欢迎光临
我们一直在努力

【异常】vLLM 分布式集群加载 HuggingFace 模型超时‘timed out‘ thrown while requesting HEAD https://huggingface.co/Qwe

vLLM 分布式集群加载 HuggingFace 模型超时问题排查与解决方案

一、报错内容

在基于 Ray 部署 vLLM 分布式推理服务的场景下,执行模型启动命令后,服务无法完成模型加载,日志反复出现配置文件请求超时并重试的现象。

启动命令示例:

user@workstation:~/vllm-cluster$ ./launch-cluster.sh exec vllm serve \\
Qwen/Qwen2-7B-Instruct \\
–host 0.0.0.0 \\
–port 8000 \\

赞(0)
未经允许不得转载:171主机测评 » 【异常】vLLM 分布式集群加载 HuggingFace 模型超时‘timed out‘ thrown while requesting HEAD https://huggingface.co/Qwe
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址