logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

vLLM 模型输出不一致

在vLLM框架下部署Qwen2.5VL模型时,观察到三种不同的生成行为差异。对于现象一,可能是由批处理机制导致。对于现象二,暂无法解释。

#科技
Ollama “... dial tcp: lookup huggingface.co“

Ollama "Error: max retries exceeded: Get ... dial tcp: lookup huggingface.co" 解决方法。

#科技
到底了