vllm启动qwen3-vl
·
vllm serve Qwen3-VL-2B-Thinking \
--tensor-parallel-size 1 \
--mm-encoder-tp-mode data \
--async-scheduling \
--media-io-kwargs '{"video": {"num_frames": -1}}' \
--host 0.0.0.0 \
--port 22002
更多推荐
vllm serve Qwen3-VL-2B-Thinking \
--tensor-parallel-size 1 \
--mm-encoder-tp-mode data \
--async-scheduling \
--media-io-kwargs '{"video": {"num_frames": -1}}' \
--host 0.0.0.0 \
--port 22002
更多推荐
所有评论(0)