logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

使用-vLLM-部署-Qwen3-4B(WSL2-RTX-2080-Ti)

本文按“新 Windows 环境 → WSL2 → GPU → Python/vLLM → 本地模型 → API 验收”组织,采用当前机器已经跑通的方案。最终得到一个监听8000端口的 OpenAI-compatible 服务。:Windows 10、WSL2 Ubuntu、NVIDIA GeForce RTX 2080 Ti(约 22 GB,compute capability 7.5)、Pyt

#人工智能
vllm多机多卡部署本地环境可行性验证

验证win10+WSL2本地局域网多机部署vllm可行性

#人工智能
到底了