
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
1. vLLM单机单卡部署大模型
安装 NVIDIA Container Toolkit,参考[Installing the NVIDIA Container Toolkit](三、安装 NVIDIA Container Toolkit。这个命令是前台启动,测试需要重开两个窗口。使用 ModelScope(国内推荐)五、验证docker可以使用GPU。安装 CUDAToolkit。添加 NVIDIA 官方源。差不多14tokens

vllm部署大模型全整合(多种部署)
本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

2. docker部署本地模型-ollama
访问IP:3080,设置登录账号密码,如果是外部的Ollama,右上角设置—管理员设置—外部链接进行添加。验证 Ollama 容器是否正常运行。访问IP:3080,设置登录账号密码。重新加载即可,会弹出下载的模型文件。
vllm部署大模型全整合(多种部署)
本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

vllm部署大模型全整合(多种部署)
本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

vllm部署大模型全整合(多种部署)
本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

4. 部署postgresql服务并监控postgresql
如果这些 groups 都存在,说明 Prometheus 已经成功加载你的规则。










