logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

1. vLLM单机单卡部署大模型

安装 NVIDIA Container Toolkit,参考[Installing the NVIDIA Container Toolkit](三、安装 NVIDIA Container Toolkit。这个命令是前台启动,测试需要重开两个窗口。使用 ModelScope(国内推荐)五、验证docker可以使用GPU。安装 CUDAToolkit。添加 NVIDIA 官方源。差不多14tokens

文章图片
#运维
vllm部署大模型全整合(多种部署)

本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

文章图片
#人工智能#kubernetes
2. docker部署本地模型-ollama

访问IP:3080,设置登录账号密码,如果是外部的Ollama,右上角设置—管理员设置—外部链接进行添加。验证 Ollama 容器是否正常运行。访问IP:3080,设置登录账号密码。重新加载即可,会弹出下载的模型文件。

#docker#容器#运维
vllm部署大模型全整合(多种部署)

本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

文章图片
#人工智能#kubernetes
vllm部署大模型全整合(多种部署)

本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

文章图片
#人工智能#kubernetes
vllm部署大模型全整合(多种部署)

本文介绍了在Ubuntu 22.04系统上配置GPU服务器集群的详细步骤。部署vllm服务:单机单卡部署、多级单卡部署、k8s单机部署、k8s集群Ray部署

文章图片
#人工智能#kubernetes
4. 部署postgresql服务并监控postgresql

如果这些 groups 都存在,说明 Prometheus 已经成功加载你的规则。

#postgresql#数据库
    共 22 条
  • 1
  • 2
  • 3
  • 请选择