logo AMD开发者中国社区

AMD开发者中国社区
首页边缘AI开发云端AI开发ROCm开源生态开发者社区
去全站搜索看看?

登录社区云

登录社区云,与社区用户共同成长

AMD开发者中国社区

邀请您加入社区

欢迎加入社区

欢迎加入社区

可用性测试
  • LLM推理服务GPU共享2026:MIG、vGPU与MPS生产环境对比实战

    - 硬件级隔离,实例间零干扰- 内存带宽和 SM 按比例分配- 需要重启才能动态调整分区(H100 开始支持部分热调整)### 1.2 vGPU(Virtual GPU)NVIDIA 软件虚拟化方案,支持多个 VM 共享一块物理 GPU,通过时分复用(Time-slicing)实现。:- 无需授权费,开源免费- 多进程真正并行执行(不是时分)- 隔离性弱:一个进程 OOM 可能影响其他进程—##

    少林码僧
    2026-06-23 00:14:06
     251 
     8 
    #人工智能#windows#可用性测试 +1
  • KOS+VLLM测试deepseek基准性能

    浪潮信息KOS是浪潮信息基于Linux Kernel、OpenAnolis等开源技术自主研发的一款服务器操作系统,支持x86、ARM等主流架构处理器,性能和稳定性居于行业领先地位,具备成熟的 CentOS 迁移和替换能力,可满足云计算、大数据、分布式存储、人工智能、边缘计算等应用场景需求。vLLM是一种用于大规模语言模型(LLM)推理的框架,旨在提高模型的吞吐量和降低延迟。vLLM通过优化内存管理

    ITer_szlgz
    2025-09-01 09:00:39
     762 
     8 
    #linux#服务器#运维 +2
没有更多了
回到
顶部
logo 提供社区服务与技术支持
logo 提供社区服务与技术支持
©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号