logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

一云多芯:国产NPU与NVIDIA_GPU混合部署实践

GPUInventory Port 的统一抽象——这是根基。如果调度器看到的是两套不同的 API(`nvidia-smi` 和 `npu-smi`),混合部署就永远停留在运维手册层面,无法成为平台能力。HAMi 的跨芯片虚拟化——昇腾 vNPU 切分和 NVIDIA MIG/vGPU 切分在 HAMi 层完成统一建模,对上层暴露完全一致的资源申请语义(`gpu-memory: 16GB, gpu-

文章图片
#云原生#人工智能#架构 +1
一云多芯:国产NPU与NVIDIA_GPU混合部署实践

GPUInventory Port 的统一抽象——这是根基。如果调度器看到的是两套不同的 API(`nvidia-smi` 和 `npu-smi`),混合部署就永远停留在运维手册层面,无法成为平台能力。HAMi 的跨芯片虚拟化——昇腾 vNPU 切分和 NVIDIA MIG/vGPU 切分在 HAMi 层完成统一建模,对上层暴露完全一致的资源申请语义(`gpu-memory: 16GB, gpu-

文章图片
#云原生#人工智能#架构 +1
企业AI基础设施安全沙箱设计:三层隔离下的AI Agent安全

如果任何一个问题的答案是"能"或"不能"(取决于问题方向),你的安全模型需要从应用层下沉到计算运行时层——这正是三层沙箱架构设计的原始动因。

文章图片
#人工智能#安全#云原生 +1
企业AI基础设施安全沙箱设计:三层隔离下的AI Agent安全

如果任何一个问题的答案是"能"或"不能"(取决于问题方向),你的安全模型需要从应用层下沉到计算运行时层——这正是三层沙箱架构设计的原始动因。

文章图片
#人工智能#安全#云原生 +1
到底了