
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
政务系统要部署大模型,第一场会经常开成「要不要私有化」。私有化只回答软件跑在谁的机房。真正卡住上线的,是另外三件事:数据进哪一张网,模型说的话算不算机关对外表态,以及省里统建之后,各委办局怎样共用模型和算力、又不把数据串在一起。2025 年 10 月,中央网信办、国家发展改革委印发《政务领域人工智能大模型部署应用指引》(下称《指引》)。2026 年 5 月,国家网信办、国家发展改革委、工业和信息化

如果任何一个问题的答案是"能"或"不能"(取决于问题方向),你的安全模型需要从应用层下沉到计算运行时层——这正是三层沙箱架构设计的原始动因。

GPUInventory Port 的统一抽象——这是根基。如果调度器看到的是两套不同的 API(`nvidia-smi` 和 `npu-smi`),混合部署就永远停留在运维手册层面,无法成为平台能力。HAMi 的跨芯片虚拟化——昇腾 vNPU 切分和 NVIDIA MIG/vGPU 切分在 HAMi 层完成统一建模,对上层暴露完全一致的资源申请语义(`gpu-memory: 16GB, gpu-

GPUInventory Port 的统一抽象——这是根基。如果调度器看到的是两套不同的 API(`nvidia-smi` 和 `npu-smi`),混合部署就永远停留在运维手册层面,无法成为平台能力。HAMi 的跨芯片虚拟化——昇腾 vNPU 切分和 NVIDIA MIG/vGPU 切分在 HAMi 层完成统一建模,对上层暴露完全一致的资源申请语义(`gpu-memory: 16GB, gpu-








