logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

政务大模型部署的工程问题:隔离、复用与辅助定位

政务系统要部署大模型,第一场会经常开成「要不要私有化」。私有化只回答软件跑在谁的机房。真正卡住上线的,是另外三件事:数据进哪一张网,模型说的话算不算机关对外表态,以及省里统建之后,各委办局怎样共用模型和算力、又不把数据串在一起。2025 年 10 月,中央网信办、国家发展改革委印发《政务领域人工智能大模型部署应用指引》(下称《指引》)。2026 年 5 月,国家网信办、国家发展改革委、工业和信息化

文章图片
#政务#python#开发语言
企业AI基础设施安全沙箱设计:三层隔离下的AI Agent安全

如果任何一个问题的答案是"能"或"不能"(取决于问题方向),你的安全模型需要从应用层下沉到计算运行时层——这正是三层沙箱架构设计的原始动因。

文章图片
#人工智能#安全#云原生 +1
一云多芯:国产NPU与NVIDIA_GPU混合部署实践

GPUInventory Port 的统一抽象——这是根基。如果调度器看到的是两套不同的 API(`nvidia-smi` 和 `npu-smi`),混合部署就永远停留在运维手册层面,无法成为平台能力。HAMi 的跨芯片虚拟化——昇腾 vNPU 切分和 NVIDIA MIG/vGPU 切分在 HAMi 层完成统一建模,对上层暴露完全一致的资源申请语义(`gpu-memory: 16GB, gpu-

文章图片
#云原生#人工智能#架构 +1
一云多芯:国产NPU与NVIDIA_GPU混合部署实践

GPUInventory Port 的统一抽象——这是根基。如果调度器看到的是两套不同的 API(`nvidia-smi` 和 `npu-smi`),混合部署就永远停留在运维手册层面,无法成为平台能力。HAMi 的跨芯片虚拟化——昇腾 vNPU 切分和 NVIDIA MIG/vGPU 切分在 HAMi 层完成统一建模,对上层暴露完全一致的资源申请语义(`gpu-memory: 16GB, gpu-

文章图片
#云原生#人工智能#架构 +1
到底了