
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
近日,信创模盒ModelHub XC 正式发布自研产品——信创模盒大模型推理引擎 XC-LLM,致力于为国产化算力环境提供一套通用、高效、稳定的大模型服务基础平台。ModelHub XC 信创模盒是一个众创共享的国产化算力和模型开源社区,致力于打造国产化算力开发者和生态厂商合作共赢的开放平台,成为“最新最全的国产算力模型社区”,让每一个优秀模型都能在国产化算力平台上生根发芽,推动 AI 国产化事业

ModelHub XC 信创模盒是一个众创共享的国产化算力和模型开源社区,致力于打造国产化算力开发者和生态厂商合作共赢的开放平台,成为“最新最全的国产算力模型社区”,让每一个优秀模型都能在国产化算力平台上生根发芽,推动 AI 国产化事业快速升级。本次适配的核心突破在于,ModelHub XC充分发挥了其搭载的4张海光K100AI加速卡集群的极致性能,在与传统通用CPU的对比中,展现了令人瞩目的效率

信创模盒ModelHub XC 社区进一步优化了大模型推理引擎 XC-LLM,在加速卡上完成对的适配,实现高效、稳定的文本生成推理能力。Qwen系列在开源开发者生态中长期保持高热度与高使用量,在多个模型社区平台的累计下载量达数亿级,并持续形成庞大的衍生模型与开发者社区。但在国产算力落地中,一直存在适配缺口:在寒武纪MLU370-X4/X8环境里,官方vLLM路线对Qwen3并非默认支持,推理性能与

信创模盒(ModelHub XC)今日正式宣布:社区累计完成的信创算力适配认证模型数量已正式突30,000大关。这一数字不仅是对信创模盒算力池储备广度的量化印证,更标志着我们在异构算力环境下的标准化适配与工程化能力实现了质的飞跃。

信创模盒ModelHub XC 社区进一步优化了大模型推理引擎 XC-LLM,在加速卡上完成对的适配,实现高效、稳定的文本生成推理能力。Qwen系列在开源开发者生态中长期保持高热度与高使用量,在多个模型社区平台的累计下载量达数亿级,并持续形成庞大的衍生模型与开发者社区。但在国产算力落地中,一直存在适配缺口:在寒武纪MLU370-X4/X8环境里,官方vLLM路线对Qwen3并非默认支持,推理性能与

信创模盒ModelHub XC 社区进一步优化了大模型推理引擎 XC-LLM,在加速卡上完成对的适配,实现高效、稳定的文本生成推理能力。Qwen系列在开源开发者生态中长期保持高热度与高使用量,在多个模型社区平台的累计下载量达数亿级,并持续形成庞大的衍生模型与开发者社区。但在国产算力落地中,一直存在适配缺口:在寒武纪MLU370-X4/X8环境里,官方vLLM路线对Qwen3并非默认支持,推理性能与

全球产业链正在经历冷战后最深刻的重组,技术主权已从学术概念变为产业竞争的现实筹码。在这一背景下,中国传统制造业这个贡献了全球近30%制造业增加值的庞大体量,面临着一个历史性命题:如何从规模驱动转向价值驱动?答案正围绕“新质生产力”这一核心概念展开。而信创(信息技术应用创新)作为新型基础设施的国产化底座,已不再是简单的软硬件替换,而是这场生产力跃迁不可或缺的承载者。理解这场转型,需要跳出“替代”叙事

OpenAI 的 Circuit-Sparsity 稀疏模型架构(参数量 0.4B、99.9% 权重为零)一经开源即引来巨大关注,其以原生稀疏架构构建可读 “电路”,破解了大模型 “黑箱” 难题,成为 AI 可解释性领域的颠覆性突破和未来大模型演进的重要技术方向。ModelHub XC信创模盒致力于打造国产化算力模型开发者和算力生态厂商合作共赢的开放平台,解决国产算力的AI模型兼容性问题,实现“引

近日,范式智能信创模盒技术团队成功完成GLM-5模型在 天数智芯 天垓150上的全面部署与验证。本次部署以GLM-5-INT4-Pack8量化模型为核心,依托Docker容器技术,采用vLLM推理框架并启用pipeline-parallel + tensor-parallel分布式并行策略,最终对外提供标准OpenAI Chat Completions API服务。

社区致力于打造国产化算力模型开发者和算力生态厂商合作共赢的开放平台,解决国产算力的AI模型兼容性问题,实现“引擎、模型即插即用”,缩短模型在国产算力平台的部署周期,推动AI信创事业快速升级。另一方面,功能强大的模型厂商,也终于能在中国国产算力上大放光彩,带动国产算力生态的繁荣发展。“Token经济”的时代机遇,以“AI for Everyone”为使命,赋能千行万业智能化转型,致力于打造 AI 2








