文心 5.1 重新定义国产大模型:成本革命与能力登顶
预训练成本仅业界同规模 6%、Arena 搜索榜全球第四、国内第一。

(图源网络,侵删)
2026 年 5 月 9 日,百度文心 5.1 大模型正式上线,凭借参数大压缩、成本大跳水、能力大跃升,成为国产大模型里的 “高能效卷王”。它不仅继承文心 5.0 的知识底蕴,更用硬核技术把预训练成本压到业界同规模的6%,还拿下 Arena 搜索榜全球第四、国内第一,实力看得见、摸得着。
参数“瘦”下来,实力“涨”上去

(图源网络,侵删)
文心 5.1 最炸的亮点,就是把总参数压到文心 5.0 的 1/3、激活参数砍半,却守住旗舰级智力,堪称大模型界的 “高效减脂达人”。
这背后是Once-for-All 弹性预训练框架,靠三大弹性魔法实现降本增效:
· 弹性深度:训练时动态跳层,不同深度子模型共享权重,平衡深浅表征
· 弹性宽度:灵活调控 MoE 专家池,屏蔽冗余专家,提升专家利用率
· 弹性稀疏度:可变 Top‑k 路由,按需激活专家,在成本与性能间自由切换
最终效果:预训练算力成本仅为业界同规模 6%,推理成本大降,同级别基础效果领跑国产大模型。
技术黑科技:训更稳、练更快、效更优

(图源网络,侵删)
文心 5.1 为大模型迈向自主智能体,打造了分离式全异步强化学习底座,解决训推偏差、资源浪费、长尾任务不稳三大痛点。
· 分离式全异步架构:训练、推理、奖励、智能体循环四大子系统解耦,独立部署、弹性扩缩,流水线并行掩盖耗时
· FP8 训推一致性优化:统一低精度算子库,优化 R3 技术,训推耗时几乎不增,KL 散度直降 50%
· 资源异构弹性调度:弹性 CPU 池化盘活闲置算力,缩短迭代周期,资源利用率拉满
针对传统训练 “能力跷跷板” 难题,文心 5.1 首创MOPD 四阶段后训练管线:统一 SFT 打底→并行训练领域专家→OPD 蒸馏融合能力→通用 RL 对齐人类偏好,能力全面不冲突。
硬核成绩单:搜索登顶,推理能打

(图源网络,侵删)
文心 5.1 在权威评测中火力全开,多项能力逼近国际顶尖闭源模型:
· 深度搜索:Arena 搜索榜 1223 分,全球第四、国内第一
·Agent 能力:τ3‑bench、SpreadsheetBench 超越 DeepSeek‑V4‑Pro,接近头部闭源模型
· 推理能力:数学竞赛 AIME26(用工具)得分 99.6,仅次于 Gemini 3.1 Pro
· 知识与创作:GPQA、MMLU‑Pro 表现亮眼,创意写作接近 Gemini 3.1 Pro
不管是复杂推理、长文本创作,还是工具调用、智能体任务,文心 5.1 都稳、准、强。
未来已来:高效能大模型,普惠 AI 时代

大模型降本增效,离不开稳定算力支撑。算家云作为贵安超算与贵州大学联合孵化的 AI 算力平台,提供弹性 GPU 算力、预配置模型镜像、一键部署服务,适配大模型推理、微调、批量任务,低成本、易上手、高稳定,助力国产大模型普惠落地。
文心 5.1 证明:大模型不必堆参数、烧算力,技术优化 + 架构创新,就能用更少资源跑出更强性能。它既是国产大模型的效价比标杆,也为行业指明 “轻量化、高效能、低成本” 的进化方向。
更多推荐



所有评论(0)