预训练成本仅业界同规模 6%、Arena 搜索榜全球第四、国内第一。

文心一言

(图源网络,侵删)

2026 年 5 月 9 日,百度文心 5.1 大模型正式上线,凭借参数大压缩、成本大跳水、能力大跃升,成为国产大模型里的 “高能效卷王”。它不仅继承文心 5.0 的知识底蕴,更用硬核技术把预训练成本压到业界同规模的6%,还拿下 Arena 搜索榜全球第四、国内第一,实力看得见、摸得着。

参数“瘦”下来,实力“涨”上去

文心 5.1 Benchmark

(图源网络,侵删)

文心 5.1 最炸的亮点,就是把总参数压到文心 5.0 的 1/3、激活参数砍半,却守住旗舰级智力,堪称大模型界的 “高效减脂达人”。

这背后是Once-for-All 弹性预训练框架,靠三大弹性魔法实现降本增效:

· 弹性深度:训练时动态跳层,不同深度子模型共享权重,平衡深浅表征

· 弹性宽度:灵活调控 MoE 专家池,屏蔽冗余专家,提升专家利用率

· 弹性稀疏度:可变 Top‑k 路由,按需激活专家,在成本与性能间自由切换

最终效果:预训练算力成本仅为业界同规模 6%,推理成本大降,同级别基础效果领跑国产大模型。

技术黑科技:训更稳、练更快、效更优

文心 5.0 弹性训练示意图

(图源网络,侵删)

文心 5.1 为大模型迈向自主智能体,打造了分离式全异步强化学习底座,解决训推偏差、资源浪费、长尾任务不稳三大痛点。

· 分离式全异步架构:训练、推理、奖励、智能体循环四大子系统解耦,独立部署、弹性扩缩,流水线并行掩盖耗时

· FP8 训推一致性优化:统一低精度算子库,优化 R3 技术,训推耗时几乎不增,KL 散度直降 50%

· 资源异构弹性调度:弹性 CPU 池化盘活闲置算力,缩短迭代周期,资源利用率拉满

针对传统训练 “能力跷跷板” 难题,文心 5.1 首创MOPD 四阶段后训练管线:统一 SFT 打底→并行训练领域专家→OPD 蒸馏融合能力→通用 RL 对齐人类偏好,能力全面不冲突。

硬核成绩单:搜索登顶,推理能打

图片

(图源网络,侵删)

文心 5.1 在权威评测中火力全开,多项能力逼近国际顶尖闭源模型:

· 深度搜索:Arena 搜索榜 1223 分,全球第四、国内第一

·Agent 能力:τ3‑bench、SpreadsheetBench 超越 DeepSeek‑V4‑Pro,接近头部闭源模型

· 推理能力:数学竞赛 AIME26(用工具)得分 99.6,仅次于 Gemini 3.1 Pro

· 知识与创作:GPQA、MMLU‑Pro 表现亮眼,创意写作接近 Gemini 3.1 Pro

不管是复杂推理、长文本创作,还是工具调用、智能体任务,文心 5.1 都稳、准、强。

未来已来:高效能大模型,普惠 AI 时代

图片

大模型降本增效,离不开稳定算力支撑。算家云作为贵安超算与贵州大学联合孵化的 AI 算力平台,提供弹性 GPU 算力、预配置模型镜像、一键部署服务,适配大模型推理、微调、批量任务,低成本、易上手、高稳定,助力国产大模型普惠落地。

文心 5.1 证明:大模型不必堆参数、烧算力,技术优化 + 架构创新,就能用更少资源跑出更强性能。它既是国产大模型的效价比标杆,也为行业指明 “轻量化、高效能、低成本” 的进化方向。

更多推荐