今年春节期间,国产大模型迎来了一轮密集的"春节档"发布潮,多家厂商集中推出新一代模型,形成了激烈的竞争格局。


2026年春节国产大模型厂商进展调研报告

一、整体态势:春节档成为AI竞赛新战场

2026年春节成为国产大模型集中发布的"黄金窗口期",形成"春节AI竞赛"现象。多家厂商选择在1月27日至2月中旬密集发布新产品,头部模型的更新甚至霸榜海外社交平台X的热点前三位。这延续了2025年春节DeepSeek R1引发的破圈传播效应,春节已从传统流量低谷转变为检验大模型实用能力的最佳场景。

行业已从"参数竞赛"转向"工程化成熟期",核心特征包括:

  • 技术路线:从单纯比拼参数规模转向推理效率优化和多模态能力
  • 产品交付:从实验室Demo走向规模化商业服务
  • 竞争焦点:编程能力与Agent(智能体)成为核心战场

二、主要厂商进展详述

1. DeepSeek(深度求索)

发布时间:1月27日及春节期间持续更新

核心进展

  • DeepSeek-OCR 2:发布新一代光学字符识别模型,采用创新的DeepEncoder V2架构,能根据图像含义动态重排图像各部分,模拟人类视觉逻辑流程,在处理复杂布局图片时显著优于传统视觉语言模型
  • 长文本能力突破:网页/App端测试新版本,上下文窗口从128K提升至1M Token(百万级),可单次处理一部长篇小说
  • 技术储备:1月12日发布论文《Conditional Memory via Scalable Lookup》,提出"条件记忆"概念,直指大模型记忆短板,业内普遍猜测V4版本或于春节前后发布

战略定位:继续聚焦效率优化,以极低算力成本提供高性价比服务,API价格维持"厘时代"水平。


2. 字节跳动(豆包大模型)

发布时间:2月6日-2月14日分阶段发布

核心进展

  • Seedance 2.0视频生成模型(2月6日首发):被称为"导演级AI",支持文本/图像输入,60秒内生成带原生音频的多镜头电影级视频,运镜规划和声画同步能力突出。影视飓风创始人Tim实测视频全网播放量破亿,《黑神话:悟空》制作人冯骥评价其为"地表最强视频生成模型"
  • 豆包大模型2.0(2月14日发布):基础模型能力和企业级Agent能力大幅提升
  • Seedream 5.0 Preview:图像创作模型同步升级
  • 生态协同:即梦AI正式接入Seedance 2.0和Seedream 5.0 Lite,支持图像、视频、音频、文本四种模态输入
  • 营销动作:开启"豆包过年"新春活动,发放新春红包;2026年春晚期间面向全国观众送出超10万份接入豆包大模型的科技好礼及现金红包

战略定位:依托抖音、剪映等庞大生态形成数据闭环,推动模型持续迭代,从C端内容创作工具向B端企业级Agent延伸。


3. 智谱AI(GLM系列)

发布时间:2月11日

核心进展

  • GLM-5旗舰模型:参数规模达7450亿(为上一代GLM-4.7的两倍),采用DeepSeek稀疏注意力(DSA)技术,78层隐藏层,256个专家网络,支持最高202K Token上下文窗口
  • 技术特性:强化多Token预测(MTP)机制和智能体工作流优化,适配复杂推理和编程任务,定位为旗舰对话与智能体模型
  • 市场表现:受模型发布消息刺激,股价2月11日盘中一度涨超10%,本周累计涨幅逾70%

战略定位:对标国际顶尖闭源模型,在开源领域保持领先(Artificial Analysis榜单全球第四、开源模型第一)。


4. MiniMax

发布时间:2月12日

核心进展

  • MiniMax M2.5编程模型:全球首个为Agent场景原生设计的生产级模型,编程与智能体性能直接对标Claude Opus 4.6
  • 性能优势:支持PC、App、跨端应用全栈编程开发,在Excel高阶处理、深度调研、PPT等Office生产力场景中处于行业领先(SOTA)地位
  • 效率突破:激活参数量仅10B,显存占用和推理能效比优势明显,支持100 TPS超高吞吐量,推理速度远超国际顶尖模型
  • 开源策略:模型全球开源,支持本地化部署

战略定位:以"小参数、高性能"挑战行业"大力出奇迹"路线,专注Agent工程化落地。


5. 阿里巴巴(通义千问)

发布时间:1月及春节期间持续更新

核心进展

  • Qwen3-Max-Thinking:发布旗舰推理模型,聚焦多模态与推理能力提升
  • 多模态矩阵:开源全系列语音合成模型Qwen3-TTS,以及专为多模态信息检索设计的Qwen3-VL-Embedding和Qwen3-VL-Reranker模型系列
  • Qwen 3.5:预计2月中旬发布,配合30亿元"春节请客计划"推动获客,通过千问App作为统一AI入口,联合淘宝闪购、飞猪、盒马等阿里全系生态业务,实现购物、餐饮、出行等全场景消费协同
  • Qwen-Image-2.0:图像生成模型更新

战略定位:坚持"全尺寸、全模态、全场景"战略,通过生态协同将AI从"聊天工具"升维为"生活管家"。


6. 月之暗面(Kimi)

发布时间:1月27日

核心进展

  • Kimi K2.5:公司迄今为止最智能、最全能的模型,采用原生多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与Agent任务
  • 技术亮点:以"Agent Swarm"技术实现100个子智能体并行协作,将复杂任务执行效率提升数倍
  • 开源策略:模型开源发布

战略定位:在长文本处理优势基础上,向多模态Agent能力延伸。


7. 百度(文心一言)

发布时间:春节期间(预计2月13日)

核心进展

  • “O计划”:内部启动代号为"O计划"的项目,与百度App相关,可能涉及春节期间AI互动玩法的重大升级
  • OpenClaw智能体: reportedly将于2月13日在百度App正式上线OpenClaw(海外风靡的AI炒股智能体),此前该智能体已在国内多个互联网平台部署

战略定位:通过差异化AI体验在春节流量竞争中占据主动权,探索AI在金融场景的应用落地。


8. 美团

发布时间:2月11日

核心进展

  • LongCat"深度研究"Agent:基于三层智能体闭环架构及美团积累的物理世界数据训练,有效缓解AI在解决真实物理世界问题时的幻觉痛点
  • 性能表现:用户盲测显示其攻略"整体可用率"达61.1%,优于ChatGPT的42.8%
  • 开放策略:该功能已在LongCat网页免费开放

战略定位:聚焦本地生活服务场景,将AI能力从线上信息处理延伸至线下物理世界决策。


9. 科大讯飞

发布时间:2月11日

核心进展

  • 星火X2大模型:基于全国产算力训练,整体能力对标国际顶尖模型水平,在数学、推理、语言理解、智能体等能力上媲美国际最优
  • 多语言支持:130+多语言综合能力提升
  • 行业应用:依托算法突破、行业高质量数据集及专业思维链强化学习,星火行业大模型持续升级

战略定位:强调自主可控技术路线,深耕教育、医疗等垂直行业应用。


10. 其他厂商
  • 面壁智能:发布并开源新一代全模态旗舰模型MiniCPM-o 4.5
  • 生数科技、银河通用、智源研究院:同期发布新模型,丰富国产大模型生态

三、技术趋势总结

趋势方向具体表现代表厂商
超长上下文从128K向1M Token级别跃升,支持长篇小说、视频理解DeepSeek、智谱
多模态融合文本、图像、视频、音频统一建模,端到端生成字节跳动、阿里、Kimi
Agent工程化从"能对话"到"能执行",支持复杂任务流和工具调用MiniMax、智谱、美团
编程能力全栈开发、Office生产力场景深度优化MiniMax、智谱、阿里
成本优化推理成本持续下降,API进入"厘时代"DeepSeek、阿里、字节
开源生态头部模型持续开源,推动技术民主化DeepSeek、Kimi、MiniMax、智谱

四、产业影响与展望

  1. 竞争格局:通用大模型马太效应凸显,呈现"强者恒强"局面,中小玩家机会更多出现在垂直行业领域

  2. 商业化进程:随着成本持续下降,AI正从C端尝鲜迈向B端规模化落地,Token调用量实现多倍增长的同时费用大幅降低

  3. 生态协同:互联网大厂依托现有业务生态(电商、本地生活、内容平台)构建AI服务闭环,形成"模型-应用-数据"飞轮

  4. 国际化:国产模型在性能上已比肩国际顶尖水平(如Claude Opus 4.6、GPT-5),并开始通过开源和API服务影响全球开发者生态


报告日期:2026年2月
数据来源:第一财经、财联社、科创板日报、钛媒体、澎湃新闻等公开报道


下面补充国际大模型市场的动态。


海外厂商春节档重要进展补充报告

一、OpenAI:Agent化转型与模型迭代

发布时间:2月5日-2月13日

核心进展

  • GPT-5.3-Codex(2月5日发布):OpenAI迄今最强的编程模型,首次将Codex代码执行能力与GPT-5.2推理能力融合,速度提升25%,实现从"代码生成"到"通用编程Agent"的跨越,支持长时自主项目开发
  • GPT-5.2 Instant更新(2月10日):优化响应风格,回答更克制、 grounded,建议类问题回答更清晰,重要信息前置
  • 产品矩阵完善
    • OpenAI Frontier:企业级AI Agent平台,支持构建、部署和管理跨系统AI代理
    • Codex macOS App:桌面端编码代理管理工具
    • ChatGPT Go:全球170+国家上线的低价订阅层(约$8/月)
  • 模型退役:2月13日起,GPT-4o、GPT-4.1系列、o4-mini等旧模型从ChatGPT界面全面退役,GPT-5.x家族成为核心

战略定位:从对话式AI向Agentic系统转型,模型不再仅响应提示,而是主动执行任务、协助团队、集成真实工作流。


二、Anthropic:Claude 4.6系列双轨发布

发布时间:2月4日、2月17日

核心进展

  • Claude Opus 4.6(2月4日发布):编程与Agent能力全面升级,SWE-Bench Pro得分超越GPT-5.3-Codex,支持更长时Agent任务规划和更大代码库操作
  • Claude Sonnet 4.6(2月17日发布):定位"全能主力模型",采用混合推理架构,支持自适应/扩展思考模式,100万Token上下文窗口(Beta),MRCR v2测试中匹配率从4.5版本的18.5%跃升至65%,OSWorld计算机使用基准达72.5%
  • Claude Code 2.1.45:支持Sonnet 4.6,新增插件配置读取、自定义加载提示、SDK速率限制信息等功能
  • Claude 5预告:CEO Dario Amodei确认将于2026年Q2(4月Beta、5月API、6月消费者版)发布,定位"更温暖、更智能"

战略定位:通过"Opus+Sonnet"双轨策略覆盖高端专业与大众市场,强化Agent工程化和长上下文能力。


三、Google DeepMind:AlphaCode 3与Gemini系列

发布时间:1月30日、2月中旬

核心进展

  • AlphaCode 3(1月30日发布):DeepMind新一代编程模型,在终端交互和漏洞扫描等基准任务中表现突出,与GPT-5.3-Codex形成直接竞争
  • Gemini 3.1 Pro(2月中旬):推理模型更新,在LMSYS竞技场总榜排名第三,仅次于Gemini 3.1 Pro Preview
  • 基础设施:NVIDIA GB200 NVL72系统(专为GPT-5.3-Codex等Agentic编码模型设计)于2月2日大规模部署,解决长时任务延迟问题

战略定位:通过Alpha系列专攻代码智能,与Gemini通用模型形成互补,强化企业级开发工具链。


四、xAI:Grok 3开源承诺

发布时间:2月10日确认

核心进展

  • Grok 3开源确认:Elon Musk在X平台确认将开源Grok 3,履行2025年8月承诺。此前Grok 2.5已于2025年8月在Hugging Face开源
  • 背景:Grok 3于2025年2月发布,基于孟菲斯数据中心约20万块GPU训练,Musk称其能力比Grok 2.5"高出一个数量级"
  • 策略延续:xAI坚持"新一代模型稳定后开源上一代"策略,此前已开源Grok 1(2024年)和Grok 2.5

战略定位:通过开源策略获取开发者生态,同时依托X平台数据优势训练迭代。


五、Meta:LLaMA 4生态完善

发布时间:春节期间持续更新

核心进展

  • LLaMA 4系列(2025年4月首发,2026年初生态完善):
    • Scout:405B参数,1000万Token上下文窗口(当时开源模型最大),单张H100可运行
    • Maverick:多模态能力,支持文本、图像、视频理解
    • Behemoth:2万亿参数"教师模型",通过协同蒸馏提升Scout/Maverick性能,尚未公开发布
  • 许可证优化:LLaMA 4社区许可证更宽松,允许商业使用(除7亿月活以上公司需单独授权),但欧盟用户仍受限

战略定位:以"开源权重+超大上下文"挑战闭源模型,推动AI民主化,但严格意义上不完全符合OSI开源定义(因存在使用限制)。


六、其他海外动态

  • Lyrics 3:音乐生成模型更新(2月中旬)
  • 欧盟监管反应:2月6日发布GPT-5.3-Codex临时指南,要求透明度和"可信网络访问"计划,防止漏洞链攻击,体现对Agentic AI双重用途风险的快速监管响应

七、中外厂商春节档对比分析

维度海外厂商国产厂商
核心战场编程Agent(OpenAI/Anthropic/Google)编程+视频生成(MiniMax/字节/智谱)
上下文长度100万Token(Claude Sonnet 4.6)100万-1000万Token(DeepSeek/LLaMA 4 Scout)
开源策略部分开源(xAI Grok、Meta LLaMA)全面开源(DeepSeek、Kimi、MiniMax、智谱)
Agent能力企业级平台(OpenAI Frontier)多Agent并行(Kimi 100个子智能体)
多模态视频/音乐生成相对滞后视频生成领先(Seedance 2.0、可灵3.0)
成本策略ChatGPT Go低价层($8/月)API"厘时代"(DeepSeek引领)
监管环境欧盟快速立法(AI Act)国内相对宽松,侧重应用创新

八、关键趋势总结

  1. Agentic AI成为共识:无论中外,大模型已从"聊天工具"转向"任务执行者",编程和复杂工作流自动化是首要落地场景

  2. 上下文长度军备竞赛:从128K到1M甚至10M Token,长文本能力成为模型"记忆力"和"理解力"的关键指标

  3. 开源与闭源并行:海外(Meta、xAI)和国产(DeepSeek、智谱、MiniMax)均推进开源,但OpenAI、Anthropic坚持闭源高端路线,形成"开源引流+闭源变现"双轨格局

  4. 推理成本持续下降:中外厂商均通过架构优化(MoE、稀疏注意力)降低推理成本,推动AI应用普及

  5. 春节档全球化:2026年春节成为中外AI厂商共同选择的发布窗口,反映中国市场的全球影响力及AI竞赛的"中国时间"特征


补充说明:海外厂商在编程Agent领域保持先发优势(OpenAI Codex、Anthropic Claude Code),但国产厂商在视频生成、多模态融合和极致成本控制方面已形成差异化竞争力。双方在"Agent工程化"赛道上的竞争将决定2026年AI应用落地的市场格局。

更多推荐