【AI技术调研】春节期间大模型厂商的重要进展
今年春节期间,国产大模型迎来了一轮密集的"春节档"发布潮,多家厂商集中推出新一代模型,形成了激烈的竞争格局。
2026年春节国产大模型厂商进展调研报告
一、整体态势:春节档成为AI竞赛新战场
2026年春节成为国产大模型集中发布的"黄金窗口期",形成"春节AI竞赛"现象。多家厂商选择在1月27日至2月中旬密集发布新产品,头部模型的更新甚至霸榜海外社交平台X的热点前三位。这延续了2025年春节DeepSeek R1引发的破圈传播效应,春节已从传统流量低谷转变为检验大模型实用能力的最佳场景。
行业已从"参数竞赛"转向"工程化成熟期",核心特征包括:
- 技术路线:从单纯比拼参数规模转向推理效率优化和多模态能力
- 产品交付:从实验室Demo走向规模化商业服务
- 竞争焦点:编程能力与Agent(智能体)成为核心战场
二、主要厂商进展详述
1. DeepSeek(深度求索)
发布时间:1月27日及春节期间持续更新
核心进展:
- DeepSeek-OCR 2:发布新一代光学字符识别模型,采用创新的DeepEncoder V2架构,能根据图像含义动态重排图像各部分,模拟人类视觉逻辑流程,在处理复杂布局图片时显著优于传统视觉语言模型
- 长文本能力突破:网页/App端测试新版本,上下文窗口从128K提升至1M Token(百万级),可单次处理一部长篇小说
- 技术储备:1月12日发布论文《Conditional Memory via Scalable Lookup》,提出"条件记忆"概念,直指大模型记忆短板,业内普遍猜测V4版本或于春节前后发布
战略定位:继续聚焦效率优化,以极低算力成本提供高性价比服务,API价格维持"厘时代"水平。
2. 字节跳动(豆包大模型)
发布时间:2月6日-2月14日分阶段发布
核心进展:
- Seedance 2.0视频生成模型(2月6日首发):被称为"导演级AI",支持文本/图像输入,60秒内生成带原生音频的多镜头电影级视频,运镜规划和声画同步能力突出。影视飓风创始人Tim实测视频全网播放量破亿,《黑神话:悟空》制作人冯骥评价其为"地表最强视频生成模型"
- 豆包大模型2.0(2月14日发布):基础模型能力和企业级Agent能力大幅提升
- Seedream 5.0 Preview:图像创作模型同步升级
- 生态协同:即梦AI正式接入Seedance 2.0和Seedream 5.0 Lite,支持图像、视频、音频、文本四种模态输入
- 营销动作:开启"豆包过年"新春活动,发放新春红包;2026年春晚期间面向全国观众送出超10万份接入豆包大模型的科技好礼及现金红包
战略定位:依托抖音、剪映等庞大生态形成数据闭环,推动模型持续迭代,从C端内容创作工具向B端企业级Agent延伸。
3. 智谱AI(GLM系列)
发布时间:2月11日
核心进展:
- GLM-5旗舰模型:参数规模达7450亿(为上一代GLM-4.7的两倍),采用DeepSeek稀疏注意力(DSA)技术,78层隐藏层,256个专家网络,支持最高202K Token上下文窗口
- 技术特性:强化多Token预测(MTP)机制和智能体工作流优化,适配复杂推理和编程任务,定位为旗舰对话与智能体模型
- 市场表现:受模型发布消息刺激,股价2月11日盘中一度涨超10%,本周累计涨幅逾70%
战略定位:对标国际顶尖闭源模型,在开源领域保持领先(Artificial Analysis榜单全球第四、开源模型第一)。
4. MiniMax
发布时间:2月12日
核心进展:
- MiniMax M2.5编程模型:全球首个为Agent场景原生设计的生产级模型,编程与智能体性能直接对标Claude Opus 4.6
- 性能优势:支持PC、App、跨端应用全栈编程开发,在Excel高阶处理、深度调研、PPT等Office生产力场景中处于行业领先(SOTA)地位
- 效率突破:激活参数量仅10B,显存占用和推理能效比优势明显,支持100 TPS超高吞吐量,推理速度远超国际顶尖模型
- 开源策略:模型全球开源,支持本地化部署
战略定位:以"小参数、高性能"挑战行业"大力出奇迹"路线,专注Agent工程化落地。
5. 阿里巴巴(通义千问)
发布时间:1月及春节期间持续更新
核心进展:
- Qwen3-Max-Thinking:发布旗舰推理模型,聚焦多模态与推理能力提升
- 多模态矩阵:开源全系列语音合成模型Qwen3-TTS,以及专为多模态信息检索设计的Qwen3-VL-Embedding和Qwen3-VL-Reranker模型系列
- Qwen 3.5:预计2月中旬发布,配合30亿元"春节请客计划"推动获客,通过千问App作为统一AI入口,联合淘宝闪购、飞猪、盒马等阿里全系生态业务,实现购物、餐饮、出行等全场景消费协同
- Qwen-Image-2.0:图像生成模型更新
战略定位:坚持"全尺寸、全模态、全场景"战略,通过生态协同将AI从"聊天工具"升维为"生活管家"。
6. 月之暗面(Kimi)
发布时间:1月27日
核心进展:
- Kimi K2.5:公司迄今为止最智能、最全能的模型,采用原生多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与Agent任务
- 技术亮点:以"Agent Swarm"技术实现100个子智能体并行协作,将复杂任务执行效率提升数倍
- 开源策略:模型开源发布
战略定位:在长文本处理优势基础上,向多模态Agent能力延伸。
7. 百度(文心一言)
发布时间:春节期间(预计2月13日)
核心进展:
- “O计划”:内部启动代号为"O计划"的项目,与百度App相关,可能涉及春节期间AI互动玩法的重大升级
- OpenClaw智能体: reportedly将于2月13日在百度App正式上线OpenClaw(海外风靡的AI炒股智能体),此前该智能体已在国内多个互联网平台部署
战略定位:通过差异化AI体验在春节流量竞争中占据主动权,探索AI在金融场景的应用落地。
8. 美团
发布时间:2月11日
核心进展:
- LongCat"深度研究"Agent:基于三层智能体闭环架构及美团积累的物理世界数据训练,有效缓解AI在解决真实物理世界问题时的幻觉痛点
- 性能表现:用户盲测显示其攻略"整体可用率"达61.1%,优于ChatGPT的42.8%
- 开放策略:该功能已在LongCat网页免费开放
战略定位:聚焦本地生活服务场景,将AI能力从线上信息处理延伸至线下物理世界决策。
9. 科大讯飞
发布时间:2月11日
核心进展:
- 星火X2大模型:基于全国产算力训练,整体能力对标国际顶尖模型水平,在数学、推理、语言理解、智能体等能力上媲美国际最优
- 多语言支持:130+多语言综合能力提升
- 行业应用:依托算法突破、行业高质量数据集及专业思维链强化学习,星火行业大模型持续升级
战略定位:强调自主可控技术路线,深耕教育、医疗等垂直行业应用。
10. 其他厂商
- 面壁智能:发布并开源新一代全模态旗舰模型MiniCPM-o 4.5
- 生数科技、银河通用、智源研究院:同期发布新模型,丰富国产大模型生态
三、技术趋势总结
| 趋势方向 | 具体表现 | 代表厂商 |
|---|---|---|
| 超长上下文 | 从128K向1M Token级别跃升,支持长篇小说、视频理解 | DeepSeek、智谱 |
| 多模态融合 | 文本、图像、视频、音频统一建模,端到端生成 | 字节跳动、阿里、Kimi |
| Agent工程化 | 从"能对话"到"能执行",支持复杂任务流和工具调用 | MiniMax、智谱、美团 |
| 编程能力 | 全栈开发、Office生产力场景深度优化 | MiniMax、智谱、阿里 |
| 成本优化 | 推理成本持续下降,API进入"厘时代" | DeepSeek、阿里、字节 |
| 开源生态 | 头部模型持续开源,推动技术民主化 | DeepSeek、Kimi、MiniMax、智谱 |
四、产业影响与展望
-
竞争格局:通用大模型马太效应凸显,呈现"强者恒强"局面,中小玩家机会更多出现在垂直行业领域
-
商业化进程:随着成本持续下降,AI正从C端尝鲜迈向B端规模化落地,Token调用量实现多倍增长的同时费用大幅降低
-
生态协同:互联网大厂依托现有业务生态(电商、本地生活、内容平台)构建AI服务闭环,形成"模型-应用-数据"飞轮
-
国际化:国产模型在性能上已比肩国际顶尖水平(如Claude Opus 4.6、GPT-5),并开始通过开源和API服务影响全球开发者生态
报告日期:2026年2月
数据来源:第一财经、财联社、科创板日报、钛媒体、澎湃新闻等公开报道
下面补充国际大模型市场的动态。
海外厂商春节档重要进展补充报告
一、OpenAI:Agent化转型与模型迭代
发布时间:2月5日-2月13日
核心进展:
- GPT-5.3-Codex(2月5日发布):OpenAI迄今最强的编程模型,首次将Codex代码执行能力与GPT-5.2推理能力融合,速度提升25%,实现从"代码生成"到"通用编程Agent"的跨越,支持长时自主项目开发
- GPT-5.2 Instant更新(2月10日):优化响应风格,回答更克制、 grounded,建议类问题回答更清晰,重要信息前置
- 产品矩阵完善:
- OpenAI Frontier:企业级AI Agent平台,支持构建、部署和管理跨系统AI代理
- Codex macOS App:桌面端编码代理管理工具
- ChatGPT Go:全球170+国家上线的低价订阅层(约$8/月)
- 模型退役:2月13日起,GPT-4o、GPT-4.1系列、o4-mini等旧模型从ChatGPT界面全面退役,GPT-5.x家族成为核心
战略定位:从对话式AI向Agentic系统转型,模型不再仅响应提示,而是主动执行任务、协助团队、集成真实工作流。
二、Anthropic:Claude 4.6系列双轨发布
发布时间:2月4日、2月17日
核心进展:
- Claude Opus 4.6(2月4日发布):编程与Agent能力全面升级,SWE-Bench Pro得分超越GPT-5.3-Codex,支持更长时Agent任务规划和更大代码库操作
- Claude Sonnet 4.6(2月17日发布):定位"全能主力模型",采用混合推理架构,支持自适应/扩展思考模式,100万Token上下文窗口(Beta),MRCR v2测试中匹配率从4.5版本的18.5%跃升至65%,OSWorld计算机使用基准达72.5%
- Claude Code 2.1.45:支持Sonnet 4.6,新增插件配置读取、自定义加载提示、SDK速率限制信息等功能
- Claude 5预告:CEO Dario Amodei确认将于2026年Q2(4月Beta、5月API、6月消费者版)发布,定位"更温暖、更智能"
战略定位:通过"Opus+Sonnet"双轨策略覆盖高端专业与大众市场,强化Agent工程化和长上下文能力。
三、Google DeepMind:AlphaCode 3与Gemini系列
发布时间:1月30日、2月中旬
核心进展:
- AlphaCode 3(1月30日发布):DeepMind新一代编程模型,在终端交互和漏洞扫描等基准任务中表现突出,与GPT-5.3-Codex形成直接竞争
- Gemini 3.1 Pro(2月中旬):推理模型更新,在LMSYS竞技场总榜排名第三,仅次于Gemini 3.1 Pro Preview
- 基础设施:NVIDIA GB200 NVL72系统(专为GPT-5.3-Codex等Agentic编码模型设计)于2月2日大规模部署,解决长时任务延迟问题
战略定位:通过Alpha系列专攻代码智能,与Gemini通用模型形成互补,强化企业级开发工具链。
四、xAI:Grok 3开源承诺
发布时间:2月10日确认
核心进展:
- Grok 3开源确认:Elon Musk在X平台确认将开源Grok 3,履行2025年8月承诺。此前Grok 2.5已于2025年8月在Hugging Face开源
- 背景:Grok 3于2025年2月发布,基于孟菲斯数据中心约20万块GPU训练,Musk称其能力比Grok 2.5"高出一个数量级"
- 策略延续:xAI坚持"新一代模型稳定后开源上一代"策略,此前已开源Grok 1(2024年)和Grok 2.5
战略定位:通过开源策略获取开发者生态,同时依托X平台数据优势训练迭代。
五、Meta:LLaMA 4生态完善
发布时间:春节期间持续更新
核心进展:
- LLaMA 4系列(2025年4月首发,2026年初生态完善):
- Scout:405B参数,1000万Token上下文窗口(当时开源模型最大),单张H100可运行
- Maverick:多模态能力,支持文本、图像、视频理解
- Behemoth:2万亿参数"教师模型",通过协同蒸馏提升Scout/Maverick性能,尚未公开发布
- 许可证优化:LLaMA 4社区许可证更宽松,允许商业使用(除7亿月活以上公司需单独授权),但欧盟用户仍受限
战略定位:以"开源权重+超大上下文"挑战闭源模型,推动AI民主化,但严格意义上不完全符合OSI开源定义(因存在使用限制)。
六、其他海外动态
- Lyrics 3:音乐生成模型更新(2月中旬)
- 欧盟监管反应:2月6日发布GPT-5.3-Codex临时指南,要求透明度和"可信网络访问"计划,防止漏洞链攻击,体现对Agentic AI双重用途风险的快速监管响应
七、中外厂商春节档对比分析
| 维度 | 海外厂商 | 国产厂商 |
|---|---|---|
| 核心战场 | 编程Agent(OpenAI/Anthropic/Google) | 编程+视频生成(MiniMax/字节/智谱) |
| 上下文长度 | 100万Token(Claude Sonnet 4.6) | 100万-1000万Token(DeepSeek/LLaMA 4 Scout) |
| 开源策略 | 部分开源(xAI Grok、Meta LLaMA) | 全面开源(DeepSeek、Kimi、MiniMax、智谱) |
| Agent能力 | 企业级平台(OpenAI Frontier) | 多Agent并行(Kimi 100个子智能体) |
| 多模态 | 视频/音乐生成相对滞后 | 视频生成领先(Seedance 2.0、可灵3.0) |
| 成本策略 | ChatGPT Go低价层($8/月) | API"厘时代"(DeepSeek引领) |
| 监管环境 | 欧盟快速立法(AI Act) | 国内相对宽松,侧重应用创新 |
八、关键趋势总结
-
Agentic AI成为共识:无论中外,大模型已从"聊天工具"转向"任务执行者",编程和复杂工作流自动化是首要落地场景
-
上下文长度军备竞赛:从128K到1M甚至10M Token,长文本能力成为模型"记忆力"和"理解力"的关键指标
-
开源与闭源并行:海外(Meta、xAI)和国产(DeepSeek、智谱、MiniMax)均推进开源,但OpenAI、Anthropic坚持闭源高端路线,形成"开源引流+闭源变现"双轨格局
-
推理成本持续下降:中外厂商均通过架构优化(MoE、稀疏注意力)降低推理成本,推动AI应用普及
-
春节档全球化:2026年春节成为中外AI厂商共同选择的发布窗口,反映中国市场的全球影响力及AI竞赛的"中国时间"特征
补充说明:海外厂商在编程Agent领域保持先发优势(OpenAI Codex、Anthropic Claude Code),但国产厂商在视频生成、多模态融合和极致成本控制方面已形成差异化竞争力。双方在"Agent工程化"赛道上的竞争将决定2026年AI应用落地的市场格局。
更多推荐
所有评论(0)