AI 大模型日报 — 2026年7月24日(星期五)
🤖 AI 大模型日报 — 2026年7月24日(星期五)
📅 本期覆盖:2026年7月9日 — 7月24日 期间重要动态
🔍 信息来源:OpenAI官方、Anthropic、Nature、The New Stack、CSDN、Zapier、LlamaStats 等
📌 本周热门话题速览
| 排名 | 话题 | 热度 |
|---|---|---|
| 🔥1 | GPT-5.6 发布 — Sol/Terra/Luna 三档新命名体系,Sol 解决50年数学猜想 | ⭐⭐⭐⭐⭐ |
| 🔥2 | Kimi K3 引发轰动 — 2.8万亿参数开源模型,因需求过大暂停新注册 | ⭐⭐⭐⭐⭐ |
| 🔥3 | DeepSeek V4 正式版即将GA — 1.6T MoE架构,引入峰谷定价,API价格极低 | ⭐⭐⭐⭐ |
| 🔥4 | Claude Fable 5 回归 — 被美国政府暂时下架后重新上线,当前排行榜第一 | ⭐⭐⭐⭐ |
| 🔥5 | OpenAI Presence + Health — 企业AI Agent产品和ChatGPT健康功能上线 | ⭐⭐⭐ |
| 🔥6 | Alibaba Qwen3.8 Max 预告 — 2.4万亿参数模型即将开源 | ⭐⭐⭐ |
🧠 各重要模型动态
1️⃣ OpenAI — GPT-5.6 系列
发布时间:2026年7月9日
官方公告:GPT-5.6: Frontier intelligence that scales with your ambition
三档命名体系(取代旧版 mini/nano):
| 型号 | 定位 | 关键亮点 |
|---|---|---|
| GPT-5.6 Sol | 旗舰版 | Agents’ Last Exam 得分 53.6,超越 Claude Fable 5 约 13 分;据称1小时内解决了一50年未解的数学猜想 |
| GPT-5.6 Terra | 中端 | 性价比均衡 |
| GPT-5.6 Luna | 轻量版 | 由 Sol 自主后训练(post-train)生成 |
其他动态:
- 7月22日:发布 OpenAI Presence — 企业AI Agent部署产品,支持语音和聊天客服,内部已处理75%的客户问题
- 7月23日:发布 Health in ChatGPT — 支持连接Apple Health和医疗记录,提供个性化健康问答(仅限美国)
- GPT-5.6 已成为 Microsoft 365 Copilot 首选模型
2️⃣ Anthropic — Claude Fable 5
状态:已回归,当前排行榜综合第一
定价:$10 / $50(每百万 tokens 输入/输出)
关键事件:
- 🚨 6月发布后即被美国政府以紧急出口管制令下架,原因是其具备自主发现和利用软件漏洞的能力
- Anthropic 添加了新的安全防护措施,6月30日禁令解除,7月1日全球重新上线
- 这是首个被政府暂停并恢复的广泛部署AI模型
与 K3 对比:Claude Fable 5 与 Kimi K3 编码能力接近,但价格是 K3 的约 3 倍,速度上 Fable 5 比 K3 快约 4 倍
其他模型版本:Opus 4.8(推理/长项目)、Sonnet 5(日常通用,目前有优惠 $2/$10)
3️⃣ Google — Gemini 系列
| 型号 | 定位 | 定价(输入/输出) |
|---|---|---|
| Gemini 3.6 Flash | 快速高吞吐日常任务 | $1.50 / $7.50 |
| Gemini 3.1 Pro | 超大文档、多模态(图/音/视频) | $2-4 / $12-18 |
- 百万 tokens 上下文窗口
- Flash 版本性价比极高,适合高频调用场景
4️⃣ Moonshot AI — Kimi K3
发布时间:2026年7月16日(上海世界人工智能大会前夕)
参数量:2.8 万亿(将成为最大开源权重模型)
上下文:100万 tokens
权重发布:承诺 7月27日 开放下载
定价:$3 / $15(每百万 tokens)
关键事件:
- 发布后3天内因需求过大暂停新用户注册,系统接近处理极限
- 在 Arena 编码排行榜登顶,超越多数闭源模型
- Nature 发表专题报道《Does China’s latest AI model finally equal US rivals?》
- Claude Fable 5 vs Kimi K3 对比:相同编码结果,K3 价格仅为 Fable 5 的 1/3,但速度慢约 4 倍
5️⃣ DeepSeek — V4 系列
状态:2026年4月发布Preview版,7月中旬正式GA(General Availability)
架构:1.6T MoE(混合专家模型),100万 tokens 上下文
定价(非常激进):
| 型号 | 输入(缓存未命中) | 输出 | 并发限制 |
|---|---|---|---|
| V4 Pro | $0.435 | $0.87 | 500 |
| V4 Flash | $0.14 | $0.28 | 2500 |
创新:
- 峰谷定价机制:北京时间 9:00-12:00 和 14:00-18:00 为高峰时段(约 2x 基准价),其余时段维持预览版价格
- 支持华为芯片(Ascend)和 NVIDIA 芯片双平台运行
- 新增视觉推理系统(“AI获得一根’数字手指’,可在思考时指向图片”)
- V4 Flash 在某次实际修复bug任务中,一次性解决了 GPT-5.6 Terra 6次尝试未修复的问题
行业影响:DeepSeek V4 大幅降价(最高降幅90%)引发"Tokenmaxxing"现象——价格下降导致使用量暴增(杰文斯悖论)
6️⃣ Meta — Muse Spark 1.1
发布时间:2026年7月(1.1更新),4月首版发布
定位:Meta 首个闭源旗舰模型(由 Meta Superintelligence Labs 打造)
定价:$1.25 / $4.25(每百万 tokens)
上下文:100万 tokens
重要变化:
- Meta 从 Llama 开源路线转向 Muse 闭源 API 路线
- Muse Spark 1.1 在公开排行榜上与最强开源模型持平
- 驱动 Meta AI 助手(WhatsApp/Instagram/Facebook/Messenger),是部署最广泛的模型之一
- Meta 表示"希望"未来开源更大版本
7️⃣ 中国其他重要模型
| 模型 | 公司 | 参数 | 定位 |
|---|---|---|---|
| GLM-5.2 | 智谱AI (Zhipu) | 744B | 目前可下载的最强开源模型,MIT许可,编码能力超 GPT-5.5 |
| Qwen3.8 Max | 阿里云 (Alibaba) | 2.4T | 7月20日发布预览,宣称"仅次于Fable 5",即将开源 |
| MiniCPM5-1B | 面壁智能 | 约1B | 小钢炮系列,适合端侧部署 |
💡 GLM-5.2 是目前可实际下载的最强开源模型(Kimi K3 权重7月27日才发布),比 GPT-5.5 编码更强,成本极低
8️⃣ Grok 4.5 — xAI(马斯克)
- 实时信息(接入 X/Twitter)
- 接近前沿的推理能力
- 定价 $2-4 / $6-12
- 500K tokens 上下文
📊 模型能力总排名(截至2026年7月中)
根据 minds.ai/hub 和 Zapier 综合排名:
Rank Model 类型 相对得分 价格竞争力
─── ────────────────────── ───────── ────── ────────
1 Claude Fable 5 Closed 100% ⭐⭐
2 GPT-5.6 Sol Closed ~99% ⭐⭐⭐
3 Kimi K3 Open† ~95% ⭐⭐⭐⭐
4 Claude Opus 4.8 Closed ~93% ⭐⭐⭐
5 GPT-5.6 Terra Closed ~91% ⭐⭐⭐⭐
6 Grok 4.5 Closed ~90% ⭐⭐⭐
7 Claude Sonnet 5 Closed ~88% ⭐⭐⭐⭐
8 GLM-5.2 Open ~85% ⭐⭐⭐⭐⭐
9 DeepSeek V4 Pro Open ~75% ⭐⭐⭐⭐⭐
10 Gemini 3.6 Flash Closed ~72% ⭐⭐⭐⭐⭐
† Kimi K3 权重尚未公开发布,预计7月27日开放
🌐 行业趋势分析
趋势一:开源模型加速追赶,价格战全面爆发
- 开源模型与闭源前沿的差距已缩小到 ~15%以内,而价格仅为闭源模型的 1/10 甚至更低
- DeepSeek V4 的定价策略(最低 $0.14/M tokens)正在重塑行业价格基准
- 各大厂商被迫跟进降价:Claude Sonnet 5 已推出优惠价 $2/$10(截至8月31日)
趋势二:中美AI双轨并行
- 美国强调安全管控:Claude Fable 5 被政府下架后重新审批,AI安全监管趋严
- 中国强调开放与技术突破:Kimi K3、DeepSeek V4、GLM-5.2 等一系列开源模型持续涌现
- "两个AI世界"正在形成——不同的技术路线、监管框架和商业模式
趋势三:AI Agent 从概念走向产品化
- OpenAI Presence 正式将AI Agent定位为企业级产品,可处理客服、销售、内部流程
- Kimi K3 的 Agent 集群能力(单任务支持1500+工具调用)
- DeepSeek V4 强化 Agent 能力,视觉推理新增"指向"交互
- AI Agent 安全成为焦点——NEXUS 等运行时安全框架论文涌现
趋势四:行业应用纵深发展
- 医疗健康:OpenAI Health in ChatGPT 整合 Apple Health 和病历,300M+用户健康咨询
- 编码/开发:GPT-5.6、Claude Code、Codex、Kimi K3 在编码排行榜激烈竞争
- 金融:Claude 成为律师/金融业首选,DeepSeek 的金融欺诈检测框架
- 硬件竞争:AMD Helios + Cerebras 联手挑战 NVIDIA 的AI推理市场
趋势五:AI治理与合规成为焦点
- 美国纽约州要求 AI 生成广告中标注"合成表演者"
- 中国大规模整治 AI 伴侣应用
- 亚马逊要求第三方卖家标注 AI 生成的广告人像
📰 今日(7月24日)头条聚焦
- DeepSeek V4 正式版今日GA — 关注峰谷定价对全球API市场的冲击,业内预计将引发新一轮价格战
- OpenAI Health in ChatGPT 上线 — ChatGPT 周均3亿健康咨询,正式进入数字健康领域
- OpenAI Presence 发布 — AI Agent 从实验室走向企业生产环境,标志着 Agent 商业化元年
- Kimi K3 权重倒计时(7月27日) — 即将成为最大开源模型,全球开发者社区高度期待
- Alibaba Qwen3.8 Max 预告 — 2.4T 参数模型声称"仅次于 Fable 5",正在与 Anthropic 争夺话语权
📋 下期关注预告
| 日期 | 事件 |
|---|---|
| 7月27日 | Kimi K3 开放权重下载 |
| 7月底 | AMD Helios AI系统发货 |
| 8月 | GPT-6 传闻(未确认) |
| 8月31日 | Claude Sonnet 5 优惠价到期 |
| 持续关注 | DeepSeek V4 GA 后的市场反应 |
📬 本报告由 AI 自动搜集整理,数据来源包括 OpenAI、Anthropic、Nature、The New Stack、CSDN、Zapier、LlamaStats 等公开渠道。如有疏漏敬请谅解。
生成时间:2026-07-24 | 工具:Hermes Agent
更多推荐


所有评论(0)