🤖 AI 大模型日报 — 2026年7月24日(星期五)

📅 本期覆盖:2026年7月9日 — 7月24日 期间重要动态
🔍 信息来源:OpenAI官方、Anthropic、Nature、The New Stack、CSDN、Zapier、LlamaStats 等


📌 本周热门话题速览

排名话题热度
🔥1GPT-5.6 发布 — Sol/Terra/Luna 三档新命名体系,Sol 解决50年数学猜想⭐⭐⭐⭐⭐
🔥2Kimi K3 引发轰动 — 2.8万亿参数开源模型,因需求过大暂停新注册⭐⭐⭐⭐⭐
🔥3DeepSeek V4 正式版即将GA — 1.6T MoE架构,引入峰谷定价,API价格极低⭐⭐⭐⭐
🔥4Claude Fable 5 回归 — 被美国政府暂时下架后重新上线,当前排行榜第一⭐⭐⭐⭐
🔥5OpenAI Presence + Health — 企业AI Agent产品和ChatGPT健康功能上线⭐⭐⭐
🔥6Alibaba Qwen3.8 Max 预告 — 2.4万亿参数模型即将开源⭐⭐⭐

🧠 各重要模型动态

1️⃣ OpenAI — GPT-5.6 系列

发布时间:2026年7月9日
官方公告GPT-5.6: Frontier intelligence that scales with your ambition

三档命名体系(取代旧版 mini/nano):

型号定位关键亮点
GPT-5.6 Sol旗舰版Agents’ Last Exam 得分 53.6,超越 Claude Fable 5 约 13 分;据称1小时内解决了一50年未解的数学猜想
GPT-5.6 Terra中端性价比均衡
GPT-5.6 Luna轻量版由 Sol 自主后训练(post-train)生成

其他动态

  • 7月22日:发布 OpenAI Presence — 企业AI Agent部署产品,支持语音和聊天客服,内部已处理75%的客户问题
  • 7月23日:发布 Health in ChatGPT — 支持连接Apple Health和医疗记录,提供个性化健康问答(仅限美国)
  • GPT-5.6 已成为 Microsoft 365 Copilot 首选模型

2️⃣ Anthropic — Claude Fable 5

状态:已回归,当前排行榜综合第一
定价:$10 / $50(每百万 tokens 输入/输出)

关键事件

  • 🚨 6月发布后即被美国政府以紧急出口管制令下架,原因是其具备自主发现和利用软件漏洞的能力
  • Anthropic 添加了新的安全防护措施,6月30日禁令解除,7月1日全球重新上线
  • 这是首个被政府暂停并恢复的广泛部署AI模型

与 K3 对比:Claude Fable 5 与 Kimi K3 编码能力接近,但价格是 K3 的约 3 倍,速度上 Fable 5 比 K3 快约 4 倍

其他模型版本:Opus 4.8(推理/长项目)、Sonnet 5(日常通用,目前有优惠 $2/$10)


3️⃣ Google — Gemini 系列

型号定位定价(输入/输出)
Gemini 3.6 Flash快速高吞吐日常任务$1.50 / $7.50
Gemini 3.1 Pro超大文档、多模态(图/音/视频)$2-4 / $12-18
  • 百万 tokens 上下文窗口
  • Flash 版本性价比极高,适合高频调用场景

4️⃣ Moonshot AI — Kimi K3

发布时间:2026年7月16日(上海世界人工智能大会前夕)
参数量2.8 万亿(将成为最大开源权重模型)
上下文:100万 tokens
权重发布:承诺 7月27日 开放下载
定价:$3 / $15(每百万 tokens)

关键事件

  • 发布后3天内因需求过大暂停新用户注册,系统接近处理极限
  • 在 Arena 编码排行榜登顶,超越多数闭源模型
  • Nature 发表专题报道《Does China’s latest AI model finally equal US rivals?》
  • Claude Fable 5 vs Kimi K3 对比:相同编码结果,K3 价格仅为 Fable 5 的 1/3,但速度慢约 4 倍

5️⃣ DeepSeek — V4 系列

状态:2026年4月发布Preview版,7月中旬正式GA(General Availability)
架构:1.6T MoE(混合专家模型),100万 tokens 上下文
定价(非常激进)

型号输入(缓存未命中)输出并发限制
V4 Pro$0.435$0.87500
V4 Flash$0.14$0.282500

创新

  • 峰谷定价机制:北京时间 9:00-12:00 和 14:00-18:00 为高峰时段(约 2x 基准价),其余时段维持预览版价格
  • 支持华为芯片(Ascend)和 NVIDIA 芯片双平台运行
  • 新增视觉推理系统(“AI获得一根’数字手指’,可在思考时指向图片”)
  • V4 Flash 在某次实际修复bug任务中,一次性解决了 GPT-5.6 Terra 6次尝试未修复的问题

行业影响:DeepSeek V4 大幅降价(最高降幅90%)引发"Tokenmaxxing"现象——价格下降导致使用量暴增(杰文斯悖论)


6️⃣ Meta — Muse Spark 1.1

发布时间:2026年7月(1.1更新),4月首版发布
定位:Meta 首个闭源旗舰模型(由 Meta Superintelligence Labs 打造)
定价:$1.25 / $4.25(每百万 tokens)
上下文:100万 tokens

重要变化

  • Meta 从 Llama 开源路线转向 Muse 闭源 API 路线
  • Muse Spark 1.1 在公开排行榜上与最强开源模型持平
  • 驱动 Meta AI 助手(WhatsApp/Instagram/Facebook/Messenger),是部署最广泛的模型之一
  • Meta 表示"希望"未来开源更大版本

7️⃣ 中国其他重要模型

模型公司参数定位
GLM-5.2智谱AI (Zhipu)744B目前可下载的最强开源模型,MIT许可,编码能力超 GPT-5.5
Qwen3.8 Max阿里云 (Alibaba)2.4T7月20日发布预览,宣称"仅次于Fable 5",即将开源
MiniCPM5-1B面壁智能约1B小钢炮系列,适合端侧部署

💡 GLM-5.2 是目前可实际下载的最强开源模型(Kimi K3 权重7月27日才发布),比 GPT-5.5 编码更强,成本极低


8️⃣ Grok 4.5 — xAI(马斯克)

  • 实时信息(接入 X/Twitter)
  • 接近前沿的推理能力
  • 定价 $2-4 / $6-12
  • 500K tokens 上下文

📊 模型能力总排名(截至2026年7月中)

根据 minds.ai/hub 和 Zapier 综合排名:

Rank  Model                   类型       相对得分  价格竞争力
───   ──────────────────────  ─────────  ──────   ────────
 1    Claude Fable 5          Closed      100%     ⭐⭐
 2    GPT-5.6 Sol             Closed       ~99%    ⭐⭐⭐
 3    Kimi K3                 Open†        ~95%    ⭐⭐⭐⭐
 4    Claude Opus 4.8         Closed       ~93%    ⭐⭐⭐
 5    GPT-5.6 Terra           Closed       ~91%    ⭐⭐⭐⭐
 6    Grok 4.5                Closed       ~90%    ⭐⭐⭐
 7    Claude Sonnet 5         Closed       ~88%    ⭐⭐⭐⭐
 8    GLM-5.2                 Open         ~85%    ⭐⭐⭐⭐⭐
 9    DeepSeek V4 Pro         Open         ~75%    ⭐⭐⭐⭐⭐
10    Gemini 3.6 Flash        Closed       ~72%    ⭐⭐⭐⭐⭐

† Kimi K3 权重尚未公开发布,预计7月27日开放


🌐 行业趋势分析

趋势一:开源模型加速追赶,价格战全面爆发

  • 开源模型与闭源前沿的差距已缩小到 ~15%以内,而价格仅为闭源模型的 1/10 甚至更低
  • DeepSeek V4 的定价策略(最低 $0.14/M tokens)正在重塑行业价格基准
  • 各大厂商被迫跟进降价:Claude Sonnet 5 已推出优惠价 $2/$10(截至8月31日)

趋势二:中美AI双轨并行

  • 美国强调安全管控:Claude Fable 5 被政府下架后重新审批,AI安全监管趋严
  • 中国强调开放与技术突破:Kimi K3、DeepSeek V4、GLM-5.2 等一系列开源模型持续涌现
  • "两个AI世界"正在形成——不同的技术路线、监管框架和商业模式

趋势三:AI Agent 从概念走向产品化

  • OpenAI Presence 正式将AI Agent定位为企业级产品,可处理客服、销售、内部流程
  • Kimi K3 的 Agent 集群能力(单任务支持1500+工具调用)
  • DeepSeek V4 强化 Agent 能力,视觉推理新增"指向"交互
  • AI Agent 安全成为焦点——NEXUS 等运行时安全框架论文涌现

趋势四:行业应用纵深发展

  • 医疗健康:OpenAI Health in ChatGPT 整合 Apple Health 和病历,300M+用户健康咨询
  • 编码/开发:GPT-5.6、Claude Code、Codex、Kimi K3 在编码排行榜激烈竞争
  • 金融:Claude 成为律师/金融业首选,DeepSeek 的金融欺诈检测框架
  • 硬件竞争:AMD Helios + Cerebras 联手挑战 NVIDIA 的AI推理市场

趋势五:AI治理与合规成为焦点

  • 美国纽约州要求 AI 生成广告中标注"合成表演者"
  • 中国大规模整治 AI 伴侣应用
  • 亚马逊要求第三方卖家标注 AI 生成的广告人像

📰 今日(7月24日)头条聚焦

  1. DeepSeek V4 正式版今日GA — 关注峰谷定价对全球API市场的冲击,业内预计将引发新一轮价格战
  2. OpenAI Health in ChatGPT 上线 — ChatGPT 周均3亿健康咨询,正式进入数字健康领域
  3. OpenAI Presence 发布 — AI Agent 从实验室走向企业生产环境,标志着 Agent 商业化元年
  4. Kimi K3 权重倒计时(7月27日) — 即将成为最大开源模型,全球开发者社区高度期待
  5. Alibaba Qwen3.8 Max 预告 — 2.4T 参数模型声称"仅次于 Fable 5",正在与 Anthropic 争夺话语权

📋 下期关注预告

日期事件
7月27日Kimi K3 开放权重下载
7月底AMD Helios AI系统发货
8月GPT-6 传闻(未确认)
8月31日Claude Sonnet 5 优惠价到期
持续关注DeepSeek V4 GA 后的市场反应

📬 本报告由 AI 自动搜集整理,数据来源包括 OpenAI、Anthropic、Nature、The New Stack、CSDN、Zapier、LlamaStats 等公开渠道。如有疏漏敬请谅解。

生成时间:2026-07-24 | 工具:Hermes Agent

更多推荐