⚡ GPT-5.5 降智风暴:你的 $200/月买了个“薛定谔的脑子“?
⚡ GPT-5.5 降智风暴:你的 $200/月买了个"薛定谔的脑子"?
不是你的错觉,OpenAI 官方文档已经承认了。而且不只是 OpenAI,Claude 也公开道歉了。
一、风暴来袭:GPT-5.5 突然"变傻"了?
2026 年 5 月下旬,X(Twitter)和 OpenAI 开发者论坛上突然爆发了大量相同主题的帖子——
“GPT-5.5 用了一个小时后突然变傻了?界面还显示 Extended Thinking,但回复质量断崖式下跌。”
“我问它训练数据截止日期,它说是 2025 年 8 月。但 GPT-5.5 Thinking 应该是 12 月!系统是不是偷偷给我换了 Instant 版?”
“trace 命令实锤了:我请求的是 gpt-5.3-codex,实际返回的是 gpt-5.2。”
这不是孤例。chatgptdisaster.com 整理了 1087 条有效投诉,指向同一个问题:OpenAI 在用户不知情的情况下,把模型静默切换到了更低级的版本。
二、实锤证据:五重铁证
铁证 1:训练截止日期暴露模型身份
开发者 Andrew Curran 怀疑模型被调包后,直接问了一个简单问题:
“What is your training data cutoff date?”
GPT-5.5 Thinking 的训练截止日期应该是 2025 年 12 月。但它回答的是 2025 年 8 月——恰好是 GPT-5.5 Instant 的截止日期。系统把 Thinking 偷偷换成了 Instant,连个提示都没有。
铁证 2:Trace 命令抓现行
GitHub 上的开发者用 trace 命令抓包:
RUST_LOG='codex_api::sse::responses=trace'
请求指定 gpt-5.3-codex,返回的日志显示实际模型是 gpt-5.2——一个更旧、更弱的版本。
铁证 3:OpenAI Help Center 白纸黑字
最讽刺的是,OpenAI 的官方帮助文档一直写着这个机制,只是没人仔细读:
“Plus 用户每 3 小时可使用最多 160 条 GPT-5.5 消息。达到上限后,系统将自动静默切换到 mini 模型。”
关键词:静默。没有弹窗。没有标签变化。没有"您的配额已用完"提示。你看到的界面还是 “GPT-5.5 Extended Thinking”,但背后已经是另一个模型了。
铁证 4:OpenAI Status 页面的自认
5 月 15 日,OpenAI 状态页出现一条记录:
“GPT-5.5 Performance Degradation — Investigating”
5 月 17 日状态更新为 “Resolved”。
然而 5 月 24-26 日的用户投诉比 5 月 15 日更猛烈。所谓的"已解决"显然不是真的解决了。
铁证 5:思考过程"消失术"
最让 $200/月 Pro 用户愤怒的发现:使用 1-2 小时后,Extended Thinking 的思考过程突然变短甚至消失,但界面上的"Extended Thinking"标签从来不会变。你花高价买的"深度推理",实际上变成了 Instant 版的秒回。
三、不止 GPT-5.5:Claude 也道过歉
这不是 OpenAI 一家的问题。Anthropic 在 4 月 23 日发布了一份罕见的公开事后分析,承认 Claude Code 中存在三个影响推理质量的 Bug:
| 问题 | 时间 | 影响 |
|---|---|---|
| 推理强度静默降级 | 3/4 - 4/7 | Opus 在某些条件下被静默降到低推理强度 |
| 推理历史缓存丢失 | 3/26 - 4/10 | 每一轮都丢失前一轮的推理链,相当于每次对话都从零开始想 |
| 工具调用文本上限 25 词 | 4/16 - 4/20 | Claude Code 返回的工具调用结果被截断到 25 词以内 |
这三个 Bug 加起来的效果就是:Claude 在该深度思考的时候无法思考,在该看到完整信息的时候看不到。
AMD 的工程总监公开批评了 Anthropic 的性能退化问题。而有开发者测试发现,Claude 4.7 的 tokenizer 改动导致相同输入多消耗 35% 的 Token——你花的钱更多了,模型表现反而更差了。
四、为什么会这样?三层根因分析
第一层:直接原因 — 路由层"偷梁换柱"
最显而易见的技术原因:OpenAI 的推理服务背后有一个模型路由器(Routing Layer)。你可以把它想象成一个调度中心——用户发来一个请求,路由器决定交给哪个模型处理。
问题出在静默降级(Silent Failover):当高配模型排队太长或用户配额用完时,路由器不是返回错误或提示用户等待,而是直接转给低配模型,并且不更新前端 UI。用户永远不知道自己在跟哪个模型对话。
第二层:经济原因 — 算力就是钱
Anthropic 的 4 月事后分析把原因说得更直白:成本优化逻辑通常不会被公开。
推理成本是 AI 公司最大的支出。一个 GPT-5.5 Thinking 的推理成本可能是 Instant 版的数倍甚至十倍。当数亿用户同时在线,哪怕是 30% 的请求被偷偷降级,省下的 GPU 时间都是天文数字。
有分析指出,多个 AI 实验室共用同一批 RLHF 数据标注商(Scale AI、Surge AI 等),标注规范一旦调整(比如"优先降低回复长度以节省 token"),会同时影响所有使用同一标注商训练的模型。这是一个行业级的系统性风险。
第三层:架构原因 — “锯齿状智能”
Yann LeCun 团队 5 月发表了一篇论文,用心理学界最权威的 CHC 智力模型(Cattell-Horn-Carroll)来测试 GPT-5:
| 维度 | 得分 |
|---|---|
| 流体推理 & 数学 | 接近满分,超越人类平均 |
| 长期记忆存储 | 接近 0 |
| 视觉处理 | 接近 0 |
这就是所谓的**“锯齿状智能”(Jagged Intelligence)**——模型在某些维度上几乎完美,在另一些维度上几乎为零。它不是"整体变笨",而是在你没注意到的维度上一直就有短板,当新的路由策略或推理配置触及这些短板时,你的体验就崩了。
而最能说明这种"锯齿"本质的,是 ARC-AGI-3 测试:
| 测试者 | ARC-AGI-3 得分 |
|---|---|
| 未受训练的普通人 | 100% |
| GPT-5.5 | 0.43% |
| Claude Opus 4.7 | 0.18% |
| Gemini 3.1 Pro | 0.37% |
135 个全新的交互环境,没有任何玩法说明。6 岁孩子都能过关的东西,最强 AI 模型加起来不到 1%。
Keras 之父 François Chollet 对此的点评是:“这些模型本质上还是模式匹配器,不是真正的推理器。它们依赖见过的数据,而不是从第一性原理出发适应新环境。”
五、这是一个系统性问题:每代 GPT 都没逃过
| 时间 | 版本 | "变笨"争议 |
|---|---|---|
| 2025/8 | GPT-5 首发 | 回复短、拒绝多,Altman 亲自承认"比预期颠簸" |
| 2025/12 | GPT-5.2 | 翻译倒退,编造不存在的 API |
| 2026/2 | GPT-5.3-Codex | Pro 用户被静默降到 5.2,trace 实锤 |
| 2026/3 | GPT-5.4 | Codex 明显退化 |
| 2026/5 | GPT-5.5 Instant | 回复长度缩短 30% |
| 2026/5 下旬 | GPT-5.5 Thinking | 降智投诉大爆发 |
社区总结了一句名言:“跑分最强的那一天,永远是发布日。”
更让人不安的是——GPT-5.6(内部代号 iris-alpha)已经出现在后台日志中,Polymarket 预测 6 月发布概率超过 85%。新模型的训练和测试会吃掉大量算力,这会不会也是 5.5 被"克扣算力"的原因之一?
同时,Codex 已宣布 6 月 2 日起强制下线 GPT-5.2/5.3,用户被硬推向仍有降智争议的 GPT-5.5。
六、开发者怎么办?
短期应对
-
用 API,别用 ChatGPT。API 调用你能精确指定模型版本(
gpt-5.5),ChatGPT 的默认模型随时可能被后台切换。 -
用 trace 命令验证模型身份。每次重要对话前,直接问模型它的训练截止日期和版本号,对比官方文档。不一致就重开 session。
-
设置 Token 消耗告警。如果你在用 Claude Code 或 Codex CLI,定期拉取 usage 看板。Uber 4 个月花光全年 AI 预算的教训就在眼前。
-
别在单一模型上吊死。在你的 Agent 工作流里预留一个"模型切换"的配置位。今天 GPT-5.5 降智,你就切到 DeepSeek V4-Pro 或 GLM-5.1。开源模型至少不会有"静默降级"。
长期思路
-
把 AI 输出当作"草稿",不是"成品"。无论是代码审查还是事实核查,AI 生成的代码引入 Bug 是人类的 1.7 倍,这不是偶然。对 AI 产出建立强制人工 Review 流程。
-
关注 Skills,而不是模型。模型会变笨、会降级、会被替换。但一份好的 SKILL.md——清晰的代码规范、项目上下文、边界条件——在任何模型下都能提升输出质量。Matt Pocock、Addy Osmani 这些一线工程师已经在做这件事了。
📌 本文由「爱吃鱼的小怪兽丶】整理发布,每日更新 AI 圈、技术圈重要资讯。
🧠 关注爱吃鱼的小怪兽丶不错过每一次技术浪潮。
更多推荐



所有评论(0)