凌晨的时候,我把跑了一整天的批量推理任务日志拉出来对账,发现这个月的 API 支出比上个月多了将近四倍。上个月调的是 DeepSeek-V4-Pro,8 月 17 日之前每百万 Token 输出 6 元,涨完之后高峰段 27 元。我以为扛到月底就行了,结果 8 月 23 日 DeepSeek 又发了新公告——周末全天按低谷价算。也就是说,如果把批量任务挪到周六周日跑,每百万 Token 输出只要 13.5 元。我盯着对账表发呆:同一个模型,一个月内价格变了三轮,不同的跑法差出来一倍多的钱。
这就是 2026 年 8 月大模型 API 定价的真实写照——"一口价"正在变成"活价格"。

涨完就降,降完再促销

DeepSeek 在 8 月 17 日完成了一轮堪称"地震级"的涨价。旗舰模型 V4-Pro 高峰时段每百万 Token 输出价格从 6 元直接飙到 27 元,涨幅 350%,缓存命中输入更是从 0.025 元涨到 0.3 元,涨幅 1100%。这是 DeepSeek 发布以来幅度最大的一次提价。
但不到一周,8 月 23 日,DeepSeek 又宣布调整——周六周日全天统一按低谷时段价格计费,不再区分峰谷。原因不复杂:8 月 17 日涨价后,大量中小团队的月度成本翻了三四倍。有开发者反馈,原本每月 3000 元的 API 支出直接涨到近一万元,已经在考虑把成本转嫁给终端用户。

DeepSeek 用周末打折的方式给了一步缓冲。

大洋彼岸的 OpenAI 也没闲着。8 月 21 日,OpenAI 宣布将旗舰模型 GPT-5.6 Sol 的 API 价格下调超 20%,输入从 5 美元降到 4 美元每百万 Token,输出从 30 美元降到 20 美元,优惠期持续三个月到 11 月 21 日。这已经是三周内第二次降价——7 月底,中端模型 Terra 降价 20%,低成本模型 Luna 直接降价 80%。加上 Google 的 Gemini 3.7 Flash 定价约为上一版本一半,整个 8 月的大模型市场像在打一场价格闪击战。
有意思的是,OpenAI 这次明确标注了"促销价"字样,说明不是永久性结构降价。Google 的 Gemini 3.7 Flash 也标注了 2027 年 1 月 1 日起恢复原价。厂商用推广期定价吸引开发者迁移,而非真正把价格打下来——这更像是电商大促的逻辑被搬到了 AI 基础设施上。

智能体在烧 Token,定价被迫跟着变形

定价为什么变得这么"活"?根本原因在于 Token 的消费结构变了。
风投机构 a16z 在 8 月 21 日的周报中援引 OpenRouter 数据显示:AI 智能体每周消耗的 Token 已经达到 7.3 万亿,大约是人类用户同期用量的 5 倍。这个逆转发生在 2026 年 2 月 6 日——智能体 Token 消耗首次超过人类,此后一路增长 14 倍。从份额看,智能体已经占到 OpenRouter 平台 Token 总量的 71%,而人类用户从 57% 跌到了 15%。

人和智能体的消费模式完全不同。人聊天是"问一句答一句",一个回合就结束了;智能体围绕一个目标反复迭代,系统提示、工具说明、代码规范和前几轮结果会一遍遍进入后续请求,一个任务跑几十甚至上百轮调用。OpenRouter 数据显示,智能体消耗的 Token 中 86% 来自缓存提示词,而人类只有 29%。缓存 Token 的成本远低于全新输入,这也解释了为什么 DeepSeek 和 OpenAI 都在调缓存相关的价格——DeepSeek 缓存命中低至 0.15 元,OpenAI 缓存输入也同步降了 20%。
当消费方从"人偶尔问问题"变成"机器持续跑任务",固定标价就不够用了。高峰时段算力拥堵,低谷时段空闲,智能体又恰好可以在任意时间跑——于是峰谷计费、周末打折、缓存优惠这些动态机制应运而生。定价从"一个数字"变成了"一个矩阵"。

定价越乱,路由层越值钱

定价矩阵越复杂,开发者自己手动算"哪个时段用哪个模型最划算"就越不现实。这也解释了为什么模型路由层突然成了资本市场的香饽饽。
8 月 19 日,企业支出管理平台 Ramp(估值 440 亿美元)正式上线了 AI 模型路由服务 Router,接入 OpenAI、Anthropic、DeepSeek 等 8 家供应商的 27 个模型,路由层免费到 2026 年底。Ramp 自己内部跑了三年这套系统,月处理超 2.75 万亿 Token,自降本 30%,客户平均降本 40%。同一天,Stripe 正式宣布收购 OpenRouter,价格超过 80 亿美元。

一个做支付的公司花 80 亿买了个"Token 中转站",一个做报销的公司上线了模型路由器——放在两年前谁也想不到。但它背后的逻辑很清楚:当模型厂商各自搞峰谷定价、促销价、缓存价,开发者面对的不是一张价格表而是一堆价格表,自动选最便宜的那条路径就成了刚需。

对于国内的独立开发者和小团队来说,不一定非得上国际平台。像 EasyAPI这类轻量的智能路由工具,同样可以帮忙根据任务复杂度和当前价格自动切换模型,在峰谷时段之间找到最优解。关键是别把模型选择写死在代码里,因为今天最便宜的那个模型,下周可能就涨价 350%。

最后

2026 年 8 月这几条新闻拼在一起,指向一个结论:大模型 API 的"一口价时代"结束了。取而代之的是峰谷定价、促销窗口、缓存分级、智能体专属消费模式交织在一起的动态定价体系。开发者要做的,不是去记住每家厂商的价格表,而是把"选模型"这件事交给路由层来动态决策。毕竟,当价格一个月变三轮的时候,手动对账已经跟不上了。

更多推荐