DeepSeek V4 峰谷计费背后:AI 算力定价的第一次结构性革命
DeepSeek V4 峰谷计费背后:AI 算力定价的第一次结构性革命
如果你昨天还在用 DeepSeek,那么从今天开始,你的 API 成本可能已经发生变化。
不是因为模型变了,而是因为 AI 第一次开始像电网一样计费。
7 月 19 日,DeepSeek V4 GA 正式发布。
所有人原本以为重点会是:
- 参数提升多少?
- Benchmark 排第几?
- 能不能正面硬刚 GPT-5.6 和 Claude Opus?
结果开发者圈真正炸锅的,却是一件完全没有人预料到的事情:
峰谷计费
AI 行业第一次出现了按时段收费的 API。
工作时间更贵,夜间更便宜。
这意味着,AI 正在从"无限算力的幻象",进入"有限资源调度的现实"。

一、先看成绩单:V4 到底行不行?
一句话先下结论:
核心结论
DeepSeek V4 已正式进入全球第一梯队
它并没有把所有模型全部打趴下,但已经具备与 Opus 4.6/4.8、GPT-5.6 Sol 同台竞争的能力。
双版本架构
| 指标 | V4 Pro(旗舰) | V4 Flash(高频) |
|---|---|---|
| 总参数 | 1.6T | 284B |
| 激活参数 | 49B | 13B |
| 上下文长度 | 1M | 1M |
| 最大输出 | 384K | 384K |
| 推理 FLOPs(对比 V3.2) | 27% | 10% |
| KV Cache(对比 V3.2) | 10% | 7% |
关键 Benchmark(V4 Pro GA)
| 基准测试 | V4 Pro | 定位 |
|---|---|---|
| SWE-bench Verified | 80.6% | 几乎追平 Opus 4.6 |
| LiveCodeBench | 93.5% | 编码第一梯队 |
| Codeforces Elo | 3206 | 竞赛级编程 |
| GPQA Diamond | 90.1% | 研究生级推理 |
| Humanity's Last Exam | 48.2% | 高难度综合推理 |
| MMLU-Pro | 87.5% | 多学科综合 |
一句话评价:
V4 已经具备"准 Opus 级"能力,尤其在代码生成、复杂推理、Agent 场景中表现极其强势。
但客观说,它还不是"全项第一"。
- 和 Fable 5 比:同任务往往需要更多迭代轮次。
- 和 Kimi K3 比:综合体验仍有细微差距。
- Pro 与 Flash 的差距比很多人预期的小。
二、真正让行业震动的:峰谷计费
先别看表格,先看这张图:

高峰时段:9:00–12:00、14:00–18:00(共 7 小时),价格 = 平峰 × 2
三、这不是"涨价",而是定价范式改变
很多人第一反应是:
"以前统一价格,现在高峰翻倍,不就是涨价吗?"
这个理解只对了一半。
真正改变行业的,不是价格数字,而是:
核心观点
价格第一次开始承担"调度算力"的职责
过去 AI API 的价格只是收费工具,现在它开始成为资源调度工具。
电商逻辑 vs 电网逻辑

过去 AI API 的价格只是"收费工具"。
现在,它开始变成"资源调度工具"。
四、为什么偏偏是 DeepSeek?
这是整篇文章最关键的问题。
很多人会问:
- OpenAI 为什么不搞峰谷计费?
- Anthropic 为什么没有?
- Google 为什么还是统一价?
答案其实只有一句:
因为 DeepSeek 真正拥有自己的算力池
它不是简单调用第三方云 API,而是在用自建的昇腾集群做全栈推理调度。
DeepSeek 的底层是:
- 华为昇腾 950PRC
- CANN Next
- 自建推理集群
- 国产算力闭环
这意味着它面对的是一个非常现实的问题:
| 时间 | 集群状态 |
|---|---|
| 工作日上午 | Agent、IDE、企业应用同时爆发 |
| 深夜 | 大量 GPU 空闲 |
如果继续统一价格,会出现什么?
- 限流
- 排队
- 暂停新用户
- 服务不稳定
峰谷计费其实是第三种方案:
让价格代替人工限流。
这比"排队 30 分钟"文明得多。
五、横向对比:V4 到底便宜到什么程度?
| 模型 | 输出价格($/M) |
|---|---|
| Claude Opus 4.8 | $75.00 |
| Anthropic Fable 5 | $50.00 |
| GPT-5.6 Sol | $30.00 |
| Kimi K3 | ≈$15.00 |
| DeepSeek V4 Pro(高峰) | $1.74 |
| DeepSeek V4 Pro(平峰) | $0.87 |
| DeepSeek V4 Flash(平峰) | $0.28 |
最夸张的数字:
V4 Flash 平峰价仅为 Fable 5 的 1/178
这已经不是"便宜一点",而是两个数量级的差距。
六、对开发者意味着什么?
个人开发者
几乎没影响。
Flash 的平峰价低到什么程度?
- 写博客
- 做脚本
- 跑 Copilot
- 日常问答
一个月可能也就几块钱。
高频 Agent 团队
这是被精准瞄准的人群。
如果你的系统:
- 白天持续运行
- 多 Agent 并发
- 长上下文推理
- 高频代码生成
那么成本会直接 ×2。
你必须开始做一件以前很少做的事:
任务调度
比如:
| 任务类型 | 建议时段 |
|---|---|
| 用户实时对话 | 高峰也要跑 |
| 批量评测 | 夜间 |
| 数据生成 | 夜间 |
| Embedding 重建 | 周末 |
| 代码库分析 | 平峰 |
这其实就是云计算时代的"离峰批处理"。
七、买 GPU 还是用 API?
很多人看到高峰翻倍,会产生一个经典问题:
"那我不如自己买卡?"
我们算笔账。
一张 3090
- 二手价格:≈ ¥7,500(约 $1,050)
V4 Pro 高峰价
- $1.74 / 百万输出 token
回本需要多少?
$1,050 ÷ $1.74 ≈ 603 百万输出 token。
也就是约 6 亿输出 token。
而且别忘了:
3090 根本跑不动 V4 Pro 这种级别的模型。
所以结论非常清晰:
买 GPU — 适合私有化
- 隐私数据
- 离线运行
- 完全可控
- 长期固定负载
用 V4 API — 适合大多数团队
- 成本极低
- 无需运维
- 随时扩容
- 能力远超消费级显卡
八、V4 的短板,也必须说清楚
真正的技术分析不能只吹。
1. 迭代效率不如 Fable 5
同样复杂任务,V4 往往需要更多轮交互。
2. Pro 与 Flash 差距不够大
很多常规任务上,Flash 已经"够用得离谱"。
3. 超长上下文幻觉率仍高于 Opus
接近 1M token 时,事实一致性不如 Claude。
4. 高峰场景确实比以前贵了
如果你必须在工作时间大量调用,账单一定会上升。
只是——
它依然比大多数国际模型便宜一个数量级。
九、真正值得关注的信号
我认为这篇文章最重要的结论不是"V4 很强"。
而是:
AI API 正在云计算化
如果峰谷计费被证明有效,未来很可能出现:
- OpenAI 企业版按时段收费
- Claude 推出 Night Batch API
- Kimi 高峰动态限价
- 云厂商 GPU 实时竞价
也就是说:
未来 AI 服务会越来越像 AWS,而不是一个固定价格的 SaaS。
DeepSeek 很可能只是第一个捅破窗户纸的人。
结语:这次改变的不是模型,而是商业模式
如果说 GPT 改变了人们使用 AI 的方式。
那么 DeepSeek V4,可能第一次改变了 AI 的商业模式。
它告诉整个行业:
真正昂贵的,不再是模型,而是算力。
而真正值得优化的,也不只是 Prompt,而是资源调度。
峰谷计费看起来只是一个价格策略。
但它背后,是 AI 基础设施开始走向成熟的标志。
7 月 24 日,旧接口退役。
V4 时代,正式开启。
数据来源:DeepSeek 官方 API 文档、X 开发者实测反馈 (@pankajkumar_dev)、wan27.org、RunAIHome、MangoMind Benchmarking Lab。
更多推荐



所有评论(0)