DeepSeek API 8月17日大幅涨价:告别“价格屠夫“,国产大模型进入新定价时代
·
DeepSeek API 8月17日大幅涨价:告别"价格屠夫",国产大模型进入新定价时代
发布时间:2026年8月13日
数据来源:DeepSeek 官方公告、官方定价页(api-docs.deepseek.com)、澎湃新闻、观察者网、21世纪经济报道、华尔街见闻、新浪财经等公开报道
一、核心结论
DeepSeek 官方确认:新价格将于北京时间 2026年8月17日 00:00 正式生效,全面采用"峰谷定价"机制,整体价格大幅上调。
- 8月6日,DeepSeek 在开发者后台发布公告:“计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。”
- 8月17日新价落地后,全计费项涨幅 50%~500% 不等,其中缓存命中输入价格涨幅最猛(V4-Pro 达 6 倍)。
- 这是 DeepSeek 近 4 个月内第 4 次调整 API 定价,标志着持续近两年的"低价抢市场"策略正式转向。
二、涨价时间线:一场"蓄谋已久"的调价
| 时间 | 事件 |
|---|---|
| 2026年4月25日 | DeepSeek-V4-Pro API 开启"限时2.5折"优惠,缓存命中输入降至 0.25元/百万tokens |
| 2026年5月22日 | 官方宣布"限时2.5折"转为永久降价(原定价的1/4),降幅高达 75% |
| 2026年6月29日 | 向 API 用户预告:V4 正式版上线后将引入峰谷定价机制 |
| 2026年7月中旬 | 峰谷定价方案公布:高峰时段(9:00-12:00、14:00-18:00)所有计费项按平时 2 倍收费 |
| 2026年7月31日 | DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力大幅跃升,调用量爆发 |
| 2026年8月4日 | V4-Flash API 因"前所未有的访问量"出现容量不足、性能下降,当日恢复 |
| 2026年8月6日 | 官方公告:计划近期整体上调 API 定价,“预计涨幅较大” |
| 2026年8月17日 00:00 | 新价格正式生效(北京时间),实行峰谷定价 |
三、新价格明细(官方定价页确认)
据 DeepSeek 官方定价页,新价格采用峰谷定价:高峰时段为北京时间 9:00-12:00、14:00-18:00,空闲时段价格为高峰时段的一半。单位:元 / 百万 tokens。
3.1 新旧价格对比
deepseek-v4-flash
| 计费项 | 旧价(8月16日前) | 新价·空闲时段 | 新价·高峰时段 | 涨幅(按空闲时段) |
|---|---|---|---|---|
| 输入(缓存命中) | 0.02元 | 0.05元 | 0.10元 | +150%(2.5倍) |
| 输入(缓存未命中) | 1元 | 1.5元 | 3.0元 | +50% |
| 输出 | 2元 | 4.5元 | 9.0元 | +125%(2.25倍) |
deepseek-v4-pro
| 计费项 | 旧价(8月16日前) | 新价·空闲时段 | 新价·高峰时段 | 涨幅(按空闲时段) |
|---|---|---|---|---|
| 输入(缓存命中) | 0.025元 | 0.15元 | 0.30元 | +500%(6倍) |
| 输入(缓存未命中) | 3元 | 4.5元 | 9.0元 | +50% |
| 输出 | 6元 | 13.5元 | 27.0元 | +125%(2.25倍) |
3.2 美元计价(国际市场,8月16日 16:00 UTC 生效)
| 模型 | 时段 | 输入(缓存命中) | 输入(缓存未命中) | 输出 |
|---|---|---|---|---|
| deepseek-v4-flash | 空闲 | $0.007 | $0.22 | $0.66 |
| deepseek-v4-flash | 高峰 | $0.014 | $0.44 | $1.32 |
| deepseek-v4-pro | 空闲 | $0.022 | $0.66 | $1.98 |
| deepseek-v4-pro | 高峰 | $0.044 | $1.32 | $3.96 |
📌 注意:高峰时段价格为空闲时段的 2 倍。若开发者集中在工作日白天调用,实际成本增幅将显著高于上表"空闲时段"口径。
四、为什么会涨价?三大原因
4.1 算力成本高企,低价模式难以为继
DeepSeek 创始人梁文锋此前在投资者交流会上明确表示:DeepSeek 追求的只是"赚取一个合理的利润",API 定价的目标是"买一批设备回来,十个月收回成本"。在高端 AI 芯片供应受限、算力成本持续攀升的背景下,现行价格已难以覆盖成本。
4.2 用量爆炸式增长,服务器不堪重负
- 7月31日 V4-Flash 正式版公测后,全球调用量激增,24 小时都是高峰期,峰谷定价根本无法削峰。
- OpenRouter 平台 7月27日-8月2日周榜显示:deepseek-v4-flash 以 7.22 万亿 Tokens 的调用量位居全球第一,而全平台 400 余款模型日均规模约 6.6 万亿 Tokens。
- 有海外开源项目团队称其平台 DeepSeek V4 Flash 单日处理量高达 8 万亿 Tokens。
- 8月4日,V4-Flash API 因"前所未有的访问量"出现容量不足。
4.3 商业化提速:从"烧钱换用户"到"盈利验证"
- 据报道 DeepSeek ARR(年度经常性收入)已达 4亿~5亿美元,旗舰模型 V4 毛利率超过 50%。
- 公司已重启第二轮融资,计划募资 500 亿元,投前估值约 5000 亿元,目标 8月下旬完成签约;
- 另据彭博社报道,DeepSeek 已开始筹备 IPO,计划 A 股上市,最快今年提交申请,2027 年完成上市。
五、涨价对开发者意味着什么
5.1 成本模型需要重新核算
对依赖 DeepSeek API 构建产品的开发者,成本上涨是实打实的:
- 重度调用者(每日数十亿 token 级别)受影响最大,下一张云账单将显著上升;
- Agent 应用(每轮调用重复发送代码库、系统提示词)需重点关注"缓存命中输入"价格——该计费项 V4-Pro 涨幅高达 6 倍;
- 错峰调度成为省钱关键:把重任务挪到非高峰时段(夜间、清晨),成本直接减半。
5.2 即便如此,DeepSeek 依然便宜
彭博社 8月4日报道:使用 DeepSeek-V4-Flash 完成一项复杂任务的成本仅为 3 美分,而 Claude Fable 5 为 3.15 美元、GPT-5.6 Sol 为 1.86 美元——即使涨价后,DeepSeek 的价格优势依然存在数量级差距。
5.3 应对建议
- 多模型路由:跑量任务走 Flash、难题切旗舰,各家模型 API 基本兼容 OpenAI 格式,切换成本极低;
- 利用缓存:Agent 场景下缓存命中价比未命中价便宜 90 倍(Flash 0.05元 vs 1.5元),优化提示词复用可大幅降本;
- 错峰调用:将批式任务调度到非高峰时段执行;
- 关注官方通知:具体方案以 DeepSeek 官方正式通知及定价页为准。
六、行业影响:国产大模型"价格战"落幕
- 国泰海通证券研报指出:DeepSeek 主动提价标志着行业盲目低价竞争阶段加速收敛,有效抬升了整个 MaaS 市场的价格底线,各厂商 API 定价中枢迎来上修空间。
- 事实上,行业早已开始跟进:智谱 CEO 张鹏 4 月表示 2026 年一季度 API 调用定价提升 83%;豆包专业版 6 月采用 68/200/500 元三级阶梯定价;Kimi 因算力超载暂停 C 端新用户订阅。
- 分析认为,国产大模型正从"烧钱换用户"的补贴阶段,迈入规模化商业变现的盈利验证期,未来竞争焦点将从"谁更便宜"转向"谁以更低成本提供更高性能、更稳定的服务"。
七、数据来源与声明
- 价格数据:DeepSeek 官方定价页(api-docs.deepseek.com/zh-cn/quick_start/pricing/),2026年8月13日核验;
- 公告信息:DeepSeek 开发者平台 8月6日官方公告;
- 报道来源:澎湃新闻、观察者网、21世纪经济报道、华尔街见闻、新浪财经、腾讯新闻、经济观察网、彭博社(8月4日)、OpenRouter 周榜数据等;
- 峰谷时段:北京时间 9:00-12:00、14:00-18:00(工作日口径以官方最终说明为准);
- 本文数据截至 2026年8月13日,模型定价变动频繁,实际以 DeepSeek 官方页面为准。
更多推荐




所有评论(0)