8 月 13 日这一整天,DeepSeek 的价格悬念层层递进:
① 8/6 预告:官方宣布"计划近期整体上调 API 服务定价,预计涨幅较大"——市场开始猜。
② 8/13 凌晨:V4-Pro-0813 正式版上线,价格未动(仍 3 元/6 元),悬念继续。
③ 8/13 晚:官方发布调价公告——采用"峰谷定价",空闲时段价格为高峰时段的一半,8 月 17 日 00:00(北京时间)生效[1] ↗。
关键词不是"涨价",而是"峰谷定价"——这是 LLM API 行业第一次把电力行业的峰谷电价逻辑搬进算力定价。下面把账算清楚。
新价格(人民币 / 百万 tokens)vs 现价(8/13 前):
| 模型 | 计费项 | 现价 | 空闲时段 | 高峰时段 | 高峰/现价 |
|---|---|---|---|---|---|
| V4-Pro | 输入(缓存命中) | 0.025 元 | 0.15 元 | 0.30 元 | 12.0x |
| 输入(缓存未命中) | 3 元 | 4.5 元 | 9 元 | 3.0x | |
| 输出 | 6 元 | 13.5 元[1] ↗ | 27 元 | 4.5x | |
| V4-Flash | 输入(缓存命中) | 0.02 元 | 0.05 元 | 0.10 元 | 5.0x |
| 输入(缓存未命中) | 1 元 | 1.5 元 | 3 元 | 3.0x | |
| 输出 | 2 元 | 4.5 元 | 9 元 | 4.5x |
三个容易被忽略的细节:
① 连"空闲时段"也涨价了——Pro 输出 6→13.5 元(+125%),不是只有高峰贵。所谓"空闲"只是高峰的一半,不是回归现价。
② 缓存命中涨得最狠:Pro 缓存命中 0.025→0.15→0.30 元,峰值是现价的 12 倍。高缓存命中场景(RAG、长对话前缀)成本冲击最大。
③ 高峰 = 每天 7 小时(北京时间 9:00-12:00、14:00-18:00),其余 17 小时空闲。时段按北京时间划分,对国内开发者最不友好。
真实账单取决于你的调用时段分布。按 24 小时均匀分布(高峰 7h/空闲 17h)测算输出价:
| 场景 | Pro 输出成本(元/百万) | 相对现价 6 元 | 适用场景 |
|---|---|---|---|
| 全部高峰调用 | 27 | 4.5x | C 端 App 白天高峰 |
| 全天均匀分布 | ≈17.4 | 2.9x | 7×24 Agent 应用 |
| 全部空闲调用 | 13.5 | 2.25x | 可调度的批处理 |
注:RuntimeWire 按美元口径测算"全天混合输出价约现价 3 倍",与上表人民币口径一致(6→17.4≈2.9x)。高峰时段 7 小时恰与国内工作时段重叠——白天实时应用(聊天、编程 Copilot、Agent)几乎必然踩高峰。
把 DeepSeek 新价(高峰/空闲两个口径)放回全球旗舰模型价格矩阵里比(输出价,人民币 / 百万 tokens,1 美元≈7.2 元):
| 模型 | 输出(¥/M) | DeepSeek Pro 高峰价 | DeepSeek Pro 空闲价 | Flash 空闲价 |
|---|---|---|---|---|
| Claude Fable 5 | ≈360 元($50) | 1/13.3 | 1/26.7 | 1/80 |
| GPT-5.6 Sol | ≈216 元($30) | 1/8 | 1/16 | 1/48 |
| Claude Opus 5 | ≈180 元($25) | 1/6.7 | 1/13.3 | 1/40 |
| GPT-5.6 Terra | ≈86 元($12) | 1/3.2 | 1/6.4 | 1/19 |
| Claude Sonnet 5(促销至 8/31) | ≈72 元($10) | 1/2.7 | 1/5.3 | 1/16 |
| GPT-5.6 Luna | ≈8.6 元($1.2) | 3.1x 更贵 | 1.6x 更贵 | 1/1.9 |
| DeepSeek V4-Pro(现价) | 6 元 | — | — | — |
| DeepSeek V4-Pro(空闲) | 13.5 元 | — | — | — |
| DeepSeek V4-Pro(高峰) | 27 元 | — | — | — |
| DeepSeek V4-Flash(空闲) | 4.5 元 | — | — | — |
| DeepSeek V4-Flash(高峰) | 9 元 | — | — | — |
结论:斩杀线没有消失,只是刀钝了一半。
最贵的口径(Pro 高峰 27 元)仍只有 Fable 5 的 1/13、Sol 的 1/8;性价比口径(Flash 空闲 4.5 元)仍是 Fable 5 的 1/80。对海外旗舰的碾压级价差依然成立。
真正的变化在国内中端:Pro 高峰 27 元已高于 GPT-5.6 Terra(86 元之下仍有优势)、逼近 Sonnet 5 促销价区间;而 Luna($1.2)这种超低价轻量模型第一次在输出价上反超 DeepSeek Pro——"无脑选 DeepSeek"的时期结束了。
把电力行业峰谷电价逻辑搬进 LLM API,是梁文锋(量化基金幻方出身)把调度经济学用到推理服务上的标志性动作:
这也是两年价格战终结的又一枚注脚:智谱年内三次调价、Kimi 输出价涨 3.5 倍、云厂商集体提价之后,DeepSeek 也收刀了。行业共识已经翻转——不再是"低价抢规模",而是"用峰谷把规模变现"。
对开发者:8/17 前是最后囤量窗口;之后把可延迟任务调到空闲时段(夜间/午休),成本可省一半;实时 Agent 应用需重新评估成本模型——Pro 输出按高峰 27 元重新测算,必要时降级 Flash 或切 Luna 类轻量档。
对国内玩家:DeepSeek 高峰价 27 元已进入 Sonnet 5/Terra 的价格带,"低价红利"收窄,竞争回到性能与生态锁定——Anthropic 兼容接口的迁移优势反而更值钱了。
对海外用户:高峰 7 小时按北京时间,正好错开美西工作日核心时段(美西 18:00-2:00 是 DeepSeek 空闲)——对欧美开发者实际冲击小于国内,这可能是刻意的时区套利设计。