8 月 13 日凌晨,DeepSeek 正式发布旗舰模型 DeepSeek-V4-Pro-0813 并全面开放 API 调用(调用模型名不变,base_url 不变)。三个关键动作同时落地:
① 能力跃升:100 万 tokens 上下文 + 38.4 万 tokens 最大输出,默认思考模式,另提供非思考模式端点;官方群评测表显示多项测试接近 Anthropic 旗舰 Fable 5,相比预览版大幅提升。
② 生态兼容:全面兼容 OpenAI 格式 + Anthropic API + Responses API,支持 Codex 接入、Tool Calls、JSON Output、上下文硬盘缓存、FIM 补全(Beta,仅非思考模式)。
③ 定价分层:Pro 输入(未命中)3 元 / 输出 6 元每百万 tokens;Flash 1 元 / 2 元(约为 Pro 1/3);官方同步预告"近期整体大幅上调 API 定价"。
以下为各大旗舰模型官方 API 牌价(美元 / 百万 tokens,DeepSeek 按 1 美元≈7.2 元折算),截至 2026-08-07 各官方定价页 + 本次 V4-Pro-0813 实价:
| 模型 | 输入(未命中) | 输入(缓存命中) | 输出 | 对标定位 |
|---|---|---|---|---|
| DeepSeek V4-Pro 0813 | $0.435 | $0.0036 | $0.87 | DeepSeek 旗舰 |
| DeepSeek V4-Flash 0731 | $0.14 | $0.0028 | $0.28 | DeepSeek 性价比 |
| Claude Fable 5 | $10 | $1.00 | $50 | Anthropic 旗舰 |
| Claude Opus 5 | $5 | $0.50 | $25 | Anthropic 旗舰 |
| GPT-5.6 Sol | $5 | $0.50 | $30 | OpenAI 旗舰 |
| GPT-5.6 Terra | $2 | $0.20 | $12 | OpenAI 中端 |
| Gemini 3.1 Pro | $2 | $0.20 | $12 | Google 旗舰 |
| Claude Sonnet 5 | $2(促销至 8/31) | $0.20 | $10 | Anthropic 中端 |
注:Gemini 3.1 Pro 与 GPT-5.6 系列对超 20 万 tokens 长上下文另设更高计价档;DeepSeek 100 万上下文不加价。DeepSeek 人民币价为平峰价,工作日高峰(9:00-12:00、14:00-18:00)翻倍。
行业投资者把 DeepSeek 形成的市场格局称作 "DeepSeek 斩杀线":模型厂商要么把价格降到能匹配 DeepSeek 的成本优势,要么投入资源打造明显领先的模型,否则就可能被淘汰。本次 V4-Pro 正式版把这条线又往前推了三个身位:
官方群评测显示 V4-Pro-0813 多项测试接近 Fable 5、相对预览版大幅提升。Fable 5 卖 $10/$50 的旗舰价格,DeepSeek Pro 卖 $0.435/$0.87——性能同一档、价格差一个数量级。这是斩杀的根基:不再是"低价但弱一档",而是"近旗舰性能 + 白菜价"。
算几笔账(输出价对比):
| 对比 | 倍率 | 解读 |
|---|---|---|
| V4-Flash 输出 vs GPT-5.6 Sol | 1/107 | Sol 跑 1 次,Flash 能跑 107 次 |
| V4-Flash 输出 vs Claude Fable 5 | 1/179 | 旗舰价差接近两个数量级 |
| V4-Pro 输出 vs GPT-5.6 Sol | 1/34 | 旗舰 Pro 对旗舰 Sol 依然碾压 |
| V4-Pro 输出 vs Claude Fable 5 | 1/57 | Pro 对 Anthropic 旗舰 |
| V4-Pro 缓存命中输入 vs Claude Opus 5 | 1/138 | 缓存场景成本几乎可忽略 |
按 Artificial Analysis 7 月底的单次任务成本对比更直观:V4-Flash 约 $0.03、Kimi K3 约 $0.86、GPT-5.6 Sol 约 $1.86、Claude Fable 5 约 $3.15——Flash 是 Fable 5 的 1/105。
本次最大变量不是价格而是兼容性:同时兼容 OpenAI 格式、Anthropic API、Responses API、Codex 接入。斩杀点:原本基于 Claude 的 Agent 应用,现在可以近乎无缝切到 DeepSeek 生态——不用重写技术栈、不用换 SDK,改个 model 名就行。配合 OpenRouter 周榜国产包揽前五(DeepSeek V4 Flash 第一,V4 Pro 第四),全球开发者切换成本被压到最低。
V4 产品线清晰化为两条轨道:Flash(1/2 元,2500 并发,面向高频高吞吐、成本敏感)和 Pro(3/6 元,500 并发,面向复杂推理、长上下文编码、Agent 工作流)。信号:DeepSeek 不再用单一低价打天下,而是用价格差把用户往 Pro 赶、用并发差把流量留在 Flash——把"斩杀线"变成了自己的产品分层逻辑。
官方预告:"计划近期整体上调 DeepSeek API 服务定价,预计涨幅较大,请合理安排使用。"——这是斩杀线战略的主动回撤信号。
这条比 Pro 转正更值得玩味。两年价格战后,智谱年内三次调价、月之暗面 Kimi K3 输出价涨至 100 元/百万(较上代旗舰涨 3.5 倍)、阿里云/腾讯云/百度智能云年初集体上调算力报价——国内大模型已整体告别"低价换规模"。DeepSeek 的涨价预告是在测试一个关键问题:用户留下,是因为便宜,还是因为强?
一句话总结:V4-Pro-0813 用"近旗舰性能 + 1/34 价格 + 零迁移成本兼容"三重斩杀,把行业竞争从"拼便宜"推向了"拼生态锁定 + 拼长上下文 Agent 落地";而涨价预告则宣告"免费/超低价时代进入倒计时"。
对用户:短期是薅羊毛窗口(官方明说涨价前囤额度);中期看各家在 Agent/长上下文场景的真刀真枪。
对开发者:Anthropic 兼容接口意味着可把 Claude 应用无缝切换到 DeepSeek——斩杀线的最大受益者是能用脚投票的开发者。