V4 Pro 这一刀,把大模型的「不可能三角」砍穿了
胡新宇
Published on 2026-08-15
DeepSeek V4 Pro 0813 与 Grok 4.6 在 2026-08-12 同夜发布,让 1.5T 尺寸的中端模型第一次同时压住性能、价格、速度三角。本文用 5 项基准跃升、SemiAnalysis 海外背书、1100 万 token 跑腾讯财报的工程案例,拆解这条新的斩杀线,并给出明确的赢家/输家名单与三层行动建议。

V4 Pro 这一刀,把大模型的「不可能三角」砍穿了
8 月 12 日晚 11 点,DeepSeek 把 V4 Pro 0813 正式版丢上了线。两个小时前,xAI 的 Grok 4.6 刚刚发布。两个 1.5T-1.6T 尺寸的模型,同一夜,把 Claude Fable 5 的体验区踩了一遍。
数字生命卡兹克当晚给 Grok 氪了 300 美元,又给 DeepSeek API 充了 1000 元。他不是为情怀买单,是给「主力模型」换岗。
这一夜发生的事,本质不是"价格战"。是 1.5T 这个参数段的中端模型,第一次同时把性能、价格、速度压到了同一个区间——这条没人命名过的边界线,被 V4 Pro 一刀砍穿了。
第一刀:DeepSWE 从 12.8 到 62.7,5 倍跃升
DeepSeek 自己放出来的基准对比里,最刺眼的不是单一指标的提升,是 9 项 Agent 基准里每一项都在涨,而且大多涨 30% 以上:
| 基准 | 4 月预览版 | 0813 正式版 | 提升幅度 |
|---|---|---|---|
| DeepSWE(软件工程) | 12.8 | 62.7 | 4.9 倍 |
| Cybergym(安全攻防) | 52.7 | 83.3 | +58% |
| AutomationBench | 12.8 | 31.8 | +148% |
| DSBench-Hard | 31.1 | 67.2 | +116% |
| Terminal Bench 2.1 | 72.1 | 87.9 | +22% |
5 个月前预览版还只能算"能跑通"的水平,今天正式版在 Terminal Bench 上 87.9 分已经超过 Opus 5 同类基准。这意味着 V4 Pro 不再是一个"够用"的模型,而是一个开始逼旗舰退位的模型。
(数据来源:DeepSeek 官方文档 + 值得关注的《DeepSeek,发动"临时价格战"》)
另一个值得说的细节是规格:1M tokens 上下文窗口 + 38.4 万 tokens 最大输出 + 默认开启思考模式。这意味着 V4 Pro 不仅"能做",还能"一次读完一整个中型代码仓库再开干"。对 Agent 工作流来说,这是从"分段喂"到"全量喂"的临界点。

第二刀:6 元/百万 tokens,不是终点是起点
V4 Pro 0813 的价格表:
- 输入(缓存未命中):3 元 / 百万 tokens
- 输出:6 元 / 百万 tokens
- 缓存命中输入:0.025 元 / 百万 tokens
把输出价格摆到国际坐标系里:Opus 5 的 1/30,Fable 5 的 1/60。一杯奶茶钱能买 500 万字生成,这不是夸张。
但更值得玩味的是 DeepSeek 自己在官方页面同步挂出的"涨价预告"——这意味着 6 元是引流价,不是常态价。苏扬把它定义为"临时价格战":先用 818 这种节点把价格砸穿同行心理防线,再用留住的用户把价格慢慢爬回来。

