
DeepSeek V4 Pro 对决 Grok 4.6:一场相隔 24 小时打响的价格战,最终谁才是赢家
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77代码
- google新Google: Gemini 3.8 Flash2026-09-0241智能76代码
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72代码
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0340智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69代码
Grok 4.6于 2026 年 8 月 12 日发布,DeepSeek V4 Pro 次日紧随其后——这是同一个 48 小时内登场的两款旗舰,如今已过去一个月,却新近变得值得重提,因为其中一款上周试图退役,随后又改了主意。两者都是前沿级推理模型,但作为产品却再不同不过:Grok 4.6 是 xAI 的专有旗舰,每百万输入 token 收费 2.00 美元,每百万输出 token 收费 6.00 美元;而 DeepSeek V4 Pro 是来自 DeepSeek 的 MIT 许可开放权重模型,错峰价 0.66/1.98 美元(高峰期为 1.32/3.96 美元)。这场对决的有趣之处在于,原始价格比——输出端约 3 倍,若叠加 V4 Pro 的错峰与缓存窗口则超过 9 倍——几乎说明不了谁该用哪一款。两者瞄准的是不同的买家,而 DeepSeek 一方 9 月发生的事件,恰好只改变了其中一类买家的算盘。
这篇文章中的独立数字是 Artificial Analysis 的测量结果。厂商提供的数字被标注为厂商报告,因为两家公司的发布基准都尚未被第三方复现。
同一周,同一推理课,截然相反的哲学
在 Artificial Analysis Intelligence Index 上,Grok 4.6 在高强度模式下得分 44——在整个指数涵盖的 200 个模型中排名第 20——而 DeepSeek V4 Pro 得分 36,在其所属类别中排名第 7。八分的差距,意味着这笔溢价确实买到了可衡量的推理能力,而不只是包装。但正是包装解释了其余的价格差异:Grok 4.6 是一个多模态专有模型——支持文本与图像输入、500K 上下文、默认开启推理——你通过 xAI 的 API 或合作伙伴来调用它。DeepSeek V4 Pro 则仅支持文本,拥有 1M 上下文,并随附 MIT 许可的权重,你可以自行下载并部署。
• 智能指数 — Grok 4.6 44(#20/200)对比 V4 Pro 36(#7/113)
• 价格 — Grok 4.6 每 1M $2.00/$6.00,对比 V4 Pro 非高峰时段 $0.66/$1.98(高峰时段 $1.32/$3.96)
• 速度 — Grok 4.6 约 57 tokens/秒,而 V4 Pro 约 81 tokens/秒
• 上下文 — Grok 4.6 500K 对比 V4 Pro 1M
• 输入 — Grok 4.6 文本和图像 对比 V4 Pro 仅文本
• 权重 — Grok 4.6 专有 vs V4 Pro MIT 开放权重
3倍价格溢价在何处显现、在何处不显现
价格差距是真实存在的,其中一部分是智能差距,但也仅仅是一部分。Grok 4.6 在独立指数上领先八分,而溢价中其余的部分为你买到的是原始能力之外的东西:xAI 的生态系统、图像输入,以及由一家全部业务都押在这一款产品上的公司所提供的 500K 上下文。更鲜明的对比在于部署这件事。Grok 4.6 是一项服务:你租用它,却从不拥有它。DeepSeek V4 Pro 也是一项服务,但 MIT 权重意味着它同时也是基础设施:如果 API 价格或厂商的路线图不再适合你,你可以只付出算力的边际成本,在自己的硬件上把同一个模型跑起来。这是性质上的差异,而非程度上的差异,也正是它让“更便宜”这一说法并不完整。
九月的逆转改变了这个故事的一半
9月8日那周,DeepSeek 让 V4 Pro 走上了退役之路:从9月14日起,发往 deepseek-v4-pro 的请求将被路由至 V4.1 Flash,并按 Flash 价格计费,直到 V4.1 Pro 发布。随后它推迟了截止日期,然后在9月11日彻底反转,承诺继续以不变的计费方式提供 V4 Pro 服务,并表示若情况有变会提前通知。这一反转当天得到了中国官方媒体和多家科技媒体的证实。对于这次对决,这条消息对 Grok 一方的影响大于 DeepSeek 一方:任何因为“便宜的开源模型即将消失”而倾向于 Grok 4.6 的人,其理由都被悄然删除了。可负担的那一半是持久的,这使得高端的那一半成为一种选择,而非被迫的对冲。

这场对决实际上对谁有利
如果你想要一个具备图像输入、长上下文,而且无意自行运行权重的前沿推理模型,Grok 4.6 的 $2/$6 算是公道价格,它在指数上的 44 分也与该档位的任何模型相比都很有竞争力。如果你的工作负载是纯文本且 token 消耗巨大,DeepSeek V4 Pro 在账单上体现出来的几乎每一个维度上都是更好的答案:峰值时价格大约只要三分之一、缓存折扣更大、输出更快、上下文长度翻倍,而且开放权重可作为退路。真正棘手的情况是纯文本、推理密集,同时对延迟要求又很严苛——这时那 8 分的差距就很关键,应该由你的评测来决定,而不是营销宣传。
目前两者都已上线 OrcaRouter——Grok 4.6 和 DeepSeek V4 Pro 都通过该平台路由——因此你只需一个密钥,就能调用其中任意一个(或两者同时调用),提供商目录价零加价原样透传。由于透传是精确的,本文中的价格列就是你实际支付的价格;而路由 DSL 意味着,你可以在同一套集成中把图像输入任务发给 Grok 4.6,把长文本任务发给 DeepSeek V4 Pro。这篇文章的基本假设是:你之所以想同时拥有两者,正是因为二者都无法匹敌对方的长处。


裁决
Grok 4.6 和 DeepSeek V4 Pro 都是强大的推理模型,独立评分确实不相上下,而它们之间的价格差距所换来的,是智能上一项真实但狭窄的优势,外加一种截然不同的产品哲学:多模态输入与封闭生态,对纯文本、开放权重,以及便宜三到九倍的 token。如果你是在租用推理能力,两者都能胜任,由你的评测说了算。如果你是在构建基础设施,DeepSeek V4 Pro 就是那个一场持续一周的退役风波也杀不死的模型——而截至9月15日,它也是那个已书面承诺留下来的模型。
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
