
DeepSeek V4 Pro 對決 Grok 4.6:一場相隔 24 小時開打的價格戰,以及究竟是誰真正勝出
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
Grok 4.6 shipped on August 12, 2026, and DeepSeek V4 Pro followed the next day — the two flagship launches of the same forty-eight hours, now a month behind us and newly worth revisiting because one of them spent last week trying to retire and then changing its mind. Both are frontier-class reasoning models, but they could not be more different products: Grok 4.6 is xAI's proprietary flagship at $2.00 per million input tokens and $6.00 per million output tokens, and DeepSeek V4 Pro is the MIT-licensed open-weights model from DeepSeek at $0.66/$1.98 off-peak (or $1.32/$3.96 at peak). The interesting thing about the matchup is how little the raw price ratio — about 3x on output, over 9x when you stack V4 Pro's off-peak and cache windows — tells you about who should use which. The two are aimed at different buyers, and the September events on the DeepSeek side changed the calculus for exactly one of those buyers.
這篇文章中的獨立數字是 Artificial Analysis 的測量結果。廠商自行運行的數據標記為廠商報告,因為兩家公司的發布基準都尚未被第三方重現。
同一週,同一推理類別,截然相反的哲學
在 Artificial Analysis Intelligence Index 上,Grok 4.6 在高強度模式下得分 44——在整個指數的 200 個模型中排名第 20——而 DeepSeek V4 Pro 得分 36,在其所屬類別中排名第 7。八分的差距,意味著較高的價格確實買到了可量測的推理能力,而不只是包裝。但正是包裝說明了其餘的價差:Grok 4.6 是一款多模態的專有模型——支援文字與圖像輸入、500K 上下文、預設啟用推理——你可透過 xAI 的 API 或合作夥伴呼叫。DeepSeek V4 Pro 僅支援文字、1M 上下文,並隨附 MIT 授權的權重,你可以自行下載並部署。
• 智慧指數 — Grok 4.6 44(#20/200)對比 V4 Pro 36(#7/113)
• 價格 — Grok 4.6 每 1M $2.00/$6.00,對比 V4 Pro 離峰 $0.66/$1.98(尖峰 $1.32/$3.96)
• 速度 — Grok 4.6 約 57 tokens/秒,對比 V4 Pro 約 81 tokens/秒
• 上下文 — Grok 4.6 500K 對比 V4 Pro 1M
• 輸入 — Grok 4.6 文字與圖像 vs V4 Pro 僅文字
• 權重 — Grok 4.6 專有 vs V4 Pro MIT 開放權重
3 倍價格溢價在哪裡顯現、哪裡不顯現
價格差距是真的,其中有一部分是智慧上的差距,但只有一部分是。Grok 4.6 在獨立指數上領先八分,而其餘的溢價買到的是原始能力以外的東西:xAI 的生態系、圖像輸入,以及由一家全副業務都押在這一款產品上的公司所提供的 500K 上下文。更強烈的對比在於部署這件事。Grok 4.6 是一項服務:你租用它,永遠不擁有它。DeepSeek V4 Pro 也是一項服務,但 MIT 授權的權重意味著它同時也是基礎設施:如果 API 價格或供應商的路線圖不再適合你,你可以在自己的硬體上架起同一個模型,只需付出邊際運算成本。這是本質上的差異,而非程度上的差異,而正是這一點讓「更便宜」這個說法顯得不完整。
九月的逆轉改變了這個故事的一半
9月8日那一週,DeepSeek 讓 V4 Pro 走上退役之路:自9月14日起,對 deepseek-v4-pro 的請求將被路由至 V4.1 Flash,並以 Flash 的價格計費,直到 V4.1 Pro 推出為止。隨後它延後了截止期限,接著在9月11日又完全逆轉,承諾維持以不變的計費方式繼續提供 V4 Pro,並表示若情況有變會提前通知。這項逆轉當天獲中國官媒與多家科技媒體證實。就這場對決而言,這則消息對 Grok 那一方的意義大於 DeepSeek 那一方:任何原本因為「那個便宜的開源模型即將消失」而傾向 Grok 4.6 的人,其理由已被悄悄刪除。可負擔的那一半具有持久性,這讓高階的那一半成為一種選擇,而非被迫的避險。

這場對戰實際上對誰有利
如果你想要一個具備圖像輸入、長上下文,且無意自行運行權重的前沿推理模型,Grok 4.6 的 $2/$6 是合理價位,而它在指數上的 44 分也足以與該級別的任何模型匹敵。如果你的工作負載是純文字且 token 用量龐大,DeepSeek V4 Pro 在帳單上幾乎每個面向都是更好的答案:尖峰時段便宜約三倍、更深的快取折扣、更快的輸出、兩倍的上下文,以及可作為退路的開放權重。真正棘手的情況是純文字、推理繁重且對延遲要求嚴苛——此時那八分的差距就有意義,該由你的評測來決定,而不是行銷話術。
兩者今日都已上線 OrcaRouter——Grok 4.6 與 DeepSeek V4 Pro 皆經由該平台路由——因此你可以用同一把金鑰呼叫任一個(或兩者),並以零加成的方式直接沿用供應商的定價。由於是精確透傳,本文中的價格欄位就是你實際支付的價格,而路由 DSL 意味著你可以從同一套整合中,把圖像輸入任務送往 Grok 4.6、把長文字任務送往 DeepSeek V4 Pro。本文的基本假設是:你會想要兩者,正是因為兩者都無法取代另一方的長處。


裁決
Grok 4.6 和 DeepSeek V4 Pro 都是強大的推理模型,各自獨立的評分確實不相上下,而兩者之間的價格差距,換來的是真實但狹窄的智慧優勢,外加一套截然不同的產品哲學:多模態輸入與封閉生態系,對比純文字、開放權重,以及便宜三到九倍的 token。如果你是在租用推理能力,兩者都行,由你的評測決定。如果你是在打造基礎設施,DeepSeek V4 Pro 是那種歷經一週退役風波也殺不死的模型——而且自 9 月 15 日起,它也是唯一附有書面承諾會留下來的那一個。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
