
DeepSeek V4 Pro 對決 Kimi K3:速度與價格迎戰 44 分推理天花板
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
DeepSeek V4 Pro 與 Kimi K3是兩款擁有百萬 token 視窗的開放權重推理旗艦,而雙方的競爭早在一個月前就已底定為穩定格局:Kimi K3(Moonshot AI 的 2.8 兆參數模型,於 2026 年 7 月 16 日發布)是智慧表現的領先者,DeepSeek V4 Pro(2026 年 8 月 13 日發布)則是速度與價格的領先者。新變化在於,這個組合中便宜的那一半,在九月初險些被刪除——DeepSeek 在 8 日將 V4 Pro 排入 9 月 14 日的退役時程,隨後延期,接著又在 11 日直接取消退役,承諾以不變的計費方式繼續提供該模型。這對本次對決的意義比對大多數情況都更大,因為「便宜、快速、100 萬上下文、開放權重」這樣的組合一旦失去,就很難找到替代,而另一邊的價格是它的五倍。
獨立數據來自 Artificial Analysis 的測量結果。DeepSeek 和 Moonshot 自家的發布基準標示為廠商自行回報,因為兩者都未經獨立重現。
Kimi K3 在跑分上勝出;V4 Pro 在帳單上勝出
獨立排行榜對於誰更聰明毫不含糊。Kimi K3 在最大努力下於 Artificial Analysis Intelligence Index 得分 44,在同類模型中排名第 2。DeepSeek V4 Pro 得分 36,在其級別中排名第 7。那九分的差距,正是任何人願意支付 Kimi K3 價格的全部原因。而價格正是這場對決不能只由指數決定的原因:Kimi K3 的定價為每百萬輸入 token $3.00、每百萬輸出 token $15.00,而 V4 Pro 的定價為離峰時段 $0.66/$1.98(尖峰時段 $1.32/$3.96)。在輸出方面,這大約是 7.5 倍——還未計入快取折扣。V4 Pro 的快取讀取在離峰時段每百萬 token 約為 $0.02,折扣達 97%;Kimi K3 的 90% 快取折扣則是從高得多的基數起算。對於 token 密集型工作負載,實際差距會擴大至接近十倍。
• 智慧指數 — Kimi K3 44(#2/113)對比 V4 Pro 36(#7/113)
• 價格 — Kimi K3 每 1M $3.00/$15.00,相較於 V4 Pro 離峰時段 $0.66/$1.98(尖峰時段 $1.32/$3.96)
• 速度 — V4 Pro 約 81 符元/秒,相較於 Kimi K3 約 35 符元/秒
• 上下文 — 兩者皆為 1M tokens
• 參數 — Kimi K3 總計 2.8T/啟用 104B,對比 V4 Pro 總計 1.6T/啟用 49B
• 權重 — 兩者皆開放(Kimi K3 開放權重,V4 Pro 採 MIT 授權)
• 輸入 — Kimi K3 文字與圖像 vs V4 Pro 僅文字
速度是每個人都低估的那個部分
沒有人談論的落差在於吞吐量。獨立測量下,V4 Pro 每秒輸出約 81 個 token;Kimi K3 則約為 35。在代理迴圈中,模型每一步會寫下數千個 token,這就是任務能在幾分鐘內完成,還是拖上一整個下午的差別——而成本差異更讓問題雪上加霜,因為你以大約一半的速度支付每百萬個輸出 token 15 美元。對於互動式程式設計助理、大量文件處理,以及任何把實際耗時視為預算項目的工作負載而言,V4 Pro 以七分之一的輸出價格提供 2.3 倍速度,這樣的組合是最具優勢的答案。
當九分值得的時候
為 Kimi K3 辯護的誠實理由,在於它的推理上限。它在 Intelligence Index 上的評估成本約為每次執行 $3,658——這反映的是真正漫長且昂貴的推理鏈,而非定價上的怪異現象。如果你的工作負載是艱難推理——深度數學證明、長遠規劃、長達數小時的代理任務,而多出的九個指數分數會體現為更少失敗——那麼 Kimi K3 值得它的溢價。反對它的誠實理由則是其他一切:吞吐量、快取經濟效益,以及光是每 token 的價格。
九月這波逆轉在這裡之所以重要,還有另一個原因:一個月前,明智的建議是「如果你打算以這個便宜、快速的開放模型作為統一標準,記得留一手——它可能會被下架。」但從九月十五日起,這層保險已經過時。DeepSeek 已公開承諾會讓 V4 Pro 繼續留在 API 上,並保證若有任何變動會事先通知;而 MIT 授權意味著無論 DeepSeek 如何處置其 API,這個模型仍可在你自己的硬體上部署。Kimi K3 的開放權重則在另一端提供同樣的自由,這正是讓這件事成為真正的「兩個開放權重」比較,而非一場服務與產品之間對決的原因。

兩款模型都在 OrcaRouter 上——DeepSeek V4 Pro 與 Kimi K3 都經由該平台路由,只需一組金鑰,供應商定價以零加成原樣傳遞——而路由 DSL 正是拆分這場對決的天然方式:把長程推論任務路由到 Kimi K3,讓那九分的優勢值回票價;並把 token 密集的吞吐工作路由到 DeepSeek V4 Pro,讓 7.5 倍的價差與 2.3 倍的速度差距為你發揮作用。這兩者既是競爭對手,也同樣經常是互補組合,而該平台讓同時運行兩者的工作量,等同於運行一個。


重點
Kimi K3 是更聰明的開放權重模型,領先九個指數點,而它的溢價——輸出 token 貴 7.5 倍、速度大約只有一半——是實實在在的成本,不是四捨五入的誤差。DeepSeek V4 Pro 則是快速、便宜、耐用的主力戰將,而在 9 月 11 日之後,它不再是隨時可能消失的風險。實際的答案正是兩個價格欄位都指向的方向:如果你的任務是困難的推理,就買 Kimi K3;如果是 token 用量大且講求時效,就買 DeepSeek V4 Pro;如果兩種都有,就兩者並用,依任務分流。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
