一張生成的主視覺卡片,標題為「DeepSeek V4 Pro 對決 Kimi K3」,左側有一個速度儀表圖示,標示為「DeepSeek V4 Pro」,徽章顯示「~81 tok/s · /bin/bash.66/.98」;右側有一個大腦圖示,標示為「Kimi K3」,徽章顯示「指數 44 · .00/5.00」;兩者之間有一條細緻的賽道分隔線,頁腳為「速度與價格對比推理上限」。
Guides & Insights

DeepSeek V4 Pro 對決 Kimi K3:速度與價格迎戰 44 分推理天花板

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

DeepSeek V4 ProKimi K3是兩款擁有百萬 token 視窗的開放權重推理旗艦,而雙方的競爭早在一個月前就已底定為穩定格局:Kimi K3(Moonshot AI 的 2.8 兆參數模型,於 2026 年 7 月 16 日發布)是智慧表現的領先者,DeepSeek V4 Pro(2026 年 8 月 13 日發布)則是速度與價格的領先者。新變化在於,這個組合中便宜的那一半,在九月初險些被刪除——DeepSeek 在 8 日將 V4 Pro 排入 9 月 14 日的退役時程,隨後延期,接著又在 11 日直接取消退役,承諾以不變的計費方式繼續提供該模型。這對本次對決的意義比對大多數情況都更大,因為「便宜、快速、100 萬上下文、開放權重」這樣的組合一旦失去,就很難找到替代,而另一邊的價格是它的五倍。

獨立數據來自 Artificial Analysis 的測量結果。Deep​Seek 和 Moonshot 自家的發布基準標示為廠商自行回報,因為兩者都未經獨立重現。

Kimi K3 在跑分上勝出;V4 Pro 在帳單上勝出

獨立排行榜對於誰更聰明毫不含糊。Kimi K3 在最大努力下於 Artificial Analysis Intelligence Index 得分 44,在同類模型中排名第 2。DeepSeek V4 Pro 得分 36,在其級別中排名第 7。那九分的差距,正是任何人願意支付 Kimi K3 價格的全部原因。而價格正是這場對決不能只由指數決定的原因:Kimi K3 的定價為每百萬輸入 token $3.00、每百萬輸出 token $15.00,而 V4 Pro 的定價為離峰時段 $0.66/$1.98(尖峰時段 $1.32/$3.96)。在輸出方面,這大約是 7.5 倍——還未計入快取折扣。V4 Pro 的快取讀取在離峰時段每百萬 token 約為 $0.02,折扣達 97%;Kimi K3 的 90% 快取折扣則是從高得多的基數起算。對於 token 密集型工作負載,實際差距會擴大至接近十倍。

• 智慧指數 — Kimi K3 44(#2/113)對比 V4 Pro 36(#7/113)

• 價格 — Kimi K3 每 1M $3.00/$15.00,相較於 V4 Pro 離峰時段 $0.66/$1.98(尖峰時段 $1.32/$3.96)

• 速度 — V4 Pro 約 81 符元/秒,相較於 Kimi K3 約 35 符元/秒

• 上下文 — 兩者皆為 1M tokens

• 參數 — Kimi K3 總計 2.8T/啟用 104B,對比 V4 Pro 總計 1.6T/啟用 49B

• 權重 — 兩者皆開放(Kimi K3 開放權重,V4 Pro 採 MIT 授權)

• 輸入 — Kimi K3 文字與圖像 vs V4 Pro 僅文字

速度是每個人都低估的那個部分

沒有人談論的落差在於吞吐量。獨立測量下,V4 Pro 每秒輸出約 81 個 token;Kimi K3 則約為 35。在代理迴圈中,模型每一步會寫下數千個 token,這就是任務能在幾分鐘內完成,還是拖上一整個下午的差別——而成本差異更讓問題雪上加霜,因為你以大約一半的速度支付每百萬個輸出 token 15 美元。對於互動式程式設計助理、大量文件處理,以及任何把實際耗時視為預算項目的工作負載而言,V4 Pro 以七分之一的輸出價格提供 2.3 倍速度,這樣的組合是最具優勢的答案。

當九分值得的時候

為 Kimi K3 辯護的誠實理由,在於它的推理上限。它在 Intelligence Index 上的評估成本約為每次執行 $3,658——這反映的是真正漫長且昂貴的推理鏈,而非定價上的怪異現象。如果你的工作負載是艱難推理——深度數學證明、長遠規劃、長達數小時的代理任務,而多出的九個指數分數會體現為更少失敗——那麼 Kimi K3 值得它的溢價。反對它的誠實理由則是其他一切:吞吐量、快取經濟效益,以及光是每 token 的價格。

九月這波逆轉在這裡之所以重要,還有另一個原因:一個月前,明智的建議是「如果你打算以這個便宜、快速的開放模型作為統一標準,記得留一手——它可能會被下架。」但從九月十五日起,這層保險已經過時。DeepSeek 已公開承諾會讓 V4 Pro 繼續留在 API 上,並保證若有任何變動會事先通知;而 MIT 授權意味著無論 DeepSeek 如何處置其 API,這個模型仍可在你自己的硬體上部署。Kimi K3 的開放權重則在另一端提供同樣的自由,這正是讓這件事成為真正的「兩個開放權重」比較,而非一場服務與產品之間對決的原因。

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

兩款模型都在 OrcaRouter 上——DeepSeek V4 Pro 與 Kimi K3 都經由該平台路由,只需一組金鑰,供應商定價以零加成原樣傳遞——而路由 DSL 正是拆分這場對決的天然方式:把長程推論任務路由到 Kimi K3,讓那九分的優勢值回票價;並把 token 密集的吞吐工作路由到 DeepSeek V4 Pro,讓 7.5 倍的價差與 2.3 倍的速度差距為你發揮作用。這兩者既是競爭對手,也同樣經常是互補組合,而該平台讓同時運行兩者的工作量,等同於運行一個。

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

重點

Kimi K3 是更聰明的開放權重模型,領先九個指數點,而它的溢價——輸出 token 貴 7.5 倍、速度大約只有一半——是實實在在的成本,不是四捨五入的誤差。DeepSeek V4 Pro 則是快速、便宜、耐用的主力戰將,而在 9 月 11 日之後,它不再是隨時可能消失的風險。實際的答案正是兩個價格欄位都指向的方向:如果你的任務是困難的推理,就買 Kimi K3;如果是 token 用量大且講求時效,就買 DeepSeek V4 Pro;如果兩種都有,就兩者並用,依任務分流。

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新