
DeepSeek V4 Pro 対 Kimi K3:44点の推論上限に挑む速度と価格
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0340知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2134知能69コーディング
DeepSeek V4 ProとKimi K3は、100万トークンのウィンドウを備えた2大オープンウェイト推論フラッグシップであり、その競争は1か月前に安定した形に落ち着いた。Kimi K3(Moonshot AIの2.8兆パラメータモデル、2026年7月16日リリース)は知能のリーダーであり、DeepSeek V4 Pro(2026年8月13日リリース)は速度と価格のリーダーである。新しいのは、その組み合わせの安価な側が9月前半にほぼ消滅しかけたことだ——DeepSeekは8日にV4 Proを9月14日の廃止予定に載せ、それを延期し、そして11日には廃止を完全に取り消し、課金体系を変えずにモデルの提供を続けると約束した。これは、ほとんどの対決の場合よりもこの対決にとって重要である。なぜなら「安価、高速、100万コンテキスト、オープンウェイト」という組み合わせは、代替手段が5倍のコストがかかるときには置き換えるのが難しいからだ。
独立した数値はArtificial Analysisによる測定値です。DeepSeekとMoonshot自身の発表ベンチマークは、どちらも独立して再現されていないため、ベンダー報告と表示されています。
Kimi K3はインデックスを制し、V4 Proは請求額を制す
独立系スコアボードは、どちらがより賢いかについて明確だ。最大努力時の Kimi K3 は Artificial Analysis Intelligence Index で44を記録し、同等モデルの中で2位。DeepSeek V4 Pro は36で、同クラス内7位。この9ポイントの差こそが、誰もが Kimi K3 の価格を払う理由そのものだ。そして価格こそが、この対決がインデックスだけでは決着しない理由でもある。Kimi K3 の定価は入力100万トークンあたり3.00ドル、出力100万トークンあたり15.00ドル。一方 V4 Pro はオフピーク時0.66/1.98ドル(ピーク時1.32/3.96ドル)。出力では、キャッシュ割引前でおよそ7.5倍。V4 Pro のキャッシュ読み取りはオフピーク時100万トークンあたり約0.02ドルで、97%割引。Kimi K3 の90%キャッシュ割引は、はるかに高い基準額から始まる。トークン消費の多いワークロードでは、実効差は10倍近くまで広がる。
• インテリジェンス指数 — Kimi K3 44(#2/113)対 V4 Pro 36(#7/113)
• 価格 — Kimi K3 は100万あたり $3.00/$15.00、V4 Pro はオフピーク時 $0.66/$1.98(ピーク時 $1.32/$3.96)
• 速度 — V4 Pro 約81トークン/秒 対 Kimi K3 約35トークン/秒
• コンテキスト — 両方とも 1M トークン
• パラメータ — Kimi K3 は合計 2.8T/アクティブ 104B、V4 Pro は合計 1.6T/アクティブ 49B
• ウェイト — 両方ともオープン(Kimi K3 オープンウェイト、V4 Pro MIT)
• 入力 — Kimi K3 はテキストと画像、V4 Pro はテキストのみ
スピードは誰もが軽視しがちな部分だ
誰も語らない差はスループットだ。V4 Proは独立測定で毎秒約81トークンを出力し、Kimi K3は約35トークンにとどまる。モデルが1ステップで数千トークンを書くエージェントループでは、これは数分で終わるタスクと午後いっぱい引きずるタスクの違いになる——しかもコスト差がそれを増幅する。なぜなら、約半分の速度で出力100万トークンあたり15ドルを支払っているからだ。インタラクティブなコーディング支援、大量文書処理、そして実時間が予算項目となるあらゆるワークロードにとって、出力価格7分の1で2.3倍の速度というV4 Proの組み合わせが支配的な答えだ。
9つのポイントが価値を持つとき
Kimi K3を支持する正直な根拠は、その推論能力の上限の高さにある。Kimi K3の Intelligence Index における評価コストは、この実行で約$3,658だった——これは価格設定の特異性によるものではなく、本当に長く高コストな推論チェーンを反映している。あなたのワークロードが高度な推論——深い数学的証明、長期的な計画、インデックスポイントが9ポイント増えることが失敗の減少として現れる数時間にわたるエージェントタスク——であるなら、Kimi K3はそのプレミアム分の価値がある。Kimi K3に反対する正直な根拠は、それ以外のすべてにある。スループット、キャッシュの経済性、そしてトークンあたりの価格そのものだ。
ここで9月の反転が重要になるもう一つの理由:1か月前、分別ある助言は「安価で高速なオープンモデルを標準にするつもりなら、保険をかけておけ——廃止されるかもしれない」というものだった。9月15日時点で、その保険は無意味になった。DeepSeekは、V4 ProをAPIで提供し続けると公に約束し、何か変更があれば通知することも約束している。そしてMITライセンスのおかげで、DeepSeekがAPIをどう扱おうと、モデルは自前のハードウェアでデプロイ可能なままだ。Kimi K3のオープンウェイトは、もう一方の側にも同じ自由をもたらす。だからこそこれは、サービスと製品の争いではなく、真のオープンウェイト同士の比較になっている。

両方のモデルはOrcaRouter上にあります — DeepSeek V4 ProとKimi K3はどちらもこのプラットフォームを通じてルーティングされます1つのキーで、プロバイダーの定価はゼロマークアップでそのまま適用され — そしてルーティングDSLはこの対決を振り分ける自然な方法です。長期的な推論タスクは、9ポイントの優位が元を取れるKimi K3へ、トークン消費の多いスループット作業は、7.5倍の価格差と2.3倍の速度差が効いてくれるDeepSeek V4 Proへ回しましょう。両者は競合であるのと同じくらいしばしば補完関係にあり、そしてこのプラットフォームなら、両方を動かすのも片方を動かすのと同じ手間で済みます。


結論
Kimi K3はより賢いオープンウェイトモデルで、指数で9ポイント先行しており、その割高さ——出力トークンで7.5倍、速度はおよそ半分——は丸め誤差ではなく実際のコストだ。DeepSeek V4 Proは高速で安価、堅牢な主力であり、9月11日以降はもはや離脱リスクではない。実用的な答えは、両方の価格列が指し示すとおりだ。タスクが難しい推論ならKimi K3を買い、トークン量が多く時間に敏感ならDeepSeek V4 Proを買い、両方の種類があるなら両方を動かしてタスクごとに振り分ければよい。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
