
Kimi K3 vs DeepSeek V4: 2つのオープンウェイトの巨人、比較
これが2026年注目のオープンウェイト対決です。Kimi K3とDeepSeek V4は、どちらもオープンウェイトの大規模 mixture-of-experts モデルで、約100万トークンのコンテキストと積極的な価格設定を持ち、どちらも中国の研究所から生まれました。もしオープンでセルフホスト可能なフロンティアクラスのモデルを求めているなら、これら2つが最終候補です。
違いは実際にあるが、具体的には次の通り:DeepSeek V4はテキストのみで、価格は絶対的な最低水準(多くの人が見逃すピーク時間帯の追加料金あり)。Kimiはネイティブのビジョン機能を追加し、独立した指標では総合的な知能でDeepSeekを上回る。ライセンスも異なり、DeepSeekは完全MIT、Kimiは修正MIT。選び方は以下の通り。
まず正直な注意点:2026年7月15日時点で、MoonshotはK3の正式な仕様やベンチマークを公開していません。リークされたローンチプロモは本物ですが、数値は確認されていません。そのため、能力を比較する際には、Kimiの出荷ラインであるK2.6およびK2.7 Codeを、K3が構築すると予想される下限として使用し、その旨を毎回明記します。K3の数字はすべて、モデルカードが公開されるまでは噂として扱ってください。
簡潔な評決
- オープン性: 両方ともオープンウェイトでセルフホスト可能。DeepSeek V4は完全にMITライセンス、Kimiは修正MITライセンス(非常に大規模な場合にブランディング要件を追加)。DeepSeekの方がより寛容なライセンスである。
- 価格: DeepSeek V4-Proは、オフピーク時に約0.435ドル(入力)/0.87ドル(出力) 1Mあたりで最安ですが、ピーク時は約2倍の追加料金がかかります。Kimiのラインは約0.60~0.95ドル / 2.80~4.00ドルです。DeepSeekは素の価格で勝りますが、ピーク時の価格に注意してください。
- 知能(独立):Kimi K2.6はArtificial Analysis Intelligence Index(54)でオープンウェイトをリードし、DeepSeek V4-Pro(52)をわずかに上回っています。
- モダリティ: Kimiはネイティブの視覚機能を持っていますが、DeepSeek V4はテキストのみです。オープンモデルで画像入力が必要なら、Kimiの勝ちです。
コーディング: 非常に近い、DeepSeek V4-ProはSWE-Bench Verified 80.6、LiveCodeBench 93.5を報告。Kimi K2.6はSWE-Bench Verified 80.2、オープンソースリーディングのSWE-Bench Pro 58.6を報告(DeepSeekの55.4に対して)。
- 結論: DeepSeek V4はテキストのみのコストが絶対的に最も低く、最も寛容なライセンスを備えているため選ぶこと; Kimi K3はネイティブビジョン、独立した知能における若干の優位性、そして(噂では)より長いコンテキストのために選ぶこと。多くのチームは両方を保持し、ルーティングすべきである。
概要
- Kimi K3(予想、K2.6/K2.7ベース):オープンウェイトMoE、Modified MIT;噂では2.5T~4Tパラメータ;噂では1Mコンテキスト;ネイティブビジョン;価格未発表(ライン約$0.60-$0.95 / $2.80-$4.00)。
- DeepSeek V4-Pro: オープンウェイトのMoE、MITライセンス。総パラメータ1.6T / アクティブ49B。コンテキスト長1M / 最大出力384K。テキスト専用。オフピーク時のおおよそのコスト: 入力$0.435 / 出力$0.87(キャッシュヒット時は約$0.0036)、ピーク時は約2倍。2026年4月24日リリース。(軽量版V4-Flashは284B/13Bで、約$0.14/$0.28で動作。)
- 注意: DeepSeekのレガシーAPI名(deepseek-chat / deepseek-reasoner)は2026年7月24日に廃止されます。これらを使用している場合は移行を計画してください。
価格とピーク時の漁獲量
理論上、DeepSeek V4-Proは利用可能な最も安価で有能なオープンモデルであり、入力100万トークンあたり約0.435ドル、出力0.87ドル、キャッシュヒットはほぼ無料です。Kimiのラインは少し高く、入力0.60〜0.95ドル、出力2.80〜4.00ドルです。純粋なテキスト量では、DeepSeekが価格競争に勝っています。
競合他社がめったに言及しない落とし穴: DeepSeekは従来のオフピーク割引をピーク時割増料金に変更しました。そのため、中国の業務時間帯(おおよそ09:00〜12:00および14:00〜18:00)では料金が約2倍になります。トラフィックがバースト的で中国の昼間に合わせている場合、実際のDeepSeekの請求額は見出しが示すよりもKimiの請求額に近くなることがあります。これはまさに、トークン単位ではなく時間単位の支出を測定したときに初めて明らかになるランディングコストの詳細です。
ベンチマーク:真の同着
この2つは、このシリーズの中で他のどのペアよりも近い存在です。コーディングにおいて、DeepSeek V4-ProはSWE-Bench Verified 80.6、LiveCodeBench 93.5、そして注目すべきCodeforcesレーティング3206を報告しています。一方、Kimi K2.6はSWE-Bench Verified 80.2、LiveCodeBench v6 89.6、そしてDeepSeekの55.4に対しオープンソースでトップのSWE-Bench Pro 58.6を報告しています。科学と数学では互角の戦いを繰り広げており(GPQA Diamondはそれぞれ約90、AIME 2026ではKimi 96.4、DeepSeek 94.3)。
タイブレーカーは独立かつ構造的です。Artificial Analysis Intelligence Indexでは、Kimi K2.6(54)がDeepSeek V4-Pro(52)を抑えて、トップのオープンウェイトモデルとなっています。しかしDeepSeekはテキストのみですが、Kimiのネイティブビジョンと噂されるより長いKimi K3コンテキストは、その能力を広げます。両ベンダーの自社コーディング数値は、ご自身での検証に値します。

ライセンス、モダリティ、およびセルフホスティング
オープンモデルを選ぶ際、実用的な3つのポイントが決定を左右します。ライセンス:DeepSeekのシンプルなMITは最も許容的であり、Kimiの修正MITは非常に大規模(ユーザー数1億以上、月収2000万ドル以上)でのみ可視ブランディング要件を追加するため、ほとんどのチームには無関係ですが、念のため留意すべき点です。モダリティ:Kimiは画像をネイティブに処理可能ですが、DeepSeekはテキストのみです。セルフホスティング:両方とも負荷が高く、DeepSeek V4-Proとフル品質のKimiはそれぞれ約8台のハイエンドGPUを必要とするため、多くのチームはオンプレミスではなく、中立管轄のホスト(OpenRouter、DeepInfra)で実行するでしょう。両方のファーストパーティAPIは中国の管轄下にあるため、データの保存場所が重要な場合はそれに応じてルーティングしてください。

どちらを使うべきですか?
テキストのみのコストを可能な限り低く抑え、最も寛容なライセンスを求める場合、かつトラフィックが中国のピーク時間帯に集中していない場合は、DeepSeek V4を選んでください。ネイティブビジョンが必要な場合、わずかな独立したインテリジェンスの優位性を求める場合、または噂のより長いコンテキストを使用する予定がある場合は、Kimi K3を選んでください。多くのチームにとって正解は両方です。冗長なオープンウェイトオプションとして保持するには十分に安価です。
その冗長性は、両方が1つのOrcaRouterエンドポイントの背後にある場合の機能です。テキストのみのバルクを現在の時間帯に安い方にルーティングし(DeepSeekのピーク時割増を自動的に回避)、画像タスクをKimiに送信し、どちらかのプロバイダーがスロットルした場合にそれらの間でフェイルオーバーすることができ、すべてのモデルごとのコストとレイテンシを1つのダッシュボードで確認できます。2つのオープンモデル、1つの統合、そして常に安い方が前面に。

よくある質問
Kimi K3とDeepSeek V4では、どちらのほうが安いですか?
DeepSeek V4-Proは紙面上では安い(オフピーク時約$0.435/$0.87 vs Kimiの約$0.60-$0.95/$2.80-$4.00)が、ピーク時の約2倍の割増料金が日中中国向けトラフィックの差を縮める可能性がある。
どちらがより有能ですか?
非常に僅差です。Kimi K2.6 は独立したArtificial Analysis Intelligence Index(54対52)およびSWE-Bench ProでDeepSeek V4-Proを僅かに上回りました。DeepSeekはCodeforcesレーティングとLiveCodeBenchでリードしています。K3はKimiの数値を引き上げると見込まれており、ローンチ時に確認してください。
両方とも画像をサポートしていますか?
いいえ。Kimiはネイティブビジョンを備えていますが、DeepSeek V4はテキストのみです。オープンモデルで画像入力が必要な場合は、Kimiを選んでください。
両方を実行して自動的に切り替えることはできますか?
はい、それは強力なパターンです。OrcaRouterのようなゲートウェイは、タスクごとに安価または適している方のオープンモデルにルーティングし、単一のエンドポイントの背後でそれらの間でフェイルオーバーすることができます。
Kimi K3にはまだ公式のベンチマークがありませんが、この比較を信頼できますか?
もっともな質問です。2026年7月15日現在、K3は未確認のため、この比較ではKimiが出荷しているK2.6/K2.7ラインを下限として、すべてのK3の数字を噂としてラベル付けしています。コミュニティのコンセンサスは「興奮しているが、本当の数字を待つ」であり、独立したリーダーボードは通常、リリース後3~6週間で公開されます。低リスクの方法:判定を方向性として扱い、今すぐタスクベースのルーティングを設定し、Moonshotの公式K3の数字が発表された日に再ベンチマークを実施することです。
結論
Kimi K3とDeepSeek V4は、2026年における2つの最高のオープンウェイトモデルであり、両方を合理的に実行できるほど近いです。テキスト専用の最低コストとよりクリーンなライセンスを求めるならDeepSeekを、ネイティブビジョンとわずかな性能の優位性を求めるならKimiを選び、迷う場合はそれらをルーティングして、より安く、より適したモデルに各リクエストを勝ち取らせましょう。
