Gemini 3.7 Flash と DeepSeek V4 Flash の比較を示すタイトルカード。2つの稲妻が描かれており、「Gemini 3.7 Flash」とラベル付けされた閉じた鍵付きボックスには $0.75 / $3.75 のタグが付き、「DeepSeek V4 Flash」とラベル付けされたダウンロード矢印付きの開いたボックスには $0.14 / $0.28 のタグが付いている。
Guides & Insights

Gemini 3.7 Flash vs DeepSeek V4 Flash:同じ質問に正反対の答えを出す2つの「Flash」モデル

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

2026年で最も紛らわしい名前を持つ2つのモデルは、どちらもFlashと呼ばれており、同じ質問に対してこれ以上ないほど異なる答えを返す。2026年8月13日にリリースされたGemini 3.7 Flashは、Go​ogleのクローズドな主力モデルであり、毎秒約340出力トークン、インテリジェンス指数56、プロモーション価格は入力100万トークンあたり0.75ドル、出力100万トークンあたり3.75ドルである。DeepSeek V4 Flashは、Deep​SeekのV4ファミリーにおけるオープンウェイト版のモデルで、4月に出荷され、7月末に更新された。MITライセンスで、ダウンロード可能であり、Deep​Seek独自のAPI上では入力100万トークンあたり0.14ドル、出力100万トークンあたり0.28ドルという価格設定だ。これはGo​ogleのプロモーション入力価格の約5分の1、出力価格の約13分の1に相当する。どちらも「フラッシュ」モデルであり、大量処理向けに高速かつ低コストを実現している。似ているのはその名称だけである。

彼らが異なる答えを出す問いこそ、この世代を定義する問いである。すなわち、知性をレンタルするのか、それとも所有するのか。DeepSeek V4 Flashは、2840億パラメータのMixture-of-Expertsモデルで、トークンあたり約130億のアクティブパラメータ、100万トークンのコンテキストウィンドウ、38万4000トークンの出力上限を持ち、MITライセンスで公開されている。重みは約160GBのダウンロードであり、7月31日のアップデート(V4-Flash-0731)ではエージェント機能が大幅に強化された。Gemini 3.7 Flashは、Gemini 3.6 Flashをベースに構築されたプロプライエタリモデルで、100万トークンのコンテキスト、6万4000トークンの出力上限、マルチモーダル入力を備え、セルフホスティングの道はない。これらのモデルのうち一方は、エアギャップ化、ファインチューニング、自前のハードウェアでの実行が可能である。もう一方は、Go​ogleが実行する環境でのみ動作する。

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

二人のフラッシュ、並んで

両モデルは同じ購買層をターゲットにしている。トークン単位でフラッグシップを導入できない高ボリュームの本番ワークロードだ。だが、そこに至るアーキテクチャは正反対である。DeepSeek V4 Flashのハイブリッド注意力(圧縮スパース+強圧縮注意力)こそが、100万トークンのコンテキストをこの価格で販売できるほど経済的にしている要因だ。これはDeep​Seekが従来の`deepseek-chat`および`deepseek-reasoner`エンドポイントで使用していたモデルで、7月に廃止された。Gemini 3.7 Flashは、Go​ogleが自社のFlashラインをアルゴリズム的に改良したものであり、その強みは提供スループットにある。独立した計測では、DeepSeek V4 Flashの約113トークン/秒に対し、約340トークン/秒を記録している。さらに、DeepSeek V4 Flashが対応しない音声・映像入力を処理しながら、この速度を達成している。

知能指数 — Artificial Analysis によると、Gemini 3.7 Flash は 56、DeepSeek V4 Flash は 50。

出力速度 — ~340 tokens/s 対 ~113 tokens/s、いずれも Artificial Analysis 調べ。

コンテキストウィンドウ — 両方とも1Mトークン。DeepSeek V4 Flashは最大384Kを出力するのに対し、Gemini 3.7 Flashは64K。

入力価格 — $0.75(プロモーション価格、2026年まで)に対し、Deep​Seekの自社APIでは$0.14。

出力価格 — $3.75(プロモーション価格)対 $0.28。

重み — プロプライエタリ vs MITライセンス、ダウンロード可能。

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

6つのインデックスポイントが実際に買えるもの

6ポイントのIndexギャップは意味のある差だが、隔絶とまでは言えない。その差は主に、DeepSeek V4 Flashが最適化されていない領域に集中している。Gemini 3.7 Flashの報告されているエージェント型コーディングのスコア(DeepSWE v1.1で65.3、FrontierCode 1.1 Mainで43.6、いずれもベンダー報告値)は大きくリードしており、Web開発のElo(1588、これもベンダー報告値)は実際のUI生成の改善を反映している。DeepSeek V4 Flash自身の報告値(SWE-bench Verifiedで79.0、LiveCodeBenchで91.6、独立したトラッカーが裏付けるτ²-Benchスコア95.0)は、制約付きコーディングとツール使用において十分に通用する。また、1Mコンテキストの検索性能(MRCRで78.7、CorpusQAで60.5)は、同価格帯のどのモデルと比較しても競争力がある。パターンは明快だ。Gemini 3.7 Flashはエージェント性能の深さとWeb関連タスクでリードし、DeepSeek V4 Flashはそれらと引き換えに、生のトークン経済性と、クローズドモデルの実用機が誰も到達しない長文コンテキストの上限を提供する。

オープンウェイトは価格だけでなく、調達のあり方も変える。

MITライセンスは、この比較の中で、どのベンチマーク表も捉えていない部分です。DeepSeek V4 Flashは、自社のハードウェアにダウンロードして実行でき、自社データでファインチューニングでき、API呼び出しが許可されていない環境でも使用できます。しかも、このライセンスには規模に基づく制限がないため、成長しても条件が変わることはありません。実質的なコストは運用面にあります。284BのMoEモデルを、プロダクションチームが求める速度で提供するには、相当なGPUリソースが必要であり、ほとんどのチームにとって正直な選択はホステッドAPIです。そこでこそ価格差が真価を発揮します。ホステッドルートでも、$0.14 / $0.28という価格は、トラフィックのロングテールのデフォルトになるほど安価です。Gemini 3.7 Flashには、所有権を得る道は一切ありません。購入できるのは、プロモーション価格と1月の崖が付いた、信頼性の高い管理された高速なマルチモーダルサービスです。

従量請求書

同じ日に両方で実行すると、入力トークン2000万、出力トークン400万になる。DeepSeek V4 Flashの専用APIでは、$2.80 + $1.12で約$3.92。Gemini 3.7 Flashのプロモーション料金では、$15 + $15で約$30 — Googleが割引を実施している最中でも7.6倍の差だ。2027年1月1日以降、Gemini 3.7 Flashが$1.50 / $7.50に戻ると、同じ日の請求額は約$58となり、DeepSeekの15倍になる。速度面での優位性は、インタラクティブなワークロードではこの差を部分的に相殺する — トークンが速ければ同時リクエスト数も少なくて済む — しかし、バッチ処理やバックグラウンド処理では、オープンモデルが請求額で文句なしに勝つ。この2つのモデルはそもそも同じコスト曲線を目指していない。それがまさに要点だ。

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

誰がどれに基づいて構築すべきか

DeepSeek V4 Flashを選ぶのは、{{1}}トークンあたりのコストが制約条件となる場合{{/1}}、384Kまでの長い出力が必要な場合、セルフホスティングまたはエアギャップ展開のオプションが必要な場合、あるいはフラッグシップ価格のトークンでは利益率が維持できないものを構築している場合です。Gemini 3.7 Flashを選ぶのは、インタラクティブなループでの速度、マルチモーダル入力、Go​ogleのマネージドな信頼性、あるいはGo​ogleが報告するより強力なエージェンティックコーディング結果が必要な場合——そしてプロモーション価格が一時的なものであることを許容できる場合です。この二つは、二つのフラッグシップが競合するような意味での競合相手ではありません。同じ名前を冠した二つの異なる調達戦略です。ルーティング層こそ、両戦略が交わる場所です。DeepSeek V4 FlashはOrcaRouter上でDeep​Seekの定価のまま、マークアップ0%で稼働しており、フェイルオーバーパターンはこの組み合わせに自然に適合します。すなわち、トラフィックの大部分をV4 Flashで処理し、困難なサブセットをより強力なクローズドモデルにエスカレーションしながら、同じルーターのもう一方の経路ではGo​ogle自身のGemini API経由でGemini 3.7 Flashに到達できるというルールです。

正直な読み

セルフホストが可能であるか、純粋にコスト重視であれば、DeepSeek V4 Flash は構築に適した優れたモデルであり、そのライセンスのおかげで、この決定を再検討する必要は二度とありません。Google の配信速度、マルチモーダル入力、または報告されているエージェント型コーディングの優位性が必要であれば、プロモーションが続く間は Gemini 3.7 Flash の方が優れたサービスです——1月の価格倍増はすでに予定されています。2つのモデル、1つの名前——市場は、来年のトラフィックがどちらの哲学に投票するのかを見届けることになるでしょう。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新