Gemini 3.7 Flash と Grok 4.6 の比較のためのタイトルカード。Gemini 3.7 Flash 側には稲妻が描かれた50%オフの値札が、Grok 4.6 側にはチェックマーク付きの盾が向かい合って配置されている。
Guides & Insights

Gemini 3.7 Flash vs Grok 4.6:Googleの価格戦争 vs SpaceXAIの自己チェックエージェント

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Gemini 3.6 Flash がほぼ失敗に終わってから3週間後、Go​ogle は価格を半額にして出荷したのはGemini 3.7 Flashであり、これは大多数の報道が直接の対抗策とみなした動きで、その標的はGrok 4.6、すなわち前日にSpaceXAIが$2と$6で出荷したエージェント特化型フラッグシップモデル。タイミングこそが物語だ。フロンティアに近い2つのモデルが1日違いで登場し、どちらも同じ買い手——フロンティア価格を払わずにエージェント型コーディングを求めるチーム——を狙い、正反対の価格哲学に基づいて価格設定されている。Go​ogle は5か月間のプロモーションで反応を買っている。SpaceXAI はタスクごとの信頼を、定額のリスト価格で売っている。

2026年8月12日にリリースされたGrok 4.6は、SpaceXAIによる1.5兆パラメータのGrok 4.5基盤モデルの改良版であり、自身のサブタスク完了を検証する長時間稼働エージェント向けに構築されています。500Kのコンテキストウィンドウ、テキストと画像の入力、そして200K以上の入力トークンで2倍になる$2/$6の料金体系を備えています。2026年8月13日にリリースされたGemini 3.7 Flashは、GoogleによるGemini 3.6 Flashのアルゴリズム改良版です。1Mのコンテキスト、ビデオとオーディオを含むマルチモーダル入力、そして2027年1月1日に$1.50/$7.50に倍増するプロモーション価格$0.75/$3.75を備えています。独立系のArtificial Analysis Intelligence Indexでは、Grok 4.6は61で、Gemini 3.7 Flashの初期スコア約56を明確に上回っています。

価格競争、次元ごとに1行

入力1Mあたりの価格 — Gemini 3.7 Flash は $0.75(導入価格)、Grok 4.6 は $2.00。Google は60%以上安い。

出力100万トークンあたりの価格 — Gemini 3.7 Flash は $3.75(導入価格)に対し、Grok 4.6 は $6.00。

2027年1月1日以降Geminiは$1.50/$7.50に倍増、Grokは$2/$6のまま変わらず。

コンテキストウィンドウ — Gemini 3.7 Flash 1M vs Grok 4.6 500K.

長い入力の課金 — Geminiはコンテキストウィンドウ全体で均一料金ですが、Grokは200K以上の入力で$4/$12に倍増します。

思考トークン — Geminiはそれらを出力として請求します。Grokのコストは、独立に測定されたタスクあたり約0.84ドルに含まれています。

要するに、今日の価格表の全項目でGemini 3.7 Flashの方が安いが、その優位性の大半は1月1日に消える。Grok 4.6は8月でも3月と同じ価格だ。

A comparison scoreboard for Gemini 3.7 Flash and Grok 4.6: Gemini at AA Index ~56, $0.75/$3.75 intro pricing, 1M context, Google-reported GDPVal-AA v2 of 1,525 and per-task cost not yet measured, versus Grok 4.6 at AA Index 61, $2/$6, 500K context, GDPVal-AA v2 of 1,753 and about $0.84 per task per Artificial Analysis, both proprietary.

Gemini 3.7 Flashのお金の行方

Go​ogle自身の数字は、Gemini 3.7 Flashが3.6 Flashから大きく伸びたと報告している:DeepSWE v1.1で65.3%(49.0%から増加)、FrontierCode 1.1 Mainで43.6%(34.4%から増加)、Terminal-bench 2.1で85.8%(78.0%から増加)、WebDev Arena Eloは1588(1538から増加)。これらはベンダー報告による未検証の数字であり、軌跡を測るものであって、ベンダー間の評価を下すものではない。しかし、その軌跡こそが重要だ。修正は、レビュアーがおおむね見放したローンチの3週間後に投入された。これは、Go​ogleがFlash層を旗艦ではなく戦場と見なしていることを示している。

Go​ogleのプロモーションがもう一つ行っているのは、購入ウィンドウを圧縮することです。$0.75/$3.75の価格では、そのモデルは大量にテストするのに十分安価であり、$1.50/$7.50でも依然として競争力はあるものの、もはや価格競争の武器ではありません。導入期間中にこれを採用するプロダクションチームは、その数字が自分たちに引き継がれるとは想定せず、12月にその経済性を再評価すべきです。

Grok 4.6の資金の行方

Grok 4.6の売り文句は異なる。より安いトークンではなく、無駄になるトークンが少ないことだ。このモデルは自己検証を行うよう訓練されている。つまり、次の作業に移る前にサブタスクが実際に完了しているかを確認するのだ。そして独立した測定がその効果を裏付けている。Artificial Analysisは、そのコストをタスクあたり約0.84ドル、GDPVal-AA v2を1,753、Intelligence Indexを61としている。これらは第三者による数値であり、この比較において最も有力な数字である。なぜなら、トークン単価では捉えられないものを示しているからだ。つまり、仕事を完了するまでのターン数が少ないモデルは、トークン単価が高くても、完了した仕事あたりではより安価なのである。

トレードオフは、まさに低価格モデルに余地がある部分です。Grok 4.6の500Kコンテキストは、Gemini 3.7 Flashの1Mの半分であり、その$2/$6という料金は200K入力を超えると2倍になります。つまり、ロングコンテキストで高入力のワークロードこそ、Grok 4.6のリスト価格がプロモーション中のGemini料金に対して競争力を失うポイントなのです。

タスクごとの経済

導入価格では、Gemini 3.7 Flashのブレンドレート(入力/出力比率80/20)は、100万トークンあたり約1.35ドルです。同じ比率でのGrok 4.6の表示価格は、長い入力に対するペナルティ適用前で100万トークンあたり2.80ドルです。書面上では、Go​ogleのモデルが圧倒的なボリューム勝者のように見えます。問題は、Geminiの推論トークンが出力として請求されること、ベンチマークの主張が1週間前のものであること、そしてタスクごとの効率がまだ独立に測定されていないことです。一方、Grok 4.6はそうした測定が済んでいます。安いトークンと無駄なターンの組み合わせは、完了する高額なトークンよりもコストがかかる可能性があります。そしてこの対決では、一方はその問いに対するデータを持っているが、他方は持っていないのです。

新しいモデルには賭けるが、パイプラインには賭けない

Grok 4.6は、OrcaRouter上でSpaceXAIの$2/$6定価、0%マークアップで提供されており、200K超の2倍ステップも含まれます。モデルページはこれをルーティングレイヤーからライブで取得します。Gemini 3.7 Flashはリリースから1日で、Go​ogle自身のAPI上にあります。その前身のGemini 3.6 Flashは、OrcaRouter上でGo​ogleの定価で提供されています。

The OrcaRouter model page for grok/grok-4.6, showing the New and Featured badges, the $2.00 per million input and $6.00 per million output pricing, a 500K-token context window, and the released August 12, 2026 label.The OrcaRouter model page for google/gemini-3.6-flash, showing the $1.50 per million input and $7.50 per million output pricing and the 1M-token context window.

この比較が本当に問うているのが「新しい安価なモデルにエージェントパイプラインを賭けるべきか」ということであれば、ルーティングレイヤーこそがそのヘッジとなる。今日はGrok 4.6でエージェントを実行し、Gemini 3.7 Flashが登場したその日に切り替えるフェイルオーバールール、あるいは両方に回答させ、ジャッジがそれらを調整するフュージョンパネル——これこそがルーティングDSLが存在する理由のセットアップであり、証拠が揃う前に片方を選ぶことを必要としないものだ。

正直な読み

もし今日最も安いトークンを求めて、3週間での納品を信頼できるなら、Gemini 3.7 Flash は攻めの賭けだ — 価格競争は現実であり、ベンチマークの改善は報告されており、導入期間は本当の割引である。エージェント効率が独立に測定され、1月に価格が変わらず、長時間の作業向けに設計された自己検証ループを持つモデルを求めるなら、Grok 4.6 は保守的な選択であり、AAデータは完了タスクあたりのコストで優位性を与える。一方はカウントダウン付きのセールであり、もう一方は実績のある価格だ。どちらも正当化できる — それこそが、これを形式的なものではなく、本当の比較にしている理由だ。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube