「MODEL COMPARISON」と見出しの付いたタイトルカードには「Gemini 4 vs Gemini 4 Argon」と記され、サブタイトルは「一方は9月30日に発表された。もう一方はファミリープレフィックスだ。」、4つのチップには「Gemini 4 · モデルIDなし」「Gemini 4 Argon · 2026-09-30 発表」「$2 / $10 導入価格」「AA Index 53 · Vals #1」とあり、フッター行には「Googleの数値はベンダーによる報告であり未再現。インデックスの数値はArtificial Analysisによる。順位はValsによる。」と記されている。OrcaRouterのロゴが右下隅に合成されている。
Guides & Insights

Gemini 4 vs Gemini 4 Argon:この2つのモデルのうち、片方は存在しない

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

グーグルは2026年9月30日にフロンティアモデルを発表した。それはほとんどの人が思い描いているものではない。Gemini 4 Argonは、実際の発表、実際の料金表、公開されたベンチマークセットに紐づいた実在の名前だ。Gemini 4はその名前が属するファミリープレフィックスであり、今日入手できる記録上、それは製品ではない。モデルIDもなく、エンドポイントもなく、モデルカードもなく、100万トークンあたりの価格もない。つまりこれは2つのシステムの比較ではない。発表された1つのモデルと、多くの人々——このブログも含めて——が何か月もの間モデルとして扱ってきた名前との比較なのだ。

その区別には金銭的な意味がある。Gemini 4 Argonには、入力トークン100万あたり$2、出力トークン100万あたり$10の導入価格が設定されており、Googleが定義していない導入期間の後には$4と$20に上がる。これらはGoogle自身の発表投稿に示されたベンダー公表の数字だ。2026年のプロ層移行を予算化するなら、$2/$10が計画の基準にできる数字であり、「Gemini 4のコストがいくらであれ」は数字ではまったくない——まだ何も公表されていないし、公表できるものもまだ何もないからだ。

記録上、「Gemini 4」とは実際何なのか

Gemini 4の製品ページを検索すると、見つかる文書はただ1件、Gemini 4 Argon:フロンティア知能の次なる時代と題されたGoogle自身の投稿だ。2026年9月30日20:00 UTCに公開され、Koray Kavukcuogluの名義になっている。注意深く読んでみても、「Gemini 4」が単独のモデルとして現れることは一度もない。この投稿にある能力の主張も、価格も、ベンチマークも、すべて正式名称に紐づいている。素の形が現れるのは、名前が接頭辞として使われている箇所だけ——「Gemini 4 Argonの能力」——であり、これはGemini 3 Pro、Gemini 3.1 Pro、そして4つのFlashバリアントがそれぞれ独立した存在になる前にGemini 3が占めていたのと同じ文法上の位置にあたる。

世代ごとの歴史は、そのように読むことを裏付けている。Alphabetの7月23日の決算電話会議は、その枠組みを記録に残した。Sundar Pichaiは、次世代のフロンティアモデルは「はるかに大規模なベースモデルを必要とする」と述べ、改善が必要な領域としてコーディングとエージェント型コーディングを挙げた。9月23日、The Information主催のイベントで、Kavukcuogluは事前学習が完了し、モデルはポストトレーニングの初期段階にあると述べ、チームは結果を確認しており、年末よりかなり早い時期にポストトレーニングの初期バージョンを出荷したいと語った。Business Insiderは9月30日の発表を4シリーズの最初のモデルと表現した——シリーズであるという点が、その示唆するところだ。これら3つはいずれも、ベンダー自身の作業についてのベンダーの発言であり、第三者によって伝えられたものだ。

これが実際に意味するのはこうだ。「Gemini 4」は世代であり、その世代には名前を持つメンバーが1つある。Googleが2年間にわたって投入してきた階層構造——最上位のPro、その下のFlash、同じプログラムの下に置かれたCyberバリアント——は、第4世代向けにはまだ埋められていない。「Gemini 4 Pro」や「Gemini 4 Ultra」は、Google自身の命名パターンからの推測であって、リークでもロードマップ上の項目でもない。Gemini 4 Argonを「Gemini 4」と比較する記事は、1つのモデルをそのモデル自身の姓と比較しているものとして扱え。

Gemini 4 Argonとは実際には何なのか

Gemini 4 Argonは2026年9月30日、Googleのブログで発表され、同じ日の夕方にはDemis Hassabisが自身の言葉でXに同じモデルについて投稿した。展開は段階的に行われ、日付が示されているのは第1段階だけだ。Argonはまず、Fairwind Programを通じて審査を経たサイバー防衛の担い手たちに提供される。同プログラムは、Googleが政府や各国のサイバー当局、重要インフラ事業者、中核技術プラットフォーム向けに構築した、申請制の枠組みだ。Hassabis自身の投稿には、同社が「本日、政府と信頼できるサイバー防衛の担い手から始め、われわれのFairwind Programを通じて」展開していると記されていた。その後についてGoogleは、有料API顧客とGoogle AI Ultra購読者を次とし、続いて開発者、企業、一般消費者と位置づけている。これらの後続段階にはいずれも日付はない。

そのリストにないものこそ、作業を計画する誰にとっても重要な部分だ。一般提供日、モデルID、コンテキストウィンドウ、パラメータ数、モデルカード、システムカード。Googleが公表したのは出力上限であり、コンテキストウィンドウではない。それは100万トークンで、以前のGeminiファミリーが使っていた64Kの上限から引き上げられたものであり、Googleは業界をリードするものだとしている。1回の呼び出しで返せる量が桁違いに増えることは、長いエージェントの軌跡や単一ショットレンダリングにとって実際の変化であり、発表の中で曖昧さのない唯一の技術的数値である。

A capture of Google's own blog post announcing Gemini 4 Argon, carrying a Published Time of 2026-09-30T20:00:00+00:00 and the headline "Gemini 4 Argon: our next era of frontier intelligence" credited to Koray Kavukcuoglu, followed by the Fairwind Program rollout and the vendor-reported benchmark set: DeepSWE v1.1 77.9%, AutomationBench 51.3%, LVBench 91.7%, CWE-bench v1 68%, an output limit of 1 million tokens up from 64K, and pricing of $2 / $10 stepping to $4 / $20.

ベンチマーク群は広範で、まったく再現されていない。GoogleはDeepSWE v1.1で77.9%、AutomationBenchで51.3%の首位、LVBenchで91.7%、CWE-bench v1で68%の首位タイ、Vals Index、同社のVals Finance Agent v2、HarveyのLegal Agent Benchmarkで首位となる結果、Gray SwanのIndirect Prompt Injectionベンチマークで最も強い成績を報告している。これらの数値はいずれもベンダー自身のもので、ベンダーによって公表されており、独立して再現されたものは一つもない。9月に出回った別の一連の数値は、Gemini 4の予測ベンチマークとして提示され、AutomationBenchスコア48.7%とされていたが、無関係な製品発表からの使い回しであることが判明し、Googleの公表したものではない。Googleが実際に報告したAutomationBenchの数値は51.3%であり、これは別の情報源による別の数値である。

2つの名前が生み出すスコアボード

この組み合わせが実際に依拠する六つの次元で両者を並べてみれば、問題の輪郭は明らかだ:

• 名前付き製品として存在する — Gemini 4: いいえ。Gemini 4 Argon: はい、2026-09-30に発表。

• 本日呼び出し可能 — Gemini 4: モデルIDもエンドポイントも存在しません。Gemini 4 Argon: モデルIDもエンドポイントも同様に存在しません。アクセスはFairwindによる制限付きで、申請のみです。

• 価格 — Gemini 4: 公開なし。Gemini 4 Argon: 100万トークンあたり $2 / $10 の導入価格、その後 $4 / $20。ベンダー公表。

• 最大出力 — Gemini 4:公表なし。Gemini 4 Argon:100万トークン(前世代は64K)。ベンダー公称値。

• インテリジェンス指数 — Gemini 4:未評価。Gemini 4 Argon:高い推論エフォートでArtificial AnalysisのIntelligence Indexにおいて53、インデックスタスクあたりのコストは$1.99。Artificial Analysisによる。

• 独立系リーダーボード順位 — Gemini 4: ランク外。Gemini 4 Argon: Vals Indexで68.90%を記録して1位、テストあたりのコストは$15.68、入力トークン13.40B、出力トークン142.01Mにわたる。Valsによる。

A two-column scoreboard card headed "Gemini 4 vs Gemini 4 Argon — the scoreboard", with the subtitle "One announced model against a name with nothing behind it". The left column, headed Gemini 4, reads: exists as a named product, no; callable today, no model ID or endpoint; published price, none; maximum output, none published; intelligence index, not evaluated; independent rank, not ranked. The right column, headed Gemini 4 Argon, reads: exists as a named product, yes, announced 2026-09-30; callable today, no, Fairwind-gated; published price, $2 / $10, then $4 / $20; maximum output, 1M tokens, up from 64K; intelligence index, 53, $1.99 per task; independent rank, 1st, Vals 68.90%. A footer reads that the Argon price and output limit are per Google's own announcement, the index and per-task cost per Artificial Analysis, the rank and score per Vals, and that no figure on the left has a published source because Gemini 4 has no product page. The OrcaRouter logo is composited in the bottom-right corner.

最後の2行を合わせて読むと、この比較の中で唯一本当に興味深い不一致が見えてくる。Artificial AnalysisはGemini 4 Argonを53位に置き、これはClaude Fable 5.1およびGPT-6 Astraと同水準で、58のClaude Opus 5.5には5ポイント及ばない。Valsはそれを文句なしの首位に置く。どちらも独立しており、どちらも実在する何かを測定しているが、測定している対象は異なる——AAの指数はコーディング、推論、ナレッジワークにわたる固定された10の評価に重みづけし、Vals Indexは4つのセクターを米国の経済付加価値に占める割合で重みづけしている。モデルが一方で首位になり他方ではならないことは、どちらのランキングが間違っているわけでもない。

Vals の行にはもう一つ注目すべき点があり、それはエンタープライズ購入者が気にすべき点です。Vals は Argon の料金表を $4/$20(導入価格終了後の価格)として記録していますが、Google 自身の発表では $2/$10 とされています。テストあたり $15.68 のコストが $4/$20 で計算されていた場合、導入価格を受け入れられる購入者にとっては同じ作業でも実質的により低い数字になりますが、導入期間を逃した購入者にはそうなりません。Google はその期間がどれだけ続くのかを明言していません。そのただ一つの未定義変数が、ローンチ全体で最も意思決定に関わる数値を左右します。

今日電話できる相手

Gemini 4という名前のものは何もなく、それは私たちも含まれます。カタログを確認しました。google/gemini-4、google/gemini-4-argon、google/gemini-4-pro、google/gemini-3.8-flash-cyber はすべて「model not found」を返し、他のあらゆるルーティングプラットフォームでも同じです。なぜなら、どのプラットフォームにもルーティングするモデルIDが存在しないからです。Gemini API自体のモデル一覧 — Gemini 3.8 Flash、Gemini 3.8 Live、Gemini 3.1 Pro、Gemini 3 Flash — には、いかなる種類のGemini 4エントリもありません。ArgonがFairwindのキューを処理し終えて識別子を取得するまで、課金価格もエンドポイントもどこにも存在しません。

実際に稼働しているGoogleのproティアはまた別の話だ。Gemini 3.1 Pro Previewは2026年2月19日から当社のカタログに載っており、価格は入力$2.00、出力$12.00(100万トークンあたり)、コンテキストウィンドウは1,048,576トークン、最大出力は65,536トークンで、テキスト、画像、音声、動画、ファイルにまたがるマルチモーダル入力に対応している。それから8か月経った今も、Gemini API自身のモデル一覧ではPreviewと表示されたままで、それこそがArgonが存在する理由そのものだ。入力を200,000トークン超に押し上げると、料金は倍の$4と$18になる。

A capture of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the Google provider, a release date of 2026-02-19, a 1,048,576-token context window, a 65,536-token maximum output, pricing of $2.00 input and $12.00 output per million tokens with $4.00 and $18.00 over the 200,000-token threshold, multimodal input icons for text, image, video, audio and file, and capability chips for reasoning, tool calling, structured outputs, prompt caching, assistant prefill, computer use and web search.

この比較に運用上の答えがあるのは、まさにここです。Gemini 3.1 Pro Preview は、当社がルーティングする他の200超のモデルと同じ OpenAI 互換エンドポイントの背後で稼働しており、プロバイダー定価のままマークアップなしで提供されます。つまり、Google がやがて Gemini 4 Argon の識別子と課金レートを公表し、さらに命名パターンが続けばその Pro ティアの兄弟モデルも公表したとき、そのパススルーにより、それらのレートは Google 側に現れたその日に当社側にも現れます。当面の間、pro ティアについて読むのではなく実際に測定したいなら、それが測るべきモデルです。挙動がまだ特徴づけられている途中のモデルを試したいなら、自動フェイルオーバーをプロバイダー間で使うのが、Google 自身が段階的に導入されると表現するプレビューに本番経路を賭けずに試す方法です。

価格と同時に触れておくべき注意点が1つあります

ブルームバーグは9月30日、Argonに直接アクセスできる一部のGoogle従業員が、実作業ではベンチマークスコアが示唆するほど良好には機能しないと述べていると報じた。具体的にはフロントエンド設計が挙げられ、2人の従業員が「benchmaxxing」という言葉を使っている。Googleはこの描写に異議を唱えている。これをベンチマーク一覧の隣に置いて検討する価値があるのは、まさにその一覧がこのモデルに関する公的証拠のすべてだからだ。あるベンダーの数値だけがあり、それを再現する方法がないとき、その数値が全体像を語っていないという報告は脚注ではない。証拠の半分なのだ。

誰がどれを選ぶべきか

これら2つの名前のどちらかを選ぼうとしているなら、まだ実際には何も選んでいない。正直なアドバイスとしては、比較を基準にするのではなく、そのことを前提に計画を立てることだ。

• 今四半期に本番環境でGoogleのproティアモデルが必要なら、答えはGemini 3.1 Pro Previewです。これは呼び出し可能で、価格も設定されており、Argonが置き換えるべく位置づけられているティアです。Argonを待つことは、参加できない待ち行列で待つことになります。

• もしあなたが Argon が対象を限定している読者——政府のサイバー機関、重要インフラ事業者、ソフトウェアメンテナー——に当てはまるなら、Fairwind Program が唯一の経路であり、そのゲートの限定性はモデルの能力に関する事実であって、マーケティングではありません。Google はそれを脆弱性の発見と修正のために訓練し、一般には提供しませんでした。

• 2026年の移行を予算に組む場合は、導入期間には$2/$10を、それ以降のすべてには$4/$20を使ってください。単一の平均化した数値を使ってはいけませんし、Valsの$15.68というテスト単価も、それがどの料金表で計算されたものかを確認せずに使ってはいけません。

• 「Gemini 4」を待っているのなら、待つべきはモデルIDだ。その名前にもいずれIDが付く——3世代にわたるGoogleの命名パターンは、ProティアとFlashティアがそれぞれ固有の識別子を与えられることを示している——だが、パターンは発表ではないし、素のGemini 4が何なのか、いくらかかるのか、何をするのかについては何も公表されていない。

より広い論点は、このブログが以前にも指摘せざるを得なかったもので、おそらくまた指摘せざるを得なくなるだろう。世代名はモデルではない、ということだ。Gemini 4 Argon は、Google が名前、価格、ベンチマークセット、アクセス計画を伴わせて打ち出した唯一のものだ。ファミリーの残りはパターンであり、パターンとは予測はできても、名前で呼べるものではない。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新