記事「Gemini 4 Carbon — LEAK REPORT」のヒーロータイトルカード。「UNVERIFIED」バッジ付きで、サブタイトルは「一般には呼び出せない Google の内部チェックポイント — レポートが述べていること」、3つのチップは「出典: Business Insider(TestingCatalog 経由)」「2026年10月9〜10日」「Jetski(Google の内部プラットフォーム)でテスト済み」、左のカードは「主張: 初期の内部フィードバックでは、Carbon はコーディングにおいて Claude Opus 5.5 に匹敵する」、右のカードは「背景: Barium-B は公開版 Gemini 4 Argon のリリース向けに選ばれたチェックポイント」。OrcaRouter のロゴが右下隅に合成されている。
Guides & Insights

Gemini 4 Carbonリーク:スタッフが「Claude Opus 5.5のようにコーディングする」と語るGoogleの内部チェックポイント

著者

Elias Hawthorne

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

この話にはニュースになる版とノイズになる版があり、その違いは完全に、名前が何に結びついているかにある。2026年10月9日と10日、Business Insiderが報じ、リーク追跡メディアのTestingCatalogが伝えたところによれば、検索大手の従業員が、追加のGemini 4チェックポイントであるCarbonを社内でテストしており、初期の社内フィードバックではCarbonはコーディングに関してClaude Opus 5.5と同程度に感じられるとされ、Barium-Bが公開版Gemini 4 Argon向けに選ばれたチェックポイントであり、Carbonは同社の社内Jetskiプラットフォームを通じてテストされた、別個の、そしておそらくより強力なイテレーションであるという。これを流し読みではなく読む価値があるのは、最後の節があるからだ。すなわち、CarbonがGemini 4 Argonのアップデートとして出荷されるのか、それとも単独のリリースとして出荷されるのかは、報告書自身の言葉を借りれば、未確認である。そしてこれが証拠の全体像だ——発表も、モデル識別子も、エンドポイントも、価格も、モデルカードも、ベンダーからのコメントもない。このページ上の具体的なものはすべて、リークか、リークから導かれた推測か、そうでなければ、そのリークが比較対象としている別の出荷可能なモデルに関する事実である。

報告書が実際に主張している内容

シグナルは薄い。だが反証可能なほど具体的であり、まさにそれが、これがこの種のページに載る唯一の理由だ。飾りを剥ぎ取れば、主張はこうだ。

• Googleの従業員は、Carbonという名称のGemini 4チェックポイントを社内でテストしている。これは公開モデルではなく、いかなるAPIからも呼び出すことはできない。

• 初期の社内フィードバックによれば、Carbon はコーディングに関して Claude Opus 5.5 と同等に感じられると位置づけられている——これはスタッフによるテストから得られた印象であり、ベンチマークの結果ではなく、Google の外部の誰かが再現できる数値でもない。

• 世間が実際に名前を耳にしているモデル — Gemini 4 Argon — の背後にあるチェックポイントは Barium-B と呼ばれており、Carbon は同じビルドに2つのラベルが付いたものではなく、別個の、そして潜在的に、より高性能なイテレーションとして説明されている。

• 伝えられるところによると、CarbonはJetskiを通じて実施されているとのことだ。同じ報道は、JetskiをGoogleのエージェント型コーディング環境であるAntigravityに関連する社内名称だと説明している。

• Carbonが将来のGemini 4 Argonアップデートとなるのか、それとも独立したGemini 4リリースとなるのかは不明だ。Googleはこれについて一切コメントしていない。

それがリークです。それには1つの比較、1つのコードネームの関係、そして真に未解決の問いが1つ含まれており、そのどの部分もリリースではありません。

A two-column infographic titled 'Gemini 4 Carbon — what the report says / what it does not'. Left column 'What the report says': '9–10 Oct 2026 — Business Insider, relayed by TestingCatalog', 'Google staff testing a Gemini 4 checkpoint named Carbon', 'Early internal feedback: feels comparable to Claude Opus 5.5 for coding', 'Barium-B is the checkpoint chosen for the public Gemini 4 Argon release', 'Tested via Jetski, tied to Antigravity'. Right column 'What it does not say': 'Whether Carbon ships as an Argon update or a separate Gemini 4 release', 'No model ID, endpoint or price of any kind', 'No model card, context window or parameter count', 'No benchmark number behind the Opus 5.5 comparison', 'No date, and no comment from Google'. Footer: 'All leak claims unverified; Google has not commented.'

コードネームのはしご、そしてどの段が重要なのか

このレポートにデコーダーリングが必要なのは、Googleの周期表的な癖が、一つの段落に、並列に見えて実際はそうではない3つの名前を押し込んでいるからだ。読者がそれぞれについて実際にできること順に並べると:

• Gemini 4 Argon — 発表済み。実在するモデル名で、ファーストパーティの発表投稿とファミリーページがあり、導入価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルと公開され、出力上限は100万トークンと公開されており、審査済みのサイバー防御担当者から始まり次に有料API顧客へ拡大すると説明された制限付きロールアウトがある。それでも、リクエストに指定できるモデル識別子はまだなく、これが発表済みモデルと呼び出し可能なモデルを分ける境界線だ。

• Barium-B — これはチェックポイント名であり、製品名ではない。同じ報告によれば、公開版 Argon リリースのために選ばれたビルドがこれにあたる。このラベルの有用な点はまさにそこにある。つまり、Argon という名称は、ビルドそのものではなく、社内ビルドを包み込んだ出荷判断を指しているのだと分かる。

• Carbon — スタッフの感想が添えられた社内チェックポイントに過ぎず、それ以外は何もない。IDも価格も発売時期も日付もなし。コードネーム付きの噂にすぎず、コードネームなどいくらでもある。

そう読むと、この話は「新しいGeminiがリークした」ということではない。Googleが複数のフロンティア・チェックポイントを並行して動かしているように見えること、Googleが公の名を与えたものは、エンジニアが最も熱意を注いでいるものではないこと、そして社外の誰も、その二つの事実のどちらがやがて重要になるのかを知らない、ということだ。

なぜ「Claude Opus 5.5のように感じる」が要となる一文なのか

報告書の中のあらゆるものの中で、その比較は最も多くの役割を果たしており、最も検証しにくい。したがって、それが何と比較されているのかについて正確である価値がある。Claude Opus 5.5はAnthropicのフラッグシップであり、独立した測定によれば、現世代で最も強力な広く呼び出し可能なコーディングモデルである——ベンチマークの名前を出さずに「これが良いやつだ」と言いたいときにGoogleのエンジニアが手に取る基準点である。公表されている定価では、入力トークン100万個あたり4.00ドル、出力トークン100万個あたり20.00ドルで、キャッシュ読み取りは100万個あたり0.20ドルであり、100万トークンの入力ウィンドウと最大128Kトークンの出力を備えている。

それと比べてみると、この比較は同時に二つのことを語っており、二つ目こそが人々が飛ばしてしまうものだ。一つ目は競争力に関するものだ。Googleの社内チェックポイントが、主要競合のフラッグシップと同列に語られている。これはGoogleがブログ記事には書かないような賛辞だ。二つ目は位置づけに関するものだ。この比較はコーディングの感触についてのスタッフの印象であり、まさにチャットウィンドウと接触しても生き残り、リーダーボードと接触すると死ぬ種類の主張だ。Carbonについてのベンチマークは誰も公開していない。Artificial Analysisのエントリもなく、ベンダーのベンチマーク表もなく、評価手法のPDFもない。それらはGemini 4 Argonには存在し、これには存在しない。感触はスコアではないし、このページは片方を他方に見せかけるつもりはない。

また、答えを知っているふりをせずに言及しておく価値のある価格設定上の帰結もある。もし「コーディングではClaude Opus 5.5のように感じられる」チェックポイントがGoogleの内部に存在し、Googleが実際に発表したモデルが独立系の指標でそれより5ポイント下に位置するなら、興味深い問いはCarbonが優れているかどうかではない——Googleがそれをいくらで値付けするのか、そしてGeminiシリーズの他のモデルがこれまで提供されてきたような主力モデル並みの価格で、それが販売されることがあるのかどうかだ。

何が欠けていて、なぜそのリストはニュースよりも長いのですか

存在しないものについての正直な目録がこの記事のすべてだ。では、それがこれだ:

• モデル識別子 — Carbon にはなく、Gemini 4 Argon にもない。どちらの名前も、リクエストの宛先として指定できる場所にはどこにも現れない。

• 価格 — Carbon についてはどのティアでも何も公表されていない。導入価格すらも。

• モデルカードやシステムカード — なし、そしてその背後にある公表された評価手法もなし。

• コンテキストウィンドウ、出力上限、パラメータ数——いずれも公開されておらず、GoogleはどのGeminiについてもパラメータ数を公開していない。

• ベンチマーク結果 — Opus 5.5 の比較はスタッフの印象であり、つまり数値もテストも再現性もない。

• 日付 — 発表もなく、段階的な展開もなく、時期の目安もなく、Carbonのリリースが計画されているかどうかについてのGoogleからのコメントも一切ない。

• 関係性 — Carbon が次の Argon アップデートなのか、それとも別個の Gemini 4 モデルなのか。これは報告書における単一最大の重大な未知事項であり、報告書自体で明示的に未確認とされている。

そのリストに載っていないものはすべて推測であり、今後2週間でこれについて書かれることのほとんども含まれる。

開発者が今日これでできること

有益な答えは、ほとんど何も変わらないということです。そして、その理由を正確に述べておく価値があります。Gemini 4 Argon も Carbon も OrcaRouter 上にはありません。どちらについても私たち自身のカタログを検索しても何も返りませんし、Google がどちらかを呼び出し可能にするまで、何も返らないままでしょう。Gemini 4 という名前は、ルーティングできる対象ではありません。それは制限付きのロールアウトに付けられた名前です。今「Gemini 4 Carbon」へのアクセスを提供しているアカウントは、ラベルを売っているだけです。

本物なのは、そのリークが比較対象として測られているモデルのほうだ。 Claude Opus 5.5は、Anthropicの定価でOrcaRouter上で稼働中 — 100万トークンあたり入力$4.00、出力$20.00、キャッシュ読み取りは100万あたり$0.20で、マークアップゼロでパススルー — つまり、Carbonが比較可能だと説明されているその具体的なモデルは、他のすべてと同じAPIキーで今日呼び出せるものだ。これはリークよりも有用な事実だ。なぜなら、それは比較のうち検証可能な半分だからだ。

噂に耐えうる姿勢とは、その噂が真実である必要のない姿勢だ。最も過酷なコーディングワークロードにはClaude Opus 5.5を配置し、それを必要としないトラフィック向けには、より安価なティアへのフェイルオーバールールを用意しておこう。プロバイダーのカタログに本物のGemini 4識別子が現れたその日には、Googleが価格を設定した同じ日に当社のリスト価格も更新される。ベンダーが価格を公表してから当社がそれをそのまま通すまでの間に、再交渉のステップは存在しないからだ。 200以上のモデルに対応する単一のAPIがあれば、「移行すべきか?」という問いは、リライトではなく、ルーティングDSLの編集とライブトラフィックでのA/Bテストに変わる。見聞きした名前ではなく、測定できる成果に基づいてルーティングしよう。

A screenshot of Google's own Gemini API models documentation page, listing the Gemini 3.8 family and earlier models with their model codes and pricing, and containing no entry for Gemini 4 Argon or Gemini 4 Carbon.A screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, showing the model id, its capability chips, a 1M-token context window, a 128K maximum output, and pricing of .00 per 1M input tokens and 0.00 per 1M output tokens with cache reads at /bin/bash.20 per 1M.

私たちが見ているもの

• Googleが何か一言でも言うかどうか。コメント、ファミリーページの変更、ローンチ投稿の一行でもあれば、これらすべては一挙にリーク欄から外れる。沈黙はそれを今ある場所にとどめる。

• Argonロールアウトの第2段階。発表では、精査済みのディフェンダーに続く次のコホートとして有料API顧客とUltraサブスクライバーが挙げられており、Gemini 4識別子の登場こそが「発表済み」を「呼び出し可能」へと変える出来事である。実行可能なエンドポイントが登場すれば、そのチェックポイントがBarium-Bなのか、それともより新しいものなのかという問いが具体的になる。

• Carbonの独立した測定なら何でも。このようなチェックポイントが、スタッフの印象ではなく中立的なリーダーボード上に現れた瞬間、Opus 5.5という一文はもはや雰囲気ではなくなり、データ点になり始める——あるいは真実ではなくなる。

• 価格表。Googleが、自社のエンジニアが好むフロンティア・チェックポイントにいくらの値付けをするかが、CarbonがArgonのアップデートなのか、それとも独自の階層なのかを見分ける手がかりとなる。

• コードネーム同士の関係が、ローンチという現実に触れても生き残るかどうか。Argon の後ろに Barium-B、その横に Carbon というのは、今日では筋の通った話だ。しかしローンチの投稿は、筋の通った話を 1 つのモデル、1 つの ID に畳み込んでしまう癖がある。

これを誇張しない要約は短い。Googleの社員は現在、Carbonと呼ばれる社内のGemini 4チェックポイントをテストしていると報じられており、彼らの初期の印象では、それはClaude Opus 5.5のようにコードを書く。公開されているGemini 4 Argonリリースの背後にあるチェックポイントは、Barium-Bと呼ばれる別のものであり、Carbonが製品になるのか——アップデートなのか、別個のモデルなのか、それとも何にもならないのか——は未確認だ。その文のうち、あなたが行動に移せる半分は、Claude Opus 5.5を名指ししている半分である。なぜなら、それはこの段落でモデル識別子、価格、エンドポイントを備えた唯一のモデルだからだ。呼べるものは呼び続け、もう一方の名前が呼べるものになる日に備えて、フェイルオーバー規則を用意しておけ。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新