生成されたヒーローカード。タイトルは「Gemini 3.8 Live」、太字の「UNVERIFIED」バッジ付き。サブタイトルは「Google Cloud のクォータページに載った未リリースの音声スラッグ2件 ― 現時点でわかっていること」。チップは「出典: X/@testingcatalog」「2026年9月15日」「非公開 ― モデルカードなし」。3枚のカードは「報告されたスラッグ: Gemini 3.8 Live」「報告されたスラッグ: Live Extended Thinking」「本日のライブ系統: gemini-3.1-flash-live-preview、2026年3月」。フッターは「どちらのスラッグも未検証 ― Google はいずれも認めていない」。
Guides & Insights

Gemini 3.8 ライブリーク:2つの新しいボイススラッグ、そして「Live Extended Thinking」がより重要である理由

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

今週、GCPのクォータページに、公開ドキュメントには一切載っていない2つの文字列が現れた:Gemini 3.8 Live、そしてLive Extended Thinkingと呼ばれるものだ。これらはリリース追跡アカウントの@testingcatalogが発見し、9月15日に投稿されたもので、どちらも公開情報ではないという率直な但し書きが付されていた。これが今のところ公開されている記録のすべてである——モデルカードも、価格の記載も、APIの変更履歴の項目も、公式な言及もない。しかし、この2つの名前は非常に読みやすい一本の線の終わりに位置している。Gemini 3.1 Flash Liveは今なお、同社自身のドキュメントがLive APIの作業に推奨するモデルであり、Gemini 3.5 LiveとGemini 3.5 Live Experimentalは8月26日にGemini Audioファミリーとして登場し、同じファミリーのテキスト側であるGemini 3.8 Flashは9月2日から提供されている。「3.8 Live」はそのギャップを埋めることになるだろう。2つ目のスラッグのほうが、より興味深い。

まずラベルから。というのも、リーク記事はラベル次第で生きも死にもするからだ。これはローンチではない。どちらのスラッグも、Google による発表、文書化、価格設定、確認はされていない。情報源はリリースを追跡している単一のアカウントだ。以下にある、Gemini 3.8 Live と Live Extended Thinking に特に言及した内容はすべて未検証だ。すでに出荷済みのモデル——Gemini 3.1 Flash Live、Gemini 3.5 Live、Gemini 3.8 Flash——についての以下の内容はすべて文書化されており検証可能で、どれがどれかは全体を通して明示している。

シグナルが語ること、そして語らないこと

• 報告あり — 「Gemini 3.8 Live」と「Live Extended Thinking」という2つのスラッグがGoogle Cloudのクォータページに表示。9月15日に投稿され、「非公開」であるとの注記付き

• 未報告 — 発表、モデルカード、価格、コンテキストウィンドウ、リリース日、API ID、あらゆるベンチマーク値、またはGoogleからのいかなる確認も

• 裏付け — 本稿執筆時点ではなし。Google の Gemini API モデルページ(最終更新 9月4日)には、会話型 Live モデルがちょうど2つ記載されています。gemini-3.1-flash-live-previewgemini-3.5-live-translate-previewであり、どちらにも「Live Extended Thinking」バリアントはありません

• 同じブリーフ内の別の主張 — 同じ9月15日の投稿はまた、Grok 4.7が「Opus 5.0の近くに着地するはずで、5.1ではない」と予測し、そのマルチモーダル作業は「まだ改善が必要」だとしていた。これは別ベンダーのモデルであり、成果物ではなく予測である。ここでは情報源の完全性のためだけに記載している。

• 名称そのものが暗示する内容 — Google Cloud のクォータ項目はモデルごとの SKU であり、これはコンシューマー向け Gemini アプリ内の機能というよりも、課金対象の API モデルであることを示している。それは、この文字列が表示されていた画面上の情報に基づく推測であり、確認された事実ではない。

A generated six-row scoreboard titled 'Gemini 3.8 Live - the scoreboard', rows reading 'Status: leak - quota page only, not public', 'Reported slugs: Gemini 3.8 Live + Live Extended Thinking', 'Live line today: gemini-3.1-flash-live-preview, March 2026', 'Thinking control: thinkingLevel minimal/low/medium/high', 'Text sibling: Gemini 3.8 Flash, shipped Sept 2', 'Independent score: none - nothing to test', with the footer 'Gemini 3.8 Live and Live Extended Thinking unverified; Live-line details per Google's Gemini API docs.'

クォータページがモデルの最初のリーク地点になるのはなぜか

これは理解しておく価値のある部分だ。なぜ2語の成果物が記事1本に値するのかを説明してくれるからである。クォータページはマーケティング用の場ではない。それらは課金とレート制限のインフラストラクチャだ。Cloudの顧客が呼び出せるすべてのモデルは、最初の有償リクエストが処理される前にプロジェクト単位のクォータエントリを必要とし、それらのエントリをプロビジョニングするのは、モデルを一般提供に向けて準備するのと同じエンジニアリング作業だ。そこにスラッグが現れるということは、誰かがSKU向けの配管を構築したということであり、誰かがプレスリリースを起草したということではない。

それは諸刃の剣であり、正直に読むなら慎重な解釈になる。クォータのエントリは、研究論文の中のコードネームより先の段階にある。顧客向けに公開する意図を示唆しているからだ。そしてそれはまさに、ローンチ前に作られ、テストされ、静かに名前を変えられる類のものでもある。このファミリーのテキスト側は、それを具体的に示すほど速く動いてきた。Gemini 3.6 Flash は7月21日に登場し、Gemini 3.7 Flash は8月13日、Gemini 3.8 Flash は9月2日——6週間で3回の Flash リリースだ。これほど速く反復するモデルラインは、その名前で出荷する以上に多くのSKUを仕込んでいるラインだ。

Liveラインは1バージョン遅れで稼働しています

「Gemini 3.8 Live」を単なる命名の物珍しさではなく、本当に語るべき話にしているのは次の点だ。Googleの音声モデルは、同社のテキストモデルにまったく追随してこなかった。

• 現在推奨されるLive APIモデル — gemini-3.1-flash-live-preview、最新アップデートは2026年3月、Google自身のドキュメントでは今もなお、すべてのLive APIユースケースに使用すべきモデルとして記載されています

• その制限 — 入力トークン131,072個、出力トークン65,536個で、テキスト、画像、音声、動画を受け取り、テキストと音声を出力

• 8月26日に発表されたGemini Audioファミリー — Gemini 3.5 Live、Gemini 3.5 Live Experimental、およびGemini 3.5 Transcribe。Transcribeモデルは音声テキスト変換用のChirp 3を置き換えます

• 一方、テキスト系の — Gemini 3.5 Flash、Gemini 3.6 Flash、Gemini 3.7 Flash、Gemini 3.8 Flash — は、ほぼ同じ期間に4つの公開バージョンを経た

A screenshot of Google's Gemini API documentation page for gemini-3.1-flash-live-preview, captured September 15, 2026, showing the banner 'Gemini 3.8 Flash is now available', the heading 'Gemini 3.1 Flash Live preview' described as a low-latency audio-to-audio model, model code gemini-3.1-flash-live-preview, supported data types text/images/audio/video in and text and audio out, an input token limit of 131,072 and an output token limit of 65,536, and capability chips including Live API Supported and Thinking Supported.

つまり、音声系は3.5世代にある一方、テキスト系は3.8にある。「Gemini 3.8 Live」というスラッグは、Googleが音声をテキストと同じ世代に戻そうとしていることを示す最初の証拠だ。これは、音声エージェントを構築する人にとって、ライブセッションの基盤となる推論が、一度に1つではなく3つのテキストモデル世代分もジャンプする可能性があることを意味する。

なぜ「Live Extended Thinking」のほうがより興味深いスラッグなのか

今日、Gemini Live モデルにおける thinking はモデルではなく、ダイヤルです。Live API はthinkingLevel パラメータを公開しており、minimal、low、medium、high の 4 つの設定があり、デフォルトはminimalで、最低レイテンシーに最適化するために明示的に選ばれています。このデフォルトは、この製品が何のためのものかを物語っています。つまり、間(ポーズ)がバグとみなされる会話です。

「Live Extended Thinking」という別個のスラッグは、Google がそれを単一のダイヤルではなく2つの製品に分割しようとしていることを示唆しており、その理屈は単純だ。音声モデルではレイテンシと熟考が真っ向から衝突する——即座に答えながら、答える前に深く考えることはできない——そのため、トグル付きの単一モデルでは、すべての呼び出し側がリクエストごとにこの線上の1点を選ばざるを得ない。2つの SKU があれば、顧客は高速パス(割り込み処理、バージイン、クイック検索)と低速パス(マルチステップのタスクを進める音声エージェント)を、それぞれ別にチューニングされたエンドポイントへ振り分けられ、一方が他方を劣化させることもない。

その前例は、すでにGoogle自身の8月のローンチの中に存在する。Gemini 3.5 Live Experimentalは、「話しながら直接推論する」ことができ、タスクの最中にその進捗を一歩ずつ語ることのできるバリアントとして説明されていた——明示的に思考を帯びた音声モデルであり、設定としてではなく独自のIDとして提供されたものだ。「Live Extended Thinking」は、その本能が実験的ラベルから名を冠した製品へと昇格したように読める。それは文字列からの推測であり、推測にすぎない——だが、それはこの特定のラインが以前にも報いてきた種類の推測なのだ。

今日実際に電話できる相手

ここで述べていることは、今あなたが実際に利用できるものを何も変えない。そして、この点については率直に言っておく価値がある。呼び出せる Gemini 3.8 Live エンドポイントは存在せず、オンにできる Live Extended Thinking 設定もなく、そのどちらへのアクセスも購入する方法はない。今日「Gemini 3.8 Live access」を販売しているアカウントは、モデルではなくラベルを売っている。あなたが本当に使える Live モデルは gemini-3.1-flash-live-preview と gemini-3.5-live-translate-preview で、どちらも Google 自身の API を通じたプレビュー版だ。

テキスト側はまた別の様相で、実際にルーティング可能なのはこちらの部分です。Gemini 3.8 Flash — 9月2日にリリースされ、Google自身のリスト価格で100万入力トークンあたり0.75ドル、100万出力トークンあたり3.75ドル、2027年1月1日には1.50ドルと7.50ドルへ倍増予定 — はOrcaRouter上で同じリスト価格で動作し、上乗せマークアップは0%です。事前に値上げが発表されたモデルでは、パススルー価格は通常以上に重要です。1月の価格が有効になれば、ここでも同日に切り替わり、再交渉が必要な別契約も、変更が必要なコードもありません。

The OrcaRouter model page for google/gemini-3.8-flash, showing the Google vendor name and the 2026-09-02 date, a 1M-token context window, 65K max output, text, image, video, file and audio input with text output, a p50 time-to-first-token of 3.46s, and pricing of $0.75 per 1M input tokens and $3.75 per 1M output tokens.

音声ラインは今日OrcaRouterにはありません — どのベンダーからも、LiveまたはネイティブオーディオSKUは存在しません — したがって、ここにあるものは当社がホスティングしていると解釈されるべきではありません。ルーティングレイヤーが本当に役立つのは、この話のもう半分です。3.8世代のLiveモデルが登場し、その横に思考寄りの第二のバリアントが登場するとき、高速な音声パスと熟考するパスのどちらを選ぶかは、リライトではなくルーティングの判断になります:1つのキーの背後にある2つのエンドポイント、そしてあなたが構築したプレビューIDが廃止された場合の自動フェイルオーバー。今年すでに一度名前を変えたラインでは、それは仮定の話ではありません。

何がこれを裏付けるのか — そして、何がこれを打ち消すのか

リーク記事は、それがどのように間違っている可能性があるかを示すべきだ。Gemini 3.8 Live と Live Extended Thinking については、裏付けとなる証拠は具体的で検証可能だ:

• クォータエントリが公開されること — 同じスラッグが、スクリーンショットの中だけではなく、レート制限付きで Google Cloud や Vertex AI のモデル一覧に現れること

• Gemini API の変更履歴のエントリ、またはモデルページの行。現時点では gemini-3.1-flash-live-preview と gemini-3.5-live-translate-preview で止まっています

• DeepMindのモデルカード — 8月の音声モデルは、報道ではLiveとTranscribeと呼ばれていたにもかかわらず、そこで「Gemini 3.5 Audio」として記録されていた。そのため、このカードは名称を決着させる一次資料である。

• 価格設定行。これは、ステージングされたSKUを、誰かが購入できる商品に変える唯一の要素です。

• 反証——スラッグが改名されるか、既存モデルの思考設定に組み込まれるか、あるいは単に二度と現れないか。三つともクォータページにとってはよくある結果であり、そのどれであっても、この記事が正しかったというより早すぎたことを意味する

注視すべき点と、誰が行動すべきか

Live API 上で音声エージェントを構築しているなら、今週あなたのアーキテクチャを変更する必要は何もありません — 構築の基盤となるモデルは依然として gemini-3.1-flash-live-preview であり、正直なアドバイスとしては、モデル ID を設定値の背後に置き、2 つ目の Live エンドポイントをウォーム状態に保つことです。このラインはすでに一度名前を変更しており、また変更する可能性があるからです。テキストモデルを選んでいるなら、このリークはあなたには無関係です。Gemini 3.8 Flash は出荷され、価格設定も測定も可能になっており、より有用な問いは音声スラッグではなく 1 月の価格変更です。

実際に注目すべきなのは、ローンチではない。「Live Extended Thinking」が2つ目のモデルとして登場するのか、それとも最初のモデルにおける5番目の設定として登場するのか、ということだ。もしそれが別個のSKUなら、Googleは開発者に対して、考える音声エージェントと話す音声エージェントは別の製品だと告げていることになる — そしてそれは、名前にあるどのバージョン番号よりも重大な主張だ。

本当にルーティング層役立つのは、この話のもう半分の部分です。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新