
Gemini 3.1 Proとは?GoogleのProティアは7か月間動いていない
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Gemini 3.1 Pro は、同ファミリー内で唯一の現行 Pro ティアモデルです。2026年2月19日に発表され、それから7か月後も、ベンダー自身のモデルドキュメントは、エンドポイント gemini-3.1-pro-preview で依然として「プレビュー」に分類しています — 一般提供もなく、終了日もなく、後継モデルも出荷されていません。同じ7か月の間に、ベンダーは5つの Flash リリースを世に送り出し、その中で最新の Gemini 3.8 Flash は、多くの人が引用する独立系インデックスで、現在11ポイント高いスコアを記録しています。この差こそが、Gemini 3.1 Pro とは何かを説明するページが、それが何ではないかから始めなければならない理由です。
2文の要約だけが欲しいなら:Gemini 3.1 Proは、Google DeepMindが開発したクローズドウェイトのネイティブ・マルチモーダル推論モデルで、テキスト、画像、動画、音声、PDFを読み取り、テキストを出力する。呼び出すにはGoogle自身のAPIか、それを扱うルーターを経由する。入力は最大1,048,576トークンまで対応し、200,000トークン未満のプロンプトでは入力100万トークンあたり$2.00、出力100万トークンあたり$12.00のコストがかかる。長文コンテキストのマルチモーダルな働き手として堅実に機能する。もう、入手可能な中で最も賢いから選ぶモデルではない。
自らのファミリーの中でどこに位置するか
ここがほとんどの記事が飛ばしてしまう部分であり、しかも最も重要な部分だ。Gemini 3ファミリーは、頂点にProが座る一つの梯子ではない。もはや比較にならない二つの梯子なのだ。
動いたのは Flash のラインアップだ。2026年9月23日に読んだ Google のモデルドキュメントには、Gemini 3.8 Flash、Gemini 3.8 Live、Gemini 3.8 Live Extended Thinking が新たな安定版リリースとして記載されており、その下位では Gemini 3.7 Flash、Gemini 3.6 Flash、Gemini 3.5 Flash、Gemini 3.5 Flash-Lite が依然として安定版だ。Gemini 3.8 Flash は2026年9月2日に登場した — 6週間で3回目の Flash リリースとなる。
Pro の階層だけが、そうはならなかった。Google のドキュメントには Gemini 3.5 Pro、3.6 Pro、3.7 Pro、3.8 Pro は存在しない。Gemini 3.1 Pro が置き換えるために作られたモデルである Gemini 3 Pro は、停止済みとして記載されている。Gemini 2.5 Pro は存続しているが、アクセスは以前からのユーザーに限られている。その結果、今日呼び出せる唯一の Pro ティアの Gemini 3 エンドポイントとして残るのは Gemini 3.1 Pro だけだ——それは競争に勝ったからではなく、他に誰も出場しなかったからである。
Googleが2月に示した計画では、プレビューは「これらのアップデートを検証」し、野心的なエージェント型ワークフローなどの領域を前進させるのに十分な期間続き、その後モデルが「まもなく一般提供」されることになっていた。これらは2月の発表におけるGoogleの言葉だ。それから7か月が経っても、それは起きていない。そして遅延をめぐる報道は、事実ではなく報道として率直に記しておく価値がある。SemiAnalysisはGemini 3.5 Proの取り組みが静かに中止されたと結論づけ、Wall Street Journalは、二次メディアが引用したところによると、社内の3.5 Pro候補がFlashシリーズを超えられなかったため破棄されたと報じた。Google自身の説明は、3.5 Proが限定パートナー向けテストに残っており、確定した月はないというものだ。中止を肯定も否定もするGoogleの声明は見つけられず、我々がGoogleに代わってどちらかの側に立つつもりもない。
実際的な帰結は命名の罠だ。「最新のGemini Pro」を探しに行くと、見つかる最も新しいProティアのモデルは2月のもので、一方Flash側のバージョン番号は3.8まで上がっている。ここでのバージョン番号はティアをまたいで能力を順位づけるものではなく、両者は別々のリリース系統なのだ。
重要なスペック
以下の数値はすべて、別段の表示がない限り、2026年9月23日付のGoogle自身のGemini APIドキュメントから読み取ったものです。
• 入力コンテキスト — 1,048,576トークン。これはGoogleが2.5世代以降提供し続けている100万トークンのウィンドウと同じです。出力は別途65,536トークンに上限が設けられていますが、これは回答に対する上限であり、会話に対する上限ではありません。
• 入力モダリティ — テキスト、画像、動画、音声、PDF。出力モダリティ — テキストのみ。音声生成なし、画像生成なし、Live API なし。したがって、これはリアルタイム音声エージェントや画像パイプライン向けのモデルではない。Google はそれらの用途向けに別個の Gemini 3.x Flash バリアントを提供している。
• 推論 — 対応、思考レベル制御付き。思考トークンは出力レートで課金されるため、請求額の大半を占めるのは出力価格です。
• ツール — キャッシュ、コード実行、関数呼び出し、Search グラウンディング、Maps グラウンディング、構造化出力、URL コンテキスト、Batch API、フレックス推論、優先推論はすべてサポート対象として記載されています。ファイル検索は AI Studio のみでサポート対象として記載されています。
・ライセンスおよびウェイト — プロプライエタリ。オープンウェイトはなく、ダウンロード可能なチェックポイントもなく、セルフホスティングの手段もない。このモデルへのあらゆる経路はホスト型APIである。
• エンドポイント — gemini-3.1-pro-preview がモデルコードです。Google は gemini-3.1-pro-preview-customtools というバリアントも公開しています。プレビューのエンドポイントは、バージョン番号を上げることなく、あなたの知らないうちに改訂される可能性があります。これが、本番環境ではエイリアスではなく正確なモデル ID を固定することが標準的な理由です。
• 文書化された更新日 — モデルページには「最終更新:2026年2月」と記載されています。Google 自身のモデルページには知識カットオフ日が明記されているのを確認できませんでした。サードパーティの一覧では2025年1月とされていますが、私たちはそれを事実として繰り返すのではなく、未確認であると注意喚起しています。
料金
Gemini 3.1 Proには価格の断崖があり、それは一見安価に見える見積もりを2倍の請求額に変えてしまう類の細部だ。Googleが公開している開発者向け価格は、モデルのバージョンではなくプロンプトのサイズで区分されている。
• スタンダード tier、最大 200,000 トークンのプロンプト — 入力トークン 100 万あたり $2.00、出力トークン 100 万あたり $12.00、思考トークンは出力としてカウントされます。
• 標準ティア、プロンプトが200,000トークンを超える場合 — 入力$4.00、出力$18.00。同じしきい値で両方の料金が2倍になる。ここに落とし穴がある。長いコンテキストのワークロードは、まさにそのためにモデルを買った機能を使っているという理由で、表示されている料金の2倍を支払うことになるのだ。
• コンテキスト キャッシュ — キャッシュされたトークン100万個あたり$0.20または$0.40(200,000のしきい値のどちら側かによって異なります)。さらに、キャッシュ ストレージは100万トークンあたり1時間$4.50で課金されます。
• Batch および flex の料金階層 — 20万トークン未満では入力 $1.00、出力 $6.00、それを超える場合は $2.00 と $9.00。待てる作業ならおよそ半額。
• プライオリティ階層 — しきい値未満は入力 $3.60、出力 $21.60、しきい値以上は $7.20 と $32.40。
• 無料枠 — このモデルではご利用いただけません。プロトタイプ作成に使用できる無料のレート制限はありません。
これらの数値がどれほど信頼できるかを知るうえで、押さえておくべき点が2つあります。ここでの権威は Google 自身の料金ページであり、私たちはそれを直接確認しているため、上記の数字は2026年9月23日時点で最新です。ただし、このモデルに関する第三者の掲載情報は実際に一貫しておらず、あるトラッカーは $2.50 / $15.00 の料金を挙げ、別のトラッカーは $4.50 のブレンド料金を挙げています。そしてその理由は段階制にあります。あるページが Gemini 3.1 Pro について、どのプロンプトサイズ帯に適用されるかを示さずに単一の数値を提示しているなら、その数値は実際の見積もりには使えません。
それが測定可能なほど得意なこと、そして測定可能なほどそうでないこと
まずGoogleが主張している内容から始め、それを独立系の評価機関が測定した結果とは切り離しておいてください。というのも、2月以降、この両者は大きく食い違っているからです。
Google自身の発表に含まれるベンチマーク数値はちょうど1つだけです。ARC-AGI-2における「検証済みスコア77.1%」で、GoogleはこれをGemini 3 Proの推論性能の2倍超と説明しています。これはベンダーによる数値で、Google自身の投稿から読み取ったものであり、そこで確認できた唯一の数値です。ローンチ時の報道では、はるかに多くの数値群が出回りました——GPQA Diamond、SWE-bench Verified、Terminal-Bench 2.0、LiveCodeBench、Humanity’s Last Exam——しかしそれらの数値はGoogle自身の発表には現れておらず、二次報道は、私たちが確認したものについては互いに食い違っています(GPQA Diamondは、誰の記事を読むかによって94.1とも94.3とも出ています)。私たちはそれらを確立された結果として掲載しているわけではありません。
独立した全体像こそが、話の転換点となる。2026年9月23日時点で公開されているArtificial Analysis Intelligence Indexでは、Gemini 3.1 Pro Previewは30を記録し、そのクラスの212モデル中81位につけている。クラス内の中央値モデルは25なので、平均を上回っている——そして同じチャートの首位、推論設定を最大にしたClaude Opus 5は58だ。この指数自体は固定された物差しではなく、バージョン管理された物差しである。Artificial Analysisは2月のローンチ後にそれを改訂し、同社の改訂ノートには、新たな評価が複合指標に加わったことが記録されている。Gemini 3.1 Proは、2月のローンチ時点の指数で57ポイントを記録し、文句なしの首位だったと報じられた。それは30と同じ物差しではなく、私たちはその2つの数字を、下降をたどったかのように並べるつもりはない。
現在のマッピングが確かに示しているのは、紛れもないプロファイルであり、しかもそれは偏ったものだ:
• インテリジェンス — 指数は30、212中81位。中央値は上回るが、フロンティアからは大きく離れている。
• 速度 — 毎秒116.5出力トークン、212台中38位。推論モデルとしては特に高速。
• コスト — Intelligence Index のタスクを1つ実行するのに $0.67、212 件中 31 位。作業単位あたりでは安価です。というのも、このモデルは思考トークンを節約するからです。
• 冗長性 — インデックスを完了するのに67Mの出力トークン。クラス中央値は88M。212件中39位で、Artificial Analysisは「かなり簡潔」と評している。比較すると、高推論設定のGemini 3.8 Flashは同じスイートで170Mトークンを消費し、タスクあたり$1.24かかる — トークン単価がより安いにもかかわらず、Gemini 3.1 Proよりも高い。
だから正直に読み解くなら、「旧モデルがすべての面で打ち負かされている」わけではない。Gemini 3.1 Pro は高速でトークン効率もよく、タスクあたりのコストで見れば、自らの新しい兄弟モデルをも上回る。それが失っているのは能力の最上位部分であり、品質が制約条件となるワークロードでは、そこが唯一意味を持つ軸なのだ。

9月の空き状況に関する問題
このモデルをめぐる進行中の動きが1つあり、それはリリースではなく、ある疑問です。2026年9月18日以降、Google自身のAI Studio開発者フォーラムのユーザーたちは、Gemini 3.1 ProがAI Studioのモデルセレクターから消えたと報告しています——スレッドのタイトルでは、この変更の日付が2026-09-18とされています——そして有料ユーザーは、自分たちがGemini 3.8 Flashに移され、そこから3.7と3.6 Flashに移されたと述べています。私たちが読んだスレッドにはGoogle社員による返信はなく、非推奨の通知もなく、原因も示されていません。2026年9月23日に確認した時点で、このモデルはまだ一覧に表示されており、Gemini API経由でも私たち自身のカタログ経由でも依然として呼び出し可能でした。
私たちはこれを、サービスの終了としてでも障害としてでもなく、Google自身のフォーラムにおける未解決のユーザー報告として注記しています。ただし、本番環境の経路が特にこのモデルに依存しているのであれば、プレビュー用エンドポイントが恒久的なものだと想定するのではなく、フォールバックを構成しておくべき理由になります。
誰がそれを選ぶべきで、誰が選ぶべきではないのか
問題が長くマルチモーダルなら、Gemini 3.1 Proを選ぼう。ネイティブの動画・音声・PDF入力に対応した100万トークンのウィンドウは、依然としてこれを選ぶ理由であり、モデルの古さによってその点が変わることはない。具体的には、リポジトリ全体の分析、何時間にもわたる録画会議や映像の監査、混合メディアの文書セットからの構造化データ抽出、あるいは単一のプロンプトが正当に20万トークンを超え、その代わりに自分で構築し評価しなければならない検索レイヤーを使うしかないようなあらゆるパイプラインだ。そのトークン効率も確かな第二の論拠である — Gemini 3.8 Flashが1億7000万トークンを費やすタスクスイートを、これは6700万出力トークンで完了する。そのため、トークン単価は高く見えても、タスクあたりの請求額は低くできることがある。
3つのケースでは別のものを選びましょう。難しい推論や長期的なコーディングの問いに対する Google の現時点で最良の答えを求めるなら、Gemini 3.8 Flash は現在の独立系インデックスで Gemini 3.1 Pro を上回り、プレビューではなく一般提供され、2026年12月31日まで入力100万トークンあたり $0.75、出力100万トークンあたり $3.75 の料金で、Gemini 3.1 Pro にはない無料枠もあります。そこに到達するにはより多くの思考トークンを消費します——それがトレードオフであり、実際に存在するトレードオフです。圧倒的な最先端が必要なら、現時点でそれは Google のモデルではありません。同じインデックスのチャートでは、最大推論設定の Claude Opus 5 が 58 でリードしており、Gemini 3.1 Pro は 30 です。また、ワークロードがレイテンシーやコストに敏感で、かつ浅いもの——分類、抽出、ルーティング、短い要約——なら、Flash-Lite ティアまたは小規模なオープンウェイトモデルが、入力100万トークンあたり $2.00 の何分の一かでその仕事をこなし、それに Pro の料金を払うのはただの無駄です。
私たちがしないのは、Googleの最新のProだからという理由でGemini 3.1 Proを選ぶことだ。それは新しいものではなく、今月時点でGoogleにはそれに代わる出荷済みの後継モデルが存在しない。
プレビューエンドポイントにスタックを賭けずにそれを呼び出すこと
7か月間のプレビューの厄介な点は、その上に構築するには十分に良いものの、前提とするには十分に安定していないことだ。2つの緩和策は挙げておく価値がある。
エイリアスではなく、正確なモデルコードを固定してください。プレビューエンドポイントはその場で改訂される可能性があるため、gemini-3.1-pro-previewを設定ファイルに記述するほうが、流動的な「最新のPro」参照よりも安全であり、サイレントな変更を差分で可視化できます。
ルーティングはモデルの上位に保ちます。OrcaRouter では、Gemini 3.1 Pro は google/gemini-3.1-pro-preview で、当社が提供する他のすべてのモデルと同じキーと同じエンドポイントから提供されます。ネイティブな /v1beta/models/{model}:generateContent 形式(Gemini SDK 向けに書かれたコード用)と、OpenAI 互換の /v1/chat/completions をそれ以外すべて向けに提供します。料金はマークアップ 0% のパススルーなので、Google の料金表にある $2.00 / $12.00 がここで支払う金額です。ベンダーの価格変更は次の請求サイクルではなく当日に反映されます。これがプレビュー モデルで特に重要なのは、フェイルオーバーです。フォールバック チェーンを設定しておけば、Gemini 3.1 Pro が利用できない日でも、ユーザーが気づいた後ではなく、レスポンスが始まる前に、再試行はチェーン内の次のモデルに送られます。それが、実運用に投入できるプレビューと、デモしかできないプレビューの違いです。
当社自身のモデルに関するカタログエントリには、当社が提供する通りの仕様が記載されています — 100万トークンのコンテキスト、65,536トークンの最大出力、音声/ファイル/画像/テキスト/動画入力、テキスト出力、そして過去7日間における初回トークンまでの時間の中央値10.00秒。これは、このモデルがチャットレイテンシー・モデルだと想定する前に知っておく価値があります。そうではありません。

何がまだ未解決ですか
閉じられなかった3つの点があり、取り繕うよりも明言しておきたい。GoogleはGemini 3.1 Proが一般提供に到達するかどうかを公表しておらず、どちらにせよ終了日も公表されていない。AI Studioの報告は5日経っても説明がなく、我々が見つけられたベンダー側の回答もない。そして後継の問いは、否定の形でしか答えられない。GoogleのProページは数か月にわたって近日のProリリースを告知しており、報道によれば内部候補はFlash系を上回れずに打ち切られ、2026年9月23日時点で何も出荷されていない。Gemini 3.5 ProまたはGemini 4 Proが登場すれば、このファミリーにおけるGemini 3.1 Proの位置づけは2月以来初めて変わる——そして、注目に値する出来事は、当初のローンチではなく、それだ。

Gemini 3.1 ProはOrcaRouter上でGoogleの定価で提供されており、当社が扱うほかのすべてのモデルと同じキーでアクセスできます。Gemini 3.1 Proのモデルページでは、最新の価格、コンテキスト上限、そして次のプレビュー版が公開される前に設定できるフォールバックチェーンをご確認いただけます。
この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
