ヒーロータイトルカードには「GPT-6 Sol Pro vs Gemini 3.1 Pro Preview」と表示され、サブタイトルは「7か月のプレビュー、そしてその代償」、右下には本物のOrcaRouterロゴ。
Guides & Insights

GPT-6 Sol Pro vs Gemini 3.1 Pro Preview:7ヶ月にわたるプレビュー、そしてそれがあなたに課すコスト

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Gemini 3.1 Pro Previewは7か月間プレビューのままです。ベンダーは2026年2月19日に、入力トークン100万あたり2.00ドル、出力トークン100万あたり12.00ドルでこれを公開しましたが、今週時点でもモデルカードは「プレビュー形式で提供」と記載し、「安定版リリースと比べて安定性や可用性に制限がある可能性がある」と警告し、「予告なく変更または非推奨化される可能性がある」と述べています。非推奨表には一般提供日も提供終了日もありません。GPT-6 Sol Pro — 2026年9月22日に一般提供に到達したモデル、GPT-6 Solの構成で、入力2.00ドル、出力10.00ドル — は正反対の仕組みです。公開価格、文書化されたエフォートダイヤル、そしてその数字を確約したベンダーを備えた本番APIです。

これら2つのモデルを比べて興味深いのは、ベンチマークの表ではない。各ベンダーが次の四半期についてあなたに約束したことのほうだ。

2つの価格行があり、そのうち1つはプレビューです

どちらもベンダーのリストだ。GoogleOpenAI 自身の数値であり、それらをホストするプラットフォームによってそのまま変更されずに渡される。

• 入力 — GPT-6 Sol 100万トークンあたり$2.00 対 Gemini 3.1 Pro Preview 100万トークンあたり$2.00

• 出力 — GPT-6 Sol 100万トークンあたり$10.00 対 Gemini 3.1 Pro Preview 100万トークンあたり$12.00

• 長コンテキスト — Gemini 3.1 Pro Preview は、200,000トークンのしきい値を超えると、入力の価格を100万トークンあたり$4.00、出力を$18.00に改定します。GPT-6 Sol は、より高い入力しきい値を超えると、独自の長コンテキスト価格改定を適用します

• キャッシュ読み取り — GPT-6 Sol は100万トークンあたり$0.20、Gemini 3.1 Pro Preview は100万トークンあたり$0.20

• コンテキストウィンドウ — GPT-6 Sol 1,050,000トークン 対 Gemini 3.1 Pro Preview 1,000,000トークン

• 最大出力 — GPT-6 Sol 128,000トークン 対 Gemini 3.1 Pro Preview 65,000トークン

• 入力モダリティ — GPT-6 Sol はテキストと画像、Gemini 3.1 Pro Preview はテキスト、画像、音声、動画、ファイル

• 提供状況 — GPT-6 Sol は 2026年9月22日から一般提供中であるのに対し、Gemini 3.1 Pro Preview は 2026年2月19日からプレビュー中で、GA日は発表されていない

表向きの料金は、決め手にならないほど近い。入力は同一。出力は20%異なる。本当の違いは最後の2行にある。Geminiは入力モダリティを4つ多くサポートする一方、出力上限では逆に相手が2倍(65,000トークン対128,000トークン)で、しかも1年の大半にわたってプレビューとして提供されてきた。

A two-column scoreboard card titled 'GPT-6 Sol vs Gemini 3.1 Pro Preview - the scoreboard'. Left column 'GPT-6 Sol': AA Index, current 48; index at Feb 2026 not scored; price in/out $2 / $10; cost per index task $1.06; max output 128K; input modalities text + image. Right column 'Gemini 3.1 Pro Preview': AA Index, current 30; index at Feb 2026 57, retired index; price in/out $2 / $12; cost per index task $0.67; max output 65K; input modalities text, image, audio, video. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

プレビューステータスは実際の運用上のプロパティです

Google 自身のカタログ文言は、開発者に対し、プレビュー版の廃止に備えた計画を立てるよう伝えている。あの一文は非常に多くの役割を担っており、免責事項としてではなく、エンジニアリング上の制約として読む価値がある。

プレビューモデルとは、その上に構築はできても、それを前提に計画を立てることのできないモデルだ。そこから三つの帰結が導かれるが、そのいずれも価格表には現れない。

• 安定性に関する確約はありません。このカードには、このモデルが安定版リリースと比べて安定性に制限がある可能性があること、そしてOrcaRouterがこのプレビューモデルに対して特定のレイテンシ保証を提供していないことが明記されています。モデルページ上の当社独自のテレメトリでは、過去1週間のp50およびp95の初回トークン時間がいずれも10.00秒であり、これは測定された中央値ではなく表示範囲の上限にあたります。

• 非推奨日なし。終了日があるモデルなら、ロードマップから外す時期を計画できる。GA日も終了日もないモデルは、どちらの方向にも一切計画できない。いつ依存しても安全になるのか分からず、いつ動かなくなるのかも分からないからだ。

• ロードマップ上の位置づけがない。Googleは同じファミリーのより新しいFlashモデルをすでに出荷しており、それらは独立系の総合評価でGemini 3.1 Proを上回っている。これには2026年9月2日のGemini 3.8 Flashも含まれる。3.5 Pro世代は遅延し、据え置かれたと報じられている。Gemini 3.8 Proは存在しない。Proの名を冠するモデルはもはやベンダー最高得点のモデルではなく、しかも依然としてプレビュー版である。

この2つのどちらを選ぶ人にとっても、それが正直な捉え方だ。GPT-6 Solは登場から6日で、変動せず公表された恒久的な価格を備えている。Gemini 3.1 Pro Previewは7か月前のもので、ロードマップの代わりにステータス行がある。

独立した記録が示すもの、そしてバージョンラベルが議論のすべてである理由

Artificial Analysisは、現在のインデックスにおいてこの正確な組み合わせについての直接比較ページを公開しており、それによりこれは、このバッチの中で中立的な数値が真に同条件で比較できる数少ない対戦の一つとなっています。最大effortでのGPT-6 Solは、インデックスタスクあたり$1.06で48を記録しています。Gemini 3.1 Pro Previewは、インデックスタスクあたり$0.67で30を記録しています。

18ポイントは大きな差であり、2月にこのモデルが抱えていた差ではない。公開時、Artificial AnalysisはGemini 3.1 Pro PreviewをIntelligence Indexで57の首位に置いた。モデルはそれ以降変わっていない。変わったのはインデックスのほうだ——2026年9月19日に再採点され、同じく変わらないモデルが今では30を示す。どちらの数値もArtificial Analysisによるもので、どちらも間違っていない。バージョンを示さずに両者を並べることは、このモデルに関する報道で最もよくある単一の誤りであり、だからこそ多くの比較ページが2月の首位を9月の同等物として描くのだ。

タスクあたりのコストは、計算してみる価値のあるもう一つの話を物語っている。Geminiはタスクあたりでは安い——$1.06に対して$0.67——が、スコアは低い。指標1ポイントあたりのコストは、GPT-6 Solが$0.022、Geminiが$0.022になる。この尺度では両者はまったくの互角で、これがここで実際に起きていることを最も明快に言い表している。Geminiは同じ知能をより安く買う方法ではなく、より少ない知能をより安く買う方法なのだ。

それらの横には、独立した数字がもう2つ並ぶべきで、どちらもラベル付きだ。コンピューター操作のベンチマークであるOSWorld-Verifiedについて、Google自身の評価ページはGemini 3.1 Proで76.2%と報告している。この数値はGoogleの資料およびそれを要約した第三者資料には登場するが、独立検証されたOSWorldのボードには登場しない。そこには他のGeminiモデル — 3.6 Flashが83%、3.5 Flashが78.4% — が掲載されており、3.1 Proの行はまったくない。より難易度の高いOSWorld 2.0のボードでは、このモデルは30.6%を記録する。またGDPval-AAでは、このモデルはおよそ1,316 Eloで、Claude Sonnet 4.6とClaude Opus 4.6の後ろに位置する。

これは悪意があるという非難ではない。自己申告の数値は普通のことであり、両ベンダーともそれを公表している。これは、7か月前に出たプレビューが実際に何をもたらすかについての話だ。つまり、ベンダーが報告した数値が広く出回るには十分な時間があり、その数値が検証されるための独立した再現には十分ではない。これに対して、GPT-6 Solの中立な記録は短く、曖昧さがなく、6日前のものだ。

誰も言及しない15か月の知識ギャップ

Gemini 3.1 Pro Previewの知識カットオフは2025年1月です。GPT-6 Solのものは2026年4月20日で、15か月後です。

そのギャップは、この対決に関するどの比較ページにも欠けている。そして、特定の種類の作業——最近のAPI、最近のライブラリのバージョン、最近の出来事、最近の組織的事実が関わるもの——にとっては、出力価格の差よりも重要だ。2025年1月のカットオフを持つモデルは、1年と四半期分進んだ世界について自信を持って答える。その失敗の形はエラーメッセージではなく、もっともらしい誤答だ。検索拡張型の作業では、コンテキストが事実を運ぶため、カットオフはほぼ無関係だ。パラメトリック知識に頼るものにとっては、それは最初に確認すべき制約であり、最後まで誰も確認しない制約でもある。

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

モダリティギャップはGeminiを支持する最も強力な論拠であり、そしてそれは実在する

これをより新しいモデルの一方的な勝利として書き記すのは簡単だろう。そうはならない、その理由は入力行にある。

Gemini 3.1 Pro Preview は、テキスト、画像、音声、動画、ファイルの入力を同一のエンドポイントでネイティブに受け付けます。GPT-6 Sol はテキストと画像を受け付けます。動画理解、会議の文字起こし、または複数のフォーマットにまたがるドキュメント処理を中心としたワークロードにとって、それは機能の違いではなく、1回の API 呼び出しと、中間ステップが別途課金され、障害モードが倍増する3段階のパイプラインとの違いなのです。

それに付随する正直な注意点はこうだ。ホストされているモデルページに表示された77.6%というエラー率を持つプレビューモデルは、そのマルチモーダルの利点を、そもそも応答するかどうかと天秤にかけなければならないプレビューモデルである。その数値はページに表示されている通りのものであり、誰かがそれを基に構築する前に検証する価値があるほど高い——まさにそこが要点だ。7か月が経った今でも、このモデルについての正直なアドバイスは依然として「自分で測定せよ」であり、それはGAリリースについて誰も書かない一文だ。

ルーティング層が計算を変える場所

Gemini 3.1 Pro Preview は OrcaRouter のカタログに、入力 $2.00、出力 $12.00、キャッシュ読み取り $0.20/100万トークンで掲載されており、コンテキストウィンドウは 1,000,000 トークン、出力上限は 65,000 トークン、エンドポイントは /v1/chat/completions と /v1beta/models/{model}:generateContent、そして直近1週間に当社のモデルページで計測された p50 初回トークン時間は 10.00 秒です。プロバイダーのリスト価格がそのまま適用され、上乗せマークアップは一切ありません

GPT-6 Solは当社のルートの一つではないため、ここにある内容は、当社を通じたその価格に関する主張ではありません。

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 23 September 2026, showing Vision, Audio, Tools, JSON and Reasoning header badges, 'by Google — 2026-02-19', a 65K-token maximum output, an input price of $2.00 and an output price of $12.00 per million tokens, a p50 time to first token of 10.00 seconds, and both the /v1/chat/completions and /v1beta/models/{model}:generateContent endpoints.

プレビューモデルは、コミットするのではなくルーティングする典型的な事例だ。Gemini 3.1 Pro Preview を試す理由も、それを本番経路の基盤にしない理由も、同じ性質にある——予告なく変更され得るということ——そして、単一のエンドポイントを自動フェイルオーバーと組み合わせることが、前者を取り入れつつ後者を受け入れずに済む方法だ。背後のモデルが変わってもリクエストの形は変わらないので、フォールバック経路は移行ではなく設定項目になる。これはほとんどの組み合わせ以上にここで重要だ。なぜなら、フォールバックチェーンでこのモデルを置き換える可能性が最も高いのは、同じベンダーの、同じキーで、より新しい Flash であり、しかも出力レートの何分の一かで済むからだ。

決定規則

• 1回の呼び出しで動画、音声、または混在フォーマットの入力 — Gemini 3.1 Pro Preview。GPT-6 Sol の列には動画ファイルを受け付けるものは何もなく、自分で構築しなければならない取り込みパイプラインを補えるほどの価格差もない。

• 可用性コミットメントが付いているもの — GPT-6 Sol。登場から6日、一般提供中、公表価格は恒久的と説明され、文書化されたエフォート調整機能もある。これがスケジュール可能というものだ。

• 長い生成 — GPT-6 Solは、レートではなく出力上限の話。128,000トークン対65,000トークンが、統合作業で真っ先に効いてくる制約であり、20%の出力価格差より先に効いてくる。

• Gemini 3.1 Pro Preview の評価はフェイルオーバー経路の背後で行い、ワークロードの規模を見積もる前に自分でエラー率を測定すること。ホスティングページに 77.6% のエラー率が表示されたまま 7 か月間プレビューが続いているのは、枯れた計測器とは言えない。

• 来四半期にこのモデルが安いことにあなたの計画が依存しているなら——どちらも当てになりません。Geminiのプレビューは予告なく価格改定されたり提供終了になったりし得ますし、GPT-6 Solの価格が恒久的なのは、OpenAIが今週そう述べたという意味でしかありません。定額料金は保証ではなく約束です。それは単に、プレビューの料金表示がする約束より強い約束にすぎません。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新