
Claude Fable 5.1 vs Gemini 3.1 Pro:登場から9日のフラッグシップ vs 公開から7ヶ月のプレビュー版
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0340知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2134知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123知能49コーディング
Claude Fable 5.1とGemini 3.1 Pro Previewについて、間違った質問をすれば退屈な答えが返ってくる。新しいAnthropicのフラッグシップはより高性能で、Googleのモデルはより安い、それで終わりだ。この対決を実際に左右するのは、モデルの「年齢」の問題だ。Claude Fable 5.1は2026年9月1日にリリースされ、この記事を書いている時点でわずか9日しか経っていない。Gemini 3.1 Pro Previewは2026年2月19日にリリースされ、Googleは今もこれをプレビューと表示している。つまり、このモデルは約7か月間、アップデートされないまま放置されている。その間に、新しいGeminiのリリースの数々(3.5、3.6、3.7 Flashティア、そして9月2日のGemini 3.8 Flash)が登場し、ベンチマークでスコアを更新し、これを追い越していった。この2つを比較することは、ベンチマークの演習というよりも、まったく異なる2つのリリース哲学への賭けである。そして、その鮮度の差こそ、あらゆるスペックシートが省略している点なのだ。
7ヶ月のプレビュー、9日のフラッグシップ
Gemini 3.1 Pro は、2月時点でのGoogleのフロンティア推論モデルでした——当時の「フロンティア」であり、強力なソフトウェアエンジニアリングとエージェント機能を謳い、今も他と一線を画すネイティブなマルチモーダル基盤を備えていました。Googleはその後、これをGA(一般提供)していません。プレビュー状態のまま7か月が経過する間に、Anthropicは2つのフラッグシップ世代をリリースしました。7月24日のClaude Opus 5と、そして今回のClaude Fable 5.1です。AnthropicはClaude Fable 5.1をOpusクラスの上位にあたるMythosクラスのティアと位置づけており、Artificial Analysis Intelligence Indexで66点を記録してトップに立ちました。Gemini 3.1 Proを導入するということは、後継機の決定をGoogleがすでに他のラインアップで事実上下しているモデルを導入するということです。一方、Claude Fable 5.1を導入するということは、Anthropicが現在改良を進めているモデルを導入するということです。
その非対称性は細部に現れている。凍結されたプレビューには、標準化した機能がGAの仕上げ、価格改定、後続のポイントリリースを得られないリスクがある。9日前のフラッグシップには逆のリスクがある——来月5.2やポイントリリースが登場して前提を変えてしまうリスクだ。どちらのリスクも回避できない。重要なのは、両者が反対方向を指していることであり、どちらなら許容できるかが、この決定における本当の判断材料となる。
スペックシートを並べて表示
「価格 — Claude Fable 5.1 は100万トークンあたり$10.00/$50.00、Gemini 3.1 Pro は200K入力トークンまでは100万トークンあたり$2.00/$12.00、200K超では$4.00/$18.00。基本ティアでは入力が約5倍、出力が約4倍安価です。」
• コンテキスト / 最大出力 — 両方とも100万トークンのコンテキスト。Claude Fable 5.1は最大128Kまで出力できるのに対し、Gemini 3.1 Proは約65Kが上限。
• 入力 — Claude Fable 5.1 はテキストと画像に対応。Gemini 3.1 Pro はテキスト、画像、音声、動画、PDFに対応し、Google 検索によるネイティブなグラウンディングを備えています。
• 独立スコア — Claude Fable 5.1はArtificial Analysis Intelligence Indexで66(最大努力)に対し、Gemini 3.1 Proは40台後半(発売時は57だったが、AAが評価を再実行するにつれて低下している)。
• 速度 — Gemini 3.1 Proは、OrcaRouter自身のテレメトリによると毎秒約540トークンをストリーム出力する。一方、Artificial AnalysisがClaude Fable 5.1について測定したのは毎秒67.2トークンであり、スループットの格差は逆方向に大きい。
• ステータス — Claude Fable 5.1 安定版(GA、2026-09-01リリース)。Gemini 3.1 Pro Previewは2026-02-19にリリースされたが、2026年9月中旬時点ではGAになっていない。

正直にラベル付けされたベンチマーク画像
生の性能に関して言えば、この2つのモデルは同じ水準にはない。そして独立したインデックスは、どのベンダーのスライドよりも明確にそれを示している。Artificial Analysis Intelligence Index(最大努力)におけるClaude Fable 5.1の66は、AAが記録した中で最高スコアだ。もっとも、Anthropicが提供するデフォルトフォールバック構成についてのAAのモデルページには53と記載されており、それでも201モデル中1位だが、一方Gemini 3.1 Proは40点台後半にとどまる。Anthropicが報告するコンポーネントベンチマークでは、Fable 5.1はTerminal-Bench 4.0で55.8%、Terminal-Bench-Science 0.1で52.6%を記録している。これらのスコアを、独立したテストでGemini 3.1 Proに帰属させた者はまだ誰もいない。広く裏付けられたSWE-bench系の項目では、Gemini 3.1 Proの2月時点の主張(第三者トラッカーによるとSWE-bench Verifiedで約75%)は、現行のClaude世代に大きく及ばない。
正直な注意点は、マルチモーダル全般については逆方向に働きます。Gemini 3.1 Pro はネイティブ音声、ネイティブ動画、PDFを読み取ることができ、さらにモデルにGoogle検索が組み込まれています。これらはClaude Fable 5.1にはまったく備わっていない機能です。Anthropicのフラッグシップはテキストと画像のみに対応しているためです。長文書や長時間動画、検索連動型の作業において、Gemini 3.1 Proは単に安いだけでなく、2つのうち単一の呼び出しでそのタスクを実行できる唯一のモデルです。これは実際の強みですが、目にするベンチマークがすべてテキストとコードに関するものだと、過小評価しがちです。

価格の崖は、本当のコストの実態を隠している。
Gemini 3.1 Pro の見出しのレート $2 / $12 は、1リクエストあたりの入力が20万トークン未満の場合にのみ適用されます。それを超えると、リクエスト全体が入力 $4.00 / 出力 $18.00 に再設定され、入力が2倍になるため、長いコンテキストの Gemini 呼び出しは、マーケティング上の数字が示すほど安くはなりません。Claude Fable 5.1 の $10 / $50 は、どの長さでも一定で、キャッシュ読み取りは $0.25 であり、セッションがコンテキストを再読するほど、リスト価格に対する相対的なコストは下がります。分岐点はワークロードの形態によって決まります。短く高頻度のマルチモーダル呼び出しでは Gemini 3.1 Pro が圧倒的に有利ですが、大きなコンテキストを繰り返し再読する長いエージェントセッションでは、性能の議論を持ち出すまでもなく、Claude Fable 5.1 のキャッシュ経済性が有利です。
誰がどれを選ぶべきか
ワークロードが真にマルチモーダルまたは検索連携型である場合、低価格でのスループットが推論性能の頂点よりも重要である場合、そしてGoogleが7か月間プレビューのままにしているモデルに標準化しても構わない場合——理想的には、Googleが次にGAするものへの移行パスがある場合——はGemini 3.1 Proを選びましょう。現在の推論性能の上限が必要な場合、128Kの出力上限と$0.25のキャッシュ読み取りが重要となる長期的なエージェントを構築している場合、そしてベンダーが積極的に改善しているモデルに賭けたい場合は、Claude Fable 5.1を選びましょう。どちらもOrcaRouterでプロバイダーの定価にて提供されており、マークアップはゼロなので、この決定のルーティングDSL版は後から安価に変更できます:マルチモーダルおよび大量のトラフィックはGemini 3.1 Proに送り、難易度の高い推論とエージェント型のトラフィックはClaude Fable 5.1にエスカレーションし、GoogleがついにProティアをGAする日——あるいはAnthropicがFable 5.1の後継をリリースする日——にその分割比率を再調整してください。

この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
