
Claude Opus 5.5が実行、Claude Fable 5.1が助言:Claude Codeのアドバイザーループの価格設定
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Fable 5.1が設計プランを書く。Claude Opus 5.5がそれをループで実行する。Fable 5.1 がアドバイザーとして戻ってきて、その結果を受け入れるか却下する。これが、ベンダーが Claude Opus 5.5 をリリースした日、2026年9月22日に X/@dotey が投稿したパターンであり、コスト圧力の下で行き着いたトークン節約の仕組みとして提示された。アドバイザーを Fable に設定し、Opus を走らせ、高価なモデルには意思決定のポイントでだけ発言させる、というものだ。彼らが使っているのは、もはやプロンプトの小技でもサブエージェントの設定でもない。Claude Code に組み込まれたアドバイザーツールであり、サーバーサイドの機能で、メインモデルが消費する分に加えてアドバイザーモデルの料金で課金される。しかも、アドバイスは安い方の部分だ。それを生成するために会話を読み直すのは安くない——実行者のコンテキストは読み直すのが安くなり、アドバイザーのそれは決して安くならなかった。この単一の非対称性が、そのループを回す価値があるかどうかを決める。そして、この記事の残りが値付けするのは、まさにそれだ。
ループとは実際に何なのか
アドバイザーツールは、あなたのメインモデルを、通常はより強力な2つ目のモデルと組み合わせます。Claude は、アプローチを確定する前、エラーが繰り返し発生するとき、またはタスクを完了と宣言する前といった重要な場面で、そのモデルに相談します。アドバイザーは、すべてのツール呼び出しとその結果を含む会話全体を受け取り、メインモデルがその後適用するガイダンスを返します。アドバイザーがツールを呼び出すことはなく、ユーザー向けの出力を生成することもありません。どのモデルにアドバイスさせるかはあなたが選択し、いつ呼び出すかは Claude が決定します。
その最後の部分が、これを、Claude Code コミュニティが8月に広めていたオーケストレーター・アンド・サブエージェント・パターンとは別物にしている。サブエージェントは委任だ。プランナーが作業を分解してワーカーに割り振り、各レーンのモデルを明示的に構成する。アドバイザーはエスカレーションだ。1つのモデルがタスク全体を推進し、高価なモデルは、ドライバーだけでは下せない判断のために実行途中で呼び出される。ワーカープールも、タスクグラフも、保守すべきオーケストレーション用プロンプトもない。@dotey が説明する実践的ループ——計画、実行、検証、繰り返し——は、アドバイザーを Fable 5.1 に向け、ループの終了条件を取り締まらせたときの、その仕組みの姿である。
Anthropic自身によるこの戦略の説明は、その勝利の形について率直だ。アドバイザーは「実行者に欠けている能力しか引き渡せない」。以下に述べることはすべて、実際にどれだけの能力が欠けているか、そして実行者がそれをどれほど頻繁に認めるかによって決まる。
なぜClaude Opus 5.5は計算を変えたのか

Anthropicが公開している料金表、100万トークンあたり。これらは推定値ではなくベンダー公表の数値です:
• Claude Opus 5.5 — 入力 $4、出力 $20、キャッシュ読み取り $0.20、5分キャッシュ書き込み $5
• Claude Opus 5 — 入力 $5、出力 $25、キャッシュ読み取り $0.50、5分間のキャッシュ書き込みは $6.25
• Claude Fable 5.1 — 入力 $10、出力 $50、キャッシュ読み取り $0.25、5分間のキャッシュ書き込み $12.50
そのリストの中で、見出しの価格よりも重要な2つの詳細がある。第一に、Opus 5.5のキャッシュ読み取りは、Anthropic自身の脚注によれば基本入力の5%だ。ほとんどのClaudeモデルは10%、Fable 5.1は2.5%に位置する。Fable 5.1はより良い倍率を持ちながら、絶対額では依然として負けている——$0.20 対 $0.25——その基本入力料金が2.5倍高いからだ。
第二に、そしてこれはループの成否を分ける仕組みなのだが、Claude Code でアドバイザーを切り替えても、メインモデルのプロンプトキャッシュは無効化されない。そのため、エグゼキューターの長く、繰り返し再送されるコンテキストは、100万トークンあたり$0.20という安さのまま保たれる。アドバイザー自身による会話の読み取りはキャッシュされない。各相談はトランスクリプト全体を新たに処理し、Fable 5.1の入力料金は100万トークンあたり$10だ。500Kトークンのコンテキストを10回再読み込みするエグゼキューターはキャッシュ読み取り分を支払うが、10回相談されるアドバイザーは、その間ずっと増え続けるトランスクリプトに対して10回分の新規入力料金を支払う。エグゼキューターのコンテキストが安くなるほど、アドバイザーの非キャッシュ読み取りが際立つ——そしてOpus 5.5は、エグゼキューターのコンテキストをOpus 5より60%安くしたばかりだ。
Claude Code でのセットアップ
アドバイザーは実験的機能であり、Anthropicもセッションのバナーでそう述べています——「Advisor Tool(実験的)はオンになっており、より多くのトークンを使用する可能性があります」。動作、価格、提供状況は変更される可能性があります。その注意点を述べたうえで、仕組みは文書化されています:

• 有効にするには /advisor fable を使うか、または /advisor を引数なしで実行するとピッカーが表示されます。選択内容はユーザー設定の advisorModel 設定に保存され、セッションをまたいで保持されます。/advisor off で無効になります。
• 保存済みのデフォルトを変更せずに単一セッションで使うには、claude --advisor fable で起動します。このフラグは claude --help には記載されておらず、ペアリングが無効な場合、Claude Code はアドバイザーを黙って無視して起動するのではなく、起動時に終了します。
• 設定ファイルで {"advisorModel": "fable"} を指定して、永続的なデフォルトを設定します。
• 完全に無効にするには、次のように設定します: CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — /advisor コマンドは表示されなくなり、設定済みの advisorModel はすべて無視されます。
• ペアリングは、少なくともメインモデルと同等以上の能力を持たなければならない。Claude Opus 5.5 は、Fable と Opus 5 以降をアドバイザーとして受け入れる。Opus 4.6 または Sonnet のアドバイザーは Claude Code によって拒否される。Opus 4.7 または Opus 4.8 のアドバイザーはアタッチされた後、API によって拒否される。メインモデルとしての Fable 5.1 は、Fable 5.1 のみを受け入れる。
• バージョン下限:アドバイザーツールには Claude Code v2.1.98 以降が必要です。Fable をメインモデルまたはアドバイザーとして使用する場合は v2.1.170 以降、Fable 5.1 の場合は v2.1.257 以降が必要です。トークン形式の /advisor — -p、Agent SDK、デスクトップアプリ、リモートコントロールで動作するもの — には v2.1.260 以降が必要です。
• アドバイザーは Anthropic API 専用です。Amazon Bedrock、AWS 上の Claude Platform、Google Cloud の Agent Platform、Microsoft Foundry では利用できず、フィーチャーフラグの取得に依存しているため、DISABLE_TELEMETRY のような変数が設定されたセッションでは無効のままになります。
• Fable の使用量が使用クレジットに課金されるプランでは、Fable をアドバイザーとして使う場合も同じように課金され、1 回限りの同意が必要です。同意するまで、/advisor fable は保存されず、claude --advisor fable は起動時に終了し、代わりに /model fable を指し示します。
サブエージェントは、あなたが設定したアドバイザーをそのまま継承し、同じペアリングチェックを自分自身のモデルに対して再実行します。これがこのパターンとサブエージェントパターンの間の唯一の相互作用です。より小さなモデルを実行するサブエージェントには、その親には許可されていないアドバイザーが許可される場合があります。
コスト構造を徹底解説
以下はどれも測定値ではない。トークンの形は計算を見えるようにするために考案したものであり、価格はAnthropicが公表している料金である。1つのエグゼキューターセッションが新規入力トークンを1M読み取り、500Kの出力トークンを生成し、さらに3回のアドバイザー相談があり、各回で200Kトークンのトランスクリプトを再読込して約600トークンのガイダンスを返すと仮定する——これは、Anthropic自身のシステムプロンプトがタスクあたりに求めている2〜3回の相談とほぼ同程度である。
• Claude Opus 5.5 での Executor — 入力 1M が $4.00、出力 500K が $10.00 = $14.00
• Claude Fable 5.1 のアドバイザー — 入力 600K が $6.00、さらに出力約 1,800 トークンが約 $0.09 = $6.09
• ループ、合計 — 約$20.09
• 同じ構成をFable 5.1でエンドツーエンド実行 — 入力$10.00 + 出力$25.00 = $35.00
• Opus 5.5のみで同じ形状 — $14.00
このループは両者の中間に収まり、それはまさにAnthropicが位置づけている場所だ。全体を通してFable 5.1を実行するより約43%安く、実行者だけの場合より約44%高い。正直な数字は2つ目だと考えよう。アドバイザーは節約ではなく、3つの判断においてFable級の判断力を購入することであり、それら3つの判断が結果を変える場合にのみ元が取れる。トランスクリプトを1Mコンテキストウィンドウに押し込むと、各相談だけで10ドルかかる。実行者が少数ではなくほとんどのタスクで尋ね始めるようにすると、ワークロード全体でアドバイザー料金を払うことになる——その時点では、Anthropicが言うように、アドバイザーのモデル自体を実行する方が同じスコアへの安い経路である。
Anthropic自身の測定が示すこと
Anthropicはこのパターンに関する実測結果を公開しており、それはベンダー報告のものです。両方のモデルを販売している企業が、自社のベンチマークハーネスで実施したものです。それでも、この種の数値はほかに存在せず、このパターンに反対する根拠も含まれているため、注意深く読む価値があります。
• Opus 5を実行者、Fable 5.1をアドバイザーとして、Anthropicの内部エージェント型コーディングベンチマークで1回あたり$7.69を記録した——Anthropicが測定した中で最も正確な構成である。これは、デフォルト設定のOpus 5単体よりも3.5ポイント高く、しかもわずかに少ない費用で済み、Fable 5.1単体よりも約2.5ポイント高く、費用は約1.5倍である。3.5ポイントの差は、タスクごとに5回の試行を行うことで、実行ごとのノイズから分離された。
• チャート読解における同じ組み合わせは、中程度のエフォートでのFable 5.1単体と誤差の範囲内で同等だった——65.0対67.5——が、タスクあたりのコストは約2.6倍だった。アドバイザーがほぼすべてのタスクで参照されたためである。
• GPQA Diamondでは、その向上幅は能力差とほぼ完全に連動していた。Haiku 4.5の実行者は大幅に向上し、Sonnet 5の実行者は数ポイント、最先端の実行者はほとんど向上しなかった。
• 相談率は脆い変数である。低労力のSonnet 5実行者は、アドバイザーを付けるとDeepSWEで23ポイント向上したが、その後SWE-bench Proでは一切尋ねなくなり、何も得られなかった。
• レイテンシ: タスクあたり約2回の余分なフロンティアモデル呼び出し。いずれもクリティカルパス上に位置する。
その証拠についての2つの点は、今週の時点でのこのループの状況に直接関わっている。測定では実行役として Opus 5 が使われた。というのも、それらが実行された時点では Opus 5.5 が存在しなかったからだ。そして Anthropic は、Opus 5.5 がほとんどの作業で Fable 5.1 と同水準の性能を発揮し、実行コストは40%低いと報告している。いずれもベンダーの主張であり、どちらも独立に再現されてはいない。実行者とアドバイザーの間のギャップを埋めるためにアドバイザーが報酬を得ているのなら、ギャップが狭いほど購入するものは小さくなる。Opus 5.5 の出荷時にこのパターンが悪化したわけではない。それが売っているものの希少性が低下したのだ。
実際に遭遇する障害モード
これらは推測ではなく文書化された動作であり、最初の項目こそ、何かをデバッグする前にこのセクションを読むべき理由です:
• 黙って消えるアドバイザー。APIがアドバイザーのペアリングを拒否すると、Claude Codeがそれを付加し、APIが拒否し、Claude Codeはアドバイザーなしでリクエストを再送します。その後、会話の残りはアドバイザーもエラーメッセージもないまま実行されます。/clearまたは/compactまで、互換性のあるメインモデルに切り替えた後でも、オフのままです。
• 静かに拒否されるケース。Claude Code 自体が拒否するペアリングの場合、アドバイザーはメインモデルのリクエストにそもそも接続されません。/advisor の出力と通知でそれが分かりますが、何も失敗しないため、アドバイスを受けていると思っていたセッションが実はそうではなかった、ということが起こり得ます。
• 同意がまだ得られていません。使用クレジットの同意が必要なプランでアドバイザーとして Fable が選択されている場合、同意するまでリクエストはアドバイザーなしで送信されます。バックグラウンドセッションが--advisor fable で開始された場合、終了するのではなく、アドバイザーなしで開始されます。
• あなたが制御できない許可リスト。組織の availableModels許可リストがアドバイザーモデルを除外している場合、Claude Code はそれを呼び出しません。その場合は /advisor で許可されたモデルを選択する必要があります。
• それが存在しないあらゆる場所。Anthropic API のみ:Bedrock なし、AWS 上の Claude Platform なし、Google Cloud Agent Platform なし、Microsoft Foundry なし。ゲートウェイ経由の場合、可用性はゲートウェイがリクエストをそのまま Anthropic の API に転送するかどうかによる。それはゲートウェイの特性であり、前提として置けるものではない。
OrcaRouterの適用範囲
このループの両モデルは現在 OrcaRouter で利用できます — Anthropic の定価そのまま、マークアップ 0%。プロバイダーの定価をそのまま反映しているため、表示されるレートは Anthropic が公表しているレートです。Claude Fable 5.1 は anthropic/claude-fable-5.1、Claude Opus 5 は anthropic/claude-opus-5 にあり、1 つの API キーで利用できます。Claude Opus 5.5 はまだ当社のルートには含まれていません。Anthropic 自身の API および主要クラウド経由で利用可能であり、そうでないかのように示唆するのではなく、その事実を明示します。

ここで1つの鍵が買うのは、安価に考えを変えられる能力です。このループの経済性は、実行者とアドバイザーの価格比率に依存しており、その比率は7週間で2度動きました——9月22日のOpus 5からOpus 5.5、そして9月1日のFable 5からFable 5.1で、後者はそのモデルのキャッシュ読み取りを100万あたり$1.00から$0.25に引き下げました。これらの動きはすべて「そのアドバイザーに価値があるか」という問いへの答えを変えますが、その答えを検証するために2つ目の契約が必要になるべきではありません。自動フェイルオーバーがもう半分です。これにより、まだ特性を把握していないモデルにトラフィックの一部を向けつつ、把握済みのモデルへフォールバックできます。本番パスをローンチ時の表に賭けるのではなく。そして、Claude Codeの組み込みツールを使わずにこのパターンを自分で構築するなら、ルーティングDSLが複数のモデルを1つの呼び出しに組み合わせます——あるモデルでの計画ステップに続き、別のモデルでの実行ステップを、1つのエンドポイントの背後で行います。
範囲について一点、正直に申し上げると、アドバイザーツール自体はAnthropicのAPI上で動作するサーバーサイドツールなので、ルーティングレイヤーがその代わりになるわけではありません。私たちにできるのは、モデルを定価で、キー1つで使えるようにすることです。そうすれば、アドバイザーを維持するか廃止するかは、ご自身の数字に基づいて判断していただけます。
自分のワークロードに合わせて判断する方法
Anthropic自身のガイダンスは正しい出発点であり、驚くほど感傷的でない。evalスイートを3つの構成——実行者単独、アドバイザー付きの実行者、そして低エフォートでのアドバイザーのモデル単独——に対して実行し、モデルリリースのたびに再確認せよ。リリースは能力差と価格比の両方を動かすからだ。その3つのうち最後のものが打ち破るべきベースラインだ。低エフォートでのアドバイザーのモデル単独が、ループと同じスコアをより少ないコストで出すなら、答えは出ている。
注目すべき2つの変数は、Anthropicが名付けたものである。能力ギャップ:実行者とアドバイザーの間の広いギャップこそ、アドバイザーがその報酬を稼ぐ場所であり、Opus 5.5はそのギャップを下から狭めた。相談率:向上分はほぼ1対1でそれに追随し、そしてそれは崩壊してしまうほどプロンプトに敏感である——低エフォートの実行者は自分が行き詰まっていることに気づかなくなり、デフォルトのエフォートでほとんどのタスクを相談するペアリングが、ほぼゼロにまで落ち込むこともある。Anthropicが提供するシステムプロンプトは、実質的な作業の前に1回、終える前に1回のアドバイザー呼び出しを求めており、これは1タスクあたり2〜3回の相談になる。3.5ポイントの向上を生み出したコーディングのペアリングは、その頻度で実行していた。そのための予算を確保し、上限を設け、それを超える相談はすべて、タスクが難しかったからではなく、実行者が誤設定されている証拠として扱うこと。
この記事の特定のループでは、3つの具体的な設定がほとんどの仕事をこなします。Claude Opus 5.5 は high に手を伸ばすのではなく、デフォルトの medium effort のままにしてください。effort はコストを直接左右しますし、Anthropic 自身の Opus 5.5 の数値は medium がほとんど犠牲にしないことを示しているからです。advisor は /advisor fable で設定し、バナーが実際に表示されることを確認してください。バナーが欠けているということは、advisor が音もなく存在していないことを意味します。そして、このパターンをスケールさせる前に、トークンあたりの価格ではなく、完成したタスクあたりのトークンを測定してください。ループが動かすことになっているのはその数値だからです。
よくある質問
アドバイザーは、Fableセッションと同じFableの利用枠を消費しますか?
API課金では、アドバイザーのトークンはFable 5.1自身の入力および出力レートで課金され、アドバイザーのレート制限は、そのモデルへの直接呼び出しと同じモデル単位のバケットから消費されます。そのため、レート制限に達したアドバイザー呼び出しは、リクエストを失敗させるのではなく、ツール結果内のエラーとして現れます。サブスクリプションプランでは、アドバイザーの使用量はプランの使用制限に算入されます。ただし、Fableの使用量が使用クレジットに課金されるプランでは、Fableアドバイザーは使用クレジットに課金されます。実務上の帰結として、アドバイザーは自由に使える別枠の予算ではなく、そのモデルで行う他のあらゆることと競合します。
アドバイザーは実際に何を見ることができるのですか?
ツール呼び出しとツール結果のすべて——ファイルの中身、コマンド出力、エラーメッセージ、その一切を含む会話全体。これは Anthropic が提供する専用のシステムプロンプトの下で動作し、計画、修正、または停止シグナルを返す。そこから二つの詳細が導かれる。第一に、各相談はトランスクリプト全体を再読するため、コストは一定ではなくループとともに増大する。第二に、あなたのセッションが、アドバイザーの料金階層にある第二のモデルには送りたくない資料に触れている場合、そのアドバイザーはそのすべてを読む第二のモデルである。
何が答えを変えるだろうか
2つのことがあり、どちらも見た目より差は小さい。独立系のベンチマーカーが Opus 5.5 対 Fable 5.1 の同一エフォート条件での実行を公開し、Anthropic が主張する差の縮小を確認すれば、ほとんどのタスクでアドバイザーに残る優位性はわずかであり、ループはデフォルトではなく難所のためのツールになる。逆に相談率が維持され、長いエージェント作業で能力差が大きいままなら、上記の算数こそがあなたが選んでいるものになり、$14 の実行に対する $6 の助言は、間違ったものを出荷しないための安価なオプションである。
変わることのないのは、この記事の冒頭で述べている仕組みだ。実行者(executor)のコンテキストはキャッシュされ、安価である。助言者(advisor)のコンテキストはどちらでもない。タスクの途中でより高価なモデルに問い合わせるループは、来月の価格表がどう言おうと、その非対称性を引き継ぐ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
