主視覺標題卡,標題為「Claude Opus 5.5 執行,Claude Fable 5.1 提供建議」,副標題為「為 Claude Code 的顧問迴圈定價」,一張由左至右的圖表,顯示 Fable 5.1 撰寫計畫、Opus 5.5 執行迴圈,以及一個標示為「提供建議並驗證」的弧形回饋箭頭,右下角則有 OrcaRouter 標誌。
Guides & Insights

Claude Opus 5.5 負責執行,Claude Fable 5.1 負責建議:為 Claude Code 的顧問迴圈定價

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

Claude Fable 5.1負責撰寫設計計畫。Claude Opus 5.5則以迴圈方式執行它。Fable 5.1 接著回頭擔任顧問,決定接受或否決結果。這就是 X/@dotey 在 2026 年 9 月 22 日——也就是該廠商發表 Claude Opus 5.5 的當天——所貼出的模式,並把它定調為在成本壓力下談成的省 token 安排:把顧問設成 Fable,跑 Opus,讓昂貴的模型只在決策點開口。他們所用的已不再是什麼提示技巧或子代理設定,而是 Claude Code 內建的顧問工具——一項伺服器端功能,除了主模型的一切花費之外,還按顧問模型的費率另行計費。而建議本身只是便宜的那一半。為了產出建議而重讀整段對話可不是——執行者的上下文重讀起來已經變便宜了,顧問的上下文卻從來都不便宜。正是這項不對稱決定了這個迴圈值不值得跑,而本文接下來要算的,就是這筆帳。

迴圈實際上是什麼

顧問工具會將你的主要模型與第二個、通常更強大的模型配對,Claude 會在關鍵時刻諮詢這個模型——在確定採用某種做法之前、當錯誤反覆出現時,或在宣告任務完成之前。顧問會收到完整對話,包括每一次工具呼叫及其結果,並回傳指引,再由主要模型套用。它永遠不會呼叫工具,也永遠不會產生面向使用者的輸出。由你選擇要由哪個模型提供建議;Claude 則決定何時呼叫它。

最後這部分,正是它與 Claude Code 社群在八月間流傳的編排器與子代理模式之間的區別所在。子代理是委派:規劃器將工作分解並分派給工作者,而你會為每個通道明確配置模型。顧問則是升級:由一個模型驅動整個任務,而昂貴的模型會在進行途中被拉進來,處理驅動模型無法獨自做出的決定。這裡沒有工作者池,沒有任務圖,也沒有需要維護的編排提示。@dotey 所描述的實用迴圈——規劃、執行、驗證、重複——就是當你把顧問指向 Fable 5.1,並讓它監管迴圈的退出條件時,這個機制的樣貌。

Anthropic 自己對這套策略的闡述,直白點出了這種勝利形態的本質:顧問「只能移交執行者所欠缺的能力」。以下一切,都取決於實際上欠缺多少能力,以及執行者多常承認這一點。

為什麼 Claude Opus 5.5 改變了算術

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Anthropic 公佈的價目表,以每百萬個 token 計。這些是廠商提供的數字,並非估計:

• Claude Opus 5.5 — 輸入 $4、輸出 $20、快取讀取 $0.20、5 分鐘快取寫入 $5

Claude Opus 5 — 輸入 $5、輸出 $25、快取讀取 $0.50、5 分鐘快取寫入 $6.25

• Claude Fable 5.1 — 輸入 $10、輸出 $50、快取讀取 $0.25、5 分鐘快取寫入 $12.50

那份清單中有兩個細節比頭條價格更重要。首先,根據 Anthropic 自家的註腳,Opus 5.5 的快取讀取費用是基礎輸入的 5%,而大多數 Claude 模型為 10%,Fable 5.1 則是 2.5%。Fable 5.1 的倍率更漂亮,但在絕對金額上仍然落敗——$0.20 對上 $0.25——因為它的基礎輸入費率高出兩倍半。

第二,而這正是整個循環得以成立的機制:在 Claude Code 中切換顧問並不會使主模型的提示快取失效,因此執行器那冗長、反覆重新傳送的上下文仍能保持低廉,每百萬只要 $0.20。顧問本身對對話的讀取不會被快取。每次諮詢都會重新處理完整的逐字稿,以 Fable 5.1 每百萬輸入 $10 的費率計價。一個會重新讀取 500K 符元上下文十次的執行器,只需支付快取讀取費用;而一個被諮詢十次的顧問,則會對一份始終在增長的逐字稿支付十次全新的輸入費用。執行器的上下文越便宜,顧問未經快取的讀取就越顯突出——而 Opus 5.5 才剛讓執行器的上下文比 Opus 5 便宜了 60%。

在 Claude Code 中設定

顧問工具屬實驗性,Anthropic 也在工作階段橫幅中說明了這一點——「Advisor Tool(實驗性)已開啟,且可能使用更多 token。」其行為、定價與可用性可能變更。在說明這項但書後,其運作機制已有文件記載:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• 使用/advisor fable 開啟,或執行/advisor,不帶引數即可顯示選擇器。所選項目會儲存到使用者設定中的advisorModel 設定,並在工作階段之間持續保留。/advisor off 則會將其關閉。

• 若只想在單一工作階段中使用,而不變更已儲存的預設值,請以下列指令啟動:claude --advisor fable。此旗標並未列在 claude --help 中,而且若配對組合無效,Claude Code 會在啟動時直接結束,而不會以默默忽略顧問的方式啟動。

• 在您的設定檔案中使用以下內容設定永久預設值:{"advisorModel": "fable"}

• 若要完全停用它,請設定 CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 —— /advisor 指令會消失,且任何已設定的 advisorModel 都會被忽略。

• 配對的模型能力必須至少與主模型相當。Claude Opus 5.5 接受 Fable 與 Opus 5 或更新版本作為顧問。Opus 4.6 或 Sonnet 顧問會被 Claude Code 拒絕;Opus 4.7 或 Opus 4.8 顧問雖會被掛上,但隨即遭 API 拒絕。以 Fable 5.1 作為主模型時,只接受 Fable 5.1。

• 版本門檻:advisor 工具需要 Claude Code v2.1.98 或更新版本;Fable 無論作為主模型或 advisor,都需要 v2.1.170 或更新版本;Fable 5.1 需要 v2.1.257 或更新版本。/advisor 的權杖形式——也就是可在 -p、Agent SDK、桌面應用程式與 Remote Control 中使用的形式——需要 v2.1.260 或更新版本。

• 此顧問功能僅適用於 Anthropic API。它不適用於 Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 的 Agent Platform 或 Microsoft Foundry,且它依賴功能旗標擷取,因此若工作階段設有像 DISABLE_TELEMETRY 這樣的變數,就會使其維持關閉。

• 在 Fable 用量以使用額度計費的方案中,Fable-as-advisor 也以相同方式計費,並需要一次性同意。在您接受之前,/advisor fable 不會儲存,且 claude --advisor fable 會在啟動時結束,並引導您前往 /model fable,作為替代。

子代理會繼承你所設定的任何顧問,並針對自己的模型重新執行相同的配對檢查。這就是這個模式與子代理模式之間唯一的交互作用:執行較小模型的子代理,可能被允許使用其父代理所不被允許的顧問。

成本結構,逐步推演

以下都不是實測數據。這裡的 token 形狀是為了讓算術一目了然而虛構的;價格是 Anthropic 公布的費率。假設有一個執行者工作階段,讀取 1M 個全新輸入 token,並產生 500K 個輸出 token;另有三次顧問諮詢,每次重新讀取 200K token 的逐字稿,並回傳約 600 token 的指引——大致相當於 Anthropic 自家系統提示所要求的每項任務二到三次諮詢。

• 在 Claude Opus 5.5 上執行 — 100 萬輸入量為 $4.00,加上 50 萬輸出量為 $10.00 = $14.00

• Claude Fable 5.1 的 Advisor — 600K 輸入量為 $6.00,加上約 1,800 個輸出權杖、費用約 $0.09 = $6.09

• 迴圈,總計——約 $20.09

• 在 Fable 5.1 上端到端執行相同的配置 — $10.00 輸入加上 $25.00 輸出 = $35.00

• 單獨在 Opus 5.5 上的相同形態 — $14.00

這個迴圈落在兩者之間,而這正是 Anthropic 為它設定的定位:比全程運行 Fable 5.1 便宜約 43%,比單獨使用執行器貴約 44%。請把第二個數字視為誠實的那一個。顧問不是一種節省;它是在三項決策上購買 Fable 等級的判斷力,而且只有在這三項決策改變結果時才划算。把逐字稿推送到 1M 上下文視窗,每次諮詢本身就要花 10 美元。如果讓執行器在大多數任務上開始詢問,而不是只有少數幾個,你就是在整個工作負載上支付顧問費率——此時,正如 Anthropic 所說,直接運行顧問的模型本身才是達到相同分數的更便宜途徑。

Anthropic 自家的測量結果怎麼說

Anthropic 已針對這個模式發布了實測結果,而這些結果屬於廠商自行回報:由同時銷售這兩款模型的公司,在其自家的基準測試框架上執行。它們仍是同類數據中僅有的一份,而且其中也包含了反對這個模式的論據,這正是它們值得細讀的原因。

• Opus 5 擔任執行者、Fable 5.1 擔任顧問,在 Anthropic 內部的代理式程式設計基準測試中,每次嘗試花費 7.69 美元——這是 Anthropic 所測得最準確的組態。這比單獨使用 Opus 5 在其預設設定下高出 3.5 個百分點,而花費略低;也比單獨使用 Fable 5.1 高出約 2.5 個百分點,但花費約為其 1.5 倍。這 3.5 個百分點的差距,是藉由每項任務五次嘗試,與逐次執行之間的雜訊區隔開來。

• 在圖表解讀上,同樣的搭配在誤差範圍內與單獨以中等投入運行的 Fable 5.1 打成平手——65.0 對 67.5——但每項任務成本約為其 2.6 倍,因為幾乎每項任務都諮詢了顧問。

• 在 GPQA Diamond 上,增益幾乎完美地對應能力差距:Haiku 4.5 執行者獲益良多,Sonnet 5 執行者提升了幾分,而前沿執行者則幾乎毫無增益。

• 諮詢率是那個脆弱的變數。一個低投入的 Sonnet 5 執行者搭配顧問後,在 DeepSWE 上提升了 23 分;但到了 SWE-bench Pro 上,它卻完全不再提問,結果毫無增益。

• 延遲:每個任務約多出兩次前沿模型呼叫,且每次都在關鍵路徑上。

那項證據有兩件事,直接關係到本週這個循環的現況。那些量測以 Opus 5 作為執行者,因為在進行時 Opus 5.5 還不存在。而 Anthropic 報告指出,Opus 5.5 在大多數工作上表現達到 Fable 5.1 的水準,執行成本卻低 40%——這兩點都是廠商說法,都未經獨立重現。如果執行者與顧問之間的落差,正是顧問收費所要彌補的東西,那麼落差變窄,這筆買賣就變小了。Opus 5.5 上市時,這個模式並沒有變得更糟;只是它所販售的東西變得不再那麼稀缺了。

你實際上會遇到的失敗模式

這些都是有文件記載的行為,並非憑空猜測,而第一項正是為什麼你在除錯任何東西之前,應該先閱讀本節的原因:

• 悄悄缺席的顧問。如果 API 拒絕顧問配對,Claude Code 會附加它,API 拒絕它,接著 Claude Code 會重新送出不含顧問的請求。之後的對話就會在沒有顧問、也沒有任何錯誤訊息的情況下繼續進行。它會一直保持關閉,直到/clear/compact,即使你切換到相容的主模型也一樣。

• 一種是悄悄被拒絕的情況。對於 Claude Code 本身會拒絕的配對組合,顧問根本不會被掛到主模型的請求上。/advisor 的輸出結果和通知會告訴你——但不會有任何東西失敗,所以你以為正在提供建議的工作階段,可能從來就沒有過。

• 你尚未給予的同意。當 Fable 被選為需要用量額度同意的計畫的顧問時,在你接受之前,請求會在不含顧問的情況下送出。以 --advisor fable 啟動的背景工作階段會在不含顧問的情況下啟動,而不是直接結束。

• 你無法控制的允許清單。若你組織的 availableModels 允許清單未包含 advisor 模型,Claude Code 就不會呼叫它,而你必須使用 /advisor 挑選一個允許的模型。

• 在所有不存在的地方。僅限 Anthropic API:沒有 Bedrock,沒有 AWS 上的 Claude Platform,沒有 Google Cloud Agent Platform,沒有 Microsoft Foundry。透過閘道使用時,可用性取決於該閘道是否將請求原封不動地轉發至 Anthropic 的 API——這是閘道本身的特性,不是你可以預設的事。

OrcaRouter 的定位

這個迴圈中的兩個模型現已上架 OrcaRouter,以 Anthropic 自家的表定價格、零加成提供——供應商表定價格原樣傳遞,因此你看到的費率就是 Anthropic 公布的費率。Claude Fable 5.1 的代號為 anthropic/claude-fable-5.1,而 Claude Opus 5 為 anthropic/claude-opus-5,兩者共用同一組 API 金鑰。Claude Opus 5.5 目前尚未納入我們的路由;它可透過 Anthropic 自家的 API 及各大雲端服務取得,我們會據實說明,而不會含糊暗示。

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

在這裡,一把金鑰替你買到的是便宜地改變主意的能力。這個迴路的經濟效益取決於執行者與顧問之間的價格比,而這個比率在七週內變動了兩次——9 月 22 日的 Opus 5 到 Opus 5.5,以及 9 月 1 日的 Fable 5 到 Fable 5.1,後者把該模型的快取讀取費用從每百萬 $1.00 砍到 $0.25。這每一次變動都會改變「這個顧問到底值不值得」的答案,而檢驗這個答案不該需要再簽一份合約。自動容錯移轉是另一半:它讓你先把一部分流量指向一個你還摸不清特性的模型,同時以你已經熟悉的那個作為備援,而不是把一條正式環境路徑押在一張發布規格表上。而如果你是自行打造這個模式,而非使用 Claude Code 的內建工具,路由 DSL 能把數個模型組成單一次呼叫——在某個模型上跑規劃步驟,接著在另一個模型上跑執行步驟,全都藏身於同一個端點之後。

關於範圍,有一點必須老實說:顧問工具本身是在 Anthropic 的 API 上執行的伺服器端工具,因此路由層無法取代它。我們能做的是讓這些模型只差一把金鑰就能以定價取用,這樣一來,要保留還是捨棄顧問工具,就由你依自己的數據來決定。

如何為自己的工作負載做決定

Anthropic 自家的指引是正確的起點,而且它不濫情得令人耳目一新:用三種配置來跑你的 eval 套件——執行者單獨運作、執行者搭配顧問,以及顧問的模型單獨以低強度運作——並在每次模型發布時重新檢查,因為每次發布都會同時改變能力差距與價格比。這三者中的最後一項,是要超越的基準。如果你的顧問模型單獨以低強度運作,得分與這個迴圈相同,但花費更少,那你就得到答案了。

值得關注的兩個變數,就是 Anthropic 所命名的那兩個。能力落差:執行者與顧問之間的落差越大,顧問才越有價值,而 Opus 5.5 從下方縮小了這個落差。諮詢率:收益幾乎與它一比一連動,而且它對提示詞敏感到足以崩跌——低投入程度的執行者可能不再察覺自己卡住了,而在預設投入程度下於大多數任務都會諮詢的搭配,可能掉到幾乎為零。Anthropic 提供的系統提示要求在實質工作開始前呼叫顧問一次,並在完成前再呼叫一次,這樣每項任務會落在二到三次諮詢;產生 3.5 點增益的那個程式開發搭配,就是照這個節奏運作的。以此編列預算、設下上限,並把超出此數的每一次諮詢都視為你的執行者設定有誤的訊號,而不是任務本身很困難。

就本文所談的這個特定迴圈來說,三項具體設定便扛下了大部分的工作。讓 Claude Opus 5.5 維持預設的中等投入程度,不要刻意調到高,因為投入程度會直接推升成本,而 Anthropic 自家的 Opus 5.5 數據顯示,中等設定讓掉的效能微乎其微。用 /advisor fable 設定顧問,並確認橫幅確實有出現——橫幅沒出現,就表示顧問悄悄缺席了。而在你擴大套用這套模式之前,請衡量每項完成任務所耗的 token 數,而不是每個 token 的價格,因為那才是這套迴圈應該推動的數字。

常見問題

顧問是否會消耗與 Fable 工作階段相同的 Fable 額度?

在 API 計費方面,advisor 的 token 依照 Fable 5.1 本身的輸入與輸出費率計費,而 advisor 的速率限制與直接呼叫該模型時共用同一個按模型劃分的配額桶——因此,受到速率限制的 advisor 呼叫會以工具結果中的錯誤呈現,而不是讓你的請求失敗。在訂閱方案中,advisor 的使用量會計入你方案的使用限制,但若某方案中 Fable 的使用量是以使用額度計費,則 Fable advisor 也以使用額度計費。實際的結果是,advisor 並不是你能隨意花用的獨立預算;它會與你在該模型上做的其他一切互相競爭。

顧問實際上究竟能看到什麼?

整段對話,包括每一次工具呼叫與每一項工具結果——檔案內容、命令輸出、錯誤訊息,全都包含在內。它會在自己由 Anthropic 提供的系統提示下執行,並回傳一份計畫、一項修正或一個停止訊號。由此可推出兩個細節。第一,每一次諮詢都會重新讀取整份對話紀錄,這就是為什麼成本會隨著迴圈增長,而不是維持不變。第二,如果你的工作階段觸及你不會以顧問的價位等級傳送給第二個模型的資料,那麼顧問就是一個正在讀取這一切的第二個模型。

什麼會改變答案?

兩件事,而兩者都比表面上看起來更接近。如果獨立評測機構發表 Opus 5.5 對上 Fable 5.1 的同等投入測試,並證實 Anthropic 所宣稱的差距正在縮小,那麼顧問在大多數任務上僅存的優勢就很薄弱——而這個迴圈就成了處理困難尾端的工具,而非預設做法。反之,如果諮詢率維持不變,而能力差距在長時間的代理式工作上依然很大,那麼上面那筆算術就是你正在取捨的東西,而在一次 14 美元的執行上花 6 美元諮詢,是一張便宜的選擇權,買的是不會推出錯的東西。

不會改變的,是本文開頭的那個機制。執行者的上下文會被快取,成本低廉;顧問的上下文則兩者皆非。任何在任務中途諮詢更昂貴模型的迴圈,都會繼承這種不對稱,無論下個月的價目表怎麼說。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新