Hero-titelkort med rubriken ”Claude Opus 5.5 utför, Claude Fable 5.1 rådger” och underrubriken ”Prissättning av rådgivningsloopen för Claude Code”, ett diagram från vänster till höger som visar hur Fable 5.1 skriver planen, hur Opus 5.5 kör loopen och en böjd återkopplingspil märkt ”rådger och verifierar”, samt OrcaRouter-logotypen i det nedre högra hörnet.
Guides & Insights

Claude Opus 5.5 utför, Claude Fable 5.1 rådger: Prissättning av Claude Codes rådgivarloop

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Claude Fable 5.1 skriver designplanen. Claude Opus 5.5 kör den i en loop. Fable 5.1 kommer tillbaka som rådgivare och godkänner eller avvisar resultatet. Det är mönstret som X/@dotey publicerade den 22 september 2026 — dagen då leverantören släppte Claude Opus 5.5 — och som de ramade in som ett tokenbesparande arrangemang tillkommet under kostnadspress: ställ in rådgivaren på Fable, kör Opus och låt den dyra modellen tala bara vid beslutspunkter. Det de använder är inte längre ett promptknep eller en subagentkonfiguration. Det är Claude Codes inbyggda rådgivarverktyg, en serversidig funktion som debiteras enligt rådgivarmodellens taxa, ovanpå allt huvudmodellen gör av med. Och rådet är den billiga delen. Att läsa om konversationen för att ta fram det är det inte — utförarens kontext har blivit billig att läsa om, och rådgivarens var det aldrig. Den enda asymmetrin avgör om loopen är värd att köra, och det är vad resten av den här artikeln räknar hem.

Vad loopen egentligen är

Rådgivarverktyget parar din huvudmodell med en andra, vanligtvis starkare modell som Claude konsulterar vid avgörande tillfällen – innan den bestämmer sig för ett tillvägagångssätt, när ett fel fortsätter återkomma, eller innan den förklarar en uppgift som klar. Rådgivaren tar emot hela konversationen, inklusive varje verktygsanrop och dess resultat, och returnerar vägledning som huvudmodellen sedan tillämpar. Den anropar aldrig verktyg och producerar aldrig utdata riktad till användaren. Du väljer vilken modell som ger råd; Claude bestämmer när den ska anropas.

Den sista delen är det som skiljer detta från det orchestrator- och subagentmönster som cirkulerade inom Claude Code-gemenskapen i augusti. Subagenter är delegering: en planerare delar upp arbetet och skickar ut det till arbetare, och du konfigurerar varje spårs modell explicit. Rådgivaren är eskalering: en modell driver hela uppgiften, och den dyra modellen kopplas in mitt i körningen för ett beslut som den drivande modellen inte kan fatta på egen hand. Det finns ingen arbetarpool, ingen uppgiftsgraf och ingen orkestreringsprompt att underhålla. Den praktiska loopen som @dotey beskriver – planera, utför, verifiera, upprepa – är hur den mekanismen ser ut när du riktar rådgivaren mot Fable 5.1 och låter den bevaka loopens avslutningsvillkor.

Anthropics egen formulering av strategin är krass om vinstens form: rådgivaren "kan bara överlämna förmåga som utföraren saknar." Allt nedan följer av hur mycket förmåga som faktiskt saknas, och hur ofta utföraren erkänner det.

Varför Claude Opus 5.5 ändrade matematiken

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Anthropics publicerade prislista, per miljon tokens. Detta är leverantörens siffror, inte uppskattningar:

• Claude Opus 5.5 — 4 USD inmatning, 20 USD utmatning, 0,20 USD cacheläsning, 5 USD för en cacheskrivning på 5 minuter

Claude Opus 5 — $5 inmatning, $25 utmatning, $0,50 cacheläsning, $6,25 för en 5-minuters cacheskrivning

• Claude Fable 5.1 — $10 inmatning, $50 utmatning, $0,25 cacheläsning, $12,50 för en 5-minuters cacheskrivning

Två detaljer i den listan spelar större roll än rubrikpriserna. För det första: cache-läsningar på Opus 5.5 utgör 5 % av basindata, enligt Anthropics egen fotnot, medan de flesta Claude-modeller ligger på 10 % och Fable 5.1 ligger på 2,5 %. Fable 5.1 har den bättre multiplikatorn och förlorar ändå i absoluta dollar — 0,20 mot 0,25 — eftersom dess basindatarate är två och en halv gånger högre.

För det andra, och det här är mekaniken som loopen hänger på: att slå på/av rådgivaren i Claude Code ogiltigförklarar inte huvudmodellens prompt-cache, så exekutörens långa kontext, som skickas om och om igen, förblir billig på $0,20 per miljon. Rådgivarens egen läsning av konversationen cachas inte. Varje konsultation bearbetar hela transkriptet på nytt, till Fable 5.1:s indatapris på $10 per miljon. En exekutör som läser om ett kontext på 500K tokens tio gånger betalar för cache-läsningar; en rådgivare som konsulteras tio gånger betalar tio nya räkningar för indata på ett transkript som växer hela tiden. Ju billigare din exekutörs kontext blir, desto mer sticker rådgivarens ocachade läsning ut — och Opus 5.5 gjorde nyss exekutörens kontext 60 % billigare än Opus 5:s.

Ställa in det i Claude Code

Rådgivaren är experimentell och Anthropic säger det i sessionsbannern — "Advisor Tool (experimental) är på och kan använda fler tokens." Beteende, prissättning och tillgänglighet kan ändras. Med det förbehållet sagt är mekaniken dokumenterad:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Slå på den med /advisor fable, eller kör /advisor utan argument för att få en väljare. Valet sparas i inställningen advisorModel i dina användarinställningar och bevaras mellan sessioner. /advisor off stänger av den.

• För en enskild session utan att ändra den sparade standardinställningen, starta med claude --advisor fable. Flaggan listas inte i claude --help, och Claude Code avslutas vid start om parkopplingen är ogiltig i stället för att starta med en tyst ignorerad advisor.

• Ange ett beständigt standardvärde i din inställningsfil med {"advisorModel": "fable"}.

• För att stänga av det helt, ställ in CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — kommandot /advisor försvinner och eventuell konfigurerad advisorModel ignoreras.

• Parningen måste vara minst lika kapabel som huvudmodellen. Claude Opus 5.5 accepterar Fable och Opus 5 eller senare som rådgivare. En Opus 4.6- eller Sonnet-rådgivare avvisas av Claude Code; en Opus 4.7- eller Opus 4.8-rådgivare läggs till och avvisas sedan av API:et. Fable 5.1 som huvudmodell accepterar endast Fable 5.1.

• Minsta versioner: advisor-verktyget kräver Claude Code v2.1.98 eller senare; Fable som antingen huvudmodell eller advisor kräver v2.1.170 eller senare; Fable 5.1 kräver v2.1.257 eller senare. Tokenformen av /advisor – den som fungerar i -p, Agent SDK, skrivbordsappen och Remote Control – kräver v2.1.260 eller senare.

• Rådgivaren är endast tillgänglig via Anthropic-API. Den är inte tillgänglig på Amazon Bedrock, Claude Platform on AWS, Google Cloud's Agent Platform eller Microsoft Foundry, och den är beroende av att hämta funktionsflaggor, så en session med en variabel som DISABLE_TELEMETRY satt håller den avstängd.

• På planer där Fable-användning debiteras mot användningskrediter debiteras Fable som rådgivare på samma sätt och kräver ett engångsgodkännande. Tills du accepterar det /advisor fable sparas inte och claude --advisor fable avslutas vid start och hänvisar dig till /model fable i stället.

Subagenter ärver vilken rådgivare du än har konfigurerat och kör om samma parkopplingskontroll mot sin egen modell. Det är den enda interaktionen mellan detta mönster och subagentmönstret: en subagent som kör en mindre modell kan tillåtas en rådgivare som dess förälder inte tillåts.

Kostnadsformen, genomarbetad

Inget av det följande är en mätning. Tokenformen är påhittad för att göra aritmetiken synlig; priserna är Anthropics publicerade priser. Anta en executor-session som läser 1M färska indatatokens och skickar ut 500K utdatatokens, samt tre advisor-konsultationer, där var och en läser en 200K-token-transkription igen och returnerar ungefär 600 tokens vägledning — ungefär de två till tre konsultationer per uppgift som Anthropics egen systemprompt ber om.

• Executor på Claude Opus 5.5 — 1M indata för $4.00 plus 500K utdata för $10.00 = $14.00

• Rådgivare på Claude Fable 5.1 — 600K indata till $6,00 plus cirka 1 800 utdatatoken till ungefär $0,09 = $6,09

• Loopen, totalt — cirka $20.09

• Samma formkörning från början till slut på Fable 5.1 — $10.00 indata plus $25.00 utdata = $35.00

• Samma form med enbart Opus 5.5 — $14.00

Loopen hamnar mellan de två, vilket är precis där Anthropic positionerar den: cirka 43 % billigare än att köra Fable 5.1 genomgående, och cirka 44 % dyrare än enbart utföraren. Läs den andra siffran som den ärliga. Rådgivaren är inte en besparing; den är ett köp av omdöme på Fable-nivå i tre beslut, och den lönar sig bara om de tre besluten förändrar utfallet. Skicka transkriptet till 1M-kontextfönstret, och varje konsultation kostar $10 i sig. Låt utföraren börja be om råd vid de flesta uppgifter i stället för några få, och du betalar rådgivarpriser över hela arbetsbelastningen – och då, som Anthropic uttrycker det, är den billigare vägen till samma poäng att köra rådgivarens modell själv.

Vad Anthropics egna mätningar säger

Anthropic har publicerat uppmätta resultat för detta mönster, och de är leverantörsrapporterade: utförda av företaget som säljer båda modellerna, i sin egen benchmarkrigg. De är fortfarande de enda siffrorna i sitt slag, och de inkluderar argumenten mot mönstret, vilket är anledningen till att de är värda att läsa noga.

• Opus 5 som utförare med Fable 5.1 som rådgivare fick 7,69 dollar per försök i Anthropics interna agentiska kodningsbenchmark – den mest träffsäkra konfiguration Anthropic mätte. Det är 3,5 poäng över Opus 5 ensam med sin standardinställning för något mindre pengar, och omkring 2,5 poäng över Fable 5.1 ensam för ungefär en och en halv gång så mycket pengar. Gapet på 3,5 poäng avskildes från brus mellan körningar med fem försök per uppgift.

• Samma parkoppling matchade Fable 5.1 ensam vid medelhög ansträngning inom brusnivån på diagramläsning – 65,0 mot 67,5 – till ungefär 2,6 gånger kostnaden per uppgift, eftersom rådgivaren konsulterades för nästan varje uppgift.

• På GPQA Diamond följer vinsten förmågegapet nästan perfekt: en Haiku 4.5-utförare vann mycket, en Sonnet 5-utförare några poäng, och en frontier-utförare nästan ingenting.

• Rådfrågningsfrekvensen är den bräckliga variabeln. En Sonnet 5-exekutor med låg ansträngning ökade med 23 poäng på DeepSWE med en rådgivare, men slutade sedan att fråga helt och hållet på SWE-bench Pro och vann ingenting.

• Latens: ungefär två extra anrop till frontier-modeller per uppgift, var och ett på den kritiska vägen.

Två saker i den evidensen har direkt bäring på loopen så som den ser ut den här veckan. Mätningarna använde Opus 5 som utförare, eftersom Opus 5.5 inte existerade när de kördes. Och Anthropic rapporterar att Opus 5.5 presterar på nivån för Fable 5.1 i de flesta arbeten samtidigt som den kostar 40 % mindre att köra – båda är leverantörspåståenden, och inget av dem har reproducerats oberoende. Om gapet mellan utförare och rådgivare är det som rådgivaren får betalt för att överbrygga, då är ett snävare gap ett mindre köp. Mönstret blev inte sämre när Opus 5.5 släpptes; det den säljer blev mindre sällsynt.

Felmoderna du faktiskt kommer att stöta på

Dessa är dokumenterade beteenden, inte spekulation, och den första är anledningen till att läsa det här avsnittet innan du felsöker något:

• En tyst frånvarande rådgivare. Om API:et nekar rådgivarparkopplingen kopplar Claude Code in den, API:et nekar, och Claude Code skickar om begäran utan rådgivaren. Resten av konversationen körs då utan rådgivare och utan felmeddelande. Den förblir avstängd tills /clear eller /compact, även efter att du har bytt till en kompatibel huvudmodell.

• En tyst avvisad. För kombinationer som Claude Code själv avvisar kopplas rådgivaren helt enkelt aldrig till huvudmodellens förfrågningar. Utdata från /advisor och en avisering talar om det för dig – men inget misslyckas, så en session som du antog gav råd kanske aldrig gjorde det.

• Samtycke som du inte har gett. När Fable har valts som rådgivare i en plan som kräver samtycke till användningskrediter skickas förfrågningar ut utan rådgivaren tills du accepterar det. En bakgrundssession som startas med --advisor fable startar utan rådgivare i stället för att avslutas.

• En tillåtelselista som du inte kontrollerar. Om din organisations availableModels-tillåtelselista utesluter advisor-modellen, kommer Claude Code inte att anropa den, och du behöver välja en tillåten modell med /advisor.

• Överallt där det inte finns. Endast Anthropic API: ingen Bedrock, ingen Claude Platform på AWS, ingen Google Cloud Agent Platform, ingen Microsoft Foundry. Via en gateway beror tillgängligheten på om gatewayen vidarebefordrar begäran intakt till Anthropics API – vilket är en egenskap hos gatewayen, inte något man kan förutsätta.

Var OrcaRouter passar

Båda modellerna i den här loopen finns på OrcaRouter idag till Anthropics eget listpris med 0 % påslag — leverantörens listpris förs vidare oförändrat, så priset du ser är priset som Anthropic publicerar. Claude Fable 5.1 finns på anthropic/claude-fable-5.1 och Claude Opus 5 på anthropic/claude-opus-5, bakom en enda API-nyckel. Claude Opus 5.5 är ännu inte en av våra rutter; den finns tillgänglig via Anthropics eget API och de stora molntjänsterna, och det säger vi hellre än att antyda något annat.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Vad en enda nyckel ger dig här är förmågan att ändra dig billigt. Loopens ekonomi beror på prisförhållandet mellan utförare och rådgivare, och det förhållandet ändrades två gånger under sju veckor — Opus 5 till Opus 5.5 den 22 september, och Fable 5 till Fable 5.1 den 1 september, vilket sänkte den modellens cacheläsning från $1.00 till $0.25 per miljon. Var och en av dessa ändringar förändrar svaret på "är rådgivaren värd det," och att testa det svaret borde inte kräva ett andra kontrakt. Automatisk felväxling är den andra halvan: den låter dig rikta en del av trafiken mot en modell som du ännu inte har karakteriserat, med en reservlösning till den du har, i stället för att satsa en produktionsväg på en lanseringstabell. Och om du bygger mönstret själv i stället för att använda Claude Codes inbyggda verktyg, komponerar routing-DSL:en flera modeller till ett enda anrop — ett plansteg på en modell följt av exekveringssteg på en annan, bakom en enda slutpunkt.

En ärlig kommentar om omfattningen: advisor-verktyget i sig är ett serververktyg som körs på Anthropics API, så ett routinglager är ingen ersättning för det. Det vi kan göra är att göra så att modellerna bara är en nyckel bort, till listpris, så beslutet att behålla eller ta bort advisor-verktyget är ditt att fatta utifrån dina egna siffror.

Hur du bestämmer för din egen arbetsbelastning

Anthropics egen vägledning är rätt utgångspunkt och den är uppfriskande osentimental: kör din utvärderingssvit mot tre konfigurationer – utföraren solo, utföraren med en rådgivare, och rådgivarens modell ensam vid låg ansträngning – och kontrollera igen vid varje modellsläpp, eftersom släpp förändrar både kapacitetsgapet och prisförhållandet. Den sista av de tre är baslinjen att slå. Om din rådgivares modell ensam vid låg ansträngning får samma resultat som loopen för mindre pengar har du ditt svar.

De två variablerna att hålla koll på är de som Anthropic namnger. Kapacitetsgapet: ett brett gap mellan utförare och rådgivare är där rådgivaren förtjänar sitt arvode, och Opus 5.5 minskade det gapet nedifrån. Konsultfrekvensen: vinster följer den nästan ett-till-ett, och den är tillräckligt promptkänslig för att kollapsa – en utförare vid låg ansträngning kan sluta märka att den har fastnat, och ett par som konsulterar på de flesta uppgifter vid standardansträngning kan falla till nästan noll. Anthropics medföljande systemprompt begär ett anrop till rådgivaren före egentligt arbete och ett före avslut, vilket landar på två till tre konsultationer per uppgift; kodningsparet som gav 3,5-punktsvinsten körde i den kadensen. Budgetera för det, sätt ett tak för det och behandla varje konsultation därutöver som en signal om att din utförare är felkonfigurerad snarare än att uppgiften var svår.

För den specifika loopen i den här artikeln gör tre konkreta inställningar det mesta av arbetet. Behåll Claude Opus 5.5 på standardinställningen medium effort i stället för att gå upp till high, eftersom effort direkt styr kostnaden och Anthropics egna Opus 5.5-siffror visar att medium ger upp väldigt lite. Ställ in advisor med /advisor fable och bekräfta att bannern faktiskt visas — en saknad banner betyder en tyst frånvarande advisor. Och innan du skalar mönstret, mät tokens per slutförd uppgift i stället för pris per token, eftersom det är siffran som loopen är tänkt att flytta.

Vanliga frågor

Förbrukar rådgivaren samma Fable-kvot som en Fable-session?

Vid API-fakturering debiteras rådgivartoken enligt Fable 5.1:s egna priser för indata och utdata, och rådgivarens frekvensgränser hämtas från samma per-modell-bucket som direkta anrop till den modellen — så ett frekvensbegränsat rådgivaranrop visas som ett fel i verktygsresultatet i stället för att få din begäran att misslyckas. På prenumerationsplaner räknas rådgivaranvändning mot din plans användningsgränser, förutom att en Fable-rådgivare debiteras mot användningskrediter i planer där Fable-användning gör det. Den praktiska konsekvensen är att rådgivaren inte är en separat budget som du kan spendera fritt; den konkurrerar med allt annat du gör på den modellen.

Vad får rådgivaren egentligen se?

Hela konversationen, inklusive varje verktygsanrop och varje verktygsresultat – filinnehåll, kommandoutdata, felmeddelanden, allt. Den körs under sin egen Anthropic-tillhandahållna systemprompt och returnerar en plan, en korrigering eller en stoppsignal. Två detaljer följer av det. För det första läser varje konsultation om hela transkriptet, vilket är varför kostnaden växer med loopen i stället för att förbli konstant. För det andra: om din session berör material som du inte skulle skicka till en andra modell till rådgivarens prisnivå, är rådgivaren en andra modell som läser allt.

Vad skulle ändra svaret

Två saker, och båda ligger närmare än de verkar. Om oberoende benchmarkare publicerar en körning med matchad ansträngning av Opus 5.5 mot Fable 5.1 och bekräftar den minskning som Anthropic hävdar, är rådgivarens återstående försprång på de flesta uppgifter tunt — och loopen blir ett verktyg för den svåra svansen snarare än ett standardval. Om konsultfrekvensen i stället håller i sig och förmågegapet förblir stort vid långt agentiskt arbete, är aritmetiken ovan vad du väljer mellan, och $6 i rådgivning på en $14-körning är en billig option för att inte leverera fel sak.

Det som inte kommer att förändras är mekaniken högst upp i den här artikeln. Executor-kontext är cachad och billig; advisor-kontext är ingetdera. Varje loop som konsulterar en dyrare modell mitt i en uppgift ärver den asymmetrin, oavsett vad prislistan säger nästa månad.

Jämförda i den här artikeln2

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen