Hero-titelkaart met als titel 'Claude Opus 5.5 voert uit, Claude Fable 5.1 adviseert' en als ondertitel 'Prijsstelling van de adviseurslus van Claude Code', een diagram van links naar rechts waarop Fable 5.1 het plan schrijft, Opus 5.5 de lus uitvoert en een gebogen feedbackpijl met het label 'adviseert en verifieert' staat, en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

Claude Opus 5.5 voert uit, Claude Fable 5.1 adviseert: prijsbepaling van Claude Code's advisor-lus

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Fable 5.1 schrijft het ontwerpplan. Claude Opus 5.5 voert het uit in een loop. Fable 5.1 komt terug als de adviseur en accepteert of verwerpt het resultaat. Dat is het patroon dat X/@dotey op 22 september 2026 plaatste — de dag dat de leverancier Claude Opus 5.5 uitbracht — en daarbij presenteerde als een tokenbesparende regeling die onder kostendruk tot stand was gekomen: zet de adviseur op Fable, laat Opus draaien en laat het dure model alleen op beslismomenten spreken. Wat ze gebruiken is niet langer een prompttruc of een subagent-configuratie. Het is de ingebouwde adviseurstool van Claude Code, een server-side functie die tegen de tarieven van het adviseursmodel wordt gefactureerd, bovenop alles wat het hoofdmodel uitgeeft. En het advies is het goedkope deel. Het gesprek opnieuw lezen om dat te produceren is dat niet — de context van de uitvoerder is goedkoop geworden om opnieuw te lezen, en die van de adviseur was dat nooit. Die ene asymmetrie bepaalt of de loop het draaien waard is, en dat is wat de rest van dit artikel doorrekent.

Wat de loop eigenlijk is

De adviseur-tool koppelt je hoofdmodel aan een tweede, doorgaans sterker model dat Claude op cruciale momenten raadpleegt — voordat het zich aan een aanpak vastlegt, wanneer een fout zich blijft herhalen, of voordat het een taak als voltooid beschouwt. De adviseur ontvangt het volledige gesprek, inclusief elke tool-aanroep en het bijbehorende resultaat, en retourneert richtlijnen die het hoofdmodel vervolgens toepast. De adviseur roept nooit tools aan en produceert nooit output voor de gebruiker. Jij kiest welk model advies geeft; Claude bepaalt wanneer het wordt aangeroepen.

Dat laatste deel is wat dit onderscheidt van het orchestrator-en-subagentpatroon dat de Claude Code-gemeenschap in augustus rondstuurde. Subagents zijn delegatie: een planner splitst werk op en stuurt het naar workers, en je configureert het model van elke lane expliciet. De advisor is escalatie: één model stuurt de hele taak aan, en het dure model wordt halverwege binnengehaald voor een beslissing die het sturende model niet alleen kan nemen. Er is geen workerpool, geen taakgraaf en geen orchestratieprompt om te onderhouden. De praktische lus die @dotey beschrijft — plannen, uitvoeren, verifiëren, herhalen — is hoe dat mechanisme eruitziet wanneer je de advisor op Fable 5.1 richt en hem de exitvoorwaarde van de lus laat bewaken.

Anthropics eigen framing van de strategie is ronduit duidelijk over de vorm van de winst: de adviseur "kan alleen capaciteit overdragen die de uitvoerder mist." Alles hieronder volgt uit hoeveel capaciteit er daadwerkelijk ontbreekt, en hoe vaak de uitvoerder dat toegeeft.

Waarom Claude Opus 5.5 de rekenkunde veranderde

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Het gepubliceerde tarievenoverzicht van Anthropic, per miljoen tokens. Dit zijn cijfers van de leverancier, geen schattingen:

• Claude Opus 5.5 — $4 invoer, $20 uitvoer, $0,20 cache-lezen, $5 voor een cache-schrijfactie van 5 minuten

Claude Opus 5 — $5 invoer, $25 uitvoer, $0,50 cache-lezen, $6,25 voor een cache-schrijfactie van 5 minuten

• Claude Fable 5.1 — $10 invoer, $50 uitvoer, $0,25 cache-lezen, $12,50 voor een cache-schrijfactie van 5 minuten

Twee details in die lijst zijn belangrijker dan de prijzen in de koppen. Ten eerste: cache-reads op Opus 5.5 bedragen 5% van de basisinvoer, volgens Anthropics eigen voetnoot, waar de meeste Claude-modellen op 10% zitten en Fable 5.1 op 2,5%. Fable 5.1 heeft de betere vermenigvuldigingsfactor en verliest toch op absolute dollars — $0,20 tegenover $0,25 — omdat het basistarief voor invoer tweeënhalf keer zo hoog is.

Ten tweede, en dit is het mechanisme waarop de loop draait: het in- en uitschakelen van de adviseur in Claude Code maakt de promptcache van het hoofdmodel niet ongeldig, dus de lange, herhaaldelijk opnieuw verzonden context van de executor blijft goedkoop tegen $0.20 per miljoen. De eigen lezing van het gesprek door de adviseur wordt niet gecacht. Elke consult verwerkt het volledige transcript opnieuw, tegen Fable 5.1's inputtarief van $10 per miljoen. Een executor die een context van 500K tokens tien keer opnieuw leest, betaalt voor cachereads; een adviseur die tien keer wordt geraadpleegd, betaalt tien keer een verse inputfactuur voor een transcript dat steeds maar groeit. Hoe goedkoper de context van je executor wordt, hoe meer de niet-gecachte lezing van de adviseur opvalt — en Opus 5.5 heeft de context van de executor net 60% goedkoper gemaakt dan die van Opus 5.

Instellen in Claude Code

De adviseur is experimenteel en Anthropic zegt dat ook in de sessiebanner — "Advisor Tool (experimental) staat aan en kan meer tokens gebruiken." Gedrag, prijsstelling en beschikbaarheid kunnen veranderen. Nu dat voorbehoud is vermeld, is de werking gedocumenteerd:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Schakel het in met /advisor fable, of voer /advisor uit zonder argument voor een keuzelijst. De keuze wordt opgeslagen in de advisorModel-instelling in je gebruikersinstellingen en blijft behouden tussen sessies. /advisor off schakelt het uit.

• Voor één sessie zonder de opgeslagen standaard te wijzigen, start met claude --advisor fable. De flag staat niet vermeld in claude --help, en Claude Code stopt bij het starten als de combinatie ongeldig is, in plaats van te starten met een stilzwijgend genegeerde adviseur.

• Stel een permanente standaard in je instellingenbestand in met {"advisorModel": "fable"}.

• Om het volledig uit te schakelen, stel CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 in — de /advisor-opdracht verdwijnt en elke geconfigureerde advisorModel wordt genegeerd.

• De combinatie moet minstens even capabel zijn als het hoofdmodel. Claude Opus 5.5 accepteert Fable en Opus 5 of later als adviseurs. Een Opus 4.6- of Sonnet-adviseur wordt afgewezen door Claude Code; een Opus 4.7- of Opus 4.8-adviseur wordt gekoppeld en vervolgens geweigerd door de API. Fable 5.1 als hoofdmodel accepteert alleen Fable 5.1.

• Minimumversies: de advisor-tool vereist Claude Code v2.1.98 of later; Fable als hoofdmodel of als advisor vereist v2.1.170 of later; Fable 5.1 vereist v2.1.257 of later. De tokenvorm van /advisor — degene die werkt in -p, de Agent SDK, de desktopapp en Remote Control — vereist v2.1.260 of later.

• De adviseur is alleen beschikbaar via de Anthropic-API. Hij is niet beschikbaar op Amazon Bedrock, Claude Platform on AWS, Google Cloud's Agent Platform of Microsoft Foundry, en hij is afhankelijk van het ophalen van feature flags, dus een sessie waarin een variabele zoals DISABLE_TELEMETRY is ingesteld, houdt hem uitgeschakeld.

• Bij abonnementen waarbij Fable-gebruik op gebruikscredits wordt gefactureerd, wordt Fable-als-adviseur op dezelfde manier gefactureerd en is een eenmalige toestemming vereist. Tot je die accepteert, /advisor fable niet wordt opgeslagen en claude --advisor fablestopt bij het opstarten en wijst je op /model fable in plaats daarvan.

Subagents erven welke adviseur je ook hebt geconfigureerd en voeren dezelfde koppelingscheck opnieuw uit voor hun eigen model. Dat is de enige interactie tussen dit patroon en het subagentpatroon: een subagent die een kleiner model draait, mag mogelijk een adviseur hebben die zijn bovenliggende agent niet mag hebben.

De vorm van de kosten, uitgewerkt

Niets hieronder is een meting. De tokenvorm is verzonnen om de rekensom zichtbaar te maken; de prijzen zijn de gepubliceerde tarieven van Anthropic. Ga uit van één executorsessie die 1M nieuwe invoertokens leest en 500K uitvoertokens produceert, en drie adviseurconsultaties, waarbij elke consultatie een transcript van 200K tokens opnieuw leest en ongeveer 600 tokens aan begeleiding retourneert — ruwweg de twee tot drie consultaties per taak waar de eigen systeemprompt van Anthropic om vraagt.

• Executor op Claude Opus 5.5 — 1 mln. invoer tegen $4,00 plus 500K uitvoer tegen $10,00 = $14,00

• Adviseur op Claude Fable 5.1 — 600K invoer tegen $6,00 plus ongeveer 1.800 uitvoertokens tegen circa $0,09 = $6,09

• De loop, totaal — ongeveer $ 20,09

• Dezelfde vorm end-to-end gedraaid op Fable 5.1 — $10,00 invoer plus $25,00 uitvoer = $35,00

• Dezelfde vorm alleen op Opus 5.5 — $14.00

De lus ligt tussen de twee in, precies waar Anthropic hem positioneert: ongeveer 43% goedkoper dan Fable 5.1 de hele tijd draaien, en ongeveer 44% duurder dan alleen de uitvoerder. Lees het tweede getal als het eerlijke getal. De adviseur is geen besparing; het is een aankoop van oordeelsvermogen op Fable-niveau bij drie beslissingen, en hij loont alleen als die drie beslissingen de uitkomst veranderen. Duw het transcript naar het 1M-contextvenster en elk consult kost op zichzelf $10. Laat de uitvoerder bij de meeste taken gaan vragen in plaats van bij een paar, en je betaalt adviseurtarieven over de hele werklast — op welk punt, zoals Anthropic het formuleert, het draaien van het model van de adviseur zelf de goedkopere route naar dezelfde score is.

Wat de eigen metingen van Anthropic zeggen

Anthropic heeft gemeten resultaten voor dit patroon gepubliceerd, en ze zijn door de leverancier gerapporteerd: uitgevoerd door het bedrijf dat beide modellen verkoopt, met zijn eigen benchmarkharnas. Het zijn nog steeds de enige cijfers in hun soort, en ze bevatten de argumenten tegen het patroon, daarom zijn ze de moeite waard om aandachtig te lezen.

• Opus 5 als uitvoerder met Fable 5.1 als adviseur scoorde $7,69 per poging op de interne agentische codeerbenchmark van Anthropic — de nauwkeurigste configuratie die Anthropic heeft gemeten. Dat is 3,5 punten hoger dan Opus 5 alleen met zijn standaardinstelling, voor iets minder geld, en ongeveer 2,5 punten hoger dan Fable 5.1 alleen, voor ongeveer anderhalf keer zoveel geld. Het verschil van 3,5 punten werd met vijf pogingen per taak onderscheiden van ruis tussen runs.

Dezelfde combinatie bij het lezen van grafieken evenaarde Fable 5.1 alleen op medium effort binnen de ruismarge — 65,0 tegen 67,5 — tegen ongeveer 2,6 keer de kosten per taak, omdat de adviseur bij bijna elke taak werd geraadpleegd.

• Op GPQA Diamond volgt de winst de capaciteitskloof bijna perfect: een Haiku 4.5-uitvoerder boekte een grote winst, een Sonnet 5-uitvoerder een paar punten, en een frontier-uitvoerder bijna niets.

• Consultatiepercentage is de kwetsbare variabele. Een Sonnet 5-executor met lage inspanning behaalde 23 punten op DeepSWE met een adviseur, maar stopte vervolgens helemaal met vragen stellen op SWE-bench Pro en behaalde niets.

• Latentie: ongeveer twee extra aanroepen naar frontier-modellen per taak, elk op het kritieke pad.

Twee dingen aan dat bewijs zijn direct van belang voor de lus zoals die er deze week voorstaat. De metingen gebruikten Opus 5 als uitvoerder, omdat Opus 5.5 nog niet bestond toen ze werden uitgevoerd. En Anthropic meldt dat Opus 5.5 bij het meeste werk op het niveau van Fable 5.1 presteert, terwijl het 40% minder kost om te draaien — beide beweringen van de leverancier, geen van beide onafhankelijk gereproduceerd. Als het gat tussen uitvoerder en adviseur is wat de adviseur betaald krijgt om te dichten, dan is een kleiner gat een kleinere aankoop. Het patroon werd niet slechter toen Opus 5.5 uitkwam; het ding dat het verkoopt, werd minder schaars.

De faalwijzen die je daadwerkelijk zult tegenkomen

Dit zijn gedocumenteerde gedragingen, geen speculatie, en de eerste is de reden om deze sectie te lezen voordat je iets debugt:

• Een stilzwijgend afwezige adviseur. Als de API de adviseur-koppeling weigert, voegt Claude Code deze toe, weigert de API deze, en stuurt Claude Code het verzoek opnieuw zonder de adviseur. De rest van het gesprek verloopt dan zonder adviseur en zonder foutmelding. Deze blijft uit tot /clear of /compact, zelfs nadat je bent overgestapt naar een compatibel hoofdmodel.

• Een stilletjes afgewezen geval. Voor combinaties die Claude Code zelf afwijst, wordt de advisor simpelweg nooit aan de verzoeken van het hoofdmodel gekoppeld. De /advisor-uitvoer en een melding vertellen het je — maar er mislukt niets, dus een sessie waarvan je aannam dat die advies gaf, heeft dat misschien nooit gedaan.

• Toestemming die je niet hebt gegeven. Als Fable als adviseur is geselecteerd voor een abonnement dat toestemming voor gebruikskrediet vereist, worden verzoeken zonder de adviseur verzonden totdat je die toestemming accepteert. Een achtergrondsessie die is gestart met --advisor fable begint zonder adviseur in plaats van af te sluiten.

• Een allowlist die u niet beheert. Als de availableModels-allowlist van uw organisatie het advisor-model uitsluit, zal Claude Code het niet aanroepen en moet u een toegestaan model kiezen met /advisor.

• Overal waar het niet bestaat. Alleen de Anthropic API: geen Bedrock, geen Claude Platform on AWS, geen Google Cloud Agent Platform, geen Microsoft Foundry. Via een gateway hangt de beschikbaarheid ervan af of de gateway het verzoek intact naar de API van Anthropic doorstuurt — wat een eigenschap van de gateway is, niet iets dat je kunt aannemen.

Waar OrcaRouter past

Beide modellen in deze lus staan vandaag op OrcaRouter tegen Anthropics eigen lijstprijs met 0% markup — de lijstprijs van de provider wordt doorgegeven, dus het tarief dat je ziet is het tarief dat Anthropic publiceert. Claude Fable 5.1 staat op anthropic/claude-fable-5.1 en Claude Opus 5 op anthropic/claude-opus-5, achter één API-sleutel. Claude Opus 5.5 is nog geen van onze routes; het is beschikbaar via Anthropics eigen API en de grote clouds, en dat zullen we zeggen in plaats van iets anders te suggereren.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Wat één sleutel je hier oplevert, is de mogelijkheid om je mening goedkoop te herzien. De economie van de lus hangt af van de prijsverhouding tussen uitvoerder en adviseur, en die verhouding verschoof twee keer in zeven weken — Opus 5 naar Opus 5.5 op 22 september, en Fable 5 naar Fable 5.1 op 1 september, waardoor de cache-read van dat model daalde van $1,00 naar $0,25 per miljoen. Elk van die verschuivingen verandert het antwoord op de vraag "is de adviseur het waard", en het testen van dat antwoord zou geen tweede contract mogen vereisen. Automatische failover is de andere helft: je kunt een deel van het verkeer naar een model sturen dat je nog niet hebt gekarakteriseerd, met een terugvaloptie naar het model dat je al hebt, in plaats van een productiepad te verwedden op een lanceertabel. En als je het patroon zelf bouwt in plaats van de ingebouwde tool van Claude Code te gebruiken, stelt de routing-DSL meerdere modellen samen in één aanroep — een planningsstap op het ene model gevolgd door uitvoeringsstappen op een ander, achter één endpoint.

Eén oprechte opmerking over de scope: de adviseurtool zelf is een server-side tool die op de API van Anthropic draait, dus een routeringslaag is geen vervanging ervoor. Wat we kunnen doen, is de modellen op één key afstand zetten, tegen lijstprijs, zodat de beslissing om de adviseur te behouden of te laten vallen aan u is, op basis van uw eigen cijfers.

Hoe je een beslissing neemt voor je eigen workload

Anthropics eigen richtlijnen zijn het juiste uitgangspunt en verfrissend nuchter: laat je evaluatiesuite tegen drie configuraties lopen — de uitvoerder solo, de uitvoerder met een adviseur, en het model van de adviseur alleen bij lage inspanning — en controleer bij elke modelrelease opnieuw, want releases verschuiven zowel de capaciteitskloof als de prijsratio. De laatste van die drie is de baseline die je moet verslaan. Als het model van je adviseur alleen bij lage inspanning hetzelfde scoort als de loop voor minder geld, heb je je antwoord.

De twee variabelen om in de gaten te houden, zijn degene die Anthropic benoemt. De capaciteitskloof: een grote kloof tussen uitvoerder en adviseur is waar de adviseur zijn geld waard is, en Opus 5.5 heeft die kloof van onderaf verkleind. De consultfrequentie: winst volgt die bijna een-op-een, en ze is gevoelig genoeg voor de prompt om in te storten — een uitvoerder met lage effort kan ophouden te merken dat hij vastzit, en een koppeling die bij de standaard effort bij de meeste taken overlegt, kan terugvallen tot bijna niets. De door Anthropic meegeleverde systeemprompt vraagt om één adviseursoverleg vóór inhoudelijk werk en één vóór de afronding, wat uitkomt op twee tot drie consulten per taak; de codekoppeling die de winst van 3,5 punt opleverde, draaide op dat ritme. Begroot dat, stel er een maximum aan, en beschouw elk consult daarboven als een signaal dat je uitvoerder verkeerd is geconfigureerd, niet dat de taak moeilijk was.

Voor de specifieke loop in dit artikel doen drie concrete instellingen het meeste werk. Houd Claude Opus 5.5 op de standaard medium effort in plaats van te grijpen naar high, want effort bepaalt rechtstreeks de kosten en Anthropic's eigen cijfers voor Opus 5.5 laten zien dat medium heel weinig opoffert. Stel de advisor in met /advisor fable en controleer of de banner daadwerkelijk verschijnt — een ontbrekende banner betekent een stilzwijgend afwezige advisor. En meet, voordat je het patroon opschaalt, tokens per afgeronde taak in plaats van prijs per token, want dat is het getal dat de loop hoort te veranderen.

Veelgestelde vragen

Verbruikt de adviseur hetzelfde Fable-tegoed als een Fable-sessie?

Op API-facturering worden advisor-tokens gefactureerd tegen Fable 5.1's eigen input- en uitvoertarieven, en de rate limits van de advisor putten uit dezelfde bucket per model als directe aanroepen naar dat model — dus een advisor-aanroep die tegen een rate limit aanloopt, verschijnt als een fout in het resultaat van de tool in plaats van dat je verzoek mislukt. Op abonnementen telt advisor-gebruik mee voor de gebruikslimieten van je abonnement, behalve dat een Fable-advisor wordt gefactureerd aan gebruikscredits op abonnementen waar Fable-gebruik dat doet. De praktische consequentie is dat de advisor geen apart budget is dat je vrij kunt besteden; hij concurreert met alles wat je verder op dat model doet.

Wat krijgt de adviseur eigenlijk te zien?

Het volledige gesprek, inclusief elke tool-aanroep en elk tool-resultaat — bestandsinhoud, opdrachtuitvoer, foutmeldingen, alles. Het draait onder zijn eigen door Anthropic geleverde systeemprompt en retourneert een plan, een correctie of een stopsignaal. Twee details volgen daaruit. Ten eerste leest elk consult het hele transcript opnieuw, waardoor de kosten met de loop meegroeien in plaats van vlak te blijven. Ten tweede: als je sessie materiaal bevat dat je niet naar een tweede model zou sturen tegen het prijsniveau van de adviseur, dan is de adviseur een tweede model dat alles leest.

Wat zou het antwoord veranderen

Twee dingen, en beide liggen dichterbij dan ze lijken. Als onafhankelijke benchmarkers een run met gelijke inspanning van Opus 5.5 tegenover Fable 5.1 publiceren en de door Anthropic beweerde vernauwing bevestigen, is de resterende voorsprong van de adviseur bij de meeste taken dun — en wordt de loop een hulpmiddel voor de moeilijke staart in plaats van een standaardoptie. Als daarentegen het aandeel consultaties standhoudt en de capaciteitskloof bij langdurig agentisch werk groot blijft, is de bovenstaande rekensom waar u tussen kiest, en is $6 aan advies bij een run van $14 een goedkope optie om niet het verkeerde uit te brengen.

Wat niet zal veranderen, is het mechanisme bovenaan dit stuk. Executorcontext is gecachet en goedkoop; adviseurcontext is geen van beide. Elke loop die tijdens een taak een duurder model raadpleegt, erft die asymmetrie, wat de prijslijst volgende maand ook zegt.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt