
Claude Fable 5 som din orkestrerare: Subagentspelboken som håller tokenkostnaderna nere
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Den 7 augusti gjorde Anthropic den största enskilda förändringen av Claude Fable 5 sedan modellen lanserades den 9 juni: man minskade biologirelaterade "fallbacks" med cirka 85 %, så vardagliga hälso- och utbildningsfrågor nu får ett direkt svar istället för att tyst växla till en svagare modell. Mönstret som faktiskt sprider sig genom Claude Code-communityn den här veckan har dock inget med biologi att göra. Utövare fortsätter att publicera ett arbetsflöde där Claude Fable 5 kör orkestreringsloopen – kravförtydligande, planuppdelning, uppgiftsfördelning, resultatgodkännande – medan exekveringen lämnas över till Claude Opus 5-subagenter. Den angivna fördelen: Fable 5 High blir en prisvärd standard för sessioner, och Claude Opus 5:s mångordighet slutar dränera sessionen.
Det senaste exemplet är @dotey:s, publicerat den 14 augusti: ett kort tillägg till ~/.claude/CLAUDE.md som säger åt agenten att öppna Opus-subagenter för exekvering, med Claude Fable 5 kvar på hög resonemangsansträngning som sessionsstandard, där författaren rapporterar att tokenförbrukningen håller sig rimlig — och en rättfram anledning till att inte köra Claude Opus 5 som standard: i deras händer var den för långsam och brände ett stort antal tokens i huvudloopen. Det är ett communityfynd, inte Anthropic-vägledning — och det är värt att förstå innan du kopierar det, för på pappret ser det bakvänt ut.
Mönstret i ett enda stycke. I Claude Code ärver underagenter din sessionsmodell som standard, så sättet att hålla en snabb och billig loop är att göra sessionsmodellen till planeraren och uttryckligen peka exekutorerna mot en annan modell. Claude Fable 5 — Anthropics Mythos-klassmodell, gjord säker för allmänt bruk, släppt den 9 juni 2026, för $10/$50 per miljon tokens — innehar kraven, bryter ner arbetet, fördelar uppgifter och tar emot resultat. Claude Opus 5 — släppt den 24 juli 2026, för $5/$25 per miljon tokens — kör de faktiska implementationerna i underagenterna. Du lägger Fable-klassat omdöme på de få orkestreringsstegen och Opus-klassad exekvering på de många exekveringsstegen, där merparten av tokens redan går åt.
Varför main-loop-modellen är det verkliga kostnadsproblemet
Inom benchmarks ser detta ut som ett löst problem — och svaret ser ut att vara "välj Opus 5 som standard". Anthropics egna siffror (leverantörsrapporterade, ej oberoende verifierade) visar att Claude Opus 5 ligger före Claude Fable 5 på benchmark för agentisk kodning Frontier-Bench v0.1 (43,3 % mot 33,7 %), på SWE-bench Verified (96,0 % mot 95,5 %) och på ARC-AGI-3 (30,2 %, ungefär 4 gånger den näst bästa publika modellen). Anthropic positionerar Opus 5 som att den närmar sig Fable 5:s frontier-intelligens till halva priset. Om du väljer standardalternativ för sessionen enbart utifrån leverantörernas benchmarks och pris per token, är Opus 5 det självklara valet.
Praktiker som faktiskt kör långa sessioner kommer fram till motsatt standard, och anledningen är tokens per uppgift, inte pris per token. Opus 5:s tänkande är aktiverat som standard och adaptivt, och Anthropic säger att den verifierar sitt eget arbete utan uppmaning — vilket i praktiken innebär att varje varv i loopen genererar betydligt fler tokens än Fable 5:s. Att stänga av det tänkandet är begränsat till hög ansträngning, så du kan inte pressa det ända ned till avskalat. I en session som pågår i timmar är det loopen som ackumuleras: modellen som är billigast per token kan bli dyrast per session, och modellen som pratar minst håller loopen snabb.
Det stämmer med vad @dotey rapporterar. Den omvända uppställningen håller tokenförbrukningen "inte dålig" just därför att Opus 5 — den ordrika — är avskild till subagenter, där dess utdata är leveransen snarare än overheaden.
Den omvända arkitekturen: Fable 5 planerar, Opus utför.
Arkitekturen är enkel att beskriva och lite kontraintuitiv att köra:
• Sessionsmodell — Claude Fable 5 med hög resonemangsansträngning (den "High" i communityförkortningen "Fable 5 High"). Den äger konversationen, planen och definitionen av vad som är klart.
• Orkestreringsturer — kravförtydligande, planuppdelning, uppgiftsutskick och resultatgodkännande sker alla på Fable 5. Dessa är få turer och en liten andel av totalt antal token.
• Exekveringsomgångar — varje uppgift skickas till en underagent som kör Claude Opus 5. Dessa är de många omgångarna och huvuddelen av tokenförbrukningen — och Opus 5 är där leverantörens rapporterade agentiska poäng är högst.
Ekonomin fungerar eftersom de två kostnadskurvorna pekar i olika riktningar. Fable 5:s styrka är omdöme; du använder den sparsamt. Opus 5:s styrka är exekvering; du använder den mycket men parallellt, isolerat från loopen. Loopen förblir snabb och billig, och den dyra förmågan används exakt där token ändå spenderas.
Detta är ett av två community-mönster i omlopp, och de är varandras spegelbilder. Det mer allmänt rekommenderade ”arkitektmönstret” (som exempelvis används av fable-advisor-pluginet) använder Opus som heltidsarkitekt och reserverar Fable 5 för den mest komplexa implementationsbanan och en obligatorisk slutgranskning av leveransen. Skillnaden är ett optimeringsmål: arkitektmönstret spenderar Opus-klassade tokens på koordinering och använder Fable 5 som skalpell; det inverterade mönstret använder Fable 5 för koordinering och Opus 5 för volym. Båda är community-vägledning — Anthropic dokumenterar ingetdera — och båda är försök att spendera frontier-tokens där de förändrar utfallet.
Ställa in det i Claude Code
Claude Code har inget inbyggt "orkestratorläge", så mönstret upprätthålls på två sätt: instruktioner i sessionsprompten och explicita modellåsningar på exekveringssidan.
Instruktionslagret ligger i ~/.claude/CLAUDE.md — samma fil som @dotey redigerade. Som en form säger prompten åt huvudagenten att göra fyra saker innan den behandlar en uppgift som avslutad:
• Återge kravet och bekräfta omfattningen innan du skriver kod.
• Dela upp arbetet i uppgifter som kan köras parallellt.
• Skicka varje exekveringsuppgift till en underagent som är låst till Claude Opus 5.
• Verifiera varje resultat mot planen innan du accepterar det.
Den formen är värd att ange som vägledning snarare än som ett kodavsnitt att klistra in — dina krav och din stack förändrar vad som hör hemma i den.
Modellagret spelar större roll än de flesta uppsättningar antar. I Claude Code är upplösningsordningen för subagentmodellen: miljövariabeln CLAUDE_CODE_SUBAGENT_MODEL, därefter en modellparameter per anrop, därefter agentdefinitionens frontmatter, och slutligen sessionsmodellen. Agenter utan en modellkonfiguration ärver sessionsmodellen. Så om din session körs på Fable 5 och du förlitar dig på Agent-verktygets modellargument, finns det en dokumenterad risk att det ignoreras (GitHub issue #83920): subagenter ärver sessionsmodellen ändå, och du betalar Fable 5-pris för exekvering som du tänkt köra på Opus 5.
Två pålitliga åtgärder: sätt CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 för sessionen, eller lås modellen i subagentens frontmatter. Den variabeln är skillnaden mellan att mönstret fungerar som avsett och att hela sessionen tyst körs på den dyra modellen.
Tokenmatematiken bakom splitten
Här är de två modellerna som de är prissatta idag (publicerade av leverantören och vidarebefordrade till listpris på OrcaRouter):
Claude Fable 5 — 10 USD per 1M inmatningstokens, 50 USD per 1M utdata; 1M-tokens kontext, 128K utdata.
• Claude Opus 5 — $5 per 1M inmatningstokens, $25 per 1M utdatatokens; 1M-tokens kontext, 128K utdata.

Det kontraintuitiva är att {{1}}Opus 5 är hälften så dyrt per token{{/1}} och ändå {{2}}kan förlora kostnadsspelet per session{{/2}}. Formen är lätt att se med ungefärliga siffror: om loopen på Opus 5 avger två till tre gånger så många tokens som loopen på Fable 5 — en illustrativ siffra som överensstämmer med praktikers rapporter om Opus 5:s självverifierande beteende, inte en uppmätt sådan — så kostar loopen även vid halva tokenpriset ungefär lika mycket, och om gapet är bredare kostar Opus i loopen mer. Under tiden sitter exekveringstoken, som utgör större delen av sessionen, på Opus 5 i subagenter till den billigare avgiften oavsett.
Det är hela argumentet för det inverterade mönstret: sätt modellen vars pris per token är högre men vars loop är smalare på loopen, och sätt modellen med lägre pris per token på volymen. Det är ett routningsbeslut förklätt som ett modellbeslut.
Eftersom OrcaRouter förmedlar leverantörspriser med 0 % påslag, är siffrorna ovan vad du faktiskt betalar här — ingen plattformsavgift utöver det — och om Anthropic sänker något av priserna syns ändringen på modellsidan samma dag.
När det inverterade mönstret vinner — och när det inte gör det.
Att kopiera @dotey's setup utan att kontrollera formen på din egen arbetsbelastning är ett misstag i båda riktningarna.
Det inverterade mönstret vinner när:
Kraven är tvetydiga eller planen har många rörliga delar — orkestreringsomdöme är den knappa resursen.
• Exekveringen kan parallelliseras till underagenter — volymen lämnar loopen.
• Sessioner är långa — looparnas mångordighet ackumuleras till en verklig kostnad.
Standardrådet vinner när:
Större delen av din session är begränsat, mekaniskt arbete — en planerare av Fable-klass är överkurs, och Opus 5:s lägre pris och högre benchmarkresultat gör den till det självklara standardvalet. Det är därför Claude Codes egna dokumentation gör Opus till sessionens standard och reserverar Fable 5 för explicit val.
• Du kan inte på ett tillförlitligt sätt låsa subagentmodeller — #83920-arvsbuggen förvandlar det inverterade mönstret till "allt i Fable 5-prissättningen."
Det finns också en medelväg för justering. Opus 5 exponerar en ansträngningsparameter (låg till max, standard hög), så du kan pressa den mot ett mer avskalat beteende — men inte hela vägen, eftersom inaktivering av tänkande har ett tak på hög ansträngning. Om din smärta är Opus 5:s mångordighet, kan det räcka att sänka ansträngningen, och du behöver aldrig invertera arkitekturen alls.
Vad biologiförändringen den 7 augusti betyder för den här uppställningen
Anthropics uppdatering den 7 augusti skrev om och tränade om Claude Fable 5:s biologiklassificerare — systemet som avgör om en fråga utlöser en "fallback" till en mindre kapabel modell. Enligt Anthropics egna siffror (leverantörsrapporterade) minskade biologirelaterade fallbacks med cirka 85 % över produktgränssnitt, med totala fallbacks ned ~67 % på Claude.ai, ~55 % på Cowork, ~17 % på Claude Code och ~7 % på Claude Platform.

För en Fable 5-orchestreringsuppställning är Claude Code-numret det som spelar roll. En fallback innebär att systemet tyst byter din fråga till en annan modell — i detta fall till Opus 5. I en vanlig chatt är det osynlig friktion; i en agentisk session innebär det att en del av din pipeline körs på en modell du inte valde, med en kostnadsprofil du inte planerat. Uppdateringen tar inte bort det: virologi, toxikologi och molekylär design faller fortfarande tillbaka. Men vardagsbiologi inom hälsa och utbildning — att läsa ett labbresultat, förstå ett symptom, studera biologi — stannar nu kvar på Fable 5.
En framåtblickande notis, tydligt markerad: obekräftade rapporter från slutet av juli (36kr, WinCentral) pekar på en möjlig Claude Fable 5.1-uppdatering denna månad till oförändrat pris. Anthropic har inte bekräftat ett namn, ett datum eller ett API-modell-ID — betrakta det som spekulation tills den släpps.
Prova det utan att riskera ditt arbetsflöde.
Det som gör det inverterade mönstret värt att prova är att det är reversibelt, och att dirigera båda modellerna genom en slutpunkt gör reverseringen billig.
På OrcaRouter ligger Claude Fable 5 (anthropic/claude-fable-5) och Claude Opus 5 (anthropic/claude-opus-5) bakom en enda API-nyckel. Du kan köra sessionens exekveringsbana på endera modellen utan ett andra avtal eller en kodändring — vilket är precis vad ett experiment som "Fable 5 som orkestrerare" behöver, eftersom hela poängen är att mäta din egen kostnad per session innan du förbinder dig.

Två OrcaRouter-funktioner mappar direkt till den här konfigurationen. Automatisk failover låter dig definiera en reservkedja — om Fable 5 ger fel eller tar timeout, dirigeras begäran till Opus 5 eller en billigare modell istället för att misslyckas. Och routing-DSL kan komponera paret till ett enda anrop: ett plansteg med Fable 5 följt av exekveringssteg med Opus 5 bakom en enda slutpunkt. Det är orkestreringsmönstret uttryckt som infrastruktur snarare än som promptdisciplin.
Slutsats
Den inverterade arkitekturen — Claude Fable 5 planerar, Claude Opus 5 exekverar — är ett verkligt, fungerande svar på ett verkligt problem: den modell som är billigast per token är inte nödvändigtvis billigast per session. Det är inte ett benchmark-beslut; Opus 5 vinner de flesta av de leverantörsrapporterade agentiska jämförelserna. Det är ett token-routningsbeslut, och det lönar sig bara när orkestreringsomdöme är en bristvara och exekvering kan parallelliseras.
Claude Fable 5 (9 juni 2026) och Claude Opus 5 (24 juli 2026) är båda aktuella Anthropic-modeller, och säkerhetsändringen den 7 augusti gör Fable 5 till en mindre avbruten vardagsdrivare. Håll utkik efter tre saker: huruvida Fable 5.1-rapporterna leder till något, huruvida Anthropic åtgärdar subagent-arvsbuggen som tyst kan upphäva detta mönster, och — viktigast av allt — hur din egen kostnad per slutförd uppgift ser ut under en vecka med riktiga sessioner.
Vanliga frågor
Är Fable 5 standardmodellen i Claude Code?
Nej. Claude Code:s egna dokumentation anger att Fable 5 inte är standard för någon kontotyp — sessioner använder som standard den vanliga Opus-modellen, och du väljer Fable 5 via /model, en modellinställning eller aliaset "best". Mönstret i den här artikeln går medvetet emot den standardinställningen.
Varför inte bara använda Opus 5 som standard, eftersom det är billigare per token och får högre poäng?
Eftersom kostnaden per session är tokens per uppgift gånger pris per token. Praktiker rapporterar att Opus 5:s adaptiva tänkande och självverifiering genererar långt fler tokens per vända, så till halva priset per token kan den fortfarande vara långsammare och dyrare i en lång loop. Det är communityns slutsats som denna playbook bygger på — mät på din egen arbetsbelastning innan du väljer sida.
Kan jag tvinga mina subagenter att köra en annan modell än sessionen?
Ja, men förlita dig inte på den per-anropsmodellparametern: GitHub-ärende #83920 dokumenterar att den ignoreras, med subagenter som istället ärver sessionsmodellen. Sätt CLAUDE_CODE_SUBAGENT_MODEL eller lås modellen i subagentens frontmatter — det är skillnaden mellan att körningen sker med Opus 5-prissättning och att den tyst körs med Fable 5-prissättning.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
