
Claude Sonnet 5.5 vs Claude Fable 5.1: Den billiga modellen ligger tre poäng före
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 983 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 196 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Claude Sonnet 5.5 lanserades den 28 september 2026 till $2,00 per miljon indatatoken och $10,00 per miljon utdatatoken. Claude Fable 5.1, modellen i Mythos-klassen som leverantören släppte den 1 september, ligger på $10,00 och $50,00 på samma två rader. Den frestande sammanfattningen är att Fable 5.1 är den dyra och därför den bättre, och i Artificial Analysis Intelligence Index är ordningen den omvända: Claude Sonnet 5.5 får 56 poäng och Claude Fable 5.1 får 53. Det är inte en avrundningsartefakt, och det är inte heller hela historien, eftersom samma utvärderare placerar de två inom tre cent per uppgift från varandra i samma testsvit – $7,60 mot $7,63. En femfaldig skillnad i prislistan har nästan försvunnit när en uppgift är färdig. Det som återstår är en uppsättning skillnader i form snarare än i poäng, och att välja mellan dessa två är mest en fråga om vilken form din arbetsbelastning har.
Två prislistor, och den enda raden där gapet inte är femfaldigt
Jämförelsen per token är slående och kräver ingen tolkning.
• Indata — Claude Sonnet 5.5 till $2,00 per miljon tokens mot Claude Fable 5.1 till $10,00, en femfaldig skillnad
• Utdata — $10.00 mot $50.00 per miljon, återigen exakt fem gånger så mycket
• Cache-läsning — $0,20 mot $0,25 per miljon. Detta är raden som bär långa agentkörningar, och rabatten kollapsar från 5× till 20%
• Cacheskrivning — $2,50 mot $12,50 per miljon för standardfönstret på fem minuter, den största enskilda skillnaden på något av korten
• Batch — Anthropics batchläge gäller inte för något av dessa kort på samma sätt som det gör för Fable 5.1:s: Fable 5.1 lanserades med batchprissättning som halverades till $5.00 för input och $25.00 för output. Läs batchraden på Anthropics egen prissättningssida innan du antar att den gäller för hela familjen
• Kontext och tak — 1 000 000 tokens kontext och 128 000 tokens maximal utdata för båda. På Message Batches API stöder Claude Sonnet 5.5 upp till 300 000 utdatatokens bakom beta-headern output-300k-2026-03-24, vilket är en verklig takskillnad för massgenerering och inte en marknadsföringsskillnad
Det finns en blygsam poäng till Claude Sonnet 5.5:s fördel som prislistan underskattar. Anthropic rapporterar att modellen i allmänhet behöver mycket färre tokens för att utföra samma arbete än sin föregångare, vilket enligt företaget motsvarar upp till 30 % lägre kostnad per uppgift. Det är ett leverantörspåstående om en annan jämförelse – Sonnet 5.5 mot Sonnet 5 – och det är inte bevis för den här matchningen. Det är emellertid mekanismen som förklarar vad den oberoende mätningen kom fram till.
Vart den femfaldiga prisskillnaden tar vägen
Artificial Analysis körde båda modellerna den 2026-09-29 under en enda testram och en konfigurationsetikett, "Adaptive Reasoning, Max Effort, Default Fallback", på Intelligence Index v4.3. De två huvudnumren är 56 för Claude Sonnet 5.5 och 53 för Claude Fable 5.1 — den billigare modellen ligger före med ungefär tre punkter på en skala där samma utvärderare placerar medianmodellen vid 26. Båda är märkta som leverantörsnamnsmodeller på samma sida, så detta är ett instrument och en ögonblicksbild, inte två.
Sedan kostnadskolumnen, och anledningen till att den här kombinationen är intressant snarare än självklar. I samma indexkörning kostar Claude Sonnet 5.5 $7,602633 per uppgift och Claude Fable 5.1 kostar $7,629706. De skiljer sig med tjugosju tusendels dollar. Uppdelningen är där det blir märkligt: enbart Claude Fable 5.1:s ingångssida är $3,73 per uppgift, mot Sonnet 5.5:s betydligt mindre inputkomponent, och enbart dess resonemangstoken kostar $2,36 per uppgift. Modellen som är fem gånger billigare per token är inte alls billigare per slutförd uppgift.
Orsaken är volym, och de två modellerna misslyckas i motsatta riktningar.
• Utdatatoken i indexsviten – Claude Sonnet 5.5 genererade 410 577 501 mot Claude Fable 5.1:s 188 465 663, i en svit där den uppmätta medianen är 88 miljoner. Båda ligger långt över medianen; Sonnet 5.5 är mer än dubbelt så många som Fable 5.1 och nästan fem gånger medianen.
• Utdata-tokens per uppgift – 192 838 för Sonnet 5.5 mot 78 111 för Fable 5.1, med resonemangsandelen 142 386 mot 47 240. Sonnet 5.5 tänker ungefär tre gånger så länge per uppgift
• Indatatoken i hela indexsviten – 18,5 miljarder för Sonnet 5.5 mot 5,6 miljarder för Fable 5.1. Sonnet 5.5 läste tre gånger så mycket, vilket är den tystare siffran i paret och den som äter upp den billigare indatatakten
• Blandat pris vid en mix på 7:2:1 för indata:cacheläsning:utdata – 1,54 USD för Sonnet 5.5 mot 7,17 USD för Fable 5.1. Det här är raden som matchar prislistan, och det är raden som beskriver en arbetsbelastning med korta, väl avgränsade utdata.
Lägger man ihop det blir det ärliga påståendet följande: skillnaden i det sammanvägda priset är verklig och skillnaden per uppgift är det inte. Vilket av de två talen som beskriver din faktura beror helt och hållet på om dina uppgifter avslutas eller svamlar, och indexsviten är byggd för att låta dem svamla.
Ansträngningsstegen är det faktiska beslutet
Båda modellerna exponerar en ansträngningsparameter – low, medium, high, xhigh, max – och båda mättes på varje nivå den 29 september 2026. Det här är den del av jämförelsen som ingen prislista kan uttrycka, eftersom den billiga modellen på en lägre nivå slår den dyra modellen på en lägre nivå med god marginal, och den dyra modellen skiljer sig bara ut nära toppen.
• Låg insats — Claude Sonnet 5.5 får 35,84 för 0,41 dollar per uppgift; Claude Fable 5.1 får 46,82 för 2,37 dollar. På den lägsta nivån ligger den dyra modellen elva poäng före, för nästan sex gånger pengarna
• Medelinsats – 40,74 för 0,59 $ mot 48,92 för 2,98 $. Fable 5.1 har en åtta punkters ledning till fem gånger kostnaden.
• Hög insats — 46,74 vid 1,08 USD mot 51,15 vid 3,91 USD. Gapet minskar till fyra och en halv poäng; kostnadsförhållandet ligger kvar på omkring 3,6×
• Xhigh effort — 51,85 för $2,74 mot 53,20 för $5,98. En och en tredjedels poängs skillnad, till 46 % av priset
• Maximal ansträngning — 55,98 vid 7,60 $ mot 53,35 vid 7,63 $. Ordningen inverteras och kostnaden konvergerar till inom en halv procent
Läs den fjärde och femte raden tillsammans så framträder formen av den här matchningen. Claude Sonnet 5.5 på xhigh levererar 51,85 – inom en och en halv indexpoäng från Claude Fable 5.1:s bästa resultat vid vilken ansträngningsnivå som helst – för 2,74 dollar per uppgift mot 7,63 dollar. Om ditt arbete behöver ligga nära fronten snarare än vid den är den raden hela svaret, och den sparar 64 % per slutförd uppgift. Pressa Sonnet 5.5 till max och du köper tre poäng till för 2,8 gånger pengarna, vilket landar dig på samma nota som Fable 5.1:s max med en marginellt bättre poäng och en mycket annorlunda resonemangsprofil.
Den där sista meningen är värd att nagla fast, för den är tillräckligt kontraintuitiv för att dubbelkollas. Vid matchad maximal ansträngning kostar modellen med en fem gånger billigare prislista lika mycket per uppgift som modellen med den dyra. Den kommer dit genom att generera 2,5 gånger så många utdatatokens, varav resonemangsandelen är tre gånger så stor. Anthropics egen dokumentation förklarar en del av mekanismen: tokeniseraren har ändrats, och samma text ger omkring 30 % fler tokens med Claude Sonnet 5.5 än med tidigare modeller. Det är en bidragande faktor bland flera, och en användbar påminnelse om att antalet utdatatokens inte är jämförbara mellan tokeniserarversioner utan att man säger det.
Latens är där de två slutar likna varandra
Poängkonvergens sträcker sig inte till tid. I samma ögonblicksbild från 2026-09-29 rapporterar Artificial Analysis en tid till första token på 254,41 sekunder för Claude Fable 5.1 och 2,80 sekunder för Claude Sonnet 5.5 på långprompt-segmentet, med medianhastigheter för utdata på 67,9 respektive 49,4 token per sekund. Det är en skillnad på två storleksordningar i hur länge en anropare väntar innan något anländer, och det är det enskilt mest operationellt betydelsefulla numret i denna jämförelse.
Båda siffrorna behöver sina kvalificerande omständigheter klart angivna. Fable 5.1:s TTFT mäts på den långa prompttypen; utvärderarens delmängd för medellånga prompter för samma modell samma dag är 117,60 sekunder, så siffran på 254 sekunder är svansen och inte en konstant. Sonnet 5.5:s 2,80 sekunder är dess övergripande median, med utvärderarens eget variansband som sträcker sig från 1,91 sekunder vid femte percentilen till 4,23 vid den nittiofemte. Anthropics plattformsdokumentation beskriver Fable 5.1:s jämförande latens som långsammare och Sonnet 5.5:s som snabb, vilket är riktningsmässigt konsekvent utan att vara en mätning.
Vår egen infrastruktur ger en tredje avläsning, eftersom vi dirigerar Claude Fable 5.1 och mäter det vi levererar. Under de sju dagarna fram till den 28 september, på OrcaRouters egen trafik, visar Claude Fable 5.1 en median för första token på 6 973 millisekunder med en 95:e percentil på 10,0 sekunder, en utdatahastighet på 65,8 tokens per sekund och en felfrekvens på 0,349 %. Det p50 är mer än hundra gånger snabbare än utvärderarens långpromptsiffra, vilket inte är så mycket en motsägelse som en definition av: ett utvecklarinriktat första token över en kort prompt och ett benchmarks första token över en lång är mätningar av olika saker. Den som planerar utifrån topplistans siffra bör veta vilken de köper.

Ärlighet i sourcing, retention och migrationen som ingen nämner
Leverantörers benchmarktabeller och oberoende utvärderingar är olika instrument och bör aldrig subtraheras från varandra. Anthropics egen lanseringstabell för Claude Sonnet 5.5 rapporterar Terminal-Bench 4.0 till 70,6 %. Artificial Analysis, som kör sin egen testrigg, rapporterar 63,6 % för samma modell på en utvärdering med samma namn. För Claude Fable 5.1 går skillnaden åt andra hållet: Anthropic rapporterade 55,8 % vid lansering och den oberoende testriggen visar 52,0 %. Inget av de två paren är en korrigering av det andra. Bedöm var och en på dess egna villkor, och föredra den oberoende när du bestämmer vart produktionstrafiken ska skickas.
Även hållningen till lagring skiljer sig, och det är den sorts skillnad som bara dyker upp i en inköpsgranskning. Anthropic uppger att Claude Sonnet 5.5 finns tillgänglig med noll datalagring, samma hållning som man intog med Opus 5.5 och Sonnet 5. Lanseringsmaterialet för Claude Fable 5.1 beskriver en inkrementell policy för dataanvändning som lever parallellt med den, och en separat driftsättning inom Project Glasswing med ett standardfönster för lagring på 30 dagar för säkerhetsövervakning, där arrangemanget med noll lagring beskrivs som det interimistiska tillståndet. Om ditt team står till svars inför en granskning av databehandling är den distinktionen en verklig radpost snarare än en fotnot, och det är värt att läsa Anthropics aktuella policysida snarare än någon sammanfattning av den, inklusive den här.
Migreringskostnaden är asymmetrisk på ett sätt som sällan tar sig in i lanseringsbevakningen. Att gå över till Claude Sonnet 5.5 är inte en ändring av modellsträngen. Anthropics migreringsguide anger att icke-standardvärden för temperature, top_p och top_k nu returnerar ett 400-fel, att ett tool_choice på any eller ett namngivet verktyg avvisas direkt, och att thinking: {"type": "disabled"} måste bli between_tools om du körde med up-front thinking avstängt. Typen between_tools accepteras vid low, medium och high effort och returnerar ett 400 vid xhigh eller max. På Claude API och Google Cloud stöds computer use endast via verktygsuppsättningen computer_toolset_20260801; den äldre computer_20251124 avvisas. Ingen av dessa gäller vid en övergång till Claude Fable 5.1, som är en uppgradering inom samma familj från Fable 5 med tre egna brytande ändringar. Om du väger de två som parallella migreringsmål är den billigare modellen den dyrare att införa.

Vilken ska sättas var?
Beslutet som följer av siffrorna är ett beslut om hur stor del av din trafik som är välavgränsad.
• Avgränsat, högvolymigt, verktygsdrivet arbete — Claude Sonnet 5.5, med xhigh-ansträngning om du behöver ligga nära frontlinjen. Den ligger en och en halv indexpoäng efter Fable 5.1:s bästa resultat till 64 % lägre kostnad per slutförd uppgift, den returnerar sin första token på omkring tre sekunder, och dess billigare rad för cache-skrivning gör att ett återuppbyggt kontextprefix är överkomligt
• Långsiktigt, öppet arbete där ett felaktigt svar är dyrt – Claude Fable 5.1. Den matchar Sonnet 5.5:s maxpoäng till samma kostnad per uppgift, men når dit med en tredjedel av resonemangstoken och en fjärdedel av indata, vilket spelar roll när uppgiften är genuint öppen och utvärderingssvitens form liknar ditt problem
• Latensbegränsade interaktiva ytor — Claude Sonnet 5.5, och det är inte ens nära. I utvärderarens egen ögonblicksbild är gapet för första token två storleksordningar för den långa prompttypen, och avläsningen för medelprompten minskar det bara till omkring 118 sekunder. En chattyta kan inte byggas på Fable 5.1-siffran utan att batcha eller strömma runt den
• Massgenerering med långa utdata — Claude Sonnet 5.5, på grund av taket på 300 000 tokens för utdata som finns tillgängligt i Message Batches API bakom headern output-300k-2026-03-24, jämfört med ett tak på 128 000 tokens överallt annars. Bekräfta din batchprissättning innan du bestämmer dig; den batchade taxan är inte identisk mellan de två korten
• Arbete som måste spänna över konton eller överföra resonemang mellan system – läs Anthropics preserved-thinking-dokumentation innan du gör något av dessa. Tankeblock är bundna till modellen och kontot som skapade dem, och Sonnet 5.5 är den första Sonnet-modellen som levereras med klassificerare som förhindrar extrahering av resonemang. Det är en efterlevnadsfunktion och en begränsning samtidigt
• Reglerade eller bevarandekänsliga — den aktuella policyn jämfört med lanseringsmaterialet. Claude Sonnet 5.5 lanserades med noll datalagring tillgänglig; Fable 5:s material beskriver en stegvis policy med ett 30-dagarsfönster och noll som ett stegvist tillstånd.

På OrcaRouter, Claude Fable 5.1 och Claude Sonnet 5 ligger båda bakom en och samma autentiseringsuppgift till leverantörens listpris med 0 % påslag, så cache-läsningsraden och tokenizerändringen är det enda som påverkar din faktura när du växlar mellan dem. Claude Sonnet 5.5 är ännu inte en route på vår plattform – modellen är en dag gammal – så det ärliga svaret är att du i dag når den via Anthropics eget API. Alla som kör Fable 5.1 via oss kan prissätta bytet den dag det lanseras utan att ändra något annat i sin integration, och under tiden automatisk failover mellan leverantörer är det som gör det säkert att prova en så här ny modell på en väg som måste hållas uppe.
Domen är snävare än prisgapet antyder. Claude Sonnet 5.5 är det bättre standardvalet för nästan allt avgränsat – den får tre poäng högre på det oberoende indexet, den svarar inom sekunder, och vid xhigh ligger den inom en och en halv poäng från Fable 5.1:s tak för väl under halva kostnaden per uppgift. Claude Fable 5.1 behåller ett verkligt argument, och det är det som Anthropics egen jämförelsetabell lägger fram: när arbetet är öppet och kostnaden för att ha fel överstiger kostnaden för att tänka längre, köper fem gånger indatapriset en modell som når samma poäng utan att spendera tre gånger så många resonemangstokens för att komma dit. Välj utifrån uppgiftens form, inte utifrån prislistans storlek, för högst upp på ansträngningsstegen debiterar de två modellerna dig samma sak.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
