Gegenereerde hero-titelkaart voor Claude Sonnet 5.5 vs Claude Fable 5.1, met als ondertitel 'Het goedkope model staat drie punten voor', met $2,00 input en $10,00 output per miljoen tokens aan de linkerkant tegenover $10,00 en $50,00 aan de rechterkant, met daaronder de cijfers 56 en 53 van de Artificial Analysis Intelligence Index v4.3, en het OrcaRouter-logo gecompositeerd in de rechteronderhoek.
Guides & Insights

Claude Sonnet 5.5 vs Claude Fable 5.1: Het goedkope model staat drie punten voor

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Sonnet 5.5 verscheen op 28 september 2026 voor $2,00 per miljoen inputtokens en $10,00 per miljoen outputtokens. Claude Fable 5.1, het model uit de Mythos-klasse dat de leverancier op 1 september uitbracht, staat op dezelfde twee regels op $10,00 en $50,00. De verleidelijke samenvatting is dat Fable 5.1 de dure is en daarom de betere, en op de Artificial Analysis Intelligence Index is de volgorde precies omgekeerd: Claude Sonnet 5.5 scoort 56 en Claude Fable 5.1 scoort 53. Dat is geen afrondingsartefact, en het is ook niet het hele verhaal, want dezelfde beoordelaar plaatst de twee binnen drie cent per taak van elkaar op dezelfde suite — $7,60 tegen $7,63. Een vijfvoudig verschil op de tarievenkaart is bijna verdwenen tegen de tijd dat een taak klaar is. Wat overblijft is een reeks verschillen in vorm in plaats van in score, en kiezen tussen deze twee is vooral een kwestie van welke vorm je workload heeft.

Twee tariefkaarten, en de ene regel waar het verschil niet vijfvoudig is

De per-token vergelijking is schril en behoeft geen interpretatie.

• Invoer — Claude Sonnet 5.5 voor $2,00 per miljoen tokens tegenover Claude Fable 5.1 voor $10,00, een vijfvoudig verschil

• Uitvoer — $10,00 tegenover $50,00 per miljoen, opnieuw exact vijfvoudig

• Cache-lezen — $0,20 tegenover $0,25 per miljoen. Dit is de regel waarop lange agent-runs draaien, en de korting valt terug van 5× naar 20%

• Cacheschrijfactie — $2,50 tegenover $12,50 per miljoen voor het standaardvenster van vijf minuten, het grootste individuele verschil van beide kaarten

• Batch — De batchmodus van Anthropic geldt voor geen van deze kaarten op de manier waarop dat voor die van Fable 5.1 geldt: Fable 5.1 werd gelanceerd met batchprijzen die halveren naar $5,00 input en $25,00 output. Lees de batchregel op de eigen prijzenpagina van Anthropic voordat je aanneemt dat die voor de hele familie geldt.

• Context en plafond — 1.000.000 tokens context en 128.000 tokens maximale uitvoer bij beide. Bij de Message Batches API ondersteunt Claude Sonnet 5.5 tot 300.000 uitvoertokens achter de bètaheader output-300k-2026-03-24, wat een echt plafondverschil is voor bulkgeneratie en geen marketingverschil

Er is een bescheiden punt in het voordeel van Claude Sonnet 5.5 dat de tariefkaart onderschat. Anthropic meldt dat het model doorgaans veel minder tokens nodig heeft om hetzelfde werk te doen dan zijn voorganger, wat volgens het bedrijf neerkomt op maar liefst 30% minder kosten per taak. Dat is een leveranciersclaim over een andere vergelijking — Sonnet 5.5 tegenover Sonnet 5 — en het is geen bewijs voor deze confrontatie. Het is echter het mechanisme dat verklaart wat de onafhankelijke meting vond.

Waar het vijfvoudige prijsverschil naartoe gaat

Artificial Analysis heeft beide modellen op 2026-09-29 onder één enkele testopstelling en één configuratielabel, "Adaptive Reasoning, Max Effort, Default Fallback", op Intelligence Index v4.3 getest. De twee kerncijfers zijn 56 voor Claude Sonnet 5.5 en 53 voor Claude Fable 5.1 — het goedkopere model ligt ongeveer drie punten voor op een schaal waar dezelfde beoordelaar het mediane model op 26 plaatst. Beide zijn op dezelfde pagina aangeduid als modellen met leveranciersnaam, dus dit is één instrument en één momentopname, niet twee.

Dan de kostenkolom, en de reden waarom deze combinatie interessant is in plaats van voor de hand liggend. In dezelfde index-run kost Claude Sonnet 5.5 $7,602633 per taak en Claude Fable 5.1 kost $7,629706. Zevenentwintig duizendsten van een dollar uit elkaar. De opsplitsing is waar het vreemd wordt: de inputzijde van Claude Fable 5.1 alleen al is $3,73 per taak tegenover de aanzienlijk kleinere inputcomponent van Sonnet 5.5, en de redeneertokens alleen al kosten $2,36 per taak. Het model dat vijf keer goedkoper is per token, is helemaal niet goedkoper per afgeronde taak.

De oorzaak is volume, en de twee modellen falen in tegengestelde richtingen.

• Uitvoertokens over de hele indexsuite — Claude Sonnet 5.5 genereerde 410.577.501 tegenover 188.465.663 van Claude Fable 5.1, in een suite waar de bijgehouden mediaan 88 miljoen is. Beide liggen ruim boven de mediaan; Sonnet 5.5 is meer dan het dubbele van Fable 5.1 en bijna vijf keer de mediaan

• Outputtokens per taak — 192.838 voor Sonnet 5.5 tegenover 78.111 voor Fable 5.1, met een aandeel redeneren van 142.386 tegen 47.240. Sonnet 5.5 denkt per taak ongeveer drie keer zo lang.

• Invoertokens in de hele indexsuite — 18,5 miljard voor Sonnet 5.5 tegenover 5,6 miljard voor Fable 5.1. Sonnet 5.5 las drie keer zoveel, het rustigere getal van de twee en degene die het goedkopere invoertarief opeet

Gemengde prijs bij een 7:2:1-mix van input, cache-lezen en output — $1,54 voor Sonnet 5.5 tegen $7,17 voor Fable 5.1. Dit is de regel die overeenkomt met de tariefkaart, en het is de regel die een workload met korte, goed afgebakende outputs beschrijft.

Als je die dingen samenvoegt, is de eerlijke bewering deze: de kloof in de gemiddelde prijs is reëel en de kloof per taak niet. Welk van de twee getallen je rekening beschrijft, hangt volledig af van of je taken stoppen of doordraven, en de indexsuite is gebouwd om ze te laten doordraven.

De inspanningsladder is de daadwerkelijke beslissing.

Beide modellen bieden een inspanningsparameter — low, medium, high, xhigh, max — en beide zijn op 2026-09-29 op elke trede gemeten. Dit is het deel van de vergelijking dat geen enkele tariefkaart kan uitdrukken, omdat het goedkope model op een lagere trede het dure model op een lagere trede met ruime marge verslaat, en het dure model zich pas nabij de top onderscheidt.

• Lage inspanning — Claude Sonnet 5.5 scoort 35,84 tegen $0,41 per taak; Claude Fable 5.1 scoort 46,82 tegen $2,37. Op de onderste sport ligt het dure model elf punten voor, voor bijna zes keer zoveel geld

• Gemiddelde inspanning — 40,74 voor $0,59 tegenover 48,92 voor $2,98. Fable 5.1 behoudt een voorsprong van acht punten tegen vijf keer de kosten

• Hoge inspanning — 46,74 bij $1,08 tegenover 51,15 bij $3,91. De kloof vernauwt tot vier en een halve punt; de kostenratio blijft op ongeveer 3,6×

• Xhigh-inspanning — 51,85 voor $2,74 tegen 53,20 voor $5,98. Een en een derde punt uit elkaar, tegen 46% van de prijs.

• Maximale inspanning — 55,98 bij $7,60 tegen 53,35 bij $7,63. De volgorde keert om en de kosten convergeren tot binnen een half procent.

Als je de vierde en vijfde rij samen leest, wordt de vorm van deze vergelijking duidelijk. Claude Sonnet 5.5 op xhigh levert 51,85 — binnen anderhalf indexpunt van de beste score van Claude Fable 5.1 bij welke inspanning dan ook — voor $2,74 per taak tegenover $7,63. Als je werk dicht bij de frontier moet zitten in plaats van er precies op, dan is die rij het volledige antwoord, en die bespaart 64% per voltooide taak. Zet je Sonnet 5.5 op max, dan koop je drie punten extra voor 2,8 keer zoveel geld, waardoor je op hetzelfde kostenplaatje uitkomt als Fable 5.1 op max, met een marginaal betere score en een heel ander redeneerprofiel.

Die laatste zin is het waard om precies vast te leggen, want hij is tegenintuïtief genoeg om hem twee keer te controleren. Bij gelijke maximale inspanning kost het model met een vijf keer goedkopere tariefkaart per taak hetzelfde als het model met de dure tariefkaart. Dat bereikt het door 2,5 keer zoveel outputtokens te produceren, waarvan het aandeel dat naar redeneren gaat drie keer zo groot is. De eigen documentatie van Anthropic verklaart een deel van het mechanisme: de tokenizer is gewijzigd, en dezelfde tekst levert ongeveer 30% meer tokens op bij Claude Sonnet 5.5 dan bij eerdere modellen. Dat is één van meerdere factoren die bijdragen, en het is een nuttige herinnering dat aantallen outputtokens niet vergelijkbaar zijn tussen tokenizer-revisies zonder dat erbij te vermelden.

Latentie is waar de twee ophouden op elkaar te lijken.

Scoreconvergentie strekt zich niet uit tot tijd. Op dezelfde snapshot van 2026-09-29 rapporteert Artificial Analysis een tijd tot het eerste token van 254,41 seconden voor Claude Fable 5.1 en 2,80 seconden voor Claude Sonnet 5.5 op de long-prompt-slice, met mediane outputsnelheden van respectievelijk 67,9 en 49,4 tokens per seconde. Dat is een verschil van twee ordes van grootte in hoe lang een aanroeper wacht voordat er ook maar iets aankomt, en het is het getal met de grootste operationele gevolgen in deze vergelijking.

Bij beide cijfers moeten de kwalificaties duidelijk worden vermeld. De TTFT van Fable 5.1 wordt gemeten op het lange-prompttype; het medium-promptsegment van de evaluator voor hetzelfde model op dezelfde dag is 117,60 seconden, dus de waarde van 254 seconden is de staart en geen constante. De 2,80 seconden van Sonnet 5.5 is de algehele mediaan, waarbij de eigen variatieband van de evaluator loopt van 1,91 seconden bij het vijfde percentiel tot 4,23 bij het vijfennegentigste. De platformdocumentatie van Anthropic beschrijft de vergelijkende latentie van Fable 5.1 als langzamer en die van Sonnet 5.5 als snel, wat qua richting consistent is zonder een meting te zijn.

Onze eigen infrastructuur levert een derde lezing op, want wij routeren Claude Fable 5.1 en meten wat wij leveren. Over de zeven dagen tot 28 september laat Claude Fable 5.1 op OrcaRouters eigen verkeer een mediane eerste token van 6.973 milliseconden zien, met een 95e percentiel van 10,0 seconden, een outputsnelheid van 65,8 tokens per seconde en een foutpercentage van 0,349%. Die p50 is meer dan honderd keer sneller dan het cijfer van de evaluator voor lange prompts, wat niet zozeer een tegenstrijdigheid is als wel een kwestie van definities: een eerste token aan de ontwikkelaarskant bij een korte prompt en het eerste token van een benchmark bij een lange prompt zijn metingen van verschillende zaken. Wie plannen maakt op basis van het leaderboard-getal, moet weten welke van de twee hij koopt.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

Eerlijkheid in sourcing, retentie en de migratie waar niemand het over heeft

Benchmarktabellen van leveranciers en onafhankelijke evaluaties zijn verschillende instrumenten en mogen nooit van elkaar worden afgetrokken. De eigen lanceringstabel van Anthropic voor Claude Sonnet 5.5 rapporteert Terminal-Bench 4.0 op 70,6%. Artificial Analysis, dat zijn eigen harness draait, rapporteert 63,6% voor hetzelfde model op een evaluatie met dezelfde naam. Voor Claude Fable 5.1 loopt het verschil de andere kant op: Anthropic rapporteerde bij de lancering 55,8% en de onafhankelijke harness komt uit op 52,0%. Geen van beide paren is een correctie op het andere. Beoordeel elk op zijn eigen merites, en geef de voorkeur aan de onafhankelijke wanneer je beslist waar je productieverkeer naartoe stuurt.

De retentiehouding verschilt ook, en het is het soort verschil dat alleen bij een inkoopreview naar voren komt. Anthropic verklaart dat Claude Sonnet 5.5 beschikbaar is met zero data retention, dezelfde houding die het aannam bij Opus 5.5 en Sonnet 5. Het lanceringsmateriaal van Claude Fable 5.1 beschrijft een aanvullend datagebruiksbeleid dat daarnaast geldt, en een afzonderlijke implementatie onder Project Glasswing die standaard een retentievenster van 30 dagen voor veiligheidsmonitoring hanteert, waarbij de zero-retentionregeling wordt beschreven als de interim-status. Als uw team verantwoording moet afleggen voor een gegevensverwerkingsreview, is dat onderscheid een echte regelpost in plaats van een voetnoot, en het is de moeite waard om de huidige beleidspagina van Anthropic te lezen in plaats van welke samenvatting daarvan dan ook, inclusief deze.

De migratiekosten zijn asymmetrisch op een manier die zelden in de verslaggeving rond de lancering terechtkomt. Overstappen naar Claude Sonnet 5.5 is geen wijziging van een model-string. Anthropics migratiegids stelt dat niet-standaardwaarden voor temperature, top_p en top_k nu een 400-fout retourneren, dat een tool_choice van any of een benoemde tool direct wordt geweigerd, en dat thinking: {"type": "disabled"} moet worden vervangen door between_tools als je met up-front thinking uit draaide. Het type between_tools wordt geaccepteerd bij low, medium en high effort en geeft een 400 bij xhigh of max. Op de Claude API en Google Cloud wordt computer use alleen ondersteund via de toolset computer_toolset_20260801; de oudere computer_20251124 wordt geweigerd. Geen van die dingen geldt voor een overstap naar Claude Fable 5.1, een upgrade binnen dezelfde familie vanaf Fable 5 met drie eigen breaking changes. Als je de twee als parallelle migratiedoelen tegen elkaar afweegt, is het goedkopere model het duurste om te adopteren.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Welke waar te plaatsen

De beslissing die uit de cijfers volgt, is een beslissing over hoeveel van je verkeer goed afgebakend is.

• Begrensd, hoogvolume, toolgedreven werk — Claude Sonnet 5.5, bij xhigh effort als je dicht bij de frontier moet zitten. Het zit anderhalf indexpunt achter het beste van Fable 5.1 voor 64% minder per voltooide taak, het levert zijn eerste token in ongeveer drie seconden, en zijn goedkopere cache-write-regel maakt een opnieuw opgebouwde contextprefix betaalbaar

• Werk met een lange horizon en open einde, waarbij een verkeerd antwoord duur is — Claude Fable 5.1. Het evenaart de maximale score van Sonnet 5.5 tegen dezelfde kosten per taak, terwijl het daar komt met een derde van de redeneertokens en een kwart van de input, wat ertoe doet wanneer de taak echt open-ended is en de vorm van de evaluatiesuite op je probleem lijkt

• Latentiegebonden interactieve interfaces — Claude Sonnet 5.5, en het verschil is allesbehalve klein. In de eigen snapshot van de evaluator bedraagt het verschil in eerste-tokenlatentie twee ordes van grootte bij het lange-prompttype, en de meting met de middellange prompt brengt dat slechts terug tot ongeveer 118 seconden. Een chatinterface kan niet op het Fable 5.1-getal worden gebouwd zonder batchverwerking of streaming eromheen.

• Bulkgeneratie met lange outputs — Claude Sonnet 5.5, vanwege het uitvoerplafond van 300.000 tokens dat beschikbaar is op de Message Batches API achter de header output-300k-2026-03-24, tegenover een plafond van 128.000 tokens overal elders. Controleer uw batchprijsstelling voordat u zich vastlegt; het batchtarief is niet identiek op de twee kaarten

• Werk dat meerdere accounts moet beslaan of redeneringen tussen systemen moet overdragen — lees voordat u een van beide doet de documentatie van Anthropic over preserved thinking. Denkblokken zijn gebonden aan het model en het account dat ze heeft voortgebracht, en Sonnet 5.5 is de eerste Sonnet die wordt geleverd met classifiers die redeneringsextractie voorkomen. Dat is tegelijk een compliancefunctie en een beperking.

• Gereguleerde of retentiegevoelige workloads — controleer het actuele beleid in plaats van de dekking bij de lancering. Claude Sonnet 5.5 werd gelanceerd waarbij zero data retention beschikbaar was; het materiaal van Fable 5.1 beschrijft een incrementeel beleid met een standaardvenster van 30 dagen bij één deployment en zero retention als tijdelijke status

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

Op OrcaRouter, Claude Fable 5.1 en Claude Sonnet 5 zitten beide achter één credential tegen de lijstprijs van de provider met 0% opslag, dus de cache-read-regel en de tokenizerwijziging zijn de enige dingen die je factuur beïnvloeden wanneer je tussen beide schakelt. Claude Sonnet 5.5 is nog geen route op ons platform — het model is één dag oud — dus de eerlijke vaststelling is dat je het vandaag via de eigen API van Anthropic bereikt. Iedereen die Fable 5.1 via ons draait, kan de kosten van de overstap berekenen op de dag dat die beschikbaar komt, zonder iets anders aan hun integratie te veranderen, en ondertussen automatische failover tussen providers is wat het veilig maakt om een model dat zo nieuw is te proberen op een pad dat beschikbaar moet blijven.

De conclusie is smaller dan de prijskloof doet vermoeden. Claude Sonnet 5.5 is de betere standaardkeuze voor bijna alle begrensde taken — het scoort drie punten hoger op de onafhankelijke index, het antwoordt binnen enkele seconden, en bij xhigh komt het binnen anderhalve punt van het plafond van Fable 5.1, voor ruim minder dan de helft van de kosten per taak. Claude Fable 5.1 houdt één echt argument over, en dat is precies het argument dat Anthropics eigen vergelijkingstabel aandraagt: wanneer het werk open-ended is en de kosten van een fout groter zijn dan de kosten van langer nadenken, koopt vijf keer de inputprijs een model dat dezelfde score bereikt zonder drie keer zoveel reasoning-tokens uit te geven om daar te komen. Kies op basis van de vorm van de taak, niet de omvang van de tariefkaart, want bovenaan de inspanningsladder rekenen die twee modellen je hetzelfde.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt