
Claude Sonnet 5.5: De standaard in het middensegment, volledig gespecificeerd
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Claude Sonnet 5.5 is het model uit de middenklasse van de Claude-lijn, uitgebracht op 28 september 2026, en de prijsstelling is de hele reden waarom het een pagina waard is: $2 per miljoen inputtokens en $10 per miljoen outputtokens, tegenover $4 en $20 voor Claude Opus 5.5, het vlaggenschip dat zes dagen eerder uitkwam. Dat is de helft van de outputprijs voor 1,62 punten op de Artificial Analysis Intelligence Index — 56,00 voor het model uit de middenklasse tegen 57,62 voor het vlaggenschip, beide cijfers gemeten door Artificial Analysis op indexrevisie v4.3.2 en niet door ons en niet door de leverancier. Boven beide staat Claude Fable 5.1, op $10 / $50 en 53,35 op dezelfde revisie: duurder dan het vlaggenschip, en erachter. Voor dezelfde adviesprijs van $2 / $10 als de Claude Sonnet 5.5 staat OpenAI's GPT-6.1 Sol, op 51,83 — 417 indexhonderdsten aan de andere kant van de lijn, wat de vergelijking is die een lezer die het model uit de middenklasse afweegt daadwerkelijk moet maken.
Deze pagina is een naslagwerk, en de datums zeggen waarom, niet de actualiteit. Claude Sonnet 5.5 is tien dagen oud op 2026-10-08, waardoor het buiten het venster van zeven dagen valt waarbinnen deze blog nieuws brengt. Wat wel binnen dat venster valt, is een gebeurtenis van zes dagen oud: twee berichten op X van 2026-10-02, die beweren dat een opvolgend model in deze familie een rivaal verslaat die zijn eigen aanbieder afrondde en achterhield. Die bewering heeft geen model-id, geen tariefkaart, geen contextvenster en geen benchmark erachter in enig register dat vanaf hier bereikbaar is, en het is niet het onderwerp van deze pagina — de bronnenketen, de afwezigheidscontrole op het leveranciersoppervlak en de indexspreiding over vijf modellen worden volledig behandeld in het stuk dat deze blog al heeft gepubliceerd onder de titel Claude Fable 5.5 Beat GPT-6.1 Astra Before It Exists — and That Is the Interesting Part, gedateerd 2026-10-03. Wat die bewering wel opleverde, is een rij lezers die vragen welk uitgeleverd Claude-model ze als standaard moeten nemen terwijl ze wachten, en die vraag heeft een pagina nodig over het model dat bestaat. Dit is die pagina.
Wat is er op 28 september 2026 uitgebracht?
De eigen documentatie van de leverancier geeft de specificatie direct, en het is een voortzetting van de tier in plaats van een nieuwe vorm. Alles hieronder is op 2026-10-08 gelezen uit de Claude Platform-documentatie van Anthropic, dus het is de specificatie van Anthropic, geen onafhankelijke test ervan.
• Uitgebracht — 28 september 2026. De eigen documentatiepagina van het model opent met de regel "Nieuwste. Uitgebracht op 28 september 2026."
• Positionering — "De beste combinatie van snelheid en intelligentie", met de vergelijkende latentie vermeld als Snel tegenover Matig voor Claude Opus 5.5, Langzamer voor Claude Fable 5.1 en Snelst voor de kleine tier.
• Model-ID — claude-sonnet-5-5 op de Claude API, Google Cloud, Microsoft Foundry en Claude Platform on AWS; anthropic.claude-sonnet-5-5 op Amazon Bedrock. Elk Claude-model-ID is een gepinde snapshot, dus de tekenreeks is geen pointer die onder je voeten wegschuift.
• Context en uitvoer — 1.000.000 tokens context en 128.000 tokens synchrone uitvoer op de Messages API, oplopend tot 300.000 achter de output-300k-2026-03-24 bèta-header op de Message Batches API.
• Denken — adaptief, standaard altijd ingeschakeld, met een standaardinspanning van hoog. De laagste instelling is between_tools, waarmee voorafgaand denken wordt uitgeschakeld en die wordt geaccepteerd bij een inspanning van hoog of lager. Als je temperature, top_p of top_k op iets anders dan de standaardwaarde instelt, wordt een 400-fout geretourneerd, zodat een verzoek dat is gemigreerd van een ouder Claude-model met een aangepaste temperatuur duidelijk faalt in plaats van stil.
• Kennisafsluitdatum — juni 2026, voor zowel de betrouwbare afsluitdatum als de afsluitdatum van de trainingsgegevens.
• Levenscyclus — Actief (nieuwste), met een uitfaseringsverplichting van niet eerder dan 28 september 2027 op de platforms die Anthropic beheert. Amazon Bedrock en Google Cloud stellen hun eigen datums vast.
De manier waarop de leverancier de lancering neerzet, is het citeren waard, want het is een claim en geen meting: de aankondiging van Anthropic beschrijft Claude Sonnet 5.5 als "een duidelijke upgrade ten opzichte van Sonnet 5, die 30% sneller draait en voor het meeste werk tot 30% minder kost." Die zin is van de leverancier en niet door ons gereproduceerd, en het is het soort claim dat volledig afhangt van welk werk je ervoor zet. Er kleeft ook een migratiekost aan de release die niet op deze pagina thuishoort: vijf breaking changes treffen code die al op Claude Sonnet 5 draait, en een zesde verandert de vorm van de respons zonder dat een verzoek mislukt. Die verantwoording hoort bij het uitrolartikel dat deze blog in de releaseweek publiceerde, en het is het eerste dat je moet lezen als je vandaag Sonnet 5 in productie hebt.

De 1,62 punten, en de halve prijs
Onafhankelijke scores voor dit model komen uit één bron, en ze bevatten één getal dat de discussie beslecht. Artificial Analysis meet Claude Sonnet 5.5 op 56,00 op de Intelligence Index, revisie v4.3.2, in de configuratie die de pagina aanduidt als "Claude Sonnet 5.5 (Max, Default Fallback)". We hebben die pagina op 2026-10-08 gelezen. Op dezelfde revisie, dezelfde dag:
• Claude Opus 5.5 — 57,62, uitgebracht op 2026-09-22, $4 / $20
• Claude Sonnet 5.5 — 56.00, uitgebracht op 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53,35, uitgebracht op 2026-09-01, $10 / $50
• GPT-6 Astra — 52,67, uitgebracht op 3 september 2026, $10 / $10? met een long-contextlaag boven 272.000 prompttokens voor $20 / $75
• GPT-6.1 Sol — 51,83, uitgebracht op 2026-09-29, $2 / $10
Aangeven welke revisie van belang is, omdat een score van de ene versie van de index niet vergelijkbaar is met een score van een andere: v4.3.2 omvat tien evaluaties — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience en AA-LCR v1.1 — en de samenstelling van die set is in de loop der revisies veranderd. Alle vijf bovenstaande cijfers komen uit dezelfde revisie, wat de reden is dat ze met elkaar vergeleken kunnen worden, en waarom geen van hen vergeleken kan worden met een getal dat uit een eerdere versie is geciteerd.
De prijsvergelijking is het onderdeel dat gedrag bepaalt. Het outputtarief van Claude Sonnet 5.5 is de helft van dat van Claude Opus 5.5, en het inputtarief is wederom de helft; op de eigen lijst van de leverancier kost de middenklasse $2 / $10, terwijl het topmodel $4 / $20 kost. Zet de twee gepubliceerde getallen naast elkaar en de verhouding is schril: per dollar output van de lijstprijs vertegenwoordigt Claude Sonnet 5.5 5,60 indexpunten en Claude Opus 5.5 2,88 — bijna twee keer zoveel index per dollar output, op Anthropics eigen tariefkaart en Artificial Analysis' eigen meting. Dat is rekenwerk met twee gepubliceerde cijfers, geen meting van wat dan ook, en het is de eerlijke vorm van het pleidooi voor de middenklasse. Het is ook geen oordeel: een indexpunt is geen eenheid van correctheid, en het punt van de rest van deze pagina is waaruit de 1,62 wel en niet bestaat.

De tariefkaart, en de twee lijnen die het meest bewegen
De volledige prijslijst van Anthropic, gelezen op 2026-10-08. Elk cijfer in deze sectie is van de leverancier.
• Input — $2,00 per miljoen tokens. Output — $10,00 per miljoen, en thinking-tokens worden gefactureerd als output, wat hier niet onderdrukt kan worden omdat adaptief denken standaard is ingeschakeld.
• Cache read — $0,10 per miljoen, wat Anthropic documenteert als 5 procent van de basisprijs voor input. Dat is dezelfde proportionele korting die Claude Opus 5.5 hanteert, dus caching verandert niets aan de rangorde tussen de twee, en het betekent wel dat een lange agent-run met een stabiele prefix een tiende van het inputtarief betaalt voor alles wat hij opnieuw leest.
• Cache-schrijfactie — $2,50 per miljoen voor de cache van vijf minuten, $4,00 voor de cache van één uur. De minimale lengte van een prompt die in de cache kan worden opgeslagen, is 512 tokens, dus korte prompts kunnen de korting helemaal niet krijgen.
• Batch API — 50 procent korting in beide richtingen, dus $1,00 input en $5,00 output voor werk dat kan wachten.
• Geen toeslag voor lange context — Anthropic factureert het volledige venster van 1M tokens tegen het standaardtarief per token op dit model, dus een verzoek van 900.000 tokens kost per token hetzelfde als een verzoek van 9.000 tokens. Dat is een wezenlijk verschil met GPT-6 Astra, waar het lange-contextniveau boven 272.000 prompttokens overgaat naar $20 / $75 — het vermelden waard, want dit is de enige plek waar de kopcijfers van de twee leveranciers scherp uiteenlopen zodra een prompt lang wordt.
Twee regels bepalen dan de meeste facturen, niet het hoofdtarief: de korting op cache-leesbewerkingen gedurende een lange agent-run, en de batchkorting voor alles wat asynchroon is. Het hoofdtarief van $2 / $10 is wat op een leaderboard wordt vergeleken; de cache- en batchregels zijn waar een maandelijkse factuur daadwerkelijk uit is opgebouwd.
Wat de kloof wel en niet betekent
De Intelligence Index is één getal over een vaste takenmix, en die ene eigenschap verklaart het grootste deel van de verwarring eromheen. De tien evaluaties achter v4.3.2 omvatten agentic coderen en terminalwerk, wetenschappelijk redeneren op masterniveau, een software-engineeringsset, een agentic-automatiseringsset en een long-context-retrievalset, gewogen tot een samengestelde score. Een model dat 1,62 punten achterloopt op een ander, loopt achter op die samengestelde score — niet op jouw workload, die die tien in een heel andere verhouding kan wegen en taken kan bevatten die geen van hen vertegenwoordigt.
Wat dat in de praktijk betekent, is een splitsing op basis van de vorm van het werk in plaats van het prestige van de tier. Anthropics eigen documentatie maakt die splitsing expliciet, en het loont de moeite om die te lezen, want ze vleit het middensegment niet: de documentatie raadt lezers aan om "te beginnen met Claude Opus 5.5 voor de meeste workloads", en om naar Claude Fable 5.1 te grijpen "voor veeleisend redeneren en agentisch werk met een lange horizon, of wanneer je evals op Claude Opus 5.5 bij hogere effort nog steeds tekortschieten". Claude Sonnet 5.5 is niet het model waarmee die zin begint. Het is het model dat dezelfde documentatie beschrijft als de beste combinatie van snelheid en intelligentie, met de snelste vergelijkende latency buiten het kleine segment — wat een ander argument is, en een nauwere.
De eerlijke lezing is deze. Het middensegment is meestal het juiste antwoord voor goed afgebakend werk op volume: features en bugfixes tegen een bekende codebase, extractie en classificatie met een gedefinieerde uitvoervorm, tool-calling-loops waarbij het moeilijke deel de harness is in plaats van het redeneren, en alles waarbij een snelle eerste token en lage kosten per aanroep belangrijker zijn dan de laatste twee procent capaciteit. Het topmodel verdient zijn tarief wanneer het werk echt langdurig is: agentruns van meerdere uren, refactors die bestanden omvatten die de prompt niet in één keer kan bevatten, en evaluaties op het middensegment die aantoonbaar tekortschieten bij hogere inspanning. Die laatste voorwaarde is van de leverancier zelf, en het is een toetsbare voorwaarde: verhoog het inspanningsniveau op het middensegment, voer je eigen evaluatie uit en kijk of het de kloof dicht. Als dat lukt, was de 1.62 niet dragend voor jou. Als dat niet lukt, heb je je antwoord gekocht met je eigen cijfers in plaats van met de samengestelde score van iemand anders.
Wat het verschil niet betekent, is dat 1,62 punten niets zijn. Het is de volledige marge tussen twee modellen, en op een vaste testopstelling die onder identieke omstandigheden wordt geëvalueerd, is het een echte rangorde. Het is simpelweg een rangorde van een specifieke mix van taken, bij maximale inspanning met standaard fallback, en het zegt niets over welke van de twee de betere aankoop is voor een workload waarvoor geen van beide is gebenchmarkt.
De valstrik van de naam: welke Claude Sonnet 5.5-pagina dit is
Een lezer die naar de naam van dit model zoekt, komt op dit blog meerdere pagina's tegen die op deze lijken, maar dat niet zijn. Die van 2026-09-24 is de vooruitblikpagina: die is geschreven voordat het model werd uitgebracht, en het onderwerp was één X-bericht dat een stealthtest claimde, gereconstrueerd aan de hand van de cijfers van het model dat het zou vervangen. Die in de releaseweek is gepubliceerd, is het uitrolartikel: het onderwerp is de vijf breaking changes die van invloed zijn op code die al draait op Claude Sonnet 5, plus de zesde wijziging die de vorm van de respons verandert zonder een fout te veroorzaken. Er is ook een waaier aan matchup-pagina's die de naam van dit model tegenover modellen van andere leveranciers zetten, en een toegepaste pagina over wat de promotie bij de release omvat.
Geen van deze pagina's is de modelpagina, en dat is het gat dat dit stuk vult. Deze pagina is de referentie die een lezer bereikt nadat die op de naam van het model zelf heeft gezocht: wat het is, wat het kost, wat het meet, en welk werk erbij hoort. De migratiedetails van de uitrolpagina en de bronnenkritiek van de anticipatiepagina blijven waar ze zijn; als je Sonnet 5-code in productie hebt, is de uitrolpagina je eerste klik, en deze pagina vertelt je of het model waarnaar je migreert het model is dat je wilt.
Eén naamgevingsgewoonte is het waard om te corrigeren nu we toch bezig zijn, want die misleidt op zichzelf al. Een 5.5-achtervoegsel duidt op een generatie, niet op een rang. Claude Sonnet 5.5 en Claude Opus 5.5 zijn dezelfde generatie van dezelfde familie, en het getal vóór de punt is het niveau. Niets aan het achtervoegsel vertelt je welke van de twee een benchmark wint.
Beschikbaarheid, gedateerd
Claude Sonnet 5.5 staat sinds de release op OrcaRouter, als anthropic/claude-sonnet-5.5, tegen Anthropics eigen adviesprijs zonder enige opslag erbovenop: $2,00 voor input en $10,00 voor output per miljoen tokens, de twee waarden uitgelezen van ons eigen model-endpoint op 2026-10-08 en die regel voor regel overeenkomen met de tariefkaart van de leverancier. Onze pagina ervoor vermeldt hetzelfde contextvenster van 1M tokens en een maximale output van 128K, noemt tekst, afbeelding en bestand als geaccepteerde invoertypes en tekst als enige uitvoertype, markeert het als uitgebracht op 2026-09-28 en niet verouderd, en toont dat het zowel bereikbaar is via het OpenAI-compatibele chat-completions-endpoint als via Anthropics eigen messages-endpoint — wat het een drop-in wijziging maakt voor een integratie die al een van beide spreekt.
Al het andere in dezelfde catalogus is bereikbaar met dezelfde sleutel: één API voor meer dan 200 modellen, met de lijstprijs van de provider doorgegeven tegen 0% opslag zodat een prijsverlaging van een leverancier de klant bereikt op de dag dat die wordt aangekondigd, automatische failover wanneer een endpoint achteruitgaat, en een routing-DSL voor de gevallen waarin je een model wilt vastpinnen of meerdere wilt samenvoegen tot één antwoord. Die combinatie is wat de vraag op deze pagina goedkoop maakt om te beantwoorden in plaats van duur. Beide modellen in de bovenstaande vergelijking zitten achter dezelfde credential, dus de prijs waarmee je vergelijkt is de eigen gepubliceerde prijs van de leverancier en niet die van een wederverkoper, en de versietest kost een eval-run in plaats van een migratieproject: richt een deel van het verkeer op anthropic/claude-sonnet-5.5, laat de rest op het flagship-model staan, en laat je eigen cijfers voor kosten per voltooide taak beslissen welke de standaard moet zijn.

De korte versie
Claude Sonnet 5.5 is een model uit de middenklasse met cijfers die aan de flagship grenzen en de helft van de outputprijs van de flagship, en de drie feiten die bepalen of het je standaardmodel is, zijn deze. Het staat 1,62 punten achter Claude Opus 5.5 op de v4.3.2-index van Artificial Analysis, op 56,00 tegenover 57,62, waarbij beide cijfers zijn gemeten op dezelfde revisie en in dezelfde max-effort-configuratie met standaard fallback. Het kost $2 / $10 tegenover $4 / $20 van de flagship, waarbij de cache- en batchkortingen proportioneel zijn in plaats van verschillend, dus het prijsverschil blijft bestaan bij elke korting die een van beide modellen biedt. En het gebruikt standaard hoge inspanning, terwijl de flagship standaard op gemiddeld staat, wat betekent dat een instelling die van de flagship is overgenomen hier één niveau hoger uitpakt in plaats van lager, en de kosten daarvan moet je meten in plaats van aannemen.
Anthropics eigen picker begint voor de meeste workloads nog steeds bij Claude Opus 5.5, en dat is goed om te weten voordat je je op wat dan ook standaardiseert. Maar voor de meeste lezers die via een zoekopdracht naar de naam van dit model op deze pagina belanden, is het middensegment de verstandige standaard en is het vlaggenschip de uitzondering die je koopt wanneer je eigen evals daarom vragen: goed afgebakend werk in grote volumes, snelle latentie, een venster van een miljoen tokens zonder toeslag voor lange context, en een tarief dat de outputregel halveert. Beide zijn op OrcaRouter met één key te bereiken, en de eval die tussen beide beslist, kost een middag in plaats van een migratie.
Vergeleken in dit artikel4
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
