
Claude Sonnet 5.5 vs Claude Sonnet 5: identieke prijzen, verschillende facturen
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 984 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 195 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
Two models from the same vendor, same tier, same name, and — on every line of the published rate card — the same price. Claude Sonnet 5 launched on June 30, 2026 at $2.00 per million input tokens and $10.00 per million output tokens. Claude Sonnet 5.5 reached general availability on September 28, 2026 at $2.00 and $10.00, with cache reads at $0.20 and five-minute cache writes at $2.50 on both. Nothing about the price changed. What changed is everything a price sheet does not measure, and the result is that one of these two models is substantially cheaper to operate than the other despite costing exactly the same per token. Anthropic's own headline for the release says as much without quite saying it: up to 30% lower cost for most work, on an unchanged rate card. The only way both sentences are true is if the newer model finishes the same job with fewer tokens, which is what the benchmarks show and what the independent per-task figures confirm.
Is Claude Sonnet 5.5 duurder dan Claude Sonnet 5?
Nee — en de vraag is hoe dan ook serieus te nemen, want heel wat migraties zijn misgelopen doordat een vaste tariefkaart als een vaste factuur werd behandeld.
Per token zijn de twee modellen identiek: $2.00 in, $10.00 out, $0.20 om een token te lezen, $2.50 om een token te schrijven. Er is geen getrapt tarief en geen toeslag voor lange context. Wat het nieuwere model ook is, het is geen prijsverhoging vermomd als een generatie.
Per voltooide taak kantelt het beeld afhankelijk van wiens werkbelasting je beschrijft. Artificial Analysis rapporteert een kostenpost van $5,09 per taak voor Claude Sonnet 5 en $7,60 per taak voor Claude Sonnet 5.5 op dezelfde Intelligence Index v4.3-suite — waarbij het nieuwere model 49% duurder is om een taak mee af te ronden, tegen een identiek tarief. Hetzelfde rapport merkt op dat Sonnet 5.5 410 miljoen tokens genereerde in de suite, tegenover 370 miljoen voor Sonnet 5, beide tegenover een mediaan van 88 miljoen voor het gevolgde veld. Bij de open prompts van de evaluator schrijft het nieuwere model simpelweg meer, en bij gelijke prijzen betekent meer tokens een hogere rekening.
Anthropics claim dat het 30% goedkoper is, is een leveranciersclaim over zijn eigen gekozen workloads. De $7,60 tegenover $5,09 van een derde partij is een meting op een andere set. Geen van beide is onjuist; de discrepantie is het hele verhaal, en de beslissende factor is of jouw taken hun eigen output begrenzen.
Wat is er daadwerkelijk veranderd tussen de twee generaties?
De tariefkaart is statisch; het model niet. In één enkele lijst weergegeven zijn de delta's groot en grotendeels in één richting.
• Terminal-Bench 4.0 — 70,6% voor Claude Sonnet 5.5 tegenover 10,3% voor Claude Sonnet 5, de grootste generatiesprong die Anthropic op deze test heeft gepubliceerd
• CursorBench 4.0 — 55,5% tegen 34,1%
• Chartography, geen hulpmiddelen — 61,6% tegen 15,6%
• GDPval-AA v2.1 — 1844 tegen 1449
• AA-Briefcase v1.1 — 1811 tegen 1359
• Humanity's Last Exam, met hulpmiddelen — 64,5% tegen 54,9%
• OSWorld 2.1, gedeeltelijke voltooiing — 80,1% tegen 57,0%
• Artificial Analysis Intelligence Index v4.3 — 56 tegen 38, een verschil van achttien punten op een schaal van een derde partij, gemeten onder dezelfde configuratie "Adaptive Reasoning, Max Effort"
De vorm van die lijst is geen uniforme vooruitgang. Chartography die van 15,6% naar 61,6% gaat en Terminal-Bench die van 10,3% naar 70,6% gaat, zien eruit als capaciteiten die ontbraken en nu aanwezig zijn, niet als capaciteiten die zijn verbeterd. Humanity's Last Exam die tien punten stijgt en OSWorld die drieëntwintig punten stijgt bij een ongewijzigde prijs, is het patroon van een generatie die specifieke hiaten dichtte in plaats van een die over het algemeen slimmer werd. De indexkloof van achttien punten is het rekenkundige gemiddelde daarvan: reëel, groot en geconcentreerd in toolgebruik, code-uitvoering en visueel werk.
Eén voetnoot is van belang voor iedereen die de leverancierstabel aandachtig leest. Anthropic stelt dat op FrontierCode de Max effort-configuratie lager scoort dan Xhigh, en het merkt op dat de GDPval-AA- en AA-Briefcase-runs zijn uitgevoerd op een pre-release-implementatie met een bug in gestructureerde uitvoer. De bovenstaande cijfers zijn nog steeds de best beschikbare, maar beschouw ze als een momentopname van één implementatie, niet als een permanente eigenschap van het model.
Waarom de prijs gelijk is en de rekening niet
Drie mechanismen, in aflopende volgorde van de mate waarin ze een echte factuur beïnvloeden.
Het eerste is discipline in de outputlengte. Sonnet 5.5 is een capabelere agent, wat betekent dat hij meer doet voordat hij antwoordt, en in een suite zonder lengtebeperking schrijft hij ongeveer 11% meer dan Sonnet 5, terwijl hij per token hetzelfde kost. Bij een workload die de output begrenst — extractie naar een vast schema, classificatie, begrensde samenvattingen — materialiseert die 11% nooit en wordt de 30%-claim geloofwaardig, omdat de winst erin zit dat je het antwoord in minder beurten bereikt in plaats van in minder tokens per beurt.
Het tweede is cachegedrag, en het is de reden waarom een ongewijzigde cache-leesprijs niet betekent dat de cachekosten ongewijzigd zijn. Cache-lees- en schrijfbewerkingen zijn identiek op beide modellen, dus elke verandering in het volume van gecachte tokens stroomt rechtstreeks door naar de factuur. Een model dat minder beurten nodig heeft om een agentische taak af te ronden, leest zijn prefix minder vaak. Dat is een besparing waar helemaal geen prijsbeweging achter zit, en het is onzichtbaar in elke vergelijkingstabel die alleen tariefkaartregels vermeldt.
De derde is degene die de meeste teams op migratiedag verkeerd doen: de standaardwaarde voor effort. Claude Sonnet 5.5 configureert redenering via een effort-parameter met de instellingen low, medium, high, xhigh en max, met standaard high op het Claude Platform en medium in de Claude-apps. Als je bent gemigreerd van een Sonnet 5-implementatie waarin je een redeneerbudget had vastgezet, kan de nieuwe standaard een andere diepte zijn dan waarvoor je betaalde. Meet voordat je uitgaat van een besparing of een verhoging.
Er is ook een gedragsconsequentie die het waard is om vóór de uitrol te melden in plaats van erna. Anthropic stelt dat Claude Sonnet 5.5 de eerste Sonnet is die wordt gelanceerd met cyberbeveiligingen en fallbacks op hetzelfde niveau als de topmodellen van Anthropic, dus verzoeken op het gebied van cyberbeveiliging met een hoger risico vallen zichtbaar terug op de vorige Sonnet. In uw logs ziet u een model dat u niet hebt aangevraagd. In verband hiermee: als u Sonnet uitvoert met denken uitgeschakeld, moet u overschakelen op een gedrag tussen tools — een codewijziging, geen vlag.
Op OrcaRouter, anthropic/claude-sonnet-5 is vandaag routeerbaar op één credential tegen de listprijs van de provider met 0% opslag, naast Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro en Gemini 3.1 Pro Preview. Claude Sonnet 5.5 zelf is nog geen route op ons platform, dus de praktische vorm van deze vergelijking is op dit moment dat een team dat al Sonnet 5 draait het verschil kan meten op de dag dat het wordt vermeld zonder een API-sleutel aan te raken, en kan in de tussentijd tussen tiers failoveren door een string te wijzigen.
Vragen die mensen stellen voordat ze overstappen
Kan ik beide tegelijk draaien en vergelijken op mijn eigen verkeer? Nog niet via één OrcaRouter-credential, want Claude Sonnet 5.5 staat niet als route in de lijst. De workaround is om het nieuwere model via de eigen API van Anthropic te draaien en het oudere via ons, en dan tokens per voltooide taak te vergelijken in plaats van kosten per token, want dat is het cijfer waarop de twee modellen echt van elkaar verschillen.
Betekent de ongewijzigde prijs dat Anthropic geen kosten in rekening brengt voor de nieuwe mogelijkheid? Het betekent dat de lijstprijs gelijk wordt gehouden terwijl het model verbetert, hetzelfde patroon als bij de vorige twee Sonnet-generaties. Of dat aanhoudt, is een commerciële kwestie, niet een technische, en het gepubliceerde uitfaseringsvenster — niet eerder dan september 2027 — is de enige verbintenis die eraan is verbonden.
Welk getal moet ik vertrouwen, Anthropics 30% of de 49% van een derde partij? Geen van beide als een algemene bewering. Het getal van Anthropic beschrijft werklasten waarin het model in minder beurten tot een antwoord komt; het getal van Artificial Analysis beschrijft een onbeperkte indexsuite waarin uitvoerigheid vrij kan groeien. Kies degene die op jouw promptset lijkt, en als je niet kunt zeggen welke dat is, dan is die ambiguïteit zelf het antwoord — meet het.
Kortom
Claude Sonnet 5.5 is geen prijsverhoging, maar het is ook niet automatisch een besparing. Anthropic hield elke regel van de tarievenkaart ongewijzigd en zette het model eronder, wat betekent dat de hele economische onderbouwing berust op tokens per voltooide taak — een aantal dat 30% beter is op de workloads die de leverancier koos en 49% slechter op de suite die een onafhankelijke beoordelaar koos. Als uw taken hun eigen uitvoer begrenzen, stap dan over en pak de winst. Als dat niet het geval is, is de gelijkblijvende prijs geen reden om de meting over te slaan, want u kunt anderhalf keer zoveel per taak betalen voor een model dat onmiskenbaar beter is in het werk.



