Hero-titelkaart gegenereerd voor Claude Sonnet 5.5 vs Claude Opus 5, met als ondertitel 'Een prijsverlaging van 60% en een verschil van vijf punten', met $2,00 en $10,00 per miljoen tokens tegenover $5,00 en $25,00, met het OrcaRouter-logo samengesteld in de rechteronderhoek.
Guides & Insights

Claude Sonnet 5.5 vs Claude Opus 5: Goedkoper op elke regel, en voorop in de index

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Opus 5 werd op 24 juli 2026 uitgebracht voor $5,00 per miljoen inputtokens en $25,00 per miljoen outputtokens. Claude Sonnet 5.5 werd op 28 september 2026 algemeen beschikbaar voor $2,00 en $10,00. Dat is een verlaging van 60% op de input en een verlaging van 60% op de output voor een model dat twee generaties nieuwer is — en, op de testomgeving die Artificial Analysis op beide toepast, een model dat op 56 uitkomt in Intelligence Index v4.3 tegenover de 51 van Claude Opus 5. Dit is de zeldzame vergelijking waarbij het nieuwere, goedkopere model ook het hoger scorende model is op een index van een derde partij, en waarbij het resterende argument voor het gevestigde model niet de benchmarkrang is, maar een specifieke klasse van werk. Beide modellen hebben een contextvenster van 1M tokens, beide genereren maximaal 128K tokens, beide lezen tekst, afbeeldingen en bestanden, en beide stellen redenering in via een effort-parameter in plaats van een budget voor denk-tokens. Omdat de interfaces hetzelfde zijn, is de keuze tussen beide puur een kwestie van wat een afgeronde taak kost en welke taken falen.

Twee releases, één interface

Begin met hoe weinig er verandert, want dat is meer dan bij de meeste generatiesprongen.

• Contextvenster — 1.000.000 tokens op beide

• Maximale uitvoer — 128.000 tokens op beide

• Invoermodaliteit — tekst, afbeelding en bestand op beide; geen audio, geen video op geen van beide

• Redeneren — adaptief denken met configureerbare inspanning op beide, zodat diepgang een requestparameter is in plaats van een aparte modelstring

• Mogelijkheden — vision, tools, JSON en redeneren op beide, volgens de OrcaRouter-catalogusvermeldingen voor anthropic/claude-opus-5 en de Sonnet-lijn

Het praktische gevolg is dat een prompt die voor Claude Opus 5 is geschreven niet hoeft te worden herschreven om op Claude Sonnet 5.5 te draaien, en dat een agent-loop die is afgestemd op een uitvoerplafond van 128K geen nieuw niveau nodig heeft. Migratie is een model-string omwisselen plus opnieuw controleren welke effort-instelling je had vastgezet — meer niet. Voor teams die de multimodale, multi-parameterovergangen van de afgelopen twee jaar hebben meegemaakt, is dat het belangrijkste nieuws, niet de benchmark.

Het enige dat wél verandert, is de prijs, en die verandert bij elke regel in plaats van alleen bij de twee op de marketingdia.

• Input — $2,00 per miljoen tegenover $5,00, een verlaging van 60%

• Uitvoer — $10,00 per miljoen tegenover $25,00, een verlaging van 60%

• Cache-lezen — $0,20 per miljoen tegenover $0,50, een verlaging van 60%

• Cache schrijven — $2,50 per miljoen tegenover $10,00 voor het vijfminutenvenster, een verlaging van 75%

Als je een agent draait die elke beurt een lange prefix opnieuw leest, is de regel voor het lezen uit cache degene die de migratie betaalt. Bij $0,20 tegenover $0,50 kost elke gecachte token in een lange sessie nog maar 40% van zijn oude kosten, en cache-lezingen vormen het grootste deel van het aantal tokens in de meeste agentische loops. De besparing stapelt zich op op een manier die de kop per token niet vangt.

Waar de vijf punten vandaan komen

Artificial Analysis geeft Claude Sonnet 5.5 een score van 56 en Claude Opus 5 een score van 51 op Intelligence Index v4.3, beide gemeten onder de configuratie "Adaptive Reasoning, Max Effort". Vijf punten is geen afrondingsfout op die schaal — ter context: dezelfde evaluator plaatst Sonnet 5 op 38 en Gemini 3.1 Pro Preview op 30, dus het verschil tussen Claude Opus 5 en Claude Sonnet 5.5 is een derde van het verschil tussen Claude Opus 5 en de vorige Sonnet-generatie.

De eigen lanceringscijfers van Anthropic voor Claude Sonnet 5.5 wijzen met een ander instrument in dezelfde richting. Het bedrijf meldt 70,6% op Terminal-Bench 4.0 — dezelfde test waarop Claude Opus 5 in een eerdere tabel van Anthropic op 89,1% wordt gedocumenteerd, een cijfer dat op een andere revisie van het testharnas is gebaseerd en niet van het nieuwere mag worden afgetrokken. Dat is de allerbelangrijkste waarschuwing over bronvermelding in dit artikel: Terminal-Bench stapte halverwege 2026 over naar 4.0, de index die het bevatte werd dienovereenkomstig herzien naar v4.3, en vergelijkingen tussen versies van die benchmark zijn niet puur rekenkundig. Als een cijfer een versie heeft, vermeld dan de versie.

Wat zuiver vergeleken kan worden, is de eigen progressie van de leverancier aan de Sonnet-kant — 10,3% op Terminal-Bench 4.0 voor Sonnet 5 tot 70,6% voor Sonnet 5.5 — en de indexmeting door derden, waarbij beide cijfers op dezelfde dag uit dezelfde harness komen. Op basis van dat bewijs heeft de opvolger het juli-vlaggenschip op het gebied van algemeen redeneren echt overtroffen, wat een sterkere bewering is dan welke leveranciersslide dan ook doet.

De uitvoerlengte-valkuil

Dit is het punt waarop de rekensom niet langer in het voordeel van het nieuwere model uitpakt.

Artificial Analysis meldt dat het evalueren van Claude Sonnet 5.5 op zijn indexsuite $7,60 per taak kost. Claude Opus 5 kost $5,86 per taak op dezelfde suite. Het nieuwere model, met 60% korting op elke regel van de tariefkaart, is ongeveer 30% duurder om een taak mee af te ronden. De reden staat in hetzelfde rapport: Sonnet 5.5 genereerde 410 miljoen tokens over de suite, tegenover een mediaan van 88 miljoen bij de gevolgde modellen, wat de evaluator bestempelt als "zeer wijdlopig". Claude Opus 5 genereerde 140 miljoen over dezelfde suite.

Als je het uitrekent, is het mechanisme eenvoudig. Sonnet 5.5 produceert bij identiek werk ongeveer drie keer zoveel outputtokens als Claude Opus 5, tegen 40% van de outputprijs. Drie keer 0,4 is 1,2 — een penalty van 20% vóór cache-effecten, wat in de buurt komt van het resultaat van $7,60 tegen $5,86. De prijs per token is niet verkeerd; het is alleen niet het getal dat de factuur bepaalt.

Dit maakt het nieuwere model niet de slechtere koop. Het laat de beslissing afhangen van iets wat de meeste vergelijkingen weglaten: of je workload je toestaat de uitvoer te begrenzen. Een samenvattingstaak met een lengte-instructie, een pipeline voor gestructureerde extractie die JSON oplevert, een classifier die een label teruggeeft — in al die gevallen komt de breedsprakigheid nooit aan bod, en de korting van 60% op de tariefkaart is echt geld. Een open-ended agent die wordt gevraagd "de repo te fixen" zonder enige uitvoerdiscipline geeft Sonnet 5.5 drie keer zoveel touw.

Effort-instellingen en de migratie waarvoor niemand een budget uittrekt

Beide modellen ontsluiten redeneerdiepte via een effort-parameter met meerdere niveaus, en beide leveren een standaardwaarde in plaats van een vaste waarde — hoog op het Claude Platform, gemiddeld in de Claude-apps. De verleiding bij een migratie is om de instelling te laten staan waar die op het oude model stond en de klus als geklaard te beschouwen.

Dat is een fout om een meetbare reden. Anthropics eigen voetnoot voor Claude Sonnet 5.5 stelt dat de Max effort-configuratie lager scoort dan Xhigh op FrontierCode, wat betekent dat effort geen monotone knop is en dat de hoogste instelling geen gratis upgrade is. Stel effort in door je taak te meten, niet door de duurste beschikbare optie te kiezen.

Er is ook een fundamenteel gedragsverschil aan de Sonnet-zijde dat het waard is om te weten vóór een uitrol. Anthropic stelt dat Claude Sonnet 5.5 de eerste Sonnet is die wordt geleverd met cyberbeveiligingsmaatregelen en terugvalopties die overeenkomen met die van zijn topmodellen, zodat beveiligingsverzoeken met een hoger risico zichtbaar terugvallen op de eerdere Sonnet in plaats van te worden afgehandeld door het model dat je hebt genoemd. Als je workload in dat domein valt, zullen je logs een model tonen dat je niet hebt aangevraagd. Claude Opus 5 bestond al vóór die regeling in de Sonnet-lijn, hoewel dezelfde soort routering binnen het hele product van Anthropic bestaat voor biologie- en cybersecuritywerk op de flagshiptiers.

Op OrcaRouter zijn beide endpoints vandaag live — anthropic/claude-opus-5 en anthropic/claude-sonnet-5 staan in dezelfde catalogus als al het andere, geprijsd tegen de lijstprijs van de provider met 0% opslag — en Claude Sonnet 5.5 zal op datzelfde inloggegeven bereikbaar zijn zodra het vermeld wordt. De relevante capaciteit in de tussentijd is automatische failover: als het ene Anthropic-niveau met een snelheidslimiet te maken krijgt of fouten retourneert, kan de aanvraag naar het andere worden omgeleid zonder codewijziging, wat de goedkoopst mogelijke vorm van indekking is tegen het ongelijk hebben in deze vergelijking.

De beslissing, als regel geformuleerd

Als je werk afgebakend is — je beheert de vorm van de output, de prompts zijn gestructureerd en het tokenaantal per taak is voorspelbaar — stap dan over op Claude Sonnet 5.5 en profiteer van de 60% besparing. De index is het ermee eens, de tariefkaart is het ermee eens, en er blijft geen capaciteitsargument meer over aan de andere kant.

Als je werk open-ended en agentisch is, voer het experiment dan uit voordat je een van beide prijslijsten gelooft. Meet een week lang per model het aantal tokens per voltooide taak op je eigen verkeer; het resultaat van derden van $7,60 tegenover $5,86 is een specifieke waarschuwing dat de goedkopere tariefkaart de hogere rekening kan opleveren. Claude Opus 5 blijft de veiligere standaard voor langdurig autonoom werk totdat je dat cijfer hebt.

Het eerlijke oordeel: dit is de eerste Sonnet-generatie waarbij het bestaansrecht van het vlaggenschip berust op de vorm van de taak in plaats van op ruwe capaciteit, en wie de beslissing nog steeds alleen op de modelnaam baseert, laat nu 60% liggen of betaalt 30% meer per afgeronde taak, louter afhankelijk van welke kant diegene op gokt.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Opus 5 across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run, 410M output tokens on the index suite. Right column Claude Opus 5: input $5.00, output $25.00, cache read $0.50, cache write $10.00, 1M context with 128K max output, AA Intelligence Index v4.3 score 51, $5.86 per task on the index run, 140M output tokens on the index suite. A footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Sonnet 5.5 is 60% cheaper on input, output and cache reads and 75% cheaper on cache writes, and still costs about 30% more per finished task."Screenshot of the OrcaRouter model page for Anthropic Claude Opus 5 (anthropic/claude-opus-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.19-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-07-24" line, and the $5.00 input and $25.00 output prices per million tokens.Screenshot of Artificial Analysis's model page for Claude Sonnet 5.5, named in full as "Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" and marked released September 2026, showing the In $2.00 and Out $10.00 rates, the Intelligence Index score of 56, the $7.60 average cost per task, and the 410M output tokens described as very verbose against a median of 88M.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt