Hero-titelkaart voor Claude Opus 5.5, met als kop 'Anthropic verlaagt de prijs van zijn vlaggenschip', met badges met $4 in / $20 uit, cacheread $0,20 en 22 september 2026, en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

Claude Opus 5.5: Anthropic verlaagt de prijs van zijn vlaggenschip, en dat is het echte verhaal

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

De leverancier bracht Claude Opus 5.5 uit op 22 september 2026, en het getal dat ertoe doet staat op geen enkele benchmarkgrafiek. Het is $4. Het nieuwe topmodel kost $4 per miljoen inputtokens en $20 per miljoen output, tegenover de $5/$25 die Claude Opus 5 sinds 24 juli hanteert — en cachereads dalen van $0,50 naar $0,20 per miljoen, een verlaging van 60% op de kostenpost die lange agent-runs domineert. Het model is ook beter: het bedrijf meldt dat het op de meeste taken Claude Fable 5.1 evenaart, het niveau van $10/$50 daarboven. Maar dat een frontierlab de catalogusprijs van zijn beste algemeen beschikbare model met 20% verlaagt — en zegt dat de werkelijke kosten om het te draaien met 40% zijn gedaald — is het deel van deze lancering dat verandert wat je je kunt permitteren te bouwen. Capability-releases worden binnen een kwartaal gekopieerd. Een prijsverlaging in het topsegment verlaagt de ondergrens voor iedereen.

Het verschil, in de bedragen die je daadwerkelijk betaalt

A single-column scoreboard for Claude Opus 5.5 listing input price $4.00 per million down from $5.00, output $20.00 down from $25.00, cache read $0.20 down from $0.50, default effort medium versus high, Terminal-Bench 4.0 66.4% at xhigh effort, and an AA Intelligence Index of 54, with a sourcing footer.

Alles hieronder is de gepubliceerde tariefkaart van Anthropic, geen schatting:

• Invoer — $4 per miljoen tokens, een daling ten opzichte van de $5,00 van Opus 5

• Uitvoer — $20 per miljoen tokens, een daling van $25,00

• Cache-lezen — $0,20 per miljoen, gedaald van $0,50

• 5 minuten durende cacheschrijfactie — $5 per miljoen; 1 uur durende cacheschrijfactie — $8

• Batch API — 50% korting in beide richtingen, zoals voorheen

• Context en uitvoer — 1M-token context, 128K maximale uitvoer, 300K uitvoer op de Batch API achter de output-300k-2026-03-24 bèta-header

• Kennisafsluitdatum — juni 2026

• Inspanning — adaptief denken altijd aan, standaard medium; de schaal kent low, medium, high, xhigh, max

Er is ook een Fast-modus op de Claude API, apart geprijsd op $8/$40 per miljoen en door Anthropic beschreven als een onderzoekspreview in plaats van een algemene optie.

De cacheregel verdient de meeste aandacht, en juist die wordt overgeslagen in de berichtgeving rond de lancering. Voor een agent die bij elke beurt een grote systeemprompt en een lange bestandsboom opnieuw verstuurt, zijn uitlezingen uit de cache de dominante kostenpost, niet nieuwe invoer. Een verlaging van 60% daarop doet meer voor een echte programmeerworkload dan de verlaging van 20% op het hoofdtarief — en daarom komt de rekensom in de volgende sectie uit zoals ze uitkomt.

Waar de claim "40% goedkoper" vandaan komt

Anthropic zegt dat Opus 5.5 bij typische workloads ongeveer 40% minder kost om te draaien dan Opus 5. Dat is ongeveer het dubbele van de prijsverlaging, wat betekent dat het grootste deel ervan niet aan prijsstelling toe te schrijven is — het is het model dat minder werk verricht om hetzelfde antwoord te bereiken. Anthropic meldt dat de output meer dan 30% sneller wordt gegenereerd dan met Opus 5, en verschillende klanten uit de lanceerfase koppelen er tokenreducties aan: Box zegt een derde van de tokens, met antwoorden die ongeveer 40% minder uitgebreid zijn, Kiro meldt ongeveer de helft van de tokens en 40% minder aanroepen, Factory noemt 20–25% minder outputtokens, en GitHub zegt dat het model een van de laagste aantallen tokens en stappen gebruikte die het heeft gemeten.

Dat zijn door leveranciers gepubliceerde klantcitaten, geen gecontroleerde metingen, en vooral de "40%" is Anthropics eigen karakterisering van een gemiddelde over workloads die het zelf heeft gekozen. Zie het als een indicatie, niet als een getal om in een budget op te nemen. De onderdelen die je vandaag onafhankelijk kunt verifiëren, zijn de tariefkaart — die staat op Anthropics openbare prijspagina — en de tokenaantallen die je eigen workload oplevert wanneer je die draait.

Het nuttigste uitgewerkte voorbeeld in het lanceringsmateriaal is ook het minst opvallend: een fusieanalyse waarvoor Opus 5.5 63 minuten nodig had en die 50% minder kostte dan dezelfde taak op Opus 5, waarvoor 93 minuten nodig waren. Als je de prijs van een agent bepaalt, is de interessante grootheid die verhouding, niet het tarief per token — een goedkoper model dat drie passes nodig heeft om af te ronden, heeft je niets bespaard.

De benchmarktabel, en wie deze heeft geproduceerd

Elk onderstaand head-to-head-cijfer komt uit het lanceringsmateriaal van Anthropic, uitgevoerd tegen zijn eigen modellen en die van zijn concurrenten. Dat is normaal bij een lancering, en daarom moet niets ervan als een onafhankelijk oordeel worden gelezen. De cijfers worden doorlopend aangeduid als door de leverancier gerapporteerd.

• Terminal-Bench 4.0 — Opus 5.5 66,4%, Opus 5 52,3%, Fable 5.1 55,8%, GPT-6 Astra 57,9%. Anthropic merkt op dat de run xhigh effort gebruikte, niet de standaard.

• FrontierCode v1.1 (Main) — Opus 5.5 54,4%, Opus 5 48,0%, Fable 5.1 50,3%, GPT-6 Astra 53,3%; 54,6% bij de standaard medium inspanning.

• CursorBench 4.0 — Opus 5.5 57,8%, Opus 5 46,6%, Fable 5.1 51,8%; 52,5% bij gemiddelde inspanning.

• GDPval-AA v2.1, kenniswerk — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.

• Terminal-Bench-Science 0.1 — Opus 5.5 58,7% tegenover 29,0% van Opus 5, met GPT-6 Astra voorop op 64,6%.

• OSWorld 2.0, computergebruik — 81,8% voor Opus 5.5 tegenover 74,0% voor Opus 5, gemarkeerd als een gedeeltelijk resultaat.

Twee dingen springen uit die lijst. Ten eerste is medium effort niet veel slechter dan max: 54,6% tegenover 54,4% op FrontierCode en 52,5% tegenover 57,8% op CursorBench. Omdat effort de kosten rechtstreeks bepaalt, is dat FrontierCode-resultaat — geen meetbaar verlies bij de standaardinstelling — de bevinding waar geld aan vastzit. Ten tweede waarschuwt Anthropic zelf dat bij dit capaciteitsniveau benchmarkmarges "een minder betrouwbare gids voor verschillen in de praktijk" zijn, en dat het interne gat naar Fable 5.1 kleiner is dan de scores suggereren. Een leverancier die je aanraadt zijn eigen tabel te relativeren, is de meest geloofwaardige zin in het document.

Aan de onafhankelijke kant gaf Artificial Analysis Claude Opus 5.5 een score van 54 op zijn Intelligence Index, de derde plaats onder de modellen die het volgt, in een configuratie met het label "Adaptive Reasoning, High Effort, Default Fallback." Die laatste clausule doet echt werk, en ze leidt direct naar de volgende sectie.

De beveiligingsroutering maakt deel uit van de spec

Dat label "Default Fallback" in het onafhankelijke resultaat is geen benchmarkartefact. Opus 5.5 wordt geleverd met het beveiligingsniveau dat Anthropic voorheen voorbehield aan Fable 5.1, omdat het vergelijkbaar is met Claude Mythos 5.1 op het gebied van biologie en cybersecurity. In de praktijk betekent dat dat de meeste cybersecurityverzoeken worden doorgestuurd naar Claude Opus 4.8, en biologiewerk valt terug op Claude Opus 5, tenzij het account is geverifieerd via Anthropic's Life Sciences- of Cyber Verification-programma's.

Als je product cybergerelateerde of life-sciences-prompts naar claude-opus-5-5 stuurt, is het antwoord dat je terugkrijgt misschien helemaal niet afkomstig van Claude Opus 5.5. Je evaluatie, je kosten per taak en je kwaliteitsmetingen bevatten op die beurten stilletjes ook een kleiner model. Voor de meeste teams gebeurt dit nooit. Voor iedereen die met beveiligingstools of biotech werkt, gebeurt het voortdurend, en het is het belangrijkste operationele detail van deze release — het betekent ook dat een werkende API-integratie toch resultaten kan opleveren die slechter zijn dan je vorige model, precies bij de prompts die je het belangrijkst vindt. Er zijn nieuwe verificatieniveaus beschikbaar; controleer of je in een daarvan zit voordat je aanneemt dat de modelstring betekent wat er staat.

Vier breaking changes voordat je de string omwisselt

Screenshot of Anthropic's Claude Platform documentation page for Claude Opus 5.5, showing the model overview line 'For long-running agentic coding and knowledge work', the model ID claude-opus-5-5, a 1M-token context window, 128K max output, and input pricing $4 and output pricing $20 per million tokens.

Opus 5.5 is geen drop-invervanging voor, of een hernoeming van, Claude Opus 5. De eigen migratienotities van Anthropic noemen vier wijzigingen die bestaande code zullen breken:

• Denken kan niet langer worden uitgeschakeld. Code die thinking: disabled instelde of vertrouwde op een niet-denkend pad, geeft een fout of verandert stilzwijgend van gedrag; de diepte wordt nu alleen via de effort-parameter geregeld.

• Geforceerd gebruik van tools geeft een foutmelding. Het doorgeven van een tool_choice die een specifieke tool forceert, wordt niet ondersteund.

• Denkblokken zijn gebonden aan het model dat ze heeft voortgebracht en aan het gesprek, dus ze kunnen niet over modellen heen opnieuw worden afgespeeld zoals sommige pipelines veronderstellen.

• De eerdere computer_20251124 computer-use-tool wordt niet geaccepteerd op de Claude API of Google Cloud.

Er is een vijfde wijziging die niets laat mislukken, maar wel de uitvoer verandert: tekst tussen toolaanroepen komt nu terug in denkblokken waarvan de tekst leeg is bij de standaardweergave-instelling. Een applicatie die die tekst als voortgangsupdates naar gebruikers streamt, zal tussen toolaanroepen stilvallen totdat deze een weergavewaarde instelt die de tekst teruggeeft. Niets geeft een fout; de UI houdt gewoon op met praten. Dat is het soort regressie dat in productie terechtkomt omdat elke test slaagt.

De eerste drie wijzigingen gelden ook voor Fable 5.1, dus als je al naar dat model bent gemigreerd, is het werk deels gedaan.

Het draaien naast wat je al hebt

Het migratiedetail dat teams het meest kost, zijn niet de API-wijzigingen; het is dat een nieuwe Opus met een andere effort-schaal het kostenmodel ongeldig maakt dat je rond de oude hebt gebouwd. Anthropic's eigen advies is om meerdere effort-niveaus te testen in plaats van de instellingen van Opus 5 zomaar over te nemen, wat betekent dat het antwoord op "is 5.5 goedkoper voor ons" afhangt van een meting die nog niemand op jullie prompts heeft uitgevoerd.

Die meting is makkelijker uit te voeren zolang het oude model nog op één aanroep afstand staat op dezelfde sleutel. Claude Opus 5 staat vandaag op OrcaRouter tegen Anthropic's eigen $5,00/$25,00 met 0% markup — de lijstprijs van de provider wordt doorgegeven, dus het tarief dat je ziet is het tarief dat Anthropic publiceert. Claude Opus 5.5 is nog niet een van onze routes; het is beschikbaar via Anthropic's eigen API en de grote clouds. Wanneer het arriveert, wordt het vergelijken van de twee bij gelijke inspanning een routeringsregel in plaats van een tweede integratie: stuur een deel van het verkeer naar het nieuwe model, houd automatische failover gericht op het model dat je al hebt gekarakteriseerd, en lees je eigen tokentellingen in plaats van een lanceringsstabel. Een aanroep samenstellen over meerdere modellen — het ene schrijft, het andere verifieert — is een regel in de routerings-DSL op hetzelfde eindpunt.

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), showing the model header, the Vision, Tools, JSON and Reasoning capability tags, the attribution 'by Anthropic - 2026-07-24', and the model description.

Wat je daarmee niet krijgt, is een onafhankelijk oordeel over Opus 5.5. Niets geeft dat vooralsnog: de gepubliceerde head-to-heads zijn van Anthropic zelf, en de enige score van buitenaf die bestaat, is één enkele effort-configuratie van een uitgerold systeem met ingebakken fallback-routing.

Het krijgen, en wat er nog aankomt

Claude Opus 5.5 is beschikbaar onder de model-ID claude-opus-5-5 op de Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry en Claude Platform on AWS. Anthropic vermeldt de status als actief en uitfasering niet eerder dan 22 september 2027.

Twee dingen volgen daarop. Anthropic zegt dat Claude Sonnet 5.5 en Claude Haiku 5.5 "in de komende weken" komen, met veel van dezelfde efficiëntie- en veiligheidsverbeteringen — wat, als dat standhoudt, de belangrijkere gebeurtenis is voor iedereen wiens workload geen frontier Opus nodig heeft. En het beeld van de onafhankelijke benchmarks is nog niet uitgekristalliseerd: de Artificial Analysis-score is een eerste blik op één effort-configuratie, in een uitgerold systeem met het hierboven beschreven fallbackgedrag, geen stabiele rangschikking.

Een oprecht hiaat in deze lancering: Anthropic meldt dat Opus 5.5 vaak vermoedt dat het wordt geëvalueerd. Dat wordt als beperking bekendgemaakt, en het raakt precies aan wat benchmarktabellen meten. Een model dat zich anders gedraagt wanneer het weet dat het in de gaten wordt gehouden, is een model waarvan de scores, of ze nu van de leverancier of onafhankelijk zijn, minder voorspellend zijn dan het formaat suggereert.

Claude Opus 5.5 is de derde release in de Opus-klasse in vier maanden en de eerste lancering sinds de chief executive van Anthropic publiekelijk pleitte voor het matigen van het tempo van frontierontwikkeling. Beide feiten staan in hetzelfde document. Over de capaciteitscijfers zal een week lang worden gediscussieerd; de prijs en het cachetarief zullen over een jaar nog steeds waar zijn.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt