
Claude Opus 5.5-prijzen: de volledige tariefkaart, de cacheregel en wat een taak werkelijk kost
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 177 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1323 tok/s
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
Claude Opus 5.5 kost $4,00 per miljoen inputtokens en $20,00 per miljoen output, een vlakke korting van 20% ten opzichte van de $5,00/$25,00 die Claude Opus 5 hanteerde, waarbij cache-reads met 60% dalen naar $0,20 per miljoen. Dat zijn de gepubliceerde prijzen van Anthropic, gelezen uit Anthropics eigen prijsdocumentatie op 24 september 2026, twee dagen nadat het model werd uitgebracht. Het prijskaartje is het makkelijke deel. Anthropic zegt ook dat het model "ongeveer 40% minder kost om te draaien" bij typische workloads, en dat getal staat niet op het prijsblad — het is een typering van de leverancier, opgebouwd uit de korting per token plus de aanname dat het model minder tokens en minder beurten nodig heeft om hetzelfde werk af te ronden. Deze pagina scheidt de twee: elk tarief dat je vandaag op het blad kunt verifiëren, en de rekenkundige onderbouwing achter het tarief dat je niet kunt verifiëren. Claude Fable 5.1, de $10/$50-laag daarboven, komt door de hele tekst heen terug als de vergelijking die Anthropic zelf maakt.
De volledige tariefkaart, elke regel zoals Anthropic die publiceert
Alles in dit gedeelte is gelezen uit de prijsdocumentatie van Anthropic op platform.claude.com en claude.com op 24 september 2026. Niets hiervan is overgenomen uit een andere tekst.
• Invoer — $4.00 per miljoen tokens (het door Anthropic gepubliceerde tarief).
• Output — $20,00 per miljoen tokens. Thinking-tokens worden gefactureerd als output-tokens, en het adaptieve denken van Claude Opus 5.5 staat altijd aan en kan niet worden uitgeschakeld.
• Cachelezing — $0,20 per miljoen tokens. Anthropic documenteert dit als 0,05x de basisinvoerprijs, een eigen uitzondering in een voetnoot voor dit model.
• 5-minuten cache-schrijfactie — $5,00 per miljoen tokens, de standaard 1,25x-basisvermenigvuldigingsfactor voor input die Anthropic op elk model in de tabel toepast.
• 1-uurs cache-write — $8,00 per miljoen tokens, de standaard 2x-vermenigvuldiger op de basisinvoer.
• Batch API — 50% korting in beide richtingen: $2,00 input en $10,00 output per miljoen. Anthropic publiceert de kortingscijfers rechtstreeks, in plaats van dat je ze zelf moet halveren.
• Fast mode — $8,00 voor invoer en $40,00 voor uitvoer per miljoen, precies 2x standaard. De documentatie van Anthropic geeft de pagina de titel "Fast mode (research preview)".
• Inference alleen in de VS — een vermenigvuldigingsfactor van 1,1x op input, output, cache-writes en cache-reads wanneer inference_geo: "us" is ingesteld. Globale routering, de standaardoptie, gebruikt standaardprijzen.
• Context en uitvoerplafond — 1M tokens context en 128K synchrone uitvoer tegen standaardprijzen, zonder toeslag voor lange context. Antropisch stelt dat een verzoek van 900k tokens tegen hetzelfde tarief per token wordt gefactureerd als een verzoek van 9k tokens. Bij de Batch API stijgt het uitvoerplafond naar 300K achter de output-300k-2026-03-24 bèta-header.
Anthropic stelt ook dat de cachevermenigvuldigers "stapelen op andere prijsaanpassingen zoals de Batch API-korting en gegevensresidentie" — dus een gebatchte, gecachte, aan de VS vastgepinde aanvraag vermenigvuldigt ze alle drie, en de rekenkundige effecten stapelen zich op in plaats van elkaar te vervangen.
Hier is waarop de lezers van de twee modellen de kosten op hetzelfde blad daadwerkelijk afwegen:
• Claude Opus 5 — $5,00 invoer, $25,00 uitvoer, $0,50 voor cachelezen, $6,25 voor een cachewrite van 5 minuten, $10,00 voor een write van 1 uur, $2,50/$12,50 bij Batch (de gepubliceerde tarieven van Anthropic, gelezen op 2026-09-24).
• Claude Fable 5.1 — $10.00 invoer, $50.00 uitvoer, $0.25 voor cachelezen, $12.50 voor een cacheschrijfactie van 5 minuten, $20.00 voor een schrijfactie van 1 uur, $5.00/$25.00 bij Batch (de gepubliceerde tarieven van Anthropic, gelezen op 2026-09-24).

De cachelijn is waar een agentfactuur daadwerkelijk wordt vastgesteld.
In de lanceringsdekking wordt de cache-read als een voetnoot behandeld. Het is de grootste afzonderlijke hefboom op de sheet voor elke workload die een grote prefix opnieuw verstuurt, wat voor de meeste coding- en agent-workloads geldt.
De eigen voetnoot van Anthropic is ongewoon expliciet over de verhoudingen: cachehits en cache-refreshes kosten 0,1x de basisprijs voor input bij de meeste Claude-modellen, 0,025x bij Claude Fable 5.1, en 0,05x bij Claude Opus 5.5. De cacheverhouding van Claude Opus 5.5 is dus twee keer zo slecht als de standaardverhouding, en twee keer zo slecht als die van Claude Fable 5.1.
In dollars wint het sowieso, en dit is het deel dat het waard is om te internaliseren: een betere multiplier wint niet in dollars wanneer het basistarief tweeënhalf keer hoger is.
• Claude Fable 5.1 — 2,5% van een basis van $10,00 is $0,25 per miljoen gecachte tokens.
• Claude Opus 5.5 — 5% van een basisbedrag van $4,00 is $0,20 per miljoen gecachte tokens.
• Claude Opus 5 — 10% van een basisbedrag van $5,00 is $0,50 per miljoen gecachte tokens.
Dezelfde omkering geldt voor schrijfacties. Claude Fable 5.1 rekent $12,50 voor het schrijven van een miljoen tokens naar de cache van 5 minuten en $20,00 voor het venster van 1 uur; Claude Opus 5.5 rekent $5,00 en $8,00. Cache-leesbewerkingen zijn de enige regel waarop Claude Opus 5.5 beide zustermodellen verslaat in absolute dollarbedragen, ondanks dat het de middelste ratio heeft.
Twee regels bepalen of het überhaupt de moeite loont om voor de schrijfactie te betalen. De documentatie van Anthropic zegt dat een schrijfactie van 5 minuten 1,25 keer de basisinvoer kost en zich daarom al na één enkele lezing uit de cache terugverdient, terwijl een schrijfactie van 1 uur 2 keer de basisinvoer kost en twee lezingen uit de cache nodig heeft om zich terug te verdienen. En de cache is gekoppeld aan de prefix die hem heeft geproduceerd: Anthropic merkt op dat het wisselen tussen snelle en standaardsnelheid de cache ongeldig maakt, omdat verzoeken met verschillende snelheden geen gecachte prefixen delen. Het wijzigen van het model, het inspanningsniveau of de tooldefinities heeft hetzelfde effect. Een goedkoper model dat bij elke wisseling een herschrijving van de prefix forceert, kan meer kosten dan het dure model dat het verving.
Wat een lange agent loop daadwerkelijk kost
Neem een programmeeragent van 40 beurten die bij elke beurt een prefix van 120.000 tokens opnieuw verzendt — systeemprompt, toolschema's, bestandsboom —, per beurt 1.000 nieuwe invoertokens uit toolresultaten toevoegt en per beurt 800 uitvoertokens produceert. Het gaat hier juist om substitutie: verander een van die vier getallen om overeen te komen met je eigen verkeer, en de onderstaande berekening klopt nog steeds.
Over Claude Opus 5.5:
• Cache-schrijfbewerking, eenmalig — 120.000 tokens tegen $5,00 per miljoen = $0,60
• Cache-leesbewerkingen, 39 beurten — 4.680.000 tokens tegen $0,20 per miljoen = $0,94
• Nieuwe invoer, 40 beurten — 40.000 tokens à $4,00 per miljoen = $0,16
• Uitvoer, 40 beurten — 32.000 tokens à $20,00 per miljoen = $0,64
• Sessietotaal — $2,34, waarvan cache-leesbewerkingen ongeveer 40% uitmaken.
Bij Claude Opus 5, identieke tokenaantallen: $0,75 aan cacheschrijven, $2,34 aan cachelezen, $0,20 aan nieuwe input en $0,80 aan output — $4,09.
Bij Claude Fable 5.1, met identieke tokenaantallen: $1,50 aan cacheschrijven, $1,17 aan cache-leesbewerkingen, $0,40 aan nieuwe invoer en $1,60 aan uitvoer — $4,67.
Dezelfde tokens, dezelfde beurten, geen efficiëntieclaim nodig: Claude Opus 5.5 komt 43% lager uit dan Claude Opus 5 en 50% lager dan Claude Fable 5.1. En $1,40 van het gat van $1,75 ten opzichte van Claude Opus 5 — tachtig procent van de besparing — komt uitsluitend uit de cache-leesregel, niet uit het opvallende inputtarief.
Voer nu het omgekeerde scenario uit: een eenmalige aanroep met 20.000 invoertokens en 8.000 uitvoertokens, zonder caching. Claude Opus 5.5 kost $0,08 aan invoer plus $0,16 aan uitvoer — $0,24. Claude Opus 5 kost $0,10 plus $0,20 — $0,30. Dat is precies de korting van 20% op de stickerprijs, en geen procentpunt meer.
Dus alleen de tariefkaart levert ergens tussen 20% en 43% op, afhankelijk van hoeveel van je factuur cache-reads is. Elke claim boven die bandbreedte komt voort uit tokenaantallen, niet uit prijzen.
Waar Anthropics "ongeveer 40% goedkoper om te draaien" vandaan komt
Het lanceringsmateriaal van Anthropic zegt dat Claude Opus 5.5 "minder rekenkracht vereist om te serveren dan Opus 5" en dat uit zijn tests blijkt dat het bij standaardinstellingen "40% minder zal kosten dan Opus 5 bij typische workloads". De uitsplitsing die Anthropic geeft, is dat het model "minder kost per token dan Opus 5 en minder tokens per taak gebruikt, wat per saldo neerkomt op een kostendaling van 40%."
Noem dat wat het is: een leverancierstypering van een gemiddelde over door Anthropic geselecteerde workloads, geen geauditeerd resultaat en geen op de prijslijst gepubliceerd tarief. De verifieerbare helft is de eerste helft — 20% korting op input en output, 60% korting op cache-reads, beide vandaag op de lijst te lezen. De tweede helft hangt ervan af of het model minder tokens en minder beurten besteedt aan uw workload, wat alleen te controleren is door deze te draaien.
Het bewijs dat Anthropic voor de tokenhelft aanvoert, is een reeks klantverklaringen uit de lanceerfase. Alle onderstaande zijn door de leverancier gepubliceerd en beschrijven workloads die de leverancier en zijn klanten hebben gekozen:
• Box — het model "gebruikte een derde van de tokens die Opus 5 gebruikte", met antwoorden die "40% minder uitgebreid zijn zonder aan nauwkeurigheid in te boeten."
• Kiro — het "loste meer op dan Opus 5 en deed daarbij ongeveer 40% minder aanroepen en gebruikte de helft van de tokens."
• Factory — het "evenaarde Opus 5 bij hoge inspanning, terwijl het 20 tot 25% minder outputtokens gebruikte."
• GitHub — het "gebruikte een van de minste tokens en stappen die we hebben gemeten," en in VS Code "loste het meer terminaltaken op dan Opus 5 in minder dan de helft van de stappen."
• Fusieanalyse, één uitgewerkt voorbeeld — twee fictieve HR-softwarebedrijven, elk model bouwt een Excel-model en een presentatie voor het management. Anthropic meldt dat Claude Opus 5.5 er 63 minuten over deed tegenover 93 voor Claude Opus 5 en "50% minder kostte om te produceren." Gerapporteerd door de leverancier, n=1.
De onafhankelijke tegenhanger is hier van belang, omdat die de andere kant op wijst. Artificial Analysis mat Claude Opus 5.5 op maximale inspanning op ongeveer 119.000 outputtokens per Intelligentie-index-taak, tegenover ongeveer 73.000 voor Claude Opus 5 op maximale inspanning — het aantal tokens gaat omhoog, niet omlaag. Hun samenvatting van die configuratie is dat Claude Opus 5.5 "gelijk staat aan Opus 5 qua kosten per taak, ondanks 1,6x zoveel outputtokens", bij een gepubliceerde kostprijs van $ 5,98 per Intelligentie-index-taak. Dat is een onafhankelijke meting op maximale inspanning, en het is geen tegenspraak van de bewering van Anthropic — het is het andere uiteinde van de inspanningsschaal.
Dit brengt ons bij het voorbehoud dat voor elk getal in deze sectie geldt. Anthropic stelt dat, tenzij anders vermeld, al zijn Claude Opus 5.5-resultaten adaptief denken gebruiken met maximale inspanning. Claude Opus 5.5 gebruikt standaard gemiddelde inspanning; Claude Opus 5 gebruikte standaard hoog, en hetzelfde niveau met dezelfde naam is niet hetzelfde denkbudget bij de twee modellen. Dus een leverancierstabel die met maximale inspanning is uitgevoerd en een onafhankelijke tabel die met maximale inspanning is uitgevoerd met standaard-fallback ingeschakeld, zijn niet dezelfde configuratie, en de standaardinstelling is ook niet wat een lezer daadwerkelijk zou inzetten. Een gemiddelde van 40% gemeten over een geselecteerde set workloads, bij instellingen die je misschien niet gebruikt, is een vertrekpunt — geen begrotingspost.
Fast mode is een onderzoekspreview, geen tier
Snelle modus op Claude Opus 5.5 kost $8,00 per miljoen input en $40,00 per miljoen output — precies het dubbele van de standaardprijs — voor tot 2,5x meer outputtokens per seconde. Het verbetert de tijd tot het eerste token niet; de winst zit in de outputsnelheid, en die is het duidelijkst zichtbaar bij streaming.
Zeg de rest ronduit, want het is makkelijk om dit als een tier te budgetteren terwijl het er geen is. Anthropic noemt fast mode een research preview. Toegang vraag je aan via een accountmanager of de wachtlijst. Het vereist de fast-mode-2026-02-01 bèta-header en speed: "fast" in het verzoek. Het is alleen beschikbaar op de Claude API — niet op Amazon Bedrock, Google Cloud, Microsoft Foundry of Claude Platform on AWS. Het kan niet worden gecombineerd met de Batch API of met een Priority Tier-verplichting. Het stapelt wel met prompt caching en multipliers voor dataresidentie, dus een in de VS vastgepinde fast-mode-request met cache betaalt 1,1x bovenop 2x. En het wisselen van een workload tussen fast en standaard snelheid maakt de promptcache ongeldig, wat bij een lange agent-loop meer kan kosten dan de snelheid oplevert.
Claude Opus 5 en Claude Opus 4.8 ondersteunen ook de snelle modus, voor $10,00/$50,00. Claude Opus 4.7 wijst de parameter ronduit af.
De eenheid die de factuur bepaalt, is de kostprijs per afgeronde taak.
Elk tarief hierboven is een prijs per token. Niemand koopt tokens. Een prijs per token wordt pas een kostenpost wanneer die wordt vermenigvuldigd met de tokens die een taak verbruikt en het aantal pogingen dat nodig is om die af te ronden.
Voer de berekening uit voor het cache-light voorbeeld van eerder. Bij $0,24 per pass kost een model dat een taak bij de eerste poging afrondt $0,24. Dezelfde taak bij een concurrent tegen $0,30 per pass kost $0,30 — dus het goedkopere model lijkt 20% voor te lopen. Stel nu dat het goedkopere model 1,2 passes per afgeronde taak nodig heeft, wat een royaal succespercentage is voor agentisch werk: 1,2 × $0,24 is $0,288, tegenover $0,30 voor het alternatief met één pass. De besparing is verdwenen. Bij drie passes is het $0,72, en het model dat 20% goedkoper leek per token, is 140% duurder per afgeronde klus.
Anthropic's eigen efficiëntieclaims — minder tokens, minder aanroepen, minder stappen — worden daarom in de juiste eenheid uitgedrukt. Daarom mag ook geen enkele ervan als begrotingspost worden beschouwd voordat je ze hebt gereproduceerd. De controle is mechanisch: prijs per pass, maal passes per afgeronde taak, gemeten op je eigen verkeer. Beide getallen moet je zelf produceren, en geen enkele leverancier publiceert het tweede voor jouw workload.
Als je één referentiepunt van buiten de leverancier wilt, zet Artificial Analysis Claude Opus 5.5 op $5,98 per Intelligence Index-taak in zijn max-effortconfiguratie — een onafhankelijk cijfer bij een instelling die het meeste productieverkeer niet zal gebruiken, nuttig als plafond in plaats van als voorspelling.

Lijnen die niet in het hoofdtarief zijn inbegrepen
• Residentie. Inferentie alleen in de VS is 1,1x op elke tokencategorie, inclusief cache-lees- en -schrijfacties. Het kan worden gecombineerd met de snelle modus en met de Batch-korting.
• Tooldefinities. Anthropic publiceert een overhead per model voor de systeemprompt voor toolgebruik: het declareren van tools voegt 286 tokens toe aan elk Claude Opus 5.5-verzoek. Klein bij $4,00 per miljoen, maar het wordt per verzoek in rekening gebracht, en een agent-loop doet veel verzoeken.
• Cache-invalidatie. Een prefix die opnieuw wordt geschreven na een wijziging van het model, de effort, de tooldefinitie of de snelheid, wordt gefactureerd tegen het schrijftarief — $5,00 of $8,00 per miljoen op Claude Opus 5.5 — en niet tegen het leestarief van $0,20.
• Het model daaronder.Claude Sonnet 5 zit op $2.00 voor invoer en $10.00 voor uitvoer per miljoen, wat volgens de prijsvoetnoot van Anthropic nu de standaardprijs is en niet het introductietarief waarmee het werd aangekondigd. Claude Opus 5.5 is precies 2x Sonnet 5 in beide richtingen.

Claude Opus 5.5 aanroepen tegen de lijstprijs van Anthropic
Claude Opus 5.5 staat op OrcaRouter op anthropic/claude-opus-5.5 voor $4,00 input en $20,00 output per miljoen — Anthropic's eigen lijstprijs, doorgegeven tegen 0% opslag. Dat doorgeven is het waard om nauwkeurig op een prijzenpagina te vermelden: omdat het providertarief wordt doorgegeven in plaats van in een tabel te worden gecachet, is een wijziging van het leverancierstarief hier live op dezelfde dag dat deze wordt gepubliceerd, niet pas na een synchronisatievenster. Als Anthropic dit blad aanpast, verandert het nummer dat je opbelt mee.
Dezelfde sleutel reikt tot de niveaus waarmee deze pagina hem vergelijkt — anthropic/claude-opus-5 voor $5,00/$25,00 en anthropic/claude-fable-5.1 voor $10,00/$50,00 — naast de rest van de Claude-line-up en meer dan 200 andere modellen, dus om te testen of het goedkopere tarief per token overeind blijft bij je eigen aantal passes heb je geen tweede contract of codewijziging nodig. Automatische failover is er voor het geval je een onbekend model op een productieroute wilt draaien zonder die route eraan te wagen.
Het antwoord in twee regels op waar deze pagina over gaat: de tariefkaart is $4,00 voor invoer, $20,00 voor uitvoer en $0,20 per miljoen gecachte reads, en de 20%-verlaging is vandaag echt en verifieerbaar. De 40% is het gemiddelde van Anthropic over workloads die het zelf heeft geselecteerd. Laat een van je eigen agent-loops erdoorheen lopen voordat je budgetteert op basis van het tweede getal.
Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
