Redactionele flatvector-illustratie voor de hero van een technologieblog over modelprijzen: een grote afgeronde modelchip op een lichte achtergrond, een prijskaartje aan de hoek geklemd, drie tokenstromen die uit de chip in een ronde prijsmeter stromen, en een klein stapeltje gecachte blokken naast de meter. Diepblauw en cyaan palet, strakke moderne SaaS-esthetiek, geen leesbare tekst.
Guides & Insights

Claude Opus 5 API-prijzen: $5 / $25 per 1M tokens, cache voor $0,50, en wat het echt kost

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Opus 5 kost $5,00 per miljoen invoertokens en $25,00 per miljoen uitvoertokens op de Claude Opus 5-API — hetzelfde tarief dat het model hanteert in de OrcaRouter-directory, gecontroleerd op 2026-08-18, zonder opslag. Dat maakt het half zo duur als Claude Fable 5 en precies even duur als Claude Opus 4.8, en de tariefkaart op de live-modelpagina van Claude Opus 5 is waar je je budget op moet baseren. De hefbomen doen er meer toe dan de kop: hergebruikte invoer wordt gefactureerd tegen $0,50 per miljoen via prompt caching, batch zakt naar $2,50 / $12,50, en de fast-mode-bèta staat op $10 / $50. Deze pagina is de prijsreferentie voor het model — de exacte tariefkaart, wat een aanvraag daadwerkelijk kost, hoe de prijs zich verhoudt tot de rest van het veld, wanneer het de verkeerde aankoop is, en hoe je het aanroept via één OpenAI-compatibel eindpunt met je eigen sleutel.

Prijzen zijn per miljoen tokens (input/output), geldig vanaf 2026-08-18. De dollarbedragen zijn afkomstig van de gepubliceerde API-tarieven van Anthropic en zijn kruislings gecontroleerd met de OrcaRouter-modelpagina voor Claude Opus 5; cache-, batch- en fast-mode-tarieven zijn door Anthropic aangekondigd. Prijzen veranderen — controleer vóór je bouwt.

De exacte prijs, vandaag geverifieerd

Hier is de volledige prijslijst voor Claude Opus 5, geverifieerd op 2026-08-18:

Price card titled 'Claude Opus 5 — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $25.00 and Cache read $0.50. Rows below list cache write 5-minute TTL $6.25, cache write 1-hour TTL $10.00, batch $2.50 input / $12.50 output, fast mode $10 / $50, context window 1M tokens and max output 128K. Footer: reused input costs one tenth of fresh input.

Invoer — $5.00 per 1M tokens bij een cache-miss.

Uitvoer — $25,00 per 1M tokens.

Promptcache schrijven — $6,25 per 1M bij een TTL van 5 minuten, $10,00 per 1M bij een TTL van 1 uur.

Prompt cache read — $0,50 per 1M tokens, een 90% korting op elke input die u opnieuw verzendt.

Batch API — $2.50 input / $12.50 output, een vaste korting van 50%, asynchroon.

Snelle modus — $10 input / $50 output, een opslag van 2x voor tot ongeveer 2,5x outputsnelheid, Anthropic beta.

Contextvenster — 1M tokens, tot 128K output.

OrcaRouter geeft het providerstarief door zonder opslag, dus het bedrag op de directory is het bedrag dat u betaalt. Op de live modelpagina toont de kaart $5.00 / $25.00 per 1M, cache lezen $0.500, cache schrijven $10.00 (het 1-uurs TTL-tarief), met Vision-, Tools-, JSON- en Reasoning-badges.

De hefbomen die de effectieve prijs veranderen

Het basistarief is slechts het startpunt. Drie modificatoren veranderen wat Opus 5 u daadwerkelijk kost:

Promptcaching — herbruikte context kost $0,50 per miljoen in plaats van $5 voor nieuwe. De minimale cachebare prefix is gedaald tot ongeveer 512 tokens op Opus 5, dus zelfs een bescheiden stabiele system prompt komt in aanmerking. Voor elke agent of chat die bij elke beurt een grote prefix opnieuw verstuurt, is caching veruit de grootste hefboom op de rekening — en omdat Anthropic de cache per API-sleutel koppelt, is het op één sleutel (één kanaal) blijven wat ervoor zorgt dat de hits blijven binnenkomen.

Batch — de batch-API van Anthropic voert taken asynchroon uit, waarbij de resultaten doorgaans binnen 24 uur beschikbaar zijn, tegen exact de helft van de prijs: $2.50 / $12.50. Het is te combineren met prompt caching en is geschikt voor evals, bulkclassificatie en offline generatie waarbij latentie er niet toe doet.

Snelle modus — $10 / $50 voor tot ~2,5x uitvoerdoorvoer, handig voor latentiegevoelig werk met hoge output. Het combineert niet met de batch-API en is een first-party bètaversie van Anthropic; het standaard doorvoertarief van een router is de basisprijs van $5 / $25.

Wat een verzoek eigenlijk kost

Prijzen per token zijn abstract, dus hier zijn uitgewerkte voorbeelden tegen de huidige tarieven:

Eén chatgesprek, 50K invoer + 20K uitvoer — $0,25 + $0,50 = $0,75.

1M invoer + 1M uitvoer — $5 + $25 = $30.

Agentische turn, 200K gecachete context + 20K verse invoer + 30K output — $0.10 + $0.10 + $0.75 = $0.95. Dezelfde turn met een koude cache — 220K verse invoer tegen $1.10 — bedraagt $1.85. Caching halveert het bijna.

Een maand met 10M tokens, 70% input / 30% output, waarbij 80% van de input uit cache komt: 1,4M verse input ($7,00) + 5,6M gecachete input ($2,80) + 3M output ($75) ≈ $85. Zonder cache kost dezelfde maand $110.

Twee kanttekeningen verhogen het effectieve tarief. Opus 5 is een denkmodel — adaptief denken is standaard ingeschakeld, en denktokens worden gefactureerd als output tegen $25 per miljoen. Een moeilijke prompt met een hoge inspanningsinstelling kan een groot deel van het outputbudget besteden aan redeneren, waardoor de effectieve outputkosten bij moeilijk werk ruim boven een naïeve schatting uitkomen. En de huidige tokenizer van Anthropic is uitgebreider dan die van de vorige generatie, dus dezelfde Engelse tekst kost meer tokens (en meer geld) dan bij oudere Claude-modellen. Verlaag de inspanningsinstelling voor eenvoudige aanroepen en begrens de output waar mogelijk.

Hoe de prijzen van Opus 5 zich verhouden tot de concurrentie

Comparison table card titled 'USD per 1M tokens — published list prices', verified 2026-08-18, with an input/output column pair per model: Claude Opus 5 $5.00/$25.00 highlighted with a 'THIS PAGE' tag; Claude Opus 4.8 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Sonnet 5 $3.00/$15.00 (intro $2.00/$10.00 through Aug 31); GPT-5.6 Sol $5.00/$30.00; GPT-5.6 Terra $2.00/$12.00; Gemini 3.6 Flash $1.50/$7.50; Kimi K3 $3.00/$15.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Opus 5 is half the price of Claude Fable 5, the same price as Claude Opus 4.8, and 20% cheaper on output than GPT-5.6 Sol.

Afgelezen tegen de gepubliceerde catalogusprijzen op 2026-08-18:

Claude Opus 4.8 — $5 / $25. Dezelfde prijs als de vorige generatie. Opus 5 kost hetzelfde voor het nieuwere model, wat upgraden gemakkelijk maakt.

Claude Fable 5 — $10 / $50. Opus 5 is half zo duur als Anthropic's topmodel, met dezelfde context van 1M tokens.

Claude Sonnet 5 — $3 / $15 standaard ($2 / $10 introductie tot en met 31 augustus 2026). De Sonnet-prijslaag is 40% goedkoper voor input en output — de natuurlijke standaardkeuze als je geen redenering op Opus-niveau nodig hebt.

GPT-5.6 Sol — $5 / $30. Zelfde inputprijs, goedkopere output dan Opus 5.

GPT-5.6 Terra — $2 / $12. De middelste volumetier voor hoogvolume niet-frontierwerk.

Gemini 3.6 Flash — $1,50 / $7,50. Een Flash-tier model voor goedkoop, snel, multimodaal verkeer.

Kimi K3 — $3 / $15. Een vlaggenschip met open-weights tegen ongeveer de helft van Opus' tarieven.

DeepSeek V4 Pro — $0,44 / $0,88 buiten piek (piekvensters verdubbelen het). Het goedkope open-gewichten vlaggenschip, een heel ander prijsuniversum.

De eerlijke insteek: Opus 5 is geen goedkoop model — het is een vlaggenschip dat geprijsd is op de helft van de topklasse (Claude Fable 5) en precies wat de vorige generatie kostte. Het wint op prijs-per-lange-context en prijs-per-moeilijke-redenering, niet op de absolute prijs. Als je verkeer bestaat uit korte prompts en eenvoudige taken, is een Sonnet van $3 of een DeepSeek-model van $0,44 de voordeligere keuze.

Wanneer Opus 5 de verkeerde keuze is

Vier gevallen waarin deze prijs niet de prijs is die u wilt:

Korte, eenvoudige prompts. Onder ruwweg 20K tokens zonder diep redeneren is de Opus-premie verspild. Claude Sonnet 5 voor $3 / $15 (of $2 / $10 via het introductievenster) verwerkt het volumetarief voor 40% minder, en een Gemini Flash- of DeepSeek-klasse model kost nog veel minder.

Redeneringsintensief volume. Omdat denktijd als output wordt gefactureerd, kan een moeilijke prompt bij hoge inspanning flink boven de nominale outputlijn uitkomen. Als uw workload uit veel moeilijke aanvragen bestaat, meet dan het werkelijke aantal outputtokens voordat u zich vastlegt — de effectieve prijs kan u verrassen.

Prijs per token als enige doel. Als een frontier-benchmarkscore of de 1M-context niet de harde vereiste is, leveren goedkopere vlaggenschepen (GPT-5.6 Terra, DeepSeek V4 Pro) of Flash-modellen (Gemini 3.6 Flash) veel lagere prijzen per token op voor het overgrote deel van het verkeer.

Strikte latentiebudgetten.Opus 5 is een groot denkmodel — p50 time-to-first-token rond 7 seconden in de 7-daagse meting van OrcaRouter. Voor realtime chat waar subseconde-TTFT van belang is, is het het verkeerde model, ongeacht de prijs.

Hoe noem je het in OrcaRouter

Screenshot of the OrcaRouter model page for Claude Opus 5 (model ID anthropic/claude-opus-5): a New Featured badge, Vision/Tools/JSON/Reasoning capability badges, 1M token context and 128K max output, input $5.00 and output $25.00 per 1M tokens, cache read $0.500 and cache write $10.00, p50 TTFT 7.06s, the /v1/chat/completions and /v1/messages endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

Claude Opus 5 wordt gehost op OrcaRouter als model-ID anthropic/claude-opus-5, geleverd via de OpenAI-compatibele endpoint op api.orcarouter.ai/v1 tegen het provider-tarief zonder enige opslag. Als je al een OpenAI-client hebt, is migratie slechts een wijziging van base-URL en model-ID — niets anders. Dezelfde sleutel en endpoint ondersteunen 200+ modellen, dus Opus 5 staat naast Claude Sonnet 5, Claude Haiku 4.5, de GPT-5.6-niveaus, de Gemini-familie en de open-weight-modellen waarmee je het wilt vergelijken, en je kunt op moeilijkheid routeren in plaats van elk model opnieuw te integreren.

Twee OrcaRouter-specifieke punten die het vermelden waard zijn op een prijspagina. BYOK: neem je eigen Anthropic-sleutel mee en Anthropic factureert je rechtstreeks tegen de eigen tarieven — OrcaRouter voegt $0 per token toe en laat de rate limits en tegoeden van je provider intact. Guardrails: het PII Shield en het contentbeleid draaien vóór de facturatie, zodat een geblokkeerd verzoek een nette 400 retourneert en nooit in rekening wordt gebracht, en de Agent Firewall beoordeelt tool- en MCP-aanroepen voordat ze worden uitgevoerd.

De eerlijkheidsnotitie die ertoe doet voor een prijspagina: wij routeren het model, wij bepalen niet de prijs. Het bedrag van $5 / $25 is het tarief van Anthropic dat wordt doorberekend, en wanneer Anthropic dit wijzigt, volgt de vermelding — dat is precies waarom deze pagina een datumstempel heeft. Als je Anthropic rechtstreeks aanroept, krijg je hetzelfde tarief; OrcaRouter bestaat voor de route met één sleutel en nul opslag, als je één eindpunt voor de hele modellijn wilt.

Bronnen en datum

Alle bovenstaande prijzen zijn gecontroleerd op 2026-08-18. De Claude-cijfers zijn afgelezen van de gepubliceerde API-prijzen van Anthropic en kruiselings gecontroleerd tegen de OrcaRouter-modelpagina voor Claude Opus 5 (dezelfde dag gecontroleerd). De GPT-5.6-prijzen na de prijsverlaging zijn de gepubliceerde tarieven van OpenAI; de Gemini-, Kimi- en DeepSeek-cijfers zijn de huidige vermeldingen in de OrcaRouter-directory, waarbij DeepSeek V4 Pro wordt getoond tegen het tarief buiten de piekuren (piekuren verdubbelen dit). De prijzen van Anthropic zijn stabiel sinds de lancering van Opus 5 op 24 juli 2026, maar ze kunnen wijzigen — behandel elke eerdere pagina met 'Opus 5-prijzen' die je vindt met de datum waarop deze is gecontroleerd. De cijfers hier zijn actueel per vandaag.

Elke prijs hierboven is de livekoers op de Claude Opus 5-modelpagina — geverifieerd op 2026-08-18 zonder opslag, klaar voor je eigen sleutel.

Vergeleken in dit artikel3

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube