
Claude Opus 5 API-prijzen: $5 / $25 per 1M tokens, cache voor $0,50, en wat het echt kost
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenNIEUWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNIEUWDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokNIEUWSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligentie77Coderen
Claude Opus 5 kost $5,00 per miljoen invoertokens en $25,00 per miljoen uitvoertokens op de Claude Opus 5-API — hetzelfde tarief dat het model hanteert in de OrcaRouter-directory, gecontroleerd op 2026-08-18, zonder opslag. Dat maakt het half zo duur als Claude Fable 5 en precies even duur als Claude Opus 4.8, en de tariefkaart op de live-modelpagina van Claude Opus 5 is waar je je budget op moet baseren. De hefbomen doen er meer toe dan de kop: hergebruikte invoer wordt gefactureerd tegen $0,50 per miljoen via prompt caching, batch zakt naar $2,50 / $12,50, en de fast-mode-bèta staat op $10 / $50. Deze pagina is de prijsreferentie voor het model — de exacte tariefkaart, wat een aanvraag daadwerkelijk kost, hoe de prijs zich verhoudt tot de rest van het veld, wanneer het de verkeerde aankoop is, en hoe je het aanroept via één OpenAI-compatibel eindpunt met je eigen sleutel.
Prijzen zijn per miljoen tokens (input/output), geldig vanaf 2026-08-18. De dollarbedragen zijn afkomstig van de gepubliceerde API-tarieven van Anthropic en zijn kruislings gecontroleerd met de OrcaRouter-modelpagina voor Claude Opus 5; cache-, batch- en fast-mode-tarieven zijn door Anthropic aangekondigd. Prijzen veranderen — controleer vóór je bouwt.
De exacte prijs, vandaag geverifieerd
Hier is de volledige prijslijst voor Claude Opus 5, geverifieerd op 2026-08-18:

• Invoer — $5.00 per 1M tokens bij een cache-miss.
• Uitvoer — $25,00 per 1M tokens.
• Promptcache schrijven — $6,25 per 1M bij een TTL van 5 minuten, $10,00 per 1M bij een TTL van 1 uur.
• Prompt cache read — $0,50 per 1M tokens, een 90% korting op elke input die u opnieuw verzendt.
• Batch API — $2.50 input / $12.50 output, een vaste korting van 50%, asynchroon.
• Snelle modus — $10 input / $50 output, een opslag van 2x voor tot ongeveer 2,5x outputsnelheid, Anthropic beta.
• Contextvenster — 1M tokens, tot 128K output.
OrcaRouter geeft het providerstarief door zonder opslag, dus het bedrag op de directory is het bedrag dat u betaalt. Op de live modelpagina toont de kaart $5.00 / $25.00 per 1M, cache lezen $0.500, cache schrijven $10.00 (het 1-uurs TTL-tarief), met Vision-, Tools-, JSON- en Reasoning-badges.
De hefbomen die de effectieve prijs veranderen
Het basistarief is slechts het startpunt. Drie modificatoren veranderen wat Opus 5 u daadwerkelijk kost:
• Promptcaching — herbruikte context kost $0,50 per miljoen in plaats van $5 voor nieuwe. De minimale cachebare prefix is gedaald tot ongeveer 512 tokens op Opus 5, dus zelfs een bescheiden stabiele system prompt komt in aanmerking. Voor elke agent of chat die bij elke beurt een grote prefix opnieuw verstuurt, is caching veruit de grootste hefboom op de rekening — en omdat Anthropic de cache per API-sleutel koppelt, is het op één sleutel (één kanaal) blijven wat ervoor zorgt dat de hits blijven binnenkomen.
• Batch — de batch-API van Anthropic voert taken asynchroon uit, waarbij de resultaten doorgaans binnen 24 uur beschikbaar zijn, tegen exact de helft van de prijs: $2.50 / $12.50. Het is te combineren met prompt caching en is geschikt voor evals, bulkclassificatie en offline generatie waarbij latentie er niet toe doet.
• Snelle modus — $10 / $50 voor tot ~2,5x uitvoerdoorvoer, handig voor latentiegevoelig werk met hoge output. Het combineert niet met de batch-API en is een first-party bètaversie van Anthropic; het standaard doorvoertarief van een router is de basisprijs van $5 / $25.
Wat een verzoek eigenlijk kost
Prijzen per token zijn abstract, dus hier zijn uitgewerkte voorbeelden tegen de huidige tarieven:
• Eén chatgesprek, 50K invoer + 20K uitvoer — $0,25 + $0,50 = $0,75.
• 1M invoer + 1M uitvoer — $5 + $25 = $30.
• Agentische turn, 200K gecachete context + 20K verse invoer + 30K output — $0.10 + $0.10 + $0.75 = $0.95. Dezelfde turn met een koude cache — 220K verse invoer tegen $1.10 — bedraagt $1.85. Caching halveert het bijna.
• Een maand met 10M tokens, 70% input / 30% output, waarbij 80% van de input uit cache komt: 1,4M verse input ($7,00) + 5,6M gecachete input ($2,80) + 3M output ($75) ≈ $85. Zonder cache kost dezelfde maand $110.
Twee kanttekeningen verhogen het effectieve tarief. Opus 5 is een denkmodel — adaptief denken is standaard ingeschakeld, en denktokens worden gefactureerd als output tegen $25 per miljoen. Een moeilijke prompt met een hoge inspanningsinstelling kan een groot deel van het outputbudget besteden aan redeneren, waardoor de effectieve outputkosten bij moeilijk werk ruim boven een naïeve schatting uitkomen. En de huidige tokenizer van Anthropic is uitgebreider dan die van de vorige generatie, dus dezelfde Engelse tekst kost meer tokens (en meer geld) dan bij oudere Claude-modellen. Verlaag de inspanningsinstelling voor eenvoudige aanroepen en begrens de output waar mogelijk.
Hoe de prijzen van Opus 5 zich verhouden tot de concurrentie

Afgelezen tegen de gepubliceerde catalogusprijzen op 2026-08-18:
• Claude Opus 4.8 — $5 / $25. Dezelfde prijs als de vorige generatie. Opus 5 kost hetzelfde voor het nieuwere model, wat upgraden gemakkelijk maakt.
• Claude Fable 5 — $10 / $50. Opus 5 is half zo duur als Anthropic's topmodel, met dezelfde context van 1M tokens.
• Claude Sonnet 5 — $3 / $15 standaard ($2 / $10 introductie tot en met 31 augustus 2026). De Sonnet-prijslaag is 40% goedkoper voor input en output — de natuurlijke standaardkeuze als je geen redenering op Opus-niveau nodig hebt.
• GPT-5.6 Sol — $5 / $30. Zelfde inputprijs, goedkopere output dan Opus 5.
• GPT-5.6 Terra — $2 / $12. De middelste volumetier voor hoogvolume niet-frontierwerk.
• Gemini 3.6 Flash — $1,50 / $7,50. Een Flash-tier model voor goedkoop, snel, multimodaal verkeer.
• Kimi K3 — $3 / $15. Een vlaggenschip met open-weights tegen ongeveer de helft van Opus' tarieven.
• DeepSeek V4 Pro — $0,44 / $0,88 buiten piek (piekvensters verdubbelen het). Het goedkope open-gewichten vlaggenschip, een heel ander prijsuniversum.
De eerlijke insteek: Opus 5 is geen goedkoop model — het is een vlaggenschip dat geprijsd is op de helft van de topklasse (Claude Fable 5) en precies wat de vorige generatie kostte. Het wint op prijs-per-lange-context en prijs-per-moeilijke-redenering, niet op de absolute prijs. Als je verkeer bestaat uit korte prompts en eenvoudige taken, is een Sonnet van $3 of een DeepSeek-model van $0,44 de voordeligere keuze.
Wanneer Opus 5 de verkeerde keuze is
Vier gevallen waarin deze prijs niet de prijs is die u wilt:
Korte, eenvoudige prompts. Onder ruwweg 20K tokens zonder diep redeneren is de Opus-premie verspild. Claude Sonnet 5 voor $3 / $15 (of $2 / $10 via het introductievenster) verwerkt het volumetarief voor 40% minder, en een Gemini Flash- of DeepSeek-klasse model kost nog veel minder.
Redeneringsintensief volume. Omdat denktijd als output wordt gefactureerd, kan een moeilijke prompt bij hoge inspanning flink boven de nominale outputlijn uitkomen. Als uw workload uit veel moeilijke aanvragen bestaat, meet dan het werkelijke aantal outputtokens voordat u zich vastlegt — de effectieve prijs kan u verrassen.
Prijs per token als enige doel. Als een frontier-benchmarkscore of de 1M-context niet de harde vereiste is, leveren goedkopere vlaggenschepen (GPT-5.6 Terra, DeepSeek V4 Pro) of Flash-modellen (Gemini 3.6 Flash) veel lagere prijzen per token op voor het overgrote deel van het verkeer.
Strikte latentiebudgetten.Opus 5 is een groot denkmodel — p50 time-to-first-token rond 7 seconden in de 7-daagse meting van OrcaRouter. Voor realtime chat waar subseconde-TTFT van belang is, is het het verkeerde model, ongeacht de prijs.
Hoe noem je het in OrcaRouter

Claude Opus 5 wordt gehost op OrcaRouter als model-ID anthropic/claude-opus-5, geleverd via de OpenAI-compatibele endpoint op api.orcarouter.ai/v1 tegen het provider-tarief zonder enige opslag. Als je al een OpenAI-client hebt, is migratie slechts een wijziging van base-URL en model-ID — niets anders. Dezelfde sleutel en endpoint ondersteunen 200+ modellen, dus Opus 5 staat naast Claude Sonnet 5, Claude Haiku 4.5, de GPT-5.6-niveaus, de Gemini-familie en de open-weight-modellen waarmee je het wilt vergelijken, en je kunt op moeilijkheid routeren in plaats van elk model opnieuw te integreren.
Twee OrcaRouter-specifieke punten die het vermelden waard zijn op een prijspagina. BYOK: neem je eigen Anthropic-sleutel mee en Anthropic factureert je rechtstreeks tegen de eigen tarieven — OrcaRouter voegt $0 per token toe en laat de rate limits en tegoeden van je provider intact. Guardrails: het PII Shield en het contentbeleid draaien vóór de facturatie, zodat een geblokkeerd verzoek een nette 400 retourneert en nooit in rekening wordt gebracht, en de Agent Firewall beoordeelt tool- en MCP-aanroepen voordat ze worden uitgevoerd.
De eerlijkheidsnotitie die ertoe doet voor een prijspagina: wij routeren het model, wij bepalen niet de prijs. Het bedrag van $5 / $25 is het tarief van Anthropic dat wordt doorberekend, en wanneer Anthropic dit wijzigt, volgt de vermelding — dat is precies waarom deze pagina een datumstempel heeft. Als je Anthropic rechtstreeks aanroept, krijg je hetzelfde tarief; OrcaRouter bestaat voor de route met één sleutel en nul opslag, als je één eindpunt voor de hele modellijn wilt.
Bronnen en datum
Alle bovenstaande prijzen zijn gecontroleerd op 2026-08-18. De Claude-cijfers zijn afgelezen van de gepubliceerde API-prijzen van Anthropic en kruiselings gecontroleerd tegen de OrcaRouter-modelpagina voor Claude Opus 5 (dezelfde dag gecontroleerd). De GPT-5.6-prijzen na de prijsverlaging zijn de gepubliceerde tarieven van OpenAI; de Gemini-, Kimi- en DeepSeek-cijfers zijn de huidige vermeldingen in de OrcaRouter-directory, waarbij DeepSeek V4 Pro wordt getoond tegen het tarief buiten de piekuren (piekuren verdubbelen dit). De prijzen van Anthropic zijn stabiel sinds de lancering van Opus 5 op 24 juli 2026, maar ze kunnen wijzigen — behandel elke eerdere pagina met 'Opus 5-prijzen' die je vindt met de datum waarop deze is gecontroleerd. De cijfers hier zijn actueel per vandaag.
Elke prijs hierboven is de livekoers op de Claude Opus 5-modelpagina — geverifieerd op 2026-08-18 zonder opslag, klaar voor je eigen sleutel.
Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
