Een titelkaart voor de Claude Opus 5 API-gids, met een afgeronde gatewaykaart met codechips met de tekst POST /v1/messages en model: claude-opus-5, een prijskaartje met $5 / $25 per 1M tokens, en vier modelchips met de labels Claude, GPT, Gemini en Qwen die via dunne lijnen met de enkele gateway zijn verbonden.
Guides & Insights

Claude Opus 5 API: hoe je het aanroept, wat het kost en wanneer het overkill is

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.

Twee endpoints, één model

De meeste tutorials voor de Claude Opus 5 API tonen alleen de native Anthropic-aanroep, en daar stopt het. Er zijn eigenlijk twee dialecten, en beide bereiken dezelfde gewichten.

Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.

OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.

Cloudmodellen. Op Amazon Bedrock is de id anthropic.claude-opus-5; op Google Vertex AI en Microsoft Foundry behoudt het de first-party id claude-opus-5. Die paden zijn voor teams die zich al hebben gecommitteerd aan een cloudprovider; de OpenAI-compatibele route is degene die je code draagbaar houdt.

Het model maakt niet uit welk dialect je gebruikt. Wat verschilt is alles rondom de aanroep — facturering, sleutels, snelheidslimieten, failover, en hoeveel andere modellen je kunt bereiken zonder code te wijzigen.

Wat je krijgt — en de twee dingen die oude code breken

Claude Opus 5 is Anthropic's vlaggenschip met zware redeneercapaciteiten: een contextvenster van 1M tokens (het maximum is ook de standaard), een uitvoerlimiet van 128K, een kennisafsluitdatum van mei 2026, en tekst-, beeld- en bestandinvoer met tekstuitvoer. Op de onafhankelijke Artificial Analysis-ranglijst scoorde het AA Coding 78.0, gerangschikt #1 van 132, en AA Intelligence 63.1, gerangschikt #2 van 134, met een GPQA Diamond van 93.2 en een Humanity's Last Exam-score van 54.9, per 24 juli 2026. Anthropic's eigen lanceerclaims — ongeveer het dubbele van Opus 4.8 op Frontier-Bench — zijn door de leverancier uitgevoerd en niet onafhankelijk gereproduceerd.

A spec and benchmark scoreboard for Claude Opus 5: 1M token context window, 128K max output, $5 / $25 list price, $0.50 per 1M cache read, AA Coding 78.0 ranked #1 of 132, and AA Intelligence 63.1 ranked #2 of 134.

Denken is standaard ingeschakeld. Adaptief denken bepaalt hoeveel er wordt nagedacht bij elke aanroep, geregeld door de output_config.effort parameter, die low tot en met max accepteert en standaard high gebruikt. Voor codeer- en agentische loops is xhigh het aanbevolen startpunt; low en medium zijn op Opus 5 echt sterker dan op eerdere modellen, waardoor ze levensvatbaar zijn voor echte workloads in plaats van speelgoedaanroepen. Redeneringstokens tellen mee voor je outputrekening.

Twee breaking changes van Claude Opus 4.8 bijten iedereen die een oud request body kopieert:

Een krappe max_tokens leidt nu tot afgekapte antwoorden. Omdat denken standaard actief is, wordt een max_tokens die is afgestemd op de verwachte antwoordlengte eerst door het denken verbruikt. Als je een 4.8-workload ongewijzigd overzet, verwacht dan afgekapte antwoorden totdat je de limiet verhoogt of de inspanning verlaagt.

Samplingparameters worden afgewezen. temperature, top_p en top_k leveren bij elke niet-standaardwaarde een 400-fout op, net als een assistant-prefill. Stuur de output met effort, niet met temperature.

Het uitschakelen van thinking is beperkt. thinking: {"type": "disabled"}wordt alleen geaccepteerd bij effort high of lager; het combineren ervan met xhigh of max retourneert een 400. De verstandige manier om kosten te besparen is het verlagen van effort, niet het uitschakelen van thinking.

Wat het werkelijk kost

Claude Opus 5 kost $5 per miljoen invoertokens en $25 per miljoen uitvoertokens — dezelfde prijs als Claude Opus 4.8, wat stilletjes het goede nieuws van de release is. Het uitlezen van de cache kost $0,50 per miljoen (prompt-caching vereist een prefix van minimaal 512 tokens en ondersteunt TTL's van 5 minuten en 1 uur). Een research-preview van de fast mode draait hetzelfde model met tot 2,5x de uitvoertokens per seconde voor $10 / $50, en de Batch API retourneert resultaten asynchroon tegen de helft van de prijs.

A price comparison card for the Claude Opus 5 API: Opus 5 at $5/$25 with a $0.50 cache read, $10/$50 fast mode and roughly half-price Batch API, Claude Opus 4.8 at the same $5/$25, Claude Sonnet 5 at $3/$15 with $2/$10 intro pricing, Claude Haiku 4.5 at $1/$5, and a worked example of 100K tokens in plus 20K out billing $1.00 uncached or about $0.55 cached.

Een concrete factuur: een verzoek van 100K tokens dat 20K outputtokens oplevert, kost $0,50 voor invoer en $0,50 voor uitvoer — $1,00 zonder cache. Als die 100K prompt bij de volgende aanroep uit de cache wordt geserveerd, daalt de invoerkant naar ongeveer $0,05, voor een $0,55 retourtje. Die cacheberekening is het verschil tussen Opus dat betaalbaar is op lange, herhaalde context en Opus dat helemaal niet betaalbaar is.

De laag erboven en eronder, ter referentie: Claude Fable 5 is Anthropics meest capabele model voor $10 / $50; Claude Sonnet 5 is $3 / $15 (met $2 / $10 introductieprijzen tot en met 31 augustus 2026); Claude Haiku 4.5 is $1 / $5. Op OrcaRouter wordt elk van deze doorgegeven tegen de lijstprijs van de leverancier, zonder marge per token, dus de bovenstaande vergelijking is ook wat je daadwerkelijk betaalt.

Het geval met één endpoint

Als je een Claude Opus 5 API-handleiding leest, heb je waarschijnlijk al een integratie en een sleutel, en de echte vraag is of je een tweede integratie en een tweede sleutel wilt voor het volgende model dat je probeert. OrcaRouter beantwoordt dat met één OpenAI-compatibel eindpunt voor 200+ modellen: dezelfde client, dezelfde basis-URL en een ander model-id per model — anthropic/claude-opus-5 vandaag, een goedkoper model wanneer de werklast geen Opus-niveau meer verdient, een nieuw frontier-model de week dat het uitkomt, allemaal zonder code te wijzigen.

The OrcaRouter model page for anthropic/claude-opus-5, showing the $5.00 per million input and $25.00 per million output pricing, a 1,000,000-token context window, the released July 24, 2026 label, and both OpenAI-compatible and Anthropic-native endpoints.

De prijzen zijn het eerlijke deel. OrcaRouter voegt $0 per token — je betaalt het gepubliceerde tarief van elke provider, dus Claude Opus 5 blijft op $5 / $25 van Anthropic, en een prijsverlaging van een provider is dezelfde dag als aangekondigd live bij ons. Je eigen key meenemen is een eersteklas optie: verstrek je bestaande Anthropic API-sleutel, behoud je eigen rate limits en tegoeden, en de provider factureert je rechtstreeks. Guardrails — een PII-schild en een contentbeleid — worden toegepast voordat het verzoek wordt gefactureerd, niet erna. De modelpagina voor anthropic/claude-opus-5 toont de live prijs, de 1M-context, en de huidige doorvoercijfers, en de routing-DSL stelt een failover samen zodat een goedkoper model antwoordt wanneer Opus 5 fouten geeft of wanneer je verkeerspatroon dat toelaat.

Waar Opus 5 het verkeerde antwoord is

De beste zijn is niet hetzelfde als geschikt zijn voor jouw workload, en er zijn drie punten waar het vlaggenschip van $5 / $25 verliest.

Hoog-volume, laag-risico aanroepen. Een samenvattings- of classificatiepijplijn die 10M invoertokens per maand verwerkt, kost $50 op Claude Opus 5 tegenover $10 op Claude Haiku 4.5 — zelfde endpoint, zelfde sleutel, één id-wijziging. Haiku is geen Opus, maar voor routing, extractie en opmaak is het dichtbij genoeg dat de 5x moeilijk te rechtvaardigen is.

Lange agentloops. Opus 5 verifieert ongevraagd zijn eigen werk, dus een "dubbelcheck je antwoord"-instructie die was afgestemd op een ouder model, leidt nu tot overmatige verificatie en verbrandt redeneertokens. Bij xhigh en maximale inspanning groeit het denkbudget zoals bedoeld. Als je agent geen geavanceerde redenering nodig heeft, is Claude Sonnet 5 voor $3 / $15 de standaard waar de meeste productieteams mee zouden moeten beginnen, en met de inspanningsknop schroef je het terug.

Waar het model niet van ons is. OrcaRouter routeert en factureert; Anthropic draait de gewichten. Het endpoint, de nulopslag, de failover en de waarborgen zijn van ons, maar de kwaliteit van de inferentie en het veiligheidsgedrag zijn van Anthropic, en met BYOK gaat het geld rechtstreeks naar hen. Dat is de deal, ronduit gezegd: je betaalt in beide gevallen het tarief van de provider, en de vraag is of één endpoint voor 200+ modellen het waard is.

Kortom

Roep de Claude Opus 5 API aan met het native Messages-endpoint als je geen andere integratie hebt, en met het OpenAI-compatibele endpoint als je één client voor alles wilt. Het is het juiste model wanneer de taak moeilijk is, de context lang is, en de output $25 per miljoen tokens waard is — en het is het verkeerde model wanneer de taak routine is. De schoonste opstelling is degene die je van gedachten laat veranderen: één endpoint, je eigen sleutel, $0 opslag, en een model-id dat je kunt omwisselen op de dag dat de werkbelasting dat doet.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube