
Claude Opus 5 API: Wie man sie aufruft, was sie kostet und wann sie Overkill ist
- DeepSeekNEUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianNEUQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenNEUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.
Zwei Endpunkte, ein Modell
Die meisten Tutorials für die Claude Opus 5 API zeigen nur den nativen Anthropic-Aufruf und hören dort auf. Es gibt tatsächlich zwei Dialekte, und beide erreichen dieselben Gewichte.
• Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.
• OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.
• Cloud-Modelle. Auf Amazon Bedrock ist die ID anthropic.claude-opus-5; bei Google Vertex AI und Microsoft Foundry behält es die First-Party-ID claude-opus-5. Diese Pfade sind für Teams gedacht, die bereits an einen Cloud-Anbieter gebunden sind; der OpenAI-kompatible Weg ist derjenige, der Ihren Code portabel hält.
Dem Modell ist es egal, welchen Dialekt du verwendest. Was sich unterscheidet, ist alles rund um den Aufruf — Abrechnung, Schlüssel, Ratenlimits, Failover und wie viele andere Modelle du erreichen kannst, ohne den Code zu ändern.
Was Sie bekommen — und die zwei Dinge, die alten Code brechen.
Claude Opus 5 ist Anthropics auf Reasoning ausgerichtetes Flaggschiff: ein Kontextfenster von 1M Token (das Maximum ist zugleich der Standardwert), ein Ausgabelimit von 128K, ein Wissensstand von Mai 2026 sowie Text-, Bild- und Dateieingabe mit Textausgabe. Auf dem unabhängigen Leaderboard von Artificial Analysis erzielte es AA Coding 78,0, Platz 1 von 132, und AA Intelligence 63,1, Platz 2 von 134, mit einem GPQA Diamond von 93,2 und einem Ergebnis von 54,9 bei Humanity's Last Exam, Stand 24. Juli 2026. Anthropics eigene Angaben beim Launch — etwa das Doppelte von Opus 4.8 bei Frontier-Bench — stammen vom Anbieter selbst und wurden nicht unabhängig reproduziert.

Denken ist standardmäßig aktiviert. Adaptives Denken entscheidet, wie viel bei jedem Aufruf nachgedacht wird, gesteuert durch den output_config.effort Parameter; dieser akzeptiert low bis max und verwendet standardmäßig high. Für Codierungs- und Agenten-Schleifen xhigh ist der empfohlene Ausgangspunkt; low und medium sind auf Opus 5 tatsächlich stärker als auf früheren Modellen, was sie für echte Arbeitslasten statt für Spielereien brauchbar macht. Reasoning-Tokens werden auf Ihre Ausgabeabrechnung angerechnet.
Zwei Breaking Changes von Claude Opus 4.8 beißen jeden, der einen alten Request-Body kopiert:
• Knappe max_tokens führen nun zu abgeschnittenen Antworten. Da das Denken standardmäßig läuft, wird ein max_tokens in der Größenordnung der erwarteten Antwortlänge zuerst vom Denken verbraucht. Wenn du einen 4.8-Workload unverändert übernimmst, erwarte abgeschnittene Antworten, bis du das Limit erhöhst oder den Aufwand reduzierst.
• Sampling-Parameter werden abgelehnt. temperature, top_p und top_k geben bei jedem Nicht-Standardwert einen 400-Fehler zurück, ebenso wie ein Assistant-Prefill. Steuern Sie die Ausgabe mit effort, nicht mit temperature.
• Das Deaktivieren des Denkens ist begrenzt. thinking: {"type": "disabled"} wird nur bei Aufwand high oder niedriger akzeptiert; die Kombination mit xhigh oder max ergibt eine 400. Der sinnvolle Weg, Kosten zu senken, ist, den Aufwand zu verringern, nicht das Denken abzuschalten.
Was es tatsächlich kostet
Claude Opus 5 kostet 5 $ pro Million Eingabe-Token und 25 $ pro Million Ausgabe-Token — derselbe Preis wie bei Claude Opus 4.8, was die leise gute Nachricht des Releases ist. Cache-Lesevorgänge kosten 0,50 $ pro Million (Prompt-Caching benötigt ein Präfix von mindestens 512 Token und unterstützt TTLs von 5 Minuten und 1 Stunde). Ein Research-Preview-Schnellmodus betreibt dasselbe Modell mit bis zu 2,5-facher Ausgabe-Token-Rate pro Sekunde für $10 / $50, und die Batch-API liefert Ergebnisse asynchron zum halben Preis.

Ein konkretes Rechnungsbeispiel: Eine Anfrage mit 100.000 Tokens, die 20.000 Ausgabe-Tokens erzeugt, kostet $0,50 für Eingabe und $0,50 für Ausgabe – also $1,00 ohne Cache. Wenn das 100K-Prompt beim nächsten Aufruf aus dem Cache bedient wird, sinkt der Eingabe-Anteil auf etwa $0,05, also insgesamt $0,55 pro Runde. Diese Cache-Rechnung macht den Unterschied, ob Opus bei langem, wiederholtem Kontext erschwinglich ist oder überhaupt nicht.
Die Stufe darüber und darunter, zum Größenvergleich: Claude Fable 5 ist das leistungsfähigste Modell von Anthropic zu $10 / $50; Claude Sonnet 5 ist $3 / $15 (mit $2 / $10 Einführungspreis bis zum 31. August 2026); Claude Haiku 4.5 ist $1 / $5. Bei OrcaRouter wird jedes dieser Modelle zum Listenpreis des Anbieters ohne Aufschlag pro Token durchgereicht, sodass der obige Vergleich auch das ist, was Sie tatsächlich zahlen.
Der Ein-Endpunkt-Fall
Wenn Sie einen API-Leitfaden für Claude Opus 5 lesen, haben Sie wahrscheinlich bereits eine Integration und einen Schlüssel, und die eigentliche Frage ist, ob Sie für das nächste Modell, das Sie ausprobieren, eine zweite Integration und einen zweiten Schlüssel möchten. OrcaRouter beantwortet das mit einem OpenAI-kompatiblen Endpunkt vor 200+ Modellen: derselbe Client, dieselbe Basis-URL und eine andere Modell-ID pro Modell — anthropic/claude-opus-5 heute, ein günstigeres Modell, wenn die Arbeitslast die Opus-Stufe nicht mehr rechtfertigt, ein neues Frontier-Modell in der Woche, in der es erscheint, alles ohne eine Codeänderung.

Die Preisgestaltung ist der ehrliche Teil. OrcaRouter berechnet $0 pro Token — Sie zahlen den veröffentlichten Preis jedes Anbieters, sodass Claude Opus 5 bei Anthropics $5 / $25 bleibt und eine Preissenkung des Anbieters bei uns am selben Tag live ist, an dem sie bekannt gegeben wird. Eigenen Schlüssel mitbringen ist eine erstklassige Option: Geben Sie Ihren vorhandenen Anthropic-API-Schlüssel ab, behalten Sie Ihre eigenen Rate Limits und Guthaben, und der Anbieter stellt Ihnen direkt in Rechnung. Schutzmechanismen — ein PII-Schutz und eine Inhaltsrichtlinie — werden durchgesetzt, bevor die Anfrage abgerechnet wird, nicht danach. Die Modellseite für anthropic/claude-opus-5 zeigt den Live-Preis, den 1M-Kontext und die aktuellen Durchsatzzahlen, und die Routing-DSL erstellt ein Failover, sodass ein günstigeres Modell antwortet, wenn Opus 5 einen Fehler meldet oder wenn Ihr Verkehrsmuster es zulässt.
Wo Opus 5 die falsche Antwort ist.
Das Beste zu sein ist nicht dasselbe wie das Richtige für deine Arbeitslast zu sein, und es gibt drei Bereiche, in denen das 5-/25-Dollar-Flaggschiff verliert.
• Hochvolumige, risikoarme Aufrufe. Eine Zusammenfassungs- oder Klassifizierungs-Pipeline, die 10 Mio. Eingabetoken pro Monat verarbeitet, kostet $50 bei Claude Opus 5 gegenüber $10 bei Claude Haiku 4.5 — derselbe Endpoint, derselbe Schlüssel, nur eine ID-Änderung. Haiku ist nicht Opus, aber für Routing, Extraktion und Formatierung ist es nahe genug, dass der 5-fache Preis schwer zu rechtfertigen ist.
• Lange Agenten-Schleifen.Opus 5 überprüft seine eigene Arbeit ohne Aufforderung, sodass eine Anweisung wie „Überprüfe deine Antwort doppelt“, die für ein älteres Modell optimiert wurde, nun ein übermäßiges Überprüfen auslöst und Reasoning-Tokens verbrennt. Bei xhigh und maximalem Aufwand wächst das Denkbudget konstruktionsbedingt. Wenn Ihr Agent kein Spitzen-Reasoning benötigt, ist Claude Sonnet 5 für 3 $ / 15 $ der Standard, von dem die meisten Produktionsteams ausgehen sollten, und am Aufwand-Regler drehen Sie ihn herunter.
• Wo das Modell nicht unseres ist. OrcaRouter leitet weiter und stellt Rechnungen aus; Anthropic betreibt die Gewichte. Der Endpunkt, der Null-Aufschlag, das Failover und die Schutzmaßnahmen gehören uns, aber die Inferenzqualität und das Sicherheitsverhalten liegen bei Anthropic, und bei BYOK fließt das Geld direkt an sie. Das ist die Vereinbarung, klar ausgedrückt: Sie zahlen in jedem Fall den Anbieterpreis, und die Frage ist, ob ein einziger Endpunkt für 200+ Modelle es wert ist.
Fazit
Rufen Sie die Claude Opus 5 API mit dem nativen Messages-Endpunkt auf, wenn Sie keine andere Integration haben, und mit dem OpenAI-kompatiblen Endpunkt, wenn Sie einen einzigen Client für alles wünschen. Es ist das richtige Modell, wenn die Aufgabe schwierig ist, der Kontext lang und die Ausgabe 25 $ pro Million Tokens wert ist – und das falsche Modell, wenn die Aufgabe Routine ist. Das sauberste Setup ist dasjenige, das Ihnen die Möglichkeit gibt, Ihre Meinung zu ändern: ein Endpunkt, Ihr eigener Schlüssel, 0 $ Aufschlag und eine Modell-ID, die Sie an dem Tag austauschen können, an dem sich die Arbeitslast ändert.
In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
