
Claude Opus 5 API-Preise: 5 $ / 25 $ pro 1 Mio. Token, Cache für 0,50 $, und was es wirklich kostet
- DeepSeekNEUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianNEUQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenNEUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
Claude Opus 5 kostet 5,00 $ pro Million Input-Token und 25,00 $ pro Million Output-Token über die Claude Opus 5 API — derselbe Satz, zu dem das Modell auch im OrcaRouter-Verzeichnis gelistet ist, geprüft am 18.08.2026, ohne Aufschlag. Damit ist es halb so teuer wie Claude Fable 5 und kostet genauso viel wie Claude Opus 4.8, und die Preisliste auf der Live-Modellseite von Claude Opus 5 ist die Referenz für die Budgetplanung. Die Stellschrauben sind wichtiger als die Schlagzeile: wiederverwendeter Input wird per Prompt-Caching mit 0,50 $ pro Million abgerechnet, Batch-Preise fallen auf 2,50 $ / 12,50 $, und die Fast-Mode-Beta liegt bei 10 $ / 50 $. Diese Seite ist die Preisreferenz für das Modell — die genaue Preisliste, was eine Anfrage tatsächlich kostet, wie sich der Preis im Vergleich zum Markt verhält, wann es der falsche Kauf ist und wie man es über einen OpenAI-kompatiblen Endpoint mit dem eigenen Schlüssel aufruft.
Preise gelten pro Million Token (Eingabe / Ausgabe), Stand 2026-08-18. Die Dollarbeträge werden aus den veröffentlichten API-Preisen von Anthropic entnommen und mit der OrcaRouter-Modellseite für Claude Opus 5 abgeglichen; Cache-, Batch- und Fast-Mode-Preise wurden von Anthropic angekündigt. Preise ändern sich – prüfen Sie, bevor Sie etwas aufbauen.
Der genaue Preis, heute verifiziert.
Hier ist die vollständige Preisliste für Claude Opus 5, verifiziert am 2026-08-18:

• Input — $5.00 pro 1M Tokens bei einem Cache-Miss.
• Ausgabe — 25,00 $ pro 1 Mio. Token.
• Prompt-Cache-Schreiben — $6.25 pro 1M bei 5-Minuten-TTL, $10.00 pro 1M bei 1-Stunden-TTL.
• Prompt-Cache lesen — 0,50 $ pro 1 Mio. Tokens, ein Rabatt von 90 % auf jede erneut gesendete Eingabe.
• Batch API — 2,50 $ Eingabe / 12,50 $ Ausgabe, pauschal 50 % Rabatt, asynchron.
• Schnellmodus — $10 Eingabe / $50 Ausgabe, ein 2-facher Aufschlag für bis zu etwa 2,5-mal schnellere Ausgabe, Anthropic-Beta.
• Kontextfenster — 1M Token, bis zu 128K Ausgabe.
OrcaRouter gibt den Provider-Preis ohne Aufschlag weiter, sodass der Betrag im Verzeichnis der Betrag ist, den Sie zahlen. Auf der Live-Modellseite zeigt die Karte $5,00 / $25,00 pro 1M, Cache-Read $0,500, Cache-Write $10,00 (der 1-Stunden-TTL-Tarif), mit Vision-, Tools-, JSON- und Reasoning-Badges.
Die Hebel, die den effektiven Preis verändern
Der Grundpreis ist nur der Ausgangspunkt. Drei Modifikatoren ändern, was Opus 5 tatsächlich kostet:
• Prompt-Caching — wiederverwendeter Kontext kostet 0,50 $ pro Million statt 5 $ frisch. Die minimale cachebare Präfixlänge ist auf Opus 5 auf etwa 512 Token gesunken, sodass selbst ein bescheidenes stabiles System-Prompt qualifiziert ist. Für jeden Agenten oder Chat, der bei jeder Runde ein großes Präfix erneut sendet, ist Caching der größte Hebel an der Rechnung — und da Anthropic den Cache pro API-Schlüssel führt, ist es das Bleiben bei einem Schlüssel (einem Kanal), das dafür sorgt, dass die Treffer landen.
• Batch — Anthropics Batch-API führt Aufträge asynchron aus, wobei Ergebnisse in der Regel innerhalb von 24 Stunden verfügbar sind, zum exakt halben Preis: $2.50 / $12.50. Sie lässt sich mit Prompt-Caching kombinieren und eignet sich für Evals, Bulk-Klassifizierung und Offline-Generierung, bei denen Latenz keine Rolle spielt.
• Fast mode — $10 / $50 für bis zu ~2,5-fachen Ausgabedurchsatz, nützlich für latenzkritische Arbeiten mit hohem Ausgabevolumen. Es lässt sich nicht mit der Batch-API kombinieren und ist eine First-Party-Beta von Anthropic; die standardmäßige Durchreichungsrate von einem Router ist der Basispreis von $5 / $25.
Was eine Anfrage tatsächlich kostet
Preise pro Token sind abstrakt, daher hier einige durchgerechnete Beispiele zu den heutigen Kursen:
• Einzelner Chat-Aufruf, 50K Eingabe + 20K Ausgabe — $0.25 + $0.50 = $0.75.
• 1M Eingabe + 1M Ausgabe — $5 + $25 = $30.
• Agenten-Turn, 200K gecachter Kontext + 20K frischer Input + 30K Output — $0.10 + $0.10 + $0.75 = $0.95. Derselbe Turn mit kaltem Cache — 220K frischer Input für $1.10 — ergibt insgesamt $1.85. Das Caching halbiert es nahezu.
• Ein Monat mit 10M Token bei einer 70/30-Aufteilung (Input/Output), wobei 80 % des Inputs aus dem Cache bedient werden: 1,4M frischer Input (7,00 $) + 5,6M gecacht (2,80 $) + 3M Output (75 $) ≈ 85 $. Ohne Cache kostet derselbe Monat 110 $.
Zwei Vorbehalte erhöhen den effektiven Satz. Opus 5 ist ein Denkmodell – adaptives Denken ist standardmäßig aktiviert, und Denk-Token werden als Ausgabe zu 25 $ pro Million abgerechnet. Ein anspruchsvoller Prompt bei hoher Effort-Einstellung kann einen großen Teil des Ausgabebudgets für das Nachdenken verbrauchen, sodass die effektiven Ausgabekosten bei schwierigen Aufgaben weit über einer naiven Schätzung liegen. Und der aktuelle Tokenizer von Anthropic ist wortreicher als der der vorherigen Generation, sodass derselbe englische Text mehr Token (und mehr Geld) kostet als bei älteren Claude-Modellen. Senken Sie die Effort-Einstellung für einfache Aufrufe und begrenzen Sie die Ausgabe, wo Sie können.
Wie die Preisgestaltung von Opus 5 im Vergleich zur Konkurrenz abschneidet

Abgelesen an den veröffentlichten Listenpreisen am 2026-08-18:
• Claude Opus 4.8 — $5 / $25. Identischer Preis wie für die Vorgängergeneration. Opus 5 ist für das neuere Modell gleich teuer, was den Umstieg leicht macht.
• Claude Fable 5 — $10 / $50. Opus 5 kostet die Hälfte von Anthropics Spitzenmodell, mit demselben 1M-Token-Kontext.
• Claude Sonnet 5 — $3 / $15 Standard ($2 / $10 Einführungspreis bis 31. August 2026). Die Sonnet-Stufe ist bei Input und Output 40 % günstiger – die natürliche Standardwahl, wenn man kein Reasoning auf Opus-Niveau benötigt.
• GPT-5.6 Sol — $5 / $30. Gleicher Eingabepreis, günstigerer Output bei Opus 5.
• GPT-5.6 Terra — $2 / $12. Die mittlere Volumenstufe für hochvolumige Non-Frontier-Arbeit.
• Gemini 3.6 Flash — $1.50 / $7.50. Ein Flash-Modell für günstigen, schnellen multimodalen Traffic.
• Kimi K3 — $3 / $15. Ein Open-Weights-Flaggschiff zu etwa der Hälfte der Opus-Preise.
• DeepSeek V4 Pro — 0,44 $ / 0,88 $ außerhalb der Spitzenzeiten (Spitzenzeiten verdoppeln den Preis). Das günstige Open-Weights-Flaggschiff, eine völlig andere Preiswelt.
Die ehrliche Einordnung: Opus 5 ist kein billiges Modell – es ist ein Flaggschiff, das zum halben Preis der obersten Preisklasse (Claude Fable 5) angeboten wird und genau das kostet, was die vorherige Generation gekostet hat. Es punktet beim Preis pro langem Kontext und beim Preis pro schwieriger Denkaufgabe, nicht bei der absoluten Rate. Wenn Ihr Traffic aus kurzen Prompts und einfachen Aufgaben besteht, ist ein Sonnet für $3 oder ein DeepSeek-Modell für $0,44 die günstigere Wahl.
Wenn Opus 5 die falsche Wahl ist
Vier Fälle, in denen dieser Preis nicht der ist, den Sie wollen:
Kurze, einfache Prompts. Bei unter etwa 20K Tokens ohne tiefes Reasoning ist die Opus-Prämie verschwendet. Claude Sonnet 5 für 3 $ / 15 $ (oder 2 $ / 10 $ über das Einführungsfenster) bewältigt die Volumenstufe für 40 % weniger, und ein Gemini-Flash- oder DeepSeek-Klassenmodell kostet noch weitaus weniger.
Denkintensives Volumen. Da Denken als Output abgerechnet wird, kann ein anspruchsvoller Prompt mit hohem Aufwand deutlich über der nominellen Output-Zeile kosten. Wenn Ihre Arbeitslast aus vielen schwierigen Aufrufen besteht, messen Sie die tatsächlichen Output-Tokens, bevor Sie sich festlegen — der effektive Preis kann Sie überraschen.
Preis pro Token als einziges Ziel. Wenn ein Frontier-Benchmark-Score oder der 1M-Kontext nicht die harte Anforderung ist, liefern günstigere Flaggschiffe (GPT-5.6 Terra, DeepSeek V4 Pro) oder Flash-Modelle (Gemini 3.6 Flash) weitaus niedrigere Preise pro Token für die einfache Mehrheit des Traffics.
Strenge Latenz-Budgets. Opus 5 ist ein großes Thinking-Modell — die p50-Zeit bis zum ersten Token liegt in OrcaRouters 7-Tage-Messung bei etwa 7 Sekunden. Für Echtzeit-Chat, bei dem eine TTFT unter einer Sekunde entscheidend ist, ist es unabhängig vom Preis das falsche Modell.
Wie ruft man es in OrcaRouter auf?

Claude Opus 5 wird auf OrcaRouter als Modell-ID anthropic/claude-opus-5 gehostet und über den OpenAI-kompatiblen Endpunkt api.orcarouter.ai/v1 zum Anbieterpreis ohne Aufschlag bereitgestellt. Wenn Sie bereits einen OpenAI-Client haben, ist die Migration nur eine Änderung von Basis-URL und Modell-ID — sonst nichts. Mit demselben Schlüssel und Endpunkt sind 200+ Modelle verfügbar, sodass Opus 5 neben Claude Sonnet 5, Claude Haiku 4.5, den GPT-5.6-Stufen, der Gemini-Familie und den Open-Weight-Modellen steht, mit denen Sie es vergleichen möchten, und Sie nach Schwierigkeitsgrad routen können, statt jedes einzelne Modell neu zu integrieren.
Zwei OrcaRouter-Besonderheiten, die auf einer Preisseite erwähnenswert sind.BYOK: Bringen Sie Ihren eigenen Anthropic-Schlüssel mit, und Anthropic stellt Ihnen direkt zu seinen eigenen Tarifen in Rechnung — OrcaRouter berechnet $0 pro Token, und die Ratenlimits und Guthaben Ihres Anbieters bleiben erhalten.Guardrails: Der PII Shield und die Content-Richtlinie greifen vor der Abrechnung, sodass eine blockierte Anfrage einen sauberen 400 zurückgibt und nie berechnet wird. Die Agent Firewall bewertet Tool- und MCP-Aufrufe, bevor sie ausgeführt werden.
Der Ehrlichkeitshinweis, der für eine Preisseite zählt: wir leiten das Modell weiter, wir bestimmen seinen Preis nicht. Die $5 / $25-Angabe ist der durchgereichte Anthropic-Tarif, und wenn Anthropic ihn ändert, folgt die Auflistung — genau deshalb trägt diese Seite einen Zeitstempel. Wenn du Anthropic direkt aufrufst, erhältst du denselben Tarif; OrcaRouter gibt es für den Single-Key-, Zero-Markup-Weg, wenn du einen einzigen Endpunkt für die gesamte Modellreihe möchtest.
Quellen und Datum
Alle oben genannten Preise wurden am 18.08.2026 überprüft. Die Claude-Werte stammen aus den veröffentlichten API-Preisen von Anthropic und wurden mit der OrcaRouter-Modellseite für Claude Opus 5 abgeglichen (ebenfalls am selben Tag geprüft). Die GPT-5.6-Preise nach der Preissenkung sind die veröffentlichten Tarife von OpenAI; die Angaben zu Gemini, Kimi und DeepSeek sind die aktuellen OrcaRouter-Verzeichniseinträge, wobei DeepSeek V4 Pro zum Off-Peak-Tarif angegeben ist (in Spitzenzeiten verdoppelt er sich). Die Preise von Anthropic sind seit dem Start von Opus 5 am 24. Juli 2026 stabil, aber sie ändern sich – versehen Sie jede frühere „Opus 5 pricing“-Seite, die Sie finden, mit dem Prüfdatum. Die hier genannten Zahlen entsprechen dem heutigen Stand.
Jeder Preis oben ist der Live-Kurs auf der Claude-Opus-5-Modellseite — verifiziert am 2026-08-18 ohne Aufschlag, bereit für Ihren eigenen Schlüssel.
In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
