Eine Titelkarte für die Preisgestaltung von Claude Opus 5.5 mit den wichtigsten Tarifen von 4,00 $ pro Million Eingabe-Tokens, 20,00 $ pro Million Ausgabe-Tokens und 0,20 $ pro Million Cache-Lese-Tokens.
Guides & Insights

Claude Opus 5.5 Preisgestaltung: Die vollständige Preisliste, die Cache-Zeile und was eine Aufgabe wirklich kostet

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Opus 5.5 kostet laut Liste 4,00 $ pro Million Input-Token und 20,00 $ pro Million Output-Token, eine pauschale Senkung um 20 % gegenüber den 5,00 $/25,00 $, die Claude Opus 5 bisher verlangt hat, wobei die Cache-Lesevorgänge um 60 % auf 0,20 $ pro Million sinken. Das sind die veröffentlichten Preise von Anthropic, abgelesen aus Anthropics eigener Preis-Dokumentation am 24. September 2026, zwei Tage nach dem Start des Modells. Der Listenpreis ist der leichte Teil. Anthropic gibt außerdem an, dass das Modell bei typischen Workloads "etwa 40 % weniger kostet im Betrieb", und diese Zahl steht nicht auf dem Preisblatt — sie ist eine Charakterisierung des Anbieters, die sich aus der Senkung pro Token plus der Annahme zusammensetzt, dass das Modell weniger Token und weniger Turns benötigt, um dieselbe Aufgabe zu erledigen. Diese Seite trennt beides: jeden Tarif, den Sie heute auf dem Blatt verifizieren können, und die Arithmetik hinter dem einen, den Sie nicht verifizieren können. Claude Fable 5.1, die darüberliegende 10 $/50 $-Stufe, erscheint durchgängig als der Vergleich, den Anthropic selbst anstellt.

Die vollständige Preisliste, jede Zeile so, wie Anthropic sie veröffentlicht

Alles in diesem Abschnitt wurde aus Ant​hropics Preisgestaltungs-Dokumentation auf platform.claude.com und claude.comam 24. September 2026 entnommen. Nichts hier wurde aus einer anderen Ausarbeitung übernommen.

Eingabe — 4,00 $ pro Million Tokens (der von Anthropic veröffentlichte Preis).

Ausgabe — 20,00 $ pro Million Tokens. Thinking-Tokens werden als Ausgabe-Tokens abgerechnet, und das adaptive Denken von Claude Opus 5.5 ist immer aktiv und kann nicht deaktiviert werden.

Cache-Lesevorgang — 0,20 $ pro Million Token. Anthropic dokumentiert dies als das 0,05-Fache des Basis-Eingabepreises, eine eigene Fußnoten-Ausnahme für dieses Modell.

5-Minuten-Cache-Schreibvorgang — 5,00 $ pro Million Tokens, der standardmäßige 1,25-fache Basis-Input-Multiplikator, den Ant​hropic auf jedes Modell in der Tabelle anwendet.

1-Stunden-Cache-Schreibvorgang — 8,00 $ pro Million Tokens, der standardmäßige 2-fache Multiplikator auf die Basis-Input-Kosten.

Batch API — 50 % Rabatt in beide Richtungen: 2,00 $ Eingabe und 10,00 $ Ausgabe pro Million. Ant​hropic veröffentlicht die rabattierten Beträge direkt, anstatt dass Sie sie selbst halbieren müssen.

Fast mode — 8,00 $ für Eingabe und 40,00 $ für Ausgabe pro Million, genau 2x Standard. Die Dokumentation von Anthropic gibt der Seite den Titel „Fast mode (research preview)".

Nur-US-Inferenz – ein 1,1-facher Multiplikator für Input, Output, Cache-Schreibvorgänge und Cache-Lesevorgänge, wenn inference_geo: "us" gesetzt ist. Globales Routing, die Standardeinstellung, verwendet Standardpreise.

Kontext und Ausgabegrenze — 1M Tokens Kontext und 128K synchrone Ausgabe zum Standardpreis, ohne Aufschlag für langen Kontext. Anthropic gibt an, dass eine Anfrage mit 900k Tokens zum gleichen Preis pro Token abgerechnet wird wie eine mit 9k Tokens. Bei der Batch API steigt die Ausgabegrenze auf 300K hinter dem output-300k-2026-03-24 Beta-Header.

Anthropic stellt außerdem fest, dass die Caching-Multiplikatoren „mit anderen Preismodifikatoren wie dem Batch-API-Rabatt und der Datenresidenz kumulieren“ – eine gebatchte, gecachte, auf die USA festgelegte Anfrage multipliziert also alle drei, und die Arithmetik kumuliert, statt dass die Faktoren einander ersetzen.

Hier ist, was die Leser der beiden Modelle an Kosten tatsächlich auf demselben Blatt abwägen:

Claude Opus 5 — 5,00 $ Eingabe, 25,00 $ Ausgabe, 0,50 $ Cache-Lesen, 6,25 $ für einen 5-minütigen Cache-Schreibvorgang, 10,00 $ für einen 1-stündigen Schreibvorgang, 2,50 $/12,50 $ bei Batch (Anthropics veröffentlichte Preise, abgerufen am 24.09.2026).

Claude Fable 5.1 — 10,00 $ Eingabe, 50,00 $ Ausgabe, 0,25 $ Cache-Lesen, 12,50 $ für einen 5-Minuten-Cache-Schreibvorgang, 20,00 $ für einen 1-Stunden-Schreibvorgang, 5,00 $/25,00 $ bei Batch (die veröffentlichten Preise von Anthropic, abgerufen am 24.09.2026).

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

Die Cache-Zeile ist der Punkt, an dem eine Agenten-Rechnung tatsächlich entschieden wird

Die Launch-Berichterstattung behandelt den Cache-Read als Fußnote. Er ist der größte einzelne Hebel auf dem Blatt für jede Workload, die ein großes Präfix erneut sendet – und das sind die meisten Coding- und Agent-Workloads.

Anthropics eigene Fußnote ist ungewöhnlich explizit, was die Verhältnisse angeht: Cache-Treffer und -Aktualisierungen kosten bei den meisten Claude-Modellen das 0,1-Fache des Basis-Eingabepreises, das 0,025-Fache bei Claude Fable 5.1 und das 0,05-Fache bei Claude Opus 5.5. Das Cache-Verhältnis von Claude Opus 5.5 ist also doppelt so schlecht wie das Standardverhältnis und doppelt so schlecht wie das von Claude Fable 5.1.

In Dollar gewinnt es trotzdem, und das ist der Teil, den es sich zu verinnerlichen lohnt: Ein besserer Multiplikator gewinnt bei Dollar nicht, wenn die Basisrate zweieinhalbmal so hoch ist.

• Claude Fable 5.1 — 2,5 % einer Basis von 10,00 $ sind 0,25 $ pro Million gecachter Token.

• Claude Opus 5.5 — 5 % einer Basis von 4,00 $ sind 0,20 $ pro Million gecachter Token.

• Claude Opus 5 — 10 % einer Basis von $5.00 ist $0.50 pro Million gecachter Token.

Dieselbe Umkehrung gilt auch bei Schreibvorgängen. Claude Fable 5.1 berechnet 12,50 $, um eine Million Token in den 5-Minuten-Cache zu schreiben, und 20,00 $ für das 1-Stunden-Fenster; Claude Opus 5.5 berechnet 5,00 $ und 8,00 $. Cache-Lesevorgänge sind der eine Punkt, an dem Claude Opus 5.5 beide Geschwister bei den absoluten Dollarbeträgen übertrifft, obwohl es das mittlere Verhältnis aufweist.

Zwei Regeln entscheiden darüber, ob sich der Write überhaupt lohnt. In der Dokumentation von Anthropic heißt es, dass ein 5-minütiger Write das 1,25-Fache des Basis-Inputs kostet und sich daher schon nach einem einzigen Cache-Read amortisiert, während ein 1-stündiger Write das 2-Fache des Basis-Inputs kostet und zwei Reads benötigt, um sich zu amortisieren. Und der Cache ist an das Präfix gebunden, das ihn erzeugt hat: Anthropic weist darauf hin, dass ein Wechsel zwischen schneller und Standard-Geschwindigkeit den Cache ungültig macht, weil Anfragen mit unterschiedlichen Geschwindigkeiten keine gecachten Präfixe teilen. Das Ändern des Modells, der Effort-Stufe oder der Tool-Definitionen hat denselben Effekt. Ein günstigeres Modell, das bei jedem Wechsel ein Neuschreiben des Präfixes erzwingt, kann mehr kosten als das teure Modell, das es ersetzt hat.

Was ein langer Agent-Loop tatsächlich kostet

Nehmen Sie einen Coding-Agenten mit 40 Turns, der bei jedem Turn ein Präfix von 120.000 Tokens — System-Prompt, Tool-Schemas, Dateibaum — erneut sendet, pro Turn 1.000 frische Eingabe-Tokens aus Tool-Ergebnissen hinzufügt und pro Turn 800 Ausgabe-Tokens erzeugt. Die Substitution ist hier der springende Punkt: Ändern Sie eine beliebige dieser vier Zahlen, damit sie zu Ihrem eigenen Traffic passt, und die folgende Rechnung gilt weiterhin.

Zu Claude Opus 5.5:

• Cache-Schreibvorgang, einmalig — 120.000 Tokens zu 5,00 $ pro Million = 0,60 $

• Cache-Lesevorgänge, 39 Runden — 4.680.000 Tokens bei 0,20 $ pro Million = 0,94 $

• Neue Eingabe, 40 Turns — 40.000 Tokens bei 4,00 $ pro Million = 0,16 $

• Ausgabe, 40 Turns — 32.000 Tokens zu $20,00 pro Million = $0,64

Sitzungssumme — 2,34 $, davon machen Cache-Lesevorgänge etwa 40 % aus.

Bei Claude Opus 5, identische Token-Anzahl: $0,75 für Cache-Schreibvorgänge, $2,34 für Cache-Lesevorgänge, $0,20 für frischen Input und $0,80 für Output — $4,09.

Bei Claude Fable 5.1, identische Token-Anzahl: 1,50 $ für Cache-Schreibvorgänge, 1,17 $ für Cache-Lesevorgänge, 0,40 $ für frischen Input und 1,60 $ für Output — 4,67 $.

Gleiche Tokens, gleiche Turns, kein Effizienzanspruch nötig: Claude Opus 5.5 liegt 43 % unter Claude Opus 5 und 50 % unter Claude Fable 5.1. Und 1,40 $ der 1,75 $-Differenz gegenüber Claude Opus 5 — achtzig Prozent der Ersparnis — stammen allein aus der Cache-Read-Zeile, nicht aus dem beworbenen Input-Tarif.

Nun der umgekehrte Fall: ein Single-Shot-Aufruf mit 20.000 Eingabe-Token und 8.000 Ausgabe-Token, ohne Caching. Claude Opus 5.5 kostet 0,08 $ für die Eingabe plus 0,16 $ für die Ausgabe — 0,24 $. Claude Opus 5 kostet 0,10 $ plus 0,20 $ — 0,30 $. Das ist genau die 20-%-Listenpreissenkung, und keinen Punkt mehr.

Die Preisliste allein ergibt also irgendwo zwischen 20 % und 43 %, je nachdem, wie viel Ihrer Rechnung auf Cache-Lesevorgänge entfällt. Jede Angabe über diesem Bereich stammt aus Token-Zahlen, nicht aus den Preisen.

Woher Anthropics „etwa 40 % günstiger im Betrieb“ stammt

Anthropics Einführungsmaterial besagt, dass Claude Opus 5.5 „weniger Rechenleistung für die Bereitstellung benötigt als Opus 5“ und dass seine Tests zeigen, dass es bei Standardeinstellungen „bei typischen Workloads 40 % weniger kosten wird als Opus 5“. Die Aufschlüsselung, die Anthropic liefert, lautet, dass das Modell „weniger pro Token kostet als Opus 5 und weniger Token pro Aufgabe verbraucht, was unterm Strich zu einem Kostenrückgang von 40 % führt.“

Bezeichne das als das, was es ist: eine Anbieter-Charakterisierung eines Durchschnitts über Workloads, die Anthropic ausgewählt hat, kein geprüftes Ergebnis und kein auf der Preisliste veröffentlichter Tarif. Die überprüfbare Hälfte ist die erste Hälfte – 20 % Rabatt auf Input und Output, 60 % Rabatt auf Cache-Lesevorgänge, beides heute auf der Preisliste nachlesbar. Die zweite Hälfte hängt davon ab, dass das Modell weniger Tokens und weniger Turns verbraucht für deine Workload, was sich nur durch Ausführen überprüfen lässt.

Die Belege, die Ant​hropic für die Token-Hälfte vorlegt, sind eine Reihe von Kundenaussagen zum Startzeitpunkt. Alle folgenden wurden vom Anbieter veröffentlicht und beschreiben Workloads, die der Anbieter und seine Kunden ausgewählt haben:

Box — das Modell „verbrauchte ein Drittel der Tokens, die Opus 5 verbrauchte“, mit Antworten, die „40 % weniger ausführlich, ohne an Genauigkeit zu verlieren“ sind.

Kiro — es „löste mehr als Opus 5, machte dabei etwa 40 % weniger Aufrufe und verbrauchte die Hälfte der Tokens.“

Factory — es „erreichte Opus 5 bei hohem Aufwand und verbrauchte dabei 20 bis 25 % weniger Ausgabe-Tokens."

GitHub – es „verbrauchte unter den wenigsten Tokens und Schritten, die wir gemessen haben“, und in VS Code „löste es mehr Terminal-Aufgaben als Opus 5 in weniger als der Hälfte der Schritte“.

Fusionsanalyse, ein durchgerechnetes Beispiel — zwei fiktive HR-Software-Unternehmen, wobei jedes Modell ein Excel-Modell und eine Management-Präsentation erstellt. Anthropic berichtet, dass Claude Opus 5.5 in 63 Minuten fertig war, gegenüber 93 Minuten bei Claude Opus 5, und „50 % weniger Produktionskosten" verursachte. Vom Anbieter angegeben, n=1.

Das unabhängige Gegengewicht ist hier von Bedeutung, weil es in die andere Richtung weist. Artificial Analysis hat Claude Opus 5.5 bei maximalem Aufwand mit etwa 119.000 Ausgabe-Tokens pro Intelligence-Index-Aufgabe, gegenüber etwa 73.000 für Claude Opus 5 bei maximalem Aufwand – die Token-Anzahl geht nach oben, nicht nach unten. Seine Zusammenfassung dieser Konfiguration lautet, dass Claude Opus 5.5 „auf Augenhöhe mit Opus 5 bei den Kosten pro Aufgabe ist, trotz 1,6-facher Ausgabe-Tokens“ bei veröffentlichten Kosten von 5,98 $ pro Intelligence-Index-Aufgabe. Das ist eine unabhängige Messung bei maximalem Aufwand, und es ist kein Widerspruch zu Anthropics Behauptung – es ist das andere Ende der Aufwandsskala.

Damit ist der Vorbehalt angesprochen, der für jede Zahl in diesem Abschnitt gilt. Anthropic gibt an, dass alle Ergebnisse für Claude Opus 5.5, sofern nicht anders angegeben, adaptives Denken mit maximalem Aufwandverwenden. Claude Opus 5.5 verwendet standardmäßig mittleren Aufwand; Claude Opus 5 verwendete standardmäßig hohen, und dieselbe Bezeichnung der Stufe bedeutet bei den beiden Modellen nicht dasselbe Denkbudget. Eine Anbietertabelle, die mit maximalem Aufwand erstellt wurde, und eine unabhängige Tabelle, die mit maximalem Aufwand bei aktiviertem Standard-Fallback erstellt wurde, sind also nicht dieselbe Konfiguration, und auch die Standardeinstellung ist nicht das, was ein Leser tatsächlich einsetzen würde. Ein über eine ausgewählte Gruppe von Workloads gemessener Durchschnitt von 40 %, bei Einstellungen, die Sie möglicherweise gar nicht verwenden, ist eine Ausgangshypothese – keine Budgetposition.

Der Fast-Modus ist eine Forschungsvorschau, kein Tarif.

Der Fast-Modus bei Claude Opus 5.5 kostet 8,00 $ pro Million Eingabe und 40,00 $ pro Million Ausgabe — genau doppelt so viel wie der Standardpreis — für bis zu 2,5-mal mehr Ausgabe-Tokens pro Sekunde. Die Zeit bis zum ersten Token verbessert er nicht; der Gewinn liegt in der Ausgabegeschwindigkeit und ist beim Streaming am deutlichsten sichtbar.

Sagen Sie den Rest ganz offen, denn es ist leicht, dies als Tarif einzuplanen, obwohl es keiner ist. Anthropic bezeichnet den Fast Mode als Forschungsvorschau. Der Zugang wird über einen Account-Manager oder die Warteliste beantragt. Er erfordert den fast-mode-2026-02-01-Beta-Header und speed: "fast" in der Anfrage. Es ist nur über die Claude API verfügbar – nicht auf Amazon Bedrock, Google Cloud, Microsoft Foundry oder Claude Platform on AWS. Es kann nicht mit der Batch API oder mit einer Priority-Tier-Verpflichtung kombiniert werden. Es lässt sich durchaus mit Prompt-Caching und Datenresidenz-Multiplikatoren kombinieren, sodass eine US-gebundene gecachte Fast-Mode-Anfrage 1,1x zusätzlich zu 2x zahlt. Und das Umschalten einer Workload zwischen Fast- und Standardgeschwindigkeit macht den Prompt-Cache ungültig, was bei einer langen Agent-Schleife mehr kosten kann, als die Geschwindigkeit einspart.

Claude Opus 5 und Claude Opus 4.8 unterstützen ebenfalls den Fast-Modus, zu $10.00/$50.00. Claude Opus 4.7 lehnt den Parameter rundweg ab.

Die Einheit, die über die Rechnung entscheidet, sind die Kosten pro abgeschlossener Aufgabe

Jeder oben genannte Satz ist ein Preis pro Token. Niemand kauft Token. Ein Preis pro Token wird erst dann zu Kosten, wenn er mit den Token, die eine Aufgabe verbraucht, und der Anzahl der Versuche, die zum Abschluss nötig sind, multipliziert wird.

Rechnen Sie das cache-light-Beispiel von vorhin durch. Bei 0,24 $ pro Durchlauf kostet ein Modell, das eine Aufgabe beim ersten Versuch erledigt, 0,24 $. Dieselbe Aufgabe kostet bei einem Konkurrenten mit 0,30 $ pro Durchlauf 0,30 $ — also scheint das günstigere Modell um 20 % vorne zu liegen. Nehmen wir nun an, das günstigere Modell benötigt 1,2 Durchläufe pro erledigter Aufgabe, was eine großzügige Erfolgsquote für agentische Arbeit ist: 1,2 × 0,24 $ ergibt 0,288 $, gegenüber 0,30 $ für die Alternative mit einem Durchlauf. Die Ersparnis ist weg. Bei drei Durchläufen sind es 0,72 $, und das Modell, das pro Token 20 % günstiger aussah, ist pro erledigtem Auftrag 140 % teurer.

Deshalb sind die eigenen Effizienzaussagen von Anthropic – weniger Tokens, weniger Aufrufe, weniger Schritte – in der richtigen Einheit formuliert. Deshalb sollte auch keine davon als Budgetposten gelten, solange Sie sie nicht reproduziert haben. Die Prüfung ist mechanisch: Preis pro Durchlauf, multipliziert mit Durchläufen pro abgeschlossener Aufgabe, gemessen an Ihrem eigenen Traffic. Beide Zahlen müssen Sie selbst liefern, und kein Anbieter veröffentlicht die zweite für Ihren Workload.

Wenn Sie einen einzelnen Referenzpunkt von außerhalb des Anbieters möchten, veranschlagt Artificial Analysis Claude Opus 5.5 mit 5,98 US-Dollar pro Intelligence-Index-Aufgabe in seiner Max-Effort-Konfiguration — eine unabhängige Zahl für eine Einstellung, die der Großteil des Produktionsverkehrs nicht nutzen wird, und damit eher als Obergrenze denn als Prognose zu gebrauchen.

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

Leitungen, die der beworbene Tarif nicht enthält

Residenz.US-only Inference beträgt das 1,1-Fache für jede Token-Kategorie, einschließlich Cache-Lese- und -Schreibvorgängen. Es lässt sich mit dem Schnellmodus und mit dem Batch-Rabatt kombinieren.

Werkzeugdefinitionen. Anthropic veröffentlicht einen modellspezifischen Overhead für den Tool-Use-System-Prompt: Das Deklarieren von Tools fügt jeder Claude Opus 5.5-Anfrage 286 Tokens hinzu. Bei 4,00 $ pro Million wenig, doch es wird pro Anfrage berechnet, und eine Agenten-Schleife erzeugt eine Menge Anfragen.

Cache-Invalidierung. Ein Präfix, das nach einer Änderung an Modell, Effort, Tool-Definition oder Geschwindigkeit neu geschrieben wird, wird mit dem Schreib-Tarif abgerechnet – 5,00 $ oder 8,00 $ pro Million bei Claude Opus 5.5 – und nicht mit dem Lese-Tarif von 0,20 $.

Das Modell darunter.Claude Sonnet 5 liegt bei 2,00 $ pro Million Input-Tokens und 10,00 $ pro Million Output-Tokens – die Preisfußnote von Anthropic bestätigt, dass dies inzwischen der Standardpreis ist und nicht mehr der Einführungspreis, als der er angekündigt wurde. Claude Opus 5.5 ist genau 2x Sonnet 5, in beide Richtungen.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

Claude Opus 5.5 zum Listenpreis von Anthropic aufrufen

Claude Opus 5.5 ist auf OrcaRouter verfügbar unter anthropic/claude-opus-5.5 für 4,00 $ Input und 20,00 $ Output pro Million — der eigene Listenpreis von Ant​hropic, durchgereicht zu 0 % Aufschlag. Diese Weitergabe sollte auf einer Preisseite präzise benannt werden: Da der Anbietertarif weitergegeben und nicht in einer Tabelle zwischengespeichert wird, ist eine Tarifänderung des Anbieters hier am selben Tag live, an dem sie veröffentlicht wird, nicht erst nach einem Synchronisierungsfenster. Wenn Ant​hropic dieses Preisblatt ändert, wandert die Zahl, die Sie hier abrufen, mit.

Derselbe Schlüssel erreicht die Stufen, mit denen diese Seite ihn vergleicht — anthropic/claude-opus-5 zu 5,00 $/25,00 $ und anthropic/claude-fable-5.1 zu 10,00 $/50,00 $ — zusammen mit dem restlichen Claude-Lineup und mehr als 200 weiteren Modellen, sodass das Testen, ob der günstigere Preis pro Token den Kontakt mit Ihren eigenen Durchlaufzahlen übersteht, weder einen zweiten Vertrag noch eine Codeänderung erfordert. Automatisches Failover ist für den Fall da, dass Sie ein unbekanntes Modell in einem Produktionspfad ausführen möchten, ohne den Pfad darauf zu verwetten.

Die Antwort in zwei Zeilen darauf, worum es auf dieser Seite geht: Die Preisliste lautet: 4,00 $ für Eingabe, 20,00 $ für Ausgabe und 0,20 $ pro Million gecachter Lesezugriffe, und der Rabatt von 20 % ist real und heute überprüfbar. Die 40 % sind der Durchschnitt von Anthropic über die von ihm ausgewählten Workloads. Lassen Sie einen Ihrer eigenen Agent-Loops damit laufen, bevor Sie Ihr Budget auf die zweite Zahl stützen.

In diesem Artikel verglichen3

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert