
Claude Opus 5.5 Demos kosten 3 bis 26 Dollar: Wie man die ersten Tage von Builds interpretiert
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 495 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 186 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
Zwei Zahlen aus der ersten Woche von Claude Opus 5.5beschreiben dasselbe Modell und weichen um eine Größenordnung voneinander ab. Ein Entwickler berichtet von einem fertigen interaktiven Linsenlabor — einer Seite, auf der man einen Fokusring zieht und beobachtet, wie eine leuchtende Fokusebene durch ein Tal fegt — bei $25.66an API-Ausgaben und einer Stunde und 26 Minuten Wanduhrzeit. Eine viel geteilte Zusammenfassung von Launch-Demos bepreist eine prozedural erstellte Blender-Schloss-Animation, komplett mit Feuerwerk und einer See-Spiegelung, bei $13.30und 35 Minuten. Ein Thread, der es auf die Startseite von r/ClaudeAI geschafft hat, nennt $3.21. Der Anbieter veröffentlichte Claude Opus 5.5am 22. September 2026 zu $4 pro Million Eingabe-Token und $20 pro Million Ausgabe-Token, und keine dieser drei Zahlen ist falsch. Sie messen unterschiedliche Dinge, und wenn Sie gegen sie budgetieren, müssen Sie wissen, welche.
Die Lücke ist kein Rauschen. Sie ist der Unterschied zwischen dem, was ein Agentenlauf produziert und was er verbraucht, und die letzten vier Tage haben eine bemerkenswerte Menge des Letzteren hervorgebracht, mit sehr wenig Abrechnung dafür. Hier ist also die Arithmetik, die niemand zusammen mit den Demos veröffentlicht hat, dann der Teil des Launches, der tatsächlich auf einer Preisliste steht und überprüft werden kann.
Was $25.66 tatsächlich kaufte
Das teure Ende der Spanne ist das nützlichste Ende, weil der Erbauer sowohl das Artefakt als auch die Rechnung veröffentlicht hat.
Ryan Sael's Lens Lab mit dem Titel „Die Schärfeebene“ ist eine einzelne interaktive Seite, die aus einem einzigen Prompt in einer einzigen Session entstanden ist. Sie zeigt ein Kameraobjektiv auf dem Bildschirm, lässt dich den Fokusring ziehen und zeigt dir das, wovon jeder Fotograf weiß, das aber fast niemand je gesehen hat: die dünne Scheibe in der Welt, an der ein Foto tatsächlich scharf wird. Dreh am Ring, und die Scheibe bewegt sich, die Glaselemente gleiten im Tubus nach vorn oder hinten, um zu zeigen, warum, und eine Konsole meldet die Entfernung, die Blende und die Schärfezone — 60 cm, f/2, 1,9 cm Tiefe, bei den Einstellungen, mit denen die Seite startet. Blende von f/2 auf f/16 ab, und die Schärfezone wird breiter, während der Lichtkegel enger wird. Eine Explosionsansicht trennt das Glas. In der Pipeline gibt es nirgends ein Bildmodell und keine heruntergeladenen Assets: Jedes Element wird im Code gezeichnet und animiert, weshalb die gesamte Demonstration des Zerstreuungskreises eine Live-Simulation statt eines Diagramms ist.
Das ist ein wirklich guter Erklärtext, und die damit verbundene Behauptung ist ungewöhnlich präzise: ein einziger Durchgang, 1 Stunde 26 Minuten, 25,66 $ API-Nutzung, wobei die Seite unter lens.lab.sael.net live war, als ich sie las. Die Zahl ist selbstberichtet und nicht überprüfbar, aber sie ist auch die einzige kursierende Demo-Kostenangabe, die mit einer Sitzungslänge zum Teilen daherkommt.
Rechnen wir das anhand der Preisliste durch. Bei den von Claude Opus 5.5 veröffentlichten Preisen von 4 $ pro Million Input und 20 $ pro Million Output liegt 25,66 $ zwischen 1,28 Millionen Tokens und 6,4 Millionen Tokens, je nach Mischung – das obere Ende, wenn der Lauf nur aus Input bestünde, das untere Ende, wenn er nur aus Output bestünde. Ein agentischer Build wie dieser liegt irgendwo in der Mitte, und der Grund, warum er näher am unteren Ende liegt, ist der Posten, den die meisten überspringen: Cache-Reads bei Claude Opus 5.5 kosten 0,20 $ pro Million, ein Vierzigstel des Input-Preises, sodass eine lange Sitzung, die dieselbe wachsende Codebasis immer wieder neu liest, für diesen Datenverkehr fast nichts zahlt. Zehn Millionen gecachte Input-Tokens kosten 2 $. Die Output-Seite ist der Ort, an dem sich anderthalb Stunden, in denen ein Modell Code schreibt, nachdenkt und ihn umschreibt, summieren: Bei 20 $ pro Million kostet eine Million Output-Tokens 20 $, und Thinking-Tokens werden als Output abgerechnet. Saels Zahl passt zu einem Lauf, der in der Größenordnung von einer Million Output-Tokens bei einer großen, günstigen, gecachten Input-Seite erzeugte – genau so sieht ein unbeaufsichtigter 86-minütiger Build aus.
Daraus folgen zwei Dinge. Erstens: Die Senkung des Listenpreises von $5/$25 auf $4/$20, die am Starttag für Aufmerksamkeit sorgte, ist eine Änderung von 20 % pro Token und hätte allein diesen Lauf nicht günstig gemacht; die Senkung der Cache-Read-Kosten von $0.50 auf $0.20 ist die Position, die eine 90-minütige Schleife bezahlbar gemacht hat. Zweitens, und das ist weniger angenehm: Nichts in dem Bericht über $25.66 sagt Ihnen, ob der Lauf gut verlief. Ein gut ausgeführter One-Shot und eine Sitzung, die anderthalb Stunden lang herumgequält hat und dann erfolgreich war, ergeben dieselbe Rechnung.
Die Zahl von 13,30 $ hält ihrer eigenen Arithmetik nicht stand.
Die Mitte der Spanne ist aus einem anderen Grund aufschlussreich. Eine am 23. September veröffentlichte Zusammenfassung von Launch-Demos berichtet über einen direkten Vergleich, bei dem Claude Opus 5.5 gebeten wurde, aus einem einzigen Prompt prozedural eine zehnsekündige Blender-Animation zu erstellen – Schloss, See mit Spiegelung, Feuerwerk – gegen GPT-6 Astra, ohne manuelle Bearbeitung, und nennt 35 Minuten und 199.600 Ausgabe-Token für etwa 13,30 US-Dollar, gegenüber 28 Minuten und etwa 14,50 US-Dollar für GPT-6 Astra. Die Tokenanzahl ist der interessante Teil, denn sie passt nicht zum Preis.
199.600 Ausgabe-Tokens bei Claude Opus 5.5 zu 20 $ pro Million sind 3,99 $, nicht 13,30 $. Um allein über die Ausgabe auf 13,30 $ zu kommen, bräuchte man 650.000 Tokens. Das fehlende Geld steckt in den anderen Spalten: Input zu 5 $ pro Million, Cache-Schreibvorgänge zu 5 $ pro Million für einen Fünf-Minuten-Breakpoint und 8 $ pro Million für eine Stunde, dazu etwaige Wiederholungsversuche. Das ist kein Widerspruch im Bericht — es ist der Bericht, der ehrlich ist über eine Token-Zahl, die eine Sache zählt, und eine Rechnung, die vier zählt, was die mit Abstand häufigste Verwechslung in Kostendiskussionen der Launch-Woche ist. Wenn Sie eine einzige Zahl aus einer veröffentlichten Demo mitnehmen, dann nehmen Sie den Dollar-Betrag, und behandeln Sie jede daneben stehende Token-Zahl als Teilbeschreibung des Durchlaufs.
Am günstigen Ende wird die Abrechnung noch dünner. Der r/ClaudeAI-Thread, der 3,21 $ API-Nutzung für einen fertigen Build meldet, ist typisch für das Genre: ein Titel, ein Video und keine Aufschlüsselung. Wahrscheinlich handelt es sich um eine kürzere Sitzung, ein kleineres Artefakt oder eine Menge zwischengespeicherter Eingaben. Darauf lässt sich kein Budget planen, und ich konnte keinen einzigen Dollar davon verifizieren.
Warum jede einzelne dieser Zahlen eine untere Schranke ist
Das Fehlermuster hier ist nicht, dass Entwickler etwas vorspielen. Es ist Selektion. Die Demos, die kursieren, sind die, die funktioniert haben, veröffentlicht von den Leuten, für die sie gearbeitet haben, und die vier Versuche, die eine kaputte Seite hervorbrachten, kosteten genauso viel wie der eine, der das nicht tat. Die Rundschau, die den Blender-Vergleich zusammengestellt hat, sagt das ganz offen – dass niemand die Fehlschläge postet – und ihr eigener ausführlichster Eintrag ist ein Paradebeispiel: eine Website einer Uhrenmarke, die das Briefing verfehlte und beim ersten Durchgang eine unlesbare Schrift verwendete und einen zweiten Durchgang brauchte, um die Version zu werden, die gezeigt wurde.
„One shot“ verrichtet in diesem Vokabular ebenfalls im Stillen seine Arbeit. Der Begriff beschreibt eine einzelne Sitzung, nicht einen einzelnen Versuch, und eine Sitzung darf so viel Selbstkorrektur enthalten, wie das Modell erzeugen kann – was bei einem 86-minütigen Lauf eine Menge ist. Dass das Modell seinen eigenen Code zweimal innerhalb eines Kontextfensters umschreibt, ist ein One shot und zwei Versuche.
Die ehrliche Lesart der ersten vier Tage besteht also aus drei Evidenzstufen, und diese sollten nicht gemittelt werden:
• Selbst gemeldete Kosten mit einer Sitzungslänge — brauchbar für die Größenordnung, nicht überprüfbar. Saels 25,66 $ über 1 h 26 min ist der stärkste Posten in dieser Stufe.
• Selbst gemeldete Kosten mit einer Token-Anzahl — häufiger intern widersprüchlich als nicht, wie die Zahl von 13,30 $ zeigt.
• Ein Dollarbetrag ohne alles dahinter — ein Signal, dass jemand etwas gebaut hat, und nicht mehr als das.
Der Teil des Launches, der auf einer Preisliste steht
Lässt man die Demo-Behauptungen beiseite, ist das überprüfbare Bild eng und klar. Alle unten aufgeführten Zahlen sind die von Anthropic veröffentlichten Preise, entnommen der eigenen Modelldokumentation und Ankündigung des Unternehmens vom 25. September 2026:
• Eingabe — 4 US-Dollar pro Million Tokens. Ausgabe — 20 US-Dollar pro Million, wobei Thinking-Tokens als Ausgabe berechnet werden und das adaptive Denken von Claude Opus 5.5 immer aktiv und nicht abschaltbar ist.
• Cache-Lesevorgänge — 0,20 US-Dollar pro Million, ein Multiplikator von 0,05x. Cache-Schreibvorgänge — 5 US-Dollar pro Million beim Fünf-Minuten-Breakpoint, 8 US-Dollar pro Million beim Ein-Stunden-Breakpoint. Batch-API — 50 % Rabatt in beide Richtungen, 2 und 10 US-Dollar.
• Fast-Modus — 8 US-Dollar Eingabe und 40 US-Dollar Ausgabe pro Million, bis zu 2,5-fache Geschwindigkeit, und Anthropic bezeichnet es weiterhin als Research Preview.
• Envelope — 1M-Token-Kontext, 128K Ausgabe-Tokens synchron und 300K bei der Batch-API mit einem Beta-Header, verlässlicher Knowledge-Cutoff von Juni 2026, Standard-Effort mittel statt des hohen Werts, den Claude Opus 5 standardmäßig nutzte.
• Verfügbarkeit — Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS, mit einer zugesagten Stilllegung frühestens am 22. September 2027.
Die eigenen Leistungsbehauptungen des Anbieters, als Behauptungen gekennzeichnet: Claude Opus 5.5 erreicht bei den meisten Aufgaben das Niveau von Claude Fable 5.1, kostet im Betrieb etwa 40 % weniger als Claude Opus 5 und generiert Ausgaben um mehr als 30 % schneller. Die 40 % sind ein vom Anbieter ausgewählter Durchschnittswert über die Arbeitslast, keine Zahl aus einer Preisliste, und die beiden sollten nicht so zitiert werden, als wären sie dieselbe Art von Tatsache.
Die unabhängige Prüfung fällt kleiner aus als die Anbietertabelle und weist mit geringerem Abstand in dieselbe Richtung. Artificial Analysis bewertet Claude Opus 5.5 mit 57,6 auf seinem Intelligence Index – daneben 61,4 bei Humanity's Last Exam, 66,9 bei SciCode und 84,7 bei der Erinnerung an langen Kontext in den Zahlen, die seine Modellseite aufführt. Bei der Coding-Agent-Messung derselben Publikation, die Kosten pro Aufgabe statt Kosten pro Token ausweist, geht die Zahl in die andere Richtung: Bei maximalem Aufwand steigen die Kosten pro Aufgabe auf etwa 13,04 US-Dollar, gegenüber 10,79 US-Dollar für Claude Opus 5 in derselben Testumgebung. Ein billigeres Token, von dem das Modell mehr verbraucht, ist keine billigere Aufgabe. Das ist dieselbe Lektion, die die Demo-Rechnungen erteilen, und sie kommt von dritter Seite.
Was in der zweiten Woche anders gemacht werden sollte
Wenn die Zahl 25,66 $ diejenige war, die Sie dazu gebracht hat, das auszuprobieren, ist der sinnvolle Schritt nicht, 25,66 $ einzuplanen – sondern Ihren eigenen Durchlauf eine Zahl liefern zu lassen, die Sie erklären können.
Lege den Effort explizit fest, statt den Standard zu akzeptieren, denn er ist der Regler, der die Tokens pro Aufgabe stärker beeinflusst als die Modellwahl, und der Standard hat sich bei diesem Modell gegenüber Claude Opus 5 geändert. Cache den stabilen Präfix bewusst: Der minimale cachefähige Prompt bei Claude Opus 5.5 beträgt 512 Tokens, gegenüber 1.024 zuvor, sodass kurze gemeinsame Präfixe, die bisher nie gecacht wurden, es jetzt werden. Gib jedem lang laufenden Job Spielraum bei max_tokens, da das Denken Teil dieses Budgets ist und nicht mehr abgeschaltet werden kann – Anthropics eigene Migrationsempfehlung legt nahe, bei Arbeit auf den höchsten Effort-Stufen mit 64K zu beginnen und von dort aus zu optimieren. Und instrumentiere den Lauf am Ende, nicht am Anfang: Lies das Model-Feld auf oberster Ebene in jeder Antwort, denn bei Prompts, die ihre Klassifikatoren flaggen, leitet Anthropic die Anfrage innerhalb desselben Aufrufs um, und der Modell-String, den du gesendet hast, beschreibt nicht, was geantwortet hat.
Der letzte Punkt ist der, an dem ein Router aufhört, eine Annehmlichkeit zu sein. Ein Build, der eineinhalb Stunden unbeaufsichtigt durch eine Sicherheitsgrenze läuft, kann zurückkommen und stillschweigend einige Turns auf einem kleineren Modell abgeschlossen haben, und die einzige Möglichkeit, das herauszufinden, ist nachzusehen. Claude Opus 5.5 ist auf OrcaRouter zu Anthropics eigenem Listenpreis mit 0 % Aufschlag — der Anbieterpreis wird direkt durchgereicht, sodass eine Preisänderung eines Anbieters hier am selben Tag live ist, an dem sie veröffentlicht wird — was das am wenigsten interessante ist, was Routing hier tut. Das Interessante ist, dass eine API für 200+ Modelle das gesamte Experiment auf einen einzigen Schlüssel legt, sodass „auf dem Frontier-Modell ausführen und lieber zurückfallen als fehlschlagen“ eine Konfigurationszeile ist statt eines zweiten Vertrags und eines Rewrites. Automatisches Failover ist das, was es sicher macht, ein unbekanntes Modell auf einen Pfad zu setzen, der Ihnen wichtig ist, und eine Ablehnung, die Sie umgehen können, ist eine Ablehnung, die Ihren Lauf nicht in Minute 70 beendet.
Die Zahl, die sich als Nächstes bewegt
Anthropic hat gesagt, dass Claude Sonnet 5.5 und Claude Haiku 5.5 „in den kommenden Wochen“ folgen, und das wird jede einzelne dieser Demos neu bepreisen, ohne ihre Form zu ändern: ein günstigerer Preis pro Token gegenüber einer Token-Anzahl, die niemand im Voraus vorhersagen kann. Dieselbe Unsicherheit, die die Zahlen der ersten Woche unbrauchbar machte, wird auch für die der nächsten Generation gelten, was der Grund ist, die Gewohnheit jetzt aufzubauen statt erst, nachdem die Preissenkung erneut greift.
Derzeit ist die ehrliche Zusammenfassung kurz. Claude Opus 5.5 ist real, allgemein verfügbar und kostet 4 $ und 20 $, mit den günstigsten gecachten Lesevorgängen, die diese Produktlinie je geboten hat. Die Demos, die es in seinen ersten vier Tagen erzeugt hat, sind bemerkenswert, und ihre Preisschilder sind Anekdoten. Wenn Sie die Kosten für Ihre eigene Workload möchten, ist das einzige Instrument, das sie abliest, Ihr eigener Lauf – mit Obergrenze –, und die Rechnung wird erst danach gelesen.



In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
