
Claude Sonnet 5.5 rollt auf Claude und der API aus – mit fünf Änderungen, die bestehenden Code brechen
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 348 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
Claude Sonnet 5.5 ist live. Die Ankündigung des Anbieters ist auf den 28. September 2026 datiert, die Modellseite der Claude Platform führt es als „Latest“ auf, und die Kennung lautet claude-sonnet-5-5 in der Claude API, bei Amazon Bedrock, in den Cloud-Konsolen, in Microsoft Foundry und in Claude Platform on AWS. Der Rollout für Claude selbst und für die API ist der Teil, der diese Woche stattfindet. Der Teil, der Sie einen Tag kosten wird, steht an anderer Stelle in derselben Dokumentation: Fünf Breaking Changes betreffen Code, der bereits auf Claude Sonnet 5, und eine sechste ändert die Form der Antwort, ohne dass eine einzige Anfrage fehlschlägt.
Das ist die Gestalt dieses Releases. Die Preisliste blieb unverändert: Claude Sonnet 5.5 kostet $2 pro Million Input-Tokens und $10 pro Million Output-Tokens, genau so viel wie Claude Sonnet 5, mit $0.20 für Cache-Lesevorgänge und $2.50 für einen fünfminütigen Cache-Schreibvorgang. Die Leistungsfähigkeit hat einen großen Sprung gemacht. In der aktuellen Revision von Artificial Analysis liegt das neue Modell 18 Punkte über dem, das es ersetzt, was der größte Abstand zwischen zwei aufeinanderfolgenden Sonnet-Modellen in dieser Rangliste ist. Der Migrationsaufwand ist entsprechend am größten. Nichts davon ist eine Beschwerde — ein Modell, das besser wird, ohne teurer zu werden, ist der gute Fall —, aber die beiden Fakten treffen zusammen ein, und die Release Notes sind die Hälfte, die entscheidet, ob deine Woche in Ordnung ist.
Was wurde am 28. September tatsächlich veröffentlicht?

Die Spezifikation ist eine direkte Fortsetzung der Stufe und keine neue Form:
• Modell-ID — claude-sonnet-5-5 in der Claude API, Claude Platform on AWS und Microsoft Foundry; anthropic.claude-sonnet-5-5 auf Amazon Bedrock
Preis — 2 $ / MTok Eingabe, 10 $ / MTok Ausgabe, 2,50 $ für fünf Minuten Cache-Schreiben, 4 $ für eine Stunde Cache-Schreiben, 0,20 $ Cache-Lesen
• Batch — 50 % Rabatt in beide Richtungen, also $1 / $5 pro MTok
• Kontext und Ausgabe — 1M Tokens Eingabe, 128K Tokens synchron Ausgabe, 300K Ausgabe bei der Message Batches API hinter dem output-300k-2026-03-24 Beta-Header
• Denken — adaptiv, mit einem Standardaufwand von hoch; Wissens- und Trainingsstichtage beide im Juni 2026
• Lebenszyklus — keine Datenaufbewahrung ab Markteinführung und ein veröffentlichter frühester Stilllegungstermin nicht vor dem 28. September 2027
Zwei Details sind leicht zu übersehen und dennoch wichtig. Erstens gibt es keinen Langkontext-Zuschlag: Anthropic berechnet das volle 1M-Token-Fenster zum Standardtarif, sodass eine Anfrage mit 900.000 Token pro Token genauso viel kostet wie eine mit 9.000 Token. Zweitens war der Tarif von $2 / $10 für das vorherige Modell ursprünglich ein Einführungspreis mit einer geplanten Erhöhung auf $3 / $15 zum 1. September 2026; auf der Preisseite von Anthropic steht nun, dass die Erhöhung nicht stattfinden wird, was den aktuellen Preis der Sonnet-Stufe zu einer dauerhaften Zusage statt zu einer Werbeaktion macht. Beides sind Aussagen des Anbieters, keine unabhängigen Befunde.
Die Migrationsliste – in der Reihenfolge, in der sie zuschlagen wird
Anthropics Übersicht zu Sonnet 5.5 ist diesbezüglich ungewöhnlich direkt: Fünf Breaking Changes betreffen Code, der bereits auf Claude Sonnet 5 läuft. Sie sind nicht stilistischer Natur. Jede einzelne gibt einen Fehler zurück oder ändert das Verhalten stillschweigend.
• Die erzwungene Nutzung von Tools wird abgelehnt. Ein tool_choice von "any" oder von einem benannten Tool gibt jetzt einen Fehler zurück, anstatt das Modell einzuschränken. Wenn Ihre Agent-Loop ein Tool festnagelt, um einen strukturierten Aufruf zu garantieren, funktioniert diese Loop ab der ersten Anfrage nicht mehr. Die Lösung besteht darin, das Modell auswählen zu lassen und das Ergebnis zu validieren oder die Garantie in strukturierte Ausgaben zu verlagern.
• thinking: {"type": "disabled"} wird abgelehnt. Das vollständige Ausschalten von Thinking ist keine unterstützte Einstellung mehr. Der Ersatz ist between_tools, das das Denken im Vorfeld abschaltet und bei high Effort oder darunter funktioniert. Es ist die niedrigste Thinking-Einstellung des Modells, kein Ausschalter.
• Denkblöcke sind an das Modell und die Konversation gebunden.Reasoning, das ein vorheriger Turn erzeugt hat, wird von Claude Sonnet 5 auf Claude Sonnet 5.5 weitergetragen, aber nicht auf eine andere Modellfamilie und nicht über Konten hinweg. Anwendungen, die ein Transkript über Modellversionen hinweg erneut abspielen, werden feststellen, dass die Denkblöcke dort abgelehnt werden, wo sie zuvor akzeptiert wurden.
• computer_20251124 wird nicht akzeptiert auf der Claude API oder Google Cloud. Code, der die frühere Version des Computer-Use-Tools deklariert hat, muss auf das aktuelle Toolset umsteigen.
• Das Advisor-Tool lehnt seine eigene Familie ab.Claude Opus 4.8, Claude Opus 4.7 und Claude Sonnet 5 werden als Advisor abgelehnt, daher muss jede Pipeline, die ein kleineres Claude-Modell als Prüfer gegen ein größeres einsetzte, neu gepaart werden.
Dann gibt es die Änderung, bei der nichts fehlschlägt. Text, den das Modell zwischen Tool-Aufrufen ausgibt, kommt jetzt in thinking-Blöcken an statt als normale Ausgabe. Eine Anwendung, die Text an einen Benutzer streamt, wird zwischen Tool-Aufrufen still – kein Fehler, keine Ausnahme, nur eine UI, die zu hängen scheint, bis Sie einen display-Wert festlegen, der den Text zurückgibt, oder zu between_tools wechseln. Das ist das Fehlerbild, das am ehesten in die Produktion gelangt, weil in einer Testsuite nichts eine Exception auslöst.
Noch eine Sache, der Vollständigkeit halber: das Setzen von temperature, top_p oder top_k auf einen vom Standard abweichenden Wert gibt einen 400 zurück. Wenn Ihr Gateway oder Ihre Client-Bibliothek eine Temperatur aus Gewohnheit statt aus Absicht setzt, ist diese Gewohnheit jetzt ein Ausfall.
Die 30%-Behauptung, gegen die unabhängige Zahl

Anthropics Werbeaussage für Claude Sonnet 5.5 lautet, dass es bei identischen Preisen pro Token „bis zu 30 % weniger pro Aufgabe kostet als sein Vorgänger“ und dass es „Ausgaben um 30 %+ schneller generiert“ als Claude Sonnet 5. Beides sind Aussagen über Token und nicht über Preise, und beide stammen vom Anbieter. Der Mechanismus hinter der ersten ist in der eigenen Benchmark-Tabelle des Anbieters sichtbar: Bei mittlerem Aufwand auf Terminal-Bench sagt Anthropic, Claude Sonnet 5.5 schlage den besten Wert von Claude Sonnet 5 für „weniger als ein Zehntel der Kosten pro Aufgabe“, und macht ähnliche Aussagen für CursorBench bei geringem Aufwand und AA-Briefcase bei mittlerem Aufwand.
Das unabhängige Bild stimmt bei der Richtung überein und geht bei der Größe auseinander. Im Intelligence Index v4.3.2 von Artificial Analysis – zehn Evaluierungen, in einer Konfiguration über alle Modelle hinweg ausgeführt – erreicht Claude Sonnet 5.5 56 Punkte, womit die Seite es auf Rang 3 von 216 einordnet. Claude Sonnet 5 erreicht auf derselben Übersicht 38 Punkte. Das ist ein Sprung von 18 Punkten zwischen zwei aufeinanderfolgenden Modellen in derselben Stufe zum selben Preis, und es ist die größte Lücke, die Anthropic in diesem Jahr innerhalb der Sonnet-Linie aufgetan hat.
Die Kostenangabe ist der Punkt, an dem die Behauptung des Anbieters schwerer aufrechtzuerhalten ist. Artificial Analysis beziffert Claude Sonnet 5.5 auf 7,60 US-Dollar pro abgeschlossener Intelligence Index-Aufgabe. Diese Zahl liegt nicht 30 % unter irgendetwas in seiner Klasse, denn das Modell ist extrem wortreich: Es gab 410 Millionen Ausgabe-Tokens aus, um die Index-Evaluierungen abzuschließen, gegenüber einem Median von 88 Millionen bei vergleichbaren Modellen. Effizienz pro Token und Effizienz pro Aufgabe sind unterschiedliche Größen, und Claude Sonnet 5.5 ist ungewöhnlich gut bei der ersten und lediglich durchschnittlich bei der zweiten.
Alle von Anthropic selbst für diese Veröffentlichung angegebenen Benchmark-Werte sind vom Anbieter gemeldet und von Dritten nicht reproduziert, und zwei davon tragen Fußnoten, die es wert sind, wiederholt zu werden: Die Zahlen für GDPval-AA v2.1 und AA-Briefcase v1.1 wurden von Artificial Analysis auf einem Pre-Release-Deployment ausgeführt, das einen Bug hatte, der die Scores möglicherweise zu niedrig ausfallen ließ, und Anthropics Anmerkung zu seiner FrontierCode-1.1-Zahl erklärt, warum Claude Sonnet 5.5 bei Max effort in dieser Evaluation niedriger abschneidet als bei Xhigh. Eine Tabelle, in der ein Modell sich selbst bei einer niedrigeren Effort-Einstellung übertrifft, ist eine Tabelle, die Ihnen sagt, dass seine Benchmark-Konfiguration nicht gefestigt ist.
Wie kann man es testen, ohne einen Produktionspfad aufs Spiel zu setzen?
Es gibt einen konkreten Grund, Claude Sonnet 5.5 bei einer Migration durch einen Router laufen zu lassen statt direkt gegen den Endpunkt des Anbieters: Man muss sich nicht zwischen dem alten Modell und dem neuen entscheiden, während man es herausfindet. Auf OrcaRouter ist Claude Sonnet 5 seit dem 30. Juni zu Anthropics eigenen $2 / $10 routbar ohne Aufschlag, eines von über 200 Modellen hinter einem einzigen OpenAI-kompatiblen Endpunkt, und es ist nach wie vor das Modell, über das der meiste Claude-API-Traffic läuft. Claude Sonnet 5.5 ist noch nicht in unserem Katalog, daher führt der Weg dorthin heute über Anthropics eigene API.
Das Muster, das in der Zwischenzeit funktioniert, besteht darin, einen Teil des Traffics an das neue Modell zu senden und den Rest vom Failover tragen zu lassen — mit Claude Sonnet 5 als Fallback, sodass ein 400 durch eine der fünf Breaking Changes zu einer langsameren Antwort statt zu einer fehlgeschlagenen Anfrage wird. Das ist auch die günstigste Methode, um das zu messen, was die Herstellerangabe Ihnen nicht verrät: Ihre eigenen Tokens pro Aufgabe bei beiden Modellen mit derselben Effort-Einstellung. Die 30%-Zahl ist ein Durchschnitt aus Anthropics eigenen Evaluationen; Ihr Traffic entspricht nicht diesem Durchschnitt.
Was kommt als Nächstes?
Anthropics Ankündigung besagt, dass Claude Haiku 5.5 „in den kommenden Wochen“ zur Familie stößt, was die 5.5-Generation in der kleinen Modellklasse vervollständigen würde. Bis dahin sind die zwei Entscheidungen, vor denen ein Team steht, das Sonnet in Produktion betreibt, trennbar: Die Migration ist eine eintägige Aufgabe, die man planen kann, und der Modellwechsel ist eine Messung, die man aufschieben kann. Sie in der umgekehrten Reihenfolge durchzuführen – zuerst zu wechseln und den Fehler bei der erzwungenen Tool-Nutzung in Produktion zu entdecken – ist die Variante dieses Rollouts, die ein Wochenende kostet.

