
Claude Sonnet 5.5 in Claude Code: Der Alias wechselte bei einem Anbieter, und der Standard rutschte nach unten
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 934 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 194 tok/s
- OrcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1167 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
Das Third-Party-Briefing, das Claude Sonnet 5.5 diese Woche wieder auf den Radar brachte, sagte, es sei „überall live, einschließlich der Platform und Claude Code“. Die erste Hälfte ist die hauseigene Formulierung des Anbieters vom 28. September, und sie stimmt: Claude Sonnet 5.5 erschien auf der Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry zu 2 bzw. 10 US-Dollar pro Million Tokens – unverändert gegenüber Claude Sonnet 5. Die zweite Hälfte stimmt nur, wenn „Claude Code“ einen einzigen Anbieter meint. Der Claude-Code-Build, der am selben Nachmittag herauskam, v2.1.284, richtet den Alias sonnet auf Claude Sonnet 5.5 auf der Anthropic API aus – und lässt ihn auf Claude Sonnet 4.6 auf Claude Platform on AWS und Claude Sonnet 4.5 auf Amazon Bedrock und Google Cloud zeigen. Wer /model sonnet gegen ein Bedrock-Deployment laufen lässt, bekommt nicht das neue Modell. Es gibt noch eine zweite Sache, die sich verschoben hat, und kaum jemand hat sie aufgeschrieben: Auf der Claude API startet Claude Sonnet 5.5 mit high Effort; in Claude Code startet es mit medium. Beide Fakten sind dokumentiert, beide sind tragend für alle, die diese Woche entscheiden, ob sie wechseln, und beide stehen unter demselben Satz darüber, dass das Modell überall live ist.
Was v2.1.284 tatsächlich geändert hat
Der Changelog-Eintrag zu Claude Code ist nur eine Zeile lang, und die wichtige Hälfte ist eine nähere Bestimmung: „Claude Sonnet 5.5 hinzugefügt (claude-sonnet-5-5), jetzt das Standard-Sonnet-Modell auf der Anthropic API — 1-Mio.-Token-Kontext, 2 $/10 $ pro Mio. Tokens mit 0,20 $/Mio. Tokens für Cache-Lesevorgänge.“ Dieser Build wurde am 28. September um 17:11 UTC auf npm veröffentlicht, also das Release-Datum mit einem Zeitstempel statt einer Versionsnummer. Die Dokumentation zur Modellkonfiguration enthält die Auflösungstabelle, die im Changelog fehlt.
• sonnet Alias — Claude Sonnet 5.5 auf der Anthropic API; Claude Sonnet 4.6 auf Claude Platform on AWS; Claude Sonnet 4.5 auf Amazon Bedrock und der Agent Platform von Google Cloud; Claude Sonnet 4.5 auf Microsoft Foundry.
• opus-Alias — Claude Opus 5.5 auf der Anthropic API, Claude Platform on AWS, Amazon Bedrock und Google Cloud; Claude Opus 4.6 auf Microsoft Foundry.
• Standardmodell — Claude Opus 5.5 für Pro, Max, Team, Enterprise und die Anthropic API, und Claude Sonnet 4.5 auf Microsoft Foundry. Seit v2.1.280 am 22. September ist es Opus 5.5; davor war es Claude Sonnet 5 für Pro und Team Standard.
• sonnet[1m] — keine Wirkung dort, wo sonnet bereits zu Claude Sonnet 5.5 oder Claude Sonnet 5 aufgelöst wird, weil beide über ein natives 1M-Token-Fenster verfügen. Das Suffix ist nicht der Weg, um bei diesem Modell langen Kontext zu bekommen; das Modell hat ihn bereits.
Liest man die erste und die dritte Zeile zusammen, ist die praktische Konsequenz eng, aber deutlich. Bei der Anthropic-API ist das Upgrade von Claude Code die gesamte Migration – sonnet wandert für Sie mit. Auf Bedrock, Google Cloud und Claude Platform on AWS wird das Modell zwar bereitgestellt, der Alias aber nicht mitverschoben, und die Dokumentation ist eindeutig, was den Workaround angeht: Wo ein Alias auf ein älteres Modell verweist, sind neuere Modelle erreichbar, indem man sie vollständig benennt oder ANTHROPIC_DEFAULT_SONNET_MODEL setzt. „Sonnet 5.5 ist in Claude Code live“ ist also ein Satz über einen Standard, und Standards gelten pro Anbieter.
Die Standardintensität ist auf jeder Oberfläche eine andere Stufe.
Dies ist der Teil, der Ihre Rechnung verändert statt Ihren Modell-String, und er verteilt sich auf zwei Seiten, die nicht aufeinander verweisen. Die Effort-Dokumentation der Claude API gibt an, dass Claude Sonnet 5.5 alle fünf Stufen unterstützt und dass high dort die Standardeinstellung ist. Die Modellkonfigurationsseite von Claude Code nennt die Auflösungsreihenfolge für eine Sitzung – eine explizite Auswahl (die Variable CLAUDE_CODE_EFFORT_LEVEL, --effort oder /effort), dann Ihre gespeicherten Einstellungen, dann den Standardwert des Modells selbst – und gibt diesen Modellstandardwert anschließend so an: „high auf jedem Modell, das Effort unterstützt, außer dass Opus 5.5 und Sonnet 5.5 standardmäßig auf medium eingestellt sind und Opus 4.7 standardmäßig auf xhigh eingestellt ist."
Zwei Standardeinstellungen, ein Modell, eine Stufe auseinander. Im unabhängigen Index ist diese eine Stufe etwa sechs Intelligenzpunkte und rund 84 % mehr Geld pro abgeschlossener Aufgabe wert. Anthropics eigene Empfehlung für Claude Sonnet 5.5 – beginnen Sie bei high, es sei denn, die Arbeitslast ist agentisch oder latenzempfindlich, und beginnen Sie bei medium für agentisches Codieren und mehrstufige Tool-Nutzung – ist für die API-Oberfläche geschrieben, wo high das ist, was man erhält, wenn man nichts tut. Claude Code hat diese Entscheidung bereits in die andere Richtung für Sie getroffen.
Ob es die richtige Entscheidung war, hängt tatsächlich von der Arbeitslast ab, und das Argument des Anbieters für mittel ist vertretbar: Die Aufwandsstufen des Modells sind ausdrücklich neu kalibriert gegen Claude Sonnet 5, und der Migrationshinweis besagt, man solle einen Aufwands-Sweep erneut durchführen, statt eine Einstellung zu übernehmen. Aber „neu kalibriert“ ist ein zweischneidiges Schwert, und im nächsten Abschnitt zeigt sich, wo das landet.

Was die Leiter kostet, gemessen
Artificial Analysis hat Claude Sonnet 5.5 auf jeder Sprosse des Intelligence Index v4.3.2 gemessen – eine Suite aus zehn Evaluierungen –, und die Kosten pro Sprosse sind die Zahl, die Ihnen eine Preisliste nicht zeigen kann. Alle folgenden Werte stammen von diesem Evaluator und wurden am 30. September 2026 aus den eigenen Daten der Modellseite entnommen; die Anbieterpreise sind die von Anthropic.
• Niedrig — Index 35,84 bei 0,41 $ pro Aufgabe; erster Chunk in 1,04 Sekunden.
• Medium, der Standard von Claude Code — 40,74 bei 0,59 $; erster Chunk in 1,34 Sekunden.
• Hoch, der Standard der Claude API — 46,74 bei 1,08 $; erster Chunk in 16,6 Sekunden.
• Xhigh — 51,85 bei 2,74 $; erster Chunk in 39,7 Sekunden.
• Max — 55,98 bei 7,60 $; erster Chunk in 378,8 Sekunden.
Setze nun Claude Sonnet 5 seine eigene Leiter daneben, denn das ist das Modell, von dem die meisten Leser migrieren würden. Seine Sprossen lauten 24,26, 28,05, 31,66, 34,38 und 38,16, kosten $0,51, $1,00, $1,79, $2,87 und $5,09 pro Aufgabe. Claude Sonnet 5.5 erzielt bei der Claude-Code-Standardeinstellung medium 40,74 — über Claude Sonnet 5s bestes Ergebnis bei jeglicher Aufwandsstufe — für $0,59 gegenüber $5,09. Das ist 8,7-mal günstiger pro abgeschlossener Aufgabe in derselben Suite, und es ist die unabhängige Version der Behauptung von Anthropic, „weniger als ein Zehntel der Kosten“, die der Anbieter auf Terminal-Bench bei Medium-Aufwand aufstellt. Gleiche Richtung, etwas kleinerer Faktor, und es ist ein gemessenes Ergebnis statt einer Anbietertabelle. Wechsle stattdessen zu low, und die Reihenfolge kippt: 35,84 liegt unter Claude Sonnet 5s Obergrenze, die die ehrliche Untergrenze der Ersparnis ist.
Die Stufe, die bei keinem der beiden Modelle günstig ist, ist die oberste. Bei maximalem Aufwand Claude Sonnet 5.5 kostet $7,60 pro Index-Aufgabe gegenüber Claude Sonnet 5 mit $5,09 — rund 49 % mehr, nicht weniger. Das ist kein Widerspruch zur Zahl des Anbieters. Es ist dieselbe Kurve, am anderen Ende gelesen, und dort landet eine Migration, wenn die Aufwandseinstellung übernommen statt bereinigt wird.
Deine gespeicherte Aufwandseinstellung wird möglicherweise nicht übernommen.
Es gibt eine dritte Einstellung im Spiel, und sie ist diejenige, die am ehesten stillschweigend falsch ist. Claude Code speichert den Effort pro Modell, unter modelSettings in deinen Benutzereinstellungen, sodass jedes Modell seine eigene Stufe beibehält. Die ältere Form — ein einzelner effortLevel-Schlüssel auf oberster Ebene, den /effort geschrieben hat, bevor es das Speichern pro Modell gab — wird bei neueren Modellen anders behandelt. Die Dokumentation sagt, dass dieser Schlüssel „weiterhin dort gilt, wo er zuvor galt: bei Opus 5, Fable 5.1 und früheren Modellen, während Opus 5.5 und danach veröffentlichte Modelle mit ihrem eigenen Standard beginnen, bis du für sie eine Stufe wählst.“
Claude Sonnet 5.5 wurde nach Claude Opus 5.5 veröffentlicht – 28. September gegenüber 22. September –, fällt also in diese zweite Gruppe. Ein Team, das vor einem Jahr global effortLevel: "high" gesetzt hat, um Claude Sonnet 5 scharf zu halten, bekommt beim neuen Modell nicht high. Es bekommt medium, den Standard von Claude Code, und nichts in der Sitzung sagt das. Dieselbe Seite merkt an, dass max nur für die aktuelle Sitzung gilt, sofern es nicht über die Umgebungsvariable gesetzt wird, und dass Projekt-, lokale oder verwaltete effortLevel-Schlüssel oder ein mit --settings übergebener für jedes Modell gelten. Wenn Sie eine Effort-Richtlinie möchten, die ein Modell-Release übersteht, ist das die Form, in der Sie sie schreiben sollten.
Eine benachbarte Änderung sollte erwähnt werden, weil sie dieselbe Versionsnummer trägt: der Ultracode-Schalter im Effort-Slider ist eine Claude-Code-Einstellung und keine Modell-Effort-Stufe, und ihn auf anderen Stufen als xhigh eingeschaltet zu lassen, oder ihn mit /effort ultracode off auszuschalten, erfordert v2.1.284 – denselben Build, der das neue Sonnet mitbrachte. Ultracode ist keine Effort-Stufe und sollte nicht als eine solche verstanden werden, aber wenn du Skripte auf das alte Verhalten abgestimmt hast, ist das die Version, in der es sich geändert hat.
Warten ist das Denkbudget, nicht die Token-Rate
Die oben genannten Latenzwerte sind das operativ nützlichste Element auf der Seite, weil sie die übliche Intuition umkehren. Die Ausgabegeschwindigkeit auf Claude Sonnet 5.5 fällt nicht, wenn der Aufwand steigt; sie steigt mit ihm, von 85 Tokens pro Sekunde bei niedrigem Aufwand bis 137 bei max. Was explodiert, ist die Wartezeit, bevor überhaupt das erste Token existiert – 1,0 Sekunden bei niedrig, 1,3 bei mittel, 16,6 bei hoch, 39,7 bei xhigh, 378,8 bei max. Das Modell ist am oberen Ende der Leiter nicht pro Token langsamer. Es denkt länger nach, bevor es beginnt, und auf der obersten Sprosse sind das mehr als sechs Minuten Stille vor jeder Aufgabe.
Das ordnet neu ein, wofür die Einstellung gedacht ist. mittel ist weniger ein Qualitätskompromiss als vielmehr die einzige Stufe, auf der sich das Modell wie ein Konversationswerkzeug verhält; max ist ein Batch-Vorgang in interaktivem Gewand. Ein Streaming-Client, der die Lücke verbirgt, lässt hoch in einer Demo gut aussehen und sich im Terminal kaputt anfühlen. Die praktische Aufteilung, für die sich die meisten Teams entscheiden werden, ist eine niedrige Stufe für alles, was ein Mensch beobachtet, und eine hohe für Arbeit, die unbeaufsichtigt läuft – was der eigenen Empfehlung des Anbieters nahekommt, zu der man von der Latenz- statt von der Kostenseite aus gelangt ist.
Der Vergleich, der heute tatsächlich routingfähig ist
Wenn der Sinn der Leiter darin besteht, dass mittel der Punkt ist, an dem der Wert liegt, dann ist die interessante Frage, was sonst noch daneben liegt. Claude Opus 5.5 erzielt mit seinem eigenen Claude-Code-Standard von mittel 51,24 bei 1,34 $ pro Aufgabe in derselben Suite. Claude Sonnet 5.5 erzielt mit hoch 46,74 bei 1,08 $. Viereinhalb Indexpunkte trennen sie bei rund einem Viertel mehr pro Aufgabe, und Claude Opus 5.5 liegt ebenfalls messbar vorn auf jeder Stufe über seinem Standard.
Ein Hinweis zur Verfügbarkeit, ausdrücklich gesagt statt nur angedeutet: Claude Sonnet 5.5 ist nicht im OrcaRouter-Katalog enthalten. Es fehlt in der öffentlichen Modellliste, und jede Schreibweise des Slugs liefert einen Not-Found, daher sollte hier nichts als Route dorthin verstanden werden. Routingfähig sind das Modell, von dem Sie migrieren würden, und das Modell darüber. anthropic/claude-sonnet-5 ist seit dem 30. Juni 2026 auf der Plattform, zu Anthropics eigenen 2,00 $ und 10,00 $ pro Million, mit 0,20 $ für Cache-Reads und 0,20 $ für Cache-Write, bereitgestellt über /v1/messages, /v1/chat/completions und /v1/responses. anthropic/claude-opus-5.5 ist dort seit dem 22. September zu 4,00 $ und 20,00 $ verfügbar, über die Anthropic-kompatiblen und Chat-Completions-Endpunkte.
Diese Kombination lässt einen Effort-Sweep kostengünstig laufen. Beide Seiten des Vergleichs – das bisherige Modell in seiner alten Einstellung und das größere Geschwistermodell auf der Stufe, gegen die der Standardwert des neuen Modells abgewogen wird – antworten mit einem einzigen Credential, ohne zweiten Vertrag und ohne Codeänderung über den Model-String hinaus, und der Katalog gibt den Listenpreis des Anbieters weiter, ohne einen Aufschlag hinzuzufügen. Das Einzige, was dabei nicht geht, ist, Ihnen Claude Sonnet 5.5 selbst bereitzustellen, und solange sich das nicht ändert, lautet die ehrliche Version der Empfehlung dieses Artikels, die Stufe über die eigene API von Anthropic zu evaluieren und die Alternativen dort zu evaluieren, wo sie bereits erreichbar sind.


Was diese Woche zu tun ist
Drei Dinge, in der Reihenfolge, in der sie dich Geld kosten, wenn du sie auslässt. Prüfe, gegen welchen Anbieter deine Claude-Code-Sitzung tatsächlich läuft, bevor du annimmst, dass das Upgrade angekommen ist, denn bei Bedrock, Google Cloud und Claude Platform on AWS zeigt der sonnet-Alias weiterhin auf Claude Sonnet 4.5 oder Claude Sonnet 4.6, und das Modell muss vollständig benannt werden. Prüfe, ob dein gespeicherter Effort ein modellspezifischer modelSettings-Eintrag ist oder der ältere Schlüssel auf oberster Ebene, denn nur der erste folgt dir auf ein Modell, das nach Claude Opus 5.5 veröffentlicht wurde. Und wenn du den vom Anbieter geforderten Sweep erneut ausführst, sweepe sowohl nach oben als auch nach unten: beim Claude-Code-Standard Claude Sonnet 5.5 schlägt Claude Sonnet 5s bestes Ergebnis für weniger als ein Neuntel der Kosten, was bedeutet, dass die interessante Frage nicht mehr lautet, ob man nach unten wechseln sollte, sondern wie weit nach oben du es dir leisten kannst.
Die offene Frage ist Claude Haiku 5.5, das laut Anthropic in den kommenden Wochen zur Familie stoßen und unterhalb dieses Modells angesiedelt sein soll. Sollte das Muster von Claude Opus 5.5 Bestand haben, wird es zuerst über die Anthropic-API verfügbar sein und sich dann mit einer Verzögerung, die eher in Claude-Code-Releases als in Tagen gemessen wird, zu den anderen Anbietern ausbreiten. Diese Verzögerung ist der Punkt, den man im Auge behalten sollte, denn alles oben zu Aliasen und Standardwerten ist letztlich eine Folge davon.
In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
