
Claude Sonnet 5.5: Der Mittelklasse-Standard, vollständig spezifiziert
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Claude Sonnet 5.5 ist das Mittelklasse-Modell der Claude-Reihe, veröffentlicht am 28. September 2026, und der Preis ist der eigentliche Grund, warum es eine eigene Seite verdient: 2 $ pro Million Input-Tokens und 10 $ pro Million Output-Tokens, gegenüber 4 $ und 20 $ für Claude Opus 5.5, das Flaggschiff, das sechs Tage früher erschien. Das ist der halbe Output-Preis für 1,62 Punkte des Artificial Analysis Intelligence Index – 56,00 für das Mittelklasse-Modell gegenüber 57,62 für das Flaggschiff, beide Werte von Artificial Analysis gemessen auf Index-Revision v4.3.2 und nicht von uns und nicht vom Anbieter. Über beiden steht Claude Fable 5.1, mit 10 $ / 50 $ und 53,35 auf derselben Revision: teurer als das Flaggschiff und dahinter zurück. Zum selben Listenpreis von 2 $ / 10 $ wie Claude Sonnet 5.5 steht OpenAIs GPT-6.1 Sol, bei 51,83 – 417 Index-Hundertstel auf der anderen Seite der Linie, und genau dieser Vergleich ist es, den ein Leser, der das Mittelklasse-Modell abwägt, tatsächlich anstellen muss.
Diese Seite ist eine Referenz, und die Datumsangaben sagen eher, warum, als dass sie etwas über die Aktualität aussagen. Claude Sonnet 5.5 ist am 2026-10-08 zehn Tage alt, womit es außerhalb des Sieben-Tage-Fensters liegt, in dem dieser Blog Neuigkeiten meldet. Was in diesem Fenster liegt, ist ein sechs Tage altes Ereignis: zwei Beiträge auf X vom 2026-10-02, die behaupten, dass ein Nachfolgemodell dieser Familie einen Rivalen schlägt, den sein eigener Anbieter fertiggestellt und zurückgehalten hat. Diese Behauptung hat in keinem von hier aus erreichbaren Register eine Modell-ID, eine Preisliste, ein Kontextfenster oder einen Benchmark hinter sich, und sie ist nicht das Thema dieser Seite — die Quellenkette, die Prüfung auf Abwesenheit an der Anbieteroberfläche und die Streuung über fünf Modelle im Index werden vollständig von dem Artikel abgedeckt, den dieser Blog bereits unter dem Titel „Claude Fable 5.5 besiegte GPT-6.1 Astra, bevor es existiert – und das ist der interessante Teil“ veröffentlicht hat, der auf den 2026-10-03 datiert ist. Was diese Behauptung jedoch hervorgerufen hat, ist eine Warteschlange von Leserinnen und Lesern, die fragen, auf welches ausgelieferte Claude-Modell sie sich als Standard festlegen sollen, während sie warten, und diese Frage braucht eine Seite über das Modell, das existiert. Das ist sie.
Was wurde am 28. September 2026 veröffentlicht?
Die Dokumentation des Anbieters selbst gibt die Spezifikation direkt an, und sie ist eine Fortsetzung der Stufe und keine neue Form. Alles Folgende wurde am 2026-10-08 aus Anthropics Claude Platform-Dokumentation entnommen, es handelt sich also um Anthropics Spezifikation und nicht um einen unabhängigen Test davon.
• Veröffentlicht — 28. September 2026. Die eigene Dokumentationsseite des Modells beginnt mit der Zeile „Neuestes. Veröffentlicht am 28. September 2026.“
• Positionierung — „Die beste Kombination aus Geschwindigkeit und Intelligenz“, wobei die vergleichende Latenz als Schnell gegenüber Mäßig für Claude Opus 5.5, Langsamer für Claude Fable 5.1 und Am schnellsten für die kleine Stufe angegeben wird.
• Modell-ID — claude-sonnet-5-5 in der Claude API, in Google Cloud, Microsoft Foundry und Claude Platform on AWS; anthropic.claude-sonnet-5-5 auf Amazon Bedrock. Jede Claude-Modell-ID ist ein festgeschriebener Snapshot, daher ist die Zeichenfolge kein Zeiger, der unter Ihnen wegdriftet.
• Kontext und Ausgabe — 1.000.000 Tokens Kontext und 128.000 Tokens synchrone Ausgabe bei der Messages API, ansteigend auf 300.000 hinter dem output-300k-2026-03-24 Beta-Header bei der Message Batches API.
• Denken — adaptiv, standardmäßig immer aktiviert, mit einem Standardaufwand von high. Die niedrigste Einstellung ist between_tools, wodurch das vorgeschaltete Denken deaktiviert wird und die bei einem Aufwand von high oder darunter akzeptiert wird. Wenn temperature, top_p oder top_k auf etwas anderes als ihren Standardwert gesetzt werden, wird ein 400-Fehler zurückgegeben, sodass eine von einem älteren Claude-Modell migrierte Anfrage mit einer angepassten Temperatur lautstark statt still fehlschlägt.
• Wissensstichtag — Juni 2026, sowohl für den verlässlichen Stichtag als auch für den Stichtag der Trainingsdaten.
• Lebenszyklus — Aktiv (neueste), mit einer Stilllegungszusage nicht vor dem 28. September 2027 auf den von Anthropic betriebenen Plattformen. Amazon Bedrock und Google Cloud legen ihre eigenen Termine fest.
Das Framing des Anbieters zur Markteinführung ist zitierenswert, denn es ist eine Behauptung und keine Messung: In Anthropics Ankündigung wird Claude Sonnet 5.5 als „ein klares Upgrade gegenüber Sonnet 5, das 30 % schneller läuft und für die meisten Arbeiten bis zu 30 % weniger kostet“ beschrieben. Dieser Satz stammt vom Anbieter und wurde von uns nicht reproduziert, und es ist die Art von Behauptung, die vollständig davon abhängt, welche Arbeit man ihr vorlegt. An das Release ist außerdem ein Migrationsaufwand geknüpft, für den diese Seite nicht der richtige Ort ist: Fünf Breaking Changes betreffen Code, der bereits auf Claude Sonnet 5 läuft, und eine sechste Änderung verändert die Form der Antwort, ohne dass eine Anfrage fehlschlägt. Diese Bilanz gehört zum Rollout-Beitrag, den dieser Blog in der Release-Woche veröffentlicht hat, und sie ist das Erste, was Sie lesen sollten, wenn Sie Sonnet 5 heute in Produktion betreiben.

Die 1,62 Punkte und der halbe Preis
Unabhängige Bewertungen für dieses Modell stammen von einer einzigen Stelle, und sie tragen eine Zahl, die die Entscheidung bestimmt. Artificial Analysis misst Claude Sonnet 5.5 mit 56.00 auf seinem Intelligence Index, Revision v4.3.2, in der Konfiguration, die auf der Seite als „Claude Sonnet 5.5 (Max, Default Fallback)“ bezeichnet wird. Wir haben diese Seite am 2026-10-08 gelesen. In derselben Revision, am selben Tag:
• Claude Opus 5.5 — 57,62, veröffentlicht am 22.09.2026, 4 $ / 20 $
• Claude Sonnet 5.5 — 56.00, veröffentlicht am 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53.35, veröffentlicht am 2026-09-01, 10 $ / 50 $
• GPT-6 Astra — 52,67, veröffentlicht am 03.09.2026, 10 $ / 50 $, mit einer Langkontext-Stufe oberhalb von 272.000 Prompt-Tokens zu 20 $ / 75 $
• GPT-6.1 Sol — 51,83, veröffentlicht am 29.09.2026, $2 / $10
Die Angabe, um welche Revision es sich handelt, ist entscheidend, denn eine Punktzahl aus einer Version des Index ist nicht mit einer Punktzahl aus einer anderen vergleichbar: v4.3.2 umfasst zehn Evaluierungen — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience und AA-LCR v1.1 — und die Zusammensetzung dieser Menge hat sich über die Revisionen hinweg geändert. Alle fünf oben genannten Werte stammen aus derselben Revision, weshalb sie miteinander verglichen werden können und weshalb keiner von ihnen mit einer Zahl verglichen werden kann, die aus einer früheren Version zitiert wird.
Der Preisvergleich ist der Teil, der das Verhalten entscheidet. Der Ausgabepreis von Claude Sonnet 5.5 liegt bei der Hälfte von dem von Claude Opus 5.5, und der Eingabepreis liegt ebenfalls bei der Hälfte; auf der eigenen Liste des Anbieters kostet das Mittelklasse-Modell 2 $ / 10 $, während das Flaggschiff 4 $ / 20 $ kostet. Setzt man die beiden veröffentlichten Zahlen zueinander in Beziehung, ist das Verhältnis krass: Pro Dollar Listenpreis für die Ausgabe trägt Claude Sonnet 5.5 5,60 Indexpunkte und Claude Opus 5.5 trägt 2,88 — fast doppelt so viel Index pro Dollar Ausgabe, und zwar nach Anthropics eigener Preisliste und der eigenen Messung von Artificial Analysis. Das ist Arithmetik mit zwei veröffentlichten Zahlen und keine Messung von irgendetwas, und es ist die ehrliche Form der Argumentation für das Mittelklasse-Modell. Es ist zugleich kein Urteil: Ein Indexpunkt ist keine Einheit für Korrektheit, und worum es im Rest dieser Seite geht, ist, woraus die 1,62 besteht und woraus nicht.

Die Preisliste und die beiden Zeilen, die sich am stärksten verändern
Anthropics vollständige Preisliste, abgerufen am 08.10.2026. Alle Zahlen in diesem Abschnitt stammen vom Anbieter.
• Eingabe — 2,00 $ pro Million Tokens. Ausgabe — 10,00 $ pro Million, und Thinking-Tokens werden als Ausgabe abgerechnet, was hier nicht unterdrückbar ist, da adaptives Denken standardmäßig aktiviert ist.
• Cache-Lesen — 0,10 $ pro Million, was Anthropic mit 5 Prozent des Basis-Input-Preises angibt. Das ist derselbe prozentuale Rabatt, den Claude Opus 5.5 bietet, sodass Caching die Rangfolge zwischen den beiden nicht verändert, und es bedeutet tatsächlich, dass ein langer Agent-Lauf, der ein stabiles Präfix beibehält, für alles, was er erneut liest, nur ein Zehntel des Input-Tarifs zahlt.
• Cache-Schreibvorgang — 2,50 $ pro Million für den Fünf-Minuten-Cache, 4,00 $ für den Ein-Stunden-Cache. Die minimale cachefähige Prompt-Länge beträgt 512 Token, daher können kurze Prompts den Rabatt überhaupt nicht nutzen.
• Batch API — 50 Prozent Rabatt in beide Richtungen, also 1,00 $ für den Input und 5,00 $ für den Output bei Arbeit, die warten kann.
• Kein Aufschlag für langen Kontext — Anthropic berechnet das volle 1-Mio.-Token-Fenster bei diesem Modell zum Standard-Tokenpreis, sodass eine Anfrage mit 900.000 Token pro Token genauso viel kostet wie eine mit 9.000 Token. Das ist ein echter Unterschied zu GPT-6 Astra, dessen Long-Context-Stufe oberhalb von 272.000 Prompt-Token auf 20 $ / 75 $ steigt – erwähnenswert, weil dies der eine Punkt ist, an dem die Schlagzeilen-Zahlen der beiden Anbieter deutlich auseinandergehen, sobald ein Prompt lang wird.
Zwei Positionen entscheiden dann über die meisten Rechnungen, nicht der Schlagzeilenpreis: der Cache-Lese-Rabatt über einen langen Agentenlauf und der Batch-Rabatt für alles Asynchrone. Die plakativen 2 $ / 10 $ werden in Bestenlisten verglichen; die Cache- und Batch-Positionen sind das, woraus sich eine Monatsrechnung tatsächlich zusammensetzt.
Was die Lücke bedeutet und was nicht
The Intelligence Index ist eine einzige Zahl über einen festen Aufgabenmix, und genau diese eine Eigenschaft erklärt den größten Teil der Verwirrung um ihn. Die zehn Bewertungen hinter v4.3.2 umfassen agentisches Coding und Terminal-Arbeit, wissenschaftliches Reasoning auf Graduiertenniveau, ein Software-Engineering-Set, ein Agentic-Automation-Set und ein Long-Context-Retrieval-Set, die zu einem Composite gewichtet werden. Ein Modell, das 1,62 Punkte hinter einem anderen liegt, liegt bei diesem Composite zurück – nicht bei Ihrer Workload, die diese zehn möglicherweise in einem völlig anderen Verhältnis gewichtet und Aufgaben enthalten kann, die keines von ihnen repräsentiert.
Was das in der Praxis bedeutet, ist eine Aufteilung nach der Art der Arbeit statt nach dem Prestige der Stufe. Anthropics eigene Modellauswahl macht die Aufteilung explizit, und es lohnt sich, sie zu lesen, denn sie schmeichelt der mittleren Stufe nicht: In der Dokumentation wird den Lesern gesagt, sie sollten „für die meisten Workloads mit Claude Opus 5.5 beginnen“ und „für anspruchsvolles Reasoning und agentische Arbeit mit langem Horizont zu Claude Fable 5.1 greifen, oder wenn Ihre Evals auf Claude Opus 5.5 bei höherem Aufwand noch immer nicht ausreichen“. Claude Sonnet 5.5 ist nicht das Modell, mit dem dieser Satz beginnt. Es ist das Modell, das dieselbe Dokumentation als die beste Kombination aus Geschwindigkeit und Intelligenz beschreibt, mit der im Vergleich schnellsten Latenz außerhalb der kleinen Stufe – was ein anderes Argument ist, und ein engeres.
Die ehrliche Lesart ist also diese. Die Mittelklasse ist normalerweise die richtige Antwort für gut abgegrenzte Arbeit in großem Umfang: Features und Bugfixes gegen eine bekannte Codebasis, Extraktion und Klassifizierung mit einer definierten Ausgabeform, Tool-Calling-Schleifen, bei denen der schwierige Teil das Harness und nicht das Reasoning ist, und alles, bei dem ein schnelles erstes Token und niedrige Kosten pro Aufruf mehr zählen als die letzten zwei Prozent der Leistungsfähigkeit. Das Flaggschiff verdient seinen Preis, wenn die Arbeit wirklich langfristig ist – mehrstündige Agent-Läufe, Refactorings, die sich über Dateien erstrecken, die der Prompt nicht auf einmal fassen kann, und Evaluierungen auf der Mittelklasse, die bei höherem Effort messbar zurückbleiben. Die letzte Bedingung ist die des Anbieters selbst, und sie ist überprüfbar: Erhöhe den Effort-Level auf der Mittelklasse, führe dein eigenes Eval aus und sieh nach, ob sie die Lücke schließt. Wenn ja, war die 1.62 für dich nicht tragend. Wenn nicht, hast du deine Antwort mit deinen eigenen Zahlen erkauft statt mit dem Composite von jemand anderem.
Was die Lücke nicht bedeutet, ist, dass 1,62 Punkte nichts sind. Es ist der gesamte Abstand zwischen zwei Modellen, und auf einem festen Harness, der unter identischen Bedingungen ausgewertet wird, ist es eine echte Rangfolge. Es ist einfach eine Rangfolge eines bestimmten Aufgabenmixes, bei maximalem Aufwand mit Standard-Fallback, und es sagt nichts darüber aus, welches der beiden der bessere Kauf für eine Workload ist, für die keines von beiden gebenchmarkt wurde.
Die Namensfalle: Welche Claude Sonnet 5.5-Seite das ist
Wer den Namen dieses Modells sucht, stößt auf diesem Blog auf mehrere Seiten, die wie diese hier aussehen – und es nicht sind. Die auf den 2026-09-24 datierte ist die Vorabseite: Sie entstand, bevor das Modell veröffentlicht wurde, und ihr Gegenstand war ein einzelner X-Post, der einen Stealth-Test behauptete, rekonstruiert anhand der Zahlen des Modells, das es ersetzen sollte. Die in der Veröffentlichungswoche erschienene ist der Rollout-Bericht: Ihr Gegenstand sind die fünf Breaking Changes, die bereits laufenden Code auf Claude Sonnet 5 betreffen, plus die sechste Änderung, die die Form der Antwort verändert, ohne einen Fehler auszulösen. Außerdem gibt es eine ganze Reihe von Vergleichsseiten, die den Namen dieses Modells gegen die Modelle anderer Anbieter stellen, und eine angewandte Seite dazu, was die Werbeaktion des Releases abdeckt.
Keine von ihnen ist die Modellseite, und genau diese Lücke füllt dieser Beitrag. Diese Seite ist die Referenz, zu der ein Leser gelangt, nachdem er den Namen des Modells selbst gesucht hat: was es ist, was es kostet, was es misst und welche Arbeit zu ihm gehört. Die Migrationsdetails der Rollout-Seite und die Quellenkritik der Anticipation-Seite bleiben, wo sie sind; wenn Sie Sonnet 5-Code in Produktion haben, ist die Rollout-Seite Ihr erster Klick, und diese Seite sagt Ihnen, ob das Modell, auf das Sie migrieren, das ist, das Sie wollen.
Eine Namensgewohnheit sollte man gleich an dieser Stelle korrigieren, denn sie führt für sich genommen in die Irre. Ein 5.5-Suffix markiert eine Generation, nicht einen Rang. Claude Sonnet 5.5 und Claude Opus 5.5 gehören zur selben Generation derselben Familie, und die Zahl vor dem Punkt ist die Stufe. Nichts am Suffix verrät, welcher von beiden einen Benchmark gewinnt.
Verfügbarkeit, datiert
Claude Sonnet 5.5 ist seit seiner Veröffentlichung bei OrcaRouter verfügbar, als anthropic/claude-sonnet-5.5, zu Anthropics eigenem Listenpreis ohne zusätzlichen Aufschlag: 2,00 $ Eingabe und 10,00 $ Ausgabe pro Million Tokens, wobei die beiden Werte am 2026-10-08 von unserem eigenen Modell-Endpunkt ausgelesen wurden und mit der Preisliste des Anbieters Zeile für Zeile übereinstimmen. Unsere Seite dafür enthält dasselbe Kontextfenster von 1 Mio. Tokens und dieselbe maximale Ausgabe von 128K, listet Text, Bild und Datei als akzeptierte Eingabetypen und Text als einzige Ausgabe, kennzeichnet es als am 2026-09-28 veröffentlicht und nicht als veraltet und zeigt, dass es sowohl über den OpenAI-kompatiblen Chat-Completions-Endpunkt als auch über Anthropics eigenen Messages-Endpunkt erreichbar ist — was es zu einer Drop-in-Änderung für eine Integration macht, die bereits einen der beiden Endpunkte anspricht.
Alles andere im selben Katalog wird über denselben Schlüssel erreicht: eine API für 200+ Modelle, mit durchgereichtem Anbieter-Listenpreis bei 0 % Aufschlag, sodass eine Preissenkung eines Anbieters den Kunden am Tag ihrer Ankündigung erreicht, automatischem Failover, wenn ein Endpunkt an Qualität verliert, und einer Routing-DSL für die Fälle, in denen Sie ein Modell festlegen oder mehrere zu einer Antwort kombinieren möchten. Diese Kombination ist es, die die Frage auf dieser Seite günstig statt teuer zu beantworten macht. Beide Modelle im obigen Vergleich laufen hinter denselben Credentials, sodass der Preis, mit dem Sie vergleichen, der eigene veröffentlichte Preis des Anbieters und nicht der eines Wiederverkäufers ist, und der Versionstest kostet einen Eval-Lauf statt eines Migrationsprojekts: Richten Sie einen Teil des Traffics auf anthropic/claude-sonnet-5.5, lassen Sie den Rest auf dem Flaggschiff und lassen Sie Ihre eigenen Zahlen zu Kosten pro abgeschlossener Aufgabe entscheiden, welches der Standard sein sollte.

Die Kurzfassung
Claude Sonnet 5.5 ist ein Mittelklasse-Modell mit flaggschiffnahen Werten und halb so hohem Ausgabepreis wie das Flaggschiff, und die drei Fakten, die entscheiden, ob es Ihr Standardmodell ist, sind diese. Es liegt 1,62 Punkte hinter Claude Opus 5.5 auf dem v4.3.2-Index von Artificial Analysis, mit 56,00 gegenüber 57,62, wobei beide Werte auf derselben Revision und in derselben Konfiguration mit maximalem Aufwand und Standard-Fallback gemessen wurden. Es kostet 2 $ / 10 $ gegenüber 4 $ / 20 $ des Flaggschiffs, wobei die Cache- und Batch-Rabatte proportional statt unterschiedlich ausfallen, sodass die Preisdifferenz jeden Rabatt übersteht, den eines der beiden Modelle bietet. Und standardmäßig ist es auf hohen Aufwand eingestellt, während das Flaggschiff standardmäßig auf mittleren Aufwand eingestellt ist, was bedeutet, dass eine vom Flaggschiff übernommene Einstellung hier eine Stufe höher statt niedriger ausfällt, und die Kosten dafür müssen Sie messen, statt sie anzunehmen.
Anthropics eigene Auswahl beginnt für die meisten Workloads weiterhin bei Claude Opus 5.5, und das ist gut zu wissen, bevor man sich auf irgendetwas standardisiert. Doch für die meisten Leser, die über die Suche nach dem Namen dieses Modells auf diese Seite gelangen, ist die Mittelklasse die vernünftige Standardwahl und das Flaggschiff die Ausnahme, die man kauft, wenn die eigenen Evals sie erfordern – gut abgegrenzte Arbeit in großem Umfang, schnelle Latenz, ein Million-Token-Fenster ohne Langkontext-Aufschlag und ein Tarif, der die Output-Zeile halbiert. Beide sind auf OrcaRouter nur einen Schlüssel entfernt, und das Eval, das zwischen ihnen entscheidet, kostet einen Nachmittag statt einer Migration.
In diesem Artikel verglichen4
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
