
Claude Opus 5.5 vs. Claude Sonnet 5: Halber Preis, zwanzig Indexpunkte und ein fünfmonatiger blinder Fleck
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 177 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1323 tok/s
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
Wenn Sie nur die Regel wollen: Führen Sie standardmäßig Claude Sonnet 5 aus und wechseln Sie zu Claude Opus 5.5, wenn eine Aufgabe fehlschlägt, denn das günstigere Modell kostet tatsächlich die Hälfte und ist tatsächlich eine andere Leistungsklasse. Die beiden Zahlen dahinter sind 38 und 58 – die Werte von Sonnet 5 und Opus 5.5 im Artificial Analysis Intelligence Index, beim selben Evaluator, in derselben Konfigurationsfamilie. Ein Abstand von zwanzig Punkten in diesem Index ist kein Tiebreak, und es ist die größte Trennung in jedem Claude-gegen-Claude-Vergleich, den Sie derzeit bilden können: Claude Opus 5.5 ist auf Platz 1 von 210 Modellen und Claude Sonnet 5 ist auf Platz 54, und der Preisunterschied zwischen ihnen beträgt 2 $ pro Million Eingabe-Tokens.
Das ist die leichte Hälfte. Die schwierige Hälfte ist, dass selektives Eskalieren Wissen darüber erfordert, welche Aufgaben fehlschlagen, und die beiden Modelle sind sich über die Welt nach Januar 2026 uneinig, auf eine Weise, die keine Evaluation als Fehler sichtbar machen wird.
Die Zwanzig-Punkte-Lücke im Kontext

Artificial Analysis führt jedes Modell in einer veröffentlichten Konfiguration aus, und diese beiden teilen ein Familien-Label – „Adaptive Reasoning, Max Effort“ –, was den Vergleich ungewöhnlich sauber macht:
• Intelligenz-Index — Claude Opus 5.5 58, auf Platz 1 von 210 vs. Claude Sonnet 5 38, auf Platz 54
• Preis — Claude Opus 5.5 4,00 $ Eingabe / 20,00 $ Ausgabe pro Million vs. Claude Sonnet 5 2,00 $ / 10,00 $
• Ausgabegeschwindigkeit — Claude Sonnet 5 79,3 Tokens/Sek. vs. Claude Opus 5.5 noch nicht in der Rangliste veröffentlicht
• Zeit bis zum ersten Token — Claude Sonnet 5 150,02 s vs. einem Board-Median von 3,83 s
• Standard-Aufwand — Claude Opus 5.5 mittel vs Claude Sonnet 5 hoch
• Wissensstichtag — Juni 2026 für Claude Opus 5.5 vs. Januar 2026 für Claude Sonnet 5
• Kontext und Ausgabe — 1M Kontext und 128K maximale Ausgabe bei beiden
Die Rangspalte ist der Teil, bei dem es sich lohnt, innezuhalten. Zwanzig Indexpunkte sind nicht vier Plätze auf einer Bestenliste; es sind neunundvierzig. Auf einer Liste von 210 Modellen sind Opus 5.5 und Sonnet 5 keine Nachbarn mit einem Preisunterschied — sie sind in unterschiedlichen Bändern, und die Lücke von 2 $ pro Million kauft einen echten Fähigkeitssprung statt eines Abzeichens. Wer die Berichterstattung dieser Woche als „Anthropic hat ein günstigeres Opus herausgebracht“ gelesen und angenommen hat, dass die Sonnet-Stufe es absorbiert hat, sollte sich dieses Rangpaar ansehen: Anthropics eigene Preisseite listet Claude Sonnet 5 immer noch als aktuelles Produkt, und seine Position auf der unabhängigen Liste hat sich nicht verändert.
Zwei Vorbehalte sorgen dafür, dass dies ehrlich bleibt. Beide Ergebnisse wurden mit maximalem Aufwand erzielt, und bei keinem der Modelle ist die Standardeinstellung maximal — Sonnet 5 verwendet standardmäßig hoch, Opus 5.5 verwendet standardmäßig mittel. Und die Geschwindigkeitszeilen machen die Geschichte zugunsten von Sonnet 5 komplizierter: 79,3 Token pro Sekunde bei einer Latenz von 150 Sekunden bis zum ersten Token stellen ein reales, gemessenes Latenzprofil dar, und es ist das einzige der beiden, das auf der Rangliste vorhanden ist. Die Geschwindigkeit und Latenz von Opus 5.5 wurden von Artificial Analysis nicht veröffentlicht, was bedeutet, dass die „schnellere“ Behauptung in diesem Duell derzeit auf Material der Anbieter statt auf einer Messung beruht.
Die Fußnote, die den Preis von Sonnet 5 ändert
Das Konkreteste, was der vergangene Monat für Claude Sonnet 5 hervorgebracht hat, ist ein Satz, den die meisten Berichte ausgelassen haben. Als das Modell am 30. Juni 2026 startete, wurde sein Tarif von 2 $ / 10 $ als Einführungspreis bis zum 31. August angekündigt, mit einer geplanten Erhöhung auf 3 $ / 15 $ am 1. September. Auf Anthropics aktueller Preisseite heißt es in der Fußnote, dass der 2-$/10-$-Tarif „jetzt der Standardpreis ist“ und dass die Erhöhung „nicht stattfinden wird“.
Das ist aus zwei Gründen wichtig. Der offensichtliche ist, dass eine 50-prozentige Erhöhung, die angekündigt und dann zurückgenommen wurde, eine Kostenposition ist, mit der Sie jetzt planen können — Sonnet 5 ist kein Aktionspreis, für den Sie ein Ablaufdatum modellieren müssen. Der weniger offensichtliche ist, dass dies die Eskalationsarithmetik in Ordnung bringt. Da Sonnet 5 dauerhaft bei $2/$10 liegt und Opus 5.5 bei $4/$20, beträgt das Verhältnis zwischen den beiden Stufen in beide Richtungen genau 2x, und es ist stabil. Eine Eskalationsregel, die beispielsweise ein Fünftel Ihres Traffics an Opus 5.5 weiterleitet, hat Kosten, die Sie einmal berechnen können und dann nicht mehr neu berechnen müssen.
Die Batch- und Cache-Preise bewegen sich gemeinsam, was den Vergleich über die gesamte Tabelle hinweg nützlich macht: Sonnet 5 kommt im Batch-Tarif auf 1,00 $ / 5,00 $ gegenüber 2,00 $ / 10,00 $ bei Opus 5.5, und beide berechnen Cache-Lesevorgänge mit 0,20 $ pro Million. Diese letzte Zahl ist ein echter Gleichstand – Opus 5.5 hat seinen Cache-Lesepreis von 0,50 $ auf 0,20 $ gesenkt, und Sonnet 5 lag bereits bei diesem Wert. Wenn Ihre Arbeitslast überwiegend darin besteht, einen großen zwischengespeicherten Kontext erneut zu lesen, statt neue Ausgaben zu generieren, ist der Preisvorteil des günstigeren Modells viel kleiner, als es die auf den ersten Blick genannte Verhältniszahl nahelegt, denn die eine Zeile, in der sie übereinstimmen, ist die Zeile, für die Sie am meisten ausgeben.
Der Cutoff ist der Teil, der still versagt.

Claude Opus 5.5 hat einen Wissensstichtag von Juni 2026. Der von Claude Sonnet 5 ist Januar 2026. Das sind fünf Monate Unterschied, und es ist die eine Dimension in diesem Vergleich, die sich nicht selbst bemerkbar macht. Ein Modell, das nichts über ein Ereignis weiß, ist dabei nicht auf eine Weise langsamer oder ungenauer, die Ihre Fehlerbehandlung abfängt – es antwortet selbstsicher aus einer Welt, die sich weiterentwickelt hat, und der Fehler sieht eher wie eine plausible falsche Antwort aus als wie eine Verweigerung.
Für manche Workloads ist das irrelevant: das Refactoring einer Codebasis, deren Konventionen stabil sind, das Zusammenfassen von Dokumenten, die Sie bereitstellen, das Transformieren strukturierter Daten. Für andere ist es allein schon ein Ausschlusskriterium, unabhängig von den zwanzig Indexpunkten oder dem Preis. Alles, was Software betrifft, die in der zweiten Hälfte von 2026 veröffentlicht wurde, alles, was Fragen zu aktuellen Ereignissen beantwortet, alles, was von einer API oder einer Bibliotheksversion abhängt, die sich nach Januar geändert hat – diese Aufgaben können nicht an Opus 5.5 eskaliert werden, sie müssen dort beginnen. Die fünf Monate sind kein Qualitätsunterschied; sie sind eine Umfangsbeschränkung, und sie gehört in die Routing-Regel und nicht in die Bewertung.
Beide Modelle teilen sich den Rest des Rahmens, was begrenzt, wie weit man den Cutoff umgehen kann. Beide nehmen 1 Mio. Token Kontext auf und geben bis zu 128K zurück, beide nutzen adaptives Denken, das sich nicht abschalten lässt, und beide machen Tiefe nur über den Effort-Parameter zugänglich. Es gibt keine Konfiguration, in der Sonnet 5 ein längeres Dokument erhält, um das auszugleichen.
Den Split ausführen
Die praktische Version dieser Gegenüberstellung ist ein Standard und eine Ausnahme, und die Ausnahme muss durch etwas anderes als „schwierige Aufgaben“ definiert werden. Das Muster, das Bestand hat, richtet sich nach der Aufgabenklasse statt nach der Schwierigkeit: Sonnet 5 für die Arbeit mit hohem Volumen, bei der sein Cutoff keine Rolle spielt und sein Latenzprofil akzeptabel ist, Opus 5.5 für alles Aktuelle, alles mit langem Zeithorizont oder alles, bei dem ein fehlgeschlagener Versuch mehr kostet als der Token-Unterschied.
Das ist eher eine Routing-Konfiguration als ein Rewrite, und hier verdient sich ein einzelner Endpunkt seinen Platz. Claude Sonnet 5 ist auf OrcaRouter zu Anthropics eigenen $2.00 / $10.00, und Claude Opus 5.5 ist dort für $4.00 / $20.00 — Listenpreis des Anbieters ohne Aufschlag weitergegeben, sodass das Kostenverhältnis in Ihrer Eskalationsregel dem von Anthropic veröffentlichten Kostenverhältnis entspricht, ohne dass eine Aufschlagsebene es verschiebt. Beide stehen hinter einem Schlüssel, was bedeutet, dass der Eskalationspfad eine Regeländerung statt einer zweiten Integration ist, automatisches Failover verhindert, dass ein ausfallendes Primärsystem die Anfrage mit sich reißt, und der Vergleich, der Ihre Schwellenwerte bestimmt, lässt sich in Ihrem eigenen Traffic durchführen, statt ihn aus zwei Anbietertabellen zu rekonstruieren.

Wer sollte umziehen, und wer sollte warten
Wenn Sie bereits Claude Sonnet 5 nutzen und es funktioniert, ist die Argumentation für einen Ersatz schwach: Das Modell kostet die Hälfte, sein Tarif gilt jetzt dauerhaft, und die Indexlücke spielt nur bei den Aufgaben eine Rolle, bei denen es versagt. Die Argumentation für die Ergänzung von Claude Opus 5.5 darüber ist stark, sofern Sie den Auslöser benennen können – und der Auslöser ist meist entweder ein Cutoff-Fehler oder eine Aufgabe, bei der selbst die Max-Effort-Läufe von Sonnet 5 noch falsch liegen.
Wenn Sie Ihr erstes Claude-Modell auswählen, ist die Antwort weniger ausgewogen, als es das Preisverhältnis erscheinen lässt. Ein Abstand von zwanzig Punkten in einem Index und fünf zusätzliche Monate Wissen für die doppelte Tokenmenge sind ein Tausch, den die meisten Produktions-Workloads bei einem kleinen Teil der Aufrufe eingehen werden – und den fast keine bei allen eingehen werden. Der Fehler, den es in beide Richtungen zu vermeiden gilt, besteht darin, die beiden als austauschbar zu behandeln und allein aufgrund der Kosten zu wechseln, denn der daraus folgende Fehlschlag ist keine schlechtere Antwort – er ist eine selbstsichere Antwort über eine Welt, die im Januar endete.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
