Generierte Hero-Karte mit dem Titel Claude Sonnet 5.5 vs Grok 4.5, Untertitel zwei Input-Preise von je 2 $ und eine Wartezeit von sechs Minuten, mit drei Statistik-Karten: erstes Token 370,8 s vs. 6,9 s, Kosten pro Aufgabe 7,60 $ vs. 1,04 $ und Intelligence Index 56 vs. 39, dazu eine Fußzeile mit dem Text Index, Kosten pro Aufgabe und Latenz laut Artificial Analysis v4.3.2; Preise laut Anbietern.
Guides & Insights

Claude Sonnet 5.5 vs. Grok 4.5: Zwei Eingabepreise von je 2 $ und eine sechsminütige Wartezeit

Autor

Elias Hawthorne

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Sonnet 5.5 und Grok 4.5 verlangen für Input denselben Preis: 2,00 US-Dollar pro Million Token. Dort endet die Übereinstimmung, und eine einzige Zahl macht das deutlicher als jede Spec-Tabelle. In der Revision v4.3.2 des Intelligence Index von Artificial Analysis beträgt die Median-Zeit bis zum ersten Antwort-Token für Claude Sonnet 5.5 in seiner Max-Effort-Einstellung 370,8 Sekunden. Für Grok 4.5 sind es 6,9 Sekunden. Derselbe Input-Preis. Dreiundfünfzigmal so lange Wartezeit, bevor überhaupt etwas zurückkommt. Claude Sonnet 5.5, veröffentlicht am 28. September 2026, und Grok 4.5, veröffentlicht am 8. Juli 2026 und seitdem zweimal innerhalb seiner eigenen Familie überholt, sind auf dem Papier die zwei günstigsten Wege in die vordere Hälfte der Frontier — und das Papier verbirgt die Entscheidung, auf die es wirklich ankommt: nämlich, was man mit der Wartezeit erkauft.

Diese Zahl braucht sofort ihren Vorbehalt, denn eine Latenzzahl ohne Konfiguration ist bedeutungslos: 370,8 Sekunden ist Anthropics Standard-Reasoning-Modus bei maximalem Aufwand, der ein sehr großes Denkbudget verbraucht, bevor er ein Antwort-Token ausgibt. Wer ein schnelles erstes Token möchte, konfiguriert etwas anderes. Aber die Richtung ist real und kein Artefakt — Artificial Analysis misst die Ausgabegeschwindigkeit von Claude Sonnet 5.5 mit 138,7 Token pro Sekunde, nur von einer Handvoll Modelle übertroffen, und die von Grok 4.5 mit 59,2. Das Modell, das am längsten wartet, schreibt auch am schnellsten. Die Wahl besteht zwischen einer langen Überlegung, gefolgt von einer schnellen Antwort, und einer kurzen, gefolgt von einer langsameren.

Was hat sich am 28. September geändert?

Claude Sonnet 5.5 ist einen Tag alt. Anthropic hat es am 28. September 2026 unter der API-Kennung claude-sonnet-5-5 veröffentlicht, zusammen mit Bedrock, Google Cloud und Microsoft Foundry, und beschreibt es als 30 % schneller als Claude Sonnet 5 und bei den meisten Aufgaben bis zu 30 % günstiger pro Task. Das sind Angaben des Anbieters, die nicht unabhängig reproduziert wurden; der Preis, gegen den hier argumentiert wird, ist real, denn die Preisliste blieb unverändert bei 2,00 $ pro Million Eingabe-Token, 10,00 $ pro Million Ausgabe-Token, 0,20 $ für Cache-Lesevorgänge und 2,50 $ für Cache-Schreibvorgänge. Das Kontextfenster umfasst 1.000.000 Token bei einer synchronen Ausgabegrenze von 128.000 Token sowie 300.000 Token bei der Message Batches API hinter dem output-300k-2026-03-24-Header. Der Knowledge Cutoff liegt bei Juni 2026. Zero Data Retention ist ab dem Start verfügbar, und Anthropic stellt das Modell nicht vor dem 28. September 2027 ein.

Artificial Analysis model page for Claude Sonnet 5.5 in its Adaptive Reasoning, Max Effort, Default Fallback configuration, released September 2026, showing an Intelligence Index of 56, an output speed of 138.7 tokens per second, $2.00 per million input tokens and $10.00 per million output tokens, $7.60 per Intelligence Index task, 410M output tokens generated during the Index evaluation, and a 1M-token context window.

Anthropics eigene Dokumentationsseite ist ebenfalls ungewöhnlich explizit, was die Kosten des Upgrades angeht: Fünf Breaking Changes trennen Claude Sonnet 5.5 von dem Modell, auf dem der Großteil des Claude-Traffics derzeit läuft, und sie werden weiter unten behandelt.

Grok 4.5 ist die ältere Option und die kompliziertere. SpaceXAI – das Unternehmen, das auf seinen Modellkarten noch unter der Marke x​AI firmiert – veröffentlichte es am 8. Juli 2026 als ein Mixture-of-Experts-Modell mit 1,5 Billionen Parametern, trainiert zusammen mit dem Cursor-Coding-Editor, mit einem Kontextfenster von 500.000 Token, Text-, Bild- und Dateieingabe und einem Markteinführungs-Pitch, der fast ausschließlich auf Token-Ökonomie statt auf Spitzenergebnisse setzte. Es ist nicht mehr das Flaggschiff. Grok 4.6 und Grok 4.7 existieren beide, beide haben denselben Listenpreis von 2,00 $ / 6,00 $, und unser Katalog führt alle drei. Die interessante Frage im September 2026 ist daher nicht, ob Grok 4.5 gut ist, sondern ob es noch irgendetwas rechtfertigt, zum ältesten der drei zu greifen.

Die Rechnung ist nicht die Preisliste.

Setze die beiden nebeneinander auf das unabhängige Board, und die Form des Trades erscheint.

• Intelligenzindex, Revision v4.3.2 — Claude Sonnet 5.5 56 bei maximalem Aufwand vs. Grok 4.5 39

• Kosten pro Index-Aufgabe — Claude Sonnet 5.5 7,60 $ vs. Grok 4.5 1,04 $, beide gemessen, nicht geschätzt

• Ausgaberate — Claude Sonnet 5.5 $10,00 pro Million vs. Grok 4.5 $6,00 pro Million

• Ausgabegeschwindigkeit — Claude Sonnet 5.5 138,7 Tokens/Sek. vs. Grok 4.5 59,2 Tokens/Sek.

• Zeit bis zum ersten Antwort-Token, Max Effort — Claude Sonnet 5.5 370,8 s vs. Grok 4.5 6,9 s

• Tokens, die über die gesamte Index-Auswertung hinweg generiert wurden — Claude Sonnet 5.5 410M vs. Grok 4.5 77M

• Kontext — Claude Sonnet 5.5 1.000.000 Token vs. Grok 4.5 500.000 Token

Die Ausführlichkeitslinie ist der Mechanismus hinter der Lücke bei den Kosten pro Aufgabe, und sie ist die mit Abstand nützlichste Zahl auf dieser Seite. Ein Modell, das über eine Evaluierung hinweg 410 Millionen Token ausgibt, während sein Rivale 77 Millionen ausgibt, braucht keine um 67 % höhere Ausgaberate, um siebenmal so viel pro Aufgabe zu kosten – aber es hat trotzdem eine, und beide Effekte wirken in dieselbe Richtung. A​nthropics eigene Darstellung stimmt mit der Interpretation überein, statt ihr zu widersprechen: „bis zu 30 % weniger pro Aufgabe“ ist eine Aussage über Token-Anzahlen, nicht über Raten, denn die Raten haben sich zwischen Claude Sonnet 5 und Claude Sonnet 5.5 nicht geändert. Artificial Analysis kommt von der anderen Seite zum selben Schluss und beschreibt das Modell in einfachen Worten als bemerkenswert schnell, aber sehr ausführlich. Gegenüber einem schlanken Modell ist dieselbe Eigenschaft das größte Betriebsrisiko von Claude Sonnet 5.5.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Grok 4.5, the scoreboard, with six matched rows: input price $2.00 vs $2.00, output price $10.00 vs $6.00, Intelligence Index 56 vs 39, cost per task $7.60 vs $1.04, first token 370.8 s vs 6.9 s, and context window 1,000,000 vs 500,000 tokens, with a footer reading Index, cost per task and latency per Artificial Analysis v4.3.2; prices per the vendors.

Wo der günstige Tarif von Grok 4.5 aufhört, günstig zu sein

Die 2,00 $ / 6,00 $-Zeile ist eine Preisstufe, kein Tarif. In der eigenen Entwicklerdokumentation von SpaceXAI gilt dieser Preis bis zu 200.000 Eingabe-Tokens und verdoppelt sich darüber hinaus auf 4,00 $ Eingabe und 12,00 $ Ausgabe. Das Fenster von Grok 4.5 umfasst 500.000 Tokens, die zweite Hälfte des beworbenen Fensters kostet also doppelt so viel wie die erste Hälfte. Einen Prompt in Repository-Größe in Grok 4.5 zu laden, ist kein Vorgang mit 6 $ Ausgabe; es ist ein Vorgang mit 12 $ Ausgabe, und an diesem Punkt ist das Modell mit dem „teuren“ Ausgabetarif von 10 $ bei jeder Anfrage, die ebenfalls viele Tokens ausgibt, das günstigere.

Claude Sonnet 5.5 hat keine entsprechende Tarifstufe. Der Tarif von 2,00 $ / 10,00 $ gilt über das gesamte Fenster von 1.000.000 Token, und Cache-Lesevorgänge werden mit 0,20 $ abgerechnet – einem Zehntel des Eingabetarifs –, was den Langkontext-Fall in der Praxis statt nur auf dem Papier machbar macht.

Die Fenstergröße ist die andere Hälfte dieses Arguments, und sie weist in dieselbe Richtung. Das Fenster von Grok 4.5 umfasst 500.000 Tokens, und jeder einzelne davon wird zum beworbenen Tarif abgerechnet. Claude Sonnet 5.5 hat 1.000.000 Tokens zur Verfügung, und die Form der Arbeitslast ist es, die das so bedeutsam macht: ein Repository, über das man Schlussfolgerungen ziehen muss, ein langes Agenten-Transkript, ein Stapel Dokumente, der im Blick bleiben muss. Die doppelte Obergrenze, kein Stufenwechsel bei der Hälfte davon und Cache-Lesevorgänge zu einem Zehntel des Eingabetarifs sind es, die das Mitführen von so viel Kontext über viele Aufrufe hinweg zu einem Einzelposten statt zu einer Budgetfrage machen.

Die praktische Trennung ist nicht subtil:

• Kurze Prompts mit dichter Ausgabe — Grok 4.5 gewinnt bei der Rate und gewinnt erneut beim Token-Verbrauch

• Prompts über 200.000 Eingabe-Tokens – bei Grok 4.5 verdoppelt sich der Tarif, bei Claude Sonnet 5.5 nicht.

• Latenzempfindliche interaktive Arbeit – Grok 4.5 antwortet zuerst, mit großem Abstand, bei Standardeinstellungen

• Agentische Läufe mit langem Horizont — der zusammengesetzte Score von Claude Sonnet 5.5 und die Ausgabeobergrenze von 128K sind das, wofür Sie die zusätzlichen Task-Kosten zahlen, und die 300K-Batches-Obergrenze erweitert dies noch weiter

Die Migration ist kein Modell-String

Wer von Claude Sonnet 5 auf Claude Sonnet 5.5 umsteigt, sollte vor dem Schreiben von Code A​nthropics Migrationshinweis lesen, weil sich fünf Verhaltensweisen geändert haben und nur eine davon an einer offensichtlichen Stelle lautstark fehlschlägt.

• Nicht standardmäßige Temperatur, top_p oder top_k geben jetzt einen 400 zurück — eine sampling-lastige Pipeline funktioniert nicht mehr, statt sich zu verschlechtern

• thinking: {"type": "disabled"} gibt einen 400 zurück und muss between_tools werden, wobei effort auf low, medium oder high beschränkt ist; xhigh und max werden abgelehnt

• Erzwungene Tool-Nutzung — tool_choice von "any" oder ein benanntes Tool — wird rundweg abgelehnt, sodass eine Schleife, die einen schema-gültigen Aufruf erzwingt, auf auto mit strikter Tool-Nutzung oder strukturierten Ausgaben wechseln muss

• Das ältere computer_20251124 Computer-Use-Tool wird auf der Claude API und auf Goo​gle Cloud abgelehnt

• Thinking-Blöcke sind an das erzeugende Modell und Konto gebunden, daher wird Reasoning von Claude Sonnet 5 weitergetragen, aber nicht seitwärts in eine andere Familie — und das Advisor-Tool akzeptiert Claude Opus 4.8, Claude Opus 4.7 oder Claude Sonnet 5 nicht mehr als Berater hinter einem Sonnet-5.5-Executor

Es gibt eine sechste Änderung, die überhaupt nichts fehlschlagen lässt, was sie zur gefährlichen macht: Text zwischen Tool-Aufrufen wird jetzt innerhalb von Thinking-Blöcken zurückgegeben. Eine Anwendung, die diesen Text an einen Nutzer streamt, verstummt zwischen Tool-Aufrufen, bis sie entweder einen Anzeigewert setzt oder vorgelagertes Denken vollständig abschaltet. Nichts schlägt fehl. Die Ausgabe erscheint einfach nicht mehr.

Grok 4.5 verlangt nichts davon. Es ist ein Modell im OpenAI-Format mit intakter Sampling-Oberfläche, und der Wechsel von den eigenen Vorgängern von Grok 4.5 zu ihm ist eine Änderung des Modell-Strings. Die Migrationskosten fallen vollständig auf der Claude-Seite an, und es ist ein Tag Arbeit statt eines Nachmittags.

Beides auf einem Nachweis, und die ehrliche Grenze dessen

Einen Vergleich zwischen zwei Anbietern im Kopf zu behalten ist einfach; ihn tatsächlich durchzuführen, ist der Punkt, an dem die Kosten verborgen liegen. OrcaRouter stellt über 200 Modelle hinter einen einzigen OpenAI-kompatiblen Endpunkt, wobei die Listenpreise der Anbieter durchgereicht und keine Aufschläge hinzugefügt werden, sodass eine Tarifänderung auf einer der beiden Seiten hier noch am selben Tag live ist statt erst bei der nächsten Vertragsverlängerung, mit automatischem Failover zwischen vorgelagerten Anbietern und einer Routing-DSL zum Zusammensetzen von Aufrufen. Die gesamte Grok-Reihe ist im Katalog zu SpaceXAIs eigenen Tarifen enthalten, und Grok 4.5 ist als grok/grok-4.5 für 2,00 $ Eingabe und 6,00 $ Ausgabe pro Million Token über sein 500.000-Token-Fenster routbar.

Claude Sonnet 5.5 ist nicht in unserem Katalog, und diese Seite wird nichts anderes suggerieren. Der Weg dorthin führt heute über Anthropics eigene API – oder über Bedrock und Google Cloud, falls Ihre Infrastruktur bereits dort angesiedelt ist. Claude Sonnet 5 ist hier seit dem 30. Juni zu Anthropics Preisen von 2,00 $ und 10,00 $ routbar und bleibt das Modell, auf dem der meiste Claude-API-Datenverkehr läuft, was es zum natürlichen Failover-Ziel macht, solange Claude Sonnet 5.5 erst einen Tag alt ist und noch keine Produktionsbelege von irgendjemandem vorliegen.

Einen Vorbehalt muss man bei all dem anbringen, und er ist nicht klein. Die Zeile zu Grok 4.5 oben ist das Werbeversprechen des Anbieters, so wie unser Katalog es derzeit wiedergibt; der Traffic-Zähler für diesen Eintrag zeigt über die letzten sieben Tage null an, und sein Durchsatzwert wird nicht gemessen, wobei die Zeit bis zum ersten Token auf der Untergrenze von einer Sekunde liegt, die ein kaum aufgerufenes Modell typischerweise zeigt. Ein Modell ohne aktuellen Traffic ist hier kein Beleg dafür, dass das Modell schlecht ist – 4.6 und 4.7 sind es, wohin die Aufrufe der Familie gegangen sind –, aber es bedeutet, dass die operativen Zahlen auf dieser Seite dünn sind, und der Latenzwert, dem man trauen kann, ist der Messwert einer Live-Route.

OrcaRouter model page for grok/grok-4.5, dated 2026-07-08, showing a 500K-token context window, text, image and file input, the pricing row of $2.00 input and $6.00 output per million tokens, a p50 time to first token of 1.00 s, a p95 of 4.0 s, and a traffic counter reading Collecting.

Zu welchem man greifen sollte

Grok 4.5 ist das richtige Modell, wenn der Prompt kurz ist, die Antwort dicht ist und die Integration bereits OpenAI spricht – und wenn die Anfrage 200.000 Eingabe-Tokens nicht überschreitet, denn ab dieser Grenze geht die Berechnung in andere Hände über. Es ist außerdem die richtige Wahl, wenn ein erstes Token in Sekunden statt in Minuten ankommen muss. Was es nicht ist: das aktuelle Grok-Flaggschiff; Grok 4.6 und Grok 4.7 stehen bei gleichem Listenpreis über ihm, und der Grund, 4.5 statt eines der beiden zu wählen, muss ein spezifischer sein.

Claude Sonnet 5.5 ist das richtige Modell, wenn der Prompt riesig ist, die Arbeit agentisch genug ist, dass siebzehn Index-Punkte und eine 128K-Ausgabegrenze siebenfach höhere Kosten pro Aufgabe rechtfertigen, oder wenn der zusammengesetzte Score einfach das ist, was gekauft wird. Seine Ausführlichkeit ist eine Designentscheidung, kein Defekt, und sie ist die Zahl, die Sie an Ihrem eigenen Traffic messen sollten, bevor Sie sich festlegen – denn 7,60 $ pro Index-Aufgabe gegenüber 1,04 $ sind ein Proxy für eine Zahl, die nur Ihre Workload erzeugen kann.