
Claude Sonnet 5.5: Ein Stealth-Test-Leak, aufgebaut aus vier Zahlen, die bereits existieren
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 36 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 181 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
Vier Zahlen wurden am 24. September auf X veröffentlicht als Beleg dafür, dass Claude Sonnet 5.5 „bereits heimlich getestet wird": ein Kontextfenster von 1 Mio. Tokens, eine maximale Ausgabe von 128K Tokens, 2 $ pro Million Eingabe-Tokens und 10 $ pro Million Ausgabe-Tokens. Alle vier stehen genau jetzt auf Anthropics eigener Preisliste, und zwar bei Claude Sonnet 5 — dem Modell, das ein 5.5 ersetzen würde und das seit dem 30. Juni 2026 allgemein verfügbar ist. Dieselben Eckwerte von 2 $ / 10 $ gelten auch für GPT-6 Sol, das OpenAI am 22. September ausgeliefert hat, und genau diese Überschneidung lässt den Beitrag wie eine Antwort auf OpenAI wirken statt wie eine routinemäßige Aktualisierung einer Modellstufe: „Für mich liest sich das wie eine direkte Reaktion auf GPT-6-Sol. Gleiche Preisgestaltung und vermutlich ähnliche L[eistung]."
Nichts davon macht die Behauptung falsch. Es macht die Behauptung nicht falsifizierbar, was ein anderes und nützlicheres Problem ist, das man aufschreiben sollte. Eine Sichtung bei einem Stealth-Test ist nur so gut wie das Artefakt dahinter, und das Artefakt hinter dieser hier ist ein Datenblatt, das sich nicht von dem Modell unterscheiden lässt, das Anthropic seit zwölf Wochen ausliefert.
Was wurde tatsächlich gepostet?
Die Quelle ist ein einzelner X-Post des Kontos @kimmonismus vom 24. September 2026. Er nennt das Kontextfenster, die maximale Ausgabelänge und die beiden Preise, vergleicht die Preisgestaltung mit GPT-6 Sol und schließt daraus, dass Sonnet 5.5 im Test ist. Es gibt keinen Screenshot, keinen Model-String, keine API-Antwort, keine Konsolenausgabe, keine Beschreibung des Verhaltens durch Tester und keinen zweiten Beobachter, der an irgendeinem Teil davon beteiligt wäre. Der Post ist eine Behauptung mit Zahlen darin, und die Zahlen sind die öffentlichen Limits der Tarifstufe.
Es lohnt sich, das von der anderen Art von Anthropic-Vorabveröffentlichungs-Story zu trennen, denn 2026 hat beide hervorgebracht, und sie sehen sich überhaupt nicht ähnlich. Bei den Early-Access-Identifikatoren claude-marshmallow-eap und claude-melon-eap vom August handelte es sich um Strings, die in Anfragen vorkamen – hässlich, unglamourös und überprüfbar. Die Story um Opus 5.2, die sich durch den September zieht, ist ein Routing-Bericht: Entwickler, die bemerken, dass das Backend hinter dem Label „Opus 5“ anders antwortete, und die das Verhalten beschreiben. Beide sind Artefakte. „Wird bereits verdeckt getestet“ ohne angehängtes Artefakt ist eine Zusammenfassung dessen, was die Sonnet-Stufe bereits verkauft.
Auch in der Quelle selbst gibt es ein Muster, das erwähnenswert ist. Derselbe Account veröffentlichte am 20. September eine Zusammenfassung, die mit vier Modellen begann, von denen es hieß, sie würden „bereits getestet“ – Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 und Gemini 4 Pro. Von diesen vier Namen haben die Opus- und Fable-Einträge separate, bestätigte Berichterstattung hinter sich, und der Gemini-Eintrag hat eigene Sichtungen. Der Sonnet-Eintrag hatte eine Position in einer Liste. Vier Tage später hat die Sonnet-Behauptung ein Datenblatt bekommen, und das Datenblatt ist das Modell, das bereits existiert.
Die vier Zahlen sind die Zahlen von Claude Sonnet 5.
Das ist der Teil, für den man dreißig Sekunden zum Überprüfen braucht und den fast niemand hat. Anthropics Modellübersichtsseite, heute gelesen, führt Claude Sonnet 5 mit einem Kontextfenster von 1 Mio. Tokens, maximal 128K Ausgabe und $2 / $10 pro Million Tokens auf. Vergleiche das Leak damit:
• Kontextfenster — 1 Mio. Token für Claude Sonnet 5.5 beansprucht; 1 Mio. Token für Claude Sonnet 5 veröffentlicht
• Maximale Ausgabe — 128K Tokens angegeben; 128K Tokens veröffentlicht
• Eingabepreis — 2 $ pro Million angegeben; 2 $ pro Million veröffentlicht
• Output-Preis — 10 $ pro Million beansprucht; 10 $ pro Million veröffentlicht
• Modell-ID — nichts veröffentlicht für Claude Sonnet 5.5; claude-sonnet-5 für Claude Sonnet 5
• Unabhängige Bewertungen — keine für das behauptete Modell; Artificial Analysis platziert Claude Sonnet 5 mit einem Intelligence Index von 38 auf Rang 54 der 210 Modelle, die es misst, in der Konfiguration mit adaptivem Reasoning und maximalem Aufwand

Beim Preispunkt gibt es eine zweite Ebene, die das Leak genau umdreht. Als Claude Sonnet 5 auf den Markt kam, wurden $2 / $10 als Einführungspreis angekündigt, der bis zum 31. August 2026 gilt, mit einer geplanten Erhöhung auf $3 / $15 zum 1. September. Diese Erhöhung fand nicht statt. Anthropics Preisseite trägt jetzt eine Fußnote mit der Aussage, dass $2 / $10 „nun der Standardpreis ist“ und dass „die zuvor geplante Erhöhung auf $3 / $15 pro Million Input-/Output-Tokens zum 1. September 2026 nicht erfolgen wird“. Der Preis, den das Leak als Wettbewerbswaffe des neuen Modells präsentiert, ist also der dauerhafte Tarif des Amtsinhabers – was bedeutet, dass ein Sonnet 5.5, das zu $2 / $10 startet, ohne jeden Rabatt starten würde, und zwar in eine Preisklasse hinein, die bereits gegen GPT-6 Sol bepreist ist.
Das Einzige, was Anthropic tatsächlich gesagt hat
Lässt man alles von ungenannten Leakern weg, bleibt ein einziger Satz aus erster Hand übrig. Als Anthropic am 22. September 2026 Claude Opus 5.5 einführte, hieß es, Claude Sonnet 5.5 und Claude Haiku 5.5 würden „in den kommenden Wochen“ folgen und vergleichbare Zugewinne bei Leistung, Effizienz und Sicherheit bringen. Dieser Satz ist der gesamte bestätigte Beleg. Er enthält keine Modell-ID, kein Kontextfenster, keinen Preis, keinen Benchmark und kein Datum – und insbesondere sagt er nichts über einen Stealth-Test, eine graue Route oder irgendeine Art von Test.
Der übrige öffentliche Auftritt von Anthropic deckt sich mit dieser Lesart. Die Modellübersicht listet weiterhin vier Modelle — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 und Claude Haiku 4.5 —, ohne fünfte Zeile, ohne Preisangabe und ohne „Upcoming“-Markierung für einen Sonnet-Nachfolger. Wenn irgendwo, wo ein Entwickler darauf zugreifen könnte, ein Checkpoint der Sonnet-Klasse bereitgestellt würde, wäre die Kennung das Erste, was auftauchen würde, denn ein bereitgestelltes Modell muss in einer Anfrage einen Namen haben. Nichts ist aufgetaucht.
Eine Sache, die die September-Ankündigung klärte: Sie widersprach dem früheren Leak, der behauptete, die Haiku-Reihe würde eingestellt und die 5.5-Generation würde die Produktpalette umstrukturieren. Haiku 5.5 kommt, laut Anthropic, was bedeutet, dass die Umstrukturierungsgeschichte in einer Richtung falsch war, in der Leaker selten falschliegen — die günstige Preisklasse bleibt.
Das August-Leak sprach von 2 Millionen Tokens. Dieses hier nennt 1 Million.
Sechs Wochen vor dem Beitrag vom 24. September, am 9. August, veröffentlichte ein anderes X-Konto ein Datenblatt zu „SONNET 5.5 LEAK“ mit einer wesentlich gewagteren Behauptung: ein Kontextfenster von 2 Millionen Token, doppelt so groß wie das von Sonnet 5, schnellere Inferenz, bessere Nutzung von Browser- und Terminal-Tools, Leistung, die an Claude Fable 5 heranreicht, und eine Veröffentlichung „nächsten Monat“. Dieser Leak enthielt eine Grafik, die wie eine Vorschaukarte von Anthropic gestaltet war. Er enthielt außerdem ein verhängnisvolles Detail, auf das sich seine Kritiker sofort stürzten: Der Codename, den er angab, „Fennec“, war der Codename, der bereits am 30. Juni mit Claude Sonnet 5 ausgeliefert worden war. Ein Codename kann kein neuer Beweis für einen Nachfolger des Modells sein, das ihn verwendet hat.
Also sind sich die beiden Leak-Wellen bei der einzigen meistzitierten Zahl uneinig. August sagte 2M Kontext. September sagt 1M. Beide können nicht denselben Build beschreiben. Die wahrscheinlichste Lesart ist die langweilige: Der September-Beitrag beschreibt die veröffentlichten Limits der Sonnet-Stufe, weil ein Modell der Sonnet-Stufe von außen genau so aussieht, und der August-Beitrag war eine Vermutung, was ein Refresh plausibel verdoppeln würde. Beachte, in welche Richtung sich die Zahl bewegt hat – nach unten, hin zu dem, was bereits existiert.
Stimmt der GPT-6-Sol-Vergleich also?
Meistens, und die Stelle, an der es auseinanderbricht, ist der interessante Teil. GPT-6 Sol wurde am 22. September 2026 ausgeliefert, am selben Tag wie Claude Opus 5.5, und sein Listenpreis beginnt bei 2 $ pro Million Eingabe und 10 $ pro Million Ausgabe – genau der Satz von Sonnet 5 und genau das, was das Leck für Sonnet 5.5 behauptet. Es bedient ein Kontextfenster von 1.050.000 Token mit einer Ausgabegrenze von 128K, beides nur eine Nuance entfernt von den Zahlen von Claude Sonnet 5. Das günstigere Geschwistermodell, GPT-6 Luna, liegt bei 0,10 $ / 0,50 $.
Der Knackpunkt ist der lange Kontext. GPT-6 Sol staffelt die Preise in zwei Stufen: $2 / $10 bis zu 272.000 Input-Tokens, danach $4 / $15 darüber hinaus. Anthropic macht das in der Sonnet-Reihe nicht – Claude Sonnet 5 berechnet das volle 1M-Fenster zu Standardtarifen, sodass eine Anfrage mit 900K Tokens pro Token genauso viel kostet wie eine mit 9K. Ein echtes Sonnet 5.5 gegenüber einem echten GPT-6 Sol ist daher bei gewöhnlichen Prompts ein Preisgleichstand und bei den Langdokument- und Large-Repo-Workloads, für die beide Modelle verkauft werden, eine Lücke um den Faktor zwei. „Gleiche Preise“ stimmt in der Schlagzeile und ist falsch bei den Workloads, bei denen die Stufe gewählt wird.
Ein zweiter Vorbehalt steht unter dem gesamten Vergleich. Claude Sonnet 5 verwendet den neueren Tokenizer von Anthropic, der für denselben Text etwa 30 % mehr Tokens erzeugt als der vorherige. Ein Schlagzeilen-Tarif ist keine Rechnung; die Rechnung sind Tokens pro Aufgabe, und das ist die Zahl, die noch kein Leak je enthalten hat.
Was würde ein Sonnet 5.5 bedeutsam machen
Lass beiseite, ob es existiert, und frage, was sich für jemanden ändern würde, der für Tokens bezahlt. Vier Dinge – und keines davon ist ein Datenblatt.
Das erste ist ein Preis unter 2 $ / 10 $. Da die zum 1. September geplante Erhöhung gestrichen wurde, gilt der Tarif des Platzhirsches nun dauerhaft — ein Nachfolger, der denselben Tarif beibehält, ist also ein Seitwärtsschritt, und die einzige Neuigkeit in der Sonnet-Klasse, die Geld bewegt, ist eine Preissenkung.
Der zweite ist Kontext jenseits von 1 Mio. Das war die eigentliche Aussage des August-Leaks, und es ist die einzige Fähigkeitslücke, die der Leak benennen kann, die der etablierte Anbieter nicht bereits abdeckt.
Der dritte Punkt sind Tokens pro Aufgabe. Das adaptive Denken von Claude Sonnet 5 ist standardmäßig aktiviert, und unabhängige Analysen haben gemessen, dass es pro Aufgabe wesentlich mehr Ausgabe-Tokens erzeugt als sein Vorgänger. Eine Version, die den Tarif von $2 / $10 beibehält und diese Inflation stoppt, würde die tatsächlichen Rechnungen stärker senken als eine Schlagzeilen-Preissenkung.
Das Vierte ist eine Kennung. Ein API-Modell-String, eine Doku-Zeile, ein Preiseintrag, eine Modellkarte – irgendeines davon beendet die Debatte, und das Fehlen aller vier nach einem so expliziten Leak ist selbst der aussagekräftigste Umstand in dieser Geschichte.
Was Sie heute anrufen können
Claude Sonnet 5 ist kein Platzhalter, während sich die Tarifstufe sortiert. Es ist das Modell, auf dem der größte Teil des Claude-API-Datenverkehrs bereits läuft, mit einem 1M-Token-Fenster, 128K Ausgabe und dem Tarif von 2 $ / 10 $, der inzwischen Standard und nicht mehr Aktionsangebot ist.

Es läuft seit Juni bei OrcaRouter zu Anthropics eigenen $2 / $10, zum Listenpreis des Anbieters ohne Aufschlag weitergegeben, sodass eine Preisänderung des Anbieters auf der Sonnet-Linie hier noch am selben Tag live wäre statt erst zum nächsten Abrechnungszyklus. Derselbe Schlüssel erreicht bereits GPT-6 Sol zu $2 / $10, was in einem Beitrag wie diesem mehr als sonst zählt: Der Vergleich, auf den sich der Leak stützt, ist ein Vergleich, den man selbst mit einem einzigen Credential statt mit zwei Verträgen durchführen kann.

Das ist zugleich der günstigste Weg, die Frage zu beantworten, die das Leck aufwirft. Sollte tatsächlich ein Sonnet 5.5 erscheinen, taucht es im Katalog auf wie alles andere, und du leitest einen Teil des Traffics darauf, hinter automatischem Failover auf Claude Sonnet 5 – keine zweite Integration, keine Neuverhandlung und kein Produktionspfad, der auf einem Modell läuft, das niemand unabhängig gebenchmarkt hat. Eine unerprobte Stufe auszuprobieren ist eine Routing-Entscheidung, kein Migrationsprojekt.
Was man sich statt des nächsten Leak-Posts ansehen sollte
Drei Signale, in absteigender Reihenfolge danach, wie viel sie dir verraten würden. Eine Kennung ist entscheidend, denn ein bereitgestelltes Modell muss einen Namen in einer Anfrage haben, und genau so wurde jede überprüfbare Anthropic-Pre-Release-Story im Jahr 2026 überprüfbar. Eine Bestätigung des Anbieters – eine Modellkarte, eine Zeile in der Doku, eine Preiszeile oder dass das Modell einfach in Anthropics eigener Liste auftaucht – beendet die Sache endgültig; der Satz „in den kommenden Wochen“ bedeutet, dass eines davon tatsächlich geschuldet ist. Ein Testerbericht, der Verhalten statt Spezifikationen beschreibt, ist der schwächste der drei und immer noch mehr, als es heute gibt.
Bis eines davon erscheint, lautet die ehrliche Zusammenfassung, dass Anthropic für die kommenden Wochen eine Sonnet-Aktualisierung versprochen hat und ein Beobachter sie mit den Zahlen des Modells beschrieben hat, das sie ersetzen wird. Wenn Ihr Stack bereits claude-sonnet-5 ausführt, gibt es nichts abzuwarten und nichts, worauf Sie Ihre Planung ausrichten müssten. Wenn Sie Claude Sonnet 5 gegen GPT-6 Sol abwägen, sind die Zahlen, nach denen Sie handeln können, die bereits veröffentlichten — und es sind dieselben Zahlen, die der Leak Ihnen als Neuigkeit verkaufen will.
In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
