Generierte Hero-Titelkarte für Claude Sonnet 5.5 vs. Claude Fable 5.1, mit dem Untertitel „Das günstige Modell liegt drei Punkte vorn“, die links $2,00 Eingabe und $10,00 Ausgabe pro Million Token gegenüber $10,00 und $50,00 rechts zeigt, darunter die Werte 56 und 53 des Artificial Analysis Intelligence Index v4.3, und das OrcaRouter-Logo in die untere rechte Ecke eingefügt.
Guides & Insights

Claude Sonnet 5.5 vs Claude Fable 5.1: Das günstige Modell liegt drei Punkte vorn

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Sonnet 5.5 erschien am 28. September 2026 für 2,00 $ pro Million Input-Tokens und 10,00 $ pro Million Output-Tokens. Claude Fable 5.1, das Mythos-Klasse-Modell, das der Anbieter am 1. September ausgeliefert hat, liegt bei 10,00 $ und 50,00 $ auf denselben beiden Zeilen. Die verführerische Zusammenfassung lautet, dass Fable 5.1 das teure und damit das bessere Modell ist, doch im Artificial Analysis Intelligence Index ist die Reihenfolge genau umgekehrt: Claude Sonnet 5.5 erreicht 56 Punkte und Claude Fable 5.1 erreicht 53. Das ist kein Rundungsartefakt, und es ist auch nicht die ganze Geschichte, denn dieselbe Auswertung bringt die beiden auf derselben Testsuite auf weniger als drei Cent pro Aufgabe aneinander heran – 7,60 $ gegenüber 7,63 $. Ein fünffacher Unterschied auf der Preisliste ist so gut wie verschwunden, wenn eine Aufgabe abgeschlossen ist. Was bleibt, ist eine Reihe von Unterschieden in der Form und nicht im Punktwert, und die Wahl zwischen diesen beiden ist vor allem die Frage, welche Form Ihre Arbeitslast hat.

Zwei Tarifkarten – und die eine Zeile, in der die Lücke nicht das Fünffache beträgt

Der Vergleich pro Token ist eindeutig und bedarf keiner Interpretation.

• Eingabe – Claude Sonnet 5.5 zu 2,00 $ pro Million Token gegenüber Claude Fable 5.1 zu 10,00 $, ein fünffacher Unterschied

• Ausgabe — 10,00 $ gegenüber 50,00 $ pro Million, wieder genau fünffach

• Cache-Lesevorgang — 0,20 $ gegenüber 0,25 $ pro Million. Das ist die Zeile, die lange Agent-Läufe trägt, und der Rabatt fällt von 5× auf 20 %

• Cache-Schreibvorgang — 2,50 $ gegenüber 12,50 $ pro Million im standardmäßigen Fünf-Minuten-Fenster, die größte einzelne Lücke auf beiden Karten

• Batch — Anthropics Batch-Modus gilt bei keiner dieser beiden Karten so wie bei Fable 5.1: Fable 5.1 startete mit Batch-Preisen, die sich auf $5.00 Input und $25.00 Output halbierten. Lies die Batch-Zeile auf Anthropics eigener Preisseite nach, bevor du annimmst, dass sie sich auf die ganze Familie übertragen lässt

• Kontext und Obergrenze — 1.000.000 Tokens Kontext und 128.000 Tokens maximale Ausgabe bei beiden. Auf der Message Batches API unterstützt Claude Sonnet 5.5 bis zu 300.000 Ausgabe-Tokens hinter dem Beta-Header output-300k-2026-03-24, was ein echter Unterschied bei der Obergrenze für die Massengenerierung ist und kein Marketing-Unterschied.

Es gibt einen bescheidenen Punkt zugunsten von Claude Sonnet 5.5, den die Preisliste unterschätzt. Anthropic berichtet, dass das Modell typischerweise weit weniger Tokens benötigt, um dieselbe Arbeit zu erledigen, als sein Vorgänger, was laut Anthropic zu bis zu 30 % geringeren Kosten pro Aufgabe führt. Das ist eine Anbieterbehauptung zu einem anderen Vergleich – Sonnet 5.5 gegen Sonnet 5 – und kein Beleg für dieses Duell. Es ist jedoch der Mechanismus, der erklärt, was die unabhängige Messung ergeben hat.

Wohin die fünffache Preisdifferenz geht

Artificial Analysis hat beide Modelle am 29.09.2026 unter einem einzigen Testaufbau und einem einzigen Konfigurationslabel, „Adaptive Reasoning, Max Effort, Default Fallback“, auf dem Intelligence Index v4.3 laufen lassen. Die beiden Schlagzeilenwerte sind 56 für Claude Sonnet 5.5 und 53 für Claude Fable 5.1 – das günstigere Modell liegt rund drei Punkte vorn, auf einer Skala, auf der derselbe Bewerter das Medianmodell bei 26 einordnet. Beide sind auf derselben Seite als Modelle mit Herstellernamen ausgewiesen, es handelt sich also um ein einziges Instrument und eine einzige Momentaufnahme, nicht um zwei.

Dann die Kostenspalte und der Grund, warum diese Paarung eher interessant als offensichtlich ist. Im selben Index-Lauf kostet Claude Sonnet 5.5 $7,602633 pro Aufgabe und Claude Fable 5.1 $7,629706. Sie liegen nur siebenundzwanzig Tausendstel Dollar auseinander. Die Aufschlüsselung ist der Punkt, an dem es seltsam wird: Allein die Eingabeseite von Claude Fable 5.1 kostet $3,73 pro Aufgabe, gegenüber der deutlich kleineren Eingabekomponente von Sonnet 5.5, und allein seine Reasoning-Tokens kosten $2,36 pro Aufgabe. Das Modell, das pro Token fünfmal günstiger ist, ist pro fertiggestellter Aufgabe keineswegs günstiger.

Die Ursache ist das Volumen, und die beiden Modelle versagen in entgegengesetzte Richtungen.

• Ausgabe-Tokens über die gesamte Index-Suite hinweg – Claude Sonnet 5.5 generierte 410.577.501 gegenüber 188.465.663 von Claude Fable 5.1, in einer Suite, in der der erfasste Median 88 Millionen beträgt. Beide liegen deutlich über dem Median; Sonnet 5.5 ist mehr als doppelt so hoch wie Fable 5.1 und fast fünfmal so hoch wie der Median.

• Ausgabe-Tokens pro Aufgabe — 192.838 für Sonnet 5.5 gegenüber 78.111 für Fable 5.1, bei einem Reasoning-Anteil von 142.386 gegenüber 47.240. Sonnet 5.5 denkt pro Aufgabe etwa dreimal so lange

• Eingabe-Tokens über die gesamte Index-Suite — 18,5 Milliarden für Sonnet 5.5 gegenüber 5,6 Milliarden für Fable 5.1. Sonnet 5.5 las dreimal so viel, was die unauffälligere Zahl des Paares ist und diejenige, die den günstigeren Eingabetarif auffrisst

• Mischpreis bei einem 7:2:1-Mix aus Eingabe, Cache-Lesevorgang und Ausgabe – 1,54 $ für Sonnet 5.5 gegenüber 7,17 $ für Fable 5.1. Dies ist die Zeile, die mit der Preisliste übereinstimmt, und es ist die Zeile, die eine Workload mit kurzen, klar begrenzten Ausgaben beschreibt.

Setzt man das zusammen, lautet die ehrliche Aussage: Die gemischte Preislücke ist real und die Pro-Aufgabe-Lücke nicht. Welche der beiden Zahlen Ihre Rechnung beschreibt, hängt ganz davon ab, ob Ihre Aufgaben terminieren oder abschweifen, und die Index-Suite ist darauf ausgelegt, sie abschweifen zu lassen.

Die Aufwandsleiter ist die eigentliche Entscheidung.

Beide Modelle bieten einen Effort-Parameter – low, medium, high, xhigh, max – und beide wurden am 29.09.2026 auf jeder Stufe gemessen. Das ist der Teil des Vergleichs, den keine Preisliste ausdrücken kann, denn das günstige Modell auf einer niedrigeren Stufe schlägt das teure Modell auf einer niedrigeren Stufe mit großem Abstand und das teure Modell setzt sich erst nahe der Spitze ab.

• Geringer Aufwand — Claude Sonnet 5.5 erzielt 35,84 bei 0,41 $ pro Aufgabe; Claude Fable 5.1 erzielt 46,82 bei 2,37 $. Auf der untersten Stufe liegt das teure Modell elf Punkte vorn – für fast sechsmal so viel Geld.

• Mittlerer Aufwand — 40,74 bei 0,59 $ gegenüber 48,92 bei 2,98 $. Fable 5.1 hält einen Acht-Punkte-Vorsprung bei fünfmal so hohen Kosten.

• Hoher Aufwand — 46,74 bei 1,08 $ gegenüber 51,15 bei 3,91 $. Die Lücke verringert sich auf viereinhalb Punkte; das Kostenverhältnis bleibt bei etwa 3,6×

• Xhigh-Aufwand — 51,85 bei 2,74 $ gegenüber 53,20 bei 5,98 $. Ein und ein Drittel Punkte auseinander, bei 46 % des Preises

• Maximaler Aufwand — 55,98 bei 7,60 $ gegenüber 53,35 bei 7,63 $. Die Reihenfolge kehrt sich um, und die Kosten konvergieren bis auf ein halbes Prozent.

Liest man die vierte und fünfte Zeile zusammen, zeigt sich die Gestalt dieses Duells. Claude Sonnet 5.5 liefert bei xhigh 51,85 — innerhalb von anderthalb Indexpunkten vom besten Ergebnis von Claude Fable 5.1 bei jeglichem Aufwand — für 2,74 $ pro Aufgabe gegenüber 7,63 $. Wenn Ihre Arbeit nahe an der Frontier liegen muss statt genau an ihr, ist diese Zeile die ganze Antwort, und sie spart 64 % pro abgeschlossener Aufgabe. Treibt man Sonnet 5.5 auf max, kauft man drei weitere Punkte für 2,8-mal so viel Geld, was Sie auf dieselbe Rechnung wie das Max von Fable 5.1 bringt, mit einem geringfügig besseren Ergebnis und einem ganz anderen Reasoning-Profil.

Der letzte Satz verdient es, genau festgehalten zu werden, denn er ist kontraintuitiv genug, um zweimal nachgeprüft zu werden. Bei identischem maximalem Aufwand kostet das Modell mit einer fünfmal günstigeren Preisliste pro Aufgabe genauso viel wie das Modell mit der teuren. Es erreicht dies, indem es 2,5-mal so viele Ausgabe-Tokens erzeugt, von denen der Anteil des Reasonings dreimal so groß ist. Anthropics eigene Dokumentation erklärt einen Teil des Mechanismus: Der Tokenizer wurde geändert, und derselbe Text erzeugt bei Claude Sonnet 5.5 etwa 30 % mehr Tokens als bei früheren Modellen. Das ist einer von mehreren beitragenden Faktoren, und es ist eine nützliche Erinnerung daran, dass Ausgabe-Token-Anzahlen über Tokenizer-Revisionen hinweg nicht vergleichbar sind, ohne das zu erwähnen.

Latenz ist der Punkt, an dem die beiden einander nicht mehr ähneln.

Die Score-Konvergenz erstreckt sich nicht auf die Zeit. Im selben Snapshot vom 29.09.2026 meldet Artificial Analysis eine Zeit bis zum ersten Token von 254,41 Sekunden für Claude Fable 5.1 und 2,80 Sekunden für Claude Sonnet 5.5 im Long-Prompt-Slice, bei medianen Ausgabegeschwindigkeiten von 67,9 bzw. 49,4 Token pro Sekunde. Das ist ein Unterschied von zwei Größenordnungen darin, wie lange ein Aufrufer wartet, bevor überhaupt etwas ankommt, und es ist die operativ folgenreichste Zahl in diesem Vergleich.

Bei beiden Werten müssen die einschränkenden Angaben klar genannt werden. Die TTFT von Fable 5.1 wird beim langen Prompt-Typ gemessen; der Medium-Prompt-Ausschnitt des Evaluators für dasselbe Modell am selben Tag beträgt 117,60 Sekunden, sodass der Wert von 254 Sekunden ein Ausläufer und keine Konstante ist. Der Gesamtmedian von Sonnet 5.5 beträgt 2,80 Sekunden, wobei das eigene Varianzband des Evaluators von 1,91 Sekunden beim fünften Perzentil bis 4,23 beim fünfundneunzigsten Perzentil reicht. Anthropics Plattformdokumentation beschreibt die vergleichende Latenz von Fable 5.1 als langsamer und die von Sonnet 5.5 als schnell, was in der Tendenz konsistent ist, ohne eine Messung zu sein.

Unsere eigene Infrastruktur liefert einen dritten Messwert, denn wir routen Claude Fable 5.1 und messen, was wir ausliefern. In den sieben Tagen bis zum 28. September verzeichnet Claude Fable 5.1 auf dem eigenen Traffic von OrcaRouter ein medianes erstes Token bei 6.973 Millisekunden mit einem 95. Perzentil bei 10,0 Sekunden, eine Ausgabegeschwindigkeit von 65,8 Token pro Sekunde und eine Fehlerrate von 0,349 %. Dieser p50-Wert ist mehr als hundertmal schneller als der Lang-Prompt-Wert des Evaluators, was weniger ein Widerspruch als vielmehr eine Definition der Begriffe ist: Ein entwicklerorientiertes erstes Token bei einem kurzen Prompt und das erste Token eines Benchmarks bei einem langen sind Messungen unterschiedlicher Dinge. Wer anhand der Leaderboard-Zahl plant, sollte wissen, welchen der beiden Werte er kauft.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

Ehrlichkeit beim Sourcing, Mitarbeiterbindung und die Migration, die niemand erwähnt

Anbieter-Benchmark-Tabellen und unabhängige Evaluierungen sind unterschiedliche Instrumente und sollten niemals voneinander subtrahiert werden. Anthropics eigene Launch-Tabelle für Claude Sonnet 5.5 weist Terminal-Bench 4.0 mit 70,6 % aus. Artificial Analysis, das seinen eigenen Harness verwendet, berichtet 63,6 % für dasselbe Modell bei einer Evaluierung desselben Namens. Für Claude Fable 5.1 verläuft die Diskrepanz in die andere Richtung: Anthropic meldete zum Launch 55,8 %, und der unabhängige Harness liest 52,0 %. Keines der beiden Paare ist eine Korrektur des anderen. Beurteile jedes nach seinen eigenen Maßstäben und bevorzuge die unabhängige Messung, wenn du entscheidest, wohin der Produktionsverkehr geleitet werden soll.

Auch die Haltung zur Datenaufbewahrung unterscheidet sich, und zwar auf eine Weise, die erst in einer Beschaffungsprüfung sichtbar wird. Anthropic gibt an, dass Claude Sonnet 5.5 mit Zero-Data-Retention verfügbar ist – dieselbe Praxis wie bei Opus 5.5 und Sonnet 5. Das Einführungsmaterial zu Claude Fable 5.1 beschreibt eine inkrementelle Datenverwendungsrichtlinie, die parallel dazu gilt, sowie ein separates Deployment im Rahmen von Project Glasswing, für das standardmäßig ein 30-tägiges Aufbewahrungsfenster zur Sicherheitsüberwachung gilt, wobei die Zero-Data-Retention-Regelung als Übergangszustand beschrieben wird. Wenn Ihr Team einer Datenverarbeitungsprüfung unterliegt, ist diese Unterscheidung ein echter Einzelposten und nicht bloß eine Fußnote, und es lohnt sich, die aktuelle Richtlinienseite von Anthropic zu lesen statt irgendeiner Zusammenfassung davon – einschließlich dieser hier.

Die Migrationskosten sind in einer Weise asymmetrisch, die es selten in die Berichterstattung zur Markteinführung schafft. Der Wechsel zu Claude Sonnet 5.5 ist keine Änderung des Modell-Strings. Anthropics Migrationsleitfaden besagt, dass nicht standardmäßige Werte für temperature, top_p und top_k jetzt einen 400-Fehler zurückgeben, dass ein tool_choice von any oder ein benanntes Tool rundheraus abgelehnt wird und dass thinking: {"type": "disabled"} zu between_tools werden muss, wenn Sie mit ausgeschaltetem Up-front-Thinking liefen. Der Typ between_tools wird bei niedrigem, mittlerem und hohem Aufwand akzeptiert und gibt bei xhigh oder max einen 400 zurück. In der Claude API und in Google Cloud wird Computer Use nur über das Toolset computer_toolset_20260801 unterstützt; das ältere computer_20251124 wird abgelehnt. Nichts davon gilt für einen Wechsel zu Claude Fable 5.1, einem Upgrade innerhalb derselben Familie von Fable 5 mit drei eigenen Breaking Changes. Wenn Sie die beiden als parallele Migrationsziele gegeneinander abwägen, ist das günstigere Modell das teurere, was die Einführung angeht.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Welche wohin

Die Entscheidung, die sich aus den Zahlen ergibt, ist eine Entscheidung darüber, wie viel Ihres Traffics gut abgegrenzt ist.

• Begrenzte, hochvolumige, werkzeuggesteuerte Arbeit — Claude Sonnet 5.5, mit xhigh-Aufwand, wenn Sie nahe an der Leistungsspitze sein müssen. Es liegt eineinhalb Indexpunkte hinter dem Bestwert von Fable 5.1 zurück und kostet dabei 64 % weniger pro abgeschlossener Aufgabe, liefert sein erstes Token in etwa drei Sekunden und seine günstigere Cache-Schreibzeile macht einen neu aufgebauten Kontextpräfix bezahlbar.

• Langfristige, ergebnisoffene Arbeit, bei der eine falsche Antwort teuer ist — Claude Fable 5.1. Es erreicht die maximale Punktzahl von Sonnet 5.5 bei gleichen Kosten pro Aufgabe und kommt dabei mit einem Drittel der Reasoning-Tokens und einem Viertel des Inputs aus, was zählt, wenn die Aufgabe wirklich ergebnisoffen ist und die Form der Eval-Suite Ihrem Problem ähnelt.

• Latenzgebundene interaktive Oberflächen — Claude Sonnet 5.5, und das ist nicht knapp. Im eigenen Snapshot des Evaluators beträgt der Abstand bis zum ersten Token beim langen Prompt-Typ zwei Größenordnungen, und die Messung beim mittleren Prompt verringert ihn nur auf rund 118 Sekunden. Eine Chat-Oberfläche lässt sich nicht auf der Zahl von Fable 5.1 aufbauen, ohne sie durch Batching oder Streaming zu umgehen.

• Massengenerierung mit langen Ausgaben — Claude Sonnet 5.5, wegen der 300.000-Token-Ausgabeobergrenze, die auf der Message Batches API hinter dem Header output-300k-2026-03-24 verfügbar ist, gegenüber einer 128.000-Token-Obergrenze überall sonst. Bestätigen Sie Ihre Batch-Preise, bevor Sie sich festlegen; der Batch-Tarif ist nicht bei den beiden Karten identisch.

• Arbeit, die über Konten hinweggehen muss oder Reasoning zwischen Systemen weiterreichen muss — lies vor beidem Anthropics Dokumentation zu Preserved Thinking. Thinking-Blöcke sind an das Modell und das Konto gebunden, die sie erzeugt haben, und Sonnet 5.5 ist das erste Sonnet, das mit Klassifikatoren ausgeliefert wird, die die Reasoning-Extraktion verhindern. Das ist gleichzeitig eine Compliance-Funktion und eine Einschränkung.

• Regulierte oder aufbewahrungssensible Workloads – prüfen Sie die aktuelle Richtlinie statt der Launch-Berichterstattung. Claude Sonnet 5.5 wurde mit verfügbarer Zero Data Retention eingeführt; das Material zu Fable 5.1 beschreibt eine inkrementelle Richtlinie mit einem standardmäßigen 30-Tage-Fenster bei einem Deployment und Zero Retention als Interimszustand.

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

Auf OrcaRouter liegen Claude Fable 5.1 und Claude Sonnet 5 beide hinter einem einzigen Zugangsschlüssel zum Listenpreis des Anbieters mit 0 % Aufschlag, sodass die Cache-Read-Zeile und die Tokenizer-Änderung die einzigen Dinge sind, die Ihre Rechnung beeinflussen, wenn Sie zwischen ihnen wechseln. Claude Sonnet 5.5 ist noch keine Route auf unserer Plattform – das Modell ist einen Tag alt –, daher lautet die ehrliche Aussage, dass Sie es heute über Anthropics eigene API erreichen. Wer Fable 5.1 über uns betreibt, kann den Wechsel an dem Tag kalkulieren, an dem er verfügbar wird, ohne sonst irgendetwas an der Integration zu ändern, und in der Zwischenzeit automatisches Failover über Anbieter hinweg ist das, was es sicher macht, ein so neues Modell auf einem Pfad auszuprobieren, der verfügbar bleiben muss.

Das Urteil ist knapper, als die Preisdifferenz vermuten lässt. Claude Sonnet 5.5 ist die bessere Standardwahl für fast alles, was begrenzt ist – es erzielt drei Punkte mehr auf dem unabhängigen Index, antwortet in Sekunden und kommt bei xhigh bis auf eineinhalb Punkte an die Obergrenze von Fable 5.1 heran, bei deutlich weniger als der Hälfte der Kosten pro Aufgabe. Claude Fable 5.1 hat ein echtes Argument, und es ist das, das Anthropics eigener Vergleichstabelle zu entnehmen ist: Wenn die Arbeit offen ist und die Kosten eines Fehlers höher sind als die Kosten längeren Nachdenkens, kauft der fünffache Eingabepreis ein Modell, das dieselbe Punktzahl erreicht, ohne dreimal so viele Reasoning-Tokens dafür auszugeben. Wähle nach der Form der Aufgabe, nicht nach der Größe der Preisliste, denn oben auf der Aufwandsskala berechnen dir diese beiden Modelle dasselbe.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert