
GPT-6 vs. Claude Fable 5.1: Die Preislisten stimmen überein, das Coding-Board nicht.
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
GPT-6 und Claude Fable 5.1 sind mit genau demselben Tarif gelistet: 10,00 $ pro Million Eingabe-Tokens und 50,00 $ pro Million Ausgabe-Tokens. Das ist der ganze einfache Teil. Die beiden Namen bezeichnen nicht dieselbe Art von Sache — GPT-6 ist eine Familie von drei Modellen, hinter der kein gpt-6-Endpunkt steht, und Claude Fable 5.1 ist ein einziges wägbares Modell mit einer einzigen Preistabelle — die Preisübereinstimmung sagt Ihnen also fast nichts, bis Sie entscheiden, welches Mitglied der GPT-6-Familie die Antwort liefert. In der Rangliste, die für diese Preisklasse am wichtigsten ist, steht Fable 5.1 an erster Stelle, und kein GPT-6-Modell steht dort.
Welcher GPT-6 taucht in diesem Vergleich auf?
Beginnen wir mit der Benennung, denn sie entscheidet über die Antwort. OpenAI veröffentlicht die GPT-6-Generation als drei separate Modell-IDs: GPT-6 Astra an der Spitze, GPT-6 Sol in der Mitte und GPT-6 Luna am unteren Ende. Es gibt kein Modell namens GPT-6, das man aufrufen kann. Fragt man openai/gpt-6 bei einem beliebigen Gateway an, bekommt man einen 404, keine Completion.
Nur einer der drei trägt die $10.00 / $50.00-Karte, die zu Claude Fable 5.1 passt, und das ist Astra. Sol ist mit $2.00 / $10.00 ein Fünftel des Preises und Luna mit $0.10 / $0.50 ein Hundertstel davon. „GPT-6 vs. Claude Fable 5.1“ ist also eigentlich „GPT-6 Astra vs. Claude Fable 5.1“, wenn man unbedingt vergleichbare Preiskarten gegenüberstellen will – und genau dieser Vergleich ist nicht mehr der interessante, aus einem Grund, der erst Ende September auftauchte.
Auf der Seite von Anthropic gibt es keine solche Mehrdeutigkeit. Claude Fable 5.1 ist ein einzelnes Modell, veröffentlicht am 1. September 2026, mit einem Kontextfenster von 1.000.000 Token, einer Obergrenze von 128.000 Token für die Ausgabe und Text-, Bild- und Dateieingabe. Es wird unter der Modell-ID anthropic/claude-fable-5.1 bereitgestellt. Die Nennung eines Preises für „Fable 5.1“ ist eindeutig, und zwar in einer Weise, wie die Nennung eines Preises für „GPT-6“ es nie ist.
Wo Fable 5.1 tatsächlich vorn liegt – und um wie viel
Der Abstand, der diesen Vergleich entscheidet, ist nicht der allgemeine Index. Es ist das Coding-Board. Abgelesen bei Artificial Analysis und im OrcaRouter-Katalogeintrag für jedes Modell am 8. Oktober 2026 geführt:
• AA Coding Index — Claude Fable 5.1 81,6, auf Platz 1 der Modelle in dieser Rangliste; GPT-6 Astra 76,9, auf Platz 4
• AA Intelligence Index — Claude Fable 5.1 53,4, Rang 8; GPT-6 Astra 52,7, Rang 9
• GPQA Diamond — Claude Fable 5.1 93,7 vs. GPT-6 Astra 96,1
• Humanity's Last Exam — Claude Fable 5.1 59,1 vs. GPT-6 Astra 54,7
• SciCode — Claude Fable 5.1 63,1 vs. GPT-6 Astra 56,5
• Terminal-Bench v2.1 — Claude Fable 5.1 91,4 vs. GPT-6 Astra 88,4
• Terminal-Bench v4.0 — Claude Fable 5.1 52,0 vs. GPT-6 Astra 59,1
• Langkontext-Erinnerung — Claude Fable 5.1 85,3 vs. GPT-6 Astra 80,7
• Kontext und Ausgabe — beide 1.000.000 Tokens Eingabe für Fable 5.1 gegenüber 1.050.000 für Astra; beide 128.000 Tokens Ausgabe
Das Muster ist nicht „ein Modell ist besser“. Fable 5.1 gewinnt die zwei Boards, die für Schreiben und langfristige Softwarearbeit stehen – SciCode und Terminal-Bench 2.1 –, und Astra gewinnt Terminal-Bench 4.0 und GPQA Diamond. Fable 5.1 hat einen Vorsprung von 4,4 Punkten bei Humanity's Last Exam und einen Vorsprung von 4,6 Punkten bei Long-Context-Recall. Im allgemeinen Index liegen die beiden 0,7 Punkte auseinander, was innerhalb des Rauschens liegt, das man bei einer Benchmark-Aktualisierung erwarten würde.
Ein Vorbehalt gilt für jede modellübergreifende Zahl in diesem Beitrag, und es lohnt sich, ihn auszusprechen, statt ihn zu verschweigen: Artificial Analysis garantiert nicht, dass zwei Modellseiten am selben Tag gegen denselben Index dargestellt werden, und das Unternehmen teilt seine Vergleichsgruppen inzwischen auf – Open-Weights-Modelle werden gegen Open-Weights-Modelle derselben Größenklasse eingestuft, proprietäre Modelle gegen ein proprietäres Preisband. Ein von einer Seite abgelesener Wert und ein von einer anderen Seite abgelesener Wert sind indikativ, keine kontrollierte Messung. Beide obigen Zahlen stammen vom selben Evaluator, doch die Unterschiede unterhalb eines Punkts sollten als Richtung而非 Präzision behandelt werden.
Die Komplikation, die am 29. September eintraf
Wenn Sie diesen Vergleich vor einem Monat kalkuliert hätten, hätten Sie Astra eingesetzt, ein 4,7-Punkte-Programmierdefizit akzeptiert und 10,00 $ / 50,00 $ dafür bezahlt. Das ist nicht mehr die naheliegende Wahl, weil GPT-6.1 Sol existiert — veröffentlicht am 29. September 2026, drei Wochen nach Astra und eine Woche nach dem Rest der Familie.
GPT-6.1 Sol erreicht 51,8 auf demselben Artificial Analysis Intelligence Index, gegenüber Astras 52,7, und es wird für 2,00 $ / 10,00 $ gelistet — ein Fünftel von Astras Preisliste. Es ist auch kein Spitzenreiter auf der Coding-Bestenliste; es weist dasselbe Muster auf, einen Punkt unter Astra zu liegen, statt die Lücke zu Fable 5.1 zu schließen. Aber es verändert die Ökonomie der Entscheidung. Wenn der Grund, aus dem Sie zu einem Modell mit 50 $ Output-Kosten gegriffen haben, „Ich brauche Frontier-Reasoning für eine schwierige Aufgabe“ war, dann deckt GPT-6.1 Sol jetzt das meiste davon für ein Zehntel der Output-Kosten ab. Wenn der Grund speziell „Ich brauche den besten Coding-Index im Raum“ war, beantwortet keines der GPT-6-Modelle das, und der ehrliche Rat lautet, Fable 5.1 zu behalten.
Es lohnt sich, ausdrücklich festzuhalten: OpenAI hat nie einen Vergleich zwischen GPT-6 Astra und Claude Fable 5.1 veröffentlicht, und Anthropic hat ebenso wenig einen Vergleich zwischen Fable-5.1 und GPT-6 veröffentlicht. Jede anbieterübergreifende Zahl in diesem Beitrag ist entweder eine Zahl eines unabhängigen Evaluators oder ein Benchmark eines Anbieters für sein eigenes Modell. Nichts hier ist ein direkter Vergleich, der von einer der beiden Parteien durchgeführt wurde.
Die Rechnung, nicht der Aufkleber
Identische Tarifkarten erzeugen keine identischen Rechnungen, weil die darunterliegenden Zähler unterschiedlich sind.
• Zwischengespeicherte Eingabe, Fable 5.1 — 0,25 $ pro Million im OrcaRouter-Listing, ein Rabatt von 97,5 % auf den Eingabetarif
• Zwischengespeicherte Eingabe, GPT-6 Astra — 1,00 $ pro Million, ein Rabatt von 90 %
• Cache-Schreibvorgänge — Fable 5.1 12,50 $ pro Million, GPT-6 Astra 12,50 $ pro Million, exakt gleichauf
• Über 272.000 Eingabe-Tokens — rechnet Astra die gesamte Anfrage auf 20,00 $ in / 75,00 $ out um; Fable 5.1 hat keine entsprechende Stufe bei dem Wert, den der Katalog führt
• Traffic, letzte 7 Tage — Fable 5.1 1,73 Millionen Tokens; GPT-6 Astra 76,2 Millionen Tokens
• Median-Zeit bis zum ersten Token — Fable 5.1 4.055 ms; GPT-6 Astra 3.500 ms
• Mediane Ausgabegeschwindigkeit — Fable 5.1 90,1 Tokens/s; GPT-6 Astra 70,4 Tokens/s
Die Cache-Zeile ist diejenige, die bei einer Fable-5.1-förmigen Workload das Geld bewegt. Ein langer Agentenlauf, der denselben Repository-Kontext mit 200.000 Token zwanzig Mal erneut sendet, zahlt für den gecachten Anteil 0,25 $ pro Million statt 10,00 $ — eine Größenordnung günstiger als Astras gecachter Lesevorgang für 1,00 $. Bei dieser Form von Anfrage ist die identische Headline-Karte keineswegs identisch, und der Coding-Vorteil von Fable 5.1 geht mit einer günstigeren Möglichkeit einher, ihn zu nutzen.
Die 272K-Stufe bewirkt bei Astra das Gegenteil. Jede Anfrage, die sie überschreitet, wird ab dem ersten Token neu bepreist, sodass ein Prompt mit 300.000 Token auf Astra mit $20.00 / $75.00 für das Ganze abgerechnet wird, nicht nur für die 28.000 Token über der Grenze. Bei einem Budget-Modell ist diese Stufe ein Rundungsfehler; bei $10.00 Input ist sie der Unterschied zwischen einer $3.00-Anfrage und einer $6.00-Anfrage.
Beide laufen lassen, ohne im Voraus einen Gewinner zu küren
Die praktische Version dieses Vergleichs ist, dass Sie wahrscheinlich beide wollen, und dass Sie in der Lage sein wollen, pro Anfrage statt pro Quartal zwischen ihnen zu wechseln. Sowohl Claude Fable 5.1 als auch jedes Live-GPT-6-Modell sitzen im selben OrcaRouter-Katalog — eine API vor über 200 Modellen, der Listenpreis des Anbieters wird mit 0 % Aufschlag durchgereicht, sodass eine Preisänderung eines Anbieters hier noch am selben Tag live ist statt erst auf Ihrer nächsten Rechnung — und die Routing-DSL lässt Sie den Datenverkehr nach Anfragegröße oder nach Anteil aufteilen. Die Form, die zu diesem Paar passt, ist eine Aufteilung nach Größe: Senden Sie kurze, coding-förmige Anfragen an Claude Fable 5.1 und leiten Sie die langkontextigen Arbeiten, die den 272K-Schritt von Astra auslösen würden, an ein Modell weiter, dessen Tarifkarte keinen Schritt enthält, und erweitern Sie dann den Anteil, den Ihre eigenen Evaluierungen bevorzugen.
Automatisches Failover über Anbieter hinweg ist die andere Hälfte davon. Keines dieser Modelle ist gegen einen schlechten Nachmittag gefeit, und eine Route, die mitten im Lauf degradiert, ist nichts, was man aus einer Kundenbeschwerde erfahren möchte.

Wozu jede Seite dient, jeweils in einer Zeile
Claude Fable 5.1 ist das beste Coding-Modell auf dem unabhängigen Board und ist als Premium-Tier eingepreist, mit den günstigsten gecachten Reads aller Modelle in dieser Preisklasse. Die GPT-6-Familie hat kein Mitglied, das es beim Coding schlägt, und das Familienmitglied, das dieselbe Preisliste teilt – Astra –, ist dasjenige, das du jetzt am wenigsten wahrscheinlich wählen wirst, weil GPT-6.1 Sol bis auf einen Punkt an Astras Index heranreicht – für ein Fünftel des Geldes.
Die Antwort auf „GPT-6 vs. Claude Fable 5.1“ hängt also ganz davon ab, welches GPT-6 du gemeint hast. Wenn du das Flaggschiff der Familie gemeint hast, gewinnt Fable 5.1 das Coding-Board und verliert beim Preis pro Antwort gegen ein Modell eine Stufe darunter. Wenn du die Familie als Ganzes gemeint hast, dann ist der derzeit beste Gegenwert auf der OpenAI-Seite dieses Duells GPT-6.1 Sol bei 2,00 $ / 10,00 $ – und es ist immer noch nicht der Coding-Spitzenreiter. Die Tarifkarten stimmen überein. Die Ranglisten nicht.


In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
