Generierte Titelkarte mit der Aufschrift „GPT-6 vs. Claude Fable 5.1“, mit einem Chip mit der Aufschrift „Beide 10,00 $ Input / 50,00 $ Output pro Million“ und einem Chip mit der Aufschrift „AA Coding: Fable 5.1 81,6 vs. GPT-6 Astra 76,9“, und einer Fußzeile mit der Aufschrift „Indexwerte laut Artificial Analysis; Preislisten von der jeweiligen Anbieterseite.“ Das OrcaRouter-Logo ist in die untere rechte Ecke eingefügt.
Guides & Insights

GPT-6 vs. Claude Fable 5.1: Die Preislisten stimmen überein, das Coding-Board nicht.

Autor

Alistair Wren

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

GPT-6 und Claude Fable 5.1 sind mit genau demselben Tarif gelistet: 10,00 $ pro Million Eingabe-Tokens und 50,00 $ pro Million Ausgabe-Tokens. Das ist der ganze einfache Teil. Die beiden Namen bezeichnen nicht dieselbe Art von Sache — GPT-6 ist eine Familie von drei Modellen, hinter der kein gpt-6-Endpunkt steht, und Claude Fable 5.1 ist ein einziges wägbares Modell mit einer einzigen Preistabelle — die Preisübereinstimmung sagt Ihnen also fast nichts, bis Sie entscheiden, welches Mitglied der GPT-6-Familie die Antwort liefert. In der Rangliste, die für diese Preisklasse am wichtigsten ist, steht Fable 5.1 an erster Stelle, und kein GPT-6-Modell steht dort.

Welcher GPT-6 taucht in diesem Vergleich auf?

Beginnen wir mit der Benennung, denn sie entscheidet über die Antwort. OpenAI veröffentlicht die GPT-6-Generation als drei separate Modell-IDs: GPT-6 Astra an der Spitze, GPT-6 Sol in der Mitte und GPT-6 Luna am unteren Ende. Es gibt kein Modell namens GPT-6, das man aufrufen kann. Fragt man openai/gpt-6 bei einem beliebigen Gateway an, bekommt man einen 404, keine Completion.

Nur einer der drei trägt die $10.00 / $50.00-Karte, die zu Claude Fable 5.1 passt, und das ist Astra. Sol ist mit $2.00 / $10.00 ein Fünftel des Preises und Luna mit $0.10 / $0.50 ein Hundertstel davon. „GPT-6 vs. Claude Fable 5.1“ ist also eigentlich „GPT-6 Astra vs. Claude Fable 5.1“, wenn man unbedingt vergleichbare Preiskarten gegenüberstellen will – und genau dieser Vergleich ist nicht mehr der interessante, aus einem Grund, der erst Ende September auftauchte.

Auf der Seite von Anthropic gibt es keine solche Mehrdeutigkeit. Claude Fable 5.1 ist ein einzelnes Modell, veröffentlicht am 1. September 2026, mit einem Kontextfenster von 1.000.000 Token, einer Obergrenze von 128.000 Token für die Ausgabe und Text-, Bild- und Dateieingabe. Es wird unter der Modell-ID anthropic/claude-fable-5.1 bereitgestellt. Die Nennung eines Preises für „Fable 5.1“ ist eindeutig, und zwar in einer Weise, wie die Nennung eines Preises für „GPT-6“ es nie ist.

Wo Fable 5.1 tatsächlich vorn liegt – und um wie viel

Der Abstand, der diesen Vergleich entscheidet, ist nicht der allgemeine Index. Es ist das Coding-Board. Abgelesen bei Artificial Analysis und im OrcaRouter-Katalogeintrag für jedes Modell am 8. Oktober 2026 geführt:

• AA Coding Index — Claude Fable 5.1 81,6, auf Platz 1 der Modelle in dieser Rangliste; GPT-6 Astra 76,9, auf Platz 4
• AA Intelligence Index — Claude Fable 5.1 53,4, Rang 8; GPT-6 Astra 52,7, Rang 9
• GPQA Diamond — Claude Fable 5.1 93,7 vs. GPT-6 Astra 96,1
• Humanity's Last Exam — Claude Fable 5.1 59,1 vs. GPT-6 Astra 54,7
• SciCode — Claude Fable 5.1 63,1 vs. GPT-6 Astra 56,5
• Terminal-Bench v2.1 — Claude Fable 5.1 91,4 vs. GPT-6 Astra 88,4
• Terminal-Bench v4.0 — Claude Fable 5.1 52,0 vs. GPT-6 Astra 59,1
• Langkontext-Erinnerung — Claude Fable 5.1 85,3 vs. GPT-6 Astra 80,7
• Kontext und Ausgabe — beide 1.000.000 Tokens Eingabe für Fable 5.1 gegenüber 1.050.000 für Astra; beide 128.000 Tokens Ausgabe

Das Muster ist nicht „ein Modell ist besser“. Fable 5.1 gewinnt die zwei Boards, die für Schreiben und langfristige Softwarearbeit stehen – SciCode und Terminal-Bench 2.1 –, und Astra gewinnt Terminal-Bench 4.0 und GPQA Diamond. Fable 5.1 hat einen Vorsprung von 4,4 Punkten bei Humanity's Last Exam und einen Vorsprung von 4,6 Punkten bei Long-Context-Recall. Im allgemeinen Index liegen die beiden 0,7 Punkte auseinander, was innerhalb des Rauschens liegt, das man bei einer Benchmark-Aktualisierung erwarten würde.

Ein Vorbehalt gilt für jede modellübergreifende Zahl in diesem Beitrag, und es lohnt sich, ihn auszusprechen, statt ihn zu verschweigen: Artificial Analysis garantiert nicht, dass zwei Modellseiten am selben Tag gegen denselben Index dargestellt werden, und das Unternehmen teilt seine Vergleichsgruppen inzwischen auf – Open-Weights-Modelle werden gegen Open-Weights-Modelle derselben Größenklasse eingestuft, proprietäre Modelle gegen ein proprietäres Preisband. Ein von einer Seite abgelesener Wert und ein von einer anderen Seite abgelesener Wert sind indikativ, keine kontrollierte Messung. Beide obigen Zahlen stammen vom selben Evaluator, doch die Unterschiede unterhalb eines Punkts sollten als Richtung而非 Präzision behandelt werden.

Die Komplikation, die am 29. September eintraf

Wenn Sie diesen Vergleich vor einem Monat kalkuliert hätten, hätten Sie Astra eingesetzt, ein 4,7-Punkte-Programmierdefizit akzeptiert und 10,00 $ / 50,00 $ dafür bezahlt. Das ist nicht mehr die naheliegende Wahl, weil GPT-6.1 Sol existiert — veröffentlicht am 29. September 2026, drei Wochen nach Astra und eine Woche nach dem Rest der Familie.

GPT-6.1 Sol erreicht 51,8 auf demselben Artificial Analysis Intelligence Index, gegenüber Astras 52,7, und es wird für 2,00 $ / 10,00 $ gelistet — ein Fünftel von Astras Preisliste. Es ist auch kein Spitzenreiter auf der Coding-Bestenliste; es weist dasselbe Muster auf, einen Punkt unter Astra zu liegen, statt die Lücke zu Fable 5.1 zu schließen. Aber es verändert die Ökonomie der Entscheidung. Wenn der Grund, aus dem Sie zu einem Modell mit 50 $ Output-Kosten gegriffen haben, „Ich brauche Frontier-Reasoning für eine schwierige Aufgabe“ war, dann deckt GPT-6.1 Sol jetzt das meiste davon für ein Zehntel der Output-Kosten ab. Wenn der Grund speziell „Ich brauche den besten Coding-Index im Raum“ war, beantwortet keines der GPT-6-Modelle das, und der ehrliche Rat lautet, Fable 5.1 zu behalten.

Es lohnt sich, ausdrücklich festzuhalten: OpenAI hat nie einen Vergleich zwischen GPT-6 Astra und Claude Fable 5.1 veröffentlicht, und Anthropic hat ebenso wenig einen Vergleich zwischen Fable-5.1 und GPT-6 veröffentlicht. Jede anbieterübergreifende Zahl in diesem Beitrag ist entweder eine Zahl eines unabhängigen Evaluators oder ein Benchmark eines Anbieters für sein eigenes Modell. Nichts hier ist ein direkter Vergleich, der von einer der beiden Parteien durchgeführt wurde.

Die Rechnung, nicht der Aufkleber

Identische Tarifkarten erzeugen keine identischen Rechnungen, weil die darunterliegenden Zähler unterschiedlich sind.

• Zwischengespeicherte Eingabe, Fable 5.1 — 0,25 $ pro Million im OrcaRouter-Listing, ein Rabatt von 97,5 % auf den Eingabetarif
• Zwischengespeicherte Eingabe, GPT-6 Astra — 1,00 $ pro Million, ein Rabatt von 90 %
• Cache-Schreibvorgänge — Fable 5.1 12,50 $ pro Million, GPT-6 Astra 12,50 $ pro Million, exakt gleichauf
• Über 272.000 Eingabe-Tokens — rechnet Astra die gesamte Anfrage auf 20,00 $ in / 75,00 $ out um; Fable 5.1 hat keine entsprechende Stufe bei dem Wert, den der Katalog führt
• Traffic, letzte 7 Tage — Fable 5.1 1,73 Millionen Tokens; GPT-6 Astra 76,2 Millionen Tokens
• Median-Zeit bis zum ersten Token — Fable 5.1 4.055 ms; GPT-6 Astra 3.500 ms
• Mediane Ausgabegeschwindigkeit — Fable 5.1 90,1 Tokens/s; GPT-6 Astra 70,4 Tokens/s

Die Cache-Zeile ist diejenige, die bei einer Fable-5.1-förmigen Workload das Geld bewegt. Ein langer Agentenlauf, der denselben Repository-Kontext mit 200.000 Token zwanzig Mal erneut sendet, zahlt für den gecachten Anteil 0,25 $ pro Million statt 10,00 $ — eine Größenordnung günstiger als Astras gecachter Lesevorgang für 1,00 $. Bei dieser Form von Anfrage ist die identische Headline-Karte keineswegs identisch, und der Coding-Vorteil von Fable 5.1 geht mit einer günstigeren Möglichkeit einher, ihn zu nutzen.

Die 272K-Stufe bewirkt bei Astra das Gegenteil. Jede Anfrage, die sie überschreitet, wird ab dem ersten Token neu bepreist, sodass ein Prompt mit 300.000 Token auf Astra mit $20.00 / $75.00 für das Ganze abgerechnet wird, nicht nur für die 28.000 Token über der Grenze. Bei einem Budget-Modell ist diese Stufe ein Rundungsfehler; bei $10.00 Input ist sie der Unterschied zwischen einer $3.00-Anfrage und einer $6.00-Anfrage.

Beide laufen lassen, ohne im Voraus einen Gewinner zu küren

Die praktische Version dieses Vergleichs ist, dass Sie wahrscheinlich beide wollen, und dass Sie in der Lage sein wollen, pro Anfrage statt pro Quartal zwischen ihnen zu wechseln. Sowohl Claude Fable 5.1 als auch jedes Live-GPT-6-Modell sitzen im selben OrcaRouter-Katalog — eine API vor über 200 Modellen, der Listenpreis des Anbieters wird mit 0 % Aufschlag durchgereicht, sodass eine Preisänderung eines Anbieters hier noch am selben Tag live ist statt erst auf Ihrer nächsten Rechnung — und die Routing-DSL lässt Sie den Datenverkehr nach Anfragegröße oder nach Anteil aufteilen. Die Form, die zu diesem Paar passt, ist eine Aufteilung nach Größe: Senden Sie kurze, coding-förmige Anfragen an Claude Fable 5.1 und leiten Sie die langkontextigen Arbeiten, die den 272K-Schritt von Astra auslösen würden, an ein Modell weiter, dessen Tarifkarte keinen Schritt enthält, und erweitern Sie dann den Anteil, den Ihre eigenen Evaluierungen bevorzugen.

Automatisches Failover über Anbieter hinweg ist die andere Hälfte davon. Keines dieser Modelle ist gegen einen schlechten Nachmittag gefeit, und eine Route, die mitten im Lauf degradiert, ist nichts, was man aus einer Kundenbeschwerde erfahren möchte.

A generated two-column comparison scoreboard titled "GPT-6 Astra vs Claude Fable 5.1 — the scoreboard". The left column, GPT-6 Astra, reads Input $10.00, Output $50.00, AA Intelligence 52.7, AA Coding 76.9, Context 1,050,000, Cached input $1.00. The right column, Claude Fable 5.1, reads Input $10.00, Output $50.00, AA Intelligence 53.4, AA Coding 81.6, Context 1,000,000, Cached input $0.25. A footer line reads "Index figures per Artificial Analysis; rate cards per each vendor page, read 8 Oct 2026." The OrcaRouter logo is composited in the bottom-right corner.

Wozu jede Seite dient, jeweils in einer Zeile

Claude Fable 5.1 ist das beste Coding-Modell auf dem unabhängigen Board und ist als Premium-Tier eingepreist, mit den günstigsten gecachten Reads aller Modelle in dieser Preisklasse. Die GPT-6-Familie hat kein Mitglied, das es beim Coding schlägt, und das Familienmitglied, das dieselbe Preisliste teilt – Astra –, ist dasjenige, das du jetzt am wenigsten wahrscheinlich wählen wirst, weil GPT-6.1 Sol bis auf einen Punkt an Astras Index heranreicht – für ein Fünftel des Geldes.

Die Antwort auf „GPT-6 vs. Claude Fable 5.1“ hängt also ganz davon ab, welches GPT-6 du gemeint hast. Wenn du das Flaggschiff der Familie gemeint hast, gewinnt Fable 5.1 das Coding-Board und verliert beim Preis pro Antwort gegen ein Modell eine Stufe darunter. Wenn du die Familie als Ganzes gemeint hast, dann ist der derzeit beste Gegenwert auf der OpenAI-Seite dieses Duells GPT-6.1 Sol bei 2,00 $ / 10,00 $ – und es ist immer noch nicht der Coding-Spitzenreiter. Die Tarifkarten stimmen überein. Die Ranglisten nicht.

Screenshot of the OrcaRouter model page for anthropic/claude-fable-5.1, showing the Anthropic vendor label, a 2026-09-01 catalogue release date, a 1,000,000-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $10.00 per million input, $50.00 per million output, a 4.05 s median time to first token, a 10.00 s p95, and 1.7M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the OpenAI vendor label, a 2026-09-04 catalogue release date, a 1,050,000-token context window (shown as ctx 1M tokens), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, a 'Best for reasoning, coding, agentic' tag row, and a rate strip reading $10.00 per million input, $50.00 per million output, a 3.50 s median time to first token, a 10.00 s p95, and 76.2M tokens routed in seven days.

In diesem Artikel verglichen3

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert