Wygenerowana karta tytułowa z napisem „GPT-6 vs Claude Fable 5.1”, z plakietką o treści „Oba: $10.00 za wejście / $50.00 za wyjście za milion” oraz plakietką o treści „AA Coding: Fable 5.1 81.6 vs GPT-6 Astra 76.9”, a także stopką o treści „Wartości indeksu według Artificial Analysis; cenniki ze stron poszczególnych dostawców”. Logo OrcaRouter jest wkomponowane w prawym dolnym rogu.
Guides & Insights

GPT-6 kontra Claude Fable 5.1: Cenniki się zgadzają, ranking kodowania już nie

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

GPT-6 i Claude Fable 5.1 mają dokładnie tę samą stawkę: 10,00 USD za milion tokenów wejściowych i 50,00 USD za milion tokenów wyjściowych. To jest cała łatwa część. Te dwie nazwy nie oznaczają tego samego rodzaju rzeczy — GPT-6 to rodzina trzech modeli, za którą nie stoi żaden gpt-6 endpoint, a Claude Fable 5.1 to jeden wymierny model z jedną kartą stawek — więc zgodność cen prawie nic ci nie mówi, dopóki nie zdecydujesz, który członek rodziny GPT-6 udziela odpowiedzi. W zestawieniu, które ma największe znaczenie dla tego przedziału, Fable 5.1 jest pierwszy, a żaden model GPT-6 nie jest.

Który GPT-6 pojawia się w tym porównaniu?

Zacznijmy od nazewnictwa, bo to ono decyduje o odpowiedzi. OpenAI dostarcza generację GPT-6 jako trzy osobne identyfikatory modeli: GPT-6 Astra na szczycie, GPT-6 Sol w środku i GPT-6 Luna na dole. Nie istnieje model o nazwie GPT-6, który możesz wywołać. Poproś o openai/gpt-6 na dowolnej bramie, a otrzymasz 404, a nie uzupełnienie.

Tylko jeden z trzech ma cennik 10,00 USD / 50,00 USD odpowiadający Claude Fable 5.1, i jest nim Astra. Sol kosztuje jedną piątą tej ceny, czyli 2,00 USD / 10,00 USD, a Luna jedną setną, czyli 0,10 USD / 0,50 USD. Zatem „GPT-6 vs Claude Fable 5.1” to tak naprawdę „GPT-6 Astra vs Claude Fable 5.1”, jeśli upierasz się przy porównywaniu porównywalnych cenników — a ten konkretny pojedynek nie jest już interesujący z powodu, który pojawił się dopiero pod koniec września.

Po stronie Anthropic nie ma takiej dwuznaczności. Claude Fable 5.1 to pojedynczy model, wydany 1 września 2026 r., z oknem kontekstu wynoszącym 1 000 000 tokenów, limitem wyjścia 128 000 tokenów oraz wejściem tekstowym, obrazowym i plikowym. Jest udostępniany pod identyfikatorem modelu anthropic/claude-fable-5.1. Podanie ceny za „Fable 5.1” jest jednoznaczne w sposób, w jaki podanie ceny za „GPT-6” nigdy nie jest.

Gdzie Fable 5.1 faktycznie przoduje i o ile

Różnica, która rozstrzyga to porównanie, to nie ogólny indeks. To tablica kodowania. Odczytane z Artificial Analysis i zamieszczone we wpisie katalogowym OrcaRouter dla każdego modelu na dzień 8 października 2026:

• AA Coding Index — Claude Fable 5.1 81,6, który zajął 1. miejsce wśród modeli na tej liście rankingowej; GPT-6 Astra 76,9, który zajął 4. miejsce
• AA Intelligence Index — Claude Fable 5.1 53,4 – 8. miejsce; GPT-6 Astra 52,7 – 9. miejsce
• GPQA Diamond — Claude Fable 5.1 93,7 vs GPT-6 Astra 96,1
• Humanity's Last Exam — Claude Fable 5.1 59,1 vs GPT-6 Astra 54,7
• SciCode — Claude Fable 5.1 63,1 vs GPT-6 Astra 56,5
• Terminal-Bench v2.1 — Claude Fable 5.1 91,4 vs GPT-6 Astra 88,4
• Terminal-Bench v4.0 — Claude Fable 5.1 52,0 vs GPT-6 Astra 59,1
• Przywoływanie długiego kontekstu — Claude Fable 5.1 85,3 vs GPT-6 Astra 80,7
• Kontekst i wyjście — 1 000 000 tokenów wejściowych dla Fable 5.1 w porównaniu z 1 050 000 dla Astry; oba po 128 000 tokenów wyjściowych

Nie chodzi o wzorzec „jeden model jest lepszy”. Fable 5.1 wygrywa dwa rankingi odpowiadające pisaniu i długoterminowej pracy nad oprogramowaniem — SciCode i Terminal-Bench 2.1 — a Astra wygrywa Terminal-Bench 4.0 i GPQA Diamond. Fable 5.1 ma 4,4 punktu przewagi w Humanity's Last Exam i 4,6 punktu przewagi w przywoływaniu długiego kontekstu. W indeksie ogólnym różnica między nimi wynosi 0,7 punktu, co mieści się w szumie, jakiego można oczekiwać po odświeżeniu benchmarku.

Jedno zastrzeżenie dotyczy każdej liczby porównującej modele w tym artykule i warto je podać wprost, a nie ukrywać: Artificial Analysis nie gwarantuje, że dwie strony modeli są renderowane na podstawie tej samej wersji indeksu tego samego dnia, a obecnie dzieli swoje grupy porównawcze — modele open-weights są klasyfikowane względem modeli open-weights tej samej klasy rozmiarowej, a modele własnościowe względem przedziału cenowego dla modeli własnościowych. Wynik odczytany z jednej strony i wynik odczytany z innej strony mają charakter orientacyjny, a nie są kontrolowanym pomiarem. Obie wartości powyżej pochodzą od tego samego ewaluatora, ale różnice poniżej jednego punktu należy traktować jako wskazanie kierunku, a nie jako miarę precyzji.

Komplikacja, która pojawiła się 29 września

Gdybyś miesiąc temu wycenił to porównanie, postawiłbyś na Astrę, zaakceptowałbyś 4,7-punktowy deficyt w kodowaniu i zapłaciłbyś za nią 10,00 / 50,00 USD. To już nie jest oczywisty wybór, ponieważ GPT-6.1 Sol istnieje — wydany 29 września 2026, trzy tygodnie po Astrze i tydzień po pozostałej części rodziny.

GPT-6.1 Sol uzyskuje wynik 51,8 w tym samym Artificial Analysis Intelligence Index, podczas gdy Astra osiąga 52,7, a jego cena katalogowa wynosi 2,00 / 10,00 USD — jedną piątą cennika Astry. Nie jest też liderem w rankingu kodowania; odziedziczył ten sam profil wyniku o punkt poniżej Astry, zamiast zmniejszyć lukę do Fable 5.1. Ale zmienia to ekonomię decyzji. Jeśli powodem, dla którego sięgałeś po model z kosztem wyjścia 50 USD, było „potrzebuję rozumowania na najwyższym poziomie do trudnego zadania”, GPT-6.1 Sol odpowiada teraz na większość tego za jedną dziesiątą kosztu wyjścia. Jeśli powodem było konkretnie „potrzebuję najlepszego indeksu kodowania wśród dostępnych modeli”, żaden z modeli GPT-6 nie odpowiada na to, a uczciwa rada brzmi: zostań przy Fable 5.1.

Warto wyraźnie ustalić: OpenAI nigdy nie opublikowało porównania GPT-6 Astra z Claude Fable 5.1, a Anthropic również nie opublikowało porównania Fable-5.1 z GPT-6. Każda liczba między dostawcami w tym tekście pochodzi albo od niezależnego ewaluatora, albo z własnego benchmarku dostawcy dotyczącego jego własnego modelu. Nic tutaj nie jest bezpośrednim testem porównawczym przeprowadzonym przez żadną ze stron.

Rachunek, a nie naklejka.

Identyczne cenniki nie generują identycznych faktur, ponieważ liczniki pod nimi się różnią.

• Wejście z pamięci podręcznej, Fable 5.1 — 0,25 USD za milion w ofercie OrcaRouter, czyli 97,5% zniżki względem stawki za wejście
• Wejście z pamięci podręcznej, GPT-6 Astra — 1,00 USD za milion, czyli 90% zniżki
• Zapisy do pamięci podręcznej — Fable 5.1 12,50 USD za milion, GPT-6 Astra 12,50 USD za milion, dokładnie tyle samo
• Powyżej 272 000 tokenów wejściowych — Astra przelicza całe żądanie na 20,00 USD za wejście / 75,00 USD za wyjście; Fable 5.1 nie ma odpowiednika takiego progu w wartości podanej w katalogu
• Ruch, ostatnie 7 dni — Fable 5.1 1,73 mln tokenów; GPT-6 Astra 76,2 mln tokenów
• Mediana czasu do pierwszego tokena — Fable 5.1 4055 ms; GPT-6 Astra 3500 ms
• Mediana szybkości generowania — Fable 5.1 90,1 tokena/s; GPT-6 Astra 70,4 tokena/s

W obciążeniu o kształcie Fable 5.1 to linia cache decyduje o pieniądzach. Długie uruchomienie agenta, które dwadzieścia razy ponownie wysyła ten sam kontekst repozytorium o rozmiarze 200 000 tokenów, płaci 0,25 USD za milion za część objętą cache zamiast 10,00 USD — o rząd wielkości taniej niż 1,00 USD za odczyt z cache w Astra. Przy takim kształcie żądania identyczna karta ofertowa wcale nie jest identyczna, a przewaga Fable 5.1 w kodowaniu wiąże się z tańszym sposobem jej wykorzystania.

Próg 272K działa odwrotnie w przypadku Astry. Każde żądanie, które go przekroczy, jest ponownie wyceniane od pierwszego tokena, więc prompt o 300 000 tokenów na Astrze jest rozliczany po $20,00 / $75,00 za całość, a nie tylko za 28 000 tokenów powyżej progu. W modelu budżetowym ten próg to błąd zaokrąglenia; przy cenie wejściowej $10,00 to różnica między żądaniem za $3,00 a żądaniem za $6,00.

Uruchamianie obu bez wcześniejszego wybierania zwycięzcy

Praktyczny wymiar tego porównania jest taki, że prawdopodobnie chcesz mieć oba rozwiązania i chcesz móc przełączać się między nimi przy każdym żądaniu, a nie raz na kwartał. Zarówno Claude Fable 5.1, jak i każdy aktywny model GPT-6znajdują się w tym samym katalogu OrcaRouter — jedno API przed ponad 200 modelami, cena katalogowa dostawcy przekazywana dalej bez marży (0%), więc zmiana ceny u dostawcy obowiązuje tu już tego samego dnia, a nie dopiero na następnej fakturze — a DSL routingu pozwala dzielić ruch według rozmiaru żądania lub według udziału. Układ, który pasuje do tej pary, to podział według rozmiaru: krótkie żądania o charakterze programistycznym kieruj do Claude Fable 5.1, a zadania z długim kontekstem, które przekroczyłyby próg 272K w Astra, kieruj do modelu, którego cennik nie ma żadnego progu, a następnie poszerz ten wycinek, któremu sprzyjają Twoje własne ewaluacje.

Automatyczne przełączanie awaryjne między dostawcami to druga połowa tego. Żaden z tych modeli nie jest odporny na gorszy dzień, a trasa, która pogarsza się w trakcie działania, nie jest czymś, o czym chcesz się dowiedzieć ze skargi klienta.

A generated two-column comparison scoreboard titled "GPT-6 Astra vs Claude Fable 5.1 — the scoreboard". The left column, GPT-6 Astra, reads Input $10.00, Output $50.00, AA Intelligence 52.7, AA Coding 76.9, Context 1,050,000, Cached input $1.00. The right column, Claude Fable 5.1, reads Input $10.00, Output $50.00, AA Intelligence 53.4, AA Coding 81.6, Context 1,000,000, Cached input $0.25. A footer line reads "Index figures per Artificial Analysis; rate cards per each vendor page, read 8 Oct 2026." The OrcaRouter logo is composited in the bottom-right corner.

Do czego służy każda strona — po jednej linii na każdą

Claude Fable 5.1 to najlepszy model do kodowania w niezależnym rankingu, a jego cena plasuje go w półce premium, z najtańszymi odczytami z pamięci podręcznej spośród wszystkich modeli w tym przedziale. Rodzina GPT-6 nie ma członka, który przebiłby go w kodowaniu, a członek rodziny dzielący z nim cennik — Astra — jest tym, którego teraz najrzadziej wybierzesz, ponieważ GPT-6.1 Sol osiąga wynik w granicach jednego punktu od indeksu Astry za jedną piątą kosztu.

Więc odpowiedź na „GPT-6 vs Claude Fable 5.1” zależy w całości od tego, który GPT-6 masz na myśli. Jeśli chodziło Ci o flagowy model rodziny, Fable 5.1 wygrywa w rankingu kodowania, ale przegrywa pod względem ceny za odpowiedź z modelem o jeden poziom niżej. Jeśli chodziło Ci o całą rodzinę, to obecnie najlepszym stosunkiem jakości do ceny po stronie OpenAI w tej parze jest GPT-6.1 Sol w cenie $2.00 / $10.00 — i nadal nie jest liderem w kodowaniu. Cenniki się zgadzają. Rankingi nie.

Screenshot of the OrcaRouter model page for anthropic/claude-fable-5.1, showing the Anthropic vendor label, a 2026-09-01 catalogue release date, a 1,000,000-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $10.00 per million input, $50.00 per million output, a 4.05 s median time to first token, a 10.00 s p95, and 1.7M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the OpenAI vendor label, a 2026-09-04 catalogue release date, a 1,050,000-token context window (shown as ctx 1M tokens), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, a 'Best for reasoning, coding, agentic' tag row, and a rate strip reading $10.00 per million input, $50.00 per million output, a 3.50 s median time to first token, a 10.00 s p95, and 76.2M tokens routed in seven days.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie