Główna karta tytułowa dla „Claude Fable 5.1 vs Claude Fable 5”: lewy panel „Claude Fable 5.1” (Anthropic, zamknięte API, 10,00 USD / 50,00 USD za 1 mln, AA Intelligence Index 53), a prawy panel „Claude Fable 5” (Anthropic, zamknięte API, 10,00 USD / 50,00 USD za 1 mln, kontekst 1 mln), z nagłówkiem „Ta sama cena. Wyższy pułap możliwości agentowych.” oraz logo OrcaRouter złożonym w prawym dolnym rogu.
Guides & Insights

Claude Fable 5.1 kontra Claude Fable 5: co tak naprawdę daje odświeżenie własnego flagowca Anthropic

Autor

Magnus Corvin

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Claude Fable 5.1 to obecny flagowy model Anth​ropic, wydany 1 września 2026 r., a najważniejszym starciem dla większości zespołów jest to, które samo Anth​ropic stworzyło: Claude Fable 5.1 przeciwko Claude Fable 5, flagowemu modelowi z 9 czerwca, którego zastępuje. Cena jest identyczna — 10,00 USD za milion tokenów wejściowych i 50,00 USD za milion tokenów wyjściowych dla obu — podobnie jak okno kontekstowe o rozmiarze 1 mln tokenów. Zmienił się charakter długotrwałej pracy agentowej: własne dane Anth​ropic pokazują, że Fable 5.1 ponad dwukrotnie przewyższa Fable 5 w swoim najtrudniejszym benchmarku dla agentów naukowych, a doniesienia z tego tygodnia o tym, jak przedsiębiorstwa traktują rodzinę Fable w kwestii przechowywania danych, nadają odświeżonej wersji drugi, ostrzejszy atut dla każdego, kto dziś wybiera między nimi.

Na wstępie uwaga o datach i źródłach: Claude Fable 5.1 został udostępniony 1 września, więc sam model ma już dwa tygodnie, a nie jest to wiadomość z ostatniej chwili. Aktualne jest doniesienie z 14 września 2026 r. — przypisywane The Information — że Nvidia, Palantir i Booz Allen ograniczają korzystanie z rodziny Fable firmy Anthropic z powodu obaw o przechowywanie wrażliwych danych korporacyjnych, oraz że Anthropic wprowadził w czerwcu kroczące 30-dniowe dzienniki użycia na potrzeby monitorowania bezpieczeństwa, z opcją dla klienta samodzielnego przechowywania tych dzienników, „wciąż możliwą do odwołania”. To doniesienie ma przypisane źródło i nie zostało jeszcze niezależnie potwierdzone. Wszystko, co poniżej oznaczono jako zgłoszone przez dostawcę, pochodzi z własnego arkusza benchmarków Anthropic i nie zostało odtworzone przez neutralny podmiot.

Arkusz specyfikacji, wymiar po wymiarze

• Cena — Claude Fable 5.1 10,00 USD za wejście / 50,00 USD za wyjście za 1 mln tokenów, tyle samo co Claude Fable 5. Żadna z cen nie zmieniła się przy odświeżeniu.

• Buforowane wejście — Claude Fable 5.1 0,25 USD za 1 mln tokenów, o 75% mniej niż 1,00 USD w Claude Fable 5. Zapisy do pamięci podręcznej 12,50 USD (5-minutowe) / 20 USD (1-godzinne); tryb wsadowy 5 USD / 25 USD.

• Kontekst i wyjście — oba mają okno wejściowe o pojemności 1M tokenów oraz do 128K tokenów wyjściowych; oba przyjmują na wejściu tekst i obrazy; oba działają w ramach tego samego interfejsu adaptacyjnego rozumowania z regulatorem wysiłku od niskiego do maksymalnego.

• Niezależny wynik — w aktualnej wersji Intelligence Index firmy Artificial Analysis Claude Fable 5.1 osiąga 53, co daje mu pierwsze miejsce wśród 201 śledzonych modeli, z szybkością 67,2 tokena wyjściowego na sekundę i kosztem 7,63 USD na zadanie indeksowe. Wynik indeksu Claude Fable 5 w skali z momentu premiery (62) pochodzi sprzed wrześniowej korekty i nie jest porównywalny, dlatego nie podajemy dla niego liczby w aktualnej skali.

• Benchmarki dostawcy — Anth​ropic podaje, że Claude Fable 5.1 osiąga 52,6% w Terminal-Bench-Science 0.1 wobec 24,7% dla Claude Fable 5; 55,8% w Terminal-Bench 4.0 wobec 42,0%; 31,4% w AutomationBench wobec 17,1%; oraz 73,4% w CursorBench 3.2.0 wobec 70,5%.

• Wydano — Claude Fable 5.1 1 września 2026 r.; Claude Fable 5 9 czerwca 2026 r.

Gdzie odświeżenie jest naprawdę odświeżeniem

Największą sztuczką premiery Fable 5.1 jest to, że nic w cenniku się nie zmieniło, a niemal wszystko w tabeli wyników benchmarków jednak się zmieniło. Zyski koncentrują się w pracy agentowej o długim horyzoncie, wymagającej użycia narzędzi — Terminal-Bench-Science 0.1 ponad dwukrotnie wzrósł z 24,7% do 52,6%, Terminal-Bench 4.0 wspiął się z 42,0% do 55,8%, AutomationBench niemal podwoił się z 17,1% do 31,4%. W Humanity's Last Exam Anthropic podaje 60,9% bez narzędzi i 65,0% z nimi, wobec 57,8% i 63,8% dla Claude Fable 5. Traktuj je jako wskazanie kierunku: to własna tabela dostawcy, a największe pojedyncze twierdzenia liczbowe dotyczą siostrzanego modelu z ograniczonym dostępem, Claude Mythos 5.1, który ma te same wagi, ale za surowszymi zabezpieczeniami.

A two-column scoreboard titled ‘Claude Fable 5.1 vs Claude Fable 5 — the scoreboard’. Left column ‘Claude Fable 5.1’: ‘Price $10.00 / $50.00 per 1M’, ‘Cache read $0.25 per 1M’, ‘Terminal-Bench-Science 0.1: 52.6%’, ‘Terminal-Bench 4.0: 55.8%’, ‘AutomationBench: 31.4%’, ‘CursorBench 3.2.0: 73.4%’. Right column ‘Claude Fable 5’: ‘Price $10.00 / $50.00 per 1M’, ‘Cache read $1.00 per 1M’, ‘Terminal-Bench-Science 0.1: 24.7%’, ‘Terminal-Bench 4.0: 42.0%’, ‘AutomationBench: 17.1%’, ‘CursorBench 3.2.0: 70.5%’. Footer: ‘Benchmarks vendor-reported, per Anthropic’s September 1 announcement. AA figure per Artificial Analysis, current index version.’ The OrcaRouter logo is composited bottom-right.

Drugą dźwignią jest koszt i ma większe znaczenie niż jakikolwiek pojedynczy benchmark. Cena wejścia z pamięci podręcznej spadła z 1,00 USD do 0,25 USD za milion tokenów, a w długich przebiegach agentowych to właśnie ponowne odczytywanie dominuje: dane wyjściowe narzędzi, zawartość plików i poprzednie tury są wysyłane ponownie raz za razem. Anthropic szacuje, że efektywny koszt jest około 25% niższy w typowych obciążeniach rozliczanych za tokeny, a w wysoce agentowych nawet do 45% niższy — to szacunek dostawcy, ale samą zmianę ceny można zweryfikować w cenniku. Agent długoterminowy, który podczas jednego zadania pięćdziesiąt razy ponownie odczytuje kontekst o rozmiarze 100 tys. tokenów, płaci 5,00 USD za odczyty z pamięci podręcznej według cennika Claude Fable 5 i 1,25 USD według Claude Fable 5.1. W przypadku floty agentów ta pozycja przestaje być błędem zaokrąglenia.

Trzecia zmiana jest tą, którą użytkownicy poprzedniej generacji odczuwają najpierw: klasyfikator bezpieczeństwa. Programiści nazwali stare zachowanie „depresją Fable'a” — flagowe pieniądze za wyniki, które były po cichu przekierowywane do słabszego modelu, gdy klasyfikator oznaczał nieszkodliwe żądania. Anthropic twierdzi, że zabezpieczenia cybernetyczne Fable 5.1 powodują teraz około 60% mniej interwencji na sesję Claude Code, a zabezpieczenia biologiczne uruchamiają się o 85% rzadziej przy nieszkodliwych żądaniach niż przy premierze Fable 5. Jeśli Twoje skargi dotyczące modelu z czerwca dotyczyły przekazywania zadań w trakcie ich wykonywania, to jest aktualizacja, która je bezpośrednio rozwiązuje.

Historia retencji z tego tygodnia i co robi z decyzją

Doniesienia z 14 września to element, który zmienia kalkulację dla przedsiębiorstw, ponieważ rodzina Fable to miejsce, w którym znajduje się najbardziej zaawansowany model Anthropic — i ponieważ podejście do retencji danych to dokładnie ten rodzaj kwestii, którego regulowany nabywca nie może lekceważyć. Jak donoszono, Anthropic wprowadził w czerwcu kroczące 30-dniowe dzienniki użycia do monitorowania bezpieczeństwa; klientom powiedziano, że zamiast tego mogą samodzielnie przechowywać te dzienniki; a doniesienia mówią, że ta opcja „wciąż może zostać cofnięta”. Palantir jest opisywany jako wstrzymujący Fable do czasu uzyskania nieodwołalnych gwarancji zerowej retencji danych, Nvidia jako ograniczająca Fable do mniej wrażliwych zadań, a Booz Allen jako wykluczająca go z zastrzeżonych prac w zakresie cyberbezpieczeństwa. Wszystko to są doniesienia powołujące się na źródła, żadne z nich nie zostało potwierdzone przez wymienione firmy, a jego praktyczny skutek jest nierówny: niektórzy klienci będą się tym bardzo przejmować, a niektórzy wcale.

Warto doprecyzować, co to oznacza dla decyzji między 5.1 a 5. Historia retencji dotyczy całej rodziny Fable — nie jest to nowa różnica między dwoma modelami, ponieważ Fable 5 i Fable 5.1 mają takie samo podejście do retencji. Zmienia natomiast kalkulację z uwzględnieniem ryzyka: jeśli Twój workload jest tak wrażliwy, że odwoływalna opcja samodzielnego przechowywania jest wykluczająca, to żaden z modeli nie spełnia dziś wymagań, a właściwym miejscem na tę rozmowę jest roadmapa Enterprise Frontier Safeguards (EFS) firmy Anthropic, w której opisano stopniowe wprowadzanie zerowej retencji danych od jesieni 2026 r. dla kwalifikujących się klientów. Jeśli Twój workload nie jest aż tak wrażliwy, raportowanie o retencji nie powinno odwieść Cię od realnego ulepszenia wydajności — ale powinno znaleźć się w dokumentacji decyzyjnej, a nie zostać odkryte dopiero później.

Screenshot of the Artificial Analysis model page for Claude Fable 5, captured September 15, 2026, showing the model’s 1M context window, closed API status, and the intelligence and price analysis summary. AA index figures are from the current, restated index version.

Kto powinien wybrać, które

Wybierz Claude Fable 5.1, gdy koszt błędnej lub porzuconej odpowiedzi dominuje nad kosztem tokenów: długoterminowe badania agentowe, intensywne korzystanie z narzędzi, wszystko, co żyje wewnątrz Claude Code, oraz obciążenia, w których odczyt z pamięci podręcznej tańszy o 75% zmienia Twoją ekonomikę jednostkową. Pozostań przy Claude Fable 5, gdy Twój ruch jest krótki, jednorazowy i tolerancyjny na przepustowość — cena jest identyczna, a wyniki starego modelu wciąż są klasy frontier — albo gdy jesteś w trakcie umowy i narzut związany z migracją jest realny. Uczciwym rozwiązaniem pośrednim jest w ogóle nie wybierać: oba modele stoją za tą samą powierzchnią Anth​ropic API, a jeśli wywołujesz je przez jeden punkt końcowy, możesz eskalować do Claude Fable 5.1, gdy zadanie wymaga szczytowych możliwości rozumowania, i pozwolić, by ta tańsza para o identycznej cenie współdzieliła przełączanie awaryjne bez drugiej umowy.

W OrcaRouter Claude Fable 5 i Claude Fable 5.1 są dostępne w cenach katalogowych swoich dostawców, bez żadnej marży, więc podane powyżej 10 USD / 50 USD to kwota widniejąca na fakturze, a własne zmiany cen Anthropic przechodzą dalej tego samego dnia, zamiast być pochłaniane przez marżę resellera. Testowanie nowej wersji na własnym ruchu to edycja reguły routingu z automatycznym przełączaniem awaryjnym — oba modele współdzielą jeden klucz, więc koszt przełączenia jest bliski zeru, a fuzja modeli pozwala panelowi odpowiadać wspólnie, gdy zadanie jest wystarczająco ważne, by chcieć więcej niż jedną opinię.

Screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5), captured September 15, 2026, showing the model’s $10.00 input and $50.00 output price per 1M tokens passed through from Anthropic, its 1M-token context window, and its capability badges.

Krótka wersja: Claude Fable 5.1 kosztuje tyle samo co Claude Fable 5, jest około dwa razy mocniejszy w benchmarkach nauk agentowych, które Anth​ropic podkreśla, o 75% tańszy przy odczytach z pamięci podręcznej, które dominują w długich sesjach, i istotnie rzadziej przekazuje Twoje żądanie słabszemu modelowi w trakcie zadania. Raportowanie retencji z 14 września jest prawdziwe i warte rozważenia, jeśli jesteś przedsiębiorstwem z surowymi wymogami dotyczącymi danych — ale dotyczy ono całej rodziny, a nie tej konkretnej aktualizacji, i powinno być jednym wierszem w decyzji, którą benchmarki i matematyka pamięci podręcznej już rozstrzygnęły.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie