
Claude Fable 5.1 kontra Claude Fable 5: co tak naprawdę daje odświeżenie własnego flagowca Anthropic
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
Claude Fable 5.1 to obecny flagowy model Anthropic, wydany 1 września 2026 r., a najważniejszym starciem dla większości zespołów jest to, które samo Anthropic stworzyło: Claude Fable 5.1 przeciwko Claude Fable 5, flagowemu modelowi z 9 czerwca, którego zastępuje. Cena jest identyczna — 10,00 USD za milion tokenów wejściowych i 50,00 USD za milion tokenów wyjściowych dla obu — podobnie jak okno kontekstowe o rozmiarze 1 mln tokenów. Zmienił się charakter długotrwałej pracy agentowej: własne dane Anthropic pokazują, że Fable 5.1 ponad dwukrotnie przewyższa Fable 5 w swoim najtrudniejszym benchmarku dla agentów naukowych, a doniesienia z tego tygodnia o tym, jak przedsiębiorstwa traktują rodzinę Fable w kwestii przechowywania danych, nadają odświeżonej wersji drugi, ostrzejszy atut dla każdego, kto dziś wybiera między nimi.
Na wstępie uwaga o datach i źródłach: Claude Fable 5.1 został udostępniony 1 września, więc sam model ma już dwa tygodnie, a nie jest to wiadomość z ostatniej chwili. Aktualne jest doniesienie z 14 września 2026 r. — przypisywane The Information — że Nvidia, Palantir i Booz Allen ograniczają korzystanie z rodziny Fable firmy Anthropic z powodu obaw o przechowywanie wrażliwych danych korporacyjnych, oraz że Anthropic wprowadził w czerwcu kroczące 30-dniowe dzienniki użycia na potrzeby monitorowania bezpieczeństwa, z opcją dla klienta samodzielnego przechowywania tych dzienników, „wciąż możliwą do odwołania”. To doniesienie ma przypisane źródło i nie zostało jeszcze niezależnie potwierdzone. Wszystko, co poniżej oznaczono jako zgłoszone przez dostawcę, pochodzi z własnego arkusza benchmarków Anthropic i nie zostało odtworzone przez neutralny podmiot.
Arkusz specyfikacji, wymiar po wymiarze
• Cena — Claude Fable 5.1 10,00 USD za wejście / 50,00 USD za wyjście za 1 mln tokenów, tyle samo co Claude Fable 5. Żadna z cen nie zmieniła się przy odświeżeniu.
• Buforowane wejście — Claude Fable 5.1 0,25 USD za 1 mln tokenów, o 75% mniej niż 1,00 USD w Claude Fable 5. Zapisy do pamięci podręcznej 12,50 USD (5-minutowe) / 20 USD (1-godzinne); tryb wsadowy 5 USD / 25 USD.
• Kontekst i wyjście — oba mają okno wejściowe o pojemności 1M tokenów oraz do 128K tokenów wyjściowych; oba przyjmują na wejściu tekst i obrazy; oba działają w ramach tego samego interfejsu adaptacyjnego rozumowania z regulatorem wysiłku od niskiego do maksymalnego.
• Niezależny wynik — w aktualnej wersji Intelligence Index firmy Artificial Analysis Claude Fable 5.1 osiąga 53, co daje mu pierwsze miejsce wśród 201 śledzonych modeli, z szybkością 67,2 tokena wyjściowego na sekundę i kosztem 7,63 USD na zadanie indeksowe. Wynik indeksu Claude Fable 5 w skali z momentu premiery (62) pochodzi sprzed wrześniowej korekty i nie jest porównywalny, dlatego nie podajemy dla niego liczby w aktualnej skali.
• Benchmarki dostawcy — Anthropic podaje, że Claude Fable 5.1 osiąga 52,6% w Terminal-Bench-Science 0.1 wobec 24,7% dla Claude Fable 5; 55,8% w Terminal-Bench 4.0 wobec 42,0%; 31,4% w AutomationBench wobec 17,1%; oraz 73,4% w CursorBench 3.2.0 wobec 70,5%.
• Wydano — Claude Fable 5.1 1 września 2026 r.; Claude Fable 5 9 czerwca 2026 r.
Gdzie odświeżenie jest naprawdę odświeżeniem
Największą sztuczką premiery Fable 5.1 jest to, że nic w cenniku się nie zmieniło, a niemal wszystko w tabeli wyników benchmarków jednak się zmieniło. Zyski koncentrują się w pracy agentowej o długim horyzoncie, wymagającej użycia narzędzi — Terminal-Bench-Science 0.1 ponad dwukrotnie wzrósł z 24,7% do 52,6%, Terminal-Bench 4.0 wspiął się z 42,0% do 55,8%, AutomationBench niemal podwoił się z 17,1% do 31,4%. W Humanity's Last Exam Anthropic podaje 60,9% bez narzędzi i 65,0% z nimi, wobec 57,8% i 63,8% dla Claude Fable 5. Traktuj je jako wskazanie kierunku: to własna tabela dostawcy, a największe pojedyncze twierdzenia liczbowe dotyczą siostrzanego modelu z ograniczonym dostępem, Claude Mythos 5.1, który ma te same wagi, ale za surowszymi zabezpieczeniami.

Drugą dźwignią jest koszt i ma większe znaczenie niż jakikolwiek pojedynczy benchmark. Cena wejścia z pamięci podręcznej spadła z 1,00 USD do 0,25 USD za milion tokenów, a w długich przebiegach agentowych to właśnie ponowne odczytywanie dominuje: dane wyjściowe narzędzi, zawartość plików i poprzednie tury są wysyłane ponownie raz za razem. Anthropic szacuje, że efektywny koszt jest około 25% niższy w typowych obciążeniach rozliczanych za tokeny, a w wysoce agentowych nawet do 45% niższy — to szacunek dostawcy, ale samą zmianę ceny można zweryfikować w cenniku. Agent długoterminowy, który podczas jednego zadania pięćdziesiąt razy ponownie odczytuje kontekst o rozmiarze 100 tys. tokenów, płaci 5,00 USD za odczyty z pamięci podręcznej według cennika Claude Fable 5 i 1,25 USD według Claude Fable 5.1. W przypadku floty agentów ta pozycja przestaje być błędem zaokrąglenia.
Trzecia zmiana jest tą, którą użytkownicy poprzedniej generacji odczuwają najpierw: klasyfikator bezpieczeństwa. Programiści nazwali stare zachowanie „depresją Fable'a” — flagowe pieniądze za wyniki, które były po cichu przekierowywane do słabszego modelu, gdy klasyfikator oznaczał nieszkodliwe żądania. Anthropic twierdzi, że zabezpieczenia cybernetyczne Fable 5.1 powodują teraz około 60% mniej interwencji na sesję Claude Code, a zabezpieczenia biologiczne uruchamiają się o 85% rzadziej przy nieszkodliwych żądaniach niż przy premierze Fable 5. Jeśli Twoje skargi dotyczące modelu z czerwca dotyczyły przekazywania zadań w trakcie ich wykonywania, to jest aktualizacja, która je bezpośrednio rozwiązuje.
Historia retencji z tego tygodnia i co robi z decyzją
Doniesienia z 14 września to element, który zmienia kalkulację dla przedsiębiorstw, ponieważ rodzina Fable to miejsce, w którym znajduje się najbardziej zaawansowany model Anthropic — i ponieważ podejście do retencji danych to dokładnie ten rodzaj kwestii, którego regulowany nabywca nie może lekceważyć. Jak donoszono, Anthropic wprowadził w czerwcu kroczące 30-dniowe dzienniki użycia do monitorowania bezpieczeństwa; klientom powiedziano, że zamiast tego mogą samodzielnie przechowywać te dzienniki; a doniesienia mówią, że ta opcja „wciąż może zostać cofnięta”. Palantir jest opisywany jako wstrzymujący Fable do czasu uzyskania nieodwołalnych gwarancji zerowej retencji danych, Nvidia jako ograniczająca Fable do mniej wrażliwych zadań, a Booz Allen jako wykluczająca go z zastrzeżonych prac w zakresie cyberbezpieczeństwa. Wszystko to są doniesienia powołujące się na źródła, żadne z nich nie zostało potwierdzone przez wymienione firmy, a jego praktyczny skutek jest nierówny: niektórzy klienci będą się tym bardzo przejmować, a niektórzy wcale.
Warto doprecyzować, co to oznacza dla decyzji między 5.1 a 5. Historia retencji dotyczy całej rodziny Fable — nie jest to nowa różnica między dwoma modelami, ponieważ Fable 5 i Fable 5.1 mają takie samo podejście do retencji. Zmienia natomiast kalkulację z uwzględnieniem ryzyka: jeśli Twój workload jest tak wrażliwy, że odwoływalna opcja samodzielnego przechowywania jest wykluczająca, to żaden z modeli nie spełnia dziś wymagań, a właściwym miejscem na tę rozmowę jest roadmapa Enterprise Frontier Safeguards (EFS) firmy Anthropic, w której opisano stopniowe wprowadzanie zerowej retencji danych od jesieni 2026 r. dla kwalifikujących się klientów. Jeśli Twój workload nie jest aż tak wrażliwy, raportowanie o retencji nie powinno odwieść Cię od realnego ulepszenia wydajności — ale powinno znaleźć się w dokumentacji decyzyjnej, a nie zostać odkryte dopiero później.

Kto powinien wybrać, które
Wybierz Claude Fable 5.1, gdy koszt błędnej lub porzuconej odpowiedzi dominuje nad kosztem tokenów: długoterminowe badania agentowe, intensywne korzystanie z narzędzi, wszystko, co żyje wewnątrz Claude Code, oraz obciążenia, w których odczyt z pamięci podręcznej tańszy o 75% zmienia Twoją ekonomikę jednostkową. Pozostań przy Claude Fable 5, gdy Twój ruch jest krótki, jednorazowy i tolerancyjny na przepustowość — cena jest identyczna, a wyniki starego modelu wciąż są klasy frontier — albo gdy jesteś w trakcie umowy i narzut związany z migracją jest realny. Uczciwym rozwiązaniem pośrednim jest w ogóle nie wybierać: oba modele stoją za tą samą powierzchnią Anthropic API, a jeśli wywołujesz je przez jeden punkt końcowy, możesz eskalować do Claude Fable 5.1, gdy zadanie wymaga szczytowych możliwości rozumowania, i pozwolić, by ta tańsza para o identycznej cenie współdzieliła przełączanie awaryjne bez drugiej umowy.
W OrcaRouter Claude Fable 5 i Claude Fable 5.1 są dostępne w cenach katalogowych swoich dostawców, bez żadnej marży, więc podane powyżej 10 USD / 50 USD to kwota widniejąca na fakturze, a własne zmiany cen Anthropic przechodzą dalej tego samego dnia, zamiast być pochłaniane przez marżę resellera. Testowanie nowej wersji na własnym ruchu to edycja reguły routingu z automatycznym przełączaniem awaryjnym — oba modele współdzielą jeden klucz, więc koszt przełączenia jest bliski zeru, a fuzja modeli pozwala panelowi odpowiadać wspólnie, gdy zadanie jest wystarczająco ważne, by chcieć więcej niż jedną opinię.

Krótka wersja: Claude Fable 5.1 kosztuje tyle samo co Claude Fable 5, jest około dwa razy mocniejszy w benchmarkach nauk agentowych, które Anthropic podkreśla, o 75% tańszy przy odczytach z pamięci podręcznej, które dominują w długich sesjach, i istotnie rzadziej przekazuje Twoje żądanie słabszemu modelowi w trakcie zadania. Raportowanie retencji z 14 września jest prawdziwe i warte rozważenia, jeśli jesteś przedsiębiorstwem z surowymi wymogami dotyczącymi danych — ale dotyczy ono całej rodziny, a nie tej konkretnej aktualizacji, i powinno być jednym wierszem w decyzji, którą benchmarki i matematyka pamięci podręcznej już rozstrzygnęły.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
