
Claude Sonnet 5.5 vs Claude Fable 5.1: Tani model wysuwa się o trzy punkty do przodu
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 983 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 196 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Claude Sonnet 5.5 pojawił się 28 września 2026 roku w cenie 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych. Claude Fable 5.1, model klasy Mythos, który dostawca udostępnił 1 września, plasuje się na poziomie 10,00 i 50,00 USD w tych samych dwóch pozycjach. Kuszące podsumowanie brzmi, że Fable 5.1 jest droższy, a więc lepszy, tymczasem w Artificial Analysis Intelligence Index kolejność jest odwrotna: Claude Sonnet 5.5 uzyskuje wynik 56, a Claude Fable 5.1 — 53. To nie jest efekt zaokrąglenia i nie jest to też pełny obraz, ponieważ ten sam ewaluator umieszcza je w odległości trzech centów na zadanie od siebie w tym samym zestawie testów — 7,60 USD wobec 7,63 USD. Pięciokrotna różnica w cenniku niemal znika, zanim zadanie zostanie ukończone. Pozostaje zestaw różnic w kształcie, a nie w wyniku, a wybór między nimi to głównie kwestia tego, jaki kształt ma Twoje obciążenie pracą.
Dwa cenniki i ten jeden wiersz, w którym różnica nie jest pięciokrotna.
Porównanie na poziomie pojedynczych tokenów jest jaskrawe i nie wymaga interpretacji.
• Wejście — Claude Sonnet 5.5 po 2,00 USD za milion tokenów w porównaniu z Claude Fable 5.1 po 10,00 USD, pięciokrotna różnica
• Wyjście — $10.00 w porównaniu z $50.00 za milion, ponownie dokładnie pięciokrotnie
• Odczyt pamięci podręcznej — 0,20 USD w porównaniu z 0,25 USD za milion. To pozycja, która utrzymuje długie przebiegi agentów, a zniżka spada z 5× do 20%
• Zapis do pamięci podręcznej — 2,50 USD wobec 12,50 USD za milion w standardowym pięciominutowym oknie, największa pojedyncza różnica na którejkolwiek z kart
• Batch — tryb wsadowy Anthropic nie ma zastosowania do żadnej z tych kart tak, jak ma to miejsce w przypadku kart Fable 5.1: Fable 5.1 został uruchomiony z cenami trybu wsadowego niższymi o połowę — $5.00 za wejście i $25.00 za wyjście. Zanim założysz, że przenosi się to na całą rodzinę, odczytaj wiersz dotyczący trybu wsadowego z własnej strony cennika Anthropic.
• Kontekst i limit — 1 000 000 tokenów kontekstu i 128 000 tokenów maksymalnego wyjścia w obu przypadkach. W Message Batches API Claude Sonnet 5.5 obsługuje do 300 000 tokenów wyjściowych za nagłówkiem beta output-300k-2026-03-24, co stanowi realną różnicę w limicie przy generowaniu masowym, a nie zabieg marketingowy
Jest pewien skromny atut na korzyść Claude Sonnet 5.5, który cennik zaniża. Anthropic podaje, że model zazwyczaj potrzebuje znacznie mniej tokenów do wykonania tej samej pracy niż jego poprzednik, co — jak twierdzi — przekłada się na nawet o 30% niższy koszt na zadanie. To twierdzenie dostawcy dotyczące innego porównania — Sonnet 5.5 z Sonnet 5 — i nie stanowi dowodu w tym zestawieniu. Jest jednak mechanizmem, który wyjaśnia, co wykazał niezależny pomiar.
Gdzie trafia pięciokrotna różnica cen
Artificial Analysis uruchomiła oba modele 29 września 2026 r. w ramach jednego środowiska testowego i jednej etykiety konfiguracji „Adaptive Reasoning, Max Effort, Default Fallback”, w Intelligence Index v4.3. Dwie najważniejsze wartości to 56 dla Claude Sonnet 5.5 i 53 dla Claude Fable 5.1 — tańszy model wyprzedza o około trzy punkty w skali, w której ten sam ewaluator plasuje model medianowy na 26. Oba są na tej samej stronie opisane jako modele pod nazwami dostawców, więc mamy do czynienia z jednym narzędziem i jedną migawką, a nie z dwoma.
A potem kolumna kosztów i powód, dla którego to zestawienie jest interesujące, a nie oczywiste. W tym samym przebiegu indeksu Claude Sonnet 5.5 kosztuje 7,602633 USD na zadanie, a Claude Fable 5.1 — 7,629706 USD. Dzieli je dwadzieścia siedem tysięcznych dolara. Dopiero rozkład na składniki jest dziwny: sama strona wejściowa Claude Fable 5.1 to 3,73 USD na zadanie w porównaniu ze znacznie mniejszym składnikiem wejściowym Sonnet 5.5, a same jego tokeny rozumowania kosztują 2,36 USD na zadanie. Model, który jest pięciokrotnie tańszy za token, wcale nie jest tańszy za ukończone zadanie.
Przyczyną jest wolumen, a oba modele zawodzą w przeciwnych kierunkach.
• Tokeny wyjściowe w całym zestawie indeksowym — Claude Sonnet 5.5 wygenerował 410 577 501, a Claude Fable 5.1 — 188 465 663, w zestawie, w którym śledzona mediana wynosi 88 milionów. Oba wyniki są znacznie powyżej mediany; Sonnet 5.5 jest ponad dwukrotnie wyższy od Fable 5.1 i prawie pięciokrotnie wyższy od mediany
• Tokeny wyjściowe na zadanie — 192,838 dla Sonnet 5.5 wobec 78,111 dla Fable 5.1, przy czym udział rozumowania wynosi 142,386 wobec 47,240. Sonnet 5.5 myśli około trzy razy dłużej na zadanie
• Tokeny wejściowe w całym zestawie indeksów — 18,5 miliarda dla Sonnet 5.5 w porównaniu z 5,6 miliarda dla Fable 5.1. Sonnet 5.5 odczytał trzy razy więcej, co jest cichszą liczbą w tej parze i tą, która pochłania tańszą stawkę za wejście
• Cena mieszana przy proporcji 7:2:1 wejście–odczyt z pamięci podręcznej–wyjście — 1,54 USD dla Sonnet 5.5 w porównaniu z 7,17 USD dla Fable 5.1. To jest pozycja zgodna z cennikiem i to jest pozycja, która opisuje obciążenie z krótkimi, dobrze ograniczonymi danymi wyjściowymi.
Połącz to razem, a szczere stwierdzenie brzmi następująco: różnica w cenie mieszanej jest realna, a różnica na zadanie nie. To, która z tych dwóch liczb opisuje Twój rachunek, zależy w całości od tego, czy Twoje zadania się kończą, czy ciągną się bez końca, a zestaw indeksów został zbudowany tak, aby pozwalać im ciągnąć się bez końca.
Drabina wysiłku to właściwa decyzja
Oba modele udostępniają parametr wysiłku — low, medium, high, xhigh, max — i oba zostały zmierzone na każdym szczeblu w dniu 2026-09-29. To ta część porównania, której nie wyrazi żadna tabela stawek, bo tani model na niższym szczeblu bije drogi model na niższym szczeblu z dużą przewagą, a drogi model odrywa się dopiero blisko szczytu.
• Niski wysiłek — Claude Sonnet 5.5 osiąga 35,84 przy 0,41 USD na zadanie; Claude Fable 5.1 osiąga 46,82 przy 2,37 USD. Na najniższym szczeblu drogi model wyprzedza o jedenaście punktów, za prawie sześciokrotnie wyższą kwotę
• Średni wysiłek — 40,74 przy 0,59 USD wobec 48,92 przy 2,98 USD. Fable 5.1 ma ośmiopunktową przewagę przy pięciokrotnie wyższym koszcie
• Wysoki wysiłek — 46,74 przy 1,08 USD wobec 51,15 przy 3,91 USD. Różnica zmniejsza się do czterech i pół punktu; stosunek kosztów utrzymuje się na poziomie około 3,6×
• Wysiłek Xhigh — 51,85 za 2,74 USD w porównaniu z 53,20 za 5,98 USD. Różnica jednego i jednej trzeciej punktu, przy 46% ceny
• Maksymalny wysiłek — 55,98 przy 7,60 USD wobec 53,35 przy 7,63 USD. Kolejność się odwraca, a koszt zbiega do różnicy poniżej pół procenta.
Przeczytaj czwarty i piąty wiersz razem, a wyłoni się kształt tego starcia. Claude Sonnet 5.5 przy xhigh osiąga 51,85 — w granicach półtora punktu indeksu od najlepszego wyniku Claude Fable 5.1 przy dowolnym poziomie wysiłku — za 2,74 USD za zadanie w porównaniu z 7,63 USD. Jeśli twoja praca musi być blisko granicy możliwości, a nie na niej samej, ten wiersz jest całą odpowiedzią i oszczędza 64% na ukończonym zadaniu. Podkręć Sonnet 5.5 do maksimum, a kupisz trzy dodatkowe punkty za 2,8 razy większe pieniądze, co stawia cię przy tym samym rachunku co maksimum Fable 5.1, z nieznacznie lepszym wynikiem i zupełnie innym profilem rozumowania.
To ostatnie zdanie warto doprecyzować, bo jest na tyle nieintuicyjne, że warto sprawdzić je dwa razy. Przy takim samym maksymalnym wysiłku model z pięciokrotnie tańszym cennikiem kosztuje tyle samo na zadanie co model z drogim cennikiem. Osiąga to, generując 2,5 razy więcej tokenów wyjściowych, z których udział rozumowania jest trzykrotnie większy. Własna dokumentacja Anthropic wyjaśnia część mechanizmu: tokenizator się zmienił, a ten sam tekst daje około 30% więcej tokenów w modelu Claude Sonnet 5.5 niż we wcześniejszych modelach. To jeden z kilku czynników, które się do tego przyczyniają, i użyteczne przypomnienie, że liczby tokenów wyjściowych nie są porównywalne między wersjami tokenizatora, jeśli się tego nie zaznaczy.
Opóźnienie to miejsce, w którym te dwa przestają być do siebie podobne.
Zbieżność wyników nie przekłada się na czas. Na tym samym snapshotcie z 2026-09-29 Artificial Analysis podaje czas do pierwszego tokenu wynoszący 254,41 sekundy dla Claude Fable 5.1 i 2,80 sekundy dla Claude Sonnet 5.5 w segmencie długich promptów, przy medianie prędkości generowania wynoszącej odpowiednio 67,9 i 49,4 tokenu na sekundę. To różnica dwóch rzędów wielkości w tym, jak długo wywołujący czeka, zanim cokolwiek dotrze, i jest to najistotniejsza operacyjnie liczba w tym porównaniu.
W przypadku obu wartości trzeba jasno podać ich kwalifikatory. TTFT modelu Fable 5.1 jest mierzone na typie długiego promptu; wycinek średniego promptu ewaluatora dla tego samego modelu tego samego dnia wynosi 117,60 sekundy, więc wartość 254 sekund to ogon, a nie stała. Wynik 2,80 sekundy modelu Sonnet 5.5 to jego ogólna mediana, a własne pasmo wariancji ewaluatora rozciąga się od 1,91 sekundy przy piątym percentylu do 4,23 przy dziewięćdziesiątym piątym. Dokumentacja platformy Anthropic opisuje porównawczą latencję Fable 5.1 jako wolniejszą, a Sonnet 5.5 jako szybką, co jest spójne kierunkowo, choć nie stanowi pomiaru.
Nasza własna infrastruktura daje trzeci odczyt, ponieważ kierujemy ruch do Claude Fable 5.1 i mierzymy to, co obsługujemy. W ciągu siedmiu dni do 28 września, w ruchu własnym OrcaRouter, Claude Fable 5.1 osiąga medianę pierwszego tokenu na poziomie 6 973 milisekund przy 95. percentylu wynoszącym 10,0 sekundy, prędkość wyjściową 65,8 tokenu na sekundę i współczynnik błędów 0,349%. Ta wartość p50 jest ponad sto razy szybsza niż wynik dla długiego promptu uzyskany przez evaluator, co nie jest tak bardzo sprzecznością, ile kwestią definicji pojęć: pierwszy token widziany przez dewelopera przy krótkim prompcie i pierwszy token w benchmarku przy długim to pomiary różnych rzeczy. Każdy, kto planuje na podstawie liczby z rankingu, powinien wiedzieć, którą z nich kupuje.

Uczciwość w sourcingu, retencja i migracja, o której nikt nie mówi
Tabele benchmarków dostawców i niezależne ewaluacje to różne narzędzia i nigdy nie należy ich odejmować od siebie. Własna tabela premierowa Anthropic dla Claude Sonnet 5.5 podaje wynik Terminal-Bench 4.0 na poziomie 70,6%. Artificial Analysis, uruchamiając własny zestaw testowy, podaje 63,6% dla tego samego modelu w ewaluacji o tej samej nazwie. W przypadku Claude Fable 5.1 rozbieżność przebiega w drugą stronę: Anthropic podał 55,8% przy premierze, a niezależny zestaw testowy wskazuje 52,0%. Żadna z tych par nie jest korektą drugiej. Oceniaj każdy według jego własnych kryteriów, a gdy decydujesz, gdzie kierować ruch produkcyjny, preferuj ten niezależny.
Podejście do przechowywania danych również się różni i jest to różnica, która ujawnia się dopiero podczas przeglądu zakupowego. Anthropic podaje, że Claude Sonnet 5.5 jest dostępny z zerowym przechowywaniem danych, tak samo jak w przypadku Opus 5.5 i Sonnet 5. Materiał premierowy Claude Fable 5.1 opisuje równolegle obowiązującą przyrostową politykę wykorzystywania danych oraz odrębne wdrożenie w ramach Project Glasswing, które domyślnie obejmuje 30-dniowy okres przechowywania na potrzeby monitorowania bezpieczeństwa, przy czym rozwiązanie z zerowym przechowywaniem opisano jako stan przejściowy. Jeśli Twój zespół podlega weryfikacji w zakresie przetwarzania danych, ta różnica to realna pozycja w wykazie, a nie przypis, i warto przeczytać aktualną stronę z polityką Anthropic, a nie jakiekolwiek jej podsumowanie, w tym niniejsze.
Koszt migracji jest asymetryczny w sposób, który rzadko trafia do doniesień o premierze. Przejście na Claude Sonnet 5.5 nie jest zmianą ciągu modelu. Przewodnik migracji Anthropic stwierdza, że niedomyślne wartości temperature, top_p i top_k zwracają teraz błąd 400, że tool_choice przyjmujące wartość any lub nazwę narzędzia jest odrzucane z miejsca, a thinking: {"type": "disabled"} musi stać się between_tools, jeśli działałeś z wyłączonym wstępnym myśleniem. Typ between_tools jest akceptowany przy niskim, średnim i wysokim poziomie wysiłku i zwraca błąd 400 przy xhigh lub max. W Claude API i Google Cloud funkcja computer use jest obsługiwana wyłącznie przez zestaw narzędzi computer_toolset_20260801; starszy computer_20251124 jest odrzucany. Żadne z nich nie dotyczy przejścia na Claude Fable 5.1, które jest aktualizacją z Fable 5 w ramach tej samej rodziny i ma trzy własne zmiany łamiące kompatybilność. Jeśli rozważasz oba jako równoległe cele migracji, tańszy model jest droższy we wdrożeniu.

Który gdzie umieścić
Decyzja wynikająca z liczb to decyzja o tym, jak duża część Twojego ruchu ma dobrze określony zakres.
• Praca ograniczona, wielkoskalowa, oparta na narzędziach — Claude Sonnet 5.5, przy wysiłku xhigh, jeśli musisz być blisko czołówki. Jest o półtora punktu indeksu za najlepszym wynikiem Fable 5.1, przy 64% niższym koszcie na ukończone zadanie, zwraca pierwszy token w około trzy sekundy, a jego tańsza stawka zapisu do pamięci podręcznej sprawia, że odbudowany prefiks kontekstu jest przystępny cenowo
• Długohoryzontowa, otwarta praca, w której błędna odpowiedź jest kosztowna — Claude Fable 5.1. Osiąga maksymalny wynik Sonnet 5.5 przy tym samym koszcie na zadanie, docierając do niego przy jednej trzeciej tokenów rozumowania i jednej czwartej danych wejściowych, co ma znaczenie, gdy zadanie jest naprawdę otwarte, a kształt zestawu ewaluacyjnego przypomina twój problem
• Interaktywne powierzchnie ograniczone opóźnieniem — Claude Sonnet 5.5, i nie jest to nawet blisko. We własnym snapshocie ewaluatora różnica czasu do pierwszego tokenu wynosi dwa rzędy wielkości dla długiego typu promptu, a odczyt dla średniego promptu zmniejsza ją tylko do około 118 sekund. Nie da się zbudować powierzchni czatu na wyniku Fable 5.1 bez batchowania lub strumieniowania wokół niego.
• Masowe generowanie długich wyników — Claude Sonnet 5.5, ze względu na limit 300 000 tokenów wyjściowych dostępny w Message Batches API za nagłówkiem output-300k-2026-03-24, wobec limitu 128 000 tokenów obowiązującego wszędzie indziej. Przed zatwierdzeniem potwierdź ceny dla batchy; stawka dla batchy nie jest identyczna w obu kartach.
• Prace, które muszą obejmować wiele kont lub przekazywać rozumowanie między systemami — przed podjęciem którejkolwiek z tych czynności przeczytaj dokumentację Anthropic na temat preserved-thinking. Bloki myślenia są powiązane z modelem i kontem, które je utworzyły, a Sonnet 5.5 to pierwszy Sonnet dostarczany z klasyfikatorami, które uniemożliwiają wydobywanie rozumowania. To jednocześnie funkcja zgodności i ograniczenie
• Obciążenia podlegające regulacjom lub wrażliwe na retencję — sprawdź aktualną politykę, a nie informacje z premiery. Claude Sonnet 5.5 zadebiutował z dostępną zerową retencją danych; materiały Fable 5.1 opisują politykę stopniowego wdrażania z domyślnym 30-dniowym okresem w jednym wdrożeniu i zerową retencją jako stan przejściowy

W OrcaRouter Claude Fable 5.1 i Claude Sonnet 5 stoją za jednym poświadczeniem w cenie katalogowej dostawcy z 0% marży, więc pozycja odczytu z pamięci podręcznej i zmiana tokenizera to jedyne rzeczy, które zmieniają Twój rachunek, gdy przełączasz się między nimi. Claude Sonnet 5.5 nie jest jeszcze trasą na naszej platformie — model ma dopiero jeden dzień — więc uczciwie można powiedzieć, że dziś dotrzesz do niego przez własne API Anthropic. Każdy, kto korzysta u nas z Fable 5.1, może wycenić to przełączenie w dniu, w którym się pojawi, nie zmieniając niczego innego w swojej integracji, a w międzyczasie automatyczne przełączanie awaryjne między dostawcami sprawia, że bezpiecznie jest wypróbować tak nowy model na ścieżce, która musi pozostać dostępna.
Werdykt jest węższy, niż sugeruje różnica cen. Claude Sonnet 5.5 jest lepszym domyślnym wyborem w niemal każdym ograniczonym zadaniu — zdobywa o trzy punkty więcej w niezależnym indeksie, odpowiada w kilka sekund, a przy xhigh zbliża się na półtora punktu do pułapu Fable 5.1 za znacznie mniej niż połowę kosztu na zadanie. Claude Fable 5.1 zachowuje jeden prawdziwy argument, i to ten, który podaje sama tabela porównawcza Anthropic: gdy praca jest otwarta, a koszt pomyłki przewyższa koszt dłuższego myślenia, pięciokrotność ceny wejściowej kupuje model, który osiąga ten sam wynik, nie zużywając przy tym trzykrotnie większej liczby tokenów rozumowania, by tam dotrzeć. Wybieraj na podstawie kształtu zadania, a nie wielkości cennika, bo na szczycie drabiny wysiłku oba te modele kosztują cię tyle samo.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
