Karta hero zatytułowana „Claude Haiku 5.5 vs Claude Sonnet 5.5" z podtytułem „Sześć dni i jeden poziom różnicy". Obok siebie stoją dwie zaokrąglone karty: lewa z nagłówkiem „Claude Haiku 5.5" i wierszami Indeks 43, 0,21 USD za zadanie oraz Wydano 7 października 2026; prawa z nagłówkiem „Claude Sonnet 5.5" i wierszami Indeks 56, 7,60 USD za zadanie oraz Wydano 28 września 2026. Pomiędzy nimi wyśrodkowana plakietka głosi „36x zmierzona różnica kosztów". Wiersz stopki głosi „Koszt na zadanie i Intelligence Index według Artificial Analysis; oba modele z kontekstem 1M".
Guides & Insights

Claude Haiku 5.5 vs Claude Sonnet 5.5: cennik 20x, zmierzony rachunek 36x

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Claude Haiku 5.5 i Claude Sonnet 5.5 dzieli sześć dni i jeden poziom w tej samej rodzinie, mają wspólne okno kontekstowe o pojemności miliona tokenów i odpowiadają przez ten sam kształt API. Na opublikowanym cenniku tańszy z nich kosztuje jedną piątą ceny droższego w przedziale, w którym ląduje większość zapytań. Na niezależnej tablicy Artificial Analysis różnica jest jeszcze większa: 0,21 USD za ukończenie jednego zadania Intelligence Index na Claude Haiku 5.5 wobec 7,60 USD na Claude Sonnet 5.5, przy Intelligence Index wynoszącym 43 wobec 56. Sygnał, od którego zaczął się ten tekst, ujął to tak, że Claude Haiku 5.5 jest „o wiele lepszy niż GPT-6 Luna” i „bliżej (bliższy) Sonnet 5.5”. Pierwsza połowa tego to w przybliżeniu to, co pokazuje własny zestaw porównawczy dostawcy. Druga połowa to miejsce, w którym pomiary przestają zgadzać się z marketingiem, i warto być precyzyjnym co do tego, w czym.

Dwa modele, sześć dni i jedna klasa różnicy

Claude Haiku 5.5 został wydany 7 października 2026 pod identyfikatorem modelu claude-haiku-5-5. Jest bezpośrednim zamiennikiem Claude Haiku 4.5, przyjmuje tekst i obrazy, a zwraca tekst, i jest pierwszym modelem klasy Haiku, któremu Anthropic udostępnił regulowane ustawienie wysiłku — Low, Medium, High, Xhigh i Max, przy czym medium jest domyślną wartością w API. Anthropic nazywa go „najtańszym, najszybszym i najbardziej zaawansowanym małym modelem, jaki kiedykolwiek wydaliśmy”, a jego przypis uściśla, że jest najszybszy przy standardowej szybkości każdego modelu, ale wciąż ustępuje modelom Opus, gdy te działają w trybie Fast Mode.

Claude Sonnet 5.5 pojawił się sześć dni wcześniej, 28 września 2026 roku, jako claude-sonnet-5-5 — poziom, który Anthropic pozycjonuje jako najlepsze połączenie szybkości i inteligencji oraz ten, który poleca do złożonego kodowania agentowego. To samo okno miliona tokenów. W przeciwieństwie do Claude Haiku 5.5 nie ma przedziału cenowego zależnego od długości promptu, co — jak się okazuje — ma większe znaczenie niż sześciodniowa przewaga.

Oba są już dostępne na wszystkich platformach, w tym Amazon Web Services, Google Cloud i Microsoft Azure, a w przypadku obu obowiązuje zobowiązanie dotyczące wycofania nie wcześniej niż rok po premierze — 7 października 2027 r. dla Claude Haiku 5.5, 28 września 2027 r. dla Claude Sonnet 5.5. Anthropic twierdzi, że Claude Sonnet 5.5 jest dostępny z zerowym przechowywaniem danych, tak jak Claude Opus 5.5 i Claude Sonnet 5.

Cennik, obie strony, w jednym miejscu

W przeliczeniu na milion tokenów, w dolarach amerykańskich, zgodnie z opublikowanymi stawkami Anthropic:

• Wejście — Claude Haiku 5.5: 0,10 USD za prompty do 100 000 tokenów, 0,50 USD powyżej tego progu; Claude Sonnet 5.5: 2,00 USD stawka stała, bez progów.

• Wyjście — Claude Haiku 5.5: 0,50 USD do 100 000 tokenów, 2,50 USD powyżej; Claude Sonnet 5.5: 10,00 USD ryczałtowo.

• Odczyty z pamięci podręcznej — Claude Haiku 5.5: 0,01 USD w dolnym przedziale, a 0,05 USD powyżej niego; Claude Sonnet 5.5: 0,10 USD. Anthropic obniżył cenę odczytów z pamięci podręcznej Claude Sonnet 5.5 o połowę, z 0,20 USD, równocześnie z premierą Haiku, i twierdzi, że ponieważ odczyty z pamięci podręcznej stanowią dużą część użycia tokenów w zastosowaniach agentowych, Claude Sonnet 5.5 kosztuje teraz o około 20% mniej w większości prac agentowych.

• Zapisy do pamięci podręcznej — Claude Haiku 5.5: 0,125 USD za zapis pięciominutowy i 0,20 USD za zapis jednogodzinny w niższym przedziale, 0,625 USD i 1,00 USD powyżej tego przedziału; Claude Sonnet 5.5: 2,50 USD za zapis pięciominutowy i 4,00 USD za godzinę.

• Batch — Batch API jest o 50% tańsze zarówno w przypadku danych wejściowych, jak i wyjściowych. Dzięki temu Claude Haiku 5.5 plasuje się na poziomie 0,05 USD i 0,25 USD poniżej progu 100 000 tokenów oraz 0,25 USD i 1,25 USD powyżej niego, w porównaniu z Claude Sonnet 5.5 na poziomie 1,00 USD i 5,00 USD.

Czytając te wiersze w poprzek, obraz jest spójny: w dolnym przedziale masz 20-krotną różnicę na wejściu i 20-krotną różnicę na wyjściu; powyżej tej linii — 4x i 4x. Nagłówek Anthropic brzmi: „około 75% mniej kosztów działania” średnio w porównaniu z Claude Haiku 4.5, doprecyzowany w przypisie jako 90% taniej poniżej 100 000 tokenów i 50% taniej powyżej tej wartości, przy czym zmiana tokenizera została wliczona w tę średnią.

Krok 100 000 tokenów to moment, w którym arytmetyka się odwraca

Dwie rzeczy ciągną w przeciwnych kierunkach, a tylko jedna z nich widnieje w cenniku. Ceny mocno spadają w porównaniu z Claude Haiku 4.5. Jednocześnie Claude Haiku 5.5 jest dostarczany z zaktualizowanym tokenizerem, podobnym do tych w Claude Sonnet 5.5 i Claude Opus 5.5, który według Anthropic „zużywa nieco więcej tokenów na zadanie” — więc identyczny prompt trafia jako większa liczba rozliczanych tokenów, niż miałoby to miejsce w poprzedniej generacji. Średnia 75% to wypadkowa obu tych czynników i jest to liczba podana przez dostawcę.

Granica 100 000 tokenów to część, która zaskakuje ludzi. Anthropic wycenia Claude Haiku 5.5 według długości promptu: żądanie, którego prompt przekracza 100 000 tokenów, płaci wyższe ceny za całe żądanie, a nie tylko za tokeny powyżej progu. Długość promptu obejmuje wszystkie tokeny wejściowe, w tym odczyty z pamięci podręcznej i zapisy do pamięci podręcznej, a każde żądanie jest wyceniane osobno — długie żądanie płaci według wyższego przedziału, nawet gdy część jego promptu to trafienie w pamięć podręczną, a wcześniejsze żądania zachowują ceny, po których zostały rozliczone. Pipeline do wyszukiwania informacji, który spokojnie mieści się w 90 000 tokenów, płaci $0.10 i $0.50. Wystarczy przesunąć okno o jeden stopień, a całe żądanie zostaje ponownie wycenione na $0.50 i $2.50. Claude Sonnet 5.5 tego nie robi, ponieważ pełne okno miliona tokenów jest rozliczane według standardowych cen.

Wynikają z tego dwie konsekwencje, wskazujące w przeciwnych kierunkach. Po pierwsze, oczekiwany punkt przecięcia — długi kontekst sprawiający, że drogi model staje się tańszy — nie następuje: Claude Haiku 5.5 powyżej linii to wciąż jedna czwarta stawki Claude Sonnet 5.5 w cenniku. Po drugie, luka, na którą liczyłeś, zmniejsza się z 20x do 4x dokładnie wtedy, gdy Twoje obciążenie staje się duże, czyli dokładnie wtedy, gdy liczby bezwzględne zaczynają mieć znaczenie. Ten skok jest powodem, dla którego pipeline wrażliwy na koszty potrzebuje własnej pozycji budżetowej, a nie stawki za token.

Jakie wyniki każdy dostawca zgłasza, że osiąga

Wszystko w tej sekcji jest zgłoszone przez dostawcę i nie zostało odtworzone przez stronę trzecią. Anthropic publikuje ten sam zestaw porównawczy na swoich stronach Claude Haiku 5.5 i Claude Sonnet 5.5, a tam, gdzie obie strony się pokrywają, są zgodne:

• GDPval-AA v2.1, praca oparta na wiedzy — 1 620 dla Claude Haiku 5.5, wobec 1 840 dla Claude Sonnet 5.5, 735 dla Claude Haiku 4.5 i 1 437 dla GPT-6 Luna.

• AA-Briefcase v1.1 — 1,578 dla Claude Haiku 5.5, wobec 1,824 dla Claude Sonnet 5.5, 614 dla Claude Haiku 4.5 i 1,336 dla GPT-6 Luna.

• OSWorld 2.1, obsługa komputera, podzbiór offline — 72,4% dla Claude Haiku 5.5, w porównaniu z 83,9% dla Claude Sonnet 5.5, 15,7% dla Claude Haiku 4.5 i 48,9% dla GPT-6 Luna.

• Terminal-Bench 4.0, kodowanie agentowe — 39,2% dla Claude Haiku 5.5, wobec 70,6% dla Claude Sonnet 5.5, 0,0% dla Claude Haiku 4.5 i 16,4% dla GPT-6 Luna.

• FrontierCode 1.1, Main — 46,4% dla Claude Haiku 5.5, wobec 52,1% dla Claude Sonnet 5.5 przy wysiłku Xhigh, 42,4% dla GPT-6 Luna. Anthropic zwraca również uwagę, że Claude Sonnet 5.5 uzyskuje niższy wynik przy wysiłku Max niż przy Xhigh w tym przypadku, co przypisuje częstszemu korzystaniu z umiejętności code-review powodującemu przekroczenia limitu czasu lub edycje wykraczające poza zakres.

• Chartography, rozumowanie wizualne bez narzędzi — 46,4% dla Claude Haiku 5.5, wobec 61,6% dla Claude Sonnet 5.5, 6,4% dla Claude Haiku 4.5 i 29,1% dla GPT-6 Luna.

• Humanity's Last Exam — 45,9% bez narzędzi i 57,4% z nimi dla Claude Haiku 5.5; 64,5% z narzędziami dla Claude Sonnet 5.5, 18,7% dla Claude Haiku 4.5 i 56,9% bez narzędzi dla Claude Sonnet 5.5 na tej samej stronie. Anthropic zauważa, że dane dla rodziny GPT-6 mogą być nieaktualne, ponieważ OpenAI naprawiło błąd w rozumieniu obrazów, a nie wszystkie wyniki podmiotów trzecich zostały zaktualizowane.

Dwie z tych linii są warte dwukrotnego przeczytania. Na FrontierCode oba modele są blisko siebie — 46,4% wobec 52,1% — a na Chartography, gdzie nie ma narzędzi, za którymi można się schować, różnica wynosi 15 punktów. Terminal-Bench 4.0 wcale nie jest blisko: 39,2% wobec 70,6% to inna klasa możliwości, dlatego strona Anthropic poświęcona Claude Sonnet 5.5 wciąż wskazuje na Claude Sonnet 5.5 i Claude Opus 5.5 w przypadku złożonego kodowania agentowego, a Claude Haiku 5.5 przedstawia jako model do wąskich zadań o dużym wolumenie.

Co wnosi niezależny zarząd

Dane Anthropic porównują jej własne modele między sobą oraz z jednym konkurentem. Niezależny ranking zestawia oba z całą konkurencją, a wskaźnikiem, który podaje, a którego dostawcy nie podają, jest koszt przypadający na ukończone zadanie.

Artificial Analysis przyznaje Claude Haiku 5.5 w trybie Max effort wynik Intelligence Index 43, znacznie powyżej mediany 13 wśród porównywalnych modeli, generując 440 mln tokenów wyjściowych w Indeksie wobec mediany 100 mln — bardzo rozwlekły — przy $0.10 za dane wejściowe i $0.50 za dane wyjściowe za milion oraz 242 tokenach wyjściowych na sekundę. Jego zmierzony koszt wynosi $0.21 na zadanie Intelligence Index.

Ten sam ranking przyznaje Claude Sonnet 5.5 56 punktów, wobec mediany 26, generując 410 mln tokenów wyjściowych wobec mediany 88 mln, przy $2.00 za tokeny wejściowe i $10.00 za tokeny wyjściowe z 90% zniżką na cache. Jego zmierzony koszt to $7.60 na zadanie Intelligence Index.

A headless capture of the Artificial Analysis model page for Claude Haiku 5.5 at Max effort, showing the header 'Claude Haiku 5.5 (Max)' with the Anthropic vendor label and release month October 2026, a rank strip reading Intelligence #2/182, Speed #8/182, Cost #46/182 and Verbosity #62/182, the price strip In $0.10, Out $0.50 and $0.21 per task, a Comparison Summary stating an Artificial Analysis Intelligence Index of 43 against a median of 13 with 440M output tokens generated, and an output-token speed of 242 tokens per second described as notably fast. A specification panel confirms a 1M-token context window, reasoning enabled, text and image input and text output.A headless capture of the Artificial Analysis model page for Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback), showing the Anthropic vendor label and release month September 2026, a rank strip reading Intelligence #3/216, Cost #98/216 and Verbosity #102/216, the price strip In $2.00, Out $10.00, a 90% cache discount and $7.60 per task, a Comparison Summary stating an Intelligence Index of 56 against a median of 26 with 410M output tokens generated against a median of 88M, and a specification panel showing a 1M-token context window and text and image input.

Postaw te dwie linie obok siebie, a stosunek mówi wszystko. $0,21 wobec $7,60 to nieco ponad 36x, a oba modele są niemal równe pod względem gadatliwości — 440M tokenów wyjściowych wobec 410M — więc ten mnożnik to niemal w całości cennik robiący to, co cennik ma robić. W cenniku samego dostawcy to samo porównanie wynosi 20x. Nadwyżka bierze się z rzeczy, których cena za token nie pokaże: tańszy model dochodzi do odpowiedzi przy mniejszej liczbie rozliczanych tokenów na zadanie przy tym ustawieniu wysiłku, a odczyty z pamięci podręcznej są rozliczane po jednej dziesiątej stawki Claude Sonnet 5.5. To samo środowisko testowe, te same zadania, niezależny pomiar.

A generated two-column comparison scoreboard titled 'Claude Haiku 5.5 vs Claude Sonnet 5.5 - the scoreboard'. The left column, headed Claude Haiku 5.5, reads AA Intelligence Index: 43; Cost per Index task: $0.21; Input / output per 1M: $0.10 / $0.50; Output speed: 242 tok/s; Context window: 1M; Terminal-Bench 4.0: 39.2%. The right column, headed Claude Sonnet 5.5, reads AA Intelligence Index: 56; Cost per Index task: $7.60; Input / output per 1M: $2.00 / $10.00; Output speed: not published; Context window: 1M; Terminal-Bench 4.0: 70.6%. A footer line reads 'Index, cost per task and speed per Artificial Analysis; Terminal-Bench vendor-reported.'

Gdzie tak naprawdę kończy się tani plan

Liczby klientów, które publikuje Anthropic, częściej przesądzają o podziale niż benchmarki i wszystkie wskazują ten sam kierunek. Asana raportuje ponad 30% niższe opóźnienie przy realizacji zadań i do 2,5 razy szybsze wnioskowanie na turę agenta. Box raportuje wynik o 11 punktów wyższy niż Claude Haiku 4.5 przy opóźnieniu mniejszym o około połowę. HubSpot raportuje najlepszy wynik, jaki zaobserwował we własnym zestawie – 92,8% uśrednione z trzech przebiegów – z najwyższym wskaźnikiem trafień i najniższym wskaźnikiem fałszywych trafień. AlphaSense wykonuje około 8 mln wywołań tygodniowo za pośrednictwem „Ask in Document” i raportuje statystycznie istotną poprawę w porównaniu z Claude Haiku 4.5, 0,84 wobec 0,76. Cognition raportuje, że z Claude Haiku 5.5 jako pomocnikiem jego agent Fusion utrzymuje wynik FrontierCode na poziomie 66,2.

Żaden z nich nie jest agentem o długim horyzoncie. To rozwiązania punktowe — jeden dobrze zdefiniowany krok, coraz szybszy i tańszy. To kształt, dla którego zbudowano Claude Haiku 5.5, i zarazem kształt, w którym 36-krotna przewaga kosztowa to realne pieniądze, a nie błąd zaokrąglenia. Przewaga kumuluje się wraz z liczbą wywołań i wyparowuje wraz z głębokością wywołań: sto tysięcy wywołań klasyfikacyjnych dziennie po $0.10 za wejście i $0.50 za wyjście to pozycja, której zniknięcie zauważysz, podczas gdy sto tur agenta na sesję, z których każda ponownie czyta nagromadzony kontekst, to pozycja rosnąca superliniowo, ponieważ każda tura powyżej progu płaci wyższą stawkę.

Kontrargument Claude Sonnet 5.5 to koszt przypadający na próbę, a nie koszt przypadający na token. Anthropic twierdzi, że działa ponad 30% szybciej niż Claude Sonnet 5 i w przypadku większości zadań kosztuje nawet o 30% mniej; oszczędność wynika z mniejszego zużycia tokenów, a nie z niższych stawek. Zewnętrzni testerzy podają konkretne liczby: Slack raportuje około 14% mniej tokenów wyjściowych, Balyasny około 121 tys. tokenów na odpowiedź wobec 497 tys., Box 2,4 razy szybciej przy 12% mniej tokenów, Lovable około o jedną trzecią mniej wywołań narzędzi i około o połowę mniej uruchomień powłoki, Atlassian do 30% szybsze Rovo Agents, a Base44 3,6 iteracji na build wobec 7,7 w przypadku Claude Opus 5. Jedna udana tura bije cztery nieudane.

Jest jeszcze trzeci czynnik działający w przeciwnym kierunku. Anthropic przeniósł w tej generacji sterowanie effort na jeden parametr na poziomie modelu — ustawienie effort w Claude Haiku 5.5 ustawia się raz na żądanie, a nie dobiera jego wielkości jako budżetu myślenia na żądanie; stary tryb budget_tokens jest przestarzały w modelach 4.6 i nie jest akceptowany w nowszych. Dla floty wywołującej jeden identyfikator modelu z wielu usług to uproszczenie. Dla czegokolwiek, co samo ustalało wielkość swojego rozumowania na wywołanie, to przepisanie od podstaw.

Uruchamianie obu za jednym punktem końcowym

Powód, dla którego warto podjąć tę decyzję właściwie, jest taki, że błędna jej połowa jest kosztowna do cofnięcia: przepięcie ścieżki produkcyjnej z jednego identyfikatora modelu na inny oznacza dotknięcie każdego miejsca wywołania, które zakładało zachowanie starego modelu. Tańszym sposobem ustalenia, do którego poziomu należy przypisać dane obciążenie, jest uruchomienie obu za jednym punktem końcowym i przenoszenie ruchu między nimi za pomocą konfiguracji, a nie refaktoryzacji.

Właśnie temu służy OrcaRouter. Claude Sonnet 5.5 jest w katalogu jako anthropic/claude-sonnet-5.5, obok Claude Sonnet 5, Claude Opus 5.5 i Claude Haiku 4.5 — starszy poziom Haiku pozostaje dostępny jako punkt odniesienia, dopóki nie zakończysz migracji z niego. Platforma przekazuje cenę katalogową dostawcy bez żadnej marży, więc powyższe 2,00 USD i 10,00 USD to stawki, które płacisz, i działa to również w drugą stronę: gdy dostawca zmienia ceny, nowa cena obowiązuje tu już tego samego dnia — tak właśnie dotarła do nas obniżka za odczyt z pamięci podręcznej Claude Sonnet 5.5. Pracę potrzebną do tej konkretnej decyzji wykonują dwie funkcje. Automatyczne przełączanie awaryjne trzyma model, który wciąż oceniasz, poza twoją ścieżką krytyczną samo z siebie, a DSL routingu pozwala kierować wywołania poniżej 100 000 tokenów do tańszego poziomu, a te o długim kontekście lub długim horyzoncie przekazywać do droższego w tym samym przepływie żądań, bez drugiej umowy i drugiego SDK.

Gwoli ścisłości, co jest hostowane, a co nie: Claude Sonnet 5.5 można obecnie kierować przez nas. Claude Haiku 5.5 nie ma go jeszcze w katalogu. Dopóki go tam nie ma, działa we własnym API Anthropic oraz u trzech wymienionych powyżej dostawców chmury.

Jak podjąć decyzję

Wybierz Claude Haiku 5.5, gdy zadanie jest wąskie, masowe i sprawdzalne — klasyfikacja, ekstrakcja, routing, streszczanie, praca przypadająca na turę wewnątrz agenta, którego już zbudowałeś. W tym przypadku właśnie w 20-krotnej różnicy stawek tkwi sedno, kroku 100 000 tokenów można z założenia uniknąć, a niezależnie zmierzony koszt $0,21 na zadanie świadczy o tym, że przewaga utrzymuje się poza własnym laboratorium dostawcy. Ustaw suwak wysiłku dla danej klasy zadań, zamiast pozostawiać go na wartości domyślnej; w modelu klasy Haiku różnica między Low i Max to mnożnik kosztu, a nie preferencja jakościowa.

Wybierz Claude Sonnet 5.5, gdy zadanie jest długoterminowe, agentowe lub nieweryfikowalne — kod, który musi się skompilować, korzystanie z komputera, które musi pozostawić ekran w znanym stanie, cokolwiek, gdzie błędna odpowiedź kosztuje więcej niż wywołanie. Terminal-Bench 4.0 na poziomie 70,6% wobec 39,2% to nie niuans, to inna klasa możliwości, a jednolity cennik oznacza, że długi kontekst nie zmienia po cichu ceny całego żądania. Jeśli twoje obciążenie naprawdę plasuje się gdzieś pośrodku, uczciwa odpowiedź jest taka, że żaden z modeli nie ma jeszcze szerokiego zaplecza niezależnych reprodukcji, wyniki indeksu pochodzą z jednego środowiska testowego, a przytoczone powyżej dane dostawcy są danymi samego dostawcy.

Co zmieniłoby tę odpowiedź?

Trzy rzeczy są warte obserwacji i żadna z nich nie jest publikacją benchmarków. Pierwsza to, czy niezależne ewaluacje Claude Haiku 5.5 na poziomach wysiłku Low, High i Xhigh — nie tylko Max — pokazują taki sam stosunek kosztu do zadania, ponieważ pokrętło wysiłku jest najtańszą dźwignią w tym porównaniu i najrzadziej mierzoną. Druga to, czy próg 100 000 tokenów przetrwa; trzeci przedział, a może całkowity brak przedziałów w następnej generacji, zmieniłby arytmetykę dla każdego potoku wyszukiwania w tej linii bardziej niż jakikolwiek pojedynczy wynik benchmarku. Trzecia to tokenizer. Jeśli późniejszy checkpoint tokenizuje ten sam tekst według starszego współczynnika, średnia 75% Anthropic staje się dolną granicą, a nie celem, a luka względem Claude Sonnet 5.5 się powiększa, mimo że żadna z cen się nie zmienia.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie