Wygenerowana karta hero dla „Claude Haiku 5.5 jest dziesięć razy tańszy”, z plakietką „NAJTANIEJSZY CLAUDE”, z nadtytułem „ANTHROPIC, 7 PAŹDZIERNIKA 2026” i podtytułem „Obniżka stawek o 90%, tokenizer, który dodaje około 30% więcej tokenów, oraz nieopublikowane przez Anthropic wideo premierowe”. Cztery chipy głoszą „0,10 USD za wejście”, „0,50 USD za wyjście”, „kontekst 1 mln” i „75% rzeczywistych oszczędności”. Dwie karty poniżej są oznaczone „CO SPADŁO” („wejście z 1,00 USD na 0,10 USD, wyjście z 5,00 USD na 0,50 USD przy mniej niż 100 000 tokenów”) i „CO WZROSŁO” („ten sam tekst jest liczony jako około 30% więcej tokenów niż wcześniej”). W stopce czytamy „Dokumentacja cenowa dostawcy przeczytana 8 października 2026 r.”. Logo OrcaRouter jest wkomponowane w prawym dolnym rogu.
Guides & Insights

Claude Haiku 5.5: obniżka ceny o 90%, nowy tokenizer i film, którego Anthropic nie opublikował

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Ktoś wpisał jedno zdanie do Claude Haiku 5.5 i otrzymał gotowy film premierowy. Prompt opublikowany na X wieczorem 7 października 2026 r. brzmi w całości: „zrób 10 razy bardziej sztosowy film na swoją premierę, który pokaże, jak dobrym jesteś motion designerem”. Podpis posta ma trzy słowa — „One shotted this video” — a sam klip jest dołączony jako załącznik. Żadnych ponownych prób, żadnego storyboardu, żadnego montażysty. Jeśli to potrafi teraz najtańszy model w linii Claude, ta półka przestała być kompromisem.

To jest ciekawa połowa premiery. Drugą połową jest arytmetyka i to w niej mieści się właściwa nowina: Claude Haiku 5.5 kosztuje 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych dla promptów o długości do 100 000 tokenów, w porównaniu z Claude Haiku 4.5, którego stawki są stałe i wynoszą 1 USD i 5 USD. Własny przypis Ant​hropic nazywa to obniżką o 90% w typowym przypadku — a potem, jednym tchem, mówi, że liczba, na której kupujący powinien opierać swoje plany, jest bliższa 75%. Obie liczby są poprawne, a różnica między nimi jest najważniejszym elementem w tym wydaniu.

Co Ant​hropic oficjalnie oświadczyło 7 października

Post premierowy dostawcy i jego dokumentacja cenowa są zgodne co do kształtu tego przedsięwzięcia, a to krok większy, niż zwykle idzie w parze z obniżką ceny.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• Cena — 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych dla promptów do 100 000 tokenów. Powyżej tego progu to samo żądanie jest rozliczane według stawek 0,50 USD i 2,50 USD. Odczyty z pamięci podręcznej kosztują 0,01 USD za milion do 100 tys. i 0,05 USD powyżej tego; zapisy do pamięci podręcznej kosztują 0,125 USD i 0,625 USD.

• Kontekst — 1 mln tokenów, z maksymalnie 128 000 tokenów wyjściowych. To to samo okno i ten sam limit tokenów wyjściowych, które oferują Fable 5.1, Claude Opus 5.5 i Claude Sonnet 5.5, odtworzone w najtańszym planie.

• Myślenie — adaptacyjne myślenie z parametrem effort, domyślnie ustawionym na medium. Anthropic twierdzi, że jest to pierwszy model klasy Haiku z regulowanym ustawieniem effort, co oznacza, że ten sam identyfikator modelu można uruchomić tanio lub ostrożnie, nie zmieniając niczego innego.

• Tokenizer — nowszy tokenizer współdzielony z Claude 4.7 i późniejszymi, który „generuje około 30% więcej tokenów dla tego samego tekstu”. Dokumentacja Ant​hropic podaje, że dokładny wzrost zależy od treści i charakteru obciążenia.

• Cykl życia — granica wiedzy czerwiec 2026 oraz zobowiązanie do wycofania „nie wcześniej niż 7 października 2027 r.”

• Dostępność — Claude API, Amazon Web Services, Goo​gle Cloud, Microsoft Azure i Claude Platform on AWS, wszystko naraz już od pierwszego dnia.

Naklejka 10x i rzeczywistość 75%

Dziesięć razy taniej to liczba, która rozejdzie się najdalej, i to ona najpewniej trafi do czyjegoś modelu budżetowego w niewłaściwym miejscu. Dotyczy promptów o długości do 100 000 tokenów. Haiku 5.5 nie utrzymuje tej stawki przez całe okno.

• Do 100 000 tokenów — 0,10 USD za wejście i 0,50 USD za wyjście, w porównaniu z 1 USD i 5 USD w przypadku Haiku 4.5. To obniżka o 90%, a Ant​hropic twierdzi, że 90% żądań kierowanych do poprzedniego modelu Haiku mieściło się w tym przedziale.

• Ponad 100 000 tokenów — 0,50 USD za wejście i 2,50 USD za wyjście. Wciąż dokładnie połowa tego, co pobierał Haiku 4.5, za to samo żądanie, bez pułapu, który trzeba by osiągnąć.

• Tokenizer — ten sam tekst daje około 30% więcej tokenów niż w Ha 4.5, więc obniżka ceny za token nie przekłada się jeden do jednego na mniejszy rachunek.

• Własna średnia dostawcy — Ant​hropic przedstawia tę kombinację jako „około 75% mniej do uruchomienia”. To jego własna liczba, a nie niezależny pomiar, i właśnie ją należy uwzględnić w prognozie.

• Ekonomika pamięci podręcznej — odczyty z pamięci podręcznej spadły z 0,10 USD do 0,01 USD za milion w typowym przedziale, co ma większe znaczenie niż stawka za dane wejściowe w przypadku każdego potoku, który ponownie wysyła długi współdzielony prefiks.

Liczba 75% wyjaśnia też coś, co czytelnik mógłby w przeciwnym razie odczytać jako sprzeczność. Te dwie główne liczby nie są ze sobą sprzeczne; jedna to wskaźnik dla określonego kształtu żądania, druga to uśrednione oszacowanie dla rzeczywistej mieszanki ruchu, obejmującej mniejszość powyżej 100K oraz dodatkowe tokeny tokenizera. Jeśli modelujesz wydatki, użyj 75% i sprawdź własny rozkład długości promptów, zanim uwierzysz w lepszy wynik.

Co wideo twierdzi, a czego nie twierdzi

Nagranie jest prawdziwe, prompt przytoczono dosłownie powyżej, a znacznik czasu — 19:49 UTC 7 października, mniej więcej tego samego dnia, w którym model został uruchomiony — można zweryfikować. Przypisanie dotyczy indywidualnego użytkownika, a nie Ant​hropic.

To rozróżnienie ma tutaj znaczenie, ponieważ własna strona produktu Claude Haiku 5.5 firmy Ant​hropic nie zawiera żadnego osadzonego wideo: ani odtwarzacza, ani pliku multimedialnego, tylko link do kanału YouTube tej firmy. Jeśli film premierowy powstał z tym modelem, dostawca tego nie powiedział. Zatem trafne stwierdzenie jest wąskie: użytkownik zgłasza, że wygenerował wideo premierowe za jednym podejściem przy użyciu Claude Haiku 5.5, i opublikował prompt. To, czy było to jedno podejście, ile kosztowało i ile z tego przetrwało montaż, to wszystko twierdzenia z jednego źródła. Traktuj ten klip jako demonstrację, a nie jako benchmark.

Powód, dla którego warto o tym mimo wszystko wspomnieć, jest taki, że generowanie wideo nie należy do specyfikacji modelu. Haiku 5.5 przyjmuje tekst i obrazy, a zwraca tekst. Wynik z zakresu motion designu o takiej jakości sugeruje, że model sterował czymś innym — ścieżką generowania kodu, potokiem renderowania, pętlą narzędziową — a nie sam tworzył klatki. To stwierdzenie o orkiestracji agentowej przy wejściu za $0.10, co jest właściwie najbardziej zaskakującą częścią.

Liczby opublikowane przez Ant​hropic

Tabela premierowa dostawcy to zestawienie przed i po w porównaniu z Haiku 4.5, z GPT-6 Luna i Claude Sonnet 5.5 w tych samych kolumnach dla skali. Każda liczba poniżej to własny, raportowany przez Ant​hropic wynik ewaluacji, uruchomiony na harnessie Ant​hropic, i jest przytoczona, ale niezweryfikowana niezależnie.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• Praca wiedzowa — GDPval-AA v2.1 na poziomie 1620 wobec 735 dla Haiku 4.5, 1437 dla GPT-6 Luna i 1840 dla Sonnet 5.5. AA-Briefcase v1.1 na poziomie 1578 wobec 614, 1336 i 1824.

• Korzystanie z komputera — OSWorld 2.1 osiąga 72,4% w podzbiorze offline, wobec 15,7% dla Haiku 4.5, 48,9% dla GPT-6 Luna i 83,9% dla Sonnet 5.5.

• Rozumowanie multidyscyplinarne — Humanity's Last Exam na poziomie 45,9% bez narzędzi i 57,4% z nimi, w porównaniu z 10,2% i 18,7% dla Haiku 4.5.

• Kodowanie agentowe — Terminal-Bench 4.0 osiąga 39,2% wobec 0,0%, 16,4% i 70,6%. FrontierCode 1.1 (Main) osiąga 46,4% wobec 42,4% dla GPT-6 Luna i 52,1% dla Sonnet 5.5.

• Rozumowanie wizualne — Chartography na poziomie 46,4% bez narzędzi, w porównaniu z 6,4%, 29,1% i 61,6%.

Anthropic jest także niezwykle bezpośrednie w kwestii tego, gdzie mniejsza klasa modeli nie wygrywa. W swoim własnym komentarzu do wykresu Terminal-Bench firma stwierdza, że Sonnet 5.5 i Opus 5.5 „pozostają lepszym wyborem do złożonych agentowych zadań programistycznych”, a Haiku 5.5 pozycjonuje zamiast tego do kompresji, podsumowywania i pracy podagentów. Cytaty klientów w poście wskazują ten sam kierunek i niosą to samo zastrzeżenie — to partnerzy z wczesnego dostępu opisujący własne ewaluacje, a nie audyty: Asana raportuje ponad 30% niższe opóźnienie ukończenia zadań i do 2,5x szybszą inferencję na turę agenta; HubSpot raportuje 92,8% średnio z trzech przebiegów w zestawie testów portalu CRM; AlphaSense raportuje 0,84 wobec 0,76 w 400 zapytaniach na obciążeniu wykonującym około 8 mln wywołań tygodniowo; Box raportuje o 11 punktów więcej niż Haiku 4.5 przy około połowie opóźnienia; Rogo opisuje podagenta Haiku 5.5 wyciągającego pozycję przychodów segmentu z dokumentu 10-K; a Cognition raportuje, że Devin Fusion utrzymuje wynik FrontierCode na poziomie 66,2 z Haiku 5.5 w roli pomocnika.

Co mówi niezależna rada

Tabele dostawcy należą do dostawcy. Pierwsze zewnętrzne umieszczenie w rankingu to użyteczniejsza liczba dla każdego, kto decyduje, czy dany poziom przesunął się wystarczająco daleko, by zmienić potok produkcyjny.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis ocenia Claude Haiku 5.5 na 43 w swoim Intelligence Index v4.3.2 w konfiguracji Max tego modelu, co daje mu drugie miejsce spośród 182 modeli na tej liście i znacznie powyżej mediany tej listy wynoszącej 13. Ta sama strona podaje 242 tokeny wyjściowe na sekundę — dziewiąte miejsce na 182 — oraz koszt 0,21 USD na zadanie Intelligence Index.

Dwie rzeczy na tej stronie są warte więcej niż nagłówek. Pierwsza to gadatliwość: oceniając Index, Artificial Analysis odnotowała 440 mln tokenów wyjściowych wobec mediany 100 mln i opisuje model jako „bardzo gadatliwy”. Cena jest naliczana za token, więc model, który myśli długo, za to płaci — i właśnie dlatego koszt na zadanie wynosi 0,21 USD, a nie blisko zera, i dlatego 90-procentowe cięcie na wejściu to nie cała historia. Druga to drabinka wysiłku: ta sama strona ujawnia konfiguracje od Max w dół do Low, a domyślne ustawienie Anthropic to medium, nie max. Wynik 43 na tablicy wyników to szczyt tej drabinki, a nie ustawienie, które dostajesz, jeśli nic nie zrobisz.

Ogrywanie poziomu poniżej tego, który możesz już wywołać

Claude Haiku 5.5 nie znajduje się w katalogu OrcaRouter i warto byłoby powiedzieć to wprost, zamiast sugerować coś przeciwnego: odstęp w dniu premiery między istnieniem modelu a możliwością routowania go wynosi zwykle kilka dni, a czasem dłużej.

To, co dziś znajduje się w katalogu Ant​hropic, to Claude Haiku 4.5, Claude Sonnet 5.5 i Claude Opus 5.5, każdy w cenie katalogowej dostawcy przekazanej dalej z 0% narzutem, więc każda obniżka, jaką wprowadzi Ant​hropic, trafia po naszej stronie tego samego dnia, w którym trafia po ich stronie. To praktyczny pomost dla każdego, kto chce już teraz przetestować wzorzec subagenta: kaskada, która kieruje rutynowe tury do Haiku 4.5 i eskaluje trudne w górę, działa już dziś w ramach jednego klucza i jednego SDK, a późniejsza zamiana małej odnogi na Haiku 5.5 to zmiana identyfikatora modelu, a nie migracja. Automatyczne przełączanie awaryjne działa pod spodem niezależnie od tego, które odnogi wybierzesz, więc zły dzień jednego dostawcy nie pociąga za sobą całego pipeline'u.

Jeśli wolisz w ogóle nie czekać, ta sama stawka wejściowa 0,10 USD jest już zajęta przez GPT-6 Luna, który faktycznie obsługujemy i który utrzymuje tę stawkę aż do 272 000 tokenów, zanim wzrośnie.

Kto powinien się przenieść, a kto nie

Jeśli Twoje obciążenie to klasyfikacja, ekstrakcja, routing, kompaktowanie lub streszczanie na dużą skalę, a Twoje prompty mieszczą się poniżej 100 000 tokenów, sprawa jest prosta: stawka to jedna dziesiąta tego, co było, okno jest pięć razy szersze, a suwak wysiłku pozwala pójść w drugą stronę, gdy wymaga tego żądanie. Zaplanuj budżet o około 75% niższy, a nie spotka Cię niespodzianka.

Jeśli Twoje prompty regularnie przekraczają 100 000 tokenów, kupujesz 50-procentową obniżkę, a nie 90-procentową, a porównywanie ofert pod kątem głębokiego kontekstu wciąż jest warte poświęcenia popołudnia — na rynku jest kilka modeli w cenie równej lub niższej od stawki tego poziomu za ponad 100 tys. tokenów.

A jeśli twoja ewaluacja nadal zawodzi na zadaniach w stylu Terminal-Bench, to nie jest model, który to naprawi; Ant​hropic sam to mówi, a 39,2% przeciwko 70,6% Sonnet 5.5 to najczystszy dowód w poście. Uczciwe podsumowanie 7 października jest takie, że dolna granica użytecznej inteligencji znacznie się obniżyła, a górna wcale się nie przesunęła.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie