
Claude Haiku 5.5: obniżka ceny o 90%, nowy tokenizer i film, którego Anthropic nie opublikował
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Ktoś wpisał jedno zdanie do Claude Haiku 5.5 i otrzymał gotowy film premierowy. Prompt opublikowany na X wieczorem 7 października 2026 r. brzmi w całości: „zrób 10 razy bardziej sztosowy film na swoją premierę, który pokaże, jak dobrym jesteś motion designerem”. Podpis posta ma trzy słowa — „One shotted this video” — a sam klip jest dołączony jako załącznik. Żadnych ponownych prób, żadnego storyboardu, żadnego montażysty. Jeśli to potrafi teraz najtańszy model w linii Claude, ta półka przestała być kompromisem.
To jest ciekawa połowa premiery. Drugą połową jest arytmetyka i to w niej mieści się właściwa nowina: Claude Haiku 5.5 kosztuje 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych dla promptów o długości do 100 000 tokenów, w porównaniu z Claude Haiku 4.5, którego stawki są stałe i wynoszą 1 USD i 5 USD. Własny przypis Anthropic nazywa to obniżką o 90% w typowym przypadku — a potem, jednym tchem, mówi, że liczba, na której kupujący powinien opierać swoje plany, jest bliższa 75%. Obie liczby są poprawne, a różnica między nimi jest najważniejszym elementem w tym wydaniu.
Co Anthropic oficjalnie oświadczyło 7 października
Post premierowy dostawcy i jego dokumentacja cenowa są zgodne co do kształtu tego przedsięwzięcia, a to krok większy, niż zwykle idzie w parze z obniżką ceny.

• Cena — 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych dla promptów do 100 000 tokenów. Powyżej tego progu to samo żądanie jest rozliczane według stawek 0,50 USD i 2,50 USD. Odczyty z pamięci podręcznej kosztują 0,01 USD za milion do 100 tys. i 0,05 USD powyżej tego; zapisy do pamięci podręcznej kosztują 0,125 USD i 0,625 USD.
• Kontekst — 1 mln tokenów, z maksymalnie 128 000 tokenów wyjściowych. To to samo okno i ten sam limit tokenów wyjściowych, które oferują Fable 5.1, Claude Opus 5.5 i Claude Sonnet 5.5, odtworzone w najtańszym planie.
• Myślenie — adaptacyjne myślenie z parametrem effort, domyślnie ustawionym na medium. Anthropic twierdzi, że jest to pierwszy model klasy Haiku z regulowanym ustawieniem effort, co oznacza, że ten sam identyfikator modelu można uruchomić tanio lub ostrożnie, nie zmieniając niczego innego.
• Tokenizer — nowszy tokenizer współdzielony z Claude 4.7 i późniejszymi, który „generuje około 30% więcej tokenów dla tego samego tekstu”. Dokumentacja Anthropic podaje, że dokładny wzrost zależy od treści i charakteru obciążenia.
• Cykl życia — granica wiedzy czerwiec 2026 oraz zobowiązanie do wycofania „nie wcześniej niż 7 października 2027 r.”
• Dostępność — Claude API, Amazon Web Services, Google Cloud, Microsoft Azure i Claude Platform on AWS, wszystko naraz już od pierwszego dnia.
Naklejka 10x i rzeczywistość 75%
Dziesięć razy taniej to liczba, która rozejdzie się najdalej, i to ona najpewniej trafi do czyjegoś modelu budżetowego w niewłaściwym miejscu. Dotyczy promptów o długości do 100 000 tokenów. Haiku 5.5 nie utrzymuje tej stawki przez całe okno.
• Do 100 000 tokenów — 0,10 USD za wejście i 0,50 USD za wyjście, w porównaniu z 1 USD i 5 USD w przypadku Haiku 4.5. To obniżka o 90%, a Anthropic twierdzi, że 90% żądań kierowanych do poprzedniego modelu Haiku mieściło się w tym przedziale.
• Ponad 100 000 tokenów — 0,50 USD za wejście i 2,50 USD za wyjście. Wciąż dokładnie połowa tego, co pobierał Haiku 4.5, za to samo żądanie, bez pułapu, który trzeba by osiągnąć.
• Tokenizer — ten sam tekst daje około 30% więcej tokenów niż w Ha 4.5, więc obniżka ceny za token nie przekłada się jeden do jednego na mniejszy rachunek.
• Własna średnia dostawcy — Anthropic przedstawia tę kombinację jako „około 75% mniej do uruchomienia”. To jego własna liczba, a nie niezależny pomiar, i właśnie ją należy uwzględnić w prognozie.
• Ekonomika pamięci podręcznej — odczyty z pamięci podręcznej spadły z 0,10 USD do 0,01 USD za milion w typowym przedziale, co ma większe znaczenie niż stawka za dane wejściowe w przypadku każdego potoku, który ponownie wysyła długi współdzielony prefiks.
Liczba 75% wyjaśnia też coś, co czytelnik mógłby w przeciwnym razie odczytać jako sprzeczność. Te dwie główne liczby nie są ze sobą sprzeczne; jedna to wskaźnik dla określonego kształtu żądania, druga to uśrednione oszacowanie dla rzeczywistej mieszanki ruchu, obejmującej mniejszość powyżej 100K oraz dodatkowe tokeny tokenizera. Jeśli modelujesz wydatki, użyj 75% i sprawdź własny rozkład długości promptów, zanim uwierzysz w lepszy wynik.
Co wideo twierdzi, a czego nie twierdzi
Nagranie jest prawdziwe, prompt przytoczono dosłownie powyżej, a znacznik czasu — 19:49 UTC 7 października, mniej więcej tego samego dnia, w którym model został uruchomiony — można zweryfikować. Przypisanie dotyczy indywidualnego użytkownika, a nie Anthropic.
To rozróżnienie ma tutaj znaczenie, ponieważ własna strona produktu Claude Haiku 5.5 firmy Anthropic nie zawiera żadnego osadzonego wideo: ani odtwarzacza, ani pliku multimedialnego, tylko link do kanału YouTube tej firmy. Jeśli film premierowy powstał z tym modelem, dostawca tego nie powiedział. Zatem trafne stwierdzenie jest wąskie: użytkownik zgłasza, że wygenerował wideo premierowe za jednym podejściem przy użyciu Claude Haiku 5.5, i opublikował prompt. To, czy było to jedno podejście, ile kosztowało i ile z tego przetrwało montaż, to wszystko twierdzenia z jednego źródła. Traktuj ten klip jako demonstrację, a nie jako benchmark.
Powód, dla którego warto o tym mimo wszystko wspomnieć, jest taki, że generowanie wideo nie należy do specyfikacji modelu. Haiku 5.5 przyjmuje tekst i obrazy, a zwraca tekst. Wynik z zakresu motion designu o takiej jakości sugeruje, że model sterował czymś innym — ścieżką generowania kodu, potokiem renderowania, pętlą narzędziową — a nie sam tworzył klatki. To stwierdzenie o orkiestracji agentowej przy wejściu za $0.10, co jest właściwie najbardziej zaskakującą częścią.
Liczby opublikowane przez Anthropic
Tabela premierowa dostawcy to zestawienie przed i po w porównaniu z Haiku 4.5, z GPT-6 Luna i Claude Sonnet 5.5 w tych samych kolumnach dla skali. Każda liczba poniżej to własny, raportowany przez Anthropic wynik ewaluacji, uruchomiony na harnessie Anthropic, i jest przytoczona, ale niezweryfikowana niezależnie.

• Praca wiedzowa — GDPval-AA v2.1 na poziomie 1620 wobec 735 dla Haiku 4.5, 1437 dla GPT-6 Luna i 1840 dla Sonnet 5.5. AA-Briefcase v1.1 na poziomie 1578 wobec 614, 1336 i 1824.
• Korzystanie z komputera — OSWorld 2.1 osiąga 72,4% w podzbiorze offline, wobec 15,7% dla Haiku 4.5, 48,9% dla GPT-6 Luna i 83,9% dla Sonnet 5.5.
• Rozumowanie multidyscyplinarne — Humanity's Last Exam na poziomie 45,9% bez narzędzi i 57,4% z nimi, w porównaniu z 10,2% i 18,7% dla Haiku 4.5.
• Kodowanie agentowe — Terminal-Bench 4.0 osiąga 39,2% wobec 0,0%, 16,4% i 70,6%. FrontierCode 1.1 (Main) osiąga 46,4% wobec 42,4% dla GPT-6 Luna i 52,1% dla Sonnet 5.5.
• Rozumowanie wizualne — Chartography na poziomie 46,4% bez narzędzi, w porównaniu z 6,4%, 29,1% i 61,6%.
Anthropic jest także niezwykle bezpośrednie w kwestii tego, gdzie mniejsza klasa modeli nie wygrywa. W swoim własnym komentarzu do wykresu Terminal-Bench firma stwierdza, że Sonnet 5.5 i Opus 5.5 „pozostają lepszym wyborem do złożonych agentowych zadań programistycznych”, a Haiku 5.5 pozycjonuje zamiast tego do kompresji, podsumowywania i pracy podagentów. Cytaty klientów w poście wskazują ten sam kierunek i niosą to samo zastrzeżenie — to partnerzy z wczesnego dostępu opisujący własne ewaluacje, a nie audyty: Asana raportuje ponad 30% niższe opóźnienie ukończenia zadań i do 2,5x szybszą inferencję na turę agenta; HubSpot raportuje 92,8% średnio z trzech przebiegów w zestawie testów portalu CRM; AlphaSense raportuje 0,84 wobec 0,76 w 400 zapytaniach na obciążeniu wykonującym około 8 mln wywołań tygodniowo; Box raportuje o 11 punktów więcej niż Haiku 4.5 przy około połowie opóźnienia; Rogo opisuje podagenta Haiku 5.5 wyciągającego pozycję przychodów segmentu z dokumentu 10-K; a Cognition raportuje, że Devin Fusion utrzymuje wynik FrontierCode na poziomie 66,2 z Haiku 5.5 w roli pomocnika.
Co mówi niezależna rada
Tabele dostawcy należą do dostawcy. Pierwsze zewnętrzne umieszczenie w rankingu to użyteczniejsza liczba dla każdego, kto decyduje, czy dany poziom przesunął się wystarczająco daleko, by zmienić potok produkcyjny.

Artificial Analysis ocenia Claude Haiku 5.5 na 43 w swoim Intelligence Index v4.3.2 w konfiguracji Max tego modelu, co daje mu drugie miejsce spośród 182 modeli na tej liście i znacznie powyżej mediany tej listy wynoszącej 13. Ta sama strona podaje 242 tokeny wyjściowe na sekundę — dziewiąte miejsce na 182 — oraz koszt 0,21 USD na zadanie Intelligence Index.
Dwie rzeczy na tej stronie są warte więcej niż nagłówek. Pierwsza to gadatliwość: oceniając Index, Artificial Analysis odnotowała 440 mln tokenów wyjściowych wobec mediany 100 mln i opisuje model jako „bardzo gadatliwy”. Cena jest naliczana za token, więc model, który myśli długo, za to płaci — i właśnie dlatego koszt na zadanie wynosi 0,21 USD, a nie blisko zera, i dlatego 90-procentowe cięcie na wejściu to nie cała historia. Druga to drabinka wysiłku: ta sama strona ujawnia konfiguracje od Max w dół do Low, a domyślne ustawienie Anthropic to medium, nie max. Wynik 43 na tablicy wyników to szczyt tej drabinki, a nie ustawienie, które dostajesz, jeśli nic nie zrobisz.
Ogrywanie poziomu poniżej tego, który możesz już wywołać
Claude Haiku 5.5 nie znajduje się w katalogu OrcaRouter i warto byłoby powiedzieć to wprost, zamiast sugerować coś przeciwnego: odstęp w dniu premiery między istnieniem modelu a możliwością routowania go wynosi zwykle kilka dni, a czasem dłużej.
To, co dziś znajduje się w katalogu Anthropic, to Claude Haiku 4.5, Claude Sonnet 5.5 i Claude Opus 5.5, każdy w cenie katalogowej dostawcy przekazanej dalej z 0% narzutem, więc każda obniżka, jaką wprowadzi Anthropic, trafia po naszej stronie tego samego dnia, w którym trafia po ich stronie. To praktyczny pomost dla każdego, kto chce już teraz przetestować wzorzec subagenta: kaskada, która kieruje rutynowe tury do Haiku 4.5 i eskaluje trudne w górę, działa już dziś w ramach jednego klucza i jednego SDK, a późniejsza zamiana małej odnogi na Haiku 5.5 to zmiana identyfikatora modelu, a nie migracja. Automatyczne przełączanie awaryjne działa pod spodem niezależnie od tego, które odnogi wybierzesz, więc zły dzień jednego dostawcy nie pociąga za sobą całego pipeline'u.
Jeśli wolisz w ogóle nie czekać, ta sama stawka wejściowa 0,10 USD jest już zajęta przez GPT-6 Luna, który faktycznie obsługujemy i który utrzymuje tę stawkę aż do 272 000 tokenów, zanim wzrośnie.
Kto powinien się przenieść, a kto nie
Jeśli Twoje obciążenie to klasyfikacja, ekstrakcja, routing, kompaktowanie lub streszczanie na dużą skalę, a Twoje prompty mieszczą się poniżej 100 000 tokenów, sprawa jest prosta: stawka to jedna dziesiąta tego, co było, okno jest pięć razy szersze, a suwak wysiłku pozwala pójść w drugą stronę, gdy wymaga tego żądanie. Zaplanuj budżet o około 75% niższy, a nie spotka Cię niespodzianka.
Jeśli Twoje prompty regularnie przekraczają 100 000 tokenów, kupujesz 50-procentową obniżkę, a nie 90-procentową, a porównywanie ofert pod kątem głębokiego kontekstu wciąż jest warte poświęcenia popołudnia — na rynku jest kilka modeli w cenie równej lub niższej od stawki tego poziomu za ponad 100 tys. tokenów.
A jeśli twoja ewaluacja nadal zawodzi na zadaniach w stylu Terminal-Bench, to nie jest model, który to naprawi; Anthropic sam to mówi, a 39,2% przeciwko 70,6% Sonnet 5.5 to najczystszy dowód w poście. Uczciwe podsumowanie 7 października jest takie, że dolna granica użytecznej inteligencji znacznie się obniżyła, a górna wcale się nie przesunęła.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
