
Claude Haiku 5.5 vs Claude Haiku 4.5: 90-procentowa obniżka ceny to nie 90-procentowa oszczędność
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Claude Haiku 5.5 jest wyceniany na 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych w przypadku promptów do 100 000 tokenów. Claude Haiku 4.5 kosztuje 1 USD i 5 USD, ryczałtowo, za całe okno 200 000 tokenów, które ten model zawsze miał. Anthropic w jednym przypisie określa tę różnicę jako „90% mniej”, a w zdaniu powyżej jako „około 75% niższy koszt działania” — a jedenastomiesięczny odstęp między tymi dwoma modelami to dokładnie odległość między tymi dwiema liczbami.
To nie jest chwyt marketingowy. To uczciwy obraz generacji modelu, która zmieniła swój tokenizer, domyślny tryb myślenia i okno kontekstowe jednocześnie ze swoją ceną, a to oznacza, że każdy, kto podmienia identyfikator modelu i oczekuje, że rachunek spadnie dziesięciokrotnie, rozczaruje się arytmetyką, a nie produktem.
Oba modele, w wersji fabrycznej
Wszystko poniżej podano w przeliczeniu na milion tokenów, w dolarach amerykańskich, i odczytano z własnej dokumentacji cenowej i dokumentacji modeli Anthropic z dnia 2026-10-08, o ile nie oznaczono inaczej.

• Wejście — Claude Haiku 5.5: 0,10 USD do 100 000 tokenów, 0,50 USD powyżej; Claude Haiku 4.5: 1,00 USD niezależnie od długości.
• Dane wyjściowe — Claude Haiku 5.5 0,50 USD do 100 000 tokenów, 2,50 USD powyżej tej wartości; Claude Haiku 4.5 5,00 USD niezależnie od długości.
• Odczyty z pamięci podręcznej — Claude Haiku 5.5: 0,01 USD do 100 000 tokenów i 0,05 USD powyżej; Claude Haiku 4.5: 0,10 USD. Zapisy do pamięci podręcznej — 0,125 USD i 0,625 USD wobec 1,25 USD.
• Kontekst — 1 mln tokenów wobec 200 000. Maksymalna długość wyjścia — 128 000 tokenów wobec 64 000.
• Myślenie — Claude Haiku 5.5 jest adaptacyjne i domyślnie włączone, z regulacją wysiłku domyślnie ustawioną na średni; Claude Haiku 4.5 przyjmuje starszą, ręczną formę i nie ma w ogóle parametru wysiłku.
• Niezależny wynik — Artificial Analysis Intelligence Index v4.3.2 plasuje Claude Haiku 5.5 (Max) na 43,40, na drugim miejscu wśród 182 modeli, a Claude 4.5 Haiku na 16,88, na trzydziestym miejscu wśród 61 — przy czym ewaluator oznacza wynik 4.5 jako oszacowany.
• Szybkość — to samo źródło mierzy 242 tokeny wyjściowe na sekundę dla Claude Haiku 5.5 wobec 89,7 dla generacji 4.5, co jest jedynym miejscem, w którym stary model wciąż wygląda dobrze.
Gdzie załamuje się narracja o dziesiątej części ceny
Trzy rzeczy uszczuplają tę obniżkę, a tylko pierwsza z nich to własne ostrzeżenie Anthropic.
Tokenizer to największa kwestia. Claude Haiku 5.5 korzysta z nowszego tokenizera wprowadzonego wraz z Claude 4.7, a dokumentacja Anthropic mówi, że ten sam tekst „liczy się jako około 30% więcej tokenów niż w Claude Haiku 4.5”. Nie płacisz jednej dziesiątej stawki za tę samą liczbę tokenów; płacisz jedną dziesiątą stawki za około 1,3 razy więcej tokenów. Przewodnik migracyjny samego dostawcy stawia to jako drugi punkt na swojej liście kontrolnej, przed każdą zmianą w kodzie: ponownie przelicz swoje prompty, a następnie zweryfikuj max_tokens i swoje szacunki kosztów.
Tokeny myślenia są rozliczane jako tokeny wyjściowe, a Claude Haiku 5.5 domyślnie myśli. Strona premiery Anthropic wprost stwierdza, że sam model jest „bardzo gadatliwy” na wykresach, a niezależny pomiar potwierdza to dobitniej niż sam dostawca: podczas oceny Intelligence Index Artificial Analysis odnotowało 440 milionów tokenów wyjściowych od Claude Haiku 5.5 wobec ogólnej mediany 100 milionów i oznaczyło model jako bardzo gadatliwy. Niska stawka za tokeny wejściowe nie pomaga obciążeniu, którego rachunek w większości stanowią tokeny wyjściowe.
Próg 100 000 tokenów to trzeci. Powyżej niego stawki wynoszą 0,50 USD i 2,50 USD — połowę tego, co Claude Haiku 4.5 pobierał za to samo żądanie, co jest dobrą ofertą, ale nie taką, o której większość czytelników przeczyta. Anthropic twierdzi, że prompty poniżej progu odpowiadały za około 90% żądań do poprzedniego modelu Haiku, co jest liczbą, która sprawia, że ta obniżka da się obronić w nagłówku; to także własna struktura ruchu dostawcy, nie twoja.

Ile ta sama praca kosztuje oba modele
Koszt na ukończone zadanie to metryka, która przetrwa wszystkie trzy powyższe efekty, ponieważ obciąża model za wszystko, co wyemitował, a nie tylko za to, co mu wysłano.
Artificial Analysis wycenia Claude Haiku 5.5 (Max) na 0,21 USD za zadanie w Intelligence Index — wartość, którą publikuje obok stawki 0,10 USD za dane wejściowe i 0,50 USD za dane wyjściowe. Dla generacji 4.5 nie publikuje żadnej wartości kosztu na zadanie; kafelek pokazuje „nieznane”, ponieważ model nigdy nie został uruchomiony w Intelligence Index w konfiguracji rozumowania. Strona publikuje natomiast surowe ceny katalogowe 1,00 USD i 5,00 USD oraz inny, niższy zmierzony wynik.
Zatem uczciwe porównanie dla nabywcy to nie 10x na tokenach, ale coś bliższego temu: jedna dziesiąta stawki za tokeny wejściowe przy 30% większej liczbie tokenów, połowa stawki za tokeny wyjściowe po przekroczeniu 100K oraz model, który zużywa więcej tokenów wyjściowych na odpowiedź niż jego poprzednik — w zestawieniu ze skokiem możliwości z 16,88 do 43,40 na tej samej niezależnej tablicy wyników. Podawana przez Anthropic wartość 75% dla przeciętnych obciążeń to rozsądna liczba do planowania. Jest to również uśredniony szacunek dostawcy dla mieszanki ruchu, której nie kontrolujesz.
Migracja nie jest zamianą identyfikatora modelu
Przewodnik migracyjny Anthropic obejmuje dziesięć punktów dla każdego, kto przechodzi z Claude Haiku 4.5, a kilka z nich to krytyczne błędy, a nie wskazówki.
• Ręczne myślenie przestaje działać — thinking: {"type": "enabled", "budget_tokens": N} zwraca błąd. Zastępuje je myślenie adaptacyjne, a thinking.display trzeba ustawić na "summarized", jeśli w ogóle chcesz zobaczyć tok rozumowania.
• Parametry próbkowania powodują błędy — temperature, top_p i top_k wszystkie muszą zostać usunięte z żądania.
• Wstępne wypełnienie asystenta psuje się — rozmowa kończąca się na turze asystenta zwraca błąd; zakończ ją na turze użytkownika.
• Zmiany kolejności bloków — odpowiedź może zaczynać się od bloków myślenia, więc kod, który odczytuje pierwszy blok treści jako odpowiedź, musi wybierać według typu.
• Odmowy to nowość — model uruchamia klasyfikatory bezpieczeństwa, może zwrócić stop_reason: "refusal", a nie ma mechanizmu awaryjnego po stronie serwera.
• Odtwarzanie podlega ograniczeniom — bloki myślenia działają tylko w koncie, które je utworzyło, lub w koncie z nim powiązanym.
• Priority Tier nie jest przenoszony — organizacje posiadające zobowiązanie w ramach Priority Tier dotyczące Claude Haiku 4.5 muszą osobno planować przepustowość, ponieważ ten poziom nie jest obsługiwany w Claude Haiku 5.5.
Dwa z nich zasługują na więcej uwagi niż pozostałe. Powód zatrzymania „odmowa” to zmiana przepływu sterowania w każdej pętli, która zakładała, że każda odpowiedź ma treść, a bloki myślenia przypisane do konta psują każdą kolejkę, która przechowuje rozmowy i odtwarza je przez pulę poświadczeń. Żaden z nich nie daje o sobie znać aż do produkcji.
Uruchamianie obu poziomów pod jednym kluczem
Dla większości zespołów praktyczne pytanie nie brzmi, który z tych dwóch modeli jest lepszy, ponieważ odpowiedź zależy wyłącznie od tego, jakie wywołanie wykonujesz. Brzmi ono, czy tanią część kaskady można ulepszyć niezależnie od wszystkiego wokół niej.
Claude Haiku 4.5 jest już dostępny w katalogu OrcaRouter w cenie katalogowej Anthropic z 0% marży, więc stawka dostawcy jest przekazywana wprost, a każda zmiana, jaką Anthropic w niej wprowadzi, pojawia się po naszej stronie tego samego dnia. Claude Sonnet 5.5 i Claude Opus 5.5 również tam są, co oznacza, że dwupoziomowy pipeline — mały model dla rutynowej większości, większy model do eskalacji — można teraz zbudować z jednym kluczem, jednym SDK oraz automatycznym przełączaniem awaryjnym pod spodem, a mniejszy etap później podmienić na Claude Haiku 5.5 jako zmianę identyfikatora modelu, a nie przepisywanie od zera.
Claude Haiku 5.5 nie ma jeszcze w katalogu i warto powiedzieć to wprost, a nie pozostawiać tego w domyśle. Luka w dniu premiery między wydaniem modelu a możliwością kierowania do niego ruchu jest normalna i nie stanowi obietnicy co do tego, kiedy się zakończy; modele, które możemy wywoływać od dzisiejszego poranka, to te wymienione powyżej.

Kto powinien się przełączyć i które połączenie przełączyć najpierw?
Jeśli Twoje obciążenie Haiku 4.5 to klasyfikacja, ekstrakcja, routing, kompaktowanie lub streszczanie z promptami poniżej 100 000 tokenów, przejdź — stawka to jedna dziesiąta, okno jest pięć razy szersze, a suwak wysiłku daje Ci dźwignię kosztową, której stary model nigdy nie miał. Zaplanuj budżet o około 75% niższy i po tygodniu uzgodnij go z własnymi zliczeniami tokenów.
Jeśli Twoje prompty regularnie przekraczają 100 000 tokenów, kupujesz 50-procentową obniżkę, a nie 90-procentową, a drugi próg zmienia porównanie w taki sposób, że warto porównywać oferty: stawka 2,50 USD za tokeny wyjściowe powyżej 100 tys. jest wyższa niż to, co kilka konkurencyjnych małych modeli pobiera za całe okno.
A jeśli korzystasz z Haiku 4.5, bo była to jedyna tania opcja, która mieściła dokument o rozmiarze 200 000 tokenów, zauważ, co się zmieniło. Okno ma teraz milion tokenów, co czyni to innym produktem, a powód, by zachować stary model, po cichu zniknął wraz z powodem, dla którego był tani.
