Wygenerowana karta hero dla „Jedna dziesiąta stawki to nie jedna dziesiąta rachunku”, z odznaką „PRZEPAŚĆ POKOLEŃ”, nadtytułem „DWA MODELE HAIKU, JEDENAŚCIE MIESIĘCY RÓŻNICY” i podtytułem „Claude Haiku 5.5 kontra Claude Haiku 4.5 w kwestii ceny, tokenów i nowego progu 100 000 tokenów”. Cztery chipy pokazują „$0.10 / $0.50”, „$1.00 / $5.00”, „kontekst 1M” i „30% więcej tokenów”. Dwie karty poniżej mają etykiety „CO MÓWI STAWKA” („o 90% niższe wejście i wyjście poniżej 100 000 tokenów”) oraz „CO MÓWI FAKTURA” („około 75% niższy koszt działania, przy około 30% więcej tokenów”). Stopka głosi: „Dokumentacja cenowa dostawcy sprawdzona 8 października 2026 r.”. Logo OrcaRouter jest wkomponowane w prawym dolnym narożniku.
Guides & Insights

Claude Haiku 5.5 vs Claude Haiku 4.5: 90-procentowa obniżka ceny to nie 90-procentowa oszczędność

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Claude Haiku 5.5 jest wyceniany na 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych w przypadku promptów do 100 000 tokenów. Claude Haiku 4.5 kosztuje 1 USD i 5 USD, ryczałtowo, za całe okno 200 000 tokenów, które ten model zawsze miał. Ant​hropic w jednym przypisie określa tę różnicę jako „90% mniej”, a w zdaniu powyżej jako „około 75% niższy koszt działania” — a jedenastomiesięczny odstęp między tymi dwoma modelami to dokładnie odległość między tymi dwiema liczbami.

To nie jest chwyt marketingowy. To uczciwy obraz generacji modelu, która zmieniła swój tokenizer, domyślny tryb myślenia i okno kontekstowe jednocześnie ze swoją ceną, a to oznacza, że każdy, kto podmienia identyfikator modelu i oczekuje, że rachunek spadnie dziesięciokrotnie, rozczaruje się arytmetyką, a nie produktem.

Oba modele, w wersji fabrycznej

Wszystko poniżej podano w przeliczeniu na milion tokenów, w dolarach amerykańskich, i odczytano z własnej dokumentacji cenowej i dokumentacji modeli Ant​hropic z dnia 2026-10-08, o ile nie oznaczono inaczej.

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• Wejście — Claude Haiku 5.5: 0,10 USD do 100 000 tokenów, 0,50 USD powyżej; Claude Haiku 4.5: 1,00 USD niezależnie od długości.

• Dane wyjściowe — Claude Haiku 5.5 0,50 USD do 100 000 tokenów, 2,50 USD powyżej tej wartości; Claude Haiku 4.5 5,00 USD niezależnie od długości.

• Odczyty z pamięci podręcznej — Claude Haiku 5.5: 0,01 USD do 100 000 tokenów i 0,05 USD powyżej; Claude Haiku 4.5: 0,10 USD. Zapisy do pamięci podręcznej — 0,125 USD i 0,625 USD wobec 1,25 USD.

• Kontekst — 1 mln tokenów wobec 200 000. Maksymalna długość wyjścia — 128 000 tokenów wobec 64 000.

• Myślenie — Claude Haiku 5.5 jest adaptacyjne i domyślnie włączone, z regulacją wysiłku domyślnie ustawioną na średni; Claude Haiku 4.5 przyjmuje starszą, ręczną formę i nie ma w ogóle parametru wysiłku.

• Niezależny wynik — Artificial Analysis Intelligence Index v4.3.2 plasuje Claude Haiku 5.5 (Max) na 43,40, na drugim miejscu wśród 182 modeli, a Claude 4.5 Haiku na 16,88, na trzydziestym miejscu wśród 61 — przy czym ewaluator oznacza wynik 4.5 jako oszacowany.

• Szybkość — to samo źródło mierzy 242 tokeny wyjściowe na sekundę dla Claude Haiku 5.5 wobec 89,7 dla generacji 4.5, co jest jedynym miejscem, w którym stary model wciąż wygląda dobrze.

Gdzie załamuje się narracja o dziesiątej części ceny

Trzy rzeczy uszczuplają tę obniżkę, a tylko pierwsza z nich to własne ostrzeżenie Anthropic.

Tokenizer to największa kwestia. Claude Haiku 5.5 korzysta z nowszego tokenizera wprowadzonego wraz z Claude 4.7, a dokumentacja Ant​hropic mówi, że ten sam tekst „liczy się jako około 30% więcej tokenów niż w Claude Haiku 4.5”. Nie płacisz jednej dziesiątej stawki za tę samą liczbę tokenów; płacisz jedną dziesiątą stawki za około 1,3 razy więcej tokenów. Przewodnik migracyjny samego dostawcy stawia to jako drugi punkt na swojej liście kontrolnej, przed każdą zmianą w kodzie: ponownie przelicz swoje prompty, a następnie zweryfikuj max_tokens i swoje szacunki kosztów.

Tokeny myślenia są rozliczane jako tokeny wyjściowe, a Claude Haiku 5.5 domyślnie myśli. Strona premiery Anthropic wprost stwierdza, że sam model jest „bardzo gadatliwy” na wykresach, a niezależny pomiar potwierdza to dobitniej niż sam dostawca: podczas oceny Intelligence Index Artificial Analysis odnotowało 440 milionów tokenów wyjściowych od Claude Haiku 5.5 wobec ogólnej mediany 100 milionów i oznaczyło model jako bardzo gadatliwy. Niska stawka za tokeny wejściowe nie pomaga obciążeniu, którego rachunek w większości stanowią tokeny wyjściowe.

Próg 100 000 tokenów to trzeci. Powyżej niego stawki wynoszą 0,50 USD i 2,50 USD — połowę tego, co Claude Haiku 4.5 pobierał za to samo żądanie, co jest dobrą ofertą, ale nie taką, o której większość czytelników przeczyta. Ant​hropic twierdzi, że prompty poniżej progu odpowiadały za około 90% żądań do poprzedniego modelu Haiku, co jest liczbą, która sprawia, że ta obniżka da się obronić w nagłówku; to także własna struktura ruchu dostawcy, nie twoja.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

Ile ta sama praca kosztuje oba modele

Koszt na ukończone zadanie to metryka, która przetrwa wszystkie trzy powyższe efekty, ponieważ obciąża model za wszystko, co wyemitował, a nie tylko za to, co mu wysłano.

Artificial Analysis wycenia Claude Haiku 5.5 (Max) na 0,21 USD za zadanie w Intelligence Index — wartość, którą publikuje obok stawki 0,10 USD za dane wejściowe i 0,50 USD za dane wyjściowe. Dla generacji 4.5 nie publikuje żadnej wartości kosztu na zadanie; kafelek pokazuje „nieznane”, ponieważ model nigdy nie został uruchomiony w Intelligence Index w konfiguracji rozumowania. Strona publikuje natomiast surowe ceny katalogowe 1,00 USD i 5,00 USD oraz inny, niższy zmierzony wynik.

Zatem uczciwe porównanie dla nabywcy to nie 10x na tokenach, ale coś bliższego temu: jedna dziesiąta stawki za tokeny wejściowe przy 30% większej liczbie tokenów, połowa stawki za tokeny wyjściowe po przekroczeniu 100K oraz model, który zużywa więcej tokenów wyjściowych na odpowiedź niż jego poprzednik — w zestawieniu ze skokiem możliwości z 16,88 do 43,40 na tej samej niezależnej tablicy wyników. Podawana przez Ant​hropic wartość 75% dla przeciętnych obciążeń to rozsądna liczba do planowania. Jest to również uśredniony szacunek dostawcy dla mieszanki ruchu, której nie kontrolujesz.

Migracja nie jest zamianą identyfikatora modelu

Przewodnik migracyjny Anthropic obejmuje dziesięć punktów dla każdego, kto przechodzi z Claude Haiku 4.5, a kilka z nich to krytyczne błędy, a nie wskazówki.

• Ręczne myślenie przestaje działać — thinking: {"type": "enabled", "budget_tokens": N} zwraca błąd. Zastępuje je myślenie adaptacyjne, a thinking.display trzeba ustawić na "summarized", jeśli w ogóle chcesz zobaczyć tok rozumowania.

• Parametry próbkowania powodują błędy — temperature, top_p i top_k wszystkie muszą zostać usunięte z żądania.

• Wstępne wypełnienie asystenta psuje się — rozmowa kończąca się na turze asystenta zwraca błąd; zakończ ją na turze użytkownika.

• Zmiany kolejności bloków — odpowiedź może zaczynać się od bloków myślenia, więc kod, który odczytuje pierwszy blok treści jako odpowiedź, musi wybierać według typu.

• Odmowy to nowość — model uruchamia klasyfikatory bezpieczeństwa, może zwrócić stop_reason: "refusal", a nie ma mechanizmu awaryjnego po stronie serwera.

• Odtwarzanie podlega ograniczeniom — bloki myślenia działają tylko w koncie, które je utworzyło, lub w koncie z nim powiązanym.

• Priority Tier nie jest przenoszony — organizacje posiadające zobowiązanie w ramach Priority Tier dotyczące Claude Haiku 4.5 muszą osobno planować przepustowość, ponieważ ten poziom nie jest obsługiwany w Claude Haiku 5.5.

Dwa z nich zasługują na więcej uwagi niż pozostałe. Powód zatrzymania „odmowa” to zmiana przepływu sterowania w każdej pętli, która zakładała, że każda odpowiedź ma treść, a bloki myślenia przypisane do konta psują każdą kolejkę, która przechowuje rozmowy i odtwarza je przez pulę poświadczeń. Żaden z nich nie daje o sobie znać aż do produkcji.

Uruchamianie obu poziomów pod jednym kluczem

Dla większości zespołów praktyczne pytanie nie brzmi, który z tych dwóch modeli jest lepszy, ponieważ odpowiedź zależy wyłącznie od tego, jakie wywołanie wykonujesz. Brzmi ono, czy tanią część kaskady można ulepszyć niezależnie od wszystkiego wokół niej.

Claude Haiku 4.5 jest już dostępny w katalogu OrcaRouter w cenie katalogowej Anthropic z 0% marży, więc stawka dostawcy jest przekazywana wprost, a każda zmiana, jaką Anth​ropic w niej wprowadzi, pojawia się po naszej stronie tego samego dnia. Claude Sonnet 5.5 i Claude Opus 5.5 również tam są, co oznacza, że dwupoziomowy pipeline — mały model dla rutynowej większości, większy model do eskalacji — można teraz zbudować z jednym kluczem, jednym SDK oraz automatycznym przełączaniem awaryjnym pod spodem, a mniejszy etap później podmienić na Claude Haiku 5.5 jako zmianę identyfikatora modelu, a nie przepisywanie od zera.

Claude Haiku 5.5 nie ma jeszcze w katalogu i warto powiedzieć to wprost, a nie pozostawiać tego w domyśle. Luka w dniu premiery między wydaniem modelu a możliwością kierowania do niego ruchu jest normalna i nie stanowi obietnicy co do tego, kiedy się zakończy; modele, które możemy wywoływać od dzisiejszego poranka, to te wymienione powyżej.

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

Kto powinien się przełączyć i które połączenie przełączyć najpierw?

Jeśli Twoje obciążenie Haiku 4.5 to klasyfikacja, ekstrakcja, routing, kompaktowanie lub streszczanie z promptami poniżej 100 000 tokenów, przejdź — stawka to jedna dziesiąta, okno jest pięć razy szersze, a suwak wysiłku daje Ci dźwignię kosztową, której stary model nigdy nie miał. Zaplanuj budżet o około 75% niższy i po tygodniu uzgodnij go z własnymi zliczeniami tokenów.

Jeśli Twoje prompty regularnie przekraczają 100 000 tokenów, kupujesz 50-procentową obniżkę, a nie 90-procentową, a drugi próg zmienia porównanie w taki sposób, że warto porównywać oferty: stawka 2,50 USD za tokeny wyjściowe powyżej 100 tys. jest wyższa niż to, co kilka konkurencyjnych małych modeli pobiera za całe okno.

A jeśli korzystasz z Haiku 4.5, bo była to jedyna tania opcja, która mieściła dokument o rozmiarze 200 000 tokenów, zauważ, co się zmieniło. Okno ma teraz milion tokenów, co czyni to innym produktem, a powód, by zachować stary model, po cichu zniknął wraz z powodem, dla którego był tani.