
Claude Haiku 5.5: Anthropic mówi, że najtańszy plan nadchodzi — tygodnie po przecieku, który ogłosił, że jest martwy
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
Przez około dwa tygodnie we wrześniu wśród osób śledzących roadmapę dostawcy panowało robocze założenie, że najtańszy poziom Claude'a zostaje wycofany. Przeciek — post na X z konta znanego z twierdzeń o roadmapie dostawcy — mówił, że generacja 5.5 przebuduje ofertę: Claude Fable, Claude Opus i Claude Sonnet otrzymają wersje 5.5, Fable przejdzie na nową bazę pretreningową, a linia Haiku zniknie. Firma nigdy niczego z tego nie potwierdziła. Potem, 22 września 2026 r., wraz z premierą Claude Opus 5.5, firma powiedziała coś przeciwnego w jednym zdaniu: „Claude Sonnet 5.5 i Claude Haiku 5.5 pojawią się w nadchodzących tygodniach”. Claude Haiku 5.5 jest zatem ogłoszony, bez daty i niewydany — i istnieje wyłącznie dlatego, że plotka na jego temat była błędna. Obecnie dostępny mały model, Claude Haiku 4.5, to wciąż to, co można by nazwać dziś.
To, co następuje, to to, co jest faktycznie ustalone, co jest wnioskiem, a czego nikt jeszcze nie wie. To rozróżnienie ma tutaj większe znaczenie niż zwykle, ponieważ większość tego, co krąży na temat Haiku 5.5, to ekstrapolacja z poziomu znajdującego się powyżej niego.
Co jest faktycznie potwierdzone i przez kogo?
Potwierdzony zbiór jest mały i warto, aby taki pozostał.

• Ogłoszenie — własny wpis Anthropic ogłaszający premierę Claude Opus 5.5 stwierdza: „Claude Sonnet 5.5 i Claude Haiku 5.5 pojawią się w nadchodzących tygodniach”. To całość bezpośrednich dowodów. To zdanie w cudzym wpisie o premierze, a nie ogłoszenie Haiku 5.5.
• Zakres obietnicy — ten sam wpis mówi, że dwa modele otrzymają „wiele z tych samych ulepszeń w zakresie wydajności, efektywności i bezpieczeństwa” co Claude Opus 5. To lista kategorii, a nie specyfikacja. Żadnego benchmarku, żadnej ceny, żadnego okna kontekstowego, żadnego identyfikatora modelu, żadnej daty.
• Pozycja w hierarchii — Haiku jest najszybszy i najtańszy z trzech obecnych poziomów Anthropic, poniżej Sonnet i Opus. To prawda od czasu wprowadzenia tej linii i nie podlega to dyskusji.
• Harmonogram — „najbliższe tygodnie”, co wskazuje, że najwcześniejsze prawdopodobne przybycie nastąpi pod koniec września lub w październiku 2026 r., i nie mówi nic o najpóźniejszym terminie.
Wszystko inne w obiegu to albo twierdzenia autora przecieku, których Anthropic nie poparł i którym ogłoszenie przeczy w kluczowym punkcie, albo wnioski wyciągnięte z Claude Opus 5.5. Traktuj oba jako niezweryfikowane.

Plotka, konkretnie, i dlaczego była wiarygodna
Twierdzenie o wyjściu nie było głupie. Miało realną podstawę, a jego zrozumienie mówi coś o tym, jak traktowano mały tier Anthropic.
Claude Haiku 4.5 został wydany 15 października 2025 r. w cenie 1 USD za milion tokenów wejściowych i 5 USD za milion tokenów wyjściowych, z oknem kontekstowym o rozmiarze 200 tys. tokenów i limitem wyjścia wynoszącym 64 tys. tokenów. Był najszybszym modelem w ofercie i zdecydowanie najtańszym, a jego pozycjonowano jako dorównujący starszej generacji Sonnet w zadaniach programistycznych i agentowych przy około jednej trzeciej kosztu.
Wtedy ten poziom ucichł. Między Haiku 4.5 w październiku 2025 a premierą Opus 5.5 we wrześniu 2026 — jedenaście miesięcy — każdy inny poziom Claude'a zmienił się co najmniej dwa razy. Opus przeszedł 4.5, 4.6, 4.7, 4.8, 5, 5.5. Sonnet przeszedł 4.5, 4.6, 5. Fable pojawił się jako całkowicie nowy najwyższy poziom. Haiku nie zmienił się wcale. W tym samym okresie zobowiązanie Anthropic dotyczące wycofania Haiku 4.5 zostało przesunięte na „nie wcześniej niż 15 października 2026 r.” — data, do której, w chwili pisania tego tekstu, pozostały około trzy tygodnie.
Jedenastomiesięczna przerwa w segmencie, który kiedyś odświeżano mniej więcej co pół roku, plus dobiegające końca odliczanie do wycofania, to dokładnie taki kształt, jaki przyjmuje linia produktów schodząca z rynku. Taki był odczyt przecieku. Był to rozsądny odczyt. Był też błędny, a korekta przyszła od dostawcy, a nie od drugiego przeciekającego.
Co Haiku 5.5 niemal na pewno odziedziczy po Claude Opus 5.5
Ta sekcja to wnioskowanie. Jest oznaczona jako taka, ponieważ Anthropic nie potwierdził niczego z tego i ponieważ analogia do warstwy powyżej jest jedynym dostępnym źródłem sygnału.
Obietnica Anthropic dotycząca „wielu takich samych ulepszeń” daje wstępną listę. Claude Opus 5.5 został wydany z czterema właściwościami, które czytelnik może sprawdzić względem obecnego małego modelu:
• Kierunek cen — Claude Opus 5.5 kosztuje 4 USD za wejście / 20 USD za wyjście za milion, w porównaniu z 5 / 25 USD w Claude Opus 5, a odczyty z pamięci podręcznej zostały obniżone z 0,50 do 0,20 USD. Obniżka o 20% w modelu flagowym sprawia, że analogiczna obniżka w warstwie małych modeli jest prawdopodobna. To nie jest zobowiązanie i nic w ogłoszeniu tego nie mówi.
• Myślenie adaptacyjne — Claude Opus 5.5 nie akceptuje thinking: {"type": "disabled"} ani stałej wartości budget_tokens; oba zwracają błąd 400. Myślenie jest zawsze włączone, a kontrolą jest effort. Claude Haiku 4.5 jest dziś przeciwieństwem: używa starszej, ręcznej formy {"type": "enabled", "budget_tokens": N} i nie ma w ogóle parametru effort.
• Okno kontekstowe — Claude Opus 5.5 utrzymuje kontekst 1 mln tokenów przy maksymalnie 128 tys. tokenów wyjściowych. Claude Haiku 4.5 to 200 tys. przy 64 tys. na wyjściu. Skok do 1 mln to pojedyncza największa rzecz, która zmieniłaby to, do czego dobra jest niższa klasa modeli, a jednocześnie jest to ta, której nikt nie powinien zakładać.
• Zabezpieczenia — Claude Opus 5.5 może zwracać odmowę jako powód zatrzymania w szerszym zestawie kategorii, przy czym żądania dotyczące biologii są kierowane do Claude Opus 5, a większość żądań dotyczących cyberbezpieczeństwa do Claude Opus 4.8. Nie wiadomo, czy mniejszy poziom dziedziczy te same klasyfikatory, czy lżejszy zestaw.
Jeśli planujesz migrację przy założeniu, że Haiku 5.5 to tańszy Claude Opus 5.5 z mniejszym oknem kontekstowym, opierasz się na analogii. Ta analogia jest najlepszą dostępną i nie stanowi dowodu.
Dlaczego poziom ma większe znaczenie niż flagowiec
Flagowe premiery dostają rozgłos, a małe modele ruch — to niedopasowanie, które warto nazwać.
Claude Haiku 4.5 to model, który działa tam, gdzie wywołanie modelu następuje setki tysięcy razy dziennie, a cena za token jest całą decyzją produktową: klasyfikacja, ekstrakcja, routing, podsumowywanie, tani pierwszy przebieg w kaskadzie, podagent, który czyta pliki, aby drogi model nie musiał. Anthropic określa go mianem najszybszego modelu z inteligencją bliską czołowej, a profil opóźnień to potwierdza — niezależny pomiar wskazuje około 86 tokenów wyjściowych na sekundę przy 0,65 sekundy do pierwszego tokenu, szybciej w obu przypadkach niż mediana modelu nierezonującego w jego przedziale cenowym.
W przeciwieństwie do tego Haiku 4.5 nie jest modelem frontierowym i nie udaje, że nim jest. Jego niezależny wynik w Artificial Analysis Intelligence Index wynosi 15, co daje 28. miejsce spośród 61 modeli na tej liście, i jest oznaczony jako szacunkowy. To właśnie ta liczba sprawia, że odświeżenie 5.5 jest interesujące, a nie rutynowe: jeśli niższa klasa modeli zaliczy skok możliwości choćby zbliżony do tego, jaki wykonał Claude Opus 5.5, przesuwa to dolną granicę stosunku ceny do wydajności w pracy o dużym wolumenie, a wiele potoków produkcyjnych opiera się dokładnie na tej granicy.
Praktyczne pytanie, jakie stoi dziś przed czytelnikiem, nie brzmi, czy czekać. Brzmi: ile kosztuje czekanie. Jeśli budujesz na Haiku 4.5, jedenastomiesięczna luka jest już odpowiedzią na pytanie, czy ten poziom jest wystarczająco stabilny, by na nim polegać — dostawca właśnie powiedział ci, że jest. Jeśli wstrzymujesz migrację z powodu Haiku 5.5, wstrzymujesz ją dla modelu bez daty i bez opublikowanej specyfikacji, co jest gorszą pozycją niż wypuszczenie tego, co istnieje, i przejście, gdy pojawi się nowy.
Uruchamianie małego poziomu, który masz, obok tych powyżej

Powód, dla którego warto śledzić odświeżenie Haiku z perspektywy routingu, a nie przeglądu modeli, jest taki, że interesująca decyzja rzadko dotyczy tego, którego modelu użyć — chodzi o to, którego modelu użyć do którego wywołania. Kaskada, która kieruje łatwe 80% do małego modelu i eskaluje resztę, to standardowa strategia kosztowa, a działa tylko wtedy, gdy oba poziomy są osiągalne z tego samego miejsca przy użyciu tych samych poświadczeń.
Claude Haiku 4.5 jest już dostępny w OrcaRouter w cenie katalogowej Anthropic, podobnie jak Claude Opus 5 i Claude Sonnet 5 — jeden klucz API do wszystkich trzech, z 0% marży, co oznacza, że cena katalogowa dostawcy jest przekazywana bez narzutu. Gdy dostawca obniża cenę, obniżka obowiązuje u nas tego samego dnia, co ma większe znaczenie na poziomie, do którego odwołujesz się milion razy, niż na tym, do którego odwołujesz się sto razy. W przypadku samej kaskady DSL routingu pozwala złożyć poziomy w jedno wywołanie, dzięki czemu logika eskalacji znajduje się w trasie, a nie w Twojej aplikacji, a automatyczne przełączanie awaryjne sprawia, że słabszy dzień u jednego dostawcy nie pociąga za sobą awarii całego potoku.
Dwa szczere zastrzeżenia. Sam Claude Opus 5.5 nie znajduje się w OrcaRouter — najnowszy poziom nie zawsze jest najnowszą trasą, a my wolimy powiedzieć to wprost, niż sugerować inaczej. Nie można też skierować niczego związanego z Haiku 5.5, ponieważ jeszcze nie istnieje. Modele, które można dziś wywołać, to te wymienione powyżej.
Na co uważać, po kolei
Kiedy Haiku 5.5 już się pojawi, cztery fakty rozstrzygną niemal każde otwarte pytanie — a pojawią się one w przewidywalnej kolejności.
• Identyfikator modelu i okno kontekstowe ze strony przeglądu modeli Anthropic — identyfikator bez daty w formacie claude-haiku-5-5 byłby zgodny z konwencją od generacji 4.6 wzwyż, a okno 1 mln tokenów byłoby najważniejszą informacją.
• Cennik. Całym powodem istnienia tego poziomu jest jego cena. Liczba powyżej $1/$5 oznaczałaby repozycjonowanie; liczba równa lub niższa od tej wartości to po prostu ulepszenie.
• Czy myślenie jest wyłącznie adaptacyjne. Jeśli Haiku 5.5 odrzuca budget_tokens tak, jak robi to Claude Opus 5.5, to jest to zmiana łamiąca kompatybilność dla każdej integracji, która obecnie go ustawia, i jest to coś, co wychodzi na jaw dopiero przy uruchomieniu.
• Niezależne wyniki. Benchmarki producenta w tej klasie były historycznie hojne w porównaniu z tym, co mierzą niezależne gremia, więc pierwsza pozycja w Artificial Analysis jest warta więcej niż tabela z premiery.
Dopóki ich nie ma, prawdziwym stwierdzeniem jest to nudne: Anthropic powiedziało, że Claude Haiku 5.5 pojawi się w ciągu najbliższych tygodni, nie powiedziało, czym jest, a przeciek, który twierdził, że został anulowany, był błędny. Ta ostatnia część to wiadomość. Cała reszta to harmonogram.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
