
Claude Haiku 5.5 w OpenCode Go: Co tak naprawdę daje 10 dolarów miesięcznie
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Anthropic wypuścił Claude Haiku 5.5 7 października 2026 roku i w ciągu jednego dnia znalazł się on w katalogach Go i Zen OpenCode — subskrypcji dla agentów kodujących, które rozliczają miesięczny limit w dolarach, zamiast naliczać opłaty za tokeny. Warto na chwilę zatrzymać się przy tym drugim wpisie, bo limit, który OpenCode publikuje dla Claude Haiku 5.5, nie jest zniżką na model. To licznik budżetu ustawiony na cenę katalogową samego Anthropic, a każdą liczbę, która za nim stoi, można sprawdzić na dwóch stronach, które ją publikują. Jeśli wciąż zastanawiasz się, co wywołać zamiast Claude Haiku 4.5, decydujący jest limit, a nie metka.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Co Anthropic oficjalnie oświadczyło 7 października
Dostawca nie wypuścił tego po cichu. W newsroomie Anthropic znajduje się opatrzone datą ogłoszenie, strona produktu z tabelą benchmarków, karta systemowa, tabela cen oraz pięć wypowiedzi nazwanych klientów. Nie ma żadnego repozytorium ani wydania wag do sprawdzenia, ponieważ nie ma czego wydawać: Artificial Analysis odnotowuje Claude Haiku 5.5 jako zastrzeżony, a liczba parametrów nie została ujawniona. Każdy, kto opisuje to jako wyciekły lub niezapowiedziany model, czyta repozytorium, które nie istnieje.
Własne ujęcie Anthropic to model wolumenowy, a nie frontierowy:
• Pozycjonowanie — „najtańszy, najszybszy i najbardziej zaawansowany mały model, jaki kiedykolwiek wydaliśmy”, przeznaczony do podsumowań, kompaktowania, zapytań do baz danych i klasyfikacji, a także reklamowany jako podagent, który współpracuje z Claude Opus 5.5 i Claude Sonnet 5.5 przy pracy programistycznej.
• Cena — 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych dla promptów do 100 000 tokenów; 0,50 USD i 2,50 USD powyżej tego. Odczyty z pamięci podręcznej 0,01 USD / 0,05 USD, zapisy do pamięci podręcznej 0,125 USD / 0,625 USD.
• Kontekst i wyjście — okno 1 mln tokenów z maksymalnym wyjściem 128 000 tokenów, ten sam zakres, jaki mają większe modele z poziomu 5.5, odtworzony na najtańszym poziomie.
• Wysiłek — pierwszy model klasy Haiku z regulowanym ustawieniem wysiłku, działającym w zakresie od niskiego do maksymalnego, domyślnie średni. Anthropic publikuje krzywe dokładności względem kosztu dla każdego ustawienia, a nie pojedynczą liczbę.
• Benchmarki, podane przez producenta i nieodtworzone niezależnie — GDPval-AA v2.1 1620 w porównaniu z 735 dla Claude Haiku 4.5; AA-Briefcase v1.1 1578 w porównaniu z 614; OSWorld 2.1 72,4% w porównaniu z 15,7%; Humanity's Last Exam 45,9% bez narzędzi i 57,4% z nimi, w porównaniu z 10,2% i 18,7%; Terminal-Bench 4 39,2% w porównaniu z 0,0%; Chartography 46,4% w porównaniu z 6,4%.
• Własny sufit dostawcy — komentarz Anthropic do jego wykresu Terminal-Bench mówi, że Claude Sonnet 5.5 i Claude Opus 5.5 „pozostają lepszym wyborem do złożonych zadań kodowania agentowego”. Cytaty klientów w tym samym poście to partnerzy z wczesnym dostępem opisujący własne ewaluacje, a nie audyty: Asana raportuje ponad 30% niższe opóźnienie i do 2,5x szybsze wnioskowanie na turę agenta, HubSpot 92,8% uśrednione z trzech przebiegów, AlphaSense 0,84 wobec 0,76 w 400 zapytaniach na obciążeniu około 8 mln wywołań tygodniowo, Box 11 punktów wyżej przy około połowie opóźnienia, a Cognition wynik FrontierCode 66,2 z Haiku 5.5 jako pomocnikiem.

Anthropic wykorzystał także premierę, aby zmienić dwie sąsiadujące ceny: odczyty z pamięci podręcznej w Claude Sonnet 5.5 zostały obniżone o połowę, do 0,10 USD za milion tokenów, co — jak twierdzi firma — sprawia, że Sonnet 5.5 jest o około 20% tańszy w większości prac agentowych, oraz nowy miesięczny kredyt API dla subskrybentów Claude Max i Team. Obie zmiany dotyczą wyższego planu i obie mają większe znaczenie dla zespołu, który już obrał Sonnet za standard, niż dla kogoś, kto szuka małego modelu.
Przydział to budżet dolarowy, a nie rabat.
Oto część, o której nie mówi tweet z ogłoszeniem. Dokumentacja Go OpenCode podaje, że „limity użycia są zdefiniowane jako miesięczne kwoty w dolarach”, że ceny tokenów są takie same w obu planach oraz że przydział dla każdego modelu zmniejsza się zgodnie z ustalonym harmonogramem: 20% miesięcznego limitu na każde pięć godzin, 50% na tydzień, 100% na miesiąc. Dokumentacja publikuje również profil tokenów na żądanie, który zakłada dla tego modelu — 1100 tokenów wejściowych, 55 000 tokenów z pamięci podręcznej, 240 tokenów wyjściowych.
Przepuść te dane przez cennik Anthropic, a opublikowane liczby żądań przestają wyglądać jak arbitralna alokacja:
• Koszt na żądanie według ceny katalogowej — 1 100 wejść po 0,10 USD/M plus 55 000 odczytów z pamięci podręcznej po 0,01 USD/M plus 240 wyjść po 0,50 USD/M daje 0,00078 USD.
• Miesięczna liczba żądań — 15 USD podzielone przez 0,00078 USD daje 19 230, i właśnie tę liczbę podaje dokumentacja. Przydział 60 USD w planie za 40 USD daje po podzieleniu 76 923, a dokumentacja podaje 76 920.
• Redukcja — 20% z 19 230 to 3 846, wyświetlane jako 3 850 na pięć godzin; 50% to 9 615, wyświetlane jako 9 620 na tydzień. Go Plus stosuje tę samą arytmetykę dla 15 380 i 38 460.
• Co to oznacza w dolarach — ten przydział odpowiada tokenom o wartości 15 USD według cen Anthropic w planie za 10 USD i 60 USD w planie za 40 USD. Subskrypcja za 10 USD pozwala więc kupić co najwyżej tokeny tego modelu o wartości 15 USD miesięcznie, jeśli wydasz cały przydział na Claude Haiku 5.5 i nic więcej.
To uczciwy sposób odczytywania plakietki „Nowy” na stronie Go. Subskrypcja jest tania, model jest tani, a te dwa fakty są niezależne: przydział to budżet rozliczany według własnej stawki dostawcy, więc plan ogranicza to, ile możesz wydać, a nie to, jak mało kosztuje model. Intensywni użytkownicy dobijają do sufitu i płacą bezpośrednio firmie Anthropic — albo sami kierują ruch do modelu.

Dziewięćdziesiąt procent, siedemdziesiąt pięć procent i pięciokrotny klif
Główny przekaz Anthropic jest taki, że Claude Haiku 5.5 kosztuje około 90% mniej niż Claude Haiku 4.5 w przypadku promptów o długości do 100 000 tokenów i że średnio „kosztuje teraz około 75% mniej w eksploatacji”. Obie liczby pochodzą od dostawcy. Obie są również poprawne, a różnica między nimi to całe ryzyko cenowe.
• W tym przedziale — 0,10 USD za wejście i 0,50 USD za wyjście, w porównaniu z jednolitymi stawkami 1 USD i 5 USD w Haiku 4.5. Anthropic twierdzi, że około 90% żądań do jej poprzedniego modelu Haiku mieściło się w tym przedziale, i stąd pochodzi liczba 90%.
• Powyżej tego przedziału — to samo żądanie jest rozliczane po 0,50 USD za wejście i 2,50 USD za wyjście, co oznacza pięciokrotny wzrost stawki za dane wejściowe. To wciąż połowa stawki Haiku 4.5, ale daleko temu do obniżki o 90%.
• Uśrednione twierdzenie — liczba 75% to własne oszacowanie firmy Anthropic na podstawie rzeczywistego miksu ruchu, a nie cennik stawek, i to jest liczba, którą należy wpisać do prognozy.
• Tokenizator — nowszy tokenizator współdzielony z Claude 4.7 i późniejszymi wersjami generuje około 30% więcej tokenów dla tego samego tekstu, zgodnie z dokumentacją samego Anthropic, więc obniżka stawki za token nie przekłada się jeden do jednego na mniejszy rachunek.
Pokrętło wysiłku potęguje to wszystko. Ponieważ domyślne ustawienie to medium, a publikowane krzywe sięgają aż do Max, ten sam prompt może kosztować kilkukrotnie więcej w zależności od parametru, którego większość wywołujących nigdy nie ustawia — a szacunki żądań OpenCode zakładają jeden stały profil tokenów przy jednym niejawnym ustawieniu. Jeśli Twoje prompty oscylują w okolicach 100 000 tokenów, uruchamiasz subagenta o ograniczonym użyciu albo przesuwasz pokrętło wysiłku, nagłówek z 90% nie jest liczbą, którą zobaczysz.
Niezależna rada zgadza się co do wyniku i sygnalizuje problemy z własnymi obliczeniami.
Artificial Analysis przyznaje Claude Haiku 5.5 21 punktów w swoim Intelligence Index v4.3.2 w konfiguracji Mini tego modelu, przy medianie w rankingu wynoszącej 13, i osiąga 241,9 tokenów wyjściowych na sekundę w porównaniu z medianą dla porównywalnego modelu wynoszącą 110,9. Ta sama strona podaje koszt na poziomie 0,21 USD za zadanie Intelligence Index i informuje, że model wygenerował 440 milionów tokenów wyjściowych w porównaniu z medianą 100 milionów — określając go jako „bardzo gadatliwy”.
Gadatliwość to punkt, w którym oba rankingi na siebie oddziałują. Powyższa arytmetyka limitu jest rozliczana za token, więc model, który rozumuje rozwlekle, zużywa budżet szybciej, niż sugerowałaby liczba żądań, a profil OpenCode wynoszący 55 000 tokenów z pamięci podręcznej na żądanie to założenie dotyczące buforowania podpowiedzi, które użytkownik subskrypcji może, ale nie musi odtworzyć. Dwie informacje ujawnione na stronie Artificial Analysis są warte więcej niż jej nagłówek: liczba 43 dotyczy konfiguracji Max, a nie ustawienia wysiłku, które otrzymujesz, nic nie robiąc, a strona zawiera wyraźną uwagę, że Claude Haiku 5.5ma 5x wyższą cenę za dane wejściowe o dłuższym kontekście, co obecnie nie znajduje odzwierciedlenia w jej wartościach kosztów. Przepaść długiego kontekstu jest realna, a niezależny ranking powiedział ci, że jeszcze nie ma jej we własnych liczbach.

Linia o retencji, którą większość kupujących pominie
Dokumentacja Go OpenCode zawiera tabelę prywatności dla poszczególnych modeli, a to jest wiersz, w którym Claude Haiku 5.5 różni się od większości katalogu. Producent sam określa to jako zerowe przechowywanie z wyjątkami. Większość modeli w tej tabeli Go ma „0 dni”. Ten ma „30 dni”, z adnotacją, że żądania są przechowywane przez 30 dni zgodnie z politykami danych Anthropic — takie samo traktowanie, jakie stosuje wobec GPT-6 Luna i GPT-5.6 Luna, i odwrotność wierszy z zerowymi dniami, które stanowią większość listy.
W przypadku agenta programistycznego oznacza to, że prompty, ścieżki plików i wklejony kod źródłowy mogą przez miesiąc znajdować się u dostawcy zewnętrznego, w ramach planu, którego język marketingowy mówi o zerowym przechowywaniu. To nie jest powód, by unikać modelu; to powód, by czytać wiersz tabeli, a nie baner. Tymczasem nic w materiałach premierowych Anthropic nie zmienia stanowiska po stronie API: Claude API oferuje zerowe przechowywanie danych, a warunki przechowywania z karty modelu są tymi, które regulują bezpośrednią integrację.
Co jest potwierdzone, a co nie
Potwierdzony zbiór jest duży i konkretny, co jest nietypowe dla tak nowego modelu. To, co nie zostało potwierdzone, jest węższe i warto je nazwać, a nie przemilczeć:
• Potwierdzone — model istnieje, jest dostępny wyłącznie przez API pod identyfikatorem claude-haiku-5-5, udostępniony 7 października w Claude API oraz Amazon Web Services, Google Cloud i Microsoft Azure, w podanych powyżej cenach, z oknem 1 mln tokenów, regulowanym poziomem wysiłku i opublikowaną kartą systemową.
• Potwierdzone — tego samego dnia dwie platformy zewnętrzne mają to na liście wraz z identyfikatorami modeli, punktami końcowymi i przydziałami rozliczanymi według zużycia.
• Niepotwierdzone — nie znaleźliśmy żadnego niezależnego benchmarku, który odtworzyłby tabelę dostawcy. Każda wartość dokładności w poście Anthropic o premierze pochodzi z własnego narzędzia testowego Anthropic, a każdy cytat klienta to relacja partnera z jego własnych wczesnych testów.
• Nie potwierdzono — nie ma wag, repozytorium, punktu kontrolnego ani licencji do wglądu. Model jest zamknięty, a wszelkie twierdzenia o jego architekturze lub rozmiarze to domysły.
• Niepotwierdzone — czy szacunki zapytań platformy utrzymują się w warunkach innych niż zakładany przez nią profil tokenów oraz czy (lub kiedy) 5-krotna cena długiego kontekstu trafi do danych kosztowych niezależnych rankingów.
Uruchamianie tego obok tego, co już nazywasz
Praktyczne pytanie, jakie rodzi ta premiera, nie brzmi: „czy Haiku 5.5 jest dobry” — tabela dostawcy mówi, że tak, a nikt poza Anthropic tego nie sprawdził. Brzmi ono: „jaki jest rachunek i co się stanie, gdy tania warstwa nie jest właściwą warstwą dla tego konkretnego wywołania”. Obie części to problemy routingu.
Jeśli chodzi o koszty, licznikiem jest rachunek za tokeny, a nie cena na metce: redukcja wejścia o 90% plus tokenizer większy o 30% plus rozwlekły model rozumujący plus pięciokrotny skok w długim kontekście oznaczają, że liczba, którą prognozujesz, i liczba, którą płacisz, rozjeżdżają się, chyba że mierzysz własny rozkład długości promptów. Model, który powyżej 100 000 tokenów jest 5 razy droższy, premiuje kompakcję — a sam Haiku 5.5 jest reklamowany jako model do kompakcji, co jest pętlą wartą zauważenia.
Jeśli chodzi o ryzyko, nieprzetestowany poziom to dokładnie przypadek, w którym nie należy opierać na nim ścieżki produkcyjnej. Claude Haiku 4.5 jest już dostępny na OrcaRouter w cenie katalogowej Anthropic z 0% narzutu, więc stary poziom nie wymaga nowej umowy, a trasa, która przełącza się awaryjnie z nowego modelu na znany, to zmiana konfiguracji, a nie przepisanie. Parametr effort jest ustawiany dla każdego wywołania, co oznacza, że ten sam endpoint może wykonać streszczenie przy niskim effort i trudną ekstrakcję przy wysokim effort bez utrzymywania dwóch integracji — DSL routingu istnieje właśnie dla takiego rodzaju decyzji, a automatyczny failover to właśnie pozwala wystawić kilkudniowy model na rzeczywisty ruch, zanim będziesz mieć dla niego niezależne liczby. Co jeszcze nie jest prawdą, to rzecz oczywista: Claude Haiku 5.5 nie ma go dziś na naszych trasach, a jeśli chcesz go w tym tygodniu, wywołujesz Anthropic bezpośrednio albo korzystasz z platformy, która go ogłosiła.
Kto powinien przejść: zespoły, których wolumen to streszczenia, klasyfikacja, kompaktowanie i praca podagentów, gdzie obowiązuje pasmo 90%, a 30% tokenizatora to arytmetyka, którą możesz wchłonąć. Kto powinien poczekać: każdy, którego prompty rutynowo przekraczają 100 000 tokenów, każdy, kto potrzebuje niezależnego benchmarku przed zobowiązaniem, oraz każdy, którego kod nie może przebywać w 30-dniowym oknie retencji. Premiera jest prawdziwa, a cennik jest prawdziwy. Dowód wciąż jest po stronie dostawcy.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
