Wygenerowana karta tytułowa hero z plakietką „Ogólna dostępność w GitHub Copilot – 7 października 2026”, z nadtytułem „Raport o dostępności modeli”, zatytułowana „Claude Haiku 5.5 w GitHub Copilot”, z podtytułem „Dziesięć razy taniej za token niż zastępowany przez niego model Haiku – dopóki żądanie nie przekroczy 100 000 tokenów”, trzy chipy o treści „$0.10 / $0.50 za mln”, „1 kredyt AI = $0.01” i „Pro: 1 500 kredytów/mies.” oraz trzy karty dla „Poziom krótki: poniżej 100 tys. tokenów”, „Poziom długi: każda stawka razy 5” i „Jeszcze nie ma go w naszym katalogu: Claude Haiku 4.5 jest”.
Guides & Insights

Claude Haiku 5.5 jest już dostępny w GitHub Copilot: ile kosztuje najtańszy model Anthropic w ramach budżetu kredytowego

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Claude Haiku 5.5 pojawił się w selektorze modeli GitHub Copilot 7 października 2026 r. — tego samego dnia, w którym dostawca go udostępnił — a wpis w changelogu, który go ogłosił, poświęca większość swojej objętości platformom. Visual Studio Code, Visual Studio, Copilot CLI, agent chmurowy GitHub Copilot, aplikacja Copilot, github.com, GitHub Mobile na iOS i Androida, środowiska IDE JetBrains, Xcode, Eclipse. Zdanie, które ma znaczenie, jeśli zarządzasz budżetem, jest krótsze: model jest rozliczany „według cennika dostawcy w ramach rozliczania na podstawie użycia”. W Copilot oznacza to kredyty AI, a stawki Claude Haiku 5.5 są wystarczająco niskie, że arytmetyka kredytów staje się interesującą częścią premiery, a nie dodatkiem. Ten artykuł przeprowadza tę arytmetykę, oddziela to, co GitHub faktycznie zademonstrował, od tego, co jedynie zadeklarował, i omawia dwa wyjątki w dokumentacji samego dostawcy, które relacje z premiery przeważnie pominęły.

Co GitHub wypuścił i dla kogo

Wpis nosi po prostu tytuł „Claude Haiku 5.5 in GitHub Copilot” i został opublikowany 7 października o 13:12 czasu pacyficznego. Jest dostępny dla subskrybentów Copilot Pro, Pro+, Max, Business i Enterprise — czyli dla każdego płatnego planu, a co godne uwagi, nie dla planu darmowego, w którym wybór modelu nadal odbywa się automatycznie, a nie przez użytkownika. Wdrożenie przebiega stopniowo, więc selektor w twoim edytorze może pozostawać kilka dni za dziennikiem zmian; jest to zaznaczone we wpisie, a nie pozostawione tobie do odkrycia.

Sposób, w jaki sam GitHub ujmuje, do czego służy ten model, wart jest uważnej lektury, ponieważ jest węższy niż ujęcie dostawcy:

• Szybka praca o dużej przepustowości — podagenci, szybkie edycje i zadania terminalowe, jak ujmuje to sam GitHub • Nie jest pozycjonowany jako zamiennik dużych modeli w selektorze, lecz jako tańsza warstwa pod nimi • Ogólnie dostępny, zgodnie z referencją obsługiwanych modeli GitHuba, która wymienia Claude Haiku 5.5 jako ogólnie dostępny, ze statusem GA • W tej samej referencji widnieje również wiersz dotyczący wersji IDE oznaczony jako TBD, co jest praktycznym powodem, dla którego wdrażanie z perspektywy edytora wygląda na stopniowe • Wyceniony według cennika dostawcy w ramach rozliczeń za użycie, a nie z narzutem specyficznym dla Copilot img src="2.png"> p>Otaczające daty w changelogu dają kontekst tempa, którego pojedyncza strona modelu nie zapewni. Claude Sonnet 5.5 trafił do Copilot 28 września, Claude Opus 5.5 — 22 września, a Claude Fable 5.1 — 1 września. Anthropic dostarcza integrację z Copilot mniej więcej co dwa do czterech tygodni, a GitHub realizuje każdą z nich w ciągu kilku dni. To tempo jest też powodem, dla którego tyka tu zegar: w połowie września GitHub opublikował zawiadomienie o wycofaniu „wybranych modeli GitHub Copilot" w połowie października, a następnie 2 października potwierdzenie tych usunięć. Jeśli wasz zespół przypina model w konfiguracji Copilot, to właśnie przypięcie jest teraz najbardziej narażone na zepsucie, a nie cena.

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

Karta stawek odczytywana jako księga kredytowa

Claude Haiku 5.5 jest rozliczany według dwóch stawek, przełączanych na podstawie rozmiaru żądania, a nie jakiegokolwiek ustawienia, które wybierzesz. Wszystko poniżej to własny, opublikowany cennik GitHub, a wszystkie wartości podano za milion tokenów:

• Przy 100 000 tokenów wejściowych lub poniżej — $0.10 za wejście, $0.01 za wejście z pamięci podręcznej, $0.125 za zapis do pamięci podręcznej, $0.50 za wyjście • Powyżej 100 000 tokenów wejściowych — $0.50 za wejście, $0.05 za wejście z pamięci podręcznej, $0.625 za zapis do pamięci podręcznej, $2.50 za wyjście • Claude Haiku 4.5, dla porównania — $1.00 za wejście, $0.10 za wejście z pamięci podręcznej, $1.25 za zapis do pamięci podręcznej, $5.00 za wyjście • Claude Sonnet 5.5, poziom wyżej — $2.00 za wejście, $0.10 za wejście z pamięci podręcznej, $2.50 za zapis do pamięci podręcznej, $10.00 za wyjście • Zapisy do pamięci podręcznej są rozliczane w modelach Anthropic osobno, ponad wejście z pamięci podręcznej — pozycja, która nie istnieje u każdego dostawcy w selektorze img src="3.png"> p>Z lektury tych wierszy razem wynikają dwie rzeczy. Po pierwsze, krótszy próg Claude Haiku 5.5 jest okrągłe dziesięć razy tańszy niż Claude Haiku 4.5 zarówno na wejściu, jak i na wyjściu, a na wejściu około dwadzieścia razy tańszy niż Claude Sonnet 5.5 — i to jest cały powód, dla którego należy on do slotów podagentów, gdzie rój drobnych wywołań mnoży to, co płacisz za każde wywołanie. Po drugie, próg długiego kontekstu to dokładnie pięć razy tyle co krótszy przy każdej stawce naraz, przy tej samej granicy 100 000 tokenów. Żądanie na 99 000 tokenów i żądanie na 101 000 tokenów nie różnią się o 2 procent w przypadku tokenów, które przekroczyły tę granicę; różnią się pięciokrotnie w przypadku wszystkich z nich. Ten skok jest dziedziczony wprost z ceny katalogowej Anthropic, a system kredytów Copilot go nie wygładza.

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

Teraz kredyty. Rozliczanie Copilota oparte na zużyciu przelicza użycie modelu na kredyty AI według udokumentowanej stawki 0,01 USD za kredyt, a każdy plan obejmuje miesięczną pulę:

• Copilot Pro, 10 dolarów miesięcznie — 1 500 kredytów, podawanych jako 1 000 podstawowych plus 500 elastycznych • Copilot Pro+, 39 dolarów miesięcznie — 7 000 kredytów, podawanych jako 3 900 podstawowych plus 3 100 elastycznych • Copilot Max, 100 dolarów miesięcznie — 20 000 kredytów, podawanych jako 10 000 podstawowych plus 10 000 elastycznych • Copilot Business, 19 dolarów za stanowisko miesięcznie — 1 900 kredytów na użytkownika • Copilot Enterprise, 39 dolarów za stanowisko miesięcznie — 3 900 kredytów na użytkownika • Pule organizacji i przedsiębiorstw są współdzielone między stanowiskami, a nie rozdzielone osobno dla każdego użytkownika • Wykorzystanie ponad pulę jest rozliczane po 0,01 dolara za kredyt — ta sama konwersja zastosowana do przekroczenia • Uzupełnianie kodu i sugestie następnej edycji w ogóle nie podlegają rozliczaniu kredytowemu i pozostają nielimitowane w płatnych planach p>Połącz jedno z drugim, a kształt premiery staje się konkretny. Weźmy umiarkowanie duży krok agenta — 40 000 tokenów wejściowych, 2 000 tokenów wyjściowych, bez buforowania. W krótkim progu Claude Haiku 5.5 to 40 000 razy 0,10 dolara za milion plus 2 000 razy 0,50 dolara za milion, czyli 0,005 dolara, co przy udokumentowanej konwersji daje pół kredytu. Identyczne wywołanie według stawek Claude Haiku 4.5 wynosi 0,05 dolara, czyli pięć kredytów. Arytmetyka jest tu nasza, nie GitHuba, ale wszystkie dane wejściowe pochodzą z opublikowanego cennika, a wniosek nie jest subtelny: pula 1 500 kredytów abonenta Pro wchłania około 3 000 takich wywołań na nowym Haiku, podczas gdy na starym wchłaniała około 300. Pula staje się dziesięć razy dłuższa, choć subskrypcja się nie zmienia.

To uczciwa propozycja wartości i wiąże się z uczciwym zastrzeżeniem, że pula jest wyceniana w kredytach, a nie w dolarach, więc rzeczywisty pułap planu zmienia się za każdym razem, gdy zmienia się cennik. Dziesięciokrotna obniżka w przypadku jednego modelu nie zwiększa puli dziesięciokrotnie, jeśli Twój ruch rozkłada się na trzy modele.

Co GitHub mówi, że model robi, a czego nie pokazał

Lista zmian zawiera jedno twierdzenie o wydajności, które w tej relacji wykonuje więcej pracy, niż jest w stanie udźwignąć. GitHub pisze, że we wczesnych testach Claude Haiku 5.5 „dorównywał Claude Sonnet 5 w wielu zadaniach programistycznych”, zużywając przy tym „znacznie mniej tokenów i kroków”.

Przeczytaj zastrzeżenia po kolei. To wczesne testy. To testy GitHuba, na zadaniach GitHuba, a GitHub jest podmiotem sprzedającym tę integrację. Nie podano nazwy żadnego harnessu, nie opublikowano zestawu zadań, żadna liczba nie towarzyszy żadnej z połówek zdania, a „many” nie jest liczbą. Twierdzenie to może być całkiem prawdziwe — mały model dorównujący dużemu w wąskich, zorientowanych na narzędzia zadaniach kodowania to prawdopodobny wynik w 2026 r. — ale w opublikowanej formie jest to twierdzenie dostawcy i powinno być oznaczane jako takie za każdym razem, gdy się je powtarza. Połowa o „mniejszej liczbie tokenów i kroków” jest trwalsza z tych dwóch, ponieważ dotyczy wydajności, a nie możliwości, a wydajność w punkcie cenowym Haiku pojawi się w twojej własnej telemetrii użycia w ciągu tygodnia. Połowa o możliwościach wymaga harnessu strony trzeciej, zanim trafi na slajd.

Liczby podane przez samą Anthropic to odrębne twierdzenie od twierdzeń GitHub i wiąże się z tym samym problemem pochodzenia danych. Anthropic podaje, że uruchamianie Claude Haiku 5.5 jest średnio około 75 procent tańsze oraz że około 90 procent żądań wcześniej wysyłanych do modelu klasy Haiku mieści się poniżej 100 000 tokenów, gdzie model oferuje „szczególnie dobrą wartość”. Oba przypadki to dostawca opisujący ekonomikę własnego produktu. Są spójne z opublikowanym cennikiem — dużej obniżki w warstwie krótkiej, mniejszej w warstwie długiej — i są przydatne jako wskazówki dostawcy, a nie jako zmierzony wynik.

Włączenie tego jest decyzją administratora, a domyślnie jest to włączone

Ta część dziennika zmian, którą nabywcy Copilot Business i Enterprise powinni przeczytać dwa razy, to akapit o kontroli dostępu. Administratorzy zarządzają dostępem do modeli za pomocą polityki modeli w ustawieniach Copilot, a udokumentowanym domyślnym zachowaniem GitHub jest to, że nowe modele są włączane automatycznie, chyba że administrator wyłączył globalne ustawienie domyślne lub jawnie wyłączył ten konkretny model. Ustawienie domyślne jest permisywne; ograniczenie działa na zasadzie opt-out.

Wynikają z tego dwie konsekwencje. Jeśli Twoja organizacja ma rygorystyczne zasady zarządzania modelami, Claude Haiku 5.5 może już być dostępny do wyboru dla Twoich deweloperów, mimo że nikt nie zatwierdził go z nazwy. A jeśli zamiast tego Twoja organizacja wyłączyła już globalny model domyślny, model nie pojawi się u Ciebie niezależnie od tego, co mówi dziennik zmian — co jest najbardziej prawdopodobnym wyjaśnieniem najczęstszego pytania do pomocy technicznej w pierwszym tygodniu po premierze dowolnego modelu Copilot. Zanim zaczniesz debugować brakujący wpis w selektorze, sprawdź politykę modeli.

Dwa wyjątki, o których dokumentacja Anthropic podaje, że posty o premierze ich nie zawierały.

Oba te elementy pochodzą z dokumentacji platformy Anthropic, a nie z jakiegokolwiek omówienia prasowego, i oba wpływają na to, co możesz zbudować, a nie na to, ile płacisz:

• Priority Tier nie jest dostępny w modelu Claude Haiku 5.5 — dokumentacja Anthropic dotycząca warstw usług wymienia ten model na swojej wyraźnej liście wykluczeń, obok Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 i linii Mythos. Jeśli Twoja architektura zakłada aprowizowaną przepustowość w taniej warstwie, to założenie nie ma tu zastosowania. • Pełne okno kontekstu o rozmiarze 1 miliona tokenów w standardowej cenie jest przyznawane „Claude 4.6 i nowszym modelom (z wyjątkiem Claude Haiku 5.5)” — ten nawias pochodzi od Anthropic, a Claude Haiku 5.5 jest jedynym obecnym modelem z niego wyłączonym. Okno jest nadal reklamowane w wierszu specyfikacji modelu jako 1M, z maksymalnym wyjściem 128 000 tokenów; wyłączenie to oznacza, że nie należy odczytywać ogólnej gwarancji cenowej dla długiego kontekstu jako dotyczącej tego modelu. • Zmienił się tokenizer. Anthropic podaje, że Claude 4.7 i nowsze modele używają nowszego tokenizera, który dla tego samego tekstu generuje około 30 procent więcej tokenów, co oznacza, że cena za token i cena za stronę Twojego tekstu zmieniły się w przeciwnych kierunkach. Wiersz specyfikacji Claude Haiku 5.5 podaje „Fastest” jako jego pozycję, domyślne ustawienie myślenia adaptacyjnego na poziomie średnim, datę odcięcia wiedzy: czerwiec 2026, oraz identyfikator modelu claude-haiku-5-5.

Żadna z tych rzeczy nie jest przeszkodą nie do przejścia w przypadku obciążeń związanych z subagentami i szybką edycją, na które GitHub kieruje ten model. To różnica między cytowaniem wpisu o premierze a cytowaniem dokumentacji, a to drugie jest tym, co przetrwa zetknięcie z testem obciążeniowym.

Jeśli wolisz to przekierować niż przełączyć narzędzia

Istnieją uzasadnione argumenty za wywoływaniem Claude Haiku 5.5 z własnego stosu, a nie wyłącznie przez subskrypcję typu czat-i-edytor: otrzymujesz surowe stawki dla krótkiego poziomu bez pośredniej konwersji na kredyty i zachowujesz decyzję o routingu we własnym kodzie. Kwestia dostępności, mówiąc wprost, wygląda tak, że Anthropic sprzedaje go przez Claude Platform oraz przez Amazon Bedrock, Vertex AI i Microsoft Azure — a u nas w katalogu jeszcze go nie ma. OrcaRouter oferuje dziś Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 i Claude Fable 5.1 w katalogu liczącym nieco ponad 200 modeli, a Claude Haiku 5.5 nie znajduje się wśród nich. Jeśli chodzi o sam model, już teraz wywołuj go bezpośrednio przez Anthropic lub jedną z tych trzech chmur.

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

To, gdzie się wpasowujemy, to warstwa wokół tego. OrcaRouter przekazuje ceny katalogowe dostawców bez marży, więc gdy dostawca zmieni cenę modelu — tak jak Anthropic zrobił z tym modelem — nowa stawka obowiązuje po naszej stronie tego samego dnia, a nie dopiero po cyklu rozliczeniowym. Automatyczny failover sprawia, że wywołanie z taniej warstwy, które zwróci błąd, trafia na działającą trasę zamiast kończyć się niepowodzeniem żądania, co ma większe znaczenie dla floty subagentów wykonujących tysiące małych wywołań niż dla pojedynczej sesji interaktywnej. A routing DSL istnieje właśnie po to, by obsłużyć taki kształt decyzji, jaki tworzy ta premiera: kierować krótką pracę o dużym wolumenie do modelu, który jest najtańszy poniżej progu, a pracę z długim kontekstem do tego, który jest najtańszy powyżej niego, z jednego endpointu i na jednym rachunku, zamiast kodować ten podział w dwóch integracjach. Jeśli Haiku 5.5 pojawi się w katalogu, wpasuje się w tę politykę bez zmiany kodu.

Co z tym zrobić przed następnym sprintem?

Wąska interpretacja jest taka, że najtańszy obecny model Anthropic jest teraz dostępny do wyboru w każdym płatnym planie Copilot i jest około dziesięć razy tańszy za token niż Haiku, który zastępuje w krótkim planie. Jeśli Twój zespół uruchamia podagentów lub automatyzację w stylu terminala przez Copilot, zmiana modelu to zmiana w ustawieniach o dużym i natychmiastowym wpływie na to, jak długo wystarcza miesięczna pula kredytów.

Dwie rzeczy warte sprawdzenia w pierwszej kolejności to te, które ogłoszenie przemilcza. Spójrz na 95. percentyl rozmiarów swoich żądań: jeśli przekracza 100 000 tokenów, poziom, według którego faktycznie jesteś rozliczany, to ten drugi, a dziesięciokrotne porównanie jest pięciokrotnym. I sprawdź, czy polityka modeli w Twojej organizacji ma włączone globalne ustawienie domyślne — w przypadku licencji Business i Enterprise to jedno ustawienie decyduje o tym, czy ta premiera jest w ogóle dostępna dla Twoich deweloperów.

przekazuje cenę katalogową dostawcy bez marży