Wygenerowana karta tytułowa z napisem „Claude Sonnet 5.5”, podtytułem „Domyślny w średniej klasie, w pełni zdefiniowany” oraz trzema plakietkami: „wydano 2026-09-28”, „2 USD za wejście / 10 USD za wyjście za 1 mln tokenów” i „Indeks inteligencji 56,00 vs 57,62”. Logo OrcaRouter zostało nałożone w prawym dolnym rogu.
Guides & Insights

Claude Sonnet 5.5: Domyślny wybór średniej klasy, w pełni wyspecyfikowany

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Claude Sonnet 5.5 to model średniej półki w linii Claude, wydany 28 września 2026 r., a cennik jest całym powodem, dla którego warto poświęcić mu osobną stronę: 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych, w porównaniu z 4 i 20 USD za Claude Opus 5.5, flagowca, który trafił na rynek sześć dni wcześniej. To połowa ceny wyjścia w zamian za 1,62 punktu Artificial Analysis Intelligence Index — 56,00 dla modelu średniej półki wobec 57,62 dla flagowca; obie liczby zmierzył Artificial Analysis w wersji v4.3.2 indeksu, a nie my ani dostawca. Ponad oboma plasuje się Claude Fable 5.1, przy 10 / 50 USD i 53,35 w tej samej wersji indeksu: droższy od flagowca, a przy tym za nim. W tej samej cenie katalogowej 2 / 10 USD co Claude Sonnet 5.5 znajduje się {{7}}GPT-6.1 Sol{{/7}} od OpenAIGPT-6.1 Sol, z wynikiem 51,83 — 417 setnych indeksu po drugiej stronie granicy, a to właśnie porównanie, którego musi dokonać czytelnik rozważający model średniej półki.

Ta strona ma charakter referencyjny, a daty mówią, dlaczego — a nie o świeżości. Claude Sonnet 5.5 ma dziesięć dni w dniu 2026-10-08, co sytuuje go poza siedmiodniowym oknem, w którym ten blog relacjonuje nowości. W tym oknie mieści się zdarzenie sprzed sześciu dni: dwa posty na X datowane na 2026-10-02, twierdzące, że model następca w tej rodzinie bije rywala, którego jego własny dostawca ukończył i wstrzymał. Za tym twierdzeniem nie stoi żaden identyfikator modelu, żaden cennik, żadne okno kontekstowe ani żaden benchmark w żadnym rejestrze dostępnym stąd, i nie jest ono tematem tej strony — łańcuch źródeł, kontrola braku obecności po stronie dostawcy oraz rozrzut indeksu pięciu modeli należą w całości do omówienia, które ten blog już opublikował pod tytułem „Claude Fable 5.5 pobił GPT-6.1 Astra, zanim ten zacznie istnieć — i to jest w tym najciekawsze”, datowanego na 2026-10-03. To, co to twierdzenie jednak wywołało, to kolejka czytelników pytających, który wydany model Claude wybrać jako standard, czekając, a to pytanie wymaga strony o modelu, który istnieje. Oto ona.

Co zostało wydane 28 września 2026

Dokumentacja samego dostawcy podaje specyfikację bezpośrednio, a jest to kontynuacja poziomu, a nie nowy kształt. Wszystko poniżej odczytano z dokumentacji Anthropic's Claude Platform w dniu 2026-10-08, więc jest to specyfikacja Anthropic, a nie niezależny jej test.

• Premiera — 28 września 2026. Strona dokumentacji samego modelu zaczyna się od słów: „Najnowszy. Wydano 28 września 2026”.

• Pozycjonowanie — „Najlepsze połączenie szybkości i inteligencji”, przy czym porównawcze opóźnienie podano jako Fast w zestawieniu z Moderate dla Claude Opus 5.5, Slower dla Claude Fable 5.1 i Fastest dla najmniejszego poziomu.

• Identyfikator modelu — claude-sonnet-5-5 w Claude API, Google Cloud, Microsoft Foundry i Claude Platform na AWS; anthropic.claude-sonnet-5-5 w Amazon Bedrock. Każdy identyfikator modelu Claude to przypięta migawka, więc ten ciąg nie jest wskaźnikiem, który dryfuje pod tobą.

• Kontekst i dane wyjściowe — 1,000,000 tokenów kontekstu i 128,000 tokenów synchronicznych danych wyjściowych w Messages API, wzrastających do 300,000 dzięki nagłówkowi output-300k-2026-03-24 beta w Message Batches API.

• Myślenie — adaptacyjne, domyślnie zawsze włączone, z domyślnym poziomem wysiłku high. Najniższe ustawienie to between_tools, które wyłącza wstępne myślenie i jest akceptowane przy poziomie wysiłku high lub niższym. Ustawienie temperature, top_p lub top_k na cokolwiek innego niż wartość domyślna zwraca błąd 400, więc żądanie przeniesione ze starszego modelu Claude z dostrojoną temperaturą zakończy się głośnym błędem, a nie po cichu.

• Granica wiedzy — czerwiec 2026, zarówno dla wiarygodnej granicy, jak i granicy danych treningowych.

• Cykl życia — Aktywny (najnowszy), z zobowiązaniem do wycofania nie wcześniej niż 28 września 2027 r. na platformach obsługiwanych przez Anthropic. Amazon Bedrock i Google Cloud ustalają własne daty.

Sposób, w jaki dostawca przedstawia premierę, warto zacytować, ponieważ jest to twierdzenie, a nie pomiar: Ogłoszenie firmy Anthropic opisuje Claude Sonnet 5.5 jako "wyraźne ulepszenie w stosunku do Sonnet 5, który działa o 30% szybciej i kosztuje do 30% mniej w przypadku większości zadań". To zdanie pochodzi od dostawcy, nie zostało przez nas odtworzone, i jest to rodzaj twierdzenia, które zależy wyłącznie od tego, jakie zadania się przed nim postawi. Z wydaniem wiąże się również koszt migracji, którego omówienie nie należy do tej strony: pięć zmian łamiących kompatybilność dotyczy kodu już działającego na Claude Sonnet 5, a szósta zmienia kształt odpowiedzi, nie powodując błędu żadnego żądania. To podsumowanie należy do artykułu o wdrożeniu, który ten blog opublikował w tygodniu premiery, i jest to pierwsza rzecz do przeczytania, jeśli masz Sonnet 5 na produkcji dzisiaj.

A screenshot of Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed with the line 'Latest. Released September 28, 2026', showing the model ID claude-sonnet-5-5, pricing of $2 per input MTok and $10 per output MTok, a 1M-token context window, 128K max output, adaptive thinking with a default effort of high, a June 2026 knowledge cutoff and a retirement commitment of not sooner than September 28, 2027.

1,62 punktu i połowa ceny

Niezależne wyniki dla tego modelu pochodzą z jednego miejsca i niosą jedną liczbę, która rozstrzyga spór. Artificial Analysis mierzy Claude Sonnet 5.5 na poziomie 56,00 w swoim Intelligence Index, wersja v4.3.2, w konfiguracji, którą strona określa jako „Claude Sonnet 5.5 (Max, Default Fallback)”. Odczytaliśmy tę stronę 2026-10-08. W tej samej wersji, tego samego dnia:

• Claude Opus 5.5 — 57,62, wydany 2026-09-22, 4 / 20 USD

• Claude Sonnet 5.5 — 56.00, wydany 2026-09-28, 2 / 10 USD

• Claude Fable 5.1 — 53,35, premiera 2026-09-01, 10 $ / 50 $

• GPT-6 Astra — 52,67, wydany 2026-09-03, 10 / 50 USD, z poziomem długiego kontekstu powyżej 272 000 tokenów promptu w cenie 20 / 75 USD

• GPT-6.1 Sol — 51,83, wydany 2026-09-29, 2 USD / 10 USD

Podanie, o którą wersję chodzi, ma znaczenie, ponieważ wyniku z jednej wersji indeksu nie można porównywać z wynikiem z innej wersji: v4.3.2 obejmuje dziesięć ewaluacji — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience i AA-LCR v1.1 — a skład tego zestawu zmieniał się między wersjami. Wszystkie pięć powyższych liczb pochodzi z tej samej wersji, dlatego można je porównywać ze sobą i dlatego żadnej z nich nie można porównywać z liczbą przytoczoną z wcześniejszej wersji.

Porównanie cen to część, która decyduje o zachowaniu. Stawka za tokeny wyjściowe Claude Sonnet 5.5 jest o połowę niższa niż w Claude Opus 5.5, a stawka za tokeny wejściowe jest znów o połowę niższa; na własnej liście cen dostawcy model ze średniej półki kosztuje 2 USD / 10 USD, podczas gdy flagowy kosztuje 4 USD / 20 USD. Zestaw obie opublikowane liczby razem, a stosunek jest uderzający: na dolara ceny katalogowej za wyjście Claude Sonnet 5.5 ma 5,60 punktu indeksu, a Claude Opus 5.5 ma 2,88 — prawie dwa razy więcej indeksu na dolara wyjścia, według własnego cennika Anthropic i własnego pomiaru Artificial Analysis. To arytmetyka na dwóch opublikowanych liczbach, a nie pomiar czegokolwiek, i to jest uczciwa forma argumentu za średnią półką. To również nie jest werdykt: punkt indeksu nie jest jednostką poprawności, a sedno reszty tej strony stanowi to, z czego 1,62 się składa, a z czego nie.

A generated two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Opus 5.5 - the scoreboard'. The left column, Claude Sonnet 5.5, reads: Released September 28, 2026; Intelligence Index v4.3.2: 56.00; Price per 1M tokens: $2.00 / $10.00; Context window: 1M tokens; Max output: 128K tokens; Default effort: high. The right column, Claude Opus 5.5, reads: Released September 22, 2026; Intelligence Index v4.3.2: 57.62; Price per 1M tokens: $4.00 / $20.00; Context window: 1M tokens; Max output: 128K tokens; Default effort: medium. The footer reads 'Index figures per Artificial Analysis v4.3.2, read 2026-10-08; prices and specifications per Anthropic.' The OrcaRouter logo is composited in the bottom-right corner.

Cennik i dwie linie, które zmieniają się najbardziej

Pełny cennik Anthropic, stan na 2026-10-08. Wszystkie liczby w tej sekcji pochodzą od dostawcy.

• Wejście — 2,00 USD za milion tokenów. Wyjście — 10,00 USD za milion, a tokeny myślenia są rozliczane jako wyjście, czego nie można tutaj wyłączyć, ponieważ myślenie adaptacyjne jest domyślnie włączone.

• Odczyt z pamięci podręcznej — 0,10 USD za milion, co Anthropic dokumentuje jako 5 procent podstawowej ceny wejściowej. To taki sam proporcjonalny rabat, jaki ma Claude Opus 5.5, więc buforowanie nie zmienia rankingu między tymi dwoma, i oznacza, że długi przebieg agenta, który utrzymuje stabilny prefiks, płaci jedną dziesiątą stawki wejściowej za wszystko, co odczytuje ponownie.

• Zapis do pamięci podręcznej — 2,50 USD za milion tokenów dla pięciominutowej pamięci podręcznej, 4,00 USD dla jednogodzinnej pamięci podręcznej. Minimalna długość promptu, który można zapisać w pamięci podręcznej, to 512 tokenów, więc krótkie prompty nie mogą w ogóle skorzystać z tej zniżki.

• Batch API — 50 procent zniżki w obu kierunkach, więc 1,00 USD za dane wejściowe i 5,00 USD za dane wyjściowe za pracę, która może poczekać.

• Bez dopłaty za długi kontekst — Anthropic rozlicza pełne okno 1 mln tokenów według standardowej stawki za token w tym modelu, więc żądanie o długości 900 000 tokenów kosztuje tyle samo za token co żądanie o długości 9 000 tokenów. To rzeczywista różnica względem GPT-6 Astra, którego warstwa długiego kontekstu powyżej 272 000 tokenów monitu przechodzi na 20 / 75 USD — warto to odnotować, ponieważ to jedyne miejsce, w którym kluczowe liczby obu dostawców wyraźnie się rozchodzą, gdy monit staje się długi.

O większości rachunków decydują zatem dwie pozycje, a nie stawka nagłówkowa: zniżka za odczyt z pamięci podręcznej podczas długiego przebiegu agenta oraz zniżka za przetwarzanie wsadowe dla wszystkiego, co asynchroniczne. Nagłówkowe $2 / $10 to stawka porównywana na liście rankingowej; miesięczna faktura jest faktycznie budowana z pozycji dotyczących pamięci podręcznej i przetwarzania wsadowego.

Co luka znaczy, a czego nie

Intelligence Index to jedna liczba dla stałego zestawu zadań, a ta pojedyncza właściwość wyjaśnia większość zamieszania wokół niego. Dziesięć ewaluacji stojących za v4.3.2 obejmuje kodowanie agentowe i pracę w terminalu, rozumowanie naukowe na poziomie absolwenckim, zestaw zadań z inżynierii oprogramowania, zestaw automatyzacji agentowej oraz zestaw wyszukiwania w długim kontekście, ważone i składane w wynik złożony. Model, który ma 1,62 punktu straty do innego, pozostaje w tyle w tym wyniku złożonym — nie w Twoim obciążeniu zadaniami, które może ważyć te dziesięć w zupełnie innych proporcjach i może zawierać zadania, których nie reprezentuje żadna z nich.

W praktyce oznacza to podział według charakteru pracy, a nie według prestiżu kategorii. Własny selektor modeli Anthropic wyraźnie dokonuje tego podziału i warto go przeczytać, ponieważ nie schlebia średniej kategorii: dokumentacja mówi czytelnikom, aby „zaczynać od Claude Opus 5.5 w przypadku większości obciążeń”, a po Claude Fable 5.1 sięgać „w przypadku wymagającego rozumowania i długoterminowej pracy agentowej albo gdy Twoje ewaluacje na Claude Opus 5.5 przy wyższym wysiłku nadal nie wystarczają”. Claude Sonnet 5.5 nie jest modelem, od którego zaczyna się to zdanie. To model, który ta sama dokumentacja opisuje jako najlepsze połączenie szybkości i inteligencji, z najszybszą porównawczą latencją poza małą kategorią — co jest innym argumentem, i to węższym.

Uczciwa interpretacja jest więc taka. Poziom średni jest zwykle właściwą odpowiedzią w przypadku pracy o jasno określonym zakresie i dużej skali: funkcjonalności i poprawek błędów w znanej bazie kodu, ekstrakcji i klasyfikacji o zdefiniowanym kształcie wyjścia, pętli wywołań narzędzi, w których trudną częścią jest oprzyrządowanie, a nie rozumowanie, oraz wszystkiego, gdzie szybki pierwszy token i niski koszt na wywołanie znaczą więcej niż ostatnie dwa procent możliwości. Flagowiec zasługuje na swoją stawkę, gdy praca naprawdę ma długi horyzont — wielogodzinne przebiegi agentów, refaktoryzacje obejmujące pliki, których prompt nie może objąć naraz, oraz ewaluacje na poziomie średnim, które przy wyższym wysiłku mierzalnie nie spełniają oczekiwań. Ten ostatni warunek jest warunkiem samego dostawcy i można go sprawdzić: zwiększ poziom wysiłku na poziomie średnim, uruchom własną ewaluację i zobacz, czy domyka lukę. Jeśli tak, 1.62 nie było dla ciebie kluczowe. Jeśli nie, kupiłeś swoją odpowiedź własnymi liczbami, a nie cudzym wynikiem zbiorczym.

Ta różnica nie oznacza, że 1,62 punktu to nic. To cały margines między dwoma modelami, a na stałym stanowisku testowym, w identycznych warunkach oceny, to rzeczywiste uszeregowanie. To po prostu uszeregowanie konkretnego miksu zadań, przy maksymalnym wysiłku z domyślnym fallbackiem, i nie mówi nic o tym, który z tych dwóch jest lepszym zakupem dla obciążenia, na którym żaden z nich nie był testowany.

Pułapka nazwy: która to strona Claude Sonnet 5.5

Czytelnik szukający nazwy tego modelu trafia na tym blogu na kilka stron, które wyglądają jak ta, a którymi nie są. Ta z datą 2026-09-24 to strona zapowiedzi: powstała przed premierą modelu, a jej tematem był pojedynczy post na X ogłaszający test w trybie stealth, zrekonstruowany na podstawie parametrów modelu, który miał zastąpić. Ta opublikowana w tygodniu premiery to opis wdrożenia: jej tematem jest pięć zmian łamiących kompatybilność, które dotyczą kodu już działającego na Claude Sonnet 5, plus szósta zmiana, która zmienia kształt odpowiedzi, nie zgłaszając błędu. Jest także wachlarz stron porównawczych zestawiających nazwę tego modelu z modelami innych dostawców oraz strona praktyczna o tym, co obejmuje promocja wydania.

Żadna z nich nie jest stroną modelu i właśnie tę lukę wypełnia ten tekst. Ta strona to punkt odniesienia, do którego czytelnik trafia po wpisaniu nazwy samego modelu: czym jest, ile kosztuje, co mierzy i jakie prace są z nim związane. Szczegóły migracji na stronie wdrożenia i krytyka doboru źródeł na stronie zapowiedzi pozostają tam, gdzie są; jeśli masz kod Sonnet 5 na produkcji, strona wdrożenia jest twoim pierwszym kliknięciem, a ta strona mówi ci, czy model, na który migrujesz, jest tym, którego chcesz.

Jeden nawyk nazewniczy warto poprawić, skoro już przy tym jesteśmy, bo sam w sobie wprowadza w błąd. Sufiks 5.5 oznacza generację, a nie rangę. Claude Sonnet 5.5 i Claude Opus 5.5 to ta sama generacja tej samej rodziny, a liczba przed kropką to poziom. Sam sufiks nie mówi nic o tym, który z nich wygrywa benchmark.

Dostępność, z datą

Claude Sonnet 5.5 jest dostępny w OrcaRouter od chwili premiery, jako anthropic/claude-sonnet-5.5, w cenie katalogowej samego Anthropic, bez żadnej marży: 2,00 USD za tokeny wejściowe i 10,00 USD za tokeny wyjściowe za milion tokenów — obie te wartości odczytane z naszego własnego endpointu modelu 8 października 2026 r. i zgodne z cennikiem dostawcy co do linijki. Nasza strona poświęcona temu modelowi podaje to samo okno kontekstu wynoszące 1 mln tokenów i maksymalne wyjście 128 tys. tokenów, wymienia tekst, obraz i plik jako akceptowane typy wejściowe, a tekst jako jedyne wyjście, oznacza go jako wydany 28 września 2026 r. i nieprzestarzały oraz pokazuje, że jest dostępny zarówno przez zgodny z OpenAI endpoint chat-completions, jak i przez własny endpoint messages Anthropic — co czyni go zmianą typu drop-in dla integracji, która posługuje się już jednym z tych formatów.

Wszystko inne w tym samym katalogu jest osiągalne za pomocą tego samego klucza: jedno API dla ponad 200 modeli, z ceną katalogową dostawcy przekazywaną dalej z zerowym narzutem, dzięki czemu obniżka ceny u dostawcy dociera do klienta w dniu jej ogłoszenia, automatycznym przełączaniem awaryjnym gdy endpoint traci wydajność, oraz DSL-em routingu na wypadki, gdy chcesz przypiąć konkretny model albo złożyć kilka w jedną odpowiedź. To właśnie ta kombinacja sprawia, że odpowiedź na pytanie z tej strony jest tania, a nie kosztowna. Oba modele z powyższego porównania stoją za tymi samymi poświadczeniami, więc cena, z którą je porównujesz, to cena opublikowana przez samego dostawcę, a nie przez resellera, a test wersji kosztuje uruchomienie ewaluacji, a nie projekt migracyjny: skieruj część ruchu na anthropic/claude-sonnet-5.5, a resztę zostaw na modelu flagowym i pozwól, by własne liczby kosztu na ukończone zadanie zdecydowały, który z nich powinien być domyślny.

A screenshot of the OrcaRouter model page for anthropic/claude-sonnet-5.5, attributed to Anthropic and dated 2026-09-28, showing a 1M-token context window, 128K maximum output, text image and file inputs with text output, an input price of $2.00 per million tokens and an output price of $10.00 per million tokens, the model id claude-sonnet-5-5, and an OrcaRouter performance panel.

Krótka wersja

Claude Sonnet 5.5 to model średniej klasy z wynikami zbliżonymi do flagowca i o połowę niższą ceną generowania niż flagowiec, a trzy fakty, które decydują o tym, czy będzie twoim domyślnym wyborem, są następujące. W indeksie v4.3.2 Artificial Analysis ustępuje Claude Opus 5.5 o 1,62 punktu, z wynikiem 56,00 wobec 57,62, przy czym oba wyniki zmierzono na tej samej wersji i w tej samej konfiguracji maksymalnego wysiłku z domyślnym fallbackiem. Kosztuje $2 / $10 wobec $4 / $20 flagowca, a rabaty za cache i przetwarzanie wsadowe są proporcjonalne, a nie odmienne, więc różnica cen utrzymuje się przy każdej zniżce oferowanej przez którykolwiek z modeli. A domyślnie ustawia się na wysoki poziom wysiłku, podczas gdy flagowiec domyślnie ustawia się na średni, co oznacza, że ustawienie przeniesione z flagowca działa tutaj o jeden poziom wyżej, a nie niżej, a koszt tego masz zmierzyć, a nie zakładać.

Własny selektor Anthropic nadal domyślnie wskazuje Claude Opus 5.5 w przypadku większości obciążeń i warto o tym wiedzieć, zanim cokolwiek ustandaryzujesz. Ale dla większości czytelników, którzy trafiają na tę stronę, wpisując nazwę tego modelu, rozsądnym domyślnym wyborem jest średnia półka, a flagowiec to wyjątek, który kupujesz, gdy twoje własne ewaluacje tego wymagają — dobrze określone zadania w dużej skali, niska latencja, okno miliona tokenów bez dopłaty za długi kontekst i stawka, która o połowę obniża koszt linii wyjściowej. Oba są dostępne za jednym kluczem w OrcaRouter, a ewaluacja, która rozstrzyga między nimi, kosztuje popołudnie, a nie migrację.

Porównane w tym artykule4

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie