
Claude Sonnet 5.5 vs Claude Sonnet 5: identyczne ceny, różne rachunki
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 984 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 195 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Dwa modele od tego samego dostawcy, w tej samej klasie, o tej samej nazwie i — w każdym wierszu opublikowanego cennika — w tej samej cenie. Claude Sonnet 5 zadebiutował 30 czerwca 2026 r. w cenie 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych. Claude Sonnet 5.5 stał się ogólnie dostępny 28 września 2026 r. w cenie 2,00 USD i 10,00 USD, przy czym w przypadku obu modeli odczyty z pamięci podręcznej kosztują 0,20 USD, a zapisy do pięciominutowej pamięci podręcznej — 2,50 USD. W cenie nie zmieniło się nic. Zmieniło się wszystko to, czego cennik nie mierzy, a skutek jest taki, że jeden z tych dwóch modeli jest znacznie tańszy w eksploatacji niż drugi, mimo że kosztuje dokładnie tyle samo za token. Firmowy nagłówek Anthropic dotyczący tej premiery daje to do zrozumienia, nie mówiąc tego wprost: nawet o 30% niższy koszt w przypadku większości zadań, przy niezmienionym cenniku. Oba te zdania mogą być prawdziwe tylko wtedy, gdy nowszy model wykonuje tę samą pracę przy użyciu mniejszej liczby tokenów, co pokazują benchmarki i potwierdzają niezależne dane dla poszczególnych zadań.
Czy Claude Sonnet 5.5 jest droższy niż Claude Sonnet 5?
Nie — a to pytanie i tak warto potraktować poważnie, ponieważ bardzo wiele migracji poszło nie tak przez potraktowanie karty stawek ryczałtowych jako rachunek ryczałtowy.
W przeliczeniu na token oba modele są identyczne: 2,00 USD za token wejściowy, 10,00 USD za token wyjściowy, 0,20 USD za odczyt tokenu z pamięci podręcznej, 2,50 USD za zapis tokenu. Nie ma progów ani dopłaty za długi kontekst. Czymkolwiek jest nowszy model, nie jest to podwyżka cen przebrana za nową generację.
W przeliczeniu na ukończone zadanie obraz się odwraca w zależności od tego, czyje obciążenie opisujesz. Artificial Analysis podaje koszt 5,09 USD na zadanie dla Claude Sonnet 5 i 7,60 USD na zadanie dla Claude Sonnet 5.5 w tym samym zestawie Intelligence Index v4.3 — nowszy model jest o 49% droższy w ukończeniu zadania, przy identycznej stawce. Ten sam raport zauważa, że Sonnet 5.5 wygenerował 410 milionów tokenów w całym zestawie, podczas gdy Sonnet 5 — 370 milionów; oba w porównaniu z medianą 88 milionów dla śledzonej grupy. W przypadku otwartych promptów ewaluatora nowszy model po prostu pisze więcej, a przy równych cenach więcej tokenów oznacza większy rachunek.
Twierdzenie Anthropic o 30% niższym koszcie to twierdzenie dostawcy o wybranych przez niego obciążeniach. Wynik 7,60 USD wobec 5,09 USD uzyskany przez stronę trzecią to pomiar na innym zbiorze. Ani jedno, ani drugie nie jest błędne; cała historia tkwi w tej rozbieżności, a czynnikiem decydującym jest to, czy twoje zadania ograniczają własne wyjście.
Co tak naprawdę zmieniło się między tymi dwiema generacjami?
Cennik jest statyczny; model nie. Zestawione w jednej liście, różnice są duże i przeważnie jednokierunkowe.
• Terminal-Bench 4.0 — 70,6% dla Claude Sonnet 5.5 wobec 10,3% dla Claude Sonnet 5, największy skok między generacjami opublikowany przez Anthropic w tym teście
• CursorBench 4.0 — 55,5% wobec 34,1%
• Kartografia, bez narzędzi — 61,6% wobec 15,6%
• GDPval-AA v2.1 — 1844 przeciwko 1449
• AA-Briefcase v1.1 — 1811 przeciwko 1359
• Humanity's Last Exam, z narzędziami — 64,5% wobec 54,9%
• OSWorld 2.1, częściowe ukończenie — 80,1% wobec 57,0%
• Artificial Analysis Intelligence Index v4.3 — 56 wobec 38, osiemnastopunktowa różnica na skali podmiotu trzeciego mierzona w tej samej konfiguracji „Adaptive Reasoning, Max Effort”
Kształt tej listy to nie jednolity postęp. Chartography przechodzące z 15,6% do 61,6% i Terminal-Bench z 10,3% do 70,6% wyglądają jak zdolności, których wcześniej nie było, a teraz są, a nie zdolności, które się poprawiły. Humanity's Last Exam przesuwający się o dziesięć punktów i OSWorld o dwadzieścia trzy punkty przy niezmienionej cenie to wzorzec generacji, która domknęła konkretne luki, a nie takiej, która stała się ogólnie mądrzejsza. Osiemnastopunktowa różnica w indeksie jest średnią arytmetyczną tego: realną, dużą i skoncentrowaną na użyciu narzędzi, wykonywaniu kodu i pracy wizualnej.
Jeden przypis ma znaczenie dla każdego, kto uważnie czyta tabelę dostawców. Anthropic podaje, że w FrontierCode konfiguracja Max effort uzyskuje niższy wynik niż Xhigh, i zaznacza, że przebiegi GDPval-AA i AA-Briefcase wykonano na przedpremierowym wdrożeniu zawierającym błąd w strukturyzowanych danych wyjściowych. Powyższe liczby są wciąż najlepszymi dostępnymi, ale traktuj je jako migawkę z jednego wdrożenia, a nie trwałą właściwość modelu.
Dlaczego cena jest taka sama, a rachunek nie
Trzy mechanizmy, w kolejności od największego do najmniejszego wpływu na rzeczywistą fakturę.
Pierwszą jest dyscyplina długości odpowiedzi. Sonnet 5.5 to bardziej zdolny agent, co oznacza, że robi więcej, zanim odpowie, a w zestawie bez ograniczenia długości pisze około 11% więcej niż Sonnet 5, kosztując tyle samo za token. W przypadku obciążenia, które ogranicza długość wyniku — ekstrakcja do stałego schematu, klasyfikacja, podsumowania o ograniczonej długości — te 11% nigdy się nie materializuje, a twierdzenie o 30% staje się wiarygodne, ponieważ zysk polega na dotarciu do odpowiedzi w mniejszej liczbie tur, a nie na mniejszej liczbie tokenów na turę.
Drugi to zachowanie pamięci podręcznej i to właśnie dlatego niezmieniona cena odczytu z pamięci podręcznej nie oznacza niezmienionego kosztu pamięci podręcznej. Odczyty i zapisy do pamięci podręcznej są wyceniane identycznie w obu modelach, więc każda zmiana wolumenu tokenów w pamięci podręcznej przekłada się bezpośrednio na rachunek. Model, który potrzebuje mniej tur, aby ukończyć zadanie agentowe, odczytuje swój prefiks mniejszą liczbę razy. To oszczędność, za którą w ogóle nie stoi żadna zmiana ceny, i jest niewidoczna w każdej tabeli porównawczej, która wymienia wyłącznie pozycje cennika.
Trzeci to ten, przy którym większość zespołów popełnia błąd w dniu migracji: domyślne ustawienie effort. Claude Sonnet 5.5 konfiguruje rozumowanie za pomocą parametru effort z ustawieniami low, medium, high, xhigh i max, domyślnie high na Claude Platform i medium w aplikacjach Claude. Jeśli zmigrowałeś z wdrożenia Sonnet 5, w którym miałeś przypięty budżet rozumowania, nowa wartość domyślna może dawać inną głębokość niż ta, za którą płaciłeś. Zmierz, zanim założysz oszczędność albo wzrost.
Jest też konsekwencja behawioralna, którą warto zgłosić przed wdrożeniem, a nie po nim. Anthropic podaje, że Claude Sonnet 5.5 to pierwszy Sonnet udostępniony z zabezpieczeniami cybernetycznymi i mechanizmami awaryjnymi na równi z jego modelami najwyższej klasy, więc żądania dotyczące cyberbezpieczeństwa o wyższym ryzyku w widoczny sposób przechodzą awaryjnie na poprzedni Sonnet. W dziennikach pojawi się model, którego nie zażądałeś. W nawiązaniu do tego, jeśli uruchamiasz Sonnet z wyłączonym myśleniem, musisz przełączyć się na zachowanie między narzędziami — to zmiana w kodzie, a nie flaga.
W OrcaRouter, anthropic/claude-sonnet-5 jest już dziś dostępny w routingu przy użyciu jednego poświadczenia po cenie katalogowej dostawcy z 0% narzutu, obok Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro i Gemini 3.1 Pro Preview. Sam Claude Sonnet 5.5 nie jest jeszcze trasą na naszej platformie, więc praktyczny wymiar tego porównania obecnie polega na tym, że zespół już korzystający z Sonnet 5 może zmierzyć deltę w dniu, w którym pojawi się w ofercie, bez dotykania klucza API, i może w międzyczasie przełączać się awaryjnie między poziomami, zmieniając jeden ciąg znaków.
Pytania, które ludzie zadają przed zmianą
Czy mogę uruchomić oba jednocześnie i porównać je na własnym ruchu? Jeszcze nie przez jedno poświadczenie OrcaRouter, ponieważ Claude Sonnet 5.5 nie figuruje na liście tras. Obejściem jest uruchomienie nowszego modelu na własnym API Anthropic, a starszego przez nas, a następnie porównanie liczby tokenów na ukończone zadanie, a nie kosztu na token, bo właśnie pod tym względem oba modele faktycznie się różnią.
Czy niezmieniona cena oznacza, że Anthropic nie pobiera opłat za nową możliwość? Oznacza to, że cena katalogowa jest utrzymywana na stałym poziomie, podczas gdy model się poprawia, co jest tym samym wzorcem co w przypadku dwóch poprzednich generacji Sonnet. To, czy tak pozostanie, jest kwestią komercyjną, a nie techniczną, a opublikowany okres wycofania — nie wcześniej niż we wrześniu 2027 r. — to jedyne zobowiązanie z tym związane.
Której liczbie powinienem zaufać — 30% Anthropic czy 49% podane przez stronę trzecią?Ani jednej jako twierdzeniu ogólnemu. Liczba Anthropic opisuje obciążenia, w których model dochodzi do odpowiedzi w mniejszej liczbie tur; liczba Artificial Analysis opisuje nieograniczony zestaw indeksów, w którym rozwlekłość może swobodnie rosnąć. Wybierz tę, która przypomina twój zestaw promptów, a jeśli nie potrafisz stwierdzić, która to jest, ta niejednoznaczność sama jest odpowiedzią — zmierz to.
Konkluzja
Claude Sonnet 5.5 nie jest podwyżką ceny, ale nie jest też automatycznie oszczędnością. Anthropic utrzymał każdą pozycję cennika na niezmienionym poziomie i przeniósł model pod nim, co oznacza, że cały bilans ekonomiczny opiera się na liczbie tokenów na ukończone zadanie — liczbie, która jest o 30% lepsza w obciążeniach wybranych przez dostawcę i o 49% gorsza w zestawie wybranym przez niezależnego ewaluatora. Jeśli Twoje zadania same ograniczają swoją generację, przełącz się i skorzystaj. Jeśli nie, stała cena nie jest powodem, by pomijać pomiar, ponieważ możesz zapłacić o połowę więcej za zadanie za model, który jest jednoznacznie lepszy w tej pracy.



