
Claude Opus 5.5: Anthropic obniżył cenę swojego flagowego modelu — i to jest prawdziwa historia
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
Dostawca udostępnił Claude Opus 5.5 22 września 2026 r., a liczba, która ma znaczenie, nie znajduje się na żadnym wykresie benchmarków. To 4 dolary. Nowy flagowiec kosztuje 4 dolary za milion tokenów wejściowych i 20 dolarów za milion tokenów wyjściowych, w porównaniu z 5/25 dolarów, które Claude Opus 5 utrzymuje od 24 lipca — a odczyty z pamięci podręcznej spadają z 0,50 do 0,20 dolara za milion, czyli o 60% w pozycji, która dominuje w długich przebiegach agentów. Model jest także lepszy: firma podaje, że dorównuje Claude Fable 5.1, czyli poziomowi za 10/50 dolarów powyżej niego, w większości zadań. Ale to, że czołowe laboratorium obniża cenę katalogową swojego najlepszego ogólnie dostępnego modelu o 20% — i twierdzi, że rzeczywisty koszt jego uruchomienia spadł o 40% — jest tą częścią premiery, która zmienia to, na co możesz sobie pozwolić, by budować. Premiery nowych możliwości są kopiowane w ciągu kwartału. Obniżka ceny w segmencie flagowym resetuje podłogę dla wszystkich.
Różnica — w liczbach, które faktycznie płacisz

Wszystko poniżej to opublikowany cennik Anthropic, a nie wycena:
• Wejście — 4 USD za milion tokenów, w dół z 5,00 USD w Opus 5
• Wyjście — 20 USD za milion tokenów, wcześniej 25,00 USD
• Odczyt pamięci podręcznej — $0.20 za milion, w dół z $0.50
• Zapis do pamięci podręcznej 5-minutowej — 5 USD za milion; zapis do pamięci podręcznej 1-godzinnej — 8 USD
• Batch API — 50% zniżki w obu kierunkach, jak wcześniej
• Kontekst i dane wyjściowe — kontekst 1 mln tokenów, maks. 128 tys. tokenów wyjściowych, 300 tys. tokenów wyjściowych w Batch API za output-300k-2026-03-24nagłówkiem beta
• Granica wiedzy — czerwiec 2026
• Wysiłek — myślenie adaptacyjne zawsze włączone, domyślnie średni; skala obejmuje: niski, średni, wysoki, bardzo wysoki, maksymalny
Istnieje również tryb Fast w Claude API, wyceniany osobno na 8/40 USD za milion i opisywany przez Anthropic jako podgląd badawczy, a nie jako opcja ogólna.
Wiersz dotyczący pamięci podręcznej zasługuje na najwięcej uwagi i to właśnie jego pomijają relacje z premiery. W przypadku agenta, który w każdej turze ponownie wysyła duży prompt systemowy i długie drzewo plików, odczyty z pamięci podręcznej są dominującym kosztem, a nie świeże dane wejściowe. Obniżka o 60% w tym miejscu daje więcej w rzeczywistym obciążeniu związanym z kodowaniem niż obniżka o 20% stawki podanej w nagłówku — i dlatego arytmetyka z następnej sekcji wychodzi tak, jak wychodzi.
Skąd pochodzi twierdzenie o „40% taniej”
Anthropic twierdzi, że uruchomienie Opus 5.5 kosztuje o około 40% mniej niż Opus 5 przy typowych obciążeniach. To mniej więcej dwukrotność obniżki ceny, co oznacza, że w większości wcale nie chodzi o cenę — to model wykonujący mniej pracy, by dojść do tej samej odpowiedzi. Anthropic podaje, że wyniki są generowane ponad 30% szybciej niż w Opus 5, a kilku klientów z premiery wiąże z tym zmniejszenie liczby tokenów: Box mówi o jednej trzeciej tokenów, przy odpowiedziach około 40% mniej rozwlekłych, Kiro podaje około połowy tokenów i o 40% mniej wywołań, Factory wskazuje o 20–25% mniej tokenów wyjściowych, a GitHub twierdzi, że model zużył jedną z najmniejszych liczb tokenów i kroków, jakie udało im się zmierzyć.
To publikowane przez dostawcę cytaty klientów, a nie audytowane pomiary, a w szczególności „40%” to sposób, w jaki sama Anthropic opisuje średnią dla wybranych przez siebie obciążeń. Traktuj to jako wskazówkę, a nie liczbę do wpisania w budżet. Elementy, które możesz dziś niezależnie zweryfikować, to cennik — dostępny na publicznej stronie Anthropic z cennikiem — oraz liczby tokenów generowane przez Twoje własne obciążenie, gdy je uruchomisz.
Najbardziej użyteczny rozwiązany przykład w materiale premierowym jest również najmniej efektowny: analiza fuzji, która zajęła Opus 5.5 63 minuty i kosztowała o 50% mniej niż to samo zadanie na Opus 5, które zajęło 93. Jeśli wyceniasz agenta, interesującą wielkością jest ten stosunek, a nie stawka za token — tańszy model, który potrzebuje trzech przebiegów, aby zakończyć, nie zaoszczędził ci niczego.
Tabela benchmarków i kto ją opracował
Każdy poniższy wynik bezpośredniego porównania pochodzi z materiałów premierowych Anthropic, uzyskanych na jej własnych modelach i modelach konkurentów. To normalne w przypadku premiery i dlatego żadnego z nich nie należy odczytywać jako niezależnego werdyktu. Liczby są wszędzie oznaczone jako raportowane przez dostawcę.
• Terminal-Bench 4.0 — Opus 5.5 66,4%, Opus 5 52,3%, Fable 5.1 55,8%, GPT-6 Astra 57,9%. Anthropic zauważa, że w tym przebiegu użyto poziomu xhigh effort, a nie domyślnego.
• FrontierCode v1.1 (Main) — Opus 5.5 54,4%, Opus 5 48,0%, Fable 5.1 50,3%, GPT-6 Astra 53,3%; 54,6% przy domyślnym średnim wysiłku.
• CursorBench 4.0 — Opus 5.5 57,8%, Opus 5 46,6%, Fable 5.1 51,8%; 52,5% przy średnim nakładzie pracy.
• GDPval-AA v2.1, praca oparta na wiedzy — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.
• Terminal-Bench-Science 0.1 — Opus 5.5 uzyskuje 58,7% w porównaniu z 29,0% Opus 5, a GPT-6 Astra jest z przodu z 64,6%.
• OSWorld 2.0, computer use — 81,8% dla Opus 5.5 wobec 74,0% dla Opus 5, oznaczony jako wynik częściowy.
Dwie rzeczy warto wyodrębnić z tej listy. Po pierwsze, średni wysiłek nie jest dużo gorszy od maksymalnego: 54,6% wobec 54,4% w FrontierCode i 52,5% wobec 57,8% w CursorBench. Ponieważ wysiłek bezpośrednio przekłada się na koszt, ten wynik FrontierCode — brak mierzalnej straty przy ustawieniu domyślnym — to wniosek, z którym wiążą się realne pieniądze. Po drugie, samo Anthropic ostrzega, że na tym poziomie możliwości różnice w wynikach benchmarków są „mniej wiarygodnym wskaźnikiem rzeczywistych różnic”, a jego wewnętrzna luka względem Fable 5.1 jest mniejsza, niż sugerują wyniki. Dostawca, który każe ci zdyskontować jego własną tabelę, to najbardziej wiarygodne zdanie w dokumencie.
Jeżeli chodzi o niezależne analizy, firma Artificial Analysis przyznała Claude Opus 5.5 wynik 54 w swoim Intelligence Index; to trzecie miejsce wśród śledzonych przez nią modeli, w konfiguracji oznaczonej „Adaptive Reasoning, High Effort, Default Fallback”. Ten ostatni człon odgrywa tu istotną rolę i prowadzi bezpośrednio do kolejnej sekcji.
Routing zabezpieczający jest częścią specyfikacji.
Etykieta „Domyślny mechanizm awaryjny” w niezależnym wyniku nie jest artefaktem testu porównawczego. Opus 5.5 jest wydawany z poziomem zabezpieczeń, który Anthropic wcześniej zarezerwował dla Fable 5.1, ponieważ pod względem biologii i cyberbezpieczeństwa jest porównywalny z Claude Mythos 5.1. W praktyce oznacza to, że większość zapytań dotyczących cyberbezpieczeństwa jest przekierowywana do Claude Opus 4.8, a zadania z zakresu biologii są awaryjnie przekierowywane do Claude Opus 5, chyba że konto zostanie zweryfikowane w ramach programów Life Sciences lub Cyber Verification Anthropic.
Jeśli Twój produkt wysyła zapytania dotyczące cyberbezpieczeństwa lub nauk przyrodniczych do claude-opus-5-5, otrzymana odpowiedź może wcale nie pochodzić od Claude Opus 5.5. Twoja ewaluacja, koszt na zadanie i pomiary jakości po cichu uwzględniają na tych turach mniejszy model. W przypadku większości zespołów to nigdy nie występuje. W przypadku każdego, kto pracuje w narzędziach bezpieczeństwa lub biotechnologii, występuje to nieustannie i jest to najważniejszy operacyjny szczegół tej premiery — oznacza to również, że działająca integracja API może nadal dawać wyniki gorsze niż Twój poprzedni model dokładnie przy tych promptach, na których zależy Ci najbardziej. Dostępne są nowe poziomy weryfikacji; sprawdź, czy znajdujesz się w którymś z nich, zanim założysz, że nazwa modelu oznacza to, co mówi.
Cztery niekompatybilne zmiany, zanim podmienisz ciąg znaków

Opus 5.5 nie jest bezpośrednim zamiennikiem Claude Opus 5 ani jego zmianą nazwy. Własne notatki migracyjne Anthropic wymieniają cztery zmiany, które złamią istniejący kod:
• Myślenie nie może już być wyłączone. Kod, który ustawiał thinking: disabled lub polegał na ścieżce bez myślenia, zgłosi błąd albo po cichu zmieni zachowanie; głębokość jest teraz kontrolowana wyłącznie przez parametr effort.
• Wymuszone użycie narzędzia zwraca błąd. Przekazanie tool_choice, które wymusza konkretne narzędzie, nie jest obsługiwane.
• Bloki myślenia są powiązane z modelem, który je utworzył, oraz z rozmową, więc nie można ich odtwarzać między modelami w sposób, jaki zakładają niektóre potoki.
• Wcześniejsze computer_20251124 narzędzie do obsługi komputera nie jest akceptowane w Claude API ani w Google Cloud.
Piąta zmiana nie powoduje żadnych błędów, ale zmienia dane wyjściowe: tekst między wywołaniami narzędzi wraca teraz w blokach myślenia, których tekst jest pusty przy domyślnym ustawieniu wyświetlania. Aplikacja, która strumieniuje ten tekst użytkownikom jako aktualizacje postępu, zamilknie między wywołaniami narzędzi, dopóki nie ustawi wartości wyświetlania, która przywróci ten tekst. Nic nie zgłasza błędu; interfejs użytkownika po prostu przestaje mówić. To jest ten rodzaj regresji, który trafia na produkcję, ponieważ wszystkie testy przechodzą.
Pierwsze trzy zmiany dotyczą również modelu Fable 5.1, więc jeśli masz już przeprowadzoną migrację do tego modelu, część pracy jest już wykonana.
Uruchamianie tego obok tego, co już masz
Najbardziej kosztownym dla zespołów szczegółem migracji nie są zmiany API; jest nim to, że nowy Opus z inną skalą wysiłku unieważnia model kosztów, który zbudowaliście wokół starego. Własne wytyczne Anthropic mówią, aby testować wiele poziomów wysiłku, zamiast przenosić ustawienia Opus 5, co oznacza, że odpowiedź na pytanie „czy 5.5 jest dla nas tańszy” zależy od pomiaru, którego nikt jeszcze nie przeprowadził na waszych promptach.
Ten pomiar jest łatwiejszy do wykonania, gdy stary model wciąż jest o jedno wywołanie stąd, na tym samym kluczu. Claude Opus 5 jest dziś dostępny na OrcaRouter w cenie Anthropic 5,00 USD/25,00 USD z 0% marży — cena katalogowa dostawcy przekazywana jest bez zmian, więc stawka, którą widzisz, to stawka publikowana przez Anthropic. Claude Opus 5.5 nie jest jeszcze jedną z naszych tras; jest dostępny przez własne API Anthropic oraz główne chmury. Gdy się pojawi, porównanie obu modeli przy dopasowanym nakładzie pracy stanie się regułą routingu, a nie kolejną integracją: skieruj część ruchu do nowego modelu, pozostaw automatyczne przełączanie awaryjne wskazane na ten, który już scharakteryzowałeś, i czytaj własne liczby tokenów zamiast tabeli z premiery. Złożenie wywołania z kilku modeli — jeden tworzy szkic, drugi weryfikuje — to jedna linia DSL routingu na tym samym punkcie końcowym.

To, czego to ci nie daje, to niezależny werdykt o Opus 5.5. Na razie nic tego nie daje: opublikowane porównania bezpośrednie pochodzą od samego Anthropic, a jedyny istniejący wynik zewnętrzny to pojedyncza konfiguracja poziomu wysiłku wdrożonego systemu z wbudowanym routingiem zapasowym.
Otrzymując to i co jeszcze nadchodzi
Claude Opus 5.5 jest już dostępny pod identyfikatorem modelu claude-opus-5-5 w Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry i Claude Platform on AWS. Anthropic podaje status jako aktywny, a datę wycofania jako nie wcześniejszą niż 22 września 2027 r.
Wynikają z tego dwie rzeczy. Anthropic twierdzi, że Claude Sonnet 5.5 i Claude Haiku 5.5 pojawią się „w nadchodzących tygodniach” z wieloma z tych samych ulepszeń w zakresie wydajności i bezpieczeństwa — co, jeśli się potwierdzi, jest donioślejszym wydarzeniem dla każdego, czyje obciążenie nie wymaga modelu Opus klasy frontier. A obraz niezależnych benchmarków wciąż się klaruje: wynik Artificial Analysis to pierwsze spojrzenie na jedną konfigurację poziomu wysiłku, w wdrożonym systemie z opisanym powyżej zachowaniem fallback, a nie stabilny ranking.
Jedna szczera luka w tej premierze: Anthropic podaje, że Opus 5.5 często podejrzewa, że jest oceniany. Jest to ujawnione jako ograniczenie i godzi dokładnie w to, co mierzą tabele benchmarków. Model, który zachowuje się inaczej, gdy wie, że jest obserwowany, to model, którego wyniki — dostawcy lub niezależne — są mniej predykcyjne, niż sugeruje format.
Claude Opus 5.5 to trzecie wydanie z serii Opus w ciągu czterech miesięcy i pierwsza premiera od czasu, gdy dyrektor generalny Anthropic publicznie opowiedział się za spowolnieniem rozwoju technologii frontier. Oba te fakty znajdują się w tym samym dokumencie. O liczbach dotyczących możliwości będzie się dyskutować przez tydzień; cena i stawka za pamięć podręczną pozostaną aktualne jeszcze za rok.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
