
Cennik Claude Opus 5.5: Pełna karta stawek, linia pamięci podręcznej i ile naprawdę kosztuje zadanie
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 177 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1323 tok/s
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
Claude Opus 5.5ma cenę katalogową4,00 USD za milion tokenów wejściowych i 20,00 USD za milion tokenów wyjściowych, czyli równo 20% obniżki względem 5,00/25,00 USD, któreClaude Opus 5utrzymywał, przy spadku odczytów z pamięci podręcznej o 60% do0,20 USD za milion. To opublikowane ceny Anthropic, odczytane z dokumentacji cenowej samego Anthropic na dzień24 września 2026 r., dwa dni po premierze modelu. Cena katalogowa to ta łatwiejsza część. Anthropic twierdzi też, że model kosztuje „około 40% mniej w eksploatacji” przy typowych obciążeniach, a tej liczby nie ma w cenniku — to charakterystyka dostawcy zbudowana z obniżki za token plus założenia, że model zużywa mniej tokenów i mniej tur na wykonanie tej samej pracy. Ta strona rozdziela jedno od drugiego: każdą stawkę, którą możesz dziś zweryfikować w cenniku, oraz arytmetykę stojącą za tą, której zweryfikować nie możesz.Claude Fable 5.1, czyli wyższa warstwa za 10/50 USD, przewija się przez cały tekst jako porównanie, które samo stosuje Anthropic.
Pełny cennik, każda linia tak, jak publikuje go Anthropic.
Wszystko w tej sekcji zostało odczytane z dokumentacji cenowej Anthropic dostępnej w serwisach platform.claude.com i claude.com w dniu 24 września 2026 r.. Nic w tym tekście nie pochodzi z innego opracowania.
• Wejście — 4,00 USD za milion tokenów (opublikowana stawka Anthropic).
• Wyjście — $20.00 za milion tokenów. Tokeny rozumowania są rozliczane jako tokeny wyjściowe, a adaptacyjne rozumowanie Claude Opus 5.5 jest zawsze włączone i nie można go wyłączyć.
• Odczyt z pamięci podręcznej — 0,20 USD za milion tokenów. Anthropic dokumentuje to jako 0,05x podstawowej ceny wejścia — własny wyjątek w przypisie dotyczący tego modelu.
• Zapis do 5-minutowej pamięci podręcznej — 5,00 USD za milion tokenów, standardowy mnożnik 1,25x dla bazowego wejścia, który Anthropic stosuje do każdego modelu w arkuszu.
• Zapis do pamięci podręcznej na 1 godzinę — 8,00 USD za milion tokenów, standardowy mnożnik 2x podstawowej ceny wejściowej.
• Batch API — 50% zniżki w obu kierunkach: 2,00 USD za wejście i 10,00 USD za wyjście za milion tokenów. Anthropic publikuje obniżone stawki bezpośrednio, zamiast zostawiać Ci dzielenie ich na pół.
• Tryb szybki — 8,00 USD za milion tokenów wejściowych i 40,00 USD za milion tokenów wyjściowych, dokładnie dwukrotnie więcej niż standard. Dokumentacja Anthropic nadaje tej stronie tytuł „Tryb szybki (podgląd badawczy)”.
• Wnioskowanie wyłącznie w USA — mnożnik 1,1x dla danych wejściowych, wyjściowych, zapisów do pamięci podręcznej oraz odczytów z pamięci podręcznej, gdy inference_geo: "us" jest ustawione. Globalne routowanie — domyślne — korzysta ze standardowych cen.
• Kontekst i limit wyjściowy — 1 mln tokenów kontekstu i 128 tys. tokenów synchronicznego wyjścia w standardowej cenie, bez dopłaty za długi kontekst. Anthropic podaje, że żądanie o długości 900 tys. tokenów jest rozliczane według tej samej stawki za token co żądanie o długości 9 tys. tokenów. W Batch API limit wyjściowy wzrasta do 300 tys. po włączeniu nagłówka beta output-300k-2026-03-24.
Anthropic stwierdza również, że mnożniki pamięci podręcznej „kumulują się z innymi modyfikatorami cenowymi, takimi jak zniżka Batch API i rezydencja danych” — zatem żądanie wsadowe, korzystające z pamięci podręcznej i przypięte do USA, mnoży wszystkie trzy, a arytmetyka się kumuluje, a nie zastępuje.
Oto, jak czytelnicy obu modeli faktycznie oceniają koszt na tym samym arkuszu:
• Claude Opus 5 — 5,00 USD za wejście, 25,00 USD za wyjście, 0,50 USD za odczyt z pamięci podręcznej, 6,25 USD za zapis do pamięci podręcznej na 5 minut, 10,00 USD za zapis na 1 godzinę, 2,50/12,50 USD w Batch (opublikowane stawki Anthropic, odczyt 2026-09-24).
• Claude Fable 5.1 — $10.00 za wejście, $50.00 za wyjście, $0.25 za odczyt z pamięci podręcznej, $12.50 za zapis do pamięci podręcznej na 5 minut, $20.00 za zapis na 1 godzinę, $5.00/$25.00 w Batch (opublikowane stawki Anthropic, odczyt 2026-09-24).

Linia pamięci podręcznej to miejsce, w którym tak naprawdę rozstrzyga się rachunek agenta
Relacje z premiery traktują odczyt z pamięci podręcznej jako przypis. To największa pojedyncza dźwignia w arkuszu w przypadku każdego obciążenia, które ponownie wysyła duży prefiks, a dotyczy to większości obciążeń programistycznych i agentowych.
Przypis samego Anthropic jest wyjątkowo jednoznaczny, jeśli chodzi o te współczynniki: trafienia i odświeżenia pamięci podręcznej kosztują 0.1x ceny bazowej danych wejściowych w większości modeli Claude, 0.025x w Claude Fable 5.1 oraz 0.05x w Claude Opus 5.5. Współczynnik pamięci podręcznej Claude Opus 5.5 jest więc dwukrotnie gorszy od standardowego i dwukrotnie gorszy niż w Claude Fable 5.1.
W dolarach i tak wygrywa, a to jest ta część, którą warto przyswoić: lepszy mnożnik nie wygrywa w dolarach, gdy stopa bazowa jest dwa i pół raza wyższa.
• Claude Fable 5.1 — 2,5% podstawy 10,00 USD to 0,25 USD za milion tokenów z pamięci podręcznej.
• Claude Opus 5.5 — 5% z bazowej kwoty 4,00 USD to 0,20 USD za milion tokenów w pamięci podręcznej.
• Claude Opus 5 — 10% z podstawy $5.00 to $0.50 za milion tokenów z pamięci podręcznej.
Ta sama inwersja zachodzi przy zapisach. Claude Fable 5.1 pobiera 12,50 USD za zapis miliona tokenów do 5-minutowej pamięci podręcznej i 20,00 USD za okno 1-godzinne; Claude Opus 5.5 pobiera 5,00 USD i 8,00 USD. Odczyty z pamięci podręcznej to jedyna pozycja, w której Claude Opus 5.5 bije oba pozostałe modele pod względem bezwzględnej kwoty w dolarach, mimo że ma środkowy współczynnik.
Dwie reguły decydują o tym, czy zapis w ogóle się opłaca. Dokumentacja Anthropic mówi, że zapis 5-minutowy kosztuje 1,25× podstawowego wejścia i dlatego zwraca się po jednym odczycie z pamięci podręcznej, natomiast zapis 1-godzinny kosztuje 2× podstawowego wejścia i wymaga dwóch odczytów, aby się zwrócić. Pamięć podręczna jest powiązana z prefiksem, który ją utworzył: Anthropic zauważa, że przełączanie między trybem szybkim a standardowym unieważnia pamięć podręczną, ponieważ żądania przy różnych szybkościach nie współdzielą prefiksów z pamięci podręcznej. Zmiana modelu, poziomu wysiłku lub definicji narzędzi ma taki sam skutek. Tańszy model, który przy każdym przełączeniu wymusza ponowne zapisanie prefiksu, może kosztować więcej niż droższy model, który zastąpił.
Ile tak naprawdę kosztuje długa pętla agenta
Weź agenta kodującego na 40 tur, który przy każdej turze ponownie wysyła prefiks o długości 120 000 tokenów — prompt systemowy, schematy narzędzi, drzewo plików — dodaje 1000 nowych tokenów wejściowych na turę z wyników narzędzi i generuje 800 tokenów wyjściowych na turę. Chodzi tu o podstawienie: zmień dowolną z tych czterech liczb, aby dopasować ją do własnego ruchu, a poniższa arytmetyka nadal się zgadza.
O Claude Opus 5.5:
• Zapis do pamięci podręcznej, jednorazowo — 120 000 tokenów po 5,00 USD za milion = 0,60 USD
• Odczyty z pamięci podręcznej, 39 tur — 4 680 000 tokenów po $0.20 za milion = $0.94
• Świeże dane wejściowe, 40 tur — 40 000 tokenów po 4,00 USD za milion = 0,16 USD
• Dane wyjściowe, 40 tur — 32 000 tokenów po 20,00 USD za milion = $0.64
• Suma sesji — 2,34 USD, z czego odczyty z pamięci podręcznej stanowią około 40%.
W przypadku Claude Opus 5, przy identycznych liczbach tokenów: 0,75 USD za zapis do pamięci podręcznej, 2,34 USD za odczyty z pamięci podręcznej, 0,20 USD za nowe dane wejściowe i 0,80 USD za dane wyjściowe — 4,09 USD.
W przypadku Claude Fable 5.1, przy identycznej liczbie tokenów: 1,50 USD za zapis do pamięci podręcznej, 1,17 USD za odczyty z pamięci podręcznej, 0,40 USD za nowe dane wejściowe i 1,60 USD za dane wyjściowe — 4,67 USD.
Te same tokeny, te same tury, żadnych twierdzeń o wydajności nie trzeba: Claude Opus 5.5 wychodzi o 43% taniej niż Claude Opus 5 i o 50% taniej niż Claude Fable 5.1. A 1,40 USD z 1,75 USD różnicy względem Claude Opus 5 — osiemdziesiąt procent oszczędności — pochodzi wyłącznie z pozycji odczytu z pamięci podręcznej, a nie z głównej stawki za dane wejściowe.
Teraz uruchom odwrotny wariant: pojedyncze wywołanie z 20 000 tokenów wejściowych i 8 000 wyjściowych, bez buforowania. Claude Opus 5.5 kosztuje 0,08 USD za wejście plus 0,16 USD za wyjście — 0,24 USD. Claude Opus 5 kosztuje 0,10 USD plus 0,20 USD — 0,30 USD. To dokładnie 20% obniżki ceny katalogowej i ani punktu więcej.
Sam cennik daje gdzieś między 20% a 43%, w zależności od tego, jak duża część Twojego rachunku przypada na odczyty z pamięci podręcznej. Każde twierdzenie powyżej tego zakresu wynika z liczby tokenów, a nie z cen.
Skąd pochodzi „około 40% taniej w eksploatacji" Anthropic
Materiały premierowe Anthropic mówią, że Claude Opus 5.5 „wymaga mniej obliczeń do obsługi niż Opus 5” i że jego testy pokazują, że „będzie kosztować o 40% mniej niż Opus 5 w typowych obciążeniach” przy domyślnych ustawieniach. Rozkład podany przez Anthropic jest taki, że model „kosztuje mniej za token niż Opus 5 i zużywa mniej tokenów na zadanie, co daje w sumie 40% spadek kosztów”.
Nazwij to po imieniu: charakterystyka dostawcy średniej z obciążeń wybranych przez Anthropic, a nie wynik po audycie ani stawka opublikowana w cenniku. Weryfikowalna połowa to pierwsza połowa — 20% zniżki na dane wejściowe i wyjściowe, 60% zniżki na odczyty z pamięci podręcznej, obie można odczytać w cenniku już dziś. Druga połowa zależy od tego, czy model zużywa mniej tokenów i mniej tur na Twoim obciążeniu, które można sprawdzić tylko przez uruchomienie go.
Dowody, jakie Anthropic oferuje dla części dotyczącej tokenów, to zestaw oświadczeń klientów z czasu premiery. Wszystkie poniższe zostały opublikowane przez dostawcę i opisują obciążenia, które wybrał dostawca i jego klienci:
• Box — model „zużył jedną trzecią tokenów, które wykorzystał Opus 5”, a odpowiedzi były „o 40% mniej rozwlekłe bez utraty dokładności”.
• Kiro — rozwiązał więcej niż Opus 5, wykonując przy tym około 40% mniej wywołań i zużywając połowę tokenów.
• Factory — „dorównał Opus 5 przy wysokim wysiłku, zużywając przy tym o 20–25% mniej tokenów wyjściowych”.
• GitHub — „wykorzystał jedną z najmniejszych liczb tokenów i kroków, jakie zmierzyliśmy”, a w VS Code „rozwiązał więcej zadań terminalowych niż Opus 5 w mniej niż połowie kroków”.
• Analiza fuzji, jeden opracowany przykład — dwie fikcyjne firmy tworzące oprogramowanie HR, przy czym każdy model budował arkusz w Excelu i prezentację dla kadry zarządzającej. Anthropic podaje, że Claude Opus 5.5 ukończył zadanie w 63 minuty wobec 93 minut w przypadku Claude Opus 5 i „koszt jego wytworzenia był o 50% niższy”. Dane zgłoszone przez dostawcę, n=1.
Niezależna przeciwwaga ma tu znaczenie, ponieważ wskazuje w przeciwnym kierunku. Artificial Analysis zmierzyło Claude Opus 5.5 przy maksymalnym wysiłku na poziomie około 119 000 tokenów wyjściowych na zadanie Intelligence Index, w porównaniu z około 73 000 dla Claude Opus 5 przy maksymalnym wysiłku — liczba tokenów idzie w górę, a nie w dół. Podsumowanie tej konfiguracji przez Artificial Analysis jest takie, że Claude Opus 5.5 jest „na tym samym poziomie co Opus 5 pod względem kosztu na zadanie, mimo 1,6-krotnie większej liczby tokenów wyjściowych”, przy publikowanym koszcie 5,98 USD za zadanie Intelligence Index. To niezależny pomiar przy maksymalnym wysiłku i nie stoi w sprzeczności z twierdzeniem Anthropic — to drugi koniec skali wysiłku.
Co prowadzi do zastrzeżenia, które determinuje każdą liczbę w tej sekcji. Anthropic podaje, że o ile nie zaznaczono inaczej, wszystkie jego wyniki dla Claude Opus 5.5 wykorzystują myślenie adaptacyjne przy maksymalnym wysiłku. Claude Opus 5.5 domyślnie używa średniego wysiłku; Claude Opus 5 domyślnie używał wysokiego, a ta sama nazwa poziomu nie oznacza tego samego budżetu myślenia w obu modelach. Zatem tabela dostawcy uruchomiona przy maksymalnym wysiłku i niezależna tabela uruchomiona przy maksymalnym wysiłku z włączonym domyślnym fallbackiem to nie ta sama konfiguracja, a ustawienie domyślne również nie jest tym, które czytelnik faktycznie by wdrożył. Średnia 40% zmierzona na wybranym zestawie obciążeń, przy ustawieniach, których możesz nie używać, jest hipotezą wyjściową — a nie pozycją budżetową.
Tryb szybki to podgląd badawczy, a nie poziom.
Tryb szybki w Claude Opus 5.5 kosztuje 8,00 USD za milion tokenów wejściowych i 40,00 USD za milion tokenów wyjściowych — dokładnie dwa razy więcej niż standardowa cena — w zamian za nawet 2,5 razy większą liczbę tokenów wyjściowych na sekundę. Nie skraca czasu do pierwszego tokenu; zysk dotyczy szybkości generowania wyjścia i jest najbardziej widoczny przy strumieniowaniu.
Powiedz resztę wprost, bo łatwo jest zaplanować to w budżecie jako tier, choć nim nie jest. Anthropic określa tryb fast jako podgląd badawczy. Dostęp uzyskuje się przez account managera lub listę oczekujących. Wymaga nagłówka beta fast-mode-2026-02-01 oraz speed: "fast" w żądaniu. Jest dostępny wyłącznie w Claude API — nie w Amazon Bedrock, Google Cloud, Microsoft Foundry ani Claude Platform on AWS. Nie można go łączyć z Batch API ani ze zobowiązaniem Priority Tier. Łączy się natomiast z prompt caching i mnożnikami data residency, więc żądanie w trybie fast z cache przypięte do USA płaci 1,1x na wierzchu 2x. A przełączanie obciążenia między trybem fast a standard unieważnia prompt cache, co przy długiej pętli agenta może kosztować więcej, niż oszczędza przyspieszenie.
Claude Opus 5 i Claude Opus 4.8 również obsługują tryb szybki, w cenie $10.00/$50.00. Claude Opus 4.7 kategorycznie odrzuca ten parametr.
Jednostką decydującą o rachunku jest koszt za ukończone zadanie
Każda z powyższych stawek to cena za token. Nikt nie kupuje tokenów. Cena za token staje się kosztem dopiero wtedy, gdy pomnoży się ją przez liczbę tokenów zużywanych przez zadanie i liczbę prób potrzebnych do jego ukończenia.
Przeprowadź obliczenia dla wcześniejszego przykładu cache-light. Przy $0.24 za przebieg model, który kończy zadanie za pierwszym podejściem, kosztuje $0.24. To samo zadanie u konkurenta przy $0.30 za przebieg kosztuje $0.30 — więc tańszy model wygląda na 20% lepszego. Teraz załóżmy, że tańszy model potrzebuje 1,2 przebiegu na ukończone zadanie, co jest szczodrym wskaźnikiem sukcesu w pracy agentowej: 1,2 × $0.24 to $0.288, w porównaniu z $0.30 dla alternatywy z pojedynczym przebiegiem. Oszczędność znika. Przy trzech przebiegach to $0.72, a model, który wyglądał na 20% tańszy za token, jest o 140% droższy na ukończone zadanie.
Dlatego właśnie własne twierdzenia Anthropic o wydajności — mniej tokenów, mniej wywołań, mniej kroków — są ujęte we właściwej jednostce. To także dlatego żadnego z nich nie należy traktować jako pozycji budżetowej, dopóki ich nie odtworzysz. Kontrola jest mechaniczna: cena za przebieg pomnożona przez liczbę przebiegów na ukończone zadanie, mierzona na własnym ruchu. Oba te liczby musisz wytworzyć sam, a żaden dostawca nie publikuje tej drugiej dla twojego obciążenia.
Jeśli chcesz mieć jeden punkt odniesienia spoza strony dostawcy, Artificial Analysis podaje, że Claude Opus 5.5 w konfiguracji maksymalnego wysiłku kosztuje 5,98 USD za zadanie w Intelligence Index — to niezależna liczba przy ustawieniu, którego większość ruchu produkcyjnego nie wykorzysta, przydatna raczej jako górna granica niż prognoza.

Linie, których nie obejmuje stawka podstawowa
• Rezydencja.Wnioskowanie wyłącznie na terenie USA to 1,1x w przypadku każdej kategorii tokenów, w tym odczytów i zapisów z pamięci podręcznej. Łączy się z trybem szybkim oraz z rabatem Batch.
• Definicje narzędzi. Anthropic publikuje narzut na prompt systemowy dotyczący używania narzędzi w podziale na modele: zadeklarowanie narzędzi dodaje 286 tokenów do każdego żądania Claude Opus 5.5. Niewiele przy cenie 4,00 USD za milion, ale jest naliczane za każde żądanie, a pętla agenta wykonuje ich mnóstwo.
• Unieważnianie pamięci podręcznej. Prefiks przepisany po zmianie modelu, poziomu wysiłku, definicji narzędzia lub szybkości jest rozliczany według stawki zapisu — 5,00 USD lub 8,00 USD za milion w Claude Opus 5.5 — a nie według stawki odczytu wynoszącej 0,20 USD.
• Model poniżej niego. Claude Sonnet 5 kosztuje 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych, co — jak potwierdza przypis cenowy Anthropic — jest obecnie ceną standardową, a nie stawką wprowadzającą, jako którą go ogłoszono. Claude Opus 5.5 to dokładnie 2x Sonnet 5 w obu kierunkach.

Wywoływanie Claude Opus 5.5 w cenie katalogowej Anthropic
Claude Opus 5.5 jest dostępny w OrcaRouteranthropic/claude-opus-5.5 w cenie 4,00 USD za wejście i 20,00 USD za wyjście za milion — czyli w cenie katalogowej samego Anthropic, przekazywanej dalej przy 0% marży. To przekazywanie warto na stronie z cennikiem ująć precyzyjnie: ponieważ stawka dostawcy jest przekazywana dalej, a nie zapisywana w tabeli, zmiana stawek dostawcy obowiązuje tutaj tego samego dnia, w którym zostanie opublikowana, a nie po oknie synchronizacji. Jeśli Anthropic zmieni ten cennik, numer, na który dzwonisz, zmieni się razem z nim.
Ten sam klucz obejmuje poziomy, z którymi porównuje go ta strona — anthropic/claude-opus-5 za $5.00/$25.00 i anthropic/claude-fable-5.1 za $10.00/$50.00 — obok reszty oferty Claude i ponad 200 innych modeli, więc sprawdzenie, czy tańsza stawka za token wytrzyma zderzenie z twoją własną liczbą przejść, nie wymaga drugiej umowy ani zmiany w kodzie. Automatyczne przełączanie awaryjne jest dostępne na wypadek, gdy chcesz uruchomić nieznany model na ścieżce produkcyjnej, nie stawiając na niego całej tej ścieżki.
Odpowiedź w dwóch linijkach na to, o czym jest ta strona: cennik wynosi 4,00 USD za wejście, 20,00 USD za wyjście i 0,20 USD za milion odczytów z pamięci podręcznej, a obniżka o 20% jest realna i weryfikowalna już dziś. Te 40% to średnia Anthropic dla obciążeń, które sama wybrała. Przepuść przez to jedną ze swoich własnych pętli agentowych, zanim zaplanujesz budżet na podstawie drugiej liczby.
Porównane w tym artykule3
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
