
Cennik API Claude Opus 5: 5 USD / 25 USD za 1 mln tokenów, cache za 0,50 USD i ile to naprawdę kosztuje
- DeepSeekNOWOŚĆDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 za 1 mln tokenów
- z-aiNOWOŚĆZ.ai: GLM 5.32026-08-1860Inteligencja75Kod
- obsidianNOWOŚĆQwen3.8 27B2026-08-1552Inteligencja68Kod
- qwenNOWOŚĆQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOWOŚĆDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencja69Kod
- grokNOWOŚĆSpaceXAI: Grok 4.62026-08-1261Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0557Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencja69Kod
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencja49Kod
- metaMeta: Muse Spark 1.12026-07-1653Inteligencja71Kod
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencja76Kod
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencja71Kod
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencja77Kod
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencja77Kod
Claude Opus 5 kosztuje $5.00 za milion tokenów wejściowych i $25.00 za milion tokenów wyjściowych na API Claude Opus 5 — to ta sama stawka, którą model ma w katalogu OrcaRouter, sprawdzona 2026-08-18, przy zerowej marży. Dzięki temu jest o połowę tańszy od Claude Fable 5 i kosztuje dokładnie tyle, ile kosztował Claude Opus 4.8, a karta stawek na bieżącej stronie modelu Claude Opus 5 to ta, na której należy opierać budżet. Dźwignie mają większe znaczenie niż główna stawka: ponownie użyte tokeny wejściowe rozliczane są po $0.50 za milion dzięki buforowaniu promptów, tryb wsadowy spada do $2.50 / $12.50, a beta trybu szybkiego wynosi $10 / $50. Ta strona jest referencją cenową dla modelu — dokładna karta stawek, ile faktycznie kosztuje żądanie, jak cena wypada na tle konkurencji, kiedy nie warto go kupować, oraz jak wywołać go przez jeden punkt końcowy zgodny z OpenAI, używając własnego klucza.
Ceny podawane są za milion tokenów (wejście / wyjście), według stanu na 2026-08-18. Kwoty w dolarach pochodzą z opublikowanych stawek API Anthropica i zostały zweryfikowane na stronie modelu OrcaRouter dla Claude Opus 5; stawki dla cache, trybu wsadowego i trybu szybkiego są ogłoszone przez Anthropica. Ceny się zmieniają — sprawdź przed rozpoczęciem tworzenia.
Dokładna cena, zweryfikowana dzisiaj
Oto pełna karta opłat dla Claude Opus 5, zweryfikowana 2026-08-18:

• Wejście — 5,00 USD za 1 mln tokenów przy braku trafienia w pamięci podręcznej.
• Wyjście — $25.00 za 1M tokenów.
• Zapis do cache promptów — 6,25 USD za 1M przy TTL 5 minut, 10,00 USD za 1M przy TTL 1 godzina.
• Odczyt z pamięci podręcznej promptu — 0,50 USD za 1M tokenów, 90% zniżki na każde ponownie wysłane wejście.
• Batch API — $2.50 za wejście / $12.50 za wyjście, stała zniżka 50%, asynchroniczny.
• Tryb szybki — $10 za wejście / $50 za wyjście, 2x dopłata za do około 2,5x szybkość wyjścia, wersja beta Anthropic.
• Okno kontekstu — 1M tokenów, do 128K na wyjściu.
OrcaRouter przekazuje stawkę dostawcy bez narzutu, więc kwota widniejąca w katalogu to kwota, którą płacisz. Na stronie modelu na żywo karta wskazuje 5,00 $ / 25,00 $ za 1M, odczyt z cache 0,500 $, zapis do cache 10,00 $ (stawka TTL 1 godziny), z plakietkami Vision, Tools, JSON i Reasoning.
Dźwignie, które zmieniają efektywną cenę
Stawka bazowa to tylko punkt wyjścia. Trzy modyfikatory zmieniają to, ile faktycznie kosztuje Cię Opus 5:
• Buforowanie promptów — ponownie użyty kontekst kosztuje 0,50 USD za milion zamiast 5 USD za świeży. Minimalny prefiks podlegający buforowaniu spadł do około 512 tokenów w Opus 5, więc nawet skromny stabilny prompt systemowy się kwalifikuje. Dla każdego agenta lub czatu, który przy każdej turze ponownie wysyła duży prefiks, buforowanie jest największą dźwignią na rachunku — a ponieważ Anthropic przyporządkowuje bufor do klucza API, to właśnie pozostanie przy jednym kluczu (jednym kanale) zapewnia, że trafienia wciąż się zdarzają.
• Batch — API wsadowe Anthropica uruchamia zadania asynchronicznie, a wyniki są zwykle dostępne w ciągu 24 godzin, w dokładnie połowie ceny: 2,50 $ / 12,50 $. Łączy się z buforowaniem promptów i sprawdza się w ewaluacjach, klasyfikacji zbiorczej i generowaniu offline, gdzie opóźnienie nie ma znaczenia.
• Szybki tryb — $10 / $50 za do ~2.5x przepustowości wyjściowej, przydatny do pracy o krytycznym znaczeniu dla opóźnień i dużym wolumenie wyjściowym. Nie łączy się z interfejsem batch API i jest betą first-party firmy Anthropic; standardowa stawka tranzytowa od routera to bazowe $5 / $25.
Ile właściwie kosztuje zapytanie
Ceny za token są abstrakcyjne, więc oto przykłady wyliczone według dzisiejszych stawek:
• Pojedyncze wywołanie czatu, 50K wejścia + 20K wyjścia — $0.25 + $0.50 = $0.75.
• 1 mln wejść + 1 mln wyjść — $5 + $25 = $30.
• Tura agenta, 200K kontekstu z cache + 20K świeżych wejść + 30K wyjść — $0.10 + $0.10 + $0.75 = $0.95. Ta sama tura z zimnym cache — 220K świeżych wejść po $1.10 — daje łącznie $1.85. Dzięki cache'owaniu koszt jest prawie o połowę niższy.
• Miesiąc z 10M tokenów przy podziale 70% na wejście / 30% na wyjście, przy 80% wejścia serwowanego z pamięci podręcznej: 1,4M świeżego wejścia (7,00 $) + 5,6M z pamięci (2,80 $) + 3M wyjścia (75 $) ≈ 85 $. Bez pamięci podręcznej ten sam miesiąc kosztuje 110 $.
Dwa zastrzeżenia podnoszą efektywną stawkę. Opus 5 to model rozumujący — myślenie adaptacyjne jest domyślnie włączone, a tokeny myślenia są rozliczane jako wyjście po 25 dolarów za milion. Trudny prompt przy wysokim ustawieniu wysiłku może wydać dużą część budżetu wyjściowego na rozumowanie, więc efektywny koszt wyjścia przy trudnych zadaniach jest znacznie wyższy, niż wynikałoby to z naiwnych szacunków. Co więcej, obecny tokenizer Anthropica jest bardziej rozwlekły niż w poprzedniej generacji, więc ten sam angielski tekst kosztuje więcej tokenów (i więcej pieniędzy) niż na starszych modelach Claude. Obniż ustawienie wysiłku w przypadku łatwych wywołań i ograniczaj wyjście, gdzie się da.
Jak ceny Opus 5 wypadają na tle konkurencji

Odczytane względem opublikowanych cen katalogowych na dzień 2026-08-18:
• Claude Opus 4.8 — $5 / $25. Cena identyczna jak w poprzedniej generacji. Opus 5 kosztuje tyle samo w przypadku nowszego modelu, co ułatwia aktualizację.
• Claude Fable 5 — $10 / $50. Opus 5 kosztuje połowę ceny najwyższego wariantu Anthropica, z takim samym kontekstem 1M tokenów.
• Claude Sonnet 5 — $3 / $15 standardowo ($2 / $10 w cenie wprowadzającej do 31 sierpnia 2026 r.). Poziom Sonnet jest o 40% tańszy na wejściu i wyjściu — naturalny domyślny wybór, gdy nie potrzebujesz rozumowania na poziomie Opus.
• GPT-5.6 Sol — $5 / $30. Ta sama cena za wejście, tańsze wyjście na Opus 5.
• GPT-5.6 Terra — 2 $ / 12 $. Średni poziom wolumenowy dla wysokowolumenowych prac spoza czołówki.
• Gemini 3.6 Flash — 1,50 USD / 7,50 USD. Model klasy Flash do taniego, szybkiego i multimodalnego ruchu.
• Kimi K3 — $3 / $15. Flagowy model o otwartych wagach, ze stawkami mniej więcej o połowę niższymi niż Opus.
• DeepSeek V4 Pro — $0.44 / $0.88 poza szczytem (w godzinach szczytu cena się podwaja). Tani flagowiec z otwartymi wagami, zupełnie inny poziom cenowy.
Mówiąc uczciwie: Opus 5 nie jest tanim modelem — to flagowiec wyceniony na połowę najwyższej półki (Claude Fable 5) i dokładnie tyle, ile kosztowała poprzednia generacja. Wygrywa ceną za długi kontekst i ceną za trudne rozumowanie, a nie bezwzględną stawką. Jeśli Twój ruch to krótkie prompty i proste zadania, model Sonnet za 3 dolary lub DeepSeek za 0,44 dolara to tańszy wybór.
Kiedy Opus 5 jest złym wyborem
Cztery przypadki, w których ta cena to nie ta, której chcesz:
Krótkie, proste podpowiedzi. Dla zapytań poniżej mniej więcej 20 tys. tokenów, bez głębokiego rozumowania, dopłata za Opusa jest zmarnowana. Claude Sonnet 5 za $3 / $15 (lub $2 / $10 w oknie promocyjnym) obsługuje wolumen o 40% taniej, a model klasy Gemini Flash lub DeepSeek kosztuje ponownie znacznie mniej.
Duży wolumen wymagający intensywnego rozumowania. Ponieważ myślenie jest rozliczane jako dane wyjściowe, trudny prompt przy wysokim nakładzie pracy może kosztować znacznie więcej, niż wynikałoby z nominalnej liczby tokenów wyjściowych. Jeśli Twoje zadania to wiele trudnych wywołań, zmierz rzeczywistą liczbę tokenów wyjściowych przed podjęciem decyzji — efektywna stawka może Cię zaskoczyć.
Cena za token jako jedyny cel. Jeśli wynik na przełomowym benchmarku lub kontekst 1M nie jest twardym wymogiem, tańsze flagowce (GPT-5.6 Terra, DeepSeek V4 Pro) lub modele klasy Flash (Gemini 3.6 Flash) oferują znacznie niższe stawki za token dla zdecydowanej większości ruchu.
Rygorystyczne budżety opóźnień. Opus 5 to duży model rozumujący — p50 czasu do pierwszego tokena wynosi około 7 sekund w 7-dniowym pomiarze przeprowadzonym przez OrcaRouter. W przypadku czatu w czasie rzeczywistym, gdzie liczy się TTFT poniżej sekundy, jest to niewłaściwy model niezależnie od ceny.
Jak to wywołać w OrcaRouter

Claude Opus 5 jest hostowany na OrcaRouter pod identyfikatorem modelu anthropic/claude-opus-5, udostępniany przez kompatybilny z OpenAI endpoint pod adresem api.orcarouter.ai/v1 po cenie dostawcy, bez żadnej marży. Jeśli masz już klienta OpenAI, migracja to zmiana adresu URL bazy i identyfikatora modelu — nic więcej. Ten sam klucz i endpoint obsługują ponad 200 modeli, więc Opus 5 znajduje się obok Claude Sonnet 5, Claude Haiku 4.5, warstw GPT-5.6, rodziny Gemini oraz modeli o otwartych wagach, z którymi warto go porównać, a Ty możesz kierować ruch według trudności zamiast integrować każdy z nich osobno.
Dwie cechy charakterystyczne OrcaRouter, które warto wymienić na stronie cenowej.BYOK: użyj własnego klucza Anthropic, a Anthropic rozliczy Cię bezpośrednio według własnych stawek — OrcaRouter dodaje $0 za token i zachowuje limity oraz kredyty Twojego dostawcy bez zmian.Guardrails: PII Shield i polityka treści działają przed rozliczeniem, więc zablokowane żądanie zwraca czysty błąd 400 i nigdy nie jest obciążane, a Agent Firewall ocenia wywołania narzędzi i MCP przed ich wykonaniem.
Uczciwa notka, która ma znaczenie dla strony z cenami: przekazujemy model, nie ustalamy jego ceny. Kwota $5 / $25 to stawka Anthropic przenoszona dalej, a gdy Anthropic ją zmieni, cennik podąża za nią — i właśnie dlatego ta strona jest opatrzona datą. Jeśli wywołujesz Anthropic bezpośrednio, otrzymujesz tę samą stawkę; OrcaRouter istnieje dla trasy z jednym kluczem i zerową marżą, jeśli chcesz mieć jeden punkt końcowy dla całej linii modeli.
Źródła i data
Wszystkie powyższe ceny zostały zweryfikowane w dniu 2026-08-18. Liczby dotyczące Claude'a pochodzą z opublikowanych cen API Anthropica i zostały sprawdzone krzyżowo ze stroną modelu OrcaRouter dla Claude Opus 5 (sprawdzono tego samego dnia). Ceny GPT-5.6 po okresie obniżek to opublikowane stawki OpenAI; wartości dla Gemini, Kimi i DeepSeek pochodzą z aktualnych wpisów w katalogu OrcaRouter, przy czym DeepSeek V4 Pro jest pokazany w stawce poza szczytem (w godzinach szczytu jest dwukrotnie wyższa). Ceny Anthropica pozostają stabilne od premiery Opus 5 w dniu 24 lipca 2026, ale mogą się zmieniać — każdą znalezioną wcześniejszą stronę „Opus 5 pricing" traktuj z uwzględnieniem daty sprawdzenia. Podane tu liczby są aktualne na dziś.
Każda cena powyżej to aktualna stawka na stronie modelu Claude Opus 5 — zweryfikowana 2026-08-18 z zerową marżą, gotowa do użycia z własnym kluczem.
Porównane w tym artykule4
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
