Claude Opus 5: Model Anthropic bliski granicy możliwości za połowę ceny Fable 5
Guides & Insights

Claude Opus 5: Model Anthropic bliski granicy możliwości za połowę ceny Fable 5

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

24 lipca 2026 roku Anthropic wypuścił Claude Opus 5 — i w ciągu dnia zrobił coś rzadkiego dla „tańszego” modelu: trafił na szczyt niezależnych rankingów. Anthropic przedstawiał Opus 5 jako model sięgający granicznej inteligencji Claude Fable 5 za połowę ceny, i tego samego dnia został udostępniony w Claude.ai, Claude API, Claude Code i Claude Cowork. Od tego czasu Artificial Analysis ocenił go jako model #1 w swoim Intelligence Index. Ten przewodnik opisuje, czym tak naprawdę jest Opus 5, co zostało niezależnie zweryfikowane w porównaniu z danymi dostawcy, jego nową skalę wysiłku i postawę w zakresie bezpieczeństwa, ile faktycznie kosztuje i kto powinien się na niego przesiąść.

Każda poniższa liczba jest oznaczona źródłem, ponieważ przy tej prędkości historia zmienia się codziennie: to, co w dniu premiery brzmiało "jeszcze brak niezależnego wyniku", teraz jest "niezależnie #1". Benchmarki i ceny się zmieniają — zweryfikuj przed podjęciem decyzji budżetowej.

TL;DR. Claude Opus 5 kosztuje $5 za 1M tokenów wejściowych i $25 za 1M tokenów wyjściowych — identyczny z Opus 4.8 i dokładnie połowa ceny Fable 5 ($10 / $50). Według Artificial Analysis Intelligence Index teraz prowadzi z wynikiem 61 (maksymalny wysiłek), jest najlepszym modelem spośród 170 ocenionych, nieznacznie wyprzedzając Fable 5 (60) i dorównując jego klasie przy połowie kosztów. Własne benchmarki Anthropic to potwierdzają: Frontier-Bench v0.1 43,3% (wobec 33,7% Fable 5), a także prowadzi w Zapier's AutomationBench i OSWorld 2.0 computer-use benchmark. Dwie cechy sprawiają, że to więcej niż obniżka ceny: pokrętło wysiłku (niskie/średnie/wysokie/maksymalne), które zmienia koszt w zależności od możliwości na żądanie, oraz najsilniejsze bezpieczeństwo spośród wszystkich dotychczasowych modeli Opus. Jeśli już korzystasz z Claude, aktualizacja jest niskiego ryzyka i nie podnosi rachunku; jeśli wybierasz pomiędzy flagowcami, Opus 5 jest teraz liderem pod względem wartości i jakości — przetestuj go na własnym obciążeniu.

Najważniejsze wnioski

• Teraz niezależnie #1. Artificial Analysis wymienia Claude Opus 5 (max effort) na 61 w swoim Intelligence Index — najlepszy model, wyprzedzając Fable 5 (60).

• Połowa ceny Fable 5. 5 $ / 25 $ za 1M tokenów, tyle samo co Opus 4.8 i połowa ceny Fable 5 wynoszącej 10 $ / 50 $ — jakość na poziomie liderów w średniej cenie.

• Nowe pokrętło wysiłku. Ustawienia niskie/średnie/wysokie/maksymalne wymieniają żetony (koszt) na zdolność; "maksymalne" to to, co jest na szczycie tabeli wyników, tańsze ustawienia wciąż pokonują większość rywali.

• Zbudowany dla agentów i użycia komputerowego. Anthropic kładzie nacisk na kończenie wieloetapowych zadań (AutomationBench) i sterowanie prawdziwym interfejsem użytkownika (OSWorld 2.0), a nie tylko pojedyncze odpowiedzi.

• Najbezpieczniejszy Opus jak dotąd. Anthropic nazywa go „najbardziej dopasowanym modelem Opus”, oczekując, że jego cyberklasyfikatory będą interweniować około 85% rzadziej niż Fable 5 — mniej fałszywych odmów w przypadku legalnej pracy.

• Szeroka, natychmiastowa dostępność. Model domyślny na Claude Max, najsilniejszy na Claude Pro, oraz dostępny na żywo na API, Claude Code i Claude Cowork od pierwszego dnia.

Uwaga dotycząca czytania tego briefu: wszystko przypisane Anthropic to twierdzenie dostawcy z materiałów premierowych; niezależne dane (Intelligence Index) są przypisywane Artificial Analysis. Gdy liczba nie została jeszcze opublikowana (oddzielny wynik SWE-bench Verified), mówimy o tym, zamiast zgadywać.

Czym tak naprawdę jest Claude Opus 5

Opus 5 to najnowszy członek linii Opus od Anthropic – cięższy poziom nad Sonnet i Haiku. Znajduje się powyżej Opus 4.8 i, według niezależnego Intelligence Index, wyprzedził Fable 5, flagowego modelu Anthropic z czerwca 2026 roku. Tym, co go wyróżnia, nie jest skromny wzrost możliwości, ale połączenie: inteligencja na poziomie niemal szczytowym przy przystępnej cenie. Anthropic opisuje go jako model „przemyślany i proaktywny”, przeznaczony do kodowania, przepływów pracy agentowych i codziennych zadań biurowych w przedsiębiorstwach.

Konkretnie, Opus 5 kosztuje $5 za 1M tokenów wejściowych i $25 za 1M tokenów wyjściowych. To tyle samo co Opus 4.8 i połowa ceny Fable 5 wynoszącej $10 / $50. Jest domyślnym modelem w Claude Max i najsilniejszą opcją w Claude Pro, a od dnia premiery jest dostępny przez Claude API, Claude Code (do kodowania) oraz Claude Cowork (do pracy zespołowej z agentem). Okno kontekstu to klasa 1M rodziny Opus.

Co właściwie jest nowego?

Najwyraźniejszym sygnałem w dniu premiery był Anthropic Frontier-Bench v0.1, trudny zestaw zadań wymagających rozumowania: Opus 5 osiąga 43,3%, wobec 33,7% dla Fable 5 i 18,7% dla Opus 4.8. W tym benchmarku tańszy nowy model Anthropic przewyższa własny droższy flagowiec — twierdzenie, które zostało potwierdzone przez niezależne oceny.

Kolejne dwa testy porównawcze dostawców uzupełniają historię o „zaprojektowanym do prawdziwej pracy”. W teście AutomationBench od Zapier, który mierzy, czy model doprowadza zadanie biznesowe do końca, a nie tylko je rozpoczyna, Anthropic twierdzi, że wskaźnik zaliczeń Opusa 5 jest około 1,5 razy wyższy niż w przypadku najbliższego konkurencyjnego modelu przy porównywalnym koszcie, a nawet jego najtańsze ustawienie wysiłkowe pokonuje najlepsze wyniki każdego rywala. W teście OSWorld 2.0, benchmarku użycia komputera, Anthropic informuje, że Opus 5 przewyższa konkurencję na każdym poziomie cenowym i osiąga najwyższy wynik Fable 5, zużywając około jednej trzeciej budżetu. Opus 5 poprawia również wyniki Opusa 4.8 we wszystkich ocenianych przez Anthropic dziedzinach nauk przyrodniczych, a największy skok – o ponad 10 punktów procentowych – dotyczy zadań z chemii organicznej, takich jak odczytywanie struktury molekularnej z danych spektroskopowych.

Pokrętło wysiłku: płacenie tylko za potrzebne możliwości

Główną funkcją – i tą, na którą zwraca uwagę większość recenzentów – jest ustawienie poziomu wysiłku. Opus 5 pozwala wybrać, ile wysiłku model poświęca na odpowiedź: niski, średni, wysoki lub maksymalny. Wyższy wysiłek oznacza więcej wewnętrznych tokenów rozumowania (a więc wyższy koszt i opóźnienie) oraz wyższą jakość; niższy wysiłek oszczędza tokeny, zapewniając szybsze i tańsze odpowiedzi. Jest to w istocie pokrętło kontroli wydatków na AI.

Dlatego Artificial Analysis wymienia kilka wersji Opus 5 (medium, high, xhigh, max): każdy poziom wysiłku to inny punkt na krzywej kosztów i jakości. Ustawienie „max” to to, co obecnie znajduje się na szczycie Indeksu Inteligencji z wynikiem 61; niższe ustawienia poświęcają nieco jakości na rzecz znacznie niższego kosztu na zadanie, a nawet one, według Anthropic, przewyższają najlepsze wyniki większości konkurentów. W praktyce oznacza to, że jeden model może obsługiwać zarówno wrażliwe na opóźnienia, wysokonakładowe zapytania (low/medium), jak i najtrudniejsze zadania wymagające rozumowania (high/max) — dostrajasz go na żądanie zamiast zmieniać modele.

Dogłębna analiza benchmarku: co te testy faktycznie mierzą

Pomaga wiedzieć, co oznacza każda liczba, zanim się jej zaufa. Indeks Artificial Analysis Intelligence Index jest złożeniem wielu niezależnych ocen (rozumowanie, matematyka, kodowanie, wiedza) przeprowadzonych przez osobę trzecią; wynik 61 plasujący Opus 5 na pierwszym miejscu spośród 170 modeli jest tutaj najbardziej wiarygodnym pojedynczym sygnałem, właśnie dlatego, że Anthropic go nie przeprowadził. Frontier-Bench v0.1 (43.3% dla Opus 5) to własny trudny zestaw Anthropica — względny sygnał, że Opus 5 rozwiązuje trudniejsze problemy niż Fable 5 (33.7%) lub Opus 4.8 (18.7%), a nie „43% poprawnych” w sensie szkolnym.

AutomationBench i OSWorld 2.0 mają większe znaczenie niż pojedynczy wynik wnioskowania, jeśli twój przypadek użycia dotyczy agentów. AutomationBench nagradza ukończenie zadania — różnica między agentem, który tworzy wersję roboczą e-maila, a agentem, który faktycznie składa raport wydatków — a OSWorld 2.0 nagradza sterowanie prawdziwym interfejsem użytkownika komputera. Twierdzenie Anthropica, że Opus 5 dorównuje szczytowemu wynikowi Fable 5 w OSWorld za jedną trzecią kosztów, jest — teraz, gdy Intelligence Index potwierdza jego ogólną pozycję — silnym argumentem za przeniesieniem zadań agentowych na Opus 5. Jedna luka: nie ma jeszcze oddzielnego, niezależnie audytowanego wyniku SWE-bench Verified dla Opus 5 (Fable 5 ma 95,0%, Opus 4,8 ma 88,6%), więc dla czystego cytowania dokładności kodowania poczekaj na tę liczbę.

Ile to kosztuje w praktyce

Ceny za token są abstrakcyjne; to cena za zadanie jest tym, co widzisz na fakturze. Weźmy reprezentatywny krok agenta składający się z 20 000 tokenów wejściowych i 3 000 tokenów wyjściowych. Opus 5 (i Opus 4.8): wejście 20k × $5/1M = $0.10, wyjście 3k × $25/1M = $0.075, czyli około $0.175 za wywołanie. Fable 5 w cenie $10 / $50: $0.20 wejście + $0.15 wyjście = około $0.35 — mniej więcej dwa razy więcej. Przy 100 000 takich wywołań miesięcznie daje to około $17 500 na Opus 5 w porównaniu z około $35 000 na Fable 5. Ponieważ Intelligence Index stawia teraz Opus 5 przed Fable 5, nie jest to "niemal jak Fable 5 za mniej" — to jakość z czołówki za mniej więcej połowę miesięcznego rachunku.

Pokrętło wysiłku ponownie zmienia matematykę. Wysokowydajny pipeline wsparcia może obsługiwać większość połączeń przy niskim lub średnim wysiłku — taniej niż powyższe liczby — i rezerwować maksymalny wysiłek na garść naprawdę trudnych zgłoszeń. Ujęcie Anthropic jest takie, że nawet tanie ustawienia pokonują najlepsze wyniki konkurencji, więc rzadko płacisz za możliwości, których nie używasz. Modeluj własną mieszankę poziomów wysiłku, zamiast zakładać, że każde połączenie działa na maksimum.

Jak uzyskać dostęp i korzystać z Claude Opus 5

Opus 5 jest natychmiast dostępny w pięciu miejscach: Claude.ai (gdzie jest domyślnym modelem w planie Max i najsilniejszą opcją w Pro), API Claude (identyfikator modelu w dokumentacji Anthropic), Claude Code (do kodowania w terminalu i IDE) oraz Claude Cowork (do współpracy, wieloetapowej pracy agenta). Użytkownicy API ustawiają poziom wysiłku jako parametr, więc kompromis między kosztem a możliwościami jest programowalny dla każdego żądania. Jeśli już korzystasz z Opus 4.8, przejście to zmiana identyfikatora modelu w tej samej cenie – najmniej problematyczna aktualizacja, jaką Anthropic wypuścił od dłuższego czasu.

Dla kogo to jest: trzy scenariusze

1. Potoki agentowe i korzystania z komputera

Jeśli Twój produkt uruchamia wieloetapowych agentów lub steruje przeglądarką lub komputerem, wyniki Opus 5 w AutomationBench i OSWorld 2.0 są skierowane bezpośrednio do Ciebie — teraz poparte niezależnym Indeksem Inteligencji #1. Większość kroków wykonuj przy średnim wysiłku, a dla trudnych przechodź na wysoki/maksymalny; testuj na własnych śladach agenta przed podjęciem decyzji.

2. Zespoły programistyczne monitorujące budżet.

Opus 5 jest w Claude Code od pierwszego dnia w cenie Opus 4.8. Dzięki prowadzeniu w Intelligence Index jest to silny domyślny programista; jedynym brakującym cytatem jest niezależna liczba SWE-bench Verified (Fable 5 wciąż ma to na poziomie 95.0%). Dla zespołów już korzystających z Claude, aktualizacja jest niskiego ryzyka i wolna od podwyżki ceny.

3. Przedsiębiorstwa standaryzujące na jednym modelu

Szeroka dostępność, kontekst klasy 1M, najbezpieczniejszy profil dopasowania Opus oraz pokrętło wysiłku, które obejmuje zarówno tanią masową pracę, jak i trudne rozumowanie, sprawiają, że Opus 5 jest sensownym jednym domyślnym wyborem dla mieszanych prac biurowych i inżynieryjnych — przy koszcie, który jest o wiele łatwiejszy do obronienia niż flagowy model na pograniczu technologii.

Bezpieczeństwo i zgodność

Anthropic pozycjonuje Opus 5 jako swoje najbezpieczniejsze wydanie Opus: „najbardziej dostosowany model Opus” i „najmniej podatny na oszukanie w celu niewłaściwego wykorzystania”. Praktyczna konsekwencja ma znaczenie dla rzeczywistych wdrożeń: Anthropic spodziewa się, że klasyfikatory cybernetyczne Opus 5 będą interweniować około 85% rzadziej niż w przypadku Fable 5. W prostych słowach powinno to oznaczać mniej fałszywych odmów w przypadku legalnych prac związanych z bezpieczeństwem, kodowaniem lub badaniami – częstej frustracji w przypadku silnie strzeżonych modeli granicznych – przy jednoczesnym blokowaniu rzeczywistego nadużycia. Jak zawsze, weryfikuj pod kątem własnych treści i wymogów zgodności, zamiast przyjmować postawę na wiarę.

Historia kontroli eksportu Fable 5 znajduje się teraz w systemowym prompcie.

Premiera Fable 5 nie była gładka, a ten kontekst ma znaczenie dla każdego, kto porównuje Claude Opus 5 z nią. Trzy dni po tym, jak Claude Fable 5 i Claude Mythos 5 zostały wydane 9 czerwca 2026 roku, Anthropic zawiesił oba modele, aby dostosować się do nakazu kontroli eksportu Departamentu Handlu USA; kontrole zostały zniesione 30 czerwca, a dostęp przywrócono 1 lipca. Ta sekwencja wydarzeń jest udokumentowaną historią — Simon Willison obserwował na żywo, jak API Anthropica zaczyna zwracać błędy, a Anthropic opublikował własne oświadczenie w sprawie zawieszenia i przywrócenia.

Nowością jest to, jak Opus 5 radzi sobie z pytaniami na ten temat. Granica danych treningowych modelu przypada na maj 2026 roku, więc zamknięcie i jego cofnięcie wykraczają poza to, czego się nauczył. Liczący około 200 000 znaków Claude Opus 5system prompt, który red-teamer Pliny the Liberator opublikował 25 lipca — dokument, co do którego Anthropic nie potwierdził zgodności z wersją produkcyjną — zawiera pełną oś czasu i instruuje model, aby odpowiadał wprost na pytania dotyczące zawieszenia, zamiast zaprzeczać, że do niego doszło, kierując użytkowników do oficjalnego oświadczenia Anthropic, gdy nie może potwierdzić aktualnego statusu. To konkretny przykład dostawcy, który wpisuje do promptu historię z okresu po granicy treningowej, aby model nie zmyślał na temat własnej rodziny.

Kiedy nie używać

Nie sięgaj po Opus 5, gdy konkretnie potrzebujesz niezależnie audytowanego numeru kodowania SWE-bench Verified do zacytowania dzisiaj – ta liczba nie została jeszcze opublikowana, a Fable 5 (95,0%) wciąż jest jej właścicielem. Nie zakładaj, że każde ustawienie wysiłku jest #1; prowadzący na liście liderów 61 to maksymalne ustawienie, a niższe ustawienia wymieniają część jakości na koszt, więc przeprowadź benchmarking dla poziomu wysiłku, który faktycznie będziesz uruchamiać. A dla czystego, wysokowolumenowego tekstu wrażliwego na opóźnienia, bez potrzeby rozumowania, tańszy model z warstwy efektywności (na przykład Gemini 3.6 Flash w cenie $1.50 / $7.50) będzie nadal tańszy za token — Opus 5 jest modelem do rozumowania i agentowym, a nie do masowego tekstu.

Często zadawane pytania

Ile kosztuje Claude Opus 5?

5 dolarów za 1M tokenów wejściowych i 25 dolarów za 1M tokenów wyjściowych — tak samo jak Opus 4.8, i połowa ceny Fable 5 wynoszącej 10 / 50 dolarów. [Anthropic]

Czy Opus 5 naprawdę jest modelem #1?

Na Artificial Analysis Intelligence Index, tak, w momencie pisania tego tekstu: Claude Opus 5 (maksymalny wysiłek) prowadzi z wynikiem 61 na 170 modeli, wyprzedzając Fable 5 (60). Jest to niezależny wynik, a nie deklaracja dostawcy. Inne rankingi i twoje własne obciążenie pracą mogą klasyfikować inaczej, a rankingi zmieniają się w miarę dodawania modeli.

Co to jest pokrętło wysiłku?

Ustawienie dla każdego żądania (niskie/średnie/wysokie/maksymalne), które wymienia tokeny — a tym samym koszt i opóźnienie — na możliwości. Max zajmuje pierwsze miejsce w rankingu; tańsze ustawienia wciąż pokonują większość konkurentów według Anthropic. Użytkownicy API ustawiają to jako parametr.

Czy Opus 5 jest lepsze od Fable 5?

W niezależnym indeksie Intelligence Index (61 vs 60) i Anthropic's Frontier-Bench v0.1 (43,3% vs 33,7%), tak – za połowę ceny. Fable 5 wciąż prowadzi w niezależnie mierzonym SWE-bench Verified (95,0%), więc w przypadku czystych cytowań dotyczących dokładności kodowania Fable 5 zachowuje tę konkretną koronę.

Jak Opus 5 wypada w porównaniu z Opus 4.8?

Ta sama cena $5/$25, znacznie wyższe benchmarki dostawców (Frontier-Bench v0.1 43,3% vs 18,7%) oraz zyski w każdym monitorowanym badaniu life-sciences, plus nowe pokrętło wysiłku i bezpieczniejsze dostosowanie. Dla obecnych użytkowników 4.8 jest to bezpłatna aktualizacja bez podwyżki ceny.

Jak bezpieczne jest to?

Anthropic nazywa go najbardziej zgodnym modelem Opus i najmniej podatnym na nadużycia, i spodziewa się, że jego cyberklasyfikatory będą interweniować około 85% rzadziej niż Fable 5 — zazwyczaj mniej fałszywych odmów w przypadku legalnej pracy.

Gdzie mogę używać Claude Opus 5?

Claude.ai (domyślnie na Max, najsilniejszy na Pro), API Claude, Claude Code i Claude Cowork — dostępne od 24 lipca 2026 roku.

Co to jest okno kontekstowe?

Klasa 1M tokenów z rodziny Opus (Opus 4.8 to 1M bez dopłaty za długi kontekst). Anthropic nie wyodrębnił osobno liczby Opus 5, więc traktuj to jako klasę 1M, dopóki nie zostanie potwierdzone.

Czy obsługuje obrazy lub wideo?

Opus 5 jest przede wszystkim modelem rozumowania tekstu i narzędzi. Do intensywnego zrozumienia multimodalnego (obraz/wideo), model taki jak Gemini 3.1 Pro jest specjalnie zaprojektowany do tego celu; używaj Opus 5 do tekstu, kodu i agentów.

Sedno sprawy

Claude Opus 5 okazał się czymś więcej niż tylko posunięciem cenowym. Jest wyceniony jak koń roboczy – 5/25 dolarów, połowa ceny Fable 5 i tyle samo co Opus 4.8 – ale teraz prowadzi w niezależnym indeksie Artificial Analysis Intelligence Index z wynikiem 61 (maksymalny wysiłek), wsparty mocnymi benchmarkami dostawców (Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0), naprawdę przydatnym pokrętłem wysiłku i najbezpieczniejszym profilem dostosowania spośród wszystkich modeli Opus. Jedynym zastrzeżeniem jest wciąż brak niezależnego wyniku SWE-bench Verified, gdzie Fable 5 (95.0%) utrzymuje cytat dotyczący dokładności kodowania. Dla obecnych użytkowników Claude aktualizacja wiąże się z niskim ryzykiem i nie podnosi rachunku; dla wszystkich innych Opus 5 jest teraz modelem do pobicia pod względem stosunku jakości do ceny – sprawdź go na swoim własnym obciążeniu i kieruj go razem z każdym konkurentem przez jeden kompatybilny z OpenAI endpoint w OrcaRouter.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube