Główna karta tytułowa dla Claude Opus 5.5 o treści „Claude Opus 5.5 dema: pierwszy tydzień”, z podtytułem „Trzy zgłoszone rachunki: 3,21 USD, 13,30 USD, 25,66 USD”, wierszem stopki o treści „Ceny jednostkowe według Anthropic; koszty dema zgodnie z raportem ich twórców.” oraz logo OrcaRouter w prawym dolnym rogu.
Engineering & Research

Wersje demonstracyjne Claude Opus 5.5 kosztują od 3 do 26 USD: jak czytać pierwsze dni buildów

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Dwie liczby z pierwszego tygodnia Claude Opus 5.5 opisują ten sam model i różnią się o rząd wielkości. Jeden z twórców raportuje gotowe interaktywne laboratorium soczewek — stronę, na której przeciągasz pierścień ostrości i patrzysz, jak świecąca płaszczyzna ostrości przesuwa się przez dolinę — przy 25,66 USD wydanych na API i 1 godzinie 26 minutach czasu zegarowego. Szeroko udostępniane podsumowanie demonstracji premierowych wycenia zbudowaną proceduralnie animację zamku w Blenderze, wraz z fajerwerkami i odbiciem w jeziorze, na 13,30 USD i 35 minut. Wątek, który trafił na pierwszą stronę r/ClaudeAI, mówi o 3,21 USD. Producent wydał Claude Opus 5.5 22 września 2026 roku w cenie 4 USD za milion tokenów wejściowych i 20 USD za milion tokenów wyjściowych, i żadna z tych trzech liczb nie jest błędna. Mierzą one różne rzeczy, a jeśli planujesz na ich podstawie budżet, musisz wiedzieć, które.

Ta luka nie jest szumem. To różnica między tym, co przebieg agenta produkuje, a tym, co zużywa, i ostatnie cztery dni wytworzyły zaskakująco dużo tego drugiego, nie rozliczając z tego prawie nic. Oto więc arytmetyka, której nikt nie opublikował obok dem, a następnie ta część premiery, która faktycznie widnieje w cenniku i można ją sprawdzić.

Co faktycznie kupiło $25.66

Drogi koniec zakresu jest najbardziej użytecznym końcem, ponieważ budowniczy opublikował zarówno artefakt, jak i rachunek.

Laboratorium obiektywów Ryana Saela, zatytułowane „Płaszczyzna ostrości”, to jedna interaktywna strona zbudowana z jednego polecenia w jednej sesji. Umieszcza obiektyw aparatu na ekranie, pozwala przeciągnąć pierścień ostrości i pokazuje coś, o czym wie każdy fotograf, ale prawie nikt tego nie widział: cienką warstwę w świecie, w której zdjęcie faktycznie staje się ostre. Przekręć pierścień, a warstwa się porusza, elementy szklane przesuwają się do przodu lub do tyłu wewnątrz tubusu, aby pokazać, dlaczego, a konsola raportuje odległość, przysłonę i strefę ostrości — 60 cm, f/2, 1,9 cm głębokości, przy ustawieniach, z którymi strona się otwiera. Przymknij przysłonę z f/2 do f/16, a strefa ostrości rozszerza się, gdy stożek światła się zwęża. Widok rozłożony rozdziela szkło. W całym potoku nie ma żadnego modelu obrazu ani pobranych zasobów: każdy element jest rysowany i animowany w kodzie, dlatego cała demonstracja krążka rozmycia jest żywą symulacją, a nie diagramem.

To naprawdę dobry materiał objaśniający, a związana z nim teza jest wyjątkowo precyzyjna: jedno podejście, 1 godzina 26 minut, 25,66 USD zużycia API, a strona była dostępna pod lens.lab.sael.net, gdy ją czytałem. Ta liczba jest podana przez autora i niepoddająca się audytowi, ale to także jedyny koszt demonstracji w obiegu, któremu towarzyszy długość sesji, przez którą można go podzielić.

Przelicz to na podstawie cennika. Przy publikowanych stawkach Claude Opus 5.5 wynoszących 4 USD za milion tokenów wejściowych i 20 USD za milion tokenów wyjściowych 25,66 USD odpowiada od 1,28 miliona do 6,4 miliona tokenów w zależności od proporcji — górna granica, gdyby przebieg składał się wyłącznie z wejścia, dolna, gdyby składał się wyłącznie z wyjścia. Tego typu agentowe budowanie plasuje się gdzieś pośrodku, a powód, dla którego jest bliżej dolnej granicy, to pozycja kosztowa, którą większość osób pomija: odczyty z pamięci podręcznej w Claude Opus 5.5 kosztują 0,20 USD za milion, jedną czterdziestą stawki za wejście, więc długa sesja, która stale odczytuje tę samą, rosnącą bazę kodu, płaci za ten ruch niemal nic. Dziesięć milionów tokenów wejściowych z pamięci podręcznej kosztuje 2 USD. Po stronie wyjściowej kumuluje się to, co powstaje przez półtorej godziny, gdy model pisze kod, myśli i przepisuje go: przy 20 USD za milion milion tokenów wyjściowych to 20 USD, a tokeny myślenia są rozliczane jako wyjściowe. Liczba Saela jest spójna z przebiegiem, który wygenerował rzędu miliona tokenów wyjściowych wobec dużej, taniej, buforowanej strony wejściowej — co dokładnie odpowiada temu, jak wygląda 86-minutowe budowanie bez nadzoru.

Z tego wynikają dwie rzeczy. Po pierwsze, obniżka ceny katalogowej, która przyciągnęła uwagę w dniu premiery — z $5/$25 do $4/$20 — to zmiana o 20% na token i sama w sobie nie sprawiłaby, że to uruchomienie stało się tanie; to obniżka ceny odczytu z pamięci podręcznej z $0.50 do $0.20 jest tą pozycją, która sprawiła, że 90-minutowa pętla stała się przystępna cenowo. Po drugie, co mniej wygodne: nic w raporcie na $25.66 nie mówi, czy uruchomienie przebiegło dobrze. Dobrze wykonane jednorazowe uruchomienie i sesja, która przez półtorej godziny się miotała, a potem odniosła sukces, dają ten sam rachunek.

Kwota 13,30 USD nie wytrzymuje zderzenia z własną arytmetyką.

Środek zakresu jest pouczający z innego powodu. Opublikowane 23 września zestawienie premierowych demonstracji opisuje bezpośrednie porównanie, w którym Claude Opus 5.5 miał proceduralnie zbudować dziesięciosekundową animację w Blenderze na podstawie jednego polecenia — zamek, odbicie w jeziorze, fajerwerki — w starciu z GPT-6 Astra, bez ręcznej edycji, i podaje 35 minut i 199 600 tokenów wyjściowych za około 13,30 USD, wobec 28 minut i około 14,50 USD dla GPT-6 Astra. Najciekawsza jest liczba tokenów, ponieważ nie zgadza się z ceną.

199 600 tokenów wyjściowych przy 20 USD za milion w Claude Opus 5.5 to 3,99 USD, a nie 13,30 USD. Aby dojść do 13,30 USD wyłącznie na tokenach wyjściowych, potrzebowalibyście 665 000 tokenów. Brakująca kwota jest w pozostałych kolumnach: wejście po 4 USD za milion, zapisy do pamięci podręcznej po 5 USD za milion dla pięciominutowego progu i po 8 USD za milion dla godzinnego, oraz wszelkie ponowienia. To nie jest sprzeczność w raporcie — to raport, który uczciwie mówi o liczbie tokenów liczącej jedno i rachunku liczącym cztery, co jest absolutnie najczęstszym nieporozumieniem w dyskusjach o kosztach w tygodniu premiery. Jeśli bierzesz jedną liczbę z opublikowanego dema, weź kwotę w dolarach, a każdą liczbę tokenów obok niej traktuj jako częściowy opis przebiegu.

Na tanim końcu rachunkowość robi się jeszcze skąpsza. Wątek na r/ClaudeAI, który podaje $3.21 użycia API dla gotowego builda, jest typowy dla tego gatunku: tytuł, wideo i żadnego rozbicia kosztów. Prawdopodobnie to krótsza sesja, mniejszy artefakt albo dużo danych wejściowych z cache. Nie jest to coś, na czym można oprzeć planowanie budżetu, a ja nie mogłem zweryfikować z tego ani jednego dolara.

Dlaczego każda z tych liczb jest dolnym ograniczeniem

Tryb awarii tutaj nie polega na tym, że twórcy coś ukrywają. Polega na selekcji. Dema, które krążą, to te, które zadziałały, publikowane przez osoby, dla których się sprawdziły, a cztery próby, które dały zepsutą stronę, kosztowały tyle samo co ta jedna, która nie dała zepsutej strony. Zestawienie, które zebrało porównanie narzędzia Blender, mówi to wprost — że nikt nie publikuje porażek — a jego własny najbardziej szczegółowy wpis jest tego przykładem: strona marki zegarków, która nie spełniła założeń, na pierwszym podejściu użyła nieczytelnej czcionki i potrzebowała drugiego podejścia, by stać się wersją, którą pokazano.

„One shot” odgrywa też cichą rolę w tym słownictwie. Opisuje pojedynczą sesję, a nie pojedynczą próbę, a sesja może zawierać tyle samokorekty, ile model zdoła wygenerować — co przy 86-minutowym przebiegu oznacza jej całkiem dużo. Przepisanie przez model własnego kodu dwukrotnie w obrębie jednego okna kontekstowego to jeden „one shot” i dwie próby.

Tak więc uczciwa interpretacja pierwszych czterech dni to trzy poziomy dowodów i nie należy ich uśredniać:

• Samodzielnie zgłoszony koszt z długością sesji — przydatny do określenia rzędu wielkości, niezweryfikowalny. 25,66 USD Saela przez 1 godz. 26 min to najmocniejsza pozycja w tym poziomie.
• Samodzielnie zgłoszony koszt z liczbą tokenów — zazwyczaj wewnętrznie niespójny, jak pokazuje kwota 13,30 USD.
• Kwota w dolarach bez żadnego uzasadnienia — sygnał, że ktoś coś zbudował, i nic więcej.

Część premiery, która znajduje się na karcie stawek

Odrzuć obietnice z dem, a weryfikowalny obraz jest wąski i jasny. Wszystkie poniższe liczby to opublikowane stawki Anthropic, odczytane z dokumentacji modeli i ogłoszenia samej firmy z 25 września 2026 r.:

• Wejście — 4 USD za milion tokenów. Wyjście — 20 USD za milion, przy czym tokeny rozumowania są rozliczane jako wyjście, a adaptacyjne myślenie Claude Opus 5.5 jest zawsze włączone i nie można go wyłączyć.
• Odczyt z pamięci podręcznej — 0,20 USD za milion, mnożnik 0,05x. Zapis do pamięci podręcznej — 5 USD za milion przy progu pięciu minut, 8 USD za milion przy jednej godzinie. Batch API — 50% zniżki w obu kierunkach, 2 USD i 10 USD.
• Tryb szybki — 8 USD za wejście i 40 USD za wyjście za milion, do 2,5x większej szybkości, a Anthropic nadal określa go jako podgląd badawczy.
• Zakres — kontekst 1 mln tokenów, 128 tys. tokenów wyjściowych synchronicznie i 300 tys. w Batch API z nagłówkiem beta, wiarygodny punkt odcięcia wiedzy na czerwiec 2026 r., domyślny effort medium zamiast high, który był wartością domyślną w Claude Opus 5.
• Dostępność — Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry i Claude Platform on AWS, z wycofaniem zaplanowanym nie wcześniej niż 22 września 2027 r.

Twierdzenia dostawcy o wydajności, oznaczone jako twierdzenia: Claude Opus 5.5 osiąga poziom Claude Fable 5.1 w większości zadań, koszt jego działania jest o około 40% niższy niż w przypadku Claude Opus 5 i generuje wyniki ponad 30% szybciej. Te 40% to wybrana przez dostawcę średnia dla obciążenia, a nie pozycja z cennika, i nie należy ich przytaczać tak, jakby były tym samym rodzajem faktu.

Niezależna weryfikacja jest mniejsza niż tabela dostawcy i wskazuje ten sam kierunek z mniejszym marginesem. Artificial Analysis przyznaje Claude Opus 5.5 wynik 57,6 w swoim Intelligence Index, obok 61,4 w Humanity's Last Exam, 66,9 w SciCode i 84,7 w przywoływaniu długiego kontekstu w liczbach podanych na jego stronie modelu. W pomiarze agenta kodującego tej samej publikacji, który podaje koszt na zadanie, a nie koszt na token, liczba zmienia się w przeciwnym kierunku: przy maksymalnym wysiłku koszt na zadanie rośnie do około 13,04 USD, wobec 10,79 USD dla Claude Opus 5 w tym samym środowisku testowym. Tańszy token, którego model zużywa więcej, nie oznacza tańszego zadania. To ta sama lekcja, której uczą rachunki z dema, docierająca od strony trzeciej.

Co zrobić inaczej w drugim tygodniu

Jeśli liczba $25.66 jest tą, która sprawiła, że chcesz tego spróbować, użytecznym posunięciem nie jest przeznaczenie w budżecie $25.66 — lecz sprawienie, by własne uruchomienie dało liczbę, którą potrafisz wyjaśnić.

Ustaw effort jawnie, zamiast przyjmować wartość domyślną, ponieważ to on jest tym pokrętłem, które bardziej niż wybór modelu przesuwa liczbę tokenów na zadanie, a wartość domyślna w tym modelu zmieniła się względem Claude Opus 5. Świadomie zapisuj stabilny prefiks w cache: minimalny prompt kwalifikujący się do cache w Claude Opus 5.5 to 512 tokenów, wcześniej 1024, więc krótkie wspólne prefiksy, które nigdy wcześniej się nie cache'owały, teraz to robią. Zapewnij każdemu długotrwałemu zadaniu zapas w max_tokens, ponieważ myślenie jest częścią tego budżetu i nie można go już wyłączyć — własne wytyczne Anthropic dotyczące migracji sugerują zaczynanie od 64K dla pracy na najwyższych poziomach effort i dostrajanie od tego punktu. A instrumentację przebiegu wykonuj na końcu, nie na początku: odczytuj pole model najwyższego poziomu w każdej odpowiedzi, ponieważ w przypadku promptów oznaczonych przez klasyfikatory Anthropic przekierowuje żądanie w ramach tego samego wywołania, a ciąg modelu, który wysłałeś, nie opisuje tego, co odpowiedziało.

Ten ostatni punkt to miejsce, w którym router przestaje być tylko udogodnieniem. Kompilacja, która działa bez nadzoru przez półtorej godziny po przekroczeniu granicy zabezpieczeń, może wrócić, po cichu kończąc część tur na mniejszym modelu, a jedynym sposobem, by się o tym dowiedzieć, jest sprawdzenie. Claude Opus 5.5 jest w OrcaRouter w cenie katalogowej samego Anthropic z 0% marży — stawka dostawcy przekazywana jest bezpośrednio, więc zmiana ceny u dostawcy obowiązuje tu tego samego dnia, w którym zostaje opublikowana — co jest najmniej interesującą rzeczą, jaką robi tutaj routing. Interesujące jest to, że jedno API dla ponad 200 modeli umieszcza cały eksperyment na jednym kluczu, więc „uruchom to na modelu czołowym, a w razie problemów przełącz się na zapasowy, zamiast ponieść porażkę” to linia konfiguracji, a nie druga umowa i przepisanie kodu. Automatyczne przełączanie awaryjne sprawia, że nieznany model można bezpiecznie umieścić na ścieżce, na której ci zależy, a odmowa, którą można ominąć, to odmowa, która nie kończy twojego przebiegu w 70. minucie.

Liczba, która przesunie się jako następna

Anthropic poinformowało, że Claude Sonnet 5.5 i Claude Haiku 5.5 pojawią się „w nadchodzących tygodniach”, co zmieni ceny każdego z tych dem bez zmiany ich kształtu: tańsza stawka za token w zestawieniu z liczbą tokenów, której nikt nie potrafi przewidzieć z góry. Ta sama niepewność, która sprawiła, że liczby z pierwszego tygodnia były bezużyteczne, będzie dotyczyć liczb kolejnej generacji — dlatego warto wyrobić sobie ten nawyk już teraz, a nie dopiero wtedy, gdy kolejna obniżka cen wejdzie w życie.

Na razie uczciwe podsumowanie jest krótkie. Claude Opus 5.5 jest prawdziwy, ogólnie dostępny i wyceniony na 4 i 20 dolarów, z najtańszymi odczytami z pamięci podręcznej, jakie ta linia kiedykolwiek miała. Wersje demonstracyjne, które wytworzył w ciągu pierwszych czterech dni, są niezwykłe, a ich metki cenowe to anegdoty. Jeśli chcesz poznać koszt własnego obciążenia, jedynym narzędziem, które go odczyta, jest twoje własne uruchomienie z limitem, a faktura odczytana po fakcie.

A three-card graphic titled 'Claude Opus 5.5 — what the demos reported', with the first card reading 'Lens lab: One shot, 1h 26m / $25.66 reported', the second reading 'Blender castle: 35 min, 199,600 output tokens / $13.30 reported / output at list price: $3.99', the third reading 'Reddit build: $3.21 reported / no breakdown published', over a footer reading 'Demo costs are builder-reported and unauditable; unit prices per Anthropic.'A single-column rate card for Claude Opus 5.5 with rows reading Input: $4.00 / M tokens; Output: $20.00 / M; Cache read: $0.20 / M; Cache write, 5 min: $5.00 / M; Batch API: 50% off both ways; Default effort: medium, over a footer reading 'Prices per Anthropic, September 25, 2026. Vendor performance claims not shown.'OrcaRouter model page for anthropic/claude-opus-5.5 showing the pricing row of $4.00 input and $20.00 output per million tokens, a p50 time-to-first-token of 6.19 seconds, a 1M-token context with 128K max output, capability chips for vision, tools, JSON and reasoning, the public benchmarks by Anthropic dated 2026-09-22, and OpenAI-compatible and Anthropic SDK code samples pointing at api.orcarouter.ai.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie