Plansza tytułowa z napisem „Claude Opus 5.5: Co tak naprawdę renderuje jedno kliknięcie”, z podtytułem „Film promocyjny nie został wygenerowany. Pipeline, który za nim stoi, można zainstalować.”, ze stopką „Ceny według Anthropic; dane indeksowe według Artificial Analysis.”
Engineering & Research

Claude Opus 5.5 napisał film promujący premierę produktu: co tak naprawdę renderuje „jedno kliknięcie”

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Post na X z 24 września 2026 r. mówi, że Claude Opus 5.5 wygenerował jednym kliknięciem film promocyjny dla produktu o nazwie CodePilot, a wynik miażdży GPT-6 Astra — model, który dostawca wypuścił 4 września. Post pochodzi od 归藏 (op7418), projektanta produktu, którego repozytoria umiejętności po cichu stały się własnym kanałem dystrybucji, a szczegół, który ma większe znaczenie niż sam film, to zdanie na końcu: przepływ pracy jest włączany do publicznego repozytorium o nazwie guizang-product-video-skill, które każdy może zainstalować w Claude Code lub Codex. Zatem użyteczne pytanie nie brzmi, czy promo wygląda dobrze — wygląd dema to twierdzenie z jednego źródła, którego nie da się zweryfikować ani obalić — lecz co tak naprawdę dostarcza to repozytorium, ile kosztuje jego uruchomienie i na co jego licencja pozwala w przypadku tworzonego przez nie wideo.

Krótka odpowiedź i to jest część, którą pomijają reposty. Claude Opus 5.5 nie generuje wideo. Pisze program, który je renderuje, a potem ffmpeg koduje klatki wygenerowane przez twoją maszynę. Cennym artefaktem w tym potoku nie jest MP4. Jest nim workflow prompt-and-verify opakowany wokół niego, czyli dokładnie to, co można teraz zainstalować.

Demo przestało być demem i to jest prawdziwa wiadomość.

Claude Opus 5.5 został udostępniony 22 września 2026 r. w cenie 4 USD za milion tokenów wejściowych i 20 USD za milion tokenów wyjściowych, z oknem kontekstowym 1 mln tokenów i do 128 tys. tokenów wyjściowych. Ma trzy dni i jest ogólnie dostępny, dlatego nie jest to publikacja oparta na przecieku: model jest prawdziwy, wyceniony i można go kierować, a nie ma premiery, o której można by spekulować. Nowością w sygnale jest opakowanie.

Repozytorium stojące za demem ma weryfikowalny kształt. Zostało upublicznione 18 września 2026 r., jego najnowszy commit pojawił się 22 września — tego samego dnia, w którym zadebiutował Claude Opus 5.5 — a w chwili pisania tego tekstu ma 261 gwiazdek i 23 forki na licencji AGPL-3.0 z osobną ścieżką licencjonowania komercyjnego. Te daty są tu sednem. Jednorazowy wpis z demem można skwitować wzruszeniem ramion; repozytorium, które przekłada tę technikę na sześć ponumerowanych kroków, osiem dokumentów referencyjnych i pięć skryptów, jest czymś, co czytelnik może zainstalować jeszcze dziś po południu. Dystrybucja liczy się bardziej niż sam artefakt, ponieważ artefakt i tak zawsze będzie wyglądał dobrze, a właśnie workflow można realnie zapożyczyć.

Sam autor przedstawia to w sposób, który uczciwie oddaje rodowód. README mówi, że skill to proces, który dopracowywał podczas tworzenia filmu CodePilot, spisany po to, aby można było wykorzystać go ponownie przy innych produktach. Film wprowadzający również nie jest dołączany do pakietu instalacyjnego — README zostawia komentarz zastępczy w miejscu, gdzie powinien znaleźć się link do przesłanego wideo, a pochodzące z niego fotosy znajdują się w zasobach readme repozytorium. To drobiazg, i to wymowny: dostarczanym elementem jest metoda, nie materiał filmowy.

Co umiejętność faktycznie tworzy, krok po kroku

Przepływ pracy obejmuje sześć etapów, a ich układ mówi, z jakim rodzajem narzędzia mamy do czynienia:

• Najpierw zakres — produkt, zakres wersji, odbiorcy, platforma, proporcje obrazu, język i styl są potwierdzane, zanim cokolwiek zostanie zbudowane, a wybrany zakres zostaje zapisany w pliku planu, aby dostarczony film nie twierdził milcząco, że obejmuje cały produkt.

• Prawdziwa treść na drugim miejscu — agent czyta repozytorium i informacje o wydaniu, sprawdza, które funkcje zostały faktycznie dostarczone, a nie tylko zapowiedziane, i podłącza jeden autentyczny komponent produktu, zanim rozpocznie się jakiekolwiek stylowanie.

• Scenorys i tekst reklamowy na trzecim miejscu — zmiany, o których warto opowiedzieć, zamienia się w listę ujęć, podpisy pisze się prostymi zdaniami, a kluczowe klatki renderuje się do przeglądu, zanim rozpocznie się animacja.

• Ruch po czwarte — przewijalna nadrzędna os czasu steruje stanem komponentów, wejściami, przejściami i ujęciami detali.

• Dźwięk na piątym miejscu — ścieżka dźwiękowa jest syntetyzowana w kodzie specjalnie dla tego filmu, efekty dźwiękowe są dopasowane do wydarzeń na ekranie, a muzyka jest przyciszana pod ważnymi sygnałami.

• Weryfikacja na końcu — kadrowanie, czcionki, obrazy, logotypy, synchronizacja dźwięku i plik końcowy są sprawdzane, a projekt rozróżnia to, co zostało zweryfikowane maszynowo, od tego, co wciąż wymaga ludzkiego oka i ucha.

To, co dostarcza repozytorium, jest niezwykle szczegółowe, a wersja szczegółowa jest bardziej przydatna niż streszczenie. Jego katalog references/ zawiera osiem dokumentów — onboarding, repozytorium i styl, potok komponentów, story i copy, pozyskiwanie dźwięku, dźwięk i QA, przewodnik startowy oraz studium przypadku — a jego katalog scripts/ zawiera pięć: sprawdzanie środowiska, inicjalizacja projektu, synteza efektów dźwiękowych, miksowanie dźwięku oraz kontrola dostarczenia uruchamiana na gotowym filmie. Projekt startowy to działający przykład, a tests/ zawiera zarówno testy regresyjne skryptów, jak i testy integracji komponentów. Lista zależności jest równie konkretna: Node 22 lub nowszy, Python 3.9 lub nowszy, FFmpeg i ffprobe, Playwright Chromium do potoku renderowania w przeglądarce, a także własne repozytorium produktu i jego zależności. Nic z tej listy nie jest usługą wideo, i to jest wybór projektowy, na którym opiera się całość.

Single-column scoreboard card titled "Claude Opus 5.5 - the scoreboard" listing Released: 22 September 2026; Price in / out: $4.00 / $20.00; Cached input: $0.20; Context: 1,000,000; AA Index, max effort: 58, rank 1 of 210; Output tokens per index task: 260M, rank 95 of 210; footer "Index figures per Artificial Analysis; price and context per Anthropic."

„Jedno kliknięcie” to określenie samego autora, a jego własne FAQ temu przeczy.

Sygnał mówi 一键生成 — wygenerowane jednym kliknięciem. FAQ repozytorium bezpośrednio odpowiada na najbliższe temu pytanie, a odpowiedź brzmi: nie. Na pytanie, czy podanie adresu repozytorium wystarczy, aby otrzymać gotowy film, odpowiedź w samym README brzmi, że czasem trzeba jeszcze pobrać repozytorium, uzupełnić zależności i potwierdzić stany demo, oraz że to proces, który pozwala AI dokończyć pracę krok po kroku, a nie konwerter działający jednym kliknięciem, który ignoruje środowisko Twojego projektu. Autor jest bardziej precyzyjny w opisie własnego narzędzia, niż jest wpis o jego narzędziu.

Drugi hamulec tkwi w samym przepływie pracy. Pierwszy etap wymaga decyzji, której agentowi wyraźnie zabrania się podejmować w imieniu użytkownika: jaki zakres wersji i jakie powierzchnie platform obejmuje film. Warto przytoczyć sedno rozumowania z README — historia repozytorium może ci powiedzieć, jakie wersje istnieją, ale nie które chcesz reklamować — a niedokończone powierzchnie platform trzeba zadeklarować przy dostarczeniu, aby widzowie nie zakładali, że film obejmuje cały produkt. To krok zarządzania, a nie krok renderowania, i jest to najwyraźniejszy dowód, że „jedno kliknięcie” opisuje własny komfort autora w pracy z narzędziem, a nie rzeczywistą powierzchnię wejściową narzędzia.

Istnieje też format, który potok zakłada, oraz format, którego nie zakłada. README wprost podaje jego domyślny punkt wyjścia: 45 do 60 sekund, orientacja pozioma, chiński. Czas trwania i proporcje obrazu można dostosować, ale wersja pionowa to nie przycięcie — kadrowanie i typografię trzeba rozplanować od nowa, ponieważ kompozycja nie przetrwa utraty boków. Pierwszy akapit tego tekstu cytuje język samego demo, więc warto powiedzieć wprost, że film, który go zainspirował, to chińskojęzyczny materiał promocyjny w orientacji poziomej; jeśli Twoja premiera jest po angielsku lub w orientacji pionowej, uwzględnij w budżecie ponowny układ, zamiast zakładać, że pierwszy przebieg umiejętności jest Twoim produktem końcowym.

To, gdzie twierdzenie o „jednym kliknięciu” się broni, jest węższe i wciąż prawdziwe: w przypadku demo, które już zbudował, film powstał z jednej instrukcji, ponieważ zakres, produkt i język wizualny były już ustalone. To uczciwa interpretacja. Prompt był jedną wiadomością; przygotowania już nie.

Ile kosztuje render i dlaczego „miażdży Astrę” to niewłaściwa oś

Porównanie w poście dotyczy GPT-6 Astra, wydanego 4 września 2026 r., w cenie 10 i 50 dolarów za milion tokenów przy danych wejściowych do 272 tys. tokenów, przy czym w przypadku żądań z długim kontekstem ceny zmieniają się na 20 i 75 dolarów, a tryb szybki kosztuje 20 i 100 dolarów. W jedynym niezależnym indeksie, na którym mierzone są oba modele, wyniki są zbliżone, a kolejność zależy od tego, jakie przyjmie się wagi.

• Intelligence Index — Claude Opus 5.5 uzyskuje wynik 58 przy maksymalnym wysiłku, zajmując pierwsze miejsce wśród 210 modeli na stronie Artificial Analysis odczytanej 2026-09-25, wobec 53 punktów GPT-6 Astra przy jego maksymalnym ustawieniu, który plasuje się na szóstym miejscu wśród 210.

• Koszt na zadanie Index — GPT-6 Astra to tańsza opcja za 3,26 USD, w porównaniu z 5,98 USD za Claude Opus 5.5. W tym wymiarze różnica przebiega w przeciwnym kierunku.

• Tokeny wyjściowe na zadanie Index — Claude Opus 5.5 zużywa 260M i plasuje się na 95. miejscu pod względem gadatliwości na 210; GPT-6 Astra zużywa 60M i zajmuje 36. miejsce. Przewaga w jakości jest częściowo okupiona tokenami.

Te liczby pochodzą z Artificial Analysis i dotyczą konfiguracji oznaczonej jako maksymalny wysiłek dla każdego modelu, a nie własnej oceny dostawcy. Czytane razem mówią coś bardziej użytecznego niż ranking: Claude Opus 5.5 jest mocniejszym modelem w opublikowanym indeksie, a GPT-6 Astra jest istotnie tańszy, jeśli chodzi o koszt uruchomienia zadania. Twierdzenie, że jeden „miażdży” drugi, jest twierdzeniem o wynikach demonstracji w jednym punkcie w czasie, a żaden indeks nie uzasadnia tego słowa w żadną stronę.

Istnieje trzecia linia kosztów, której nie wychwytuje żaden z indeksów, i to ona decyduje, czy potok promocyjny wart jest instalacji. Renderowanie klatek nie jest wywołaniem modelu. Renderowanie 3760 klatek przy 24 klatkach na sekundę działa na twoim sprzęcie przez Chromium w trybie headless, a jego koszt to czas zegarowy i energia elektryczna, a nie tokeny. Rachunek za API obejmuje planowanie, tekst, okablowanie komponentów i kod źródłowy renderera. Ten podział jest powodem, dla którego ta technika jest w ogóle przystępna cenowo, i dlaczego lista zależności Skill jest dłuższa niż jego prompt.

Artificial Analysis model page for Claude Opus 5.5 in its Adaptive Reasoning, Max Effort, Default Fallback configuration, showing Intelligence rank 1 of 210, Speed 93 of 210, Cost 93 of 210, Verbosity 95 of 210, In $4.00 / Out $20.00, cost per Intelligence Index task $5.98, 260M output tokens per Index task, and 210 models in this class.

Licencja to część, której nikt nie czyta, a jednocześnie najbardziej praktyczna sekcja

To tutaj repozytorium jest niezwykle staranne i tutaj czytelnik planujący wykorzystać je komercyjnie musi zwolnić. Obowiązują trzy odrębne reżimy i nie zlewają się one w jeden.

• Główną licencją jest AGPL-3.0. Przepływ pracy, dokumentacja, skrypty, projekt startowy i oryginalne zasoby audio są nią objęte. Kopiowanie lub rozpowszechnianie ich wymaga zachowania praw autorskich, licencji i informacji prawnych, a klauzula interakcji sieciowej AGPL-3.0 oznacza, że zmodyfikowana wersja udostępniana użytkownikom przez sieć musi zaoferować tym użytkownikom odpowiedni kod źródłowy.

• Domyślny styl wizualny nie jest objęty AGPL. Komponenty i style zaadaptowane z CodePilot i dostarczane jako styl zapasowy pozostają objęte Business Source License 1.1 wraz z jej Additional Use Grant i Change Date. README mówi wprost, że ten katalog nie został ponownie objęty licencją MIT oraz że projektu, który go łączy, nie można opisywać jako wyłącznie AGPL ani jako nieograniczonego do użytku komercyjnego.

• Wygenerowane wideo nie jest automatycznie objęte AGPL. README stwierdza, że materiał wyjściowy nie staje się utworem objętym AGPL tylko dlatego, że został wytworzony przez to narzędzie — ale wszelkie chronione komponenty, zasoby lub kod znajdujące się w tym materiale wyjściowym zachowują własne warunki. Ta różnica ma kluczowe znaczenie dla zespołu marketingu: licencja narzędzia i licencja filmu to dwie różne kwestie.

Muzyka to część o najczystszym pochodzeniu i najklarowniejszej licencji. Dołączona partytura jest syntezowana w Pythonie z przebiegów fal, szumu, obwiedni i sekwencjonowania nut, przy stałych 48 sekundach i 120 BPM, bez zewnętrznych sampli i bez wywołania modelu generatywnego; źródło znajduje się w repozytorium jako punkt odniesienia do adaptacji, a nie stała ścieżka dźwiękowa, a domyślnie dla nowego filmu jest partytura napisana w kodzie dla storyboardu tego filmu. Jedenaście efektów dźwiękowych jest generowanych przez skrypt w repozytorium przy 48 kHz, mono, 16-bit PCM, z czasami trwania poszczególnych plików i hashami SHA-256 opublikowanymi w manifeście audio. Oba zestawy są oryginalnymi dziełami autora repozytorium, dlatego objęte są licencją AGPL-3.0 wraz z przepływem pracy, dokumentacją, skryptami i projektem startowym.

Luka dotyczy tego, czego użyto w oryginalnym filmie, a repozytorium radzi sobie z tym we właściwy sposób. Studium przypadku otwarcie przyznaje, że dźwięki kliknięć, pyknięć, pisania i powiadomień w materiale promocyjnym CodePilot były nagraniami bibliotecznymi z serwisu z efektami dźwiękowymi, że nie zachowano informacji o autorstwie poszczególnych klipów ani stron ze szczegółami oraz że nie zamierza wymyślać dla nich źródeł. Dlatego te nagrania są wyłączone z pakietu instalacyjnego i zastąpione zestawem proceduralnym. Praktyczną konsekwencją jest to, że dźwięk, który otrzymujesz od razu po instalacji, jest celowo prosty, a dokumentacja dotycząca źródeł mówi, by najpierw przeszukać bibliotekę i sięgać po wbudowane pliki tylko w tych kategoriach, których nie da się wypełnić — z przypomnieniem, że wbudowana nota o pochodzeniu nie obejmuje tego, co pobierzesz, aby je zastąpić.

Prowadzimy to na własnych dwóch nogach

Oba modele w porównaniu są dostępne w OrcaRouter, więc jeśli pytanie brzmi, na który z nich skierować pipeline, test nie wymaga dwóch kont ani przepisywania kodu. Claude Opus 5.5 jest dostępny w OrcaRouter w opublikowanej cenie katalogowej Anthropic, przekazanej bez żadnej marży — te same 4 USD/20 USD i 0,20 USD za odczyt z cache, które podaje Anthropic — a GPT-6 Astra jest tam na tych samych warunkach, więc argument „rozdziera go” można rozstrzygnąć na nagraniach z własnego produktu, a nie na cudzym demie. Jeden klucz obsługuje jedno API dla ponad 200 modeli, a automatyczne przełączanie awaryjne oznacza, że nieudany eksperyment kosztuje cię ponowną próbę, a nie ścieżkę produkcyjną. Jeśli chcesz same modele, oba są w tym samym katalogu i na tym samym rozliczeniu.

OrcaRouter model page for anthropic/claude-opus-5.5 showing input text, image and file modality, vision, tools, JSON and reasoning support, public benchmarks by Anthropic dated 2026-09-22, pricing of $4.00 per 1M input tokens, $20.00 per 1M output tokens and $0.200 per 1M cache reads, and a performance panel with 7.39s p50 time to first token, 131 tokens per second and a 10.3% error rate.

Na co uważać i co teraz zdecydować

Dwie rzeczy pozostają nierozstrzygnięte i warto im się przyglądać, zamiast przyjmować je za pewnik. Pierwsza to, czy ten przepływ pracy uogólnia się poza React. README szczerze przyznaje, że trudność integracji komponentów różni się w zależności od frameworka, że React ma działające przykłady, a komponenty wymagające serwera, środowiska uruchomieniowego natywnego lub dużej ilości kontekstu mogą wymagać warstwy adaptacyjnej. Zespół pracujący z Vue lub Svelte powinien oczekiwać, że będzie musiał napisać tę warstwę, a nie odziedziczyć ją gotową.

Druga to obietnica przenośności na słabsze modele. W poście twierdzi się, że wzorce tej umiejętności pozwalają również słabszym modelom uzyskiwać przyzwoite wyniki, i to jest dokładnie ten rodzaj twierdzenia, który publiczne repozytorium może w końcu rozstrzygnąć: jeśli to metoda zapewnia jakość, wyniki na tańszym modelu powinny się utrzymać; jeśli to model ją zapewnia, nie utrzymają się. Nikt jeszcze nie opublikował tego porównania, w tym autor.

To, co możesz dziś zdecydować, jest węższe i bardziej użyteczne. Jeśli masz produkt z prawdziwymi komponentami i wydanie warte ogłoszenia, ta technika jest warta popołudnia, a uczciwe oczekiwanie, z którym warto do tego podejść, jest takie: model pisze renderer, twoja maszyna maluje klatki, ffmpeg tworzy plik, a licencja, którą dziedziczysz, zależy od tego, którego z trzech reżimów faktycznie dotyka twój film. Przyjdź z tym oczekiwaniem, a repozytorium dowiezie. Przyjdź z "jednym kliknięciem", a pierwszą godzinę spędzisz na decydowaniu, o czym jest film, co jest tą częścią, której narzędzie słusznie odmawia zdecydowania za ciebie.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie