Titelkarte mit der Aufschrift „Claude Opus 5.5: Was ein einziger Klick tatsächlich rendert“, untertitelt mit „Das Werbevideo wurde nicht generiert. Die dahinterliegende Pipeline kann installiert werden.“, mit einer Fußzeile mit der Aufschrift „Preise gemäß Anthropic; Indexzahlen gemäß Artificial Analysis.“
Engineering & Research

Claude Opus 5.5 schrieb ein Produktlaunch-Video: Was „ein Klick" tatsächlich rendert

Autor

Elias Hawthorne

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Ein Beitrag auf X vom 24. September 2026 besagt, Claude Opus 5.5 habe einen Werbefilm für ein Produkt namens CodePilot erstellt, mit einem Klick generiert, und das Ergebnis zermalme GPT-6 Astra – das Modell, das der Anbieter am 4. September ausgeliefert hat. Der Beitrag stammt von 归藏 (op7418), einem Produktdesigner, dessen Skill-Repositories sich still und leise zu einem eigenen Vertriebskanal entwickelt haben, und das Detail, das wichtiger ist als der Film, ist der Satz am Ende: Der Workflow wird in ein öffentliches Repository namens guizang-product-video-skill eingebunden, das jeder in Claude Code oder Codex installieren kann. Die nützliche Frage ist also nicht, ob der Werbefilm gut aussieht – das Aussehen einer Demo ist eine Behauptung aus einer einzigen Quelle und in beide Richtungen nicht falsifizierbar –, sondern was dieses Repository tatsächlich ausliefert, was der Betrieb kostet und was seine Lizenz einem mit dem Video erlaubt, das es erstellt.

Kurze Antwort, und das ist der Teil, den die Reposts auslassen. Claude Opus 5.5 gibt kein Video aus. Er schreibt ein Programm, das eines rendert, und dann kodiert ffmpeg die Frames, die deine Maschine erzeugt hat. Das wertvolle Artefakt in dieser Pipeline ist nicht das MP4. Es ist der Prompt-and-Verify-Workflow, der darum herum liegt, und genau das ist jetzt installierbar.

Die Demo ist keine Demo mehr, und das ist die eigentliche Nachricht.

Claude Opus 5.5 wurde am 22. September 2026 veröffentlicht – zu 4 US-Dollar pro Million Eingabe-Token und 20 US-Dollar pro Million Ausgabe-Token, mit einem Kontextfenster von 1 Mio. Token und bis zu 128K Ausgabe-Token. Es ist drei Tage alt und allgemein verfügbar, weshalb dies kein Leak-Artikel ist: Das Modell ist real, bepreist und routbar, und es gibt keine Veröffentlichung, über die spekuliert werden müsste. Das Neue an dem Signal ist das Packaging.

Das Repository hinter der Demo hat eine überprüfbare Struktur. Es wurde am 18. September 2026 öffentlich, sein jüngster Commit landete am 22. September – am selben Tag, an dem Claude Opus 5.5 startete – und zum Zeitpunkt dieses Textes verzeichnet es 261 Sterne und 23 Forks unter einer AGPL-3.0-Lizenz mit einem separaten kommerziellen Lizenzierungsweg. Diese Daten sind der springende Punkt. Ein einmaliger Demo-Beitrag ist ein Schulterzucken wert; ein Repository, das die Technik in sechs nummerierte Schritte, acht Referenzdokumente und fünf Skripte fasst, ist etwas, das ein Leser heute Nachmittag installieren kann. Die Verbreitung zählt mehr als das Artefakt, denn das Artefakt würde ohnehin immer gut aussehen, und der Workflow ist das, was man sich tatsächlich abschauen kann.

Das eigene Framing des Autors ist ehrlich, was die Abstammungslinie betrifft. Die README sagt, der Skill sei der Prozess, den er beim Dreh des CodePilot-Films verfeinert habe, niedergeschrieben, damit er bei anderen Produkten wiederverwendet werden kann. Der Einführungsfilm wird ebenfalls nicht mit dem Installationspaket ausgeliefert – die README lässt einen Platzhalterkommentar an der Stelle, an der der Link zum hochgeladenen Video stehen würde, während die daraus entnommenen Standbilder in den Readme-Assets des Repositorys liegen. Das ist eine Kleinigkeit, und eine bezeichnende: Das Ausgelieferte ist die Methode, nicht das Filmmaterial.

Was die Fähigkeit tatsächlich erzeugt, Schritt für Schritt

Der Workflow umfasst sechs Phasen, und ihre Form verrät, um welche Art von Tool es sich handelt:

• Zuerst der Umfang — Produkt, Versionsbereich, Zielgruppe, Plattform, Seitenverhältnis, Sprache und Stil werden bestätigt, bevor irgendetwas erstellt wird, und der gewählte Umfang wird in eine Plandatei geschrieben, damit der gelieferte Film nicht stillschweigend behauptet, das gesamte Produkt abzudecken.

• Echter Inhalt an zweiter Stelle — der Agent liest das Repository und die Release Notes, prüft, welche Funktionen tatsächlich ausgeliefert und nicht nur angekündigt sind, und bindet eine authentische Produktkomponente ein, bevor irgendein Styling erfolgt.

• Storyboard und Copy an dritter Stelle — die Änderungen, die es wert sind, erzählt zu werden, werden in eine Shotliste überführt, die Untertitel werden als einfache Sätze verfasst, und Keyframes werden zur Überprüfung gerendert, bevor die Animation beginnt.

• Motion als viertes — eine spulbare Master-Timeline steuert Komponentenzustand, Eintritte, Übergänge und Detailaufnahmen.

• Ton an fünfter Stelle — die Partitur wird im Code speziell für diesen Film synthetisiert, Soundeffekte sind auf die Handlungen auf dem Bildschirm abgestimmt, und die Musik wird unter wichtigen Cues abgesenkt.

• Verifizierung zuletzt – Bildkomposition, Schriftarten, Bilder, Logos, Audio-Synchronisation und die endgültige Datei werden geprüft, und das Projekt unterscheidet, was maschinell verifiziert wurde, von dem, was noch menschliche Augen und Ohren braucht.

Was das Repository mitliefert, ist ungewöhnlich explizit, und die explizite Version ist nützlicher als die Zusammenfassung. Sein Verzeichnis references/ enthält acht Dokumente – Onboarding, Repo und Style, Komponenten-Pipeline, Story und Copy, Audio-Beschaffung, Audio und QA, einen Einstiegsleitfaden und eine Fallstudie – und sein Verzeichnis scripts/ enthält fünf: Umgebungsprüfung, Projektinitialisierung, Klangsynthese, Audiomischung und eine Lieferprüfung, die über den fertigen Film läuft. Das Starterprojekt ist ein durchlaufendes Beispiel, und tests/ enthält sowohl Skript-Regressionstests als auch Komponenten-Integrationstests. Die Abhängigkeitsliste ist ebenso konkret: Node 22 oder neuer, Python 3.9 oder neuer, FFmpeg und ffprobe, ein Playwright-Chromium für die Browser-Render-Pipeline, dazu dein eigenes Produkt-Repository und dessen Abhängigkeiten. Nichts auf dieser Liste ist ein Videodienst, und genau das ist die Designentscheidung, auf der das Ganze beruht.

Single-column scoreboard card titled "Claude Opus 5.5 - the scoreboard" listing Released: 22 September 2026; Price in / out: $4.00 / $20.00; Cached input: $0.20; Context: 1,000,000; AA Index, max effort: 58, rank 1 of 210; Output tokens per index task: 260M, rank 95 of 210; footer "Index figures per Artificial Analysis; price and context per Anthropic."

„One click“ ist das eigene Wort des Autors, und seine eigene FAQ widerspricht dem.

Das Signal sagt 一键生成 – mit einem Klick generiert. Die FAQ des Repositorys beantwortet die nächstliegende Frage dazu direkt, und die Antwort ist nein. Auf die Frage, ob die Übergabe einer Repository-Adresse ausreicht, um einen fertigen Film zu erhalten, lautet die Antwort des README selbst, dass manchmal noch das Repository heruntergeladen, Daten ausgefüllt und Demo-Zustände bestätigt werden müssen, und dass dies ein Prozess ist, der eine KI die Arbeit Schritt für Schritt erledigen lässt, statt ein Ein-Klick-Konverter, der Ihre Projektumgebung ignoriert. Der Autor ist in Bezug auf sein eigenes Werkzeug präziser als der Beitrag über sein Werkzeug.

Es gibt eine zweite Bremse im Workflow selbst. Die erste Stufe verlangt eine Entscheidung, die dem Agenten ausdrücklich untersagt ist, im Namen des Nutzers zu treffen: welchen Versionsbereich und welche Plattform-Oberflächen der Film abdeckt. Die Begründung im README ist es wert, sinngemäß zitiert zu werden – die Repository-Historie kann sagen, welche Versionen existieren, aber nicht, welche man bewerben möchte – und unfertige Plattform-Oberflächen müssen bei der Auslieferung deklariert werden, damit Zuschauer nicht annehmen, der Film decke das ganze Produkt ab. Das ist ein Governance-Schritt, kein Rendering-Schritt, und er ist der deutlichste Beleg dafür, dass „ein Klick“ die eigene Vertrautheit des Autors mit dem Werkzeug beschreibt und nicht die tatsächliche Eingabeoberfläche des Werkzeugs.

Es gibt außerdem ein Format, das die Pipeline voraussetzt, und eines, das sie nicht voraussetzt. Das README nennt seinen Standardausgangspunkt unumwunden: 45 bis 60 Sekunden, Querformat, Chinesisch. Dauer und Seitenverhältnis sind anpassbar, aber eine vertikale Fassung ist kein bloßer Beschnitt – Bildkomposition und Typografie müssen neu angelegt werden, weil die Komposition den Verlust ihrer Seiten nicht übersteht. Der erste Absatz dieses Textes zitiert die eigene Sprache der Demo, daher lohnt es sich, klar zu sagen, dass der Film, der ihn ausgelöst hat, eine chinesischsprachige Querformat-Promo ist; wenn Ihr Launch auf Englisch oder im Hochformat erfolgt, planen Sie das Neulayout ein, statt anzunehmen, dass der erste Durchlauf des Skills Ihr Ergebnis ist.

Wo die Behauptung vom „Ein-Klick“ standhält, ist der Bereich enger und dennoch real: Für die Demo, die er bereits gebaut hatte, entstand der Film aus einer einzigen Anweisung, weil Umfang, Produkt und visuelle Sprache bereits feststanden. Das ist die ehrliche Lesart. Der Prompt war eine einzige Nachricht; das Setup war es nicht.

Was ein Rendering kostet und warum „crushes Astra" die falsche Achse ist

Der Vergleich im Beitrag bezieht sich auf GPT-6 Astra, veröffentlicht am 4. September 2026, mit einem Preis von 10 $ und 50 $ pro Million Tokens bis zu einer Eingabe von 272K Tokens, wobei Long-Context-Anfragen auf 20 $ und 75 $ umgepreist werden und ein Fast Mode bei 20 $ und 100 $ liegt. Auf dem einen unabhängigen Index, auf dem beide Modelle gemessen werden, liegen die beiden nahe beieinander, und die Reihenfolge hängt davon ab, was man gewichtet.

• Intelligence Index — Claude Opus 5.5 erzielt 58 bei maximalem Aufwand und belegt auf der am 25.09.2026 gelesenen Artificial-Analysis-Seite Platz eins von 210 Modellen, gegenüber GPT-6 Astra mit 53 bei dessen maximaler Einstellung, das Platz sechs von 210 belegt.

• Kosten pro Index-Aufgabe — GPT-6 Astra ist der günstigere mit 3,26 $, gegenüber 5,98 $ für Claude Opus 5.5. Auf dieser Achse verläuft die Lücke in die andere Richtung.

• Ausgabe-Tokens pro Index-Aufgabe — Claude Opus 5.5 verbraucht 260 Mio. und erreicht im Verbositäts-Ranking Platz 95 von 210; GPT-6 Astra verbraucht 60 Mio. und belegt Platz 36. Der Qualitätsvorsprung wird teilweise mit Tokens erkauft.

Diese Zahlen stammen von Artificial Analysis und beziehen sich auf die mit maximalem Aufwand gekennzeichnete Konfiguration für jedes Modell, nicht auf eine herstellereigene Bewertung. Zusammen gelesen sagen sie etwas Nützlicheres als ein Ranking: Claude Opus 5.5 ist das stärkere Modell im veröffentlichten Index, und GPT-6 Astra ist deutlich günstiger darin, eine Aufgabe darauf auszuführen. Die Behauptung, dass eines das andere „zerquetscht“, bezieht sich auf die Ausgabe einer Demo zu einem einzigen Zeitpunkt, und kein Index stützt dieses Wort in die eine oder andere Richtung.

Es gibt eine dritte Kostenposition, die keiner der beiden Indizes erfasst, und sie ist diejenige, die darüber entscheidet, ob es sich lohnt, eine Promo-Pipeline zu installieren. Frame-Rendering ist kein Modellaufruf. Ein Rendering von 3.760 Frames bei 24 Frames pro Sekunde läuft auf Ihrer Hardware über headless Chromium, und seine Kosten sind Wall-Clock-Zeit und Strom, nicht Tokens. Die API-Rechnung deckt die Planung, die Texte, die Komponentenverdrahtung und den Quellcode des Renderers ab. Diese Aufteilung ist der Grund, warum die Technik überhaupt bezahlbar ist, und warum die Abhängigkeitsliste des Skills länger ist als sein Prompt.

Artificial Analysis model page for Claude Opus 5.5 in its Adaptive Reasoning, Max Effort, Default Fallback configuration, showing Intelligence rank 1 of 210, Speed 93 of 210, Cost 93 of 210, Verbosity 95 of 210, In $4.00 / Out $20.00, cost per Intelligence Index task $5.98, 260M output tokens per Index task, and 210 models in this class.

Die Lizenz ist der Teil, den niemand liest, und sie ist der Abschnitt, der am ehesten umsetzbar ist.

Hier ist das Repository ungewöhnlich sorgfältig, und hier muss ein Leser, der es kommerziell nutzen möchte, langsamer werden. Es gelten drei getrennte Regelungen, und sie fallen nicht zu einer einzigen zusammen.

• Die Hauptlizenz ist AGPL-3.0. Der Workflow, die Dokumentation, die Skripte, das Starterprojekt und die ursprünglichen Audio-Assets fallen darunter. Das Kopieren oder Verbreiten dieser Bestandteile erfordert, dass Copyright, Lizenz und Hinweise beibehalten werden, und die Netzwerkinteraktionsklausel der AGPL-3.0 bedeutet, dass eine modifizierte Version, die Nutzern über ein Netzwerk angeboten wird, diesen Nutzern den entsprechenden Quellcode zur Verfügung stellen muss.

• Der standardmäßige visuelle Stil ist nicht AGPL. Die aus CodePilot übernommenen Komponenten und Stile, die als Fallback-Stil ausgeliefert werden, unterliegen weiterhin der Business Source License 1.1 mit ihrer Additional Use Grant und dem Change Date. Das README sagt klar, dass dieses Verzeichnis nicht auf MIT umlizenziert wurde und dass ein Projekt, das es kombiniert, nicht als ausschließlich AGPL oder als uneingeschränkt für die kommerzielle Nutzung beschrieben werden kann.

• Das generierte Video ist nicht automatisch AGPL. Die README stellt klar, dass die Ausgabe nicht allein dadurch zu einem AGPL-Werk wird, dass dieses Tool sie erzeugt hat – doch sämtliche geschützten Komponenten, Assets oder Code innerhalb dieser Ausgabe behalten ihre eigenen Bedingungen. Diese Unterscheidung ist das Entscheidende für ein Marketingteam: Die Lizenz des Tools und die Lizenz des Films sind zwei verschiedene Fragen.

Musik ist der Teil mit der saubersten Herkunft und der klarsten Lizenz. Die mitgelieferte Partitur wird in Python aus Wellenformen, Rauschen, Hüllkurven und Notensequenzierung synthetisiert, bei festen 48 Sekunden und 120 BPM, ohne externe Samples und ohne Aufruf eines generativen Modells; der Quellcode befindet sich im Repository als Anpassungsreferenz statt als feste Filmmusik, und der Standard für einen neuen Film ist eine im Code für das Storyboard dieses Films geschriebene Partitur. Die elf Klangeffekte werden von einem Skript im Repository mit 48 kHz, Mono, 16-Bit-PCM erzeugt, wobei Dateidauern und SHA-256-Hashes im Audio-Manifest veröffentlicht sind. Beide Sätze sind Originalwerke des Repository-Autors, weshalb sie zusammen mit dem Workflow, der Dokumentation, den Skripten und dem Starterprojekt unter AGPL-3.0 fallen.

Die Lücke betrifft das, was der Originalfilm verwendet hat, und das Repository geht damit richtig um. Die Fallstudie ist offen darüber, dass die Klick-, Pop-, Tipp- und Benachrichtigungstöne der CodePilot-Promo Aufnahmen aus einer Bibliothek von einer Soundeffekt-Website waren, dass die Urheberschaft pro Clip und die Detailseiten nicht beibehalten wurden und dass sie keine Quellen dafür erfinden wird. Daher werden diese Aufnahmen aus dem Installationspaket ausgeschlossen und durch das prozedurale Set ersetzt. Die praktische Konsequenz ist, dass das Audio, das Sie ab Werk erhalten, bewusst schlicht ist, und die Herkunftsreferenz weist Sie an, zuerst eine Bibliothek zu durchsuchen und nur für die Kategorien, die Sie nicht füllen können, auf die integrierten Dateien zurückzugreifen – mit dem Hinweis, dass der integrierte Herkunftshinweis nicht abdeckt, was auch immer Sie herunterladen, um sie zu ersetzen.

Es auf unseren eigenen zwei Beinen laufen zu lassen

Beide Modelle im Vergleich befinden sich auf OrcaRouter. Wenn also die Frage ist, auf welches man eine Pipeline ausrichten soll, erfordert der Test weder zwei Konten noch ein Umschreiben. Claude Opus 5.5 ist auf OrcaRouter zu Anthropics veröffentlichtem Listenpreis erhältlich, der ohne Aufschlag weitergegeben wird — dieselben $4/$20 und $0.20 für Cache-Reads, die Anthropic angibt — und GPT-6 Astra ist zu denselben Bedingungen dort, sodass sich das „zerlegt es“-Argument anhand des Materials Ihres eigenen Produkts klären lässt statt anhand der Demo von jemand anderem. Ein Schlüssel deckt eine API für über 200 Modelle ab, und automatisches Failover bedeutet, dass ein Experiment, das schlecht ausgeht, Sie einen erneuten Versuch kostet statt einen Produktionspfad. Wenn Sie die Modelle selbst wollen, sind beide im selben Katalog mit derselben Abrechnung.

OrcaRouter model page for anthropic/claude-opus-5.5 showing input text, image and file modality, vision, tools, JSON and reasoning support, public benchmarks by Anthropic dated 2026-09-22, pricing of $4.00 per 1M input tokens, $20.00 per 1M output tokens and $0.200 per 1M cache reads, and a performance panel with 7.39s p50 time to first token, 131 tokens per second and a 10.3% error rate.

Worauf zu achten ist und was jetzt zu entscheiden ist

Zwei Dinge sind ungeklärt und es lohnt sich, sie zu beobachten, statt sie einfach anzunehmen. Das erste ist, ob sich der Workflow über React hinaus verallgemeinern lässt. Die README ist offen damit, dass die Schwierigkeit der Komponentenintegration je nach Framework variiert, dass es für React funktionierende Beispiele gibt und dass Komponenten, die einen Server, eine native Laufzeitumgebung oder einen umfangreichen Kontext benötigen, möglicherweise eine Anpassungsschicht brauchen. Ein Vue- oder Svelte-Team sollte erwarten, diese Schicht selbst zu schreiben, statt sie zu erben.

Das zweite ist das Versprechen der Portabilität über schwächere Modelle hinweg. Der Beitrag behauptet, die Muster der Fähigkeit ließen auch geringere Modelle anständige Ergebnisse erzielen, und genau das ist die Art von Behauptung, die ein öffentliches Repository irgendwann klären kann: Wenn die Methode die Qualität trägt, sollten die Ergebnisse auf einem günstigeren Modell standhalten; wenn das Modell sie trägt, werden sie es nicht tun. Niemand hat diesen Vergleich bisher veröffentlicht, auch der Autor nicht.

Was Sie heute entscheiden können, ist enger umrissen und nützlicher. Wenn Sie ein Produkt mit echten Komponenten und ein Release haben, das es wert ist, angekündigt zu werden, ist die Technik einen Nachmittag wert, und die ehrliche Erwartung, die Sie mitbringen sollten, ist diese: Das Modell schreibt den Renderer, Ihre Maschine malt die Frames, ffmpeg erzeugt die Datei, und die Lizenz, die Sie erben, hängt davon ab, welches der drei Regime Ihr Film tatsächlich berührt. Bringen Sie diese Erwartung mit, und das Repository liefert. Bringen Sie „Ein Klick“ mit, und Sie werden die erste Stunde damit verbringen, zu entscheiden, worum es in dem Film geht – und das ist der Teil, bei dem das Tool zu Recht ablehnt, ihn für Sie zu entscheiden.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert