
Claude Opus 5.5 maakt in één keer een muziekvideo: wat "Plan a Video" daadwerkelijk oplevert
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 496 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 183 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1285 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 119 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
Een bericht dat op 23 september 2026 op X is geplaatst, luidt: "Claude's Plan: een video door Opus 5.5 in één keer gemaakt," met een eerbetoon aan @jeffgwoah eraan toegevoegd. Dat is een democlaim, geen releaseclaim — en het belandt aan de verkeerde kant van wat gewoonlijk belangrijk is. Claude Opus 5.5 is geen onuitgebracht model dat uit een lek moet worden opgediept. Anthropic bracht het uit op 22 september 2026, voor $4 per miljoen inputtokens en $20 per miljoen outputtokens. Het is een dag oud, algemeen beschikbaar en staat al op de tariefkaart. De interessante vraag is dus niet of Opus 5.5 bestaat. Het is wat deze berichten over "in één keer een video gemaakt" daadwerkelijk laten zien, want de uitdrukking betekent iets nauwers dan hij klinkt, en het verschil bepaalt of je er iets van kunt gebruiken.
Hier is de korte versie, en het is het deel dat de meeste reposts weglaten: in de demo's die een grondige inspectie doorstaan, genereert Claude Opus 5.5 geen pixels. Het schrijft code die pixels schildert. De output is een programma, geen videobestand.
Wat de twee demo's in omloop eigenlijk deden
Achter dit soort beweringen staan twee publieke artefacten, en beide zijn controleerbaar omdat beide hun bron hebben gepubliceerd.
De eerste is een muziekvideo van 156,6 seconden voor een nummer genaamd "I'm Upping My P(doom)", een repo genaamd PDoomVideo die op 22 september 2026 op GitHub is gepubliceerd — dezelfde dag dat Opus 5.5 werd gelanceerd. In de README staat dat de video "twee generaties kostte, beide in Claude Code", waarbij de eerste wordt toegeschreven aan Claude Opus 5.5 (Medium) en de tweede aan Claude Opus 5.5 met standaardinspanning. Er staat ook dat "alles in deze repository door het model is gegenereerd" en dat "geen scène-ideeën werden gespecificeerd" — de enige aanwijzing die werd gegeven, was om een bepaald personageontwerp te gebruiken en elke songtekstregel interessante visuals en overgangen te geven.
De tweede is een demo-repo met drie games, gepubliceerd op 23 september 2026, die dichter bij een gecontroleerd experiment staat dan bij een showcase: drie speelbare 3D-browsergames, elk met één prompt van één enkele zin, gegenereerd in één sessie met wat de repo beschrijft als nul menselijke bewerkingen aan de code, en vervolgens uitgerold. De games zijn single-file HTML zonder externe assets — modellen, texturen, animatie en geluid worden allemaal procedureel door code gegenereerd. Een van de drie vereiste dat het model de officiële lay-out van een gamekaart opzocht en de geometrie ervan op basis van dat onderzoek opnieuw opbouwde voordat er iets werd geschreven.
Geen van beide repo's is een leverancierspublicatie. Beide zijn artefacten van derden, zelfgerapporteerd, en de bewering 'nul menselijke bewerkingen' in het bijzonder is een bewering over een git-geschiedenis, niet iets dat een buitenstaander heeft gecontroleerd. Beschouw de procesbeschrijving als het verslag van de auteur en de artefacten zelf als het bewijs.
Het storyboard is de echte output
Het detail dat bepaalt of "one-shotted" een eerlijke beschrijving is, is een bestand in de eerste repo genaamd STORYBOARD.md. Het is geen shotlijst van een mens. Het is een document dat het model voor zichzelf schreef na zijn eerste generatieronde, en het is echt specifiek: een regel dat "er iets op het scherm gebeurt" in elke shot, een instructie om tekst buiten beeld te houden, een cast van personages met namen en vaste ontwerpen, een palet dat van warm crème via ruimteviolet naar alarmrood beweegt en weer terug, een regel dat de gezichtsuitdrukkingen van personages geleidelijk morphen in plaats van abrupt verspringen, en een vereiste dat elke cut door actie gemotiveerd wordt — een hap naar zwart, een val, een zoom door een oog.
Dat document is het plan waar de signaaltekst naar verwijst. Het model produceerde een regiebrief en zette daarop vervolgens parallel subagenten in, één per hoofdstuk, die elk een JavaScript-bestand schreven dat zijn eigen segment van de tijdlijn schildert.
De rendering-pipeline is gewoon en verdient het om ronduit te worden gezegd, want dit is waar de framing 'AI heeft een video gemaakt' ineenstort: frames worden in een pagina geschilderd met p5.js en een aquarelborstelbibliotheek, een Node-script bestuurt die pagina in headless Chrome en maakt een screenshot van elk frame, en ffmpeg voegt de frames samen met de audiotrack. Bij 24 frames per seconde over 156,6 seconden komt dat neer op ongeveer 3.760 frames die één voor één worden gerenderd.
Dus de accurate zin is niet "Claude Opus 5.5 heeft een video gegenereerd." Het is "Claude Opus 5.5 schreef, en regisseerde vervolgens, een programma dat een video rendert." Het onderscheid is niet pedant — het is de hele reden waarom de techniek nuttig is voor iedereen die geen muziekvideo maakt.
Waarom de "twee generaties"-regel belangrijker is dan de "one-shot"-regel
Dezelfde README ondermijnt zijn eigen kop. De video vergde twee generaties, niet één. De eerste ronde leverde een resultaat op dat de auteur vervolgens verder doorontwikkelde; het storyboard en de animatiegids — de documenten die de tweede ronde samenhangend maken — werden na die eerste ronde geschreven, niet ervoor.
Dat is de eerlijke vorm van elke serieuze generatietaak met een lange horizon, en het is de moeite waard om te zeggen, omdat de one-shotframing een verwachting schept waaraan de artefacten niet voldoen. De prompt was één bericht. Het werk was niet één doorgang. Wat het model deed, was een grote build met meerdere bestanden die uren duurde, goed genoeg bij elkaar houden zodat de tweede doorgang een revisie was in plaats van een herstart — wat een echte en veel minder flitsende capaciteit is dan 'één prompt, één video'.
Er is een onafhankelijk cijfer dat dit beter beschrijft dan de demo's doen. Artificial Analysis mat Claude Opus 5.5 op zijn Intelligence Index op 58 bij maximale inspanning — de hoogste score die het heeft geregistreerd, met een voorsprong van meerdere punten op de volgende modellen — en meldde dat het model ongeveer 119.000 outputtokens per Index-taak verbruikt, tegenover ongeveer 73.000 voor Claude Opus 5 en ongeveer 78.000 voor Claude Fable 5.1. Het gebruikt ongeveer 1,6x zoveel outputtokens en komt uit op ongeveer dezelfde kosten per taak (~$5,98 tegenover ~$5,86), ondanks een 20% lagere prijs per token. Generatie over een lange horizon is hoe dat tokenprofiel er van buitenaf uitziet: het model besteedt het budget aan zichzelf.


Waar de artefacten niet meer bruikbaar zijn
De faalwijzen in dit soort werk zijn consistent, en beide repo's wijzen vanuit verschillende richtingen op dezelfde.
• De output is een programma, geen bestand. Als je een MP4 wilt die je aan iemand kunt geven, heb je nog steeds Node, een browser en ffmpeg nodig. Het model produceerde de renderer, niet de render. Dat is een buildafhankelijkheid waar je voor altijd aan vastzit.
• Het schaalt met frames, niet met prompts. 3.760 frames kostten een gescripte nachtelijke run op de eigen hardware van de auteur. Niets aan Opus 5.5 verandert de kosten om frame 2.000 te schilderen.
• Determinisme is een vereiste, geen luxe. Frames worden parallel en buiten volgorde gerenderd, dus elk frame moet een pure functie van zijn tijdstempel zijn — geen meegedragen toestand, geen willekeur zonder seed. Een model dat dat niet heeft geïnternaliseerd, produceert een video die flikkert. Beide repo's vangen dit op; niets in de prompt dwingt het af.
• One-shot betekent niet ongecontroleerd. Het duidelijkste bewijs is het gamewerk in de tweede repo: het model moest de lay-out van een bestaande map onderzoeken voordat het die bouwde, wat erop neerkomt dat het model besloot dat zijn eerste antwoord fout zou zijn geweest.
• Niemand heeft het falen een prijskaartje gegeven. Geen van beide repo's rapporteert hoeveel pogingen het kostte, hoeveel tokens er verbrand werden, of hoeveel van de tweede generatie bestond uit het repareren van de eerste. Dat is het getal dat een team daadwerkelijk nodig heeft voordat het zich vastlegt.
Wat dit voor jou verandert, en wat niet
Als je hoopte op een videogeneratiemodel, dan is Claude Opus 5.5 dat niet, en geen enkele hoeveelheid demobeelden maakt het er een. Het lanceringsmateriaal van Anthropic bevat geen mogelijkheid tot videogeneratie; de gepubliceerde evaluaties van het model zijn agentisch coderen, computergebruik en kenniswerk. Wat de demo's laten zien, is codegeneratie over een lange horizon op basis van een creatieve briefing — hetzelfde vermogen dat ook terugkomt in de migratie van 680.000 regels en de C-naar-Rust-overzetting die Anthropic in zijn eigen lanceringsbericht aanhaalt, alleen dan gericht op iets dat je kunt bekijken.
Als dat het vermogen is dat je wilt, houdt de praktische vraag op "welk model" te zijn en wordt het "hoe run ik zoiets zonder er een productiepad aan te verbinden". Generatie over een lange horizon is duur en de faalmodus is stil — je krijgt een plausibel programma dat vier minuten rendert en dan stukloopt. De redelijke manier om het te testen is het werk via een endpoint te routeren dat je al hebt, in plaats van via een nieuw contract: Opus 5.5 staat op OrcaRouter tegen de lijstprijs van Anthropic met 0% opslag, naast de andere modellen in de familie, zodat een nachtelijke generatierun op dezelfde sleutel en dezelfde failover-regels kan draaien als alles wat je aanroept. Als de run crasht bij frame 3.000, is dat een routeringsprobleem en niet een herarchitectuur.

Twee dingen zijn het waard om in de gaten te houden voordat je hieromheen gaat plannen. Anthropic heeft gezegd dat Sonnet 5.5 en Haiku 5.5 "in de komende weken" volgen, wat de rekensom voor een lange render zal veranderen — een goedkoper model dat een build met meerdere bestanden bij elkaar kan houden, zou de overnight-pass tot routine maken in plaats van iets opmerkelijks. En het storyboardpatroon zelf is overdraagbaar: niets in dat document is specifiek voor Opus 5.5, en niets weerhoudt een kleiner model ervan een slechtere te schrijven.
Voorlopig is de eerlijke lezing van "Claude's Plan a video by opus 5.5 one shotted" beperkter dan het klinkt en nuttiger dan het lijkt. Het model schreef een shotlijst, gaf zijn eigen subagenten een briefing en schreef daarna de renderer — en het feit dat zo'n plan contact met 3.760 frames heeft overleefd, is de bewering die het testen waard is, niet de video.
