Титульная карточка-баннер для Claude Opus 5.5 с надписью «Что на самом деле получается, когда видео делаешь с одного захода», с логотипом OrcaRouter в правом нижнем углу.
Engineering & Research

Claude Opus 5.5 снимает музыкальный клип с одного дубля: что на самом деле даёт «Plan a Video»

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Сигнал, опубликованный в X 23 сентября 2026 года, гласит: «Claude's Plan, видео от opus 5.5, сделанное с одного дубля», с прикреплённой данью уважения к @jeffgwoah. Это заявление о демо, а не о релизе — и оно оказывается не на той стороне того, что обычно имеет значение. Claude Opus 5.5 — не невыпущенная модель, которую нужно вынюхивать из утечки. Anthropic выпустила её 22 сентября 2026 года по цене $4 за миллион входных токенов и $20 за миллион выходных. Ей всего день, она общедоступна и уже включена в тарифную сетку. Так что интересный вопрос не в том, существует ли Opus 5.5. А в том, что на самом деле показывают эти посты про «видео с одного дубля», потому что эта фраза означает нечто более узкое, чем кажется, и от этой разницы зависит, сможете ли вы хоть что-то из этого использовать.

Вот краткая версия, и именно её большинство перепостов опускают: в демо, которые выдерживают проверку, Claude Opus 5.5 не генерирует пиксели. Он пишет код, который рисует пиксели. На выходе — программа, а не видеофайл.

Что на самом деле делали две демоверсии, имевшие хождение

За утверждениями такого рода стоят два публичных артефакта, и оба поддаются проверке, поскольку оба опубликовали свои исходники.

Первый — это 156,6-секундный музыкальный клип на песню под названием «I'm Upping My P(doom)», репозиторий под названием PDoomVideo, опубликованный на GitHub 22 сентября 2026 года — в тот же день, когда вышел Opus 5.5. В его README говорится, что видео «потребовало двух генераций, обе в Claude Code», причём первая приписывается Claude Opus 5.5 (Medium), а вторая — Claude Opus 5.5 при уровне усилий по умолчанию. Там также сказано, что «всё в этом репозитории было сгенерировано моделью» и что «никаких идей для сцен не задавалось» — единственным указанием было использовать определённый дизайн персонажа и придать каждой строчке текста песни интересные визуальные образы и переходы.

Второй — это демонстрационный репозиторий с тремя играми, опубликованный 23 сентября 2026 года, который ближе к контролируемому эксперименту, чем к витрине: три играбельные 3D-браузерные игры, по одному промпту из одного предложения на каждую, сгенерированные за одну сессию, причём, как описывает репозиторий, без единой правки кода человеком, а затем развёрнутые. Игры представляют собой HTML в одном файле без внешних ресурсов — модели, текстуры, анимация и звук генерируются процедурно кодом. Одна из трёх потребовала, чтобы модель отыскала официальную планировку игровой карты и воссоздала её геометрию на основе этого исследования, прежде чем написать хоть что-то.

Ни один из репозиториев не является публикацией поставщика. Оба — сторонние артефакты, заявленные самими авторами, и особенно утверждение о «нулевых ручных правках» относится к истории git, а не к тому, что проверяла внешняя сторона. Относитесь к описанию процесса как к авторскому изложению, а к самим артефактам — как к доказательствам.

Раскадровка — это реальный результат

Деталь, которая решает, справедливо ли описание «за один заход», — это файл в первом репозитории под названием STORYBOARD.md. Это не составленный человеком список кадров. Это документ, который модель написала для себя после первого прохода генерации, и он действительно конкретен: правило, что в каждом кадре «что-то происходит на экране», инструкция не помещать текст в кадры, поименованный состав персонажей с фиксированным дизайном, палитра, которая движется от тёплого кремового через космический фиолетовый к тревожному красному и обратно, правило, что мимика персонажей плавно перетекает, а не меняется скачком, и требование, чтобы каждый монтажный стык был мотивирован действием — чавк в черноту, падение, зум сквозь глаз.

Тот документ — это план, на который указывает текст сигнала. Модель создала режиссёрский бриф, затем параллельно запустила по нему субагентов — по одному на главу, — и каждый написал файл JavaScript, который отрисовывает собственный сегмент таймлайна.

Конвейер рендеринга обычен, и об этом стоит сказать прямо, потому что именно здесь рассыпается представление «ИИ сделал видео»: кадры отрисовываются на странице с помощью p5.js и библиотеки акварельных кистей, скрипт на Node управляет этой страницей в headless Chrome и делает скриншот каждого кадра, а ffmpeg объединяет кадры со звуковой дорожкой. При 24 кадрах в секунду на протяжении 156,6 секунды это примерно 3 760 кадров, отрендеренных по одному.

Итак, точная фраза — не «Claude Opus 5.5 сгенерировал видео». Она такая: «Claude Opus 5.5 написал, а затем срежиссировал программу, которая рендерит видео». Это различие не придирка — именно оно объясняет, почему этот приём полезен каждому, кто не снимает музыкальный клип.

Почему фраза «два поколения» важнее, чем фраза «один выстрел»

Тот же README подрывает собственный заголовок. Видео потребовало двух генераций, а не одной. Первый проход дал результат, который автор затем развил дальше; раскадровка и руководство по анимации — документы, которые делают второй проход связным, — были написаны после этого первого прохода, а не до него.

Такова честная форма любой серьёзной задачи генерации с длинным горизонтом, и об этом стоит сказать, потому что установка на один выстрел формирует ожидание, которому артефакты не соответствуют. Запрос был одним сообщением. Работа не была одним проходом. Модель сделала вот что: она удерживала крупную, многофайловую, многочасовую сборку вместе достаточно хорошо, чтобы второй проход стал доработкой, а не перезапуском, — а это реальная и куда менее эффектная способность, чем «один запрос — одно видео».

Есть независимый числовой показатель, который описывает это лучше, чем демонстрации. Artificial Analysis измерила Claude Opus 5.5 в своём Intelligence Index на уровне 58 при максимальном усилии — это самый высокий результат, который она когда-либо фиксировала, на несколько баллов опережающий следующие модели, — и сообщила, что модель потребляет примерно 119 000 выходных токенов на одну задачу Index по сравнению с примерно 73 000 у Claude Opus 5 и примерно 78 000 у Claude Fable 5.1. Она использует примерно в 1,6 раза больше выходных токенов и при этом обходится примерно в ту же стоимость за задачу (~$5,98 против ~$5,86), несмотря на на 20% более низкую цену за токен. Долгосрочная генерация — вот как этот профиль токенов выглядит снаружи: модель тратит бюджет на саму себя.

A single-column scoreboard for Claude Opus 5.5 with rows reading Shipped: September 22, 2026; Price: $4 / $20 per M tokens; AA Index: 58 at max effort; Output tokens per Index task: 119k; Cost per Index task: $5.98; Native video output: none, over a footer line reading 'AA figures per Artificial Analysis; price per Anthropic.'A four-card pipeline diagram titled 'Claude Opus 5.5 — what the run actually produces', with cards reading Plan: STORYBOARD.md, written by the model; Build: one JavaScript painter per chapter; Render: ~3,760 frames at 24 fps in headless Chrome; Join: ffmpeg adds the audio track, over a footer reading 'Pipeline as described in the PDoomVideo repo README; not independently reproduced.'

Где артефакты перестают быть пригодными для использования

Режимы отказа в этом классе задач устойчивы, и оба репозитория указывают на один и тот же с разных сторон.

• Результат — это программа, а не файл. Если вам нужен MP4, который можно кому-то передать, вам всё равно понадобятся Node, браузер и ffmpeg. Модель создала рендерер, а не сам рендер. Это зависимость сборки, которая останется с вами навсегда.

• Это масштабируется по кадрам, а не по промптам. 3 760 кадров потребовали скриптового ночного прогона на собственном оборудовании автора. Ничто в Opus 5.5 не меняет стоимость отрисовки 2 000-го кадра.

• Детерминизм — это обязательное требование, а не приятное дополнение. Кадры рендерятся параллельно и в произвольном порядке, поэтому каждый кадр должен быть чистой функцией от своей временной метки — без переносимого состояния, без неинициализированной случайности. Модель, которая этого не усвоила, создаёт видео, которое мерцает. Оба репозитория с этим справляются; ничто в промпте не заставляет это делать.

• Однократность не означает отсутствие проверки. Самое убедительное свидетельство — работа над игрой во втором репозитории: модели пришлось изучить планировку существующей карты, прежде чем строить её, а это значит, что модель решила, будто её первый ответ был бы неверным.

• Никто не подсчитал цену провала. Ни один из репозиториев не сообщает, сколько попыток потребовалось, сколько токенов было сожжено и какая доля второго поколения ушла на исправление первого. А ведь именно эта цифра нужна команде, прежде чем брать на себя обязательства.

Что это меняет для вас, а что — нет

Если вы надеялись получить модель генерации видео, то Claude Opus 5.5 — не такая модель, и никакое количество демонстрационных роликов не сделает её такой. В материалах запуска Anthropic нет возможностей генерации видео; опубликованные оценки модели относятся к агентному программированию, использованию компьютера и интеллектуальному труду. Демонстрации показывают длинногоризонтную генерацию кода по творческому брифу — ту же способность, которая проявляется в миграции на 680 000 строк и переносе с C на Rust, который Anthropic упоминает в собственном посте о запуске, только направленную на то, что можно посмотреть.

Если вам нужна именно такая возможность, практический вопрос перестаёт быть «какая модель» и становится «как запустить нечто подобное, не выделяя под это продакшен-путь». Генерация с длинным горизонтом дорога, а её отказ происходит незаметно — вы получаете правдоподобную программу, которая рендерится четыре минуты, а затем ломается. Разумный способ это протестировать — направить работу через уже имеющуюся у вас конечную точку, а не через новый контракт: Opus 5.5 доступен на OrcaRouter по прайс-листу Anthropic с наценкой 0%, вместе с другими моделями семейства, так что ночной запуск генерации может использовать тот же ключ и те же правила переключения при отказе, что и всё остальное, что вы вызываете. Если запуск падает на кадре 3 000, это проблема маршрутизации, а не повод переделывать архитектуру.

Artificial Analysis article page dated September 22, 2026 headlined 'Claude Opus 5.5 takes the top spot on the Artificial Analysis Intelligence Index, along with a 20% price cut and larger cache hit discount', showing the key-takeaways list: an Index score of 58 at max effort, pricing cut to $4/$20 per 1M tokens from $5/$25, cache reads down to $0.20, ~119k output tokens per Index task against ~73k for Opus 5, and four of five effort levels on the Intelligence vs Cost per Task frontier.

Прежде чем планировать с учётом этого, стоит следить за двумя вещами. Anthropic заявила, что Sonnet 5.5 и Haiku 5.5 появятся «в ближайшие недели», что изменит арифметику долгого рендера — более дешёвая модель, способная удержать вместе многофайловую сборку, сделала бы ночной прогон обычным делом, а не чем-то примечательным. И сам паттерн раскадровки переносим: ничто в этом документе не привязано именно к Opus 5.5, и ничто не мешает модели поменьше написать вариант похуже.

Пока что честное прочтение «Claude's Plan: видео от opus 5.5, созданное с первой попытки» — уже, чем звучит, и полезнее, чем кажется. Модель написала список кадров, проинструктировала собственных субагентов, а затем написала рендерер — и тот факт, что подобный план выдержал соприкосновение с 3 760 кадрами, — это утверждение, которое стоит проверять, а не само видео.