
Claude Opus 5.5, 뮤직비디오를 원샷으로 제작하다: "Plan a Video"가 실제로 만들어내는 것
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 496 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 183 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1285 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 119 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
2026년 9월 23일 X에 게시된 한 신호는 "Claude's Plan: opus 5.5가 한 방에 만든 영상"이라고 적혀 있으며, @jeffgwoah에게 바치는 헌사가 첨부되어 있다. 그것은 출시 주장이 아니라 데모 주장이다 — 그리고 보통 중요하게 여겨지는 것의 잘못된 쪽에 놓인다. Claude Opus 5.5Claude Opus 5.5는 유출에서 찾아내야 할 미출시 모델이 아니다. Anthropic은 2026년 9월 22일 백만 입력 토큰당 4달러, 백만 출력 토큰당 20달러에 이를 출시했다. 출시된 지 하루 된, 일반 제공 중인 모델이며, 이미 요금표에 올라 있다. 따라서 흥미로운 질문은 Opus 5.5가 존재하는지 여부가 아니다. 이 "영상을 한 방에 만들었다"는 게시물들이 실제로 무엇을 보여주는지다. 왜냐하면 그 표현은 들리는 것보다 더 좁은 의미이고, 그 차이가 그것을 활용할 수 있는지를 결정하기 때문이다.
짧게 말하자면, 그리고 대부분의 재게시물이 빼먹는 바로 그 부분인데: 검증을 견뎌내는 데모에서 Claude Opus 5.5는 픽셀을 생성하지 않는다. 픽셀을 그려내는 코드를 작성한다. 결과물은 동영상 파일이 아니라 프로그램이다.
유통 중인 두 데모가 실제로 한 일
이런 부류의 주장 뒤에는 두 가지 공개 산출물이 있으며, 둘 다 소스를 공개했기 때문에 검증할 수 있습니다.
첫 번째는 "I'm Upping My P(doom)"이라는 곡의 156.6초짜리 뮤직비디오로, 2026년 9월 22일 GitHub에 공개된 PDoomVideo라는 저장소입니다 — Opus 5.5가 출시된 바로 그날이었습니다. README에는 이 비디오가 "두 번의 생성 과정을 거쳤으며, 둘 다 Claude Code에서" 만들어졌다고 되어 있습니다. 첫 번째는 Claude Opus 5.5(Medium)에, 두 번째는 기본 노력 수준(default effort)의 Claude Opus 5.5에 의해 이루어졌다고 합니다. 또한 "이 저장소의 모든 것은 모델이 생성했다" 그리고 "어떤 장면 아이디어도 지정되지 않았다"고 밝히며 — 주어진 유일한 지시는 특정 캐릭터 디자인을 사용하고 각 가사에 흥미로운 시각적 요소와 전환을 넣으라는 것이었습니다.
두 번째는 2026년 9월 23일에 공개된 세 개의 게임 데모 저장소로, 쇼케이스라기보다 통제된 실험에 가깝습니다: 세 개의 플레이 가능한 3D 브라우저 게임, 각각 한 문장짜리 프롬프트 하나, 저장소가 설명하기로 코드에 대한 인간의 수정이 전혀 없이 단일 세션에서 생성된 뒤 배포되었습니다. 게임들은 외부 자산이 없는 단일 파일 HTML입니다 — 모델, 텍스처, 애니메이션, 사운드는 모두 코드로 절차적으로 생성됩니다. 세 게임 중 하나는 모델이 게임 맵의 공식 레이아웃을 찾아보고, 무엇이든 작성하기 전에 그 조사를 바탕으로 지오메트리를 다시 구축해야 했습니다.
어느 저장소도 벤더 발행물이 아닙니다. 둘 다 제3자 산출물이며 자체 보고된 것이고, 특히 '인간 편집 제로'라는 주장은 git 이력에 관한 주장일 뿐, 외부 당사자가 감사한 사항이 아닙니다. 과정 설명은 작성자의 진술로, 산출물 자체는 증거로 취급하세요.
스토리보드가 진짜 결과물이다
“한 방에 해냈다”라는 표현이 타당한지를 결정하는 세부 사항은 첫 번째 리포지토리에 있는 STORYBOARD.md라는 파일이다. 그것은 사람이 만든 숏 리스트가 아니다. 그것은 모델이 첫 번째 생성 패스를 마친 뒤 스스로를 위해 작성한 문서이며, 실제로 대단히 구체적이다: 모든 숏에서 “화면에서 무언가가 일어난다”는 규칙, 프레임에 텍스트가 들어가지 않게 하라는 지침, 고정된 디자인을 가진 이름 붙은 등장인물 캐스트, 따뜻한 크림색에서 스페이스 바이올렛을 거쳐 경보 빨강으로 갔다가 다시 돌아오는 팔레트, 캐릭터의 표정이 급격히 바뀌기보다 변형되어 이어진다는 규칙, 그리고 모든 컷이 액션에 의해 동기가 부여되어야 한다는 요건 — 검은 화면으로 이어지는 물어뜯기, 낙하, 눈을 통과하는 줌.
그 문서는 시그널 텍스트가 가리키는 계획이다. 모델은 연출 브리프를 생성한 뒤, 이를 기준으로 챕터마다 하나씩 하위 에이전트를 병렬로 실행해, 각 에이전트가 타임라인의 자기 구간을 그리는 JavaScript 파일을 작성하도록 했다.
렌더링 파이프라인은 평범하며 분명히 말할 가치가 있습니다. 왜냐하면 바로 이 지점에서 "AI가 영상을 만들었다"는 프레이밍이 무너지기 때문입니다. 프레임은 p5.js와 수채화 브러시 라이브러리를 사용해 페이지에 그려지고, Node 스크립트가 헤드리스 Chrome에서 그 페이지를 구동하며 모든 프레임을 스크린샷으로 찍고, ffmpeg가 프레임들을 오디오 트랙과 결합합니다. 156.6초 동안 초당 24프레임이라면, 대략 3,760개의 프레임을 하나씩 렌더링한 셈입니다.
그러므로 정확한 문장은 "Claude Opus 5.5가 영상을 생성했다"가 아니다. "Claude Opus 5.5가 영상을 렌더링하는 프로그램을 작성하고, 그런 다음 연출했다"이다. 이 구분은 현학적인 것이 아니다 — 뮤직비디오를 만들지 않는 사람에게도 이 기법이 유용한 바로 그 이유다.
"2세대"라는 표현이 "원샷"이라는 표현보다 더 중요한 이유
같은 README가 자신의 헤드라인을 스스로 약화시킨다. 그 영상은 한 번이 아니라 두 번의 생성을 거쳤다. 첫 번째 패스는 결과를 만들어냈고, 저자는 그 결과를 더 밀고 나갔다. 두 번째 패스를 일관되게 만드는 문서인 스토리보드와 애니메이션 가이드는 그 첫 번째 패스 이후에 작성되었지, 그 전에 작성된 것이 아니다.
그것이 모든 진지한 장기 호라이즌 생성 작업이 지닌 정직한 형태이며, 이 점은 말할 가치가 있습니다. 원샷 프레이밍은 결과물이 충족하지 못하는 기대를 심어 놓기 때문입니다. 프롬프트는 하나의 메시지였습니다. 작업은 한 번의 패스가 아니었습니다. 모델이 해낸 것은 크고, 여러 파일로 이루어지고, 여러 시간이 걸리는 빌드를 두 번째 패스가 재시작이 아니라 수정이 될 만큼 충분히 잘 유지하는 일이었습니다 — 이는 "하나의 프롬프트, 하나의 비디오"보다 현실적이고 훨씬 덜 화려한 능력입니다.
데모보다 이 점을 더 잘 설명해 주는 독립적인 수치가 있다. Artificial Analysis는 Claude Opus 5.5를 자사의 Intelligence Index에서 최대 노력(maximum effort) 설정으로 측정한 결과 58점을 기록했다고 밝혔는데, 이는 이 지수가 기록한 최고 점수이자 다음 모델들을 몇 점 차로 앞선 결과이며, 이 모델이 Index 작업당 약 119,000개의 출력 토큰을 소비한다고 보고했다. 이는 Claude Opus 5의 약 73,000개, Claude Fable 5.1의 약 78,000개와 대비된다. 이 모델은 출력 토큰을 약 1.6배 사용하면서도 토큰당 가격이 20% 더 낮은데도 작업당 비용은 거의 같은 수준(~$5.98 대 ~$5.86)에 이른다. 장기 지평(long-horizon) 생성은 그러한 토큰 프로필이 외부에서 보이는 모습이다. 모델이 예산을 자기 자신에게 쓰고 있는 것이다.


아티팩트가 더 이상 사용할 수 없게 되는 지점
이런 종류의 작업에서 나타나는 실패 유형은 일관되며, 두 리포지토리 모두 서로 다른 방향에서 동일한 지점을 가리킨다.
• 출력물은 파일이 아니라 프로그램입니다. 누군가에게 건넬 수 있는 MP4가 필요하다면, 여전히 Node와 브라우저, ffmpeg가 필요합니다. 모델이 만들어낸 것은 렌더가 아니라 렌더러입니다. 그것은 영원히 당신이 떠안아야 할 빌드 의존성입니다.
• 그것은 프롬프트가 아니라 프레임에 따라 늘어납니다. 3,760개 프레임은 저자의 자체 하드웨어에서 스크립트로 밤새 한 번 처리했습니다. Opus 5.5의 그 어떤 것도 2,000번째 프레임을 그리는 비용을 바꾸지 않습니다.
• 결정론은 있으면 좋은 것이 아니라 요구 사항이다. 프레임은 병렬로, 순서에 상관없이 렌더링되므로 모든 프레임은 해당 타임스탬프의 순수 함수여야 한다 — 이월되는 상태도, 시드 없는 무작위성도 없어야 한다. 이것을 내면화하지 못한 모델은 깜빡이는 비디오를 만들어낸다. 두 저장소 모두 이를 처리하지만, 프롬프트에서 이를 강제하는 것은 아무것도 없다.
• 원샷이라고 해서 검증되지 않았다는 뜻은 아니다. 가장 명확한 증거는 두 번째 저장소의 게임 작업이다. 모델은 기존 맵의 레이아웃을 먼저 조사한 뒤에야 그것을 만들 수 있었는데, 이는 모델이 자신의 첫 번째 답이 틀렸을 것이라고 스스로 판단한 셈이다.
• 아무도 실패의 비용을 계산하지 않았다. 두 저장소 중 어느 곳도 시도가 몇 번 필요했는지, 토큰을 얼마나 태웠는지, 2세대 결과물 중 얼마나 많은 부분이 1세대를 고치는 데 쓰였는지 보고하지 않는다. 그것이 팀이 실제로 커밋하기 전에 필요한 숫자다.
이것이 당신에게 무엇을 바꾸는지, 그리고 무엇을 바꾸지 않는지
비디오 생성 모델을 기대했다면, Claude Opus 5.5는 그런 모델이 아니며, 아무리 많은 데모 영상도 그것을 그렇게 만들어 주지 않는다. Anthropic의 출시 자료에는 비디오 생성 기능이 전혀 없으며, 이 모델의 공개 평가 항목은 에이전트형 코딩, 컴퓨터 사용, 지식 작업이다. 데모가 보여 주는 것은 창의적 브리프를 바탕으로 한 장기 지평 코드 생성이다. 이는 Anthropic이 자사 출시 글에서 언급한 680,000줄 마이그레이션과 C-to-Rust 포팅에서 나타나는 것과 같은 역량을, 다만 눈으로 볼 수 있는 대상에 겨냥했을 뿐이다.
그것이 원하는 능력이라면, 실질적인 질문은 "어떤 모델인가"가 아니라 "이런 것을 프로덕션 경로에 고정하지 않고 어떻게 실행할까"가 된다. 장기 생성은 비용이 많이 들고 그 실패 모드는 조용하다 — 그럴듯한 프로그램이 나와 4분 동안 렌더링되다가 깨진다. 그것을 테스트하는 합리적인 방법은 새 계약이 아니라 이미 보유한 엔드포인트를 통해 작업을 라우팅하는 것이다. Opus 5.5는 같은 제품군의 다른 모델들과 함께 OrcaRouter에서 Anthropic의 정가에 0% 마크업으로 제공되므로, 밤샘 생성 실행도 호출하는 다른 모든 것과 동일한 키와 동일한 페일오버 규칙을 그대로 쓸 수 있다. 실행이 프레임 3,000에서 죽는다면, 그것은 재설계가 아니라 라우팅 문제다.

이를 전제로 계획을 세우기 전에 주목할 만한 두 가지가 있습니다. Anthropic은 Sonnet 5.5와 Haiku 5.5가 "앞으로 몇 주 안에" 뒤따를 것이라고 말했는데, 이는 장시간 렌더링의 셈법을 바꿔 놓을 것입니다 — 여러 파일로 구성된 빌드를 하나로 유지할 수 있는 더 저렴한 모델이라면 야간 작업이 주목할 만한 일이 아니라 일상적인 일이 될 테니까요. 그리고 스토리보드 패턴 자체는 이식 가능합니다: 그 문서에서 Opus 5.5에만 국한된 내용은 없고, 더 작은 모델이 더 나쁜 스토리보드를 작성하는 것을 막을 것도 없습니다.
지금으로서는, “Claude의 계획: opus 5.5가 단번에 만든 영상”에 대한 솔직한 해석은 들리는 것보다 범위가 좁고 보기보다 유용하다. 그 모델은 샷 리스트를 작성하고, 자신의 하위 에이전트들에게 브리핑한 뒤, 렌더러를 작성했다 — 그리고 그런 계획이 3,760프레임과 맞닥뜨린 뒤에도 살아남았다는 사실이야말로 검증할 가치가 있는 주장이지, 영상 자체가 아니다.
