Odyssey-3와 Seedance 2.5를 비교하는 기사의 타이틀 카드로, 부제는 “몇 초의 영상 vs 몇 시간의 시뮬레이션”이며, 세 개의 스탯 칩에는 “30초 단일 패스 생성”, “720p 기준 5초 클립당 ~$1.16”, “Odyssey-3: 판매 단위 없음”이라고 적혀 있다.
Guides & Insights

Odyssey-3 vs Seedance 2.5: 몇 초 분량의 영상 vs 몇 시간 분량의 시뮬레이션

작성자

Gideon Frost

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

얼마인지 물으면 Seedance 2.5의 가격은 초당 달러로 답이 나온다. 얼마인지 물으면 Odyssey-3의 가격은 전혀 나오지 않는다 — 요율표도, 엔드포인트도, 라이선스도 없다. 2026년 9월 15일에 발표된 그 모델은 아직 출시되지 않았고, 제작사는 "몇 주 안에" 공개하겠다고 공개적으로 약속했을 뿐이기 때문이다. 이 격차는 성숙도 차이처럼 보이지만, 사실상 대부분은 범주 차이다. 바이트댄스의 Seed 팀이 2026년 7월 31일에 공개한 Seedance 2.5는 완성된 영상의 초 단위로 판매되는 제작 엔진으로, 영상이 필요한 사람들에게 팔린다. Odyssey-3는 행동 인터페이스를 갖춘 월드 모델이며, 이것이 겨냥하는 구매자는 영상을 전혀 원하지 않는다 — 그 안에서 무언가가 행동할 때 올바르게 반응하는 환경을 원한다. 이 둘은 로봇 및 주행 데이터를 포함한 일부 동일한 문제들을 겨냥하고 있는데, 바로 그렇기 때문에 이 구분을 신중하게 그어둘 가치가 있다.

Seedance 2.5는 프로덕션 엔진이며, 출시 파트너들이 이를 보여줍니다

가장 눈에 띄는 역량은 지속 시간이다. Seedance 2.5는 한 번의 생성으로 30초를 만들어내는데, 이는 이전 버전의 15초의 두 배이며, 더 긴 시퀀스를 위한 다중 라운드 확장 기능과 그보다 더 나아가는 것으로 알려진 초장시간 베타 모드를 갖추고 있다. 그것만으로도 이 모델의 용도가 달라진다. 30초는 한 번의 숏이 아니라 하나의 장면이며, ByteDance의 마케팅이 바로 그런 이유로 "원테이크"라는 표현에 기대고 있다.

지속 시간을 중심으로 실제 편집에서 생성물을 사용할 수 있게 해주는 기능들이 자리 잡고 있습니다. 이 모델은 강력한 멀티모달 참조를 지원합니다 — 보고서에 따르면 생성당 최대 30개의 이미지, 10개의 비디오 클립, 10개의 오디오 클립을 사용할 수 있으며, 참조 비디오와 오디오는 각각 약 30초로 제한되고, 오디오 전용 참조는 이 버전에서 새롭게 추가되었습니다. 화이트 모델 또는 클레이 렌더, 그린 스크린 플레이트, 모션 및 크리에이티브 참조를 위한 새로운 참조 모드가 있습니다. 제어는 타임스탬프 수준으로 이루어져, 프롬프트가 특정 시간 범위 내에서 내러티브, 카메라 또는 모션을 대상으로 지정할 수 있고, 생성 후 영역 수준 편집은 재롤을 강제하는 대신 연속성을 유지합니다. 오디오와 비디오는 한 번에 함께 생성되므로 립 싱크가 인용된 대화를 따르며, 10개 이상의 언어가 기본적으로 지원됩니다.

채택 목록이 단서다. 출시 당일 XCMG, XPeng, Lingchu Intelligence, Weifen Zhifei, Qiongche Intelligence가 파트너십을 확인했으며, 제시된 사용 사례는 엠바디드 AI 학습 데이터와 자율주행 코너 케이스부터 산업용 SOP 교육 영상, 교육 및 이커머스 광고에 이르기까지 다양하다. 그중 일부는 창작 작업이다. 일부는 나중에 세상에 작용하게 될 시스템을 위한 데이터 생성이다 — 바로 이 부분이 Odyssey-3와 겹치는 부분이다.

Seedance 2.5의 1초 비용은 얼마인가요?

가격은 공개되어 있으며, 초가 아니라 토큰 단위로 과금되므로 약정하기 전에 환산 단계를 거칠 가치가 있습니다. ModelArk 엔드포인트에 대해 보고된 수치는 비디오 입력이 없을 때 백만 토큰당 $10.70, 비디오 입력이 포함될 때 백만 토큰당 $6.40입니다. 실제로는 480p에서 5초 16:9 클립의 경우 대략 $0.51, 720p에서 같은 클립의 경우 약 $1.16에 해당합니다. 이는 출시 당시 보고된 공급업체의 공개 요율입니다. 해상도와 길이 모두 비용을 확대하므로, 이를 산출물당 실측 비용이 아니라 현재의 정가로 취급하십시오.

가용성에는 실제 경계가 있습니다. 소비자 접근은 ByteDance 자체 앱을 통해 이루어지는 반면, API 접근은 중국에서는 Volcano Engine Ark, 해외에서는 BytePlus ModelArk로 나뉩니다. 적어도 한 유통업체는 이 모델이 미국에서는 사용할 수 없다고 밝히고 있으며, 출처들은 지원 해상도가 720p에서 끝나는지 아니면 1080p까지 확장되는지에 대해 서로 엇갈립니다 — 해상도를 전제로 설계하기 전에 벤더 자체 문서와 대조해 해결할 가치가 있는 불일치입니다.

이런 유형의 모델에서는 라우팅 계층이 특정한 이유로 제 역할을 합니다. 바로 요금이 변동하기 때문입니다. 출시 당시 한 번 바뀌었던 토큰당 영상 가격은 다시 바뀔 것이고, 오늘의 숫자를 기준으로 세운 비용 모델과 지난 분기의 숫자를 기준으로 세운 비용 모델의 차이는 마진과 예상치 못한 결과의 차이입니다. OrcaRouter는 공급자 정가를 0% 마크업으로 그대로 전달하므로, 벤더 인하가 다음 계약 갱신 때가 아니라 같은 날 우리 쪽에 반영되며, 자동 페일오버는 공급자 엔드포인트 하나가 성능 저하될 때 생성 큐가 계속 돌아가게 합니다 — 이는 영상 워크로드에서 이론적인 문제라기보다 스케줄링상의 고려사항입니다. Seedance 2.5 자체는 OrcaRouter를 통해 라우팅되지 않으며, ByteDance 자체 플랫폼과 ModelArk 엔드포인트를 통해 제공됩니다.

Two-column scoreboard for Odyssey-3 and Seedance 2.5 across six shared dimensions — unit of sale, what you get, inputs, editing control, availability and partners. Seedance 2.5 reads tokens at roughly $0.51 per 5s at 480p, finished footage up to 30s, shipping since 31 Jul 2026; Odyssey-3 reads not published, next world state plus actions, announced 15 Sep 2026, Flexion on humanoids.

Odyssey-3는 초 단위로 판매되지 않습니다

Odyssey-3는 아직 판매 단위가 없는데, 바로 그 점이 핵심이다. 그것은 로봇을 구동하고, 자동차를 운전하고, AI를 훈련하고, 드론을 조종하고, 비디오 게임을 할 수 있는 파운데이션 월드 모델로 묘사된다 — 대규모 시각 관찰 데이터로 훈련된 자기회귀 확산 트랜스포머로, 제작사는 이것이 물리학, 역학, 인과관계 및 인간 행동에 대한 학습된 이해를 제공한다고 말한다. 새로운 작업에 대한 적응은 관찰-행동 쌍으로 행동 디코더를 훈련하고 사전 훈련된 월드 모델을 동결시킴으로써 이루어지므로, 작은 정책이 동결된 표현을 읽고 모터 명령을 출력한다.

모두 공급업체가 보고했으며 독립적으로 재현된 것은 없는 이 시연들은 여섯 가지 구현체에 걸쳐 있습니다: 수십 시간의 시연으로부터 나온 로봇 팔(데이터에 없던 복구 행동 포함); 수십 시간의 원격 조작으로부터 Flexion으로 구축된 휴머노이드 정책으로, Odyssey는 수치를 공개하지 않은 채 자사가 테스트한 VLA 기준선보다 더 잘 일반화한다고 말합니다; 20시간의 시뮬레이션 데이터로부터 인도에서의 폐루프 주행; 시뮬레이션 데이터로부터의 실내 드론 비행; 추가 훈련 없이 Red Dead Redemption 2와 Sleeping Dogs로 전이된 Grand Theft Auto V 정책으로, 약 2시간의 GTA 영상으로 RDR2에서 말 타기 움직임을 생성; 그리고 PROWL 작업을 통해 다른 AI를 훈련하기 위한 환경 생성.

딱 하나 확실한 숫자는 77%다 — 시뮬레이션으로 훈련된 주행 정책은 안전요원이 개입하기까지 주행한 거리가 실제 영상으로 훈련된 정책의 약 그 비율에 그쳤다. 이는 기술 보고서도, 외부 검증도 뒷받침되지 않는 벤더 측 수치다.

Screenshot of Odyssey's “Introducing Odyssey-3: A General-Purpose Physical Intelligence” page, dated September 15th, 2026, showing the model subtitle “Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games” and the authors Oliver Cameron and Jeff Hawke.

판매 단위가 무엇이 최적화되는지를 결정한다

두 모델을 역량이 아니라 계량기로 보게 되면, 두 모델의 차이는 한쪽이 다른 쪽보다 앞서 있다는 식으로 더 이상 보이지 않는다.

출력 1초당 과금되는 모델은 시청자를 만족시키는 출력에 최적화되어 있다. 그것은 더 낮은 야망이 아니다. 나름의 어려운 문제를 지닌 다른 목표일 뿐이다. 대사가 동기화되고 타임스탬프 수준의 제어가 가능한 일관된 30초를 만들어내는 Seedance 2.5는 정말로 어려운 성과이며, 그것이 평가받는 실패 모드 — 캐릭터의 얼굴이 흐트러지는 것, 컷이 제대로 먹히지 않는 것, 대사 한 줄의 싱크가 어긋나는 것 — 는 편집실에 있는 사람이라면 알아차릴 법한 것들이다.

컨트롤러가 작동할 때 다음에 무슨 일이 일어날지 예측하도록 요청받은 모델은 시청자가 결코 확인하지 않을 무언가, 즉 아무도 시연하지 않은 결정까지 포함한 일련의 결정 아래에서 동역학이 견고하게 유지되는지를 위해 최적화된다. 그래서 Odyssey는 충실도를 보고하는 대신 수십 시간의 데이터에서 창발하는 복구 행동을 보고하며, 그것의 유일한 정량적 주장이 시각적 품질이 아니라 안전 운전자 개입으로 측정되는 이유다. 렌더러는 관객이 용서하는 방식으로 틀릴 수 있다. 시뮬레이터는 컨트롤러가 그에 따라 행동하는 방식으로 틀릴 수 있으며, 두 번째 종류의 오류는 롤아웃이 진행되는 동안 복리로 누적된다.

선언된 활용 사례 — 로봇 훈련 데이터, 자율주행 엣지 케이스 — 의 중복 지점이 바로 이 둘이 만나는 곳이며, 이는 벤치마크 순위가 아니라 예산을 두고 벌이는 진짜 경쟁이다. 로보틱스 팀이 실제로 직면하는 질문은 그럴듯한 세계의 렌더링된 초를 살 것인가, 아니면 행동 인터페이스를 갖춘 동역학 모델을 살 것인가이며, 그 답은 다운스트림 소비자가 사람 검토자인지 훈련 루프인지에 달려 있다.

나란히

판매 단위 — Seedance 2.5: 토큰 기준이며, 480p에서는 5초 클립당 약 $0.51, 720p에서는 $1.16으로 환산됩니다. Odyssey-3: 공개된 정보 없음.

단위당 얻는 것 — Seedance 2.5: 한 번의 처리로 최대 30초의 완성된 영상, 동기화된 오디오와 대사 포함. Odyssey-3: 연결된 하드웨어를 위한 예측된 다음 세계 상태와 모터 동작.

입력 — Seedance 2.5: 텍스트와 최대 약 30개의 이미지, 10개의 비디오, 10개의 오디오 클립. Odyssey-3: 동결된 백본 위에서 관찰-행동 쌍으로 학습된 액션 디코더.

편집 제어 — Seedance 2.5: 타임스탬프 수준 타기팅 및 영역 수준 생성 후 편집. Odyssey-3: 해당 없음; 편집 표면이 존재하지 않습니다.

공개된 파트너사 — Seedance 2.5: 출시 당시 XCMG, XPeng 외 3개사. Odyssey-3: 휴머노이드 정책 관련 Flexion; 상용 고객은 발표되지 않음.

이용 가능성 — Seedance 2.5: 2026년 7월 31일부터 출시됨, 지역별 제한이 적용됩니다. Odyssey-3: 2026년 9월 15일 발표, "몇 주 내" 공개 출시 예정, 날짜와 가격은 미정.

어떤 것이 당신의 스택에 어울리나요?

최종 결과물이 사람이 시청할 영상이라면, Seedance 2.5는 공개된 가격과 폭넓은 기능 세트를 갖춘 출시 제품이며, 결정은 일반적인 자체 구축 대 구매 판단입니다 — 다만 먼저 확인해 볼 만한 두 가지 유의점이 있습니다: 필요한 해상도가 실제로 접근 가능한 엔드포인트에서 제공되는지, 그리고 해당 지역이 아예 서비스 대상인지입니다. 더 긴 단일 패스 지속 시간과 타임스탬프 제어는 워크플로를 가장 크게 바꾸는 기능인데, 이는 프레임 하나를 개선하기보다 이어 붙이는 단계를 제거해 주기 때문입니다.

산출물이 훈련된 정책이나 컨트롤러라면, 영상이 아무리 좋아 보여도 Seedance 2.5는 대체재가 아니다. 그리고 Odyssey-3는 당신의 문제를 겨냥하고 있지만 구매할 것은 없다. 주목할 만한 주장은 동결된 백본이다. 작은 디코더를 통해 로봇 팔, 휴머노이드, 자동차, 드론, 그리고 세 가지 게임에 도달하는 하나의 사전 학습된 모델은 물리적 이해가 임바디먼트 간에 얼마나 전이되는지에 관한 진술이며, 이것이 입증된다면 로봇공학 팀이 수집해야 하는 것을 바꾼다. 이는 Odyssey 외부의 누구도 테스트하지 않았고, 기술 보고서도, 라이선스도, 가격도 없다.

주목할 점은 화려하지 않다. Seedance 2.5의 경우에는 안정화된 가격과 명확한 지역별 제공 여부 발표, Odyssey-3의 경우에는 저장소, 라이선스, 그리고 77%를 재현하는 제3자다. 두 번째 목록이 존재하기 전까지, 이 두 모델의 차이는 품질이 아니다. 그 차이는 둘 중 하나는 제품이고, 다른 하나는 주장이라는 점이다.

Infographic titled “What One Unit Buys” contrasting Seedance 2.5, billed per token, with a 5s clip costing about $0.51 at 480p and about $1.16 at 720p and up to 30s in a single pass, against Odyssey-3, which has no published price and reaches robot arms, humanoids, a car and a drone through a frozen backbone plus action decoder across six embodiments with no third-party runs.

OrcaRouter는 200개 이상의 모델을단일 API 키 뒤에 두고 있어, 선택한 비디오 모델만이 호출할 수 있는 유일한 모델은 아닙니다.