
Odyssey-3 vs Wan 3.0: 월드 모델이 비디오 팩토리를 만나다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 378 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
Odyssey-3와 Wan 3.0은 둘 다 "비디오 모델"로 분류되는데, 이 공유된 라벨은 감당할 수 있는 것보다 더 큰 무게를 지고 있다. Odyssey-3는 학습된 동역학 시스템, 즉 프롬프트로부터 환경을 구축하고 누군가 그 환경을 가로질러 이동하거나 이벤트를 트리거할 때 그 환경이 어떻게 변하는지 예측하는 시뮬레이터로, Odyssey가 2026년 10월 8일 연구 프리뷰로 공개했다. Wan 3.0은 Alibaba Cloud의 프로덕션 비디오 생성기로, 2026년 8월 24일 출시 이후 정식 제공되고 있으며, 초 단위로 과금되고, 이미 두 개의 독립적인 리더보드에서 평가를 받았다. 이 둘 중 하나는 카메라를 놓는 장소가 되고 싶어 한다. 다른 하나는 당신이 게시하는 영상을 렌더링하는 그 무엇이 되고 싶어 한다.
두 출시 페이지를 나란히 놓으면 차이가 즉시 드러난다. Odyssey는 물리적 정확성, 즉 자사 모델이 물체가 서로 만날 때 어떤 일이 일어나는지 얼마나 잘 이해하는지를 앞세운다. Alibaba는 처리량, 지속 시간, 레퍼런스 제어를 앞세운다: 30초 테이크, 네이티브 오디오, 생성당 최대 10개의 이미지와 5개의 비디오 제공. 어느 쪽도 다른 쪽의 열등한 버전이 아니다. 두 제품은 서로 다른 질문에 대한 답이며, 그 답은 팀이 이번 주에 무엇을 해야 하는지를 바꾼다.
숫자에 앞서 한 가지 짚고 넘어갈 점이 있습니다. 이 글의 대부분 수치는 각 벤더의 자체 출시 자료에서 나온 것이며, 해당 연구소 외부의 누구도 이를 재현하지 않았습니다. 수치가 보도자료 페이지가 아니라 독립적인 리더보드에서 나온 경우에는 본문에서 그 사실을 밝힙니다. 이 구분은 여기서 평소보다 더 중요합니다. 두 모델이 공개하는 검증 가능한 정보의 양이 극단적으로 다르기 때문입니다. 하나는 개방형 API에서 초 단위로 판매되고, 다른 하나는 가격을 전혀 공개하지 않았습니다.
각각이 실제로 무엇인지
Odyssey가 Odyssey-3를 직접 설명한 내용은 출시 게시물치고는 이례적으로 구체적이며, 대충 요약하기보다 그대로 인용할 가치가 있다. 그것은 “물체가 공간을 통해 어떻게 움직이고 상호작용하며 상황이 시간에 따라 어떻게 진화하는지 예측하는, 자기회귀 확산 트랜스포머로 구현된 학습된 동역학 시스템”이다. 그것이 반환하는 것은 일반적인 의미의 클립이 아니다. 그것은 구동되는 동안 계속 진화하는 상태다. 이 모델은 두 가지 크기로 제공된다 — 832×480의 Odyssey-3와 1280×720의 Odyssey-3 Pro — 그리고 Odyssey에 따르면 그 프리뷰는 독립적인 카메라 움직임과 함께 1인칭 및 3인칭 내비게이션을 지원한다. 이 빌드에는 분포 매칭과 적대적 증류의 조합을 통해 만들어진 몇 단계 증류 변형도 포함되어 있으며, 공급업체는 이를 실시간 상호작용형이라고 설명한다.
Wan 3.0은 기존 모델을 따르는 생성기입니다: 프롬프트와 하나 이상의 참조가 입력되면 완성된 영상 한 편이 나옵니다. Alibaba의 핵심 기능은 30초 단일 실행 생성, 네이티브 오디오, 그리고 텍스트, 이미지, 비디오, 오디오를 아우르는 참조 입력이며, 여기에 doc, xls, ppt, pdf, md, txt, key, pages, numbers 형식의 문서를 최대 100MB, 50페이지까지 지원합니다. 편집은 명령 기반이므로, 처음부터 다시 생성하지 않고도 생성물의 비주얼, 줄거리, 대사를 수정할 수 있습니다. Alibaba는 또한 오디오 품질과 화면 텍스트 정확도가 아직 개선되어야 한다고 분명히 밝히는데, 이는 출시 게시물에서 마땅히 더 자주 나와야 할 것보다 드문 인정이며, 공식 기록으로 남겨두기에 유용한 인정입니다.
• 출력물의 정체 — 당신이 그 안에서 행동하는 시뮬레이션 환경(Odyssey-3) vs. 당신이 게시하는 렌더링된 클립(Wan 3.0) • 광고된 크기 — 832×480, 또는 Odyssey-3 Pro에서 1280×720 vs. 480p, 720p, 1080p • 단일 실행 길이 — 환경이 계속 구동되는 동안 계속 vs. 생성당 30초 • 오디오 — 어느 크기에서도 핵심 기능은 아님 vs. 공급업체가 품질 제한을 명시한 네이티브 오디오 • 입력 — 환경을 정의하는 프롬프트 vs. 최대 100MB 및 50페이지의 텍스트, 이미지, 비디오, 오디오, 문서 • 편집 모델 — 상태를 바꾸고 다시 시뮬레이션 vs. 완성된 생성물에 대한 지시 기반 편집 • 문서화된 API — 공개된 것 없음 vs. 2026년 8월 24일부터 개방 및 종량제 • 공개 가격 — 없음 vs. 480p / 720p / 1080p에서 초당 0.3 / 0.6 / 1.2위안
출력 1초에 드는 비용, 그리고 단위가 맞지 않는 이유
Wan 3.0은 구매자가 접할 수 있는 가장 알아보기 쉬운 단위인 시간을 기준으로 가격이 책정됩니다. Alibaba의 요금은 480p에서 생성된 영상 1초당 0.3위안(약 $0.05), 720p에서 0.6위안(약 $0.10), 1080p에서 1.2위안(약 $0.20)입니다. 따라서 30초 전체를 생성하면 480p에서 약 9위안($1.50), 720p에서 18위안($3.00), 1080p에서 36위안($6.00)에 이릅니다. 이는 8월 출시 요금이며, 요금을 30% 인하한 출시 프로모션은 9월 23일까지만 진행되었으므로, 위 수치는 오늘 구매자가 실제로 접하는 금액입니다. Wan 3.0을 재판매하는 제공업체들은 일반적으로 분당 수치를 대신 제시하므로, 예산을 승인하기 전에 초당 계산과 대조해 확인할 가치가 있습니다.
Odyssey-3에는 비교 가능한 수치가 없습니다. Odyssey가 가격, 요율표, 라이선스 또는 API 문서를 공개하지 않았기 때문입니다. 대신 존재하는 것은 타사 벤치마크 내부의 비용 수치이며, 이는 벤더가 공개적으로 밝힌 가정, 즉 MI355X GPU-시간당 $1을 기반으로 계산된 것입니다. 그 기준으로 Physics-IQ Verified는 Odyssey-3 Pro를 생성 영상당 $0.267, Odyssey-3을 $0.139로 기재하며, 둘 다 24 FPS 및 1280 너비 출력으로 정규화됩니다. 같은 리더보드는 별도로 Odyssey의 API를 통한 프롬프트 재작성 비용이 제출된 영상당 $0.01로 추정된다고 명시합니다. 이 점을 주의 깊게 읽으십시오. 이는 가격이 아니라 모델링 기준입니다. 이는 벤더가 가정한 하드웨어 요율에서 시뮬레이션에 얼마가 들지를 알려줄 뿐, Odyssey가 청구할 금액을 알려주는 것은 아닙니다.
그 두 사실은 구매자에게 상반된 방향을 가리킨다. Wan 3.0은 최악의 경우 비용을 렌더링이 이루어지기 전에 산출할 수 있는 종량제 청구 항목이다. Odyssey-3은 영상당 모델링된 비용이 더 낮으면서도 그것을 붙일 인보이스가 없다 — 바로 그 단계에서 조달 논의가 멈춘다. 비교가 공정하려면 독자는 두 측면을 모두 함께 고려해야 한다: 실제 청구서가 딸린 실제 요율과, 아직 아무것도 뒷받침하지 않는 추정 요율을.

그들이 공유하는 단 하나의 점수판, 그리고 거기에서 빠져 있는 이름
Anates Labs와 DeepMind가 비디오 모델이 물리 원리를 얼마나 잘 다루는지를 동적으로 순위화한 Physics-IQ Verified는 이 조합이 공통으로 가진 유일한 독립 리더보드이며 — 그리고 바로 여기서 비교가 진정으로 흥미로워지는데, 이곳이 비교가 무너지는 곳이기도 하기 때문이다.
Odyssey의 출시 게시물은 Odyssey-3 Pro가 “Physics-IQ Verified의 벤치마크에서 새로운 최첨단 기록을 세우고 WorldMark의 4개 카테고리 중 3개에서 1위를 차지했다”고 밝힙니다. 그중 WorldMark 부분은 Odyssey가 공개한 수치에서 확인됩니다: First-Person Stylized(77.2), Third-Person Real(79.0), Third-Person Stylized(76.3)에서 1위, First-Person Real은 80.6으로 AlayaWorld의 83.0과 Lyra 2.0의 84.4에 이어 2위입니다. 이 모든 수치는 Odyssey 자체 평가 실행에서 나온 공급업체 보고 수치입니다.
최신 최고 성능(state-of-the-art)을 다루는 부분은 독자가 속도를 늦춰야 할 대목이다. 현재 제공되는 Physics-IQ Verified 리더보드 버전에서 트랙 평균 대비 퍼센트 포인트 기준 순 개선폭으로 순위를 매기면, Black Forest Labs의 FLUX 3 [large]가 +12.27 pp로 01위에 올라 있다. Odyssey-3 Pro는 +11.15 pp로 02위, Odyssey-3는 +9.99 pp로 03위다. 따라서 해당 벤더가 말하는 "새로운 최고 성능"은, 벤더 자신이 인용하는 그 리더보드에서 2위인 셈인데, 이는 그 주장이 리더보드 업데이트보다 앞서기 때문이거나, 문장이 시사하는 것보다 더 좁은 범위로 한정되기 때문이다. 어느 쪽이든 정직하게 읽자면 Odyssey-3 Pro는 상위 3위권 물리 모델이지, 압도적인 선두는 아니다. 또한 FLUX 3 [large]는 영상당 비용이 $0.868로 Odyssey-3 Pro의 $0.267보다 훨씬 높은데, 이는 바로 리더보드의 비용 뷰가 드러내기 위해 존재하는 트레이드오프다.
Odyssey는 세부 지표 분석에서 딱 한 항목만큼은 확실히 1위를 차지한다. 바로 Spatiotemporal으로, 44.70을 기록해 42.97의 Odyssey-3 Pro와 41.57의 Physis-Lang(Cosmos3 Super)을 앞선다. Spatial에서는 4위(59.17)로 FLUX 3(64.36), Odyssey-3 Pro(61.78), Physis-Lang(59.87)에 뒤지고, Weighted Spatial과 MSE에서는 각각 4위와 3위다. 이러한 패턴, 즉 시간에 걸쳐 움직임이 얼마나 잘 유지되는가에서는 확실한 선두이고 단일 프레임 공간 충실도에서는 2군이라는 점은, 아름다운 정지 이미지를 렌더링하기보다는 변화를 시뮬레이션하도록 만들어진 모델의 일관된 특징이다.
이제 빠진 이름. Wan 3.0은 Physics-IQ Verified에 전혀 나타나지 않는다. 유일한 Wan 항목은 17위의 Wan 2.2 14B, −6.64 pp, 그리고 22위의 Wan 2.2 5B, −11.13 pp뿐이다 — 둘 다 트랙 평균 아래이고, 둘 다 오픈소스이며, 둘 다 한 세대 뒤처져 있다. 이 리더보드의 자체 범위 설명에 따르면, 리더보드는 "공개 접근이 불가능하거나 출시일이 확인되지 않았더라도, 벤치마크된 모델과 프리프린트나 발표를 통해 알려진 모델을 포함한다"라고 하므로, Wan 3.0의 부재는 그것이 낮은 점수를 받는다는 증거가 아니다. 그것은 아무도 이 축에서 그것을 측정하지 않았다는 증거다. 실질적 결과는 노골적이다: Odyssey-3가 물리적 개연성에서 Wan 3.0을 이긴다는 어떤 주장도 양방향으로 검증되지 않았고, 그렇지 않다는 어떤 주장도 마찬가지로 검증되지 않았다. Wan 3.0의 독립적인 기록은 다른 곳에 있다 — OpenArt Arena에서 전체 #2를, Artificial Analysis에서 Video Editing with Audio 부문 #1을 차지했다 — 인지된 품질과 편집 품질을 측정하는 보드에서이지, 물리학이 아니다.
오늘 전화할 수 있는 것, 그리고 오직 물어볼 수만 있는 것
Wan 3.0은 2026년 8월 24일부터 호출할 수 있게 되었습니다. 그날 Alibaba Cloud의 출시로 사용량 기반 과금과 신청 승인이 필요한 베타가 완전히 개방된 API로 바뀌었습니다. 이 모델은 공급업체 자체 API와 여러 타사 플랫폼을 통해 이용할 수 있으며, 모두 사용량 기반 과금이고 위에 제시된 초당 요금이 적용됩니다. 팀에서 오늘 오후에 생성된 영상이 필요하다면, 그것은 실제 선택지이며 청구서가 따릅니다.
Odyssey-3는 그것을 제공하지 않습니다. Odyssey의 페이지는 연구 프리뷰가 "지금 이용 가능"하다고 말하며 피지컬 AI 개발자들에게 연락하라고 초대합니다. 이는 데모와 대화를 설명하는 것이지, 키 뒤에 있는 엔드포인트를 설명하는 것이 아닙니다. 공개된 가격도, 라이선스도, API 문서도 없으며, 위 섹션에서 보여주듯 독립적인 평가도 없습니다. 출시 게시물을 읽는 개발자는 오늘날 Odyssey-3 기반 프로덕션 빌드에 비용이 얼마나 들지 계산할 수 없고, 물리 관련 주장이 벤더 자체의 하네스 밖에서도 성립하는지 확인할 수 없습니다. 이는 출시 당일의 월드 모델에서는 정상적인 일이며, 이 비교에서 가장 중요한 단 하나의 사실이기도 합니다.
두 모델 모두 우리 카탈로그에 없으므로 — OrcaRouter 모델 목록에는 Odyssey-3도 Wan 3.0도 없습니다 — 유용한 라우팅 지점은 그들 위에 있는 계층입니다. 영상 빌드는 대개 하나의 모델을 호출하지 않습니다. 프롬프트 재작성 모델, 영상 모델, 때로는 오디오 모델을 호출하고, 공급업체가 가격이나 요청 한도를 바꿀 때마다 이들 모두를 다시 호출합니다. OrcaRouter에서는 이런 요소들이 200개 이상의 모델을 공급업체 정가에 0% 마크업으로 아우르는 하나의 API 뒤에 있으므로, 영상 공급업체의 초당 가격 인하가 구성 변경을 기다리지 않고 같은 날 여기에 반영되며, 자동 페일오버 덕분에 한 모델의 장애가 렌더 큐를 멈추게 하지 않습니다. 우리가 실제로 서비스하는 영상 모델 — MiniMax H3, Kling 3.0, Kling Video O1 등 — 은 같은 키를 사용하므로, Wan 3.0 프리뷰나 Odyssey-3 체험이 마침내 공개될 때 교체 비용이 저렴해집니다.

어떤 것이 당신의 스택에 어울리나요?
이 선택은 근소한 차이의 문제가 아니다. 두 가지가 만들어내는 결과물에는 겹치는 부분이 전혀 없기 때문이다. 정직한 결정 규칙은 결국 마지막에 당신에게 필요한 결과물에 관한 것이다.
사람이 시청하는 영상물이 결과물이라면 Wan 3.0을 선택하세요: 광고, 장면 삽입, 소셜 컷, 교육 세그먼트. 네이티브 오디오가 포함된 실행당 30초, 이미지·비디오·오디오 전반에 걸친 레퍼런스 제어, 지시 기반 편집, 문서 입력은 제작 기능 목록이며, 종량제 API는 테스트 비용을 사전에 알 수 있게 해줍니다. 이것은 시뮬레이션이 아니라 생성입니다 — 모델의 작업은 클립이 끝나면 끝납니다. 벤더의 초당 요금을 기준으로 예산을 책정하고, 오디오와 화면 텍스트에 관한 벤더 자체의 주의사항을 각주가 아니라 설계 제약으로 취급하세요.
산출물이 파일이 아니라 행동이라면, 구할 수 있을 때 Odyssey-3를 선택하세요: 정책이 학습하는 환경, 긴 롤아웃 동안 행동에 대한 반응이 일관되게 유지되어야 하는 장면, 카메라가 문제의 일부인 내비게이션 또는 매니퓰레이션 작업 말입니다. 바로 이 지점에서 시공간적 개연성 부문의 확실한 1위와 영상당 모델링된 비용 $0.139–$0.267이 실제로 중요해집니다. 빠져 있는 것은 프로덕션 팀이 확정을 위해 필요한 모든 것 — 가격, 라이선스, 엔드포인트, 외부 측정 — 이며, 이 중 어느 것도 데모가 대신할 수 있는 것은 아닙니다.
주목해야 할 것은 구체적이고 바로 눈앞에 있다. Wan 3.0이 Physics-IQ Verified에 등장하면 물리 질문은 한 방향으로 답할 수 있게 된다. Odyssey가 요금표나 API를 공개하면 비용 질문은 다른 방향으로 해결된다. 그중 하나가 실현되기 전까지 이 비교는 이상한 형태를 띤다. 공개된 가격은 있지만 물리 점수는 없는 프로덕션 시스템이, 공개된 물리 점수는 있지만 가격은 없는 시뮬레이터 옆에 놓여 있는 것이다. 오늘 어느 쪽이 더 나은지 말하는 사람은 그 두 수치 중 적어도 하나는 추측하고 있는 것이다.
![Capture of the Physics-IQ Verified leaderboard from Anates Labs and DeepMind, ranked by net improvement in percentage points above the track mean, showing FLUX 3 [large] first at +12.27 pp, Odyssey-3 Pro second at +11.15 pp and Odyssey-3 third at +9.99 pp, with Wan 2.2 14B at rank 17 and Wan 2.2 5B at rank 22 and no entry for Wan 3.0.](https://cms.orcarouter.ai/api/media/file/4-1741.png)
