
Odyssey-3 vs FLUX 3 Video: 시뮬레이터와 렌더러는 같은 도구가 아니다
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
Odyssey-3와 FLUX 3 Video는 존재하지 않는 세계의 영상을 둘 다 생성하기 때문에 비교되며, 유사점은 대략 거기까지다. FLUX 3 Video는 Black Forest Labs의 생성 모델로, 2026년 8월 4일부터 일반에 제공되었으며, 프롬프트나 시작 프레임을 최대 20초의 1080p SDR MP4로 변환하고 네이티브 오디오를 포함하며, 출력 초당 가격이 책정된다. Odyssey-3는 Odyssey의 파운데이션 월드 모델로, 2026년 9월 15일에 프리뷰 공개되었고 아직 공개적으로 사용할 수 없으며, 행동에 따라 장면이 어떻게 진화하는지 시뮬레이션하고 학습된 디코더를 붙여 그 시뮬레이션을 로봇 팔, 휴머노이드, 자동차 또는 드론을 위한 모터 명령으로 바꾼다. 하나는 렌더러다: 사람이 볼 수 있는 관측값을 생성한다. 다른 하나는 시뮬레이터다: 프로그램이 작동할 수 있는 상태를 생성한다. 둘을 맞붙여 비교하는 것은 어쨌든 유용하다 — 승자를 가리기 위해서가 아니라, 그들이 출력하는 두 가지가 현재 많은 팀이 하나의 예산 항목으로 사려고 하는 두 가지 서로 다른 것이기 때문이다.
차이는 모델에서 나오는 것에 있습니다
그 구분을 유지하는 가장 깔끔한 방법은 World Labs가 월드 모델을 위해 발표한 분류 체계인데, 이는 시스템이 지각-행동 루프의 어느 부분을 출력하는지에 따라 시스템을 분류한다. 렌더러는 관측을 출력한다 — 인간의 눈을 위한 픽셀이며, 시각적 충실도로 평가된다. 시뮬레이터는 상태를 출력한다 — 인간과 프로그램 모두가 계산할 수 있을 만큼 기하학적이고 물리적으로 충실한 세계의 표현이다. 플래너는 행동을 출력한다. FLUX 3 Video는 명백히 렌더러이며, 매우 뛰어난 렌더러다. Odyssey-3는 한 발은 플래너 칼럼에 걸치고 시뮬레이터 칼럼을 목표로 하고 있는데, 액션 디코더가 시뮬레이션이 하드웨어를 구동할 수 있게 해주기 때문이다.
그것은 마케팅상의 구분이 아니며, 실용적인 테스트가 하나 있다. 비디오 모델로 방을 렌더링하고, 시점을 방 밖으로 걸어 나간 뒤 돌아보라: 가구가 당신이 두고 온 자리에 없을 수도 있다. 그 모델은 프레임 단위로 예측했을 뿐 지속적인 세계를 유지하지 않았기 때문이다. 시뮬레이터에게 같은 것을 요청하면 답은 안정적이어야 한다. 그 모델의 핵심은 프레임 아래에 있는 상태이기 때문이다. Odyssey 자체의 발표도 이 점에 기대고 있다 — 비디오 생성기가 아니라 동역학 모델을 만들어야 하는 이유는, 그 안에서 훈련된 정책을 단지 지켜보는 것이 아니라 평가하고 개선할 수 있기 때문이다.

FLUX 3 Video, 특히
블랙 포레스트 랩스는 2026년 8월 4일 FLUX 3 Video를 출시했으며, 그 사양표는 시뮬레이션이 아니라 프로덕션 결과물을 겨냥한다. 이 모델은 최대 1080p, SDR, MP4 형식으로 한 번의 패스에서 최대 20초를 생성하며, 영상과 함께 네이티브 오디오도 생성한다. 가격은 생성된 영상 1초당 기준이다. 드래프트 720p 등급은 초당 $0.06, 표준 720p 등급은 $0.17, 1080p는 $0.29이며, video-to-video 작업은 그보다 높은 가격이 책정된다. 이는 벤더가 제시한 수치다.
Black Forest Labs가 여기에 붙인 단 하나의 벤치마크 수치는 텍스트-투-비디오 부문의 내부 Elo 1,135인데, 이는 공급업체가 직접 수행한 평가이며 독립적으로 재현된 적이 없습니다 — FLUX 3 Video는 현재 독립 비디오 리더보드에 나타나지 않습니다. 이 순위는 주장으로 취급하십시오. 의심할 여지가 없는 것은 제공 방식입니다: 오늘 파일을 반환하는, 가격이 책정되고 문서화된 초당 과금 API.
Odyssey-3, 구체적으로는
Odyssey-3는 아키텍처만 있고 가격은 없는 프리뷰다. 이는 시각적 관찰 데이터로 학습된 자기회귀 확산 트랜스포머이며, 두드러지는 특징은 액션 디코더다. 오디세이의 표현을 빌리면 "월드 모델에 부착된 학습된 출력 컴포넌트"로, 관찰-행동 쌍으로 학습되어 모델의 내부 표현을 특정 하드웨어에 필요한 행동으로 변환한다. 오디세이는 이것이 수십 시간의 시연으로 로봇 팔을 구동하고, Flexion으로 실시간 휴머노이드 정책을 구축하고, 20시간의 시뮬레이션 데이터로 폐루프 주행을 수행하고, 실내 장애물 회피 드론 비행을 하고, Grand Theft Auto V에서 장시간 플레이하며 해당 타이틀에서 추가 정책 학습 없이 Red Dead Redemption 2와 Sleeping Dogs로 전이하는 것을 보고했다. 또한 이 회사는 비교 수치 하나를 보고했는데, 시뮬레이션으로 학습된 주행 정책은 실제 영상으로 학습된 정책에 비해 안전 운전자 개입 사이의 주행 거리가 약 77%에 달했다. 독립적인 벤치마크도, Odyssey-3에 대한 기술 보고서도, "향후 몇 주 안에"라는 것 외의 출시 날짜도 없다. 모든 수치는 오디세이 자체적인 것이다.
대비, 차원별로
• 출력물 — FLUX 3 Video: 픽셀로 이루어진 MP4 파일. Odyssey-3: 시뮬레이션된 월드 상태와 액션 디코더를 통한 모터 액션.
• 누가 사용하는가 — FLUX 3 Video: 시청하는 사람, 또는 편집을 마무리하는 편집자. Odyssey-3: 로봇 컨트롤러, 주행 정책, 또는 학습 중인 RL 에이전트.
• 최대 출력 — FLUX 3 Video: 단일 패스로 최대 20초, 최대 1080p SDR, 네이티브 오디오. Odyssey-3: 시뮬레이션이 유지되는 한 지속적으로 롤아웃되며, 배포에 필요한 프레임 레이트로 실행됩니다.
• 가격 — FLUX 3 Video: 초안 720p 초당 $0.06, 720p 초당 $0.17, 1080p 초당 $0.29(공급업체). Odyssey-3: 공개된 내용 없음.
• 가용성 — FLUX 3 Video: 2026-08-04부터 GA. Odyssey-3: 프리뷰, 공개적으로 “향후 몇 주 내”.
• 벤치마크 — FLUX 3 Video: 벤더 Elo 1,135 T2V, 재현되지 않음, 독립 리더보드에 없음. Odyssey-3: 벤치마크 표 없음, 벤더가 제공한 sim-to-real 수치 하나뿐.
가격 비대칭이 정직한 핵심이다
이 둘 중 하나에는 가격이 있고 다른 하나에는 없으며, 이 단 하나의 사실이 어떤 기능 주장보다도 둘 중 하나를 선택하는 데 더 많은 것을 알려줍니다. FLUX 3 Video는 출력 1초당 종량 비용이 있어서, 팀은 첫 클립을 생성하기 전에 100개 클립의 비용을 계산할 수 있습니다. Odyssey-3는 공개된 가격도, API도, 공개된 날짜도 없으므로 현재로서는 이를 사용하는 비용을 알 수 없습니다 — 청구서의 형태도 마찬가지입니다. Odyssey가 설명하는 종류의 월드 모델은 일반적으로 비디오 생성과는 매우 다르게 청구됩니다. 아름다운 픽셀 1초당이 아니라 시뮬레이션 1시간당입니다. 그 소비 주체가 수백만 단계를 실행할 수 있는 학습 루프이기 때문입니다. 초당 $0.29를 아무것도 아닌 것과 비교하는 것은 비교가 아니며, 그것을 비교라고 제시하는 페이지는 추측으로 빈틈을 메우는 것입니다.
그들이 실제로 만나게 될 곳
둘은 대체재가 아니며, 더 흥미로운 질문은 이들이 결합될 수 있는지다. FLUX 3 Video는 사람이 시청하는 파일이 결과물인 모든 작업, 즉 제품 촬영컷, 광고 변형, 소셜 컷다운, 프리비주얼라이제이션에 더 나은 도구다. Odyssey-3는, 그 약속을 지킨다면, 결과물이 실제 물리적 세계에서 작동해야 하는 정책이거나 프로그램이 추론해야 하는 장면인 모든 작업에 더 나은 도구다. 영화나 게임 파이프라인에서 그럴듯한 구성은 양자택일이 아니다 — 월드 모델이 상호작용 가능한 환경을 생성하고, 렌더러가 외부로 나가는 완성도 높은 프레임을 만들어낸다.
오늘날 그 구성에는 실제 한계가 하나 있는데, 바로 SDR입니다. FLUX 3 Video는 SDR MP4를 출력합니다. Odyssey-3는 그레이딩된 파일이 아니라 시뮬레이션된 환경을 출력합니다. 둘 다 HDR 피니싱 도구가 아니므로, 방송용이나 극장용 결과물로 끝나는 파이프라인은 이 둘 이후에도 여전히 마스터링 단계가 필요합니다.
라우팅, 그리고 여기서 그것이 다루는 것과 다루지 않는 것
현재 두 모델 모두 OrcaRouter를 통해 라우팅할 수 없습니다. FLUX 3 Video는 Black Forest Labs 자체 API와 여러 타사 플랫폼에서 제공되며, Odyssey-3는 아직 출시되지 않았기 때문에 어디에서도 구할 수 없습니다. 이런 파이프라인에서 라우팅 계층이 제 역할을 하는 지점은 비디오 모델 위의 계층입니다 — 샷 리스트를 작성하는 언어 모델, 생성된 프레임이 브리프와 일치하는지 확인하는 비전 모델, 녹음된 보이스오버를 캡션으로 바꾸는 전사 모델입니다. 이들은 일반적인 라우팅 워크로드이며200개 이상의 모델을 제공업체 정가에 0% 마크업으로 아우르는 하나의 API 위에 있습니다. 따라서 공급업체의 가격 인하가 다음 계약 갱신 때가 아니라 같은 날 청구서에 반영됩니다. 라우팅 DSL은 다단계 파이프라인에서 중요한 부분입니다. 여러 모델을 단일 호출로 구성하고, 자동 페일오버를 갖추어 공급업체가 성능 저하될 때 프롬프트 모델의 엔드포인트가 안 좋은 오후를 보내고 있다는 이유로 렌더 단계가 실패하지 않도록 합니다. 그 어느 것도 FLUX 3 Video나 Odyssey-3를 호스팅하지 않으며, 이 글은 그렇다고 주장하지 않습니다.

어느 것, 누구를 위한 것인가
결과물이 파일 — 클립, 컷다운, 프리비주얼라이제이션 — 이라면, FLUX 3 Video는 오늘 바로 구매할 수 있는 제품이며, 공개된 초당 가격에 네이티브 오디오와 20초 단일 패스 출력을 제공합니다. 그리고 공급업체의 Elo 주장은 그것을 선택하는 이유라기보다 합리적인 보너스입니다. 결과물이 하드웨어에서 작동해야 하는 컨트롤러라면, Odyssey-3는 당신의 문제를 겨냥한 제품이며, 솔직한 조언은 기다리라는 것입니다: 아직 가격도, 출시일도, 독립적인 수치도 없고, 77%라는 시뮬레이션-실제(sim-to-real) 수치는 Odyssey 자체의 것이며 재현되지 않았습니다.
주목할 것은 어느 모델이 이기는지가 아니다. 그들은 경주하는 게 아니기 때문이다. 주목할 것은 외부 그룹이 그것을 실행할 수 있게 되면 Odyssey-3의 액션 디코더가 발표문에 나열된 여섯 가지 임바디먼트 전반으로 일반화되는지 여부다. 그것이 성립한다면 가장 큰 상승 여력이 있는 주장이며, 현재 그것을 뒷받침하는 증거는 측정치가 아니라 시연 목록이다.

