
Odyssey-3 vs Google Veo 3.1: 10개월의 제작에 맞선 최전선 물리학
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
Odyssey-3와 Veo 3.1의 비교는 사실상 두 날짜 사이의 비교입니다. Veo 3.1은 2025년 11월 17일부터 정식 제공되어 왔습니다 — 10개월간의 프로덕션 사용, 초당 가격 공개, 네이티브 4K, 그리고 적어도 한 번은 엔터프라이즈 검토를 거친 서빙 스택을 갖추고 있습니다. Odyssey-3는 2026년 9월 15일 Odyssey가 프리뷰로 공개했고, 공개된 가격도, API 문서도, 독립 벤치마크도 없으며, 출시 시기는 "다가오는 몇 주"입니다. 그래도 둘을 나란히 놓고 볼 가치는 있습니다. 함께 언급되는 이유는 실제로 존재하기 때문입니다: Veo 3.1은 아름다운 비디오를 렌더링하고, Odyssey-3는 제어 하에서 올바르게 동작하는 세계를 시뮬레이션하려고 합니다. 이 두 가지는 팀들이 "비디오"라는 단어 아래 계속 혼동하는 서로 다른 제품이며, 그들 사이의 간극이 바로 구매 결정이 놓여 있는 곳입니다.
10개월간의 출시가 당신에게 주는 것
Veo 3.1의 장점은 기능이 아니라 경과된 시간이다. 이 모델은 2025년 10월부터 프리뷰로, 11월 17일부터는 GA 제품으로 유료 고객의 손에 들어왔으며, 2026년 3월 31일에는 Lite 티어가, 4월 2일에는 무료 티어가 추가되었다. 그런 이력은 프리뷰가 만들어낼 수 없는 것들을 낳는다: 문서화된 API 표면, 실무자들이 이미 매핑해 둔 확립된 실패 모드 집합, 그리고 재무 팀이 모델링할 수 있는 비용 곡선이다.
사양서도 같은 성숙도를 보여준다. Veo 3.1은 720p, 1080p, 네이티브 4K로 초당 24프레임, 4초·6초·8초의 네이티브 길이로 생성하며, 더 긴 출력은 1080p로 보고되고 그 이상은 장면 확장 체이닝으로 이어진다. 캐릭터와 장면 일관성을 위해 최대 세 개의 참조 이미지를 받아들이고, 시드와 네거티브 프롬프트 제어도 제공한다. 출력에는 SynthID와 C2PA 출처 메타데이터가 포함된다. 브랜드, 방송 또는 대형 화면 작업에서 네이티브 4K 경로는 경쟁 진영 대부분이 그저 갖추지 못한 단 하나의 역량이며 — 이것이 Veo 3.1이 가격으로는 이기지 못할 프로젝트를 계속 수주하는 이유다.

모든 비교를 조용히 왜곡하는 오디오 기본값
Veo 3.1은 네이티브 48kHz 스테레오 오디오—대사, 주변음, 폴리—를 영상과 함께 생성하며, 이는 진정으로 가장 강력한 기능 중 하나입니다. 그런데 API에서는 audio 매개변수가 기본적으로 꺼져 있고, 무음 생성은 오디오 생성보다 낮은 가격이 책정됩니다. Google이 공개한 Standard 등급에서는 이는 무음의 경우 초당 약 $0.20, 오디오 포함 시 초당 약 $0.40에 해당합니다. 여기서 두 가지 결과가 따릅니다. 첫째, Veo 클립의 실질 가격은 대부분의 사람이 절대 바꾸지 않는 플래그에 전적으로 달려 있으므로, 같은 모델에 대해 “초당 $0.20”이라는 수치와 “초당 $0.40”이라는 수치가 모두 정확할 수 있습니다. 둘째, 더 미묘한 점인데, 이는 당신이 읽어 온 아주 많은 일대일 비교 테스트가 무음 Veo 3.1을 오디오가 항상 켜져 있는 경쟁자와 맞붙게 한 뒤, 오디오를 인식하는 리더보드에서 점수를 매겼다는 뜻입니다. 출력에 사운드가 필요하다면, 계획을 세울 때 기준으로 삼아야 할 정직한 숫자는 오디오가 활성화된 쪽입니다.
Odyssey-3이 실제로 주장하는 것
Odyssey-3는 더 나은 비디오 생성기가 아니며 그렇다고 주장하지도 않는다. 이는 세계에 대한 시각적 관찰로 훈련된 자기회귀 확산 트랜스포머이며, 발표의 중심에 있는 기능은 행동 디코더 — "월드 모델에 부착된 학습된 출력 구성요소"로서 모델의 내부 장면 표현을 특정 하드웨어를 위한 모터 명령으로 바꾸는 것이다. Odyssey는 이것이 수십 시간의 데모로부터 로봇 팔을 제어하고, Flexion으로 구축된 휴머노이드 정책을 실시간으로 구동하며, 20시간의 시뮬레이션 데이터로 훈련된 동결된 백본에서 폐루프 주행 웨이포인트를 생성하고, 실내에서 장애물 주변을 드론으로 비행하며, Grand Theft Auto V를 플레이하고 추가 정책 훈련 없이 Red Dead Redemption 2와 Sleeping Dogs로 전이한다고 보고한다. 공개된 단 하나의 비교 수치는 시뮬레이션으로 훈련된 주행 정책이 안전 운전자 개입 사이 주행 거리가 실제 영상으로 훈련된 정책의 약 77%였다는 것이다.
그것들이 어떤 종류의 주장인지 주목하세요. 그중 어느 것도 출력이 어떻게 보이는지에 관한 것이 아닙니다. 모두 모델의 다운스트림에 있는 프로그램이 그 출력으로 무엇을 할 수 있는지에 관한 것입니다.
겹치지 않는 차원
• 출력 — Google Veo 3.1: 최대 네이티브 4K의 렌더링된 클립, 선택적 48kHz 스테레오 오디오 지원. Odyssey-3: 시뮬레이션된 월드 상태와 액션 디코더를 통한 모터 액션.
• 소비자 — Google Veo 3.1: 뷰어 또는 편집자. Odyssey-3: 로봇 컨트롤러, 주행 정책, 또는 학습 루프.
• 클립 길이 — Google Veo 3.1: 4/6/8초 네이티브, 1080p에서는 더 길게, 그 이상은 확장 체인으로. Odyssey-3: 연속 롤아웃, 클립 개념 없음.
• 가격 — Google Veo 3.1: Standard 기준 무음 약 $0.20/초, 오디오 포함 약 $0.40/초이며, Fast 및 Lite 등급은 그보다 낮습니다. Odyssey-3: 공개된 정보 없음.
• 이용 가능 여부 — Google Veo 3.1: 2025-11-17부터 GA(정식 출시). Odyssey-3: 2026-09-15 미리보기 공개, "몇 주 내" 일반 공개.
• 근거 — Google Veo 3.1: 10개월간 프로덕션 사용 및 독립 리더보드 순위. Odyssey-3: 벤더 시연만 존재, 벤치마크 표 없음, 기술 보고서 없음.
물리학적 주장이 실제로 빛을 발하는 곳 — 그리고 그렇지 않은 곳
더 나은 물리 모델이 더 나은 영상을 만든다고 가정하기 쉽지만, 그것은 Odyssey가 판매하는 것이 아니다. 영상 팀의 문제는 클립 속 세계가 물리적으로 일관되지 않다는 경우가 거의 없다 — 문제는 그 샷이 4K여야 한다거나, 캐릭터가 세 가지 서로 다른 셋업에서도 똑같아 보여야 한다거나, 법무팀이 승인하기 전에 결과물에 출처 메타데이터가 붙어 있어야 한다는 것이다. Veo 3.1은 오늘 그런 질문에 답한다. 물리적으로 정확한 시뮬레이터는 다른 질문에 답한다: 여기서 훈련한 무언가가 저 바깥에서도 작동하게 할 수 있을까. 아무것도 훈련하고 있지 않다면, Odyssey-3의 물리적 정확성은 당신의 워크플로에 구매자가 없는 기능이다.
이 둘이 진정으로 만나는 지점은 프리비주얼라이제이션이다. 공간을 상호작용적으로 탐색하려는 감독, 즉 세트를 카메라로 걸어 다니고, 블로킹 선택을 바꾸고, 그 결과를 보고자 하는 감독은 월드 모델이 제공하는 것, 그리고 렌더링된 클립이 할 수 없는 것을 정확히 원한다. 클립은 생성되는 순간 고정되기 때문이다. 이는 실제 사용 사례이며, 동시에 아직 공개되지 않은 프리뷰가 아직 선택지가 아닌 경우이기도 하다.
하나의 엔드포인트에 모든 것을 걸지 않고 프로덕션에서 실행하기
프로덕션 팀이 모델 주변의 아키텍처에 신경 쓰는 이유는 비디오 파이프라인이 좀처럼 단일 호출로 끝나지 않기 때문입니다. 프롬프트 모델이 숏 리스트를 작성하고, 이미지 모델이 시작 프레임을 생성하며, 비전 모델이 결과를 브리프에 비추어 검사하고, 전사 모델이 보이스오버를 처리합니다. 이들 각각은 새벽 2시에 실패할 수 있는 의존성이며, 개별적으로 구매하면 각각이 별도의 통합입니다. 그 계층을 프로바이더 정가에 0% 마크업으로 200개 이상의 모델을 아우르는 하나의 API에 올리면 통합이 줄어들고, 자동 장애 조치가 있으면 프롬프트 모델 장애 시 렌더 큐가 멈추는 대신 경로가 우회됩니다. 라우팅 DSL은 단일 모델 워크플로보다 여기서 더 중요합니다. 여러 모델을 하나의 호출로 구성하는 것이야말로 다단계 파이프라인이 전체로 실패하는 대신 단계별로 우아하게 실패할 수 있게 해주기 때문입니다. 범위를 분명히 하자면, OrcaRouter는 Google Veo 3.1이나 Odyssey-3를 제공하지 않으며, 두 모델 모두 이를 통해 접근할 수 없습니다.

누가 지금 행동해야 하고, 누가 기다려야 하는가
마감이 이번 분기이고 결과물이 파일이라면 Google Veo 3.1은 정당화할 수 있는 선택이며, 가격 — 오디오 포함 1080p에서 초당 약 $0.40, Fast 및 Lite 티어에서는 더 저렴 — 은 지루할 정도로 오랫동안 프로덕션에 사용되어 온 모델의 비용입니다. 오디오 플래그 비용은 나중에 뒤늦게 알게 되기보다 미리 의도적으로 예산에 반영하세요.
당신의 문제가 하드웨어에서 작동해야 하는 정책이라면, Odyssey-3는 당신을 겨냥한 것이며 아직 구매할 수 있는 것은 없습니다. 세 가지를 기다리십시오: 공개된 가격, 기간이 아니라 날짜인 출시일, 그리고 독립적인 수치 하나. 77%라는 sim-to-real 수치는 Odyssey 자체의 것이며, 회사 외부의 누군가가 이를 다시 실행하기 전까지 올바른 태도는 계획이 아니라 관심입니다. 그동안 주변 스택은 당신이 구축할 수 있는 부분이며, 나중에 새 모델을 끼워 넣을 수 있도록 그것을 구축하는 것이 가장 저렴한 포지션입니다.

