
MiniMax H3 (Hailuo 3.0): Omni-Reference를 갖춘 2K AI 비디오 모델, 설명
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
MiniMax H3(일명 Hailuo 3.0)는 MiniMax의 최신 AI 비디오 생성 모델이다. 2026년 7월 17일 WAIC 2026에서 처음 공개되었고, 7월 31일부터 일반에 공개되었으며, 현재 MiniMax의 Hailuo 플랫폼, Luma Agents, 오픈 가중치 다운로드, 그리고 8월 30일부터는 Vercel의 AI Gateway 등 네 가지 방식으로 동시에 제공된다. Vercel의 AI Gateway에서는 새로운 속도 우선형 MiniMax H3 Max도 함께 출시되었다. 이 모델은 MiniMax의 비디오 라인을 네이티브 2K 해상도로 끌어올리고, 단일 패스로 동기화된 오디오를 추가하며, 특이할 정도로 풍부한 “omni-reference” 제어 시스템을 도입한다. 최신 개발은 자체 호스팅 측면에서 이루어졌다. 9월 1일부터 공개 H3-Base 가중치를 vLLM-Omni와 FastVideo의 FastH3를 통해 서빙할 수 있으며, FastH3는 완전한 10.1초 분량의 비디오-오디오 MP4를 약 8.7초 만에 렌더링할 수 있을 정도로 빨라 재생 시간보다도 빠르다. 이 가이드는 H3가 실제로 무엇인지, 무엇이 진정으로 새로운 것인지, 그리고 2026년 최첨단 비디오 모델들 사이에서 H3가 어디에 위치하는지 설명한다 — 기능에 대한 출처와 품질 주장이 명확히 표시된다.
정확성 참고: H3의 기능은 MiniMax의 발표 및 플랫폼 문서에서 비롯된 것입니다. Vercel AI Gateway 이용 가능 여부는 확인되었습니다. Vercel의 모델 카탈로그에는 MiniMax H3와 MiniMax H3 Max가 모두 등재되어 있으며, Vercel의 변경 로그에는 출시 할인이 기록되어 있습니다. 다만 프로모션 조건 자체는 공급업체가 발표한 것입니다. Luma Agents 통합 및 오픈 가중치 공개는 현재 작성 시점 기준으로 공급업체 발표 사항입니다. Luma의 자체 제품 문서에는 아직 H3가 등재되지 않았으며, 통합의 이용 조건도 불분명합니다. 비디오 품질은 대체로 주관적이며 인간 선호도 평가에 의해 판단됩니다. H3는 이제 초기 Artificial Analysis 아레나 점수를 보유하고 있습니다 — 이미지-투-비디오 약 1,184점, 오디오 포함 텍스트-투-비디오 약 1,226점(2026년 8월 27일 측정)입니다. 다만 아레나 순위는 투표가 누적됨에 따라 변동됩니다. 9월 1일의 재생보다 빠른 서빙 수치 — 동기화된 오디오가 포함된 전체 10.1초 MP4가 약 8.7초 만에 렌더링된 것 — 는 vLLM-Omni 팀이 자체 블로그 게시물에서 보고한 것으로, 8× NVIDIA B300 서버에서 측정되었습니다. 이는 아직 독립적으로 재현되지 않은 팀 벤치마크이며, 전체 기본 모델이 아닌 FastVideo의 4단계 증류 어댑터인 FastH3를 측정한 것입니다. "어떤 것이 가장 좋아 보이는가"라는 비교 주장은 잠정적인 것으로 간주하세요. 사양과 가격은 변경될 수 있습니다 — 구축 전에 확인하세요.
TL;DR. H3는 네이티브 2K, 24fps 텍스트-투-비디오 및 이미지-투-비디오 모델로, 동기화된 대사, 효과음, 앰비언스를 포함한 5~15초 클립(약 30초까지 확장 가능)을 한 번에 생성한다. 가장 눈에 띄는 기능은 옴니 레퍼런스(일관성을 위한 참조 이미지 최대 9장, 비디오 클립 3개, 오디오 클립 3개)와 지시 기반 편집(재생성 없이 캐릭터, 객체, 장면, 사운드 또는 속도 변경)이다. 출시 이후 빠르게 확산됐다. 8월 3일 기본 가중치가 오픈됐고, MiniMax는 8월 6일 Luma Agents에서 H3를 발표했으며(네이티브 스테레오 사운드를 갖춘 최대 15초 2K 비디오를 제공하지만, 액세스 조건은 아직 공개되지 않음), 8월 30일에는 MiniMax H3와 MiniMax H3 Max가 Vercel의 AI Gateway에 합류하며 2주간 50% 출시 할인이 적용됐다. 9월 1일부터는 오픈된 기본 가중치를 실시간 생성에도 서빙할 수 있다. vLLM-Omni와 FastVideo의 FastH3를 사용하면 10.1초 분량의 비디오·오디오 MP4 전체가 약 8.7초 만에 렌더링되는데, vLLM-Omni 팀의 벤치마크에 따르면 이는 재생 시간보다 빠른 것이다. 이는 Hailuo 2.3(1080p, 약 10초, 옴니 레퍼런스 미지원)보다 큰 도약이며, Kling 3.0, Google Veo 3.1, ByteDance Seedance 2.0 등과 경쟁한다. 제어와 오디오에서 강점을 보이며, 초기 독립 아레나 점수는 아직 더 확정돼야 한다.
주요 시사점
• H3 = Hailuo 3.0, MiniMax의 최신 비디오 모델로, WAIC 2026에서 공개되었으며 7월 31일에 출시됨; Hailuo, Luma Agents, 오픈 가중치 및 Vercel의 AI Gateway를 통해 이용 가능.
네이티브 2K 해상도, 24fps, 5~15초 클립(최대 ~30초까지 확장 가능), 다양한 화면비, 텍스트-투-비디오 및 이미지-투-비디오.
• 옴니 레퍼런스: 스타일, 캐릭터, 동작 및 음성 일관성을 위한 참조로 최대 9개의 이미지, 3개의 비디오 클립 및 3개의 오디오 클립.
• 단일 패스로 생성된 동기화된 대화, SFX 및 분위기; 전체 재생성 없이 명령 기반 편집.
• 기본 가중치는 8월 3일 커뮤니티 라이선스로 오픈소스 공개되었으며, Context-IR 및 2K 재생성 모듈은 API 전용으로 유지됩니다.
• 8월 30일, MiniMax H3 및 MiniMax H3 Max가 Vercel의 AI Gateway에서 9월 13일까지 적용되는 50% 출시 할인과 함께 출시되었습니다.
• 9월 1일부터 공개된 H3-Base 가중치를 사용해 실시간 생성이 가능합니다 — 10.1초 분량의 영상·오디오 MP4를 약 8.7초 만에 렌더링하여 재생 속도보다 빠릅니다 — vLLM-Omni 및 FastVideo의 FastH3을 통해 제공됩니다(팀 보고 벤치마크로, 아직 독립적으로 재현되지 않음).
• Hailuo 2.3(1080p, ~10초)에 비해 큰 업그레이드; Kling 3.0, Veo 3.1, Seedance 2.0, Wan 2.7 등과 경쟁합니다.
MiniMax H3가 실제로 무엇인지
MiniMax는 중국의 주요 AI 기업이다 (2026년 1월 홍콩 IPO를 완료했으며, 약 6억 1,900만 달러를 조달하고 약 40억 달러의 가치 평가를 받은 것으로 알려졌다. 투자자에는 알리바바와 텐센트가 포함된다). 소비자용 비디오 브랜드는 Hailuo로, 카테고리에서 선도적인 물리 시뮬레이션, 빠른 생성 속도, 합리적인 가격으로 유명하다. H3는 3세대 Hailuo 모델로, WAIC 2026에서 MiniMax의 M3 텍스트 모델 및 기타 멀티모달 솔루션과 함께 공개되었으며 2026년 7월 31일에 일반에 공개되었다. M3가 텍스트/에이전트 LLM인 반면, H3는 명백히 비디오 생성 모델이다.
새로운 기능: 2K, omni-reference, one-pass 오디오
H3을 정의하는 세 가지가 있습니다. 첫째, 네이티브 2K, 24fps — Hailuo 2.3의 1080p보다 한 단계 업그레이드된 것으로, 영화 표준 프레임 속도로 5초에서 15초 길이의 클립(Extend 도구를 사용해 최대 약 30초까지 연장 가능)을 지원하며, 화면비는 21:9에서 9:16까지입니다. 둘째, omni-reference: 최대 9개의 참조 이미지, 3개의 비디오 클립, 3개의 오디오 클립을 동시에 입력하여 스타일, 캐릭터 정체성, 동작 또는 음성을 고정할 수 있습니다. 이는 여러 샷에서 캐릭터나 외형을 일관되게 유지하기 위한 매우 풍부한 제어 인터페이스입니다. 셋째, 단일 패스로 동기화된 오디오: H3는 별도의 오디오 단계 없이 화면의 액션에 맞춰 대사, 음향 효과, 주변 분위기를 생성합니다.

지시 기반 편집
조용히 중요한 기능은 명령 기반 편집입니다. 변경을 위해 클립을 처음부터 다시 생성하는 대신, 편집을 설명할 수 있습니다. 예를 들어 캐릭터 바꾸기, 객체 변경, 장면 변경, 소리 조정, 또는 샷의 속도 재조정을 설명하면 H3가 이를 적용합니다. 반복적인 창작 작업에서 제자리 편집은 새로운 생성에서 주사위를 다시 굴리는 것보다 실제 워크플로우 이점을 제공합니다.
Hailuo 2.3과 어떻게 비교되나요?
세대 점프가 명확합니다. H3는 1080p에서 네이티브 2K로 전환하고, 단일 생성 최대 길이를 약 10초에서 15초(30초 확장 포함)로 연장하며, 2.3에는 없었던 옴니 레퍼런스 입력과 명령 기반 편집을 모두 추가했습니다. Hailuo 2.3을 사용했다면, H3는 해상도, 길이, 제어, 오디오 면에서 확실한 업그레이드입니다.
2026년 프론티어에서 H3의 위치
H3는 이제 초기 Artificial Analysis 아레나 점수 — 대략 이미지-투-비디오에서 1,184, 오디오가 포함된 텍스트-투-비디오에서 1,226, 2026년 8월 27일에 기록 — 를 보유하고 있지만, 아레나 순위는 표가 쌓이면서 변하므로 어느 단일 언급보다는 직접 테스트 프롬프트로 평가하세요.
OpenAI Sora에 관한 메모
현황을 파악하자면: OpenAI는 2026년 4월에 Sora 웹·앱 서비스를 중단했고, API는 2026년 9월에 종료될 예정이다. 따라서 Sora는 새로운 비디오 워크플로우를 시작할 모델로 적합하지 않다. 현재 최전선은 위에 나열된 세트이며, H3가 여기에 합류한다.
H3 및 나머지 필드에 액세스하는 방법
H3는 이제 네 가지 방법으로 이용할 수 있으며, 그 목록은 출시 이후로 더 늘어났습니다.
• Hailuo(MiniMax의 자체 플랫폼): 지시 기반 편집 및 H3-Regenerate-2K의 2K 업스케일을 포함한 전체 제품.
• Luma Agents: MiniMax는 2026년 8월 6일, H3가 Luma의 멀티 모델 Agents 제품에서 이제 사용 가능하며, 기본 스테레오 사운드와 함께 최대 15초의 2K 비디오를 생성할 수 있다고 발표했습니다. 이는 업체가 발표한 사항이며, 접근 조건은 아직 공개되지 않았습니다. — 현재 시점에서 Luma 자체 제품 문서에는 H3가 등재되어 있지 않습니다. — 따라서 가격 및 자격 요건에 대한 세부 사항은 곧 확정될 것으로 예상됩니다. Luma가 자사 Agents 제품 안에 경쟁사의 비디오 모델을 호스팅하는 것은 2026년 비디오 모델 시장이 얼마나 상호 교환 가능해졌는지를 보여주는 신호입니다.
• Vercel AI Gateway: 2026년 8월 30일, MiniMax와 Vercel은 MiniMax H3와 MiniMax H3 Max가 모두 Vercel의 AI Gateway를 통해 제공되며, 게이트웨이를 통해 청구되는 요청은 2026년 8월 30일부터 9월 13일까지 50% 할인된다고 발표했습니다. 모델 ID(minimax/minimax-h3 및 minimax/minimax-h3-max)는 변경되지 않았으므로 기존 게이트웨이 통합은 코드 변경 없이 할인된 요금이 적용됩니다. 이용 가능 여부는 Vercel의 모델 카탈로그와 변경 로그에서 확인할 수 있으며, 프로모션 조건은 공급업체가 발표한 것입니다.
• 오픈 가중치: 2026년 8월 3일, MiniMax는 H3의 기본 가중치(33B 밀집 트랜스포머, H3-Base)를 MiniMax H3 Community License에 따라 Hugging Face와 ModelScope에 두 개의 체크포인트, 즉 텍스트-비디오/오디오 및 키프레임 생성을 위한 H3-Base-FL2VA와 참조 기반 생성을 위한 H3-Base-Ref2VA로 공개했습니다. 세 가지 시스템 모듈 중 두 가지(H3-Context-IR(프롬프트 전처리기) 및 H3-Regenerate-2K(2K 업스케일))는 오픈 릴리스에 포함되지 않고 API 전용으로 남아 있으므로, 자체 호스팅 실행은 2K 미만으로 제한됩니다. 그리고 9월 1일부터는 동일한 기본 가중치를 vLLM-Omni와 FastVideo의 FastH3를 통해 실시간 생성에 사용할 수 있습니다. FastH3는 4단계 증류 어댑터로, 8× NVIDIA B300 서버에서 완전한 10.1초 분량의 비디오·오디오 MP4를 약 8.7초 만에 렌더링하여 재생 시간보다 빠릅니다(팀 측 주장이며, 아직 독립적으로 재현되지 않음).
MiniMax H3는 OrcaRouter에서 공급업체의 정가로 제공됩니다 — 768p에서 초당 $0.08, 2K에서 초당 $0.13 — 0% 마크업과 자동 장애 조치를 적용해 전달되므로, 며칠 된 벤더 엔드포인트를 직접 연결하는 대신 하나의 OpenAI 호환 API로 H3 제품군을 호출할 수 있습니다. 모든 모델을 호스팅하는 제공업체는 없으므로, LLM 및 에이전트 트래픽을 하나의 엔드포인트에서 실행하고(OrcaRouter는 MiniMax 자체 M3 텍스트 모델도 전달함) 프로젝트별로 가장 적합한 비디오 모델을 직접 사용하는 것이 실용적인 패턴입니다. MiniMax H3 Max는 아직 OrcaRouter에서 라우팅되지 않습니다. 현재는 제3자 채널을 통해 제공되므로, 이 모델로 프로토타이핑하는 경우 장애 조치 습관이 큰 도움이 됩니다. 프로덕션 파이프라인을 걸지 않고 며칠 된 모델을 시도할 수 있기 때문입니다.

실시간 제공: 재생보다 빠른 동영상
이번 업데이트의 배경에는 셀프 호스팅 측의 개발이 있습니다. MiniMax H3의 공개된 베이스 체크포인트는 33B 규모의 덴스 트랜스포머이며, 표준 방식으로 클립 하나를 생성하려면 긴 디노이징 스케줄에 걸쳐 약 49회의 디퓨전-트랜스포머 포워드(순방향) 연산을 실행해야 합니다. 오픈소스 비디오 학습·추론 프로젝트인 FastVideo는 H3-Base를 증류한 학생 모델인 FastH3를 공개했습니다. FastH3는 H3의 텍스트 인코더, 비디오 VAE, 오디오 VAE, 토크나이저, 스케줄러를 재사용하면서도 디노이징 루프를 5개 시그마 위치에 걸친 4회의 트랜스포머 포워드 연산으로 줄인 4-스텝(DMD2 스타일) 모델입니다. 멀티모달 서빙 런타임인 vLLM-Omni는 로드 시점에 FastH3 어댑터를 통합하며(pull request #6714), 이를 기존의 base-H3 지원과 함께 OpenAI 호환 /v1/videos 엔드포인트로 제공합니다.
헤드라인 수치는 대형 하드웨어에서 측정된 것입니다. 1344×768, 24fps의 8× NVIDIA B300 서버에서 vLLM-Omni 팀은 약 8.7초 만에 전체 10.1초 분량의 MP4(비디오 및 동기화된 오디오)를 종단 간(end-to-end) 렌더링했으며, 이는 재생 시간보다 빠른 것입니다. 이는 2026년 9월 1일에 발표된 팀 보고 벤치마크로 아직 독립적으로 재현되지 않았습니다. 팀은 또한 원시 벤치마크 번들이 아직 공개 대기 중이며 base 대비 FastH3의 품질 동등성을 주장하지 않는다고 밝혔습니다. 보다 일반적인 하드웨어에서 수치는 덜 극적입니다. 커뮤니티 레시피는 2× RTX 5090 및 단일 GPU 설정도 다루며, FastH3 v1은 텍스트-투-비디오-오디오(T2VA)만 지원하며, API 측에 남아 있는 2K가 아닌 1344×768에서 작동합니다.
독자에게 이는 “H3 자체 호스팅”이 의미할 수 있는 바를 바꾼다. 이전에는 공개 기본 가중치를 실행할 수 있었지만 속도가 느렸다. 배치 작업에는 적합했지만, 대화형 작업에는 적합하지 않았다. vLLM-Omni에서 FastH3를 사용하면 온프레미스 H3 파이프라인이 10초짜리 클립을 클립 길이보다 훨씬 짧은 시간 안에 처리할 수 있으며, 이는 라이브 프리비주얼라이제이션, 빠른 샷 반복, 에이전트 기반 비디오 같은 실시간 제품 루프가 실용화되는 기준점이다. 8-GPU 서버를 직접 운영하고 싶지 않다면 관리형 경로는 종전과 동일하다. MiniMax H3는 OrcaRouter에서 제공업체 공시 가격 그대로 제공되며, 0% 마크업과 자동 장애 조치(failover)가 적용된다. 따라서 하드웨어를 소유하지 않고도 단일 OpenAI 호환 API를 통해 H3 제품군을 호출할 수 있다.
H3가 빛나는 세 가지 시나리오
1. 캐릭터와 스타일이 일관된 단편 영화
Omni-reference (최대 9개의 이미지, 3개의 클립, 3개의 오디오)는 여러 샷에서 캐릭터, 룩, 음성의 일관성을 유지하기 위해 설계되었으며, 내러티브 단편 및 에피소드 콘텐츠에 이상적입니다.
2. 소리와 함께하는 소셜 및 광고 크리에이티브
원패스 동기화 대화, SFX, 앰비언스와 유연한 화면 비율(9:16에서 21:9까지)은 시각적 요소뿐만 아니라 완성된 오디오가 필요한 빠른 소셜 및 광고 작업 흐름에 적합합니다.
3. 반복적인 창의적 편집
명령 기반 편집을 사용하면 팀이 다시 생성하는 대신 설명적으로 클립을 수정할 수 있어, 수정 작업이 많은 제작 과정의 속도를 높여줍니다.

자주 묻는 질문
MiniMax H3는 무엇인가요?
H3는 2026년 7월 17일 WAIC 2026에서 공개되고 2026년 7월 31일에 출시된 MiniMax의 최신 AI 비디오 생성 모델인 Hailuo 3.0입니다. 이 모델은 옴니 레퍼런스 제어와 지시 기반 편집을 통해, 텍스트나 이미지에서 동기화된 오디오를 갖춘 네이티브 2K, 24fps 비디오를 생성합니다.
H3는 MiniMax M3와 동일한가요?
아니요. M3는 MiniMax의 텍스트/에이전트 LLM이고, H3(Hailuo 3.0)는 비디오 생성 모델입니다. 둘은 같은 행사에서 공개됐지만 역할이 다릅니다.
지금 H3를 어디에서 사용할 수 있나요?
네 가지 방법이 있습니다: MiniMax의 Hailuo 플랫폼(전체 제품), Vercel의 AI Gateway(H3와 MiniMax H3 Max, 9월 13일까지 50% 출시 할인), Luma Agents(2026년 8월 6일 발표 — 최대 15초의 2K 비디오와 네이티브 스테레오 사운드 지원, 접근 조건은 아직 불명확), 그리고 Hugging Face와 ModelScope의 공개 H3-Base 가중치를 통한 자체 호스팅 — 이는 9월 1일부터 vLLM-Omni와 FastVideo의 FastH3를 통해 재생 속도보다 빠르게 서빙할 수 있습니다(vLLM-Omni 팀에 따르면 8× B300에서 10.1초 분량의 비디오 및 오디오 MP4를 약 8.7초 만에 처리). 또한 기본 모델은 OrcaRouter에서 공급업체 정가로 라우팅됩니다.
H3 클립의 길이와 해상도는 얼마인가요?
네이티브 2K, 24fps, 생성당 5~15초, 약 30초까지 확장 가능, 화면비 21:9에서 9:16까지.
omni-reference란 무엇인가요?
최대 9개의 참조 이미지, 3개의 비디오 클립, 3개의 오디오 클립을 동시에 받아 스타일, 캐릭터, 모션, 음성 일관성을 유지하는 제어 시스템.
H3가 Kling 3.0이나 Veo 3.1보다 더 나은가요?
기준에 따라 다릅니다. Kling 3.0은 네이티브 4K를 지원하며 일부 영역에서 앞서 있습니다. Veo 3.1은 48kHz 대화에서 강점을 보입니다. H3는 옴니 레퍼런스 제어, 원패스 오디오, 편집, 가격을 강조합니다. H3는 8월 말 기준 이미지-투-비디오 약 1,184점, 오디오가 포함된 텍스트-투-비디오 약 1,226점의 초기 Artificial Analysis 아레나 점수를 보유하고 있으며, 이는 투표가 누적됨에 따라 변동될 것입니다. 자신만의 프롬프트로 직접 테스트해 보세요.
H3는 오픈 웨이트인가요?
부분적으로 그렇습니다. MiniMax는 2026년 8월 3일 H3의 기본 가중치를 오픈소스로 공개했습니다. 이는 MiniMax H3 커뮤니티 라이선스(MiniMax H3 Community License)에 따라 Hugging Face와 ModelScope에 배포된 33B 트랜스포머로, FL2VA 및 Ref2VA 체크포인트를 포함합니다. MiniMax의 라이선스 약관에 따라 이번 공개는 배포 지역을 제한하며 생성된 출력물에도 적용되고 저작자 표시가 요구됩니다. 플래그십 경험을 완성하는 두 모듈, 즉 H3-Context-IR(프롬프트 전처리)과 H3-Regenerate-2K(2K 업스케일)는 오픈 릴리스에 포함되지 않고 API 전용으로 남아 있습니다. 9월 1일부터 공개된 기본 가중치는 vLLM-Omni와 FastVideo의 FastH3를 통해서도 실시간 생성에 제공할 수 있습니다(FastH3 v1은 텍스트-투-비디오-오디오만 지원합니다). 따라서 기본 모델에 대해서는 그렇습니다. 단, 조건이 있습니다.
결론
MiniMax H3 (Hailuo 3.0)는 MiniMax 비디오 라인업에서 확실한 도약입니다. 네이티브 2K, 원패스(one-pass) 동기화 오디오, 폭넓은 옴니 레퍼런스 제어, 지시 기반 편집을 합리적인 가격에 제공합니다. 출시 이후 접근성도 비약적으로 좋아졌습니다. OrcaRouter에서는 공급업체 공식 가격 그대로 라우팅되고, Luma Agents 안에서 실행되며, 기본 가중치가 공개되어 자체 호스팅이 가능합니다(9월 1일부터는 vLLM-Omni와 FastVideo의 FastH3를 통해 10.1초 분량의 클립을 재생 시간보다 더 빠르게 렌더링할 수 있을 만큼 빨라졌습니다). MiniMax H3와 MiniMax H3 Max는 이제 Vercel의 AI Gateway에서도 2주간 50% 출시 할인으로 제공됩니다. 네이티브 4K를 표방하는 경쟁 모델들을 해상도에서 자동으로 앞서지는 못할 것이며, 초기 아레나 점수도 아직 확정되는 중입니다. 다만 제어, 오디오, 반복 속도 측면에서는 설득력이 있습니다. H3를 Kling 3.0, Veo 3.1, Seedance 2.0 등과 비교해 여러분의 자체 영상에서 직접 평가해 보시고, 더 넓은 모델 스택은 OrcaRouter 같은 단일 엔드포인트를 통해 벤더 중립적으로 유지하십시오.
