
Vidu Q4 Preview vs Grok Imagine Video: 1월에 Arena를 선도했던 모델이 이제 9위다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
이 대결을 설명하는 숫자는 세 개이며, 그중 어느 것도 스펙표가 아니다. Artificial Analysis 이미지-투-비디오 보드에서 Vidu Q4 Preview는 5,543표를 등에 업고 1,179점으로 3위에 올라 있다. Grok Imagine Video 1.5는 1,098점으로 9위다. 여전히 목록에 올라 있고 자기 이름으로 여전히 호출할 수 있는 Grok Imagine Video의 2026년 1월 빌드는 1,072점으로 14위이며 — 두 Grok 항목의 가격은 각각 분당 $8.40과 $4.20인데, 이는 더 새로운 쪽이 Elo 26점을 더 얻는 대가로 정확히 두 배의 비용을 지불한다는 뜻이다.
Vidu Q4 Preview는 하나의 빌드로, 2026년 10월 7일 Shengshu Technology가 전체 Q4 모델에 앞서 첫 공개 프리뷰로 출시했으며, Image-to-Video와 Reference-to-Video 두 가지 모드로 제공됩니다. Grok Imagine Video는 두 개의 보드에 걸쳐 최소 세 개의 항목을 가진 제품군입니다. 이 비교의 핵심은 사실 9개월에 걸쳐 리더보드 순위에 어떤 일이 일어나는지이며, Vidu 릴리스는 바로 그 점을 보여주기 위해 등장한 것입니다.
같은 모델의 두 빌드, Elo 26점 차이
Artificial Analysis, 2026년 10월 8일 확인, 오디오 유지, 이미지-투-비디오 보드(AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3위, 1,179 ±10, 5,543개 샘플, 2026년 10월, 분당 $7.20
• Grok Imagine Video 1.5 — 9위, 1,098 ±8, 5,267개 샘플, 2026년 5월, 분당 $8.40
• grok-imagine-video — 14위, 1,072 ±7, 14,371개 샘플, 2026년 1월, 분당 $4.20
그리고 텍스트-투-비디오(AA-Video-T2V v2.0)에서는 자체 척도를 가진 별도의 보드:
• Grok Imagine Video 1.5 — 11위, 1,045 ±9, 4,056개 샘플, 2026년 5월, 분당 $15.00
• Grok Imagine Video 1.5 Lite — 17~18일, 993 ±10, 5,715개 샘플, 2026년 8월, 분당 $8.40
• Vidu Q4 Preview — 없음
첫 번째 블록에서 두 가지가 눈에 띕니다. Grok Imagine Video의 1월 빌드는 이 비교에 포함된 어떤 모델보다도 가장 많은 투표를 받았습니다 — 14,371표로, Vidu Q4 Preview의 5,543표와 1.5 빌드의 표 수의 거의 세 배에 달합니다. 모델이 1월에 아레나 리더로 출시되었을 때, 10월의 샘플 수는 바로 이런 모습입니다: 커뮤니티는 그 모델에 광범위하게 투표했고, 그다음 멈췄습니다. 점수는 안정적이고 잘 측정되었으며 더 이상 최상위권 근처에 있지 않습니다.
두 번째는 가격 역전이다. Grok Imagine Video 1.5는 1월의 전작보다 분당 요금이 두 배이고 Elo는 26점 앞선다. Elo 26점은 두 구간을 합친 범위 — ±8과 ±7 — 를 간신히 벗어나므로 그 개선은 아마 실제일 테지만, 이는 새 아키텍처라기보다 세대 리프레시에서 나오는 종류의 격차이며, 두 배 가격에 팔리고 있다. 한편 Vidu Q4 Preview는 1.5 빌드보다 Elo가 81점 높으면서 가격은 그보다 낮다. $7.20 대 $8.40이다. 이는 더 새로운 모델이 두 축 모두에서 더 오래된 모델을 이기는 것으로, 마땅히 일어나야 하지만 이렇게 깔끔하게 일어나는 일은 드물다.
세 번째 이상한 점은 두 보드 사이에 있습니다. 이미지-투-비디오에서 분당 $8.40인 동일한 Grok Imagine Video 1.5가 텍스트-투-비디오에서는 분당 $15.00이며, 다른 보드의 척도로는 더 낮은 점수를 받습니다. Grok 워크로드를 계획하고 있다면, 선택하는 입력 모달리티에 따라 요금이 약 80퍼센트 달라집니다.

Grok Imagine Video가 실제로 제공하는 것은 무엇인가
이 모델은 나쁜 모델이 아니며, 이 글은 그렇지 않은 척하지 않겠다. 이 모델이 Vidu Q4 Preview는 하지 않는 두 가지:
텍스트 프롬프트를 입력받습니다. Vidu Q4 Preview의 제품 페이지에는 이미지-투-비디오와 레퍼런스-투-비디오, 정확히 두 가지 모드만 나열되어 있고, API 문서에는 /ent/v2/img2video와 /ent/v2/reference2video만 기재되어 있으며 그 외에는 아무것도 없습니다. 텍스트-투-비디오 엔드포인트는 존재하지 않습니다. Grok Imagine Video 1.5와 그 Lite 버전은 둘 다 텍스트-투-비디오 목록에 올라 있으므로, 파이프라인이 작성된 프롬프트에서 시작한다면 이 두 모델 중 하나는 사용할 수 있고 다른 하나는 사용할 수 없습니다.
여기에는 저렴한 티어가 있다. 이미지-투-비디오 보드에서 1월 빌드는 분당 $4.20로, 같은 보드에서 Vidu Q4 Preview의 $7.20과 대비된다. Lite 티어의 $8.40은 자체 척도를 가진 별도 보드인 텍스트-투-비디오에 놓여 있다. 대량으로 생성하면서 5위 티어 점수를 감수할 수 있다면, Grok 제품군의 최저가 모델이 이 글에서 가장 저렴한 것이다 — $4.20의 1월 빌드는 1,072 Elo를 기록하는데, 이는 Vidu Q4 Preview보다 107 낮지만 분당 $3.00 더 저렴하다.

Vidu Q4 Preview가 제공하는 것
Vidu 쪽은 두 모델이 공유하는 축에서 더 강력한 생성 모델이며, 참조 예산도 훨씬 큽니다.
• 해상도 — Vidu Q4 Preview는 최대 4K, 10비트 컬러(2K 및 4K) 지원, Grok Imagine Video는 이 게시판에서 4K로 문서화되지 않음
• 클립 길이 — Vidu Q4 Preview는 이미지-투-비디오 3-16초, 레퍼런스-투-비디오 1-16초 vs Grok Imagine Video는 같은 수준의 세부 정보로 공개되지 않음
• 레퍼런스 입력 — Vidu Q4 Preview는 최대 15개의 레퍼런스 이미지와 최대 3개의 레퍼런스 오디오 클립을 지원하는 반면, Grok Imagine Video는 해당 수준으로 공개되지 않았습니다.
• 오디오 기본값 — Vidu Q4 Preview의 이미지-투-비디오 엔드포인트에는 audio 매개변수가 있으며 기본값은 true이므로, 비활성화하지 않으면 사운드가 영상과 함께 따라옵니다
• 텍스트-투-비디오 — 없음, 그리고 그것이 이 목록에서 유일하게 반대 방향으로 가는 항목이다
위의 모든 Vidu 수치는 공급업체 자체의 것이므로 그렇게 읽어야 합니다. 이 기사에서 독립적으로 측정된 단 하나의 숫자는 Elo이며, 그 Elo에서 Vidu Q4 Preview는 1,000표 더 적게 받고도 Grok Imagine Video 1.5보다 81점 앞서 있습니다. 81 Elo는 결합된 구간 폭의 약 다섯 배입니다. 그것은 오늘날 실재하는 격차이며 2026년 10월자입니다. 즉, Grok 점수들이 자리한 순간과는 다른 순간에 관한 격차라는 뜻입니다.

프리뷰 빌드는 공정한 상대인가?
Shengshu의 설명 방식은 이례적으로 직설적이다. Vidu Q4 Preview는 정식 Q4 모델보다 먼저 출시되어 창작자들이 실제 프로젝트에서 사용하고 최종 릴리스에 기여할 수 있게 했다. 가격은 프로모션 성격으로 설명된다. 최종 가격, 지원 해상도, 기능 제공 여부, 사용 약관은 요금제와 지역에 따라 달라질 수 있다. API 문서에는 잘못 입력된 별칭 viduq4-previerw, 올바른 viduq4-preview 옆에 나란히 자리하고 있는데, 이는 정식 출시된 제품이라면 보통 정리하고 프리뷰라면 보통 정리하지 않는 종류의 세부 사항이다.
그러니까 81 Elo는 해당 공급업체 스스로가 아직 최종판이 아니라고 말하는 빌드가, 같은 공급업체가 판촉 가격이라고 말하는 가격으로 얻은 점수입니다. 이 두 가지는 모두 Vidu에 유리하게 작용합니다 — 모델은 개선될 가능성이 높고 가격은 오를 가능성이 높습니다 — 하지만 두 수치 중 어느 것도 확약이 아니라는 뜻이기도 합니다. 이 페이지를 보고 예산을 편성하는 사람이라면 Q4 릴리스에서 요금이 바뀔 것에 대비해야 하며, 그때가 되면 순위가 아니라 보드를 다시 읽어야 합니다.
몇 주마다 바뀌는 프리뷰 빌드가 문제라면, 자동 페일오버가 바로 그런 경우를 위해 존재합니다: 200개 이상의 모델을 아우르는 하나의 OpenAI 호환 엔드포인트, 제공업체 정가가 그대로 전달되고 마크업이 추가되지 않아서, 프로모션 요금이 끝나는 일은 재협상이 아니라 한 줄 변경에 불과하며, 경로를 사용할 수 없게 되면 요청을 실패시키는 대신 폴백됩니다. 솔직히 말하자면 — Vidu Q4 Preview는 OrcaRouter 경로가 아니며, Grok Imagine Video도 아닙니다. 우리가 실제로 제공하는 비디오 모델은 MiniMax H3을 포함해 텍스트 모델과 동일한 키와 엔드포인트를 사용합니다.
좁은 답변
프레임이 입력이고 최고의 이미지-투-비디오 출력을 원한다면, Vidu Q4 Preview는 Grok Imagine Video의 현재 빌드보다 Elo가 81점 앞서면서 측정 단가도 더 낮으며, 가격 하한선 외에는 Grok 쪽을 지지할 강한 논거가 없습니다. 제법 괜찮은 점수를 내는 가장 저렴한 것을 원한다면, $4.20의 Grok Imagine Video 1월 빌드는 14,371표의 뒷받침을 받은 1,072 Elo를 갖춘, 잘 측정되었고 표도 충분히 확보한, 의도적으로 저렴한 선택지이며, Vidu에는 그 가격대에 아무것도 없습니다. 입력이 문장이라면, Grok 계열은 이 두 계열 중 방 안에 있는 유일한 계열입니다.
이것을 바꿀 수 있는 것: 정식 Vidu Q4 릴리스는 모드를 추가하거나 가격 격차를 좁힐 수 있고, 새로운 분류 체계와 새로운 투표 풀을 함께 선보인다고 발표된 AA-Video-I2V v2.0은 이 페이지의 모든 수치를 조정하는 것이 아니라 초기화할 것이다. 둘 중 하나가 실현되기 전까지 기억해 둘 만한 포지션은 표본 수가 말해 주는 것이다 — Vidu의 5,543표는 하루 된 것이고, Grok의 1월 빌드가 받은 14,371표는 아홉 달 된 것이며, 리더보드는 사진이지, 고정된 순위가 아니다.
