
Vidu Q4 Preview 対 Grok Imagine Video:1月にArenaをリードしたモデルが、今や9位に
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
この対戦を語る数字は3つあり、そのどれもスペック表ではない。Artificial Analysisのimage-to-videoボードでは、Vidu Q4が5,543票を背負って1,179で3位。Grok Imagine Video 1.5は1,098で9位。2026年1月版のGrok Imagine Videoは、今も掲載され自分の名前で呼び出せる状態なのに、1,072で14位——そして2つのGrokエントリの価格はそれぞれ毎分$8.40と$4.20、つまり新しいほうはEloがわずか26高いだけで、ちょうど2倍のコストがかかる。
Vidu Q4 Previewは1つのビルドで、2026年10月7日にShengshu Technologyによって、完全版Q4モデルに先立つ最初の公開プレビューとして、Image-to-VideoとReference-to-Videoの2つのモードでリリースされた。Grok Imagine Videoは、2つにまたがる少なくとも3つのエントリーを持つファミリーだ。この比較の本質は、9か月の間にリーダーボードの順位に何が起こるかにあり、Viduのリリースはその点を示すために現れたものだ。
同じモデルの2つのビルドで、Elo差は26。
Artificial Analysis、2026年10月8日閲覧、音声あり、画像から動画へのボード(AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3位、1,179 ±10、5,543 サンプル、2026年10月、$7.20/分
• Grok Imagine Video 1.5 — 9位、1,098 ±8、5,267サンプル、2026年5月、$8.40/分
• grok-imagine-video — 第14位、1,072 ±7、14,371サンプル、2026年1月、$4.20/分
そしてテキスト・トゥ・ビデオ(AA-Video-T2V v2.0)については、独自のスケールを持つ別のボードで:
• Grok Imagine Video 1.5 — 11位、1,045 ±9、4,056サンプル、2026年5月、$15.00
• Grok Imagine Video 1.5 Lite — 17~18位、993 ±10、5,715 サンプル、2026年8月、$8.40/分
• Vidu Q4 Preview — 存在しません
最初のブロックで目を引く点が2つある。Grok Imagine Videoの1月ビルドは、この比較のどのモデルよりも多くの票を集めている——14,371票で、Vidu Q4 Previewの5,543票のほぼ3倍、そして1.5ビルドのほぼ3倍だ。モデルが1月にアリーナのリーダーとして登場したとき、10月のサンプル数はこうなる。コミュニティはそれに大量に投票し、その後は止まった。スコアは安定しており、十分に測定されているが、もはやトップ付近にはない。
第二の点は価格の逆転です。Grok Imagine Video 1.5は、1月の前身モデルの2倍の分あたり料金で、Eloスコアは26上回っています。26 Eloは、±8と±7という2つの区間を合算した範囲のちょうど外側にあるため、改善はおそらく本物ですが、それは新しいアーキテクチャによるものではなく世代更新による差の種類であり、しかも倍の価格で販売されています。一方、Vidu Q4 Previewは1.5ビルドよりEloが81高く、価格はそれより低く、$7.20対$8.40です。これは、より新しいモデルが古いモデルを両方の軸で打ち負かしているということで、本来起こるべきことですが、これほどきれいに起こることはまれです。
第三の奇妙な点はボードの間に位置する。画像から動画への変換では1分あたり$8.40である同じGrok Imagine Video 1.5が、テキストから動画への変換では1分あたり$15.00であり、そこではもう一方のボードの尺度でもより低いスコアとなっている。Grokのワークロードを計画しているなら、選択する入力モダリティによって料金がおよそ80パーセント変わる。

Grok Imagine Videoが実際に提供してくれるもの
悪いモデルではないし、本記事もそうでないふりをするつもりはない。Vidu Q4 Previewにはできない、このモデルならではの2つのこと:
テキストプロンプトを受け取ります。Vidu Q4 Previewの製品ページには、Image-to-VideoとReference-to-Videoというちょうど2つのモードだけが記載されており、そのAPIドキュメントに載っているのも/ent/v2/img2videoと/ent/v2/reference2videoだけで、ほかには何もありません。テキスト-to-ビデオのエンドポイントは存在しません。Grok Imagine Video 1.5とそのLite版はどちらもtext-to-videoのボードに掲載されているため、パイプラインが書き起こしたプロンプトから始まるのであれば、この2つのモデルのうち片方は利用でき、もう片方は単に利用できません。
安価なティアがあります。画像から動画のボードでは、1月版は1分あたり$4.20で、同じボード上のVidu Q4 Previewの$7.20と対比されます。Liteティアの$8.40は、独自の尺度を持つ別のボードであるテキストから動画に位置します。大量生成を行っていて、5位ティア相当のスコアを受け入れられるなら、Grokファミリーの低価格帯はこの記事で最も安いものです — 1月版は$4.20で1,072 Eloを記録し、これはVidu Q4 Previewより107低いものの、1分あたり$3.00安いのです。

Vidu Q4 Previewでできること
この点におけるVidu側は、両者が共通する軸においてより強力な生成モデルであり、はるかに大きな参照バジェットを備えている。
• 解像度 — Vidu Q4 Preview は最大4K・10ビットカラー(2Kおよび4K)に対し、Grok Imagine Video はこれらの掲示板では4Kについて記載されていない
• クリップの長さ — Vidu Q4 Preview は画像から動画で3~16秒、参照から動画で1~16秒であるのに対し、Grok Imagine Video は同程度の詳細さでは公開されていない
• 参照入力 — Vidu Q4 Preview は最大15枚の参照画像と最大3つの参照音声クリップに対応、Grok Imagine Video ではそのレベルまで公開されていない
• 音声デフォルト — Vidu Q4 Previewの画像から動画へのエンドポイントにはaudioパラメータがあり、デフォルトでtrueに設定されているため、無効にしない限り映像と一緒に音声も届きます
• テキストから動画 — なし。そして、それがこのリストの中で唯一逆を行く項目だ
上記のViduの数値はすべてベンダー自身によるもので、そのように読むべきだ。この記事で独立に測定されている唯一の数値はEloであり、その点でVidu Q4 Previewは、投票数が1000少ないながら、Grok Imagine Video 1.5を81ポイント上回っている。81 Eloは、合算した区間幅のおよそ5倍に相当する。それは現時点で実在する差であり、日付は2026年10月だ。つまり、Grokのスコアが置かれている時点とは異なる時点についての差なのだ。

プレビュー版は公平ですか?
Shengshuの説明は異例なほど率直だ。Vidu Q4 Previewは、フルのQ4モデルより先に出荷され、クリエイターが実際のプロジェクトで使って最終リリースの形成に貢献できるようにした。価格はプロモーション価格と説明されている。最終的な価格、対応解像度、機能の提供状況、利用条件は、プランや地域によって異なる場合がある。APIドキュメントには、誤って入力されたエイリアス、viduq4-previerwが、正しいviduq4-previewの隣に並んでいる。これは、出荷済みの製品なら通常はきれいに直されるが、プレビュー版では通常そうならない類の細部だ。
つまり、その81 Eloは、ベンダー自身が最終版ではないと述べているビルドによって、ベンダー自身がプロモーション価格だと述べている価格で獲得されたものだ。これらの点はどちらもViduに有利に働く——モデルは改善する可能性が高く、価格は上がる可能性が高い——が、同時に、どちらの数字も確約ではないことも意味している。このページから予算を組む人は、Q4リリースで料金が動くことを想定して計画し、その際にはランクではなくボードを読み直すべきだ。
数週間ごとに切り替わるプレビュービルドが問題だというのなら、まさにそのために自動フェイルオーバーは存在します:200超のモデルに対応する単一のOpenAI互換エンドポイントで、プロバイダーの定価をそのまま通し、マークアップは一切追加しません。だからプロモーション料金が終了しても再交渉ではなく明細の1行が変わるだけであり、あるルートが利用不可になってもリクエストが失敗するのではなくフォールスルーします。カバレッジについて正直に言えば——Vidu Q4 PreviewはOrcaRouterのルートではなく、Grok Imagine Videoも同様です。私たちが実際に提供している動画モデルは、MiniMax H3を含め、テキストモデルと同じキーとエンドポイント上にあります。
その狭い答え
最高のimage-to-video出力が欲しくて、入力がフレームなら、Vidu Q4 PreviewはGrok Imagine Videoの現行ビルドよりEloで81上、しかも実測レートはより安い。Grok側を支持する強い論拠は、価格の下限以外にはない。そこそこ評価される最安のものが欲しいなら、$4.20のGrok Imagine Videoの1月ビルドは、14,371票でElo 1,072、よく測定され、よく投票され、意図的に安くされた選択肢であり、Viduにはその価格帯のものは何もない。入力が文なら、この場にいる2つのファミリーのうち一方だけが該当し、それはGrokファミリーだ。
{{1}}それを変えるもの:Vidu Q4の完全リリース、{{2}}これはモードを追加したり価格差を縮めたりする可能性がある;そしてAA-Video-I2V v2.0は、新しい分類法と新たな投票プールを伴って登場すると発表されており、このページのすべての数字を調整するのではなくリセットすることになる。どちらかが実現するまでは、覚えておく価値のある順位は、サンプル数が教えてくれるものだ — Viduの5,543票は1日前のもので、Grokの1月ビルドの14,371票は9か月前のものであり、リーダーボードは写真であって、順位ではない。{{/2}}{{/1}}
