
Vidu Q4 Preview vs. Grok Imagine Video: Das Modell, das im Januar die Arena anführte, steht jetzt auf Platz neun
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Drei Zahlen beschreiben diesen Vergleich, und keine davon ist ein Datenblatt. Auf dem Image-to-Video-Board von Artificial Analysis, Vidu Q4 Preview liegt mit 1.179 auf Platz drei, mit 5.543 Stimmen. Grok Imagine Video 1.5 liegt mit 1.098 auf Platz neun. Der Januar-2026-Build von Grok Imagine Video, weiterhin gelistet und weiterhin unter eigenem Namen aufrufbar, liegt mit 1.072 auf Platz vierzehn – und die beiden Grok-Einträge kosten 8,40 bzw. 4,20 US-Dollar pro Minute, was bedeutet, dass der neuere für 26 Elo-Punkte mehr genau doppelt so viel kostet.
Vidu Q4 Preview ist ein Build, veröffentlicht am 7. Oktober 2026 von Shengshu Technology als erste öffentliche Vorschau vor dem vollständigen Q4-Modell, in zwei Modi: Image-to-Video und Reference-to-Video. Grok Imagine Video ist eine Familie mit mindestens drei Einträgen über zwei Boards hinweg. Bei dem Vergleich geht es eigentlich darum, was mit einer Leaderboard-Position über neun Monate hinweg geschieht, und die Vidu-Veröffentlichung ist das, was eintraf, um genau das zu verdeutlichen.
Zwei Builds des gleichen Modells, sechsundzwanzig Elo auseinander
Artificial Analysis, gelesen am 8. Oktober 2026, Audio beibehalten, Bild-zu-Video-Board (AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3., 1.179 ±10, 5.543 Samples, Okt. 2026, 7,20 $/Min.
• Grok Imagine Video 1.5 — 9., 1.098 ±8, 5.267 Stichproben, Mai 2026, 8,40 $/Min.
• grok-imagine-video — 14., 1.072 ±7, 14.371 Samples, Jan. 2026, 4,20 $/Min.
Und bei Text-zu-Video (AA-Video-T2V v2.0), ein separates Board mit eigener Skala:
• Grok Imagine Video 1.5 — 11., 1.045 ±9, 4.056 Samples, Mai 2026, 15,00 $/Min.
• Grok Imagine Video 1.5 Lite — 17.–18., 993 ±10, 5.715 Samples, Aug. 2026, 8,40 $/Min.
• Vidu Q4 Preview — nicht vorhanden
Zwei Dinge stechen im ersten Block hervor. Der Januar-Build von Grok Imagine Video hat die meisten Stimmen aller Modelle in diesem Vergleich — 14.371, fast dreimal so viele wie die 5.543 von Vidu Q4 Preview und fast dreimal so viele wie die des 1.5-Builds. Wenn ein Modell im Oktober als Arena-Leader an den Start ging: Die Community hat ausgiebig darüber abgestimmt und dann aufgehört. Der Score ist stabil und gut gemessen und nicht mehr nahe an der Spitze.
Der zweite Punkt ist die Preisinversion. Grok Imagine Video 1.5 hat den doppelten Minutenpreis seines Vorgängers vom Januar und liegt 26 Elo vor ihm. 26 Elo liegen knapp außerhalb der beiden Intervalle zusammengenommen – ±8 und ±7 –, die Verbesserung ist also wahrscheinlich echt, aber es ist die Art von Vorsprung, die aus einer Generationsauffrischung statt aus einer neuen Architektur stammt, und es wird zum doppelten Preis verkauft. Derweil liegt Vidu Q4 Preview 81 Elo über dem 1.5-Build und wird darunter angeboten, bei 7,20 $ gegenüber 8,40 $. Das ist ein frischeres Modell, das ein älteres auf beiden Achsen schlägt, was eigentlich passieren soll und selten so sauber passiert.
Die dritte Merkwürdigkeit liegt zwischen den Boards. Dasselbe Grok Imagine Video 1.5, das bei Image-to-Video 8,40 $ pro Minute kostet, kostet bei Text-to-Video 15,00 $ pro Minute, wo es nach der Skala des anderen Boards außerdem niedriger abschneidet. Wenn Sie eine Grok-Workload planen, verändert die von Ihnen gewählte Eingabemodalität den Tarif um rund achtzig Prozent.

Was Grok Imagine Video dir tatsächlich bietet
Es ist kein schlechtes Modell, und dieser Artikel wird nicht so tun, als wäre es anders. Zwei Dinge, die es tut, die Vidu Q4 Preview nicht tut:
Es nimmt Text-Prompts entgegen. Die Produktseite von Vidu Q4 Preview listet genau zwei Modi auf – Image-to-Video und Reference-to-Video – und seine API dokumentiert /ent/v2/img2video und /ent/v2/reference2video und sonst nichts. Es gibt keinen Text-to-Video-Endpunkt. Grok Imagine Video 1.5 und sein Lite-Pendant erscheinen beide auf dem Text-to-Video-Board. Wenn Ihre Pipeline also mit einem geschriebenen Prompt beginnt, steht Ihnen eines dieser beiden Modelle zur Verfügung und das andere schlicht nicht.
Es hat eine günstige Tarifstufe. Auf dem Image-to-Video-Board kostet der Januar-Build 4,20 $ pro Minute, gegenüber 7,20 $ für Vidu Q4 Preview auf demselben Board; die Lite-Stufe mit 8,40 $ liegt bei Text-to-Video, einem separaten Board mit eigener Skala. Wenn Sie in großem Umfang generieren und eine Punktzahl auf dem Niveau des fünften Platzes akzeptieren können, ist das untere Ende der Grok-Familie die günstigste Option in diesem Artikel – der Januar-Build mit 4,20 $ kommt auf 1.072 Elo, was 107 unter Vidu Q4 Preview liegt, aber auch 3,00 $ pro Minute günstiger ist.

Was Vidu Q4 Preview dir bietet
Die Vidu-Seite davon ist ein stärkeres Generierungsmodell auf der Achse, die beide teilen, und ein deutlich größeres Referenzbudget.
• Auflösung — Vidu Q4 Preview bis zu 4K bei 10-Bit-Farbe (2K und 4K) vs. Grok Imagine Video, auf diesen Boards nicht in 4K dokumentiert
• Cliplänge — Vidu Q4 Preview: 3-16s für Image-to-Video und 1-16s für Reference-to-Video im Vergleich zu Grok Imagine Video, das nicht mit derselben Detailtiefe veröffentlicht ist
• Referenzeingaben — Vidu Q4 Preview mit bis zu 15 Referenzbildern und bis zu 3 Referenz-Audioclips im Vergleich zu nicht in diesem Umfang veröffentlicht für Grok Imagine Video
• Audio-Standard — der Image-to-Video-Endpunkt von Vidu Q4 Preview enthält einen audio-Parameter, der standardmäßig auf true gesetzt ist, sodass der Ton zusammen mit dem Bild ankommt, sofern du ihn nicht deaktivierst
• Text-zu-Video – nicht vorhanden, und das ist der eine Punkt auf dieser Liste, der in die andere Richtung geht
Jede oben aufgeführte Vidu-Zahl ist eine Angabe des Anbieters selbst und sollte auch als solche gelesen werden. Die einzige Zahl in diesem Artikel, die unabhängig gemessen wurde, ist der Elo-Wert, und bei diesem liegt Vidu Q4 Preview mit tausend weniger Stimmen einundachtzig Punkte vor Grok Imagine Video 1.5. Einundachtzig Elo sind ungefähr das Fünffache der kombinierten Intervallbreite. Es ist heute eine echte Lücke, und sie ist auf Oktober 2026 datiert, was bedeutet, dass es eine Lücke zu einem anderen Zeitpunkt ist als dem, in dem die Grok-Werte liegen.

Ist ein Preview-Build ein fairer Gegner?
Shengshus Formulierung ist ungewöhnlich direkt: Vidu Q4 Preview wurde vor dem vollständigen Q4-Modell veröffentlicht, damit Creator es in echten Projekten nutzen und die endgültige Version mitgestalten konnten. Der Preis wird als Aktionspreis angegeben. Endgültige Preise, unterstützte Auflösungen, Funktionsverfügbarkeit und Nutzungsbedingungen können je nach Tarif und Region variieren. In der API-Dokumentation steht ein falsch geschriebener Alias, viduq4-previerw, direkt neben dem korrekten viduq4-preview – genau die Art von Detail, die ein ausgeliefertes Produkt normalerweise bereinigt und eine Vorschau normalerweise nicht.
Also wurde die einundachtzig Elo von einem Build erzielt, das sein eigener Anbieter als nicht final bezeichnet, zu einem Preis, den sein eigener Anbieter als Aktionspreis bezeichnet. Beide dieser Punkte sprechen für Vidu — das Modell wird sich wahrscheinlich verbessern und der Preis wird wahrscheinlich steigen —, aber sie bedeuten auch, dass keine der beiden Zahlen verbindlich ist. Wer auf Basis dieser Seite budgetiert, sollte damit rechnen, dass sich der Wert mit dem Q4-Release ändert, und sollte dann das Board statt den Rang neu lesen.
Wenn der Preview-Build, der alle paar Wochen wechselt, das Problem ist, dann ist das genau der Fall, für den automatisches Failover existiert: ein OpenAI-kompatibler Endpunkt über mehr als 200 Modelle hinweg, wobei die Listenpreise der Anbieter durchgereicht und keine Aufschläge aufgeschlagen werden, sodass das Auslaufen eines Aktionspreises eine Änderung an einer einzelnen Position ist statt einer Neuverhandlung, und eine Route, die nicht mehr verfügbar ist, fällt durch, statt dass die Anfrage scheitert. Um ehrlich bei der Abdeckung zu sein — Vidu Q4 Preview ist keine OrcaRouter-Route, und Grok Imagine ebenso wenig. Die Videomodelle, die wir tatsächlich bedienen, darunter MiniMax H3, laufen über denselben Schlüssel und Endpunkt wie der Text.
Die enge Antwort
Wenn Sie die beste Bild-zu-Video-Ausgabe wollen und Ihre Eingabe ein Frame ist, liegt Vidu Q4 Preview mit einundachtzig Elo vor dem aktuellen Build von Grok Imagine Video und das bei einer niedrigeren gemessenen Rate, und es gibt kein starkes Argument für die Grok-Seite außer der Preisuntergrenze. Wenn Sie das Billigste wollen, das respektabel abschneidet, ist der Januar-Build von Grok Imagine Video für $4,20 mit 1.072 Elo, gestützt auf 14.371 Stimmen, eine gut gemessene, gut durch Stimmen gestützte, bewusst günstige Option, und Vidu hat nichts zu diesem Preis. Wenn Ihre Eingabe ein Satz ist, ist die Grok-Familie die einzige der beiden Familien im Raum.
Was daran etwas ändern würde: das vollständige Vidu-Q4-Release, das Modi hinzufügen oder die Preislücke verkleinern könnte; und AA-Video-I2V v2.0, angekündigt mit einer neuen Taxonomie und einem frischen Abstimmungspool, das jede Zahl auf dieser Seite zurücksetzen statt anpassen würde. Bis eines von beiden erscheint, ist die Position, die es sich zu merken lohnt, diejenige, die Ihnen die Stichprobenzahlen verraten — Vidus 5.543 Stimmen sind einen Tag alt, die 14.371 des Januar-Builds von Grok sind neun Monate alt, und eine Rangliste ist eine Momentaufnahme, kein Dauerzustand.
