
Vidu Q4 Preview vs Grok Imagine Video: il modello che a gennaio guidava l'Arena ora è nono
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Tre numeri descrivono questo confronto, e nessuno di essi è una scheda tecnica. Sulla classifica image-to-video di Artificial Analysis, Vidu Q4 Previewoccupa la terza posizione a 1.179 con 5.543 voti alle spalle. Grok Imagine Video 1.5occupa la nona posizione a 1.098. La versione di gennaio 2026 di Grok Imagine Video, ancora presente in elenco e ancora richiamabile con il proprio nome, occupa la quattordicesima posizione a 1.072 — e le due voci Grok hanno un prezzo rispettivamente di 8,40 $ e 4,20 $ al minuto, il che significa che quella più recente costa esattamente il doppio per ventisei punti Elo in più.
Vidu Q4 Preview è una build, rilasciata il 7 ottobre 2026 da Shengshu Technology come prima anteprima pubblica in vista del modello Q4 completo, in due modalità: Image-to-Video e Reference-to-Video. Grok Imagine Video è una famiglia con almeno tre voci su due classifiche. Il confronto riguarda in realtà ciò che accade a una posizione in classifica nell'arco di nove mesi, e il rilascio di Vidu è l'elemento che è arrivato a dimostrarlo.
Due build dello stesso modello, a ventisei punti Elo di distanza
Artificial Analysis, consultato l'8 ottobre 2026, audio mantenuto, classifica image-to-video (AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3°, 1.179 ±10, 5.543 campioni, ott 2026, 7,20 $/min
• Grok Imagine Video 1.5 — 9°, 1.098 ±8, 5.267 campioni, maggio 2026, 8,40 $/min
• grok-imagine-video — 14°, 1.072 ±7, 14.371 campioni, gen 2026, 4,20 $/min
E sul text-to-video (AA-Video-T2V v2.0), una classifica separata con una propria scala:
• Grok Imagine Video 1.5 — 11°, 1.045 ±9, 4.056 campioni, maggio 2026, 15,00 $/min
• Grok Imagine Video 1.5 Lite — 17-18, 993 ±10, 5.715 campioni, ago 2026, 8,40 $/min
• Vidu Q4 Preview — non presente
Due cose saltano all'occhio nel primo blocco. La build di gennaio di Grok Imagine Video ha il maggior numero di voti di qualsiasi modello in questo confronto — 14.371, quasi tre volte i 5.543 di Vidu Q4 Preview e quasi tre volte quelli della build 1.5. Quando un modello viene lanciato come leader dell'arena a gennaio, ecco come appare il conteggio dei campioni a ottobre: la community ha votato su di esso in modo estensivo, per poi fermarsi. Il punteggio è stabile e ben misurato e non è più vicino alla vetta.
La seconda cosa è l'inversione di prezzo. Grok Imagine Video 1.5 ha una tariffa al minuto doppia rispetto al suo predecessore di gennaio ed è avanti di ventisei Elo. Ventisei Elo è appena fuori dai due intervalli combinati — ±8 e ±7 — quindi il miglioramento è probabilmente reale, ma è il tipo di margine che deriva da un aggiornamento generazionale piuttosto che da una nuova architettura, e viene venduto al doppio. Nel frattempo Vidu Q4 Preview è ottantuno Elo sopra la build 1.5 e ha un prezzo inferiore, a $7,20 contro $8,40. Questo è un modello più recente che batte uno più vecchio su entrambi gli assi, cosa che dovrebbe succedere e raramente accade in modo così netto.
La terza stranezza sta tra le due tabelle. Lo stesso Grok Imagine Video 1.5 che costa $8,40 al minuto per image-to-video costa $15,00 al minuto per text-to-video, dove ottiene anche un punteggio inferiore secondo la scala dell'altra tabella. Se stai pianificando un carico di lavoro con Grok, la modalità di input che scegli cambia la tariffa di circa l'ottanta per cento.

Cosa ti offre davvero Grok Imagine Video
Non è un brutto modello e questo articolo non fingerà il contrario. Due cose che fa che Vidu Q4 Preview non fa:
Richiede prompt testuali. La pagina prodotto di Vidu Q4 Preview elenca esattamente due modalità — Image-to-Video e Reference-to-Video — e la sua API documenta /ent/v2/img2video e /ent/v2/reference2video e nient'altro. Non esiste alcun endpoint text-to-video. Grok Imagine Video 1.5 e il suo fratello Lite compaiono entrambi nella scheda text-to-video, quindi se la tua pipeline parte da un prompt scritto, uno di questi due modelli è disponibile per te e l'altro semplicemente non lo è.
Ha una fascia economica. Nella classifica image-to-video, la build di gennaio è a 4,20 $ al minuto contro i 7,20 $ di Vidu Q4 Preview su quella stessa classifica; gli 8,40 $ della fascia Lite si trovano su text-to-video, una classifica separata con una propria scala. Se generi volumi elevati e puoi accettare un punteggio da quinta fascia, la fascia bassa della famiglia Grok è la cosa più economica in questo articolo — la build di gennaio a 4,20 $ totalizza 1.072 Elo, ovvero 107 in meno di Vidu Q4 Preview, ma anche 3,00 $ al minuto in meno.

Cosa ti offre Vidu Q4 Preview
Il lato Vidu di questa faccenda è un modello di generazione più potente sull'asse che condividono, e un budget di riferimento molto più ampio.
• Risoluzione — Vidu Q4 Preview fino a 4K con colore a 10 bit (2K e 4K) vs Grok Imagine Video non documentato a 4K in queste classifiche
• Durata clip — Vidu Q4 Preview 3-16s per Image-to-Video e 1-16s per Reference-to-Video vs Grok Imagine Video non pubblicato con lo stesso livello di dettaglio
• Input di riferimento — Vidu Q4 Preview: fino a 15 immagini di riferimento e fino a 3 clip audio di riferimento, mentre per Grok Imagine Video non è pubblicato a quel livello
• Audio predefinito — l'endpoint image-to-video di Vidu Q4 Preview include un parametro audio il cui valore predefinito è true, quindi il suono arriva insieme all'immagine a meno che tu non lo disattivi
• Da testo a video — assente, ed è l'unica voce di questo elenco che va nella direzione opposta
Ogni dato di Vidu sopra riportato è del fornitore stesso e va letto come tale. L'unico numero in questo articolo misurato in modo indipendente è l'Elo, e su questo Vidu Q4 Preview è avanti di ottantuno punti rispetto a Grok Imagine Video 1.5, con mille voti in meno. Ottantuno punti Elo corrispondono all'incirca a cinque volte l'ampiezza dell'intervallo combinato. È un divario reale oggi ed è datato ottobre 2026, il che significa che è un divario relativo a un momento diverso da quello in cui si collocano i punteggi di Grok.

Una build di anteprima è un avversario leale?
L'impostazione di Shengshu è insolitamente diretta: Vidu Q4 Preview è stato rilasciato prima del modello Q4 completo, così che i creatori potessero usarlo in progetti reali e contribuire a plasmare la versione finale. Il prezzo è descritto come promozionale. Il prezzo finale, le risoluzioni supportate, la disponibilità delle funzionalità e le condizioni d'uso possono variare in base al piano e alla regione. La documentazione API contiene un alias con un refuso, viduq4-previerw, accanto a quello corretto viduq4-preview, ed è il genere di dettaglio che un prodotto già rilasciato di solito sistema e un'anteprima di solito no.
Quindi gli ottantuno Elo sono stati guadagnati da una build che il suo stesso fornitore dichiara non definitiva, a un prezzo che il suo stesso fornitore dichiara promozionale. Entrambe queste precisazioni giocano a favore di Vidu — il modello è probabilmente destinato a migliorare e il prezzo è probabilmente destinato a — ma significano anche che nessuno dei due numeri costituisce un impegno. Chiunque pianifichi un budget basandosi su questa pagina dovrebbe prevedere che la tariffa cambi in occasione della release del Q4, e quando ciò accadrà dovrebbe rileggere la classifica anziché la posizione.
Se la build di anteprima che cambia ogni poche settimane è il problema, è esattamente il caso per cui esiste il failover automatico: un unico endpoint compatibile con OpenAI su oltre 200 modelli, con i prezzi di listino dei provider passati così come sono e senza alcun ricarico, così la fine di una tariffa promozionale è la modifica di una voce di costo anziché una rinegoziazione, e una rotta che diventa non disponibile viene aggirata invece di far fallire la richiesta. Siamo chiari sulla copertura: Vidu Q4 Preview non è una rotta di OrcaRouter, e non lo è nemmeno Grok Imagine Video. I modelli video che serviamo, incluso MiniMax H3, si trovano sulla stessa chiave e sullo stesso endpoint dei modelli testuali.
La risposta ristretta
Se vuoi il miglior output da immagine a video e il tuo input è un fotogramma, Vidu Q4 Preview ha ottantuno Elo di vantaggio rispetto all'attuale build di Grok Imagine Video a una tariffa misurata inferiore, e non c'è un forte argomento a favore del lato Grok al di là del prezzo minimo. Se vuoi la cosa più economica che ottiene un punteggio rispettabile, la build di gennaio di Grok Imagine Video a $4,20 con 1.072 Elo e 14.371 voti a supporto è un'opzione ben misurata, ben votata e deliberatamente economica, e Vidu non ha nulla a quel prezzo. Se il tuo input è una frase, la famiglia Grok è l'unica delle due famiglie presenti.
Cosa lo cambierebbe: il rilascio completo di Vidu Q4, che potrebbe aggiungere modalità o ridurre il divario di prezzo; e AA-Video-I2V v2.0, annunciato come in arrivo con una nuova tassonomia e un nuovo bacino di voti, che azzererebbe ogni numero su questa pagina invece di modificarlo. Finché uno dei due non arriva, la posizione che vale la pena ricordare è quella che ti dicono i conteggi dei campioni — i 5.543 voti di Vidu risalgono a un giorno fa, i 14.371 della build di gennaio di Grok risalgono a nove mesi fa, e una classifica è una fotografia, non una posizione permanente.
