
Vidu Q4 Preview vs Google Veo 3.1: Veo vende tre livelli, e il divario tra loro è più piccolo del divario verso l'alto
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
GoogleVeo 3.1Nella classifica image-to-video di Artificial Analysis ottengono 1.082, 1.071 e 1.066 — sedici punti Elo lungo l'intervallo — mentre i loro prezzi al minuto variano di cinque volte, da 4,80 $ a 24,00 $. Vidu Q4 PreviewLeggi quei numeri in ordine e la domanda pratica smette di essere «quale livello di Veo» e diventa «perché comprarne uno qualsiasi» — che non è il confronto che scrivono quasi tutte le pagine, e merita la risposta specifica qui sotto anziché un'alzata di spalle.
Vidu Q4 Preview è stato rilasciato il 7 ottobre 2026 da Shengshu Technology come prima anteprima pubblica del suo flagship di prossima generazione, prima del rilascio completo di Q4, in due modalità: Image-to-Video e Reference-to-Video. Veo 3.1 è in circolazione da gennaio 2026, con un livello Lite aggiunto a marzo, e accetta sia prompt testuali sia immagini. Forme diverse, annate diverse, e un'unica board dove possono essere misurati l'uno contro l'altro.

La scala dei tier di Veo, letta dal tabellone
Tutti i dati riportati di seguito sono di Artificial Analysis, letti l'8 ottobre 2026, con l'audio mantenuto attivo. Ogni classifica ha la propria scala Elo e il proprio bacino di voti, quindi i due blocchi non sono confrontabili tra loro — solo al loro interno.
Da immagine a video (AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3°, 1.179 ±10, 5.543 campioni, ott 2026, 7,20 $/min
• Veo 3.1 — 12°, 1.082 ±7, 7.040 campioni, gen 2026, 24,00 $/min
• Veo 3.1 Lite — 15º, 1.071 ±8, 5.122 campioni, mar 2026, $4,80/min
• Veo 3.1 Fast — 18°, 1.066 ±6, 14.688 campioni, gen 2026, $9,00/min
Da testo a video (AA-Video-T2V v2.0):
• Veo 3.1 — 19°-21°, 962 ±10, 2.998 campioni, gen 2026, 24,00 $/min
• Veo 3.1 Fast — 20°, 961 ±10, 4.325 campioni, gen 2026, 7,20 $/min
• Veo 3.1 Lite — 22-25, 948 ±10, 2.903 campioni, mar 2026, $4,80/min
• Vidu Q4 Preview — non presente in questa scheda
I due blocchi raccontano la stessa storia da angolazioni diverse. Su image-to-video, i tre livelli di Veo si collocano all'interno di una fascia di sedici punti mentre il prezzo varia di un fattore cinque — quindi pagare cinque volte tanto per Veo 3.1 rispetto a Veo 3.1 Lite ti fa guadagnare undici Elo, ben all'interno degli intervalli ±7 e ±8 che quei due punteggi comportano. Su text-to-video la differenza è di quattordici punti nello stesso intervallo di prezzo quintuplo, e lì l'ordinamento è generoso verso il livello economico: Veo 3.1 Fast è un Elo dietro il modello di punta per un terzo del prezzo, con più voti a sostegno del suo numero.
La suddivisione in livelli di Google stesso è quindi per lo più una decisione di latenza e risoluzione, più che una scala di qualità, il che è una cosa ragionevole da vendere per un fornitore. Semplicemente non è ciò che la maggior parte degli articoli su «quale Veo» sostiene che sia.

Il paragone che regge davvero
Vidu Q4 Preview si trova 97 Elo sopra il miglior livello di Veo 3.1 nella classifica image-to-video, a 16,80 $ al minuto in meno, e 113 Elo sopra Veo 3.1 Fast. Questi margini sono da cinque a sette volte l'ampiezza degli intervalli in questione, quindi non si tratta di rumore.
L'obiezione ovvia è che qui si confronta un modello di ottobre 2026 con uno di gennaio 2026, e in effetti è così: è proprio questa la conclusione. Veo 3.1 ha otto mesi su questa classifica, l'ultima volta che i suoi livelli sono stati riorganizzati in modo significativo è stato quando Lite è arrivato a marzo, ed è stato superato da una build di anteprima di un laboratorio più piccolo a un prezzo inferiore. L'avviso della classifica stessa dice che negli ultimi 30 giorni sono stati aggiunti due modelli, e Vidu Q4 Preview è uno di essi.
Il contrappeso altrettanto ovvio: Vidu Q4 Preview non ha alcuna voce text-to-video, ed è lì che si collocano due dei tre livelli di Veo. Se il tuo carico di lavoro parte da un prompt scritto anziché da un fotogramma, nessuno di questi confronti si applica e la scala di Veo è l'unica delle due che risponde.

Cosa ti offre Veo che Vidu non offre
C'è una dimensione in cui il divario è strutturale anziché numerico, e non ha nulla a che fare con Elo.
Google's Veo 3.1 output is watermarked with SynthID on every frame and carries C2PA content credentials recording that it was AI-generated, with a detector available in the Gemini app. That is not a feature you switch on; it is what the model produces. For anyone shipping into a market with disclosure requirements, working with a platform that screens for synthetic media, or simply wanting an audit trail of which shots were generated, this is a procurement difference that no benchmark will show you. It is also, on some workflows, a reason not to use it — a watermark you cannot disable is a constraint if your deliverable needs to pass as unmarked footage.
Vidu Q4 Preview non pubblica alcun meccanismo di watermarking o di provenienza di specificità comparabile. Questa è l'assenza di una dichiarazione, non una dichiarazione di assenza, e va registrata come tale.
Due asimmetrie più piccole che vale la pena mantenere:
• Audio predefinito — l'endpoint image-to-video di Vidu Q4 Preview ha un parametro audio impostato per impostazione predefinita su true, quindi ottieni l'audio insieme all'immagine a meno che tu non lo disattivi; Veo 3.1 considera l'audio come una decisione di livello a sé, con circa $0,40/s a Standard che lo include rispetto a molto meno per un output silenzioso
• Budget dei riferimenti — Vidu Q4 Preview accetta fino a 15 immagini di riferimento e fino a 3 clip audio di riferimento in Reference-to-Video; la gestione dei riferimenti di Veo 3.1 non è documentata a quel livello di dettaglio
Dove questo lascia la scelta
Se stai generando da un fotogramma fermo — un frame di prodotto, un riferimento di personaggio, un pannello di storyboard — la classifica indipendente colloca Vidu Q4 Preview in un tier diverso da ogni variante di Veo 3.1, a una frazione del prezzo del tier più alto, e la scala dei tier all'interno di Veo non lo salva. Questo è il risultato, ed è fondato su 5.543 voti contro 7.040, 5.122 e 14.688 rispettivamente. I conteggi dei voti sono reali; la posizione cambierà man mano che gli intervalli si restringono.
Se hai bisogno di provenienza integrata, text-to-video, o di un fornitore con la distribuzione e i termini enterprise di Google, Veo 3.1 è la risposta per ragioni che la tabella Elo non può esprimere e che non dovrebbero essere interpretate come prevalenti.
Se ti servono entrambi, l'aritmetica è una sola integrazione contro due. OrcaRouter esegue un endpoint compatibile con OpenAI su oltre 200 modelli con i prezzi di listino dei provider passati così come sono e senza alcun ricarico aggiunto, quindi una variazione di tariffa presso l'uno o l'altro fornitore compare nella tua fattura lo stesso giorno anziché al rinnovo, e il failover automatico tra provider significa che se una singola rotta diventa non disponibile non si porta dietro la richiesta. Né Vidu Q4 Preview né Veo 3.1 sono oggi una rotta di OrcaRouter — i modelli video che serviamo, incluso MiniMax H3, sono richiamabili su quello stesso endpoint — quindi la formulazione onesta è che possiamo mantenere stabile il livello di orchestrazione mentre decidi quale percorso di rendering vince, non che ospitiamo questi due.
La domanda che conta davvero
Veo 3.1 non è un modello scadente. È un modello di gennaio 2026 che è stato prezzato come un flagship mentre tre dei suoi stessi livelli convergono sullo stesso punteggio, e ora è stato misurato rispetto a un'anteprima di ottobre 2026 che batte la sua variante migliore con un margine più ampio dell'intera forbice interna di Veo.
Cosa cambierebbe il quadro: AA-Video-I2V v2.0 è annunciato in arrivo, allineato alla tassonomia di T2V v2.0 e con copertura 1080p ovunque. Una nuova esecuzione su una nuova board con nuovi pool di voti può rimescolare ognuna di queste posizioni, verso l'alto o verso il basso, ed entrambi i modelli andrebbero riletti su quella board anziché fidarsi dei numeri in questa pagina.
La risposta in senso stretto per chi ne vuole una: nell'unica classifica in cui compaiono entrambi, l'unica build di Vidu Q4 Preview si colloca più in alto di tutti e tre i livelli di Veo 3.1, e lo fa a $7,20 al minuto contro i $24,00 di Veo 3.1 Standard e i $9,00 di Veo 3.1 Fast — anche se non rispetto a Veo 3.1 Lite, l'unico livello di Veo che costa meno, a $4,80 al minuto e diciotto posizioni più in basso nella stessa classifica. La scala di livelli di Veo non è una scala di qualità, ed è questa la parte di questo confronto che vale la pena portare avanti. La risposta in senso ampio è che sono pensati per compiti diversi, e l'elemento decisivo è se il tuo input è una fotografia o una frase.
