Una scheda del titolo generata per Vidu Q4 Preview vs Google Veo 3.1, sottotitolata "Tre livelli Veo, una build Vidu", con chip che recitano "Vidu Q4 Preview — Elo 1.179", "Veo 3.1 — Elo 1.082" e "Veo 3.1 Lite — Elo 1.071". Il logo OrcaRouter si trova nella striscia con padding in basso a destra.
Guides & Insights

Vidu Q4 Preview vs Google Veo 3.1: Veo vende tre livelli, e il divario tra loro è più piccolo del divario verso l'alto

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

GoogleVeo 3.1Nella classifica image-to-video di Artificial Analysis ottengono 1.082, 1.071 e 1.066 — sedici punti Elo lungo l'intervallo — mentre i loro prezzi al minuto variano di cinque volte, da 4,80 $ a 24,00 $. Vidu Q4 PreviewLeggi quei numeri in ordine e la domanda pratica smette di essere «quale livello di Veo» e diventa «perché comprarne uno qualsiasi» — che non è il confronto che scrivono quasi tutte le pagine, e merita la risposta specifica qui sotto anziché un'alzata di spalle.

Vidu Q4 Preview è stato rilasciato il 7 ottobre 2026 da Shengshu Technology come prima anteprima pubblica del suo flagship di prossima generazione, prima del rilascio completo di Q4, in due modalità: Image-to-Video e Reference-to-Video. Veo 3.1 è in circolazione da gennaio 2026, con un livello Lite aggiunto a marzo, e accetta sia prompt testuali sia immagini. Forme diverse, annate diverse, e un'unica board dove possono essere misurati l'uno contro l'altro.

A generated two-column scoreboard for Vidu Q4 Preview and Google Veo 3.1. Left column rows read 'Image-to-video Elo: 1,179', 'Tiers: one build', 'Text-to-video: none', 'Measured rate: $7.20 per minute', 'Provenance: none stated' and 'Max resolution: 4K'; right column rows read 'Image-to-video Elo: 1,082 / 1,071 / 1,066', 'Tiers: three', 'Text-to-video: yes', 'Measured rate: $24.00 / $9.00 / $4.80 per minute', 'Provenance: SynthID plus C2PA' and 'Max resolution: not stated'. A footer reads 'Elo and rates per Artificial Analysis, 8 October 2026; provenance per Google DeepMind.' The OrcaRouter logo sits in the bottom-right padded strip.

La scala dei tier di Veo, letta dal tabellone

Tutti i dati riportati di seguito sono di Artificial Analysis, letti l'8 ottobre 2026, con l'audio mantenuto attivo. Ogni classifica ha la propria scala Elo e il proprio bacino di voti, quindi i due blocchi non sono confrontabili tra loro — solo al loro interno.

Da immagine a video (AA-Video-I2V v1.0):

• Vidu Q4 Preview — 3°, 1.179 ±10, 5.543 campioni, ott 2026, 7,20 $/min

• Veo 3.1 — 12°, 1.082 ±7, 7.040 campioni, gen 2026, 24,00 $/min

• Veo 3.1 Lite — 15º, 1.071 ±8, 5.122 campioni, mar 2026, $4,80/min

• Veo 3.1 Fast — 18°, 1.066 ±6, 14.688 campioni, gen 2026, $9,00/min

Da testo a video (AA-Video-T2V v2.0):

• Veo 3.1 — 19°-21°, 962 ±10, 2.998 campioni, gen 2026, 24,00 $/min

• Veo 3.1 Fast — 20°, 961 ±10, 4.325 campioni, gen 2026, 7,20 $/min

• Veo 3.1 Lite — 22-25, 948 ±10, 2.903 campioni, mar 2026, $4,80/min

• Vidu Q4 Preview — non presente in questa scheda

I due blocchi raccontano la stessa storia da angolazioni diverse. Su image-to-video, i tre livelli di Veo si collocano all'interno di una fascia di sedici punti mentre il prezzo varia di un fattore cinque — quindi pagare cinque volte tanto per Veo 3.1 rispetto a Veo 3.1 Lite ti fa guadagnare undici Elo, ben all'interno degli intervalli ±7 e ±8 che quei due punteggi comportano. Su text-to-video la differenza è di quattordici punti nello stesso intervallo di prezzo quintuplo, e lì l'ordinamento è generoso verso il livello economico: Veo 3.1 Fast è un Elo dietro il modello di punta per un terzo del prezzo, con più voti a sostegno del suo numero.

La suddivisione in livelli di Google stesso è quindi per lo più una decisione di latenza e risoluzione, più che una scala di qualità, il che è una cosa ragionevole da vendere per un fornitore. Semplicemente non è ciò che la maggior parte degli articoli su «quale Veo» sostiene che sia.

The Artificial Analysis image-to-video board showing all three Veo 3.1 tiers and Vidu Q4 Preview on one scale.

Il paragone che regge davvero

Vidu Q4 Preview si trova 97 Elo sopra il miglior livello di Veo 3.1 nella classifica image-to-video, a 16,80 $ al minuto in meno, e 113 Elo sopra Veo 3.1 Fast. Questi margini sono da cinque a sette volte l'ampiezza degli intervalli in questione, quindi non si tratta di rumore.

L'obiezione ovvia è che qui si confronta un modello di ottobre 2026 con uno di gennaio 2026, e in effetti è così: è proprio questa la conclusione. Veo 3.1 ha otto mesi su questa classifica, l'ultima volta che i suoi livelli sono stati riorganizzati in modo significativo è stato quando Lite è arrivato a marzo, ed è stato superato da una build di anteprima di un laboratorio più piccolo a un prezzo inferiore. L'avviso della classifica stessa dice che negli ultimi 30 giorni sono stati aggiunti due modelli, e Vidu Q4 Preview è uno di essi.

Il contrappeso altrettanto ovvio: Vidu Q4 Preview non ha alcuna voce text-to-video, ed è lì che si collocano due dei tre livelli di Veo. Se il tuo carico di lavoro parte da un prompt scritto anziché da un fotogramma, nessuno di questi confronti si applica e la scala di Veo è l'unica delle due che risponde.

The Artificial Analysis text-to-video board, on which Vidu Q4 Preview has no entry.

Cosa ti offre Veo che Vidu non offre

C'è una dimensione in cui il divario è strutturale anziché numerico, e non ha nulla a che fare con Elo.

Goo​gle's Veo 3.1 output is watermarked with SynthID on every frame and carries C2PA content credentials recording that it was AI-generated, with a detector available in the Gem​ini app. That is not a feature you switch on; it is what the model produces. For anyone shipping into a market with disclosure requirements, working with a platform that screens for synthetic media, or simply wanting an audit trail of which shots were generated, this is a procurement difference that no benchmark will show you. It is also, on some workflows, a reason not to use it — a watermark you cannot disable is a constraint if your deliverable needs to pass as unmarked footage.

Vidu Q4 Preview non pubblica alcun meccanismo di watermarking o di provenienza di specificità comparabile. Questa è l'assenza di una dichiarazione, non una dichiarazione di assenza, e va registrata come tale.

Due asimmetrie più piccole che vale la pena mantenere:

• Audio predefinito — l'endpoint image-to-video di Vidu Q4 Preview ha un parametro audio impostato per impostazione predefinita su true, quindi ottieni l'audio insieme all'immagine a meno che tu non lo disattivi; Veo 3.1 considera l'audio come una decisione di livello a sé, con circa $0,40/s a Standard che lo include rispetto a molto meno per un output silenzioso

• Budget dei riferimenti — Vidu Q4 Preview accetta fino a 15 immagini di riferimento e fino a 3 clip audio di riferimento in Reference-to-Video; la gestione dei riferimenti di Veo 3.1 non è documentata a quel livello di dettaglio

Dove questo lascia la scelta

Se stai generando da un fotogramma fermo — un frame di prodotto, un riferimento di personaggio, un pannello di storyboard — la classifica indipendente colloca Vidu Q4 Preview in un tier diverso da ogni variante di Veo 3.1, a una frazione del prezzo del tier più alto, e la scala dei tier all'interno di Veo non lo salva. Questo è il risultato, ed è fondato su 5.543 voti contro 7.040, 5.122 e 14.688 rispettivamente. I conteggi dei voti sono reali; la posizione cambierà man mano che gli intervalli si restringono.

Se hai bisogno di provenienza integrata, text-to-video, o di un fornitore con la distribuzione e i termini enterprise di Goo​gle, Veo 3.1 è la risposta per ragioni che la tabella Elo non può esprimere e che non dovrebbero essere interpretate come prevalenti.

Se ti servono entrambi, l'aritmetica è una sola integrazione contro due. OrcaRouter esegue un endpoint compatibile con OpenAI su oltre 200 modelli con i prezzi di listino dei provider passati così come sono e senza alcun ricarico aggiunto, quindi una variazione di tariffa presso l'uno o l'altro fornitore compare nella tua fattura lo stesso giorno anziché al rinnovo, e il failover automatico tra provider significa che se una singola rotta diventa non disponibile non si porta dietro la richiesta. Né Vidu Q4 Preview né Veo 3.1 sono oggi una rotta di OrcaRouter — i modelli video che serviamo, incluso MiniMax H3, sono richiamabili su quello stesso endpoint — quindi la formulazione onesta è che possiamo mantenere stabile il livello di orchestrazione mentre decidi quale percorso di rendering vince, non che ospitiamo questi due.

La domanda che conta davvero

Veo 3.1 non è un modello scadente. È un modello di gennaio 2026 che è stato prezzato come un flagship mentre tre dei suoi stessi livelli convergono sullo stesso punteggio, e ora è stato misurato rispetto a un'anteprima di ottobre 2026 che batte la sua variante migliore con un margine più ampio dell'intera forbice interna di Veo.

Cosa cambierebbe il quadro: AA-Video-I2V v2.0 è annunciato in arrivo, allineato alla tassonomia di T2V v2.0 e con copertura 1080p ovunque. Una nuova esecuzione su una nuova board con nuovi pool di voti può rimescolare ognuna di queste posizioni, verso l'alto o verso il basso, ed entrambi i modelli andrebbero riletti su quella board anziché fidarsi dei numeri in questa pagina.

La risposta in senso stretto per chi ne vuole una: nell'unica classifica in cui compaiono entrambi, l'unica build di Vidu Q4 Preview si colloca più in alto di tutti e tre i livelli di Veo 3.1, e lo fa a $7,20 al minuto contro i $24,00 di Veo 3.1 Standard e i $9,00 di Veo 3.1 Fast — anche se non rispetto a Veo 3.1 Lite, l'unico livello di Veo che costa meno, a $4,80 al minuto e diciotto posizioni più in basso nella stessa classifica. La scala di livelli di Veo non è una scala di qualità, ed è questa la parte di questo confronto che vale la pena portare avanti. La risposta in senso ampio è che sono pensati per compiti diversi, e l'elemento decisivo è se il tuo input è una fotografia o una frase.