Una card del titolo generata per Vidu Q4 Preview vs Alibaba Wan 2.7, con sottotitolo 'Due modalità contro quattro varianti, e una sola classifica che condividono', con chip che recitano 'Vidu Q4 Preview — #3, Elo 1.179', 'Alibaba Wan 2.7 — #13, Elo 1.077' e 'Divario su image-to-video: 102 Elo'. Il logo OrcaRouter si trova nella fascia con padding in basso a destra.
Guides & Insights

Vidu Q4 Preview vs Alibaba Wan 2.7: Due modalità contro quattro, e una classifica dove conta

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Here is the whole comparison in one line: Vidu Q4 Preview beats Ali​baba Wan 2.7 by 102 Elo on the Artificial Analysis image-to-video board, and cannot be entered against it on text-to-video or video editing, because Vidu Q4 Preview does not do either.

Both models launched in 2026 and both generate video with sound. Vidu Q4 Preview arrived on 7 October 2026 from Shengshu Technology as a first public preview ahead of the full Q4 model, in two modes — Image-to-Video and Reference-to-Video. Ali​baba Wan 2.7 shipped in April 2026 as a four-variant suite: text-to-video, image-to-video, reference-to-video and video edit, billed per second of generated video. So the tie-breaker in most head-to-head pages — a score — only exists on one of the axes, and the honest way to judge these two is to start by asking which axes you actually need.

Il tabellone, con gli spazi lasciati visibili

Artificial Analysis gestisce tre classifiche video separate. Ognuna ha la propria scala Elo e il proprio bacino di voti, quindi un punteggio di una non è trasferibile a un'altra. Consultato l'8 ottobre 2026, di nuovo con l'audio mantenuto:

• Image-to-video (AA-Video-I2V v1.0) — Vidu Q4 Preview 3rd, 1,179 ±10, 5,543 samples, Oct 2026, $7.20/min; Ali​baba Wan 2.7 13th, 1,077 ±8, 4,571 samples, Apr 2026, $9.00/min

• Da testo a video (AA-Video-T2V v2.0) — Vidu Q4 Preview non presente; Wan2.7-260612 13°-14°, 1.030 ±9, 5.571 campioni, giu 2026, 9,00 $/min

• Montaggio video (AA-Video-Editing v1.1) — Vidu Q4 Preview non presente; Wan 2.7 7°, 1.074, 20.021 campioni, apr 2026, 16,90 $/min

Da quella tabella discendono due cose. Wan 2.7 è di gran lunga il più versatile dei due: è l’unico dei due a essere valutato su tutte e tre le classifiche, e la sua voce relativa all’editing registra il conteggio voti più alto di qualsiasi punteggio di Wan 2.7 in assoluto, con ventimila campioni. E sull’unico asse in cui si incontrano, Vidu Q4 Preview vince di 102 punti Elo, che è all’incirca cinque volte l’ampiezza dell’intervallo di confidenza di entrambi i modelli.

Il divario di 102 punti non è un risultato di poco conto. Per dare un'idea delle proporzioni: l'intera forbice tra le prime sei posizioni della classifica image-to-video è di 21 Elo. Vidu Q4 Preview non è marginalmente davanti a Wan 2.7 su image-to-video; è di un altro livello, e costa 1,80 $ al minuto in meno, oltre a essere il rilascio più recente. Se image-to-video è il tuo carico di lavoro, la decisione è netta, e la classifica indipendente è il motivo per cui è netta.

A generated two-column scoreboard for Vidu Q4 Preview and Alibaba Wan 2.7. Left column rows read 'I2V rank: #3, Elo 1,179', 'Modes: image, reference', 'Max clip: 16 seconds', 'Max resolution: 4K', 'Text-to-video: none' and 'Measured rate: $7.20 per minute'; right column rows read 'I2V rank: #13, Elo 1,077', 'Modes: four variants', 'Max clip: 15 seconds', 'Max resolution: 1080p', 'Text-to-video: yes' and 'Measured rate: $9.00 per minute'. A footer reads 'Ranks, Elo and rates per Artificial Analysis, 8 October 2026; modes, clip length and resolution are vendor-stated.' The OrcaRouter logo sits in the bottom-right padded strip.

Dove Wan 2.7 è l'unico dei due che compare

La documentazione di Wan 2.7 indica due aree che necessitano ancora di lavoro: la qualità audio e l'accuratezza del testo a schermo. Questa è la valutazione del fornitore, non di un recensore, e vale la pena tenerla presente in qualsiasi confronto, perché entrambi i modelli avanzano la stessa promessa principale — audio nativo generato insieme all'immagine anziché aggiunto a posteriori.

The difference is in what happens by default. Vidu Q4 Preview's image-to-video endpoint carries an audio parameter that defaults to true: you get sound unless you turn it off, and turning it off is how you get a silent clip. Wan 2.7 does not document the same switch in the same place. If silent output matters to your pipeline — and for anything you plan to score separately, or d​ub into another language, it does — that asymmetry changes what your first integration pass looks like.

Nella classifica di editing, il settimo posto di Wan 2.7 con 1.074 su 20.021 campioni è il risultato singolo più forte che uno dei due modelli detenga su qualsiasi classifica per numero di voti. Ventimila voti sono una misura con un peso reale alle spalle, e nessun modello Vidu compare su quella classifica per poter essere confrontato con esso. Se il tuo lavoro consiste nel modificare il timing o lo stile di filmati esistenti anziché generare nuove inquadrature, Wan 2.7 è l'unico dei due che si applica.

Alibaba Wan 2.7's Video Editing board entry, the single strongest result either model holds by vote count.

Il divario di specifica sul fronte della generazione

Laddove si sovrappongono, i due differiscono su quasi ogni dimensione, e le differenze non sono simmetriche a favore di Wan.

• Risoluzione massima — Vidu Q4 Preview 4K (2K e 4K con colore a 10 bit) vs Wan 2.7 fino a 1080p

• Durata massima della clip — Vidu Q4 Preview 16s (Da immagine a video 3-16s, Da riferimento a video 1-16s) vs Wan 2.7 fino a 15s

• Immagini di riferimento — Vidu Q4 Preview fino a 15 in una singola configurazione rispetto a Wan 2.7 fino a dieci asset

• Reference audio — Vidu Q4 Preview up to 3 clips for voice consistency vs not published to the same detail by Ali​baba

• Copertura delle attività — Vidu Q4 Preview due modalità (da immagine a video, da riferimento a video) vs Wan 2.7 quattro varianti (con l'aggiunta di da testo a video e modifica video)

• Tariffa di listino pubblicata — Vidu Q4 Preview da $0,014/s in promozione; misurati $7,20/min sulla board indipendente rispetto a Wan 2.7 $0,10-$0,15/s a seconda della variante, $9,00/min misurati

La questione della risoluzione è quella da valutare attentamente. L'output 4K a 10 bit rappresenta una differenza reale nel prodotto consegnabile per chiunque finalizzi per uno schermo o un grande display, e non è una funzionalità che Wan 2.7 offra su nessuna variante. Ma il 4K è anche il punto in cui il prezzo al secondo di solito smette di sembrare il minimo pubblicizzato, e il materiale di lancio di Vidu stesso contiene l'avvertenza che il prezzo finale, le risoluzioni supportate, la disponibilità delle funzionalità e i termini di utilizzo variano in base al piano e alla regione.

Vidu Q4 Preview's product page open on Reference-to-Video, showing the reference-image and audio upload surface.

Quale, in base al carico di lavoro

Se stai animando immagini fisse — scatti di prodotto, frame di riferimento dei personaggi, storyboard — Vidu Q4 Preview è il modello migliore secondo l'unica evidenza indipendente disponibile, a una tariffa misurata inferiore. Questo è il caso più semplice.

Se hai bisogno di un unico contratto che copra text-to-video, image-to-video ed editing, Wan 2.7 è l'unico dei due a rispondere, e lo fa con un risultato nell'editing al settimo posto, basato sul maggior numero di voti ottenuto da uno dei due modelli. Consolidare su un unico fornitore è un vantaggio concreto e questo confronto non pretende il contrario.

If you need both, the cost of running two vendors is usually not the licence — it is the second integration, the second key, the second set of retry semantics, and the second schema to keep current. OrcaRouter collapses that: one OpenAI-compatible endpoint across 200-plus models, provider list prices passed through with no markup added, and automatic failover across providers. On the video side specifically we serve MiniMax H3, which is the model currently ranked first and second on the image-to-video board above — callable on the same endpoint and the same key as the text models. Neither Vidu Q4 Preview nor Ali​baba Wan 2.7 is an OrcaRouter route today, and this page should not be read as implying otherwise; what we can do is keep the rest of the workload on one integration so the video experiment is a line item rather than a project.

Cosa cambierebbe questo

Vidu Q4 Preview è un'anteprima. Il prezzo è promozionale, la build è più avanzata rispetto al rilascio completo del Q4 per stessa ammissione del fornitore, e la documentazione API contiene ancora un alias del modello digitato in modo errato accanto a quello corretto. Contano due esiti: se il rilascio completo del Q4 aggiunge il text-to-video, gli assi collassano e questo diventa un confronto diretto su tre classifiche invece di una; in caso contrario, la divisione resta com'è e la scelta riguarda esclusivamente la forma del carico di lavoro.

D'altro canto, i campioni di Wan 2.7 sulla board image-to-video sono cinque mesi più vecchi di quelli di Vidu e circa un migliaio in meno. Entrambi gli intervalli si restringeranno. La posizione in classifica di nessuno dei due modelli va considerata fissa oltre la data stampata accanto ad essa.

La risposta in senso stretto: condividono esattamente un asse competitivo, Vidu Q4 Preview è chiaramente in testa a un tasso misurato inferiore, e Wan 2.7 vince per impostazione predefinita ovunque Vidu non sia in competizione. La risposta in senso lato è che un modello preview a due modalità e una suite a quattro varianti non sono davvero alternative tra loro — sono alternative a lavori diversi, e la parte utile di questo confronto è sapere quale lavoro hai.