Une carte de titre générée pour Vidu Q4 Preview vs Alibaba 2.7, sous-titrée « Deux modes face à quatre variantes, et un seul classement qu'ils partagent », avec des pastilles indiquant « Vidu Q4 Preview — #3, Elo 1 179 », « Alibaba Wan 2.7 — #13, Elo 1 077 » et « Écart en image-vers-vidéo : 102 Elo ». Le logo OrcaRouter se trouve dans la bande rembourrée en bas à droite.
Guides & Insights

Vidu Q4 Preview vs Alibaba Wan 2.6 : deux modes contre quatre, et un classement là où ça compte

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Voici la comparaison complète en une ligne : Vidu Q4 Previewbat Ali​baba Wan 2.7de 102 Elo sur le tableau image-to-video d'Artificial Analysis, et ne peut pas lui être comparé sur le text-to-video ni sur le montage vidéo, car Vidu Q4 Preview ne fait ni l'un ni l'autre.

Les deux modèles ont été lancés en 2026 et génèrent tous deux de la vidéo avec son. Vidu Q4 Preview est arrivé le 7 octobre 2026, par Shengshu Technology, comme première préversion publique avant le modèle Q4 complet, en deux modes — image-vers-vidéo et référence-vers-vidéo. Alibaba Wan 2.7 est sorti en avril 2026 sous la forme d'une suite à quatre variantes : texte-vers-vidéo, image-vers-vidéo, référence-vers-vidéo et édition vidéo, facturée à la seconde de vidéo générée. Le départage dans la plupart des pages de comparaison directe — un score — n'existe donc que sur l'un des axes, et la façon honnête de juger ces deux modèles est de commencer par se demander de quels axes vous avez réellement besoin.

Le tableau des scores, avec les écarts laissés visibles

Artificial Analysis gère trois classements vidéo distincts. Chacun possède sa propre échelle Elo et son propre vivier de votes, de sorte qu'un score obtenu dans l'un ne se transfère pas à un autre. À lire le 8 octobre 2026, là encore avec l'audio conservé :

• Image vers vidéo (AA-Video-I2V v1.0) — Vidu Q4 Preview 3e, 1 179 ±10, 5 543 échantillons, oct. 2026, 7,20 $/min ; Alibaba Wan 2.7 13e, 1 077 ±8, 4 571 échantillons, avr. 2026, 9,00 $/min

• Texte-vers-vidéo (AA-Video-T2V v2.0) — Vidu Q4 Preview absent ; Wan2.7-260612 13e-14e, 1 030 ±9, 5 571 échantillons, juin 2026, 9,00 $/min

• Montage vidéo (AA-Video-Editing v1.1) — Vidu Q4 Preview absent ; Wan 2.7 7e, 1 074, 20 021 échantillons, avr. 2026, 16,90 $/min

Deux choses découlent de ce tableau. Wan 2.7 est le plus polyvalent des deux, et de loin — c'est le seul des deux à être évalué sur les trois classements, et son entrée pour l’édition porte le plus grand nombre de votes de tous les scores de Wan 2.7, où que ce soit, avec vingt mille échantillons au compteur. Et sur le seul axe où ils se rencontrent, Vidu Q4 Preview l’emporte de 102 Elo, soit environ cinq fois la largeur de l’intervalle de confiance de l’un ou l’autre modèle.

L’écart de 102 points n’est pas un petit résultat. Pour donner une idée : l’écart total entre les six premières places du classement image-to-video est de 21 Elo. Vidu Q4 Preview n’a pas qu’une légère avance sur Wan 2.7 en image-to-video ; il est d’un autre niveau, et il coûte 1,80 $ par minute de moins tout en étant également la version la plus récente. Si l’image-to-video est votre charge de travail, la décision n’est pas serrée, et c’est le classement indépendant qui fait qu’elle ne l’est pas.

A generated two-column scoreboard for Vidu Q4 Preview and Alibaba Wan 2.7. Left column rows read 'I2V rank: #3, Elo 1,179', 'Modes: image, reference', 'Max clip: 16 seconds', 'Max resolution: 4K', 'Text-to-video: none' and 'Measured rate: $7.20 per minute'; right column rows read 'I2V rank: #13, Elo 1,077', 'Modes: four variants', 'Max clip: 15 seconds', 'Max resolution: 1080p', 'Text-to-video: yes' and 'Measured rate: $9.00 per minute'. A footer reads 'Ranks, Elo and rates per Artificial Analysis, 8 October 2026; modes, clip length and resolution are vendor-stated.' The OrcaRouter logo sits in the bottom-right padded strip.

Là où Wan 2.7 est le seul des deux à apparaître

La documentation de Wan 2.7 elle-même désigne deux domaines qui nécessitent encore des améliorations : la qualité audio et l'exactitude du texte à l'écran. Il s'agit de l'évaluation du fournisseur, et non de celle d'un critique, et il vaut la peine de la garder à l'esprit dans toute comparaison, car les deux modèles avancent la même promesse phare : un audio natif généré avec l'image plutôt qu'ajouté après coup.

La différence réside dans ce qui se passe par défaut. Le point de terminaison image-vers-vidéo de Vidu Q4 Preview comporte un paramètre audio dont la valeur par défaut est true : vous obtenez du son sauf si vous le désactivez, et c'est en le désactivant que vous obtenez un clip silencieux. Wan 2.7 ne documente pas le même interrupteur au même endroit. Si la sortie silencieuse importe pour votre pipeline — et pour tout ce que vous prévoyez de sonoriser séparément, ou de doubler dans une autre langue, elle importe — cette asymétrie change à quoi ressemble votre première passe d'intégration.

Sur le classement d’édition, la septième place de Wan 2.7 avec 1 074 sur 20 021 échantillons est le résultat le plus solide, tous classements confondus, en nombre de votes. Vingt mille votes constituent une mesure qui a un véritable poids, et aucun modèle Vidu n’apparaît dans ce classement pour établir une comparaison. Si votre travail consiste à retimer ou à restyler des séquences existantes plutôt qu’à générer de nouveaux plans, Wan 2.7 est le seul des deux qui s’applique.

Alibaba Wan 2.7's Video Editing board entry, the single strongest result either model holds by vote count.

L'écart de spécification du côté de la génération

Là où ils se recoupent, les deux diffèrent sur presque tous les plans, et les différences ne sont pas symétriques en faveur de Wan.

• Résolution maximale — Vidu Q4 Preview 4K (2K et 4K en couleur 10 bits) vs Wan 2.7 jusqu’à 1080p

• Durée maximale du clip — Vidu Q4 Preview 16 s (Image-to-Video 3-16 s, Reference-to-Video 1-16 s) vs Wan 2.7 jusqu’à 15 s

• Images de référence — Vidu Q4 Preview jusqu’à 15 dans une seule configuration vs Wan 2.7 jusqu’à dix ressources

• Audio de référence — Vidu Q4 Preview : jusqu’à 3 clips pour la cohérence vocale, contrairement à Alibaba, qui ne publie pas ce niveau de détail

• Couverture des tâches — Vidu Q4 Preview deux modes (image vers vidéo, référence vers vidéo) vs Wan 2.7 quatre variantes (ajout de texte vers vidéo et d'édition vidéo)

• Tarif catalogue publié — Vidu Q4 Preview à partir de 0,014 $/s en promotion ; mesuré à 7,20 $/min sur le classement indépendant, contre Wan 2.7 à 0,10–0,15 $/s selon la variante, 9,00 $/min mesuré

La ligne sur la résolution est celle à peser attentivement. La sortie 4K en 10 bits constitue une véritable différence au niveau du livrable pour quiconque finalise pour un écran ou un grand affichage, et ce n’est pas une fonctionnalité que Wan 2.7 propose, quelle que soit la variante. Mais la 4K est aussi le point où la tarification à la seconde cesse généralement de ressembler au prix plancher annoncé, et les propres documents de lancement de Vidu comportent la mise en garde selon laquelle la tarification finale, les résolutions prises en charge, la disponibilité des fonctionnalités et les conditions d’utilisation varient selon le forfait et la région.

Vidu Q4 Preview's product page open on Reference-to-Video, showing the reference-image and audio upload surface.

Lequel, selon la charge de travail ?

Si vous animez des images fixes — photos de produits, images de référence de personnages, storyboards —, Vidu Q4 Preview est le meilleur modèle selon la seule preuve indépendante disponible, à un tarif mesuré plus faible. C’est le cas le plus simple.

Si vous avez besoin d’un seul contrat couvrant le texte-vers-vidéo, l’image-vers-vidéo et le montage, Wan 2.7 est le seul des deux à répondre, et il le fait avec une septième place en montage reposant sur le plus grand nombre de votes que l’un ou l’autre des modèles ait obtenu. Consolider sur un seul fournisseur est un véritable avantage, et cette comparaison ne prétend pas le contraire.

Si vous avez besoin des deux, le coût d'exploitation de deux fournisseurs n'est généralement pas la licence : c'est la deuxième intégration, la deuxième clé, le deuxième ensemble de règles de réessai et le deuxième schéma à maintenir à jour. OrcaRouter élimine tout cela : un point de terminaison unique compatible OpenAI couvrant plus de 200 modèles, les tarifs publics des fournisseurs répercutés sans marge ajoutée, et une bascule automatique entre fournisseurs. Côté vidéo en particulier, nous servons MiniMax H3, le modèle actuellement classé premier et deuxième au classement image-vers-vidéo ci-dessus — appelable sur le même point de terminaison et avec la même clé que les modèles textuels. Ni Vidu Q4 Preview ni Alibaba Wan 2.7 ne figurent aujourd'hui parmi les routes OrcaRouter, et cette page ne doit pas être lue comme suggérant le contraire ; ce que nous pouvons faire, c'est maintenir le reste de la charge de travail sur une seule intégration, afin que l'expérience vidéo soit un simple poste budgétaire plutôt qu'un projet.

Qu’est-ce qui changerait cela ?

Vidu Q4 Preview est un aperçu. La tarification est promotionnelle, la build est en avance sur la sortie complète du Q4 de l'aveu même du fournisseur, et la documentation de l'API contient encore un alias de modèle mal orthographié à côté du bon. Deux issues comptent : si la sortie complète du Q4 ajoute le texte-vers-vidéo, les axes se confondent et cela devient une comparaison directe sur trois tableaux au lieu d'un ; sinon, la séparation reste en l'état et le choix ne concerne que la forme de la charge de travail.

De l'autre côté, les échantillons de Wan 2.7 sur le tableau image-vers-vidéo sont plus anciens de cinq mois que ceux de Vidu, et environ un millier de moins. Les deux intervalles se réduiront. Le rang d'aucun des deux modèles ne doit être considéré comme figé au-delà de la date imprimée à côté de lui.

La réponse étroite : ils partagent exactement un axe concurrentiel, Vidu Q4 Preview le domine clairement à un taux mesuré plus bas, et Wan 2.7 l’emporte par défaut partout où Vidu n’est pas en concurrence. La réponse large, c’est qu’un modèle de prévisualisation à deux modes et une suite à quatre variantes ne sont pas vraiment des alternatives l’un à l’autre — ce sont des alternatives pour des travaux différents, et la partie utile de cette comparaison est de savoir à quel travail vous avez affaire.