Una tarjeta de título generada para Vidu Q4 Preview vs Alibaba Wan 2.7, con el subtítulo «Dos modos contra cuatro variantes, y solo una tabla que comparten», con etiquetas que dicen «Vidu Q4 Preview — n.º 3, Elo 1.179», «Alibaba Wan 2.7 — n.º 13, Elo 1.077» y «Diferencia en imagen a vídeo: 102 Elo». El logotipo de OrcaRouter se encuentra en la franja con relleno de la esquina inferior derecha.
Guides & Insights

Vidu Q4 Preview vs. Alibaba Wan 2.7: dos modos frente a cuatro, y una tabla donde de verdad importa

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Here is the whole comparison in one line: Vidu Q4 Preview beats Ali​baba Wan 2.7 by 102 Elo on the Artificial Analysis image-to-video board, and cannot be entered against it on text-to-video or video editing, because Vidu Q4 Preview does not do either.

Both models launched in 2026 and both generate video with sound. Vidu Q4 Preview arrived on 7 October 2026 from Shengshu Technology as a first public preview ahead of the full Q4 model, in two modes — Image-to-Video and Reference-to-Video. Ali​baba Wan 2.7 shipped in April 2026 as a four-variant suite: text-to-video, image-to-video, reference-to-video and video edit, billed per second of generated video. So the tie-breaker in most head-to-head pages — a score — only exists on one of the axes, and the honest way to judge these two is to start by asking which axes you actually need.

El marcador, con los huecos a la vista

Artificial Analysis gestiona tres tablas de clasificación de vídeo independientes. Cada una tiene su propia escala Elo y su propio conjunto de votos, por lo que una puntuación de una no se transfiere a otra. Leído el 8 de octubre de 2026, de nuevo con el audio incluido:

• Image-to-video (AA-Video-I2V v1.0) — Vidu Q4 Preview 3rd, 1,179 ±10, 5,543 samples, Oct 2026, $7.20/min; Ali​baba Wan 2.7 13th, 1,077 ±8, 4,571 samples, Apr 2026, $9.00/min

• Texto a vídeo (AA-Video-T2V v2.0) — Vidu Q4 Preview no está presente; Wan2.7-260612 13.º-14.º, 1.030 ±9, 5.571 muestras, jun 2026, $9.00/min

• Edición de vídeo (AA-Video-Editing v1.1) — Vidu Q4 Preview no presente; Wan 2.7 7º, 1.074, 20.021 muestras, Abr 2026, $16,90/min

De esa tabla se desprenden dos cosas. Wan 2.7 es el más versátil de los dos por un margen amplio: es el único de ellos puntuado en las tres tablas, y su entrada de edición tiene el mayor número de votos de cualquier puntuación de Wan 2.7 en cualquier parte, con veinte mil muestras. Y en el único eje en el que coinciden, Vidu Q4 Preview gana por 102 Elo, lo que equivale aproximadamente a cinco veces la amplitud del intervalo de confianza de cualquiera de los dos modelos.

Una diferencia de 102 puntos no es un resultado menor. Para que se hagan una idea de la escala: la diferencia total entre los seis primeros puestos de la tabla de imagen a vídeo es de 21 Elo. Vidu Q4 Preview no está ligeramente por delante de Wan 2.7 en imagen a vídeo; está en otra categoría, y cuesta 1,80 $ menos por minuto, además de ser el lanzamiento más reciente. Si tu carga de trabajo es la de imagen a vídeo, la decisión no admite dudas, y la tabla independiente es la razón de que no las admita.

A generated two-column scoreboard for Vidu Q4 Preview and Alibaba Wan 2.7. Left column rows read 'I2V rank: #3, Elo 1,179', 'Modes: image, reference', 'Max clip: 16 seconds', 'Max resolution: 4K', 'Text-to-video: none' and 'Measured rate: $7.20 per minute'; right column rows read 'I2V rank: #13, Elo 1,077', 'Modes: four variants', 'Max clip: 15 seconds', 'Max resolution: 1080p', 'Text-to-video: yes' and 'Measured rate: $9.00 per minute'. A footer reads 'Ranks, Elo and rates per Artificial Analysis, 8 October 2026; modes, clip length and resolution are vendor-stated.' The OrcaRouter logo sits in the bottom-right padded strip.

Donde Wan 2.7 es el único de los dos que aparece

La documentación propia de Wan 2.7 señala dos áreas que aún necesitan trabajo: la calidad de audio y la precisión del texto en pantalla. Esa es la evaluación del proveedor, no la de un reseñador, y vale la pena tenerla en cuenta en cualquier comparación, porque ambos modelos hacen la misma afirmación principal: audio nativo generado con la imagen en lugar de añadido después.

The difference is in what happens by default. Vidu Q4 Preview's image-to-video endpoint carries an audio parameter that defaults to true: you get sound unless you turn it off, and turning it off is how you get a silent clip. Wan 2.7 does not document the same switch in the same place. If silent output matters to your pipeline — and for anything you plan to score separately, or d​ub into another language, it does — that asymmetry changes what your first integration pass looks like.

En la tabla de edición, el séptimo puesto de Wan 2.7 con 1.074 sobre 20.021 muestras es el resultado individual más sólido que cualquiera de los dos modelos ostenta en cualquier tabla por número de votos. Veinte mil votos son una medición con un peso real detrás, y ningún modelo Vidu aparece en esa tabla para compararlo con él. Si tu trabajo consiste en reajustar la temporalización o cambiar el estilo de metraje existente en lugar de generar tomas nuevas, Wan 2.7 es el único de los dos que resulta aplicable.

Alibaba Wan 2.7's Video Editing board entry, the single strongest result either model holds by vote count.

La brecha de especificación en el lado de la generación

En los puntos en que se solapan, los dos difieren en casi todas las dimensiones, y las diferencias no son simétricas en favor de Wan.

• Resolución máxima — Vidu Q4 Preview 4K (2K y 4K con color de 10 bits) frente a Wan 2.7 de hasta 1080p

• Duración máxima del clip — Vidu Q4 Preview 16 s (Imagen a vídeo 3-16 s, Referencia a vídeo 1-16 s) vs. Wan 2.7 hasta 15 s

• Imágenes de referencia — Vidu Q4 Preview hasta 15 en una sola configuración frente a Wan 2.7 hasta diez recursos

• Reference audio — Vidu Q4 Preview up to 3 clips for voice consistency vs not published to the same detail by Ali​baba

• Cobertura de tareas — Vidu Q4 Preview dos modos (imagen a video, referencia a video) vs Wan 2.7 cuatro variantes (añadiendo texto a video y edición de video)

• Tarifa de lista publicada — Vidu Q4 Preview desde $0.014/s (promocional); costo medido de $7.20/min en el panel independiente frente a Wan 2.7, $0.10-$0.15/s según la variante, $9.00/min medido

La línea de resolución es la que hay que sopesar con cuidado. La salida 4K a 10 bits supone una diferencia real en el entregable para cualquiera que haga el acabado para una pantalla o una pantalla grande, y no es una función que Wan 2.7 ofrezca en ninguna variante. Pero el 4K también es donde el precio por segundo suele dejar de parecerse al mínimo anunciado, y el propio material de lanzamiento de Vidu incluye la advertencia de que el precio final, las resoluciones compatibles, la disponibilidad de funciones y los términos de uso varían según el plan y la región.

Vidu Q4 Preview's product page open on Reference-to-Video, showing the reference-image and audio upload surface.

¿Cuál, según la carga de trabajo?

Si vas a animar imágenes fijas —tomas de producto, fotogramas de referencia de personajes, guiones gráficos—, Vidu Q4 Preview es el mejor modelo según la única evidencia independiente disponible, y con una tarifa medida más baja. Ese es el caso sencillo.

Si necesitas un solo contrato que cubra texto a vídeo, imagen a vídeo y edición, Wan 2.7 es el único de los dos que responde, y lo hace con un resultado de edición en séptimo puesto basado en el mayor número de votos que tiene cualquiera de los dos modelos. Consolidarse con un solo proveedor es un beneficio real, y esta comparación no pretende lo contrario.

If you need both, the cost of running two vendors is usually not the licence — it is the second integration, the second key, the second set of retry semantics, and the second schema to keep current. OrcaRouter collapses that: one OpenAI-compatible endpoint across 200-plus models, provider list prices passed through with no markup added, and automatic failover across providers. On the video side specifically we serve MiniMax H3, which is the model currently ranked first and second on the image-to-video board above — callable on the same endpoint and the same key as the text models. Neither Vidu Q4 Preview nor Ali​baba Wan 2.7 is an OrcaRouter route today, and this page should not be read as implying otherwise; what we can do is keep the rest of the workload on one integration so the video experiment is a line item rather than a project.

¿Qué cambiaría esto?

Vidu Q4 Preview es una versión preliminar. El precio es promocional, la compilación va por delante del lanzamiento completo del Q4 a decir del propio proveedor, y la documentación de la API todavía incluye un alias de modelo mal escrito junto al correcto. Importan dos desenlaces: si el lanzamiento completo del Q4 añade texto a vídeo, los ejes se colapsan y esto pasa a ser una comparación directa en tres tableros en lugar de uno; si no lo hace, la división se mantiene tal cual y la elección depende únicamente del perfil de la carga de trabajo.

Por otro lado, las muestras de Wan 2.7 en la tabla de imagen a video son cinco meses más antiguas que las de Vidu y unas mil menos. Ambos intervalos se reducirán. No debería considerarse fija la posición de ninguno de los modelos más allá de la fecha impresa junto a él.

La respuesta concreta: comparten exactamente un eje competitivo, Vidu Q4 Preview lo lidera con claridad a una tasa medida más baja, y Wan 2.7 gana por defecto en todo aquello donde Vidu no compite. La respuesta amplia es que un modelo de vista previa de dos modos y una suite de cuatro variantes no son realmente alternativas entre sí — son alternativas para distintos trabajos, y la parte útil de esta comparación es saber cuál es el trabajo que tienes.