
Vidu Q4 Preview vs. Alibaba Wan 2.7: dos modos frente a cuatro, y una tabla donde de verdad importa
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Here is the whole comparison in one line: Vidu Q4 Preview beats Alibaba Wan 2.7 by 102 Elo on the Artificial Analysis image-to-video board, and cannot be entered against it on text-to-video or video editing, because Vidu Q4 Preview does not do either.
Both models launched in 2026 and both generate video with sound. Vidu Q4 Preview arrived on 7 October 2026 from Shengshu Technology as a first public preview ahead of the full Q4 model, in two modes — Image-to-Video and Reference-to-Video. Alibaba Wan 2.7 shipped in April 2026 as a four-variant suite: text-to-video, image-to-video, reference-to-video and video edit, billed per second of generated video. So the tie-breaker in most head-to-head pages — a score — only exists on one of the axes, and the honest way to judge these two is to start by asking which axes you actually need.
El marcador, con los huecos a la vista
Artificial Analysis gestiona tres tablas de clasificación de vídeo independientes. Cada una tiene su propia escala Elo y su propio conjunto de votos, por lo que una puntuación de una no se transfiere a otra. Leído el 8 de octubre de 2026, de nuevo con el audio incluido:
• Image-to-video (AA-Video-I2V v1.0) — Vidu Q4 Preview 3rd, 1,179 ±10, 5,543 samples, Oct 2026, $7.20/min; Alibaba Wan 2.7 13th, 1,077 ±8, 4,571 samples, Apr 2026, $9.00/min
• Texto a vídeo (AA-Video-T2V v2.0) — Vidu Q4 Preview no está presente; Wan2.7-260612 13.º-14.º, 1.030 ±9, 5.571 muestras, jun 2026, $9.00/min
• Edición de vídeo (AA-Video-Editing v1.1) — Vidu Q4 Preview no presente; Wan 2.7 7º, 1.074, 20.021 muestras, Abr 2026, $16,90/min
De esa tabla se desprenden dos cosas. Wan 2.7 es el más versátil de los dos por un margen amplio: es el único de ellos puntuado en las tres tablas, y su entrada de edición tiene el mayor número de votos de cualquier puntuación de Wan 2.7 en cualquier parte, con veinte mil muestras. Y en el único eje en el que coinciden, Vidu Q4 Preview gana por 102 Elo, lo que equivale aproximadamente a cinco veces la amplitud del intervalo de confianza de cualquiera de los dos modelos.
Una diferencia de 102 puntos no es un resultado menor. Para que se hagan una idea de la escala: la diferencia total entre los seis primeros puestos de la tabla de imagen a vídeo es de 21 Elo. Vidu Q4 Preview no está ligeramente por delante de Wan 2.7 en imagen a vídeo; está en otra categoría, y cuesta 1,80 $ menos por minuto, además de ser el lanzamiento más reciente. Si tu carga de trabajo es la de imagen a vídeo, la decisión no admite dudas, y la tabla independiente es la razón de que no las admita.

Donde Wan 2.7 es el único de los dos que aparece
La documentación propia de Wan 2.7 señala dos áreas que aún necesitan trabajo: la calidad de audio y la precisión del texto en pantalla. Esa es la evaluación del proveedor, no la de un reseñador, y vale la pena tenerla en cuenta en cualquier comparación, porque ambos modelos hacen la misma afirmación principal: audio nativo generado con la imagen en lugar de añadido después.
The difference is in what happens by default. Vidu Q4 Preview's image-to-video endpoint carries an audio parameter that defaults to true: you get sound unless you turn it off, and turning it off is how you get a silent clip. Wan 2.7 does not document the same switch in the same place. If silent output matters to your pipeline — and for anything you plan to score separately, or dub into another language, it does — that asymmetry changes what your first integration pass looks like.
En la tabla de edición, el séptimo puesto de Wan 2.7 con 1.074 sobre 20.021 muestras es el resultado individual más sólido que cualquiera de los dos modelos ostenta en cualquier tabla por número de votos. Veinte mil votos son una medición con un peso real detrás, y ningún modelo Vidu aparece en esa tabla para compararlo con él. Si tu trabajo consiste en reajustar la temporalización o cambiar el estilo de metraje existente en lugar de generar tomas nuevas, Wan 2.7 es el único de los dos que resulta aplicable.

La brecha de especificación en el lado de la generación
En los puntos en que se solapan, los dos difieren en casi todas las dimensiones, y las diferencias no son simétricas en favor de Wan.
• Resolución máxima — Vidu Q4 Preview 4K (2K y 4K con color de 10 bits) frente a Wan 2.7 de hasta 1080p
• Duración máxima del clip — Vidu Q4 Preview 16 s (Imagen a vídeo 3-16 s, Referencia a vídeo 1-16 s) vs. Wan 2.7 hasta 15 s
• Imágenes de referencia — Vidu Q4 Preview hasta 15 en una sola configuración frente a Wan 2.7 hasta diez recursos
• Reference audio — Vidu Q4 Preview up to 3 clips for voice consistency vs not published to the same detail by Alibaba
• Cobertura de tareas — Vidu Q4 Preview dos modos (imagen a video, referencia a video) vs Wan 2.7 cuatro variantes (añadiendo texto a video y edición de video)
• Tarifa de lista publicada — Vidu Q4 Preview desde $0.014/s (promocional); costo medido de $7.20/min en el panel independiente frente a Wan 2.7, $0.10-$0.15/s según la variante, $9.00/min medido
La línea de resolución es la que hay que sopesar con cuidado. La salida 4K a 10 bits supone una diferencia real en el entregable para cualquiera que haga el acabado para una pantalla o una pantalla grande, y no es una función que Wan 2.7 ofrezca en ninguna variante. Pero el 4K también es donde el precio por segundo suele dejar de parecerse al mínimo anunciado, y el propio material de lanzamiento de Vidu incluye la advertencia de que el precio final, las resoluciones compatibles, la disponibilidad de funciones y los términos de uso varían según el plan y la región.

¿Cuál, según la carga de trabajo?
Si vas a animar imágenes fijas —tomas de producto, fotogramas de referencia de personajes, guiones gráficos—, Vidu Q4 Preview es el mejor modelo según la única evidencia independiente disponible, y con una tarifa medida más baja. Ese es el caso sencillo.
Si necesitas un solo contrato que cubra texto a vídeo, imagen a vídeo y edición, Wan 2.7 es el único de los dos que responde, y lo hace con un resultado de edición en séptimo puesto basado en el mayor número de votos que tiene cualquiera de los dos modelos. Consolidarse con un solo proveedor es un beneficio real, y esta comparación no pretende lo contrario.
If you need both, the cost of running two vendors is usually not the licence — it is the second integration, the second key, the second set of retry semantics, and the second schema to keep current. OrcaRouter collapses that: one OpenAI-compatible endpoint across 200-plus models, provider list prices passed through with no markup added, and automatic failover across providers. On the video side specifically we serve MiniMax H3, which is the model currently ranked first and second on the image-to-video board above — callable on the same endpoint and the same key as the text models. Neither Vidu Q4 Preview nor Alibaba Wan 2.7 is an OrcaRouter route today, and this page should not be read as implying otherwise; what we can do is keep the rest of the workload on one integration so the video experiment is a line item rather than a project.
¿Qué cambiaría esto?
Vidu Q4 Preview es una versión preliminar. El precio es promocional, la compilación va por delante del lanzamiento completo del Q4 a decir del propio proveedor, y la documentación de la API todavía incluye un alias de modelo mal escrito junto al correcto. Importan dos desenlaces: si el lanzamiento completo del Q4 añade texto a vídeo, los ejes se colapsan y esto pasa a ser una comparación directa en tres tableros en lugar de uno; si no lo hace, la división se mantiene tal cual y la elección depende únicamente del perfil de la carga de trabajo.
Por otro lado, las muestras de Wan 2.7 en la tabla de imagen a video son cinco meses más antiguas que las de Vidu y unas mil menos. Ambos intervalos se reducirán. No debería considerarse fija la posición de ninguno de los modelos más allá de la fecha impresa junto a él.
La respuesta concreta: comparten exactamente un eje competitivo, Vidu Q4 Preview lo lidera con claridad a una tasa medida más baja, y Wan 2.7 gana por defecto en todo aquello donde Vidu no compite. La respuesta amplia es que un modelo de vista previa de dos modos y una suite de cuatro variantes no son realmente alternativas entre sí — son alternativas para distintos trabajos, y la parte útil de esta comparación es saber cuál es el trabajo que tienes.
