Um cartão de título gerado para Vidu Q4 Preview vs Alibaba Wan 2.7, com o subtítulo 'Dois modos contra quatro variantes, e apenas um ranking que eles compartilham', com chips lendo 'Vidu Q4 Preview — #3, Elo 1.179', 'Alibaba Wan 2.7 — #13, Elo 1.077' e 'Diferença em imagem para vídeo: 102 Elo'. O logotipo da OrcaRouter fica na faixa com preenchimento no canto inferior direito.
Guides & Insights

Vidu Q4 Preview vs Alibaba Wan 2.7: Dois Modos Contra Quatro, e um Quadro Onde Isso Importa

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Here is the whole comparison in one line: Vidu Q4 Preview beats Ali​baba Wan 2.7 by 102 Elo on the Artificial Analysis image-to-video board, and cannot be entered against it on text-to-video or video editing, because Vidu Q4 Preview does not do either.

Both models launched in 2026 and both generate video with sound. Vidu Q4 Preview arrived on 7 October 2026 from Shengshu Technology as a first public preview ahead of the full Q4 model, in two modes — Image-to-Video and Reference-to-Video. Ali​baba Wan 2.7 shipped in April 2026 as a four-variant suite: text-to-video, image-to-video, reference-to-video and video edit, billed per second of generated video. So the tie-breaker in most head-to-head pages — a score — only exists on one of the axes, and the honest way to judge these two is to start by asking which axes you actually need.

O placar, com as lacunas deixadas visíveis

Artificial Analysis mantém três rankings de vídeo separados. Cada um tem sua própria escala Elo e seu próprio conjunto de votos, então uma pontuação de um não é transferível para outro. Consultado em 8 de outubro de 2026, novamente com o áudio incluído:

• Image-to-video (AA-Video-I2V v1.0) — Vidu Q4 Preview 3rd, 1,179 ±10, 5,543 samples, Oct 2026, $7.20/min; Ali​baba Wan 2.7 13th, 1,077 ±8, 4,571 samples, Apr 2026, $9.00/min

• {{1}}Text-to-AA-Video-T2V v2.0{{/1}} — V2 Q4 Preview não está presente; {{2}}Wan2.7-260612 13th-14th, 1,030 ±9, 5,571 samples, Jun 2026, $9.00/min{{/2}}

• Edição de vídeo (AA-Video-Editing v1.1) — Vidu Q4 Preview não presente; Wan 2.7 7º, 1.074, 20.021 amostras, Abr 2026, $16,90/min

Duas coisas decorrem dessa tabela. O Wan 2.7 é o mais versátil dos dois, por uma ampla margem — é o único deles pontuado nos três quadros, e sua entrada de edição tem a maior contagem de votos de qualquer pontuação do Wan 2.7 em qualquer lugar, vinte mil amostras. E no único eixo em que se encontram, o VQ4 Preview vence por 102 Elo, o que é cinco vezes a largura do intervalo de confiança de qualquer um dos modelos.

A diferença de 102 pontos não é um resultado pequeno. Para dar uma ideia de escala: toda a amplitude entre os seis primeiros lugares no ranking de imagem para vídeo é de 21 Elo. O Vidu Q4 Preview não está ligeiramente à frente do Wan 2.7 em imagem para vídeo; ele está em outro patamar, e custa US$ 1,80 por minuto menos, além de também ser o lançamento mais recente. Se a sua carga de trabalho for imagem para vídeo, a decisão não é acirrada, e o ranking independente é o motivo de ela não ser acirrada.

A generated two-column scoreboard for Vidu Q4 Preview and Alibaba Wan 2.7. Left column rows read 'I2V rank: #3, Elo 1,179', 'Modes: image, reference', 'Max clip: 16 seconds', 'Max resolution: 4K', 'Text-to-video: none' and 'Measured rate: $7.20 per minute'; right column rows read 'I2V rank: #13, Elo 1,077', 'Modes: four variants', 'Max clip: 15 seconds', 'Max resolution: 1080p', 'Text-to-video: yes' and 'Measured rate: $9.00 per minute'. A footer reads 'Ranks, Elo and rates per Artificial Analysis, 8 October 2026; modes, clip length and resolution are vendor-stated.' The OrcaRouter logo sits in the bottom-right padded strip.

Onde o Wan 2.7 é o único dos dois que aparece

A própria documentação do Wan 2.7 aponta duas áreas que ainda precisam de melhorias: qualidade de áudio e precisão do texto exibido na tela. Essa é a avaliação do fornecedor, não a de um crítico, e vale a pena levar isso em conta em qualquer comparação, porque ambos os modelos fazem a mesma afirmação de destaque — áudio nativo gerado junto com a imagem, em vez de adicionado depois.

The difference is in what happens by default. Vidu Q4 Preview's image-to-video endpoint carries an audio parameter that defaults to true: you get sound unless you turn it off, and turning it off is how you get a silent clip. Wan 2.7 does not document the same switch in the same place. If silent output matters to your pipeline — and for anything you plan to score separately, or d​ub into another language, it does — that asymmetry changes what your first integration pass looks like.

No ranking de edição, o sétimo lugar do Wan 2.7, com 1.074 de 20.021 amostras, é o resultado individual mais forte que qualquer um dos dois modelos detém em qualquer ranking por contagem de votos. Vinte mil votos são uma medição com peso real por trás, e nenhum modelo Vidu aparece nesse ranking para ser comparado a ele. Se o seu trabalho é reajustar o tempo ou reestilizar filmagens existentes, em vez de gerar novas tomadas, o Wan 2.7 é o único dos dois que se aplica.

Alibaba Wan 2.7's Video Editing board entry, the single strongest result either model holds by vote count.

A lacuna de especificação no lado da geração

Onde se sobrepõem, os dois divergem em quase todos os aspetos, e as diferenças não são simétricas a favor da Wan.

• Resolução máxima — Vidu Q4 Preview 4K (2K e 4K com cor de 10 bits) vs Wan 2.7 até 1080p

• Duração máxima do clipe — Vidu Q4 Preview 16s (Imagem para Vídeo 3-16s, Referência para Vídeo 1-16s) vs Wan 2.7 até 15s

• Imagens de referência — Vidu Q4 Preview até 15 em uma única configuração vs. Wan 2.7 até dez ativos

• Reference audio — Vidu Q4 Preview up to 3 clips for voice consistency vs not published to the same detail by Ali​baba

• Cobertura de tarefas — Vidu Q4 Preview com dois modos (imagem para vídeo, referência para vídeo) vs. Wan 2.7 com quatro variantes (adicionando texto para vídeo e edição de vídeo)

• Tarifa de tabela publicada — Vidu Q4 Preview a partir de $0,014/s em promoção; $7,20/min medidos no painel independente vs. Wan 2.7 $0,10–$0,15/s por variante, $9,00/min medidos

A linha da resolução é a que deve ser ponderada com cuidado. A saída em 4K a 10 bits é uma diferença real de entregável para quem faz a finalização para uma tela ou um grande monitor, e não é uma funcionalidade que o Wan 2.7 oferece em nenhuma variante. Mas o 4K é também onde o preço por segundo normalmente deixa de parecer o valor mínimo anunciado, e o próprio material de lançamento do Vidu traz a ressalva de que o preço final, as resoluções suportadas, a disponibilidade de funcionalidades e os termos de utilização variam conforme o plano e a região.

Vidu Q4 Preview's product page open on Reference-to-Video, showing the reference-image and audio upload surface.

Qual deles, por carga de trabalho

Se você está animando imagens estáticas — fotos de produto, frames de referência de personagens, storyboards — o Vidu Q4 Preview é o modelo melhor segundo a única evidência independente disponível, a um custo medido mais baixo. Esse é o caso evidente.

Se você precisa de um único contrato que cubra texto para vídeo, imagem para vídeo e edição, o Wan 2.7 é o único dos dois que atende, e o faz com um resultado de edição na sétima posição, baseado na maior contagem de votos que qualquer um dos dois modelos possui. Consolidar em um único fornecedor é um benefício real, e esta comparação não finge o contrário.

If you need both, the cost of running two vendors is usually not the licence — it is the second integration, the second key, the second set of retry semantics, and the second schema to keep current. OrcaRouter collapses that: one OpenAI-compatible endpoint across 200-plus models, provider list prices passed through with no markup added, and automatic failover across providers. On the video side specifically we serve MiniMax H3, which is the model currently ranked first and second on the image-to-video board above — callable on the same endpoint and the same key as the text models. Neither Vidu Q4 Preview nor Ali​baba Wan 2.7 is an OrcaRouter route today, and this page should not be read as implying otherwise; what we can do is keep the rest of the workload on one integration so the video experiment is a line item rather than a project.

O que mudaria isso?

Vidu Q4 Preview é uma prévia. O preço é promocional, a build está à frente do lançamento completo do Q4 segundo o próprio fornecedor, e a documentação da API ainda traz um alias de modelo digitado incorretamente ao lado do correto. Dois desfechos importam: se o lançamento completo do Q4 adicionar texto para vídeo, os eixos colapsam e isso se torna uma comparação direta em três rankings em vez de um; se não adicionar, a divisão permanece como está e a escolha é puramente sobre o perfil da carga de trabalho.

Por outro lado, as amostras do Wan 2.7 no ranking de imagem para vídeo são cinco meses mais antigas que as da Vidu e cerca de mil a menos. Ambos os intervalos diminuirão. O ranking de nenhum dos modelos deve ser tratado como fixo além da data impressa ao lado dele.

A resposta em sentido restrito: eles compartilham exatamente um eixo de concorrência, o Vidu Q4 Preview lidera com clareza nesse eixo a uma taxa medida mais baixa, e o Wan 2.7 vence por padrão em todos os pontos em que o Vidu não compete. A resposta em sentido amplo é que um modelo de pré-visualização de dois modos e um conjunto de quatro variantes não são realmente alternativas entre si — são alternativas para tarefas diferentes, e a parte útil desta comparação é saber qual é a sua tarefa.