Ett genererat titelkort för Vidu Q4 Preview vs Alibaba Wan 2.7, med undertexten ”Två lägen mot fyra varianter, och endast en resultattavla som de delar”, med chips som lyder ”Vidu Q4 Preview — #3, Elo 1 179”, ”Alibaba Wan 2.7 — #13, Elo 1 077” och ”Gap på bild-till-video: 102 Elo”. OrcaRouter-logotypen sitter i den nedre högra remsan med padding.
Guides & Insights

Vidu Q4 Preview vs Alibaba Wan 2.7: Två lägen mot fyra, och en resultattavla där det räknas

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Här är hela jämförelsen på en rad: Vidu Q4 Preview slår Alibaba Wan 2.7 med 102 Elo på Artificial Analysis-tavlan för bild-till-video, och kan inte ställas mot den i text-till-video eller videoredigering, eftersom Vidu Q4 Preview inte gör något av dem.

Båda modellerna lanserades 2026 och båda genererar video med ljud. Vidu Q4 Preview kom den 7 oktober 2026 från Shengshu Technology som en första offentlig förhandsvisning inför den fullständiga Q4-modellen, i två lägen – bild-till-video och referens-till-video. Ali​baba Wan 2.7 släpptes i april 2026 som en svit med fyra varianter: text-till-video, bild-till-video, referens-till-video och videoredigering, med fakturering per sekund genererad video. Så utslagsgivaren på de flesta head-to-head-sidor – en poäng – finns bara på en av axlarna, och det ärliga sättet att bedöma dessa två är att börja med att fråga vilka axlar du faktiskt behöver.

Resultattavlan, med luckorna kvar synliga

Artificial Analysis driver tre separata videotopplistor. Var och en har sin egen Elo-skala och sin egen röstpool, så en poäng från en överförs inte till en annan. Läst den 8 oktober 2026, återigen med ljudet kvar:

• Bild-till-video (AA-Video-I2V v1.0) — Vidu Q4 Preview 3:e, 1 179 ±10, 5 543 prover, okt 2026, 7,20 $/min; Alibaba Wan 2.7 13:e, 1 077 ±8, 4 571 prover, apr 2026, 9,00 $/min

• Text-till-video (AA-Video-T2V v2.0) — Vidu Q4 Preview saknas; Wan2.7-260612 13:e–14:e, 1 030 ±9, 5 571 prover, juni 2026, 9,00 $/min

• Videoredigering (AA-Video-Editing v1.1) — Vidu Q4 Preview saknas; Wan 2.7 på 7:e plats, 1 074, 20 021 sampel, apr 2026, 16,90 $/min

Två saker följer av den tabellen. Wan 2.7 är den mest mångsidiga av de två med bred marginal – det är den enda av dem som har poängsatts på alla tre tavlorna, och dess redigeringspost har det största röstantalet av alla Wan 2.7-poäng någonstans, tjugotusen prover djupt. Och på den enda axel där de möts vinner Vidu Q4 Preview med 102 Elo, vilket är ungefär fem gånger bredden på endera modellens konfidensintervall.

Gapet på 102 poäng är inte ett litet resultat. För att sätta det i perspektiv: hela spridningen över de sex främsta platserna på bild-till-video-tavlan är 21 Elo. Vidu Q4 Preview ligger inte marginellt före Wan 2.7 inom bild-till-video; den ligger på en annan nivå, och den kostar 1,80 dollar per minut mindre samtidigt som den också är den nyare utgåvan. Om bild-till-video är din arbetsbelastning är beslutet inte svårt, och den oberoende resultattavlan är anledningen till att det inte är svårt.

A generated two-column scoreboard for Vidu Q4 Preview and Alibaba Wan 2.7. Left column rows read 'I2V rank: #3, Elo 1,179', 'Modes: image, reference', 'Max clip: 16 seconds', 'Max resolution: 4K', 'Text-to-video: none' and 'Measured rate: $7.20 per minute'; right column rows read 'I2V rank: #13, Elo 1,077', 'Modes: four variants', 'Max clip: 15 seconds', 'Max resolution: 1080p', 'Text-to-video: yes' and 'Measured rate: $9.00 per minute'. A footer reads 'Ranks, Elo and rates per Artificial Analysis, 8 October 2026; modes, clip length and resolution are vendor-stated.' The OrcaRouter logo sits in the bottom-right padded strip.

Där Wan 2.7 är den enda av de två som dyker upp

Wan 2.7:s egen dokumentation pekar ut två områden som fortfarande behöver förbättras: ljudkvalitet och noggrannhet i text på skärmen. Det är leverantörens bedömning, inte en granskares, och den är värd att ta med sig in i varje jämförelse, eftersom båda modellerna gör samma stora anspråk – inbyggt ljud som genereras tillsammans med bilden i stället för att läggas till i efterhand.

Skillnaden ligger i vad som händer som standard. Vidu Q4 Previews bild-till-video-endpoint har en ljudparameter som standard är true: du får ljud om du inte stänger av det, och att stänga av det är hur du får ett ljudlöst klipp. Wan 2.7 dokumenterar inte samma växel på samma ställe. Om tyst utdata är viktigt för din pipeline – och det gäller allt du planerar att sätta musik till separat eller dubba till ett annat språk – förändrar den asymmetrin hur din första integrationsomgång ser ut.

På redigeringstavlan är Wan 2.7:s sjunde plats med 1 074 över 20 021 prover det starkaste enskilda resultat som endera modellen har på någon tavla räknat i antal röster. Tjugotusen röster är en mätning med verklig tyngd bakom sig, och ingen Vidu-modell finns på den tavlan att jämföra den med. Om ditt arbete går ut på att ändra timingen eller stilen på befintligt filmmaterial i stället för att generera nya tagningar, är Wan 2.7 den enda av de två som är relevant.

Alibaba Wan 2.7's Video Editing board entry, the single strongest result either model holds by vote count.

Specifikationsgapet på generationssidan

Där de överlappar varandra skiljer de två sig åt i nästan varje avseende, och skillnaderna är inte symmetriska till Wans fördel.

• Maximal upplösning — Vidu Q4 Preview 4K (2K och 4K i 10-bitars färg) jämfört med Wan 2.7 upp till 1080p

• Maximal klipplängd — Vidu Q4 Preview 16s (Image-to-Video 3-16s, Reference-to-Video 1-16s) vs Wan 2.7 upp till 15s

• Referensbilder — Vidu Q4 Preview upp till 15 i en och samma uppsättning jämfört med Wan 2.7 upp till tio tillgångar

• Referensljud — Vidu Q4 Preview upp till 3 klipp för röstkonsekvens jämfört med att inte publiceras med samma detaljrikedom av Ali​baba

• Uppgiftstäckning — Vidu Q4 Preview två lägen (bild-till-video, referens-till-video) mot Wan 2.7 fyra varianter (som lägger till text-till-video och videoredigering)

• Publicerat listpris — Vidu Q4 Preview från $0.014/s i kampanjpris; uppmätt $7.20/min på den oberoende tavlan mot Wan 2.7 $0.10-$0.15/s beroende på variant, $9.00/min uppmätt

Upplösningspunkten är den man bör väga noggrant. 4K-utdata i 10-bit är en verklig skillnad i leverans för alla som färdigställer för en skärm eller en stor display, och det är inte en funktion som Wan 2.7 erbjuder i någon variant. Men 4K är också där prissättningen per sekund vanligtvis slutar se ut som det annonserade golvpriset, och Vidus eget lanseringsmaterial innehåller förbehållet att slutlig prissättning, upplösningar som stöds, funktionstillgänglighet och användarvillkor varierar beroende på plan och region.

Vidu Q4 Preview's product page open on Reference-to-Video, showing the reference-image and audio upload surface.

Vilken, efter arbetsbelastning

Om du animerar stillbilder – produktbilder, karaktärsreferensbilder, storyboards – är Vidu Q4 Preview den bättre modellen enligt det enda oberoende underlag som finns, till en lägre uppmätt kostnad. Det är ett enkelt fall.

Om du behöver ett enda avtal som täcker text-till-video, bild-till-video och redigering är Wan 2.7 den enda av de två som svarar, och det gör den med ett sjundeplatsresultat inom redigering byggt på det största antalet röster som någon av modellerna har. Att konsolidera till en enda leverantör är en verklig fördel, och den här jämförelsen låtsas inte om något annat.

Om du behöver båda är kostnaden för att driva två leverantörer vanligtvis inte licensen – det är den andra integrationen, den andra nyckeln, den andra uppsättningen återförsökssemantik och det andra schemat som måste hållas uppdaterat. OrcaRouter reducerar detta till: en OpenAI-kompatibel slutpunkt för över 200 modeller, leverantörernas listpriser vidarebefordrade utan påslag, och automatisk redundansväxling mellan leverantörer. På videosidan specifikt tillhandahåller vi MiniMax H3, som för närvarande rankas som etta och tvåa på topplistan för image-to-video ovan – och kan anropas via samma slutpunkt och samma nyckel som textmodellerna. Varken Vidu Q4 Preview eller Ali​baba Wan 2.7 är en OrcaRouter-rutt idag, och den här sidan bör inte läsas som att den antyder något annat; vad vi kan göra är att hålla resten av arbetsbelastningen på en integration så att videoexperimentet blir en enskild post snarare än ett projekt.

Vad skulle förändra detta

Vidu Q4 Preview är en förhandsversion. Prissättningen är kampanjmässig, bygget ligger före den fullständiga Q4-lanseringen enligt leverantörens egen utsago, och API-dokumentationen innehåller fortfarande ett felstavat modellalias vid sidan av det korrekta. Två utfall spelar roll: om den fullständiga Q4-lanseringen lägger till text-till-video kollapsar axlarna och detta blir en direkt jämförelse på tre tavlor i stället för en; om den inte gör det förblir uppdelningen som den är och valet handlar enbart om arbetsbelastningens form.

Å andra sidan är Wan 2.7:s prov på resultattavlan för bild-till-video fem månader äldre än Vidus och omkring tusen färre. Båda intervallen kommer att bli smalare. Ingen av modellernas placering bör betraktas som fast bortom det datum som står tryckt bredvid den.

Det snäva svaret: de delar exakt en konkurrensaxel, Vidu Q4 Preview leder den tydligt med en lägre uppmätt kostnad, och Wan 2.7 vinner som standard överallt där Vidu inte konkurrerar. Det breda svaret är att en förhandsvisningsmodell med två lägen och en svit med fyra varianter egentligen inte är alternativ till varandra — de är alternativ för olika uppgifter, och det användbara i den här jämförelsen är att veta vilken uppgift du har.