
Vidu Q4 Preview vs Alibaba Wan 2.7: Två lägen mot fyra, och en resultattavla där det räknas
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Här är hela jämförelsen på en rad: Vidu Q4 Preview slår Alibaba Wan 2.7 med 102 Elo på Artificial Analysis-tavlan för bild-till-video, och kan inte ställas mot den i text-till-video eller videoredigering, eftersom Vidu Q4 Preview inte gör något av dem.
Båda modellerna lanserades 2026 och båda genererar video med ljud. Vidu Q4 Preview kom den 7 oktober 2026 från Shengshu Technology som en första offentlig förhandsvisning inför den fullständiga Q4-modellen, i två lägen – bild-till-video och referens-till-video. Alibaba Wan 2.7 släpptes i april 2026 som en svit med fyra varianter: text-till-video, bild-till-video, referens-till-video och videoredigering, med fakturering per sekund genererad video. Så utslagsgivaren på de flesta head-to-head-sidor – en poäng – finns bara på en av axlarna, och det ärliga sättet att bedöma dessa två är att börja med att fråga vilka axlar du faktiskt behöver.
Resultattavlan, med luckorna kvar synliga
Artificial Analysis driver tre separata videotopplistor. Var och en har sin egen Elo-skala och sin egen röstpool, så en poäng från en överförs inte till en annan. Läst den 8 oktober 2026, återigen med ljudet kvar:
• Bild-till-video (AA-Video-I2V v1.0) — Vidu Q4 Preview 3:e, 1 179 ±10, 5 543 prover, okt 2026, 7,20 $/min; Alibaba Wan 2.7 13:e, 1 077 ±8, 4 571 prover, apr 2026, 9,00 $/min
• Text-till-video (AA-Video-T2V v2.0) — Vidu Q4 Preview saknas; Wan2.7-260612 13:e–14:e, 1 030 ±9, 5 571 prover, juni 2026, 9,00 $/min
• Videoredigering (AA-Video-Editing v1.1) — Vidu Q4 Preview saknas; Wan 2.7 på 7:e plats, 1 074, 20 021 sampel, apr 2026, 16,90 $/min
Två saker följer av den tabellen. Wan 2.7 är den mest mångsidiga av de två med bred marginal – det är den enda av dem som har poängsatts på alla tre tavlorna, och dess redigeringspost har det största röstantalet av alla Wan 2.7-poäng någonstans, tjugotusen prover djupt. Och på den enda axel där de möts vinner Vidu Q4 Preview med 102 Elo, vilket är ungefär fem gånger bredden på endera modellens konfidensintervall.
Gapet på 102 poäng är inte ett litet resultat. För att sätta det i perspektiv: hela spridningen över de sex främsta platserna på bild-till-video-tavlan är 21 Elo. Vidu Q4 Preview ligger inte marginellt före Wan 2.7 inom bild-till-video; den ligger på en annan nivå, och den kostar 1,80 dollar per minut mindre samtidigt som den också är den nyare utgåvan. Om bild-till-video är din arbetsbelastning är beslutet inte svårt, och den oberoende resultattavlan är anledningen till att det inte är svårt.

Där Wan 2.7 är den enda av de två som dyker upp
Wan 2.7:s egen dokumentation pekar ut två områden som fortfarande behöver förbättras: ljudkvalitet och noggrannhet i text på skärmen. Det är leverantörens bedömning, inte en granskares, och den är värd att ta med sig in i varje jämförelse, eftersom båda modellerna gör samma stora anspråk – inbyggt ljud som genereras tillsammans med bilden i stället för att läggas till i efterhand.
Skillnaden ligger i vad som händer som standard. Vidu Q4 Previews bild-till-video-endpoint har en ljudparameter som standard är true: du får ljud om du inte stänger av det, och att stänga av det är hur du får ett ljudlöst klipp. Wan 2.7 dokumenterar inte samma växel på samma ställe. Om tyst utdata är viktigt för din pipeline – och det gäller allt du planerar att sätta musik till separat eller dubba till ett annat språk – förändrar den asymmetrin hur din första integrationsomgång ser ut.
På redigeringstavlan är Wan 2.7:s sjunde plats med 1 074 över 20 021 prover det starkaste enskilda resultat som endera modellen har på någon tavla räknat i antal röster. Tjugotusen röster är en mätning med verklig tyngd bakom sig, och ingen Vidu-modell finns på den tavlan att jämföra den med. Om ditt arbete går ut på att ändra timingen eller stilen på befintligt filmmaterial i stället för att generera nya tagningar, är Wan 2.7 den enda av de två som är relevant.

Specifikationsgapet på generationssidan
Där de överlappar varandra skiljer de två sig åt i nästan varje avseende, och skillnaderna är inte symmetriska till Wans fördel.
• Maximal upplösning — Vidu Q4 Preview 4K (2K och 4K i 10-bitars färg) jämfört med Wan 2.7 upp till 1080p
• Maximal klipplängd — Vidu Q4 Preview 16s (Image-to-Video 3-16s, Reference-to-Video 1-16s) vs Wan 2.7 upp till 15s
• Referensbilder — Vidu Q4 Preview upp till 15 i en och samma uppsättning jämfört med Wan 2.7 upp till tio tillgångar
• Referensljud — Vidu Q4 Preview upp till 3 klipp för röstkonsekvens jämfört med att inte publiceras med samma detaljrikedom av Alibaba
• Uppgiftstäckning — Vidu Q4 Preview två lägen (bild-till-video, referens-till-video) mot Wan 2.7 fyra varianter (som lägger till text-till-video och videoredigering)
• Publicerat listpris — Vidu Q4 Preview från $0.014/s i kampanjpris; uppmätt $7.20/min på den oberoende tavlan mot Wan 2.7 $0.10-$0.15/s beroende på variant, $9.00/min uppmätt
Upplösningspunkten är den man bör väga noggrant. 4K-utdata i 10-bit är en verklig skillnad i leverans för alla som färdigställer för en skärm eller en stor display, och det är inte en funktion som Wan 2.7 erbjuder i någon variant. Men 4K är också där prissättningen per sekund vanligtvis slutar se ut som det annonserade golvpriset, och Vidus eget lanseringsmaterial innehåller förbehållet att slutlig prissättning, upplösningar som stöds, funktionstillgänglighet och användarvillkor varierar beroende på plan och region.

Vilken, efter arbetsbelastning
Om du animerar stillbilder – produktbilder, karaktärsreferensbilder, storyboards – är Vidu Q4 Preview den bättre modellen enligt det enda oberoende underlag som finns, till en lägre uppmätt kostnad. Det är ett enkelt fall.
Om du behöver ett enda avtal som täcker text-till-video, bild-till-video och redigering är Wan 2.7 den enda av de två som svarar, och det gör den med ett sjundeplatsresultat inom redigering byggt på det största antalet röster som någon av modellerna har. Att konsolidera till en enda leverantör är en verklig fördel, och den här jämförelsen låtsas inte om något annat.
Om du behöver båda är kostnaden för att driva två leverantörer vanligtvis inte licensen – det är den andra integrationen, den andra nyckeln, den andra uppsättningen återförsökssemantik och det andra schemat som måste hållas uppdaterat. OrcaRouter reducerar detta till: en OpenAI-kompatibel slutpunkt för över 200 modeller, leverantörernas listpriser vidarebefordrade utan påslag, och automatisk redundansväxling mellan leverantörer. På videosidan specifikt tillhandahåller vi MiniMax H3, som för närvarande rankas som etta och tvåa på topplistan för image-to-video ovan – och kan anropas via samma slutpunkt och samma nyckel som textmodellerna. Varken Vidu Q4 Preview eller Alibaba Wan 2.7 är en OrcaRouter-rutt idag, och den här sidan bör inte läsas som att den antyder något annat; vad vi kan göra är att hålla resten av arbetsbelastningen på en integration så att videoexperimentet blir en enskild post snarare än ett projekt.
Vad skulle förändra detta
Vidu Q4 Preview är en förhandsversion. Prissättningen är kampanjmässig, bygget ligger före den fullständiga Q4-lanseringen enligt leverantörens egen utsago, och API-dokumentationen innehåller fortfarande ett felstavat modellalias vid sidan av det korrekta. Två utfall spelar roll: om den fullständiga Q4-lanseringen lägger till text-till-video kollapsar axlarna och detta blir en direkt jämförelse på tre tavlor i stället för en; om den inte gör det förblir uppdelningen som den är och valet handlar enbart om arbetsbelastningens form.
Å andra sidan är Wan 2.7:s prov på resultattavlan för bild-till-video fem månader äldre än Vidus och omkring tusen färre. Båda intervallen kommer att bli smalare. Ingen av modellernas placering bör betraktas som fast bortom det datum som står tryckt bredvid den.
Det snäva svaret: de delar exakt en konkurrensaxel, Vidu Q4 Preview leder den tydligt med en lägre uppmätt kostnad, och Wan 2.7 vinner som standard överallt där Vidu inte konkurrerar. Det breda svaret är att en förhandsvisningsmodell med två lägen och en svit med fyra varianter egentligen inte är alternativ till varandra — de är alternativ för olika uppgifter, och det användbara i den här jämförelsen är att veta vilken uppgift du har.
