
Vidu Q4 Preview debuterar som trea på Image-to-Video-tavlan – och lyser med sin frånvaro på den andra.
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Vidu Q4 Preview tog sig in på Artificial Analysis AA-Video-I2V v1.0-topplistan på tredje plats med ett Elo på 1 179, och modellen som den ersatte som Vidus bäst placerade bidrag, Vidu Q3 Pro, ligger på nittonde plats med 1 056. Det är en förflyttning på 123 poäng i en enda release, på en lista där konfidensintervallen är ungefär tjugo punkter breda, och det skedde till ett pris av 7,20 dollar per minut genererad video i stället för de 9,60 dollar som den äldre modellen har. Shengshu Technology släppte Vidu Q4 Preview den 7 oktober 2026 som den första offentliga förhandsvisningen av sitt nästa generations flaggskepp, uttryckligen före den fullständiga Q4-modellen, och ber kreatörer att använda den i verkliga projekt medan den slutliga versionen fortfarande formas.
Debutsiffran är rubriken. Frånvaron är det intressantare faktumet, och det är anledningen till att det här är en artikel snarare än ett diagram.
Vad som faktiskt släpptes den 7 oktober
Vidu Q4 Preview är en videogenereringsmodell med inbyggt ljud, som säljs via Vidus egen webbprodukt och API-plattform. Shengshus lanseringsmaterial beskriver tre arbetsområden: karaktärsframställning (ansiktsuttryck, känslor, kroppsrörelser och röst samordnade i stället för skiktade), kamera- och klippkoherens i snabb action, samt visuella effekter – explosioner, partiklar, fyrverkerier – som ligger inuti en scen i stället för ovanpå den.
Specifikationen, såsom leverantören anger den:
• Maximal upplösning – 4K, där 2K och 4K har 10-bitars färgdjup; hela skalan är 540p, 720p, 1080p, 2K, 4K
• Maximal klipplängd – 16 sekunder, uppdelad ojämnt: Image-to-Video går från 3 till 16 sekunder, Reference-to-Video går från 1 till 16
• Referensbudget — upp till 15 referensbilder (karaktärer, kläder, rekvisita, produkter, miljöer i en och samma uppsättning) och upp till 3 referensljudklipp
• Lanseringspris — från $0.014 per sekund, vilket är leverantörens siffra och uttryckligen är av kampanjkaraktär
Leverantören gör också ett jämförande påstående som den inte enkelt kan ställas till svars för: att Vidu Q4 Preview under jämförbara utdataspecifikationer och faktureringsvillkor ger ”upp till fem gånger så mycket utdata för samma budget”. Det är ett effektivitetsanspråk, inte ett kvalitetsanspråk, och eftersom frasen ”jämförbara utdataspecifikationer och faktureringsvillkor” gör hela jobbet i den meningen, är det värt att behandla det som en marknadsföringskonstruktion tills någon reproducerar det. Shengshus eget förbehåll, som publicerats samtidigt, är att slutpris, upplösningar som stöds, funktionstillgänglighet och användningsvillkor kan variera beroende på plan och region.

De två styrelserna är oeniga om vad den här modellen är till för
Artificial Analysis driver separata videotopplistor med separata Elo-skalor och separata röstningspooler, och skillnaden mellan dem är hela historien här.
På AA-Video-I2V v1.0 – bild-till-video, rankad utifrån parvisa mänskliga preferensröster med ljudet inräknat – ligger Vidu Q4 Preview på tredje plats med 1 179 ±10 över 5 543 sampel, daterad oktober 2026, prissatt till 7,20 USD per minut. Endast två modeller ligger över den: MiniMax H3 Max på 1 195 ±9 över 5 894 sampel (4,80 USD/min, augusti 2026) och MiniMax H3 på 1 181 ±8 över 7 284 sampel (7,80 USD/min, juli 2026). Gemini Omni Flash ligger på fjärde plats med 1 178 ±7 över 12 327 sampel. Resultattavlans egen notis säger att två modeller lades till under de senaste 30 dagarna: Vidu Q4 Preview och HiDream-O1-Video-1.0, som ligger på sjätte plats med 1 175 ±10.
På AA-Video-T2V v2.0 — text-to-video, en annan resultattavla byggd på en annan taxonomi för användningsfall — förekommer Vidu Q4 Preview inte alls. Den bästa Vidu-posten där är Vidu Q3 Pro, på tjugofemte plats med 941 ±10 över 4 088 sampel. Wan 3.0 leder den tavlan med 1 156 ±9.
Läs de två meningarna tillsammans och lanseringens karaktär blir tydlig. Det här är en bild- och referensmodell. Vidus egen produktsida listar exakt två lägen för den, Image-to-Video och Reference-to-Video, utan någon text-till-video-flik, och API-dokumentationen stämmer överens. En lansering som i leverantörens marknadsföring framstår som ett generellt flaggskepp är, på de oberoende forumen, en riktad sådan.
Ytterligare ett förbehåll kring själva placeringen. I2V-tavlans tiopunktsintervall överlappar kraftigt från tredje till sjätte plats — 1 179, 1 178, 1 176, 1 175 — så "tredjeplats" är en position inom bruset, inte en tydlig åtskillnad från fjärdeplatsen. Det som däremot inte ligger inom bruset är avståndet till modellen som den ersatte. 123 Elo mellan Vidu Q3 Pro och Vidu Q4 Preview är större än hela spridningen över de sex högsta placeringarna på tavlan.

Vad du faktiskt ringer, och vad det kostar
API:et är oglamoröst och specifikt. Image-to-Video postar till /ent/v2/img2video med modellnamnet viduq4-preview, tar en enda startbild (png, jpeg, jpg eller webp, upp till 50MB), en prompt på upp till 20 000 tecken, en varaktighet från 3 till 16 sekunder med standard 5, och en upplösning från 540p till 4K med standard 720p. Reference-to-Video postar till /ent/v2/reference2video, tar en till femton bilder plus noll till tre mp3-ljudreferenser på tre till tolv sekunder vardera, och erbjuder bildförhållanden på 1:1, 9:16, 16:9, 3:4 och 4:3 med standard 16:9.
Parametern som är värd att lägga märke till är audio, som har standardvärdet true. Vidu Q4 Preview genererar ljud tillsammans med bilden som standard – dialog och ljudeffekter inkluderade – och du stänger av det medvetet. Returnerade skapelse-URL:er förblir giltiga i 24 timmar, vilket är tillräckligt kort för att spela roll om du genererar i en batch och renderar senare.
När det gäller priset är den ärliga matematiken att de två tal som nämnts – "$0.014 per sekund" och de $7.20 per minut som Artificial Analysis registrerar – inte avser samma produkt. $0.014 per sekund är $0.84 per minut, ungefär en niondel av resultattavlans siffra, vilket är vad ett kampanjprisgolv vid lägsta upplösning ser ut som bredvid en uppmätt taxa vid en produktionsupplösning. Allt du budgeterar utifrån lanseringssiffran bör räknas om utifrån din egen upplösning och varaktighet, inte utifrån rubriken.

Det praktiska problemet med en förhandsvisnings-SKU
Vidu Q4 Preview är, enligt leverantörens egen formulering, inte färdig. Den släpptes före Q4 så att feedback om prestanda, kreativ kontroll och dagliga produktionsbehov skulle kunna forma den slutliga versionen. Prissättningen är kampanjbaserad. Funktionstillgängligheten varierar beroende på plan och region. API-dokumentationen innehåller till och med ett felstavat alias – viduq4-previerw förekommer i beskrivningen av modellparametern tillsammans med den korrekta viduq4-preview – vilket är en liten sak som säger något sant om var den här byggversionen befinner sig i pipelinen.
Det är inte ett argument mot att använda det. Det är ett argument mot att lägga det på en kritisk väg utan en plan för vad som händer när kampanjpriset upphör eller förhandsversionen ersätts, vilket för en modell som släpps på det här sättet är en fråga om veckor, inte kvartal.
Om du vill prova det utan att satsa en produktionspipeline på det, är OrcaRouter byggd exakt för det här fallet: en OpenAI-kompatibel slutpunkt för över 200 modeller, automatisk failover mellan leverantörer, och leverantörernas listpriser som förs vidare utan påslag. Failover-delen spelar större roll än vanligt med en förhandsversion, eftersom det är den som gör att du kan dirigera en begäran till en stabil modell med samma nyckel när en förhandsvisningsrutt inte är tillgänglig. För att vara tydlig med routningen: Vidu Q4 Preview är inte en OrcaRouter-rutt i dag. De videomodeller vi faktiskt tillhandahåller – inklusive MiniMax H3, den högst rankade modellen på just den här resultattavlan – kan anropas på samma slutpunkt som textmodellerna, och en videotaxa per sekund är en radpost, inte ett separat avtal.
Vad du ska titta på
Tre saker skulle föra den här berättelsen framåt.
Först, text-till-video-tavlan. Artificial Analysis har sagt att AA-Video-I2V v2.0 är på väg, i linje med T2V v2.0-taxonomin och med 1080p-video genomgående. Om Vidu Q4 Preview är en bild- och referensmodell kommer den inte att dyka upp där heller — och om den gör det säger det dig att Shengshu har släppt en bredare modell än vad förhandsvisningen antyder.
För det andra: det fullständiga Q4-släppet. Från förhandsversion till slutlig version är där kampanjpriser vanligtvis tar slut och där funktionsuppsättningen antingen håller stånd eller tyst minskar. Referensbudgeten på 15 bilder och 3 ljud är den del av specifikationen som mest sannolikt överlever, eftersom det är den särskiljande faktor som hela lanseringen är uppbyggd kring.
För det tredje: antalet röster. 5 543 röster är en verklig mätning men en ung sådan; intervallen kommer att smalna och placeringen kommer att förändras, åt endera hållet, i takt med att resultattavlan fylls. Den som citerar "tredje" som ett fastställt faktum bör ange datumet de läste det.
Frågan som är värd att hålla fast vid är snävare än marknadsföringen antyder. Vidu Q4 Preview är mätbart den bästa bild-till-video-modellen som Vidu har tagit fram, med en marginal som är större än resultattavlans egen spridning bland de sex främsta, till ett lägre pris per minut än sin föregångare. Huruvida det blir en varaktig position eller en tillfällig uppgång i samband med förhandsversionen är inte något som någon av de nuvarande siffrorna kan svara på.
