
Vidu Q4 Preview vs Google Veo 3.1: Veo säljer tre nivåer, och gapet mellan dem är mindre än gapet uppåt
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Google's Veo 3.1 finns i tre nivåer. På Artificial Analysiss tavla för bild-till-video får de 1 082, 1 071 och 1 066 – sexton Elo över hela spannet – medan deras priser per minut spänner över en faktor fem, från 4,80 till 24,00 dollar. Vidu Q4 Preview är en modell, inte tre, får 1 179 på samma tavla och listas till 7,20 dollar per minut. Läs siffrorna i ordning och den praktiska frågan upphör att vara "vilken Veo-nivå" och blir "varför köpa någon av dem alls" – vilket inte är den jämförelse de flesta sidor skriver, och den förtjänar det specifika svar som följer nedan snarare än en axelryckning.
Vidu Q4 Preview släpptes den 7 oktober 2026 av Shengshu Technology som en första offentlig förhandsvisning av sitt nästa generations flaggskepp, inför den fullständiga Q4-lanseringen, i två lägen: Image-to-Video och Reference-to-Video. Veo 3.1 har funnits på resultattavlorna sedan januari 2026, med en Lite-nivå som lades till i mars, och den tar såväl textpromptar som bilder. Olika former, olika årgångar och en resultattavla där de kan mätas mot varandra.

Veos nivåstege, avläst från tavlan
Alla siffror nedan kommer från Artificial Analysis, avlästa den 8 oktober 2026, med ljudet inkluderat. Varje resultattavla har sin egen Elo-skala och sin egen röstpool, så de två blocken är inte jämförbara med varandra – bara inom sig själva.
Bild-till-video (AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3:e, 1 179 ±10, 5 543 prover, okt. 2026, 7,20 USD/min
• Veo 3.1 — 12:e, 1 082 ±7, 7 040 prover, jan. 2026, 24,00 USD/min
• Veo 3.1 Lite — 15:e, 1 071 ±8, 5 122 sampel, mars 2026, $4,80/min
• Veo 3.1 Fast — 18:e, 1 066 ±6, 14 688 prover, jan. 2026, $9,00/min
Text-till-video (AA-Video-T2V v2.0):
• Veo 3.1 — 19:e–21:a, 962 ±10, 2 998 prover, jan. 2026, 24,00 USD/min
• Veo 3.1 Fast — 20:e, 961 ±10, 4 325 prover, jan 2026, 7,20 $/min
• Veo 3.1 Lite — 22:a–25:e, 948 ±10, 2 903 sampel, mars 2026, 4,80 $/min
• Vidu Q4 Preview — finns inte på detta kort
De två blocken berättar samma historia ur olika vinklar. För bild-till-video ligger de tre Veo-nivåerna inom ett band på sexton punkter medan priset varierar med en faktor fem – så att betala fem gånger mer för Veo 3.1 än för Veo 3.1 Lite ger dig elva Elo, väl inom de ±7- och ±8-intervall som dessa två poäng har. För text-till-video är spridningen fjorton punkter över samma femfaldiga prisintervall, och där är ordningen generös mot den billiga nivån: Veo 3.1 Fast ligger en Elo bakom flaggskeppet för en tredjedel av priset, med fler röster bakom sin siffra.
Googles egen nivåindelning är därför mest ett beslut om latens och upplösning snarare än en kvalitetsstege, vilket är en rimlig sak för en leverantör att sälja. Det är bara inte det som de flesta "vilken Veo"-artiklar påstår att det är.

Jämförelsen som faktiskt håller
Vidu Q4 Preview ligger 97 Elo över Veo 3.1:s bästa nivå på bild-till-video-tavlan, till 16,80 USD mindre per minut, och 113 Elo över Veo 3.1 Fast. Dessa marginaler är fem till sju gånger bredden på de aktuella intervallen, så de är inte brus.
Den uppenbara invändningen är att detta jämför en modell från oktober 2026 med en från januari 2026, och det gör den – det är hela fyndet. Veo 3.1 är åtta månader gammalt på den här tavlan, dess nivåer omstrukturerades senast på ett betydelsefullt sätt när Lite kom i mars, och det har passerats av en förhandsversion från ett mindre labb till ett lägre pris. Tavlans eget meddelande säger att två modeller lades till under de senaste 30 dagarna, och Vidu Q4 Preview är en av dem.
Den lika uppenbara motvikten: Vidu Q4 Preview har ingen text-till-video-ingång alls, vilket är där två av Veos tre nivåer finns. Om din arbetsbelastning utgår från en skriven prompt snarare än en bildruta, är ingen av dessa jämförelser tillämplig och Veo-stegen är den enda av de två som svarar.

Vad Veo ger dig som Vidu inte gör
Det finns en dimension där gapet är strukturellt snarare än numeriskt, och det har ingenting med Elo att göra.
Google's Veo 3.1 output is watermarked with SynthID on every frame and carries C2PA content credentials recording that it was AI-generated, with a detector available in the Gemini app. That is not a feature you switch on; it is what the model produces. For anyone shipping into a market with disclosure requirements, working with a platform that screens for synthetic media, or simply wanting an audit trail of which shots were generated, this is a procurement difference that no benchmark will show you. It is also, on some workflows, a reason not to use it — a watermark you cannot disable is a constraint if your deliverable needs to pass as unmarked footage.
Vidu Q4 Preview publicerar ingen vattenmärkning eller proveniensmekanism av jämförbar specificitet. Det är en frånvaro av ett påstående, inte ett påstående om frånvaro, och det bör registreras som sådant.
Två mindre asymmetrier värda att behålla:
• Ljudstandard — Vidu Q4 Previews bild-till-video-endpoint har en audio parameter som standard är true, så du får ljud med bilden om du inte stänger av det; Veo 3.1 prissätter ljud som ett eget tier-beslut, med ungefär $0,40/s på Standard för att inkludera det mot betydligt mindre för tyst utdata
• Referensbudget — Vidu Q4 Preview tar emot upp till 15 referensbilder och upp till 3 referensljudklipp i Reference-to-Video; Veo 3.1:s referenshantering är inte dokumenterad på den detaljnivån
Var detta lämnar valet
Om du genererar utifrån en stillbild – en produktbild, en karaktärsreferens, en storyboardruta – placerar den oberoende resultattavlan Vidu Q4 Preview i en annan nivå än varje Veo 3.1-variant, till en bråkdel av toppnivåns pris, och nivåtrappan inom Veo räddar den inte. Det är slutsatsen, och den bygger på 5 543 röster mot 7 040, 5 122 och 14 688 respektive. Röstsiffrorna är verkliga; placeringen kommer att ändras i takt med att intervallen snävas åt.
Om du behöver inbyggd proveniens, text-till-video eller en leverantör med Googles distribution och företagsvillkor är Veo 3.1 svaret, av skäl som Elo-tabellen inte kan uttrycka och inte bör läsas som överordnade.
Om du behöver båda är räkningen en integration mot två. OrcaRouter kör en OpenAI-kompatibel slutpunkt för 200+ modeller med leverantörernas listpriser som förs vidare och inget påslag läggs till, så en prisändring hos endera leverantören syns på din faktura samma dag i stället för vid förnyelse, och automatisk failover mellan leverantörer innebär att en enskild rutt som blir otillgänglig inte tar förfrågan med sig. Varken Vidu Q4 Preview eller Veo 3.1 är en OrcaRouter-rutt i dag – de videomodeller vi faktiskt tillhandahåller, inklusive MiniMax H3, kan anropas via samma slutpunkt – så den ärliga formuleringen är att vi kan hålla orkestreringslagret stabilt medan du avgör vilken renderingsväg som vinner, inte att vi är värd för någon av dessa två.
Frågan som faktiskt spelar roll
Veo 3.1 är inte en dålig modell. Det är en modell från januari 2026 som har prissatts som en flaggskeppsmodell medan tre av dess egna nivåer konvergerar mot samma poäng, och den har nu mätts mot en förhandsversion från oktober 2026 som slår dess bästa variant med en marginal som är större än Veos hela interna spridning.
Vad som skulle förändra bilden: AA-Video-I2V v2.0 meddelas vara på väg, i linje med T2V v2.0-taxonomin och med 1080p genomgående. En ny körning på en ny resultattavla med nya röstpooler kan kasta om någon av dessa placeringar, uppåt eller nedåt, och båda modellerna bör läsas om på den tavlan snarare än att lita på siffrorna på den här sidan.
Det snäva svaret för en läsare som vill ha ett: på den enda listan där båda förekommer rankas den enda Vidu Q4 Preview-versionen högre än alla tre Veo 3.1-nivåer, och det gör den till $7.20 per minut mot Veo 3.1 Standard på $24.00 och Veo 3.1 Fast på $9.00 – men inte mot Veo 3.1 Lite, som är den enda Veo-nivån som underbjuder den, med $4.80 per minut och arton platser lägre på samma lista. Veos egen nivåstege är inte en kvalitetsstege, och det är den delen av den här jämförelsen som är värd att ta med sig. Det breda svaret är att de är avsedda för olika uppgifter, och det som avgör är om din indata är ett fotografi eller en mening.
