
Qwen3.8-Omni-Flash vs Gemini Omni 1.1 Flash: De een bekijkt de video, de ander maakt hem
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Kort antwoord: deze twee zijn geen vervangers van elkaar, en de vergelijking is pas zinvol zodra je ophoudt "omni" als een categorie te behandelen. Qwen3.8-Omni-Flash, die de leverancier op 18 september 2026 voor API-klanten heeft opengesteld, neemt tekst, beeld, audio en video op en geeft tekst terug — het is een model om een uur vergadering of beeldmateriaal te lezen en je te vertellen wat er is gebeurd. Gemini Omni 1.1 Flash, die de leverancier op 27 augustus 2026 heeft uitgebracht, neemt een tekst- of beeldprompt en geeft video met gesynchroniseerde audio terug — het is een model om het beeldmateriaal te maken. De een verbruikt media, de ander produceert die. Als je pipeline beide nodig heeft, heb je beide nodig, en de eerlijke vraag is niet welke wint, maar welke je nu eigenlijk tekortkomt.
Geen van beide modellen is open-weight, geen van beide is routeerbaar via OrcaRouter, en beide zijn geprijsd op assen die niet in elkaar kunnen worden omgezet — tokens aan de ene kant, seconden gegenereerde video aan de andere kant. Hun werkelijke overlap is beperkter dan de "omni vs omni"-framing doet vermoeden, en die overlap is het waard om precies vast te stellen voordat de prijsberekening begint, want de prijsberekening is waar de twee het vaakst verkeerd met elkaar worden vergeleken.
De categoriefout die het waard is om eerst op te helderen
Het lanceermateriaal van Alibaba benchmarkt Qwen3.8-Omni-Flash tegen Gemini 3.8 Flash, en een groot deel van de berichtgeving die daarop volgde, vatte dat samen als "verslaat Gemini." Dat is een ander Google-model dan Gemini Omni 1.1 Flash, en de twee zijn geen uitwisselbare referentiepunten: Gemini 3.8 Flash is het multimodale model voor algemene doeleinden, en Gemini Omni 1.1 Flash is het videogeneratiemodel met een afzonderlijke prijslijst en een afzonderlijk API-oppervlak. Elk Qwen-versus-Gemini-getal dat na de lancering circuleert — WildClawBench-MM 71.0 tegen 58.9, SpotSoundBench 67.2 tegen 39.7, AgenticVBench 36.8 tegen 45.0 — heeft betrekking op Gemini 3.8 Flash, niet op het Omni-videomodel, en niets ervan is in elk geval onafhankelijk. Als je hier bent gekomen met een scorebord dat de twee modellen in dit artikel op dezelfde as plaatst, dan is het vrijwel zeker het verkeerde Google-model in de rechterkolom.
Wat elk ervan daadwerkelijk doet
• Wat het als invoer accepteert — Qwen3.8-Omni-Flash accepteert tekst, afbeelding, audio en video, waaronder stereo en vierkanaals ruimtelijke audio; Gemini Omni 1.1 Flash accepteert tekst- en afbeeldingsprompts plus maximaal drie seconden referentievideo.
• Wat het teruggeeft — Qwen3.8-Omni-Flash retourneert alleen tekst; Gemini Omni 1.1 Flash retourneert video met native gesynchroniseerde audio, in scènes die kunnen worden verlengd tot 40 seconden, in stappen van tien seconden.
• Bedieningsoppervlak — Qwen3.8-Omni-Flash biedt context, sampling en een agentische modus die zelf bepaalt waar naar te kijken; Gemini Omni 1.1 Flash biedt controle over het eerste en laatste frame, een terugblik van tien seconden voor continuïteit, en een 360p-conceptlaag die Google omschrijft als ongeveer een derde van de kosten en ongeveer 60% sneller.
• Resolutie en afwerking — Qwen3.8-Omni-Flash heeft geen uitvoerresolutie omdat het geen media produceert; Gemini Omni 1.1 Flash levert output in 720p, 1080p en 4K.
• Context en duur — Qwen3.8-Omni-Flash bevat één miljoen tokens en tot een uur continue audio-video in één enkele aanroep; Gemini Omni 1.1 Flash wordt begrensd door de clip die het genereert, niet door een invoervenster.
• Hoe u betaalt — Qwen3.8-Omni-Flash wordt per token gefactureerd: $0,15 per miljoen invoertokens, $0,016 voor gecachte tokens, $0,47 voor uitvoertokens op de internationale prijslijst; Gemini Omni 1.1 Flash wordt per seconde gegenereerde video gefactureerd, met het door Google gepubliceerde tarief van $0,10 per seconde voor 720p.
• Openheid — aan beide kanten gesloten. Voor geen van beide modellen zijn er gewichten, en geen van beide is vandaag beschikbaar om via onze API te routeren.

De overlap is videobegrip, en die is asymmetrisch.
De enige plek waar een koper deze redelijkerwijs naast elkaar zou kunnen leggen, is een pipeline die zowel beeldmateriaal moet begrijpen als produceren — bijvoorbeeld een montageassistent die een lange opname leest, de momenten vindt die de moeite waard zijn om te bewaren, en een montage genereert. Wat het begrijpen betreft, Qwen3.8-Omni-Flash is precies hiervoor gebouwd: een uur continue audio en video per aanroep, sprekersscheiding, en een agentische modus die de nauwkeurigheid op de OmniVideoBench van de leverancier verhoogt van 63,4 naar 67,8 en tegelijk het aantal tokens per query verlaagt van 145.736 naar 79.117. Wat de productie betreft, Gemini Omni 1.1 Flash is degene die de resulterende clip met gesynchroniseerde audio kan genereren, en het model van Qwen kan helemaal geen videoframe produceren.
De asymmetrie werkt ook de andere kant op, en die is makkelijker te missen. De greep van een videogeneratiemodel op begrip is instrumenteel — het heeft genoeg van een scène nodig om een shot consistent te houden gedurende een verlenging van tien seconden, wat een andere vereiste is dan het beantwoorden van een vraag over wat er in het derde uur van een vergadering werd gezegd. Het model van Google heeft een langere staat van dienst op het gebied van generatiekwaliteit en een kortere op het gebied van longform-analyse; dat van Alibaba is het omgekeerde. Als je taak is "de drie minuten vinden die er in deze opname toe doen", dan is het generatiemodel niet het juiste instrument. Als je taak is "een clip van dertig seconden produceren die aan deze briefing voldoet", dan is het begripsmodel evenmin het juiste instrument.
Waarom de prijsvergelijking steeds fout gaat
Een tarief per seconde en een tarief per token zijn niet converteerbaar, en de poging om ze te converteren levert de twee fouten op die deze vergelijking domineren. De eerste is het vergelijken van een hele gegenereerde clip met een invoertarief per token en concluderen dat het videomodel honderden keren duurder is — wat waar en betekenisloos is, omdat ze niet hetzelfde verkopen. De tweede is het alleen vergelijken van invoerprijzen en missen dat Alibaba's 98% audiokorting geldt voor uren invoeraudio, terwijl Google's tarief geldt voor seconden uitvoervideo, dus de twee "kortingen" staan niet eens aan dezelfde kant van de meter.
Wat men eerlijk kan zeggen, is dit. Volgens de eigen methodologie van Alibaba — een steekproef van twee minuten vermenigvuldigd met dertig, video op 720p en één frame per seconde — een uur gecombineerde audio- en video-invoer naar Qwen3.8-Omni-Flash wordt opgegeven als ongeveer $0,20, tegenover $3,27 voor de vorige generatie. Het genereren van veertig seconden 720p-video met Gemini Omni 1.1 Flash tegen het door Google gepubliceerde tarief van $0,10 per seconde kost $4,00, en het maken van een conceptversie van dezelfde veertig seconden op 360p komt uit op bijna $1,20 volgens Google's kostenkader van een derde. Beide reeksen cijfers zijn door leveranciers gerapporteerd en geen van beide is onafhankelijk gereproduceerd. De nuttige conclusie is niet welk getal kleiner is, maar dat het analyseren van een uur beeldmateriaal en het genereren van veertig seconden ervan in dezelfde orde van grootte liggen — wat de echte reden is dat een productiepijplijn die beide doet een kostenmodel nodig heeft, niet een winnaar.
Dat is ook het argument om de twee op één key te houden in plaats van twee contracten. Geen van beide omni-modellen is vandaag routeerbaar via OrcaRouter: Qwen3.8-Omni-Flash draait alleen op Alibaba's eigen platforms, en Google heeft de Omni-video-API niet opengesteld voor routing door derden, dus we hosten geen van beide en zullen niet doen alsof. Wat wél live is in onze catalogus is het zustermodel van elke familie — Qwen3.8-Flash en Gemini 3.8 Flash — beide vandaag aanroepbaar via één endpoint tegen de lijstprijs van de provider met 0% markup, wat ervoor zorgt dat een A/B-test tegen de eigen cijfers van welke leverancier dan ook een kwestie is van een configuratiewijziging in plaats van een tweede integratie.

Waar elk van beide wint, simpel gezegd
Qwen3.8-Omni-Flash wint op alles wat in uren input wordt gemeten: transcriptie en diarisatie van vergaderingen, samenvatting van lange opnames, audio-intensief agentisch gebruik van tools, en kosten per uur verwerkte media. De door de leverancier gerapporteerde audioresultaten zijn sterk, en de zwakte ligt waar het model nooit op was gericht — de redeneerintensieve leaderboards, waar de eerste runs door derden het in het 28e percentiel voor redeneren plaatsen, met een snelheidscijfer in het 21e, op een steekproef die klein genoeg is dat de cijfers moeten worden behandeld als een aanleiding om te testen, niet als een verdict.
Gemini Omni 1.1 Flash wint op het gebied van output: shotgeneratie met gesynchroniseerde audio, continuïteit over langere scènes, controle op frameniveau en de 4K-afwerking die een leveringspijplijn simpelweg kan vereisen. Het voordeel is niet een benchmarkscore — het is dat het andere model het werk helemaal niet kan doen. Waar het zwakker is, is alles waarbij een uur aan context vastgehouden moet worden, omdat het daar niet voor gebouwd is.
De beslissing, en het ding om in de gaten te houden
Als u tussen hen moet kiezen, is de vraag welke helft van de pipeline onbediend blijft. Een team dat al video genereert en lange opnamen moet begrijpen, zou deze week Qwen3.8-Omni-Flash op zijn eigen audio moeten testen; een team dat media analyseert en het moet produceren, zou Gemini Omni 1.1 Flash moeten testen. Een team dat beide nodig heeft, kijkt naar twee leveranciers, twee factureringsmodellen en twee integraties, en dat is de situatie waarin één routeringslaag ophoudt een gemak te zijn en het ding wordt dat het kostenmodel leesbaar houdt.
Twee dingen zouden deze interpretatie veranderen. Een onafhankelijke evaluatie van Qwen3.8-Omni-Flash zou elk leverancierscijfer hierboven vervangen door een vergelijkbaar cijfer — dat bestaat nog niet, en het ontbreken ervan is de grootste enkele lacune in deze vergelijking. En een gepubliceerd tarief voor 1080p- en 4K-output van Google zou het rekenwerk voor het topsegment controleerbaar maken; vandaag de dag circuleren die cijfers alleen als marktplaatsramingen in plaats van als de eigen lijst van Google.

Een afsluitende opmerking over framing. "Omni" betekent allang niets precies meer — het omvat nu zowel een model dat een uur vergaderaudio leest als een model dat een clip van veertig seconden met geluid rendert, en door dat woord als een categorie te behandelen, komen kopers uiteindelijk een tarief per token te vergelijken met een tarief per seconde en daar een conclusie uit te trekken. De modellen vullen elkaar aan met een beperkte overlap, en de juiste houding tegenover beide, vijf dagen en vier weken na hun respectieve releases, is dezelfde: meet ze op je eigen materiaal, en houd een tweede pad open.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
