
Qwen-Image-2.1 vs Gemini Omni 1.1 Flash: De een retourneert een PNG, de ander kan dat niet
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Het nuttigste om te weten over Qwen-Image-2.1 en Gemini Omni 1.1 Flash is dat ze niet concurreren. Vraag Gemini Omni 1.1 Flash om een stilstaand beeld en je krijgt een foutmelding: de eigen documentatie van de leverancier vermeldt beeldgeneratie, beeldbewerking en afwisselende beeld- en tekstuitvoer als niet-ondersteunde mogelijkheden voor het model. Vraag Qwen-Image-2.1 om een video en je krijgt een stilstaand beeld van 2048×2048 met een alfakanaal. Elke vergelijkingstabel die ze in twee kolommen zet, vergelijkt een camera met een projector. De echte vraag — degene die daadwerkelijk geld kost — is wat er gebeurt als je ze aaneenschakelt, en of de keten het contact met de tariefkaart overleeft. Qwen-Image-2.1 werd op 20 september 2026 openbaar; Gemini Omni 1.1 Flash is algemeen beschikbaar sinds 27 augustus 2026.
Wat elk model fysiek retourneert
Dit is de hele vergelijking, en al het andere volgt daaruit.
• Uitvoerformaat — Qwen-Image-2.1 levert een stilstaand beeld op, native tot 2048×2048 bij 40 inferentiestappen, optioneel met een echt alfakanaal; Gemini Omni 1.1 Flash levert video, tot 40 seconden, samengesteld uit generatie- en verlengingsaanroepen van 10 seconden, zonder enige modus voor stilstaande beelden.
• Transparantie — Qwen-Image-2.1 denoist in een 64-kanaals RGBA-latente ruimte, dus alfa komt uit de sampler; Gemini Omni 1.1 Flash heeft geen uitvoer met transparante achtergrond, en dit aanvragen mislukt.
• Referentie-invoer — Qwen-Image-2.1 accepteert tot 10 referentieafbeeldingen voor compositie met meerdere onderwerpen; Gemini Omni 1.1 Flash accepteert tot 10 afbeeldingen per prompt als *invoer* en tot drie referentievideoclips van 3 seconden.
• Resolutieplafond — Qwen-Image-2.1 is native 2K; Gemini Omni 1.1 Flash biedt 360p, 720p, 1080p en 4K, maar 1080p en 4K zijn upscales van een native 720p-render in plaats van native generaties.
• Wat het kost — Qwen-Image-2.1 heeft geen gehoste prijs omdat er geen gehost endpoint is, dus de kosten zijn je eigen GPU-tijd; Gemini Omni 1.1 Flash rekent $0,10 per seconde bij 720p, met een 360p-conceptlaag van ongeveer $0,03 per seconde.
• Licentie — Qwen-Image-2.1 valt onder de Qwen Research License Agreement van 20 september 2026, uitsluitend niet-commercieel; Gemini Omni 1.1 Flash is een commerciële API waarvan de uitvoer standaard SynthID- en C2PA-herkomst bevat.
De laatste rij is de rij waar mensen achteloos overheen lezen. Aan de ene kant heb je een model dat je kunt downloaden maar niet mag verkopen. Aan de andere kant een model dat je niet kunt downloaden maar vrij mag verkopen — met een onzichtbaar watermerk in elk frame.
Waarom de "versus"-framing toch blijft opduiken
Zoek je de twee namen samen, dan vind je pagina's die ze head-to-head rangschikken. De reden is dat de onderliggende vraag echt is, zelfs wanneer de framing verkeerd is: beide modellen zitten in dezelfde creatieve pijplijn, en beide zijn het nieuwste daarin. Waar mensen eigenlijk over proberen te beslissen, is waar het stilstaande beeld ophoudt en de beweging begint.
Gemini Omni 1.1 Flash verdiende zijn plek op die vraag met onafhankelijke cijfers in plaats van cijfers van de leverancier. Op Artificial Analysis stond het per 2 september 2026 bovenaan in zowel de tekst-naar-video- als de afbeelding-naar-video-arena's in de categorie zonder audio, met Elo 1324 en 1364. Met audio ingeschakeld zakt het naar Elo 1237 en 1180 — tweede en vierde. Dat audiogat is het soort detail dat een specsheet verbergt en een ranglijst blootlegt.
Het bewijs voor Qwen-Image-2.1 is dunner en van een andere aard. De eigen Qwen-Image-Bench van de leverancier plaatst het op 60,28, vóór Nano Banana 2.0 met 59,82 en GPT Image 1.5 met 59,65, en als eerste onder open modellen — maar dat is een door de leverancier uitgevoerde benchmark met marges van minder dan een punt, en het is geen reproductie door een derde partij. Onafhankelijke tests bestaan tot nu toe uit een door mensen beoordeelde run van GenAI Showdown met 7/15, een stijging ten opzichte van 4/15 voor het oorspronkelijke Qwen-Image en achter Ideogram 4 met 8/15. Het model stond op het moment van schrijven niet op de beeldranglijsten van Artificial Analysis. Geen lage score — geen score.


De overdracht, en wat die werkelijk kost
Als je iets bouwt dat zowel een still als een clip nodig heeft, werkt de pipeline maar in één richting: Qwen-Image-2.1 maakt het frame, Gemini Omni 1.1 Flash animeert het. Het omgekeerde bestaat niet.
De rekensom is genadeloos als je hem eenmaal doorrekent. Een clip van 10 seconden in 720p op Gemini Omni 1.1 Flash kost ongeveer $1,00. Op het 360p-conceptniveau kost dezelfde 10 seconden ongeveer $0,30, en een volledige scène van 40 seconden in 720p — één generatie plus drie extensieaanroepen — komt uit op bijna $4,00. Het stilstaande beeld dat aan de basis van alles staat, kost ondertussen niets anders dan de stroom op je eigen kaart. Dat betekent dat de interessante kostenbeslissing niet is "welk model", maar "hoeveel takes". Op een stilstaand beeld kun je gratis itereren; op een video niet. Teams die videogeneratie per asset begroten in plaats van per poging, zijn degenen die verrast worden, want het eerste frame is gratis en de herhaalpogingen niet.
Er zit ook een kwaliteitsval in de overdracht. Gemini Omni 1.1 Flash rendert native in 720p en schaalt op naar 1080p en 4K. Als je still een 2048×2048 Qwen-Image-2.1-frame met een schoon alfakanaal is, gooit het invoeren ervan in een videopad dat in 720p rendert en opschaalt het meeste weg van wat het beeldmodel je gaf — en het alfakanaal wordt volledig weggegooid, omdat er geen transparante video-uitvoer is. Transparantie blijft behouden in de compositor, niet in de modelketen. Plan het compositen nadat de clip terugkomt, niet ervoor.
Waar de routeringslaag past
Het ongemakkelijke deel van deze combinatie is dat geen van beide modellen bereikbaar is op de manier waarop de rest van je stack dat waarschijnlijk is. Gemini Omni 1.1 Flash is een leveranciers-API met een eigen sleutel en een eigen meter per seconde. Qwen-Image-2.1 is een download van ongeveer 33 GB — een 7B diffusie-transformer plus een Qwen3-VL 8B tekstencoder — die je zelf host, onder een licentie die alleen niet-commercieel gebruik toestaat. Twee factureringsmodellen, twee toegangspaden, één project.
OrcaRouter bestaat precies voor het omliggende oppervlak: één OpenAI-compatibel endpoint voor 200+ modellen, listprijs van de provider doorgegeven tegen nul markup, automatische failover tussen providers, een routing-DSL voor het samenstellen van fallbacks, en modelfusie voor calls in panelstijl. Het is belangrijk om precies te zijn over wat dat hier dekt. We routeren geen enkel Qwen-Image-model van welke versie dan ook, dus Qwen-Image-2.1 is geen route die je aan onze kant kunt aanroepen — die draait op jouw hardware of helemaal niet. We routeren Gemini Omni 1.1 Flash ook niet. Wat we aan de motion-kant wél aanbieden, is Kling's videolijn, inclusief kling-v3, kling-v3-omni en kling-video-o1, plus MiniMax H3 — dus de animatiehelft van deze pipeline heeft een gehoste route waarvoor geen tweede leverancierscontract nodig is, en aan de beeldkant bieden we de OpenAI GPT-Image-familie, Google's Imagen 4-tiers en Gemini image previews, en xAI's Grok Imagine image endpoint. Omdat de listprijs wordt doorgegeven in plaats van dat er markup op wordt gezet, is een prijsverlaging van een leverancier op een van deze modellen hier dezelfde dag live.
Welke heb je eigenlijk nodig?
• Je hebt assets nodig, geen beeldmateriaal — Qwen-Image-2.1, en het alfakanaal is de reden. Transparante productuitsneden, iconen, sprites en gelaagde composities zijn precies waar een sampler die RGBA uitstuurt je een volledige matting-pipeline bespaart.
• Je hebt beweging nodig en je moet die kunnen meten — Gemini Omni 1.1 Flash. Het is de enige van de twee met onafhankelijke arenaresultaten bovenaan een ranglijst, en de enige met een gepubliceerde prijs per seconde die je in een prognose kunt opnemen.
• Je hebt beide nodig — begroot het videodeel per poging, niet per asset, en ga er niet van uit dat het alfakanaal behouden blijft.
• Je moet de output kunnen verkopen — Gemini Omni 1.1 Flash, en alleen Gemini Omni 1.1 Flash, totdat Qwen commerciële voorwaarden publiceert voor Qwen-Image-2.1. Er is vandaag geen gepubliceerde prijs of term sheet voor die licentie.
De eerlijke samenvatting is dat de vergelijking die hen rangschikt het verkeerde artefact is. Wat nu de moeite waard is om te volgen, is of Qwen commerciële voorwaarden aan Qwen-Image-2.1 verbindt, en of Google de audiokloof op de Omni-ranglijsten dicht — die twee feiten, en niet nog een scorebord, bepalen welk half van deze pijplijn het budget krijgt.

Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
