
Qwen-Image-2.1 vs Grok Imagine Image 2.0: gratis gewichten tegenover een betaalde omgeving
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Een van deze kost niets per afbeelding en komt met een licentie die de verkoop van het resultaat verbiedt. De andere kost tussen de twee en zes cent per afbeelding, afhankelijk van waar je hem koopt, heeft geen dergelijke beperking en staat vermeld op de ranglijsten die je daadwerkelijk kunt opzoeken. Qwen-Image-2.1werd op 20 september 2026 openbaar gemaakt als open weights onder een onderzoekslicentie. Grok Imagine Image 2.0is het betaalde afbeeldingseindpunt van de leverancier, verspreid via zijn eigen API en een reeks externe aanbieders. De keuze tussen beide is geen kwestie van kwaliteit — het gaat erom of je het model wilt bezitten of de omgeving eromheen wilt huren, en de omgeving doet meer werk dan het prijskaartje doet vermoeden.
Wat een foto aan elke kant kost
De prijs van Qwen-Image-2.1 is nul per afbeelding en eenmalig niet-nul. Je downloadt ongeveer 33 GB — een 7B, 32-laags single-stream diffusietransformer van zo'n 14 GB plus een Qwen3-VL 8B tekstencoder die het grootste deel van de rest voor zijn rekening neemt — en daarna zijn de marginale kosten van een afbeelding de elektriciteit om hem te draaien. Op een kaart met beperkte capaciteit raadt de modelkaart CPU-offload aan via pipe.enable_model_cpu_offload(), de standaarduitweg, en die kost je snelheid in plaats van geld.
De prijs van Grok Imagine Image 2.0 heeft de tegenovergestelde vorm. In de eigen documentatie van xAI wordt het vlaggenschip vermeld voor $0,04 per uitvoerafbeelding, met het basis-endpoint voor Grok Imagine-afbeeldingen op $0,02 en het kwaliteitsniveau op $0,05. Aanbieders van derden vallen in een vergelijkbare bandbreedte met hun eigen niveau-indeling — de een vermeldt vaste tarieven van $0,05 voor tekst-naar-afbeelding en $0,06 voor bewerking, ongeacht resolutie- of kwaliteitsinstelling, een ander noemt $0,045 vast voor zowel 1K als 2K voor zijn kwaliteitsniveau, en een derde adverteert met $0,025 voor tekst-naar-afbeelding of referentiebewerking met tot vijf invoerafbeeldingen. Over de hele markt komt dat neer op ongeveer $0,02 tot $0,06 per afbeelding, waarbij consumententoegang is inbegrepen bij X Premium en SuperGrok in plaats van per afbeelding te worden gefactureerd.
• Kostenmodel — Qwen-Image-2.1 is een vaste kostenpost voor hardware en downloads, met nul marginale kosten per afbeelding; Grok Imagine Image 2.0 is puur marginaal en schaalt voor altijd lineair mee met het volume.
• Break-even — het omslagpunt is een volumevraagstuk dat je kunt berekenen, en het verschuift zodra een aanbieder een tarief wijzigt. Bij een paar duizend afbeeldingen per maand is de gehoste route zonder meer goedkoper dan het kopen van een GPU; bij een hoog aanhoudend volume wint de lokale route op kosten en verliest die op alle andere assen.
• Wat je aan de lokale kant niet kunt kopen — rate limits, uptime en het operations-team van iemand anders. Wat je aan de gehoste kant niet kunt kopen, zijn de gewichten.
Wat de ranglijsten zeggen, en wat ze niet zeggen
Grok Imagine Image 2.0 heeft publieke claims over zijn rangschikking. xAI's lanceringsmateriaal noemde een tweede plaats overall op zowel de Text-to-Image- als de Image Edit Arena-borden per 7 augustus 2026, achter GPT Image 2 — dat is een door de leverancier aangehaald snapshot met tijdstempel en moet als zodanig worden gelezen. Trackers van derden plaatsten het in de weken daarna rond de tweede plaats bij beeldbewerking en de derde plaats bij tekst-naar-beeld, opnieuw achter GPT Image 2, met Elo-cijfers in de lage 1.300 en sommige trackingwebsites die dichter bij 1.173–1.175 rapporteerden. De spreiding tussen die cijfers is zelf de les: leaderboardposities in deze categorie verschuiven van week tot week, en een rang zonder datum is geen informatie.
Qwen-Image-2.1 heeft helemaal geen ranking. Het kwam niet voor op de onafhankelijke ranglijsten voor beeldmodellen toen dit werd geschreven. Het enige kwaliteitscijfer is de eigen Qwen-Image-Bench-grafiek van de leverancier, waar het 60,28 aangeeft tegenover Nano Banana 2.0 met 59,82 en GPT Image 1.5 met 59,65 — leveranciersmateriaal, niet gereproduceerd door een derde partij. Het enige echt onafhankelijke datapunt is de functionele verificatie die samen met het SGLang-integratiewerk is gepubliceerd: transparante PNG-uitvoer slaagde, alpha bleef behouden over het volledige bereik van 0–255, en RGBA-PSNR mat 60,69 dB in één enkele steekproef die de auteurs expliciet omschrijven als een correctheidscontrole en niet als een kwaliteitsgarantie.
Dus het eerlijke scorebord is: het ene model heeft een publieke rang die beweegt en een leveranciersclaim die eraan hangt, en het andere heeft een leveranciersscorekaart en een geslaagde integratietest. Dat is geen vergelijking, en geen enkel artikel dat het tegendeel beweert, heeft beide gedraaid.

Alpha, en waarom het de enige technische asymmetrie is
De transparantie van Qwen-Image-2.1 is in het model ingebouwd. Een 64-kanaals RGBA-VAE met 16× ruimtelijke compressie betekent dat het alfakanaal deel uitmaakt van de latente ruimte die wordt gedenoised, wat je drie dingen uit één mechanisme oplevert: genereren met transparantie, bewerken binnen een afbeelding die al transparantie heeft zonder die eerst af te vlakken, en subjectextractie uit een gewone RGB-foto die alpha retourneert in plaats van een hard masker. Geen node voor achtergrondverwijdering, geen matting-model, geen randopschoning — dat is de claim van de leverancier, en de functionele verificatie met SGLang is het enige onafhankelijke bewijs dat het kanaal echt is en niet nominaal.
Grok Imagine Image 2.0 heeft geen gedocumenteerd equivalent. Het gepubliceerde aanbod is tekst-naar-afbeelding en referentiegebaseerde bewerking, met resolutie- en kwaliteitsniveaus en bij sommige providers tot vijf invoerafbeeldingen. Als je asset een vrijstaand onderwerp met schone semi-transparante randen nodig heeft — haar, glas, rook — voeg je aan de Grok-kant een mattingstap toe en niet aan de Qwen-kant. Of die stap meer kost dan de licentiehoofdpijn aan de andere kant is de eigenlijke technische vraag, en die hangt af van je onderwerp.
Een bewerkingsomgeving versus een controlepunt
De twee systemen zijn het er niet over eens waar bewerkingsintelligentie zou moeten zitten.
Grok Imagine Image 2.0 maakt er een dienst van. Je stuurt een referentieafbeelding en een instructie, de provider bepaalt wat dat betekent, en de resolutie- en kwaliteitsniveaus worden per verzoek gekozen. Er is niets te lezen, niets af te stellen en niets dat kapot kan gaan — wat een echt voordeel is voor een team dat geen eigen diffusers-pipeline wil beheren. Het is ook de reden waarom de prijs per provider verschilt voor wat nominaal hetzelfde model is: je koopt een omgeving, niet alleen gewichten.
Qwen-Image-2.1 stopt het in checkpoints die je kunt inspecteren. Naast het beeldmodel levert het twee prompt-herschrijvende modellen mee — PE-T2I en PE-I2I, elk een fijn afgestemde Qwen3.5-VL 9B van ongeveer 18,8 GB — met de herschrijfcode in een prompt_rewrite/-map en een meegeleverd system_prompt.txt dat onder andere uiteenzet hoe de taal van weergegeven tekst wordt gekozen. Dat is een mate van inspecteerbaarheid die geen enkele gehoste beeld-API biedt. Het is bovendien 37,6 GB aan rewriter bovenop het model, wat een reële kostenpost is qua schijfruimte en laadtijd voor een component die de meeste pipelines als optioneel zullen beschouwen.
• Bewerkingsoppervlak — Qwen-Image-2.1 ondersteunt lokale bewerkingen via een cirkel, geschilderde annotatie of een apart masker, plus bewerking van transparante lagen en het extraheren van onderwerpen; de gedocumenteerde bewerking van Grok Imagine Image 2.0 is gebaseerd op referentieafbeeldingen.
• Referentie-invoer — Qwen-Image-2.1 accepteert tot 10 referentieafbeeldingen, waarbij één reviewer met vroege toegang meldt dat de consistentie bij meerdere referenties afneemt vanaf ongeveer drie afbeeldingen; verschillende Grok-aanbieders documenteren tot vijf invoerafbeeldingen.
• Native resolutie — Qwen-Image-2.1 levert native uitvoer op 2K, met 2048×2048 als standaard bij 40 stappen en zeven presets voor beeldverhouding; de resolutie van Grok Imagine Image 2.0 is een keuze per aanvraag, geprijsd per aanbieder.
Distributie en de licentie
Dit is waar de twee het scherpst uiteenlopen, en het is helemaal geen technisch verschil.
Grok Imagine Image 2.0 is beschikbaar via de API van xAI en via meerdere onafhankelijke externe aanbieders. Dat betekent prijsconcurrentie, en dus dat het tarief dat je betaalt een markttarief is in plaats van een lijsttarief. Er is geen download, geen GPU, geen licentebestand om te lezen, en geen beperking op commercieel gebruik naast de eigen voorwaarden van de aanbieder.
Qwen-Image-2.1 is op slechts één manier beschikbaar: door het te downloaden. Het valt onder de Qwen Research License Agreement van 20 september 2026, die alleen rechten voor niet-commerciële doeleinden verleent en stelt dat commercieel gebruik een aparte licentie vereist die bij de leverancier moet worden aangevraagd. Dat is een verstrakking ten opzichte van de eerdere Qwen-Image-reeks, die onder Apache 2.0 viel, en het is het enkele feit dat de meeste reële beslissingen tussen deze twee bepaalt. Een studio die ze op outputkwaliteit vergelijkt, beantwoordt de verkeerde vraag; de studio die Qwen-Image-2.1 niet voor werk voor klanten kan gebruiken, vergelijkt ze helemaal niet.
OrcaRouter is waar de verhuurde kant van die regeling huist. We routeren 200+ modellen achter één OpenAI-compatibel endpoint tegen de leverancierslijstprijs zonder opslag, met automatische failover tussen providers, een routing-DSL en modelfusie — zodat een image-route een primaire en een fallback kan benoemen in plaats van te gokken op de middag van één provider. We routeren het xAI Grok Imagine image-endpoint, maar let op de versie: onze catalogus bevat grok/grok-imagine-image, niet Grok Imagine Image 2.0, dus het nieuwere model kunnen we je momenteel niet leveren. We routeren ook geen enkel Qwen-Image-model van welke versie dan ook, dus Qwen-Image-2.1 is alleen lokaal. De gerouteerde image-lijn die we wél aanbieden is OpenAI's GPT-Image-familie, Google's Imagen 4-tiers en Gemini image-previews, en dat oudere Grok Imagine image-endpoint; omdat de lijstprijs wordt doorgegeven in plaats van eropslag op te leggen, is een prijsverlaging van een leverancier op elk daarvan dezelfde dag live.

Wat zou dit antwoord veranderen?
Drie dingen, en alle drie zijn binnen een kwartaal aannemelijk.
• Een commerciële licentie voor Qwen-Image-2.1. Als de leverancier voorwaarden publiceert tegen een prijs die een studio wil betalen, worden zowel het transparantievoordeel als de marginale kosten van nul bruikbaar in commercieel werk, en deze vergelijking verandert volledig van vorm. Vandaag is er geen gepubliceerde prijs en geen vermelde voorwaarden.
• Een onafhankelijke benchmark van Qwen-Image-2.1. Een derde partij die de cijfers van Qwen-Image-Bench van de leverancier reproduceert, of het model op een openbaar afbeeldingenboard plaatst, zou de enige resterende open vraag — is het eigenlijk goed — tot een beslechte kwestie maken.
• Een prijsbeweging aan de kant van Grok. Concurrentie tussen aanbieders heeft al gezorgd voor een spreiding van $0.02 tot $0.06 voor nominaal hetzelfde model. Een blijvende verlaging zou de gehoste route voor meer volumebanden dan nu het geval is tot de standaardoptie maken.
Totdat een van die dingen er is, is de beslissende factor niet kwaliteit en niet prijs. Het is of je alpha nodig hebt en kunt leven met een niet-commerciële licentie, in welk geval je het downloadt en in hardware betaalt; of je moet uitleveren en wilt dat iemand anders het model draait, in welk geval je per afbeelding betaalt en nooit meer aan een VAE denkt.

