Hero-titelkaart voor Grok Imagine Image 2.0 met de tekst 'Grok Imagine Image 2.0 — #2 op de text-to-image Arena, nauwkeurig bewerken, nu live in Grok-apps' met de bijschriftregel 'Aangekondigd op 7 augustus 2026 door xAI' en een plat bewerkingspictogram van een fotolijst met pen.
Guides & Insights

Grok Imagine Image 2.0: #4 op Artificial Analysis, voor een derde van de prijs

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Grok Imagine Image 2.0 is op #4 beland in de Text to Image Leaderboard van Artificial Analysis, en het getal dat telt is niet de rang — het is de prijs ernaast. Het model staat op 1.153,66 Elo, achter drie vermeldingen: GPT Image 2.5 Flare (max), GPT Image 2.5 Sunburst (max) en GPT Image 2 (high). Het staat boven elk model van andere labs, inclusief het MAI-Image-2.6 van Microsoft en het Nano Banana 2-model. Daarmee is het model de hoogst gerangschikte beeldgenerator buiten dat drietal, en met een ruime marge het goedkoopste in die top vier: Artificial Analysis prijst het op $60 per 1.000 afbeeldingen, tegenover ongeveer $211 voor de drie vermeldingen erboven. Het model zelf is van 7 augustus 2026 — wat is veranderd, is waar de onafhankelijke ranglijst het plaatst, en wat dat doet met de "wereld #2"-framing die de maker bij de lancering gebruikte.

Wat de #4-positie eigenlijk meet

De Text to Image Leaderboard van Artificial Analysis is een blinde arena voor menselijke voorkeuren: stemmers zien outputs van dezelfde prompt zonder modellabels en kiezen de betere, en de resulterende Elo wordt onafhankelijk van elke leverancier gepubliceerd. De vermelding van Grok Imagine Image 2.0 staat op #4 met 1.153,66 Elo en een 95%-betrouwbaarheidsinterval van 1.141,66 tot 1.165,66. Niets van dat cijfer is afkomstig van xAI. (Een administratief detail dat het weten waard is wanneer je het leaderboard leest: Artificial Analysis vermeldt de maker van het model als SpaceXAI.)

Het prijsgedeelte van het verhaal is het interessantere gedeelte. Op dezelfde pagina wordt kwaliteit tegen prijs uitgezet, met een Pareto-lijn die de modellen markeert die de meeste Elo per dollar opleveren, en volgens de eigen gepubliceerde cijfers van het board is Grok Imagine Image 2.0 het best scorende model met een prijs onder $100 per 1.000 afbeeldingen. Het eerstvolgende model dat qua kwaliteit boven Grok Imagine Image 2.0 staat, GPT Image 2 (high), kost $211 per 1.000 — ongeveer drieënhalf keer zoveel voor ongeveer 17 Elo meer. Dat is een claim over prijs en prestatie, geen claim dat het het beste model is, en het is de versie van het verhaal die de onafhankelijke data daadwerkelijk ondersteunen.

De frontierpositie is reëel maar smal, en het is de moeite waard om dat ronduit te zeggen. Microsofts MAI-Image-2.6 staat één rang lager op $38,90 per 1.000, en Meta's Muse Image kost $10 per 1.000 bij 1.111 Elo. Elo-intervallen op deze ranglijst bedragen ongeveer ±12 punten, dus #4 en #5 — die 6,5 Elo uit elkaar liggen — vallen binnen elkaars foutmarges. Behandel de plaatsing als "top vijf", niet als een definitieve plek.

De stijging van 14 plaatsen is het gat naar het niveau dat Grok Imagine Image 2.0 heeft vervangen. Het vorige kwaliteitsniveau van xAI, grok-imagine-image-quality, staat op #18 op dezelfde ranglijst met 1.043,21 Elo, en het originele grok-imagine-image staat op #29 met 1.017,86. Dat is ongeveer 110 Elo en 14 rangplaatsen tussen het model dat xAI nu documenteert als zijn standaard voor afbeeldingen en het model dat het vervangt.

Waar de bewering "wereld #2" nu staat

Bij de lancering verwees xAI naar een #2-notering op zowel de tekst-naar-afbeelding- als de beeldbewerkingsranglijst van Arena, met ongeveer 1.320 Elo en aangeduid als Preliminary. Dat waren cijfers die xAI in zijn eigen aankondiging benadrukte — geen onafhankelijke evaluatie die het zelf had laten uitvoeren — en ze zijn sindsdien verschoven: de momentopname van 10 augustus plaatste het model op #3 met 1.316 Elo, achter MAI-Image-2.6 en GPT Image 2. De #2 voor beeldbewerking blijft een verwijzing van xAI zelf.

Artificial Analysis is een andere ranglijst met een andere methode en een ander publiek van stemmers, en plaatst het model nu op #4. De twee spreken elkaar niet echt tegen — ze meten menselijke voorkeur op een andere manier, en beide zijn momentopnames van ranglijsten die van week tot week veranderen. De eerlijke samenvatting van zes weken onafhankelijke rangschikking is dat Grok Imagine Image 2.0 steevast in de top vijf staat en nooit precies de #2 is die xAI aankondigde.

Wat Grok Imagine Image 2.0 daadwerkelijk levert

xAI positioneert Grok Imagine Image 2.0 als een bewerkingsomgeving in plaats van weer een one-shot-generator. De functieset:

Magic Wand — bewerkingen op regiogebied die de rest van het frame onberoerd laten

Segmentatie — nauwkeurige regioselectie voor kleurgrading, vervanging of aanpassing

Achtergrondverwijdering — export van het onderwerp met transparante achtergrond

Invoer van meerdere afbeeldingen — tot vijf bronafbeeldingen per bewerking; de documentatie van xAI vermeldt nu vijf, tegenover de drie waarop de API bij de lancering was beperkt

Smart Resize — herschikt één afbeelding naar 9 beeldverhoudingen (van 1:2 staand tot 2:1 liggend), waarbij nieuwe beeldinhoud wordt gegenereerd in plaats van bijgesneden

Sjablonen — vooraf ingestelde workflows voor productfotografie, headshots, e-commerce-lijsten, game-assets en marketingposters

De API biedt bedieningselementen die de consumentenapp niet beschikbaar stelt: beeldverhouding — waaronder 21:9 en 5:2, beide nieuw in 2.0 — resolutie (standaard 1K, optioneel 2K) en een kwaliteitsparameter met de waarden laag, gemiddeld of auto. Aan consumentenzijde wordt het model geleverd als de standaard Quality Mode op grok.com/imagine, iOS en Android, en sinds 13 augustus staat het ook vermeld op het platform van Runway, waar het zich voegde bij de beeld- en videomodellen die Runway al host. Die vermelding is een verklaring van de leverancier en zijn partners in plaats van een onafhankelijke evaluatie, maar het was het eerste teken van distributie via derden na de lancering.

Bij het weergeven van koppen stelt xAI dat het model "typografie en lay-out plant zoals een ontwerper dat zou doen", waarbij dichte composities met meerdere onderdelen intact blijven en kleine tekst scherp wordt weergegeven. Het behoudt ook de identiteit van een onderwerp en instellingen bij meerdere iteratieve bewerkingen.

Wat een eerste onafhankelijke test ontdekte

Een vergelijking met zes prompts, één seed en zonder cherry-picking tegen gpt-image-2 vond een duidelijke tweedeling, en niets in de nieuwe positie op de ranglijst maakt dat ongedaan.

Grok wint: fotorealisme en identiteitsbehoud. De handanatomie in portretten was correct, met huiddetail op poriënniveau, onderhuidse verstrooiing, en natuurlijke catchlight en randlicht. Bij een geometrische rotatietaak van 45 graden behield Grok de gezichtsidentiteit boven de ArcFace 0.5-drempel, terwijl gpt-image-2 meer afweek.

Grok faalt: productiekritieke gebieden. Bij een verzoek om een filmposterkop in vereenvoudigd Chinees leverde het Traditionele Chinese karakters op — iets dat een "harde diskwalificatie" wordt genoemd voor lokalisatie- en publicatiepijplijnen. Een verzoek om een fusie in aquarelstijl leverde een fotorealistisch beeld op met slechts een lichte schilderachtige textuurdoorgang — een "diskwalificatie op categorieniveau". Lokale bewerkingen voltooiden alle drie de verzoeken, maar slaagden er niet in het zicht door het raam te behouden en verankerden een highlight verkeerd.

Samenvatting: Grok Imagine Image 2.0 "loopt voorop op het gebied van fotorealisme en identiteit, en loopt achter op het gebied van betrouwbaarheid bij bewerken, meertalige tekst en echte stijloverdracht." Een ranglijst middelt voorkeuren over duizenden blinde vergelijkingen; die kan je niet vertellen of het model je Chinese kop goed krijgt. Eén test met zes prompts is ook geen solide bewijsbasis — maar van de twee is de specifieke fout het bruikbaardere signaal voor een team dat gelokaliseerde assets uitbrengt.

De API en de prijsberekening

Het verhaal voor ontwikkelaars is sinds de lancering veranderd. grok-imagine-image-2.0 is nu het model dat xAI documenteert voor beeldgeneratie, het bewerken van één afbeelding en het bewerken van meerdere afbeeldingen, en het is wat de eigen modelpagina van xAI aanbeveelt voor afbeeldingen. De regel "toegang tot de ontwikkelaars-API komt binnenkort" uit de lanceertijd is verdwenen van de model- en prijspagina's van de leverancier.

• grok-imagine-image-2.0: vanaf $0,04 per afbeelding, gefactureerd tegen de daadwerkelijk geleverde kwaliteit

• grok-imagine-image (1.0): $0,02 per afbeelding, niet beïnvloed door de onderstaande wijziging

• grok-imagine-image-quality: $0,05 per afbeelding, vervalt op 2 november 2026

Kwaliteit is de hefboom op de kosten. Auto — de standaard wanneer de parameter wordt weggelaten — levert momenteel laag voor generatie en gemiddeld voor bewerken, dus een generatieverzoek wordt gefactureerd tegen het lage tarief en een bewerking tegen het gemiddelde. Het vastzetten op laag of gemiddeld maakt de rekening voorspelbaar in plaats van afhankelijk van welk pad de service kiest.

Die laatste bullet bevat een deadline. In de migratiegids van xAI staat dat de slug grok-imagine-image-quality op 2 november 2026 komt te vervallen, na een kennisgevingstermijn van 60 dagen die op 2 september begon. Vanaf die datum blijft de slug werken, maar worden verzoeken afgehandeld door grok-imagine-image-2.0 met quality ingesteld op low — een compatibiliteitsredirect, geen harde uitschakeling. Omdat de low-tier bij elke resolutie $0,01 per afbeelding goedkoper is dan de oude quality-tier, zullen teams die niets wijzigen een prijsdaling én een stille verandering in uitvoerkwaliteit zien. Bewust migreren, door grok-imagine-image-2.0 te benoemen en quality vast te zetten waar stabiele output belangrijk is, is de variant die je wilt. Die datum en het redirectgedrag komen uit xAI's eigen documentatie — door de leverancier opgegeven, niet onafhankelijk getest.

Vergeleken met de OpenAI-opties is de vergelijking net zozeer een verschil in prijsmodel als een prijsverschil. gpt-image-2 werkt met tokenprijzen — $8 per miljoen image-inputtokens en $30 per miljoen image-outputtokens volgens de gepubliceerde tarieven van OpenAI — dus de kosten per afbeelding schommelen mee met resolutie en detail. Het representatieve cijfer van Artificial Analysis van $211 per 1.000 afbeeldingen voor GPT Image 2 (high) tegenover $60 voor Grok is die schommeling die zich in één getal uitdrukt. Een vaste prijs per afbeelding is op schaal veel gemakkelijker te voorspellen, en dat is grotendeels waarom een model op de vierde plaats überhaupt de moeite waard is.

Het uitproberen zonder de pipeline op het spel te zetten

De redelijke reactie op Grok Imagine Image 2.0 is nog steeds: "probeer het, leg je er nog niet op vast." De positie ervan valt binnen overlappende betrouwbaarheidsintervallen, een onafhankelijke test signaleerde echte zwakke punten bij gelokaliseerde tekst en stijloverdracht, en xAI fasert in november een slug eronder uit. Dat is precies het argument voor routeren in plaats van een directe integratie aan te leggen.

Op OrcaRouter, grok-imagine-image — xAI's beeldmodel in onze catalogus — bevindt zich op hetzelfde OpenAI-compatibele endpoint als gpt-image-2, dus overstappen tussen xAI- en OpenAI-beeldmodellen is een kwestie van de modelstring aanpassen: geen tweede contract, geen nieuwe SDK. OrcaRouter geeft de lijstprijzen van providers zonder opslag door, dus een prijsverlaging van een leverancier is hier dezelfde dag live, en automatische failover kan fouten, rate limits of weigeringen naar een fallbackmodel sturen in plaats van naar je productiepad. Eén eerlijk voorbehoud, ongewijzigd ten opzichte van de oorspronkelijke beoordeling: het nieuwste kwaliteitsniveau van xAI is een aparte vermelding, los van het Grok-beeldmodel dat al in onze catalogus staat, dus controleer de huidige modellenlijst in plaats van ervan uit te gaan dat een bepaalde Grok-variant vandaag routeerbaar is.

Wat nu te kijken

1. De migratie van 2 november. Of teams expliciet naar grok-imagine-image-2.0 overstappen of meeglijden met de redirect en de bijbehorende standaardinstelling van lage kwaliteit, is het grootste dat xAI met dit model nog fout kan doen — en door de redirect blijft die fout onzichtbaar, tenzij je het modelveld in je antwoorden leest.

2. Of #4 standhoudt. Het verschil met MAI-Image-2.6 bedraagt 6,5 Elo met intervallen van ±12 punten, dus een paar duizend stemmen meer zouden het klassement in beide richtingen kunnen herschikken. De winst van 110 Elo ten opzichte van de vorige laag lijkt duurzaam; de exacte positie niet.

3. Hoeveel van het consumentenoppervlak de API bereikt. Generatie, bewerken en het bewerken van meerdere afbeeldingen zijn gedocumenteerd. Sjablonen en de genoemde Smart Resize-workflow blijven app-functies, en in dat gat leeft het resterende voorbehoud 'alleen voor consumenten'.

Kort gezegd: Grok Imagine Image 2.0 is een echt, capabel model dat nu onafhankelijk is geplaatst — #4 op de Text to Image Leaderboard van Artificial Analysis, de beste niet-OpenAI-inzending daar, ongeveer 110 Elo boven de categorie die het verving, en aan de prijs-kwaliteitsgrens van het klassement met $60 per 1.000 afbeeldingen tegenover ongeveer $211 voor de OpenAI-modellen direct boven zich. De positionering "wereldwijd #2" was altijd de lanceringsmomentopname van xAI, en de onafhankelijke ranglijsten hebben dat nooit echt gezegd. De twee duidelijkste onafhankelijke zwakke punten — naleving van Vereenvoudigd Chinees en betrouwbaarheid van stijltransfer — betreffen functies die teams het vaakst nodig hebben van een afbeeldings-API. Probeer het onmiddellijk voor fotorealistisch werk waarbij identiteit behouden blijft; wacht ermee voor pipelines die gelokaliseerde tekst of gestileerde assets uitleveren, en als je al de uitgefaseerde quality-slug aanroept, migreer dan vóór 2 november.