
Grok Imagine Image 2.0: #4 på Artificial Analysis, till en tredjedel av priset
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok Imagine Image 2.0 har landat på #4 på Artificial Analysis Text to Image Leaderboard, och siffran som spelar roll är inte placeringen – det är priset bredvid. Modellen ligger på 1 153,66 Elo, bakom tre poster: GPT Image 2.5 Flare (max), GPT Image 2.5 Sunburst (max) och GPT Image 2 (high). Före varje annat labbs modell, inklusive Microsofts MAI-Image-2.6 och Nano Banana 2-modellen. Det gör modellen till den högst rankade bildgeneratorn utanför den trion, och den billigaste i den toppfyran med bred marginal: Artificial Analysis prissätter den till $60 per 1 000 bilder mot cirka $211 för de tre posterna ovanför. Modellen i sig är från den 7 augusti 2026 – det som har ändrats är var den oberoende topplistan placerar den, och vad det gör med inramningen "världens #2" som tillverkaren använde vid lanseringen.
Vad #4-placeringen faktiskt mäter
Artificial Analysis topplista för text till bild är en blind arena för mänskliga preferenser: röstande ser resultat från samma prompt utan modellbeteckningar och väljer den bättre, och det resulterande Elo-talet publiceras oberoende av alla leverantörer. Grok Imagine Image 2.0:s post ligger på #4 med 1 153,66 i Elo och ett 95-procentigt konfidensintervall på 1 141,66 till 1 165,66. Inget av det numret kommer från xAI. (En praktisk detalj som är värd att känna till när du läser listan: Artificial Analysis anger modellens skapare som SpaceXAI.)
Prishalvan av berättelsen är den mer intressanta halvan. Samma sida plottar kvalitet mot pris med en Pareto-linje som markerar de modeller som ger mest Elo per dollar, och enligt leaderboardens egna publicerade siffror är Grok Imagine Image 2.0 den högst poängsatta modellen med ett pris under 100 dollar per 1 000 bilder. Nästa modell ovanför den i kvalitet, GPT Image 2 (high), kostar 211 dollar per 1 000 – ungefär tre och en halv gånger så mycket för cirka 17 mer Elo. Det är ett påstående om pris-prestanda, inte ett påstående om att vara den bästa modellen, och det är den version av berättelsen som den oberoende datan faktiskt stöder.
Frontpositionen är verklig men smal, och det är värt att säga det rakt ut. Microsofts MAI-Image-2.6 ligger en placering under på 38,90 USD per 1 000, och Metas Muse Image kostar 10 USD per 1 000 vid 1 111 Elo. Elo-intervallen på den här resultattavlan ligger på omkring ±12 poäng, så #4 och #5 – åtskilda av 6,5 Elo – ligger inom varandras felstaplar. Betrakta placeringen som "topp fem", inte som en fastställd plats.
Klättringen på 14 placeringar är gapet till den nivå som Grok Imagine Image 2.0 ersatte. xAI:s tidigare kvalitetsnivå, grok-imagine-image-quality, ligger på #18 på samma lista med 1 043,21 Elo, och den ursprungliga grok-imagine-image är #29 med 1 017,86. Det är ungefär 110 Elo och 14 placeringar mellan modellen som xAI nu dokumenterar som sin bildstandard och den som den ersätter.
Var påståendet om "världens #2" står nu
Vid lanseringen uppgav xAI en andraplats (#2) på både text-till-bild- och bildredigerings-Arena-tavlorna, på ungefär 1 320 Elo och märkt Preliminary. Det var siffror som xAI lyfte fram i sitt eget tillkännagivande – inte en oberoende utvärdering som företaget hade beställt – och de har förändrats sedan dess: ögonblicksbilden från den 10 augusti placerade modellen på #3 med 1 316 Elo, bakom MAI-Image-2.6 och GPT Image 2. Andraplatsen för bildredigering är fortfarande xAI:s egen hänvisning.
Artificial Analysis är en annan lista med en annan metod och en annan skara röstande, och den placerar nu modellen på #4. De två motsäger egentligen inte varandra – de mäter mänskliga preferenser på olika sätt, och båda är ögonblicksbilder av listor som förändras från vecka till vecka. Den ärliga sammanfattningen av sex veckor av oberoende rankning är att Grok Imagine Image 2.0 konsekvent ligger bland de fem bästa och aldrig riktigt den #2 som xAI tillkännagav.
Vad Grok Imagine Image 2.0 faktiskt levererar
xAI positionerar Grok Imagine Image 2.0 som en redigeringsmiljö snarare än ännu en engångsgenerator. Funktionsuppsättningen:
• Magic Wand — redigeringar på regionnivå som lämnar resten av bildrutan orörd
• Segmentering — exakt regionval för färggradering, ersättning eller justering
• Bakgrundsborttagning — export av motiv med transparent bakgrund
• Indata med flera bilder — upp till fem källbilder per redigering; xAI:s dokumentation listar nu fem, mot de tre som API:et begränsade till vid lanseringen
• Smart Resize — omkomponerar en bild till 9 bildförhållanden (1:2 stående till 2:1 liggande), genom att skapa nytt bildinnehåll istället för att beskära
• Mallar — förinställda arbetsflöden för produktfotografering, porträtt, e-handelslistningar, speltillgångar och marknadsföringsaffischer
API:et exponerar kontroller som konsumentappen inte visar: bildförhållande – inklusive 21:9 och 5:2, båda nya med 2.0 – upplösning (1K som standard, 2K valfritt), och en kvalitetsparameter som tar låg, medium eller auto. På konsumentsidan levereras modellen som standardläget Quality Mode på grok.com/imagine, iOS och Android, och sedan den 13 augusti har den också listats på Runways plattform, där den anslöt sig till de bild- och videomodeller som Runway redan är värd för. Den listningen är ett uttalande från leverantör och partner snarare än en oberoende utvärdering, men det var det första tecknet på tredjepartsdistribution efter lanseringen.
Vid rendering av rubriktext säger xAI att modellen "planerar typografi och layout som en designer skulle göra," och håller täta kompositioner i flera delar intakta samt återger liten text skarpt. Den bevarar också ett motivs identitet och inställningar genom iterativa redigeringar i flera omgångar.
Vad ett första oberoende test fann
En jämförelse mot gpt-image-2 med sex prompter, ett enda seed och utan cherry-picking fann en tydlig uppdelning, och inget i den nya placeringen på resultattavlan ändrar på detta.
Grok vinner: Fotorealism och identitetsbevarande. Porträttets handanatomi var korrekt, med huddetaljer på pornivå, subsurface scattering och naturliga catchlights och kantljus. I en 45-graders geometrisk rotationsuppgift behöll Grok ansiktsidentiteten över ArcFace 0,5-tröskeln medan gpt-image-2 avvek mer.
Grok förlorar: produktionskritiska områden. När den ombads att ta fram en rubrik för en filmaffisch på förenklad kinesiska, renderade den tecken på traditionell kinesiska — det kallades för en "hård diskvalificeringsfaktor" för lokaliserings- och publiceringspipelines. En förfrågan om stilfusion med akvarell returnerade en fotorealistisk bild med endast ett lätt måleriskt texturlager — en "diskvalificering på kategorinivå". Lokala redigeringar slutförde alla tre förfrågningarna men misslyckades med att bevara fönsterutsikten och förankrade en högdager på fel ställe.
Sammanfattning: Grok Imagine Image 2.0 "leder inom fotorealism och identitet, och ligger efter inom redigeringstillförlitlighet, flerspråkig text och äkta stilöverföring." En resultattavla beräknar ett genomsnitt av preferenser över tusentals blinda jämförelser; den kan inte säga dig om modellen kommer att få din kinesiska rubrik rätt. Ett test med sex prompter är inte heller ett bevisunderlag – men mellan de två är det specifika misslyckandet den mer åtgärdbara signalen för ett team som levererar lokaliserade tillgångar.
API:t och prissättningsmatten
Utvecklarberättelsen har förändrats sedan lanseringen. grok-imagine-image-2.0 är nu modellen som xAI dokumenterar för bildgenerering, redigering av enskilda bilder och redigering av flera bilder, och det är den som xAI:s egen modellsida rekommenderar för bilder. Raden "API-åtkomst för utvecklare kommer snart" från lanseringstiden har försvunnit från leverantörens modell- och prissidor.
• grok-imagine-image-2.0: från $0.04 per bild, debiteras efter den kvalitet som faktiskt levereras
• grok-imagine-image (1.0): $0.02 per bild, påverkas inte av ändringen nedan
• grok-imagine-image-quality: $0.05 per bild, fasas ut 2 november 2026
Kvalitet är hävstången för kostnaden. Auto – standardvärdet när parametern utelämnas – ger för närvarande low för generering och medium för redigering, så en genereringsbegäran debiteras enligt low-priset och en redigering enligt medium-priset. Genom att låsa till low eller medium blir fakturan förutsägbar i stället för beroende av vilken väg tjänsten väljer.
Den sista punkten innebär en deadline. xAI:s migreringsguide säger att sluggen grok-imagine-image-quality dras tillbaka den 2 november 2026, efter en 60-dagars avisering som började den 2 september. Från och med det datumet fortsätter sluggen att lösas upp, men förfrågningar hanteras av grok-imagine-image-2.0 med quality inställt på low – en kompatibilitetsomdirigering, inte en hård avstängning. Eftersom low-nivån är 0,01 USD per bild billigare än den gamla quality-nivån vid alla upplösningar, kommer team som inte ändrar något att se en prissänkning och en tyst förändring av utdatakvaliteten. Att migrera medvetet, genom att namnge grok-imagine-image-2.0 och låsa quality där stabil utdata är viktigt, är den version av detta du vill ha. Det datumet och omdirigeringsbeteendet är xAI:s egen dokumentation – uppgivet av leverantören, inte oberoende testat.
Jämfört med OpenAI-alternativen är jämförelsen lika mycket en skillnad i prismodell som en prisskillnad. gpt-image-2 har tokenbaserad prissättning – 8 USD per miljon tokens för bildinmatning och 30 USD per miljon tokens för bildutmatning enligt OpenAIs publicerade priser – så kostnaden per bild varierar med upplösning och detaljrikedom. Den representativa siffran från Artificial Analysis på 211 USD per 1 000 bilder för GPT Image 2 (high) mot Groks 60 USD är den variationen uttryckt som ett enda tal. Platt prissättning per bild är mycket lättare att prognostisera i stor skala, vilket till stor del är varför en modell på fjärde plats är värd att titta på överhuvudtaget.
Att prova det utan att satsa hela pipelinen
Den rimliga reaktionen på Grok Imagine Image 2.0 är fortfarande "prova det, bind dig inte vid det ännu." Dess position ligger inom överlappande konfidensintervall, ett oberoende test flaggade verkliga svagheter på lokaliserad text och stilöverföring, och xAI avvecklar en slug under den i november. Det är precis argumentet för routning i stället för att koppla en direkt integration.
På OrcaRouter grok-imagine-image – xAI:s bildmodell i vår katalog – ligger på samma OpenAI-kompatibla endpoint som gpt-image-2, så att växla mellan xAI:s och OpenAIs bildmodeller är en ändring av modellsträngen: inget andra avtal, inget nytt SDK. OrcaRouter för vidare leverantörernas listpriser utan påslag, så en prissänkning från en leverantör är live här samma dag, och automatisk failover kan skicka fel, hastighetsbegränsningar eller avvisanden till en reservmodell i stället för in i din produktionsväg. En ärlig varning, oförändrad sedan den ursprungliga recensionen: xAI:s senaste kvalitetsnivå är en separat post från den Grok-bildmodell som redan finns i vår katalog, så kontrollera den aktuella modellistan i stället för att anta att en viss Grok-variant går att routa i dag.
Vad du ska titta på härnäst
1. Migreringen den 2 november.Huruvida team uttryckligen flyttar till grok-imagine-image-2.0 eller glider in på omdirigeringen och dess lågkvalitativa standard är det största som xAI fortfarande kan göra fel med den här modellen – och omdirigeringen gör misstaget osynligt om man inte läser modellfältet i sina svar.
2. Om #4 håller. Avståndet till MAI-Image-2.6 är 6,5 Elo med intervall på ±12 punkter, så några tusen fler röster skulle kunna ändra ordningen på resultattavlan i endera riktningen. Ökningen på 110 Elo jämfört med föregående nivå verkar hållbar; den exakta placeringen gör det inte.
3. Hur mycket av konsumentytan som når API:et. Generering, redigering och redigering av flera bilder är dokumenterade. Mallar och det namngivna arbetsflödet Smart Resize är fortfarande appfunktioner, och det är i det glappet som det återstående förbehållet "endast för konsumenter" finns.
Kort sagt: Grok Imagine Image 2.0 är en verklig, kapabel modell som nu har placerats oberoende – nr 4 på Artificial Analysis Text to Image Leaderboard, det bästa icke-OpenAI-bidraget där, cirka 110 Elo över den nivå den ersatte, och på listans pris-/kvalitetsfront med 60 USD per 1 000 bilder mot cirka 211 USD för OpenAI-modellerna direkt ovanför. Inramningen "världens #2" var hela tiden xAI:s ögonblicksbild vid lanseringen, och de oberoende listorna har aldrig riktigt sagt det. Dess två tydligaste oberoende svagheter – efterlevnad av förenklad kinesiska och tillförlitlighet för stilöverföring – gäller funktioner som team oftast behöver från ett bild-API. Testa det omedelbart för fotorealistiskt arbete som bevarar identitet; avvakta med det för pipelines som levererar lokaliserad text eller stiliserade tillgångar, och om du redan anropar den utgående quality-sluggen, migrera före den 2 november.
