Hero-titelkort för MAI-Image-2.6, Microsofts #2-text-till-bild-modell på Arena, som visar ett Arena-poäng på 1 336, en andraplats och en +79 Elo-ökning jämfört med MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview: #1 inom bildredigering, #2 inom text-till-bild

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Microsofts MAI-Image-2.6-Preview är inte längre bara en post på Arenas leaderboard som du inte kan röra – den är nu en självständig leaderboard-topp. Den 25 augusti rankade Artificial Analysis, den oberoende benchmark-organisationen, samma förhandsversion som nummer 1 på sin Image Editing Leaderboard och nummer 2 i Text to Image. Förstaplatsen inom redigering placerar den före Microsofts egen MAI-Image-2.5-Pro (den tidigare ledaren), Reve 2.1 och OpenAIs GPT Image 2, vilket ger Microsoft de två översta positionerna på den listan. Modellen blev tillgänglig i privat förhandsvisning på MAI Playground och Microsoft Foundry den 19 augusti, enligt Microsofts tillkännagivande – inbjudningsbaserad, fortfarande inget offentligt API, fortfarande ingen prislista.

Det slående är utvecklingskurvan, inte bara placeringen. Bidraget som nådde andra plats på Arenas text-till-bild-topplista heter bokstavligen "mai-image-2.6-preview", hade cirka 3 500 röster i den ögonblicksbilden och klättrade åtta platser med +79 Elo jämfört med MAI-Image-2.5 i ett enda steg. Sedan dess har bilden fyllts i snabbt: tillgång till privat förhandsvisning öppnades på MAI Playground och Microsoft Foundry den 19 augusti, Arenas bildredigeringstopplista flyttade bygget upp till tredje plats, och nu har Artificial Analysis den på första plats i bildredigering och andra plats i text-till-bild. Det gör detta till den starkaste oberoende signalen hittills att Microsofts interna bildsatsning har minskat gapet mot OpenAI – och det offentliga API:et är fortfarande inte allmänt tillgängligt.

Nyckeltalen

• Arena text-till-bild-rankning: Nr. 2 — poäng 1 336±11, preliminärt, ~3 488 röster

• Avstånd till Nr 1 (GPT Image 2 Medium): 45 Elo

• Ledning över Nr 3 (Grok Imagine Image 2.0): 20 Elo

• Hoppa över MAI-Image-2.5: +79 Elo totalt, +91 Elo på textrendering

• Föregångarens position: MAI-Image-2.5 på plats 10 (1,256)

• Bildredigeringsrankning: Nr 3 på Arenas "Single Image Edit" — 1 420 poäng, upp från nr 5

• Artificial Analysis rankning för bildredigering: Nr. 1 — före MAI-Image-2.5-Pro (den tidigare Nr. 1), Reve 2.1 och GPT Image 2; Microsoft innehar de två främsta platserna

• Artificial Analysis text-till-bild-rank: Nr 2 — endast efter GPT Image 2; först i 5 av 19 kategoritavlor

• Privat förhandsversion: annonserades den 19 aug på MAI Playground och Microsoft Foundry — leverantörsuppgivet, inbjudningsbaserat, ingen prissättning ännu

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

Vad MAI-Image-2.6 är

MAI-Image-2.6 är den senaste modellen i Microsofts interna bildgenereringsserie, utvecklad under Mustafa Suleymans Microsoft AI. Serien har rört sig snabbt: MAI-Image-1 var grunden, MAI-Image-2 (mars 2026) levererade språnget inom fotorealism och textrendering, MAI-Image-2.5 (juni 2026) tillförde professionell kvalitet och redigering och blev motorn i Bing Image Creator, PowerPoint och OneDrive, MAI-Image-2.5-Pro (juli 2026) lade till en premiumnivå med 8K – och 2.6 lanseras nu ungefär sex veckor efter sin föregångare.

Takten är lika viktig som modellen. Microsoft levererar bildförbättringar i en sex- till åttaveckorscykel, närmare hur ledande labb skickar ut textmodeller än hur bildmarknaden historiskt har rört sig. En Arena-debut som nummer två vid lanseringen, och en redigeringsrankning som nummer tre en vecka senare, är vad den takten innebär när den väl ackumuleras.

Topplistans resultat, läs noga.

Arena (det omdöpta LMArena) rankar bildmodeller genom blind mänsklig preferens: väljare ser två bilder genererade från samma prompt och väljer den starkare. Artificial Analysis kör samma typ av oberoende blind-preferens-arena med egna Elo-betyg. Båda är oberoende mått på vad människor faktiskt föredrar snarare än leverantörsdrivna riktmärken – vilket är anledningen till att en andraplatsdebut har verklig tyngd, och att två separata rankinglistor som är överens om samma modell betyder mer än något av siffrorna ensamma. Det är också därför siffrorna behöver reservationer: Arenas poäng på 1 336 är preliminär, baserad på cirka 3 500 röster jämfört med mer än 70 000 för modellen på första plats, och posten är märkt ”preview”. Tidiga röster flyttar Elo; behandla riktningen som säker och den exakta poängen som provisorisk.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

Var vinsterna är koncentrerade är mer intressant än rubriksiffran. Arena rankade MAI-Image-2.6 först i 3D-avbildning och modellering (upp från sjätte plats) och tvåa i tecknat/anime/fantasy (upp från åttonde plats), produkt- och varumärkesdesign samt kommersiell design (upp från sjunde plats), textrendering (upp från åttonde plats, med +91 i Elo-ökning), och konst (upp från fjärde plats). Microsoft säger att den förbättrades i varje uppmätt kategori. Den spridningen — kommersiell design, 3D, text och konst — är kännetecknet för en generell bildmodell snarare än en specialiserad en-tricksponny.

Sedan kom ytterligare två datapunkter. Arenas bildredigeringslista – kategorin "Single Image Edit" – placerar samma mai-image-2.6-preview-version på tredje plats med 1 420 poäng, upp från femte plats och 19 poäng före MAI-Image-2.5, där textrendering är den enskilt största ökningen (+43 poäng). Den 25 augusti gick Artificial Analysis längre: dess Image Editing Leaderboard placerar preview-versionen på första plats, och tar därmed topplatsen från Microsofts egen MAI-Image-2.5-Pro (tidigare etta med 1 272 Elo) och ligger före Reve 2.1 och OpenAI:s GPT Image 2 – Microsoft innehar nu de två översta redigeringsplatserna på den listan. Microsofts AI-chef Mustafa Suleyman kallade 2.6 för "den bästa bildredigeringsmodellen på AA" och sade att Microsoft innehar tre av de fem översta platserna – det är leverantörens beskrivning; de underliggande rankingarna är Artificial Analysis egna. AA:s redigeringspoäng för själva preview-versionen har inte publicerats, och båda listorna är tidiga och har få röster, så betrakta riktningen som säker och de exakta siffrorna som preliminära.

Vad som faktiskt är nytt (leverantörsrapporterat)

När det gäller kapacitet är Microsofts egna beskrivningar för MAI-Image-2.6:

• Starkare textrendering, porträtt och 3D-bilder

• Mer polerad kommersiell och fotorealistisk output för produkt-, varumärkes- och filmiska användningsfall

• Arbeta med flera referensbilder i en enda generation

• Rikare förankring — bättre följsamhet mot detaljerna i prompten

• Större kontroll över resonemang, format och upplösning

Var och en av dessa är leverantörsrapporterad och ännu inte oberoende reproducerad. De oberoende bevisen är leaderboard-paret: nr 2 i text-till-bild på både Arena och Artificial Analysis, nr 3 på Arenas redigeringslista och nr 1 på Artificial Analysis redigeringslista — allt preliminärt. Tills MAI-Image-2.6 är allmänt tillgänglig och tredje parter kan köra kontrollerade utvärderingar, betrakta kapabilitetslistan som Microsofts påstående och de två leaderboardarna som den fungerande signalen.

När du faktiskt kan använda det

MAI-Image-2.6 gick den här veckan från "endast Arena" till "Arena plus en officiell förhandsversion". Den 19 augusti meddelade Microsoft att modellen finns tillgänglig i privat förhandsversion på MAI Playground och Microsoft Foundry. Det är leverantörens eget uttalande, och förhandsversionen är inbjudningsbaserad snarare än en öppen anmälan – så det finns fortfarande ingen prislista och inget API med betalning per token. Det praktiska tecknet att hålla utkik efter: när MAI-Image-2.5 blev standard i Bing Image Creator och rullades ut till PowerPoint och OneDrive, innebar det att Microsoft ansåg den produktionssäker. En liknande utrullning av 2.6 till dessa ytor – eller att "preview"-etiketten försvinner – kommer att vara signalen att den är redo för produktionsarbetsbelastningar.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

Vad det kan kosta

Inga priser för 2.6 har publicerats — den privata förhandsvisningen har ingen prislista. Ankaret är resten av familjen, allt leverantörsrapporterat:

• MAI-Image-2.5: $5 per miljon textinmatningstokens, $8 bildinmatning, $47 bildutdata.

• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — högvolymnivån

• MAI-Image-2.5-Pro (juli 2026): 5 $ / 8 $ / 106 $ — 8K-utdata, 96,8 % textåtergivningsnoggrannhet

Det är en femfaldig prisskillnad mellan de billigaste och dyraste bildutmatningspriserna som Microsoft redan säljer, så 2.6:s produktionskostnad kommer att avgöras av vilken nivå den hamnar i. Vid 2.5:s utmatningspris på 47 dollar per miljon hamnar en bild som förbrukar ungefär tusen utdatatokens på närmare fem cent — men Microsoft publicerar inte tokenantal per bild, så betrakta det som ett räkneexempel, inte en officiell prisuppgift.

Prissättning är också där ett routinglager gör skäl för sig när modellen når ett publikt API. På OrcaRouter förs det som Microsoft tar betalt vidare med 0 % påslag — leverantörens listpris, inget extra — så en lanseringsrabatt eller en senare prissänkning hamnar på din faktura samma dag som den tillkännages. Ingen omförhandling och inget andra kontrakt; modellen dyker upp på samma nyckel som allt annat.

Var detta lämnar bildmodellracet

Toppen av Arenas text-till-bild-topplista just nu: GPT Image 2 (Medium) på 1 381, MAI-Image-2.6 på 1 336, Grok Imagine Image 2.0 på 1 316, Reve 2.1 på 1 302 och Metas Muse Image på 1 282. Fem modeller inom ungefär 100 Elo i toppen. Artificial Analysis kommer fram till samma övergripande slutsats — Nr 2 i text-till-bild, bakom endast GPT Image 2 — och lägger till kategoridetaljer: förhandsversionen tar förstaplatsen i 5 av sina 19 text-till-bild-kategorier (Material, Knowledge, Frontier, Retail & Ecommerce och Marketing & Advertising), medan GPT Image 2 leder alla andra. Två oberoende preferensbaserade topplistor som pekar i samma riktning är den starkaste indikationen du kan få om en så här ung modell. Den kvalitetsklyfta som förut skilde ledaren från de andra har krympt så mycket att "bästa bildmodellen" inte längre är en användbar fråga — redigering, förankring, hastighet och pris är det.

Microsofts satsning är bredare än någon enskild topplacering på en ledartavla: en egen modellstack som täcker bild, röst, kod och resonemang, distribuerad genom Copilot, Bing och Office. Arena-rankningarna är beviset på prestation; distributionen är den faktiska produkten.

Hur du testar det utan att satsa produktionen på det

Arena-förhandsversionen är gratis — testa den idag om du vill ha den råa signalen. Har du tillgång till den privata förhandsversionen kan MAI Playground och Microsoft Foundrys ingångspunkter låta dig köra verkliga arbetsbelastningar innan du förbinder dig. För alla andra är det förnuftigaste sättet att börja använda en helt ny modell med ett "preliminärt" betyg att dirigera en del av trafiken till den och ha kvar din beprövade modell som reserv. Det är precis det felscenario som ett routingskikt är byggt för: på OrcaRouter skulle du peka en slutpunkt mot MAI-Image-2.6 när den väl är hostad hos en uppströmsleverantör och låta automatisk failover fånga upp gränsfall som ett ledarlistebetyg med få röster inte kan se. En API-nyckel, 200+ modeller, leverantörspriser som skickas vidare.

Vad du ska titta på härnäst

• Huruvida Artificial Analysis redigeringsrankning nr 1 och Arena nr 3 håller i sig allt eftersom rösterna rullar in — båda listorna är i ett tidigt skede och har få röster.

Det offentliga API-priset och vilken nivå det hamnar i — den privata förhandsversionen har fortfarande ingen prislista.

• Huruvida Bing Image Creator och Copilot byter sin standard från 2.5 till 2.6

Oberoende riktmärken när API:et öppnas.

• Huruvida "preview"-etiketten försvinner — signalen att Microsoft är tillräckligt säkra för att sälja den

Vanliga frågor

När kan jag egentligen använda MAI-Image-2.6?

Just nu via Arena, som är gratis. Sedan den 19 augusti är den också i privat förhandsversion på MAI Playground och Microsoft Foundry — enligt Microsofts eget tillkännagivande, så åtkomsten är inbjudningsbaserad snarare än en offentlig registrering. Det finns fortfarande inget offentligt API med betalning per token och inget publicerat pris.

Hur starkt är bildredigeringsresultatet?

På Artificial Analysis Image Editing Leaderboard är MAI-Image-2.6-Preview nummer 1, före MAI-Image-2.5-Pro, Reve 2.1 och GPT Image 2 — Microsoft har de två topplatserna. På Arenas "Single Image Edit"-lista är den nummer 3 med 1 420 poäng, upp från nummer 5. Båda är oberoende blindpreferensresultat men tidiga och med få röster, och AA-redigeringspoängen för preview-versionen har inte publicerats.

Hur nära är den GPT Image 2 Medium?

45 Elo på den aktuella text-till-bild-arenans ögonblicksbild — tillräckligt nära för att skillnaden mellan nr 2 / nr 1 ligger inom vad röstflödet kan förändra, och de fem bästa modellerna ligger alla inom ungefär 100 Elo.

Är Arena-rankerna tillförlitliga?

De är oberoende, blinda resultat från mänskliga preferenser, vilket är precis det som gör dem meningsfulla — men båda är preliminära (cirka 3 500 röster på text-till-bild-tavlan) och kopplade till en förhandsversion. Lita på riktningen, inte på decimalerna.

Slutsats: MAI-Image-2.6-Preview är den första Microsoft-bildmodellen som verkligen hör hemma i frontlinjen – och den tog sig dit snabbt: nr 2 på Arenas text-till-bild-tavla vid debuten, nr 1 i bildredigering på Artificial Analysis den 25 augusti, och privat förhandsvisning på Microsofts egna ytor innan något offentligt API. Två oberoende tavlor pekar nu åt samma håll. Om det slutgiltiga priset hamnar i närheten av Flash-nivån blir det ett av årets mest intressanta värdeerbjudanden inom bildgenerering. Redigeringsrankningarna och förhandsvisningen svarar på "är detta på riktigt." Det offentliga API:t och dess pris kommer att svara på "är detta värt att bygga på."