
MAI-Image-2.6: Microsofts nya #2-bildmodell debuterar på Arena innan dess API är live
- metaNYMeta: Muse Spark 1.22026-08-0557Intelligens72Kodning
- qwenNYQwen: Qwen3.8 Max2026-08-0358Intelligens72Kodning
- deepseekNYDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligens69Kodning
- minimaxNYMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligens69Kodning
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
- metaMeta: Muse Spark 1.12026-07-1653Intelligens71Kodning
- kimiMoonshotAI: Kimi K32026-07-1560Intelligens76Kodning
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligens71Kodning
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligens77Kodning
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligens77Kodning
- grokxAI: Grok 4.52026-07-0856Intelligens72Kodning
- tencentTencent: Hy32026-07-0642Intelligens59Kodning
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligens42Kodning
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligens39Kodning
- anthropicAnthropic: Claude Sonnet 52026-06-3055Intelligens72Kodning
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligens52Kodning57Matematik
Microsofts MAI-Image-2.6 har just blivit den näst högst rankade text-till-bild-modellen på Arena-topplistan – fortfarande utan ett offentligt API. Modellen, som tillkännagavs den 10 augusti 2026, ligger på plats 2 med en Arena-poäng på 1 336, endast bakom GPT Image 2 Medium (1 381) och före Grok Imagine Image 2.0 (1 316), Metas Muse Image och Nano Banana Pro. Dess föregångare, MAI-Image-2.5, ligger på tionde plats.
Det slående är sammanhanget, inte bara rankningen. Posten som toppade på nummer 2 heter bokstavligen "mai-image-2.6-preview" och hade ungefär 3 500 röster i den ögonblicksbilden. Den klättrade åtta placeringar och fick +79 Elo jämfört med MAI-Image-2.5 i ett enda steg, och Microsoft lovar API- och Foundry-tillgång "snart" – tidiga uppgifter pekar mot nästa vecka. Det gör detta till den starkaste oberoende signalen hittills om att Microsofts interna bildsatsning har tagit igen avståndet till OpenAI – och de flesta av er kan fortfarande inte anropa det via ett API.
Nyckeltalen
• Arena text-till-bild-rankning: Nr. 2 — poäng 1 336±11, preliminärt, ~3 488 röster
• Avstånd till Nr 1 (GPT Image 2 Medium): 45 Elo
• Ledning över Nr 3 (Grok Imagine Image 2.0): 20 Elo
• Hoppa över MAI-Image-2.5: +79 Elo totalt, +91 Elo på textrendering
• Föregångarens position: MAI-Image-2.5 på plats 10 (1,256)
• Tillgänglighet: Arena nu; MAI Playground senare i veckan; APIs/Foundry förväntas nästa vecka

Vad MAI-Image-2.6 är
MAI-Image-2.6 är den senaste modellen i Microsofts interna bildgenereringsserie, utvecklad under Mustafa Suleymans Microsoft AI. Serien har rört sig snabbt: MAI-Image-1 var grunden, MAI-Image-2 (mars 2026) levererade språnget inom fotorealism och textrendering, MAI-Image-2.5 (juni 2026) tillförde professionell kvalitet och redigering och blev motorn i Bing Image Creator, PowerPoint och OneDrive, MAI-Image-2.5-Pro (juli 2026) lade till en premiumnivå med 8K – och 2.6 lanseras nu ungefär sex veckor efter sin föregångare.
Kadensen är lika viktig som modellen. Microsoft släpper bildförbättringar i en sex- till åttaveckorscykel, närmare hur frontier-labb släpper textmodeller än hur bildmarknaden historiskt har rört sig. En debut som No. 2 på Arena är vad den kadensen resulterar i när den väl ackumuleras.
Arena-resultatet, läs noga.
Arena (den omprofilerade LMArena) rankar bildmodeller genom blind mänsklig preferens: väljarna ser två bilder genererade från samma prompt och väljer den starkare. Det gör det till ett oberoende mått på vad människor faktiskt föredrar snarare än en leverantörsstyrd benchmark – vilket är anledningen till att en andraplatsdebut väger tungt. Det är också därför siffran behöver reservationer: poängen 1 336 är preliminär, baserad på cirka 3 500 röster jämfört med mer än 70 000 för modellen på första plats, och posten är märkt "förhandsvisning." Tidig röstnings-Elo rör sig; behandla riktningen som solid och den exakta poängen som provisorisk.

Var vinsterna är koncentrerade är mer intressant än rubriksiffran. Arena rankade MAI-Image-2.6 först i 3D-avbildning och modellering (upp från sjätte plats) och tvåa i tecknat/anime/fantasy (upp från åttonde plats), produkt- och varumärkesdesign samt kommersiell design (upp från sjunde plats), textrendering (upp från åttonde plats, med +91 i Elo-ökning), och konst (upp från fjärde plats). Microsoft säger att den förbättrades i varje uppmätt kategori. Den spridningen — kommersiell design, 3D, text och konst — är kännetecknet för en generell bildmodell snarare än en specialiserad en-tricksponny.
Vad som faktiskt är nytt (leverantörsrapporterat)
När det gäller kapacitet är Microsofts egna beskrivningar för MAI-Image-2.6:
• Starkare textrendering, porträtt och 3D-bilder
• Mer polerad kommersiell och fotorealistisk output för produkt-, varumärkes- och filmiska användningsfall
• Arbeta med flera referensbilder i en enda generation
• Rikare förankring — bättre följsamhet mot detaljerna i prompten
• Större kontroll över resonemang, format och upplösning
Var och en av dessa är leverantörsrapporterade och ännu inte oberoende återskapade. De enda oberoende bevisen hittills är Arena-hoppet — som är genuint oberoende men preliminärt. Tills API:et öppnas och tredje parter kan köra kontrollerade utvärderingar, behandla kapacitetslistan som Microsofts påstående och topplistan som den fungerande signalen.
När du faktiskt kan använda det
Modellen är live för testning idag, men endast via Arena. Microsoft säger att MAI Playground får det senare i veckan, och API-åtkomst plus Microsoft Foundry ”rullas ut snart” — tidiga rapporter pekar på nästa vecka. Det praktiska tecknet att hålla utkik efter: när MAI-Image-2.5 blev standard i Bing Image Creator och rullades ut i PowerPoint och OneDrive, innebar det att Microsoft ansåg den produktionssäker. En liknande 2.6-utrullning till dessa ytor blir signalen på att förhandsgranskningsetiketten tas bort.

Vad det kan kosta
Inga priser för 2.6 har publicerats. Ankaret är resten av familjen, alla leverantörsrapporterade:
• MAI-Image-2.5: $5 per miljon textinmatningstokens, $8 bildinmatning, $47 bildutdata.
• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — högvolymnivån
• MAI-Image-2.5-Pro (juli 2026): 5 $ / 8 $ / 106 $ — 8K-utdata, 96,8 % textåtergivningsnoggrannhet
Det är en femfaldig prisskillnad mellan de billigaste och dyraste bildutmatningspriserna som Microsoft redan säljer, så 2.6:s produktionskostnad kommer att avgöras av vilken nivå den hamnar i. Vid 2.5:s utmatningspris på 47 dollar per miljon hamnar en bild som förbrukar ungefär tusen utdatatokens på närmare fem cent — men Microsoft publicerar inte tokenantal per bild, så betrakta det som ett räkneexempel, inte en officiell prisuppgift.
Prisättning är också där ett routinglager bevisar sitt värde när API:et öppnas. På OrcaRouter skickas allt som Microsoft tar betalt vidare med 0 % påslag – leverantörens listpris, inget extra – så en lanseringsrabatt eller en senare prissänkning hamnar på din sida av fakturan samma dag som den tillkännages. Ingen omförhandling och inget andra kontrakt; modellen dyker upp på samma nyckel som allt annat.
Var detta lämnar bildmodellracet
Toppen av Arenas text-till-bild-topplista just nu: GPT Image 2 (Medium) på 1 381, MAI-Image-2.6 på 1 336, Grok Imagine Image 2.0 på 1 316, Reve 2.1 på 1 302 och Metas Muse Image på 1 282. Fem modeller inom ungefär 100 Elo-poäng i toppen. Den kvalitetsklyfta som brukade skilja ledaren från resten har krympt till den punkt där "bästa bildmodellen" inte längre är en relevant fråga — redigering, instruktionsföljsamhet, hastighet och pris är det.
Microsofts satsning är bredare än någon enskild topplacering på ledartavlan: en intern modellstack som spänner över bild, röst, kod och resonemang, distribuerad genom Copilot, Bing och Office. Arena-rankningen är kvittot på arbetet; distributionen är den faktiska produkten.
Hur du testar det utan att satsa produktionen på det
Arena-förhandsvisningen är gratis — gå och generera mot den idag om du vill ha den råa signalen. När API:et öppnas är det förnuftiga sättet att anta en helt ny modell med ett "preliminärt" betyg att dirigera en del av trafiken till den och behålla din beprövade modell som fallback. Det är precis den typen av feltillstånd som ett routinglager är byggt för: på OrcaRouter skulle du peka en endpoint mot MAI-Image-2.6 så fort den är hostad hos en uppströmsleverantör och låta automatisk failover fånga de kantfall som en ledarplatsrankning med 3 000 röster inte kan se. En API-nyckel, 200+ modeller, leverantörspriser som skickas vidare.
Vad du ska titta på härnäst
Huruvida MAI-Image-2.6 dyker upp på ledartavlan för bildredigering — MAI-Image-2.5 är redan en stark redigerare, och 2.6:s redigeringspoäng har inte kommit ut än.
• API-priset och vilken nivå det hamnar i.
• Huruvida Bing Image Creator och Copilot byter sin standard från 2.5 till 2.6
Oberoende riktmärken när API:et öppnas.
• Huruvida "preview"-etiketten försvinner — signalen att Microsoft är tillräckligt säkra för att sälja den
FAQ
När blir MAI-Image-2.6 tillgängligt via ett API?
Inte än. Den finns på Arena nu som en förhandsversion; Microsoft säger att API- och Foundry-åtkomst "rullas ut snart," med tidiga rapporter som pekar på nästa vecka. Inget fast datum eller pris har publicerats.
Hur nära är den GPT Image 2 Medium?
45 Elo på den aktuella Arena-snapshoten — tillräckligt nära att skillnaden mellan nr 2 och nr 1 ligger inom vad röstflödet kan flytta, och de fem bästa modellerna ligger alla inom ungefär 100 Elo.
Är No. 2 Arena-rankningen tillförlitlig?
Det är ett oberoende, blint resultat av mänskliga preferenser, vilket är precis det som gör det betydelsefullt — men det är preliminärt (cirka 3 500 röster) och kopplat till en förhandsversion. Lita på riktningen, inte decimalerna.
Slutsats: MAI-Image-2.6 är den första Microsoft-bildmodellen som verkligen hör hemma i frontier-samtalet, och den kom innan API:et gjorde det. Om priset hamnar någonstans i närheten av Flash-nivån blir den ett av de mest intressanta värdeerbjudandena inom bildgenerering i år. API:et kan inte öppna snart nog — och när det gör det kommer priset och redigeringsresultaten att tala om för dig om No. 2 var en debut eller en platå.
