
MAI-Image-2.5-Pro verovert de #1-positie in beeldbewerking: wat Microsofts onafhankelijke overwinning daadwerkelijk bewijst
- AlibabaNIEUWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.3 Flash2026-08-2658Intelligentie72Coderen
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
MAI-Image-2.5-Pro is nu het hoogst gewaardeerde beeldbewerkingsmodel op het leaderboard van Artificial Analysis — een onafhankelijk, blind stemmend bord — terwijl het bij pure tekst-naar-afbeelding nog slechts zevende staat. Die tweedeling is het verhaal: een model dat nog geen maand in publieke preview is, volledig in-house gebouwd door Microsoft AI, heeft GPT Image 2, Reve 2.1, en zijn eigen zustermodel MAI-Image-2.5 op de bewerkingslijst ingehaald, maar blijft achter bij de meeste van hetzelfde veld wanneer de prompt is "teken me iets uit het niets." Lees beide cijfers samen en je krijgt een precies beeld van wat Microsoft heeft uitgebracht: een specialist in het veranderen van bestaande afbeeldingen, geen general-purpose generator.
De twee getallen, naast elkaar.
Vanaf de momentopname van augustus 2026 plaatst de Image Editing Arena van Artificial Analysis MAI-Image-2.5-Pro op nummer 1 met Elo 1.272, gebaseerd op ongeveer 6.100 blinde gebruikersvergelijkingen. De achtervolgende groep zit dicht bij elkaar: Reve 2.1 op 1.262, gevolgd door MAI-Image-2.5 en GPT Image 2 (high) gelijk op 1.256, GPT Image 1.5 (high) op 1.250, Qwen-Image-3.0-Pro op 1.249, en Nano Banana 2 van Gogle op 1.249. Op de Text-to-Image Arena staat het op nummer 7 met Elo 1.292, achter GPT Image 2 (high) op 1.369, Reve 2.1 op 1.322, Nano Banana 2 op 1.320, GPT Image 1.5 (high) op 1.310, MAI-Image-2.5 op 1.304, en Nano Banana Pro op 1.296.
• Bewerken: Nr. 1 — 1.272 Elo, ~6.100 samples
• Tekst-naar-afbeelding: Nr. 7 — 1.292 Elo, ~11.500 samples
• Verschil met nr. 2 bij bewerken: 10 Elo boven Reve 2.1
• Kloof met nummer 1 op text-to-image: 77 Elo achter GPT Image 2 (hoog)
Wat de bewerkingsranglijst meer waard maakt dan een ijdel nummer, is het mechanisme. De Artificial Analysis-arena draait om blinde menselijke voorkeur: stemmers zien dezelfde invoerafbeelding en instructie, krijgen twee bewerkte resultaten en kiezen de sterkere. Geen leveranciersscript schrijft de score. Dus een #1 daar komt het dichtst in de buurt van 'mensen vonden de output van deze editor het beste' wat de markt te bieden heeft — en het is een recente stijging, geen lanceerdag-uitschieter. Beschouw de richting als betrouwbaar en de exacte Elo als voorlopig; ranglijsten met weinig stemmen verschuiven.

Het text-to-image-bord, op dezelfde dag vastgelegd, is hetzelfde model in een ander licht — niet langer leidend, maar nog steeds comfortabel in de top tien van een veld dat dicht opeen ligt tussen 1.290 en 1.370 Elo.

Wat MAI-Image-2.5-Pro eigenlijk is
{{1}}MAI-Image-2.5-Pro is Microsoft AI's kwaliteitsniveau van de MAI-Image-2.5-familie{{/1}}, {{2}}aangekondigd op 23 juli 2026 naast MAI-Voice-2-Flash{{/2}} en {{3}}in openbare preview geplaatst op Microsoft Foundry (Azure AI Foundry) en de gratis MAI Playground{{/3}}. {{4}}Microsoft beschrijft het als zijn meest realistische beeldmodel tot nu toe{{/4}}, {{5}}gericht op hero-afbeeldingen, gedetailleerd bewerken{{/5}} en {{6}}nauwkeurige tekstweergave in afbeeldingen{{/6}}. {{7}}De familie bestrijkt nu de kostencurve{{/7}}: {{8}}MAI-Image-2.5 voor gebalanceerd werk{{/8}}, {{9}}MAI-Image-2.5-Flash voor hoge volumes{{/9}}, en {{10}}het Pro-niveau aan de kwaliteitskant{{/10}} — {{11}}met een nieuwer zustermodel, MAI-Image-2.6{{/11}}, {{12}}al in privé-preview sinds 19 augustus{{/12}}.
Microsofts eigen beweringen voor de Pro-tier, allemaal door de leverancier gerapporteerd en nog geen enkele onafhankelijk gereproduceerd:
• 96,8% nauwkeurigheid van tekstweergave — gemarkeerd als dekkend voor Chinees, Engels, Japans, Koreaans en Spaans, hoewel dezelfde documentatie de output beperkt tot ruwweg een megapixel, dus de '8K'-formulering in de claim kan het beste als marketing worden beschouwd.
• 27% betere prompttrouw dan GPT-Image-1.5 in Microsofts interne evaluaties.
• 94% consistentie van personages over meerdere afbeeldingen en generaties heen.
• Tot 84–89% lagere GPU-kosten vergeleken met GPT-modellen in specifieke Microsoft-scenario's (PowerPoint, OneDrive), geen algemeen getal.
Het gedocumenteerde specificatieblad is wat die beweringen onderbouwt: tekstinvoer tot 32.000 tokens, een contextvenster van 131k, 4.096 uitvoertokens, invoer van JPEG/PNG-afbeeldingen en uitvoer beperkt tot 1.048.576 pixels (gelijk aan 1024×1024). Dat laatste getal is belangrijk voor kopers: dit is een hoogwaardige editor, geen printresolutie-generator.
Waar de kwaliteit zichtbaar wordt
De bewerkingskracht die het leaderboard meet, komt overeen met waar Microsoft de nadruk op legt: precieze, chirurgische bewerkingen die de rest van de afbeelding consistent houden. Gerichte objectvervanging, lay-outwijzigingen, tekstupdates in de afbeelding en het opruimen van artefacten zoals bewegingsonscherpte — de categorie bewerkingen waarbij oudere modellen de hele scène opnieuw genereren en het onderwerp verliezen. Combineer dat met de claim van 94% karakterconsistentie en je hebt een model dat is ontworpen voor de workflow die commercieel van belang is: neem een bestaand asset, verander één ding, lever het op.
De #7-positie op de text-to-image-ranglijst is het eerlijke tegenwicht. Vanuit een lege prompt is MAI-Image-2.5-Pro goed, maar niet de leider — 77 Elo achter GPT Image 2 (high) is een echte kloof op een blind leaderboard. Microsoft claimt momenteel niet de text-to-image-kroon; het claimt de bewerkingskroon, en de gegevens ondersteunen de engere claim veel beter dan de bredere.
Wat het kost
MAI-Image-2.5-Pro wordt op Foundry per token gemeten: $5 per miljoen tekstinvoertokens, $8 per miljoen afbeeldingsinvoertokens, $106 per miljoen afbeeldingsuitvoertokens. Microsoft publiceert geen tokens-per-afbeelding, dus de kosten per afbeelding zijn een berekening, geen prijsopgave; met de conversie van Artificial Analysis komt een 1024×1024-afbeelding uit op ongeveer $108,50 per 1.000 afbeeldingen. Dat is ruwweg 2,3× het zustermodel MAI-Image-2.5 (~$48 per 1k) en 5,4× MAI-Image-2.5-Flash (~$20 per 1k) — de Pro-tier is een bewuste meerprijs.
Preview-prijzen zijn geen GA-prijzen; de preview-prijslijst kan wijzigen vóór algemene beschikbaarheid. Wanneer dat gebeurt, is een doorgeef-routelaag de manier waarop een prijsverlaging dezelfde dag op uw factuur terechtkomt: op OrcaRouter wordt de catalogusprijs van de provider doorgegeven met 0% opslag, dus zodra MAI-Image-2.5-Pro bereikbaar is via een aanroepbare API van derden, is wat Microsoft ook in rekening brengt exact wat u betaalt — geen heronderhandeling, geen tweede contract.

Waarom de #1 aan Microsoft het bedrijf toebehoort, niet alleen aan het model
Het leaderboardresultaat komt op een moment dat Microsoft zichtbaar modellen van derden voor beeldgeneratie vervangt door eigen modellen. MAI-Image-2.5 is al de standaardengine in Bing Image Creator en draait in PowerPoint, OneDrive en Dynamics 365 Contact Center; de Pro-laag is dezelfde familie gericht op werk met hogere nauwkeurigheid. Microsoft heeft gezegd dat de MAI-modellen zijn getraind op schone, traceerbare gegevens 'zonder distillatie van modellen van derden' — een direct antwoord op de vraag over afhankelijkheid van OpenAI, en de kostenclaims (tot 84% lagere GPU-kosten in PowerPoint, door leverancier gerapporteerd en scenariospecifiek) maken deel uit van hetzelfde verhaal: een eigen model dat per taak goedkoper is dan het model dat het vervangt.
Niets daarvan zou bewijsbaar zijn voor een sceptische koper zonder het onafhankelijke klassement, en daarom is de nummer 1 strategisch betekenisvol in plaats van slechts een score. Het is het eerste onafhankelijke bewijs dat Microsofts eigen beeldgeneratielijn het veld verslaat bij de specifieke taak waarvoor het is gebouwd.
Wat nu te kijken
• Houdt de bewerkingsvoorsprong stand naarmate de stemmen zich ophopen? 1.272 Elo op ~6.100 samples is een voorsprong, geen zekerheid; Reve 2.1 staat 10 punten achter.
• Algemene beschikbaarheid en de definitieve tariefkaart — de preview-prijs is niet de GA-prijs.
• Het resolutieplafond. Een limiet van 1 megapixel houdt Pro buiten drukwerk; als Microsoft deze limiet opheft, verandert het verhaal.
• MAI-Image-2.6 (privépreview, 19 augustus) — de volgende stap in de familie, op nummer 2 voor tekst-naar-afbeelding op de andere hoofdarena.
• Onafhankelijke evaluaties van de claims van de leverancier — de nauwkeurigheid van de tekstweergave en de consistentie van tekens zijn buiten Microsoft niet geverifieerd.
De belangrijkste conclusie van het gesplitste leaderboard is niet "Microsoft maakt nu het beste beeldmodel." Het is smaller en nuttiger: Microsoft maakt nu de best aangeschreven beeldeditor op een onafhankelijk leaderboard, tegen een premium prijs, in preview, met een harde resolutielimiet. Als je werk bestaat uit het wijzigen van bestaande afbeeldingen — hero shots, productbeelden, tekst in afbeeldingen — dan is dat precies het model om in de gaten te houden. Als je werk bestaat uit generatie vanaf een leeg canvas, zegt de #7-positie dat de betere keuze nog steeds GPT Image 2 is — en dat is de eerlijke conclusie die beide cijfers je geven.
