Carte vedette pour MAI-Image-2.5-Pro, le modèle d'image de Microsoft axé sur la qualité, montrant son classement #1 en édition d'images et #7 en texte-vers-image dans le classement Artificial Analysis.
Guides & Insights

MAI-Image-2.5-Pro s'empare de la première place en édition d'images : ce que la victoire indépendante de Microsoft prouve réellement

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

MAI-Image-2.5-Pro est désormais le modèle d'édition d'images le mieux noté du classement d'Artificial Analysis — un classement indépendant reposant sur un vote à l'aveugle — alors qu'il ne se classe qu'au septième rang en simple génération texte-image. Cet écart est toute l'histoire : un modèle en préversion publique depuis moins d'un mois, entièrement conçu en interne par Microsoft AI, a dépassé GPT Image 2, Reve 2.1, et son propre jumeau MAI-Image-2.5 au classement d'édition d'images, mais reste à la traîne de la plupart des mêmes concurrents lorsque la requête est « dessine-moi quelque chose à partir de rien ». Lisez les deux chiffres ensemble et vous obtenez une image précise de ce que Microsoft a livré : un spécialiste de la modification d'images existantes, pas un générateur polyvalent.

Les deux nombres, côte à côte

D'après l'instantané d'août 2026, l'Image Editing Arena d'Artificial Analysis place MAI-Image-2.5-Pro à N° 1 avec un Elo de 1 272, reposant sur environ 6 100 comparaisons d'utilisateurs en aveugle. La concurrence est serrée : Reve 2.1 à 1 262, puis MAI-Image-2.5 et GPT Image 2 (high) à égalité à 1 256, GPT Image 1.5 (high) à 1 250, Qwen-Image-3.0-Pro à 1 249, et Nano Banana 2 de Go​gle à 1 249. Sur la Text-to-Image Arena, il se situe à N° 7 avec un Elo de 1 292, derrière GPT Image 2 (high) à 1 369, Reve 2.1 à 1 322, Nano Banana 2 à 1 320, GPT Image 1.5 (high) à 1 310, MAI-Image-2.5 à 1 304 et Nano Banana Pro à 1 296.

Édition : n° 1 — 1 272 Elo, ~6 100 échantillons

Texte vers image: n° 7 — 1 292 Elo, ~11 500 échantillons

Écart avec le n° 2 en édition : 10 Elo de plus que Reve 2.1

Écart avec le n° 1 en texte-vers-image : 77 Elo de retard sur GPT Image 2 (élevé)

Ce qui fait que le classement d'édition vaut plus qu'un chiffre de vanité, c'est le mécanisme. L'arène Artificial Analysis repose sur une préférence humaine en aveugle : les votants voient la même image d'entrée et la même instruction, reçoivent deux résultats édités et choisissent le plus convaincant. Aucun script de fournisseur n'écrit le score. Ainsi, une première place là-bas est ce que le marché a de plus proche de « les gens ont préféré les résultats de cet éditeur » — et c'est une récente montée, et non un feu de paille du jour du lancement. Considérez la tendance comme solide et l'Elo exact comme provisoire ; les classements avec peu de votes bougent.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 and 6,133 samples, ahead of Reve 2.1 at 1,262, MAI-Image-2.5 at 1,256, and GPT Image 2 (high) at 1,256

Le classement texte-à-image, capturé le même jour, présente le même modèle sous un jour différent — n'étant plus en tête, mais figurant toujours confortablement dans le top dix d'un peloton resserré entre 1 290 et 1 370 Elo.

Screenshot of the Artificial Analysis Text to Image Leaderboard showing MAI-Image-2.5-Pro at No. 7 with Elo 1,292 behind GPT Image 2 (high), Reve 2.1, Nano Banana 2, GPT Image 1.5 (high), MAI-Image-2.5, and Nano Banana Pro

Ce qu'est réellement MAI-Image-2.5-Pro

MAI-Image-2.5-Pro est le niveau de qualité de la famille MAI-Image-2.5 de Microsoft AI, annoncé le 23 juillet 2026 aux côtés de MAI-Voice-2-Flash et placé en aperçu public sur Microsoft Foundry (Azure AI Foundry) et le MAI Playground gratuit. Microsoft le décrit comme son modèle d'image à la plus haute fidélité à ce jour, destiné aux visuels hero, à l'édition détaillée et au rendu précis du texte dans l'image. La famille couvre désormais toute la courbe des coûts : MAI-Image-2.5 pour les usages équilibrés, MAI-Image-2.5-Flash pour les volumes élevés, et le niveau Pro au sommet de la qualité — avec une déclinaison plus récente, MAI-Image-2.6, déjà en aperçu privé depuis le 19 août.

Les propres affirmations de Microsoft pour le niveau Pro, toutes rapportées par le fournisseur et aucune encore reproduite de manière indépendante :

96,8 % de précision du rendu du texte — signalée comme couvrant le chinois, l’anglais, le japonais, le coréen et l’espagnol, bien que la même documentation plafonne la sortie à environ un mégapixel, de sorte que la mention « 8K » dans l’affirmation relève davantage du marketing.

27 % de meilleure adhérence aux instructions que GPT-Image-1.5 lors des évaluations internes de Microsoft.

94% de cohérence des personnages multi-images à travers les générations.

Jusqu'à 84–89 % de réduction du coût GPU par rapport aux modèles G​PT dans des scénarios Microsoft spécifiques (PowerPoint, OneDrive), pas un chiffre général.

La fiche technique documentée est ce qui fonde ces affirmations : saisie de texte jusqu’à 32 000 jetons, une fenêtre contextuelle de 131 000 jetons, 4 096 jetons de sortie, saisie d’images JPEG/PNG, et sortie plafonnée à 1 048 576 pixels (l’équivalent d’une image 1024×1024). Ce dernier chiffre importe pour les acheteurs : il s’agit d’un excellent éditeur, et non un générateur en résolution d’impression.

Là où la qualité se manifeste

La force d'édition mesurée par le classement correspond à ce que Microsoft met en avant : {{1}}des modifications précises et chirurgicales qui préservent la cohérence du reste de l'image{{/1}}. {{2}}Le remplacement ciblé d'objets, les changements de mise en page, les mises à jour de texte dans l'image et le nettoyage des artefacts tels que le flou de mouvement{{/2}} — la catégorie de modifications où les anciens modèles régénèrent toute la scène et perdent le sujet. Ajoutez à cela l'affirmation d'une cohérence des personnages de 94 % et vous obtenez un modèle conçu pour le flux de travail qui compte commercialement : {{3}}prenez un actif existant, changez une chose, livrez-le{{/3}}.

Le rang n°7 en texte-à-image est le contrepoids honnête. À partir d'une invite vide, MAI-Image-2.5-Pro est bon mais pas le leader — 77 Elo derrière GPT Image 2 (high) est un écart réel sur un classement en aveugle. Microsoft ne revendique actuellement pas la couronne du texte-à-image ; il revendique celle de l'édition, et les données soutiennent la revendication la plus étroite bien mieux que la plus large.

Ce que ça coûte

MAI-Image-2.5-Pro est facturé au jeton sur Foundry : 5 $ par million de jetons de texte en entrée, 8 $ par million de jetons d'image en entrée, 106 $ par million de jetons d'image en sortie. Microsoft ne publie pas le nombre de jetons par image, le coût par image est donc une simple opération arithmétique, et non un devis ; en utilisant la conversion d'Artificial Analysis, une image 1024×1024 revient à environ 108,50 $ pour 1 000 images. C'est environ 2,3× le coût du modèle frère MAI-Image-2.5 (~48 $ pour 1 000) et 5,4× celui de MAI-Image-2.5-Flash (~20 $ pour 1 000) — le niveau Pro est un choix résolument premium.

Le tarif d’aperçu n’est pas le tarif de disponibilité générale ; la grille tarifaire d’aperçu peut évoluer avant la disponibilité générale. Lorsque cela se produit, une couche de routage en transparence permet à une baisse de prix d’atteindre votre facture le jour même : sur OrcaRouter, le prix catalogue du fournisseur est répercuté avec une marge de 0 %, donc dès que MAI-Image-2.5-Pro est accessible via une API tierce appelable, ce que Microsoft facture est exactement ce que vous payez — sans renégociation, sans second contrat.

Scoreboard for MAI-Image-2.5-Pro: image editing rank No. 1 at 1,272 Elo, text-to-image rank No. 7 at 1,292 Elo, price about USD 108.50 per 1k images, 32k text input tokens, 131k context window, ~1-megapixel output cap, preview status on Microsoft Foundry

Pourquoi la première place revient à Microsoft l'entreprise, pas seulement au modèle

Ce résultat au classement arrive à un moment où Microsoft remplace visiblement les modèles d'images tiers par les siens. MAI-Image-2.5 est déjà le moteur par défaut de Bing Image Creator et fonctionne dans PowerPoint, OneDrive et Dynamics 365 Contact Center ; le niveau Pro appartient à la même famille, conçu pour des travaux de plus haute fidélité. Microsoft a déclaré que les modèles MAI sont entraînés sur des données propres et traçables « sans distillation à partir de modèles tiers » — une réponse directe à la question de la dépendance à OpenAI, et les affirmations sur les coûts (jusqu'à 84 % de coût GPU en moins dans PowerPoint, rapportées par le fournisseur et spécifiques à certains scénarios) s'inscrivent dans la même logique : un modèle interne moins cher par tâche que le modèle qu'il remplace.

Rien de tout cela ne serait prouvable à un acheteur sceptique sans le classement indépendant, c'est pourquoi la première place est stratégiquement significative plutôt qu'un simple score. C'est la première preuve indépendante que la gamme d'images interne de Microsoft surpasse la concurrence sur la tâche spécifique pour laquelle elle est conçue.

Que regarder ensuite

L'avance en édition se maintient-elle à mesure que les votes s'accumulent ? 1 272 Elo sur ~6 100 échantillons est une avance, pas une garantie ; Reve 2.1 est 10 points derrière.

Disponibilité générale et grille tarifaire finale — le prix de préversion n'est pas le prix GA.

Le plafond de résolution. Un plafond de 1 mégapixel exclut Pro du travail d'impression ; si Microsoft le supprime, la donne change.

MAI-Image-2.6 (aperçu privé, 19 août) — la prochaine étape de la famille, classée n° 2 en texte-à-image sur l'autre arène principale.

Évaluations indépendantes des allégations du fournisseur — la précision du rendu du texte et la cohérence des caractères ne sont pas vérifiées en dehors de Microsoft.

La conclusion à retenir du classement scindé n'est pas « Microsoft fabrique désormais le meilleur modèle d'image ». Elle est plus précise et plus utile : Microsoft fabrique désormais l'éditeur d'images le plus réputé sur un classement indépendant, à un prix premium, en version préliminaire, avec un plafond de résolution strict. Si votre travail consiste à modifier des images existantes — photos principales, visuels produits, texte dans l'image — c'est exactement le modèle à surveiller. Si votre travail consiste à générer sur toile vierge, la 7e place indique que le meilleur choix reste GPT Image 2 — et c'est la lecture honnête que vous donnent les deux chiffres.

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube