Carte de titre principale pour MAI-Image-2.6, le modèle texte-image n°2 de Microsoft sur Arena, affichant un score Arena de 1 336, un rang n°2 et un gain de +79 Elo par rapport à MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview : #1 en édition d'images, #2 en texte-vers-image

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le MAI-Image-2.6-Preview de Microsoft n'est plus seulement une entrée du classement Arena que vous ne pouvez pas toucher : c'est désormais un leader indépendant du classement. Le 25 août, Artificial Analysis, l'organisme indépendant d'évaluation comparative, a classé la même version d'aperçu n° 1 dans son classement d'édition d'images et n° 2 en texte vers image. La première place en édition la place devant le MAI-Image-2.5-Pro de Microsoft (le précédent leader), Reve 2.1 et GPT Image 2 d'OpenAI, donnant à Microsoft les deux premières positions de ce classement. Le modèle est entré en aperçu privé sur MAI Playground et Microsoft Foundry le 19 août, selon l'annonce de Microsoft — accès sur invitation, toujours pas d'API publique, toujours pas de grille tarifaire.

Ce qui est frappant, c'est la trajectoire, pas seulement le rang. L'entrée qui a culminé à la n° 2 du classement text-to-image d'Arena porte littéralement le nom de « mai-image-2.6-preview », comptait environ 3 500 votes à cet instantané et a grimpé de huit places avec un gain de +79 Elo par rapport à MAI-Image-2.5 en une seule étape. Depuis, le tableau s'est rapidement précisé : l'accès en aperçu privé a été ouvert sur MAI Playground et Microsoft Foundry le 19 août, le classement d'édition d'images d'Arena a fait passer le build à la n° 3, et désormais Artificial Analysis le classe en n° 1 en édition d'images et en n° 2 en text-to-image. Ce qui en fait le signal indépendant le plus fort à ce jour que l'effort d'imagerie interne de Microsoft a comblé l'écart avec OpenAI — et l'API publique n'est toujours pas en disponibilité générale.

Les chiffres clés

• Classement Arena texte-vers-image : n° 2 — score 1 336 ± 11, préliminaire, ~3 488 votes

• Écart avec le n° 1 (GPT Image 2 Medium) : 45 Elo

• Avance sur le n°3 (Grok Imagine Image 2.0) : 20 Elo

• Surpasser MAI-Image-2.5 : +79 Elo au total, +91 Elo sur le rendu texte

• Position du prédécesseur : MAI-Image-2.5 au n° 10 (1,256)

• Classement en édition d'images : No. 3 sur « Single Image Edit » d'Arena — 1 420 pts, en hausse par rapport au No. 5

• Classement d'Artificial Analysis en édition d'images : n° 1 — devant MAI-Image-2.5-Pro (le précédent n° 1), Reve 2.1 et GPT Image 2 ; Microsoft occupe les deux premières places

• Classement Artificial Analysis en texte-vers-image : n° 2 — juste derrière GPT Image 2 ; premier dans 5 des 19 catégories.

• Aperçu privé : annoncé le 19 août sur MAI Playground et Microsoft Foundry — selon le fournisseur, accès sur invitation, pas encore de grille tarifaire

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

Ce qu'est MAI-Image-2.6

MAI-Image-2.6 est le modèle le plus récent de la gamme de génération d'images interne de Microsoft, développé sous la direction de Mustafa Suleyman au sein de Microsoft AI. La gamme a évolué rapidement : MAI-Image-1 a été la base, MAI-Image-2 (mars 2026) a apporté le bond en photoréalisme et en rendu de texte, MAI-Image-2.5 (juin 2026) a ajouté une sortie de qualité professionnelle et l'édition et est devenu le moteur de Bing Image Creator, PowerPoint et OneDrive, MAI-Image-2.5-Pro (juillet 2026) a ajouté un niveau premium 8K — et la 2.6 arrive maintenant environ six semaines après son prédécesseur.

Le rythme compte autant que le modèle. Microsoft publie des améliorations d'images sur un cycle de six à huit semaines, plus proche de la façon dont les laboratoires de pointe publient leurs modèles de texte que de la façon dont le marché de l'image a historiquement évolué. Une entrée en deuxième position à l'Arena au lancement, et une troisième place en édition une semaine plus tard, voilà à quoi ressemble ce rythme une fois qu'il porte ses fruits.

Les résultats du classement, lisez attentivement

L'Arena (le nouveau nom de LMArena) classe les modèles d'images par préférence humaine en aveugle : les votants voient deux images générées à partir du même prompt et choisissent la plus forte. Artificial Analysis mène le même type d'arène indépendante de préférence en aveugle avec ses propres cotes Elo. Les deux sont des mesures indépendantes de ce que les gens préfèrent réellement, plutôt que des benchmarks gérés par les fournisseurs — c'est pourquoi une entrée en deuxième position a un vrai poids, et pourquoi deux classements distincts qui s'accordent sur le même modèle comptent plus qu'un seul chiffre. C'est aussi pourquoi les chiffres appellent à la prudence : le score de 1 336 de l'Arena est préliminaire, basé sur environ 3 500 votes contre plus de 70 000 pour le modèle en première position, et l'entrée est étiquetée « aperçu ». La cote Elo évolue avec les premiers votes ; considérez la tendance comme solide et le score exact comme provisoire.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

Là où se concentrent les gains est plus intéressant que le chiffre principal. Arena a classé MAI-Image-2.6 première en imagerie et modélisation 3D (auparavant sixième) et deuxième en dessin animé/anime/fantasy (auparavant huitième), en design produit, branding et design commercial (auparavant septième), en rendu de texte (auparavant huitième, avec un gain de +91 points Elo) et en art (auparavant quatrième). Microsoft affirme s'être améliorée dans chaque catégorie mesurée. Cette répartition — design commercial, 3D, texte et art — est la signature d'un modèle d'image polyvalent plutôt que d'une spécialité à une seule corde.

Puis deux nouvelles données sont arrivées. Le classement d'édition d'images d'Arena — la catégorie « Single Image Edit » — place la même build mai-image-2.6-preview à la 3e place avec 1 420 points, en hausse par rapport à la 5e place et avec 19 points d'avance sur MAI-Image-2.5, le rendu de texte représentant le plus gros gain (+43 points). Le 25 août, Artificial Analysis est allé plus loin : son Image Editing Leaderboard place la build preview en n° 1, ravissant la première place au MAI-Image-2.5-Pro de Microsoft (précédemment n° 1 avec 1 272 Elo) et la plaçant devant Reve 2.1 et GPT Image 2 d'OpenAI — Microsoft détient désormais les deux premières places d'édition sur ce classement. Le patron de Microsoft AI, Mustafa Suleyman, a qualifié la 2.6 de « meilleur modèle d'édition d'images sur AA » et a déclaré que Microsoft détenait trois des cinq premières places — c'est l'argumentaire du fournisseur ; les classements sous-jacents sont ceux d'Artificial Analysis. Le score d'édition AA de la build preview elle-même n'a pas été publié, et les deux classements sont récents et comptent peu de votes : considérez donc la tendance comme fiable et les chiffres exacts comme provisoires.

Ce qui est réellement nouveau (signalé par le fournisseur)

En ce qui concerne les capacités, les propres descriptions de Microsoft pour MAI-Image-2.6 sont :

• Rendu du texte, des portraits et de l'imagerie 3D améliorés

• Un rendu commercial et photoréaliste plus soigné pour les cas d'utilisation produits, image de marque et cinématographiques

• Travailler sur plusieurs images de référence en une seule génération

• Un ancrage plus riche — un meilleur respect des spécificités de la consigne

• Un plus grand contrôle sur le raisonnement, le format et la résolution

Chacun de ces éléments est rapporté par le fournisseur et n'a pas encore été reproduit de manière indépendante. La preuve indépendante réside dans la paire de classements : n° 2 en texte-à-image sur Arena et Artificial Analysis, n° 3 sur le classement d'édition d'Arena, et n° 1 sur le classement d'édition d'Artificial Analysis — tous préliminaires. Jusqu'à ce que MAI-Image-2.6 soit largement disponible et que des tiers puissent mener des évaluations contrôlées, considérez la liste des capacités comme une déclaration de Microsoft et les deux classements comme le signal exploitable.

Quand vous pouvez réellement l'utiliser.

MAI-Image-2.6 est passé de « Arena uniquement » à « Arena plus un aperçu officiel » cette semaine. Le 19 août, Microsoft a annoncé que le modèle est disponible en aperçu privé sur MAI Playground et Microsoft Foundry. C'est la déclaration du fournisseur lui-même, et l'accès à l'aperçu est soumis à invitation plutôt qu'à une inscription publique — il n'y a donc toujours pas de grille tarifaire ni d'API payante par jeton. Le signe concret à surveiller : lorsque MAI-Image-2.5 est devenu le modèle par défaut dans Bing Image Creator et a été intégré à PowerPoint et OneDrive, cela signifiait que Microsoft le considérait comme sûr pour la production. Un déploiement similaire de la 2.6 dans ces surfaces — ou le retrait du label « aperçu » — sera le signal qu'elle est prête pour des charges de travail de production.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

Ce que cela pourrait coûter

Aucun tarif n'a été publié pour la version 2.6 — l'aperçu privé n'a pas de grille tarifaire. Le point d'ancrage est le reste de la famille, le tout selon les données des fournisseurs :

• MAI-Image-2.5 : 5 $ par million de jetons d’entrée de texte, 8 $ pour l’entrée d’image, 47 $ pour la sortie d’image

MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — le palier haut volume

• MAI-Image-2.5-Pro (juillet 2026) : 5 $ / 8 $ / 106 $ — sortie 8K, précision de rendu du texte de 96,8 %

C'est un écart de cinq fois entre les tarifs de sortie d'images les moins chers et les plus chers que Microsoft vend déjà, si bien que le coût de production de 2.6 dépendra du palier auquel il sera rattaché. Au tarif de sortie de 47 $ par million de 2.5, une image consommant environ un millier de jetons de sortie revient à près de cinq cents — mais Microsoft ne publie pas le nombre de jetons par image, alors considérez cela comme un calcul, pas comme un devis.

C'est aussi au niveau de la tarification qu'une couche de routage justifie sa valeur une fois que le modèle est exposé via une API publique. Sur OrcaRouter, ce que Microsoft facture est répercuté sans marge — prix catalogue du fournisseur, rien ajouté — si bien qu'une remise de lancement ou une baisse de prix ultérieure se retrouve sur votre facture le jour même de son annonce. Aucune renégociation ni second contrat ; le modèle apparaît sous la même clé que tout le reste.

Où cela laisse la course aux modèles d'image.

Le haut du classement text-to-image d'Arena en ce moment : GPT Image 2 (Medium) à 1 381, MAI-Image-2.6 à 1 336, Grok Imagine Image 2.0 à 1 316, Reve 2.1 à 1 302, et Meta's Muse Image à 1 282. Cinq modèles en l'espace d'environ 100 points d'Elo en tête. Artificial Analysis parvient au même verdict global — n°2 en text-to-image, derrière GPT Image 2 seulement — et ajoute le détail par catégorie : le build en préversion prend la première place dans 5 de ses 19 catégories text-to-image (Material, Knowledge, Frontier, Retail & Ecommerce, et Marketing & Advertising), GPT Image 2 menant dans chacune des autres. Deux classements indépendants basés sur les préférences pointant dans la même direction, c'est la lecture la plus fiable que l'on puisse avoir d'un modèle aussi jeune. L'écart de qualité qui séparait autrefois le leader du peloton s'est resserré au point que la question du « meilleur modèle d'image » n'est plus utile — ce sont l'édition, l'ancrage, la vitesse et le prix qui comptent désormais.

Le pari de Microsoft est plus large que n'importe quelle couronne de classement : une pile de modèles internes couvrant l'image, la voix, le code et le raisonnement, distribuée via Copilot, Bing et Office. Les classements de l'Arena sont la preuve de travail ; la distribution est le véritable produit.

Comment l'essayer sans risquer la production

L'aperçu Arena est gratuit — générez-y dès aujourd'hui si vous voulez le signal brut. Si vous disposez d'un accès à l'aperçu privé, les points d'entrée MAI Playground et Microsoft Foundry vous permettent d'exécuter de véritables charges de travail avant de vous engager. Pour tout le monde, la manière prudente d'adopter un tout nouveau modèle avec un score « préliminaire » est de lui acheminer une partie du trafic tout en conservant votre modèle éprouvé comme solution de repli. C'est exactement le scénario de défaillance pour lequel une couche de routage est conçue : sur OrcaRouter, vous pointeriez un point d'accès vers MAI-Image-2.6 une fois celui-ci hébergé par un fournisseur en amont, et laisser le basculement automatique couvrir les cas limites qu'un classement au faible nombre de votes ne peut pas détecter. Une seule clé API, plus de 200 modèles, prix des fournisseurs répercutés tels quels.

Que regarder ensuite

Que le rang n° 1 en édition d'Artificial Analysis et le n° 3 de l'Arena tiennent à mesure que les votes s'accumulent — les deux classements sont récents et comptent peu de votes.

• Le prix de l'API publique et le palier dans lequel elle se situe — l'aperçu privé n'a toujours pas de grille tarifaire.

Si Bing Image Creator et Copilot basculent leur valeur par défaut de 2.5 à 2.6

• Benchmarks indépendants dès l’ouverture de l’API

• Que l'étiquette « preview » soit retirée — le signe que Microsoft a suffisamment confiance pour le vendre.

FAQ

Quand puis-je réellement utiliser MAI-Image-2.6 ?

Actuellement via Arena, qui est gratuit. Depuis le 19 août, il est également en aperçu privé sur MAI Playground et Microsoft Foundry — selon l'annonce de Microsoft, l'accès est donc limité sur invitation plutôt que par inscription publique. Il n'existe toujours pas d'API publique payante à la consommation ni de prix publié.

Quelle est la qualité du résultat de retouche d'image ?

Sur le leaderboard de modification d'images d'Artificial Analysis, MAI-Image-2.6-Preview est n°1, devant MAI-Image-2.5-Pro, Reve 2.1 et GPT Image 2 — Microsoft détient les deux premières places. Sur le tableau « Single Image Edit » d'Arena, il est n°3 avec 1 420 points, en hausse par rapport à la 5e place. Les deux sont des résultats indépendants de préférence en aveugle, mais précoces et avec peu de votes, et le score de modification d'images AA pour la version d'aperçu n'a pas été publié.

À quel point est-ce proche de GPT Image 2 Medium ?

45 Elo sur l'instantané actuel de l'Arena texte-à-image — assez proche pour que l'écart entre le n°2 et le n°1 se situe dans ce que le flux de votes peut faire bouger, et les cinq meilleurs modèles sont tous à environ 100 Elo d'écart.

Les rangs de l'Arène sont-ils fiables ?

Il s'agit de résultats indépendants de préférence humaine en aveugle, ce qui est précisément ce qui les rend significatifs — mais les deux sont préliminaires (environ 3 500 votes sur le classement texte-vers-image) et rattachés à une version d'aperçu. Fiez-vous à la direction, pas aux décimales.

En résumé : MAI-Image-2.6-Preview est le premier modèle d'image de Microsoft qui mérite véritablement sa place dans la conversation sur les modèles de pointe — et il y est arrivé vite : n° 2 au classement text-to-image d'Arena dès ses débuts, n° 1 en édition d'images sur Artificial Analysis au 25 août, et en aperçu privé sur les propres surfaces de Microsoft avant toute API publique. Deux classements indépendants convergent désormais vers la même conclusion. Si le prix final se situe près du palier Flash, il devient l'un des choix les plus intéressants en termes de valeur dans la génération d'images cette année. Les classements en édition et l'aperçu répondent à la question « est-ce réel ? ». L'API publique et son prix répondront à la question « vaut-il la peine de construire dessus ? »