Cartão hero para MAI-Image-2.5-Pro, o modelo de imagem focado em qualidade da Microsoft, mostrando sua posição #1 em edição de imagem e #7 em texto-para-imagem no ranking Artificial Analysis.
Guides & Insights

MAI-Image-2.5-Pro Conquista o 1º Lugar em Edição de Imagens: O Que a Vitória Independente da Microsoft Realmente Prova

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

MAI-Image-2.5-Proé agora o modelo de edição de imagem com melhor classificação no ranking da Artificial Analysis — um ranking independente com votação às cegas — embora ainda ocupe apenas o sétimo lugar em texto-para-imagem simples. Essa divisão é a história: um modelo que está em pré-visualização pública há menos de um mês, construído inteiramente internamente pela Microsoft AI, superou GPT Image 2, Reve 2.1, e seu próprio modelo irmão MAI-Image-2.5 no ranking de edição, mas fica atrás da maioria dos mesmos concorrentes quando o comando é "desenhe-me algo do nada." Leia os dois números juntos e você terá uma imagem precisa do que a Microsoft lançou: um especialista em alterar imagens existentes, não um gerador de propósito geral.

Os dois números, lado a lado

Conforme o instantâneo de agosto de 2026, a Image Editing Arena da Artificial Analysis coloca o MAI-Image-2.5-Pro em n.º 1 com Elo 1.272, com base em cerca de 6.100 comparações cegas de usuários. O grupo perseguidor está próximo: Reve 2.1 com 1.262, depois MAI-Image-2.5 e GPT Image 2 (high) empatados com 1.256, GPT Image 1.5 (high) com 1.250, Qwen-Image-3.0-Pro com 1.249 e o Nano Banana 2 da Go​gle com 1.249. Na Text-to-Image Arena, ele fica em n.º 7 com Elo 1.292, atrás de GPT Image 2 (high) com 1.369, Reve 2.1 com 1.322, Nano Banana 2 com 1.320, GPT Image 1.5 (high) com 1.310, MAI-Image-2.5 com 1.304 e Nano Banana Pro com 1.296.

Editando: Nº 1 — 1.272 Elo, ~6.100 amostras

Texto para imagem: Nº 7 — 1.292 Elo, ~11.500 amostras

Diferença para o nº 2 em edição: 10 Elo acima do Reve 2.1

Diferença para o nº 1 em texto-para-imagem: 77 Elo atrás do GPT Image 2 (alto)

O que torna o ranking de edição mais valioso do que um número de vaidade é o mecanismo. A arena Artificial Analysis é preferência humana cega: os votantes veem a mesma imagem de entrada e a mesma instrução, recebem dois resultados editados e escolhem o mais forte. Nenhum script de fornecedor escreve a pontuação. Então, um #1 lá é o mais próximo que o mercado tem de "as pessoas gostaram mais do resultado deste editor" — e é uma recente subida, não um soluço do dia do lançamento. Trate a direção como sólida e o Elo exato como provisório; placares com poucos votos mudam.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 and 6,133 samples, ahead of Reve 2.1 at 1,262, MAI-Image-2.5 at 1,256, and GPT Image 2 (high) at 1,256

O ranking de texto para imagem, capturado no mesmo dia, é o mesmo modelo sob uma luz diferente — não mais liderando, mas ainda confortavelmente entre os dez primeiros de um campo que está agrupado de 1.290 a 1.370 de Elo.

Screenshot of the Artificial Analysis Text to Image Leaderboard showing MAI-Image-2.5-Pro at No. 7 with Elo 1,292 behind GPT Image 2 (high), Reve 2.1, Nano Banana 2, GPT Image 1.5 (high), MAI-Image-2.5, and Nano Banana Pro

O que o MAI-Image-2.5-Pro realmente é

MAI-Image-2.5-Pro é o nível de qualidade da Microsoft AI na família MAI-Image-2.5, anunciado em 23 de julho de 2026 junto com o MAI-Voice-2-Flash e colocado em pré-visualização pública no Microsoft Foundry (Azure AI Foundry) e no MAI Playground gratuito. A Microsoft o descreve como seu modelo de imagem de mais alta fidelidade até hoje, voltado para imagens hero, edição detalhada e renderização precisa de texto em imagem. A família agora cobre toda a curva de custo: MAI-Image-2.5 para trabalhos equilibrados, MAI-Image-2.5-Flash para alto volume e o nível Pro na ponta da qualidade — com um irmão mais novo, o MAI-Image-2.6, já em pré-visualização privada desde 19 de agosto.

As próprias afirmações da Microsoft para o nível Pro, todas relatadas pelo fornecedor e nenhuma reproduzida de forma independente até agora:

96.8% de precisão na renderização de texto — indicado como cobrindo chinês, inglês, japonês, coreano e espanhol, embora a mesma documentação limite a saída a aproximadamente um megapixel, então a expressão "8K" na afirmação é melhor tratada como marketing.

27% melhor aderência a prompts do que o GPT-Image-1.5 nas avaliações internas da Microsoft.

94% de consistência de personagem em múltiplas imagens entre gerações.

Até 84–89% menor custo de GPU vs modelos G​PT em cenários específicos da Microsoft (PowerPoint, OneDrive), não é um número geral.

A ficha técnica documentada é o que fundamenta essas afirmações: entrada de texto de até 32.000 tokens, janela de contexto de 131k, 4.096 tokens de saída, entrada de imagens JPEG/PNG e saída limitada a 1.048.576 pixels (equivalente a 1024×1024). Esse último número importa para os compradores: este é um excelente editor, não um gerador de resolução de impressão.

Onde a qualidade aparece

The editing strength that the leaderboard is measuring matches what Microsoft emphasizes: precise, surgical edits that keep the rest of the image consistent. {{1}}Targeted object replacement, layout changes, in-image text updates, and cleanup of artifacts like motion blur{{/1}} — the class of edit where older models regenerate the whole scene and lose the subject. Combine that with the 94% character-consistency claim and you have a model designed for {{2}}the workflow that matters commercially: take an existing asset, change one thing, ship it{{/2}}.

A posição #7 no ranking de texto-para-imagem é o contrapeso honesto. A partir de um prompt em branco, MAI-Image-2.5-Pro é bom, mas não é o líder — 77 Elo atrás do GPT Image 2 (alto) é uma diferença real em um placar cego. A Microsoft não está atualmente reivindicando a coroa de texto-para-imagem; está reivindicando a coroa de edição, e os dados apoiam a alegação mais restrita muito melhor do que a mais ampla.

Quanto custa

MAI-Image-2.5-Pro é cobrado por tokens na Foundry: $5 por milhão de tokens de entrada de texto, $8 por milhão de tokens de entrada de imagem, $106 por milhão de tokens de saída de imagem. A Microsoft não publica tokens por imagem, então o custo por imagem é aritmético, não é uma cotação; usando a conversão da Artificial Analysis, uma imagem de 1024×1024 fica perto de $108,50 por 1.000 imagens. Isso é aproximadamente 2,3× o valor do modelo irmão MAI-Image-2.5 (~$48 por 1k) e 5,4× o valor do MAI-Image-2.5-Flash (~$20 por 1k) — o nível Pro é um acréscimo intencional.

O preço de preview não é o preço GA; a tabela de preços de preview pode mudar antes da disponibilidade geral. Quando isso acontece, uma camada de roteamento pass-through é como um corte de preço chega à sua fatura no mesmo dia: no OrcaRouter, o preço de tabela do provedor é repassado com margem de 0%, então, assim que o MAI-Image-2.5-Pro estiver acessível por meio de uma API de terceiros chamável, o que a Microsoft cobrar é exatamente o que você paga — sem renegociação, sem segundo contrato.

Scoreboard for MAI-Image-2.5-Pro: image editing rank No. 1 at 1,272 Elo, text-to-image rank No. 7 at 1,292 Elo, price about USD 108.50 per 1k images, 32k text input tokens, 131k context window, ~1-megapixel output cap, preview status on Microsoft Foundry

Por que o #1 pertence à Microsoft, a empresa, e não apenas ao modelo

O resultado do ranking chega num momento em que a Microsoft está visivelmente substituindo modelos de imagem de terceiros pelos seus próprios. MAI-Image-2.5 já é o mecanismo padrão no Bing Image Creator e roda no PowerPoint, no OneDrive e no Dynamics 365 Contact Center; o nível Pro é da mesma família, voltado para trabalhos de maior fidelidade. A Microsoft disse que os modelos MAI são treinados com dados limpos e rastreáveis "sem destilação de modelos de terceiros" — uma resposta direta à questão da dependência da OpenAI, e as alegações de custo (redução de até 84% no custo de GPU no PowerPoint, informadas pelo fornecedor e específicas de cenário) fazem parte da mesma história: um modelo interno que é mais barato por tarefa do que o modelo que ele substitui.

Nada disso seria comprovável para um comprador cético sem o ranking independente, e é por isso que o #1 é estrategicamente significativo em vez de apenas uma pontuação. É a primeira evidência independente de que a linha de imagens interna da Microsoft supera a concorrência na tarefa específica para a qual foi criada.

O que assistir em seguida

A liderança de edição se mantém à medida que os votos se acumulam? 1.272 Elo em ~6.100 amostras é uma vantagem, não uma garantia; a Reve 2.1 está 10 pontos atrás.

Disponibilidade geral e a tabela de preços final — o preço da pré-visualização não é o preço da GA.

O teto de resolução. Um limite de 1 megapixel mantém o Pro fora de trabalhos de impressão; se a Microsoft o remover, a história muda.

MAI-Image-2.6 (prévia privada, 19 de agosto) — o próximo passo da família, classificado em 2º lugar em texto-para-imagem na outra arena principal.

Avaliações independentes das alegações do fornecedor — a precisão da renderização de texto e a consistência de caracteres não são verificadas fora da Microsoft.

A conclusão do ranking dividido não é "a Microsoft agora tem o melhor modelo de imagem". É mais restrita e mais útil: A Microsoft agora tem o editor de imagem mais bem avaliado em um ranking independente, a um preço premium, em pré-visualização, com um limite de resolução rígido. Se o seu trabalho é alterar imagens existentes — fotos principais, visuais de produto, texto dentro da imagem — esse é exatamente o modelo a observar. Se o seu trabalho é geração em tela em branco, a posição #7 indica que a escolha melhor ainda é o GPT Image 2 — e essa é a leitura honesta que ambos os números oferecem.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube