
MAI-Image-2.5-Pro Conquista o 1º Lugar em Edição de Imagens: O Que a Vitória Independente da Microsoft Realmente Prova
- AlibabaNOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.3 Flash2026-08-2658Inteligência72Código
- DeepSeekNOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.32026-08-1860Inteligência75Código
- obsidianNOVOQwen3.8 27B2026-08-1552Inteligência68Código
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
MAI-Image-2.5-Proé agora o modelo de edição de imagem com melhor classificação no ranking da Artificial Analysis — um ranking independente com votação às cegas — embora ainda ocupe apenas o sétimo lugar em texto-para-imagem simples. Essa divisão é a história: um modelo que está em pré-visualização pública há menos de um mês, construído inteiramente internamente pela Microsoft AI, superou GPT Image 2, Reve 2.1, e seu próprio modelo irmão MAI-Image-2.5 no ranking de edição, mas fica atrás da maioria dos mesmos concorrentes quando o comando é "desenhe-me algo do nada." Leia os dois números juntos e você terá uma imagem precisa do que a Microsoft lançou: um especialista em alterar imagens existentes, não um gerador de propósito geral.
Os dois números, lado a lado
Conforme o instantâneo de agosto de 2026, a Image Editing Arena da Artificial Analysis coloca o MAI-Image-2.5-Pro em n.º 1 com Elo 1.272, com base em cerca de 6.100 comparações cegas de usuários. O grupo perseguidor está próximo: Reve 2.1 com 1.262, depois MAI-Image-2.5 e GPT Image 2 (high) empatados com 1.256, GPT Image 1.5 (high) com 1.250, Qwen-Image-3.0-Pro com 1.249 e o Nano Banana 2 da Gogle com 1.249. Na Text-to-Image Arena, ele fica em n.º 7 com Elo 1.292, atrás de GPT Image 2 (high) com 1.369, Reve 2.1 com 1.322, Nano Banana 2 com 1.320, GPT Image 1.5 (high) com 1.310, MAI-Image-2.5 com 1.304 e Nano Banana Pro com 1.296.
• Editando: Nº 1 — 1.272 Elo, ~6.100 amostras
• Texto para imagem: Nº 7 — 1.292 Elo, ~11.500 amostras
• Diferença para o nº 2 em edição: 10 Elo acima do Reve 2.1
• Diferença para o nº 1 em texto-para-imagem: 77 Elo atrás do GPT Image 2 (alto)
O que torna o ranking de edição mais valioso do que um número de vaidade é o mecanismo. A arena Artificial Analysis é preferência humana cega: os votantes veem a mesma imagem de entrada e a mesma instrução, recebem dois resultados editados e escolhem o mais forte. Nenhum script de fornecedor escreve a pontuação. Então, um #1 lá é o mais próximo que o mercado tem de "as pessoas gostaram mais do resultado deste editor" — e é uma recente subida, não um soluço do dia do lançamento. Trate a direção como sólida e o Elo exato como provisório; placares com poucos votos mudam.

O ranking de texto para imagem, capturado no mesmo dia, é o mesmo modelo sob uma luz diferente — não mais liderando, mas ainda confortavelmente entre os dez primeiros de um campo que está agrupado de 1.290 a 1.370 de Elo.

O que o MAI-Image-2.5-Pro realmente é
MAI-Image-2.5-Pro é o nível de qualidade da Microsoft AI na família MAI-Image-2.5, anunciado em 23 de julho de 2026 junto com o MAI-Voice-2-Flash e colocado em pré-visualização pública no Microsoft Foundry (Azure AI Foundry) e no MAI Playground gratuito. A Microsoft o descreve como seu modelo de imagem de mais alta fidelidade até hoje, voltado para imagens hero, edição detalhada e renderização precisa de texto em imagem. A família agora cobre toda a curva de custo: MAI-Image-2.5 para trabalhos equilibrados, MAI-Image-2.5-Flash para alto volume e o nível Pro na ponta da qualidade — com um irmão mais novo, o MAI-Image-2.6, já em pré-visualização privada desde 19 de agosto.
As próprias afirmações da Microsoft para o nível Pro, todas relatadas pelo fornecedor e nenhuma reproduzida de forma independente até agora:
• 96.8% de precisão na renderização de texto — indicado como cobrindo chinês, inglês, japonês, coreano e espanhol, embora a mesma documentação limite a saída a aproximadamente um megapixel, então a expressão "8K" na afirmação é melhor tratada como marketing.
• 27% melhor aderência a prompts do que o GPT-Image-1.5 nas avaliações internas da Microsoft.
• 94% de consistência de personagem em múltiplas imagens entre gerações.
• Até 84–89% menor custo de GPU vs modelos GPT em cenários específicos da Microsoft (PowerPoint, OneDrive), não é um número geral.
A ficha técnica documentada é o que fundamenta essas afirmações: entrada de texto de até 32.000 tokens, janela de contexto de 131k, 4.096 tokens de saída, entrada de imagens JPEG/PNG e saída limitada a 1.048.576 pixels (equivalente a 1024×1024). Esse último número importa para os compradores: este é um excelente editor, não um gerador de resolução de impressão.
Onde a qualidade aparece
The editing strength that the leaderboard is measuring matches what Microsoft emphasizes: precise, surgical edits that keep the rest of the image consistent. {{1}}Targeted object replacement, layout changes, in-image text updates, and cleanup of artifacts like motion blur{{/1}} — the class of edit where older models regenerate the whole scene and lose the subject. Combine that with the 94% character-consistency claim and you have a model designed for {{2}}the workflow that matters commercially: take an existing asset, change one thing, ship it{{/2}}.
A posição #7 no ranking de texto-para-imagem é o contrapeso honesto. A partir de um prompt em branco, MAI-Image-2.5-Pro é bom, mas não é o líder — 77 Elo atrás do GPT Image 2 (alto) é uma diferença real em um placar cego. A Microsoft não está atualmente reivindicando a coroa de texto-para-imagem; está reivindicando a coroa de edição, e os dados apoiam a alegação mais restrita muito melhor do que a mais ampla.
Quanto custa
MAI-Image-2.5-Pro é cobrado por tokens na Foundry: $5 por milhão de tokens de entrada de texto, $8 por milhão de tokens de entrada de imagem, $106 por milhão de tokens de saída de imagem. A Microsoft não publica tokens por imagem, então o custo por imagem é aritmético, não é uma cotação; usando a conversão da Artificial Analysis, uma imagem de 1024×1024 fica perto de $108,50 por 1.000 imagens. Isso é aproximadamente 2,3× o valor do modelo irmão MAI-Image-2.5 (~$48 por 1k) e 5,4× o valor do MAI-Image-2.5-Flash (~$20 por 1k) — o nível Pro é um acréscimo intencional.
O preço de preview não é o preço GA; a tabela de preços de preview pode mudar antes da disponibilidade geral. Quando isso acontece, uma camada de roteamento pass-through é como um corte de preço chega à sua fatura no mesmo dia: no OrcaRouter, o preço de tabela do provedor é repassado com margem de 0%, então, assim que o MAI-Image-2.5-Pro estiver acessível por meio de uma API de terceiros chamável, o que a Microsoft cobrar é exatamente o que você paga — sem renegociação, sem segundo contrato.

Por que o #1 pertence à Microsoft, a empresa, e não apenas ao modelo
O resultado do ranking chega num momento em que a Microsoft está visivelmente substituindo modelos de imagem de terceiros pelos seus próprios. MAI-Image-2.5 já é o mecanismo padrão no Bing Image Creator e roda no PowerPoint, no OneDrive e no Dynamics 365 Contact Center; o nível Pro é da mesma família, voltado para trabalhos de maior fidelidade. A Microsoft disse que os modelos MAI são treinados com dados limpos e rastreáveis "sem destilação de modelos de terceiros" — uma resposta direta à questão da dependência da OpenAI, e as alegações de custo (redução de até 84% no custo de GPU no PowerPoint, informadas pelo fornecedor e específicas de cenário) fazem parte da mesma história: um modelo interno que é mais barato por tarefa do que o modelo que ele substitui.
Nada disso seria comprovável para um comprador cético sem o ranking independente, e é por isso que o #1 é estrategicamente significativo em vez de apenas uma pontuação. É a primeira evidência independente de que a linha de imagens interna da Microsoft supera a concorrência na tarefa específica para a qual foi criada.
O que assistir em seguida
• A liderança de edição se mantém à medida que os votos se acumulam? 1.272 Elo em ~6.100 amostras é uma vantagem, não uma garantia; a Reve 2.1 está 10 pontos atrás.
• Disponibilidade geral e a tabela de preços final — o preço da pré-visualização não é o preço da GA.
• O teto de resolução. Um limite de 1 megapixel mantém o Pro fora de trabalhos de impressão; se a Microsoft o remover, a história muda.
• MAI-Image-2.6 (prévia privada, 19 de agosto) — o próximo passo da família, classificado em 2º lugar em texto-para-imagem na outra arena principal.
• Avaliações independentes das alegações do fornecedor — a precisão da renderização de texto e a consistência de caracteres não são verificadas fora da Microsoft.
A conclusão do ranking dividido não é "a Microsoft agora tem o melhor modelo de imagem". É mais restrita e mais útil: A Microsoft agora tem o editor de imagem mais bem avaliado em um ranking independente, a um preço premium, em pré-visualização, com um limite de resolução rígido. Se o seu trabalho é alterar imagens existentes — fotos principais, visuais de produto, texto dentro da imagem — esse é exatamente o modelo a observar. Se o seu trabalho é geração em tela em branco, a posição #7 indica que a escolha melhor ainda é o GPT Image 2 — e essa é a leitura honesta que ambos os números oferecem.
