Cartão de título hero para o MAI-Image-2.6, o modelo de texto para imagem nº 2 da Microsoft na Arena, mostrando uma pontuação Arena de 1.336, uma classificação de nº 2 e um ganho de +79 Elo sobre o MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview: #1 em Edição de Imagens, #2 em Texto para Imagem

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O MAI-Image-2.6-Preview da Microsoft não é mais apenas uma entrada no leaderboard da Arena que você não pode tocar — agora ele é um líder independente de leaderboard. Em 25 de agosto, a Artificial Analysis, organização independente de benchmarking, classificou a mesma build de preview em 1º lugar no seu Image Editing Leaderboard e em 2º no Text to Image. A posição de nº 1 em edição a coloca à frente do próprio MAI-Image-2.5-Pro da Microsoft (o líder anterior), do Reve 2.1 e do GPT Image 2 da OpenAI, dando à Microsoft as duas primeiras posições nesse leaderboard. O modelo entrou em preview privado no MAI Playground e no Microsoft Foundry em 19 de agosto, conforme anúncio da Microsoft — com acesso por convite, ainda sem API pública e sem tabela de preços.

O aspecto marcante é a trajetória, não apenas a posição. A entrada que chegou ao nº 2 no ranking de texto-para-imagem do Arena se chama literalmente "mai-image-2.6-preview", carregava cerca de 3.500 votos naquele instantâneo e subiu oito posições com um ganho de +79 Elo sobre o MAI-Image-2.5 em um único passo. Desde então, o quadro ganhou contornos rapidamente: o acesso de prévia privada foi aberto no MAI Playground e no Microsoft Foundry em 19 de agosto, o ranking de edição de imagem do Arena moveu o build para o nº 3, e agora a Artificial Analysis o tem em nº 1 em edição de imagem e nº 2 em texto-para-imagem. Isso faz deste o sinal independente mais forte até agora de que o esforço interno de imagem da Microsoft fechou a lacuna com a OpenAI — e a API pública ainda não está amplamente disponível.

Os números-chave

• Classificação de texto para imagem da Arena: N.º 2 — pontuação 1.336±11, preliminar, ~3.488 votos

• Diferença para o nº 1 (GPT Image 2 Medium): 45 Elo

• Vantagem sobre o Nº 3 (Grok Imagine Image 2.0): 20 Elo

• Supere a MAI-Image-2.5: +79 Elo no geral, +91 Elo em renderização de texto

• Posição do antecessor: MAI-Image-2.5 na posição nº 10 (1.256)

• Classificação de edição de imagem: Nº 3 na categoria "Single Image Edit" da Arena — 1.420 pontos, subindo do Nº 5

• Ranking de edição de imagem da Artificial Analysis: Nº 1 — à frente de MAI-Image-2.5-Pro (o anterior Nº 1), Reve 2.1 e GPT Image 2; a Microsoft ocupa os dois primeiros lugares.

• Ranking de text-to-image da Artificial Analysis: Nº 2 — atrás apenas do GPT Image 2; primeiro em 5 de 19 painéis de categoria

• Prévia privada: anunciada em 19 de agosto no MAI Playground e no Microsoft Foundry — declarada pelo fornecedor, com acesso por convite, ainda sem tabela de preços

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

O que é MAI-Image-2.6

MAI-Image-2.6 é o modelo mais recente da linha de geração de imagens interna da Microsoft, desenvolvido sob o Microsoft AI de Mustafa Suleyman. A família avançou rapidamente: MAI-Image-1 foi a base, MAI-Image-2 (março de 2026) entregou o salto em fotorrealismo e renderização de texto, MAI-Image-2.5 (junho de 2026) adicionou saída e edição de nível profissional e se tornou o mecanismo por trás do Bing Image Creator, do PowerPoint e do OneDrive, MAI-Image-2.5-Pro (julho de 2026) adicionou um nível premium de 8K — e o 2.6 agora chega cerca de seis semanas depois de seu antecessor.

O ritmo importa tanto quanto o modelo. A Microsoft está lançando melhorias de imagem em um ciclo de seis a oito semanas, mais próximo de como os laboratórios de fronteira lançam modelos de texto do que de como o mercado de imagens se moveu historicamente. Uma estreia em 2º lugar no Arena no lançamento, e um 3º lugar no ranking de edição uma semana depois, é o que esse ritmo parece quando se acumula.

Os resultados do placar, leia com atenção.

Arena (a LMArena renomeada) classifica modelos de imagem por preferência humana cega: os votantes veem duas imagens geradas a partir do mesmo prompt e escolhem a melhor. A Artificial Analysis opera o mesmo tipo de arena independente de preferência cega, com suas próprias classificações Elo. Ambas são medidas independentes do que as pessoas realmente preferem, em vez de benchmarks controlados por fornecedores — o que explica por que uma estreia em 2.º lugar tem peso real, e por que dois painéis independentes concordando sobre o mesmo modelo importa mais do que qualquer um dos números isoladamente. É também por isso que os números exigem ressalvas: a pontuação de 1.336 da Arena é preliminar, baseada em cerca de 3.500 votos, contra mais de 70.000 para o modelo em primeiro lugar, e a entrada está rotulada como "preview". O Elo com votos iniciais oscila; trate a direção como sólida e a pontuação exata como provisória.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

Onde os ganhos estão concentrados é mais interessante do que o número principal. A Arena classificou o MAI-Image-2.6 em primeiro lugar em imagem e modelagem 3D (subindo do sexto) e em segundo lugar em cartoon/anime/fantasia (subindo do oitavo), produto e branding e design comercial (subindo do sétimo), renderização de texto (subindo do oitavo, com o ganho de +91 Elo), e arte (subindo do quarto). A Microsoft afirma que melhorou em todas as categorias medidas. Essa distribuição — design comercial, 3D, texto e arte — é a assinatura de um modelo de imagem de uso geral, e não de uma especialidade de truque único.

Então chegaram mais dois pontos de dados. O painel de edição de imagens da Arena — a categoria "Single Image Edit" — lista a mesma versão mai-image-2.6-preview em 3º lugar com 1.420 pontos, subindo do 5º e 19 pontos à frente do MAI-Image-2.5, com a renderização de texto sendo o maior ganho individual (+43 pontos). Em 25 de agosto, a Artificial Analysis foi além: seu Image Editing Leaderboard coloca a versão de preview em 1º lugar, tirando o topo do próprio MAI-Image-2.5-Pro da Microsoft (anteriormente 1º com 1.272 Elo) e ficando à frente do Reve 2.1 e do GPT Image 2 da OpenAI — a Microsoft agora ocupa as duas primeiras posições de edição nesse painel. O chefe de IA da Microsoft, Mustafa Suleyman, chamou o 2.6 de "o melhor modelo de edição de imagem da AA" e disse que a Microsoft ocupa três das cinco primeiras posições — isso é enquadramento do fornecedor; os rankings subjacentes são da própria Artificial Analysis. A pontuação de edição da AA para a versão de preview em si não foi publicada, e ambos os painéis são recentes e com poucos votos, então trate a direção como sólida e os números exatos como provisórios.

O que é realmente novo (relatado pelo fornecedor)

Sobre as capacidades, as descrições da própria Microsoft para MAI-Image-2.6 são:

• Renderização de texto aprimorada, retratos e imagens 3D

• Resultados comerciais e fotorrealistas mais refinados em casos de uso de produto, branding e cinematográficos

• Trabalhe com várias imagens de referência em uma única geração

• Fundamentação mais rica — melhor aderência às especificidades do prompt

• Maior controle sobre o raciocínio, o formato e a resolução

Cada um desses é relatado pelo fornecedor e ainda não foi reproduzido de forma independente. A evidência independente é o par de leaderboards: Nº 2 em texto-para-imagem tanto na Arena quanto na Artificial Analysis, Nº 3 no quadro de edição da Arena e Nº 1 no quadro de edição da Artificial Analysis — tudo preliminar. Até que o MAI-Image-2.6 esteja amplamente disponível e terceiros possam executar avaliações controladas, trate a lista de capacidades como afirmação da Microsoft e os dois leaderboards como o sinal de trabalho.

Quando você pode realmente usar isso

MAI-Image-2.6 passou de "somente Arena" para "Arena mais uma prévia oficial" esta semana. Em 19 de agosto, a Microsoft anunciou que o modelo está disponível em prévia particular no MAI Playground e no Microsoft Foundry. Essa é a declaração do próprio fornecedor, e o acesso à prévia é restrito a convites, não a um cadastro público — portanto, ainda não há tabela de preços nem API de pagamento por token. O sinal prático a observar: quando o MAI-Image-2.5 se tornou o padrão no Bing Image Creator e foi integrado ao PowerPoint e ao OneDrive, isso significou que a Microsoft o considerava seguro para produção. Uma implementação semelhante do 2.6 nessas superfícies — ou a remoção do rótulo "preview" — será o sinal de que ele está pronto para cargas de trabalho em produção.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

Quanto pode custar

Nenhum preço para 2.6 foi publicado — a prévia privada não possui tabela de preços. A referência é o restante da família, todos informados pelo fornecedor:

• MAI-Image-2.5: $5 por milhão de tokens de entrada de texto, $8 para entrada de imagem, $47 para saída de imagem

• MAI-Image-2.5-Flash: $1,75 / $1,75 / $19,50 — o nível de alto volume

• MAI-Image-2.5-Pro (julho de 2026): $5 / $8 / $106 — saída 8K, 96,8% de precisão na renderização de texto

Isso é uma variação de cinco vezes entre as taxas de saída de imagem mais baratas e mais caras que a Microsoft já vende, então o custo de produção do 2.6 dependerá da faixa em que ele se encaixar. À taxa de US$ 47 por milhão de tokens de saída do 2.5, uma imagem que consome cerca de mil tokens de saída fica perto de cinco centavos — mas a Microsoft não publica contagens de tokens por imagem, então trate isso como aritmética, não como cotação.

O preço também é onde uma camada de roteamento mostra seu valor quando o modelo chega a uma API pública. No OrcaRouter, qualquer valor cobrado pela Microsoft é repassado com margem de 0% — preço de tabela do provedor, nada acrescentado — então um desconto de lançamento ou uma redução de preço posterior chega à sua conta no mesmo dia em que é anunciado. Sem renegociação e sem segundo contrato; o modelo aparece na mesma chave que todo o resto.

Onde isso deixa a corrida dos modelos de imagem

O topo do ranking de texto-para-imagem da Arena agora: GPT Image 2 (Medium) com 1.381, MAI-Image-2.6 com 1.336, Grok Imagine Image 2.0 com 1.316, Reve 2.1 com 1.302 e Muse Image, da Meta, com 1.282. Cinco modelos num intervalo de aproximadamente 100 Elo no topo. A Artificial Analysis chega à mesma conclusão geral — nº 2 em texto-para-imagem, atrás apenas do GPT Image 2 — e acrescenta detalhes por categoria: a versão preview fica em primeiro em 5 das 19 categorias de texto-para-imagem (Material, Knowledge, Frontier, Retail & Ecommerce e Marketing & Advertising), com o GPT Image 2 liderando todas as outras. Dois rankings independentes baseados em preferência apontando na mesma direção é a leitura mais forte que se pode ter de um modelo tão novo. A lacuna de qualidade que costumava separar o líder do grupo se comprimiu a tal ponto que "melhor modelo de imagem" não é mais uma pergunta útil — edição, ancoragem, velocidade e preço são.

A aposta da Microsoft é mais ampla do que qualquer coroa de um ranking isolado: uma pilha de modelos internos que abrange imagem, voz, código e raciocínio, distribuída por meio do Copilot, do Bing e do Office. Os rankings da Arena são a prova de trabalho; a distribuição é o produto real.

Como experimentá-lo sem arriscar a produção

O preview da Arena é gratuito — teste-o hoje mesmo se você quiser o sinal bruto. Se você tiver acesso ao preview privado, os pontos de entrada do MAI Playground e do Microsoft Foundry permitem executar cargas de trabalho reais antes de se comprometer. Para todos os demais, a maneira sensata de adotar um modelo totalmente novo com uma pontuação "preliminar" é direcionar uma parcela do tráfego para ele e manter o seu modelo comprovado como fallback. Esse é exatamente o tipo de falha para o qual uma camada de roteamento foi feita: no OrcaRouter, você apontaria um endpoint para o MAI-Image-2.6 assim que ele estiver hospedado em um provedor upstream e deixaria o failover automático capturar os casos extremos que uma classificação de leaderboard com poucos votos não consegue enxergar. Uma chave de API, mais de 200 modelos, preços dos provedores repassados.

O que assistir em seguida

Se o ranking nº 1 de edição da Artificial Analysis e o nº 3 da Arena se mantêm à medida que os votos se acumulam — ambos os rankings são iniciais e com poucos votos.

• O preço da API pública e em qual nível ela se enquadra — a prévia privada ainda não tem tabela de preços.

• Se o Bing Image Creator e o Copilot mudarem seu padrão de 2.5 para 2.6

• Benchmarks independentes assim que a API for aberta.

Se o rótulo "preview" cair — o sinal de que a Microsoft está confiante o suficiente para vendê-lo

Perguntas Frequentes

Quando posso realmente usar o MAI-Image-2.6?

Atualmente, através do Arena, que é gratuito. Desde 19 de agosto, também está em prévia privada no MAI Playground e no Microsoft Foundry — de acordo com o anúncio da própria Microsoft, portanto o acesso é limitado a convites, em vez de inscrição pública. Ainda não há uma API pública com pagamento por token nem preço divulgado.

Quão forte é o resultado da edição de imagem?

No leaderboard de edição de imagem da Artificial Analysis, o MAI-Image-2.6-Preview é o nº 1, à frente do MAI-Image-2.5-Pro, Reve 2.1 e GPT Image 2 — a Microsoft ocupa as duas primeiras posições. No quadro "Single Image Edit" da Arena, é o nº 3 com 1.420 pontos, subindo do nº 5. Ambos são resultados independentes de preferência cega, porém iniciais e com poucos votos, e a pontuação de edição do AA para a versão de preview ainda não foi publicada.

Quão próximo ele está do GPT Image 2 Medium?

45 Elo no snapshot atual do Arena de texto-para-imagem — perto o suficiente para que a diferença entre o No. 2 / No. 1 esteja dentro do que o fluxo de votos consegue movimentar, e os cinco melhores modelos estão todos dentro de aproximadamente 100 Elo.

As classificações da Arena são confiáveis?

São resultados independentes e cegos de preferência humana, que é exatamente o que os torna significativos — mas ambos são preliminares (cerca de 3.500 votos no painel de texto-para-imagem) e anexados a uma versão de pré-visualização. Confie na direção, não nos decimais.

Em resumo: MAI-Image-2.6-Preview é o primeiro modelo de imagem da Microsoft que realmente pertence à conversa de fronteira — e chegou lá rápido: n.º 2 no ranking de texto-para-imagem da Arena na estreia, n.º 1 em edição de imagem no Artificial Analysis até 25 de agosto, e prévia privada nas próprias superfícies da Microsoft antes de qualquer API pública. Dois rankings independentes agora convergem para a mesma leitura. Se o preço final chegar perto do nível Flash, torna-se uma das jogadas de valor mais interessantes em geração de imagem deste ano. Os rankings de edição e a prévia respondem "isto é real." A API pública e seu preço responderão "vale a pena construir em cima disso."