
MAI-Image-2.6: O Novo Modelo de Imagem #2 da Microsoft Estreia na Arena Antes de Sua API Entrar no Ar
- metaNOVOMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenNOVOQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekNOVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxNOVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
- grokxAI: Grok 4.52026-07-0856Inteligência72Código
- tencentTencent: Hy32026-07-0642Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3055Inteligência72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligência52Código57Matemática
da Microsoft MAI-Image-2.6acabou de se tornar o modelo de texto para imagem com a segunda maior avaliação no ranking Arena — embora ainda não tenha uma API pública. Anunciado em 10 de agosto de 2026, o modelo está em 2º lugar com uma pontuação Arena de 1.336, atrás apenas do GPT Image 2 Medium (1.381) e à frente do Grok Imagine Image 2.0 (1.316), do Muse Image da Meta e do Nano Banana Pro. Seu antecessor, MAI-Image-2.5, está em décimo.
O que impressiona é o contexto, não apenas a classificação. A entrada que chegou ao nº 2 chama-se literalmente "mai-image-2.6-preview" e carregava cerca de 3.500 votos nesse instantâneo. Ela subiu oito posições e ganhou +79 Elo em relação à MAI-Image-2.5 em um único passo, e a Microsoft está prometendo acesso à API e ao Foundry "em breve", com os primeiros relatos apontando para a próxima semana. Isso faz deste o sinal independente mais forte até agora de que o esforço interno de imagem da Microsoft fechou a lacuna com a OpenAI — e a maioria de vocês ainda não consegue usá-la por meio de uma API.
Os números-chave
• Classificação de texto para imagem da Arena: N.º 2 — pontuação 1.336±11, preliminar, ~3.488 votos
• Diferença para o nº 1 (GPT Image 2 Medium): 45 Elo
• Vantagem sobre o Nº 3 (Grok Imagine Image 2.0): 20 Elo
• Supere a MAI-Image-2.5: +79 Elo no geral, +91 Elo em renderização de texto
• Posição do antecessor: MAI-Image-2.5 na posição nº 10 (1.256)
• Disponibilidade:Arena agora; MAI Playground ainda esta semana; APIs/Foundry esperados na próxima semana

O que é MAI-Image-2.6
MAI-Image-2.6 é o modelo mais recente da linha de geração de imagens interna da Microsoft, desenvolvido sob o Microsoft AI de Mustafa Suleyman. A família avançou rapidamente: MAI-Image-1 foi a base, MAI-Image-2 (março de 2026) entregou o salto em fotorrealismo e renderização de texto, MAI-Image-2.5 (junho de 2026) adicionou saída e edição de nível profissional e se tornou o mecanismo por trás do Bing Image Creator, do PowerPoint e do OneDrive, MAI-Image-2.5-Pro (julho de 2026) adicionou um nível premium de 8K — e o 2.6 agora chega cerca de seis semanas depois de seu antecessor.
A cadência importa tanto quanto o modelo. A Microsoft está lançando melhorias de imagem em um ciclo de seis a oito semanas, mais próximo de como os laboratórios de ponta lançam modelos de texto do que de como o mercado de imagens historicamente se movimentou. Uma estreia em 2º lugar na Arena é o que essa cadência representa quando se acumula.
O resultado da Arena, leia atentamente.
Arena (a LMArena reformulada) classifica modelos de imagem por preferência humana cega: os eleitores veem duas imagens geradas a partir do mesmo prompt e escolhem a mais forte. Isso a torna uma medida independente do que as pessoas realmente preferem, em vez de um benchmark administrado pelo fornecedor — e é por isso que uma estreia em 2º lugar tem peso real. É também por isso que o número precisa de ressalvas: a pontuação de 1.336 é preliminar, baseada em cerca de 3.500 votos contra mais de 70.000 para o modelo em primeiro lugar, e a entrada está rotulada como "preview". O Elo dos primeiros votos muda; trate a direção como sólida e a pontuação exata como provisória.

Onde os ganhos estão concentrados é mais interessante do que o número principal. A Arena classificou o MAI-Image-2.6 em primeiro lugar em imagem e modelagem 3D (subindo do sexto) e em segundo lugar em cartoon/anime/fantasia (subindo do oitavo), produto e branding e design comercial (subindo do sétimo), renderização de texto (subindo do oitavo, com o ganho de +91 Elo), e arte (subindo do quarto). A Microsoft afirma que melhorou em todas as categorias medidas. Essa distribuição — design comercial, 3D, texto e arte — é a assinatura de um modelo de imagem de uso geral, e não de uma especialidade de truque único.
O que é realmente novo (relatado pelo fornecedor)
Sobre as capacidades, as descrições da própria Microsoft para MAI-Image-2.6 são:
• Renderização de texto aprimorada, retratos e imagens 3D
• Resultados comerciais e fotorrealistas mais refinados em casos de uso de produto, branding e cinematográficos
• Trabalhe com várias imagens de referência em uma única geração
• Fundamentação mais rica — melhor aderência às especificidades do prompt
• Maior controle sobre o raciocínio, o formato e a resolução
Cada um desses itens é relatado pelo fornecedor e ainda não foi reproduzido de forma independente. A única evidência independente até agora é o salto na Arena — que é genuinamente independente, mas preliminar. Até que a API seja aberta e terceiros possam executar avaliações controladas, trate a lista de capacidades como alegação da Microsoft e o leaderboard como o sinal que funciona.
Quando você pode realmente usar isso
O modelo está disponível para teste hoje, mas apenas através do Arena. A Microsoft diz que o MAI Playground recebe o modelo ainda esta semana, e o acesso à API, além do Microsoft Foundry, está "disponível em breve" — os primeiros relatos apontam para a próxima semana. O sinal prático a observar: quando o MAI-Image-2.5 se tornou o padrão no Bing Image Creator e foi integrado ao PowerPoint e ao OneDrive, isso significou que a Microsoft o considerava seguro para produção. Uma implementação semelhante do 2.6 nessas superfícies será o sinal de que o rótulo de pré-visualização está sendo removido.

Quanto pode custar
Nenhum preço para a 2.6 foi publicado. A referência é o restante da família, tudo relatado pelo fornecedor:
• MAI-Image-2.5: $5 por milhão de tokens de entrada de texto, $8 para entrada de imagem, $47 para saída de imagem
• MAI-Image-2.5-Flash: $1,75 / $1,75 / $19,50 — o nível de alto volume
• MAI-Image-2.5-Pro (julho de 2026): $5 / $8 / $106 — saída 8K, 96,8% de precisão na renderização de texto
Isso é uma variação de cinco vezes entre as taxas de saída de imagem mais baratas e mais caras que a Microsoft já vende, então o custo de produção do 2.6 dependerá da faixa em que ele se encaixar. À taxa de US$ 47 por milhão de tokens de saída do 2.5, uma imagem que consome cerca de mil tokens de saída fica perto de cinco centavos — mas a Microsoft não publica contagens de tokens por imagem, então trate isso como aritmética, não como cotação.
O preço também é onde uma camada de roteamento mostra seu valor quando a API é aberta. No OrcaRouter, o que a Microsoft cobra é repassado com margem de 0% — preço de tabela do provedor, nada acrescentado — então um desconto de lançamento ou uma redução de preço posterior chega à sua fatura no mesmo dia em que é anunciado. Sem renegociação e sem segundo contrato; o modelo aparece na mesma chave que todo o resto.
Onde isso deixa a corrida dos modelos de imagem
O topo do ranking de texto-para-imagem da Arena neste momento: GPT Image 2 (Medium) com 1.381, MAI-Image-2.6 com 1.336, Grok Imagine Image 2.0 com 1.316, Reve 2.1 com 1.302 e o Muse Image da Meta com 1.282. Cinco modelos dentro de aproximadamente 100 pontos de Elo no topo. A lacuna de qualidade que costumava separar o líder do grupo se estreitou a ponto de "melhor modelo de imagem" não ser mais uma pergunta útil — edição, ancoragem, velocidade e preço são.
A aposta da Microsoft é mais ampla do que qualquer coroa de ranking individual: uma pilha de modelos internos que abrange imagem, voz, código e raciocínio, distribuída por meio do Copilot, Bing e Office. O ranking da Arena é a prova de trabalho; a distribuição é o produto real.
Como experimentá-lo sem arriscar a produção
A prévia do Arena é gratuita — vá gerar com ela hoje se você quer o sinal bruto. Quando a API abrir, a maneira sensata de adotar um modelo novinho em folha com uma pontuação "preliminar" é rotear uma parcela do tráfego para ele e manter seu modelo comprovado como fallback. Esse é exatamente o modo de falha para o qual uma camada de roteamento é feita: no OrcaRouter, você apontaria um endpoint para o MAI-Image-2.6 assim que ele estiver hospedado em um provedor upstream e deixaria o failover automático capturar os casos extremos que uma classificação de leaderboard com 3.000 votos não pode ver. Uma chave de API, mais de 200 modelos, preços de provedores repassados.
O que assistir em seguida
• Se o MAI-Image-2.6 aparece no ranking de edição de imagens — o MAI-Image-2.5 já é um editor forte, e as notas de edição do 2.6 ainda não foram divulgadas
• O preço da API e em qual nível ela se enquadra.
• Se o Bing Image Creator e o Copilot mudarem seu padrão de 2.5 para 2.6
• Benchmarks independentes assim que a API for aberta.
Se o rótulo "preview" cair — o sinal de que a Microsoft está confiante o suficiente para vendê-lo
Perguntas Frequentes
Quando o MAI-Image-2.6 estará disponível através de uma API?
Ainda não. Está na Arena agora como um build de pré-visualização; a Microsoft diz que o acesso à API e ao Foundry está "chegando em breve", com relatos iniciais apontando para a próxima semana. Nenhuma data ou preço definitivo foi publicado.
Quão próximo ele está do GPT Image 2 Medium?
45 Elo no snapshot atual da Arena — perto o suficiente para que a diferença entre o nº 2 e o nº 1 esteja dentro do que o fluxo de votos pode mover, e os cinco principais modelos estão todos dentro de aproximadamente 100 Elo.
O ranking da Arena No. 2 é confiável?
É um resultado independente e cego de preferência humana, que é exatamente o que o torna significativo — mas é preliminar (cerca de 3.500 votos) e está vinculado a uma build de pré-visualização. Confie na direção, não nos decimais.
Em resumo: o MAI-Image-2.6 é o primeiro modelo de imagem da Microsoft que realmente pertence à conversa de vanguarda, e ele chegou antes da API. Se o preço ficar próximo ao nível Flash, ele se torna uma das propostas de valor mais interessantes em geração de imagens neste ano. A API não pode abrir cedo o bastante — e quando abrir, o preço e as pontuações de edição dirão se o Nº 2 foi uma estreia ou um platô.
