
MAI-Image-2.6-Preview: #1 nell'editing di immagini, #2 nel text-to-image
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
La MAI-Image-2.6-Preview di Microsoft non è più solo una voce della classifica Arena che non puoi toccare: ora è in cima a una classifica indipendente. Il 25 agosto, Artificial Analysis, l'organizzazione indipendente di benchmarking, ha classificato la stessa build di anteprima al n. 1 nella sua Image Editing Leaderboard e al n. 2 in Text to Image. Il primo posto nella categoria editing la mette davanti alla MAI-Image-2.5-Pro di Microsoft (la precedente leader), a Reve 2.1 e a GPT Image 2 di OpenAI, dando a Microsoft le prime due posizioni in quella classifica. Il modello è entrato in anteprima privata su MAI Playground e Microsoft Foundry il 19 agosto, secondo quanto annunciato da Microsoft — accesso su invito, ancora nessuna API pubblica, ancora nessun listino prezzi.
Ciò che colpisce è la traiettoria, non solo la posizione in classifica. La voce che ha raggiunto il 2° posto nella classifica text-to-image di Arena si chiama letteralmente "mai-image-2.6-preview", ha raccolto circa 3.500 voti in quell'istantanea ed è salita di otto posizioni con un guadagno Elo di +79 rispetto a MAI-Image-2.5 in un solo passaggio. Da allora il quadro si è completato rapidamente: l'accesso in anteprima privata è stato aperto su MAI Playground e Microsoft Foundry il 19 agosto, la classifica di image editing di Arena ha portato la build al 3° posto e ora Artificial Analysis la colloca al 1° posto nell'image editing e al 2° nel text-to-image. Questo è il segnale indipendente più forte finora che lo sforzo interno di Microsoft nel campo delle immagini ha colmato il divario con OpenAI — e l'API pubblica non è ancora generalmente disponibile.
I numeri chiave
• Classifica text-to-image di Arena: N. 2 — punteggio 1.336±11, preliminare, ~3.488 voti
• Distanza dal No. 1 (GPT Image 2 Medium): 45 Elo
• Vantaggio sul n. 3 (Grok Imagine Image 2.0): 20 Elo
• Supera MAI-Image-2.5: +79 Elo complessivamente, +91 Elo sul rendering del testo
• Posizione del predecessore: MAI-Image-2.5 al n. 10 (1,256)
• Posizione nell'editing di immagini: N. 3 sulla "Single Image Edit" di Arena — 1.420 punti, in risalita dal N. 5
• Classifica di editing immagini di Artificial Analysis: n. 1 — davanti a MAI-Image-2.5-Pro (il precedente n. 1), Reve 2.1 e GPT Image 2; Microsoft detiene i primi due posti
• Posizione nella classifica text-to-image di Artificial Analysis: n. 2 — dietro solo a GPT Image 2; primo in 5 delle 19 classifiche di categoria.
• Anteprima privata: annunciata il 19 agosto su MAI Playground e Microsoft Foundry — dichiarato dal fornitore, accesso su invito, prezzi non ancora disponibili.

Cos'è MAI-Image-2.6
MAI-Image-2.6 è il modello più recente della linea di generazione immagini interna di Microsoft, costruito nell'ambito di Microsoft AI di Mustafa Suleyman. La famiglia si è evoluta rapidamente: MAI-Image-1 è stata la base, MAI-Image-2 (marzo 2026) ha portato il salto in fatto di fotorealismo e resa del testo, MAI-Image-2.5 (giugno 2026) ha aggiunto output di livello professionale ed editing, diventando il motore alla base di Bing Image Creator, PowerPoint e OneDrive, MAI-Image-2.5-Pro (luglio 2026) ha aggiunto un livello premium 8K — e la 2.6 arriva ora a circa sei settimane dal suo predecessore.
La cadenza conta tanto quanto il modello. Microsoft sta rilasciando miglioramenti per le immagini con un ciclo di sei-otto settimane, più vicino a come i laboratori di frontiera rilasciano i modelli di testo che a come si è mosso storicamente il mercato delle immagini. Un debutto al n. 2 in Arena al lancio e un terzo posto nella classifica di editing una settimana dopo: è così che appare quella cadenza una volta che i suoi effetti si accumulano.
I risultati della classifica, leggili attentamente
Arena (la rinominata LMArena) classifica i modelli di immagini in base alla preferenza umana cieca: gli elettori vedono due immagini generate dallo stesso prompt e scelgono quella più forte. Artificial Analysis gestisce lo stesso tipo di arena indipendente di preferenza cieca con i propri punteggi Elo. Entrambe sono misure indipendenti di ciò che le persone preferiscono realmente, piuttosto che benchmark gestiti dai vendor — ecco perché un debutto al secondo posto ha un peso reale, e perché due classifiche separate che concordano sullo stesso modello contano più di ciascun numero singolarmente. È anche il motivo per cui i numeri richiedono delle avvertenze: il punteggio di 1.336 di Arena è preliminare, basato su circa 3.500 voti contro più di 70.000 per il modello al primo posto, e la voce è etichettata come "anteprima". L'Elo dei primi voti si muove; considera la direzione come solida e il punteggio esatto come provvisorio.

Dove si concentrano i guadagni è più interessante del numero principale. Arena ha classificato MAI-Image-2.6 al primo posto nell'imaging e modellazione 3D (dal sesto) e al secondo in cartoni/anime/fantasy (dall'ottavo), product e branding e design commerciale (dal settimo), rendering del testo (dall'ottavo, con un guadagno Elo di +91), e arte (dal quarto). Microsoft afferma di essere migliorata in ogni categoria misurata. Questa distribuzione — design commerciale, 3D, testo e arte — è la firma di un modello di immagini generalista piuttosto che di una specialità a un solo trucco.
Poi sono arrivati altri due dati. La classifica di Arena per l'editing delle immagini — la categoria "Single Image Edit" — elenca la stessa build mai-image-2.6-preview al 3° posto con 1.420 punti, in salita dal 5° posto e 19 punti avanti a MAI-Image-2.5, con il rendering del testo come miglioramento singolo più grande (+43 punti). Il 25 agosto, Artificial Analysis è andata oltre: la sua classifica Image Editing Leaderboard colloca la build di anteprima al 1° posto, strappando la vetta a MAI-Image-2.5-Pro di Microsoft (precedentemente al 1° posto con 1.272 Elo) e posizionandosi davanti a Reve 2.1 e GPT Image 2 di OpenAI — Microsoft ora detiene le prime due posizioni per l'editing in quella classifica. Il capo dell'AI di Microsoft, Mustafa Suleyman, ha definito 2.6 "il miglior modello di editing immagini su AA" e ha dichiarato che Microsoft detiene tre delle prime cinque posizioni — questo è l'inquadramento del fornitore; le classifiche sottostanti sono di Artificial Analysis. Il punteggio di editing di AA per la build di anteprima stessa non è stato pubblicato, e entrambe le classifiche sono precoci e con pochi voti, quindi considera la direzione come solida e i numeri esatti come provvisori.
Cosa c'è di effettivamente nuovo (segnalato dal fornitore)
Per quanto riguarda le capacità, le descrizioni di Microsoft stessa per MAI-Image-2.6 sono:
• Migliore resa del testo, ritratti e immagini 3D
• Output commerciale e fotorealistico più raffinato nei casi d'uso relativi a prodotto, branding e cinematografia
• Lavora con più immagini di riferimento in una singola generazione
• Un grounding più ricco — migliore aderenza alle specifiche del prompt
• Maggiore controllo sul ragionamento, sul formato e sulla risoluzione
Ognuna di queste voci è dichiarata dal fornitore e non è ancora stata riprodotta in modo indipendente. Le prove indipendenti sono la coppia di classifiche: n. 2 in text-to-image sia su Arena che su Artificial Analysis, n. 3 nella classifica di editing di Arena e n. 1 in quella di editing di Artificial Analysis — tutte preliminari. Finché MAI-Image-2.6 non sarà ampiamente disponibile e terze parti non potranno eseguire valutazioni controllate, tratta l'elenco delle capacità come un'affermazione di Microsoft e le due classifiche come il segnale di riferimento.
Quando puoi effettivamente usarlo
MAI-Image-2.6 è passato da "solo Arena" ad "Arena più un'anteprima ufficiale" questa settimana. Il 19 agosto Microsoft ha annunciato che il modello è disponibile in anteprima privata su MAI Playground e Microsoft Foundry. Questa è la dichiarazione del fornitore stesso, e l'accesso all'anteprima è limitato su invito, non con un'iscrizione pubblica — quindi non c'è ancora una lista prezzi né un'API a pagamento per token. L'indicatore pratico da osservare: quando MAI-Image-2.5 è diventato il predefinito in Bing Image Creator e integrato in PowerPoint e OneDrive, significava che Microsoft lo considerava sicuro per la produzione. Un rollout simile della 2.6 in quelle superfici — o l'eliminazione dell'etichetta "anteprima" — sarà il segnale che è pronta per carichi di lavoro in produzione.

Quanto potrebbe costare
Nessun prezzo per la 2.6 è stato pubblicato — l'anteprima privata non ha un listino prezzi. Il punto di riferimento è il resto della famiglia, tutti dichiarati dal fornitore:
• MAI-Image-2.5: $5 per milione di token di testo in input, $8 per input immagine, $47 per output immagine.
• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — la fascia ad alto volume
• MAI-Image-2.5-Pro (Luglio 2026): $5 / $8 / $106 — output 8K, precisione di rendering del testo al 96,8%
Si tratta di una differenza quintupla tra le tariffe di output delle immagini più economiche e quelle più care che Microsoft già vende, quindi il costo di produzione di 2.6 dipenderà dal livello in cui si colloca. Con la tariffa di output di 2.5 di 47 dollari per milione, un'immagine che consuma circa mille token di output costa quasi cinque centesimi — ma Microsoft non pubblica il numero di token per immagine, quindi consideralo come un calcolo aritmetico, non un preventivo.
Il pricing è anche il contesto in cui un livello di routing dimostra il proprio valore, una volta che il modello raggiunge un'API pubblica. Su OrcaRouter, qualsiasi importo addebitato da Microsoft viene trasferito con un margine dello 0% — prezzo di listino del provider, senza nulla di aggiunto — quindi uno sconto di lancio o un successivo taglio del prezzo si riflette sulla vostra fattura lo stesso giorno in cui viene annunciato. Niente rinegoziazioni e nessun secondo contratto; il modello compare con la stessa chiave di tutto il resto.
Dove questo lascia la corsa ai modelli di immagine
La cima della classifica text-to-image di Arena in questo momento: GPT Image 2 (Medium) a 1,381, MAI-Image-2.6 a 1,336, Grok Imagine Image 2.0 a 1,316, Reve 2.1 a 1,302 e Muse Image di Meta a 1,282. Cinque modelli nell'arco di circa 100 Elo ai vertici. Artificial Analysis arriva alla stessa conclusione complessiva — n. 2 in text-to-image, dietro solo a GPT Image 2 — e aggiunge dettagli per categoria: la build preview è prima in 5 delle sue 19 categorie text-to-image (Material, Knowledge, Frontier, Retail & Ecommerce e Marketing & Advertising), con GPT Image 2 in testa in tutte le altre. Due classifiche indipendenti basate sulle preferenze che puntano nella stessa direzione sono il segnale più forte che si possa ottenere su un modello così giovane. Il divario di qualità che un tempo separava il leader dal gruppo si è compresso al punto che "miglior modello di immagini" non è più una domanda utile — editing, grounding, velocità e prezzo lo sono.
La scommessa di Microsoft è più ampia di qualsiasi singolo primato in classifica: uno stack di modelli interni che spazia tra immagine, voce, codice e ragionamento, distribuito attraverso Copilot, Bing e Office. Le classifiche dell'Arena sono la prova del lavoro; la distribuzione è il prodotto vero e proprio.
Come provarlo senza rischiare la produzione
L'anteprima di Arena è gratuita — usala oggi stesso per generare, se vuoi il segnale grezzo. Se hai accesso all'anteprima privata, i punti di ingresso MAI Playground e Microsoft Foundry ti permettono di eseguire carichi di lavoro reali prima di impegnarti. Per tutti gli altri, il modo sensato di adottare un modello nuovissimo con un punteggio "preliminare" è instradare una parte del traffico verso di esso e mantenere il modello collaudato come fallback. È esattamente lo scenario per cui è progettato un layer di routing: su OrcaRouter punteresti un endpoint a MAI-Image-2.6 una volta ospitato su un provider upstream e lasceresti che il failover automatico intercetti i casi limite che un punteggio in classifica con pochi voti non può rilevare. Una sola chiave API, oltre 200 modelli, prezzi dei provider senza ricarico.
Cosa guardare dopo
• Se il No. 1 nella classifica di editing di Artificial Analysis e il No. 3 nell’Arena reggano man mano che i voti si accumulano — entrambe le classifiche sono premature e con pochi voti.
• Il prezzo dell'API pubblica e in quale tier rientra — l'anteprima privata non ha ancora un tariffario
• Se Bing Image Creator e Copilot cambiano il loro default dalla versione 2.5 alla 2.6
• Benchmark indipendenti una volta che l'API sarà aperta
Se l'etichetta "preview" scompare — il segnale che Microsoft è abbastanza sicura da venderlo
Domande frequenti
Quando posso effettivamente usare MAI-Image-2.6?
Attualmente tramite Arena, che è gratuito. Dal 19 agosto è anche in anteprima privata su MAI Playground e Microsoft Foundry — come da annuncio di Microsoft, quindi l'accesso è su invito e non tramite registrazione pubblica. Non esiste ancora un'API pubblica a pagamento per token, né un prezzo pubblicato.
Quanto è forte il risultato del fotoritocco?
Nella classifica Image Editing di Artificial Analysis, MAI-Image-2.6-Preview è al primo posto, davanti a MAI-Image-2.5-Pro, Reve 2.1 e GPT Image 2 — Microsoft detiene le prime due posizioni. Nella classifica "Single Image Edit" di Arena è al terzo posto con 1.420 punti, in salita dal quinto. Entrambi sono risultati indipendenti di preferenza alla cieca, ma preliminari e con pochi voti, e il punteggio di editing AA per la build preview non è ancora stato pubblicato.
Quanto è vicino a GPT Image 2 Medium?
45 Elo nello snapshot attuale dell'Arena text-to-image — abbastanza vicino che la differenza tra il n. 2 e il n. 1 rientra in ciò che il flusso di voti può spostare, e i primi cinque modelli sono tutti entro circa 100 Elo.
I ranking dell'Arena sono affidabili?
Sono risultati indipendenti di preferenze umane espresse alla cieca, che è esattamente ciò che li rende significativi — ma entrambi sono preliminari (circa 3.500 voti sulla board text-to-image) e legati a una build di anteprima. Fidati della direzione, non dei decimali.
In sintesi: MAI-Image-2.6-Preview è il primo modello di immagini Microsoft che appartiene davvero alla conversazione di frontiera — e ci è arrivato in fretta: n. 2 nella classifica text-to-image di Arena al debutto, n. 1 nell'editing di immagini su Artificial Analysis entro il 25 agosto, e anteprima privata sulle piattaforme Microsoft prima di qualsiasi API pubblica. Due classifiche indipendenti ora convergono sulla stessa lettura. Se il prezzo finale si attesta vicino al livello Flash, diventa una delle proposte di valore più interessanti nella generazione di immagini quest'anno. Le classifiche di editing e l'anteprima rispondono "è reale?". L'API pubblica e il suo prezzo risponderanno "vale la pena costruirci sopra?".
