Karta tytułowa hero dla MAI-Image-2.6, modelu tekst-obraz firmy Microsoft z numerem 2 na Arena, pokazująca wynik Arena 1336, pozycję nr 2 oraz wzrost Elo o +79 w porównaniu z MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview: #1 w edycji obrazów, #2 w generowaniu obrazów z tekstu

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Model MAI-Image-2.6-Preview firmy Microsoft nie jest już tylko pozycją na liście Arena, której nie można przetestować — obecnie samodzielnie zasiada na szczycie rankingu. 25 sierpnia niezależna organizacja benchmarkowa Artificial Analysis uplasowała ten sam build w wersji preview na 1. miejscu w swoim rankingu edycji obrazów (Image Editing Leaderboard) i na 2. miejscu w kategorii Text to Image. Pierwsze miejsce w edycji obrazów stawia go przed MAI-Image-2.5-Pro Microsoftu (dotychczasowym liderem), Reve 2.1 oraz GPT Image 2 od OpenAI, dzięki czemu Microsoft zajmuje dwie najwyższe pozycje na tej liście. Zgodnie z ogłoszeniem Microsoftu, model wszedł w prywatny podgląd na MAI Playground i Microsoft Foundry 19 sierpnia — dostęp tylko na zaproszenie, wciąż bez publicznego API i bez cennika.

Uderzająca jest trajektoria, a nie tylko pozycja w rankingu. Wpis, który na tablicy text-to-image Areny osiągnął 2. miejsce, nazywa się dosłownie „mai-image-2.6-preview", miał w tym ujęciu około 3500 głosów i awansował o osiem pozycji, zyskując +79 Elo względem MAI-Image-2.5 w jednym kroku. Od tego czasu obraz szybko się dopełnił: dostęp w ramach prywatnego podglądu otwarto na MAI Playground i Microsoft Foundry 19 sierpnia, tablica edycji obrazów Areny przesunęła tę wersję na 3. miejsce, a teraz Artificial Analysis plasuje ją na 1. miejscu w edycji obrazów i 2. w text-to-image. To sprawia, że jest to jak dotąd najsilniejszy niezależny sygnał, że wewnętrzne prace Microsoftu nad generowaniem obrazów zniwelowały dystans do OpenAI — a publiczne API wciąż nie jest powszechnie dostępne.

Kluczowe liczby

• Pozycja w rankingu Arena text-to-image: Nr 2 — wynik 1336±11, wstępny, ~3488 głosów

• Strata do nr 1 (GPT Image 2 Medium): 45 Elo

• Przewaga nad nr 3 (Grok Imagine Image 2.0): 20 Elo

• Przeskakuje MAI-Image-2.5: +79 Elo ogółem, +91 Elo w renderowaniu tekstu

• Pozycja poprzednika: MAI-Image-2.5 na 10. miejscu (1,256)

• Pozycja w edycji obrazów: 3. miejsce na Arenie w kategorii „Single Image Edit" — 1 420 pkt, awans z 5. miejsca

Ranking edycji obrazów Artificial Analysis: 1. miejsce — przed MAI-Image-2.5-Pro (poprzednim nr 1), Reve 2.1 i GPT Image 2; Microsoft zajmuje dwa najwyższe miejsca

• Ranking text-to-image Artificial Analysis: nr 2 — ustępując jedynie GPT Image 2; pierwsze miejsce w 5 z 19 kategorii

• Prywatna wersja zapoznawcza:ogłoszono 19 sierpnia na MAI Playground i Microsoft Foundry — zgodnie z deklaracją producenta, dostęp tylko na zaproszenie, brak jeszcze cennika

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

Czym jest MAI-Image-2.6

MAI-Image-2.6 to najnowszy model w wewnętrznej linii generowania obrazów Microsoftu, zbudowany w ramach Microsoft AI Mustafy Suleymana. Rodzina rozwija się szybko: MAI-Image-1 był fundamentem, MAI-Image-2 (marzec 2026) przyniósł skok w fotorealizmie i renderowaniu tekstu, MAI-Image-2.5 (czerwiec 2026) dodał profesjonalną jakość wyników i edycję oraz stał się silnikiem Bing Image Creator, PowerPoint i OneDrive, MAI-Image-2.5-Pro (lipiec 2026) dodał warstwę premium 8K — a 2.6 pojawia się teraz około sześć tygodni po swoim poprzedniku.

Tempo ma znaczenie równie duże jak sam model. Microsoft wdraża ulepszenia obrazów w cyklu sześcio–ośmiotygodniowym, co przypomina bardziej sposób, w jaki czołowe laboratoria wydają modele tekstowe, niż dotychczasowe tempo rynku obrazów. Debiut na 2. miejscu w Arenie na starcie i 3. miejsce w rankingu edycji tydzień później — tak wygląda to tempo, gdy zaczyna procentować.

Wyniki rankingu, przeczytaj uważnie

Arena (przemianowana LMArena) rankuje modele obrazowe na podstawie ślepej preferencji ludzi: głosujący widzą dwa obrazy wygenerowane z tego samego promptu i wybierają ten lepszy. Artificial Analysis prowadzi podobną niezależną arenę ślepej preferencji z własnymi ratingami Elo. Obie są niezależnymi miarami tego, co ludzie faktycznie preferują, a nie benchmarkami tworzonymi przez dostawców — dlatego debiut z 2. miejsca ma znaczenie i dlatego zgodność dwóch niezależnych tablic co do tego samego modelu liczy się bardziej niż którakolwiek z tych liczb z osobna. To także powód, dla którego liczby wymagają zastrzeżeń: wynik 1,336 w Arena jest wstępny, oparty na około 3 500 głosach, wobec ponad 70 000 dla modelu na pierwszym miejscu, a wpis jest oznaczony jako „podgląd”. Wczesny Elo się zmienia; traktuj kierunek jako pewny, a dokładny wynik jako tymczasowy.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

To, gdzie skoncentrowane są przyrosty, jest bardziej interesujące niż liczba w nagłówku. Arena uplasowała MAI-Image-2.6 na pierwszym miejscu w obrazowaniu i modelowaniu 3D (awans z szóstego) i na drugim miejscu w kreskówkach/animacji/fantasy (awans z ósmego), projektowaniu produktów, brandingu i projektowaniu komercyjnym (awans z siódmego), renderowaniu tekstu (awans z ósmego, z przyrostem +91 Elo) oraz sztuce (awans z czwartego). Microsoft twierdzi, że poprawił się w każdej mierzonej kategorii. Taki rozkład — projektowanie komercyjne, 3D, tekst i sztuka — to znak rozpoznawczy modelu obrazu ogólnego przeznaczenia, a nie wyspecjalizowanego w jednej dziedzinie.

Potem nadeszły dwa kolejne punkty danych. Tablica edycji obrazów Areny — kategoria „Single Image Edit” — plasuje tę samą wersję mai-image-2.6-preview na 3. miejscu z 1420 punktami, w górę z 5. miejsca i 19 punktów przed MAI-Image-2.5, przy czym renderowanie tekstu przyniosło największy pojedynczy wzrost (+43 punkty). 25 sierpnia Artificial Analysis poszło dalej: jego ranking Image Editing Leaderboard umieszcza wersję preview na 1. miejscu, odbierając pierwsze miejsce własnemu modelowi Microsoftu MAI-Image-2.5-Pro (wcześniej 1. z 1272 Elo) i wyprzedzając Reve 2.1 oraz GPT Image 2 od OpenAI — Microsoft zajmuje teraz dwie pierwsze pozycje w edycji obrazów na tej tablicy. Szef działu AI w Microsoft, Mustafa Suleyman, nazwał 2.6 „najlepszym modelem edycji obrazów na AA” i powiedział, że Microsoft zajmuje trzy z pięciu czołowych pozycji — to perspektywa producenta; podstawowe rankingi pochodzą od samego Artificial Analysis. Sam wynik edycji AA dla wersji preview nie został opublikowany, a obie tablice są wczesne i mają mało głosów, więc kierunek należy traktować jako wiarygodny, a dokładne liczby jako tymczasowe.

Co faktycznie jest nowego (zgłoszone przez dostawcę)

Jeśli chodzi o możliwości, własne opisy Microsoftu dla MAI-Image-2.6 to:

• Mocniejsze renderowanie tekstu, portrety i grafika 3D

• Bardziej dopracowane, komercyjne i fotorealistyczne rezultaty w zastosowaniach produktowych, brandingowych i filmowych

• Pracuj na wielu obrazach referencyjnych w jednej generacji

• Bogatsze ugruntowanie — lepsze trzymanie się szczegółów w poleceniu

• Większa kontrola nad rozumowaniem, formatem i rozdzielczością

Każde z tych twierdzeń pochodzi od dostawcy i nie zostało jeszcze niezależnie zweryfikowane. Niezależnym dowodem jest para rankingów: 2. miejsce w text-to-image zarówno na Arena, jak i Artificial Analysis, 3. miejsce na tablicy edycji Areny i 1. miejsce na tablicy edycji Artificial Analysis — wszystko wstępnie. Dopóki MAI-Image-2.6 nie będzie powszechnie dostępny, a strony trzecie nie będą mogły przeprowadzić kontrolowanych ewaluacji, traktuj listę możliwości jako deklarację Microsoftu, a dwa rankingi jako wiarygodny sygnał.

Kiedy faktycznie możesz tego użyć.

MAI-Image-2.6 przeszedł w tym tygodniu z „tylko Arena” do „Arena plus oficjalna wersja zapoznawcza”. 19 sierpnia Microsoft ogłosił, że model jest dostępny w prywatnej wersji zapoznawczej w MAI Playground i Microsoft Foundry. To oświadczenie samego dostawcy, a dostęp do wersji zapoznawczej jest ograniczony zaproszeniami, a nie publiczną rejestracją — więc nadal nie ma cennika ani API płatnego za token. Praktyczny wskaźnik, na który warto patrzeć: gdy MAI-Image-2.5 stał się domyślnym modelem w Bing Image Creator i trafił do PowerPointa i OneDrive, oznaczało to, że Microsoft uznał go za bezpieczny dla produkcji. Podobne wdrożenie 2.6 w tych aplikacjach — lub zniknięcie etykiety „wersja zapoznawcza” — będzie sygnałem, że jest gotowy do obciążeń produkcyjnych.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

Ile to może kosztować

Nie opublikowano żadnych cen dla wersji 2.6 — prywatna wersja zapoznawcza nie ma cennika. Punktem odniesienia jest reszta rodziny, wszystkie ceny podawane przez dostawców:

• MAI-Image-2.5: 5 dolarów za milion tokenów tekstu na wejściu, 8 dolarów za obraz na wejściu, 47 dolarów za obraz na wyjściu

MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — poziom o wysokim wolumenie

• MAI-Image-2.5-Pro (lipiec 2026): $5 / $8 / $106 — wyjście 8K, 96,8% dokładności renderowania tekstu

To jest pięciokrotna rozpiętość między najtańszymi a najdroższymi stawkami za generowanie obrazów, które Microsoft już sprzedaje, więc koszt produkcji 2.6 będzie zależeć od tego, w którym przedziale się znajdzie. Przy stawce 2.5 wynoszącej 47 dolarów za milion tokenów, obraz zużywający około tysiąca tokenów wyjściowych kosztuje blisko pięć centów — ale Microsoft nie publikuje liczby tokenów na obraz, więc traktuj to jako arytmetykę, a nie wycenę.

Kwestia cen to również obszar, w którym warstwa routingu pokazuje swoją wartość, gdy model trafia do publicznego API. W OrcaRouter opłaty Microsoftu są przekazywane dalej z zerową marżą — cena katalogowa dostawcy, bez żadnych narzutów — więc rabat na start lub późniejsza obniżka ceny trafia na Twój rachunek tego samego dnia, w którym zostanie ogłoszona. Bez negocjacji i bez drugiej umowy; model pojawia się na tym samym kluczu co wszystko inne.

Co to oznacza dla wyścigu modeli obrazowych.

Na szczycie tablicy text-to-image Areny są obecnie: GPT Image 2 (Medium) z wynikiem 1381, MAI-Image-2.6 – 1336, Grok Imagine Image 2.0 – 1316, Reve 2.1 – 1302 oraz Muse Image od Meta – 1282. Pięć modeli w odstępie mniej więcej 100 punktów Elo. Artificial Analysis dochodzi do tego samego ogólnego wniosku – 2. miejsce w text-to-image, zaraz za GPT Image 2 – i dodaje szczegóły dotyczące kategorii: wersja preview zajmuje pierwsze miejsce w 5 z 19 kategorii text-to-image (Material, Knowledge, Frontier, Retail & Ecommerce oraz Marketing & Advertising), a GPT Image 2 prowadzi we wszystkich pozostałych. Dwie niezależne tablice oparte na preferencjach wskazujące ten sam kierunek to najmocniejszy sygnał, jaki można uzyskać o tak młodym modelu. Luka jakościowa, która kiedyś oddzielała lidera od reszty stawki, skurczyła się do tego stopnia, że pytanie „który model obrazowy jest najlepszy” przestało być użyteczne – teraz liczą się edycja, grounding, szybkość i cena.

Zakład Microsoftu jest szerszy niż jakakolwiek pojedyncza korona na liście liderów: wewnętrzny stos modeli obejmujący obraz, głos, kod i rozumowanie, dystrybuowany przez Copilota, Binga i Office. Rankingi Areny to dowód wykonanej pracy; dystrybucja jest właściwym produktem.

Jak to wypróbować, nie ryzykując produkcji

{{1}}Wersja zapoznawcza Arena jest darmowa — wypróbuj na niej generowanie już dziś, jeśli chcesz uzyskać surowy sygnał.{{/1}} {{2}}Jeśli masz dostęp do prywatnej wersji zapoznawczej, punkty wejścia MAI Playground i Microsoft Foundry pozwalają uruchamiać rzeczywiste obciążenia, zanim podejmiesz decyzję.{{/2}} {{3}}Dla wszystkich pozostałych rozsądnym sposobem na wdrożenie całkiem nowego modelu z „wstępną” oceną jest skierowanie na niego części ruchu i pozostawienie sprawdzonego modelu jako rozwiązania zapasowego.{{/3}} {{4}}To dokładnie ten tryb awarii, do którego zaprojektowano warstwę routingu: w OrcaRouter wskazałbyś jeden endpoint na MAI-Image-2.6, gdy tylko zostanie udostępniony przez dostawcę zewnętrznego, i pozwoliłbyś automatycznemu przełączaniu awaryjnemu wychwycić przypadki brzegowe, których nie dostrzeże ocena w rankingu przy niskiej liczbie głosów.{{/4}} {{5}}Jeden klucz API, ponad 200 modeli, ceny dostawców bez narzutów.{{/5}}

Co obejrzeć dalej

Czy pierwsze miejsce w edycji w Artificial Analysis i trzecie miejsce na Arenie utrzymają się w miarę napływu głosów — oba rankingi są wczesne i mają niewiele głosów.

• Cena publicznego API i to, w którym poziomie się znajduje — prywatna wersja zapoznawcza nadal nie ma cennika

• Czy Bing Image Creator i Copilot zmienią swoje domyślne ustawienie z 2.5 na 2.6

• Niezależne benchmarki po otwarciu API.

• Czy etykieta „preview” zniknie — sygnał, że Microsoft jest na tyle pewny siebie, by to sprzedawać.

Najczęściej zadawane pytania

Kiedy właściwie mogę używać MAI-Image-2.6?

Obecnie przez Arenę, która jest darmowa. Od 19 sierpnia jest również w prywatnej wersji zapoznawczej na MAI Playground i Microsoft Foundry — zgodnie z ogłoszeniem samego Microsoftu, więc dostęp jest ograniczony zaproszeniami, a nie publiczną rejestracją. Nadal nie ma publicznego API płatnego za tokeny ani opublikowanej ceny.

Jak mocny jest wynik edycji obrazu?

Na rankingu edycji obrazów Artificial Analysis, MAI-Image-2.6-Preview zajmuje 1. miejsce, wyprzedzając MAI-Image-2.5-Pro, Reve 2.1 i GPT Image 2 — Microsoft zajmuje dwa pierwsze miejsca. Na liście „Single Image Edit" platformy Arena zajmuje 3. miejsce z 1420 punktami, po awansie z 5. miejsca. Oba wyniki to niezależne testy ślepej preferencji, ale są wczesne i mają niską liczbę głosów, a wynik edycji AA dla wersji preview nie został jeszcze opublikowany.

Jak blisko jest to GPT Image 2 Medium?

45 Elo na obecnym zrzucie Areny text-to-image — na tyle blisko, że różnica między nr 2 a nr 1 mieści się w tym, co może przesunąć przepływ głosów, a wszystkie modele z pierwszej piątki są w granicach mniej więcej 100 Elo.

Czy rangi Arena są wiarygodne?

Są to niezależne, ślepe wyniki preferencji ludzkich, co właśnie czyni je miarodajnymi — ale oba są wstępne (około 3500 głosów na tablicy tekst-obraz) i dotyczą wersji podglądowej. Ufaj kierunkowi, a nie dokładnym liczbom.

Sedno sprawy: MAI-Image-2.6-Preview to pierwszy model obrazowy Microsoftu, który naprawdę zasługuje na miejsce w czołówce — i dotarł tam szybko: nr 2 na tablicy tekst-na-obraz Areny przy debiucie, nr 1 w edycji obrazów według Artificial Analysis do 25 sierpnia oraz prywatny podgląd na własnych platformach Microsoftu przed jakimkolwiek publicznym API. Dwie niezależne tablice ocen są teraz zgodne. Jeśli ostateczna cena zbliży się do poziomu Flash, stanie się to jedną z najciekawszych ofert wartościowych w generowaniu obrazów w tym roku. Wyniki w edycji i podgląd odpowiadają na pytanie „czy to jest prawdziwe”. Publiczne API i jego cena odpowiedzą na pytanie „czy warto na tym budować”.