Karta hero dla MAI-Image-2.5-Pro, modelu obrazowego Microsoftu skupionego na jakości, pokazująca zajęcie #1 w edycji obrazów i #7 w generowaniu obrazów z tekstu w rankingu Artificial Analysis.
Guides & Insights

MAI-Image-2.5-Pro Zajmuje Pierwsze Miejsce w Edycji Obrazów: Co Tak Naprawdę Udowadnia Niezależne Zwycięstwo Microsoftu

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

MAI-Image-2.5-Pro jest obecnie najlepiej ocenianym modelem edycji obrazów w rankingu Artificial Analysis — niezależnym, opartym na ślepych głosowaniach — a jednocześnie zajmuje dopiero siódme miejsce w zwykłym generowaniu obrazów z tekstu. Ta rozbieżność jest kluczowa: model, który jest w publicznej wersji zapoznawczej od niespełna miesiąca, zbudowany w całości wewnętrznie przez Microsoft AI, wyprzedził GPT Image 2, Reve 2.1 oraz swój bliźniaczy odpowiednik MAI-Image-2.5 na liście edycji obrazów, a mimo to pozostaje w tyle za większością tych samych modeli, gdy prompt brzmi „narysuj mi coś z niczego." Przeczytaj obie liczby razem, a otrzymasz precyzyjny obraz tego, co dostarczył Microsoft: specjalistę od zmieniania istniejących obrazów, a nie generatora ogólnego przeznaczenia.

Te dwie liczby, obok siebie

Według stanu na sierpień 2026 r. w rankingu Image Editing Arena serwisu Artificial Analysis MAI-Image-2.5-Pro zajmuje miejsce 1. z Elo 1 272, na podstawie około 6 100 ślepych porównań użytkowników. Stawka rywali jest wyrównana: Reve 2.1 na 1 262, następnie MAI-Image-2.5 i GPT Image 2 (high) ex aequo na 1 256, GPT Image 1.5 (high) na 1 250, Qwen-Image-3.0-Pro na 1 249, a Nano Banana 2 od Go​gle na 1 249. W rankingu Text-to-Image Arena zajmuje miejsce 7. z Elo 1 292, za GPT Image 2 (high) z 1 369, Reve 2.1 z 1 322, Nano Banana 2 z 1 320, GPT Image 1.5 (high) z 1 310, MAI-Image-2.5 z 1 304 i Nano Banana Pro z 1 296.

Edycja: Nr 1 — 1,272 Elo, ~6,100 próbek

Tekst-obraz: Nr 7 — 1 292 Elo, ~11 500 próbek

Strata do nr 2 w edycji: 10 Elo nad Reve 2.1

Dystans do nr 1 w text-to-image: 77 Elo za GPT Image 2 (wysoki)

To, co sprawia, że ranking edycji jest wart więcej niż zwykła liczba na pokaz, to mechanizm. Arena Artificial Analysis to ślepe preferencje ludzi: głosujący widzą ten sam obraz wejściowy i tę samą instrukcję, otrzymują dwa rezultaty edycji i wybierają ten lepszy. Żaden skrypt dostawcy nie ustala wyniku. Więc #1 tam to dla rynku najbliższy odpowiednik stwierdzenia „ludziom najbardziej podobały się wyniki tego edytora" — i to jest świeży awans, a nie chwilowy skok w dniu premiery. Traktuj kierunek jako pewny, a dokładną wartość Elo jako tymczasową; tablice z małą liczbą głosów się zmieniają.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 and 6,133 samples, ahead of Reve 2.1 at 1,262, MAI-Image-2.5 at 1,256, and GPT Image 2 (high) at 1,256

Ranking text-to-image, zarejestrowany tego samego dnia, ukazuje ten sam model w innym świetle — nie jest już liderem, ale nadal z zapasem mieści się w pierwszej dziesiątce stawki, która skupia się w przedziale od 1290 do 1370 punktów Elo.

Screenshot of the Artificial Analysis Text to Image Leaderboard showing MAI-Image-2.5-Pro at No. 7 with Elo 1,292 behind GPT Image 2 (high), Reve 2.1, Nano Banana 2, GPT Image 1.5 (high), MAI-Image-2.5, and Nano Banana Pro

Czym tak naprawdę jest MAI-Image-2.5-Pro

MAI-Image-2.5-Pro {{1}}to jakościowy poziom rodziny MAI-Image-2.5 firmy Microsoft AI{{/1}}, {{2}}ogłoszony 23 lipca 2026 r. wraz z MAI-Voice-2-Flash{{/2}} i {{3}}udostępniony w publicznej wersji zapoznawczej na Microsoft Foundry (Azure AI Foundry) oraz w bezpłatnym MAI Playground{{/3}}. Microsoft opisuje go {{4}}jako swój jak dotąd najwierniejszy model obrazowy{{/4}}, {{5}}przeznaczony do materiałów typu hero, szczegółowej edycji i precyzyjnego renderowania tekstu w obrazie{{/5}}. Rodzina obejmuje teraz {{6}}całą krzywą kosztów{{/6}}: MAI-Image-2.5 {{7}}do zrównoważonej pracy{{/7}}, MAI-Image-2.5-Flash {{8}}do dużych wolumenów{{/8}}, a poziom Pro {{9}}na jakościowym końcu{{/9}} — {{10}}z nowszym siostrzanym modelem, MAI-Image-2.6, już w prywatnej wersji zapoznawczej od 19 sierpnia{{/10}}.

Własne twierdzenia Microsoftu dotyczące wersji Pro — wszystkie raportowane przez producenta i żadne dotąd niezależnie niepotwierdzone:

96,8% dokładności renderowania tekstu — wskazano, że obejmuje chiński, angielski, japoński, koreański i hiszpański, choć ta sama dokumentacja ogranicza wyjście do około megapiksela, więc sformułowanie „8K” w tym twierdzeniu najlepiej traktować jako chwyt marketingowy.

o 27% lepsze przestrzeganie poleceń niż GPT-Image-1.5 w wewnętrznych ewaluacjach Microsofta.

94% spójności postaci między wieloma obrazami w kolejnych generacjach.

Nawet 84–89% niższe koszty GPU w porównaniu z modelami G​PT w konkretnych scenariuszach Microsoft (PowerPoint, OneDrive), a nie ogólna liczba.

Udokumentowana karta specyfikacji jest podstawą tych twierdzeń: wejście tekstowe do 32 000 tokenów, okno kontekstu 131 tys., 4096 tokenów wyjściowych, wejście obrazów JPEG/PNG oraz wyjście ograniczone do 1 048 576 pikseli (odpowiednik 1024×1024). Ta ostatnia liczba ma znaczenie dla kupujących: to wysokiej jakości edytor, a nie generator w rozdzielczości druku.

Gdzie widać jakość

Siła edycji mierzona przez ranking pokrywa się z tym, co podkreśla Microsoft: precyzyjne, chirurgiczne edycje, które zachowują spójność reszty obrazu. Zamiana wybranych obiektów, zmiany układu, aktualizacja tekstu w obrazie i usuwanie artefaktów, takich jak rozmycie ruchu — to kategoria edycji, w której starsze modele regenerują całą scenę i gubią główny obiekt. Połącz to z deklarowaną 94% zgodnością postaci, a otrzymasz model zaprojektowany pod przepływ pracy, który ma znaczenie komercyjne: weź istniejący zasób, zmień jedną rzecz, wyślij go.

#7 w rankingu text-to-image to uczciwa przeciwwaga. Od pustego promptu MAI-Image-2.5-Pro jest dobry, ale to nie lider — 77 Elo za GPT Image 2 (wysoki wynik) to realna strata na ślepej tablicy. Microsoft obecnie nie twierdzi, że dzierży koronę text-to-image; twierdzi, że dzierży koronę edycji obrazów, a dane wspierają to węższe twierdzenie znacznie lepiej niż to szersze.

Ile to kosztuje

MAI-Image-2.5-Pro jest rozliczane tokenowo na Foundry: $5 za milion tokenów wejściowych tekstu, $8 za milion tokenów wejściowych obrazu, $106 za milion tokenów wyjściowych obrazu. Microsoft nie publikuje liczby tokenów na obraz, więc koszt pojedynczego obrazu to arytmetyka, a nie wycena; przy przeliczeniu wg Artificial Analysis, obraz 1024×1024 kosztuje około 108,50 USD za 1000 obrazów. To mniej więcej 2,3× więcej niż pokrewny MAI-Image-2.5 (~48 USD za 1 tys.) i 5,4× więcej niż MAI-Image-2.5-Flash (~20 USD za 1 tys.) — wariant Pro jest celowo droższy.

Ceny preview nie są cenami GA; cennik preview może się zmienić przed ogólną dostępnością. Gdy to nastąpi, warstwa routingu typu pass-through sprawia, że obniżka ceny trafia na Twój rachunek tego samego dnia: na OrcaRouter cena katalogowa dostawcy jest przekazywana dalej z 0% narzutu, więc gdy MAI-Image-2.5-Pro będzie dostępny przez wywoływalne API zewnętrznego dostawcy, zapłacisz dokładnie tyle, ile nalicza Microsoft — bez renegocjacji i drugiej umowy.

Scoreboard for MAI-Image-2.5-Pro: image editing rank No. 1 at 1,272 Elo, text-to-image rank No. 7 at 1,292 Elo, price about USD 108.50 per 1k images, 32k text input tokens, 131k context window, ~1-megapixel output cap, preview status on Microsoft Foundry

Dlaczego numer jeden należy do firmy Microsoft, a nie tylko do modelu.

Wynik na liście liderów pojawia się w momencie, gdy Microsoft wyraźnie zastępuje modele obrazowe innych firm własnymi. MAI-Image-2.5 jest już domyślnym silnikiem w Bing Image Creator i działa w PowerPoint, OneDrive oraz Dynamics 365 Contact Center; wersja Pro to ta sama rodzina, ale przeznaczona do pracy o wyższej wierności. Microsoft oświadczył, że modele MAI są trenowane na czystych, możliwych do prześledzenia danych „bez destylacji z modeli innych firm" — co stanowi bezpośrednią odpowiedź na pytanie o zależność od OpenAI, a twierdzenia o kosztach (do 84% niższy koszt GPU w PowerPoint, dane dostarczone przez producenta i zależne od scenariusza) są częścią tej samej historii: wewnętrzny model, który jest tańszy na zadanie niż model, który zastępuje.

Nic z tego nie dałoby się udowodnić sceptycznemu kupującemu bez niezależnego rankingu, dlatego #1 ma znaczenie strategiczne, a nie jest tylko wynikiem. To pierwszy niezależny dowód na to, że wewnętrzna linia generowania obrazów Microsoftu pokonuje konkurencję w konkretnym zadaniu, do którego została stworzona.

Co obejrzeć dalej

Czy przewaga w edycji utrzyma się w miarę gromadzenia głosów? 1 272 Elo na ~6 100 próbkach to przewaga, a nie pewnik; Reve 2.1 traci 10 punktów.

Ogólna dostępność i ostateczny cennik — cena podglądu nie jest ceną GA.

Pułap rozdzielczości. Limit 1 megapiksela wyklucza Pro z prac drukarskich; jeśli Microsoft go usunie, sytuacja się zmieni.

MAI-Image-2.6 (prywatna wersja zapoznawcza, 19 sierpnia) — kolejny krok w rodzinie, zajmujący 2. miejsce w generowaniu obrazu z tekstu na drugiej głównej arenie.

Niezależne oceny twierdzeń producenta — dokładność renderowania tekstu i spójność znaków nie są zweryfikowane poza Microsoftem.

Wniosek z podzielonego rankingu nie brzmi: „Microsoft tworzy teraz najlepszy model obrazowy”. Jest węższy i bardziej użyteczny: Microsoft tworzy obecnie najlepiej oceniany edytor obrazów w niezależnym rankingu – w cenie premium, w wersji preview, ze sztywnym limitem rozdzielczości. Jeśli twoja praca polega na modyfikowaniu istniejących obrazów — zdjęć głównych, wizualizacji produktów, tekstu w obrazie — to właśnie model, na który warto zwracać uwagę. Jeśli twoja praca to generowanie od zera, 7. miejsce w rankingu wskazuje, że lepszym wyborem nadal jest GPT Image 2 — i to jest uczciwy odczyt, jaki dają obie liczby.

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube