
MAI-Image-2.5-Pro vs Flux 3: Ten sam tydzień premiery, dwie różne rzeczywistości
- z-aiNOWOŚĆZ.ai: GLM 5.32026-08-1860Inteligencja75Kod
- obsidianNOWOŚĆQwen3.8 27B Uncensored (Aggressive)2026-08-1552Inteligencja68Kod
- qwenNOWOŚĆQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOWOŚĆDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencja69Kod
- grokNOWOŚĆSpaceXAI: Grok 4.62026-08-1261Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0557Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencja69Kod
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencja49Kod
- metaMeta: Muse Spark 1.12026-07-1653Inteligencja71Kod
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencja76Kod
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencja71Kod
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencja77Kod
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencja77Kod
- grokxAI: Grok 4.52026-07-0856Inteligencja72Kod
MAI-Image-2.5-Pro i Flux 3 zostały ogłoszone w tym samym tygodniu — 23 lipca 2026 r. Miesiąc później znajdują się w różnych wszechświatach. MAI-Image-2.5-Pro, model obrazowy Microsoftu klasy jakości, jest w publicznej wersji zapoznawczej na Microsoft Foundry i wspiął się do Nr 1 na Artificial Analysis Image Editing Arena (Elo 1 272 z ~6 100 ślepych głosów). Flux 3, ujednolicony multimodalny model fundamentalny Black Forest Labs, wypuścił dokładnie jeden ze swoich poziomów — wideo — a jego poziom obrazowy nie ma publicznego punktu końcowego, ceny ani benchmarków, które ktokolwiek mógłby uruchomić. Czytelnik pytający „którego modelu obrazowego powinienem użyć” nie ma tutaj dwóch kandydatów; ma jeden produkt i jedną obietnicę.
Czym każdy z nich właściwie jest
• MAI-Image-2.5-Pro — wyspecjalizowany, własnościowy model generowania i edycji obrazów, wariant o najwyższej wierności wewnętrznej rodziny MAI-Image-2.5 firmy Microsoft. Rozliczany w tokenach, hostowany na Foundry, przeznaczony do obrazów hero, szczegółowej edycji i renderowania tekstu w obrazie. To cały model: obrazy.
• Flux 3 — ujednolicony multimodalny model bazowy trenowany łącznie na obrazach, wideo i audio (plus przewidywanie działań robotów), zbudowany na metodzie flow-matching, którą BFL nazywa Self-Flow. Ogłoszono pięć wariantów: Flux 3 Video, Flux 3 Image, Flux 3 Action, Flux-mimic dla robotyki oraz Flux 3 Dev (otwarte wagi planowane na później w 2026 roku). Obraz to jedna modalność w ramach większego przedsięwzięcia, a nie sam produkt.
Ta strukturalna różnica znaczy więcej niż jakakolwiek specyfikacja. Wyspecjalizowany model obrazowy wkłada całą swoją pojemność w nieruchome obrazy; model multimodalny rozkłada pojemność na różne media. MAI-Image-2.5-Pro istnieje po to, aby wygrywać w edycji obrazów. Flux 3 istnieje po to, aby być jednym modelem, który robi wszystko, a jego warstwa obrazowa to część tej wizji, która jeszcze nie nadeszła.
Dostępność: całe porównanie
Według stanu na połowę sierpnia 2026 r. asymetria jest całkowita:
• MAI-Image-2.5-Pro — publiczna wersja zapoznawcza w Azure AI Foundry w siedmiu regionach globalnych oraz darmowy MAI Playground. Możesz go wywołać już dziś, mając konto Microsoft; jest już wariantem o najwyższej jakości w rodzinie, która zasila Bing Image Creator, PowerPoint i OneDrive.
• Flux 3 Image — niewydany. Dokumentacja BFL nie wymienia żadnego endpointu obrazu; obecna dostępna linia modeli obrazowych to wciąż FLUX.2 (Pro, Dev, Flex, Klein). Strona Flux 3 ma etykietę „coming soon” z formularzem aplikacyjnym zamiast przycisku startowego. BFL zapowiedział, że wczesny dostęp do obrazów zostanie otwarty „w ciągu najbliższych tygodni” po ogłoszeniu z 23 lipca; na tę chwilę nie opublikowano żadnego ID modelu, specyfikacji obrazów ani limitu promptów. Tylko Flux 3 Video osiągnęło ogólną dostępność (4 sierpnia, rozliczane za sekundę).
Więc praktyczna odpowiedź na pytanie „na czym można dziś oprzeć edycję obrazów" zawiera dokładnie jedną nazwę.
Dowody, które każda ze stron może przedstawić.
Siła edycji MAI-Image-2.5-Pro jest mierzona niezależnie. Oprócz pierwszego miejsca w Elo edycji, jej pozycja w rankingu tekst-na-obraz to 7. miejsce z wynikiem 1 292 Elo — dobrze, ale nie lider, co jest uczciwym odczytaniem specjalisty. Microsoft publikuje również deklaracje dostawcy: 96,8% dokładności renderowania tekstu (oznaczona jako obejmująca pięć języków), 27% lepszą zgodność z promptem niż GPT Image 1.5 w wewnętrznych ewaluacjach oraz 94% spójności postaci na wielu obrazach. Wszystkie te dane należy oznaczyć jako własne liczby Microsoftu; to ranking jest częścią niezależną.
Flux 3 Image nie ma żadnych publicznych dowodów. Nie ma żadnych benchmarków obrazu, ponieważ nie ma żadnego endpointu obrazu do przetestowania. Jedyne liczby podane przez BFL w tej rodzinie dotyczą Flux 3 Video — wewnętrzne Elo 1135 dla text-to-video i 1051 dla image-to-video, które według BFL pokonuje Omni Flash, H3 i Seedance 2.0 — a są to dane od producenta, niezweryfikowane i i tak nie przenoszą się na poziom obrazu. Wszystko, co przeczytasz na temat „benchmarków" jakości obrazu Flux 3, jest ekstrapolacją z liczb dotyczących wideo lub ze starszej linii FLUX.2.


Co Flux 3 obiecuje w zakresie obrazów (mapa drogowa dostawcy, nie specyfikacja)
Twierdzenia BFL dotyczące mapy drogowej dla warstwy obrazów warto znać właśnie dlatego, że są to twierdzenia:
• Synteza i edycja obrazów w różnych stylach, proporcjach i rozdzielczościach
• Ulepszona obsługa złożonych promptów i renderowanie tekstu wielojęzycznego o wysokiej dokładności
• Zero-shot transfer stylu z obrazu referencyjnego, z wieloma referencjami stylu mieszanymi w jednym przejściu
• Spójność postaci i marki na przestrzeni pokoleń bez dostrajania
• Nieniszcząca edycja — zachowuje tekstury, ziarno, oświetlenie i tło, dzięki czemu wieloetapowe edycje nie powodują degradacji.
To ostatnie twierdzenie jest interesujące: to ta sama właściwość „edycji bez regenerowania sceny”, którą projekt chirurgicznej edycji MAI-Image-2.5-Pro już wdraża i na której osiąga wyniki. Jeśli Flux 3 Image dotrzyma słowa, będzie bezpośrednio konkurować z tym, co MAI-Image-2.5-Pro już robi. „Jeśli” jest tu słowem kluczowym — wszystko z tej listy pozostaje niezweryfikowane, dopóki nie pojawi się endpoint.
Koszt
• MAI-Image-2.5-Pro — 5 dolarów za milion tokenów tekstu na wejściu, 8 dolarów za milion tokenów obrazu na wejściu, 106 dolarów za milion tokenów obrazu na wyjściu. Według przeliczeń Artificial Analysis obraz 1024×1024 kosztuje około $108,50 za 1 000. Cennik w wersji podglądowej; wersja GA może go zmienić.
• Flux 3 Image — nie istnieje cena, ponieważ nie istnieje żaden endpoint. Jedyna opublikowana wycena Flux 3 dotyczy wideo: 0,17 USD/sekundę (HD) i 0,29 USD/sekundę (FHD) za pełne rendery. Dla porównania, w przypadku wywoływalnej linii obrazów FLUX.2, BFL pobiera około 0,04 USD za obraz dla Flux Pro i 0,015 USD dla Flux Dev — ale to poprzednia generacja, a nie prognoza.
Nie można porównać ceny z pustą linią. Dzisiejsze porównanie kosztów to stawka premium MAI-Image-2.5-Pro w zestawieniu z niczym.

Na którym budować?
Jeśli w 2026 roku Twoim produktem końcowym są obrazy, odpowiedzią jest MAI-Image-2.5-Pro (lub jeden z pozostałych hostowanych edytorów — GPT Image 2 wciąż prowadzi w generowaniu obrazów z tekstu i w drugiej głównej klasyfikacji edycji). Można go wywołać, ma niezależny wynik #1 w edycji, a limit rozdzielczości w okolicach megapiksela to główna rzecz do sprawdzenia w kontekście Twojego przypadku użycia. Flux 3 to pozycja do obserwowania: gdy pojawi się wariant obrazowy, jego deklaracje o nieniszczącej edycji i spójności marki zasłużą na poważny test w konfrontacji z dokładnie tym modelem, który Microsoft obecnie ocenia na #1.
Istnieje również sposób myślenia o oczekiwaniu przez pryzmat routingu. Gdy Flux 3 Image w końcu otrzyma endpoint, niskoryzykownym sposobem na wdrożenie zupełnie nowego modelu bez benchmarków jest skierowanie na niego fragmentu ruchu i pozostawienie sprawdzonego modelu jako automatycznego failover — jeden endpoint, ceny dostawcy przekazywane dalej bez marży, a niesprawdzony model zasługuje na swoje miejsce na żywym ruchu zamiast na slajdzie w roadmapie. To właśnie dla tego wzorca istnieje OrcaRouter i to ten sam wzorzec, dzięki któremu modele z warstwy podglądowej, takie jak MAI-Image-2.5-Pro, można wdrażać, zanim osiągną ogólną dostępność.
Werdykt
W tym samym tygodniu premiery, miesiąc później: MAI-Image-2.5-Pro to oceniany na #1 edytor, na którym możesz polegać już dziś, a Flux 3 to multimodalny model podstawowy, którego warstwa obrazowa wciąż jest obietnicą z mapą drogową. Porównywanie ich pod względem jakości obrazu byłoby jak porównywanie boksera z wojownikiem, który jeszcze nie wszedł na ring. Używaj MAI-Image-2.5-Pro do pracy z obrazami teraz; zostaw Flux 3 Image na liście rzeczy do ponownej oceny w dniu, w którym jego endpoint faktycznie zacznie działać.
