
Ming-Image-0.1-Design vs FLUX 3: Dwa sposoby, by model obrazu nie był dostępny
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Zarówno Ming-Image-0.1-Design jak i poziom obrazu FLUX 3 są obecnie modelami, których nie można wywołać. Dotarły do tego przeciwnymi drogami. Ming-Image-0.1-Design to ukończony artefakt bez drzwi wejściowych: 6B wag na licencji MIT opublikowanych na Hugging Face przez inclusionAI 17 września 2026 r., udokumentowanych w karcie modelu, której Quick Start każe sklonować repozytorium, które zwraca 404. FLUX 3 to drzwi wejściowe, za którymi nic nie ma: Black Forest Labs ogłosiło rodzinę 23 lipca 2026 r. jako cztery poziomy — Video, Image, Action i Dev — dostarczyło poziom wideo i od tego czasu nie opublikowało punktu końcowego obrazu FLUX 3, identyfikatora modelu, schematu żądania ani ceny. To porównanie między modelem, który istnieje i nie można go uruchomić, a modelem, który jest obiecany i nie można go wycenić, co jest bardziej przydatną informacją niż którykolwiek z tych nagłówków osobno.
Co każda ze stron faktycznie opublikowała
Rozróżnienie między repozytorium a ogłoszeniem ma znaczenie, więc przedstawiamy je obok siebie.
• Artefact — Ming-Image-0.1-Design ma prawdziwe wagi: pięć shardów transformera, VAE, scheduler oraz osobne komponenty mllm, connector i mlp, wszystko na licencji MIT w przeciwieństwie do FLUX 3, gdzie jedynym dostarczanym komponentem jest warstwa wideo, ogólnie dostępna od początku sierpnia 2026.
• Identyfikator — inclusionAI/Ming-Image-0.1-Design, wywoływany jako identyfikator repozytorium Hugging Face w przeciwieństwie do całkowitego braku identyfikatora modelu obrazu FLUX 3. Dokumentacja punktów końcowych Black Forest Labs wymienia trasy /flux-2-max, /flux-2-pro, /flux-2-flex oraz /flux-2-klein-*; trasa obrazu /flux-3 nie występuje.
• Zalecana konfiguracja — 2048 x 2048 przy 12 krokach próbkowania, skala CFG 1,0, BF16, jeden GPU CUDA 80 GiB w przeciwieństwie do braku opublikowanych danych dla warstwy obrazowej.
• Cena — brak. Wagi można bezpłatnie pobrać na licencji MIT, ale nie ma hostowanego endpointu do zakupu, w przeciwieństwie do opublikowanego cennika obejmującego wyłącznie wideo, wynoszącego około 0,06 USD za sekundę przy 720p w trybie roboczym, 0,17 USD przy HD i 0,29 USD przy FHD.
• Kod — Quick Start, który nie działa, ponieważ towarzyszące mu repozytorium inclusionAI/Ming-Image nie figuruje na publicznej liście repozytoriów organizacji, w przeciwieństwie do formularza zgłoszeniowego o wczesny dostęp, otwieranego od wideo, bez żadnej dokumentacji dotyczącej warstwy obrazów w tle.
• Niezależny wynik — brak. Ming-Image-0.1-Design nie pojawia się na żadnej tablicy Artificial Analysis, w żadnym widoku kategorii ani w żadnym widoku otwartych wag na dzień 23 września 2026 r., podobnie jak brak jakiegokolwiek wariantu FLUX 3. Najbliższe wpisy BFL na bieżącej tablicy pochodzą z poprzedniej generacji: FLUX.2 [flex] z wynikiem 1 065 Elo w kategorii UI/UX Design i 1 026 na ogólnej tablicy text-to-image, przy czym FLUX.2 [max] ma 1 053, a FLUX.2 [dev] 1 000.

Dlaczego poziom wideo został wdrożony, a poziom obrazu nie
Black Forest Labs podało powód i warto go podać precyzyjnie, ponieważ kształtuje on to, czego można się spodziewać. Firma stwierdziła, że ponad 95% mocy obliczeniowej przeznaczonej na trenowanie FLUX 3 poszło na predykcję wideo. To spójne wyjaśnienie, dlaczego to właśnie poziom wideo ma za sobą produkt, a także powód, by sceptycznie podchodzić do założenia, że poziom obrazu pojawi się jako niewielka delta, gdy już to nastąpi. Ta zdolność była trenowana w drugiej kolejności, a obietnice związane z nią w planie rozwoju nie są małe: ulepszona obsługa złożonych promptów, wielojęzyczne renderowanie tekstu o wysokiej dokładności, transfer stylu, spójność postaci i marki bez dostrajania oraz edycja niedestrukcyjna. Każda z tych rzeczy jest raczej deklaracją niż funkcją, dopóki nie będzie punktu końcowego do przetestowania.
To, co BFL faktycznie sprzedaje dziś w przypadku obrazów statycznych, to poprzednia linia: FLUX.2 w wariantach max, pro, flex i klein, a także starsze wydania FLUX Pro, Dev i Schnell — w cenie od około półtora centa do siedmiu centów za obraz, zależnie od poziomu i rozdzielczości. To prawdziwe produkty, które można wywołać, i uczciwy punkt odniesienia dla jakości obrazów BFL, podczas gdy poziom obrazowy FLUX 3 wciąż czeka.
Luka wdrożeniowa jest tą interesującą asymetrią.
Tu dwa modele przestają być swoimi lustrzanymi odbiciami. Ming-Image-0.1-Design nie ma działającego kodu, ale ma historię związaną z serwowaniem: karta modelu zaleca vLLM-Omni, a 22 września repozytorium zyskało linki do przewodnika instalacyjnego tego frameworku oraz do przepisu specyficznego dla modelu. Przewodnik instalacyjny działa. Przepis nie — na dzień 23 września zwraca 404 — więc masz framework, który uznał ten model, oraz stronę specyficzną dla modelu, której jeszcze nie napisano. To i tak jest dalej niż formularz zgłoszeniowy.
Warstwa obrazowa FLUX 3 ma odwrotny profil. Black Forest Labs to firma z działającym API, udokumentowaną listą punktów końcowych i warstwą wideo działającą produkcyjnie na tym API. Infrastruktura dla punktu końcowego obrazu FLUX 3 wyraźnie istnieje. Nie istnieje natomiast decyzja o jego udostępnieniu. Nie ma żadnego identyfikatora modelu z ograniczonym dostępem, o który można by się ubiegać, żadnej daty potwierdzenia z listy oczekujących ani opublikowanej listy możliwości, która przetrwałaby zetknięcie ze schematem żądania.
Praktyczna konsekwencja: zespół, który chce udostępniać Ming-Image-0.1-Design, może zacząć już dziś, czytając quickstart vLLM-Omni i samodzielnie podłączając model, na własnym sprzęcie, na własny koszt, z permisywną licencją, która na to pozwala. Zespół, który chce udostępniać FLUX 3 Image, nie może zacząć za żadną cenę, ponieważ nie ma czego udostępniać.
Odczytywanie tego jednego twierdzenia o wydajności w zestawie
Ming-Image-0.1-Design zawiera w swoim repozytorium grafikę z rankingiem: tablicę projektowania UI/UX zatytułowaną „Tabela liderów tekstu na obraz: projektowanie UI/UX", z podpisem u dołu „Wyniki Elo z anonimowych głosów preferencji w naszej Image Arena" i plakietką „Ranking otwartych wag". Model zajmuje w niej pierwsze miejsce z wynikiem 1 082 Elo, wyprzedzając Ideogram 4.0 (Quality) z 1 052 oraz warianty FLUX.2 dev z wynikami od 994 do 1 000.
Dwa problemy z odczytaniem tego jako wyniku. Pierwszy to pochodzenie: to grafika opublikowana przez dostawcę we własnym repozytorium dostawcy, a my opisujemy plik, a nie weryfikujemy badanie. Drugi to fakt, że 23 września w ogóle nie mogliśmy znaleźć modelu na aktywnych tablicach Artificial Analysis, a aktywna kategoria UI/UX Design to inna skala — jej lider to GPT Image 2.5 Flare z 1 227 Elo, a wpisy FLUX.2 wymienione na karcie wskazują 1 065 dla [flex], 1 053 dla [max] i 1 000 dla [dev] na tej samej aktywnej tablicy. Ranking wyrażony na tablicy, której nie możemy zlokalizować, około 150 Elo poniżej tablicy, którą możemy, nie jest wynikiem benchmarku. To twierdzenie oczekujące na zewnętrzne uruchomienie.
Po stronie FLUX 3 nie ma nic do sprawdzenia — i o to właśnie chodzi. Żadnej docelowej rozdzielczości, żadnej liczby kroków, żadnego limitu obrazów referencyjnych, żadnej liczby parametrów dla poziomu obrazowego. Roadmapa to lista przymiotników.

Co robić, gdy oba są niedostępne
Żadna ze stron tego porównania nie jest dziś trasowalna przez OrcaRouter i warto powiedzieć to wprost, zamiast pozwalać, by strona modelu sugerowała coś innego: nasz katalog nie zawiera żadnego modelu inclusionAI ani żadnego poziomu FLUX, więc powyższe liczby pochodzą od samych dostawców i nic tutaj nie jest trasą, którą można wywołać przez nas. To, co warstwa trasowania jest naprawdę warta w takiej luce, to dzień po tym, jak luka się zamknie. Ponieważ OrcaRouter przekazuje ceny katalogowe dostawców bez marży, przy 0% narzutu, zmiana stawek dostawcy obowiązuje po naszej stronie tego samego dnia, a nie po cyklu zmian cen, a ponieważ wywołanie generowania stoi za jednym punktem końcowym obejmującym ponad 200 modeli, podmiana na ten z tych dwóch, który pojawi się pierwszy, to zmiana identyfikatora modelu, a nie migracja. Automatyczne przełączanie awaryjne ma znaczenie z tego samego powodu, co zawsze w przypadku niewypróbowanego modelu: jeśli punkt końcowy generowania obrazów z pierwszego wydania zachwieje się pod obciążeniem, żądanie zostanie przeniesione zamiast zakończyć się niepowodzeniem.
Dzisiejsza decyzja jest węższa, niż sugeruje sposób jej przedstawiania. Jeśli potrzebujesz generowania obrazów w produkcji w tym kwartale, żaden z kandydatów się nie kwalifikuje, a uczciwa odpowiedź to poziom FLUX.2 — prawdziwy, wyceniony, możliwy do wywołania i niezależnie oceniany — z FLUX 3 Image śledzonym jako przyszły zamiennik. Jeśli budujesz narzędzia do ewaluacji, Ming-Image-0.1-Design jest ciekawszym obiektem w tej parze: wagi można już pobrać, licencja pozwala robić z nimi, co chcesz, a pierwsze wiarygodne Elo, jakie ktokolwiek dla niego opublikuje, będzie prawdziwą nowiną. A jeśli obserwujesz BFL, sygnałem, na który warto patrzeć, nie jest wpis na blogu. To /flux-3 trasa pojawiająca się obok /flux-2-* tras w dokumentacji endpointów, bo to moment, w którym warstwa obrazów przestaje być roadmapą.

