Karta tytułowa hero z napisem „Ming-Image-0.1-Design vs FLUX 3”, podtytuł „Jeden ma wagi i nie ma kodu; drugi ma roadmapę i nie ma endpointu”, z dwiema kartami o treści „Ming-Image-0.1-Design: wagi na Hugging Face od 17 września, repozytorium Quick Start zwraca 404” oraz „poziom obrazów FLUX 3: ogłoszono 23 lipca, brak endpointu, brak identyfikatora modelu, brak ceny”. Logo OrcaRouter jest złożone w prawym dolnym rogu.
Guides & Insights

Ming-Image-0.1-Design vs FLUX 3: Dwa sposoby, by model obrazu nie był dostępny

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Zarówno Ming-Image-0.1-Design jak i poziom obrazu FLUX 3 są obecnie modelami, których nie można wywołać. Dotarły do tego przeciwnymi drogami. Ming-Image-0.1-Design to ukończony artefakt bez drzwi wejściowych: 6B wag na licencji MIT opublikowanych na Hugging Face przez inclusionAI 17 września 2026 r., udokumentowanych w karcie modelu, której Quick Start każe sklonować repozytorium, które zwraca 404. FLUX 3 to drzwi wejściowe, za którymi nic nie ma: Black Forest Labs ogłosiło rodzinę 23 lipca 2026 r. jako cztery poziomy — Video, Image, Action i Dev — dostarczyło poziom wideo i od tego czasu nie opublikowało punktu końcowego obrazu FLUX 3, identyfikatora modelu, schematu żądania ani ceny. To porównanie między modelem, który istnieje i nie można go uruchomić, a modelem, który jest obiecany i nie można go wycenić, co jest bardziej przydatną informacją niż którykolwiek z tych nagłówków osobno.

Co każda ze stron faktycznie opublikowała

Rozróżnienie między repozytorium a ogłoszeniem ma znaczenie, więc przedstawiamy je obok siebie.

• Artefact — Ming-Image-0.1-Design ma prawdziwe wagi: pięć shardów transformera, VAE, scheduler oraz osobne komponenty mllm, connector i mlp, wszystko na licencji MIT w przeciwieństwie do FLUX 3, gdzie jedynym dostarczanym komponentem jest warstwa wideo, ogólnie dostępna od początku sierpnia 2026.

• Identyfikator — inclusionAI/Ming-Image-0.1-Design, wywoływany jako identyfikator repozytorium Hugging Face w przeciwieństwie do całkowitego braku identyfikatora modelu obrazu FLUX 3. Dokumentacja punktów końcowych Black Forest Labs wymienia trasy /flux-2-max, /flux-2-pro, /flux-2-flex oraz /flux-2-klein-*; trasa obrazu /flux-3 nie występuje.

• Zalecana konfiguracja — 2048 x 2048 przy 12 krokach próbkowania, skala CFG 1,0, BF16, jeden GPU CUDA 80 GiB w przeciwieństwie do braku opublikowanych danych dla warstwy obrazowej.

• Cena — brak. Wagi można bezpłatnie pobrać na licencji MIT, ale nie ma hostowanego endpointu do zakupu, w przeciwieństwie do opublikowanego cennika obejmującego wyłącznie wideo, wynoszącego około 0,06 USD za sekundę przy 720p w trybie roboczym, 0,17 USD przy HD i 0,29 USD przy FHD.

• Kod — Quick Start, który nie działa, ponieważ towarzyszące mu repozytorium inclusionAI/Ming-Image nie figuruje na publicznej liście repozytoriów organizacji, w przeciwieństwie do formularza zgłoszeniowego o wczesny dostęp, otwieranego od wideo, bez żadnej dokumentacji dotyczącej warstwy obrazów w tle.

• Niezależny wynik — brak. Ming-Image-0.1-Design nie pojawia się na żadnej tablicy Artificial Analysis, w żadnym widoku kategorii ani w żadnym widoku otwartych wag na dzień 23 września 2026 r., podobnie jak brak jakiegokolwiek wariantu FLUX 3. Najbliższe wpisy BFL na bieżącej tablicy pochodzą z poprzedniej generacji: FLUX.2 [flex] z wynikiem 1 065 Elo w kategorii UI/UX Design i 1 026 na ogólnej tablicy text-to-image, przy czym FLUX.2 [max] ma 1 053, a FLUX.2 [dev] 1 000.

A two-column scoreboard comparing Ming-Image-0.1-Design with the FLUX 3 image tier. The Ming-Image-0.1-Design column reads: weights 17 Sep 2026, MIT licence, 6B parameters, 2048 x 2048 at 12 steps, one 80 GiB GPU, Quick Start repo missing, no independent score. The FLUX 3 (image tier) column reads: announced 23 Jul 2026, no model ID, no endpoint, no published configuration, no published price, early-access form only, no independent score. A footer notes that both columns carry no third-party evaluation.

Dlaczego poziom wideo został wdrożony, a poziom obrazu nie

Black Forest Labs podało powód i warto go podać precyzyjnie, ponieważ kształtuje on to, czego można się spodziewać. Firma stwierdziła, że ponad 95% mocy obliczeniowej przeznaczonej na trenowanie FLUX 3 poszło na predykcję wideo. To spójne wyjaśnienie, dlaczego to właśnie poziom wideo ma za sobą produkt, a także powód, by sceptycznie podchodzić do założenia, że poziom obrazu pojawi się jako niewielka delta, gdy już to nastąpi. Ta zdolność była trenowana w drugiej kolejności, a obietnice związane z nią w planie rozwoju nie są małe: ulepszona obsługa złożonych promptów, wielojęzyczne renderowanie tekstu o wysokiej dokładności, transfer stylu, spójność postaci i marki bez dostrajania oraz edycja niedestrukcyjna. Każda z tych rzeczy jest raczej deklaracją niż funkcją, dopóki nie będzie punktu końcowego do przetestowania.

To, co BFL faktycznie sprzedaje dziś w przypadku obrazów statycznych, to poprzednia linia: FLUX.2 w wariantach max, pro, flex i klein, a także starsze wydania FLUX Pro, Dev i Schnell — w cenie od około półtora centa do siedmiu centów za obraz, zależnie od poziomu i rozdzielczości. To prawdziwe produkty, które można wywołać, i uczciwy punkt odniesienia dla jakości obrazów BFL, podczas gdy poziom obrazowy FLUX 3 wciąż czeka.

Luka wdrożeniowa jest tą interesującą asymetrią.

Tu dwa modele przestają być swoimi lustrzanymi odbiciami. Ming-Image-0.1-Design nie ma działającego kodu, ale ma historię związaną z serwowaniem: karta modelu zaleca vLLM-Omni, a 22 września repozytorium zyskało linki do przewodnika instalacyjnego tego frameworku oraz do przepisu specyficznego dla modelu. Przewodnik instalacyjny działa. Przepis nie — na dzień 23 września zwraca 404 — więc masz framework, który uznał ten model, oraz stronę specyficzną dla modelu, której jeszcze nie napisano. To i tak jest dalej niż formularz zgłoszeniowy.

Warstwa obrazowa FLUX 3 ma odwrotny profil. Black Forest Labs to firma z działającym API, udokumentowaną listą punktów końcowych i warstwą wideo działającą produkcyjnie na tym API. Infrastruktura dla punktu końcowego obrazu FLUX 3 wyraźnie istnieje. Nie istnieje natomiast decyzja o jego udostępnieniu. Nie ma żadnego identyfikatora modelu z ograniczonym dostępem, o który można by się ubiegać, żadnej daty potwierdzenia z listy oczekujących ani opublikowanej listy możliwości, która przetrwałaby zetknięcie ze schematem żądania.

Praktyczna konsekwencja: zespół, który chce udostępniać Ming-Image-0.1-Design, może zacząć już dziś, czytając quickstart vLLM-Omni i samodzielnie podłączając model, na własnym sprzęcie, na własny koszt, z permisywną licencją, która na to pozwala. Zespół, który chce udostępniać FLUX 3 Image, nie może zacząć za żadną cenę, ponieważ nie ma czego udostępniać.

Odczytywanie tego jednego twierdzenia o wydajności w zestawie

Ming-Image-0.1-Design zawiera w swoim repozytorium grafikę z rankingiem: tablicę projektowania UI/UX zatytułowaną „Tabela liderów tekstu na obraz: projektowanie UI/UX", z podpisem u dołu „Wyniki Elo z anonimowych głosów preferencji w naszej Image Arena" i plakietką „Ranking otwartych wag". Model zajmuje w niej pierwsze miejsce z wynikiem 1 082 Elo, wyprzedzając Ideogram 4.0 (Quality) z 1 052 oraz warianty FLUX.2 dev z wynikami od 994 do 1 000.

Dwa problemy z odczytaniem tego jako wyniku. Pierwszy to pochodzenie: to grafika opublikowana przez dostawcę we własnym repozytorium dostawcy, a my opisujemy plik, a nie weryfikujemy badanie. Drugi to fakt, że 23 września w ogóle nie mogliśmy znaleźć modelu na aktywnych tablicach Artificial Analysis, a aktywna kategoria UI/UX Design to inna skala — jej lider to GPT Image 2.5 Flare z 1 227 Elo, a wpisy FLUX.2 wymienione na karcie wskazują 1 065 dla [flex], 1 053 dla [max] i 1 000 dla [dev] na tej samej aktywnej tablicy. Ranking wyrażony na tablicy, której nie możemy zlokalizować, około 150 Elo poniżej tablicy, którą możemy, nie jest wynikiem benchmarku. To twierdzenie oczekujące na zewnętrzne uruchomienie.

Po stronie FLUX 3 nie ma nic do sprawdzenia — i o to właśnie chodzi. Żadnej docelowej rozdzielczości, żadnej liczby kroków, żadnego limitu obrazów referencyjnych, żadnej liczby parametrów dla poziomu obrazowego. Roadmapa to lista przymiotników.

Screenshot of the Black Forest Labs API quick-start documentation page, captured 23 September 2026, showing the documented FLUX 3 endpoint as a video endpoint with an API key header and asynchronous polling, and no image-tier endpoint alongside it.

Co robić, gdy oba są niedostępne

Żadna ze stron tego porównania nie jest dziś trasowalna przez OrcaRouter i warto powiedzieć to wprost, zamiast pozwalać, by strona modelu sugerowała coś innego: nasz katalog nie zawiera żadnego modelu inclusionAI ani żadnego poziomu FLUX, więc powyższe liczby pochodzą od samych dostawców i nic tutaj nie jest trasą, którą można wywołać przez nas. To, co warstwa trasowania jest naprawdę warta w takiej luce, to dzień po tym, jak luka się zamknie. Ponieważ OrcaRouter przekazuje ceny katalogowe dostawców bez marży, przy 0% narzutu, zmiana stawek dostawcy obowiązuje po naszej stronie tego samego dnia, a nie po cyklu zmian cen, a ponieważ wywołanie generowania stoi za jednym punktem końcowym obejmującym ponad 200 modeli, podmiana na ten z tych dwóch, który pojawi się pierwszy, to zmiana identyfikatora modelu, a nie migracja. Automatyczne przełączanie awaryjne ma znaczenie z tego samego powodu, co zawsze w przypadku niewypróbowanego modelu: jeśli punkt końcowy generowania obrazów z pierwszego wydania zachwieje się pod obciążeniem, żądanie zostanie przeniesione zamiast zakończyć się niepowodzeniem.

Dzisiejsza decyzja jest węższa, niż sugeruje sposób jej przedstawiania. Jeśli potrzebujesz generowania obrazów w produkcji w tym kwartale, żaden z kandydatów się nie kwalifikuje, a uczciwa odpowiedź to poziom FLUX.2 — prawdziwy, wyceniony, możliwy do wywołania i niezależnie oceniany — z FLUX 3 Image śledzonym jako przyszły zamiennik. Jeśli budujesz narzędzia do ewaluacji, Ming-Image-0.1-Design jest ciekawszym obiektem w tej parze: wagi można już pobrać, licencja pozwala robić z nimi, co chcesz, a pierwsze wiarygodne Elo, jakie ktokolwiek dla niego opublikuje, będzie prawdziwą nowiną. A jeśli obserwujesz BFL, sygnałem, na który warto patrzeć, nie jest wpis na blogu. To /flux-3 trasa pojawiająca się obok /flux-2-* tras w dokumentacji endpointów, bo to moment, w którym warstwa obrazów przestaje być roadmapą.

The OrcaRouter models catalogue, captured 23 September 2026, showing the English-language directory reporting 199 models across 15 providers on one API key, with the copy-the-model-ID instructions and the filter panel for input modalities, context length, price, status and series.