Hero-titelkortet har rubriken 'Ming-Image-0.1-Design vs FLUX 3' och underrubriken 'Den ena har vikter och ingen kod; den andra har en färdplan och ingen slutpunkt', med två kort som lyder 'Ming-Image-0.1-Design: vikter på Hugging Face sedan 17 sep, Quick Start-repot returnerar 404' och 'FLUX 3 bildnivå: tillkännagavs 23 juli, ingen slutpunkt, inget modell-ID, inget pris'. OrcaRouter-logotypen är inlagd i nedre högra hörnet.
Guides & Insights

Ming-Image-0.1-Design vs FLUX 3: Två sätt för en bildmodell att inte vara tillgänglig

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Både Ming-Image-0.1-Design och bildnivån i FLUX 3 är just nu modeller som du inte kan anropa. De hamnade där via motsatta vägar. Ming-Image-0.1-Design är en färdig artefakt utan entrédörr: 6B MIT-licensierade vikter publicerade på Hugging Face av inclusionAI den 17 september 2026, dokumenterade i ett modellkort vars snabbstart säger att du ska klona ett repositorium som returnerar 404. FLUX 3 är en entrédörr med ingenting bakom: Black Forest Labs tillkännagav familjen den 23 juli 2026 som fyra nivåer – Video, Image, Action och Dev – släppte videonivån och har sedan dess inte publicerat någon bildslutpunkt, modellidentifierare, förfrågningsschema eller pris för FLUX 3. Detta är en jämförelse mellan en modell som finns och inte kan köras och en modell som är utlovad och inte kan prissättas, vilket är en mer användbar sak att veta än någon av rubrikerna för sig.

Vad vardera sidan faktiskt har publicerat

Skillnaden mellan ett förråd och ett tillkännagivande spelar roll, så här är den sida vid sida.

• Artefakt — Ming-Image-0.1-Design har riktiga vikter: fem transformer-shards, en VAE, en scheduler och separata mllm-, connector- och mlp-komponenter, alla under en MIT-licens jämfört med FLUX 3, där den enda komponenten som levereras är videonivån, allmänt tillgänglig sedan början av augusti 2026.

• Identifierare — inclusionAI/Ming-Image-0.1-Design, anropbar som ett Hugging Face-repo-ID kontra inget FLUX 3-bildmodell-ID alls. Black Forest Labs slutpunktsdokumentation listar /flux-2-max, /flux-2-pro, /flux-2-flex och /flux-2-klein-*rutter; en /flux-3bildrutt förekommer inte.

• Rekommenderad konfiguration — 2048 x 2048 vid 12 samplingssteg, CFG-skala 1,0, BF16, en CUDA-GPU på 80 GiB mot inget publicerat för bildnivån.

• Pris — inget. Vikterna är gratis att ladda ner under MIT, men det finns ingen hostad endpoint att köpa, till skillnad från en publicerad prislista som endast täcker video, på ungefär 0,06 USD per sekund vid 720p-utkast, 0,17 USD vid HD och 0,29 USD vid FHD.

• Kod — en snabbstart som inte körs, eftersom det medföljande inclusionAI/Ming-Image-arkivet saknas i organisationens offentliga arkivlista kontra ett ansökningsformulär för tidig åtkomst, öppnat med video först, utan någon dokumentation för bildnivån bakom det.

• Oberoende poäng — ingen. Ming-Image-0.1-Design förekommer inte på någon Artificial Analysis-resultattavla, i någon kategorivy och i någon open-weights-vy per den 23 september 2026, jämfört med att det inte heller finns någon för någon FLUX 3-nivå. De närmaste BFL-posterna på den aktuella resultattavlan är från föregående generation: FLUX.2 [flex] med 1 065 Elo i kategorin UI/UX Design och 1 026 på den allmänna text-till-bild-resultattavlan, med FLUX.2 [max] på 1 053 och FLUX.2 [dev] på 1 000.

A two-column scoreboard comparing Ming-Image-0.1-Design with the FLUX 3 image tier. The Ming-Image-0.1-Design column reads: weights 17 Sep 2026, MIT licence, 6B parameters, 2048 x 2048 at 12 steps, one 80 GiB GPU, Quick Start repo missing, no independent score. The FLUX 3 (image tier) column reads: announced 23 Jul 2026, no model ID, no endpoint, no published configuration, no published price, early-access form only, no independent score. A footer notes that both columns carry no third-party evaluation.

Varför videonivån lanserades och bildnivån inte

Black Forest Labs har angett ett skäl, och det är värt att uttrycka exakt eftersom det formar vad man kan förvänta sig. Företaget har sagt att mer än 95 % av FLUX 3:s träningsberäkningskraft gick till videoprediktion. Det är en sammanhängande förklaring till varför videonivån är den som har en produkt bakom sig, och det är också anledningen att vara skeptisk till antagandet att bildnivån kommer att komma som ett litet delta när den väl gör det. Förmågan tränades i ett andra steg, och löftena i färdplanen som är kopplade till den är inte små: förbättrad hantering av komplexa prompter, flerspråkig textrendering med hög noggrannhet, stilöverföring, karaktärs- och varumärkeskonsekvens utan finjustering samt icke-destruktiv redigering. Vart och ett av dessa är ett påstående snarare än en funktion tills det finns en slutpunkt att testa.

Det BFL faktiskt säljer för stillbilder i dag är den tidigare serien: FLUX.2 i varianterna max, pro, flex och klein, plus de äldre utgåvorna FLUX Pro, Dev och Schnell, för ungefär en och en halv cent till sju cent per bild beroende på nivå och upplösning. Det är riktiga, anropbara produkter och de är den ärliga måttstocken för var BFL:s bildkvalitet ligger medan FLUX 3:s bildnivå väntar.

Deployeringsgapet är den intressanta asymmetrin.

Här upphör de två modellerna att vara spegelbilder av varandra. Ming-Image-0.1-Design har ingen fungerande kod men har en serveringshistoria: modellkortet rekommenderar vLLM-Omni, och den 22 september fick repositoriet länkar till ramverkets installationsguide och till ett modellspecifikt recept. Installationsguiden fungerar. Receptet gör det inte — det ger 404 från och med den 23 september — så det du har är ett ramverk som har erkänt modellen och en modellspecifik sida som inte har skrivits. Det är fortfarande längre fram än ett ansökningsformulär.

FLUX 3:s bildnivå har den motsatta profilen. Black Forest Labs är ett företag med ett fungerande API, en dokumenterad endpoint-lista och en videonivå i produktion på det. Infrastrukturen för en FLUX 3-bildendpoint finns uppenbarligen. Det som inte finns är beslutet att exponera den. Det finns inget gated modell-ID att ansöka om, inget bekräftelsedatum för väntelistan och ingen publicerad kapabilitetslista som överlever kontakt med ett request-schema.

Den praktiska konsekvensen: ett team som vill serva Ming-Image-0.1-Design kan börja redan idag genom att läsa snabbstarten för vLLM-Omni och koppla upp modellen själva, på sin egen hårdvara, till sin egen kostnad, med en tillåtande licens som medger det. Ett team som vill serva FLUX 3 Image kan inte börja till något pris, eftersom det inte finns något att serva.

Läser det enda prestandapåståendet i uppsättningen

Ming-Image-0.1-Design levererar en topplistegrafik i sitt repository: en UI/UX-designtavla med rubriken "Topplista för text till bild: UI/UX-design", med "Elo-poäng från blinda preferensröstningar i vår Image Arena" längst ned och ett "Topplista för öppna vikter"-märke. I den ligger modellen först med 1 082 Elo, före Ideogram 4.0 (Quality) med 1 052 och FLUX.2 dev-varianterna mellan 994 och 1 000.

Två problem med att läsa det som ett resultat. Det första är proveniens: det är leverantörspublicerad grafik i leverantörens eget arkiv, och vi beskriver filen i stället för att verifiera studien. Det andra är att vi inte alls kunde hitta modellen på live-tavlorna hos Artificial Analysis den 23 september, och den aktuella kategorin UI/UX Design är en annan skala – dess ledare är GPT Image 2.5 Flare med 1 227 Elo, och de FLUX.2-poster som kortet listar visar 1 065 för [flex], 1 053 för [max] och 1 000 för [dev] på samma live-tavla. En rankning uttryckt på en tavla som vi inte kan hitta, ungefär 150 Elo under den tavla vi kan hitta, är inte ett benchmarkresultat. Det är ett påstående som väntar på en extern körning.

På FLUX 3-sidan finns inget att kontrollera, vilket är poängen. Inget upplösningsmål, inget antal steg, ingen gräns för referensbilder, inget parameterantal för bildnivån. Färdplanen är en lista med adjektiv.

Screenshot of the Black Forest Labs API quick-start documentation page, captured 23 September 2026, showing the documented FLUX 3 endpoint as a video endpoint with an API key header and asynchronous polling, and no image-tier endpoint alongside it.

Vad ska man göra medan båda är otillgängliga

Ingen av sidorna i den här jämförelsen går att routa via OrcaRouter i dag, och det är värt att vara tydlig med det i stället för att låta en modellsida antyda något annat: vår katalog innehåller ingen inclusionAI-modell och ingen FLUX-nivå, så siffrorna ovan är leverantörernas egna och inget här är en rutt du kan anropa via oss. Vad routningslagret verkligen är värt i en lucka som denna är dagen efter att luckan har slutits. Eftersom OrcaRouter för vidare leverantörernas listpriser med 0 % påslag, blir en ändring av leverantörens taxa live hos oss samma dag i stället för efter en omprissättningscykel, och eftersom ett genereringsanrop ligger bakom en enda slutpunkt över 200+ modeller, är att byta in den av dessa två som släpps först ett byte av modell-ID snarare än en migrering. Automatisk failover spelar roll av samma skäl som alltid med en obeprövad modell: om en bildslutpunkt i första utgåvan vacklar under belastning flyttas begäran i stället för att misslyckas.

Dagens beslut är snävare än inramningen antyder. Om du behöver bildgenerering i produktion det här kvartalet kvalificerar ingen av kandidaterna, och det ärliga svaret är en FLUX.2-nivå – verklig, prissatt, anropbar och oberoende poängsatt – med FLUX 3 Image bevakad som ett framtida utbyte. Om du bygger utvärderingsramverk är Ming-Image-0.1-Design det mer intressanta objektet av de två: vikterna går att ladda ner nu, licensen tillåter vad du än vill göra med dem, och den första trovärdiga Elo som någon publicerar för den kommer att vara en riktig nyhet. Och om du bevakar BFL är signalen att bevaka inte ett blogginlägg. Det är en /flux-3-rutt som dyker upp bredvid /flux-2-*-posterna i slutpunktsdokumentationen, för det är ögonblicket då bildnivån slutar vara en färdplan.

The OrcaRouter models catalogue, captured 23 September 2026, showing the English-language directory reporting 199 models across 15 providers on one API key, with the copy-the-model-ID instructions and the filter panel for input modalities, context length, price, status and series.