
Qwen-Image 2.1 vs FLUX 3: Två bildmodeller du inte riktigt kan använda
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen-Image 2.1 och FLUX 3 är de två mest intressanta bildsläppen under andra halvan av 2026, och ingen av dem är direkt användbar. Qwen-Image 2.1, som Qwen-Image-teamet släppte som öppen källkod den 20 september 2026, är en enhetlig 7B-parametermodell för generering och redigering som du kan ladda ner i eftermiddag och inte lagligt kan använda i en kommersiell produkt. FLUX 3, som Black Forest Labs tillkännagav den 23 juli 2026, är en enhetlig multimodal grundmodell vars bildnivå – den del du faktiskt skulle jämföra – fortfarande inte har någon offentlig slutpunkt, inget modell-ID, inget pris och inga benchmarks två månader efter tillkännagivandet. Jämförelsen handlar därför inte om "vilken som är bättre". Den handlar om vilken av de två blockerarna du kan kringgå.
Två olika typer av otillgänglighet
Det är frestande att sortera in båda under "inte redo än" och gå vidare. Det skulle dölja det enda beslut som spelar roll, eftersom de två blockerarna har motsatta former.
Qwen-Image 2.1:s hinder är juridiskt, och det är en rad i en fil som du kan läsa innan du laddar ner något. Vikterna finns på Hugging Face och ModelScope, modellkortet är skrivet, inferenskoden är publicerad, och fyra separata serving-ramverk hade fått stöd inlemmat före eller på releasedagen. Inget tekniskt står mellan dig och en körande modell. Det som står mellan dig och att skeppa den är Qwen Research License Agreement, daterat 20 september 2026, vars klausul om rättighetsbeviljning tillåter användning "ENDAST FÖR ICKE-KOMMERSIELLA ÄNDAMÅL" och hänvisar alla som vill ha kommersiella rättigheter till att begära en separat licens från leverantören.
FLUX 3:s blockerare är fysisk. Det finns ingen bildendpoint att anropa, ingen modellidentifierare att skicka och inget priskort att budgetera mot. BFL:s egen prissida täcker FLUX 3 Video-nivåerna och den äldre FLUX.2-bildlinjen; den täcker inte en FLUX 3-bildnivå, eftersom det inte finns något att prissätta. Åtkomst till bildmodellen sker endast via förfrågan i stället för via en get-started-knapp: BFL:s egen FLUX 3-sida listar bildnivån som "kommer snart", och det är action-nivån som bär early access-etiketten.
Så en av dessa är en modell som du kan köra i kväll och inte kan sälja, och den andra är en modell som du skulle kunna sälja och inte kan köra. Vilken av dem som är mer användbar för dig beror helt och hållet på vilken sida av den meningen du står på – ett internt forskningsteam och ett kommersiellt produktteam borde dra motsatta slutsatser av samma två fakta.
Läsningen dimension för dimension
• Status — Qwen-Image 2.1:s vikter, licens och modellkort publicerades den 20 september 2026, med ett blogginlägg från leverantören samma dag. FLUX 3 tillkännagavs den 23 juli 2026; endast videonivån har släppts och nådde allmän tillgänglighet den 4 augusti 2026.
• Vad du faktiskt kan anropa idag — Qwen-Image 2.1 körs lokalt via Diffusers, ComfyUI, vLLM-Omni, SGLang och LightX2V, eller via leverantörens eget API och flera tredjepartsplattformar. FLUX 3 listar sin bildnivå som "kommer snart" utan någon slutpunkt att anropa, och erbjuder en prissatt, allmänt tillgänglig videoslutpunkt.
• Arkitektur — Qwen-Image 2.1 är en 32-lagrig enkelströms-DiT med 7B parametrar i den visuella genereringskomponenten, en Qwen3-VL 8B-textkodare och en 64-kanalig RGBA-VAE med 16× rumslig komprimering. FLUX 3 är en enda enhetlig flödesmodell som tränats gemensamt över bild, video och ljud, byggd på en självövervakad flödesmatchningsmetod som BFL kallar Self-Flow, med en nivå för aktionsprediktion utvecklad parallellt med Mimic Robotics.
• Inbyggd transparens – Qwen-Image 2.1 genererar och redigerar RGBA-bilder, redigerar text i transparenta lager och extraherar motiv från RGB-fotografier till transparenta lager, och införlivar därmed den funktion som Alibaba släppte separat som Qwen-Image-Layered i december 2025. BFL har inte publicerat något påstående om transparens för FLUX 3 Image.
• Referensbilder — Qwen-Image 2.1 tar emot upp till 10 indatareferenser, med lokal redigering via cirkel, målad markering eller en separat mask. Ingen publicerad siffra finns för FLUX 3 Image.
• Upplösning — Qwen-Image 2.1 har nativ 2K-upplösning och använder som standard 2048×2048 vid 40 inferenssteg, med sju dokumenterade förinställningar för bildförhållande. FLUX 3 Image:s upplösningar beskrivs i tillkännagivandet endast som "breda," utan att något publicerats.
• Pris — inget publicerat pris för någon av dem. Qwen-Image 2.1 har ingen listad taxa för hostad tjänst vid tidpunkten för skrivandet; FLUX 3 Image har inget priskort eftersom det inte har någon endpoint. Den enda prissättning som finns för FLUX 3 är video: 0,06 USD per sekund för draft, 0,17 USD per sekund för HD och 0,29 USD per sekund för FHD.
• Licens — Qwen Research License Agreement, endast för icke-kommersiellt bruk, kommersiellt bruk efter separat begäran. FLUX 3:s licensvillkor för bildnivån har inte publicerats alls.
En asymmetri förtjänar en egen rad, för den är fällan i den här duellen. FLUX 3 har faktiskt publicerade benchmark-siffror – ett internt Elo på 1 135 för text-till-video och vinstfrekvenser för mänskliga preferenser rapporterade mot Grok Imagine Video, Seedance 2.0, Gemini Omni Flash, Runway Gen-4.5 och Luma Ray 3.2. Var och en av dessa siffror beskriver videonivån. Ingen av dem gäller för bildgenerering, och BFL har själva inte publicerat några benchmarks eller vinstfrekvenser för bilder. Att citera ett FLUX 3-video-Elo som bevis för FLUX 3:s bildkvalitet är det enskilt enklaste misstaget att göra i den här jämförelsen.

Vad varje sida faktiskt kan visa
Lägg bevisen sida vid sida och asymmetrin inverteras från föregående avsnitt.
FLUX 3 har en produkt som är släppt, prissatt och allmänt tillgänglig – bara inte den som står i rubriken för den här artikeln. FLUX 3 Video genererar klipp på upp till 20 sekunder med synkroniserat ljud i en enda körning, stöder text-till-video, bild-till-video, video-till-video, keyframe-till-video och generativ fortsättning, och testas redan av Canva, Burda, Magnific, Krea och Picsart. Det är ett riktigt, driftsatt system med en riktig kundlista. Bildnivån är den del som inte har kommit, och BFL:s ursprungliga besked att den skulle följa "inom de kommande veckorna" har nu hållit i sig i över två månader utan en offentlig slutpunkt.
Qwen-Image 2.1 har en motsatt profil. Dess kvalitetsanspråk kommer från leverantörens eget jämförelsediagram Qwen-Image-Bench, och ingen tredje part har reproducerat dem. Men själva saken ligger i dina händer: 33 GB vikter, en Apache-liknande förvarsstruktur med en licensfil som är ärlig med att den endast är för forskning, och en dag-noll-serveringsväg över fem ramverk. Det finns också en praktisk recension med tidig åtkomst, från en testare som körde de slutliga vikterna genom ett ModelScope Studio-gränssnitt och rapporterade ungefär 10–15 sekunder för text-till-bild och 18–23 sekunder för redigering, starkt kamerapreset- och rolltilldelningsbeteende för flera karaktärer, samt konsistens mellan flera referenser som börjar försämras från omkring tre indatabilder. En recensent, ingen timer, ingen publicerad promptuppsättning. Riktgivande användbar, formellt overifierad.
Den ärliga sammanfattningen av underlaget: Qwen-Image 2.1 har en körbar modell och inga oberoende kvalitetsdata; FLUX 3 Image har leverantörspåståenden och varken en körbar modell eller någon bilddata alls. Om din fråga är "vilken av dessa bör jag planera en pipeline kring", är svaret i dag ingen av dem, och skälet skiljer sig åt.

Var kringlösningen faktiskt finns
För ett kommersiellt team har Qwen-Image 2.1-blockeraren en form som går att planera kring. Licensen är explicit, kontaktpersonen för kommersiell licens anges i repot, och modellen är tillräckligt liten – 7B i genereringskomponenten – för att kostnaden för att utvärdera den på din egen hårdvara mäts i en eftermiddag, inte ett kvartal. Utvärdera först, förhandla sedan, och håll forskningsbygget borta från alla kundvända vägar under tiden. Det är ett normalt upphandlingsproblem.
FLUX 3 Image-blockeraren är inte ett anskaffningsproblem, eftersom det inte finns något att anskaffa. Du kan ansluta dig till en kö för tidig åtkomst, och du kan hålla utkik efter att slutpunkten dyker upp, och det är allt du kan göra. Om du behöver bildgenerering i FLUX-familjen i produktion i dag är de anropbara alternativen de äldre FLUX.2- och FLUX Pro/Dev-linjerna, som är prissatta och tillgängliga – och som tillhör en annan modellgeneration än den som den här artikeln handlar om.
För ett team som vill testa båda kandidaterna utan att binda någon av dem till en produktionsväg är detta fallet som routningslagret finns till för. OrcaRouter placerar över 200 modeller bakom en enda OpenAI-kompatibel endpoint till leverantörens listpris utan påslag, med automatisk redundansväxling mellan leverantörer, så en obeprövad eller outgiven modell ligger bakom en rutt bredvid något du redan litar på i stället för att ersätta det – och eftersom listpriset förs vidare slår varje prisändring från en leverantör på en routad modell igenom samma dag. Varken Qwen-Image 2.1 eller FLUX 3 Image går att routa i skrivande stund, och vi tänker inte låtsas något annat; det vi routar är bildlinjen runt dem, inklusive OpenAIs GPT-Image-familj, Googles Imagen 4-nivåer och Geminis bildförhandsvisningar samt xAIs Grok Imagine-endpoint för bilder. Det är de modeller som kan bära en arbetsbelastning medan dessa två reder ut sig.
Ytterligare en sak som är värd att hålla ögonen på, specifikt på Qwen-sidan. Alibaba släppte Qwen-Image 1.0 och 2.0 som öppna vikter under Apache-2.0, släppte sedan Qwen-Image 3.0 i juli 2026 som en helt stängd hostad modell utan vikter, utan licens och utan teknisk rapport, och släppte därefter Qwen-Image 2.1 i september som öppna vikter under en licens endast för forskning. Utvecklingsriktningen är inte en rak linje, och licensvillkoren för nästa utgåva är en verklig öppen fråga snarare än ett tryggt antagande åt något håll.

Domen, sådan den nu är.
Om du är forskare eller ett internt utvärderingsteam är Qwen-Image 2.1 det mer användbara av de två just nu, med bred marginal – det är nedladdningsbart, dokumenterat, stöds av ramverk och ärligt om sina villkor. Om du är ett kommersiellt team är båda blockerade, och blockeringarna är inte likvärdiga: det ena är ett avtal som du kan inleda en dialog om, det andra är en produkt som ännu inte finns.
Om du behöver leverera bildgenerering den här månaden är ingendera av dessa svaret, och den användbara frågan är vilken av modellerna du kan anropa som får dig närmast. Det är en övning i benchmarking, och den är värd att göra med dina egna promptar snarare än någons lanseringsdiagram — inklusive leverantörens, och inklusive den här.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
