
Qwen-Image 2.1 vs. FLUX 3: Zwei Bildmodelle, die man nicht so recht nutzen kann
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen-Image 2.1 und FLUX 3 sind die beiden interessantesten Bildveröffentlichungen der zweiten Hälfte des Jahres 2026, und keine von beiden ist ohne Weiteres nutzbar. Qwen-Image 2.1, das das Qwen-Image-Team am 20. September 2026 als Open Source veröffentlichte, ist ein einheitliches 7B-Parameter-Modell für Generierung und Bearbeitung, das Sie heute Nachmittag herunterladen und rechtlich nicht in ein kommerzielles Produkt integrieren können. FLUX 3, das Black Forest Labs am 23. Juli 2026 angekündigt hat, ist ein einheitliches multimodales Foundation-Modell, dessen Bildstufe – der Teil, den man tatsächlich vergleichen würde – zwei Monate nach der Ankündigung immer noch keinen öffentlichen Endpoint, keine Modell-ID, keinen Preis und keine Benchmarks hat. Der Vergleich lautet daher nicht: „Welches ist besser?“ Sondern: Welchen der beiden Blocker kann man umgehen?
Zwei verschiedene Arten von Nichtverfügbarkeit
Es ist verlockend, beide unter „noch nicht bereit“ abzulegen und zur Tagesordnung überzugehen. Das würde die einzige Entscheidung verschleiern, auf die es ankommt, denn die beiden Blocker haben entgegengesetzte Formen.
Der Blocker von Qwen-Image 2.1 ist rechtlicher Natur, und er besteht aus einer Zeile in einer Datei, die man lesen kann, bevor man überhaupt etwas herunterlädt. Die Gewichte liegen auf Hugging Face und ModelScope, die Model Card ist verfasst, der Inferenzcode ist veröffentlicht, und vier separate Serving-Frameworks hatten bereits vor oder am Release-Tag gemergten Support. Technisch steht nichts zwischen Ihnen und einem lauffähigen Modell. Was zwischen Ihnen und dem Ausliefern steht, ist die Qwen Research License Agreement vom 20. September 2026, deren Rechteeinräumungsklausel die Nutzung „FOR NON-COMMERCIAL PURPOSES ONLY" gestattet und jeden, der kommerzielle Rechte wünscht, dazu anweist, eine separate Lizenz beim Anbieter zu beantragen.
Der Blocker von FLUX 3 ist physischer Natur. Es gibt keinen Bild-Endpunkt zum Aufrufen, keine Modellkennung zum Übergeben und keine Preisliste, gegen die man kalkulieren könnte. Die eigene Preisseite von BFL deckt die FLUX 3 Video-Tarife und die ältere FLUX.2-Bildreihe ab; einen FLUX 3 Bild-Tarif deckt sie nicht ab, weil es nichts zu bepreisen gibt. Der Zugang zum Bildmodell erfolgt nur auf Anfrage statt über eine Loslegen-Schaltfläche: Die eigene FLUX 3-Seite von BFL führt den Bild-Tarif als „demnächst verfügbar“ auf, und es ist der Action-Tarif, der das Early-Access-Label trägt.
Also, eines davon ist ein Modell, das Sie heute Abend ausführen können und nicht verkaufen können, und das andere ist ein Modell, das Sie verkaufen könnten und nicht ausführen können. Welches von beiden für Sie nützlicher ist, hängt ganz davon ab, auf welcher Seite dieses Satzes Sie stehen – ein internes Forschungsteam und ein kommerzielles Produktteam sollten aus denselben zwei Tatsachen zu gegensätzlichen Schlussfolgerungen gelangen.
Die Dimension-für-Dimension-Lesart
• Status — Qwen-Image 2.1: Gewichte, Lizenz und Modellkarte veröffentlicht am 20. September 2026, dazu am selben Tag ein Hersteller-Blogbeitrag. FLUX 3 am 23. Juli 2026 angekündigt; bislang ist nur die Video-Stufe erschienen, die am 4. August 2026 allgemein verfügbar wurde.
• Was Sie heute tatsächlich aufrufen können — Qwen-Image 2.1 läuft lokal über Diffusers, ComfyUI, vLLM-Omni, SGLang und LightX2V oder über die API des Anbieters und mehrere Drittanbieter-Plattformen. FLUX 3 führt seine Bild-Stufe als „coming soon“ ohne aufrufbaren Endpunkt auf und bietet einen bepreisten, allgemein verfügbaren Video-Endpunkt.
• Architektur — Qwen-Image 2.1 ist ein 32-schichtiger Single-Stream-DiT mit 7B Parametern in der visuellen Generierungskomponente, einem Qwen3-VL 8B Text-Encoder und einem 64-Kanal-RGBA-VAE bei 16× räumlicher Kompression. FLUX 3 ist ein einheitliches Flow-Modell, das gemeinsam über Bild, Video und Audio trainiert wird, aufgebaut auf einer selbstüberwachten Flow-Matching-Methode, die BFL Self-Flow nennt, mit einer Aktionsvorhersage-Ebene, die parallel zu Mimic Robotics entwickelt wurde.
• Native-Transparenz — Qwen-Image 2.1 generiert und bearbeitet RGBA-Bilder, bearbeitet Text innerhalb transparenter Ebenen und extrahiert Motive aus RGB-Fotografien in transparente Ebenen, womit die Funktion integriert wird, die Alibaba im Dezember 2025 separat als Qwen-Image-Layered veröffentlicht hat. BFL hat für FLUX 3 Image keine Transparenz-Angabe veröffentlicht.
• Referenzbilder — Qwen-Image 2.1 akzeptiert bis zu 10 Eingabereferenzen, mit lokaler Bearbeitung per Kreis, gemalter Anmerkung oder separater Maske. Für FLUX 3 Image existiert keine veröffentlichte Angabe.
• Auflösung — Qwen-Image 2.1 ist nativ 2K, standardmäßig 2048×2048 bei 40 Inferenzschritten, mit sieben dokumentierten Seitenverhältnis-Voreinstellungen. Die Auflösungen von FLUX 3 Image werden in der Ankündigung nur als „breit“ beschrieben, wobei nichts veröffentlicht wurde.
• Preis — für keinen von beiden gibt es einen veröffentlichten Preis. Qwen-Image 2.1 hat zum Zeitpunkt des Verfassens keinen aufgeführten Hosting-Preis; FLUX 3 Image hat keine Preiskarte, weil es keinen Endpunkt hat. Die einzige FLUX 3-Preisangabe, die existiert, ist Video, mit 0,06 $ pro Sekunde für Draft, 0,17 $ pro Sekunde für HD und 0,29 $ pro Sekunde für FHD.
• Lizenz — Qwen Research License Agreement, nur nicht-kommerzielle Nutzung, kommerzielle Nutzung auf gesonderte Anfrage. Die Lizenzbedingungen von FLUX 3 für die Bildstufe wurden überhaupt nicht veröffentlicht.
Eine Asymmetrie verdient eine eigene Zeile, denn sie ist die Falle in diesem Duell. FLUX 3 hat durchaus veröffentlichte Benchmark-Zahlen – ein internes Elo von 1.135 für Text-zu-Video sowie Gewinnraten bei menschlicher Präferenz, die gegen Grok Imagine Video, Seedance 2.0, Gemini Omni Flash, Runway Gen-4.5 und Luma Ray 3.2 berichtet werden. Jede einzelne dieser Zahlen beschreibt die Video-Stufe. Keine davon lässt sich auf die Bildgenerierung übertragen, und BFL selbst hat keine Bild-Benchmarks oder Gewinnraten veröffentlicht. Ein FLUX-3-Video-Elo als Beleg für die Bildqualität von FLUX 3 anzuführen, ist der mit Abstand leichteste Fehler in diesem Vergleich.

Was jede Seite tatsächlich zeigen kann
Stellt man die Belege nebeneinander, kehrt sich die Asymmetrie gegenüber dem vorherigen Abschnitt um.
FLUX 3 hat ein ausgeliefertes, bepreistes, allgemein verfügbares Produkt – nur nicht das im Titel dieses Artikels. FLUX 3 Video erzeugt Clips von bis zu 20 Sekunden mit synchronisiertem Audio in einem einzigen Durchlauf, unterstützt Text-zu-Video, Bild-zu-Video, Video-zu-Video, Keyframe-zu-Video und generative Fortsetzung und wird bereits von Canva, Burda, Magnific, Krea und Picsart getestet. Das ist ein reales, eingesetztes System mit einer echten Kundenliste. Die Bild-Ebene ist der Teil, der noch nicht da ist, und BFLs ursprüngliche Angabe, dass sie „in den kommenden Wochen“ folgen würde, hat inzwischen zwei volle Monate überdauert, ohne einen öffentlichen Endpunkt.
Qwen-Image 2.1 hat das umgekehrte Profil. Seine Qualitätsaussagen stammen aus dem eigenen Qwen-Image-Bench-Vergleichsdiagramm des Anbieters, und kein Dritter hat sie reproduziert. Doch die Sache selbst liegt in Ihren Händen: 33 GB Gewichte, ein Repository-Layout im Apache-Stil mit einer Lizenzdatei, die ehrlich sagt, dass sie nur für Forschungszwecke gedacht ist, und ein Serving-Pfad ab Tag null über fünf Frameworks. Außerdem gibt es einen einzigen Early-Access-Praxisbericht von einem Tester, der die finalen Gewichte über eine ModelScope-Studio-Oberfläche laufen ließ und berichtete, dass Text-zu-Bild ungefähr 10–15 Sekunden und Bearbeitung 18–23 Sekunden dauert, dass das Verhalten bei Kamera-Presets und der Rollenzuweisung mehrerer Charaktere stark ist und dass die Konsistenz über mehrere Referenzen ab etwa drei Eingabebildern nachzulassen beginnt. Ein einziger Tester, keine Stoppuhr, kein veröffentlichtes Prompt-Set. Tendenziell nützlich, formal unverifiziert.
Die ehrliche Zusammenfassung der Belege: Qwen-Image 2.1 hat ein lauffähiges Modell und keine unabhängigen Qualitätsdaten; FLUX 3 Image hat Herstellerbehauptungen und weder ein lauffähiges Modell noch überhaupt irgendwelche Bilddaten. Wenn Ihre Frage lautet: „Um welches davon sollte ich eine Pipeline herum planen?“, dann lautet die Antwort heute: um keines, und der Grund ist unterschiedlich.

Wo sich der Workaround tatsächlich befindet
Für ein kommerzielles Team hat der Qwen-Image 2.1-Blocker eine Gestalt, mit der man planen kann. Die Lizenz ist eindeutig, der Kontakt für kommerzielle Lizenzen ist im Repository genannt, und das Modell ist klein genug – 7B in der Generierungskomponente –, dass sich die Kosten für die Evaluierung auf Ihrer eigenen Hardware in einem Nachmittag bemessen, nicht in einem Quartal. Erst evaluieren, dann verhandeln, und halten Sie den Forschungs-Build in der Zwischenzeit von jedem kundenorientierten Pfad fern. Das ist ein normales Beschaffungsproblem.
Der FLUX 3 Image Blocker ist kein Beschaffungsproblem, denn es gibt nichts zu beschaffen. Sie können sich in eine Early-Access-Warteschlange einreihen, und Sie können beobachten, wann der Endpunkt erscheint, und das ist die gesamte verfügbare Handlungsmöglichkeit. Wenn Sie heute Bildgenerierung der FLUX-Familie im Produktivbetrieb benötigen, sind die aufrufbaren Optionen die älteren Linien FLUX.2 und FLUX Pro/Dev, die bepreist und verfügbar sind – und die einer anderen Modellgeneration angehören als die, um die es in diesem Artikel geht.
Für ein Team, das beide Kandidaten testen möchte, ohne einen von ihnen auf einen Produktionspfad festzulegen, ist dies genau der Fall, für den die Routing-Schicht existiert. OrcaRouter stellt über 200 Modelle hinter einem einzigen OpenAI-kompatiblen Endpunkt zum Listenpreis des Anbieters ohne Aufschlag bereit, mit automatischem Failover über Anbieter hinweg, sodass ein nicht erprobtes oder noch nicht veröffentlichtes Modell hinter einer Route neben etwas steht, dem Sie bereits vertrauen, anstatt es zu ersetzen – und da der Listenpreis durchgereicht wird, ist jede Preisänderung eines Anbieters bei einem gerouteten Modell noch am selben Tag wirksam. Weder Qwen-Image 2.1 noch FLUX 3 Image ist zum Zeitpunkt des Verfassens dieses Textes routbar, und wir werden nicht so tun, als wäre es anders; was wir routen, ist die Bildlinie um sie herum, einschließlich der GPT-Image-Familie von OpenAI, der Imagen-4-Stufen von Google und der Gemini-Bildvorschauen sowie des Grok-Imagine-Bildendpunkts von xAI. Das sind die Modelle, die eine Workload tragen können, während diese beiden ihre Sache klären.
Noch eine Sache, die speziell auf der Qwen-Seite Beachtung verdient. Alibaba veröffentlichte Qwen-Image 1.0 und 2.0 als Open-Weights unter Apache-2.0, brachte dann Qwen-Image 3.0 im Juli 2026 als vollständig geschlossenes gehostetes Modell ohne Gewichte, ohne Lizenz und ohne technischen Bericht heraus und veröffentlichte anschließend Qwen-Image 2.1 im September als Open-Weights unter einer Lizenz nur für Forschungszwecke. Die Richtung ist keine gerade Linie, und die Lizenzbedingungen der nächsten Veröffentlichung sind eine echte offene Frage und keine sichere Annahme in die eine oder andere Richtung.

Das Urteil, so wie es ist
Wenn Sie Forscher oder ein internes Evaluierungsteam sind, ist Qwen-Image 2.1 derzeit mit großem Abstand das nützlichere der beiden – es ist herunterladbar, dokumentiert, framework-unterstützt und ehrlich in Bezug auf seine Bedingungen. Wenn Sie ein kommerzielles Team sind, sind beide blockiert, und die Blockaden sind nicht gleichwertig: Die eine ist ein Vertrag, über den Sie ein Gespräch beginnen können, die andere ist ein Produkt, das noch nicht existiert.
Wenn Sie in diesem Monat Bildgenerierung ausliefern müssen, ist keines dieser Modelle die Antwort, und die nützliche Frage ist, welches der Modelle Sie können aufrufen, Sie am nächsten bringt. Das ist eine Benchmarking-Übung, und es lohnt sich, sie mit Ihren eigenen Prompts durchzuführen statt mit jedermanns Launch-Chart – einschließlich der des Anbieters und einschließlich dieser hier.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
