Eine generierte Hero-Karte für den Artikel 'Qwen-Image 2.1 vs. Qwen-Image 3.0', die zwei abgerundete Modellkarten mit den Beschriftungen 'Qwen-Image 2.1' und 'Qwen-Image 3.0' zeigt, mit Datumsmarkierungen 20. Sep. 2026 und 21. Juli 2026, einem Download-Symbol auf der einen und einem Cloud-Symbol auf der anderen sowie einem Band mit der Aufschrift 'Die niedrigere Zahl ist das neuere Modell'.
Guides & Insights

Qwen-Image 2.1 vs Qwen-Image 3.0: Die niedrigere Nummer ist das neuere Modell

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Beginnen Sie mit dem, was alle ins Stolpern bringt. Qwen-Image 2.1 ist neuer als Qwen-Image 3.0. Der Anbieter veröffentlichte Qwen-Image 3.0 am 21. Juli 2026 und machte es am 5. August allgemein verfügbar. Er veröffentlichte Qwen-Image 2.1 am 20. September 2026 – sieben Wochen später und eine Minor-Version niedriger. Die Nummerierung ist keine Reihenfolge; es sind zwei verschiedene Produktlinien, die sich einen Namen teilen, und die mit Abstand nützlichste Tatsache über jede der beiden ist, dass sie gegensätzliche Positionen zu der Frage einnehmen, die entscheidet, ob man auf ihnen aufbauen kann. Qwen-Image 3.0 ist geschlossen und gehostet, ohne Gewichte, ohne Lizenz und ohne technischen Bericht. Qwen-Image 2.1 hat offene Gewichte, ist heute herunterladbar, unter einer Forschungslizenz, die ausschließlich nichtkommerzielle Nutzung erlaubt.

Zwei Produkte, die zufällig denselben Namen haben

Die Qwen-Image-Familie hat nun innerhalb von vierzehn Monaten drei unterschiedliche Lizenzpositionen eingenommen, und sie darzulegen beseitigt den größten Teil der Verwirrung:

Qwen-Image 1.0 und 2.0 — Apache 2.0 offene Gewichte auf Hugging Face und ModelScope, technische Berichte am Starttag, selbst hostbar, feinabstimmbar, quantisierbar.

Qwen-Image 3.0 — geschlossen. Keine Gewichte, keine angegebene Lizenz, keine Modellkarte, kein technischer Bericht, keine veröffentlichte Benchmark-Tabelle. Nur über eine gehostete API erreichbar, in den Editionen Pro und Standard.

Qwen-Image 2.1 — wieder offene Gewichte, allerdings unter der Qwen Research License Agreement vom 20. September 2026, die Rechte „NUR FÜR NICHTKOMMERZIELLE ZWECKE" einräumt und die kommerzielle Nutzung auf eine separat auszuhandelnde Lizenz verweist.

Liest man das als Muster statt als Zeitlinie, ist die Form klar: Alibaba behandelt „open“ nicht länger als binär. Qwen-Image 2.1 ist weder die permissive Veröffentlichung, die 1.0 und 2.0 waren, noch die geschlossene Veröffentlichung, die 3.0 war. Es ist eine dritte Position – Gewichte, die man einsehen, ausführen und verändern kann, mit einer kommerziellen Schranke, die vorne angeschraubt ist.

Was jedes Modell tatsächlich ist

Qwen-Image 2.1 — ein einheitliches Text-zu-Bild-Generierungs- und Bildbearbeitungsmodell mit 7B Parametern in seiner visuellen Generierungskomponente, aufgebaut als 32-schichtiger Single-Stream-DiT. Ein Qwen3-VL 8B Text-Encoder und ein 64-Kanal-RGBA-VAE mit 16-facher räumlicher Kompression stehen daneben; der vollständige Download umfasst rund 33 GB, wobei der Text-Encoder mehr als die Hälfte ausmacht. Block-kausale Attention mit einer kausalen Maske auf Token-Ebene für Text und einer bidirektionalen Maske auf Chunk-Ebene für die Bildgenerierung, plus Wiederverwendung des Prefix-KV-Caches für die Bearbeitung mehrerer Bilder. Nativ 2K, standardmäßig 2048×2048 bei 40 Schritten, mit sieben Seitenverhältnis-Voreinstellungen.

Qwen-Image 3.0 — ein geschlossenes gehostetes Modell in den Editionen Pro und Standard, das Bildgenerierung und -bearbeitung über eine einzige API bereitstellt. Alibabas Material zur Markteinführung behauptet Prompts bis zu etwa 4.500 Token, lesbaren Text bis hinunter zu etwa 10 Pixeln und die Abdeckung von 12 Sprachen über mehr als 20 Schriftarten, mit Ausgabe bis zu 2048×2048 und bis zu sechs Bildern pro Aufruf. Es wurde keine Parameteranzahl veröffentlicht; die viel zitierte Angabe von ~20B MMDiT wird eher berichtet als bestätigt.

Der architektonische Unterschied, der in der Praxis am meisten zählt, ist nicht die Größe – sondern wo das Modell läuft und was man damit machen kann. Qwen-Image 2.1 kommt als Dateien, die man inspizieren, quantisieren, mit privaten Daten feinabstimmen und auf eigener Hardware ausführen kann, wobei ein Pull Request zur SGLang-Unterstützung drei Tage vor dem Eintreffen der Gewichte zusammengeführt wurde. Qwen-Image 3.0 kommt als Endpunkt. Man kann es nicht quantisieren, man kann es nicht feinabstimmen, und man kann es nirgendwo anders ausführen als dort, wo Alibaba es ausführt.

Beim Bearbeiten gehen die beiden am stärksten auseinander.

Beide Modelle übernehmen Generierung und Bearbeitung in einem System, daher liegt der interessante Vergleich in den Bearbeitungsspezifika – und hier ist das neuere, kleinere Modell auf dem Papier das leistungsfähigere.

Referenzbilder — Qwen-Image 2.1 akzeptiert bis zu 10 Eingabereferenzen. Die Pro-Dokumentation von Qwen-Image 3.0 beschreibt die Unterstützung von 1–3 Eingabebildern.

Lokale Bearbeitungskontrolle — Qwen-Image 2.1 unterstützt Kreise, gemalte Anmerkungen und eine separate Maske, die als eigener Input bereitgestellt wird, sodass das Originalbild unmarkiert bleibt. Der dokumentierte Bearbeitungspfad von Qwen-Image 3.0 umfasst lokales Umschreiben, Inhaltserweiterung, Stilübertragung und Generierung aus mehreren Kamerawinkeln – ohne einen veröffentlichten maskenbasierten Workflow.

Transparenz — Qwen-Image 2.1 erzeugt und bearbeitet RGBA-Bilder nativ, bearbeitet Text innerhalb einer transparenten Ebene und extrahiert ein Motiv aus einem RGB-Foto in eine transparente Ebene. Die Ankündigung von Qwen-Image 3.0 enthält keinerlei Aussage zur Transparenz.

Prompt-Umschreibung — Qwen-Image 2.1 liefert zwei dedizierte Rewrite-Checkpoints, beides feinabgestimmte Qwen3.5-VL-9B-Modelle, eines für Text-zu-Bild und eines fürs Editing, wobei der Rewriting-Code und der System-Prompt veröffentlicht sind. Die Prompt-Verarbeitung von Qwen-Image 3.0 ist eine Blackbox hinter der API.

Ökosystem — Qwen-Image 2.1 wird ab dem ersten Tag in Diffusers, ComfyUI, vLLM-Omni, SGLang und LightX2V unterstützt, dazu AMD-ROCm- und FlagOS-Pfade. Qwen-Image 3.0 verfügt über eine API.

Diese letzte Zeile ist keine rhetorische Floskel. Für ein Team, dessen Pipeline in ComfyUI läuft oder dessen Inferenz-Stack vLLM ist, ist der Unterschied zwischen einem Modell mit einer zusammengeführten Pipeline-Klasse und einem Modell mit einem HTTP-Endpunkt der Unterschied zwischen einer Integrationsaufgabe und einer Neuimplementierung.

A generated two-column comparison scoreboard titled 'Qwen-Image 2.1 vs Qwen-Image 3.0 — the scoreboard'. Left column 'Qwen-Image 2.1': rows reading Released: 20 Sep 2026; Licence: research, non-commercial; Access: 33 GB open download; Reference images: up to 10; Transparency: native RGBA; Published price: none. Right column 'Qwen-Image 3.0': rows reading Released: 21 Jul 2026, GA 5 Aug; Licence: not published; Access: closed hosted API; Reference images: 1 to 3; Transparency: none claimed; Published price: ~$0.04 Pro, $0.03 Std. Footer reads 'Qwen-Image 2.1 specs per vendor model card, unaudited; Qwen-Image 3.0 pricing is vendor list, unaudited.'

Preis – und das, was der Preis nicht erfasst

Qwen-Image 3.0 hat den einzigen veröffentlichten Preis der beiden: In der Cloud des Anbieters wird Pro mit rund 0,04 $ pro Bild und Standard mit rund 0,03 $ angegeben, wobei die Preise für inländische Endkunden bei etwa 0,18 ¥ beginnen. Das sind Einführungswerte, die nicht unabhängig geprüft wurden. Qwen-Image 2.1 hat überhaupt keinen veröffentlichten Hosting-Tarif – es ist ein Download, und die Kosten entsprechen dem, was die eigene GPU-Zeit kostet.

Diese beiden Zeilen sind nicht vergleichbar, und so zu tun, als ob, ist der häufigste Fehler in dieser Gegenüberstellung. Ein Preis pro Bild deckt das Modell, die Serving-Infrastruktur, die Skalierung und die Uptime von jemand anderem ab. Ein Download der Gewichte deckt nichts davon ab. Die richtige Frage ist nicht, welche Zahl kleiner ist; sie ist, ob Sie die betriebliche Kapazität haben, einen 33-GB-Modell-Stack zu betreiben, und ob die Lizenz auf der günstigen Seite erlaubt, was Sie damit vorhaben.

Womit die Lizenz wieder in den Mittelpunkt des Vergleichs rückt, wo sie hingehört. Die Bedingungen von Qwen-Image 3.0 sind nicht veröffentlicht, was für regulierte Arbeit oder Agenturarbeit ein eigenes Problem darstellt — es gibt kein Dokument, auf das man sich berufen kann. Die Bedingungen von Qwen-Image 2.1 sind veröffentlicht, und darin steht: nicht kommerziell. Zwischen einer unklaren Lizenz und einer eindeutig restriktiven lässt sich die eindeutig restriktive leichter einplanen, denn zumindest weiß man, welches Gespräch zu führen ist.

A screenshot of the Qwen vendor blog page for Qwen-Image 3.0, captured September 20 2026, showing the launch announcement, the Pro and Standard edition descriptions, the claimed prompt-length and text-rendering figures, and the per-image list pricing.

Zu welchem du greifen solltest

Sie brauchen textlastige Produktionsbilder und möchten, dass jemand anderes das übernimmt — Qwen-Image 3.0 ist die passende Wahl, mit der Einschränkung, dass die prominent angeführten Werte zur Textwiedergabe Herstellerangaben sind und die vorhandenen unabhängigen Tests beschreiben, dass kleine Schrift in manchen Fällen noch fehlerhaft wiedergegeben wird.

Sie müssen das Modell selbst ausführen, es feinabstimmen oder Daten auf Ihrer eigenen Hardware behalten — Qwen-Image 2.1 ist von den beiden die einzige Option, und die Research-Lizenz ist der Preis des Eintritts.

Sie benötigen transparente Assets, Produktfreisteller oder mehr als drei Referenzbilder — Qwen-Image 2.1 ist laut den veröffentlichten Spezifikationen das stärkere Tool, und beim Referenzumfang liegt es nicht knapp vorn.

Sie benötigen kommerzielle Nutzungsrechte und eine permissive Lizenzierung – keines von beidem trifft auf Ihr Modell zu. Qwen-Image 3.0 hat überhaupt keine veröffentlichten Bedingungen, und Qwen-Image 2.1 erfordert eine ausgehandelte kommerzielle Lizenz. Die Apache-2.0-Veröffentlichungen in dieser Familie sind die früheren Qwen-Image 1.0 und 2.0.

Die letzte Zeile ist die, bei der es sich lohnt zu verweilen, denn sie beschreibt eine schrumpfende Menge. Eine bereits erteilte Lizenz ändert sich nicht rückwirkend, daher bleiben die Apache-2.0-Qwen-Image-Veröffentlichungen zu ihren ursprünglichen Bedingungen nutzbar. Doch wenn Sie eine kommerzielle Bildpipeline auf der Annahme planen, dass das neueste Qwen-Image permissiv lizenziert sein wird, sind die letzten drei Veröffentlichungen ein Beleg gegen diese Annahme.

Eines von beiden laufen zu lassen, ohne dabei die ganze Pipeline darauf zu verwetten

Beide dieser Modelle lassen sich heute aus unterschiedlichen Gründen nur schwer hinter einen Produktionspfad stellen – das eine wegen einer Lizenz, das andere wegen einer Blackbox und einer unveröffentlichten Parameteranzahl. Genau für diese Situation ist eine Routing-Schicht gemacht. OrcaRouter stellt 200+ Modelle hinter einem einzigen OpenAI-kompatiblen Endpunkt zum Listenpreis des Anbieters ohne Aufschlag bereit, mit automatischem Failover über Anbieter hinweg und einer Routing-DSL, mit der sich mehrere Modelle zu einem einzigen Aufruf kombinieren lassen, sodass ein neues oder sperriges Modell neben einem bewährten stehen kann statt davor. Modell-Fusion führt dieselbe Idee weiter: ein Panel von Modellen läuft gemeinsam, und Sie können sie anhand Ihrer eigenen Prompts vergleichen statt anhand eines Launch-Diagramms.

Weder Qwen-Image 2.1 noch Qwen-Image 3.0 gehört zu den Modellen, die wir heute routen, und dieser Artikel wird nichts anderes nahelegen. Die Bildmodelle, die wir tatsächlich routen – OpenAIs GPT-Image-Reihe, Googles Imagen-4-Stufen und Gemini-Bildvorschauen sowie xAIs Grok-Imagine-Bild-Endpunkt – sind das, woraus ein Failover-Pfad tatsächlich aufgebaut würde, während Sie das Qwen-Paar nach Ihren eigenen Maßstäben bewerten.

Worauf man achten muss, ist enger, als es aussieht. Alibaba hat jetzt gezeigt, dass offene Gewichte, geschlossene gehostete Modelle und forschungslizenzierte Downloads innerhalb derselben Familie im selben Quartal ausgeliefert werden. Das nächste Release wird nicht verraten, welches Muster gewonnen hat. Die Lizenzdatei wird es.

A screenshot of the Qwen vendor blog page for Qwen-Image 2.1, captured September 20 2026, showing the 2026/09/20 date, the headline 'Compact, Efficient, and Unified Image Creation', the 'Now open weights' hero banner, GitHub, Hugging Face and ModelScope buttons, and the 7B parameter figure.