
GPT-Image-2.5 vs Qwen-Image-3.0: Zwei Closed-Source-Flaggschiffe, zwei unterschiedliche Preisschilder
- openaiNEUOpenAI: GPT-6 Astra2026-09-0455Intelligenz77Coding
- googleNEUGoogle: Gemini 3.8 Flash2026-09-0247Intelligenz76Coding
- qwenNEUQwen: Qwen3.8 Max (0902)2026-09-0247Intelligenz72Coding
- anthropicNEUAnthropic: Claude Fable 5.12026-09-0157Intelligenz82Coding
- AlibabaNEUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.3 Flash2026-08-2646Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1849Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1541Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1251Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0547Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0347Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2140Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Intelligenz49Coding
Der klarste Weg, GPT-Image-2.5 gegen Qwen-Image-3.0 zu lesen, ist als zwei Flaggschiffe, die im selben Sommer ihre Türen geschlossen haben. Am 8. September brachte OpenAI GPT-Image-2.5 heraus, das ChatGPT-Images-2.5-Modell, das über die API als GPT-Image-2.5 Flare und GPT-Image-2.5 Sunburst bereitgestellt wird, als reines Hosted-Produkt, das in Tokens abgerechnet wird – $8 pro Million Bild-Eingabe-Tokens und $30 pro Million Bild-Ausgabe-Tokens. Etwa fünf Wochen zuvor, am 4. August, brachte Alibabas Qwen-Team Qwen-Image-3.0 zur allgemeinen Verfügbarkeit auf Qwen Cloud und Alibaba Cloud Bailian – und diesmal, in einer leisen Kehrtwende, die mehr bedeutet als jedes einzelne Feature, lieferte es überhaupt keine Gewichte aus. Qwen-Image 1.0 und 2.0 waren Open-Source-Veröffentlichungen unter Apache-2.0 mit technischen Berichten am selben Tag; Qwen-Image-3.0 hat keine herunterladbaren Gewichte, keinen technischen Bericht, keine Modellkarte, keine Parameteranzahl und keine Benchmarks von seinem eigenen Hersteller. Beide sind jetzt geschlossene, gehostete Bild-Flaggschiffe der beiden Labore mit der stärksten Open-Weight-Reputation auf beiden Seiten des Pazifiks. Der Vergleich zwischen ihnen dreht sich teils um die Bildqualität und vor allem darum, was jedes Labor beschlossen hat, nicht mehr kostenlos anzubieten.
Keines der beiden Modelle wird durch die Dokumentation seines eigenen Herstellers validiert, und genau darin unterscheiden sich die beiden. GPT-Image-2.5 hat noch keinen unabhängigen Score — es gibt keinen Artificial-Analysis-Eintrag zum 9. September 2026, also sind seine Qualitätsbehauptungen von OpenAI berichtet und nicht reproduziert. Qwen-Image-3.0 wird ohne irgendetwas von Alibaba ausgeliefert, aber die Pro-Edition ist dennoch auf den unabhängigen Ranglisten erschienen: In den Artificial-Analysis-Schnappschüssen von September liegt Qwen-Image-3.0-Pro im Mittelfeld bei etwa 1.086 Elo für Text-zu-Bild und 1.079 für Bildbearbeitung, gelistet bei fast 40 $ pro 1.000 Bildern. Das ist ein wirklich unabhängiges Signal, und es ist kein schmeichelhaftes — es platziert Alibabas Flaggschiff etwa neunzig Elo hinter dem Spitzenreiter GPT Image 2 (hoch) und unter Meta Muse Image und Nano Banana 2. Jeder Preis in diesem Artikel ist ein Listenpreis des Anbieters; jeder Score stammt von Artificial Analysis, nicht von Alibaba.
Warum die Geschlossenheit die Geschichte ist.
Für Alibaba ist die Schließung von Qwen-Image eine strategische Kehrtwende mit klarer Logik: Die bisherigen offenen Bildmodelle wurden zwar häufig heruntergeladen, waren für Alibaba jedoch kommerziell wertlos, da jeder sie selbst hosten konnte. Qwen-Image-3.0 ist darauf ausgelegt, das Gegenteil zu sein – das Qwen-Team positioniert es ausdrücklich um das Schriftzeichen 实, „praktisch", was Produktionsarbeit bedeutet, die über eine kostenpflichtige gehostete API läuft. Dieselbe Logik gilt bereits für die Spitzenmodelle der übrigen Qwen-Familie, und sie macht jedes frühere Tutorial, das „Laden Sie einfach Qwen-Image herunter" besagte, zu einem historischen Dokument.
OpenAI hatte nie ein offenes Bild-Flaggschiff, das es hätte schließen können, also bleibt seine Haltung unverändert: GPT-Image-2.5 existiert, um aufgerufen, abgerechnet und gemessen zu werden, mit integrierter C2PA-Herkunft und Wasserzeichen. Die praktische Konsequenz für einen Entwickler ist auf beiden Seiten dieses Vergleichs identisch — {{1}}es gibt keine Selbsthosting-Option, kein Fine-Tuning des Basismodells, keinen Offline-Fallback{{/1}}. Sie mieten das Modell von seinem Eigentümer {{2}}zu den Konditionen des Eigentümers{{/2}}, {{3}}und die einzige verbleibende Frage ist, welches Mietmodell Sie benötigen{{/3}}.
Wofür jedes Flaggschiff tatsächlich gebaut wurde
Qwen-Image-3.0s technische Geschichte dreht sich um Dokumente, Layout und Sprachdichte. Alibaba beansprucht eine Prompt-Kapazität von 4.500 Token – etwa das Viereinhalbfache der Vorgängergeneration –, die es dem Modell ermöglicht, dichte Layouts in einem Durchgang zu erstellen: ganze Zeitungsseiten, Infografik-Raster, Storyboards, Prüfungsbögen und UI-Mockups. Es verspricht lesbare Textdarstellung bis hinunter zu etwa zehn Pixeln, einschließlich Mathematik und LaTeX, native Darstellung in zwölf Sprachen mit mehr als zwanzig Schriftarten und hundert künstlerischen Stilen sowie bis zu 2048×2048 Ausgabe mit bis zu sechs Bildern in einem einzigen Aufruf. Generierung und Bild-zu-Bild-Bearbeitung leben in einem Modell. Wenn sich die Behauptungen halten, ist es das stärkste gehostete Modell für textdichte, layoutlastige, mehrsprachige Bildarbeit – und die AA-Platzierung seiner Pro-Edition deutet darauf hin, dass die Realität hinter dem Anspruch zurückbleibt: kompetente Bildqualität im Mittelfeld, aber noch kein Anzeichen eines Text-Layout-Führers.
Die technische Geschichte von GPT-Image-2.5 ist das andere Ende des Bildspektrums: die Bearbeitung und das Motiv, nicht die Seite. OpenAIs Behauptungen konzentrieren sich auf Referenztreue – eine Person, ein Haustier oder ein Produkt über Änderungen von Umgebung und Stil hinweg erkennbar zu halten –, auf Multi-Turn-Bearbeitung, die nur das berührt, was angefragt wurde, auf transparente Hintergründe und schärfere feine Details, wobei der Sunburst-Endpunkt für präzise Bearbeitungsarbeit und Flare für schnelle Generierung steht. Der Anspruch an die Textdarstellung ist enger gefasst als der von Qwen (korrekte Handhabung von Chinesisch unter anderem Schriften), weil OpenAI nicht Dokumentlayout anstrebt; es strebt den kommerziellen Fotografie- und Produktdesign-Workflow an, bei dem das einzelne, wiederholt bearbeitete Bild das Ergebnis ist.

Der Preisvergleich, den keiner der Anbieter abschließt.
Qwen-Image-3.0 nennt Preise pro Bild: Die Inlandspreise für Verbraucher beginnen bei etwa ¥0,18 pro Bild für die Standard-Edition, die Pro-Version ist teurer – etwa ¥0,25 bei 1K-Auflösung und bis zu etwa ¥0,5 bei 2K – und die internationalen Standard-Preise liegen im Bereich von $0,03–$0,04 pro Bild. Unabhängige Foren verzeichnen die Pro-Edition bei etwa $40 pro 1.000 Bilder. GPT-Image-2.5 gibt Preise in Tokens an und veröffentlicht kein Äquivalent pro Bild; seine Preisliste entspricht der von GPT-Image-2, die Artificial Analysis bei hoher Qualität auf etwa $211 pro 1.000 Bilder ansetzt. Selbst wenn man einräumt, dass die OpenAI-Zahl für den Vorgänger gilt, liegt der Unterschied bei den Listenpreisen in der Größenordnung des Fünf- bis Achtfachen – und man erhält dafür zwei völlig unterschiedliche Qualitätsversprechen: Qwens Versprechen wird an der Menge korrekt dargestellter kleiner Texte auf einer dicht bedruckten Seite gemessen, das von OpenAI an der Wiedergabetreue eines bearbeiteten Motivs.
Der Vergleich ist auch einer, den keiner der Anbieter sauber abschließen lässt. Qwens Standard-Preise sind real, aber die Qualität der Standard-Edition ist eine Blackbox – Alibaba veröffentlicht nichts, und nur die im Mittelfeld liegenden AA-Werte der Pro-Edition existieren als Anker für die Familie. OpenAIs Qualitätsaussagen sind konkret und intern bewertet, aber die Kosten pro Bild sind unbekannt und seine Ergebnisse wurden nicht unabhängig gemessen. Man kann beide Familien bepreisen und jeweils nur teilweise validieren.
Dimension für Dimension
• Veröffentlichung — GPT-Image-2.5: Allgemeine Verfügbarkeit am 8. September 2026. Qwen-Image-3.0: Allgemeine Verfügbarkeit am 4. August 2026 (angekündigt am 21. Juli; Pro-Ausgabe seit Juli unabhängig gelistet).
• Offenheit — Beide geschlossen, nur gehostet. Die Schließung von Qwen-Image-3.0 kehrt die unter Apache-2.0 offenen Veröffentlichungen von Qwen-Image 1.0 und 2.0 um; GPT-Image-2.5 war nie offen.
• Preis — GPT-Image-2.5: $8 Bild-Eingabe / $30 Bild-Ausgabe pro Million Tokens, pro Bild unveröffentlicht. Qwen-Image-3.0: ab ~¥0.18 pro Bild (Standard, ~$0.03 international); Pro ~¥0.25–0.5, ~$40/1k auf AA.
• Stärken — GPT-Image-2.5: Bearbeitungspräzision, Referenztreue, Konsistenz über mehrere Durchgänge. Qwen-Image-3.0: dichte Dokument-/Layout-Generierung, 4.500-Token-Prompts, ~10px lesbarer Text, 12 Sprachen.
• Unabhängiges Signal — GPT-Image-2.5: noch keine. Qwen-Image-3.0: Pro im Mittelfeld bei AA — ~1.086 T2I, ~1.079 Bearbeitung, etwa 90 Elo hinter GPT Image 2 (hoch).
• Ausgabe — GPT-Image-2.5: bis zu 3840×2160, transparente Hintergründe. Qwen-Image-3.0: bis zu 2048×2048, bis zu sechs Bilder pro Aufruf.
Welches Mietgerät passt zu Ihrer Arbeitslast?
Wenn Ihre Arbeit Dokumente, Bildung, Lokalisierung oder mehrsprachiges Layout in hohem Volumen umfasst — Kursmaterialien mit Gleichungen, Zeitungs- und Magazinseiten, UI-Mockups, Infografiken, die in einem Dutzend Sprachen lesbaren Text enthalten müssen — ist Qwen-Image-3.0 das Flaggschiff für diese Aufgabe, und die Preisgestaltung von Standard pro Bild macht Experimente in großem Umfang günstig. Die Bedingung ist Vertrauen: Die Standard-Edition ist undokumentiert, und die vorhandenen unabhängigen Bewertungen gelten für die teurere Pro-Edition, die im Mittelfeld landet — gut für Layout-Arbeit, aber kein Qualitätsführer. Kalkulieren Sie Budget für visuelle QA im großen Maßstab ein.
Wenn Ihre Arbeit kommerzielle Bildwelten umfasst – Produktaufnahmen, Kampagnen-Creatives, referenzkonsistente Bearbeitungen, bei denen das Motiv über eine lange Bearbeitungskette hinweg unverändert erhalten bleiben muss –, ist GPT-Image-2.5 die bessere Wette, allerdings mit derselben Einschränkung in abgeschwächter Form: Immerhin veröffentlicht OpenAI eine Preisliste und konkrete Angaben, und die gemessene #1-Platzierung des Vorgängers auf der AA-Text-zu-Bild-Rangliste liefert Ihnen eine rationale A-priori-Annahme. Keines der beiden Modelle ist Stand 9. September 2026 im Katalog von OrcaRouter (die frühere OpenAI-Generation, GPT-Image-2, ist dort gelistet, zum Listenpreis des Anbieters ohne Aufschlag), daher bedeutet ein A/B-Test, dass Sie Schlüssel sowohl für Qwen Cloud als auch für die OpenAI-API vorhalten müssen. Die Pass-through-Idee gilt weiterhin, sobald diese Modelle dort tatsächlich verfügbar sind: Ein Aggregator, der zum Listenpreis des Anbieters ohne Aufschlag abrechnet, ist der sauberste Weg, um solche anbieterübergreifenden Tests durchzuführen, ohne eine Abrechnung pro Anbieter aufzubauen.

Die offene Frage, die beide Modelle hinterlassen, ist, ob ein „geschlossenes Flaggschiff“ eine dauerhafte Strategie für die Bildgenerierung ist oder nur eine vorübergehende. Die Schließung von Qwen-Image-3.0 ist leichter umkehrbar – Alibaba hat eine Tradition der Offenheit und eine Community, die sie erwartet – und das lautere Signal, wenn es die Gewichte wieder veröffentlicht, wird sein, dass das reine Hosting-Experiment nicht genug eingebracht hat. GPT-Image-2.5 setzt darauf, dass OpenAIs Vorsprung bei der Bildbearbeitung, sobald er gemessen ist, die nach Token abgerechneten Preise gegenüber Konkurrenten mit Abrechnung pro Bild rechtfertigt. Achten Sie auf zwei Ereignisse: Qwen-Image-3.0 (Non-Pro), das überhaupt auf einer unabhängigen Rangliste erscheint, und GPT-Image-2.5, das dasselbe tut. Bis dahin ist dies ein Vergleich zweier Preislisten, an denen Qualitätsversprechen hängen, von denen nur eine – die Qwen-Pro-Edition – bisher von unabhängiger Seite geprüft wurde, und diese Prüfung fiel im Mittelfeld aus.

