
Qwen-Image-2.1 is het beste open-weights-beeldmodel op beide ranglijsten van Artificial Analysis
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 223 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Alibaba's Qwen team released Qwen-Image-2.1 with open weights on 20 September 2026. Twelve days later, the independent scoreboards have caught up with it, and the result is more interesting than the launch. On the AA-Image-T2I v2.0 leaderboard, Qwen-Image-2.1 sits at rank 18 of 166 with an Elo of 1,034, from 5,286 blind comparisons. On AA-Image-Editing v2.0 it sits at rank 18 of 97 with an Elo of 1,074, from 5,536. Both of those rows are marked Open Weights on a board that marks every model individually. No other model carrying that marker on either board is placed above them. That is the whole finding: on the only two public image boards that score models by blind pairwise comparison, the released Qwen-Image-2.1 is the strongest set of downloadable weights in the field, and it is Qwen-Image-2.1 specifically, not a preview of it, that holds both positions.
Wat volgt is waar die twee getallen vandaan komen, hoe de rijen eromheen eruitzien, en de drie details op het bord die de meeste berichtgeving over de lancering wegliet — te beginnen met het feit dat het bord nergens een API voor het model registreert.
Waar de twee rijen zitten
Artificial Analysis bouwt beide ranglijsten op uit blinde paarsgewijze vergelijkingen: twee modellen beantwoorden dezelfde prompt, een stemmer kiest de betere output, en uit het aggregaat rolt een Elo-score. De twee ranglijsten delen alleen een huisstijl, verder niets. Ze beoordelen verschillende taken, hebben verschillende populaties, en hun Elo-waarden zijn onderling niet vergelijkbaar. Qwen-Image-2.1 belandt toevallig in beide op dezelfde positie, wat een samenloop is van twee verschillende verdelingen.
Tekst-naar-afbeelding, 166 modellen op het bord:
• De bovenste rij van de ranglijst is GPT Image 2.5 Sunburst (max) met 1.107 Elo uit 14.023 verschijningen — een propriëtair model met meer dan twee keer zoveel samples als Qwen-Image-2.1.
• Qwen-Image-2.1 staat op plaats 18 met 1.034 Elo en een 95%-betrouwbaarheidsinterval van 1.024 tot 1.044, op basis van 5.286 optredens.
• Lees de rijenaantallen voordat je naar de rangen kijkt. Qwen-Image-2.1 staat op rang 18 op beide ranglijsten, maar die rangen komen uit verschillende populaties — 166 modellen voor tekst-naar-afbeelding, 97 voor bewerking — en de twee Elo-waarden behoren tot twee afzonderlijke schalen. De identieke rang is rekenkundig, geen bewijs dat de twee ranglijsten het ergens over eens zijn.
• Alibaba's own two Pro-tier models are above it on this board: Qwen-Image-3.0-Pro at 1,089 Elo, rank 14, and Qwen-Image-3.0 at 1,075, rank 16. Neither carries the Open Weights marker. The board's September snapshot lists both as July 2026 releases, which is the version of the story where the newest Qwen image model is not the highest-scoring one — and on text-to-image it is not.
Beeldbewerking, 97 modellen op het bord:
• GPT Image 2.5 Sunburst (max) staat ook bovenaan dit klassement, met 1.182 Elo uit 17.899 verschijningen.
• Qwen-Image-2.1 staat op plaats 18 met 1.074 Elo, interval 1.065 tot 1.083, op basis van 5.536 verschijningen — een iets grotere steekproef dan zijn tekst-naar-afbeelding-rij, wat logisch is voor een model waarvan de bewerkingskant de luidere lanceringscopy kreeg.
• De rijen eromheen zijn drukbezet. grok-imagine-image staat één plaats lager op 1.071 en Luma UNI 1 Max op 1.069. De dichtstbijzijnde open-weights-rij eronder op dit bord is HunyuanImage 3.0 Instruct op 1.066 bij 5.221 verschijningen — 8 Elo verwijderd. Zeven rijen bevinden zich binnen achttien Elo-punten.
De claim 'top open-weights model' eerlijk lezen
De formulering in de kop doet specifiek werk, en verdient het om te worden gecontroleerd in plaats van herhaald.
• Het is een rangorde binnen een markering, niet een algehele rangorde. Qwen-Image-2.1 staat algeheel 18e op beide ranglijsten. Het Open Weights-label is wat het op elk daarvan bovenaan zet, en het label wordt per model toegepast op gezag van de ranglijst zelf — 47 rijen voor tekst-naar-afbeelding dragen de markering; 36 rijen dragen die markering op de bewerkingsranglijst, die 97 vermeldt.
• The marker describes weights, not terms. Qwen-Image-2.1 ships under the Qwen Research License Agreement dated 20 September 2026, which grants rights for non-commercial purposes only. The board's Open Weights label is accurate about downloadability and silent about what you may do with the download. Anyone reading "top open-weights image model" as "free to use in a product" has read the label past its meaning.
• Het is een momentopname, geen definitieve ranglijst. Het bord verschuift dagelijks naarmate er stemmen bijkomen. De betrouwbaarheidsintervallen van Qwen-Image-2.1 zijn ±10 Elo bij tekst-naar-afbeelding en ±9 bij bewerken; de rijen eronder liggen op overlappende intervallen. Zie de positie als actueel, niet als permanent.
Het detail dat de verslaggeving over de lancering niet had: geen API
Beide rijen van Qwen-Image-2.1 bevatten een expliciete Geen API beschikbaar-notitie. Dat is een reële kostenpost voor de rangschikking, en het zegt je iets over wie de 5.286 en 5.536 stemmen heeft gegenereerd — als er geen endpoint is om een prompt naartoe te sturen, kwamen de vergelijkingen van mensen die de weights zelf draaiden en de output indienden. Onafhankelijke Elo voor een model dat alleen self-hosted is, is een wezenlijk moeilijkere meting dan Elo voor iets dat iedereen kan aanroepen, en daarom zijn de samples hier een derde zo groot als de bovenste rijen.
Voor een ontwikkelaar is de vorm hiervan bekend: het sterkste downloadbare beeldmodel in het veld is niet degene die je vandaag kunt aanroepen. Praktisch gezien splitst dat het werk. Je host Qwen-Image-2.1 zelf op je eigen hardware, of je roept een van de modellen eromheen aan op dit board. De tweede optie is waar routing zich terugverdient — één API over 200+ modellen, met de lijstprijs van de provider doorgegeven zonder markup, automatische failover wanneer een provider degradeert, en een routing-DSL voor het samenstellen van meerdere modellen in één call. OrcaRouter serveert Qwen-Image-2.1 vandaag niet; de beeldlijnen op het platform zijn Google's Imagen-tiers en Gemini image previews, xAI's Grok Imagine image endpoint en OpenAI's GPT-Image-familie. Op dit board is dat de GPT Image 2.5 Sunburst-rij helemaal bovenaan, en het is een legitiem antwoord op "Ik wil de beste score en ik wil dat het vanmiddag aanroepbaar is."

Wat te volgen op het bord
Drie dingen zullen dit verhaal in beweging brengen, en alle drie zijn ze al zichtbaar op de borden.
The first is whether an API appears. If Alibaba or a serving partner puts Qwen-Image-2.1 behind an endpoint, the No API available note disappears, vote volume should climb toward the size of the neighbouring rows, and the confidence interval tightens. A tighter interval on a 1,034 or a 1,074 is a much stronger claim than the current one.
The second is Alibaba's own stack. Qwen-Image-3.0-Pro at 1,089 and Qwen-Image-3.0 at 1,075 both outrank Qwen-Image-2.1 on text-to-image while carrying no Open Weights marker. If Qwen-Image-2.1 is meant to be the downloadable counterpart to that line rather than its successor, the interesting question is whether the gap narrows — and on the editing board it already has, where Qwen-Image-3.0-Pro leads Qwen-Image-2.1 by two Elo points.
De derde is de licentie. Elke Open Weights-rij op beide borden komt evenzeer in aanmerking voor het label, en de licenties erachter zijn bij lange na niet gelijkwaardig. Het bord zal je dat nooit vertellen. Het is de enige kolom die het scorebord niet heeft.

Veelgestelde vragen
Is Qwen-Image-2.1 het beste open-weights beeldmodel?
Op deze twee ranglijsten, ja — het is de rij met de hoogste Elo die op beide de Open Weights-markering draagt, met 1.034 voor tekst-naar-afbeelding en 1.074 voor bewerken. Al met al staat hij op elk daarvan op de 18e plaats — en die 18 is een rang binnen 166 rijen op de ene ranglijst en binnen 97 op de andere, en staat voor twee Elo-schalen die niet met elkaar te vergelijken zijn. De bewering houdt alleen stand als beide kwalificaties eraan verbonden blijven.
Waarom tonen de twee boards verschillende Elo-waarden voor hetzelfde model?
Ze beoordelen verschillende taken ten opzichte van verschillende modelpopulaties. Een Elo voor tekst-naar-afbeelding en een Elo voor het bewerken van afbeeldingen zijn twee afzonderlijke schalen; het vergelijken van 1.034 met 1.074 meet de ranglijsten, niet het model.
Kan ik Qwen-Image-2.1 via een API aanroepen?
Both board rows record No API available. The weights are downloadable from Alibaba's repositories, so the model runs — it just does not have a hosted endpoint that the board has credited with serving it.
Als je vandaag een getal wilt in plaats van een download, is de top van beide ranglijsten aanroepbaar via de eigen API's van de leveranciers, en de GPT-Image-reeks, de Imagen-tiers van Google en Grok Imagine van xAI zijn de beeldmodellen die OrcaRouter rechtstreeks ontsluit. Bewaar het gewichtsbestand voor het experiment en het endpoint voor de deadline.
