Rubrik på Qwens leverantörsblogginlägg som tillkännager Qwen-Image-2.1, med titeln 'Qwen-Image-2.1: Kompakt, effektivt och enhetligt bildskapande' ovanför orden 'Nu öppna vikter' och Qwen-märket, med sidans språkväxlare inställd på EN
Guides & Insights

Qwen-Image-2.1 är den främsta bildmodellen med öppna vikter på båda Artificial Analysis-tavlorna

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Aliba​ba's Qwe​n team released Qwen-Image-2.1 with open weights on 20 September 2026. Twelve days later, the independent scoreboards have caught up with it, and the result is more interesting than the launch. On the AA-Image-T2I v2.0 leaderboard, Qwen-Image-2.1 sits at rank 18 of 166 with an Elo of 1,034, from 5,286 blind comparisons. On AA-Image-Editing v2.0 it sits at rank 18 of 97 with an Elo of 1,074, from 5,536. Both of those rows are marked Open Weights on a board that marks every model individually. No other model carrying that marker on either board is placed above them. That is the whole finding: on the only two public image boards that score models by blind pairwise comparison, the released Qwen-Image-2.1 is the strongest set of downloadable weights in the field, and it is Qwen-Image-2.1 specifically, not a preview of it, that holds both positions.

Det som följer är var de två siffrorna kommer ifrån, hur raderna runt dem ser ut, och de tre detaljerna på tavlan som de flesta lanseringsbevakningar utelämnade – med början i att tavlan inte registrerar något API någonstans för modellen.

Var de två raderna sitter

Artificial Analysis bygger båda tabellerna utifrån blinda parvisa jämförelser: två modeller svarar på samma prompt, en röstare väljer det bättre svaret, och ett Elo-värde uppstår ur aggregeringen. De två tabellerna delar en husstil och inget annat. De bedömer olika uppgifter, de har olika populationer, och deras Elo-värden är inte jämförbara med varandra. Qwen-Image-2.1 råkar hamna på samma placering i båda, vilket är en tillfällighet till följd av två olika fördelningar.

Text-till-bild, 166 modeller på tavlan:

• Topplistans översta rad är GPT Image 2.5 Sunburst (max) med 1 107 Elo från 14 023 förekomster — en proprietär modell med ett urval som är mer än dubbelt så stort som Qwen-Image-2.1:s.

• Qwen-Image-2.1 ligger på plats 18 med 1 034 Elo och ett 95-procentigt konfidensintervall på 1 024 till 1 044, baserat på 5 286 framträdanden.

• Läs radantalen före placeringarna. Qwen-Image-2.1 ligger på plats 18 på båda listorna, men dessa placeringar kommer från olika populationer – 166 modeller för text-till-bild, 97 för redigering – och de två Elo-värdena tillhör två separata skalor. Den identiska placeringen är aritmetik, inte ett bevis för att de två listorna är överens om något.

• Aliba​ba's own two Pro-tier models are above it on this board: Qwen-Image-3.0-Pro at 1,089 Elo, rank 14, and Qwen-Image-3.0 at 1,075, rank 16. Neither carries the Open Weights marker. The board's September snapshot lists both as July 2026 releases, which is the version of the story where the newest Qwe​n image model is not the highest-scoring one — and on text-to-image it is not.

Bildredigering, 97 modeller på tavlan:

• GPT Image 2.5 Sunburst (max) toppar även denna lista, med 1 182 Elo från 17 899 framträdanden.

• Qwen-Image-2.1 ligger på plats 18 med 1 074 Elo, intervall 1 065 till 1 083, från 5 536 framträdanden – ett något större urval än dess rad för text-till-bild, vilket är logiskt för en modell vars redigeringssida fick den mer högljudda lanseringstexten.

• Raderna runt den är tätt packade. grok-imagine-image ligger en placering under på 1 071 och Luma UNI 1 Max på 1 069. Den närmaste raden med öppna vikter under den på den här listan är HunyuanImage 3.0 Instruct på 1 066 med 5 221 framträdanden — 8 Elo efter. Sju rader ligger inom arton Elo-poäng.

Att läsa påståendet om ”främsta modellen med öppna vikter” ärligt

Frasen i rubriken utför ett specifikt arbete, och den förtjänar att granskas snarare än att upprepas.

• Det är en placering bland dem med en markör, inte en övergripande placering. Qwen-Image-2.1 ligger totalt på 18:e plats på båda listorna. Etiketten Open Weights är det som gör att den ligger först på respektive lista, och etiketten tillämpas per modell på listans eget bemyndigande — 47 text-till-bild-rader bär markören; 36 rader bär den på redigeringslistan, som listar 97.

• The marker describes weights, not terms. Qwen-Image-2.1 ships under the Qwe​n Research License Agreement dated 20 September 2026, which grants rights for non-commercial purposes only. The board's Open Weights label is accurate about downloadability and silent about what you may do with the download. Anyone reading "top open-weights image model" as "free to use in a product" has read the label past its meaning.

• Det är en ögonblicksbild, inte en fastställd rankning. Tavlan förändras dagligen i takt med att röster tillkommer. Qwen-Image-2.1:s konfidensintervall är ±10 Elo för text-till-bild och ±9 för redigering; raderna under den ligger på överlappande intervall. Betrakta placeringen som aktuell snarare än permanent.

Den detalj som lanseringsbevakningen saknade: inget API

Båda raderna för Qwen-Image-2.1 har en explicit "Inget API tillgängligt"-notering. Det är en reell kostnad för rankningen, och det säger dig något om vilka som genererade de 5 286 och 5 536 rösterna — om det inte finns någon slutpunkt att rikta en prompt mot, kom jämförelserna från personer som körde vikterna själva och skickade in utdata. Oberoende Elo för en modell som bara kan självhostas är en genuint svårare mätning än Elo för något som vem som helst kan anropa, och det är därför urvalet här är en tredjedel så stort som de översta raderna.

För en utvecklare är formen på detta bekant: den starkaste nedladdningsbara bildmodellen inom området är inte den du kan anropa i dag. I praktiken delar det upp arbetet. Antingen serverar du Qwen-Image-2.1 själv på din egen hårdvara, eller så anropar du en av modellerna runt omkring den på den här tavlan. Det andra alternativet är där routning lönar sig — ett enda API över 200+ modeller med leverantörernas listpris vidarebefordrat utan påslag, automatisk redundansväxling när en leverantör försämras, och ett routnings-DSL för att komponera flera modeller till ett enda anrop. OrcaRouter serverar inte Qwen-Image-2.1 i dag; bildlinjerna på plattformen är Googles Imagen-nivåer och Geminis bildförhandsvisningar, xAI:s Grok Imagine-bildendpoint och OpenAIs GPT-Image-familj. På den här tavlan är det raden GPT Image 2.5 Sunburst allra högst upp, och det är ett legitimt svar på "jag vill ha bästa poäng och jag vill kunna anropa den i eftermiddag."

Screenshot of the Artificial Analysis text-to-image leaderboard, AA-Image-T2I v2.0, captured in English, listing GPT Image 2.5 Sunburst (max) first at 1,107 Elo from 14,023 samples, the Qwen-Image-3.0-Pro row at rank 14 with 1,089 Elo and 6,353 samples, and the Qwen-Image-2.1 row at rank 18 with 1,034 Elo from 5,286 samples

Vad man ska titta efter på tavlan

Tre saker kommer att driva den här historien framåt, och alla tre syns redan på tavlorna.

The first is whether an API appears. If Aliba​ba or a serving partner puts Qwen-Image-2.1 behind an endpoint, the No API available note disappears, vote volume should climb toward the size of the neighbouring rows, and the confidence interval tightens. A tighter interval on a 1,034 or a 1,074 is a much stronger claim than the current one.

The second is Aliba​ba's own stack. Qwen-Image-3.0-Pro at 1,089 and Qwen-Image-3.0 at 1,075 both outrank Qwen-Image-2.1 on text-to-image while carrying no Open Weights marker. If Qwen-Image-2.1 is meant to be the downloadable counterpart to that line rather than its successor, the interesting question is whether the gap narrows — and on the editing board it already has, where Qwen-Image-3.0-Pro leads Qwen-Image-2.1 by two Elo points.

Den tredje är licensen. Varje Open Weights-rad på båda tavlorna är lika berättigad till etiketten, och licenserna bakom dem är inte på långt när likvärdiga. Tavlan kommer aldrig att tala om det för dig. Det är den enda kolumnen som resultattavlan inte har.

Generated summary card for Qwen-Image-2.1 on the Artificial Analysis boards, listing text-to-image rank 18 of 166 at 1,034 Elo from 5,286 votes, editing rank 18 of 97 at 1,074 Elo from 5,536 votes, the note that it is the top Open Weights row on both boards, and the sourcing line that the figures are per Artificial Analysis

Vanliga frågor

Är Qwen-Image-2.1 den bästa bildmodellen med öppna vikter?

På dessa två resultattavlor, ja – det är raden med högst Elo som bär Open Weights-markören på båda, med 1 034 för text-till-bild och 1 074 för redigering. Sammantaget rankas den som nummer 18 på var och en – och 18:an är en placering inom 166 rader på den ena tavlan och inom 97 på den andra, och står för två Elo-skalor som inte kan jämföras med varandra. Påståendet håller bara om båda bestämningarna förblir kopplade.

Varför visar de två topplistorna olika Elo-värden för samma modell?

De poängsätter olika uppgifter mot olika modellpopulationer. Ett Elo för text-till-bild och ett för redigering är två separata skalor; att jämföra 1 034 med 1 074 mäter tavlorna, inte modellen.

Kan jag anropa Qwen-Image-2.1 via ett API?

Båda raderna på resultattavlan anger Inget API tillgängligt. Vikterna går att ladda ner från Alibabas repositorier, så modellen körs – den har bara ingen hostad slutpunkt som resultattavlan har tillskrivit att betjäna den.

Om du vill ha en siffra idag i stället för en nedladdning kan toppen av båda resultattavlorna anropas via leverantörernas egna API:er, och GPT-Image-serien, Googles Imagen-nivåer och xAI:s Grok Imagine är de bildmodeller som OrcaRouter frontar direkt. Behåll viktfilen för experimentet och slutpunkten för deadlinen.