
Qwen-Image-2.1 är den främsta bildmodellen med öppna vikter på båda Artificial Analysis-tavlorna
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 223 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Alibaba's Qwen team released Qwen-Image-2.1 with open weights on 20 September 2026. Twelve days later, the independent scoreboards have caught up with it, and the result is more interesting than the launch. On the AA-Image-T2I v2.0 leaderboard, Qwen-Image-2.1 sits at rank 18 of 166 with an Elo of 1,034, from 5,286 blind comparisons. On AA-Image-Editing v2.0 it sits at rank 18 of 97 with an Elo of 1,074, from 5,536. Both of those rows are marked Open Weights on a board that marks every model individually. No other model carrying that marker on either board is placed above them. That is the whole finding: on the only two public image boards that score models by blind pairwise comparison, the released Qwen-Image-2.1 is the strongest set of downloadable weights in the field, and it is Qwen-Image-2.1 specifically, not a preview of it, that holds both positions.
Det som följer är var de två siffrorna kommer ifrån, hur raderna runt dem ser ut, och de tre detaljerna på tavlan som de flesta lanseringsbevakningar utelämnade – med början i att tavlan inte registrerar något API någonstans för modellen.
Var de två raderna sitter
Artificial Analysis bygger båda tabellerna utifrån blinda parvisa jämförelser: två modeller svarar på samma prompt, en röstare väljer det bättre svaret, och ett Elo-värde uppstår ur aggregeringen. De två tabellerna delar en husstil och inget annat. De bedömer olika uppgifter, de har olika populationer, och deras Elo-värden är inte jämförbara med varandra. Qwen-Image-2.1 råkar hamna på samma placering i båda, vilket är en tillfällighet till följd av två olika fördelningar.
Text-till-bild, 166 modeller på tavlan:
• Topplistans översta rad är GPT Image 2.5 Sunburst (max) med 1 107 Elo från 14 023 förekomster — en proprietär modell med ett urval som är mer än dubbelt så stort som Qwen-Image-2.1:s.
• Qwen-Image-2.1 ligger på plats 18 med 1 034 Elo och ett 95-procentigt konfidensintervall på 1 024 till 1 044, baserat på 5 286 framträdanden.
• Läs radantalen före placeringarna. Qwen-Image-2.1 ligger på plats 18 på båda listorna, men dessa placeringar kommer från olika populationer – 166 modeller för text-till-bild, 97 för redigering – och de två Elo-värdena tillhör två separata skalor. Den identiska placeringen är aritmetik, inte ett bevis för att de två listorna är överens om något.
• Alibaba's own two Pro-tier models are above it on this board: Qwen-Image-3.0-Pro at 1,089 Elo, rank 14, and Qwen-Image-3.0 at 1,075, rank 16. Neither carries the Open Weights marker. The board's September snapshot lists both as July 2026 releases, which is the version of the story where the newest Qwen image model is not the highest-scoring one — and on text-to-image it is not.
Bildredigering, 97 modeller på tavlan:
• GPT Image 2.5 Sunburst (max) toppar även denna lista, med 1 182 Elo från 17 899 framträdanden.
• Qwen-Image-2.1 ligger på plats 18 med 1 074 Elo, intervall 1 065 till 1 083, från 5 536 framträdanden – ett något större urval än dess rad för text-till-bild, vilket är logiskt för en modell vars redigeringssida fick den mer högljudda lanseringstexten.
• Raderna runt den är tätt packade. grok-imagine-image ligger en placering under på 1 071 och Luma UNI 1 Max på 1 069. Den närmaste raden med öppna vikter under den på den här listan är HunyuanImage 3.0 Instruct på 1 066 med 5 221 framträdanden — 8 Elo efter. Sju rader ligger inom arton Elo-poäng.
Att läsa påståendet om ”främsta modellen med öppna vikter” ärligt
Frasen i rubriken utför ett specifikt arbete, och den förtjänar att granskas snarare än att upprepas.
• Det är en placering bland dem med en markör, inte en övergripande placering. Qwen-Image-2.1 ligger totalt på 18:e plats på båda listorna. Etiketten Open Weights är det som gör att den ligger först på respektive lista, och etiketten tillämpas per modell på listans eget bemyndigande — 47 text-till-bild-rader bär markören; 36 rader bär den på redigeringslistan, som listar 97.
• The marker describes weights, not terms. Qwen-Image-2.1 ships under the Qwen Research License Agreement dated 20 September 2026, which grants rights for non-commercial purposes only. The board's Open Weights label is accurate about downloadability and silent about what you may do with the download. Anyone reading "top open-weights image model" as "free to use in a product" has read the label past its meaning.
• Det är en ögonblicksbild, inte en fastställd rankning. Tavlan förändras dagligen i takt med att röster tillkommer. Qwen-Image-2.1:s konfidensintervall är ±10 Elo för text-till-bild och ±9 för redigering; raderna under den ligger på överlappande intervall. Betrakta placeringen som aktuell snarare än permanent.
Den detalj som lanseringsbevakningen saknade: inget API
Båda raderna för Qwen-Image-2.1 har en explicit "Inget API tillgängligt"-notering. Det är en reell kostnad för rankningen, och det säger dig något om vilka som genererade de 5 286 och 5 536 rösterna — om det inte finns någon slutpunkt att rikta en prompt mot, kom jämförelserna från personer som körde vikterna själva och skickade in utdata. Oberoende Elo för en modell som bara kan självhostas är en genuint svårare mätning än Elo för något som vem som helst kan anropa, och det är därför urvalet här är en tredjedel så stort som de översta raderna.
För en utvecklare är formen på detta bekant: den starkaste nedladdningsbara bildmodellen inom området är inte den du kan anropa i dag. I praktiken delar det upp arbetet. Antingen serverar du Qwen-Image-2.1 själv på din egen hårdvara, eller så anropar du en av modellerna runt omkring den på den här tavlan. Det andra alternativet är där routning lönar sig — ett enda API över 200+ modeller med leverantörernas listpris vidarebefordrat utan påslag, automatisk redundansväxling när en leverantör försämras, och ett routnings-DSL för att komponera flera modeller till ett enda anrop. OrcaRouter serverar inte Qwen-Image-2.1 i dag; bildlinjerna på plattformen är Googles Imagen-nivåer och Geminis bildförhandsvisningar, xAI:s Grok Imagine-bildendpoint och OpenAIs GPT-Image-familj. På den här tavlan är det raden GPT Image 2.5 Sunburst allra högst upp, och det är ett legitimt svar på "jag vill ha bästa poäng och jag vill kunna anropa den i eftermiddag."

Vad man ska titta efter på tavlan
Tre saker kommer att driva den här historien framåt, och alla tre syns redan på tavlorna.
The first is whether an API appears. If Alibaba or a serving partner puts Qwen-Image-2.1 behind an endpoint, the No API available note disappears, vote volume should climb toward the size of the neighbouring rows, and the confidence interval tightens. A tighter interval on a 1,034 or a 1,074 is a much stronger claim than the current one.
The second is Alibaba's own stack. Qwen-Image-3.0-Pro at 1,089 and Qwen-Image-3.0 at 1,075 both outrank Qwen-Image-2.1 on text-to-image while carrying no Open Weights marker. If Qwen-Image-2.1 is meant to be the downloadable counterpart to that line rather than its successor, the interesting question is whether the gap narrows — and on the editing board it already has, where Qwen-Image-3.0-Pro leads Qwen-Image-2.1 by two Elo points.
Den tredje är licensen. Varje Open Weights-rad på båda tavlorna är lika berättigad till etiketten, och licenserna bakom dem är inte på långt när likvärdiga. Tavlan kommer aldrig att tala om det för dig. Det är den enda kolumnen som resultattavlan inte har.

Vanliga frågor
Är Qwen-Image-2.1 den bästa bildmodellen med öppna vikter?
På dessa två resultattavlor, ja – det är raden med högst Elo som bär Open Weights-markören på båda, med 1 034 för text-till-bild och 1 074 för redigering. Sammantaget rankas den som nummer 18 på var och en – och 18:an är en placering inom 166 rader på den ena tavlan och inom 97 på den andra, och står för två Elo-skalor som inte kan jämföras med varandra. Påståendet håller bara om båda bestämningarna förblir kopplade.
Varför visar de två topplistorna olika Elo-värden för samma modell?
De poängsätter olika uppgifter mot olika modellpopulationer. Ett Elo för text-till-bild och ett för redigering är två separata skalor; att jämföra 1 034 med 1 074 mäter tavlorna, inte modellen.
Kan jag anropa Qwen-Image-2.1 via ett API?
Båda raderna på resultattavlan anger Inget API tillgängligt. Vikterna går att ladda ner från Alibabas repositorier, så modellen körs – den har bara ingen hostad slutpunkt som resultattavlan har tillskrivit att betjäna den.
Om du vill ha en siffra idag i stället för en nedladdning kan toppen av båda resultattavlorna anropas via leverantörernas egna API:er, och GPT-Image-serien, Googles Imagen-nivåer och xAI:s Grok Imagine är de bildmodeller som OrcaRouter frontar direkt. Behåll viktfilen för experimentet och slutpunkten för deadlinen.
