
Qwen-Image-2.1 è il miglior modello di immagini open-weights su entrambe le classifiche di Artificial Analysis
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 223 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Alibaba's Qwen team released Qwen-Image-2.1 with open weights on 20 September 2026. Twelve days later, the independent scoreboards have caught up with it, and the result is more interesting than the launch. On the AA-Image-T2I v2.0 leaderboard, Qwen-Image-2.1 sits at rank 18 of 166 with an Elo of 1,034, from 5,286 blind comparisons. On AA-Image-Editing v2.0 it sits at rank 18 of 97 with an Elo of 1,074, from 5,536. Both of those rows are marked Open Weights on a board that marks every model individually. No other model carrying that marker on either board is placed above them. That is the whole finding: on the only two public image boards that score models by blind pairwise comparison, the released Qwen-Image-2.1 is the strongest set of downloadable weights in the field, and it is Qwen-Image-2.1 specifically, not a preview of it, that holds both positions.
Quello che segue è da dove provengono quei due numeri, che aspetto hanno le righe attorno a essi e i tre dettagli sul tabellone che gran parte della copertura del lancio ha omesso — a cominciare dal fatto che il tabellone non registra alcuna API da nessuna parte per il modello.
Dove si trovano le due righe
Artificial Analysis costruisce entrambe le classifiche tramite confronti a coppie in cieco: due modelli rispondono allo stesso prompt, un votante sceglie l'output migliore e dall'aggregato emerge un punteggio Elo. Le due classifiche condividono solo uno stile di casa e nient'altro. Valutano task diversi, hanno popolazioni diverse e i loro valori Elo non sono comparabili tra loro. Qwen-Image-2.1 si trova per caso sullo stesso rango in entrambe, il che è una coincidenza di due distribuzioni diverse.
Da testo a immagine, 166 modelli in classifica:
La riga in cima alla classifica è GPT Image 2.5 Sunburst (max) con 1.107 Elo da 14.023 apparizioni — un modello proprietario con più del doppio del campione di Qwen-Image-2.1.
• Qwen-Image-2.1 si trova al 18° posto con 1.034 Elo e un intervallo di confidenza del 95% da 1.024 a 1.044, su 5.286 apparizioni.
• Leggi il numero di righe prima dei ranghi. Qwen-Image-2.1 si colloca al 18º posto in entrambe le classifiche, ma quei ranghi provengono da popolazioni diverse — 166 modelli su text-to-image, 97 su editing — e i due valori Elo appartengono a due scale separate. Il rango identico è pura aritmetica, non una prova che le due classifiche concordino su qualcosa.
• Alibaba's own two Pro-tier models are above it on this board: Qwen-Image-3.0-Pro at 1,089 Elo, rank 14, and Qwen-Image-3.0 at 1,075, rank 16. Neither carries the Open Weights marker. The board's September snapshot lists both as July 2026 releases, which is the version of the story where the newest Qwen image model is not the highest-scoring one — and on text-to-image it is not.
Modifica immagini, 97 modelli sul tabellone:
• Anche GPT Image 2.5 Sunburst (max) è in cima a questa classifica, con 1.182 Elo su 17.899 apparizioni.
• Qwen-Image-2.1 si trova al 18° posto con 1.074 Elo, intervallo da 1.065 a 1.083, su 5.536 presenze — un campione leggermente più ampio rispetto alla sua riga text-to-image, il che ha senso per un modello il cui lato editing ha ricevuto una comunicazione di lancio più clamorosa.
• Le righe intorno sono affollate. grok-imagine-image si trova una posizione sotto a 1.071 e Luma UNI 1 Max a 1.069. La riga open-weights più vicina al di sotto di essa in questa classifica è HunyuanImage 3.0 Instruct a 1.066 su 5.221 apparizioni — 8 Elo di distacco. Sette righe si trovano entro diciotto punti Elo.
Leggere con onestà l'affermazione del "miglior modello open-weights"
La frase nel titolo svolge una funzione specifica e merita di essere verificata anziché ripetuta.
• È una posizione tra i contrassegnati, non una posizione complessiva. Qwen-Image-2.1 è 18º in entrambe le classifiche nel complesso. L'etichetta Open Weights è ciò che lo colloca al primo posto in ciascuna, e l'etichetta viene applicata per modello sotto l'autorità della classifica stessa — 47 righe text-to-image portano il contrassegno; 36 righe lo portano nella classifica di editing, che ne elenca 97.
• The marker describes weights, not terms. Qwen-Image-2.1 ships under the Qwen Research License Agreement dated 20 September 2026, which grants rights for non-commercial purposes only. The board's Open Weights label is accurate about downloadability and silent about what you may do with the download. Anyone reading "top open-weights image model" as "free to use in a product" has read the label past its meaning.
• È un'istantanea, non una classifica definitiva. La classifica si muove ogni giorno man mano che i voti si accumulano. Gli intervalli di confidenza di Qwen-Image-2.1 sono di ±10 Elo sul text-to-image e ±9 sull'editing; le righe sottostanti si collocano su intervalli sovrapposti. Considera la posizione come attuale, non permanente.
Il dettaglio che la copertura del lancio non aveva: nessuna API
Entrambe le righe di Qwen-Image-2.1 riportano un'esplicita Nessuna API disponibile nota. Questo è un costo reale per la classifica, e ti dice qualcosa su chi ha generato i 5.286 e 5.536 voti — se non c'è un endpoint a cui indirizzare un prompt, i confronti sono venuti da persone che eseguivano i pesi da sole e inviavano l'output. L'Elo indipendente per un modello solo self-hosted è una misurazione davvero più difficile rispetto all'Elo per qualcosa che chiunque può chiamare, ed è per questo che i campioni qui sono un terzo della dimensione delle righe in cima.
Per uno sviluppatore, la situazione è familiare: il modello di immagini scaricabile più forte del settore non è quello che puoi chiamare oggi. In pratica, questo divide il lavoro. O servi Qwen-Image-2.1 tu stesso sul tuo hardware, oppure chiami uno dei modelli che gli stanno attorno in questa classifica. La seconda opzione è quella in cui il routing si ripaga — una sola API su oltre 200 modelli, con il prezzo di listino del provider passato senza alcun ricarico, failover automatico quando un provider si degrada, e un DSL di routing per comporre più modelli in un'unica chiamata. OrcaRouter non fornisce Qwen-Image-2.1 oggi; le linee di immagini sulla piattaforma sono i livelli Imagen di Google e le anteprime immagine di Gemini, l'endpoint immagini Grok Imagine di xAI e la famiglia GPT-Image di OpenAI. In questa classifica, quella è la riga GPT Image 2.5 Sunburst proprio in cima, ed è una risposta legittima a «Voglio il punteggio migliore e lo voglio chiamabile questo pomeriggio».

Cosa guardare sulla board
Tre cose faranno avanzare questa storia, e tutte e tre sono già visibili sulle bacheche.
The first is whether an API appears. If Alibaba or a serving partner puts Qwen-Image-2.1 behind an endpoint, the No API available note disappears, vote volume should climb toward the size of the neighbouring rows, and the confidence interval tightens. A tighter interval on a 1,034 or a 1,074 is a much stronger claim than the current one.
The second is Alibaba's own stack. Qwen-Image-3.0-Pro at 1,089 and Qwen-Image-3.0 at 1,075 both outrank Qwen-Image-2.1 on text-to-image while carrying no Open Weights marker. If Qwen-Image-2.1 is meant to be the downloadable counterpart to that line rather than its successor, the interesting question is whether the gap narrows — and on the editing board it already has, where Qwen-Image-3.0-Pro leads Qwen-Image-2.1 by two Elo points.
Il terzo è la licenza. Ogni riga di Open Weights su entrambe le classifiche è ugualmente idonea all'etichetta, e le licenze che vi stanno dietro non sono neanche lontanamente equivalenti. La classifica non te lo dirà mai. È l'unica colonna che il tabellone non ha.

Domande frequenti
Qwen-Image-2.1 è il miglior modello di immagini open-weights?
Su queste due classifiche, sì — è la riga con l'Elo più alto che porta il marcatore Open Weights su entrambe, con 1.034 su text-to-image e 1.074 su editing. Nel complesso si classifica 18º su ciascuna — e il 18 è una posizione all'interno di 166 righe su una classifica e di 97 sull'altra, a rappresentare due scale Elo che non possono essere confrontate tra loro. L'affermazione vale solo se entrambi i qualificatori restano associati.
Perché le due classifiche mostrano valori Elo diversi per lo stesso modello?
Valutano compiti diversi rispetto a popolazioni di modelli diverse. Un Elo text-to-image e un Elo di editing sono due scale separate; confrontare 1.034 con 1.074 misura le classifiche, non il modello.
Posso chiamare Qwen-Image-2.1 tramite un'API?
Both board rows record No API available. The weights are downloadable from Alibaba's repositories, so the model runs — it just does not have a hosted endpoint that the board has credited with serving it.
Se oggi vuoi un numero invece di un download, la parte alta di entrambe le classifiche è chiamabile tramite le API proprie dei fornitori, e la linea GPT-Image, i tier di Imagen di Google e Grok Imagine di xAI sono i modelli di immagini che OrcaRouter interfaccia direttamente. Conserva il file dei pesi per l'esperimento e l'endpoint per la scadenza.
