
Qwen-Image-2.1 es el mejor modelo de imagen de pesos abiertos en ambas clasificaciones de Artificial Analysis
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 223 tok/s
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAINUEVOGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Alibaba's Qwen team released Qwen-Image-2.1 with open weights on 20 September 2026. Twelve days later, the independent scoreboards have caught up with it, and the result is more interesting than the launch. On the AA-Image-T2I v2.0 leaderboard, Qwen-Image-2.1 sits at rank 18 of 166 with an Elo of 1,034, from 5,286 blind comparisons. On AA-Image-Editing v2.0 it sits at rank 18 of 97 with an Elo of 1,074, from 5,536. Both of those rows are marked Open Weights on a board that marks every model individually. No other model carrying that marker on either board is placed above them. That is the whole finding: on the only two public image boards that score models by blind pairwise comparison, the released Qwen-Image-2.1 is the strongest set of downloadable weights in the field, and it is Qwen-Image-2.1 specifically, not a preview of it, that holds both positions.
Lo que sigue es de dónde vienen esos dos números, cómo se ven las filas que los rodean, y los tres detalles en el tablero que la mayoría de la cobertura del lanzamiento dejó fuera — empezando por el hecho de que el tablero no registra ninguna API en ninguna parte para el modelo.
Dónde se ubican las dos filas
Artificial Analysis construye ambos rankings a partir de comparaciones por pares a ciegas: dos modelos responden al mismo prompt, un votante elige la mejor salida y del agregado surge un Elo. Los dos rankings comparten un estilo propio y nada más. Evalúan tareas distintas, tienen poblaciones distintas y sus valores de Elo no son comparables entre sí. Qwen-Image-2.1 resulta caer en el mismo puesto en ambos, lo que es una coincidencia de dos distribuciones diferentes.
Texto a imagen, 166 modelos en la tabla:
• La primera fila de la clasificación la ocupa GPT Image 2.5 Sunburst (max) con 1.107 Elo procedentes de 14.023 apariciones — un modelo propietario con más del doble de muestras que Qwen-Image-2.1.
• Qwen-Image-2.1 ocupa el puesto 18 con 1.034 de Elo y un intervalo de confianza del 95 % de 1.024 a 1.044, a partir de 5.286 apariciones.
• Lee el recuento de filas antes que los puestos. Qwen-Image-2.1 ocupa el puesto 18 en ambas tablas, pero esos puestos proceden de poblaciones distintas —166 modelos en texto a imagen, 97 en edición—, y los dos valores de Elo pertenecen a dos escalas separadas. El puesto idéntico es aritmética, no una prueba de que ambas tablas coincidan en algo.
• Alibaba's own two Pro-tier models are above it on this board: Qwen-Image-3.0-Pro at 1,089 Elo, rank 14, and Qwen-Image-3.0 at 1,075, rank 16. Neither carries the Open Weights marker. The board's September snapshot lists both as July 2026 releases, which is the version of the story where the newest Qwen image model is not the highest-scoring one — and on text-to-image it is not.
Edición de imágenes, 97 modelos en la lista:
• GPT Image 2.5 Sunburst (max) también encabeza esta tabla, con 1.182 de Elo en 17.899 apariciones.
• Qwen-Image-2.1 está en el puesto 18 con 1.074 de Elo, intervalo de 1.065 a 1.083, de 5.536 apariciones — una muestra ligeramente más grande que su fila de texto a imagen, lo cual tiene sentido para un modelo cuyo lado de edición recibió el texto de lanzamiento más llamativo.
• Las filas a su alrededor están abarrotadas. grok-imagine-image se sitúa un puesto por debajo, con 1,071, y Luma UNI 1 Max con 1,069. La fila de pesos abiertos más cercana por debajo en esta tabla es HunyuanImage 3.0 Instruct con 1,066 en 5,221 apariciones — 8 Elo de diferencia. Siete filas se encuentran dentro de dieciocho puntos Elo.
Leer con honestidad la afirmación del "mejor modelo de pesos abiertos"
La frase del titular cumple una función específica, y merece que se la verifique en lugar de repetirla.
• Es un puesto entre los que llevan la marca, no un puesto general. Qwen-Image-2.1 ocupa el puesto 18 en ambas tablas a nivel general. La etiqueta de Pesos Abiertos es lo que lo coloca en primer lugar en cada una, y dicha etiqueta se aplica por modelo según el criterio de la propia tabla: 47 filas de texto a imagen llevan la marca; 36 filas la llevan en la tabla de edición, que enumera 97.
• The marker describes weights, not terms. Qwen-Image-2.1 ships under the Qwen Research License Agreement dated 20 September 2026, which grants rights for non-commercial purposes only. The board's Open Weights label is accurate about downloadability and silent about what you may do with the download. Anyone reading "top open-weights image model" as "free to use in a product" has read the label past its meaning.
• Es una instantánea, no una clasificación definitiva. La tabla se mueve a diario a medida que se acumulan los votos. Los intervalos de confianza de Qwen-Image-2.1 son de ±10 Elo en texto a imagen y de ±9 en edición; las filas que quedan por debajo se sitúan en intervalos superpuestos. Considera la posición como algo actual, no permanente.
El detalle que la cobertura del lanzamiento no tuvo: no API
Ambas filas de Qwen-Image-2.1 llevan una nota explícita de No hay API disponible. Eso supone un coste real para la clasificación, y te dice algo sobre quién generó los 5.286 y 5.536 votos: si no hay ningún endpoint al que apuntar un prompt, las comparaciones procedieron de personas que ejecutaban los pesos por su cuenta y enviaban los resultados. El Elo independiente de un modelo exclusivamente autoalojado es una medición genuinamente más difícil que el Elo de algo que cualquiera puede invocar, y es la razón por la que las muestras de aquí son un tercio del tamaño de las de las filas superiores.
Para un desarrollador, la forma de esto resulta familiar: el modelo de imagen descargable más potente del sector no es el que se puede invocar hoy. En la práctica, eso divide el trabajo. O bien sirves Qwen-Image-2.1 tú mismo en tu propio hardware, o bien invocas uno de los modelos que lo rodean en este tablero. La segunda opción es donde el enrutamiento demuestra su valía: una sola API sobre más de 200 modelos con el precio de lista del proveedor trasladado sin margen alguno, conmutación automática por error cuando un proveedor se degrada, y un DSL de enrutamiento para componer varios modelos en una sola llamada. OrcaRouter no sirve Qwen-Image-2.1 hoy; las líneas de imagen de la plataforma son los niveles de Imagen de Google y las vistas previas de imagen de Gemini, el endpoint de imagen Grok Imagine de xAI y la familia GPT-Image de OpenAI. En este tablero, esa es la fila GPT Image 2.5 Sunburst en lo más alto, y es una respuesta legítima a «quiero la mejor puntuación y quiero poder invocarlo esta tarde».

Qué ver en el tablero
Tres cosas harán avanzar esta historia, y las tres ya se ven en los tableros.
The first is whether an API appears. If Alibaba or a serving partner puts Qwen-Image-2.1 behind an endpoint, the No API available note disappears, vote volume should climb toward the size of the neighbouring rows, and the confidence interval tightens. A tighter interval on a 1,034 or a 1,074 is a much stronger claim than the current one.
The second is Alibaba's own stack. Qwen-Image-3.0-Pro at 1,089 and Qwen-Image-3.0 at 1,075 both outrank Qwen-Image-2.1 on text-to-image while carrying no Open Weights marker. If Qwen-Image-2.1 is meant to be the downloadable counterpart to that line rather than its successor, the interesting question is whether the gap narrows — and on the editing board it already has, where Qwen-Image-3.0-Pro leads Qwen-Image-2.1 by two Elo points.
La tercera es la licencia. Todas las filas de Open Weights en ambos tableros son igualmente elegibles para la etiqueta, y las licencias que hay detrás de ellas no son ni de lejos iguales. El tablero nunca te dirá eso. Es la única columna que el marcador no tiene.

Preguntas frecuentes
¿Es Qwen-Image-2.1 el mejor modelo de imágenes de pesos abiertos?
En estas dos tablas, sí: es la fila con el Elo más alto que lleva el marcador Open Weights en ambas, con 1.034 en texto a imagen y 1.074 en edición. En conjunto, ocupa el puesto 18 en cada una, y ese 18 es un puesto dentro de 166 filas en una tabla y dentro de 97 en la otra, en representación de dos escalas Elo que no se pueden comparar entre sí. La afirmación solo se sostiene si ambos calificadores permanecen adjuntos.
¿Por qué los dos tableros muestran valores de Elo diferentes para el mismo modelo?
Puntúan diferentes tareas frente a diferentes poblaciones de modelos. Un Elo de texto a imagen y un Elo de edición son dos escalas distintas; comparar 1.034 con 1.074 mide las tablas, no el modelo.
¿Puedo llamar a Qwen-Image-2.1 a través de una API?
Both board rows record No API available. The weights are downloadable from Alibaba's repositories, so the model runs — it just does not have a hosted endpoint that the board has credited with serving it.
Si quieres una cifra hoy en lugar de una descarga, la cima de ambas tablas se puede invocar a través de las propias API de los proveedores, y la línea GPT-Image, los niveles de Imagen de Google y Grok Imagine de xAI son los modelos de imagen que OrcaRouter expone directamente. Guarda el archivo de pesos para el experimento y el endpoint para la fecha límite.
