
Qwen-Image 2.1 vs FLUX 3: Dos modelos de imagen que no puedes usar del todo
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen-Image 2.1 y FLUX 3 son los dos lanzamientos de modelos de imagen más interesantes de la segunda mitad de 2026, y ninguno de los dos es directamente utilizable. Qwen-Image 2.1, que el equipo de Qwen-Image publicó como código abierto el 20 de septiembre de 2026, es un modelo unificado de generación y edición de 7B de parámetros que puedes descargar esta misma tarde y que no puedes incluir legalmente en un producto comercial. FLUX 3, que Black Forest Labs anunció el 23 de julio de 2026, es un modelo fundacional multimodal unificado cuyo nivel de imagen —la parte que en realidad compararías— sigue sin endpoint público, sin ID de modelo, sin precio y sin benchmarks dos meses después del anuncio. Por lo tanto, la comparación no es «cuál de los dos es mejor», sino cuál de los dos bloqueadores puedes sortear.
Dos tipos diferentes de no disponible
Es tentador archivar ambos bajo «aún no está listo» y pasar página. Eso ocultaría la única decisión que importa, porque los dos bloqueos tienen formas opuestas.
El obstáculo de Qwen-Image 2.1 es legal, y es una línea en un archivo que puedes leer antes de descargar nada. Los pesos están en Hugging Face y ModelScope, la ficha del modelo está redactada, el código de inferencia está publicado, y cuatro frameworks de servicio distintos ya tenían soporte integrado antes o el mismo día del lanzamiento. Nada técnico se interpone entre tú y un modelo en funcionamiento. Lo que se interpone entre tú y lanzarlo es el Acuerdo de Licencia de Investigación de Qwen, con fecha del 20 de septiembre de 2026, cuya cláusula de concesión de derechos permite el uso «SOLO PARA FINES NO COMERCIALES» y dirige a cualquiera que quiera derechos comerciales a solicitar una licencia por separado al proveedor.
El obstáculo de FLUX 3 es físico. No hay ningún endpoint de imagen al que llamar, ningún identificador de modelo que pasar y ninguna tarifa con la que presupuestar. La propia página de precios de BFL abarca los niveles de FLUX 3 Video y la antigua línea de imágenes FLUX.2; no abarca ningún nivel de imágenes de FLUX 3, porque no hay nada que tarificar. El acceso al modelo de imagen es solo por solicitud, en lugar de un botón para empezar: la propia página de FLUX 3 de BFL incluye el nivel de imagen como «próximamente», y es el nivel de acción el que lleva la etiqueta de acceso anticipado.
Así que uno de estos es un modelo que puedes ejecutar esta noche y no puedes vender, y el otro es un modelo que podrías vender y no puedes ejecutar. Cuál te resulta más útil depende por completo de en qué lado de esa frase estás parado — un equipo de investigación interno y un equipo de producto comercial deberían llegar a conclusiones opuestas a partir de los mismos dos hechos.
La lectura dimensión por dimensión
• Estado — pesos, licencia y ficha de modelo de Qwen-Image 2.1 publicados el 20 de septiembre de 2026, junto con una entrada de blog del proveedor ese mismo día. FLUX 3 se anunció el 23 de julio de 2026; solo se ha lanzado el nivel de vídeo, que alcanzó la disponibilidad general el 4 de agosto de 2026.
• Lo que realmente puedes llamar hoy — Qwen-Image 2.1 se ejecuta localmente a través de Diffusers, ComfyUI, vLLM-Omni, SGLang y LightX2V, o a través de la propia API del proveedor y varias plataformas de terceros. FLUX 3 enumera su nivel de imagen como "próximamente" sin endpoint al que llamar, y ofrece un endpoint de vídeo con precio y de disponibilidad general.
• Arquitectura — Qwen-Image 2.1 es un DiT single-stream de 32 capas con 7B parámetros en el componente de generación visual, un codificador de texto Qwen3-VL 8B y un VAE RGBA de 64 canales con compresión espacial de 16×. FLUX 3 es un único modelo de flujo unificado entrenado conjuntamente en imagen, vídeo y audio, construido sobre un método de flow-matching autosupervisado que BFL llama Self-Flow, con un nivel de predicción de acciones desarrollado junto a Mimic Robotics.
• Transparencia nativa — Qwen-Image 2.1 genera y edita imágenes RGBA, edita texto dentro de capas transparentes y extrae sujetos de fotografías RGB a capas transparentes, incorporando la capacidad que Alibaba lanzó por separado como Qwen-Image-Layered en diciembre de 2025. BFL no ha publicado ninguna afirmación de transparencia para FLUX 3 Image.
• Imágenes de referencia — Qwen-Image 2.1 acepta hasta 10 referencias de entrada, con edición local mediante círculo, anotación pintada o una máscara aparte. No existe ninguna cifra publicada para FLUX 3 Image.
• Resolución — Qwen-Image 2.1 tiene resolución nativa 2K, con 2048×2048 por defecto a 40 pasos de inferencia y siete preajustes de relación de aspecto documentados. Las resoluciones de FLUX 3 Image se describen en el anuncio solo como "amplias", sin que se haya publicado nada.
• Precio — no hay precio publicado para ninguno de los dos. Qwen-Image 2.1 no tiene tarifa alojada listada en el momento de escribir esto; FLUX 3 Image no tiene ficha de precios porque no tiene endpoint. El único precio de FLUX 3 que existe es el de vídeo: $0.06 por segundo en borrador, $0.17 por segundo en HD y $0.29 por segundo en FHD.
• Licencia — Acuerdo de Licencia de Investigación de Qwen, únicamente para uso no comercial; el uso comercial requiere una solicitud por separado. Los términos de licencia de FLUX 3 para el nivel de imágenes no se han publicado en absoluto.
Una asimetría merece una línea propia, porque es la trampa de este enfrentamiento. FLUX 3 sí tiene cifras de benchmark publicadas: un Elo interno de 1.135 para texto a vídeo y tasas de victoria por preferencia humana reportadas frente a Grok Imagine Video, Seedance 2.0, Gemini Omni Flash, Runway Gen-4.5 y Luma Ray 3.2. Todas esas cifras describen el nivel de vídeo. Ninguna de ellas se traslada a la generación de imágenes, y BFL no ha publicado ningún benchmark ni tasa de victoria para imágenes. Citar un Elo de vídeo de FLUX 3 como evidencia sobre la calidad de imagen de FLUX 3 es el error más fácil de cometer en esta comparación.

Lo que cada lado puede mostrar en realidad
Ponga la evidencia lado a lado y la asimetría se invierte respecto a la sección anterior.
FLUX 3 tiene un producto ya lanzado, con precio y disponible de forma general — solo que no es el que aparece en el título de este artículo. FLUX 3 Video genera clips de hasta 20 segundos con audio sincronizado en una sola pasada, admite texto a vídeo, imagen a vídeo, vídeo a vídeo, fotograma clave a vídeo y continuación generativa, y ya está siendo probado por Canva, Burda, Magnific, Krea y Picsart. Eso es un sistema real, desplegado, con una lista real de clientes. El nivel de imagen es la parte que no ha llegado, y la orientación original de BFL de que llegaría "en las próximas semanas" ya ha superado dos meses completos sin un endpoint público.
Qwen-Image 2.1 tiene el perfil opuesto. Sus afirmaciones de calidad provienen de la propia tabla comparativa Qwen-Image-Bench del proveedor, y ningún tercero las ha reproducido. Pero el objeto en sí está en tus manos: 33 GB de pesos, una estructura de repositorio al estilo Apache con un archivo de licencia que es honesto al indicar que es solo para investigación, y una ruta de servicio desde el día cero en cinco frameworks. También hay una reseña práctica de acceso anticipado, de un probador que ejecutó los pesos finales a través de una interfaz de ModelScope Studio y reportó aproximadamente 10–15 segundos para texto a imagen y 18–23 segundos para edición, un buen comportamiento con preajustes de cámara y asignación de roles para varios personajes, y una consistencia multirreferencia que empieza a degradarse a partir de unas tres imágenes de entrada. Un solo revisor, sin cronómetro, sin conjunto de prompts publicado. Útil como orientación, formalmente no verificado.
El resumen honesto de la evidencia: Qwen-Image 2.1 tiene un modelo ejecutable y ningún dato independiente de calidad; FLUX 3 Image tiene afirmaciones del proveedor y ni un modelo ejecutable ni ningún dato de imagen en absoluto. Si tu pregunta es «¿en torno a cuál de estos debería planificar un pipeline?», la respuesta hoy es ninguno de los dos, y el motivo es distinto.

Dónde está realmente la solución provisional
Para un equipo comercial, el bloqueo de Qwen-Image 2.1 tiene una forma con la que se puede planificar. La licencia es explícita, el contacto para la licencia comercial figura en el repositorio, y el modelo es lo bastante pequeño —7B en el componente de generación— como para que el coste de evaluarlo en su propio hardware se mida en una tarde, no en un trimestre. Evalúe primero, negocie después y, mientras tanto, mantenga la versión de investigación fuera de cualquier ruta orientada al cliente. Eso es un problema de compras normal.
El bloqueo de FLUX 3 Image no es un problema de adquisición, porque no hay nada que adquirir. Puedes unirte a una cola de acceso anticipado y puedes estar atento a que aparezca el endpoint, y esa es toda la acción disponible. Si hoy necesitas generación de imágenes de la familia FLUX en producción, las opciones invocables son las líneas anteriores FLUX.2 y FLUX Pro/Dev, que tienen precio y están disponibles, y que son una generación de modelo distinta de la que trata este artículo.
Para un equipo que quiere probar ambos candidatos sin comprometer a ninguno con una ruta de producción, este es el caso para el que existe la capa de enrutamiento. OrcaRouter coloca más de 200 modelos detrás de un único endpoint compatible con OpenAI al precio de lista del proveedor y sin ningún margen añadido, con conmutación por error automática entre proveedores, de modo que un modelo no probado o no publicado se sitúa detrás de una ruta junto a algo en lo que ya confías en lugar de sustituirlo — y, como el precio de lista se repercute tal cual, cualquier cambio de precio del proveedor en un modelo enrutado está activo el mismo día. Ni Qwen-Image 2.1 ni FLUX 3 Image son enrutables en el momento de escribir esto, y no vamos a fingir lo contrario; lo que sí enrutamos es la línea de imagen que los rodea, incluida la familia GPT-Image de OpenAI, los niveles de Imagen 4 de Google y las vistas previas de imagen de Gemini, y el endpoint de imagen Grok Imagine de xAI. Esos son los modelos que pueden soportar una carga de trabajo mientras estos dos se aclaran.
Una cosa más que vale la pena seguir, específicamente en el lado de Qwen. Alibaba lanzó Qwen-Image 1.0 y 2.0 como pesos abiertos bajo Apache-2.0, luego lanzó Qwen-Image 3.0 en julio de 2026 como un modelo alojado totalmente cerrado, sin pesos, sin licencia y sin informe técnico, y después lanzó Qwen-Image 2.1 en septiembre como pesos abiertos bajo una licencia solo para investigación. La dirección del recorrido no es una línea recta, y los términos de la licencia de la próxima versión son una verdadera incógnita en lugar de una suposición segura en cualquier dirección.

El veredicto, tal como es
Si eres investigador o un equipo de evaluación interno, Qwen-Image 2.1 es el más útil de los dos en este momento, por un amplio margen: es descargable, está documentado, cuenta con soporte de frameworks y es honesto sobre sus términos. Si eres un equipo comercial, ambos están bloqueados y los bloqueos no son equivalentes: uno es un contrato sobre el que puedes iniciar una conversación, el otro es un producto que aún no existe.
Si necesitas lanzar la generación de imágenes este mes, ninguno de estos dos es la respuesta, y la pregunta útil es cuál de los modelos que puedes llamar te acerca más. Eso es un ejercicio de benchmarking, y vale la pena hacerlo con tus propios prompts en lugar de con el gráfico de lanzamiento de cualquiera — incluido el del proveedor, e incluido este.
