Una tarjeta de título principal para «Qwen 4 Max vs GLM-5.3» con el subtítulo «Pesos abiertos, licencias personalizadas y el nivel que realmente se lanza», tres insignias tipo píldora que dicen «$1.26 y $3.96», «solo texto vs. multimodal» y «el 27B es el que hay que seguir», una línea de pie de página que dice «Alibaba anunció el 22 de septiembre de 2026; GLM-5.3 se listó el 18 de agosto de 2026», y el logotipo de OrcaRouter en la esquina inferior derecha.
Engineering & Research

Qwen 4 Max vs GLM-5.3: pesos abiertos, licencias personalizadas y el nivel que realmente se lanza

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Qwen 4 Max se presentó en primicia en la conferencia Yunqi de Hangzhou el 22 de septiembre de 2026 como el modelo insignia de una línea de cuatro modelos que también incluye Qwen 4 Flash, Qwen 4 Plus y un nivel Qwen 4 27B de pesos abiertos. GLM-5.3 de Z.ai figura en nuestro catálogo desde el 18 de agosto de 2026, solo texto, con una ventana de contexto de 1 millón de tokens y un techo de salida de 128.000 tokens, a 1,26 $ por millón de tokens de entrada y 3,96 $ por millón de tokens de salida, frente a las tarifas de lista de 1,40 $ y 4,40 $ que publica Z.ai. Ambos laboratorios proceden de la tradición de los pesos abiertos y ahora ambos venden modelos de gama fronteriza mediante API alojadas, así que el habitual encuadre de cerrado frente a abierto no viene al caso aquí. El eje que sí viene al caso es el que nadie incluye en una tabla comparativa: qué permite realmente la licencia y qué nivel de cada familia es ese con el que se te permite hacer algo interesante.

Dos laboratorios, dos respuestas a la misma pregunta

Alibaba y Z.ai son los dos editores de pesos abiertos más consistentes entre los laboratorios cercanos a la frontera, y han adoptado posturas distintas sobre cuánto de esa apertura sobrevive al nivel insignia.

La generación Qwen 3.8 de Alibaba publicó los pesos de su modelo más grande —Qwen3.8-2.4T-A95B, en BF16 y FP8— el 12 de agosto de 2026. Los publicó bajo una licencia Qwen personalizada, no Apache 2.0. Esa distinción es justamente lo esencial: los pesos existen, lo que significa que el ajuste fino, la cuantización y el autoalojamiento son posibles de un modo en que nunca lo serán para un modelo cerrado, pero los términos son los propios de Alibaba y no son el valor predeterminado permisivo que tiende a implicar la frase «pesos abiertos».

La línea GLM de Z.ai proviene de un laboratorio con un linaje de pesos abiertos, y su modelo insignia ya no es una excepción a ello. Los propios pesos de GLM-5.3 se publicaron el 28 de agosto de 2026 —el modelo insignia de 743.000 millones de parámetros, en 141 fragmentos safetensors— bajo una licencia personalizada que Z.ai redactó para él en lugar de bajo MIT. Los términos son, en esencia, una concesión al estilo MIT con una condición de revisión de seguridad adjunta para empresas de modelo como servicio por encima de un umbral de ingresos elevado. Observa lo que eso significa para la familia: GLM-5.2 y GLM-5.3-Flash llevan MIT, y el modelo insignia no.

Tal como se indica, GLM-5.3 es un modelo solo de texto con una ventana de contexto publicada, un límite de salida publicado y uso de herramientas, modo JSON y razonamiento documentados.

Pon los dos lado a lado y el contraste práctico es este:

• Pesos de la versión insignia — La versión insignia de Qwen 3.8 publicada bajo una licencia personalizada de Qwen frente a los pesos de GLM-5.3 publicados el 28 de agosto de 2026 bajo una licencia personalizada de Z.ai

• Precio de entrada: Qwen3.8-Max $2.00 por 1M de tokens frente a GLM-5.3 $1.26 por 1M de tokens en nuestro catálogo, $1.40 en la propia lista de Z.ai

Precio de salida — Qwen3.8-Max $6.00 por 1M de tokens frente a GLM-5.3 $3.96 por 1M de tokens en nuestro catálogo, $4.40 en la propia lista de Z.ai

• Contexto — Qwen3.8-Max 1M tokens frente a GLM-5.3 1M tokens

• Techo de salida — Qwen3.8-Max 128K tokens frente a GLM-5.3 128K tokens

• Modalidad: entrada de texto, imagen y vídeo de Qwen3.8-Max frente a GLM-5.3, solo texto, documentado como tal

• Etiquetas de capacidades — Qwen3.8-Max visión, herramientas, JSON y razonamiento frente a GLM-5.3 herramientas, JSON y razonamiento

• Qwen 4 Max — anunciado el 22 de septiembre de 2026, sin precio, sin contexto, sin pesos, sin fecha, a diferencia de GLM-5.3, ya lanzado y atendiendo tráfico

La fila multimodal es la que paga la diferencia de precio. El modelo insignia de Qwen acepta entrada de imagen y video y cobra $2.00 de entrada y $6.00 de salida; GLM-5.3 acepta texto y cobra $1.26 y $3.96. Si tu carga de trabajo es texto, estás pagando un sobrecoste por un codificador de visión que nunca invocas, y esa es la razón más concreta por la que un especialista solo de texto supera a un modelo insignia multimodal en coste para trabajo de texto.

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

El nivel de 27B es el que decide esto

Qwen 4 Max es el titular y el nivel de 27B es la historia. Cada generación de Qwen ha distribuido su pequeño nivel abierto bajo términos que permiten a la gente hacer cosas, y la evidencia posterior es inequívoca: en cuestión de días tras la llegada de los pesos de Qwen 3.8 27B, el ecosistema había producido conversiones a MLX, cuantizaciones NVFP4 y fine-tunes sin censura, ninguna de las cuales requirió el permiso de nadie. Eso es lo que compra un lanzamiento permisivo de un modelo pequeño, y es una forma de distribución que ninguna API alojada puede igualar.

El nivel insignia es otro asunto. Un modelo de 2,4 billones de parámetros publicado bajo una licencia personalizada es abierto en el sentido de que los bytes se pueden descargar y cerrado en el sentido de que lo que puedes hacer con ellos lo define el editor. Ambas cosas son ciertas a la vez, y el anuncio de Qwen 4 no cambió ninguna de las dos. Si el nivel 27B de Qwen 4 sigue el patrón de sus predecesores, será el lanzamiento que importe al mayor número de personas, y también es el lanzamiento con la fecha de entrega más predecible, porque los niveles abiertos pequeños son lo más fácil de completar en la hoja de ruta.

Lo que devuelve la comparación a algo utilizable. GLM-5.3 es un modelo alojado a un precio publicado con un conjunto de capacidades documentado, y está disponible ya. Qwen 4 Max es un nombre de nivel. Si quieres que el argumento de la apertura sea concreto en lugar de filosófico, el modelo que hay que esperar es el 27B, no el Max.

La capa de enrutamiento es donde la cuestión de la licencia deja de importar

Hay una versión de esta decisión que evita por completo la cuestión de la licencia, y vale la pena ser honesto: es una opción real, no un compromiso. Si lo que necesitas es llamar a un modelo en lugar de poseer uno, la licencia de los pesos es irrelevante y los términos que importan son el precio, la latencia y el comportamiento ante fallos.

OrcaRouter ofrece GLM-5.3 como z-ai/glm-5.3 a $1.26 de entrada y $3.96 de salida por millón de tokens — por debajo de los $1.40 y $4.40 que publica Z.ai, con la página del modelo mostrando esas tarifas de lista junto a la tarifa a la que facturamos, y sin ningún margen añadido sobre lo que le pagamos al proveedor. El mismo endpoint compatible con OpenAI ofrece la familia Qwen 3.8, Qwen3.8-Max, Qwen3.8-Flash y Qwen3.8-27B, junto con cerca de otros 200 modelos, con failover automático cuando se degrada la ruta de un proveedor y un DSL de enrutamiento que te permite expresar la política de sustitución de forma explícita en lugar de editar una cadena de modelo en el código de la aplicación. Cuando un proveedor cambia su tarifa, el cambio llega a tu clave el mismo día, porque no hay ninguna capa de margen tras la que pueda quedarse atascado.

Lo que OrcaRouter no incluye es Qwen 4 Max ni ningún nivel de Qwen 4. El catálogo no tiene ninguna entrada para la familia, que es el estado correcto para un modelo que se anunció en un escenario y no se ha lanzado. Se podrá acceder a Qwen 4 Max, cuando llegue a ser accesible, a través de la propia API del proveedor y varias plataformas de terceros. Hasta entonces, el modelo Qwen de esta comparación que realmente puedes invocar es Qwen3.8-Max, y está en el mismo catálogo que GLM-5.3, lo que convierte la versión en vivo de este enfrentamiento en una decisión de política de enrutamiento en lugar de una de adquisición.

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

Lo que realmente decide la cuestión de la licencia

GLM-5.3 es más económico en ambos aspectos, su ventana de contexto y su límite máximo de salida igualan los del modelo insignia de Qwen, sus límites de modalidad están documentados en lugar de dejarse a la inferencia, y hoy está sirviendo tráfico. Qwen 4 Max tiene un espacio en una conferencia y un nombre de nivel, y la única parte de la hoja de ruta de Qwen 4 con una entrega predecible es el nivel de 27B.

La decisión que sobrevive al lanzamiento no es qué modelo es mejor. Es si necesitas tenerlo en propiedad. Si necesitas alojarlo en tus propios servidores, ajustarlo o modificarlo, los pesos insignia de cualquiera de los dos laboratorios vienen con términos que deberías leer antes de construir un negocio sobre ellos, y la gama abierta pequeña es donde históricamente han estado las opciones permisivas. Si necesitas invocar un modelo, GLM-5.3 es la respuesta más barata hoy para trabajo de texto, Qwen3.8-Max es la respuesta si necesitas entrada de imagen o video, y ambos están a un endpoint y una factura de distancia. Vuelve a plantearte la pregunta sobre el modelo insignia cuando Alibaba publique una ficha de modelo, y lee la licencia antes de la tabla de benchmarks.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario