Tarjeta destacada generada titulada Claude Sonnet 5.5 vs Qwen 4 Max, con el subtítulo un modelo tiene una tarjeta, el otro tiene un nombre, con tres tarjetas que dicen Claude Sonnet 5.5 lanzado el 2026-09-28, Qwen 4 Max anunciado sin tarjeta de modelo, y Qwen3.8 Max el Qwen al que puedes llamar por $2.00 / $6.00, con un pie de página que dice Qwen 4 Max se anunció el 2026-09-22 sin precio publicado, ventana de contexto, pesos ni puntuación.
Guides & Insights

Claude Sonnet 5.5 vs Qwen 4 Max: Un modelo tiene una tarjeta, el otro tiene un nombre

Autor

Magnus Corvin

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Las dos mitades de este título no son el mismo tipo de objeto, y eso es lo primero que un lector necesita saber. Claude Sonnet 5.5 se lanzó el 28 de septiembre de 2026: tiene un identificador de API, una tarifa, una ventana de contexto, una fecha mínima de retirada publicada y una fila en los rankings independientes. Qwen 4 Max se presentó en primicia en la conferencia Yunqi de Hangzhou el 22 de septiembre de 2026 como el buque insignia de una línea Qwen 4 anunciada de cuatro modelos, y a día de hoy no tiene precio, ni ventana de contexto, ni puntuación publicada, ni ficha de modelo, ni una página en Artificial Analysis que abrir. Eso no es un escándalo; es así como se anuncia un nivel. Pero cambia el aspecto que tiene una comparación útil. La comparación que merece la pena hacer es entre el Sonnet más reciente ya publicado y el modelo Qwen al que realmente puedes llamar hoy, que es Qwen3.8 Max, porque ese sí tiene tarifa, y la tarifa es instructiva.

Lo que Alibaba realmente puso sobre la mesa

Q​wen 4 Max apareció como un nombre dentro de una lista, no como un producto. La presentación de la conferencia dio a conocer la estructura de niveles de la familia Q​wen 4, y nada de ello se ha convertido desde entonces en una especificación sobre la que un desarrollador pueda planificar: ni precio por millón de tokens, ni tamaño de ventana, ni salida máxima, ni tabla de benchmarks, ni repositorio en Hugging Face, ni entrada en la propia lista de modelos del proveedor. Que se lance como un nivel cerrado de API, como pesos abiertos o en ambas formas no se indica en ningún lugar que el proveedor haya publicado. Cuando un nivel está tan en pañales, lo único honesto que un artículo puede decir sobre sus especificaciones es que no hay ninguna, y cualquier página que ofrezca hoy una ficha técnica del Q​wen 4 Max no está publicando más que una proyección.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Qwen 4 Max, the scoreboard, with six matched rows. Claude Sonnet 5.5: released 2026-09-28, $2.00 input, $10.00 output, Intelligence Index 56, 1,000,000-token context window, closed weights. Qwen 4 Max: announced with no model card, input and output price not published, no score published, context window not published, weights not stated. A footer reads Qwen 4 Max was announced 2026-09-22 with no specification published; Claude Sonnet 5.5 figures per Artificial Analysis v4.3.2 and Anthropic.

Lo único que el anuncio establece de manera útil es la dirección. El buque insignia más reciente de Alibaba, Qwen3.8 Max, está posicionado por la propia guía de migración del proveedor directamente contra GPT-5.5, Claude Opus 4.7 y Gemini 3.1 Pro, y es el nivel que Qwen 4 Max está siendo construido para reemplazar. Así que el objetivo del sucesor es legible incluso cuando sus números no lo son, y el modelo al que tendrá que superar en precio es el que ya está a la venta.

El Qwen que puedes llamar hoy, con un precio frente al nuevo Sonnet

Qwen3.8 Max está disponible de forma general desde el 3 de agosto de 2026. Es el nivel de mayor capacidad de Alibaba hasta la fecha: nativamente multimodal con entrada de texto, imagen y vídeo y salida de texto, una ventana de 1.000.000 de tokens, modo de pensamiento, llamada a funciones, herramientas integradas y salidas estructuradas, servido a través de endpoints compatibles con OpenAI, compatibles con Anthropic y nativos de DashScope. Alibaba lo posiciona para el mismo análisis exigente de varios pasos y trabajo agéntico para el que el proveedor posiciona Claude Sonnet 5.5, y ambos se sitúan en casi exactamente la misma tarifa anunciada, que es donde la comparación se vuelve interesante.

• Precio de entrada — Claude Sonnet 5.5 2,00 $ por millón frente a Qwen3.8 Max 2,00 $ por millón, idénticos

• Precio de salida — Claude Sonnet 5.5 $10.00 por millón frente a Qwen3.8 Max $6.00 por millón

• Lectura de caché — Claude Sonnet 5.5 $0.20 por millón vs Qwen3.8 Max $0.25 por millón

• Escritura en caché — Claude Sonnet 5.5 $2.50 por millón frente a Qwen3.8 Max $2.50 por millón

• Contexto — Claude Sonnet 5.5 1.000.000 tokens vs. Qwen3.8 Max 1.000.000 tokens en la ficha técnica del proveedor; Artificial Analysis registra la instantánea que midió en 983.616

• Salida máxima — Claude Sonnet 5.5: 128.000 en modo síncrono, 300.000 en Batches, frente a Qwen3.8 Max, cuyo máximo no ha sido publicado por el proveedor

• Modalidad de entrada — Claude Sonnet 5.5: texto, imagen y archivo frente a Qwen3.8 Max: texto, imagen y video

Una tarifa de entrada idéntica y una tarifa de salida un 40% más barata constituyen una posición de precio realmente sólida, y es la razón por la que Qwen3.8 Max no deja de aparecer en las comparativas frente a los modelos de frontera. Pero luego uno mira las mediciones independientes y la ventaja se traslada a un terreno completamente distinto.

Lo que dicen los números independientes sobre la ventaja de precio

Ambos modelos están en el mismo Artificial Analysis Intelligence Index, revisión v4.3.2, y ambos han sido medidos en lugar de estimados.

• Índice de Inteligencia — Claude Sonnet 5.5 56 con Esfuerzo Máximo vs Qwen3.8 Max 45 en la instantánea del 2 de septiembre

• Costo por tarea de Index — Claude Sonnet 5.5 $7.60 vs Qwen3.8 Max $5.41

• Velocidad de salida — Claude Sonnet 5.5 138,7 tokens/seg vs Qwen3.8 Max 38,2 tokens/seg

• Tiempo hasta el primer fragmento — Claude Sonnet 5.5 370,8 s con Max Effort frente a Qwen3.8 Max 3,0 s

• Tokens de salida generados en todo el Index — Claude Sonnet 5.5 410M frente a Qwen3.8 Max 190M, que el panel señala como muy verboso en comparación con una mediana de 88M

• GPQA Diamond — Claude Sonnet 5.5 no publicado en la tabla actual frente a Qwen3.8 Max 92,8%

• Humanity's Last Exam — Claude Sonnet 5.5 55,0 % vs Qwen3.8 Max 43,1 %

• Recuperación en contexto largo — Claude Sonnet 5.5 82,7 % vs Qwen3.8 Max 80,3 %

Dos cosas destacan, y ninguna de las dos es el precio. La primera es que una tarifa de salida un 40 % más barata se convierte en una tarea un 30 % más barata cuando se tiene en cuenta la cantidad de tokens — Qwen3.8 Max emite 190M tokens en todo el índice frente a los 410M de Claude Sonnet 5.5, que es más ligero, pero no lo suficiente como para conservar toda la diferencia de tarifas. La segunda es la velocidad, y aquí la dirección se invierte radicalmente: Claude Sonnet 5.5 genera salida 3,6 veces más rápido que Qwen3.8 Max, 138,7 tokens por segundo frente a 38,2. En una generación larga, esa es la diferencia entre un minuto y varios minutos, y no es una diferencia que ningún descuento por token pueda compensar.

La cifra del primer token apunta en la dirección opuesta y merece que su salvedad se exponga con claridad. 370,8 segundos corresponden a Claude Sonnet 5.5 en Max Effort con fallback predeterminado, una configuración de razonamiento que consume un presupuesto de pensamiento muy grande antes de responder; quien realiza la llamada con un esfuerzo menor obtiene un primer token en segundos. Los 3,0 segundos de Qwen3.8 Max se miden en un modelo cuyo comportamiento de pensamiento es distinto. La comparación es real, pero es una comparación de configuraciones, no de proveedores.

Artificial Analysis model page for Qwen3.8 Max (0902), a proprietary model released September 2026, showing an Intelligence Index of 45, an output speed of 38.2 tokens per second, $2.00 per million input tokens and $6.00 per million output tokens, $5.41 per Intelligence Index task, 190M output tokens generated during the Index evaluation described as very verbose, and a 984k-token context window.

Dónde acaba recayendo el costo faltante de la migración de Sonnet

Una diferencia operativa no aparece en ninguna de las filas anteriores y es más importante que la diferencia de precio para cualquiera que tenga código en ejecución. Claude Sonnet 5.5 cambió seis comportamientos con respecto a Claude Sonnet 5, y cinco de ellos rompen las integraciones existentes: los valores no predeterminados de temperature, top_p y top_k ahora devuelven un 400; thinking: {"type": "disabled"} devuelve un 400 y debe convertirse en between_tools con esfuerzo limitado a bajo, medio o alto; la elección forzada de herramienta de "any" o una herramienta nombrada se rechaza, por lo que los bucles deben pasar a auto con uso estricto de herramientas o salidas estructuradas; la computer_20251124 herramienta de uso de computadora se rechaza en la API de Claude y Google Cloud; y los bloques de pensamiento ahora están vinculados al modelo y la cuenta de producción, por lo que el razonamiento se transfiere desde Sonnet 5 pero no hacia otra familia. El sexto cambio no falla nada y, por lo tanto, es el fácil de enviar roto: el texto entre llamadas a herramientas ahora se devuelve dentro de los bloques de pensamiento, por lo que una aplicación de transmisión se queda en silencio entre llamadas hasta que establece un valor de visualización o desactiva el pensamiento por adelantado.

Qwen3.8 Max no le pide nada de eso a un llamador de Q​wen: es un endpoint compatible con Open​AI con toda la superficie de muestreo y la forma estándar de llamada a herramientas, y su endpoint compatible con Anthro​pic existe precisamente para que el código escrito para Claude pueda apuntarle con solo cambiar la URL base. Para un equipo que ya trabaja con Sonnet 5, pasarse a Sonnet 5.5 es un día de trabajo de migración con una lista de cinco puntos que revisar; pasarse a Qwen3.8 Max es un cambio de configuración con un conjunto distinto de riesgos, sobre todo en torno a la deriva de comportamiento más que a la forma de la API.

Conseguir que el accesible esté en la misma tecla

Un pipeline realista a finales de septiembre de 2026 no elige una de estas. Ejecuta un modelo Claude para la ruta agéntica y un modelo Qwen donde la entrada de video o el precio importan, y el coste de esa disposición normalmente consiste en dos contratos, dos claves, dos superficies de límites de velocidad y dos puntos en los que una solicitud puede fallar. OrcaRouter lo reduce a un único endpoint compatible con OpenAI para más de 200 modelos, con el precio de lista del proveedor pasado tal cual y sin margen añadido, de modo que un cambio de tarifa de un proveedor en cualquiera de las dos partes surte efecto aquí el mismo día en lugar de en la próxima renovación, además de conmutación automática por error entre proveedores upstream y un DSL de enrutamiento para componer llamadas a partir de varios modelos.

Qwen3.8 Max se puede enrutar aquí hoy como qwen/qwen3.8-max con los $2.00 de entrada y $6.00 de salida de Alibaba en toda la ventana de 1,000,000 de tokens, y la instantánea del 2 de septiembre que midió Artificial Analysis se puede direccionar como qwen/qwen3.8-max-0902 cuando necesitas la revisión exacta sobre la que se tomó una puntuación. Ni Qwen 4 Max ni ningún otro nivel de Qwen 4 está en nuestro catálogo, y ningún nivel de Qwen 4 lo estará hasta que Alibaba publique algo que enrutar. Claude Sonnet 5.5 tampoco está en el catálogo — tiene un día de vida, y la ruta hacia él es la propia API de Anthropic, con Claude Sonnet 5 disponible aquí a los $2.00 y $10.00 de Anthropic como objetivo de conmutación por error mientras tanto. Qwen3.8 Max transporta 52.0 millones de tokens de tráfico a la semana a través de este catálogo y Claude Sonnet 5 transporta 7.9 millones, que es la versión práctica del argumento anterior: el nivel de Qwen no es un respaldo solo de nombre.

OrcaRouter model page for qwen/qwen3.8-max, dated 2026-08-03, showing text, image and video input, a 1M-token context window, $2.00 input and $6.00 output per million tokens, a p50 time to first token of 2.27 s, and 52.0M tokens of recent traffic.

La regla para un nivel anunciado

Trata un nivel anunciado como un dato de planificación, no como una opción de compra. Qwen 4 Max merece seguimiento porque indica hacia dónde se dirige el buque insignia de Alibaba y porque con el tiempo acabará desplazando a Qwen3.8 Max en lo más alto de la gama. No merece la pena planificar en función de él, porque no hay nada con lo que planificar: ni identificador, ni precio, ni ventana, ni pesos, ni puntuación medida. La evidencia que lo hará real es concreta y fácil de reconocer: una entrada en la propia lista de modelos de Alibaba, una fila de precio, una ventana de contexto publicada, un repositorio de Hugging Face si los pesos son abiertos, y una página en Artificial Analysis, porque un modelo que nadie ha medido no es un modelo que puedas comparar.

Hasta entonces, la decisión está entre dos modelos que existen ambos. Si tu trabajo es agéntico, los diecisiete puntos de Index y la velocidad de salida de 3,6× son lo que compras, y el mayor coste por tarea de Claude Sonnet 5.5 es el precio de ello. Si tu trabajo acepta entrada de vídeo, necesita un endpoint nativo compatible con Anthro​pic en una factura de Q​wen, o simplemente no puede justificar una tarifa de salida de $10, Qwen3.8 Max está ahora mismo de oferta al mismo precio de entrada con una salida un 40 % más barata y un primer token que llega en segundos — y la advertencia honesta es que se sentirá lento una vez que empiece la generación, que es el intercambio que compra la tarifa más barata.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario