Qwen 3.8 vs Claude Fable 5: La compilación 0902 toma la delantera en codificación
Guides & Insights

Qwen 3.8 vs Claude Fable 5: La compilación 0902 toma la delantera en codificación

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Cuando Alibaba presentó Qwen3.8-Max en Shanghái el 19 de julio de 2026, hizo una afirmación más fuerte que cualquier otra: este modelo de 2,4 billones de parámetros está cerca del nivel de frontera y solo por detrás de Claude Fable 5. En ese momento era imposible de evaluar. No había tarjeta de precios, ni tabla de benchmarks, ni licencia: solo una declaración de posicionamiento.

El 3 de agosto de 2026, Qwen3.8-Max estuvo disponible de forma general: una tarifa real de $2/$6 por millón de tokens, una tabla de benchmarks con números, y un endpoint compatible con OpenAI y DashScope. El 2 de septiembre, Alibaba lanzó el siguiente paso sin cambiar el número de versión: Qwen3.8-Max-0902, una actualización posterior al entrenamiento orientada a la codificación y al trabajo agéntico que debutó en el #1 del ranking Code Arena: WebDev con 1,691 Elo. Claude Fable 5, el modelo detrás del cual Alibaba pasó julio posicionándose directamente, se encuentra en 1,628 en ese mismo ranking. La pregunta de julio se ha vuelto más aguda: ¿sigue Qwen 3.8 siendo “solo superado por Fable 5”, o el eje de la codificación ya se ha invertido?

Una nota para los desarrolladores: la forma más rápida de resolver una afirmación como esta es ejecutar ambos modelos con sus propias indicaciones. OrcaRouter ofrece más de 200 modelos detrás de un único endpoint compatible con OpenAI, por lo que puedes enfrentar a Qwen 3.8 Max contra Fable 5 en la misma tarea sin tener que configurar dos SDKs.

Veredicto TL;DR. Qwen3.8-Max-0902 es la versión más potente hasta la fecha del buque insignia de 2,4 billones de parámetros de Alibaba, y la novedad de su candidatura ya no es autodeclarada: debutó en el #1 de la tabla independiente Code Arena: WebDev con 1.691 Elo, por delante de Claude Fable 5 (1.628, #8) en esa misma tabla. El precio no ha cambiado y sigue siendo decisivo: a $2 / $6 fijos por millón de tokens, Qwen supone aproximadamente una quinta parte de los $10 de Fable 5 en la entrada y una octava parte de los $50 en la salida. Lo que no se ha cerrado es la brecha en tareas de propósito general: Artificial Analysis puntúa a Qwen3.8-Max con 56 en su Índice de Inteligencia, frente al 62 de Claude Fable 5, y en la última semana publicada de la clasificación general de Arena (24–30 de agosto) Fable 5 mantiene el #1 (1.508 Elo), mientras que Qwen3.8-Max ocupa el #20 (1.479). Dos veredictos, entonces: en programación, la actualización 0902 de Qwen ya tiene árbitro y victoria; en razonamiento amplio y contrastado, Claude Fable 5 — y el nuevo Claude Fable 5.1 de Anthropic, que lidera el índice de AA con 66 — siguen manteniendo el terreno.

Conclusiones clave

Qwen3.8-Max alcanzó la disponibilidad general el 3 de agosto de 2026 y su actualización 0902 siguió el 2 de septiembre — sin cambio de versión, misma tarjeta de precios de $2 / $6, mismo contexto de 1M de tokens.

La diferencia de precio es enorme: Qwen a $2 / $6 por 1M frente a Fable 5 a $10 / $50. Eso es ~5× en entrada y ~8× en salida, y la tarifa de Qwen es plana en todo el contexto de 1M de tokens, sin recargo por prompts largos.

Ambas partes tienen ahora puntuaciones independientes — y apuntan en direcciones distintas. Qwen3.8-Max obtiene 56 en el Artificial Analysis Intelligence Index (Claude Fable 5: 62), y su build 0902 encabeza Code Arena: WebDev con 1.691 Elo frente a los 1.628 de Fable 5.

La propia tabla de benchmarks de Qwen sigue siendo sólida y sigue producida por el proveedor. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — pero la actualización del 2 de septiembre es el primer resultado de Qwen que una arena independiente ha clasificado en el puesto #1.

La brecha de arquitectura en la hoja de especificaciones está cerrada. Qwen3.8-2.4T-A95B tiene ~95B de parámetros activos de un total de 2.4T, distribuidos en 512 expertos — revelado con el lanzamiento de pesos abiertos del 12 de agosto. La arquitectura de Fable 5 sigue sin revelarse.

Los pesos abiertos ya están disponibles, no son una promesa. Qwen3.8-2.4T-A95B (BF16 y FP8) se publicó en Hugging Face y ModelScope el 12 de agosto bajo una licencia personalizada de Qwen3.8-Max, seguido de Qwen3.8-27B el 14 de agosto bajo Apache 2.0. Fable 5 es un modelo cerrado y solo API, permanentemente.

Nota de precisión: las cifras de la propia tabla de referencia de Alibaba siguen siendo comunicadas por el proveedor y no han sido replicadas. Las cifras independientes aquí están selladas con fecha y son de terceros: el Índice de Inteligencia de Artificial Analysis (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), el listado de Code Arena: WebDev Elo y la tabla semanal general de Arena — las puntuaciones de Arena fluctúan a medida que se acumulan votos, y el puesto #1 del build 0902 se basa en el anuncio de Alibaba de un listado en un momento concreto. El 95.0% de SWE-bench Verified de Fable 5 es informado por Anthropic; el precio de Qwen es la tarifa GA de Alibaba Model Studio.

Las especificaciones y el precio, lado a lado

Aquí están los datos concretos, cada cifra atribuida a su fuente.

• Fabricante / estado — Qwen3.8-Max: Alibaba; GA el 3 de agosto de 2026; actualización 0902 el 2 de septiembre de 2026. Claude Fable 5: Anthropic; buque insignia GA.

• Arquitectura — Qwen3.8-Max: 2,4 billones en total / ~95 mil millones activos, MoE disperso, 512 expertos (revelado el 12 de agosto); Fable 5: sin revelar.

• Ventana de contexto — Qwen3.8-Max: 1M tokens (983,616 con pensamiento; salida máxima 131,072); Fable 5: buque insignia de contexto largo

• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (Sep 1): 66, lidera

• SWE-bench Verified — Qwen3.8-Max: No reportado (Alibaba informa FrontierSWE 73.5 en su lugar); Fable 5: 95.0% (Anthropic / buildfastwithai)

• Fortalezas independientes y reportadas por el proveedor — Qwen3.8-Max: Code Arena WebDev #1 con 1,691 (0902, independiente); tabla del proveedor: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%

• Precios (entrada / salida) — Qwen3.8-Max: $2.00 / $6.00 por 1M, fijo en contexto de 1M; entrada en caché $0.25; Fable 5: $10 / $50 por 1M

• Pesos abiertos — Qwen3.8-Max: publicado el 12 de agosto de 2026 (licencia personalizada, no Apache); Qwen3.8-27B bajo Apache 2.0 el 14 de agosto. Fable 5: no — cerrado / solo API.

• Multimodalidad — Qwen3.8-Max: texto, imagen y video como entrada → texto como salida; Fable 5: buque insignia multimodal

Dos cosas enmarcan toda la comparación. La primera cambió el 3 de agosto y sigue vigente; la segunda cambió de nuevo el 2 de septiembre.

Primero, la columna de precios es ahora lo más llamativo de la página. En julio, la ventaja de coste de Qwen era un cupón de descuento: 90% de descuento en créditos, temporal, sin una tarifa por token con la que planificar. Ahora es una tarjeta de tarifas, y la brecha es estructural en lugar de promocional. A $6 de salida frente a los $50 de Fable, puedes ejecutar aproximadamente ocho llamadas de Qwen por el precio de una llamada de Fable. Para cualquier carga de trabajo en la que pagues por volumen en lugar de por la respuesta más difícil, esa relación cambia la arquitectura de lo que construyes.

En segundo lugar, la columna de los benchmarks ha dejado de estar decantada. Durante la mayor parte de agosto, la lectura honesta era limitada: Alibaba reportó FrontierSWE 73,5 y una tabla de cifras de ejecuciones propias; Anthropic reportó un 95,0 % de SWE-bench Verified verificado por terceros; y ningún evaluador independiente había puntuado a Qwen en absoluto. La versión 0902 puso fin a eso. Code Arena: WebDev es una arena de votación ciega por pares entre humanos — el proyecto anteriormente conocido como WebDev Arena, que no gestiona nadie de Alibaba — y Qwen3.8-Max-0902 entró en ella en el puesto #1 con 1.691 Elo, por encima de Claude Opus 5 (1.688), Kimi K3 (1.674) y Claude Fable 5 (1.628, #8). Para que esa lectura siga siendo honesta, hay que añadir dos salvedades: es una única tabla de clasificación, que mide el desarrollo front-end agéntico, no la capacidad general; y «debutó en el #1» es el anuncio de Alibaba de un puesto en un momento dado. Pero la afirmación de que Qwen no tiene ningún árbitro en absoluto ya no es cierta, y eso cambia la comparación más que cualquier cifra individual de esa tabla.

Lo que la brecha de precios realmente te ofrece

Los múltiplos abstractos son menos útiles que un ejemplo resuelto, así que aquí tiene uno. Tome un agente de revisión de código que envía 150,000 tokens de contexto de repositorio y genera 6,000 tokens de revisión por llamada.

Qwen3.8-Max: 0,15M × $2 = $0,30, más 0,006M × $6 = $0,036. ≈ $0,34 por llamada.

Claude Fable 5: 0.15M × $10 = $1.50, más 0.006M × $50 = $0.30. ≈ $1.80 por llamada.

• Con 2,000 llamadas/día: Qwen ≈ $672/día; Fable ≈ $3,600/día. En un mes, eso es aproximadamente $20,000 frente a $108,000.

• Con el almacenamiento en caché de prompts en un contexto de repositorio estable, la entrada en caché de Qwen a $0.25/1M reduce el lado de entrada de $0.30 a menos de $0.04, llevando la llamada a ≈ $0.08 — aproximadamente 22× más barato que Fable por llamada.

Eso no es un ahorro marginal; es la diferencia entre ejecutar un revisor en cada pull request y ejecutarlo solo en los riesgosos. Y el contexto a tarifa plana de Qwen hace que el efecto sea más fuerte a medida que crecen los prompts: como Alibaba no aplica ningún recargo por prompts largos, procesar un contexto de 900,000 tokens cuesta lo mismo por token que uno de 5,000 tokens.

El contrapeso honesto es que el precio por token no es el precio por tarea resuelta. Si Fable 5 resuelve un problema en una sola pasada mientras que un modelo más barato necesita tres intentos más corrección humana, el modelo más barato puede costar más en conjunto — y en el trabajo de razonamiento más difícil, el ranking auditado #1 de Fable es la mejor evidencia disponible de que efectivamente resuelve más en una sola pasada. El argumento de costo a favor de Qwen es más fuerte en cargas de trabajo de alto volumen y tolerantes, y más débil en las de bajo volumen y alto riesgo.

La nomenclatura 0902: la capacidad saltó, el número de versión no.

Lo notable del 2 de septiembre es lo que Alibaba no hizo: lanzar Qwen 3.9. La mejora se distribuyó como un checkpoint fechado bajo el mismo nombre de modelo — Qwen3.8-Max-0902 — y la API lo sirvió con el mismo nombre y al mismo precio. Esta es la dirección hacia la que se desvía la industria: cuando un salto de capacidades ya no garantiza un nuevo número de versión, «qué modelo debería usar» se convierte en una cuestión de builds y fechas, no solo de nombres de familia.

También significa que una puntuación de referencia asociada a “Qwen3.8-Max” tiene una fecha de caducidad: una puntuación medida con la versión de julio o agosto puede no describir el modelo que la API devuelve hoy. Comprueba el identificador de compilación en el endpoint que realmente llamas: el número 0902 es la diferencia entre un modelo que iba por detrás de Claude Fable 5 y uno que lo supera en Code Arena: WebDev.

Prueba, y por qué sigue decidiendo este enfrentamiento.

La evidencia práctica más citada para Qwen3.8-Max proviene de una reseña de la era de vista previa (thomas-wiegold.com) que sometió al modelo a cuatro builds reales. Los resultados fueron realmente impresionantes: Qwen resolvió en una sola pasada una simulación de Go poker — solo el tercer modelo en superar ese prompt de un solo intento, junto con Fable 5 y Grok 4.5 — y en un prompt de sitio web de tostador de café produjo la mejor salida que el revisor había visto jamás en esa prueba, añadiendo un carrito de compras no solicitado, una sección de venta al por mayor e integración con Instagram por pura minuciosidad.

El problema era la velocidad: más de 30 minutos en el sitio web y 1 hora 20 minutos en la simulación de póker, lo que lo convertía en el modelo más lento que ese revisor había usado. Ese hallazgo ahora necesita una salvedad que no necesitaba en julio. Se midió en una infraestructura de vista previa, por un revisor, en ejecuciones agénticas inusualmente largas. El serving de GA es un sistema diferente. Por si sirve de algo, la propia telemetría de 7 días de OrcaRouter actualmente muestra un p50 de tiempo hasta el primer token de 1,64 segundos para Qwen3.8-Max — una medición de primera parte, aunque el TTFT y el rendimiento de extremo a extremo en compilaciones de una hora son cantidades diferentes. La posición honesta es que el hallazgo de lentitud de la vista previa debería volver a probarse en lugar de repetirse como un hecho actual.

Lo que sobrevive a la actualización 0902 es que la evidencia más contundente de cada bando sigue viniendo de lugares distintos. El #1 de Qwen3.8-Max-0902 en Code Arena: WebDev es un resultado independiente por votación a ciegas, pero mide una sola tabla, y la propia tabla de benchmarks de Alibaba sigue siendo un artefacto del proveedor: los laboratorios eligen qué benchmarks reportar, y la cifra reportada más débil de Alibaba (IFBench 82.8, seguimiento de instrucciones) sigue coincidiendo con la queja previa de que el modelo se excede e ignora el alcance. La evidencia de Claude Fable 5 es más amplia y mayormente de terceros: 62 en el AA Intelligence Index, #1 en la tabla general de Arena, 95.0% SWE-bench Verified — y el más nuevo Claude Fable 5.1, de la propia Anthropic, ha encabezado el índice AA con 66 desde el 1 de septiembre. Sobre “qué modelo manejará un trabajo en el que no puedo permitirme equivocarme”, la respuesta de propósito general no cambia. Sobre “qué modelo ofrece el mejor front-end a una décima parte del precio”, la respuesta se invirtió el 2 de septiembre.

Apertura: el eje que Qwen ya ha ganado

Fable 5 nunca será autoalojable. Qwen3.8-Max ya lo es: el 12 de agosto, los pesos de Qwen3.8-2.4T-A95B — una variante BF16 y una FP8 oficial — llegaron a Hugging Face y ModelScope, lo que lo convierte en el primer Qwen de clase Max que cualquiera puede descargar. Dos salvedades merecen el mismo peso.

Lo primero es legal. La versión se distribuye bajo una licencia propia denominada “Qwen3.8-Max”, no bajo Apache 2.0: los proveedores que ofrecen modelo-como-servicio o negocios de asistentes de trabajo con IA cuyos ingresos recurrentes superen los 50 millones de dólares deben negociar una licencia por separado con Qwen, y los productos comerciales que superen los 100 millones de usuarios activos mensuales o los 20 millones de dólares de ingresos mensuales deben mostrar el nombre del modelo. Para uso interno y para startups, los umbrales rara vez resultan vinculantes, pero esto no es un uso libre e ilimitado.

El segundo es físico. Un MoE de 2.4T en total ocupa aproximadamente 4.9TB en BF16 (cerca de la mitad en el checkpoint oficial FP8), frente a aproximadamente 141GB de memoria por H200; así que alojar el modelo insignia por tu cuenta implica tener un rack de aceleradores antes de servir un token. Los parámetros activos revelados de ~95B al menos te permiten estimar qué compraría ese rack. Para casi todos los equipos, la API alojada a $2 / $6 es la opción práctica.

Por eso Qwen3.8-27B, cuyos pesos con licencia Apache-2.0 se publicaron el 14 de agosto y que, según se informa, se ejecuta en ~17 GB de VRAM, sigue siendo el lanzamiento autoalojado de mayor importancia práctica. Si tu razón para preferir Qwen sobre Fable 5 es la residencia de datos o el control local, en lugar de la capacidad bruta, el modelo de 27B es el que realmente lo ofrece — y en ambos lados la comparación de apertura ya no es teórica.

Preguntas frecuentes

¿Es Qwen 3.8 mejor que Claude Fable 5?

Ahora depende del eje, lo cual es un cambio genuino con respecto a agosto. En codificación, Qwen3.8-Max-0902 lidera: #1 en Code Arena: WebDev con 1,691 Elo frente a los 1,628 de Claude Fable 5, a $2 / $6 versus los $10 / $50 de Fable 5. En calidad amplia y auditada, Fable 5 sigue liderando: 62 en el AA Intelligence Index frente a los 56 de Qwen, 95.0% en SWE-bench Verified y #1 en el tablero general de Arena. Para trabajos donde una respuesta incorrecta es costosa, Fable 5 es la opción mejor documentada; para codificación de alto volumen y trabajo web con agentes, el Qwen más reciente es más barato y está mejor posicionado en Arena.

¿Es cierto el reclamo de "solo detrás de Fable 5"?

El posicionamiento de Alibaba se hizo sin cifras independientes, y la compilación 0902 ha cambiado su forma desde entonces. Qwen3.8-Max-0902 se sitúa por delante de Claude Fable 5 en Code Arena: WebDev (1.691 frente a 1.628), pero por detrás de este en el Índice de Inteligencia AA (56 frente a 62) y en la tabla general de Arena (Qwen #20 con Elo 1.479; Fable 5 #1 con 1.508). Así, “solo superado por Fable 5” se ha convertido en “por delante de Fable 5 en la tabla de codificación a la que apuntaba esta actualización, pero por detrás en las amplias tablas de propósito general”.

¿Cuánto más barato es Qwen 3.8 que Fable 5?

Sustancialmente, y ahora es una tarifa real en lugar de un descuento. Qwen3.8-Max cuesta $2 / $6 por 1M de tokens frente a los $10 / $50 de Fable 5 — aproximadamente 5 veces más barato en entrada y 8 veces en salida. La tarifa de Qwen también es plana en todo el contexto de 1M, y la entrada en caché a $0.25/1M hace que las cargas de trabajo con contexto repetido sean aún más baratas.

¿Qwen 3.8 Max salió de la vista previa?

Sí. Alcanzó disponibilidad general el 3 de agosto de 2026 con una tarjeta de tarifas publicada y un endpoint compatible con OpenAI y DashScope. La campaña de créditos Qoder y el planteamiento de vista previa con un 90 % de descuento que circularon en julio ya no describen cómo se vende el modelo.

¿Sigue siendo Qwen 3.8 el modelo más lento, como dijeron las primeras reseñas?

Ese hallazgo provino de un revisor en infraestructura de vista previa ejecutando compilaciones agénticas de una hora, y debería volverse a probar contra el servicio GA en lugar de tratarse como un hecho actual. La telemetría de 7 días de OrcaRouter muestra un tiempo p50 hasta el primer token de 1,64 segundos, aunque eso mide la latencia del primer token en lugar del rendimiento en compilaciones muy largas.

¿Puedo autoalojar Qwen 3.8 en lugar de pagar por Fable 5?

Sí, para Qwen, con matices. Qwen3.8-2.4T-A95B ha estado disponible para descarga desde el 12 de agosto bajo una licencia personalizada (no Apache 2.0), y Qwen3.8-27B bajo Apache 2.0 desde el 14 de agosto. La barrera práctica es el hardware: un MoE de 2,4T en total necesita aproximadamente 4,9 TB en BF16 —un rack de aceleradores—, así que la mayoría de los equipos seguirán usando la API alojada a $2/$6 en lugar de servir al modelo insignia. Fable 5 está cerrado permanentemente.

¿Cuál debería usar hoy?

Para trabajo general donde una respuesta equivocada es costosa — razonamiento complejo, rutas de producción de alto riesgo — Claude Fable 5 sigue siendo la opción mejor documentada, y el Claude Fable 5.1 de Anthropic amplía esa ventaja. Para codificación de alto volumen y desarrollo web basado en agentes, Qwen3.8-Max-0902 tiene ahora la ventaja independiente en la arena y un precio de salida aproximadamente 8× menor: revisión masiva de código, generación de front-end, análisis de documentos largos. Muchos equipos deberían ejecutar ambos y enrutar según la tarea.

En resumen

Qwen 3.8 vs Claude Fable 5 es una comparación diferente a la de hace un mes, y diferente también a la de hace una semana. Qwen3.8-Max es un modelo disponible de forma general con una tarifa que es 5 veces más barata en entrada y 8 veces más barata en salida, plana por millón de tokens — y desde el 2 de septiembre el mismo nombre sirve la compilación 0902, que un arena independiente ahora clasifica como la #1 para desarrollo web agéntico, por encima de Fable 5 en esa tabla.

Ninguno de los dos modelos domina ya toda la comparación. Claude Fable 5 — y el Claude Fable 5.1 de Anthropic, que ha liderado el AA Intelligence Index con 66 desde el 1 de septiembre — mantienen el terreno amplio, auditado y de propósito general, mientras que la propia tabla comparativa de Alibaba sigue siendo un artefacto de proveedor. Pero la razón por la que este enfrentamiento estaba tan desequilibrado en julio — que Qwen no tenía ningún árbitro independiente — caducó el 2 de septiembre: Qwen3.8-Max-0902 es el modelo #1 en Code Arena: WebDev. La respuesta sensata sigue siendo dividir según lo que está en juego y la tarea: Fable 5 para razonamiento general donde equivocarse es costoso, Qwen3.8-Max para codificación de alto volumen donde la diferencia de precio y la ventaja en Code Arena juegan a su favor — y probar ambos con tus propios prompts.

Comparados en este artículo3

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario