
Fecha de lanzamiento de Qwen3.8-27B: Todo lo que sabemos hasta ahora
- deepseekNUEVODeepSeek: DeepSeek V4 Pro 08132026-08-12$0.44 / $0.88 por 1M de tokens · 72 tok/s
- grokNUEVOSpaceXAI: Grok 4.62026-08-1261Inteligencia77Código
- metaNUEVOMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenNUEVOQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2304 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencia77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencia77Código
- grokxAI: Grok 4.52026-07-0856Inteligencia72Código
- tencentTencent: Hy32026-07-0642Inteligencia59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligencia42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligencia39Código
Alibaba prometió los pesos abiertos de Qwen3.8-27B para la semana del 10 de agosto de 2026, y ese plazo llegó y se fue. Ahora el retraso tiene un objetivo concreto: la página oficial de Qwen en ModelScope muestra una cuenta regresiva hasta la medianoche del 15 de agosto de 2026 — 00:00 JST, según el informe del 13 de agosto de PC Watch sobre el adelanto. Al día de hoy, los pesos todavía no han aparecido en la organización oficial de Qwen en Hugging Face, pero la cuestión de la fecha de lanzamiento ahora tiene una respuesta por primera vez desde el anuncio del 3 de agosto. Esto es lo que está confirmado, lo que sigue sin verificar y lo que hay que observar.
¿Qué está confirmado?
Alibaba anunció la generación Qwen3.8 el 3 de agosto de 2026. Ese día ocurrieron dos cosas: Qwen3.8-Max, el buque insignia de mezcla de expertos con 2,4 billones de parámetros, se lanzó con una API de pago, y Alibaba se comprometió a abrir los pesos tanto del Max como del Qwen3.8-27B, más pequeño, "en aproximadamente una semana". Varios medios independientes (36Kr, TrendForce, C114) difundieron el mismo compromiso: Hugging Face y ModelScope, la semana del 10 de agosto.
El 27B es el miembro autoalojable de la generación: Alibaba lo posicionó como una solución para trabajo con una sola GPU y en entornos locales, el sucesor directo del muy utilizado Qwen3.6-27B. Ese linaje importa. Qwen3.6-27B se convirtió en uno de los modelos de codificación locales más populares de su generación, y la versión 3.8 hereda esa base instalada de preguntas: ¿cuánto cuesta ejecutarlo, es mejor para agentes, cuándo puedo descargarlo?
Lo que hoy se puede verificar de forma independiente es el modelo insignia, y eso ahora incluye pesos abiertos. Qwen3.8-Max ya está disponible en la API, y sus repositorios — Qwen3.8-2.4T-A95B (BF16 completo) y una cuantización FP8 oficial — se publicaron en la organización oficial de Qwen en Hugging Face durante la semana del 10 de agosto, la primera vez que Alibaba ha liberado como código abierto un modelo insignia de clase Max. También ya tiene puntuación: Artificial Analysis sitúa su Intelligence Index en 58, lo más cerca que un laboratorio chino ha estado de la cima de esa tabla, su Coding Index en 71,8 y su precio en $2.00 por millón de tokens de entrada y $6.00 por millón de tokens de salida.

Cómo se ve realmente un "lanzamiento" para un modelo de pesos abiertos
Una pregunta sobre fechas en un modelo cerrado es simple: la API se activa. Para un modelo de pesos abiertos, "lanzado" tiene capas, y cada capa aterriza con días de diferencia:
• Los pesos sin procesar aparecen como un repositorio de Hugging Face y ModelScope, con una tarjeta de modelo y un archivo LICENSE.
Los frameworks de inferencia siguen — se espera que vLLM y SGLang añadan soporte en cuestión de días, lo cual es la señal de que un modelo está listo para servir, no solo para descargarse.
• Las cuantizaciones de la comunidad (GGUF, AWQ) suelen llegar con una o dos semanas de retraso, que es cuando los usuarios de Ollama, LM Studio y llama.cpp pueden descargarlas y ejecutarlas.
Entonces, si la pregunta es "cuándo puedo descargar los pesos", la respuesta es un repositorio que aparece en la organización oficial de Qwen. Si la pregunta es "cuándo puedo ejecutarlo con un solo comando", añade una o dos semanas. La promesa del 3 de agosto apuntaba a la primera de esas para la semana del 10 de agosto — y esa capa ya ha llegado para un miembro de la generación: Qwen3.8-2.4T-A95B se publicó en Hugging Face esa semana. En cuanto al 27B específicamente, todavía no ha llegado a Hugging Face — pero la cuenta regresiva de ModelScope ahora indica un objetivo: 15 de agosto de 2026 a las 00:00 JST.
¿Qué sigue sin verificar?
Todo lo demás sobre el 27B es especulativo hasta que se publique el repositorio. No permitas que la cobertura confiada convierta proyecciones en especificaciones: nada de lo siguiente está confirmado al momento de escribir esto:
• Arquitectura — densa o de mezcla de expertos, y el número de parámetros activos si es MoE.
Límites de ventana de contexto, de salida, y si es solo de texto o multimodal. El teaser de ModelScope, según PC Watch, describe soporte multimodal y multilingüe nativo para imágenes y video — declarado por el proveedor en el teaser, aún sin verificar hasta que se publiquen los pesos.
• La licencia. Apache 2.0 no es una suposición segura; los lanzamientos abiertos recientes de Qwen se distribuyen bajo la licencia Tongyi Qianwen, que incluye una cláusula de 100 millones de usuarios activos mensuales que activa una discusión comercial más allá de ese umbral.
• Cualquier puntuación de benchmarks. Cada cifra que circula para la generación 3.8 es reportada por el proveedor para el Max; el 27B no tiene evaluaciones públicas en absoluto.
Tamaños cuantizados exactos. Las cifras de VRAM en circulación son proyecciones heredadas de Qwen3.6-27B, no mediciones del modelo 3.8.

Por qué la licencia importa más que la fecha
La fecha de lanzamiento determina cuándo puedes empezar a probar. La licencia determina si puedes distribuir. Un modelo Qwen bajo la licencia Tongyi Qianwen es de uso gratuito por debajo de 100 millones de usuarios activos mensuales — más allá de eso, se espera que discutas términos comerciales. Para un modelo local que los equipos integrarán en productos y agentes, ese umbral puede llegar más rápido de lo que parece. El primer archivo que se abre en el repositorio es la LICENCIA, antes de la tarjeta del modelo y antes del README.
Cómo atrapar la caída antes que las publicaciones del blog
La organización oficial de Qwen en Hugging Face es la fuente de verdad: cuando un repositorio llamado Qwen3.8-27B aparece allí, o en ModelScope, el lanzamiento se ha producido. El mecanismo ya se demostró esta semana: Qwen3.8-2.4T-A95B y su variante FP8 aparecieron en la organización exactamente de esa manera, así que el repositorio 27B será igual de inconfundible. En ModelScope, una página de cuenta regresiva para Qwen3.8-27B ya está activa, apuntando a la medianoche del 15 de agosto — lo más cercano a una fecha oficial hasta ahora. Tres señales anteriores que vale la pena observar:
• Un pull request de vLLM o SGLang que nombre a Qwen3.8-27B. Las PRs de frameworks suelen ser el primer rastro público de una liberación de pesos, porque el trabajo de integración comienza en cuanto se prepara el repositorio.
• Los propios canales del equipo de Qwen (X, WeChat, el blog de qwen.ai), que suelen anunciar el lanzamiento en sí.
• Cuantizadores de la comunidad — Unsloth y otros suelen publicar archivos cuantizados y mediciones reales de VRAM en cuestión de días, lo que convierte las proyecciones anteriores en números medibles.
Una advertencia se aplica en todo momento: antes de que la organización oficial publique, cualquier "Qwen3.8-27B" que puedas descargar es o un marcador de posición o una subida de terceros. El nombre por sí solo no es autenticidad.
Lo que puedes usar hoy
El 27B es el modelo que hay que esperar, no la única opción de esta generación. Qwen3.8-Max ya está disponible —y también es autoalojable, ya que sus pesos se pueden descargar— y en OrcaRouter se factura al precio de lista del proveedor: 2,00 $ por millón de tokens de entrada y 6,00 $ por millón de tokens de salida, sin margen adicional, así que el precio que figura en la propia página de precios del proveedor es el precio que pagas. Una sola clave da acceso a él, y cuando el 27B salga y se gane la confianza en los benchmarks públicos, la misma clave enrutará también hacia él. Para un equipo que quiera construir hoy sobre esta generación manteniendo la opción de un 27B autoalojado más adelante, ese es el camino con menos dependencia que existe.

El resumen sin rodeos: la respuesta sobre la fecha de lanzamiento está más clara que hace una semana. La ventana que dio Alibaba — la semana del 10 de agosto de 2026 — llegó y se fue. Entregó los pesos del buque insignia: Qwen3.8-2.4T-A95B y su cuantización oficial FP8 están ya en Hugging Face. No entregó los del 27B — pero el retraso ahora tiene un objetivo: la cuenta atrás de ModelScope llega hasta la medianoche del 15 de agosto de 2026 (00:00 JST, según PC Watch). Vigila la organización oficial Qwen en Hugging Face y la página de Qwen en ModelScope, lee la LICENCIA en cuanto el repositorio del 27B aterrice, y trata toda especificación y cifra de VRAM que circule como una proyección hasta que los pesos permitan medirlas.
