
Solar Mini 4 vs Qwen3.8-Max: lo que realmente costaron los últimos veinte puntos de índice
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 por 1M de tokens · 159 tok/s
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 220 tok/s
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAINUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
Solar Mini 4 cuesta $0.10 por millón de tokens de entrada y $0.40 por millón de tokens de salida. Qwen3.8-Max, el modelo al que se refiere la mayoría de la gente cuando escribe “Qwen 3.8” y pide la API, cuesta $2.00 y $6.00. En una tabla de tarifas, eso se lee como una diferencia de veinte veces en el precio de entrada. En la evaluación independiente por la que ambos modelos ya han pasado, la cifra honesta es que Qwen3.8-Max obtiene 45.4 en el Artificial Analysis Intelligence Index frente al 24.1 de Solar Mini 4 —aproximadamente el doble de la capacidad medida— mientras que cuesta alrededor de quince veces más por tarea completada. Todo lo que merece la pena saber sobre esta comparación está en la brecha entre esas dos proporciones, y en el hecho de que el modelo de Upstage funciona a 204 tokens por segundo mientras que el buque insignia de Alibaba lo hace a 39.
Una nota sobre la nomenclatura antes de las cifras, porque cambia lo que estás comprando. Qwen 3.8 es una generación, no un modelo: el buque insignia alojado es Qwen3.8-Max, actualizado como una instantánea con fecha 0902, y el miembro descargable de la misma generación es Qwen3.8-2.4T-A95B, los pesos de 2,4 billones de parámetros que Alibaba publicó el 12 de agosto de 2026. Solar Mini 4, lanzado el 22 de septiembre de 2026, es la mezcla de expertos dispersa de 35.000 millones de parámetros de Upstage, con unos 3.000 millones de parámetros activos por token y sin pesos abiertos a ningún precio.
Las dos columnas, en las dimensiones que deciden la adquisición
• Intelligence Index — 45,4 para Qwen3.8-Max (0902) frente a 24,1 para Solar Mini 4, ambos Intelligence Index v4.3.2.
• Costo por tarea completada $5.41 por Qwen3.8-Max frente a $0.36 por Solar Mini 4. Aproximadamente quince a uno, y la cifra que nadie menciona.
• Tarifa — $2.00 / $6.00 por millón de tokens, entrada en caché $0.25, para Qwen3.8-Max frente a $0.10 / $0.40, entrada en caché $0.01, para Solar Mini 4.
• Contexto — 1.000.000 de tokens en ambos, que es la única dimensión en la que el modelo barato no cede nada. Artificial Analysis indica 983.616 para Qwen3.8-Max y 1.048.576 para Solar Mini 4; la propia documentación de Upstage dice 512K, así que el techo del modelo pequeño es el menos seguro de los dos.
• Pesos — Qwen3.8-Max es propietario alojado; su hermano abierto Qwen3.8-2.4T-A95B se puede descargar bajo una licencia personalizada y obtiene 39,9 en el mismo índice con 262.000 tokens de contexto. Solar Mini 4 es propietario y no tiene hermano abierto.
• Rendimiento — 204 tokens de salida por segundo para Solar Mini 4 frente a 39,5 de Qwen3.8-Max, según las mediciones del mismo laboratorio. El modelo que cuesta una decimoquinta parte por tarea es cinco veces más rápido al realizarla.
Qué compran veintiún puntos de índice

Compran el extremo difícil de la distribución. En Humanity's Last Exam, Qwen3.8-Max responde correctamente al 43,1 % de los ítems frente al 25,8 % de Solar Mini 4. En programación científica, es del 52,1 % frente al 47,6 %. En el trabajo de conocimiento agéntico, la brecha se amplía hasta convertirse en una categoría distinta: Qwen3.8-Max alcanza 1663 Elo en GDPval-AA, donde Solar Mini 4 logra 1072 —casi seiscientos puntos Elo, lo cual no es una diferencia de redondeo, sino un cambio en lo que se puede confiar que el modelo haga sin supervisión.
La única evaluación en la que el modelo pequeño no solo se mantiene firme, sino que gana, es el razonamiento de contexto largo. Solar Mini 4 obtiene un 83,3 % en AA-LCR v1.1 y Qwen3.8-Max obtiene un 80,3 %. Ese es el argumento más fuerte a favor de Solar Mini 4 en toda esta comparación: en la prueba comparativa creada para evaluar «leer un documento muy largo y razonar a lo largo de todo él», pagar quince veces el precio por tarea arroja un resultado que es tres puntos peor.
El ámbito donde ninguno de los dos modelos es el instrumento adecuado es el trabajo autónomo en terminal. Solar Mini 4 obtiene un 1 % en Terminal-Bench 4.0; Qwen3.8-Max obtiene un 38,9 %. Un modelo que supera ocho de veinte tareas difíciles de terminal es realmente utilizable ahí, y el otro no, lo que constituye el ejemplo más claro en esta comparación de una diferencia de naturaleza, no de grado.
Por qué la factura por tarea del modelo insignia es mucho peor de lo que sugiere su precio por token
Qwen3.8-Max emite más salida por tarea que Solar Mini 4 —107.700 tokens frente a 88.300— y las emite a 6,00 $ por millón en lugar de 0,40 $. Ahí está ya la mayor parte de la diferencia, antes incluso de considerar el comportamiento de la caché. Alibaba sí ofrece una tarifa de 0,25 $ para la entrada en caché, lo que supone un descuento real frente a su precio de entrada de 2,00 $, y el hermano abierto de la familia, Qwen3.8-2.4T-A95B, es un modelo disperso de 2,4 billones de parámetros con unos 95.000 millones de parámetros activos, así que cada token que produce lo produce una máquina sustancialmente más grande. Nada de esto es una crítica. Es la razón por la que existe un multiplicador de quince veces por tarea, y la razón por la que una comparación de precios por token entre estos dos modelos es engañosa en ambos sentidos.
La consecuencia práctica: Solar Mini 4 no es "el Qwen 3.8 económico". Es un especialista que resulta ser barato, rápido y fuerte en exactamente un eje —documentos largos— y débil en el eje en el que equivocarse cuesta más, que es la fiabilidad agéntica. Qwen3.8-Max es el generalista cuya ventaja se manifiesta precisamente donde una respuesta incorrecta es costosa.
Ejecutar el par en lugar de elegir entre ellos
Este es el caso inusual en la serie Solar Mini 4 en el que ambos lados de la comparación son rutas que realmente podemos venderle. Qwen3.8-Max y su instantánea fechada 0902 se encuentran en OrcaRouter con la tarifa de lista del propio proveedor de $2.00 / $6.00, junto con Qwen3.8-Flash a $0.15 / $0.47 y Qwen3.8-27B a $0.33 / $2.40 — tres niveles de la misma generación, una sola clave, sin un segundo contrato y sin ningún cambio de código más allá de una cadena de modelo. A partir del 1 de octubre de 2026, nuestra propia medición en el playground sitúa a Qwen3.8-Max en un p50 de 2.5 segundos con 87.7 tokens de salida por segundo durante los últimos siete días; esa ventana es móvil, así que consulte la ficha del modelo en vivo en lugar de esta frase. Los modelos de Upstage no están disponibles a través de nosotros, y a Solar Mini 4 hay que acceder mediante la propia API de Upstage.

Lo que eso hace posible es la división por la que aboga esta comparación: enviar el tráfico de documentos largos, en coreano y de extracción estructurada a algún lugar barato, enrutar las solicitudes con mucha carga de razonamiento y uso de herramientas al modelo insignia, y dejar que la conmutación por error cubra al proveedor que tiene una mala tarde. También es donde el DSL de enrutamiento se gana su lugar: componer modelos en una sola llamada significa que una primera pasada barata y una pasada de verificación costosa pueden ser una sola solicitud contra un solo endpoint en lugar de dos integraciones que deben mantenerse sincronizadas.
La versión corta

Si tu carga de trabajo es de contexto largo, una forma de salida fija y un presupuesto de latencia tolerable, Solar Mini 4 te ofrece el 83 % del resultado de contexto largo a una quinceava parte del coste de la tarea y cinco veces el rendimiento, y los veintiún puntos de índice faltantes nunca aparecerán en tu panel de control. Si tu carga de trabajo implica herramientas, agentes de múltiples pasos o preguntas en las que una respuesta incorrecta pero segura es peor que no tener respuesta, los puntos faltantes son todo el producto y Qwen3.8-Max vale quince veces el precio. Toda cifra atribuida anteriormente a Artificial Analysis es una medición independiente de esa organización; la nomenclatura y las fechas de lanzamiento de Qwen3.8 son de Alibaba, y las cifras de servicio de OrcaRouter son nuestra propia medición de playground en una ventana móvil de siete días.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
