
Solar Mini 4: el modelo de agente de 3B activos de Upstage, y el modelo silencioso con el que se lanzó
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Upstage lanzó dos cosas el 22 de septiembre de 2026, y la segunda es la razón para seguir leyendo después de la primera. Solar Mini 4 es el modelo: un checkpoint de mezcla de expertos de 35 mil millones de parámetros con 3 mil millones de parámetros activos por token, una ventana de contexto de 512,000 tokens, hasta 128,000 tokens de salida y un precio de lista de $0.10 por millón de tokens de entrada y $0.40 por millón de salida. Se puso en marcha en la Upstage Console, en el Playground y como despliegue on-premises, sin etiqueta de preview ni lista de espera. Ese es el lanzamiento, y es sensato. Lo otro que Upstage lanzó el mismo día fue Solar Jev, un endpoint de decisiones servido sobre Solar Mini 4 que no genera nada de prosa — devuelve una opción, una puntuación o una respuesta de sí/no con una probabilidad adjunta, en una sola pasada hacia adelante, y Upstage factura sus tokens de salida a cero. Uno de estos dos anuncios es un lanzamiento de modelo. El otro es una pequeña apuesta a que una clase útil de trabajo de agentes no quiere que un modelo de lenguaje hable.
¿Qué aterrizó realmente el 22 de septiembre?
La entrada del registro de cambios de Solar Mini 4 es breve y no se anda con rodeos. Nuevo modelo, ya disponible. El propio encuadre de Upstage es la eficiencia de costos para el trabajo agéntico "donde la velocidad de respuesta y el costo importan" — que es la frase que un laboratorio escribe cuando quiere que lo compares con algo tres veces más caro en lugar de con la frontera.

La hoja de especificaciones, según la página de historial de modelos de Upstage:
• Parámetros — 35B en total, 3B activos por token. Una mezcla de expertos dispersa, así que pagas por almacenar 35B y calcular con 3B. Upstage no desglosa cuántos expertos hay ni cómo se enrutan.
Contexto — 512.000 tokens, con un máximo de 128.000 tokens de salida. Ambas cifras son idénticas a las del buque insignia, que es la línea más interesante de la ficha.
• Fecha de corte del entrenamiento — febrero de 2026. Siete meses de desfase en el momento de su lanzamiento, lo cual es normal para un modelo de este tamaño y conviene saberlo antes de preguntarle sobre cualquier cosa reciente.
• Idiomas — inglés, coreano y japonés. Upstage lo describe como "coreano fluido con sólidas capacidades en inglés y japonés", que es el orden correcto para un laboratorio coreano y probablemente el orden correcto para el modelo.
• Capacidades: chat, razonamiento, salidas estructuradas y llamada a herramientas. El razonamiento supone un cambio respecto a la generación anterior: los modelos solar-mini más antiguos ignoran por completo un parámetro reasoning_effort, y Solar Mini 4 no.
• IDs de modelo — solar-mini4 es el alias y actualmente se resuelve en la instantánea fechada solar-mini4-260922. Un identificador solar-mini4-preview también ha estado circulando en herramientas de agentes de terceros, algo que conviene saber si estás escribiendo configuración de enrutamiento con una cadena de vista previa que podría no perdurar.
• Disponibilidad — Upstage Console, Playground y en las instalaciones. No hay pesos abiertos. Upstage ya ha publicado pesos abiertos anteriormente (Solar Open 2 se lanzó en una release de Hugging Face y su servicio de API finalizó el 12 de agosto de 2026), pero nada en Solar Mini 4 sugiere que ese sea el plan aquí.
Solar Jev es la parte sobre la que nadie va a escribir
Solar Jev está en beta en un nuevo endpoint POST /v1/systemone. Envías un fragmento de estado —un documento, una línea de registro, un ticket de soporte— junto con una lista de preguntas tipadas, y recibes como respuesta una opción de un conjunto que tú mismo proporcionaste, una puntuación según una rúbrica o una respuesta de sí/no, cada una con una probabilidad calibrada tomada directamente del modelo en lugar de estar redactada como texto.
La consecuencia de diseño es que no hay prosa. Sin explicación, sin cadena de pensamiento, sin preámbulo. Upstage dice que cada decisión es una única pasada hacia adelante y que los tokens de salida son gratuitos. Con una ventana de contexto de 512K, todo el estado — un contrato completo, una transcripción completa — puede ser la entrada.
Este es un producto más limitado de lo que parece a primera vista, y esa limitación es precisamente el punto. Un modelo que no escribe nada no puede escribir algo incorrecto. Si tu flujo de procesamiento actualmente le pide a un modelo de chat que devuelva un veredicto JSON y luego lo analiza, y has dedicado aunque sea algo de tiempo a protegerte contra que el modelo envuelva ese JSON en una frase amistosa, Solar Jev está dirigido directamente a ti. La contrapartida es que obtienes una probabilidad y ningún rastro de razonamiento, así que cuando se equivoca no tienes nada que leer.
Vale la pena ser precisos sobre lo que Solar Jev no es: no es un Solar Mini 4 más pequeño, y no es un ajuste fino que puedas descargar. Es un endpoint servido sobre Solar Mini 4, disponible en la Upstage Console, en beta. Beta es la palabra clave.
Cuánto cuesta y la cuenta atrás para el descuento
El precio de lista es de $0,10 por millón de tokens de entrada, $0,01 por millón de tokens de entrada en caché y $0,40 por millón de tokens de salida. Todas las cifras excluyen el 10 % de IVA.
Esos precios de lista no son lo que pagarás hoy. Upstage está ofreciendo un descuento de lanzamiento del 50 % que su propia página de precios fecha el 22 de octubre de 2026 (UTC) — los datos estructurados subyacentes de esa página indican que la ventana va desde el 22 de septiembre a las 05:00 UTC hasta el 23 de octubre a las 00:00 UTC, que es lo mismo dicho de dos maneras. Durante esa ventana, las tarifas son $0.05 de entrada, $0.005 en caché, $0.20 de salida.

Dos cosas se desprenden. Primero, si estás comparando el costo de esto con cualquier otra cosa, calcula el costo con ambos números, porque un descuento del 50% que vence en un mes no es un precio, es una promoción. Segundo, para poner en contexto dónde se ubica el precio de lista: la generación anterior de Solar Mini se lista a $0.15 por millón de tokens de entrada y salida, con un contexto de 32,768 tokens y sin ningún modo de razonamiento. Solar Mini 4 es más barato en entrada, más caro en salida, y te da dieciséis veces la ventana de contexto y un modo de razonamiento. Eso no es una actualización. Es un producto diferente con el mismo nombre.
Lo que nadie ha medido todavía
Solar Mini 4 tiene un día de vida y no cuenta con una evaluación independiente. No hay Artificial Analysis Intelligence Index, ni una posición en Agent Arena, ni ningún benchmark agéntico de terceros. Upstage tampoco ha publicado una tabla de benchmarks para él: la entrada del registro de cambios incluye especificaciones y ninguna puntuación. Cualquiera que te dé una cifra para este modelo está citando otra cosa.
Hay exactamente un punto de datos más o menos de terceros en circulación, y hay que etiquetarlo con cuidado porque no es ninguna de las dos cosas que parece ser. Un repositorio comunitario, hunkim/solar-mini4-jev, envuelve Solar Mini 4 detrás de una forma compatible con la API de decisiones TypeSafe Jev y publica su propia ejecución de test400, evaluada por otro modelo bajo una rúbrica declarada. En esa ejecución, Solar Mini 4 con reasoning_effort=none obtuvo una precisión de campos del 98.4% frente al 94.2% del propio wrapper, fallando 7 de 447 campos puntuados frente a 26; lideró tanto en coreano (98.8%) como en inglés (98.4%); y promedió 1.21 segundos por llamada frente a los 0.38 segundos del wrapper.
Lee eso por lo que es. No es un benchmark de proveedor — Upstage no lo publicó. No es una evaluación independiente — ningún organismo neutral la ejecutó, el harness es del propio competidor y el juez es un modelo. Es la comparación autodeclarada de un desarrollador de una API alojada frente a su propio wrapper, y el resumen honesto es que es la única señal disponible y que no debería, por sí sola, mover una decisión de producción. Sí sugiere dos cosas que vale la pena que pruebes tú mismo: que el modelo es lo bastante rápido para uso interactivo, y que su coreano es al menos tan fuerte como su inglés.
Cómo probarlo sin arriesgar un pipeline en ello
La parte incómoda de un modelo de un día de antigüedad y sin puntuaciones independientes es que la única manera de saber si encaja es enrutar tráfico real a través de él, y la única manera de hacerlo de forma segura es tener algún lugar adonde ese tráfico pueda ir cuando no encaje.
La conmutación por error es la respuesta honesta aquí, y es para lo que sirve una capa de enrutamiento. Colocas Solar Mini 4 detrás de un endpoint, mantienes el modelo que ya estás ejecutando como respaldo y dejas que el enrutador mueva el tráfico cuando el nuevo dé errores, se agote el tiempo de espera o empiece a devolver una salida estructurada que tu analizador rechaza. De esa manera, la primera semana de un modelo nuevo es un experimento con una red de seguridad debajo en lugar de un lanzamiento que tienes que defender.
Una corrección que conviene decir con claridad, porque es fácil dar a entender lo contrario: hoy OrcaRouter no enruta ningún modelo de Upstage. Solar Mini 4, Solar Pro 4 y Solar Jev están disponibles a través de la propia API de Upstage y de varias plataformas de terceros, y si quieres Solar Mini 4 en concreto, ahí es donde lo puedes conseguir. Lo que ofrecemos es una sola clave de API para los aproximadamente 190 modelos que sí enrutamos, lo cual resulta útil si el experimento que de verdad quieres hacer es «¿un modelo de agente compacto supera lo que ya tengo?» en lugar de «¿este modelo coreano en concreto supera lo que ya tengo?». Son preguntas distintas y solo una de ellas tiene una respuesta incorrecta.

La pregunta abierta
Upstage ya ha lanzado un modelo compacto y un modelo insignia con la misma ficha técnica de 512K/128K, con tres semanas de diferencia en los niveles de precios, y ha puesto un endpoint de decisión en el pequeño en lugar del grande. Ese orden es deliberado: Solar Jev se sirve en Solar Mini 4 porque una decisión que no genera prosa no necesita el razonamiento de un modelo insignia, y porque quieres el modelo barato cuando haces un millón de ellos.
Lo que aún no está claro es si 3B de parámetros activos bastan como razonamiento para trabajo agéntico que implica más que extracción. El marketing de Upstage dice agéntico. Los benchmarks de Upstage no dicen nada. Hasta que un organismo independiente lo ejecute —y, dada la fecha de lanzamiento, eso está, en el mejor de los casos, a semanas de distancia—, la postura correcta es probarlo en tu propia tarea, al precio promocional, con un fallback configurado, y tratar cualquier afirmación sobre su calidad agéntica, incluida la del proveedor, como una hipótesis.
