
Solar Mini 4 vs Gemma 4 12B: un checkpoint que descargas y un modelo que invocas
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
La comparación honesta más breve entre Solar Mini 4 y Gemma 4 12B es que uno de ellos es un archivo y el otro es un endpoint. Solar Mini 4 de Upstage es un modelo de mezcla de expertos de 35 mil millones de parámetros con 3 mil millones de parámetros activos por token, una ventana de contexto de 512.000 tokens y sin pesos abiertos: se accede a él a través de Upstage Console, el Playground o una implementación local que acuerdes con el proveedor. Gemma 4 12B es un checkpoint denso de 11,95 mil millones de parámetros bajo Apache 2.0, descargable hoy, que se ejecuta en aproximadamente 16 GB de memoria unificada en un portátil. Ambos están diseñados para trabajo agéntico, ambos toman un documento largo como entrada y no compiten por el mismo lugar en tu stack, porque uno de ellos tiene una factura de memoria y el otro una factura de tokens.
Esa distinción se pierde porque los dos modelos se parecen en una lista de características. Ambos razonan, ambos llaman a herramientas, ambos emiten salida estructurada, ambos manejan inglés, coreano y japonés. Las diferencias que deciden la cuestión están en otro lugar: qué sucede a las 3 a.m. cuando el sistema está caído, qué dice tu equipo de cumplimiento sobre dónde residen los datos, y si pagas por token o por hora de GPU.
El contraste de especificaciones, dimensión por dimensión
• Arquitectura — Solar Mini 4 es disperso: 35B parámetros totales, 3B activos por token. Gemma 4 12B es denso: cada uno de sus 11,95B parámetros se ejecuta en cada token. Solar almacena diez veces la cantidad de pesos y calcula con una cuarta parte de ellos; Gemma almacena una cuarta parte y calcula con todos ellos.
• Dónde se ejecuta: Solar Mini 4 se ejecuta en la infraestructura de Upstage (Console, Playground) o en tu propio entorno bajo un acuerdo on-premises. Gemma 4 12B se ejecuta en tu hardware: alrededor de 16 GB de memoria unificada a precisión completa, cerca de 8 GB a 4 bits, y cabe en una sola GPU de consumo o en un portátil de la serie M.
• Pesos — Apache 2.0 para Gemma 4 12B, lo que implica uso comercial, modificación y redistribución sin umbral de ingresos. Cerrado para Solar Mini 4. Upstage ya ha publicado pesos abiertos antes, pero nada en este lanzamiento indica que tenga previsto hacerlo aquí.
• Contexto — 512.000 tokens para Solar Mini 4, con hasta 128.000 tokens de salida. Gemma 4 12B tiene 256.000 tokens, y Artificial Analysis indica 260 K en su página del modelo. Solar es el de mayor longitud de los dos, y la diferencia no es marginal.
• Modalidades — Gemma 4 12B es multimodal sin codificador: los parches de imagen y el audio de 16 kHz se proyectan directamente en el espacio de incrustación del modelo de lenguaje, por lo que acepta texto, imagen, audio y video y devuelve texto. Solar Mini 4 es texto de entrada, texto de salida. Esta es la única dimensión donde Gemma gana de manera contundente y por mucho.
• Precio — Solar Mini 4 tiene un precio de lista de $0.10 por millón de tokens de entrada y $0.40 por millón de salida, con entrada en caché a $0.01; una promoción de lanzamiento del 50 % estará vigente hasta el 22 de octubre de 2026. Gemma 4 12B no cuesta nada descargarlo, y Artificial Analysis incluyó la inferencia alojada a $0.10 de entrada y $0.30 de salida por millón cuando se capturó su página el 22 de septiembre de 2026.
• Fecha de corte de conocimiento — febrero de 2026 para Solar Mini 4; Gemma 4 12B se lanzó el 3 de junio de 2026 con una fecha de corte de conocimiento de enero de 2025. Ambos están tan desactualizados que la recuperación no es opcional.
• Puntuaciones independientes: Solar Mini 4 aún no tiene ninguna, un día después de su lanzamiento. Gemma 4 12B registra un Índice de Inteligencia de Artificial Analysis de 14, ocupa el puesto 22 de los 142 modelos monitoreados en su clase, con 112,7 tokens de salida por segundo.
¿Para qué sirve realmente Gemma 4 12B?

Gemma 4 12B existe para poner un modelo multimodal capaz en un lugar que tú controlas. El posicionamiento de Google en su lanzamiento fue que se acerca al propio modelo de mezcla de expertos de 26B de la compañía con menos de la mitad de la memoria, y que supera al Gemma 3 27B de la generación anterior en tareas de razonamiento, ciencia y documentos. Las cifras reportadas por el proveedor que respaldan esa afirmación son sólidas para el tamaño: 77,2 % en MMLU-Pro, 78,8 % en GPQA Diamond, 94,9 en DocVQA y 88,4 en InfoVQA, todas cifras del propio Google y no reproducidas de forma independiente.
La interesante decisión de ingeniería es que Gemma 4 12B no tiene codificadores de visión o audio separados. Los parches de imagen se proyectan en el espacio de embeddings del modelo mediante una única multiplicación de matrices; el audio sin procesar entra de la misma manera. Eso elimina el costo de memoria y latencia de ejecutar dos torres adicionales junto al modelo de lenguaje, y es la razón por la que un modelo multimodal cabe en 16 GB. También significa que el modelo de lenguaje absorbe el trabajo que habrían hecho los codificadores, lo cual es una compensación real para el detalle visual fino.
Para el trabajo con agentes, la consecuencia práctica es que Gemma 4 12B es el único de estos dos modelos que puede leer una captura de pantalla, una página escaneada o una nota de voz como parte del bucle. Si el trabajo de tu agente implica mirar algo, la comparación termina antes de empezar.
Para qué sirve realmente el Solar Mini 4
Solar Mini 4 está orientado al caso opuesto: trabajo de alta frecuencia y sensible al costo, donde la entrada es texto y el volumen es grande. La propia descripción de Upstage es «la velocidad de respuesta y el costo importan», y la cifra de 3B de parámetros activos es el mecanismo. Un modelo disperso con esta proporción es barato de servir, y por eso Upstage puede ofrecer $0.10 por millón de tokens de entrada para algo con una ventana de 512K.
El contexto de 512K es el arma más afilada. Es la misma cifra que Upstage incluye en Solar Pro 4, su buque insignia, lo que significa que el modelo compacto no se queda corto en capacidad de documentos — un contrato de 400 páginas, un código base completo, un año de tickets de soporte. Los 256K de Gemma 4 12B son generosos según cualquier estándar normal y la mitad de los de Solar según este.
El razonamiento es algo nuevo en la línea Mini. Los modelos solar-mini de la generación anterior ignoran por completo un parámetro reasoning_effort; Solar Mini 4 sí acepta uno, y las herramientas de agentes de terceros se han actualizado para tratarlo como capaz de razonar en lugar de incluirlo en listas de denegación. Upstage también lanzó Solar Jev el mismo día, un endpoint de decisión en fase beta servido en Solar Mini 4 que devuelve una opción, una puntuación o una probabilidad sin texto alguno — una señal sobre para qué cargas de trabajo cree Upstage que está destinado este modelo.
Lo que Solar Mini 4 no tiene, al momento de escribir esto, es un solo número independiente. Tampoco tiene un Intelligence Index, ni una posición en Agent Arena, ni una tabla de benchmarks de Upstage: la entrada del changelog incluye especificaciones y ninguna puntuación. La única cifra más o menos de terceros que circula es una ejecución test400 autoinformada de un wrapper de la comunidad, juzgada por otro modelo bajo una rúbrica declarada, en la que Solar Mini 4 obtuvo un 98,4% de precisión de campo con reasoning_effort=none y un promedio de 1,21 segundos por llamada. Esa es la comparación de un desarrollador con su propio arnés, y no es motivo para tomar una decisión de producción.
La comparación que lo decide

Si tienes GPUs y una razón para mantener los datos internamente, Gemma 4 12B en realidad no compite con Solar Mini 4 en absoluto: compite con tu factura de electricidad. Lo descargas una vez, lo ejecutas para siempre, no pagas nada por token y obtienes entrada multimodal que Solar Mini 4 no ofrece a ningún precio. Los costes que aparecen después son operativos: alguien tiene que encargarse del stack de servicio, alguien tiene que gestionar la actualización cuando Google lance el siguiente, y tu rendimiento está limitado por el hardware que hayas comprado.
Si no tienes GPUs, o sí las tienes y la carga de trabajo es irregular, Solar Mini 4 es la opción sin coste de capital. Pagas $0.05 por millón de tokens de entrada durante la promoción de lanzamiento y $0.10 después, obtienes el doble de ventana de contexto y cuentas con un SLA del proveedor en lugar de un buscapersonas. Lo que sacrificas son los pesos, la entrada multimodal y cualquier capacidad de responder a la pregunta «qué pasa con mis datos» con «nunca salen de este edificio».
La comparación de precios es más reñida de lo que sugiere el titular y vale la pena hacerla con cuidado. A precio de lista, Solar Mini 4 y Gemma 4 12B alojado cuestan lo mismo en entrada ($0.10) y Gemma es más barato en salida ($0.30 frente a $0.40). Durante la promoción de Upstage, Solar cuesta la mitad de eso en ambos. Si tu carga de trabajo es intensiva en entrada —documentos largos, respuestas cortas—, los dos están efectivamente empatados a precio de lista y Solar es más barato hoy. Si es intensiva en salida, Gemma es más barato a menos que la promoción esté vigente.
Ejecutar cualquiera de los dos sin reconstruir tu stack
La parte incómoda de esta decisión es que no es obviamente reversible. Descargar Gemma 4 12B te compromete con un stack de servicio; adoptar Solar Mini 4 te compromete con una forma de API. Elijas lo que elijas, el costo de cambio es lo que te impide volver a evaluar dentro de seis meses, y la razón honesta para mantener un enrutador en la ecuación es mantener ese costo cerca de cero.
Una cosa en la que hay que ser precisos: OrcaRouter no enruta ningún modelo de Upstage, así que Solar Mini 4 no está disponible aquí — proviene de la propia API de Upstage y de varias plataformas de terceros. Sí enrutamos los tamaños más grandes de Gemma 4 de Google, el 26B-A4B y el 31B, pero no el checkpoint de 12B del que trata este artículo. En este contexto, la plataforma sirve en realidad para la comparación que haces después de esta: una vez que hayas decidido "modelo de agente compacto, texto de entrada", la pregunta interesante pasa a ser cuál de ellos, y esa es una pregunta que respondes poniendo tres de ellos detrás de una sola clave y midiendo con tu propio tráfico en lugar de leer otra ficha técnica. Un DSL de enrutamiento que compone varios modelos en una única llamada es la forma de ejecutar esa prueba sin escribir tres integraciones.

¿Cuál elegir?
Elige Gemma 4 12B si tienes el hardware, si tu agente necesita mirar imágenes o escuchar audio, si necesitas los pesos para ajuste fino, o si la respuesta a «¿a dónde van los datos?» tiene que ser «a ninguna parte». Elige Solar Mini 4 si no quieres ejecutar inferencia, si tus entradas son texto largo y tus salidas son cortas, si una ventana de 512K importa, o si necesitas un modelo centrado en coreano con un contrato de proveedor que lo respalde.
Si estás indeciso, el desempate no es un benchmark. Es la pregunta que aún no puedes responder sobre Solar Mini 4: nadie fuera de Upstage lo ha medido. Gemma 4 12B tiene un Intelligence Index de 14 y un ranking público; Solar Mini 4 tiene una hoja de especificaciones, un precio y una promoción que vence el 22 de octubre. Probarlo te cuesta unos pocos dólares durante esa ventana. Apostar una ruta de producción basada en él te cuesta una reescritura si los números, cuando lleguen, son desfavorables.
