Carton-titre indiquant « Solar Mini 4 vs Gemma 4 12B », avec le sous-titre « Un checkpoint que vous téléchargez et un modèle que vous appelez », sur un dégradé du bleu au bleu sarcelle avec le logo OrcaRouter en bas à droite.
Guides & Insights

Solar Mini 4 vs Gemma 4 12B : un checkpoint que vous téléchargez et un modèle que vous appelez

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

La comparaison honnête la plus brève de Solar Mini 4 et Gemma 4 12B, c’est que l’un est un fichier et l’autre un point de terminaison. Solar Mini 4 d’Upstage est un modèle mixture-of-experts de 35 milliards de paramètres, avec 3 milliards de paramètres actifs par token, une fenêtre de contexte de 512 000 tokens et aucun poids ouvert — vous y accédez via la Upstage Console, le Playground ou un déploiement sur site que vous organisez avec le fournisseur. Gemma 4 12B est un checkpoint dense de 11,95 milliards de paramètres sous Apache 2.0, téléchargeable dès aujourd’hui, qui tourne dans environ 16 Go de mémoire unifiée sur un ordinateur portable. Les deux sont conçus pour le travail agentique, les deux prennent un long document en entrée, et ils ne se disputent pas la même place dans votre stack, parce que l’un a une facture de mémoire et l’autre une facture de tokens.

Cette distinction se perd parce que les deux modèles se ressemblent sur une liste de fonctionnalités. Tous deux raisonnent, tous deux appellent des outils, tous deux produisent une sortie structurée, tous deux gèrent l'anglais, le coréen et le japonais. Les différences qui tranchent la question se situent ailleurs : ce qui se passe à 3 h du matin quand le système est en panne, ce que dit votre équipe de conformité sur l'endroit où résident les données, et si vous payez au token ou à l'heure de GPU.

Le contraste des spécifications, dimension par dimension

• Architecture — Solar Mini 4 est clairsemé : 35 B de paramètres au total, 3 B actifs par token. Gemma 4 12B est dense : chacun de ses 11,95 B de paramètres est exécuté sur chaque token. Solar stocke dix fois plus de poids et calcule avec un quart d’entre eux ; Gemma en stocke un quart et calcule avec la totalité.

• Où il s'exécute — Solar Mini 4 s'exécute sur l'infrastructure d'Upstage (Console, Playground) ou dans votre propre environnement dans le cadre d'un déploiement sur site. Gemma 4 12B s'exécute sur votre matériel : environ 16 Go de mémoire unifiée en pleine précision, plus près de 8 Go en 4 bits, et il tient sur un seul GPU grand public ou un ordinateur portable de la série M.

• Poids — Apache 2.0 pour Gemma 4 12B, ce qui signifie utilisation commerciale, modification et redistribution sans seuil de revenus. Fermé pour Solar Mini 4. Upstage a déjà publié des poids ouverts par le passé, mais rien dans cette annonce n'indique qu'elle prévoit de le faire ici.

• Contexte — 512 000 tokens pour Solar Mini 4, avec jusqu’à 128 000 tokens de sortie. Gemma 4 12B est à 256 000 tokens, Artificial Analysis indiquant 260 K sur sa page de modèle. Solar est le plus long des deux, et l’écart n’est pas marginal.

• Modalités — Gemma 4 12B est multimodal sans encodeur : les patchs d'image et l'audio à 16 kHz sont projetés directement dans l'espace d'embedding du modèle de langage, de sorte qu'il prend en entrée du texte, des images, de l'audio et de la vidéo et renvoie du texte. Solar Mini 4 fonctionne en texte entrant, texte sortant. C'est la seule dimension où Gemma l'emporte nettement et de loin.

• Prix — Solar Mini 4 s'affiche à 0,10 $ par million de jetons d'entrée et 0,40 $ par million de jetons de sortie, avec les entrées mises en cache à 0,01 $ ; une promotion de lancement de 50 % court jusqu'au 22 octobre 2026. Gemma 4 12B est gratuit à télécharger, et Artificial Analysis indiquait une inférence hébergée à 0,10 $ en entrée et 0,30 $ en sortie par million lorsque sa page a été capturée le 22 septembre 2026.

• Date de coupure des connaissances — février 2026 pour Solar Mini 4 ; Gemma 4 12B est sorti le 3 juin 2026 avec une date de coupure des connaissances de janvier 2025. Les deux sont suffisamment obsolètes pour que la récupération ne soit pas facultative.

• Scores indépendants — Solar Mini 4 n'en a encore aucun, un jour après sa sortie. Gemma 4 12B affiche un Artificial Analysis Intelligence Index de 14, classé 22e sur les 142 modèles suivis dans sa catégorie, à 112,7 jetons de sortie par seconde.

À quoi sert réellement Gemma 4 12B

Screenshot of Artificial Analysis’s model page for Gemma 4 12B, showing its Intelligence Index score, its rank among the models tracked in its class, and its output speed.

Gemma 4 12B existe pour mettre un modèle multimodal performant là où vous gardez le contrôle. Le positionnement de Google au lancement était qu'il s'approche de son propre modèle à mélange d'experts 26B avec moins de la moitié de la mémoire, et qu'il surpasse le Gemma 3 27B de la génération précédente sur les tâches de raisonnement, de science et de documents. Les chiffres rapportés par le fournisseur à l'appui de cette affirmation sont solides pour la taille : 77,2 % sur MMLU-Pro, 78,8 % sur GPQA Diamond, 94,9 sur DocVQA et 88,4 sur InfoVQA, tous des chiffres de Google et non reproduits indépendamment.

La décision d'ingénierie intéressante, c'est que Gemma 4 12B n'a pas d'encodeurs visuels ou audio distincts. Les patchs d'image sont projetés dans l'espace d'enchâssement du modèle par une seule multiplication matricielle ; l'audio brut passe de la même manière. Cela élimine le coût en mémoire et en latence lié à l'exécution de deux tours supplémentaires aux côtés du modèle de langage, et c'est pourquoi un modèle multimodal tient dans 16 Go. Cela signifie aussi que le modèle de langage absorbe le travail qu'auraient effectué les encodeurs, ce qui constitue un véritable compromis pour le détail visuel fin.

Pour le travail d'agent, la conséquence pratique est que Gemma 4 12B est le seul de ces deux modèles à pouvoir lire une capture d'écran, une page numérisée ou une note vocale dans le cadre de la boucle. Si le travail de votre agent implique de regarder quelque chose, la comparaison est terminée avant même d'avoir commencé.

À quoi sert réellement le Solar Mini 4

Solar Mini 4 vise le cas inverse : un travail à haute fréquence et sensible aux coûts, où l'entrée est du texte et le volume est important. La description d'Upstage est « la vitesse de réponse et le coût comptent », et le nombre de paramètres actifs de 3B en est le mécanisme. Un modèle sparse à ce ratio est peu coûteux à servir, ce qui explique pourquoi Upstage peut afficher 0,10 $ par million de jetons d'entrée pour quelque chose doté d'une fenêtre de 512K.

Le contexte de 512K est l’arme la plus affûtée. C’est le même chiffre qu’Upstage propose sur Solar Pro 4, son modèle phare, ce qui signifie que le modèle compact n’est pas lésé en matière de capacité documentaire — un contrat de 400 pages, une base de code complète, une année de tickets de support. Le 256K de Gemma 4 12B est généreux selon toute norme habituelle, et ne représente que la moitié de celui de Solar selon ce critère-ci.

Le raisonnement est une nouveauté dans la gamme Mini. Les modèles solar-mini de la génération précédente ignorent purement et simplement un paramètre reasoning_effort ; Solar Mini 4 en accepte un, et l’outillage d’agents tiers a été mis à jour pour le considérer comme capable de raisonnement plutôt que de l’inscrire sur une liste de refus. Upstage a également lancé Solar Jev le même jour, un point de terminaison de décision bêta servi sur Solar Mini 4 qui renvoie un choix, un score ou une probabilité sans la moindre prose — un signal sur les charges de travail auxquelles Upstage destine ce modèle.

Ce que Solar Mini 4 n'a pas, à l'heure où ces lignes sont écrites, c'est un seul chiffre indépendant. Ni d'Intelligence Index, ni de place dans l'Agent Arena, ni de tableau de benchmarks provenant d'Upstage non plus — l'entrée du changelog contient des spécifications et aucun score. La seule donnée à peu près tierce en circulation est le run test400 auto-déclaré d'un wrapper communautaire, jugé par un autre modèle selon une grille d'évaluation énoncée, dans lequel Solar Mini 4 a obtenu 98,4 % de précision sur les champs à reasoning_effort=none, avec une moyenne de 1,21 seconde par appel. Ce n'est là que la comparaison d'un développeur avec son propre harnais, et ce n'est pas une raison pour changer une décision de production.

La comparaison qui tranche

Screenshot of Upstage’s pricing page listing Solar Mini 4’s input, cached input and output rates alongside the launch promotion window.

Si vous disposez de GPU et d'une raison de garder les données en interne, Gemma 4 12B n'entre pas vraiment en concurrence avec Solar Mini 4 — il entre en concurrence avec votre facture d'électricité. Vous le téléchargez une fois, vous l'exécutez pour toujours, vous ne payez rien par token, et vous obtenez une entrée multimodale que Solar Mini 4 ne propose à aucun prix. Les coûts qui apparaissent plus tard sont opérationnels : quelqu'un doit être responsable de la pile de service, quelqu'un doit gérer la mise à niveau quand Google publie la suivante, et votre débit est plafonné par le matériel que vous avez acheté.

Si vous n’avez pas de GPU, ou si vous en avez et que la charge est en pics, Solar Mini 4 est celui sans coût d’investissement. Vous payez 0,05 $ par million de tokens d’entrée pendant la promotion de lancement et 0,10 $ ensuite, vous obtenez une fenêtre de contexte deux fois plus grande, et vous obtenez un SLA de fournisseur au lieu d’un bipeur. Ce à quoi vous renoncez, ce sont les poids, l’entrée multimodale et toute possibilité de répondre à la question « que deviennent mes données » par « elles ne quittent jamais ce bâtiment ».

La comparaison des tarifs est plus serrée que ne le suggère le titre, et elle mérite d'être menée attentivement. Au tarif catalogue, Solar Mini 4 et Gemma 4 12B hébergé coûtent la même chose en entrée (0,10 $) et Gemma est moins cher en sortie (0,30 $ contre 0,40 $). Pendant la promotion d'Upstage, Solar est à moitié prix dans les deux cas. Si votre charge de travail est intensive en entrée — documents longs, réponses courtes —, les deux sont pratiquement à égalité au tarif catalogue et Solar est moins cher aujourd'hui. Si elle est intensive en sortie, Gemma est moins cher, sauf si la promotion est en cours.

Exécuter l’un ou l’autre sans reconstruire votre stack

L’aspect délicat de cette décision, c’est qu’elle n’est manifestement pas réversible. Télécharger Gemma 4 12B vous engage dans une pile de service ; adopter Solar Mini 4 vous engage dans une forme d’API. Quel que soit votre choix, le coût de changement est ce qui vous empêche de réévaluer dans six mois, et la raison honnête de garder un routeur dans l’équation est de maintenir ce coût proche de zéro.

Une chose à laquelle il faut être précis : OrcaRouter ne route aucun modèle Upstage, donc Solar Mini 4 n'est pas disponible ici — il provient de l'API d'Upstage elle-même et de plusieurs plateformes tierces. Nous routons bien les grandes tailles de Gemma 4 de Google, les 26B-A4B et les 31B, mais pas le checkpoint 12B dont traite cet article. Ce à quoi sert réellement la plateforme dans ce contexte, c'est à la comparaison que vous ferez après celle-ci : une fois que vous avez décidé « modèle d'agent compact, entrée texte », la question intéressante devient de savoir lequel, et c'est une question à laquelle vous répondez en plaçant trois d'entre eux derrière une seule clé et en mesurant sur votre propre trafic plutôt qu'en lisant une autre fiche technique. Un DSL de routage qui compose plusieurs modèles en un seul appel, voilà comment vous menez ce test sans écrire trois intégrations.

OrcaRouter scoreboard comparing Solar Mini 4 and Gemma 4 12B across six dimensions: architecture, weights, context, input modalities, price per million tokens, and Artificial Analysis Intelligence Index.

Lequel choisir

Choisissez Gemma 4 12B si vous avez le matériel, si votre agent doit regarder des images ou écouter de l’audio, si vous avez besoin des poids pour le fine-tuning, ou si la réponse à « où vont les données » doit être « nulle part ». Choisissez Solar Mini 4 si vous ne voulez pas exécuter l’inférence, si vos entrées sont de longs textes et vos sorties courtes, si une fenêtre de 512K compte, ou si vous avez besoin d’un modèle privilégiant le coréen avec un contrat de fournisseur derrière lui.

Si vous êtes indécis, l'élément qui départage n'est pas un benchmark. C'est la question à laquelle vous ne pouvez pas encore répondre à propos de Solar Mini 4 : personne en dehors d'Upstage ne l'a mesuré. Gemma 4 12B a un Intelligence Index de 14 et un classement public ; Solar Mini 4 a une fiche technique, un prix et une promotion qui expire le 22 octobre. Le tester vous coûte quelques dollars pendant cette fenêtre. Miser une trajectoire de production dessus vous coûte une réécriture si les chiffres, lorsqu'ils arrivent, sont peu cléments.