
Solar Mini 4 : le modèle d’agent à 3B actifs d’Upstage, et le modèle silencieux avec lequel il a été livré
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Upstage a publié deux choses le 22 septembre 2026, et c'est la seconde qui justifie de continuer la lecture au-delà de la première. Solar Mini 4 est le modèle : un point de contrôle mixture-of-experts de 35 milliards de paramètres avec 3 milliards de paramètres actifs par token, une fenêtre de contexte de 512 000 tokens, jusqu'à 128 000 tokens en sortie, et un prix catalogue de 0,10 $ par million de tokens en entrée et de 0,40 $ par million en sortie. Il est disponible sur la Upstage Console, dans le Playground, et en déploiement sur site, sans étiquette d'aperçu ni liste d'attente. Voilà pour le lancement, et il est tout à fait sensé. L'autre chose qu'Upstage a livrée le même jour, c'était Solar Jev, un point de terminaison de décision servi par-dessus Solar Mini 4 qui ne génère aucune prose — il renvoie un choix, un score ou une réponse oui/non assortie d'une probabilité, en une seule passe avant, et Upstage facture ses tokens de sortie à zéro. L'une de ces deux annonces est la sortie d'un modèle. L'autre est un petit pari : qu'une catégorie utile de travail d'agent ne souhaite pas qu'un modèle de langage parle.
Qu'est-ce qui a réellement atterri le 22 septembre
L’entrée du changelog pour Solar Mini 4 est courte et sans détour. Nouveau modèle, désormais disponible. La présentation qu’Upstage en fait est celle de l’efficacité économique pour le travail agentique « où la vitesse de réponse et le coût comptent » — la phrase qu’un laboratoire écrit lorsqu’il veut vous faire le comparer à quelque chose trois fois plus cher plutôt qu’à la frontière.

La fiche technique, selon la page d'historique des modèles d'Upstage :
• Paramètres — 35B au total, 3B actifs par token. Un mélange d’experts sparse, donc vous payez pour stocker 35B et calculez avec 3B. Upstage ne précise pas combien d’experts il y a ni comment ils sont routés.
• Contexte — 512 000 tokens, avec un maximum de 128 000 tokens en sortie. Ces deux chiffres sont identiques à ceux du modèle phare, ce qui est la ligne la plus intéressante de la fiche.
• Date de coupure des données d’entraînement — février 2026. Sept mois d’ancienneté au moment de la sortie, ce qui est normal pour un modèle de cette taille et bon à savoir avant de l’interroger sur des sujets récents.
• Langues — anglais, coréen et japonais. Upstage le décrit comme « un coréen courant avec de solides capacités en anglais et en japonais », ce qui est l’ordre correct pour un laboratoire coréen et probablement l’ordre correct pour le modèle.
• Capacités — conversation, raisonnement, sorties structurées et appel d’outils. Le raisonnement constitue un changement par rapport à la génération précédente : les anciens modèles solar-mini ignorent complètement un paramètre reasoning_effort, et Solar Mini 4 ne l’ignore pas.
• ID de modèle — solar-mini4 est l’alias, et il correspond actuellement à l’instantané daté solar-mini4-260922. Un identifiant solar-mini4-preview a aussi circulé dans des outils d’agent tiers, ce qu’il est utile de savoir si vous écrivez une configuration de routage en vous appuyant sur une chaîne d’aperçu qui pourrait ne pas perdurer.
• Disponibilité — Console Upstage, Playground et sur site. Aucun poids ouvert. Upstage a déjà publié des poids ouverts par le passé (Solar Open 2 est sorti dans le cadre d'une publication sur Hugging Face et son service d'API a pris fin le 12 août 2026), mais rien à propos de Solar Mini 4 ne suggère que ce soit le plan ici.
Solar Jev est la partie sur laquelle personne ne va écrire
Solar Jev est en version bêta sur un nouvel endpoint POST /v1/systemone. Vous envoyez un élément d'état — un document, une ligne de journal, un ticket d'assistance — ainsi qu'une liste de questions typées, et vous recevez en retour un choix parmi un ensemble que vous avez fourni, une note sur une grille d'évaluation ou une réponse oui/non, chacun accompagné d'une probabilité calibrée issue directement du modèle plutôt que rédigée sous forme de texte.
La conséquence de cette conception est qu’il n’y a pas de prose. Pas d’explication, pas de chaîne de pensée, pas de préambule. Upstage affirme que chaque décision est une seule passe avant et que les jetons de sortie sont gratuits. Avec une fenêtre de contexte de 512K, l’état entier — un contrat complet, une transcription complète — peut constituer l’entrée.
C’est un produit plus étroit qu’il n’y paraît, et cette étroitesse est voulue. Un modèle qui n’écrit rien ne peut pas écrire quelque chose de faux. Si votre pipeline demande actuellement à un modèle conversationnel de renvoyer un verdict JSON, puis l’analyse, et que vous avez passé le moindre temps à vous protéger contre le fait que le modèle enveloppe ce JSON dans une phrase amicale, Solar Jev s’adresse précisément à vous. Le compromis, c’est que vous obtenez une probabilité et aucune trace de raisonnement ; donc lorsqu’il se trompe, vous n’avez rien à lire.
Il vaut la peine d’être précis sur ce que Solar Jev n’est pas : ce n’est pas un Solar Mini 4 plus petit, et ce n’est pas un modèle affiné que l’on peut télécharger. C’est un endpoint servi par-dessus Solar Mini 4, disponible sur Upstage Console, en bêta. Bêta est le mot qui compte.
Combien ça coûte, et le compte à rebours de la remise
Le prix catalogue est de 0,10 $ par million de tokens d’entrée, 0,01 $ par million de tokens d’entrée mis en cache, et 0,40 $ par million de tokens de sortie. Tous les montants sont hors TVA de 10 %.
Ces prix catalogue ne sont pas ce que vous paierez aujourd'hui. Upstage propose actuellement une remise de lancement de 50 %, dont sa propre page de tarification situe la date au 22 octobre 2026 (UTC) — les données structurées sous-jacentes de cette page indiquent une fenêtre allant du 22 septembre 05:00 UTC au 23 octobre 00:00 UTC, ce qui revient à dire la même chose de deux façons. Pendant cette fenêtre, les tarifs sont de 0,05 $ en entrée, 0,005 $ en cache et 0,20 $ en sortie.

Deux choses en découlent. Premièrement, si vous chiffrez cela par rapport à autre chose, chiffrez-le avec les deux montants, car une remise de 50 % qui expire dans un mois n’est pas un prix, c’est une promotion. Deuxièmement, pour situer le prix catalogue : la génération précédente de Solar Mini est affichée à 0,15 $ par million de tokens en entrée et en sortie, avec un contexte de 32 768 tokens et aucun mode de raisonnement. Solar Mini 4 est moins cher en entrée, plus cher en sortie, et offre une fenêtre de contexte seize fois plus grande ainsi qu’un mode de raisonnement. Ce n’est pas une mise à jour. C’est un produit différent qui porte le même nom.
Ce que personne n'a encore mesuré
Solar Mini 4 n'a qu'un jour d'existence et ne dispose d'aucune évaluation indépendante. Pas d'Artificial Analysis Intelligence Index, pas de classement dans Agent Arena, pas de benchmark agentique tiers. Upstage n'a pas non plus publié de tableau de benchmarks pour ce modèle — l'entrée du journal des modifications contient des spécifications et aucun score. Quiconque vous cite un chiffre pour ce modèle vous cite autre chose.
Il existe exactement un point de données de type tiers en circulation, et il doit être étiqueté avec soin, car il n'est ni l'une ni l'autre des deux choses auxquelles il ressemble. Un dépôt communautaire, hunkim/solar-mini4-jev, encapsule Solar Mini 4 derrière une forme compatible avec l'API de décision TypeSafe Jev et publie sa propre exécution test400, jugée par un autre modèle selon une grille d'évaluation énoncée. Dans cette exécution, Solar Mini 4 avec reasoning_effort=none a obtenu une précision de champ de 98,4 % contre 94,2 % pour le wrapper, manquant 7 des 447 champs évalués contre 26 ; il était en tête à la fois en coréen (98,8 %) et en anglais (98,4 %) ; et il a pris en moyenne 1,21 seconde par appel contre 0,38 seconde pour le wrapper.
Prenez cela pour ce que c'est. Ce n'est pas un benchmark de fournisseur — Upstage ne l'a pas publié. Ce n'est pas une évaluation indépendante — aucun organisme neutre ne l'a menée, le harnais est celui du concurrent, et le juge est un modèle. C'est la comparaison auto-déclarée d'un développeur entre une API hébergée et son propre wrapper, et le résumé honnête est qu'il s'agit du seul signal disponible et qu'il ne devrait pas, à lui seul, orienter une décision de production. Il suggère néanmoins deux choses qui valent la peine d'être testées par vous-même : que le modèle est assez rapide pour un usage interactif, et que son coréen est au moins aussi solide que son anglais.
Comment l'essayer sans parier tout un pipeline dessus
Le problème délicat avec un modèle vieux d’un jour et dépourvu de scores indépendants, c’est que le seul moyen de savoir s’il convient est de lui faire traiter du trafic réel, et le seul moyen de faire cela en toute sécurité est d’avoir un endroit où ce trafic puisse aller lorsqu’il ne convient pas.
Basculement est la réponse honnête ici, et c'est précisément à cela que sert une couche de routage. Vous placez Solar Mini 4 derrière un point de terminaison, conservez le modèle que vous exécutez déjà comme solution de repli, et laissez le routeur déplacer le trafic lorsque le nouveau génère des erreurs, dépasse le délai d'attente ou commence à renvoyer une sortie structurée que votre analyseur rejette. Ainsi, la première semaine d'un nouveau modèle est une expérimentation avec un filet de sécurité, plutôt qu'un lancement que vous devez défendre.
Une correction qu'il vaut la peine d'énoncer clairement, car il est facile de laisser entendre le contraire : OrcaRouter ne route aujourd'hui aucun modèle Upstage. Solar Mini 4, Solar Pro 4 et Solar Jev sont disponibles via l'API propre d'Upstage et plusieurs plateformes tierces, et si vous voulez spécifiquement Solar Mini 4, c'est là que vous le trouverez. Ce que nous offrons, c'est une clé API pour la centaine de modèles que nous routons, ce qui est utile si l'expérience que vous voulez réellement mener est « est-ce qu'un modèle d'agent compact surpasse ce que j'ai » plutôt que « est-ce que ce modèle coréen spécifique surpasse ce que j'ai ». Ce sont des questions différentes et une seule d'entre elles a une mauvaise réponse.

La question ouverte
Upstage a désormais livré un modèle compact et un modèle phare sur la même fiche technique 512K/128K, à trois semaines d'écart dans les niveaux de prix, et il a placé un point de terminaison de décision sur le petit plutôt que sur le grand. Cet ordre est délibéré : Solar Jev est servi sur Solar Mini 4 parce qu'une décision qui ne génère pas de prose n'a pas besoin du raisonnement d'un modèle phare, et parce qu'on veut le modèle bon marché quand on en produit un million.
Ce qui n’est pas encore clair, c’est de savoir si 3B de paramètres actifs suffisent en matière de raisonnement pour un travail agentique qui implique plus qu’une simple extraction. Le marketing d’Upstage parle d’agentique. Les benchmarks d’Upstage ne disent rien. Tant qu’un organisme indépendant ne l’a pas exécuté — et vu la date de sortie, ce n’est au mieux que dans quelques semaines — la bonne posture consiste à le tester sur votre propre tâche, au prix promotionnel, avec une solution de repli configurée, et à considérer toute affirmation sur sa qualité agentique, y compris celle du fournisseur, comme une hypothèse.
