Titelkaart met de tekst “Solar Mini 4” en de ondertitel “Upstage’s 3B-actieve agentmodel, en het stille model dat ermee werd meegeleverd”, op een blauw-naar-turquoise gradiënt met het OrcaRouter-logo rechtsonder.
Guides & Insights

Solar Mini 4: het 3B-actieve agentmodel van Upstage, en het stille model dat ermee werd meegeleverd

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Upstage bracht op 22 september 2026 twee dingen uit, en de tweede is de reden om verder te lezen dan de eerste. Solar Mini 4 is het model: een mixture-of-experts-checkpoint met 35 miljard parameters, waarvan 3 miljard parameters actief per token, een contextvenster van 512.000 tokens, tot 128.000 tokens uitvoer, en een lijstprijs van $0,10 per miljoen invoertokens en $0,40 per miljoen uitvoertokens. Het ging live op de Upstage Console, in de Playground en als on-premises deployment, zonder preview-label en zonder wachtlijst. Dat is de lancering, en het is een verstandige. Het andere dat Upstage dezelfde dag uitbracht was Solar Jev, een decision endpoint bovenop Solar Mini 4 dat helemaal geen proza genereert — het retourneert een keuze, een score of een ja/nee-antwoord met een waarschijnlijkheid eraan verbonden, in één forward pass, en Upstage rekent nul voor de uitvoertokens. Een van deze twee aankondigingen is een modelrelease. De andere is een kleine gok dat een nuttige klasse van agentwerk niet wil dat een taalmodel praat.

Wat landde er eigenlijk op 22 september?

De changelog-vermelding voor Solar Mini 4 is kort en zonder slag om de arm. Nieuw model, nu beschikbaar. De eigen positionering van Upstage is kostenefficiëntie voor agentisch werk "waar reactiesnelheid en kosten ertoe doen" — wat de zin is die een lab opschrijft wanneer het wil dat je het vergelijkt met iets dat drie keer zo duur is in plaats van met de frontier.

Screenshot of Upstage’s changelog page, showing the entry announcing Solar Mini 4 as a new model now available.

Het specificatieblad, volgens de modelgeschiedenispagina van Upstage:

• Parameters — 35B totaal, 3B actief per token. Een sparse mixture-of-experts, dus je betaalt voor het opslaan van 35B en rekent met 3B. Upstage maakt niet bekend hoeveel experts er zijn of hoe ze worden gerouteerd.

• Context — 512.000 tokens, met een maximum van 128.000 outputtokens. Beide cijfers zijn identiek aan die van het vlaggenschip, wat de meest interessante regel op het blad is.

• Trainingsafsluiting — februari 2026. Zeven maanden verouderd bij release, wat normaal is voor een model van deze omvang en goed om te weten voordat je het iets over recente zaken vraagt.

• Talen — Engels, Koreaans en Japans. Upstage beschrijft het als "vloeiend Koreaans met sterke Engels- en Japansvaardigheden", wat de juiste volgorde is voor een Koreaans lab en waarschijnlijk ook de juiste volgorde voor het model.

• Mogelijkheden — chat, redeneren, gestructureerde uitvoer en het aanroepen van tools. Redeneren is een verandering ten opzichte van de vorige generatie: de oudere solar-mini-modellen negeren een reasoning_effort-parameter volledig, en Solar Mini 4 doet dat niet.

• Model-ID's — solar-mini4 is de alias, en deze verwijst momenteel naar de gedateerde snapshot solar-mini4-260922. Een solar-mini4-preview-identificatie circuleert ook in agent-tooling van derden, wat het weten waard is als je routeringsconfiguratie schrijft op basis van een preview-string die mogelijk niet blijft bestaan.

• Beschikbaarheid — Upstage Console, Playground en on-premises. Geen open gewichten. Upstage heeft eerder open gewichten gepubliceerd (Solar Open 2 kwam uit via een Hugging Face-release en de API-dienstverlening ervan eindigde op 12 augustus 2026), maar niets aan Solar Mini 4 wijst erop dat dat hier het plan is.

Solar Jev is het deel waar niemand over gaat schrijven

Solar Jev is in bèta op een nieuw POST /v1/systemone endpoint. Je stuurt een stukje state — een document, een logregel, een supportticket — plus een lijst met getypeerde vragen, en je krijgt een keuze terug uit een set die je zelf hebt aangeleverd, een score op een rubric, of een ja/nee-antwoord, elk met een gekalibreerde waarschijnlijkheid die rechtstreeks uit het model komt in plaats van als tekst te worden uitgeschreven.

Het ontwerpgevolg is dat er geen proza is. Geen uitleg, geen gedachtegang, geen inleiding. Upstage zegt dat elke beslissing één forward pass is en dat outputtokens gratis zijn. Met een contextvenster van 512K kan de volledige staat — een heel contract, een heel transcript — de invoer zijn.

Dit is een beperkter product dan het op het eerste gezicht lijkt, en die beperktheid is juist het punt. Een model dat niets schrijft, kan niets fout schrijven. Als je pijplijn momenteel een chatmodel vraagt een JSON-oordeel te retourneren en dat vervolgens parseert, en je überhaupt tijd hebt besteed aan het verdedigen tegen het model dat die JSON in een vriendelijke zin verpakt, dan is Solar Jev precies op jou gericht. De ruil is dat je een waarschijnlijkheid krijgt en geen redeneerspoor, dus als het model ernaast zit, heb je niets om te lezen.

Het is de moeite waard om precies te zijn over wat Solar Jev niet is: het is geen kleinere Solar Mini 4, en het is geen fine-tune die je kunt downloaden. Het is een geserveerd endpoint bovenop Solar Mini 4, beschikbaar in de Upstage Console, in bèta. Bèta is het sleutelwoord.

Wat het kost, en de klok die tikt op de korting

Lijstprijs is $0,10 per miljoen invoertokens, $0,01 per miljoen gecachte invoertokens en $0,40 per miljoen uitvoertokens. Alle bedragen zijn exclusief 10% btw.

Die listprijzen zijn niet wat je vandaag betaalt. Upstage heeft een lanceerkorting van 50% lopen, waarvan de eigen prijzenpagina van Upstage de datum op 22 oktober 2026 (UTC) stelt — de onderliggende gestructureerde data op die pagina geeft het venster als 22 september 05:00 UTC tot 23 oktober 00:00 UTC, wat hetzelfde is, op twee manieren gezegd. Binnen dat venster zijn de tarieven $0,05 voor invoer, $0,005 voor gecachet, $0,20 voor uitvoer.

Screenshot of Upstage’s pricing page listing Solar Mini 4’s input, cached input and output rates alongside the launch promotion window.

Twee dingen volgen hieruit. Ten eerste: als je dit tegen iets anders afzet, reken het dan tegen beide bedragen, want een korting van 50% die over een maand afloopt is geen prijs, maar een promotie. Ten tweede, voor context over waar de lijstprijs ligt: de vorige generatie Solar Mini heeft een lijstprijs van $0,15 per miljoen tokens voor input en output, met een contextvenster van 32.768 tokens en helemaal geen reasoning-modus. Solar Mini 4 is goedkoper op input, duurder op output, en biedt je een zestien keer zo groot contextvenster en een reasoning-modus. Dat is geen refresh. Dat is een ander product dat dezelfde naam draagt.

Wat nog niemand heeft gemeten

Solar Mini 4 is één dag oud en heeft geen onafhankelijke evaluatie. Geen Artificial Analysis Intelligence Index, geen Agent Arena-plaatsing, geen agentische benchmark van derden. Upstage heeft er ook geen benchmarktabel voor gepubliceerd — de changelog-vermelding bevat specificaties en geen scores. Iedereen die u een getal voor dit model noemt, citeert iets anders.

Er is precies één enigszins van een derde partij afkomstig datapunt in omloop, en dat moet zorgvuldig worden gelabeld, want het is geen van de twee dingen waarop het lijkt. Een community-repository, hunkim/solar-mini4-jev, verpakt Solar Mini 4 achter een compatibele vorm voor de TypeSafe Jev decision API en publiceert zijn eigen test400-run, beoordeeld door een ander model volgens een vermelde rubric. In die run scoorde Solar Mini 4 met reasoning_effort=none 98,4% veldnauwkeurigheid tegenover 94,2% van de wrapper zelf, waarbij het 7 van de 447 gescoorde velden miste tegenover 26; het leidde op zowel Koreaans (98,8%) als Engels (98,4%); en het kwam gemiddeld uit op 1,21 seconde per aanroep tegenover 0,38 seconde van de wrapper.

Lees dat voor wat het is. Het is geen leveranciersbenchmark — Upstage heeft die niet gepubliceerd. Het is geen onafhankelijke evaluatie — geen enkele neutrale instantie heeft die uitgevoerd, de testomgeving is die van de concurrent zelf, en de beoordelaar is een model. Het is de zelfgerapporteerde vergelijking van één ontwikkelaar tussen een gehoste API en hun eigen wrapper, en de eerlijke samenvatting is dat het het enige beschikbare signaal is en dat het op zichzelf geen productiebeslissing zou moeten sturen. Het suggereert wel twee dingen die je zelf zou moeten testen: dat het model snel genoeg is voor interactief gebruik, en dat het Koreaans minstens zo sterk is als het Engels.

Hoe je het kunt uitproberen zonder er een pipeline op in te zetten

Het lastige van een model dat pas één dag oud is en geen onafhankelijke scores heeft, is dat de enige manier om erachter te komen of het geschikt is, is om er echt verkeer doorheen te routeren, en de enige manier om dat veilig te doen is om een plek te hebben waar dat verkeer naartoe kan als het niet geschikt is.

Failover is hier het eerlijke antwoord, en dat is waar een routeringslaag voor dient. Je zet Solar Mini 4 achter een endpoint, houdt het model dat je al draait als fallback, en laat de router het verkeer verplaatsen wanneer het nieuwe model fouten geeft, een timeout krijgt of gestructureerde output begint te retourneren die je parser afwijst. Op die manier is de eerste week van een nieuw model een experiment met een vangnet eronder in plaats van een lancering die je moet verdedigen.

Eén correctie die ik ronduit wil noemen, want het is makkelijk om iets anders te suggereren: OrcaRouter routeert vandaag geen enkel Upstage-model. Solar Mini 4, Solar Pro 4 en Solar Jev zijn beschikbaar via de eigen API van Upstage en verschillende platforms van derden, en als je specifiek Solar Mini 4 wilt, is dat waar je het kunt krijgen. Wat wij bieden is één API-sleutel voor de ongeveer 190 modellen die we wél routeren, wat handig is als het experiment dat je eigenlijk wilt uitvoeren, luidt: "presteert een compact agentmodel beter dan wat ik heb" in plaats van "presteert dit specifieke Koreaanse model beter dan wat ik heb." Dat zijn verschillende vragen, en slechts één ervan heeft een fout antwoord.

OrcaRouter scoreboard card listing Solar Mini 4’s release date of 22 September 2026, its 35B total / 3B active parameter split, 512K context with 128K output, $0.10 / $0.40 list price, the 50% launch promotion to 22 October, and no Artificial Analysis Intelligence Index yet.

De open vraag

Upstage heeft nu een compact model en een flagship uitgebracht op hetzelfde 512K/128K-specificatieblad, drie weken na elkaar in prijsklassen, en het heeft een beslissings-endpoint op het kleine gezet in plaats van op het grote. Die ordening is bewust: Solar Jev draait op Solar Mini 4 omdat een beslissing die geen proza genereert niet de redeneerkracht van een flagship nodig heeft, en omdat je het goedkope model wilt wanneer je er een miljoen maakt.

Wat nog niet duidelijk is, is of 3B actieve parameters genoeg redeneervermogen bieden voor agentisch werk dat meer dan extractie omvat. De marketing van Upstage zegt agentisch. De benchmarks van Upstage zeggen niets. Totdat een onafhankelijke instantie het test — en gezien de releasedatum is dat op zijn vroegst weken weg — is de juiste houding om het op je eigen taak te testen, tegen de promotieprijs, met een geconfigureerde fallback, en om elke claim over de agentische kwaliteit ervan, inclusief die van de leverancier, als een hypothese te behandelen.