
Solar Mini 4: Upstages 3B-aktiva agentmodell och den tysta modellen som den levererades med
- OpenAINYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Upstage släppte två saker den 22 september 2026, och det andra är anledningen till att fortsätta läsa förbi det första. Solar Mini 4 är modellen: en mixture-of-experts-checkpoint med 35 miljarder parametrar och 3 miljarder aktiva parametrar per token, ett kontextfönster på 512 000 tokens, upp till 128 000 tokens utdata och ett listpris på 0,10 USD per miljon indatatokens och 0,40 USD per miljon utdatatokens. Den lanserades i Upstage Console, i Playground och som en lokal driftsättning, utan preview-etikett och utan väntelista. Det är lanseringen, och den är förnuftig. Det andra som Upstage släppte samma dag var Solar Jev, en beslutsendpunkt som serveras ovanpå Solar Mini 4 och inte genererar någon prosa alls – den returnerar ett val, en poäng eller ett ja/nej-svar med en sannolikhet kopplad till sig, i en enda framåtpassning, och Upstage debiterar noll för dess utdatatokens. Ett av dessa två tillkännagivanden är ett modellsläpp. Det andra är en liten satsning på att en användbar klass av agentarbete inte vill att en språkmodell ska prata.
Vad landade egentligen den 22 september
Ändringsloggposten för Solar Mini 4 är kort och tar inga förbehåll. Ny modell, nu tillgänglig. Upstages egen formulering är kostnadseffektivitet för agentiskt arbete "där svarstid och kostnad spelar roll" – vilket är meningen ett labb skriver när det vill att du ska jämföra den med något som kostar tre gånger så mycket i stället för med frontlinjen.

Specifikationsbladet, enligt Upstages modellhistoriksida:
• Parametrar — 35B totalt, 3B aktiva per token. En gles mixture-of-experts, så du betalar för att lagra 35B och beräknar med 3B. Upstage redovisar inte hur många experter det finns eller hur de dirigeras.
• Kontext — 512 000 tokens, med maximalt 128 000 utdatatokens. Båda siffrorna är identiska med flaggskeppets, vilket är den mest intressanta raden på bladet.
• Träningsavslut — februari 2026. Sju månader inaktuell vid lanseringen, vilket är normalt för en modell av den här storleken och värt att känna till innan du frågar den om något aktuellt.
• Språk – engelska, koreanska och japanska. Upstage beskriver det som "flytande koreanska med starka förmågor i engelska och japanska", vilket är rätt ordning för ett koreanskt labb och förmodligen rätt ordning för modellen.
• Kapaciteter — chatt, resonemang, strukturerade utdata och verktygsanrop. Resonemang är en förändring från föregående generation: de äldre solar-mini-modellerna ignorerar parametern reasoning_effort helt, medan Solar Mini 4 inte gör det.
• Modell-ID:n — solar-mini4 är aliaset, och det pekar för närvarande på den daterade ögonblicksbilden solar-mini4-260922. En identifierare solar-mini4-preview har också cirkulerat i tredjepartsverktyg för agenter, vilket är värt att känna till om du skriver routningskonfiguration mot en förhandsversionssträng som kanske inte överlever.
• Tillgänglighet — Upstage Console, Playground och lokal installation. Inga öppna vikter. Upstage har tidigare publicerat öppna vikter (Solar Open 2 släpptes via en Hugging Face-release och dess API-tjänst upphörde den 12 augusti 2026), men inget kring Solar Mini 4 tyder på att det är planen här.
Solar Jev är delen som ingen kommer att skriva om
Solar Jev är i beta på en ny POST /v1/systemone-slutpunkt. Du skickar en bit tillstånd — ett dokument, en loggrad, ett supportärende — plus en lista med typade frågor, och du får tillbaka ett val från en uppsättning du angav, en poäng på en bedömningsmatris eller ett ja/nej-svar, där var och en bär en kalibrerad sannolikhet som hämtats direkt från modellen i stället för att skrivas ut som text.
Designkonsekvensen är att det inte finns någon prosa. Ingen förklaring, ingen tankekedja, ingen inledning. Upstage säger att varje beslut är en enda framåtpassning och att utdatatoken är gratis. Med ett kontextfönster på 512K kan hela tillståndet – ett helt avtal, en hel transkription – vara indata.
Det här är en snävare produkt än den först verkar vara, och snävheten är själva poängen. En modell som inte skriver något kan inte skriva något fel. Om din pipeline för närvarande ber en chattmodell att returnera en JSON-bedömning och sedan tolkar den, och du har lagt någon tid alls på att skydda dig mot att modellen lindar in den JSON:en i en vänlig mening, så riktar sig Solar Jev direkt till dig. Avvägningen är att du får en sannolikhet och inget resonemangsspår, så när den har fel har du inget att läsa.
Det är värt att vara precis om vad Solar Jev inte är: det är inte en mindre Solar Mini 4, och det är inte en finjustering du kan ladda ner. Det är en serverad endpoint ovanpå Solar Mini 4, tillgänglig i Upstage Console, i beta. Beta är det avgörande ordet.
Vad det kostar, och nedräkningen för rabatten
Listpris är 0,10 USD per miljon indatatoken, 0,01 USD per miljon cachade indatatoken och 0,40 USD per miljon utdatatoken. Alla belopp exkluderar 10 % moms.
De där listpriserna är inte vad du betalar i dag. Upstage kör en lanseringsrabatt på 50 % som deras egen prissida daterar till den 22 oktober 2026 (UTC) – den underliggande strukturerade datan på den sidan anger fönstret som den 22 september 05:00 UTC till den 23 oktober 00:00 UTC, vilket är samma sak uttryckt på två sätt. Under den perioden ligger priserna på 0,05 USD för indata, 0,005 USD för cachad indata och 0,20 USD för utdata.

Två saker följer. För det första: om du kostnadsberäknar detta mot något annat, beräkna kostnaden med båda siffrorna, för en rabatt på 50 % som löper ut om en månad är inte ett pris, det är en kampanj. För det andra, för att sätta listpriset i sitt sammanhang: den tidigare generationen av Solar Mini listas till $0.15 per miljon tokens in och ut, med en kontext på 32 768 tokens och inget resonemangsläge alls. Solar Mini 4 är billigare på indata, dyrare på utdata och ger dig sexton gånger så stort kontextfönster och ett resonemangsläge. Det är inte en uppdatering. Det är en annan produkt som bär samma namn.
Vad ingen har mätt ännu
Solar Mini 4 är en dag gammal och har ingen oberoende utvärdering. Inget Artificial Analysis Intelligence Index, ingen placering i Agent Arena, ingen agentisk benchmark från tredje part. Upstage har inte heller publicerat någon benchmarktabell för den — ändringsloggsposten innehåller specifikationer och inga poäng. Den som citerar en siffra för den här modellen till dig citerar något annat.
Det finns exakt en tredjepartsaktig datapunkt i omlopp, och den behöver märkas noggrant, eftersom den inte är någon av de två saker som den ser ut att vara. Ett gemenskapsrepository, hunkim/solar-mini4-jev, lindar in Solar Mini 4 bakom en kompatibel form för TypeSafe Jevs besluts-API och publicerar sin egen test400-körning, bedömd av en annan modell enligt en angiven bedömningsmall. I den körningen fick Solar Mini 4 med reasoning_effort=none 98,4 % fältnoggrannhet mot wrapperns egna 94,2 %, och missade 7 av 447 bedömda fält mot 26; den ledde både på koreanska (98,8 %) och engelska (98,4 %); och den tog i genomsnitt 1,21 sekunder per anrop mot wrapperns 0,38 sekunder.
Läs det för vad det är. Det är inte ett leverantörsbenchmark – Upstage publicerade det inte. Det är inte en oberoende utvärdering – inget neutralt organ körde det, testramverket är konkurrentens eget, och domaren är en modell. Det är en utvecklares självrapporterade jämförelse av ett hostat API mot deras egen wrapper, och den ärliga sammanfattningen är att det är den enda signal som finns och att den inte bör styra ett produktionsbeslut på egen hand. Det antyder dock två saker som är värda att testa själv: att modellen är tillräckligt snabb för interaktiv användning, och att dess koreanska är minst lika stark som dess engelska.
Hur man testar det utan att satsa en pipeline på det
Det besvärliga med en endagsgammal modell utan oberoende poäng är att det enda sättet att ta reda på om den passar är att dirigera verklig trafik genom den, och det enda sättet att göra det säkert är att ha någonstans dit den trafiken kan ta vägen när den inte passar.
Redundansväxling är det ärliga svaret här, och det är vad ett routningslager är till för. Du sätter Solar Mini 4 bakom en slutpunkt, behåller modellen du redan kör som reserv och låter routern flytta trafik när den nya modellen felar, får timeout eller börjar returnera strukturerad utdata som din parser avvisar. På så sätt är den första veckan med en ny modell ett experiment med en undre gräns i stället för en lansering du måste försvara.
En rättelse som förtjänar att sägas rakt ut, för det är lätt att antyda något annat: OrcaRouter dirigerar inte någon Upstage-modell i dag. Solar Mini 4, Solar Pro 4 och Solar Jev är tillgängliga via Upstages eget API och flera tredjepartsplattformar, och om du specifikt vill ha Solar Mini 4 är det där du får den. Det vi erbjuder är en API-nyckel för de drygt 190 modeller som vi faktiskt dirigerar, vilket är användbart om experimentet du faktiskt vill köra är "slår en kompakt agentmodell det jag har" snarare än "slår den här specifika koreanska modellen det jag har". Det är olika frågor och bara en av dem har ett felaktigt svar.

Den öppna frågan
Upstage har nu släppt en kompakt modell och ett flaggskepp med samma specifikation på 512K/128K, tre veckor isär i prisnivåer, och man har lagt en beslutsendpoint på den lilla i stället för den stora. Den ordningen är avsiktlig: Solar Jev serveras på Solar Mini 4 eftersom ett beslut som inte genererar någon prosa inte behöver ett flaggskepps resonemang, och eftersom man vill ha den billiga modellen när man fattar en miljon av dem.
Det som ännu inte är klart är huruvida 3B aktiva parametrar ger tillräcklig resonemangsförmåga för agentiskt arbete som innefattar mer än extrahering. Upstages marknadsföring säger agentiskt. Upstages benchmarks säger ingenting. Tills ett oberoende organ kör det — och med tanke på releasedatumet är det minst veckor bort — är det korrekta förhållningssättet att testa det på din egen uppgift, till kampanjpriset, med en reservlösning konfigurerad, och att behandla varje påstående om dess agentiska kvalitet, inklusive leverantörens, som en hypotes.
