
Solar Mini 4: il modello agente 3B-Active di Upstage, e il modello silenzioso con cui è stato distribuito
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Upstage ha rilasciato due cose il 22 settembre 2026, e la seconda è il motivo per continuare a leggere oltre la prima. Solar Mini 4 è il modello: un checkpoint mixture-of-experts da 35 miliardi di parametri con 3 miliardi di parametri attivi per token, una finestra di contesto da 512.000 token, fino a 128.000 token di output e un prezzo di listino di $0,10 per milione di token di input e $0,40 per milione di output. È diventato disponibile su Upstage Console, nel Playground e come distribuzione on-premises, senza etichetta di anteprima e senza lista d'attesa. Questo è il lancio, ed è un lancio sensato. L'altra cosa che Upstage ha rilasciato lo stesso giorno è stata Solar Jev, un endpoint decisionale servito sopra Solar Mini 4 che non genera alcuna prosa — restituisce una scelta, un punteggio o una risposta sì/no con una probabilità associata, in un singolo forward pass, e Upstage fattura i suoi token di output a zero. Uno di questi due annunci è il rilascio di un modello. L'altro è una piccola scommessa sul fatto che una classe utile di lavoro degli agenti non voglia che un modello linguistico parli.
Cosa è atterrato davvero il 22 settembre
La voce di changelog per Solar Mini 4 è breve e non usa mezzi termini. Nuovo modello, ora disponibile. L'inquadramento di Upstage stesso è l'efficienza in termini di costi per il lavoro agentico «dove la velocità di risposta e il costo contano» — che è la frase che un laboratorio scrive quando vuole che tu lo confronti con qualcosa che costa tre volte tanto invece che con la frontiera.

La scheda tecnica, secondo la pagina della cronologia dei modelli di Upstage:
• Parametri — 35B totali, 3B attivi per token. Un mixture-of-experts sparso, quindi paghi per archiviarne 35B e calcolare con 3B. Upstage non specifica quanti esperti ci siano né come vengano instradati.
• Contesto — 512.000 token, con un massimo di 128.000 token di output. Entrambe le cifre sono identiche a quelle del modello di punta, che è la voce più interessante della scheda.
• Data limite di addestramento — febbraio 2026. Sette mesi di obsolescenza al momento del rilascio, il che è normale per un modello di queste dimensioni e vale la pena saperlo prima di chiedergli qualcosa di recente.
• Lingue — inglese, coreano e giapponese. Upstage lo descrive come "coreano fluente con solide capacità in inglese e giapponese", che è l'ordine corretto per un laboratorio coreano e probabilmente l'ordine corretto per il modello.
• Capacità — chat, ragionamento, output strutturati e chiamata di strumenti. Il ragionamento rappresenta un cambiamento rispetto alla generazione precedente: i modelli solar-mini più vecchi ignorano del tutto il parametro reasoning_effort, mentre Solar Mini 4 non lo fa.
• ID dei modelli — solar-mini4 è l'alias, e attualmente si risolve nello snapshot datato solar-mini4-260922. Un identificatore solar-mini4-preview è anche circolato negli strumenti per agenti di terze parti, cosa utile da sapere se si scrive una configurazione di routing basata su una stringa di anteprima che potrebbe non sopravvivere.
• Disponibilità — Upstage Console, Playground e on-premises. Nessun peso aperto. Upstage ha già pubblicato pesi aperti in passato (Solar Open 2 è uscito con un rilascio su Hugging Face e il suo servizio API è terminato il 12 agosto 2026), ma nulla riguardo a Solar Mini 4 suggerisce che sia questo il piano.
Solar Jev è la parte su cui nessuno scriverà
Solar Jev è in beta su un nuovo endpoint POST /v1/systemone. Invii una porzione di stato — un documento, una riga di log, un ticket di supporto — più un elenco di domande tipizzate, e ricevi indietro una scelta da un insieme che hai fornito, un punteggio su una rubrica, oppure una risposta sì/no, ciascuna corredata di una probabilità calibrata presa direttamente dal modello anziché scritta come testo.
La conseguenza progettuale è che non c'è prosa. Nessuna spiegazione, nessuna catena di pensiero, nessun preambolo. Upstage afferma che ogni decisione è un singolo forward pass e che i token di output sono gratuiti. Con una finestra di contesto di 512K, l'intero stato — un intero contratto, un'intera trascrizione — può costituire l'input.
Questo è un prodotto più limitato di quanto non sembri a prima vista, e la limitatezza è il punto. Un modello che non scrive nulla non può scrivere qualcosa di sbagliato. Se la tua pipeline attualmente chiede a un modello di chat di restituire un verdetto JSON e poi lo analizza, e hai speso anche solo un po' di tempo a difenderti dal fatto che il modello racchiuda quel JSON in una frase amichevole, Solar Jev è pensato esattamente per te. Il compromesso è che ottieni una probabilità e nessuna traccia di ragionamento, quindi quando sbaglia non hai nulla da leggere.
Vale la pena essere precisi su ciò che Solar Jev non è: non è un Solar Mini 4 più piccolo, e non è un fine-tune che puoi scaricare. È un endpoint servito sopra Solar Mini 4, disponibile sulla Upstage Console, in beta. Beta è la parola che conta.
Quanto costa e quanto tempo resta per lo sconto
Il prezzo di listino è 0,10 $ per milione di token di input, 0,01 $ per milione di token di input in cache e 0,40 $ per milione di token di output. Tutti gli importi escludono l'IVA del 10%.
Quei prezzi di listino non sono ciò che pagherai oggi. Upstage sta applicando uno sconto di lancio del 50% che la sua stessa pagina dei prezzi fissa al 22 ottobre 2026 (UTC) — i dati strutturati sottostanti su quella pagina indicano la finestra come dal 22 settembre 05:00 UTC al 23 ottobre 00:00 UTC, che è la stessa cosa detta in due modi. Durante quella finestra le tariffe sono $0,05 input, $0,005 cache, $0,20 output.

Seguono due cose. Primo, se stai valutando il costo rispetto a qualsiasi altra cosa, calcolalo su entrambi i numeri, perché uno sconto del 50% che scade tra un mese non è un prezzo, è una promozione. Secondo, per contestualizzare dove si colloca il prezzo di listino: la generazione precedente di Solar Mini è a listino a $0,15 per milione di token in input e output, con un contesto di 32.768 token e nessuna modalità di ragionamento. Solar Mini 4 costa meno in input, più in output, e ti dà una finestra di contesto sedici volte più ampia e una modalità di ragionamento. Questo non è un aggiornamento. È un prodotto diverso che porta lo stesso nome.
Ciò che nessuno ha ancora misurato
Solar Mini 4 ha un solo giorno di vita e non ha valutazioni indipendenti. Nessun Artificial Analysis Intelligence Index, nessun posizionamento in Agent Arena, nessun benchmark agentico di terze parti. Anche Upstage non ha pubblicato alcuna tabella di benchmark per esso — la voce del changelog riporta specifiche e nessun punteggio. Chiunque ti citi un numero per questo modello sta citando qualcos'altro.
C'è esattamente un punto dati, per così dire di terze parti, in circolazione, e va etichettato con attenzione perché non è nessuna delle due cose che sembra. Un repository della comunità, hunkim/solar-mini4-jev, incapsula Solar Mini 4 dietro una forma compatibile per l'API decisionale TypeSafe Jev e pubblica la propria esecuzione test400, giudicata da un altro modello secondo una rubrica dichiarata. In quell'esecuzione, Solar Mini 4 con reasoning_effort=none ha ottenuto un'accuratezza sui campi del 98,4% rispetto al 94,2% del wrapper stesso, mancando 7 dei 447 campi valutati contro 26; era in testa sia in coreano (98,8%) sia in inglese (98,4%); e ha impiegato in media 1,21 secondi per chiamata contro i 0,38 secondi del wrapper.
Leggilo per quello che è. Non è un benchmark di un fornitore — Upstage non l'ha pubblicato. Non è una valutazione indipendente — nessun ente neutrale l'ha eseguita, il banco di prova è quello dello stesso concorrente, e il giudice è un modello. È il confronto autodichiarato di uno sviluppatore tra un'API ospitata e il proprio wrapper, e il riassunto onesto è che è l'unico segnale disponibile e non dovrebbe, da solo, orientare una decisione di produzione. Suggerisce però due cose che vale la pena verificare di persona: che il modello è abbastanza veloce per l'uso interattivo, e che il suo coreano è almeno forte quanto il suo inglese.
Come provarlo senza scommetterci una pipeline
La parte scomoda di un modello vecchio di un giorno senza punteggi indipendenti è che l'unico modo per scoprire se è adatto è instradare traffico reale attraverso di esso, e l'unico modo per farlo in sicurezza è avere un posto dove quel traffico possa andare quando non lo è.
Il failover è la risposta onesta qui, ed è a questo che serve un livello di routing. Metti Solar Mini 4 dietro un endpoint, mantieni il modello che stai già eseguendo come fallback e lascia che il router sposti il traffico quando quello nuovo genera errori, va in timeout o inizia a restituire output strutturato che il tuo parser rifiuta. In questo modo, la prima settimana di un nuovo modello è un esperimento con una rete di sicurezza sotto, anziché un lancio che devi difendere.
Una precisazione che vale la pena fare in modo esplicito, perché è facile lasciar intendere il contrario: oggi OrcaRouter non instrada nessun modello Upstage. Solar Mini 4, Solar Pro 4 e Solar Jev sono disponibili tramite l'API di Upstage stessa e diverse piattaforme di terze parti, e se ti interessa specificamente Solar Mini 4, è lì che lo trovi. Quello che offriamo è una sola chiave API per i circa 190 modelli che invece instradiamo, il che è utile se l'esperimento che vuoi davvero condurre è «un modello agente compatto batte quello che ho già» e non «questo specifico modello coreano batte quello che ho già». Sono domande diverse e solo una delle due ha una risposta sbagliata.

La questione aperta
Upstage ha ora rilasciato un modello compatto e un flagship sulla stessa scheda tecnica 512K/128K, a tre settimane di distanza e su fasce di prezzo diverse, e ha messo un endpoint decisionale sul piccolo anziché sul grande. Quest'ordine è intenzionale: Solar Jev viene servito su Solar Mini 4 perché una decisione che non genera prosa non ha bisogno del ragionamento di un flagship, e perché vuoi il modello economico quando ne fai un milione.
Ciò che non è ancora chiaro è se 3B parametri attivi siano sufficienti come ragionamento per un lavoro agentico che comporta più della semplice estrazione. Il marketing di Upstage dice agentico. I benchmark di Upstage non dicono nulla. Finché un organismo indipendente non lo mette alla prova — e, considerata la data di rilascio, nel migliore dei casi mancano settimane — l'atteggiamento corretto è testarlo sul proprio compito, al prezzo promozionale, con un fallback configurato, e trattare qualsiasi affermazione sulla sua qualità agentica, compresa quella del fornitore, come un'ipotesi.
