
Solar Mini 4 vs Solar Pro 4: la stessa finestra di contesto a tre volte il prezzo
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
I due attuali modelli Solar di Upstage condividono una scheda tecnica su ogni dimensione che un acquirente normalmente controlla per prima. Solar Mini 4, rilasciato il 22 settembre 2026, e Solar Pro 4, rilasciato il 6 agosto 2026, accettano entrambi 512.000 token di contesto, emettono entrambi fino a 128.000 token di output, coprono entrambi inglese, coreano e giapponese, e entrambi hanno una data di fine dei dati di addestramento a febbraio 2026. La differenza è che Solar Pro 4 ha un listino pari a tre volte il prezzo di Solar Mini 4 — 0,30 $ per milione di token di input contro 0,10 $ — e che Solar Pro 4 ha un punteggio benchmark indipendente pubblicato, mentre Solar Mini 4, che ha un giorno di vita, non ne ha alcuno. Il che significa che la domanda a cui questa comparazione risponde non è "quale sia migliore". È se la cosa per cui paghi tre volte tanto è la cosa che manca al tuo carico di lavoro.
Due orologi scontati in funzione contemporaneamente
Prima dell'argomento sulla capacità, quello sul prezzo — perché al momento i due modelli seguono tempistiche promozionali diverse e l'aritmetica è più strana di quanto suggeriscano i prezzi di listino.
Solar Mini 4 è stato lanciato il 22 settembre con uno sconto del 50% fino al 22 ottobre 2026, il che porta le sue tariffe attuali a $0,05 per l'input, $0,005 per l'input in cache e $0,20 per l'output per milione di token. La pagina dei prezzi di Upstage riporta la finestra strutturata come dal 22 settembre alle 05:00 UTC al 23 ottobre alle 00:00 UTC.
La promozione di Solar Pro 4 è cambiata l'11 settembre, quando Upstage ha ridotto lo sconto dal 90% al 70% — un aumento di prezzo, in parole povere, anche se il modello è rimasto ben al di sotto del listino. Quella promozione dura fino al 9 ottobre 2026, con prezzi standard a partire dal 10 ottobre. Durante questo periodo, Solar Pro 4 si attesta a $0.09 per l'input, $0.018 per la cache e $0.36 per l'output.
Quindi, per le circa due settimane tra ora e il 9 ottobre, il divario tra i due modelli è di 1,8×, non 3×: $0,09 contro $0,05 in input, $0,36 contro $0,20 in output. Dopo il 9 ottobre, Solar Pro 4 torna a $0,30 e $1,20, mentre Solar Mini 4 resta scontato fino al 22. Dopo il 22, entrambi sono a prezzo di listino e il divario è pari al 3× pieno.

Da questo discendono tre conclusioni. Se stai mettendo a confronto i due con un benchmark, fallo prima del 9 ottobre, quando il vantaggio del modello più economico è minimo e stai misurando la capacità, non il prezzo. Se stai pianificando il budget per un rilascio in produzione che inizia a novembre, usa i prezzi di listino, perché nessuna delle due promozioni sarà ancora in corso. E se stai pianificando una migrazione tra i due, sappi che il punto di crossover è una data, non un carico di lavoro.
L'unico punto in cui i due modelli sono davvero molto distanti
La valutazione indipendente è il campo in cui Solar Pro 4 si guadagna il suo livello, mentre Solar Mini 4 non riesce ancora a rispondere alla domanda.
Artificial Analysis ha assegnato a Solar Pro 4 un punteggio di 42 sul suo Intelligence Index, un balzo di 27 punti rispetto al 14 di Solar Pro 3, e i miglioramenti si sono concentrati esattamente dove un flagship dovrebbe vincere. Terminal-Bench v2.1 è passato dal 12% al 57%. AA-LCR, la valutazione di ragionamento su contesto lungo, è passata dal 31% al 71%. τ³-Banking è passato dal 9% al 23%. Su GDPval-AA v2, che misura compiti agentici del mondo reale rispetto a una baseline Elo umana di 1000, Solar Pro 3 ha ottenuto 498 e Solar Pro 4 ha ottenuto 1277. Questi sono dati di terze parti, pubblicati da Artificial Analysis, non numeri del fornitore.

Lo stesso resoconto è onesto riguardo al costo di quel miglioramento. Solar Pro 4 impiega 8,6 minuti per completare un compito medio dell'Intelligence Index, contro i 6,0 di Solar Pro 3, nonostante utilizzi circa il 17% in meno di token di output — 43.000 per compito contro 52.000. È più efficiente in termini di token e più lento in termini di tempo effettivo. E il suo punteggio AA-Omniscience è migliorato da −53 a −1 soprattutto astenendosi: tenta solo il 41% delle domande, contro il 92% di Pro 3, e mentre il suo tasso di allucinazione è sceso dall'88% al 24%, la sua accuratezza è appena cambiata, da circa il 17% al 19%. Un modello che migliora il suo punteggio di onestà rifiutandosi di rispondere è un vero miglioramento per il lavoro degli agenti — una risposta sbagliata data con sicurezza costa più di un rifiuto — ma non è la stessa cosa che sapere di più.
Solar Mini 4 non ha equivalenti. Nessun Intelligence Index, nessuna posizione in Agent Arena, nessuna valutazione agentica di terze parti e nemmeno una tabella di benchmark da Upstage. L'unico dato in circolazione è un'esecuzione test400 autodichiarata da un wrapper della community e giudicata da un altro modello, in cui Solar Mini 4 ha ottenuto un'accuratezza sul campo del 98,4% con un tempo medio di chiamata di 1,21 secondi. È il banco di prova di un singolo sviluppatore sulla propria implementazione: utile come indicazione preliminare, inutile come input per l'approvvigionamento.
Cosa si ottiene con 3B di parametri attivi, e cosa no
La divulgazione dei parametri è la dichiarazione d'intenti più chiara in questo abbinamento. Solar Mini 4 ha 35B totali con 3B attivi per token. Il numero di parametri di Solar Pro 4 non è reso noto.
Un rapporto attivo di 3B è una decisione di economia del serving, non una dichiarazione di capacità. Significa che il modello memorizza 35B di pesi ed esegue l'aritmetica di 3B per ogni token, ed è per questo che Upstage può prezzare un modello con contesto da 512K a $0,10 per milione di token di input. Solar Pro 4 a $0,30 ti dice che sta facendo più lavoro per token; il fatto che Upstage non pubblichi il numero ti dice che non vuole che il confronto venga fatto aritmeticamente.
Ciò che effettivamente li separa, in base alle prove pubblicate, è la difficoltà del compito che al modello viene chiesto di portare a termine, piuttosto che la dimensione del documento che gli viene fornito. Solar Mini 4 è stato annunciato con una finestra di contesto di 512K e un output fino a 128K — gli stessi valori del modello di punta — quindi il caso dei documenti lunghi non è dove si colloca il confine tra i livelli. Il confine è nel lavoro agentico a più passaggi: i numeri di Terminal-Bench, τ³-Banking e GDPval sono ciò che si acquista con il prezzo di Solar Pro 4, e misurano compiti che richiedono pianificazione, chiamate agli strumenti e recupero dagli errori nel corso di molti turni.
C'è un'avvertenza che vale la pena dichiarare, perché è il genere di cosa che morde le persone nel bel mezzo di un progetto. La cronologia dei modelli di Upstage elenca Solar Pro 4 con contesto 512K e output massimo 128K. L'articolo di Artificial Analysis sullo stesso modello elenca una finestra di contesto di 384K e un output massimo di 256K: lo stesso massimo e minimo, invertiti. Entrambe le fonti sono affidabili e non concordano. Se stai dimensionando un prompt vicino al limite, verifica sulla risposta API anziché su uno dei due documenti, perché le due cifre pubblicate non sono conciliabili.
Dove ciascuno trova posto in una pipeline
Il modo utile di intendere questi due modelli è come una coppia di livelli anziché come alternative, che è all'incirca il modo in cui Upstage li ha posizionati. Solar Mini 4 è quello predefinito: estrazione, classificazione, output strutturato su documenti lunghi, il ciclo ad alto volume in cui un milione di chiamate a basso costo è il carico di lavoro. Solar Pro 4 è l'escalation: l'esecuzione dell'agente che deve pianificare, usare strumenti, riprendersi da un passaggio fallito e completare comunque.
L'economia di quella suddivisione è spietata a favore del livello economico ogni volta che il livello economico è quello giusto. Solar Mini 4, a $0,05 per l'input e $0,20 per l'output durante la sua promozione, costa da cinque a sei volte meno della tariffa promozionale di Solar Pro 4 e tre volte meno a listino. Se il 90% del tuo volume è estrazione e il 10% è lavoro agentico, instradare il 90% a un livello inferiore fa risparmiare più di qualunque ottimizzazione del prompt. La modalità di errore è l'instradamento errato — inviare lavoro agentico al modello piccolo e pagarlo due volte, una per la chiamata sprecata e una per il nuovo tentativo su quello costoso.
Quel rischio di instradamento errato è il motivo per cui questo è un problema di misurazione prima ancora che un problema di prezzo, ed è qui che un livello di routing si guadagna il suo posto. Per essere chiari sul confine del prodotto: OrcaRouter non instrada alcun modello Upstage, quindi né Solar Mini 4 né Solar Pro 4 sono disponibili tramite noi — entrambi provengono dall'API di Upstage e da diverse piattaforme di terze parti. Ciò a cui serve la piattaforma è lo schema che questo abbinamento crea: un livello economico e un livello costoso, una regola per stabilire quale traffico va dove, e failover automatico che promuove una chiamata al modello più grande quando quello più piccolo va in errore o restituisce qualcosa che il tuo parser rifiuta. Sui circa 190 modelli che instradiamo, quella suddivisione in livelli si configura una volta sola invece di essere cablata in ogni chiamante. Se utilizzi entrambi i livelli Solar, la logica equivalente risiede nella console di Upstage stessa, e gli elementi che vorresti leggere con attenzione sono quelli che decidono quando passare al livello superiore.

Cosa farne
Se oggi devi scegliere tra i due, scegli Solar Pro 4 solo se il tuo lavoro è agentico nel senso specifico che i benchmark misurano — multi-step, con uso di strumenti, auto-correttivo. È questo che il 3× paga, ed è l'unico asse su cui le prove pubblicate li distinguono chiaramente. Per tutto il resto, Solar Mini 4 offre la stessa finestra di contesto, lo stesso tetto di output, le stesse tre lingue e un prezzo inferiore, e l'obiezione onesta che gli si può muovere non è che sia debole, ma che nessuno al di fuori di Upstage l'ha ancora misurato.
Quest'ultimo punto è l'intera decisione, e ha una scadenza. La promozione di Solar Mini 4 dura fino al 22 ottobre e quella di Solar Pro 4 fino al 9 ottobre, quindi la finestra conveniente per confrontarli tra loro è nelle prossime due settimane. Esegui entrambi sul tuo traffico alle tariffe promozionali, con i tuoi criteri di accettazione, prima che scada una delle due scadenze. I benchmark indipendenti per Solar Mini 4 arriveranno prima o poi, e quando arriveranno ti diranno come si comporta su un compito di qualcun altro, che è una risposta diversa e meno utile di quella che puoi comprare per pochi dollari questo mese.
