
Solar Mini 4 vs Qwen3.8-Max: quanto costano davvero gli ultimi venti punti dell'indice
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 per 1M di token
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 per 1M di token · 159 tok/s
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 220 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Solar Mini 4 costa $0,10 per milione di token di input e $0,40 per milione di token di output. Qwen3.8-Max, il modello che la maggior parte delle persone intende quando digita "Qwen 3.8" e chiede l'API, costa $2,00 e $6,00. Su un listino prezzi, si legge come una differenza di venti volte nel prezzo di input. Nella valutazione indipendente a cui entrambi i modelli sono ormai stati sottoposti, il dato onesto è che Qwen3.8-Max totalizza 45,4 sull'Artificial Analysis Intelligence Index contro il 24,1 di Solar Mini 4 — all'incirca il doppio della capacità misurata — pur costando circa quindici volte tanto per attività completata. Tutto ciò che vale la pena sapere su questo abbinamento è nel divario tra quei due rapporti, e nel fatto che il modello di Upstage gira a 204 token al secondo mentre il modello di punta di Alibaba gira a 39.
Una nota sui nomi prima dei numeri, perché cambia ciò che stai acquistando. Qwen 3.8 è una generazione, non un modello: il modello di punta ospitato è Qwen3.8-Max, aggiornato come snapshot datato 0902, e il membro scaricabile della stessa generazione è Qwen3.8-2.4T-A95B, i pesi da 2,4 trilioni di parametri che Alibaba ha pubblicato il 12 agosto 2026. Solar Mini 4, rilasciato il 22 settembre 2026, è lo sparse mixture-of-experts da 35 miliardi di parametri di Upstage, con circa 3 miliardi di parametri attivi per token e nessun peso aperto a qualunque prezzo.
Le due colonne, sulle dimensioni che decidono l'approvvigionamento
• Indice di Intelligenza — 45,4 per Qwen3.8-Max (0902) contro 24,1 per Solar Mini 4, entrambi sull'Indice di Intelligenza v4.3.2.
• Costo per attività completata — 5,41 $ per Qwen3.8-Max contro 0,36 $ per Solar Mini 4. Circa quindici a uno, e il rapporto che nessuno cita.
• Listino prezzi — 2,00 $ / 6,00 $ per milione di token, input in cache 0,25 $, per Qwen3.8-Max rispetto a 0,10 $ / 0,40 $, input in cache 0,01 $, per Solar Mini 4.
• Contesto — 1.000.000 di token su entrambi, che è l'unica dimensione in cui il modello economico non concede nulla. Artificial Analysis indica 983.616 per Qwen3.8-Max e 1.048.576 per Solar Mini 4; la documentazione di Upstage parla invece di 512K, quindi il tetto del modello piccolo è il meno certo dei due.
• Pesi — Qwen3.8-Max è proprietario e ospitato; il suo fratello open source Qwen3.8-2.4T-A95B è scaricabile con una licenza personalizzata e ottiene 39,9 sullo stesso indice con 262.000 token di contesto. Solar Mini 4 è proprietario e non ha un fratello open source.
• Velocità di elaborazione — 204 token di output al secondo per Solar Mini 4 contro 39,5 per Qwen3.8-Max, come misurato dallo stesso laboratorio. Il modello che costa un quindicesimo per attività è cinque volte più veloce a svolgerla.
Cosa comprano ventuno punti indice

Loro comprano la parte difficile della distribuzione. Su Humanity's Last Exam, Qwen3.8-Max risponde correttamente al 43,1% degli elementi, contro il 25,8% di Solar Mini 4. Nella programmazione scientifica è il 52,1% contro il 47,6%. Nel lavoro di conoscenza agentico il divario si allarga fino a diventare una categoria a parte: Qwen3.8-Max raggiunge 1663 Elo su GDPval-AA, mentre Solar Mini 4 arriva a 1072 — quasi seicento punti Elo, che non è una differenza di arrotondamento, ma un cambiamento in ciò che il modello può fare in modo affidabile senza supervisione.
L'unica valutazione in cui il modello piccolo non si limita a tenere testa ma vince è il ragionamento su contesti lunghi. Solar Mini 4 ottiene 83,3% su AA-LCR v1.1 e Qwen3.8-Max ottiene 80,3%. Questo è l'argomento più forte a favore di Solar Mini 4 in tutto questo confronto: sul benchmark creato per testare "leggere un documento molto lungo e ragionare lungo tutto il suo contenuto", un prezzo per attività quindici volte superiore compra un risultato che è di tre punti peggiore.
Il campo in cui nessuno dei due modelli è lo strumento giusto è quello del lavoro autonomo da terminale. Solar Mini 4 ottiene l'1% su Terminal-Bench 4.0; Qwen3.8-Max ottiene il 38,9%. Un modello che supera otto dei venti compiti complessi da terminale è davvero utilizzabile in quel contesto, mentre l'altro no: è l'esempio più chiaro, in questo confronto, di un divario di natura, non di grado.
Perché il conto per attività del modello di punta è molto peggiore di quanto suggerisca il prezzo dei token
Qwen3.8-Max emette più output per attività di Solar Mini 4 — 107.700 token contro 88.300 — e li emette a 6,00 $ per milione anziché 0,40 $. È lì che sta gran parte del divario, prima ancora di considerare il comportamento della cache. Alibaba offre effettivamente una tariffa di input in cache di 0,25 $, che è uno sconto reale rispetto al suo prezzo di input di 2,00 $, e il gemello open della famiglia, Qwen3.8-2.4T-A95B, è un modello sparse da 2,4 trilioni di parametri con circa 95 miliardi di parametri attivi, quindi ogni token che produce è prodotto da una macchina sostanzialmente più grande. Niente di tutto ciò è una critica. È il motivo per cui esiste un moltiplicatore di quindici volte per attività, e il motivo per cui un confronto dei prezzi per token tra questi due modelli è fuorviante in entrambe le direzioni.
La conseguenza pratica: Solar Mini 4 non è "il Qwen 3.8 economico". È uno specialista che per caso è economico, veloce e forte esattamente su un asse — i documenti lunghi — e debole sull'asse dove sbagliare costa di più, ovvero l'affidabilità agentica. Qwen3.8-Max è il generalista il cui vantaggio si manifesta proprio dove una risposta sbagliata è costosa.
Gestire la coppia invece di scegliere tra loro
Questo è il caso insolito della serie Solar Mini 4 in cui entrambe le parti del confronto sono route che possiamo effettivamente venderti. Qwen3.8-Max e la sua istantanea datata 0902 si trovano su OrcaRouter al listino del fornitore stesso di $2,00 / $6,00, accanto a Qwen3.8-Flash a $0,15 / $0,47 e Qwen3.8-27B a $0,33 / $2,40 — tre livelli della stessa generazione, una sola chiave, nessun secondo contratto e nessuna modifica al codice oltre a una stringa di modello. Al 1° ottobre 2026 la nostra misurazione nel playground pone Qwen3.8-Max a un p50 di 2,5 secondi con 87,7 token di output al secondo negli ultimi sette giorni; quella finestra scorre, quindi leggi la scheda del modello live anziché questa frase. I modelli di Upstage non sono disponibili tramite noi, e Solar Mini 4 deve essere raggiunto tramite l'API di Upstage stesso.

Ciò che questo rende possibile è la suddivisione per cui argomenta questo confronto: inviare il traffico di documenti lunghi, in lingua coreana e di estrazione strutturata verso una soluzione economica, instradare le richieste ad alto ragionamento e con uso di strumenti verso il modello di punta, e lasciare che il failover copra il provider che ha una giornata storta. È anche il punto in cui il DSL di routing si guadagna il suo posto — comporre modelli in un'unica chiamata significa che un primo passaggio economico e un passaggio di verifica costoso possono essere una sola richiesta verso un unico endpoint invece di due integrazioni che devono essere mantenute sincronizzate.
La versione breve

Se il tuo carico di lavoro è a contesto lungo, con una forma di output fissa e un budget di latenza tollerabile, Solar Mini 4 ti offre l'83% del risultato sul contesto lungo a un quindicesimo del costo dell'attività e con una capacità di elaborazione cinque volte superiore, e i ventuno punti di indice mancanti non appariranno mai sulla tua dashboard. Se il tuo carico di lavoro prevede strumenti, agenti multi-step o domande in cui una risposta sbagliata ma sicura è peggio di nessuna risposta, i punti mancanti sono l'intero prodotto e Qwen3.8-Max vale quindici volte il prezzo. Ogni cifra sopra attribuita ad Artificial Analysis è una misurazione indipendente di quell'organizzazione; la denominazione e le date di rilascio di Qwen3.8 sono di Alibaba, e i dati di serving di OrcaRouter sono una nostra misurazione nel playground su una finestra mobile di sette giorni.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
