Una scheda del titolo hero generata che recita 'Solar Mini 4 vs Qwen3.8-Max' con il sottotitolo 'Quanto sono realmente costati gli ultimi venti punti dell'indice' e due badge che recitano '24,1 contro 45,4 sull'indice' e '0,36 $ contro 5,41 $ per attività'.
Guides & Insights

Solar Mini 4 vs Qwen3.8-Max: quanto costano davvero gli ultimi venti punti dell'indice

Autore

Magnus Corvin

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Solar Mini 4 costa $0,10 per milione di token di input e $0,40 per milione di token di output. Qwen3.8-Max, il modello che la maggior parte delle persone intende quando digita "Qwen 3.8" e chiede l'API, costa $2,00 e $6,00. Su un listino prezzi, si legge come una differenza di venti volte nel prezzo di input. Nella valutazione indipendente a cui entrambi i modelli sono ormai stati sottoposti, il dato onesto è che Qwen3.8-Max totalizza 45,4 sull'Artificial Analysis Intelligence Index contro il 24,1 di Solar Mini 4 — all'incirca il doppio della capacità misurata — pur costando circa quindici volte tanto per attività completata. Tutto ciò che vale la pena sapere su questo abbinamento è nel divario tra quei due rapporti, e nel fatto che il modello di Upstage gira a 204 token al secondo mentre il modello di punta di Alibaba gira a 39.

Una nota sui nomi prima dei numeri, perché cambia ciò che stai acquistando. Qwen 3.8 è una generazione, non un modello: il modello di punta ospitato è Qwen3.8-Max, aggiornato come snapshot datato 0902, e il membro scaricabile della stessa generazione è Qwen3.8-2.4T-A95B, i pesi da 2,4 trilioni di parametri che Alibaba ha pubblicato il 12 agosto 2026. Solar Mini 4, rilasciato il 22 settembre 2026, è lo sparse mixture-of-experts da 35 miliardi di parametri di Upstage, con circa 3 miliardi di parametri attivi per token e nessun peso aperto a qualunque prezzo.

Le due colonne, sulle dimensioni che decidono l'approvvigionamento

• Indice di Intelligenza — 45,4 per Qwen3.8-Max (0902) contro 24,1 per Solar Mini 4, entrambi sull'Indice di Intelligenza v4.3.2.

• Costo per attività completata — 5,41 $ per Qwen3.8-Max contro 0,36 $ per Solar Mini 4. Circa quindici a uno, e il rapporto che nessuno cita.

• Listino prezzi — 2,00 $ / 6,00 $ per milione di token, input in cache 0,25 $, per Qwen3.8-Max rispetto a 0,10 $ / 0,40 $, input in cache 0,01 $, per Solar Mini 4.

• Contesto — 1.000.000 di token su entrambi, che è l'unica dimensione in cui il modello economico non concede nulla. Artificial Analysis indica 983.616 per Qwen3.8-Max e 1.048.576 per Solar Mini 4; la documentazione di Upstage parla invece di 512K, quindi il tetto del modello piccolo è il meno certo dei due.

• Pesi — Qwen3.8-Max è proprietario e ospitato; il suo fratello open source Qwen3.8-2.4T-A95B è scaricabile con una licenza personalizzata e ottiene 39,9 sullo stesso indice con 262.000 token di contesto. Solar Mini 4 è proprietario e non ha un fratello open source.

• Velocità di elaborazione — 204 token di output al secondo per Solar Mini 4 contro 39,5 per Qwen3.8-Max, come misurato dallo stesso laboratorio. Il modello che costa un quindicesimo per attività è cinque volte più veloce a svolgerla.

Cosa comprano ventuno punti indice

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

Loro comprano la parte difficile della distribuzione. Su Humanity's Last Exam, Qwen3.8-Max risponde correttamente al 43,1% degli elementi, contro il 25,8% di Solar Mini 4. Nella programmazione scientifica è il 52,1% contro il 47,6%. Nel lavoro di conoscenza agentico il divario si allarga fino a diventare una categoria a parte: Qwen3.8-Max raggiunge 1663 Elo su GDPval-AA, mentre Solar Mini 4 arriva a 1072 — quasi seicento punti Elo, che non è una differenza di arrotondamento, ma un cambiamento in ciò che il modello può fare in modo affidabile senza supervisione.

L'unica valutazione in cui il modello piccolo non si limita a tenere testa ma vince è il ragionamento su contesti lunghi. Solar Mini 4 ottiene 83,3% su AA-LCR v1.1 e Qwen3.8-Max ottiene 80,3%. Questo è l'argomento più forte a favore di Solar Mini 4 in tutto questo confronto: sul benchmark creato per testare "leggere un documento molto lungo e ragionare lungo tutto il suo contenuto", un prezzo per attività quindici volte superiore compra un risultato che è di tre punti peggiore.

Il campo in cui nessuno dei due modelli è lo strumento giusto è quello del lavoro autonomo da terminale. Solar Mini 4 ottiene l'1% su Terminal-Bench 4.0; Qwen3.8-Max ottiene il 38,9%. Un modello che supera otto dei venti compiti complessi da terminale è davvero utilizzabile in quel contesto, mentre l'altro no: è l'esempio più chiaro, in questo confronto, di un divario di natura, non di grado.

Perché il conto per attività del modello di punta è molto peggiore di quanto suggerisca il prezzo dei token

Qwen3.8-Max emette più output per attività di Solar Mini 4 — 107.700 token contro 88.300 — e li emette a 6,00 $ per milione anziché 0,40 $. È lì che sta gran parte del divario, prima ancora di considerare il comportamento della cache. Alibaba offre effettivamente una tariffa di input in cache di 0,25 $, che è uno sconto reale rispetto al suo prezzo di input di 2,00 $, e il gemello open della famiglia, Qwen3.8-2.4T-A95B, è un modello sparse da 2,4 trilioni di parametri con circa 95 miliardi di parametri attivi, quindi ogni token che produce è prodotto da una macchina sostanzialmente più grande. Niente di tutto ciò è una critica. È il motivo per cui esiste un moltiplicatore di quindici volte per attività, e il motivo per cui un confronto dei prezzi per token tra questi due modelli è fuorviante in entrambe le direzioni.

La conseguenza pratica: Solar Mini 4 non è "il Qwen 3.8 economico". È uno specialista che per caso è economico, veloce e forte esattamente su un asse — i documenti lunghi — e debole sull'asse dove sbagliare costa di più, ovvero l'affidabilità agentica. Qwen3.8-Max è il generalista il cui vantaggio si manifesta proprio dove una risposta sbagliata è costosa.

Gestire la coppia invece di scegliere tra loro

Questo è il caso insolito della serie Solar Mini 4 in cui entrambe le parti del confronto sono route che possiamo effettivamente venderti. Qwen3.8-Max e la sua istantanea datata 0902 si trovano su OrcaRouter al listino del fornitore stesso di $2,00 / $6,00, accanto a Qwen3.8-Flash a $0,15 / $0,47 e Qwen3.8-27B a $0,33 / $2,40 — tre livelli della stessa generazione, una sola chiave, nessun secondo contratto e nessuna modifica al codice oltre a una stringa di modello. Al 1° ottobre 2026 la nostra misurazione nel playground pone Qwen3.8-Max a un p50 di 2,5 secondi con 87,7 token di output al secondo negli ultimi sette giorni; quella finestra scorre, quindi leggi la scheda del modello live anziché questa frase. I modelli di Upstage non sono disponibili tramite noi, e Solar Mini 4 deve essere raggiunto tramite l'API di Upstage stesso.

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

Ciò che questo rende possibile è la suddivisione per cui argomenta questo confronto: inviare il traffico di documenti lunghi, in lingua coreana e di estrazione strutturata verso una soluzione economica, instradare le richieste ad alto ragionamento e con uso di strumenti verso il modello di punta, e lasciare che il failover copra il provider che ha una giornata storta. È anche il punto in cui il DSL di routing si guadagna il suo posto — comporre modelli in un'unica chiamata significa che un primo passaggio economico e un passaggio di verifica costoso possono essere una sola richiesta verso un unico endpoint invece di due integrazioni che devono essere mantenute sincronizzate.

La versione breve

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

Se il tuo carico di lavoro è a contesto lungo, con una forma di output fissa e un budget di latenza tollerabile, Solar Mini 4 ti offre l'83% del risultato sul contesto lungo a un quindicesimo del costo dell'attività e con una capacità di elaborazione cinque volte superiore, e i ventuno punti di indice mancanti non appariranno mai sulla tua dashboard. Se il tuo carico di lavoro prevede strumenti, agenti multi-step o domande in cui una risposta sbagliata ma sicura è peggio di nessuna risposta, i punti mancanti sono l'intero prodotto e Qwen3.8-Max vale quindici volte il prezzo. Ogni cifra sopra attribuita ad Artificial Analysis è una misurazione indipendente di quell'organizzazione; la denominazione e le date di rilascio di Qwen3.8 sono di Alibaba, e i dati di serving di OrcaRouter sono una nostra misurazione nel playground su una finestra mobile di sette giorni.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno