
GPT-6 Sol vs Qwen 4 Max: il prezzo di input è in parità e quasi tutto il resto non è confrontabile
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Ecco il numero che rende l'abbinamento GPT-6 Sol e Qwen 4 Max meritevole di una pagina dedicata: entrambi sono indicati a $2.00 per milione di token di input. È qui che inizia la parte utilizzabile del confronto e, per Qwen 4 Max, quasi esattamente dove finisce. L'azienda ha annunciato il tier Qwen 4 Max il 22 settembre 2026 alla sua conferenza Apsara — lo stesso giorno in cui è stato rilasciato GPT-6 Sol — e al momento in cui scriviamo non esiste alcuna model card pubblicata al riguardo: nessun prezzo, nessuna finestra di contesto, nessuna dichiarazione sui pesi e nessun punteggio da parte di alcun valutatore. Il flagship Qwen che dispone davvero di misurazioni, e che puoi chiamare oggi, è Qwen3.8 Max, rilasciato il 3 agosto 2026 a $2.00 / $6.00. Quindi la domanda pratica non è come si comporta Qwen 4 Max rispetto a GPT-6 Sol. È ciò che il tier annunciato ti dice su dove sta andando il flagship dell'azienda, e ciò che il Qwen che puoi effettivamente instradare fa oggi contro il modello GPT-6.
Quella distinzione non è pedanteria. Un livello che è stato annunciato ma non specificato può assorbire qualsiasi ipotesi tu voglia fare al riguardo, e un articolo che presume silenziosamente che Qwen 4 Max superi GPT-6 Sol — perché il numero di versione è più alto — avanza un'argomentazione che il fornitore non ha avanzato e che le prove non supportano.
Tre cose che sono paragonabili in questo momento
• Prezzo di input — GPT-6 Sol $2,00 per milione vs Qwen3.8 Max $2,00 per milione, una parità esatta
• Prezzo di output — GPT-6 Sol $10,00 per milione vs Qwen3.8 Max $6,00 per milione
• Input in cache — GPT-6 Sol $0,20 per milione vs Qwen3.8 Max $0,25 per milione
• Finestra di contesto — GPT-6 Sol 1.050.000 token vs Qwen3.8 Max 1.000.000 token
• Modalità di input — entrambi accettano testo, immagini e video o file; GPT-6 Sol testo, immagini e file, Qwen3.8 Max testo, immagini e video
• Scaglione per richieste lunghe — GPT-6 Sol riprezza l'intera richiesta oltre 272.000 token di input a $4,00 / $15,00 vs Qwen3.8 Max nessuno scaglione sulla sua scheda
• Indice di intelligenza — GPT-6 Sol 47,6 vs Qwen3.8 Max 45,4
• Indice di coding — GPT-6 Sol non pubblicato in questa revisione vs Qwen3.8 Max 76,2
• GPQA Diamond — GPT-6 Sol 96,1 vs Qwen3.8 Max 92,8
• Terminal-Bench 4.0 — GPT-6 Sol 43,9 vs Qwen3.8 Max 38,9
Due di quelle righe sono quelle su cui vale la pena soffermarsi. La riga dell'input in cache va contro il pattern — Qwen3.8 Max addebita cinque centesimi in più per milione per le letture dalla cache rispetto a GPT-6 Sol, che in un loop di agente a forte uso di cache è il contatore che si muove per primo. E la clausola sulle richieste lunghe è il punto in cui la parità sul prezzo dell'input si rompe definitivamente: a esattamente $2,00 in input, i due sembrano intercambiabili finché un prompt non supera i 272.000 token, a quel punto l'intera richiesta di GPT-6 Sol viene riprezzata a $4,00 / $15,00, mentre la scheda di Qwen3.8 Max non riporta affatto uno scaglione equivalente. Su un prompt a contesto pieno, il modello dell'azienda non è semplicemente più economico sull'output. È l'unico dei due di cui si può ancora prevedere la tariffa pubblicata dal prezzo di copertina.
Due cose che non sono paragonabili, e perché la differenza conta
Il primo è la capacità di Qwen 4 Max. L'azienda l'ha presentato come un livello in una gamma anziché come un prodotto: nessuna tabella di benchmark, nessun dato sul contesto, nessuna dichiarazione sui pesi, nessun tasso. Tutto ciò che è stato scritto su come si comporterà è una proiezione dalla traiettoria della linea Qwen, inclusa questa frase. L'unica cosa leggibile è l'obiettivo — il livello che sostituisce e il modello che il successore è costruito per superare — e questo ti dice la direzione di marcia, non la destinazione.
La seconda è la questione dei pesi aperti, ed è quella che più merita di essere segnalata prima di pianificare un deployment di Qwen 4 Max. L'azienda pubblica i pesi per alcune parti della famiglia Qwen e non per altre. Qwen3.8 Max, il modello di punta, è elencato come modello API chiuso — nessun file di licenza, nessun checkpoint scaricabile — anche se i fratelli minori della stessa generazione sono pubblicati. Se il modello di punta della serie 4 seguirà i fratelli minori o resterà chiuso è una domanda senza risposta, e un team che costruisce un piano di self-hosting basandosi sull'aspettativa di pesi aperti scommetterebbe su un precedente che l'attuale modello di punta non stabilisce.
Il confronto che viene effettivamente eseguito è GPT-6 Sol contro Qwen3.8 Max, ed è più serrato di quanto suggeriscano i numeri di generazione: 47,6 contro 45,4 sull'Intelligence Index, entrambi dati di terze parti sulla stessa revisione, e GPQA Diamond un autentico 96,1 contro 92,8. Un divario di 2,2 punti nell'indice a tre quarti del prezzo di output è la versione più stretta di questa sfida disponibile, ed è quella da cui ragionare finché l'azienda non pubblica qualcosa per la serie 4.

Di cosa l'annuncio stesso è prova
Un livello annunciato ma non specificato non è un segnale vuoto. Indica che l'azienda intende collocare la sua prossima ammiraglia in cima alla gamma e che è disposta a nominarla pubblicamente prima che sia pronta, il che è un cambiamento nelle abitudini di comunicazione più che una dichiarazione di capacità. Fa partire anche un conto alla rovescia: un livello annunciato a settembre crea l'aspettativa di una finestra di spedizione, e il divario tra annuncio e specifica è dove di solito avviene il posizionamento competitivo.
Per chiunque al momento utilizzi Qwen3.8 Max, la conseguenza pratica è che la migrazione sarà una questione di capacità più che di costo. Il tier che Qwen 4 Max è pensato per sostituire è già a $2,00 / $6,00, e il successore deve battere un modello che segna 45,4 pur costando un terzo in meno sull'output rispetto a GPT-6 Sol. Se colmerà anche il divario verso 47,6 — e a quale data — è l'unica cosa che valga la pena monitorare, e non c'è nulla nell'annuncio che risponda a questo.

Instradamento di un modello che non esiste ancora
Solo uno dei due modelli Qwen in questa conversazione è nel nostro catalogo, e non è la serie 4. Qwen3.8 Max è instradato tramite OrcaRouter con l'id modello qwen/qwen3.8-max, sulla stessa chiave di GPT-6 Sol e di oltre 200 altri modelli, e l'abbinamento vale esattamente questo: un cambio di route anziché un progetto di integrazione quando l'azienda pubblicherà il successore. Qwen 4 Max sarà aggiunto quando ci sarà qualcosa da instradare — una scheda, una tariffa, un endpoint — e non prima, perché non c'è modo responsabile di vendere uno slot sulla base di una specifica che non è ancora stata scritta.
Nel frattempo, il motivo per tenere aperte entrambe le colonne è che i due modelli non concordano su dove risultino economici. Qwen3.8 Max non rinuncia a nulla sul prezzo dell'input e riduce di un terzo la tariffa di output di GPT-6 Sol, e non ha alcun salto di costo per il contesto lungo; GPT-6 Sol offre un indice marginalmente migliore e uno sconto molto più ricco sull'input in cache, al costo di riprezzare l'intera richiesta oltre 272.000 token. Un carico di lavoro lungo e con molto output e un carico di lavoro breve e ottimizzato per la cache vogliono risposte diverse, ed entrambi distano una sola regola di routing anziché due conversazioni di approvvigionamento.
Il failover qui è importante per una ragione specifica a questo confronto. Qwen3.8 Max è un modello ad alto volume sulle nostre rotte — più di 110 milioni di token in una finestra di sette giorni — ed è il volume a far emergere la varianza degli endpoint. Una seconda rotta configurata alle spalle significa che un primario degradato è un retry, e una variazione di tariffa sulla carta dell'azienda, che è esattamente il tipo di evento prodotto da un passaggio di consegne di un flagship, è attiva dalla nostra parte lo stesso giorno perché il nostro catalogo riporta i prezzi di listino dei provider senza alcun ricarico.

Cosa fare con questo, questo mese
Se ti serve subito un modello di punta Qwen, quello a cui rivolgerti è Qwen3, ed è competitivo con GPT-6 Sol sul ragionamento a una tariffa di output sensibilmente inferiore — questo è l'onesto stato attuale del confronto. Se ti serve il risultato pubblicato più forte sui benchmark di ragionamento di questa coppia, il 47,6 di GPT-6 Sol è il numero, e il suo sconto sull'input in cache è il più conveniente del confronto. Se stai aspettando Qwen 4 Max, aspetta una scheda anziché una data, perché l'annuncio ti ha dato il tier e nient'altro.
E qualunque cosa tu scelga, controlla il lato GPT-6 prima di impegnarti. GPT-6 Sol è già stato soppiantato da GPT-6.1 Sol allo stesso prezzo di $2,00 / $10,00, con l'input in cache dimezzato a $0,10, e la sua pagina dedicata al modello ora reindirizza i lettori a quest'ultimo. Un confronto con GPT-6 Sol è un confronto con un modello il cui successore è già in vendita, e la stessa cautela vale per qualsiasi dato su Qwen derivato dall'annuncio di 4 Max: entrambi sono forme di notizia, e solo uno dei due è un prodotto acquistabile in questo momento.
Confrontati in questo articolo3
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
