Una hero card generata intitolata 'DeepSeek V4 Pro vs Qwen3.8 Max' con due card arrotondate — una card DeepSeek V4 Pro con badge '$0.66 / $1.98 fuori picco · pesi aperti MIT · contesto 1M' e una card Qwen3.8 Max con badge '$2.00 / $6.00 · Licenza commerciale · contesto 1M' — separate da un'icona bilancia e dal footer 'Tre volte il prezzo, quattro punti di intelligenza — quale sopravvive al contatto con la tua bolletta?'
Guides & Insights

DeepSeek V4 Pro vs Qwen3.8 Max: il divario di prezzo 3x, riesecuzione dopo la tregua di settembre

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

DeepSeek V4 Pro e Qwen3.8 Max sono i due flagship open o economici più importanti di questa generazione, e gli eventi di settembre sul fronte DeepSeek hanno cambiato la partita più di quanto il marketing di entrambi i fornitori abbia riconosciuto. DeepSeek V4 Pro è stato rilasciato il 13 agosto 2026, dieci giorni dopo che Qwen3.8 Max di Alibaba è diventato disponibile in generale il 3 agosto, e l'abbinamento è sempre stato letto come una sfida a senso unico: Qwen3.8 Max è l'all-rounder da 2,4 trilioni di parametri a 2 $ per milione di token in input e 6 $ per milione in output, mentre DeepSeek V4 Pro è lo specialista del reasoning da 1,6 trilioni di parametri a una frazione di quel prezzo, con licenza MIT e pesi pubblici. Il motivo per cui vale la pena rifare oggi questo confronto non sono i numeri della settimana di lancio, ma ciò che è accaduto un mese dopo — DeepSeek ha passato la settimana dell'8 settembre a cercare di ritirare V4 Pro, per poi tornare sui suoi passi l'11 settembre e impegnarsi a mantenerlo online con fatturazione invariata. Quell'inversione è il fatto più importante in assoluto su questa sfida in questo momento, perché decide se la metà economica sia una scommessa sicura o una trappola di migrazione.

Le misurazioni indipendenti in questo articolo provengono da Artificial Analysis, rilevate oggi. Le tabelle di benchmark di Alibaba e DeepSeek sono etichettate in tutto il documento come dati dichiarati dai fornitori — i numeri di lancio di nessuna delle due aziende sono stati completamente riprodotti da una terza parte, e quelli di DeepSeek hanno ormai quattro settimane rispetto a una classifica in continuo movimento.

La tregua di settembre è la notizia, non il lancio di agosto.

L'8 settembre, DeepSeek ha annunciato che dopo il 14 settembre ogni richiesta a deepseek-v4-pro sarebbe stata indirizzata a V4.1 Flash e fatturata ai prezzi di Flash fino al rilascio di un V4.1 Pro. Chiunque stesse eseguendo un confronto serio tra Qwen3.8 Max e DeepSeek V4 Pro ha dovuto iniziare a pianificare la scomparsa dell'opzione economica. Poi DeepSeek ha ritardato la scadenza, e l'11 settembre ha completamente invertito la rotta, dichiarando che avrebbe continuato a fornire servizi API per DeepSeek V4 Pro dopo il 14 settembre con fatturazione invariata, e dando preavviso se mai ciò fosse cambiato. L'inversione è stata riportata dai media statali cinesi e dalla stampa tecnologica lo stesso giorno.

Quello che questo fa al confronto è rimuovere l'asimmetria che stava silenziosamente orientando le decisioni. Per tutta la prima settimana di settembre, la risposta onesta a «dovrei costruire sul modello di output da $0,66 o sul modello di output da $6?» è stata contaminata dal rischio di sopravvivenza: il leader di prezzo aveva una data di spegnimento. Dal 15 settembre, quella contaminazione è scomparsa. L'opzione economica è durevole, e il confronto riguarda finalmente ciò su cui avrebbe sempre dovuto vertere — intelligenza, prezzo e velocità.

A generated scoreboard titled 'DeepSeek V4 Pro vs Qwen3.8 Max — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, License MIT open weights, Input text; right column Qwen3.8 Max rows AA Index 40 (#30/200), Price $2.00/$6.00, Speed ~41 tok/s, Context 1M, License Commercial, Input text + image + video; footer 'AA figures independent (current scale); DeepSeek price is vendor list off-peak.'

Prezzo: lo stesso gioco, a una frazione del costo di output

Nella classifica indipendente attuale i due distano quattro punti l'uno dall'altro, e il divario di prezzo tra loro è il più ampio del livello open-weights. Qwen3.8 Max costa 2,00 $ per milione di token in input e 6,00 $ per milione di token in output secondo il listino di Aliba​ba, con uno sconto sulla cache dell'88%. DeepSeek V4 Pro costa 0,66 $ per milione di token in input e 1,98 $ per milione di token in output nelle ore non di punta, il doppio a 1,32 $/3,96 $ nelle ore di punta, con uno sconto sulla cache del 97%.

• Prezzo — DeepSeek V4 Pro $0,66/$1,98 per 1M fuori picco (picco $1,32/$3,96) vs Qwen3.8 Max $2,00/$6,00 fisso

• Indice di Intelligenza — V4 Pro 36 (#7/113) vs Qwen3.8 Max 40 (#30/200)

• Velocità di output — V4 Pro ~81 token/sec vs Qwen3.8 Max ~41 token/sec

• Costo per attività — V4 Pro $0,67 vs Qwen3.8 Max $2,67 (per attività dell'indice AA)

• Contesto — entrambi 1M token

• Licenza — V4 Pro con pesi aperti MIT vs Qwen3.8 Max con pesi proprietari, licenza commerciale

Il rapporto prezzo-output è l'intero argomento: Qwen3.8 Max costa tre volte tanto per token di input e circa tre volte tanto per token di output alla tariffa di picco di V4 Pro — e il divario sull'output si allarga fino a sei volte quando V4 Pro viene fatturato alla sua tariffa fuori picco, che copre la maggior parte della settimana al di fuori di una finestra ristretta. Su un carico di lavoro intensivo di ragionamento, dove i token di output dominano la bolletta, quel divario è la differenza tra un modello che puoi lasciare in esecuzione e uno che tieni d'occhio nella dashboard. Le voci relative alla cache lo ampliano ulteriormente: lo sconto del 97% di V4 Pro contro l'88% di Qwen significa che un'attività a contesto lungo con un prefisso riutilizzato costa una frazione del suo prezzo di listino sul versante DeepSeek.

Intelligence: quattro punti di distacco, e il divario è il vero prodotto

Il punteggio indipendente rende questo confronto più serrato di quanto suggerisca il rapporto prezzo. Sull'attuale Artificial Analysis Intelligence Index, Qwen3.8 Max ottiene 40 contro il 36 di DeepSeek V4 Pro — un divario di quattro punti che emerge nelle attività ad alto ragionamento ma scompare in quelle ad alto consumo di token. Il vantaggio di Qwen3.8 Max è reale e costante: si classifica #30 su 200 complessivamente, appena dentro la frontiera, mentre V4 Pro si classifica #7 su 113 nella sua categoria open-weights. Nella tabella di benchmark di Alibaba stessa, Qwen3.8 Max dichiara un Terminal-Bench 2.1 di 86,6, GPQA Diamond 92,6 e un FrontierSWE 73,5 che ha quasi raddoppiato il 40,7 del suo predecessore — tutti dichiarati dal fornitore, nessuno riprodotto in modo indipendente. La model card di DeepSeek dichiara un rating Codeforces di 3.348 e un Terminal-Bench 2.1 di 87,9 con il massimo sforzo di ragionamento — anch'essi dichiarati dal fornitore e non verificati da terzi.

La lettura onesta è che le due aziende stanno parlando senza incontrarsi. La tabella del fornitore di Qwen3.8 Max è costruita attorno al lavoro aziendale e scientifico — l'aggiornamento 0902 che Alibaba ha rilasciato il 2 settembre è stato ulteriormente post-addestrato su Coding e Cowork, il che, secondo Qwen, rafforza proprio quel profilo. Le rivendicazioni di DeepSeek V4 Pro si concentrano sul ragionamento profondo e sull'uso agentico degli strumenti, dove i suoi numeri su Codeforces e Terminal-Bench, vecchi di quattro settimane, sembrano ancora solidi. Nessuna delle tabelle dei due fornitori è stata riprodotta da un valutatore indipendente, e sull'unico tabellone che sia indipendente, il divario di quattro punti è tutta la differenza tra i modelli.

La velocità è il punto in cui Qwen3.8 Max perde silenziosamente terreno

La dimensione che la scheda tecnica nasconde è la velocità di output. Artificial Analysis misura DeepSeek V4 Pro a circa 81 token al secondo, contro i circa 41 di Qwen3.8 Max — una differenza doppia nella velocità con cui arrivano le risposte. Su un carico di lavoro di chat è una pausa che l'utente nota; su un ciclo di agent con molte chiamate sequenziali, si accumula fino a diventare tempo effettivo trascorso. Il rapporto di prezzo favorisce già V4 Pro, e il divario di velocità rende il divario effettivo di costo per risposta ancora più ampio di quanto suggerisca il calcolo dei token.

C'è un trade-off nascosto in quel numero, ed è la verbosità di Qwen3.8 Max. Artificial Analysis osserva che il modello è «notevolmente lento e molto verboso», e il suo costo per attività — 2,67 $ contro gli 0,67 $ di V4 Pro — riflette sia la tariffa più alta sia i token di output aggiuntivi. Un modello di ragionamento che scrive di più per ogni risposta costa di più per attività ancora prima di moltiplicare per il tariffario. Se il tuo carico di lavoro è sensibile alla latenza o il tuo ciclo di agenti effettua decine di chiamate, questo è il numero su cui eseguire la tua valutazione.

Pesi: MIT contro una licenza commerciale

DeepSeek V4 Pro è rilasciato con licenza MIT e pesi pubblici — puoi scaricarli, servirli su infrastruttura propria, metterli a punto e mantenere chiuse le tue modifiche. Qwen3.8 Max è il primo Qwen di classe Max in assoluto a essere distribuito con pesi aperti (il checkpoint 2.4T A95B è arrivato il 12 agosto), ma con una licenza commerciale e condizioni legate al livello di scala, e Alibaba non ha pubblicato l'intera stack di inferenza come ha fatto DeepSeek. Per un'azienda che confronta i due, il modello di deployment è l'elemento decisivo: V4 Pro può essere self-hosted come infrastruttura; Qwen3.8 Max è principalmente un servizio che si affitta. La differenza nei pesi conta soprattutto se la tua preoccupazione è il vendor lock-in o se vuoi sfuggire del tutto al prezzo delle API.

Chi dovrebbe scegliere cosa

Se il tuo carico di lavoro è incentrato sul ragionamento, dominato dai token di output o sensibile alla latenza, DeepSeek V4 Pro è la risposta su quasi ogni asse che compare nella bolletta: circa da tre a sei volte più economico sull'output, circa due volte più veloce, sconto cache più profondo e pesi MIT come via di fuga. Il divario di intelligenza di quattro punti è reale ma stretto, e raramente sopravvive al contatto con la differenza di prezzo sul traffico di produzione.

Se il tuo carico di lavoro ha una forma enterprise — analisi complesse a più passaggi, derivazione logica profonda, lavoro agentico impegnativo o qualsiasi attività in cui la qualità marginale della risposta valga da tre a sei volte il costo in token — i quattro punti in più di Qwen3.8 Max sull'indice indipendente e le sue dichiarazioni più solide sui benchmark enterprise sono il motivo per pagare il premium. L'aggiornamento 0902 affina questo profilo. E se hai bisogno di input di immagini o video, la scelta non è nemmeno in discussione: Qwen3.8 Max accetta testo, immagini e video, mentre DeepSeek V4 Pro è solo testo.

Entrambi i modelli sono richiamabili tramite OrcaRouter con una singola chiave — sia DeepSeek V4 Pro sia Qwen3.8 Max vengono instradati attraverso la piattaforma — e poiché OrcaRouter trasmette i prezzi di listino dei provider senza alcun ricarico, i numeri in questo articolo sono i numeri che paghi davvero, con i tagli di prezzo dei fornitori che arrivano lo stesso giorno. Il DSL di routing ti permette di indirizzare il traffico ad alto consumo di token o sensibile alla latenza verso DeepSeek V4 Pro e le attività multimodali o di ragionamento più critiche verso Qwen3.8 Max dalla stessa integrazione — ed è esattamente così che la maggior parte dei team finisce per usare questa combinazione: entrambi, per ciò che ciascuno fa meglio.

A screenshot of the Artificial Analysis page for Qwen3.8 Max, captured September 15, 2026, showing the Intelligence Index score of 40 at rank 30 of 200, output speed 40.6 tokens per second, an input price of $2.00 and output price of $6.00 per million tokens with an 88% cache discount, and a cost of $2.67 per Intelligence Index task.A screenshot of the OrcaRouter model page for Qwen3.8 Max at orcarouter.ai/models/qwen/qwen3.8-max, captured September 15, 2026, showing the model listing with its provider Qwen, 1M-token context window, text+image+video input, and $2.00/$6.00 per-million-token pricing alongside the surrounding catalogue.

Il verdetto

La tregua di settembre ha risolto la questione che stava affogando questo confronto: la metà economica non è più un rischio di fuga. DeepSeek V4 Pro è la risposta in termini di costo-prestazioni — da tre a sei volte più economico sull'output, due volte più veloce, con licenza MIT, e ora impegnato a rimanere online. Qwen3.8 Max è la risposta in termini di capacità — quattro punti di indice indipendenti in più, rivendicazioni enterprise più forti, input multimodale e una licenza commerciale che lo tiene fuori dal tuo stack. Scegli i quattro punti quando le tue valutazioni dimostrano che contano; scegli il prezzo quando la tua bolletta è la valutazione che decide davvero.

Invia il traffico ad alto consumo di token o sensibile alla latenza a DeepSeek V4 Pro e il ragionamento multimodale o di massima posta in gioco a Qwen3.8 Max dalla stessa integrazione — ed è esattamente così che la maggior parte dei team finisce per usare questa combinazione: entrambi, per ciò che ciascuno sa fare meglio.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno