
DeepSeek V4 Pro vs Grok 4.6: una guerra dei prezzi combattuta a 24 ore di distanza, e chi l'ha vinta davvero
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleNUOVOGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenNUOVOQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenza72Codice
- anthropicNUOVOAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenza69Codice
Grok 4.6 è stato rilasciato il 12 agosto 2026, e DeepSeek V4 Pro è seguito il giorno successivo — i due lanci di punta nell'arco delle stesse quarantotto ore, ora a un mese di distanza e di nuovo degni di essere rivisitati perché uno dei due ha passato la settimana scorsa a cercare di ritirarsi per poi cambiare idea. Entrambi sono modelli di ragionamento di livello frontier, ma non potrebbero essere prodotti più diversi: Grok 4.6 è il flagship proprietario di xAI a 2,00 $ per milione di token di input e 6,00 $ per milione di token di output, e DeepSeek V4 Pro è il modello open-weights con licenza MIT di DeepSeek a 0,66 $/1,98 $ fuori picco (o 1,32 $/3,96 $ in orario di punta). La cosa interessante del confronto è quanto poco il rapporto grezzo dei prezzi — circa 3x sull'output, oltre 9x quando si sommano le finestre fuori picco e di cache di V4 Pro — ti dica riguardo a chi dovrebbe usare quale. I due sono rivolti ad acquirenti diversi, e gli eventi di settembre sul fronte DeepSeek hanno cambiato i calcoli per esattamente uno di quegli acquirenti.
I numeri indipendenti in questo articolo sono misurazioni di Artificial Analysis. Le cifre eseguite dai fornitori sono etichettate come dichiarate dai fornitori perché i benchmark di lancio di nessuna delle due aziende sono stati riprodotti da una terza parte.
Stessa settimana, stessa classe di ragionamento, filosofie opposte
Sull'Artificial Analysis Intelligence Index, Grok 4.6 ottiene 44 con effort alto — al 20° posto su 200 nell'intero indice — mentre DeepSeek V4 Pro ottiene 36, al 7° posto nella sua categoria. Un divario di otto punti, il che significa che il premium compra davvero un ragionamento misurabile, non solo packaging. Ma è il packaging a spiegare il resto della differenza di prezzo: Grok 4.6 è un modello multimodale proprietario — input di testo e immagini, contesto da 500K, ragionamento predefinito — che si invoca tramite l'API di xAI o di un partner. DeepSeek V4 Pro è solo testo, con contesto da 1M, e viene distribuito con pesi con licenza MIT che puoi scaricare ed eseguire in autonomia.
• Indice di intelligenza — Grok 4.6 44 (#20/200) contro V4 Pro 36 (#7/113)
• Prezzo — Grok 4.6 $2,00/$6,00 per 1M rispetto a V4 Pro $0,66/$1,98 fuori punta ($1,32/$3,96 in punta)
• Velocità — Grok 4.6 ~57 token/sec vs V4 Pro ~81 token/sec
• Contesto — Grok 4.6 500K vs V4 Pro 1M
• Input — Grok 4.6 testo e immagine vs V4 Pro solo testo
• Pesi — Grok 4.6 proprietario vs pesi aperti MIT di V4 Pro
Dove il premio di prezzo di 3 volte si manifesta e dove no
Il divario di prezzo è reale ed è in parte un divario di intelligenza, ma solo in parte. Grok 4.6 è in vantaggio di otto punti sull'indice indipendente, e il resto del sovrapprezzo ti offre cose diverse dalla capacità grezza: l'ecosistema di xAI, l'input di immagini e una finestra di contesto da 500K offerta da un'azienda il cui intero business è quel singolo prodotto. Il contrasto più forte è la storia del deployment. Grok 4.6 è un servizio: lo noleggi, non lo possiedi mai. DeepSeek V4 Pro è anch'esso un servizio, ma i pesi MIT significano che è anche infrastruttura: se il prezzo dell'API o la roadmap del fornitore non ti soddisfano più, puoi installare lo stesso modello sul tuo hardware al costo marginale del calcolo. Questa è una differenza di tipo, non di grado, ed è quella che rende incompleto l'inquadramento di "più economico".
L'inversione di settembre ha cambiato una metà di questa storia
La settimana dell'8 settembre, DeepSeek ha avviato V4 Pro verso il ritiro: dal 14 settembre, le richieste a deepseek-v4-pro sarebbero state indirizzate a V4.1 Flash e fatturate ai prezzi di Flash fino al rilascio di un V4.1 Pro. Poi ha rinviato la data di disattivazione, e infine l'11 settembre ha fatto marcia indietro del tutto, impegnandosi a continuare a servire V4 Pro con la stessa fatturazione e dichiarando che avrebbe dato preavviso qualora ciò fosse mai cambiato. Il dietrofront è stato confermato dai media statali cinesi e da diverse testate tecnologiche lo stesso giorno. Per questo confronto, quella notizia conta più dal lato Grok che dal lato DeepSeek: chiunque stesse pendendo verso Grok 4.6 perché «il modello aperto ed economico sta per sparire» si è visto cancellare silenziosamente la propria giustificazione. La metà accessibile è duratura, il che rende la metà premium una scelta anziché una copertura forzata.

Chi favorisce davvero il confronto
Se vuoi un modello di ragionamento all'avanguardia con input di immagini, un contesto lungo e nessun interesse a eseguire i tuoi pesi in proprio, il $2/$6 di Grok 4.6 è un prezzo equo e il suo 44 sull'indice è competitivo con qualsiasi cosa a quel livello. Se il tuo carico di lavoro è solo testo e ad alto consumo di token, DeepSeek V4 Pro è la risposta migliore su quasi ogni asse che compare nella fattura: circa tre volte più economico ai picchi, sconto cache più profondo, output più rapido, il doppio del contesto e pesi aperti come via di fuga. Il caso davvero difficile è quello solo testo e con forte componente di ragionamento, con esigenze di latenza ristrette — lì il divario di otto punti conta, e dovrebbe deciderlo la tua eval, non il marketing.
Entrambi sono oggi su OrcaRouter — Grok 4.6 e DeepSeek V4 Pro passano entrambi attraverso la piattaforma — così puoi chiamare l'uno o l'altro (o entrambi) con una sola chiave, con i prezzi di listino dei provider trasferiti a ricarico zero. Poiché il pass-through è esatto, le colonne dei prezzi in questo articolo sono i prezzi che paghi effettivamente, e il DSL di routing significa che puoi inviare attività con input di immagini a Grok 4.6 e attività di testo lungo a DeepSeek V4 Pro dalla stessa integrazione. L'ipotesi di lavoro dell'articolo è che vorresti entrambi proprio perché nessuno dei due eguaglia i punti di forza dell'altro.


Il verdetto
Grok 4.6 e DeepSeek V4 Pro sono entrambi solidi modelli di ragionamento con punteggi indipendenti davvero comparabili, e il divario di prezzo tra loro compra un vantaggio reale ma limitato in intelligenza, oltre a una filosofia di prodotto del tutto diversa: input multimodale ed ecosistema chiuso contro solo testo, pesi aperti e un token da tre a nove volte più economico. Se noleggi il ragionamento, va bene l'uno o l'altro e decide la tua valutazione. Se costruisci infrastruttura, DeepSeek V4 Pro è il modello che una settimana di drammi sul ritiro non è riuscita a uccidere — e dal 15 settembre è anche quello con una promessa scritta di restare.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
