
Nex-N2.5 Pro vs DeepSeek V4 Pro: Solo uno di questi set di pesi open è davvero open
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0455Intelligenza77Codice
- googleNUOVOGoogle: Gemini 3.8 Flash2026-09-0247Intelligenza76Codice
- qwenNUOVOQwen: Qwen3.8 Max (0902)2026-09-0247Intelligenza72Codice
- anthropicNUOVOAnthropic: Claude Fable 5.12026-09-0157Intelligenza82Codice
- AlibabaNUOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiNUOVOZ.ai: GLM 5.3 Flash2026-08-2646Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1849Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1541Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1251Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0547Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0347Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2140Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Intelligenza49Codice
Ecco il segreto di famiglia che rende questo confronto più strano di quanto sembri: {{1}}la stessa Nex-N2.5 Max di Nex-AGI, il livello di punta della famiglia che include Nex-N2.5 Pro, è stata a sua volta post-addestrata a partire da DeepSeek-V4-Pro-Base.{{/1}} La copertura delle note di rilascio dell'8 settembre è esplicita — {{2}}Mini e Pro sono costruiti a partire da varianti Qwen3.5, mentre la Max 1.6T, solo testo, poggia sulla base aperta rilasciata da DeepSeek ad agosto.{{/2}} Quindi, quando si mettono a confronto Nex-N2.5 Pro e DeepSeek V4 Pro, il lettore osserva {{3}}un progetto open-model prendere in prestito la base dell'altro per il proprio livello di punta e poi cercare di superare il donatore nel livello inferiore.{{/3}} Non è un insulto; è così che funziona l'economia dei pesi aperti, ed è la cornice più onesta possibile per un confronto in cui entrambi i modelli hanno una licenza aperta e solo uno dei due può essere effettivamente scaricato oggi.
L'asimmetria è il nocciolo della questione. DeepSeek V4 Pro, la build 0813 diventata GA il 13 agosto, ha i pesi con licenza MIT su Hugging Face in questo momento: un grande modello mixture-of-experts con circa 1.600 miliardi di parametri totali, di cui circa 49 miliardi attivi, un contesto di 1 milione di token, un tetto massimo di output di 384.000 token e un'API ufficiale a supporto. Nex-N2.5 Pro, annunciato l'8 settembre, è un MoE sparso da 397 miliardi di parametri con circa 17 miliardi attivi, multimodale mentre DeepSeek è solo testo, ed è pensato per agenti che usano il computer piuttosto che per l'uso generalista di strumenti. La sua scheda su Hugging Face mostra ancora il banner che i pesi arriveranno presto con licenza Apache-2.0, senza data, mentre solo endpoint hosted gratuiti lo servono. Stesso impegno filosofico verso i pesi aperti. Stato di consegna completamente diverso.
Due licenze, un set di pesi effettivamente rilasciato
Il contrasto delle licenze conta meno del contrasto sulla consegna, ma stabilisce le condizioni. DeepSeek V4 Pro è MIT — puoi scaricare gli shard oggi, servirli da solo, metterli a punto e costruirci un business senza chiedere il permesso a nessuno, e poiché i pesi sono disponibili, nessun singolo host controlla il prezzo. Nex-N2.5 Pro è promesso sotto Apache-2.0, la licenza altrettanto permissiva scelta dall'alleanza, ma il banner sulla scheda è inequivocabile: i pesi non sono scaricabili e non è allegata alcuna data. Per un team il cui requisito è "il modello deve essere nostro", questo confronto attualmente non è una competizione — DeepSeek V4 Pro è l'unico candidato che puoi davvero possedere. L'avvertenza pratica vale in entrambe le direzioni: l'hosting autonomo di un MoE da ~1.6T è un'infrastruttura seria, quindi per la maggior parte dei team la licenza MIT conta meno come piano di hosting che come garanzia contro il lock-in e come pavimento sotto il prezzo. Nex-N2.5 Pro, quando i suoi shard arriveranno, sarà il design più auto-hostabile — 17B attivi su un nodo di otto H100 è un'architettura molto più piccola dell'impronta di riferimento di DeepSeek.
Le righe in cui i due differiscono
Affiancati, i due modelli si sovrappongono a malapena per quanto riguarda il loro scopo:
• Rilasciato — Nex-N2.5 Pro: 8 settembre 2026 (endpoint ospitati attivi, pesi non ancora rilasciati). DeepSeek V4 Pro: 13 agosto 2026 (build GA 0813), pesi disponibili.
• Scala — Nex-N2.5 Pro: 397B totali / ~17B attivi. DeepSeek V4 Pro: ~1.6T totali / ~49B attivi.
• Modalità — Nex-N2.5 Pro: input di testo e immagini, output di testo; progettato per l'uso del computer tramite lettura dello schermo. DeepSeek V4 Pro: solo testo nella sua API pubblica — nessun input nativo per visione, immagini o audio.
• Contesto / output — Nex-N2.5 Pro: contesto di 262.144 token. DeepSeek V4 Pro: contesto di 1M token, fino a 384K token di output.
• Controllo del ragionamento — Nex-N2.5 Pro: nessuno / medio (adattivo, predefinito) / alto. DeepSeek V4 Pro: basso / alto / massimo sforzo di ragionamento sulla stessa stringa di modello.
• Pesi — Nex-N2.5 Pro: Apache-2.0, in arrivo. DeepSeek V4 Pro: MIT, scaricabile ora.
• Superficie API — Nex-N2.5 Pro: chiamate di chat compatibili con OpenAI su endpoint hostati gratuiti. DeepSeek V4 Pro: API Responses di OpenAI nativa, più endpoint compatibili con Anthropic, chiamate agli strumenti e output JSON.
Due prodotti davvero diversi condividono la parola "open". Nex-N2.5 Pro è progettato per guardare uno schermo e gestirlo; DeepSeek V4 Pro è progettato per pensare, scrivere codice e chiamare strumenti — la differenza tra un operatore e un analista.

Che cosa viene misurato e che cosa viene preso in prestito

Il quadro dei benchmark è tanto squilibrato quanto quello delle consegne. DeepSeek V4 Pro ha un'impronta misurata e indipendente: una presenza nell'Artificial Analysis Intelligence Index, settimane di stampa e traffico produttivo dal GA dell'0813, e cifre di codifica del vendor — Terminal-Bench 2.1 a 87.9 e DeepSWE a 62.7 secondo quanto riportato dalla stessa DeepSeek — che perlomeno poggiano su un modello che chiunque può scaricare e rieseguire. Nex-N2.5 Pro non ha nulla di tutto ciò. I suoi numeri di punta — OSWorld-2 a 56.4, Terminal-Bench 2.1 a 82.7, SWE-Bench Pro a 61.2, BrowseComp a 89.7 — sono tutte misurazioni di Nex-AGI attraverso il suo harness NexCUA, che l'alleanza dichiara di voler rendere open-source ma non ha ancora rilasciato. Nelle prime 48 ore dal lancio, nessun laboratorio indipendente aveva eseguito Nex-N2.5 Pro, perché nessuno al di fuori dell'alleanza può farlo.
Read the two sets of claims side by side and the honest conclusion is not "DeepSeek is smarter." It is "DeepSeek's numbers are checkable and Nex-N2.5 Pro's are not." Where the two vendor sheets do overlap — Terminal-Bench 2.1 — DeepSeek claims 87.9 against Nex-N2.5 Pro's 82.7, a five-point gap in the incumbent's favor that is exactly the direction a cautious reader should expect: the model that has shipped measures higher on the shared row than the one that has not.
Il prezzo: un numero reale, un numero pianificato e nessun numero.
Il prezzo di DeepSeek V4 Pro non è un singolo numero, ed è già una storia a sé. Alla GA 0813 l'API ufficiale elencava $0,435 per milione di token di input e $0,87 per milione di token di output; il 16 agosto DeepSeek ha spostato la famiglia V4 su una tariffazione a picco/fuori picco, quindi l'API ufficiale ora applica $0,66 di input / $1,98 di output fuori picco e $1,32 / $3,96 in picco, con input in cache a $0,022 fuori picco e $0,044 in picco. A seconda di quando chiami DeepSeek direttamente, lo stesso modello costa da circa il 50% in più fino a quattro volte e mezzo la tariffa di lancio. Anche la via conta: la pagina del modello OrcaRouter per DeepSeek V4 Pro elenca attualmente una tariffa piatta di $0,44 di input / $0,88 di output per milione — la tariffa del provider applicata senza alcun margine — che è più bassa persino della tariffa ufficiale fuori picco. Quella tariffa piatta è il prezzo da battere se si confronta il costo per token, ed è il tipo di numero che esiste solo perché un livello di routing mostra la tariffa reale del provider invece di una tariffa rimodulata.

Nex-N2.5 Pro non ha un prezzo da affiancare a nessuno di questi elementi. Il suo livello ospitato è gratuito, e Nex-AGI non ha pubblicato alcuna tariffa a pagamento per token per la famiglia, quindi l'economia del modello è semplicemente sconosciuta — gli endpoint gratuiti dimostrano che la build funziona, e nient'altro. Se i pesi venissero rilasciati e un provider iniziasse a servire Nex-N2.5 Pro a un prezzo di listino, il confronto onesto diventerebbe possibile; fino ad allora, "gratuito" è un meccanismo di anteprima, non un segnale di mercato.
Due diversi tipi di agente
Scegliere tra questi due modelli significa scegliere tra due lavori, non tra due punteggi. Nex-N2.5 Pro è pensato per l'agente che opera su un computer: legge uno schermo, muove un cursore, modifica un file, controlla il risultato visivo e va avanti — la sessione dimostrativa di 468 azioni in Pokemon Platinum è la forma concreta di quell'ambizione. DeepSeek V4 Pro è pensato per l'agente che opera tramite API: ragiona, scrive codice multi-file, chiama strumenti e produce output lunghi e strutturati, tutto attraverso il canale testuale a servizio del quale esistono il tetto di output di 384K e il contesto da 1M. Un team che sta costruendo automazione per browser dovrebbe tenere d'occhio Nex-N2.5 Pro. Un team che sta costruendo un agente per il coding o per il knowledge work dovrebbe confrontare DeepSeek V4 Pro con i modelli di frontiera chiusi, e Nex-N2.5 Pro non è ancora un candidato per quel lavoro — non può rimuovere l'immagine dal processo, e le sue affermazioni in ambito coding sono sia inferiori sia meno verificate rispetto al modello con cui viene confrontato.
Il verdetto: su uno aspettare, sull'altro costruire.
DeepSeek V4 Pro è l'unica scelta razionale su cui costruire in questo confronto, oggi. I suoi pesi sono scaricabili, il suo prezzo è noto — e più conveniente attraverso la rotta flat di OrcaRouter che sul piano tariffario di picco di DeepSeek — e le sue affermazioni sono verificabili da chiunque in un pomeriggio. È anche il punto di partenza naturale per misurare quanto costerà il computer-use aperto: instrada il traffico del suo agente di coding attraverso OrcaRouter con failover automatico attorno al limite di ~500 richieste concorrenti dell'API ufficiale, e ottieni una baseline open-weights funzionante a un prezzo reale. Nex-N2.5 Pro è la scommessa più interessante sul lungo periodo proprio perché è l'architettura più specializzata — un operatore multimodale con 17B di parametri attivi che potrebbe sottocostare i leader chiusi del computer-use come DeepSeek ha sottocostato i generalisti chiusi — ma un endpoint gratuito non verificabile non è una base. Quando arriveranno gli shard Apache-2.0 e un sistema di valutazione indipendente produrrà quel numero OSWorld-2, questo confronto cambierà dall'oggi al domani. Fino ad allora, è un confronto tra un modello che puoi possedere e un modello che puoi solo guardare.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
