Scheda titolo hero per l'articolo sulla fuga di notizie di Nemotron 4: titolo 'Nemotron 4', sottotitolo 'La famiglia di pesi aperti da 1 trilione di parametri di NVIDIA — segnalata, non rilasciata', e due chip etichettati 'segnalato' e 'non rilasciato'. Logo OrcaRouter in basso a destra.
Guides & Insights

Nemotron 4 Leak: la risposta open-weights di NVIDIA alla frontiera con 1.000 miliardi di parametri

Autore

Jim Song

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

1 trilione di parametri. È la soglia minima riportata per il modello più grande di Nemotron 4, l'ammiraglia della prossima famiglia open-weights di NVIDIA — e il numero sembra impressionante solo finché non lo si confronta con ciò che è già stato rilasciato. Nell'ultimo mese, Moonshot AI ha lanciato Kimi K3 con 2,8 trilioni di parametri totali, Alibaba ha presentato Qwen3.8-Max con 2,4 trilioni, e l'attuale ammiraglia di NVIDIA, Nemotron 3 Ultra, si ferma a 550 miliardi. The Information ha riportato l'11 agosto 2026 — citando diversi dipendenti che lavorano al progetto — che Nemotron 4 è la risposta di NVIDIA: una famiglia open-weights il cui modello più grande dovrebbe partire da circa 1 trilione di parametri, circa il doppio di Nemotron 3 Ultra.

Niente di tutto questo è stato rilasciato. NVIDIA ha riconosciuto di essere al lavoro su una famiglia Nemotron 4, ma non ha confermato né l'obiettivo sui parametri, né il budget, né la tempistica, né i dettagli sull'alleanza che The Information attribuisce a dipendenti rimasti anonimi. Considera ogni numero in questo articolo come "riportato", non "specificato". Lo scopo di un resoconto basato su fughe di notizie è separare il piccolo nucleo confermato dall'alone più ampio di voci riportate — e dirti quali elementi contano quando arriverà la vera scheda tecnica.

La fuga di una riga, analizzata

Prima di tutto, il nome, perché ti confonderà nei risultati di ricerca: NVIDIA ha già rilasciato un modello chiamato Nemotron-4-340B a giugno 2024. Il nuovo Nemotron 4 è una famiglia diversa e più grande — il successore della linea Nemotron 3 (Nano, Super, Ultra) rilasciata quest'anno — che riutilizza il nome "Nemotron 4" per la generazione successiva. Questo articolo parla del nuovo modello.

Ciò che The Information ha effettivamente riportato: NVIDIA sta sviluppando Nemotron 4 come una famiglia di modelli open-source destinati alla cima della classifica dei modelli open-weight, e si prevede che il modello di punta abbia "almeno mille miliardi di parametri." NVIDIA non ha fissato una data di rilascio, non ha iniziato l'addestramento finale — un processo che i dipendenti si aspettano richieda mesi — e ha definito solo i dati di pre-addestramento e l'architettura; la specifica è ancora in evoluzione. Due dipendenti hanno detto che la famiglia potrebbe essere pronta già nel tardo autunno; altri si aspettano più tardi.

Lo stesso rapporto include un budget: circa 28 miliardi di dollari in accordi pluriennali per servizi cloud che coprono fino all'inizio del 2031, circa tre volte quanto NVIDIA aveva dichiarato un anno prima, con circa 7 miliardi di dollari che ricadono nell'anno fiscale in corso. Rileva inoltre che l'articolo di ricerca del precedente modello di punta elencava 570 autori e che Nemotron 4 ne coinvolge ancora di più — un ex dipendente ha detto a The Information che "tutti vogliono essere coinvolti." Tutto ciò non è stato divulgato da NVIDIA.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

Perché il numero della taglia è la parte meno interessante

La storia ovvia è che NVIDIA sta andando verso il trilione di parametri. Quella meno ovvia è che la frontiera dei pesi aperti ci è arrivata prima. Kimi K3 ha aperto i suoi pesi il 27 luglio con 2,8 trilioni di parametri totali — circa 104 miliardi attivi per token in una configurazione mixture-of-experts — e Qwen3.8-Max di Alibaba, svelato il 19 luglio, è un modello da 2,4 trilioni di parametri totali con circa 95 miliardi attivi. Di fronte a questi, un modello di punta Nemotron 4 con "almeno 1 trilione" raddoppierebbe Nemotron 3 Ultra ma resterebbe comunque indietro rispetto ai leader in termini di dimensioni, ed entrambi questi leader sono cinesi.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

Ciò rende il conteggio totale dei parametri una lente completamente sbagliata. In un modello mistura-di-esperti, ciò che determina costo e velocità è il conteggio dei parametri attivi per token, non il totale pubblicizzato. Un Nemotron 4 con 1 trilione di parametri totali potrebbe assestarsi su circa 100 miliardi attivi — esattamente nella fascia di Kimi K3 e Qwen3.8-Max — o sulla metà. Il numero che trapelerà per prossimo è quello che conta, e non è ancora trapelato.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Anche l'altra direzione merita attenzione: DeepSeek V4-Flash, uscito il 31 luglio con licenza MIT, ha preso la strada opposta — 284 miliardi in totale, puntando sul prezzo piuttosto che sulla scala, con un costo stimato di circa $0,14 per milione di token in input. Il mercato premia entrambi gli estremi. La scala non è la strategia; è una strategia.

La posizione di NVIDIA spiega la mossa. The Information riporta che Nemotron 3 Ultra si classifica al secondo posto tra i modelli a pesi aperti statunitensi — dietro a Inkling di Thinking Machines — e fuori dalla fascia alta della classifica globale aperta. Nemotron 4 è il tentativo di rientrare nel dibattito sulla frontiera, e i dirigenti di NVIDIA lo inquadrano come una mossa di sovranità: la VP dell'AI generativa Kari Briski ha detto che NVIDIA investe in Nemotron perché "ogni azienda e ogni paese ha bisogno di modelli open-source di frontiera accessibili per rafforzare sicurezza e protezione, accelerare l'innovazione e fornire una base su cui poter contare da una generazione all'altra". Jensen Huang ha ribadito la stessa tesi su X, sostenendo che i modelli aperti "rafforzano la sicurezza e la cybersicurezza, accelerano l'innovazione e la diffusione, e consentono la sovranità". La tensione strutturale è reale — NVIDIA possiederebbe circa 30 miliardi di dollari di OpenAI — ma la scommessa è che i modelli aperti amplino la torta delle GPU piuttosto che ridurla. Come ha affermato il CEO di LMArena, Anastasios Angelopoulos: "Non importa quale azienda crei un grande modello open-source, NVIDIA vince."

La Coalizione Nemotron è la parte da tenere d'occhio.

Nemotron 4 non è un progetto solitario, ed è questo il dettaglio che gran parte della stampa non coglie. Al GTC del 16 marzo 2026, NVIDIA ha annunciato la Nemotron Coalition — otto membri fondatori: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam e Thinking Machines Lab — organizzata per mettere in comune ricerca, dati e potenza di calcolo a favore dei "modelli aperti di frontiera". Il suo primo progetto è un modello base co-sviluppato da Mistral AI e NVIDIA, addestrato su NVIDIA DGX Cloud, che la coalizione dichiara verrà reso open-source e costituirà le fondamenta della famiglia Nemotron 4.

The Information aggiunge i dettagli operativi: Reflection, Cursor, Thinking Machines e Mistral sono contributori confermati; Prime Intellect ha contribuito con 300.000 ambienti di simulazione per l'addestramento; Cognition ha discusso di fornire dati di addestramento per il codice. L'amministratore delegato di Prime Intellect, Vincent Weisser, ha inquadrato l'alleanza come un'azione collettiva contro quello che ha definito un monopolio di un unico modello "simil-divino". Cosa significa in pratica: Nemotron 4 potrebbe essere rilasciato come base consortile che ciascun membro adatta tramite post-addestramento per il proprio prodotto, piuttosto che come checkpoint di un singolo fornitore. Questo renderebbe "modello NVIDIA open-weights" la categoria sbagliata: la base è l'elemento interessante.

Confermato, segnalato, sconosciuto

• Confermato — NVIDIA sta lavorando a una famiglia Nemotron 4 (dichiarazione aziendale). La Nemotron Coalition esiste e sta costruendo un modello base aperto con Mistral AI (NVIDIA, marzo 2026).

• Riportato, non confermato — l'obiettivo chiave di "almeno mille miliardi"; la tempistica di fine autunno; l'impegno cloud di circa 28 miliardi di dollari, con circa 7 miliardi in questo anno fiscale; quali membri della coalizione contribuiscono con cosa.

• Incognita — numero di parametri attivi, lunghezza del contesto, mix di modalità, termini di licenza, prezzo, quali checkpoint vengono rilasciati per primi e se il modello base co-sviluppato con Mistral diventerà davvero il fondamento della famiglia.

Cronologia e cosa guardare

Non c'è una data di rilascio. L'addestramento finale non è ancora iniziato; i dipendenti lo descrivono come un processo lungo mesi, e le stime vanno da "tardo autunno" (due fonti) a più avanti. Nel frattempo, NVIDIA ha mantenuto in movimento la famiglia: ha rilasciato Nemotron 3.5 Lightning, un agente worker da 31,6 miliardi di parametri pubblicato l'11 agosto — lo stesso giorno in cui è uscito il report su Nemotron 4 — insieme a NeMo Switchyard, il software di routing open-source di NVIDIA. In altre parole, NVIDIA sta iterando attivamente la gamma mentre il modello di punta è ancora in fase di progettazione.

Cosa guardare, in ordine approssimativo di importanza:

• Parametri attivi — il totale è il dato principale; il numero di attivi determina costo e velocità. Un MoE con ~1T di totale e ~100B attivi cambia completamente il quadro rispetto a uno con ~50B.

• Punteggi indipendenti — non esiste alcuna valutazione di terze parti per un modello che non è stato addestrato. Monitora l'Artificial Analysis Intelligence Index quando appare un checkpoint ospitato.

• Termini di licenza — Nemotron 3 Ultra è distribuito con OpenMDW-1.1, permissivo ma non MIT o Apache 2.0. Se Nemotron 4 segua questa strada o la inasprisca non è ancora deciso, e per un'azienda che costruisce sui pesi questo decide tutto.

• Quali dimensioni escono prima — Nemotron 3 è arrivato come una famiglia (Nano, Super, Ultra). Aspettatevi una gamma di dimensioni di Nemotron 4, e aspettatevi che quelle piccole arrivino prima del modello di punta.

• La base Mistral — se il modello base della coalizione diventa davvero il fondamento della famiglia, è la questione strutturale dietro tutti i discorsi sui parametri.

• Prezzo — non è ospitato nulla, quindi non è previsto alcun prezzo. Quando un partner di hosting elenca Nemotron 4, il prezzo di pass-through è ciò che pagherai effettivamente.

Cosa significa per il tuo livello di inferenza

Non puoi chiamare Nemotron 4 oggi — nessuno può — quindi la domanda pratica è quanto del tuo stack debba cambiare per accogliere un modello la cui scheda tecnica è ancora in evoluzione. La risposta è la stessa di qualsiasi modello di frontiera non ancora rilasciato: mantieni il livello di inferenza agnostico rispetto al modello. Se instradi il traffico attraverso una singola API che fa da interfaccia a più di 200 modelli, una nuova famiglia Nemotron è una modifica di configurazione, non una riscrittura. OrcaRouter applica il prezzo di listino del fornitore con margine dello 0%, quindi qualunque cosa un host eventualmente faccia pagare per Nemotron 4 è esattamente ciò che paghi, e un taglio di prezzo del fornitore si riflette lo stesso giorno in cui viene applicato. Il failover automatico è lo strumento giusto per una prima release non collaudata: indirizza il traffico iniziale verso il nuovo modello, ripiega su un'alternativa stabile quando si blocca o va in errore, e promuovilo in produzione solo dopo essersi guadagnato i tuoi carichi di lavoro. Niente di tutto ciò richiede di scommettere un percorso di produzione su una fuga di notizie — che è esattamente l'atteggiamento giusto quando la scheda tecnica è così provvisoria.

Domande frequenti

Quando verrà rilasciato Nemotron 4?

Nessuna data è stata fissata. I dipendenti hanno riferito a The Information che la run di addestramento finale non è ancora iniziata e richiederà mesi; due hanno detto che la fine dell'autunno 2026 è possibile, e altri si aspettano più tardi. Considera "fine autunno" come una stima fiduciosa dall'interno del progetto, non una tabella di marcia.

Nemotron 4 sarà open-source?

L'intento dichiarato di NVIDIA è quello di avere pesi aperti, e il primo progetto della Nemotron Coalition — il modello base sviluppato in collaborazione con Mistral — è impegnato a essere rilasciato come open source. Ma "pesi aperti" non significa "open source": Nemotron 3 Ultra viene distribuito con licenza OpenMDW-1.1, che è più permissiva dei vecchi termini di NVIDIA ma non è ancora MIT o Apache 2.0. La licenza specifica di Nemotron 4 non è stata ancora annunciata.

"Almeno 1 trilione di parametri" è una specifica reale?

Si tratta di un obiettivo segnalato da dipendenti e riportato da The Information, non di una specifica confermata, e lo stesso rapporto afferma che il numero potrebbe cambiare. Anche a 1 trilione totale, sarebbe dietro a Kimi K3 (2,8T) e Qwen3.8-Max (2,4T) in termini di dimensione grezza; il numero di parametri attivi — che non è trapelato — è la cifra che determinerà costi e velocità.

Dovrei aspettare Nemotron 4 prima di scegliere un modello?

No. Manca ancora mesi nella migliore delle ipotesi ed è non comprovato. Scegli il miglior modello disponibile per il compito ora e mantieni flessibile il livello di instradamento; quando Nemotron 4 sarà effettivamente disponibile, valuta{{1}}lo nello stesso modo in cui valuteresti qualsiasi nuovo modello — parametri attivi{{2}}, benchmark indipendenti{{3}}, licenza{{4}} e prezzo{{5}} — piuttosto che sul totale dichiarato{{6}}.

Il risultato finale

La famiglia è reale; i numeri sono stime. NVIDIA ha confermato di stare costruendo Nemotron 4, e la struttura di coalizione che la circonda è la parte più interessante della storia — ma ogni cifra da titolo nella fuga di notizie, dal minimo di 1 trilione al periodo di fine autunno fino al budget di 28 miliardi di dollari, proviene da dipendenti anonimi e potrebbe cambiare. La frontiera dei pesi aperti ha già superato il traguardo del trilione di parametri, guidata dai laboratori cinesi, e la risposta di NVIDIA è un modello base di consorzio più una promessa. Per un lettore che sceglie i modelli oggi, questo significa una cosa: non pianificare in base alla fuga di notizie. Mantieni flessibile il livello di inferenza, valuta qualsiasi cosa venga rilasciata in base ai suoi numeri reali, e lascia che il routing faccia ciò per cui esiste — provare la novità senza scommetterci il percorso di produzione.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

Contattaci

Unisciti alla community

DiscordEmailXGitHubYouTube