Scheda titolo hero per l'articolo sulla fuga di notizie di Nemotron 4: titolo 'Nemotron 4', sottotitolo 'La famiglia di pesi aperti da 1 trilione di parametri di NVIDIA — segnalata, non rilasciata', e due chip etichettati 'segnalato' e 'non rilasciato'. Logo OrcaRouter in basso a destra.
Guides & Insights

Nemotron 4 Leak: la risposta open-weights di NVIDIA alla frontiera con 1.000 miliardi di parametri

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Nemotron 4 non è ancora stato rilasciato, ma questa settimana ha smesso di essere una semplice voce con solo un numero di parametri. Il Wall Street Journal ha riportato il 22 agosto 2026, citando persone a conoscenza della questione, che NVIDIA sta spendendo circa 6 miliardi di dollari per trasformare Nemotron 4 in uno dei modelli di intelligenza artificiale open-weight più potenti al mondo — e che il piano include una licenza non esclusiva per la tecnologia di addestramento dei modelli della startup AI Poolside, oltre al trasferimento di più di 100 ingegneri di Poolside nel progetto Nemotron 4. Questo si aggiunge alla precedente fuga di notizie di The Information, dell'11 agosto, secondo cui il modello di punta della famiglia avrà "almeno 1.000 miliardi di parametri." Insieme, i due rapporti descrivono il tentativo più serio finora di NVIDIA di raggiungere la vetta della frontiera open-weight.

Niente di tutto ciò è stato rilasciato e nulla è confermato. NVIDIA ha riconosciuto di stare costruendo una famiglia Nemotron 4, ma non ha confermato l'obiettivo dei parametri, la tempistica, il piano di licenze e assunzioni che il WSJ attribuisce a persone informate sull'accordo, né i dettagli dell'alleanza che The Information attribuisce a dipendenti anonimi. Tratta ogni numero in questo articolo come "riportato", non "specificato". Lo scopo di un articolo su una fuga di notizie è separare il piccolo nucleo confermato dal più ampio alone riportato — e dirti quali parti contano quando arriverà la vera scheda tecnica.

La fuga di una riga, analizzata

Prima di tutto, il nome, perché ti confonderà nei risultati di ricerca: NVIDIA ha già rilasciato un modello chiamato Nemotron-4-340B a giugno 2024. Il nuovo Nemotron 4 è una famiglia diversa e più grande — il successore della linea Nemotron 3 (Nano, Super, Ultra) rilasciata quest'anno — che riutilizza il nome "Nemotron 4" per la generazione successiva. Questo articolo parla del nuovo modello.

Ciò che The Information ha effettivamente riportato: NVIDIA sta sviluppando Nemotron 4 come una famiglia di modelli open-source destinati alla cima della classifica dei modelli open-weight, e si prevede che il modello di punta abbia "almeno mille miliardi di parametri." NVIDIA non ha fissato una data di rilascio, non ha iniziato l'addestramento finale — un processo che i dipendenti si aspettano richieda mesi — e ha definito solo i dati di pre-addestramento e l'architettura; la specifica è ancora in evoluzione. Due dipendenti hanno detto che la famiglia potrebbe essere pronta già nel tardo autunno; altri si aspettano più tardi.

Lo stesso rapporto include un budget separato: circa 28 miliardi di dollari in accordi pluriennali di servizi cloud che si estendono fino all'inizio del 2031, circa tre volte quanto NVIDIA aveva rivelato un anno prima, con circa 7 miliardi di dollari che ricadono nell'anno fiscale in corso. Tale cifra copre gli impegni di calcolo, non il nuovo accordo annunciato questa settimana. Il rapporto osserva inoltre che l'articolo di ricerca del precedente modello di punta elencava 570 autori e che Nemotron 4 ne coinvolge di più — un ex dipendente ha detto a The Information che "tutti vogliono essere coinvolti." Tutto ciò senza alcuna comunicazione da parte di NVIDIA.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

Questa settimana: un accordo da 6 miliardi di dollari con Poolside per dare vita a Nemotron 4

Il Wall Street Journal ha riferito questa settimana che il piano di NVIDIA per Nemotron 4 non è solo un progetto di ricerca — è uno sviluppo finanziato. Secondo il WSJ, che cita persone a conoscenza della questione, NVIDIA pagherà circa 6 miliardi di dollari per una licenza non esclusiva della "Model Factory" di Poolside, il sistema di addestramento e valutazione alla base dei modelli di codifica Laguna a pesi aperti di Poolside, e farà offerte di lavoro a più di 100 membri dello staff di Poolside — secondo quanto riportato 109, la maggior parte dei quali ingegneri — per lavorare al progetto Nemotron. Bloomberg ha riferito separatamente che NVIDIA investirà ulteriori 1 miliardo di dollari in Poolside a una valutazione pre-money segnalata di 12 miliardi di dollari, portando l'impegno totale segnalato di NVIDIA a circa 7 miliardi di dollari.

Non è un'acquisizione. La licenza non è esclusiva, i fondatori di Poolside restano, e Poolside continua a operare come società indipendente; secondo quanto riportato, Poolside prevede di distribuire il pagamento della licenza da 6 miliardi di dollari ai suoi investitori. La notizia è emersa per la prima volta tramite Newcomer il 20 agosto ed è stata confermata da Bloomberg il 21 agosto e dal WSJ il 22 agosto — tutte ancora "segnalazioni", nessuna confermata da NVIDIA o Poolside.

Perché l'accordo conta più del numero in evidenza: dà al progetto Nemotron 4 un team che ha effettivamente distribuito modelli open-weight. La famiglia Laguna di Poolside è una linea comprovata di coding open-weight, e l'obiettivo riportato — una release di Nemotron entro circa un anno in grado di competere con i modelli frontier più forti — è la prima tempistica concreta mai associata al progetto. I report inquadrano la mossa come la risposta di NVIDIA ai leader open-weight in Cina, in particolare Deep​Seek e Kimi K3 di Moonshot AI, e, nel dibattito tra open e closed, come una copertura contro i laboratori chiusi statunitensi.

Anche la struttura conta. Una licenza non esclusiva significa che Poolside mantiene la propria proprietà intellettuale e può concedere in licenza la stessa tecnologia ad altri: NVIDIA sta acquistando capacità e talento, non la proprietà. Gli analisti lo interpretano come uno sforzo di NVIDIA per mantenere commoditizzato il livello dei modelli: se i modelli open-weight restano validi ed economici, la domanda continua a fluire verso il livello che NVIDIA controlla: le GPU. Come ha affermato il CEO di LMArena Anastasios Angelopoulos nel precedente servizio: «Non importa quale azienda crei un ottimo modello open-source, NVIDIA vince.»

Perché il numero della taglia è la parte meno interessante

La storia ovvia è che "NVIDIA sta puntando al trilione di parametri". Quella meno ovvia è che la frontiera dei pesi aperti ci è arrivata prima. Kimi K3 ha aperto i suoi pesi il 27 luglio, con 2,8 trilioni di parametri totali — circa 104 miliardi attivi per token in una configurazione mixture-of-experts — e il Qwen3.8 Max di Alibaba, presentato il 19 luglio, è un modello da 2,4 trilioni di parametri totali con circa 95 miliardi attivi. Rispetto a questi, un modello di punta Nemotron 4 con "almeno 1 trilione" raddoppierebbe Nemotron 3 Ultra, ma resterebbe comunque indietro rispetto ai leader per dimensioni, ed entrambi questi leader sono cinesi.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

Questo rende il conteggio totale dei parametri una lente del tutto sbagliata. In un modello mixture-of-experts, ciò che determina costo e velocità è il numero di parametri attivi per token, non il totale pubblicizzato. Un Nemotron 4 con 1 trilione di parametri totali potrebbe attestarsi su circa 100 miliardi di parametri attivi — esattamente nella fascia di Kimi K3 e Qwen3.8 Max — o anche sulla metà. Il prossimo numero a trapelare è quello che conta, e non è ancora trapelato.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Anche l'altra direzione merita attenzione: DeepSeek V4-Flash, uscito il 31 luglio con licenza MIT, ha preso la strada opposta — 284 miliardi in totale, puntando sul prezzo piuttosto che sulla scala, con un costo stimato di circa $0,14 per milione di token in input. Il mercato premia entrambi gli estremi. La scala non è la strategia; è una strategia.

La posizione di NVIDIA spiega la mossa. The Information riferisce che Nemotron 3 Ultra si piazza al secondo posto tra i modelli open-weights statunitensi — dietro a Inkling di Thinking Machines — e al di fuori della fascia alta della classifica globale open. Nemotron 4 è il tentativo di rientrare nel dibattito di frontiera, e gli stessi dirigenti di NVIDIA la inquadrano come una mossa di sovranità: la VP dell'AI generativa Kari Briski ha dichiarato che NVIDIA investe in Nemotron perché "ogni azienda e ogni Paese ha bisogno di modelli open-source di frontiera accessibili per rafforzare sicurezza e protezione, accelerare l'innovazione e fornire una base su cui poter contare di generazione in generazione". Jensen Huang ha sostenuto la stessa tesi su X, affermando che i modelli open "rafforzano la sicurezza e la cybersecurity, accelerano l'innovazione e la diffusione e consentono la sovranità". La tensione strutturale è reale — NVIDIA possiederebbe circa 30 miliardi di dollari di Ope​nAI — ma la scommessa è che i modelli open espandano la torta delle GPU invece di ridurla.

La Coalizione Nemotron è la parte da tenere d'occhio.

Nemotron 4 non è un progetto solitario, e l'accordo con Poolside non è l'unica struttura che lo circonda. Al GTC del 16 marzo 2026, NVIDIA ha annunciato la Nemotron Coalition — otto membri fondatori: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam e Thinking Machines Lab — organizzata per mettere in comune ricerca, dati e potenza di calcolo a sostegno dei "modelli aperti di frontiera". Il suo primo progetto è un modello base co-sviluppato da Mistral AI e NVIDIA, addestrato su NVIDIA DGX Cloud, che la coalizione dichiara verrà reso open source e costituirà la base della famiglia Nemotron 4.

The Information aggiunge i dettagli operativi: Reflection, Cursor, Thinking Machines e Mistral sono contributori confermati; Prime Intellect ha contribuito con 300.000 ambienti di simulazione per l'addestramento; Cognition ha discusso di fornire dati di addestramento per il codice. L'amministratore delegato di Prime Intellect, Vincent Weisser, ha inquadrato l'alleanza come un'azione collettiva contro quello che ha definito un monopolio di un unico modello "simil-divino". Cosa significa in pratica: Nemotron 4 potrebbe essere rilasciato come base consortile che ciascun membro adatta tramite post-addestramento per il proprio prodotto, piuttosto che come checkpoint di un singolo fornitore. Questo renderebbe "modello NVIDIA open-weights" la categoria sbagliata: la base è l'elemento interessante.

L'accordo con Poolside si inserisce accanto a tutto ciò. La coalizione mette in comune ricerca e potenza di calcolo; l'accordo di licenza e assunzione porta con sé una fabbrica di modelli funzionante e uno staff che ha già rilasciato pesi aperti. Se i report sono corretti, NVIDIA sta assemblando Nemotron 4 da tre fonti contemporaneamente — la propria operazione di addestramento, una base consortile e il sistema di produzione di Poolside — una forma diversa da qualsiasi rilascio con un singolo checkpoint.

Confermato, segnalato, sconosciuto

• Confermato — NVIDIA sta lavorando a una famiglia Nemotron 4 (dichiarazione aziendale). La Nemotron Coalition esiste e sta costruendo un modello base aperto con Mistral AI (NVIDIA, marzo 2026).

• Segnalato, non confermato — l'obiettivo di punta di "almeno 1 trilione" e la tempistica del tardo autunno, più l'impegno cloud di circa 28 miliardi di dollari con circa 7 miliardi di dollari in questo anno fiscale (The Information); il budget di costruzione di circa 6 miliardi di dollari riportato dal WSJ, la licenza non esclusiva della "Model Factory" di Poolside e più di 100 ingegneri di Poolside che si uniscono al progetto Nemotron; l'investimento da 1 miliardo di dollari di NVIDIA in Poolside riportato da Bloomberg a una valutazione pre-money di circa 12 miliardi di dollari; quali membri della coalizione contribuiscono con cosa.

• Sconosciuto — numero di parametri attivi, lunghezza del contesto, mix di modalità, termini di licenza, prezzo, quali checkpoint verranno rilasciati per primi, se la base co-sviluppata con Mistral diventerà effettivamente il fondamento della famiglia e se l'accordo con Poolside è strutturato come riportato (nessuna delle due aziende ha commentato).

Cronologia e cosa guardare

Non c'è ancora una data di rilascio. L'ultima sessione di addestramento non è ancora iniziata; i dipendenti la descrivono come un processo che durerà mesi, e le stime vanno da "fine autunno" (due fonti) a più avanti. Il report di Poolside aggiunge la prima finestra temporale concreta mai associata al progetto: secondo la copertura, l'obiettivo è un rilascio entro circa un anno in grado di competere con i modelli frontier più forti. NVIDIA ha nel frattempo mantenuto attiva la famiglia: ha distribuito Nemotron 3.5 Lightning, un agent worker da 31,6 miliardi di parametri rilasciato l'11 agosto — lo stesso giorno in cui è emerso il report su Nemotron 4 — insieme a NeMo Switchyard, il software di routing open-source di NVIDIA.

Cosa guardare, in ordine approssimativo di importanza:

• Parametri attivi — il totale è il dato principale; il numero di attivi determina costo e velocità. Un MoE con ~1T di totale e ~100B attivi cambia completamente il quadro rispetto a uno con ~50B.

• L'integrazione di Poolside — se la licenza di Model Factory e il suo nuovo team rimodellano davvero il piano di formazione e comprimono la tempistica riportata, o se è l'acquisizione di talenti a lasciare il piano invariato.

• Punteggi indipendenti — non esiste alcuna valutazione di terze parti per un modello che non è stato addestrato. Monitora l'Artificial Analysis Intelligence Index quando appare un checkpoint ospitato.

• Termini di licenza — Nemotron 3 Ultra è distribuito con OpenMDW-1.1, permissivo ma non MIT o Apache 2.0. Se Nemotron 4 segua questa strada o la inasprisca non è ancora deciso, e per un'azienda che costruisce sui pesi questo decide tutto.

• Quali dimensioni escono prima — Nemotron 3 è arrivato come una famiglia (Nano, Super, Ultra). Aspettatevi una gamma di dimensioni di Nemotron 4, e aspettatevi che quelle piccole arrivino prima del modello di punta.

• La base Mistral — se il modello base della coalizione diventa davvero il fondamento della famiglia, è la questione strutturale dietro tutti i discorsi sui parametri.

• Prezzo — non è ospitato nulla, quindi non è previsto alcun prezzo. Quando un partner di hosting elenca Nemotron 4, il prezzo di pass-through è ciò che pagherai effettivamente.

Cosa significa per il tuo livello di inferenza

Non puoi chiamare Nemotron 4 oggi — nessuno può — e i report di Poolside, per quanto drammatici, non cambiano la cosa. La domanda pratica è ancora quanta parte del tuo stack debba cambiare per accogliere un modello la cui scheda tecnica è ancora in evoluzione. La risposta è la stessa che vale per qualsiasi modello frontier non ancora rilasciato: mantieni il livello di inferenza agnostico rispetto al modello. Se instradi il traffico attraverso una singola API che funge da front-end per 200+ modelli, una nuova famiglia Nemotron è un cambio di configurazione, non una riscrittura. OrcaRouter trasmette il prezzo di listino del provider con markup 0%, quindi qualunque cosa un host alla fine faccia pagare per Nemotron 4 è esattamente quello che paghi, e un taglio di prezzo del fornitore arriva lo stesso giorno in cui viene fatto. Il failover automatico è lo strumento giusto per un primo rilascio non ancora collaudato: indirizza il traffico iniziale al nuovo modello, torna a un'alternativa stabile quando si blocca o va in errore, e promuovilo in produzione solo dopo che ha guadagnato il diritto di gestire i tuoi carichi di lavoro. Nessuna di queste cose richiede di scommettere il percorso di produzione su una fuga di notizie — che è esattamente la postura giusta quando la scheda tecnica è così provvisoria.

Domande frequenti

Quando verrà rilasciato Nemotron 4?

Nessuna data è stata fissata. I dipendenti hanno detto a The Information che la corsa di addestramento finale non è ancora iniziata e richiederà mesi; due hanno indicato il tardo autunno 2026 come possibile, mentre altri si aspettano più avanti. I report di questa settimana aggiungono un obiettivo dichiarato di un rilascio competitivo all'avanguardia entro circa un anno, ma ancora nessuna data certa. Trattate entrambe le cose come stime interne al progetto, non come una tabella di marcia.

Nemotron 4 sarà open-source?

L'intento dichiarato di NVIDIA è quello di avere pesi aperti, e il primo progetto della Nemotron Coalition — il modello base sviluppato in collaborazione con Mistral — è impegnato a essere rilasciato come open source. Ma "pesi aperti" non significa "open source": Nemotron 3 Ultra viene distribuito con licenza OpenMDW-1.1, che è più permissiva dei vecchi termini di NVIDIA ma non è ancora MIT o Apache 2.0. La licenza specifica di Nemotron 4 non è stata ancora annunciata.

L'accordo da 6 miliardi di dollari con Poolside riportato è confermato?

No. Il WSJ ha riportato la licenza da circa 6 miliardi di dollari e l'ingresso di oltre 100 ingegneri Poolside nel progetto Nemotron il 22 agosto, citando persone a conoscenza della questione; Bloomberg ha riportato l'ulteriore investimento di 1 miliardo di dollari. Newcomer lo ha riportato per primo il 20 agosto. Né NVIDIA né Poolside hanno confermato nulla. La licenza è descritta come non esclusiva e Poolside rimarrebbe una società indipendente.

"Almeno 1 trilione di parametri" è una specifica reale?

È un obiettivo proveniente da un dipendente, riportato da The Information, non una specifica confermata, e lo stesso rapporto afferma che il numero potrebbe cambiare. Anche con un totale di 1 trilione, sarebbe comunque inferiore a Kimi K3 (2,8T) e Qwen3.8 Max (2,4T) per dimensione complessiva; il numero di parametri attivi — che non è trapelato — è il dato che determinerà i costi e la velocità.

Dovrei aspettare Nemotron 4 prima di scegliere un modello?

No. Manca almeno qualche mese e non è dimostrato. Scegli subito il miglior modello disponibile per il lavoro e mantieni flessibile il livello di routing; quando Nemotron 4 sarà effettivamente disponibile, valutalo allo stesso modo in cui valuteresti qualsiasi nuovo modello — parametri attivi, benchmark indipendenti, licenza e prezzo — piuttosto che sul totale pubblicizzato o sull'entità del budget dichiarato.

Il risultato finale

La famiglia è reale; i numeri sono stime. Questa settimana la storia ha cambiato forma: Nemotron 4 non è più solo una fuga di parametri, è una build finanziata. NVIDIA risulta aver stanziato circa 6 miliardi di dollari, aver acquisito la licenza della Model Factory di Poolside, aver assunto più di 100 dei suoi ingegneri e aver investito altri 1 miliardo di dollari nella società — il tutto per realizzare un modello flagship open-weight che possa reggere il confronto con Deep​Seek e Kimi K3. Ognuno di quei numeri è stato riportato dalla stampa, nessuno è confermato, e nulla è stato rilasciato. La frontiera open-weight ha già superato il traguardo dei mille miliardi di parametri, e la risposta di NVIDIA è un modello base di consorzio, una model factory in licenza e una promessa. Per un lettore che sceglie i modelli oggi, questo significa ancora una cosa: non pianificare in base alla fuga di notizie. Mantieni flessibile il livello di inferenza, valuta qualsiasi cosa venga rilasciata in base ai suoi numeri reali, e lascia che il routing faccia ciò per cui esiste — provare la novità senza scommettere su di essa il percorso di produzione.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno