Hero-titelkaart voor het Nemotron 4-lekartikel: kop 'Nemotron 4', ondertitel 'NVIDIA's open-weights-familie met 1 biljoen parameters — gerapporteerd, niet uitgebracht', en twee chips gelabeld 'gerapporteerd' en 'niet uitgebracht'. OrcaRouter-logo rechtsonder.
Guides & Insights

Nemotron 4 Lek: NVIDIA's antwoord op de frontier met 1 biljoen parameters en open gewichten

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Nemotron 4 is nog niet uitgebracht, maar deze week is het niet langer een gerucht waarvan alleen het aantal parameters bekend was. The Wall Street Journal berichtte op 22 augustus 2026, onder verwijzing naar ingewijden, dat NVIDIA ongeveer 6 miljard dollar uitgeeft om Nemotron 4 uit te bouwen tot een van de krachtigste open-weight AI-modellen ter wereld — en dat het plan een niet-exclusieve licentie op de modeltrainingstechnologie van AI-startup Poolside en de overplaatsing van meer dan honderd engineers van Poolside naar het Nemotron 4-project omvat. Dat komt bovenop het eerdere lek van The Information, van 11 augustus, dat het vlaggenschip van de familie "ten minste 1 biljoen parameters" zal hebben. Samen beschrijven de twee rapporten NVIDIA's meest serieuze poging tot nu toe om de top te bereiken op het gebied van open-weight modellen.

Er is hier nog niets uitgebracht en niets is bevestigd. NVIDIA heeft erkend dat het een Nemotron 4-familie bouwt, maar het heeft de beoogde parameteromvang, de tijdlijn, het licentie- en aanwervingsplan dat de WSJ toeschrijft aan ingewijden, of de alliantiedetails die The Information toeschrijft aan ongenoemde medewerkers niet bevestigd. Beschouw elk getal in dit stuk als 'gerapporteerd', niet als 'gespecificeerd'. Het punt van een lek-reportage is om de kleine bevestigde kern te scheiden van de grotere gerapporteerde halo — en je te vertellen welke onderdelen ertoe doen wanneer het echte specificatieblad verschijnt.

Het éénregelige lek, uitgepakt

Eerst de naam, want die zal je in verwarring brengen in zoekresultaten: NVIDIA bracht in juni 2024 al een model genaamd Nemotron-4-340B uit. De nieuwe Nemotron 4 is een andere, grotere familie — de opvolger van de Nemotron 3-lijn (Nano, Super, Ultra) die dit jaar is uitgebracht — en gebruikt de naam "Nemotron 4" opnieuw voor de generatie daarna. Dit artikel gaat over de nieuwe.

Wat The Information daadwerkelijk meldde: NVIDIA ontwikkelt Nemotron 4 als een familie van open-source modellen gericht op de top van het open-gewicht leaderboard, en het vlaggenschip zal naar verwachting "minstens 1 biljoen parameters" hebben. NVIDIA heeft geen releasedatum vastgesteld, is niet begonnen met de definitieve trainingsrun — een proces waarvan medewerkers verwachten dat het maanden zal duren — en heeft alleen de pre-training data en de architectuur vastgesteld; de specificatie is nog in beweging. Twee medewerkers zeiden dat de familie al in de late herfst klaar zou kunnen zijn; anderen verwachten later.

Hetzelfde rapport bevat een apart budget: ongeveer $28 miljard aan meerjarige cloudservice-overeenkomsten die doorlopen tot begin 2031, ongeveer drie keer zoveel als NVIDIA een jaar eerder bekendmaakte, met ongeveer $7 miljard in het huidige boekjaar. Dat bedrag dekt compute-verplichtingen, niet de nieuwe deal die deze week werd gemeld. Het rapport merkt ook op dat het onderzoekspaper van het vorige vlaggenschip 570 auteurs vermeldde en dat Nemotron 4 er meer bij betrekt — een voormalig werknemer vertelde The Information dat 'iedereen erbij betrokken wil zijn.' Dit alles werd niet gerapporteerd door NVIDIA.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

Deze week: een deal van $6 miljard van Poolside om Nemotron 4 werkelijkheid te maken

The Wall Street Journal meldde deze week dat het plan van NVIDIA voor Nemotron 4 niet zomaar een onderzoeksproject is — het is een gefinancierde bouw. Volgens de WSJ, die zich beroept op mensen die bekend zijn met de zaak, zal NVIDIA ongeveer 6 miljard dollar betalen voor een niet-exclusieve licentie op de "Model Factory" van Poolside, het trainings- en evaluatiesysteem achter de open-weight Laguna-codeermodellen van Poolside, en zal het meer dan 100 medewerkers van Poolside een arbeidsaanbod doen — naar verluidt 109, voornamelijk ingenieurs — om aan het Nemotron-project te werken. Bloomberg meldde afzonderlijk dat NVIDIA nog eens 1 miljard dollar in Poolside zal investeren tegen een gerapporteerde pre-money waardering van 12 miljard dollar, waarmee de totale gerapporteerde toezegging van NVIDIA op ongeveer 7 miljard dollar uitkomt.

Het is geen overname. De licentie is niet-exclusief, de oprichters van Poolside blijven aan, en Poolside blijft opereren als een onafhankelijk bedrijf; volgens de berichtgeving is Poolside van plan om de licentiebetaling van $6 miljard aan zijn investeerders uit te keren. Het verhaal kwam voor het eerst naar buiten via Newcomer op 20 augustus en werd bevestigd door Bloomberg op 21 augustus en de WSJ op 22 augustus — nog steeds allemaal "gemeld", niets ervan bevestigd door NVIDIA of Poolside.

Waarom de deal belangrijker is dan het getal in de krantenkop: het geeft het Nemotron 4-project een team dat daadwerkelijk open-gewichtmodellen heeft uitgebracht. Poolside's Laguna-familie is een bewezen reeks open-gewicht codeermodellen, en het gemelde doel — een Nemotron-release binnen ongeveer een jaar die kan concurreren met de sterkste frontier-modellen — is het eerste concrete tijdpad dat iemand aan het project heeft verbonden. De berichten framen de zet als NVIDIA's antwoord op de open-gewichtleiders in China, met name Deep​Seek en Moonshot AI's Kimi K3, en, in het debat over open versus gesloten, als een hedge tegen de gesloten Amerikaanse labs.

Ook de structuur is belangrijk. Een niet-exclusieve licentie betekent dat Poolside zijn intellectuele eigendom behoudt en dezelfde technologie aan anderen kan licentiëren — NVIDIA koopt capaciteit en talent, geen eigendom. Analisten zien het als NVIDIA's poging om de modellaag gecommoditiseerd te houden: als open-weight-modellen sterk en goedkoop blijven, blijft de vraag stromen naar de laag die NVIDIA controleert — de gpu's. Zoals LMArena-CEO Anastasios Angelopoulos het in de eerdere berichtgeving verwoordde: "Ongeacht welk bedrijf een geweldig opensource-model maakt, NVIDIA wint."

Waarom het maatnummer het minst interessante deel is

Het voor de hand liggende verhaal is dat NVIDIA naar een biljoen parameters gaat. Het minder voor de hand liggende is dat de open-weight-frontier daar als eerste was. Kimi K3 publiceerde op 27 juli zijn gewichten, met in totaal 2,8 biljoen parameters — waarvan ongeveer 104 miljard actief per token in een mixture-of-experts-configuratie — en Alibaba's Qwen3.8 Max, onthuld op 19 juli, is een model met in totaal 2,4 biljoen parameters en ruwweg 95 miljard actieve parameters. Daartegenover zou een Nemotron 4-vlaggenschip met 'minstens 1 biljoen' twee keer zo groot zijn als Nemotron 3 Ultra, maar het zou nog steeds achterblijven bij de omvangrijkste modellen, en beide koplopers zijn Chinees.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

Dat maakt het totale aantal parameters de verkeerde lens. In een mixture-of-experts-model is het aantal actieve parameters per token dat kosten en snelheid bepaalt, niet het totaal dat de krantenkoppen haalt. Een Nemotron 4 met 1 biljoen parameters in totaal zou kunnen uitkomen op ruwweg 100 miljard actieve parameters — precies in de klasse van Kimi K3 en Qwen3.8 Max — of op de helft daarvan. Het getal dat vervolgens uitlekt is het getal dat ertoe doet, en dat is nog niet uitgelekt.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Ook de andere richting is het vermelden waard: DeepSeek V4-Flash, uitgebracht op 31 juli onder een MIT-licentie, ging de tegenovergestelde weg — 284 miljard in totaal, gepositioneerd op prijs in plaats van schaal, met een geschatte kostprijs van ongeveer $0.14 per miljoen invoertokens. De markt beloont beide extremen. Schaal is niet de strategie; het is één strategie.

De positie van NVIDIA verklaart de zet. The Information meldt dat Nemotron 3 Ultra op de tweede plaats staat bij Amerikaanse open-weights-modellen — achter Inkling van Thinking Machines — en buiten de topcategorie van de wereldwijde open ranglijst. Nemotron 4 is de poging om weer aan te haken bij de frontier-discussie, en NVIDIA's eigen leidinggevenden framen het als een soevereiniteitsstrategie: Kari Briski, VP van generatieve AI, zei dat NVIDIA in Nemotron investeert omdat "elk bedrijf en elk land toegankelijke frontier open-source modellen nodig heeft om veiligheid en beveiliging te versterken, innovatie te versnellen en een fundament te bieden waarop ze van de ene generatie op de volgende kunnen vertrouwen." Jensen Huang voert op X hetzelfde pleidooi en betoogt dat open modellen "veiligheid en cyberbeveiliging versterken, innovatie en verspreiding versnellen en soevereiniteit mogelijk maken." De structurele spanning is reëel — NVIDIA bezit naar verluidt ongeveer $30 miljard aan Ope​nAI — maar de gok is dat open modellen de GPU-taart eerder vergroten dan verkleinen.

De Nemotron Coalitie is het onderdeel om in de gaten te houden.

Nemotron 4 is geen soloproject, en de Poolside-deal is niet de enige structuur eromheen. Op GTC op 16 maart 2026 kondigde NVIDIA de Nemotron Coalition aan — acht oprichtende leden: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam en Thinking Machines Lab — georganiseerd om onderzoek, data en rekenkracht te bundelen achter "frontier open models". Het eerste project is een basismodel dat door Mistral AI en NVIDIA gezamenlijk is ontwikkeld, getraind op NVIDIA DGX Cloud, waarvan de coalitie zegt dat het open source zal worden en de basis zal vormen voor de Nemotron 4-familie.

The Information voegt de operationele details toe: Reflection, Cursor, Thinking Machines en Mistral zijn bevestigde bijdragers; Prime Intellect leverde 300.000 simulatieomgevingen voor training; Cognition heeft gesproken over het leveren van codedata voor training. De CEO van Prime Intellect, Vincent Weisser, omschreef het bondgenootschap als collectieve actie tegen wat hij een monopolie op één 'godachtig' model noemde. Wat dit operationeel betekent: Nemotron 4 zou kunnen verschijnen als een consortium-fundament dat elk lid voor zijn eigen product verder traint, in plaats van één checkpoint van één leverancier. Dat zou van 'open-weights NVIDIA-model' de verkeerde categorie maken — het fundament is het interessante artefact.

De Poolside-deal sluit daar naadloos op aan. De coalitie bundelt onderzoek en rekenkracht; de licentie-en-inhuurdeal levert een werkende modelfabriek op en een team dat al open-gewichtmodellen heeft uitgebracht. Als de berichten kloppen, stelt NVIDIA Nemotron 4 samen uit drie bronnen tegelijk — de eigen trainingsoperatie, een consortiumbasis en Poolside's productiesysteem — wat een andere opzet is dan een release met één checkpoint.

Bevestigd, gerapporteerd, onbekend

• Bevestigd — NVIDIA werkt aan een Nemotron 4-familie (verklaring van het bedrijf). De Nemotron Coalition bestaat en bouwt een open basismodel met Mistral AI (NVIDIA, maart 2026).

• Gemeld, niet bevestigd — het "minstens 1 biljoen" vlaggenschipdoel en de tijdlijn van het late najaar, plus de cloudtoezegging van ~$28 miljard met ~$7 miljard in dit fiscale jaar (The Information); het door de WSJ gerapporteerde bouwbudget van ~$6 miljard, een niet-exclusieve Poolside-licentie voor de "Model Factory", en meer dan 100 Poolside-ingenieurs die zich bij het Nemotron-project aansluiten; de door Bloomberg gerapporteerde investering van $1 miljard door NVIDIA in Poolside bij een pre-money-waardering van ~$12 miljard; welke coalitieleden wat bijdragen.

• Onbekend — aantal actieve parameters, contextlengte, modaliteitenmix, licentievoorwaarden, prijs, welke checkpoints als eerste worden uitgebracht, of de door Mistral mede-ontwikkelde basis daadwerkelijk de basis van de familie wordt, en of de Poolside-deal is gestructureerd zoals gerapporteerd (geen van beide bedrijven heeft commentaar gegeven).

Tijdlijn en wat je moet bekijken

Er is nog steeds geen releasedatum. De laatste trainingsrun is niet begonnen; medewerkers beschrijven die als maandenlang, en de schattingen variëren van 'late herfst' (twee bronnen) tot later. De berichtgeving van Poolside voegt het eerste concrete tijdsbestek toe dat iemand aan het project heeft verbonden: volgens die berichtgeving is het doel om binnen ongeveer een jaar een release te realiseren die kan concurreren met de sterkste frontier-modellen. NVIDIA heeft de familie in de tussentijd op gang gehouden: het leverde Nemotron 3.5 Lightning uit, een agent-worker met 31,6B parameters die op 11 augustus werd uitgebracht — dezelfde dag dat het Nemotron 4-rapport naar buiten kwam — naast NeMo Switchyard, NVIDIA's eigen open-source routeringssoftware.

Wat te bekijken, in grove volgorde van belangrijkheid:

• Actieve parameters — het totaal is het belangrijkste getal; het aantal actieve parameters bepaalt de kosten en snelheid. Een MoE met ~1T totaal en ~100B actief verandert het hele plaatje vergeleken met één met ~50B.

De Poolside-integratie — of de Model Factory-licentie en het nieuwe team het trainingsplan daadwerkelijk hervormen en de gerapporteerde tijdlijn inkorten, of dat het talentwerving is die het plan overeind laat.

• Onafhankelijke scores — er bestaat geen evaluatie door derden voor een model dat niet is getraind. Houd de Artificial Analysis Intelligence Index in de gaten wanneer er een gehost checkpoint verschijnt.

• Licentievoorwaarden — Nemotron 3 Ultra wordt uitgebracht onder OpenMDW-1.1, permissief maar niet MIT of Apache 2.0. Of Nemotron 4 dit volgt of aanscherpt is nog onbeslist, en voor een bedrijf dat voortbouwt op de gewichten, beslist dit alles.

• Welke formaten worden eerst geleverd — Nemotron 3 kwam uit als een familie (Nano, Super, Ultra). Verwacht een reeks Nemotron 4-formaten, en verwacht dat de kleine formaten vóór het vlaggenschip komen.

• De Mistral-basis — of het basismodel van de coalitie daadwerkelijk het fundament van de familie wordt, is de structurele vraag achter al het parametergepraat.

• Prijs — er wordt niets gehost, dus er wordt niets geprijsd. Wanneer een hostingpartner Nemotron 4 vermeldt, is de doorberekende prijs wat je daadwerkelijk zult betalen.

Wat het betekent voor je inferentielaag

U kunt Nemotron 4 vandaag niet aanroepen — niemand kan dat — en de Poolside-rapporten, hoe dramatisch ook, veranderen daar niets aan. De praktische vraag blijft hoeveel van uw stack moet veranderen om een model te accommoderen waarvan het specificatieblad nog steeds in beweging is. Het antwoord is hetzelfde als voor elk niet-uitgebracht frontier-model: houd de inferentielaag model-agnostisch. Als u routeert via een enkele API die meer dan 200 modellen bedient, is een nieuwe Nemotron-familie een configuratiewijziging, geen herschrijving. OrcaRouter geeft de catalogusprijs van de provider door met een opslag van 0%, dus wat een host uiteindelijk voor Nemotron 4 vraagt, is exact wat u betaalt, en een prijsverlaging van de leverancier gaat dezelfde dag in als ze wordt doorgevoerd. Automatische failover is het instrument voor een onbewezen eerste release: stuur het vroege verkeer naar het nieuwe model, val terug op een stabiel alternatief wanneer het hapert of fouten geeft, en promoot het pas naar productie nadat het uw workloads heeft verdiend. Niets daarvan vereist dat u een productiepad inzet op een lek — wat precies de juiste houding is wanneer het specificatieblad zo voorlopig is.

Veelgestelde vragen

Wanneer wordt Nemotron 4 uitgebracht?

Er is nog geen datum vastgesteld. Medewerkers vertelden The Information dat de laatste trainingsrun nog niet is begonnen en maanden zal duren; twee zeiden dat de late herfst van 2026 mogelijk is, en anderen verwachten later. De berichtgeving van deze week voegt een gerapporteerd doel toe: een frontier-concurrerende release binnen ongeveer een jaar, maar nog steeds zonder vaste datum. Behandel beide als schattingen van binnenuit het project, niet als een routekaart.

Zal Nemotron 4 open-source zijn?

NVIDIA's verklaarde intentie is open weights, en het eerste project van de Nemotron Coalitie — het samen met Mistral ontwikkelde basismodel — is toegezegd om open source te worden. Maar "open weights" is niet "open source": Nemotron 3 Ultra wordt uitgebracht onder de OpenMDW-1.1-licentie, die permissiever is dan NVIDIA's oudere voorwaarden, maar nog steeds geen MIT of Apache 2.0 is. De specifieke licentie van Nemotron 4 is nog niet aangekondigd.

Is de gerapporteerde Poolside-deal van $6 miljard bevestigd?

Nee. De WSJ meldde op 22 augustus, onder verwijzing naar ingewijden, de licentie van ongeveer $6 miljard en de toetreding van meer dan 100 Poolside-ingenieurs tot het Nemotron-project; Bloomberg meldde de extra investering van $1 miljard. Newcomer meldde dit als eerste op 20 augustus. Noch NVIDIA, noch Poolside heeft iets hiervan bevestigd. De licentie wordt gemeld als niet-exclusief, en Poolside zou een onafhankelijk bedrijf blijven.

Is "minstens 1 biljoen parameters" een echte specificatie?

Het is een {{1}}door medewerkers aangedragen doelstelling{{/1}} gerapporteerd door {{2}}The Information{{/2}}, geen {{3}}bevestigde specificatie{{/3}}, en hetzelfde rapport zegt dat {{4}}het aantal zou kunnen veranderen{{/4}}. {{5}}Zelfs bij 1 biljoen in totaal{{/5}}, {{6}}zou het qua omvang achterblijven bij Kimi K3 (2,8T) en Qwen3.8 Max (2,4T){{/6}}; het {{7}}aantal actieve parameters{{/7}} — {{8}}dat niet is gelekt{{/8}} — {{9}}is het getal dat de kosten en snelheid zal bepalen{{/9}}.

Moet ik wachten op Nemotron 4 voordat ik een model kies?

Nee. Het duurt op zijn vroegst nog maanden en is onbewezen. Kies nu het beste beschikbare model voor de taak en houd de routeringslaag flexibel; wanneer Nemotron 4 daadwerkelijk uitkomt, beoordeel het dan op dezelfde manier als bij elk nieuw model — actieve parameters, onafhankelijke benchmarks, licentie en prijs — in plaats van op het opvallende totaalcijfer of de omvang van het gerapporteerde budget.

Kortom

De familie is echt; de cijfers zijn schattingen. Deze week veranderde het verhaal van vorm: Nemotron 4 is niet langer alleen maar een parameterlek, het is een gefinancierd project. Naar verluidt geeft NVIDIA ongeveer 6 miljard dollar uit, licentieert Poolside's Model Factory, neemt meer dan 100 van diens ingenieurs in dienst en investeert nog eens 1 miljard dollar in het bedrijf — allemaal om een open-weight vlaggenschip te maken dat naast Deep​Seek en Kimi K3 kan staan. Elk van die cijfers is door de pers gerapporteerd, geen enkel is bevestigd en er is niets uitgebracht. De open-weight frontier heeft de grens van een biljoen parameters al overschreden, en NVIDIA's antwoord is een consortium-basismodel, een gelicentieerde modelfabriek en een belofte. Voor een lezer die vandaag modellen kiest, betekent dat nog steeds één ding: plan niet rond het lek. Houd de inferentielaag flexibel, evalueer wat er ook uitkomt op zijn werkelijke cijfers, en laat routing doen waarvoor hij bedoeld is — het nieuwe uitproberen zonder het productiepad erop te verwedden.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt