Hero-titelkaart voor het Nemotron 4-lekartikel: kop 'Nemotron 4', ondertitel 'NVIDIA's open-weights-familie met 1 biljoen parameters — gerapporteerd, niet uitgebracht', en twee chips gelabeld 'gerapporteerd' en 'niet uitgebracht'. OrcaRouter-logo rechtsonder.
Guides & Insights

Nemotron 4 Lek: NVIDIA's antwoord op de frontier met 1 biljoen parameters en open gewichten

Auteur

Jim Song

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

1 biljoen parameters. Dat is de gerapporteerde ondergrens voor het grootste Nemotron 4-model, het vlaggenschip van NVIDIA's volgende open-gewichtenfamilie — en het getal klinkt alleen maar groot totdat je het naast wat er al is uitgebracht legt. In de afgelopen maand bracht Moonshot AI Kimi K3 uit met 2,8 biljoen totale parameters, onthulde Alibaba Qwen3.8-Max met 2,4 biljoen, en NVIDIA's eigen huidige vlaggenschip, Nemotron 3 Ultra, zit op 550 miljard. The Information meldde op 11 augustus 2026 — onder verwijzing naar meerdere medewerkers die aan het project werken — dat Nemotron 4 NVIDIA's antwoord is: een open-gewichtenfamilie waarvan het grootste model naar verwachting begint bij ruwweg 1 biljoen parameters, ongeveer het dubbele van Nemotron 3 Ultra.

Er is hier nog niets verzonden. NVIDIA heeft erkend dat het een Nemotron 4-familie bouwt, maar het heeft de parameterdoelstelling, het budget, de tijdlijn of de details over de samenwerkingsverbanden die The Information aan anonieme werknemers toeschrijft, niet bevestigd. Beschouw elk getal in dit artikel als 'gerapporteerd', niet als 'gespecificeerd'. Het doel van een artikel over een lek is om de kleine bevestigde kern te scheiden van de grotere gerapporteerde halo – en om je te vertellen welke onderdelen ertoe doen wanneer het echte specificatieblad verschijnt.

Het éénregelige lek, uitgepakt

Eerst de naam, want die zal je in verwarring brengen in zoekresultaten: NVIDIA bracht in juni 2024 al een model genaamd Nemotron-4-340B uit. De nieuwe Nemotron 4 is een andere, grotere familie — de opvolger van de Nemotron 3-lijn (Nano, Super, Ultra) die dit jaar is uitgebracht — en gebruikt de naam "Nemotron 4" opnieuw voor de generatie daarna. Dit artikel gaat over de nieuwe.

Wat The Information daadwerkelijk meldde: NVIDIA ontwikkelt Nemotron 4 als een familie van open-source modellen gericht op de top van het open-gewicht leaderboard, en het vlaggenschip zal naar verwachting "minstens 1 biljoen parameters" hebben. NVIDIA heeft geen releasedatum vastgesteld, is niet begonnen met de definitieve trainingsrun — een proces waarvan medewerkers verwachten dat het maanden zal duren — en heeft alleen de pre-training data en de architectuur vastgesteld; de specificatie is nog in beweging. Twee medewerkers zeiden dat de familie al in de late herfst klaar zou kunnen zijn; anderen verwachten later.

Hetzelfde rapport bevat een begroting: grofweg 28 miljard dollar aan meerjarige cloudservice-overeenkomsten die doorlopen tot begin 2031, ongeveer drie keer zoveel als NVIDIA een jaar eerder bekendmaakte, met ongeveer 7 miljard dollar die in het huidige boekjaar terechtkomt. Het merkt ook op dat het onderzoekspaper van het vorige vlaggenschip 570 auteurs vermeldde en Nemotron 4 er meer bij betrekt — een voormalig medewerker vertelde The Information dat "iedereen betrokken wil zijn." En dat is allemaal niet door NVIDIA gerapporteerd.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

Waarom het maatnummer het minst interessante deel is

Het voor de hand liggende verhaal is: "NVIDIA gaat naar een biljoen parameters." Het minder voor de hand liggende is dat de open-gewichten-grens daar als eerste was. Kimi K3 opende zijn gewichten op 27 juli met 2,8 biljoen totale parameters — ongeveer 104 miljard actieve parameters per token in een mixture-of-experts-configuratie — en Alibaba's Qwen3.8-Max, onthuld op 19 juli, is een model met in totaal 2,4 biljoen parameters en ongeveer 95 miljard actieve parameters. Vergeleken daarmee zou een vlaggenschip Nemotron 4 met "minstens 1 biljoen" parameters Nemotron 3 Ultra verdubbelen, maar nog steeds achterblijven bij de koplopers qua omvang, en die beide koplopers zijn Chinees.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

Dat maakt het totale aantal parameters volledig de verkeerde lens. In een mixture-of-experts-model wordt kosten en snelheid bepaald door het aantal actieve parameters per token, niet door het opvallende totaal. Een Nemotron 4 met in totaal 1 biljoen parameters zou uit kunnen komen op ruwweg 100 miljard actieve parameters — precies in de categorie van Kimi K3 en Qwen3.8-Max — of op de helft daarvan. Het getal dat als volgende uitlekt, is het getal dat er toe doet, en het is nog niet uitgelekt.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Ook de andere richting is het vermelden waard: DeepSeek V4-Flash, uitgebracht op 31 juli onder een MIT-licentie, ging de tegenovergestelde weg — 284 miljard in totaal, gepositioneerd op prijs in plaats van schaal, met een geschatte kostprijs van ongeveer $0.14 per miljoen invoertokens. De markt beloont beide extremen. Schaal is niet de strategie; het is één strategie.

NVIDIA's positie verklaart de zet. The Information meldt dat Nemotron 3 Ultra op de tweede plaats staat onder Amerikaanse open-weights-modellen — achter Thinking Machines' Inkling — en buiten de top van de wereldwijde open-ranglijst. Nemotron 4 is de poging om weer mee te doen in het gesprek over de frontier, en NVIDIA's eigen leidinggevenden framen het als een soevereiniteitsstrategie: VP voor generatieve AI Kari Briski zei dat NVIDIA in Nemotron investeert omdat "elk bedrijf en elk land toegankelijke frontier open-source modellen nodig heeft om veiligheid en beveiliging te versterken, innovatie te versnellen en een fundament te bieden waar ze generatie na generatie op kunnen vertrouwen." Jensen Huang bepleit hetzelfde op X, met het argument dat open modellen "de veiligheid en cybersecurity versterken, innovatie en verspreiding versnellen en soevereiniteit mogelijk maken." De structurele spanning is reëel — NVIDIA zou ruwweg $30 miljard aan OpenAI bezitten — maar de weddenschap is dat open modellen de GPU-taart vergroten in plaats van verkleinen. Zoals LMArena-CEO Anastasios Angelopoulos het zei: "Ongeacht welk bedrijf een geweldig open-source model maakt, NVIDIA wint."

De Nemotron Coalitie is het onderdeel om in de gaten te houden.

{{1}}Nemotron 4 is geen soloproject, en dat is het detail dat de meeste berichtgeving over het hoofd ziet.{{/1}} {{2}}Op GTC op 16 maart 2026 kondigde NVIDIA de Nemotron Coalition aan{{/2}} — {{3}}acht oprichtende leden: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam en Thinking Machines Lab{{/3}} — {{4}}georganiseerd om onderzoek, data en rekenkracht te bundelen achter 'frontier open models.'{{/4}} {{5}}Het eerste project is een basismodel dat door Mistral AI en NVIDIA is ontwikkeld, getraind op NVIDIA DGX Cloud, waarvan de coalitie zegt dat het open source zal worden en de basis zal vormen voor de Nemotron 4-familie.{{/5}}

The Information voegt de operationele details toe: Reflection, Cursor, Thinking Machines en Mistral zijn bevestigde bijdragers; Prime Intellect leverde 300.000 simulatieomgevingen voor training; Cognition heeft gesproken over het leveren van codedata voor training. De CEO van Prime Intellect, Vincent Weisser, omschreef het bondgenootschap als collectieve actie tegen wat hij een monopolie op één 'godachtig' model noemde. Wat dit operationeel betekent: Nemotron 4 zou kunnen verschijnen als een consortium-fundament dat elk lid voor zijn eigen product verder traint, in plaats van één checkpoint van één leverancier. Dat zou van 'open-weights NVIDIA-model' de verkeerde categorie maken — het fundament is het interessante artefact.

Bevestigd, gerapporteerd, onbekend

• Bevestigd — NVIDIA werkt aan een Nemotron 4-familie (verklaring van het bedrijf). De Nemotron Coalition bestaat en bouwt een open basismodel met Mistral AI (NVIDIA, maart 2026).

• Gerapporteerd, niet bevestigd — de "minstens 1 biljoen" vlaggenschipdoelstelling; de tijdlijn van het late najaar; de cloudtoezegging van ~$28 miljard met ~$7 miljard in dit fiscale jaar; welke coalitieleden wat bijdragen.

• Onbekend — aantal actieve parameters, contextlengte, modaliteitsmix, licentievoorwaarden, prijs, welke checkpoints het eerst uitkomen, en of de met Mistral mede-ontwikkelde basis daadwerkelijk de basis van de familie wordt.

Tijdlijn en wat je moet bekijken

Er is geen releasedatum. De laatste trainingsrun is nog niet begonnen; medewerkers omschrijven die als maandenlang, en de schattingen lopen uiteen van "late herfst" (twee bronnen) tot later. NVIDIA heeft de familie in de tussentijd in beweging gehouden: het bracht Nemotron 3.5 Lightning uit, een agent-worker met 31,6B parameters die op 11 augustus verscheen — dezelfde dag dat het Nemotron 4-rapport naar buiten kwam — samen met NeMo Switchyard, NVIDIA's eigen open-source routeringssoftware. Met andere woorden: NVIDIA blijft de line-up actief doorontwikkelen terwijl het vlaggenschip nog op de tekentafel ligt.

Wat te bekijken, in grove volgorde van belangrijkheid:

• Actieve parameters — het totaal is het belangrijkste getal; het aantal actieve parameters bepaalt de kosten en snelheid. Een MoE met ~1T totaal en ~100B actief verandert het hele plaatje vergeleken met één met ~50B.

• Onafhankelijke scores — er bestaat geen evaluatie door derden voor een model dat niet is getraind. Houd de Artificial Analysis Intelligence Index in de gaten wanneer er een gehost checkpoint verschijnt.

• Licentievoorwaarden — Nemotron 3 Ultra wordt uitgebracht onder OpenMDW-1.1, permissief maar niet MIT of Apache 2.0. Of Nemotron 4 dit volgt of aanscherpt is nog onbeslist, en voor een bedrijf dat voortbouwt op de gewichten, beslist dit alles.

• Welke formaten worden eerst geleverd — Nemotron 3 kwam uit als een familie (Nano, Super, Ultra). Verwacht een reeks Nemotron 4-formaten, en verwacht dat de kleine formaten vóór het vlaggenschip komen.

• De Mistral-basis — of het basismodel van de coalitie daadwerkelijk het fundament van de familie wordt, is de structurele vraag achter al het parametergepraat.

• Prijs — er wordt niets gehost, dus er wordt niets geprijsd. Wanneer een hostingpartner Nemotron 4 vermeldt, is de doorberekende prijs wat je daadwerkelijk zult betalen.

Wat het betekent voor je inferentielaag

Je kunt Nemotron 4 vandaag niet aanroepen — niemand kan dat — dus de praktische vraag is hoeveel van je stack moet veranderen om een model te accommoderen waarvan de specificaties nog in beweging zijn. Het antwoord is hetzelfde als voor elk nog niet uitgebracht frontier-model: houd de inferentielaag modelagnostisch. Als je routeert via een enkele API die toegang biedt tot 200+ modellen, is een nieuwe Nemotron-familie een configuratiewijziging, geen herschrijving. OrcaRouter geeft de catalogusprijs van de provider door met 0% opslag, dus wat een host uiteindelijk voor Nemotron 4 rekent, is exact wat jij betaalt, en een prijsverlaging door de leverancier gaat dezelfde dag in als ze wordt doorgevoerd. Automatische failover is het instrument voor een onbewezen eerste release: stuur vroege traffic naar het nieuwe model, val terug op een stabiel alternatief wanneer het vastloopt of fouten geeft, en breng het pas naar productie nadat het je workloads heeft verdiend. Niets daarvan vereist dat je een productietraject op een lek inzet — en dat is precies de juiste houding wanneer de specificaties zo voorlopig zijn.

Veelgestelde vragen

Wanneer wordt Nemotron 4 uitgebracht?

Er is geen datum vastgesteld. Werknemers vertelden The Information dat de laatste trainingsrun nog niet is gestart en maanden zal duren; twee zeiden dat de late herfst van 2026 mogelijk is, en anderen verwachten later. Behandel "late herfst" als een hoopvolle schatting vanuit het project, niet als een routekaart.

Zal Nemotron 4 open-source zijn?

NVIDIA's verklaarde intentie is open weights, en het eerste project van de Nemotron Coalitie — het samen met Mistral ontwikkelde basismodel — is toegezegd om open source te worden. Maar "open weights" is niet "open source": Nemotron 3 Ultra wordt uitgebracht onder de OpenMDW-1.1-licentie, die permissiever is dan NVIDIA's oudere voorwaarden, maar nog steeds geen MIT of Apache 2.0 is. De specifieke licentie van Nemotron 4 is nog niet aangekondigd.

Is "minstens 1 biljoen parameters" een echte specificatie?

Het is een door medewerkers aangeleverde doelstelling waarover The Information bericht, geen bevestigde specificatie, en hetzelfde bericht zegt dat het aantal zou kunnen veranderen. Zelfs bij een totaal van 1 biljoen zou het in ruwe omvang achterblijven bij Kimi K3 (2,8T) en Qwen3.8-Max (2,4T); het aantal actieve parameters — dat niet is uitgelekt — is het getal dat de kosten en de snelheid zal bepalen.

Moet ik wachten op Nemotron 4 voordat ik een model kies?

Nee. Het is op zijn vroegst nog maanden verwijderd en onbewezen. Kies nu het beste beschikbare model voor de klus en houd de routinglaag flexibel; wanneer Nemotron 4 daadwerkelijk uitkomt, evalueer het dan op dezelfde manier als je elk nieuw model zou evalueren — actieve parameters, onafhankelijke benchmarks, licentie en prijs — in plaats van op het aangeprezen totaal.

Kortom

De familie is echt; de cijfers zijn schattingen. NVIDIA heeft bevestigd dat het Nemotron 4 bouwt, en de coalitiestructuur eromheen is het interessantste deel van het verhaal — maar elk opvallend cijfer in de lek, van de ondergrens van 1 biljoen tot de tijdlijn van late herfst tot het budget van $28 miljard, komt van anonieme werknemers en kan nog wijzigen. De open-gewichtgrens is al voorbij de mijlpaal van een biljoen parameters, aangevoerd door Chinese laboratoria, en de reactie van NVIDIA is een consortium-basismodel plus een belofte. Voor een lezer die vandaag modellen kiest, betekent dat één ding: plan niet rond de lek. Houd de inferentielaag flexibel, evalueer wat er ook uitkomt op basis van de echte cijfers, en laat routing doen waar routing voor is — het nieuwe uitproberen zonder het productiepad erop te verwedden.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

Neem contact op

Word lid van de community

DiscordEmailXGitHubYouTube