
Nemotron 4 Läcka: NVIDIAs svar till frontlinjen med öppna vikter och 1 biljon parametrar
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 143 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Nemotron 4 är fortfarande inte släppt, men i veckan slutade den att vara ett rykte som bara handlade om ett parameterantal. The Wall Street Journal rapporterade den 22 augusti 2026, med hänvisning till personer med insyn i ärendet, att NVIDIA spenderar cirka 6 miljarder dollar för att utveckla Nemotron 4 till en av världens mest kraftfulla AI-modeller med öppna vikter — och att planen inkluderar en icke-exklusiv licens till AI-startupen Poolsides modellträningsteknik plus överföringen av fler än 100 av Poolsides ingenjörer till Nemotron 4-projektet. Detta kommer utöver den tidigare läckan från The Information, den 11 augusti, om att familjens flaggskepp kommer att ha "minst 1 biljon parametrar." Sammantaget beskriver de två rapporterna NVIDIAs hittills allvarligaste försök att nå toppen inom modeller med öppna vikter.
Inget här har levererats, och inget av det är bekräftat. NVIDIA har erkänt att de bygger en Nemotron 4-familj, men de har inte bekräftat parametermålet, tidsplanen, licens- och anställningsplanen som WSJ tillskriver personer med insyn i affären, eller alliansdetaljerna som The Information tillskriver namnlösa anställda. Behandla varje siffra i den här texten som "rapporterad", inte "specificerad". Poängen med en läckageartikel är att skilja den lilla bekräftade kärnan från den större rapporterade halon – och att berätta för dig vilka delar som spelar roll när den riktiga specifikationslistan släpps.
Enradsläckan, förklarad
Först namnet, eftersom det kommer att förvirra dig i sökresultaten: NVIDIA släppte redan en modell som heter Nemotron-4-340B i juni 2024. Den nya Nemotron 4 är en annan, större familj — efterträdaren till Nemotron 3-serien (Nano, Super, Ultra) som släpptes i år — som återanvänder namnet "Nemotron 4" för generationen efter. Den här artikeln handlar om den nya.
Vad The Information faktiskt rapporterade: NVIDIA utvecklar Nemotron 4 som en familj av öppen källkodsmodeller som siktar på toppen av ledartavlan för öppna vikter, och flaggskeppsmodellen förväntas ha "minst 1 biljon parametrar." NVIDIA har inte satt ett releasedatum, har inte påbörjat den slutgiltiga träningskörningen – en process som anställda förväntar sig ska ta månader – och har endast fastställt förträningsdata och arkitekturen; specifikationen är fortfarande i rörelse. Två anställda sade att familjen kan vara redo redan i senhösten; andra förväntar sig senare.
Samma rapport innehåller en separat budget: cirka 28 miljarder dollar i fleråriga molntjänstavtal som löper till början av 2031, ungefär tre gånger vad NVIDIA avslöjade ett år tidigare, med omkring 7 miljarder dollar som hamnar under det innevarande räkenskapsåret. Den siffran täcker beräkningsåtaganden, inte det nya avtalet som rapporterades den här veckan. Rapporten noterar också att den tidigare flaggskeppsmodellens forskningsrapport listade 570 författare och Nemotron 4 involverar fler – en tidigare anställd sade till The Information att "alla vill vara med." Allt detta har inte rapporterats av NVIDIA.

Den här veckan: en Poolside-affär på 6 miljarder dollar för att göra Nemotron 4 verklig
The Wall Street Journal rapporterade denna vecka att NVIDIAs plan för Nemotron 4 inte bara är ett forskningsprojekt – det är en finansierad satsning. Enligt WSJ, som citerar personer med insyn i ärendet, kommer NVIDIA att betala ungefär 6 miljarder dollar för en icke-exklusiv licens till Poolsides "Model Factory", det tränings- och utvärderingssystem som ligger bakom Poolsides open-weight Laguna-kodmodeller, och lägga jobberbjudanden till fler än 100 av Poolsides anställda – rapporterat som 109, de flesta ingenjörer – för att arbeta på Nemotron-projektet. Bloomberg rapporterade separat att NVIDIA kommer att investera ytterligare 1 miljard dollar i Poolside till en rapporterad värdering om 12 miljarder dollar före investeringen, vilket bringar NVIDIAs totala rapporterade åtagande till ungefär 7 miljarder dollar.
Det är inte ett förvärv. Licensen är icke-exklusiv, Poolside:s grundare stannar kvar, och Poolside fortsätter att verka som ett oberoende företag; enligt rapporteringen planerar Poolside att fördela licensbetalningen på 6 miljarder dollar till sina investerare. Historien dök först upp genom Newcomer den 20 augusti och bekräftades av Bloomberg den 21 augusti och WSJ den 22 augusti — allt fortfarande ”rapporterat”, inget av det bekräftat av NVIDIA eller Poolside.
Varför affären betyder mer än rubriksiffran: den ger Nemotron 4-projektet ett team som faktiskt har levererat open-weight-modeller. Poolsides Laguna-familj är en beprövad serie open-weight-modeller för kodning, och det rapporterade målet – en Nemotron-lansering inom ungefär ett år som kan konkurrera med de starkaste frontier-modellerna – är den första konkreta tidsram som någon har kopplat till projektet. Rapporterna beskriver flytten som NVIDIAs svar på open-weight-ledarna i Kina, särskilt DeepSeek och Moonshot AI:s Kimi K3, och, i debatten om öppna kontra stängda modeller, som en säkring mot de stängda labben i USA.
Strukturen spelar också roll. En icke-exklusiv licens innebär att Poolside behåller sin immateriella egendom och kan licensiera samma teknik till andra — NVIDIA köper kompetens och talang, inte äganderätt. Analytiker tolkar det som NVIDIAs försök att hålla modellagret kommodifierat: om open-weight-modeller förblir starka och billiga fortsätter efterfrågan att flöda till det lager NVIDIA kontrollerar — GPU:erna. Som LMArenas vd Anastasios Angelopoulos uttryckte det i den tidigare rapporteringen: "Oavsett vilket företag som gör en bra open source-modell, vinner NVIDIA."
Varför storleksnumret är den minst intressanta delen
Den uppenbara berättelsen är att NVIDIA satsar på biljonparametrar. Den mindre uppenbara är att open-weight-fronten var där först. Kimi K3 öppnade sina vikter den 27 juli med totalt 2,8 biljoner parametrar – cirka 104 miljarder aktiva per token i en mixture-of-experts-konfiguration – och Alibabas Qwen3.8 Max, som avtäcktes den 19 juli, är en modell med totalt 2,4 biljoner parametrar och ungefär 95 miljarder aktiva. Mot dessa skulle en Nemotron 4-flaggskeppsmodell med "minst 1 biljon" dubblera Nemotron 3 Ultra men ändå ligga efter storleksledarna, och båda dessa ledare är kinesiska.

Det gör det totala antalet parametrar till helt fel lins. I en mixture-of-experts-modell är det antalet aktiva parametrar per token som avgör kostnad och hastighet, inte den uppmärksammade totalsiffran. En Nemotron 4 med totalt 1 biljon parametrar skulle kunna hamna på ungefär 100 miljarder aktiva — rakt i samma klass som Kimi K3 och Qwen3.8 Max — eller på hälften av det. Nästa siffra som läcker ut är den som räknas, och den har inte läckt än.

Den andra riktningen är också värd att notera: DeepSeek V4-Flash, som släpptes den 31 juli under en MIT-licens, gick åt motsatt håll — totalt 284 miljarder, positionerad på pris snarare än skala, till en uppskattad kostnad på cirka 0,14 dollar per miljon input tokens. Marknaden belönar båda ytterligheterna. Skala är inte strategin; det är en strategi.
NVIDIAs position förklarar draget. The Information rapporterar att Nemotron 3 Ultra rankas tvåa bland USA:s open-weights-modeller — bakom Thinking Machines' Inkling — och utanför toppskiktet på den globala open leaderboarden. Nemotron 4 är försöket att ta sig tillbaka in i frontlinjediskussionen, och NVIDIAs egna chefer framställer det som en suveränitetssatsning: vicepresidenten för generativ AI, Kari Briski, sade att NVIDIA investerar i Nemotron eftersom ”varje företag och varje land behöver tillgängliga frontlinjemodeller med öppen källkod för att stärka säkerhet och trygghet, påskynda innovation och tillhandahålla en grund som de kan lita på från en generation till nästa.” Jensen Huang har framfört samma argument på X och menar att öppna modeller ”stärker säkerhet och cybersäkerhet, påskyndar innovation och spridning, och möjliggör suveränitet.” Den strukturella spänningen är reell — NVIDIA uppges äga cirka 30 miljarder dollar av OpenAI — men vadet är att öppna modeller gör GPU-kakan större snarare än att krympa den.
Nemotronkoalitionen är delen att hålla koll på.
Nemotron 4 är inte ett soloprojekt, och Poolside-affären är inte den enda strukturen kring det. På GTC den 16 mars 2026 tillkännagav NVIDIA Nemotron Coalition – åtta grundarmedlemmar: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam och Thinking Machines Lab – organiserade för att slå samman forskning, data och beräkningskraft bakom ”frontier open models”. Dess första projekt är en grundmodell som utvecklats gemensamt av Mistral AI och NVIDIA, tränad på NVIDIA DGX Cloud, som koalitionen säger kommer att vara öppen källkod och ligga till grund för Nemotron 4-familjen.
The Information fyller i de konkreta detaljerna: Reflection, Cursor, Thinking Machines och Mistral är bekräftade bidragsgivare; Prime Intellect har bidragit med 300 000 simuleringsmiljöer för träning; Cognition har diskuterat att tillhandahålla kodträningsdata. Prime Intellects vd, Vincent Weisser, beskrev alliansen som kollektiv handling mot vad han kallade ett enda "gudsliknande" modellmonopol. Vad detta innebär operativt: Nemotron 4 kan lanseras som en konsortiegrund som varje medlem vidaretränar för sin egen produkt, snarare än en enda leverantörs checkpoint. Det skulle göra "open-weights NVIDIA-modell" till fel kategori — basen är den intressanta artefakten.
Poolside-affären passar in vid sidan av allt detta. Koalitionen slår samman forskning och beräkningskraft; licens-och-anställningsavtalet tillför en fungerande modellfabrik och personal som har levererat öppna vikter. Om rapporterna stämmer håller NVIDIA på att sätta samman Nemotron 4 från tre källor samtidigt — sin egen träningsverksamhet, en konsortiebas och Poolside:s produktionssystem — vilket är en annan form än någon utgivning med en enda kontrollpunkt.
Bekräftad, rapporterad, okänd
• Bekräftat — NVIDIA arbetar på en Nemotron 4-familj (enligt företaget). Nemotron Coalition finns och bygger en öppen basmodell tillsammans med Mistral AI (NVIDIA, mars 2026).
• Rapporterat, obekräftat – flaggskeppsmålet på "minst 1 biljon" och tidsplanen för senhösten, samt molnåtagandet på cirka 28 miljarder dollar, varav cirka 7 miljarder dollar detta räkenskapsår (The Information); den av WSJ rapporterade byggbudgeten på cirka 6 miljarder dollar, icke-exklusiv licens för Poolside "Model Factory" och fler än 100 Poolside-ingenjörer som ansluter till Nemotron-projektet; den av Bloomberg rapporterade NVIDIA-investeringen på 1 miljard dollar i Poolside till en värdering på cirka 12 miljarder dollar före investeringen; vilka koalitionsmedlemmar som bidrar med vad.
• Okänt — antal aktiva parametrar, kontextlängd, modalitetsblandning, licensvillkor, pris, vilka checkpoints som levereras först, om den Mistral-samutvecklade basen faktiskt blir familjens grund, och om Poolside-affären är strukturerad som rapporterats (inget av företagen har kommenterat).
Tidslinje och vad du ska titta på
Det finns fortfarande inget releasedatum. Den slutgiltiga träningskörningen har inte startat; anställda beskriver den som månader lång, och uppskattningarna sträcker sig från "senhösten" (två källor) till senare. Rapporteringen från Poolside ger den första konkreta tidsram som någon har kopplat till projektet: enligt rapporten är målet en lansering inom ungefär ett år som kan konkurrera med de starkaste frontmodellerna. NVIDIA har hållit modellfamiljen i rörelse under tiden: man släppte Nemotron 3.5 Lightning, en agentarbetare med 31,6 miljarder parametrar, den 11 augusti – samma dag som Nemotron 4-rapporten kom ut – tillsammans med NeMo Switchyard, NVIDIAs egen programvara för routing med öppen källkod.
Vad du ska titta på, i ungefärlig prioritetsordning:
• Aktiva parametrar — totalen är huvudtalet; antalet aktiva avgör kostnad och hastighet. En MoE med totalt ~1T och ~100B aktiva förändrar hela bilden jämfört med en med ~50B.
• Poolside-integrationen — huruvida Model Factory-licensen och dess nya team faktiskt omformar träningsplanen och komprimerar den rapporterade tidslinjen, eller om det är talangförvärv som lämnar planen orörd.
• Oberoende poäng — ingen tredjepartsutvärdering finns för en modell som inte har tränats. Håll utkik efter Artificial Analysis Intelligence Index när en hostad kontrollpunkt dyker upp.
Licensvillkor — Nemotron 3 Ultra levereras under OpenMDW-1.1, tillåtande men inte MIT eller Apache 2.0. Huruvida Nemotron 4 följer efter eller skärper villkoren är ännu inte bestämt, och för ett företag som bygger på vikterna avgör det allt.
• Vilka storlekar levereras först — Nemotron 3 kom som en familj (Nano, Super, Ultra). Förvänta dig en rad Nemotron 4-storlekar, och förvänta dig att de små kommer före flaggskeppet.
• Mistral-basen — huruvida koalitionens basmodell faktiskt blir familjens grund är den strukturella frågan bakom allt prat om parametrar.
• Pris — ingenting hostas, så ingenting prissätts. När en värdpartner listar Nemotron 4, är pass-through-priset det du faktiskt betalar.
Vad det innebär för ditt inferenslager
Du kan inte anropa Nemotron 4 idag – ingen kan det – och Poolside-rapporterna, hur dramatiska de än är, ändrar inte på det. Den praktiska frågan är fortfarande hur mycket av din stack som bör ändras för att rymma en modell vars specifikationsblad fortfarande är i rörelse. Svaret är detsamma som för vilken osläppt frontier-modell som helst: håll inferenslagret modellagnostiskt. Om du går via ett enda API som ger tillgång till 200+ modeller, är en ny Nemotron-familj en konfigurationsändring, inte en omskrivning. OrcaRouter vidarebefordrar leverantörens listpris med 0 % påslag, så vad en värd så småningom tar för Nemotron 4 är exakt vad du betalar, och en prissänkning från leverantören slår igenom samma dag som den görs. Automatisk failover är verktyget för en obeprövad första release: peka tidig trafik mot den nya modellen, fall tillbaka till ett stabilt alternativ när den hakar upp sig eller ger fel, och flytta upp den till produktion först efter att den förtjänat dina arbetsbelastningar. Inget av det kräver att du satsar en produktionsväg på en läcka – vilket är exakt rätt hållning när specifikationsbladet är så här preliminärt.
Vanliga frågor
När kommer Nemotron 4 att släppas?
Inget datum har satts. Anställda har sagt till The Information att den slutgiltiga träningskörningen inte har påbörjats och kommer att ta månader; två sade att senhösten 2026 är möjligt, och andra förväntar sig senare. Den här veckans rapportering tillägger ett rapporterat mål om en release inom ungefär ett år som kan konkurrera med de främsta modellerna, men fortfarande inget fast datum. Behandla båda som uppskattningar inifrån projektet, inte som en färdplan.
Kommer Nemotron 4 att vara öppen källkod?
{{1}}NVIDIAs uttalade avsikt är öppna vikter, och Nemotron-koalitionens första projekt — basmodellen som utvecklats tillsammans med Mistral — har utlovats att släppas som öppen källkod.{{/1}} {{2}}Men "öppna vikter" är inte "öppen källkod": Nemotron 3 Ultra levereras under OpenMDW-1.1-licensen, som är mer tillåtande än NVIDIAs äldre villkor men fortfarande inte MIT eller Apache 2.0.{{/2}} {{3}}Nemotron 4:s specifika licens har inte tillkännagivits.{{/3}}
Är den rapporterade Poolside-affären på 6 miljarder dollar bekräftad?
Nej. WSJ rapporterade den 22 augusti, med hänvisning till personer med kännedom om saken, att licensen gäller cirka 6 miljarder dollar och att fler än 100 Poolside-ingenjörer ansluter sig till Nemotron-projektet; Bloomberg rapporterade den ytterligare investeringen på 1 miljard dollar. Newcomer rapporterade det först den 20 augusti. Varken NVIDIA eller Poolside har bekräftat något av detta. Licensen uppges vara icke-exklusiv, och Poolside skulle förbli ett oberoende företag.
Är "minst 1 biljon parametrar" en verklig specifikation?
Det är ett mål som uppges av anställda och som rapporterats av The Information, inte en bekräftad specifikation, och samma rapport säger att antalet kan komma att ändras. Även vid totalt 1 biljon skulle det hamna efter Kimi K3 (2.8T) och Qwen3.8 Max (2.4T) i rå storlek; antalet aktiva parametrar – som inte har läckt ut – är den siffra som kommer att avgöra kostnad och hastighet.
Bör jag vänta på Nemotron 4 innan jag väljer en modell?
Nej. Den är månader bort i bästa fall och oprövad. Välj den bästa tillgängliga modellen för jobbet nu och håll routinglagret flexibelt; när Nemotron 4 faktiskt släpps, utvärdera den på samma sätt som du skulle utvärdera vilken ny modell som helst — aktiva parametrar, oberoende riktmärken, licens och pris — snarare än på den rubriksatta totalsiffran eller storleken på dess rapporterade budget.
Slutsats
Familjen är verklig; siffrorna är uppskattningar. Den här veckan förändrades historien: Nemotron 4 är inte längre bara ett parameterläckage, det är en finansierad satsning. NVIDIA uppges spendera cirka 6 miljarder dollar, licensiera Poolside's Model Factory, anställa fler än 100 av dess ingenjörer och investera ytterligare 1 miljard dollar i företaget – allt för att skapa ett flaggskepp med öppna vikter som kan stå sida vid sida med DeepSeek och Kimi K3. Var och en av dessa siffror är pressrapporterad, ingen är bekräftad och ingenting har levererats. Frontlinjen för öppna vikter har redan passerat biljonparametermärket, och NVIDIAs svar är en konsortiebasmodell, en licensierad modellfabrik och ett löfte. För en läsare som väljer modeller idag betyder det fortfarande en sak: planera inte utifrån läckan. Håll inferenslagret flexibelt, utvärdera det som levereras utifrån dess verkliga siffror, och låt routing göra det routing är till för – att prova det nya utan att satsa produktionsvägen på det.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
