
Nemotron 4 Läcka: NVIDIAs svar till frontlinjen med öppna vikter och 1 biljon parametrar
- metaNYMeta: Muse Spark 1.22026-08-0557Intelligens72Kodning
- qwenNYQwen: Qwen3.8 Max2026-08-0358Intelligens72Kodning
- deepseekNYDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligens69Kodning
- minimaxNYMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens · 2278 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligens69Kodning
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
- metaMeta: Muse Spark 1.12026-07-1653Intelligens71Kodning
- kimiMoonshotAI: Kimi K32026-07-1560Intelligens76Kodning
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligens71Kodning
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligens77Kodning
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligens77Kodning
- grokxAI: Grok 4.52026-07-0856Intelligens72Kodning
- tencentTencent: Hy32026-07-0642Intelligens59Kodning
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligens42Kodning
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligens39Kodning
- anthropicAnthropic: Claude Sonnet 52026-06-3055Intelligens72Kodning
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligens52Kodning57Matematik
{{1}}1 biljon parametrar{{/1}}. Det är det rapporterade golvet för {{2}}den största Nemotron 4-modellen{{/2}}, {{3}}flaggskeppet i NVIDIAs nästa familj med öppna vikter{{/3}} – och {{4}}siffran låter bara stor tills du ställer den bredvid det som redan har släppts{{/4}}. Under den senaste månaden {{5}}släppte Moonshot AI Kimi K3 med 2,8 biljoner totala parametrar{{/5}}, {{6}}Alibaba avtäckte Qwen3.8-Max med 2,4 biljoner{{/6}}, och {{7}}NVIDIAs eget nuvarande flaggskepp, Nemotron 3 Ultra, ligger på 550 miljarder{{/7}}. {{8}}The Information rapporterade den 11 augusti 2026 – med hänvisning till flera anställda som arbetar med projektet – att Nemotron 4 är NVIDIAs svar{{/8}}: {{9}}en familj med öppna vikter vars största modell förväntas börja på cirka 1 biljon parametrar{{/9}}, {{10}}cirka dubbelt så mycket som Nemotron 3 Ultra{{/10}}.
Ingenting här har släppts. NVIDIA har medgett att de bygger en Nemotron 4-familj, men de har inte bekräftat parametermålet, budgeten, tidslinjen eller alliansdetaljerna som The Information tillskriver namnlösa anställda. Behandla varje siffra i den här texten som ”rapporterad”, inte ”specificerad”. Poängen med en läckrapport är att skilja den lilla bekräftade kärnan från den större rapporterade glorian – och att berätta vilka delar som spelar roll när det riktiga specifikationsbladet väl landar.
Enradsläckan, förklarad
Först namnet, eftersom det kommer att förvirra dig i sökresultaten: NVIDIA släppte redan en modell som heter Nemotron-4-340B i juni 2024. Den nya Nemotron 4 är en annan, större familj — efterträdaren till Nemotron 3-serien (Nano, Super, Ultra) som släpptes i år — som återanvänder namnet "Nemotron 4" för generationen efter. Den här artikeln handlar om den nya.
Vad The Information faktiskt rapporterade: NVIDIA utvecklar Nemotron 4 som en familj av öppen källkodsmodeller som siktar på toppen av ledartavlan för öppna vikter, och flaggskeppsmodellen förväntas ha "minst 1 biljon parametrar." NVIDIA har inte satt ett releasedatum, har inte påbörjat den slutgiltiga träningskörningen – en process som anställda förväntar sig ska ta månader – och har endast fastställt förträningsdata och arkitekturen; specifikationen är fortfarande i rörelse. Två anställda sade att familjen kan vara redo redan i senhösten; andra förväntar sig senare.
Samma rapport innehåller en budget: cirka 28 miljarder dollar i fleråriga molntjänstavtal som sträcker sig till tidigt 2031, ungefär tre gånger så mycket som NVIDIA avslöjade ett år tidigare, med cirka 7 miljarder dollar som hamnar under det innevarande räkenskapsåret. Den noterar också att den tidigare flaggskeppsmodellens forskningsrapport listade 570 författare och att Nemotron 4 involverar fler – en tidigare anställd sade till The Information att "alla vill vara med". Allt detta har inte rapporterats av NVIDIA.

Varför storleksnumret är den minst intressanta delen
Den uppenbara historien är att ”NVIDIA går mot biljonparametrar.” Den mindre uppenbara är att open-weight-fronten kom dit först. Kimi K3 öppnade sina vikter den 27 juli med totalt 2,8 biljoner parametrar — cirka 104 miljarder aktiva per token i en mixture-of-experts-konfiguration — och Alibabas Qwen3.8-Max, som avtäcktes den 19 juli, är en modell med totalt 2,4 biljoner parametrar och ungefär 95 miljarder aktiva. Mot dessa skulle en Nemotron 4-flaggskeppsmodell med ”minst 1 biljon” fördubbla Nemotron 3 Ultra men ändå hamna efter storleksledarna, och båda dessa ledare är kinesiska.

Det gör det totala parametrarantalet till helt fel lins. I en mixture-of-experts-modell är det antalet aktiva parametrar per token som bestämmer kostnad och hastighet, inte rubriksiffran. En Nemotron 4 med totalt 1 biljon parametrar skulle kunna landa på cirka 100 miljarder aktiva – mitt i samma klass som Kimi K3 och Qwen3.8-Max – eller på hälften av det. Det nummer som läcker härnäst är det som räknas, och det har inte läckt än.

Den andra riktningen är också värd att notera: DeepSeek V4-Flash, som släpptes den 31 juli under en MIT-licens, gick åt motsatt håll — totalt 284 miljarder, positionerad på pris snarare än skala, till en uppskattad kostnad på cirka 0,14 dollar per miljon input tokens. Marknaden belönar båda ytterligheterna. Skala är inte strategin; det är en strategi.
NVIDIAs position förklarar draget. The Information rapporterar att Nemotron 3 Ultra rankas tvåa bland amerikanska öppna viktmodeller – bakom Thinking Machines Inkling – och utanför toppskiktet på den globala öppna ledartavlan. Nemotron 4 är försöket att ta sig tillbaka in i frontlinjediskussionen, och NVIDIAs egna chefer beskriver det som en suveränitetssatsning: VP för generativ AI Kari Briski sade att NVIDIA investerar i Nemotron eftersom "varje företag och varje land behöver tillgängliga banbrytande modeller med öppen källkod för att stärka säkerhet och trygghet, påskynda innovation och skapa en grund som de kan lita på från en generation till nästa." Jensen Huang har fört fram samma argument på X och menat att öppna modeller "stärker säkerhet och cybersäkerhet, påskyndar innovation och spridning samt möjliggör suveränitet." Den strukturella spänningen är verklig – NVIDIA äger enligt uppgift cirka 30 miljarder dollar i OpenAI – men satsningen är att öppna modeller utökar GPU-kakan snarare än krymper den. Som LMArenas vd Anastasios Angelopoulos uttryckte det: "Oavsett vilket företag som skapar en bra modell med öppen källkod vinner NVIDIA."
Nemotronkoalitionen är delen att hålla koll på.
Nemotron 4 är inte ett soloprojekt, och det är den detaljen de flesta bevakningar missar. På GTC den 16 mars 2026 tillkännagav NVIDIA Nemotron Coalition – åtta grundarmedlemmar: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam och Thinking Machines Lab – organiserade för att slå samman forskning, data och datorkraft bakom "banbrytande öppna modeller." Dess första projekt är en basmodell som samutvecklats av Mistral AI och NVIDIA, tränad på NVIDIA DGX Cloud, som koalitionen uppger kommer att släppas som öppen källkod och ligga till grund för Nemotron 4-familjen.
The Information fyller i de konkreta detaljerna: Reflection, Cursor, Thinking Machines och Mistral är bekräftade bidragsgivare; Prime Intellect har bidragit med 300 000 simuleringsmiljöer för träning; Cognition har diskuterat att tillhandahålla kodträningsdata. Prime Intellects vd, Vincent Weisser, beskrev alliansen som kollektiv handling mot vad han kallade ett enda "gudsliknande" modellmonopol. Vad detta innebär operativt: Nemotron 4 kan lanseras som en konsortiegrund som varje medlem vidaretränar för sin egen produkt, snarare än en enda leverantörs checkpoint. Det skulle göra "open-weights NVIDIA-modell" till fel kategori — basen är den intressanta artefakten.
Bekräftad, rapporterad, okänd
• Bekräftat — NVIDIA arbetar på en Nemotron 4-familj (enligt företaget). Nemotron Coalition finns och bygger en öppen basmodell tillsammans med Mistral AI (NVIDIA, mars 2026).
• Rapporterat, ej bekräftat — flaggskeppsmålet på "minst 1 biljon"; tidslinjen mot senhösten; cloud-åtagandet på ~28 miljarder dollar med ~7 miljarder dollar detta räkenskapsår; vilka koalitionsmedlemmar som bidrar med vad.
• Okänt — antal aktiva parametrar, kontextlängd, modalitetsmix, licensvillkor, pris, vilka checkpoints som levereras först, och huruvida den Mistral-samutvecklade basen verkligen blir familjens grund.
Tidslinje och vad du ska titta på
Det finns inget släppdatum. Den slutliga träningskörningen har inte startat; anställda beskriver den som månader lång, och uppskattningarna varierar från ”senhösten” (två källor) till senare. NVIDIA har under tiden hållit familjen i rörelse: företaget släppte Nemotron 3.5 Lightning, en agentarbetare med 31,6 miljarder parametrar som lanserades den 11 augusti – samma dag som Nemotron 4-rapporten blev känd – tillsammans med NeMo Switchyard, NVIDIAs egen routingprogramvara med öppen källkod. Med andra ord utvecklar NVIDIA aktivt modellutbudet medan flaggskeppet fortfarande är på ritbordet.
Vad du ska titta på, i ungefärlig prioritetsordning:
• Aktiva parametrar — totalen är huvudtalet; antalet aktiva avgör kostnad och hastighet. En MoE med totalt ~1T och ~100B aktiva förändrar hela bilden jämfört med en med ~50B.
• Oberoende poäng — ingen tredjepartsutvärdering finns för en modell som inte har tränats. Håll utkik efter Artificial Analysis Intelligence Index när en hostad kontrollpunkt dyker upp.
Licensvillkor — Nemotron 3 Ultra levereras under OpenMDW-1.1, tillåtande men inte MIT eller Apache 2.0. Huruvida Nemotron 4 följer efter eller skärper villkoren är ännu inte bestämt, och för ett företag som bygger på vikterna avgör det allt.
• Vilka storlekar levereras först — Nemotron 3 kom som en familj (Nano, Super, Ultra). Förvänta dig en rad Nemotron 4-storlekar, och förvänta dig att de små kommer före flaggskeppet.
• Mistral-basen — huruvida koalitionens basmodell faktiskt blir familjens grund är den strukturella frågan bakom allt prat om parametrar.
• Pris — ingenting hostas, så ingenting prissätts. När en värdpartner listar Nemotron 4, är pass-through-priset det du faktiskt betalar.
Vad det innebär för ditt inferenslager
Du kan inte anropa Nemotron 4 idag — ingen kan det — så den praktiska frågan är hur stor del av din stack som bör ändras för att anpassa sig till en modell vars specifikationer fortfarande rör sig. Svaret är detsamma som för vilken outgiven frontier-modell som helst: håll inferenslagret modellagnostiskt. Om du dirigerar genom ett enda API som ligger framför 200+ modeller, är en ny Nemotron-familj en konfigurationsändring, inte en omskrivning. OrcaRouter förmedlar leverantörens listpris med 0 % påslag, så vad en värd än tar för Nemotron 4 är exakt vad du betalar, och en prissänkning från leverantören slår igenom samma dag som den görs. Automatisk failover är verktyget för en obeprövad första release: rikta tidig trafik mot den nya modellen, fall tillbaka till ett stabilt alternativ när den stannar eller ger fel, och flytta upp den till produktion först efter att den har förtjänat dina arbetsbelastningar. Inget av detta kräver att du satsar din produktionsväg på en läcka — vilket är precis rätt hållning när specifikationerna är så preliminära.
FAQ
När kommer Nemotron 4 att släppas?
Inget datum har satts. Anställda har berättat för The Information att den slutliga träningskörningen inte har startat och kommer att ta månader; två sade att senhösten 2026 är möjlig, och andra väntar sig senare. Betrakta "senhösten" som en hoppfull uppskattning inifrån projektet, inte en färdplan.
Kommer Nemotron 4 att vara öppen källkod?
{{1}}NVIDIAs uttalade avsikt är öppna vikter, och Nemotron-koalitionens första projekt — basmodellen som utvecklats tillsammans med Mistral — har utlovats att släppas som öppen källkod.{{/1}} {{2}}Men "öppna vikter" är inte "öppen källkod": Nemotron 3 Ultra levereras under OpenMDW-1.1-licensen, som är mer tillåtande än NVIDIAs äldre villkor men fortfarande inte MIT eller Apache 2.0.{{/2}} {{3}}Nemotron 4:s specifika licens har inte tillkännagivits.{{/3}}
Är "minst 1 biljon parametrar" en verklig specifikation?
Det är ett mål från anställda som rapporterats av The Information, inte en bekräftad specifikation, och samma rapport säger att antalet kan ändras. Även vid totalt 1 biljon skulle det hamna efter Kimi K3 (2,8T) och Qwen3.8-Max (2,4T) i rå storlek; antalet aktiva parametrar – som inte har läckt ut – är den siffra som kommer att avgöra kostnad och hastighet.
Bör jag vänta på Nemotron 4 innan jag väljer en modell?
Nej. Det är månader bort i bästa fall och oprövat. Välj den bästa tillgängliga modellen för uppgiften nu och håll routinglagret flexibelt; när Nemotron 4 faktiskt släpps, utvärdera den på samma sätt som du skulle utvärdera vilken ny modell som helst — aktiva parametrar, oberoende riktmärken, licens och pris — snarare än på rubrikens totalsiffra.
Slutsats
Familjen är verklig; siffrorna är uppskattningar. NVIDIA har bekräftat att de bygger Nemotron 4, och koalitionsstrukturen runt den är den mest intressanta delen av historien — men varje rubriksiffra i läckan, från golvet på 1 biljon parametrar till tidplanen för senhösten till budgeten på 28 miljarder dollar, kommer från namnlösa anställda och kan förändras. Frontlinjen för öppna vikter har redan passerat biljon-parametermärket, ledd av kinesiska labb, och NVIDIAs svar är en konsortiebasmodell plus ett löfte. För en läsare som väljer modeller idag betyder det en sak: planera inte utifrån läckan. Håll inferenslagret flexibelt, utvärdera det som levereras utifrån dess verkliga siffror, och låt routing göra det routing är till för — att prova det nya utan att satsa produktionsvägen på det.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
