Karta tytułowa (hero) do artykułu o wycieku Nemotron 4: nagłówek 'Nemotron 4', podtytuł 'NVIDIA's 1-trillion-parameter open-weights family — reported, not released' oraz dwa chipy z etykietami 'reported' i 'unreleased'. Logo OrcaRouter w prawym dolnym rogu.
Guides & Insights

Wyciek Nemotron 4: odpowiedź NVIDII dla czołówki — bilion parametrów i otwarte wagi

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Nemotron 4 wciąż nie został oficjalnie wydany, ale w tym tygodniu przestał być plotką sprowadzającą się jedynie do liczby parametrów. Dziennik The Wall Street Journal poinformował 22 sierpnia 2026 r., powołując się na osoby zaznajomione ze sprawą, że NVIDIA wydaje około 6 miliardów dolarów, aby uczynić z Nemotron 4 jeden z najpotężniejszych na świecie modeli AI o otwartych wagach — a plan obejmuje niewyłączną licencję na technologię trenowania modeli od startupu AI Poolside oraz przeniesienie ponad 100 inżynierów Poolside do projektu Nemotron 4. To dochodzi do wcześniejszego przecieku z The Information z 11 sierpnia, zgodnie z którym flagowy model rodziny będzie miał „co najmniej 1 bilion parametrów”. Łącznie te dwa doniesienia opisują jak dotąd najpoważniejszą próbę NVIDIA, by osiągnąć szczyt w dziedzinie modeli o otwartych wagach.

Nic tu jeszcze nie trafiło na rynek i nic nie zostało potwierdzone. NVIDIA przyznała, że buduje rodzinę modeli Nemotron 4, ale nie potwierdziła docelowej liczby parametrów, harmonogramu, planu dotyczącego licencji i zatrudnienia, który WSJ przypisuje osobom zaznajomionym ze sprawą, ani szczegółów sojuszu, które The Information przypisuje anonimowym pracownikom. Każdą liczbę w tym tekście traktuj jako „reported”, a nie „specified”. Celem tekstu o wycieku jest oddzielenie małego, potwierdzonego rdzenia od większego, opartego na doniesieniach halo — i wskazanie, które elementy będą miały znaczenie, gdy pojawi się prawdziwa specyfikacja.

Jednolinijkowy przeciek, rozpakowany

Po pierwsze, nazwa, bo może cię zmylić w wynikach wyszukiwania: NVIDIA wypuściła już model o nazwie Nemotron-4-340B w czerwcu 2024 roku. Nowy Nemotron 4 to inna, większa rodzina — następca linii Nemotron 3 (Nano, Super, Ultra), która pojawiła się w tym roku — ponownie używająca nazwy „Nemotron 4” dla generacji po niej. Ten artykuł dotyczy nowego modelu.

Co faktycznie podał The Information: NVIDIA opracowuje Nemotron 4 jako rodzinę modeli open-source, celującą w szczyt rankingu modeli open-weight, a flagowy model ma mieć „co najmniej 1 bilion parametrów”. NVIDIA nie ustaliła daty premiery, nie rozpoczęła jeszcze finalnego treningu — procesu, który według pracowników ma potrwać miesiące — a ustaliła jedynie dane do wstępnego treningu i architekturę; specyfikacja wciąż się zmienia. Dwóch pracowników powiedziało, że rodzina może być gotowa już późną jesienią; inni spodziewają się później.

{{1}}Ten sam raport zawiera osobny budżet: około 28 miliardów dolarów na wieloletnie umowy na usługi w chmurze obowiązujące do początku 2031 roku, czyli mniej więcej trzykrotnie więcej, niż NVIDIA ujawniła rok wcześniej, przy czym około 7 miliardów dolarów przypada na bieżący rok obrotowy.{{/1}} {{2}}Ta kwota obejmuje zobowiązania dotyczące mocy obliczeniowych, a nie nową umowę, o której poinformowano w tym tygodniu.{{/2}} {{3}}W raporcie zauważono również, że wstępna publikacja badawcza poprzedniego flagowego modelu wymieniała 570 autorów, a Nemotron 4 angażuje ich więcej — jeden z byłych pracowników powiedział The Information, że „wszyscy chcą w tym uczestniczyć".{{/3}} Wszystko to nie zostało ujawnione przez NVIDIA.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

W tym tygodniu: transakcja z Poolside o wartości 6 miliardów dolarów, która ma urzeczywistnić Nemotron 4.

Według doniesień "The Wall Street Journal" z tego tygodnia, plan NVIDII dotyczący Nemotron 4 to nie tylko projekt badawczy — to finansowane przedsięwzięcie. Jak podaje WSJ, powołując się na osoby zaznajomione ze sprawą, NVIDIA zapłaci około 6 miliardów dolarów za niewyłączną licencję na "Model Factory" firmy Poolside — system treningu i ewaluacji stojący za publikowanymi na otwartych licencjach modelami kodowania Laguna firmy Poolside — i złoży oferty pracy ponad 100 pracownikom Poolside — według doniesień 109 osobom, w większości inżynierom — aby pracowali nad projektem Nemotron. Bloomberg niezależnie podał, że NVIDIA zainwestuje dodatkowy 1 miliard dolarów w Poolside przy wycenie pre-money wynoszącej 12 miliardów dolarów, co daje łączne deklarowane zaangażowanie NVIDII na poziomie około 7 miliardów dolarów.

To nie jest przejęcie. Licencja jest niewyłączna, założyciele Poolside pozostają, a Poolside nadal działa jako niezależna firma; zgodnie z doniesieniami Poolside planuje rozdysponować wypłatę z tytułu licencji w wysokości 6 miliardów dolarów swoim inwestorom. Historia po raz pierwszy pojawiła się dzięki Newcomer 20 sierpnia i została potwierdzona przez Bloomberg 21 sierpnia oraz przez WSJ 22 sierpnia — wszystko to wciąż "doniesienia", nic nie zostało potwierdzone przez NVIDIA ani Poolside.

Dlaczego transakcja jest ważniejsza niż kwota z nagłówka: daje projektowi Nemotron 4 zespół, który faktycznie wypuścił modele o otwartych wagach. Rodzina Laguna od Poolside to sprawdzona linia modeli do kodowania o otwartych wagach, a podawany cel — wydanie Nemotron w ciągu mniej więcej roku, które mogłoby konkurować z najmocniejszymi modelami granicznymi — to pierwszy konkretny termin, jaki ktokolwiek przypisał temu projektowi. Raporty przedstawiają ten ruch jako odpowiedź NVIDIA na chińskich liderów otwartych wag, zwłaszcza Deep​Seek i Kimi K3 od Moonshot AI, a w debacie otwarte kontra zamknięte — jako zabezpieczenie przed zamkniętymi laboratoriami z USA.

Struktura też ma znaczenie. Licencja niewyłączna oznacza, że Poolside zachowuje swoją własność intelektualną i może licencjonować tę samą technologię innym podmiotom — NVIDIA kupuje możliwości i talent, a nie własność. Analitycy odczytują to jako wysiłek NVIDIA zmierzający do utrzymania skomodyfikowanej warstwy modeli: jeśli modele o otwartych wagach pozostaną mocne i tanie, popyt będzie nadal płynął do warstwy kontrolowanej przez NVIDIA — procesorów graficznych. Jak ujął to wcześniej dyrektor generalny LMArena, Anastasios Angelopoulos: „Niezależnie od tego, która firma stworzy świetny model open-source, NVIDIA wygrywa”.

Dlaczego numer rozmiaru jest najmniej interesującą częścią.

Oczywista historia jest taka, że „NVIDIA zmierza w kierunku biliona parametrów”. Mniej oczywista jest ta, że to czołówka open-weight dotarła tam pierwsza. Kimi K3 udostępnił swoje wagi 27 lipca, mając łącznie 2,8 biliona parametrów — około 104 miliardów aktywnych na token w konfiguracji mixture-of-experts — a Qwen3.8 Max firmy Alibaba, zaprezentowany 19 lipca, to model o 2,4 biliona parametrów łącznie i około 95 miliardach aktywnych. W porównaniu z nimi flagowy Nemotron 4 z „co najmniej bilionem” parametrów byłby dwukrotnie większy od Nemotron 3 Ultra, ale wciąż ustępowałby liderom pod względem rozmiaru, a obaj ci liderzy są chińscy.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

To sprawia, że całkowita liczba parametrów jest całkowicie błędną perspektywą. W modelu mixture-of-experts o koszcie i szybkości decyduje liczba aktywnych parametrów na token, a nie deklarowana suma. Nemotron 4 z bilionem parametrów łącznie mógłby mieć około 100 miliardów aktywnych — czyli dokładnie w lidze Kimi K3 i Qwen3.8 Max — albo o połowę mniej. Liczba, która wycieknie następna, to ta, która się liczy — a ona jeszcze nie wyciekła.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Warto również odnotować drugi kierunek: DeepSeek V4-Flash, wydany 31 lipca na licencji MIT, poszedł w przeciwną stronę — łącznie 284 miliardy, stawiając na cenę, a nie na skalę, przy szacowanym koszcie około 0,14 dolara za milion tokenów wejściowych. Rynek nagradza obie skrajności. Skala nie jest strategią; jest jedną ze strategii.

Stanowisko NVIDIA wyjaśnia ten ruch. The Information podaje, że Nemotron 3 Ultra zajmuje drugie miejsce wśród amerykańskich modeli o otwartych wagach — za Inkling od Thinking Machines — i poza najwyższą półką globalnego rankingu modeli otwartych. Nemotron 4 to próba powrotu do dyskusji o modelach frontier, a samo kierownictwo NVIDIA przedstawia to jako grę o suwerenność: wiceprezes ds. generatywnej AI Kari Briski powiedziała, że NVIDIA inwestuje w Nemotron, ponieważ „każda firma i każdy kraj potrzebuje dostępnych modeli frontier o otwartym kodzie źródłowym, aby wzmocnić bezpieczeństwo i ochronę, przyspieszyć innowacje i zapewnić fundament, na którym można polegać z pokolenia na pokolenie”. Jensen Huang przedstawia tę samą argumentację na X, twierdząc, że otwarte modele „wzmacniają bezpieczeństwo i cyberbezpieczeństwo, przyspieszają innowacje i dyfuzję oraz umożliwiają suwerenność”. To napięcie strukturalne jest realne — NVIDIA rzekomo posiada w OpenAI około 30 miliardów dolarów — ale zakład jest taki, że otwarte modele powiększają tort GPU, a nie go zmniejszają.

Koalicja Nemotron to frakcja, którą warto obserwować.

Nemotron 4 nie jest projektem solowym, a transakcja z Poolside nie jest jedyną strukturą wokół niego. Na GTC 16 marca 2026 roku NVIDIA ogłosiła koalicję Nemotron — ośmiu członków założycieli: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam i Thinking Machines Lab — zorganizowanych w celu połączenia badań, danych i mocy obliczeniowej na rzecz „frontier open models". Jej pierwszym projektem jest model bazowy opracowany wspólnie przez Mistral AI i NVIDIA, trenowany na NVIDIA DGX Cloud, który — według koalicji — zostanie udostępniony jako open source i będzie stanowić podstawę rodziny Nemotron 4.

The Information dodaje szczegóły dotyczące prac: Reflection, Cursor, Thinking Machines i Mistral są potwierdzonymi kontrybutorami; Prime Intellect dostarczyło 300 000 środowisk symulacyjnych do trenowania; Cognition prowadziło rozmowy na temat dostarczenia danych treningowych dla kodu. Dyrektor generalny Prime Intellect, Vincent Weisser, przedstawił sojusz jako działanie zbiorowe przeciwko temu, co nazwał monopolem pojedynczego „boskiego” modelu. Co to oznacza operacyjnie: Nemotron 4 może zostać udostępniony jako podstawa konsorcjum, którą każdy członek doszkala dla własnego produktu, zamiast być punktem kontrolnym jednego dostawcy. To sprawiałoby, że kategoria „model NVIDIA z otwartymi wagami” byłaby błędna — to baza jest interesującym artefaktem.

Umowa z Poolside wpisuje się w to wszystko. Koalicja łączy badania i moce obliczeniowe; licencja z zatrudnieniem personelu zapewnia działającą fabrykę modeli i zespół, który ma już na koncie wydanie otwartych wag. Jeśli doniesienia się potwierdzą, NVIDIA składa Nemotron 4 z trzech źródeł naraz — własnej operacji treningowej, bazy konsorcjum i systemu produkcyjnego Poolside — co stanowi inną formę niż wydanie pojedynczego checkpointu.

Potwierdzone, zgłoszone, nieznane

• Potwierdzone — NVIDIA pracuje nad rodziną Nemotron 4 (oświadczenie firmy). Koalicja Nemotron istnieje i buduje otwarty model bazowy z Mistral AI (NVIDIA, marzec 2026).

• Niepotwierdzone doniesienia — flagowy cel „co najmniej 1 bilion” i harmonogram na późną jesień, a także zobowiązanie chmurowe o wartości ~28 mld dolarów, z czego ~7 mld w tym roku obrotowym (The Information); raportowany przez WSJ budżet na budowę wynoszący ~6 mld dolarów, niewyłączna licencja na „Model Factory” firmy Poolside i ponad 100 inżynierów Poolside dołączających do projektu Nemotron; raportowana przez Bloomberga inwestycja NVIDIA o wartości 1 mld dolarów w Poolside przy wycenie przedinwestycyjnej ~12 mld dolarów; wkład poszczególnych członków koalicji.

• Nieznane — liczba aktywnych parametrów, długość kontekstu, mieszanka modalności, warunki licencji, cena, które checkpointy zostaną udostępnione jako pierwsze, czy baza współtworzona z Mistral faktycznie stanie się fundamentem rodziny oraz czy umowa z Poolside jest skonstruowana tak, jak podają doniesienia (żadna z firm nie skomentowała sprawy).

Oś czasu i co oglądać

Nadal nie ma daty premiery. Ostateczna sesja treningowa jeszcze się nie rozpoczęła; pracownicy opisują ją jako wielomiesięczną, a szacunki wahają się od „późnej jesieni” (dwa źródła) do późniejszego terminu. Doniesienia Poolside dodają pierwsze konkretne ramy czasowe, jakie ktokolwiek przypisał do tego projektu: zgodnie z nimi celem jest premiera w ciągu mniej więcej roku, która będzie mogła konkurować z najsilniejszymi modelami granicznymi. NVIDIA w międzyczasie utrzymała rodzinę w ruchu: wypuściła Nemotron 3.5 Lightning, agenta wykonawczego o 31,6 miliarda parametrów, wydanego 11 sierpnia — tego samego dnia, w którym ukazał się raport o Nemotron 4 — wraz z NeMo Switchyard, własnym oprogramowaniem routingu NVIDIA o otwartym kodzie źródłowym.

Co oglądać, w przybliżonej kolejności ważności:

• Aktywne parametry — łączna liczba to główny wskaźnik; liczba aktywnych decyduje o koszcie i szybkości. MoE o ~1T parametrów łącznie przy ~100B aktywnych zmienia cały obraz w porównaniu z ~50B.

• Integracja Poolside — czy licencja Model Factory i jej nowy zespół faktycznie przekształcą plan treningowy i skrócą raportowany harmonogram, czy też to pozyskiwanie talentów pozostawia plan w mocy.

• Niezależne wyniki — nie istnieje ocena zewnętrzna dla modelu, który nie został wytrenowany. Obserwuj Artificial Analysis Intelligence Index, gdy pojawi się hostowany punkt kontrolny.

• Warunki licencji — Nemotron 3 Ultra jest dystrybuowany na licencji OpenMDW-1.1, permisywnej, ale nie MIT ani Apache 2.0. To, czy Nemotron 4 pójdzie jej śladem, czy zaostrzy warunki, pozostaje nierozstrzygnięte, a dla firmy budującej na tych wagach decyduje to o wszystkim.

• Które rozmiary pojawią się najpierw — Nemotron 3 pojawił się jako rodzina (Nano, Super, Ultra). Spodziewaj się zakresu rozmiarów Nemotron 4 i oczekuj, że mniejsze pojawią się przed flagowcem.

• Baza Mistral — czy model bazowy koalicji faktycznie stanie się fundamentem rodziny, to strukturalne pytanie stojące za całą rozmową o parametrach.

• Cena — nic nie jest hostowane, więc nie ma czego wyceniać. Gdy partner hostingowy udostępni Nemotron 4, zapłacisz dokładnie cenę pass-through (bez narzutu).

Co to oznacza dla Twojej warstwy wnioskowania.

Nie możesz dziś wywołać Nemotron 4 — nikt nie może — a raporty Poolside, jakkolwiek dramatyczne, tego nie zmieniają. Praktyczne pytanie wciąż brzmi: w jakim stopniu Twój stos technologiczny powinien się zmienić, aby dostosować się do modelu, którego specyfikacja wciąż się zmienia. Odpowiedź jest taka sama jak w przypadku każdego niewydanego modelu z najwyższej półki: utrzymuj warstwę inferencji niezależną od modelu. Jeśli korzystasz z pojedynczego API, które udostępnia ponad 200 modeli, nowa rodzina Nemotron to zmiana konfiguracji, a nie przepisywanie kodu. OrcaRouter przekazuje cenę katalogową dostawcy z zerową marżą, więc cokolwiek host ostatecznie zażąda za Nemotron 4, płacisz dokładnie tyle, a obniżka ceny od dostawcy obowiązuje tego samego dnia, w którym została wprowadzona. Automatyczne przełączanie awaryjne to narzędzie na nieprzetestowaną pierwszą wersję: skieruj wczesny ruch na nowy model, wracaj do stabilnej alternatywy, gdy ten zawiesi się lub zwróci błąd, a do produkcji wprowadź go dopiero, gdy udowodni, że radzi sobie z Twoimi obciążeniami. Żadne z tych działań nie wymaga stawiania ścieżki produkcyjnej na przecieku — co jest dokładnie właściwą postawą, gdy specyfikacja jest tak prowizoryczna.

Najczęściej zadawane pytania

Kiedy zostanie wydany Nemotron 4?

Nie ustalono żadnej daty. Pracownicy powiedzieli The Information, że końcowy etap treningu nie został jeszcze rozpoczęty i potrwa miesiące; dwie osoby stwierdziły, że późna jesień 2026 jest możliwa, a inni spodziewają się później. Doniesienia z tego tygodnia dodają cel wydania dorównującego czołówce w ciągu około roku, ale nadal nie ma konkretnej daty. Obie informacje należy traktować jako szacunki wewnątrz projektu, a nie plan działania.

Czy Nemotron 4 będzie open-source?

Zamiarem NVIDIA są otwarte wagi, a pierwszy projekt koalicji Nemotron — bazowy model opracowany wspólnie z Mistral — ma zostać udostępniony jako open source. Ale „otwarte wagi” to nie „open source”: Nemotron 3 Ultra jest wydawany na licencji OpenMDW-1.1, która jest bardziej liberalna niż wcześniejsze warunki NVIDIA, ale wciąż nie jest to MIT ani Apache 2.0. Konkretna licencja Nemotron 4 nie została jeszcze ogłoszona.

Czy zgłaszana umowa Poolside o wartości 6 miliardów dolarów została potwierdzona?

Nie. WSJ podał 22 sierpnia, powołując się na osoby zaznajomione ze sprawą, że licencja opiewa na około 6 miliardów dolarów, a ponad 100 inżynierów Poolside dołącza do projektu Nemotron; Bloomberg podał o dodatkowej inwestycji 1 miliarda dolarów. Newcomer poinformował o tym jako pierwszy 20 sierpnia. Ani NVIDIA, ani Poolside nie potwierdziły żadnej z tych informacji. Licencja ma być niewyłączna, a Poolside pozostałby niezależną firmą.

Czy „co najmniej 1 bilion parametrów” to realna specyfikacja?

To cel oparty na informacjach od pracowników, podany przez The Information, a nie potwierdzona specyfikacja; ten sam raport mówi, że liczba może się zmienić. Nawet przy łącznej wartości 1 biliona ustępowałby surowym rozmiarem modelom Kimi K3 (2,8T) i Qwen3.8 Max (2,4T); liczba aktywnych parametrów — która nie wyciekła — to wartość decydująca o koszcie i szybkości.

Czy powinienem poczekać na Nemotron 4, zanim wybiorę model?

Nie. To kwestia wielu miesięcy w najlepszym razie i jest niesprawdzone. Wybierz teraz najlepszy dostępny model do tego zadania i utrzymuj elastyczną warstwę routingu; gdy Nemotron 4 faktycznie się ukaże, oceń go tak samo, jak każdy nowy model — aktywne parametry, niezależne benchmarki, licencję i cenę — a nie na podstawie ogólnej liczby parametrów czy rozmiaru raportowanego budżetu.

Konkluzja

{{1}}Rodzina jest prawdziwa; liczby są szacunkowe.{{/1}} {{2}}W tym tygodniu historia zmieniła kształt: Nemotron 4 to już nie tylko wyciek parametrów, to finansowany projekt.{{/2}} {{3}}Według doniesień NVIDIA wydaje około 6 miliardów dolarów, nabywa licencję na Model Factory od Poolside, zatrudnia ponad 100 ich inżynierów i inwestuje kolejny miliard dolarów w spółkę — wszystko po to, aby stworzyć flagowy model open-weight, który może stanąć obok Deep​Seek i Kimi K3.{{/3}} {{4}}Każda z tych liczb pochodzi z doniesień prasowych, żadna nie została potwierdzona i nic nie zostało wydane.{{/4}} {{5}}Czołówka open-weight przekroczyła już granicę biliona parametrów, a odpowiedzią NVIDIA jest konsorcjalny model bazowy, licencjonowana fabryka modeli i obietnica.{{/5}} {{6}}Dla czytelnika, który dziś wybiera modele, to wciąż oznacza jedno: nie opieraj planów na wycieku.{{/6}} {{7}}Utrzymuj elastyczną warstwę inferencji, oceniaj wszystko, co trafia do wydania, na podstawie rzeczywistych liczb i pozwól routingowi robić to, do czego służy — testować nowość bez stawiania na nią ścieżki produkcyjnej.{{/7}}

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie