
Nemotron 4 유출: NVIDIA의 1조 파라미터 오픈 웨이트, 프런티어에 대한 답
- metaNEWMeta: Muse Spark 1.22026-08-0557지능72코딩
- qwenNEWQwen: Qwen3.8 Max2026-08-0358지능72코딩
- deepseekNEWDeepSeek: DeepSeek V4 Flash 07312026-07-3152지능69코딩
- minimaxNEWMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당 · 2278 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2152지능69코딩
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137지능49코딩
- metaMeta: Muse Spark 1.12026-07-1653지능71코딩
- kimiMoonshotAI: Kimi K32026-07-1560지능76코딩
- openaiOpenAI: GPT-5.6 Luna2026-07-0952지능71코딩
- openaiOpenAI: GPT-5.6 Terra2026-07-0957지능77코딩
- openaiOpenAI: GPT-5.6 Sol2026-07-0961지능77코딩
- grokxAI: Grok 4.52026-07-0856지능72코딩
- tencentTencent: Hy32026-07-0642지능59코딩
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232지능42코딩
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226지능39코딩
- anthropicAnthropic: Claude Sonnet 52026-06-3055지능72코딩
- klingKling: Kling 3.0 Turbo2026-06-1757지능52코딩57수학
1조 개의 파라미터. 이는 NVIDIA의 차기 오픈 가중치(open-weights) 제품군의 플래그십인 가장 큰 Nemotron 4 모델의 알려진 하한선이다. 그리고 그 숫자는 이미 출시된 모델과 나란히 놓기 전까지만 크게 들린다. 지난 한 달 동안 Moonshot AI는 총 2.8조 개의 파라미터를 가진 Kimi K3를 출시했고, Alibaba는 2.4조 개의 Qwen3.8-Max를 공개했다. NVIDIA의 현재 플래그십인 Nemotron 3 Ultra는 5,500억 개에 머물러 있다. The Information은 2026년 8월 11일, 이 프로젝트에 참여 중인 여러 직원들을 인용해 Nemotron 4가 NVIDIA의 답이라고 보도했다. 즉, 가장 큰 모델이 약 1조 개의 파라미터에서 시작할 것으로 예상되는 오픈 가중치 제품군으로, Nemotron 3 Ultra의 약 2배에 해당한다.
아직 출시된 것은 없습니다. NVIDIA는 Nemotron 4 제품군을 개발 중임을 인정했지만, 파라미터 규모, 예산, 일정, 또는 얼라이언스 세부 사항은 확정하지 않았습니다. 이는 The Information이 익명의 직원들을 인용해 보도한 내용입니다. 이 글의 모든 수치는 "확정된 수치"가 아닌 "보도된 수치"로 간주하세요. 유출 기사 작성의 요점은 작게 확인된 핵심 사실과 더 큰 규모의 보도된 추정 범위를 구분하고, 실제 사양 시트가 공개되었을 때 어떤 부분이 중요한지 알려주는 데 있습니다.
한 줄짜리 유출, 파헤치기
먼저, 이름부터 말씀드리겠습니다. 검색 결과에서 혼동을 일으킬 수 있기 때문입니다. NVIDIA는 이미 2024년 6월에 Nemotron-4-340B라는 모델을 출시했습니다. 새로운 Nemotron 4는 — 올해 출시된 Nemotron 3 라인(Nano, Super, Ultra)의 후속작으로, 그 다음 세대를 위해 "Nemotron 4"라는 이름을 재사용한 — 더 크고 다른 제품군입니다. 이 기사는 새로운 모델에 관한 것입니다.
The Information이 실제로 보도한 내용: NVIDIA는 오픈-웨이트 리더보드 최상위를 목표로 하는 오픈소스 모델 제품군으로 Nemotron 4를 개발 중이며, 플래그십 모델은 "최소 1조 개의 파라미터"를 가질 것으로 예상된다. NVIDIA는 출시일을 정하지 않았고, 직원들이 수개월이 걸릴 것으로 예상하는 최종 훈련 실행도 시작하지 않았으며, 사전 훈련 데이터와 아키텍처만 확정했다. 사양은 여전히 변경 중이다. 두 직원은 이 제품군이 빠르면 늦가을에 준비될 수 있다고 말했으며, 다른 직원들은 더 늦을 것으로 예상한다.
같은 보고서에는 예산이 포함되어 있습니다: 약 280억 달러 규모의 다년간 클라우드 서비스 계약이 2031년 초까지 이어지며, 이는 엔비디아가 1년 전 공개한 금액의 약 3배에 해당하고, 약 70억 달러는 현재 회계 연도에 반영됩니다. 또한 보고서는 이전 주력 모델의 연구 논문에 570명의 저자가 있었고 Nemotron 4에는 더 많은 저자가 참여한다고 언급합니다. 한 전 직원은 The Information에 "모두가 참여하고 싶어 한다"고 말했습니다. 이 모든 것은 엔비디아가 공개하지 않은 것입니다.

왜 사이즈 숫자가 가장 흥미롭지 않은 부분인가
뻔한 이야기는 “NVIDIA가 수조 파라미터로 간다”는 것이다. 덜 뻔한 이야기는 오픈 웨이트 최전선이 먼저 그곳에 도달했다는 점이다. Kimi K3는 7월 27일에 가중치를 공개했는데, 총 파라미터는 2.8조이며, 혼합 전문가(MoE) 구성에서 토큰당 약 1,040억 개가 활성화된다. 알리바바의 Qwen3.8-Max는 7월 19일에 공개되었으며, 총 파라미터 2.4조 수준으로 활성 파라미터는 약 950억 개다. 이에 비해 Nemotron 4 플래그십이 “최소 1조”라면 Nemotron 3 Ultra의 두 배에 달하지만, 여전히 규모 선두주자들을 따라잡지 못한다. 그리고 그 선두주자 둘 다 중국 기업이다.

그렇다면 총 파라미터 수는 전적으로 잘못된 기준이 된다. 혼합 전문가(mixture-of-experts) 모델에서 비용과 속도를 결정하는 것은 내세우는 총 파라미터 수가 아니라 토큰당 활성 파라미터 수다. 총 1조 개의 파라미터를 가진 Nemotron 4는 활성 파라미터가 약 1,000억 개 수준 — 정확히 Kimi K3와 Qwen3.8-Max가 속한 등급 — 또는 그 절반 수준이 될 수 있다. 다음에 유출되는 숫자가 중요한 숫자인데, 그 숫자는 아직 유출되지 않았다.

반대 방향도 주목할 만하다. 7월 31일 MIT 라이선스로 출시된 DeepSeek V4-Flash는 정반대의 길을 택했다 — 총 2840억, 규모보다는 가격에 초점을 맞추고, 백만 입력 토큰당 약 0.14달러의 비용으로 추정된다. 시장은 양극단 모두에 보상을 주고 있다. 규모는 전략이 아니다. 하나의 전략일 뿐이다.
엔비디아의 입지가 이번 행보를 설명한다. {{1}}The Information{{/1}}은 Nemotron 3 Ultra가 미국 오픈 웨이트 모델 중 Thinking Machines의 Inkling에 이어 2위를 차지했으며, 글로벌 오픈 리더보드의 상위권에는 들지 못했다고 보도한다. Nemotron 4는 프런티어 논의에 다시 합류하려는 시도이며, 엔비디아 경영진은 이를 주권(sovereignty) 전략으로 규정한다. 생성형 AI 부사장 카리 브리스키(Kari Briski)는 엔비디아가 Nemotron에 투자하는 이유에 대해 {{2}}"모든 기업과 모든 국가는 안전과 보안을 강화하고, 혁신을 가속화하며, 다음 세대까지 의지할 수 있는 기반을 제공하기 위해 접근 가능한 프런티어 오픈소스 모델이 필요하다"{{/2}}라고 말했다. 젠슨 황(Jensen Huang)도 X에서 같은 주장을 펼치며 오픈 모델이 {{3}}"안전과 사이버 보안을 강화하고, 혁신과 확산을 가속화하며, 주권을 가능하게 한다"{{/3}}고 말했다. 구조적 긴장은 실재한다. 엔비디아는 약 {{4}}300억 달러{{/4}} 상당의 오픈AI 지분을 보유한 것으로 알려졌기 때문이다. 그러나 엔비디아가 거는 승부수는 오픈 모델이 GPU 파이를 줄이는 대신 키운다는 것이다. LMArena CEO 아나스타시오스 안겔로풀로스(Anastasios Angelopoulos)는 이렇게 말했다: {{5}}"어느 회사가 훌륭한 오픈소스 모델을 만들든, 엔비디아가 승리한다."{{/5}}
The Nemotron Coalition은 주목해야 할 부분입니다.
Nemotron 4는 단독 프로젝트가 아니며, 대부분의 보도가 놓치는 세부 사항이 바로 이것이다. 2026년 3월 16일 GTC에서 NVIDIA는 Nemotron Coalition을 발표했다. 창립 멤버는 Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam, Thinking Machines Lab 등 8곳으로, '프론티어 오픈 모델'을 위해 연구, 데이터, 컴퓨팅 자원을 모으기 위해 결성됐다. 첫 번째 프로젝트는 Mistral AI와 NVIDIA가 공동 개발하고 NVIDIA DGX Cloud에서 학습된 베이스 모델로, 연합은 이 모델을 오픈소스로 공개할 예정이며 Nemotron 4 제품군의 기반이 될 것이라고 밝혔다.
The Information은 작업 세부 내용을 추가로 보도한다: Reflection, Cursor, Thinking Machines, Mistral은 확인된 기여자다. Prime Intellect는 학습용 시뮬레이션 환경 30만 개를 제공했고, Cognition은 코드 학습 데이터 공급을 논의한 바 있다. Prime Intellect의 CEO Vincent Weisser는 이 연합을 그가 "신과 같은" 단일 모델 독점에 맞서는 집단 행동으로 규정했다. 이것이 운영상 의미하는 바: Nemotron 4는 단일 공급업체의 체크포인트가 아니라 각 구성원이 자사 제품에 맞춰 사후 학습하는 컨소시엄 기반 모델로 출시될 수 있다. 그렇게 되면 "오픈 가중치 NVIDIA 모델"이라는 분류는 틀린 것이 된다 — 흥미로운 결과물은 베이스 모델이기 때문이다.
확인됨, 보고됨, 알 수 없음
• 확인됨 — NVIDIA는 Nemotron 4 제품군을 개발 중입니다(회사 성명). Nemotron Coalition이 존재하며 Mistral AI와 함께 개방형 기본 모델을 구축하고 있습니다(NVIDIA, 2026년 3월).
• 보고되었으나 확인되지 않은 — "최소 1조"라는 핵심 목표; 늦가을 일정; 약 280억 달러의 클라우드 약정(이번 회계연도 약 70억 달러 포함); 연합 구성원이 각각 무엇을 기여하는지.
• 알 수 없음 — 활성 파라미터 수, 컨텍스트 길이, 모달리티 구성, 라이선스 조건, 가격, 어떤 체크포인트가 먼저 출시되는지, 그리고 Mistral과 공동 개발한 베이스가 실제로 그 제품군의 기반이 되는지 여부.
타임라인과 시청할 것
출시일은 없다. 최종 학습 실행은 아직 시작되지 않았으며, 직원들은 수개월이 걸릴 것이라고 말한다. 예상 시기는 (두 소식통에 따르면) "늦가을"부터 그 이후까지로 다양하다. 그동안 NVIDIA는 제품군을 계속 발전시켜 왔다. Nemotron 4 보도가 나온 8월 11일에 출시된 316억 매개변수 에이전트 워커인 Nemotron 3.5 Lightning을 NVIDIA 자체 오픈소스 라우팅 소프트웨어인 NeMo Switchyard와 함께 출시한 것이다. 다시 말해, NVIDIA는 플래그십이 아직 설계 단계에 있는 동안에도 라인업을 적극적으로 개선하고 있는 것이다.
무엇을 볼지, 대략적인 중요도 순서로:
활성 파라미터 — 총량이 핵심 지표이며, 활성 개수가 비용과 속도를 결정한다. 활성 파라미터 ~100B에 총 ~1T 규모의 MoE는 활성 파라미터 ~50B인 MoE와 비교해 전체적인 그림이 완전히 달라진다.
• 독립적인 점수 — 훈련되지 않은 모델에 대한 제3자 평가는 존재하지 않습니다. 호스팅된 체크포인트가 나타나면 Artificial Analysis Intelligence Index를 주시하세요.
• 라이선스 조건 — Nemotron 3 Ultra는 OpenMDW-1.1로 제공되며, 이는 허용적이지만 MIT나 Apache 2.0은 아닙니다. Nemotron 4가 이를 따를지 강화할지는 아직 미정이며, 가중치를 기반으로 구축하는 회사에게는 이 조건이 모든 것을 결정합니다.
• 어떤 크기가 먼저 출시되나요 — Nemotron 3는 Nano, Super, Ultra로 구성된 패밀리로 출시되었습니다. Nemotron 4도 다양한 크기로 출시될 예정이며, 플래그십보다 작은 모델이 먼저 나올 것으로 기대하세요.
Mistral 베이스 — 연합의 베이스 모델이 실제로 패밀리의 기반이 되는지 여부가 모든 파라미터 논의 이면의 구조적 질문이다.
• 가격 — 호스팅되는 것이 없으므로 가격이 책정되지 않습니다. 호스팅 파트너가 Nemotron 4를 나열하면, 실제로 지불하게 될 금액은 통과 가격입니다.
추론 레이어에 있어서의 의미
오늘날 네모트론 4를 호출할 수 없습니다. 누구도 할 수 없죠. 따라서 실질적인 질문은 사양서가 아직 확정되지 않은 모델을 수용하기 위해 스택을 얼마나 바꿔야 하느냐입니다. 그 답은 아직 출시되지 않은 프런티어 모델의 경우와 동일합니다. 추론 계층을 모델에 구애받지 않게 유지하세요. 200개 이상의 모델을 앞에 두는 단일 API를 통해 라우팅한다면 새로운 네모트론 제품군은 재작성이 아니라 설정 변경에 불과합니다. OrcaRouter는 공급업체의 공식 가격을 마크업 0%로 그대로 전달하므로, 호스트가 최종적으로 네모트론 4에 부과하는 가격이 곧 여러분이 지불하는 가격이며, 공급업체가 가격을 인하하면 그날 바로 적용됩니다. 자동 장애 조치는 검증되지 않은 첫 출시에 적합한 도구입니다. 초기 트래픽을 새 모델로 보내고, 지연되거나 오류가 발생하면 안정적인 대안으로 폴백한 다음, 실제 워크로드에서 성과를 낸 후에만 프로덕션으로 승격하세요. 이 모든 과정에 유출 정보에 프로덕션 경로를 거는 일은 필요 없습니다. 사양서가 이렇게 잠정적인 상황에서야말로 바로 그런 태세가 적절합니다.
자주 묻는 질문
Nemotron 4는 언제 출시되나요?
아직 날짜가 정해지지 않았다. 직원들은 The Information에 최종 학습 실행이 아직 시작되지 않았으며 수개월이 걸릴 것이라고 말했다. 두 명은 2026년 늦가을이 가능하다고 말했고, 다른 이들은 더 늦을 것으로 예상한다. "늦가을"은 로드맵이 아닌 프로젝트 내부의 희망적인 추정치로 간주하라.
Nemotron 4는 오픈소스가 될까요?
NVIDIA가 표명한 의도는 오픈 웨이트(open weights)이며, Nemotron Coalition의 첫 번째 프로젝트인 Mistral 공동 개발 베이스 모델은 오픈소스로 공개하겠다고 약속되었습니다. 그러나 '오픈 웨이트'는 '오픈소스'가 아닙니다. Nemotron 3 Ultra는 NVIDIA의 기존 조건보다 더 허용적인 OpenMDW-1.1 라이선스로 제공되지만, 여전히 MIT나 Apache 2.0은 아닙니다. Nemotron 4의 구체적인 라이선스는 아직 발표되지 않았습니다.
"at least 1 trillion parameters"가 실제 사양인가요?
이는 The Information이 보도한 직원 소스 기반의 목표치로, 확정된 사양이 아니며 같은 보도에 따르면 수치는 변경될 수 있다. 총 1조(1T) 규모라 해도 원시 크기에서는 Kimi K3(2.8T)와 Qwen3.8-Max(2.4T)에 뒤처진다. 유출되지 않은 활성 파라미터 수가 비용과 속도를 결정할 핵심 수치다.
Nemotron 4가 나올 때까지 기다렸다가 모델을 선택해야 할까요?
아니요. 아무리 빨라도 몇 달은 남았고, 검증되지도 않았습니다. 지금은 사용 가능한 모델 중 작업에 가장 적합한 것을 선택하고 라우팅 계층은 유연하게 유지하세요. Nemotron 4가 실제로 출시되면 다른 새 모델과 동일한 기준 — 활성 파라미터, 독립 벤치마크, 라이선스, 가격 — 으로 평가하세요. 헤드라인에 내세운 총 파라미터 수로 판단하지 말고요.
결론
제품군은 실재하지만, 숫자는 추정치입니다. NVIDIA는 Nemotron 4를 개발 중임을 확인했으며, 그 주변의 컨소시엄 구조가 이 이야기에서 가장 흥미로운 부분입니다. 그러나 유출된 주요 수치들—1조 하한부터 늦가을 일정, 280억 달러 예산까지—은 모두 익명의 직원들로부터 나온 것이며 변경될 수 있습니다. 오픈 가중치 프런티어는 이미 중국 연구소들이 주도하며 1조 파라미터를 돌파했고, NVIDIA의 대응은 컨소시엄 기반 모델과 약속입니다. 오늘 모델을 선택하는 독자에게 이는 한 가지를 의미합니다: 유출된 정보를 기준으로 계획을 세우지 말라는 것. 추론 계층을 유연하게 유지하고, 실제 수치로 출시되는 것을 평가하며, 라우팅이 본래의 역할을 하게 하십시오—프로덕션 경로를 걸지 않고 새로운 것을 시도하는 것.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
