
Nemotron 4 泄露:NVIDIA 对前沿的 1 万亿参数开放权重回应
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 143 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
Nemotron 4 仍未正式发布,但本周它已不再仅仅是一个带着参数量的传闻。《华尔街日报》2026年8月22日援引知情人士消息报道,英伟达正投入约60亿美元,将 Nemotron 4 打造为全球最强大的开源权重 AI 模型之一——该计划包括获得 AI 初创公司 Poolside 模型训练技术的非独占许可,并将 Poolside 的100多名工程师调入 Nemotron 4 项目。在此之前,The Information 于8月11日曾爆料,该系列旗舰模型将拥有“至少1万亿参数”。两份报道结合起来,描绘了英伟达迄今冲击开源权重领域巅峰的最认真尝试。
这里没有任何东西已经出货,也没有任何内容得到确认。NVIDIA已承认正在构建Nemotron 4系列,但尚未确认参数目标、时间表、WSJ归因于知情人士的许可与招聘计划,以及The Information归因于未具名员工的合作细节。请将本文中的每个数字视为“据报道”,而非“已确认”。泄露报道的意义在于将少数已确认的核心信息与更大范围的报道光环区分开来——并在真正的规格表发布时告诉你哪些部分重要。
一行代码的泄露,深度解析
首先,先说名称,因为它在搜索结果中会让你困惑:NVIDIA 已于 2024 年 6 月发布了一款名为 Nemotron-4-340B 的模型。新的 Nemotron 4 是一个不同的、更大的系列——是今年发布的 Nemotron 3 系列(Nano、Super、Ultra)的继任者——沿用了“Nemotron 4”这个名称来指代其下一代。本文介绍的是这个新系列。
《The Information》实际报道的是:NVIDIA 正在开发 Nemotron 4,这是一个旨在冲击开放权重排行榜顶端的开源模型系列,旗舰模型预计将拥有“至少 1 万亿参数”。NVIDIA 尚未确定发布日期,也尚未开始最终的训练运行——员工预计这一过程需要数月时间——并且目前仅确定了预训练数据和架构;规格仍在变动中。两名员工表示,该系列最早可能在秋末准备就绪;其他人则预计会更晚。
这份报告还附带了一份独立的预算:约280亿美元的多年度云服务协议,持续到2031年初,约为NVIDIA一年前披露金额的三倍,其中约70亿美元将在本财年入账。这一数字涵盖的是算力承诺,而非本周报道的新交易。报告还指出,此前旗舰模型的研究论文列出了570位作者,而Nemotron 4涉及的作者更多——一位前员工告诉The Information,“每个人都想参与其中。”所有这些NVIDIA均未披露。

本周:一笔60亿美元的Poolside交易,让Nemotron 4成为现实。
《华尔街日报》本周报道,NVIDIA打造Nemotron 4的计划不仅仅是一个研究项目——而是一项有资金支持的建设。据《华尔街日报》援引知情人士消息,NVIDIA将支付约60亿美元,获得Poolside"Model Factory"的非独占许可——这是Poolside开源权重Laguna编程模型背后的训练与评估系统——并向Poolside超过100名员工发出工作邀请,据报为109人,其中大多数为工程师,以参与Nemotron项目。彭博社另行报道,NVIDIA将向Poolside追加投资10亿美元,据报投资前估值为120亿美元,使NVIDIA的累计承诺总额达到约70亿美元。
这不是收购。该许可为非排他性许可,Poolside 的创始人将继续留任,Poolside 仍作为独立公司运营;据相关报道,Poolside 计划将 60 亿美元的许可费分配给其投资者。此事最初由 Newcomer 于 8 月 20 日报道,彭博社于 8 月 21 日、WSJ 于 8 月 22 日予以证实——但这一切仍只是“报道”,NVIDIA 和 Poolside 均未确认。
这笔交易的意义远不止头条数字:它为 Nemotron 4 项目带来了一支真正发布过开放权重模型的团队。Poolside 的 Laguna 系列是经过验证的开放权重编码产品线,而报道中提到的目标——大约一年内推出一个能与最强前沿模型竞争的 Nemotron——是该项目首次被赋予的具体时间框架。相关报道将此举解读为英伟达对中国开放权重领跑者(尤其是 DeepSeek 和 Moonshot AI 的 Kimi K3)的回应,也是在开放与封闭之争中针对美国封闭实验室的一种对冲。
结构也很重要。非独占许可意味着Poolside保留其知识产权,并可以将同样的技术许可给他人——NVIDIA购买的是能力和人才,而非所有权。分析师将此解读为NVIDIA致力于将模型层商品化:如果开放权重模型保持强大且廉价,需求就会持续流向NVIDIA所控制的层级——GPU。正如LMArena首席执行官Anastasios Angelopoulos在此前报道中所言:“无论哪家公司打造出优秀的开源模型,NVIDIA都是赢家。”
为什么尺寸数字是最无趣的部分
显而易见的故事是“NVIDIA 正在迈向万亿参数”。不那么明显的是,开放权重的前沿阵营已经率先抵达。Kimi K3 于 7 月 27 日开放权重,总参数达 2.8 万亿——在混合专家(MoE)架构下,每个 token 激活约 1040 亿参数——而阿里巴巴于 7 月 19 日发布的 Qwen3.8 Max 则是总参数 2.4 万亿的模型,激活参数约 950 亿。相比之下,号称“至少 1 万亿”参数的 Nemotron 4 旗舰版虽然将是 Nemotron 3 Ultra 的两倍,但仍落后于规模领先者,而这两家领先者都是中国公司。

这使得总参数量这个视角变得完全错误。在混合专家模型中,决定成本与速度的是每个token的激活参数量,而不是标题上的总参数量。一个总参数量达1万亿的Nemotron 4,其激活参数量可能落在约1000亿——正好与Kimi K3和Qwen3.8 Max处于同一梯队——也可能只有其一半。接下来泄露的那个数字才是关键,而它尚未泄露。

另一个方向同样值得关注:DeepSeek V4-Flash 于7月31日以 MIT 许可证发布,走了相反的路线——总参数达2840亿,主打价格而非规模,据估计每百万输入 token 的成本约为0.14美元。市场对这两种极端路线都给予了回报。规模并非唯一的战略;它只是战略之一。
NVIDIA的立场解释了这一举动。据The Information报道,Nemotron 3 Ultra在美国开放权重模型中排名第二——仅次于Thinking Machines的Inkling——但未进入全球开放排行榜的第一梯队。Nemotron 4是NVIDIA试图重回前沿讨论的尝试,NVIDIA自己的高管将其定位为一种主权战略:生成式AI副总裁Kari Briski表示,NVIDIA投资Nemotron是因为“每个公司、每个国家都需要可获取的前沿开源模型,以加强安全和保障,加速创新,并为一代又一代人提供可靠的基础。”黄仁勋也一直在X平台上表达同样的观点,他认为开放模型“能加强安全和网络安全,加速创新和传播,并实现主权。”结构性紧张确实存在——据报道,NVIDIA持有OpenAI约300亿美元的股份——但NVIDIA的赌注在于,开放模型会扩大GPU市场的蛋糕,而不是缩小它。
Nemotron Coalition 是需要关注的部分。
Nemotron 4 并非一个单独的项目,Poolside 的交易也不是围绕它的唯一架构。2026 年 3 月 16 日的 GTC 上,NVIDIA 宣布了 Nemotron Coalition(Nemotron 联盟),创始成员共八家:Black Forest Labs、Cursor、LangChain、Mistral AI、Perplexity、Reflection AI、Sarvam 和 Thinking Machines Lab。该联盟旨在汇集研究、数据和算力,共同打造“开放前沿模型”。其首个项目是由 Mistral AI 与 NVIDIA 共同开发的基础模型,基于 NVIDIA DGX Cloud 训练。联盟表示,该模型将开源,并成为 Nemotron 4 系列的基础。
The Information 补充了具体工作细节:Reflection、Cursor、Thinking Machines 和 Mistral 确认为贡献方;Prime Intellect 提供了30万个模拟环境用于训练;Cognition 已讨论提供代码训练数据。Prime Intellect 的 CEO Vincent Weisser 将这一联盟定性为集体行动,以对抗他所说的单一“神级”模型垄断。这在操作层面意味着:Nemotron 4 可能会以联盟基础模型的形式发布,由每位成员针对自身产品进行后训练,而不是依赖某一家厂商的检查点。这样一来,“开放权重的NVIDIA模型”这个归类就错了——基础模型本身才是真正有价值的产物。
Poolside交易与这一切并列其中。联盟汇集了研究和算力;许可加雇佣则带来了一座运转中的模型工厂,以及一支发布过开源权重的团队。如果报道属实,NVIDIA正同时从三个来源组装Nemotron 4——其自身的训练业务、一个联盟基础,以及Poolside的生产系统——这与任何单一检查点发布的形态都截然不同。
已确认、已报告、未知
• 已确认 — NVIDIA 正在开发 Nemotron 4 系列(公司声明)。Nemotron Coalition 已经成立,并正在与 Mistral AI 合作构建开放基础模型(NVIDIA,2026年3月)。
• 据报但未证实——“至少1万亿”的旗舰目标与晚秋时间表,外加约280亿美元的云承诺(其中本财年约70亿美元)(The Information);WSJ报道的约60亿美元建设预算、Poolside非独家“Model Factory”许可,以及100多名Poolside工程师加入Nemotron项目;Bloomberg报道的NVIDIA以约120亿美元投前估值向Poolside投资10亿美元;联盟各成员分别贡献了什么。
• 未知 — 活跃参数数量、上下文长度、模态组合、许可条款、价格、哪些检查点最先发布、Mistral 共同开发的基础模型是否真正成为该系列的根基,以及 Poolside 的交易是否如报道所述那般构建(两家公司均未置评)。
时间线与观看指南
目前仍没有发布日期。最终的训练运行尚未开始;员工们称其将耗时数月,预计时间从“深秋”(两位消息人士)到更晚不一。Poolside 的报道首次给出了该项目相关的最具体时间框架:根据该报道,目标是大约一年内发布,并能与最强的前沿模型竞争。与此同时,NVIDIA 一直在推进该系列的发展:它发布了 Nemotron 3.5 Lightning,一个 316 亿参数的智能体工作模型,于 8 月 11 日发布——同一天 Nemotron 4 的报道爆出,另外还有 NVIDIA 自家的开源路由软件 NeMo Switchyard。
要看什么,大致按重要程度排序:
• 活跃参数 — 总参数量是卖点;活跃参数量决定成本和速度。总参约1T、活跃约100B的MoE,与活跃约50B的MoE相比,完全是另一番局面。
• Poolside 整合——无论是 Model Factory 许可证及其新团队真正重塑训练计划并压缩所报告的时间线,还是人才收购使该计划维持原状。
• 独立评分 — 未经训练的模型尚不存在第三方评估。当托管检查点出现时,请关注 Artificial Analysis Intelligence Index。
• 许可条款 — Nemotron 3 Ultra 采用 OpenMDW-1.1 许可,宽松但不同于 MIT 或 Apache 2.0。Nemotron 4 是沿用还是收紧许可尚未确定,而对一家基于这些权重构建产品的公司而言,这决定了一切。
哪些尺寸会先发货——Nemotron 3 是以系列形式推出的(Nano、Super、Ultra)。预计 Nemotron 4 也会有一系列尺寸,而且小尺寸版本会先于旗舰版发货。
• Mistral底座——联盟的基础模型是否真正成为家族的基础,是所有这些参数讨论背后的结构性问题。
• 价格 — 没有托管,所以没有定价。当托管合作伙伴列出 Nemotron 4 时,转手价格就是您实际需要支付的费用。
这对你的推理层意味着什么
你今天无法调用 Nemotron 4——没有人能——而 Poolside 的报道无论多么戏剧化,都不会改变这一点。实际的问题仍然是:你的技术栈需要改变多少,才能适应一个规格表仍在变动中的模型。答案与任何尚未发布的顶尖模型一样:保持推理层与模型无关。如果你通过一个覆盖 200+ 模型的单一 API 进行路由,那么新的 Nemotron 家族只是一个配置变更,而非重写。OrcaRouter 以 0% 加价直接传递提供商的标价,因此无论托管方最终对 Nemotron 4 收取多少费用,你支付的就是那个价格,而供应商的降价也会在实施当天生效。自动故障转移是应对未经证实首发版本的利器:将早期流量指向新模型,当它卡顿或出错时回退到稳定的替代方案,只有在你工作负载验证通过后才将其提升至生产环境。这些都不需要将生产路径押注在泄露的消息上——当规格表如此不确定时,这正是正确的姿态。
常见问题
Nemotron 4 什么时候发布?
尚未确定具体日期。员工告诉《The Information》,最终的训练运行尚未开始,且需要数月时间;两名员工表示可能在2026年深秋,其他人则预计会更晚。本周的报道增加了一个目标——在约一年内发布具有前沿竞争力的版本,但仍无确切日期。请将这两项信息视为项目内部的估算,而非路线图。
Nemotron 4 会开源吗?
NVIDIA公开表态的意图是开放权重,而Nemotron Coalition的首个项目——与Mistral共同开发的基础模型——也承诺将开源。但“开放权重”不等于“开源”:Nemotron 3 Ultra采用OpenMDW-1.1许可协议发布,这比NVIDIA以往的条款更为宽松,但仍不属于MIT或Apache 2.0。Nemotron 4的具体许可协议尚未公布。
据报道的Poolside 60亿美元交易是否已得到确认?
不。《华尔街日报》8月22日援引知情人士的话报道称,这项约60亿美元的授权协议,以及100多名Poolside工程师将加入Nemotron项目;彭博社则报道了额外的10亿美元投资。Newcomer于8月20日率先报道了此事。NVIDIA和Poolside均未证实任何相关消息。据报道,该授权为非排他性授权,Poolside仍将保持独立公司地位。
“至少1万亿参数”是真实的规格吗?
这是The Information援引员工消息报道的目标值,并非已确认的规格,且同一篇报道称这一数字可能还会有变化。即使总数达到1万亿,其原始规模仍将落后于Kimi K3(2.8T)和Qwen3.8 Max(2.4T);而尚未泄露的活跃参数数量,才是决定成本和速度的关键数字。
在选择模型之前,我应该等待 Nemotron 4 吗?
不。它最快也要几个月后才可能推出,而且尚未经过验证。现在就为任务挑选当前可用的最佳模型,并保持路由层的灵活性;当 Nemotron 4 真正发布时,像评估任何新模型那样去评估它——活跃参数、独立基准测试、许可证和价格——而不是看宣传中的总参数规模或所报告的预算大小。
最重要的一点
家族是真实的;数字是估算的。本周故事发生了变化:Nemotron 4 不再只是一次参数泄露,而是一个有资金支持的项目。据报道,NVIDIA 将花费约 60 亿美元,获得 Poolside 的 Model Factory 授权,招聘其 100 多名工程师,并向该公司再投资 10 亿美元——所有这一切都是为了打造一款能够与 DeepSeek 和 Kimi K3 相媲美的开放权重旗舰模型。这些数字全部来自媒体报道,没有一项得到确认,而且没有任何产品已发布。开放权重的前沿已经突破万亿参数大关,而 NVIDIA 的回应是一个联盟基础模型、一个获得授权的模型工厂和一个承诺。对于今天正在选择模型的读者来说,这仍然意味着一点:不要围绕泄露做规划。保持推理层的灵活性,用真实数据评估任何已发布的产品,并让路由做它该做的事——尝试新事物,而不把生产路径押注在它上面。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
