
Nemotron 4 洩漏:NVIDIA 對前沿領域的 1 兆參數開放權重回應
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 143 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
Nemotron 4 尚未正式發布,但本週它已不再只是個僅有參數規模的傳聞。《華爾街日報》於2026年8月22日引述知情人士報導,NVIDIA 正投入約60億美元,將 Nemotron 4 打造成全球最強大的開放權重 AI 模型之一;計畫內容還包括取得 AI 新創公司 Poolside 模型訓練技術的非專屬授權,以及將超過100名 Poolside 工程師轉調至 Nemotron 4 專案。這項消息疊加在 The Information 於8月11日率先揭露的資訊之上——該系列旗艦模型將具備「至少1兆個參數」。綜合兩則報導,可見這是 NVIDIA 迄今為止挑戰開放權重領域頂峰最認真的一次嘗試。
這裡沒有任何東西已經出貨,也都尚未獲得證實。NVIDIA 已承認正在打造 Nemotron 4 系列,但尚未證實參數規模、時間表、WSJ 引述知情人士所稱的授權與招募計畫,或 The Information 歸因於匿名員工的合作細節。請將本文中的每個數字視為「報導所述」,而非「官方確定」。洩漏報導的意義,在於把小小的已證實核心,與更大的傳聞光環區分開來——並在真正的規格表出爐時,告訴你哪些部分才重要。
一行洩漏,層層拆解
首先,先談名稱,因為它會讓你在搜尋結果中感到困惑:NVIDIA 已經在 2024 年 6 月推出了一款名為 Nemotron-4-340B 的模型。新的 Nemotron 4 是不同且更大的系列——是今年推出的 Nemotron 3 系列(Nano、Super、Ultra)的後繼產品——將「Nemotron 4」這個名稱沿用至其後的新世代。本文要介紹的是新的這個版本。
What The Information actually reported: NVIDIA 正在開發 Nemotron 4,作為一個旨在登上開放權重排行榜頂端的開源模型系列,而旗艦模型預計將擁有「至少 1 兆個參數」。NVIDIA 尚未設定發布日期,也尚未開始最終的訓練運行——員工預期這項過程需要數個月——而且目前只確定了預訓練數據和架構;規格仍在變動中。兩名員工表示,該系列最快可能在深秋準備就緒;其他人則預期會更晚。
同一份報告還附帶了一份單獨的預算:約280億美元的多年度雲端服務協議,持續到2031年初,約為NVIDIA一年前披露金額的三倍,其中約70億美元落在當前會計年度。該數字涵蓋運算承諾,不包括本週報導的新交易。報告還指出,先前旗艦產品的研究論文列有570位作者,而Nemotron 4的參與人數更多——一位前員工告訴The Information:「每個人都想參與其中。」而這一切NVIDIA均未披露。

本週:一筆 60 億美元的 Poolside 交易,讓 Nemotron 4 成真
《華爾街日報》本週報導,NVIDIA 的 Nemotron 4 計畫不僅僅是一項研究專案,而是一項已獲資金支持、將實際開發的建置計畫。據《華爾街日報》引述知情人士說法,NVIDIA 將支付約 60 億美元,取得 Poolside「Model Factory」的非獨家授權——該系統是 Poolside 開放權重 Laguna 編碼模型背後的訓練與評估系統;NVIDIA 並將向 Poolside 超過 100 名員工發出工作邀請,報導指稱人數為 109 人,其中多數為工程師,以投入 Nemotron 專案。彭博社另行報導,NVIDIA 將額外投資 Poolside 10 億美元,據報導其投前估值為 120 億美元,使 NVIDIA 的總承諾投資金額達到約 70 億美元。
這不是一筆收購。該授權是非獨家的,Poolside 的創辦人留任,且 Poolside 繼續作為一家獨立公司營運;根據報導,Poolside 計劃將 60 億美元的授權費分配給其投資者。此消息最早於 8 月 20 日由 Newcomer 披露,隨後於 8 月 21 日獲 Bloomberg 證實,並於 8 月 22 日獲 WSJ 證實——這些都仍屬「據報導」,尚無任何消息獲得 NVIDIA 或 Poolside 證實。
這筆交易之所以比檯面上的數字更重要:它讓 Nemotron 4 專案獲得了一支真正出貨過開放權重模型的團隊。Poolside 的 Laguna 系列是經過實證的開放權重程式碼產品線,而報導中的目標——大約一年內推出能與最強前沿模型競爭的 Nemotron 版本——是該專案首次有人給出具體時間表。報導將此舉定位為 NVIDIA 對中國開放權重領導者的回應,尤其是 DeepSeek 與 Moonshot AI 的 Kimi K3;同時在開放與封閉之爭中,這也是一種針對美國封閉實驗室的避險。
結構也很重要。非獨家授權意味著 Poolside 保留其智慧財產權,並可將相同技術授權給其他公司——NVIDIA 購買的是能力與人才,而非所有權。分析師將其解讀為 NVIDIA 試圖維持模型層級的商品化:只要開放權重模型保持強大且便宜,需求就會持續流向 NVIDIA 所掌控的層級——也就是 GPU。正如 LMArena 執行長 Anastasios Angelopoulos 在先前的報導中所言:「無論是哪家公司做出優秀的開源模型,NVIDIA 都是贏家。」
為什麼尺寸數字是最無趣的部分
顯而易見的故事是「NVIDIA 正邁向萬億參數規模」。比較不明顯的是,開放權重的前沿陣營搶先達到了這個目標。Kimi K3 於 7 月 27 日開放權重,總參數達 2.8 兆——在混合專家(Mixture-of-Experts)架構下,每個 token 約有 1,040 億個活躍參數——而阿里巴巴於 7 月 19 日發表的 Qwen3.8 Max,則是總參數 2.4 兆、活躍參數約 950 億的模型。相較之下,Nemotron 4 旗艦款「至少 1 兆」參數,雖是 Nemotron 3 Ultra 的兩倍,但在規模上仍落後於那些領先者,而這兩大領先者都是中國的。

這使得總參數數量完全成了錯誤的衡量標準。在混合專家(MoE)模型中,決定成本與速度的是每個 token 的活躍參數數量,而非標題上的總參數。總參數 1 兆的 Nemotron 4,其活躍參數可能約落在 1000 億——正好與 Kimi K3 和 Qwen3.8 Max 同級——也可能只有一半。接下來洩漏的那個數字才是關鍵,而它尚未洩漏。

另一個方向也值得注意:DeepSeek V4-Flash 於 7 月 31 日以 MIT 許可證發布,走的是相反路線——總計 2840 億參數,以價格而非規模為定位,估計每百萬輸入 token 的成本約為 0.14 美元。市場對這兩個極端都給予回報。規模不是策略本身;它只是一種策略。
NVIDIA 的立場說明了此舉。《The Information》報導,Nemotron 3 Ultra 在美國開放權重模型中排名第二——僅次於 Thinking Machines 的 Inkling——且未進入全球開放模型排行榜的頂尖層級。Nemotron 4 是試圖重返前沿領域對話的嘗試,而 NVIDIA 自家高層將其定位為一場主權策略:生成式 AI 副總裁 Kari Briski 表示,NVIDIA 投資 Nemotron 是因為「每個企業和每個國家都需要易於取得的前沿開源模型,以強化安全與保障、加速創新,並提供一個能代代相傳、值得信賴的基礎。」黃仁勳也在 X 上提出同樣論點,主張開放模型「能強化安全與網路安全、加速創新與擴散,並實現主權。」結構性緊張確實存在——據報導 NVIDIA 持有 OpenAI 約 300 億美元的股份——但其賭注在於開放模型會擴大而非縮小 GPU 市場大餅。
Nemotron Coalition 是最值得關注的勢力。
Nemotron 4 不是一個獨立專案,Poolside 交易也不是圍繞它的唯一架構。在 2026 年 3 月 16 日的 GTC 大會上,NVIDIA 宣布成立 Nemotron Coalition——八個創始成員:Black Forest Labs、Cursor、LangChain、Mistral AI、Perplexity、Reflection AI、Sarvam 和 Thinking Machines Lab——旨在集結研究、資料與運算資源,投入「前沿開放模型」。其首個專案是由 Mistral AI 與 NVIDIA 共同開發的基礎模型,在 NVIDIA DGX Cloud 上完成訓練;聯盟表示該模型將開源釋出,並將奠定 Nemotron 4 系列的基礎。
The Information 補充了具體運作細節:Reflection、Cursor、Thinking Machines 與 Mistral 已確認是貢獻者;Prime Intellect 提供了 30 萬個模擬環境供訓練使用;Cognition 曾討論過提供程式碼訓練資料。Prime Intellect 的執行長 Vincent Weisser 將這個聯盟定性為集體行動,對抗他所謂單一「神級」模型的壟斷。這在實際運作上意味著什麼:Nemotron 4 可能以聯盟基礎模型的形式推出,由每位成員各自進行後續訓練以打造自己的產品,而非由單一廠商提供 checkpoint。如此一來,「NVIDIA 開源權重模型」就不是正確的分類——真正值得關注的核心產物是那個基礎模型本身。
Poolside 的這筆交易正好融入上述所有布局之中。該聯盟匯集研究資源與運算能力;而授權加聘僱的方式則引進了一座可運作的模型工廠,以及一支已釋出開放權重的團隊。若這些報導屬實,NVIDIA 正同時從三個來源組裝 Nemotron 4——其自身的訓練營運、一個聯盟基礎,以及 Poolside 的生產系統——這與任何單一檢查點釋出的形式截然不同。
已確認、已回報、未知
• 已確認 — NVIDIA 正在開發 Nemotron 4 系列(公司聲明)。Nemotron Coalition 確實存在,並正與 Mistral AI 合作打造一個開放基礎模型(NVIDIA,2026 年 3 月)。
• 據報導、未經證實——「至少 1 兆」的旗艦目標與深秋時程,加上約 280 億美元的雲端承諾,其中本財年約 70 億美元(The Information);WSJ 報導的約 60 億美元建置預算、Poolside「Model Factory」非獨家授權,以及超過 100 名 Poolside 工程師加入 Nemotron 專案;Bloomberg 報導的 NVIDIA 以約 120 億美元投資前估值向 Poolside 投資 10 億美元;以及聯盟成員各自貢獻的內容。
• 未知 — 活化參數數量、上下文長度、模態組合、授權條款、價格、哪些檢查點會先出貨、Mistral 共同開發的基礎模型是否真的會成為該系列的基礎,以及 Poolside 交易是否如報導所述結構化(兩家公司均未評論)。
時間軸與觀看建議
目前仍未有發布日期。最終的訓練運行尚未開始;員工描述其耗時數月,估算範圍從「深秋」(兩個消息來源)到更晚。Poolside 的報導提供了迄今為止任何人對該項目附上的第一個具體時間框架:根據報導,目標是在大約一年內發布一個能夠與最強的前沿模型競爭的版本。與此同時,NVIDIA 讓這個系列持續推進:它推出了 Nemotron 3.5 Lightning,這是一個 316 億參數的代理工作器,於 8 月 11 日發布——正好是 Nemotron 4 報導曝光的那一天——同時還有 NVIDIA 自家的開源路由軟體 NeMo Switchyard。
該看什麼,大致按重要性排序:
• 活躍參數 — 總數是焦點;活躍數量決定成本與速度。總量約1T、活躍參數約100B的MoE,與活躍參數約50B的MoE相比,徹底改變了整個局面。
• Poolside 整合 —— 究竟 Model Factory 授權及其新團隊是否真正重塑培訓計劃並壓縮所報告的時間表,抑或是人才收購讓該計劃維持原狀。
• 獨立評分 — 對於尚未訓練的模型,不存在第三方評測。當託管檢查點出現時,請關注 Artificial Analysis Intelligence Index。
• 授權條款 — Nemotron 3 Ultra 以 OpenMDW-1.1 授權發布,屬於寬鬆授權,但並非 MIT 或 Apache 2.0。Nemotron 4 是否沿用或收緊授權尚無定論,而對於在這些權重之上建構產品的公司而言,這決定了所有一切。
• 哪些尺寸會先出貨 — Nemotron 3 是以家族形式推出(Nano、Super、Ultra)。預計 Nemotron 4 也會有一系列尺寸,而且小型版本會先於旗艦版推出。
• Mistral 基礎 — 聯盟的基礎模型是否真的能成為這個家族的根基,是所有參數討論背後的結構性問題。
• 價格 — 沒有託管,就沒有定價。當託管合作夥伴列出 Nemotron 4 時,轉嫁價格即為您實際支付的金額。
這對您的推論層意味著什麼
你今天無法呼叫 Nemotron 4——沒有人能——而 Poolside 的報導無論多麼引人注目,都不會改變這一點。實際問題仍然在於:為了遷就一個規格表仍在變動的模型,你的技術棧該調整多少。答案與任何尚未推出的前沿模型相同:讓推論層保持與模型無關。如果你透過一個統一的 API 路由,該 API 涵蓋 200 多個模型,那麼新的 Nemotron 系列只是設定變更,而非重寫。OrcaRouter 以 0% 加價轉傳供應商的標價,因此無論主機商最終對 Nemotron 4 收取多少費用,你就支付多少,而供應商降價也會在當天同步生效。自動容錯轉移是應對未經考驗的首發版本的工具:將早期流量指向新模型,當它停滯或出錯時回退到穩定的替代方案,只有當它證明自己能承擔你的工作負載後,才將其提升到正式環境。這一切都不需要在洩漏消息上押注生產路徑——當規格表如此暫時性時,這正是正確的姿態。
常見問題
Nemotron 4 何時會發布?
尚未設定日期。員工告訴The Information,最終訓練執行尚未開始,且將耗時數月;兩人表示2026年晚秋有可能,其他人則預期更晚。本週的報導新增了一個報告目標:約一年內發布具前沿競爭力的版本,但仍無確切日期。請將兩者視為專案內部的估計,而非路線圖。
Nemotron 4 會是開源的嗎?
NVIDIA 公開表明的意圖是開放權重,而 Nemotron 聯盟的第一個專案——與 Mistral 共同開發的基礎模型——已承諾將開放原始碼。但「開放權重」不等於「開放原始碼」:Nemotron 3 Ultra 以 OpenMDW-1.1 授權條款發布,該條款比 NVIDIA 先前的條款更為寬鬆,但仍非 MIT 或 Apache 2.0。Nemotron 4 的具體授權條款尚未公布。
報導稱價值 60 億美元的 Poolside 交易是否已獲得證實?
不。WSJ於8月22日引述知情人士報導,稱這筆授權金額約為60億美元,且超過100名Poolside工程師將加入Nemotron專案;Bloomberg則報導了額外的10億美元投資。Newcomer於8月20日率先報導此事。NVIDIA與Poolside均未證實任何相關消息。據報導,該授權為非獨家,Poolside將維持獨立公司身分。
「at least 1 trillion parameters」是真實的規格嗎?
{{1}}這是The Information報導的員工來源目標,並非已確認的規格,且同一篇報導指出該數字可能會有變動。{{/1}}{{2}}即使總參數達到1兆,其原始規模仍落後於Kimi K3(2.8T)和Qwen3.8 Max(2.4T);而尚未外流的活躍參數數量,才是決定成本與速度的關鍵數字。{{/2}}
我應該等 Nemotron 4 再選擇模型嗎?
不。它最快也要幾個月後才會推出,而且尚未經過驗證。現在就為這項任務挑選現有最好的模型,並保持路由層的靈活性;當 Nemotron 4 真正推出時,用你評估任何新模型的相同方式來評估它——活躍參數、獨立基準測試、授權條款和價格——而不是看宣傳的總數或其宣稱的預算規模。
底線
這個模型家族是真的;數字只是估計。本週故事變了樣:Nemotron 4 不再只是參數外洩,而是有資金支持的產品。據報導,NVIDIA 將花費約 60 億美元,授權 Poolside 的 Model Factory,僱用其 100 多名工程師,並再向該公司投資 10 億美元——全都是為了打造一個能與 DeepSeek 和 Kimi K3 並駕齊驅的開放權重旗艦模型。這些數字每一項都是媒體報導,沒有獲得證實,而且什麼都還沒出貨。開放權重領域已經跨過萬億參數門檻,而 NVIDIA 的答案是聯盟基礎模型、授權的模型工廠,以及一個承諾。對於今天要選擇模型的讀者來說,這仍然只意味著一件事:不要圍繞外洩資訊做規劃。保持推論層的靈活性,用真實數字評估任何出貨的產品,讓路由發揮它應有的作用——嘗試新東西,但別拿生產路徑去賭。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
