
Nemotron 4リーク:NVIDIAの1兆パラメータ・オープンウェイトによるフロンティアへの回答
- metaNEWMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenNEWQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekNEWDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxNEWMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり · 2278 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
- grokxAI: Grok 4.52026-07-0856知能72コーディング
- tencentTencent: Hy32026-07-0642知能59コーディング
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232知能42コーディング
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226知能39コーディング
- anthropicAnthropic: Claude Sonnet 52026-06-3055知能72コーディング
- klingKling: Kling 3.0 Turbo2026-06-1757知能52コーディング57数学
{{1}}1兆パラメータ。{{/1}}それが、NVIDIAの次期オープンウェイトファミリーの旗艦となる最大のNemotron 4モデルについて報じられた下限値だ。ただし、この数字が大きく聞こえるのも、すでに出荷済みのモデルと並べてみるまでの話だ。{{2}}この1か月だけでも、Moonshot AIは総パラメータ2.8兆のKimi K3を出荷し、Alibabaは2.4兆のQwen3.8-Maxを発表し、NVIDIA自身の現行フラッグシップであるNemotron 3 Ultraは5,500億パラメータにとどまる。{{/2}}{{3}}The Informationは2026年8月11日、プロジェクトに携わる複数の従業員の話として、Nemotron 4がNVIDIAの答えだと報じた。すなわち、最大モデルが約1兆パラメータ(Nemotron 3 Ultraの約2倍)から始まると見込まれるオープンウェイトファミリーである。{{/3}}
ここに出荷されたものは何もありません。NVIDIAはNemotron 4ファミリーを構築していることを認めていますが、パラメータ目標、予算、スケジュール、提携の詳細については確認していません。これらの情報は、The Informationが匿名の従業員の話として伝えているものです。この記事の数字はすべて「確定」ではなく「報道ベース」として扱ってください。リーク記事の目的は、小さくとも確定している核となる部分と、より大きな報道ベースの周辺情報を切り分け、実際のスペックシートが公開されたときにどの部分が重要なのかを伝えることです。
1行のリークを紐解く
{{1}}まず、名前についてです。検索結果で混乱するからです。{{/1}} {{2}}NVIDIAは2024年6月にすでにNemotron-4-340Bというモデルをリリースしています。{{/2}} {{3}}新しいNemotron 4は、異なる、より大きなファミリーです{{/3}} — {{4}}今年リリースされたNemotron 3ライン(Nano、Super、Ultra)の後継で{{/4}} — {{5}}その次の世代に「Nemotron 4」という名前を再利用しています。{{/5}} {{6}}この記事は新しいものについてです。{{/6}}
The Informationが実際に報じた内容:NVIDIAは、オープンウェイトのリーダーボード最上位を目指すオープンソースモデル群としてNemotron 4を開発しており、フラッグシップモデルは「少なくとも1兆パラメータ」になると見込まれている。NVIDIAは発売日を設定しておらず、最終トレーニングラン(従業員らは数か月かかると予想)も開始していない。確定しているのは事前学習データとアーキテクチャのみで、仕様はまだ流動的だ。2人の従業員によると、このモデル群は早ければ晩秋にも完成する可能性があるが、他の従業員はそれより遅れると見込んでいる。
同じ報告書には予算も添付されている。2031年初頭まで続く複数年にわたるクラウドサービス契約で約280億ドルに上り、これはNVIDIAが1年前に開示した額の約3倍で、うち約70億ドルが今年度に計上される。また、以前のフラッグシップモデルの研究論文には570人の著者が記載されており、Nemotron 4にはそれ以上の著者が関わっている。元従業員はThe Informationに対し、「誰もが関わりたがっている」と語った。これらはすべてNVIDIAからは開示されていない。

なぜサイズ番号が最も面白くない部分なのか
明白なストーリーは「NVIDIAは兆パラメータ規模を目指している」というものだ。あまり知られていないのは、オープンウェイトのフロンティアが先にそこへ到達していたことだ。Kimi K3は7月27日にウェイトを公開し、総パラメータ数は2.8兆——混合専門家(MoE)構成で1トークンあたり約1,040億のアクティブパラメータ——を誇る。AlibabaのQwen3.8-Maxも7月19日に発表され、総パラメータ数2.4兆、アクティブパラメータは約950億だ。これらに対し、「少なくとも1兆」とされるNemotron 4のフラッグシップはNemotron 3 Ultraの2倍に相当するが、規模のリーダーには依然として及ばない。そして、そのリーダー2社はどちらも中国企業なのだ。

つまり、総パラメータ数を指標にすることはまったくの見当違いだ。Mixture-of-Expertsモデルでは、コストと速度を左右するのはトークンあたりのアクティブ・パラメータ数であって、宣伝文句になる総数ではない。総計1兆のNemotron 4は、アクティブ数が約1000億——まさにKimi K3やQwen3.8-Maxと同じ層——か、あるいはその半分に落ち着くかもしれない。次にリークされる数字こそが重要であり、それはまだリークされていない。

もう一つの方向性にも注目する価値がある。DeepSeek V4-Flashは、MITライセンスの下で7月31日にリリースされ、逆の道を選んだ。総計2840億パラメータで、規模ではなく価格に重点を置き、推定コストは入力トークン100万個あたり約0.14ドルだ。市場は両極端を評価している。規模は戦略ではない。規模は一つの戦略に過ぎない。
NVIDIAの立場がこの動きを説明している。{{1}}The Informationは、Nemotron 3 Ultraが米国のオープンウェイトモデルの中で2位——Thinking MachinesのInklingに次ぐ——であり、世界のオープンリーダーボードの最上位層には入っていないと報じている。{{/1}}Nemotron 4は、フロンティア(最先端)の議論に再び加わるための試みであり、NVIDIA自身の経営幹部はこれを主権(ソブリンティ)戦略と位置づけている。生成AI担当バイスプレジデントのKari Briski氏は、NVIDIAがNemotronに投資する理由について「あらゆる企業とあらゆる国が、安全とセキュリティを強化し、イノベーションを加速し、次世代へと引き継げる信頼できる基盤を提供するために、アクセス可能なフロンティア向けオープンソースモデルを必要としている」と述べた。{{2}}Jensen Huang氏もXで同じ主張をしてきており、オープンモデルは「安全性とサイバーセキュリティを強化し、イノベーションと普及を加速し、主権を可能にする」と論じている。{{/2}}構造的な緊張は現実のものだ——NVIDIAはOpenAIの株式を約300億ドル分保有していると報じられている——しかし賭けは、オープンモデルがGPUパイを縮小させるのではなく拡大させるというものだ。{{3}}LMArenaのCEOであるAnastasios Angelopoulos氏が言うように、「どの企業が優れたオープンソースモデルを作ろうとも、勝つのはNVIDIAだ」。{{/3}}
見どころはNemotron Coalitionです。
Nemotron 4は単独のプロジェクトではなく、そこが多くの報道が見落としている点だ。2026年3月16日のGTCで、NVIDIAはNemotron Coalitionを発表した。創設メンバーはBlack Forest Labs、Cursor、LangChain、Mistral AI、Perplexity、Reflection AI、Sarvam、Thinking Machines Labの8社で、「フロンティア・オープンモデル」のために研究、データ、計算資源を結集する体制だ。最初のプロジェクトは、Mistral AIとNVIDIAが共同開発し、NVIDIA DGX Cloudでトレーニングされるベースモデルで、連合はこれをオープンソース化し、Nemotron 4ファミリーの基盤にするとしている。
The Informationは作業の詳細を追加している:Reflection、Cursor、Thinking Machines、Mistralが貢献者として確認されており、Prime Intellectはトレーニング用に30万のシミュレーション環境を提供し、Cognitionはコード学習データの提供を協議している。Prime IntellectのCEOであるVincent Weisser氏は、この連合を、彼が「神のような」単一モデルの独占と呼ぶものに対する集団的アクションとして位置づけた。これが運用上意味すること:Nemotron 4は、単一ベンダーのチェックポイントではなく、各メンバーが自社製品向けにポストトレーニングするコンソーシアム基盤としてリリースされる可能性がある。そうなれば、「オープンウェイトのNVIDIAモデル」という分類は誤りになる——ベース自体が興味深い成果物となる。
確認済み、報告済み、不明
• 確認済み — NVIDIAはNemotron 4ファミリーに取り組んでいる(会社発表)。Nemotron Coalitionは存在し、Mistral AIと共同でオープンベースモデルを構築している(NVIDIA、2026年3月)。
• 報告済み、未確認 — 「少なくとも1兆」の旗艦ターゲット;晩秋のスケジュール;約280億ドルのクラウドコミットメント(うち今年度は約70億ドル);各連合メンバーが何を拠出するか。
• 不明 — アクティブパラメータ数、コンテキスト長、モダリティ構成、ライセンス条件、価格、最初にリリースされるチェックポイント、そしてMistralと共同開発されたベースが実際にファミリーの基盤となるかどうか。
タイムラインと見どころ
リリース日は未定だ。最終トレーニングランはまだ開始されておらず、従業員によれば数か月かかるとされ、その見積もりは「晩秋」(2つの情報源)からそれ以降まで幅がある。その間、NVIDIAはファミリーの進化を続けており、8月11日、Nemotron 4の報道が流れた同日に、31.6BパラメータのエージェントワーカーであるNemotron 3.5 Lightningをリリースし、NVIDIA自身のオープンソースルーティングソフトウェアであるNeMo Switchyardも同時に発表した。言い換えれば、NVIDIAは旗艦モデルがまだ設計段階にある間に、ラインナップを積極的に反復更新している。
見るべきもの(重要度の高い順):
• アクティブパラメータ — 総数が見出しになる一方、コストと速度を決めるのはアクティブ数である。アクティブ約100B・総数約1TのMoEは、アクティブ約50Bのものとは全体像が大きく異なる。
• 独立したスコア — 未学習のモデルには第三者の評価は存在しません。ホストされたチェックポイントが登場したら、Artificial Analysis Intelligence Indexに注目してください。
{{1}}ライセンス条件{{/1}} — Nemotron 3 Ultra は OpenMDW-1.1 の下で提供され、{{2}}寛容ではあるが、MIT や Apache 2.0 ではない{{/2}}。{{3}}Nemotron 4 がこの方針を踏襲するのか、あるいはさらに厳格化するのかは未決定であり{{/3}}、{{4}}ウェイトを基に構築する企業にとっては、それがすべてを左右する{{/4}}。
• どのサイズが先に出荷されるか — Nemotron 3 はファミリーとして登場しました(Nano、Super、Ultra)。Nemotron 4 もさまざまなサイズが予定されており、フラッグシップよりも先に小型モデルが出荷される見込みです。
「Mistralベース ― 連合のベースモデルが実際にファミリーの基盤となるかどうかが、すべてのパラメータ論の背後にある構造的問いである。」
{{1}}価格{{/1}} — ホストされているものがないため、価格も設定されていません。ホスティングパートナーがNemotron 4をリストアップした場合、パススルー価格が実際に支払う金額になります。
あなたの推論層にとっての意味
あなたは今日Nemotron 4を呼び出すことはできません — 誰にもできません — したがって実際的な問題は、仕様がまだ流動的なモデルに対応するために、自社スタックのどこまでを変更すべきかです。その答えは、未出荷のフロンティアモデル一般と同じです。推論レイヤーをモデル非依存に保ちなさい。200以上のモデルを束ねる単一のAPI経由でルーティングすれば、新しいNemotronファミリーは書き直しではなく設定変更です。OrcaRouterはプロバイダーの定価を0%マークアップで透過的に渡すため、ホストが最終的にNemotron 4に請求する額がそのまま支払額となり、ベンダーの値下げは実施日に即反映されます。自動フェイルオーバーは、実績のない初回リリースに適したツールです。初期トラフィックを新モデルに向け、停滞やエラーが発生したら安定した代替モデルにフォールバックし、ワークロードで実績を上げた後にのみ本番に昇格させます。そのいずれも、リーク情報に本番パスを賭けることを必要としません — 仕様がこれほど暫定的である場合、それはまさに正しい姿勢です。
よくある質問
Nemotron 4はいつリリースされますか?
日程は設定されていない。従業員はThe Informationに対し、最終トレーニング実行はまだ開始されておらず、数か月かかると語った。2人は2026年の晩秋が可能性としてあり得るとし、他の従業員はそれ以降になると予想している。「晩秋」という表現は、プロジェクト内部からの楽観的な見積もりとして捉えるべきであり、ロードマップとして見なすべきではない。
Nemotron 4はオープンソースになるのでしょうか?
NVIDIAの表明した意図はオープンウェイトであり、Nemotron Coalitionの最初のプロジェクトであるMistralと共同開発されたベースモデルはオープンソース化されることが約束されている。しかし、「オープンウェイト」は「オープンソース」ではない。Nemotron 3 UltraはOpenMDW-1.1ライセンスの下で提供されており、これはNVIDIAの従来の条件よりも許容的であるものの、依然としてMITやApache 2.0ではない。Nemotron 4の具体的なライセンスはまだ発表されていない。
「少なくとも1兆パラメータ」というのは実際の仕様ですか?
これはThe Informationが従業員情報源に基づいて報じた目標値であり、確定した仕様ではありません。同じ報道によれば、その数値は変わる可能性もあります。仮に総数が1兆だったとしても、生の規模ではKimi K3(2.8T)やQwen3.8-Max(2.4T)に及びません。コストと速度を左右するのはアクティブパラメータ数ですが、これはまだリークされていません。
モデルを選ぶ前にNemotron 4を待つべきでしょうか?
いいえ。それは早くても数か月先のことであり、まだ実証されていません。今利用できるモデルの中からその仕事に最適なものを選び、ルーティング層は柔軟に保ってください。Nemotron 4が実際に出荷されたら、他の新しいモデルと同じ方法で評価してください — アクティブパラメータ数、独立したベンチマーク、ライセンス、価格 — 見出しに載る総数ではなく。
結論
ファミリーは実在するが、数字は推定値である。NVIDIAはNemotron 4を構築していることを確認しており、その周囲のコンソーシアム構造こそがこの話の最も興味深い部分だ——しかし、リークされた主要な数字はすべて、1兆パラメータの下限から晩秋のスケジュール、280億ドルの予算に至るまで、匿名の従業員からの情報であり、変わり得る。オープンウェイトの最前線は、中国の研究所が主導してすでに1兆パラメータの大台を超えている。NVIDIAの回答は、コンソーシアムのベースモデルと約束である。今日モデルを選ぶ読者にとって、これはひとつのことを意味する:リークを前提に計画を立てるな。推論層は柔軟に保て。実際にリリースされたものは実数で評価せよ。そしてルーティングには、本番パスを賭けずに新しいものを試すという本来の役割を果たさせよ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
