
הדלפת Nemotron 4: התשובה של NVIDIA לחזית עם טריליון פרמטרים ומשקלים פתוחים
- metaחדשMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekחדשDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxחדשMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים · 2278 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0642אינטליגנציה59כתיבת קוד
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232אינטליגנציה42כתיבת קוד
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226אינטליגנציה39כתיבת קוד
- anthropicAnthropic: Claude Sonnet 52026-06-3055אינטליגנציה72כתיבת קוד
- klingKling: Kling 3.0 Turbo2026-06-1757אינטליגנציה52כתיבת קוד57מתמטיקה
טריליון פרמטרים. זה הרף התחתון המדווח עבור הדגם הגדול ביותר של Nemotron 4, דגם הדגל של משפחת המשקלים הפתוחים הבאה של NVIDIA — והמספר נשמע גדול רק עד שמצמידים אותו למה שכבר שוחרר. בחודש האחרון, Moonshot AI שחררה את Kimi K3 עם 2.8 טריליון פרמטרים בסך הכול, Alibaba חשפה את Qwen3.8-Max עם 2.4 טריליון, ו-Nemotron 3 Ultra, דגם הדגל הנוכחי של NVIDIA עצמה, עומד על 550 מיליארד. The Information דיווחה ב-11 באוגוסט 2026 — בצטטה מספר עובדים שעובדים על הפרויקט — ש-Nemotron 4 הוא התשובה של NVIDIA: משפחת משקלים פתוחים שהדגם הגדול ביותר שלה צפוי להתחיל בכ-1 טריליון פרמטרים, בערך פי שניים מ-Nemotron 3 Ultra.
שום דבר כאן לא שוחרר. NVIDIA אישרה שהיא בונה את משפחת Nemotron 4, אך לא אישרה את יעד מספר הפרמטרים, את התקציב, את ציר הזמן או את פרטי הברית שהאתר The Information מייחס לעובדים אלמוניים. התייחסו לכל מספר בכתבה זו כ"מדווח", לא כ"מוגדר". מטרת כתבת הדלפה היא להפריד בין הגרעין המאושר והקטן לבין הילת הדיווחים הרחבה יותר — ולציין אילו חלקים חשובים כשגיליון המפרט האמיתי יגיע.
הדליפה בשורה אחת, מפוענחת
ראשית, השם, כי הוא יבלבל אתכם בתוצאות החיפוש: NVIDIA כבר השיקה מודל בשם Nemotron-4-340B ביוני 2024. ה-Nemotron 4 החדש הוא משפחה שונה וגדולה יותר — היורשת של קו Nemotron 3 (Nano, Super, Ultra) שהושק השנה — תוך שימוש חוזר בשם "Nemotron 4" לדור שאחריו. מאמר זה עוסק בחדש.
מה ש-The Information דיווחה בפועל: NVIDIA מפתחת את Nemotron 4 כמשפחת מודלים בקוד פתוח שמטרתם להגיע לפסגת לוח המובילים של מודלים פתוחי-משקל, והמודל הדגל צפוי לכלול "לפחות טריליון פרמטרים." NVIDIA לא קבעה תאריך השקה, לא החלה בריצת האימון הסופית — תהליך שהעובדים צופים שיימשך חודשים — וקבעה רק את נתוני טרום-האימון ואת הארכיטקטורה; המפרט עדיין משתנה. שני עובדים אמרו שהמשפחה עשויה להיות מוכנה כבר בסוף הסתיו; אחרים צופים מועד מאוחר יותר.
הדוח כולל גם תקציב: כ-28 מיליארד דולר בהסכמי שירותי ענן רב-שנתיים שיימשכו עד תחילת 2031, בערך פי שלושה ממה שנווידיה חשפה שנה קודם לכן, עם כ-7 מיליארד דולר שיגיעו בשנה הפיסקלית הנוכחית. עוד נכתב בו כי המאמר המדעי של הדגל הקודם מנה 570 מחברים, וכי Nemotron 4 כולל יותר — עובד לשעבר אמר ל-The Information ש"כולם רוצים להיות מעורבים". כל זה לא דווח על ידי נווידיה.

למה מספר הגודל הוא החלק הכי פחות מעניין
הסיפור הברור הוא "NVIDIA עוברת לטריליון פרמטרים". הסיפור הפחות ברור הוא שחזית המשקלים הפתוחים הגיעה לשם ראשונה. Kimi K3 פתחה את המשקלים שלה ב-27 ביולי עם סך של 2.8 טריליון פרמטרים — כ-104 מיליארד פעילים לכל טוקן בתצורת תערובת מומחים — וה-Qwen3.8-Max של עליבאבא, שנחשף ב-19 ביולי, הוא מודל עם סך של 2.4 טריליון פרמטרים וכ-95 מיליארד פעילים. לעומתם, מודל דגל של Nemotron 4 עם "לפחות טריליון אחד" יכפיל את Nemotron 3 Ultra, אבל עדיין יפגר אחרי מובילי הגודל, ושני המובילים הללו הם סיניים.

זה הופך את ספירת הפרמטרים הכוללת לעדשה שגויה לחלוטין. במודל mixture-of-experts, מה שקובע עלות ומהירות הוא מספר הפרמטרים הפעילים לכל טוקן, לא המספר הכולל שנזרק לכותרת. Nemotron 4 עם טריליון פרמטרים בסך הכול יכול להגיע לכ-100 מיליארד פעילים — בדיוק בדרגה של Kimi K3 ו-Qwen3.8-Max — או לחצי מזה. המספר שידלוף הבא הוא המספר שחשוב, והוא עדיין לא דלף.

ראוי לשים לב גם לכיוון ההפוך: DeepSeek V4-Flash, שיצא ב-31 ביולי תחת רישיון MIT, הלך בדרך ההפוכה — 284 מיליארד בסך הכול, ממוצב על מחיר ולא על קנה מידה, בעלות מוערכת של כ-0.14 דולר למיליון אסימוני קלט. השוק מתגמל את שני הקצוות. קנה מידה אינו האסטרטגיה; הוא אסטרטגיה אחת.
העמדה של NVIDIA מסבירה את המהלך. The Information מדווח כי Nemotron 3 Ultra מדורג במקום השני בין דגמי המשקולות הפתוחים של ארה"ב — מאחורי Inkling של Thinking Machines — ומחוץ לדרגה העליונה של לוח המובילים הפתוח העולמי. Nemotron 4 הוא הניסיון לחזור לשיח על החזית, ומנהלי NVIDIA עצמם ממסגרים זאת כמהלך ריבונות: סגנית הנשיא ל-AI גנרטיבי, קארי בריסקי, אמרה ש-NVIDIA משקיעה ב-Nemotron כי "כל חברה וכל מדינה זקוקות למודלים פתוחים נגישים בחזית כדי לחזק ביטחון ואבטחה, להאיץ חדשנות, ולספק בסיס שאפשר לסמוך עליו מדור לדור." ג'נסן הואנג משמיע את אותו מסר ב-X, וטוען שמודלים פתוחים "מחזקים ביטחון ואבטחת סייבר, מאיצים חדשנות והפצה, ומאפשרים ריבונות." המתח המבני אמיתי — לפי הדיווחים, NVIDIA מחזיקה בכ-30 מיליארד דולר מ-OpenAI — אבל ההימור הוא שמודלים פתוחים מרחיבים את עוגת ה-GPU ולא מכווצים אותה. כפי שניסח זאת מנכ"ל LMArena, אנסטסיוס אנג'לופולוס: "לא משנה איזו חברה תייצר מודל קוד פתוח מצוין, NVIDIA מנצחת."
קואליציית נמוטרון היא החלק שכדאי לעקוב אחריו.
Nemotron 4 אינו פרויקט סולו, וזהו הפרט שרוב הסיקורים מפספסים. ב-GTC ב-16 במרץ 2026, הכריזה NVIDIA על Nemotron Coalition — שמונה חברות מייסדות: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam ו-Thinking Machines Lab — שאורגנו כדי לרכז מחקר, נתונים וכוח מחשוב מאחורי "מודלים פתוחים פורצי דרך". הפרויקט הראשון שלה הוא מודל בסיס שפותח במשותף על ידי Mistral AI ו-NVIDIA, אומן על NVIDIA DGX Cloud, ולפי הקואליציה יופץ כקוד פתוח ויהווה בסיס למשפחת Nemotron 4.
The Information מוסיף את פרטי העבודה: {{1}}Reflection, Cursor, Thinking Machines ו-Mistral{{/1}} הם תורמים מאושרים; {{2}}Prime Intellect תרם 300,000 סביבות סימולציה לאימון{{/2}}; {{3}}Cognition דנה באספקת נתוני אימון קוד{{/3}}. המנכ"ל של Prime Intellect, Vincent Weisser, הציג את הברית כפעולה קולקטיבית נגד מה שהוא כינה מונופול של מודל {{4}}"דמוי-אל"{{/4}} יחיד. מה זה אומר מבחינה תפעולית: Nemotron 4 עשוי להישלח כבסיס קונסורציום שכל חבר מאמן מחדש עבור המוצר שלו, במקום checkpoint של ספק אחד. זה יהפוך את {{5}}"מודל NVIDIA עם משקלים פתוחים"{{/5}} לקטגוריה שגויה — הבסיס הוא הארטיפקט המעניין.
מאושר, דווח, לא ידוע
• אושר — NVIDIA עובדת על משפחת Nemotron 4 (הצהרת חברה). קואליציית Nemotron קיימת ובונה מודל בסיס פתוח עם Mistral AI (NVIDIA, מרץ 2026).
• דווח, לא אושר — היעד הראשי של "לפחות טריליון אחד"; ציר הזמן של סוף הסתיו; ההתחייבות לענן של כ-28 מיליארד דולר עם כ-7 מיליארד דולר השנה הפיסקלית; אילו חברות קואליציה תורמות מה.
• לא ידוע — מספר הפרמטרים הפעילים, אורך ההקשר, תמהיל המודאליות, תנאי הרישיון, המחיר, אילו checkpoints ישוחררו ראשונים, והאם הבסיס שפותח בשיתוף עם Mistral אכן יהפוך לבסיס המשפחה.
ציר זמן ומה לצפות
אין תאריך שחרור. ריצת האימון הסופית טרם החלה; עובדים מתארים אותה כאורכת חודשים, וההערכות נעות בין "סוף הסתיו" (שני מקורות) לבין מועד מאוחר יותר. בינתיים, NVIDIA ממשיכה להניע את המשפחה: החברה שחררה את Nemotron 3.5 Lightning, סוכן עובד עם 31.6B פרמטרים, שיצא ב-11 באוגוסט — באותו היום שבו פורסם הדו"ח על Nemotron 4 — לצד NeMo Switchyard, תוכנת הניתוב בקוד פתוח של NVIDIA עצמה. במילים אחרות, NVIDIA חוזרת ומשפרת את הקו באופן פעיל, בעוד שדגם הדגל עדיין בשלבי תכנון.
מה לצפות, לפי סדר חשיבות משוער:
• פרמטרים פעילים — הסך הכולל הוא המספר הראשי; מספר הפרמטרים הפעילים קובע את העלות והמהירות. מודל MoE עם ~1T בסך הכול ו-~100B פעילים משנה את כל התמונה לעומת אחד עם ~50B פעילים.
• ציונים עצמאיים — אין הערכה של צד שלישי עבור מודל שלא אומן. עקבו אחר מדד Artificial Analysis Intelligence Index כשיופיע checkpoint מתארח.
• תנאי רישיון — Nemotron 3 Ultra מופץ תחת OpenMDW-1.1, רישיון מתירני אך לא MIT או Apache 2.0. האם Nemotron 4 ימשיך באותה דרך או יחמיר את התנאים עדיין לא נקבע, ועבור חברה שבונה על המשקולות זה מכריע הכל.
• אילו גדלים נשלחים ראשונים — Nemotron 3 הגיע כמשפחה (Nano, Super, Ultra). צפו למגוון גדלים של Nemotron 4, וצפו שהקטנים יגיעו לפני הדגל.
בסיס המיסטרל — האם מודל הבסיס של הקואליציה יהפוך בפועל ליסוד המשפחה היא השאלה המבנית שמאחורי כל הדיבורים על הפרמטרים.
• מחיר — שום דבר לא מתארח, אז שום דבר לא מתומחר. כאשר ספק אירוח מציג את Nemotron 4, מחיר המעבר הוא מה שבפועל תשלם.
מה זה אומר עבור שכבת ההסקה שלך
אי אפשר לקרוא ל-Nemotron 4 היום — אף אחד לא יכול — ולכן השאלה המעשית היא כמה מהמחסנית שלך צריך להשתנות כדי להתאים למודל שהמפרט שלו עדיין משתנה. התשובה זהה לזו של כל מודל חזיתי שטרם הושק: שמור על שכבת ההסקה אגנוסטית למודל. אם אתה מנתב דרך API יחיד שמאחוריו עומדים 200+ מודלים, משפחת Nemotron חדשה היא שינוי קונפיגורציה, לא שכתוב. OrcaRouter מעביר אליך את מחיר המחירון של הספק עם 0% תוספת, כך שכל מה שמארח יגבה בסופו של דבר עבור Nemotron 4 הוא בדיוק מה שאתה משלם, וקיצוץ מחיר של ספק נכנס לתוקף באותו יום שבו הוא מוכרז. מעבר אוטומטי (failover) הוא הכלי לשחרור ראשון שלא הוכח: הפנה תנועה מוקדמת אל המודל החדש, חזור לחלופה יציבה כשהוא נתקע או נכשל, וקדם אותו לייצור רק אחרי שיוכיח את עצמו עם העומסים שלך. שום דבר מזה לא דורש להמר את נתיב ההפקה על הדלפה — וזו בדיוק העמדה הנכונה כשהמפרט כל כך זמני.
שאלות נפוצות
מתי ישוחרר Nemotron 4?
לא נקבע תאריך. עובדים אמרו ל-The Information שהריצת ההכשרה הסופית טרם החלה ותיקח חודשים; שניים אמרו שסוף סתיו 2026 אפשרי, ואחרים צופים מועד מאוחר יותר. יש להתייחס ל"סוף סתיו" כהערכה אופטימית מתוך הפרויקט, לא כמפת דרכים.
האם Nemotron 4 יהיה בקוד פתוח?
ההצהרה הרשמית של NVIDIA היא משקלים פתוחים, והפרויקט הראשון של קואליציית Nemotron — מודל הבסיס שפותח בשיתוף עם Mistral — מובטח שיופץ כקוד פתוח. אבל "משקלים פתוחים" אינו "קוד פתוח": Nemotron 3 Ultra מופץ תחת רישיון OpenMDW-1.1, שהוא מתירני יותר מהתנאים הישנים של NVIDIA אך עדיין לא MIT או Apache 2.0. הרישיון הספציפי של Nemotron 4 טרם הוכרז.
האם "לפחות טריליון פרמטרים" הוא מפרט אמיתי?
זהו יעד שמקורו בעובדים, כפי שדווח ב-The Information, ולא מפרט מאושר, ואותו דיווח אומר שהמספר עשוי להשתנות. אפילו בנפח כולל של טריליון אחד, הוא יפגר בגודל הגולמי אחרי Kimi K3 (2.8T) ו-Qwen3.8-Max (2.4T); מספר הפרמטרים הפעילים – שעדיין לא דלף – הוא המספר שיקבע את העלות והמהירות.
האם כדאי לי להמתין ל-Nemotron 4 לפני בחירת מודל?
לא. זה במרחק חודשים במקרה הטוב, ולא מוכח. בחר את המודל הזמין הטוב ביותר למשימה עכשיו, ושמור על שכבת הניתוב גמישה; כש-Nemotron 4 יופץ בפועל, הערך אותו באותה דרך שבה היית מעריך כל מודל חדש — פרמטרים פעילים, מדדי ביצועים עצמאיים, רישיון ומחיר — ולא על פי המספר הכולל בכותרת.
השורה התחתונה
המשפחה אמיתית; המספרים הם הערכות. NVIDIA אישרה שהיא בונה את Nemotron 4, והמבנה הקואליציוני סביבו הוא החלק המעניין ביותר בסיפור — אבל כל נתון כותרי בהדלפה, מהרף של טריליון פרמטרים ועד ללוח הזמנים של סוף הסתיו ועד לתקציב של 28 מיליארד דולר, מגיע מעובדים אנונימיים ועשוי להשתנות. חזית המשקל הפתוח כבר חצתה את רף הטריליון פרמטרים, בהובלת מעבדות סיניות, והתגובה של NVIDIA היא מודל בסיס קונסורציאלי加上 הבטחה. עבור קורא שבוחר מודלים היום, זה אומר דבר אחד: אל תתכנן סביב ההדלפה. שמור על שכבת ה-inference גמישה, הערך כל מה שיוצא על פי המספרים האמיתיים שלו, ותן ל-routing לעשות את מה ש-routing נועד לעשות — לנסות את הדבר החדש בלי להמר על נתיב הייצור עליו.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
