
Nemotron 4 รั่วไหล: คำตอบน้ำหนักเปิดพารามิเตอร์ 1 ล้านล้านของ NVIDIA ต่อโมเดลระดับแนวหน้า
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 143 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Nemotron 4 ยังไม่เปิดตัว แต่ในสัปดาห์นี้ มันไม่ใช่เพียงข่าวลือเรื่องจำนวนพารามิเตอร์อีกต่อไป วอลล์สตรีทเจอร์นัลรายงานเมื่อวันที่ 22 สิงหาคม 2026 โดยอ้างอิงแหล่งข่าวที่ใกล้ชิดกับเรื่อง ว่า NVIDIA ใช้เงินประมาณ 6 พันล้านดอลลาร์เพื่อพัฒนา Nemotron 4 ให้เป็นหนึ่งในโมเดล AI แบบเปิดน้ำหนักที่ทรงพลังที่สุดในโลก และแผนดังกล่าวรวมถึงการได้รับสิทธิ์ใช้งานแบบไม่ผูกขาดในเทคโนโลยีการฝึกโมเดลของสตาร์ทอัพ AI อย่าง Poolside รวมถึงการย้ายวิศวกรของ Poolside มากกว่า 100 คนเข้าสู่โครงการ Nemotron 4 ซึ่งต่อยอดมาจากข่าวรั่วก่อนหน้านี้จาก The Information เมื่อวันที่ 11 สิงหาคม ที่ว่าเรือธงของตระกูลนี้จะมีพารามิเตอร์อย่างน้อย 1 ล้านล้านตัว เมื่อรวมกันแล้ว รายงานทั้งสองฉบับบ่งบอกถึงความพยายามที่จริงจังที่สุดของ NVIDIA เท่าที่เคยมีมาในการก้าวขึ้นสู่จุดสูงสุดของวงการโมเดลแบบเปิดน้ำหนัก
ยังไม่มีสิ่งใดในส่วนนี้ที่ถูกปล่อยออกมา และทุกอย่างยังไม่ได้รับการยืนยัน NVIDIA ยอมรับว่ากำลังพัฒนาโมเดลตระกูล Nemotron 4 แต่ยังไม่ยืนยันเป้าหมายจำนวนพารามิเตอร์ ไทม์ไลน์ แผนการออกใบอนุญาตและการจ้างงานที่ WSJ อ้างอิงจากบุคคลที่ใกล้ชิดกับดีล หรือรายละเอียดพันธมิตรที่ The Information อ้างอิงจากพนักงานที่ไม่เปิดเผยชื่อ ให้ถือว่าตัวเลขทุกตัวในบทความนี้เป็น "ตัวเลขจากรายงาน" ไม่ใช่ "ตัวเลขที่ยืนยันแล้ว" จุดประสงค์ของบทความข่าวหลุดคือการแยกแกนกลางที่ได้รับการยืนยันเพียงเล็กน้อยออกจากขอบเขตข้อมูลที่รายงานเข้ามาเป็นวงกว้าง — และเพื่อชี้ให้เห็นว่าส่วนไหนสำคัญเมื่อสเปกจริงถูกเปิดเผย
เจาะลึกการรั่วไหลในบรรทัดเดียว
ก่อนอื่น เรื่องชื่อ เพราะมันอาจทำให้คุณสับสนในผลการค้นหา: NVIDIA ได้เปิดตัวโมเดลที่ชื่อ Nemotron-4-340B แล้วในเดือนมิถุนายน 2024 Nemotron 4 ตัวใหม่เป็นตระกูลที่แตกต่างและใหญ่กว่า — เป็นผู้สืบทอดของสาย Nemotron 3 (Nano, Super, Ultra) ที่เปิดตัวในปีนี้ — โดยใช้ชื่อ "Nemotron 4" ซ้ำสำหรับรุ่นถัดจากนั้น บทความนี้พูดถึงตัวใหม่
สิ่งที่ The Information รายงานจริง: NVIDIA กำลังพัฒนา Nemotron 4 เป็นตระกูลโมเดลโอเพนซอร์สที่มุ่งสู่จุดสูงสุดของลีดเดอร์บอร์ด open-weight และเรือธงคาดว่าจะมี "พารามิเตอร์อย่างน้อย 1 ล้านล้านตัว" NVIDIA ยังไม่ได้กำหนดวันวางจำหน่าย ยังไม่ได้เริ่มการฝึกขั้นสุดท้าย — กระบวนการที่พนักงานคาดว่าจะใช้เวลาหลายเดือน — และได้กำหนดเพียงข้อมูลก่อนการฝึกและสถาปัตยกรรมเท่านั้น สเปกยังมีการเปลี่ยนแปลงอยู่ พนักงานสองคนกล่าวว่าตระกูลนี้อาจพร้อมได้เร็วสุดในช่วงปลายฤดูใบไม้ร่วง ขณะที่คนอื่นคาดว่าจะช้ากว่านั้น
รายงานฉบับเดียวกันมีงบประมาณแยกแนบมาด้วย: ข้อตกลงบริการคลาวด์แบบหลายปีมูลค่ารวมประมาณ 28 พันล้านดอลลาร์สหรัฐ ซึ่งมีระยะเวลาไปจนถึงต้นปี 2031 คิดเป็นประมาณสามเท่าของที่ NVIDIA เคยเปิดเผยเมื่อปีก่อน โดยมีประมาณ 7 พันล้านดอลลาร์สหรัฐอยู่ในปีงบประมาณปัจจุบัน ตัวเลขดังกล่าวครอบคลุมภาระผูกพันด้านการคำนวณ ไม่ใช่ข้อตกลงใหม่ที่มีรายงานในสัปดาห์นี้ รายงานยังตั้งข้อสังเกตอีกว่าบทความวิจัยของรุ่นเรือธงก่อนหน้าระบุผู้เขียนไว้ 570 คน และ Nemotron 4 เกี่ยวข้องมากกว่านั้น — อดีตพนักงานคนหนึ่งบอกกับ The Information ว่า "ทุกคนอยากมีส่วนร่วม" ทั้งหมดนี้ NVIDIA ไม่ได้เปิดเผย

สัปดาห์นี้: ข้อตกลงมูลค่า 6 พันล้านดอลลาร์ของ Poolside เพื่อทำให้ Nemotron 4 เป็นจริง
วอลล์สตรีทเจอร์นัลรายงานในสัปดาห์นี้ว่าแผนของ NVIDIA สำหรับ Nemotron 4 ไม่ใช่แค่โครงการวิจัยเท่านั้น — แต่เป็นการสร้างที่ได้รับเงินทุนจริง ตามรายงานของ WSJ ซึ่งอ้างอิงผู้ที่เกี่ยวข้องกับเรื่องนี้ NVIDIA จะจ่ายเงินประมาณ 6 พันล้านดอลลาร์สหรัฐสำหรับใบอนุญาตแบบไม่ผูกขาดสำหรับ "Model Factory" ของ Poolside ซึ่งเป็นระบบฝึกอบรมและประเมินผลที่อยู่เบื้องหลังโมเดลเขียนโค้ด Laguna แบบ open-weight ของ Poolside และจะยื่นข้อเสนอการจ้างงานให้กับพนักงานของ Poolside มากกว่า 100 คน — มีรายงานว่าจำนวน 109 คน ซึ่งส่วนใหญ่เป็นวิศวกร — เพื่อทำงานในโครงการ Nemotron บลูมเบิร์กรายงานแยกต่างหากว่า NVIDIA จะลงทุนเพิ่มอีก 1 พันล้านดอลลาร์สหรัฐใน Poolside ที่การประเมินมูลค่าก่อนการลงทุน (pre-money valuation) ตามรายงานที่ 12 พันล้านดอลลาร์สหรัฐ ทำให้ยอดผูกพันรวมที่รายงานของ NVIDIA อยู่ที่ประมาณ 7 พันล้านดอลลาร์สหรัฐ
นี่ไม่ใช่การเข้าซื้อกิจการ ใบอนุญาตเป็นแบบไม่ผูกขาด ผู้ก่อตั้ง Poolside ยังคงอยู่ และ Poolside ยังคงดำเนินงานเป็นบริษัทอิสระ ตามรายงาน Poolside วางแผนที่จะแจกจ่ายเงินค่าลิขสิทธิ์ 6 พันล้านดอลลาร์ให้แก่นักลงทุน เรื่องนี้ปรากฏครั้งแรกผ่าน Newcomer เมื่อวันที่ 20 สิงหาคม และได้รับการยืนยันโดย Bloomberg ในวันที่ 21 สิงหาคม และ WSJ ในวันที่ 22 สิงหาคม — ทั้งหมดยังเป็นเพียง "รายงาน" ไม่มีสิ่งใดที่ NVIDIA หรือ Poolside ยืนยัน
เหตุผลที่ดีลนี้สำคัญกว่าตัวเลขในพาดหัวก็คือ มันทำให้โครงการ Nemotron 4 ได้ทีมที่เคยส่งมอบโมเดลแบบเปิดน้ำหนักจริง ๆ มาแล้ว กลุ่มโมเดล Laguna ของ Poolside เป็นไลน์อัปโมเดลเปิดสำหรับเขียนโค้ดที่พิสูจน์แล้ว และเป้าหมายที่รายงานไว้ — การปล่อย Nemotron ภายในเวลาประมาณหนึ่งปีที่สามารถแข่งขันกับโมเดลระดับแนวหน้าที่แข็งแกร่งที่สุดได้ — เป็นกรอบเวลาที่เป็นรูปธรรมครั้งแรกที่มีใครผูกไว้กับโครงการนี้ รายงานต่าง ๆ มองว่าการเคลื่อนไหวครั้งนี้คือคำตอบของ NVIDIA ต่อผู้นำโมเดลเปิดในจีน โดยเฉพาะ DeepSeek และ Kimi K3 ของ Moonshot AI และในวาทกรรมเปิดปะทะปิด ก็มองว่าเป็นการป้องกันความเสี่ยงจากแล็บปิดของสหรัฐฯ
โครงสร้างก็สำคัญเช่นกัน ใบอนุญาตแบบไม่ผูกขาดหมายความว่า Poolside ยังคงความเป็นเจ้าของทรัพย์สินทางปัญญาของตน และสามารถอนุญาตให้ผู้อื่นใช้เทคโนโลยีเดียวกันได้ — NVIDIA กำลังซื้อความสามารถและบุคลากร ไม่ใช่ความเป็นเจ้าของ นักวิเคราะห์มองว่านี่คือความพยายามของ NVIDIA ที่จะทำให้ชั้นโมเดลกลายเป็นสินค้าทั่วไป: หากโมเดลแบบเปิดน้ำหนักยังแข็งแกร่งและมีราคาถูก ความต้องการก็จะไหลไปยังชั้นที่ NVIDIA ควบคุม นั่นคือ GPU ดังที่ซีอีโอของ LMArena อนาสตาซิโอส แองเจโลปูลอส กล่าวไว้ในรายงานก่อนหน้านี้: "ไม่ว่าบริษัทใดจะสร้างโมเดลโอเพนซอร์สที่ยอดเยี่ยมได้ NVIDIA ก็เป็นฝ่ายชนะ"
ทำไมตัวเลขขนาดถึงเป็นส่วนที่น่าสนใจน้อยที่สุด
เรื่องราวที่ชัดเจนคือ "NVIDIA กำลังเดินหน้าสู่พารามิเตอร์ระดับล้านล้าน" แต่เรื่องที่ชัดเจนน้อยกว่าคือ แนวหน้าโอเพนเวทไปถึงจุดนั้นก่อน Kimi K3 เปิดเผยน้ำหนักโมเดลเมื่อวันที่ 27 กรกฎาคม ด้วยพารามิเตอร์รวม 2.8 ล้านล้าน — มีแอ็กทีฟประมาณ 104 พันล้านต่อโทเคนในรูปแบบ mixture-of-experts — ส่วน Qwen3.8 Max ของอาลีบาบา ซึ่งเปิดตัวเมื่อวันที่ 19 กรกฎาคม เป็นโมเดลพารามิเตอร์รวม 2.4 ล้านล้าน โดยมีแอ็กทีฟประมาณ 95 พันล้าน เมื่อเทียบกับรุ่นเรือธง Nemotron 4 ที่ "อย่างน้อย 1 ล้านล้าน" จะเพิ่มเป็นสองเท่าของ Nemotron 3 Ultra แต่ก็ยังตามหลังผู้นำด้านขนาด และผู้นำทั้งสองรายนั้นเป็นบริษัทจีน

นั่นทำให้การมองที่จำนวนพารามิเตอร์รวมเป็นมุมมองที่ผิดโดยสิ้นเชิง ในโมเดลแบบ mixture-of-experts สิ่งที่กำหนดต้นทุนและความเร็วคือจำนวนพารามิเตอร์ที่ใช้งานจริงต่อโทเคน ไม่ใช่จำนวนรวมที่โฆษณาไว้ Nemotron 4 ที่มีพารามิเตอร์รวม 1 ล้านล้าน อาจมีพารามิเตอร์ที่ใช้งานจริงประมาณ 1 แสนล้าน ซึ่งอยู่ในระดับเดียวกันกับ Kimi K3 และ Qwen3.8 Max หรืออาจเป็นครึ่งหนึ่งของนั้นก็ได้ ตัวเลขที่จะหลุดออกมาต่อไปคือตัวเลขที่สำคัญ และมันยังไม่หลุดออกมา

อีกทิศทางหนึ่งก็น่าจับตามองเช่นกัน: DeepSeek V4-Flash ซึ่งเปิดตัวเมื่อวันที่ 31 กรกฎาคมภายใต้สัญญาอนุญาต MIT กลับมาในแนวทางตรงกันข้าม — มีพารามิเตอร์รวม 284 พันล้าน แต่มุ่งเน้นที่เรื่องราคามากกว่าขนาด โดยมีต้นทุนโดยประมาณราว $0.14 ต่อล้านโทเค็นอินพุต ตลาดกำลังให้รางวัลกับทั้งสองสุดขั้วนี้ ขนาดไม่ใช่กลยุทธ์ทั้งหมด มันเป็นเพียงหนึ่งในกลยุทธ์เท่านั้น
จุดยืนของ NVIDIA อธิบายการตัดสินใจครั้งนี้ The Information รายงานว่า Nemotron 3 Ultra ครองอันดับสองในบรรดาโมเดลโอเพนเวตของสหรัฐฯ — รองจาก Inkling ของ Thinking Machines — และอยู่นอกกลุ่มชั้นนำของลีดเดอร์บอร์ดโอเพนทั่วโลก Nemotron 4 คือความพยายามที่จะกลับเข้าสู่วงสนทนาของโมเดลระดับแนวหน้าอีกครั้ง และผู้บริหารของ NVIDIA เองก็วางกรอบว่าเป็นหมากเชิงอธิปไตย: Kari Briski รองประธานฝ่าย generative AI กล่าวว่า NVIDIA ลงทุนใน Nemotron เพราะ "ทุกบริษัทและทุกประเทศต้องการโมเดลโอเพนซอร์สระดับแนวหน้าที่เข้าถึงได้ เพื่อเสริมสร้างความปลอดภัยและความมั่นคง เร่งนวัตกรรม และมอบรากฐานที่พวกเขาสามารถพึ่งพาได้จากรุ่นสู่รุ่น" Jensen Huang ได้กล่าวถึงเรื่องเดียวกันบน X โดยให้เหตุผลว่าโมเดลโอเพน "เสริมสร้างความปลอดภัยและความมั่นคงทางไซเบอร์ เร่งนวัตกรรมและการแพร่หลาย และทำให้เกิดอธิปไตย" ความตึงเครียดเชิงโครงสร้างมีจริง — มีรายงานว่า NVIDIA ถือหุ้นใน OpenAI มูลค่าราว 3 หมื่นล้านดอลลาร์ — แต่เดิมพันคือโมเดลโอเพนจะขยายขนาดตลาด GPU แทนที่จะหดตัวลง
พันธมิตร Nemotron คือฝ่ายที่ต้องจับตามอง
Nemotron 4 ไม่ใช่โปรเจกต์เดี่ยว และดีลกับ Poolside ก็ไม่ใช่โครงสร้างเดียวที่อยู่รอบ ๆ มัน ในการประชุม GTC เมื่อวันที่ 16 มีนาคม 2026 NVIDIA ประกาศก่อตั้ง Nemotron Coalition — สมาชิกผู้ร่วมก่อตั้งแปดราย: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam และ Thinking Machines Lab — ซึ่งรวมตัวกันเพื่อรวบรวมงานวิจัย ข้อมูล และพลังประมวลผลไว้เบื้องหลัง "โมเดลเปิดระดับแนวหน้า" โปรเจกต์แรกของกลุ่มคือโมเดลฐานที่พัฒนาโดย Mistral AI และ NVIDIA ร่วมกัน ฝึกด้วย NVIDIA DGX Cloud ซึ่งกลุ่มระบุว่าจะเปิดเป็นโอเพนซอร์สและจะเป็นรากฐานของตระกูล Nemotron 4
The Information เพิ่มรายละเอียดการทำงาน: Reflection, Cursor, Thinking Machines และ Mistral ได้รับการยืนยันว่าเป็นผู้มีส่วนร่วม; Prime Intellect บริจาคสภาพแวดล้อมจำลอง 300,000 สภาพแวดล้อมสำหรับการฝึกอบรม; Cognition ได้หารือถึงการจัดหาข้อมูลฝึกอบรมสำหรับโค้ด ซีอีโอของ Prime Intellect อย่าง Vincent Weisser มองการรวมกลุ่มครั้งนี้ว่าเป็นการลงมือร่วมกันเพื่อต่อต้านสิ่งที่เขาเรียกว่าการผูกขาดของโมเดล "ดุจเทพเจ้า" เพียงหนึ่งเดียว ในเชิงปฏิบัติการแล้ว นี่หมายความว่า Nemotron 4 อาจเปิดตัวในฐานะรากฐานของกลุ่มพันธมิตร ที่สมาชิกแต่ละรายนำไปปรับฝึกต่อ (post-train) เพื่อผลิตภัณฑ์ของตนเอง แทนที่จะเป็น checkpoint จากผู้ขายรายใดรายหนึ่ง ซึ่งจะทำให้ "โมเดล NVIDIA แบบเปิดน้ำหนัก" เป็นหมวดหมู่ที่ไม่ถูกต้อง — เพราะตัวฐานต่างหากคือสิ่งที่น่าสนใจ
ข้อตกลงกับ Poolside เข้ามาเสริมในเรื่องทั้งหมดนั้น กลุ่มพันธมิตรรวบรวมงานวิจัยและการประมวลผล ส่วนข้อตกลงแบบไลเซนส์และจ้างงานนำเข้ามาซึ่งโรงงานโมเดลที่ทำงานได้จริงและทีมงานที่เคยปล่อยโมเดลแบบโอเพนเวต หากรายงานเป็นจริง NVIDIA กำลังประกอบ Nemotron 4 จากสามแหล่งพร้อมกัน นั่นคือ ฝ่ายฝึกอบรมของตัวเอง ฐานของกลุ่มพันธมิตร และระบบการผลิตของ Poolside ซึ่งมีรูปแบบที่แตกต่างจากการปล่อยเช็คพอยต์เดียวใดๆ
ยืนยันแล้ว, รายงานแล้ว, ไม่ทราบ
• ยืนยันแล้ว — NVIDIA กำลังพัฒนาตระกูล Nemotron 4 (แถลงการณ์ของบริษัท) Nemotron Coalition มีอยู่จริงและกำลังสร้างโมเดลพื้นฐานแบบเปิดร่วมกับ Mistral AI (NVIDIA, มีนาคม 2026)
• รายงานที่ยังไม่ได้รับการยืนยัน — เป้าหมายเรือธงที่ "อย่างน้อย 1 ล้านล้าน" และกรอบเวลาช่วงปลายฤดูใบไม้ร่วง รวมถึงข้อผูกพันด้านคลาวด์มูลค่าประมาณ 28 พันล้านดอลลาร์ โดยใช้ประมาณ 7 พันล้านดอลลาร์ในปีงบประมาณนี้ (The Information); งบประมาณการก่อสร้างประมาณ 6 พันล้านดอลลาร์ตามรายงานของ WSJ, ใบอนุญาต "Model Factory" แบบไม่ผูกขาดจาก Poolside และวิศวกรของ Poolside กว่า 100 คนเข้าร่วมโครงการ Nemotron; การลงทุน 1 พันล้านดอลลาร์ของ NVIDIA ใน Poolside ตามรายงานของ Bloomberg ที่มูลค่าประเมินก่อนการลงทุนประมาณ 12 พันล้านดอลลาร์; สมาชิกแต่ละรายของกลุ่มพันธมิตรสนับสนุนอะไรบ้าง
• ไม่ทราบ — จำนวนพารามิเตอร์ที่ใช้งานจริง ความยาวบริบท ส่วนผสมของโมดาลิตี เงื่อนไขใบอนุญาต ราคา เช็คพอยต์ใดที่ปล่อยออกมาก่อน ฐานที่พัฒนาร่วมกับ Mistral จะกลายเป็นรากฐานของตระกูลจริงหรือไม่ และข้อตกลงกับ Poolside มีโครงสร้างตามที่รายงานหรือไม่ (ทั้งสองบริษัทไม่ได้ให้ความเห็น)
ไทม์ไลน์และสิ่งที่ควรดู
ยังไม่มีวันวางจำหน่ายอย่างเป็นทางการ การฝึกเทรนครั้งสุดท้ายยังไม่ได้เริ่มต้น พนักงานระบุว่าอาจใช้เวลานานหลายเดือน และประมาณการอยู่ในช่วงตั้งแต่ "ปลายฤดูใบไม้ร่วง" (จากสองแหล่งข้อมูล) ไปจนถึงช่วงเวลาที่ช้ากว่านั้น รายงานของ Poolside เพิ่มกรอบเวลาที่เป็นรูปธรรมครั้งแรกที่มีการอ้างอิงถึงโครงการนี้ โดยจากรายงาน เป้าหมายคือการเปิดตัวภายในระยะเวลาประมาณหนึ่งปี ซึ่งสามารถแข่งขันกับโมเดลระดับแนวหน้าที่แข็งแกร่งที่สุดได้ ในระหว่างนั้น NVIDIA ยังคงผลักดันตระกูลโมเดลนี้ต่อไป โดยได้เปิดตัว Nemotron 3.5 Lightning เอเจนต์เวิร์กเกอร์ที่มีพารามิเตอร์ 31.6B ซึ่งเปิดตัวเมื่อวันที่ 11 สิงหาคม — วันเดียวกับที่รายงานของ Nemotron 4 ถูกเปิดเผย — พร้อมกับ NeMo Switchyard ซอฟต์แวร์จัดเส้นทางโอเพนซอร์สที่พัฒนาโดย NVIDIA เอง
สิ่งที่ควรดู เรียงตามลำดับความสำคัญคร่าวๆ:
• พารามิเตอร์ที่ใช้งานจริง — ยอดรวมคือตัวเลขหลัก; จำนวนที่ใช้งานจริงเป็นตัวกำหนดต้นทุนและความเร็ว MoE ที่มีพารามิเตอร์รวม ~1T แต่ใช้งานจริง ~100B เปลี่ยนภาพรวมทั้งหมดเมื่อเทียบกับตัวที่ใช้งานจริง ~50B
การผสานรวมกับ Poolside — ไม่ว่าใบอนุญาตของ Model Factory และทีมใหม่จะปรับเปลี่ยนแผนการฝึกอบรมและบีบระยะเวลาที่รายงานไว้ให้สั้นลงจริง หรือว่าการสรรหาบุคลากรต่างหากที่ทำให้แผนยังคงเดิม
• คะแนนอิสระ — ยังไม่มีการประเมินจากบุคคลที่สามสำหรับโมเดลที่ยังไม่ได้รับการฝึกฝน จับตาดูดัชนี Artificial Analysis Intelligence Index เมื่อมี checkpoint ที่โฮสต์ไว้ปรากฏขึ้น
• ข้อกำหนดใบอนุญาต — Nemotron 3 Ultra เผยแพร่ภายใต้ OpenMDW-1.1 ซึ่งอนุญาตให้ใช้ได้อย่างเสรี แต่ไม่ใช่ MIT หรือ Apache 2.0 ยังไม่มีการตัดสินใจว่า Nemotron 4 จะปฏิบัติตามหรือทำให้เข้มงวดขึ้น และสำหรับบริษัทที่สร้างบนน้ำหนักเหล่านั้น มันตัดสินใจทุกอย่าง
• ขนาดใดจะจัดส่งก่อน — Nemotron 3 เปิดตัวเป็นตระกูล (Nano, Super, Ultra) คาดว่า Nemotron 4 จะมีหลายขนาด และคาดว่ารุ่นเล็กจะออกมาก่อนรุ่นเรือธง
ฐาน Mistral — ไม่ว่าโมเดลพื้นฐานของกลุ่มพันธมิตรจะกลายเป็นรากฐานของตระกูลจริงหรือไม่ คือคำถามเชิงโครงสร้างที่อยู่เบื้องหลังการพูดถึงพารามิเตอร์ทั้งหมด
• ราคา — ไม่มีการโฮสต์อะไร ดังนั้นจึงไม่มีการตั้งราคา เมื่อพันธมิตรโฮสต์แสดงรายการ Nemotron 4 ราคาที่ส่งผ่านคือสิ่งที่คุณจะจ่ายจริง
มันหมายความว่าอย่างไรสำหรับเลเยอร์การอนุมานของคุณ
คุณไม่สามารถเรียกใช้ Nemotron 4 ได้ในวันนี้ — ไม่มีใครทำได้ — และรายงานของ Poolside แม้จะดูน่าตื่นเต้นเพียงใดก็ไม่เปลี่ยนข้อเท็จจริงนั้น คำถามเชิงปฏิบัติยังคงอยู่ที่ว่าสแต็กของคุณต้องปรับเปลี่ยนมากเพียงใดเพื่อรองรับโมเดลที่สเปกยังไม่นิ่ง คำตอบก็เหมือนกับโมเดลระดับแนวหน้าที่ยังไม่ได้เปิดตัวทุกรุ่น: ทำให้เลเยอร์อินเฟอเรนซ์เป็นแบบไม่ผูกติดกับโมเดล (model-agnostic) หากคุณเรียกผ่าน API ตัวเดียวที่เชื่อมต่อโมเดล 200+ ตัว ตระกูล Nemotron ใหม่ก็เป็นเพียงการเปลี่ยนคอนฟิก ไม่ใช่การเขียนใหม่ทั้งหมด OrcaRouter ส่งผ่านราคาลิสต์ของผู้ให้บริการโดยมีมาร์กอัป 0% ดังนั้นไม่ว่าท้ายที่สุดผู้ให้บริการโฮสต์จะเรียกเก็บค่าบริการ Nemotron 4 เท่าใด คุณก็จ่ายเท่านั้น และการลดราคาของผู้จำหน่ายจะมีผลในวันเดียวกับที่ประกาศ การเฟลโอเวอร์อัตโนมัติคือเครื่องมือสำหรับการเปิดตัวครั้งแรกที่ยังไม่ผ่านการพิสูจน์: ส่งทราฟฟิกช่วงแรกไปที่โมเดลใหม่ เปลี่ยนกลับไปใช้ทางเลือกที่เสถียรเมื่อมันหยุดชะงักหรือเกิดข้อผิดพลาด และเลื่อนขึ้นสู่โปรดักชันหลังจากที่มันพิสูจน์แล้วว่าคู่ควรกับเวิร์กโหลดของคุณเท่านั้น ไม่มีสิ่งใดในนี้ที่ต้องเดิมพันเส้นทางโปรดักชันกับข้อมูลหลุด — ซึ่งเป็นจุดยืนที่ถูกต้องที่สุดเมื่อสเปกยังไม่เป็นทางการขนาดนี้
คำถามที่พบบ่อย
Nemotron 4 จะเปิดตัวเมื่อไหร่?
ยังไม่มีการกำหนดวันที่ พนักงานบอกกับ The Information ว่าการฝึกอบรมรอบสุดท้ายยังไม่เริ่ม และจะใช้เวลาหลายเดือน สองคนกล่าวว่าปลายฤดูใบไม้ร่วงปี 2026 อาจเป็นไปได้ ขณะที่คนอื่นคาดว่าจะช้ากว่านั้น รายงานสัปดาห์นี้เพิ่มเป้าหมายที่รายงานไว้สำหรับการเปิดตัวที่แข่งขันได้ระดับแนวหน้าภายในเวลาประมาณหนึ่งปี แต่ก็ยังไม่มีวันที่แน่นอน ถือว่าทั้งสองเป็นเพียงการประมาณการจากภายในโครงการ ไม่ใช่แผนงาน
Nemotron 4 จะเป็นโอเพนซอร์สหรือไม่?
NVIDIA ระบุเจตนารมณ์ไว้ว่าเป็น open weights, {{1}}และโครงการแรกของ Nemotron Coalition ซึ่งเป็นโมเดลพื้นฐานที่พัฒนาร่วมกับ Mistral นั้น ถูกให้คำมั่นว่าจะเปิดเป็นโอเพนซอร์ส.{{/1}} แต่ "open weights" ไม่ใช่ "open source": {{2}}Nemotron 3 Ultra เผยแพร่ภายใต้ไลเซนส์ OpenMDW-1.1 ซึ่งอนุญาตให้ใช้ได้กว้างกว่าเงื่อนไขเดิมของ NVIDIA แต่ก็ยังไม่ใช่ MIT หรือ Apache 2.0.{{/2}} {{3}}ยังไม่มีการประกาศไลเซนส์เฉพาะของ Nemotron 4.{{/3}}
รายงานข้อตกลงมูลค่า 6 พันล้านดอลลาร์กับ Poolside ได้รับการยืนยันแล้วหรือไม่?
ไม่ หนังสือพิมพ์ WSJ รายงานเมื่อวันที่ 22 สิงหาคมว่า มีการจ่ายค่าลิขสิทธิ์ประมาณ 6 พันล้านดอลลาร์ และวิศวกรของ Poolside กว่า 100 คนจะเข้าร่วมโครงการ Nemotron โดยอ้างอิงแหล่งข่าวที่เกี่ยวข้อง ส่วน Bloomberg รายงานว่ามีการลงทุนเพิ่มอีก 1 พันล้านดอลลาร์ Newcomer รายงานเป็นคนแรกเมื่อวันที่ 20 สิงหาคม ทั้ง NVIDIA และ Poolside ยังไม่ได้ยืนยันข่าวใดๆ ทั้งสิ้น มีรายงานว่าลิขสิทธิ์ดังกล่าวเป็นแบบไม่ผูกขาด และ Poolside จะยังคงเป็นบริษัทอิสระต่อไป
“อย่างน้อย 1 ล้านล้านพารามิเตอร์” เป็นสเปกจริงหรือ?
มันเป็นเป้าหมายที่มาจากแหล่งข้อมูลที่เป็นพนักงาน รายงานโดย The Information ไม่ใช่สเปกที่ยืนยันแล้ว และรายงานเดียวกันยังกล่าวว่าจำนวนอาจเปลี่ยนแปลงได้ ถึงแม้จะมีทั้งหมด 1 ล้านล้าน ก็ยังตามหลัง Kimi K3 (2.8T) และ Qwen3.8 Max (2.4T) ในแง่ขนาดดิบ; จำนวนพารามิเตอร์ที่ใช้งานจริง — ซึ่งยังไม่มีการรั่วไหล — คือตัวเลขที่จะกำหนดต้นทุนและความเร็ว
ฉันควรรอ Nemotron 4 ก่อนเลือกโมเดลไหม?
ไม่ใช่ อย่างดีที่สุดมันก็ยังห่างออกไปอีกหลายเดือน และยังไม่ผ่านการพิสูจน์ {{1}}เลือกโมเดลที่ดีที่สุดที่มีอยู่ในตอนนี้สำหรับงานนี้ และทำให้เลเยอร์การจัดเส้นทางยังคงยืดหยุ่น{{/1}} {{2}}เมื่อ Nemotron 4 วางจำหน่ายจริง ให้ประเมินมันแบบเดียวกับที่คุณจะประเมินโมเดลใหม่ตัวใดก็ได้{{/2}} — {{3}}พารามิเตอร์ที่ใช้งานจริง เกณฑ์มาตรฐานอิสระ ใบอนุญาต และราคา{{/3}} — {{4}}แทนที่จะดูที่ตัวเลขรวมที่เป็นจุดขายหรือขนาดงบประมาณที่รายงาน{{/4}}
ประเด็นสำคัญ
ตระกูลเป็นเรื่องจริง ตัวเลขเป็นเพียงการประมาณ สัปดาห์นี้เรื่องราวเปลี่ยนรูปโฉม: Nemotron 4 ไม่ใช่แค่การรั่วไหลของพารามิเตอร์อีกต่อไป แต่เป็นโปรเจกต์ที่ได้รับทุนสนับสนุน มีรายงานว่า NVIDIA ใช้จ่ายประมาณ 6 พันล้านดอลลาร์ ซื้อลิขสิทธิ์ Model Factory ของ Poolside จ้างวิศวกรของบริษัทกว่า 100 คน และลงทุนเพิ่มอีก 1 พันล้านดอลลาร์ในบริษัท — ทั้งหมดเพื่อสร้างโมเดลเรือธงแบบ open-weight ที่เทียบเคียงได้กับ DeepSeek และ Kimi K3 ตัวเลขทุกตัวล้วนมาจากรายงานของสื่อ ยังไม่มีการยืนยันใด ๆ และยังไม่มีอะไรเปิดตัวจริง พรมแดน open-weight ก้าวข้ามระดับล้านล้านพารามิเตอร์ไปแล้ว และคำตอบของ NVIDIA คือโมเดลฐานจากกลุ่มพันธมิตร Model Factory ที่ซื้อลิขสิทธิ์ และคำมั่นสัญญา สำหรับผู้อ่านที่กำลังเลือกโมเดลในวันนี้ ยังคงหมายถึงสิ่งเดียว: อย่าวางแผนโดยยึดข่าวรั่วเป็นหลัก รักษาชั้น inference ให้ยืดหยุ่น ประเมินสิ่งที่เปิดตัวจริงด้วยตัวเลขจริง และปล่อยให้ routing ทำหน้าที่ของมัน — ลองสิ่งใหม่โดยไม่เดิมพันเส้นทางโปรดักชันกับมัน
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
