
Nemotron 4 รั่วไหล: คำตอบน้ำหนักเปิดพารามิเตอร์ 1 ล้านล้านของ NVIDIA ต่อโมเดลระดับแนวหน้า
- metaใหม่Meta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekใหม่DeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxใหม่MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น · 2278 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
- grokxAI: Grok 4.52026-07-0856ความฉลาด72การเขียนโค้ด
- tencentTencent: Hy32026-07-0642ความฉลาด59การเขียนโค้ด
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232ความฉลาด42การเขียนโค้ด
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226ความฉลาด39การเขียนโค้ด
- anthropicAnthropic: Claude Sonnet 52026-06-3055ความฉลาด72การเขียนโค้ด
- klingKling: Kling 3.0 Turbo2026-06-1757ความฉลาด52การเขียนโค้ด57คณิตศาสตร์
พารามิเตอร์ 1 ล้านล้าน นั่นคือตัวเลขขั้นต่ำที่รายงานสำหรับโมเดล Nemotron 4 ที่ใหญ่ที่สุด ซึ่งเป็นเรือธงของตระกูล open-weights รุ่นถัดไปของ NVIDIA — และตัวเลขนี้ฟังดูใหญ่ก็ต่อเมื่อคุณยังไม่ได้เทียบกับสิ่งที่วางจำหน่ายไปแล้ว ในเดือนที่ผ่านมา Moonshot AI เปิดตัว Kimi K3 ด้วยพารามิเตอร์รวม 2.8 ล้านล้าน Alibaba เปิดตัว Qwen3.8-Max ด้วยพารามิเตอร์ 2.4 ล้านล้าน และเรือธงปัจจุบันของ NVIDIA เองอย่าง Nemotron 3 Ultra อยู่ที่ 5.5 แสนล้าน The Information รายงานเมื่อวันที่ 11 สิงหาคม 2026 โดยอ้างอิงพนักงานหลายคนที่ทำงานในโปรเจกต์นี้ว่า Nemotron 4 คือคำตอบของ NVIDIA: ตระกูล open-weights ซึ่งโมเดลที่ใหญ่ที่สุดคาดว่าจะเริ่มต้นที่พารามิเตอร์ประมาณ 1 ล้านล้าน หรือประมาณสองเท่าของ Nemotron 3 Ultra
ยังไม่มีอะไรออกสู่ตลาดจริงในที่นี้ NVIDIA ยอมรับแล้วว่ากำลังสร้างตระกูล Nemotron 4 แต่ยังไม่ได้ยืนยันเป้าหมายพารามิเตอร์ งบประมาณ ไทม์ไลน์ หรือรายละเอียดพันธมิตรที่ The Information ระบุว่าเป็นของพนักงานนิรนาม ให้ถือว่าตัวเลขทุกตัวในบทความนี้เป็น 'ตัวเลขที่รายงาน' ไม่ใช่ 'ตัวเลขที่ระบุแน่นอน' จุดประสงค์ของการเขียนข่าวหลุดคือเพื่อแยกแกนกลางที่ยืนยันแล้วเพียงเล็กน้อยออกจากขอบเขตที่รายงานกว้างกว่า และบอกคุณว่าส่วนไหนสำคัญเมื่อเอกสารข้อมูลจำเพาะจริงออกมา
เจาะลึกการรั่วไหลในบรรทัดเดียว
ก่อนอื่น เรื่องชื่อ เพราะมันอาจทำให้คุณสับสนในผลการค้นหา: NVIDIA ได้เปิดตัวโมเดลที่ชื่อ Nemotron-4-340B แล้วในเดือนมิถุนายน 2024 Nemotron 4 ตัวใหม่เป็นตระกูลที่แตกต่างและใหญ่กว่า — เป็นผู้สืบทอดของสาย Nemotron 3 (Nano, Super, Ultra) ที่เปิดตัวในปีนี้ — โดยใช้ชื่อ "Nemotron 4" ซ้ำสำหรับรุ่นถัดจากนั้น บทความนี้พูดถึงตัวใหม่
สิ่งที่ The Information รายงานจริง: NVIDIA กำลังพัฒนา Nemotron 4 เป็นตระกูลโมเดลโอเพนซอร์สที่มุ่งสู่จุดสูงสุดของลีดเดอร์บอร์ด open-weight และเรือธงคาดว่าจะมี "พารามิเตอร์อย่างน้อย 1 ล้านล้านตัว" NVIDIA ยังไม่ได้กำหนดวันวางจำหน่าย ยังไม่ได้เริ่มการฝึกขั้นสุดท้าย — กระบวนการที่พนักงานคาดว่าจะใช้เวลาหลายเดือน — และได้กำหนดเพียงข้อมูลก่อนการฝึกและสถาปัตยกรรมเท่านั้น สเปกยังมีการเปลี่ยนแปลงอยู่ พนักงานสองคนกล่าวว่าตระกูลนี้อาจพร้อมได้เร็วสุดในช่วงปลายฤดูใบไม้ร่วง ขณะที่คนอื่นคาดว่าจะช้ากว่านั้น
รายงานฉบับเดียวกันแนบงบประมาณมาด้วย: {{1}}ประมาณ 28 พันล้านดอลลาร์ในข้อตกลงบริการคลาวด์แบบหลายปีที่ดำเนินไปจนถึงต้นปี 2031 ซึ่งคิดเป็นประมาณสามเท่าของที่ NVIDIA เปิดเผยเมื่อปีก่อน โดยมีประมาณ 7 พันล้านดอลลาร์ที่อยู่ในปีงบประมาณปัจจุบัน{{/1}} นอกจากนี้ยังระบุว่า {{2}}เอกสารวิจัยของเรือธงรุ่นก่อนหน้าระบุผู้เขียน 570 คน และ Nemotron 4 เกี่ยวข้องมากกว่านั้น{{/2}} — อดีตพนักงานคนหนึ่งบอกกับ The Information ว่า {{3}}"ทุกคนอยากมีส่วนร่วม"{{/3}} {{4}}ทั้งหมดนี้ NVIDIA ไม่ได้รายงาน{{/4}}

ทำไมตัวเลขขนาดถึงเป็นส่วนที่น่าสนใจน้อยที่สุด
เรื่องราวที่เห็นได้ชัดคือ "NVIDIA กำลังไปสู่ระดับล้านล้านพารามิเตอร์" ส่วนเรื่องที่เห็นได้ชัดน้อยกว่าคือ แนวหน้าโมเดลน้ำหนักเปิดไปถึงจุดนั้นก่อน Kimi K3 เปิดเผยน้ำหนักเมื่อวันที่ 27 กรกฎาคม ด้วยพารามิเตอร์รวม 2.8 ล้านล้าน — ใช้งานจริงประมาณ 104 พันล้านต่อโทเคนในรูปแบบ mixture-of-experts — และ Qwen3.8-Max ของ Alibaba ที่เปิดตัวเมื่อวันที่ 19 กรกฎาคม เป็นโมเดลที่มีพารามิเตอร์รวม 2.4 ล้านล้าน และใช้งานจริงประมาณ 95 พันล้าน เมื่อเทียบกับตัวเลขเหล่านี้ โมเดลเรือธง Nemotron 4 ที่ "อย่างน้อย 1 ล้านล้าน" จะเท่ากับสองเท่าของ Nemotron 3 Ultra แต่ยังคงตามหลังผู้นำด้านขนาด และผู้นำทั้งสองรายนั้นเป็นบริษัทจีน

นั่นทำให้จำนวนพารามิเตอร์รวมเป็นมุมมองที่ผิดโดยสิ้นเชิง ในแบบจำลองแบบ mixture-of-experts สิ่งที่กำหนดต้นทุนและความเร็วคือจำนวนพารามิเตอร์ที่ทำงานจริงต่อโทเคน ไม่ใช่ยอดรวมที่โฆษณา Nemotron 4 ที่มีพารามิเตอร์รวม 1 ล้านล้านอาจมีพารามิเตอร์ที่ทำงานจริงประมาณ 1 แสนล้าน — อยู่ในระดับเดียวกับ Kimi K3 และ Qwen3.8-Max — หรืออาจเป็นแค่ครึ่งหนึ่งของนั้น ตัวเลขที่จะหลุดออกมาถัดไปคือตัวเลขที่สำคัญ และมันยังไม่หลุดออกมา

อีกทิศทางหนึ่งก็น่าจับตามองเช่นกัน: DeepSeek V4-Flash ซึ่งเปิดตัวเมื่อวันที่ 31 กรกฎาคมภายใต้สัญญาอนุญาต MIT กลับมาในแนวทางตรงกันข้าม — มีพารามิเตอร์รวม 284 พันล้าน แต่มุ่งเน้นที่เรื่องราคามากกว่าขนาด โดยมีต้นทุนโดยประมาณราว $0.14 ต่อล้านโทเค็นอินพุต ตลาดกำลังให้รางวัลกับทั้งสองสุดขั้วนี้ ขนาดไม่ใช่กลยุทธ์ทั้งหมด มันเป็นเพียงหนึ่งในกลยุทธ์เท่านั้น
การเคลื่อนไหวครั้งนี้อธิบายได้จากสถานะของ NVIDIA The Information รายงานว่า Nemotron 3 Ultra อยู่ในอันดับสองในบรรดาโมเดลโอเพนเวตของสหรัฐฯ — รองจาก Inkling ของ Thinking Machines — และอยู่นอกกลุ่มชั้นนำของกระดานผู้นำโมเดลโอเพนระดับโลก Nemotron 4 คือความพยายามที่จะกลับเข้าสู่การพูดคุยในระดับแนวหน้าอีกครั้ง และผู้บริหารของ NVIDIA เองก็มองว่าเป็นเกมเชิงอธิปไตย: VP ของ AI เชิงสร้างสรรค์ Kari Briski กล่าวว่า NVIDIA ลงทุนใน Nemotron เพราะ "ทุกบริษัทและทุกประเทศต้องการโมเดลโอเพนซอร์สระดับแนวหน้าที่เข้าถึงได้ เพื่อเสริมสร้างความปลอดภัยและความมั่นคง เร่งนวัตกรรม และเป็นรากฐานที่พวกเขาวางใจได้จากรุ่นสู่รุ่น" Jensen Huang ได้กล่าวในทำนองเดียวกันบน X โดยโต้แย้งว่าโมเดลโอเพน "เสริมสร้างความปลอดภัยและความมั่นคงไซเบอร์ เร่งนวัตกรรมและการแพร่กระจาย และทำให้เกิดอธิปไตย" ความตึงเครียดเชิงโครงสร้างมีจริง — มีรายงานว่า NVIDIA ถือหุ้น OpenAI มูลค่าประมาณ 3 หมื่นล้านดอลลาร์ — แต่การเดิมพันคือโมเดลโอเพนจะขยายส่วนแบ่งตลาด GPU แทนที่จะทำให้หดเล็กลง ดังที่ CEO ของ LMArena อย่าง Anastasios Angelopoulos กล่าวว่า "ไม่ว่าบริษัทใดจะสร้างโมเดลโอเพนซอร์สที่ยอดเยี่ยม NVIDIA ก็ชนะเสมอ"
พันธมิตร Nemotron คือฝ่ายที่ต้องจับตามอง
Nemotron 4 ไม่ใช่โครงการเดี่ยว และนี่คือรายละเอียดที่สื่อส่วนใหญ่มองข้าม ในงาน GTC เมื่อวันที่ 16 มีนาคม 2026 NVIDIA ประกาศ Nemotron Coalition — สมาชิกผู้ร่วมก่อตั้งแปดราย: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam และ Thinking Machines Lab — ซึ่งรวมตัวกันเพื่อรวบรวมงานวิจัย ข้อมูล และพลังประมวลผลไว้เบื้องหลัง "โมเดลเปิดระดับแนวหน้า" โครงการแรกคือโมเดลพื้นฐานที่พัฒนาโดย Mistral AI และ NVIDIA ร่วมกัน ฝึกฝนบน NVIDIA DGX Cloud ซึ่งกลุ่มพันธมิตรกล่าวว่าจะเปิดเป็นโอเพนซอร์สและจะรองรับตระกูล Nemotron 4
The Information เพิ่มรายละเอียดการทำงาน: Reflection, Cursor, Thinking Machines และ Mistral ได้รับการยืนยันว่าเป็นผู้มีส่วนร่วม; Prime Intellect บริจาคสภาพแวดล้อมจำลอง 300,000 สภาพแวดล้อมสำหรับการฝึกอบรม; Cognition ได้หารือถึงการจัดหาข้อมูลฝึกอบรมสำหรับโค้ด ซีอีโอของ Prime Intellect อย่าง Vincent Weisser มองการรวมกลุ่มครั้งนี้ว่าเป็นการลงมือร่วมกันเพื่อต่อต้านสิ่งที่เขาเรียกว่าการผูกขาดของโมเดล "ดุจเทพเจ้า" เพียงหนึ่งเดียว ในเชิงปฏิบัติการแล้ว นี่หมายความว่า Nemotron 4 อาจเปิดตัวในฐานะรากฐานของกลุ่มพันธมิตร ที่สมาชิกแต่ละรายนำไปปรับฝึกต่อ (post-train) เพื่อผลิตภัณฑ์ของตนเอง แทนที่จะเป็น checkpoint จากผู้ขายรายใดรายหนึ่ง ซึ่งจะทำให้ "โมเดล NVIDIA แบบเปิดน้ำหนัก" เป็นหมวดหมู่ที่ไม่ถูกต้อง — เพราะตัวฐานต่างหากคือสิ่งที่น่าสนใจ
ยืนยันแล้ว, รายงานแล้ว, ไม่ทราบ
• ยืนยันแล้ว — NVIDIA กำลังพัฒนาตระกูล Nemotron 4 (แถลงการณ์ของบริษัท) Nemotron Coalition มีอยู่จริงและกำลังสร้างโมเดลพื้นฐานแบบเปิดร่วมกับ Mistral AI (NVIDIA, มีนาคม 2026)
• ที่รายงาน ยังไม่ได้รับการยืนยัน — เป้าหมายหลัก "อย่างน้อย 1 ล้านล้าน" ไทม์ไลน์ช่วงปลายฤดูใบไม้ร่วง; ข้อผูกพันด้านคลาวด์ประมาณ 2.8 หมื่นล้านดอลลาร์ โดยประมาณ 7 พันล้านดอลลาร์ในปีงบประมาณนี้; สมาชิกกลุ่มพันธมิตรแต่ละรายมีส่วนสนับสนุนอะไรบ้าง
• ไม่ทราบ — จำนวนพารามิเตอร์ที่ใช้งานจริง, ความยาวบริบท, การผสมผสานโมดาลิตี้, เงื่อนไขใบอนุญาต, ราคา, เช็คพอยต์ใดที่ปล่อยออกมาก่อน, และว่าฐานที่พัฒนาร่วมกับ Mistral จะกลายเป็นรากฐานของตระกูลนี้จริงหรือไม่
ไทม์ไลน์และสิ่งที่ควรดู
ยังไม่มีวันวางจำหน่าย การฝึกฝนรอบสุดท้ายยังไม่ได้เริ่มต้น พนักงานอธิบายว่าใช้เวลาหลายเดือน และประมาณการมีตั้งแต่ "ปลายฤดูใบไม้ร่วง" (สองแหล่งข้อมูล) ไปจนถึงหลังจากนั้น NVIDIA ยังคงเดินหน้าตระกูลโมเดลต่อไป: พวกเขาปล่อย Nemotron 3.5 Lightning เอเจนต์เวิร์กเกอร์ที่มีพารามิเตอร์ 31.6B วางจำหน่ายเมื่อวันที่ 11 สิงหาคม — วันเดียวกับที่รายงาน Nemotron 4 ถูกเปิดเผย — พร้อมกับ NeMo Switchyard ซอฟต์แวร์จัดเส้นทางโอเพนซอร์สของ NVIDIA เอง กล่าวอีกนัยหนึ่ง NVIDIA กำลังพัฒนารุ่นโมเดลอย่างต่อเนื่องในขณะที่รุ่นเรือธงยังอยู่ในขั้นตอนการออกแบบ
สิ่งที่ควรดู เรียงตามลำดับความสำคัญคร่าวๆ:
• พารามิเตอร์ที่ใช้งานจริง — ยอดรวมคือตัวเลขหลัก; จำนวนที่ใช้งานจริงเป็นตัวกำหนดต้นทุนและความเร็ว MoE ที่มีพารามิเตอร์รวม ~1T แต่ใช้งานจริง ~100B เปลี่ยนภาพรวมทั้งหมดเมื่อเทียบกับตัวที่ใช้งานจริง ~50B
• คะแนนอิสระ — ยังไม่มีการประเมินจากบุคคลที่สามสำหรับโมเดลที่ยังไม่ได้รับการฝึกฝน จับตาดูดัชนี Artificial Analysis Intelligence Index เมื่อมี checkpoint ที่โฮสต์ไว้ปรากฏขึ้น
• ข้อกำหนดใบอนุญาต — Nemotron 3 Ultra เผยแพร่ภายใต้ OpenMDW-1.1 ซึ่งอนุญาตให้ใช้ได้อย่างเสรี แต่ไม่ใช่ MIT หรือ Apache 2.0 ยังไม่มีการตัดสินใจว่า Nemotron 4 จะปฏิบัติตามหรือทำให้เข้มงวดขึ้น และสำหรับบริษัทที่สร้างบนน้ำหนักเหล่านั้น มันตัดสินใจทุกอย่าง
• ขนาดใดจะจัดส่งก่อน — Nemotron 3 เปิดตัวเป็นตระกูล (Nano, Super, Ultra) คาดว่า Nemotron 4 จะมีหลายขนาด และคาดว่ารุ่นเล็กจะออกมาก่อนรุ่นเรือธง
ฐาน Mistral — ไม่ว่าโมเดลพื้นฐานของกลุ่มพันธมิตรจะกลายเป็นรากฐานของตระกูลจริงหรือไม่ คือคำถามเชิงโครงสร้างที่อยู่เบื้องหลังการพูดถึงพารามิเตอร์ทั้งหมด
• ราคา — ไม่มีการโฮสต์อะไร ดังนั้นจึงไม่มีการตั้งราคา เมื่อพันธมิตรโฮสต์แสดงรายการ Nemotron 4 ราคาที่ส่งผ่านคือสิ่งที่คุณจะจ่ายจริง
มันหมายความว่าอย่างไรสำหรับเลเยอร์การอนุมานของคุณ
คุณไม่สามารถเรียกใช้ Nemotron 4 ได้ในวันนี้ — ไม่มีใครทำได้ — ดังนั้นคำถามเชิงปฏิบัติคือ สแต็กของคุณควรเปลี่ยนไปมากแค่ไหนเพื่อรองรับโมเดลที่สเปกยังคงขยับไปเรื่อย ๆ คำตอบก็เหมือนกับโมเดลแนวหน้าที่ยังไม่เปิดตัวอื่น ๆ: คงชั้นการอนุมานให้ไม่ยึดติดกับตัวโมเดล หากคุณใช้เส้นทางผ่าน API เดียวที่เชื่อมต่อโมเดลมากกว่า 200 รายการ ตระกูล Nemotron ใหม่ก็เป็นแค่การเปลี่ยนคอนฟิก ไม่ใช่การเขียนใหม่ OrcaRouter ส่งผ่านราคารายการของผู้ให้บริการโดยคิดมาร์กอัป 0% ดังนั้นไม่ว่าโฮสต์จะเรียกเก็บค่า Nemotron 4 เท่าใดในที่สุด คุณก็จ่ายเท่านั้น และการลดราคาจากผู้จำหน่ายก็มีผลในวันเดียวกัน การเฟลโอเวอร์อัตโนมัติคือเครื่องมือสำหรับการเปิดตัวครั้งแรกที่ยังไม่ผ่านการพิสูจน์: ชี้ทราฟฟิกช่วงแรกไปที่โมเดลใหม่ กลับไปใช้ทางเลือกที่เสถียรเมื่อมันค้างหรือเกิดข้อผิดพลาด และเลื่อนขึ้นเป็นโปรดักชันเฉพาะเมื่อมันทำงานได้กับโหลดของคุณ ไม่มีสิ่งใดต้องเดิมพันเส้นทางโปรดักชันกับข่าวหลุด — ซึ่งเป็นท่าทีที่ถูกต้องเมื่อสเปกชั่วคราวขนาดนี้
คำถามที่พบบ่อย
Nemotron 4 จะเปิดตัวเมื่อไหร่?
ยังไม่มีการกำหนดวันที่ พนักงานบอกกับ The Information ว่าการฝึกอบรมรอบสุดท้ายยังไม่ได้เริ่มและจะใช้เวลาอีกหลายเดือน สองคนกล่าวว่าปลายฤดูใบไม้ร่วงปี 2026 เป็นไปได้ ขณะที่คนอื่นๆ คาดว่าจะช้ากว่านั้น ให้ถือว่า "ปลายฤดูใบไม้ร่วง" เป็นการประมาณการเชิงหวังดีจากภายในโครงการ ไม่ใช่แผนงานที่ยืนยันแล้ว
Nemotron 4 จะเป็นโอเพนซอร์สหรือไม่?
NVIDIA ระบุเจตนารมณ์ไว้ว่าเป็น open weights, {{1}}และโครงการแรกของ Nemotron Coalition ซึ่งเป็นโมเดลพื้นฐานที่พัฒนาร่วมกับ Mistral นั้น ถูกให้คำมั่นว่าจะเปิดเป็นโอเพนซอร์ส.{{/1}} แต่ "open weights" ไม่ใช่ "open source": {{2}}Nemotron 3 Ultra เผยแพร่ภายใต้ไลเซนส์ OpenMDW-1.1 ซึ่งอนุญาตให้ใช้ได้กว้างกว่าเงื่อนไขเดิมของ NVIDIA แต่ก็ยังไม่ใช่ MIT หรือ Apache 2.0.{{/2}} {{3}}ยังไม่มีการประกาศไลเซนส์เฉพาะของ Nemotron 4.{{/3}}
“อย่างน้อย 1 ล้านล้านพารามิเตอร์” เป็นสเปกจริงหรือ?
เป็นเป้าหมายที่ได้จากแหล่งข่าวซึ่งเป็นพนักงาน รายงานโดย The Information ไม่ใช่สเปกที่ยืนยันแล้ว และรายงานฉบับเดียวกันบอกว่าจำนวนดังกล่าวอาจเปลี่ยนแปลงได้ แม้ที่ขนาดรวม 1 ล้านล้าน ก็ยังตามหลัง Kimi K3 (2.8T) และ Qwen3.8-Max (2.4T) ในแง่ขนาดดิบ ส่วนจำนวนพารามิเตอร์ที่ใช้งานจริง (active-parameter count) ซึ่งยังไม่มีการรั่วไหลออกมา เป็นตัวเลขที่จะกำหนดต้นทุนและความเร็ว
ฉันควรรอ Nemotron 4 ก่อนเลือกโมเดลไหม?
ไม่. มันยังห่างออกไปหลายเดือนอย่างดีที่สุด และยังไม่ได้รับการพิสูจน์ เลือกโมเดลที่ดีที่สุดที่มีอยู่สำหรับงานตอนนี้ และรักษาชั้นการจัดเส้นทางให้ยืดหยุ่น; เมื่อ Nemotron 4 วางจำหน่ายจริง ให้ประเมินมันแบบเดียวกับที่คุณจะประเมินโมเดลใหม่ใดๆ — พารามิเตอร์ที่ใช้งาน เกณฑ์มาตรฐานอิสระ สัญญาอนุญาต และราคา — มากกว่าที่จะดูจากยอดรวมที่โฆษณา
บรรทัดล่าง
{{1}}ครอบครัวนั้นมีจริง ตัวเลขเป็นเพียงการประมาณการ{{/1}} NVIDIA ยืนยันแล้วว่ากำลังสร้าง Nemotron 4 และโครงสร้างพันธมิตรรอบ ๆ โมเดลนี้คือ{{2}}ส่วนที่น่าสนใจที่สุดของเรื่องราว{{/2}} — แต่ตัวเลขเด่นทุกตัวในข่าวลือ {{3}}ตั้งแต่พื้น 1 ล้านล้านพารามิเตอร์ กำหนดการปลายฤดูใบไม้ร่วง ไปจนถึงงบประมาณ 28 พันล้านดอลลาร์ ล้วนมาจากพนักงานที่ไม่เปิดเผยชื่อ และอาจเปลี่ยนแปลงได้{{/3}} วงการโมเดลโอเพนเวทก้าวข้ามจุดพารามิเตอร์ 1 ล้านล้านไปแล้ว โดยมีห้องแล็บจีนเป็นผู้นำ และการตอบสนองของ NVIDIA คือโมเดลฐานแบบกลุ่มพันธมิตรบวกกับคำมั่นสัญญา สำหรับผู้อ่านที่กำลังเลือกใช้โมเดลในวันนี้ นั่นหมายถึงสิ่งเดียว: {{4}}อย่าวางแผนโดยยึดข่าวลือเป็นหลัก{{/4}} รักษาชั้นการอนุมานให้ยืดหยุ่น ประเมินสิ่งที่วางจำหน่ายจริงด้วยตัวเลขจริง และปล่อยให้ระบบจัดเส้นทางทำหน้าที่ของมัน — {{5}}ลองสิ่งใหม่โดยไม่ต้องเดิมพันเส้นทางการผลิตกับมัน{{/5}}
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
