Kartu judul hero untuk artikel kebocoran Nemotron 4: judul utama 'Nemotron 4', subjudul 'keluarga open-weights dengan 1 triliun parameter milik NVIDIA — dilaporkan, bukan dirilis', dan dua chip berlabel 'dilaporkan' dan 'belum dirilis'. Logo OrcaRouter di kanan bawah.
Guides & Insights

Kebocoran Nemotron 4: Jawaban Bobot Terbuka NVIDIA dengan 1 Triliun Parameter untuk Frontier

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Nemotron 4 masih belum dirilis, tetapi minggu ini ia tidak lagi sekadar rumor dengan hanya jumlah parameter. The Wall Street Journal melaporkan pada 22 Agustus 2026, mengutip orang-orang yang mengetahui masalah ini, bahwa NVIDIA menghabiskan sekitar $6 miliar untuk menjadikan Nemotron 4 salah satu model AI open-weight paling kuat di dunia — dan bahwa rencana tersebut mencakup lisensi non-eksklusif untuk teknologi pelatihan model dari startup AI Poolside serta transfer lebih dari 100 insinyur Poolside ke proyek Nemotron 4. Itu di atas kebocoran sebelumnya dari The Information, pada 11 Agustus, bahwa model unggulan keluarga ini akan membawa "setidaknya 1 triliun parameter." Secara gabungan, kedua laporan tersebut menggambarkan upaya paling serius NVIDIA untuk mencapai puncak frontier open-weight.

Tidak ada yang telah dirilis di sini, dan tidak ada yang dikonfirmasi. NVIDIA telah mengakui bahwa mereka sedang membangun keluarga Nemotron 4, tetapi belum mengonfirmasi target parameter, garis waktu, rencana lisensi-dan-perekrutan yang dikaitkan WSJ kepada orang-orang yang mengetahui kesepakatan tersebut, atau detail aliansi yang dikaitkan The Information kepada karyawan yang tidak disebutkan namanya. Perlakukan setiap angka dalam tulisan ini sebagai "dilaporkan," bukan "ditentukan." Tujuan dari tulisan kebocoran adalah untuk memisahkan inti terkonfirmasi yang kecil dari lingkaran laporan yang lebih besar — dan memberi tahu Anda bagian mana yang penting ketika lembar spesifikasi yang sesungguhnya hadir.

Kebocoran satu baris, dibongkar

Pertama, namanya, karena akan membingungkan Anda dalam hasil pencarian: NVIDIA sudah merilis model bernama Nemotron-4-340B pada Juni 2024. Nemotron 4 yang baru adalah keluarga yang berbeda dan lebih besar — penerus lini Nemotron 3 (Nano, Super, Ultra) yang dirilis tahun ini — menggunakan kembali nama "Nemotron 4" untuk generasi setelahnya. Artikel ini tentang yang baru.

Apa yang sebenarnya dilaporkan oleh The Information: NVIDIA mengembangkan Nemotron 4 sebagai keluarga model open-source yang ditujukan untuk puncak papan peringkat open-weight, dan model utamanya diperkirakan memiliki "setidaknya 1 triliun parameter." NVIDIA belum menetapkan tanggal rilis, belum memulai pelatihan final — sebuah proses yang menurut karyawan akan memakan waktu berbulan-bulan — dan hanya menetapkan data pra-pelatihan dan arsitekturnya; spesifikasinya masih berubah. Dua karyawan mengatakan keluarga model ini bisa siap paling cepat akhir musim gugur; yang lain memperkirakan lebih lambat.

Laporan yang sama melampirkan anggaran terpisah: sekitar $28 miliar dalam perjanjian layanan cloud multi-tahun yang berlangsung hingga awal 2031, sekitar tiga kali lipat dari yang diungkapkan NVIDIA setahun sebelumnya, dengan sekitar $7 miliar jatuh pada tahun fiskal saat ini. Angka tersebut mencakup komitmen komputasi, bukan kesepakatan baru yang dilaporkan minggu ini. Laporan tersebut juga mencatat bahwa makalah penelitian andalan sebelumnya mencantumkan 570 penulis dan Nemotron 4 melibatkan lebih banyak — seorang mantan karyawan memberi tahu The Information bahwa "semua orang ingin terlibat." Semuanya tidak dilaporkan oleh NVIDIA.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

Minggu ini: kesepakatan senilai $6 miliar dengan Poolside untuk mewujudkan Nemotron 4.

The Wall Street Journal melaporkan minggu ini bahwa rencana NVIDIA untuk Nemotron 4 bukan sekadar proyek penelitian — melainkan pembangunan yang didanai. Menurut WSJ, yang mengutip orang-orang yang mengetahui masalah ini, NVIDIA akan membayar sekitar $6 miliar untuk lisensi non-eksklusif atas "Model Factory" milik Poolside, sistem pelatihan dan evaluasi di balik model koding Laguna sumber terbuka milik Poolside, dan memberikan tawaran kerja kepada lebih dari 100 staf Poolside — dilaporkan sebanyak 109, sebagian besar insinyur — untuk mengerjakan proyek Nemotron. Bloomberg secara terpisah melaporkan bahwa NVIDIA akan berinvestasi tambahan $1 miliar di Poolside dengan valuasi pra-pendanaan yang dilaporkan sebesar $12 miliar, sehingga total komitmen NVIDIA yang dilaporkan mencapai sekitar $7 miliar.

Ini bukan akuisisi. Lisensinya bersifat non-eksklusif, para pendiri Poolside tetap bertahan, dan Poolside tetap beroperasi sebagai perusahaan independen; menurut laporan tersebut, Poolside berencana untuk mendistribusikan pembayaran lisensi senilai $6 miliar kepada para investornya. Kisah ini pertama kali muncul melalui Newcomer pada 20 Agustus dan dikonfirmasi oleh Bloomberg pada 21 Agustus serta WSJ pada 22 Agustus — semuanya masih "dilaporkan," tidak ada satu pun yang dikonfirmasi oleh NVIDIA atau Poolside.

Mengapa kesepakatan ini lebih penting daripada angka di tajuk utama: kesepakatan ini memberi proyek Nemotron 4 tim yang benar-benar pernah merilis model open-weight. Keluarga Laguna milik Poolside adalah lini pengodean open-weight yang sudah terbukti, dan tujuan yang dilaporkan — rilis Nemotron dalam waktu sekitar satu tahun yang mampu bersaing dengan model frontier terkuat — adalah kerangka waktu konkret pertama yang pernah dikaitkan siapa pun dengan proyek ini. Laporan-laporan tersebut membingkai langkah ini sebagai jawaban NVIDIA atas para pemimpin open-weight di Tiongkok, khususnya Deep​Seek dan Kimi K3 milik Moonshot AI, serta, dalam perdebatan terbuka versus tertutup, sebagai lindung nilai terhadap laboratorium tertutup AS.

Struktur juga penting. Lisensi non-eksklusif berarti Poolside mempertahankan kekayaan intelektualnya dan dapat melisensikan teknologi yang sama kepada pihak lain — NVIDIA membeli kapabilitas dan bakat, bukan kepemilikan. Analis membacanya sebagai upaya NVIDIA untuk menjaga lapisan model tetap terkomoditisasi: jika model open-weight tetap kuat dan murah, permintaan terus mengalir ke lapisan yang dikendalikan NVIDIA — GPU. Seperti yang dikatakan CEO LMArena, Anastasios Angelopoulos, dalam laporan sebelumnya: "Tidak peduli perusahaan mana yang membuat model open-source yang hebat, NVIDIA tetap menang."

Mengapa angka ukuran adalah bagian yang paling tidak menarik

Kisah yang jelas adalah "NVIDIA menuju parameter triliunan." Kisah yang kurang jelas adalah bahwa perbatasan bobot terbuka sampai di sana lebih dulu. Kimi K3 membuka bobotnya pada 27 Juli dengan total 2,8 triliun parameter — sekitar 104 miliar aktif per token dalam konfigurasi mixture-of-experts — dan Qwen3.8 Max milik Alibaba, yang diluncurkan pada 19 Juli, adalah model dengan total 2,4 triliun parameter dengan sekitar 95 miliar aktif. Dibandingkan dengan itu, model unggulan Nemotron 4 dengan "setidaknya 1 triliun" akan menggandakan Nemotron 3 Ultra, tetapi masih tertinggal dari para pemimpin ukuran, dan kedua pemimpin itu berasal dari Tiongkok.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

Hal itu membuat jumlah total parameter menjadi lensa yang sepenuhnya salah. Dalam model mixture-of-experts, yang menentukan biaya dan kecepatan adalah jumlah parameter aktif per token, bukan total yang digembar-gemborkan. Nemotron 4 dengan total 1 triliun bisa memiliki sekitar 100 miliar parameter aktif — tepat berada di kelas Kimi K3 dan Qwen3.8 Max — atau setengah dari itu. Angka yang bocor berikutnya adalah angka yang paling penting, dan angka itu belum bocor.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Arah sebaliknya juga patut dicatat: DeepSeek V4-Flash, dirilis pada 31 Juli dengan lisensi MIT, mengambil jalan yang berlawanan — total 284 miliar, diposisikan pada harga daripada skala, dengan perkiraan biaya sekitar $0,14 per juta token input. Pasar menghargai kedua ujung ekstrem. Skala bukanlah strategi; ia hanyalah salah satu strategi.

Posisi NVIDIA menjelaskan langkah ini. The Information melaporkan Nemotron 3 Ultra menempati peringkat kedua di antara model open-weights AS — di belakang Inkling milik Thinking Machines — dan berada di luar jajaran teratas papan peringkat global. Nemotron 4 adalah upaya untuk kembali masuk ke dalam percakapan frontier, dan para eksekutif NVIDIA sendiri membingkainya sebagai langkah kedaulatan: VP AI generatif Kari Briski mengatakan NVIDIA berinvestasi di Nemotron karena "setiap perusahaan dan setiap negara membutuhkan model open-source frontier yang mudah diakses untuk memperkuat keselamatan dan keamanan, mempercepat inovasi, dan menyediakan fondasi yang dapat mereka andalkan dari satu generasi ke generasi berikutnya." Jensen Huang juga menyampaikan argumen yang sama di X, dengan menyatakan bahwa model terbuka "memperkuat keselamatan dan keamanan siber, mempercepat inovasi dan difusi, serta memungkinkan kedaulatan." Ketegangan struktural ini nyata — NVIDIA dilaporkan memiliki sekitar $30 miliar saham Ope​nAI — tetapi taruhannya adalah bahwa model terbuka memperbesar kue GPU, bukan menyusutkannya.

Koalisi Nemotron adalah bagian yang patut diperhatikan.

Nemotron 4 bukanlah proyek yang dikerjakan sendirian, dan kesepakatan Poolside bukan satu-satunya struktur yang mengelilinginya. Pada GTC tanggal 16 Maret 2026, NVIDIA mengumumkan Nemotron Coalition — delapan anggota pendiri: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam, dan Thinking Machines Lab — yang dibentuk untuk menggabungkan riset, data, dan komputasi demi mendukung "model terbuka kelas frontier." Proyek pertamanya adalah model dasar yang dikembangkan bersama oleh Mistral AI dan NVIDIA, dilatih di NVIDIA DGX Cloud, yang menurut koalisi tersebut akan dijadikan sumber terbuka dan akan menjadi fondasi bagi keluarga Nemotron 4.

The Information menambahkan detail pengerjaan: Reflection, Cursor, Thinking Machines, dan Mistral adalah kontributor yang terkonfirmasi; Prime Intellect menyumbangkan 300.000 lingkungan simulasi untuk pelatihan; Cognition telah membahas penyediaan data pelatihan kode. CEO Prime Intellect, Vincent Weisser, membingkai aliansi tersebut sebagai aksi kolektif melawan apa yang ia sebut monopoli model tunggal yang "seperti dewa". Artinya secara operasional: Nemotron 4 dapat dirilis sebagai fondasi konsorsium yang setiap anggotanya melakukan post-training untuk produknya sendiri, bukan sebagai checkpoint dari satu vendor. Itu akan membuat "model NVIDIA dengan bobot terbuka" menjadi kategori yang salah — fondasinya adalah artefak yang menarik.

Kesepakatan Poolside masuk berdampingan dengan semua itu. Koalisi tersebut menggabungkan riset dan komputasi; skema lisensi-dan-perekrutan membawa pabrik model yang berfungsi serta staf yang telah merilis open weights. Jika laporan tersebut benar, NVIDIA sedang merakit Nemotron 4 dari tiga sumber sekaligus — operasi pelatihannya sendiri, basis konsorsium, dan sistem produksi Poolside — yang merupakan bentuk berbeda dari perilisan checkpoint tunggal mana pun.

Dikonfirmasi, dilaporkan, tidak diketahui

• Terkonfirmasi — NVIDIA sedang mengerjakan keluarga Nemotron 4 (pernyataan perusahaan). Koalisi Nemotron telah ada dan sedang membangun model dasar terbuka bersama Mistral AI (NVIDIA, Maret 2026).

• Dilaporkan, belum dikonfirmasi — target utama "setidaknya 1 triliun" dan jadwal akhir musim gugur, ditambah komitmen cloud sekitar $28 miliar dengan sekitar $7 miliar pada tahun fiskal ini (The Information); anggaran pembangunan sekitar $6 miliar yang dilaporkan WSJ, lisensi "Model Factory" Poolside non-eksklusif, dan lebih dari 100 insinyur Poolside yang bergabung dengan proyek Nemotron; investasi NVIDIA senilai $1 miliar di Poolside yang dilaporkan Bloomberg dengan valuasi pra-investasi sekitar $12 miliar; serta kontribusi masing-masing anggota koalisi.

• Tidak diketahui — jumlah parameter aktif, panjang konteks, perpaduan modalitas, ketentuan lisensi, harga, checkpoint mana yang dirilis lebih dulu, apakah basis yang dikembangkan bersama Mistral benar-benar menjadi fondasi keluarga tersebut, dan apakah kesepakatan Poolside disusun seperti yang dilaporkan (tidak ada satu pun perusahaan yang berkomentar).

Linimasa dan yang perlu ditonton

Masih belum ada tanggal rilis. Proses pelatihan terakhir belum dimulai; para karyawan menggambarkannya berlangsung berbulan-bulan, dan perkiraannya berkisar dari "akhir musim gugur" (dua sumber) hingga lebih lambat. Pelaporan Poolside menambahkan kerangka waktu konkret pertama yang pernah dilekatkan siapa pun pada proyek ini: menurut liputan tersebut, tujuannya adalah merilis dalam waktu sekitar satu tahun yang dapat bersaing dengan model-model frontier terkuat. NVIDIA terus menggerakkan keluarga ini sementara itu: mereka merilis Nemotron 3.5 Lightning, agen pekerja dengan 31,6 miliar parameter yang dirilis pada 11 Agustus — hari yang sama dengan laporan Nemotron 4 — bersama dengan NeMo Switchyard, perangkat lunak routing open-source milik NVIDIA sendiri.

Yang perlu diperhatikan, sesuai urutan kepentingannya:

Parameter aktif — total adalah angka utamanya; jumlah parameter aktif menentukan biaya dan kecepatan. MoE dengan total sekitar 1T dan sekitar 100B parameter aktif mengubah keseluruhan gambaran dibandingkan dengan yang sekitar 50B.

• Integrasi Poolside — apakah lisensi Model Factory dan tim barunya benar-benar mengubah rencana pelatihan dan memperpendek jadwal yang dilaporkan, atau apakah itu akuisisi bakat yang membuat rencana tetap bertahan.

• Skor independen — belum ada evaluasi pihak ketiga untuk model yang belum dilatih. Pantau Artificial Analysis Intelligence Index saat checkpoint yang dihosting muncul.

• Ketentuan lisensi — Nemotron 3 Ultra dirilis di bawah OpenMDW-1.1, bersifat permisif tetapi bukan MIT atau Apache 2.0. Apakah Nemotron 4 akan mengikuti atau memperketat ketentuannya masih belum diputuskan, dan bagi perusahaan yang membangun di atas bobot (weights), hal ini menentukan segalanya.

• Ukuran mana yang dikirim lebih dulu — Nemotron 3 hadir sebagai keluarga (Nano, Super, Ultra). Perkirakan berbagai ukuran Nemotron 4, dan perkirakan yang kecil hadir sebelum yang flagship.

• Basis Mistral — apakah model dasar koalisi benar-benar menjadi fondasi keluarga adalah pertanyaan struktural di balik semua pembicaraan parameter.

• Harga — tidak ada yang di-hosting, jadi tidak ada yang dipatok harga. Saat mitra hosting mencantumkan Nemotron 4, harga pass-through adalah harga yang sebenarnya akan Anda bayar.

Apa artinya bagi lapisan inferensi Anda

Anda tidak dapat memanggil Nemotron 4 hari ini — tidak ada yang bisa — dan laporan Poolside, betapapun dramatisnya, tidak mengubah hal itu. Pertanyaan praktisnya tetap: seberapa besar stack Anda yang harus berubah untuk mengakomodasi model yang spesifikasinya masih terus bergerak. Jawabannya sama seperti untuk model frontier yang belum dirilis: pertahankan lapisan inferensi agar agnostik terhadap model. Jika Anda merutekan melalui satu API yang menaungi 200+ model, keluarga Nemotron yang baru hanyalah perubahan konfigurasi, bukan penulisan ulang. OrcaRouter meneruskan harga daftar penyedia dengan markup 0%, jadi berapa pun yang akhirnya dikenakan host untuk Nemotron 4, itulah yang persis Anda bayar, dan pemotongan harga vendor berlaku pada hari yang sama saat pemotongan tersebut dilakukan. Failover otomatis adalah alat yang tepat untuk rilis pertama yang belum terbukti: arahkan lalu lintas awal ke model baru, beralih kembali ke alternatif yang stabil saat model itu macet atau error, dan naikkan ke produksi hanya setelah ia terbukti mampu menangani beban kerja Anda. Semua itu tidak mengharuskan mempertaruhkan jalur produksi pada sebuah kebocoran — dan itulah sikap yang tepat ketika spesifikasinya masih sangat sementara.

FAQ

Kapan Nemotron 4 akan dirilis?

Belum ada tanggal yang ditetapkan. Karyawan memberi tahu The Information bahwa pelatihan final belum dimulai dan akan memakan waktu berbulan-bulan; dua orang mengatakan akhir musim gugur 2026 mungkin terjadi, dan yang lain memperkirakan lebih lambat. Pelaporan minggu ini menambahkan target yang dilaporkan untuk rilis yang kompetitif di level frontier dalam waktu sekitar satu tahun, tetapi masih belum ada tanggal pasti. Anggaplah keduanya sebagai perkiraan dari dalam proyek, bukan peta jalan.

Akankah Nemotron 4 menjadi sumber terbuka?

Pernyataan niat NVIDIA adalah open weights, dan proyek pertama Koalisi Nemotron — model dasar yang dikembangkan bersama Mistral — dijanjikan untuk dijadikan open source. Tetapi "open weights" bukanlah "open source": Nemotron 3 Ultra dirilis dengan lisensi OpenMDW-1.1, yang lebih permisif daripada ketentuan lama NVIDIA namun tetap bukan MIT atau Apache 2.0. Lisensi spesifik Nemotron 4 belum diumumkan.

Apakah kesepakatan Poolside senilai $6 miliar yang dilaporkan itu sudah dikonfirmasi?

{{1}}Tidak.{{/1}} WSJ melaporkan lisensi senilai sekitar $6 miliar dan lebih dari 100 insinyur Poolside yang bergabung dengan proyek Nemotron pada 22 Agustus, dengan mengutip orang-orang yang mengetahui masalah ini; Bloomberg melaporkan tambahan investasi $1 miliar. Newcomer pertama kali melaporkannya pada 20 Agustus. Baik NVIDIA maupun Poolside belum mengonfirmasi semua itu. Lisensi tersebut dilaporkan bersifat non-eksklusif, dan Poolside akan tetap menjadi perusahaan independen.

Apakah "setidaknya 1 triliun parameter" merupakan spesifikasi yang nyata?

Ini adalah target yang berasal dari karyawan yang dilaporkan oleh The Information, bukan spesifikasi yang dikonfirmasi, dan laporan yang sama mengatakan bahwa jumlah tersebut dapat berubah. Bahkan dengan total 1 triliun, ukuran mentahnya akan tertinggal dari Kimi K3 (2,8T) dan Qwen3.8 Max (2,4T); jumlah parameter aktif—yang belum bocor—adalah angka yang akan menentukan biaya dan kecepatan.

Haruskah saya menunggu Nemotron 4 sebelum memilih model?

Tidak. Itu masih berbulan-bulan lagi dan belum terbukti. Pilih model terbaik yang tersedia untuk pekerjaan itu sekarang dan jaga lapisan perutean tetap fleksibel; ketika Nemotron 4 benar-benar dirilis, evaluasi dengan cara yang sama seperti Anda mengevaluasi model baru lainnya — parameter aktif, benchmark independen, lisensi, dan harga — daripada berdasarkan total utama atau besarnya anggaran yang dilaporkan.

Intinya

Keluarga model itu nyata; angka-angkanya hanyalah perkiraan. Pekan ini ceritanya berubah bentuk: Nemotron 4 bukan lagi sekadar kebocoran parameter, melainkan pengembangan yang didanai. NVIDIA dilaporkan mengeluarkan sekitar $6 miliar, melisensikan Model Factory milik Poolside, merekrut lebih dari 100 insinyurnya, dan berinvestasi $1 miliar lagi di perusahaan tersebut — semuanya untuk membuat model unggulan berbobot terbuka yang mampu berdiri sejajar dengan Deep​Seek dan Kimi K3. Setiap angka itu hanya laporan media, tidak ada yang terkonfirmasi, dan belum ada apa pun yang dirilis. Batas bobot terbuka telah melewati tonggak satu triliun parameter, dan jawaban NVIDIA adalah model dasar konsorsium, pabrik model berlisensi, dan sebuah janji. Bagi pembaca yang memilih model saat ini, itu tetap berarti satu hal: jangan menyusun rencana berdasarkan kebocoran itu. Jaga lapisan inferensi tetap fleksibel, evaluasi apa pun yang dirilis berdasarkan angka riilnya, dan biarkan perutean melakukan fungsinya — mencoba hal baru tanpa mempertaruhkan jalur produksi padanya.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari