Kartu judul hero untuk artikel kebocoran Nemotron 4: judul utama 'Nemotron 4', subjudul 'keluarga open-weights dengan 1 triliun parameter milik NVIDIA — dilaporkan, bukan dirilis', dan dua chip berlabel 'dilaporkan' dan 'belum dirilis'. Logo OrcaRouter di kanan bawah.
Guides & Insights

Kebocoran Nemotron 4: Jawaban Bobot Terbuka NVIDIA dengan 1 Triliun Parameter untuk Frontier

Penulis

Jim Song

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

1 triliun parameter. Itulah batas bawah yang dilaporkan untuk model Nemotron 4 terbesar, andalan dari keluarga open-weights NVIDIA berikutnya — dan angka itu hanya terdengar besar sampai Anda membandingkannya dengan yang sudah dirilis. Dalam sebulan terakhir, Moonshot AI merilis Kimi K3 dengan total 2,8 triliun parameter, Alibaba meluncurkan Qwen3.8-Max dengan 2,4 triliun, dan andalan NVIDIA saat ini, Nemotron 3 Ultra, berada di 550 miliar. The Information melaporkan pada 11 Agustus 2026 — mengutip beberapa karyawan yang mengerjakan proyek tersebut — bahwa Nemotron 4 adalah jawaban NVIDIA: keluarga open-weights yang model terbesarnya diperkirakan mulai dari sekitar 1 triliun parameter, hampir dua kali lipat Nemotron 3 Ultra.

Tidak ada apa pun di sini yang telah dirilis. NVIDIA telah mengakui bahwa mereka sedang membangun keluarga Nemotron 4, tetapi belum mengonfirmasi target parameter, anggaran, linimasa, atau detail aliansi yang dikaitkan The Information kepada karyawan yang tidak disebutkan namanya. Anggaplah setiap angka dalam tulisan ini sebagai "dilaporkan", bukan "ditetapkan". Tujuan dari tulisan kebocoran adalah memisahkan inti kecil yang telah dikonfirmasi dari halo laporan yang lebih besar — dan memberi tahu Anda bagian mana yang penting saat lembar spesifikasi yang sesungguhnya tiba.

Kebocoran satu baris, dibongkar

Pertama, namanya, karena akan membingungkan Anda dalam hasil pencarian: NVIDIA sudah merilis model bernama Nemotron-4-340B pada Juni 2024. Nemotron 4 yang baru adalah keluarga yang berbeda dan lebih besar — penerus lini Nemotron 3 (Nano, Super, Ultra) yang dirilis tahun ini — menggunakan kembali nama "Nemotron 4" untuk generasi setelahnya. Artikel ini tentang yang baru.

Apa yang sebenarnya dilaporkan oleh The Information: NVIDIA mengembangkan Nemotron 4 sebagai keluarga model open-source yang ditujukan untuk puncak papan peringkat open-weight, dan model utamanya diperkirakan memiliki "setidaknya 1 triliun parameter." NVIDIA belum menetapkan tanggal rilis, belum memulai pelatihan final — sebuah proses yang menurut karyawan akan memakan waktu berbulan-bulan — dan hanya menetapkan data pra-pelatihan dan arsitekturnya; spesifikasinya masih berubah. Dua karyawan mengatakan keluarga model ini bisa siap paling cepat akhir musim gugur; yang lain memperkirakan lebih lambat.

Laporan yang sama mencantumkan anggaran: sekitar $28 miliar untuk perjanjian layanan cloud multi-tahun yang berjalan hingga awal 2031, sekitar tiga kali lipat dari yang diungkapkan NVIDIA setahun sebelumnya, dengan sekitar $7 miliar jatuh pada tahun fiskal berjalan. Laporan itu juga mencatat bahwa makalah penelitian andalan sebelumnya mencantumkan 570 penulis dan Nemotron 4 melibatkan lebih banyak — seorang mantan karyawan mengatakan kepada The Information bahwa "semua orang ingin terlibat." Semuanya tidak dilaporkan oleh NVIDIA.

Comparison scoreboard 'Nemotron 3 Ultra vs Nemotron 4 — shipped vs reported': Parameters 550B total / 55B active vs at least 1T total / TBD active; Release June 4, 2026 vs no date set; Weights open now vs not yet; Status shipped and verifiable vs employee-reported; License OpenMDW-1.1 vs not announced; Price ~$0.68 / $2.68 per 1M vs nothing hosted yet. Footer: Nemotron 3 Ultra figures per NVIDIA and Artificial Analysis; Nemotron 4 per The Information, unconfirmed.

Mengapa angka ukuran adalah bagian yang paling tidak menarik

Kisah yang jelas adalah "NVIDIA menuju parameter triliunan." Yang kurang jelas adalah bahwa perbatasan bobot terbuka sampai di sana lebih dulu. Kimi K3 membuka bobotnya pada 27 Juli dengan total 2,8 triliun parameter — sekitar 104 miliar aktif per token dalam konfigurasi mixture-of-experts — dan Qwen3.8-Max milik Alibaba, yang diluncurkan pada 19 Juli, adalah model total 2,4 triliun dengan sekitar 95 miliar aktif. Dibandingkan dengan itu, model unggulan Nemotron 4 dengan "setidaknya 1 triliun" akan menggandakan Nemotron 3 Ultra tetapi masih tertinggal dari para pemimpin ukuran, dan kedua pemimpin tersebut berasal dari China.

Screenshot of the Artificial Analysis models page comparing intelligence index, price per 1M tokens, output speed, and context window across frontier models, with Claude Opus 5 leading the intelligence highlights.

Dengan demikian, jumlah parameter total menjadi lensa yang sepenuhnya keliru. Dalam model mixture-of-experts, yang menentukan biaya dan kecepatan adalah jumlah parameter aktif per token, bukan total yang ditonjolkan. Nemotron 4 dengan total 1 triliun bisa berada di sekitar 100 miliar parameter aktif — tepat di tingkat Kimi K3 dan Qwen3.8-Max — atau setengahnya. Angka yang bocor berikutnya adalah angka yang penting, dan angka itu belum bocor.

Infographic 'The trillion-parameter open frontier' listing four models with total-parameter counts: Kimi K3 2.8T (Moonshot AI), Qwen3.8-Max 2.4T (Alibaba), Nemotron 4 at least 1T total, reported (NVIDIA), Nemotron 3 Ultra 550B (NVIDIA), with footer 'Total-parameter counts; Nemotron 4 per The Information, unconfirmed.'

Arah sebaliknya juga patut dicatat: DeepSeek V4-Flash, dirilis pada 31 Juli dengan lisensi MIT, mengambil jalan yang berlawanan — total 284 miliar, diposisikan pada harga daripada skala, dengan perkiraan biaya sekitar $0,14 per juta token input. Pasar menghargai kedua ujung ekstrem. Skala bukanlah strategi; ia hanyalah salah satu strategi.

Posisi NVIDIA menjelaskan langkah ini. The Information melaporkan bahwa Nemotron 3 Ultra menempati peringkat kedua di antara model open-weights AS — di belakang Inkling milik Thinking Machines — dan berada di luar jajaran teratas papan peringkat open global. Nemotron 4 adalah upaya untuk kembali ke percakapan frontier, dan para eksekutif NVIDIA sendiri membingkainya sebagai langkah kedaulatan: VP AI generatif Kari Briski mengatakan NVIDIA berinvestasi di Nemotron karena "setiap perusahaan dan setiap negara membutuhkan model open-source frontier yang dapat diakses untuk memperkuat keselamatan dan keamanan, mempercepat inovasi, dan menyediakan fondasi yang dapat mereka andalkan dari satu generasi ke generasi berikutnya." Jensen Huang juga menyampaikan hal yang sama di X, dengan berargumen bahwa model terbuka "memperkuat keselamatan dan keamanan siber, mempercepat inovasi dan difusi, serta memungkinkan kedaulatan." Ketegangan strukturalnya nyata — NVIDIA dilaporkan memiliki sekitar $30 miliar dari OpenAI — tetapi taruhannya adalah bahwa model terbuka memperbesar kue GPU, bukan mengecilkannya. Seperti yang dikatakan CEO LMArena Anastasios Angelopoulos: "Tidak peduli perusahaan mana yang membuat model open-source yang hebat, NVIDIA yang menang."

Koalisi Nemotron adalah bagian yang patut diperhatikan.

Nemotron 4 bukanlah proyek tunggal, dan detail itulah yang paling sering terlewat oleh pemberitaan. Pada GTC tanggal 16 Maret 2026, NVIDIA mengumumkan Nemotron Coalition — delapan anggota pendiri: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam, dan Thinking Machines Lab — yang dibentuk untuk menggabungkan riset, data, dan komputasi di balik "model terbuka terdepan". Proyek pertamanya adalah model dasar yang dikembangkan bersama oleh Mistral AI dan NVIDIA, dilatih di NVIDIA DGX Cloud, yang menurut koalisi tersebut akan bersumber terbuka dan akan menjadi fondasi bagi keluarga Nemotron 4.

The Information menambahkan detail pengerjaan: Reflection, Cursor, Thinking Machines, dan Mistral adalah kontributor yang terkonfirmasi; Prime Intellect menyumbangkan 300.000 lingkungan simulasi untuk pelatihan; Cognition telah membahas penyediaan data pelatihan kode. CEO Prime Intellect, Vincent Weisser, membingkai aliansi tersebut sebagai aksi kolektif melawan apa yang ia sebut monopoli model tunggal yang "seperti dewa". Artinya secara operasional: Nemotron 4 dapat dirilis sebagai fondasi konsorsium yang setiap anggotanya melakukan post-training untuk produknya sendiri, bukan sebagai checkpoint dari satu vendor. Itu akan membuat "model NVIDIA dengan bobot terbuka" menjadi kategori yang salah — fondasinya adalah artefak yang menarik.

Dikonfirmasi, dilaporkan, tidak diketahui

• Terkonfirmasi — NVIDIA sedang mengerjakan keluarga Nemotron 4 (pernyataan perusahaan). Koalisi Nemotron telah ada dan sedang membangun model dasar terbuka bersama Mistral AI (NVIDIA, Maret 2026).

• Dilaporkan, belum dikonfirmasi — target utama "setidaknya 1 triliun"; jadwal akhir musim gugur; komitmen cloud sekitar $28 miliar dengan sekitar $7 miliar pada tahun fiskal ini; kontribusi masing-masing anggota koalisi.

• Tidak diketahui — jumlah parameter aktif, panjang konteks, campuran modalitas, ketentuan lisensi, harga, checkpoint mana yang dirilis lebih dulu, dan apakah basis yang dikembangkan bersama Mistral benar-benar menjadi fondasi keluarga ini.

Linimasa dan yang perlu ditonton

Belum ada tanggal rilis. Pelatihan final belum dimulai; karyawan menggambarkannya sebagai proses berbulan-bulan, dan perkiraannya berkisar dari "akhir musim gugur" (dua sumber) hingga lebih lambat. Sementara itu, NVIDIA terus mengembangkan lini produknya: mereka merilis Nemotron 3.5 Lightning, agen pekerja dengan 31,6 miliar parameter yang diluncurkan pada 11 Agustus — hari yang sama ketika laporan Nemotron 4 muncul — bersama NeMo Switchyard, perangkat lunak perutean sumber terbuka milik NVIDIA. Dengan kata lain, NVIDIA secara aktif terus menyempurnakan lini produknya sementara produk unggulannya masih dalam tahap perancangan.

Yang perlu diperhatikan, sesuai urutan kepentingannya:

Parameter aktif — total adalah angka utamanya; jumlah parameter aktif menentukan biaya dan kecepatan. MoE dengan total sekitar 1T dan sekitar 100B parameter aktif mengubah keseluruhan gambaran dibandingkan dengan yang sekitar 50B.

• Skor independen — belum ada evaluasi pihak ketiga untuk model yang belum dilatih. Pantau Artificial Analysis Intelligence Index saat checkpoint yang dihosting muncul.

• Ketentuan lisensi — Nemotron 3 Ultra dirilis di bawah OpenMDW-1.1, bersifat permisif tetapi bukan MIT atau Apache 2.0. Apakah Nemotron 4 akan mengikuti atau memperketat ketentuannya masih belum diputuskan, dan bagi perusahaan yang membangun di atas bobot (weights), hal ini menentukan segalanya.

• Ukuran mana yang dikirim lebih dulu — Nemotron 3 hadir sebagai keluarga (Nano, Super, Ultra). Perkirakan berbagai ukuran Nemotron 4, dan perkirakan yang kecil hadir sebelum yang flagship.

• Basis Mistral — apakah model dasar koalisi benar-benar menjadi fondasi keluarga adalah pertanyaan struktural di balik semua pembicaraan parameter.

• Harga — tidak ada yang di-hosting, jadi tidak ada yang dipatok harga. Saat mitra hosting mencantumkan Nemotron 4, harga pass-through adalah harga yang sebenarnya akan Anda bayar.

Apa artinya bagi lapisan inferensi Anda

Anda tidak bisa memanggil Nemotron 4 hari ini — tidak ada yang bisa — jadi pertanyaan praktisnya adalah seberapa banyak stack Anda yang harus berubah untuk mengakomodasi model yang spesifikasinya masih berubah-ubah. Jawabannya sama seperti untuk model frontier yang belum dirilis: pertahankan lapisan inferensi agar model-agnostik. Jika Anda merutekan melalui satu API yang menjadi gerbang untuk 200+ model, keluarga Nemotron baru adalah perubahan konfigurasi, bukan penulisan ulang. OrcaRouter meneruskan harga daftar penyedia dengan markup 0%, jadi berapa pun yang akhirnya dikenakan host untuk Nemotron 4 adalah persis yang Anda bayar, dan potongan harga dari vendor berlaku pada hari yang sama saat dibuat. Failover otomatis adalah alat untuk rilis pertama yang belum teruji: arahkan lalu lintas awal ke model baru, kembali ke alternatif yang stabil saat ia macet atau error, dan naikkan ke produksi hanya setelah ia berhasil menangani beban kerja Anda. Tidak ada satu pun dari itu yang mengharuskan mempertaruhkan jalur produksi pada bocoran — yang justru merupakan sikap yang tepat ketika lembar spesifikasinya masih begitu tentatif.

FAQ

Kapan Nemotron 4 akan dirilis?

Belum ada tanggal yang ditetapkan. Para karyawan mengatakan kepada The Information bahwa putaran pelatihan final belum dimulai dan akan memakan waktu berbulan-bulan; dua di antaranya mengatakan akhir musim gugur 2026 mungkin terjadi, sementara yang lain memperkirakan lebih lambat. Anggap "akhir musim gugur" sebagai perkiraan optimistis dari dalam proyek, bukan peta jalan.

Akankah Nemotron 4 menjadi sumber terbuka?

Pernyataan niat NVIDIA adalah open weights, dan proyek pertama Koalisi Nemotron — model dasar yang dikembangkan bersama Mistral — dijanjikan untuk dijadikan open source. Tetapi "open weights" bukanlah "open source": Nemotron 3 Ultra dirilis dengan lisensi OpenMDW-1.1, yang lebih permisif daripada ketentuan lama NVIDIA namun tetap bukan MIT atau Apache 2.0. Lisensi spesifik Nemotron 4 belum diumumkan.

Apakah "setidaknya 1 triliun parameter" merupakan spesifikasi yang nyata?

Ini adalah target yang bersumber dari karyawan yang dilaporkan oleh The Information, bukan spesifikasi yang dikonfirmasi, dan laporan yang sama mengatakan jumlah tersebut dapat berubah. Bahkan dengan total 1 triliun, ukuran mentahnya akan berada di belakang Kimi K3 (2,8T) dan Qwen3.8-Max (2,4T); jumlah parameter aktif — yang belum bocor — adalah angka yang akan menentukan biaya dan kecepatan.

Haruskah saya menunggu Nemotron 4 sebelum memilih model?

Tidak. Paling cepat masih berbulan-bulan lagi dan belum terbukti. Pilih model terbaik yang tersedia untuk tugas itu sekarang dan pertahankan lapisan perutean yang fleksibel; ketika Nemotron 4 benar-benar dirilis, evaluasi dengan cara yang sama seperti Anda mengevaluasi model baru lainnya — parameter aktif, tolok ukur independen, lisensi, dan harga — daripada berdasarkan jumlah total yang diiklankan.

Intinya

Keluarganya nyata; angkanya perkiraan. NVIDIA telah mengonfirmasi bahwa mereka sedang membangun Nemotron 4, dan struktur koalisi di sekitarnya adalah bagian paling menarik dari cerita ini — tetapi setiap angka utama dalam kebocoran tersebut, dari batas bawah 1 triliun hingga jadwal akhir musim gugur hingga anggaran $28 miliar, berasal dari karyawan yang tidak disebutkan namanya dan bisa berubah. Perbatasan open-weight telah melewati angka satu triliun parameter, dipimpin oleh laboratorium Tiongkok, dan respons NVIDIA adalah model dasar konsorsium plus sebuah janji. Bagi pembaca yang memilih model saat ini, itu berarti satu hal: jangan merencanakan berdasarkan kebocoran tersebut. Jaga lapisan inferensi tetap fleksibel, evaluasi apa pun yang dirilis berdasarkan angka sebenarnya, dan biarkan routing melakukan fungsinya — mencoba hal baru tanpa mempertaruhkan jalur produksi padanya.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube