
Nex-N2.5 Pro vs DeepSeek V4 Pro: Hanya Satu Set dari Bobot Terbuka Ini yang Benar-Benar Terbuka
- openaiBARUOpenAI: GPT-6 Astra2026-09-0455Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0247Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0247Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0157Kecerdasan82Koding
- AlibabaBARUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiBARUZ.ai: GLM 5.3 Flash2026-08-2646Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1849Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1541Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1251Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0547Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0347Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2140Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Kecerdasan49Koding
Inilah rahasia keluarga yang membuat pertarungan ini lebih aneh daripada yang terlihat: Nex-N2.5 Max milik Nex-AGI sendiri — tingkat teratas dari keluarga yang juga mencakup Nex-N2.5 Pro — adalah hasil post-training dari DeepSeek-V4-Pro-Base. Liputan atas catatan rilis 8 September dengan terang-terangan menyebutkan bahwa Mini dan Pro dibangun dari varian Qwen3.5, sementara Max 1.6T yang khusus teks berdiri di atas basis terbuka yang dirilis DeepSeek pada bulan Agustus. Jadi ketika Nex-N2.5 Pro dibandingkan dengan DeepSeek V4 Pro, pembaca menyaksikan satu proyek model terbuka meminjam fondasi proyek lain untuk tingkat unggulannya, lalu mencoba mengungguli pihak pemberi fondasi itu di tingkat di bawahnya. Itu bukanlah sebuah hinaan; begitulah cara kerja ekonomi model terbuka, dan itulah kerangka paling jujur untuk sebuah perbandingan ketika kedua model sama-sama berlisensi terbuka dan hanya satu di antaranya yang benar-benar dapat diunduh saat ini.
Asimetri inilah inti keseluruhannya. DeepSeek V4 Pro, build 0813 yang dirilis umum (GA) pada 13 Agustus, memiliki bobot berlisensi MIT yang saat ini tersedia di Hugging Face — model mixture-of-experts besar dengan total sekitar 1,6 triliun parameter, sekitar 49 miliar aktif, konteks 1 juta token, batas keluaran 384K, dan API resmi di belakangnya. Nex-N2.5 Pro, yang diumumkan pada 8 September, adalah MoE sparse dengan 397 miliar parameter, sekitar 17 miliar aktif, multimodal sementara DeepSeek hanya teks, dan ditujukan untuk agen penggunaan komputer, bukan penggunaan alat secara generalis. Kartu Hugging Face-nya masih menampilkan spanduk bahwa bobotnya akan segera hadir di bawah lisensi Apache-2.0, tanpa tanggal, sementara hanya endpoint gratis yang melayaninya. Komitmen filosofis yang sama terhadap bobot terbuka. Keadaan pengiriman yang sangat berbeda.
Dua lisensi, satu set beban yang benar-benar dirilis.
Perbedaan lisensi sebenarnya tidak sepenting perbedaan cara penyediaannya, tetapi lisensi itulah yang menetapkan aturan mainnya. DeepSeek V4 Pro berlisensi MIT — Anda dapat mengunduh shard-nya hari ini, menjalankannya sendiri, melakukan fine-tuning, dan membangun bisnis di atasnya tanpa meminta izin siapa pun; dan karena weights-nya sudah dirilis, tidak ada satu host pun yang dapat mengendalikan harga. Nex-N2.5 Pro dijanjikan hadir di bawah lisensi Apache-2.0, lisensi yang sama permisifnya dan menjadi pilihan aliansi tersebut, tetapi banner pada kartunya tidak ambigu: weights-nya tidak dapat diunduh, dan tidak ada tanggal yang dicantumkan. Bagi tim yang mensyaratkan "modelnya harus milik kami," perbandingan ini saat ini bukan tandingan yang seimbang — DeepSeek V4 Pro adalah satu-satunya kandidat yang benar-benar dapat Anda miliki. Ada catatan praktis yang berlaku dua arah: self-hosting MoE dengan sekitar 1,6 triliun parameter membutuhkan infrastruktur yang serius; bagi sebagian besar tim, lisensi MIT kurang berperan sebagai rencana hosting, melainkan lebih sebagai jaminan terhadap lock-in dan batas bawah harga. Nex-N2.5 Pro, ketika shard-nya dirilis, akan menjadi desain yang lebih mudah untuk di-self-host — 17 miliar parameter aktif pada satu node berisi delapan H100 adalah sistem yang jauh lebih kecil daripada kebutuhan referensi DeepSeek.
Baris-baris tempat keduanya berbeda.
Dilihat berdampingan, kedua model itu nyaris tidak tumpang tindih dalam hal peruntukannya:
• Dirilis — Nex-N2.5 Pro: 8 September 2026 (endpoint yang dihosting aktif, bobot belum tersedia). DeepSeek V4 Pro: 13 Agustus 2026 (build GA 0813), bobot sudah tersedia.
• Skala — Nex-N2.5 Pro: total 397B / ~17B aktif. DeepSeek V4 Pro: total ~1.6T / ~49B aktif.
• Modalitas — Nex-N2.5 Pro: masukan teks dan gambar, keluaran teks; dibuat untuk penggunaan komputer dengan pembacaan layar. DeepSeek V4 Pro: hanya teks pada API publiknya — tanpa visi bawaan, masukan gambar, atau audio.
• Konteks / keluaran — Nex-N2.5 Pro: konteks 262.144 token. DeepSeek V4 Pro: konteks 1 juta token, hingga 384 ribu token keluaran.
• Kontrol penalaran — Nex-N2.5 Pro: tidak ada / sedang (adaptif, bawaan) / tinggi. DeepSeek V4 Pro: rendah / tinggi / upaya penalaran maksimal pada string model yang sama.
• Bobot — Nex-N2.5 Pro: Apache-2.0, segera hadir. DeepSeek V4 Pro: MIT, dapat diunduh sekarang.
• Permukaan API — Nex-N2.5 Pro: panggilan chat yang kompatibel dengan OpenAI pada endpoint gratis yang dihosting. DeepSeek V4 Pro: API Responses OpenAI native serta endpoint yang kompatibel dengan Anthropic, pemanggilan alat, dan output JSON.
Dua produk yang benar-benar berbeda berbagi kata "open." Nex-N2.5 Pro dirancang untuk melihat layar dan mengendarainya; DeepSeek V4 Pro dirancang untuk berpikir, menulis kode, dan memanggil alat — perbedaan antara operator dan analis.

Apa yang diukur, dan apa yang dipinjam

Gambaran tolok ukurnya sama timpangnya dengan gambaran pendistribusiannya. DeepSeek V4 Pro memiliki rekam jejak independen yang terukur: entri pada Artificial Analysis Intelligence Index, berminggu-minggu liputan pers dan lalu lintas produksi sejak GA 0813, serta angka-angka pengkodean vendor — Terminal-Bench 2.1 pada 87,9 dan DeepSWE pada 62,7 menurut laporan DeepSeek sendiri — yang setidaknya bertumpu pada model yang dapat diunduh dan dijalankan ulang oleh siapa pun. Nex-N2.5 Pro tidak memiliki semua itu. Angka-angka utamanya — OSWorld-2 pada 56,4, Terminal-Bench 2.1 pada 82,7, SWE-Bench Pro pada 61,2, BrowseComp pada 89,7 — semuanya adalah pengukuran Nex-AGI sendiri melalui harness NexCUA miliknya, yang menurut aliansi tersebut akan dijadikan sumber terbuka tetapi hingga kini belum dilakukan. Dalam 48 jam pertama setelah peluncuran, belum ada laboratorium independen yang menjalankan Nex-N2.5 Pro, karena tidak ada seorang pun di luar aliansi yang dapat melakukannya.
Bacalah kedua set klaim tersebut secara berdampingan, dan kesimpulan yang jujur bukanlah "DeepSeek lebih pintar," melainkan "Angka milik DeepSeek dapat diperiksa, sedangkan milik Nex-N2.5 Pro tidak." Pada titik di mana lembar data kedua vendor itu tumpang tindih — Terminal-Bench 2.1 — DeepSeek mengklaim 87.9 berbanding 82.7 milik Nex-N2.5 Pro, selisih lima poin yang menguntungkan petahana, persis arah yang seharusnya diharapkan pembaca yang cermat: model yang sudah dirilis terukur lebih tinggi pada baris yang sama daripada model yang belum dirilis.
Harga: bilangan real, bilangan terjadwal, dan tanpa bilangan
DeepSeek V4 Pro's pricing is not one number, and that is its own story. At the 0813 GA the official API listed $0.435 per million input and $0.87 per million output; on August 16 DeepSeek moved the V4 family to a peak/off-peak schedule, so the official API now charges $0.66 input / $1.98 output off-peak and $1.32 / $3.96 at peak, with cached input at $0.022 off-peak and $0.044 at peak. Depending on when you call DeepSeek directly, the same model costs between roughly 50% more and four and a half times the launch rate. Route matters too: the OrcaRouter model page for DeepSeek V4 Pro currently lists a flat $0.44 input / $0.88 output per million — the provider's rate passed through with no markup — which undercuts even the off-peak official schedule. That flat route is the price to beat if you are comparing cost per token, and it is the kind of number that only exists because a routing layer shows you the provider's real rate rather than a repriced one.

Nex-N2.5 Pro tidak memiliki harga untuk dibandingkan dengan semua itu. Tingkat layanan terkelolanya gratis, dan Nex-AGI belum menerbitkan tarif berbayar per token untuk keluarga model tersebut, sehingga ekonomi model ini simply tidak diketahui — titik akhir gratis membuktikan bahwa bangunannya berfungsi, tidak lebih. Jika bobot model dirilis dan penyedia mulai melayani Nex-N2.5 Pro dengan harga terdaftar, perbandingan yang jujur menjadi mungkin; sampai saat itu, "gratis" adalah mekanisme pratinjau, bukan sinyal pasar.
Dua jenis agen yang berbeda.
Memilih di antara keduanya berarti Anda memilih di antara dua pekerjaan, bukan dua skor. Nex-N2.5 Pro diperuntukkan bagi agen yang mengoperasikan komputer: ia membaca layar, menggerakkan kursor, menyunting berkas, memeriksa hasil visual, lalu terus berjalan — sesi 468 aksi yang didemonstrasikan di Pokemon Platinum adalah wujud ambisi tersebut. DeepSeek V4 Pro diperuntukkan bagi agen yang mengoperasikan API: ia bernalar, menulis kode multi-berkas, memanggil alat, dan menghasilkan keluaran terstruktur yang panjang, semuanya lewat saluran teks yang batas keluaran 384K dan konteks 1M-nya ada untuk melayani. Tim yang membangun otomasi peramban sebaiknya mengawasi Nex-N2.5 Pro. Tim yang membangun agen pengodean atau pekerjaan berbasis pengetahuan sebaiknya membandingkan DeepSeek V4 Pro dengan model frontier tertutup, dan Nex-N2.5 Pro belum menjadi kandidat untuk pekerjaan itu — ia tidak dapat mengeluarkan citra dari proses, dan klaim pengodeannya lebih rendah serta kurang terverifikasi dibandingkan model yang dibandingkan dengannya.
Keputusannya: tunggu yang satu, bangun yang lain
Dalam pertarungan hari ini, DeepSeek V4 Pro adalah satu-satunya target pengembangan yang rasional. Bobotnya dapat diunduh, harganya diketahui — dan lebih murah lewat rute OrcaRouter yang tarifnya flat daripada lewat jadwal puncak DeepSeek sendiri — dan klaimnya dapat diverifikasi oleh siapa pun dalam satu sore. Ini juga merupakan tempat alami untuk mulai mengukur berapa biaya computer-use terbuka: arahkan lalu lintas coding-agent lewat OrcaRouter dengan failover otomatis untuk mengatasi batas ~500 konkurensi API resmi, dan Anda akan memiliki baseline bobot terbuka yang berfungsi dengan harga riil. Nex-N2.5 Pro adalah taruhan jangka panjang yang lebih menarik justru karena desainnya yang lebih terspesialisasi — operator multimodal dengan 17B parameter aktif yang dapat mengalahkan harga para pemimpin computer-use tertutup, sebagaimana DeepSeek mengalahkan harga model-model generalis tertutup — tetapi endpoint gratis yang tidak dapat diverifikasi bukanlah fondasi. Ketika shard Apache-2.0 dirilis dan perangkat uji independen memverifikasi skor OSWorld-2 itu, pertarungan ini berubah dalam semalam. Sampai saat itu, ini adalah perbandingan antara model yang dapat Anda miliki dan model yang hanya dapat Anda saksikan.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
