Hero Nex-N2.5 Pro vs GLM-5.2 — kartu judul yang dibuat bertuliskan 'Nex-N2.5 Pro vs GLM-5.2', dengan subjudul 'Dua model agenik open-weights, satu kebetulan yang mencurigakan pada 82,7', serta overline 'Nex-AGI vs Z.ai — September 2026'.
Guides & Insights

Nex-N2.5 Pro vs GLM-5.2: Skor 82.7 yang Sama di Terminal-Bench, Dua Asal-usul yang Sangat Berbeda

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua model agentik berbobot terbuka, satu kebetulan yang mencurigakan: Nex-N2.5 Pro dan GLM-5.2 sama-sama muncul di angka 82.7 pada Terminal-Bench 2.1. Nex-AGI mencetak 82.7 untuk Nex-N2.5 Pro di kartu modelnya sendiri, diukur dengan harness NexCUA milik aliansi tersebut, yang belum pernah dilihat publik. Angka terbaik yang dilaporkan Z.ai untuk GLM-5.2 pada rangkaian pengujian yang sama juga 82.7 — dan ketika harness independen menjalankan ulang model itu, hasilnya menjadi 77.9, sekitar lima poin di bawah angka vendor itu sendiri. Seri sempurna antara angka yang tidak bisa diperiksa siapa pun dan angka yang sudah menyusut begitu diperiksa bukanlah seri sama sekali. Itu adalah demonstrasi paling jelas mengapa perbedaan antara "bobot terbuka" dan "bobot yang pada akhirnya akan ada" menentukan pertarungan ini sebelum satu baris tolok ukur pun dibaca.

Kedua model berada di lingkungan komersial yang sama dan tidak bisa lebih berbeda sifatnya. Nex-N2.5 Pro, yang diumumkan pada 8 September 2026, adalah model penggunaan komputer multimodal — dengan total 397 miliar parameter dan sekitar 17 miliar yang aktif, dibangun dari garis keturunan Qwen3.5, dirancang untuk membaca layar dan mengendalikan sesi peramban atau desktop dengan putaran umpan balik visual. GLM-5.2 adalah model unggulan berlisensi MIT dari Z.ai (Zhipu AI) untuk penalaran dan pengodean jangka panjang — dengan total sekitar 743 miliar parameter dan sekitar 40 miliar yang aktif, khusus teks, tersedia umum sejak 16 Juni 2026, dan model yang telah menjadi jangkar skor independen tingkat open-weights selama berbulan-bulan. Yang satu melihat dunia melalui piksel dan bertindak atasnya. Yang lain berpikir dalam teks dan mengirimkan kode. Lisensi pada keduanya menyatakan bahwa Anda dapat membangun bisnis di atasnya; perbedaannya adalah pada salah satunya, lisensi itu saat ini baru berupa janji.

Nomor yang sama, dua asal-usul yang berbeda.

Mulailah dari hasil imbang tersebut, karena hasil imbang itu mengajarkan keseluruhan pertandingan. Kartu Nex-AGI mencantumkan Terminal-Bench 2.1 sebesar 82.7 untuk Nex-N2.5 Pro, bersama OSWorld-2 sebesar 56.4, SWE-Bench Pro sebesar 61.2, dan BrowseComp sebesar 89.7 — semuanya dihasilkan melalui kerangka uji NexCUA dan tidak ada satu pun yang direproduksi secara independen pada hari-hari awal model tersebut, dengan alasan sederhana bahwa bobotnya tidak dapat diunduh. Angka Z.ai sebesar 82.7 untuk GLM-5.2 pada Terminal-Bench 2.1 adalah angka terbaik yang dilaporkan vendor tersebut, tetapi angka itu berkaitan dengan model yang dapat diunduh siapa saja dari Hugging Face dan dijalankan ulang sore ini; pengukuran kerangka uji independen sebesar 77.9 sudah ada, dan kira-kira lima poin di bawah klaim Z.ai. Ketika angka dari vendor menyusut saat diuji secara independen, itu bukan skandal — itu adalah pajak normal atas pengukuran mandiri. Ketika angka dari vendor pesaing bahkan tidak dapat diuji, ketiadaan pajak itulah masalahnya, bukan tanda bahwa angka itu murni.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GLM-5.2 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; License Apache-2.0 pending; Params 397B / ~17B active; Modality text + image (computer use); Terminal-Bench 2.1 82.7 vendor; Price free hosted / no list. Right column GLM-5.2: GA Jun 16 2026; License MIT live now; Params ~743B / ~40B active; Modality text only; Terminal-Bench 2.1 82.7 claimed / 77.9 independent; Price $1.40 / $4.40 per 1M. Footer: 'Nex and Z.ai figures vendor-reported; 77.9 per the OrcaRouter harness.'

Baca baris-baris di sekitarnya dengan cara yang sama. GLM-5.2 memegang pembacaan indeks independen tertinggi yang pernah dihasilkan tier terbuka — kisaran rendah 50-an pada Intelligence Index Artificial Analysis saat ini — itulah sebabnya model ini menjadi model terbuka referensi selama berbulan-bulan meskipun bukan rilis baru yang paling mencolok. Nex-N2.5 Pro tidak memiliki entri indeks independen sama sekali. Pada baris-baris di mana kedua vendor mengklaim angka, yang dapat diverifikasi adalah milik vendor petahana; pada baris-baris di mana hanya Nex-AGI yang memublikasikan, angka-angka tersebut belum dapat direproduksi. Itu bukan vonis tentang model mana yang lebih cerdas. Itu adalah vonis tentang model mana yang boleh Anda verifikasi.

Lembar spesifikasi lebih konsisten daripada yang Anda perkirakan.

Singkirkan benchmark-nya dan kedua model tersebut nyaris sejalan dalam hal-hal fundamental:

Dirilis — Nex-N2.5 Pro: 8 September 2026 (endpoint yang dihosting aktif, bobot menyusul). GLM-5.2: GA 16 Juni 2026, bobot tersedia.

Lisensi — Nex-N2.5 Pro: Apache-2.0, bobot segera tersedia. GLM-5.2: MIT, dapat diunduh sekarang.

Skala — Nex-N2.5 Pro: total 397B / ~17B aktif. GLM-5.2: total ~743B / ~40B aktif.

Modalitas — Nex-N2.5 Pro: masukan teks dan gambar, keluaran teks, loop visi penggunaan komputer. GLM-5.2: model penalaran khusus teks.

Konteks / keluaranNex-N2.5 Pro: konteks 262.144 token. GLM-5.2: konteks 1M token, batas keluaran 128K.

Kontrol penalaran — Nex-N2.5 Pro: tidak ada / sedang (adaptif, default) / tinggi. GLM-5.2: kontrol reasoning-effort pada string model yang sama.

Harga per 1 juta token — Nex-N2.5 Pro: tier gratis yang dihosting, tanpa harga yang tercantum. GLM-5.2: $1.40 input / $4.40 output, $0.26 input cache.

Amplop spesifikasi keduanya berbeda sesuai dengan perbedaan peran kedua model: GLM-5.2 menghadirkan konteks teks hingga satu juta token penuh dan batas keluaran 128K untuk sesi rekayasa yang panjang, sementara Nex-N2.5 Pro menukar ukuran konteks dengan kanal visi dan jendela 262K yang lebih kecil untuk beban kerja berukuran layar. Tidak ada spesifikasi yang salah; keduanya memang dirancang untuk tugas yang berbeda.

Bobot terbuka, dua makna yang berbeda

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Di sinilah perbandingan berhenti menjadi soal angka sama sekali. GLM-5.2 terbuka sebagaimana Anda merilis produk yang bisa dijadikan fondasi bisnis: lisensi MIT, bobot tersedia di Hugging Face, tanpa pembatasan penggunaan komersial, tanpa klausul berbagi data, tanpa vendor yang mengawasi dari belakang. Anda dapat mengunduhnya, melakukan fine-tuning, menjalankannya di balik batas kepatuhan Anda sendiri, atau membawanya ke host mana pun yang Anda suka — dan karena bobotnya sudah dirilis, harganya punya batas bawah yang tidak bisa dinaikkan oleh satu vendor pun. Nex-N2.5 Pro dijanjikan di bawah Apache-2.0, lisensi yang sama permisifnya, tetapi banner di kartu Hugging Face-nya menyebut bobot akan segera hadir tanpa tanggal pasti. Bagi tim yang terikat aturan tata kelola data, atau yang ingin lepas sepenuhnya dari harga per-token dalam skala besar, perbedaan itulah yang menjadi penentu: GLM-5.2 adalah model yang bisa Anda miliki hari ini, sedangkan Nex-N2.5 Pro adalah model yang baru dijanjikan. Matematika self-hosting juga berpihak pada pendatang baru ketika bobot akhirnya dirilis — 17B parameter aktif pada satu node delapan-H100 adalah kebutuhan sumber daya yang jauh lebih terjangkau daripada kotak ~40B aktif milik GLM-5.2 — tetapi "ketika bobot akhirnya dirilis" menanggung beban yang sangat besar dalam kalimat itu.

Keluarga-keluarga itu sedang bergerak ke arah yang berlawanan.

Kedua model berada dalam keluarga yang bergerak cepat, dan lintasannya mengarah ke arah yang berbeda. Silsilah GLM-5.2 transparan dan iteratif: Z.ai merilis GLM-5.3 pada bulan Agustus sebagai penyegaran pasca-pelatihan dari basis 5.2 yang sama, dan GLM-5.3 Flash pada awal September, sehingga bobot 5.2 yang menjadi dasar pengembangan Anda saat ini adalah fondasi yang terus ditingkatkan oleh keluarga tersebut — pengetahuan arsitektur dan fine-tuning Anda terbawa ke depan. Keluarga Nex-AGI adalah taruhan pada generasi yang benar-benar baru: Nex-N2.5 Mini pada 35B, Nex-N2.5 Pro pada 397B, dan Nex-N2.5 Max khusus teks pada 1.6T yang basisnya sendiri adalah DeepSeek-V4-Pro-Base, dengan bobot Pro yang memungkinkan siapa pun memvalidasi klaim keluarga itu masih belum dipublikasikan. Tim yang memilih platform untuk dikembangkan sedang memilih antara silsilah dengan peta jalan pembaruan yang telah dipublikasikan dan rilis pertama yang babak keduanya belum tiba.

Mana yang layak untuk build-mu?

Jika persyaratan Anda adalah "modelnya harus milik kami" — untuk tata kelola data, untuk audit, untuk produk yang tidak ingin Anda kendalikan oleh satu vendor — maka GLM-5.2 bukan pilihan yang lebih baik dalam perbandingan ini; ia adalah satu-satunya pilihan, karena ia adalah satu-satunya model di dalamnya yang dapat Anda unduh. Ia juga satu-satunya yang memiliki skor independen, dan harganya sesuai daftar Z.ai yaitu $1,40 per juta input dan $4,40 per juta output. Jika persyaratan Anda adalah agen multimodal untuk penggunaan komputer yang pada akhirnya dapat mengungguli para pemimpin tertutup, Nex-N2.5 Pro adalah tesis jangka panjang yang lebih menarik — operator visi dengan 17B aktif dari aliansi yang jelas tahu apa yang ingin dibangunnya — tetapi tesis bukanlah ketergantungan, dan endpoint yang dihosting gratis bukanlah fondasi.

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), marked FEATURED, showing the header stats $1.40 input and $4.40 output per million tokens and the byline 'by Z.ai - 2026-06-16'.

Cara praktis untuk menindaklanjuti semua ini adalah dengan membangun dari yang sudah ada dan mengukur janjinya ketika hal itu terwujud. GLM-5.2 tersedia di OrcaRouter dengan harga daftar Z.ai — sama $1.40 / $4.40, diteruskan tanpa markup — dan karena bobotnya terbuka, model ini juga dapat di-hosting sendiri jika Anda ingin pengukurannya mencakup tumpukan penyajian Anda sendiri. Ini adalah titik referensi untuk menjalankan beban kerja agentik aktual Anda saat ini, dengan DSL perutean menjadi pengganti untuk hari ketika Nex-N2.5 Pro muncul pada penyedia dengan harga daftar: saat itu terjadi, mengganti perbandingan adalah aturan perutean, bukan migrasi. Sampai detail-detailnya dirilis dan pengukur independen mengonfirmasi — atau mengoreksi — angka 82.7 itu, Nex-N2.5 Pro vs GLM-5.2 adalah pertarungan antara model yang dapat diverifikasi dan angka yang tidak dapat diverifikasi.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari