
Dots vs GLM-5.2: Dua Ujung Rantai Pasok Agen
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 349 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 210 tok/s
- OrcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- xAISpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
Dots and GLM-5.2 sit at opposite ends of the same supply chain, and neither one is the other's rival. Dots is the agent surface the company announced at DevDay on September 29, 2026 — an always-on worker with its own cloud computer and browser, connections to more than 4,000 apps, reachable in ChatGPT, Slack and Teams, powered by GPT-6 Astra and included with Pro and Business Premium at no extra cost. GLM-5.2 is Z.ai's open-weight flagship text model, released June 16, 2026, with a one-million-token context window, up to 128,000 tokens of output and a published rate of $1.40 per million input tokens and $4.40 per million output tokens. One is the layer you rent and cannot see inside; the other is the layer you can download, inspect and price to the token. If you are deciding how to run agents this quarter, that is the pair of decisions in front of you.
Apa masing-masingnya, dalam satu kali proses
• Apa itu — agen selalu aktif yang dihosting tanpa pengenal model sendiri (Dots) versus model teks yang dapat diunduh dengan bobot yang dipublikasikan (GLM-5.2)
• Siapa yang membuatnya — OpenAI, diumumkan di DevDay pada 2026-09-29, versus Z.ai (Zhipu AI), dirilis 2026-06-16
• Di mana ia berjalan — komputer cloud dan peramban OpenAI, terisolasi dari mesin Anda kecuali Anda menautkannya, versus di mana pun Anda menerapkannya: perangkat keras Anda sendiri, cloud pilihan Anda, atau endpoint kami
• Model di baliknya — GPT-6 Astra, yang disebutkan OpenAI dalam materi peluncurannya (menurut vendor), melawan GLM-5.2 itu sendiri, model mixture-of-experts yang dirilis Z.ai dengan bobot terbuka
• Modalitas — pesan, data aplikasi, dan peramban di satu sisi, dibandingkan dengan hanya teks masuk dan teks keluar, tanpa input gambar atau audio
• Kapasitas — batas respons yang tidak terdokumentasi untuk dot, dibandingkan dengan 1.000.000 token konteks dan 128.000 token keluaran maksimum
• Harga — dot pertama disertakan dengan Pro atau Business Premium, jatah belum dipublikasikan, dibandingkan $1,40 per juta input dan $4,40 per juta output seperti yang tercantum di katalog kami
• Bukti — demo vendor, tidak ada tolok ukur independen untuk dots, dibandingkan dengan Artificial Analysis Intelligence Index sebesar 33.7 dan 99.1 yang dilaporkan vendor pada τ²-Bench, keduanya disertakan beserta sumbernya di katalog kami
Separuh open-weights, dan jebakan hari pertama
Proposisi GLM-5.2 adalah proposisi open-weight yang sudah dikenal, dan ini lebih kuat dari biasanya karena model ini murah menurut ukuran apa pun dan bobotnya berarti keputusan deployment ada di tangan Anda. Hasil terbitan Z.ai sendiri memimpin dengan penggunaan alat agentik — 99.1 pada τ²-Bench, 76.8 pada MCP-Atlas dan 74.4 pada FrontierSWE — dan itu adalah angka vendor, yang perlu dikatakan secara gamblang karena angka-angka itulah yang membuat model ini tampak seperti barang murah. Pengukuran independen lebih terukur: Indeks Kecerdasan Artificial Analysis sebesar 33.7 menempatkannya di posisi tengah pada papan itu, potongan τ-banking sebesar 34.6 tergolong modest, dan 78.3 pada recall konteks panjang berada di belakang para pemimpin saat ini. Katalog kami membawa 123,2 juta token lalu lintas pada model ini selama tujuh hari terakhir, yang merupakan tanda paling jelas yang tersedia bahwa orang benar-benar menjalankannya.
Inilah masalahnya, dan itulah alasan artikel ini ada alih-alih sekadar perbandingan spesifikasi. Artificial Analysis menandai GLM-5.2 sebagai deprecated demi rilis yang lebih baru, GLM-5.3, dan halaman live-nya menyatakan hal itu di bagian atas: model tersebut masih dapat dirutekan dan masih tersedia secara umum, tetapi peta jalan vendor sudah bergerak maju dan angka indeks yang terlampir pada GLM-5.2 adalah snapshot, bukan pengukuran yang tetap. Angka-angka independennya yang lain tetap statis karena alasan yang sama — pemberitahuan AA menjelaskan bahwa setelah deprecation, pihaknya terus melakukan benchmark hanya untuk beban kerja default model tersebut, dan hasil untuk semua hal lainnya menjadi historis.

Dua pelajaran mengikuti dari itu, dan keduanya berlaku jauh melampaui model ini. Pertama, harga dan lisensi adalah fakta yang bertahan lama tentang rilis berbobot terbuka; posisi papan peringkat adalah hal yang terus berubah, dan sebuah model bisa murah, dapat diunduh, namun tetap saja tersalip. Kedua, penerusnya sudah ada di sini: Z.ai telah merilis GLM-5.3 sebagai andalan saat ini, dengan harga di bawah GLM-5.2 yaitu $1,26 untuk input dan $3,96 untuk output per juta dengan Intelligence Index independen sebesar 44,8 dibandingkan 33,7 milik GLM-5.2. Siapa pun yang membangun sekarang harus menghitung biaya model yang lebih baru terlebih dahulu dan memperlakukan GLM-5.2 sebagai batas bawah yang lebih murah di bawahnya, bukan sebagai yang terdepan dalam keluarga ini.
Berapa biaya sebuah titik, dan mengapa tak satu pun dari kalian berdua bisa menganggarkannya
OpenAI telah menerbitkan satu harga untuk dots — yang pertama sudah termasuk dalam Pro dan Business Premium, dengan batas yang diperluas pada bulan pertama dan percakapan yang tidak mengurangi batas penggunaan ChatGPT. Tidak ada angka kuota, tidak ada harga untuk dot kedua, tidak ada tarif untuk kecepatan atau kapasitas tambahan, tidak ada biaya per tugas yang diselesaikan, dan tidak ada harga perusahaan untuk dots spesialis yang saat ini dalam pengujian internal. Liputan keynote CNBC menampilkan kepala keuangan Sarah Friar menetapkan tier Pro 500 baru seharga $500 sebagai kuota penggunaan ditambah mode Ultrafast, bukan sebagai tarif per dot; paket termahal dalam daftar OpenAI juga tidak dapat dikonversikan menjadi biaya per unit kerja agen.
GLM-5.2 memiliki masalah yang sebaliknya, yaitu masalah yang lebih baik: terlalu banyak angka, semuanya dapat diperiksa. Kartu tarifnya adalah $1.40 dan $4.40 per juta token dengan pembacaan cache sebesar $0.26, dan modelnya dapat diunduh, sehingga biaya marginal untuk permintaan yang Anda jalankan sendiri adalah perangkat keras dan listrik, bukan tagihan vendor. Itulah pertukarannya dalam satu kalimat. Sebuah dot memberi Anda pekerja dan tanpa meteran; GLM-5.2 memberi Anda meteran dan tanpa pekerja.

Menempatkan model berbasis meteran di bawah agen yang Anda sewa
Cara yang berguna untuk menggunakan keduanya adalah memberi masing-masing separuh pekerjaan yang dilakukannya dengan baik. Dot menangani koordinasi: mengawasi proyek, mengejar orang dan sistem yang terlibat, lalu kembali dengan sesuatu yang sudah selesai. GLM-5.2 — atau penerus yang harganya Anda bandingkan dengannya — menangani penalaran yang perlu Anda kuasai: proses ekstraksi atas arsip sejuta token, generasi panjang, antrean klasifikasi, bagian di mana jawaban yang salah memakan biaya lebih besar daripada token yang dihematnya.
Pemisahan itu menuntut separuh penalaran agar portabel, yang merupakan masalah perutean, bukan masalah model. OrcaRouter menyajikan GLM-5.2 sebagai z-ai/glm-5.2 dengan harga daftar penyedia yang diteruskan dengan markup 0% — tidak ada tambahan di atasnya, sehingga pemotongan tarif Z.ai sampai ke akun Anda pada hari yang sama — dalam katalog berisi lebih dari 200 model di balik satu kunci, dengan alat failover dan perutean yang memungkinkan suatu pekerjaan berpindah ke model yang lebih baru atau lebih murah tanpa perubahan kode. Yang tidak ditawarkannya adalah titik: tidak ada endpoint dots, tidak ada pengenal model untuk agen itu, dan tidak ada cara untuk menukar kecerdasan yang berjalan di dalamnya. Batasnya nyata, dan berpura-pura sebaliknya akan menjadi satu-satunya slide yang tidak jujur dalam perbandingan ini.
Rekomendasi tersebut, dinyatakan sekali
Jika Anda ingin pekerjaan itu berjalan tanpa Anda yang mengendalikannya, belilah dot — harganya tidak lebih dari langganan yang mungkin sudah Anda miliki, dan keterbatasannya adalah Anda belum dapat membuktikan berapa banyak yang dihematnya untuk Anda. Jika Anda ingin mengetahui berapa biaya penalaran Anda dan ingin dapat memindahkannya nanti, letakkan GLM-5.2 atau penerusnya di balik endpoint Anda sendiri dan ukurlah penggunaannya. Tim-tim yang berhasil melakukannya dengan benar pada akhir 2026 melakukan keduanya, dan disiplin yang membuatnya berhasil adalah menolak membiarkan lapisan sewaan memiliki apa pun yang tidak dapat mereka gantikan.

Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
