
Step 5 Preview vs GLM-5.5: Satu Model Rilis Hari Ini, yang Lain Masih Ramalan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Pratinjau Step 5 membuka API-nya pada 20 September 2026, pada hari yang sama StepFun mengumumkannya, dan Anda dapat memanggilnya sore ini dari satu endpoint dengan harga $1,00 per juta token input dan $2,70 per juta token output. GLM-5.5 tidak ada. Tidak ada kartu model, tidak ada pengenal API, tidak ada harga, tidak ada checkpoint dan tidak ada file lisensi, dan tidak ada halaman Z.ai di mana pun yang menggunakan nama itu — karena GLM-5.5 adalah singkatan komunitas yang tidak pernah diadopsi oleh perusahaan. Asimetri itulah yang menjadi artikel ini. Berikut ini adalah apa yang sebenarnya dirilis oleh StepFun, apa yang benar-benar sudah mapan tentang flagship berikutnya dari Z.ai, dan adu langsung yang dapat Anda jalankan hari ini sebagai pengganti yang ada di judul.
Apa itu GLM-5.5, dan apa yang bukan
Nama itu mulai beredar pada pertengahan 2026, melekat pada jendela peluncuran, dan jendela itu memiliki asal yang dapat dilacak: prakiraan analis yang diteruskan pada 25 Juni 2026, yang menempatkan produk unggulan berikutnya dari Z.ai pada Agustus. Itu adalah jendela pemantauan, bukan komitmen dari vendor, dan Agustus berakhir tanpa itu. Yang dikirim Z.ai sebagai gantinya adalah GLM-5.3, diumumkan pada 14 Agustus, dengan API-nya aktif sekitar 18 Agustus dan bobot terbuka pada 28 Agustus, disusul oleh GLM-5.3-Flash pada 26 Agustus. Tidak ada checkpoint GLM-5.5 yang muncul di organisasi Hugging Face milik vendor itu sendiri, di mana repositori terbarunya masih paling tinggi pada seri GLM-5.3.
Penamaannya juga belum pasti. GLM-5.3, GLM-5.4, GLM-5.5, dan GLM-6 semuanya disebut-sebut dalam rentang waktu yang sama, dan Z.ai tidak mengonfirmasi satu pun di antaranya. Satu-satunya sinyal dari pihak perusahaan adalah komentar salah satu pendiri tentang rilis "epic plus", yang lebih merupakan suasana hati ketimbang spesifikasi. Analis yang membaca irama vendor — kira-kira satu model unggulan setiap 54 hingga 70 hari — kini memproyeksikan model berikutnya ke jendela yang berjalan dari 8 Oktober hingga 9 November 2026, dan memperkirakan model itu akan diberi nomor GLM-5.4, bukan GLM-5.5.
Tiga klaim beredar seolah-olah sudah dikonfirmasi, dan ada baiknya kita tepat mengenai ketiganya. Jumlah parameter adalah yang paling lemah: tidak ada sumber resmi yang mendukung angka "lebih dari 1 triliun", dan unggahan media sosial belakangan yang membesar-besarkannya melebihi 3 triliun sama sekali tidak mengutip apa pun. Konteks 1M token adalah asumsi paling aman, karena GLM-5.2 dan GLM-5.3 keduanya membawanya. Bobot terbuka lebih merupakan harapan daripada janji — Z.ai telah merilis bobot untuk beberapa flagship terakhirnya, yang merupakan pola, bukan komitmen.
Apa yang sebenarnya dirilis Step 5 Preview
Model StepFun adalah bagian konkret dari perbandingan ini, dan spesifikasinya tidak biasa. Ini adalah model sparse mixture-of-experts dengan total 600B parameter dengan sekitar 27B aktif per token — rasio aktivasi mendekati 4,5% — dibangun di atas transformer narrow-and-deep 92 lapis dengan sparse grouped-query attention dan block-wise token merging. Jendela konteksnya adalah 1M token, masukannya adalah teks dan gambar, keluarannya adalah teks, dan ia bernalar dengan extended thinking. StepFun melewati seluruh lini Step 4.x untuk sampai ke sini, langsung dari Step-3.7-Flash ke Step 5.
• Indeks Kecerdasan — 44 pada Artificial Analysis, peringkat ke-24 dari 200 model yang dinilai, dibandingkan dengan median 24
• Kecepatan output — 99,8 token per detik, ke-45 dari 200
• Waktu hingga token pertama — 2,96 detik pada uji independen yang sama
• Harga — $1,00 per 1 juta token masukan, $2,70 per 1 juta token keluaran, dengan diskon cache 95%
• Biaya per tugas Intelligence Index — $0,71, ke-27 dari 200
• Bobot — tidak ada hari ini; checkpoint BF16 dijadwalkan pada 15 Oktober 2026
• Lisensi — tidak ada yang diterbitkan. Model ini bersifat proprietari, tanpa pemberian izin penggunaan komersial, hak redistribusi, atau izin fine-tuning yang dinyatakan
Harga adalah baris yang menarik perhatian, dan demikian pula hal yang sebenarnya kurang menguntungkan StepFun daripada yang terlihat pada awalnya: 160 juta token keluaran pada Intelligence Index dibandingkan median 92 juta, peringkat ke-64 dari 200 pada ukuran tersebut. Model ini bertele-tele, dan verbositas adalah pengganda biaya tepat pada beban kerja agentik yang menjadi sasaran penjualannya. Angka biaya per tugas sebesar $0,71 sudah memperhitungkan hal itu, sehingga itulah angka yang lebih jujur untuk dikutip daripada harga daftar.
Evaluasi StepFun sendiri tidak direproduksi dan harus dibaca sebagai materi vendor sampai ada pihak independen yang menjalankannya. Mereka menempatkan model itu pada 29,5 di ALE-CLI, 66,4 di FrontierFinance, 83,3 di DRACO, 80,5 di ProgramBench, 67,7 di DeepSWE v1.1, dan 49,0 di StepCodeBench, dengan 33,3% di Terminal-Bench 4.0 dan 1571 di GDPval-AA v2. StepFun juga melaporkan puncak MLA 508 TFLOPS dalam tugas optimisasi kernel GPU 24 jam, dibandingkan 493 untuk Claude Opus 5. Itu adalah angka StepFun tentang model yang belum dibuka oleh StepFun.

Adu langsung yang bisa Anda jalankan sebagai pengganti yang ini
Jika Anda menginginkan perbandingan yang dijanjikan judul, pengganti yang jujur adalah Step 5 Preview melawan GLM-5.3 — model yang sebenarnya dirilis Z.ai, yang masih menjadi unggulan terbuka mereka saat ini, dan yang akan digantikan oleh GLM-5.5 mana pun. Di papan independen, keduanya terpaut satu poin. Dalam hampir semua hal lainnya, keduanya tidak demikian.
• Indeks Kecerdasan — Step 5 Preview 44 vs GLM-5.3 45
• Parameter — 600B total / 27B aktif vs 753B total / 40B aktif
• Kecepatan output — 99,8 token/dtk vs 72,1 token/dtk
• Waktu ke token pertama — 2,96 dtk vs 2,99 dtk
• Harga per 1 juta token — $1,00 masuk / $2,70 keluar vs $1,40 masuk / $4,40 keluar
• Diskon cache — 95% vs 81%
• Biaya per tugas Intelligence Index — $0.71 vs $2.01
• Modalitas input — teks dan gambar vs hanya teks
• Lisensi — tidak ada yang diterbitkan vs lisensi Z.ai khusus yang bukan MIT
Pola ini mengulangi apa yang telah ditetapkan oleh peluncuran Step 5 Preview terhadap setiap model yang telah dirilis yang pernah menjadi pembanding skornya: keunggulan efisiensi yang tegas dan hasil seri secara statistik dalam hal kemampuan. Model ini menghasilkan token sekitar 38% lebih cepat, biayanya kira-kira setengahnya per juta token di kedua arah, dan menjadi 2,8 kali lebih murah per tugas indeks dibandingkan GLM-5.3 — meskipun skornya satu poin lebih rendah. Di papan skor, angka 44 itu juga menempatkannya sejajar dengan Kimi K3, yang patut diketahui sebelum menganggap salah satunya sebagai pemimpin.
Satu-satunya baris di mana Step 5 Preview jelas tertinggal adalah baris yang tidak dapat Anda uji tolok ukurnya. GLM-5.3 memiliki berkas lisensi dan bobot yang dapat diunduh; Step 5 Preview memiliki repositori Hugging Face yang hanya berisi satu .gitattributes dan tanggal yang dinyatakan 15 Oktober untuk pos pemeriksaan BF16. Jika unggulan berikutnya dari Z.ai hadir dengan bobot terbuka di bawah ketentuan khusus yang sama seperti yang telah digunakannya sepanjang tahun, ia masuk ke satu-satunya kategori di mana Step 5 Preview saat ini tidak memiliki jawaban — itulah alasan sebenarnya mengapa perbandingan GLM-5.5 layak ditunggu alih-alih dijalankan.

Mengapa menunggu GLM-5.5 adalah pilihan yang mahal
Masalah praktis dengan model yang selama dua bulan ini selalu tinggal dua bulan lagi adalah pekerjaan evaluasi Anda tidak bisa menunggu bersamanya. GLM-5.5 tidak memiliki endpoint, sehingga tidak dapat di-benchmark, dibandingkan harganya, diuji beban, atau ditempatkan di balik aturan fallback. Setiap minggu yang dihabiskan untuk merencanakan seputar model itu adalah minggu keputusan yang ditunda berdasarkan ramalan — dan ramalan itu sudah melewatkan satu jendela.
GLM-5.3, sebaliknya, sudah aktif di OrcaRouter dengan z-ai/glm-5.3 pada $1,26 untuk input dan $3,96 untuk output, dibandingkan dengan daftar Z.ai sebesar $1,40 dan $4,40 di halamannya sendiri. Harga ini diteruskan tanpa markup, yang berarti angka yang Anda lihat adalah tarif penyedia saat ini, bukan tarif yang kami tetapkan, dan perubahan harga vendor langsung berlaku di sisi kami pada hari yang sama, bukan pada siklus penagihan berikutnya.
Step 5 Preview tidak ada di katalog kami dan kami tidak merutekannya. Ia berjalan di API dan Studio milik StepFun sendiri, dan itu satu-satunya tempat ia berjalan sampai checkpoint 15 Oktober hadir. Sementara itu, yang OrcaRouter berikan kepada Anda adalah semua hal di sisi lain perbandingan tersebut di balik satu API untuk lebih dari 200 model: GLM-5.3 dengan tarif di atas, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 dan sisanya, dengan failover otomatis antar penyedia yang menjaga jalur produksi tetap stabil sementara kurva kapasitas sebuah preview masih belum diketahui, dan DSL perutean yang menyusun beberapa di antaranya menjadi satu panggilan alih-alih integrasi kedua. Uji benchmark preview terhadap model produksi dengan kunci yang sama; biarkan jalur produksi tetap di tempatnya.

Apa yang bisa mengubah jawabannya
Dua tanggal menentukan ini. 15 Oktober adalah saat StepFun menyatakan checkpoint BF16 untuk Step 5 Preview akan hadir, dan lisensi yang dirilis bersamanya adalah ketidakpastian tunggal yang paling berdampak dalam perbandingan ini — lisensi permisif akan menjadikan keunggulan biaya per tugas 2,8 kali sebagai sesuatu yang Anda miliki, bukan sewa, dan akan menghapus satu-satunya sumbu di mana GLM-5.3 jelas unggul. Lisensi restriktif menyisakan GLM-5.3 sebagai satu-satunya dari pasangan ini yang dapat Anda jadikan fondasi untuk membangun produk, dan mengubah selisih satu poin menjadi hal sepele tentang dua model yang toh akan Anda gunakan secara berbeda.
Yang kedua adalah jendela analis yang berlangsung dari 8 Oktober hingga 9 November untuk produk unggulan berikutnya Z.ai, yang bisa jadi bernama GLM-5.5 atau tidak, dan bisa jadi menyerupai rumor itu atau tidak. Jika ia muncul sama sekali, ia hadir sebagai model dengan lisensi dan checkpoint — dua hal yang tidak dimiliki Step 5 Preview — dan perbandingannya menjadi perbandingan yang sesungguhnya.
Sampai keduanya teratasi, pertanyaan yang berguna bukanlah mana dari keduanya yang lebih baik, karena salah satunya tidak dapat dijalankan. Melainkan model mana di antara model yang ada yang seharusnya Anda jadikan pijakan untuk membangun sekarang, dan apakah jawabannya berubah ketika checkpoint berikutnya muncul. Pertanyaan itu punya jawaban yang bisa diuji minggu ini, dan tidak perlu menunggu sebuah nama menjadi model.
Dibandingkan dalam artikel ini3
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
