Kartu judul yang dihasilkan berjudul 'Step 5 Preview — apa kata repo' mencantumkan enam baris: total parameter 600B, diaktifkan per token 27B, jendela konteks 1 juta token, input teks dan gambar, AA Intelligence Index 44, dan harga $1,00 input / $2,70 output. Footer berbunyi 'StepFun mengumumkan 20 September 2026; bobot dijadwalkan 15 Oktober 2026. Angka indeks menurut Artificial Analysis.'
Engineering & Research

Step 5 Preview Diumumkan: Apa yang Sebenarnya Dibawa Flagship 600B StepFun, dan Apa yang Masih Kurang

Penulis

Gideon Frost

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

StepFun mengumumkan Step 5 Preview pada 20 September 2026 — model unggulan sparse mixture-of-experts dengan 600 miliar parameter dengan 27B parameter aktif per token, jendela konteks 1 juta token, input gambar native, dan skor Artificial Analysis Intelligence Index 44. API dibuka pada hari yang sama. Yang tidak dibuka adalah modelnya sendiri: repositori Hugging Face stepfun-ai/Step-5-Preview-BF16 sudah ada pada sore hari pengumuman dan berisi tepat satu file, .gitattributes, tanpa bobot, tanpa lisensi, tanpa kartu model, dan tanpa konfigurasi. Materi StepFun sendiri mencantumkan rilis open-weights pada 15 Oktober 2026. Jadi ringkasan jujur satu baris untuk peluncuran ini adalah bahwa model tersebut dapat dipanggil hari ini dan dapat diunduh dalam sekitar tiga setengah minggu, dan itu adalah dua hal yang berbeda. Ini juga model yang sama yang dibahas blog ini lebih awal hari ini sebagai kebocoran tanpa pengumuman, di-benchmark dengan tag pengujian sebelum StepFun menerbitkan halaman produk — pengingat yang berguna bahwa pratinjau dapat berpindah dari kebocoran ke peluncuran tanpa satu pun angka berubah.

Repo ini hanyalah sebuah placeholder, dan itulah keseluruhan ceritanya

Ketika vendor menerbitkan bobot, repositori adalah buktinya. Di dalamnya ada berkas lisensi, config yang berisi jumlah parameter, README dengan tujuan penggunaan dan tabel evaluasi, serta shard safetensors yang ukuran totalnya memberi tahu Anda apakah klaim parameter itu nyata. stepfun-ai/Step-5-Preview-BF16 tidak memiliki semua itu. Catatan API Hugging Face untuknya menunjukkan stempel waktu pembuatan 2026-09-20T03:52Z, nol unduhan, dua suka, objek config kosong, tanpa pipeline_tag, tanpa lisensi, dan satu berkas sibling. Halaman organisasi StepFun mencantumkannya, dan tidak mencantumkan repositori Step 5 lain — tidak ada build FP8, tidak ada build NVFP4, tidak ada GGUF, tidak ada varian kuantisasi yang menyertai Step-3.7-Flash pada Juni.

Bacalah itu sebagai penjadwalan, bukan sebagai misteri. Akhiran BF16 pada nama repo adalah petunjuknya: lab yang berniat menerbitkan checkpoint bfloat16 terlebih dahulu — format yang Anda fine-tune dan kuantisasi, sebelum build penyajian FP8 dan NVFP4 tiba — menamai repositori seperti itu saat pembuatan dan mengisinya kemudian. StepFun telah menyebut 15 Oktober dalam materi pengumumannya sendiri. Sampai saat itu, repositori tersebut hanyalah klaim tentang sebuah niat, dan satu-satunya hal yang dibuktikannya adalah bahwa StepFun telah mereservasi namespace itu.

Ini penting karena alasan praktis. Preview dan bobot yang hilang adalah sinyal yang sama yang menunjuk ke arah yang sama: model dapat dipanggil, harganya sudah ditetapkan, dan artefak yang akan Anda jalankan di perangkat keras Anda sendiri belum ada. Rencana apa pun yang mengasumsikan Step 5 Preview yang dihosting sendiri sebelum pertengahan Oktober adalah rencana tanpa artefak di belakangnya.

Apa yang sebenarnya diumumkan

Kerangka StepFun sempit dan spesifik: Step 5 Preview adalah model dasar untuk pekerjaan agentik dunia nyata — pengodean AI, rekayasa perangkat lunak, pekerjaan berbasis pengetahuan profesional, dan keuangan — dengan penekanan pada konteks panjang, panggilan alat multi-turn, dan eksekusi berkelanjutan, bukan pada kualitas obrolan. Perusahaan melewati lini Step 4.x sepenuhnya, beralih dari Step-3.7-Flash langsung ke Step 5, yang dengan sendirinya merupakan pernyataan tentang seberapa besar langkah yang dianggapnya.

Satu detail penanggalan patut diperhatikan, karena hal semacam ini bisa mengacaukan kalender pengadaan: Artificial Analysis menyebut model ini bertanggal 18 September 2026, dua hari sebelum pengumuman StepFun sendiri. Papan skor menilai suatu model ketika model itu dapat diakses, dan selisih dua hari itu adalah jeda biasa antara model menjadi dapat dipanggil dan vendor menulis tentangnya. Pengumuman StepFun — 20 September, dengan API dan Studio dibuka pada hari yang sama — adalah tanggal yang harus dikutip, dan tanggal bobot 15 Oktober berasal dari materi yang sama.

Spesifikasi sebagaimana diterbitkan:

• Total parameter — 600B, sparse mixture-of-experts

• Aktif per token — 27B, sekitar 4,5% dari total, rasio yang luar biasa jarang

• Jendela konteks — 1M token

• Masukan — teks dan gambar secara native; keluaran hanya teks

• Penalaran — ya, dengan pemikiran yang diperluas

• Harga — $1,00 per juta token masukan, $2,70 per juta token keluaran, dengan diskon cache 95%

• Ketersediaan — API dan Studio dibuka mulai 20 September; bobot dijadwalkan 15 Oktober

Klaim efisiensi yang dijadikan andalan StepFun adalah bahwa pembagian 600B/27B menempatkan model tersebut di batas Pareto — kemampuan per unit komputasi — dan perusahaan membingkainya sebagai tiga generasi dari upaya yang sama, dari Step-3.5-Flash melalui Step-3.7-Flash hingga yang ini. Ini adalah cerita yang koheren, dan rasio sparse adalah mekanismenya: pada 27B aktif, biaya penyajian per token berada di rentang model yang jauh lebih kecil sementara total 600B sebagian besar merupakan soal jejak memori.

Klaim vendor, dan angka pihak ketiga di sebelahnya

Dua kelas angka muncul dalam materi peluncuran, dan keduanya tidak boleh dibaca dengan cara yang sama. Evaluasi StepFun sendiri adalah kelas pertama: klaim biaya tugas tunggal sebesar seperdelapan dari Claude Opus 5; peringkat kedua di belakang GPT-6 Astra atau Claude Opus 5 pada ALE-CLI, FrontierFinance, dan DRACO; proses optimasi kernel GPU selama 24 jam yang meningkatkan kinerja puncak kernel MLA menjadi 508 TFLOPS dibandingkan 493 milik Claude Opus 5; eksperimen pascapelatihan otomatis yang menaikkan Qwen3-30B-A3B dari 53,3% menjadi 60% pada AIME24; DeepSWE v1.1 pada 67,7% dan StepCodeBench internalnya pada 49,0%. StepFun membangun StepCodeBench sendiri — 553 repositori kode, sembilan jenis tugas, 33 bahasa pemrograman — yang menjadikannya instrumen yang wajar untuk mengukur modelnya sendiri dan bukan instrumen yang independen.

Kelas kedua diukur oleh pihak lain, dan itulah bagian yang perlu dijadikan acuan dalam perencanaan. Artificial Analysis memberi Step 5 Preview skor 44 pada Intelligence Index v4.3.2, menempatkannya di peringkat ke-24 dari 200 model — setara dengan Kimi K3, tertinggal satu poin dari GLM-5.3, dan setara dengan setelan upaya penalaran sedang Claude Opus 5. Pada Terminal-Bench 4.0, papan yang sama mencatat 33,3%, di depan DeepSeek V4.1 Flash pada 26,8% dan jauh di depan Kimi K3 pada sekitar 12,6%. Kecepatan output terukur 99,8 token per detik dan waktu ke token pertama 2,96 detik — keduanya dari proses independen yang sama, dan keduanya jenis angka yang menentukan apakah loop agen terasa interaktif.

Satu angka pihak ketiga justru berlawanan arah dan layak disandingkan dengan harga. Proses indeks yang sama menggunakan 160M token keluaran untuk Step 5 Preview, dibandingkan dengan median 92M pada model-model yang dinilai — model ini bertele-tele. Dengan tarif $2,70 per juta token keluaran, sifat bertele-tele itu tidak gratis: 160M token keluaran setara dengan sekitar $432 dari total biaya proses sebesar $922,84, dan pada model yang mengenakan tarif tiga kali lipat, itu akan menjadi pos dominan dalam tagihan. Harga utama yang rendah dan jumlah token per tugas yang tinggi adalah dua sisi dari satu angka, dan biaya per tugas indeks — $0,71 — adalah angka yang sudah memuat keduanya.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens at rank 64 of 200, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

Apa yang akurat dari bocoran itu, dan satu hal yang belum dipastikan

Liputan sebelumnya blog ini ditulis berdasarkan uji evaluasi yang muncul sebelum adanya pengumuman, dan liputan itu menandai klaim yang tidak dapat dikonfirmasi. Pengumuman tersebut menyelesaikan sebagian besar klaim itu. Pasangan 600B/27B kini dinyatakan oleh vendor, bukan disimpulkan. Jendela konteks 1M token kini ada dalam spesifikasi StepFun sendiri, bukan hanya di papan pihak ketiga. Harga $1.00 dan $2.70 adalah harganya. Namanya adalah Step 5 Preview, bukan alternatif yang dirumorkan.

Yang tidak dilakukan oleh pengumuman itu adalah menyelesaikan kontradiksi jendela konteks yang dimunculkan oleh liputan kebocoran tersebut. Sebuah konfigurasi pihak ketiga terpisah yang beredar di perkakas pengembang mencantumkan model tersebut pada 350.000 token konteks dengan keluaran maksimum 64.000 token. Jendela 1M dan jendela 350k adalah produk yang berbeda dengan biaya memori yang berbeda, dan plafon keluaran 64k merupakan batasan keras tepat pada pekerjaan agentik berhorizon panjang yang menjadi alasan model ini dijual. Pengumuman StepFun menyebut 1M dan tidak menyebutkan batas keluaran. Ada baiknya mengetahui yang mana yang akhirnya dipakai oleh routing Anda sebelum Anda membangun pipeline yang bergantung pada jawabannya, dan itu adalah pertanyaan untuk dokumentasi vendor, bukan untuk papan peringkat.

Hal lain yang tidak diubah oleh peluncuran ini adalah reproduksi independen. Setiap baris benchmark di atas yang bukan dari Artificial Analysis adalah milik StepFun sendiri, dijalankan pada harness StepFun, dan belum ada pihak ketiga yang mereproduksi hasil agentic tersebut. Pola dari produk unggulan lab Tiongkok tahun ini adalah indeks agregatnya tetap bertahan dan baris utama vendor bergeser; anggap agregat sebagai angka perencanaan.

Apa yang dapat Anda panggil hari ini, dan apa yang harus dirutekan untuk sementara waktu

Step 5 Preview tidak ada di katalog kami, dan OrcaRouter tidak merutekannya — ada API publik dan Studio di sisi StepFun, dan di sanalah ia berjalan. Yang kami miliki adalah kumpulan model yang menjadi tolok ukurnya, di balik satu kunci: DeepSeek V4.1 Flash dengan harga $0,15 masuk dan $0,60 keluar per juta, GLM-5.3 seharga $1,26 dan $3,96 dibandingkan $1,40 dan $4,40 yang dicantumkan Z.ai, Claude Opus 5 seharga $5,00 dan $25,00, serta Kimi K3 di sampingnya. Itulah bentuk praktis dari tiga minggu ke depan: sebuah pratinjau yang bisa Anda jadikan tolok ukur, dan satu set model produksi yang benar-benar bisa Anda andalkan, dapat diakses melalui satu API untuk lebih dari 200 model dengan harga daftar penyedia diteruskan tanpa markup 0% — jadi jika harga StepFun berubah sebelum Oktober, angka yang Anda bayar ikut berubah pada hari yang sama, bukan saat perpanjangan.

Failover otomatis lebih bernilai daripada biasanya dalam jendela ini, karena mode kegagalan sebuah pratinjau bukanlah bahwa ia buruk — melainkan bahwa kapasitasnya terbatas. Model yang membuka API-nya pada hari pengumuman dan belum memiliki bobot adalah model yang armada penyajiannya masih dibangun, dan endpoint pratinjau yang menurun performanya pada pukul 2 pagi akan menyeret loop agen Anda bersamanya. Tempatkan pratinjau di belakang router dengan model yang sudah terbukti sebagai fallback, dan Anda mendapatkan sinyal kualitas pada beban kerja Anda sendiri tanpa mempertaruhkan jalur produksi pada armada yang belum terbukti.

Screenshot of the Hugging Face repository page for stepfun-ai/Step-5-Preview-BF16, showing the repository created on September 20, 2026 with one contributor, a single initial commit and a single file listed, .gitattributes at 1.52 kB, with no model card, no license and no configuration.

Tanggal yang penting adalah 15 Oktober.

Semua di atas bersifat sementara dalam satu cara spesifik: bobot adalah hal yang membuat sebuah model menjadi permanen. Pratinjau tertutup dengan harga $1,00 dan $2,70 adalah harga yang bagus dari vendor tunggal, dan checkpoint BF16 di bawah lisensi yang diterbitkan adalah harga yang tidak lagi dikendalikan oleh vendor tunggal mana pun. StepFun telah berkomitmen pada opsi kedua untuk 15 Oktober, dan nama repositori yang telah dicadangkannya menyebut bfloat16 lebih dulu.

Apa yang perlu diperhatikan antara sekarang dan nanti itu sempit dan dapat diperiksa. Apakah repositori itu terisi — dan dengan lisensi apa? Apakah file konfigurasi mengonfirmasi total 600B dan 27B aktif? Apakah StepFun menerbitkan batas keluaran bersama jendela konteks, sehingga menjawab pertanyaan 350k/64k? Apakah harganya tetap berlaku setelah pratinjau kehilangan sufiksnya? Keempat jawaban itu menentukan apakah Step 5 Preview menjadi model yang Anda host sendiri, model yang Anda sewa, atau model yang Anda benchmark sekali lalu tinggalkan. Sampai repositori itu berisi lebih dari sekadar .gitattributes di dalamnya, pengumuman ini adalah awal dari cerita, bukan akhirnya.

Generated two-column infographic titled 'Step 5 Preview — live today vs promised October 15'. The left card 'Callable now' lists rows: API and Studio open September 20, price $1.00 in / $2.70 out, AA Intelligence Index 44, 1M-token context, output speed 99.8 tokens/sec. The right card 'Promised October 15' lists rows: BF16 weights, licence terms, config with parameter counts, output ceiling. A footer reads 'The announcement covers the left card; the right card is unconfirmed until the repository is filled.'

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari