Kartu judul yang dihasilkan berjudul 'Step 5 Preview vs DeepSeek V4 Pro — apa yang dapat Anda unduh' dengan dua kolom: Step 5 Preview pada AA Index 44, total 600B / 27B aktif, bobot dijanjikan 15 Oktober dan repositori yang hanya berisi satu file .gitattributes; DeepSeek V4 Pro pada AA Index 36, total 1,6T / 49B aktif, bobot MIT dan dapat diunduh sekarang serta checkpoint lengkap di Hugging Face. Footer berbunyi 'Kedua angka indeks menurut Artificial Analysis Intelligence Index v4.3.2 pada upaya penalaran maksimum.'
Guides & Insights

Step 5 Preview vs DeepSeek V4 Pro: Satu Adalah Janji, yang Lain Adalah Lisensi MIT

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Segala hal dalam perbandingan ini bergantung pada satu pertanyaan yang sama sekali tidak berkaitan dengan benchmark: apa yang sebenarnya dapat Anda unduh? DeepSeek V4 Pro — build yang dikirim vendor sebagai DeepSeek-V4-Pro-0813 pada 13 Agustus 2026 — adalah model mixture-of-experts berparameter 1,6 triliun di bawah lisensi MIT, dengan bobot yang saat ini sudah tersedia di Hugging Face. Step 5 Preview, yang diumumkan StepFun pada 20 September 2026, adalah MoE sparse berparameter 600 miliar yang mencetak skor delapan poin lebih tinggi pada papan peringkat independen yang sama dan memiliki repositori Hugging Face yang berisi tepat satu file, .gitattributes. StepFun mengatakan checkpoint BF16 akan tiba pada 15 Oktober. Jadi bentuk jujur dari perbandingan ini bukanlah "model mana yang lebih baik." Melainkan "mana dari keduanya yang dapat Anda bangun di atasnya kuartal ini, dan mana yang sedang Anda tunggu."

Pembingkaian itu kurang menarik dibandingkan adu benchmark dan jauh lebih berguna, karena selisih delapan poin dan penantian dua puluh lima hari bukanlah jenis fakta yang sama. Salah satunya sudah bisa Anda perhitungkan hari ini.

Delapan poin, dan empat yang penting

Artificial Analysis menjalankan kedua model melalui Intelligence Index v4.3.2 — sepuluh evaluasi — yang merupakan satu-satunya tempat keduanya diukur oleh tangan yang sama.

• Intelligence Index — Step 5 Preview 44 vs DeepSeek V4 Pro 36

• Peringkat di papan itu — Step 5 Preview ke-24 dari 200 vs DeepSeek V4 Pro ke-7 dari 113 di kelasnya

• Terminal-Bench 4.0 — Step 5 Preview 33.3%; DeepSeek V4 Pro tidak terdaftar di papan yang sama, jadi tidak ada baris agentik yang sebanding untuk dikutip

• Kecepatan output — Step 5 Preview 99.8 token/detik vs DeepSeek V4 Pro 88.8 token/detik

• Waktu ke token pertama — Step 5 Preview 2,96 dtk vs DeepSeek V4 Pro 1,69 dtk

• Harga per 1 juta token — Step 5 Preview $1,00 masuk / $2,70 keluar vs DeepSeek V4 Pro $1,32 masuk / $3,96 keluar pada tarif puncak DeepSeek, menjadi separuhnya $0,66 / $1,98 di luar jam sibuk

• Diskon cache — Step 5 Preview 95% vs DeepSeek V4 Pro 97%

• Konteks — keduanya 1M token; DeepSeek mempublikasikan batas keluaran 384.000 token, StepFun belum mempublikasikannya

• Bobot — Step 5 Preview ditutup, checkpoint BF16 dijadwalkan pada 15 Oktober; DeepSeek V4 Pro MIT, dapat diunduh sekarang

Dua baris bertentangan dengan judul utamanya. DeepSeek V4 Pro menjawab token pertamanya dalam 1,69 detik dibandingkan 2,96 detik milik Step 5 Preview — keunggulan awal 43% pada setiap panggilan, yang pada loop agen yang panjang menumpuk menjadi waktu nyata yang sesungguhnya. Dan diskon cache-nya dua poin lebih baik, yang paling penting justru untuk beban kerja yang menjadi sasaran penjualan kedua model ini: agen yang mengirim ulang system prompt dan konteks repositori yang sama pada setiap giliran hampir sepenuhnya hidup di dalam diskon tersebut.

Selisih agregat delapan poin itu nyata, dan juga lebih sempit daripada kesan yang ditimbulkan angka delapan poin. Sebuah indeks adalah komposit dari sepuluh evaluasi, dan komposisinya adalah titik di mana kedua model berbeda. 33,3% Step 5 Preview pada Terminal-Bench 4.0 adalah hasil agentik yang sesungguhnya; kekuatan utama DeepSeek V4 Pro sendiri adalah penalaran jangka panjang dengan harga yang tidak tertandingi oleh apa pun di kelas open-weights. Tidak ada papan peringkat yang menerbitkan baris di mana keduanya dipertentangkan secara langsung, dan itulah alasan jujur mengapa perbandingan ini tidak dapat diselesaikan dengan satu angka.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second, cost per Intelligence Index task $0.71, verbosity 160M output tokens, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

Apa manfaat "terbuka" bagi Anda saat vendor berubah pikiran

Inilah bagian dari pertandingan ini yang tidak dapat ditangkap oleh lembar spesifikasi, dan patut dinyatakan dengan tanggal sebenarnya karena hal itu terjadi sebelas hari sebelum Step 5 Preview diumumkan.

DeepSeek memberi tahu pengguna bahwa mereka akan menghentikan V4 Pro. Pada 9 September, perusahaan mengatakan permintaan akan dialihkan ke DeepSeek V4.1 Flash yang lebih baru; pada 10 September, perusahaan memastikan tanggalnya menjadi pukul 12.00 waktu Beijing pada 14 September. Pada 11 September, perusahaan membalikkannya — layanan API V4 Pro berlanjut setelah 14 September, penagihan tidak berubah, dalam kata-kata DeepSeek sendiri. String model, konteks 1 juta token, dan batas konkurensi 500 permintaan semuanya masih seperti semula, dan halaman Model & Harga DeepSeek memuat pembalikan tersebut sebagai catatan kaki pada baris deepseek-v4-pro.

Bacalah itu sebagai demonstrasi tentang hal yang sebenarnya Anda dilindungi darinya oleh bobot terbuka, dan tentang hal yang tidak. API itu hampir dicabut oleh sebuah keputusan penjadwalan. Bobotnya tidak bisa. Checkpoint berlisensi MIT di perangkat keras Anda sendiri tidak memiliki vendor yang dapat mengumumkan penghentiannya, dan itu adalah jenis jaminan yang berbeda dari janji harga — itu sama sekali bukan janji.

Yang justru merupakan celah yang sedang diisi Step 5 Preview. StepFun telah berkomitmen pada 15 Oktober untuk checkpoint BF16, dan nama repositori yang telah dicadangkannya — stepfun-ai/Step-5-Preview-BF16 — adalah format yang Anda gunakan untuk fine-tune dan kuantisasi, dinamai saat dibuat dan diisi kemudian. Itu sinyal penjadwalan, bukan artefak. Sampai repositori tersebut berisi sesuatu selain .gitattributes, Step 5 Preview adalah model yang Anda sewa, dengan ketentuan satu vendor, tanpa lisensi untuk membacanya dan tanpa opsi cadangan jika ketentuannya berubah.

Dua cara untuk menjadi pilihan murah

Kedua model ini jauh lebih murah daripada frontier tertutup, dan mekanismenya tidak sama, yang berpengaruh terhadap seberapa tahan lama harga tersebut.

DeepSeek V4 Pro murah karena sebuah lab menerbitkan bobotnya dan pasar penyajian yang kompetitif menghilangkan marginnya. Itu adalah batas bawah struktural: siapa pun dapat menyajikan checkpoint tersebut, sehingga harganya ditentukan oleh biaya per GPU-jam alih-alih oleh strategi penetapan harga perusahaan. API DeepSeek sendiri menetapkan harganya dalam dua jendela — $1,32 dan $3,96 selama jam sibuk, setengahnya di luar jam tersebut — dan jam sibuknya sempit, beberapa jam pada pagi hari kerja dalam UTC, sehingga sebagian besar lalu lintas jatuh pada tarif yang lebih murah dan akhir pekan tidak pernah melihat tarif yang lebih tinggi.

Step 5 Preview murah karena StepFun memutuskan untuk menetapkan harganya seperti itu. Hanya ada satu endpoint, satu daftar harga, dan tidak ada sumber kedua. Itu bukan sebuah tuduhan — model sparse 600B/27B memang benar-benar lebih murah untuk dilayani daripada yang disiratkan oleh jumlah parameternya, dan rasio parameter yang diaktifkan adalah alasannya. Ini hanyalah jenis harga yang berbeda, dan perbedaannya akan terlihat pada hari StepFun memutuskan bahwa preview telah menjalankan tugasnya.

Selisih harga antara keduanya cukup kecil sehingga seharusnya tidak menentukan apa pun: $1,00 dan $2,70 versus $1,32 dan $3,96 adalah perbedaan 24% pada input dan 32% pada output, jauh di dalam rentang yang dapat dihapus oleh diskon cache, perbedaan panjang output, atau tingkat percobaan ulang. Mengenai soal verbositas, keduanya berdekatan — Step 5 Preview menghasilkan 160M token output pada proses indeks dibandingkan median 92M, dan proses DeepSeek V4 Pro sendiri berada di kisaran yang sama. Tidak ada yang merupakan model hemat, dan keduanya dijual karena murah per token, bukan murah per tugas.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs DeepSeek V4 Pro — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, TTFT 2.96s, and weights due October 15. The right column gives DeepSeek V4 Pro the rows AA Index 36, parameters 1.6T total / 49B active, price $1.32 / $3.96, cache discount 97%, TTFT 1.69s, and weights MIT-licensed and downloadable now. A footer reads 'Both per Artificial Analysis Intelligence Index v4.3.2 at maximum reasoning effort.'

Di mana masing-masing seharusnya berada dalam stack nyata

Jika Anda memerlukan model yang dapat Anda fine-tune, kuantisasi, host di VPC Anda sendiri, atau serahkan kepada tim hukum dengan file lisensi yang dapat mereka baca, ini bukan pilihan yang sulit dan ini bukan tentang benchmark. DeepSeek V4 Pro tersedia di bawah MIT hari ini. Step 5 Preview tidak memiliki lisensi, tidak memiliki konfigurasi dan tidak memiliki file parameter, dan waktu paling awal yang dapat Anda rencanakan adalah pertengahan Oktober. Selisih indeks delapan poin tidak mengubah perhitungan itu, karena model yang tidak dapat Anda unduh tidak dapat di-deploy.

Jika yang Anda inginkan adalah hasil agentic terkuat yang tersedia pada harga satu dolar per juta token input, Step 5 Preview unggul pada satu-satunya papan peringkat yang telah mengukur keduanya, dan ini adalah default yang lebih baik untuk pekerjaan coba-coba yang mengisi sebagian besar loop agen — ekstraksi, klasifikasi, perancah pengujian, panggilan rutin di antara dua hal yang penting. Kecepatan 99,8 token per detiknya juga menyelesaikan output lebih cepat daripada 88,8 milik DeepSeek V4 Pro, yang memperpendek loop itu sendiri, bukan hanya tagihannya.

Kasus yang canggung adalah kasus yang sebenarnya dihadapi sebagian besar tim: Anda menginginkan angka Step 5 Preview, tetapi Anda tidak bisa menempatkan endpoint pratinjau yang dibuka pada hari peluncuran, tanpa batas keluaran yang dipublikasikan, pada jalur produksi. Itu masalah perutean, dan itulah yang menjadi penutup perbandingan ini. DeepSeek V4 Pro dapat diakses melalui OrcaRouter dengan harga $0,66 dan $1,98 per juta token, separuh tarif off-peak dari kartu tarif DeepSeek sebesar $1,32 dan $3,96, beserta model-model teks di sekitarnya — di balik satu kunci untuk lebih dari 200 model dengan markup 0%, sehingga perubahan harga DeepSeek masuk ke tagihan Anda pada hari yang sama, bukan saat perpanjangan. Arahkan bagian eksploratif dari lalu lintas ke pratinjau dan pertahankan jalur produksi pada model yang memiliki lisensi di belakangnya, dengan failover otomatis lintas penyedia yang melakukan pekerjaan yang diperlukan oleh kurva kapasitas endpoint pratinjau.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro at www.orcarouter.ai/models/deepseek/deepseek-v4-pro, showing the model id deepseek/deepseek-v4-pro, a 1M-token context and 384K max output, input pricing of $0.66 and output pricing of $1.98 per million tokens, a p50 time to first token of 4.01 seconds, 3,730M tokens of traffic over seven days, and the endpoints and SDK snippets behind the OrcaRouter API.

Apa yang bisa menyelesaikannya

Tiga hal, dan ketiganya dapat diperiksa bukan diperdebatkan.

Yang pertama adalah lisensi. Saat checkpoint BF16 dirilis, apa yang dikatakan repositori tentang apa yang boleh dilakukan sebuah bisnis dengannya? Lisensi permisif menutup sebagian besar celah ini dengan sendirinya, karena menjadikan keunggulan delapan poin sebagai sesuatu yang dapat Anda miliki, bukan sekadar sewa. Lisensi yang restriktif meninggalkan DeepSeek V4 Pro sebagai satu-satunya model dalam pasangan itu yang benar-benar dapat Anda bangun produknya.

Yang kedua adalah plafon keluaran. DeepSeek mempublikasikan 384.000 token. Pengumuman StepFun menyebut konteks 1M dan tidak menyebutkan batas keluaran, dan konfigurasi pihak ketiga terpisah yang beredar selama kebocoran mencantumkan konteks 350.000 dengan maksimum keluaran 64.000. Untuk pekerjaan agentik jangka panjang yang menjadi alasan kedua model ini dijual, angka itu bukan catatan kaki.

Ketiga adalah apakah harga tetap bertahan setelah akhiran pratinjau hilang. Harga pratinjau adalah angka akuisisi pelanggan; harga rilis adalah model bisnis. Batas bawah DeepSeek V4 Pro ditentukan oleh pasar layanan yang kompetitif dan tidak bisa bergerak banyak. Batas bawah Step 5 Preview bisa berubah pada hari Selasa.

Sampai dua hal pertama itu terjawab, bacaan praktisnya adalah bahwa DeepSeek V4 Pro adalah model yang Anda deploy dan Step 5 Preview adalah model yang Anda jadikan tolok ukur — dengan catatan bahwa endpoint pratinjau yang baru berumur beberapa hari, berada delapan poin di atas produk unggulan berlisensi MIT yang sudah matang, adalah hasil yang nyata, dan alasan 15 Oktober layak dicatat di kalender alih-alih sekadar diabaikan.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari