
Step 5 Preview vs MiniMax M3: Lebih Murah Per Token, Lebih Mahal Per Poin
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Harga satuan jauh lebih menguntungkan MiniMax M3. Dengan $0,30 per juta input dan $1,20 per juta output, model sparse 428B milik vendor tersebut memangkas harga $1,00 dan $2,70 milik Step 5 Preview lebih dari dua kali lipat di kedua sisi. Namun harga satuan adalah penyebut yang salah untuk model yang Anda gunakan untuk menjawab pertanyaan, dan begitu Anda membaginya dengan apa yang sebenarnya dihasilkan setiap model, peringkatnya berbalik. Step 5 Preview memakan biaya $0,71 per tugas Intelligence Index pada skor 44. MiniMax M3 memakan biaya $0,51 per tugas indeks pada skor 29. Per poin kemampuan yang terukur, model dengan harga tertera yang lebih tinggi justru yang lebih murah — dan penyebabnya adalah selisih indeks lima belas poin yang tidak dapat ditutup oleh diskon sebesar apa pun.
Dua jenis "tersedia" yang sangat berbeda
MiniMax M3 telah tersedia secara umum sejak 1 Juni 2026, saat MiniMax membukanya melalui MiniMax Code, Token Plan-nya, dan API — tanpa label pratinjau di mana pun dalam peluncuran tersebut. Bobot menyusul pada 12 Juni, sebelas hari kemudian, sesuai janji. Repositori MiniMaxAI/MiniMax-M3 membawa sekitar 428 miliar parameter total dengan sekitar 23 miliar aktif per token, dibangun di atas MiniMax Sparse Attention, bersama dengan rilis MXFP8 terkuantisasi yang terpisah.
Step 5 Preview membuka API-nya pada 20 September 2026. Bobotnya belum dipublikasikan — repositori Hugging Face stepfun-ai/Step-5-Preview-BF16 hanyalah cangkang kosong — dan StepFun telah menetapkan tanggal 15 Oktober 2026. Jadi perbedaan praktisnya adalah M3 adalah model yang dapat Anda unduh, host sendiri, dan periksa, sedangkan Step 5 Preview adalah endpoint yang dihosting dengan niat yang dipublikasikan.
Perlu dicatat: halaman model MiniMax sendiri masih menyatakan M3 "akan segera sepenuhnya open-source," yang bertentangan dengan repositori yang mereka publikasikan pada Juni. Anggap itu sebagai halaman vendor yang kedaluwarsa, bukan bukti bahwa bobotnya hilang.
Kisah harga bukanlah kisah biaya
Artificial Analysis menghitung angka biaya per tugas indeks dengan menjalankan set evaluasi yang sama melalui setiap model dan menjumlahkan biaya tokennya. Ini adalah hal yang paling mendekati angka total biaya kepemilikan di bidang ini untuk jumlah pekerjaan yang tetap, dan ini memperhitungkan dua efek yang disembunyikan oleh harga token: seberapa bertele-tele suatu model, dan seberapa banyak proses berpikir yang dilakukannya.
Step 5 Preview mencatat $0,71 per tugas indeks, dengan total biaya menjalankan indeks sebesar $922,84. MiniMax M3 mencatat $0,51, dengan total biaya menjalankan sebesar $537,98. Dalam hal throughput mentah tugas, M3 sekitar 28% lebih murah. Bagi dengan skor indeks — 44 berbanding 29 — dan Step 5 Preview menghasilkan sekitar 1,6 sen per poin indeks dibandingkan 1,8 sen milik M3.
Satu peringatan perlu disampaikan di sini: itu adalah satu kali penjalanan indeks per model, dan satu kali penjalanan indeks adalah sampel kecil. Perhitungan aritmetika per poin hanyalah pemeriksaan kewajaran terhadap angka per tugas, bukan tolok ukur tersendiri. Namun arahnya konsisten dengan angka per tugas, dan itulah angka yang tidak dapat ditunjukkan oleh daftar harga milik kedua vendor itu sendiri.
• Intelligence Index — Step 5 Preview 44 (#24 dari 200) vs MiniMax M3 29 (#15 dari 113), keduanya pada versi indeks saat ini
• Harga input — $1,00 per juta vs $0,30 per juta
• Harga keluaran — $2,70 per juta vs $1,20 per juta
• Biaya per tugas indeks — $0,71 vs $0,51
• Parameter aktif — 27B vs 23B
• Jendela konteks — 1M token vs 1M token
• Kecepatan keluaran — 99.8 token/dtk vs 210.4 token/dtk
• Bobot — dijanjikan 15 Oktober 2026 vs tersedia sejak 12 Juni 2026

Jebakan versi indeks yang membuat ini membingungkan
Ada bahaya nyata dalam membaca angka M3, dan ini layak dibahas dalam satu paragraf karena hal ini menjebak hampir setiap halaman perbandingan pihak ketiga. Artificial Analysis mengkalibrasi ulang Intelligence Index-nya pada 7 September 2026, dan kalibrasi ulang tersebut memampatkan skor secara menyeluruh. Dalam skala saat ini, M3 bernilai 29. Dalam skala sebelum September, nilainya 44 hingga 45 — dan sejumlah pelacak masih menerbitkan 44,4 atau 45,4 untuknya.
Benturan itu lebih penting daripada biasanya di sini, karena skor Step 5 Preview saat ini juga 44. Halaman yang menempatkan angka M3 yang usang di samping angka Step 5 Preview terkini tampak menunjukkan dua model seri, padahal selisih saat ini lima belas poin. Kedua angka dalam artikel ini berasal dari versi indeks terkini dan sebanding satu sama lain; apa pun yang diterbitkan sebelum 7 September tidak.
Di mana MiniMax M3 benar-benar sulit dikalahkan
Dua hal tentang M3 tidak dekat. Yang pertama adalah kecepatan: 210,4 token output per detik, tercepat keempat dari 113 model yang dilacak Artificial Analysis, dibandingkan median 76,3. Kecepatan 99,8 token per detik Step 5 Preview terbilang baik dan kurang dari setengahnya. Waktu M3 ke token pertama 1,01 detik juga merupakan angka yang lebih cepat dibandingkan 2,96 detik.
Yang kedua adalah modalitas input. M3 menerima teks, gambar, dan video serta mengembalikan teks, dan MiniMax mendokumentasikan operasi desktop dan penggunaan komputer. Step 5 Preview menerima teks dan gambar. Jika pipeline Anda memasukkan rekaman layar atau frame video ke dalam model, itu bukan preferensi — itu perbedaan kemampuan.
Kesenjangan harga memperkuat keduanya. Pada $0.30 dan $1.20 dengan diskon permanen 50% yang diterapkan pada daftar harga $0.60 dan $2.40, serta diskon cache 80% yang menurunkan pembacaan cache menjadi $0.06 per juta, M3 adalah salah satu cara termurah untuk memindahkan token dalam volume besar melalui model yang mumpuni. Perhatikan tingkatannya: input di atas 512K token menggandakan seluruh permintaan, dan tier layanan prioritas berbiaya 1.5×.
Di mana hal itu terurai
Set evaluasi milik MiniMax sendiri untuk M3 tergolong kuat dan harus dibaca sebagai laporan vendor: SWE-bench Verified 80,5%, SWE-bench Pro 59,0%, Terminal-Bench 2.1 66,0%, MCP Atlas 74,2%, BrowseComp 83,5 dan OSWorld-Verified 70,06%. MiniMax menjalankannya di infrastrukturnya sendiri menggunakan Claude Code sebagai perancah, dirata-ratakan dari empat kali pengujian, dan pengaturan penilaiannya tidak dipublikasikan — jadi untuk saat ini hasilnya tidak dapat direproduksi oleh pihak ketiga.
Gambaran yang diukur secara independen jauh lebih keras terhadap pekerjaan agentik. Artificial Analysis mencatat Terminal-Bench 4.0 sebesar 2% untuk M3 — versi benchmark yang berbeda dari angka Terminal-Bench 2.1 milik vendor, dan tidak dapat dibandingkan dengannya, tetapi tetap mencolok. SciCode mencapai 47%, AutomationBench-AA 21%, dan CritPt 4%. Hasil independen terkuat M3 ada pada pekerjaan konteks panjang dan pengetahuan: AA-LCR v1.1 83%, Humanity's Last Exam 39%.
Step 5 Preview membalikkan profil itu. Terminal-Bench 4.0 pada 33,3% di harness yang sama dengan 2% milik M3, SciCode pada 59% berbanding 47%. Jika pekerjaannya bersifat agentic atau berbentuk kode, ini bukan perbandingan yang mendekati dan keunggulan harganya tidak mengompensasi hal itu.

Klausul lisensi yang dilewatkan oleh sebagian besar perbandingan
MiniMax M3 bersifat open-weight, tetapi bukan open source dalam pengertian OSI, dan ketentuannya lebih ketat daripada yang disiratkan oleh frasa "open weights". Repositori ini membawa MiniMax Community License: gratis untuk penggunaan non-komersial, dengan penggunaan komersial yang bersyarat pada penampilan secara mencolok "Built with MiniMax M3" — dan produk apa pun dengan pendapatan tahunan lebih dari $20 juta USD memerlukan otorisasi tertulis sebelumnya dari MiniMax. Ini bukan MIT, bukan Apache, dan bukan jenis lisensi yang langsung diloloskan oleh tim hukum.
Step 5 Preview sama sekali belum dapat dinilai pada aspek ini, karena belum ada lisensi yang bisa dibaca. StepFun telah berkomitmen untuk merilis bobot pada 15 Oktober dan belum menerbitkan ketentuan yang akan mengaturnya. Siapa pun yang berencana membangun di atasnya harus menganggap lisensi ini sebagai pertanyaan terbuka, bukan berasumsi bahwa lisensi tersebut akan mirip dengan milik Moonshot atau DeepSeek.
Inilah asimetri yang jujur antara keduanya: ketentuan M3 bersifat restriktif tetapi diketahui; ketentuan Step 5 Preview tidak diketahui. Lisensi yang restriktif namun dapat Anda antisipasi lebih baik daripada lisensi yang tidak diumumkan dan tidak dapat Anda antisipasi.
Memanggil salah satu dari mereka
MiniMax M3 ada di katalog kami di /models/minimax/minimax-m3, dapat diakses melalui kunci dan bentuk permintaan yang sama seperti 200+ model lain yang kami rutekan, dengan harga daftar penyedia diteruskan pada markup 0% — jadi diskon permanen 50% yang diterapkan MiniMax adalah harga yang Anda lihat, dan harga itu berubah pada hari MiniMax mengubahnya. Failover otomatis adalah separuh lainnya dari itu: M3 pada 210 token per detik menarik untuk pekerjaan bervolume tinggi, dan pekerjaan bervolume tinggi justru merupakan tempat di mana satu endpoint yang menurun paling merugikan.
Step 5 Preview tidak ada dalam katalog kami. Model teks StepFun bukan termasuk yang kami layani, jadi tersedia melalui API milik StepFun sendiri dan beberapa platform pihak ketiga — dan tidak dapat diakses pada key yang akan Anda gunakan untuk M3.

Putusan
Pilih MiniMax M3 ketika volume, latensi, atau input video menjadi kendala, ketika Anda menginginkan model yang dapat diunduh hari ini, dan ketika Anda dapat hidup di dalam lisensi komunitas — termasuk ambang batas pendapatan $20 juta. Terimalah bahwa skor agentik independen menempatkannya jauh tertinggal, dan bahwa tolok ukur vendornya belum direproduksi di luar infrastruktur MiniMax sendiri.
Ambil Step 5 Preview ketika pekerjaannya bersifat agentik atau padat kode, ketika Anda menginginkan kemampuan per dolar ketimbang token per dolar, dan ketika Anda nyaman menjadi pelanggan awal dari endpoint terkelola yang bobotnya baru hadir bulan depan. Terimalah bahwa Anda tidak dapat memeriksa lisensinya sebelum Anda membangun, dan bahwa selisih 2% versus 33,3% pada Terminal-Bench 4.0 adalah jenis kesenjangan yang menentukan sebuah proyek.
Diskonnya nyata. Hanya saja, itu bukan hal yang sedang dibeli.
MiniMax M3 adalah salah satu model yang kami rutekan dengan markup 0% dengan failover otomatis, sehingga perubahan harga vendor langsung berlaku pada kunci yang sama di hari yang sama.
