
Step 5 Preview vs Qwen 3.8 Max Prime: Satu Poin Indeks, Empat Dolar dan Tiga Puluh Delapan Sen
- OrcaBARUOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 per 1 juta token
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 113 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
Mulailah dengan hal yang tidak akan diberitahukan oleh kotak pencarian kepada Anda. Qwen 3.8 Max Prime bukanlah sebuah model. Ini adalah jalur penyajian — Qwen3.8-Max, bobot yang sama yang dibawa vendor ke ketersediaan umum pada 3 Agustus 2026, dijual di bawah ID model kedua dengan tarif tepat dua kali lipat kartu tarif internasional. Step 5 Preview, andalan tertutup StepFun, membuka API-nya pada 20 September 2026 dan merupakan model dalam pengertian biasa: satu endpoint, satu harga, satu set bobot yang tidak dapat Anda miliki. Jadi versi jujur dari pertarungan ini mempertemukan model yang terukur dengan tingkat yang tidak terukur, dan perhitungan yang dihasilkan lebih blak-blakan daripada yang akan ditampilkan vendor mana pun di slide. Pada Artificial Analysis Intelligence Index yang independen, keduanya terpaut satu poin, 44 melawan 45, dan dalam hal biaya tugas yang diselesaikan, keduanya terpaut $1,03 melawan $5,41. Satu poin, empat dolar tiga puluh delapan sen, per tugas — dan itu sebelum Anda membeli kecepatan apa pun yang sebenarnya dibebankan Prime.
Berikut adalah angka itu yang dibedah: dari mana asalnya, mengapa Qwen ID standar sudah menjadi separuh perbandingan yang lebih mahal sebelum Prime menggandakan apa pun, dan apa yang dibeli dan tidak dibeli oleh tambahan empat dolar per tugas.
Nama itu melakukan pekerjaan yang tidak dilakukan produknya
Alibaba mengumumkan Prime — 优速模式, mode cepat — di Yunqi Conference pada 22 September 2026 dan menerbitkannya sebagai baris di kartu tarif Model Studio. Dokumentasi Alibaba sendiri tidak ambigu tentang apa yang berubah: kecepatan output naik menjadi 1,5 hingga 2 kali lipat API standar, dan, dalam kata-kata vendor, kemampuan serta batasan penggunaannya identik dengan model asli. Tidak ada jumlah parameter baru, tidak ada kontrak endpoint baru, tidak ada kemampuan yang tidak dimiliki ID standar. Anda mengubah nama model di body permintaan dan Anda berada di jalur cepat.

Itu membuat istilah pencarian menjadi jebakan. Seseorang yang mencari unggulan Qwen yang lebih baru daripada Qwen3.8-Max menemukan "Prime" dan membacanya sebagai nomor versi. Itu adalah harga. Segala yang tersirat dari nama itu tentang kemampuan disediakan oleh Qwen3.8-Max sendiri: model sparse mixture-of-experts dengan 2,4 triliun parameter dengan sekitar 95 miliar parameter aktif per token, 512 pakar per lapisan, dan konteks 983.616 token pada konfigurasi yang diuji oleh dewan independen.
Step 5 Preview tidak memiliki ambiguitas yang setara, dan memiliki masalah yang berlawanan. StepFun mencantumkannya pada sekitar 600 miliar parameter total dengan 27 miliar aktif, input teks, gambar, dan video, jendela konteks 1M token dan batas maksimum keluaran 64.000 token yang terdokumentasi, dengan upaya penalaran yang dapat dipilih pada tingkat rendah, sedang, atau tinggi. Ini bersifat proprietary. Checkpoint BF16 telah dijanjikan untuk 15 Oktober 2026 dan belum dirilis; mirror komunitas dari build BF16 telah beredar di Hugging Face sejak hari API dibuka, tetapi unggahan ulang bukanlah rilis dan StepFun belum menerbitkan pengumuman open-weights.
Jadi pasangan ini benar-benar timpang sebelum satu tolok ukur pun muncul: model pratinjau yang mungkin akan menjadi unduhan, dibandingkan dengan tier penyajian berharga baru dari model yang tidak akan.
Berapa biaya satu poin indeks
Kedua model telah dijalankan oleh evaluator independen yang sama, dan di sinilah perbandingan menjadi tidak nyaman bagi narasi yang lebih murah per token. Baca selengkapnya pada 10 Oktober 2026:
• Indeks — Step 5 Preview 44, jauh di atas median model sebanding sebesar 26. Qwen3.8-Max pada build 0902, 45. Satu poin.
• Biaya per tugas indeks yang diselesaikan — $1,03 dibanding $5,41. Lebih dari lima kali lebih baik.
• Harga output — $2,70 dibandingkan $6,00 per juta token pada ID standar, yang menjadi $9,902 setelah Anda beralih ke Prime. Step 5 Preview 2,2 kali lebih murah daripada standar dan 3,7 kali lebih murah daripada Prime.
• Harga input — $1.00 dibandingkan dengan $2.00 standar dan $3.301 on. Cerminan dari kolom output, dan yang lebih penting setelah Anda membaca rincian biaya di bawah ini.
• Cache hit — $0,10 per juta token pada Step 5 Preview, diskon 90 persen; $0,25 pada Qwen3.8-Max, diskon 87,5 persen yang dibulatkan halaman vendor sendiri menjadi 88 persen.
• Token keluaran per detik — 87 berbanding 35,4. Di sini Qwen yang lambat, dan dengan faktor sekitar dua setengah.
Kolom per token dan kolom per tugas tidak cocok, dan kolom per tugas adalah yang harus dipercaya, karena alasan yang hanya muncul jika Anda membuka rincian biaya. Pada proses indeks Step 5 Preview, $0,85 dari $1,03 adalah sisi input dan $0,17 adalah output. Pada proses indeks Qwen3.8-Max, $4,76 dari $5,41 adalah sisi input dan $0,65 adalah output. Harga tertera berbeda sekitar faktor dua; tagihan tugas berbeda faktor lima, karena proses Qwen mendorong sekitar 9,9 miliar token input melalui harness, dibandingkan dengan 5,5 miliar milik Step 5 Preview, dan karena sebagian besar volume itu adalah lalu lintas cache yang dibaca ulang dengan diskon apa pun yang diberikan vendor, bukan pada tarif yang dipublikasikan.
Step 5 Preview digambarkan oleh dewan sebagai sangat bertele-tele, dengan sekitar 160 juta token keluaran di seluruh suite, dibandingkan median 82 juta — dan Qwen3.8-Max digambarkan dengan kata-kata yang persis sama, dengan sekitar 190 juta token keluaran dibandingkan median yang sama. Tidak satu pun dari keduanya adalah model yang menjawab secara singkat. Jika panjang keluaran adalah yang ingin Anda optimalkan, tidak ada dari kedua kolom ini yang membantu Anda.

Perbandingan itu memiliki lubang, dan lubangnya berbentuk Prime.
Setiap angka di bagian sebelumnya diukur pada Qwen3.8-Max ID standar. Tidak ada satu pun yang diukur pada Prime.
Itu bukan hal teknis semata. Seluruh proposisi Prime adalah bahwa token datang lebih cepat, dan satu-satunya angka kecepatan di papan peringkat untuk keluarga ini adalah 35,4 token keluaran per detik milik ID standar — yang paling lambat di antara tiga ID yang dibahas di sini dengan selisih yang jauh, dan satu-satunya baris di mana Qwen3.8-Max bukan sekadar mahal tetapi terlihat berkinerja di bawah standar. Jika Prime memberikan hasil di ujung atas rentang yang dinyatakan Alibaba, 35,4 itu menjadi sekitar 70, masih di bawah 87 milik Step 5 Preview sementara biayanya 3,7 kali lebih mahal per token keluaran. Jika ia memberikan hasil di ujung bawah rentang, angkanya menjadi sekitar 53.
Itu adalah perkiraan yang dibuat berdasarkan pengganda yang dinyatakan vendor, bukan hasil pengukuran, dan seharusnya diberi label seperti itu. Sejauh yang dapat kami temukan, tidak ada yang menerbitkan uji throughput independen untuk mode Prime. Angka 1,5 hingga 2× itu milik Alibaba sendiri, dan itu adalah satu-satunya klaim penopang bagi keseluruhan tier.
Satu detail struktural yang mendukung Prime adalah aturan pembatasan, dan mudah untuk dilewatkan begitu saja. Dokumentasi Alibaba menyatakan bahwa di bawah Prime, ketika volume panggilan mencapai batas laju, jika platform masih memiliki sumber daya cadangan, permintaan tidak dibatasi — sehingga throughput yang tersedia untuk Anda tidak turun di bawah batas yang dinyatakan. Itu adalah plafon lunak dengan lantai keras: dalam kondisi kontensi Anda mendapatkan batasnya, dalam kapasitas menganggur Anda bisa mendapatkan lebih banyak. Untuk loop agen yang menembakkan puluhan panggilan berurutan, ini lebih penting daripada median, karena panggilan paling lambat menentukan kapan loop berakhir. Ini juga penjelasan paling jelas mengapa Prime ada sebagai produk. Alibaba menjual posisi antrian dari kapasitas yang telah dibangunnya, dan menagih dua kali lipat untuk hak dilayani lebih dulu darinya.
Apa yang dikatakan kedua kartu tarif saat Anda menyandingkannya
Alibaba menerbitkan baris-baris Qwen-nya bersebelahan, yang membuat aritmetika tingkat tersebut luar biasa rapi. Di halaman internasional, baris Prime mencantumkan $3.301 input dan $9.902 output per juta token, dibandingkan $1.65 dan $4.951 untuk ID standar dan untuk pin 0902-nya. Itu tepat 2.0 pada kedua kolom — bukan pembulatan perkiraan melainkan rasio literal dari angka-angka yang diterbitkan. Halaman harga berbahasa Inggris StepFun mencantumkan Step 5 Preview pada $1.00 input, $0.10 pada cache hit dan $2.70 output, dengan input cache-miss termasuk biaya penulisan konten baru ke dalam cache. Angka cache-hit yang diterbitkan vendor adalah diskon 90 persen; dewan independen mencatat 95 persen dari materi yang sama, dan ada baiknya mengetahui yang mana dari keduanya yang Anda jadikan dasar pemodelan.
Tempatkan ketiga kartu dalam satu kolom, dan polanya menjadi jelas. Keluaran Prime, $9.902. Keluaran Qwen Standard, $6.00 menurut catatan papan dan $4.951 pada halaman internasional Alibaba sendiri. Keluaran Step 5 Preview, $2.70. Dan pada jalur murah yang tidak diiklankan siapa pun, pembacaan cache Step 5 Preview adalah $0.10 dibandingkan $0.25 milik Qwen — yang lebih penting daripada kolom keluaran untuk beban kerja apa pun yang mengulang prefiksnya.
Satu peringatan tentang angka yang sudah kedaluwarsa, karena keluarga model ini telah mengalami perubahan harga lebih dari sekali dalam tujuh minggu. Harga $2 untuk input dan $6 untuk output yang banyak dikutip untuk Qwen3.8-Max adalah angka utama saat peluncuran Agustus, dan itu masih yang ditampilkan di tab Singapura Alibaba. Baris internasional dan global kini menunjukkan $1.65 dan $4.951. Jika Anda memodelkan pengeluaran, gunakan kartu tarif untuk wilayah Anda dan baca ulang pada hari Anda berkomitmen.
Dua cara membaca 2×
Karena Prime adalah model yang sama dengan harga dua kali lipat dari standard ID, premi ini mudah diberi harga dan sulit dibenarkan. Di ujung atas jajaran Alibaba, Anda membayar 2× untuk kecepatan 2×, yang netral biaya per detik latensi yang dihilangkan. Di ujung bawah, Anda membayar 2× untuk 1,5×, premi 33 persen per detik yang dihemat. Kedua ujung itu masuk akal untuk pekerjaan interaktif; keduanya tidak dapat dipertahankan untuk batch semalaman. Itulah sebabnya saran standar tentang tier ini — panggilan yang sensitif terhadap latensi di Prime, sisanya di standard ID — juga merupakan saran yang tepat.
Perbandingan terhadap Step 5 Preview adalah titik ketika penalaran berubah bentuk, dan inilah bagian yang dibuat terlihat oleh pembingkaian "vs". Prime sama sekali tidak bersaing dengan Step 5 Preview dalam hal harga. standard ID sudah lebih mahal per token keluaran dibandingkan Step 5 Preview, lima kali lebih mahal per tugas yang diselesaikan, dan skornya lebih tinggi satu poin. Prime mengalikan sisi biaya dari persamaan yang sudah kalah dan membeli kembali kecepatan yang justru lebih banyak dimiliki Step 5 Preview secara gratis. Jika kecepatan adalah yang Anda butuhkan dari keluarga ini, pernyataan yang jujur adalah bahwa model di sisi lain halaman ini memberi Anda 87 token per detik dengan $2.70 per juta token keluaran, dan jalur cepat memberi Anda rentang yang puncaknya, menurut angka Alibaba sendiri, sekitar 70 dengan $9.902.
Itu bukan argumen bahwa Step 5 Preview menang. Itu adalah argumen bahwa nilai Prime sepenuhnya internal bagi lini produk Alibaba sendiri, dan bahwa argumentasi untuknya bertumpu pada beban kerja di mana keunggulan indeks satu poin Qwen3.8-Max, konteks 983.616 token-nya, atau profil tugasnya yang berbeda melakukan pekerjaan yang tidak dilakukan oleh konteks Step 5 Preview 1M token. Yang merupakan perbandingan yang belum bisa dijalankan siapa pun, karena baris Prime tidak ada di papan independen mana pun.

Apa dampaknya bagi pembeli
Tak satu pun dari keduanya ada di OrcaRouter. Step 5 Preview dapat dijangkau melalui API StepFun sendiri dan beberapa platform pihak ketiga; Prime adalah tier Alibaba Cloud Model Studio yang dilayani pada endpoint berskup workspace; dan Anda dapat memeriksa kedua klaim tersebut terhadap katalog kami dalam satu menit yang sama saat Anda membacanya, yang merupakan uji yang lebih baik daripada hanya memercayai kata-kata kami.
Rute What we do adalah produk berbeda dalam keluarga yang sama, dan kebetulan itulah yang terus menjadi rujukan perhitungan artikel ini. Qwen3.8-Max standar dan pin bertanggalnya, Qwen3.8-Max-0902, berada di katalog pada kunci yang sama dengan saudara-saudaranya Qwen3.8-Max-Preview, Qwen3.8-Flash, dan Qwen3.8-27B, bersama 200+ model lainnya, dengan harga daftar penyedia yang diteruskan dengan markup 0 persen. Ada dua hal yang mengikuti dari itu, dan keduanya memengaruhi keputusan di atas. Yang pertama adalah bahwa perubahan daftar tarif di Alibaba muncul di sisi kami pada hari yang sama Alibaba mempublikasikannya — tepat sifat yang Anda inginkan dari vendor yang telah menetapkan ulang harga keluarga ini dua kali dalam tujuh minggu. Yang kedua adalah bahwa baseline Anda tidak lagi menjadi taruhan satu vendor: ID standar adalah tier yang paling mungkin Anda pertahankan di jalur default Anda, dan menempatkannya di balik lapisan routing alih-alih integrasi langsung adalah yang membuat keputusan Prime dapat dibalik per endpoint, bukan per kontrak.
Jika Anda memilih di antara dua nama dalam judul artikel ini, pembagiannya jelas. Pilih Step 5 Preview ketika Anda menginginkan skor, input video dan gambar, serta diskon cache 90 persen, dan terimalah bahwa Anda menyewa pratinjau yang checkpoint-nya adalah janji untuk 15 Oktober bukan lisensi. Pilih Qwen 3.8 Max Prime hanya jika Anda sudah berkomitmen pada Qwen3.8-Max dan telah mengukur, pada prompt Anda sendiri, bahwa 35 token per detik dari ID standar itulah yang membuat Anda mengeluarkan uang — dan nilai keputusan itu terhadap 2× bukan terhadap 1.5×, karena puncak rentang vendor bukanlah angka yang akan Anda lihat di produksi.
Pengukuran yang akan menyelesaikan ini tidak ada, dan layak dikatakan secara lugas daripada mempercantiknya. Seseorang perlu menjalankan Prime melalui harness yang juga menjalankan Step 5 Preview, menerbitkan distribusi throughput alih-alih pengganda, dan menempatkan angka biaya per tugas di samping poin indeks yang dibelinya. Sampai saat itu, satu-satunya angka yang sama-sama dimiliki kedua pihak adalah dua kartu tarif, dan keduanya mengatakan hal yang sama dari arah berlawanan: jalur cepat adalah cara termahal untuk membeli token Qwen3.8-Max, dan cara paling lambat untuk membeli satu detik waktu aktual dibandingkan dengan yang dibebankan alternatif untuk detik yang sama.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
