Kartu hero yang dihasilkan berjudul MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash, dengan subjudul 'Jendela 1M token yang sama, dua pitch penjualan yang sangat berbeda'. Kartu kiri bertuliskan 'MiniMax M3.1 Flash Preview: konteks 1M, harga tidak dipublikasikan, hanya Token Plan, thinking tidak dapat dinonaktifkan'; kartu kanan bertuliskan 'DeepSeek V4 Flash: konteks 1M, $0.15/$0.60 di luar jam sibuk, hanya teks, digantikan oleh V4.1 Flash'. Footer bertuliskan 'Angka MiniMax menurut platform.minimax.io; angka DeepSeek menurut rate card resmi DeepSeek'.
Engineering & Research

MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash: Dua Tiket Konteks 1M yang Murah, Satu Tanda Bintang Besar

Penulis

Gideon Frost

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Jika Anda sedang mencari jendela konteks sejuta token dengan harga rendah per token, MiniMax-M3.1-Flash-Preview dan DeepSeek V4 Flash adalah dua nama yang terus muncul — dan keduanya sebenarnya bukan jenis produk yang sama. DeepSeek V4 Flash adalah model yang sudah pensiun yang pengenalnya masih merespons, berada di dalam kartu tarif vendor yang dapat Anda baca sampai ke sen. MiniMax-M3.1-Flash-Preview adalah pratinjau langsung tanpa tarif yang dipublikasikan sama sekali. Perbandingan di bawah ini karena itu sebagian merupakan perbandingan spesifikasi dan sebagian lagi demonstrasi tentang betapa berbedanya kedua vendor ini dalam memilih menjual segmen yang sama.

Kedua sisinya layak dinyatakan secara tepat, karena angka-angka yang menentukan hal itu tersebar di halaman harga vendor, pohon dokumentasi vendor, dan katalog kami sendiri, dan salah satu klaim yang paling sering diulang tentang DeepSeek V4 Flash — harganya — adalah klaim yang sejak itu telah digantikan oleh DeepSeek.

Apa yang sebenarnya cocok antara kedua lembar spesifikasi tersebut

Spesifikasi utamanya cukup berdekatan sehingga bukan menjadi faktor penentu, dengan satu pengecualian yang tidak diiklankan siapa pun.

• Jendela konteks — 1.000.000 token untuk MiniMax-M3.1-Flash-Preview versus 1.048.576 untuk DeepSeek V4 Flash: secara nominal identik, selisih 48.576 token
• Output maksimum — tidak dipublikasikan untuk MiniMax-M3.1-Flash-Preview; 384.000 token untuk DeepSeek V4 Flash, yang tidak biasa pada harga ini dan merupakan angka yang seharusnya menentukan banyak keputusan pembelian
• Modalitas input — teks, gambar, dan video untuk MiniMax-M3.1-Flash-Preview; hanya teks untuk DeepSeek V4 Flash
• Kontrol pemikiran — tangga upaya dari rendah hingga maks, pemikiran selalu aktif, untuk MiniMax-M3.1-Flash-Preview; pemikiran atau non-pemikiran pada DeepSeek V4 Flash, dengan non-pemikiran sebagai opsi nyata
• Dukungan protokol — endpoint yang kompatibel dengan Anthropic, kompatibel dengan OpenAI, dan OpenAI Responses untuk MiniMax-M3.1-Flash-Preview; tiga hal yang sama plus penyelesaian prefiks obrolan pada DeepSeek V4 Flash
• Bobot — tidak ada untuk MiniMax-M3.1-Flash-Preview; bobot DeepSeek V4 Flash telah dipublikasikan, meskipun model itu sendiri sudah digantikan
• Harga — tidak dipublikasikan untuk MiniMax-M3.1-Flash-Preview; dipublikasikan dan rendah untuk DeepSeek V4 Flash

Baca daftar itu dua kali, karena batas output adalah yang tidak mencolok. Konteks satu juta token dengan 384.000 token output adalah jendela generasi sekali jalan yang benar-benar panjang. Konteks satu juta token dengan batas output yang tidak diungkapkan adalah janji tentang membaca, bukan tentang menulis. Jika beban kerja Anda adalah "baca repositori, keluarkan rencana migrasi", angka kedua itulah yang menentukan apakah tugas tersebut muat dalam satu panggilan.

Pada apa masing-masing diukur

Ini adalah bagian yang paling tidak nyaman dari perbandingan ini, dan bagian ini singkat.

DeepSeek V4 Flash memiliki catatan benchmark, dan itu independen. Artificial Analysis memberinya skor 34,3 pada Intelligence Index — ke-42 dari 145 model pada indeks tersebut — dengan 69,1 pada Coding Index dan 90,8% pada GPQA Diamond. Skor 95,0 pada τ²-Bench yang diunggulkan oleh entri katalog kami sendiri adalah angka yang sama yang tercantum dalam materi peluncuran DeepSeek, jadi itu adalah angka vendor yang didampingi data independen, bukan angka yang diaudit. Recall konteks panjangnya adalah 79,7% dan angka terminal-bench-nya adalah 78,7% pada harness v2.1. Itu adalah pengukuran nyata dan sebanding dari model yang sudah dikenal.

MiniMax-M3.1-Flash-Preview tidak memilikinya. MiniMax tidak menerbitkan tabel evaluasi apa pun saat peluncuran, dan tidak ada pihak ketiga yang memilikinya juga — model ini sama sekali tidak muncul di indeks Artificial Analysis. Itu bukan celah dalam riset kami; itu adalah keadaan terkini dari catatan publik, dan artinya setiap klaim kualitas tentang model yang lebih baru, pada saat ini, hanyalah kata sifat dari vendor. Siapa pun yang memberi Anda tabel benchmark MiniMax-M3.1-Flash-Preview hari ini entah mengutip MiniMax-M3 yang lebih lama atau mengarangnya.

A generated two-column scoreboard titled 'MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash — the scoreboard'. The left column, MiniMax M3.1 Flash Preview, reads 'AA Intelligence: none published', 'Coding score: none published', 'Context window: 1M', 'Max output: not published', 'Weights: none', 'Price: not published'. The right column, DeepSeek V4 Flash, reads 'AA Intelligence: 34.3', 'Coding score: 69.1', 'Context window: 1,048,576', 'Max output: 384,000', 'Weights: published', 'Price: $0.15 / $0.60 off-peak'. A footer reads 'MiniMax figures per platform.minimax.io documentation, 27 September 2026; DeepSeek figures per DeepSeek's published rate card and Artificial Analysis. The MiniMax column is empty because nothing has been published, not because a result is pending.'

DeepSeek V4 Flash tidak dijual dengan harga yang Anda ingat

Inilah jebakannya. Angka yang banyak dikutip untuk DeepSeek V4 Flash — $0,14 per juta token input dan $0,28 per juta token output — adalah tarif yang berlaku untuk model tersebut sebelum 10 September 2026. Pada tanggal itu DeepSeek merilis DeepSeek-V4.1-Flash, menghentikan V4 Flash dan eksperimen V4-Flash-Vision-Exp, serta memangkas harga. deepseek-v4-flash masih berfungsi sebagai pengenal, tetapi dokumentasi DeepSeek menyatakan bahwa untuk sementara ia dialihkan ke V4.1 Flash dan ditagih dengan harga Flash. Dengan kata lain, Anda masih dapat mengetikkan nama model lama; Anda tidak memanggil model lama.

Jadi, kartu yang sebenarnya untuk dibandingkan adalah kartu yang saat ini, per 1 juta token — dan di luar jam sibuk adalah separuh yang lebih murah darinya:

• Input cache-miss — $0.15 di luar jam sibuk, $0.30 pada jam sibuk
• Input cache-hit — $0.003 di luar jam sibuk, $0.006 pada jam sibuk
• Output — $0.60 di luar jam sibuk, $1.20 pada jam sibuk
• Jendela jam sibuk — 01:00–04:00 dan 06:00–10:00 UTC, Senin hingga Jumat, tidak termasuk hari libur nasional Tiongkok; semua waktu lainnya, termasuk akhir pekan penuh, di luar jam sibuk

Sebaliknya, MiniMax-M3.1-Flash-Preview tidak memiliki tarif per token dalam bentuk apa pun. Biayanya adalah berapa pun biaya seat Token Plan Anda — $22, $55, atau $132 per bulan untuk Plus, Max, dan Ultra — yang terkuras melalui kumpulan kuota bersama pada harga daftar bayar sesuai pemakaian masing-masing model, dengan vendor berhak mengubah komposisi kumpulan tersebut. Untuk anggaran bulanan tetap dengan volume yang dapat diprediksi, itu bisa menjadi nilai yang sangat baik. Bagi proyek yang perlu mengatribusikan biaya per panggilan, ini adalah ketidakjelasan yang berkedok langganan.

Alasan ini lebih penting daripada biasanya di sisi DeepSeek adalah pengali puncak. Tim di Eropa atau Asia yang menjalani hari kerjanya berada di dalam jendela puncak untuk sebagian signifikan dari lalu lintasnya dan membayar dua kali lipat untuk keistimewaan itu, yang mengubah tarif input $0.15 yang diumumkan menjadi $0.30 tepat pada jam-jam saat sebagian besar produk sibuk. Susun anggaran berdasarkan kolom puncak kecuali lalu lintas Anda benar-benar berjalan pada malam hari UTC.

Kapan MiniMax M3.1 Flash Preview menjadi pilihan yang salah

Tiga kasus, dan dua yang pertama mudah terlewat karena didokumentasikan alih-alih dikurangkan.

Batas keluaran tidak diketahui. Jika tugas Anda berakhir dengan generasi panjang — spesifikasi lengkap, penulisan ulang transkrip, laporan beranotasi — Anda memilih anggaran keluaran yang tidak dapat Anda lihat. DeepSeek V4 Flash mempublikasikan 384.000. Asimetri itu menguntungkan model yang lebih tua untuk apa pun yang banyak menulis.

Berpikir tidak dapat dimatikan. Kirim thinking: {"type": "disabled"} ke MiniMax-M3.1-Flash-Preview dan Anda mendapatkan HTTP 400: model memerlukan pemikiran adaptif. Pada DeepSeek V4 Flash, mode tanpa berpikir ada dan merupakan sakelar yang didukung. Untuk klasifikasi throughput tinggi, perutean, atau ekstraksi terstruktur singkat, model yang selalu menalar terlebih dahulu membayar latensi dan token yang tidak Anda minta — dan satu-satunya tuas yang Anda miliki adalah menurunkan upaya ke rendah, bukan menghilangkan penalaran.

Ini tidak dapat dipanggil pada pay-as-you-go. Dokumentasi vendor dengan jelas menyatakan bahwa MiniMax-M3.1-Flash-Preview hanya tersedia melalui Token Plan dan MiniMax Code saat ini, dan Subscription Key tidak dapat dipertukarkan dengan kunci API pay-as-you-go. Jika Anda sudah memiliki seat, ini adalah perubahan satu baris. Jika belum, mengevaluasi model ini berarti membeli langganan.

Ketika angka DeepSeek adalah pilihan yang salah

Cerminan sebaliknya adalah bahwa DeepSeek V4 Flash hanya mendukung teks dan sudah digantikan. Model ini tidak pernah menerima gambar — pekerjaan itu memerlukan build eksperimental terpisah, yang kini telah dihentikan bersamanya — dan pengenal model kini menyajikan bobot yang berbeda dari yang disiratkan oleh namanya. Pipeline yang dipatok ke deepseek-v4-flash untuk reproduksibilitas sedang bergantung pada pengalihan yang DeepSeek gambarkan sebagai sementara.

MiniMax-M3.1-Flash-Preview menerima teks, gambar, dan video secara native, dan ini adalah model teks peringkat teratas vendor saat ini. Input video pada kisaran harga Flash tidak umum di kelas ini.

Kedua catatan peringatan itu mengarah pada kesimpulan yang sama bagi siapa pun yang menjalankan lalu lintas produksi: pengenal pada faktur dan model yang menjawab tidak dijamin selamanya merujuk pada hal yang sama, dan lapisan perutean adalah tempat hal itu ditangani, bukan tempat hal itu baru ditemukan.

A generated infographic titled 'The two Flash brackets, side by side' listing six paired rows: 'Sales motion — subscription seat vs per-token rate card', 'Effective input rate — Token Plan quota vs $0.15 off-peak / $0.30 peak', 'Peak surcharge — not applicable vs doubles 01:00-04:00 and 06:00-10:00 UTC', 'Cost attribution — pooled quota vs metered per call', 'Failure mode — no published output ceiling vs identifier now serves a successor', and 'Best fit — fixed-budget teams vs metered pipelines'. A footer reads 'Both models carry a 1M-token context window; neither figure is a quality claim.'

Bagaimana cara memutuskan ini dalam satu sore

Mulailah dari akhir tugas, bukan dari awal.

Jika pekerjaannya adalah pembuatan teks panjang — apa pun yang selesai dengan menulis puluhan ribu token — DeepSeek V4 Flash adalah satu-satunya dari keduanya yang menerbitkan batas maksimum yang cukup besar untuk menjanjikannya, dan daftar tarifnya cukup kecil sehingga pengganda puncaknya masih dapat ditanggung. Modelkan biayanya pada tarif puncak, bukan di luar puncak, dan perlakukan pengenal yang sudah dipensiunkan itu sebagai migrasi yang belum Anda lakukan, bukan sebagai kontrak yang stabil.

Jika pekerjaannya adalah membaca dan menalar atas input multimodal dengan anggaran bulanan tetap — rekaman layar, dokumen hasil pindai, tinjauan video — MiniMax-M3.1-Flash-Preview adalah bentuk yang lebih mumpuni, dan di dalam seat Token Plan, itu adalah cara termurah untuk mendapatkan input video pada panjang konteks ini. Terimalah bahwa Anda membeli model yang belum terukur, dan batasi radius ledakannya: pertahankan beban kerja yang penting pada sesuatu dengan rate card yang dipublikasikan, dan biarkan versi preview menangani separuh eksploratifnya.

Jika kedua deskripsi cocok dengan pipeline Anda, itu adalah masalah routing, bukan masalah pemilihan model, dan untuk itulah kami ada. DeepSeek V4 Flash di OrcaRouter berada pada tarif penyedia dengan markup 0% — entri katalognya menunjukkan $0.22 per juta token input dan $0.66 per juta output, yang merupakan kolom puncak kartu Flash saat ini, diteruskan langsung — bersama MiniMax-M3 dan MiniMax M2.7 dalam rentang harga yang sama pada kunci yang sama. Satu endpoint menjangkau 200+ model dengan failover otomatis di belakangnya, sehingga beban kerja dapat berpindah antara rentang harga tanpa integrasi kedua. MiniMax-M3.1-Flash-Preview tidak ada di katalog kami; untuk menjangkaunya berarti Token Plan milik vendor dan produk coding-nya.

Versi satu barisnya: DeepSeek V4 Flash adalah kuantitas yang sudah dikenal dengan batas output yang dipublikasikan, kartu tarif yang mudah dibaca, dan penerus yang diam-diam menyandang namanya; MiniMax-M3.1-Flash-Preview adalah yang lebih baru, multimodal, belum terukur, yang memerlukan langganan untuk mencobanya. Tak satu pun dari itu menjadi alasan untuk memilih yang lain — itu hanyalah fakta yang tidak akan Anda dapatkan dari perbandingan harga per token yang mengutip kartu yang DeepSeek pensiunkan pada September.

A headless Chromium screenshot of the OrcaRouter model page for deepseek/deepseek-v4-flash, showing the model title 'DeepSeek: DeepSeek V4 Flash', a pricing row reading 0.22 US dollars per million input tokens and 0.66 per million output tokens, a context window of 1,048,576 tokens, and a maximum output of 384,000 tokens, captured 28 September 2026.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari