
MiniMax M3.1 Flash Preview Sudah Hadir di Token Plan: Apa yang Sebenarnya Anda Dapatkan dari Langganan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 468 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 192 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
MiniMax-M3.1-Flash-Preview resmi dirilis pada 27 September 2026, dan cara peluncurannya itulah yang jadi inti ceritanya. Ini bukan model bayar sesuai pemakaian. Vendor menempatkan model teks terbarunya di balik Token Plan Subscription Key yang sama yang sudah mencakup MiniMax-M3, MiniMax M2.7, dan varian M2.7-highspeed, jadi jika Anda memegang seat, tidak ada kunci baru yang perlu dibuat dan tidak ada kontrak kedua yang perlu ditandatangani. Yang juga tidak ada, per hari ini, adalah harga per token, model card, benchmark yang dipublikasikan, atau cara apa pun untuk mematikan thinking model.
Kombinasi itu — akses tanpa hambatan yang dipasangkan dengan ekonomi yang sama sekali tidak dipublikasikan — cukup tidak biasa sehingga layak dibedah sebelum siapa pun menyambungkan pipeline produksi ke sana. Sisa tulisan ini adalah apa yang sebenarnya dikatakan dokumentasi vendor sendiri, apa yang secara mencolok tidak dikatakannya, dan satu baris kode yang akan memberi tahu Anda dalam waktu satu menit apakah model ini cocok dengan cara Anda bekerja.
Apa yang sebenarnya mendarat pada 27 September
Dokumentasi pengembang MiniMax kini memuat catatan tetap, yang diulang di setiap halaman model teks: MiniMax-M3.1-Flash-Preview untuk sementara hanya tersedia melalui Token Plan dan MiniMax Code. Model ini muncul pertama dalam tabel model milik vendor tersebut, di atas MiniMax-M3, dan dijelaskan sebagai model pengodean multimodal terdepan dengan jendela konteks 1J dan kedalaman berpikir yang dapat disesuaikan.
• Jendela konteks — 1.000.000 token, plafon yang sama dengan yang dimiliki MiniMax-M3
• Modalitas masukan — teks, gambar, dan video, yang menghasilkan teks
• Kedalaman berpikir — pengaturan effort yang menerima low, medium, high, xhigh dan max, dengan nilai bawaan max jika dihilangkan
• Dukungan protokol — id model yang sama berfungsi melalui endpoint yang kompatibel dengan Anthropic milik MiniMax, endpoint yang kompatibel dengan OpenAI miliknya, dan endpoint OpenAI Responses miliknya
• Ketersediaan — hanya Token Plan dan MiniMax Code; tidak tersedia pada skema bayar sesuai pemakaian
• Harga — tidak ada tarif per token yang dipublikasikan di mana pun
• Bobot — tidak ada; dua repositori publik terbaru milik organisasi MiniMaxAI tetap MiniMax-Music3 dan MiniMax-H3
• Tolok ukur independen — tidak ada; model ini tidak memiliki entri pada indeks model Artificial Analysis
Perusahaan mengumumkannya pada hari yang sama di akun MiniMaxAgent-nya, dengan membingkainya untuk pengembangan sehari-hari alih-alih pekerjaan terdepan: cepat dan andal, dari perbaikan bug cepat hingga pengerjaan fitur lengkap. Itu adalah tugas tier Flash, bukan flagship. Liputan kantor berita pihak ketiga dari PANews dan KuCoin menggambarkannya dengan istilah yang sama dan mencatat bahwa para pengembang telah melihat model tersebut di pemilih MiniMax Code sebelum perusahaan mengonfirmasinya.

Kunci mana yang Anda gunakan lebih penting daripada biasanya.
Inilah bagian yang sering menjebak orang. MiniMax menggunakan dua jenis kredensial terpisah, dan M3.1-Flash-Preview hanya menerima salah satunya. Token Plan Subscription Key berasal dari Billing > Token Plan dan mencakup penggunaan langganan serta Credits yang dibeli. API Key pay-as-you-go mencakup model per token. Dokumentasi vendor secara eksplisit menyatakan bahwa keduanya tidak dapat dipertukarkan, dan bahwa Subscription Key dapat ada sebelum sumber daya berbayar apa pun dikaitkan dengannya — dalam hal ini, kunci tersebut valid tetapi tidak ada apa pun di belakangnya.
Jadi, uji praktisnya bukan "apakah saya punya MiniMax API key" melainkan "apakah saya punya seat Token Plan". Seat yang sudah ada sudah tercakup. Dokumentasi menyebutkan bahwa Subscription Key menjadi dapat digunakan ketika sebuah seat atau akses Credits ditetapkan, dan bahwa limpahan Credits ditarik secara otomatis setelah kuota langganan habis.
Ada juga inkonsistensi dokumentasi yang perlu diketahui, karena ini akan membingungkan siapa pun yang membaca halaman harga terlebih dahulu. Catatan kaki cakupan halaman harga Token Plan masih mencantumkan jajaran yang memenuhi syarat sebagai M3, M2.7, image dan speech, dengan H3 dikecualikan — halaman itu belum diperbarui untuk menyebut M3.1-Flash-Preview. Halaman-halaman model mengatakan sebaliknya: bahwa M3.1-Flash-Preview tersedia di Token Plan dan tidak di tempat lain. Kedua halaman tersebut merupakan halaman vendor yang aktif per hari ini. Hanya kunci di tangan Anda yang bisa memastikannya.
400 yang memberi tahu Anda model macam apa ini
Setiap model MiniMax seri M berpikir sebelum menjawab, tetapi M3.1-Flash-Preview adalah yang pertama menolak untuk berhenti. Kirim thinking: {"type": "disabled"} atau reasoning_effort: "none" dan API mengembalikan HTTP 400 dengan pesan:
Model "MiniMax-M3.1-Flash-Preview" memerlukan pemikiran adaptif; thinking.type="disabled" (termasuk reasoning.effort=none) tidak diizinkan (2013)
Panduan dari vendor sendiri adalah menurunkan upaya alih-alih mencoba menonaktifkan pemikiran, dan tangga tersebut adalah tuas latensi: pengeditan rutin pada low dan perubahan di seluruh repositori pada xhigh adalah model yang sama yang melakukan trade-off berbeda. Dua detail lebih lanjut khusus untuk model ini. Parameter reasoning_effort didokumentasikan efektif hanya untuk MiniMax-M3.1-Flash-Preview — ini bukan kontrol umum seri M. Dan sakelar keluaran reasoning_split, yang memisahkan pemikiran ke dalam bidang reasoning_content, saat ini tidak dapat diatur ke false pada model ini.
Di mana teks pemikiran ditempatkan bergantung pada protokol: endpoint yang kompatibel dengan Anthropic mengembalikannya sebagai thinking blok konten, endpoint yang kompatibel dengan OpenAI mengembalikannya pada reasoning_content, dan endpoint Responses mengembalikannya sebagai item keluaran penalaran. Jika Anda mengurai <think> tag dari keluaran MiniMax-M3, pekerjaan itu tidak lagi diperlukan pada model yang lebih baru — dan untuk percakapan penggunaan alat yang berselang-seling, respons lengkap termasuk blok thinking harus ditambahkan kembali ke riwayat pesan atau rantai penalaran akan terputus.
Promosi yang sedang berlangsung saat ini
MiniMax Code menjalankan promosi check-in dari 28 September hingga 7 Oktober di UTC+8, menggandakan kredit gratis yang diberikan untuk login harian dan membukanya untuk pengguna baru dan lama. Kredit yang dilaporkan berlaku di seluruh model yang didukung, dengan M3.1-Flash-Preview dan model video H3 disebut sebagai contoh. Secara terpisah, perusahaan mengatakan kuota Token Plan direset untuk semua pengguna saat peluncuran dan bahwa reset lebih lanjut direncanakan selama acara, dengan kelayakan ditampilkan di dalam aplikasi.
Anggap keduanya sebagai pernyataan vendor yang diteruskan melalui liputan peluncuran — keduanya adalah ketentuan promosi yang disertai tanggal, bukan perilaku produk, dan liputan yang sama mencatat bahwa pengumuman tersebut tidak merinci jumlah kredit per check-in atau aturan persisnya untuk hari yang terlewat. Keekonomian kondisi mapan lebih mudah diuraikan: Token Plan tercantum pada $22 per bulan untuk Plus, $55 untuk Max, dan $132 untuk Ultra, dengan jendela kuota bergulir 5 jam dan mingguan, yang diperkirakan vendor masing-masing sekitar tiga hingga empat, empat hingga lima, dan enam hingga tujuh agen bersamaan. Purchased Credits berjalan pada 1.000 kredit per dolar dan dipotong sesuai harga daftar bayar sesuai pemakaian tiap model.
Empat hal yang masih belum dimiliki model ini
Tidak satu pun dari hal berikut merupakan kritik terhadap model tersebut; masing-masing adalah celah yang harus diperhitungkan oleh sebuah tim, dan keempatnya dapat diverifikasi hari ini.
• Tidak ada harga. Tidak ada tarif per token untuk M3.1-Flash-Preview di halaman MiniMax mana pun, sehingga tidak dapat dibandingkan dengan M3 yang seharga $0,30 per juta input dan $1,20 per juta output, atau dengan apa pun lainnya, dalam hal biaya per token.
• Tidak ada tolok ukur. MiniMax tidak menerbitkan tabel evaluasi apa pun pada rilis ini. Begitu pula pihak lain: model ini tidak ada dalam indeks Artificial Analysis, sehingga kolomnya benar-benar kosong, bukan sekadar belum terisi.
• Tidak ada bobot. MiniMax-M3 dirilis dengan bobot terbuka; M3.1-Flash-Preview tidak memiliki repositori dan tidak ada checkpoint yang dapat diunduh.
• Tidak ada pengukuran independen. Tidak ada angka kecepatan output, latensi, atau tingkat kesalahan dari pihak ketiga mana pun, dan tidak ada juga dari telemetri perutean kami sendiri, karena model ini tidak ada dalam katalog kami.
Dibandingkan dengan peluncuran M3 pada Juni 2026, yang hadir dengan catatan arsitektur, lembar benchmark, dan kartu tarif pada hari pertama, ini adalah perilisan yang sengaja dibuat tenang. Tafsiran yang masuk akal — dan ini tafsiran, bukan rencana yang dinyatakan — adalah bahwa MiniMax menginginkan penggunaan nyata di dalam produknya sendiri sebelum memutuskan berapa biaya model dan apakah model itu akan dibuka.

Apa yang benar dari catatan pratinjau yang bocor
Empat hari sebelum peluncuran, sebuah dokumen pratinjau yang disalin di repositori mitra publik beredar, mendeskripsikan MiniMax M3.1 dengan sparse attention, kuantisasi atensi Q8KV4, routed expert NVFP4, head speculative-decoding DSpark, dan sebuah reasoning_effort bidang baru yang mengambil nilai dari max hingga low. Saat itu kami menuliskannya sebagai belum terverifikasi, karena memang demikian: tidak ada bobot, tidak ada kartu model, tidak ada halaman harga, dan tidak ada ID model API.
Salah satu dari lima klaim itu kini dikonfirmasi oleh dokumentasi vendor itu sendiri, dan itu adalah reasoning_effort field — termasuk tangga max-to-low, yang cocok persis dengan nilai yang dikirim. Empat klaim lainnya masih belum dikonfirmasi. Deskripsi terbitan MiniMax tentang M3.1-Flash-Preview hanya menyatakan bahwa model itu adalah model pengkodean multimodal terdepan dengan jendela konteks 1M dan kedalaman berpikir yang dapat disetel; deskripsi tersebut tidak menjelaskan skema atensi, kuantisasi, maupun head decoding. Siapa pun yang mengulang klaim sparse-attention dan NVFP4 sebagai spesifikasi yang sudah pasti sedang mengulang transkripsi pihak ketiga, yang justru tidak dikonfirmasi oleh rilis tersebut.
Jika Anda ingin mencobanya tanpa mempertaruhkan pipeline untuk itu
Bagian yang canggung dari pratinjau yang hanya menyediakan Token-Plan adalah bahwa cara alami untuk mengevaluasi model baru — memanggilnya dari stack yang sudah ada dan mengukurnya — justru merupakan satu hal yang tidak dapat Anda lakukan dengan bersih. Tidak ada tarif per token yang bisa dijadikan acuan, tidak ada profil latensi yang dipublikasikan, dan tidak ada skenario failover di dalam produk vendor itu sendiri jika pratinjau ini goyah.
Itulah situasi yang menjadi alasan sebuah lapisan routing dibangun. Semua yang dapat Anda panggil hari ini berada di balik satu endpoint yang kompatibel dengan OpenAI dan satu kunci API, dan model-model yang berdekatan dengan model ini sudah ada di sana: MiniMax-M3 dengan tarif penyedia sebesar $0,30 per juta token masukan dan $1,20 per juta token keluaran, MiniMax M2.7 dengan harga yang sama dengan jendela 200.000 token dan bobot terbuka, serta tier DeepSeek dan Qwen Flash dalam rentang harga yang sama. Harga di sisi kami adalah harga daftar penyedia yang diteruskan dengan markup 0%, jadi ketika vendor memangkas tarif, harga itu masuk ke sini pada hari yang sama alih-alih menunggu siklus negosiasi ulang. Failover otomatis berarti dependensi tingkat pratinjau dapat berada di samping jalur produksi, bukan di bawahnya, dan ketika MiniMax memang menerbitkan kartu tarif dan endpoint untuk MiniMax-M3.1-Flash-Preview, pertanyaannya menjadi entri tabel routing, bukan proyek migrasi. MiniMax-M3.1-Flash-Preview sendiri tidak ada di katalog kami, dan cara untuk menjangkaunya saat ini adalah Token Plan milik vendor sendiri dan produk coding mereka.
Ringkasan jujur untuk tim yang membaca ini pada hari peluncuran: model ini sudah aktif, gratis di margin jika Anda sudah membayar seat Token Plan, dan sepenuhnya tanpa harga serta belum terukur berdasarkan parameternya sendiri. Cobalah di dalam MiniMax Code, pertahankan pipeline yang Anda andalkan pada model dengan daftar tarif dan rekam jejak, dan perhatikan dua hal yang akan mengubah ini dari sekadar keingintahuan menjadi keputusan — harga yang dipublikasikan dan skor independen pertama.

