Kartu hero yang dihasilkan berjudul 'DeepSeek V4 Pro vs MiniMax M3' dengan ikon dompet ramping di sebelah kiri berlabel 'MiniMax M3' berlencana '$0.30/$1.20 · teks+gambar+video' dan ikon dompet yang sedikit lebih besar di sebelah kanan berlabel 'DeepSeek V4 Pro' berlencana '$0.66/$1.98 di luar jam sibuk · MIT', dengan ikon timbangan kecil di antara keduanya dan footer 'Permainan bobot terbuka yang sama dengan harga lima kali lipat'.
Guides & Insights

DeepSeek V4 Pro vs MiniMax M3: Permainan Bobot Terbuka yang Sama dengan Harga Lima Kali Lipat

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (Mini​Max's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, Deep​Seek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.

Pengukuran independen di bawah ini berasal dari Artificial Analysis. Angka yang dilaporkan vendor diberi label demikian.

Dua model unggulan berbobot terbuka kelas hemat, terpaut satu poin indeks

Pada Artificial Analysis Intelligence Index, MiniMax M3 mendapat skor 30, peringkat #16 di kelasnya, dan DeepSeek V4 Pro mendapat skor 36, peringkat #7. Selisih enam poin antara model yang biayanya hampir sama per token. Itulah intinya: model yang lebih mahal juga yang terukur lebih pintar — tetapi hanya dengan selisih enam poin, dan hanya pada sumbu teks-saja tempat V4 Pro berada. MiniMax M3 menerima input teks, gambar, dan video; V4 Pro hanya teks. Jika input multimodal menjadi kebutuhan, perbandingan berakhir di situ — MiniMax M3 adalah satu-satunya dari keduanya yang dapat membaca video.

• Indeks Kecerdasan — V4 Pro 36 (#7/113) vs MiniMax M3 30 (#16/113)

• Harga — MiniMax M3 $0.30/$1.20 per 1 juta vs V4 Pro $0.66/$1.98 di luar jam sibuk ($1.32/$3.96 jam sibuk)

• Kecepatan — MiniMax M3 ~103 token/detik vs V4 Pro ~81 token/detik

• Konteks — keduanya 1 juta token

• Parameter — MiniMax M3 428B total / 23B aktif vs V4 Pro 1.6T total / 49B aktif

• Input — MiniMax M3 teks/gambar/video vs V4 Pro hanya teks

• License — Mini​Max Community License vs V4 Pro MIT

Persaingan harga lebih ketat daripada yang terlihat dari label harganya

Jika dibandingkan secara langsung, MiniMax M3 2,2x lebih murah untuk input dan 1,65x lebih murah untuk output dibandingkan tarif off-peak V4 Pro. Namun harga tertera menyembunyikan mekanisme cache dan peak. Jendela off-peak V4 Pro memotong separuh harga yang sudah rendah, dan diskon pembacaan cache-nya mencapai sekitar 97% — sekitar $0,02 per juta token yang di-cache saat off-peak. Harga cache MiniMax M3 tidak seagresif itu. Untuk beban kerja yang menggunakan ulang awalan besar — prompt sistem yang panjang, dokumen panjang, korpus retrieval — biaya efektif per token V4 Pro pada jendela cache off-peak-nya dapat memangkas harga utama MiniMax M3, yang merupakan pembalikan mengejutkan dari peringkat harga tertera. Pada beban kerja token baru, MiniMax M3 lebih murah; pada beban kerja yang berat cache, V4 Pro bisa menang.

Kecepatan menunjukkan cerita serupa tetapi terbalik. MiniMax M3 menghasilkan sekitar 103 token per detik dibandingkan 81 milik V4 Pro — yang tercepat di antara model mana pun pada tingkat harganya, dan lebih cepat daripada beberapa model yang harganya lima kali lebih mahal. Keunggulan kecepatannya nyata tetapi tidak terlalu besar; keunggulan harganya lebih penting, dan itu bergantung pada beban kerja.

Lisensi dan ketahanan: di mana September mengubah jawabannya

Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINI​MAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.

Pertanyaan tentang ketahanan, yang sebulan lalu benar-benar nyata, adalah berita September ini. DeepSeek menghabiskan paruh pertama September dengan mengumumkan penghentian V4 Pro pada 14 September, menundanya, lalu — pada tanggal 11 — membatalkannya, dengan komitmen publik untuk terus melayani model tersebut dengan biaya yang tidak berubah dan memberi pemberitahuan jika hal itu berubah. MiniMax M3 tidak punya drama seperti itu karena memang tidak ada yang diharapkan: ini adalah flagship muda tanpa penghentian yang terlihat di depan. Tetapi efeknya sama: kedua sisi pertandingan ini sekarang memiliki peta jalan yang jelas, sesuatu yang tidak bisa dikatakan tentang salah satunya dua minggu lalu.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at $1.32 input and $3.96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Siapa yang harus memilih yang mana

Jika beban kerja Anda mencakup input gambar atau video, keputusannya sudah jelas: MiniMax M3 adalah satu-satunya dari kedua model tersebut yang dapat membacanya, dengan harga terendah di kelasnya. Jika beban kerja Anda hanya teks dan berat cache — agen dengan prompt sistem besar, RAG dokumen panjang, peringkasan korpus besar — jendela cache di luar jam sibuk dan lisensi MIT milik V4 Pro menjadikannya pilihan biaya per jawaban yang lebih baik, terutama karena sekarang dijamin akan tetap tersedia. Jika beban kerja Anda hanya teks dan sensitif terhadap latensi, 103 token/detik serta $0.30/$1.20 milik MiniMax M3 menjadikannya opsi murah tercepat yang tersedia.

Kedua model tersedia melalui OrcaRouter dengan satu kunci, dengan harga daftar penyedia diteruskan tanpa markup — jadi angka di atas adalah angka yang Anda bayar — dan failover otomatis antarpenyedia adalah jawaban praktis untuk satu hal yang tidak bisa dipastikan sebelumnya oleh perbandingan ini: penyedia model mana yang akan bertahan di bawah beban aktual Anda. Merutekan lalu lintas multimodal ke MiniMax M3 dan pekerjaan teks konteks panjang ke DeepSeek V4 Pro hanyalah perubahan routing-DSL dua baris, dan failover berarti gejolak penyedia di sisi mana pun hanyalah percobaan ulang, bukan insiden.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of $0.66 and output price of $1.98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs MiniMax M3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, Input text, Weights MIT; right column MiniMax M3 rows AA Index 30 (#16/113), Price $0.30/$1.20, Speed ~103 tok/s, Context 1M, Input text+image+video, Weights Community License; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

Putusan

Ini adalah pertarungan paling ketat di jajaran DeepSeek V4 Pro, karena kedua model murah, keduanya berbobot terbuka, dan keduanya cepat. MiniMax M3 menang dalam hal harga mentah, kecepatan, dan input multimodal. DeepSeek V4 Pro menang dalam hal kecerdasan, kebersihan lisensi, dan — sejak 11 September — kepastian daya tahan. Jawaban singkatnya: teks multimodal atau yang kritis terhadap latensi ditujukan ke MiniMax M3; beban kerja yang berat cache, hanya teks, atau sensitif secara hukum ditujukan ke DeepSeek V4 Pro.

Arahkan trafik multimodal ke MiniMax M3 dan pekerjaan teks konteks panjang ke DeepSeek V4 Pro: MiniMax M3 perubahan DSL perutean dua baris.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari