
Xiaomi MiMo-V2.6-Pro vs MiniMax M3: Skor yang Lebih Baik Memiliki Rute yang Lebih Ramping
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Xiaomi MiMo-V2.6-Pro tersedia secara umum pada 22 September 2026 dan menduduki posisi teratas untuk model dengan bobot terbuka pada Artificial Analysis Intelligence Index dengan skor 46 pada v4.3.2. MiniMax M3 telah memegang versi gelar tersebut sejak dirilis pada 31 Mei 2026, dan pada indeks yang sama hari ini skornya 29 — tertinggal tujuh belas poin. Skor adalah hal yang paling tidak menarik dari pasangan ini. MiniMax M3 melayani 168,9 token keluaran per detik versus 134,3, menjawab dalam 0,92 detik versus 2,15, lebih murah per token masukan, dan dapat diakses melalui lima belas penyedia API versus satu milik Xiaomi. Model yang lebih baru dengan skor lebih tinggi justru lebih sulit untuk benar-benar dipanggil, dan pembalikan itulah yang menjadi inti perbandingan ini.
Keduanya berbobot terbuka, keduanya multimodal, berselang empat belas minggu
Kedua model itu adalah kerabat dekat dalam tujuan desain. Keduanya adalah model sparse mixture-of-experts dari laboratorium Tiongkok, keduanya membawa jendela konteks 1 juta token, keduanya menerima gambar dan video secara native alih-alih melalui adaptor tambahan, dan keduanya merilis bobot. Empat belas minggu memisahkan perilisan keduanya, dan selisih indeks di antara keduanya adalah jarak yang ditempuh garis depan open-weights dalam rentang waktu itu.
• Total parameter — Xiaomi MiMo-V2.6-Pro 1.02T; MiniMax M3 sekitar 427B, keduanya MoE sparse
• Aktif per token — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 sekitar 23–25B
• Konteks — masing-masing 1M token, dengan MiniMax M3 yang menjamin minimum 512K
• Modalitas masukan — teks, gambar, dan video untuk keduanya; Xiaomi menambahkan masukan audio
• Bobot — lisensi MIT pada Xiaomi MiMo-V2.6-Pro; MiniMax M3 dirilis di bawah MiniMax Community Licence, yang tidak bersifat permisif dan memerlukan perjanjian terpisah untuk penggunaan komersial
• Dirilis — Xiaomi MiMo-V2.6-Pro 21–22 September 2026; MiniMax M3 31 Mei 2026
• Jangkauan — satu penyedia API dihitung untuk Xiaomi MiMo-V2.6-Pro di Artificial Analysis; lima belas untuk MiniMax M3
Baris terakhir itulah yang harus terus diperhatikan. Semua hal lain di lembar itu lebih menguntungkan model yang lebih baru. Baris itu tidak, dan baris itulah yang menentukan apakah sebuah model bisa berada di jalur produksi.
Apa yang diukur indeks ini, dan siapa yang mengukurnya
Artificial Analysis menjalankan kedua model itu sendiri pada v4.3.2 — sebuah komposit sepuluh evaluasi yang mencakup penalaran, pengetahuan, matematika, dan pengodean, termasuk AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, dan AA-LCR v1.1. Baik 46 maupun 29 bukan angka vendor, yang penting di sini karena kedua laboratorium juga menerbitkan angka tolok ukur mereka sendiri yang merupakan angka vendor, dan kedua jenis tersebut tidak boleh dicampur.
Angka 46 menempatkan Xiaomi MiMo-V2.6-Pro di puncak bidang bobot terbuka pada komposit itu. Namun, angka itu tidak menempatkannya di puncak indeks: Claude Fable 5.1 dan GPT-6 Astra sama-sama berada di 53, dan Claude Opus 5 di 51. Skor 29 milik MiniMax M3 menempatkannya di urutan keenam belas dari 114 model yang diukur, jauh di atas median untuk kelas ukurannya tetapi masih jauh dari garis depan yang dibandingkan dengannya pada Juni.
MiniMax M3 punya bukti yang tidak dimiliki Xiaomi
Inilah bagian dari perbandingan yang dilewatkan, dan inilah bagian yang seharusnya paling diberi bobot oleh pembeli. MiniMax M3 ada di papan peringkat publik DeepSWE v1.1 dengan entri resmi: Pass@1 20,4% dan Pass@4 48,7%, diterbitkan 8 Juni 2026 setelah peningkatan inferensi MiniMax memperbaiki generasi token yang abnormal dan meningkatkan perilaku cache konteks panjang. Entri itu disertai penghitungan efisiensi, dan penghitungannya tidak bagus: median 311 langkah agen, sekitar 91.000 token keluaran, dan sekitar $5,04 per tugas. Model ini lulus tugas rekayasa berhorizon panjang, dan melakukannya dengan mahal.
Angka benchmark utama Xiaomi untuk model barunya adalah 72,57 pada DeepSWE v1.1, naik dari baseline 58,4, diukur dengan mini-swe-agent pada rata-rata dari tiga di harness milik Xiaomi sendiri. Ini bukan entri papan peringkat dan belum diajukan sebagai entri. Menempatkan 72,57 di samping 20,4 milik MiniMax dan menyimpulkan kemenangan 52 poin adalah aritmetika lintas dua pengukuran yang berbeda: papan peringkat mempublikasikan Pass@1 untuk konfigurasi tertentu, dengan interval kepercayaan dan biaya rata-rata per tugas yang dapat dijalankan ulang oleh pihak ketiga, sedangkan angka dari vendor tidak memiliki semua itu yang melekat padanya. 72,57 bisa saja jujur. Hanya saja, itu bukan jenis objek yang sama.
MiniMax juga menerbitkan angka peluncurannya sendiri, dan peringatan yang sama berlaku untuk semuanya: SWE-Bench Pro sebesar 59,0, BrowseComp 83,5, SVG-Bench 63,7, dan Terminal-Bench 2.1 sebesar 66,0, dijalankan pada infrastruktur MiniMax sendiri dengan scaffolding-nya sendiri. Perlakukan semuanya sebagai klaim tentang model, bukan pengukuran terhadapnya.
Kecepatan, latensi, dan dua angka yang menentukan tagihan
Kesenjangan throughput berlawanan dengan kesenjangan kualitas, dan cukup besar untuk diperhitungkan. MiniMax M3 menghasilkan 168,9 token keluaran per detik dibandingkan 134,3 untuk Xiaomi MiMo-V2.6-Pro, dan waktu 0,92 detiknya ke token pertama sekitar dua setengah kali lebih cepat daripada 2,15 milik Xiaomi. Untuk produk interaktif, latensi token pertama adalah angka yang dirasakan pengguna; untuk pipeline batch, throughput adalah angka yang menentukan waktu nyata.
Dari segi biaya, keduanya lebih berdekatan daripada yang disiratkan oleh tarif utama, dan arahnya bergantung pada lalu lintas Anda. MiniMax M3 dipatok $0,30 per juta token input dan $1,20 per juta token output; Xiaomi MiMo-V2.6-Pro dipatok $0,43 dan $0,87. M3 lebih murah untuk diberi masukan, Xiaomi lebih murah untuk menghasilkan keluaran. Setelah diskon cache diterapkan — 80% untuk M3, 99% untuk Xiaomi — tarif gabungannya menjadi $0,22 dan $0,18 per juta pada komposisi cache-hit/input/output 7:2:1. Artificial Analysis juga mencatat biaya $0,13 per tugas Intelligence Index untuk Xiaomi MiMo-V2.6-Pro, yang diukur dengan cara yang sama di seluruh model di papan peringkat, yang merupakan angka biaya tunggal paling sebanding yang tersedia untuk keduanya.

Lima belas rute versus satu, dan seberapa berharga failover
Keunggulan indeks tujuh belas poin tidak akan menolong Anda jika endpoint-nya down. Artificial Analysis menghitung hanya satu penyedia API untuk Xiaomi MiMo-V2.6-Pro pada saat penulisan, dan jumlah itu adalah fakta tentang rilis tersebut, bukan tentang modelnya: checkpoint yang diterbitkan tiga hari lalu belum sempat menyebar. MiniMax M3, yang berusia empat bulan, dilayani oleh lima belas penyedia.
Perbedaan itulah gunanya router, dan di sinilah kedua model berbeda secara komersial. MiniMax M3 tersedia di OrcaRouter sebagai minimax/minimax-m3: satu endpoint yang kompatibel dengan OpenAI, harga daftar penyedia diteruskan tanpa markup 0%, jadi $0,30 dan $1,20 di atas adalah angka milik MiniMax sendiri, bukan angka kami, dan perubahan harga MiniMax langsung berlaku di sisi kami pada hari yang sama. Lima belas upstream-nya itulah yang membuat rantai failover otomatis menjadi berarti — permintaan yang macet pada satu penyedia akan dicoba ulang ke penyedia lain sebelum respons dimulai, sebuah jaminan yang berbeda dari model yang hanya punya satu tujuan. Xiaomi MiMo-V2.6-Pro tidak ada di OrcaRouter; tidak ada model Xiaomi yang tersedia di sana, dan untuk mengaksesnya saat ini berarti harus melalui platform milik Xiaomi sendiri serta katalog pihak ketiga yang mencantumkannya.
Jika Anda ingin keduanya berada dalam aplikasi yang sama, bentuk praktisnya adalah satu key yang menampung model-model yang sudah Anda putuskan, dengan pendatang baru dievaluasi terhadapnya alih-alih diadopsi berdasarkan skor yang sudah berumur tiga hari. Itu adalah keputusan perutean, dan properti yang berguna adalah bahwa jalur cadangan tidak memakan biaya apa pun sampai hari ketika ia menyelamatkan Anda.

Mana yang harus dipilih
Jika Anda membutuhkan model open-weight, multimodal, sejuta token yang siap produksi minggu ini, jawabannya adalah MiniMax M3, dan tidak ada yang mendekati — lima belas penyedia, token pertama di bawah satu detik, jalur komersial yang cukup permisif hanya jika Anda telah membaca lisensi komunitas, dan entri benchmark long-horizon resmi yang dapat Anda periksa. Peringatan efisiensinya nyata: anggarkan untuk 91.000 token keluaran per tugas, bukan hanya tarif per token.
Jika Anda memilih model untuk pekerjaan yang akan Anda mulai bulan depan, Xiaomi MiMo-V2.6-Pro adalah model yang lebih mumpuni dengan selisih terukur yang lebar, pada tarif campuran yang lebih rendah dan dengan lisensi MIT yang sama sekali menghapus perdebatan tentang lisensi. Yang belum dimilikinya adalah tempat kedua untuk menjalankannya. Hal yang perlu diperhatikan adalah jumlah penyedia: ketika model ini beralih dari satu penyedia, selisih tujuh belas poin itu berhenti menjadi hasil riset dan menjadi keputusan penerapan.
Sampai saat itu, ringkasan jujurnya adalah bahwa model yang lebih baik adalah model yang tidak dapat Anda lakukan failover darinya, dan model yang lebih lemah adalah model yang dapat Anda hadapkan kepada pelanggan malam ini.

Dari mana asal angka-angka dalam tulisan ini
Skor indeks, throughput, latensi, diskon cache, dan jumlah penyedia untuk kedua model merupakan pengukuran Artificial Analysis pada Intelligence Index v4.3.2, yang dibaca pada 22 September 2026, dan angka 29 untuk MiniMax M3 berada pada versi komposit yang sama dengan angka 46 untuk Xiaomi MiMo-V2.6-Pro. Angka DeepSWE v1.1 untuk MiniMax M3 berasal dari entri papan peringkat publik tanggal 8 Juni 2026. Pergerakan DeepSWE dari 58,4 ke 72,57, pengeluaran pembelajaran penguatan sekitar $2,62 juta untuk proses Pro selama tiga puluh langkah, serta angka SWE-Bench Pro, BrowseComp, SVG-Bench, dan Terminal-Bench untuk MiniMax M3 semuanya dilaporkan oleh vendor pada harness masing-masing lab dan belum direproduksi secara independen. Tarif per token adalah harga daftar milik vendor sendiri.
