
Xiaomi MiMo-V2.6-Pro vs Grok 4.7: 30× Lebih Murah per Tugas, dan Keduanya Tidak Cepat
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 36 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 181 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
Xiaomi MiMo-V2.6-Pro dan Grok 4.7 sama-sama dirilis pada 21 September 2026, keduanya menempati peringkat 46 pada Artificial Analysis Intelligence Index v4.3.2, dan keduanya disebut lambat oleh halaman yang mengukurnya — 43,6 token keluaran per detik untuk MiMo-V2.6-Pro dibandingkan median 67,1, dan 40 untuk Grok 4.7 pada upaya xhigh. Yang membedakan keduanya adalah biaya sebuah jawaban. Angka per tugas dari evaluator adalah $0,13 untuk checkpoint terbuka Tiongkok itu dan $3,74 untuk model Grok 4.7, faktor sekitar 29. Itu bukan perbedaan tarif, atau bukan hanya itu: laju keluaran Grok 4.7 adalah $6,00 per juta token dibandingkan $0,87, yang berarti tujuh kali lipat, dan sisa kelipatannya berasal dari berapa banyak token yang dibakar masing-masing model untuk sampai pada sebuah jawaban.
Dua model di bulan yang sama, pada indeks yang sama, dengan skor yang sama, dihargai seolah-olah mereka berasal dari dekade pasar yang berbeda. Pertanyaan yang menarik bukanlah mana yang menang. Melainkan bagian mana dari 29× itu yang benar-benar bisa Anda hindari — karena dalam pasangan ini tepat satu dari keduanya adalah rute yang bisa Anda beli hari ini, dan itu yang mahal.
Hari yang sama, skor yang sama, hewan yang berbeda
Grok 4.7 dirilis pada 21 September 2026 dengan harga $2,00 per juta token input dan $6,00 per juta token output dengan jendela konteks 500.000 token, batas pengetahuan Mei 2026, diskon cache 75%, serta input teks dan gambar dengan output teks. Nilainya 46 pada indeks tersebut pada upaya xhigh, 56 pada Coding Agent Index dalam harness Grok Build, dan 1.657 Elo pada AA-Briefcase — keempat pada papan peringkat itu, di belakang tiga entri Anthropic, dengan biaya per tugas sekitar setengah dari Claude Opus 5.
Xiaomi MiMo-V2.6-Pro adalah checkpoint sparse mixture-of-experts, 1,02 triliun parameter total dengan 42 miliar aktif, berlisensi MIT, konteks 1 juta token, masukan teks, gambar, ucapan, dan video dengan keluaran teks, $0,43 dan $0,87 per juta token dengan diskon cache 99% yang membuat tarif masukan efektifnya menyusut hampir nol pada prompt hangat. Artificial Analysis menempatkannya di peringkat pertama dari 114 model open-weights pada indeks tersebut dan kedua belas dari 114 dalam hal biaya. Model ini dapat diakses melalui tiga penyedia API. Model ini tidak ada di rute kami, dan kami tidak mencantumkan model sebelum penyedia mengonboard-nya.
Satu-satunya baris yang memutuskannya
• Biaya per tugas indeks — MiMo-V2.6-Pro $0.13; Grok 4.7 $3.74 — 29× • Tarif output — MiMo-V2.6-Pro $0.87 / 1M; Grok 4.7 $6.00 / 1M — 6,9× • Token output pada proses indeks — MiMo-V2.6-Pro 140M; Grok 4.7 240M, dibandingkan median 88M • Kecepatan output — MiMo-V2.6-Pro 43,6 t/s; Grok 4.7 40 t/s — keduanya di bawah median • Jendela konteks — MiMo-V2.6-Pro 1M; Grok 4.7 500K • Bobot — MiMo-V2.6-Pro berlisensi MIT dan dapat diunduh; Grok 4.7 proprietari, hanya API
Baca dua butir pertama secara bersamaan, dan bentuk kesenjangannya menjadi jelas. Pada harga daftar, keduanya terpaut 6,9× pada keluaran. Pada uji indeks, keduanya terpaut 29× pada biaya sebuah jawaban. Faktor pengali di antaranya adalah verbositas: Grok 4.7 menghasilkan 240 juta token keluaran dibandingkan median 88 juta untuk kelasnya, dan MiMo-V2.6-Pro menghasilkan 140 juta. Itu adalah penalti token 1,71× yang bertumpuk di atas penalti tarif 6,9×, dan 1,71 × 6,9 adalah 11,8 — sisa jarak menuju 29 berasal dari sisi masukan, tempat diskon cache 99% dan tarif masukan $0,43 milik MiMo-V2.6-Pro memainkan peran besar pada beban kerja dengan prefiks berulang apa pun.

Bertele-tele adalah angka yang orang-orang lewatkan dari perkiraan
Model biaya biasanya dibangun dari kartu tarif dan jumlah token yang diasumsikan. Kedua bagian itu salah di sini. Kartu tarifnya salah karena diskon cache bukan sekadar catatan kaki — 99% versus 75% adalah perbedaan antara prompt sistem yang membebani Anda biaya setiap panggilan dan yang hampir tidak memakan biaya. Jumlah tokennya salah karena kedua model tidak menghasilkan jumlah token yang sama untuk pekerjaan yang sama, dan evaluator mengukur selisihnya: 240 juta versus 140 juta, rentang 1,71× pada tolok ukur yang identik.
Tidak satu pun dari keduanya merupakan proksi yang bisa Anda baca langsung dari lembar spesifikasi. Peringkat verbositas Grok 4.7 adalah #94 dari 210 model di kelasnya; peringkat biaya MiMo-V2.6-Pro adalah #12 dari 114 di kelasnya. Tim yang mengutip kartu tarif Grok 4.7 dan mengasumsikan beban kerja yang netral token akan memperkirakan sekitar seperempat dari apa yang sebenarnya dikeluarkan indeks per tugas. Koreksinya bukan pula menggunakan biaya indeks sebagai estimasi Anda — itu adalah pengukuran atas bentuk satu tolok ukur. Koreksinya adalah mengukur jumlah token Anda sendiri di kedua sisi sebelum berkomitmen, karena selisih antara kedua model adalah 6,9× di atas kertas dan 29× dalam praktik, dan hanya satu dari angka-angka itu yang nyata untuk lalu lintas Anda.

Keduanya lambat, dan itu bukanlah seri.
Artificial Analysis mengukur Grok 4.7 pada 40 token keluaran per detik dan menyebutnya “di antara yang paling lambat”; MiMo-V2.6-Pro pada 43,6 dan menyebutnya “lambat secara mencolok”. Kedua angka itu cukup berdekatan sehingga kecepatan tidak seharusnya menjadi penentu di antara keduanya. Namun, median di baliknya tidak demikian: 67,1 untuk kategori open-weights tempat MiMo-V2.6-Pro berada. Kedua model jauh di bawahnya, dan MiMo-V2.6-Pro juga memiliki waktu ke token pertama 3,17 detik terhadap median 2,31 detik, angka yang terasa menyakitkan dalam loop interaktif alih-alih batch.
Jadi ringkasan jujur dari sisi latensi adalah bahwa 29× lebih murah tidak memberi Anda produk yang lebih cepat, melainkan produk yang lebih lambat dengan biaya lebih rendah — dan jika pengguna Anda sedang menatap kursor, penantian 3,17 detik bisa jadi lebih mahal daripada token yang dihemat. Untuk pekerjaan batch semalaman, evaluasi offline, atau pipeline apa pun yang waktunya diukur dalam jam, pertukarannya lugas dan 29× itu hampir gratis.
Apa yang bisa dan tidak bisa dilakukan router dengan penyandingan ini
Ini adalah pasangan di mana katalog kami sendiri benar-benar berat sebelah, dan ada baiknya kita bersikap terus terang tentang hal itu. Grok 4.7 sudah aktif di OrcaRouter sebagai grok/grok-4.7dengan harga $2.00 / $6.00 milik penyedianya sendiri, output maksimum 450K, dan endpoint yang kompatibel dengan OpenAI SDK di https://api.orcarouter.ai/v1 — jadi jika perbandingan ini membuat Anda menginginkan model xAI di balik kunci yang sama dengan yang lainnya, jalur itu sudah tersedia hari ini. Xiaomi MiMo-V2.6-Pro tidak ada di rute kami; untuk sisi itu, API milik vendor sendiri atau penyedia mana pun dari tiga penyedia yang terdaftar yang sudah Anda gunakan adalah jawabannya, dan kami tidak akan berpura-pura sebaliknya.
Yang membuat sebuah router layak dipertimbangkan dalam perbandingan seperti ini adalah pada bagian-bagian yang bukan modelnya. Satu kunci untuk 200+ model pada harga daftar tiap penyedia dengan markup 0% berarti pemotongan harga vendor langsung masuk ke tagihan Anda pada hari yang sama, bukan pada perpanjangan kontrak berikutnya. Failover otomatis berarti rute 40 t/s yang menurun performanya tidak ikut menjatuhkan pipeline Anda. DSL routing memungkinkan pembagian dilakukan berdasarkan biaya per tugas yang dipublikasikan, bukan berdasarkan loyalitas merek — model murah untuk volume tinggi, model mumpuni untuk panggilan sulit, ditentukan per permintaan. Dan untuk beban kerja yang tidak benar-benar cocok dengan salah satu model, model fusion dapat menjalankan beberapa model di balik satu panggilan.

Pertanyaan yang biasanya muncul dari perbandingan ini
Apakah 29× tetap berlaku untuk beban kerja saya? Hanya jika campuran token Anda menyerupai yang ada pada run indeks. Jika output Anda pendek dan prompt Anda panjang serta di-cache, kelipatannya menyusut ke arah selisih tarif 6,9× pada output dan melebar pada input, di mana diskon 99% MiMo-V2.6-Pro merupakan suku penentu. Jika output Anda berupa jejak penalaran yang panjang, kelipatannya melebar melampaui 29×, karena penalti verbositas Grok 4.7 sebanding dengan panjang output.
Apakah angka 46 di masing-masing sisi adalah 46 yang sama? Ini adalah indeks yang sama, versi yang sama, dan skala yang sama — sub-skor yang mendasarinya adalah 46,32 dan 46,45, selisih 0,13 poin, dan indeks membulatkan keduanya menjadi 46. Artificial Analysis tidak mempublikasikan rincian per evaluasi untuk kedua model, sehingga komposit adalah ukuran paling rinci yang tersedia dan perbedaan 0,13 poin tidak boleh dianggap sebagai peringkat kemampuan.
Mana yang sebaiknya dijadikan default untuk proyek baru?Jika beban kerjanya bersifat batch, toleran terhadap latensi, dan sensitif terhadap biaya, MiMo-V2.6-Pro dengan $0,13 per tugas adalah default-nya dan bobot terbuka berarti Anda tidak terekspos pada penetapan harga satu penyedia. Jika Anda membutuhkan model xAI secara spesifik — hasil harness Grok Build, penempatan AA-Briefcase, konteks 500K dengan batas waktu Mei 2026 — Grok 4.7 adalah rute langsung di OrcaRouter saat ini dan premi per tugas adalah harga dari kemampuan spesifik tersebut. Tidak ada model di sini yang menang di keduanya.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
