
MiMo-V2.6-Pro vs GPT-5.6 Sol: Satu Poin Indeks Berbiaya Lima Belas Kali Lebih Mahal per Tugas
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 36 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 181 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
Pada Artificial Analysis Intelligence Index v4.3.2, yang dibaca pada 25 September 2026, GPT-5.6 Sol pada upaya maksimum mendapat skor 47 dan MiMo-V2.6-Pro milik Xiaomi mendapat skor 46. Satu poin. Angka yang sebenarnya memisahkan keduanya bukanlah skor dan bukan pula tarif per token — melainkan biaya satu tugas indeks, yang dipublikasikan Artificial Analysis sebagai $1.99 untuk GPT-5.6 Sol dan $0.13 untuk MiMo-V2.6-Pro. Lima belas kali lipat uang untuk satu poin. Dan pada pembacaan ini, halaman evaluator itu sendiri untuk model tersebut memuat pemberitahuan deprekasi, karena GPT-6 Sol telah menggantikannya.
Xiaomi menerbitkan bobot dan laporan teknis MiMo-V2.6-Pro pada 21 September 2026, empat hari sebelum pembacaan ini; OpenAI merilis GPT-5.6 Sol pada 9 Juli 2026. Kedua fakta di atas baru sejak pasangan ini terakhir dituliskan, dan keduanya menarik ke arah yang berlawanan. Pemberitahuan deprekasi menyatakan bahwa perbandingan ini dilakukan terhadap model yang sudah ditinggalkan OpenAI. Angka per tugas menunjukkan bahwa hal yang tampak seperti kesalahan pembulatan ketika kedua model dikutip pada harga daftar, pada beban kerja nyata, adalah seluruh keputusan. Mana di antara keduanya yang penting bergantung pada apakah Anda membeli model atau menggantinya.
Apa yang sekarang dikatakan oleh kedua halaman itu
GPT-5.6 Sol dirilis pada 9 Juli 2026 sebagai model unggulan dari keluarga GPT-5.6. Harga daftarnya adalah $4,00 per juta token input dan $20,00 per juta output di API pihak pertama OpenAI, dengan diskon cache 90%, dan halaman tersebut mencatat 90 juta token output yang dihasilkan sepanjang index run, dibandingkan median 88 juta. Model ini terukur menghasilkan 73 token output per detik, yang oleh halaman yang sama disebut lebih cepat dari rata-rata dibandingkan median 72 t/s. Entri indeksnya berada di peringkat 19 dari 210 model di kelasnya.
Xiaomi MiMo-V2.6-Pro adalah checkpoint sparse mixture-of-experts dengan total 1,02 triliun parameter dan 42 miliar parameter aktif, berlisensi MIT, dengan jendela konteks 1 juta token dan masukan teks, gambar, suara, serta video dengan keluaran teks. Harganya tercantum $0,43 dan $0,87 per juta token dengan diskon cache 99% — sepersepuluh dari tarif masukan Sol dan satu per dua puluh tiga dari tarif keluarannya. Model ini menghasilkan 140 juta token keluaran pada uji indeks, dan terukur 43,6 token keluaran per detik, yang halamannya menggambarkan sebagai terbilang lambat dibandingkan median 67,1 t/s.
• Biaya tugas indeks — MiMo-V2.6-Pro $0.13; GPT-5.6 Sol $1.99 — selisihnya 15× • Harga daftar — MiMo-V2.6-Pro $0.43 / $0.87 per 1M; GPT-5.6 Sol $4.00 / $20.00 • Diskon cache — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Token keluaran pada proses indeks — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Kecepatan keluaran — MiMo-V2.6-Pro 43,6 t/s, dibanding median 67,1; GPT-5.6 Sol 73 t/s, dibanding median 72 • Konteks dan bobot — MiMo-V2.6-Pro 1M dan berlisensi MIT; GPT-5.6 Sol 1M dan proprietari

Pemberitahuan penghentian penggunaan adalah baris yang lebih berdampak.
Artificial Analysis kini membuka halaman GPT-5.6 Sol dengan pemberitahuan dalam kotak: “Model ini sudah usang. Kami hanya melanjutkan benchmark performa untuk beban kerja default 10k input token”, diikuti oleh kalimat bahwa OpenAI telah meluncurkan model yang lebih baru, GPT-6 Sol (max), dan model itulah yang seharusnya dipertimbangkan. Angka 47 pada indeks karena itu merupakan pembacaan atas model yang bukan lagi barang yang seharusnya dibeli. Itu tidak membuat pembacaannya salah — angka itu diukur pada indeks yang sama, pada hari yang sama, pada pengaturan effort yang sama dengan 46 — tetapi itu mengubah untuk apa perbandingan itu dilakukan. Ini bukan lagi “flagship mana yang harus saya gunakan”. Ini adalah “berapa biaya puncak papan model proprietary, pada saat ia menjadi puncak”.
Pembingkaian ulang itu lebih penting daripada kedengarannya, karena pemberitahuan penghentian di halaman evaluator adalah salah satu dari sedikit tempat ketika irama produk vendor muncul sebagai perubahan data, bukan siaran pers. Skornya dibekukan; modelnya tidak ditawarkan. Apa pun yang Anda bangun terhadap 47, Anda membangunnya terhadap snapshot.

Mengapa angka per tugas adalah yang harus dijadikan acuan dalam pemodelan
Tarif per token membuat model murah tampak lebih baik dan menyesatkan pada beban kerja yang tidak netral-token. Biaya tugas indeks adalah pengukuran yang berbeda: itulah yang sebenarnya dikeluarkan evaluator untuk mendapatkan satu jawaban dari tiap model, yang mencakup baik tarif maupun jumlah token yang dipilih model untuk dihasilkan. MiMo-V2.6-Pro mengeluarkan lebih banyak token daripada Sol pada proses indeks — 140 juta berbanding 90 juta, sekitar 1,6 kali lebih banyak — dan tetap berbiaya $0,13 per tugas berbanding $1,99. Keunggulan tarifnya kira-kira dua puluh tiga kali lipat pada output; penalti verbositasnya 1,6×; hasil kalinya adalah selisih per tugas sebesar lima belas kali lipat.
Itulah aritmetika yang seharusnya menjadi dasar pembuatan model biaya, dan itulah aritmetika yang tidak terlihat jika Anda membandingkan $0,87 dengan $20,00 lalu berhenti. Itu juga memberi tahu Anda apa yang akan meruntuhkan kesimpulan tersebut. Jika beban kerja Anda didominasi oleh keluaran yang sangat pendek, jumlah token Sol menciut mendekati jumlah token Anda dan selisih tarif dua puluh tiga kali lipat memainkan sebagian besar peran, sehingga kelipatan sebenarnya bergerak menuju selisih tarif, bukan menjauhinya. Jika beban kerja Anda didominasi oleh jejak penalaran yang panjang, verbositas 1,6× MiMo-V2.6-Pro terakumulasi dan $0,13 menjadi batas atas, bukan perkiraan. Angka yang dipublikasikan adalah pengukuran atas bentuk satu tolok ukur, bukan kutipan yang bisa Anda serahkan ke bagian keuangan.
Garis latensi adalah penyeimbang yang jujur
Pada 43,6 token output per detik, MiMo-V2.6-Pro lebih lambat daripada GPT-5.6 Sol yang diukur pada hari yang sama pada 73 — dan lebih lambat daripada model-model yang dibandingkan oleh halamannya sendiri, yang mediannya 67,1. Halamannya menyatakannya secara gamblang: “lambat secara mencolok”. Untuk pipeline batch, ini adalah biaya throughput yang dapat kamu perhitungkan. Untuk agen interaktif, ini adalah keputusan produk, dan lima belas kali lebih murah per tugas tidak membuat model yang lambat menjadi cepat. Jika batasanmu adalah anggaran per giliran, bukan tagihan bulanan, rasio yang penting adalah 43,6 berbanding 73, dan MiMo-V2.6-Pro kalah.
Di mana ini berakhir pada router
Bentuk berguna dari pemasangan ini bukanlah "pilih salah satu". Yang penting adalah kedua model menjawab indeks yang sama dan evaluator menerbitkan biaya per tugas untuk masing-masing, sehingga pembagiannya dapat dilakukan berdasarkan biaya yang terukur, bukan berdasarkan tingkatan vendor. Di OrcaRouter, katalognya mencakup 200+ model di balik satu kunci pada harga daftar tiap penyedia dengan markup 0% — pemotongan harga vendor sampai ke tagihan Anda pada hari yang sama, tanpa kontrak kedua yang perlu dinegosiasikan ulang — dan DSL perutean memungkinkan sebuah beban kerja mengirim panggilan murah bervolume tinggi ke satu model dan panggilan yang sulit ke model lain berdasarkan tugas, bukan berdasarkan merek. Failover otomatis menangani kasus ketika rute yang lebih murah mengalami degradasi. Xiaomi MiMo-V2.6-Pro tidak ada di rute kami — kami tidak mencantumkan sebuah model sebelum penyedianya meng-onboard-nya — jadi untuk sisi perbandingan itu, jawaban yang jujur adalah API milik vendor sendiri atau platform hosting mana pun yang sudah memiliki hubungan dengan Anda.

Apa yang harus dilakukan dengan ini sebelum minggu depan
Dua hal berubah pada 25 September 2026 dan hanya satu di antaranya yang berkaitan dengan harga. GPT-5.6 Sol membawa pemberitahuan penghentian pada indeks tempat ia diukur pada 47, yang mencoretnya sebagai keputusan pembelian dan menyisakannya sebagai referensi tolok ukur. MiMo-V2.6-Pro diukur pada $0,13 per tugas indeks dibandingkan $1,99 milik Sol, yaitu lima belas kali uang untuk satu poin indeks — dan kecepatannya 43,6 token per detik, yang lebih lambat daripada model yang dibandingkan dengannya dan lebih lambat daripada median kelasnya sendiri. Uji kedua angka tersebut terhadap traffic Anda sendiri sebelum salah satu angka menjadi keputusan: biaya per tugas adalah pengukuran, bukan tarif, dan latensi adalah pengukuran, bukan opini. Jika output Anda pendek dan non-interaktif, argumen untuk checkpoint terbuka lebih kuat daripada yang disiratkan oleh selisih indeks. Jika output Anda panjang atau pengguna Anda menunggu, penghematan lima belas kali lipat memberi Anda produk yang lebih lambat, dan itu adalah pertukaran yang hanya beban kerja Anda yang dapat menilai harganya.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
