Kartu judul yang dihasilkan bertuliskan MiMo-V2.6-Pro vs GPT-5.6 Sol, dengan subjudul 15 kali lipat biaya per tugas untuk satu poin indeks di bawahnya dan tiga ikon garis datar di atas judul yang menyiratkan meteran biaya, kartu skor, dan pemberitahuan bertanggal. Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: Satu Poin Indeks Berbiaya Lima Belas Kali Lebih Mahal per Tugas

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Pada Artificial Analysis Intelligence Index v4.3.2, yang dibaca pada 25 September 2026, GPT-5.6 Sol pada upaya maksimum mendapat skor 47 dan MiMo-V2.6-Pro milik Xiaomi mendapat skor 46. Satu poin. Angka yang sebenarnya memisahkan keduanya bukanlah skor dan bukan pula tarif per token — melainkan biaya satu tugas indeks, yang dipublikasikan Artificial Analysis sebagai $1.99 untuk GPT-5.6 Sol dan $0.13 untuk MiMo-V2.6-Pro. Lima belas kali lipat uang untuk satu poin. Dan pada pembacaan ini, halaman evaluator itu sendiri untuk model tersebut memuat pemberitahuan deprekasi, karena GPT-6 Sol telah menggantikannya.

Xiaomi menerbitkan bobot dan laporan teknis MiMo-V2.6-Pro pada 21 September 2026, empat hari sebelum pembacaan ini; OpenAI merilis GPT-5.6 Sol pada 9 Juli 2026. Kedua fakta di atas baru sejak pasangan ini terakhir dituliskan, dan keduanya menarik ke arah yang berlawanan. Pemberitahuan deprekasi menyatakan bahwa perbandingan ini dilakukan terhadap model yang sudah ditinggalkan OpenAI. Angka per tugas menunjukkan bahwa hal yang tampak seperti kesalahan pembulatan ketika kedua model dikutip pada harga daftar, pada beban kerja nyata, adalah seluruh keputusan. Mana di antara keduanya yang penting bergantung pada apakah Anda membeli model atau menggantinya.

Apa yang sekarang dikatakan oleh kedua halaman itu

GPT-5.6 Sol dirilis pada 9 Juli 2026 sebagai model unggulan dari keluarga GPT-5.6. Harga daftarnya adalah $4,00 per juta token input dan $20,00 per juta output di API pihak pertama OpenAI, dengan diskon cache 90%, dan halaman tersebut mencatat 90 juta token output yang dihasilkan sepanjang index run, dibandingkan median 88 juta. Model ini terukur menghasilkan 73 token output per detik, yang oleh halaman yang sama disebut lebih cepat dari rata-rata dibandingkan median 72 t/s. Entri indeksnya berada di peringkat 19 dari 210 model di kelasnya.

Xiaomi MiMo-V2.6-Pro adalah checkpoint sparse mixture-of-experts dengan total 1,02 triliun parameter dan 42 miliar parameter aktif, berlisensi MIT, dengan jendela konteks 1 juta token dan masukan teks, gambar, suara, serta video dengan keluaran teks. Harganya tercantum $0,43 dan $0,87 per juta token dengan diskon cache 99% — sepersepuluh dari tarif masukan Sol dan satu per dua puluh tiga dari tarif keluarannya. Model ini menghasilkan 140 juta token keluaran pada uji indeks, dan terukur 43,6 token keluaran per detik, yang halamannya menggambarkan sebagai terbilang lambat dibandingkan median 67,1 t/s.

• Biaya tugas indeks — MiMo-V2.6-Pro $0.13; GPT-5.6 Sol $1.99 — selisihnya 15× • Harga daftar — MiMo-V2.6-Pro $0.43 / $0.87 per 1M; GPT-5.6 Sol $4.00 / $20.00 • Diskon cache — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Token keluaran pada proses indeks — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Kecepatan keluaran — MiMo-V2.6-Pro 43,6 t/s, dibanding median 67,1; GPT-5.6 Sol 73 t/s, dibanding median 72 • Konteks dan bobot — MiMo-V2.6-Pro 1M dan berlisensi MIT; GPT-5.6 Sol 1M dan proprietari

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

Pemberitahuan penghentian penggunaan adalah baris yang lebih berdampak.

Artificial Analysis kini membuka halaman GPT-5.6 Sol dengan pemberitahuan dalam kotak: “Model ini sudah usang. Kami hanya melanjutkan benchmark performa untuk beban kerja default 10k input token”, diikuti oleh kalimat bahwa OpenAI telah meluncurkan model yang lebih baru, GPT-6 Sol (max), dan model itulah yang seharusnya dipertimbangkan. Angka 47 pada indeks karena itu merupakan pembacaan atas model yang bukan lagi barang yang seharusnya dibeli. Itu tidak membuat pembacaannya salah — angka itu diukur pada indeks yang sama, pada hari yang sama, pada pengaturan effort yang sama dengan 46 — tetapi itu mengubah untuk apa perbandingan itu dilakukan. Ini bukan lagi “flagship mana yang harus saya gunakan”. Ini adalah “berapa biaya puncak papan model proprietary, pada saat ia menjadi puncak”.

Pembingkaian ulang itu lebih penting daripada kedengarannya, karena pemberitahuan penghentian di halaman evaluator adalah salah satu dari sedikit tempat ketika irama produk vendor muncul sebagai perubahan data, bukan siaran pers. Skornya dibekukan; modelnya tidak ditawarkan. Apa pun yang Anda bangun terhadap 47, Anda membangunnya terhadap snapshot.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

Mengapa angka per tugas adalah yang harus dijadikan acuan dalam pemodelan

Tarif per token membuat model murah tampak lebih baik dan menyesatkan pada beban kerja yang tidak netral-token. Biaya tugas indeks adalah pengukuran yang berbeda: itulah yang sebenarnya dikeluarkan evaluator untuk mendapatkan satu jawaban dari tiap model, yang mencakup baik tarif maupun jumlah token yang dipilih model untuk dihasilkan. MiMo-V2.6-Pro mengeluarkan lebih banyak token daripada Sol pada proses indeks — 140 juta berbanding 90 juta, sekitar 1,6 kali lebih banyak — dan tetap berbiaya $0,13 per tugas berbanding $1,99. Keunggulan tarifnya kira-kira dua puluh tiga kali lipat pada output; penalti verbositasnya 1,6×; hasil kalinya adalah selisih per tugas sebesar lima belas kali lipat.

Itulah aritmetika yang seharusnya menjadi dasar pembuatan model biaya, dan itulah aritmetika yang tidak terlihat jika Anda membandingkan $0,87 dengan $20,00 lalu berhenti. Itu juga memberi tahu Anda apa yang akan meruntuhkan kesimpulan tersebut. Jika beban kerja Anda didominasi oleh keluaran yang sangat pendek, jumlah token Sol menciut mendekati jumlah token Anda dan selisih tarif dua puluh tiga kali lipat memainkan sebagian besar peran, sehingga kelipatan sebenarnya bergerak menuju selisih tarif, bukan menjauhinya. Jika beban kerja Anda didominasi oleh jejak penalaran yang panjang, verbositas 1,6× MiMo-V2.6-Pro terakumulasi dan $0,13 menjadi batas atas, bukan perkiraan. Angka yang dipublikasikan adalah pengukuran atas bentuk satu tolok ukur, bukan kutipan yang bisa Anda serahkan ke bagian keuangan.

Garis latensi adalah penyeimbang yang jujur

Pada 43,6 token output per detik, MiMo-V2.6-Pro lebih lambat daripada GPT-5.6 Sol yang diukur pada hari yang sama pada 73 — dan lebih lambat daripada model-model yang dibandingkan oleh halamannya sendiri, yang mediannya 67,1. Halamannya menyatakannya secara gamblang: “lambat secara mencolok”. Untuk pipeline batch, ini adalah biaya throughput yang dapat kamu perhitungkan. Untuk agen interaktif, ini adalah keputusan produk, dan lima belas kali lebih murah per tugas tidak membuat model yang lambat menjadi cepat. Jika batasanmu adalah anggaran per giliran, bukan tagihan bulanan, rasio yang penting adalah 43,6 berbanding 73, dan MiMo-V2.6-Pro kalah.

Di mana ini berakhir pada router

Bentuk berguna dari pemasangan ini bukanlah "pilih salah satu". Yang penting adalah kedua model menjawab indeks yang sama dan evaluator menerbitkan biaya per tugas untuk masing-masing, sehingga pembagiannya dapat dilakukan berdasarkan biaya yang terukur, bukan berdasarkan tingkatan vendor. Di OrcaRouter, katalognya mencakup 200+ model di balik satu kunci pada harga daftar tiap penyedia dengan markup 0% — pemotongan harga vendor sampai ke tagihan Anda pada hari yang sama, tanpa kontrak kedua yang perlu dinegosiasikan ulang — dan DSL perutean memungkinkan sebuah beban kerja mengirim panggilan murah bervolume tinggi ke satu model dan panggilan yang sulit ke model lain berdasarkan tugas, bukan berdasarkan merek. Failover otomatis menangani kasus ketika rute yang lebih murah mengalami degradasi. Xiaomi MiMo-V2.6-Pro tidak ada di rute kami — kami tidak mencantumkan sebuah model sebelum penyedianya meng-onboard-nya — jadi untuk sisi perbandingan itu, jawaban yang jujur adalah API milik vendor sendiri atau platform hosting mana pun yang sudah memiliki hubungan dengan Anda.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

Apa yang harus dilakukan dengan ini sebelum minggu depan

Dua hal berubah pada 25 September 2026 dan hanya satu di antaranya yang berkaitan dengan harga. GPT-5.6 Sol membawa pemberitahuan penghentian pada indeks tempat ia diukur pada 47, yang mencoretnya sebagai keputusan pembelian dan menyisakannya sebagai referensi tolok ukur. MiMo-V2.6-Pro diukur pada $0,13 per tugas indeks dibandingkan $1,99 milik Sol, yaitu lima belas kali uang untuk satu poin indeks — dan kecepatannya 43,6 token per detik, yang lebih lambat daripada model yang dibandingkan dengannya dan lebih lambat daripada median kelasnya sendiri. Uji kedua angka tersebut terhadap traffic Anda sendiri sebelum salah satu angka menjadi keputusan: biaya per tugas adalah pengukuran, bukan tarif, dan latensi adalah pengukuran, bukan opini. Jika output Anda pendek dan non-interaktif, argumen untuk checkpoint terbuka lebih kuat daripada yang disiratkan oleh selisih indeks. Jika output Anda panjang atau pengguna Anda menunggu, penghematan lima belas kali lipat memberi Anda produk yang lebih lambat, dan itu adalah pertukaran yang hanya beban kerja Anda yang dapat menilai harganya.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari