Kartu judul yang dihasilkan membandingkan Xiaomi MiMo-V2.6-Pro dan GPT-5.6 Sol pada upaya maksimum. Kartu kiri bertuliskan Intelligence Index v4.3.2: 46, $0,18 campuran per 1 juta, $0,13 per tugas indeks, dan 134,3 token per detik; kartu kanan bertuliskan Intelligence Index v4.3.2: 47, $3,08 campuran per 1 juta, $3.464,84 untuk menjalankan indeks, dan 77,3 token per detik. Footer bertuliskan: Kedua skor pada Artificial Analysis Intelligence Index v4.3.2, dibaca 22 September 2026. Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: Satu Poin Indeks, Dua Puluh Dua Kali Tarif Campuran

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Pada Artificial Analysis Intelligence Index v4.3.2, yang dibaca pada 22 September 2026, GPT-5.6 Sol dari vendor tersebut pada upaya maksimal mencetak skor 47 dan MiMo-V2.6-Pro milik Xiaomi mencetak skor 46. Satu poin. Tarif campuran yang diterbitkan Artificial Analysis untuk keduanya — komposisi cache-hit, input, output 7:2:1 — adalah $3.08 untuk GPT-5.6 Sol dan $0.18 untuk MiMo-V2.6-Pro. Dua puluh dua kali lipat uang untuk satu poin indeks adalah keseluruhan bentuk pertarungan ini, dan pertanyaan yang menarik bukanlah apakah poin itu sepadan. Pertanyaannya adalah pada permintaan spesifik mana poin itu berada, karena angka agregat tidak memberi tahu Anda.

Yang membuat pasangan ini layak dibandingkan sama sekali adalah bahwa keduanya tidak jelas berada dalam kategori yang sama. GPT-5.6 Sol adalah model frontier proprietary dengan mode multi-agen dan daftar harga yang setimpal. Xiaomi MiMo-V2.6-Pro adalah checkpoint open-weights berlisensi MIT yang dirilis pada 22 September 2026, dengan repositori reinforcement-learning hadir sehari sebelumnya, dan harganya dipatok seolah-olah model kelas menengah. Fakta bahwa model terbuka bertriliun parameter berada dalam selisih satu poin dari model andalan OpenAI itulah beritanya. Apa yang Anda lakukan dengan fakta itu adalah keputusan tersendiri.

Kedua model tersebut dinyatakan secara gamblang.

GPT-5.6 Sol dirilis pada 9 Juli 2026 sebagai unggulan keluarga GPT-5.6, bersama Terra dan Luna, dan OpenAI mengarahkan alias polos gpt-5.6 ke sana. Produk ini bersifat proprietari, menerima input teks dan gambar serta mengembalikan teks, mendukung upaya penalaran dari none hingga xhigh serta mode multiagen "ultra" yang eksklusif untuk Sol, dan memiliki batas pengetahuan Februari 2026. Harga daftarnya adalah $4,00 per juta token input dan $20,00 per juta output di API pihak pertama OpenAI, dengan input cache sebesar $0,50 dan jendela konteks 1 juta token. Artificial Analysis mengukur 77,3 token output per detik dan 127,21 detik ke token pertama, dengan biaya $3.464,84 untuk menjalankan indeks penuh.

Xiaomi MiMo-V2.6-Pro adalah model sparse mixture-of-experts dengan total 1,02 triliun parameter dan 42 miliar yang diaktifkan per token, dengan jendela konteks 1 juta token dan multimodalitas bawaan di seluruh teks, gambar, video, dan audio. Xiaomi mempertahankan harga generasi sebelumnya alih-alih menaikkan harga checkpoint baru, itulah sebabnya model sebesar ini dibanderol pada $0,43 dan $0,87 per juta token dengan diskon cache 99%. Artificial Analysis mengukur 134,3 token keluaran per detik, 2,15 detik ke token pertama, dan $206,66 untuk menjalankan indeks — $0,13 per tugas.

• Bobot — MiMo-V2.6-Pro berlisensi MIT dan dapat diunduh; GPT-5.6 Sol proprietari, hanya API

• Parameter — MiMo-V2.6-Pro total 1,02T / aktif 42B; GPT-5.6 Sol tidak diungkapkan

• Konteks — 1M token keduanya; GPT-5.6 Sol membatasi output pada 128K

• Modalitas — MiMo-V2.6-Pro menerima teks, gambar, video, dan audio; permukaan masukan yang dipublikasikan GPT-5.6 Sol adalah teks dan gambar

• Harga daftar — MiMo-V2.6-Pro $0.43 / $0.87 per 1 juta; GPT-5.6 Sol $4.00 / $20.00, input yang di-cache $0.50

• Tarif campuran — MiMo-V2.6-Pro $0,18 per 1 juta; GPT-5.6 Sol $3,08

• Biaya terukur per tugas indeks — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $3.464,84 untuk indeks lengkap

• Kecepatan — MiMo-V2.6-Pro 134.3 token output/detik; GPT-5.6 Sol 77.3

• Waktu hingga token pertama — MiMo-V2.6-Pro 2,15 detik; GPT-5.6 Sol 127,21 detik

• Kontrol penalaran — GPT-5.6 Sol menyediakan none/low/medium/high/xhigh/max plus mode ultra multi-agen; MiMo-V2.6-Pro tidak mempublikasikan tingkatan yang setara

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol, subtitled One index point on the composite, twenty-two times the blended rate. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; list price $0.43 / $0.87 per 1M; blended rate per 1M $0.18; cost per index task $0.13; speed 134.3 tokens per second; time to first token 2.15 s. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; list price $4.00 / $20.00 per 1M; blended rate per 1M $3.08; cost to run the index $3,464.84; speed 77.3 tokens per second; time to first token 127.21 s. A footer notes both scores are Artificial Analysis Intelligence Index v4.3.2 read 22 September 2026. The OrcaRouter logo is composited in the bottom-right corner.

Di mana satu titik itu sebenarnya berada

Selisih satu poin pada komposit sepuluh evaluasi adalah kesalahan pembulatan di tingkat agregat dan jurang di tingkat komponen. Rangkaian ini mencakup AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, dan AA-LCR v1.1 — penalaran, pengetahuan, matematika, dan pemrograman — dan tidak ada vendor yang menerbitkan rincian per evaluasi untuk kedua model ini. Ketiadaan itu merupakan keterbatasan nyata di kedua sisi halaman ini dan layak dikatakan alih-alih ditutupi dengan komposit.

Apa yang tercatat bersifat menunjukkan arah, dan itu menunjuk pada pekerjaan agentik sebagai tempat kesenjangan terkonsentrasi. Materi peluncuran GPT-5.6 Sol melaporkan 53,6% pada Agents' Last Exam, evaluasi alur kerja profesional yang telah lama berjalan yang mencakup 55 bidang, yang oleh OpenAI disebut sebagai capaian tertinggi baru; 64,6% pada SWE-Bench Pro; 88,8% pada Terminal-Bench 2.1; dan 62,6% pada OSWorld 2.0 untuk penggunaan komputer. Skor BrowseComp-nya sebesar 90,4% naik menjadi 92,2% dalam mode ultra yang menjalankan empat sub-agen paralel dengan biaya token sekitar empat kali lipat. Itu adalah angka vendor pada harness vendor, dan peringatan yang biasa berlaku untuk semuanya — tetapi itu adalah kategori di mana kesenjangan komposit satu poin paling kecil kemungkinannya terdistribusi secara merata, dan Xiaomi tidak menerbitkan rincian kinerja agentik yang sebanding untuk MiMo-V2.6-Pro.

Penyeimbangnya adalah angka dari vendor MiMo-V2.6-Pro sendiri berada pada keluarga tugas yang sama sekali berbeda. Xiaomi melaporkan model tersebut bergerak dari 58,4 ke 72,57 pada DeepSWE v1.1 sepanjang proses reinforcement-learning-nya, dievaluasi dengan mini-swe-agent pada rata-rata-dari-tiga di penilai milik Xiaomi sendiri dan tidak pernah diajukan ke papan publik. Menempatkan 72,57 di samping angka Sol mana pun berarti menciptakan perbandingan yang tidak ada. Satu-satunya angka yang benar-benar diuji terhadap kedua model oleh evaluator yang sama adalah 46 dan 47.

Perbandingan biaya, dilakukan dengan benar

Perhitungan per token meremehkan kesenjangan, karena kedua model tidak menghabiskan jumlah token yang sama untuk menyelesaikan pekerjaan yang sama. Angka tunggal yang adil adalah angka yang diukur Artificial Analysis untuk menjalankan indeks lengkapnya pada masing-masing model: $206,66 untuk MiMo-V2.6-Pro dan $3.464,84 untuk GPT-5.6 Sol. Suite yang sama, harness yang sama, diukur dengan cara yang identik — perbedaan 16,8x pada kumpulan tugas terkendali, dan perbedaan itu sudah memperhitungkan fakta bahwa Sol adalah model penalaran yang mengeluarkan token untuk berpikir.

Sekarang sebuah loop produksi. Proses agen 30 langkah yang membaca 200.000 token konteks per langkah dan menulis 2.000 token per langkah berarti 6 juta token input dan 60.000 token output per proses. Pada GPT-5.6 Sol dengan harga daftar, itu $24,00 untuk input dan $1,20 untuk output — $25,20 per proses sebelum caching. Pada MiMo-V2.6-Pro, itu $2,58 dan $0,05 — $2,63. Caching mengubah keduanya: input Sol yang di-cache pada $0,50 versus diskon 99% MiMo-V2.6-Pro masih menempatkan model mahal itu satu orde besaran lebih tinggi pada loop yang berat konteks, yang justru merupakan loop yang dijalankan agen.

Separuh perbandingan yang membahas latensi lebih tajam daripada separuh harga dan mendapat lebih sedikit perhatian. GPT-5.6 Sol terukur 127,21 detik hingga token pertama. MiMo-V2.6-Pro terukur 2,15. Itu perbedaan lima puluh sembilan kali lipat, dan itulah angka yang menentukan apakah sebuah produk interaktif mungkin ada sama sekali. Sol pada upaya maksimum adalah model batch dalam praktiknya — Anda mengirim, Anda menunggu, Anda kembali. Jika aplikasi Anda terblokir pada token pertama, pilihan sudah dibuat untuk Anda, apa pun kata indeksnya.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 22 September 2026. The header reads 46 Artificial Analysis Intelligence Index, ranked first of 114 in its class; 134.3 output tokens per second, ranked eleventh of 114; $0.435 input and $0.87 output per 1M tokens with a 99% cache discount; $0.13 cost per Intelligence Index task, ranked twelfth of 114; and 140M output tokens from the Intelligence Index. Technical specifications list reasoning Yes, input modality text, image, speech and video, output modality text, a 1M-token context window, 1.0T total parameters, 42B active parameters, an MIT licence and Hugging Face model weights, under a breadcrumb reading Xiaomi, Open weights model, Released September 2026. A comparison summary notes it cost $206.66 to evaluate MiMo-V2.6-Pro on the Intelligence Index.

Satu tombol, kedua jalur

Kedua model dapat dijangkau melalui satu kunci OrcaRouter pada harga daftar penyedia dengan markup 0% — GPT-5.6 Sol sebagai openai/gpt-5.6-sol, yang merupakan jalur kami sendiri untuk mengaksesnya. Karena kami meneruskan harga daftar penyedia tanpa markup, perubahan harga di salah satu sisi langsung berlaku di sisi kami pada hari yang sama, bukan menunggu penawaran ulang.

DSL routing adalah tempat pasangan ini menjadi menarik, bukan sekadar nyaman. Dua model yang terpaut satu poin indeks, dengan satu model berbiaya enam belas kali lebih besar per tugas, bukanlah alternatif yang harus dipilih salah satu — keduanya adalah konfigurasi dua jalur. Kirim sebagian besar beban kerja ke jalur murah dan arahkan sisanya ke jalur mahal berdasarkan predikat yang Anda tentukan: permintaan yang gagal dalam pemeriksaan mandiri, permintaan yang cocok dengan aturan kompleksitas, permintaan yang biaya kegagalannya melebihi biaya token cukup jauh sehingga poin tersebut menjadi asuransi murah. Failover adalah separuh lainnya. Sol dilayani secara luas; MiMo-V2.6-Pro diluncurkan minggu ini dan hanya dicantumkan oleh satu penyedia API saat Artificial Analysis menangkapnya, yang merupakan rute tipis untuk model yang akan Anda tempatkan di jalur produksi. Router yang dapat melakukan fallback adalah yang membuat jalur murah aman untuk diadopsi, dan juga yang membuat jalur mahal menjadi opsional, bukan wajib.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol, captured 22 September 2026. The page lists the model id openai/gpt-5.6-sol, by OpenAI, dated 2026-07-09, marked FEATURED, with Vision, Tools, JSON and Reasoning badges, a 1M-token context window, a maximum output of 128K tokens, input of text, image and file with text output, $4.00 per 1M input tokens and $20.00 per 1M output tokens, 40.2M tokens of traffic over seven days, and a code sample calling the model through the OpenAI-compatible base URL api.orcarouter.ai/v1.

Mana yang harus dipilih

Pilih GPT-5.6 Sol ketika biaya kegagalan tugas jauh melebihi biaya token — pekerjaan agentik berhorizon panjang dengan efek samping nyata, otomatisasi penggunaan komputer, penggunaan alat yang panggilan salahnya lebih buruk daripada panggilan lambat, apa pun yang outputnya sudah Anda bayar manusia untuk memeriksa. Uji indeks senilai $3,464.84 bukan alasan untuk menghindarinya; itu adalah harga dari tier tersebut, dan tier itu ada karena suatu alasan.

Pilih MiMo-V2.6-Pro ketika volume menjadi kendala, ketika beban kerja padat konteks dan repetitif, ketika Anda membutuhkan latensi token pertama yang cukup rendah untuk ditunggu manusia, ketika Anda ingin bobotnya berada di infrastruktur Anda sendiri — MIT mengizinkan penerapan komersial, modifikasi, dan pelatihan lebih lanjut — atau ketika ekonomi per unit hanya masuk akal pada seperlima sen per seribu token. Kecepatannya 134,3 token per detik membuatnya dapat digunakan secara interaktif dengan cara yang tidak dimiliki sebagian besar model terbuka bertriliun parameter, dan itu adalah kemampuan, bukan diskon.

Pilih keduanya jika Anda memiliki router, karena jawaban jujur untuk "mana yang lebih baik" adalah bahwa selisih komposit satu poin bukanlah vonis — itu adalah pengukuran seberapa mirip keduanya secara rata-rata dan seberapa berbeda kemungkinan keduanya di ekor. Mode kegagalan yang harus dihindari adalah menstandarkan pada model murah karena rasionya 22x, menemukan di bulan ketiga bahwa suatu kelas permintaan membutuhkan model yang mahal, dan tidak memiliki jalur untuk merutekannya ke sana. Kegagalan sebaliknya adalah membayar tarif Sol untuk pekerjaan peringkasan yang diselesaikan secara identik oleh model 46-index. Keduanya bukan masalah model. Keduanya adalah konfigurasi, dan konfigurasi adalah bagian yang dapat Anda ubah pada Selasa sore.

OrcaRouter menempatkan 200+ model di balik satu endpoint yang kompatibel dengan OpenAI pada harga daftar penyedia dengan markup 0%, sehingga perubahan harga vendor langsung berlaku pada hari yang sama.