Kartu judul hero yang dihasilkan untuk 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed' dengan overline 'Dua tingkat kecepatan. Satu harga yang hilang.' dan dua kartu: kiri 'GPT-5.6 Sol Ultrafast' mencantumkan Bobot: sama dengan Sol, Klaim kecepatan: hingga 14x, Harga: belum dipublikasikan; kanan 'MiMo v2.6 Pro Ultraspeed' mencantumkan Bobot: sama dengan Pro, Klaim kecepatan: 10x hingga 20x, Harga: $4.35 / $8.70; footer 'Keduanya belum diukur secara independen.' Logo OrcaRouter di kanan bawah.
Guides & Insights

GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Dua Tingkat Kecepatan, Satu Harga yang Hilang

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua vendor merilis ide produk yang sama dengan selisih tiga minggu, dan perbedaan di antara keduanya adalah cara terbaik untuk melihat apa yang sebenarnya dijual oleh masing-masing. Kubu Xiaomi hadir pada 22 September 2026: Xiaomi MiMo v2.6 Pro Ultraspeed adalah checkpoint 1,02 triliun parameter yang sama dengan MiMo-V2.6-Pro, dilayani lebih cepat, dengan harga $4,35 per juta token input dan $8,70 per juta output dibandingkan jalur Pro standar sebesar $0,44 dan $0,87. GPT-5.6 Sol Ultrafast milik vendor tersebut adalah manuver yang sama yang diterapkan pada GPT-5.6 Sol: bobot yang identik, hingga 750 token output per detik, hingga 14× tier standar, berjalan di perangkat keras wafer-scale Cerebras — dan sama sekali tidak ada harga yang dipublikasikan, enam minggu setelah mode tersebut diumumkan pada 13 Agustus.

Tempatkan keduanya berdampingan dan anomalinya langsung terlihat. Xiaomi menerbitkan daftar harga sebelum menerbitkan sebagian besar benchmark-nya. OpenAI menerbitkan benchmark, mitra perangkat keras, dan nama pelanggan — namun masih belum menerbitkan angka yang bisa Anda jadikan dasar anggaran. Salah satu tier ini dapat dibeli hari ini. Yang lain hanyalah sebuah nilai dalam skema API. Karena itu, membandingkan keduanya bukan terutama soal mana yang lebih cepat, melainkan soal berapa nilai sebuah tier kecepatan ketika satu vendor telah memberi tahu Anda harganya dan yang lain belum.

Apa sebenarnya masing-masing itu

Keduanya bukan model baru. Itu adalah premis bersama dan layak dinyatakan secara terus terang, karena kedua peluncuran tersebut menarik liputan yang memperlakukan perubahan serving sebagai rilis kemampuan.

MiMo v2.6 Pro Ultraspeed adalah konfigurasi penyajian dari produk andalan Xiaomi: checkpoint sparse mixture-of-experts dengan 1,02T parameter yang sama dengan 42B yang diaktifkan per token, konteks 1M token yang sama, multimodalitas native yang sama di seluruh teks, gambar, video, dan audio, serta bobot berlisensi MIT yang sama di repositori publik. Materi Xiaomi sendiri mengklaim hingga 20 kali kecepatan keluaran layanan Pro standar pada kualitas yang sama; daftar katalog pihak ketiga yang mendeskripsikan model yang sama pada hari yang sama menyebutkan sekitar 10 kali. Tidak ada yang telah menerbitkan pengukuran yang merekonsiliasi keduanya.

GPT-5.6 Sol Ultrafast adalah konfigurasi penyajian dari produk unggulan OpenAI: checkpoint yang sama, perilaku penalaran yang sama, jendela konteks 1.050.000 token yang sama, keluaran maksimum 128K yang sama, jawaban yang sama. Akselerasinya adalah perangkat keras, bukan penjadwalan — bobot model berada di SRAM on-chip pada silikon skala wafer Cerebras, bukan dipindahkan antara memori GPU dan komputasi — dan ini adalah produk pertama dari kemitraan komputasi OpenAI–Cerebras Januari 2026, dilaporkan sekitar $10 miliar selama tiga tahun.

Jadi sumbu perbandingan yang jujur bukanlah kecerdasan. Melainkan apa yang dipilih vendor untuk diubah, berapa yang ditagihnya untuk perubahan itu, dan seberapa besar dari perubahan itu yang dibiarkannya Anda verifikasi.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

Kartu tarif, termasuk yang kosong

• MiMo v2.6 Pro Ultraspeed — $4,35 input / $8,70 output per juta token, diterbitkan oleh Xiaomi.

• MiMo-V2.6-Pro standard — $0.44 / $0.87, diterbitkan oleh katalog komersial Xiaomi. Sekitar 9,9× pada input dan tepat 10× pada output.

• GPT-5.6 Sol Ultrafast — tidak ada daftar tarif yang dipublikasikan per 27 September 2026. Halaman harga OpenAI masih memuat empat tab — Standard, Batch, Flex, Fast — dan tier tersebut tidak termasuk di dalamnya.

• GPT-5.6 Sol standar — $4.00 / $20.00 per juta, tarif promosi OpenAI saat ini, dengan input cache sebesar $0.40 dan lonjakan tarif konteks panjang menjadi $8.00 / $30.00 setelah sekitar 272K token input.

• Satu-satunya opsi premium sebanding yang pernah diberi harga oleh OpenAI — Mode Cepat, pada $8.00 / $40.00, tepat dua kali tarif standar untuk kecepatan output hingga sekitar 2,5×.

Baris terakhir itulah keseluruhan alasan mengapa bagian kosong itu penting. Tier kecepatan Xiaomi berbiaya sepuluh kali lipat dari jalur standar dan mengklaim kecepatan sepuluh hingga dua puluh kali lipat, yang setidaknya koheren secara internal sebagai sebuah pertukaran: Anda membayar lebih secara proporsional untuk waktu tunggu yang lebih sedikit secara proporsional, dan taruhannya adalah waktu aktual itulah produknya. Tier kecepatan OpenAI adalah klaim yang lebih besar atas silikon yang lebih langka daripada Fast mode, jadi berapa pun biayanya nanti, presedennya mengatakan premi, bukan diskon. Tetapi "presedennya mengatakan premi" bukanlah angka, dan sampai angka itu ada, tier tersebut sama sekali tidak dapat dibandingkan dengan UltraSpeed soal harga — hanya berdasarkan fakta bahwa Xiaomi bersedia menyebut angkanya dan OpenAI tidak.

Dari mana angka-angka itu berasal

Kedua tingkatan itu memiliki masalah pembuktian yang berlawanan, dan ada baiknya menyebut keduanya daripada mencari jalan tengah.

Klaim kecepatan Xiaomi tidak jelas besarnya tetapi berpijak pada harga yang dipublikasikan. Angka 20× adalah batas atas dari vendor dalam kondisi yang tidak dirinci Xiaomi, angka 10× adalah apa yang bersedia dinyatakan oleh sebuah daftar katalog sebagai tipikal, dan pengali sebenarnya berada di suatu tempat dalam rentang lebar yang belum diukur secara publik pada tingkat konkurensi yang dinyatakan. Sebaliknya, harganya tepat, bobotnya dapat diunduh di bawah lisensi MIT, dan laporan teknis serta lingkungan pelatihan pembelajaran penguatan bersifat publik — Anda dapat memeriksa apa yang dilakukan Xiaomi, Anda hanya belum dapat memverifikasi seberapa cepat ia berjalan.

Klaim kecepatan OpenAI spesifik dalam besaran tetapi tidak berpijak pada apa pun yang dapat dibeli. Hingga 750 token keluaran per detik, hingga 14× standar, dinyatakan secara lugas. Ini juga angka throughput untuk token keluaran, bukan pengali ujung ke ujung yang seragam: pemrosesan input dan penalaran model itu sendiri tidak terkompresi pada rasio tersebut, itulah sebabnya perusahaan menyebutnya sebagai maksimum. Tolok ukur pendukungnya dilaporkan oleh vendor dan dalam satu kasus lintas vendor — uji Humanity's Last Exam dengan 2.500 pertanyaan dilaporkan selesai dalam 11 jam 11 menit dibandingkan 78 jam 27 menit untuk Claude Fable 5, dengan akurasi yang sebanding. Liputan independen atas peluncuran tersebut mengutip perbandingan kecepatan generasi yang lebih sempit, sekitar 11×, pada uji yang sama, sementara angka Cerebras sendiri menyiratkan sekitar 7× untuk total waktu pengujian. Tiga pihak, tiga pecahan dari satu beban kerja, tanpa reproduksi pihak ketiga atas salah satu pun dari angka-angka itu. Cerebras secara terpisah melaporkan 5,6× ujung ke ujung pada GDP-Val tanpa penurunan kualitas yang terukur, juga belum direproduksi.

Kedua kumpulan angka tersebut berasal dari pernyataan vendor. Perbedaannya adalah ketidakjelasan Xiaomi menyangkut kecepatan dan ketidakjelasan OpenAI menyangkut biaya, dan bagi siapa pun yang menyusun anggaran, biaya adalah hal yang lebih sulit ditebak.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Apa yang terjadi minggu ini, dan mengapa hal itu tidak menutup kesenjangan

Alasan perbandingan ini sama sekali punya kaitan berita adalah sebuah commit, bukan sebuah pengumuman. Nilai ultrafast sudah ada di skema openai-openapi publik OpenAI sejak 13 Agustus 2026 — hari yang sama ketika mode tersebut diumumkan — dengan deskripsi yang membatasinya pada gpt-5.6-sol dan menyebutnya dikendalikan akses. Commit yang muncul minggu ini lebih belakangan dan lebih kecil: pada 25 September 2026, fe4f7a1 menambahkan ultrafast ke dua enumerasi lain, yakni parameter service-tier di tingkat permintaan dan bidang kebijakan service-tier agen. Sebelum commit itu, kedua daftar tersebut berbunyi auto, default, flex, priority, fast. Setelahnya, ada entri yang dideskripsikan sebagai "Menggunakan tier layanan ultrafast."ultrafast ke service_tier enumerasi dalam openai-openapi spesifikasi publiknya — bidang yang oleh skema dideskripsikan sebagai "tier layanan yang digunakan untuk permintaan model," dan bidang kebijakan yang dilekatkan pada agen. Sebelum perubahan, daftar tersebut berbunyi default, flex, priority, fast. Setelahnya, ada entri yang dideskripsikan sebagai "Menggunakan tier layanan ultrafast."

Perbedaan itu penting bagi siapa pun yang membaca liputan ini. Ini bukan tier yang sedang dibuat; ini adalah tier yang sedang dihubungkan ke field yang digunakan untuk mengonfigurasi agen, yang berarti klien pada akhirnya dapat ditulis terhadapnya tanpa endpoint baru. Laporan hari berikutnya menjelaskan pemilih Fast / Standard / Ultrafast yang akan hadir di Responses API Playground, dengan akses yang lebih luas diperkirakan setelah konferensi DevDay OpenAI. Kami belum melihat pemilih tersebut dan OpenAI belum menerbitkan catatan peluncuran, jadi bagian itu bersumber tunggal. Yang dapat diperiksa adalah entri skema yang ditambahkan dan tetap tidak adanya kartu tarif enam minggu setelah pengumuman.

Sementara itu, tier Xiaomi sudah dapat dibeli selama lima hari dan masih menjadi satu-satunya dari keduanya yang bisa dimasukkan ke invoice. Pertanyaan terbukanya sendiri berbeda: apakah premi 10× bertahan, atau apakah ia berperilaku seperti kebanyakan harga peluncuran pada tier premium baru dan bergerak menuju jalur standar setelah liputan peluncuran berhenti. Standard Pro pada $0.44 / $0.87 adalah patokannya, dan tier yang dibuka pada sepuluh kali patokannya jarang berakhir di sana.

Memilih di antara keduanya, mengingat Anda mungkin tidak bisa

Fakta praktis yang tidak nyaman adalah bahwa bagi sebagian besar pembaca, ini adalah perbandingan antara satu tier yang tidak dapat Anda beli dan satu tier yang mungkin sebaiknya tidak Anda beli pada harga daftar. GPT-5.6 Sol Ultrafast adalah pratinjau dengan daftar tunggu untuk pelanggan terpilih, yang diperluas seiring bertambahnya kapasitas, tanpa tanggal ketersediaan umum dan tanpa harga; MiMo v2.6 Pro Ultraspeed tersedia, mahal, dan dirancang untuk jenis pembeli tertentu.

Uji beban kerjanya sama untuk keduanya, dan ini tentang bentuk grafik permintaan Anda, bukan ukuran prompt Anda. Satu generasi panjang tunggal mendapat jauh lebih sedikit daripada pengganda utama, karena pemrosesan input dan penalaran tidak dipercepat pada rasio yang sama. Loop agen empat puluh langkah di balik satu tindakan yang terlihat oleh pengguna mendapat sesuatu yang jauh lebih mendekati angka penuh, karena setiap perjalanan bolak-balik adalah latensi yang harus ditunggu seseorang. Jika lalu lintas Anda terlihat seperti bentuk kedua, kedua tier ditujukan untuk Anda; jika terlihat seperti yang pertama, jalur standar pada model mana pun selalu merupakan pilihan yang tepat dan jalur standar MiMo-V2.6-Pro dengan $0.44 / $0.87 adalah salah satu cara termurah untuk memanggil model kelas triliun parameter di mana pun.

Apa yang tidak diubah oleh kedua tier adalah bahwa Anda membeli latensi, bukan kualitas. Jika Anda membandingkan UltraSpeed atau Ultrafast dengan jalur standarnya sendiri pada prompt yang identik dan mendapatkan jawaban yang berbeda, itu adalah temuan yang layak dilaporkan, bukan fitur — tidak ada dalam deskripsi kedua vendor yang mengklaim bahwa bobotnya berubah.

Ini juga kasus di mana sebuah router membuktikan kegunaannya, dan khususnya untuk tier yang tidak bisa Anda dapatkan. GPT-5.6 Sol sudah live di OrcaRouter sebagai openai/gpt-5.6-sol dengan tarif milik penyedia itu sendiri, dengan tanpa markup pada token melalui endpoint yang kompatibel dengan OpenAI di api.orcarouter.ai/v1, jadi jalur standar yang akan Anda pakai sebagai cadangan hanya berjarak satu perubahan base-URL, dan kunci yang sama membawa 200+ model. Itu penting karena jawaban jujur untuk “haruskah saya memakai Ultrafast” hari ini adalah “Anda tidak bisa, jadi putuskan apa yang menangani trafik interaktif untuk sementara ini” — dan cara membeli latensi tanpa daftar tunggu adalah mengarahkan panggilan interaktif ke model mana pun di katalog yang melewati standar kualitas Anda dengan waktu wall-clock paling rendah, dan membiarkan pekerjaan sepanjang malam di jalur termurah yang lolos. Saat tier itu dibuka, itulah sakelar yang Anda nyalakan. Catat dengan jelas apa yang tidak kami hosting: tidak ada model Xiaomi di OrcaRouter, jadi MiMo v2.6 Pro Ultraspeed berasal dari API Xiaomi sendiri dan beberapa platform pihak ketiga, dan halaman ini bukan rute menuju ke sana.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Apa yang bisa menyelesaikannya

Tiga pengukuran, yang belum satu pun ada. Kartu tarif Ultrafast yang dipublikasikan akan menjadikan ini perbandingan yang pantas diwujudkan, bukan perbandingan yang berlubang. Distribusi latensi independen pada tingkat konkurensi yang dinyatakan akan memberi tahu Anda apakah pengganda nyata Xiaomi lebih dekat ke 10× atau 20×, dan apakah ia bertahan di bawah beban alih-alih dalam demonstrasi aliran tunggal. Dan reproduksi independen dari rangkaian benchmark salah satu vendor akan memindahkan kedua kumpulan angka tersebut keluar dari kolom klaim.

Sampai saat itu, tafsir yang bisa dipertahankan masih sempit. Xiaomi merilis tier kecepatan dengan harga dan kecepatan yang tidak jelas; OpenAI merilis tier kecepatan dengan kecepatan spesifik dan tanpa harga; keduanya adalah model yang sama dengan yang menjadi acuan harganya, dan tidak ada satu pun yang telah diukur secara independen. Jika Anda membutuhkan latensi sekarang dan beban kerjanya interaktif, UltraSpeed itu nyata, dapat dibeli, dan harganya dipatok tepat untuk pembeli yang diinginkannya. Jika Anda membutuhkannya sekarang sedangkan beban kerjanya tidak interaktif, jalur standar pada kedua model lebih murah, terbukti, dan tersedia hari ini — dan tier yang diperdebatkan semua orang akan tetap ada saat seseorang mempublikasikan sebuah angka.