Kartu hero yang dihasilkan berjudul 'Dua jalur cepat, terpaut enam belas hari' dengan subjudul 'GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed', panel kiri bertuliskan '6x standar', 'API Tertutup' dan 'Kelipatan kecepatan dipinjam dari GPT-6 Astra', serta panel kanan bertuliskan 'Sekitar 10x standar', 'Bobot MIT' dan 'Total 1,02T / 42B aktif', di atas footer bertuliskan 'Angka vendor dan katalog, September-Oktober 2026; tidak ada pengukuran independen untuk kedua tingkat.'
Engineering & Research

GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Dua Jalur Cepat, Satu Mengungkap Berapa Biayanya

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua cara tercepat untuk membeli model frontier mulai dijual dengan selisih enam belas hari, dan hanya satu di antaranya memberi tahu Anda bagaimana kecepatan itu dihasilkan. GPT-6.1 Ultrafast — tier penyajian di atas GPT-6.1 Sol, yang dirilis OpenAI pada 29 September 2026 dan yang mendapatkan tier ini pada 8 Oktober 2026 — adalah flagship tertutup yang Anda akses melalui API, dengan harga enam kali Standard tanpa penjelasan yang dipublikasikan tentang apa yang terjadi antara bobot dan permintaan Anda. Xiaomi MiMo v2.6 Pro Ultraspeed, yang dirilis pada 22 September 2026, adalah tier kecepatan di atas MiMo-V2.6-Pro, sebuah checkpoint berlisensi MIT yang lingkungan pembelajaran penguatannya juga diterbitkan Xiaomi. Keduanya menjual latensi dengan kelipatan. Hanya kelipatan Xiaomi yang berada di atas sesuatu yang dapat diperiksa pelanggan, dan perbedaan itu lebih bernilai bagi keputusan daripada klaim kecepatan mana pun.

Harga kedua jalur adalah bagian yang mudah dan sudah dibahas di bawah. Bagian yang sulit adalah bahwa tingkat kecepatan merupakan janji tentang layanan, dan kedua vendor membuat janji itu pada tingkat pengungkapan yang sangat berbeda — yang satu meminjam angka utamanya dari model saudaranya, yang satunya lagi merilis resep pelatihan bersama daftar harga. Jika Anda akan menempatkan beban kerja produksi di jalur cepat, kesenjangan pengungkapan itulah risiko yang sebenarnya Anda tanggung.

Harga, dengan kedua sisi pada baris yang sama

Kedua tier dijual sebagai kelipatan dari jalur standar, dan kelipatannya cukup berdekatan sehingga harga bukan yang membedakan keduanya.

Jalur Standar - GPT-6.1 Sol dengan $2,00 input / $10,00 output per juta token, dibandingkan dengan MiMo-V2.6-Pro pada $0,44 / $10,00 output per juta token.

• Jalur cepat — GPT-6.1 Ultrafast dengan harga $12.00 / $60.00, dibandingkan dengan MiMo-V2.6-Pro-UltraSpeed dengan harga $4.35 / $8.70.

• Kelipatannya — tepat 6x pada setiap baris untuk tier O​penAI, kira-kira 9,9x pada input dan tepat 10x pada output untuk X​iaomi.

• Input cache — GPT-6.1 Sol tercatat $0,10 per juta pada Standard dan $0,60 pada Ultrafast; kartu tarif MiMo yang dapat kami baca tidak mencantumkan baris input cache terpisah untuk kedua jalur tersebut.

• Konteks panjang — GPT-6.1 Sol menetapkan ulang harga seluruh permintaan pada 2x tarif input dan cache serta 1,5x output di atas 272.000 token input, menempatkan Ultrafast pada $24,00 / $1,20 / $30,00 / $90,00. MiMo-V2.6-Pro memiliki jendela konteks 1 juta token tanpa ambang batas harga setara yang dipublikasikan.

• Selisih absolut — dua jalur cepat terpaut 2,8x pada input dan 6,9x pada output, yang merupakan selisih antara model tertutup terdepan dan model berbobot terbuka yang muncul di dalam tier kecepatan, bukan pada tarif standar.

Ringkasan satu baris blok itu: Xiaomi mengenakan kelipatan yang lebih besar pada model yang jauh lebih murah, dan OpenAI mengenakan kelipatan yang lebih kecil pada model yang jauh lebih mahal. Untuk token keluaran, Anda membayar $60,00 per juta untuk jalur OpenAI dan $8,70 untuk jalur Xiaomi. Tidak ada vendor yang menawarkan diskon untuk kecepatan; keduanya menetapkan harganya sebagai produk terpisah, yang merupakan tanda pertama bahwa dalam kedua kasus, jalur standar masih menjadi default dan jalur cepat adalah pengecualian yang Anda justifikasi per beban kerja.

Apa yang akan diberitahukan setiap vendor kepada Anda tentang kecepatan

Di sinilah kedua rollout itu tidak lagi simetris, dan inilah hal yang paling berguna di halaman ini.

Angka yang diterbitkan O​penAI untuk Ultrafast adalah bahwa GPT-6 Astra Ultrafast menghasilkan token hingga 8x lebih cepat daripada GPT-6 Astra dalam mode Standard di Codex. Itu adalah pengukuran model yang berbeda, di klien yang berbeda, yang dinyatakan sebagai batas atas. Dokumentasi yang mencakup Ultrafast untuk GPT-6.1 Sol menyatakan bahwa tier tersebut mengurangi waktu antara token keluaran yang dihasilkan dan mengarah ke rate card; dokumentasi itu sama sekali tidak mencantumkan angka untuk tier Sol. Jadi angka utama yang dilekatkan pada peluncuran ini dipinjam dari model saudaranya yang telah memakai Ultrafast sejak 29 September, dan tidak ada pihak independen yang menerbitkan pengukuran token per detik untuk keduanya. Bisa jadi angka itu tetap berlaku — tumpukan penyajian yang sama, mekanisme yang sama — tetapi itu adalah batas atas dari vendor yang O​penAI sendiri tidak mengukurnya untuk model ini.

Pengungkapan Xiaomi berbeda jenisnya, dan perbedaannya bukan bahwa pengungkapan itu lebih presisi. Materi Xiaomi sendiri mengklaim UltraSpeed mencapai hingga 20 kali kecepatan output layanan Pro standar pada kualitas yang sama. Daftar katalog pihak ketiga yang mendeskripsikan model yang sama pada hari yang sama menyebut sekitar 10 kali. Kedua angka itu beredar, keduanya bukan angka yang sama, dan belum ada yang menerbitkan pengukuran yang merekonsiliasi keduanya. Membacanya secara jujur: "hingga 20x" adalah batas atas dari vendor dalam kondisi yang tidak ditentukan Xiaomi, "sekitar 10x" adalah angka yang bersedia dinyatakan sebuah katalog sebagai tipikal, dan pengganda sebenarnya berada di suatu tempat dalam rentang yang lebar sampai seseorang menerbitkan distribusi latensi per permintaan pada tingkat konkurensi yang dinyatakan.

Jadi Xiaomi memberi Anda dua angka yang tidak selaras, dan OpenAI memberi Anda satu angka yang berasal dari model yang berbeda. Tidak ada satu pun yang merupakan fakta yang bisa Anda jadikan dasar penganggaran, dan konsekuensi praktisnya sama untuk keduanya: ukur tier itu pada prompt Anda sendiri sebelum Anda menetapkan jalur produksi untuknya.

Asimetri yang benar-benar penting: apa yang diperoleh dari digit tambahan

Terlepas dari klaim kecepatannya, kedua jalur ini terhubung ke jenis produk yang sangat berbeda, dan di sinilah pilihan tersebut tidak lagi hanya soal perbandingan harga.

MiMo-V2.6-Pro adalah desain sparse mixture-of-experts yang telah dijelaskan Xiaomi secara publik: 1,02 triliun parameter total dengan 42 miliar yang diaktifkan per token, jendela konteks 1M-token, multimodality native di seluruh teks, gambar, video dan audio, dan tag lisensi MIT pada checkpoint yang dirilis. Bundel rilis mencakup laporan teknis dan catatan deployment, dan Xiaomi mengatakan bahwa mereka open-sourcing lingkungan pelatihan reinforcement-learning dan kodenya sehingga pelatihan pasca-pelatihan dapat diperiksa dan direproduksi. Proses RL juga didokumentasikan — 30 langkah dan sekitar 750.000 trajectory per model, di bawah enam hari, dengan total pengeluaran yang dipublikasikan sekitar $3.474.715 di seluruh proses Pro dan Flash. Pada DeepSWE v1.1, harness milik Xiaomi sendiri dengan mini-swe-agent pada avg@3, perusahaan melaporkan MiMo-V2.6-Flash bergerak dari 48,8 menjadi 65,68 dan MiMo-V2.6-Pro dari 58,4 menjadi 72,57 di seluruh proses tersebut. Itu dilaporkan oleh vendor dan tidak direproduksi; perbedaan antara "harness Xiaomi mengatakan 72,57" dan "72,57 adalah skornya" adalah perbedaan antara klaim dan fakta.

GPT-6.1 Sol tidak mempublikasikan semua itu. Tidak ada jumlah parameter, tidak ada catatan arsitektur, tidak ada angka belanja pelatihan, tidak ada checkpoint, dan tidak ada lisensi untuk dibaca — yang ada adalah kartu model, jendela konteks, batas pengetahuan 30 April 2026, dan sebuah API. Itulah pengaturan normal bagi lab terdepan dan ini bukanlah kritik. Namun hal itu punya konsekuensi bagi keputusan pembelian yang cenderung dilewatkan oleh liputan peluncuran: dengan jalur bobot terbuka, tier cepat yang mengecewakan masih bisa dipulihkan. Jika UltraSpeed ternyata tidak sepadan dengan 10x trafik Anda, checkpoint yang sama dapat diunduh dan Anda bisa menyajikannya sendiri atau melalui penyedia lain, yang membatasi kerugian maksimal Anda dengan biaya migrasi. Dengan jalur tertutup, tier cepat yang mengecewakan hanyalah tagihan dan anggaran batas laju yang Anda sesuaikan kembali ke bawah; Anda tidak dapat mengakalinya dengan menjalankan bobotnya, karena tidak ada bobot untuk dijalankan.

Satu peringatan tentang tag MIT itu, karena hal itu disederhanakan dalam liputan peluncuran. Lisensi tersebut berlaku untuk checkpoint yang dipublikasikan Xiaomi. UltraSpeed adalah layanan hosted, dan layanan hosted diatur oleh ketentuan layanan, bukan oleh lisensi bobot. Memiliki hak untuk menjalankan checkpoint di perangkat keras Anda sendiri dan memiliki hak untuk menjual kembali penyajian terakselerasi milik orang lain atas checkpoint tersebut adalah dua hak yang berbeda, dan hanya yang pertama yang berasal dari berkas lisensi.

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

Dua jebakan penamaan sebelum Anda menyalin salah satu pengenal

Tidak ada satu pun nama dalam judul halaman ini yang merupakan checkpoint, dan dokumentasi kedua vendor membuat kesalahan tersebut mudah terulang.

• GPT-6.1 Ultrafast — bukan sebuah model. Pengenal dalam permintaan tetap sama dengan model standar; tier diatur oleh field permintaan, dan hasilnya adalah checkpoint yang sama yang dijadwalkan secara berbeda.

• MiMo v2.6 Pro Ultraspeed — juga bukan kumpulan bobot yang tersendiri. Ini adalah checkpoint MiMo-V2.6-Pro yang disajikan pada jalur yang lebih cepat dan dihargai sebagai item tersendiri.

• Apa artinya untuk benchmarking — jika Anda membandingkan dua jalur pada model mana pun dengan prompt yang identik, hasil yang diharapkan adalah jawaban yang sama pada laju yang berbeda. Konten yang berbeda pada masukan yang sama adalah cacat yang harus dilaporkan, bukan kemampuan yang Anda beli.

• Apa artinya itu untuk pemeriksaan lisensi — untuk Xiaomi, baca kartu model. Untuk OpenAI, tidak ada yang perlu dibaca, karena bobotnya tidak didistribusikan.

Ada juga asimetri yang lebih halus yang muncul dalam cara setiap tier dijual. GPT-6.1 Sol mendukung residensi data AS dan UE serta pemrosesan global, termasuk dalam Ultrafast, sehingga beban kerja yang dipatok ke pemrosesan Eropa memiliki jawaban yang terdokumentasi. Daftar tarif MiMo yang dapat kami baca sama sekali tidak mencantumkan residensi — Xiaomi menjual model dan jalur penyajian, bukan postur kepatuhan. Bagi pembeli di sektor teregulasi, satu baris itu dapat menentukan perbandingan sebelum harga dipertimbangkan.

Di mana setiap jalur sebenarnya dapat dipanggil

Kedua jalur cepat dapat diakses melalui API vendor masing-masing, dan keduanya muncul di platform pihak ketiga. Keduanya tidak ada di OrcaRouter, dan patut dikatakan secara gamblang daripada membiarkan sebuah perbandingan menyiratkan sebaliknya.

Yang ada di OrcaRouter adalah jalur standar model O​penAI: openai/gpt-6.1-sol dengan tarif daftar O​penAI sendiri sebesar $2.00 per juta token input dan $10.00 per juta token output, dengan markup 0% dan harga penyedia diteruskan langsung, sehingga penetapan harga ulang vendor sampai ke sisi kami pada hari yang sama. Ultrafast adalah flag tingkat layanan yang ditagih ke akun O​penAI Anda sendiri, dan tidak ada model X​iaomi yang dihosting di sini sama sekali. Yang didapat dengan satu kunci adalah jalur standar bersama lebih dari 200 model lain di balik satu endpoint yang kompatibel dengan O​penAI, dengan failover otomatis antarpenyedia — yang merupakan posisi berguna ketika beban kerja yang Anda lindungi adalah beban yang akan menyadari batas rate-limit pada pukul tiga pagi.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

Jalur mana yang harus diuji, secara berurutan

Jika beban kerja Anda interaktif dan waktu generasinya diukur oleh jam manusia, kedua tier layak dicoba dan faktor penentunya bukan harga — melainkan tanggal kedaluwarsa kepercayaan Anda. Jalur open-weight memungkinkan Anda memverifikasi lalu keluar; jalur tertutup meminta Anda memverifikasi dengan satu-satunya vendor yang dapat melayaninya dan tetap tinggal. Asimetri itu nyata, tetapi juga tidak bebas biaya: MiMo-V2.6-Pro-UltraSpeed adalah layanan yang dihosting, jadi keluarnya adalah migrasi, bukan sekadar konfigurasi, dan checkpoint tujuan migrasi Anda mungkin tidak cocok dengan optimisasi serving tier tersebut.

Jika beban kerja Anda bersifat batch atau terjadwal, keduanya adalah pembelian yang salah, pada 6x dan 10x, dan langkah jujurnya adalah menjalankannya di jalur standar dan menggunakan selisihnya untuk evaluasi sebagai gantinya.

Apa yang akan mengubah halaman ini: pengukuran independen atas kecepatan keluaran salah satu tier pada tingkat konkurensi yang dinyatakan, pernyataan residensi yang diterbitkan oleh Xiaomi, atau angka batas laju dari OpenAI untuk tier Sol yang dapat dijadikan acuan perencanaan oleh pembeli alih-alih harus memintanya. Sampai hal-hal itu ada, perbandingan ini hanyalah daftar harga melawan daftar harga, sementara salah satu dari dua vendor telah mempublikasikan jauh lebih banyak tentang objek yang diberi harga.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari