
GPT-6.1 Sol Ultrafast Diluncurkan ke API, Codex dan ChatGPT Berfungsi
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
OpenAI sedang meluncurkan mode Ultrafast untuk GPT-6.1 Sol — tingkat layanan tercepat yang dijualnya, dan pertama kalinya tier Sol yang hampir setara Astra memilikinya. Langkah ini menempatkan GPT-6.1 Sol dalam kelas yang sama dengan GPT-6 Astra Ultrafast di API, di Codex, dan di ChatGPT Work, dan hadir dengan daftar tarif yang dipublikasikan alih-alih daftar tunggu: $12.00 per juta token input dan $60.00 per juta token output, tepat enam kali lipat biaya standar GPT-6.1 Sol. Klaim kecepatan yang tertera adalah "hingga 8x". Bagian yang menarik adalah apa yang diukur oleh frasa itu, dan jawabannya bukan model yang akan Anda bayar.
Catatan perubahan pengembang memuat entri tertanggal 8 Oktober: "Menambahkan Ultrafast untuk GPT-6.1 di Responses API. Gunakan gpt-6.1-sol dengan service_tier: "ultrafast" untuk mengurangi waktu antar token output yang dihasilkan. Fitur ini tersedia untuk semua pengguna API, dengan batas laju yang berlaku, pemrosesan global, serta residensi data AS dan UE." Halaman dokumentasi Ultrafast kini berbunyi "tersedia secara luas untuk GPT-6 Astra dan GPT-6.1 Sol, dengan akses pratinjau untuk GPT-5.6 Sol", dan halaman kecepatan di sisi ChatGPT mengonfirmasi bagian langganannya: Ultrafast tersedia di Codex dan ChatGPT Work pada Pro $500 dan pada paket Enterprise serta Edu yang memenuhi syarat.
Ultrafast adalah tingkatan layanan, bukan model kedua
Tidak ada yang berubah pada bobotnya. Checkpoint sama, jendela konteks 1.050.000 token sama, input maksimum 922.000 token sama, batas keluaran 128.000 token sama, batas pengetahuan 30 April 2026 sama, jawaban sama. Yang Anda beli adalah prioritas penjadwalan: model menghasilkan token lebih cepat, dan pembingkaian OpenAI sendiri sengaja dibuat sempit — tingkat ini "mengurangi waktu antara token keluaran yang dihasilkan". Ini tidak membuat model lebih pintar, dan tidak membuat fase berpikirnya lebih singkat.
Perbedaan itulah inti seluruh keputusannya. Untuk loop agen yang melakukan empat puluh panggilan alat berturut-turut, keuntungannya berlipat karena output setiap giliran tiba lebih cepat. Untuk satu permintaan penalaran berat yang menghabiskan sebagian besar waktu aktualnya untuk berdeliberasi, Anda bisa membayar enam kali lebih banyak dan tetap menatap spinner yang sama.
Tangga tingkat, sekali, dalam istilah sederhana:
• Batch and Flex — setengah dari Standard, jalur murah untuk pekerjaan yang tidak ditunggu siapa pun
• Standar — $2.00 input / $0.10 di-cache / $2.50 penulisan cache / $10.00 output per juta token
• Cepat — dua kali lipat Standard, atau $4.00 / $0.20 / $5.00 / $20.00; OpenAI mengganti nama Priority processing menjadi mode Cepat pada 30 Juli 2026
• Ultracepat — enam kali Standard, atau $12.00 / $0.60 / $15.00 / $60.00
• Di atas 272K token masukan — seluruh permintaan dikenai harga ulang pada 2x tarif masukan dan cache serta 1,5x keluaran; Ultrafast long-context adalah $24.00 / $1.20 / $30.00 / $90.00
Hitungan yang tak seorang pun cantumkan di halaman pemasaran.
Harga enam kali lipat untuk kecepatan delapan kali lipat bukanlah transaksi yang merugi, dan juga bukan makan siang gratis. Ultrafast ditagih per token, jadi pekerjaan yang biayanya $1.00 di Standard akan menjadi $6.00 di Ultrafast — dan selesai dalam sekitar seperdelapan waktu. Penghematannya bukan pada tagihan, melainkan pada waktu nyata. Anda membayar lima dolar ekstra untuk menghilangkan tujuh per delapan waktu antrean pada pekerjaan itu, dan apakah itu murah atau absurd sepenuhnya bergantung pada berapa nilai orang atau pipeline yang menunggu di ujung lain per menit.
Ada dua implikasi yang menyusul, dan itulah yang sering terlewat:
• Pekerjaan interaktif adalah "ya" yang mudah. Seorang developer yang menyaksikan sebuah diff mendarat, sebuah agen yang tidak bisa melanjutkan sebelum membaca hasilnya — itulah kasus-kasus di mana latensi adalah produknya. Output delapan kali lebih cepat pada loop empat puluh giliran bukanlah peningkatan marginal bagi persepsi manusia; itu adalah perbedaan antara alat yang Anda gunakan dan alat yang Anda biarkan berjalan di latar belakang.
• Pekerjaan terjadwal dan batch adalah jawaban "tidak" yang mudah. Jika suatu pekerjaan memang punya waktu sampai besok pagi, Ultrafast adalah tagihan 6x yang sia-sia, dan jalur Batch setengah harga sudah tersedia di sana.
Input yang di-cache layak ditinjau ulang karena harganya juga bergerak: $0,60 per juta di Ultrafast dibandingkan $0,10 di Standard, tetap 5% dari tarif input tanpa cache. Agen dengan cache prompt yang mengirim ulang prompt sistem berukuran besar setiap giliran akan mendapati bahwa diskon cache berskala mengikuti tier, bukan melindungi mereka darinya.

Dari mana angka "hingga 8x" berasal
Ini adalah bagian yang perlu dibaca dengan cermat, karena di sinilah judul utama rollout dan dokumentasi rollout secara diam-diam menggambarkan hal yang berbeda.
Satu-satunya pengukuran kecepatan khusus model yang diterbitkan OpenAI adalah kalimat ini: "GPT-6 Astra Ultrafast menghasilkan token hingga 8x lebih cepat daripada GPT-6 Astra dalam mode Standar di Codex." Itu adalah angka Astra, yang diukur di Codex. Tidak ada kelipatan setara yang dipublikasikan untuk GPT-6.1 Sol. Dokumen yang membahas Ultrafast untuk model ini menyatakan bahwa fitur ini mengurangi waktu antara token keluaran yang dihasilkan dan merujuk ke tabel harga; dokumen itu tidak mencantumkan angka untuk itu. Halaman kecepatan di sisi ChatGPT mengulangi kalimat Astra itu dan berhenti sampai di situ.
Jadi pembacaan jujur atas "hingga 8x lebih cepat" adalah: itu adalah klaim utama tier tersebut, bersumber dari model saudara yang telah ada di Ultrafast sejak 29 September, dan itu adalah klaim vendor yang belum direproduksi oleh pihak independen mana pun untuk kedua model. Bisa jadi itu memang berlaku untuk GPT-6.1 Sol — keduanya berjalan pada stack penyajian yang sama dan mekanisme tier-nya sama — tetapi tidak ada pihak di luar OpenAI yang telah menerbitkan pengukuran token per detik untuk varian Sol, dan kata "hingga" benar-benar berperan penting dalam kalimat itu.
Ada baiknya juga memisahkan tier berdasarkan model, karena model yang lebih lama masih menjadi urusan yang belum selesai. Ultrafast diumumkan pada 13 Agustus 2026 untuk GPT-5.6 Sol dengan "hingga 14x lebih cepat daripada pemrosesan Standard", dalam pratinjau terbatas untuk pelanggan tertentu. Tiga bulan kemudian, dokumentasi masih menyatakan GPT-5.6 Sol memiliki "akses pratinjau" dan tabel harga Ultrafast berisi tepat dua baris — GPT-6 Astra dan GPT-6.1 Sol. Angka 14x yang tidak pernah mencapai ketersediaan umum dan tidak memiliki tarif yang dipublikasikan hanyalah klaim, bukan produk.

Siapa yang benar-benar bisa menyalakannya
Sisi API itu luas; sisi langganan sempit, dan perbedaan itulah yang sering membuat orang terkecoh.
• API — tersedia untuk semua pengguna API pada gpt-6.1-sol, dengan batas laju terpisah dari Standard dan Fast. Itu berarti anggaran kedua yang perlu diperhatikan, bukan hanya harga kedua.
• Batas laju ultracepat untuk GPT-6.1 Sol — 1.000.000 token per menit di Build, 4.000.000 di Launch, 40.000.000 di Grow. OpenAI menyederhanakan tier penggunaannya dari lima menjadi tiga pada 6 Oktober, jadi ketiga nama itu adalah jenjang yang berlaku saat ini, bukan jenjang lama.
• Residensi data — GPT-6.1 Sol mendukung residensi data AS dan UE serta pemrosesan global, termasuk pada Fast dan Ultrafast. Ultrafast milik Astra tidak mendapatkan residensi UE, jadi jika beban kerja Anda dipatok ke UE, ini adalah konfigurasi Ultrafast pertama yang bisa Anda beli sama sekali.
• Codex and ChatGPT Work — Ultrafast tersedia pada paket Pro $500 dan pada paket Enterprise serta Edu yang memenuhi syarat. Administrator Enterprise mendapatkannya dalam keadaan nonaktif secara default dan harus mengaktifkannya per pengguna atau per ruang kerja.
• Chat — tidak termasuk. GPT-6.1 Sol sendiri berada di Work dan Codex; antarmuka Chat untuk konsumen bukan bagian dari ini.
• Bagaimana penagihannya pada langganan — penggunaan yang sudah termasuk dikonsumsi pada 8x tarif Standar, dan kredit yang dibeli atau bayar sesuai pemakaian Enterprise ditagih pada 6x tarif Standar. Kedua angka tersebut sebaiknya Anda ketahui sebelum membiarkannya tetap aktif.
Satu detail implementasi menentukan apakah Anda bisa merasakan kecepatannya sama sekali. Panduan OpenAI blak-blakan soal ini: gunakan WebSockets, "terutama untuk aplikasi agentik yang melakukan banyak panggilan tool secara beruntun", karena "tanpa koneksi persisten, overhead jaringan dapat mengurangi keuntungan latensi". Jika klien Anda membuka koneksi HTTP baru untuk setiap panggilan, overhead per permintaan dapat memakan seluruh keunggulan tier yang baru saja Anda bayar 6x lipat. HTTP tetap berfungsi. Hanya saja mungkin tidak sepadan dengan tier itu.
Apa yang kami rutekan, dan apa yang tidak
GPT-6.1 Sol tingkat standar tersedia di OrcaRouter sebagai openai/gpt-6.1-sol dengan harga milik penyedia sendiri, yaitu $2,00 untuk input dan $10,00 untuk output per juta token, dilayani tanpa markup 0% — harga daftar vendor diteruskan apa adanya, jadi ketika OpenAI mengubah tarif, perubahan itu masuk ke tagihan Anda pada hari yang sama saat perubahan muncul di daftar harga, bukan pada perpanjangan kontrak berikutnya. Kunci dan endpoint yang sama melayani lebih dari 200 model, sehingga panggilan GPT-6.1 Sol serta panggilan Claude atau Qwen berada di balik satu integrasi dengan failover otomatis dan tanpa kontrak kedua, dan DSL perutean akan menyusun model menjadi satu panggilan ketika suatu tugas membutuhkan lebih dari satu pendapat.
Ultrafast bukan salah satu dari model tersebut, dan akan menyesatkan untuk menyiratkan sebaliknya. Ini adalah flag tingkat layanan pada akun OpenAI — Anda mengirim service_tier: "ultrafast" ke gpt-6.1-sol dan OpenAI menagih akun Anda sendiri dengan tarif di atas — jadi ia berada di dalam integrasi OpenAI langsung Anda. Jika Anda mengaktifkannya, pertahankan lalu lintas berjenjang pada kunci vendor Anda dan rutekan lalu lintas bervolume standar melalui kami. Itulah pembagian yang jujur, dan itu juga yang lebih murah untuk apa pun yang tidak sedang menunggu manusia.

Apa yang harus dilakukan dengannya hari ini
Jika Anda memiliki seat Codex atau ChatGPT Work di Pro $500, toggle-nya sudah ada dan uji cobanya tidak memakan biaya apa pun selain pengganda penggunaan — jalankan tugas yang sama dengan kedua cara dan lihat apakah loop yang benar-benar Anda jalankan memiliki cukup putaran agar peningkatan delapan kali lipat itu muncul. Jika Anda menggunakan API, eksperimen yang layak dijalankan lebih sempit daripada yang disiratkan pengumuman: ukur berapa banyak latensi Anda yang berasal dari generasi token dan berapa banyak yang merupakan proses berpikir model, lalu arahkan Ultrafast ke bagian yang benar-benar dapat dikompresinya.
Dan jika Anda punya pilihan antara Fast pada 2x dan Ultrafast pada 6x untuk permintaan yang sama, Fast adalah tier yang lebih dulu sampai di sini dan yang perilakunya dapat Anda nalar hanya dari rate card. Ultrafast baru untuk model ini, tidak diberi harga oleh pengukuran independen mana pun, dan nilainya persis sebesar yang dikatakan stopwatch Anda sendiri.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
