
GPT-5.6 Sol Ultrafast: Ultrafast Dirilis dengan Harga 6× Harga Standar, tetapi Model Ini Masih Hanya Pratinjau
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Penantian telah berakhir untuk tier ini, tetapi tidak untuk model ini. Pada DevDay tanggal 29 September 2026, vendor mengubah Ultrafast menjadi sesuatu yang bisa Anda beli: paket baru ChatGPT Pro 500 seharga $500 per bulan menyertakannya, API kini menerbitkan kartu tarif Ultrafast pada enam kali tarif standar — $60.00 input / $300.00 output per juta token pada GPT-6 Astra — dan dokumentasi Codex milik vendor mengonfirmasi bahwa tier Pro sama sekali tidak memiliki batas penggunaan lima jam, jendela yang berlaku untuk Plus. Semua itu dinyatakan oleh vendor, diterbitkan pada rekap DevDay, halaman bantuan, dan dokumentasi pengembang milik vendor sendiri. Yang belum berubah adalah model yang dibahas halaman ini. GPT-5.6 Sol Ultrafast, yang diumumkan pada 13 Agustus 2026 sebagai tier penyajian yang dipercepat Cerebras untuk GPT-5.6 Sol dengan throughput hingga 14× standar dan 750 token output per detik, masih hanya berupa akses pratinjau — yang diatur melalui tim akun vendor — dan masih belum memiliki harga sendiri yang dipublikasikan. Tier ini sudah dirilis. Varian Sol masih menunggu.
Dua pergerakan harga terjadi sejak kami pertama kali menuliskan ini, dan keduanya mengarah ke arah yang berlawanan. Model yang mendasarinya menjadi lebih murah: GPT-5.6 Sol standar kini ditagih $4.00 per juta token masukan dan $20.00 per juta keluaran — tarif promosi OpenAI, yang menurut vendor tersedia setidaknya sampai dengan 21 November 2026 — bukan $5.00 / $30.00 yang berlaku pada Agustus. Tingkat kecepatan di atasnya mendapat harga untuk pertama kalinya, dan itu tidak murah: Ultrafast pada GPT-6 Astra ditagih $60.00 / $300.00 per juta. Setiap angka dalam tulisan ini diperiksa ulang terhadap kartu tarif terbitan OpenAI, referensi API-nya, dan dokumentasi harga Codex-nya pada 2026-09-30.
Apa sebenarnya mode Ultrafast itu
Ultrafast adalah tier layanan, bukan model baru. OpenAI mengumumkannya pada 13 Agustus 2026 sebagai produk pertama dari kemitraan komputasi Januari 2026 dengan pembuat chip Cerebras — kesepakatan yang dilaporkan bernilai sekitar $10 miliar selama tiga tahun. Jika inferensi GPT-5.6 Sol standar berjalan pada kluster GPU dan menghabiskan sebagian besar waktunya untuk memindahkan bobot antara memori dan komputasi, Ultrafast memuat bobot model ke dalam SRAM on-chip 44 GB pada chip wafer-scale Cerebras; model seukuran Sol membentang beberapa wafer secara berlapis, sehingga bobotnya berada di tempat komputasinya. Hasilnya adalah batas throughput yang ditentukan oleh silikon, bukan oleh bandwidth memori.
Perkembangan hardware berlanjut pada 2026-08-18. Dalam acara Supernova-nya, Cerebras meluncurkan CS-4, sistem skala-rak generasi berikutnya yang dibangun di atas platform Nexus — tiga chip Wafer-Scale Engine per rak, kecepatan pembuatan token hingga 2× lipat dari CS-3 sebelumnya, dan, menurut Cerebras, lebih dari 1.000 token per detik pada model di atas 10 triliun parameter. Itu adalah klaim Cerebras untuk sistem dalam akses awal, belum tersedia secara umum. Sejak peluncuran itu, satu unggahan di X mengklaim CS-4 sudah melayani GPT-5.6 Sol dengan kecepatan sekitar 1.300 token per detik — sejalan dengan angka Cerebras, tetapi sejauh ini belum dikonfirmasi siapa pun. Anggap saja sebagai sinyal awal: masuk akal, belum terverifikasi, dan layak diperiksa ulang sebelum Anda merencanakan kapasitas berdasarkan hal itu.
Bagian yang penting untuk kode Anda: id model, bobot, perilaku penalaran, dan keluarannya identik dengan GPT-5.6 Sol standar. OpenAI menyebut Ultrafast sebagai "pekerjaan berguna yang lebih banyak per detik" alih-alih sebagai tingkatan kualitas, dan pratinjau ini menjalankan model unggulan penuh — kecepatan tidak berasal dari menukar dengan model yang lebih murah. Yang berubah adalah seberapa cepat token keluar.
Jangan samakan Ultrafast dengan mode cepat. Mode cepat adalah tier terpisah yang dapat dibeli pada perangkat keras standar: kecepatan output hingga sekitar 2,5× dengan premi 2× per token, tanpa perubahan kualitas — namanya diubah dari Priority Processing pada 30 Juli 2026, dan pada GPT-5.6 Sol biayanya $8,00 input / $40,00 output per 1 juta. Ultrafast adalah hal yang berbeda — perangkat keras Cerebras, hingga 14× pada GPT-5.6 Sol dan hingga 8× pada GPT-6 Astra, dengan biaya 6× tarif standar pada Astra dan masih belum diberi harga pada Sol. Kedua nama itu kini bersebelahan di pemilih model yang sama, yang tetap menjadi hal paling membingungkan dari rilis ini.
Seberapa cepat — angka-angka yang penting

Angka utamanya adalah 14×, dan itu perlu didefinisikan. OpenAI mengatakan Ultrafast menghasilkan hingga 750 token keluaran per detik dibanding pemrosesan standar GPT-5.6 Sol. Itu adalah angka throughput untuk token keluaran, bukan sekadar klaim bahwa "semuanya berjalan 14× lebih cepat" — waktu permintaan end-to-end juga mencakup pemrosesan masukan dan penalaran model itu sendiri, itulah sebabnya 14× diberi label sebagai maksimum.
• Throughput output maksimum — hingga 750 token output per detik, menurut pengumuman OpenAI (13-08-2026).
• Vs pemrosesan standar — hingga 14× lebih cepat, menurut pengumuman yang sama; keuntungan sebenarnya bervariasi tergantung panjang input dan jenis tugas.
• Humanity's Last Exam, 2.500 pertanyaan — OpenAI/Cerebras melaporkan GPT-5.6 Sol Ultrafast selesai dalam 11 jam 11 menit versus 78 jam 27 menit untuk Claude Fable 5, dengan akurasi yang sebanding. Dilaporkan oleh vendor, dan perbandingannya mencakup stack perangkat keras dua vendor — baca ini sebagai indikatif, bukan putusan.
• GDP-Val, end-to-end — Cerebras melaporkan 5,6× lebih cepat secara keseluruhan tanpa kehilangan kualitas yang terukur. Juga dilaporkan oleh vendor.
• Fast mode dan Ultrafast dibandingkan — fast mode mencapai sekitar 2,5× kecepatan output dengan premi harga 2×, dibatasi pada batas ~272K token yang sama seperti harga standar. Ultrafast adalah lompatan yang lebih besar: 14× pada GPT-5.6 Sol menurut pengumuman Agustus, dan hingga 8× pada GPT-6 Astra di Codex menurut dokumen OpenAI saat ini, dengan cakupan peluncuran menempatkannya pada hingga 300 token output per detik.
• CS-4, perangkat keras berikutnya — Cerebras mengklaim rak CS-4 menghasilkan lebih dari 1.000 token per detik pada model di atas 10 triliun parameter, hingga 2× generasi token CS-3. Laporan komunitas yang belum terverifikasi menyebut GPT-5.6 Sol pada CS-4 mencapai ~1.300 token per detik — arah yang sama, belum dikonfirmasi oleh OpenAI atau Cerebras.
Satu peringatan sebelum Anda mengutip 14×: itu adalah plafon throughput keluaran pada perangkat keras satu vendor, dan perbandingan independen atas peluncuran Agustus berkisar dari sekitar 7× hingga 11× bergantung pada bagian beban kerja mana yang diukur. Disiplin yang sama berlaku pada sinyal kecepatan CS-4 — angka ~1.300 token/dtk untuk GPT-5.6 Sol pada CS-4 bermula sebagai satu unggahan X, dan baik OpenAI maupun Cerebras belum mengonfirmasinya. Perlakukan semua ini sebagai klaim vendor dan komunitas, bukan putusan benchmark.
Berapa biaya Ultrafast sekarang — dan mengapa itu masih belum menetapkan harga Sol

Berikut status pertanyaan harga pada 30 September 2026, yang dinyatakan secara gamblang. Ultrafast memiliki tarif yang dipublikasikan — untuk GPT-6 Astra, dan hanya untuk GPT-6 Astra. Halaman harga OpenAI kini memuat kolom Ultrafast di samping Standard, Batch, Flex, dan Fast: $60.00 input / $6.00 input yang di-cache / $75.00 penulisan cache / $300.00 output per juta token dalam konteks pendek, berlipat ganda menjadi $120.00 / $12.00 / $150.00 / $450.00 setelah sekitar 272K token. Itu enam kali tarif Astra standar, sedangkan mode fast dua kali — dan ini adalah angka pasti pertama yang OpenAI cantumkan untuk tier tersebut. Kartu di atas adalah snapshot 18 Agustus 2026 milik kami sendiri, dan angka dolarnya telah digantikan dua kali, oleh pemotongan tarif standar dan kini oleh baris Ultrafast ini. Yang masih belum ada di tabel itu adalah tarif Ultrafast untuk GPT-5.6 Sol: kolom Ultrafast hanya mencantumkan tepat satu model, gpt-6-astra. Tier ini sudah diberi harga; model ini belum.
Apa yang dapat Anda tetapkan harganya hari ini, model demi model:
• Standard GPT-5.6 Sol — $4.00 input / $20.00 output per 1 juta token untuk prompt hingga sekitar 272K token. OpenAI mencantumkan ini sebagai harga promosi yang tersedia setidaknya hingga 21 November 2026. Ini adalah baseline yang dapat Anda panggil sekarang.
• Mode Cepat — $8,00 / $40,00 konteks pendek pada GPT-5.6 Sol, menjadi dua kali lipat $16,00 / $60,00 setelah sekitar 272K token. Dua kali tarif standar untuk kecepatan output hingga sekitar 2,5×, dan pada Sol ini tetap hal tercepat yang benar-benar bisa Anda beli.
• Cache prompt — pembacaan cache ditagih sebesar $0.40 per 1M (diskon 90% dari input baru); penulisan cache ditagih sebesar $5.00 per 1M.
• Tingkat konteks panjang — input di atas sekitar 272K token dikenai biaya $8,00 / $30,00 pada pemrosesan standar, dalam jendela model ~1,05 juta token dan keluaran maksimum 128K token.
• Batch API — $2.00 / $10.00 untuk konteks pendek dan $4.00 / $15.00 untuk konteks panjang, potongan harga tetap 50% dengan waktu penyelesaian sekitar 24 jam.
Untuk GPT-5.6 Sol, angka Astra adalah petunjuk terbaik yang tersedia dan tidak lebih dari itu. OpenAI menetapkan harga Ultrafast sebesar 6× tarif standar model dasarnya; terapkan pengali itu pada $4 / $20 milik Sol dan Anda mendapatkan $24 / $120 per juta. Itu aritmetika, bukan harga yang dipublikasikan — OpenAI belum mengatakan apa pun tentang tarif Sol Ultrafast, dan kohort pratinjau Agustus sama sekali tidak ditagih dengan tarif tingkat. Rencanakan berdasarkan Sol standar pada $4 / $20 atau mode cepat pada $8 / $40 sampai vendor menerbitkan barisnya.
Cara menggunakannya — tersedia secara luas di Astra, masih berdasarkan permintaan untuk Sol
Akses terbelah menjadi dua pada 29 September, dan pemisahan itu bertentangan dengan model yang dibahas di halaman ini. Ultrafast kini tersedia secara luas di GPT-6 Astra: dokumentasi API OpenAI menyatakan bahwa layanan ini terbuka untuk semua pengguna API dengan batas laju yang rendah — 500.000 token per menit pada tier penggunaan 1–3, 1 juta pada tier 4, 5 juta pada tier 5 — dan layanan ini tersedia di dalam ChatGPT Work dan Codex pada paket Pro 500 yang baru serta pada paket Enterprise dan Edu yang memenuhi syarat, di mana pemilik workspace harus mengaktifkannya, dan di mana layanan ini tidak didukung untuk workspace yang memerlukan inferensi di luar Amerika Serikat. GPT-5.6 Sol Ultrafast tidak ikut berpindah. Dokumentasi yang sama masih menggambarkannya sebagai akses pratinjau melalui tim akun OpenAI, dan deskripsi parameter itu sendiri dalam skema API masih berbunyi "currently available for gpt-5.6-sol" — baris yang kini tertinggal dari bagian lain dokumentasi, bukan memimpinnya. Jika Anda menginginkan tier ini hari ini, Anda menginginkannya di Astra.
Pertanyaan tentang antarmuka juga sudah terjawab. TestingCatalog melaporkan pada 2026-09-26 bahwa pemilih kecepatan yang menawarkan Standard, Fast, dan Ultrafast ada tetapi belum dipublikasikan di Responses API Playground; tiga hari kemudian OpenAI merilis versi konsumen dari tepat hal itu, dengan Ultrafast kini menjadi opsi di pemilih model di ChatGPT Work dan Codex pada Pro 500. Kami menandai penampakan itu sebagai tafsiran satu publikasi atas UI yang belum dirilis dan mengatakan bahwa OpenAI tidak mengonfirmasi satu pun dari itu. Itu benar secara arah, dan peluncuran yang ditunjuknya tiba pada DevDay, bukan setelahnya.
Kohort pratinjau yang disebut OpenAI pada Agustus adalah coding, commerce, riset keuangan, dukungan, dan beban kerja interaktif lainnya — tim yang agennya melakukan banyak panggilan per permintaan dan latensi respons menjadi penghambatnya. Jane Street, Rogo, dan Podium termasuk penguji awal yang disebutkan. Jika beban kerja Anda adalah obrolan satu giliran, tingkat kecepatan jauh lebih tidak penting dibandingkan untuk loop agen 40 panggilan. Jawaban praktisnya sekarang bergantung pada model mana yang Anda tanyakan: pada GPT-6 Astra Anda dapat menyetel service_tier: "ultrafast" sore ini, dan pada GPT-5.6 Sol Anda masih belum bisa.
Apa yang dapat Anda lakukan hari ini — jawaban yang praktis

Sementara GPT-5.6 Sol Ultrafast masih berada di balik pintu pratinjau, kedua model unggulan sudah aktif di OrcaRouter dengan tarif penyedia dan markup $0 per token — ID model openai/gpt-5.6-sol melalui endpoint yang kompatibel dengan OpenAI di api.orcarouter.ai/v1, dan GPT-6 Astra di sampingnya dengan tarif standar $10.00 / $50.00, yaitu model yang kini diberi tier Ultrafast di atasnya oleh OpenAI dan yang tidak kami rutekan pada tier tersebut. Tangkapan layar di bawah berasal dari Agustus 2026 dan masih menunjukkan lini $5.00 / $30.00 yang berlaku saat itu; tarif Sol hari ini adalah $4.00 / $20.00, yang kami teruskan apa adanya. Penerusan itulah sebabnya perubahan harga vendor sampai ke sisi kami pada hari yang sama: input $4.00 / output $20.00, angka yang sama dengan yang diterbitkan OpenAI, tanpa markup per token yang ditambahkan di atasnya. Jika Anda sudah memiliki klien OpenAI, migrasinya hanyalah perubahan base-URL dan ID model; tidak ada hal lain. Kunci dan endpoint yang sama melayani 200+ model, jadi Sol berada di samping saudara-saudaranya sendiri — GPT-5.6 Terra dengan $2.00 / $12.00 dan GPT-5.6 Luna dengan $0.20 / $1.20 — serta model open-weight yang akan Anda bandingkan dengannya, dan Anda dapat merutekan berdasarkan tingkat kesulitan alih-alih mengintegrasikan ulang masing-masing.
Dua spesifik OrcaRouter layak disebutkan di halaman kecepatan. BYOK: bawa kunci OpenAI Anda sendiri dan OpenAI menagih Anda langsung dengan tarifnya sendiri — OrcaRouter menambahkan $0 per token dan menjaga batas laju serta kredit penyedia Anda tetap utuh. Guardrails: PII Shield dan kebijakan konten berjalan sebelum penagihan, sehingga permintaan yang diblokir mengembalikan 400 yang bersih dan tidak pernah dikenai biaya, dan Agent Firewall menilai panggilan alat dan MCP sebelum dieksekusi. Ultrafast sendiri tersedia secara luas pada GPT-6 Astra tetapi tidak dengan ketentuan yang dapat dirutekan dan tidak untuk Sol — ini adalah tier yang dikontrol akses yang ditagih 6× tarif standar, dan kami tidak melayaninya. Jika OpenAI suatu saat menawarkannya dengan ketentuan standar, memasangnya ke endpoint yang sama hanyalah perubahan model-id; pengaturan yang Anda bangun hari ini tetap berlaku.
Batas yang jujur — ketika Ultrafast bukan jawabannya
Lima hal di mana kisah kecepatan masih belum berlaku, sekarang setelah separuhnya telah tuntas:
Tersedia tidak sama dengan tersedia untuk Anda. Ultrafast dibuka untuk semua pengguna API pada GPT-6 Astra, tetapi dibuka dengan batas laju yang rendah, masih digambarkan sebagai dikontrol akses dalam skema OpenAI, tidak mendukung pemrosesan regional UE atau non-AS lainnya, dan di ruang kerja Enterprise fitur ini nonaktif sampai pemilik mengaktifkannya. Pada GPT-5.6 Sol tidak ada yang dibuka sama sekali. Periksa akses Anda sendiri sebelum Anda merancang arsitektur pada salah satunya.
14× adalah maksimum, bukan jaminan. Ini adalah batas atas throughput keluaran pada perangkat keras Cerebras; latensi end-to-end tetap mencakup pemrosesan input, waktu penalaran model, dan jaringan Anda sendiri. Prompt yang berat penalaran dapat menghabiskan sebagian besar waktu aktualnya untuk berpikir, sehingga percepatan yang diunggulkan menyusut.
Ini memiliki harga pada satu model dan tidak ada harga pada model lainnya. Tarif Astra Ultrafast dipublikasikan — 6× standar — dan tidak ada baris Ultrafast untuk GPT-5.6 Sol di mana pun. Anggarkan terhadap Sol standar pada $4 / $20 atau mode cepat pada $8 / $40, dan perlakukan setiap angka "biaya GPT-5.6 Sol Ultrafast" yang Anda lihat, termasuk ekstrapolasi $24 / $120 di atas, sebagai aritmetika, bukan sebagai kartu tarif.
Tolok ukur tersebut dilaporkan oleh vendor. Uji HLE selama 11 jam dan angka GDP-Val 5,6× adalah angka OpenAI/Cerebras dari pengumuman Agustus; estimasi independen atas percepatannya berkisar dari sekitar 7× hingga 11× tergantung pada apa yang diukur. Tambahkan sinyal CS-4 ke daftar itu: angka sekitar 1.300 token/dtk untuk GPT-5.6 Sol pada CS-4 berasal dari satu postingan X dan tidak memiliki konfirmasi independen. Angka Astra Ultrafast yang baru — 8× di Codex, 6× harganya — juga milik OpenAI sendiri.
Dan yang memakan biaya, bukan waktu: itu tidak akan memperbaiki hambatan yang tidak Anda miliki. Jika agen Anda lambat karena orkestrasi Anda sendiri, latensi alat, atau prompt yang padat input, jalur output yang lebih cepat hanya sedikit menggeser ekor. Keputusan pencocokan tier — GPT-5.6 Sol seharga $4 / $20 versus GPT-5.6 Terra seharga $2 / $12 versus GPT-5.6 Luna seharga $0,20 / $1,20 — tetap lebih menggerakkan tagihan Anda daripada tier kecepatan mana pun.
Intinya. Ultrafast bukan lagi tier daftar tunggu yang hanya bisa Anda baca-baca. Per 29 September 2026 OpenAI menjualnya: disertakan dengan paket ChatGPT Pro 500 seharga $500 di Work dan Codex, terbuka untuk semua pengguna API pada GPT-6 Astra dengan batas laju yang rendah, dan dibanderol enam kali tarif standar — $60 / $300 per juta konteks pendek. GPT-5.6 Sol Ultrafast, pratinjau Agustus yang menjadi dasar halaman ini dibuat, tidak bergeser: masih dikontrol aksesnya, masih terbatas pada gpt-5.6-sol di skema API, masih tanpa harga, dan angka ~1.300 token/dtk yang dilaporkan untuk Sol pada CS-4 milik Cerebras masih merupakan satu unggahan X yang belum terverifikasi. GPT-5.6 Sol standar dengan harga $4 / $20 adalah yang bisa Anda panggil hari ini di OrcaRouter tanpa markup; GPT-6 Astra dengan harga $10 / $50 adalah yang bisa Anda panggil jika Anda menginginkan model yang mendapatkan baris Ultrafast.
Ultrafast kini benar-benar berbayar di GPT-6 Astra — 6× standar, atau dibundel ke dalam paket Pro 500 seharga $500 — sementara Ultrafast GPT-5.6 Sol tetap berstatus pratinjau. GPT-5.6 Sol lengkap sudah aktif di OrcaRouter dengan tarif $4 / $20 per juta token tanpa markup, siap untuk kunci Anda sendiri.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
