
Harga GPT-5.6 Setelah Pemotongan: Luna vs Terra vs Sol, dan Tingkatan Mana yang Harus Digunakan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 546 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 182 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 114 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
Setelah penurunan harga OpenAI pada 30 Juli 2026, keluarga GPT-5.6 — GPT-5.6 Luna, GPT-5.6 Terra, dan GPT-5.6 Sol — belum pernah semurah ini untuk dijalankan dalam skala besar. Seminggu kemudian, pada 6 Agustus, OpenAI menerapkan tingkatan yang sama ke dalam ChatGPT: GPT-5.6 Luna menjadi model default untuk akun gratis dan Go dengan obrolan teks tanpa batas, sementara GPT-5.6 Sol diperbarui untuk Plus dan Pro. Pada 19 Agustus, OpenAI dan Replit mengumumkan bahwa Free Mode baru Replit untuk pelanggan Core dan Pro berjalan di GPT-5.6 Luna — taruhan pihak ketiga terbesar sejauh ini pada tingkatan volume. Dan pada akhir Agustus, OpenAI mulai meluncurkan fallback untuk pengguna konsumen dengan pemakaian berat: tunjangan “Luna Reserve” yang memberikan akun ChatGPT Plus dan Pro terpilih penggunaan GPT-5.6 Luna terbatas di Codex dan ChatGPT Work setelah batas penggunaan reguler mereka habis. Namun ketiga tingkatan tersebut dibanderol dengan harga yang sangat berbeda, dan memilih yang tepat (plus menggunakan cache, batch, dan routing dengan baik) adalah pengungkit terbesar pada tagihan API Anda. Panduan ini memaparkan harga pasca-penurunan secara lengkap, contoh perhitungan biaya, perbandingan setiap tingkatan dengan pesaing, serta cara merutekan di antara semuanya melalui satu endpoint.
Harga adalah per juta token (input / output), mencerminkan kartu tarif pasca-pemotongan sebagaimana dilaporkan dan halaman model pass-through OrcaRouter; tarif berjenjang dan tarif cache berasal dari halaman model OrcaRouter, dan angka pesaing diatribusikan. Rincian peluncuran ChatGPT dalam tulisan ini sebagaimana dinyatakan OpenAI pada 6 Agustus 2026, dan rincian Mode Gratis Replit sebagaimana dinyatakan OpenAI dan Replit pada 19 Agustus 2026 — dilaporkan oleh vendor, tidak diukur secara independen. Rincian Luna Reserve sebagaimana didokumentasikan OpenAI di pusat bantuannya dan sebagaimana dilaporkan staf OpenAI serta pengguna awal pada akhir Agustus 2026 — dinyatakan oleh vendor dan komunitas, tidak diverifikasi secara independen. Harga dapat berubah — verifikasi sebelum membangun.
Intinya
GPT-5.6 Luna ($0.20 / $1.20) adalah kuda kerja bervolume tinggi; Terra ($2 / $12) adalah pilihan tengah yang seimbang; Sol ($5 / $30) adalah unggulan untuk penalaran tersulit dan pengkodean agenik. Ketiganya berbagi konteks ~1.05M token dan output maksimum 128K. Cache prompt dan opsi batch semakin menekan biaya, sementara input yang sangat panjang membawa Anda ke level yang lebih tinggi. Di sisi konsumen, OpenAI mengumumkan pada 6 Agustus bahwa GPT-5.6 Luna menjadi default untuk akun ChatGPT Free dan Go dengan obrolan teks tanpa batas, dan bahwa GPT-5.6 Sol yang diperbarui mulai diluncurkan ke Plus dan Pro. Pada 19 Agustus, Replit meluncurkan Free Mode di GPT-5.6 Luna untuk pelanggan Core dan Pro, mengarahkan tugas yang lebih sulit ke GPT-5.6 Sol sesuai kebutuhan. Pada akhir Agustus, OpenAI juga mulai meluncurkan fallback “Luna Reserve” yang memberikan akun ChatGPT Plus dan Pro terpilih penggunaan GPT-5.6 Luna terbatas di Codex dan ChatGPT Work setelah batas reguler mereka habis — didokumentasikan oleh OpenAI, dengan peluncuran ke akun terpilih yang dilaporkan oleh pengguna. Gunakan Luna untuk mayoritas tugas yang mudah, Terra saat Anda membutuhkan lebih banyak, dan Sol hanya jika sepadan dengan biayanya — dan arahkan berdasarkan tingkat kesulitan melalui satu endpoint yang kompatibel dengan OpenAI untuk meminimalkan biaya.
Poin-poin penting
• Luna: $0.20 / $1.20 per 1M tokens — cepat, murah, untuk pekerjaan bervolume tinggi dan sensitif terhadap latensi.
• Terra: $2 / $12 — tingkatan menengah yang seimbang untuk tugas-tugas yang lebih berat yang tidak memerlukan flagship.
• Sol: $5 / $30 — unggulan untuk penalaran mendalam, pengkodean skala besar, dan agen jangka panjang.
Caching dan batch memangkas biaya lebih jauh; input panjang membawa Anda ke tier konteks panjang yang lebih mahal.
• ChatGPT (disebutkan OpenAI, 6 Agustus): Luna menjadi default gratis/Go dengan obrolan teks tanpa batas; Sol mendapatkan pembaruan keandalan untuk Plus/Pro.
• Replit (diumumkan 19 Agu): Mode Gratis untuk Core/Pro berjalan di GPT-5.6 Luna — hingga 30x lebih banyak penggunaan per Replit, dengan tugas yang lebih sulit dialihkan hingga GPT-5.6 Sol. Pernyataan Replit, belum diverifikasi secara independen.
• Luna Reserve (akhir Agustus, terdokumentasi OpenAI): tunjangan cadangan berbatas yang memungkinkan akun ChatGPT Plus dan Pro tertentu terus menggunakan GPT-5.6 Luna di Codex dan ChatGPT Work setelah batas reguler habis — bukan tanpa batas, dan tidak tersedia di ruang kerja Business atau Enterprise.
• Kunci penghematan terbesar: arahkan berdasarkan tingkat kesulitan — jangan bayar tarif Sol untuk pekerjaan yang bisa dilakukan Luna.
Harga dasar GPT-5.6 yang baru
Ini harga dasar pasca-pemotongan per juta token input/output: Luna $0.20 / $1.20 (turun dari $1 / $6), Terra $2 / $12 (turun dari $2.50 / $15), dan Sol $5 / $30 (tidak berubah). Dua tingkatan yang lebih murah dipotong pada 30 Juli 2026; yang unggulan tetap bertahan. Singkatnya, tingkatan rendah kini dihargai untuk skala, sementara yang unggulan tetap premium.

Penetapan harga berjenjang, cache, dan batch
Tarif dasar hanyalah titik awal. Harga GPT-5.6 memiliki tiga pengubah yang secara material mengubah biaya efektif Anda:
• Tingkatan konteks panjang. Harga meningkat untuk input yang sangat panjang. Di halaman pass-through OrcaRouter, Luna adalah $0.20 / $1.20 hingga tingkatan konteks besar dan $0.40 / $1.80 di atasnya; Sol adalah $5 / $30 pada tingkatan dasarnya dan $10 / $45 pada yang terbesar. Tingkatan tersebut dipilih berdasarkan jumlah token input setiap permintaan, sehingga beberapa prompt besar dapat secara diam-diam menaikkan harga rata-rata Anda.
• Caching prompt. Konteks yang digunakan kembali ditagih dengan diskon besar — pembacaan cache Luna kira-kira $0.02 per juta token (dibandingkan $0.20 untuk yang baru), dengan penulisan cache sekitar $0.25; pembacaan cache Sol sekitar $0.50 (dibandingkan $5 untuk yang baru). Untuk agen dan obrolan dengan prompt sistem yang stabil, caching sering kali menjadi penghematan terbesar.
• Batch. Pekerjaan non-mendesak berjalan secara asinkron dengan harga diskon — ideal untuk klasifikasi massal, evaluasi, dan pembuatan offline yang tidak bergantung pada latensi.
Contoh perhitungan: berapa biaya sebenarnya
Angka konkret membuat tingkatan menjadi nyata. Ambil contoh 10 juta token per bulan dengan pembagian 70% input / 30% output (campuran chat/agen yang umum):
• Luna: sekitar $5 per bulan (kurang lebih $4,37 dengan prompt caching).
• Terra: sekitar $50 per bulan.
• Sol: sekitar $125 per bulan (kira-kira $109 dengan caching).
Itu adalah selisih 25x antara Luna dan Sol untuk volume yang sama — yang justru menjadi alasan mengapa mencocokkan setiap permintaan ke tier termurah yang mampu lebih penting daripada tarif tunggal mana pun. (Ini cocok dengan kalkulator biaya di halaman OrcaRouter, yang memperkirakan dari harga daftar; angka aktual Anda bergantung pada caching dan campuran input/output Anda.)
Apa sebenarnya fungsi setiap tingkatan
GPT-5.6 Luna — kuda kerja untuk volume
Luna adalah tier yang cepat dan efisien dari segi biaya, dirancang untuk beban kerja bervolume tinggi dan sensitif terhadap latensi: chat, klasifikasi, ekstraksi, routing, dan tugas agentic ringan, dengan p50 time-to-first-token sekitar 1,65 detik. Setelah dipangkas, dengan harga $0,20 / $1,20, tier ini dibanderol untuk bersaing langsung dengan model open yang murah — menjadi pilihan default untuk mayoritas panggilan yang mudah. Tier ini juga yang sedang diarahkan OpenAI untuk consumer ChatGPT: sesuai pengumuman 6 Agustus, GPT-5.6 Luna menjadi model default untuk akun Free dan Go, dengan chat berbasis teks menjadi tidak terbatas dan tombol Think baru untuk penalaran lebih tinggi pada pertanyaan yang lebih sulit hadir pada minggu berikutnya (batas file, gambar, dan suara tetap berlaku). OpenAI menyebut Luna membuat 62% lebih sedikit kesalahan faktual dibandingkan GPT-5.5 Instant yang digantikannya — angka yang dilaporkan vendor, tetapi sinyal yang jelas bahwa tier volume adalah tempat perusahaan mengarahkan sebagian besar lalu lintasnya.
Pada 19 Agustus 2026, Replit menjadikan GPT-5.6 Luna sebagai mesin dari Free Mode barunya — pengalaman default untuk pelanggan Core dan Pro. Chat sehari-hari, ideasi, dan tugas coding sederhana berjalan di Luna tanpa mengonsumsi anggaran kredit AI berbayar pengguna; Replit mengatakan pengguna Core kini dapat membuat hingga 30x lebih banyak per bulan, termasuk hingga 30 jam chat. Ketika sebuah tugas membutuhkan penalaran lebih, Agent Replit mengarahkan permintaan ke model yang lebih besar untuk bagian tersebut — mode Power/Max atau GPT-5.6 Sol — lalu kembali ke Luna. Ini adalah detail yang dinyatakan oleh Replit dan OpenAI, belum diverifikasi secara independen — tetapi arahnya sejalan dengan pemotongan harga: Luna yang 80% lebih murah adalah yang membuat tier selalu-aktif dan termasuk secara default menjadi layak.
Sisi lain yang menjadi perhatian konsumen muncul pada akhir Agustus 2026: Luna Reserve. Sebagaimana didokumentasikan OpenAI di pusat bantuannya, akun ChatGPT Plus dan Pro tertentu dapat memperoleh kumpulan penggunaan GPT-5.6 Luna yang terbatas di Codex dan ChatGPT Work sebagai cadangan setelah jatah penggunaan reguler mereka habis — muncul notifikasi atau indikator bulan saat mencapai batas, dan Anda dapat terus bekerja di Luna selama cadangan masih tersedia. Ini bukan perpanjangan tanpa batas: cadangan tersebut terpisah dari jatah reguler dan dibatasi pula, hanya melayani GPT-5.6 Luna (tidak pernah Terra atau Sol), tidak tersedia di ruang kerja Business atau Enterprise, dan mencapai batas reguler tidak menjamin akses. Staf OpenAI mengonfirmasi keberadaan cadangan ini pada 27 Agustus, dan laporan awal pengguna menyebutkan peluncurannya ke akun-akun terpilih — pernyataan dari vendor dan komunitas, belum diverifikasi secara independen. Beberapa laporan awal dari komunitas juga mencatat bahwa cadangan tersebut menjalankan sisi ringan-browser dari GPT-5.6 Luna, sehingga tugas inspeksi web langsung mungkin tidak berfungsi saat menggunakan cadangan.
GPT-5.6 Terra — titik tengah yang seimbang
Terra berada di antara volume dan flagship: lebih mumpuni daripada Luna untuk penalaran dan pengodean yang lebih sulit, tetapi jauh lebih murah daripada Sol. Pada $2 / $12, ini adalah pilihan default yang masuk akal ketika Luna tidak cukup, tetapi Anda tidak membutuhkan flagship — ekstraksi kompleksitas menengah, penyusunan draf, dan tugas multi-langkah yang tetap berjalan dalam skala besar.
GPT-5.6 Sol — model unggulan
Sol dirancang untuk pekerjaan terberat: penalaran multi-langkah yang mendalam, rekayasa perangkat lunak skala besar, dan alur kerja agenik berhorizon panjang, tetap koheren dalam konteks ~1,05M token dan hingga keluaran 128K. Dengan harga $5 / $30 (dasar), ini adalah pilihan premium — cadangkan untuk tugas yang benar-benar membutuhkannya, seperti pengodean multi-file yang kompleks atau proses agen yang panjang. Pada 6 Agustus, OpenAI juga memperbarui GPT-5.6 Sol di ChatGPT untuk pengguna Plus dan Pro: perusahaan mengatakan versi obrolan lebih andal dalam hal fakta — 68% lebih sedikit kesalahan faktual, menurut OpenAI — dan memberikan jawaban yang lebih fokus, dengan penggeser baru untuk mengontrol seberapa banyak upaya penalaran yang diterapkannya. Pembaruan ini hanya untuk obrolan (Sol di balik Work dan Codex tidak berubah), dan tingkat API tetap di $5 / $30.
Peringatan token penalaran
GPT-5.6 adalah model penalaran, sehingga biaya keluaran efektif dapat melebihi perkiraan naif: ketika penalaran aktif, token penalaran internal ditagih sebagai keluaran. Pada prompt sulit dengan upaya penalaran tinggi, hal itu dapat mendominasi tagihan Anda. Sesuaikan upaya penalaran dengan tugas (rendah atau mati untuk panggilan sederhana), batasi token keluaran jika memungkinkan, dan ukur penggunaan sebenarnya. Tarif per token yang lebih murah membantu; menghasilkan lebih sedikit token lebih membantu.
Perbandingan setiap tingkat dengan para pesaing
Pemangkasan harga tersebut memposisikan ulang GPT-5.6 terhadap para pesaingnya. Menurut laporan, harga Luna $0,20 / $1,20 kini berada di bawah harga Claude Haiku 4.5 sekitar 5x untuk input dan 4x untuk output, dan harga Terra $2 / $12 berada di bawah harga standar Claude Sonnet 5 (dilaporkan sebesar $3 / $15). Dibandingkan dengan model open-weight, Luna berada di dekat batas bawah yang ditetapkan lini V4 DeepSeek dan GLM-5.2 milik Zhipu (sekitar $1,20 / $4,10), dengan tier Qwen dan Gemini Flash di kisaran yang sama. Intinya: untuk pekerjaan yang sensitif terhadap biaya, Luna kini kompetitif dengan model-model mumpuni termurah, bukan alternatif premium bagi mereka — sementara Sol tetap menjadi tier premium sejati untuk kapabilitas yang tidak bisa Anda dapatkan dengan murah.
Tuas penghematan yang sesungguhnya: arahkan berdasarkan tingkat kesulitan
Tagihan termurah bukanlah satu tingkat tunggal — melainkan mencocokkan setiap permintaan dengan model termurah yang dapat mengerjakannya. Dalam praktiknya: kirim panggilan mudah bervolume tinggi ke Luna (atau model terbuka yang murah), naik ke Terra untuk tugas yang lebih sulit, dan gunakan Sol hanya untuk sebagian kecil yang benar-benar sulit. Jika dikombinasikan dengan caching dan batch, cara ini secara rutin memangkas biaya jauh lebih banyak daripada perubahan harga tunggal apa pun. Kendalanya bersifat operasional: Anda tidak ingin mengintegrasikan ulang tiga tingkat OpenAI plus alternatif model terbuka secara terpisah.
Akses ketiganya (dan pesaing yang lebih murah) melalui satu endpoint.
Di sinilah router yang netral terhadap vendor membantu. OrcaRouter mengekspos GPT-5.6 Luna, Terra, dan Sol — dengan harga pasca-pemotongan yang sama, markup 0% — melalui satu endpoint yang kompatibel dengan OpenAI, di samping model open-source yang lebih murah seperti DeepSeek V4 Pro, GLM-5.2, dan Qwen. Mengganti tingkatan (atau pengujian A/B Luna terhadap model terbuka) adalah perubahan konfigurasi, bukan integrasi ulang, dan Anda dapat mengarahkan setiap permintaan ke opsi yang paling murah. Luna Reserve adalah versi sisi-konsumen dari gagasan yang sama — fallback bawaan yang menjaga pengguna terpilih tetap menggunakan GPT-5.6 Luna setelah jatah reguler mereka habis — dan padanan sisi-API-nya adalah failover otomatis, yang ditangani OrcaRouter ketika penyedia melakukan rate-limit atau mengalami kesalahan pada sebuah permintaan.

Kartu tarif Luna pasca-pemotongan dapat dilihat di halaman model OrcaRouter sendiri dengan harga daftar — $0.20 / $1.20 per juta token — karena router meneruskan harga penyedia dengan markup 0%, dengan kalkulator biaya di halaman untuk tagihan bulanan yang umum. Ada juga tier gratis dan halaman Offers untuk penghematan tambahan.

FAQ
Berapa harga GPT-5.6 setelah dipotong?
Luna $0.20 / $1.20, Terra $2 / $12, dan Sol $5 / $30 per juta token input/output. Luna dan Terra dipotong pada 30 Juli 2026; Sol tidak berubah.
Tingkatan GPT-5.6 mana yang harus saya gunakan?
Luna untuk pekerjaan bervolume tinggi yang sensitif terhadap latensi; Terra untuk tugas yang lebih berat yang tidak memerlukan flagship; Sol untuk penalaran tersulit dan pengodean agen. Rute berdasarkan tingkat kesulitan untuk meminimalkan biaya.
Apakah GPT-5.6 Luna gratis di ChatGPT?
OpenAI mengumumkan pada 6 Agustus bahwa GPT-5.6 Luna menjadi model default untuk akun gratis dan akun Go ChatGPT, dengan obrolan khusus teks tanpa batas; batasan tetap berlaku untuk unggahan file, gambar, dan alat suara, serta tombol Think untuk penalaran yang lebih tinggi sedang diluncurkan secara terpisah. Ini adalah rencana yang dinyatakan oleh OpenAI, bukan diverifikasi secara independen.
Mengapa Replit menggunakan GPT-5.6 Luna untuk Mode Gratis?
Mode Gratis Replit, yang diumumkan pada 19 Agustus 2026, menjalankan obrolan sehari-hari, ideasi, dan pengkodean sederhana pada GPT-5.6 Luna secara default untuk pelanggan Core dan Pro, mengarahkan tugas yang lebih sulit ke model yang lebih besar — mode Power/Max atau GPT-5.6 Sol — sesuai kebutuhan. Replit mengaitkan pemotongan harga API Luna pada 30 Juli, sekitar 80%, dengan membuat ekonomi ini menjadi berjalan. Ini adalah rencana yang dinyatakan vendor, belum diverifikasi secara independen.
Apa itu Luna Reserve?
Jatah cadangan yang didokumentasikan OpenAI untuk Codex dan ChatGPT Work: akun ChatGPT Plus dan Pro terpilih mendapatkan kumpulan penggunaan GPT-5.6 Luna yang terbatas setelah batas penggunaan reguler mereka habis, sehingga mereka tetap bisa bekerja alih-alih diputus. Ini hanya menyajikan GPT-5.6 Luna — tidak pernah Terra atau Sol — memiliki batasnya sendiri, terpisah dari penggunaan reguler, dan tidak tersedia di ruang kerja Business atau Enterprise. Keberadaannya dinyatakan oleh OpenAI (staf mengonfirmasinya pada 27 Agustus); peluncurannya ke akun terpilih dilaporkan oleh komunitas, belum diverifikasi secara independen.
Berapa biaya GPT-5.6 per bulan?
Pada 10 juta token/bulan (70% input): kira-kira $5 di Luna, $50 di Terra, dan $125 di Sol — selisih 25x, sebelum caching. Biaya aktual Anda bergantung pada caching dan campuran input/output Anda.
Apakah ketiga tingkat tersebut memiliki jendela konteks yang sama?
Ya — kira-kira konteks 1,05 juta token dan hingga 128 ribu token keluaran, dengan dukungan visi, alat, JSON, dan penalaran.
Bagaimana caching prompt memengaruhi biaya?
Caching secara tajam mengurangi biaya konteks berulang — pembacaan cache Luna sekitar $0,02 per juta token dibandingkan $0,20 untuk yang baru — jadi gunakan kembali prompt yang di-cache sedapat mungkin. Input panjang, sebaliknya, dapat membawa Anda ke tingkat konteks panjang yang lebih mahal.
Bagaimana perbandingan tingkatan-tingkatan tersebut dengan Anthropic atau model terbuka?
Berdasarkan laporan, Luna menawarkan harga lebih murah daripada Claude Haiku 4.5 (sekitar 5x input / 4x output) dan Terra berada di bawah Claude Sonnet 5 ($3 / $15). Luna juga mendekati batas bawah harga model open-source yang murah (DeepSeek, GLM-5.2 ~$1.20/$4.10).
Di mana saya dapat menggunakan ketiga tingkatan tersebut secara bersamaan?
Melalui endpoint tunggal OrcaRouter yang kompatibel dengan OpenAI dengan markup 0%, di samping model terbuka yang lebih murah untuk routing berbasis kesulitan.
Intinya
Setelah pemotongan harga, GPT-5.6 Luna ($0,20 / $1,20) dan Terra ($2 / $12) menarik untuk pekerjaan volume tinggi dan kelas menengah, sementara Sol ($5 / $30) tetap menjadi andalan premium — selisih biaya 25x yang memberi imbalan atas perutean cerdas. Peluncuran konsumen memperkuat pembagian ini: OpenAI menjadikan Luna sebagai default gratis sambil menyimpan pembaruan keandalan Sol untuk paket berbayar, dan Free Mode 19 Agustus milik Replit — dibangun di atas GPT-5.6 Luna, dengan tugas yang lebih sulit dirutekan ke GPT-5.6 Sol — menunjukkan produk dengan lalu lintas tinggi mendarat di tingkat yang sama, dan fallback Luna Reserve akhir Agustus memperluas pola tersebut dengan menjaga sebagian pengguna Plus dan Pro tetap di GPT-5.6 Luna bahkan setelah batas reguler mereka habis. Bagi pengembang API, itu satu alasan lagi untuk mengarahkan lalu lintas mudah ke Luna. Penghematan terbesar berasal dari perutean berdasarkan tingkat kesulitan, mengandalkan caching dan batch, serta mengontrol token penalaran daripada mengandalkan satu tingkat secara default. Cara termudah melakukannya adalah melalui satu endpoint dengan markup 0% seperti OrcaRouter, tempat ketiga tingkat (dengan harga baru) bersanding dengan model open yang lebih murah yang ingin Anda bandingkan.
