Kartu judul untuk analisis pemotongan harga 80% GPT-5.6 Luna, yang menampilkan panah besar mengarah ke bawah berlabel potongan 80%, tarif sebelum pemotongan sebesar $1,00 per juta token input dan $6,00 per juta output, serta tarif saat ini sebesar $0,20 untuk input dan $1,20 untuk output.
Guides & Insights

GPT-5.6 Luna: Apa yang Sebenarnya Berubah dari Pemotongan Harga 80% OpenAI

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-5.6 Lunatelah 80% lebih murah daripada harga peluncurannya sejak akhir Juli, dan OpenAI mulai memperlakukannya sebagai argumen, bukan diskon. Model itu — tier cepat dan berbiaya rendah dari keluarga GPT-5.6 — tersedia secara umum pada 9 Juli 2026 dengan harga $1,00 per juta token input dan $6,00 per juta token output. Saat ini tarifnya $0,20 dan $1,20. Pada 9 September, direktur keuangan OpenAI, Sarah Friar, mengatakan kepada konferensi Communacopia Goldman Sachs bahwa pemotongan itu menghasilkan peningkatan penggunaan sekitar sepuluh kali lipat, dan bahwa menerapkan Luna lebih murah daripada menjalankan GLM 5.3 milik Z.ai pada lapisan cloud.

Klaim terakhir itu adalah klaim Open​AI sendiri, yang disampaikan oleh seorang eksekutif di konferensi investor, dan klaim itu layak mendapat perlakuan yang sama seperti angka dari vendor lain mana pun: layak dilaporkan, layak diperiksa, tidak layak diulang sebagai fakta yang sudah mapan. Harga itu sendiri adalah soal lain. Harga itu publik, dan belum kembali ke posisi semula.

Apa yang sebenarnya berubah, dan kapan

Tidak ada yang berubah pada kemampuan, jendela konteks, atau ketersediaan GPT-5.6 Luna di bulan September. Yang berubah adalah cara Open​AI menjualnya, dan pergeseran itu memiliki lima tanggal di baliknya.

26 Juni 2026 — Open​AI mengumumkan keluarga GPT-5.6 (GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna) dalam pratinjau terbatas untuk sekelompok kecil mitra, setelah berkoordinasi dengan lembaga-lembaga pemerintah Amerika Serikat.

9 Juli 2026 — ketersediaan umum. Sol, Terra, dan Luna tersedia di API dengan harga $5/$30, $2,50/$15, dan $1/$6 per juta token input/output.

Akhir Juli 2026 — pemotongan 80% hanya pada Luna, menjadi $0,20 untuk input dan $1,20 untuk output. Pembacaan input yang di-cache berjalan dengan diskon sekitar 90%. Di atas ambang batas konteks panjang, tarifnya kurang lebih dua kali lipat, menjadi sekitar $0,40/$1,80.

6–7 Agustus 2026 — Luna menggantikan GPT-5.5 Instant sebagai model default untuk ChatGPT Free dan Go, dengan obrolan teks tanpa batas dan tombol "Think" untuk penalaran yang lebih mendalam yang hadir pada minggu berikutnya. Evaluasi internal Open​AI menempatkan tingkat respons Luna yang mengandung setidaknya satu kesalahan faktual sekitar 62% di bawah GPT-5.5 Instant pada prompt keuangan, medis, dan hukum — angka yang dilaporkan vendor, bukan angka independen.

9 September 2026 — pernyataan Friar, yang untuk pertama kalinya mempublikasikan angka-angka dampak dari pemotongan tersebut: penggunaan sekitar 10x lipat, pendapatan enterprise naik 32% dari Juni ke Juli dibandingkan pertumbuhan tahunan keseluruhan sebesar 20%, dan Codex dengan 25 juta pengguna.

Jika dibaca bersama-sama, tanggal-tanggal itu menggambarkan konversi dua bulan dari tingkatan murah menjadi strategi volume. Luna memang selalu menjadi tingkatan yang dimaksudkan untuk menyerap pekerjaan bervolume tinggi dan berkompleksitas rendah — klasifikasi, ekstraksi, perutean, draf tahap pertama. Pemotongan itu membuat perhitungan di balik posisi tersebut jauh lebih sulit dibantah.

Angka yang lebih penting daripada harga token

Screenshot of the Artificial Analysis model page for GPT-5.6 Luna (max), showing an Intelligence Index of 38 ranked 4th of 177 models, output speed of 109.4 tokens per second, input pricing of $0.20 and output pricing of $1.20 per million tokens, a cache discount of 90%, and a cost of $0.18 per Intelligence Index task.

Harga yang tertera adalah titik tempat sebagian besar perbandingan berhenti, dan bagi Luna, harga itu membuatnya tampak lebih baik. Pada $0,20/$1,20, ia menawarkan harga sekitar 5x lebih murah untuk input dan 4x lebih murah untuk output dibandingkan Claude Haiku 4.5 milik Anthropic — yang paling mendekati pesaing langsungnya.

Artificial Analysis mengukur sesuatu yang kurang praktis: biaya per tugas Intelligence Index yang diselesaikan, yang turut memperhitungkan berapa banyak token yang benar-benar dihabiskan sebuah model untuk menyelesaikan pekerjaan yang sama. Pada indeks saat ini, konfigurasi reasoning GPT-5.6 Luna mencapai $0,18 per tugas. Claude Haiku 4.5 dalam konfigurasi reasoning-nya mencapai $0,21.

Itu adalah selisih sekitar 14%, bukan 5x. Penyebabnya adalah verbositas. Menyelesaikan set evaluasi tersebut membutuhkan Luna sekitar 150M token keluaran, dibandingkan 78M milik Haiku. Luna menalar panjang lebar, dan token keluaran ditagih enam kali tarif input.

Pembacaan praktisnya terbagi dengan rapi. Untuk pekerjaan bervolume tinggi dengan keluaran pendek — klasifikasi, pemberian tag, ekstraksi, perutean permintaan, draf awal — pemotongan 80% itu nyata, besar, dan langsung terlihat di tagihan. Untuk pekerjaan ketika model bernalar sebelum menjawab, sebagian besar diskon dikonsumsi oleh token keluaran tambahan. Kedua pernyataan itu benar sekaligus, dan yang kedua adalah bagian yang terlewat dari cakupan pemotongan itu.

Perlu juga diketahui apa yang dikatakan indeks tentang kemampuan, karena tingkatannya tidak berdekatan. Artificial Analysis saat ini memberi skor GPT-5.6 Luna sebesar 38, peringkat keempat dari 177 model di kelasnya. Konfigurasi penalaran Claude Haiku 4.5 mendapat skor 18, peringkat ke-138 dari 200. Dua catatan tentang angka-angka tersebut. Pertama, indeks tersebut dinilai ulang pada September 2026, sehingga angka saat peluncuran — termasuk 51 dan 52 yang masih beredar untuk Luna — dikutip dari skala yang sudah tidak digunakan. Kedua, Artificial Analysis telah mengadopsi GPT-5.6 Luna sebagai satu-satunya penilai untuk beberapa evaluasinya sendiri, yang perlu dicatat saat membaca skornya.

Mengapa Open​AI mengemukakan argumen ini sekarang

Pemotongan 80% yang diumumkan pada akhir Juli tidak perlu diperdebatkan kembali oleh seorang CFO pada bulan September. Fakta bahwa dia melakukannya justru memberi tahu Anda untuk apa pemotongan itu sebenarnya.

Model-model Tiongkok dengan bobot terbuka telah sepanjang 2026 menekan tepat pada sumbu yang ditempati Luna: kualitas yang memadai dengan harga yang menjadikan akuntansi per token sebagai faktor penentu. Memangkas harga itu pada deployment cloud adalah klaim yang lebih sulit dibuat daripada memangkasnya pada bobot, dan itulah klaim yang dipilih OpenAI — dengan menyebut GLM 5.3 secara spesifik alih-alih hanya menyinggung "model terbuka" secara umum.

Angka-angka enterprise yang dipasangkan Friar dengannya menunjuk ke arah yang sama. Pendapatan enterprise yang tumbuh 32% bulan ke bulan dibandingkan 20% secara keseluruhan adalah gambaran perusahaan yang menjual ke siklus pengadaan, dan siklus pengadaan adalah tempat sebuah item baris dipertanyakan. Ia juga mengonfirmasi bahwa Open​AI sedang bereksperimen dengan penetapan harga berbasis hasil, mengaitkan biaya dengan hasil bisnis alih-alih konsumsi token. Itu adalah pengakuan yang signifikan bagi perusahaan yang seluruh model pendapatannya berbasis per token: ini menunjukkan bahwa di ujung pasar yang murah, angka per token menjadi argumen penjualan yang lebih lemah daripada apa yang diselesaikan model.

Tak satu pun dari itu membuat perbandingan GLM terverifikasi. Klaim Friar bersandar pada perbandingan penerapan cloud yang tidak diterbitkan OpenAI secara rinci, dan "lebih murah daripada menjalankan X sendiri di lapisan cloud" sepenuhnya bergantung pada cloud mana, instance mana, dan asumsi pemanfaatan mana yang Anda pilih. Perlakukan itu sebagai klaim yang diposisikan dari pihak yang berkepentingan, dan periksa terhadap beban kerja Anda sendiri sebelum itu mengubah apa pun yang Anda bangun.

Apa yang berubah jika Anda sudah merutekan lintas model?

Screenshot of the OrcaRouter model page for GPT-5.6 Luna, showing the model identifier openai/gpt-5.6-luna, a release date of 2026-07-09, a 1M-token context window, 128K maximum output, input pricing of $0.20 per million tokens, output pricing of $1.20, a median time to first token of 1.83 seconds and a 95th percentile of 10.00 seconds.

Ada tiga hal yang lebih penting di sini daripada harga utamanya.

Potongan harga berlaku pada hari terjadinya. OrcaRouter meneruskan harga daftar penyedia tanpa markup 0%, jadi ketika vendor mengubah tarif, tarif di sisi kami ikut berubah — tanpa tiket dukungan, tanpa kontrak yang dinegosiasikan ulang, tanpa hubungan penagihan kedua. Itulah alasan keseluruhan potongan bulan Juli layak dituliskan, bukan sekadar dicatat: bagi siapa pun yang memanggil Luna melalui satu API untuk 200+ model, itu sudah berlaku pada hari yang sama.

Alias itu jebakan. Pengenal tanpa akhiran gpt-5.6 mengarah ke tier Sol unggulan, bukan ke Luna, sehingga integrasi apa pun yang menginginkan keekonomian Luna harus mematok gpt-5.6-luna secara eksplisit. Hal ini didokumentasikan dalam panduan developer keluarga ini dan masih menjadi salah satu cara paling umum migrasi "tier murah" secara diam-diam ditagih dengan tarif unggulan.

Tier murah menangani failover dengan baik. Model pada titik harga ini sering mengerjakan pekerjaan yang membuat 503 singkat menjadi mahal — ribuan panggilan klasifikasi, bukan satu completion penting. Merutekan permintaan yang sama ke beberapa penyedia GPT-5.6 Luna dengan failover otomatis adalah perbedaan antara antrean coba ulang dan gangguan layanan, dan itulah fitur yang membuat tier berbiaya rendah aman untuk ditempatkan di jalur produksi.

Anda dapat melihat tarif terkini dan angka p50/p95 waktu-ke-token-pertama di halaman GPT-5.6 Luna di OrcaRouter — layak untuk dilihat, karena halaman harga vendor tertinggal dari pemotongan harga dan pelacak pihak ketiga tertinggal dari keduanya.

Tontonan Berikutnya

Tiga hal akan mengubah ini dari cerita tentang harga menjadi cerita yang berbeda.

Pemotongan lebih lanjut. Liputan keuangan berbahasa Tionghoa pada awal September menggambarkan Open​AI sedang bersiap menyesuaikan kembali harganya untuk menghadapi persaingan open-weight. Laporan itu berorientasi ke depan dan belum dikonfirmasi, tetapi konsisten dengan perusahaan yang telah menerima pengurangan 80% pada tier volumenya dan kini berdebat secara publik tentang biaya per deployment.

Penetapan harga berbasis hasil menjadi nyata. Jika Open​AI mulai menjual Luna berdasarkan hasil bisnis, bukan berdasarkan token, perbandingan per token yang menjadi acuan seluruh pasar ini tidak lagi menjadi papan skor yang relevan — dan setiap perkiraan biaya per tugas, termasuk yang di atas, perlu diturunkan ulang.

Penerus yang mumpuni dengan harga yang sama. GPT-6 Astra sudah ada di atas lini GPT-5.6, dan posisi Luna sendiri bergantung pada Open​AI yang membiarkannya tetap di tempatnya. Begitu tier kecil yang lebih baru hadir dengan harga $0.20/$1.20, pertanyaan yang menarik bukan lagi apakah Luna murah, melainkan apakah ia masih menjadi opsi termurah yang layak dijadikan tujuan perutean.

A summary card for GPT-5.6 Luna listing its July 9, 2026 release date, its current price of $0.20 per million input tokens and $1.20 per million output, its launch price of $1.00 and $6.00, an Artificial Analysis Intelligence Index of 38 ranked 4th of 177, a cost of $0.18 per index task, and Claude Haiku 4.5's comparative figure of $0.21 per index task.

Untuk saat ini, situasinya luar biasa sederhana. GPT-5.6 Luna adalah model berusia dua bulan yang jadi berita adalah harganya, bukan kemampuannya — dan harga token adalah cara paling menyanjung untuk melihatnya, bukan cara yang paling akurat.