Harga API GPT-5.6: Tingkatan Sol, Terra, dan Luna, Biaya Sebenarnya, dan Cara Memanggil Masing-Masing
Guides & Insights

Harga API GPT-5.6: Tingkatan Sol, Terra, dan Luna, Biaya Sebenarnya, dan Cara Memanggil Masing-Masing

Penulis

Fengya Tian

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-5.6 adalah keluarga unggulan OpenAI pada Juli 2026, dan yang penting bagi pengembang adalah harganya tidak tunggal. Tersedia dalam tiga tingkatan—Sol, Terra, dan Luna. Di OpenAI API, Sol berharga $5 per juta token masukan dan $30 per juta token keluaran, Terra $2,50 dan $15, dan Luna $1 dan $6. Setiap tingkatan memiliki diskon masukan yang di-cache, ketiganya menerima masukan gambar serta teks, dan jendela konteksnya sekitar 1,05 juta token dengan hingga 128K token keluaran.

Harga daftar hanyalah awal dari biaya sebenarnya. Tingkat (tier) mana yang benar-benar Anda butuhkan, berapa banyak cache yang Anda miliki, berapa banyak output yang dihasilkan model, dan beberapa aturan harga yang sebagian besar panduan lewatkan—prompt di atas 272K token, kenaikan residensi data, dan tingkat layanan—menentukan tagihan jauh lebih banyak daripada tarif utama. Panduan ini menguraikan harga setiap tingkat, untuk apa tingkat tersebut, bagaimana nilainya, cara migrasi dari GPT-5.5, cara memanggilnya, dan perbandingannya dengan Claude, GLM, Gemini, DeepSeek, dan Grok.

Jawaban cepat: harga GPT-5.6 sekilas

- Tiga tingkatan (per juta token, masukan/keluaran): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.

- Input cache: $0,50 (Sol), $0,25 (Terra), $0,10 (Luna) per juta token; penulisan cache berbiaya 1,25x dari tarif input tanpa cache.

- Posisi: Sol untuk pekerjaan penalaran dan agen yang paling sulit, Terra sebagai default yang seimbang, Luna untuk tugas volume tinggi yang sensitif terhadap biaya.

- Modalitas: multimodal—GPT-5.6 menerima input gambar bersama teks. Konteks ~1,05M token, output maksimal 128K.

- Dua aturan harga yang perlu direncanakan: prompt dengan lebih dari 272K token input ditagih sebesar 2x input dan 1.5x output untuk seluruh permintaan, dan endpoint data-residency menambahkan kenaikan 10%.

- Cara membayar lebih sedikit: Batch diskon 50% dari standar, caching memotong input berulang menjadi sepersepuluh, dan merutekan pekerjaan rutin ke tingkat yang lebih rendah menghindari Sol’s $30 output.

- Intelligence: Artificial Analysis places GPT-5.6 Sol near the top of its Intelligence Index (score 59).

Harga API GPT-5.6, berdasarkan tingkat

OpenAI menetapkan harga GPT-5.6 per juta token, dan biaya output jauh lebih mahal daripada input di setiap tingkatan. Tarif yang dipublikasikan saat ini adalah:

GPT-5.6 Sol: $5.00 masukan, $0.50 masukan ter-cache, $30.00 keluaran (penulisan cache $6.25).

- GPT-5.6 Terra: $2.50 input, $0.25 input cache, $15.00 output.

GPT-5.6 Luna: $1.00 input, $0.10 input cache, $6.00 output.

Dua detail penting sebelum Anda merencanakan anggaran. Pertama, tingkat output mendominasi sebagian besar tagihan riil, terutama untuk pekerjaan penalaran dan agen di mana model menghasilkan jejak panjang, panggilan alat, dan revisi sebelum jawaban akhir. Kedua, tidak ada baris harga "Sol Ultra" terpisah di halaman harga; "Sol Ultra" adalah konfigurasi penalaran yang lebih tinggi dari Sol (pengaturan multi-agen), bukan tingkatan independen—anggarkan di sekitar Sol, Terra, dan Luna.

Apa sebenarnya fungsi setiap tingkatan

Luna: volume tinggi dan sensitif terhadap biaya

Luna adalah tingkat ekonomi dengan biaya $1 untuk input dan $6 untuk output. Ini adalah pilihan default yang tepat untuk klasifikasi, ekstraksi, perutean, perangkuman, penyusunan draf, dan volume besar pekerjaan rutin di mana perbedaan kualitas kecil tidak mengubah hasil. Dengan biaya enam dolar per juta token output, ini cukup murah untuk dijalankan dalam skala besar dan untuk diambil sampelnya secara berulang.

Terra: default yang seimbang

Terra berada di tengah dengan harga $2,50 dan $15. Untuk sebagian besar pekerjaan aplikasi dan coding, ini adalah titik awal yang masuk akal: terlihat lebih kuat daripada Luna pada tugas-tugas yang lebih sulit, tetapi dengan harga output setengah dari Sol. Mulailah di sini, kemudian pindahkan tugas ke Sol hanya ketika Terra secara jelas gagal melakukannya.

Sol: penalaran dan kerja agen tersulit

Sol adalah produk unggulan dengan harga $5 dan $30, dan Artificial Analysis menempatkannya di dekat puncak Intelligence Index-nya. Cadangkan untuk arsitektur yang sulit, debugging yang rumit, agen jangka panjang, dan analisis berisiko tinggi di mana satu kegagalan yang dihindari sebanding dengan premi. Menggunakan Sol untuk pekerjaan rutin adalah cara paling umum untuk mengeluarkan uang berlebihan pada GPT-5.6.

Berasal dari GPT-5.5? Tingkat mana yang paling menghemat?

GPT-5.6 Sol dihargai sama dengan GPT-5.5 yaitu $5 untuk masukan dan $30 untuk keluaran, sehingga memindahkan beban kerja GPT-5.5 langsung ke Sol tidak banyak mengubah tagihan. Penghematannya ada pada dua tingkatan baru yang lebih rendah. Terra memberikan kualitas setara GPT-5.5 pada sebagian besar tugas dengan setengah harga, sehingga migrasi paling sederhana adalah mengirim lalu lintas GPT-5.5 yang ada ke Terra dan hanya menaikkan tugas yang menurun kembali ke Sol.

Rencana migrasi praktis terdiri dari tiga langkah: arahkan kembali panggilan GPT-5.5 ke Terra, jalankan set evaluasi Anda, dan eskalasi hanya kegagalan ke Sol sambil mendorong pekerjaan rutin yang jelas ke Luna. Sebagian besar beban kerja GPT-5.5 menjadi lebih murah dengan cara ini tanpa penurunan kualitas yang dapat Anda ukur.

Bagaimana tingkatan sebenarnya memberikan skor

Price only matters next to capability. On OpenAI’s own Terminal-Bench 2.1 numbers, the tiers separate about as you would expect: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, and Luna 84.7%. For context in the same table, GPT-5.5 scores 85.6%, Claude Opus 4.8 is 78.9%, Claude Fable 5 is 83.1%, and Gemini 3.1 Pro (preview) is 70.7%. Artificial Analysis separately gives Sol an Intelligence Index of 59, near the top of its ranking.

Bacalah ini sebagai laporan vendor dan bersifat indikatif. OpenAI telah menerbitkan sejumlah evaluasi terbatas untuk GPT-5.6 dan tidak, pada saat penulisan, tolok ukur pengkodean dan penalaran tradisional seperti SWE-bench Verified atau GPQA, jadi gunakan skor ini untuk memutuskan apa yang akan diuji pada beban kerja Anda sendiri, bukan sebagai vonis akhir.

Setiap tingkat memiliki kecepatan baca input yang di-cache sebesar sepersepuluh dari kecepatan input segar: $0,50 di Sol, $0,25 di Terra, $0,10 di Luna. Namun, menulis ke cache memerlukan biaya 1,25 kali lipat dari kecepatan input tanpa cache (sekitar $6,25 per juta di Sol), sehingga caching hanya menguntungkan jika prefiks stabil digunakan kembali berkali-kali untuk mendapatkan kembali premi tulis—instruksi sistem, dokumen besar, aturan repositori, atau taksonomi produk. Tempatkan materi stabil di bagian depan prompt dan pertanyaan yang berubah di bagian akhir, serta hindari menyisipkan stempel waktu atau pengidentifikasi acak di depan konteks yang dapat digunakan kembali.

Caching mengurangi biaya input berulang; itu tidak melakukan apa pun untuk output. Karena output adalah sisi yang mahal di setiap tingkatan, dua tuas yang paling memengaruhi tagihan GPT-5.6 adalah menyimpan cache prefiks yang stabil dan mengontrol seberapa banyak model menulis.

Tingkatan mana yang harus kamu pilih?

Jangan memilih tingkatan berdasarkan reputasi. Pilihlah berdasarkan pengujian. Buatlah serangkaian kecil tugas yang representatif dengan kriteria penerimaan yang jelas, jalankan di Luna terlebih dahulu, dan hanya promosikan tugas yang gagal ke Terra, lalu ke Sol. Ukurlah biaya per tugas yang diterima, bukan harga token rata-rata, karena tingkatan yang lebih murah yang membutuhkan tiga percobaan bisa lebih mahal daripada tingkatan yang lebih kuat yang berhasil sekali.

Satu kebiasaan operasional menghemat uang nyata: sematkan ID model tier yang tepat di setiap panggilan alih-alih mengandalkan alias polos, sehingga permintaan rutin tidak pernah berjalan diam-diam di tier termahal. Beban kerja campuran biasanya berujung pada Luna untuk transformasi dan penyusunan rutin, Terra untuk implementasi dan analisis sehari-hari, dan Sol disediakan untuk minoritas yang sulit—sebagian besar permintaan tidak pernah membutuhkan model unggulan sama sekali.

GPT-5.6 vs para pesaing dalam hal harga

GPT-5.6 does not exist in isolation. Read against the current field (per million tokens, input / output, mid-2026): Claude Opus 4.8 is $5 / $25, Claude Fable 5—Anthropic’s strongest public model—is $10 / $50, GLM 5.2 is $1.40 / $4.40 on Z.AI (third-party hosts can be lower), Grok 4.5 is $2 / $6, Google’s Gemini 3.5 Flash is about $1.50 / $9, and DeepSeek V4-Pro is about $0.44 / $0.87. Confirm each on the vendor’s own page, as these move.

Kesimpulannya spesifik. GPT-5.6 Sol menyamai Opus 4.8 pada input tetapi lebih mahal pada output ($30 vs $25), sehingga pada pekerjaan agen yang berat output, Opus sedikit lebih murah per token sementara Sol memimpin Indeks Kecerdasan. Terra mengalahkan harga kedua andalan utama dan menjadi pilihan nilai terbaik dalam keluarga OpenAI. Luna bersaing dengan model yang lebih murah dari segi harga, meskipun Grok 4.5, GLM 5.2, dan terutama DeepSeek berada lebih rendah lagi. Tidak ada satu tingkatan atau vendor yang menang di semua aspek, itulah sebabnya perutean berdasarkan tingkat kesulitan lebih baik daripada berkomitmen pada satu model.

Tagihan bulanan yang telah dikerjakan

Berikan angka-angka padanya. Untuk bulan yang cukup berat dengan 50M token masukan dan 10M token keluaran, pada harga daftar sebelum caching dan penggunaan alat, biaya modelnya kira-kira:

- GPT-5.6 Luna: sekitar $110.

- GPT-5.6 Terra: sekitar $275.

- GPT-5.6 Sol: sekitar $550.

- Sebagai perbandingan: GLM 5.2 sekitar $114, Grok 4.5 sekitar $160, Claude Opus 4.8 sekitar $500, Claude Fable 5 sekitar $1,000.

Tugas yang sama dirutekan secara cerdas—Luna dan Terra untuk sebagian besar, Sol untuk minoritas yang sulit—jatuh jauh lebih dekat ke kisaran $110–$275 daripada ke flat $550 dari Sol-for-everything. Kesenjangan itu, jika dikalikan selama setahun, adalah seluruh argumen untuk perutean berbasis tingkat.

Biaya tersembunyi yang perlu direncanakan

Beberapa aturan penetapan harga tidak muncul dalam tarif utama dan mengejutkan tim kemudian:

- Permintaan panjang: permintaan dengan lebih dari 272K token input dikenakan biaya 2x input dan 1.5x output untuk seluruh permintaan, sehingga panggilan konteks besar dan big-RAG dapat lebih dari dua kali lipat biayanya.

Volume keluaran: keluaran bisa mencapai enam kali lipat laju masukan, sehingga keluaran tanpa batas atau dengan penalaran tinggi merupakan risiko pengeluaran berlebih yang utama.

- Tingkat layanan: Pemrosesan prioritas kira-kira dua kali lipat tarif standar (sekitar $10 input / $60 output di Sol); Flex dan Batch lebih murah. Pilih tingkat dengan sengaja melalui pengaturan service_tier.

- Residensi data: titik akhir pemrosesan regional menambahkan kenaikan 10% untuk model yang dirilis pada atau setelah 5 Maret 2026, yang mencakup GPT-5.6.

- Perulangan dan percobaan ulang agen: instruksi, alat, dan riwayat dikirim ulang setiap giliran, dan permintaan panjang yang gagal membuang input yang sudah Anda bayar.

- Pergeseran tingkat: meninggalkan semuanya di Sol "untuk aman" adalah kebiasaan yang paling mahal.

Cara membayar lebih sedikit

Tiga tuas memotong tagihan GPT-5.6 tanpa mengubah apa yang Anda bangun. Batch: permintaan asinkron melalui tingkat Batch mendapat diskon 50% dari harga standar, ideal untuk pekerjaan Luna volume tinggi yang tidak sensitif terhadap latensi. Caching: gunakan kembali prefiks stabil cukup sering untuk mengalahkan premi tulis 1,25x dan input berulang turun menjadi sepersepuluh. Routing: kirim pekerjaan rutin ke Luna atau Terra dan eskalasi hanya minoritas sulit ke Sol, dan jaga prompt di bawah ambang 272K jika memungkinkan.

Cara memanggil GPT-5.6

GPT-5.6 tersedia melalui OpenAI API dan melalui gateway yang kompatibel dengan OpenAI, sehingga integrasi tetap stabil saat Anda mengubah model atau tingkat di belakangnya. Berikut adalah pola standar yang kompatibel dengan OpenAI; konfirmasi ID model saat ini sebelum penggunaan produksi, dan tetapkan tingkat yang tepat daripada alias mentah.

from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Refaktor modul ini dan jelaskan risikonya."}],
)
print(response.choices[0].message.content)

Mengubah tingkatan adalah perubahan satu baris pada bidang model, yang membuat perutean berbasis kesulitan menjadi praktis: kirim panggilan rutin ke Luna atau Terra dan tingkatkan hanya yang sulit ke Sol.

Menguji GPT-5.6 melalui OrcaRouter

Sebuah gateway membuat GPT-5.6 lebih mudah diadopsi karena dua alasan. Pertama, klien yang kompatibel dengan OpenAI yang sama dapat memanggil ketiga tingkatan dan model perbandingan seperti Claude Opus 4.8, GLM 5.2, dan Grok 4.5, sehingga Anda dapat menjalankan satu set evaluasi di seluruhnya tanpa menulis ulang kode integrasi dan mengukur biaya nyata per tugas yang diterima—biaya alat, percobaan ulang, dan biaya tambahan 272K termasuk. Kedua, gateway dapat melakukan failover antar penyedia dan menerapkan batas anggaran, sehingga masalah kapasitas sementara atau panggilan Sol yang menyimpang tidak menghabiskan bulan ini. Konfirmasi rute GPT-5.6 langsung dan ID tingkatan saat ini sebelum Anda membangun anggaran berdasarkan mereka.

Langkah selanjutnya: Daftar untuk OrcaRouter dan jalankan perbandingan tingkatan GPT-5.6 Anda sendiri di satu titik akhir API.

FAQ

Apa perbedaan antara GPT-5.6 Sol, Terra, dan Luna?

Mereka adalah tiga tingkatan dari keluarga yang sama dengan harga dan tingkat kemampuan yang berbeda. Sol adalah andalan untuk pekerjaan terberat ($5/$30), Terra adalah default yang seimbang ($2.50/$15), dan Luna adalah tingkatan ekonomi untuk tugas volume tinggi ($1/$6). Pilih yang terendah yang lulus tes Anda.

Apakah ada tingkat harga GPT-5.6 Sol Ultra?

Tidak. "Sol Ultra" adalah konfigurasi multi-agen dengan penalaran tingkat tinggi dari Sol, bukan baris terpisah di harga halaman. Ia menggunakan lebih banyak token dan lebih mahal per tugas, tetapi Anda menganggarkannya sebagai Sol dengan upaya yang lebih tinggi.

Mengapa tagihan GPT-5.6 saya melebihi perkiraan sederhana?

Biasanya token keluaran, biaya tambahan long-prompt 272K (2x input, 1.5x output), tingkat layanan Prioritas, peningkatan residensi data, atau percobaan ulang. Catat seluruh rantai permintaan dan ukur biaya per tugas yang diterima, bukan per prompt.

Bisakah saya melakukan fine-tuning pada GPT-5.6, dan apakah ada tingkat gratis?

Tidak untuk keduanya. GPT-5.6 tidak mendukung fine-tuning, dan API tidak memiliki tingkat gratis—penagihan dimulai sejak token pertama. Akses gratis hanya ada di dalam paket ChatGPT tertentu, yang merupakan produk terpisah dari API.

Paket ChatGPT mana yang bisa menggunakan tingkatan yang mana?

Ini bervariasi tergantung produk. Di ChatGPT Work dan Codex, Free dan Go dapat menggunakan Terra, sementara Plus dan di atasnya bisa memilih antara Sol, Terra, dan Luna; pengaturan ultra tertinggi terbatas untuk Pro dan Enterprise. Perlakukan paket API dan ChatGPT secara terpisah—kunci API tidak mewarisi akses langganan.

Intinya

Kisah penetapan harga GPT-5.6 adalah tingkatan. Sol dengan harga $5/$30 memimpin peringkat kecerdasan, Terra dengan harga $2.50/$15 adalah nilai default dan rumah alami untuk lalu lintas GPT-5.5 sebelumnya, dan Luna dengan harga $1/$6 menangani volume. Caching memotong input berulang menjadi sepersepuluh (setelah premi tulis 1.25x), Batch setengah harga, tetapi output adalah sisi mahal di setiap tingkatan dan prompt panjang di atas 272K dikenakan biaya tambahan.

Perlakukan tiga tingkatan tersebut sebagai masalah perutean, bukan pembelian tunggal: default rendah, eskalasi saat gagal, cache konteks stabil, gunakan Batch jika latensi memungkinkan, dan pertahankan model perbandingan yang dapat dijangkau melalui endpoint yang sama. Itu menghasilkan biaya per tugas yang diterima jauh lebih rendah daripada membayar tarif flagship untuk pekerjaan rutin.


© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube