
Harga GPT-5.6 Sol API: $5 / $30 per 1M Token, Cache $0.50, dan Berapa Biaya Sebenarnya
- DeepSeekBARUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiBARUZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianBARUQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenBARUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekBARUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokBARUSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Kecerdasan77Koding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Kecerdasan77Koding
GPT-5.6 Sol berharga $5,00 per juta token input dan $30,00 per juta token output pada API GPT-5.6 Sol — tarif yang sama dengan yang dibawa tier unggulan di direktori OrcaRouter, diverifikasi pada 2026-08-18, tanpa markup. Ini adalah tier termahal dalam keluarga GPT-5.6 dan satu-satunya yang harga daftarnya tidak berubah dalam pemotongan 30 Juli, jadi kartu tarif di halaman model GPT-5.6 Sol langsung adalah acuan untuk menyusun anggaran. Tuas pengatur lebih penting daripada angka utamanya: input yang digunakan ulang ditagih $0,50 per juta melalui prompt caching, API batch turun menjadi $2,50 / $15,00, dan mode cepat menukar premi 2x dengan kecepatan hingga 2,5x. Halaman ini adalah referensi harga khusus untuk Sol — kartu tarif yang tepat, biaya sebenarnya dari sebuah permintaan, bagaimana tier unggulan dibandingkan dengan yang lain, kapan ia bukan pilihan yang tepat, dan cara memanggilnya melalui satu endpoint yang kompatibel dengan OpenAI menggunakan kunci Anda sendiri.
Harga adalah per juta token (input / output), per 2026-08-18. Angka dolar dibaca dari tarif API yang dipublikasikan OpenAI dan diperiksa silang dengan halaman model OrcaRouter untuk GPT-5.6 Sol; tarif cache, batch, mode cepat, dan konteks panjang diumumkan oleh OpenAI. Harga berubah — verifikasi sebelum Anda membangun.
Harga pastinya, terverifikasi hari ini.
Berikut adalah kartu tarif lengkap untuk GPT-5.6 Sol, diverifikasi 2026-08-18:

• Input — $5.00 per 1M token saat cache miss.
• Output — $30.00 per 1M token.
• Pembacaan cache prompt — $0,50 per 1M token, diskon 90% untuk input apa pun yang Anda kirim ulang.
• Penulisan cache prompt — $6,25 per 1 juta token.
• Tingkat konteks panjang — input di atas sekitar 272K token dikenai biaya $10.00 per input / $45.00 per output (2x input, 1.5x output).
• Batch API — $2.50 input / $15.00 output, diskon tetap 50%, asinkron, biasanya siap dalam sekitar 24 jam.
• Mode cepat — $10.00 input / $60.00 output, premium 2x untuk kecepatan output hingga sekitar 2.5x tanpa perubahan kecerdasan.
• Jendela konteks — ~1,05M token, hingga output 128K.
OrcaRouter meneruskan tarif penyedia tanpa markup, sehingga angka di direktori adalah angka yang Anda bayar. Di halaman model langsung, kartu menampilkan $5.00 / $30.00 per 1M, pembacaan cache $0.500, dengan lencana Vision, Tools, JSON, dan Reasoning. Harga $5 / $30 dari Sol juga merupakan harga sebelum dipotong: pengurangan OpenAI pada 30 Juli berlaku untuk GPT-5.6 Luna (sekarang $0.20 / $1.20) dan GPT-5.6 Terra (sekarang $2 / $12), sementara model unggulannya tetap.
Tuas yang mengubah harga efektif
Tarif dasar hanyalah titik awal. Empat pengubah mengubah berapa biaya Sol yang sebenarnya Anda keluarkan.
• Caching prompt — konteks yang digunakan kembali ditagih $0,50 per juta, bukan $5 untuk konteks baru, dan penulisan cache berbiaya $6,25 per juta. Untuk agen atau percakapan apa pun yang mengirim ulang prefiks besar di setiap giliran, caching adalah pengungkit terbesar pada tagihan. OpenAI menggunakan proyek dan kunci API sebagai kunci cache, jadi tetap menggunakan satu kunci (satu saluran) adalah yang membuat cache hit terus terjadi.
• Tingkatan konteks panjang — permintaan yang masukannya melewati sekitar 272K token berpindah dari tarif dasar menjadi $10 / $45. Beberapa prompt besar dapat diam-diam menaikkan harga rata-rata Anda, jadi buat batch atau potong jika Anda tidak benar-benar membutuhkan konteks yang dalam.
• Batch — API batch OpenAI menjalankan tugas secara asinkron dengan waktu pengerjaan sekitar 24 jam dengan harga tepat setengahnya: $2.50 / $15.00, dengan input cache sebesar $0.25 dan penulisan cache sebesar $3.13. Fitur ini dapat digabungkan dengan caching prompt dan cocok untuk evaluasi, klasifikasi massal, serta pembuatan offline yang tidak bergantung pada latensi.
• Mode Cepat — $10 / $60 untuk hingga ~2,5x throughput keluaran, berguna untuk pekerjaan yang sensitif terhadap latensi dan membuat pengguna menunggu seperti bantuan pengodean langsung. Biayanya dihitung per token sebesar 2x tarif standar, tidak dihitung ke paket TPM Scale Tier yang dibeli, dan dapat kembali ke pemrosesan standar jika Anda melonjak melewati batas tarif bersama.
Berapa biaya sebenarnya dari sebuah permintaan
Harga per token bersifat abstrak, jadi berikut adalah contoh perhitungan dengan tarif saat ini:
• Satu panggilan chat, 50K input + 20K output — $0.25 + $0.60 = $0.85.
• 1M masukan + 1M keluaran — $5 + $30 = $35.
• Giliran agentik, 200K konteks cache + 20K input baru + 30K output — $0.10 + $0.10 + $0.90 = $1.10. Giliran yang sama dengan cache dingin — 220K input baru seharga $1.10 — totalnya $2.00. Caching hampir memangkasnya hingga setengah.
• Sebulan 10M token dengan pembagian 70% input / 30% output, dengan 80% input dilayani dari cache: 1.4M input baru ($7.00) + 5.6M dari cache ($2.80) + 3M output ($90) ≈ $100. Tanpa cache, bulan yang sama adalah $125 — dan bulan yang sama pada GPT-5.6 Terra sekitar $50, atau sekitar $5 pada GPT-5.6 Luna. Selisih 20x antara Sol dan Luna inilah mengapa pencocokan tingkat lebih penting daripada tarif tunggal mana pun.
Dua peringatan menaikkan tarif efektif. Sol adalah model penalaran — token penalaran internal ditagih sebagai output sebesar $30 per juta. Prompt yang sulit dengan pengaturan upaya penalaran tinggi dapat menghabiskan sebagian besar anggaran outputnya untuk berpikir, sehingga biaya output efektif pada pekerjaan sulit jauh di atas perkiraan naif. Dan tokenizer OpenAI lebih verbose daripada generasi sebelumnya pada beberapa input, sehingga teks yang sama dapat memakan lebih banyak token daripada di GPT-5.5. Sesuaikan upaya penalaran dengan tugas, batasi output jika memungkinkan, dan ukur penggunaan aktual sebelum memproyeksikan tagihan.
Bagaimana harga Sol dibandingkan dengan para pesaingnya

Dibaca terhadap harga daftar yang diterbitkan pada 2026-08-18:
• GPT-5.6 Terra — $2 / $12, tingkat menengah pasca-pemotongan. Sol membutuhkan biaya 2,5x lebih banyak untuk input dan output; Terra adalah pilihan default saat Anda tidak memerlukan penalaran unggulan.
• GPT-5.6 Luna — $0.20 / $1.20, tingkatan volume pasca-pemotongan. Kesenjangan input 25x terhadap Sol; Luna dibanderol untuk mayoritas besar lalu lintas.
• Claude Opus 5 — $5 / $25. Input sama, output 20% lebih murah di atas kertas. Dalam praktiknya, perbandingan berbalik untuk sebagian beban kerja: blog ini sebelumnya mengukur Sol menghasilkan sekitar 34,5% lebih sedikit token daripada model Anthropic pada sampel bahasa Inggris/campuran yang sama, dan analisis ekonomi token yang diterbitkan (TheBlockBeats) memperkirakan total tagihan Sol bisa sekitar 21% lebih rendah daripada Claude Opus 5 untuk pekerjaan yang setara meskipun tarif outputnya lebih tinggi. Ukur tokenizer Anda sendiri, bukan harga yang tertera.
• Claude Fable 5 — $10 / $50. Sol adalah setengah dari harga input dan 40% lebih murah pada output dibandingkan tingkat teratas Anthropic.
• Claude Opus 4.8 — $5 / $25. Input sama dengan Sol, output lebih murah — produk unggulan Anthropic generasi sebelumnya.
• Grok 4.6 — $2 / $6. Angka paling tajam di papan: ia menyamai GPT-5.6 Sol pada indeks Artificial Analysis (keduanya 61) dengan input 2,5x lebih murah dan output 5x lebih murah.
• DeepSeek V4 Pro — $0.44 / $0.88 di luar jam sibuk (pada jam sibuk menjadi dua kali lipat). Dunia harga yang sama sekali berbeda, untuk jalur open-weights yang murah.
Framing yang jujur: Sol adalah flagship premium dengan tingkat output premium — tingkat output tertinggi di antara flagship tertutup di bawah Claude Fable 5. Ia menang pada biaya efektif per unit kerja keras (tokenizer-nya, penalarannya, konteks panjangnya) daripada pada tingkat absolut. Jika lalu lintas Anda berupa prompt pendek dan tugas sederhana, Terra seharga $2, Luna seharga $0.20, atau Grok 4.6 seharga $2 / $6 adalah pilihan yang lebih murah — dan di indeks, Grok 4.6 tidak kalah di atas kertas.
Ketika Sol adalah pilihan yang salah.
Empat kasus di mana harga ini bukan yang Anda inginkan:
Perintah singkat dan sederhana. Di bawah sekitar 20K token tanpa penalaran mendalam, model premium unggulan menjadi sia-sia. GPT-5.6 Terra dengan harga $2 / $12 atau GPT-5.6 Luna dengan harga $0.20 / $1.20 menangani tingkatan volume dengan biaya yang jauh lebih rendah, dan model kelas Grok 4.6 atau DeepSeek berbiaya lebih murah lagi.
Volume yang sarat penalaran. Karena pemikiran ditagih sebagai output, prompt yang sulit dengan upaya tinggi dapat memakan biaya jauh di atas garis output nominal. Jika beban kerja Anda mencakup banyak panggilan yang sulit, ukur token output aktual sebelum berkomitmen — tarif efektifnya dapat mengejutkan Anda.
Harga per token sebagai satu-satunya tujuan. Grok 4.6 menyamai Sol pada indeks dengan harga $2 / $6, dan DeepSeek V4 Pro berada di $0.44 / $0.88 di luar jam sibuk. Jika skor tolok ukur frontier bukan persyaratan mutlak, model-model tersebut menawarkan tarif per token yang jauh lebih rendah untuk kelas pekerjaan yang sama.
Anggaran latensi yang ketat.Sol adalah model penalaran besar, sehingga waktu hingga token pertama jauh di atas model tingkat Flash. Untuk obrolan real-time yang mementingkan TTFT di bawah satu detik, mode cepat seharga $10 / $60 memberikan throughput, bukan latensi token pertama yang lebih rendah — dan model yang lebih kecil tetap menjadi solusi yang lebih murah.
Cara memanggilnya di OrcaRouter

GPT-5.6 Sol di-hosting di OrcaRouter sebagai ID model openai/gpt-5.6-sol, dilayani melalui endpoint yang kompatibel dengan OpenAI di api.orcarouter.ai/v1 dengan tarif penyedia tanpa markup. Jika Anda sudah memiliki klien OpenAI, migrasinya hanya perubahan URL dasar dan ID model — tidak ada yang lain. Kunci dan endpoint yang sama mendukung 200+ model, sehingga Sol berada di samping GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6, dan model open-weight yang ingin Anda bandingkan dengannya, dan Anda dapat merutekan berdasarkan tingkat kesulitan alih-alih mengintegrasikan ulang masing-masing model.
Dua detail spesifik OrcaRouter yang layak disebutkan di halaman harga. BYOK: bawa kunci OpenAI Anda sendiri dan OpenAI menagih Anda langsung dengan tarifnya sendiri — OrcaRouter menambahkan $0 per token dan menjaga batas permintaan serta kredit penyedia Anda tetap utuh. Guardrails: PII Shield dan kebijakan konten berjalan sebelum penagihan, sehingga permintaan yang diblokir mengembalikan 400 yang bersih dan tidak pernah dikenakan biaya, serta Agent Firewall menilai panggilan tool dan MCP sebelum dieksekusi.
Catatan kejujuran yang penting untuk halaman harga: kami merutekan model, kami tidak menetapkan harganya. Angka $5 / $30 adalah tarif OpenAI yang diteruskan, dan saat OpenAI mengubahnya, daftar harga ini ikut berubah — justru itulah mengapa halaman ini diberi cap tanggal. Jika Anda memanggil OpenAI secara langsung, Anda mendapat tarif yang sama; OrcaRouter ada untuk rute satu-kunci tanpa markup jika Anda menginginkan satu endpoint untuk seluruh lini model.
Sumber dan tanggal
Semua harga di atas diverifikasi pada 2026-08-18. Angka GPT-5.6 Sol dibaca dari harga API yang dipublikasikan OpenAI dan diperiksa silang dengan halaman model OrcaRouter untuk GPT-5.6 Sol (diperiksa pada hari yang sama) serta halaman harga GPT-5.6 yang kami publikasikan sendiri. Tarif batch, mode cepat, penulisan cache, dan konteks panjang diumumkan oleh OpenAI. Angka Claude, Grok, dan DeepSeek adalah daftar direktori OrcaRouter saat ini, dengan DeepSeek V4 Pro ditampilkan pada tarif di luar jam sibuk (off-peak). OpenAI tidak mengubah harga daftar Sol sejak peluncurannya pada 9 Juli 2026 — pemotongan pada 30 Juli tidak menyentuh model unggulan tersebut — tetapi harga bisa berubah; perlakukan halaman "GPT-5.6 Sol pricing" lama mana pun yang Anda temukan dengan tanggal pemeriksaannya. Angka-angka di sini berlaku per hari ini.
Setiap harga di atas adalah kurs langsung di GPT-5.6 Sol on OrcaRouter — diperiksa pada 2026-08-18 tanpa markup, siap untuk kunci Anda sendiri.
Dibandingkan dalam artikel ini3
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
