Ilustrasi vektor datar editorial untuk hero blog teknologi tentang harga model unggulan: chip model besar dengan sudut membulat berwarna biru tua dengan cahaya cyan lembut di latar belakang terang, label harga kertas yang ditempelkan di sudutnya, tiga aliran token yang mengalir keluar dari chip ke dalam pengukur harga melingkar dengan lekukan abstrak kecil, tumpukan kecil blok cache di samping pengukur, dan lembar kalender tipis yang meluncur masuk dari kiri. Latar belakang putih dengan aksen gradasi biru dan cyan lembut serta satu sorotan hangat halus; ikon garis datar minimalis; tipografi sans-serif geometris modern yang bersih; tanpa teks yang dapat dibaca.
Guides & Insights

Harga API GPT-5.6 Sol: $4 / $20 per 1 Juta Token Setelah Pemotongan Harga

Penulis

Gideon Frost

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-5.6 Sol berharga $4.00 per juta token masukan dan $20.00 per juta token keluaran pada API GPT-5.6 Sol per hari ini — tarif pass-through yang sama dengan yang berlaku untuk tier flagship di direktori OrcaRouter, dicek pada 2026-08-25 tanpa markup. Pada 24 Agustus 2026, OpenAI memotong harga API Sol sebesar 20% untuk input dan sekitar 33% untuk output, sebuah promosi sementara yang berlangsung setidaknya hingga 21 November 2026. Ini masih merupakan tier termahal dalam keluarga GPT-5.6, dan merupakan tier pertama yang harga daftarnya berubah sejak pemotongan 30 Juli yang tidak menyentuh flagship. Pengungkit harga lebih penting daripada tajuknya: input yang dipakai ulang ditagih $0.40 per juta via prompt caching, API batch turun menjadi $2.00 / $10.00, dan mode cepat menukar premi 2x dengan kecepatan hingga 2.5x. Halaman ini adalah referensi harga khusus untuk Sol — kartu tarif yang tepat, berapa biaya sebenarnya dari sebuah permintaan, bagaimana flagship dibandingkan dengan yang lain, kapan ia bukan pilihan yang tepat, dan cara memanggilnya melalui satu endpoint yang kompatibel dengan OpenAI menggunakan kunci Anda sendiri.

Harga per juta token (input / output), per 2026-08-25. Pemotongan — 20% untuk input, kira-kira 33% untuk output, berlaku setidaknya hingga 21 November 2026 — adalah pengumuman OpenAI sendiri, dilaporkan sebagaimana adanya; angka dolar dibaca dari tarif API yang dipublikasikan OpenAI dan diperiksa silang dengan halaman model OrcaRouter untuk GPT-5.6 Sol. Tarif cache, batch, mode cepat, dan konteks panjang diumumkan oleh OpenAI. Ini adalah tarif promosi, bukan pengaturan ulang permanen — harga bisa berubah, dan bisa berubah kembali; verifikasi sebelum Anda membangun.

Harga pastinya, terverifikasi hari ini.

Berikut adalah kartu tarif lengkap untuk GPT-5.6 Sol, diverifikasi 2026-08-25 dengan tarif promosi. Tarif yang sama berlaku untuk permintaan yang menggunakan alias gpt-5.6, dan pemotongan ini diluncurkan secara bertahap ke paket kredit ChatGPT Work dan Codex yang memenuhi syarat; langganan ChatGPT Pro, Plus, dan Business tidak berubah.

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

• Input — $4.00 per 1M token pada cache miss (turun dari $5.00, diskon 20% hingga 21 November).

• Output — $20.00 per 1M token (turun dari $30.00, diskon ~33% hingga 21 November).

• Pembacaan cache prompt — $0,40 per 1 juta token (sebelumnya $0,50), diskon 90% untuk input apa pun yang Anda kirim ulang.

• Penulisan cache prompt — $5.00 per 1M token (sebelumnya $6.25).

• Tier konteks panjang — input yang melebihi sekitar 272K token dikenakan biaya $8.00 per input / $30.00 per output (sebelumnya $10.00 / $45.00; pengali yang sama 2x input, 1.5x output sekarang berlaku dari basis yang lebih rendah).

• Batch API — $2.00 input / $10.00 output, diskon tetap 50% (harga sebelumnya $2.50 / $15.00), asinkron, biasanya siap dalam waktu sekitar 24 jam.

• Mode Cepat — $8.00 input / $40.00 output (sebelumnya $10.00 / $60.00), premium 2x lipat untuk kecepatan output hingga sekitar 2.5x tanpa perubahan dalam kecerdasan.

• Jendela konteks — ~1,05M token, hingga output 128K.

OrcaRouter meneruskan tarif penyedia tanpa markup, sehingga angka di direktori adalah angka yang Anda bayar — dan potongan vendor muncul di listing pada hari yang sama saat berlaku. Di halaman model langsung, kartu menunjukkan $4.00 / $20.00 per 1M, cache read $0.400, dengan lencana Vision, Tools, JSON dan Reasoning. Ini adalah pertama kalinya harga daftar Sol bergerak sejak penurunan 30 Juli, yang membawa GPT-5.6 Luna menjadi $0.20 / $1.20 dan GPT-5.6 Terra menjadi $2 / $12 sementara flagship tetap; penurunan 24 Agustus adalah giliran flagship.

Tuas yang mengubah harga efektif

Tarif dasar hanyalah titik awal. Empat pengubah mengubah berapa biaya Sol yang sebenarnya Anda keluarkan.

• Caching prompt — konteks yang digunakan ulang dikenai biaya $0,40 per juta, bukan $4 untuk yang baru, dan penulisan cache dikenai biaya $5,00 per juta. Untuk agen atau obrolan apa pun yang mengirim ulang prefiks besar di setiap giliran, caching adalah tuas terbesar pada tagihan. OpenAI mengunci cache per proyek dan kunci API, jadi tetap pada satu kunci (satu saluran) itulah yang membuat cache hits tetap terjadi.

• Tingkat konteks panjang — permintaan yang inputnya melewati sekitar 272K token berpindah dari tarif dasar menjadi $8 / $30. Beberapa prompt yang sangat besar dapat diam-diam menaikkan harga rata-rata Anda, jadi lakukan batch atau truncate saat Anda tidak benar-benar membutuhkan konteks yang dalam.

• Batch — API batch OpenAI menjalankan pekerjaan secara asinkron dengan waktu proses sekitar 24 jam dengan harga tepat setengahnya: $2.00 / $10.00, dengan input cache sebesar $0.20 dan penulisan cache sebesar $2.50. Ini dapat digabungkan dengan prompt caching dan cocok untuk eval, klasifikasi massal, dan pembuatan offline yang tidak mementingkan latensi.

• Mode Cepat — $8 / $40 untuk throughput output hingga ~2,5x, berguna untuk pekerjaan yang kritis terhadap latensi dan menunggu pengguna seperti bantuan pengodean langsung. Ditagih per token sebesar 2x tarif standar, tidak dihitung ke paket TPM Scale Tier yang dibeli, dan dapat kembali ke pemrosesan standar jika Anda melonjak melewati batas rate limit bersama.

Berapa biaya sebenarnya dari sebuah permintaan

Harga per token bersifat abstrak, jadi berikut adalah contoh perhitungan dengan tarif saat ini:

• Satu panggilan chat, 50K input + 20K output — $0,20 + $0,40 = $0,60 (sebelumnya $0,85).

• 1M masukan + 1M keluaran — $4 + $20 = $24 (sebelumnya $35).

• Giliran agen, 200K konteks cache + 20K input baru + 30K output — $0.08 + $0.08 + $0.60 = $0.76. Giliran yang sama dengan cache dingin — 220K input baru sebesar $0.88 ditambah output $0.60 — total $1.48. Caching kira-kira mengurangi setengahnya.

• Bulan 10M token dengan pembagian 70% input / 30% output, dengan 80% input dilayani dari cache: 1.4M input baru ($5.60) + 5.6M cache ($2.24) + 3M output ($60) ≈ $68. Tanpa cache, bulan yang sama adalah $88 — dan bulan yang sama pada GPT-5.6 Terra sekitar $50, atau sekitar $5 pada GPT-5.6 Luna. Selisih ~14x antara Sol dan Luna itulah mengapa pencocokan tier lebih penting daripada tarif tunggal mana pun.

Dua peringatan menaikkan tarif efektif. Sol adalah model penalaran — token penalaran internal ditagih sebagai output sebesar $20 per juta. Prompt yang sulit dengan pengaturan upaya penalaran tinggi dapat menghabiskan sebagian besar anggaran outputnya untuk berpikir, sehingga biaya output efektif untuk pekerjaan sulit jauh melampaui perkiraan naif. Dan tokenizer OpenAI lebih boros kata daripada generasi sebelumnya pada beberapa input, sehingga teks yang sama dapat memakan lebih banyak token daripada di GPT-5.5. Sesuaikan upaya penalaran dengan tugas, batasi output jika memungkinkan, dan ukur penggunaan aktual sebelum memproyeksikan tagihan.

Bagaimana harga Sol dibandingkan dengan para pesaingnya

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Jika dibandingkan dengan harga daftar publik pada 2026-08-25 (Sol pada tarif promosinya). Liputan pers menafsirkan pemotongan ini sebagai respons terhadap tekanan harga dari Anthropic dan laboratorium Tiongkok — itu adalah interpretasi pihak ketiga, bukan pernyataan OpenAI.

• GPT-5.6 Terra — $2 / $12, tingkat menengah setelah pemotongan harga. Sol sekarang biaya masuknya 2x lebih mahal dan keluarannya ~1.7x lebih mahal; Terra adalah default ketika Anda tidak memerlukan penalaran flagship.

• GPT-5.6 Luna — $0,20 / $1,20, tingkat volume pasca-pemotongan. Selisih input 20x dibandingkan Sol; Luna dibanderol untuk mayoritas lalu lintas yang mudah.

• Claude Opus 5 — $5 / $25. Sol kini 20% lebih murah untuk input dan output di atas kertas, dibandingkan dengan yang menyamai Opus 5 pada input dengan tarif lama. Perbandingan ini sudah memihak Sol sebelum pemotongan: blog ini sebelumnya mengukur Sol dengan sekitar 34,5% lebih sedikit token daripada model Anthropic pada sampel bahasa Inggris/campuran yang sama, dan analisis ekonomi token yang dipublikasikan (TheBlockBeats) memperkirakan total tagihan Sol bisa sekitar 21% lebih rendah daripada Claude Opus 5 untuk pekerjaan yang setara bahkan ketika tarif output Sol lebih tinggi. Ukur tokenizer Anda sendiri, bukan harga yang tertera.

• Claude Fable 5 — $10 / $50. Sol kini 60% lebih murah untuk input dan 60% lebih murah untuk output dibandingkan tier tertinggi Anthropic (sebelumnya 50% / 40% pada tarif lama).

• Claude Opus 4.8 — $5 / $25. Sol kini 20% lebih murah untuk input dan 20% lebih murah untuk output — keunggulan harga dibandingkan andalan Anthropic generasi sebelumnya telah sepenuhnya berbalik.

• Grok 4.6 — $2 / $6. Angka paling tajam di papan: ia menyamai GPT-5.6 Sol pada indeks Artificial Analysis (keduanya 61) dengan input lebih murah 2x dan output lebih murah ~3.3x, turun dari selisih 2.5x / 5x pada tarif lama.

• DeepSeek V4 Pro — $0.44 / $0.88 di luar jam sibuk (pada jam sibuk menjadi dua kali lipat). Dunia harga yang sama sekali berbeda, untuk jalur open-weights yang murah.

Penggambaran yang jujur: Sol masih merupakan flagship premium, tetapi pemotongan harga mengeluarkannya dari kelompok harga teratas — output $20 sekarang lebih murah daripada $25 milik Claude Opus 5 dan $25 milik Claude Opus 4.8, menjadikan $50 milik Claude Fable 5 sebagai satu-satunya tarif output flagship tertutup di atasnya. Ia menang pada biaya efektif per unit kerja keras (tokenizer-nya, penalarannya, konteks panjangnya) daripada pada tarif absolut, dan pemotongan 24 Agustus memperkuat argumen tersebut. Jika lalu lintas Anda adalah prompt pendek dan tugas sederhana, Terra $2, Luna $0,20, atau Grok 4.6 $2 / $6 masih menjadi pilihan yang lebih murah — dan pada indeks, Grok 4.6 tidak kalah sama sekali di atas kertas.

Ketika Sol adalah pilihan yang salah.

Empat kasus di mana harga ini bukan yang Anda inginkan:

Perintah singkat dan sederhana. Di bawah sekitar 20K token tanpa penalaran mendalam, model premium unggulan menjadi sia-sia. GPT-5.6 Terra dengan harga $2 / $12 atau GPT-5.6 Luna dengan harga $0.20 / $1.20 menangani tingkatan volume dengan biaya yang jauh lebih rendah, dan model kelas Grok 4.6 atau DeepSeek berbiaya lebih murah lagi.

Volume yang sarat penalaran. Karena pemikiran ditagih sebagai output, prompt yang sulit dengan upaya tinggi dapat memakan biaya jauh di atas garis output nominal. Jika beban kerja Anda mencakup banyak panggilan yang sulit, ukur token output aktual sebelum berkomitmen — tarif efektifnya dapat mengejutkan Anda.

Harga per token sebagai satu-satunya tujuan. Grok 4.6 menyamai Sol pada indeks dengan harga $2 / $6, dan DeepSeek V4 Pro berada di $0.44 / $0.88 di luar jam sibuk. Jika skor tolok ukur frontier bukan persyaratan mutlak, model-model tersebut menawarkan tarif per token yang jauh lebih rendah untuk kelas pekerjaan yang sama.

Anggaran latensi yang ketat. Sol adalah model penalaran besar, sehingga waktu hingga token pertama jauh di atas model kelas Flash. Untuk obrolan real-time yang membutuhkan TTFT di bawah satu detik, mode cepat dengan harga $8 / $40 memberikan throughput, bukan latensi token pertama yang lebih rendah — dan model yang lebih kecil tetap menjadi solusi yang lebih murah.

Cara memanggilnya di OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol di-hosting di OrcaRouter sebagai ID model openai/gpt-5.6-sol, dilayani melalui endpoint yang kompatibel dengan OpenAI di api.orcarouter.ai/v1 dengan tarif penyedia tanpa markup. Jika Anda sudah memiliki klien OpenAI, migrasinya hanya perubahan URL dasar dan ID model — tidak ada yang lain. Kunci dan endpoint yang sama mendukung 200+ model, sehingga Sol berada di samping GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6, dan model open-weight yang ingin Anda bandingkan dengannya, dan Anda dapat merutekan berdasarkan tingkat kesulitan alih-alih mengintegrasikan ulang masing-masing model.

Dua detail spesifik OrcaRouter yang layak disebutkan di halaman harga. BYOK: bawa kunci OpenAI Anda sendiri dan OpenAI menagih Anda langsung dengan tarifnya sendiri — OrcaRouter menambahkan $0 per token dan menjaga batas permintaan serta kredit penyedia Anda tetap utuh. Guardrails: PII Shield dan kebijakan konten berjalan sebelum penagihan, sehingga permintaan yang diblokir mengembalikan 400 yang bersih dan tidak pernah dikenakan biaya, serta Agent Firewall menilai panggilan tool dan MCP sebelum dieksekusi.

Catatan kejujuran yang penting untuk halaman harga: kami merutekan model, kami tidak menetapkan harganya. Angka $4 / $20 adalah tarif promosi OpenAI yang diteruskan — dan ketika OpenAI mengubahnya pada 24 Agustus, daftar harga mengikuti pada hari yang sama, dan itulah alasan halaman ini diberi cap tanggal. Jika Anda menghubungi OpenAI secara langsung, Anda mendapatkan tarif yang sama; OrcaRouter hadir untuk jalur satu-kunci tanpa markup jika Anda menginginkan satu endpoint di seluruh lini model.

Sumber dan tanggal

Semua harga di atas diverifikasi pada 25 Agustus 2026. Angka GPT-5.6 Sol diambil dari harga API yang dipublikasikan OpenAI, diperiksa silang dengan halaman model OrcaRouter untuk GPT-5.6 Sol (diperiksa pada hari yang sama) dan liputan pers tentang pemotongan harga 24 Agustus (Indian Express, Economic Times, The Star); tarif batch, mode cepat, cache-write, dan konteks panjang diumumkan oleh OpenAI. Angka Claude, Grok, dan DeepSeek adalah daftar direktori OrcaRouter saat ini, dengan DeepSeek V4 Pro ditampilkan pada tarif di luar jam sibuk. Harga daftar Sol tidak berubah sejak peluncurannya pada 9 Juli hingga pemotongan 30 Juli dan baru berubah untuk pertama kalinya pada 24 Agustus dengan promosi ini — itulah sebabnya tanggal menjadi penting di sini: tarif $4 / $20 bersifat sementara, dan harga bisa berubah; perlakukan halaman "harga GPT-5.6 Sol" mana pun yang Anda temukan, baik yang lebih awal maupun lebih baru, dengan memeriksa tanggalnya. Angka-angka di sini berlaku hingga hari ini.

Setiap harga di atas adalah tarif langsung untuk GPT-5.6 Sol di OrcaRouter — dicek pada 2026-08-25 tanpa markup, siap untuk kunci Anda sendiri.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari