Kartu judul untuk panduan API GPT-5.6 Sol, menampilkan kartu gerbang dengan sudut membulat berisi chip kode bertuliskan model: gpt-5.6-sol, label harga bertuliskan $5 / $30 per 1M token, kenop berlabel Reasoning effort dengan enam posisi, serta empat chip model berlabel GPT, Claude, Gemini, dan Qwen yang terhubung oleh garis-garis tipis menuju gerbang tunggal tersebut.
Guides & Insights

GPT-5.6 Sol API: Cara Memanggilnya, Berapa Biayanya, dan Kapan Turun Versi

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.

Kedua dialek dan satu id model

Kebanyakan tutorial GPT-5.6 Sol hanya menampilkan satu dialek dan berhenti di situ. Ada dua, dan keduanya mencapai bobot yang sama.

Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.

Responses API — client.responses.create. ID model yang sama dengan bentuk permintaan yang lebih baru: satu input field dan reasoning blok ({"effort": "high"}) sebagai pengganti array messages. OpenAI merekomendasikannya untuk build baru karena ia menerima parameter reasoning secara langsung dan mengembalikan token reasoning sebagai output kelas satu — dan tingkat effort tertinggi hanya tersedia di sini.

Sematkan tier. Alias dasar gpt-5.6 saat ini mengarah ke Sol, tetapi alias persis hal yang diubah vendor saat flagship baru rilis. Meneruskan gpt-5.6-sol secara eksplisit berarti setiap panggilan menyatakan biayanya, dan itulah id yang diharapkan setiap gateway.

Apa yang Anda dapatkan — dan pengatur yang menentukan tagihan Anda

GPT-5.6 Sol adalah andalan OpenAI yang berfokus pada penalaran: jendela konteks ~1,05 juta token, keluaran maksimal 128K, batas pengetahuan 16 Februari 2026, serta masukan teks, gambar, dan file dengan keluaran teks. Pada papan peringkat Artificial Analysis yang independen, model ini memperoleh Indeks Kecerdasan AA sebesar 61 dan skor Coding AA sebesar 77, dengan skor SWE-bench Pro sebesar 64.6% sebagaimana diukur secara independen oleh llm-stats — angka coding itulah yang sebenarnya dikutip oleh kalangan agen.

A spec and benchmark scoreboard for GPT-5.6 Sol: model id gpt-5.6-sol, ~1.05M token context window, 128K max output, released July 9 2026, AA Intelligence Index 61 and AA Coding 77 per Artificial Analysis, SWE-bench Pro 64.6% independently measured by llm-stats, and six reasoning-effort levels from none to max.

Berpikir aktif secara default, dan reasoning effort parameter adalah pengungkit tunggal terbesar baik pada latensi maupun biaya:

Enam tingkatnone, low, medium, high, xhigh, max. none menonaktifkan penalaran untuk tugas-tugas mekanis; max digunakan untuk masalah dengan biaya kesalahan tinggi dan hanya tersedia melalui Responses API.

Mulailah dari level sedang dan naikkan satu tingkat setiap kali. Tutorial apidog GPT-5.6 mencatat bahwa banyak beban kerja GPT-5.5 mempertahankan kualitasnya satu tingkat lebih rendah pada keluarga 5.6 — ukur kualitas sebelum membayar lebih untuk penalaran.

Mode Pro adalah pengaturan, bukan model. Atur reasoning.mode: "pro" dan model memprioritaskan kualitas jawaban daripada kecepatan. Harga dan id model tidak berubah.

Verbositasrendah, sedang (bawaan), tinggi — mengontrol panjang keluaran secara independen dari penalaran.

Token penalaran ditagih sebagai output sebesar $30 per juta. Pada prompt sulit di level xhigh atau max, penalaran internal dapat mendominasi tagihan — bagian tersembunyi dari penetapan harga model penalaran yang tidak pernah ditampilkan labelnya.

Berapa sebenarnya biaya Sol

Harga dasar Sol tidak berubah setelah pemotongan harga OpenAI pada 30 Juli 2026: $5 per juta input dan $30 per juta output. Pemotongan harga tersebut berlaku pada dua tingkatan yang lebih murah — GPT-5.6 Terra turun menjadi $2 / $12 dan GPT-5.6 Luna menjadi $0.20 / $1.20 — yang penting di sini karena perbandingan itulah yang menunjukkan kapan Sol berlebihan.

A price card for the GPT-5.6 Sol API: Sol at $5 input / $30 output per 1M with a $0.50 cache read and a $6.25 cache write, a long-context tier at $10 / $45, GPT-5.6 Terra at $2 / $12 and GPT-5.6 Luna at $0.20 / $1.20, and a worked example of 100K tokens in plus 20K out billing $1.10 uncached or about $0.65 with a cached input leg.

Tiga pengubah mengubah tarif efektif:

Caching prompt. Input yang digunakan kembali ditagih sekitar $0,50 per juta pada pembacaan cache — diskon 90% dari input baru — dan penulisan cache ditagih sebesar $6,25 per juta (1,25x tingkat input tanpa cache). Caching bersifat implisit secara default dan dapat dibuat eksplisit melalui prompt_cache_options dengan ttl; prefiks cache membutuhkan setidaknya 1.024 token dan tetap hangat selama setidaknya 30 menit.

Tingkatan konteks panjang. Di atas ukuran input ambang batas, Sol naik ke $10 / $45 per juta. Beberapa prompt yang sangat panjang diam-diam menggeser harga rata-rata Anda.

Segala sesuatu yang dikeluarkan model adalah output. Itu mencakup token penalaran internal, jadi pada panggilan yang sarat penalaran, tagihan terpusat pada sisi output.

Sebuah faktur konkret: permintaan 100K token yang menghasilkan 20K token output membebankan $0.50 untuk input dan $0.60 untuk output — $1.10 tanpa cache. Jika prompt 100K tersebut dilayani dari cache pada panggilan berikutnya, biaya input turun menjadi sekitar $0.05 dan total biaya menjadi sekitar $0.65. Pada loop agen panjang yang menggunakan kembali prompt sistem yang sama sepanjang hari, caching menentukan apakah Sol terjangkau atau tidak.

Satu endpoint, 200+ model

If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the 1.05M-token context window, 128K max output, the p50 TTFT of 4.59s, and the /v1/chat/completions and /v1/responses endpoints.

Ekonominya adalah bagian yang jujur. OrcaRouter menambahkan $0 per token — $5 / $30 di halaman model adalah tarif OpenAI yang diteruskan, dan perubahan harga vendor berlaku di sisi kami pada hari yang sama saat diumumkan. Bawa kunci sendiri adalah opsi kelas satu: serahkan kunci OpenAI Anda yang sudah ada, pertahankan batas kecepatan dan kredit Anda sendiri, dan OpenAI menagih Anda secara langsung. Pengaman — perisai PII dan kebijakan konten — diberlakukan sebelum permintaan ditagih, bukan setelahnya. DSL rute menyusun failover sehingga model yang lebih murah menjawab ketika Sol mengalami error atau ketika bentuk lalu lintas Anda memungkinkannya.

Ketika Sol berada di tier yang salah

Menjadi produk unggulan tidak sama dengan menjadi pilihan yang tepat untuk setiap kebutuhan, dan ada tiga situasi di mana tarif $5/$30 kurang menguntungkan.

Panggilan bervolume tinggi dan berisiko rendah. Pipeline klasifikasi atau ekstraksi yang memproses 10 juta token input per bulan berbiaya $50 di Sol dibandingkan dengan $2 di GPT-5.6 Luna — endpoint yang sama, kunci yang sama, cukup mengganti satu id. Luna dengan harga $0.20 / $1.20 memang dibanderol untuk pekerjaan seperti ini.

Penalaran tingkat menengah yang tidak memerlukan kedalaman terdepan. GPT-5.6 Terra pada $2 / $12 berada di antara volume dan andalan. Saran dari tutorial apidog adalah default yang masuk akal: buat prototipe di Terra, tingkatkan ke Sol hanya jika Terra terbukti gagal secara terukur, dan pindahkan jalur ber-volume tinggi yang stabil ke Luna.

Batas dari apa yang bisa kami janjikan.OrcaRouter menangani routing dan penagihan; OpenAI yang menjalankan bobotnya. Endpoint, markup nol, failover, dan guardrail adalah milik kami, tetapi kualitas inferensi dan perilaku keamanan adalah milik OpenAI, dan dengan BYOK uangnya langsung mengalir ke mereka. Itulah kesepakatan yang dinyatakan secara gamblang: Anda tetap membayar tarif penyedia, dan pertanyaannya adalah apakah satu endpoint untuk 200+ model itu sepadan.

Intinya

Panggil API GPT-5.6 Sol dengan Chat Completions jika Anda memiliki klien OpenAI yang sudah ada, dan dengan Responses API jika Anda membangun yang baru — id model gpt-5.6-sol, tarif $5 / $30, dan dial penalaran yang sama dalam kedua kasus. Ini adalah model yang tepat ketika tugasnya sulit, konteksnya panjang, dan keluarannya bernilai $30 per juta token — dan model yang salah ketika tugasnya rutin, di mana Terra dan Luna berbiaya sebagian kecil dari harga tersebut. Pengaturan yang paling bersih adalah yang memungkinkan Anda berubah pikiran: satu endpoint, kunci Anda sendiri, markup $0, dan id model yang dapat Anda ganti pada hari beban kerja berubah.

GPT-5.6 Sol telah tersedia di OrcaRouter dengan harga resmi OpenAI $5 / $30 dan markup $0 per token — gunakan kunci OpenAI Anda yang sudah ada dan penyedia akan menagih Anda secara langsung. Mulai dengan GPT-5.6 Sol on OrcaRouter — satu endpoint, tanpa integrasi kedua.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube