Kartu hero yang dihasilkan berjudul 'GPT-6 Sol vs GPT-5.6 Sol', dengan judul utama 'Terpaut 1 poin Index, setengah harganya', dengan kartu kedua model yang menampilkan AA Index 48 berbanding 47 dan harga $2.00/$10.00 berbanding $4.00/$20.00, serta logo OrcaRouter di kanan bawah.
Guides & Insights

GPT-6 Sol vs GPT-5.6 Sol: Satu Poin Indeks, Setengah Harga, dan Regresi yang Tak Diumumkan Siapa pun

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Ya, upgrade — tetapi bacalah paragraf kedua sebelum melakukannya. GPT-6 Sol, yang dirilis pada 22 September 2026, mendapat skor 48 pada Intelligence Index dari Artificial Analysis. GPT-5.6 Sol, yang dirilis pada 9 Juli 2026, mendapat skor 47. Satu poin. Model yang menggantikannya dibanderol setengahnya: $2,00 per juta input dan $10,00 per juta output, dibandingkan dengan $4,00 dan $20,00. Berdasarkan angka-angka utamanya, ini adalah keputusan upgrade termudah dalam jajaran saat ini, dan pemotongan harga ini nyata, permanen, serta merupakan pengurangan tunggal terbesar yang pernah dilakukan vendor terhadap sebuah model flagship.

Komplikasinya adalah bahwa penilaian Artificial Analysis sendiri terhadap GPT-6 Sol menemukan campuran keuntungan dan regresi, bukan peningkatan yang bersih. Ada regresi pada GDPval-AA v2.1. Ada juga tier penetapan harga ulang untuk konteks panjang di atas 272.000 token masukan yang kira-kira menggandakan tarif masukan dan menaikkan biaya output sebesar setengahnya — dan 272K justru merupakan rentang tempat GPT-5.6 Sol memiliki kekuatan yang dipublikasikan. Migrasi yang tampak seperti pemotongan separuh tagihan Anda secara langsung bisa, pada lalu lintas konteks panjang, berakhir lebih mendekati impas dengan pertukaran kemampuan yang melekat.

Apa Arti Sebenarnya dari Kenaikan Satu Poin Indeks

Kedua model diukur pada board yang sama, versi 4.3.2, yang menjadikan ini perbandingan paling bersih di seluruh seri GPT-6 Sol — tidak ada perbedaan harness, tidak ada ketidaksesuaian vendor versus independen, satu laboratorium mengukur dua model dari satu vendor.

• AA Intelligence Index — GPT-6 Sol 48, peringkat 18 dari 212 vs GPT-5.6 Sol 47, peringkat 19 dari 212

• Biaya per tugas Index — GPT-6 Sol sekitar setengah dari GPT-5.6 Sol

• Kecepatan output — GPT-6 Sol 104,4 token/detik vs GPT-5.6 Sol 72,6 token/detik

Waktu hingga token pertama — GPT-6 Sol 107,18 dtk vs GPT-5.6 Sol lebih cepat, keduanya dibandingkan median papan peringkat 3,87 dtk

• Harga input — GPT-6 Sol $2,00 per 1 juta vs GPT-5.6 Sol $4,00 per 1 juta

Harga output — GPT-6 Sol $10,00 per 1 juta vs GPT-5.6 Sol $20,00 per 1 juta

• Input cache — GPT-6 Sol sekitar 90% lebih murah vs GPT-5.6 Sol $0.40 per 1M

• Tarif batch — GPT-6 Sol belum dipublikasikan vs GPT-5.6 Sol $2,50 / $15,00

• Tingkatan konteks panjang — GPT-6 Sol menetapkan harga baru untuk input di atas 272K, sedangkan GPT-5.6 Sol tidak memiliki langkah yang setara

• Jendela konteks — GPT-6 Sol 872K menurut AA, 1,05M diklaim vs GPT-5.6 Sol sekitar 1,05M hingga 1,1M

• Output maksimum — 128K pada keduanya

• Dirilis — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6 Sol: Input $2.00 per 1M, Output $10.00 per 1M, AA Index 48, Speed 104.4 tok/s, Long context 'reprices above 272K', Released 2026-09-22. Right column GPT-5.6 Sol: Input $4.00 per 1M, Output $20.00 per 1M, AA Index 47, Speed 72.6 tok/s, Long context 'no step', Released 2026-07-09. Footer: 'Both measured by Artificial Analysis, Index v4.3.2.'

Lihatlah kedua garis kecepatan itu bersama-sama. GPT-6 Sol menghasilkan output sekitar 44% lebih cepat daripada pendahulunya, dan jauh lebih lambat dalam menghasilkan token pertama — 107,18 detik dibandingkan median papan peringkat sebesar 3,87. GPT-5.6 Sol juga bukan model yang cepat menurut standar papan peringkat, tetapi tidak berada di wilayah itu. Jika Anda bermigrasi ke GPT-5.6 Sol untuk produk interaktif, GPT-6 Sol bukan pengganti langsung, dan itu adalah regresi fungsional yang tidak bergantung pada tolok ukur apa pun.

Satu hal yang secara diam-diam menguntungkan: tarif standar GPT-6 Sol sebesar $2/$10 lebih murah daripada tarif batch GPT-5.6 Sol sebesar $2.50/$15. Bahkan tier diskon dari model lama lebih mahal daripada harga daftar model baru. Itu adalah bukti terkuat bahwa pemotongan ini bersifat struktural, bukan promosi.

Regresi adalah bagian yang menarik

Artificial Analysis menemukan bahwa GPT-6 Sol kurang lebih memangkas biaya per tugas hingga sekitar setengah, sekaligus menghasilkan campuran peningkatan dan regresi. GDPval-AA v2.1 adalah regresi yang disebutkan. Secara terpisah, GPT-5.6 Luna dari OpenAI juga mengalami regresi pada Coding Agent Index — yang menunjukkan adanya pola pada generasi ini, bukan kekeliruan yang terisolasi pada satu model.

Ini layak ditanggapi dengan serius justru karena temuan ini independen. Materi peluncuran OpenAI dibangun berdasarkan biaya per tugas dan baris-baris benchmark yang dipilihnya sendiri; Artificial Analysis tidak punya produk untuk dijual dan melaporkan apa yang dihasilkan harness-nya. Model yang lebih murah dan kurang lebih setara pada skor komposit, tetapi secara terukur lebih buruk pada sub-tugas tertentu, bukanlah model yang secara mutlak lebih baik. Ini adalah titik yang berbeda pada frontier.

Versi praktisnya: jika beban kerja Anda sangat berbentuk GDPval-AA — pekerjaan pengetahuan yang bernilai ekonomis, jenis tugas yang tolok ukur itu dibangun untuk memberi harga — maka keuntungan komposit satu poin tidak mencakup Anda, dan regresi adalah angka yang penting. Jika beban kerja Anda bersifat umum, pemotongan biaya per tugas menjadi setengah adalah angka yang penting dan komposit mengatakan Anda tidak mengorbankan apa pun yang terukur.

Di mana GPT-5.6 Sol masih unggul

GPT-5.6 Sol memiliki hasil penelusuran konteks panjang yang dipublikasikan yang tidak bisa ditandingi GPT-6 Sol dengan hasil apa pun yang setara: MRCR v2, 8-needle, 91,5% pada rentang 256K hingga 512K. Itu adalah angka akurasi penelusuran pada rentang tempat kartu tarif GPT-6 Sol berubah.

Sandingkan kedua fakta itu. Di atas 272.000 token input, seluruh permintaan GPT-6 Sol dihitung ulang menjadi sekitar $4 untuk input dan $15 untuk output. Itu kira-kira tarif lama GPT-5.6 Sol pada input dan tiga perempat dari tarif itu pada output — jadi penghematan 50% yang membuat Anda bermigrasi merosot menjadi sekitar 0% pada input dan 25% pada output, tepat pada rentang konteks di mana GPT-5.6 Sol memiliki kekuatan yang terdokumentasi dan GPT-6 Sol tidak memiliki padanan yang dipublikasikan.

Hasil terbit lainnya dari GPT-5.6 Sol tetap terhormat dan menjadi alasan sebagian tim tidak akan beralih:

• Agents' Last Exam — GPT-5.6 Sol 53.6

• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0

• SWE-Bench Pro — GPT-5.6 Sol 64.6

• OSWorld 2.0 — GPT-5.6 Sol 62.6

• BrowseComp — GPT-5.6 Sol 90.4

• GDPval-AA v2 — GPT-5.6 Sol 1747,8 Elo

• HLE — GPT-5.6 Sol 49,5

• MRCR v2, 8-needle — GPT-5.6 Sol 91,5% pada 256K hingga 512K

Ini dilaporkan oleh OpenAI. Perhatikan bahwa BrowseComp pada 90,4 dan angka MRCR adalah dua yang paling sulit digantikan: agen riset web dan pengambilan konteks panjang adalah beban kerja di mana model berusia dua bulan dengan angka yang telah dipublikasikan lebih aman daripada model baru tanpa pengukuran pembanding.

Apa yang dihadirkan GPT-6 Sol yang tidak tercantum dalam rate card

Harganya adalah intinya, tetapi ada tiga hal lain yang berubah.

Pertama, batas atas konteks. GPT-6 Sol tercatat 872.000 token oleh Artificial Analysis, dibandingkan dengan klaim 1,05M di tempat lain dalam materi OpenAI, dengan input maksimum 922K. GPT-5.6 Sol berada di sekitar 1,05M hingga 1,1M tergantung sumbernya. Di atas kertas, itu adalah kemunduran kecil dalam jendela yang dapat digunakan — dengan catatan bahwa batas tier 272K, bukan batas atasnya, yang menentukan biaya.

Kedua, ketersediaan. GPT-6 Sol tersedia di API dan di ChatGPT Work serta Codex pada Plus, Pro, Business, Enterprise, dan Edu — dan administrator Enterprise harus mengaktifkannya sebelum pengguna dapat melihatnya. Model ini tidak ada di ChatGPT Chat. GPT-5.6 Sol merupakan peluncuran yang lebih luas. Jika jalur akses tim Anda melewati admin Enterprise, migrasi ini bukan sekadar perubahan kode.

Ketiga, peluncuran model unggulan baru umumnya berarti model lama menjadi opsi cadangan yang lebih murah daripada dipensiunkan. GPT-5.6 Sol pada $4/$20 masih merupakan model yang sangat baik dengan skor 47 pada Index, dan untuk pekerjaan retrieval konteks panjang, model ini memiliki angka yang dipublikasikan yang tidak dimiliki GPT-6 Sol.

Migrasi yang biayanya lebih rendah daripada yang terlihat

Alasan peningkatan khusus ini mudah adalah karena kedua model berasal dari vendor yang sama, memiliki bentuk API yang sama, dan berdekatan dalam peringkat — yang berarti migrasinya hanyalah perubahan string model, bukan arsitektur ulang, dan jalur fallback sudah ada di kode Anda. GPT-5.6 Sol tersedia di OrcaRouter dengan harga daftar OpenAI, di bawah model pass-through yang membuat perubahan harga OpenAI langsung berlaku di sisi kami pada hari yang sama, bukan setelah pereseller menegosiasikan ulang.

GPT-6 Sol tidak ada dalam katalog kami pada saat penulisan ini — model tersebut dapat dijangkau melalui API OpenAI sendiri. Jadi bentuk migrasi yang jujur adalah sebuah rute dengan GPT-5.6 Sol di belakangnya pada kunci yang sama: kirim lalu lintas baru ke GPT-6 Sol, pertahankan model sebelumnya hanya berjarak satu perubahan konfigurasi, dan biarkan failover otomatis menutupi jendela ketika ketersediaan flagship baru masih dalam proses penetapan. Untuk model yang baru berusia dua hari, dengan tombol pengaktifan Enterprise di depannya dan tier konteks panjang yang mengubah hitungan ekonominya di atas 272K token, tetap terpasangnya generasi sebelumnya bukanlah kehati-hatian — itu adalah perbedaan antara sore yang buruk dan seminggu yang buruk.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

Daftar periksa migrasi

Ukur distribusi konteks Anda yang sebenarnya sebelum melakukan hal lain. Jika persentil ke-95 dari permintaan Anda berada di bawah 272.000 token input, bermigrasilah — penghematannya benar-benar 50% di kedua sisi tagihan, biaya per tugas menjadi separuh, dan indeks komposit menyatakan Anda tidak mengorbankan apa pun. Jika sebagian berarti dari trafik berada di atas garis itu, modelkan tier-nya dengan cermat: pada sekitar $4/$15, keunggulan dibandingkan $4/$20 milik GPT-5.6 Sol adalah 25% pada output dan tidak ada pada input, dan Anda membayarnya dengan hilangnya hasil pengambilan konteks panjang yang terdokumentasi.

Periksa apakah ada yang menunggu token pertama. 107 detik kira-kira dua puluh delapan kali median papan dan itu adalah mode kegagalan yang akan muncul lebih dulu di produksi. Apa pun yang di ujung lainnya ada manusia harus tetap di GPT-5.6 Sol atau dialihkan ke tempat lain.

Lalu periksa jalur pengaktifannya. Paket Enterprise memerlukan administrator untuk mengaktifkan GPT-6 Sol, dan fitur itu sama sekali tidak ada di ChatGPT Chat. Pastikan pengguna Anda benar-benar dapat mengaksesnya sebelum Anda mengumumkan migrasi secara internal.

Terakhir, pantau GDPval-AA v2.1 pada evaluasi Anda sendiri selama bulan pertama. Lab independen menemukan regresi di sana, dan kenaikan komposit satu poin tidak memberi tahu Anda apakah kumpulan tugas spesifik Anda naik atau turun. Jalankan evaluasi Anda pada kedua model sebelum Anda beralih, bukan sesudahnya.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the Vision, Tools, JSON and Reasoning badges, a 1.05M-token context with 128K maximum output and text + image + file input, list pricing of $4.00 input and $20.00 output per 1M tokens, and the description of GPT-5.6 Sol as the flagship of OpenAI's GPT-5.6 series, strong at command-line and multi-file coding tasks.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari