Kartu judul hero bertuliskan 'GPT-6 Sol Pro vs Claude Opus 5' dengan subjudul 'Tangga upaya yang tidak ada yang mencantumkannya dalam tabel', pasangan label dua kolom 'GPT-6 Sol Pro' / 'Claude Opus 5', dan baris footer bertuliskan 'Daftar vendor tidak diaudit; angka menurut Artificial Analysis.', dengan logo OrcaRouter asli di kanan bawah.
Guides & Insights

GPT-6 Sol Pro vs Claude Opus 5: Tangga Upaya yang Tidak Pernah Dicantumkan dalam Tabel

Penulis

Gideon Frost

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-6 Sol Pro dan Claude Opus 5 terus-menerus dibandingkan satu sama lain, dan hampir selalu pada pengaturan yang salah. Perbandingan yang beredar adalah Claude Opus 5 pada upaya penalaran tertingginya melawan GPT-6 Sol Pro pada upaya penalaran tertingginya, yang menghasilkan selisih tiga poin pada indeks netral dan perbedaan biaya lima kali lipat. Setel kedua model ke konfigurasi yang disediakan vendor masing-masing sebagai default — dan ingat bahwa "Pro" pada nama pertama adalah konfigurasi penalaran, bukan model terpisah — dan selisih tiga poin itu hilang sepenuhnya. Yang tersisa adalah perbedaan biaya, dan itulah satu-satunya bagian dari cerita yang bertahan saat bersentuhan dengan tagihan produksi.

Ini bukan trik penyajian. Ini adalah konsekuensi langsung dari dua tangga upaya yang tidak dikalibrasi satu sama lain, yang diterbitkan oleh dua vendor yang mengukur terhadap model lama satu sama lain.

Apa sebenarnya kedua model itu, sebelum perbandingan apa pun

GPT-6 Sol adalah model penalaran tingkat menengah milik OpenAI, tersedia secara umum sejak 22 September 2026, dengan harga $2,00 per juta token masukan dan $10,00 per juta token keluaran. Tidak ada pengenal model gpt-6-sol-pro dalam dokumentasi pengembang OpenAI — halaman tersebut mencantumkan satu entri Sol, jendela konteks 1.050.000 token, masukan maksimum 922.000 token, batas keluaran 128.000 token, batas pengetahuan 20 April 2026, dan tangga upaya penalaran yang mencakup none, low, medium, high, xhigh, dan max dengan medium sebagai default. "Pro" adalah nilai dari mode penalaran, pola alias yang sama yang diperkenalkan generasi GPT-5.6 dan diwarisi oleh model ini. Entri katalog pihak ketiga bernama GPT-5.6 Sol Pro memang ada dan sekarang mencantumkan $2,00 dan $10,00 — angka milik GPT-6 Sol — yang merupakan artefak penamaan, bukan produk.

Claude Opus 5 adalah model nyata dari Anthropic yang diberi harga terpisah, tersedia secara umum sejak 24 Juli 2026 dengan harga $5,00 untuk input dan $25,00 untuk output per juta token. Jendela konteksnya 1.000.000 token, batas output sinkronnya 128.000, dan tangga upayanya sendiri — output_config.effort — mencakup low, medium, high, xhigh, dan max dengan high sebagai nilai default. Kemampuan berpikirnya bersifat adaptif dan aktif secara default, yang pertama untuk keluarga Opus.

Satu fakta lagi yang membentuk semua hal di bawah ini, dan yang tidak dimuat oleh halaman perbandingan mana pun yang ada: tabel siklus hidup milik Anthropic sendiri mencantumkan Claude Opus 5 sebagai Aktif (legacy), dengan banner migrasi yang mengarah ke Claude Opus 5.5, yang mencapai ketersediaan umum pada 22 September 2026 dengan harga $4.00 dan $20.00. Bagan peluncuran OpenAI masih membandingkan dengan Opus 5, bukan 5.5. Model dalam perbandingan ini adalah Opus generasi sebelumnya.

Dua baris harga, baris demi baris

Keduanya adalah daftar vendor — angka yang diterbitkan sendiri oleh OpenAI dan Anthropic, diteruskan tanpa perubahan oleh platform yang menghostingnya.

• Input — GPT-6 Sol $2,00 per juta token vs Claude Opus 5 $5,00 per juta token

• Keluaran — GPT-6 Sol $10,00 per juta token vs Claude Opus 5 $25,00 per juta token

• Pembacaan cache — GPT-6 Sol $0.20 per juta token vs Claude Opus 5 $0.50 per juta token; keduanya sebesar 10% tetap dari tarif input tanpa cache

• Penulisan cache — GPT-6 Sol $2,50 per juta token pada satu TTL vs Claude Opus 5 $6,25 pada TTL lima menit dan $10,00 pada TTL satu jam; TTL yang lebih panjang adalah opsi yang tidak ditawarkan OpenAI, dan itulah tier yang paling sering dikutip secara tidak sengaja oleh tabel perbandingan, karena itulah yang muncul pada kartu katalog yang dihosting

• Penanganan konteks panjang — GPT-6 Sol menetapkan harga ulang untuk permintaan yang melewati ambang batas inputnya dengan tarif lebih tinggi untuk keseluruhan permintaan; Claude Opus 5 sama sekali tidak menerapkan biaya tambahan konteks panjang, sehingga permintaan 900.000 token ditagih dengan tarif per token yang sama seperti permintaan 9.000 token

• Batch — GPT-6 Sol memiliki endpoint batch dengan diskon standar, sedangkan Message Batches API Claude Opus 5 memberi potongan 50% untuk kedua arah, dan diskon batch Anthropic dapat ditumpuk dengan prompt caching

• Jendela konteks — GPT-6 Sol 1.050.000 token vs Claude Opus 5 1.000.000 token

• Output maksimum — 128.000 token untuk keduanya, dengan Claude Opus 5 menaikkannya menjadi 300.000 pada Message Batches API di bawah header beta output-300k-2026-03-24

Kombinasi batch dan caching adalah butir yang paling jarang dibahas dalam daftar ini dan yang paling banyak mengubah perhitungan. Diskon batch 50% yang dikombinasikan dengan pembacaan cache pada sepersepuluh tarif input adalah penawaran yang berbeda dari diskon batch 50% saja, dan untuk pekerjaan sintesis yang panjang — di mana batas keluaran batch 300.000 token Anthropic juga berlaku — hal ini menutup sebagian signifikan dari kesenjangan yang tampak tak terjembatani pada harga daftar.

A two-column scoreboard card titled 'GPT-6 Sol vs Claude Opus 5 - the scoreboard'. Left column 'GPT-6 Sol': AA Index, max effort 48; AA Index, default effort 48; cost per task, max $1.06; cost per task, default $0.37; price in/out $2 / $10; context window 1.05M. Right column 'Claude Opus 5': AA Index, max effort 51; AA Index, default effort 48; cost per task, max $5.86; cost per task, default $3.61; price in/out $5 / $25; context window 1M. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Tangga usaha adalah perbandingan yang sebenarnya

Inilah angka yang seharusnya ada di setiap artikel ini. Di Artificial Analysis, yang harness-nya merupakan satu-satunya yang netral dan menerbitkan tangga upaya lengkap untuk kedua model, Claude Opus 5 mendapat skor 51 pada upaya maksimum dan biayanya $5.86 per tugas indeks. Pada pengaturan tinggi bawaannya, ia mendapat skor 48 dan biayanya $3.61. GPT-6 Sol mendapat skor 48 pada upaya maksimum dan biayanya $1.06 — dan 43 pada upaya tinggi dengan biaya $0.37.

Bacalah kedua baris itu bersama-sama. Claude Opus 5 yang berjalan pada pengaturan upaya yang disertakan Anthropic sebagai default memperoleh skor indeks yang persis sama dengan GPT-6 Sol yang berjalan dengan upaya maksimal. Selisih yang dilaporkan liputan peluncuran — tiga poin — hanya ada jika Anda membandingkan setiap model pada puncak setelannya masing-masing, dan puncak setelan itu bukanlah posisi ketika model mana pun berjalan secara default. Keunggulan Opus 5 pada upaya maksimal memang nyata, dan untuk memperolehnya diperlukan biaya sekitar lima setengah kali lebih besar per tugas yang diselesaikan.

Dua catatan kejujuran semestinya disertakan pada angka-angka itu, dan keduanya tidak ada di halaman-halaman yang mengutipnya.

• Versi indeks terus berubah. Skor Opus 5 telah dipublikasikan sebagai 61, 63, 54, dan 51 di sepanjang revisi-revisi berturut-turut dari indeks Artificial Analysis sejak Juli. Tidak ada satu pun dari angka itu yang salah; setiap angka itu salah tanpa label versinya. Angka 51 di atas adalah papan skor saat ini, dan tidak dapat dibandingkan dengan 61 yang dikutip dari artikel hari peluncuran.

• Tangga upaya tidak dikalibrasi antar vendor. "high" pada satu model bukanlah jumlah pemikiran yang sama dengan "high" pada model lainnya. Skor yang sepadan pada pengaturan yang secara nominal berbeda adalah bukti tentang biaya, bukan tentang kesetaraan kapabilitas.

Di mana catatan independen lebih tipis daripada kelihatannya

Claude Opus 5 telah memiliki delapan minggu pengukuran pihak ketiga di belakangnya dan serangkaian angka peluncuran yang dilaporkan vendor yang jelas dilabeli demikian — Frontier-Bench v0.1 pada 43,3%, ARC-AGI-3 pada 30,2%, GDPval-AA v2 pada 1.861 Elo. Setiap angka itu diukur terhadap GPT-5.6 Sol atau Claude Fable 5, bukan terhadap GPT-6 Sol. Tidak ada hasil harness bersama di mana pun yang mempertemukan Opus 5 dan GPT-6 Sol secara berhadapan langsung pada benchmark milik Anthropic sendiri, dan kartu sistem Anthropic mengakui bahwa model tersebut tidak lebih mampu secara keseluruhan daripada Claude Fable 5.

Catatan independen itu juga mengandung peringatan ke arah sebaliknya. Dalam evaluasi AA-Omniscience dari Artificial Analysis, tingkat halusinasi Opus 5 adalah 50%, naik empat belas poin dari Opus 4.8 — penyebab yang terdokumentasi adalah penolakan turun dari sekitar 23% menjadi 7%, sehingga model menjawab lebih banyak pertanyaan dan salah pada lebih banyak di antaranya. Vals AI secara terpisah mengungkapkan bahwa Opus 5 dan Fable 5 menggunakan Opus 4.8 sebagai fallback penolakan selama proses Terminal-Bench; mereklasifikasi sembilan kelulusan yang terdampak sebagai kegagalan menggeser Opus 5 dari 84,64% menjadi 81,27%. Ini bukan temuan yang mendiskualifikasi, tetapi tulisan yang berargumen bahwa Opus 5 adalah pilihan yang lebih andal perlu melampirkannya.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens, above the 'Intelligence Index vs Cost to Run Intelligence' scatter chart with the reasoning-models-only filter applied.

Rekor independen GPT-6 Sol, minggu ini, hanya selebar satu angka: skor indeks di atas, diukur pada upaya maksimal, dengan delapan belas bulan rilis model di belakangnya dalam pengujian pihak ketiga yang terakumulasi. Asimetri itu — delapan minggu pengamatan ketat versus satu hari — adalah alasan jujur seorang pembeli mungkin masih membayar premi lima kali lipat, dan itu alasan yang lebih baik daripada angka utama tiga poin.

Di mana lapisan perutean mengubah keputusan

Claude Opus 5 ada di OrcaRouter, yang katalognya mencantumkan harga $5.00 untuk input, $25.00 untuk output, $0.50 untuk pembacaan cache dan $10.00 untuk penulisan cache per juta token, dengan jendela 1.000.000 token, batas output 128.000 token, serta kedua endpoint /v1/chat/completions dan /v1/messages — harga daftar penyedia diteruskan tanpa markup tambahan, sehingga perubahan harga Anthropic langsung berlaku di sisi kami pada hari yang sama saat berlaku di sisi mereka. Angka penulisan cache di kartu model adalah tarif TTL satu jam; tingkat lima menit Anthropic adalah $6.25, dan mengutip salah satunya tanpa menyebut yang mana itulah yang membuat kedua angka itu akhirnya tampak seperti kontradiksi.

GPT-6 Sol bukan salah satu rute kami, jadi tidak ada apa pun di sini yang merupakan klaim tentang harganya melalui kami.

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), captured 23 September 2026, showing an input price of $5.00 per million tokens, an output price of $25.00 per million tokens, a 1,000,000-token context window, a 128,000-token output cap, reasoning and tools tags, a 'Traffic — Last 7 days' section, and both the /v1/chat/completions and /v1/messages endpoints.

Yang sebenarnya didapat dari satu endpoint dalam pertandingan ini adalah kemampuan untuk memegang kedua jawaban sekaligus. Argumen untuk Opus 5 dan argumen untuk Sol sama-sama bergantung pada effort, dan effort adalah parameter per permintaan, bukan kontrak. Tim yang merutekan kedua model di balik satu kunci dengan failover otomatis dapat mengirim pekerjaan yang membutuhkan plafon effort maksimum Opus 5 ke Opus 5 dan tingkat volume ke Sol pada effort sedang, tanpa integrasi kedua atau set batas laju kedua. DSL perutean menyusun keputusan itu ke dalam panggilan alih-alih ke dalam proyek migrasi — yang khususnya penting di sini, karena jawaban yang benar untuk pasangan ini berubah seiring permintaan, bukan seiring kuartal.

Aturan keputusan

• Pekerjaan bervolume pada tolok ukur kualitas yang diketahui — GPT-6 Sol pada upaya sedang atau tinggi. Empat puluh poin indeks dengan $0.25 per tugas adalah penawaran kredibel termurah di papan ini, dan pengaturan upaya adalah parameter yang terdokumentasi, bukan tebakan.

• Pekerjaan yang memerlukan puncak rentang kemampuan dan mampu membayarnya — Claude Opus 5 pada xhigh atau max. Tiga poin indeks di atas plafon Sol, dengan biaya $4,88 hingga $5,86 per tugas, dan satu-satunya di antara keduanya yang memiliki batas atas keluaran batch 300.000 token.

• Pekerjaan batch korpus besar — Claude Opus 5, berdasarkan argumen struktural, bukan argumen per token. Tanpa biaya tambahan konteks panjang, diskon batch yang dapat digabungkan dengan caching, dan TTL cache satu jam untuk prefiks yang bertahan lebih lama dari jendela lima menit.

• Apa pun yang membuat jawaban salah berbiaya mahal — tidak keduanya, berdasarkan catatan saat ini. Tingkat halusinasi Opus 5 naik empat belas poin pada rilis ini, dan catatan pihak ketiga Sol hanya selebar satu angka.

• Jika perbandingan yang ditampilkan kepada Anda adalah "Opus 5 max versus Sol max" — jalankan ulang dengan effort default sebelum Anda memutuskan. Di situlah keputusan sebenarnya dibuat, dan itulah satu konfigurasi yang tidak pernah ditunjukkan oleh cakupan yang ada kepada Anda.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari