
Claude Opus 5.5 vs GPT-6 Sol: Setengah Harga, Sampai Konteksnya Menjadi Panjang
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 177 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1323 tok/s
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
Anthropic dan OpenAI meluncurkan model unggulan yang bersaing pada sore yang sama. Claude Opus 5.5 dirilis pada 22 September 2026 dengan harga $4 per juta token input dan $20 per juta token output, potongan 20% pada kedua lini dibanding Claude Opus 5. GPT-6 Sol dirilis pada hari yang sama dengan harga $2 untuk input dan $10 untuk output, potongan langsung 50% dari GPT-5.6 Sol, yang digambarkan OpenAI sebagai permanen, bukan promosi. Baca hanya dua kalimat itu, dan pertandingannya tampak sudah ditentukan sebelum dimulai: model OpenAI harganya setengah, dan setengah harga ya setengah harga. Baca sisa kedua daftar tarif dan kesenjangannya sebagian besar tertutup — bukan karena salah satu vendor mengubah apa pun, tetapi karena kedua model menerapkan biaya tambahan pada jenis permintaan yang sama, dan biaya tambahan itu menggerus keunggulan Sol jauh lebih banyak daripada keunggulan Anthropic.
Dua kartu tarif, keduanya dengan langkah di dalamnya
Di bawah 272.000 token masukan, ini perbandingan paling sederhana di frontier saat ini:
• Masukan — GPT-6 Sol $2,00 per juta vs Claude Opus 5.5 $4,00
• Output — GPT-6 Sol $10,00 per juta vs Claude Opus 5.5 $20,00
• Input di-cache — GPT-6 Sol sekitar 90% lebih murah untuk bagian yang di-cache dibandingkan Claude Opus 5.5 $0.20 per juta, pengali 5% pada input dasar
• Konteks dan output — GPT-6 Sol 872K seperti yang diukur oleh Artificial Analysis, 1M diklaim di tempat lain, output maksimum 128K vs Claude Opus 5.5 1M dan 128K
• Batas pengetahuan — Claude Opus 5.5 Juni 2026 vs GPT-6 Sol tidak dinyatakan dalam istilah yang sama
Di atas 272.000 token masukan, aritmetikanya berubah di kedua sisi, dan tidak dengan jumlah yang sama. GPT-6 Sol menetapkan ulang harga untuk seluruh permintaan — bukan hanya kelebihannya, melainkan seluruh panggilan — pada sekitar dua kali tarif masukan dan satu setengah kali tarif keluaran, sehingga menjadi sekitar $4,00 untuk masukan dan $15,00 untuk keluaran. Kartu tarif Claude Opus 5.5 tidak memiliki tahapan konteks panjang: Anthropic menagih $4,00 dan $20,00 di sepanjang jendela 1 juta token dan menyatakan bahwa permintaan 900 ribu token biayanya sama per token dengan permintaan 9 ribu token.
Gabungkan semuanya, dan urutannya berbalik di tempat yang tak terduga. Pada panggilan dengan konteks panjang, tarif input bertemu di sekitar $4 pada kedua model — keunggulan separuh harga Sol untuk input hilang sepenuhnya — sementara output menyempit dari selisih 2x menjadi sekitar $15 versus $20, keunggulan 25% alih-alih 50%. Sol tetap lebih murah. Namun tidak lagi cukup murah untuk menjadi satu-satunya angka dalam keputusan, dan alasannya adalah kedua biaya tambahan itu berbentuk berbeda: model Anthropic menerapkan tarif tetap yang kebetulan lebih tinggi, model OpenAI menerapkan penalti yang paling berat tepat pada beban kerja agentik, pembacaan repositori, dan kumpulan dokumen yang justru menjadi sasaran kedua perusahaan dalam menjual model-model ini.

Skor independen, yang merupakan satu-satunya perbandingan dengan kondisi yang sama

Tidak ada tabel peluncuran yang memuat model baru milik yang lain — keduanya ditulis sebelum rilis pada hari yang sama itu muncul — jadi materi vendor sama sekali tidak dapat memberi peringkat pada keduanya. Artificial Analysis bisa, karena ia menjalankan setiap model dalam satu konfigurasi yang dipublikasikan:
• Indeks Kecerdasan — Claude Opus 5.5 58, berperingkat #1 dari 210 vs GPT-6 Sol 48, berperingkat #18
• Label konfigurasi — keduanya dinilai pada upaya maksimal; Claude Opus 5.5 juga diberi label "Fallback Default"
• Kecepatan output — GPT-6 Sol 113,3 token/detik, berada di peringkat ke-38 vs Claude Opus 5.5 yang belum dipublikasikan
• Waktu menuju token pertama — GPT-6 Sol 142,74 detik vs median papan peringkat 3,83 detik; Claude Opus 5.5 belum dipublikasikan
• Harga — GPT-6 Sol $2.00 / $10.00 per juta vs Claude Opus 5.5 $4.00 / $20.00
Sepuluh poin indeks dan tujuh belas peringkat adalah jarak terlebar di antara pasangan Claude-versus-OpenAI mana pun saat ini, dan itu merugikan model yang lebih murah untuk kedua kalinya bulan ini — pola yang sama muncul ketika GPT-6 Sol bertemu Claude Opus 5 dalam perbandingan sebelumnya dan kalah dengan selisih tiga poin pada biaya 60% lebih rendah. Baris kecepatan justru berlawanan arah dan lebih penting daripada yang terlihat: 113,3 token per detik kira-kira dua kali lipat dari yang dicapai unggulan GPT-6 Astra, dan itu adalah angka tercepat di grup ini. Digabungkan dengan token pertama berdurasi 142 detik, profilnya adalah model yang berpikir lama lalu menulis dengan cepat, sehingga kurang cocok untuk apa pun yang interaktif dan cukup wajar untuk proses panjang tanpa pengawasan.
Kedua angka tersebut memiliki catatan yang sama seperti milik para vendor: keduanya adalah pengukuran dengan effort maksimal, dan default rilis dari kedua model bukanlah effort maksimal. Claude Opus 5.5 secara default menggunakan mediumpada skala effort yang berkisar dari low hingga max; GPT-6 Sol menyediakan skala yang berkisar dari none hingga max. Indeks effort maksimal adalah cara yang adil untuk membandingkan batas atas sekaligus cara yang menyesatkan untuk memprediksi tagihan Anda.
Apa yang rusak saat Anda beralih, di kedua arah
Gesekan migrasi di sini bersifat asimetris dan perlu diketahui sebelum salah satu langkah diambil.
Claude Opus 5.5 bukan pengganti langsung untuk Claude Opus 5. Thinking tidak dapat lagi dinonaktifkan, sehingga kode yang menetapkan jalur non-thinking akan error atau mengubah perilaku secara diam-diam. Penggunaan tool yang dipaksa akan menghasilkan error. Blok thinking terikat pada model dan percakapan yang menghasilkannya, sehingga tidak dapat diputar ulang lintas model. Versi lama dari computer_20251124 tool computer-use tidak diterima di Claude API atau Google Cloud. Secara terpisah, teks di antara panggilan tool kini dikembalikan di dalam blok thinking yang kosong pada pengaturan tampilan default, sehingga aplikasi yang melakukan streaming teks tersebut sebagai progres akan sekadar menjadi senyap di antara panggilan tanpa memunculkan apa pun.
Skala effort GPT-6 Sol adalah yang lebih fleksibel di antara keduanya: skala ini dapat diubah di tengah percakapan tanpa membuat prompt cache menjadi tidak valid, yang berarti jalur pertama yang murah dan percobaan ulang yang mahal pada konteks yang sama adalah pola yang didukung, bukan pola yang merusak cache. Itu adalah keunggulan rekayasa yang nyata bagi siapa pun yang menjalankan penalaran berjenjang dalam satu sesi, dan itu adalah argumen terkuat untuk Sol yang tidak muncul di tabel harga mana pun.
Menjalankan keduanya, dan memutuskan dengan angka Anda sendiri
Posisi yang jujur soal perbandingan ini adalah tabel vendor tidak bisa menyelesaikannya, dan indeks independen hanya menetapkan batas atasnya. Yang tersisa adalah pertanyaan beban kerja — berapa lama konteks Anda benar-benar berjalan, dan berapa besar biaya dari percobaan yang gagal — dan itu terukur pada trafik Anda sendiri, bukan bisa diperdebatkan dari siaran pers.
Kedua model dapat dirutekan dari OrcaRouter dengan harga daftar penyedia tanpa markup 0%: GPT-6 Sol di harga OpenAI $2,00 / $10,00 dan Claude Opus 5.5 di harga Anthropic $4,00 / $20,00. Karena penerusan harganya persis dan harga berubah pada hari yang sama saat vendor mengubahnya, rasio yang Anda ukur di staging adalah rasio yang Anda bayar di produksi, tanpa lapisan markup yang perlu dihitung ulang. Satu kunci mencakup keduanya, sehingga aturan routing yang mengirim panggilan di bawah 272K ke Sol dan panggilan konteks panjang ke model mana pun yang menang pada evaluasi Anda hanyalah perubahan konfigurasi, bukan integrasi kedua — dan failover otomatis berarti peluncuran di hari yang sama pada salah satu sisi adalah sesuatu yang bisa Anda beri seporsi trafik, bukan taruhan yang Anda lakukan dengan seluruh pipeline.

Versi dari ini yang bertahan saat berhadapan dengan sebuah RUU
GPT-6 Sol adalah model yang lebih murah di setiap baris, dalam setiap konfigurasi, dan itu tidak diperdebatkan. Yang tidak bertahan adalah asumsi bahwa "setengah harga" adalah angka yang harus dijadikan patokan: pada panggilan konteks panjang, tarif input bertemu di sekitar $4 dan selisih output menyempit menjadi seperempat, yang merupakan keputusan berbeda dari yang dijelaskan halaman peluncuran. Timbang itu dengan selisih indeks sepuluh poin, tujuh belas peringkat, dan token pertama terukur 142 detik, dan pembagiannya menjadi jelas dengan sendirinya untuk sebagian besar beban kerja — Sol sebagai default volume tinggi pada konteks pendek dan menengah, Claude Opus 5.5 ketika konteksnya panjang atau tugasnya cukup sulit sehingga percobaan ulang lebih mahal daripada selisih token. Kesalahan yang layak dihindari adalah memilih salah satu dari ini hanya berdasarkan tarif utama, karena angka kedua pada setiap kartu tarif yang menentukan kasus yang menjadi tujuan pembuatan kedua model.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
