Kartu judul hasil generasi untuk Claude Opus 5.5 vs Claude Sonnet 5, dengan subjudul 'Setengah harga, dua puluh poin indeks, lima bulan titik buta', dengan tiga ikon garis datar (lambang basis data bertumpuk, diagram batang yang naik, dan kalender dengan jam) serta baris footer bertuliskan 'Indeks menurut Artificial Analysis pada upaya maksimal; harga menurut Anthropic.' Logo OrcaRouter yang asli dikompositkan di kanan bawah.
Guides & Insights

Claude Opus 5.5 vs Claude Sonnet 5: Setengah Harga, Dua Puluh Poin Indeks, dan Titik Buta Lima Bulan

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Jika Anda hanya menginginkan aturannya: gunakan Claude Sonnet 5 secara default dan naikkan ke Claude Opus 5.5 ketika suatu tugas gagal, karena model yang lebih murah itu benar-benar setengah harga dan benar-benar kelas kemampuan yang berbeda. Dua angka di balik itu adalah 38 dan 58 — skor Sonnet 5 dan Opus 5.5 pada Artificial Analysis Intelligence Index, pada evaluator yang sama, dalam keluarga konfigurasi yang sama. Selisih dua puluh poin pada indeks itu bukan sekadar penentu seri, dan itu adalah perbedaan terbesar dalam adu Claude-versus-Claude apa pun yang saat ini dapat Anda buat: Claude Opus 5.5 berada di peringkat #1 dari 210 model dan Claude Sonnet 5 berada di peringkat #54, dan selisih harga di antara keduanya adalah $2 per juta token input.

Itu bagian yang mudah. Bagian yang sulit adalah bahwa eskalasi secara selektif menuntut kita mengetahui tugas mana yang gagal, dan kedua model itu tidak sepakat tentang dunia setelah Januari 2026 dengan cara yang tidak akan muncul sebagai kesalahan dalam eval mana pun.

Selisih dua puluh poin, dalam konteks

A two-column scoreboard comparing Claude Opus 5.5 and Claude Sonnet 5 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 38, ranked #54), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), default effort (medium against high), knowledge cutoff (Jun 2026 against Jan 2026), output speed (not yet published against 79.3 tokens per second) and cache read ($0.20 per million on both). The footer reads 'Index and speed figures per Artificial Analysis at max effort; prices, effort defaults and cutoffs per Anthropic.'

Artificial Analysis menjalankan setiap model dalam satu konfigurasi yang dipublikasikan, dan kedua model ini berbagi label keluarga — "Adaptive Reasoning, Max Effort" — yang membuat perbandingannya luar biasa bersih:

• Intelligence Index — Claude Opus 5.5 58, peringkat #1 dari 210 vs Claude Sonnet 5 38, peringkat #54

• Harga — Claude Opus 5.5 $4.00 masuk / $20.00 keluar per juta vs Claude Sonnet 5 $2.00 / $10.00

• Kecepatan output — Claude Sonnet 5 79,3 token/detik vs Claude Opus 5.5 yang belum dipublikasikan di papan peringkat

• Waktu hingga token pertama — Claude Sonnet 5 150,02 dtk vs median papan 3,83 dtk

• Upaya default — Claude Opus 5.5 sedang vs Claude Sonnet 5 tinggi

• Batas pengetahuan — Juni 2026 untuk Claude Opus 5.5 vs Januari 2026 untuk Claude Sonnet 5

• Konteks dan output — konteks 1M dan output maksimal 128K pada keduanya

Kolom peringkat adalah bagian yang layak direnungkan. Dua puluh poin indeks bukanlah empat posisi di papan peringkat; melainkan empat puluh sembilan. Di papan yang berisi 210 model, Opus 5.5 dan Sonnet 5 bukanlah tetangga dengan selisih harga — keduanya berada di band yang berbeda, dan selisih $2 per juta itu membeli lompatan kemampuan yang nyata, bukan sekadar lencana. Siapa pun yang membaca liputan minggu ini sebagai "Anthropic merilis Opus yang lebih murah" dan menganggap tier Sonnet menyerapnya harus melihat pasangan peringkat itu: halaman harga Anthropic sendiri masih mencantumkan Claude Sonnet 5 sebagai produk yang masih berlaku, dan posisinya di papan independen tidak bergeser.

Dua catatan penting membuat ini tetap jujur. Kedua skor dijalankan pada upaya maksimal, dan default rilis masing-masing model bukanlah maksimal — Sonnet 5 default ke high, Opus 5.5 ke medium. Dan baris kecepatan memperumit cerita ini demi keunggulan Sonnet 5: 79,3 token per detik dengan token pertama 150 detik adalah profil latensi nyata yang terukur, dan itu adalah satu-satunya dari keduanya yang ada di papan. Kecepatan dan latensi Opus 5.5 belum dipublikasikan oleh Artificial Analysis, yang berarti klaim "lebih cepat" dalam pertarungan ini saat ini bersandar pada materi vendor alih-alih hasil pengukuran.

Catatan kaki yang mengubah harga Sonnet 5

Hal paling konkret yang muncul dari bulan lalu untuk Claude Sonnet 5 adalah sebuah kalimat yang dilewatkan oleh sebagian besar liputan. Ketika model itu diluncurkan pada 30 Juni 2026, tarif $2 / $10-nya diumumkan sebagai harga perkenalan hingga 31 Agustus, dengan kenaikan terjadwal menjadi $3 / $15 pada 1 September. Di halaman harga Anthropic saat ini, catatan kakinya menyebutkan bahwa harga $2/$10 "kini menjadi harga standar" dan bahwa kenaikan itu "tidak akan terjadi."

Itu penting karena dua alasan. Yang jelas, kenaikan 50% yang diumumkan lalu dibatalkan adalah pos biaya yang kini bisa Anda rencanakan — Sonnet 5 bukan tarif promosi yang harus Anda modelkan masa berakhirnya. Yang kurang jelas, itu memperbaiki aritmetika eskalasi. Dengan Sonnet 5 permanen di $2/$10 dan Opus 5.5 di $4/$20, rasio antara kedua tier itu tepat 2x di kedua arah, dan stabil. Aturan eskalasi yang mengirim, katakanlah, seperlima trafik Anda ke Opus 5.5 memiliki biaya yang bisa Anda hitung sekali dan berhenti menghitung ulang.

Tarif batch dan cache bergerak bersamaan, dan itulah yang membuat perbandingan seluruh tabel berguna: Sonnet 5 menetapkan tarif batch sebesar $1,00 / $5,00 dibandingkan Opus 5.5 sebesar $2,00 / $10,00, dan keduanya menagih pembacaan cache sebesar $0,20 per juta. Angka terakhir itu benar-benar seri — Opus 5.5 memangkas pembacaan cache-nya dari $0,50 menjadi $0,20, dan Sonnet 5 sudah berada di sana. Jika beban kerja Anda didominasi oleh pembacaan ulang konteks cache yang besar alih-alih menghasilkan output baru, keunggulan harga dari model yang lebih murah jauh lebih kecil daripada yang disiratkan oleh rasio utamanya, karena satu baris tempat keduanya sama adalah baris tempat Anda paling banyak membelanjakan.

Cutoff adalah bagian yang gagal secara diam-diam.

A generated two-card graphic titled 'Knowledge cutoffs, five months apart', showing Claude Sonnet 5 with a knowledge cutoff of January 2026 against Claude Opus 5.5 with a cutoff of June 2026, separated by a marker reading '5 months of coverage'. The footer reads 'Cutoff dates per Anthropic's Claude model documentation, current as of September 2026.'

Claude Opus 5.5 memiliki batas pengetahuan pada Juni 2026. Batas pengetahuan Claude Sonnet 5 adalah Januari 2026. Itu adalah selisih lima bulan, dan itulah satu-satunya dimensi dalam perbandingan ini yang tidak menunjukkan dirinya sendiri. Model yang tidak mengetahui suatu peristiwa tidak menjadi lebih lambat atau kurang akurat dalam hal tersebut dengan cara yang dapat ditangkap oleh penanganan kesalahan Anda — model itu menjawab dengan percaya diri dari dunia yang sudah bergerak maju, dan kegagalannya tampak seperti jawaban salah yang masuk akal alih-alih sebuah penolakan.

Untuk beberapa beban kerja, hal ini tidak relevan: melakukan refactoring pada basis kode yang konvensinya stabil, merangkum dokumen yang Anda berikan, mentransformasi data terstruktur. Untuk beban kerja lain, hal ini sudah mendiskualifikasi dengan sendirinya, terlepas dari dua puluh poin indeks atau harganya. Apa pun yang menyentuh perangkat lunak yang dirilis pada paruh kedua tahun 2026, apa pun yang menjawab pertanyaan tentang peristiwa terkini, apa pun yang bergantung pada API atau versi pustaka yang berubah setelah Januari — tugas-tugas itu tidak dapat dieskalasi ke Opus 5.5, tugas-tugas itu harus dimulai di sana. Lima bulan itu bukan perbedaan kualitas; itu adalah pembatasan cakupan, dan hal itu termasuk dalam aturan perutean, bukan dalam evaluasi.

Kedua model berbagi sisa amplopnya, yang membatasi seberapa jauh batas potong dapat disiasati. Keduanya menerima konteks 1 juta token dan mengembalikan hingga 128K, keduanya menjalankan pemikiran adaptif yang tidak dapat dimatikan, dan keduanya hanya mengekspos kedalaman melalui parameter effort. Tidak ada konfigurasi di mana Sonnet 5 diberi dokumen yang lebih panjang sebagai kompensasi.

Menjalankan split

Versi praktis dari perbandingan ini adalah default dan pengecualian, dan pengecualiannya harus ditentukan oleh sesuatu selain "tugas sulit". Pola yang bertahan adalah berdasarkan kelas tugas, bukan berdasarkan tingkat kesulitan: Sonnet 5 untuk pekerjaan bervolume tinggi yang cutoff-nya tidak relevan dan profil latensinya dapat diterima, Opus 5.5 untuk apa pun yang terkini, apa pun yang berjangka panjang, atau apa pun yang biaya percobaan gagalnya lebih besar daripada selisih tokennya.

Itu adalah konfigurasi perutean, bukan penulisan ulang, dan di situlah satu endpoint membuktikan manfaatnya. Claude Sonnet 5 tersedia di OrcaRouter dengan harga Anthropic sendiri $2.00 / $10.00, dan Claude Opus 5.5 tersedia di sana dengan harga $4.00 / $20.00 — harga daftar penyedia diteruskan dengan markup 0%, sehingga rasio biaya dalam aturan eskalasi Anda adalah rasio biaya yang diterbitkan Anthropic, tanpa lapisan markup yang menggesernya. Keduanya berada di balik satu kunci, yang berarti jalur eskalasi cukup berupa pengeditan aturan alih-alih integrasi kedua, failover otomatis mencegah primary yang gagal ikut menjatuhkan permintaan, dan perbandingan yang menentukan ambang batas Anda dapat dijalankan di dalam trafik Anda sendiri alih-alih direkonstruksi dari dua tabel vendor.

A screenshot of OrcaRouter's own model page for anthropic/claude-sonnet-5, headed 'Claude Sonnet 5' and credited to Anthropic, showing $2.00 input and $10.00 output per 1M tokens, a 1M-token context and a PERFORMANCE panel with 79.3 output tokens per second, a 150.02s time to first token and 55M output tokens over 7 days.

Siapa yang harus bergerak, dan siapa yang harus menunggu.

Jika Anda sudah menggunakan Claude Sonnet 5 dan model itu berfungsi, alasan untuk menggantinya lemah: model ini setengah harga, tarifnya kini permanen, dan selisih indeks hanya relevan pada tugas-tugas yang gagal dilakukannya. Alasan untuk menambahkan Claude Opus 5.5 di atasnya kuat, asalkan Anda dapat menyebutkan pemicunya — dan pemicunya biasanya berupa kegagalan cutoff atau tugas yang tetap salah meskipun Sonnet 5 dijalankan dengan upaya maksimal.

Jika Anda sedang memilih model Claude pertama Anda, jawabannya tidak seimbang seperti yang terlihat dari rasio harga. Selisih indeks dua puluh poin dan tambahan lima bulan pengetahuan untuk token dua kali lipat adalah pertukaran yang akan diambil sebagian besar beban kerja produksi pada sebagian kecil panggilan, dan hampir tidak ada yang akan mengambilnya untuk semua panggilan. Kesalahan yang harus dihindari di kedua arah adalah menganggap keduanya dapat dipertukarkan dan beralih hanya berdasarkan biaya, karena kegagalan yang mengikutinya bukanlah jawaban yang lebih buruk — melainkan jawaban yang begitu yakin tentang dunia yang berakhir pada Januari.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari