
Claude Sonnet 5.5: Default Kelas Menengah, Ditentukan Sepenuhnya
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Claude Sonnet 5.5 adalah model kelas menengah dari lini Claude, dirilis pada 28 September 2026, dan harganya adalah alasan utama mengapa model ini layak mendapat halaman tersendiri: $2 per juta token masukan dan $10 per juta token keluaran, dibandingkan $4 dan $20 untuk Claude Opus 5.5, model unggulan yang meluncur enam hari sebelumnya. Itu berarti setengah harga keluaran untuk 1,62 poin Artificial Analysis Intelligence Index — 56,00 untuk kelas menengah versus 57,62 untuk sang unggulan, kedua angka tersebut diukur oleh Artificial Analysis pada revisi indeks v4.3.2 dan bukan oleh kami dan bukan oleh vendor. Di atas keduanya ada Claude Fable 5.1, pada $10 / $50 dan 53,35 pada revisi yang sama: lebih mahal daripada sang unggulan, tetapi tertinggal di belakangnya. Pada harga daftar $2 / $10 yang sama dengan Claude Sonnet 5.5 terdapat GPT-6.1 Sol milik OpenAI, pada 51,83 — 417 perseratus indeks di sisi seberang garis, yang justru merupakan perbandingan yang harus dibuat oleh pembaca yang menimbang model kelas menengah.
Halaman ini adalah rujukan, dan tanggal-tanggalnya menjelaskan alasannya, bukan menunjukkan kebaruannya. Claude Sonnet 5.5 berusia sepuluh hari pada 2026-10-08, yang menempatkannya di luar jendela tujuh hari yang dipakai blog ini untuk melaporkan berita. Yang berada di dalam jendela itu adalah peristiwa berusia enam hari: dua unggahan di X bertanggal 2026-10-02, yang mengklaim bahwa model penerus dalam keluarga ini mengalahkan rival yang telah selesai dibuat dan ditahan oleh vendornya sendiri. Klaim itu tidak punya id model, tidak punya kartu tarif, tidak punya jendela konteks, dan tidak ada tolok ukur di baliknya di registri mana pun yang dapat dijangkau dari sini, dan itu bukan subjek halaman ini — rantai sumber, pemeriksaan ketiadaan permukaan vendor, dan sebaran indeks lima model sepenuhnya ditangani oleh tulisan yang sudah diterbitkan blog ini dengan judul "Claude Fable 5.5 Beat GPT-6.1 Astra Before It Exists — and That Is the Interesting Part", yang bertanggal 2026-10-03. Yang dihasilkan klaim itu adalah antrean pembaca yang bertanya model Claude yang sudah dirilis mana yang harus dijadikan standar sementara mereka menunggu, dan pertanyaan itu membutuhkan halaman tentang model yang ada. Inilah halaman itu.
Apa yang dirilis pada 28 September 2026
Dokumentasi vendor itu sendiri memberikan spesifikasinya secara langsung, dan ini merupakan kelanjutan dari tier tersebut, bukan bentuk baru. Semua yang ada di bawah ini dibaca dari dokumentasi Claude Platform milik Anthropic pada 2026-10-08, jadi ini adalah spesifikasi Anthropic, bukan pengujian independen terhadapnya.
• Dirilis — 28 September 2026. Halaman dokumentasi model itu sendiri dibuka dengan baris "Terbaru. Dirilis 28 September 2026."
• Positioning — "Kombinasi terbaik antara kecepatan dan kecerdasan", dengan latensi komparatif yang dicantumkan sebagai Cepat dibandingkan Sedang untuk Claude Opus 5.5, Lebih Lambat untuk Claude Fable 5.1, dan Paling Cepat untuk tier kecil.
• ID Model — claude-sonnet-5-5 di Claude API, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS; anthropic.claude-sonnet-5-5 di Amazon Bedrock. Setiap ID model Claude adalah snapshot yang dipatok, sehingga string tersebut bukan pointer yang bergeser di bawah Anda.
• Konteks dan output — 1.000.000 token konteks dan 128.000 token output sinkron pada Messages API, meningkat hingga 300.000 di balik output-300-2026-03-24 header beta pada Message Batches API.
• Berpikir — adaptif, selalu aktif secara default, dengan effort default high. Pengaturan terendah adalah between_tools, yang menonaktifkan berpikir di awal dan diterima pada high effort atau di bawahnya. Mengatur temperature, top_p atau top_k ke nilai apa pun selain defaultnya akan mengembalikan error 400, sehingga permintaan yang dimigrasikan dari model Claude yang lebih lama dengan temperature yang disesuaikan akan gagal secara mencolok, bukan secara diam-diam.
• Batas pengetahuan — Juni 2026, untuk batas yang andal maupun batas data pelatihan.
• Siklus Hidup — Aktif (terbaru), dengan komitmen penghentian tidak lebih cepat dari 28 September 2027 pada platform yang dioperasikan Anthropic. Amazon Bedrock dan Google Cloud menetapkan tanggalnya masing-masing.
Pembingkaian peluncuran dari vendor ini layak dikutip karena itu adalah klaim, bukan pengukuran: pengumuman Anthropic menggambarkan Claude Sonnet 5.5 sebagai "peningkatan yang jelas dibandingkan Sonnet 5 yang berjalan 30% lebih cepat dan hingga 30% lebih hemat untuk sebagian besar pekerjaan." Itu klaim vendor, tidak kami reproduksi, dan klaim semacam itu sepenuhnya bergantung pada apa yang Anda hadapkan padanya. Ada juga biaya migrasi yang melekat pada rilis ini yang tidak dibahas di halaman ini: lima breaking change memengaruhi kode yang sudah berjalan di Claude Sonnet 5, dan yang keenam mengubah bentuk respons tanpa membuat permintaan mana pun gagal. Perhitungan itu termasuk dalam tulisan perincian peluncuran yang diterbitkan blog ini pada pekan rilis, dan itu hal pertama yang perlu dibaca jika Anda menjalankan Sonnet 5 di produksi hari ini.

Poin 1,62, dan setengah harga
Skor independen untuk model ini berasal dari satu tempat, dan skor tersebut membawa satu angka yang menentukan argumen. Artificial Analysis mengukur Claude Sonnet 5.5 pada 56.00 dalam Intelligence Index-nya, revisi v4.3.2, dalam konfigurasi yang disebut halaman tersebut sebagai "Claude Sonnet 5.5 (Max, Default Fallback)". Kami membaca halaman itu pada 2026-10-08. Pada revisi yang sama, di hari yang sama:
• Claude Opus 5.5 — 57.62, dirilis 2026-09-22, $4 / $20
• Claude Sonnet 5.5 — 56.00, dirilis 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53.35, dirilis 2026-09-01, $10 / $50
• GPT-6 Astra — 52,67, dirilis 2026-09-03, $10 / $50, dengan tier konteks panjang di atas 272.000, $10 / $50
• GPT-6.1 Sol — 51.83, dirilis 2026-09-29, $2 / $10
Menyebutkan revisi mana yang dimaksud itu penting, karena skor dari satu versi indeks tidak dapat dibandingkan dengan skor dari versi lain: v4.3.2 mencakup sepuluh evaluasi — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience dan AA-LCR v1.1 — dan komposisi kumpulan itu telah berubah antarrevisi. Kelima angka di atas berasal dari revisi yang sama, itulah sebabnya angka-angka tersebut dapat dibandingkan satu sama lain, dan mengapa tidak satu pun darinya dapat dibandingkan dengan angka yang dikutip dari versi sebelumnya.
Perbandingan harga adalah bagian yang menentukan perilaku. Tarif output Claude Sonnet 5.5 adalah setengah dari Claude Opus 5.5, dan tarif inputnya juga setengah; pada daftar milik vendor sendiri, tier menengah berbiaya $2 / $10 sedangkan flagship berbiaya $4 / $20. Sandingkan kedua angka yang dipublikasikan itu, dan rasionya sangat mencolok: per dolar harga daftar output, Claude Sonnet 5.5 membawa 5,60 poin indeks dan Claude Opus 5.5 membawa 2,88 — hampir dua kali lebih banyak indeks per dolar output, menurut kartu tarif Anthropic sendiri dan pengukuran Artificial Analysis sendiri. Itu adalah aritmetika atas dua angka yang dipublikasikan, bukan pengukuran atas apa pun, dan itulah bentuk jujur dari argumen yang mendukung tier menengah. Ini juga bukan putusan: satu poin indeks bukanlah satuan kebenaran, dan inti dari sisa halaman ini adalah dari apa 1,62 itu terbentuk dan tidak terbentuk.

Kartu tarif, dan dua lini yang paling banyak bergerak
Daftar harga lengkap Anthropic, dibaca pada 2026-10-08. Setiap angka di bagian ini berasal dari vendor.
• Masukan — $2.00 per juta token. Keluaran — $10.00 per juta, dan token pemikiran ditagih sebagai keluaran, yang tidak dapat ditekan di sini karena pemikiran adaptif aktif secara default.
• Pembacaan cache — $0,10 per juta, yang didokumentasikan Anthropic sebagai 5 persen dari harga input dasar. Itu adalah diskon proporsional yang sama dengan yang berlaku pada Claude Opus 5.5, jadi caching tidak mengubah peringkat antara keduanya, dan itu berarti proses agen yang panjang yang mempertahankan prefiks stabil hanya membayar sepersepuluh tarif input untuk semua yang dibacanya kembali.
• Penulisan cache — $2.50 per juta untuk cache lima menit, $4.00 untuk cache satu jam. Panjang prompt minimum yang dapat di-cache adalah 512 token, sehingga prompt pendek sama sekali tidak bisa mendapatkan diskon tersebut.
• Batch API — diskon 50 persen untuk kedua arah, jadi $1,00 untuk input dan $5,00 untuk output bagi pekerjaan yang bisa ditunda.
• Tanpa biaya tambahan konteks panjang — Anthropic menagih seluruh jendela 1M token dengan tarif standar per token pada model ini, sehingga permintaan 900.000 token dikenai biaya per token yang sama dengan permintaan 9.000 token. Ini perbedaan nyata dari GPT-6 Astra, yang tingkat konteks panjangnya di atas 272.000 token prompt melonjak menjadi $20 / $75 — layak disebut karena ini satu-satunya tempat di mana angka utama kedua vendor tersebut berbeda tajam begitu prompt menjadi panjang.
Dua pos biaya inilah yang kemudian menentukan sebagian besar tagihan, bukan tarif utamanya: diskon baca cache selama eksekusi agen yang panjang, dan diskon batch untuk apa pun yang asinkron. Angka utama $2 / $10 adalah yang dibandingkan di papan peringkat; pos cache dan batch adalah yang sebenarnya menjadi dasar faktur bulanan.
Apa yang dimaksud dan tidak dimaksud dengan kesenjangan
Intelligence Index adalah satu angka atas campuran tugas yang tetap, dan sifat tunggal itulah yang menjelaskan sebagian besar kebingungan di sekitarnya. Sepuluh evaluasi di balik v4.3.2 mencakup pengodean agentic dan pekerjaan terminal, penalaran ilmiah tingkat pascasarjana, satu set rekayasa perangkat lunak, satu set otomatisasi agentic, dan satu set pengambilan konteks panjang, yang diberi bobot menjadi sebuah komposit. Model yang tertinggal 1,62 poin dari model lain tertinggal pada komposit tersebut — bukan pada beban kerja Anda, yang mungkin memberi bobot pada kesepuluh evaluasi itu dalam proporsi yang sama sekali berbeda, dan mungkin berisi tugas-tugas yang tidak diwakili oleh satu pun dari evaluasi tersebut.
Dalam praktik, itu berarti pembagian berdasarkan bentuk pekerjaannya, bukan berdasarkan prestise tier-nya. Pemilih model milik Anthropic sendiri menyatakan pembagian ini secara eksplisit, dan itu layak dibaca karena tidak menyanjung tier menengah: dokumentasinya memberi tahu pembaca untuk "mulai dengan Claude Opus 5.5 untuk sebagian besar beban kerja", dan beralih ke Claude Fable 5.1 "untuk penalaran yang menuntut dan pekerjaan agentik berhorizon panjang, atau ketika evaluasi Anda pada Claude Opus 5.5 dengan upaya lebih tinggi masih kurang memadai". Claude Sonnet 5.5 bukan model yang mengawali kalimat itu. Model itulah yang digambarkan oleh dokumentasi yang sama sebagai kombinasi terbaik antara kecepatan dan kecerdasan, dengan latensi komparatif tercepat di luar tier kecil — yang merupakan argumen yang berbeda, dan yang lebih sempit.
Jadi pembacaan yang jujur adalah ini. Tingkat menengah biasanya jawaban yang tepat untuk pekerjaan bercakupan jelas dalam volume besar: fitur dan perbaikan bug pada basis kode yang sudah dikenal, ekstraksi dan klasifikasi dengan bentuk keluaran yang telah ditentukan, loop pemanggilan alat ketika bagian sulitnya adalah harness, bukan penalaran, dan apa pun yang mengutamakan token pertama yang cepat serta biaya per panggilan yang rendah dibandingkan dua persen terakhir kemampuan. Flagship layak dengan tarifnya ketika pekerjaannya benar-benar berjangka panjang — eksekusi agen selama berjam-jam, refaktor yang mencakup berkas-berkas yang tidak dapat ditampung prompt sekaligus, dan evaluasi pada tingkat menengah yang secara terukur kurang memadai pada upaya yang lebih tinggi. Syarat terakhir itu milik vendor sendiri, dan merupakan syarat yang dapat diuji: naikkan tingkat upaya pada tingkat menengah, jalankan eval Anda sendiri, dan lihat apakah itu menutup kesenjangannya. Jika ya, 1.62 bukanlah penopang bagi Anda. Jika tidak, Anda telah membeli jawaban Anda dengan angka Anda sendiri, bukan dengan komposit orang lain.
Selisih itu tidak berarti bahwa 1.62 poin bukanlah apa-apa. Itu adalah seluruh margin antara dua model, dan pada harness tetap yang dievaluasi dalam kondisi identik, itu adalah urutan yang nyata. Itu sekadar urutan dari campuran tugas tertentu, pada upaya maksimal dengan fallback default, dan tidak mengatakan apa pun tentang mana dari keduanya yang lebih layak dibeli untuk beban kerja yang tidak dijadikan tolok ukur bagi keduanya.
Jebakan nama: ini halaman Claude Sonnet 5.5 yang mana
Pembaca yang mencari nama model ini akan menemukan beberapa halaman di blog ini yang tampak seperti halaman ini, padahal bukan. Halaman bertanggal 2026-09-24 adalah halaman antisipasi: halaman itu ditulis sebelum model dirilis, dan subjeknya adalah satu unggahan X yang mengklaim adanya uji siluman, direkonstruksi terhadap angka-angka model yang akan digantikannya. Halaman yang diterbitkan pada pekan peluncuran adalah tulisan peluncuran: subjeknya adalah lima perubahan besar yang memengaruhi kode yang sudah berjalan di Claude Sonnet 5, ditambah perubahan keenam yang mengubah bentuk respons tanpa memunculkan error. Ada juga sederet halaman matchup yang membawa nama model ini melawan model vendor lain, dan halaman terapan tentang cakupan promosi peluncuran tersebut.
Tidak satu pun dari itu adalah halaman model, dan itulah celah yang diisi artikel ini. Halaman ini adalah referensi yang dicapai pembaca setelah mencari nama model itu sendiri: apa itu, berapa biayanya, apa yang diukurnya, dan karya mana yang termasuk di dalamnya. Detail migrasi di halaman peluncuran dan kritik sumber di halaman antisipasi tetap berada di tempatnya; jika Anda memiliki kode Sonnet 5 di produksi, halaman peluncuran adalah klik pertama Anda, dan halaman inilah yang memberi tahu Anda apakah model yang Anda migrasikan adalah model yang Anda inginkan.
Satu kebiasaan penamaan layak diperbaiki selagi kita di sini, karena kebiasaan itu menyesatkan dengan sendirinya. Akhiran 5.5 menandai generasi, bukan peringkat. Claude Sonnet 5.5 dan Claude Opus 5.5 adalah generasi yang sama dari keluarga yang sama, dan angka di depan titik adalah tingkatannya. Tidak ada apa pun pada akhiran itu yang memberi tahu Anda mana yang menang dalam benchmark.
Ketersediaan, bertanggal
Claude Sonnet 5.5 telah tersedia di OrcaRouter sejak dirilis, sebagai anthropic/claude-sonnet-5.5, dengan harga daftar resmi Anthropic tanpa markup tambahan: $2,00 untuk input dan $10,00 untuk output per juta token, dua angka tersebut dibaca dari endpoint model kami sendiri pada 2026-10-08 dan cocok dengan kartu tarif vendor baris demi baris. Halaman kami untuk model ini mencantumkan jendela konteks 1M token dan output maksimum 128K yang sama, mendaftarkan teks, gambar, dan file sebagai jenis input yang diterima serta teks sebagai satu-satunya output, menandainya dirilis pada 2026-09-28 dan tidak deprecated, dan menunjukkan bahwa model ini dapat diakses baik melalui endpoint chat-completions yang kompatibel dengan OpenAI maupun melalui endpoint messages milik Anthropic sendiri — yang membuatnya menjadi perubahan drop-in bagi integrasi yang sudah berbicara salah satu dari keduanya.
Semua hal lain dalam katalog yang sama dijangkau dari kunci yang sama: satu API untuk 200+ model, dengan harga daftar penyedia yang diteruskan dengan markup 0% sehingga penurunan harga vendor sampai ke pelanggan pada hari diumumkannya, failover otomatis ketika sebuah endpoint menurun kinerjanya, dan DSL routing untuk kasus-kasus di mana Anda ingin menyematkan satu model atau menggabungkan beberapa model menjadi satu jawaban. Kombinasi itulah yang membuat pertanyaan di halaman ini murah untuk dijawab alih-alih mahal. Kedua model dalam perbandingan di atas berada di balik kredensial yang sama, sehingga harga yang Anda bandingkan adalah harga yang diterbitkan vendor sendiri, bukan harga reseller, dan uji versi hanya memerlukan satu kali menjalankan eval, bukan proyek migrasi: arahkan sebagian trafik ke anthropic/claude-sonnet-5.5, biarkan sisanya pada model unggulan, dan biarkan angka biaya per tugas yang diselesaikan versi Anda sendiri yang menentukan mana yang seharusnya menjadi default.

Versi singkatnya
Claude Sonnet 5.5 adalah model kelas menengah dengan angka yang mendekati model unggulan dan setengah harga output model unggulan, dan tiga fakta yang menentukan apakah ia menjadi default Anda adalah ini. Ia berada 1,62 poin di belakang Claude Opus 5.5 pada indeks v4.3.2 Artificial Analysis, pada 56,00 versus 57,62, dengan kedua angka diukur pada revisi yang sama dan dalam konfigurasi upaya maksimum yang sama dengan fallback default. Biayanya $2 / $10 dibandingkan $4 / $20 milik model unggulan, dengan diskon cache dan batch yang proporsional, bukan berbeda, sehingga selisih harga tetap bertahan pada setiap diskon yang ditawarkan masing-masing model. Dan secara default ia menggunakan upaya tinggi, sedangkan model unggulan secara default menggunakan sedang, yang berarti pengaturan yang diwarisi dari model unggulan berjalan satu tingkat lebih tinggi di sini, bukan lebih rendah, dan biaya dari hal itu menjadi tanggung jawab Anda untuk mengukur, bukan mengasumsikan.
Pemilih milik Anthropic sendiri masih dimulai dari Claude Opus 5.5 untuk sebagian besar beban kerja, dan itu layak diketahui sebelum Anda menstandarkan apa pun. Tetapi bagi sebagian besar pembaca yang tiba di halaman ini dengan mencari nama model ini, tingkat menengah adalah default yang masuk akal dan model unggulan adalah pengecualian yang Anda beli ketika evaluasi Anda sendiri menuntutnya — pekerjaan dengan cakupan jelas dalam volume besar, latensi cepat, jendela satu juta token tanpa biaya tambahan konteks panjang, dan tarif yang memangkas separuh biaya keluaran. Keduanya hanya berjarak satu kunci di OrcaRouter, dan evaluasi yang menentukan di antara keduanya memakan waktu satu sore, bukan migrasi.
Dibandingkan dalam artikel ini4
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
