
Claude Sonnet 5.5: Kebocoran Uji Siluman yang Dibangun dari Empat Angka yang Sudah Ada
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 36 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 181 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
Empat angka diposting di X pada 24 September sebagai bukti bahwa Claude Sonnet 5.5 "sudah diuji secara sembunyi-sembunyi": jendela konteks 1 juta token, keluaran maksimum 128 ribu token, $2 per juta token masukan dan $10 per juta token keluaran. Keempatnya ada di daftar harga Anthropic sendiri saat ini, terlampir pada Claude Sonnet 5 — model yang akan digantikan oleh 5.5, tersedia secara umum sejak 30 Juni 2026. Angka $2 / $10 yang sama juga dimiliki oleh GPT-6 Sol, yang diluncurkan OpenAI pada 22 September, dan tumpang tindih itulah yang membuat postingan tersebut terbaca sebagai jawaban terhadap OpenAI alih-alih penyegaran tingkat rutin: "Ini terbaca bagi saya sebagai respons langsung terhadap GPT-6-Sol. Harga sama dan mungkin performa serupa."
Tidak satu pun dari itu membuat klaim tersebut salah. Itu membuat klaim tersebut tidak dapat difalsifikasi, yang merupakan masalah berbeda dan lebih berguna untuk dicatat. Penampakan dalam uji siluman hanya sebaik artefak di baliknya, dan artefak di balik yang ini adalah lembar spesifikasi yang tidak dapat dibedakan dari model yang telah dilayani Anthropic selama dua belas minggu.
Apa yang sebenarnya diposting
Sumbernya adalah satu postingan X dari akun @kimmonismus, bertanggal 24 September 2026. Postingan itu menyebutkan jendela konteks, batas atas keluaran, dan dua harga, membandingkan harganya dengan GPT-6 Sol, lalu menyimpulkan bahwa Sonnet 5.5 sedang diuji. Tidak ada tangkapan layar, tidak ada string model, tidak ada respons API, tidak ada daftar konsol, tidak ada deskripsi perilaku dari penguji, dan tidak ada pengamat kedua yang dilampirkan pada semua itu. Postingan tersebut adalah klaim dengan angka-angka di dalamnya, dan angka-angka itu adalah batas publik dari tier tersebut.
Itu layak dipisahkan dari jenis cerita pra-rilis Anthropic yang lain, karena 2026 telah menghasilkan keduanya dan keduanya sama sekali tidak mirip. Pengenal akses awal Agustus claude-marshmallow-eap dan claude-melon-eap adalah string yang ada dalam request — jelek, tanpa pesona, dan bisa diperiksa. Cerita Opus 5.2 yang berjalan sepanjang September adalah laporan perutean: para pengembang menyadari bahwa backend di balik label "Opus 5" menjawab secara berbeda, dan menggambarkan perilakunya. Keduanya adalah artefak. "Sudah diuji secara diam-diam" tanpa artefak yang disertakan hanyalah ringkasan dari apa yang sudah dijual oleh tier Sonnet.
Ada juga pola yang layak dicatat pada sumbernya sendiri. Akun yang sama memposting rangkuman pada 20 September yang dibuka dengan empat model yang menurutnya "sudah mulai diuji" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 dan Gemini 4 Pro. Dari keempat nama itu, entri Opus dan Fable memiliki laporan terpisah yang terkonfirmasi di belakangnya dan entri Gemini memiliki penampakan sendiri. Entri Sonnet hanya punya posisi dalam sebuah daftar. Empat hari kemudian klaim Sonnet telah berkembang menjadi lembar spesifikasi, dan lembar spesifikasi itu adalah model yang sudah ada.
Keempat angka tersebut adalah angka milik Claude Sonnet 5
Ini bagian yang butuh tiga puluh detik untuk diperiksa dan hampir tidak ada yang melakukannya. Halaman ringkasan model Anthropic, dibaca hari ini, mencantumkan Claude Sonnet 5 dengan jendela konteks 1M token, keluaran maksimum 128K, dan $2 / $10 per juta token. Bandingkan kebocoran itu dengan ini:
• Jendela konteks — 1 juta token diklaim untuk Claude Sonnet 5.5; 1 juta token dipublikasikan untuk Claude Sonnet 5
• Output maksimum — 128K token diklaim; 128K token dipublikasikan
• Harga input — $2 per juta yang diklaim; $2 per juta yang dipublikasikan
• Harga output — $10 per juta yang diklaim; $10 per juta yang dipublikasikan
• ID Model — belum ada yang dipublikasikan untuk Claude Sonnet 5.5; claude-sonnet-5 untuk Claude Sonnet 5
• Skor independen — tidak ada untuk model yang diklaim; Artificial Analysis menempatkan Claude Sonnet 5 pada Intelligence Index 38 di peringkat 54 dari 210 model yang diukurnya, dalam konfigurasi penalaran adaptif, upaya maksimal

Ada lapisan kedua pada persoalan harga yang justru terbalik dalam bocoran tersebut. Saat Claude Sonnet 5 diluncurkan, $2 / $10 diumumkan sebagai harga perkenalan yang berlaku hingga 31 Agustus 2026, dengan kenaikan terjadwal menjadi $3 / $15 pada 1 September. Kenaikan itu tidak terjadi. Halaman harga Anthropic kini memuat catatan kaki yang menyatakan bahwa $2 / $10 "kini menjadi harga standar" dan bahwa "kenaikan yang sebelumnya dijadwalkan menjadi $3 / $15 per juta token input/output pada 1 September 2026 tidak akan terjadi." Jadi, harga yang disajikan bocoran sebagai senjata kompetitif model baru itu adalah tarif permanen pemain yang sudah ada — yang berarti Sonnet 5.5 yang diluncurkan pada $2 / $10 akan diluncurkan tanpa diskon sama sekali, ke tingkat yang harganya sudah dipatok terhadap GPT-6 Sol.
Satu-satunya hal yang sebenarnya telah dikatakan Anthropic
Jika semua hal dari pembocor tanpa nama disingkirkan, satu kalimat pihak pertama tetap bertahan. Ketika Anthropic meluncurkan Claude Opus 5.5 pada 22 September 2026, Anthropic mengatakan bahwa Claude Sonnet 5.5 dan Claude Haiku 5.5 akan menyusul "dalam beberapa minggu ke depan," membawa peningkatan yang sebanding dalam performa, efisiensi, dan keamanan. Kalimat itu adalah keseluruhan catatan yang terkonfirmasi. Kalimat itu tidak memuat ID model, tidak memuat jendela konteks, tidak memuat harga, tidak memuat tolok ukur, dan tidak memuat tanggal — dan secara khusus kalimat itu tidak mengatakan apa pun tentang uji stealth, jalur abu-abu, atau pengujian dalam bentuk apa pun.
Bagian lain dari permukaan publik Anthropic sependapat dengan pembacaan itu. Ikhtisar model masih mencantumkan empat model — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5, dan Claude Haiku 4.5 — tanpa baris kelima, tanpa entri harga, dan tanpa penanda "upcoming" untuk penerus Sonnet. Jika checkpoint tingkat Sonnet disajikan di suatu tempat yang dapat dijangkau pengembang, pengenalnya akan menjadi hal pertama yang muncul, karena model yang disajikan harus memiliki nama dalam permintaan. Tidak ada yang muncul.
Satu hal yang berhasil dipastikan oleh pengumuman September: pengumuman itu bertentangan dengan bocoran sebelumnya yang mengklaim lini Haiku akan dipensiunkan dan generasi 5.5 akan merombak jajaran produk. Haiku 5.5 akan hadir, menurut Anthropic, yang berarti cerita restrukturisasi itu salah ke arah yang jarang dilakukan para pembocor — tier murah tetap dipertahankan.
Kebocoran Agustus menyebut 2 juta token. Yang ini menyebut 1 juta.
Enam minggu sebelum postingan 24 September, pada 9 Agustus, akun X lain memposting lembar spesifikasi "SONNET 5.5 LEAK" dengan klaim yang jauh lebih berani: jendela konteks 2 juta token, dua kali lipat Sonnet 5, inferensi lebih cepat, penggunaan alat browser dan terminal yang lebih baik, performa mendekati Claude Fable 5, dan rilis "bulan depan." Kebocoran itu disertai grafik yang ditata agar terlihat seperti kartu pratinjau Anthropic. Itu juga disertai detail fatal yang langsung disorot para kritikusnya: nama kode yang diberikannya, "Fennec," adalah nama kode yang sudah dirilis bersama Claude Sonnet 5 pada 30 Juni. Nama kode tidak bisa menjadi bukti baru tentang penerus model yang memakainya.
Jadi kedua gelombang kebocoran itu tidak sepakat soal satu angka yang paling banyak dikutip. Agustus menyebut konteks 2M. September menyebut 1M. Keduanya tidak mungkin menggambarkan build yang sama. Tafsiran yang paling mungkin adalah yang membosankan: postingan September menggambarkan batas yang dipublikasikan untuk tier Sonnet karena seperti itulah model tier Sonnet terlihat dari luar, dan postingan Agustus hanyalah tebakan tentang apa yang secara masuk akal akan digandakan oleh sebuah penyegaran. Perhatikan ke arah mana angka itu bergerak — turun, menuju apa yang sudah ada.
Jadi, apakah perbandingan GPT-6 Sol itu benar?
Sebagian besar, dan titik di mana hal itu rusak adalah bagian yang menarik. GPT-6 Sol dirilis pada 22 September 2026, hari yang sama dengan Claude Opus 5.5, dan harga daftarnya mulai dari $2 per juta input dan $10 per juta output — persis tarif Sonnet 5 dan persis seperti yang diklaim bocoran untuk Sonnet 5.5. Model ini menyediakan jendela konteks 1.050.000 token dengan batas output 128K, keduanya sedikit berbeda dari angka Claude Sonnet 5. Varian yang lebih murah, GPT-6 Luna, berada di $0.10 / $0.50.
Pembedaannya adalah konteks panjang. GPT-6 Sol menetapkan harga dalam dua tingkat: $2 / $10 hingga 272.000 token masukan, lalu $4 / $15 di atas itu. Anthropic tidak menerapkan hal itu pada lini Sonnet — Claude Sonnet 5 menagih seluruh jendela 1M dengan tarif standar, sehingga permintaan 900K token biayanya sama per token dengan permintaan 9K. Sonnet 5.5 sungguhan versus GPT-6 Sol sungguhan karenanya menghasilkan harga yang imbang untuk prompt biasa dan selisih dua kali lipat untuk beban kerja dokumen panjang dan repo besar yang menjadi sasaran penjualan kedua model. "Harga yang sama" benar di angka utama dan salah pada beban kerja yang membuat tingkat harga itu dipilih.
Peringatan kedua mendasari seluruh perbandingan. Claude Sonnet 5 menggunakan tokenizer Anthropic yang lebih baru, yang menghasilkan sekitar 30% lebih banyak token untuk teks yang sama dibandingkan tokenizer sebelumnya. Tarif utama bukanlah tagihan; tagihannya adalah token per tugas, dan itulah angka yang belum pernah dibawa oleh kebocoran mana pun.
Apa yang akan membuat Sonnet 5.5 berarti?
Kesampingkan dulu apakah itu ada dan tanyakan apa yang akan berubah bagi seseorang yang membayar untuk token. Ada empat hal, dan tak satu pun darinya adalah lembar spesifikasi.
Yang pertama adalah harga di bawah $2 / $10. Dengan dibatalkannya kenaikan pada 1 September, tarif penyedia saat ini kini permanen — jadi penerus yang mempertahankan tarif yang sama hanyalah langkah lateral, dan satu-satunya kabar tingkat Sonnet yang menggerakkan uang adalah pemotongan harga.
Yang kedua adalah konteks di atas 1M. Itulah proposisi aktual dari kebocoran Agustus, dan itu adalah satu-satunya celah kemampuan yang bisa disebutkan oleh kebocoran tersebut yang belum ditangani oleh pemain yang sudah mapan.
Yang ketiga adalah token per tugas. Pemikiran adaptif Claude Sonnet 5 aktif secara default, dan analisis independen telah mengukur bahwa model ini menghasilkan token keluaran yang jauh lebih banyak per tugas dibandingkan pendahulunya. Versi yang mempertahankan tarif $2 / $10 dan menghentikan inflasi tersebut akan memangkas tagihan riil lebih jauh daripada pemotongan harga di headline.
Yang keempat adalah sebuah pengenal. String model API, baris dokumentasi, entri harga, kartu model — salah satu saja dari itu sudah mengakhiri perdebatan, dan tidak adanya keempatnya setelah kebocoran yang begitu eksplisit itu sendiri merupakan fakta yang paling mengungkap dalam cerita ini.
Apa yang dapat Anda sebut hari ini
Claude Sonnet 5 bukanlah sekadar pengisi sementara selagi tingkatan itu menata diri. Model inilah yang sudah menjalankan sebagian besar lalu lintas Claude API, dengan jendela 1M token, output 128K, dan tarif $2 / $10 yang kini sudah menjadi standar, bukan lagi promosi.

Model ini sudah ada di OrcaRouter sejak Juni dengan harga Anthropic sendiri, yaitu $2 / $10, diteruskan pada harga daftar penyedia tanpa markup, jadi perubahan harga vendor pada lini Sonnet akan langsung berlaku di sini pada hari yang sama, bukan pada siklus penagihan berikutnya. Kunci yang sama juga sudah menjangkau GPT-6 Sol pada $2 / $10, yang dalam artikel seperti ini lebih penting dari biasanya: perbandingan yang menjadi sandaran bocoran tersebut adalah perbandingan yang bisa Anda jalankan sendiri dengan satu kredensial, bukan dua kontrak.

Itu juga cara termurah untuk menjawab pertanyaan yang muncul dari kebocoran itu. Jika Sonnet 5.5 memang muncul, ia hadir di katalog seperti yang lain, dan Anda mengarahkan sebagian trafik ke sana di balik failover otomatis ke Claude Sonnet 5 — tanpa integrasi kedua, tanpa negosiasi ulang, dan tanpa jalur produksi yang bergantung pada model yang belum diuji tolok ukur secara independen. Mencoba tingkat yang belum terbukti adalah keputusan perutean, bukan proyek migrasi.
Apa yang harus ditonton alih-alih postingan kebocoran berikutnya
Tiga sinyal, dalam urutan menurun berdasarkan seberapa banyak informasi yang dapat mereka berikan kepada Anda. Sebuah pengenal bersifat menentukan, karena model yang dilayani harus memiliki nama dalam sebuah permintaan dan begitulah setiap kabar pra-rilis Anthropic tahun 2026 yang dapat diverifikasi menjadi dapat diverifikasi. Pengakuan vendor — kartu model, baris dokumentasi, baris harga, atau model yang sekadar muncul di daftar Anthropic sendiri — langsung mengakhirinya; kalimat "beberapa minggu mendatang" berarti salah satunya benar-benar harus diberikan. Laporan penguji yang menjelaskan perilaku alih-alih spesifikasi adalah yang paling lemah dari ketiganya, dan tetap lebih banyak daripada yang ada saat ini.
Sampai salah satu dari itu terwujud, ringkasan yang jujur adalah bahwa Anthropic telah menjanjikan penyegaran Sonnet dalam beberapa pekan ke depan dan seorang pengamat menggambarkannya menggunakan angka-angka dari model yang akan digantikannya. Jika stack Anda sudah menjalankan claude-sonnet-5, tidak ada yang perlu ditunggu dan tidak ada yang perlu direncanakan. Jika Anda membandingkan Claude Sonnet 5 dengan GPT-6 Sol, angka-angka yang bisa Anda tindak lanjuti adalah angka-angka yang sudah dipublikasikan — dan itu adalah angka-angka yang sama yang coba dijual oleh kebocoran itu sebagai berita.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
