Kartu hero kebocoran Claude Opus 5.5 berjudul 'Claude Opus 5.5: sebuah kebocoran, berlabel', dengan baris 'Checkpoint yang dilaporkan bernama claude-wafer-eap — belum dirilis, belum dikonfirmasi, sumber tunggal' dan tiga kartu berlabel: Diklaim — versi 5.5, rilis paling awal Selasa 22 Sep; Terverifikasi — Opus 5.2 dilayani dengan label Opus 5, 14-17 Sep; Belum dikonfirmasi — nama sandi dan handle pembocor: tidak ada sumber kedua
Guides & Insights

Kebocoran Claude Opus 5.5: Checkpoint Bernama "claude-wafer-eap" dan Rumor Rilis Hari Selasa

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Klaim yang beredar akhir pekan ini cukup spesifik untuk diperiksa dan cukup tipis untuk runtuh begitu diperiksa: sebuah checkpoint baru untuk pembaruan Opus berikutnya, yang kini diberi label Claude Opus 5.5, dilaporkan sudah di tangan, dengan nama kode internal — "claude-wafer-eap" — dan rilis yang bisa mendarat paling cepat Selasa, 22 September. Sumbernya adalah akun X @kimmonismus yang meneruskan seorang pembocor bernama Lyra. Tidak ada model card, tidak ada pengenal API, tidak ada daftar harga, tidak ada benchmark, dan tidak ada media kedua yang melaporkan string checkpoint yang sama. Yang ada, di bawah klaim itu, adalah peristiwa nyata yang terdokumentasi dengan baik: Claude Opus 5.2, build Opus yang belum dirilis yang disajikan kepada sebagian trafik dengan label "Opus 5" yang tidak diubah hingga pertengahan September, dan yang sempat dihentikan oleh vendor pada malam 17 September. Sejauh itu didukung oleh beberapa media. Segala hal di atasnya hanyalah kata-kata satu akun. Dan ada hal ketiga yang layak dicermati, yaitu apa yang dilakukan bocoran ini terhadap nomor versi itu sendiri: Claude Opus 5 dirilis pada 24 Juli dengan harga $5,00/$25,00 per juta token dan masih menjadi Opus teratas vendor yang tersedia secara umum; Claude Fable 5.1 hadir pada 1 September. Jika Opus berikutnya benar-benar 5.5, maka penamaannya telah melompat melewati 5.3 dan 5.4 — dan angka itu memainkan peran yang lebih besar dalam kisah ini daripada benchmark apa pun.

Apa yang sebenarnya diklaim oleh kebocoran tersebut

Buka kemasannya dan ada empat pernyataan. Pertama, bahwa sebuah checkpoint ada — sebuah model yang telah dilatih, disimpan, dan sedang disiapkan di suatu tempat. Kedua, bahwa nomor versinya adalah 5.5, bukan 5.2 atau 5.3. Ketiga, bahwa ia membawa nama sandi, "claude-wafer-eap", dengan "eap" berarti program akses awal dalam singkatan vendor yang biasa. Keempat, bahwa peluncurannya sudah dekat, berpotensi hari Selasa.

Masing-masing dari itu adalah jenis klaim yang berbeda, dan tidak semuanya didukung secara setara. Yang keempat adalah yang memiliki bukti eksternal di belakangnya, dan bukti itu menunjuk pada tanggal, bukan pada nama kode. Pasar prediksi untuk rilis Claude Opus berikutnya dibuka pada 16 September dan mengelompokkan sebagian besar probabilitas tersiratnya di rentang 21 hingga 24 September, dengan porsi volume yang signifikan masih mendukung "tidak ada rilis hingga 30 September." Aturan penyelesaian pasar itu sempit: modelnya harus dapat diakses publik, dan harus secara eksplisit dinamai Opus. Rilis Fable, Mythos, Sonnet, dan Haiku tidak dihitung. "Claude Opus 5.5" muncul dalam daftar nama yang memenuhi syarat milik pasar itu sendiri — di situlah string tersebut paling masuk akal mulai beredar, dan itu adalah daftar kemungkinan, bukan laporan penampakan.

Nama sandi adalah mata rantai terlemah. "claude-wafer-eap" muncul dalam teks sinyal dan, sejauh yang dapat kami pastikan, tidak di tempat lain: tidak ada referensi repositori, tidak ada slug API, tidak ada kebocoran konfigurasi, tidak ada akun yang menguatkan. Nama sandi justru merupakan jenis detail yang menyebar karena terdengar dapat diverifikasi. Anggap yang ini belum terverifikasi sampai sumber kedua yang independen menghasilkan string yang sama. Hal yang sama berlaku untuk atribusi "Lyra" — nama samaran pembocor tanpa rekam jejak yang bisa kami periksa.

Apa yang sebenarnya diverifikasi

Baseline terverifikasi adalah Claude Opus 5, dan dokumentasinya luar biasa baik, yang membuatnya berguna sebagai tolok ukur. Anthropic merilisnya pada 24 Juli 2026 — tanpa 5.1 di antaranya — dengan jendela konteks 1M token, hingga 128K token output (300K melalui header beta pada Batch API), adaptive thinking aktif secara default, dan lima tingkat effort penalaran dari low hingga max. Harga tetap $5.00 per juta token input dan $25.00 per juta token output pada setiap panjang prompt, sama seperti Opus 4.8 sebelumnya, dengan Batch API setengah dari itu. Artificial Analysis menempatkannya di puncak Intelligence Index-nya, dengan skor persisnya bergantung pada varian effort mana yang Anda lihat — detail yang perlu diingat, karena papan skor "5.5" tidak akan sebanding dengan papan skor "5" kecuali pengaturan effort-nya sama.

Artificial Analysis model page for Claude Opus 5 (Adaptive Reasoning, Max Effort), showing 7th of 200 on the Intelligence Index, released July 2026, $5.00 input and $25.00 output per million tokens with a 90% cache discount, and a 1M token context window

Di atas itu terdapat peristiwa September yang telah dikonfirmasi. Dari sekitar 14 hingga 15 September, para pengembang melaporkan bahwa sebagian kecil permintaan yang secara nominal ditujukan kepada Opus 5 dijawab oleh model backend yang berbeda, dengan metadata permintaan menunjuk ke claude-opus-5.2 yang belum dirilis — nomor versi yang melewati 5.1 sepenuhnya. Perilaku yang dilaporkan mencakup keluaran yang lebih ringkas dan iterasi mandiri tanpa diminta: menulis kode, menjalankan pengujian, memperbaiki kegagalan, mengulanginya sampai pengujian lulus, alih-alih berhenti di tengah jalan. Trik deteksi yang beredar bersamanya — mengajukan pertanyaan spesifik kepada model tentang seseorang yang seharusnya tidak dikenalnya, dengan pencarian dan memori dinonaktifkan — adalah cara untuk mengetahui backend mana yang menjawab. Pada malam tanggal 17 September, Anthropic menutup saluran itu tanpa pemberitahuan, sebuah peristiwa yang oleh komunitas pengembang dijuluki "midnight shock"; saluran itu kembali sekitar sehari kemudian dan, menurut laporan-laporan tersebut, diperluas dari Claude Code ke permukaan chat dan cowork. Tidak ada model card, tidak ada tabel harga, tidak ada pengenal API, dan tidak ada pernyataan resmi yang menyertai semua itu.

Nomor versinya adalah ceritanya

Inilah bagian yang secara struktural benar dari kebocoran itu, meskipun setiap hal spesifiknya salah. Anthropic telah membuktikan, dua kali tahun ini, bahwa mereka akan melakukan iterasi pada tier Opus tanpa acara peluncuran — 4.8 pada akhir Mei, 5 pada 24 Juli dengan 5.1 dilewati, lalu 5.2 yang ada di produksi tanpa ada di publik. Vendor yang merilis melalui perutean backend dan mengendalikan rasio peluncuran juga dapat memutuskan, pada saat-saat terakhir, nomor apa yang akan dicetak pada kotaknya. Jika Opus berikutnya diumumkan sebagai 5.5 alih-alih 5.2, itu adalah keputusan pemasaran yang dibuat setelah pekerjaan teknis selesai, dan itulah jenis keputusan yang didengar oleh pembocor secara terlambat dan tidak akurat.

Itu berlaku dua arah bagi siapa pun yang membaca ini. Nomor versi yang bocor adalah bukti lemah tentang kemampuan dan bukti kuat tentang positioning. Jika nomornya benar-benar 5.5, itu menyiratkan lompatan yang lebih besar daripada jika 5.2 — dan itu menyiratkan Anthropic ingin pasar membacanya seperti itu, menjelang IPO yang kabarnya telah didorong perusahaan ke November. Reuters melaporkan pada 18 September, mengutip tiga sumber, bahwa Anthropic sedang mempertimbangkan apakah akan merilis model baru khusus untuk menjawab momentum enterprise GPT-6 Astra, sementara CEO-nya secara publik meminta industri untuk melambat. Angka yang lebih besar pada checkpoint yang sama tidak memakan biaya apa pun dan membeli satu headline. Itu bukan alasan untuk tidak mempercayai kebocoran tersebut; itu alasan untuk tidak memasukkan angka itu ke dalam pengambilan keputusan.

Apa yang harus benar pada hari Selasa

Rilis pada 22 September akan dapat diperiksa dalam waktu sekitar lima menit, dan ada baiknya menyebutkan pemeriksaannya sekarang agar pengumuman — jika itu muncul — dapat dibaca alih-alih sekadar dicerna.

• Ketersediaan — kartu model publik, pengenal model API yang mengembalikan completion, atau daftar tunggu bergulir yang terbuka. Beta tertutup tidak memenuhi syarat, dan pasar prediksi umumnya menetapkan hasilnya sebagai tidak. Inilah garis yang memisahkan "dirilis" dari "diuji pada beberapa akun."

• Harga — apakah Opus baru mempertahankan tingkat $5.00/$25.00, menggesernya, atau hadir dengan tarif promosi. Opus 5 mempertahankan harga Opus 4.8 persis sama, yang merupakan pola yang patut diharapkan dan karena itu menjadi hal yang perlu diperiksa.

• Konteks dan batas keluaran — konteks 1M dan keluaran 128K milik Opus 5 (300K pada Batch) adalah batas bawah saat ini. Opus baru yang hadir dengan kapasitas lebih kecil akan menjadi penurunan kelas yang dikemas sebagai peluncuran.

• Penilaian independen — entri Artificial Analysis pada tingkat upaya yang dinyatakan, bukan bagan vendor. Setiap klaim kemampuan dalam kebocoran tersebut saat ini belum direproduksi, dan kartu model saja tidak akan mengubah itu.

• Perilaku perutean — apakah perilaku ringkas yang beriterasi sendiri yang dilaporkan dalam catatan uji gray masih ada di build publik, atau apakah itu artefak pengujian. Perubahan perilaku itu adalah hal paling konkret yang benar-benar diamati para pengembang, dan itulah hal yang paling mungkin diam-diam dihilangkan sebelum rilis.

A two-column scoreboard for the Claude Opus 5.5 leak: left column 'Claude Opus 5.5 (reported)' lists status unreleased single source, codename claude-wafer-eap unconfirmed, version number reportedly 5.5, reported release as early as Tue Sep 22, no published pricing, and no independent benchmarks; right column 'Claude Opus 5 (verified)' lists generally available since Jul 24, codename n/a, version number 5, shipped Jul 24 2026, $5.00 / $25.00 per million, and top of the Artificial Analysis Index

Mencoba Claude yang belum terbukti tanpa mempertaruhkan jalur produksi padanya

Celah canggung dalam minggu seperti ini adalah bahwa model yang semua orang ingin evaluasi justru model yang tidak bisa dipanggil siapa pun. Yang bisa Anda panggil hari ini adalah Claude Opus 5 — dan jika 5.5 muncul, pertanyaan praktisnya menjadi bagaimana mengarahkan sebagian trafik nyata ke sana tanpa menulis ulang integrasi Anda atau mengikat jalur kritis ke model yang tidak memiliki tolok ukur independen.

Itulah kasus yang menjadi alasan routing diciptakan. OrcaRouter menempatkan jajaran Claude terkini di balik satu kunci API pada harga daftar penyedia dengan markup 0% — Claude Opus 5 dengan harga Anthropic sendiri $5,00/$25,00, angka yang sama seperti yang dipublikasikan vendor, sehingga perubahan harga vendor langsung aktif di sisi kami pada hari yang sama, bukan setelah sinkronisasi. Ketika Opus baru benar-benar dirilis, itu hanya satu rute tambahan, bukan kontrak kedua: Anda dapat mengarahkan sebagian persentase trafik ke sana, biarkan failover otomatis tetap diarahkan ke model yang sudah Anda karakterisasi, dan bandingkan keluaran pada prompt Anda sendiri, bukan pada benchmark yang bocor. Menyusun panggilan lintas beberapa model — draf dari satu model, tahap verifikasi dari model lain — hanyalah satu baris routing-DSL, bukan layanan baru.

OrcaRouter model page for anthropic/claude-opus-5, showing Claude Opus 5 by Anthropic dated 2026-07-24 with a 1M token context window, 128K max output, input $5.00 and output $25.00 per million tokens, p50 time to first token 9.49 seconds, and 975.4M tokens of traffic in seven days

Untuk memperjelas apa yang tidak kami katakan: tidak ada Claude Opus 5.5 di OrcaRouter, karena tidak ada Claude Opus 5.5 untuk dirutekan. Kami tidak akan memilikinya sampai Anthropic merilisnya, dan artikel ini bukan pratinjau halaman produk. Semua yang ada di tulisan ini tentang 5.5 adalah laporan dari sebuah laporan.

Apa yang harus diperhatikan, dan apa yang harus diabaikan

Perhatikan pengenal model. Slug API yang berfungsi adalah pembeda antara peluncuran dan rumor, dan itu adalah satu artefak yang tidak bisa dipalsukan lama oleh kebocoran. Perhatikan tabel harga, karena di sanalah Anthropic memberi tahu Anda ke tier mana menurutnya model itu berada. Perhatikan apakah perutean uji kelabu kembali berjalan sebelum pengumuman — saluran yang dilebarkan kembali adalah sinyal yang jauh lebih kuat daripada tweet, dan pemutusan lalu pemulihan pada 17 September sudah menunjukkan seperti apa saluran itu dari luar.

Untuk sekarang, abaikan nama kodenya. "claude-wafer-eap" adalah string dari satu sumber tanpa dukungan, dan hal yang sama berlaku untuk atribusi "Lyra" di baliknya. Abaikan nomor versi sebagai bukti apa pun kecuali sebagai posisi. Dan abaikan papan skor apa pun yang muncul dalam 48 jam pertama yang membandingkan Opus 5 publik dengan 5.5 yang belum dijalankan secara independen oleh siapa pun — termasuk milik kami, jika kami membuatnya, sampai ada sesuatu yang nyata di kedua sisi perbandingan itu.

Jika Selasa berlalu tanpa rilis, kebocoran itu tidak serta-merta terbantahkan; peristiwa Opus 5.2 September sendiri merupakan kasus sebuah model yang sudah ada di produksi selama berhari-hari sebelum siapa pun bisa menamainya. Posisi jujur sampai saat itu adalah posisi yang didukung bukti: sebuah build Opus nyata yang belum dirilis sedang disajikan secara senyap seminggu yang lalu, sebuah jendela rilis nyata sudah diperhitungkan pasar untuk minggu ini, dan satu akun telah menyematkan nomor, nama kode, serta tanggal padanya yang belum dikonfirmasi oleh pihak lain.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari