
Claude Haiku 5.5 di OpenCode Go: Apa yang Sebenarnya Didapat dengan $10 per Bulan
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Anthropic merilis Claude Haiku 5.5 pada 7 Oktober 2026, dan dalam sehari model itu sudah terdaftar di katalog Go dan Zen OpenCode — langganan agen pengkodean yang mengukur jatah dolar bulanan alih-alih menagih token. Listing kedua itulah bagian yang pantas ditinjau lebih saksama, karena jatah yang diterbitkan OpenCode untuk Claude Haiku 5.5 bukan diskon untuk model tersebut. Itu adalah meteran anggaran yang ditetapkan pada harga daftar Anthropic sendiri, dan setiap angka di baliknya dapat diperiksa terhadap dua halaman yang menerbitkannya. Jika Anda masih menentukan apa yang harus dipanggil sebagai pengganti Claude Haiku 4.5, jatah itulah keputusannya, bukan label harganya.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Apa yang Anthropic catat secara resmi pada 7 Oktober
Vendor ini tidak merilisnya secara diam-diam. Ruang berita Anthropic memuat pengumuman bertanggal, halaman produk dengan tabel benchmark, kartu sistem, tabel harga, dan enam kutipan dari pelanggan yang namanya disebutkan. Tidak ada repositori dan tidak ada rilis bobot untuk diperiksa, karena tidak ada yang perlu dirilis: Artificial Analysis mencatat Claude Haiku 5.5 sebagai proprietary, dengan jumlah parameter yang tidak diungkapkan. Siapa pun yang menggambarkan ini sebagai model yang bocor atau belum diumumkan sedang membaca repo yang tidak ada.
Pembingkaian Anthropic sendiri adalah model volume alih-alih model terdepan:
• Positioning — "model kecil termurah, tercepat, dan paling mumpuni yang pernah kami rilis," ditujukan untuk ringkasan, pemadatan, kueri basis data, dan klasifikasi, serta ditawarkan sebagai subagen yang berpasangan dengan Claude Opus 5.5 dan Claude Sonnet 5.5 dalam pekerjaan pengodean.
• Harga — $0,10 per juta token masukan dan $0,50 per juta token keluaran untuk prompt hingga 100.000 token; $0,50 dan $2,50 di atas itu. Pembacaan cache $0,01 / $0,05, penulisan cache $0,125 / $0,625.
• Konteks dan keluaran — jendela 1M token dengan keluaran maksimum 128.000 token, cakupan yang sama yang dimiliki model tingkat 5.5 yang lebih besar, direproduksi pada tingkat termurah.
• Effort — model kelas Haiku pertama dengan pengaturan effort yang dapat disesuaikan, berjalan dari Low hingga Max, dengan default medium. Anthropic menerbitkan kurva akurasi versus biaya pada setiap pengaturan, bukan satu angka tunggal.
• Tolok ukur, dilaporkan vendor dan tidak direproduksi secara independen — GDPval-AA v2.1 1620 dibandingkan dengan 735 milik Claude Haiku 4.5; AA-Briefcase v1.1 1578 dibandingkan dengan 614; OSWorld 2.1 72,4% dibandingkan dengan 15,7%; Humanity's Last Exam 45,9% tanpa alat dan 57,4% dengan alat tersebut, dibandingkan dengan 10,2% dan 18,7%; Terminal-Bench 4.0 39,2% dibandingkan dengan 0,0%; Chartography 46,4% dibandingkan dengan 6,4%.
• Batas atas milik vendor sendiri — komentar Anthropic tentang grafik Terminal-Bench-nya mengatakan Claude Sonnet 5.5 dan Claude Opus 5.5 "tetap menjadi pilihan yang lebih baik untuk tugas coding agentic yang kompleks." Kutipan pelanggan dalam postingan yang sama adalah mitra akses awal yang menjelaskan evaluasi mereka sendiri, bukan audit: Asana melaporkan latensi lebih rendah lebih dari 30% dan inferensi hingga 2,5x lebih cepat per giliran agen, HubSpot 92,8% rata-rata selama tiga kali proses, AlphaSense 0,84 versus 0,76 di 400 kueri pada beban kerja sekitar 8 juta panggilan per minggu, Box 11 poin lebih tinggi dengan sekitar setengah latensi, dan Cognition skor FrontierCode 66,2 dengan Haiku 5.5 sebagai pendamping.

Anthropic juga memanfaatkan peluncuran itu untuk mengubah dua harga yang berdekatan: pembacaan cache pada Claude Sonnet 5.5 dipangkas setengah menjadi $0.10 per juta token, yang menurut perusahaan membuat Sonnet 5.5 sekitar 20% lebih murah untuk sebagian besar pekerjaan agentik, dan kredit API bulanan baru untuk pelanggan Claude Max dan Team. Keduanya adalah perubahan pada tingkat di atasnya, dan keduanya lebih penting bagi tim yang sudah menjadikan Sonnet sebagai standar daripada bagi siapa pun yang mencari model kecil.
Tunjangan ini adalah anggaran dolar, bukan diskon.
Inilah bagian yang tidak disebutkan oleh tweet pengumuman. Dokumentasi Go OpenCode menyatakan bahwa "batas penggunaan didefinisikan sebagai jumlah dolar bulanan," bahwa harga token sama pada kedua paket, dan bahwa jatah setiap model menurun menurut jadwal tetap: 20% dari batas bulanan per lima jam, 50% per minggu, 100% per bulan. Dokumentasi tersebut juga mempublikasikan profil token per permintaan yang diasumsikan untuk model ini — 1.100 token masukan, 55.000 token di-cache, 240 token keluaran.
Jalankan itu melalui harga daftar Anthropic, dan jumlah permintaan yang dipublikasikan tidak lagi terlihat seperti alokasi sembarangan:
• Biaya per permintaan pada harga daftar — 1.100 input dengan $0,10/juta ditambah 55.000 pembacaan cache dengan $0,01/juta ditambah 240 output dengan $0,50/juta menjadi $0,00078.
• Jumlah permintaan bulanan — $15 dibagi $0,00078 adalah 19.230, yang merupakan angka yang dicetak dokumentasi. Tunjangan $60 dari paket $40 menghasilkan 76.923, dan dokumentasi mencetak 76.920.
• Penurunan bertahap — 20% dari 19.230 adalah 3.846, ditampilkan sebagai 3.850 per lima jam; 50% adalah 9.615, ditampilkan sebagai 9.620 per minggu. Go Plus mengikuti aritmetika yang sama pada 15.380 dan 38.460.
• Apa artinya dalam dolar — jatah tersebut bernilai token dengan harga Anthropic senilai $15 pada paket $10 dan $60 pada paket $40. Oleh karena itu, langganan $10 membeli paling banyak token model ini senilai $15 per bulan jika Anda menghabiskan seluruh jatah untuk Claude Haiku 5.5 dan tidak ada yang lain.
Itulah cara jujur untuk membaca lencana "New" di halaman Go. Langganannya murah, modelnya murah, dan kedua fakta itu independen: jatahnya adalah anggaran terukur dengan tarif milik vendor sendiri, jadi paketnya membatasi seberapa banyak yang boleh Anda belanjakan, bukan seberapa murah modelnya. Pengguna berat akan mencapai batas dan membayar Anthropic secara langsung — atau mengarahkan modelnya sendiri.

Sembilan puluh persen, tujuh puluh lima persen, dan jurang lima kali lipat
Judul utama Anthropic adalah bahwa Claude Haiku 5.5 berbiaya sekitar 90% lebih murah daripada Claude Haiku 4.5 untuk prompt hingga 100.000 token, dan bahwa rata-rata "kini biaya menjalankannya sekitar 75% lebih murah." Kedua angka itu milik vendor. Keduanya juga benar, dan selisih di antara keduanya merupakan keseluruhan risiko penetapan harga itu.
• Dalam rentang ini — $0,10 untuk input dan $0,50 untuk output, dibandingkan dengan tarif tetap Haiku 4.5 sebesar $1 dan $5. Anthropic mengatakan sekitar 90% permintaan ke model Haiku sebelumnya berada dalam rentang ini, dan dari situlah angka 90% berasal.
• Di atas rentang — permintaan yang sama ditagih $0,50 untuk input dan $2,50 untuk output, kenaikan lima kali lipat pada input. Itu masih setengah dari tarif Haiku 4.5, tetapi jauh dari potongan 90%.
• Klaim gabungan — angka 75% adalah perkiraan Anthropic sendiri berdasarkan campuran lalu lintas nyata, bukan daftar tarif, dan itulah angka yang harus dimasukkan ke dalam prakiraan.
• Tokenizer — tokenizer yang lebih baru yang digunakan bersama Claude 4.7 dan versi setelahnya menghasilkan sekitar 30% lebih banyak token untuk teks yang sama, menurut dokumentasi Anthropic sendiri, sehingga pemotongan per token tidak serta-merta berarti tagihan yang lebih kecil.
Dial effort memperparah semuanya. Karena nilai default-nya medium dan kurva yang dipublikasikan mencapai Max, prompt yang sama bisa memakan biaya beberapa kali lebih besar bergantung pada parameter yang tidak pernah diatur oleh sebagian besar pemanggil — dan estimasi permintaan OpenCode mengasumsikan satu profil token tetap pada satu pengaturan implisit. Jika prompt Anda mendekati 100.000 token, menjalankan subagent dengan penggunaan terbatas, atau Anda menggeser dial effort, angka utama 90% bukanlah angka yang akan Anda lihat.
Dewan independen sepakat atas skor dan menyoroti perhitungannya sendiri
Artificial Analysis memberi skor Claude Haiku 5.5 sebesar 43 pada Intelligence Index v4.3.2 dalam konfigurasi Max model tersebut, dibandingkan median papan skor sebesar 13, dan mencatat 241,9 token keluaran per detik dibandingkan median model sebanding sebesar 110,9. Halaman yang sama menyebut biayanya $0,21 per tugas Intelligence Index dan melaporkan bahwa model tersebut menghasilkan 440 juta token keluaran selama evaluasi dibandingkan median 100 juta — menggambarkannya sebagai "sangat bertele-tele."
Verbosity adalah titik interaksi kedua papan. Aritmetika jatah di atas dibebankan per token, jadi model yang bernalar panjang menghabiskan anggaran lebih cepat daripada yang disiratkan oleh jumlah permintaan, dan profil per permintaan OpenCode sebesar 55.000 token yang di-cache adalah asumsi tentang caching prompt yang mungkin atau tidak mungkin tereproduksi oleh pengguna langganan. Dua pengungkapan di halaman Artificial Analysis bernilai lebih daripada judul utamanya: angka 43 adalah konfigurasi Max, bukan pengaturan effort yang Anda peroleh dengan tidak melakukan apa pun, dan halaman itu memuat catatan eksplisit bahwa Claude Haiku 5.5 "memiliki harga 5x lebih tinggi untuk input konteks yang lebih panjang yang saat ini tidak tercermin" dalam angka biayanya. Tebing konteks panjang itu nyata, dan papan independen telah memberi tahu Anda bahwa hal itu belum ada dalam angka-angkanya sendiri.

Baris retensi yang akan dilewati sebagian besar pembeli
Dokumentasi Go milik OpenCode memuat tabel privasi per model, dan inilah baris tempat Claude Haiku 5.5 berbeda dari sebagian besar katalog. Kerangka yang digunakan vendor itu sendiri adalah tanpa penyimpanan, dengan pengecualian. Sebagian besar model dalam tabel Go tersebut tertulis "0 hari." Model ini tertulis "30 hari," dengan catatan bahwa permintaan disimpan selama 30 hari sesuai dengan kebijakan data Anthropic — perlakuan yang sama seperti yang diberikan kepada GPT-6 Luna dan GPT-5.6 Luna, dan kebalikan dari baris-baris nol hari yang mendominasi daftar itu.
Bagi agen coding, itu berarti prompt, jalur file, dan sumber yang ditempel dapat tersimpan di vendor hulu selama sebulan, pada paket yang bahasa pemasarannya menyebut retensi nol. Itu bukan alasan untuk menghindari model; itu alasan untuk membaca barisnya alih-alih bannernya. Sementara itu, tidak ada apa pun dalam materi peluncuran Anthropic yang mengubah posisi di sisi API: Claude API telah menawarkan retensi data nol, dan ketentuan retensi pada kartu model itulah yang mengatur integrasi langsung.
Apa yang dikonfirmasi, dan apa yang tidak
Kumpulan yang terkonfirmasi itu besar dan spesifik, hal yang tidak biasa untuk model yang baru ini. Apa yang belum terkonfirmasi lebih sempit, dan layak disebutkan daripada sekadar ditutupi:
• Terkonfirmasi — model ini ada, hanya tersedia melalui API dengan id claude-haiku-5-5, dirilis 7 Oktober pada Claude API serta Amazon Web Services, Google Cloud, dan Microsoft Azure, dengan harga di atas, jendela 1 juta token, effort yang dapat disesuaikan, dan system card yang dipublikasikan.
• Terkonfirmasi — dua platform pihak ketiga telah mencantumkannya dengan id model, endpoint, dan alokasi terukur pada hari yang sama.
• Belum dikonfirmasi — kami tidak menemukan tolok ukur independen yang telah mereproduksi tabel vendor. Setiap angka akurasi dalam posting peluncuran Anthropic berasal dari perangkat evaluasi Anthropic sendiri, dan setiap kutipan pelanggan adalah pengujian awal yang dilaporkan sendiri oleh mitra.
• Belum dikonfirmasi — tidak ada bobot, tidak ada repositori, tidak ada checkpoint, dan tidak ada lisensi untuk diperiksa. Modelnya tertutup, dan klaim apa pun tentang arsitektur atau ukurannya hanyalah inferensi.
• Belum dikonfirmasi — apakah estimasi permintaan platform tersebut tetap berlaku pada apa pun selain profil token yang diasumsikannya, dan apakah (atau kapan) penetapan harga konteks panjang 5x masuk ke dalam angka biaya papan independen.
Menjalankannya berdampingan dengan apa yang sudah Anda sebut
Pertanyaan praktis yang ditimbulkan peluncuran ini bukanlah "apakah Haiku 5.5 bagus" — tabel vendor mengatakan begitu, dan belum ada orang di luar Anthropic yang memeriksanya. Pertanyaannya adalah "berapa tagihannya, dan apa yang terjadi ketika tier murah bukan tier yang tepat untuk panggilan tertentu ini." Kedua bagian itu adalah masalah routing.
Dalam hal biaya, yang menjadi ukuran adalah tagihan token, bukan harga di label: pemangkasan input 90% ditambah tokenizer yang 30% lebih besar ditambah model penalaran yang bertele-tele ditambah lompatan konteks panjang lima kali lipat berarti angka yang Anda perkirakan dan angka yang Anda bayar akan berbeda kecuali Anda mengukur distribusi panjang prompt Anda sendiri. Model yang 5x lebih mahal di atas 100.000 token memberi insentif pada pemadatan — dan Haiku 5.5 sendiri dipasarkan sebagai model pemadatan, sebuah lingkaran yang layak diperhatikan.
Soal risiko, tier yang belum terbukti justru menjadi alasan untuk tidak mempertaruhkan jalur produksi padanya. Claude Haiku 4.5 sudah tersedia di OrcaRouter dengan harga daftar Anthropic dengan markup 0%, sehingga tier lama tidak memerlukan kontrak baru, dan rute yang melakukan fallback dari model baru ke model yang sudah dikenal hanyalah perubahan konfigurasi, bukan penulisan ulang. Parameter effort bersifat per panggilan, yang berarti endpoint yang sama dapat menjalankan ringkasan dengan effort rendah dan ekstraksi sulit dengan effort tinggi tanpa memelihara dua integrasi — DSL routing ada justru untuk bentuk keputusan seperti ini, dan failover otomatis adalah yang memungkinkan Anda menempatkan model yang baru berumur beberapa hari di depan lalu lintas nyata sebelum Anda memiliki angka independen untuknya. Yang belum benar adalah hal yang sudah jelas: Claude Haiku 5.5 belum ada di rute kami hari ini, dan jika Anda menginginkannya minggu ini, Anda harus menghubungi Anthropic secara langsung atau melalui platform yang mengumumkannya.
Siapa yang sebaiknya beralih: tim yang volumenya berupa ringkasan, klasifikasi, pemadatan, dan pekerjaan subagen, di mana rentang 90% berlaku dan 30% dari tokenizer adalah aritmetika yang dapat Anda serap. Siapa yang sebaiknya menunggu: siapa pun yang prompt-nya rutin melewati 100.000 token, siapa pun yang membutuhkan tolok ukur independen sebelum berkomitmen, dan siapa pun yang kodenya tidak dapat berada dalam jendela retensi 30 hari. Peluncurannya nyata dan harganya nyata. Buktinya masih milik vendor.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
