Kartu hero yang dihasilkan untuk 'Claude Haiku 5.5 harganya sepersepuluh dari itu', diberi badge 'CLAUDE TERMURAH' dengan teks pengantar 'ANTHROPIC, 7 OKTOBER 2026' dan subjudul 'Pemotongan tarif 90%, tokenizer yang menambah sekitar 30% token lebih banyak, dan video peluncuran yang tidak diposting Anthropic.' Empat chip berbunyi '$0.10 masuk', '$0.50 keluar', 'konteks 1M' dan 'penghematan nyata 75%'. Dua kartu di bawahnya diberi label 'YANG TURUN' ('input $1.00 ke $0.10, output $5.00 ke $0.50 di bawah 100,000 token') dan 'YANG NAIK' ('teks yang sama dihitung sekitar 30% lebih banyak token daripada sebelumnya'). Footer berbunyi 'Dokumentasi harga vendor dibaca 8 Oktober 2026.' Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

Claude Haiku 5.5: Potongan Harga 90%, Tokenizer Baru, dan Video yang Tidak Diunggah oleh Anthropic

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Seseorang mengetikkan satu kalimat ke Claude Haiku 5.5 dan mendapatkan film peluncuran yang sudah jadi. Prompt itu, yang diposting ke X pada malam 7 Oktober 2026, berbunyi lengkap: "buat video peluncuranmu yang 10 kali lebih memukau yang menunjukkan seberapa hebat kamu sebagai motion designer." Keterangan unggahannya hanya tiga kata — "Video sekali jadi" — dan klipnya disertakan sebagai lampiran. Tanpa percobaan ulang, tanpa storyboard, tanpa editor. Jika itu yang sekarang dilakukan model termurah di lini Claude, tingkatan itu tidak lagi menjadi kompromi.

Itu adalah separuh yang menarik dari peluncuran ini. Separuh lainnya adalah aritmetika, dan di situlah berita sebenarnya berada: Claude Haiku 5.5 berbiaya $0,10 per juta token input dan $0,50 per juta token output untuk prompt hingga 100.000 token, dibandingkan dengan Claude Haiku 4.5 yang bertarif tetap $1 dan $5. Catatan kaki Anthropic sendiri menyebut itu 90% lebih murah pada kasus umum — lalu, dalam tarikan napas yang sama, mengatakan bahwa angka yang seharusnya dijadikan acuan pembeli lebih dekat ke 75%. Kedua angka itu benar, dan selisih di antara keduanya adalah hal terpenting dalam rilis ini.

Apa yang Ant​hropic catat secara resmi pada 7 Oktober

Post peluncuran vendor tersebut dan dokumentasi penetapan harganya sepakat tentang bentuk dari hal itu, dan ini merupakan langkah yang lebih besar daripada yang biasanya menyertai pemotongan harga.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• Harga — $0,10 per juta token masukan dan $0,50 per juta token keluaran untuk prompt hingga 100.000 token. Di atas ambang batas tersebut, permintaan yang sama ditagih sebesar $0,50 dan $2,50. Pembacaan cache dikenai biaya $0,01 per juta hingga 100K dan $0,05 di atasnya; penulisan cache sebesar $0,125 dan $0,625.

• Konteks — 1M token, dengan keluaran maksimum 128.000 token. Itu adalah jendela yang sama dan batas keluaran yang sama yang dimiliki Claude Fable 5.1, Claude Opus 5.5, dan Claude Sonnet 5.5, direproduksi pada tingkat termurah.

• Berpikir — pemikiran adaptif dengan parameter effort, yang secara default diatur ke medium. Ant​hropic menyatakan ini adalah model kelas Haiku pertama dengan pengaturan effort yang dapat disesuaikan, yang berarti id model yang sama dapat dijalankan dengan murah atau dijalankan dengan cermat tanpa mengubah apa pun yang lain.

• Tokenizer — tokenizer yang lebih baru yang digunakan bersama Claude 4.7 dan versi setelahnya, yang "menghasilkan sekitar 30% lebih banyak token untuk teks yang sama." Dokumentasi Anthropic menyatakan peningkatan pastinya bergantung pada konten dan bentuk beban kerja.

• Siklus hidup — batas pengetahuan Juni 2026, dan komitmen penghentian "tidak lebih awal dari 7 Oktober 2027."

• {{1}}Ketersediaan{{/1}} — Claude API, Amazon Web Services, Goo​gle Cloud, Microsoft Azure, dan Claude Platform on AWS, semuanya sekaligus pada hari pertama.

Stiker 10x dan realitas 75%

Sepuluh kali lebih murah adalah angka yang akan paling jauh menyebar, dan angka itulah yang paling mungkin berakhir di tempat yang salah dalam model anggaran seseorang. Ini berlaku untuk prompt hingga 100.000 token. Haiku 5.5 tidak mempertahankan tarif itu untuk seluruh jendela.

• Hingga 100.000 token — $0,10 untuk input dan $0,50 untuk output, dibandingkan dengan $1 dan $5 milik Haiku 4.5. Itu adalah pemotongan 90%, dan Anthropic mengatakan 90% permintaan ke model Haiku sebelumnya masuk dalam kisaran ini.

• Lebih dari 100.000 token — $0,50 untuk input dan $2,50 untuk output. Masih tepat setengah dari yang dikenakan Haiku 4.5, pada permintaan yang sama, tanpa batas atas yang harus dicapai.

• Tokenizer — teks yang sama menjadi sekitar 30% lebih banyak token dibandingkan pada Haiku 4.5, jadi pemotongan per token tidak berarti tagihan yang lebih kecil secara satu-ke-satu.

• Rata-rata dari vendor itu sendiri — Ant​hropic menyebut kombinasi tersebut sebagai "sekitar 75% lebih hemat untuk dijalankan." Itu adalah angka mereka, bukan pengukuran independen, dan itulah yang harus dimasukkan ke dalam perkiraan.

• Ekonomi cache — pembacaan cache turun dari $0,10 menjadi $0,01 per juta pada rentang umum, yang lebih penting daripada tarif input untuk pipeline apa pun yang mengirim ulang prefiks bersama yang panjang.

Angka 75% juga menjelaskan sesuatu yang mungkin dianggap pembaca sebagai kontradiksi. Kedua angka utama itu tidak bertentangan; yang satu adalah laju pada suatu bentuk permintaan, yang lain adalah estimasi campuran atas campuran lalu lintas nyata yang mencakup minoritas di atas 100K dan token tambahan dari tokenizer. Jika Anda memodelkan pengeluaran, gunakan 75% dan periksa distribusi panjang prompt Anda sendiri sebelum Anda mempercayai angka yang lebih baik.

Apa yang diklaim oleh video itu, dan apa yang tidak.

Klip itu asli, prompt dikutip secara verbatim di atas, dan stempel waktunya — 19:49 UTC pada 7 Oktober, kira-kira pada hari yang sama model itu mulai aktif — dapat diperiksa. Atribusinya kepada pengguna individu, bukan kepada Ant​hropic.

Perbedaan itu penting di sini, karena halaman produk Anthropic sendiri untuk Claude Haiku 5.5 sama sekali tidak memuat video tersemat: tidak ada pemutar, tidak ada berkas media, hanya tautan ke kanal YouTube perusahaan. Jika ada film peluncuran yang dibuat dengan model tersebut, vendor tidak mengatakannya. Jadi pernyataan yang akurat bersifat sempit: seorang pengguna melaporkan menghasilkan video peluncuran dalam sekali percobaan dengan Claude Haiku 5.5, dan menerbitkan prompt-nya. Apakah itu sekali percobaan, berapa biayanya, dan seberapa banyak yang bertahan setelah penyuntingan, semuanya adalah klaim dari satu sumber. Perlakukan klip itu sebagai demonstrasi, bukan sebagai tolok ukur.

Alasan ini tetap layak disebut adalah bahwa pembuatan video tidak ada dalam spesifikasi model. Haiku 5.5 menerima teks dan gambar sebagai masukan dan mengembalikan teks. Hasil desain gerak dengan kualitas seperti itu menyiratkan bahwa model tersebut menggerakkan sesuatu yang lain — jalur penghasil kode, pipeline rendering, loop alat — alih-alih menghasilkan frame sendiri. Itu adalah pernyataan tentang orkestrasi agentik pada input $0.10, dan itulah bagian yang sebenarnya mengejutkan.

Angka-angka yang diterbitkan Ant​hropic

Tabel peluncuran vendor adalah perbandingan sebelum-dan-sesudah terhadap Haiku 4.5, dengan GPT-6 Luna dan Claude Sonnet 5.5 di kolom yang sama untuk skala. Setiap angka di bawah ini adalah hasil evaluasi yang dilaporkan sendiri oleh Anthropic, dijalankan pada harness Anthropic, dan direproduksi tetapi tidak diverifikasi secara independen.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• Pekerjaan pengetahuan — GDPval-AA v2.1 di angka 1620 dibandingkan dengan 735 milik Haiku 4.5, 1437 milik GPT-6 Luna, dan 1840 milik Sonnet 5.5. AA-Briefcase v1.1 di angka 1578 dibandingkan dengan 614, 1336, dan 1824.

• Penggunaan komputer — OSWorld 2.1 sebesar 72,4% pada subset luring, dibandingkan dengan 15,7% untuk Haiku 4.5, 48,9% untuk GPT-6 Luna, dan 83,9% untuk Sonnet 5.5.

• Penalaran multidisiplin — Humanity's Last Exam pada 45,9% tanpa alat dan 57,4% dengan alat, dibandingkan dengan 10,2% dan 18,7% untuk Haiku 4.5.

• Pengodean agentic — Terminal-Bench 4.0 pada 39,2% dibandingkan 0,0%, 16,4%, dan 70,6%. FrontierCode 1.1 (Main) pada 46,4% dibandingkan 42,4% untuk GPT-6 Luna dan 52,1% untuk Sonnet 5.5.

• Penalaran visual — Chartography mencapai 46,4% tanpa alat, dibandingkan dengan 6,4%, 29,1%, dan 61,6%.

Ant​hropic juga sangat terus terang tentang di mana tier kecil tidak unggul. Komentarnya sendiri pada grafik Terminal-Bench menyatakan Sonnet 5.5 dan Opus 5.5 "tetap menjadi pilihan yang lebih baik untuk tugas pengodean agentik yang kompleks," dan memposisikan Haiku 5.5 untuk pemadatan, peringkasan, dan pekerjaan subagen sebagai gantinya. Kutipan pelanggan dalam postingan mengarah ke arah yang sama dan membawa peringatan yang sama — ini adalah mitra akses awal yang menjelaskan evaluasi mereka sendiri, bukan audit: Asana melaporkan latensi lebih rendah lebih dari 30% untuk penyelesaian tugas dan inferensi hingga 2,5x lebih cepat per giliran agen; HubSpot melaporkan 92,8% rata-rata dari tiga kali pengujian pada suite portal CRM; AlphaSense melaporkan 0,84 berbanding 0,76 pada 400 kueri dalam beban kerja yang melakukan sekitar 8 juta panggilan per minggu; Box melaporkan 11 poin lebih tinggi daripada Haiku 4.5 dengan latensi sekitar setengahnya; Rogo menggambarkan subagen Haiku 5.5 menarik baris pendapatan segmen dari 10-K; dan Cognition melaporkan Devin Fusion mempertahankan skor FrontierCode 66,2 dengan Haiku 5.5 sebagai pendamping.

Apa kata dewan independen

Tabel vendor adalah milik vendor. Penempatan dari luar yang pertama adalah angka yang lebih berguna bagi siapa pun yang memutuskan apakah tier tersebut bergerak cukup jauh untuk mengubah pipeline produksi.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis memberi skor Claude Haiku 5.5 sebesar 43 pada Intelligence Index v4.3.2 dalam konfigurasi Max model tersebut, menempati peringkat kedua dari 182 model di papan itu dan jauh di atas median papan tersebut, yaitu 13. Halaman yang sama mengukur 242 token keluaran per detik — kesembilan dari 182 — dan biaya $0,21 per tugas Intelligence Index.

Ada dua hal di halaman itu yang lebih bernilai daripada tajuk utamanya. Yang pertama adalah verbositas: saat mengevaluasi Index, Artificial Analysis mencatat 440 juta token keluaran, dibandingkan median 100 juta, dan menggambarkan model itu sebagai "sangat verbose." Harga yang tertera dikenakan per token, jadi model yang berpikir panjang harus menanggungnya — itulah sebabnya angka biaya per tugas berada di $0,21 alih-alih mendekati nol, dan mengapa pemangkasan input 90% bukanlah keseluruhan ceritanya. Yang kedua adalah tangga upaya: halaman yang sama menampilkan konfigurasi dari Max turun ke Low, dan default Anthropic adalah medium, bukan max. Angka 43 di papan peringkat adalah puncak tangga itu, bukan pengaturan yang Anda dapatkan jika tidak melakukan apa pun.

Menjalankan tier di bawah tier yang sudah dapat Anda panggil

Claude Haiku 5.5 tidak ada di katalog OrcaRouter, dan ada baiknya mengatakannya secara terang-terangan daripada menyiratkan sebaliknya: jeda pada hari peluncuran antara sebuah model sudah ada dan model tersebut dapat dirutekan biasanya beberapa hari, dan kadang lebih lama.

Yang ada di katalog Ant​hropic hari ini adalah Claude Haiku 4.5, Claude Sonnet 5.5, dan Claude Opus 5.5, masing-masing pada harga daftar penyedia yang diteruskan tanpa markup alias 0%, jadi potongan apa pun yang dibuat Ant​hropic mendarat di sisi kami pada hari yang sama saat mendarat di sisi mereka. Itulah jembatan praktis bagi siapa pun yang ingin menguji pola subagent sekarang: kaskade yang mengirim giliran rutin ke Haiku 4.5 dan mengeskalasi giliran sulit ke atas sudah bisa berjalan hari ini di bawah satu kunci dan satu SDK, dan mengganti kaki kecilnya ke Haiku 5.5 nanti hanyalah perubahan model-id, bukan migrasi. Failover otomatis berada di bawah kaki mana pun yang Anda pilih, sehingga sore buruk satu penyedia tidak ikut menjatuhkan pipeline-nya.

Jika Anda lebih memilih untuk tidak menunggu sama sekali, band input $0,10 yang sama sudah ditempati oleh GPT-6 Luna, yang memang kami rutekan, dan yang mempertahankan tarif tersebut hingga 272.000 token sebelum naik.

Siapa yang harus pindah, dan siapa yang tidak

Jika beban kerja Anda adalah klasifikasi, ekstraksi, perutean, pemadatan, atau peringkasan dalam skala besar, dan prompt Anda berada di bawah 100.000 token, kasusnya sederhana: tarifnya sepersepuluh dari sebelumnya, jendelanya lima kali lebih lebar, dan dial effort memungkinkan Anda menukar ke arah sebaliknya saat sebuah permintaan membutuhkannya. Anggarkan sekitar 75% lebih rendah dan Anda tidak akan terkejut.

Jika prompt Anda rutin melewati 100.000 token, Anda membeli potongan 50%, bukan potongan 90%, dan membandingkan harga untuk konteks mendalam tetap sepadan untuk meluangkan waktu satu sore — di bidang ini ada beberapa model pada atau di bawah tarif di atas 100K milik tier ini.

Dan jika evaluasi Anda masih gagal pada pekerjaan berbentuk Terminal-Bench, ini bukan model yang memperbaikinya; Anthropic sendiri mengatakan demikian, dan 39,2% versus 70,6% milik Sonnet 5.5 adalah bukti paling jelas di pos itu. Ringkasan jujur dari 7 Oktober adalah bahwa dasar kecerdasan yang berguna turun jauh dan plafonnya tidak bergerak sama sekali.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari