Kartu judul untuk penetapan harga Claude Opus 5.5 yang menampilkan tarif utama $4.00 per juta token input, $20.00 per juta token output, dan $0.20 per juta token baca yang di-cache.
Guides & Insights

Harga Claude Opus 5.5: Daftar Tarif Lengkap, Baris Cache, dan Berapa Biaya Sebenarnya untuk Sebuah Tugas

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Claude Opus 5.5 tercatat pada $4.00 per juta token masukan dan $20.00 per juta token keluaran, potongan tetap 20% dari $5.00/$25.00 yang Claude Opus 5 telah menerapkan, dengan pembacaan cache turun 60% menjadi $0.20 per juta. Itu adalah harga yang dipublikasikan Ant​hropic, dibaca dari dokumentasi harga Ant​hropic sendiri pada 24 September 2026, dua hari setelah model dirilis. Label harganya adalah bagian yang mudah. Ant​hropic juga mengatakan bahwa biaya menjalankan model ini "sekitar 40% lebih murah" pada beban kerja tipikal, dan angka itu tidak ada di lembar harga — itu adalah karakterisasi vendor yang dibangun dari potongan per token ditambah asumsi bahwa model menghabiskan lebih sedikit token dan lebih sedikit giliran untuk menyelesaikan pekerjaan yang sama. Halaman ini memisahkan keduanya: setiap tarif yang dapat Anda verifikasi di lembar harga hari ini, dan aritmetika di balik angka yang tidak dapat Anda verifikasi. Claude Fable 5.1, tier $10/$50 di atasnya, muncul di seluruh bagian sebagai perbandingan yang dibuat Ant​hropic sendiri.

Daftar harga lengkap, setiap barisnya sebagaimana dipublikasikan oleh Anthropic

Semua yang ada di bagian ini dibaca dari dokumentasi harga Ant​hropic di platform.claude.com dan claude.com pada 24 September 2026. Tidak ada apa pun di sini yang diambil dari tulisan lain.

Masukan — $4,00 per juta token (tarif yang dipublikasikan Anthropic).

Output — $20,00 per juta token. Token thinking ditagih sebagai token output, dan pemikiran adaptif Claude Opus 5.5 selalu aktif serta tidak dapat dinonaktifkan.

Pembacaan cache — $0,20 per juta token. Anthropic mendokumentasikan ini sebagai 0,05x harga input dasar, pengecualian catatan kaki tersendiri untuk model ini.

penulisan cache 5 menit — $5,00 per juta token, pengganda input dasar standar 1,25x yang Anthropic terapkan pada setiap model di lembar tersebut.

Penulisan cache 1 jam — $8,00 per juta token, pengganda input dasar 2x standar.

Batch API — diskon 50% untuk kedua arah: input $2,00 dan output $10,00 per juta. Ant​hropic menerbitkan angka diskon tersebut secara langsung, alih-alih membuat Anda harus membaginya dua.

Mode cepat — $8,00 input dan $40,00 output per juta, tepat 2x standar. Dokumentasi Anthropic memberi judul halaman "Mode cepat (pratinjau riset)".

Inferensi khusus AS — pengali 1,1x pada input, output, penulisan cache dan pembacaan cache ketika inference_geo: "us" ditetapkan. Perutean global, yang merupakan default, menggunakan harga standar.

Konteks dan batas keluaran — konteks 1M token dan keluaran sinkron 128K dengan harga standar, tanpa biaya tambahan untuk konteks panjang. Ant​hropic menyatakan bahwa permintaan 900k token ditagih dengan tarif per token yang sama seperti permintaan 9k token. Pada Batch API, batas keluaran naik menjadi 300K di balik output-300k-2026-03-24 header beta.

Anthropic juga menyatakan bahwa pengganda caching "bertumpuk dengan pengubah harga lain seperti diskon Batch API dan residensi data" — jadi permintaan yang di-batch, di-cache, dan dipatok ke AS mengalikan ketiganya, dan aritmetikanya bertambah secara majemuk alih-alih menggantikan.

Inilah biaya yang sebenarnya ditimbang oleh para pembaca kedua model pada lembar yang sama:

Claude Opus 5 — $5.00 input, $25.00 output, $0.50 pembacaan cache, $6.25 untuk penulisan cache 5 menit, $10.00 untuk penulisan 1 jam, $2.50/$12.50 pada Batch (tarif yang dipublikasikan Anthropic, dibaca 2026-09-24).

Claude Fable 5.1 — $10.00 untuk masukan, $50.00 untuk keluaran, $0.25 untuk pembacaan cache, $12.50 untuk penulisan cache 5 menit, $20.00 untuk penulisan 1 jam, $5.00/$25.00 pada Batch (tarif yang dipublikasikan Anthropic, dibaca 2026-09-24).

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

Baris cache adalah tempat tagihan agen sebenarnya ditentukan.

Cakupan peluncuran memperlakukan pembacaan cache sebagai catatan kaki. Ini adalah tuas tunggal terbesar di lembar tersebut untuk beban kerja apa pun yang mengirim ulang prefiks besar, yang mencakup sebagian besar beban kerja pengodean dan agen.

Catatan kaki Anthropic sendiri luar biasa eksplisit tentang rasio-rasio tersebut: cache hit dan refresh berbiaya 0,1x harga input dasar pada sebagian besar model Claude, 0,025x pada Claude Fable 5.1, dan 0,05x pada Claude Opus 5.5. Jadi rasio cache Claude Opus 5.5 dua kali lebih buruk daripada rasio standar, dan dua kali lebih buruk daripada rasio Claude Fable 5.1.

Dalam dolar, ia tetap menang, dan inilah bagian yang perlu diresapi: pengganda yang lebih baik tidak menang dalam dolar ketika tingkat dasarnya dua setengah kali lebih tinggi.

• Claude Fable 5.1 — 2,5% dari basis $10,00 adalah $0,25 per juta token yang di-cache.

• Claude Opus 5.5 — 5% dari dasar $4.00 adalah $0.20 per juta token yang di-cache.

• Claude Opus 5 — 10% dari basis $5.00 adalah $0.50 per juta token yang di-cache.

Inversi yang sama juga berlaku pada operasi tulis. Claude Fable 5.1 mengenakan biaya $12,50 untuk menulis satu juta token ke cache 5 menit dan $20,00 untuk jendela 1 jam; Claude Opus 5.5 mengenakan $5,00 dan $8,00. Pembacaan cache adalah satu-satunya pos di mana Claude Opus 5.5 mengalahkan kedua model saudaranya dalam hal dolar absolut meskipun memiliki rasio menengah.

Dua aturan menentukan apakah penulisan itu layak dibayar sama sekali. Dokumentasi Ant​hropic menyatakan bahwa penulisan 5 menit berbiaya 1,25x input dasar dan karenanya terbayar setelah satu pembacaan cache, sedangkan penulisan 1 jam berbiaya 2x input dasar dan membutuhkan dua pembacaan agar terbayar. Dan cache terikat pada prefiks yang menghasilkannya: Ant​hropic mencatat bahwa beralih antara kecepatan cepat dan standar membuat cache tidak valid, karena permintaan pada kecepatan berbeda tidak berbagi prefiks yang di-cache. Mengubah model, tingkat effort, atau definisi alat memiliki efek yang sama. Model yang lebih murah yang memaksa penulisan ulang prefiks pada setiap pergantian bisa lebih mahal daripada model mahal yang digantikannya.

Berapa biaya sebenarnya dari loop agen yang panjang

Ambil agen pengkodean 40 putaran yang mengirim ulang prefiks 120.000 token — prompt sistem, skema alat, pohon berkas — pada setiap putaran, menambahkan 1.000 token masukan baru per putaran dari hasil alat, dan menghasilkan 800 token keluaran per putaran. Substitusi adalah intinya di sini: ubah salah satu dari empat angka tersebut agar sesuai dengan lalu lintas Anda sendiri dan aritmetika di bawah ini tetap berlaku.

Pada Claude Opus 5.5:

• Penulisan cache, sekali — 120,000 token dengan $5.00 per juta = $0.60

• Pembacaan cache, 39 giliran — 4.680.000 token dengan $0.20 per juta = $0.94

• Input baru, 40 giliran — 40.000 token dengan $4,00 per juta = $0,16

• Keluaran, 40 giliran — 32,000 token dengan $20.00 per juta = $0.64

Total sesi — $2.34, di mana pembacaan cache sekitar 40%.

Pada Claude Opus 5, jumlah token yang identik: $0,75 untuk penulisan cache, $2,34 untuk pembacaan cache, $0,20 untuk input baru dan $0,80 untuk output — $4,09.

Pada Claude Fable 5.1, jumlah token yang identik: $1.50 untuk penulisan cache, $1.17 untuk pembacaan cache, $0.40 untuk input baru dan $1.60 untuk output — $4.67.

Token yang sama, jumlah giliran yang sama, tanpa perlu klaim efisiensi: Claude Opus 5.5 hasilnya 43% lebih rendah daripada Claude Opus 5 dan 50% lebih rendah daripada Claude Fable 5.1. Dan $1,40 dari selisih $1,75 terhadap Claude Opus 5 — delapan puluh persen dari penghematan — berasal dari baris pembacaan cache saja, bukan dari tarif input utama.

Sekarang jalankan bentuk sebaliknya: panggilan single-shot dengan 20.000 token masukan dan 8.000 token keluaran, tanpa caching. Biaya Claude Opus 5.5 adalah $0,08 untuk masukan ditambah $0,16 untuk keluaran — $0,24. Biaya Claude Opus 5 adalah $0,10 ditambah $0,20 — $0,30. Itu tepat potongan harga tertera sebesar 20%, dan tidak lebih satu poin pun.

Jadi kartu tarif saja menghasilkan sekitar antara 20% dan 43% bergantung pada berapa banyak tagihan Anda yang merupakan pembacaan cache. Klaim apa pun di atas rentang itu berasal dari jumlah token, bukan dari harga.

Dari mana klaim Anthropic "sekitar 40% lebih murah untuk dijalankan" berasal

Materi peluncuran Anthropic menyatakan bahwa Claude Opus 5.5 "memerlukan lebih sedikit komputasi untuk melayani daripada Opus 5" dan bahwa pengujiannya menunjukkan model ini "akan berbiaya 40% lebih murah daripada Opus 5 pada beban kerja tipikal" dengan pengaturan bawaan. Penguraian yang diberikan Anthropic adalah bahwa model tersebut "berbiaya lebih rendah per token daripada Opus 5 dan menggunakan lebih sedikit token per tugas, yang secara keseluruhan menghasilkan penurunan biaya sebesar 40%."

Sebut itu apa adanya: karakterisasi vendor dari rata-rata lintas beban kerja yang dipilih Anthropic, bukan hasil yang diaudit dan bukan tarif yang dipublikasikan di lembar harga. Bagian yang dapat diverifikasi adalah bagian pertama — diskon 20% untuk input dan output, diskon 60% untuk pembacaan cache, keduanya dapat dibaca di lembar tersebut hari ini. Bagian kedua bergantung pada model yang menghabiskan lebih sedikit token dan lebih sedikit giliran pada Anda beban kerja, yang hanya dapat diperiksa dengan menjalankannya.

Bukti yang ditawarkan Anthropic untuk bagian token adalah serangkaian pernyataan pelanggan pada saat peluncuran. Semua berikut ini diterbitkan oleh vendor, yang menggambarkan beban kerja yang dipilih oleh vendor dan pelanggannya:

Box — model tersebut "menggunakan sepertiga token yang digunakan Opus 5," dengan jawaban "40% lebih ringkas tanpa mengurangi akurasi."

Kiro — ia "memecahkan lebih banyak daripada Opus 5 sekaligus melakukan sekitar 40% lebih sedikit panggilan dan menggunakan setengah token."

Factory — ini "menyamai Opus 5 pada upaya tinggi, sambil menggunakan 20 hingga 25% lebih sedikit token keluaran."

GitHub — ia "menggunakan salah satu token dan langkah paling sedikit yang kami ukur," dan di VS Code "menyelesaikan lebih banyak tugas terminal daripada Opus 5 dalam kurang dari separuh langkah."

Analisis merger, satu contoh yang dikerjakan tuntas — dua perusahaan perangkat lunak HR fiktif, masing-masing model membangun model Excel dan presentasi eksekutif. Anthropic melaporkan Claude Opus 5.5 selesai dalam 63 menit dibandingkan 93 menit untuk Claude Opus 5 dan "biaya produksinya 50% lebih rendah." Dilaporkan vendor, n=1.

Penyeimbang independen ini penting di sini, karena ia mengarah ke arah sebaliknya. Artificial Analysis mengukur Claude Opus 5.5 pada upaya maksimal, yaitu sekitar 119.000 token keluaran per tugas Intelligence Index, dibandingkan dengan sekitar 73.000 untuk Claude Opus 5 pada upaya maksimal — jumlah tokennya naik, bukan turun. Ringkasannya atas konfigurasi tersebut adalah bahwa Claude Opus 5.5 "setara dengan Opus 5 dalam hal biaya per tugas meskipun token keluarannya 1,6 kali lebih banyak," pada biaya yang dipublikasikan sebesar $5,98 per tugas Intelligence Index. Itu adalah pengukuran independen pada upaya maksimal, dan itu bukan kontradiksi terhadap klaim Anthropic — itu ujung lain dari skala upaya.

Yang memunculkan peringatan yang berlaku untuk setiap angka di bagian ini. Anthropic menyatakan bahwa kecuali dinyatakan lain, semua hasil Claude Opus 5.5-nya menggunakan pemikiran adaptif pada upaya maksimal. Claude Opus 5.5 default ke upaya sedang; Claude Opus 5 default ke upaya tinggi, dan tingkat dengan nama yang sama bukanlah anggaran berpikir yang sama di antara kedua model. Jadi tabel vendor yang dijalankan pada upaya maksimal dan tabel independen yang dijalankan pada upaya maksimal dengan fallback default yang diaktifkan bukanlah konfigurasi yang sama, dan pengaturan defaultnya juga bukan pengaturan yang akan benar-benar dipakai pembaca. Rata-rata 40% yang diukur pada serangkaian beban kerja terpilih, pada pengaturan yang mungkin tidak Anda gunakan, adalah hipotesis awal — bukan patokan anggaran.

Mode Cepat adalah pratinjau riset, bukan tingkatan.

Mode cepat di Claude Opus 5.5 adalah $8,00 per juta input dan $40,00 per juta output — tepat dua kali harga standar — untuk token output per detik hingga 2,5x lebih tinggi. Ini tidak meningkatkan waktu ke token pertama; peningkatannya ada pada kecepatan output, dan paling terlihat saat streaming.

Katakan sisanya secara gamblang, karena mudah untuk menganggarkan ini sebagai tier padahal bukan. Anthropic menyebut fast mode sebagai pratinjau riset. Akses diminta melalui manajer akun atau daftar tunggu. Ini memerlukan fast-mode-2026-02-01 header beta dan speed: "fast" pada permintaan. Ini hanya tersedia di Claude API — tidak di Amazon Bedrock, Google Cloud, Microsoft Foundry, atau Claude Platform on AWS. Ini tidak dapat digabungkan dengan Batch API atau dengan komitmen Priority Tier. Ini memang dapat ditumpuk dengan prompt caching dan pengali data-residency, sehingga permintaan cached fast-mode yang dipin ke AS membayar 1,1x di atas 2x. Dan memindahkan beban kerja antara kecepatan fast dan standar akan membatalkan prompt cache, yang pada loop agen yang panjang bisa lebih mahal daripada penghematan dari kecepatan.

Claude Opus 5 dan Claude Opus 4.8 juga mendukung mode cepat, dengan harga $10.00/$50.00. Claude Opus 4.7 menolak parameter tersebut sepenuhnya.

Satuan yang menentukan tagihan adalah biaya per tugas yang diselesaikan

Setiap tarif di atas adalah harga per token. Tidak ada yang membeli token. Harga per token baru menjadi biaya ketika dikalikan dengan jumlah token yang dikonsumsi suatu tugas dan jumlah percobaan yang diperlukan untuk menyelesaikannya.

Lakukan perhitungan pada contoh cache-light dari sebelumnya. Dengan $0,24 per pass, model yang menyelesaikan tugas pada percobaan pertama menghabiskan biaya $0,24. Tugas yang sama pada pesaing dengan $0,30 per pass menghabiskan biaya $0,30 — jadi model yang lebih murah tampak unggul 20%. Sekarang, anggap model yang lebih murah membutuhkan 1,2 pass per tugas yang diselesaikan, yang merupakan tingkat keberhasilan yang cukup tinggi untuk pekerjaan agentic: 1,2 × $0,24 adalah $0,288, dibandingkan $0,30 untuk alternatif sekali pass. Penghematannya lenyap. Pada tiga pass, biayanya $0,72, dan model yang tampak 20% lebih murah per token ternyata 140% lebih mahal per pekerjaan yang diselesaikan.

Itulah sebabnya klaim efisiensi Ant​hropic sendiri — lebih sedikit token, lebih sedikit panggilan, lebih sedikit langkah — dinyatakan dalam satuan yang tepat. Itu juga sebabnya tak satu pun dari klaim itu boleh dijadikan pos anggaran sampai Anda mereproduksinya. Pemeriksaannya mekanis: harga per pass, dikalikan jumlah pass per tugas yang selesai, diukur pada trafik Anda sendiri. Kedua angka itu harus Anda hasilkan sendiri, dan tidak ada vendor yang memublikasikan angka kedua untuk beban kerja Anda.

Jika Anda menginginkan satu titik referensi dari luar vendor, Artificial Analysis menempatkan Claude Opus 5.5 pada $5,98 per tugas Intelligence Index dalam konfigurasi upaya maksimalnya — angka independen pada pengaturan yang tidak akan digunakan oleh sebagian besar lalu lintas produksi, berguna sebagai batas atas ketimbang sebagai perkiraan.

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

Baris yang tidak termasuk dalam tarif utama

Residensi. Inferensi khusus AS adalah 1,1x pada setiap kategori token, termasuk pembacaan dan penulisan cache. Ini dapat digabungkan dengan mode cepat dan dengan diskon Batch.

Definisi alat. Ant​hropic menerbitkan overhead prompt sistem penggunaan alat per model: mendeklarasikan alat menambahkan 286 token ke setiap permintaan Claude Opus 5.5. Kecil pada $4,00 per juta, tetapi ditagih per permintaan, dan loop agen membuat banyak permintaan.

Invalidasi cache. Prefiks yang ditulis ulang setelah perubahan model, effort, definisi alat, atau kecepatan ditagih dengan tarif tulis — $5.00 atau $8.00 per juta pada Claude Opus 5.5 — bukan tarif baca $0.20.

Model di bawahnya. Claude Sonnet 5 berada pada $2,00 untuk input dan $10,00 untuk output per juta token, yang menurut catatan kaki penetapan harga Anthropic kini merupakan harga standar, bukan tarif perkenalan seperti yang diumumkan sebelumnya. Claude Opus 5.5 tepat 2x Sonnet 5 di kedua arah.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

Memanggil Claude Opus 5.5 dengan harga daftar Anthropic

Claude Opus 5.5 tersedia di OrcaRouter pada anthropic/claude-opus-5.5 dengan harga $4,00 untuk input dan $20,00 untuk output per juta — harga daftar resmi Anthropic sendiri, diteruskan dengan markup 0%. Pass-through itu layak dinyatakan secara tepat di halaman harga: karena tarif penyedia diteruskan, bukan di-cache dalam tabel, perubahan tarif vendor langsung berlaku di sini pada hari yang sama saat diterbitkan, bukan setelah jendela sinkronisasi. Jika Anthropic mengubah lembar ini, angka yang Anda akses ikut berpindah.

Kunci yang sama menjangkau tier yang dibandingkan oleh halaman ini — anthropic/claude-opus-5 pada $5.00/$25.00 dan anthropic/claude-fable-5.1 pada $10.00/$50.00 — bersama sisa jajaran Claude dan lebih dari 200 model lainnya, sehingga menguji apakah tarif per token yang lebih murah tetap bertahan saat berhadapan dengan jumlah pass Anda sendiri tidak memerlukan kontrak kedua atau perubahan kode. Failover otomatis hadir untuk kasus ketika Anda ingin menjalankan model yang belum Anda kenal di jalur produksi tanpa mempertaruhkan jalur tersebut padanya.

Jawaban dua baris tentang isi halaman ini: daftar tarifnya adalah $4.00 untuk input, $20.00 untuk output, dan $0.20 per juta pembacaan cache, dan potongan 20% itu nyata dan dapat diverifikasi hari ini. Angka 40% adalah rata-rata Anthropic di seluruh beban kerja yang dipilihnya. Jalankan salah satu loop agen Anda sendiri menggunakan daftar tarif ini sebelum Anda menyusun anggaran berdasarkan angka kedua.

Dibandingkan dalam artikel ini3

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari