
Demo Claude Opus 5.5 Berbiaya $3 hingga $26: Cara Membaca Hari-Hari Pertama Proses Build
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 495 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 186 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
Dua angka dari minggu pertama Claude Opus 5.5 menggambarkan model yang sama dan berselisih satu orde besaran. Seorang pengembang melaporkan lab lensa interaktif yang sudah selesai — halaman tempat Anda menarik cincin fokus dan menyaksikan bidang fokus yang berpendar menyapu lembah — dengan biaya $25,66 untuk pemakaian API dan waktu nyata satu jam 26 menit. Sebuah rangkuman demo peluncuran yang banyak dibagikan memberi harga animasi kastel Blender yang dibangun secara prosedural, lengkap dengan kembang api dan pantulan danau, sebesar $13,30 dan 35 menit. Sebuah utas yang masuk halaman depan r/ClaudeAI menyebut $3,21. Vendor merilis Claude Opus 5.5 pada 22 September 2026 dengan tarif $4 per juta token input dan $20 per juta token output, dan tak satu pun dari ketiga angka itu yang salah. Ketiganya mengukur hal yang berbeda, dan jika Anda menyusun anggaran berdasarkan angka-angka itu, Anda perlu tahu yang mana.
Kesenjangan itu bukanlah derau. Itu adalah perbedaan antara apa yang sebuah eksekusi agen hasilkan dan apa yang ia konsumsi, dan empat hari terakhir telah menghasilkan sejumlah besar yang terakhir dengan sangat sedikit pertanggungjawaban atasnya. Jadi inilah aritmetika yang tidak diposting siapa pun bersama demo-demo itu, lalu bagian dari peluncuran yang sebenarnya ada di daftar tarif dan dapat diperiksa.
Apa yang sebenarnya dibeli dengan $25,66
Ujung mahal dari rentang itu adalah ujung yang paling berguna, karena pembangunnya menerbitkan baik artefak maupun tagihannya.
Lab lensa Ryan Sael, yang berjudul "Bidang Fokus", adalah satu halaman interaktif yang dibangun dari satu prompt dalam satu sesi. Halaman ini menampilkan lensa kamera di layar, memungkinkan Anda menyeret cincin fokus, dan menunjukkan kepada Anda hal yang diketahui setiap fotografer tetapi hampir tidak pernah dilihat siapa pun: bidang tipis di dunia tempat sebuah foto benar-benar menjadi tajam. Putar cincinnya dan bidang itu bergerak, elemen kaca meluncur maju atau mundur di dalam tabung lensa untuk menunjukkan alasannya, dan sebuah konsol melaporkan jarak, bukaan, dan zona tajam — 60 cm, f/2, kedalaman 1,9 cm, pada pengaturan saat halaman dibuka. Kecilkan bukaan dari f/2 ke f/16 dan zona tajam melebar seiring kerucut cahaya menyempit. Tampilan terurai memisahkan elemen kaca. Tidak ada model gambar di mana pun dalam pipeline, dan tidak ada aset yang diunduh: setiap elemen digambar dan dianimasikan dalam kode, itulah sebabnya seluruh demonstrasi lingkaran kekaburan adalah simulasi langsung, bukan diagram.
Itu adalah penjelasan yang benar-benar bagus, dan klaim yang menyertainya luar biasa tepat: sekali percobaan, 1 jam 26 menit, penggunaan API senilai $25,66, dengan halaman tersebut aktif di lens.lab.sael.net saat saya membacanya. Angka itu dilaporkan sendiri dan tidak dapat diaudit, tetapi itu juga satu-satunya biaya demo yang beredar yang disertai durasi sesi untuk dibagi.
Lakukan perhitungan pada kartu tarif. Pada tarif Claude Opus 5.5 yang dipublikasikan sebesar $4 per juta token input dan $20 per juta token output, $25,66 berada di antara 1,28 juta token dan 6,4 juta token bergantung pada campurannya — ujung atas jika prosesnya hanya input, ujung bawah jika hanya output. Build agentik seperti ini berada di suatu tempat di tengah, dan alasan ia lebih dekat ke ujung bawah adalah pos biaya yang dilewatkan sebagian besar orang: pembacaan cache pada Claude Opus 5.5 berbiaya $0,20 per juta, satu per empat puluh dari tarif input, sehingga sesi panjang yang terus membaca ulang basis kode yang sama dan terus tumbuh hampir tidak membayar apa pun untuk trafik itu. Sepuluh juta token input yang di-cache berbiaya $2. Di sisi output-lah akumulasi satu setengah jam model menulis kode, berpikir, dan menulis ulang kode itu terjadi: pada $20 per juta, satu juta token output adalah $20, dan token pemikiran ditagih sebagai output. Angka Sael konsisten dengan proses yang menghasilkan sekitar satu juta token output dibandingkan dengan sisi input yang besar, murah, dan di-cache — yang persis seperti wujud build 86 menit tanpa pengawasan.
Dua hal menyusul. Pertama, pemotongan harga tertera yang menarik perhatian pada hari peluncuran, dari $5/$25 menjadi $4/$20, adalah perubahan 20% per token dan tidak akan, dengan sendirinya, membuat proses ini murah; pemotongan biaya baca cache dari $0.50 menjadi $0.20 adalah pos yang membuat loop 90 menit terjangkau. Kedua, dan ini kurang nyaman: tidak ada apa pun dalam laporan $25.66 yang memberi tahu Anda apakah proses ini berjalan baik. Eksekusi sekali jalan yang dilakukan dengan baik dan sesi yang berjuang keras selama satu setengah jam lalu berhasil menghasilkan tagihan yang sama.
Angka $13,30 itu tidak lolos dari perhitungannya sendiri.
Bagian tengah rentang ini instruktif karena alasan yang berbeda. Rangkuman demo peluncuran yang diterbitkan 23 September melaporkan adu langsung di mana Claude Opus 5.5 diminta membangun secara prosedural animasi Blender sepuluh detik dari satu prompt — kastil, pantulan danau, kembang api — melawan GPT-6 Astra, tanpa penyuntingan manual, dan melaporkan 35 menit serta 199.600 token keluaran dengan biaya sekitar $13,30, dibandingkan 28 menit dan sekitar $14,50 untuk GPT-6 Astra. Jumlah token adalah bagian yang menarik, karena tidak selaras dengan harganya.
199.600 token output dengan tarif Claude Opus 5.5 sebesar $20 per juta adalah $3,99, bukan $13,30. Untuk mencapai $13,30 hanya dari output, Anda memerlukan 665.000 token. Uang yang hilang ada di kolom lain: input sebesar $4 per juta, penulisan cache sebesar $5 per juta untuk breakpoint lima menit dan $8 per juta untuk satu jam, serta percobaan ulang apa pun. Itu bukan kontradiksi dalam laporan — itu adalah laporan yang jujur tentang jumlah token yang menghitung satu hal dan tagihan yang menghitung empat, yang merupakan kebingungan paling umum dalam pembicaraan biaya minggu peluncuran. Jika Anda mengambil satu angka dari demo yang dipublikasikan, ambil angka dolarnya, dan perlakukan setiap jumlah token di sampingnya sebagai deskripsi sebagian dari eksekusi.
Di ujung murah, perinciannya semakin tipis. Utas r/ClaudeAI yang melaporkan penggunaan API senilai $3.21 untuk build yang sudah selesai adalah tipikal dari genre ini: judul, video, dan tanpa rincian. Masuk akal jika itu sesi yang lebih pendek, artefak yang lebih kecil, atau banyak input yang di-cache. Ini bukan sesuatu yang bisa dijadikan patokan untuk menyusun anggaran, dan saya tidak bisa memverifikasi satu dolar pun darinya.
Mengapa setiap angka ini merupakan batas bawah
Pola kegagalan di sini bukanlah bahwa para pembangunnya berpura-pura. Ini soal seleksi. Demo yang beredar adalah demo yang berhasil, dipublikasikan oleh orang-orang yang mempekerjakan para pembuatnya, dan empat percobaan yang menghasilkan halaman rusak memakan biaya yang sama dengan satu percobaan yang tidak rusak. Rangkuman yang menyusun perbandingan Blender mengatakan ini secara terang-terangan — bahwa tidak ada yang memposting kegagalan — dan entri paling terperincinya sendiri adalah contoh yang tepat: situs merek jam yang gagal memenuhi brief dan menggunakan font yang tidak terbaca pada percobaan pertama serta membutuhkan percobaan kedua untuk menjadi versi yang ditampilkan.
“One shot” juga melakukan kerja senyap dalam kosakata itu. Istilah itu menggambarkan satu sesi, bukan satu percobaan, dan sebuah sesi boleh memuat koreksi diri sebanyak yang dapat dihasilkan model — yang, dalam proses berdurasi 86 menit, jumlahnya banyak. Model yang menulis ulang kodenya sendiri dua kali dalam satu jendela konteks adalah one shot dan dua percobaan.
Jadi, pembacaan yang jujur terhadap empat hari pertama adalah tiga tingkatan bukti, dan itu tidak boleh dirata-ratakan:
• Biaya yang dilaporkan sendiri dengan durasi sesi — dapat digunakan untuk perkiraan orde besaran, tidak dapat diverifikasi. $25,66 milik Sael selama 1j26m adalah item terkuat di tier ini.
• Biaya yang dilaporkan sendiri dengan jumlah token — sering kali tidak konsisten secara internal, seperti yang ditunjukkan angka $13,30.
• Angka dolar tanpa dasar apa pun — sebuah sinyal bahwa seseorang telah membangun sesuatu, dan tidak lebih dari itu.
Bagian dari peluncuran yang tercantum di kartu tarif
Singkirkan klaim-klaim demo, dan gambaran yang dapat diverifikasi itu sempit serta jelas. Semua angka di bawah ini adalah tarif yang diterbitkan Anthropic, yang dibaca dari dokumentasi model dan pengumuman perusahaan itu sendiri pada 25 September 2026:
• Input — $4 per juta token. Output — $20 per juta, dengan token pemikiran ditagih sebagai output, dan pemikiran adaptif Claude Opus 5.5 selalu aktif serta tidak mungkin dimatikan.
• Pembacaan cache — $0,20 per juta, pengali 0,05x. Penulisan cache — $5 per juta pada breakpoint lima menit, $8 per juta pada satu jam. Batch API — diskon 50% untuk kedua arah, $2 dan $10.
• Mode cepat — $8 input dan $40 output per juta, hingga 2,5x kecepatan, dan Anthropic masih melabelinya sebagai pratinjau riset.
• Envelope — konteks 1M token, token output 128K secara sinkron dan 300K pada Batch API dengan header beta, cutoff pengetahuan andal Juni 2026, upaya default medium alih-alih high yang menjadi default Claude Opus 5.
• Ketersediaan — Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS, dengan penghentian yang dikomitmenkan tidak lebih awal dari 22 September 2027.
Klaim performa milik vendor itu sendiri, yang dilabeli sebagai klaim: Claude Opus 5.5 tampil setara dengan Claude Fable 5.1 pada sebagian besar pekerjaan, berbiaya sekitar 40% lebih murah untuk dijalankan daripada Claude Opus 5, dan menghasilkan output lebih dari 30% lebih cepat. Angka 40% itu adalah rata-rata beban kerja yang dipilih vendor, bukan angka pada kartu tarif, dan keduanya tidak boleh dikutip seolah-olah keduanya adalah jenis fakta yang sama.
Pemeriksaan independen lebih kecil daripada tabel vendor dan menunjuk ke arah yang sama dengan margin yang lebih kecil. Artificial Analysis memberi skor Claude Opus 5.5 sebesar 57,6 pada Intelligence Index-nya, bersama 61,4 pada Humanity's Last Exam, 66,9 pada SciCode, dan 84,7 pada recall konteks panjang dalam angka-angka yang tercantum di halaman modelnya. Pada pengukuran coding-agent dari publikasi yang sama, yang melaporkan biaya per tugas alih-alih biaya per token, angkanya bergerak ke arah sebaliknya: pada upaya maksimum, biaya per tugas naik menjadi sekitar $13,04, dibandingkan $10,79 untuk Claude Opus 5 dalam harness yang sama. Token yang lebih murah yang justru lebih banyak dihabiskan model bukanlah tugas yang lebih murah. Itu adalah pelajaran yang sama yang diajarkan oleh tagihan demo, yang datang dari pihak ketiga.
Apa yang perlu dilakukan secara berbeda pada minggu kedua
Jika angka $25.66 adalah yang membuat Anda ingin mencoba ini, langkah yang berguna bukanlah menganggarkan $25.66 — melainkan membuat perhitungan Anda sendiri menghasilkan angka yang bisa Anda jelaskan.
Tetapkan effort secara eksplisit daripada menerima default, karena itu adalah dial yang menggerakkan token per tugas lebih banyak daripada pilihan model, dan default pada model ini berubah dari Claude Opus 5. Lakukan cache pada prefix stabil dengan sengaja: prompt minimum yang dapat di-cache pada Claude Opus 5.5 adalah 512 token, turun dari 1.024, sehingga prefix bersama yang pendek yang sebelumnya tidak pernah di-cache sekarang bisa. Beri ruang gerak untuk pekerjaan yang berjalan lama di max_tokens, karena thinking adalah bagian dari anggaran itu dan tidak bisa lagi dimatikan — panduan migrasi Anthropic sendiri menyarankan memulai dari 64K untuk pekerjaan pada tingkat effort tertinggi dan menyetel dari sana. Dan instrumentasi proses di akhir, bukan di awal: baca field model tingkat atas pada setiap respons, karena pada prompt yang ditandai oleh pengklasifikasinya, Anthropic mengarahkan ulang permintaan di dalam panggilan yang sama, dan string model yang Anda kirim tidak menggambarkan apa yang menjawab.
Poin terakhir itulah tempat sebuah router berhenti menjadi sekadar kemudahan. Sebuah build yang berjalan tanpa pengawasan selama satu setengah jam melewati batas pengaman bisa kembali dengan diam-diam telah menyelesaikan beberapa giliran pada model yang lebih kecil, dan satu-satunya cara untuk mengetahuinya adalah dengan memeriksanya. Claude Opus 5.5 tersedia di OrcaRouter dengan harga daftar Anthropic sendiri tanpa markup 0% — tarif penyedia diteruskan langsung, jadi perubahan harga vendor langsung berlaku di sini pada hari yang sama saat diumumkan — yang merupakan hal paling tidak menarik yang dilakukan routing di sini. Yang menarik adalah bahwa satu API untuk 200+ model menempatkan seluruh eksperimen pada satu kunci, sehingga "jalankan pada model frontier, dan fallback daripada gagal" menjadi satu baris konfigurasi alih-alih kontrak kedua dan penulisan ulang. Failover otomatis inilah yang membuat model yang tidak dikenal aman untuk ditempatkan pada jalur yang Anda pedulikan, dan penolakan yang bisa Anda alihkan adalah penolakan yang tidak mengakhiri proses Anda pada menit ke-70.
Nomor yang akan bergerak selanjutnya
Anthropic telah mengatakan Claude Sonnet 5.5 dan Claude Haiku 5.5 menyusul "dalam beberapa minggu ke depan," dan itu akan mengubah harga setiap demo ini tanpa mengubah bentuknya: tarif per token yang lebih murah dibandingkan jumlah token yang tidak dapat diprediksi sebelumnya oleh siapa pun. Ketidakpastian yang sama yang membuat angka minggu pertama tidak dapat digunakan akan berlaku juga pada generasi berikutnya, dan itulah alasan untuk membangun kebiasaan sekarang alih-alih setelah pemotongan harga terjadi lagi.
Untuk saat ini, ringkasan jujurnya singkat. Claude Opus 5.5 nyata, tersedia secara umum, dan dihargai $4 dan $20 dengan pembacaan cache termurah yang pernah dibawa lini ini. Demo yang dihasilkannya dalam empat hari pertamanya luar biasa dan label harganya hanyalah anekdot. Jika Anda menginginkan biaya untuk beban kerja Anda sendiri, satu-satunya instrumen yang membacanya adalah eksekusi Anda sendiri, dibatasi, lalu tagihannya dibaca setelahnya.



Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
