
Claude Opus 5: Model Near-Frontier dari Anthropic dengan Harga Setengah dari Fable 5
- DeepSeekBARUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiBARUZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianBARUQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenBARUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekBARUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokBARUSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Kecerdasan77Koding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Kecerdasan77Koding
Pada tanggal 24 Juli 2026, Anthropic merilis Claude Opus 5 — dan dalam sehari, model tersebut melakukan sesuatu yang jarang terjadi untuk model yang "lebih murah": model tersebut naik ke puncak papan peringkat independen. Anthropic mempromosikan Opus 5 sebagai yang mencapai hampir kecerdasan frontier dari Claude Fable 5 dengan setengah harga, dan diluncurkan pada hari yang sama di Claude.ai, Claude API, Claude Code, dan Claude Cowork. Sejak saat itu, Artificial Analysis telah menilainya sebagai model #1 dalam Intelligence Index-nya. Panduan ini mencakup apa sebenarnya Opus 5, apa yang diverifikasi secara independen versus yang dilaporkan vendor, upaya dial dan postur keamanan barunya, berapa biayanya dalam praktik, dan siapa yang harus beralih.
Setiap gambar di bawah diberi label berdasarkan sumber, karena dengan kecepatan ini cerita berubah setiap hari: apa yang tertulis "belum ada skor independen" pada hari peluncuran kini menjadi "#1 secara independen." Tolok ukur dan harga bergerak — verifikasi sebelum Anda mengalokasikan anggaran.
TL;DR. Claude Opus 5 dibanderol $5 per 1M token input dan $25 per 1M output — sama dengan Opus 4.8 dan tepat setengah dari Fable 5 seharga $10/$50. Pada Artificial Analysis Intelligence Index kini memimpin di 61 (upaya maksimal), model teratas dari 170 yang dievaluasi, mengungguli Fable 5 (60) dan setara di kelasnya dengan biaya setengah. Tolok ukur peluncuran Anthropic sendiri mendukung ini: Frontier-Bench v0.1 43.3% (vs Fable 5 33.7%), plus unggul di Zapier's AutomationBench dan tolok ukur penggunaan komputer OSWorld 2.0. Dua hal menjadikannya lebih dari sekadar pemotongan harga: sebuah dial upaya (rendah/sedang/tinggi/maksimal) yang menukar biaya dengan kemampuan per permintaan, dan postur keamanan terkuat dari Opus mana pun sejauh ini. Jika Anda sudah membangun di Claude, meningkatkan versi berisiko rendah dan tidak menaikkan tagihan Anda; jika Anda memilih antara model unggulan, Opus 5 kini menjadi pemimpin nilai-dan-kualitas — validasikan pada beban kerja Anda sendiri.
Poin-poin penting
• Sekarang secara independen #1. Artificial Analysis mencantumkan Claude Opus 5 (max effort) pada 61 di Intelligence Index — model peringkat teratas, di depan Fable 5 (60).
• Setengah dari harga Fable 5. $5 / $25 per 1M token, sama dengan Opus 4.8 dan setengah dari $10 / $50 milik Fable 5 — kualitas terdepan dengan harga menengah.
• Dial upaya baru. Pengaturan rendah/sedang/tinggi/maks menukar token (biaya) dengan kemampuan; "maks" adalah yang memuncaki papan peringkat, pengaturan yang lebih murah masih mengalahkan sebagian besar pesaing.
• Dibangun untuk agen dan penggunaan komputer. Anthropic menekankan penyelesaian tugas multi-langkah (AutomationBench) dan mengemudikan UI nyata (OSWorld 2.0), bukan hanya jawaban tunggal.
• Opus paling aman sejauh ini. Anthropic menyebutnya "model Opus yang paling selaras," memperkirakan pengklasifikasi sibernya akan turun tangan sekitar 85% lebih jarang daripada Fable 5 — lebih sedikit penolakan palsu pada pekerjaan yang sah.
• Ketersediaan luas dan langsung. Model default di Claude Max, yang terkuat di Claude Pro, dan langsung tersedia di API, Claude Code, dan Claude Cowork sejak hari pertama.
Catatan tentang membaca ringkasan ini: segala sesuatu yang diatribusikan kepada Anthropic adalah klaim vendor dari materi peluncuran; angka-angka independen (Indeks Kecerdasan) diatribusikan kepada Artificial Analysis. Jika suatu angka belum dipublikasikan (skor SWE-bench Verified yang terpisah), kami menyatakannya daripada menebak.
Apa sebenarnya Claude Opus 5 itu
Opus 5 adalah anggota terbaru dari lini Opus milik Anthropic — tingkatan "heavy" di atas Sonnet dan Haiku. Ia menempati posisi di atas Opus 4.8 dan, pada Intelligence Index independen, kini telah unggul dari Fable 5, flagship frontier milik Anthropic yang dirilis pada Juni 2026. Yang membuatnya menonjol bukanlah peningkatan kemampuan yang sederhana, melainkan kombinasinya: kecerdasan hampir di papan atas dengan harga pekerja keras. Anthropic menggambarkannya sebagai model yang "bijaksana dan proaktif" yang ditujukan untuk pengkodean, alur kerja agen, dan pekerjaan kantor perusahaan sehari-hari.
Secara konkret, Opus 5 berharga $5 per 1M token masukan dan $25 per 1M token keluaran. Ini sama dengan Opus 4.8, dan setengah dari harga Fable 5 yaitu $10 / $50. Ini adalah opsi default di Claude Max dan opsi terkuat di Claude Pro, serta tersedia melalui Claude API, Claude Code (untuk coding), dan Claude Cowork (untuk pekerjaan agen kolaboratif) sejak hari peluncuran. Jendela konteksnya adalah kelas 1M dari keluarga Opus.
Apa yang sebenarnya baru?
Sinyal paling jelas pada hari peluncuran adalah Anthropic's Frontier-Bench v0.1, sebuah paket penalaran dan tugas yang sulit: Opus 5 mencetak 43.3%, berbanding 33.7% untuk Fable 5 dan 18.7% untuk Opus 4.8. Pada tolok ukur tersebut, model baru yang lebih murah dari Anthropic mengungguli andalannya sendiri yang lebih mahal — sebuah klaim yang sejak itu telah digaungkan oleh penilaian independen.
Dua tolok ukur vendor lainnya melengkapi kisah "dibangun untuk pekerjaan nyata". Pada AutomationBench milik Zapier, yang mengukur apakah suatu model menyelesaikan tugas bisnis hingga tuntas daripada hanya memulainya, Anthropic mengatakan tingkat kelulusan Opus 5 kira-kira 1,5 kali lipat model terdekat berikutnya dengan biaya yang setara, dan bahwa bahkan pengaturan upaya termurahnya mengalahkan hasil terbaik setiap pesaing. Pada OSWorld 2.0, sebuah tolok ukur penggunaan komputer, Anthropic melaporkan Opus 5 mengungguli para pesaing di setiap titik harga dan melampaui skor puncak Fable 5 dengan menggunakan sekitar sepertiga dari anggaran. Opus 5 juga meningkatkan Opus 4.8 di setiap evaluasi ilmu hayati yang dilacak Anthropic, dengan lonjakan terbesar — lebih dari 10 poin persentase — pada tugas-tugas kimia organik seperti membaca struktur molekul dari data spektroskopi.
Dial upaya: hanya membayar untuk kemampuan yang Anda butuhkan
Fitur utama — dan yang paling menjadi fokus para pengulas — adalah pengaturan upaya. Opus 5 memungkinkan Anda memilih seberapa banyak upaya yang dikeluarkan model untuk suatu permintaan: rendah, sedang, tinggi, atau maksimal. Upaya yang lebih tinggi berarti lebih banyak token penalaran internal (sehingga biaya dan latensi lebih tinggi) dan kualitas yang lebih tinggi; upaya yang lebih rendah menghemat token untuk jawaban yang lebih cepat dan lebih murah. Ini, pada dasarnya, adalah pengatur tagihan AI Anda.
Inilah mengapa Artificial Analysis mencantumkan beberapa entri Opus 5 (medium, high, xhigh, max): setiap tingkat usaha adalah titik berbeda pada kurva biaya-kualitas. Pengaturan "max" adalah yang saat ini menempati puncak Indeks Intelijen di angka 61; pengaturan yang lebih rendah mengorbankan sedikit kualitas demi biaya per tugas yang jauh lebih rendah, dan bahkan itu, menurut Anthropic, mengalahkan hasil terbaik sebagian besar pesaing. Dalam praktiknya, ini berarti satu model dapat melayani panggilan sensitif latensi dengan volume tinggi (low/medium) dan tugas penalaran tersulit Anda (high/max) — Anda menyesuaikan per permintaan alih-alih mengganti model.

Analisis mendalam tentang benchmark: apa yang sebenarnya diukur oleh tes-tes ini
Hal ini membantu untuk mengetahui arti setiap angka sebelum mempercayainya. Indeks Artificial Analysis Intelligence Index adalah gabungan dari banyak evaluasi independen (penalaran, matematika, pengkodean, pengetahuan) yang dijalankan oleh pihak ketiga; skor 61 yang menempatkan Opus 5 pertama dari 170 model adalah sinyal tunggal paling kredibel di sini, tepatnya karena Anthropic tidak menjalankannya.Frontier-Bench v0.1 (43.3% untuk Opus 5) adalah set sulit milik Anthropic sendiri — sinyal relatif bahwa Opus 5 menyelesaikan masalah yang lebih sulit daripada Fable 5 (33.7%) atau Opus 4.8 (18.7%), bukan "43% benar" dalam pengertian sekolah.
AutomationBench dan OSWorld 2.0 lebih penting daripada satu skor penalaran jika kasus penggunaan Anda adalah agen. AutomationBench memberikan penghargaan pada penyelesaian tugas — perbedaan antara agen yang menulis draf email dan agen yang benar-benar mengajukan laporan biaya — dan OSWorld 2.0 memberikan penghargaan pada pengoperasian antarmuka UI komputer nyata. Klaim Anthropic bahwa Opus 5 menyamai puncak OSWorld Fable 5 dengan sepertiga biaya, sekarang setelah Intelligence Index mengonfirmasi standing umumnya, merupakan argumen yang kuat untuk memindahkan beban kerja agen ke Opus 5. Satu celah: belum ada angka SWE-bench Verified yang diaudit secara independen untuk Opus 5 (Fable 5 berada di 95,0%, Opus 4.8 di 88,6%), jadi untuk kutipan akurasi pengkodean murni, tunggu angka tersebut.

Berapa biayanya dalam praktik
Harga per-token bersifat abstrak; biaya per-tugas yang muncul di faktur Anda. Ambil contoh langkah agen representatif dengan 20.000 token input dan 3.000 token output. Opus 5 (dan Opus 4.8): input 20k × $5/1M = $0,10, output 3k × $25/1M = $0,075, jadi sekitar $0,175 per panggilan. Fable 5 dengan harga $10 / $50: $0,20 input + $0,15 output = sekitar $0,35 — kira-kira dua kali lipat. Selama 100.000 panggilan sebulan, itu berarti sekitar $17.500 untuk Opus 5 versus sekitar $35.000 untuk Fable 5. Karena Intelligence Index kini menempatkan Opus 5 di depan Fable 5, ini bukan "hampir setara Fable 5 dengan biaya lebih rendah" — melainkan kualitas kelas terdepan dengan tagihan bulanan kira-kira setengahnya.
Tombol usaha mengubah perhitungan lagi. Pipeline dukungan bervolume tinggi dapat menangani sebagian besar panggilan dengan usaha rendah atau sedang — lebih murah daripada angka di atas — dan menyisihkan usaha maksimal untuk segelintir tiket yang benar-benar sulit. Framing Anthropic adalah bahwa pengaturan yang murah pun mengalahkan yang terbaik dari pesaing, jadi Anda jarang membayar untuk kemampuan yang tidak Anda gunakan. Modelkan campuran tingkat usaha Anda sendiri daripada menganggap setiap panggilan berjalan dengan usaha maksimal.
Cara mengakses dan menggunakan Claude Opus 5
Opus 5 tersedia segera di lima tempat: Claude.ai (di mana itu menjadi default pada paket Max dan opsi terkuat di Pro), Claude API (id model di dokumen Anthropic), Claude Code (untuk pengkodean terminal dan IDE), dan Claude Cowork (untuk pekerjaan agen kolaboratif multi-langkah). Pengguna API mengatur tingkat upaya sebagai parameter, sehingga trade-off biaya-kemampuan dapat diprogram per permintaan. Jika Anda sudah memanggil Opus 4.8, beralih adalah perubahan id model dengan harga yang sama — peningkatan dengan gesekan terendah yang pernah dikirimkan Anthropic dalam beberapa waktu.
Untuk siapa: tiga skenario
1. Pipeline agen dan penggunaan komputer
Jika produk Anda menjalankan agen multi-langkah atau mengendalikan browser atau desktop, hasil AutomationBench dan OSWorld 2.0 dari Opus 5 secara langsung ditujukan untuk Anda — kini didukung oleh Indeks Intelijen #1 yang independen. Jalankan sebagian besar langkah dengan usaha sedang dan tingkatkan ke tinggi/maksimal untuk langkah-langkah yang sulit; uji coba pada jejak agen Anda sendiri sebelum berkomitmen.
2. Tim coding mengawasi anggaran
Opus 5 sudah ada di Claude Code sejak hari pertama dengan harga Opus 4.8. Dengan keunggulan Intelligence Index, ia menjadi default coder yang kuat; satu-satunya kutipan yang hilang adalah angka SWE-bench Verified yang independen (Fable 5 masih memegangnya di 95.0%). Untuk tim yang sudah menggunakan Claude, peningkatan ini berisiko rendah dan tanpa kenaikan harga.
3. Perusahaan yang menstandarisasi satu model
Ketersediaan luas, konteks kelas 1M, profil penyelarasan Opus teraman, dan pengatur tingkat usaha yang mencakup pekerjaan massal murah maupun penalaran rumit menjadikan Opus 5 sebagai default tunggal yang masuk akal untuk pekerjaan kantor dan teknik campuran — dengan biaya yang jauh lebih mudah dipertahankan dibandingkan flagship frontier.

Keselamatan dan penyelarasan
Anthropic memposisikan Opus 5 sebagai rilis Opus yang paling aman: "model Opus yang paling selaras," dan "yang paling tidak rentan terhadap tipu daya untuk penyalahgunaan." Konsekuensi praktis penting untuk penerapan nyata: Anthropic memperkirakan pengklasifikasi siber Opus 5 akan campur tangan sekitar 85% lebih jarang dibandingkan Fable 5. Secara sederhana, itu berarti lebih sedikit penolakan palsu pada pekerjaan keamanan, pengkodean, atau penelitian yang sah — frustrasi umum dengan model batas depan yang dijaga ketat — sambil tetap memblokir penyalahgunaan yang sesungguhnya. Seperti biasa, validasi terhadap konten dan persyaratan kepatuhan Anda sendiri daripada menerima sikap tersebut begitu saja.
Kisah kontrol ekspor Fable 5 sekarang ada di dalam prompt sistem.
Peluncuran Fable 5 sama sekali tidak mulus, dan konteks itu penting bagi siapa pun yang membandingkan Claude Opus 5 dengannya. Tiga hari setelah Claude Fable 5 dan Claude Mythos 5 dirilis pada 9 Juni 2026, Anthropic menangguhkan kedua model tersebut untuk mematuhi perintah kontrol ekspor Departemen Perdagangan AS; kontrol tersebut dicabut pada 30 Juni dan akses dipulihkan pada 1 Juli. Rangkaian kejadian itu adalah sejarah yang terdokumentasi — Simon Willison menyaksikan API Anthropic mulai mengembalikan error secara real time, dan Anthropic menerbitkan pernyataannya sendiri tentang penangguhan dan pemulihan tersebut.
Yang baru adalah cara Opus 5 menangani pertanyaan tentang hal itu. Batas pelatihan model adalah Mei 2026, sehingga penutupan dan pembatalannya berada di luar apa yang dipelajarinya. Sekitar 200.000 karakter Claude Opus 5 prompt sistem yang diposting oleh red-teamer Pliny the Liberator pada 25 Juli — sebuah dokumen yang belum dikonfirmasi Anthropic sesuai dengan versi produksi — mencatat linimasa lengkap dan menginstruksikan model untuk menjawab pertanyaan tentang penangguhan tersebut secara terus terang daripada menyangkalnya, mengarahkan pengguna ke pernyataan resmi Anthropic ketika model tidak dapat mengonfirmasi status saat ini. Ini adalah contoh konkret dari vendor yang menulis sejarah pasca-cutoff ke dalam prompt sehingga model tidak berimprovisasi tentang keluarganya sendiri.
Kapan tidak menggunakannya
Jangan meraih Opus 5 ketika Anda secara spesifik membutuhkan nomor kode SWE-bench Verified yang diaudit secara independen untuk dikutip hari ini — angka itu belum dipublikasikan, dan Fable 5 (95.0%) masih memegangnya. Jangan berasumsi setiap pengaturan usaha adalah #1; 61 yang memuncaki papan peringkat adalah pengaturan maksimal, dan pengaturan yang lebih rendah mengorbankan beberapa kualitas demi biaya, jadi tolok ukur tingkat usaha yang benar-benar akan Anda jalankan. Dan untuk teks murni volume tinggi yang sensitif terhadap latensi tanpa kebutuhan penalaran, model tingkat efisiensi yang lebih murah (misalnya Gemini 3.6 Flash dengan harga $1.50 / $7.50) akan tetap lebih murah per token — Opus 5 adalah model penalaran dan agen, bukan model teks massal.
FAQ
Berapa biaya Claude Opus 5?
$5 per 1 juta token input dan $25 per 1 juta token output — sama dengan Opus 4.8, dan setengah dari $10 / $50 milik Fable 5. [Anthropic]
Apakah Opus 5 benar-benar model #1?
Pada Artificial Analysis Intelligence Index, ya pada saat tulisan ini dibuat: Claude Opus 5 (max effort) memimpin dengan 61 dari 170 model, unggul dari Fable 5 (60). Itu adalah skor independen, bukan klaim vendor. Papan peringkat lainnya dan beban kerja Anda sendiri mungkin memeringkat secara berbeda, dan peringkat berubah seiring model ditambahkan.
Apa itu dial usaha?
Pengaturan per-permintaan (low/medium/high/max) yang menukar token — dan karenanya biaya dan latensi — dengan kemampuan. Max memuncaki papan peringkat; pengaturan yang lebih murah masih mengalahkan sebagian besar pesaing menurut Anthropic. Pengguna API mengaturnya sebagai parameter.
Apakah Opus 5 lebih baik daripada Fable 5?
Pada Intelligence Index independen (61 vs 60) dan Frontier-Bench v0.1 milik Anthropic (43.3% vs 33.7%), ya — dengan setengah harga. Fable 5 masih memimpin SWE-bench Verified yang diukur secara independen (95.0%), jadi untuk kutipan akurasi pengkodean murni, Fable 5 tetap memegang mahkota spesifik tersebut.
Bagaimana perbandingan Opus 5 dengan Opus 4.8?
Harga yang sama $5/$25, tolok ukur vendor yang secara material lebih tinggi (Frontier-Bench v0.1 43.3% vs 18.7%) dan keuntungan di setiap evaluasi ilmu hayati yang dilacak, ditambah tombol upaya baru dan penyelarasan yang lebih aman. Bagi pengguna 4.8 yang sudah ada, ini adalah peningkatan gratis tanpa kenaikan harga.
Seberapa amankah itu?
Anthropic menyebutnya sebagai model Opus yang paling selaras dan paling tidak rentan terhadap penyalahgunaan, serta memperkirakan pengklasifikasi sibernya akan campur tangan sekitar 85% lebih jarang dibandingkan Fable 5 — biasanya lebih sedikit penolakan palsu pada pekerjaan yang sah.
Di mana saya bisa menggunakan Claude Opus 5?
Claude.ai (bawaan di Max, terkuat di Pro), API Claude, Claude Code, dan Claude Cowork — aktif sejak 24 Juli 2026.
Apa itu jendela konteks?
Kelas token 1M keluarga Opus (Opus 4.8 adalah 1M tanpa biaya tambahan konteks panjang). Anthropic belum memisahkan angka Opus 5, jadi anggap saja sebagai kelas 1M sampai dikonfirmasi.
Apakah ini mendukung gambar atau video?
Opus 5 terutama adalah model penalaran berbasis teks dan alat. Untuk pemahaman multimodal (gambar/video) yang berat, model seperti Gemini 3.1 Pro dirancang khusus; gunakan Opus 5 untuk teks, kode, dan agen.
Intinya
Claude Opus 5 ternyata lebih dari sekadar langkah penyesuaian harga. Harganya seperti kuda kerja — $5/$25, setengah dari harga Fable 5 dan sama dengan Opus 4.8 — tetapi kini memimpin Indeks Kecerdasan Analisis Buatan independen di angka 61 (upaya maksimal), didukung oleh tolok ukur vendor yang kuat (Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0), tombol upaya yang benar-benar berguna, dan profil keselarasan paling aman dari semua Opus. Satu kekurangannya adalah masih belum adanya angka SWE-bench Verified independen, di mana Fable 5 (95.0%) mempertahankan sitasi akurasi pengkodean. Bagi pengguna Claude yang sudah ada, peningkatan ini berisiko rendah dan tidak menaikkan tagihan; bagi yang lain, Opus 5 kini menjadi model yang harus dikalahkan dalam hal kualitas per dolar — validasikan pada beban kerja Anda sendiri, dan arahkan bersama setiap pesaing melalui satu titik akhir yang kompatibel dengan OpenAI di OrcaRouter.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
