
Claude Opus 5 API: Cara Memanggilnya, Berapa Biayanya, dan Kapan Itu Berlebihan
- DeepSeekBARUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiBARUZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianBARUQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenBARUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekBARUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokBARUSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Kecerdasan77Koding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Kecerdasan77Koding
The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.
Dua titik akhir, satu model
Kebanyakan tutorial untuk API Claude Opus 5 hanya menampilkan panggilan native Anthropic, dan berhenti sampai di situ. Sebenarnya ada dua dialek, dan keduanya mencapai bobot yang sama.
• Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.
• OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.
• Model cloud. Di Amazon Bedrock, id-nya adalah anthropic.claude-opus-5; di Google Vertex AI dan Microsoft Foundry, ia mempertahankan id first-party claude-opus-5. Jalur-jalur tersebut untuk tim yang sudah berkomitmen pada penyedia cloud; rute yang kompatibel dengan OpenAI adalah yang menjaga kode Anda tetap portabel.
Model tidak peduli dialek mana yang Anda gunakan. Yang berbeda adalah segala sesuatu di sekitar panggilan tersebut — penagihan, kunci, batas permintaan, failover, dan berapa banyak model lain yang dapat Anda jangkau tanpa mengubah kode.
Apa yang Anda dapatkan — dan dua hal yang merusak kode lama
Claude Opus 5 adalah andalan utama Anthropic yang sangat mengandalkan penalaran: jendela konteks 1M token (maksimumnya juga merupakan nilai default), batas keluaran 128K, batas pengetahuan Mei 2026, serta masukan teks, gambar, dan file dengan keluaran teks. Pada papan peringkat independen Artificial Analysis, ia mencatatkan AA Coding 78,0, peringkat #1 dari 132, dan AA Intelligence 63,1, peringkat #2 dari 134, dengan skor GPQA Diamond 93,2 dan skor Humanity's Last Exam 54,9, per 24 Juli 2026. Klaim peluncuran Anthropic sendiri — kira-kira dua kali lipat Opus 4.8 di Frontier-Bench — dijalankan oleh vendor dan tidak direproduksi secara independen.

Berpikir aktif secara bawaan. Pemikiran adaptif menentukan seberapa banyak penalaran yang dilakukan pada setiap panggilan, dikendalikan oleh output_config.effort parameter, yang menerima low hingga max dan secara bawaan menggunakan high. Untuk pengodean dan loop agenik, xhigh adalah titik awal yang disarankan; low dan medium benar-benar lebih kuat pada Opus 5 daripada di model-model sebelumnya, sehingga keduanya layak untuk beban kerja nyata, bukan sekadar panggilan mainan. Token penalaran diperhitungkan dalam tagihan output Anda.
Dua perubahan yang merusak dari Claude Opus 4.8 menggigit siapa pun yang menyalin badan permintaan lama:
• max_tokens yang ketat kini membuat keluaran terpotong.Karena proses berpikir berjalan secara default, max_tokens yang ukurannya sekitar panjang jawaban yang diharapkan akan habis digunakan oleh penalaran terlebih dahulu. Jika Anda memindahkan beban kerja 4.8 tanpa perubahan, perkirakan respons yang terpotong sampai Anda menaikkan batas atau mengurangi usaha.
• Parameter sampling ditolak. temperature, top_p, dan top_k pada nilai non-default apa pun mengembalikan error 400, begitu pula prefill asisten. Kontrol output dengan effort, bukan temperature.
• Menonaktifkan thinking dibatasi. thinking: {"type": "disabled"} hanya diterima pada effort high atau di bawahnya; memadukannya dengan xhigh atau max akan mengembalikan 400. Cara yang masuk akal untuk memangkas biaya adalah menurunkan effort, bukan mematikan thinking.
Berapa sebenarnya biayanya
Claude Opus 5 dibanderol sebesar $5 per juta token input dan $25 per juta output — harga yang sama dengan Claude Opus 4.8, yang merupakan kabar baik yang tak mencolok dari rilis ini. Pembacaan cache ditagih sebesar $0.50 per juta (cache prompt membutuhkan prefiks minimal 512 token dan mendukung TTL 5 menit dan 1 jam). Pratinjau riset mode cepat menjalankan model yang sama dengan hingga 2.5x token output per detik seharga $10 / $50, dan Batch API mengembalikan hasil secara asinkron dengan harga setengahnya.

Contoh konkret: permintaan dengan 100K token yang menghasilkan 20K token output dikenai biaya $0.50 untuk input dan $0.50 untuk output — $1.00 jika tidak di-cache. Jika prompt 100K tersebut dilayani dari cache pada panggilan berikutnya, biaya input turun menjadi sekitar $0.05, sehingga totalnya $0.55 untuk satu putaran. Aritmetika cache inilah yang menjadi pembeda antara Opus yang terjangkau pada konteks panjang yang berulang dan Opus yang sama sekali tidak terjangkau.
Tingkat di atas dan di bawahnya, sebagai skala perbandingan: Claude Fable 5 adalah model Anthropic yang paling canggih dengan harga $10 / $50; Claude Sonnet 5 adalah $3 / $15 (dengan $2 / $10 harga pengenalan hingga 31 Agustus 2026); Claude Haiku 4.5 adalah $1 / $5. Di OrcaRouter, setiap model ini diteruskan dengan harga daftar vendor tanpa markup per token, jadi perbandingan di atas juga merupakan yang sebenarnya Anda bayar.
Kasus dengan satu endpoint
Jika Anda membaca panduan API Claude Opus 5, Anda mungkin sudah memiliki integrasi dan kunci, dan pertanyaan sebenarnya adalah apakah Anda menginginkan integrasi kedua dan kunci kedua untuk model berikutnya yang Anda coba. OrcaRouter menjawabnya dengan satu endpoint yang kompatibel dengan OpenAI di depan 200+ model: klien yang sama, base URL yang sama, dan ID model yang berbeda per model — anthropic/claude-opus-5 hari ini, model yang lebih murah saat beban kerja tidak lagi mencapai tingkat Opus, model frontier baru pada minggu perilisan, semuanya tanpa perubahan kode.

Bagian yang jujur adalah ekonominya. OrcaRouter menambahkan $0 per token — Anda membayar tarif resmi masing-masing penyedia, sehingga Claude Opus 5 tetap pada harga Anthropic $5 / $25, dan potongan harga vendor langsung aktif di sisi kami pada hari yang sama saat diumumkan. Bawa kunci Anda sendiri adalah opsi kelas satu: serahkan kunci API Anthropic Anda yang sudah ada, pertahankan batas kecepatan dan kredit Anda sendiri, dan penyedia menagih Anda secara langsung. Pengaman — pelindung PII dan kebijakan konten — diberlakukan sebelum permintaan ditagih, bukan setelahnya. Halaman model untuk anthropic/claude-opus-5 menampilkan harga langsung, konteks 1M, dan angka throughput saat ini, dan DSL perutean menyusun failover sehingga model yang lebih murah menjawab saat Opus 5 mengalami error atau saat pola lalu lintas Anda memungkinkannya.
Di mana Opus 5 adalah jawaban yang salah
Menjadi yang terbaik tidak sama dengan menjadi yang tepat untuk beban kerja Anda, dan ada tiga tempat di mana produk unggulan $5 / $25 ini kalah.
• Panggilan bervolume tinggi dan berisiko rendah. Pipeline peringkasan atau klasifikasi yang memproses 10 juta token input per bulan membutuhkan biaya $50 pada Claude Opus 5 dibandingkan $10 pada Claude Haiku 4.5 — endpoint yang sama, kunci yang sama, hanya perubahan satu id. Haiku bukan Opus, tetapi untuk routing, ekstraksi, dan pemformatan, kualitasnya cukup mendekati sehingga perbedaan 5x sulit untuk dibenarkan.
• Loop agen yang panjang.Opus 5 memverifikasi hasil kerjanya sendiri tanpa diminta, sehingga instruksi "periksa ulang jawaban Anda" yang disetel untuk model lama kini memicu verifikasi berlebihan dan menghabiskan token penalaran. Pada usaha xhigh dan max, anggaran berpikir bertambah sesuai desain. Jika agen Anda tidak memerlukan penalaran frontier, Claude Sonnet 5 dengan harga $3 / $15 adalah default yang sebaiknya menjadi titik awal sebagian besar tim produksi, dan dial usaha adalah tempat Anda menyetelnya ke bawah.
• Jika model tersebut bukan milik kami.OrcaRouter merutekan dan menagih; Anthropic yang menjalankan bobotnya. Endpoint, markup nol, failover, dan guardrail adalah milik kami, tetapi kualitas inferensi dan perilaku keamanan adalah milik Anthropic, dan dengan BYOK uangnya langsung masuk ke mereka. Itulah kesepakatannya secara gamblang: Anda tetap membayar tarif penyedia bagaimanapun juga, dan pertanyaannya adalah apakah satu endpoint untuk 200+ model itu sepadan.
Intinya
Panggil API Claude Opus 5 dengan endpoint Messages asli jika Anda tidak memiliki integrasi lain, dan dengan endpoint yang kompatibel dengan OpenAI jika Anda menginginkan satu klien untuk semuanya. Model ini adalah model yang tepat ketika tugasnya sulit, konteksnya panjang, dan keluarannya bernilai $25 per juta token — dan model ini salah ketika tugasnya rutin. Pengaturan yang paling bersih adalah yang memungkinkan Anda mengubah pikiran: satu endpoint, kunci Anda sendiri, markup $0, dan id model yang dapat Anda ganti pada hari beban kerja berubah.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
