Kartu judul hero dengan judul 'Claude Opus 5.5 Menjalankan, Claude Fable 5.1 Memberi Saran' dan subjudul 'Penetapan Harga Loop Penasihat Claude Code', diagram dari kiri ke kanan yang menunjukkan Fable 5.1 menulis rencana, Opus 5.5 menjalankan loop, dan panah umpan balik melengkung berlabel 'memberi saran dan memverifikasi', serta logo OrcaRouter di sudut kanan bawah.
Guides & Insights

Claude Opus 5.5 Mengeksekusi, Claude Fable 5.1 Memberi Saran: Menetapkan Harga Loop Penasihat Claude Code

Penulis

Gideon Frost

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Claude Fable 5.1 menulis rencana desain. Claude Opus 5.5 mengeksekusinya dalam sebuah loop. Fable 5.1 kembali sebagai advisor dan menerima atau menolak hasilnya. Itulah pola yang diposting X/@dotey pada 22 September 2026 — hari ketika vendor merilis Claude Opus 5.5 — yang membingkainya sebagai pengaturan penghematan token yang dicapai di bawah tekanan biaya: atur advisor ke Fable, jalankan Opus, dan biarkan model mahal itu berbicara hanya pada titik-titik keputusan. Apa yang mereka gunakan bukan lagi trik prompt atau konfigurasi subagen. Itu adalah alat advisor bawaan Claude Code, fitur sisi server yang ditagih dengan tarif model advisor, di atas semua yang dihabiskan model utama. Dan nasihatnya adalah bagian yang murah. Membaca ulang percakapan untuk menghasilkannya tidak murah — konteks eksekutor menjadi murah untuk dibaca ulang, dan konteks advisor tidak pernah murah. Asimetri tunggal itulah yang menentukan apakah loop ini layak dijalankan, dan itulah yang dihitung oleh sisa artikel ini.

Apa sebenarnya loop itu

Alat penasihat memasangkan model utama Anda dengan model kedua, biasanya lebih kuat, yang dikonsultasikan oleh Claude pada momen-momen penting — sebelum berkomitmen pada suatu pendekatan, ketika kesalahan terus berulang, atau sebelum menyatakan tugas selesai. Penasihat menerima percakapan lengkap, termasuk setiap panggilan alat dan hasilnya, dan mengembalikan panduan yang kemudian diterapkan oleh model utama. Ia tidak pernah memanggil alat dan tidak pernah menghasilkan output yang ditampilkan kepada pengguna. Anda memilih model mana yang memberi nasihat; Claude memutuskan kapan memanggilnya.

Bagian terakhir itulah yang membedakan ini dari pola orkestrator-dan-subagen yang beredar di komunitas Claude Code pada Agustus. Subagen adalah delegasi: seorang perencana menguraikan pekerjaan dan mengirimkannya ke para pekerja, dan Anda mengonfigurasi model tiap jalur secara eksplisit. Penasihat adalah eskalasi: satu model menjalankan seluruh tugas, dan model mahal ditarik masuk di tengah proses untuk mengambil keputusan yang tidak bisa diambil sendiri oleh pengendali. Tidak ada kumpulan pekerja, tidak ada graf tugas, dan tidak ada prompt orkestrasi yang perlu dipelihara. Lingkar praktis yang dijelaskan @dotey — rencanakan, eksekusi, verifikasi, ulangi — adalah wujud mekanisme itu ketika Anda mengarahkan penasihat ke Fable 5.1 dan membiarkannya mengawasi kondisi keluar lingkar tersebut.

Rumusan Anthropic sendiri tentang strategi ini gamblang soal bentuk kemenangannya: penasihat "hanya dapat menyerahkan kemampuan yang tidak dimiliki pelaksana." Semua di bawah ini mengikuti dari seberapa besar kemampuan yang sebenarnya tidak ada, dan seberapa sering pelaksana mengakuinya.

Mengapa Claude Opus 5.5 mengubah aritmetika

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Daftar tarif yang diterbitkan Anthropic, per juta token. Ini angka dari vendor, bukan perkiraan:

• Claude Opus 5.5 — $4 untuk input, $20 untuk output, $0,20 untuk baca cache, $5 untuk tulis cache 5 menit

Claude Opus 5 — $5 input, $25 output, $0.50 pembacaan cache, $6.25 untuk penulisan cache 5 menit

• Claude Fable 5.1 — $10 input, $50 output, $0,25 pembacaan cache, $12,50 untuk penulisan cache 5 menit

Dua detail dalam daftar itu lebih penting daripada harga utamanya. Pertama, pembacaan cache pada Opus 5.5 adalah 5% dari input dasar, menurut catatan kaki Anthropic sendiri, sementara sebagian besar model Claude berada di 10% dan Fable 5.1 berada di 2,5%. Fable 5.1 memiliki pengali yang lebih baik tetapi tetap kalah dalam hal nilai dolar absolut — $0,20 versus $0,25 — karena tarif input dasarnya dua setengah kali lebih tinggi.

Kedua, dan inilah mekanisme yang menjadi poros loop ini: menyalakan atau mematikan advisor di Claude Code tidak membatalkan cache prompt model utama, sehingga konteks executor yang panjang dan dikirim ulang berulang kali tetap murah pada $0.20 per juta. Pembacaan percakapan oleh advisor sendiri tidak di-cache. Setiap konsultasi memproses transkrip lengkap dari awal, dengan tarif input Fable 5.1 sebesar $10 per juta. Executor yang membaca ulang konteks 500K token sepuluh kali membayar pembacaan cache; advisor yang dikonsultasikan sepuluh kali membayar sepuluh tagihan input baru atas transkrip yang terus bertambah sepanjang waktu. Semakin murah konteks executor Anda, semakin menonjol pembacaan tanpa cache milik advisor — dan Opus 5.5 baru saja membuat konteks executor 60% lebih murah daripada Opus 5.

Menyiapkannya di Claude Code

Advisor ini bersifat eksperimental dan Anthropic menyatakannya di banner sesi — "Advisor Tool (experimental) aktif dan mungkin menggunakan lebih banyak token." Perilaku, harga, dan ketersediaan dapat berubah. Setelah catatan itu disampaikan, mekanismenya didokumentasikan:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Aktifkan dengan /advisor fable, atau jalankan /advisor tanpa argumen untuk pemilih. Pilihan disimpan ke advisorModel pengaturan di pengaturan pengguna Anda dan tetap berlaku di seluruh sesi. /advisor off mematikannya.

• Untuk satu sesi tanpa mengubah default yang tersimpan, jalankan dengan claude --advisor fable. Flag ini tidak tercantum di claude --help, dan Claude Code keluar saat diluncurkan jika pasangannya tidak valid alih-alih memulai dengan advisor yang diabaikan secara diam-diam.

• Tetapkan default permanen di file pengaturan Anda dengan {"advisorModel": "fable"}.

• Untuk mematikannya sepenuhnya, setel CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — perintah /advisor akan hilang dan advisorModel yang telah dikonfigurasi akan diabaikan.

• Pasangan tersebut harus setidaknya sama mampu dengan model utama. Claude Opus 5.5 menerima Fable dan Opus 5-or-later sebagai penasihat. Penasihat Opus 4.6 atau Sonnet ditolak oleh Claude Code; penasihat Opus 4.7 atau Opus 4.8 dilampirkan dan kemudian ditolak oleh API. Fable 5.1 sebagai model utama hanya menerima Fable 5.1.

• Batas versi: alat advisor memerlukan Claude Code v2.1.98 atau yang lebih baru; Fable sebagai model utama maupun advisor memerlukan v2.1.170 atau yang lebih baru; Fable 5.1 memerlukan v2.1.257 atau yang lebih baru. Bentuk token dari /advisor — yang berfungsi di -p, Agent SDK, aplikasi desktop, dan Remote Control — memerlukan v2.1.260 atau yang lebih baru.

• Penasihat ini hanya tersedia melalui Anthropic-API. Fitur ini tidak tersedia di Amazon Bedrock, Claude Platform on AWS, Agent Platform milik Google Cloud, atau Microsoft Foundry, dan bergantung pada pengambilan feature flag, sehingga sesi dengan variabel seperti DISABLE_TELEMETRY yang disetel akan membuatnya tetap nonaktif.

• Pada paket yang penggunaan Fable-nya ditagih ke kredit penggunaan, Fable sebagai advisor ditagih dengan cara yang sama dan memerlukan persetujuan satu kali. Sampai Anda menyetujuinya, /advisor fable tidak tersimpan dan claude --advisor fable keluar saat diluncurkan lalu mengarahkan Anda ke /model fable sebagai gantinya.

Subagen mewarisi penasihat apa pun yang Anda konfigurasikan dan menjalankan ulang pemeriksaan pasangan yang sama terhadap model mereka sendiri. Itulah satu-satunya interaksi antara pola ini dan pola subagen: subagen yang menjalankan model yang lebih kecil mungkin diizinkan memiliki penasihat yang tidak diizinkan bagi induknya.

Bentuk biaya, diuraikan tuntas

Tidak ada apa pun di bawah ini yang merupakan pengukuran. Bentuk tokennya diciptakan untuk membuat aritmetikanya terlihat; harga-harganya adalah tarif yang dipublikasikan Anthropic. Asumsikan satu sesi eksekutor yang membaca 1 juta token masukan baru dan mengeluarkan 500 ribu token keluaran, serta tiga konsultasi penasihat, masing-masing membaca ulang transkrip 200 ribu token dan mengembalikan sekitar 600 token panduan — kira-kira dua hingga tiga konsultasi per tugas yang diminta oleh prompt sistem Anthropic sendiri.

• Executor pada Claude Opus 5.5 — input 1 juta dengan tarif $4,00 ditambah output 500 ribu dengan tarif $10,00 = $14,00

• Penasihat pada Claude Fable 5.1 — 600K input dengan $6,00 ditambah sekitar 1.800 token output dengan kira-kira $0,09 = $6,09

• Loop, total — sekitar $20,09

• Bentuk yang sama dijalankan secara end-to-end pada Fable 5.1 — input $10,00 ditambah output $25,00 = $35,00

• Bentuk yang sama hanya pada Opus 5.5 — $14.00

Loop ini berada di antara keduanya, yang persis di situlah Anthropic memposisikannya: sekitar 43% lebih murah daripada menjalankan Fable 5.1 sepanjang waktu, dan sekitar 44% lebih mahal daripada eksekutor saja. Bacalah angka kedua sebagai yang jujur. Penasihat bukanlah penghematan; ini adalah pembelian penilaian sekelas Fable atas tiga keputusan, dan baru sepadan jika ketiga keputusan itu mengubah hasil. Dorong transkrip ke jendela konteks 1M dan setiap konsultasi memakan biaya $10 sendiri. Biarkan eksekutor mulai bertanya pada sebagian besar tugas alih-alih hanya beberapa, dan Anda membayar tarif penasihat di seluruh beban kerja — pada titik itu, seperti yang dikatakan Anthropic, menjalankan model penasihat itu sendiri adalah rute yang lebih murah untuk skor yang sama.

Apa yang dikatakan oleh pengukuran Anthropic sendiri

Anthropic telah menerbitkan hasil terukur untuk pola ini, dan hasil itu dilaporkan vendor: dijalankan oleh perusahaan yang menjual kedua model, pada kerangka benchmark miliknya sendiri. Angka-angka itu tetap satu-satunya angka sejenis, dan mencakup argumen yang menentang pola ini, itulah sebabnya angka-angka itu layak dibaca dengan saksama.

• Opus 5 sebagai eksekutor dengan Fable 5.1 sebagai penasihat mencetak skor $7.69 per percobaan pada tolok ukur pengodean agentik internal Anthropic — konfigurasi paling akurat yang diukur Anthropic. Itu 3,5 poin di atas Opus 5 saja pada pengaturan bawaannya dengan biaya sedikit lebih murah, dan sekitar 2,5 poin di atas Fable 5.1 saja dengan biaya sekitar satu setengah kali lipat. Selisih 3,5 poin dipisahkan dari derau antar-percobaan dengan lima percobaan per tugas.

• Kombinasi yang sama pada pembacaan grafik menyamai Fable 5.1 saja pada upaya sedang dalam kisaran noise — 65,0 berbanding 67,5 — dengan biaya sekitar 2,6 kali lipat per tugas, karena penasihat dikonsultasikan pada hampir setiap tugas.

• Pada GPQA Diamond, peningkatan tersebut mengikuti kesenjangan kemampuan hampir secara sempurna: eksekutor Haiku 4.5 memperoleh banyak sekali, eksekutor Sonnet 5 beberapa poin, dan eksekutor frontier hampir tidak memperoleh apa pun.

• Tingkat konsultasi adalah variabel yang rapuh. Eksekutor Sonnet 5 dengan usaha rendah memperoleh 23 poin pada DeepSWE dengan seorang penasihat, lalu berhenti bertanya sama sekali pada SWE-bench Pro dan tidak memperoleh apa pun.

• Latensi: sekitar dua panggilan model terdepan tambahan per tugas, masing-masing ada di jalur kritis.

Dua hal tentang bukti itu berkaitan langsung dengan loop sebagaimana kondisinya minggu ini. Pengukuran tersebut menggunakan Opus 5 sebagai eksekutor, karena Opus 5.5 belum ada saat pengukuran itu dijalankan. Dan Anthropic melaporkan bahwa Opus 5.5 berkinerja setingkat Fable 5.1 pada sebagian besar pekerjaan, dengan biaya menjalankan 40% lebih rendah — keduanya klaim vendor, tak satu pun direproduksi secara independen. Jika celah antara eksekutor dan penasihat adalah hal yang penasihat dibayar untuk menutup, maka celah yang lebih sempit berarti pembelian yang lebih kecil. Pola itu tidak memburuk saat Opus 5.5 dirilis; hal yang dijualnya menjadi lebih tidak langka.

Mode kegagalan yang akan benar-benar Anda hadapi

Ini adalah perilaku yang terdokumentasi, bukan spekulasi, dan yang pertama adalah alasan untuk membaca bagian ini sebelum Anda men-debug apa pun:

• Penasihat yang tidak hadir secara diam-diam. Jika API menolak pemasangan penasihat, Claude Code melampirkannya, API menolaknya, dan Claude Code mengirim ulang permintaan tanpa penasihat. Sisa percakapan kemudian berjalan tanpa penasihat dan tanpa pesan kesalahan. Fitur ini tetap nonaktif hingga /clear atau /compact, bahkan setelah Anda beralih ke model utama yang kompatibel.

• Yang ditolak secara diam-diam. Untuk pasangan yang ditolak oleh Claude Code sendiri, advisor tidak pernah dilampirkan ke permintaan model utama. Output /advisor dan notifikasi memberi tahu Anda — tetapi tidak ada yang gagal, jadi sesi yang Anda anggap sedang memberi saran mungkin sebenarnya tidak pernah demikian.

• Persetujuan yang belum Anda berikan. Dengan Fable dipilih sebagai advisor pada plan yang memerlukan persetujuan kredit penggunaan, permintaan dikirim tanpa advisor sampai Anda menerimanya. Sesi latar belakang yang dimulai dengan --advisor fable akan dimulai tanpa advisor alih-alih keluar.

• Daftar izin yang tidak Anda kendalikan. Jika daftar izin availableModels organisasi Anda mengecualikan model advisor, Claude Code tidak akan memanggilnya, dan Anda perlu memilih model yang diizinkan dengan /advisor.

• Di mana pun hal itu tidak ada. Hanya Anthropic API: tidak ada Bedrock, tidak ada Claude Platform on AWS, tidak ada Google Cloud Agent Platform, tidak ada Microsoft Foundry. Melalui gateway, ketersediaan bergantung pada apakah gateway meneruskan permintaan secara utuh ke API Anthropic — yang merupakan sifat gateway, bukan sesuatu yang dapat Anda asumsikan.

Di mana OrcaRouter cocok

Kedua model dalam loop ini sudah ada di OrcaRouter hari ini dengan harga daftar Anthropic sendiri dengan markup 0% — harga daftar penyedia diteruskan apa adanya, jadi tarif yang Anda lihat adalah tarif yang dipublikasikan Anthropic. Claude Fable 5.1 berada di anthropic/claude-fable-5.1 dan Claude Opus 5 di anthropic/claude-opus-5, di balik satu kunci API. Claude Opus 5.5 belum menjadi salah satu rute kami; model itu tersedia melalui API Anthropic sendiri dan cloud-cloud utama, dan kami akan mengatakan hal itu alih-alih menyiratkan sebaliknya.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Yang Anda dapatkan dengan satu kunci di sini adalah kemampuan untuk berubah pikiran dengan biaya murah. Ekonomi loop ini bergantung pada rasio harga eksekutor terhadap advisor, dan rasio itu berubah dua kali dalam tujuh minggu — Opus 5 ke Opus 5.5 pada 22 September, dan Fable 5 ke Fable 5.1 pada 1 September, yang memangkas cache read model tersebut dari $1,00 menjadi $0,25 per juta. Setiap perubahan itu mengubah jawaban atas pertanyaan "apakah advisor ini sepadan", dan menguji jawaban tersebut seharusnya tidak memerlukan kontrak kedua. Failover otomatis adalah separuh lainnya: ini memungkinkan Anda mengarahkan sebagian trafik ke model yang belum Anda karakterisasi, dengan fallback ke model yang sudah Anda kenal, alih-alih mempertaruhkan jalur produksi pada tabel peluncuran. Dan jika Anda membangun pola ini sendiri alih-alih menggunakan alat bawaan Claude Code, DSL routing menyusun beberapa model menjadi satu panggilan — langkah perencanaan pada satu model diikuti langkah eksekusi pada model lain, di balik satu endpoint.

Satu catatan jujur soal cakupan: alat advisor itu sendiri adalah alat sisi server yang berjalan di API Anthropic, jadi lapisan routing bukan penggantinya. Yang bisa kami lakukan adalah membuat model-model itu hanya berjarak satu kunci, dengan harga list, sehingga keputusan untuk mempertahankan atau menghapus advisor ada di tangan Anda, berdasarkan angka Anda sendiri.

Cara memutuskan untuk beban kerja Anda sendiri

Panduan Anthropic sendiri adalah titik awal yang tepat dan menyegarkan karena tidak sentimental: jalankan rangkaian evaluasi Anda terhadap tiga konfigurasi — eksekutor sendirian, eksekutor dengan penasihat, dan model penasihat saja pada upaya rendah — dan periksa ulang pada setiap rilis model, karena rilis menggeser baik kesenjangan kapabilitas maupun rasio harga. Yang terakhir dari ketiga konfigurasi itu adalah baseline yang harus dikalahkan. Jika model penasihat Anda saja pada upaya rendah mencetak skor yang sama dengan loop dengan biaya lebih murah, Anda sudah punya jawabannya.

Dua variabel yang perlu diperhatikan adalah yang dinamai Anthropic. Kesenjangan kemampuan: kesenjangan yang lebar antara eksekutor dan penasihat adalah tempat penasihat memperoleh bayarannya, dan Opus 5.5 mempersempit kesenjangan itu dari bawah. Tingkat konsultasi: keuntungan mengikuti tingkat itu hampir satu banding satu, dan tingkat itu cukup sensitif terhadap prompt hingga bisa merosot tajam — eksekutor dengan effort rendah dapat berhenti menyadari bahwa ia sedang macet, dan pasangan yang berkonsultasi pada sebagian besar tugas dengan effort default dapat turun hingga hampir tidak ada. Prompt sistem yang disediakan Anthropic meminta satu panggilan penasihat sebelum pekerjaan substantif dan satu lagi sebelum menyelesaikan, yang menghasilkan dua hingga tiga konsultasi per tugas; pasangan coding yang menghasilkan kenaikan 3,5 poin berjalan pada irama itu. Anggarkan untuk itu, batasi, dan perlakukan setiap konsultasi di atas batas itu sebagai sinyal bahwa eksekutor Anda salah konfigurasi, bukan bahwa tugasnya sulit.

Untuk loop spesifik dalam artikel ini, tiga pengaturan konkret melakukan sebagian besar pekerjaan. Pertahankan Claude Opus 5.5 pada effort medium bawaannya alih-alih memilih high, karena effort secara langsung memengaruhi biaya dan angka Opus 5.5 milik Anthropic sendiri menunjukkan medium hanya mengorbankan sedikit sekali. Setel advisor dengan /advisor fable dan pastikan banner benar-benar muncul — banner yang hilang berarti advisor tidak ada secara diam-diam. Dan sebelum Anda menskalakan pola ini, ukur token per tugas yang selesai alih-alih harga per token, karena itulah angka yang seharusnya digerakkan oleh loop.

FAQ

Apakah penasihat memakai jatah Fable yang sama dengan sesi Fable?

Pada penagihan API, token advisor ditagih dengan tarif input dan output milik Fable 5.1 sendiri, dan batas laju advisor diambil dari bucket per-model yang sama dengan panggilan langsung ke model tersebut — sehingga panggilan advisor yang terkena batas laju muncul sebagai error di dalam hasil tool alih-alih menggagalkan permintaan Anda. Pada paket langganan, penggunaan advisor dihitung terhadap batas penggunaan paket Anda, kecuali bahwa advisor Fable ditagih ke kredit penggunaan pada paket di mana penggunaan Fable juga demikian. Konsekuensi praktisnya adalah advisor bukanlah anggaran terpisah yang dapat Anda belanjakan dengan bebas; ia bersaing dengan segala hal lain yang Anda lakukan pada model tersebut.

Apa yang sebenarnya bisa dilihat oleh advisor?

Seluruh percakapan, termasuk setiap panggilan alat dan setiap hasil alat — isi file, output perintah, pesan error, semuanya. Ini berjalan di bawah prompt sistem bawaannya yang disediakan Anthropic dan mengembalikan rencana, koreksi, atau sinyal berhenti. Dua detail mengikuti dari itu. Pertama, setiap konsultasi membaca ulang seluruh transkrip, itulah sebabnya biaya bertambah seiring loop alih-alih tetap datar. Kedua, jika sesi Anda menyentuh materi yang tidak akan Anda kirim ke model kedua pada tingkat harga penasihat, penasihat adalah model kedua yang membaca semuanya.

Apa yang bisa mengubah jawabannya

Dua hal, dan keduanya lebih dekat daripada yang terlihat. Jika penguji benchmark independen menerbitkan uji benchmark dengan upaya setara dari Opus 5.5 melawan Fable 5.1 dan mengonfirmasi penyempitan yang diklaim Anthropic, keunggulan yang tersisa dari penasihat pada sebagian besar tugas menjadi tipis — dan loop menjadi alat untuk kasus yang paling sulit alih-alih default. Jika sebaliknya tingkat konsultasi tetap bertahan dan kesenjangan kemampuan tetap lebar pada pekerjaan agentic yang panjang, perhitungan di atas adalah hal yang sedang Anda pilih di antara keduanya, dan saran senilai $6 pada eksekusi senilai $14 adalah opsi murah untuk tidak mengirimkan hal yang salah.

Yang tidak akan berubah adalah mekanisme di bagian atas tulisan ini. Konteks executor di-cache dan murah; konteks advisor tidak demikian. Setiap loop yang berkonsultasi dengan model yang lebih mahal di tengah tugas akan mewarisi asimetri itu, apa pun yang dikatakan daftar harga bulan depan.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari