Kartu judul hero untuk artikel 'Claude Fable 5 as Your Orchestrator' yang menampilkan node Claude Fable 5 di tengah yang memancar ke empat node pekerja subagen Opus 5 yang lebih kecil, dengan subjudul 'A Claude Code subagent playbook for keeping token costs down' dan logo OrcaRouter yang dikomposit di sudut.
Guides & Insights

Claude Fable 5 sebagai Orkestrator Anda: Buku Panduan Subagen yang Menjaga Biaya Token Tetap Rendah

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Pada 7 Agustus, Anthrop​ic membuat perubahan tunggal terbesar pada Claude Fable 5 sejak model tersebut dirilis pada 9 Juni: mereka mengurangi "fallback" terkait biologi sekitar 85%, sehingga pertanyaan kesehatan dan pendidikan sehari-hari kini mendapat jawaban langsung, alih-alih diam-diam beralih ke model yang lebih lemah. Namun, pola yang sebenarnya menyebar di komunitas Claude Code minggu ini tidak ada hubungannya dengan biologi. Para praktisi terus memposting alur kerja di mana Claude Fable 5 menjalankan loop orkestrasi — klarifikasi kebutuhan, dekomposisi rencana, pengiriman tugas, penerimaan hasil — sementara eksekusi diserahkan kepada subagen Claude Opus 5. Imbalan yang disebutkan: Fable 5 High menjadi default sesi yang terjangkau, dan kebertele-telean Claude Opus 5 berhenti menguras sesi.

Contoh terbaru adalah milik @dotey, yang diposting pada 14 Agustus: tambahan singkat pada ~/.claude/CLAUDE.md yang menyuruh agen untuk membuka subagen Opus untuk eksekusi, menjadikan Claude Fable 5 dengan upaya penalaran tinggi sebagai default sesi, dengan penulis melaporkan bahwa konsumsi token tetap wajar — dan alasan blak-blakan untuk tidak menjalankan Claude Opus 5 sebagai default: di tangannya, model itu terlalu lambat dan menghabiskan sangat banyak token dalam loop utama. Itu adalah temuan komunitas, bukan panduan Anthrop​ic — dan layak dipahami sebelum Anda menyalinnya, karena secara teori tampak terbalik.

Pola dalam satu paragraf. Di Claude Code, subagen mewarisi model sesi Anda secara default, jadi cara untuk menjaga loop tetap cepat dan murah adalah dengan menjadikan model sesi sebagai perencana dan mengarahkan pelaksana ke model yang berbeda secara eksplisit. Claude Fable 5 — model kelas Mythos dari Anthrop​ic yang dibuat aman untuk penggunaan umum, dirilis pada 9 Juni 2026, dengan harga $10/$50 per juta token — memegang persyaratan, memecah pekerjaan, mengirimkan tugas, dan menerima hasil. Claude Opus 5 — dirilis pada 24 Juli 2026, dengan harga $5/$25 per juta token — menjalankan implementasi aktual di dalam subagen. Anda mengeluarkan penilaian tingkat Fable untuk beberapa giliran orkestrasi dan eksekusi tingkat Opus untuk banyak giliran eksekusi, di mana sebagian besar token sudah digunakan.

Mengapa model loop utama adalah masalah biaya yang sebenarnya

Pada benchmark, ini tampak seperti masalah yang sudah terpecahkan — dan jawabannya tampak seperti "default ke Opus 5." Angka milik Anthropic sendiri (dilaporkan vendor, belum direproduksi) menunjukkan Claude Opus 5 unggul atas Claude Fable 5 pada benchmark pengkodean agen Frontier-Bench v0.1 (43,3% berbanding 33,7%), pada SWE-bench Verified (96,0% berbanding 95,5%), dan pada ARC-AGI-3 (30,2%, kira-kira 4x model publik terbaik berikutnya). Anthropic memposisikan Opus 5 sebagai mendekati kecerdasan frontier Fable 5 dengan harga setengahnya. Jika Anda memilih default sesi murni berdasarkan benchmark vendor dan harga per token, Opus 5 adalah pilihan yang jelas.

Praktisi yang benar-benar menjalankan sesi panjang justru sampai pada default sebaliknya, dan alasannya adalah token per tugas, bukan harga per token. Pemikiran Opus 5 aktif secara default dan adaptif, dan Anthrop​ic mengklaim ia memverifikasi pekerjaannya sendiri tanpa diminta — yang berarti, dalam praktiknya, setiap putaran loop mengeluarkan token jauh lebih banyak daripada milik Fable 5. Menonaktifkan pemikiran itu dibatasi pada upaya tinggi, sehingga Anda tidak bisa memaksanya menjadi seminimal mungkin. Pada sesi yang berlangsung berjam-jam, loop itulah yang berakumulasi: model yang paling murah per token bisa menjadi paling mahal per sesi, dan model yang paling sedikit bicara menjaga loop tetap cepat.

Itu sesuai dengan yang dilaporkan @dotey. Pengaturan terbalik membuat konsumsi token "tidak buruk" justru karena Opus 5 — yang bertele-tele itu — dikarantina ke subagen, di mana keluarannya adalah hasil yang diinginkan, bukan beban tambahan.

Arsitektur terbalik: Fable merencanakan, Opus mengeksekusi

Arsitekturnya sederhana untuk dijelaskan, tetapi sedikit berlawanan dengan intuisi saat dijalankan:

• Model sesi — Claude Fable 5 dengan tingkat upaya penalaran tinggi (yang "High" dalam singkatan komunitas "Fable 5 High"). Ia memegang kendali atas percakapan, rencana, dan definisi selesai.

• Giliran orkestrasi — klarifikasi kebutuhan, dekomposisi rencana, pengiriman tugas, dan penerimaan hasil semuanya terjadi di Fable 5. Ini adalah beberapa giliran dan sebagian kecil dari total token.

• Giliran eksekusi — setiap tugas dikirim ke subagen yang menjalankan Claude Opus 5. Ini adalah giliran-giliran yang banyak dan sebagian besar pengeluaran token — dan Opus 5 adalah tempat di mana skor agentik yang dilaporkan vendor paling tinggi.

Ekonomi kerjanya berjalan karena kedua kurva biaya menunjuk ke arah yang berbeda. Kekuatan Fable 5 adalah penilaian; Anda menggunakannya secukupnya. Kekuatan Opus 5 adalah eksekusi; Anda menggunakannya secara masif tetapi paralel, terisolasi dari loop. Loop tetap cepat dan murah, dan kemampuan yang mahal dihabiskan tepat di tempat token-token itu memang sudah dibelanjakan.

Ini adalah salah satu dari dua pola komunitas yang beredar, dan keduanya adalah cermin satu sama lain. Pola "arsitek" yang lebih umum direkomendasikan (digunakan, misalnya, oleh plugin fable-advisor) menjalankan Opus sebagai arsitek penuh waktu dan menyisihkan Fable 5 untuk jalur implementasi dengan kompleksitas tertinggi serta review akhir deliverable yang wajib. Perbedaannya adalah target optimasi: pola arsitek menghabiskan token kelas Opus untuk koordinasi dan menggunakan Fable 5 sebagai pisau bedah; pola terbalik menggunakan Fable 5 untuk koordinasi dan Opus 5 untuk volume. Keduanya adalah panduan komunitas — Anthropic tidak mendokumentasikan keduanya — dan keduanya adalah upaya untuk membelanjakan token frontier di tempat yang dapat mengubah hasil.

Menyiapkannya di Claude Code

Claude Code tidak memiliki "mode orkestrator" bawaan, jadi pola tersebut diterapkan dengan dua cara: instruksi dalam prompt sesi, dan pin model eksplisit di sisi eksekusi.

Lapisan instruksi berada di ~/.claude/CLAUDE.md — file yang sama yang disunting @dotey. Sebagai bentuk, prompt tersebut memberi tahu agen utama untuk melakukan empat hal sebelum menganggap tugas apa pun selesai:

Ulangi persyaratan dan konfirmasi cakupan sebelum menulis kode.

• Uraikan pekerjaan menjadi tugas-tugas yang dapat dijalankan secara paralel.

• Kirim setiap tugas eksekusi ke subagen yang disematkan ke Claude Opus 5.

• Verifikasi setiap hasil terhadap rencana sebelum menerimanya.

Bentuk tersebut lebih baik dinyatakan sebagai panduan daripada sebagai cuplikan untuk ditempel — kebutuhan dan stack Anda mengubah apa yang seharusnya ada di dalamnya.

Lapisan model lebih penting daripada yang diasumsikan kebanyakan pengaturan. Di Claude Code, urutan resolusi model subagen adalah: variabel lingkungan CLAUDE_CODE_SUBAGENT_MODEL, kemudian parameter model per-pemanggilan, lalu frontmatter definisi agen, kemudian model sesi. Agen tanpa model yang ditetapkan mewarisi model sesi. Jadi jika sesi Anda berjalan di Fable 5 dan Anda mengandalkan argumen model pada alat Agent, ada risiko terdokumentasi bahwa argumen tersebut diabaikan (GitHub issue #83920): subagen tetap mewarisi model sesi, dan Anda membayar harga Fable 5 untuk eksekusi yang Anda maksudkan untuk dijalankan di Opus 5.

Dua perbaikan yang andal: setel CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 untuk sesi tersebut, atau sematkan model di frontmatter subagen. Variabel itulah yang membedakan antara pola yang bekerja sesuai rancangan dan menjalankan seluruh sesi secara diam-diam pada model yang mahal.

Matematika token di balik pemisahan

Berikut adalah dua model dengan harga saat ini (diterbitkan vendor, dan diteruskan sesuai harga daftar di OrcaRouter):

• Claude Fable 5 — $10 per 1 juta token masukan, $50 per 1 juta token keluaran; konteks 1 juta token, keluaran 128K.

• Claude Opus 5 — $5 per 1 juta token masukan, $25 per 1 juta token keluaran; konteks 1 juta token, keluaran 128 ribu.

A comparison scoreboard for Claude Fable 5 and Claude Opus 5 contrasting price ($10/$50 vs $5/$25 per 1M tokens), context (both 1M in / 128K out), Frontier-Bench v0.1 (33.7% vs 43.3%), SWE-bench Verified (95.5% vs 96.0%), loop behaviour, and the role each plays in the orchestrator pattern, with a footer noting prices are vendor-published and benchmarks vendor-reported.

Bagian yang kontraintuitif adalah bahwa Opus 5 harganya setengahnya per token dan tetap bisa kalah dalam permainan biaya per sesi. Polanya mudah terlihat dengan angka kasar: jika loop pada Opus 5 mengeluarkan token dua hingga tiga kali lipat dari loop pada Fable 5 — angka ilustratif yang konsisten dengan laporan praktisi tentang perilaku verifikasi diri Opus 5, bukan angka terukur — maka bahkan dengan tarif per token setengahnya, biaya loop-nya kurang lebih sama, dan jika kesenjangannya lebih lebar, Opus di dalam loop memakan biaya lebih banyak. Sementara itu, token eksekusi — bagian terbesar dari sesi — berada di Opus 5 dalam subagen dengan tarif yang lebih murah, apa pun skenarionya.

Itulah keseluruhan argumen untuk pola terbalik: letakkan model yang harga per token-nya lebih tinggi tetapi loop-nya lebih ramping pada loop, dan letakkan model yang lebih murah per token pada volume. Itu adalah keputusan perutean yang disamarkan sebagai keputusan model.

Karena OrcaRouter meneruskan harga penyedia dengan markup 0%, angka-angka di atas adalah yang sebenarnya Anda bayar di sini — tanpa biaya platform tambahan — dan jika Anthrop​ic memangkas salah satu harga, perubahannya akan muncul di halaman model pada hari yang sama.

Ketika pola terbalik menang — dan ketika tidak.

Menyalin pengaturan @dotey tanpa memeriksa bentuk beban kerja Anda sendiri adalah kesalahan di kedua arah.

Pola terbalik menang ketika:

• Persyaratan bersifat ambigu atau rencana memiliki banyak bagian yang bergerak — penilaian orkestrasi adalah sumber daya yang langka.

• Eksekusi dapat diparalelkan menjadi subagen — volume keluar dari loop.

• Sesi berlangsung lama — verbositas loop terakumulasi menjadi biaya nyata.

Nasihat standar menang ketika:

• Sebagian besar sesi Anda adalah pekerjaan yang terbatas dan mekanis — perencana kelas Fable terlalu berlebihan, dan harga Opus 5 yang lebih rendah serta skor benchmark yang lebih tinggi menjadikannya pilihan default yang jelas. Inilah sebabnya dokumentasi Claude Code sendiri menjadikan Opus sebagai default sesi dan menyimpan Fable 5 untuk pemilihan eksplisit.

Anda tidak dapat dengan andal menyematkan model subagen — bug warisan #83920 mengubah pola terbalik menjadi "semuanya pada harga Fable 5."

Ada juga jalur tengah penyesuaian. Opus 5 mengekspos parameter effort (rendah hingga maksimum, default tinggi), sehingga Anda bisa mendorongnya menuju perilaku yang lebih ringkas — tetapi tidak sepenuhnya, karena menonaktifkan pemikiran dibatasi pada effort tinggi. Jika masalah Anda adalah verbositas Opus 5, menurunkan effort mungkin sudah cukup, dan Anda tidak perlu membalik arsitekturnya sama sekali.

Apa makna perubahan biologi pada 7 Agustus untuk pengaturan ini?

Pembaruan tanggal 7 Agustus dari {{1}}Anthrop​ic{{/1}} menulis ulang dan melatih ulang pengklasifikasi biologi Claude Fable 5 — sistem yang memutuskan apakah sebuah kueri memicu "{{2}}pengalihan{{/2}}" ke model yang kurang mumpuni. Berdasarkan angka {{3}}Anthrop​ic{{/3}} sendiri ({{4}}yang dilaporkan vendor{{/4}}), pengalihan {{5}}terkait biologi{{/5}} turun sekitar 85% di semua permukaan produk, dengan total pengalihan turun ~67% di {{6}}Claude.ai{{/6}}, ~55% di {{7}}Cowork{{/7}}, ~17% di {{8}}Claude Code{{/8}}, dan ~7% di {{9}}Claude Platform{{/9}}.

Screenshot of Anthropic's 'Improving Fable 5's biology safeguards' announcement dated August 7, 2026, describing the roughly 85% reduction in biology-related fallbacks across product surfaces.

Untuk pengaturan orkestrasi Fable 5, nomor Claude Code-lah yang paling menentukan. Fallback adalah sistem yang secara diam-diam mengalihkan kueri Anda ke model yang berbeda — dalam hal ini ke Opus 5. Dalam percakapan biasa, itu adalah gesekan yang tak terlihat; dalam sesi agentik, itu berarti sebagian pipeline Anda berjalan pada model yang tidak Anda pilih, dengan profil biaya yang tidak Anda rencanakan. Pembaruan itu tidak menghilangkan hal tersebut: virologi, toksikologi, dan desain molekuler masih mengalami fallback. Tetapi biologi kesehatan dan pendidikan sehari-hari — membaca hasil lab, memahami gejala, mempelajari biologi — kini tetap menggunakan Fable 5.

Satu catatan awal, dengan label yang jelas: laporan yang belum terkonfirmasi dari akhir Juli (36kr, WinCentral) menunjukkan kemungkinan pembaruan Claude Fable 5.1 bulan ini dengan harga yang tidak berubah. Anthrop​ic belum mengonfirmasi nama, tanggal, atau ID model API — anggap itu sebagai spekulasi sampai dirilis.

Mencobanya tanpa mempertaruhkan alur kerja Anda

Yang membuat pola terbalik layak dicoba adalah bahwa pola tersebut dapat dibalik, dan merutekan kedua model melalui satu titik akhir membuat pembalikan tersebut murah.

Di OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) dan Claude Opus 5 (anthropic/claude-opus-5) berada di balik satu kunci API. Anda dapat menjalankan jalur eksekusi sesi pada salah satu model tanpa kontrak kedua atau perubahan kode — yang persis dibutuhkan oleh eksperimen seperti "Fable 5 sebagai orkestrator", karena intinya adalah mengukur biaya per sesi Anda sendiri sebelum berkomitmen.

Screenshot of the OrcaRouter model page for Claude Fable 5 showing the slug anthropic/claude-fable-5, $10 per 1 million input tokens and $50 per 1 million output tokens, a 1M-token context, and the /v1/messages and /v1/chat/completions endpoints.

Dua fitur OrcaRouter berhubungan langsung dengan pengaturan ini. Failover otomatis memungkinkan Anda menentukan rantai fallback — jika Fable 5 mengalami error atau timeout, permintaan dialihkan ke Opus 5 atau model yang lebih murah alih-alih gagal. Dan DSL perutean dapat menyusun pasangan tersebut menjadi satu panggilan: langkah perencanaan Fable 5 yang diikuti langkah-langkah eksekusi Opus 5 di balik satu endpoint. Itulah pola orkestrasi yang diwujudkan sebagai infrastruktur, bukan sekadar disiplin prompt.

Intinya

Arsitektur terbalik — Claude Fable 5 merencanakan, Claude Opus 5 mengeksekusi — adalah jawaban nyata dan berfungsi untuk masalah nyata: model yang paling murah per token belum tentu paling murah per sesi. Ini bukan keputusan tolok ukur; Opus 5 memenangkan sebagian besar perbandingan agentic yang dilaporkan vendor. Ini adalah keputusan perutean token, dan hanya menguntungkan ketika penilaian orkestrasi langka dan eksekusi dapat diparalelkan.

Claude Fable 5 (9 Juni 2026) dan Claude Opus 5 (24 Juli 2026) keduanya merupakan model Anthropic terkini, dan perubahan pengaman pada 7 Agustus menjadikan Fable 5 sebagai pendamping harian yang lebih jarang terinterupsi. Perhatikan tiga hal: apakah laporan Fable 5.1 membuahkan hasil, apakah Anthropic memperbaiki bug pewarisan subagen yang dapat membatalkan pola ini secara diam-diam, dan — yang paling penting — seperti apa biaya per-tugas-selesai Anda selama seminggu sesi nyata.

FAQ

Apakah Fable 5 adalah model default di Claude Code?

Tidak. Dokumentasi Claude Code sendiri menyatakan bahwa Fable 5 bukan default untuk semua tipe akun — sesi default ke model standar Opus, dan Anda memilih Fable 5 melalui /model, pengaturan model, atau alias "best". Pola dalam artikel ini sengaja dijalankan terhadap default tersebut.

Mengapa tidak menggunakan Opus 5 sebagai default saja karena lebih murah per token dan skornya lebih tinggi?

Karena biaya per sesi adalah token-per-tugas dikali harga-per-token. Para praktisi melaporkan bahwa pemikiran adaptif dan verifikasi mandiri Opus 5 menghasilkan jauh lebih banyak token per giliran, sehingga meskipun tarif per-tokennya setengah, ia tetap bisa lebih lambat dan lebih mahal dalam loop yang panjang. Itulah temuan komunitas yang menjadi dasar playbook ini — ukur pada beban kerja Anda sendiri sebelum memilih salah satu.

Bisakah saya memaksa subagen saya untuk menjalankan model yang berbeda dari sesi ini?

Ya, tetapi jangan mengandalkan parameter model per pemanggilan: isu GitHub #83920 mendokumentasikan bahwa parameter tersebut diabaikan, dengan subagen mewarisi model sesi sebagai gantinya. Setel CLAUDE_CODE_SUBAGENT_MODEL atau sematkan model di frontmatter subagen — itulah perbedaan antara eksekusi yang berjalan dengan harga Opus 5 versus berjalan diam-diam dengan harga Fable 5.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari