
Claude Fable 5.1 vs Claude Fable 5: Apa Sebenarnya yang Didapat dari Penyegaran Produk Unggulan Milik Anthropic Sendiri
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
Claude Fable 5.1 adalah andalan Anthropic saat ini, diluncurkan pada 1 September 2026, dan adu yang paling penting bagi sebagian besar tim adalah adu yang disiapkan Anthropic sendiri: Claude Fable 5.1 versus Claude Fable 5, andalan 9 Juni yang digantikannya. Harganya identik — $10.00 per juta token input dan $50.00 per juta token output untuk keduanya — dan begitu pula jendela konteks 1M token. Yang berubah adalah karakter kerja agentik yang panjang: angka Anthropic sendiri menunjukkan Fable 5.1 mencatat lebih dari dua kali lipat skor Fable 5 pada benchmark agen sains tersulitnya, dan liputan minggu ini tentang cara perusahaan-perusahaan memperlakukan keluarga Fable terkait retensi data memberi penyegaran ini keunggulan kedua yang lebih tajam bagi siapa pun yang memilih di antara keduanya hari ini.
Catatan tentang tanggal dan sumber, di awal: Claude Fable 5.1 dirilis pada 1 September, jadi model itu sendiri berusia dua minggu, bukan berita terkini. Yang masih aktual adalah laporan dari 14 September 2026 — yang diatribusikan kepada The Information — bahwa Nvidia, Palantir, dan Booz Allen membatasi penggunaan mereka terhadap keluarga Fable milik Anthropic karena kekhawatiran tentang penyimpanan data korporat yang sensitif, dan bahwa Anthropic memperkenalkan log penggunaan bergulir selama 30 hari untuk pemantauan keselamatan pada Juni, dengan opsi bagi pelanggan untuk menyimpan sendiri log tersebut "masih dapat dicabut." Laporan itu diatribusikan kepada sumber dan belum dikonfirmasi secara independen. Semua yang berlabel "dilaporkan vendor" di bawah ini adalah lembar benchmark Anthropic sendiri dan belum direproduksi oleh pihak netral.
Lembar spesifikasi, dimensi demi dimensi
• Harga — Claude Fable 5.1 $10,00 masuk / $50,00 keluar per 1 juta token, sama seperti Claude Fable 5. Tidak ada harga yang berubah saat penyegaran.
• Input yang di-cache — Claude Fable 5.1 $0,25 per 1 juta token, turun 75% dari $1,00 milik Claude Fable 5. Penulisan cache $12,50 (5 menit) / $20 (1 jam); mode batch $5 / $25.
• Konteks dan output — keduanya membawa jendela input 1M token dan output hingga 128K token; keduanya menerima input teks dan gambar; keduanya berada di balik permukaan penalaran adaptif yang sama dengan tombol pengaturan upaya dari low hingga max.
• Skor independen — pada versi terkini Intelligence Index dari Artificial Analysis, Claude Fable 5.1 mencatat 53, peringkat pertama dari 201 model yang dilacak, dengan 67,2 token keluaran per detik dan $7,63 per tugas indeks. Angka indeks skala peluncuran Claude Fable 5 (62) mendahului pernyataan ulang September dan tidak dapat dibandingkan, jadi kami tidak mencantumkan angka skala saat ini untuknya.
• Tolok ukur vendor — Anthropic melaporkan Claude Fable 5.1 sebesar 52,6% pada Terminal-Bench-Science 0.1 versus 24,7% untuk Claude Fable 5; 55,8% pada Terminal-Bench 4.0 versus 42,0%; 31,4% pada AutomationBench versus 17,1%; dan 73,4% pada CursorBench 3.2.0 versus 70,5%.
• Dirilis — Claude Fable 5.1 pada 1 September 2026; Claude Fable 5 pada 9 Juni 2026.
Di mana penyegaran benar-benar sebuah penyegaran
Trik utama di balik peluncuran Fable 5.1 adalah tidak ada yang berubah pada daftar harga, sementara hampir semua hal di lembar benchmark berubah. Peningkatan terkonsentrasi pada pekerjaan agentik jangka panjang yang menggunakan alat — Terminal-Bench-Science 0.1 lebih dari dua kali lipat dari 24,7% menjadi 52,6%, Terminal-Bench 4.0 naik dari 42,0% menjadi 55,8%, AutomationBench hampir dua kali lipat dari 17,1% menjadi 31,4%. Pada Humanity's Last Exam, Anthropic melaporkan 60,9% tanpa alat dan 65,0% dengan alat, dibandingkan dengan 57,8% dan 63,8% untuk Claude Fable 5. Bacalah ini sebagai arah perkembangan: ini adalah tabel milik vendor sendiri, dan klaim angka tunggal terbesar menggambarkan saudara yang dibatasi, Claude Mythos 5.1, yang berbagi bobot yang sama di balik pengaman yang lebih ketat.

Tuas kedua adalah biaya, dan ini lebih penting daripada tolok ukur tunggal mana pun. Input yang di-cache turun dari $1,00 menjadi $0,25 per juta token, dan eksekusi agentic yang panjang adalah tempat pembacaan ulang mendominasi: output alat, isi file, dan giliran sebelumnya dikirim ulang berulang kali. Anthropic memperkirakan biaya efektif sekitar 25% lebih rendah pada beban kerja umum yang ditagih per token dan hingga 45% pada beban kerja yang sangat agentic — perkiraan vendor, tetapi perubahan harga yang mendasarinya dapat diverifikasi di lembar harga. Agen berhorizon panjang yang membaca ulang konteks 100K token lima puluh kali selama satu tugas membayar $5,00 untuk pembacaan cache dengan harga Claude Fable 5 dan $1,25 pada Claude Fable 5.1. Di seluruh armada agen, angka itu tidak lagi menjadi kesalahan pembulatan.
Perubahan ketiga adalah perubahan yang paling pertama dirasakan pengguna generasi sebelumnya: pengklasifikasi keamanan. Para pengembang menjuluki perilaku lama itu "Fable's depression" — membayar harga model andalan untuk keluaran yang diam-diam dialihkan ke model yang lebih lemah saat pengklasifikasi menandai permintaan yang tidak berbahaya. Anthropic mengatakan pengamanan siber Fable 5.1 kini menghasilkan sekitar 60% lebih sedikit intervensi per sesi Claude Code, dan bahwa pengamanan biologi dipicu 85% lebih jarang pada permintaan yang tidak berbahaya dibandingkan saat peluncuran Fable 5. Jika keluhan Anda tentang model Juni adalah soal pengalihan di tengah tugas, inilah peningkatan yang mengatasinya secara langsung.
Cerita retensi minggu ini, dan apa pengaruhnya terhadap keputusan
Laporan 14 September adalah bagian yang mengubah perhitungan bagi perusahaan, karena keluarga Fable adalah tempat model paling mumpuni milik Anthropic berada — dan karena sikap retensi data adalah hal yang tidak bisa diabaikan begitu saja oleh pembeli yang diatur regulasi. Seperti dilaporkan, Anthropic memperkenalkan log penggunaan bergulir 30 hari untuk pemantauan keselamatan pada Juni; pelanggan diberi tahu bahwa mereka dapat menyimpan sendiri log tersebut sebagai gantinya; dan laporan itu menyebut opsi itu "masih dapat dicabut." Palantir digambarkan menahan Fable sampai mendapatkan jaminan retensi data nol yang tidak dapat dicabut, Nvidia membatasi Fable untuk pekerjaan yang kurang sensitif, dan Booz Allen mengecualikannya dari pekerjaan keamanan siber proprietari. Semuanya adalah laporan berdasarkan atribusi, tidak satu pun dikonfirmasi oleh perusahaan yang disebut, dan efek praktisnya tidak merata: sebagian pelanggan akan sangat peduli, dan sebagian tidak akan peduli sama sekali.
Apa dampaknya terhadap keputusan 5.1 versus 5 patut dijelaskan secara presisi. Kisah retensi berlaku untuk keluarga Fable secara keseluruhan — itu bukan perbedaan baru antara kedua model, karena Fable 5 dan Fable 5.1 memiliki postur retensi yang sama. Yang berubah adalah perhitungan berbobot risikonya: jika beban kerja Anda cukup sensitif sehingga opsi penyimpanan mandiri yang dapat ditarik kembali menjadi hal yang mendiskualifikasi, maka tidak ada model yang memenuhi syarat saat ini, dan pembahasannya berada pada peta jalan Enterprise Frontier Safeguards (EFS) milik Anthropic, yang dijelaskan akan menerapkan retensi nol data secara bertahap mulai musim gugur 2026 bagi pelanggan yang memenuhi syarat. Jika beban kerja Anda tidak sesensitif itu, pelaporan tentang retensi tidak boleh membuat Anda membatalkan peningkatan performa yang nyata — tetapi hal itu harus ada dalam catatan keputusan, bukan baru ditemukan belakangan.

Siapa yang harus memilih yang mana
Pilih Claude Fable 5.1 ketika biaya jawaban yang salah atau yang ditinggalkan mendominasi biaya token: riset agentik berhorizon panjang, penggunaan alat yang berat, apa pun yang berjalan di dalam Claude Code, dan beban kerja yang membuat pembacaan cache 75% lebih murah mengubah ekonomika unit Anda. Tetap gunakan Claude Fable 5 ketika lalu lintas Anda pendek, sekali jalan, dan toleran terhadap throughput — harganya identik dan skor model lama masih kelas terdepan — atau ketika Anda masih berada di tengah kontrak dan biaya overhead migrasinya nyata. Jalan tengah yang jujur adalah tidak memilih sama sekali: kedua model berada di balik permukaan Anthropic API yang sama, dan jika Anda memanggil keduanya melalui satu endpoint, Anda dapat beralih naik ke Claude Fable 5.1 saat suatu tugas membutuhkan batas atas penalaran dan membiarkan pasangan berharga identik yang lebih murah itu berbagi failover tanpa kontrak kedua.
Di OrcaRouter, Claude Fable 5 dan Claude Fable 5.1 keduanya tersedia dengan harga daftar dari penyedianya tanpa markup, jadi $10 / $50 di atas adalah angka yang tertera di faktur, dan perubahan harga Anthropic sendiri diteruskan pada hari yang sama alih-alih diserap ke dalam margin reseller. Menguji penyegaran ini terhadap trafik Anda sendiri adalah pengeditan aturan perutean dengan failover otomatis — kedua model berbagi satu kunci, jadi biaya pengalihannya hampir nol, dan fusi model memungkinkan sebuah panel menjawab bersama ketika suatu tugas cukup penting untuk menginginkan lebih dari satu pendapat.

Versi singkatnya: Claude Fable 5.1 harganya sama dengan Claude Fable 5, kira-kira dua kali lebih kuat pada benchmark sains agentik yang disorot Anthropic, 75% lebih murah untuk pembacaan cache yang mendominasi sesi panjang, dan secara signifikan lebih kecil kemungkinannya untuk menyerahkan permintaan Anda ke model yang lebih lemah di tengah tugas. Pelaporan retensi 14 September itu nyata dan layak dipertimbangkan jika Anda adalah perusahaan dengan persyaratan data yang ketat — tetapi itu berlaku untuk keluarga model, bukan untuk peningkatan spesifik ini, dan itu seharusnya menjadi satu baris dalam keputusan yang sudah ditentukan oleh benchmark dan perhitungan cache.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
