Kartu judul hero yang dihasilkan untuk Claude Sonnet 5.5 vs Claude Fable 5.1, dengan subjudul 'Model murah itu berada tiga poin di depan', menampilkan $2,00 input dan $10,00 output per juta token di sebelah kiri berbanding $10,00 dan $50,00 di sebelah kanan, dengan angka Artificial Analysis Intelligence Index v4.3 56 dan 53 di bawahnya, serta logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

Claude Sonnet 5.5 vs Claude Fable 5.1: Model Murah Unggul Tiga Poin

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Claude Sonnet 5.5 hadir pada 28 September 2026 dengan harga $2,00 per juta token masukan dan $10,00 per juta token keluaran. Claude Fable 5.1, model kelas Mythos yang dirilis vendor pada 1 September, berada pada $10,00 dan $50,00 pada dua lini yang sama. Ringkasan yang menggoda adalah bahwa Fable 5.1 adalah yang mahal dan karenanya yang lebih baik, dan pada Artificial Analysis Intelligence Index urutannya justru terbalik: Claude Sonnet 5.5 mencetak 56 dan Claude Fable 5.1 mencetak 53. Itu bukan artefak pembulatan, dan itu juga bukan keseluruhan ceritanya, karena evaluator yang sama menempatkan keduanya hanya berselisih tiga sen per tugas pada suite yang sama — $7,60 versus $7,63. Perbedaan lima kali lipat pada kartu tarif hampir hilang pada saat sebuah tugas selesai. Yang tersisa adalah serangkaian perbedaan dalam bentuk, bukan dalam skor, dan memilih di antara keduanya terutama merupakan pertanyaan tentang bentuk seperti apa yang dimiliki beban kerja Anda.

Dua kartu tarif, dan satu baris di mana selisihnya bukan lima kali lipat

Perbandingan per token sangat mencolok dan tidak perlu ditafsirkan.

• Masukan — Claude Sonnet 5.5 dengan $2.00 per juta token dibandingkan dengan Claude Fable 5.1 dengan $10.00, selisih lima kali lipat

• Keluaran — $10.00 dibandingkan dengan $50.00 per juta, sekali lagi tepat lima kali lipat

• Pembacaan cache — $0.20 versus $0.25 per juta. Inilah pos yang menopang eksekusi agen yang panjang, dan diskonnya merosot dari 5× menjadi 20%

• Penulisan cache — $2,50 dibandingkan $12,50 per juta untuk jendela lima menit standar, selisih tunggal terlebar di kedua kartu

• Batch — Mode batch Anthropic tidak berlaku untuk kedua kartu ini sebagaimana berlaku pada Fable 5.1: Fable 5.1 diluncurkan dengan harga batch yang dipotong setengah menjadi $5,00 untuk input dan $25,00 untuk output. Bacalah baris batch dari halaman harga Anthropic sendiri sebelum Anda mengasumsikan bahwa hal itu berlaku di seluruh keluarga

Konteks dan batas maksimum — 1.000.000 token konteks dan 128.000 token output pada keduanya. Pada Message Batches API, Claude Sonnet 5 mendukung hingga 300.000 token output di balik header beta output-300k-2026-03-24, yang merupakan perbedaan batas maksimum yang nyata untuk pembuatan massal dan bukan sekadar klaim pemasaran

Ada satu poin kecil yang menguntungkan Claude Sonnet 5.5 yang tidak dinyatakan sepenuhnya oleh daftar tarif. Anthropic melaporkan bahwa model tersebut biasanya membutuhkan jauh lebih sedikit token untuk melakukan pekerjaan yang sama dibandingkan pendahulunya, yang menurutnya berarti penghematan biaya hingga 30% per tugas. Itu adalah klaim vendor tentang perbandingan yang berbeda — Sonnet 5.5 versus Sonnet 5 — dan bukan bukti tentang pertandingan ini. Namun, itulah mekanisme yang menjelaskan apa yang ditemukan oleh pengukuran independen.

Ke mana perginya kesenjangan harga lima kali lipat

Artificial Analysis menjalankan kedua model pada 2026-09-29 di bawah satu harness dan satu label konfigurasi, "Adaptive Reasoning, Max Effort, Default Fallback", pada Intelligence Index v4.3. Dua angka utama adalah 56 untuk Claude Sonnet 5.5 dan 53 untuk Claude Fable 5.1 — model yang lebih murah unggul sekitar tiga poin pada skala di mana evaluator yang sama menempatkan model median di 26. Keduanya dilabeli sebagai model dengan nama vendor pada halaman yang sama, jadi ini satu instrumen dan satu snapshot, bukan dua.

Lalu kolom biaya, dan alasan pasangan ini menarik, bukan sekadar jelas. Pada eksekusi indeks yang sama, Claude Sonnet 5.5 membutuhkan biaya $7,602633 per tugas dan Claude Fable 5.1 membutuhkan biaya $7,629706. Selisihnya dua puluh tujuh seperseribu dolar. Dekomposisinya justru yang membuatnya aneh: sisi input Claude Fable 5.1 saja adalah $3,73 per tugas, sedangkan komponen input Sonnet 5.5 jauh lebih kecil, dan token penalarannya saja berbiaya $2,36 per tugas. Model yang lima kali lebih murah per token sama sekali tidak lebih murah per tugas yang diselesaikan.

Penyebabnya adalah volume, dan kedua model itu gagal ke arah yang berlawanan.

• Token output di seluruh suite indeks — Claude Sonnet 5.5 menghasilkan 410.577.501 dibandingkan dengan Claude Fable 5.1 sebesar 188.465.663, pada suite yang median terlacaknya adalah 88 juta. Keduanya jauh di atas median; Sonnet 5.5 lebih dari dua kali lipat Fable 5.1 dan hampir lima kali lipat median.

• Token output per tugas — 192.838 untuk Sonnet 5.5 dibandingkan 78.111 untuk Fable 5.1, dengan porsi penalaran 142.386 berbanding 47.240. Sonnet 5.5 berpikir sekitar tiga kali lebih lama per tugas

• Token masukan di seluruh rangkaian indeks — 18,5 miliar untuk Sonnet 5.5 dibanding 5,6 miliar untuk Fable 5.1. Sonnet 5.5 membaca tiga kali lebih banyak, yang merupakan angka yang lebih senyap di antara keduanya dan angka yang memakan tarif masukan yang lebih murah

• Harga campuran pada komposisi 7:2:1 input-ke-cache-read-ke-output — $1,54 untuk Sonnet 5.5 dibandingkan $7,17 untuk Fable 5.1. Inilah baris yang sesuai dengan rate card, dan inilah baris yang menggambarkan beban kerja dengan output yang pendek dan berbatas jelas

Gabungkan semuanya, dan pernyataan jujurnya adalah ini: selisih harga gabungan itu nyata dan selisih per tugas tidak. Angka mana dari kedua angka itu yang menggambarkan tagihan Anda sepenuhnya bergantung pada apakah tugas Anda berhenti atau berlarut-larut, dan suite indeks dirancang untuk membiarkannya berlarut-larut.

Tangga usaha adalah keputusan yang sebenarnya.

Kedua model mengekspos parameter effort — low, medium, high, xhigh, max — dan keduanya diukur pada setiap tingkat pada 2026-09-29. Inilah bagian dari perbandingan yang tidak dapat diungkapkan oleh kartu tarif mana pun, karena model murah pada tingkat yang lebih rendah mengalahkan model mahal pada tingkat yang lebih rendah dengan selisih yang besar dan model mahal baru terpisah di dekat puncak.

• Usaha rendah — Claude Sonnet 5.5 mendapat skor 35.84 dengan $0.41 per tugas; Claude Fable 5.1 mendapat skor 46.82 dengan $2.37. Di tingkat paling bawah, model mahal itu unggul sebelas poin, dengan biaya hampir enam kali lipat.

• Upaya sedang — 40,74 dengan biaya $0,59 versus 48,92 dengan biaya $2,98. Fable 5.1 mempertahankan keunggulan delapan poin dengan biaya lima kali lipat

• Upaya tinggi — 46,74 pada $1,08 versus 51,15 pada $3,91. Selisihnya menyempit menjadi empat setengah poin; rasio biaya tetap sekitar 3,6×

• Upaya Xhigh — 51,85 dengan $2,74 dibandingkan 53,20 dengan $5,98. Terpaut satu sepertiga poin, pada 46% dari harga

• Upaya maksimal — 55.98 pada $7.63. Urutannya terbalik dan biayanya konvergen hingga dalam setengah persen

Baca baris keempat dan kelima secara bersamaan dan bentuk pertarungan ini mulai terlihat. Claude Sonnet 5.5 pada xhigh menghasilkan 51,85 — dalam jarak satu setengah poin indeks dari skor terbaik Claude Fable 5.1 pada upaya apa pun — dengan biaya $2,74 per tugas dibandingkan $7,63. Jika pekerjaan Anda perlu mendekati garis terdepan alih-alih berada tepat di garis terdepan, baris itu adalah jawaban lengkapnya, dan menghemat 64% per tugas yang diselesaikan. Dorong Sonnet 5.5 ke max dan Anda membeli tiga poin tambahan dengan biaya 2,8 kali lipat, yang membawa Anda ke tagihan yang sama dengan max Fable 5.1 dengan skor yang sedikit lebih baik dan profil penalaran yang sangat berbeda.

Kalimat terakhir itu layak dipastikan, karena cukup berlawanan dengan intuisi sehingga perlu diperiksa dua kali. Pada upaya maksimum yang setara, model dengan daftar tarif lima kali lebih murah memakan biaya yang sama per tugas dengan model yang daftar tarifnya mahal. Model tersebut mencapainya dengan menghasilkan 2,5 kali lebih banyak token keluaran, dengan porsi penalaran tiga kali lebih besar. Dokumentasi Anthropic sendiri menjelaskan sebagian mekanismenya: tokenizer berubah, dan teks yang sama menghasilkan sekitar 30% lebih banyak token pada Claude Sonnet 5.5 dibandingkan model-model sebelumnya. Itu adalah salah satu faktor yang berkontribusi di antara beberapa faktor lain, dan ini menjadi pengingat yang berguna bahwa jumlah token keluaran tidak dapat dibandingkan antarrevisi tokenizer tanpa menyatakan hal itu.

Latensi adalah titik di mana keduanya berhenti menyerupai satu sama lain.

Konvergensi skor tidak berlaku untuk waktu. Pada snapshot 2026-09-29 yang sama, Artificial Analysis melaporkan waktu ke token pertama sebesar 254,41 detik untuk Claude Fable 5.1 dan 2,80 detik untuk Claude Sonnet 5.5 pada irisan prompt panjang, dengan kecepatan output median masing-masing 67,9 dan 49,4 token per detik. Itu adalah perbedaan dua orde besaran dalam lamanya pemanggil menunggu sebelum apa pun tiba, dan itu adalah angka yang paling konsekuensial secara operasional dalam perbandingan ini.

Kedua angka itu perlu disertai keterangannya secara gamblang. TTFT Fable 5.1 diukur pada jenis prompt panjang; irisan prompt sedang milik evaluator untuk model yang sama pada hari yang sama adalah 117,60 detik, jadi angka 254 detik itu adalah ekor dan bukan konstanta. Nilai 2,80 detik milik Sonnet 5.5 adalah median keseluruhannya, dengan rentang varians evaluator sendiri membentang dari 1,91 detik pada persentil kelima hingga 4,23 pada persentil sembilan puluh lima. Dokumentasi platform Anthropic menggambarkan latensi komparatif Fable 5.1 sebagai lebih lambat dan Sonnet 5.5 sebagai cepat, yang konsisten secara arah tanpa menjadi sebuah pengukuran.

Infrastruktur kami sendiri memberikan pembacaan ketiga, karena kami merutekan Claude Fable 5.1 dan mengukur apa yang kami sajikan. Selama tujuh hari hingga 28 September, pada lalu lintas OrcaRouter sendiri, Claude Fable 5.1 mencatat token pertama median pada 6.973 milidetik dengan persentil ke-95 pada 10,0 detik, kecepatan keluaran 65,8 token per detik, dan tingkat kesalahan 0,349%. P50 tersebut lebih dari seratus kali lebih cepat daripada angka prompt panjang milik evaluator, yang bukanlah suatu kontradiksi melainkan definisi istilah: token pertama yang dihadapi pengembang pada prompt pendek dan token pertama benchmark pada prompt panjang adalah pengukuran atas hal-hal yang berbeda. Siapa pun yang merencanakan berdasarkan angka papan peringkat harus tahu yang mana yang mereka beli.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

Kejujuran dalam pengadaan, retensi, dan migrasi yang tidak disebutkan siapa pun

Tabel benchmark vendor dan evaluasi independen adalah instrumen yang berbeda dan tidak boleh saling dikurangkan satu terhadap yang lain. Tabel peluncuran Anthropic sendiri untuk Claude Sonnet 5.5 melaporkan Terminal-Bench 4.0 sebesar 70,6%. Artificial Analysis, yang menjalankan harness-nya sendiri, melaporkan 63,6% untuk model yang sama pada evaluasi dengan nama yang sama. Untuk Claude Fable 5.1, selisihnya justru berlawanan arah: Anthropic melaporkan 55,8% saat peluncuran dan harness independen menunjukkan 52,0%. Tidak satu pun dari pasangan tersebut merupakan koreksi terhadap yang lain. Nilailah masing-masing sesuai kaidahnya sendiri, dan utamakan yang independen saat Anda memutuskan ke mana trafik produksi akan dikirim.

Postur retensinya juga berbeda, dan perbedaan semacam ini hanya muncul dalam tinjauan pengadaan. Anthropic menyatakan bahwa Claude Sonnet 5.5 tersedia dengan retensi data nol, postur yang sama seperti yang diterapkan pada Opus 5.5 dan Sonnet 5. Materi peluncuran Claude Fable 5.1 menjelaskan kebijakan penggunaan data bertahap yang berjalan berdampingan dengannya dan penerapan terpisah di bawah Project Glasswing yang membawa jendela retensi default 30 hari untuk pemantauan keamanan, dengan pengaturan retensi nol digambarkan sebagai keadaan sementara. Jika tim Anda bertanggung jawab kepada tinjauan pemrosesan data, perbedaan itu merupakan pos baris nyata, bukan catatan kaki, dan sebaiknya bacalah halaman kebijakan Anthropic yang berlaku saat ini, bukan ringkasannya, termasuk ringkasan ini.

Biaya migrasi bersifat asimetris dengan cara yang jarang masuk ke liputan peluncuran. Berpindah ke Claude Sonnet 5.5 bukan sekadar perubahan string model. Panduan migrasi Anthropic menyatakan bahwa nilai temperature, top_p, dan top_k non-default kini mengembalikan error 400, bahwa tool_choice bernilai any atau tool bernama ditolak mentah-mentah, dan bahwa thinking: {"type": "disabled"} harus menjadi between_tools jika Anda menjalankannya dengan up-front thinking dimatikan. Tipe between_tools diterima pada effort low, medium, dan high serta mengembalikan 400 pada xhigh atau max. Pada Claude API dan Google Cloud, computer use didukung hanya melalui toolset computer_toolset_20260801; computer_20251124 yang lebih lama ditolak. Tidak satu pun dari itu berlaku untuk perpindahan ke Claude Fable 5.1, yang merupakan peningkatan dalam keluarga yang sama dari Fable 5 dengan tiga breaking change tersendiri. Jika Anda menimbang keduanya sebagai target migrasi paralel, model yang lebih murah justru yang lebih mahal untuk diadopsi.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Yang mana ditaruh di mana

Keputusan yang mengikuti dari angka-angka tersebut adalah keputusan tentang seberapa besar traffic Anda yang tercakup dengan baik.

• Pekerjaan yang terbatas cakupannya, bervolume tinggi, dan digerakkan oleh alat — Claude Sonnet 5.5, pada xhigh effort jika Anda perlu berada dekat dengan garis depan. Ia tertinggal satu setengah poin indeks dari performa terbaik Fable 5.1 dengan biaya 64% lebih murah per tugas yang diselesaikan, ia mengembalikan token pertamanya dalam sekitar tiga detik, dan baris penulisan cache-nya yang lebih murah membuat prefiks konteks yang dibangun ulang menjadi terjangkau

• Pekerjaan berhorizon panjang dan terbuka di mana jawaban yang salah itu mahal — Claude Fable 5.1. Model ini menyamai skor maksimum Sonnet 5.5 pada biaya per tugas yang sama, tetapi mencapainya dengan sepertiga token penalaran dan seperempat input, yang penting ketika tugasnya benar-benar terbuka dan bentuk suite eval-nya menyerupai masalah Anda

• Permukaan interaktif yang terikat latensi — Claude Sonnet 5.5, dan ini tidak dekat. Pada snapshot milik evaluator sendiri, selisih token pertama adalah dua orde besaran pada tipe prompt panjang, dan pembacaan prompt sedang hanya mempersempitnya menjadi sekitar 118 detik. Permukaan obrolan tidak dapat dibangun di atas angka Fable 5.1 tanpa batching atau streaming di sekitarnya

• Pembuatan massal dengan keluaran panjang — Claude Sonnet 5.5, karena batas keluaran 300.000 token tersedia di Message Batches API di balik header output-300k-2026-03-24, dibandingkan dengan batas 128.000 token di tempat lain. Konfirmasi harga batch Anda sebelum berkomitmen; tarif batch tidak sama di kedua kartu

• Pekerjaan yang harus mencakup beberapa akun atau meneruskan penalaran antar sistem — baca dokumentasi preserved-thinking Anthropic sebelum melakukan salah satunya. Blok pemikiran terikat pada model dan akun yang menghasilkannya, dan Sonnet 5.5 adalah Sonnet pertama yang dirilis dengan pengklasifikasi yang mencegah ekstraksi penalaran. Itu adalah fitur kepatuhan sekaligus kendala

• Beban kerja yang diatur atau sensitif terhadap retensi — periksa kebijakan saat ini, bukan cakupan saat peluncuran. Claude Sonnet 5.5 diluncurkan dengan retensi data nol yang tersedia; materi Fable 5.1 menjelaskan kebijakan bertahap dengan jendela default 30 hari pada satu penerapan dan retensi nol sebagai keadaan sementara

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

Di OrcaRouter, Claude Fable 5.1 dan Claude Sonnet 5 keduanya berada di balik satu kredensial pada harga daftar penyedia dengan markup 0%, jadi baris pembacaan cache dan perubahan tokenizer hanyalah hal-hal yang mengubah tagihan Anda saat Anda beralih di antara keduanya. Claude Sonnet 5.5 belum menjadi rute di platform kami — model ini baru berusia satu hari — jadi pernyataan yang jujur adalah bahwa hari ini Anda mengaksesnya melalui API milik Anthropic sendiri. Siapa pun yang menjalankan Fable 5.1 melalui kami dapat menghitung biaya peralihan pada hari model itu tersedia tanpa mengubah hal lain apa pun pada integrasi mereka, dan sementara itu failover otomatis antarpenyedia adalah yang membuat aman untuk mencoba model yang begitu baru pada jalur yang harus tetap aktif.

Putusannya lebih sempit daripada yang disiratkan oleh selisih harga. Claude Sonnet 5.5 adalah default yang lebih baik untuk hampir semua hal yang terbatas — nilainya tiga poin lebih tinggi pada indeks independen, ia menjawab dalam hitungan detik, dan pada xhigh ia mencapai dalam jarak satu setengah poin dari plafon Fable 5.1 dengan biaya per tugas jauh di bawah setengahnya. Claude Fable 5.1 mempertahankan satu argumen nyata, dan itulah argumen yang dibuat oleh tabel perbandingan Anthropic sendiri: ketika pekerjaannya terbuka dan biaya kesalahan melebihi biaya berpikir lebih lama, lima kali harga input membeli model yang mencapai skor yang sama tanpa menghabiskan tiga kali token penalaran untuk mencapainya. Pilih berdasarkan bentuk tugasnya, bukan besar kecilnya kartu tarif, karena di puncak tangga upaya kedua model itu menagih Anda dengan jumlah yang sama.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari