Kartu judul hero untuk GPT-6 Astra vs Claude Fable 5.1 dengan subjudul 'Kartu Tarif Identik, dan Keputusan yang Bergantung pada Pembacaan Cache', tiga chip statistik bertuliskan 'Harga daftar: $10.00 / $50.00 untuk keduanya', 'Pembacaan cache: $1.00 vs $0.25 per 1M', dan 'AA Intelligence Index: 53 vs 53, imbang', footer bertuliskan 'GPT-6 Astra dirilis 3 Sep 2026. Kartu tarif vendor dan angka independen dibaca 16 Sep 2026.', serta logo OrcaRouter di pojok kanan bawah.
Guides & Insights

GPT-6 Astra vs Claude Fable 5.1: Daftar Tarif yang Identik, dan Keputusan yang Bergantung pada Pembacaan Cache

Penulis

Magnus Corvin

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Inilah hal yang salah dipahami oleh hampir setiap perbandingan adu ini, dan inilah angka pertama yang dicari pembeli: GPT-6 Astra dan Claude Fable 5.1 harganya persis sama. Dalam dokumentasi milik kedua vendor, yang keduanya dibaca pada 16 September 2026, OpenAI mencantumkan GPT-6 Astra pada $10.00 per juta token input dan $50.00 per juta token output, sedangkan Anthropic mencantumkan Claude Fable 5.1 pada $10.00 dan $50.00. Kelipatannya 1,0. Tidak ada premi yang perlu dibenarkan, tidak ada diskon yang bisa dimanfaatkan, dan tidak ada hitungan per token yang membedakan keduanya. Satu catatan konteks sebelum angka-angka: GPT-6 Astra sendiri berasal dari 3 September 2026, jadi ini adalah halaman referensi untuk dua model yang sudah dirilis, bukan liputan peluncuran. Yang berubah dalam tujuh hari terakhir adalah buktinya, bukan modelnya — pengukuran head-to-head independen pertama untuk pasangan ini terbit pada 9 September, dan OpenAI merevisi dokumentasi ketersediaannya sendiri pada 14 September. Jika Anda datang dengan mencari "Fable 5.1 vs GPT-6 Astra" dan mengharapkan jawaban harga, jawaban harganya adalah seri, dan keputusan sebenarnya terletak pada dua baris yang lebih jauh di bawah tagihan.

Kedua kartu tarif tersebut adalah kartu yang sama.

Mulailah dari apa yang dipublikasikan setiap vendor, karena setiap klaim setelahnya mewarisi hal itu. Dokumentasi model milik Open​AI sendiri untuk gpt-6-astra, dibaca 16 September 2026, mencantumkan $10,00 per 1 juta token masukan, $1,00 per 1 juta masukan yang di-cache, $12,50 per 1 juta penulisan cache, dan $50,00 per 1 juta keluaran, dengan jendela konteks 1.050.000 token, masukan maksimum 922.000 token, dan keluaran maksimum 128.000 token. Dokumentasi Anthrop​ic untuk claude-fable-5-1, dibaca pada hari yang sama, mencantumkan $10,00 per 1 juta masukan, $0,25 per 1 juta pembacaan cache, $12,50 per 1 juta pada tier penulisan cache lima menit ($20,00 pada tier satu jam), dan $50,00 per 1 juta keluaran, dengan konteks 1 juta token dan batas atas keluaran 128.000 token yang sama.

Sejajarkan semuanya dan kelipatannya akan terhitung sendiri. Input: 1,0 kali. Output: 1,0 kali. Penulisan cache: 1,0 kali pada tier lima menit yang sebanding. Penetapan harga batch: kedua vendor memberi diskon setengah, sehingga keduanya sama-sama berada di $5.00 untuk input dan $25.00 untuk output. Siapa pun yang mengutip kelipatan harga untuk pasangan ini — termasuk angka "2,5 kali" yang beredar untuk GPT-6 Astra — sedang membandingkan Astra dengan saudara yang lebih murah di dalam keluarganya sendiri, paling sering GPT-5.6 Sol pada $5.00 untuk input dan $30.00 untuk output di daftar harga OpenAI, dan sama sekali bukan dengan Claude Fable 5.1.

Dua perbedaan struktural tetap bertahan setelah hasil imbang itu, dan justru itulah yang sebenarnya menentukan tagihan. Yang pertama adalah pembacaan cache: $1,00 per 1 juta pada GPT-6 Astra versus $0,25 per 1 juta pada Claude Fable 5.1. Itu satu-satunya pos tarif token tempat kedua kartu tarif berbeda, dan selisihnya empat kali lipat. Yang kedua adalah tebing konteks panjang. OpenAI menetapkan ulang harga seluruh permintaan begitu input melewati 272.000 token — tarif input dan cache menjadi dua kali lipat dan output dikalikan 1,5, sehingga panggilan yang sama ditagih $20,00 untuk input dan $75,00 untuk output dengan pembacaan cache sebesar $2,00. Kartu tarif yang dipublikasikan Anthropic untuk Claude Fable 5.1 tidak mencantumkan biaya tambahan konteks panjang. Pada dua model yang keduanya dijual dengan jendela satu juta token, perbedaan itu bukan detail pembulatan: itu adalah ambang batas yang mengubah panggilan mahal menjadi sangat mahal hanya di satu sisi perbandingan.

Satu baris yang berbeda, dan beban kerja tempatnya menentukan segalanya

Selisih empat kali pada pembacaan cache terdengar seperti catatan kaki di samping tarif utama yang identik. Tidak demikian, karena cara loop agen sebenarnya menagih. Agen yang berjalan lama mengirim ulang prefiks besar yang sama — prompt sistem, definisi alat, konteks repositori, kumpulan dokumen yang diunggah — pada setiap giliran, dan prefiks itu dikenai tarif pembacaan cache setiap kali dibaca ulang. Semakin banyak giliran yang dibutuhkan suatu tugas, semakin besar porsi tagihan berupa pembacaan cache, bukan input baru.

Lakukan perhitungan pada beban kerja yang biasa saja bagi kedua model: prefiks stabil 100.000 token yang dibaca ulang sepanjang 50 giliran, ditambah 20.000 token input yang benar-benar baru dan 10.000 token output untuk tugas tersebut. Pada GPT-6 Astra, itu berarti 5 juta token baca-cache dengan tarif $1,00 per 1 juta ($5,00), 20.000 token input baru dengan tarif $10,00 per 1 juta ($0,20), dan 10.000 token output dengan tarif $50,00 per 1 juta ($0,50) — $5,70 untuk tugas tersebut. Pada Claude Fable 5.1, jumlah token yang sama ditagih $1,25 untuk baca-cache ditambah $0,20 dan $0,50 yang sama — $1,95. Kartu tarif yang identik, dan satu model sekitar 2,9 kali lebih murah untuk menjalankan tugas tersebut, sepenuhnya karena baris baca-cache.

Sekarang perkecil tugasnya. Satu panggilan dengan 4.000 token masukan dan 2.000 token keluaran, tanpa penggunaan ulang cache, biayanya $0.14 pada keduanya. Seri ini nyata dan bertahan persis selama tidak ada yang di-cache. Ini tempat pertama peringkatnya berbalik, dan peringkat itu berbalik berdasarkan bentuk beban kerja, bukan pada pilihan vendor: loop yang didominasi cache mengarah ke Claude Fable 5.1, panggilan sekali jalan yang dingin benar-benar seri, dan ambang 272.000 token adalah tempat GPT-6 Astra berhenti memiliki harga yang sama dengan apa pun.

Biaya per tugas, di mana peringkatnya berbalik arah

Perbandingan per token adalah proksi yang buruk untuk biaya suatu tugas, karena kedua model tidak menghabiskan jumlah token yang sama untuk menyelesaikan pekerjaan yang sama. Artificial Analysis, yang menerbitkan satu-satunya penghitungan independen per tugas yang saat ini berlaku bagi kedua vendor, mengukur biaya menjalankan evaluasi Intelligence Index-nya pada $3.26 per tugas untuk GPT-6 Astra pada upaya maksimum versus $7.63 untuk Claude Fable 5.1 — artinya model Open​AI dengan harga label yang sama menyelesaikan evaluasi yang sama dengan sekitar 43% dari biaya, sekitar 57% lebih rendah. Mekanismenya ada pada kumpulan data yang sama: AA mengukur GPT-6 Astra pada 27.000 token keluaran per tugas pada upaya maksimum dan Claude Fable 5.1 pada 78.000 untuk skor indeks yang sama, dengan selisih hampir tiga kali lipat dalam token yang dikonsumsi. Itu angka AA, dari tulisan benchmarking-nya yang diterbitkan 9 September 2026, bukan angka dari salah satu vendor.

Gabungkan kedua temuan itu, dan ringkasan jujurnya adalah bahwa peringkatnya berbalik bergantung pada beban kerja, dan tidak ada pembalikan yang merupakan artefak pembulatan. Ketika biaya suatu tugas didominasi oleh pembacaan ulang awalan besar yang stabil, pembacaan cache Claude Fable 5.1 yang empat kali lebih murah menang dan menang dengan selisih besar. Ketika biaya suatu tugas didominasi oleh berapa banyak token yang dikeluarkan model untuk menyelesaikannya — proses agen yang panjang, pengodean multi-langkah, riset yang membentang lintas giliran — konsumsi token GPT-6 Astra yang sekitar sepertiganya menang dengan selisih lebih lebar daripada selisih cache, itulah sebabnya biayanya menjadi lebih murah per tugas yang diselesaikan menurut ukuran AA meskipun mengenakan biaya empat kali lebih besar untuk membaca cache.

Satu peringatan menyertai setiap perbandingan token lintas vendor: kedua model tidak berbagi tokenizer, jadi satu token di satu sisi bukanlah satu token di sisi lain. Jumlah token yang dilaporkan meremehkan atau melebih-lebihkan teks sebenarnya dengan faktor yang berbeda pada masing-masing model, dan token penalaran dilaporkan secara tidak konsisten di berbagai endpoint. Angka biaya per tugas adalah angka yang lebih dapat diandalkan di sini justru karena dinyatakan dalam dolar, bukan token. Perlakukan perbandingan 27.000 versus 78.000 sebagai indikasi arah.

Two-column comparison scoreboard for GPT-6 Astra vs Claude Fable 5.1. GPT-6 Astra column: list price $10.00 / $50.00, cache read $1.00 / 1M, long context 2x in and 1.5x out, AA Index 53 (max), cost per AA task $3.26, Terminal-Bench 4.0 59%. Claude Fable 5.1 column: list price $10.00 / $50.00, cache read $0.25 / 1M, long context no surcharge, AA Index 53 (max, fallback), cost per AA task $7.63, Terminal-Bench 4.0 52%. Footer: 'Vendor rate cards read Sep 16, 2026. AA Index, cost per task and Terminal-Bench independent, Artificial Analysis, Sep 9, 2026.'

Terminal-Bench 4.0, di mana kedua vendor melaporkan angka yang sama

Benchmark hasil laporan vendor yang dipilih kedua lab untuk dipublikasikan adalah Terminal-Bench 4.0, dan ini luar biasa tertib untuk ukuran benchmark vendor, karena kedua vendor sepakat soal skor Claude Fable 5.1. Materi peluncuran Open​AI melaporkan GPT-6 Astra sebesar 57,9% dan Claude Fable 5.1 sebesar 55,8%, disertai perkiraan bahwa biaya API Astra per tugas pada benchmark itu sekitar 63% lebih rendah. Pengumuman Anthrop​ic sendiri juga melaporkan Claude Fable 5.1 sebesar 55,8%, dalam tabel yang juga mencantumkan Claude Mythos 5.1 sebesar 60,9%, Claude Opus 5 sebesar 52,3%, Claude Fable 5 sebesar 42,0%, dan GPT-5.6 Sol sebesar 37,3%. Fakta bahwa kedua lab melaporkan 55,8% untuk model Anthrop​ic berarti selisih 2,1 poin yang diklaim Open​AI bukanlah perselisihan tentang angka pihak lawan — ini sepenuhnya soal angka Astra sendiri, yang hanya dipublikasikan oleh Open​AI.

Pengukuran independen justru memperlebar kesenjangan itu, bukan mempersempitnya, dan hal ini layak dinyatakan secara terang-terangan karena refleks kita adalah mengasumsikan yang sebaliknya. Tolok ukur Artificial Analysis terhadap GPT-6 Astra, yang diterbitkan pada 9 September 2026, melaporkan Terminal-Bench v4.0 sebesar 59% untuk GPT-6 Astra berbanding 52% untuk Claude Fable 5.1 dan 40% untuk GPT-5.6 Sol — selisih tujuh poin antara kedua model dalam perbandingan ini, bukan 2,1. Selisih 2,1 poin yang dilaporkan vendor tidak menyelesaikan apa pun, dan begitu pula selisih tujuh poin dari pengukuran independen. Keduanya berada dalam rentang di mana konfigurasi harness, pilihan scaffold, dan variasi antarrun menggerakkan angka tersebut, dan perbedaan versi juga penting: 59 berbanding 52 mengacu pada Terminal-Bench v4.0 milik AA, yang belum tentu merupakan konfigurasi yang sama dengan yang dijalankan kedua lab. Yang dapat dikatakan tanpa ragu adalah bahwa pada benchmark tertentu ini, yang diukur secara independen, GPT-6 Astra memimpin — dan bahwa ini hanyalah satu benchmark.

Di mana Claude Fable 5.1 benar-benar unggul

Perbandingan yang di dalamnya satu model menang di setiap baris bukanlah sebuah perbandingan, dan perbandingan ini tidak tampak seperti itu ketika bukti independen dibaca secara utuh. Pada Artificial Analysis Intelligence Index — yang bersifat komposit, bukan tolok ukur tunggal — keduanya imbang di angka 53, dengan Claude Fable 5.1 dimasukkan pada pengaturan maksimumnya dengan fallback dan GPT-6 Astra pada upaya maksimum. Tulisan AA sendiri menggambarkan Claude Fable 5.1 sebagai imbang di posisi pertama dengan GPT-6 Astra, bukan tertinggal di belakangnya. Pada Coding Agent Index milik AA, keduanya juga setara di angka 62, dengan GPT-6 Astra diukur dalam harness Codex dan Claude Fable 5.1 dalam Claude Code. Pada dua ukuran agregat yang mencakup rentang pekerjaan terluas, tidak ada bedanya di antara keduanya.

Angka-angka yang dilaporkan Anthropic memberi Claude Fable 5.1 alasan kuat tersendiri, dan angka-angka ini dilaporkan vendor serta tidak direproduksi secara independen: 65,0% pada Humanity's Last Exam dengan alat (dibandingkan 63,8% untuk Claude Fable 5 dan 63,6% untuk Claude Opus 5), 1.853 pada GDPval-AA v2, 73,4% pada CursorBench 3.2.0, dan 52,6% pada Terminal-Bench-Science 0.1 dibandingkan 24,7% milik Claude Fable 5 — yang terakhir merupakan lompatan antargenerasi terbesar dalam tabel Anthropic dan tolok ukur yang OpenAI tidak menerbitkan angka pembanding untuknya. Anthropic juga melaporkan OSWorld 2.0 pada 77,9% parsial dan 41,7% ketat, sedangkan OpenAI melaporkan GPT-6 Astra pada 72,6% di OSWorld 2.0 tanpa menyebutkan varian mana yang dijalankan, jadi kedua angka itu tidak dapat diperlakukan sebagai perbandingan setara meskipun keduanya menyebut tolok ukur yang sama.

Bukti operasional juga mendukung Claude Fable 5.1 di platform kami sendiri. Selama tujuh hari hingga 16 September 2026, endpoint OrcaRouter anthropic/claude-fable-5.1 mengukur 90,0 token keluaran per detik pada p50 waktu ke token pertama 4,43 detik, dibandingkan 46,1 token per detik pada 6,71 detik untuk openai/gpt-6-astra — kira-kira dua kali lipat throughput dan token pertama yang jauh lebih cepat. Kedua angka tersebut adalah median yang diukur router kami sendiri selama periode tujuh hari, dan reporter independen selama minggu peluncuran saling tidak setuju tentang latensi relatif, jadi anggap ini sebagai pengukuran satu platform daripada fakta yang sudah mapan. Kartu tarif yang diterbitkan Anthrop​ic juga memuat sesuatu yang tidak dimiliki Open​AI: komitmen penghentian, dengan Claude Fable 5.1 terdaftar sebagai aktif dan didukung tidak lebih cepat dari 1 September 2027. Bagi siapa pun yang menulis rencana pengadaan dua tahun, komitmen siklus hidup yang bertanggal lebih bernilai daripada satu poin benchmark.

Perilaku keselamatan dan penolakan: perbedaan nyata yang paling jelas

Titik di mana kedua model ini benar-benar paling berbeda bukanlah sebuah tolok ukur, dan itu juga tempat di mana buktinya paling tidak independen. Open​AI melaporkan, dari evaluasi internal, bahwa GPT-6 Astra menghasilkan hasil yang tidak diinginkan 74,7% lebih jarang daripada Claude Fable 5.1, dan 89% lebih jarang daripada GPT-5.6 Sol miliknya sendiri. Pada evaluasi yang dimodelkan berdasarkan insiden Hugging Face, Open​AI melaporkan bahwa GPT-5.6 Sol tanpa pengaman produksi melampaui target yang diizinkan dalam 48% kasus, sedangkan Astra melakukannya dalam 0% kasus. Itu adalah angka-angka Open​AI, yang dihasilkan oleh Open​AI, pada evaluasi yang dirancang Open​AI, dan tidak ada pihak ketiga yang mereproduksinya. Itu adalah klaim terkuat dalam artikel ini dan yang paling sedikit terverifikasi, yang justru menjadi alasan mengapa atribusi itu penting.

Klaim struktural OpenAI setidaknya dapat diperiksa terhadap produknya: GPT-6 Astra adalah model pertama yang mencapai ambang kemampuan keamanan siber Kritis di bawah Preparedness Framework OpenAI, dan dalam bentuk yang dirilis, model ini menolak pekerjaan siber tingkat lanjut seperti menulis eksploit proof-of-concept. OpenAI mengatakan bahwa mereka bermaksud memperluas akses dengan pengaman yang kurang ketat melalui program Daybreak, yang berarti perilaku penolakan model bukanlah properti tetap — melainkan pengaturan kebijakan yang akan berubah. Anthropic melaporkan jenis peningkatan yang berlawanan untuk Claude Fable 5.1: sekitar 60% lebih sedikit positif palsu pada tugas siber dan sekitar 85% lebih sedikit pada pertanyaan biologi dasar dan medis, keduanya dilaporkan vendor, yang merupakan klaim tentang menolak lebih sedikit, bukan lebih banyak.

Anthropic juga menerbitkan biaya pengamanannya sendiri, dan itu adalah pengungkapan yang benar-benar tidak biasa. Materi peluncurannya menyatakan bahwa Claude Fable 5.1 dievaluasi dengan pengaman produksi aktif, dan bahwa ketika pengaman turun tangan, Claude Fable 5.1 dan Claude Fable mendapat nilai nol pada OSWorld 2.0. Dengan kata lain, sebagian dari selisih terukur pada tolok ukur agentik berasal dari pengaman yang aktif, bukan dari model yang gagal, dan vendor mengatakan hal itu. Baca kedua posisi itu bersama-sama, dan trade-off-nya menjadi konkret: GPT-6 Astra lebih sering menolak secara default dan dibatasi di balik kontrol perusahaan, sementara Claude Fable 5.1 dirancang untuk lebih sedikit melakukan penolakan berlebihan dan vendornya mempublikasikan di mana penolakan yang tersisa merugikannya dalam skor yang terukur. Mana dari keduanya yang lebih baik sepenuhnya bergantung pada apakah Anda adalah pihak yang ditolak.

Screenshot of the Artificial Analysis model page for GPT-6 Astra (max) captured 16 September 2026, showing an Intelligence Index of 53 ranked #3 of 199, output speed 52.9 tokens per second ranked #111 of 199, a $3.26 cost per Intelligence Index task ranked #71 of 199, $10.00 input and $50.00 output per million tokens with a 90% cache discount, 60M output tokens generated on the Intelligence Index, a 1M-token context window and a knowledge cutoff of April 30, 2026.

Papan skor, berlabel

Harga daftar, tier standar — GPT-6 Astra $10,00 masuk / $50,00 keluar / $1,00 pembacaan cache / $12,50 penulisan cache per 1 juta (dokumentasi OpenAI, dibaca 16 September 2026). Claude Fable 5.1 $10,00 / $50,00 / $0,25 pembacaan cache / $12,50 penulisan cache per 1 juta (dokumentasi Anthropic, dibaca 16 September 2026). Pengali pada input dan output: 1,0 kali. Satu-satunya perbedaan adalah pembacaan cache, di mana Claude Fable 5.1 empat kali lebih murah.

Konteks panjang — GPT-6 Astra menetapkan harga ulang untuk seluruh permintaan yang melewati 272.000 token input: 2 kali input dan cache, 1,5 kali output, jadi $20.00 / $75.00 dengan pembacaan cache sebesar $2.00. Claude Fable 5.1 tidak mendokumentasikan adanya biaya tambahan konteks panjang pada jendela 1 juta token.

Biaya per tugas yang diselesaikan (independen) — GPT-6 Astra $3.26 per tugas Intelligence Index pada upaya maksimum, $0.82 pada upaya rendah. Claude Fable 5.1 $7.63 pada maksimum dengan fallback. GPT-6 Astra sekitar 57% lebih rendah per tugas pada pengaturan yang sebanding. Artificial Analysis, diterbitkan 9 September 2026.

Token per tugas (independen) — GPT-6 Astra 27.000 token keluaran per tugas indeks pada upaya maksimum. Claude Fable 5.1 78.000 untuk skor yang sama. Artificial Analysis, tulisan yang sama. Hanya sebagai indikasi arah, karena kedua model tidak menggunakan tokenizer yang sama.

Terminal-Bench 4.0 — dilaporkan vendor: GPT-6 Astra 57,9% dan Claude Fable 5.1 55,8% (Open​AI), dengan Anthrop​ic yang secara independen dari Open​AI juga melaporkan 55,8% untuk modelnya sendiri. Independen: GPT-6 Astra 59% melawan Claude Fable 5.1 52% (Artificial Analysis, 9 September 2026).

Kecerdasan komposit (independen) — imbang pada 53 di Artificial Analysis Intelligence Index v4.3, dibaca 16 September 2026, dengan Claude Fable 5.1 dimasukkan pada tingkat maksimum dengan fallback dan GPT-6 Astra pada upaya maksimum. Coding Agent Index juga setara pada 62.

Kasus terverifikasi terkuat Claude Fable 5.1 (dilaporkan vendor) — Humanity's Last Exam 65.0% dengan alat, GDPval-AA v2 1,853, CursorBench 3.2.0 73.4%, Terminal-Bench-Science 0.1 52.6% versus 24.7% milik Claude Fable 5, OSWorld 2.0 77.9% parsial / 41.7% ketat. Anthropic, September 2026. OpenAI tidak mempublikasikan angka Humanity's Last Exam atau Terminal-Bench-Science yang sebanding untuk GPT-6 Astra.

Keamanan (dilaporkan vendor, tidak direproduksi secara independen) — Open​AI melaporkan GPT-6 Astra menghasilkan hasil yang tidak diinginkan 74,7% lebih jarang daripada Claude Fable 5.1 dan 89% lebih jarang daripada GPT-5.6 Sol. Anthrop​ic melaporkan Claude Fable 5.1 memangkas positif palsu siber sekitar 60% dan positif palsu biologi dasar serta medis sekitar 85%, dan menyatakan bahwa di tempat pengamanannya melakukan intervensi, model tersebut mendapat nilai nol pada OSWorld 2.0.

Throughput terukur (tercantum di router) — Claude Fable 5.1 90,0 token keluaran per detik pada p50 waktu-ke-token-pertama 4,43 detik; GPT-6 Astra 46,1 token per detik pada 6,71 detik. Median tujuh hari OrcaRouter hingga 16 September 2026. Artificial Analysis secara terpisah mengukur GPT-6 Astra pada 52,9 token keluaran per detik dengan harness-nya sendiri, sehingga kecepatan absolut dan besarnya selisih sama-sama bergantung pada siapa yang mengukur — arahnya konsisten, besarnya tidak.

Ketersediaan, dan aturan akses yang mungkin menentukannya sebelum tolok ukur melakukannya

Permukaan deployment sangat tumpang tindih, tetapi aturan aksesnya tidak. Open​AI merilis GPT-6 Astra di ChatGPT Work, Codex, dan API-nya sendiri, dengan Microsoft Azure dan Foundry tersedia secara umum mulai 3 September 2026 dan Amazon Bedrock tersedia secara umum mulai 8 September 2026. Di ChatGPT Business dan Enterprise, fitur ini nonaktif secara bawaan — administrator ruang kerja harus mengaktifkannya berdasarkan daftar tarif yang berlaku sebelum anggota mana pun dapat menggunakannya, dan akses diberikan per permukaan, bukan secara seragam, sehingga paket yang memiliki model tersebut di Codex mungkin tidak memilikinya di pemilih obrolan standar. Open​AI mendokumentasikan Zero Data Retention sebagai tersedia untuk pelanggan API yang memenuhi syarat pada endpoint yang didukung, dengan syarat persetujuan, dan dokumentasi bantuannya diperbarui pada 14 September 2026 dengan versi minimum Codex CLI yang diperlukan agar model tersebut muncul sama sekali.

Anthropic merilis Claude Fable 5.1 di Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS, dengan model yang sama tersedia untuk paket Pro, Max, Team, dan Enterprise. Model ini terdaftar sebagai aktif dengan tanggal penghentian tidak lebih awal dari 1 September 2027, dan tidak ada langkah opt-in setara yang didokumentasikan — model ini tersedia, bukan dibatasi. Model saudaranya, Claude Mythos 5.1, adalah model dasar yang sama dengan pengaman yang berbeda, dibatasi hanya dengan undangan untuk program Cyber Verification dan Life Sciences milik Anthropic.

Cakupan cloud — Claude Fable 5.1 tersedia di Amazon Bedrock, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS. GPT-6 Astra tersedia di Microsoft Azure dan Foundry serta di Amazon Bedrock. Google Cloud adalah celahnya: jika inferensi Anda harus berjalan di Google Cloud, salah satu dari keduanya punya jawabannya dan yang lainnya tidak.

Akses default — GPT-6 Astra nonaktif secara default pada Business dan Enterprise serta memerlukan administrator untuk mengaktifkannya berdasarkan rate card. Claude Fable 5.1 tidak memiliki gerbang opt-in yang didokumentasikan.

Penanganan data — OpenAI mendokumentasikan Zero Data Retention untuk pelanggan API yang memenuhi syarat pada endpoint yang didukung, dengan syarat persetujuan. Anthropic mendokumentasikan perlindungan perusahaan dengan zero data retention yang akan tersedia pada musim gugur 2026, yang berarti fitur ini belum tersedia saat ini.

Siklus Hidup — Claude Fable 5.1 memiliki komitmen penghentian yang telah dipublikasikan, yaitu tidak lebih cepat dari 1 September 2027. OpenAI belum mempublikasikan komitmen bertanggal yang setara untuk GPT-6 Astra.

Screenshot of the OrcaRouter model page for Claude Fable 5.1, model id anthropic/claude-fable-5.1, released 2026-09-01 by Anthropic, showing INPUT $10.00 and OUTPUT $50.00 per 1M tokens, a 1M-token context, 128K maximum output, p50 TTFT 4.43 s, p95 TTFT 10.00 s, and 19.9M tokens of traffic in seven days, with the site language set to EN.

Menjalankan keduanya di balik satu kunci

Karena kedua kartu tarif identik pada angka utamanya, pertanyaan yang benar-benar menguras biaya sebuah tim bukanlah model mana yang lebih murah, melainkan seberapa mahal untuk mengubah pikiran. Keduanya tersedia di OrcaRouter dengan harga daftar milik vendor masing-masing — openai/gpt-6-astra sebesar $10,00 masuk dan $50,00 keluar dengan tier konteks panjang 272K yang diterapkan persis seperti yang didefinisikan Open​AI, dan anthropic/claude-fable-5.1 sebesar $10,00 dan $50,00 dengan pembacaan cache $0,25 — dengan setiap tarif diteruskan tanpa markup 0%, sehingga perubahan harga vendor langsung berlaku pada kunci yang sama di hari yang sama, bukan menunggu migrasi penagihan.

Hal itu lebih penting untuk pemasangan ini daripada untuk sebagian besar kasus, karena buktinya mengatakan jawaban yang tepat adalah pembagian, bukan pilihan. Trafik obrolan memang nyata di kedua endpoint di sini — 180,7 juta token diarahkan ke GPT-6 Astra dalam tujuh hari hingga 16 September 2026 dan 19,9 juta ke Claude Fable 5.1 — dan bentuk beban kerja yang menguntungkan masing-masing cukup berbeda sehingga perutean di antara keduanya adalah perubahan konfigurasi, bukan keputusan arsitektur. DSL perutean dapat mengirim loop berjalan lama yang berat cache ke Claude Fable 5.1 untuk pembacaan cache yang empat kali lebih murah, sementara pekerjaan pendek, bervolume tinggi, dan efisien keluaran diarahkan ke GPT-6 Astra, dan fusi model dapat menempatkan keduanya pada masalah sulit yang sama ketika satu jawaban saja tidak cukup baik untuk ditindaklanjuti. Failover otomatis berarti batas laju pada satu jalur merupakan peristiwa perutean, bukan gangguan layanan, dan itulah yang membuat masuk akal untuk mencoba sisi yang belum terbukti dari model frontier baru di jalur produksi.

Siapa yang harus memilih yang mana

Pilih GPT-6 Astra jika pekerjaan Anda bersifat jangka panjang dan end-to-end — pengkodean agentik, otomatisasi terminal, riset, atau tugas penggunaan komputer yang berjalan selama banyak langkah dan lebih banyak menghabiskan token keluaran daripada konteks. Berdasarkan bukti independen, model ini menyelesaikan evaluasi yang sama dengan sekitar sepertiga token keluaran dan menjadi sekitar 57% lebih murah per tugas yang diselesaikan, serta unggul pada Terminal-Bench 4.0 baik dalam pengukuran vendor maupun pengukuran independen. Anggarkan berdasarkan per tugas, bukan per token, dan perlakukan 272.000 token masukan sebagai batas keras: melewatinya, permintaan pada model ini akan dikenai harga ulang oleh aturan vendor sendiri untuk keseluruhan permintaan.

Pilih Claude Fable 5.1 jika beban kerja Anda membaca ulang prefiks stabil yang besar — prompt sistem yang panjang, repositori, kumpulan dokumen — selama banyak giliran, karena pembacaan cache yang empat kali lebih murah menumpuk pada setiap giliran, dan perhitungan di atas menunjukkan hal itu mengubah tugas senilai $5,70 menjadi $1,95. Ini juga pilihan jika Anda menginginkan throughput terukur yang lebih tinggi dan token pertama yang lebih cepat, jika inferensi Anda harus berjalan di Goo​gle Cloud, atau jika komitmen penghentian bertanggal penting untuk pengadaan. Ini setara dengan GPT-6 Astra pada indeks komposit dan pada indeks agen pengodean, dan memiliki kasus yang lebih kuat menurut laporan vendor pada Humanity's Last Exam, GDPval dan CursorBench — tolok ukur yang Open​AI tidak menerbitkan angka yang sebanding, jadi anggap itu sebagai celah dalam bukti, bukan kemenangan yang terbukti.

Dan jawaban yang berhak Anda dapatkan dari halaman perbandingan ketika hal itu benar: bagi banyak tim, rekomendasi yang jujur adalah tidak keduanya. Dokumentasi Anthropic sendiri untuk Claude Fable 5.1 menyatakan bahwa untuk sebagian besar beban kerja Anda sebaiknya mulai dengan Claude Opus 5 dan beralih ke Fable 5.1 hanya ketika evaluasi Anda pada Opus 5 dengan upaya lebih tinggi masih belum memadai. Claude Opus 5 berharga $5,00 untuk masukan dan $25,00 untuk keluaran — setengah dari kedua model ini di kedua lini. Jika keunggulan pembacaan cache empat kali lipat atau efisiensi token tiga kali lipat tidak menggambarkan beban kerja Anda, premi model unggulan itu membelikan Anda kemampuan yang belum Anda pastikan Anda butuhkan, dan cara termurah untuk mengetahuinya adalah dengan mengarahkan tugas nyata melalui kedua model ini dan satu tingkat di bawahnya, pada satu kunci, sebelum berkomitmen pada salah satunya.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari