Hero-titelkaart voor GPT-6 Astra vs Claude Fable 5.1 met de ondertitel 'Identieke tariefkaarten, en een beslissing die afhangt van cachereads', drie statistiekchips met de tekst 'Lijstprijs: $10,00 / $50,00 voor beide', 'Cacheread: $1,00 vs $0,25 per 1M' en 'AA Intelligence Index: 53 vs 53, gelijk', een footer met de tekst 'GPT-6 Astra uitgebracht op 3 september 2026. Tariefkaarten van leveranciers en onafhankelijke cijfers gelezen op 16 september 2026.', en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

GPT-6 Astra vs Claude Fable 5.1: identieke tariefkaarten, en een beslissing die afhangt van cache-reads

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Dit is het punt dat bijna elke vergelijking van deze confrontatie verkeerd doet, en het is het eerste getal waarnaar een koper kijkt: GPT-6 Astra en Claude Fable 5.1 kosten exact hetzelfde. In de eigen documentatie van beide leveranciers, beide geraadpleegd op 16 september 2026, vermeldt OpenAI GPT-6 Astra voor $10,00 per miljoen inputtokens en $50,00 per miljoen outputtokens, en Anthropic vermeldt Claude Fable 5.1 voor $10,00 en $50,00. De factor is 1,0. Er is geen premie te rechtvaardigen, geen korting te pakken en geen rekenwerk per token dat hen onderscheidt. Eén opmerking vooraf over de context: GPT-6 Astra zelf is van 3 september 2026, dus dit is een naslagpagina voor twee modellen die al zijn uitgebracht, geen lanceringsartikel. Wat in de afgelopen zeven dagen is veranderd, is het bewijs en niet de modellen — de eerste onafhankelijke head-to-head-meting van het tweetal verscheen op 9 september, en OpenAI herzag zijn eigen beschikbaarheidsdocumentatie op 14 september. Als je hier bent gekomen met een zoekopdracht naar "Fable 5.1 vs GPT-6 Astra" in de verwachting een antwoord over de prijs te krijgen, dan is het prijsantwoord een gelijkspel, en de echte beslissing staat twee regels verderop op de factuur.

De twee tariefkaarten zijn dezelfde kaart

Begin met wat elke leverancier publiceert, want elke bewering stroomafwaarts erft het. OpenAI's eigen modeldocumentatie voor gpt-6-astra, gelezen op 16 september 2026, vermeldt $10,00 per 1 miljoen invoertokens, $1,00 per 1 miljoen gecachte invoer, $12,50 per 1 miljoen cache-schrijfacties en $50,00 per 1 miljoen uitvoer, met een contextvenster van 1.050.000 tokens, een maximale invoer van 922.000 tokens en een maximale uitvoer van 128.000 tokens. Anthropic's documentatie voor claude-fable-5-1, op dezelfde dag gelezen, vermeldt $10,00 per 1 miljoen invoer, $0,25 per 1 miljoen cache-leesacties, $12,50 per 1 miljoen op het cache-schrijfniveau van vijf minuten ($20,00 op het niveau van een uur) en $50,00 per 1 miljoen uitvoer, met een context van 1 miljoen tokens en hetzelfde uitvoerplafond van 128.000 tokens.

Zet ze naast elkaar en de multiples rekenen zichzelf uit. Input: 1,0 keer. Output: 1,0 keer. Cacheschrijfacties: 1,0 keer op het vergelijkbare vijfminutenniveau. Batchprijzen: beide leveranciers geven er de helft korting op, dus beide komen uit op $5,00 in en $25,00 out. Iedereen die een prijsmultiple voor deze combinatie noemt — inclusief het "2,5 keer"-cijfer dat circuleert voor GPT-6 Astra — vergelijkt Astra met een goedkopere broer of zus binnen zijn eigen familie, meestal GPT-5.6 Sol tegen $5,00 in en $30,00 out op Open​AI's tariefkaart, en helemaal niet met Claude Fable 5.1.

Twee structurele verschillen blijven in die gelijkstand over, en dat zijn precies de punten die daadwerkelijk worden gefactureerd. Het eerste zijn cache-leesbewerkingen: $1,00 per 1 miljoen bij GPT-6 Astra tegenover $0,25 per 1 miljoen bij Claude Fable 5.1. Dat is de enige tokenregel waarop de twee tariefkaarten uiteenlopen, en het verschil bedraagt een factor vier. Het tweede is de long-contextkloof. OpenAI herprijst het volledige verzoek zodra de invoer 272.000 tokens overschrijdt — de invoer- en cachetarieven verdubbelen en de uitvoer wordt met 1,5 vermenigvuldigd, zodat dezelfde aanroep wordt gefactureerd tegen $20,00 voor invoer en $75,00 voor uitvoer, met cache-leesbewerkingen tegen $2,00. De gepubliceerde tariefkaart van Anthropic voor Claude Fable 5.1 vermeldt geen toeslag voor lange context. Bij twee modellen die beide met een contextvenster van een miljoen tokens worden verkocht, is dat verschil geen afrondingsdetail: het is een drempel die een dure aanroep aan slechts één kant van de vergelijking in een zeer dure aanroep verandert.

De enige regel die afwijkt, en de workload waarin die alles bepaalt

Een verschil van vier keer bij cache-leesbewerkingen klinkt als een voetnoot naast identieke hoofdtarieven. Dat is het niet, vanwege de manier waarop agent-loops daadwerkelijk worden gefactureerd. Een langdurig draaiende agent stuurt bij elke beurt dezelfde grote prefix opnieuw — systeemprompt, tooldefinities, repositorycontext, een geüploade documentenset — en die prefix wordt telkens wanneer hij opnieuw wordt gelezen tegen het cache-leestarief in rekening gebracht. Hoe meer beurten een taak vergt, hoe meer de rekening uit cache-leesbewerkingen bestaat in plaats van uit nieuwe invoer.

Voer de berekening uit op een workload die voor geen van beide modellen opmerkelijk is: een stabiele prefix van 100.000 tokens die over 50 beurten opnieuw wordt gelezen, plus 20.000 tokens aan echt nieuwe invoer en 10.000 tokens aan uitvoer voor de taak. Op GPT-6 Astra is dat 5 miljoen tokens voor cache-lezen tegen $1,00 per 1 mln. ($5,00), 20.000 nieuwe invoertokens tegen $10,00 per 1 mln. ($0,20) en 10.000 uitvoertokens tegen $50,00 per 1 mln. ($0,50) — $5,70 voor de taak. Bij Claude Fable 5.1 worden dezelfde tokenaantallen gefactureerd tegen $1,25 voor cache-lezen plus dezelfde $0,20 en $0,50 — $1,95. Identieke tariefkaarten, en het ene model is ongeveer 2,9 keer goedkoper om de taak uit te voeren, volledig vanwege de regel voor cache-lezen.

Verklein nu de taak. Een enkele aanroep met 4.000 inputtokens en 2.000 outputtokens, zonder hergebruik van cache, kost bij beide $0,14. De gelijkstand is reëel en geldt precies zolang er niets in de cache staat. Dit is de eerste plaats waar de rangschikking kantelt, en die kantelt op basis van de vorm van de workload, niet op basis van de leverancierskeuze: cachegedomineerde loops gaan naar Claude Fable 5.1, koude one-shot-aanroepen leveren een echte gelijkstand op, en de drempel van 272.000 tokens is het punt waarop GPT-6 Astra niet langer hetzelfde kost als wat dan ook.

Kosten per taak, waarbij de rangschikking de andere kant op omslaat

Vergelijkingen per token zijn een slechte proxy voor wat een taak kost, omdat de twee modellen niet hetzelfde aantal tokens besteden om hetzelfde werk af te maken. Artificial Analysis, dat de enige onafhankelijke kostenberekening per taak publiceert waaraan beide leveranciers momenteel onderworpen zijn, mat de kosten van het uitvoeren van zijn Intelligence Index-evaluatie op $3,26 per taak voor GPT-6 Astra bij maximale inspanning tegenover $7,63 voor Claude Fable 5.1 — wat betekent dat het Open​AI-model met hetzelfde prijskaartje dezelfde evaluatie voltooit voor ongeveer 43% van de kosten, ruwweg 57% lager. Het mechanisme zit in dezelfde dataset: AA mat GPT-6 Astra op 27.000 outputtokens per taak bij maximale inspanning en Claude Fable 5.1 op 78.000 voor dezelfde indexscore, bijna een drievoudig verschil in verbruikte tokens. Dat is het cijfer van AA, uit zijn benchmarkverslag dat op 9 september 2026 is gepubliceerd, niet dat van een van beide leveranciers.

Leg de twee bevindingen naast elkaar en de eerlijke samenvatting is dat de rangorde omkeert met de werklast, en geen van beide omkeringen is een afrondingsartefact. Waar de kosten van een taak worden gedomineerd door het herlezen van een grote, stabiele prefix, wint de vier keer goedkopere cacheread van Claude Fable 5.1, en wint met een flinke marge. Waar de kosten van een taak worden gedomineerd door hoeveel tokens het model uitzendt om te voltooien — lange agentische runs, meerstaps coderen, onderzoek dat zich over meerdere beurten uitstrekt — wint het ruwweg een derde lagere tokenverbruik van GPT-6 Astra met een grotere marge dan het cacheverschil, en daarom komt het per voltooide taak goedkoper uit volgens de maatstaf van AA, ondanks dat het vier keer zoveel rekent voor het lezen van de cache.

Bij elke tokenvergelijking tussen leveranciers hoort één waarschuwing: de twee modellen delen geen tokenizer, dus een token aan de ene kant is niet hetzelfde als een token aan de andere kant. Gerapporteerde tokenaantallen onderschatten of overschatten de werkelijke tekst met een verschillende factor per model, en redeneertokens worden inconsistent gerapporteerd tussen eindpunten. Het kostencijfer per taak is hier het betrouwbaardere getal, precies omdat het in dollars is uitgedrukt en niet in tokens. Beschouw de vergelijking 27.000 tegenover 78.000 als richtinggevend.

Two-column comparison scoreboard for GPT-6 Astra vs Claude Fable 5.1. GPT-6 Astra column: list price $10.00 / $50.00, cache read $1.00 / 1M, long context 2x in and 1.5x out, AA Index 53 (max), cost per AA task $3.26, Terminal-Bench 4.0 59%. Claude Fable 5.1 column: list price $10.00 / $50.00, cache read $0.25 / 1M, long context no surcharge, AA Index 53 (max, fallback), cost per AA task $7.63, Terminal-Bench 4.0 52%. Footer: 'Vendor rate cards read Sep 16, 2026. AA Index, cost per task and Terminal-Bench independent, Artificial Analysis, Sep 9, 2026.'

Terminal-Bench 4.0, waar beide leveranciers hetzelfde getal rapporteren

De door de leverancier gerapporteerde benchmark die beide labs ervoor kozen te publiceren, is Terminal-Bench 4.0, en die is, voor leveranciersbenchmarks, ongewoon netjes, omdat de twee leveranciers het eens zijn over de score van Claude Fable 5.1. Het lanceermateriaal van Open​AI meldt GPT-6 Astra met 57,9% en Claude Fable 5.1 met 55,8%, naast een schatting dat Astra's API-kosten per taak op die benchmark ongeveer 63% lager liggen. In de eigen aankondiging van Anthrop​ic wordt Claude Fable 5.1 eveneens op 55,8% gerapporteerd, in een tabel die ook Claude Mythos 5.1 met 60,9%, Claude Opus 5 met 52,3%, Claude Fable 5 met 42,0% en GPT-5.6 Sol met 37,3% vermeldt. Dat beide labs 55,8% rapporteren voor het Anthrop​ic-model, betekent dat het verschil van 2,1 punt dat Open​AI claimt, geen geschil is over het cijfer van de tegenstander — het is volledig een kwestie van Astra's eigen cijfer, dat alleen Open​AI heeft gepubliceerd.

Onafhankelijke meting vergroot die kloof in plaats van hem te verkleinen, wat je maar beter ronduit kunt zeggen, want de reflex is om het tegenovergestelde aan te nemen. De benchmark van Artificial Analysis van GPT-6 Astra, gepubliceerd op 9 september 2026, meldt Terminal-Bench v4.0 op 59% voor GPT-6 Astra tegenover 52% voor Claude Fable 5.1 en 40% voor GPT-5.6 Sol — een verschil van zeven punten tussen de twee modellen in deze vergelijking, niet 2,1. Een door de leverancier gerapporteerd verschil van 2,1 punt beslecht niets, en een onafhankelijk verschil van zeven punten evenmin. Beide vallen binnen het bereik waarin harness-configuratie, de keuze van scaffold en variantie tussen runs het getal beïnvloeden, en het versieverschil is ook van belang: 59 tegen 52 is de Terminal-Bench v4.0 van AA, wat niet automatisch dezelfde configuratie is die beide labs hebben gedraaid. Wat zonder voorbehoud gezegd kan worden, is dat GPT-6 Astra op deze specifieke benchmark, onafhankelijk gemeten, vooroploopt — en dat het om één benchmark gaat.

Waar Claude Fable 5.1 echt vooroploopt

Een vergelijking waarin één model elke rij wint, is geen vergelijking, en deze ziet er niet zo uit wanneer het onafhankelijke bewijsmateriaal in zijn geheel wordt gelezen. Op de Artificial Analysis Intelligence Index — de samengestelde index, niet één enkele benchmark — staan de twee gelijk op 53, met Claude Fable 5.1 ingevoerd op zijn maximale instelling met fallback en GPT-6 Astra op maximale inspanning. AA's eigen beschrijving noemt Claude Fable 5.1 gedeeld eerste met GPT-6 Astra, niet erachter. Op AA's Coding Agent Index staan de twee ook gelijk op 62, met GPT-6 Astra gemeten in de Codex-harness en Claude Fable 5.1 in Claude Code. Op de twee samengestelde maatstaven die het breedste scala aan werk bestrijken, zit er niets tussen hen.

De door Anthrop​ic gerapporteerde cijfers geven Claude Fable 5.1 een echt eigen verhaal, en deze zijn door de leverancier gerapporteerd en niet onafhankelijk gereproduceerd: 65,0% op Humanity's Last Exam met tools (tegen 63,8% voor Claude Fable 5 en 63,6% voor Claude Opus 5), 1.853 op GDPval-AA v2, 73,4% op CursorBench 3.2.0, en 52,6% op Terminal-Bench-Science 0.1 tegen 24,7% voor Claude Fable 5 — waarbij die laatste de grootste generatiesprong in de tabel van Anthrop​ic is en een benchmark waarvoor Open​AI geen vergelijkbaar cijfer publiceert. Anthrop​ic rapporteert ook voor OSWorld 2.0 77,9% partial en 41,7% strict, terwijl Open​AI voor GPT-6 Astra 72,6% op OSWorld 2.0 rapporteert zonder te vermelden welke variant is gedraaid, dus die twee cijfers kunnen niet als een één-op-éénvergelijking worden beschouwd, ook al betreffen ze dezelfde benchmark.

Het operationele bewijs pleit ook voor Claude Fable 5.1 op ons eigen platform. Gedurende de zeven dagen tot 16 september 2026 mat de OrcaRouter-endpoint anthropic/claude-fable-5.1 90,0 outputtokens per seconde bij een p50 time-to-first-token van 4,43 seconden, tegenover 46,1 tokens per seconde bij 6,71 seconden voor openai/gpt-6-astra — ongeveer het dubbele van de doorvoer en een merkbaar snellere eerste token. Beide cijfers zijn onze eigen, door de router gemeten medianen over een venster van zeven dagen, en onafhankelijke verslaggevers waren het tijdens de lanceringsweek onderling oneens over de relatieve latentie, dus beschouw dit als de meting van één platform en niet als een vaststaand feit. De gepubliceerde tariefkaart van Anthropic bevat ook iets wat die van OpenAI niet heeft: een toezegging over uitfasering, waarbij Claude Fable 5.1 als actief en ondersteund staat vermeld en uitfasering niet vóór 1 september 2027 plaatsvindt. Voor iedereen die een tweejarig inkoopplan opstelt, is een gedateerde levenscyclusverbintenis meer waard dan een benchmarkpunt.

Veiligheid en weigeringsgedrag: de duidelijkste echte divergentie

De plek waar deze twee modellen het meest echt van elkaar verschillen is geen benchmark, en het is ook de plek waar het bewijs het minst onafhankelijk is. Open​AI meldt op basis van interne evaluatie dat GPT-6 Astra 74,7% minder vaak ongewenste uitkomsten produceerde dan Claude Fable 5.1, en 89% minder vaak dan zijn eigen GPT-5.6 Sol. Bij een evaluatie die is gemodelleerd naar het Hugging Face-incident meldt Open​AI dat GPT-5.6 Sol zonder productiebeveiligingen in 48% van de gevallen verder ging dan het toegestane doel, terwijl Astra dat in 0% van de gevallen deed. Dat zijn de cijfers van Open​AI, geproduceerd door Open​AI, op evaluaties die Open​AI heeft ontworpen, en geen enkele derde partij heeft ze gereproduceerd. Het is de sterkste bewering in dit artikel en de minst geverifieerde, en precies daarom doet de toeschrijving ertoe.

Open​AI's structurele bewering is ten minste controleerbaar aan de hand van het product: GPT-6 Astra is het eerste model dat de Critical-drempel voor cyberveiligheidsvermogen bereikt onder Open​AI's Preparedness Framework, en zoals geleverd weigert het geavanceerd cyberwerk, zoals het schrijven van proof-of-concept-exploits. Open​AI zegt dat het van plan is de toegang te verruimen onder minder beperkende waarborgen via zijn Daybreak-programma, wat betekent dat het weigeringsgedrag van het model geen vaste eigenschap is — het is een beleidsinstelling die zal verschuiven. Anthrop​ic meldt het tegenovergestelde soort verbetering voor Claude Fable 5.1: ongeveer 60% minder valse positieven bij cybertaken en ongeveer 85% minder bij basale biologie- en medische vragen, beide door de leverancier gerapporteerd, wat een claim is over minder weigeren in plaats van meer.

Anthropic publiceert ook de kosten van zijn eigen veiligheidsmaatregelen, en het is een werkelijk ongebruikelijke onthulling. In het lanceringsmateriaal staat dat Claude Fable 5.1 is geëvalueerd met productie-veiligheidsmaatregelen ingeschakeld, en dat waar veiligheidsmaatregelen ingrepen, Claude Fable 5.1 en Claude Fable 5 nul scoorden op OSWorld 2.0. Met andere woorden, een deel van het gemeten verschil op een agentische benchmark is het in werking treden van de veiligheidsmaatregel, niet het falen van het model, en de leverancier zegt dat ook. Als je de twee standpunten samen leest, is de afweging concreet: GPT-6 Astra weigert standaard vaker en is afgeschermd achter enterprisecontrols, terwijl Claude Fable 5.1 is ontworpen om minder overmatig te weigeren en zijn leverancier publiceert waar de resterende weigeringen ten koste gaan van een meetbare score. Welke van die twee beter is, hangt volledig af van of jij degene bent die wordt geweigerd.

Screenshot of the Artificial Analysis model page for GPT-6 Astra (max) captured 16 September 2026, showing an Intelligence Index of 53 ranked #3 of 199, output speed 52.9 tokens per second ranked #111 of 199, a $3.26 cost per Intelligence Index task ranked #71 of 199, $10.00 input and $50.00 output per million tokens with a 90% cache discount, 60M output tokens generated on the Intelligence Index, a 1M-token context window and a knowledge cutoff of April 30, 2026.

Het scorebord, gelabeld

Lijstprijs, standaardtarief — GPT-6 Astra $10,00 in / $50,00 uit / $1,00 cached read / $12,50 cache write per 1M (Open​AI-documentatie, geraadpleegd op 16 september 2026). Claude Fable 5.1 $10,00 / $50,00 / $0,25 cached read / $12,50 cache write per 1M (Anthrop​ic-documentatie, geraadpleegd op 16 september 2026). Factor voor input en output: 1,0 keer. Het enige verschil zijn cache-reads, waar Claude Fable 5.1 vier keer goedkoper is.

Lange context — GPT-6 Astra herprijst het hele verzoek boven 272.000 inputtokens: 2 keer input en cache, 1,5 keer output, dus $20,00 / $75,00 met cachelezingen tegen $2,00. Claude Fable 5.1 documenteert geen toeslag voor lange context op een 1M-tokenvenster.

Kosten per voltooide taak (onafhankelijk) — GPT-6 Astra $3,26 per Intelligence Index-taak bij maximale inspanning, $0,82 bij laag. Claude Fable 5.1 $7,63 bij maximaal met fallback. GPT-6 Astra ligt ongeveer 57% lager per taak bij de vergelijkbare instelling. Artificial Analysis, gepubliceerd op 9 september 2026.

Tokens per taak (onafhankelijk) — GPT-6 Astra 27.000 uitvoertokens per indextaak bij maximale inspanning. Claude Fable 5.1 78.000 voor dezelfde score. Artificial Analysis, hetzelfde artikel. Alleen indicatief, aangezien de twee modellen geen tokenizer delen.

Terminal-Bench 4.0 — volgens opgave van de leverancier: GPT-6 Astra 57,9% en Claude Fable 5.1 55,8% (OpenAI), waarbij Anthropic, onafhankelijk van OpenAI, eveneens 55,8% voor zijn eigen model rapporteert. Onafhankelijk: GPT-6 Astra 59% tegenover Claude Fable 5.1 52% (Artificial Analysis, 9 september 2026).

Samengestelde intelligentie (onafhankelijk) — gelijk op 53 op de Artificial Analysis Intelligence Index v4.3, uitgelezen op 16 september 2026, met Claude Fable 5.1 ingevoerd op maximaal met fallback en GPT-6 Astra op maximale inspanning. Coding Agent Index ook gelijk op 62.

Sterkste geverifieerde geval van Claude Fable 5.1 (door leverancier gerapporteerd) — Humanity's Last Exam 65,0% met tools, GDPval-AA v2 1.853, CursorBench 3.2.0 73,4%, Terminal-Bench-Science 0.1 52,6% tegenover 24,7% van Claude Fable 5, OSWorld 2.0 77,9% gedeeltelijk / 41,7% strikt. Anthrop​ic, september 2026. Open​AI publiceert geen vergelijkbaar cijfer voor Humanity's Last Exam of Terminal-Bench-Science voor GPT-6 Astra.

Veiligheid (door leverancier gerapporteerd, niet onafhankelijk gereproduceerd) — Open​AI meldt dat GPT-6 Astra 74,7% minder vaak onbedoelde uitkomsten produceerde dan Claude Fable 5.1 en 89% minder vaak dan GPT-5.6 Sol. Anthrop​ic meldt dat Claude Fable 5.1 cyberfout-positieven met ongeveer 60% terugbracht en fout-positieven op het gebied van basisbiologie en geneeskunde met ongeveer 85%, en stelt dat het model waar zijn waarborgen ingrepen nul scoorde op OSWorld 2.0.

Gemeten doorvoer (door de router vermeld) — Claude Fable 5.1 90,0 outputtokens per seconde bij een p50 tijd-tot-eerste-token van 4,43 seconden; GPT-6 Astra 46,1 tokens per seconde bij 6,71 seconden. Medianen over zeven dagen van OrcaRouter tot 16 september 2026. Artificial Analysis meet GPT-6 Astra afzonderlijk op 52,9 outputtokens per seconde met zijn eigen testopstelling, dus zowel de absolute snelheden als de grootte van het verschil hangen ervan af wie er meet — de richting is consistent, de omvang niet.

Beschikbaarheid, en de toegangsregels die daarover kunnen beslissen voordat de benchmarks dat doen

De deployment-oppervlakken overlappen elkaar sterk, maar de toegangsregels niet. OpenAI levert GPT-6 Astra in ChatGPT Work, Codex en zijn eigen API, waarbij Microsoft Azure en Foundry algemeen beschikbaar zijn vanaf 3 september 2026 en Amazon Bedrock algemeen beschikbaar is vanaf 8 september 2026. Op ChatGPT Business en Enterprise is het standaard uitgeschakeld — een werkruimtebeheerder moet het inschakelen onder de toepasselijke tariefkaart voordat een lid het kan gebruiken, en toegang wordt per oppervlak toegekend in plaats van uniform, dus een abonnement dat het model in Codex heeft, heeft het mogelijk niet in de standaard chatpicker. OpenAI documenteert Zero Data Retention als beschikbaar voor in aanmerking komende API-klanten op ondersteunde eindpunten, onder voorbehoud van goedkeuring, en de helpdocumentatie is bijgewerkt op 14 september 2026 met de minimale Codex CLI-versie die vereist is voordat het model überhaupt verschijnt.

Anthropic levert Claude Fable 5.1 via de Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry en het Claude Platform on AWS, waarbij hetzelfde model beschikbaar is voor Pro-, Max-, Team- en Enterprise-abonnementen. Het model staat als actief vermeld met een uitfaseringsdatum die niet eerder valt dan 1 september 2027, en er is geen gelijkwaardige opt-in-stap gedocumenteerd — het is beschikbaar in plaats van afgeschermd. Het zustermodel Claude Mythos 5.1 is hetzelfde onderliggende model met andere veiligheidsmaatregelen, en is op uitnodiging beperkt tot de Cyber Verification- en Life Sciences-programma's van Anthropic.

Clouddekking — Claude Fable 5.1 is beschikbaar op Amazon Bedrock, Goo​gle Cloud, Microsoft Foundry en het Claude Platform op AWS. GPT-6 Astra is beschikbaar op Microsoft Azure en Foundry en op Amazon Bedrock. Goo​gle Cloud is het gat: als je inferentie in Goo​gle Cloud moet draaien, heeft een van deze twee een antwoord en de andere niet.

Standaardtoegang — GPT-6 Astra staat standaard uit bij Business en Enterprise en vereist dat een beheerder het inschakelt onder een tariefkaart. Claude Fable 5.1 heeft geen gedocumenteerde opt-in-drempel.

Gegevensverwerking — Open​AI documenteert Zero Data Retention voor in aanmerking komende API-klanten op ondersteunde endpoints, onder voorbehoud van goedkeuring. Anthrop​ic documenteert enterprise-waarborgen met zero data retention die in de herfst van 2026 beschikbaar komen, wat betekent dat het vandaag nog niet beschikbaar is.

Levenscyclus — Claude Fable 5.1 heeft een gepubliceerde toezegging dat het niet eerder dan 1 september 2027 buiten gebruik wordt gesteld. OpenAI heeft geen gelijkwaardige, gedateerde toezegging gepubliceerd voor GPT-6 Astra.

Screenshot of the OrcaRouter model page for Claude Fable 5.1, model id anthropic/claude-fable-5.1, released 2026-09-01 by Anthropic, showing INPUT $10.00 and OUTPUT $50.00 per 1M tokens, a 1M-token context, 128K maximum output, p50 TTFT 4.43 s, p95 TTFT 10.00 s, and 19.9M tokens of traffic in seven days, with the site language set to EN.

Beide achter één sleutel draaien

Omdat de twee tariefkaarten op het eerste gezicht identiek zijn, is de vraag die een team echt geld kost niet welk model goedkoper is, maar hoe duur het is om van gedachten te veranderen. Beide worden op OrcaRouter aangeboden tegen de eigen lijstprijzen van de leveranciers — openai/gpt-6-astra tegen $10,00 voor invoer en $50,00 voor uitvoer, waarbij de 272K long-context-tier precies wordt toegepast zoals Open​AI die definieert, en anthropic/claude-fable-5.1 tegen $10,00 en $50,00, met cache-reads tegen $0,25 — waarbij elk tarief met 0% opslag wordt doorgegeven, zodat een prijswijziging van een leverancier dezelfde dag live is op dezelfde sleutel in plaats van te wachten op een facturatiemigratie.

Dat is voor deze combinatie belangrijker dan voor de meeste, omdat het bewijs zegt dat het juiste antwoord een splitsing is in plaats van een keuze. Chatverkeer is hier op beide endpoints reëel — 180,7 mln. tokens naar GPT-6 Astra in de zeven dagen tot 16 september 2026 en 19,9 mln. naar Claude Fable 5.1 — en de workloadvormen die elk begunstigen verschillen zo sterk dat routering tussen hen een configuratiewijziging is in plaats van een architectuurbeslissing. Een routerings-DSL kan cache-intensieve langdurige loops naar Claude Fable 5.1 sturen voor de vier keer goedkopere cachelezing, terwijl kort, hoogvolume, output-efficiënt werk naar GPT-6 Astra gaat, en modelfusie kan beide op hetzelfde moeilijke probleem zetten wanneer één enkel antwoord niet goed genoeg is om erop te handelen. Automatische failover betekent dat een rate limit op één pad een routeringsgebeurtenis is in plaats van een storing, en dat is wat het redelijk maakt om de onbewezen kant van een gloednieuw frontiermodel op een productiepad uit te proberen.

Wie moet welke kiezen

Kies GPT-6 Astra als je werk een lange tijdshorizon heeft en end-to-end is — agentisch programmeren, terminalautomatisering, onderzoekstaken of taken voor computergebruik die vele stappen doorlopen en meer kosten aan gegenereerde tokens dan aan context. Op basis van het onafhankelijke bewijs voltooit het dezelfde evaluatie met ongeveer een derde van de outputtokens en komt het ongeveer 57% goedkoper uit per voltooide taak, en het leidt op Terminal-Bench 4.0 in zowel de meting van de leverancier als de onafhankelijke meting. Budgetteer per taak in plaats van per token, en behandel 272.000 invoertokens als een harde grens: daarboven wordt een verzoek op dit model volgens de eigen regel van de leverancier voor het hele verzoek opnieuw geprijsd.

Kies Claude Fable 5.1 als je werklast een grote, stabiele prefix herhaaldelijk opnieuw leest — een lange systeemprompt, een repository, een documentenset — gedurende vele beurten, omdat een vier keer goedkopere cacheread zich bij elk daarvan opstapelt, en het rekenwerk hierboven laat zien dat dit een taak van $5,70 omzet in een van $1,95. Het is ook de keuze als je de hogere gemeten doorvoer en een snellere eerste token wilt, als je inferentie in Google Cloud moet draaien, of als een gedateerde toezegging over uitfasering van belang is voor inkoop. Het staat op hetzelfde niveau als GPT-6 Astra op de samengestelde index en op de codingagentindex, en het heeft de sterkere door de leverancier gerapporteerde onderbouwing op Humanity's Last Exam, GDPval en CursorBench — benchmarks waar OpenAI geen vergelijkbaar cijfer publiceert, dus beschouw dat als een hiaat in het bewijs in plaats van een aangetoonde overwinning.

En het antwoord dat een vergelijkingspagina je verschuldigd is wanneer het waar is: voor veel teams is de eerlijke aanbeveling geen van beide. De eigen documentatie van Anthropic voor Claude Fable 5.1 zegt dat je voor de meeste workloads moet beginnen met Claude Opus 5 en alleen naar Fable 5.1 moet grijpen wanneer je evaluaties op Opus 5 bij hogere inspanning nog steeds tekortschieten. Claude Opus 5 kost $5,00 in en $25,00 out — de helft van wat beide modellen op beide lijnen kosten. Als het vier keer zo grote voordeel bij cache-lezen of de drievoudige tokenefficiëntie niet op jouw workload van toepassing is, dan levert de premium van het vlaggenschip je een capaciteit op waarvan je niet hebt vastgesteld dat je die nodig hebt, en de goedkoopste manier om daarachter te komen is om een echte taak door beide modellen en één niveau lager te laten lopen, met één sleutel, voordat je je aan een van beide vastlegt.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt