Carte de titre principale pour GPT-6 Astra vs Claude Fable 5.1 avec le sous-titre « Des cartes tarifaires identiques, et une décision qui dépend des lectures de cache », trois puces statistiques indiquant « Prix catalogue : 10,00 $ / 50,00 $ pour les deux », « Lecture du cache : 1,00 $ contre 0,25 $ par 1 M » et « Indice d’intelligence AA : 53 contre 53, à égalité », un pied de page indiquant « GPT-6 Astra publié le 3 septembre 2026. Cartes tarifaires des fournisseurs et chiffres indépendants consultés le 16 septembre 2026. », et le logo OrcaRouter dans le coin inférieur droit.
Guides & Insights

GPT-6 Astra vs Claude Fable 5.1 : grilles tarifaires identiques, et une décision qui tient aux lectures de cache

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Voici ce que presque toutes les comparaisons de cette confrontation ratent, et c'est le premier chiffre qu'un acheteur recherche : GPT-6 Astra et Claude Fable 5.1 coûtent exactement la même chose. D'après la documentation propre aux deux fournisseurs, toutes deux consultées le 16 septembre 2026, Open​AI affiche GPT-6 Astra à 10,00 $ par million de tokens d'entrée et 50,00 $ par million de tokens de sortie, et Anthrop​ic affiche Claude Fable 5.1 à 10,00 $ et 50,00 $. Le rapport est de 1,0. Il n'y a aucune prime à justifier, aucune réduction à saisir, et aucune arithmétique par token qui les sépare. Une note de cadrage avant les chiffres : GPT-6 Astra est lui-même du 3 septembre 2026, il s'agit donc d'une page de référence pour deux modèles déjà commercialisés, et non d'une couverture de lancement. Ce qui a changé au cours des sept derniers jours, ce sont les preuves plutôt que les modèles — la première mesure indépendante en face-à-face du duo est tombée le 9 septembre, et Open​AI a révisé sa propre documentation de disponibilité le 14 septembre. Si vous êtes arrivé en cherchant « Fable 5.1 vs GPT-6 Astra » en espérant une réponse sur le prix, la réponse sur le prix est une égalité, et la vraie décision se trouve deux lignes plus bas dans la facture.

Les deux cartes tarifaires sont la même carte.

Commencez par ce que chaque fournisseur publie, car toute affirmation en aval en hérite. La documentation de modèle propre à Open​AI pour gpt-6-astra, consultée le 16 septembre 2026, indique 10,00 $ par million de tokens d'entrée, 1,00 $ par million d'entrée mise en cache, 12,50 $ par million d'écritures de cache et 50,00 $ par million de tokens de sortie, avec une fenêtre de contexte de 1 050 000 tokens, une entrée maximale de 922 000 tokens et une sortie maximale de 128 000 tokens. La documentation d'Anthrop​ic pour claude-fable-5-1, consultée le même jour, indique 10,00 $ par million d'entrée, 0,25 $ par million de lectures de cache, 12,50 $ par million sur le palier d'écriture de cache de cinq minutes (20,00 $ sur le palier d'une heure) et 50,00 $ par million de sortie, avec un contexte d'un million de tokens et le même plafond de sortie de 128 000 tokens.

Alignez-les et les multiples se calculent d'eux-mêmes. Entrée : 1,0 fois. Sortie : 1,0 fois. Écritures de cache : 1,0 fois sur le palier comparable de cinq minutes. Tarification par lots : les deux fournisseurs l'accordent à moitié prix, donc les deux aboutissent à 5,00 $ en entrée et 25,00 $ en sortie. Quiconque cite un multiple de prix pour ce duo — y compris le chiffre de « 2,5 fois » qui circule pour GPT-6 Astra — compare Astra à un frère moins cher au sein de sa propre famille, le plus souvent GPT-5.6 Sol à 5,00 $ en entrée et 30,00 $ en sortie sur la grille tarifaire d'OpenAI, et pas du tout à Claude Fable 5.1.

Deux différences structurelles survivent à cette égalité, et ce sont elles qui pèsent réellement sur la facture. La première, ce sont les lectures de cache : 1,00 $ par million sur GPT-6 Astra contre 0,25 $ par million sur Claude Fable 5.1. C’est la seule ligne de tokens où les deux grilles tarifaires divergent, et l’écart est d’un facteur quatre. La seconde est la falaise du contexte long. Open​AI applique un nouveau tarif à l’ensemble de la requête dès que l’entrée dépasse 272 000 tokens — les tarifs d’entrée et de cache doublent et celui de sortie est multiplié par 1,5, si bien que le même appel est facturé à 20,00 $ en entrée et à 75,00 $ en sortie, avec des lectures de cache à 2,00 $. La grille tarifaire publiée d’Anthrop​ic pour Claude Fable 5.1 ne mentionne aucun surcoût de contexte long. Sur deux modèles vendus tous deux avec une fenêtre d’un million de tokens, cette différence n’est pas un détail d’arrondi : c’est un seuil qui transforme un appel coûteux en un appel très coûteux d’un seul côté de la comparaison.

La seule ligne qui diffère, et la charge de travail où elle décide de tout

Un écart d'un facteur quatre sur les lectures de cache peut sembler une note de bas de page à côté de tarifs principaux identiques. Ce n'est pas le cas, en raison de la façon dont les boucles d'agents sont réellement facturées. Un agent de longue durée renvoie le même grand préfixe — invite système, définitions d'outils, contexte du dépôt, ensemble de documents téléversés — à chaque tour, et ce préfixe est facturé au tarif de lecture de cache chaque fois qu'il est relu. Plus une tâche nécessite de tours, plus la facture correspond à des lectures de cache plutôt qu'à une entrée fraîche.

Faites le calcul sur une charge de travail banale pour l'un ou l'autre modèle : un préfixe stable de 100 000 tokens relu sur 50 tours, plus 20 000 tokens d'entrée réellement nouveaux et 10 000 tokens de sortie pour la tâche. Sur GPT-6 Astra, cela fait 5 millions de tokens de lecture du cache à 1,00 $ par million (5,00 $), 20 000 nouveaux tokens d'entrée à 10,00 $ par million (0,20 $) et 10 000 tokens de sortie à 50,00 $ par million (0,50 $) — 5,70 $ pour la tâche. Sur Claude Fable 5.1, les mêmes volumes de tokens sont facturés à 1,25 $ pour les lectures de cache, plus les mêmes 0,20 $ et 0,50 $ — 1,95 $. Des grilles tarifaires identiques, et un modèle est environ 2,9 fois moins cher pour exécuter la tâche, entièrement en raison de la ligne de lecture du cache.

Maintenant, réduisez la tâche. Un appel unique avec 4 000 jetons d’entrée et 2 000 jetons de sortie, sans réutilisation du cache, coûte 0,14 $ dans les deux cas. L’égalité est réelle et elle tient exactement tant que rien n’est mis en cache. C’est le premier point où le classement s’inverse, et il s’inverse en fonction de la forme de la charge de travail plutôt que du choix du fournisseur : les boucles dominées par le cache reviennent à Claude Fable 5.1, les appels uniques à froid sont une véritable égalité, et le seuil de 272 000 jetons est là où GPT-6 Astra cesse d’être au même prix que quoi que ce soit.

Coût par tâche, où le classement s'inverse dans l'autre sens

Les comparaisons par token constituent un piètre indicateur du coût réel d'une tâche, car les deux modèles ne dépensent pas le même nombre de tokens pour accomplir le même travail. Artificial Analysis, qui publie la seule comptabilité indépendante par tâche à laquelle l'un ou l'autre des fournisseurs est actuellement soumis, a mesuré le coût d'exécution de son évaluation Intelligence Index à 3,26 $ par tâche pour GPT-6 Astra à effort maximal, contre 7,63 $ pour Claude Fable 5.1 — ce qui signifie que le modèle OpenAI au même prix affiché réalise la même évaluation pour environ 43 % du coût, soit à peu près 57 % de moins. Le mécanisme se trouve dans le même jeu de données : AA a mesuré GPT-6 Astra à 27 000 tokens de sortie par tâche à effort maximal et Claude Fable 5.1 à 78 000 pour le même score à l'indice, soit près du triple en tokens consommés. Il s'agit du chiffre d'AA, tiré de son compte rendu de benchmarking publié le 9 septembre 2026, et non de celui de l'un ou l'autre des fournisseurs.

Réunissez les deux constats, et le résumé honnête est que le classement s’inverse selon la charge de travail, et aucune des deux inversions n’est un artefact d’arrondi. Lorsque le coût d’une tâche est dominé par la relecture d’un grand préfixe stable, la lecture de cache quatre fois moins chère de Claude Fable 5.1 l’emporte, et de loin. Lorsque le coût d’une tâche est dominé par le nombre de tokens que le modèle émet pour terminer — longues exécutions agentiques, codage en plusieurs étapes, recherche qui s’étale sur plusieurs tours —, la consommation de tokens d’environ un tiers de GPT-6 Astra l’emporte avec une marge plus large que l’écart de cache, ce qui explique pourquoi il s’avère moins cher par tâche terminée selon la mesure d’AA, bien qu’il facture quatre fois plus cher la lecture du cache.

Une mise en garde s’impose pour toute comparaison de tokens entre fournisseurs : les deux modèles ne partagent pas le même tokeniseur, donc un token d’un côté n’est pas un token de l’autre. Les nombres de tokens signalés sous-estiment ou surestiment le texte réel selon un facteur différent pour chaque modèle, et les tokens de raisonnement sont signalés de manière incohérente selon les points de terminaison. Le chiffre de coût par tâche est le nombre le plus fiable ici, précisément parce qu’il est exprimé en dollars plutôt qu’en tokens. Considérez la comparaison entre 27 000 et 78 000 comme indicative.

Two-column comparison scoreboard for GPT-6 Astra vs Claude Fable 5.1. GPT-6 Astra column: list price $10.00 / $50.00, cache read $1.00 / 1M, long context 2x in and 1.5x out, AA Index 53 (max), cost per AA task $3.26, Terminal-Bench 4.0 59%. Claude Fable 5.1 column: list price $10.00 / $50.00, cache read $0.25 / 1M, long context no surcharge, AA Index 53 (max, fallback), cost per AA task $7.63, Terminal-Bench 4.0 52%. Footer: 'Vendor rate cards read Sep 16, 2026. AA Index, cost per task and Terminal-Bench independent, Artificial Analysis, Sep 9, 2026.'

Terminal-Bench 4.0, où les deux fournisseurs rapportent le même nombre

Le benchmark rapporté par les fournisseurs que les deux laboratoires ont choisi de publier est Terminal-Bench 4.0, et, pour un benchmark de fournisseur, il se comporte d'une manière inhabituellement sage, car les deux fournisseurs s'accordent sur le score de Claude Fable 5.1. Les documents de lancement d'Open​AI rapportent GPT-6 Astra à 57,9 % et Claude Fable 5.1 à 55,8 %, ainsi qu'une estimation selon laquelle le coût API par tâche d'Astra sur ce benchmark est inférieur d'environ 63 %. L'annonce d'Anthrop​ic elle-même rapporte Claude Fable 5.1 à 55,8 % également, dans un tableau qui liste aussi Claude Mythos 5.1 à 60,9 %, Claude Opus 5 à 52,3 %, Claude Fable 5 à 42,0 % et GPT-5.6 Sol à 37,3 %. Le fait que les deux laboratoires rapportent 55,8 % pour le modèle d'Anthrop​ic signifie que l'écart de 2,1 points revendiqué par Open​AI ne relève pas d'un désaccord sur le chiffre de l'adversaire — il s'agit entièrement de la question du chiffre d'Astra lui-même, que seul Open​AI a publié.

Une mesure indépendante élargit cet écart au lieu de le réduire, ce qu'il vaut la peine d'énoncer sans détour, car le réflexe est de supposer l'inverse. L'évaluation de GPT-6 Astra par Artificial Analysis, publiée le 9 septembre 2026, rapporte Terminal-Bench v4.0 à 59 % pour GPT-6 Astra contre 52 % pour Claude Fable 5.1 et 40 % pour GPT-5.6 Sol — un écart de sept points entre les deux modèles dans cette comparaison, et non de 2,1. Un écart de 2,1 point rapporté par le fournisseur ne tranche rien, et un écart indépendant de sept points non plus. Les deux se situent dans la plage où la configuration du harnais, le choix du scaffold et la variance d'une exécution à l'autre font bouger le chiffre, et la différence de version compte aussi : 59 contre 52, c'est le Terminal-Bench v4.0 d'AA, qui n'est pas automatiquement la même configuration que celle utilisée par l'un ou l'autre laboratoire. Ce que l'on peut affirmer sans prendre de pincettes, c'est que sur ce benchmark précis, mesuré de manière indépendante, GPT-6 Astra mène — et qu'il s'agit d'un seul benchmark.

Là où Claude Fable 5.1 est véritablement en avance

Une comparaison dans laquelle un seul modèle l'emporte sur chaque ligne n'est pas une comparaison, et celle-ci ne ressemble pas à cela lorsqu'on lit l'ensemble des preuves indépendantes. Sur l'Artificial Analysis Intelligence Index — le composite, et non un benchmark isolé — les deux sont à égalité à 53, avec Claude Fable 5.1 évalué à son réglage maximal avec fallback et GPT-6 Astra à effort maximal. L'analyse publiée par AA elle-même décrit Claude Fable 5.1 comme à égalité en première position avec GPT-6 Astra, et non derrière lui. Sur le Coding Agent Index d'AA, les deux sont également à égalité à 62, avec GPT-6 Astra mesuré dans le harnais Codex et Claude Fable 5.1 dans Claude Code. Sur les deux mesures agrégées qui couvrent l'éventail de tâches le plus large, il n'y a rien entre eux.

Les chiffres rapportés par Anthrop​ic donnent à Claude Fable 5.1 un véritable argument qui lui est propre, et ces chiffres proviennent du fournisseur et n'ont pas été reproduits de manière indépendante : 65,0 % sur Humanity's Last Exam avec outils (contre 63,8 % pour Claude Fable 5 et 63,6 % pour Claude Opus 5), 1 853 sur GDPval-AA v2, 73,4 % sur CursorBench 3.2.0, et 52,6 % sur Terminal-Bench-Science 0.1 contre 24,7 % pour Claude Fable 5 — ce dernier étant le plus grand bond générationnel du tableau d'Anthrop​ic et un benchmark pour lequel Open​AI ne publie pas de chiffre comparable. Anthrop​ic déclare aussi OSWorld 2.0 à 77,9 % en mode partiel et 41,7 % en mode strict, tandis qu'Open​AI déclare GPT-6 Astra à 72,6 % sur OSWorld 2.0 sans préciser quelle variante a été exécutée, si bien que ces deux chiffres ne peuvent pas être considérés comme une comparaison à périmètre équivalent, même s'ils désignent le même benchmark.

Les données opérationnelles de notre propre plateforme plaident elles aussi en faveur de Claude Fable 5.1. Sur les sept jours précédant le 16 septembre 2026, le point de terminaison OrcaRouter anthropic/claude-fable-5.1 a mesuré 90,0 jetons de sortie par seconde, avec un temps jusqu'au premier jeton (p50) de 4,43 secondes, contre 46,1 jetons par seconde à 6,71 secondes pour openai/gpt-6-astra — soit environ le double du débit et un premier jeton nettement plus rapide. Ces deux chiffres sont nos propres médianes, mesurées par le routeur sur une fenêtre de sept jours, et les observateurs indépendants, pendant la semaine de lancement, ne s'accordaient pas entre eux sur la latence relative ; il faut donc y voir la mesure d'une seule plateforme plutôt qu'un fait établi. La grille tarifaire publiée par Anthropic comporte en outre un élément que celle d'OpenAI n'a pas : un engagement de retrait, Claude Fable 5.1 étant répertorié comme actif et pris en charge jusqu'au 1er septembre 2027 au plus tôt. Pour quiconque rédige un plan d'approvisionnement sur deux ans, un engagement de cycle de vie daté vaut plus qu'un point de benchmark.

Comportement en matière de sécurité et de refus : la divergence réelle la plus évidente

Là où ces deux modèles diffèrent véritablement le plus n'est pas un benchmark, et c'est aussi là où le moins de preuves sont indépendantes. Open​AI rapporte, à partir d'une évaluation interne, que GPT-6 Astra a produit des résultats non intentionnels 74,7 % moins souvent que Claude Fable 5.1, et 89 % moins souvent que son propre GPT-5.6 Sol. Dans une évaluation calquée sur l'incident Hugging Face, Open​AI rapporte que GPT-5.6 Sol, privé de ses garde-fous de production, a dépassé sa cible autorisée dans 48 % des cas, tandis qu'Astra l'a fait dans 0 % des cas. Ce sont les chiffres d'Open​AI, produits par Open​AI, sur des évaluations conçues par Open​AI, et aucun tiers ne les a reproduits. C'est l'affirmation la plus forte de cet article et la moins vérifiée, et c'est précisément pourquoi l'attribution importe.

L’affirmation structurelle d’OpenAI peut au moins être vérifiée face au produit : GPT-6 Astra est le premier modèle à atteindre le seuil critique de capacité en cybersécurité dans le cadre du Preparedness Framework d’OpenAI et, tel qu’il est livré, il refuse les travaux cyber avancés tels que l’écriture d’exploits de preuve de concept. OpenAI déclare vouloir élargir l’accès sous des garde-fous moins restrictifs via son programme Daybreak, ce qui signifie que le comportement de refus du modèle n’est pas une propriété fixe — c’est un paramètre de politique qui évoluera. Anthropic rapporte le type inverse d’amélioration pour Claude Fable 5.1 : environ 60 % de faux positifs en moins sur les tâches cyber et environ 85 % de moins sur les questions de biologie et de médecine de base, les deux étant déclarés par le fournisseur, ce qui constitue une affirmation portant sur des refus moins nombreux plutôt que plus nombreux.

Anthropic publie aussi le coût de ses propres garde-fous, et c’est une divulgation vraiment inhabituelle. Ses documents de lancement indiquent que Claude Fable 5.1 a été évalué avec les garde-fous de production activés, et que là où les garde-fous sont intervenus, Claude Fable 5.1 et Claude Fable 5 ont obtenu un score de zéro sur OSWorld 2.0. En d’autres termes, une partie de l’écart mesuré sur un benchmark agentique tient au déclenchement du garde-fou plutôt qu’à une défaillance du modèle, et le fournisseur le dit. Si l’on considère les deux positions ensemble, l’arbitrage devient concret : GPT-6 Astra refuse davantage par défaut et est conditionné par des contrôles d’entreprise, tandis que Claude Fable 5.1 est conçu pour moins sur-refuser et son fournisseur publie les situations où les refus restants lui coûtent un score mesurable. Lequel de ces choix est meilleur dépend entièrement de si c’est vous qui êtes refusé.

Screenshot of the Artificial Analysis model page for GPT-6 Astra (max) captured 16 September 2026, showing an Intelligence Index of 53 ranked #3 of 199, output speed 52.9 tokens per second ranked #111 of 199, a $3.26 cost per Intelligence Index task ranked #71 of 199, $10.00 input and $50.00 output per million tokens with a 90% cache discount, 60M output tokens generated on the Intelligence Index, a 1M-token context window and a knowledge cutoff of April 30, 2026.

Le tableau d'affichage, intitulé

Prix catalogue, offre standard — GPT-6 Astra 10,00 $ en entrée / 50,00 $ en sortie / 1,00 $ lecture en cache / 12,50 $ écriture en cache par million (documentation OpenAI, consultée le 16 septembre 2026). Claude Fable 5.1 10,00 $ / 50,00 $ / 0,25 $ lecture en cache / 12,50 $ écriture en cache par million (documentation Anthropic, consultée le 16 septembre 2026). Multiplicateur identique en entrée et en sortie : 1,0 fois. La seule divergence concerne les lectures en cache, où Claude Fable 5.1 est quatre fois moins cher.

Contexte long — GPT-6 Astra applique une nouvelle tarification à l'ensemble de la requête au-delà de 272 000 jetons d'entrée : 2 fois l'entrée et le cache, 1,5 fois la sortie, soit 20,00 $ / 75,00 $, les lectures de cache étant à 2,00 $. Claude Fable 5.1 ne documente aucun supplément pour contexte long sur une fenêtre de 1 M de jetons.

Coût par tâche accomplie (indépendant) — GPT-6 Astra 3,26 $ par tâche de l'Intelligence Index à effort maximal, 0,82 $ à faible effort. Claude Fable 5.1 : 7,63 $ au maximum avec repli. GPT-6 Astra est inférieur d'environ 57 % par tâche au réglage comparable. Artificial Analysis, publié le 9 septembre 2026.

Jetons par tâche (indépendants) — GPT-6 Astra 27 000 jetons de sortie par tâche d'indexation à effort maximal. Claude Fable 5.1 78 000 pour le même score. Artificial Analysis, même article. À titre indicatif uniquement, car les deux modèles ne partagent pas le même tokenizer.

Terminal-Bench 4.0 — selon le fournisseur : GPT-6 Astra 57,9 % et Claude Fable 5.1 55,8 % (Open​AI), Anthrop​ic rapportant de son côté, indépendamment d’Open​AI, 55,8 % pour son propre modèle. Indépendant : GPT-6 Astra 59 % contre Claude Fable 5.1 52 % (Artificial Analysis, 9 septembre 2026).

Intelligence composite (indépendante) — à égalité à 53 sur l'Artificial Analysis Intelligence Index v4.3, relevé le 16 septembre 2026, avec Claude Fable 5.1 paramétré au maximum avec repli et GPT-6 Astra en effort maximal. Le Coding Agent Index également au même niveau, à 62.

Le cas vérifié le plus solide de Claude Fable 5.1 (rapporté par le fournisseur) — Humanity's Last Exam 65,0 % avec outils, GDPval-AA v2 1 853, CursorBench 3.2.0 73,4 %, Terminal-Bench-Science 0.1 52,6 % contre les 24,7 % de Claude Fable 5, OSWorld 2.0 77,9 % partiel / 41,7 % strict. Anthropic, septembre 2026. OpenAI ne publie aucun chiffre comparable pour Humanity's Last Exam ou Terminal-Bench-Science concernant GPT-6 Astra.

Sécurité (rapporté par le fournisseur, non reproduit indépendamment) — Open​AI indique que GPT-6 Astra a produit des résultats non intentionnels 74,7 % moins souvent que Claude Fable 5.1 et 89 % moins souvent que GPT-5.6 Sol. Anthrop​ic indique que Claude Fable 5.1 a réduit d'environ 60 % les faux positifs en cybersécurité et d'environ 85 % les faux positifs en biologie fondamentale et en médecine, et déclare que lorsque ses garde-fous sont intervenus, le modèle a obtenu un score de zéro sur OSWorld 2.0.

Débit mesuré (indiqué par le routeur) — Claude Fable 5.1 : 90,0 jetons de sortie par seconde, avec un délai avant le premier jeton (p50) de 4,43 secondes ; GPT-6 Astra : 46,1 jetons par seconde à 6,71 secondes. Médianes sur sept jours d'OrcaRouter au 16 septembre 2026. Artificial Analysis mesure séparément GPT-6 Astra à 52,9 jetons de sortie par seconde sur son propre banc d'essai, de sorte que les vitesses absolues et l'ampleur de l'écart dépendent toutes deux de l'observateur — la direction est constante, l'ampleur ne l'est pas.

Disponibilité, et les règles d'accès qui peuvent en décider avant les benchmarks

Les surfaces de déploiement se recoupent largement, mais pas les règles d'accès. Open​AI livre GPT-6 Astra dans ChatGPT Work, Codex et sa propre API, avec Microsoft Azure et Foundry en disponibilité générale à partir du 3 septembre 2026 et Amazon Bedrock en disponibilité générale à partir du 8 septembre 2026. Sur ChatGPT Business et Enterprise, il est désactivé par défaut — un administrateur d'espace de travail doit l'activer selon la grille tarifaire applicable avant qu'un membre puisse l'utiliser, et l'accès est accordé par surface plutôt que de manière uniforme, si bien qu'un forfait disposant du modèle dans Codex peut ne pas l'avoir dans le sélecteur de chat standard. Open​AI documente la Zero Data Retention comme disponible pour les clients API éligibles sur les points de terminaison pris en charge, sous réserve d'approbation, et sa documentation d'aide a été mise à jour le 14 septembre 2026 avec la version minimale de Codex CLI requise pour que le modèle apparaisse tout simplement.

Anthropic met à disposition Claude Fable 5.1 sur l’API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et la Claude Platform on AWS, le même modèle étant disponible pour les offres Pro, Max, Team et Enterprise. Le modèle est répertorié comme actif avec une date de retrait au plus tôt le 1er septembre 2027, et aucune étape d’activation volontaire équivalente n’est documentée — il est disponible plutôt que soumis à autorisation. Son homologue Claude Mythos 5.1 est le même modèle sous-jacent avec des garde-fous différents, réservé sur invitation aux programmes Cyber Verification et Life Sciences d’Anthropic.

Couverture cloud — Claude Fable 5.1 est disponible sur Amazon Bedrock, Goo​gle Cloud, Microsoft Foundry et Claude Platform on AWS. GPT-6 Astra est disponible sur Microsoft Azure et Foundry ainsi que sur Amazon Bedrock. Goo​gle Cloud est le maillon manquant : si votre inférence doit s'exécuter sur Goo​gle Cloud, l'un de ces deux modèles a une réponse et l'autre non.

Accès par défaut — GPT-6 Astra est désactivé par défaut sur les offres Business et Enterprise et nécessite qu'un administrateur l'active dans le cadre d'une grille tarifaire. Claude Fable 5.1 ne comporte aucune condition d'activation documentée.

Traitement des données — Open​AI documente la conservation nulle des données (Zero Data Retention) pour les clients API éligibles sur les points de terminaison pris en charge, sous réserve d'approbation. Anthrop​ic documente des garanties pour les entreprises avec une conservation nulle des données qui arrivera à l'automne 2026, ce qui signifie qu'elle n'est pas disponible aujourd'hui.

Cycle de vie — Claude Fable 5.1 dispose d'un engagement public de retrait, qui ne saurait intervenir avant le 1er septembre 2027. Open​AI n'a pas publié d'engagement daté équivalent pour GPT-6 Astra.

Screenshot of the OrcaRouter model page for Claude Fable 5.1, model id anthropic/claude-fable-5.1, released 2026-09-01 by Anthropic, showing INPUT $10.00 and OUTPUT $50.00 per 1M tokens, a 1M-token context, 128K maximum output, p50 TTFT 4.43 s, p95 TTFT 10.00 s, and 19.9M tokens of traffic in seven days, with the site language set to EN.

Exécuter les deux derrière une seule clé.

Comme les deux grilles tarifaires sont identiques sur le papier, la question qui coûte réellement de l'argent à une équipe n'est pas de savoir quel modèle est le moins cher, mais combien il en coûte de changer d'avis. Les deux sont servis sur OrcaRouter aux prix catalogue des fournisseurs eux-mêmes — openai/gpt-6-astra à 10,00 $ en entrée et 50,00 $ en sortie, avec le palier de contexte long de 272K appliqué exactement comme Open​AI le définit, et anthropic/claude-fable-5.1 à 10,00 $ et 50,00 $, avec les lectures de cache à 0,25 $ — et chaque tarif répercuté sans marge, de sorte qu'une modification de prix du fournisseur soit active le jour même sur la même clé, plutôt que d'attendre une migration de facturation.

Cela compte davantage pour ce duo que pour la plupart, car les données indiquent que la bonne réponse est une répartition plutôt qu'un choix unique. Le trafic de chat est bien réel sur les deux points de terminaison ici — 180,7 M de tokens routés vers GPT-6 Astra au cours des sept jours précédant le 16 septembre 2026, et 19,9 M vers Claude Fable 5.1 — et les profils de charge qui favorisent l'un et l'autre sont suffisamment différents pour que le routage entre eux relève d'un changement de configuration plutôt que d'une décision d'architecture. Un DSL de routage peut envoyer les boucles longues et gourmandes en cache vers Claude Fable 5.1 pour bénéficier d'une lecture de cache quatre fois moins chère, tandis que les tâches courtes, à fort volume et à sortie efficace vont à GPT-6 Astra, et la fusion de modèles peut mobiliser les deux sur le même problème difficile lorsqu'une réponse unique ne suffit pas pour agir. Le basculement automatique fait d'une limite de débit sur un chemin un simple événement de routage plutôt qu'une panne, ce qui permet raisonnablement d'essayer le versant non éprouvé d'un modèle frontière tout nouveau sur un chemin de production.

Qui devrait choisir quoi

Choisissez GPT-6 Astra si votre travail se déroule sur un horizon long et de bout en bout — codage agentique, automatisation du terminal, tâches de recherche ou d'utilisation de l'ordinateur qui s'exécutent sur de nombreuses étapes et coûtent plus en jetons émis qu'en contexte. D'après les données indépendantes, il termine la même évaluation avec environ un tiers des jetons de sortie et revient à environ 57 % moins cher par tâche terminée, et il arrive en tête sur Terminal-Bench 4.0 à la fois dans la mesure du fournisseur et dans la mesure indépendante. Établissez votre budget par tâche plutôt que par jeton, et considérez 272 000 jetons d'entrée comme une limite stricte : au-delà, une requête sur ce modèle est re-tarifée selon la règle propre du fournisseur pour l'ensemble de la requête.

Choisissez Claude Fable 5.1 si votre charge de travail relit un large préfixe stable — une longue invite système, un dépôt, un ensemble de documents — au fil de nombreux tours, car une lecture de cache quatre fois moins chère se répercute cumulativement sur chacun d'eux, et le calcul ci-dessus montre qu'elle transforme une tâche à 5,70 $ en une tâche à 1,95 $. C'est aussi le choix qui s'impose si vous voulez le débit mesuré plus élevé et un premier jeton plus rapide, si votre inférence doit s'exécuter dans Google Cloud, ou si un engagement de retrait daté compte pour l'approvisionnement. Il est au niveau de GPT-6 Astra sur l'indice composite et sur l'indice des agents de codage, et il présente le meilleur argument rapporté par le fournisseur sur Humanity's Last Exam, GDPval et CursorBench — des benchmarks pour lesquels OpenAI ne publie aucun chiffre comparable, alors considérez cela comme une lacune dans les preuves plutôt que comme une victoire démontrée.

Et la réponse qu'une page comparative vous doit lorsqu'elle est vraie : pour de nombreuses équipes, la recommandation honnête n'est ni l'un ni l'autre. La documentation d'Anthropic elle-même pour Claude Fable 5.1 indique que, pour la plupart des charges de travail, vous devriez commencer par Claude Opus 5 et ne recourir à Fable 5.1 que lorsque vos évaluations sur Opus 5 à effort plus élevé restent encore insuffisantes. Claude Opus 5 coûte 5,00 $ en entrée et 25,00 $ en sortie — soit la moitié de chacun de ces deux modèles sur les deux lignes. Si l'avantage de lecture du cache par quatre ou l'efficacité de jetons trois fois supérieure ne décrit pas votre charge de travail, le surcoût du modèle phare vous achète une capacité dont vous n'avez pas établi avoir besoin, et le moyen le moins cher de le savoir est de faire passer une tâche réelle par ces deux modèles et un niveau en dessous, sur une seule clé, avant de vous engager pour l'un ou l'autre.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement