Carte de titre principale pour « Claude Fable 5.1 vs Claude Fable 5 » : panneau de gauche « Claude Fable 5.1 » (Anthropic, API fermée, 10,00 $ / 50,00 $ par million, AA Intelligence Index 53) et panneau de droite « Claude Fable 5 » (Anthropic, API fermée, 10,00 $ / 50,00 $ par million, contexte de 1 M), avec le titre « Même prix. Un plafond agentique plus élevé. » et le logo OrcaRouter incrusté en bas à droite.
Guides & Insights

Claude Fable 5.1 vs Claude Fable 5 : ce que la mise à jour de son propre produit phare apporte réellement à Anthropic

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Fable 5.1 est le fleuron actuel d'Anth​ropic, lancé le 1er septembre 2026, et la confrontation qui compte le plus pour la plupart des équipes est celle qu'Anth​ropic a elle-même mise en place : Claude Fable 5.1 face à Claude Fable 5, le fleuron du 9 juin qu'il remplace. Le prix est identique — 10,00 $ par million de jetons d'entrée et 50,00 $ par million de jetons de sortie pour les deux — tout comme la fenêtre de contexte de 1 M de jetons. Ce qui a changé, c'est la nature du travail agentique de longue durée : les propres chiffres d'Anth​ropic montrent que Fable 5.1 fait plus que doubler Fable 5 sur son benchmark d'agents scientifiques le plus difficile, et les reportages de cette semaine sur la manière dont les entreprises traitent la famille Fable en matière de conservation des données donnent à cette mise à jour un second avantage, plus tranchant, pour quiconque doit choisir entre les deux aujourd'hui.

Une note sur les dates et les sources, d’emblée : Claude Fable 5.1 est sorti le 1er septembre, donc le modèle lui-même a deux semaines, ce n’est pas une nouvelle de dernière minute. Ce qui est d’actualité, c’est l’information du 14 septembre 2026 — attribuée à The Information — selon laquelle Nvidia, Palantir et Booz Allen restreignent leur utilisation de la famille Fable d’Anthropic en raison de préoccupations concernant la conservation de données d’entreprise sensibles, et selon laquelle Anthropic a introduit en juin des journaux d’utilisation à fenêtre glissante de 30 jours pour la surveillance de sûreté, avec, pour le client, l’option de stocker lui-même ces journaux, option « encore susceptible d’être révoquée ». Cette information est attribuée à une source et n’a pas encore été confirmée de manière indépendante. Tout ce qui est étiqueté ci-dessous comme rapporté par le fournisseur provient de la propre fiche de benchmarks d’Anthropic et n’a pas été reproduit par un tiers neutre.

La fiche technique, dimension par dimension

• Prix — Claude Fable 5.1 : 10,00 $ en entrée / 50,00 $ en sortie par million de tokens, identique à Claude Fable 5. Aucun des deux prix n'a bougé lors de l'actualisation.

• Entrée mise en cache — Claude Fable 5.1 : 0,25 $ par million de jetons, en baisse de 75 % par rapport aux 1,00 $ de Claude Fable 5. Écritures de cache : 12,50 $ (5 minutes) / 20 $ (1 heure) ; mode par lots : 5 $ / 25 $.

• Contexte et sortie — les deux disposent d’une fenêtre d’entrée de 1 M de tokens et de jusqu’à 128 K tokens de sortie ; les deux acceptent des entrées texte et image ; les deux reposent sur la même surface de raisonnement adaptatif avec un réglage d’effort allant de faible à max.

• Score indépendant — sur la version actuelle de l’Intelligence Index d’Artificial Analysis, Claude Fable 5.1 obtient 53, au premier rang des 201 modèles suivis, avec 67,2 jetons de sortie par seconde et 7,63 $ par tâche de l’indice. Le chiffre de l’indice à l’échelle du lancement de Claude Fable 5 (62) est antérieur à la réévaluation de septembre et n’est pas comparable ; nous ne citons donc pas de chiffre à l’échelle actuelle pour ce dernier.

• Benchmarks du fournisseur — Anth​ropic rapporte Claude Fable 5.1 à 52,6 % sur Terminal-Bench-Science 0.1 contre 24,7 % pour Claude Fable 5 ; 55,8 % sur Terminal-Bench 4.0 contre 42,0 % ; 31,4 % sur AutomationBench contre 17,1 % ; et 73,4 % sur CursorBench 3.2.0 contre 70,5 %.

• Publié — Claude Fable 5.1 le 1er septembre 2026 ; Claude Fable 5 le 9 juin 2026.

Là où le rafraîchissement est réellement un rafraîchissement

L’astuce phare du lancement de Fable 5.1 est que rien n’a bougé sur la grille tarifaire et que presque tout a bougé sur la feuille des benchmarks. Les gains se concentrent dans le travail agentique à long horizon utilisant des outils — Terminal-Bench-Science 0.1 fait plus que doubler, passant de 24,7 % à 52,6 %, Terminal-Bench 4.0 grimpe de 42,0 % à 55,8 %, AutomationBench passe de 17,1 % à 31,4 %, soit près du double. Sur Humanity's Last Exam, Anthropic annonce 60,9 % sans outils et 65,0 % avec, contre 57,8 % et 63,8 % pour Claude Fable 5. À lire comme des directions de progression : il s’agit du propre tableau du fournisseur, et les plus grosses affirmations portant sur un chiffre unique décrivent le modèle frère à accès restreint, Claude Mythos 5.1, qui partage les mêmes poids derrière des garde-fous plus stricts.

A two-column scoreboard titled ‘Claude Fable 5.1 vs Claude Fable 5 — the scoreboard’. Left column ‘Claude Fable 5.1’: ‘Price $10.00 / $50.00 per 1M’, ‘Cache read $0.25 per 1M’, ‘Terminal-Bench-Science 0.1: 52.6%’, ‘Terminal-Bench 4.0: 55.8%’, ‘AutomationBench: 31.4%’, ‘CursorBench 3.2.0: 73.4%’. Right column ‘Claude Fable 5’: ‘Price $10.00 / $50.00 per 1M’, ‘Cache read $1.00 per 1M’, ‘Terminal-Bench-Science 0.1: 24.7%’, ‘Terminal-Bench 4.0: 42.0%’, ‘AutomationBench: 17.1%’, ‘CursorBench 3.2.0: 70.5%’. Footer: ‘Benchmarks vendor-reported, per Anthropic’s September 1 announcement. AA figure per Artificial Analysis, current index version.’ The OrcaRouter logo is composited bottom-right.

Le deuxième levier est le coût, et il compte plus que n'importe quel benchmark pris isolément. Le coût de l'entrée mise en cache est passé de 1,00 $ à 0,25 $ par million de tokens, et c'est dans les longues exécutions agentiques que la relecture domine : les sorties d'outils, le contenu des fichiers et les tours précédents sont renvoyés encore et encore. Anthropic estime un coût effectif inférieur d'environ 25 % sur les charges de travail typiques facturées au token et jusqu'à 45 % sur celles hautement agentiques — une estimation du fournisseur, mais le changement de prix sous-jacent est vérifiable sur la grille tarifaire. Un agent à long horizon qui relit un contexte de 100 K tokens cinquante fois au cours d'une tâche paie 5,00 $ en lectures de cache avec la tarification de Claude Fable 5 et 1,25 $ avec celle de Claude Fable 5.1. À l'échelle d'une flotte d'agents, cette ligne cesse d'être une erreur d'arrondi.

Le troisième changement est celui que les utilisateurs de la génération précédente ressentent en premier : le classificateur de sécurité. Les développeurs ont surnommé l’ancien comportement « la dépression de Fable » — payer le prix d’un modèle phare pour des sorties discrètement redirigées vers un modèle plus faible lorsque le classificateur signalait des requêtes bénignes. Anthropic affirme que les garde-fous cybernétiques de Fable 5.1 génèrent désormais environ 60 % d’interventions en moins par session de Claude Code, et que les garde-fous biologiques se déclenchent 85 % moins souvent sur des requêtes bénignes qu’au lancement de Fable 5. Si vos reproches à l’égard du modèle de juin concernaient les passations en cours de tâche, c’est la mise à niveau qui y répond directement.

L'histoire de rétention de cette semaine, et son effet sur la décision

Les informations publiées le 14 septembre sont l'élément qui change le calcul pour les entreprises, parce que c'est dans la famille Fable que se situe le modèle le plus capable d'Anthropic — et parce que la posture de conservation des données est exactement le genre de chose qu'un acheteur réglementé ne peut pas balayer d'un revers de main. Comme rapporté, Anthropic a introduit en juin des journaux d'utilisation glissants sur 30 jours pour la surveillance de la sécurité ; les clients ont été informés qu'ils pouvaient stocker eux-mêmes ces journaux à la place ; et les informations indiquent que cette option « peut encore être révoquée ». Palantir est décrit comme retenant Fable jusqu'à ce qu'il obtienne des garanties irrévocables de non-conservation des données, Nvidia comme limitant Fable à des travaux moins sensibles, et Booz Allen comme l'excluant de travaux de cybersécurité propriétaires. Tout cela relève d'informations attribuées, rien n'est confirmé par les entreprises citées, et son effet pratique est inégal : certains clients s'en soucieront beaucoup, et d'autres pas du tout.

Il vaut mieux être précis sur ce que cela change pour la décision entre 5.1 et 5. Le sujet de la rétention s’applique à toute la famille Fable — ce n’est pas une nouvelle différence entre les deux modèles, puisque Fable 5 et Fable 5.1 partagent la même posture de rétention. Ce que cela change, en revanche, c’est le calcul pondéré par le risque : si votre charge de travail est suffisamment sensible pour qu’une option de stockage autonome révocable soit éliminatoire, alors aucun des deux modèles ne franchit la barre aujourd’hui, et la discussion relève de la feuille de route Enterprise Frontier Safeguards (EFS) d’Anth​ropic, décrite comme déployant progressivement la rétention zéro des données à partir de l’automne 2026 pour les clients éligibles. Si votre charge de travail n’est pas aussi sensible, les informations sur la rétention ne devraient pas vous dissuader de procéder à une véritable amélioration des performances — mais elles devraient figurer au dossier de décision plutôt que d’être découvertes plus tard.

Screenshot of the Artificial Analysis model page for Claude Fable 5, captured September 15, 2026, showing the model’s 1M context window, closed API status, and the intelligence and price analysis summary. AA index figures are from the current, restated index version.

Qui devrait choisir quoi

Choisissez Claude Fable 5.1 lorsque le coût d'une réponse erronée ou abandonnée domine le coût des tokens : recherche agentique sur un horizon long, usage intensif d'outils, tout ce qui vit dans Claude Code, et les charges de travail où une lecture de cache 75 % moins chère modifie votre économie unitaire. Restez sur Claude Fable 5 lorsque votre trafic est court, à tir unique et tolérant au débit — le prix est identique et les scores de l'ancien modèle restent toujours de niveau frontière — ou lorsque vous êtes à mi-contrat et que la charge de migration est bien réelle. Le juste milieu honnête consiste à ne pas choisir du tout : les deux modèles se trouvent derrière la même surface d'API Anthropic, et si vous les appelez via un point de terminaison unique, vous pouvez passer à Claude Fable 5.1 lorsqu'une tâche exige le plafond de raisonnement et laisser la paire, moins chère à prix identique, partager le basculement sans second contrat.

Sur OrcaRouter, Claude Fable 5 et Claude Fable 5.1 sont tous deux disponibles aux prix catalogue de leurs fournisseurs, sans marge, donc les 10 $ / 50 $ ci-dessus correspondent au montant de la facture, et les changements de prix propres à Anth​ropic sont répercutés le jour même plutôt que d'être absorbés dans une marge de revendeur. Tester la mise à jour par rapport à votre propre trafic revient à modifier une règle de routage avec basculement automatique — les deux modèles partagent une seule clé, donc le coût de changement est quasi nul, et la fusion de modèles permet à un panel de répondre ensemble lorsqu'une tâche est suffisamment importante pour que l'on souhaite plus d'un avis.

Screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5), captured September 15, 2026, showing the model’s $10.00 input and $50.00 output price per 1M tokens passed through from Anthropic, its 1M-token context window, and its capability badges.

En bref : Claude Fable 5.1 est au même prix que Claude Fable 5, environ deux fois plus performant sur les benchmarks de science agentique mis en avant par Anthropic, 75 % moins cher sur les lectures de cache qui dominent les longues sessions, et nettement moins susceptible de transmettre votre requête à un modèle plus faible en cours de tâche. Le reporting sur la rétention du 14 septembre est réel et mérite d'être pris en compte si vous êtes une entreprise avec des exigences strictes en matière de données — mais il s'applique à la famille, pas à cette mise à niveau spécifique, et il devrait être une ligne dans une décision que les benchmarks et les calculs de cache ont déjà tranchée.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement