
Claude Sonnet 5.5 vs Claude Fable 5.1 : le modèle bon marché a trois points d'avance
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 983 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 196 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Claude Sonnet 5.5 est arrivé le 28 septembre 2026 à 2,00 $ par million de jetons d'entrée et 10,00 $ par million de jetons de sortie. Claude Fable 5.1, le modèle de classe Mythos que le fournisseur a livré le 1er septembre, se situe à 10,00 $ et 50,00 $ sur ces deux mêmes lignes. Le résumé tentant est que Fable 5.1 est le plus cher, et donc le meilleur, or sur l'Artificial Analysis Intelligence Index, l'ordre est inverse : Claude Sonnet 5.5 obtient 56 et Claude Fable 5.1 obtient 53. Ce n'est pas un artefact d'arrondi, et ce n'est pas non plus toute l'histoire, car le même évaluateur les place à moins de trois cents par tâche l'un de l'autre sur la même suite — 7,60 $ contre 7,63 $. Une différence d'un facteur cinq sur la grille tarifaire a presque disparu au moment où une tâche est terminée. Ce qui reste, ce sont des différences de forme plutôt que de score, et choisir entre ces deux modèles est surtout une question de la forme que présente votre charge de travail.
Deux grilles tarifaires, et la seule ligne où l’écart n’est pas quintuple
La comparaison par token est frappante et ne nécessite aucune interprétation.
• Entrée — Claude Sonnet 5.5 à 2,00 $ par million de tokens contre Claude Fable 5.1 à 10,00 $, une différence d'un facteur cinq
• Sortie — 10,00 $ contre 50,00 $ par million, là encore exactement cinq fois moins.
• Lecture du cache — 0,20 $ contre 0,25 $ par million. C'est la ligne qui supporte les longues exécutions d'agents, et la remise s'effondre de 5× à 20 %
• Écriture de cache — 2,50 $ contre 12,50 $ par million pour la fenêtre standard de cinq minutes, l’écart le plus important sur l’une ou l’autre des cartes
• Batch — le mode batch d'Anthropic ne s'applique ni à l'une ni à l'autre de ces deux cartes comme c'est le cas pour celle de Fable 5.1 : Fable 5.1 a été lancé avec une tarification batch réduite de moitié, à $5.00 en entrée et $25.00 en sortie. Consultez la ligne batch sur la propre page de tarification d'Anthropic avant de supposer qu'elle vaut pour toute la famille
• Contexte et plafond — 1 000 000 de tokens de contexte et 128 000 tokens de sortie maximale pour les deux. Sur l'API Message Batches, Claude Sonnet 5.5 prend en charge jusqu'à 300 000 tokens de sortie derrière l'en-tête bêta output-300k-2026-03-24, ce qui représente une véritable différence de plafond pour la génération en masse, et non un argument marketing
Il y a un argument modeste en faveur de Claude Sonnet 5.5 que la grille tarifaire minimise. Anthropic indique que le modèle a généralement besoin de bien moins de tokens que son prédécesseur pour accomplir le même travail, ce qui, selon la société, représente jusqu’à 30 % de coût en moins par tâche. Il s’agit d’une affirmation d’un fournisseur à propos d’une comparaison différente — Sonnet 5.5 face à Sonnet 5 — et ce n’est pas une preuve concernant cette confrontation. C’est toutefois le mécanisme qui explique ce qu’a constaté la mesure indépendante.
Où va l’écart de prix quintuple
Artificial Analysis a exécuté les deux modèles le 29 septembre 2026 sous un même harnais et une seule étiquette de configuration, « Adaptive Reasoning, Max Effort, Default Fallback », sur l'Intelligence Index v4.3. Les deux chiffres phares sont 56 pour Claude Sonnet 5.5 et 53 pour Claude Fable 5.1 — le modèle le moins cher devançant l'autre d'environ trois points sur une échelle où le même évaluateur place le modèle médian à 26. Tous deux sont étiquetés comme des modèles de fournisseur sur la même page : il s'agit donc d'un seul instrument et d'un seul instantané, et non de deux.
Puis la colonne des coûts, et la raison pour laquelle ce duo est intéressant plutôt qu'évident. Lors de la même exécution d'index, Claude Sonnet 5.5 coûte 7,602633 $ par tâche et Claude Fable 5.1 coûte 7,629706 $. Vingt-sept millièmes de dollar d'écart. C'est dans la décomposition que cela devient étrange : le seul volet d'entrée de Claude Fable 5.1 s'élève à 3,73 $ par tâche, contre une composante d'entrée nettement plus faible pour Sonnet 5.5, et ses seuls jetons de raisonnement coûtent 2,36 $ par tâche. Le modèle cinq fois moins cher par jeton n'est pas du tout moins cher par tâche terminée.
La cause est le volume, et les deux modèles échouent dans des directions opposées.
• Tokens de sortie sur l’ensemble de la suite d’index — Claude Sonnet 5.5 a généré 410 577 501 contre les 188 465 663 de Claude Fable 5.1, sur une suite où la médiane suivie est de 88 millions. Les deux se situent bien au-dessus de la médiane ; Sonnet 5.5 représente plus du double de Fable 5.1 et près de cinq fois la médiane
• Tokens de sortie par tâche — 192,838 pour Sonnet 5.5 contre 78,111 pour Fable 5.1, avec une part de raisonnement de 142,386 contre 47,240. Sonnet 5.5 réfléchit environ trois fois plus longtemps par tâche
• Tokens d'entrée sur l'ensemble de la suite d'index — 18,5 milliards pour Sonnet 5.5 contre 5,6 milliards pour Fable 5.1. Sonnet 5.5 en a lu trois fois plus, ce qui est le chiffre le plus discret des deux et celui qui absorbe le tarif d'entrée le moins cher
• Prix mixte pour une répartition 7:2:1 entrée / lecture de cache / sortie — 1,54 $ pour Sonnet 5.5 contre 7,17 $ pour Fable 5.1. C’est la ligne qui correspond à la grille tarifaire, et c’est la ligne qui décrit une charge de travail avec des sorties courtes et bien délimitées
Si l’on met tout cela ensemble, le constat honnête est le suivant : l’écart de prix mixte est réel et l’écart par tâche ne l’est pas. Lequel des deux chiffres décrit votre facture dépend entièrement de si vos tâches se terminent ou divaguent, et la suite d’indices est conçue pour les laisser divaguer.
L'échelle de l'effort est la véritable décision
Les deux modèles exposent un paramètre d’effort — low, medium, high, xhigh, max — et tous deux ont été mesurés à chaque échelon le 29 septembre 2026. C’est la partie de la comparaison qu’aucune grille tarifaire ne peut exprimer, car le modèle bon marché à un échelon inférieur surpasse largement le modèle coûteux à un échelon inférieur, et le modèle coûteux ne se démarque que près du sommet.
• Effort faible — Claude Sonnet 5.5 obtient 35,84 à 0,41 $ par tâche ; Claude Fable 5.1 obtient 46,82 à 2,37 $. Au plus bas de l'échelle, le modèle coûteux devance de onze points, pour près de six fois le prix
• Effort moyen — 40,74 à 0,59 $ contre 48,92 à 2,98 $. Fable 5.1 conserve une avance de huit points pour un coût cinq fois supérieur
• Effort élevé — 46,74 à 1,08 $ contre 51,15 à 3,91 $. L'écart se réduit à quatre points et demi ; le ratio de coût se maintient à environ 3,6×
• Effort Xhigh — 51,85 à 2,74 $ contre 53,20 à 5,98 $. À un point et un tiers d’écart, à 46 % du prix
• Effort maximal — 55,98 à 7,60 $ contre 53,35 à 7,63 $. L'ordre s'inverse et le coût converge à un demi pour cent près.
Lisez les quatrième et cinquième lignes ensemble et la forme de cette confrontation apparaît. Claude Sonnet 5.5 en xhigh atteint 51,85 — à un point et demi d’indice près du meilleur score de Claude Fable 5.1, quel que soit l’effort — pour 2,74 $ la tâche contre 7,63 $. Si votre travail doit être près de la frontière plutôt qu’à la frontière même, cette ligne est toute la réponse, et elle permet d’économiser 64 % par tâche terminée. Poussez Sonnet 5.5 au maximum et vous achetez trois points de plus pour 2,8 fois le prix, ce qui vous amène à la même facture que le maximum de Fable 5.1, avec un score marginalement meilleur et un profil de raisonnement très différent.
Cette dernière phrase mérite d’être précisée, car elle est suffisamment contre-intuitive pour qu’on la vérifie deux fois. À effort maximal équivalent, le modèle dont la grille tarifaire est cinq fois moins chère coûte autant par tâche que le modèle à la grille chère. Il y parvient en émettant 2,5 fois plus de jetons de sortie, dont la part de raisonnement est trois fois plus importante. La documentation d’Anthropic explique une partie du mécanisme : le tokeniseur a changé, et le même texte produit environ 30 % de jetons en plus sur Claude Sonnet 5.5 que sur les modèles antérieurs. C’est un facteur contributif parmi plusieurs, et c’est un rappel utile que les décomptes de jetons de sortie ne sont pas comparables d’une révision de tokeniseur à l’autre sans le préciser.
La latence est ce qui fait que les deux cessent de se ressembler
La convergence des scores ne s’étend pas au temps. Sur le même instantané du 2026-09-29, Artificial Analysis rapporte un temps jusqu’au premier token de 254,41 secondes pour Claude Fable 5.1 et de 2,80 secondes pour Claude Sonnet 5.5 sur la tranche de prompts longs, avec des vitesses de sortie médianes de 67,9 et 49,4 tokens par seconde respectivement. Cela représente une différence de deux ordres de grandeur dans le temps qu’un appelant attend avant que quoi que ce soit n’arrive, et c’est le chiffre le plus déterminant sur le plan opérationnel de cette comparaison.
Les deux chiffres doivent être accompagnés de leurs qualificatifs clairement énoncés. Le TTFT de Fable 5.1 est mesuré sur le type de prompt long ; la tranche de prompts moyens de l’évaluateur pour le même modèle le même jour est de 117,60 secondes, de sorte que le chiffre de 254 secondes correspond à la queue de distribution et non à une constante. Les 2,80 secondes de Sonnet 5.5 correspondent à sa médiane globale, la bande de variance propre à l’évaluateur allant de 1,91 seconde au cinquième percentile à 4,23 au quatre-vingt-quinzième percentile. La documentation de la plateforme d’Anthropic décrit la latence comparative de Fable 5.1 comme plus lente et celle de Sonnet 5.5 comme rapide, ce qui est cohérent quant à la tendance sans constituer une mesure.
Notre propre infrastructure fournit une troisième lecture, car nous routons Claude Fable 5.1 et mesurons ce que nous servons. Sur les sept jours précédant le 28 septembre, sur le trafic propre d'OrcaRouter, Claude Fable 5.1 affiche un premier token médian à 6 973 millisecondes, avec un 95e percentile à 10,0 secondes, une vitesse de sortie de 65,8 tokens par seconde et un taux d'erreur de 0,349 %. Ce p50 est plus de cent fois plus rapide que le chiffre de l'évaluateur pour un prompt long, ce qui n'est pas tant une contradiction qu'une définition des termes : un premier token côté développeur sur un prompt court et le premier token d'un benchmark sur un prompt long sont des mesures de choses différentes. Quiconque planifie en fonction du chiffre du classement doit savoir lequel des deux il achète.

L’honnêteté du sourcing, la rétention et la migration dont personne ne parle
Les tableaux de benchmarks des fournisseurs et les évaluations indépendantes sont des instruments différents et ne devraient jamais être soustraits l’un de l’autre. Le tableau de lancement d’Anthropic pour Claude Sonnet 5.5 indique Terminal-Bench 4.0 à 70,6 %. Artificial Analysis, avec son propre harnais, rapporte 63,6 % pour le même modèle sur une évaluation du même nom. Pour Claude Fable 5.1, l’écart va dans l’autre sens : Anthropic a rapporté 55,8 % au lancement et le harnais indépendant affiche 52,0 %. Aucune des deux paires n’est une correction de l’autre. Jugez chacun selon ses propres termes, et privilégiez l’instrument indépendant lorsque vous décidez où envoyer le trafic de production.
La posture de conservation des données diffère également, et c’est le genre de différence qui n’apparaît que lors d’un examen des achats. Anthropic indique que Claude Sonnet 5.5 est disponible avec une conservation nulle des données, la même posture qu’elle a adoptée avec Opus 5.5 et Sonnet 5. Les documents de lancement de Claude Fable 5.1 décrivent une politique incrémentale d’utilisation des données qui coexiste avec lui, ainsi qu’un déploiement distinct dans le cadre de Project Glasswing comportant une fenêtre de conservation par défaut de 30 jours pour la surveillance de la sécurité, le dispositif de conservation nulle étant décrit comme l’état provisoire. Si votre équipe est soumise à un examen du traitement des données, cette distinction constitue un véritable poste à part entière plutôt qu’une note de bas de page, et il vaut la peine de lire la page de politique actuelle d’Anthropic plutôt que n’importe quel résumé de celle-ci, y compris celui-ci.
Le coût de la migration est asymétrique d’une manière qui apparaît rarement dans la couverture du lancement. Passer à Claude Sonnet 5.5 n’est pas un simple changement de chaîne de modèle. Le guide de migration d’Anthropic indique que les valeurs non par défaut de temperature, top_p et top_k renvoient désormais une erreur 400, qu’un tool_choice défini sur any ou sur un outil nommé est purement et simplement rejeté, et que thinking: {"type": "disabled"} doit devenir between_tools si vous fonctionniez avec la réflexion initiale désactivée. Le type between_tools est accepté avec un effort low, medium et high, et renvoie une erreur 400 avec xhigh ou max. Sur l’API Claude et Google Cloud, l’utilisation de l’ordinateur n’est prise en charge que via le toolset computer_toolset_20260801 ; l’ancien computer_20251124 est refusé. Aucune de ces contraintes ne s’applique à un passage à Claude Fable 5.1, qui est une mise à niveau au sein de la même famille depuis Fable 5 et comporte trois changements incompatibles qui lui sont propres. Si vous comparez les deux comme cibles de migration parallèles, le modèle le moins cher est le plus coûteux à adopter.

Lequel mettre où ?
La décision qui découle des chiffres porte sur la part de votre trafic qui est bien délimitée.
• Travail délimité, à fort volume et piloté par des outils — Claude Sonnet 5.5, à effort xhigh si vous devez vous rapprocher de la frontière. Il se situe un point et demi d'indice derrière le meilleur de Fable 5.1, pour 64 % de moins par tâche accomplie, il renvoie son premier token en environ trois secondes, et sa ligne d'écriture de cache moins coûteuse rend abordable un préfixe de contexte reconstruit
• Travail ouvert et à long horizon, où une mauvaise réponse coûte cher — Claude Fable 5.1. Il égale le score maximal de Sonnet 5.5 pour le même coût par tâche, tout en y parvenant avec un tiers des jetons de raisonnement et un quart de l'entrée, ce qui compte lorsque la tâche est réellement ouverte et que la forme de la suite d'évaluation ressemble à votre problème
• Surfaces interactives contraintes par la latence — Claude Sonnet 5.5, et l'écart est loin d'être mince. Sur l'instantané de l'évaluateur lui-même, l'écart au premier token atteint deux ordres de grandeur pour le type de prompt long, et le relevé sur prompt moyen ne le réduit qu'à environ 118 secondes. Une surface de chat ne peut pas être construite sur le chiffre de Fable 5.1 sans traitement par lots ou streaming pour le contourner.
• Génération en masse avec de longues sorties — Claude Sonnet 5.5, en raison du plafond de sortie de 300 000 jetons disponible sur l’API Message Batches derrière l’en-tête output-300k-2026-03-24, contre un plafond de 128 000 jetons partout ailleurs. Confirmez votre tarification par lots avant de vous engager ; le tarif par lots n’est pas identique entre les deux cartes.
• Travaux qui doivent couvrir plusieurs comptes ou transmettre un raisonnement entre systèmes — lisez la documentation d'Anthropic sur la conservation de la réflexion avant l'un ou l'autre. Les blocs de réflexion sont liés au modèle et au compte qui les a produits, et Sonnet 5.5 est le premier Sonnet à être livré avec des classificateurs qui empêchent l'extraction du raisonnement. C'est à la fois une fonctionnalité de conformité et une contrainte
• Charges de travail réglementées ou sensibles à la rétention — vérifiez la politique en vigueur plutôt que les informations de lancement. Claude Sonnet 5.5 a été lancé avec une rétention nulle des données disponible ; la documentation de Fable 5.1 décrit une politique progressive avec une fenêtre de 30 jours par défaut sur un déploiement et une rétention nulle comme état intermédiaire

Sur OrcaRouter, Claude Fable 5.1 et Claude Sonnet 5 se trouvent tous deux derrière un seul identifiant au prix catalogue du fournisseur, avec 0 % de marge, donc seule la ligne de lecture du cache et le changement de tokenizer font bouger votre facture lorsque vous passez de l'un à l'autre. Claude Sonnet 5.5 n'est pas encore une route sur notre plateforme — le modèle a un jour — donc pour être honnête, aujourd'hui vous y accédez via l'API propre d'Anthropic. Quiconque exécute Fable 5.1 chez nous peut estimer le coût du changement le jour où il arrive sans rien modifier d'autre à son intégration, et en attendant le basculement automatique entre fournisseurs est ce qui permet d'essayer sans risque un modèle aussi récent sur un chemin qui doit rester disponible.
Le verdict est plus étroit que ne le laisse supposer l'écart de prix. Claude Sonnet 5.5 est le meilleur choix par défaut pour presque toutes les tâches délimitées : il obtient trois points de plus sur l'indice indépendant, il répond en quelques secondes et, à xhigh, il arrive à un point et demi du plafond de Fable 5.1 pour bien moins de la moitié du coût par tâche. Claude Fable 5.1 conserve un véritable argument, et c'est celui que met en avant le tableau comparatif d'Anthropic lui-même : quand le travail est ouvert et que le coût de se tromper dépasse le coût de réfléchir plus longtemps, cinq fois le prix d'entrée achètent un modèle qui atteint le même score sans dépenser trois fois les tokens de raisonnement pour y parvenir. Choisissez selon la forme de la tâche, non selon la taille de la grille tarifaire, car au sommet de l'échelle d'effort, ces deux modèles vous facturent la même chose.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
