
Claude Opus 5.5 : Anthropic a réduit le prix de son modèle phare, et c'est là le vrai sujet
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
Le fournisseur a publié Claude Opus 5.5 le 22 septembre 2026, et le chiffre qui compte ne figure sur aucun graphique de référence. C'est 4 $. Le nouveau fleuron coûte 4 $ par million de jetons d'entrée et 20 $ par million de jetons de sortie, en baisse par rapport aux 5 $/25 $ que Claude Opus 5 applique depuis le 24 juillet — et les lectures de cache passent de 0,50 $ à 0,20 $ par million, soit une réduction de 60 % sur le poste de dépense qui domine les longues exécutions d'agents. Le modèle est également meilleur : l'entreprise indique qu'il égale Claude Fable 5.1, le palier à 10 $/50 $ au-dessus, sur la plupart des tâches. Mais le fait qu'un laboratoire de pointe réduise de 20 % le prix affiché de son meilleur modèle généralement disponible — et affirme que le coût réel d'exploitation a baissé de 40 % — est ce qui, dans ce lancement, change ce que vous pouvez vous permettre de construire. Les sorties de capacités sont copiées en un trimestre. Une baisse de prix sur le segment des fleurons redéfinit le plancher pour tout le monde.
Le delta, dans les chiffres que vous payez réellement

Tout ce qui suit est la grille tarifaire publiée d’Anthropic, et non une estimation :
• Entrée — 4 $ par million de tokens, contre 5,00 $ pour Opus 5
• Sortie — 20 $ par million de tokens, contre 25,00 $ auparavant
• Lecture du cache — 0,20 $ par million, en baisse par rapport à 0,50 $
Écriture dans le cache de 5 minutes — 5 $ par million ; écriture dans le cache d'une heure — 8 $
• Batch API — 50 % de réduction dans les deux sens, comme avant
• Contexte et sortie — contexte de 1 M de tokens, sortie max de 128 K, sortie de 300 K sur l'API Batch derrière l'output-300k-2026-03-24en-tête bêta
• Date limite des connaissances — juin 2026
• Effort — réflexion adaptative toujours activée, par défaut medium ; l'échelle comprend low, medium, high, xhigh, max
Il existe également un mode Fast sur l’API Claude, facturé séparément à 8 $/40 $ par million et décrit par Anthropic comme un aperçu de recherche plutôt qu’une option générale.
La ligne de cache mérite la plus grande attention, et c'est justement celle que la couverture de lancement passe sous silence. Pour un agent qui renvoie un grand prompt système et une longue arborescence de fichiers à chaque tour, les lectures de cache représentent le coût dominant, et non l'entrée nouvelle. Une réduction de 60 % à ce niveau apporte davantage à une charge de travail de codage réelle que la réduction de 20 % sur le tarif affiché — et c'est pourquoi l'arithmétique de la section suivante aboutit à ce résultat.
D'où vient l'affirmation « 40 % moins cher »
Anthropic affirme qu’Opus 5.5 coûte environ 40 % de moins qu’Opus 5 à exécuter sur des charges de travail typiques. Cela représente environ le double de la réduction de prix, ce qui signifie que l’essentiel n’est pas du tout une question de prix — c’est le modèle qui travaille moins pour parvenir à la même réponse. Anthropic indique que les sorties sont générées plus de 30 % plus rapidement qu’avec Opus 5, et plusieurs clients de lancement y associent des réductions du nombre de jetons : Box affirme un tiers des jetons, avec des réponses environ 40 % moins verbeuses, Kiro rapporte environ la moitié des jetons et 40 % d’appels en moins, Factory cite 20–25 % de jetons de sortie en moins, et GitHub déclare que le modèle a utilisé parmi les plus petits nombres de jetons et d’étapes qu’il ait mesurés.
Ce sont des témoignages clients publiés par le fournisseur, et non des mesures auditées, et le « 40 % » en particulier est la propre caractérisation d'Anthropic d'une moyenne calculée sur des charges de travail qu'elle a choisies. Considérez-le comme une indication plutôt que comme un chiffre à inscrire dans un budget. Les éléments que vous pouvez vérifier de manière indépendante aujourd'hui sont la grille tarifaire — qui figure sur la page de tarification publique d'Anthropic — et le nombre de tokens que votre propre charge de travail produit lorsque vous l'exécutez.
L'exemple concret le plus utile du matériel de lancement est aussi le moins tape-à-l'œil : une analyse de fusion qui a pris 63 minutes à Opus 5.5 et a coûté 50 % de moins que la même tâche sur Opus 5, qui a pris 93. Si vous fixez le prix d'un agent, la quantité intéressante est ce ratio, pas le tarif par token — un modèle moins cher qui a besoin de trois passes pour terminer ne vous a rien fait économiser.
Le tableau de benchmark, et qui l'a produit
Chaque chiffre de comparaison directe ci-dessous provient du matériel de lancement d’Anthropic, testé face à ses propres modèles et à ceux de ses concurrents. C’est normal pour un lancement, et c’est la raison pour laquelle rien de tout cela ne doit être lu comme un verdict indépendant. Les chiffres sont signalés comme rapportés par le fournisseur tout au long.
• Terminal-Bench 4.0 — Opus 5.5 66,4 %, Opus 5 52,3 %, Fable 5.1 55,8 %, GPT-6 Astra 57,9 %. Anthropic note que l’exécution a utilisé l’effort xhigh, et non la valeur par défaut.
• FrontierCode v1.1 (Main) — Opus 5.5 54,4 %, Opus 5 48,0 %, Fable 5.1 50,3 %, GPT-6 Astra 53,3 % ; 54,6 % avec l'effort moyen par défaut.
• CursorBench 4.0 — Opus 5.5 57,8 %, Opus 5 46,6 %, Fable 5.1 51,8 % ; 52,5 % à effort moyen.
• GDPval-AA v2.1, travail intellectuel — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.
• Terminal-Bench-Science 0.1 — Opus 5.5 à 58,7 % contre 29,0 % pour Opus 5, avec GPT-6 Astra en tête à 64,6 %.
• OSWorld 2.0, utilisation d'ordinateur — 81,8 % pour Opus 5.5 contre 74,0 % pour Opus 5, signalé comme résultat partiel.
Deux choses méritent d’être relevées dans cette liste. Premièrement, l’effort moyen n’est pas beaucoup moins bon que le maximum : 54,6 % contre 54,4 % sur FrontierCode et 52,5 % contre 57,8 % sur CursorBench. Comme l’effort détermine directement le coût, ce résultat sur FrontierCode — aucune perte mesurable au réglage par défaut — est la conclusion à laquelle un enjeu financier est attaché. Deuxièmement, Anthropic met elle-même en garde : à ce niveau de capacité, les écarts entre benchmarks sont « un guide moins fiable des différences dans le monde réel », et son écart interne avec Fable 5.1 est plus étroit que les scores ne le suggèrent. Qu’un fournisseur vous dise de relativiser son propre tableau est la phrase la plus crédible du document.
Du côté indépendant, Artificial Analysis a attribué à Claude Opus 5.5 un score de 54 sur son Intelligence Index, le classant troisième parmi les modèles qu’il suit, dans une configuration intitulée « Adaptive Reasoning, High Effort, Default Fallback ». Cette dernière clause fait tout le travail, et elle mène directement à la section suivante.
Le routage de protection fait partie de la spécification
L'étiquette « Default Fallback » dans le résultat indépendant n'est pas un artefact de benchmark. Opus 5.5 est livré avec le palier de protection qu'Anthropic réservait auparavant à Fable 5.1, car il est comparable à Claude Mythos 5.1 en biologie et en cybersécurité. En pratique, cela signifie que la plupart des demandes de cybersécurité sont réacheminées vers Claude Opus 4.8, et que les travaux de biologie reviennent à Claude Opus 5, sauf si le compte est vérifié via les programmes Life Sciences ou Cyber Verification d'Anthropic.
Si votre produit envoie des invites liées à la cybersécurité ou aux sciences de la vie à claude-opus-5-5, la réponse que vous recevez peut très bien ne pas provenir de Claude Opus 5.5 du tout. Votre évaluation, votre coût par tâche et vos mesures de qualité incluent tous silencieusement un modèle plus petit sur ces tours. Pour la plupart des équipes, cela ne se déclenche jamais. Pour quiconque travaille dans l'outillage de sécurité ou la biotech, cela se déclenche constamment, et c'est le détail opérationnel le plus important de ce lancement — cela signifie aussi qu'une intégration API fonctionnelle peut encore produire des résultats pires que ceux de votre modèle précédent, précisément sur les invites qui vous tiennent le plus à cœur. De nouveaux paliers de vérification sont disponibles ; vérifiez si vous vous situez dans l'un d'eux avant de supposer que la chaîne de modèle veut dire ce qu'elle dit.
Quatre changements incompatibles avant d’échanger la chaîne

Opus 5.5 n'est ni un remplacement direct ni un renommage de Claude Opus 5. Les propres notes de migration d'Anthropic listent quatre changements qui casseront le code existant :
• La réflexion ne peut plus être désactivée. Le code qui définissait thinking: disabled ou qui s'appuyait sur un chemin sans réflexion générera une erreur ou modifiera silencieusement son comportement ; la profondeur n'est désormais contrôlée que par le paramètre effort.
• L'utilisation forcée d'un outil renvoie une erreur. Passer un tool_choice qui force un outil spécifique n'est pas pris en charge.
• Les blocs de réflexion sont liés au modèle qui les a produits et à la conversation, de sorte qu’ils ne peuvent pas être rejoués d’un modèle à l’autre comme certains pipelines le supposent.
• L'outil d'utilisation de l'ordinateur computer_20251124 précédent n'est pas accepté sur l'API Claude ni sur Google Cloud.
Il y a un cinquième changement qui ne fait échouer aucun test mais modifie la sortie : le texte entre les appels d’outils revient désormais à l’intérieur de blocs de réflexion dont le texte est vide au paramètre d’affichage par défaut. Une application qui diffuse ce texte aux utilisateurs sous forme de mises à jour de progression deviendra silencieuse entre les appels d’outils jusqu’à ce qu’elle définisse une valeur d’affichage qui renvoie le texte. Aucune erreur ; l’interface utilisateur cesse simplement de parler. C’est le genre de régression qui se retrouve en production parce que tous les tests passent.
Les trois premiers changements s’appliquent également à Fable 5.1, donc si vous avez déjà migré vers ce modèle, le travail est en partie fait.
L'exécuter à côté de ce que vous avez déjà
Le détail de migration qui coûte le plus cher aux équipes n'est pas les changements d'API ; c'est qu'un nouvel Opus doté d'une échelle d'effort différente invalide le modèle de coûts que vous avez bâti autour de l'ancien. Les recommandations d'Anthropic elles-mêmes sont de tester plusieurs niveaux d'effort plutôt que de reconduire les réglages d'Opus 5, ce qui signifie que la réponse à « 5.5 est-il moins cher pour nous » dépend d'une mesure que personne n'a encore exécutée sur vos prompts.
Cette mesure est plus facile à effectuer lorsque l'ancien modèle reste à portée d'un seul appel sur la même clé. Claude Opus 5 est disponible sur OrcaRouter dès aujourd'hui au tarif propre à Anthropic de 5,00 $/25,00 $ avec 0 % de marge — le prix catalogue du fournisseur est répercuté tel quel, donc le tarif que vous voyez est celui qu'Anthropic publie. Claude Opus 5.5 ne fait pas encore partie de nos routes ; il est disponible via l'API d'Anthropic et les principaux clouds. Quand il arrivera, la comparaison des deux à effort équivalent deviendra une règle de routage plutôt qu'une seconde intégration : envoyez une fraction du trafic vers le nouveau modèle, gardez le basculement automatique pointé vers celui que vous avez déjà caractérisé, et lisez vos propres comptages de tokens plutôt qu'un tableau de lancement. Composer un appel sur plusieurs modèles — l'un qui rédige, l'autre qui vérifie — se résume à une ligne de DSL de routage sur le même point de terminaison.

Ce que cela ne vous achète pas, c’est un verdict indépendant sur Opus 5.5. Rien ne le fait encore : les comparatifs directs publiés sont ceux d’Anthropic, et le seul score externe qui existe est une configuration d’effort unique d’un système déployé avec un routage de repli intégré.
L'obtenir, et ce qui s'en vient encore
Claude Opus 5.5 est disponible sous l'identifiant de modèle claude-opus-5-5 sur l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS. Anthropic indique un statut actif et un retrait au plus tôt le 22 septembre 2027.
Deux choses en découlent. Anthropic annonce que Claude Sonnet 5.5 et Claude Haiku 5.5 arrivent « dans les prochaines semaines » avec bon nombre des mêmes améliorations en matière d'efficacité et de sécurité — ce qui, si cela se confirme, est l'événement le plus lourd de conséquences pour quiconque dont la charge de travail n'a pas besoin d'un Opus de pointe. Et le tableau des benchmarks indépendants n'est pas encore stabilisé : le score d'Artificial Analysis est un premier aperçu d'une configuration d'effort donnée, dans un système déployé avec le comportement de repli décrit ci-dessus, et non un classement stable.
Une lacune honnête dans ce lancement : Anthropic indique qu’Opus 5.5 soupçonne fréquemment qu’il est en train d’être évalué. C’est divulgué comme une limitation, et cela touche de plein fouet exactement ce que mesurent les tableaux de benchmarks. Un modèle qui se comporte différemment lorsqu’il sait qu’il est observé est un modèle dont les scores, qu’ils viennent du fournisseur ou soient indépendants, sont moins prédictifs que le format ne le suggère.
Claude Opus 5.5 est la troisième sortie de la gamme Opus en quatre mois et le premier lancement depuis que le PDG d’Anthropic a publiquement plaidé pour un rythme maîtrisé du développement à la frontière. Ces deux faits figurent dans le même document. Les chiffres de capacités feront débat pendant une semaine ; le prix et le tarif de cache resteront vrais dans un an.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
