Claude Opus 5 : le modèle quasi-frontière d'Anthropic à la moitié du prix de Fable 5
Guides & Insights

Claude Opus 5 : le modèle quasi-frontière d'Anthropic à la moitié du prix de Fable 5

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le 24 juillet 2026, Anthropic a lancé Claude Opus 5 — et en un jour, il a fait quelque chose de rare pour un modèle « moins cher » : il a atteint le sommet des classements indépendants. Anthropic a présenté Opus 5 comme atteignant presque l'intelligence de pointe de Claude Fable 5 à moitié prix, et il a été lancé le même jour sur Claude.ai, l'API Claude, Claude Code et Claude Cowork. Depuis lors, Artificial Analysis l'a classé comme le modèle n°1 sur son Intelligence Index. Ce guide couvre ce qu'est réellement Opus 5, ce qui est vérifié indépendamment par rapport à ce qui est rapporté par le fournisseur, son nouveau cadran d'effort et sa posture de sécurité, ce qu'il coûte en pratique, et qui devrait passer à ce modèle.

Chaque figure ci-dessous est étiquetée par source, car à cette vitesse, l'histoire change quotidiennement : ce qui se lisait « pas encore de score indépendant » le jour du lancement est maintenant « indépendamment n°1 ». Les benchmarks et les prix bougent — vérifiez avant d'engager un budget.

TL;DR. Claude Opus 5 est proposé au prix de 5 $ par 1M de jetons d’entrée et 25 $ par 1M de sortie — identique à Opus 4.8 et exactement la moitié des 10 $ / 50 $ de Fable 5. Sur l’Artificial Analysis Intelligence Index, il occupe désormais la première place avec un score de 61 (effort maximal), le meilleur modèle parmi 170 évalués, devançant Fable 5 (60) et égalant sa catégorie à moitié du coût. Les propres benchmarks de lancement d’Anthropic confirment cela : Frontier-Bench v0.1 43,3 % (contre 33,7 % pour Fable 5), ainsi que des premières places sur Zapier’s AutomationBench et le benchmark d’utilisation informatique OSWorld 2.0. Deux éléments en font plus qu’une simple baisse de prix : un cadran d’effort (faible/moyen/élevé/maximal) qui échange le coût contre la capacité par requête, et la posture de sécurité la plus solide de tous les Opus à ce jour. Si vous construisez déjà sur Claude, la mise à niveau comporte peu de risques et n’augmente pas votre facture ; si vous choisissez entre des modèles phares, Opus 5 est désormais le leader en termes de rapport qualité-prix — validez-le sur votre propre charge de travail.

Points clés

• Désormais classé n°1 indépendamment. Artificial Analysis place Claude Opus 5 (effort maximal) à 61 sur son Intelligence Index — le modèle le mieux classé, devant Fable 5 (60).

• La moitié du prix de Fable 5. $5 / $25 par million de jetons, le même que Opus 4.8 et la moitié du $10 / $50 de Fable 5 — une qualité de pointe à un prix moyen.

• Nouveau cadran d'effort. Les réglages bas/moyen/élevé/max échangent des jetons (coût) contre des capacités ; "max" est ce qui domine le classement, les réglages moins chers battent encore la plupart des concurrents.

• Conçu pour les agents et l'utilisation informatique. Anthropic met l'accent sur l'achèvement de tâches multi-étapes (AutomationBench) et la conduite d'une interface utilisateur réelle (OSWorld 2.0), pas seulement des réponses uniques.

• L'Opus le plus sûr à ce jour. Anthropic l'appelle « le modèle Opus le plus aligné », s'attendant à ce que ses classificateurs de cybersécurité interviennent environ 85% moins souvent que Fable 5 — moins de faux refus sur un travail légitime.

• Large disponibilité immédiate. Modèle par défaut sur Claude Max, le plus puissant sur Claude Pro, et disponible sur l'API, Claude Code et Claude Cowork dès le premier jour.

Note concernant la lecture de ce document : tout ce qui est attribué à Anthropic est une affirmation du fournisseur issue des documents de lancement ; les chiffres indépendants (l'Intelligence Index) sont attribués à Artificial Analysis. Lorsqu'un chiffre n'est pas encore publié (un score SWE-bench Verified distinct), nous le précisons plutôt que de deviner.

Ce qu'est réellement Claude Opus 5

Opus 5 est le dernier membre de la gamme Opus d'Anthropic — le niveau « lourd » au-dessus de Sonnet et Haiku. Il se positionne au-dessus d'Opus 4.8 et, selon l'Intelligence Index indépendant, a désormais dépassé Fable 5, le vaisseau amiral frontalier d'Anthropic de juin 2026. Ce qui le rend remarquable n'est pas une modeste augmentation de capacité, mais la combinaison : une intelligence proche du sommet du classement à un prix de cheval de trait. Anthropic le décrit comme un modèle « réfléchi et proactif » destiné au codage, aux workflows agentiques et au travail de bureau quotidien en entreprise.

Concrètement, Opus 5 coûte 5 $ pour 1 million de tokens d'entrée et 25 $ pour 1 million de tokens de sortie. C'est le même prix que Opus 4.8, et la moitié du tarif de Fable 5 à 10 $ / 50 $. Il est le modèle par défaut sur Claude Max et l'option la plus puissante sur Claude Pro, et il est disponible via l'API Claude, Claude Code (pour le codage) et Claude Cowork (pour le travail collaboratif avec des agents) dès le jour du lancement. La fenêtre de contexte est de la famille Opus, classe 1M.

Qu'est-ce qui est vraiment nouveau ?

Le signal le plus clair du jour du lancement était le Frontier-Bench v0.1 d'Anthropic, une suite difficile de raisonnement et de tâches : Opus 5 obtient 43.3%, contre 33.7% pour Fable 5 et 18.7% pour Opus 4.8. Sur ce benchmark, le nouveau modèle moins cher d'Anthropic surpasse son propre vaisseau amiral plus cher — une affirmation qui a depuis été confirmée par des évaluations indépendantes.

Deux autres benchmarks de fournisseurs complètent le récit « conçu pour le travail réel ». Sur AutomationBench de Zapier, qui mesure si un modèle mène une tâche métier jusqu'à son terme plutôt que de simplement la démarrer, Anthropic indique que le taux de réussite d'Opus 5 est environ 1,5 fois supérieur à celui du modèle suivant le plus proche à coût équivalent, et que même son réglage d'effort le moins cher surpasse le meilleur résultat de chaque concurrent. Sur OSWorld 2.0, un benchmark d'utilisation informatique, Anthropic rapporte qu'Opus 5 surpasse ses rivaux à tous les niveaux de prix et dépasse le score maximal de Fable 5 en utilisant environ un tiers du budget. Opus 5 s'améliore également par rapport à Opus 4.8 dans toutes les évaluations en sciences du vivant suivies par Anthropic, avec le bond le plus important — plus de 10 points de pourcentage — dans les tâches de chimie organique comme la lecture de structures moléculaires à partir de données spectroscopiques.

Le cadran d'effort : ne payer que pour la capacité dont vous avez besoin.

La fonction phare — et celle sur laquelle la plupart des critiques se concentrent — est le réglage de l'effort. Opus 5 vous permet de choisir l'effort que le modèle consacre à une requête : faible, moyen, élevé ou maximum. Un effort plus élevé signifie davantage de jetons de raisonnement internes (donc un coût et une latence plus élevés) et une meilleure qualité ; un effort moindre économise les jetons pour des réponses plus rapides et moins coûteuses. C'est, en effet, un cadran sur votre facture d'IA.

Voilà pourquoi Artificial Analysis répertorie plusieurs entrées Opus 5 (moyen, élevé, très élevé, max) : chaque niveau d'effort correspond à un point différent de la courbe coût-qualité. Le réglage « max » est actuellement celui qui domine l’Intelligence Index avec un score de 61 ; les réglages inférieurs sacrifient un peu de qualité pour un coût par tâche nettement réduit, et même ceux-ci, selon Anthropic, surpassent les meilleurs résultats de la plupart des concurrents. En pratique, cela signifie qu’un seul modèle peut traiter à la fois vos appels à forte volumétrie sensibles à la latence (faible/moyen) et vos tâches de raisonnement les plus difficiles (élevé/max) – vous ajustez par requête au lieu de changer de modèle.

Analyse approfondie des benchmarks : ce que ces tests mesurent réellement

Il est utile de savoir ce que chaque nombre signifie avant de lui faire confiance. L'Artificial Analysis Intelligence Index est un composite de nombreuses évaluations indépendantes (raisonnement, mathématiques, codage, connaissances) menées par un tiers ; un score de 61 plaçant Opus 5 en tête parmi 170 modèles est le signal unique le plus crédible ici, précisément parce qu'Anthropic ne l'a pas réalisé. Frontier-Bench v0.1 (43,3 % pour Opus 5) est le propre ensemble difficile d'Anthropic — un signal relatif indiquant qu'Opus 5 résout des problèmes plus difficiles que Fable 5 (33,7 %) ou Opus 4.8 (18,7 %), et non « 43 % de bonnes réponses » au sens scolaire.

AutomationBench et OSWorld 2.0 importent plus qu'un seul score de raisonnement si votre cas d'utilisation est les agents. AutomationBench récompense l'achèvement des tâches — la différence entre un agent qui rédige un email et un qui soumet réellement le rapport de dépenses — et OSWorld 2.0 récompense la conduite d'une véritable interface utilisateur informatique. L'affirmation d'Anthropic selon laquelle Opus 5 égale le pic OSWorld de Fable 5 pour un tiers du coût est, maintenant que l'Intelligence Index corrobore sa position générale, un argument fort pour déplacer les charges de travail agentiques vers Opus 5. Le seul écart : il n'existe pas encore de chiffre SWE-bench Verified distinct et audité indépendamment pour Opus 5 (Fable 5 est à 95,0 %, Opus 4.8 à 88,6 %), donc pour une citation pure de précision de codage, attendez ce nombre.

Ce que cela coûte en pratique

Les prix par jeton sont abstraits ; c'est le coût par tâche qui apparaît sur votre facture. Prenons une étape d'agent représentative de 20 000 jetons en entrée et 3 000 jetons en sortie. Opus 5 (et Opus 4.8) : entrée 20k × 5 $/1M = 0,10 $, sortie 3k × 25 $/1M = 0,075 $, soit environ 0,175 $ par appel. Fable 5 à 10 $ / 50 $ : 0,20 $ en entrée + 0,15 $ en sortie = environ 0,35 $ — soit à peu près le double. Pour 100 000 appels de ce type par mois, on obtient environ 17 500 $ sur Opus 5 contre environ 35 000 $ sur Fable 5. Étant donné que l'Intelligence Index place désormais Opus 5 devant Fable 5, il ne s'agit pas d'un « proche du Fable 5 pour moins cher » — c'est une qualité de premier plan pour environ la moitié de la facture mensuelle.

Le cadran d'effort change à nouveau la donne. Un pipeline de support à volume élevé peut traiter la plupart des appels avec un effort faible ou moyen — moins cher que les chiffres ci-dessus — et réserver l'effort maximal pour la poignée de tickets vraiment difficiles. Le cadre d'Anthropic est que même les réglages les moins chers surpassent le meilleur des concurrents, donc vous payez rarement pour une capacité que vous n'utilisez pas. Modélisez votre propre mélange de niveaux d'effort plutôt que de supposer que chaque appel fonctionne au maximum.

Comment accéder à Claude Opus 5 et l'utiliser

Opus 5 est immédiatement disponible dans cinq environnements : Claude.ai (où il est le modèle par défaut sur le plan Max et l'option la plus puissante sur Pro), l'API Claude (l'identifiant du modèle dans la documentation d'Anthropic), Claude Code (pour le codage en terminal et IDE), et Claude Cowork (pour le travail d'agent collaboratif en plusieurs étapes). Les utilisateurs de l'API définissent le niveau d'effort comme paramètre, de sorte que le compromis coût-capacité est programmable par requête. Si vous appelez déjà Opus 4.8, passer à ce modèle nécessite simplement un changement d'identifiant au même prix – c'est la mise à niveau la plus fluide qu'Anthropic ait proposée depuis un certain temps.

À qui cela s'adresse : trois scénarios

1. Pipelines d'agents et d'utilisation informatique

Si votre produit exécute des agents multi-étapes ou pilote un navigateur ou un bureau, les résultats d'AutomationBench et d'OSWorld 2.0 d'Opus 5 vous sont directement destinés — désormais soutenus par un Intelligence Index #1 indépendant. Exécutez la plupart des étapes avec un effort moyen et passez à un effort élevé/maximum pour les plus difficiles ; testez sur vos propres traces d'agent avant de vous engager.

2. Les équipes de codage surveillent le budget.

Opus 5 est disponible dans Claude Code dès le premier jour au prix de l'Opus 4.8. Avec l'avance de l'Intelligence Index, c'est un codeur par défaut solide ; la seule citation manquante est un score indépendant SWE-bench Verified (Fable 5 détient toujours ce record à 95,0%). Pour les équipes déjà sur Claude, la mise à niveau est à faible risque et sans augmentation de prix.

3. Entreprises se standardisant sur un modèle unique

Large disponibilité, contexte de classe 1M, le profil d'alignement Opus le plus sûr, et un cadran d'effort qui couvre à la fois le travail en vrac bon marché et le raisonnement difficile font d'Opus 5 un seul défaut plausible pour le travail mixte bureau + ingénierie — à un coût bien plus facile à défendre qu'un vaisseau amiral de pointe.

Sécurité et alignement

Anthropic positionne Opus 5 comme sa version Opus la plus sûre : « le modèle Opus le plus aligné », et « le moins susceptible d'être piégé en vue d'un mauvais usage ». Une conséquence pratique compte pour les déploiements réels : Anthropic s'attend à ce que les classificateurs cybernétiques d'Opus 5 interviennent environ 85 % moins souvent que ceux de Fable 5. En termes simples, cela devrait signifier moins de faux refus sur des travaux légitimes de sécurité, de codage ou de recherche — une frustration courante avec les modèles de pointe fortement gardés — tout en bloquant les véritables mauvais usages. Comme toujours, validez par rapport à votre propre contenu et à vos exigences de conformité plutôt que d'adopter la posture par confiance.

L'histoire du contrôle des exportations de Fable 5 est maintenant dans le prompt système.

Le lancement de Fable 5 a été tout sauf fluide, et ce contexte importe pour quiconque compare Claude Opus 5 à ce dernier. Trois jours après le lancement de Claude Fable 5 et de Claude Mythos 5, le 9 juin 2026, Anthropic a suspendu les deux modèles pour se conformer à une ordonnance de contrôle des exportations du département du Commerce américain ; les contrôles ont été levés le 30 juin et l’accès a été rétabli le 1er juillet. Cette séquence est un fait documenté — Simon Willison a vu l’API d’Anthropic se mettre à renvoyer des erreurs en temps réel, et Anthropic a publié sa propre déclaration sur la suspension et le rétablissement.

Ce qui est nouveau, c'est la façon dont Opus 5 traite les questions à ce sujet. La date limite d'apprentissage du modèle est mai 2026, de sorte que la suspension et son annulation se situent en dehors de ce qu'il a appris. Le prompt système d'environ 200 000 caractères Claude Opus 5 que le red-teamer Pliny the Liberator a publié le 25 juillet — un document qu'Anthropic n'a pas confirmé comme étant celui de production — retrace la chronologie complète et demande au modèle de répondre clairement aux questions sur la suspension plutôt que de la nier, en orientant les utilisateurs vers la déclaration officielle d'Anthropic lorsqu'il ne peut pas confirmer le statut actuel. C'est un exemple concret d'un fournisseur qui intègre l'historique postérieur à la date limite dans le prompt afin que le modèle n'improvise pas sur sa propre famille.

Quand ne pas l'utiliser

N'utilisez pas Opus 5 lorsque vous avez spécifiquement besoin d'un numéro de codage vérifié par SWE-bench et audité de manière indépendante à citer aujourd'hui — ce chiffre n'est pas encore publié, et Fable 5 (95.0%) le détient toujours. Ne supposez pas que chaque paramètre d'effort est le numéro 1 ; le 61 en tête du classement est le paramètre maximal, et les paramètres inférieurs échangent une partie de la qualité contre le coût, alors évaluez le niveau d'effort que vous allez réellement exécuter. Et pour du texte pur à volume élevé et sensible à la latence sans besoin de raisonnement, un modèle de niveau d'efficacité moins cher (par exemple Gemini 3.6 Flash à 1,50 $ / 7,50 $) sera toujours moins cher par token — Opus 5 est un modèle de raisonnement et d'agent, pas un modèle de texte en vrac.

FAQ

Combien coûte Claude Opus 5 ?

5 $ pour 1 million de tokens d'entrée et 25 $ pour 1 million de tokens de sortie — soit le même prix qu'Opus 4.8, et la moitié de celui de Fable 5 (10 $ / 50 $). [Anthropic]

Opus 5 est-il vraiment le modèle numéro 1 ?

Sur l'Artificial Analysis Intelligence Index, oui au moment où j'écris : Claude Opus 5 (max effort) mène avec 61 sur 170 modèles, devant Fable 5 (60). Il s'agit d'un score indépendant, pas d'une affirmation d'un fournisseur. D'autres classements et votre propre charge de travail peuvent classer différemment, et les classements changent à mesure que des modèles sont ajoutés.

Qu'est-ce que le cadran d'effort ?

Un paramètre par requête (faible/moyen/élevé/max) qui échange des jetons — et donc du coût et de la latence — contre des capacités. Max domine le classement ; des réglages moins chers surpassent encore la plupart des concurrents selon Anthropic. Les utilisateurs de l'API le définissent comme un paramètre.

Est-ce que Opus 5 est meilleur que Fable 5 ?

Sur l'indice d'intelligence indépendant (61 contre 60) et le Frontier-Bench v0.1 d'Anthropic (43,3 % contre 33,7 %), oui — à moitié prix. Fable 5 reste en tête du SWE-bench Verified mesuré indépendamment (95,0 %), donc pour les citations pures de précision de codage, Fable 5 conserve cette couronne spécifique.

Comment Opus 5 se compare-t-il à Opus 4.8 ?

Même prix de 5 $/25 $, des benchmarks vendeurs matériellement plus élevés (Frontier-Bench v0.1 43,3 % contre 18,7 %) et des gains dans toutes les évaluations des sciences de la vie suivies, plus le nouveau cadran d'effort et un alignement plus sûr. Pour les utilisateurs actuels de la version 4.8, il s'agit d'une mise à niveau sans augmentation de prix.

À quel point est-ce sûr ?

Anthropic le qualifie de modèle Opus le plus aligné et le moins susceptible d'être utilisé à mauvais escient, et s'attend à ce que ses classificateurs cybernétiques interviennent environ 85 % moins souvent que ceux de Fable 5 — généralement moins de faux refus sur un travail légitime.

Où puis-je utiliser Claude Opus 5 ?

Claude.ai (par défaut sur Max, plus puissant sur Pro), l'API Claude, Claude Code et Claude Cowork — disponibles depuis le 24 juillet 2026.

Quelle est la fenêtre de contexte?

Classe 1M-token de la famille Opus (Opus 4.8 est 1M sans surcharge de contexte long). Anthropic n'a pas encore publié séparément un chiffre pour Opus 5, donc considérez-le comme classe 1M jusqu'à confirmation.

Est-ce qu'il prend en charge les images ou la vidéo ?

Opus 5 est principalement un modèle de raisonnement textuel et d'outils. Pour la compréhension multimodale lourde (image/vidéo), un modèle comme Gemini 3.1 Pro est spécialement conçu ; utilisez Opus 5 pour le texte, le code et les agents.

En résumé

Claude Opus 5 s’est avéré être plus qu’un simple ajustement de prix. Son tarif est celui d’un cheval de trait — 5 $/25 $, soit la moitié de Fable 5 et le même que Opus 4.8 — mais il prend désormais la tête de l’indépendant Artificial Analysis Intelligence Index avec un score de 61 (effort maximal), soutenu par de solides benchmarks maison (Frontier-Bench v0.1 43.3 %, AutomationBench, OSWorld 2.0), un curseur d’effort réellement utile, et le profil d’alignement le plus sûr de tous les Opus. Le seul bémol est l’absence encore d’un chiffre indépendant sur SWE-bench Verified, où Fable 5 (95,0 %) conserve la citation en précision de codage. Pour les utilisateurs actuels de Claude, la mise à niveau est peu risquée et n’augmente pas la facture ; pour tous les autres, Opus 5 est désormais le modèle à battre en termes de qualité par dollar — validez-le sur votre propre charge de travail et acheminez-le, aux côtés de tous ses concurrents, via un point d’accès unique compatible OpenAI sur OrcaRouter.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube