Une carte de titre générée pour Claude Opus 5.5 vs Claude Sonnet 5, sous-titrée « Moitié prix, vingt points d'indice, cinq mois d'angle mort », avec trois icônes plates au trait (un symbole de base de données empilée, un graphique à barres croissant et un calendrier avec une horloge) et une ligne de pied de page indiquant « Indice selon Artificial Analysis à effort maximal ; prix selon Anthropic. » Le véritable logo OrcaRouter est intégré en bas à droite.
Guides & Insights

Claude Opus 5.5 vs Claude Sonnet 5 : moitié prix, vingt points d’indice et un angle mort de cinq mois

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Si vous ne voulez retenir que la règle : utilisez Claude Sonnet 5 par défaut et basculez vers Claude Opus 5.5 lorsqu'une tâche échoue, car le modèle le moins cher coûte réellement moitié prix et relève réellement d'une autre classe de capacités. Les deux chiffres qui sous-tendent cela sont 38 et 58 — les scores de Sonnet 5 et d'Opus 5.5 sur l'Artificial Analysis Intelligence Index, avec le même évaluateur, dans la même famille de configurations. Un écart de vingt points sur cet indice n'est pas un simple départage, et c'est la plus grande séparation que l'on puisse actuellement obtenir dans n'importe quel duel Claude contre Claude : Claude Opus 5.5 est classé n°1 sur 210 modèles et Claude Sonnet 5 est classé n°54, et la différence de prix entre eux est de 2 $ par million de jetons d'entrée.

C’est la moitié facile. La moitié difficile, c’est que l’escalade sélective exige de savoir quelles tâches échouent, et les deux modèles sont en désaccord sur le monde après janvier 2026 d’une manière qu’aucune évaluation ne fera apparaître comme une erreur.

L'écart de vingt points, en contexte

A two-column scoreboard comparing Claude Opus 5.5 and Claude Sonnet 5 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 38, ranked #54), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), default effort (medium against high), knowledge cutoff (Jun 2026 against Jan 2026), output speed (not yet published against 79.3 tokens per second) and cache read ($0.20 per million on both). The footer reads 'Index and speed figures per Artificial Analysis at max effort; prices, effort defaults and cutoffs per Anthropic.'

Artificial Analysis exécute chaque modèle dans une configuration publiée, et ces deux partagent une étiquette de famille — « Adaptive Reasoning, Max Effort » — ce qui rend la comparaison inhabituellement nette :

• Intelligence Index — Claude Opus 5.5 58, classé n°1 sur 210 contre Claude Sonnet 5 38, classé n°54

• Prix — Claude Opus 5.5 4,00 $ en entrée / 20,00 $ en sortie par million, contre Claude Sonnet 5 2,00 $ / 10,00 $

• Vitesse de sortie — Claude Sonnet 5 79,3 tokens/s vs Claude Opus 5.5, pas encore publié au classement

• Délai avant le premier token — Claude Sonnet 5 150,02 s contre une médiane du classement de 3,83 s

• Effort par défaut — Claude Opus 5.5 moyen vs Claude Sonnet 5 élevé

• Date limite des connaissances — juin 2026 pour Claude Opus 5.5 contre janvier 2026 pour Claude Sonnet 5

• Contexte et sortie — 1M de contexte et 128K de sortie max sur les deux

La colonne du rang est la partie qui mérite qu'on s'y attarde. Vingt points d'indice ne représentent pas quatre places sur un classement ; ils en représentent quarante-neuf. Sur un classement de 210 modèles, Opus 5.5 et Sonnet 5 ne sont pas des voisins séparés par un écart de prix — ils se trouvent dans des catégories différentes, et l'écart de 2 $ par million achète un véritable palier de capacités plutôt qu'un badge. Quiconque a lu la couverture médiatique de cette semaine comme « Anthropic a livré un Opus moins cher » et a supposé que la gamme Sonnet l'avait absorbé devrait regarder cette paire de rangs : la page de tarification d'Anthropic elle-même répertorie encore Claude Sonnet 5 comme produit actuel, et sa position dans le classement indépendant n'a pas bougé.

Deux réserves s'imposent pour rester honnête. Les deux scores ont été obtenus à l'effort maximal, et la configuration par défaut de livraison d'aucun des deux modèles n'est maximale — Sonnet 5 est par défaut sur élevé, Opus 5.5 sur moyen. Et les lignes de vitesse compliquent l'histoire en faveur de Sonnet 5 : 79,3 jetons par seconde avec un premier jeton à 150 secondes est un profil de latence réel et mesuré, et c'est le seul des deux qui figure au tableau. La vitesse et la latence d'Opus 5.5 n'ont pas été publiées par Artificial Analysis, ce qui signifie que l'affirmation de « plus rapide » dans cette confrontation repose actuellement sur des documents de fournisseur plutôt que sur une mesure.

La note de bas de page qui change le prix de Sonnet 5

L’élément le plus concret ressorti du mois écoulé pour Claude Sonnet 5 est une phrase que la plupart de la couverture médiatique a ignorée. Lors du lancement du modèle, le 30 juin 2026, son tarif de 2 $ / 10 $ a été annoncé comme un prix d’introduction jusqu’au 31 août, avec une hausse prévue à 3 $ / 15 $ le 1er septembre. Sur la page tarifaire actuelle d’Anthropic, la note de bas de page indique que le tarif de 2 $/10 $ « est désormais le prix standard » et que la hausse « n’aura pas lieu ».

Cela compte pour deux raisons. La plus évidente est qu’une augmentation de 50 % annoncée puis annulée constitue un poste de coût sur lequel vous pouvez désormais planifier — Sonnet 5 n’est pas un tarif promotionnel dont il faut modéliser l’expiration. La moins évidente est que cela règle l’arithmétique de l’escalade. Avec Sonnet 5 fixé de façon permanente à 2 $/10 $ et Opus 5.5 à 4 $/20 $, le rapport entre les deux paliers est exactement de 2x dans les deux sens, et il est stable. Une règle d’escalade qui envoie, disons, un cinquième de votre trafic vers Opus 5.5 a un coût que vous pouvez calculer une fois et ne plus recalculer.

Les tarifs par lots et de cache évoluent ensemble, et c'est ce qui rend la comparaison sur l'ensemble du tableau utile : les lots de Sonnet 5 s'établissent à 1,00 $ / 5,00 $ contre 2,00 $ / 10,00 $ pour Opus 5.5, et les deux facturent la lecture du cache à 0,20 $ le million. Ce dernier chiffre est une véritable égalité — Opus 5.5 a réduit sa lecture de cache de 0,50 $ à 0,20 $, et Sonnet 5 y était déjà. Si votre charge de travail consiste surtout à relire un grand contexte mis en cache plutôt qu'à générer de nouveaux résultats, l'avantage de prix du modèle le moins cher est bien plus faible que ne le laisse croire le ratio affiché, car la seule ligne sur laquelle ils s'accordent est celle qui vous coûte le plus cher.

Le cutoff est la partie qui échoue en silence.

A generated two-card graphic titled 'Knowledge cutoffs, five months apart', showing Claude Sonnet 5 with a knowledge cutoff of January 2026 against Claude Opus 5.5 with a cutoff of June 2026, separated by a marker reading '5 months of coverage'. The footer reads 'Cutoff dates per Anthropic's Claude model documentation, current as of September 2026.'

Claude Opus 5.5 a une date limite de connaissances de juin 2026. Celle de Claude Sonnet 5 est janvier 2026. Cela représente cinq mois d’écart, et c’est la seule dimension de cette comparaison qui ne s’annonce pas. Un modèle qui ne connaît pas un événement n’est pas plus lent ou moins précis à son sujet d’une manière que votre gestion des erreurs intercepte — il répond avec assurance depuis un monde qui a évolué, et l’échec ressemble à une réponse erronée plausible plutôt qu’à un refus.

Pour certaines charges de travail, cela n'a aucune importance : refactoriser une base de code dont les conventions sont stables, résumer des documents que vous fournissez, transformer des données structurées. Pour d'autres, c'est à soi seul éliminatoire, indépendamment des vingt points d'index ou du prix. Tout ce qui touche à des logiciels publiés au second semestre 2026, tout ce qui répond à des questions sur des événements récents, tout ce qui dépend d'une API ou d'une version de bibliothèque modifiée après janvier — ces tâches ne peuvent pas être escaladées vers Opus 5.5, elles doivent commencer là. Les cinq mois ne sont pas une différence de qualité ; ils constituent une restriction de périmètre, et celle-ci a sa place dans la règle de routage plutôt que dans l'évaluation.

Les deux modèles partagent le reste de l’enveloppe, ce qui limite la possibilité de contourner la coupure. Tous deux acceptent 1M de tokens de contexte et renvoient jusqu’à 128K, tous deux exécutent une réflexion adaptative qui ne peut pas être désactivée, et tous deux n’exposent la profondeur que par l’intermédiaire du paramètre d’effort. Il n’existe aucune configuration dans laquelle Sonnet 5 reçoit un document plus long pour compenser.

Exécution du split

La version pratique de cette confrontation se résume à un choix par défaut et à une exception, et l’exception doit être définie par autre chose que « les tâches difficiles ». Le schéma qui tient repose sur la classe de tâche plutôt que sur la difficulté : Sonnet 5 pour le travail à gros volume, où sa date de coupure n’entre pas en jeu et où son profil de latence est acceptable ; Opus 5.5 pour tout ce qui est actuel, tout ce qui s’inscrit sur un long horizon, ou tout ce où une tentative ratée coûte plus que la différence de tokens.

Il s'agit d'une configuration de routage plutôt que d'une réécriture, et c'est là qu'un point de terminaison unique justifie sa place. Claude Sonnet 5 est disponible sur OrcaRouter au tarif propre d'Anthropic, soit 2,00 $ / 10,00 $, et Claude Opus 5.5 y est proposé à 4,00 $ / 20,00 $ — le prix catalogue du fournisseur est répercuté sans aucune marge, de sorte que le ratio de coûts de votre règle d'escalade est exactement celui publié par Anthropic, sans couche de marge pour le fausser. Les deux se trouvent derrière une seule clé, ce qui signifie que le chemin d'escalade se résume à une modification de règle plutôt qu'à une seconde intégration ; le basculement automatique évite qu'un primaire défaillant entraîne la requête dans sa chute, et la comparaison qui détermine vos seuils, vous pouvez l'exécuter au sein de votre propre trafic plutôt que de la reconstituer à partir de deux tableaux de fournisseurs.

A screenshot of OrcaRouter's own model page for anthropic/claude-sonnet-5, headed 'Claude Sonnet 5' and credited to Anthropic, showing $2.00 input and $10.00 output per 1M tokens, a 1M-token context and a PERFORMANCE panel with 79.3 output tokens per second, a 150.02s time to first token and 55M output tokens over 7 days.

Qui doit bouger, et qui doit attendre

Si vous êtes déjà sur Claude Sonnet 5 et qu’il fonctionne, les arguments en faveur de son remplacement sont faibles : le modèle coûte moitié prix, son tarif est désormais permanent, et l’écart d’indice ne compte que sur les tâches où il échoue. L’argument en faveur de l’ajout de Claude Opus 5.5 au-dessus de lui est solide, à condition de pouvoir nommer le déclencheur — et le déclencheur est généralement soit un échec de coupure, soit une tâche que les exécutions en effort maximal de Sonnet 5 ratent encore.

Si vous choisissez votre premier modèle Claude, la réponse est moins équilibrée que le rapport de prix ne le laisse paraître. Un écart de vingt points sur l’indice et cinq mois de connaissances supplémentaires pour deux fois plus de tokens : c’est un compromis que la plupart des charges de travail de production accepteront sur une minorité d’appels, et que presque aucune n’acceptera sur la totalité. L’erreur à éviter, dans un sens comme dans l’autre, est de les traiter comme interchangeables et de basculer sur le seul critère du coût, car l’échec qui s’ensuit n’est pas une réponse moins bonne — c’est une réponse assurée au sujet d’un monde qui a pris fin en janvier.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement