
Les démos de Claude Opus 5.5 coûtent de 3 $ à 26 $ : comment lire les premiers jours des builds
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 495 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 186 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
Deux chiffres issus de la première semaine de Claude Opus 5.5 portent sur le même modèle et divergent d'un ordre de grandeur. Un développeur rapporte un laboratoire de lentilles interactif terminé — une page où l'on fait glisser un anneau de mise au point et où un plan de netteté lumineux balaie une vallée — pour $25.66 de dépenses et 1 heure 26 minutes de temps réel. Une compilation très partagée de démos de lancement évalue une animation de château Blender construite de manière procédurale, avec feux d'artifice et reflet dans un lac, à $13.30 et 35 minutes. Un fil qui a fait la une de r/ClaudeAI annonce $3.21. L'éditeur a livré Claude Opus 5.5 le 22 septembre 2026, à 4 $ par million de jetons d'entrée et 20 $ par million de jetons de sortie, et aucun de ces trois chiffres. Ils mesurent des choses différentes, et si vous établissez votre budget d'après eux, vous devez savoir lequel.
L'écart n'est pas du bruit. C'est la différence entre ce qu'une exécution d'agent produit et ce qu'elle consomme, et les quatre derniers jours ont produit une quantité remarquable de ce dernier, avec très peu d'explications. Voici donc l'arithmétique que personne n'a publiée à côté des démos, puis la partie du lancement qui figure réellement sur une grille tarifaire et peut être vérifiée.
Ce que 25,66 $ ont réellement acheté
L'extrémité coûteuse de la gamme est l'extrémité la plus utile, car le constructeur a publié à la fois l'artefact et la facture.
Le laboratoire d'objectifs de Ryan Sael, intitulé « Le plan de mise au point », est une page interactive unique construite à partir d'un seul prompt en une seule session. Il affiche un objectif photo à l'écran, vous permet de faire glisser la bague de mise au point, et vous montre la chose que tout photographe connaît mais que presque personne n'a vue : la fine feuille dans le monde où une photo devient réellement nette. Tournez la bague et la feuille se déplace, les éléments en verre glissent vers l'avant ou vers l'arrière à l'intérieur du barillet pour montrer pourquoi, et une console indique la distance, l'ouverture et la zone de netteté — 60 cm, f/2, 1,9 cm de profondeur, aux réglages avec lesquels la page s'ouvre. Fermez le diaphragme de f/2 à f/16 et la zone de netteté s'élargit à mesure que le cône de lumière se rétrécit. Une vue éclatée sépare les verres. Il n'y a aucun modèle d'image nulle part dans le pipeline, et aucune ressource téléchargée : chaque élément est dessiné et animé dans le code, ce qui explique pourquoi toute la démonstration du cercle de confusion est une simulation en direct plutôt qu'un diagramme.
C'est une explication vraiment bonne, et l'affirmation qui l'accompagne est d'une précision inhabituelle : une seule tentative, 1 heure 26 minutes, 25,66 $ d'utilisation d'API, avec la page en ligne à lens.lab.sael.net au moment où je l'ai lue. Le chiffre est auto-déclaré et non auditable, mais c'est aussi le seul coût de démo en circulation qui s'accompagne d'une durée de session par laquelle diviser.
Faites le calcul à partir de la grille tarifaire. Aux tarifs publiés de Claude Opus 5.5, à savoir 4 $ par million de tokens d'entrée et 20 $ par million de tokens de sortie, 25,66 $ se situe entre 1,28 million de tokens et 6,4 million de tokens selon la répartition — la borne supérieure s'il ne s'agissait que d'entrée, la borne inférieure s'il ne s'agissait que de sortie. Un build agentique comme celui-ci se situe quelque part entre les deux, et la raison pour laquelle il se situe plus près de la borne basse est le poste que la plupart des gens négligent : les lectures de cache sur Claude Opus 5.5 coûtent 0,20 $ par million, soit un quarantième du tarif d'entrée, ainsi, une longue session qui ne cesse de relire la même base de code en croissance ne paie presque rien pour ce trafic. Dix millions de tokens d'entrée mis en cache coûtent 2 $. C'est du côté de la sortie que s'accumule une heure et demie d'un modèle qui écrit du code, réfléchit et le réécrit : à 20 $ par million, un million de tokens de sortie coûte 20 $, et les tokens de réflexion sont facturés comme de la sortie. Le chiffre de Sael est cohérent avec une exécution qui a produit de l'ordre d'un million de tokens de sortie face à un volet d'entrée volumineux, bon marché et mis en cache — ce qui correspond exactement à ce à quoi ressemble un build de 86 minutes non supervisé.
Deux choses s'ensuivent. Premièrement, la baisse du prix affiché qui a attiré l'attention le jour du lancement, de 5 $/25 $ à 4 $/20 $, représente un changement de 20 % par token et n'aurait pas, à elle seule, rendu cette exécution bon marché ; la réduction du coût de lecture du cache de 0,50 $ à 0,20 $ est la ligne qui a rendu une boucle de 90 minutes abordable. Deuxièmement, et c'est moins confortable : rien dans le rapport de 25,66 $ ne vous dit si l'exécution s'est bien passée. Un one-shot bien exécuté et une session qui a pataugé pendant une heure et demie avant de réussir produisent la même facture.
Le chiffre de 13,30 $ ne résiste pas à sa propre arithmétique.
Le milieu de la gamme est instructif pour une autre raison. Un récapitulatif de démos de lancement publié le 23 septembre rapporte un duel dans lequel Claude Opus 5.5 a été chargé de construire de manière procédurale une animation Blender de dix secondes à partir d’un seul prompt — château, reflet sur le lac, feux d’artifice — face à GPT-6 Astra, sans édition manuelle, et rapporte 35 minutes et 199 600 jetons de sortie pour environ 13,30 $, contre 28 minutes et environ 14,50 $ pour GPT-6 Astra. Le jeton est l’élément intéressant, car il ne concorde pas avec le prix.
199 600 jetons de sortie à 20 $ le million pour Claude Opus 5.5, cela fait 3,99 $, et non 13,30 $. Pour atteindre 13,30 $ sur la seule sortie, il faudrait 665 000 jetons. L'argent manquant se trouve dans les autres colonnes : l'entrée à 4 $ le million, les écritures de cache à 5 $ le million pour un point de rupture de cinq minutes et à 8 $ le million pour une heure, et les éventuelles tentatives répétées. Ce n'est pas une contradiction dans le rapport — c'est le rapport qui fait preuve d'honnêteté à propos d'un décompte de jetons qui compte une chose et d'une facture qui en compte quatre, ce qui est la confusion la plus courante lorsqu'on parle des coûts la semaine du lancement. Si vous ne retenez qu'un seul chiffre d'une démo publiée, retenez le montant en dollars, et considérez tout décompte de jetons qui l'accompagne comme une description partielle de l'exécution.
Dans le bas de gamme, la comptabilité devient encore plus mince. Le fil r/ClaudeAI qui fait état de 3,21 $ d’utilisation de l’API pour une réalisation terminée est typique du genre : un titre, une vidéo, et aucune ventilation. Il est plausible qu’il s’agisse d’une session plus courte, d’un artefact plus petit ou d’une grande quantité d’entrées mises en cache. Ce n’est pas quelque chose sur quoi fonder un budget, et je n’ai pas pu en vérifier un seul dollar.
Pourquoi chacun de ces nombres est une borne inférieure
Le mode de défaillance ici n’est pas que les constructeurs dissimulent. C’est la sélection. Les démos qui circulent sont celles qui ont fonctionné, publiées par les personnes pour qui elles ont fonctionné, et les quatre tentatives qui ont produit une page cassée ont coûté autant que celle qui ne l’a pas fait. Le récapitulatif qui a compilé la comparaison Blender le dit sans détour — que personne ne publie les échecs — et son entrée la plus détaillée en est un parfait exemple : un site de marque horlogère qui a raté le brief et utilisé une police illisible au premier passage et a eu besoin d’une seconde tentative pour devenir la version qui a été présentée.
« One shot » joue lui aussi discrètement son rôle dans ce vocabulaire. Il désigne une seule session, et non une seule tentative, et une session peut contenir autant d’autocorrection que le modèle peut en générer — ce qui, sur une exécution de 86 minutes, en fait beaucoup. Que le modèle réécrive son propre code deux fois au sein d’une même fenêtre de contexte correspond à un one shot et à deux tentatives.
Ainsi, la lecture honnête des quatre premiers jours fait apparaître trois niveaux de preuves, et il ne faut pas en faire une moyenne :
• Coût auto-déclaré avec une durée de session — utilisable pour un ordre de grandeur, non vérifiable. Les 25,66 $ de Sael sur 1 h 26 constituent l'élément le plus solide de ce niveau.
• Coût auto-déclaré avec un nombre de jetons — incohérent en interne plus souvent qu'autrement, comme le montre le chiffre de 13,30 $.
• Un montant en dollars sans rien derrière — un signal que quelqu'un a construit quelque chose, et rien de plus.
La partie du lancement qui figure sur une grille tarifaire
Si l’on écarte les arguments de démonstration, le tableau vérifiable est étroit et clair. Tous les chiffres ci-dessous correspondent aux tarifs publiés par Anthropic, lus dans la documentation de ses propres modèles et dans son annonce du 25 septembre 2026 :
• Entrée — 4 $ par million de tokens. Sortie — 20 $ par million, les tokens de réflexion étant facturés comme de la sortie, et la réflexion adaptative de Claude Opus 5.5 étant toujours activée et impossible à désactiver.
• Lectures de cache — 0,20 $ par million, soit un multiplicateur de 0,05x. Écritures de cache — 5 $ par million au palier de cinq minutes, 8 $ par million à une heure. Batch API — 50 % de réduction dans les deux sens, 2 $ et 10 $.
• Mode rapide — 8 $ en entrée et 40 $ en sortie par million, jusqu'à 2,5x la vitesse, et Anthropic le qualifie encore d'aperçu de recherche.
• Enveloppe — contexte de 1 M de tokens, 128 K de tokens en sortie de manière synchrone et 300 K sur la Batch API avec un en-tête bêta, date de coupure des connaissances fiable de juin 2026, effort par défaut moyen plutôt que le niveau élevé qui était celui par défaut de Claude Opus 5.
• Disponibilité — l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform sur AWS, avec un retrait garanti au plus tôt le 22 septembre 2027.
Les propres allégations de performance du fournisseur, étiquetées comme allégations : Claude Opus 5.5 offre des performances au niveau de Claude Fable 5.1 sur la plupart des tâches, coûte environ 40 % de moins à exécuter que Claude Opus 5 et génère sa sortie plus de 30 % plus vite. Les 40 % sont une moyenne sur les charges de travail que le fournisseur a choisie, et non un chiffre de grille tarifaire, et il ne faudrait pas les citer comme s’il s’agissait du même type de fait.
Le contrôle indépendant est plus modeste que le tableau du fournisseur et pointe dans la même direction, avec une marge plus faible. Artificial Analysis attribue à Claude Opus 5.5 une note de 57,6 à son Intelligence Index, ainsi que 61,4 à Humanity's Last Exam, 66,9 à SciCode et 84,7 en rappel de contexte long dans les chiffres que porte sa page de modèle. Dans la mesure d'agent de codage de la même publication, qui rapporte le coût par tâche plutôt que le coût par token, le chiffre va dans l'autre sens : à effort maximal, le coût par tâche grimpe à environ 13,04 $, contre 10,79 $ pour Claude Opus 5 dans le même harnais. Un jeton moins cher, que le modèle consomme davantage, ne rend pas une tâche moins coûteuse. C'est la même leçon que les factures de démo enseignent, et elle arrive d'un tiers.
Que faire différemment lors de la deuxième semaine
Si c’est le chiffre de 25,66 $ qui vous a donné envie d’essayer ceci, le bon réflexe n’est pas de prévoir 25,66 $ dans votre budget — c’est de faire en sorte que votre propre calcul produise un chiffre que vous pouvez expliquer.
Définissez explicitement l'effort plutôt que d'accepter la valeur par défaut, car c'est le paramètre qui fait varier le nombre de jetons par tâche plus que le choix du modèle, et la valeur par défaut sur ce modèle a changé depuis Claude Opus 5. Mettez délibérément en cache le préfixe stable : le prompt minimal pouvant être mis en cache sur Claude Opus 5.5 est de 512 jetons, contre 1 024 auparavant, de sorte que les préfixes partagés courts qui n'étaient jamais mis en cache le sont désormais. Prévoyez une marge dans max_tokens pour toute tâche de longue durée, car la réflexion fait partie de ce budget et ne peut plus être désactivée — les propres recommandations de migration d'Anthropic suggèrent de commencer à 64K pour les travaux aux niveaux d'effort les plus élevés, puis d'ajuster à partir de là. Et instrumentez l'exécution à la fin, pas au début : lisez le champ model de niveau supérieur sur chaque réponse, car pour les prompts que ses classificateurs signalent, Anthropic réachemine la requête au sein du même appel, et la chaîne de modèle que vous avez envoyée ne décrit pas ce qui a répondu.
Ce dernier point est là où un routeur cesse d'être une simple commodité. Un build qui tourne sans surveillance pendant une heure et demie en franchissant une frontière de sauvegarde peut revenir en ayant silencieusement terminé certains tours sur un modèle plus petit, et le seul moyen de le savoir, c'est d'aller regarder. Claude Opus 5.5 est sur OrcaRouter au prix catalogue d'Anthropic, avec 0 % de marge — le tarif du fournisseur est répercuté tel quel, donc un changement de prix d'un fournisseur est effectif ici le jour même de sa publication — ce qui est la chose la moins intéressante que le routage fasse ici. Ce qui est intéressant, c'est que une seule API pour plus de 200 modèles place toute l'expérience sur une seule clé, de sorte que « lancer sur le modèle de pointe, et basculer plutôt qu'échouer » est une ligne de configuration au lieu d'un second contrat et d'une réécriture. Le basculement automatique est ce qui rend un modèle inconnu sûr à placer sur un chemin qui vous importe, et un refus que l'on peut contourner est un refus qui ne met pas fin à votre exécution à la minute 70.
Le numéro qui bougera ensuite
Anthropic a déclaré que Claude Sonnet 5.5 et Claude Haiku 5.5 arriveront « dans les semaines à venir », et cela modifiera le tarif de chacune de ces démos sans en changer la forme : un tarif par token moins cher face à un nombre de tokens que personne ne peut prédire à l'avance. La même incertitude qui a rendu inutilisables les chiffres de la première semaine s'appliquera à ceux de la prochaine génération, ce qui est la raison pour laquelle il faut prendre l'habitude dès maintenant plutôt qu'après la prochaine baisse de prix.
Pour l’instant, le résumé honnête est court. Claude Opus 5.5 est réel, généralement disponible, et proposé à 4 $ et 20 $, avec les lectures en cache les moins chères que la gamme ait jamais portées. Les démos qu’il a produites lors de ses quatre premiers jours sont remarquables, et leurs étiquettes de prix sont anecdotiques. Si vous voulez connaître le coût pour votre propre charge de travail, le seul instrument capable de le mesurer est votre propre exécution, plafonnée, avec la facture lue ensuite.



Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
