Carte de titre principale générée pour l'article, surmontée d'un badge pilule ambré portant la mention « NEW IN OPENCODE GO » et l'accroche « ANTHROPIC, 7 OCTOBRE 2026 », avec le titre « Claude Haiku 5.5 débarque dans un forfait de codage à 10 $ » au-dessus du sous-titre « Une réduction de prix de 90 %, une allocation de 15 $ qui en comptabilise l'usage, et un palier 5x au-delà de 100 000 tokens. », une rangée de quatre pastilles en contour affichant « 0,10 $ en entrée », « 0,50 $ en sortie », « 3 850 requêtes / 5 h » et « allocation mensuelle de 15 $ », et deux cartes arrondies en dessous — « CE QUI A ÉTÉ RÉDUIT », indiquant « entrée 1,00 $ à 0,10 $, sortie 5,00 $ à 0,50 $ pour les prompts jusqu'à 100 000 tokens » et, encadrée d'un ambre pâle, « CE QUE LE FORFAIT COMPTABILISE », indiquant « 15 $ de tokens par mois sur le forfait à 10 $, au tarif catalogue d'Anthropic » — avec la ligne de pied de page « Tarifs d'Anthropic et documentation OpenCode Go consultés le 8 octobre 2026. » Le logo OrcaRouter est incrusté dans le coin inférieur droit.
Guides & Insights

Claude Haiku 5.5 dans OpenCode Go : ce que 10 $ par mois achètent réellement

Auteur

Gideon Frost

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Anthropic a livré Claude Haiku 5.5 le 7 octobre 2026, et en moins d'un jour, il figurait dans les catalogues Go et Zen d'OpenCode — les abonnements d'agents de codage qui comptabilisent une allocation mensuelle en dollars au lieu de facturer des tokens. C'est cette seconde inscription qui mérite qu'on s'y attarde, car l'allocation qu'OpenCode publie pour Claude Haiku 5.5 n'est pas une réduction sur le modèle. C'est un compteur budgétaire fixé au propre prix catalogue d'Anthropic, et chaque chiffre qui le sous-tend peut être vérifié sur les deux pages qui le publient. Si vous hésitez encore sur le modèle à appeler à la place de Claude Haiku 4.5, l'allocation est le critère de décision, pas le prix affiché.

The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.

Ce qu’Anthropic a déclaré publiquement le 7 octobre

Le fournisseur n'a pas commercialisé ce modèle en catimini. La salle de presse d'Anthropic contient une annonce datée, une page produit avec un tableau de benchmarks, une fiche système, une grille tarifaire et six citations de clients nommés. Il n'y a aucun dépôt et aucune publication de poids à examiner, car il n'y a rien à publier : Artificial Analysis répertorie Claude Haiku 5.5 comme un modèle propriétaire, avec un nombre de paramètres non divulgué. Quiconque décrit cela comme un modèle fuité ou non annoncé lit un dépôt qui n'existe pas.

Le positionnement d'Anthropic correspond à un modèle de volume plutôt qu'à un modèle de frontière :

• Positionnement — « le petit modèle le moins cher, le plus rapide et le plus capable que nous ayons jamais publié », destiné aux résumés, aux compactages, aux requêtes de bases de données et à la classification, et présenté comme un sous-agent qui s'associe à Claude Opus 5.5 et Claude Sonnet 5.5 pour le travail de codage.

• Prix — 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie pour les invites allant jusqu'à 100 000 jetons ; 0,50 $ et 2,50 $ au-delà. Lectures du cache 0,01 $ / 0,05 $, écritures du cache 0,125 $ / 0,625 $.

• Contexte et sortie — une fenêtre de 1 M de tokens avec une sortie maximale de 128 000 tokens, la même enveloppe que celle des modèles plus grands de la gamme 5.5, reproduite sur le palier le moins cher.

• Effort — le premier modèle de classe Haiku doté d'un réglage d'effort ajustable, allant de Low à Max, avec medium par défaut. Anthropic publie des courbes précision-coût pour chaque réglage plutôt qu'un chiffre unique.

• Benchmarks, déclarés par le fournisseur et non reproduits de manière indépendante — GDPval-AA v2.1 1620 contre 735 pour Claude Haiku 4.5 ; AA-Briefcase v1.1 1578 contre 614 ; OSWorld 2.1 72,4 % contre 15,7 % ; Humanity's Last Exam 45,9 % sans outils et 57,4 % avec, contre 10,2 % et 18,7 % ; Terminal-Bench 4.0 39,2 % contre 0,0 % ; Chartography 46,4 % contre 6,4 %.

• Le propre plafond du fournisseur — le commentaire d'Ant​hropic sur son graphique Terminal-Bench indique que Claude Sonnet 5.5 et Claude Opus 5.5 « restent de meilleurs choix pour les tâches de codage agentique complexes. » Les citations de clients dans le même article proviennent de partenaires à accès anticipé décrivant leurs propres évaluations, et non des audits : Asana rapporte une latence inférieure de plus de 30 % et une inférence jusqu'à 2,5 fois plus rapide par tour d'agent, HubSpot 92,8 % en moyenne sur trois exécutions, AlphaSense 0,84 contre 0,76 sur 400 requêtes pour une charge de travail d'environ 8 millions d'appels par semaine, Box 11 points de plus à environ la moitié de la latence, et Cognition un score FrontierCode de 66,2 avec Haiku 5.5 comme acolyte.

Generated two-column scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 — Anthropic's own harness'. The left column, 'Claude Haiku 5.5', reads GDPval-AA v2.1: 1620, AA-Briefcase v1.1: 1578, OSWorld 2.1: 72.4%, Humanity's Last Exam: 45.9%, Terminal-Bench 4.0: 39.2%, Chartography: 46.4%. The right column, 'Claude Haiku 4.5', reads GDPval-AA v2.1: 735, AA-Briefcase v1.1: 614, OSWorld 2.1: 15.7%, Humanity's Last Exam: 10.2%, Terminal-Bench 4.0: 0.0%, Chartography: 6.4%. A footer line reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.' The OrcaRouter logo is composited in the bottom-right corner.

Ant​hropic a aussi profité du lancement pour modifier deux tarifs adjacents : les lectures de cache sur Claude Sonnet 5.5 ont été divisées par deux, à 0,10 $ par million de tokens, ce qui, selon l’entreprise, rend Sonnet 5.5 environ 20 % moins cher sur la plupart des tâches agentiques, ainsi qu’un nouveau crédit API mensuel pour les abonnés Claude Max et Team. Les deux sont des changements apportés au niveau supérieur, et tous deux comptent davantage pour une équipe déjà standardisée sur Sonnet que pour quiconque cherche un petit modèle.

L'allocation est un budget en dollars, et non une remise.

Voici la partie que le tweet d'annonce ne dit pas. La documentation Go d'OpenCode indique que « les limites d'utilisation sont définies en montants mensuels en dollars », que la tarification des tokens est identique pour les deux forfaits, et que l'allocation de chaque modèle diminue selon un calendrier fixe : 20 % de la limite mensuelle toutes les cinq heures, 50 % par semaine, 100 % par mois. La documentation publie également le profil de tokens par requête qu'elle suppose pour ce modèle — 1 100 tokens d'entrée, 55 000 tokens mis en cache, 240 tokens de sortie.

Faites passer ceux-ci par le prix catalogue d’Ant​hropic et les nombres de requêtes publiés cessent de ressembler à une allocation arbitraire :

• Coût par requête au prix catalogue — 1 100 en entrée à 0,10 $/M plus 55 000 lectures en cache à 0,01 $/M plus 240 en sortie à 0,50 $/M revient à 0,00078 $.

• Le nombre mensuel de requêtes — 15 $ divisé par 0,00078 $ donne 19 230, soit le nombre indiqué dans la documentation. L’allocation de 60 $ du forfait à 40 $ équivaut à 76 923, et la documentation indique 76 920.

• L’affûtage — 20 % de 19 230 est égal à 3 846, arrondi à 3 850 par tranche de cinq heures ; 50 % est égal à 9 615, arrondi à 9 620 par semaine. Go Plus suit le même calcul avec 15 380 et 38 460.

• Ce que cela signifie en dollars — l'allocation vaut 15 $ de jetons au tarif d'Ant​hropic sur le forfait à 10 $ et 60 $ sur le forfait à 40 $. Un abonnement à 10 $ permet donc d'obtenir au maximum 15 $ par mois de jetons de ce modèle si vous consacrez toute l'allocation à Claude Haiku 5.5 et rien d'autre.

C'est la façon honnête de lire le badge « New » sur la page Go. L'abonnement est bon marché, le modèle est bon marché, et ces deux faits sont indépendants : le quota est un budget mesuré au tarif propre du fournisseur, de sorte que le forfait encadre ce que vous pouvez dépenser, et non le faible coût du modèle. Les utilisateurs intensifs atteignent le plafond et paient Ant​hropic directement — ou font eux-mêmes le routage vers le modèle.

Generated single-column card titled 'The $15 allowance, at Anthropic's list price', with six rows reading 'Go plan: $10 per month', 'Claude Haiku 5.5 allowance: $15', 'Cost per request: $0.00078', 'Requests per 5 hours: 3,850', 'Requests per month: 19,230' and 'Above 100,000 tokens: 5x input', over the footer line 'Allowance figures per OpenCode Go documentation; token prices per Anthropic, both read October 8, 2026. Arithmetic is ours.' The OrcaRouter logo is composited in the bottom-right corner.

Quatre-vingt-dix pour cent, soixante-quinze pour cent, et la falaise du quintuple

Le titre d'Ant​hropic est que Claude Haiku 5.5coûte environ 90 % de moins que Claude Haiku 4.5pour les prompts allant jusqu'à 100 000 tokens, et qu'en moyenne, il « coûte désormais environ 75 % de moins à exécuter ». Les deux chiffres proviennent du fournisseur. Ils sont aussi tous les deux exacts, et l'écart entre eux constitue tout le risque tarifaire.

• Dans la tranche — 0,10 $ en entrée et 0,50 $ en sortie, contre les tarifs fixes de 1 $ et 5 $ de Haiku 4.5. Ant​hropic indique qu’environ 90 % des requêtes adressées à son précédent modèle Haiku se situaient dans cette tranche, d’où vient le chiffre de 90 %.

• Au-dessus de la tranche — la même requête est facturée à 0,50 $ en entrée et 2,50 $ en sortie, soit un quintuplement sur l’entrée. C’est encore la moitié du tarif de Haiku 4.5, mais c’est loin d’être une réduction de 90 %.

• L'affirmation sur le taux mixte — le chiffre de 75 % est l'estimation d'Ant​hropic sur un mélange réel de trafic, non une grille tarifaire, et c'est le chiffre à mettre dans une prévision.

• Le tokenizer — le tokenizer plus récent, partagé avec Claude 4.7 et les versions ultérieures, produit environ 30 % de tokens en plus pour un même texte, selon la propre documentation d’Anthropic, si bien qu’une réduction du prix par token ne se traduit pas un pour un par une facture moins élevée.

Le curseur d'effort amplifie tout cela. Comme la valeur par défaut est medium et que les courbes publiées vont jusqu'à Max, une même invite peut coûter plusieurs fois plus cher selon un paramètre que la plupart des appelants ne définissent jamais — et les estimations de requêtes d'OpenCode supposent un profil de tokens fixe à un réglage implicite. Si vos invites approchent les 100 000 tokens, si vous exécutez un sous-agent à usage limité, ou si vous déplacez le curseur d'effort, le chiffre phare de 90 % n'est pas celui que vous verrez.

Le conseil indépendant s’accorde sur le score et signale ses propres calculs

Les scores d'Artificial Analysis attribuent à Claude Haiku 5.5 une note de 43 sur son Intelligence Index v4.3.2 dans la configuration Max du modèle, contre une médiane du classement de 13, et mesurent 241,9 jetons de sortie par seconde contre une médiane de 110,9 pour des modèles comparables. La même page indique un coût de 0,21 $ par tâche de l'Intelligence Index et rapporte que le modèle a généré 440 millions de jetons de sortie pendant l'évaluation, contre une médiane de 100 millions — le qualifiant de « très verbeux ».

La verbosité est le point d'interaction entre les deux classements. Le calcul de l'allocation ci-dessus est facturé par token, donc un modèle qui raisonne longuement consomme le budget plus vite que ne le suggère le nombre de requêtes, et le profil par requête d'OpenCode de 55 000 tokens mis en cache est une hypothèse sur la mise en cache des prompts qu'un utilisateur d'abonnement peut ou non reproduire. Deux révélations sur la page d'Artificial Analysis valent plus que son titre principal : le 43 correspond à la configuration Max plutôt qu'au réglage d'effort obtenu en ne faisant rien, et la page comporte une note explicite indiquant que Claude Haiku 5.5 « a un tarif 5 fois plus élevé sur les entrées à contexte plus long, ce qui n'est pas actuellement reflété » dans ses chiffres de coût. La falaise du contexte long est réelle, et le classement indépendant vous a indiqué qu'elle ne figure pas encore dans ses propres chiffres.

A screenshot of Anthropic's own Claude Haiku 5.5 product page, showing the date 'OCTOBER 7, 2026' above the heading 'Claude Haiku 5.5', the site sections 'Pricing', 'Performance', 'Safety' and 'Further updates', a 'MODEL ID' field reading 'claude-haiku-5-5', and the top navigation 'Research', 'Policy Commitments', 'Learn' and 'News'.

La ligne de rétention que la plupart des acheteurs sauteront

La documentation Go d'OpenCode comporte un tableau de confidentialité par modèle, et c'est la ligne où Claude Haiku 5.5 diffère de la majeure partie du catalogue. La formulation du fournisseur lui-même est « zéro rétention, avec exceptions ». La plupart des modèles de ce tableau Go indiquent « 0 jour ». Celui-ci indique « 30 jours », avec la note que les requêtes sont conservées pendant 30 jours conformément aux politiques de données d'Anthropic — le même traitement que celui réservé à GPT-6 Luna et GPT-5.6 Luna, et l'inverse des lignes à zéro jour qui constituent l'essentiel de la liste.

Pour un agent de codage, cela signifie que les prompts, les chemins de fichiers et le code source collé peuvent rester chez le fournisseur en amont pendant un mois, sur une offre dont le discours marketing promet une rétention zéro. Ce n'est pas une raison d'éviter le modèle ; c'est une raison de lire la ligne plutôt que la bannière. Par ailleurs, rien dans les supports de lancement d'Ant​hropic ne change la position côté API : l'API Claude propose une rétention zéro des données, et ce sont les conditions de rétention de la fiche modèle qui régissent une intégration directe.

Ce qui est confirmé, et ce qui ne l'est pas

L’ensemble confirmé est vaste et précis, ce qui est inhabituel pour un modèle aussi récent. Ce qui n’est pas confirmé est plus restreint, et mérite d’être nommé plutôt que passé sous silence :

• Confirmé — le modèle existe, est disponible uniquement via API sous l’identifiant claude-haiku-5-5, a été déployé le 7 octobre sur l’API Claude ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure, aux tarifs ci-dessus, avec une fenêtre de 1 M de tokens, un effort ajustable et une fiche système publiée.

• Confirmé — deux plateformes tierces le référencent avec des identifiants de modèle, des points de terminaison et des allocations mesurées le jour même.

• Non confirmé — aucun benchmark indépendant que nous puissions trouver n'a reproduit le tableau du fournisseur. Chaque chiffre de précision dans la publication de lancement d'Ant​hropic provient du propre harnais d'Ant​hropic, et chaque témoignage client provient d'un test précoce auto-déclaré d'un partenaire.

• Non confirmé — il n’y a aucun poids, aucun dépôt, aucun checkpoint et aucune licence à inspecter. Le modèle est fermé, et toute affirmation concernant son architecture ou sa taille relève de l’inférence.

• Non confirmé — que les estimations de requêtes de la plateforme tiennent pour autre chose que son profil de tokens supposé, et si (ou quand) la tarification 5x pour le contexte long apparaît dans les chiffres de coûts des classements indépendants.

L’exécuter à côté de ce que vous appelez déjà

La question pratique que ce lancement pose n'est pas « Haiku 5.5 est-il bon ? » — le tableau du fournisseur dit que oui, et personne en dehors d'Ant​hropic ne l'a vérifié. C'est « quelle est la facture, et que se passe-t-il lorsque le palier économique n'est pas le bon palier pour cet appel précis ? » Ces deux volets sont des problèmes de routage.

Côté coût, le compteur est la facture de tokens, pas le prix affiché : une réduction de 90 % de l'entrée, plus un tokenizer 30 % plus gros, plus un modèle de raisonnement verbeux, plus un palier de contexte long multiplié par cinq, signifie que le nombre que vous anticipez et le nombre que vous payez divergent, à moins de mesurer votre propre distribution de longueur de prompts. Un modèle 5 fois plus cher au-delà de 100 000 tokens récompense la compaction — et Haiku 5.5 est lui-même présenté comme le modèle de compaction, ce qui est une boucle qui mérite d'être remarquée.

En matière de risque, un palier non éprouvé est exactement le cas où il ne faut pas miser un chemin de production dessus. Claude Haiku 4.5 est déjà disponible sur OrcaRouter au prix catalogue d'Anthropic, avec 0 % de marge, donc l'ancien palier n'a besoin d'aucun nouveau contrat, et une route qui bascule d'un nouveau modèle vers un modèle connu relève d'un changement de configuration plutôt que d'une réécriture. Le paramètre effort est défini par appel, ce qui signifie que le même point de terminaison peut exécuter un résumé à faible effort et une extraction difficile à effort élevé sans maintenir deux intégrations — le DSL de routage existe précisément pour ce type de décision, et le basculement automatique est ce qui vous permet de placer un modèle vieux de quelques jours face à du trafic réel avant de disposer de chiffres indépendants le concernant. Ce qui n'est pas encore vrai, c'est l'évidence : Claude Haiku 5.5 n'est pas sur nos routes aujourd'hui, et si vous le voulez cette semaine, vous appelez Anthropic directement ou vous passez par la plateforme qui l'a annoncé.

Qui doit sauter le pas : les équipes dont le volume est constitué de résumés, de classification, de compaction et de travail de sous-agents, là où la tranche des 90 % s’applique et où les 30 % du tokenizer sont une arithmétique que vous pouvez absorber. Qui doit attendre : toute personne dont les prompts dépassent régulièrement 100 000 tokens, toute personne qui a besoin d’un benchmark indépendant avant de s’engager, et toute personne dont le code ne peut pas rester dans une fenêtre de rétention de 30 jours. Le lancement est réel et la tarification est réelle. La preuve appartient encore au fournisseur.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement