Une carte de titre hero générée, portant le badge « Disponibilité générale dans GitHub Copilot - 7 octobre 2026 », avec en surtitre « Rapport de disponibilité des modèles », intitulée « Claude Haiku 5.5 dans GitHub Copilot », avec le sous-titre « Dix fois moins cher par token que le Haiku qu'il remplace - jusqu'à ce qu'une requête dépasse 100 000 tokens », trois puces affichant « 0,10 $ / 0,50 $ par M », « 1 crédit IA = 0,01 $ » et « Pro : 1 500 crédits/mois », et trois cartes pour « Palier court : moins de 100 K tokens », « Palier long : 5x tous les tarifs » et « Pas encore dans notre catalogue : Claude Haiku 4.5 l'est ».
Guides & Insights

Claude Haiku 5.5 débarque dans GitHub Copilot : ce que coûte le modèle Anthropic le moins cher dans un budget de crédits

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Haiku 5.5 a fait son apparition dans le sélecteur de modèles de GitHub Copilot le 7 octobre 2026 — le jour même où l'éditeur l'a mis à disposition — et l'entrée du journal des modifications qui l'annonce consacre l'essentiel de sa longueur aux surfaces. Visual Studio Code, Visual Studio, la CLI Copilot, l'agent cloud GitHub Copilot, l'application Copilot, github.com, GitHub Mobile sur iOS et Android, les IDE JetBrains, Xcode, Eclipse. La phrase qui compte si vous maîtrisez le budget est plus courte : le modèle est facturé « aux tarifs catalogue du fournisseur dans le cadre d'une facturation à l'usage ». Dans Copilot, cela signifie des crédits IA, et les tarifs de Claude Haiku 5.5 sont suffisamment bas pour que l'arithmétique des crédits devienne la partie intéressante du lancement plutôt qu'une réflexion après coup. Cet article déroule ce calcul, distingue ce que GitHub a réellement démontré de ce qu'il a simplement affirmé, et passe en revue deux exceptions figurant dans la documentation de l'éditeur lui-même, que la couverture du lancement a pour la plupart ignorées.

Ce que GitHub a livré, et à qui

L'entrée est intitulée, simplement, « Claude Haiku 5.5 in GitHub Copilot », et elle a été publiée à 13 h 12, heure du Pacifique, le 7 octobre. Elle est disponible pour les abonnés Copilot Pro, Pro+, Max, Business et Enterprise — c'est-à-dire toutes les offres payantes, et notamment pas l'offre gratuite, où la sélection du modèle est toujours gérée automatiquement plutôt que par l'utilisateur. Le déploiement est progressif, donc le sélecteur dans votre éditeur peut accuser plusieurs jours de retard par rapport au journal des modifications ; c'est précisé dans l'entrée plutôt que laissé à votre découverte.

La propre formulation de GitHub sur la finalité du modèle mérite une lecture attentive, car elle est plus étroite que celle du fournisseur :

• Travail rapide et à gros volume — sous-agents, modifications rapides et tâches de terminal, selon les propres termes de GitHub • Non pas présenté comme un remplacement des grands modèles du sélecteur, mais comme l'échelon bon marché situé en dessous • Disponibilité générale, selon la référence des modèles pris en charge de GitHub, qui liste Claude Haiku 5.5 comme généralement disponible, avec un statut GA • Également listé dans cette référence avec une ligne de version IDE marquée TBD, ce qui explique concrètement pourquoi le déploiement paraît progressif du côté de l'éditeur • Facturé au tarif catalogue du fournisseur dans le cadre de la facturation à l'usage, plutôt qu'avec une majoration propre à Copilot img src="2.png"> p>Les dates environnantes du changelog donnent le contexte de cadence qu'une simple page de modèle ne peut pas fournir. Claude Sonnet 5.5 est arrivé dans Copilot le 28 septembre, Claude Opus 5.5 le 22 septembre, et Claude Fable 5.1 le 1er septembre. Anthropic livre une intégration Copilot environ toutes les deux à quatre semaines, et GitHub la traite en quelques jours. Cette cadence explique aussi pourquoi il y a un compte à rebours : GitHub a publié à la mi-septembre un avis de dépréciation pour « certains modèles GitHub Copilot » à la mi-octobre, puis un suivi le 2 octobre confirmant les suppressions. Si votre équipe épingle un modèle dans une configuration Copilot, c'est désormais l'épinglage qui risque le plus de casser, pas le prix.

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

La grille tarifaire, lue comme un grand livre de crédit

Claude Haiku 5.5 est facturé selon deux paliers, basculés en fonction de la taille de la requête plutôt que d’un paramètre que vous choisissez. Tout ce qui suit provient de la grille tarifaire publiée par GitHub lui-même, et tout est exprimé par million de jetons :

• Jusqu'à 100 000 jetons en entrée — 0,10 $ en entrée, 0,01 $ en entrée mise en cache, 0,125 $ en écriture de cache, 0,50 $ en sortie • Au-delà de 100 000 jetons en entrée — 0,50 $ en entrée, 0,05 $ en entrée mise en cache, 0,625 $ en écriture de cache, 2,50 $ en sortie • Claude Haiku 4.5, par comparaison — 1,00 $ en entrée, 0,10 $ en entrée mise en cache, 1,25 $ en écriture de cache, 5,00 $ en sortie • Claude Sonnet 5.5, le palier supérieur — 2,00 $ en entrée, 0,10 $ en entrée mise en cache, 2,50 $ en écriture de cache, 10,00 $ en sortie • Les écritures de cache sont facturées séparément sur les modèles Anthropic, en plus de l'entrée mise en cache — un poste de coût qui n'existe pas chez tous les fournisseurs du sélecteur img src="3.png"> p>Deux constats ressortent de la lecture conjointe de ces lignes. Premièrement, le palier court de Claude Haiku 5.5 est exactement dix fois moins cher que Claude Haiku 4.5, tant en entrée qu'en sortie, et environ vingt fois moins cher en entrée que Claude Sonnet 5.5 — c'est précisément pourquoi il a sa place dans les emplacements de sous-agents, où une flotte de petits appels multiplie tout ce que vous payez par appel. Deuxièmement, le palier de contexte long représente exactement cinq fois le palier court sur tous les tarifs à la fois, à la même limite de 100 000 jetons. Une requête de 99 000 jetons et une requête de 101 000 jetons ne sont pas à 2 % d'écart sur les jetons qui ont franchi la limite ; elles sont à un facteur cinq sur tous. Ce palier est hérité directement du tarif catalogue d'Anthropic, et le système de crédits de Copilot ne le lisse pas.

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

Maintenant, les crédits. La facturation à l’usage de Copilot convertit l’utilisation des modèles en crédits IA à un taux documenté de 0,01 $ par crédit, et chaque forfait comprend un quota mensuel :

• Copilot Pro, 10 $ par mois — 1 500 crédits, annoncés comme 1 000 de base plus 500 flexibles • Copilot Pro+, 39 $ par mois — 7 000 crédits, annoncés comme 3 900 de base plus 3 100 flexibles • Copilot Max, 100 $ par mois — 20 000 crédits, annoncés comme 10 000 de base plus 10 000 flexibles • Copilot Business, 19 $ par siège par mois — 1 900 crédits par utilisateur • Copilot Enterprise, 39 $ par siège par mois — 3 900 crédits par utilisateur • Les réserves d'organisation et d'entreprise sont partagées entre les sièges plutôt que cloisonnées par utilisateur • L'utilisation au-delà de la réserve est facturée à 0,01 $ par crédit — la même conversion, appliquée au dépassement • Les complétions de code et les suggestions de prochaine modification se situent entièrement en dehors de la facturation des crédits et restent illimitées sur les offres payantes p>En réunissant les deux, la forme du lancement devient concrète. Prenons une étape d'agent de taille modérée — 40 000 jetons d'entrée, 2 000 jetons de sortie, sans mise en cache. Sur le palier court de Claude Haiku 5.5, cela fait 40 000 fois 0,10 $ par million plus 2 000 fois 0,50 $ par million, soit 0,005 $, ce qui correspond à un demi-crédit selon la conversion documentée. Le même appel aux tarifs de Claude Haiku 4.5 revient à 0,05 $, soit cinq crédits. L'arithmétique ici est la nôtre, pas celle de GitHub, mais les données d'entrée proviennent toutes de la grille tarifaire publiée, et la conclusion n'est pas subtile : la réserve de 1 500 crédits d'un abonné Pro absorbe environ 3 000 appels de ce type sur le nouveau Haiku, contre environ 300 sur l'ancien. La réserve devient dix fois plus longue sans que l'abonnement change.

Voilà la proposition de valeur honnête, et elle s'accompagne d'une mise en garde tout aussi honnête : le pool est libellé en crédits plutôt qu'en dollars, de sorte que le plafond réel d'un forfait évolue dès qu'une grille tarifaire bouge. Une division par dix du tarif d'un modèle ne décuple pas un pool si votre trafic est réparti sur trois.

Ce que GitHub dit que le modèle fait, et ce qu'il n'a pas montré

Le journal des modifications contient une affirmation de performance, et elle est mise à contribution dans la couverture médiatique au-delà de ce qu’elle peut supporter. GitHub écrit que, lors des premiers tests, Claude Haiku 5.5 « égalait Claude Sonnet 5 sur de nombreuses tâches de codage » tout en utilisant « nettement moins de tokens et d’étapes ».

Lisez les qualificatifs dans l’ordre. Il s’agit de tests préliminaires. Il s’agit des tests de GitHub, sur les tâches de GitHub, et c’est GitHub qui vend l’intégration. Aucun harnais n’est nommé, aucun ensemble de tâches n’est publié, aucun chiffre n’accompagne ni l’une ni l’autre moitié de la phrase, et « many » n’est pas un nombre. L’affirmation peut très bien être vraie — qu’un petit modèle égale un grand modèle sur des tâches de codage étroites et orientées outillage est un résultat plausible en 2026 — mais telle qu’elle est publiée, c’est une assertion de fournisseur, et elle devrait être étiquetée comme telle chaque fois qu’elle est répétée. La moitié « moins de tokens et d’étapes » est la plus durable des deux, parce qu’il s’agit d’une affirmation sur l’efficacité plutôt que sur la capacité, et l’efficacité au niveau de prix de Haiku se manifeste dans votre propre télémétrie d’usage en une semaine. La moitié sur la capacité exige un harnais tiers avant de figurer sur une diapositive.

Les chiffres d'Anthropic constituent une affirmation distincte de celle de GitHub et présentent le même problème de provenance. Anthropic affirme que Claude Haiku 5.5 coûte en moyenne environ 75 % moins cher à exécuter, et que près de 90 % des requêtes auparavant adressées à un modèle de la classe Haiku font moins de 100 000 tokens, seuil où le modèle offre un « rapport qualité-prix particulièrement avantageux ». Dans les deux cas, c'est le fournisseur qui décrit l'économie de son propre produit. Ces affirmations concordent avec la grille tarifaire publiée — une forte réduction sur le palier court, une plus faible sur le palier long — et sont utiles à titre d'indications du fournisseur plutôt que de résultat mesuré.

Son activation relève d'une décision d'administrateur, et la valeur par défaut est oui.

La partie du journal des modifications que les acheteurs de Copilot Business et Enterprise devraient lire deux fois, c’est le paragraphe sur le contrôle d’accès. Les administrateurs gèrent l’accès aux modèles via la politique de modèles dans les paramètres Copilot, et le comportement par défaut documenté par GitHub est que les nouveaux modèles sont activés automatiquement, sauf si un administrateur a désactivé la valeur par défaut globale ou désactivé explicitement ce modèle précis. La valeur par défaut est permissive ; la restriction est de type opt-out.

Deux conséquences en découlent. Si votre organisation applique une gouvernance stricte des modèles, Claude Haiku 5.5 est peut-être déjà sélectionnable par vos développeurs sans que personne ne l'ait approuvé nommément. Et si, à l'inverse, votre organisation a déjà désactivé le modèle par défaut global, le modèle n'apparaîtra pas pour vous, quoi qu'en dise le journal des modifications — ce qui est l'explication la plus probable de la question de support la plus fréquente lors de la première semaine de tout lancement de modèle Copilot. Avant de déboguer une entrée manquante dans le sélecteur, vérifiez la politique des modèles.

Deux dérogations que la documentation d’Anthropic énonce, mais que les articles de lancement ne mentionnaient pas.

Ces deux éléments proviennent de la documentation de la plateforme d’Anthropic plutôt que d’une quelconque couverture médiatique, et tous deux influent sur ce que vous pouvez construire plutôt que sur ce que vous payez :

• Priority Tier n'est pas disponible sur Claude Haiku 5.5 — la documentation d'Anthropic sur les niveaux de service nomme le modèle dans sa liste d'exclusion explicite, aux côtés de Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 et de la gamme Mythos. Si votre architecture présuppose un débit provisionné sur le niveau économique, cette hypothèse ne tient pas ici. • La fenêtre de contexte complète de 1 million de tokens à la tarification standard est accordée à « Claude 4.6 et modèles ultérieurs (sauf Claude Haiku 5.5) » — la parenthèse est d'Anthropic, et Claude Haiku 5.5 est le seul modèle actuel qui en est exclu. La fenêtre est toujours annoncée à 1M sur la ligne de spécifications du modèle, avec une sortie maximale de 128 000 tokens ; ce que signifie cette exclusion, c'est que vous ne devez pas considérer que la garantie générale de tarification pour le contexte long s'applique à ce modèle. • Le tokeniseur a changé. Anthropic déclare que les modèles Claude 4.7 et ultérieurs utilisent un tokeniseur plus récent produisant environ 30 % de tokens en plus pour le même texte, ce qui signifie que le prix par token et le prix par page de votre texte ont évolué en sens opposés. La ligne de spécifications de Claude Haiku 5.5 indique « Fastest » comme position, une valeur par défaut de réflexion adaptative de medium, une date de coupure des connaissances de juin 2026 et un ID de modèle de claude-haiku-5-5.

Aucun de ces éléments n’est un obstacle rédhibitoire pour les charges de travail de sous-agent et de modification rapide auxquelles GitHub destine ce modèle. Ils font la différence entre citer un billet de lancement et citer la documentation, et c’est cette dernière qui survit au contact d’un test de charge.

Si vous préférez l’acheminer plutôt que de changer d’outil

Il y a de bonnes raisons d'appeler Claude Haiku 5.5 depuis votre propre stack plutôt que uniquement par le biais d'un abonnement de type chat et éditeur : vous obtenez les tarifs bruts du palier court sans conversion de crédits intermédiaire, et vous gardez la décision de routage dans votre propre code. Pour ce qui est de la disponibilité, pour le dire simplement, Anthropic le commercialise via la Claude Platform ainsi que via Amazon Bedrock, Vertex AI et Microsoft Azure — et il n'est pas encore dans notre catalogue. OrcaRouter propose aujourd'hui Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 et Claude Fable 5.1 dans un catalogue d'un peu plus de 200 modèles, et Claude Haiku 5.5 n'en fait pas partie. Pour ce qui est du modèle lui-même à l'heure actuelle, faites directement appel à Anthropic ou à l'un des trois fournisseurs cloud.

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

Là où nous nous distinguons, c’est dans la couche qui l’entoure. OrcaRouter répercute le prix catalogue du fournisseur sans marge, donc lorsqu’un fournisseur révise le tarif d’un modèle — comme Anthropic l’a fait pour celui-ci —, le nouveau tarif est actif de notre côté le jour même, plutôt qu’après un cycle de facturation. Le basculement automatique signifie qu’un appel de niveau économique qui échoue atterrit sur une route fonctionnelle au lieu de faire échouer la requête, ce qui compte davantage pour une flotte de sous-agents effectuant des milliers de petits appels que pour une seule session interactive. Et le DSL de routage existe précisément pour la forme de décision que ce lancement crée : envoyer le travail court et à fort volume vers le modèle le moins cher sous le seuil, et le travail à long contexte vers le modèle le moins cher au-dessus, depuis un seul point de terminaison sur une seule facture, au lieu d’encoder cette répartition dans deux intégrations. Si Haiku 5.5 arrive au catalogue, il s’intègre à cette politique sans changement de code.

Que faire de ceci avant le prochain sprint ?

L’interprétation restrictive est que le modèle actuel le moins cher d’Anthropic est désormais sélectionnable dans chaque palier payant de Copilot et qu’il est environ dix fois moins cher par jeton que le Haiku qu’il remplace sur le palier court. Si votre équipe exécute des sous-agents ou de l’automatisation de type terminal via Copilot, changer de modèle est un changement de paramètre qui a un effet important et immédiat sur ce qu’un pool mensuel de crédits permet de couvrir.

Les deux choses qu'il vaut la peine de vérifier en premier sont celles que l'annonce enterre. Regardez le 95e centile de la taille de vos requêtes : s'il dépasse 100 000 tokens, le palier sur lequel vous êtes réellement facturé est le deuxième, et la comparaison par dix est en réalité une comparaison par cinq. Et vérifiez si la politique de modèles de votre organisation a le paramètre global par défaut activé — pour les licences Business et Enterprise, ce seul réglage détermine si ce lancement est ne serait-ce qu'accessible à vos développeurs.

répercute le prix catalogue du prestataire sans marge