
Claude Haiku 5.5 vs GPT-5.6 Luna : la moitié du prix affiché, 19 % de plus par tâche terminée
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Le prix aligné dont tout le monde a parlé est bien réel, et ce n'est pas avec ce modèle. Claude Haiku 5.5, que le fournisseur a lancé le 7 octobre 2026, est affiché à 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie pour les invites allant jusqu'à 100 000 jetons. GPT-5.6 Luna, l'offre optimisée en coût du 9 juillet 2026, est affichée à 0,20 $ et 1,20 $. Le fournisseur est donc exactement à la moitié du tarif du modèle plus ancien sur les deux compteurs — et exactement à égalité avec GPT-6 Luna, le successeur qui l'a remplacé le 22 septembre 2026 et qui est le modèle par rapport auquel le propre article de lancement du fournisseur établit ses comparaisons.
C'est un endroit étrange pour écrire une comparaison, il vaut donc la peine de préciser à quoi sert cette confrontation. GPT-5.6 Luna est le seul des deux à être déprécié sur le classement indépendant, ce n'est plus le Luna de la grille tarifaire phare d'OpenAI, et c'est toujours le Luna que vous trouverez dans beaucoup de code d'intégration aujourd'hui. Le comparer à Claude Haiku 5.5 est une question de migration que vous devez peut-être déjà, pas une question de savoir lequel de deux modèles actuels appeler.
Et la réponse à la question évidente, c'est la partie intéressante. Lors de la même exécution d'évaluation indépendante, une tâche terminée de l'Intelligence Index coûte 0,21 $ sur Claude Haiku 5.5 et 0,18 $ sur GPT-5.6 Luna. Un prix du token divisé par deux, 19 % de plus par réponse.
Les deux grilles tarifaires
Par million de jetons, en dollars américains. Les tarifs d’Anthropic et d’OpenAI proviennent de leur propre documentation ; les scores partagés sont l’Artificial Analysis Intelligence Index v4.3.2, relevé le 2026-10-08.

• Entrée — Claude Haiku 5.5 0,10 $ jusqu’à 100 000 tokens et 0,50 $ au-delà ; GPT-5.6 Luna 0,20 $, doublant à 0,40 $ pour les requêtes de plus de 272 000 tokens.
• Sortie — Claude Haiku 5.5 : 0,50 $ jusqu’à 100 000 tokens et 2,50 $ au-delà ; GPT-5.6 Luna : 1,20 $, passant à 1,80 $ dans le cadre du contexte long.
• Entrée mise en cache — Claude Haiku 5.5 0,01 $ et 0,05 $, une réduction de 90 % ; GPT-5.6 Luna 0,02 $, également 90 %, plus des frais d’écriture dans le cache de 0,25 $.
Contexte — 1 M de tokens pour Claude Haiku 5.5 et 1 050 000 pour GPT-5.6 Luna. Les deux plafonnent une réponse unique à 128 000 tokens, et OpenAI publie une date limite de connaissances au 16 février 2026 pour son modèle.
• Contrôle du raisonnement — Claude Haiku 5.5 expose une molette d'effort de Faible à Max avec Moyen par défaut ; GPT-5.6 Luna expose six réglages : aucun / faible / moyen (par défaut) / élevé / xhigh / max.
• Score indépendant — 43,40 pour Claude Haiku 5.5 (Max) contre 37,32 pour GPT-5.6 Luna (Max), un écart de 6,07 points sur un classement de 182 modèles.
• Statut — Claude Haiku 5.5 est actuel, propriétaire, uniquement accessible via API. GPT-5.6 Luna porte un indicateur d'obsolescence sur le tableau indépendant et n'occupe plus de ligne dans le tableau tarifaire des modèles phares d'OpenAI.

À moitié prix, plus cher par réponse
L’arithmétique de la grille tarifaire est ici inhabituellement favorable à Anthropic — un net facteur 2 sur les deux compteurs dans le régime des prompts courts —, de sorte que c’est le résultat par tâche qu’il faut expliquer.
Claude Haiku 5.5 émet 162 164 jetons de sortie par tâche de l'Intelligence Index, répartis en 129 047 jetons de raisonnement et 33 118 jetons de réponse. GPT-5.6 Luna en émet 41 235, répartis en 28 098 jetons de raisonnement et 13 136 jetons de réponse. Le modèle d'Anthropic dépense 3,9 fois plus de jetons pour le même travail, et à un débit de sortie deux fois plus faible, cela le rend 19 % plus cher par tâche terminée. L'avantage de débit et le désavantage de verbosité sont à moins d'un facteur deux l'un de l'autre, si bien qu'ils s'annulent presque — et le résidu tourne à l'avantage d'OpenAI.
Les deux coûts par tâche sont proches, mais leur composition respective ne l’est pas. Les 0,1783 $ par tâche de GPT-5.6 Luna correspondent pour environ la moitié à des écritures de cache et pour un quart à de la sortie ; les 0,2128 $ de Claude Haiku 5.5 correspondent à 0,1317 $ d’entrée — principalement des lectures en cache — plus 0,0811 $ de sortie. Aucun des deux modèles n’est cher en termes absolus, et ils sont chers à des endroits différents, ce qui fait converger les totaux par tâche alors que les grilles tarifaires affichent un écart d’un facteur deux.
C'est le même effet qui rend généralement peu fiable une comparaison par token des modèles de raisonnement, et il vaut la peine de le dire sans détour : un compteur bon marché se multiplie par un budget de tokens élevé, et c'est le produit que vous payez. Les notes de lancement d'Anthropic sont elles-mêmes franches à ce sujet, affirmant que Claude Haiku 5.5 est « particulièrement avantageux lorsqu'il est utilisé pour des tâches dont les prompts vont jusqu'à 100 000 tokens, qui représentent environ 90 % des requêtes adressées à notre précédent modèle Haiku ».
Le calcul de mélange raconte la même histoire dans l'autre sens. Sur le mélange 7:2:1 à forte pondération d'entrée d'Artificial Analysis — la forme que présente réellement la plupart du trafic de production — Claude Haiku 5.5 revient à 0,077 $ par million de tokens, contre 0,174 $ pour GPT-5.6 Luna. C'est le facteur 2,26 auquel on s'attendrait d'après le prix affiché. Ce n'est que lorsqu'on pondère le compteur de sortie comme le fait une charge de travail de raisonnement que les deux convergent, et au-delà de 100 000 tokens, ils se croisent.
La falaise des 100 jetons contre celle des 272 jetons
Les deux fournisseurs refacturent les requêtes longues, et leurs seuils diffèrent de plus de deux fois et demie.
Le seuil d'Anthropic est fixé à 100 000 tokens d'entrée. Au-delà, les tarifs de Claude Haiku 5.5 passent à 0,50 $ en entrée et 2,50 $ en sortie — cinq fois le tarif des prompts courts, appliqué à l'ensemble de la requête. Le seuil d'OpenAI est fixé à 272 000 tokens d'entrée. Au-delà, les tarifs de GPT-5.6 Luna passent à 0,40 $ en entrée et 1,80 $ en sortie — 2x en entrée et 1,5x en sortie, également appliqué à l'ensemble de la requête.
Ainsi, le point de bascule n'est pas une convergence lente ; c'est un saut. Un prompt de récupération de 120 000 jetons relève du palier long d'Anthropic et se situe confortablement dans le palier court d'OpenAI, ce qui transforme un avantage de 2x d'Anthropic en un avantage de 1,25x d'OpenAI en entrée et de 1,39x en sortie. Et le seuil d'Anthropic est suffisamment bas pour qu'un pipeline à forte composante documentaire le franchisse régulièrement, tandis que celui d'OpenAI est suffisamment élevé pour que la plupart de ces pipelines ne l'atteignent jamais.
En dessous de 100 000 tokens, rien de tout cela ne modifie l'ordre. Au-dessus de 272 000, l'ordre s'inverse et reste inversé.
Qu’est-ce qui a remplacé le modèle auquel vous vous comparez ?
C’est la partie qui devrait déterminer combien de temps vous consacrez à la comparaison, voire si vous y consacrez du temps.
OpenAI a lancé GPT-6 Luna le 22 septembre 2026 — quinze jours avant qu’Anthropic ne lance Claude Haiku 5.5 — à 0,10 $ en entrée et 0,50 $ en sortie, avec un contexte de 1 M de jetons, un plafond de réponse de 128 000 jetons et le même contrôle d’effort de raisonnement en six étapes. Il s’agit exactement de la même grille tarifaire que celle de Claude Haiku 5.5, sur les deux compteurs, dans le régime des invites courtes.
Sur le classement indépendant, les deux sont assez proches pour que l'ordre composite ne tranche pas : Claude Haiku 5.5 obtient 43,40 contre 38,12 pour GPT-6 Luna — soit toujours une avance de 5,28 points pour Anthropic — mais le coût par tâche achevée est de 0,21 $ contre 0,068 $. C'est un triple avantage pour OpenAI sur le chiffre qui est réellement facturé, et il tient à la même raison de verbosité que ci-dessus : GPT-6 Luna émet 50 012 jetons de sortie par tâche de l'Index, contre 162 164 pour Claude Haiku 5.5.
Le billet d'annonce d'Anthropic fait lui-même la comparaison, dans un tableau qui oppose Haiku 5.5 à « GPT-6 Luna » sur GDPval-AA v2.1 (1620 contre 1437), AA-Briefcase v1.1 (1578 contre 1336), le sous-ensemble hors ligne d'OSWorld 2.1 (72,4 % contre 48,9 %) et Terminal-Bench 4.0 (39,2 % contre 16,4 %). Ce sont les chiffres d'Anthropic eux-mêmes, et ils sont déclarés par le fournisseur, mais le choix de l'adversaire est révélateur : le modèle qu'Anthropic a choisi de battre est celui qui vient après celui du titre de cet article.
Là où l'ancienne Luna l'emporte encore
Trois choses, et aucune d'entre elles n'est la capacité.
Vidéo et audio. Aucun des deux modèles n'est natif pour la vidéo — Claude Haiku 5.5 lit du texte et des images, et GPT-5.6 Luna lit du texte et des images — donc cette ligne est à égalité, et les deux perdent face à tout ce qui dispose d'un pipeline multimédia.
Écritures de cache. OpenAI publie un tarif de 0,25 $ par million d’écritures de cache pour GPT-5.6 Luna, et Anthropic n’en publie aucun pour Claude Haiku 5.5, ce qui signifie que la formulation honnête est que le coût d’écriture se trouve dans le compteur d’entrée à 0,10 $ d’Anthropic plutôt qu’absent. Une charge de travail riche en préfixes avec un cache éphémère paie cet écart à chaque tour.
Et le chemin du contexte long lui-même, où le seuil plus élevé d'OpenAI constitue un véritable avantage structurel qui n'a rien à voir avec le modèle qui est le plus intelligent.

Les deux sont appelables, l'un d'eux n'est pas le nôtre
GPT-5.6 Luna figure dès aujourd’hui au catalogue d’OrcaRouter à openai/gpt-5.6-luna — 0,20 $ en entrée, 1,20 $ en sortie, 0,25 $ pour l’écriture de cache, un contexte de 1 050 000 tokens et un plafond de réponse de 128 000 tokens, avec le palier de contexte long de 272 000 tokens porté comme une étape distincte dans la grille tarifaire plutôt que lissé dans la moyenne. Répercuté au prix catalogue d’OpenAI avec 0 % de marge, et un basculement automatique en dessous, ce qui vaut quelque chose de précis pour un modèle délibérément supplanté : si la capacité d’OpenAI pour ce modèle se resserre, la route change avant que votre budget d’erreur ne le fasse.
Claude Haiku 5.5 ne figure pas au catalogue. Il est accessible via l'API d'Anthropic ainsi que via AWS, Google Cloud et Microsoft Azure, et c'est là la formulation exacte. Ce que le catalogue propose bel et bien d'Anthropic, c'est Claude Sonnet 5.5 et Claude Opus 5.5, de sorte que le chemin d'escalade depuis un palier de classification bon marché vers un palier agentique intermédiaire relève d'un réglage de routage plutôt que d'une intégration — et le même catalogue contient GPT-6 Luna au tarif exact qu'utilise Claude Haiku 5.5, ce qui fait du véritable test A/B pour ce niveau de prix un simple changement de deux chaînes plutôt qu'une opération d'approvisionnement.
Que faire de cette comparaison ?
Si votre intégration mentionne gpt-5.6-luna, la conclusion utile n'est pas que Claude Haiku 5.5 le dépasse de six points d'indice. C'est que vous utilisez un modèle que votre fournisseur a déjà remplacé deux fois dans sa propre gamme flash — d'abord par la génération de Terra, puis par GPT-6 Luna, qu'Anthropic lui-même considère comme le concurrent actuel à ce prix. Migrer vers GPT-6 Luna, c'est une équivalence tarifaire et une division par trois du coût par tâche terminée selon la même mesure indépendante.
Si vous devez choisir entre Claude Haiku 5.5 et la gamme Luna en matière de capacités, Anthropic l’emporte sur le score composite, sur les lignes terminal et code, et sur l’utilisation de l’ordinateur, et son propre tableau de fournisseur l’indique. Si vous choisissez en fonction de la facture, la gamme Luna a remporté toutes les versions de cette comparaison avec une large marge, et la raison tient à un seul chiffre : 162 164 jetons de sortie par tâche contre 41 235.
Ce que cette confrontation tranche réellement, c’est qu’un compteur deux fois moins cher vaut moins qu’un modèle quatre fois plus économe. Anthropic a aligné le prix de Claude Haiku 5.5 sur celui de GPT-6 Luna, et il y est parvenu — exactement, sur les deux compteurs — et il coûte encore trois fois plus cher d’en obtenir une réponse.
