
Claude Haiku 5.5 vs Gemini 3.8 Flash : deux points d'indice, six fois le coût par tâche
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Claude Haiku 5.5 et Gemini 3.8 Flashsont plus proches en capacité mesurée que n'importe quelle autre paire de cette gamme de prix — 43,40 contre 40,93 sur l'Artificial Analysis Intelligence Index v4.3.2, tous deux classés parmi les cinquante premiers d'un tableau de 225 modèles. Ce qui les distingue, c'est le coût d'un seul de ces points d'indice. Selon la même mesure indépendante, une tâche de l'Intelligence Index terminée coûte 0,21 $ avec Claude Haiku 5.5 et 1,24 $ avec Gemini 3.8 Flash.
C’est un écart d’un facteur six pour une différence de deux points et demi au score, et c’est ce chiffre qui devrait trancher cette comparaison. Tout le reste — les tarifs affichés, la liste des modalités, les échéances liées à la tarification de Google — relève d’un débat sur les marges.
Les deux modèles, sur les chiffres qui comptent
Par million de tokens en dollars américains, d'après les documentations tarifaires respectives d'Anthropic et de Google, avec les mesures indépendantes attribuées à Artificial Analysis. Mise en cache le 2026-10-08.

• Entrée — Claude Haiku 5.5 : 0,10 $ jusqu'à 100 000 tokens et 0,50 $ au-delà ; Gemini 3.8 Flash : 0,75 $ forfaitaire, passant à 1,50 $ le 1er janvier 2027.
• Sortie — Claude Haiku 5.5 : 0,50 $ jusqu'à 100 000 tokens et 2,50 $ au-delà ; Gemini 3.8 Flash : 3,75 $ forfaitaire, passant à 7,50 $ à la même date.
• Entrée mise en cache — Claude Haiku 5.5 0,01 $ et 0,05 $ ; Gemini 3.8 Flash 0,075 $, plus des frais de stockage de 0,50 $ par million de tokens par heure.
• Contexte — 1 M de tokens pour les deux. Sortie maximale — 128 000 tokens pour Claude Haiku 5.5 contre 65 536 pour Gemini 3.8 Flash.
Modalité d'entrée — texte et images pour Claude Haiku 5.5 ; texte, images, parole et vidéo pour Gemini 3.8 Flash. C'est la seule ligne où la liste de Google est strictement plus longue.
• Score indépendant — 43,40 pour Claude Haiku 5.5 (Max) contre 40,93 pour Gemini 3.8 Flash (High), sur Intelligence Index v4.3.2.
• Coût indépendant par tâche — 0,21 $ contre 1,24 $ sur le même tableau.
• Vitesse — 241,9 jetons de sortie par seconde contre 125,2, tous deux mesurés par Artificial Analysis.
D'où vient le chiffre de six fois
L'écart de coût par tâche est plus important que l'écart de prix affiché, et c'est là que ça devient intéressant, car cela signifie que la grille tarifaire à elle seule ne l'explique pas.
L’arithmétique des prix affichés est assez simple : 0,10 $ contre 0,75 $ en entrée, soit sept fois et demie moins cher, et 0,50 $ contre 3,75 $ en sortie, soit le même ratio. Si les deux modèles généraient les mêmes tokens pour le même travail, ce ratio se répercuterait directement sur la facture.
Cela ne se répercute pas, et les deux effets jouent en faveur de Google. Claude Haiku 5.5 est verbeux d’une manière que son propre fournisseur reconnaît : Artificial Analysis a enregistré 440 millions de jetons de sortie lors de l’exécution de l’Index, contre une médiane de 100 millions, et qualifie le modèle de très verbeux. Gemini 3.8 Flash a généré 170 millions de jetons contre une médiane de 81 millions — également signalé comme verbeux, mais pour un tiers du nombre de jetons. La documentation d’Anthropic elle-même ajoute le second effet : Claude Haiku 5.5 utilise le nouveau tokeniseur partagé avec Claude 4.7 et les versions ultérieures, de sorte que le même texte compte environ 30 % de jetons en plus que sur le modèle qu’il remplace.
Mis bout à bout, la version honnête de l’argument tarifaire est la suivante : un avantage de dix pour un sur le tarif d’entrée et de sept et demi pour un sur le tarif de sortie, en partie absorbé par un modèle qui écrit plus de tokens par réponse, pour aboutir à un avantage de six pour un selon la mesure qui facture l’ensemble de la tâche. Toujours une déroute, et plus petite que ne le suggère la grille tarifaire.
Le prix de Google porte une date
La chose la plus utile sur la page de tarification de Google est une phrase que la plupart des tableaux comparatifs omettent.
Gemini 3.8 Flash est annoncé à 0,75 $ en entrée et 3,75 $ en sortie « jusqu'au 31 décembre 2026 », et à 1,50 $ et 7,50 $ « à partir du 1er janvier 2027 ». L'entrée mise en cache passe de 0,075 $ à 0,15 $ à la même date. Il s'agit d'un tarif d'introduction avec une date d'expiration imprimée à côté, soit environ onze semaines à compter de la rédaction de ce texte.
Rien dans la fiche d'Anthropic ne se lit ainsi. Les tarifs de Claude Haiku 5.5 sont indiqués comme étant les tarifs, avec une structure à deux niveaux indexée sur la longueur du prompt plutôt que sur un calendrier, et un engagement de retrait au plus tôt le 7 octobre 2027. Si vous modélisez un pipeline qui s'étend sur l'année prochaine, l'étape de janvier de Google est un doublement et elle a sa place dans le modèle ; Anthropic n'a pas d'événement équivalent à prévoir.
Cela joue dans les deux sens, et l’interprétation équitable n’est pas « un fournisseur est honnête et l’autre ne l’est pas ». Un tarif promotionnel est un tarif réel tant qu’il dure, et Google est en droit de fixer le prix d’un lancement de cette façon. C’est simplement un fait concernant la comparaison : le côté le moins cher en apparence dans les chiffres de janvier est celui qui a une date limite.

Combien valent deux points d’indice ?
Un écart de 2,47 points sur un indice qui va jusqu’à la soixantaine n’est pas une erreur d’arrondi, et ce n’est pas un gouffre. Les deux modèles se situent dans la même plage de fonctionnement, et la question pratique est de savoir si l’écart se manifeste sur les tâches que vous exécutez réellement.
D'après les chiffres publiés par les fournisseurs eux-mêmes, les deux ne sont pas mesurés sur le même banc d'essai et ne peuvent donc pas être comparés directement — Anthropic publie des résultats GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 et FrontierCode pour Claude Haiku 5.5, et Google publie les siens pour Gemini 3.8 Flash, et aucun des deux fournisseurs n'a fait tourner la suite de l'autre. La seule comparaison vraiment à armes égales dont on dispose est celle du classement indépendant, et là, la réponse est qu'Anthropic est en avance, d'une marge mesurable mais faible.
La différence de capacités qui comptera davantage pour certaines équipes se situe au niveau des modalités. Gemini 3.8 Flash accepte les entrées vocales et vidéo ; Claude Haiku 5.5 accepte le texte et les images. Un pipeline qui ingère nativement des enregistrements d'appels ou des captures d'écran ne choisit pas du tout entre ces deux modèles sur le critère du prix — l'un des deux ne peut pas faire le travail sans une étape de transcription ou d'extraction d'images en amont, et cette étape a son propre coût et ses propres modes de défaillance.
Exécuter le côté le moins cher de la paire
Gemini 3.8 Flash figure au catalogue d'OrcaRouter au prix catalogue de Google, avec 0 % de marge, ce qui compte ici plus que d'ordinaire : le tarif du fournisseur est répercuté tel quel plutôt que mutualisé, donc si vous voulez voir ce que le palier de janvier fait réellement à une facture, le chiffre bouge quand celui de Google bouge. Claude Sonnet 5.5 et Claude Opus 5.5 figurent eux aussi au catalogue, ce qui fait d'un test de routage à trois branches — le segment Flash de Google, un palier intermédiaire Anthropic, puis un petit palier Anthropic — une simple configuration plutôt qu'un projet. Une seule clé, un seul SDK, une bascule automatique sous le capot, et le DSL de routage si vous préférez exprimer l'escalade dans la route plutôt que dans le code de l'application.
Claude Haiku 5.5 lui-même n'est pas encore au catalogue, et il est préférable de le dire plutôt que de laisser planer l'ambiguïté. Le volet Anthropic de cette comparaison n'est actuellement accessible que chez Anthropic, tandis que le volet Google peut être appelé de notre côté dès aujourd'hui au prix indiqué ci-dessus.

Lequel, et pour qui ?
Si votre travail consiste en du texte en entrée et du texte en sortie, que vos prompts font moins de 100 000 tokens et que vous payez au token pour un volume réel, Claude Haiku 5.5 est le modèle le moins cher selon tous les critères de cet article, et celui qui obtient le meilleur score sur le seul classement partagé — avec la réserve que l'avantage est de six fois sur le coût par tâche plutôt que les dix fois que l'étiquette laisse entendre.
Si vous avez besoin d'audio ou de vidéo en entrée, ou si vous avez besoin d'une réponse de plus de 65 K, ou si vos prompts sont régulièrement longs, le calcul change : Gemini 3.8 Flash accepte des entrées que le palier d'entrée d'Anthropic ne peut pas accepter, et au-delà de 100 000 tokens, le deuxième palier d'Anthropic lui-même est facturé bien au-dessus du tarif forfaitaire de Google.
La seule chose à retenir, ce sont les dates. Le tarif de Google est valable jusqu’à la fin de l’année et double ensuite. Celui d’Anthropic est annoncé comme fixe, avec un palier de durée. Quel que soit le camp pour lequel vous optez, intégrez le calendrier dans la feuille de calcul avant de construire le pipeline.
