Carte principale générée pour « Six fois le coût pour deux points d'indice », arborant le badge « COÛT PAR TÂCHE », avec l'accroche « DEUX MODÈLES DE LA GAMME FLASH, UN SEUL TABLEAU » et le sous-titre « Claude Haiku 5.5 à 43,40 contre Gemini 3.8 Flash à 40,93 sur l'Intelligence Index v4.3.2 ». Quatre pastilles indiquent « 43,40 vs 40,93 », « 0,21 $ vs 1,24 $ », « 0,10 $ vs 0,75 $ » et « augmente le 1er janvier 2027 ». Deux cartes en dessous sont intitulées « L'ATOUT D'ANTHROPIC » (« mieux classé sur le tableau commun, et six fois moins cher par tâche terminée ») et « L'ATOUT DE GOOGLE » (« entrée audio et vidéo, et un tarif fixe sur toute la fenêtre »). Un pied de page indique « Mesures indépendantes d'Artificial Analysis ; prix catalogue relevés le 8 octobre 2026. » Le logo OrcaRouter est intégré dans le coin inférieur droit.
Guides & Insights

Claude Haiku 5.5 vs Gemini 3.8 Flash : deux points d'indice, six fois le coût par tâche

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Haiku 5.5 et Gemini 3.8 Flashsont plus proches en capacité mesurée que n'importe quelle autre paire de cette gamme de prix — 43,40 contre 40,93 sur l'Artificial Analysis Intelligence Index v4.3.2, tous deux classés parmi les cinquante premiers d'un tableau de 225 modèles. Ce qui les distingue, c'est le coût d'un seul de ces points d'indice. Selon la même mesure indépendante, une tâche de l'Intelligence Index terminée coûte 0,21 $ avec Claude Haiku 5.5 et 1,24 $ avec Gemini 3.8 Flash.

C’est un écart d’un facteur six pour une différence de deux points et demi au score, et c’est ce chiffre qui devrait trancher cette comparaison. Tout le reste — les tarifs affichés, la liste des modalités, les échéances liées à la tarification de Google — relève d’un débat sur les marges.

Les deux modèles, sur les chiffres qui comptent

Par million de tokens en dollars américains, d'après les documentations tarifaires respectives d'Ant​hropic et de Google, avec les mesures indépendantes attribuées à Artificial Analysis. Mise en cache le 2026-10-08.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• Entrée — Claude Haiku 5.5 : 0,10 $ jusqu'à 100 000 tokens et 0,50 $ au-delà ; Gemini 3.8 Flash : 0,75 $ forfaitaire, passant à 1,50 $ le 1er janvier 2027.

• Sortie — Claude Haiku 5.5 : 0,50 $ jusqu'à 100 000 tokens et 2,50 $ au-delà ; Gemini 3.8 Flash : 3,75 $ forfaitaire, passant à 7,50 $ à la même date.

• Entrée mise en cache — Claude Haiku 5.5 0,01 $ et 0,05 $ ; Gemini 3.8 Flash 0,075 $, plus des frais de stockage de 0,50 $ par million de tokens par heure.

• Contexte — 1 M de tokens pour les deux. Sortie maximale — 128 000 tokens pour Claude Haiku 5.5 contre 65 536 pour Gemini 3.8 Flash.

Modalité d'entrée — texte et images pour Claude Haiku 5.5 ; texte, images, parole et vidéo pour Gemini 3.8 Flash. C'est la seule ligne où la liste de Google est strictement plus longue.

• Score indépendant — 43,40 pour Claude Haiku 5.5 (Max) contre 40,93 pour Gemini 3.8 Flash (High), sur Intelligence Index v4.3.2.

• Coût indépendant par tâche — 0,21 $ contre 1,24 $ sur le même tableau.

• Vitesse — 241,9 jetons de sortie par seconde contre 125,2, tous deux mesurés par Artificial Analysis.

D'où vient le chiffre de six fois

L'écart de coût par tâche est plus important que l'écart de prix affiché, et c'est là que ça devient intéressant, car cela signifie que la grille tarifaire à elle seule ne l'explique pas.

L’arithmétique des prix affichés est assez simple : 0,10 $ contre 0,75 $ en entrée, soit sept fois et demie moins cher, et 0,50 $ contre 3,75 $ en sortie, soit le même ratio. Si les deux modèles généraient les mêmes tokens pour le même travail, ce ratio se répercuterait directement sur la facture.

Cela ne se répercute pas, et les deux effets jouent en faveur de Google. Claude Haiku 5.5 est verbeux d’une manière que son propre fournisseur reconnaît : Artificial Analysis a enregistré 440 millions de jetons de sortie lors de l’exécution de l’Index, contre une médiane de 100 millions, et qualifie le modèle de très verbeux. Gemini 3.8 Flash a généré 170 millions de jetons contre une médiane de 81 millions — également signalé comme verbeux, mais pour un tiers du nombre de jetons. La documentation d’Anthropic elle-même ajoute le second effet : Claude Haiku 5.5 utilise le nouveau tokeniseur partagé avec Claude 4.7 et les versions ultérieures, de sorte que le même texte compte environ 30 % de jetons en plus que sur le modèle qu’il remplace.

Mis bout à bout, la version honnête de l’argument tarifaire est la suivante : un avantage de dix pour un sur le tarif d’entrée et de sept et demi pour un sur le tarif de sortie, en partie absorbé par un modèle qui écrit plus de tokens par réponse, pour aboutir à un avantage de six pour un selon la mesure qui facture l’ensemble de la tâche. Toujours une déroute, et plus petite que ne le suggère la grille tarifaire.

Le prix de Google porte une date

La chose la plus utile sur la page de tarification de Google est une phrase que la plupart des tableaux comparatifs omettent.

Gemini 3.8 Flash est annoncé à 0,75 $ en entrée et 3,75 $ en sortie « jusqu'au 31 décembre 2026 », et à 1,50 $ et 7,50 $ « à partir du 1er janvier 2027 ». L'entrée mise en cache passe de 0,075 $ à 0,15 $ à la même date. Il s'agit d'un tarif d'introduction avec une date d'expiration imprimée à côté, soit environ onze semaines à compter de la rédaction de ce texte.

Rien dans la fiche d'Ant​hropic ne se lit ainsi. Les tarifs de Claude Haiku 5.5 sont indiqués comme étant les tarifs, avec une structure à deux niveaux indexée sur la longueur du prompt plutôt que sur un calendrier, et un engagement de retrait au plus tôt le 7 octobre 2027. Si vous modélisez un pipeline qui s'étend sur l'année prochaine, l'étape de janvier de Google est un doublement et elle a sa place dans le modèle ; Ant​hropic n'a pas d'événement équivalent à prévoir.

Cela joue dans les deux sens, et l’interprétation équitable n’est pas « un fournisseur est honnête et l’autre ne l’est pas ». Un tarif promotionnel est un tarif réel tant qu’il dure, et Google est en droit de fixer le prix d’un lancement de cette façon. C’est simplement un fait concernant la comparaison : le côté le moins cher en apparence dans les chiffres de janvier est celui qui a une date limite.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

Combien valent deux points d’indice ?

Un écart de 2,47 points sur un indice qui va jusqu’à la soixantaine n’est pas une erreur d’arrondi, et ce n’est pas un gouffre. Les deux modèles se situent dans la même plage de fonctionnement, et la question pratique est de savoir si l’écart se manifeste sur les tâches que vous exécutez réellement.

D'après les chiffres publiés par les fournisseurs eux-mêmes, les deux ne sont pas mesurés sur le même banc d'essai et ne peuvent donc pas être comparés directement — Ant​hropic publie des résultats GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 et FrontierCode pour Claude Haiku 5.5, et Google publie les siens pour Gemini 3.8 Flash, et aucun des deux fournisseurs n'a fait tourner la suite de l'autre. La seule comparaison vraiment à armes égales dont on dispose est celle du classement indépendant, et là, la réponse est qu'Ant​hropic est en avance, d'une marge mesurable mais faible.

La différence de capacités qui comptera davantage pour certaines équipes se situe au niveau des modalités. Gemini 3.8 Flash accepte les entrées vocales et vidéo ; Claude Haiku 5.5 accepte le texte et les images. Un pipeline qui ingère nativement des enregistrements d'appels ou des captures d'écran ne choisit pas du tout entre ces deux modèles sur le critère du prix — l'un des deux ne peut pas faire le travail sans une étape de transcription ou d'extraction d'images en amont, et cette étape a son propre coût et ses propres modes de défaillance.

Exécuter le côté le moins cher de la paire

Gemini 3.8 Flash figure au catalogue d'OrcaRouter au prix catalogue de Google, avec 0 % de marge, ce qui compte ici plus que d'ordinaire : le tarif du fournisseur est répercuté tel quel plutôt que mutualisé, donc si vous voulez voir ce que le palier de janvier fait réellement à une facture, le chiffre bouge quand celui de Google bouge. Claude Sonnet 5.5 et Claude Opus 5.5 figurent eux aussi au catalogue, ce qui fait d'un test de routage à trois branches — le segment Flash de Google, un palier intermédiaire Ant​hropic, puis un petit palier Ant​hropic — une simple configuration plutôt qu'un projet. Une seule clé, un seul SDK, une bascule automatique sous le capot, et le DSL de routage si vous préférez exprimer l'escalade dans la route plutôt que dans le code de l'application.

Claude Haiku 5.5 lui-même n'est pas encore au catalogue, et il est préférable de le dire plutôt que de laisser planer l'ambiguïté. Le volet Ant​hropic de cette comparaison n'est actuellement accessible que chez Ant​hropic, tandis que le volet Google peut être appelé de notre côté dès aujourd'hui au prix indiqué ci-dessus.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Lequel, et pour qui ?

Si votre travail consiste en du texte en entrée et du texte en sortie, que vos prompts font moins de 100 000 tokens et que vous payez au token pour un volume réel, Claude Haiku 5.5 est le modèle le moins cher selon tous les critères de cet article, et celui qui obtient le meilleur score sur le seul classement partagé — avec la réserve que l'avantage est de six fois sur le coût par tâche plutôt que les dix fois que l'étiquette laisse entendre.

Si vous avez besoin d'audio ou de vidéo en entrée, ou si vous avez besoin d'une réponse de plus de 65 K, ou si vos prompts sont régulièrement longs, le calcul change : Gemini 3.8 Flash accepte des entrées que le palier d'entrée d'Ant​hropic ne peut pas accepter, et au-delà de 100 000 tokens, le deuxième palier d'Ant​hropic lui-même est facturé bien au-dessus du tarif forfaitaire de Google.

La seule chose à retenir, ce sont les dates. Le tarif de Google est valable jusqu’à la fin de l’année et double ensuite. Celui d’Ant​hropic est annoncé comme fixe, avec un palier de durée. Quel que soit le camp pour lequel vous optez, intégrez le calendrier dans la feuille de calcul avant de construire le pipeline.