
Claude Haiku 5.5 vs Gemini 3.6 Flash : 7,5 fois le coût par réponse, un modèle à neuf points de moins
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Claude Haiku 5.5 et Gemini 3.6 Flashoccupent le même échelon dans leurs gammes respectives — le petit, le rapide, le bon marché — et c'est là que s'arrête la ressemblance. Sur l'Artificial Analysis Intelligence Index v4.3.2, Claude Haiku 5.5 obtient un score de 43,40 dans sa configuration Max, contre 33,98 pour Gemini 3.6 Flash dans sa configuration High. Sur cette même exécution, une tâche Index terminée coûte 0,21 $ avec Claude Haiku 5.5 et 1,60 $ avec Gemini 3.6 Flash.
Lisez ces deux données ensemble, car chacune prise isolément est trompeuse. Le modèle le moins cher n'est pas légèrement moins cher ; il est 7,5 fois moins cher par tâche terminée. Et le modèle qu'il surpasse n'est pas légèrement plus faible ; il est plus faible de 9,42 points d'indice, ce qui, sur un classement de 182 modèles, correspond à l'écart entre le quartile supérieur et le milieu.
Les deux faits proviennent de la même exécution indépendante, ce qui compte car les fiches des fournisseurs ici ne vous indiquent ni l’un ni l’autre. Anthropic a lancé Claude Haiku 5.5 le 7 octobre 2026 ; Google a livré Gemini 3.6 Flash le 21 juillet 2026. Les trois mois qui les séparent sont la partie intéressante.
Les deux cartes, côte à côte
Par million de tokens, en dollars américains. Les tarifs d'Anthropic et de Google proviennent de leur propre documentation tarifaire ; les lignes partagées correspondent à l'Artificial Analysis Intelligence Index v4.3.2. Données mises en cache le 2026-10-08.

• Entrée — Claude Haiku 5.5 0,10 $ jusqu'à 100 000 tokens et 0,50 $ au-delà ; Gemini 3.6 Flash 0,75 $ forfaitaire aujourd'hui, passant à 1,50 $ le 1er janvier 2027.
• Sortie — Claude Haiku 5.5 : 0,50 $ jusqu'à 100 000 tokens et 2,50 $ au-delà ; Gemini 3.6 Flash : 3,75 $ forfaitaire aujourd'hui, passant à 7,50 $ à la même date.
• Entrée mise en cache — Claude Haiku 5.5 0,01 $ et 0,05 $ ; Gemini 3.6 Flash 0,075 $, plus des frais de stockage de 0,50 $ par million de tokens par heure.
• Contexte et plafond de sortie — 1 M de tokens pour les deux. Claude Haiku 5.5 limite une réponse à 128 000 tokens ; Gemini 3.6 Flash à 65 536.
• Modalité — Claude Haiku 5.5 prend en charge le texte et les images. Gemini 3.6 Flash prend en charge le texte, les images, la vidéo, l’audio et les fichiers. C’est la seule ligne où le camp de Google est incontestablement en avance, et pour un pipeline de compréhension des médias, cela peut décider de toute la question.
• Score indépendant — 43,40 pour Claude Haiku 5.5 (Max) contre 33,98 pour Gemini 3.6 Flash (High).
• Coût par tâche terminée — 0,21 $ contre 1,60 $, lors de la même exécution d'évaluation.

Pourquoi le nombre à utiliser est celui par tâche, et non par jeton
Le multiple de la grille tarifaire semble déjà être de 7,5 en entrée et de 7,5 en sortie, donc le chiffre par tâche n’a rien de surprenant ici — mais il vaut la peine de montrer pourquoi les deux modèles aboutissent au même point sur une mesure et sont si éloignés sur l’autre, parce que la même arithmétique joue en sens inverse dans les autres confrontations de ce lot.
Gemini 3.6 Flash est le moins verbeux des deux. Il émet 41 606 jetons de sortie par tâche de l'Intelligence Index — 20 061 de raisonnement et 21 545 de réponse — contre 162 164 pour Claude Haiku 5.5, répartis en 129 047 de raisonnement et 33 118 de réponse. Le modèle d'Anthropic dépense près de quatre fois plus de jetons pour le même travail, et c'est celui dont le débit de sortie représente un septième de celui de Google ; l'écart de jetons et l'écart de débit se multiplient donc au lieu de s'annuler.
Cette combinaison — un tarif avantageux multiplié par un usage intensif — est la description honnête de l’économie de Claude Haiku 5.5, et le billet de lancement d’Anthropic reconnaît lui-même l’autre facette de la médaille : le modèle offre « un rapport qualité-prix particulièrement intéressant lorsqu’il est utilisé pour des tâches dont les invites vont jusqu’à 100 000 tokens, qui représentent environ 90 % des requêtes adressées à notre précédent modèle Haiku ». Au-delà de 100 000 tokens, le tarif des entrées passe à 0,50 $ et celui des sorties à 2,50 $, point où l’écart avec Gemini 3.6 Flash se réduit à environ 1,5 fois.
Ce qu'a fait le palier propre à Google pendant que cette comparaison restait immobile.
C'est ici que l'article cesse d'être une comparaison entre deux modèles pour devenir un avertissement sur le Gemini auquel vous vous comparez réellement.
Google a maintenu le prix de Flash fixe sur trois générations. Gemini 3.6 Flash, Gemini 3.7 Flash et Gemini 3.8 Flash sont tous indiqués à 0,75 $ en entrée et 3,75 $ en sortie dans la documentation tarifaire de Google, avec le même tarif de cache de 0,075 $ et la même hausse au 1er janvier 2027 pour passer à 1,50 $ et 7,50 $. La fiche tarifaire de Google pour la gamme 3.6 le décrit comme « notre précédent modèle Flash de génération », ce qui est la formulation même du fournisseur.
Ce qui a bougé, c’est le score, pas le prix. Dans le classement indépendant, Gemini 3.6 Flash obtient 33,98, Gemini 3.7 Flash 39,06 et Gemini 3.8 Flash 40,93 — tous dans leur configuration publiée de plus haute intensité. Neuf points d’indice ont été gagnés au sein de la gamme Flash de Google en six semaines, sans aucun changement de tarif.
La conséquence pour quiconque est en pleine évaluation est concrète : si vous avez évalué cette confrontation il y a trois semaines face à Gemini 3.7 Flash, votre résultat est obsolète, et si vous l'évaluez face à Gemini 3.8 Flash, l'écart avec Claude Haiku 5.5 se réduit à 2,47 points. Gemini 3.6 Flash est la version de cette comparaison qui flatte le plus Anthropic, et c'est aussi la version que Google est le plus loin de commercialiser.
Artificial Analysis signale l’entrée 3.6 comme obsolète. La documentation tarifaire de Google publie toujours le tarif, et sa liste de modèles renvoie toujours à une section 3.6, donc la lecture honnête n’est pas « disparu », mais « remplacé deux fois au sein de sa propre famille en dix semaines » — et c’est un fait sur la vitesse à laquelle ce segment évolue, pas une raison d’éviter la comparaison.
Pour qui cela décide-t-il réellement
Il y a un vrai argument en faveur de Gemini 3.6 Pro, et ce n'est pas le score.
Si vous avez besoin d'audio ou de vidéo dans le prompt, Claude Haiku 5.5 ne peut pas du tout le faire — il lit du texte et des images, rien d'autre. Gemini 3.6 Flash lit le texte, les images, la vidéo, l'audio et les fichiers, et notre propre catalogue enregistre, pour ce modèle, 582 jetons de sortie par seconde mesurés, avec une médiane de 4,1 secondes avant le premier jeton au cours de la dernière semaine, ce qui en fait un modèle rapide, même selon les critères de Flash. Pour un pipeline de compréhension des médias, la liste des modalités constitue toute la décision, et l'écart d'indice n'est qu'une note de bas de page.
Si votre travail est fait de texte et d’images, l’écart de calcul n’est pas assez proche pour qu’on en discute. Avec un mélange à forte proportion d’entrées, de 7:2:1 — la configuration de la plupart du trafic de production — Claude Haiku 5.5 revient à 0,077 $ par million de tokens, contre 0,63 $ pour Gemini 3.6 Flash. Sur un million de tokens mélangés par jour, cela fait 77 cents contre 6,30 $, et le deuxième chiffre se dégrade le 1er janvier 2027, tandis que le premier ne bouge pas.
Le seuil des 100 000 tokens est la seule condition qui fait basculer la donne. Un pipeline de récupération ou de documents longs qui assemble régulièrement des prompts de 150 000 tokens paie le palier de 0,50 $/2,50 $ d'Anthropic sur toute la requête, et à ce stade, les deux modèles se tiennent à moins d'un facteur 1,5 en matière de prix, tandis que Gemini 3.6 Flash l'emporte encore sur la modalité et sur le chiffre de 91,8 % que Google publie pour la récupération multi-aiguilles à une moyenne de 128k. Ces données sont rapportées par le fournisseur et non reproduites, et elles doivent être présentées exactement dans ce cadre.

Appeler les deux, ou n’en appeler qu’un
Gemini 3.6 Flash figure dès aujourd'hui au catalogue d'OrcaRouter sous google/gemini-3.6-flash, au prix public de Google avec 0 % de marge — 0,75 $ et 3,75 $, avec une lecture de cache à 0,075 $, répercutés tels que le fournisseur les facture. Cela compte pour ce modèle en particulier, car la hausse du 1er janvier de Google est un changement de tarif, et un catalogue en répercussion directe l'applique le jour même plutôt qu'à la prochaine reconduction de contrat. Une seule clé API et un seul appel SDK donnent accès à ce modèle comme à n'importe lequel des plus de 200 autres du catalogue : un A/B entre une branche Google et une branche Anthropic n'est donc qu'un changement de chaîne de modèle, avec un basculement automatique en dessous, plutôt qu'une seconde intégration.
Claude Haiku 5.5 ne figure pas au catalogue. Le modèle d’Anthropic est accessible via l’API propre à Anthropic et via AWS, Google Cloud et Microsoft Azure, et c’est là toute la réponse honnête. Ce que nous proposons, nous, de cette gamme, ce sont Claude Sonnet 5.5 et Claude Opus 5.5 — ce qui fait du chemin d’escalade depuis un appel de classification peu coûteux jusqu’à un appel agentique de gamme intermédiaire une décision de routage plutôt qu’un projet.
Ce qui rend le verdict assez simple à énoncer sans détour. Pour les tâches de texte et d’image à partir d’invites courtes, Claude Haiku 5.5 l’emporte sur tous les critères, sauf celui du plafond de réponse. Pour tout contenu comportant de l’audio ou de la vidéo, Gemini 3.6 Flash est le seul des deux capable de répondre, ne serait-ce que minimalement — et si vous comptez payer le tarif de Google pour cette capacité, demandez-vous pour quel Gemini vous le payez, car sur ce niveau, vous pouvez obtenir neuf points d’indice de plus pour le même prix auprès d’un modèle frère plus récent.
Une API pour plus de 200 modèles, une seule clé, basculement automatique sous le capot, donc un test A/B entre une branche Google et une branche Anthropic est un changement de chaîne de modèle plutôt qu’une seconde intégration.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
