
Gemini 3.7 Flash vs Claude Opus 5 : Ce qu'un cheval de bataille vous offre pour un sixième du prix
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 221 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 106 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Voici le chiffre qui rend cette comparaison pertinente : Claude Opus 5, le fleuron d'Anthropic, obtient 61 à l'Artificial Analysis Intelligence Index, tandis que Gemini 3.7 Flash, le cheval de trait de Google lancé le 13 août 2026, obtient 56. Cinq points. Et au tarif promotionnel que Google propose jusqu'à la fin de l'année, Gemini 3.7 Flash coûte 0,75 $ par million de jetons en entrée et 3,75 $ par million en sortie — soit environ un sixième des 5,00 $ / 25,00 $ de Claude Opus 5. L'écart qui séparait autrefois le « cheval de trait » du « fleuron » s'est réduit au point où la vraie question n'est plus de savoir si le modèle bon marché est bon, mais ce que le modèle coûteux fait encore que le modèle bon marché ne peut pas faire.
Le cadrage est important, car il ne s'agit pas d'une comparaison à armes égales, et prétendre le contraire vous induirait en erreur. Claude Opus 5, sorti le 24 juillet 2026, est le modèle généralement disponible le plus performant d'Anthropic : un modèle de raisonnement avec un contexte de 1M de jetons et un plafond de sortie de 128K, conçu pour les tâches d'ingénierie, de recherche et d'utilisation d'ordinateur les plus exigeantes. Gemini 3.7 Flash est le cheval de trait de Google pour les volumes élevés : 1M de contexte, 64K de sortie, entrées texte/image/audio/vidéo, et un cahier des charges à l'opposé de celui d'Opus — générer autant de jetons que possible, au coût le plus bas possible, pour les 95 % du trafic qui est routinier. Les comparer sur un seul chiffre, c'est le moyen d'obtenir une mauvaise réponse ; les comparer sur la forme du travail que vous exécutez réellement, c'est le moyen d'en obtenir une utile.

Cinq points, détaillés
L'indice d'intelligence n'est pas une échelle linéaire, et l'écart entre 56 et 61 pèse plus sur certaines tâches que sur d'autres. Le 61 d'Opus 5 vient de sa première place sur les membres les plus difficiles du composite — ses 30,2 sur ARC-AGI-3, 43,3 sur FrontierBench et 79,2 sur SWE-bench Pro sont tous communiqués par le fournisseur, mais ils représentent le genre de résultats de raisonnement de pointe qu'aucun modèle de la classe Flash n'approche. Le 56 de Gemini 3.7 Flash est obtenu différemment : les chiffres rapportés par Google pour ce modèle (65,3 sur DeepSWE v1.1, 1588 Elo sur WebDev Arena, 30,4 sur AutomationBench) montrent un modèle excellent en ingénierie et en agents à périmètre défini et à haut volume, mais pas en raisonnement ouvert et novateur. Cinq points d'indice décrivent donc un véritable gouffre de capacités, même si la distance affichée en titre paraît faible.
• Indice d'intelligence — 56 pour Gemini 3.7 Flash contre 61 pour Claude Opus 5 (effort maximal), selon Artificial Analysis.
• Vitesse de sortie — ~340 tokens/s pour Gemini 3.7 Flash contre ~53 tokens/s pour Claude Opus 5, selon Artificial Analysis. Un écart de 6,4x.
• Fenêtre de contexte — 1M de jetons pour les deux, mais le plafond de sortie de Claude Opus 5 est de 128K contre 64K pour Gemini 3.7 Flash.
• Prix d'entrée — 0,75 $ (promotionnel, jusqu'en 2026) contre 5,00 $ — un écart de 6,7 fois.
• Prix de sortie — 3,75 $ (promotionnel) contre 25,00 $ — un écart de 6,7 fois.
• Entrée multimodale — Gemini 3.7 Flash prend en charge le texte, l'image, l'audio et la vidéo ; Claude Opus 5 ne prend en charge que le texte et l'image.

Là où Claude Opus 5 justifie encore son prix
Le cas du produit phare n'est pas de la nostalgie, c'est la queue de la distribution des tâches. L'ingénierie autonome à long horizon — un modèle laissé seul avec une base de code pendant une heure pour planifier, éditer, tester et itérer — est le domaine où l'avance rapportée d'Opus 5 est la plus large, et ses résultats en utilisation d'ordinateur (71 sur OSWorld, rapportés par le fournisseur) le placent dans une classe que Gemini 3.7 Flash ne rejoint pas. Les équipes qui migrent depuis Claude Opus 4.8 doivent aussi savoir qu'Opus 5 est livré avec la réflexion adaptative activée par défaut et des niveaux d'effort recalibrés, et que la désactivation de la réflexion est plafonnée à un effort élevé — des changements de comportement qui peuvent casser les pipelines existants. Rien de tout cela n'en fait le mauvais choix pour un travail exigeant ; cela en fait le bon choix pour une part de travail plus étroite que ce que son prix suggère.
L'autre chose que vend Opus 5, ce sont les économies de plateforme d'Anthropic. La mise en cache des prompts peut réduire le coût d'entrée effectif jusqu'à 90 % en cas de hit de cache, et son niveau batch réduit de moitié le prix du trafic asynchrone — si bien qu'une charge de travail à fort cache et fort batch sur Opus 5 facture bien plus près de l'ombre de son étiquette que ne le laissent entendre les 5 $ / 25 $ annoncés. Le prix réel du fleuron dépend de la charge de travail ; celui du cheval de trait, non.
Là où Gemini 3.7 Flash est l'achat le plus judicieux.
Pour tout ce qui diffuse, traite par lots ou se nourrit de longs contextes, le cheval de bataille n'est pas seulement moins cher, il est structurellement mieux placé. Un avantage de vitesse de sortie de 6,4x change ce que vous pouvez construire : complétion de code interactive, résumé en direct d'un dépôt complet, boucles d'agent qui nécessitent de nombreux appels par minute — tous ces cas se heurtent au mur du débit sur un modèle de 53 tokens/s bien avant d'atteindre le mur de la qualité. Gemini 3.7 Flash accepte également les entrées audio et vidéo, ce qui ouvre des cas d'usage (transcription de réunions, compréhension de trames vidéo) qu'aucun modèle Claude ne propose sur cet axe d'entrée. Et son niveau de réflexion réglable signifie que vous pouvez l'exécuter avec un effort faible pour les tâches routinières bon marché et avec un effort élevé pour le sous-ensemble plus difficile, en ne payant que pour le raisonnement que vous utilisez.
Le playbook du pairing
Les praticiens sur le terrain ont largement cessé de traiter cela comme un choix binaire, et le schéma qui revient sans cesse est une boucle diviser pour régner : Claude Opus 5 assure la planification et la conception, Gemini 3.7 Flash réalise l'implémentation à grand volume, et Opus 5 assure la relecture. Chaque modèle est utilisé là où son rapport qualité/coût est le meilleur, et le pipeline combiné est à la fois moins cher et plus rapide que l'exécution de l'un ou de l'autre seul. Une couche de routage rend ce schéma pratique plutôt qu'architectural : Claude Opus 5 est disponible sur OrcaRouter au prix catalogue d'Anthropic avec une marge de 0 %, et le DSL de routage permet de composer un seul appel qui envoie le planificateur à Opus 5 et l'exécuteur vers les modèles de classe Flash derrière un endpoint compatible OpenAI — avec la fusion de modèles comme étape supplémentaire, où les deux modèles répondent à la même question et un juge réconcilie les deux verdicts.

Le projet de loi, côte à côte
Prenons des chiffres concrets. Une journée de 10 millions de jetons d'entrée et 1 million de jetons de sortie — un pipeline agentique lourd mais ordinaire — coûte 75 $ + 375 $ = 450 $ au tarif standard de Claude Opus 5. Le même trafic au tarif promotionnel de Gemini 3.7 Flash coûte 7,50 $ + 37,50 $ = 45 $, soit exactement un dixième. Même en tenant compte des réductions de cache d'Opus côté entrée, l'écart est d'un ordre de grandeur, et c'est la raison pour laquelle « flash pour le volume, opus pour les cas difficiles » est devenu la configuration de production par défaut plutôt qu'une option exotique. Quand la promotion se terminera, le taux d'entrée de Gemini 3.7 Flash doublera pour atteindre 1,50 $ — toujours un tiers de celui d'Opus, et toujours assez bas pour préserver l'arithmétique du duo.
La lecture honnête
L'écart de cinq points est réel et il se situe exactement là où on l'attend : sur les travaux les plus difficiles, à l'horizon le plus long. Si votre charge de travail est dominée par cette queue de distribution — recherche de pointe, ingénierie autonome de plusieurs heures, utilisation d'ordinateur — Claude Opus 5 justifie son prix et vous ne devriez pas trop y réfléchir. Si votre charge de travail est dominée par le volume, la latence ou le long contexte, Gemini 3.7 Flash au tarif promotionnel est un bien meilleur achat, d'un ordre de grandeur, et l'écart avec le modèle phare est d'un palier de benchmark, pas d'un gouffre. Les modèles convergent, et la réponse pratique pour la plupart des équipes n'est plus « lequel » mais « quelles parties du travail confier à chacun ».
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
