
Gemini 3.7 Flash vs Gemini 3.1 Pro : Le niveau Flash de Google a-t-il rendu son propre produit phare obsolète ?
- AlibabaNOUVEAUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiNOUVEAUZ.ai: GLM 5.3 Flash2026-08-2658Intelligence72Code
- DeepSeekNOUVEAUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligence75Code
- obsidianQwen3.8 27B2026-08-1552Intelligence68Code
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1261Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0557Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
- metaMeta: Muse Spark 1.12026-07-1653Intelligence71Code
- kimiMoonshotAI: Kimi K32026-07-1560Intelligence76Code
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligence71Code
Une question gênante se cache dans la gamme de modèles 2026 de Google, et elle s'adresse à toutes les équipes qui paient actuellement pour Gemini 3.1 Pro : pourquoi le modèle Flash, pourtant bon marché, surpasse-t-il le modèle phare sur l'indice indépendant ? Gemini 3.7 Flash, publié le 13 août 2026 à 0,75 $ par million de jetons d'entrée et 3,75 $ par million de sortie, obtient un score de 56 sur l'Artificial Analysis Intelligence Index en raisonnement élevé. Gemini 3.1 Pro, la préversion que Google a publiée le 19 février 2026 à 2,00 $ / 12,00 $ — et 4,00 $ / 18,00 $ au-delà de 200K de contexte — se situe dans le haut de la quarantaine sur le même indice aujourd'hui. Le modèle phare, qui dominait l'indice au lancement, a été dépassé par ses propres modèles de travail, et cet article explique ce que cela signifie pour les deux modèles, et pour les équipes qui doivent choisir entre eux.
La prémisse : le niveau haut de gamme de Google est bloqué en aperçu.
Le contexte compte plus que les chiffres. Gemini 3.1 Pro est disponible en préversion depuis février 2026 — sept mois à ce jour — et son successeur, Gemini 3.5 Pro, annoncé lors de la Google I/O en mai comme « arrivant le mois prochain », a ensuite manqué juin, juillet et août. Début septembre, le niveau phare n'a aucun successeur publié, aucune date, et des informations font état d'une possible annulation. Pendant ce temps, le niveau Flash a lancé trois générations sur la même période : Gemini 3.6 Flash le 21 juillet, Gemini 3.7 Flash le 13 août, et la capacité de compréhension vidéo agentique sur les deux le 1er septembre. La comparaison n'est pas vraiment « Pro vs Flash ». C'est « le niveau que Google lance » contre « le niveau que Google a cessé de lancer ».
Le contraste de spécification
• Prix — Gemini 3.7 Flash 0,75 $ / 3,75 $ par million de jetons (promo jusqu'au 31 déc. 2026, puis 1,50 $ / 7,50 $) contre Gemini 3.1 Pro 2,00 $ / 12,00 $ pour un contexte inférieur à 200K, passant à 4,00 $ / 18,00 $ au-delà de 200K. Trois à quatre fois moins cher au prix catalogue, avant les contrôles du niveau de raisonnement.
• Contexte / sortie maximale — 1M / 64K vs 1M / 64K. Plafonds identiques.
• Entrées — à la fois texte, image, audio, vidéo, PDF. La surface multimodale est la même ; la différence réside dans ce que le modèle fait avec la vidéo (ci-dessous).
• Contrôle du raisonnement — Gemini 3.7 Flash réflexion faible / moyenne / élevée. Gemini 3.1 Pro faible / moyenne / élevée avec réflexion dynamique activée par défaut.
• Score indépendant — Gemini 3.7 Flash : 56 sur l'Artificial Analysis Intelligence Index, contre Gemini 3.1 Pro dans le haut de la quarantaine sur la version actuelle de l'index (ce dernier a obtenu 57 au lancement sous la version précédente).
• Vitesse de sortie — Gemini 3.7 Flash environ 285 tokens/sec avec un raisonnement élevé contre Gemini 3.1 Pro environ 112–125 tokens/sec — environ deux fois et demie plus rapide.
• Statut — Gemini 3.7 Flash stable, GA. Gemini 3.1 Pro en preview, avec la courte fenêtre de dépréciation de la preview.
L'indice, et le désordre des benchmarks en dessous.
Le titre, c'est l'indice : Artificial Analysis, l'évaluateur indépendant multi-fournisseurs, classe désormais Gemini 3.7 Flash à 56 et Gemini 3.1 Pro dans le haut de la quarantaine — le cheval de trait devant le fleuron, une inversion des positions par rapport au lancement de 3.1 Pro, quand son 57 trônait en tête de l'indice. C'est le fait le plus important de ce face-à-face, et il provient d'une source indépendante plutôt que du fournisseur.
Sous l’indice, le registre des benchmarks est un fouillis de harnais non comparables, et le lire naïvement donne la mauvaise réponse. Le record publié de Gemini 3.1 Pro — 80,6 % sur SWE-bench Verified, 77,1 % sur ARC-AGI-2, 94,3 % sur GPQA Diamond, un Elo de 2887 sur LiveCodeBench Pro — a été rapporté par Google lors de son lancement en février, utilise des versions de benchmark différentes de celles des chiffres de Flash, et n’a jamais été reproduit de manière uniforme. Les 43,6 % de Gemini 3.7 Flash sur FrontierCode 1.1, 65,3 % sur DeepSWE v1.1 et 1588 Elo dans l’arène de développement web sont également rapportés par le fournisseur sur les harnais plus récents. Là où les deux se recoupent sur un agrégat indépendant — l’AA Index — c’est Flash qui gagne. Quiconque vous dit que « Pro bat Flash sur SWE-bench » compare deux versions de deux tests différents sans le dire.


L'écart de capacités vidéo
La capacité qui rend la comparaison déséquilibrée, c'est la vidéo. Le nouveau mode agentique de compréhension vidéo de Google — annoncé le 1er septembre 2026 — s'applique à Gemini 3.7 Flash, Gemini 3.6 Flash et Gemini 3.5 Flash-Lite. Gemini 3.1 Pro n'est pas sur la liste. Le modèle Flash lit la vidéo comme le nouveau mode définit la lecture vidéo : le modèle décide quoi regarder, à quelle vitesse, et par le biais des images, de l'audio ou de la transcription, en ne chargeant que les segments pertinents, avec des économies rapportées par le fournisseur allant jusqu'à 66 % sur les coûts et 88 % sur les tokens. Gemini 3.1 Pro accepte techniquement les entrées vidéo, mais il utilise l'ancienne voie d'échantillonnage statique et ne bénéficie d'aucun des nouveaux outils. Pour les utilisateurs du modèle phare, la toute nouvelle capacité vidéo de la famille Gemini est déployée d'abord sur le modèle le moins cher, et le niveau Pro n'a aucune date annoncée pour la recevoir.
Vitesse, et le problème du risque d’aperçu
La vitesse accentue l’écart de prix exactement comme dans chaque confrontation avec Gemini 3.7 Flash : environ trois fois le débit de sortie sur un modèle qui coûte déjà un tiers du prix. Mais la deuxième différence est celle que les équipes oublient de chiffrer : le statut. Gemini 3.1 Pro est un aperçu, et les aperçus s’accompagnent d’un court délai d’avis de dépréciation lorsque le successeur arrive. Une charge de travail en production sur un modèle en aperçu représente un risque permanent que l’identifiant du modèle change, que la tarification change ou que les capacités évoluent sans grand préavis. Gemini 3.7 Flash est en disponibilité générale — stable, documenté, et sans remplacement programmé à la légère, même si le rythme quasi mensuel des Flash chez Google signifie qu’un 3.8 Flash pourrait arriver rapidement. Le risque de dépréciation de l’aperçu 3.1 Pro n’est pas hypothétique ; c’est l’état actuel d’un palier dont le successeur est retardé depuis trois mois.
Là où Gemini 3.1 Pro gagne encore
Le plaidoyer honnête en faveur de 3.1 Pro repose sur trois piliers, et aucun d'entre eux n'est la capacité brute. Premièrement, l'endpoint d'outils personnalisés : Gemini 3.1 Pro est servi avec une surface d'API bash/outils personnalisés dédiée que Flash ne propose pas, et les équipes qui ont construit leur outillage d'agents sur cette base disposent d'un système fonctionnel dès aujourd'hui. Deuxièmement, les charges de travail optimisées : un pipeline déjà réglé sur les paramètres par défaut de pensée dynamique de 3.1 Pro, ses schémas de cache et ses scores d'évaluation est une cible mouvante, et changer de modèle coûte un temps d'ingénierie réel, même lorsque la destination est plus rapide et moins chère. Troisièmement, les tâches spécifiques pour lesquelles le bilan de production plus long de Pro n'a toujours pas d'équivalent chez Flash — les benchmarks de génération de lancement comme GPQA et ARC-AGI-2, sur lesquels Flash n'a jamais été mesuré. Si votre charge de travail en fait partie, « Flash surpasse Pro dans l'indice » ne tranche pas votre question ; seul un test sur votre propre évaluation le fera.
Le verdict : ce que signifie la prise de contrôle du niveau Flash
La direction est sans ambiguïté. Pour une nouvelle charge de travail aujourd'hui, Gemini 3.7 Flash est le meilleur Gemini par défaut : moins cher, plus rapide, GA-stable, mieux classé sur l'indice indépendant, et il reçoit la nouvelle capacité vidéo en premier. Gemini 3.1 Pro conserve une base réelle mais étroite — les utilisateurs d'outils personnalisés, les pipelines optimisés, et les tâches où son ancien record de référence reste valable. Le constat plus large est que la gamme phare de Google est au point mort, tandis que c'est sur sa gamme de travail que l'entreprise est réellement en concurrence — et les équipes qui paient encore les prix phares pour 3.1 Pro paient pour un statut que l'entreprise elle-même a cessé de défendre.

Pour les équipes qui souhaitent migrer sans projet, le passage entre les modèles Gemini est un changement de nom de modèle plutôt qu'une intégration. Gemini 3.1 Pro est servi sur OrcaRouter à son prix catalogue de 2,00 $ / 12,00 $, répercuté sans marge (0 %), aux côtés de Gemini 3.6 Flash et du reste du palier Gemini routable derrière une seule clé — ainsi, une charge de travail peut envoyer une partie de son trafic vers un modèle Flash, conserver 3.1 Pro en secours pour les tâches où il reste gagnant, et laisser le basculement automatique absorber le risque que l'un ou l'autre des modèles de Google change. Gemini 3.7 Flash est quant à lui disponible via l'API propre de Google et plusieurs plateformes tierces. Le DSL de routage et la fusion de modèles sont exactement ce qu'il faut pour effectuer une comparaison équitable entre les deux modèles Gemini sur votre propre évaluation avant de basculer. Le choix vers lequel la gamme vous pousse est clair : privilégier par défaut le palier Flash, et ne garder Pro que pour les cas précis où il démontre qu'il justifie son prix supérieur.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
