
Grok 4.7 vs Gemini 3.1 Pro : le classement a bougé, pas le modèle
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Le 19 février 2026, Artificial Analysis a publié un article intitulé « Gemini 3.1 Pro Preview : le nouveau leader de l’IA ». Il arrivait en tête dans six évaluations sur dix et comptait quatre points d’avance sur Claude Opus 4.6. Consultez aujourd’hui la page de ce même modèle, et le chiffre est 30, classé 69e sur 200. Le fournisseur n’a rien modifié. Ce qui a changé, c’est la règle de mesure : Artificial Analysis a révisé son Intelligence Index en v4.3.2 le 19 septembre 2026, réévaluant chaque modèle du catalogue selon un ensemble d’évaluations différent, et un leader de février est devenu un milieu de tableau de septembre, tandis que le modèle lui-même restait inchangé en preview. C’est le contexte d’une comparaison avec Grok 4.7 — publié par le fournisseur le 21 septembre 2026 — et c’est la raison pour laquelle cette confrontation porte moins sur le modèle le plus intelligent que sur lequel de ces deux vous pouvez encore compter pour rester la même chose le mois prochain.
Ce qu'est réellement chacun de ces éléments
Gemini 3.1 Pro est le modèle de niveau Pro le plus récent de Google et il n'a jamais atteint la disponibilité générale. Il a été livré sous le nom gemini-3.1-pro-preview le 19 février 2026, et le tableau des dépréciations de Google le répertorie toujours avec la mention « aucune date d'arrêt annoncée » — un modèle en preview qui est désormais en preview depuis sept mois, tandis que Google a livré toute une gamme de modèles Flash en dessous : 3.5 Flash en mai, 3.6 en juillet, 3.7 en août, 3.8 en septembre. Aucun modèle Pro en disponibilité générale n'est plus récent que Gemini 3 Pro. Il dispose d'une fenêtre d'entrée de 1 048 576 tokens et d'un plafond de sortie de 65 536 tokens, accepte du texte, des images, de la vidéo, de l'audio et des PDF en entrée avec du texte en sortie, et expose un contrôle du niveau de réflexion avec les niveaux faible, moyen et élevé, sans paramètre de budget ni réglage minimal. Les poids sont fermés.
Grok 4.7 n’a qu’un jour et est également à poids fermés. Il dispose d’un contexte de 500 k tokens — la moitié de celui de Gemini — et prend en entrée du texte et des images, de sorte qu’il ne peut pas du tout ingérer de vidéo ou d’audio, ce qui est la différence de capacités la plus marquée de cette comparaison. Son tarif est de 2,00 $ par million de tokens d’entrée et de 6,00 $ par million de tokens de sortie en dessous de 200 k tokens de prompt, passant à 4,00 $ et 12,00 $ au-delà de ce seuil, avec des lectures en cache à 0,50 $ et 1,00 $ ; xAI propose également une variante plus rapide, à environ deux fois la vitesse de sortie et deux fois le prix. Aucune valeur maximale de sortie n’est publiée à son sujet dans la documentation consultée ici.
La règle a bougé. C'est toute l'histoire.
Les deux modèles sont actuellement évalués sur l'Artificial Analysis Intelligence Index v4.3.2, qui a remplacé Terminal-Bench 2.1 par Terminal-Bench 4.0 et tau3-Banking par AutomationBench-AA, et a réancré l'échelle Elo GDPval-AA. Le score de chaque modèle a changé au moment de son intégration. Celui de Gemini 3.1 Pro a bougé davantage que la plupart, car ses points forts de février étaient concentrés dans des évaluations que le nouvel indice a soit retirées, soit repondérées. Si l'on lit les deux colonnes côte à côte aujourd'hui :
• Composite — Grok 4.7 (xhigh) : 46 sur l'Artificial Analysis Intelligence Index v4.3.2. Gemini 3.1 Pro Preview : 30 sur la même révision, classé n° 69 sur 200.
• Contexte long — Grok 4.7 : fenêtre de 500 k, AA-LCR v1.1 77 %. Gemini 3.1 Pro : fenêtre de 1 M — deux fois plus grande — et un plafond de sortie de 65 k, soit environ la moitié de ce qu'exige habituellement une session agentique à contexte long.
• Modalité d'entrée — Grok 4.7 : texte et image. Gemini 3.1 Pro : texte, image, vidéo, audio et PDF. L'écart n'est pas mince, et ce n'est pas un écart de benchmark — c'est un écart de capacités.
• Vitesse — Grok 4.7 : aucune mesure publiée pour l'instant. Gemini 3.1 Pro : 124,4 jetons de sortie par seconde, classé n° 39 sur 200, avec un délai de 63,62 secondes avant le premier jeton via Google AI Studio.
• Prix, palier standard — Grok 4.7 : 2,00 $ en entrée / 6,00 $ en sortie par million. Gemini 3.1 Pro : 2,00 $ en entrée / 12,00 $ en sortie. Entrée identique, sortie deux fois plus élevée.
• Prix, palier de contexte long — Grok 4.7 : double pour atteindre 4,00 $ / 12,00 $ à 200 k tokens de prompt. Gemini 3.1 Pro : passe à 4,00 $ / 18,00 $ à la même limite de 200 k. Même entrée, 50 % de sortie en plus.
• Maturité — Grok 4.7 : un jour d'existence, les benchmarks du fournisseur largement non reproduits. Gemini 3.1 Pro : sept mois sur le marché, mais toujours une version préliminaire sans engagement de disponibilité générale ni date d'arrêt.

Le problème de l'aperçu est désormais bien réel.
Un aperçu de sept mois serait une anomalie plutôt qu’un risque si rien n’avait mal tourné. Or, quelque chose a mal tourné. À partir du 18 septembre 2026, des utilisateurs ont commencé à signaler que Gemini 3.1 Pro avait disparu du sélecteur de modèles d’AI Studio, et au moment d’écrire ces lignes, il n’y a eu aucune réponse du personnel de Google, aucun avis de dépréciation et aucune cause indiquée — un incident de disponibilité non résolu plutôt qu’un retrait confirmé. À mettre en regard de l’historique des annonces : Google a déclaré à l’I/O en mai 2026 que Gemini 3.5 Pro allait être « déployé le mois suivant », et des articles de presse fin août indiquaient que ce modèle avait été abandonné parce que les candidats internes « n’étaient pas suffisamment meilleurs que la série Flash ». La page Pro de Google elle-même annonce encore « 3.5 Pro bientôt disponible », ce qui est la contradiction sur un seul écran. Quelle que soit l’issue, la lecture pratique est que Gemini 3.1 Pro est un point de terminaison d’aperçu sans date de GA, sans successeur nommé et avec un point d’interrogation actuel sur sa disponibilité.
Le risque de Grok 4.7 est le reflet symétrique, en plus réduit. Il n’a qu’un jour, donc ses chiffres sont minces — Artificial Analysis n’a publié aucune mesure de vitesse ou de latence, et la suite de benchmarks de xAI pour ce modèle n’a pas été reproduite indépendamment. Ce qui n’est pas en question, c’est que le modèle est en disponibilité générale, avec un prix, documenté et stable quant à son identité. Un modèle dont l’identité est stable et dont les chiffres ne sont pas prouvés est bien plus facile à prendre comme base qu’un modèle dont les chiffres sont publiés et dont la disponibilité ne l’est pas.
Ce que coûte la séparation, en pratique
Supposons que vous choisissiez pour un pipeline de documents. Sur 100 k tokens d'entrée et 8 k de sortie, Grok 4.7 coûte 0,20 $ en entrée et 0,048 $ en sortie — environ un quart de dollar. Gemini 3.1 Pro coûte 0,20 $ en entrée et 0,096 $ en sortie — environ trente cents. Les deux se situent à moins de vingt pour cent d'écart, et si vos documents sont des numérisations, des PDF, de l'audio ou de la vidéo, Gemini est le seul des deux à pouvoir les lire. Ce n'est pas un argument de benchmark ; cela met fin à la comparaison pour cette charge de travail.
Supposons maintenant que vous choisissiez pour un agent à long contexte. Avec 300 k en entrée et 8 k en sortie, Grok 4.7 coûte 1,20 $ en entrée et 0,096 $ en sortie, soit environ 1,30 $. Gemini 3.1 Pro coûte 1,20 $ en entrée et 0,144 $ en sortie, soit environ 1,35 $. En pratique identiques — et ici, la fenêtre de 1 M et le plafond de sortie de 65 K de Gemini deviennent la contrainte qui détermine le choix, car un plafond de 65 K est le point où les exécutions agentiques longues s'effondrent. Aucun des deux modèles n'est l'option bon marché dans cette confrontation, et aucun des deux n'est cher selon les standards de pointe.

Contourner une cible mouvante
OrcaRouter propose Gemini 3.1 Pro, répertorié sur sa propre page modèle aux tarifs du fournisseur — $2.00 en entrée et $12.00 en sortie, avec la fenêtre de 1M et une sortie maximale de 65k — parce que nous répercutons la tarification catalogue du fournisseur à 0 % de marge. Ce n'est pas un argument marketing dans un cas comme celui-ci : Google a une version d'aperçu non tarifée et à durée indéterminée, dont la disponibilité a vacillé en septembre, et ce qu'un routeur fait d'utile, c'est garder l'intégration stable pendant que ce qui se trouve derrière elle change. Le basculement automatique fait qu'un point de terminaison d'aperçu qui cesse de répondre devient un événement de routage plutôt qu'une panneEt le DSL de routage vous permet de composer un modèle multimodal avec un modèle purement textuel en un seul appel — ce qui correspond exactement à la configuration que suggère ce duo, Gemini lisant la vidéo et Grok menant le raisonnement sur sa transcription. Grok 4.7 ne figure pas au catalogue d'OrcaRouter à l'heure où nous écrivons ; l'appeler aujourd'hui implique de passer par l'API propre à xAI et par les plateformes tierces qui le proposent.
Le schéma à mettre en place : conservez Gemini 3.1 Pro pour tout ce qui doit ingérer de la vidéo, de l’audio ou du PDF, et considérez son statut de préversion comme un risque opérationnel à contourner plutôt qu’une raison de l’éviter. Réservez Grok 4.7 aux tâches de texte et d’image où s’appliquent son prix de sortie inférieur et son score composite plus élevé, et où le modèle que vous intégrez aujourd’hui est celui que vous appellerez encore dans six mois. La seule chose à ne pas faire est de lire le classement à la soixante-neuvième place comme un verdict sur le modèle — c’est un verdict sur une révision de benchmark, et la même révision qui a rétrogradé Gemini 3.1 Pro a aussi rétrogradé des dizaines de modèles que Google n’a jamais touchés.
L'appel
Sur l’indice actuel, Grok 4.7 devance Gemini 3.1 Pro de seize points, et sur le prix de sortie, il coûte moitié moins dans le niveau standard et un tiers de moins dans le niveau à contexte long. Si votre charge de travail est constituée de texte et d’images, cela suffit pour trancher. Si votre charge de travail est constituée de vidéo, d’audio ou de documents numérisés, Gemini 3.1 Pro est le seul candidat des deux et la comparaison s’arrête là — vous achetez une capacité, pas un score. La mise en garde qui devrait accompagner les deux concerne la provenance plutôt que la performance : l’un est un aperçu vieux de sept mois, sans date de disponibilité générale et avec un incident de disponibilité en septembre derrière lui, l’autre a un jour et affiche un chiffre phare sans reproduction indépendante de tout le reste. Ni l’un ni l’autre n’est un choix définitif. Les deux méritent d’être routés plutôt que d’être adoptés définitivement.

Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
