Carte de titre principale pour l'explicatif Grok 4.5 : le titre « Qu'est-ce que Grok 4.5 ? » au-dessus du sous-titre « Le flagship V9 qui a vendu l'économie de tokens, pas les meilleurs scores », puis trois cartes indiquant « Contexte - 500K tokens », « Prix catalogue par million - 2,00 $ / 6,00 $ » et « AA Intelligence - 39 », avec une ligne de pied de page « Grok 4.5 sorti le 8 juillet 2026. Prix selon la documentation xAI ; chiffre AA selon l'Artificial Analysis Intelligence Index v4.3.2. » et le logo OrcaRouter dans le coin inférieur droit.
Guides & Insights

Qu'est-ce que Grok 4.5 ? Le modèle phare V9 qui a vendu l'économie de tokens au lieu de scores élevés

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Grok 4.5 est un modèle de raisonnement à mélange d'experts de 1 500 milliards de paramètres du fournisseur — l'entreprise qui livre et commercialise désormais sous la marque SpaceXAI — sorti le 8 juillet 2026. Il accepte du texte et des images en entrée, renvoie du texte, dispose d'une fenêtre de contexte de 500 000 jetons et est proposé à 2,00 $ par million de jetons d'entrée et 6,00 $ par million de jetons de sortie. C'est le modèle qui a mis « jetons par tâche terminée » à l'avant d'une diapositive de lancement, et c'est le modèle sur lequel le laboratoire a depuis bâti deux fleurons plus récents.

Cette dernière clause est toute la raison pour laquelle cette page doit être écrite. Cherchez « Grok 4.5 » et vous obtenez une couverture de lancement de juillet : le partenariat avec Cursor, la citation « classe Opus », l’affirmation des 80 tokens par seconde. Ce que vous n’obtenez pas, c’est une réponse directe à la question qu’un développeur se pose réellement fin septembre : savoir si Grok 4.5 vaut encore la peine d’être intégré à quoi que ce soit alors que Grok 4.6 et Grok 4.7 existent au même prix catalogue. Cette page est donc une entrée de référence, pas un article d’actualité : ce qu’est le modèle, où il se situe, ce qu’il fait mesurablement bien, ce qu’il fait mesurablement mal, et qui devrait choisir autre chose. Rien ici n’est présenté comme un lancement, parce que ce n’en est pas un.

En ce qui concerne les sources, car cela compte plus que d’habitude sur une page comme celle-ci : chaque chiffre ci-dessous est étiqueté selon sa provenance. Les chiffres que xAI a publiés sur son propre modèle sont marqués comme déclarés par le fournisseur. Les chiffres d’Artificial Analysis sont des mesures indépendantes, relevées directement sur la page du modèle le 23 septembre 2026. Lorsqu’un chiffre n’a pas pu être confirmé par une source primaire, la page l’indique au lieu de l’estimer.

Où se situe Grok 4.5 dans sa propre famille — et ce n'est pas le sommet

L’erreur la plus courante dans la couverture de Grok 4.5 est de le traiter comme le modèle phare. Il l’a été, pendant environ cinq semaines. Depuis, xAI a lancé Grok 4.6 le 12 août 2026 et Grok 4.7 début septembre, tous deux encore facturés à 2,00 $ et 6,00 $ par million de tokens. Grok 4.5 occupe désormais le milieu de la gamme : plus capable que l’offre bon marché, deux générations derrière le haut de gamme et — c’est là le point important — le seul modèle de la gamme Grok actuelle dont le tarif des entrées mises en cache est inférieur à celui de ses successeurs. La mise en cache de Grok 4.5 est facturée à 0,30 $ par million de tokens ; celle de Grok 4.6 et de Grok 4.7 est de 0,50 $, selon le propre tableau tarifaire de xAI.

Voici la gamme telle que la documentation tarifaire du fournisseur la répertorie actuellement, tous les chiffres étant par million de tokens et tous publiés par le fournisseur :

• Grok 4.20 (trois variantes : multi-agent, raisonnement, sans raisonnement) — contexte de 1 M, 1,25 $ en entrée / 2,50 $ en sortie, 0,20 $ en cache, sorti le 31 mars 2026

• Grok 4.3 — contexte de 1 M, 1,25 $ en entrée / 2,50 $ en sortie, 0,20 $ en cache, plus une remise par lots ; le moyen le moins cher d’obtenir un million de tokens de contexte Grok

• Grok 4.5 — contexte de 500K, 2,00 $ en entrée / 6,00 $ en sortie, 0,30 $ en cache, sorti le 8 juillet 2026

• Grok 4.6 — 500K de contexte, 2,00 $ en entrée / 6,00 $ en sortie, 0,50 $ en cache, publié le 12 août 2026

• Grok 4.7 — contexte de 500 K, 2,00 $ en entrée / 6,00 $ en sortie, 0,50 $ en cache, sorti début septembre 2026

• Grok Build 0.1 — contexte de 256 K, 1,00 $ en entrée / 2,00 $ en sortie, un spécialiste du codage plutôt qu'un modèle généraliste

Deux choses ressortent de cette liste. Premièrement, Grok 4.5 n’a pas bénéficié d’une baisse de prix lorsqu’il a cessé d’être le modèle phare — il a conservé le prix du modèle phare, ce qui signifie que Grok 4.6 offre désormais un rapport qualité-prix strictement meilleur pour le même prix, à moins que vous ne vouliez spécifiquement le tarif de cache moins cher ou que vous soyez verrouillé sur le snapshot 4.5. Deuxièmement, Grok 4.5 a la moitié du contexte de Grok 4.3 et de la famille 4.20, pour un prix d’entrée deux fois plus élevé. La fondation V9 en est la raison : 1 500 milliards de paramètres, environ trois fois la taille de Grok 4.3, et c’est un modèle de base plus grand qui a permis d’obtenir cette capacité au détriment de la fenêtre.

Si ce dont vous avez réellement besoin, c’est d’un contexte long avec un budget limité, Grok 4.3 est la réponse honnête au sein de cette famille, et Grok 4.5 ne l’est pas. Cet arbitrage — la capacité contre la fenêtre — est la décision déterminante dans la gamme Grok, et il vaut la peine de le dire clairement plutôt que de prétendre que le numéro le plus récent est meilleur en tout.

La fiche technique

Screenshot of the xAI developer documentation model page for grok-4.5, showing the model identifier and aliases grok-4.5-latest and grok-build-latest, the description 'intelligent coding model for agentic software, engineering, and workflow tasks', an At a glance block giving modalities 'Text, Image to Text' and a 500,000-token context window, capability rows for function calling, structured outputs and reasoning, and the pricing rows $2.00 input, $0.30 cached input and $6.00 output per million tokens, above a collapsed 'Higher context pricing' note about requests exceeding the 200K context window.

Voici les spécifications que xAI publie sur sa propre page de modèle, et non des estimations de tiers :

• Identifiant du modèle — grok-4.5, avec les alias grok-4.5-latest et grok-build-latest

• Modalité — texte et image en entrée, texte en sortie. Les images sont acceptées en entrée ; le modèle ne les génère pas

• Fenêtre de contexte — 500 000 tokens, partagés entre le prompt et la réponse plutôt que 500 K en entrée plus une allocation de sortie séparée

• Licence — propriétaire. Il n'y a pas de poids ouverts ni de checkpoint téléchargeable ; vous accédez à Grok 4.5 via une API ou via les produits du fournisseur lui-même

• Prix catalogue — 2,00 $ par million de jetons d'entrée, 6,00 $ par million de jetons de sortie, 0,30 $ pour les jetons d'entrée mis en cache

• Tarification des contextes longs — à partir de 200 000 jetons de prompt, le tarif passe à 4,00 $ en entrée / 12,00 $ en sortie / 0,60 $ en cache, et le tarif plus élevé s’applique à chaque jeton de la requête, pas seulement aux jetons au-delà du seuil. C’est le détail le plus coûteux à manquer sur cette page

• Contrôle du raisonnement — quatre niveaux, faible, moyen, élevé et très élevé, par défaut : élevé. Le raisonnement ne peut pas être entièrement désactivé, et les jetons de raisonnement sont facturés comme des jetons de sortie.

• Prise en charge des outils et des formats — l'appel de fonctions et les sorties structurées sont pris en charge nativement. Les outils de recherche côté serveur sont facturés en plus de la consommation de tokens ; nous n'avons pas pu confirmer les tarifs actuels par appel sur la page du modèle du fournisseur, seulement qu'ils existent

• Limites de débit — 150 requêtes par seconde et 50 millions de jetons par minute

• Batch API — non prise en charge sur Grok 4.5, contrairement à Grok 4.3

• Régions desservies — us-east-1 et us-west-2 au lancement. La disponibilité européenne n'était explicitement pas disponible dès le premier jour et a été décrite par le fournisseur comme prévue à la mi-juillet 2026 ; nous n'avons pas trouvé de déclaration ultérieure de source primaire confirmant la date exacte de son ouverture, donc considérez ici la chronologie de l'UE comme non confirmée

Une divergence qui mérite d’être consignée plutôt que gommée : la propre fiche de catalogue d’OrcaRouter pour grok/grok-4.5 indique un tarif de lecture du cache de $0.50 par million, ce qui correspond à ce que xAI facture pour Grok 4.6 et Grok 4.7, plutôt qu’aux $0.30 que le tableau tarifaire du fournisseur indique pour Grok 4.5. La documentation du fournisseur fait autorité sur le prix ; notre page semble reprendre le tarif de cache du successeur, et cela a été signalé plutôt que discrètement répété ici.

Ce dans quoi Grok 4.5 est mesurablement bon

La promesse phare au lancement était l'économie de jetons, et c'est la seule affirmation de la page de lancement qui repose sur un mécanisme plutôt que sur un simple score. Sur SWE-bench Pro, xAI rapporte que Grok 4.5 génère en moyenne 15 954 jetons de sortie par tâche résolue, contre 67 020 pour Claude Opus 4.8 fonctionnant à effort maximal — soit environ 4,2 fois moins de jetons pour accomplir le même travail. Produire moins de jetons de sortie par tâche résolue, c'est la différence entre un modèle qui est moins cher et plus rapide en temps réel, car les jetons de sortie sont précisément ce que vous attendez. Rapporté par le fournisseur, sur le propre harnais d'évaluation du fournisseur, et non reproduit par un tiers indépendant — mais il s'agit d'une affirmation structurelle, et non d'un pourcentage choisi avec soin.

Le tableau de référence du fournisseur, publié avec le modèle et donc rapporté par le fournisseur d'un bout à l'autre, se présente comme suit face aux mêmes modèles :

• DeepSWE 1.0 — Grok 4.5 62,0 %, derrière Claude Fable 5 à 66,1 % et GPT-5.5 à 64,31 %, devant Claude Opus 4.8 à 55,75 %

• SWE Marathon, taux de résolution — Grok 4.5 29,0 %, devant Claude Opus 4.8 à 26,0 % et Claude Fable 5 à 24,0 %. C’est le seul benchmark de codage où Grok 4.5 a été en tête.

• Terminal-Bench 2.1 — Grok 4.5 83,3 %, pratiquement au même niveau que Claude Fable 5 à 84,3 % et GPT-5.5 à 83,4 %, devant Claude Opus 4.8 à 78,9 %

• DeepSWE 1.1 — Grok 4.5 53 %, derrière Claude Fable 5 à 70 % et GPT-5.5 à 67 %

• SWE-bench Pro — Grok 4.5 64,7 %, derrière Claude Fable 5 à 80,4 % et Claude Opus 4.8 à 69,2 %

La lecture honnête est que Grok 4.5 gagne sur la résolution de tâches à long horizon et sur l'économie de l'achèvement d'une tâche, et perd sur les benchmarks de codage en un seul coup plus difficiles. C'est un bon modèle pour les boucles d'agents et un modèle médiocre pour les problèmes difficiles en un seul coup — et cette distinction est exactement ce que le chiffre d'efficacité des tokens prédit qu'elle devrait être.

A single-column scoreboard card for Grok 4.5 titled 'Grok 4.5 - the scoreboard' with six rows reading: AA Intelligence Index 39 (#52 of 212); Output speed 55.1 tok/s (#126 of 212); Time to first token 10.94 s; Context window 500K tokens; Price per 1M $2.00 / $6.00, $0.30 cached; SWE-bench Pro 64.7% (vendor). Footer: 'Price and spec rows per xAI docs; AA Index and speed per Artificial Analysis Intelligence Index v4.3.2; SWE-bench Pro vendor-reported.'

Le tableau indépendant est plus ténu, et c’est là que cette page doit être prudente. Artificial Analysis classe actuellement Grok 4.5 (high) à un score de 39 à l’Indice d’intelligence, au 52e rang sur 212 modèles, sur la version v4.3.2 de l’indice — au-dessus de la médiane de 25 pour les modèles comparables, mais pas près de la tête. Si vous avez vu un score de 54 ou 56 cité pour ce modèle dans la couverture de juillet, ne le comparez pas à 39 : Artificial Analysis a révisé l’indice depuis le lancement et les deux chiffres proviennent de révisions différentes. C’est exactement le genre de comparaison de chiffres périmés qui rend les tableaux de benchmarks peu fiables, et c’est pourquoi cette page indique la version de l’indice à côté du score.

Ce en quoi Grok 4.5 est mesurablement mauvais

Artificial Analysis rapporte une vitesse de sortie de 55,1 jetons par seconde, classé n°126 sur 212 modèles et inférieur à la médiane de 74 — loin des 80 jetons par seconde cités par xAI au lancement et encore plus loin des ~340 jetons par seconde qu’affichent les modèles actuels les plus rapides. Il rapporte également un temps jusqu’au premier jeton de 10,94 secondes contre une médiane de 3,86 secondes. Ces deux chiffres décrivent ensemble le coût réel d’un modèle de raisonnement qui est par défaut en élevé et ne peut pas être désactivé : vous attendez, puis il parle lentement. Laissez le niveau de raisonnement à sa valeur par défaut et Grok 4.5 donnera l’impression d’être le modèle le plus lent que vous ayez sur la clé.

Trois autres points négatifs mesurés, par ordre d’importance de leur influence sur une décision :

• Artificial Analysis a signalé que Grok 4.5 est obsolète et indique qu'il continue à n'évaluer que la charge de travail par défaut de 10 000 jetons en entrée pour celui-ci. C'est un tiers qui vous dit qu'il a cessé de mesurer pleinement le modèle que vous envisagez, et il recommande plutôt Grok 4.6. Le fait qu'un modèle soit obsolète sur un classement ne signifie pas qu'il soit indisponible via une API — cela signifie que la base de preuves indépendantes est figée.

• Il perd les deux benchmarks qui ressemblent le plus à du codage difficile en un seul essai : DeepSWE 1.1 et SWE-bench Pro, tous deux face à Claude Fable 5 et à GPT-5.5, selon le propre tableau de xAI

• Il dispose de la moitié de la fenêtre de contexte de Grok 4.3 pour un prix d’entrée deux fois plus élevé, et d’aucune API par lots. Si votre charge de travail concerne le traitement de documents longs ou l’inférence par lots hors ligne, Grok 4.5 est le mauvais modèle au sein même de sa propre famille

Concernant l’hallucination et la calibration, cette page n’a pas pu confirmer un chiffre indépendant actuel. La couverture de juillet faisait circuler un taux d’hallucination d’environ 54 %, mais nous n’avons pas pu vérifier ce chiffre sur la page du modèle Artificial Analysis que nous avons consultée, et il n’apparaît pas non plus sur la page du fournisseur. Plutôt que de répéter un chiffre que nous ne pouvons pas sourcer, nous l’enregistrons comme non mesuré ici.

Qui devrait choisir Grok 4.5, et qui devrait choisir autre chose ?

Choisissez Grok 4.5 si vous exécutez des boucles agentiques dans lesquelles le coût par tâche accomplie importe plus que le coût par token, et si vous avez déjà mesuré que le comportement d'économie de tokens de la V9 se vérifie sur votre charge de travail. C'est également le bon choix s'il vous faut un instantané de la famille Grok avec un tarif d'entrée en cache de 0,30 $ sur un préfixe volumineux, stable et sollicité de façon répétée — ce tarif de cache est réellement moins cher que ce que facturent Grok 4.6 et Grok 4.7, et sur une charge de travail à forte utilisation du cache, cet écart peut l'emporter sur deux générations de capacités.

Choisissez plutôt Grok 4.6 ou Grok 4.7 pour presque tout le reste. Même prix catalogue, même fenêtre de 500K, entraînement plus récent, meilleurs scores indépendants, et la recommandation d'Artificial Analysis elle-même. Il n'existe aucune version de « je veux le meilleur Grok » où la réponse est 4.5 aujourd'hui.

Choisissez Grok 4.3 si le contexte est la contrainte : 1 M de tokens à 1,25 $ et 2,50 $, avec une remise par lots que Grok 4.5 n'offre pas. Le RAG sur documents longs et l'analyse de dépôt entier restent encore son territoire.

Choisissez quelque chose en dehors de la famille si vous optimisez pour le score de pointe plutôt que pour le prix par tâche — Claude Fable 5 domine tous les benchmarks de codage dans le propre tableau comparatif de xAI, et GPT-5.5 devance Grok 4.5 sur DeepSWE 1.0 et 1.1. Si vous voulez des poids ouverts et pouvez accepter un modèle plus petit, il s'agit d'un tout autre achat et aucun modèle Grok n'est en concurrence pour celui-ci.

Appeler Grok 4.5 sans second contrat

Grok 4.5 est disponible sur OrcaRouter au prix catalogue de xAI, avec le tarif du fournisseur répercuté sans aucune marge — les 2,00 $ et 6,00 $ ci-dessus sont donc ce que vous payez, et un changement de prix du fournisseur est répercuté de notre côté le jour même où il intervient chez lui. Cela compte plus que d'ordinaire pour ce modèle en particulier, car la décision qui s'impose à la plupart des lecteurs n'est pas « Grok 4.5 ou rien » mais « Grok 4.5 ou Grok 4.6 ou Grok 4.3 », et comparer trois modèles d'une même famille est exactement ce qu'un point d'accès unique donnant accès à plus de 200 modèles rend peu coûteux. Une seule clé, pas de second contrat, et un test A/B qui se résume à modifier une chaîne de caractères plutôt qu'à une intégration.

L’argument du basculement est ici particulièrement concret. Grok 4.5 reste routable, mais n’est plus pleinement évalué par les trackers indépendants et n’est plus le produit phare du fournisseur — un modèle que vous pourriez vouloir dans une chaîne de repli plutôt que comme votre unique voie. Le basculement automatique entre fournisseurs est le mécanisme qui vous permet de le conserver pour ce pour quoi il est bon, sans miser une route de production sur un instantané que l’écosystème a commencé à délaisser.

Ce que cette page ne fera pas, c’est prétendre que le choix est évident. Grok 4.5 est un bon modèle avec une force spécifique, dans une famille où le même budget permet désormais d’acheter un modèle plus récent. Si vous partez de zéro aujourd’hui, la recommandation honnête est Grok 4.6. Si vous exécutez déjà Grok 4.5 dans une boucle d’agent et qu’il termine les tâches avec le nombre de tokens que vous aviez budgété, la recommandation honnête est de ne rien changer et de refaire une mesure dans un trimestre.

Screenshot of the OrcaRouter model page for Grok 4.5 (grok/grok-4.5), showing the SpaceXAI provider label, the Featured badge, capability tags for Vision, Tools, JSON and Reasoning, the 500K-token context window, the $2.00 per million input and $6.00 per million output pricing rows, and the benchmark table sourced from Artificial Analysis.

Grok 4.5 est routable sur OrcaRouter dès aujourd'hui, tout comme Grok 4.6, Grok 4.7 et Grok 4.3. OrcaRouter répercute le prix catalogue du fournisseur sans marge, de sorte qu'un changement de prix du fournisseur nous parvient le jour même où il leur parvient, et déplacer une charge de travail entre deux modèles Grok se fait par un changement de chaîne plutôt que par un second contrat.

Comparés dans cet article4

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement