
Claude Sonnet 5.5 vs Grok 4.5 : deux tarifs d'entrée de 2 $ et une attente de six minutes
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 931 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 192 tok/s
- OrcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- xAISpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Claude Sonnet 5.5 et Grok 4.5 facturent le même prix en entrée : 2,00 $ par million de tokens. C’est là que l’accord s’arrête, et un chiffre illustre mieux le propos que n’importe quel tableau de spécifications. Sur la révision v4.3.2 de l’Intelligence Index d’Artificial Analysis, le délai médian avant le premier token de réponse pour Claude Sonnet 5.5 avec son réglage Max Effort est de 370,8 secondes. Pour Grok 4.5, il est de 6,9 secondes. Même tarif en entrée. Une attente cinquante-trois fois plus longue avant que quoi que ce soit ne revienne. Claude Sonnet 5.5, sorti le 28 septembre 2026, et Grok 4.5, sorti le 8 juillet 2026 et depuis dépassé deux fois au sein de sa propre famille, sont les deux moyens les moins chers d’entrer dans la première moitié de la frontière sur le papier — et le papier cache la décision qui compte vraiment, à savoir ce que vous achetez avec l’attente.
Ce chiffre nécessite immédiatement une mise en garde, car un chiffre de latence sans configuration n’a aucun sens : 370,8 secondes correspond au mode de raisonnement par défaut d’Anthropic en effort maximal, qui dépense un très large budget de réflexion avant d’émettre un token de réponse. Un appelant qui veut un premier token rapide configure autre chose. Mais la tendance est réelle et ce n’est pas un artefact — Artificial Analysis mesure la vitesse de sortie de Claude Sonnet 5.5 à 138,7 tokens par seconde, avec seulement une poignée de modèles devant lui, et celle de Grok 4.5 à 59,2. Le modèle qui attend le plus longtemps écrit aussi le plus vite. Le choix qui s’offre à vous est entre une longue délibération suivie d’une réponse rapide, et une courte suivie d’une réponse plus lente.
Qu’est-ce qui a changé le 28 septembre ?
Claude Sonnet 5.5 n'a qu'un jour d'existence. Anthropic l'a livré le 28 septembre 2026 sous l'identifiant d'API claude-sonnet-5-5, aux côtés de Bedrock, Google Cloud et Microsoft Foundry, et le décrit comme fonctionnant 30 % plus vite que Claude Sonnet 5 et coûtant jusqu'à 30 % de moins par tâche pour la plupart des charges de travail. Ce sont des chiffres du fournisseur et ils n'ont pas été reproduits indépendamment ; le prix auquel il se compare est réel, car la grille tarifaire est restée stable à 2,00 $ par million de jetons d'entrée, 10,00 $ par million de jetons de sortie, 0,20 $ pour les lectures de cache et 2,50 $ pour les écritures de cache. La fenêtre est de 1 000 000 de jetons avec un plafond de sortie synchrone de 128 000 jetons, et de 300 000 jetons sur l'API Message Batches derrière l'en-tête output-300k-2026-03-24. La date de coupure des connaissances est juin 2026. La rétention zéro des données est disponible dès le lancement, et Anthropic ne retirera pas le modèle avant le 28 septembre 2027.

La page de documentation d’Anthropic elle-même est également inhabituellement explicite sur le coût de la mise à niveau : cinq changements incompatibles séparent Claude Sonnet 5.5 du modèle sur lequel tourne actuellement la majeure partie du trafic Claude, et ils sont abordés plus bas.
Grok 4.5 est la proposition la plus ancienne et la plus complexe. SpaceXAI — l’entreprise qui commercialise encore sous la marque xAI sur ses fiches de modèle — l’a publié le 8 juillet 2026 sous la forme d’un mélange d’experts de 1,5 billion de paramètres, entraîné aux côtés de l’éditeur de code Cursor, avec une fenêtre de 500 000 tokens, une entrée texte, image et fichier, et un argumentaire de lancement reposant presque entièrement sur l’économie de tokens plutôt que sur des scores de tête de classement. Ce n’est plus le modèle phare. Grok 4.6 et Grok 4.7 existent tous les deux, affichent tous les deux le même prix catalogue de 2,00 $ / 6,00 $, et notre catalogue les répertorie tous les trois. La question intéressante en septembre 2026 n’est donc pas de savoir si Grok 4.5 est bon ; c’est de savoir si quoi que ce soit justifie encore de se tourner vers le plus ancien des trois.
La facture n'est pas la grille tarifaire
Mettez les deux côte à côte sur le plateau indépendant et la forme de l’échange apparaît.
• Indice d'intelligence, révision v4.3.2 — Claude Sonnet 5.5 56 en effort maximal vs Grok 4.5 39
• Coût par tâche Index — Claude Sonnet 5.5 7,60 $ vs Grok 4.5 1,04 $, tous deux mesurés, non estimés
• Tarif de sortie — Claude Sonnet 5.5 10,00 $ par million vs Grok 4.5 6,00 $ par million
• Vitesse de sortie — Claude Sonnet 5.5 138,7 tokens/s contre Grok 4.5 59,2 tokens/s
• Temps jusqu'au premier token de réponse, Effort maximal — Claude Sonnet 5.5 370,8 s vs Grok 4.5 6,9 s
• Tokens générés sur l'ensemble de l'évaluation Index — Claude Sonnet 5.5 410M vs Grok 4.5 77M
• Contexte — Claude Sonnet 5.5 1 000 000 de tokens vs Grok 4.5 500 000 tokens
La ligne de verbosité est le mécanisme derrière l'écart de coût par tâche, et c'est le nombre le plus utile sur cette page. Un modèle qui émet 410 millions de jetons sur une évaluation où son rival en émet 77 millions n'a pas besoin d'un taux de sortie supérieur de 67 % pour coûter sept fois plus cher par tâche — mais il en a un quand même, et les deux effets poussent dans le même sens. La propre formulation d'Anthropic s'accorde avec l'interprétation plutôt que de la contredire : « jusqu'à 30 % de moins par tâche » est une affirmation sur le nombre de jetons, pas sur les taux, car les taux n'ont pas changé entre Claude Sonnet 5 et Claude Sonnet 5.5. Artificial Analysis parvient à la même conclusion d'un autre angle et décrit le modèle en langage simple comme particulièrement rapide mais très verbeux. Face à un modèle léger, cette même propriété constitue le plus grand risque opérationnel de Claude Sonnet 5.5.

Là où le tarif avantageux de Grok 4.5 cesse de l'être
La ligne 2,00 $ / 6,00 $ correspond à un palier, pas à un tarif. Dans la documentation pour développeurs de SpaceXAI elle-même, ce prix s’applique jusqu’à 200 000 jetons d’entrée et double pour atteindre 4,00 $ en entrée et 12,00 $ en sortie au-delà. La fenêtre de Grok 4.5 est de 500 000 jetons, donc la seconde moitié de la fenêtre qu’il annonce coûte deux fois ce que coûte la première moitié. Charger une invite à l’échelle d’un dépôt dans Grok 4.5 n’est pas une opération à 6,00 $ en sortie ; c’est une opération à 12,00 $ en sortie, et à ce stade, le modèle au tarif de sortie « coûteux » de 10,00 $ est le moins cher sur toute requête qui émet aussi beaucoup de jetons.
Claude Sonnet 5.5 n'a pas de palier équivalent. Le tarif de 2,00 $ / 10,00 $ s'applique sur toute la fenêtre de 1 000 000 de tokens, et les lectures de cache sont facturées à 0,20 $ — soit un dixième du tarif d'entrée — ce qui rend le cas du contexte long exploitable en pratique, et non seulement sur le papier.
La taille de la fenêtre constitue l'autre moitié de cet argument, et elle va dans le même sens. La fenêtre de Grok 4.5 est de 500 000 tokens, et chacun d'eux est facturé au tarif annoncé. Claude Sonnet 5.5 dispose de 1 000 000 de tokens, et c'est la forme de la charge de travail qui donne à cela toute son importance : un dépôt à analyser, une longue transcription d'agent, une pile de documents qui doit rester sous les yeux. Un plafond deux fois plus élevé, aucun palier à la moitié de celui-ci, et des lectures de cache à un dixième du tarif d'entrée : voilà ce qui transforme le transport d'autant de contexte sur de nombreux appels en une simple ligne de coût plutôt qu'en un budget à part entière.
La distinction pratique n’est pas subtile :
• Des prompts courts à sortie dense — Grok 4.5 l'emporte sur le taux et l'emporte encore sur l'habitude des tokens
• Les prompts dépassant 200 000 jetons d’entrée — le tarif de Grok 4.5 double, mais pas celui de Claude Sonnet 5.5
• Travail interactif sensible à la latence — Grok 4.5 répond en premier, et de loin, avec les paramètres par défaut
• Les exécutions agentiques à long horizon — le score composite et le plafond de sortie de 128K de Claude Sonnet 5.5 sont ce pour quoi vous payez un coût de tâche supplémentaire, et le plafond de 300K des Batches l'étend encore davantage
La migration n'est pas une chaîne de modèle
Quiconque passe de Claude Sonnet 5 à Claude Sonnet 5.5 devrait lire la note de migration d’Anthropic avant d’écrire du code, car cinq comportements ont changé et un seul d’entre eux échoue bruyamment à un endroit évident.
• Les valeurs non par défaut de temperature, top_p ou top_k renvoient désormais une erreur 400 — un pipeline à forte composante d'échantillonnage cesse de fonctionner au lieu de se dégrader
• thinking: {"type": "disabled"} renvoie un 400 et doit devenir between_tools, avec effort limité à low, medium ou high ; xhigh et max sont rejetés
• Utilisation forcée d'un outil — tool_choice défini sur "any" ou un outil nommé — est rejetée d'emblée, donc une boucle qui force un appel valide selon le schéma doit passer à auto avec l'utilisation stricte des outils ou les sorties structurées
• L'ancien computer_20251124, outil d'utilisation d'ordinateur, est refusé sur l'API Claude et sur Google Cloud
• Les blocs de réflexion sont liés au modèle et au compte qui les produisent, de sorte que le raisonnement se poursuit depuis Claude Sonnet 5 mais ne passe pas latéralement vers une famille différente — et l'outil conseiller n'accepte plus Claude Opus 4.8, Claude Opus 4.7 ou Claude Sonnet 5 comme conseillers derrière un exécuteur Sonnet 5.5
Il existe un sixième changement qui ne fait échouer absolument rien, ce qui en fait le plus dangereux : le texte entre les appels d'outils est désormais renvoyé à l'intérieur de blocs de réflexion. Une application qui diffuse ce texte à un utilisateur reste silencieuse entre les appels d'outils jusqu'à ce qu'elle définisse une valeur d'affichage ou désactive complètement la réflexion en amont. Aucune erreur ne se produit. La sortie cesse simplement d'apparaître.
Grok 4.5 ne demande rien de tout cela. C'est un modèle au format OpenAI dont la surface d'échantillonnage reste intacte, et passer à lui depuis les propres prédécesseurs de Grok 4.5 revient à un simple changement de chaîne de modèle. Le coût de la migration retombe entièrement du côté de Claude, et il s'agit d'une journée de travail plutôt que d'un après-midi.
Les deux sur une même accréditation, et la limite honnête de cela
Garder une comparaison entre deux fournisseurs en tête est facile ; c’est au moment de la mettre en œuvre que le coût se cache. OrcaRouter place plus de 200 modèles derrière un point de terminaison unique compatible OpenAI, avec le prix catalogue des fournisseurs répercuté et sans marge ajoutée, de sorte qu’un changement de tarif d’un côté ou de l’autre est effectif ici le jour même plutôt qu’au prochain renouvellement de contrat, avec un basculement automatique entre fournisseurs amont et un DSL de routage pour composer des appels. Toute la gamme Grok figure au catalogue aux tarifs propres à SpaceXAI, et Grok 4.5 est routable en tant que grok/grok-4.5 à 2,00 $ en entrée et 6,00 $ en sortie par million de jetons sur sa fenêtre de 500 000 jetons.
Claude Sonnet 5.5 ne figure pas dans notre catalogue, et cette page ne va pas laisser entendre le contraire. La voie pour y accéder aujourd'hui passe par l'API d'Anthropic elle-même, ou par Bedrock et Google Cloud si c'est là que se trouve déjà votre infrastructure. Claude Sonnet 5 est routable ici depuis le 30 juin aux tarifs d'Anthropic de 2,00 $ et 10,00 $ et reste le modèle sur lequel passe la majorité du trafic de l'API Claude, ce qui en fait la cible de basculement naturelle tant que Claude Sonnet 5.5 n'a encore qu'un jour et ne dispose d'aucune preuve de production.
Une réserve s’applique à tout cela, et elle n’est pas minime. La ligne Grok 4.5 ci-dessus est l’argumentaire du fournisseur tel que notre catalogue le reproduit actuellement ; le compteur de trafic de cette fiche affiche zéro sur les sept derniers jours et son débit n’est pas mesuré, le temps jusqu’au premier token se situant au plancher d’une seconde qu’un modèle très rarement appelé a tendance à afficher. Un modèle sans trafic récent ici n’est pas la preuve que le modèle est mauvais — les appels de la famille se sont dirigés vers 4.6 et 4.7 — mais cela signifie que les chiffres opérationnels de cette page sont maigres, et que le chiffre de latence auquel on peut se fier est le relevé d’une route en direct.

Lequel choisir
Grok 4.5 est le bon modèle lorsque le prompt est court, que la réponse est dense et que l'intégration parle déjà OpenAI — et lorsque la requête ne franchira pas la barre des 200 000 tokens d'entrée, car au-delà de cette limite, l'arithmétique change de mains. C'est aussi le bon choix lorsqu'un premier token doit arriver en quelques secondes plutôt qu'en quelques minutes. Ce qu'il n'est pas, c'est le fleuron actuel de Grok ; Grok 4.6 et Grok 4.7 se situent au-dessus de lui au même prix catalogue, et la raison de choisir 4.5 plutôt que l'un ou l'autre doit être spécifique.
Claude Sonnet 5.5 est le bon modèle lorsque le prompt est énorme, que le travail est suffisamment agentique pour que dix-sept points Index et un plafond de sortie de 128 K justifient un coût par tâche sept fois plus élevé, ou que le score composite est simplement ce qui est acheté. Sa verbosité est une décision de conception, pas un défaut, et c’est le chiffre à mesurer sur votre propre trafic avant de vous engager — car 7,60 $ par tâche Index contre 1,04 $ est une approximation d’un chiffre que seul votre volume de travail peut produire.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
