
Les limites d'utilisation de Claude Code chutent de 17 % le 14 septembre : dans les coulisses de la guerre de réinitialisation GPT-6 Astra
- openaiNOUVEAUOpenAI: GPT-6 Astra2026-09-0455Intelligence77Code
- googleNOUVEAUGoogle: Gemini 3.8 Flash2026-09-0247Intelligence76Code
- qwenNOUVEAUQwen: Qwen3.8 Max (0902)2026-09-0247Intelligence72Code
- anthropicNOUVEAUAnthropic: Claude Fable 5.12026-09-0157Intelligence82Code
- AlibabaNOUVEAUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiNOUVEAUZ.ai: GLM 5.3 Flash2026-08-2646Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1849Intelligence75Code
- obsidianQwen3.8 27B2026-08-1541Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1251Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0547Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0347Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2140Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Intelligence49Code
L'abonnement Claude Code d'Anthropic devient nettement moins généreux à partir du 14 septembre, lorsqu'une hausse temporaire de +50 % de l'utilisation hebdomadaire, en vigueur depuis mai, sera remplacée par une augmentation permanente de +25 % — ce qui, par rapport à ce que les abonnés reçoivent aujourd'hui, représente en réalité une réduction d'environ 17 %. Cette décision est un round dans la lutte concurrentielle la plus étrange de l'IA en ce moment : une guerre de réinitialisation de quotas entre Anthropic, dont le pool d'abonnement Claude Code et Claude chat s'appuie sur son produit phare Claude Fable 5.1, et OpenAI, dont le produit Codex est construit autour de GPT-6 Astra. C'est un combat mené à coups de réinitialisations d'utilisation et de manœuvres dignes de chefs de produit, et il change désormais ce qu'un abonnement payant vaut réellement de semaine en semaine.
Le 5 septembre, le commentateur développeur kimmonismus a publié un résumé largement partagé de l’affrontement : « c’est la concurrence à son meilleur… l’arrivée de Tibo a forcé Anthropic à enfin réinitialiser les quotas, ce qu’elle n’aurait jamais fait autrement. Dans le même temps, Anthropic a forcé OpenAI à se recentrer sur l’essentiel : la capacité des modèles. » « Tibo », c’est Thibault Sottiaux, responsable produit d’OpenAI pour Codex et ChatGPT, qui a passé l’été à réinitialiser si souvent les quotas des utilisateurs payants que la communauté l’a surnommé le dieu de la réinitialisation. La blague du post — le mème « je sens la peur » — vient de Tibo lui-même, lors d’une nuit de juillet où il a réinitialisé les limites de Codex quelques minutes après qu’Anthropic a réinitialisé celles de Claude. Ce qui suit ne porte pas sur les scores des benchmarks. Il s’agit de l’autre moitié de l’économie des modèles : combien de travail un abonnement mensuel fixe achète réellement, et qui décide quand ce chiffre change.
Qu'est-ce qui change réellement le 14 septembre ?
Le changement de Claude est réel et datable. Le 29 août, le compte ClaudeDevs d'Anthropic a annoncé qu'à partir du 14 septembre, les limites hebdomadaires standard de Claude Code seront définitivement augmentées de 25 % pour les forfaits Pro, Max, Team et Enterprise à base de sièges. Ce que l'annonce n'a pas mis en avant, c'est que les abonnés bénéficient actuellement d'un bonus hebdomadaire temporaire de +50 % en place depuis le 13 mai et qui court jusqu'au 13 septembre. Remplacer un bonus de +50 % par un bonus de +25 % constitue un recul, et l'arithmétique est simple sur la propre base de référence d'Anthropic :
• Aujourd'hui : base de 100 + hausse de 50 % = 150 unités de quota hebdomadaire.
• 14 septembre : base de 100 + augmentation permanente de 25 % = 125 unités.
• Variation nette pour les utilisateurs existants : environ −17 % (de 150 à 125).
Anthropic a ensuite reconnu directement le calcul — « par rapport à aujourd'hui, cela équivaut à une réduction de 17 % » — après que l'écart a suscité des notes de la communauté et des critiques de la part des développeurs. L'entreprise a présenté le changement comme la fin d'une expansion temporaire tout en rendant une partie de celle-ci permanente, a souligné la durabilité à long terme et a indiqué qu'elle travaillait sur des « changements passionnants » pour donner aux utilisateurs plus de visibilité et de contrôle sur leur utilisation. Elle n'a annoncé aucune date pour ces fonctionnalités.
Deux faits structurels rendent cette réduction plus difficile à ignorer. Premièrement, sur les formules Pro et Max, Claude Code partage un même pool d'utilisation avec Claude chat et Cowork, de sorte que la même allocation hebdomadaire est consommée sur trois produits. Deuxièmement, rien de tout cela n'est exprimé en tokens : Anthropic décrit les limites comme des multiplicateurs plutôt que comme des budgets, si bien que la manière dont les utilisateurs apprennent qu'ils ont atteint un plafond, c'est en l'atteignant. Une réduction annoncée comme une augmentation est perçue différemment lorsque l'on ne peut pas voir le chiffre sous-jacent.
L'autre côté de la guerre : OpenAI ne cesse de distribuer des réinitialisations
OpenAI a passé ce même été à évoluer dans la direction opposée, et de façon très bruyante. Sottiaux a distribué plus de 40 coupons de reset Codex pour tous les utilisateurs depuis le printemps — la communauté les recense sur codex-reset.com — pour la plupart valables trente jours. Un « reset en banque » est un rafraîchissement stocké, à usage unique, des deux fenêtres d’utilisation — celle de 5 heures et celle hebdomadaire — que l’utilisateur choisit de dépenser à sa convenance ; il ne peut être ni acheté, ni encaissé, ni transféré, et il expire. En termes de dollars, ces resets sont significatifs : les utilisateurs payants les ont testés à l’équivalent d’environ 5 à 8 dollars d’utilisation sur Plus et 50 à 80 dollars sur Pro, tandis que le suivi communautaire (NerfTrack) estime qu’une allocation hebdomadaire Plus vaut de l’ordre de 80 à 160 dollars d’utilisation de GPT-5.6 Sol — et les gros utilisateurs obtiennent bien plus que la médiane. Un utilisateur Pro a été suivi consommant 2,5 milliards de jetons en 23 heures, soit environ 80 % d’une allocation hebdomadaire.
Le 30 août, Tibo a annoncé une réinitialisation complète pour tous les utilisateurs payants de Codex et ChatGPT Work — et, fait inhabituel, a expliqué pourquoi leurs quotas ne cessaient de se vider. Il a déclaré que l'équipe avait corrigé un ensemble de bugs qui grignotaient silencieusement l'utilisation : la compression et la compaction des images, les processus mémoire en arrière-plan, les nouvelles tentatives /goal, les sous-agents, la surcharge liée à l'historique informatique et le travail en arrière-plan lié à MCP. Selon les habitudes d'utilisation, le même quota devrait désormais durer de 10 % à 50 % plus longtemps. Cette divulgation détaillée est précisément ce qu'Anthropic n'a pas égalé : une liste indiquant où les tokens sont réellement allés.
La dernière réinitialisation a eu lieu cette semaine. Après que GPT-6 Astra a fini d’être déployé dans les formules payantes de ChatGPT — un déploiement difficile au début, avec une panne de ChatGPT et de Codex le 3 septembre et le modèle initialement inaccessible même à certains abonnés Pro à 200 $ par mois — Sottiaux a annoncé une réinitialisation mondiale de l’utilisation pour tous les abonnements payants de ChatGPT, prévue pour le 7 septembre vers 18 h, heure du Pacifique (le matin du 8 septembre à Pékin). L’annonce était elle-même une blague : un post Rickroll dont les paroles accentuées épelaient RESET. La raison invoquée était de donner aux utilisateurs qui avaient épuisé leur quota pendant l’afflux d’Astra une fenêtre dégagée pour le début de la semaine de travail.

Pourquoi les deux entreprises se battent maintenant pour des quotas
Rien de tout cela ne ressemble à la guerre des benchmarks d'il y a un an, car les modèles ont convergé sur le prix. Claude Fable 5.1 — publié par Anthropic le 1er septembre en tant que version publique et déployée de son niveau de classe Mythos, à 10 $ par million de jetons d'entrée et 50 $ par million de sortie — et GPT-6 Astra, le produit phare d'OpenAI depuis le 3 septembre au même prix catalogue de 10 $/50 $, sont suffisamment proches en termes de capacités pour que les classements ne tranchent plus le débat. Claude Fable 5.1 arrive en tête de l'indépendant Artificial Analysis Intelligence Index avec un score de 66, contre 61 pour GPT-6 Astra, et le lancement d'Anthropic a également réduit de 75 % le prix de lecture du cache, à 0,25 $ par million de jetons, se positionnant ainsi comme l'option la plus économique pour les agents à longue durée d'exécution.
Quand les modèles s'alignent sur le prix, la bataille se déplace sur les sièges. Les deux entreprises vendent désormais la même chose aux gros utilisateurs : un abonnement de codage agentique avec un plafond d'utilisation qu'aucune des deux ne se risque à chiffrer en tokens. Le levier d'OpenAI, c'est la générosité des réinitialisations ; celui d'Anthropic, jusqu'à ce mois-ci, c'était la capacité — les augmentations temporaires remontent à l'expansion des centres de données d'Anthropic en mai. Voilà pourquoi une réinitialisation de quota se lit désormais comme un événement concurrentiel et une baisse de quota comme un repli, et pourquoi les deux responsables produit se donnent la réplique. La réponse de Tibo en juillet — « Je sens la peur », après le lancement de GPT-5.6 Sol qui a poussé Anthropic à réinitialiser Claude le jour même — a donné le ton, et le camp Claude a désormais sa propre figure de proue adepte des réinitialisations : des informations parues cette semaine décrivent Anthropic réinitialisant en silence, une fois encore, les limites hebdomadaires de Claude sous la pression de GPT-6 Astra, avec Lydia Hallie jouant la contrepartie que la communauté a pris l'habitude de surnommer la marraine du cyber. Le post de kimmonismus a raison de dire que les utilisateurs y gagnent — la querelle a produit des dizaines de réinitialisations de quota gratuites — mais elle a aussi transformé les conditions d'abonnement en instrument de marketing, et c'est précisément à ce moment-là que les conditions cessent d'être prévisibles.
Ce qu'une API à l'usage peut faire qu'un abonnement ne peut pas
Pour quiconque paie l’un de ces abonnements, la question concrète est de savoir si ces manœuvres doivent modifier ce que vous exécutez, et où vous l’exécutez. Un quota hebdomadaire qui s’amenuise silencieusement de 17 %, ou qui se réinitialise au calendrier d’un concurrent, pose un problème de planification : vous découvrez votre plafond en vous cognant dedans, et aucune des deux sociétés ne publie le budget de jetons. Cette incertitude est l’argument le plus fort pour conserver une option à la consommation dans votre stack. Un abonnement est un pari sur la quantité de travail qu’un prix forfaitaire achète ; une API est un prix par jeton réellement consommé. Sur OrcaRouter, les deux modèles au cœur de cette bataille sont disponibles au prix catalogue de leur fournisseur, sans aucune marge — Claude Fable 5.1 à 10 $/50 $ par million de jetons, avec un prix de lecture du cache de 0,25 $, et GPT-6 Astra à 10 $/50 $, avec son palier « contexte long » à 20 $/75 $ au-delà de 272 000 jetons d’entrée. Comme la plateforme répercute sans aucune marge le prix catalogue du fournisseur, la baisse du prix de lecture du cache d’Anthropic est entrée en vigueur de notre côté le jour même de son annonce — sans renégociation ni second contrat lorsqu’un fournisseur cède le premier.
Le routage modifie également le calcul des risques de la guerre. Lorsque Codex est tombé le 3 septembre, une charge de travail routée avec une règle de bascule ne s'est pas arrêtée ; la requête a été envoyée automatiquement à un modèle alternatif. Lorsque vous voulez savoir si les gains agentiques de Claude Fable 5.1 justifient son prix pour votre base de code spécifique, vous pouvez lui envoyer une partie du trafic et le reste à GPT-6 Astra via une seule clé API et comparer le coût par tâche accomplie — aucun abonnement à acheter ou à résilier, aucune remise à zéro de crédits accumulés à craindre. La guerre des quotas est une spécificité des abonnements ; sur une API facturée à l'usage, la politique de remise à zéro d'un fournisseur ne change rien à votre accès.

Que regarder entre maintenant et le 14 septembre
• 14 septembre. Qu’Anthropic maintienne le cap sur la réduction ou étende à nouveau l’augmentation de +50 % sous la pression — il a déjà prolongé cette augmentation plusieurs fois cet été, et des rapports cette semaine indiquent que Claude a recommencé à réinitialiser les limites hebdomadaires.
• Savoir si les réinitialisations d'OpenAI s'arrêtent lorsque le déploiement prend fin. Tibo a dit qu'il continuerait à réinitialiser jusqu'à ce que GPT-6 Astra soit réellement disponible sur tous les paliers de ChatGPT ; une fois qu'Astra sera pleinement en ligne partout, la soupape de pression se ferme et les réinitialisations deviendront probablement moins théâtrales.
• La visibilité d'utilisation promise par Anthropic. L'entreprise affirme qu'elle travaille à offrir aux utilisateurs plus de contrôle et de visibilité sur leur utilisation ; si elle lance un véritable affichage des jetons ou des dollars, elle serait la première des deux à cesser de cacher le budget.
• Une divulgation de correctif de fuite de la part d'Anthropic. OpenAI a détaillé ce qui grignotait les quotas de Codex ; les utilisateurs de Claude en sont encore à deviner ce que la mémoire en arrière-plan et la compaction leur coûtent.
• Le front des modèles, où la guerre risque de toute façon de s'intensifier. Une fuite non vérifiée datée du 5 septembre affirme qu'Anthropic prépare déjà un successeur dans la gamme Claude Fable 5.2, en réponse à GPT-6 Astra — la même pression concurrentielle qui a provoqué les manœuvres sur les quotas cette semaine, désormais tournée vers les modèles eux-mêmes.

La guerre des réinitialisations a été bénéfique aux utilisateurs à court terme — la seule semaine écoulée a apporté une réinitialisation mondiale de Codex et de nouvelles réinitialisations de Claude, et les deux entreprises enchérissent désormais visiblement pour les utilisateurs intensifs, d'une manière qui profite à tous ceux qui paient. Mais une générosité qu'un chef de produit peut désactiver n'est pas un modèle tarifaire, et une réduction de 17 % déguisée en augmentation de 25 % est le rappel le plus clair à ce jour que le quota d'abonnement est un instrument marketing, pas un contrat. Les modèles sous-jacents — Claude Fable 5.1 et GPT-6 Astra — sont excellents, très proches en performances et au prix identique ; ce sont les conditions qui les entourent qui ne cessent de changer. Mesurez ce que vous pouvez, surveillez le 14 septembre et ne laissez pas un calendrier de réinitialisation décider de votre architecture.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
