Une carte-titre générée indiquant « L'agent o d'OpenAI : la fuite du DevDay, sous étiquette », avec la ligne de statut « Signalé comme un agent toujours actif pour les offres ChatGPT Pro – aucune page produit, aucun prix, aucun identifiant de modèle, aucune déclaration d'OpenAI ». Trois cartes indiquent : « La référence – repérée comme nom d'affichage et suffixe de courriel, selon un rapport » ; « La fenêtre – DevDay 2026, 29 septembre, Fort Mason Center » ; « Le manque – tâches, autorisations, mémoire, planification et disponibilité, tous non signalés ». Une ligne de pied de page indique « Fuite d'une source unique. Rien ici n'est une annonce d'OpenAI. » Le logo OrcaRouter se trouve dans le coin inférieur droit.
Guides & Insights

L’agent « o » d’OpenAI : ce que dit réellement la fuite du DevDay 2026, et ce qu’elle ne dit pas

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le nom rapporté est la partie la moins intéressante. Ce que la fuite dit sur l'agent toujours actif de l'entreprise, c'est qu'il s'appellera "o", qu'il sera intégré à chaque niveau de ChatGPT Pro, et qu'un Fast Mode — fonctionnant sur du silicium Cerebras — y est associé. Le détail qui mérite qu'on s'y arrête est plus petit et plus étrange que cela : la référence aurait été repérée sur la page de mise à niveau du forfait Pro à 100 $, et non celui à 200 $, le mois même où l'entreprise a complètement cessé de vendre le forfait à 200 $. Il n'existe ni page produit, ni prix, ni identifiant de modèle, et aucune déclaration de l'entreprise n'utilise la lettre comme nom de produit. Le post à l'origine de cet article est le résumé, par un compte, de ce qu'il dit avoir vu, et la conférence sur laquelle il s'appuie est réelle : DevDay 2026 a lieu le 29 septembre au Fort Mason Center, à San Francisco. L'agent avec lequel il est en concurrence est réel aussi — Gro​k Bot, le produit de collaborateur numérique que SpaceXAI a mis en bêta précoce le 11 août. Le modèle sur lequel l'agent tournerait vraisemblablement est réel et daté : GPT-6 Astra, en disponibilité générale depuis le 3 septembre. Presque rien d'autre dans cette affirmation ne l'est.

En quoi consiste réellement la fuite, trié par poids

Trois choses sont rapportées, et elles ne méritent pas d’être lues comme une seule affirmation.

Les références capturées en captures d'écran en sont l'élément le plus solide. Un article publié le 26 septembre indique que des références à « O » apparaissent dans la configuration même de ChatGPT — comme nom d'affichage, et comme suffixe de courriel écrit « -o » — et que la même chaîne a récemment été présentée comme un avantage sur la page de mise à niveau du forfait ChatGPT Pro à 100 $. Il s'agit d'artefacts propres à un déploiement plutôt que d'une invention : les surfaces de configuration sont l'endroit où une entreprise prépare un produit avant de l'annoncer, de la même manière que les feature flags. C'est aussi le type d'artefact le plus fragile qui soit, car une chaîne en préparation peut être renommée, détournée de son usage ou abandonnée, et elle ne porte en elle aucun comportement. L'article est explicite sur cette lacune : ce que fait l'agent, à quoi il peut accéder, s'il planifie quoi que ce soit, combien de temps il se souvient, et à qui il est destiné, tout cela n'est pas précisé.

Le nom est la revendication de second ordre. Un compte @o suspendu sur X est cité comme une éventuelle réservation. Un pseudo suspendu est un point de données sur l’intention à un moment donné, pas sur ce qu’est le produit, et la même lettre est déjà passée une fois par le service de nommage d’OpenAI — nous y reviendrons plus bas.

La troisième couche est la partie qui vient du signal de cette semaine plutôt que du reportage : que « o » apparaît dans tous les paliers Pro, que Fast Mode est confirmé, qu'il est vraisemblablement intégré à un palier d'abonnement à 500 $, et que le silicium de Cerebras est ce qui rend la vitesse possible. « Vraisemblablement » joue un rôle bien visible dans cette phrase. Le post du signal lui-même est tronqué dans la capture réalisée par le radar — son cinquième élément commence par « shared m… » et s'arrête — donc lisez la liste comme incomplète plutôt que comme cinq points établis.

Le problème de nommage que personne n'a vérifié

OpenAI a déjà utilisé la lettre. Ses modèles de raisonnement sont sortis sous o1, o3, o3-mini et o4-mini en 2024 et 2025, et la gamme a été progressivement arrêtée plutôt qu'élargie : o4-mini a été retiré de ChatGPT en février 2026, GPT-4.5 a été retiré en juin, et o3 s'est vu imposer un arrêt progressif de 90 jours annoncé dans les notes de version du modèle le 28 mai — un retrait que ce blog a couvert à l'époque, car des utilisateurs signalaient des réponses qui disparaissaient avant la date limite.

Ainsi, un « o » tout court comme nom d’un agent grand public entrerait en collision avec l’histoire récente de l’entreprise elle-même, et serait ambigu là où l’ambiguïté coûte cher : dans un sélecteur de modèle. Ce n’est pas la preuve que la fuite est fausse — les fournisseurs recyclent les lettres, et un nom de code interne est souvent abandonné lors de la revue de nommage — mais c’est une raison de considérer le nom comme l’élément le plus jetable du récit. Si « o » est commercialisé sous une autre étiquette, chaque fait daté ci-dessous tient toujours.

Pourquoi le timing est crédible même si le produit ne l’est pas

La preuve la plus solide d’un lancement d’agent au DevDay n’est pas la fuite. C’est ce qu’OpenAI a déjà mis en place au cours des quatre semaines qui l’ont précédé.

• 3 septembre — GPT-6 Astraa atteint la disponibilité générale en tant que modèle de pointe d'OpenAI : contexte de 1,05 M de jetons, sortie maximale de 128 K, affiché à 10,00 $ par million de jetons d'entrée et 50,00 $ par million de jetons de sortie, avec l'entrée mise en cache à 1,00 $ et les écritures de cache à 12,50 $. Notre propre catalogue référence le même modèle sous une date d'inscription au 2026-09-04 ; Artificial Analysis date la sortie au 3 septembre.

• 10 septembre — OpenAI a ouvert l'API Agents en bêta publique, vendant aux développeurs le harnais Codex managé : OpenAI se charge de l'orchestration, de la compaction du contexte et de la reprise, tandis que le développeur fournit la tâche, le modèle, les outils et l'environnement. C'est l'infrastructure d'un agent toujours actif, vendue comme un produit destiné aux développeurs.

• 10 septembre — le même jour, les nouvelles inscriptions et les mises à niveau vers l'offre ChatGPT Pro à 200 $ ont été suspendues, la demande pour GPT-6 Astra étant invoquée comme raison. L'offre à 100 $, Plus, Go, Business et Enterprise ainsi que l'API sont toutes restées ouvertes.

• 22 septembre — GPT-6 Sol et GPT-6 Luna ont été lancés à 2,00 $ / 10,00 $ et 0,10 $ / 0,50 $ par million de tokens, qu'OpenAI a décrits comme permanents plutôt que promotionnels, étendant l'entrée de gamme sur laquelle l'agent s'appuierait pour les tâches de routine.

• 26 septembre — la documentation du palier de service Ultrafast s'est enrichie, avec un sélecteur de vitesse proposant Standard, Fast et Ultrafast repéré à l'état non publié dans le Responses API Playground, et des signalements laissant présager un déploiement plus large autour du DevDay.

• 29 septembre — DevDay 2026, discours d’ouverture diffusé en direct, ouverture par Sam Altman. Le compte développeurs d’OpenAI a publié « 72 heures avant OpenAI DevDay » le même week-end où le rapport sur les agents est paru.

Screenshot of the OrcaRouter model page for OpenAI GPT-6 Astra, showing a 1.05M-token context window, input pricing of $10.00 and output pricing of $50.00 per million tokens with $1.00 cached input and $12.50 cache writes, and a second pricing row above 272,000 input tokens at double the input and cache rates and 1.5x the output rate, plus capability tags for Vision, Tools, JSON and Reasoning.

Lisez ces six lignes ensemble et la forme de l'histoire est cohérente : OpenAI a transformé le harnais d'agent en produit, l'a vendu aux développeurs, a rationné l'offre grand public qui embarque son meilleur modèle, et a une keynote dans quatre jours. Une version grand public de ce même harnais — vendue sous forme d'abonnement plutôt que de point de terminaison par jeton — est la prochaine étape évidente. Rien de tout cela ne rend le nom, le niveau ou le lien avec Cerebras vérifiés. Cela rend le timing plausible, ce qui est une affirmation différente et plus faible.

Fast Mode, Ultrafast et l'affirmation de Cerebras

Le signal indique que le mode Fast est « confirmé » et que la puce Cerebras « prend effet ». Il faut distinguer l'un de l'autre, car le premier est un mécanisme de plateforme documenté, tandis que le second est une déduction sur la puce qui sert tel ou tel produit.

Fast mode est un palier réel et facturé de l'API d'OpenAI pour la gamme GPT-6 : il est facturé au double du tarif standard et offre environ 2,5× la vitesse de sortie, et c'est le même palier qui a été renommé depuis Priority processing le 30 juillet 2026 — l'API accepte l'un ou l'autre, service_tier: "fast" ou service_tier: "priority". Il n'est pas disponible avec la résidence des données dans l'UE sur au moins un modèle de la gamme. Au sein du pool d'abonnements ChatGPT, les analyses de la structure des crédits d'abonnement situent Fast mode à 2,5× le taux de crédits plutôt qu'à 2× comme pour l'API, ce qui fait du réglage le plus rapide une offre légèrement moins avantageuse à l'intérieur de ChatGPT qu'à l'extérieur — un détail qu'il vaut la peine de connaître avant de supposer qu'un avantage de Fast-Mode vaut ce que cela laisse entendre.

Ultrafast est le palier Cerebras, et c'est une tout autre bête. OpenAI l'a annoncé le 13 août 2026 comme le premier produit de son partenariat de calcul avec Cerebras — un accord estimé à environ 10 milliards de dollars sur trois ans — et il offre jusqu'à 14 fois le débit standard et jusqu'à 750 jetons de sortie par seconde sur GPT-5.6 Sol, le seul modèle auquel il est actuellement réservé. L'accès est contrôlé, aucun prix n'est publié et, à ce jour cette semaine, il reste un palier sur liste d'attente plutôt qu'un palier général. La référence de l'API Responses répertorie ultrafast comme valeur du service_tier paramètre, avec la mise en garde qu'il est « actuellement disponible pour gpt-5.6-sol ».

C’est exactement pourquoi la phrase du leak sur Cerebras doit être traitée comme une supposition à la base plausible plutôt que comme une confirmation. Un agent grand public qui fonctionnerait en continu serait dominé par la latence et le coût par tâche, et une vitesse de classe Cerebras constitue une véritable réponse à la première moitié de ce problème. Mais il n’existe encore aucune voie Ultrafast documentée pour un quelconque modèle GPT-6, aucune grille tarifaire pour celle-ci, et rien de la part d’OpenAI ne reliant un agent grand public à ce silicium. Le sens de l’inférence est raisonnable ; la certitude de la formulation, elle, n’est pas justifiée.

Ce que « disponible dans tous les niveaux Pro » vous coûterait

C'est la partie de l'affirmation qu'un lecteur peut réellement évaluer, car la structure des niveaux qui la sous-tend est publiée.

• Tarifs mensuels — les formules ChatGPT Pro à 100 $ et à 200 $ ont toutes deux été en vente jusqu'à fin septembre ; les nouvelles inscriptions à la formule à 200 $ sont suspendues depuis le 10 septembre et OpenAI n'a publié aucun seuil de réouverture.

• La version mesurée de la même capacité — GPT-6 Pro est plafonné à 200 messages par semaine sur le forfait à 200 $ et à 50 par semaine sur le forfait à 100 $, ce dernier étant prélevé sur une allocation partagée avec GPT-5.6 Sol Pro. Les paliers Business sont plus bas. Ce sont les chiffres publiés d’OpenAI et ils constituent la véritable limite de ce que vaut un « avantage sur la page de mise à niveau ».

• Arithmétique des tokens sur le modèle sous-jacent — à 10,00 $ / 50,00 $ par million, 500 $ d’API GPT-6 Astra représentent environ 50 M de tokens d’entrée ou 10 M de tokens de sortie, soit une nouvelle division par deux du travail effectif au-delà du seuil de 272 K tokens d’entrée, où l’ensemble de la requête est refacturé à 20,00 $ / 2,00 $ / 75,00 $.

• La moitié la moins chère de la gamme — les mêmes 500 $ permettent d’obtenir environ 250 M de tokens d’entrée ou 50 M de tokens de sortie sur GPT-6 Sol à 2,00 $ / 10,00 $, et dix fois plus sur GPT-6 Luna à 0,10 $ / 0,50 $.

Si l’agent arrive dans le cadre d’un abonnement existant, la comparaison cesse de porter sur le prix catalogue et porte sur le siège que vous payez déjà. S’il arrive comme poste de facturation distinct, OpenAI doit le justifier face à une catégorie où un concurrent propose déjà une offre depuis six semaines. Dans un cas comme dans l’autre, un agent toujours actif modifie la structure de la facture : un assistant qui continue de travailler pendant que vous dormez dépense des jetons sans humain dans la boucle, et c’est la charge de travail qu’un palier à l’usage pénalise et qu’un siège absorbe. C’est aussi la charge de travail où l’entrée mise en cache, à un dixième du tarif de l’entrée non mise en cache, détermine le total — un agent persistant renvoie un contexte presque inchangé à chaque tour, ce qui correspond précisément au schéma pour lequel une remise de cache est conçue.

C'est la couche au niveau de laquelle OrcaRouter opère, et il vaut la peine d'être clair sur ce qu'elle ne couvre pas. Nous routons les modèles d'OpenAI au token, au prix catalogue du fournisseur répercuté avec 0 % de marge, si bien qu'une modification de tarif d'un fournisseur est effective ici le jour même, avec un basculement automatique entre fournisseurs et un DSL de routage pour composer les appels. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol et GPT-6 Luna sont tous sur une seule clé. Ce que nous ne pouvons pas vous vendre, c'est un abonnement ChatGPT ou un agent qui n'existe pas encore — il n'y a rien à router tant qu'OpenAI n'en a pas livré un.

La barre que l'agent doit franchir est plus basse qu'elle n'en a l'air.

Gro​k Bot est la comparaison que la fuite elle-même établit, et l’interprétation honnête que l’on peut en faire est que SpaceXAI a placé la barre bien bas. Il est entré en bêta anticipée le 11 août dans une configuration d’entrée à 120 $ par siège, intégrée à Cursor Premium Teams, avec des offres individuelles à 200 $ et 300 $ par mois et une facturation à l’usage au-delà des limites incluses, au coût des tokens. Chaque bot dispose de sa propre VM cloud avec un navigateur, un système de fichiers et un terminal ; il se connecte aux applications dépourvues d’API ; il enregistre les workflows démontrés sous forme de routines et poursuit son travail une fois l’ordinateur portable fermé.

Ce qui n'a pas été publié est la partie qui trancherait la question. SpaceXAI n'a publié aucun benchmark indépendant ni données de fiabilité à son sujet, le routeur de modèles qui le sous-tend est automatique et les utilisateurs ne peuvent pas épingler un modèle, les premiers testeurs se sont montrés publiquement peu convaincus, et les critiques relèvent l'absence d'une couche de contrôle d'entreprise — pas d'autorisations délimitées, de règles d'escalade ni de piste d'audit. Muse de Meta a suivi le 8 septembre dans une catégorie qui compte désormais trois produits.

A two-column scoreboard titled 'o vs Grok Bot - the scoreboard'. The left column, 'o (reported)', reads: Status reported for DevDay, Sept 29; Evidence a display name and a mail suffix, per one report; Tiers reported as all Pro tiers, unconfirmed; Speed mode reported Fast Mode on Cerebras, unconfirmed; Behaviour unreported; Benchmarks none. The right column, 'Grok Bot (shipped)', reads: Status early beta since Aug 11, 2026; Evidence vendor product page; Tiers from $120 per seat per month, bundled with Cursor Premium Teams; Speed mode vendor-managed, model not pinnable; Behaviour cloud VM with browser, filesystem and terminal; Benchmarks none published. A footer line reads 'o column is single-source reporting; Grok Bot figures per SpaceXAI. Neither side has published independent reliability data.'

Cette dernière ligne est l’essentiel de toute la comparaison. Il n’existe pas d’indice Artificial Analysis pour « l’agent a-t-il terminé la tâche sans faire quelque chose de catastrophique », aussi un agent persistant s’achète-t-il sur les mêmes preuves qu’un chatbot en 2023 : des démos et du ressenti. La seule contrainte datée que personne dans cette histoire ne mentionne est la posture de sécurité d’OpenAI elle-même. GPT-6 Astra a atteint le seuil critique de capacité en cybersécurité de l’entreprise, et OpenAI a averti que la surveillance pourrait ralentir, suspendre ou arrêter des tâches légitimes — y compris explicitement les tâches de longue durée. Un agent toujours actif est, par définition, une tâche de longue durée, dans la plateforme qui a déjà déclaré qu’elle pourrait en interrompre une.

Qu’est-ce qui rendrait cela vérifiable, et quand ?

Les rumeurs sur un produit à quatre jours de sa sortie ne valent pas cher, et les vérifications sont précises.

• Une page OpenAI, une note de version ou une entrée de centre d’aide qui utilise le nom comme nom de produit. Rien n’est apparu jusqu’à présent, et l’historique de la lettre au sein d’OpenAI fait de ce test celui qui a le plus de chances d’échouer.

• Une surface de configuration qui survit à un rafraîchissement — un forfait réellement achetable, une allocation répertoriée, une page de paramètres — plutôt qu'une chaîne d'affichage préparée dans un build.

• Toute spécification de comportement, quelle qu'elle soit : ce qui peut lui être accordé, ce qu'il planifie, combien de temps il se souvient, s'il possède sa propre identité de messagerie en production ou seulement dans un fichier de configuration.

• Un prix. « Dans tous les niveaux Pro » n’est pas un prix, et un palier à 500 $ ne devient pas un fait parce qu’un rapport distinct a trouvé des chaînes d’abonnement à 500 $ à un autre endroit.

• Le lien Cerebras, qu'il apparaisse dans la propre documentation de serving d'OpenAI pour le palier, comme l'a fait la restriction d'Ultrafast à GPT-5.6 Sol, ou qu'il n'apparaisse pas du tout.

A two-column card titled 'The o agent - verified vs claimed'. The left column, 'Verified and dated', reads: DevDay 2026 on September 29 at Fort Mason Center; GPT-6 Astra generally available September 3 at $10 / $50 per million; Agents API public beta September 10; ChatGPT Pro $200 sign-ups paused September 10; GPT-6 Sol and GPT-6 Luna shipped September 22 at $2 / $10 and $0.10 / $0.50; Ultrafast documented as access-controlled on GPT-5.6 Sol; Grok Bot in early beta since August 11. The right column, 'Claimed and unverified', reads: the product name 'o'; an announcement at DevDay; availability in all Pro tiers; Fast Mode bundled into a $500 tier; Cerebras serving the agent; tasks, permissions, memory and scheduling; any published price. A footer line reads 'Left column per OpenAI, SpaceXAI and Artificial Analysis; right column single-source reporting.'

La décision qui reste au lecteur est plus petite que ce que la fuite laisse entendre, et elle ne porte pas sur la lettre. Si vous évaluez un agent toujours actif pour le travail, le produit qui existe aujourd'hui est Gro​k Bot, et le geste sensé est un essai de courte durée sur votre propre flux de travail plutôt qu'un engagement par siège — son palier d'entrée à 120 $ est un plancher, pas un plafond, et l'usage au-delà des limites incluses est facturé au coût des tokens. Si vous développez, l'Agents API est en bêta publique depuis le 10 septembre et c'est la partie de cette histoire que vous pouvez réellement tester aujourd'hui, avec le harnais, le bac à sable et la facturation tous documentés.

Et si vous chiffrez ce que tout cela coûterait à faire tourner, faites-le sur les modèles plutôt que sur la rumeur. GPT-6 Astra à 10,00 $ / 50,00 $ par million de tokens est disponible sur OrcaRouter au prix catalogue d'OpenAI, sans marge ajoutée ; GPT-6 Sol et GPT-6 Luna y sont à 2,00 $ / 10,00 $ et 0,10 $ / 0,50 $, et le taux de lecture du cache — 1,00 $ contre 10,00 $ pour Astra — est la ligne qui détermine ce que coûte réellement une charge de travail persistante. Un agent qu'OpenAI n'a pas annoncé ne peut pas faire l'objet de benchmarks, être routé ni acheté. Les tokens qui le sous-tendent, eux, le peuvent, aujourd'hui, et le compteur que vous construisez sur eux restera le bon compteur si le nom sur la boîte s'avère être autre chose qu'une seule lettre.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement