Une carte hero générée intitulée « Three posts deep », avec le sous-titre « GPT-6.1 Ultrafast is Pro $500 only in ChatGPT — open to all API users », des puces indiquant « Pro $500 plan », « eligible Enterprise and Edu » et « all API users », et un pied de page indiquant « Availability per OpenAI documentation, 8 October 2026 ».
Guides & Insights

GPT-6.1 Ultrafast est Pro pour seulement 500 $, et ce détail était enterré trois posts plus bas.

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

GPT-6.1 Sol Ultrafastest arrivé le 8 octobre 2026 avec la chose la plus rare qu'un palier de vitesse puisse proposer : un tarif publié. 12,00 $ par million de tokens d'entrée, 60,00 $ par million de tokens de sortie, soit exactement six fois ce que coûte GPT-6.1 Sol — le modèle qu'OpenAI a publié le 29 septembre 2026 lors de sa keynote DevDay 2026 — sur la voie standard. Ce que le fil de l'annonce n'a pas mis en avant, c'est l'endroit où un abonné ChatGPT peut réellement l'activer, et la réponse, trois messages plus bas, est le forfait Pro à 500 $. Cet ordre mérite plus d'attention qu'il n'en a reçu, car la moitié API et la moitié abonnement de ce déploiement sont restreintes de façons opposées, et cette différence détermine si Ultrafast est quelque chose que vous pouvez essayer cette semaine ou quelque chose pour lequel vous devez acheter un forfait.

Rien n’a changé dans le modèle. GPT-6.1 Sol Ultrafast est le même checkpoint, la même fenêtre de contexte de 1 050 000 jetons, le même plafond de sortie de 128 000 jetons, la même date de coupure des connaissances du 30 avril 2026 et les mêmes réponses que GPT-6.1 Sol. Ultrafast est un niveau de service — une priorité d’ordonnancement que vous demandez — pas un second modèle. Le produit tout entier, c’est de la latence, vendue à un multiple, et les deux seules questions qui comptent sont : quelle quantité vous en obtenez et qui est autorisé à l’acheter.

Ce que le dossier dit réellement, dans l’ordre où il le dit

La version à charge de cette histoire est qu’O​penAI a enterré la porte. La version exacte est plus précise, et elle est vérifiable ligne par ligne par rapport à la documentation d’O​penAI elle-même.

Le journal des modifications destiné aux développeurs contient l’entrée datée du 8 octobre : ajout du mode Ultrafast pour GPT-6.1 Sol dans l’API Responses, demandé en envoyant model: "gpt-6.1-sol" avec service_tier: "ultrafast", décrit comme réduisant le temps entre les jetons de sortie générés, et présenté comme disponible pour tous les utilisateurs de l’API sous réserve de limites de débit, avec un traitement mondial et une résidence des données aux États-Unis et dans l’UE. Lu isolément, il s’agit d’un lancement sans restriction à un tarif publié.

La documentation des niveaux indique qu’Ultrafast est le niveau de service le plus rapide de l’API, largement disponible pour GPT-6 Astra et GPT-6.1 Sol avec un accès en avant-première pour GPT-5.6 Sol, et recommande l’utilisation de WebSockets pour celui-ci. Toujours aucune mention d’un plan.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

Le détail de l’abonnement se trouve sur la page de vitesse côté ChatGPT, et il s’agit de trois limitations empilées dans un seul paragraphe : Ultrafast est disponible dans Codex et ChatGPT Work, sur Pro à 500 $, ainsi que sur les forfaits Enterprise et Edu éligibles. Les administrateurs Enterprise le voient désactivé par défaut et doivent l’activer par utilisateur ou par espace de travail. Et la surface Chat grand public ne se voit pas proposer ce niveau du tout — GPT-6.1 Sol lui-même réside dans Work et Codex, donc Chat n’a jamais été dans le périmètre.

Rassemblez les trois pages et le tableau est clair. Une clé API est un ticket. Un abonnement ChatGPT n’est un ticket que s’il s’agit de l’abonnement le plus cher vendu par OpenAI, ou si un administrateur vous l’a activé. Personne, en lisant le premier message de l’annonce, ne le devinerait.

Pourquoi la porte existe, et ce n'est pas arbitraire

La lecture évidente est qu'OpenAI utilise la voie rapide pour vendre des forfaits à 500 $. Le mécanisme sous-jacent est moins cynique et plus utile : Ultrafast est un compteur coûteux, et un forfait à 500 $ est le seul forfait grand public où un compteur 8x tient dans l'usage inclus.

Sur un abonnement, l’usage inclus est consommé à huit fois le taux standard lorsque vous utilisez Ultrafast, de sorte qu’un seul tour Ultrafast consomme la même allocation que huit tours standard. C’est une conséquence de ce que fait ce niveau — il achète du temps d’horloge en dépensant de la capacité de service, et un abonnement est un produit à capacité fixe. Facturez la même allocation pour huit fois la consommation de capacité, et l’économie du forfait ne tient plus à 20 $ par mois. Facturez huit fois l’allocation, et le niveau devient tout simplement peu attrayant sur un petit forfait. Dans un cas comme dans l’autre, le niveau finit là où l’allocation est suffisamment grande pour l’absorber.

L'API n'a pas une telle contrainte, car elle est facturée à l'usage. Dans ce cadre, Ultrafast dispose de son propre budget de limitation de débit, distinct des budgets Standard et Fast, et OpenAI décrit ces limites comme définies par organisation plutôt que publiées sur la page du palier. C'est un deuxième point à surveiller que l'annonce n'a pas mis en avant : le passage d'une charge de travail à Ultrafast ne fait pas que multiplier la facture, il déplace la charge de travail vers un autre plafond, et si vous augmentez le trafic au-delà de ce qui a été accordé à l'organisation, les limites propres au palier deviennent le mode de défaillance.

L’arithmétique de l’achat de vitesse de deux façons différentes

Voici la décision en chiffres, et c’est la partie qui vaut la peine d’être faite sur vos propres comptes de jetons plutôt que sur les miens. Prenez une session d’agent qui envoie 30 000 jetons d’entrée et reçoit 1 500 jetons de sortie par tour, sur 40 tours.

• Total de tokens par exécution — 1 200 000 en entrée, 60 000 en sortie, répartis sur 40 requêtes qui restent chacune confortablement sous le seuil de 272 000 tokens à partir duquel OpenAI applique un nouveau tarif à l'ensemble de la requête.

• Sur le GPT-6.1 Sol standard — 1,2 million de tokens à 2,00 $ le million, soit 2,40 $, plus 60 000 à 10,00 $ le million, soit 0,60 $. Trois dollars par exécution.

• Sur GPT-6.1 Sol Ultrafast — 1,2 million à 12,00 $, soit 14,40 $, plus 60 000 à 60,00 $, soit 3,60 $. Dix-huit dollars par exécution.

• La différence — 15,00 $ par exécution pour supprimer la majeure partie du temps de génération sur une tâche qui ne change pas par ailleurs.

Ces 15,00 $ par exécution sont le chiffre à retenir face à l'abonnement. Si la seule raison pour laquelle vous envisagez le forfait Pro est Ultrafast, environ 33 exécutions par mois avec ces nombres de tokens correspond au point où les 500 $ du forfait et le compteur par token de l'API se croisent — en dessous, le compteur est la façon la moins chère d'acheter le même niveau, et au-dessus, le forfait commence à être plus avantageux. Vos nombres de tokens déplaceront ce point de croisement, parfois beaucoup, donc faites vos propres calculs avant de considérer 33 comme un seuil. Il s'agit de notre arithmétique sur une charge de travail déclarée, pas d'un seuil de rentabilité publié.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Deux remarques structurelles qui survivent à n’importe quel décompte de tokens.

L’affirmation sur la vitesse est empruntée, et c’est la seule chose à lire attentivement.

Ultrafast est commercialisé sur la promesse d’être « jusqu’à 8 fois plus rapide », et la seule mesure propre à un modèle qu’OpenAI publie à l’appui de cette formule concerne un autre modèle. La phrase dans sa documentation indique que GPT-6 Astra Ultrafast génère des tokens jusqu’à 8 fois plus vite que GPT-6 Astra en mode Standard dans Codex. Il s’agit d’un chiffre propre à Astra, mesuré dans Codex. La documentation du palier de GPT-6.1 Sol le décrit comme réduisant le temps entre les tokens et renvoie à une grille tarifaire ; elle ne lui associe aucun chiffre, et aucun tiers indépendant n’a non plus publié de mesure de tokens par seconde pour la variante Sol.

Cela peut très bien tenir. Les deux modèles tournent sur la même pile de service et le mécanisme de palier est identique, donc un multiple d’Astra constitue un a priori raisonnable pour Sol. Mais « jusqu’à 8x » est un plafond fournisseur, non reproduit, tiré d’un modèle frère — et le « jusqu’à » joue un rôle crucial dans cette phrase. Considérez ce multiple comme une hypothèse à tester sur vos propres prompts, car la documentation propre au palier ne le testera jamais à votre place.

La même mise en garde est plus facile à énoncer pour les niveaux plus anciens. Ultrafast sur GPT-5.6 Sol a été annoncé le 13 août 2026 comme « jusqu'à 14 fois plus rapide que le traitement Standard » en aperçu limité, et trois mois plus tard, la documentation indique toujours un accès en aperçu, tandis que la grille tarifaire Ultrafast ne comporte exactement que deux lignes — GPT-6 Astra et GPT-6.1 Sol. Un chiffre de 14x sans prix publié et sans disponibilité générale est une allégation plutôt qu'un produit, et c'est un rappel utile du caractère encore largement aspirationnel de cette échelle de niveaux.

Si le plan de 500 $ ne se concrétise pas

Pour quiconque ne compte pas acheter Pro à 500 $ pour tester un palier de latence, la bonne approche consiste à séparer les deux éléments que l’annonce a regroupés. Ce palier est disponible sur l’API pour tous les utilisateurs de l’API, si bien que la voie rapide peut être achetée sans abonnement — à 12,00 $ et 60,00 $ par million de tokens, avec son propre budget de limite de débit, sur une charge de travail suffisamment petite pour être mesurée. Testez-la d’abord là, sur vos propres prompts, face à la voie standard.

La voie standard est celle qui existe sans rien de tout cela. OrcaRouter sert GPT-6.1 Sol sous openai/gpt-6.1-sol aux tarifs affichés par O​penAI — 2,00 $ par million de tokens d'entrée et 10,00 $ par million de tokens de sortie — avec 0 % de marge et le prix du fournisseur répercuté tel quel, de sorte qu'une révision tarifaire du fournisseur arrive de notre côté le jour même. Ultrafast n'est pas quelque chose que nous vendons : c'est un indicateur de niveau de service facturé sur votre propre compte O​penAI, et nous préférons le dire clairement plutôt que de laisser une page de modèle sous-entendre le contraire. Ce qu'une clé permet bel et bien, c'est d'acheminer la voie standard et le reste du catalogue — plus de 200 modèles derrière un seul point de terminaison compatible O​penAI — et de basculer automatiquement entre fournisseurs quand l'un d'eux est dégradé, ce qui est l'assurance la moins chère qui soit si vous êtes sur le point de placer un palier de latence devant un chemin de production.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

Et si vous êtes sur Plus ou Team et que la réponse que vous cherchiez était « puis-je simplement l'activer », la réponse est non, sous une forme bien précise. Codex et ChatGPT Work sur Pro à 500 $ ou sur une offre Enterprise ou Edu éligible, activés par un administrateur s'il s'agit de l'offre Enterprise. Tout le reste accède à Ultrafast via l'API et paie au token.

Que regarder ensuite

Trois choses feraient passer cela d'un déploiement restreint à un déploiement ordinaire, et ces trois choses sont observables. Une limite de débit Ultrafast publiée pour GPT-6.1 Sol mettrait fin aux conjectures quant à savoir si le plafond propre à ce niveau contraint avant la facture. Une mesure de vitesse propre au modèle — ou une mesure indépendante — remplacerait le chiffre Astra emprunté par une donnée sur laquelle juger le niveau Sol. Et le fait qu'Ultrafast atteigne ChatGPT Plus signifierait que le calcul de capacité a changé, ce qui est le signal que la restriction relevait de la pénurie de lancement plutôt que de la forme permanente du niveau.

D’ici là, le résumé honnête est limité et vérifiable. GPT-6.1 Sol est sorti le 29 septembre 2026 et n’a pas changé. Le 8 octobre 2026, il a obtenu une voie rapide avec un prix réel, ouverte aux utilisateurs de l’API et conditionnée dans ChatGPT à l’abonnement à 500 $ — un détail qui méritait le premier post plutôt que le troisième, et qui détermine pour la plupart des lecteurs s’il s’agit d’une ligne budgétaire ou d’un bon de commande.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement