
GPT-6.1 Ultrafast est Pro pour seulement 500 $, et ce détail était enterré trois posts plus bas.
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
GPT-6.1 Sol Ultrafastest arrivé le 8 octobre 2026 avec la chose la plus rare qu'un palier de vitesse puisse proposer : un tarif publié. 12,00 $ par million de tokens d'entrée, 60,00 $ par million de tokens de sortie, soit exactement six fois ce que coûte GPT-6.1 Sol — le modèle qu'OpenAI a publié le 29 septembre 2026 lors de sa keynote DevDay 2026 — sur la voie standard. Ce que le fil de l'annonce n'a pas mis en avant, c'est l'endroit où un abonné ChatGPT peut réellement l'activer, et la réponse, trois messages plus bas, est le forfait Pro à 500 $. Cet ordre mérite plus d'attention qu'il n'en a reçu, car la moitié API et la moitié abonnement de ce déploiement sont restreintes de façons opposées, et cette différence détermine si Ultrafast est quelque chose que vous pouvez essayer cette semaine ou quelque chose pour lequel vous devez acheter un forfait.
Rien n’a changé dans le modèle. GPT-6.1 Sol Ultrafast est le même checkpoint, la même fenêtre de contexte de 1 050 000 jetons, le même plafond de sortie de 128 000 jetons, la même date de coupure des connaissances du 30 avril 2026 et les mêmes réponses que GPT-6.1 Sol. Ultrafast est un niveau de service — une priorité d’ordonnancement que vous demandez — pas un second modèle. Le produit tout entier, c’est de la latence, vendue à un multiple, et les deux seules questions qui comptent sont : quelle quantité vous en obtenez et qui est autorisé à l’acheter.
Ce que le dossier dit réellement, dans l’ordre où il le dit
La version à charge de cette histoire est qu’OpenAI a enterré la porte. La version exacte est plus précise, et elle est vérifiable ligne par ligne par rapport à la documentation d’OpenAI elle-même.
Le journal des modifications destiné aux développeurs contient l’entrée datée du 8 octobre : ajout du mode Ultrafast pour GPT-6.1 Sol dans l’API Responses, demandé en envoyant model: "gpt-6.1-sol" avec service_tier: "ultrafast", décrit comme réduisant le temps entre les jetons de sortie générés, et présenté comme disponible pour tous les utilisateurs de l’API sous réserve de limites de débit, avec un traitement mondial et une résidence des données aux États-Unis et dans l’UE. Lu isolément, il s’agit d’un lancement sans restriction à un tarif publié.
La documentation des niveaux indique qu’Ultrafast est le niveau de service le plus rapide de l’API, largement disponible pour GPT-6 Astra et GPT-6.1 Sol avec un accès en avant-première pour GPT-5.6 Sol, et recommande l’utilisation de WebSockets pour celui-ci. Toujours aucune mention d’un plan.

Le détail de l’abonnement se trouve sur la page de vitesse côté ChatGPT, et il s’agit de trois limitations empilées dans un seul paragraphe : Ultrafast est disponible dans Codex et ChatGPT Work, sur Pro à 500 $, ainsi que sur les forfaits Enterprise et Edu éligibles. Les administrateurs Enterprise le voient désactivé par défaut et doivent l’activer par utilisateur ou par espace de travail. Et la surface Chat grand public ne se voit pas proposer ce niveau du tout — GPT-6.1 Sol lui-même réside dans Work et Codex, donc Chat n’a jamais été dans le périmètre.
Rassemblez les trois pages et le tableau est clair. Une clé API est un ticket. Un abonnement ChatGPT n’est un ticket que s’il s’agit de l’abonnement le plus cher vendu par OpenAI, ou si un administrateur vous l’a activé. Personne, en lisant le premier message de l’annonce, ne le devinerait.
Pourquoi la porte existe, et ce n'est pas arbitraire
La lecture évidente est qu'OpenAI utilise la voie rapide pour vendre des forfaits à 500 $. Le mécanisme sous-jacent est moins cynique et plus utile : Ultrafast est un compteur coûteux, et un forfait à 500 $ est le seul forfait grand public où un compteur 8x tient dans l'usage inclus.
Sur un abonnement, l’usage inclus est consommé à huit fois le taux standard lorsque vous utilisez Ultrafast, de sorte qu’un seul tour Ultrafast consomme la même allocation que huit tours standard. C’est une conséquence de ce que fait ce niveau — il achète du temps d’horloge en dépensant de la capacité de service, et un abonnement est un produit à capacité fixe. Facturez la même allocation pour huit fois la consommation de capacité, et l’économie du forfait ne tient plus à 20 $ par mois. Facturez huit fois l’allocation, et le niveau devient tout simplement peu attrayant sur un petit forfait. Dans un cas comme dans l’autre, le niveau finit là où l’allocation est suffisamment grande pour l’absorber.
L'API n'a pas une telle contrainte, car elle est facturée à l'usage. Dans ce cadre, Ultrafast dispose de son propre budget de limitation de débit, distinct des budgets Standard et Fast, et OpenAI décrit ces limites comme définies par organisation plutôt que publiées sur la page du palier. C'est un deuxième point à surveiller que l'annonce n'a pas mis en avant : le passage d'une charge de travail à Ultrafast ne fait pas que multiplier la facture, il déplace la charge de travail vers un autre plafond, et si vous augmentez le trafic au-delà de ce qui a été accordé à l'organisation, les limites propres au palier deviennent le mode de défaillance.
L’arithmétique de l’achat de vitesse de deux façons différentes
Voici la décision en chiffres, et c’est la partie qui vaut la peine d’être faite sur vos propres comptes de jetons plutôt que sur les miens. Prenez une session d’agent qui envoie 30 000 jetons d’entrée et reçoit 1 500 jetons de sortie par tour, sur 40 tours.
• Total de tokens par exécution — 1 200 000 en entrée, 60 000 en sortie, répartis sur 40 requêtes qui restent chacune confortablement sous le seuil de 272 000 tokens à partir duquel OpenAI applique un nouveau tarif à l'ensemble de la requête.
• Sur le GPT-6.1 Sol standard — 1,2 million de tokens à 2,00 $ le million, soit 2,40 $, plus 60 000 à 10,00 $ le million, soit 0,60 $. Trois dollars par exécution.
• Sur GPT-6.1 Sol Ultrafast — 1,2 million à 12,00 $, soit 14,40 $, plus 60 000 à 60,00 $, soit 3,60 $. Dix-huit dollars par exécution.
• La différence — 15,00 $ par exécution pour supprimer la majeure partie du temps de génération sur une tâche qui ne change pas par ailleurs.
Ces 15,00 $ par exécution sont le chiffre à retenir face à l'abonnement. Si la seule raison pour laquelle vous envisagez le forfait Pro est Ultrafast, environ 33 exécutions par mois avec ces nombres de tokens correspond au point où les 500 $ du forfait et le compteur par token de l'API se croisent — en dessous, le compteur est la façon la moins chère d'acheter le même niveau, et au-dessus, le forfait commence à être plus avantageux. Vos nombres de tokens déplaceront ce point de croisement, parfois beaucoup, donc faites vos propres calculs avant de considérer 33 comme un seuil. Il s'agit de notre arithmétique sur une charge de travail déclarée, pas d'un seuil de rentabilité publié.

p>Deux remarques structurelles qui survivent à n’importe quel décompte de tokens.
L’affirmation sur la vitesse est empruntée, et c’est la seule chose à lire attentivement.
Ultrafast est commercialisé sur la promesse d’être « jusqu’à 8 fois plus rapide », et la seule mesure propre à un modèle qu’OpenAI publie à l’appui de cette formule concerne un autre modèle. La phrase dans sa documentation indique que GPT-6 Astra Ultrafast génère des tokens jusqu’à 8 fois plus vite que GPT-6 Astra en mode Standard dans Codex. Il s’agit d’un chiffre propre à Astra, mesuré dans Codex. La documentation du palier de GPT-6.1 Sol le décrit comme réduisant le temps entre les tokens et renvoie à une grille tarifaire ; elle ne lui associe aucun chiffre, et aucun tiers indépendant n’a non plus publié de mesure de tokens par seconde pour la variante Sol.
Cela peut très bien tenir. Les deux modèles tournent sur la même pile de service et le mécanisme de palier est identique, donc un multiple d’Astra constitue un a priori raisonnable pour Sol. Mais « jusqu’à 8x » est un plafond fournisseur, non reproduit, tiré d’un modèle frère — et le « jusqu’à » joue un rôle crucial dans cette phrase. Considérez ce multiple comme une hypothèse à tester sur vos propres prompts, car la documentation propre au palier ne le testera jamais à votre place.
La même mise en garde est plus facile à énoncer pour les niveaux plus anciens. Ultrafast sur GPT-5.6 Sol a été annoncé le 13 août 2026 comme « jusqu'à 14 fois plus rapide que le traitement Standard » en aperçu limité, et trois mois plus tard, la documentation indique toujours un accès en aperçu, tandis que la grille tarifaire Ultrafast ne comporte exactement que deux lignes — GPT-6 Astra et GPT-6.1 Sol. Un chiffre de 14x sans prix publié et sans disponibilité générale est une allégation plutôt qu'un produit, et c'est un rappel utile du caractère encore largement aspirationnel de cette échelle de niveaux.
Si le plan de 500 $ ne se concrétise pas
Pour quiconque ne compte pas acheter Pro à 500 $ pour tester un palier de latence, la bonne approche consiste à séparer les deux éléments que l’annonce a regroupés. Ce palier est disponible sur l’API pour tous les utilisateurs de l’API, si bien que la voie rapide peut être achetée sans abonnement — à 12,00 $ et 60,00 $ par million de tokens, avec son propre budget de limite de débit, sur une charge de travail suffisamment petite pour être mesurée. Testez-la d’abord là, sur vos propres prompts, face à la voie standard.
La voie standard est celle qui existe sans rien de tout cela. OrcaRouter sert GPT-6.1 Sol sous openai/gpt-6.1-sol aux tarifs affichés par OpenAI — 2,00 $ par million de tokens d'entrée et 10,00 $ par million de tokens de sortie — avec 0 % de marge et le prix du fournisseur répercuté tel quel, de sorte qu'une révision tarifaire du fournisseur arrive de notre côté le jour même. Ultrafast n'est pas quelque chose que nous vendons : c'est un indicateur de niveau de service facturé sur votre propre compte OpenAI, et nous préférons le dire clairement plutôt que de laisser une page de modèle sous-entendre le contraire. Ce qu'une clé permet bel et bien, c'est d'acheminer la voie standard et le reste du catalogue — plus de 200 modèles derrière un seul point de terminaison compatible OpenAI — et de basculer automatiquement entre fournisseurs quand l'un d'eux est dégradé, ce qui est l'assurance la moins chère qui soit si vous êtes sur le point de placer un palier de latence devant un chemin de production.

Et si vous êtes sur Plus ou Team et que la réponse que vous cherchiez était « puis-je simplement l'activer », la réponse est non, sous une forme bien précise. Codex et ChatGPT Work sur Pro à 500 $ ou sur une offre Enterprise ou Edu éligible, activés par un administrateur s'il s'agit de l'offre Enterprise. Tout le reste accède à Ultrafast via l'API et paie au token.
Que regarder ensuite
Trois choses feraient passer cela d'un déploiement restreint à un déploiement ordinaire, et ces trois choses sont observables. Une limite de débit Ultrafast publiée pour GPT-6.1 Sol mettrait fin aux conjectures quant à savoir si le plafond propre à ce niveau contraint avant la facture. Une mesure de vitesse propre au modèle — ou une mesure indépendante — remplacerait le chiffre Astra emprunté par une donnée sur laquelle juger le niveau Sol. Et le fait qu'Ultrafast atteigne ChatGPT Plus signifierait que le calcul de capacité a changé, ce qui est le signal que la restriction relevait de la pénurie de lancement plutôt que de la forme permanente du niveau.
D’ici là, le résumé honnête est limité et vérifiable. GPT-6.1 Sol est sorti le 29 septembre 2026 et n’a pas changé. Le 8 octobre 2026, il a obtenu une voie rapide avec un prix réel, ouverte aux utilisateurs de l’API et conditionnée dans ChatGPT à l’abonnement à 500 $ — un détail qui méritait le premier post plutôt que le troisième, et qui détermine pour la plupart des lecteurs s’il s’agit d’une ligne budgétaire ou d’un bon de commande.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
