Une carte hero générée intitulée « Un seul palier, trois modèles », avec trois puces affichant « GPT-6.1 Sol Ultrafast : disponible, 12,00 $ / 60,00 $ », « GPT-6 Astra Ultrafast : disponible, 60,00 $ / 300,00 $ » et « GPT-5.6 Sol Ultrafast : aperçu uniquement, aucun tarif publié », au-dessus d'un pied de page indiquant « D'après la documentation d'OpenAI du 9 octobre 2026 ».
Guides & Insights

GPT-6.1 Sol Ultrafast vs GPT-5.6 Sol Ultrafast : un niveau, trois modèles, dont un toujours en attente

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

GPT-6.1 Sol Ultrafast et GPT-5.6 Sol Ultrafast sont le même niveau de service appliqué à deux générations de Sol différentes, et après le 8 octobre 2026, ils se trouvent dans des états opposés. GPT-6.1 Sol est passé de « bientôt disponible » à une grille tarifaire publiée — 12,00 $ par million de jetons d'entrée, 60,00 $ par million de jetons de sortie, soit six fois le tarif Standard — accessible à tout utilisateur de l'API, ainsi qu'aux utilisateurs de Codex et de ChatGPT Work abonnés au forfait Pro à 500 $. GPT-5.6 Sol en est encore là où Ultrafast a commencé : un niveau annoncé, en aperçu limité, sans aucune ligne sur la page des tarifs. Même nom, même mécanisme, et un seul des deux est réellement achetable.

C'est la version courte. La version longue est importante, car les chiffres de vitesse phares du palier sont rattachés à différents modèles, mesurés sur différentes surfaces, et dans un cas, vieux de trois mois.

Ce qu’« Ultrafast » est réellement sur chaque modèle

Sur aucun des deux modèles, Ultrafast n'est un point de contrôle distinct. Vous envoyez le même identifiant de modèle et changez de niveau de service — model: "gpt-6.1-sol" avec service_tier: "ultrafast" dans l'API Responses — et OpenAI planifie votre requête sur le chemin à faible latence. Les poids, les réponses et la fenêtre de contexte sont inchangés. Sur GPT-6.1 Sol, cette fenêtre est de 1 050 000 tokens, avec un maximum de 922 000 tokens en entrée et de 128 000 en sortie ; GPT-5.6 Sol possède une fenêtre et un plafond de sortie identiques, et diffère principalement par sa date limite de connaissances (16 février 2026 contre 30 avril 2026) et par son échelle de raisonnement, où GPT-5.6 Sol accepte encore none et GPT-6.1 Sol non.

Donc la comparaison n'est pas « quel modèle réfléchit le plus vite ». Elle est « quelle génération du même palier vous est ouverte », et la réponse a changé il y a quatre jours.

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

Les multiples publiés, et le seul chiffre qui est resté à 14x

OpenAI a publié deux affirmations de vitesse concernant ce niveau, sur deux modèles, et aucune des deux ne constitue une déclaration générale à propos d'« Ultrafast ».

• GPT-6 Astra Ultrafast — « génère des tokens jusqu'à 8 fois plus vite que GPT-6 Astra en mode Standard dans Codex ». C'est le titre phare actuel de ce niveau, répété dans la documentation sur la vitesse côté ChatGPT.

• GPT-5.6 Sol Ultrafast — annoncé le 13 août 2026 comme fonctionnant « jusqu'à 14 fois plus vite que le traitement Standard », en aperçu limité pour certains clients.

Remarquez ce qui manque. Il n'existe aucun multiple de vitesse publié pour GPT-6.1 Sol Ultrafast. Sa page de documentation décrit le niveau de service, indique ses limites de débit et sa posture en matière de résidence des données, et renvoie au tableau de tarification — mais le seul multiple propre à un modèle dans l'ensemble de la documentation appartient à Astra. La position honnête est que « jusqu'à 8x » est la mesure d'Astra, sur la même pile de service, et c'est le chiffre sur lequel le déploiement est vendu, sans qu'il ait été reproduit pour Sol par qui que ce soit, au sein d'O​penAI ou à l'extérieur.

Le chiffre 14x mérite plus de méfiance qu’on ne lui en accorde d’ordinaire, en raison de son ancienneté. Annoncé à la mi-août pour un palier qui n’a toujours pas atteint la disponibilité générale, il est resté sans révision pendant environ deux mois, tandis que le palier lui-même a été reconstruit autour de deux autres modèles. Pendant ce temps, ce qu’il était évident d’attendre — que l’Ultrafast de 5.6 Sol quitte la préversion et soit tarifé — ne s’est jamais produit. À la place, GPT-6 Astra l’a obtenu le 29 septembre et GPT-6.1 Sol l’a obtenu le 8 octobre. Un chiffre qui n’existe que dans une annonce, attaché à une configuration que personne ne peut acheter, n’est qu’un argument marketing tant qu’il ne figure pas sur une grille tarifaire.

Côte à côte : ce que chacun coûte et qui peut y accéder

• Tarif standard — GPT-6.1 Sol $2.00 en entrée / $0.10 mis en cache / $2.50 en écriture de cache / $10.00 en sortie pour 1 million de jetons contre GPT-5.6 Sol $4.00 / $0.40 / $5.00 / $20.00

• Tarif Ultrafast — GPT-6.1 Sol 12,00 $ / 0,60 $ / 15,00 $ / 60,00 $, publié selon la règle 6x-Standard et sa propre ligne dans le tableau de tarification Ultrafast, contrairement à GPT-5.6 Sol, aucun tarif publié

• Contexte long au-delà de 272 K jetons d'entrée — GPT-6.1 Sol re-tarifé à 2 fois les tarifs d'entrée et de cache et à 1,5 fois la sortie pour l'ensemble de la requête, ce qui donne une ligne Ultrafast à contexte long de 24,00 $ / 1,20 $ / 30,00 $ / 90,00 $ contre l'équivalent Ultrafast de GPT-5.6 Sol, que personne n'a publié

• Disponibilité du niveau — GPT-6.1 Sol : tous les utilisateurs de l'API, soumis à des limites de débit distinctes, ainsi que Codex et ChatGPT Work sur l'offre Pro à 500 $ et les formules Enterprise et Edu éligibles, contre GPT-5.6 Sol : aperçu limité pour certains clients de l'API

• Limites de débit au lancement — GPT-6.1 Sol dispose de son propre budget Ultrafast, distinct des limites Standard et Fast, défini par organisation et relevé sur demande, contrairement à GPT-5.6 Sol, non publié

• Résidence des données — GPT-6.1 Sol prend en charge la résidence aux États-Unis et dans l’UE ainsi que le traitement mondial avec Fast et Ultrafast, contrairement à GPT-5.6 Sol, qui prend en charge la résidence aux États-Unis et le traitement mondial

• Facteur de vitesse — GPT-6.1 Sol, aucun publié vs GPT-5.6 Sol, « jusqu'à 14x » dans l'annonce d'août, non reproduit

• Contexte et plafond de sortie — 1 050 000 et 128 000 pour les deux

Une asymétrie dans cette liste mérite d’être relevée. GPT-6.1 Sol est la seule configuration Ultrafast avec résidence des données dans l’UE : l’Ultrafast d’Astra est réservé aux États-Unis, et 5.6 Sol n’est pas accessible du tout. Si votre charge de travail doit impérativement être traitée dans l’UE, le 8 octobre est la première date à laquelle ce niveau a été disponible pour vous, sous quelque forme que ce soit.

Sur un abonnement, la différence, c’est le forfait, pas le modèle.

Dans Codex et ChatGPT Work, les deux générations se comportent de la même manière sur le plan structurel — Ultrafast est un réglage de vitesse sur un modèle que vous possédez déjà —, mais le contrôle d’accès en amont est nouveau. Ultrafast est disponible avec Pro à 500 $ et sur les forfaits Enterprise et Edu éligibles, et cette option est désactivée par défaut dans les espaces de travail Enterprise tant qu’un administrateur ne l’a pas activée. Dans le cadre d’un abonnement, l’utilisation incluse est décomptée à 8x le tarif Standard, et les crédits achetés ou le paiement à l’usage Enterprise sont facturés à 6x ; sur l’API, le multiplicateur est uniformément de 6x sur chaque ligne tarifaire.

Pour GPT-5.6 Sol spécifiquement, rien de tout cela n’est encore accessible. Il n’existe pas de voie d’abonnement — la documentation de vitesse côté ChatGPT répertorie Ultrafast comme prenant en charge GPT-6 Astra et GPT-6.1 Sol — et la voie API reste réservée à une cohorte de prévisualisation. Quoi que promette le chiffre de 14x, il le promet à un ensemble de comptes qui ne s’est pas élargi depuis deux mois.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

Lequel utiliser concrètement, et quand attendre

Si vous commencez aujourd’hui, la question se répond en grande partie d’elle-même : GPT-6.1 Sol Ultrafast est achetable, tarifé et documenté, et GPT-5.6 Sol Ultrafast ne l’est pas. La raison de se tourner plutôt vers l’ancien modèle n’est pas du tout le niveau — c’est que GPT-5.6 Sol est en circulation depuis le 9 juillet 2026, et si vous avez des suites de prompts, des évaluations et des modèles de coûts conçus pour lui, le coût de migration pour passer à une actualisation de Sol avec une date limite de connaissances différente et une échelle de raisonnement strictement plus étroite est bien réel, même lorsque le prix est réduit de moitié. Faites ce changement selon son propre calendrier, et non parce qu’un réglage de vitesse est enfin arrivé.

La règle de décision pour le palier lui-même est celle que les chiffres d’Astra impliquent et que ceux de Sol valident : payer six fois le prix pour une réduction de latence est un bon compromis quand un humain ou un agent est bloqué sur le résultat, et un mauvais quand une tâche peut attendre le lendemain matin. Rien dans le déploiement de GPT-6.1 Sol ne change ce calcul ; il rend simplement cette option disponible sur un modèle de base moins cher, où la facture absolue pour un tour rapide est plus faible.

Et si vous voulez plutôt le niveau Fast, vous pouvez raisonner à partir de la seule grille tarifaire : 2x Standard, et Fast est l’option intermédiaire stable depuis qu’OpenAI a rebaptisé Priority processing le 30 juillet 2026. Ultrafast reste le niveau où vous achetez une promesse non mesurée, et, du côté de GPT-5.6 Sol, un niveau que vous ne pouvez pas acheter du tout.

Appeler l'un ou l'autre depuis une seule touche

Les modèles GPT-5.6 Sol et GPT-6.1 Sol de gamme standard sont tous deux disponibles sur OrcaRouter — openai/gpt-5.6-sol à 4,00 $ en entrée et 20,00 $ en sortie par million de tokens, openai/gpt-6.1-sol à 2,00 $ et 10,00 $ — servis avec une marge de 0 %, avec le prix catalogue du fournisseur répercuté, de sorte qu'une variation tarifaire du fournisseur atteint votre facture le jour même où elle atteint la grille tarifaire. Cela compte plus que d'habitude pour ce duo, car le tarif de 4,00 $ / 20,00 $ de GPT-5.6 Sol est explicitement promotionnel et OpenAI indique qu'il est disponible au moins jusqu'au 21 novembre 2026. Lorsque cette fenêtre se ferme, l'écart entre les deux générations se réduit, et une plateforme de répercussion signifie que vous le découvrez dans vos chiffres d'utilisation plutôt que dans un e-mail de renouvellement.

La même clé et le même point de terminaison prennent en charge plus de 200 modèles, donc comparer les deux générations de Sol sur votre propre trafic ne nécessite ni deux intégrations ni deux contrats, et le basculement automatique maintient un chemin de production opérationnel si un fournisseur se dégrade. Lorsqu'une seule réponse ne suffit pas, le DSL de routage compose plusieurs modèles en un seul appel et la fusion de modèles place un panel derrière.

Ce que nous ne proposons pas, c’est Ultrafast. Sur l’un comme sur l’autre modèle, il s’agit d’un indicateur de niveau de service sur un compte OpenAI plutôt que d’un modèle routable séparément ; il reste donc à l’intérieur de votre intégration OpenAI directe — et sur GPT-5.6 Sol, il n’y est même pas disponible en accès général. Nous le disons sans détour, car l’alternative serait de laisser entendre une capacité que nous n’avons pas. Ce qui n’est pas une phrase que nous souhaitons voir sur ce blog.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement