Date de sortie, fonctionnalités, tarifs et guide d'accès de GPT-5.6
Guides & Insights

Date de sortie, fonctionnalités, tarifs et guide d'accès de GPT-5.6

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

GPT-5.6 Sol vient d'obtenir un palier de vitesse Ultrafast — jusqu'à 14 fois plus rapide que le traitement Standard, aperçu cette semaine sur l'API Open​AI — tandis que GPT-5.6 Terra et GPT-5.6 Luna poursuivent le déploiement de la famille dans ChatGPT. Deux mois après le lancement de l'API, la génération GPT​-5.6 est à la fois largement disponible et continue de gagner des capacités : le même fleuron qui dépasse GPT-5.5 en raisonnement peut désormais être aperçu à raison de jusqu'à 750 jetons de sortie par seconde. La même semaine, Open​AI a également étendu son programme de cybersécurité Daybreak en Daybreak Blue pour les défenseurs et Daybreak Red, propulsé par un nouveau modèle GPT​-5.6-Cyber construit sur Sol pour la recherche autorisée de vulnérabilités.

Open​AI a lancé la famille de modèles GPT​-5.6 le 9 juillet 2026, et le 6 août, elle a intégré le modèle phare dans ChatGPT avec une mise à jour axée sur la fiabilité et un accès gratuit élargi. Ce n'est pas simplement une autre mise à niveau mono-modèle. C'est une famille à plusieurs niveaux conçue pour offrir aux développeurs des choix plus clairs en matière d'intelligence, de vitesse et de coût — et c'est désormais aussi l'expérience par défaut pour les utilisateurs gratuits de ChatGPT.

Le hic, c'est que «GPT​-5.6» signifie différentes choses à différents endroits.

{{1}}L'API est en ligne depuis le 9 juillet avec une tarification publique pour les trois niveaux.{{/1}} {{2}}Le déploiement de ChatGPT se fait par phases :{{/2}} {{3}}le Sol mis à jour a atteint les utilisateurs Plus et Pro le 6 août{{/3}}, {{4}}GPT-5.6 Luna devient le modèle par défaut pour les comptes Free et Go cette semaine{{/4}}, {{5}}et les conversations textuelles sur ces niveaux deviennent illimitées la semaine du 10 août{{/5}}. {{6}}Le Sol derrière les surfaces Work et Codex de ChatGPT n'a pas été modifié par cette mise à jour.{{/6}} {{7}}L'aperçu Ultrafast est de nouveau séparé :{{/7}} {{8}}un nouveau niveau de vitesse dans l'API, annoncé le 13 août{{/8}}, {{9}}initialement limité à un petit groupe de clients.{{/9}}

GPT-5.6 est officiel, disponible et largement accessible — et son modèle phare est désormais le modèle frontal le plus rapide sur le papier. Pour les développeurs, l’élément intéressant reste la décision de routage : Sol pour les raisonnements les plus difficiles, Terra pour les tâches de production équilibrées, Luna pour les volumes élevés — et, lorsque l’aperçu sera ouvert, un niveau Ultrafast pour les charges de travail Sol à faible latence — avec des prix qui ont changé pour deux des trois niveaux fin juillet.

Ce guide explique ce qu'est GPT​-5.6, ce qui est officiellement confirmé, en quoi Sol, Terra et Luna diffèrent, comment fonctionne la tarification, ce que signifie l'aperçu Ultrafast, et pourquoi GPT​-5.6 rend le routage des modèles plus important.

Réponse rapide

GPT-5.6 est-il sorti ? Oui. L'API a été lancée le 9 juillet 2026, et l'accès à ChatGPT est en cours de déploiement — Sol mis à jour pour Plus/Pro depuis le 6 août, Luna comme modèle par défaut de l'offre gratuite/Go cette semaine.

Puis-je utiliser GPT-5.6 dans ChatGPT ? Oui. GPT-5.6 Sol est désormais le modèle par défaut mis à jour dans l’expérience de chat Plus/Pro (avec un nouveau curseur de réflexion), et GPT-5.6 Luna devient le modèle par défaut des comptes Free et Go cette semaine.

Puis-je utiliser GPT​-5.6 via l'API ? Oui. Sol, Terra et Luna sont toutes disponibles sur l'API publique avec des tarifs publiés, et sur OrcaRouter avec une majoration de 0%.

Qu'est-ce que le mode GPT-5.6 Sol Ultrafast ? Il s'agit d'un palier de vitesse en aperçu sur l'API qui exécute GPT-5.6 Sol jusqu'à 14X plus vite que le traitement Standard, à raison de 750 jetons de sortie par seconde au maximum. Il est initialement limité à un petit groupe de clients, et Open​AI n'a pas publié de tarif pour celui-ci.

Y a-t-il une liste d'attente ? Pour l'accès de base, non — l'API est publique et l'accès à ChatGPT est déployé progressivement à tous les niveaux, il n'y a donc rien à rejoindre. Le mode Ultrafast est différent : il s'agit d'un aperçu limité, initialement ouvert à un petit groupe de clients, avec une inscription pour être notifié à mesure que la capacité s'étend.

Quand GPT-5.6 sera-t-il généralement disponible ? Il l’est déjà, par étapes : l’API a été mise en ligne le 9 juillet 2026, la version mise à jour de Sol est arrivée sur ChatGPT Plus/Pro le 6 août, Luna devient le modèle par défaut des formules gratuite et Go cette semaine, et les conversations texte gratuites illimitées arrivent la semaine du 10 août.

Faut-il attendre GPT-5.6 ?Non, pas si vous voulez l’utiliser — il est en ligne. La vraie question est de savoir vers quel palier acheminer chaque tâche et quelle quantité de raisonnement autoriser, car c’est désormais ce qui détermine votre coût par tâche.

Qu'est-ce que GPT​-5.6 ?

GPT-5.6 est la nouvelle famille de modèles d’OpenAI et la génération successeur de GPT-5.5.

Le mot-clé est famille.

Au lieu de lancer un modèle pour chaque cas d’utilisation, OpenAI introduit trois niveaux :

- GPT-5.6 Sol est le modèle phare pour les travaux les plus difficiles : raisonnement approfondi, codage agentique, recherche, travail de connaissances professionnelles et tâches complexes nécessitant de nombreux outils.

- GPT-5.6 Terra est le modèle équilibré pour le travail quotidien. Il est conçu pour offrir une grande capacité à moindre coût, ce qui le rend plus adapté aux applications de production qui ne peuvent pas envoyer toutes leurs requêtes au modèle phare.

- GPT-5.6 Luna est le niveau le plus rapide et le plus rentable. Il est conçu pour les tâches à haut volume, l'automatisation légère, les résumés, la classification, le routage et d'autres charges de travail où la vitesse et le coût importent plus que la profondeur maximale de raisonnement.

Cela change la question principale que les développeurs doivent se poser.

La question n'est plus : devrais-je utiliser GPT​-5.6 ?

La meilleure question est : quel modèle GPT-5.6 devrait gérer cette tâche ?

Toutes les requêtes n'ont pas besoin de Sol. Certaines tâches exigent un raisonnement maximal. D'autres nécessitent une latence plus faible. Certaines requièrent le modèle fiable le moins coûteux. GPT{{1}}​-5.6 rend ce compromis explicite.

Qu’est-ce qui est officiellement confirmé ?

GPT​-5.6 ne doit pas être traité comme un tour d'horizon des rumeurs. Open​AI a officiellement confirmé la famille de modèles et l'accès en avant-première.

Les points confirmés sont :

- GPT​-5.6 est une famille de modèles avec Sol, Terra et Luna.

Il a été lancé sur l'API le 9 juillet 2026, avec les trois niveaux tarifés publiquement.

L'accès à ChatGPT est en cours de déploiement : Sol mis à jour pour Plus/Pro (6 août), Luna comme option gratuite/Go par défaut (cette semaine), chats texte gratuits illimités (semaine du 10 août).

OpenAI rapporte que le Sol mis à jour commet environ 68 % d'erreurs factuelles en moins que GPT-5.5 Instant lors d'évaluations internes financières/médicales/juridiques (annoncé par le fournisseur ; environ 62 % pour Luna).

Les utilisateurs Plus et Pro disposent d'un nouveau curseur de réflexion pour contrôler le niveau de raisonnement consacré à chaque réponse.

Les prix de l'API sont publics — et Terra et Luna ont été réduits fin juillet 2026 (Sol inchangé).

GPT-5.6 introduit une mise en cache des prompts plus prévisible.

- GPT-5.6 Sol inclut un nouvel effort de raisonnement maximal.

GPT-5.6 introduit un mode ultra utilisant des sous-agents pour les tâches complexes.

OpenAI a présenté en avant-première le mode Ultrafast pour GPT-5.6 Sol sur l'API le 13 août 2026 — jusqu'à 14 fois plus rapide que le traitement Standard, avec jusqu'à 750 tokens de sortie par seconde, initialement pour un petit groupe de clients. Les chiffres de vitesse sont fournis par le fournisseur et n'ont pas encore été reproduits de manière indépendante.

OpenAI a élargi Daybreak, son programme de cybersécurité vérifié, en deux niveaux le 10 août 2026 : Daybreak Blue (GPT-5.6 Sol avec les garde-fous cyber supprimés, pour les travaux défensifs) et Daybreak Red (GPT-5.6-Cyber, un modèle basé sur Sol spécialement entraîné pour la recherche de vulnérabilités autorisée). L'accès est limité aux clients vérifiés et aux partenaires de sécurité, et non à l'API publique.

Les questions ouvertes sont différentes :

Comment le Sol affiné par ChatGPT se comparera-t-il au Sol API sur des tâches réelles ?

À quelle vitesse fonctionnera-t-il dans les flux de production réels ? L'aperçu Ultrafast est le premier vrai point de données, et il est toujours réservé sur invitation.

- Combien de fois les garde-fous ajouteront-ils des frictions ?

- Comment Sol, Terra et Luna se comparent-ils sur des tâches réelles ?

- Combien de raisonnement suffit-il, et comment dosez-vous le nouveau curseur de réflexion ?

Comment le niveau Ultrafast sera-t-il tarifé, et à quelle vitesse l’offre de Cerebras pourra-t-elle suivre la demande pour celui-ci ?

C'est pourquoi la bonne approche est la préparation, pas la migration aveugle.

Date de sortie et accès à GPT-5.6

La réponse la plus simple : GPT​-5.6 est sorti sur l'API le 9 juillet 2026, et l'accès à ChatGPT est déployé par phases jusqu'en août.

L'accès à l'API est désormais ouvert à tout développeur avec des tarifs publiés. Ce qui varie encore, c'est la surface : le Sol optimisé pour l'expérience de chat de ChatGPT n'est pas le même que le modèle API — Open​AI affirme que la version qui alimente Work et Codex est inchangée — donc le comportement peut différer entre l'application grand public et l'API.

Pour les utilisateurs de ChatGPT, la situation de juin est inversée. Les utilisateurs Plus et Pro reçoivent la version mise à jour de Sol avec un nouveau curseur de réflexion sur le web, le mobile et le bureau, qui échange la profondeur des réponses contre la latence. Les utilisateurs Free et Go obtiennent Luna par défaut cette semaine, ainsi qu'un bouton Think pour les questions plus difficiles, avec des discussions textuelles illimitées qui arrivent la semaine du 10 août.

La toute dernière nouveauté de l'histoire de l'accès est l'aperçu Ultrafast. Annoncé le 13 août 2026, il s'agit d'un nouveau niveau de vitesse dans l'API pour GPT-5.6 Sol — jusqu'à 14 fois plus rapide que le traitement Standard (selon le fournisseur) — et il commence avec un petit groupe de clients plutôt qu'un lancement ouvert. Open​AI indique qu'il teste ce niveau dans les domaines du codage, du commerce, de la recherche financière, du support client et des applications interactives afin d'apprendre où la vitesse crée une réelle valeur avant d'élargir l'accès. Les autres clients peuvent s'inscrire pour être informés lorsque la capacité augmentera.

Pour les développeurs, la formulation sûre est désormais : GPT-5.6 est une famille d'API disponible et tarifée. L'incertitude restante est comportementale — à quel point chaque niveau réfléchit, à quel point il est verbeux, et ce que cela coûte par tâche terminée — et non pas de savoir si vous pouvez y accéder. Le palier Ultrafast est le seul endroit où l'accès reste encore une question.

Cette distinction compte. Ne planifiez pas un lancement autour d’une date d’accès à GPT​-5.6 ; planifiez plutôt en fonction du comportement des paliers et du coût par tâche. Élaborez votre jeu d’évaluation, mesurez l’effort de raisonnement et conservez une solution de repli.

GPT-5.6 Sol, Terra et Luna expliqués

GPT-5.6 Sol

Sol est le modèle à tester quand la qualité importe plus que le coût.

Utilisez-le pour :

génie logiciel complexe

workflows de codage agentifs

utilisation d'outils à long horizon

- débogage difficile

- analyse de recherche

- raisonnement d'entreprise à enjeux élevés

défense en cybersécurité et recherche de vulnérabilités

Sol est le niveau phare, mais cela ne signifie pas qu'il doit traiter toutes les requêtes.

Le 6 août 2026, Open​AI a également réajusté le Sol utilisé dans l’expérience Chat de ChatGPT pour les conversations de tous les jours — plus fiable en matière de faits, des réponses plus directes et un ton cohérent entre Instant et Thinking. Les évaluations internes d’Open​AI, et non celles d’un laboratoire indépendant, ont constaté une réduction d’environ 68 % des erreurs factuelles par rapport à GPT-5.5 Instant sur des requêtes financières, médicales et juridiques. Le réglage de ChatGPT est distinct du modèle d’API ; le Sol derrière Work et Codex est inchangé.

Sol est également le palier qui bénéficie de l’aperçu Ultrafast. Le 13 août 2026, Open​AI a présenté en aperçu un mode Ultrafast pour Sol sur l’API, qui exécute le même modèle jusqu’à 14X plus vite que le traitement Standard (selon le fournisseur), destiné aux travaux critiques en latence. Ce n’est pas encore largement disponible — l’aperçu commence avec un petit groupe de clients — mais c’est le premier signe que la qualité de Sol n’a pas à s’accompagner de la latence du palier Standard.

Sol est également le modèle derrière le programme Daybreak d'Open​AI : Daybreak Blue fournit GPT-5.6 Sol avec des garde-fous cyber retirés à des défenseurs agréés, et GPT​-5.6-Cyber est spécialement entraîné sur Sol pour la recherche de vulnérabilités autorisée. Les deux paliers sont à accès restreint et se situent en dehors de l'API publique.

GPT-5.6 Terra

Terra est l'option équilibrée.

Utilisez-le pour :

assistants IA du quotidien

rédaction commerciale et analyse

- outils de connaissances internes

flux de travail du support client

- aide au codage qui ne nécessite pas un raisonnement maximum

traitement de documents

- automatisation de complexité moyenne

Terra pourrait devenir le niveau GPT-5.6 le plus pratique pour de nombreuses applications de production, car il équilibre capacités et prix.

GPT-5.6 Luna

Luna est le niveau rapide et abordable.

Utilisez-le pour :

- requêtes à volume élevé

- classification

routage

- résumé

transformations simples

étapes d'agent léger

- réponses de repli

génération de brouillon

Luna est utile lorsque la tâche est suffisamment simple pour que payer pour Sol soit un gaspillage.

Luna est également le modèle par défaut pour les consommateurs : Open​AI a fait de GPT-5.6 Luna le modèle des comptes ChatGPT Free et Go au cours de la semaine du 3 août 2026, en remplacement de GPT-5.5 Instant. Un nouveau bouton Think permet à ces utilisateurs de demander un raisonnement plus avancé, et les conversations textuelles deviennent illimitées à partir de la semaine du 10 août.

Tarification et mise en cache de GPT​-5.6

Le prix de GPT-5.6 est déjà public.

GPT-5.6 Sol

$5 par 1M tokens

- Sortie : 30 $ par million de tokens

- Meilleur pour le raisonnement de pointe, le codage complexe et le travail agentique profond

GPT-5.6 Terra

2 $ par million de tokens (en baisse par rapport à 2,50 $ fin juillet 2026)

Sortie : 12 $ par million de jetons (au lieu de 15 $)

- Idéal pour un travail quotidien équilibré

GPT-5.6 Luna

0,20 $ par million de tokens (au lieu de 1 $)

- Sortie : 1,20 $ par million de jetons (réduit depuis 6 $)

- Idéal pour les charges de travail rapides, abordables et à volume élevé

Open​AI a réduit Terra de 20 % et Luna de 80 % fin juillet 2026, invoquant des gains d’efficacité d’inférence ; Sol est resté à 5 $/30 $. Parce qu’OrcaRouter transmet les tarifs des fournisseurs avec une marge de 0 %, ces réductions apparaissent sur nos pages de modèles le jour même où elles sont publiées.

L'aperçu Ultrafast n'a pas encore de prix publié. Il s'agit d'un aperçu limité à un petit groupe de clients, et Open​AI n'a pas indiqué comment ce palier sera facturé — ne supposez donc pas que le tarif Sol de 5 $/30 $ s'y applique. C'est un point à surveiller en parallèle des chiffres de vitesse : si un palier de vitesse premium arrive à un tarif premium, le calcul du coût par jeton pour les charges de travail sensibles à la latence change.

Le prix rend une chose claire : GPT-5.6 n'est pas destiné à être utilisé comme un modèle par défaut pour chaque tâche.

Une stratégie de routage judicieuse pourrait ressembler à ceci :

- utilisez Luna pour les tâches simples et à volume élevé ;

- utilisez Terra pour le raisonnement quotidien et les flux de travail professionnels;

- utilisez Sol pour les tâches de codage, de recherche ou d’agentique les plus difficiles ;

- mettre en cache le contexte répété de manière agressive ;

- éviter d'envoyer chaque requête à Sol par défaut.

GPT-5.6 introduit également une mise en cache des prompts plus prévisible, notamment des points de coupure de cache explicites et une durée de vie minimale du cache de 30 minutes. Pour les workflows de longue durée, les agents de codage et les assistants d'entreprise, cela peut faire une grande différence.

Le point à retenir : Mesurez le coût par tâche accomplie, pas seulement le coût par jeton.

Un modèle plus cher peut être moins coûteux s'il termine le travail en moins de tentatives. Un modèle moins cher peut être meilleur lorsque la tâche est simple et en grand volume.

Quoi de neuf dans GPT-5.6 ?

GPT-5.6 ne devrait pas être principalement décrit à travers des nombres de fenêtres de contexte supposés ou des journaux internes divulgués.

Les changements importants sont ceux qu'Open​AI a confirmés.

Une famille de modèles à trois niveaux

Sol, Terra et Luna rendent la sélection de modèles plus structurée. Les développeurs peuvent acheminer les tâches en fonction de la difficulté, de la latence et du coût au lieu de tout envoyer vers un modèle phare.

Des workflows agentiques et de codage plus puissants

GPT-5.6 Sol est positionné autour du codage agentique, des workflows en ligne de commande, de la planification, de l'itération et de la coordination d'outils.

Cela importe parce que les agents de codage modernes font plus que simplement écrire des extraits de code. Ils inspectent les dépôts, exécutent des commandes, comprennent les échecs de tests, corrigent les fichiers, vérifient les modifications, et répètent jusqu'à ce que la tâche soit terminée.

Nouvel effort de raisonnement maximal

Sol introduit un nouvel effort de raisonnement max pour les tâches plus difficiles.

Ceci ne devrait pas être utilisé partout. Un raisonnement plus poussé peut augmenter le coût et la latence, il devrait donc être réservé aux travaux pour lesquels une planification plus approfondie en vaut la peine : débogage complexe, migrations, synthèse de recherche, révision de sécurité ou analyse de données difficiles.

Mode Ultra avec sous-agents

GPT-5.6 introduit un mode ultra qui utilise des sous-agents pour les tâches complexes.

Cela pointe vers un avenir où les modèles ne se contentent pas de répondre à des requêtes. Ils coordonnent le travail à travers plusieurs étapes ou agents spécialisés.

Mode ultrarapide : GPT-5.6 Sol à une vitesse pouvant atteindre 14X.

Le 13 août 2026, Open​AI a dévoilé Ultrafast, un nouveau palier de service dans l’API qui exécute GPT-5.6 Sol jusqu’à 14 fois plus vite que le traitement Standard, générant jusqu’à 750 jetons de sortie par seconde. Open​AI affirme que ce palier offre la même intelligence que GPT-5.6 Sol Standard — l’accélération concerne la latence, pas un modèle plus petit ou plus faible. Ces chiffres de vitesse sont annoncés par le fournisseur : Open​AI les a présentés avec son partenaire d’inférence Cerebras, et aucun laboratoire indépendant ne les a encore reproduits.

La vitesse vient d'une pile d'inférence différente, pas d'un modèle différent. Ultrafast fonctionne sur l'architecture Wafer-Scale Engine de Cerebras, qui conserve les poids du modèle sur la puce (44 Go de SRAM par puce de taille de tranche) et supprime le goulot d'étranglement de la bande passante mémoire qui limite l'inférence basée sur GPU. Pour ce niveau, Open​AI utilise le matériel de Cerebras plutôt que le sien.

Ultrafast est initialement un aperçu limité. Un petit groupe de clients y accède en premier, et Open​AI indique qu'il teste ce niveau dans les domaines du codage, du commerce, de la recherche financière, du support client et des applications interactives afin de comprendre où la vitesse crée de la valeur. Les autres clients peuvent s'inscrire pour être prévenus lorsque la capacité augmentera. Aucun prix n'a été publié et aucune date de disponibilité générale n'a encore été annoncée.

Open{{1}}AI{{/1}} et Cerebras ont également publié des chiffres comparatifs, tous rapportés par les fournisseurs et basés sur les données de vitesse de sortie d'Artificial Analysis : Ultrafast affirme être 5 fois plus rapide que Claude Opus 4.8 en mode Fast et 11 fois plus rapide que Claude Fable 5 ; sur l'ensemble de 2 500 questions de Humanity's Last Exam, il terminerait en un peu plus de 11 heures, contre plus de trois jours pour Claude Fable 5, avec une précision comparable ; et sur GDP-Val (mémoires juridiques, modèles financiers, rapports d'ingénierie), il revendique une accélération de bout en bout de 5,6 fois sans perte de qualité. Considérez ces affirmations comme celles d'Open{{2}}AI{{/2}} et de Cerebras jusqu'à ce que des exécutions indépendantes les confirment.

Ce niveau soulève également deux questions ouvertes. Premièrement, la capacité : l’offre de Cerebras à l’échelle du wafer est la contrainte, et le fait que l’aperçu reste sur invitation uniquement après fin 2026 indiquera si le matériel peut suivre la demande. Deuxièmement, la structure tarifaire : un niveau de vitesse premium pourrait segmenter la tarification de l’API d’une manière qui compte pour les équipes sensibles aux coûts.

Des garanties renforcées

GPT-5.6 est également doté de garde-fous plus solides, notamment en ce qui concerne la cybersécurité et les flux de travail biologiques. Certaines demandes peuvent prendre plus de temps ou ne renvoyer aucun contenu pendant que des contrôles de sécurité supplémentaires sont exécutés.

Pour les équipes légitimes de défense ou de recherche, cela ne rend pas GPT-5.6 inutilisable. Mais cela signifie que les flux de travail des domaines sensibles doivent être testés avec soin avant la migration en production.

Daybreak Blue and Red : GPT-5.6 avec des garde-fous abaissés pour les équipes approuvées

Le revers de la médaille de ces garanties renforcées, c’est qu’OpenAI propose désormais aussi, pour cette même famille, un accès avec moins de garde-fous. Le 10 août 2026, elle a élargi Daybreak — son programme de cybersécurité approuvé — en deux niveaux. Daybreak Blue donne aux défenseurs approuvés GPT-5.6 Sol avec les garde-fous système au niveau cyber supprimés, pour la découverte de vulnérabilités, la revue de code sécurisé, l’analyse de logiciels malveillants, l’ingénierie de détection, la réponse aux incidents et la validation de correctifs. OpenAI le décrit comme le point de départ recommandé pour la plupart des défenseurs.

Daybreak Red va plus loin. Il donne accès à GPT​-5.6-Cyber, un modèle spécifiquement entraîné sur GPT-5.6 Sol pour la découverte de failles zero-day et le développement de chaînes d'exploits. L'accès est fortement restreint et surveillé — vérification d'identité, restrictions d'usage approuvé et attestations légales — et Open​AI déclare que les comptes Daybreak individuels devront adopter des clés de sécurité matérielles à partir du 1er septembre 2026.

Les chiffres de capacité sont déclarés par les fournisseurs. Sur le taux d'achèvement interne en cybersécurité avancée d'Open​AI, GPT​-5.6-Cyber a accompli 95 % des tâches sensibles demandées, contre 57,3 % pour son prédécesseur GPT​-5.5-Cyber — tandis que Sol via Daybreak Blue en a accompli 2,0 % (1,5 % avec les garde-fous standard). Open​AI présente ce changement comme une évolution du taux de refus plutôt qu'un bond en matière d'intelligence : le modèle sous-jacent répond au lieu de refuser. Open​AI affirme également que le modèle a aidé à mettre au jour deux vulnérabilités jusqu'alors inconnues dans le moteur V8 de Chrome, signalées à Google et corrigées sous la référence CVE-2026-15903.

Daybreak n'est pas un produit d'API publique. L'accès passe par le programme d'Open​AI et un réseau de partenaires fournisseurs de sécurité, si bien que la plupart des équipes le rencontreront indirectement — dans de meilleurs outils défensifs, et dans le signal qu'Open​AI propose désormais un modèle dont le travail consiste à attaquer des systèmes au nom des défenseurs.

Sol dans ChatGPT : un réglage de fiabilité et un curseur de pensée.

L'annonce du 6 août 2026 concernait l'expérience utilisateur. OpenAI a ajusté Sol dans l'expérience Chat de ChatGPT pour qu'il soit plus fiable en matière de faits — dates, chiffres, sources, règles et hypothèses — et plus direct dans les réponses quotidiennes, tout en rapprochant les expériences Instant et Thinking. Les chiffres derrière « plus fiable » sont les évaluations internes d'OpenAI, et non celles d'un laboratoire indépendant : sur des requêtes financières, médicales et juridiques, les réponses contenant des erreurs factuelles étaient environ 68 % moins fréquentes avec Sol (et 62 % moins avec Luna) qu'avec GPT-5.5 Instant.

Les utilisateurs Plus et Pro bénéficient également d'un nouveau curseur de réflexion sur le web, sur mobile et sur ordinateur de bureau, leur permettant de choisir la quantité de raisonnement que chaque réponse consacre — des réponses rapides pour les questions quotidiennes à une planification, des recherches, de l'écriture, du codage ou des décisions plus approfondis. Open​AI affirme que la version de Sol derrière Work et Codex est inchangée ; l'ajustement s'applique à l'expérience Chat.

Gratuit et Go : Luna par défaut, conversations texte illimitées

Open​AI a fait de GPT-5.6 Luna le modèle par défaut des comptes ChatGPT Free et Go cette semaine, remplaçant GPT-5.5 Instant. À partir de la semaine du 10 août, les conversations textuelles sur ces niveaux sont illimitées — sans limites de débit, sous réserve de garde-fous contre les abus — tandis que des limites s'appliquent toujours aux téléchargements de fichiers, aux images, à la génération d'images et à la voix. Un nouveau bouton Think permet aux utilisateurs Free et Go de demander à Luna de raisonner plus en profondeur, également sans limite pour les conversations textuelles. Open​AI a également ajouté une formation à la sécurité pour les utilisateurs de moins de 18 ans, notamment des limites concernant le jeu de rôle romantique et les contenus réservés aux adultes.

GPT-5.6 contre GPT-5.5

En comparaison avec GPT-5.5, GPT​-5.6 est le plus important dans six domaines :

- Choix du modèle : GPT​-5.6 introduit Sol, Terra et Luna au lieu d'un modèle par défaut.

- Travail agentique : Sol est positionné plus fortement pour les agents de codage et les workflows lourds en outils.

- Contrôle du raisonnement : l'effort de raisonnement maximal et le mode ultra offrent aux développeurs plus d'options pour les tâches difficiles.

- Flexibilité des coûts : Terra et Luna permettent d'éviter plus facilement la surutilisation du modèle phare.

- Options de vitesse : GPT-5.6 Sol présente en avant-première un niveau Ultrafast jusqu'à 14 fois la vitesse Standard ; GPT-5.5 a été lancé avec une seule classe de vitesse.

Stratégie de déploiement : GPT​-5.6 est arrivé par phases — d'abord l'API, puis ChatGPT — les équipes ont donc toujours besoin de solutions de repli à mesure que le comportement et les prix évoluent.

Le point clé est simple : GPT-​5.6 n'est pas seulement un meilleur modèle. C'est une raison d'arrêter de coder en dur un seul modèle dans votre application.

Comment se préparer pour GPT-5.6

Vous pouvez vous préparer avec l'accès que vous avez déjà : Luna est le ChatGPT gratuit par défaut, Sol se trouve dans l'expérience Plus/Pro, et l'API est publique. La préparation concerne le routage et le comptage, pas l'attente.

D'abord, créez un véritable ensemble d'évaluation. Ne testez pas GPT​-5.6 uniquement avec des invites simplistes. Utilisez de vrais problèmes issus de la base de code, des tickets d'assistance, des documents clients, des tâches de recherche et des échecs d'automatisation.

Deuxièmement, concevez le routage des modèles. Luna peut gérer les résumés simples et la classification. Terra peut gérer les flux de travail quotidiens destinés aux utilisateurs. Sol devrait être réservé au raisonnement complexe, au codage et à la recherche. Si la latence est une exigence sur votre feuille de route, considérez l’aperçu Ultrafast comme une raison de concevoir dès maintenant une couche de routage sensible à la vitesse plutôt que de coder en dur un seul niveau — le niveau qui gagne sur la latence aujourd’hui est peut-être encore en aperçu, mais la décision de routage qu’il implique est déjà visible.

Troisièmement, suivez le coût par tâche terminée. Pour les workflows agentiques, une seule requête utilisateur peut déclencher de nombreux appels de modèle. Le prix du token le moins cher n'est pas toujours le workflow terminé le moins cher.

Quatrièmement, préparez-vous pour la mise en cache. Si votre application envoie de manière répétée le même dépôt, document de politique ou base de connaissances, structurez les invites afin que le contexte stable puisse être réutilisé.

Enfin, gardez un plan de secours. Les modèles de raisonnement sont verbeux, et les prix évoluent — Terra et Luna ont toutes deux chuté fin juillet. Les systèmes de production devraient pouvoir basculer vers un autre palier de GPT-5.6, vers GPT-5.5, ou vers un autre fournisseur lorsque la latence, le coût ou le comportement changent.

Où OrcaRouter s'intègre

GPT​-5.6 rend le routage des modèles plus important.

Open​AI ne présente plus la nouvelle génération comme un modèle unique. GPT​-5.6 se décline en une famille : Sol pour les tâches de raisonnement et de travail agentique les plus difficiles, Terra pour les charges de travail équilibrées du quotidien, et Luna pour les tâches rapides et à moindre coût.

Cela pose une question pratique pour les développeurs : quel modèle doit traiter chaque demande ?

Toutes les tâches n'ont pas besoin de Sol. Un résumé simple peut être mieux servi par Luna. Un flux de travail professionnel normal peut correspondre à Terra. Une tâche difficile d'agent de codage peut justifier Sol.

Et même avec un accès ouvert, les applications de production ont toujours besoin d'options de secours lorsque la latence, les limites de débit ou le coût par tâche évoluent — les baisses de prix de fin juillet rappellent que la grille tarifaire est une cible mouvante, et l'aperçu Ultrafast rappelle que les options de service évoluent également.

C'est là qu'OrcaRouter trouve sa place.

OrcaRouter offre aux développeurs un point de terminaison compatible Open​AI pour le routage entre de nombreux modèles, avec routage intelligent, bascule automatique, observabilité et zéro majoration de tokens. Au lieu de reconstruire votre intégration à chaque lancement d'un nouveau modèle, vous pouvez conserver un seul schéma d'API et router les tâches en fonction de la qualité, du coût, de la latence et de la disponibilité.

Pour GPT-5.6, cela signifie que vous pouvez construire la couche modèle maintenant plutôt que d'attendre que l'accès se stabilise.

Les trois paliers standard sont disponibles sur OrcaRouter dès aujourd'hui : GPT-5.6 Sol à $5/$30, GPT-5.6 Terra à $2/$12 et GPT-5.6 Luna à $0.20/$1.20 — répercutés sans aucune marge, si bien que les baisses de prix de fin juillet sont en vigueur ici dès leur sortie. Le palier Ultrafast n'est pas encore largement disponible et ne figure donc pas dans cette liste — lorsqu'il sera ouvert au public, il deviendra un palier de service supplémentaire à router, et ce choix se fera sur le même endpoint. Daybreak Blue et Red constituent un programme distinct à accès restreint plutôt que des paliers d'API publics ; ils ne sont donc pas routables via OrcaRouter non plus — la décision de routage se prend parmi les paliers standard.

L’histoire d’accès de GPT​-5.6 est encore en train de se stabiliser, mais votre stratégie de routage n’a pas à attendre.

En utilisant GPT​-5.6 via OrcaRouter

GPT-5.6 est exactement le genre de famille vers laquelle les développeurs veulent router.

Mais le déploiement a créé un problème pratique : l’accès s’est élargi par phases, les prix ont changé pour deux niveaux fin juillet, le réglage de ChatGPT diffère du modèle API, et un niveau de vitesse est désormais en aperçu. Les équipes ont besoin d’une couche qui absorbe ces changements.

OrcaRouter expose les trois niveaux de GPT​-5.6 via un point de terminaison compatible Open​AI, aux côtés de plus de 200 autres modèles — afin que vous puissiez tester Sol, Terra et Luna face à GPT-5.5, Claude, Gem​ini et le reste en un seul endroit, sans réintégration.

Ceci est utile si vous voulez :

- acheminer chaque requête vers le niveau le moins cher qui la traite ;

- testez Sol, Terra et Luna côte à côte avec votre stack actuel ;

acheminer les tâches simples vers des modèles moins chers ;

- réservez les modèles phares pour les travaux plus difficiles;

Comparez GPT-5.6 avec votre stack de production actuel ;

- garder des modèles de secours prêts en cas de changement de comportement ou de tarification.

GPT-5.6 est désormais en ligne sur OrcaRouter — Sol, Terra et Luna — avec 0 % de marge, et une bascule automatique afin qu'un niveau nouvellement déployé ou dont le prix a été révisé ne fasse jamais tomber un chemin de production.

Appelez n'importe quel niveau GPT‑5.6 via une seule API sur OrcaRouter, et routez à travers le reste du catalogue avec la même clé.

Verdict final

GPT​-5.6 est réel, officiel et important.

Mais ce n'est plus un aperçu que vous attendez : l'API est en ligne depuis le 9 juillet, et l'accès à ChatGPT se déploie progressivement pour tous les niveaux ce mois-ci.

Le plus grand changement n'est pas seulement une meilleure intelligence. C'est le passage d'un modèle par défaut à une famille de modèles routés : Sol, Terra et Luna.

Pour les développeurs, l'opportunité ne consiste pas simplement à passer à GPT​-5.6. L'opportunité est de construire une couche de modèle plus intelligente :

- Luna pour des tâches rapides et peu coûteuses ;

- Terra pour des charges de travail de production équilibrées;

- Sol pour les tâches de raisonnement et de codage les plus difficiles ;

mise en cache pour un contexte répété;

- modèles de secours pour la fiabilité.

Si vous lancez aujourd'hui, vous n'avez plus à attendre : Luna est le modèle gratuit par défaut de ChatGPT, Sol est inclus dans l'expérience Plus/Pro, et l'API est publique.

Si vous construisez des agents de codage, des copilotes d’entreprise ou des flux de travail IA de longue durée, la préparation signifie désormais routage, mesure de l’effort de raisonnement et coût par tâche — pas l’accès. Et l’aperçu Ultrafast rappelle que la famille continue d’évoluer : le produit phare que vous évaluez aujourd’hui pourrait avoir un palier plus rapide — ou, avec Daybreak, une variante cyber spécialement entraînée — d’ici votre lancement.

FAQ

GPT-5.6 est-il sorti ?

Oui. L'API a été lancée le 9 juillet 2026, et l'accès ChatGPT est déployé progressivement — Sol mis à jour pour Plus/Pro depuis le 6 août, Luna comme option par défaut pour Free/Go cette semaine.

Puis-je utiliser GPT-5.6 dans ChatGPT ?

Oui. GPT-5.6 Sol est disponible dans l'expérience de chat Plus/Pro avec un nouveau curseur de réflexion, et GPT-5.6 Luna devient le modèle par défaut pour les comptes Free et Go cette semaine, avec des chats textuels illimités à partir de la semaine du 10 août.

Puis-je utiliser GPT​-5.6 via l'API ?

Oui. Les trois niveaux sont sur l'API publique avec des tarifs publiés — Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20 — et via OrcaRouter avec une majoration de 0 %.

Qu'est-ce que le mode Ultrafast de GPT-5.6 Sol ?

Il s'agit d'un palier de vitesse en avant-première dans l'API Open​AI qui exécute GPT-5.6 Sol jusqu'à 14 fois plus rapidement que le traitement Standard, avec jusqu'à 750 jetons de sortie par seconde, et avec la même intelligence que le modèle standard (selon le fournisseur). Il est initialement limité à un petit groupe de clients, et Open​AI n'a pas publié de tarif pour celui-ci.

Y a-t-il une liste d'attente publique pour GPT​-5.6 ?

Pour les offres de base, non — l'API est publique et l'accès à ChatGPT est progressivement déployé sur tous les niveaux, il n'y a donc rien à rejoindre. L'aperçu Ultrafast est l'exception : il est initialement limité à un petit groupe de clients, avec une inscription pour être notifié à mesure que la capacité augmente.

Quand GPT-5.6 sera-t-il généralement disponible ?

C'est déjà le cas, par étapes. L'API a été lancée le 9 juillet 2026 ; la version mise à jour de Sol est arrivée sur ChatGPT Plus/Pro le 6 août ; Luna devient l'option par défaut de Free/Go cette semaine ; les conversations textuelles gratuites illimitées arrivent la semaine du 10 août.

Que sont GPT-5.6 Sol, Terra, and Luna ?

Sol est le modèle phare, Terra est le modèle équilibré pour le travail quotidien, et Luna est le modèle rapide et abordable.

Combien coûte GPT-5.6 ?

GPT-5.6 Sol coûte 5 $ par million de tokens en entrée et 30 $ par million de tokens en sortie. GPT-5.6 Terra coûte 2 $ par million en entrée et 12 $ par million en sortie. GPT-5.6 Luna coûte 0,20 $ par million en entrée et 1,20 $ par million en sortie. Les prix de Terra et Luna ont été réduits fin juillet 2026 ; celui de Sol est resté inchangé. Sur OrcaRouter, ces prix sont répercutés avec une marge de 0 %. L'aperçu Ultrafast n'a pas encore de prix publié.

Devrais-je passer de GPT-5.5 à GPT​-5.6 ?

Pas aveuglément. Gardez un repli stable, mais la donne a changé : le prix de Luna en fait le choix par défaut pour le travail textuel à grand volume, et le réglage ChatGPT mérite d’être testé pour les assistants du quotidien. Évaluez sur vos propres tâches et routez par niveau.

Puis-je accéder à GPT-5.6 via OrcaRouter ?

Oui. GPT-5.6 Sol, Terra et Luna sont tous sur OrcaRouter via un point d'accès compatible OpenAI avec 0% de majoration et une bascule automatique. Vous pouvez les tester contre GPT-5.5, Claude, Gemini et d'autres modèles sans modifier les intégrations.

Qu'est-ce que Daybreak Blue et Daybreak Red ?

Ce sont les deux niveaux du programme de cybersécurité approuvé d'OpenAI, élargi le 10 août 2026. Daybreak Blue offre aux défenseurs approuvés GPT-5.6 Sol avec les garde-fous cyber retirés, pour des travaux défensifs tels que la réponse aux incidents, l'analyse de logiciels malveillants et la revue de code sécurisé. Daybreak Red fournit GPT-5.6-Cyber, un modèle basé sur Sol spécialement entraîné pour la recherche de vulnérabilités autorisée et les travaux d'exploitation, à des équipes approuvées séparément. Aucun des deux n'est un produit d'API public.

Comparés dans cet article4

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement