
GPT-6.1 Sol contre la génération GPT-6 : une génération à part
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Le fournisseur a ajouté un quatrième nom à sa gamme de modèles le 29 septembre 2026 et l'a appelé une génération, et l'arithmétique de la gamme est ce qu'il y a de plus intéressant : GPT-6.1 Sol constitue toute la génération. GPT-6 Luna et GPT-6 Sol, tous deux sortis le 22 septembre 2026, sont inchangés ; GPT-6 Astra, disponible depuis le 4 septembre 2026, est inchangé ; la mise à jour 6.1 n'a touché qu'un seul niveau. Pendant ce temps, GPT-6.1 Sol, à 2,00 $ en entrée et 10,00 $ en sortie par million de jetons, obtient 51,83 sur l'Artificial Analysis Intelligence Index pour 0,724 $ par tâche — à 0,84 point de GPT-6 Astra, qui coûte 3,2575 $ par tâche à 10,00 $/50,00 $. Même génération sur l'étiquette, quatre logiques économiques différentes en dessous.
Cela fait de « dois-je utiliser la génération GPT-6 » la mauvaise question. La gamme couvre un écart de 48× en coût par tâche et un écart de 14,6 points en intelligence mesurée, et la réponse dépend entièrement du niveau dont vous parlez. Voici l’échelle, mesurée.
Les quatre échelons, tels que mesurés

• GPT-6 Luna — Index 38,12, 0,10 $ / 0,50 $ par million, 0,01 $ en cache, 0,0678 $ par tâche, 50 012 jetons de sortie, 100,1 s jusqu'au premier jeton
• GPT-6 Sol — Index 47,63, 2,00 $ / 10,00 $, 0,20 $ en cache, 1,045 $ par tâche, 31 000 jetons de sortie, 124,3 s
• GPT-6.1 Sol — Index 51,83, 2,00 $ / 10,00 $, 0,10 $ en cache, 0,724 $ par tâche, 38 128 jetons de sortie, 332,0 s
• GPT-6 Astra — Index 52,67, 10,00 $ / 50,00 $, 1,00 $ en cache, 3,2575 $ par tâche, 27 206 jetons de sortie, 400,4 s
Chacun d’eux possède la même fenêtre de contexte de 1 050 000 jetons et la même sortie maximale de 128 000 jetons, et chacun d’eux accepte des entrées texte, image et fichier. Les niveaux ne se différencient pas par des indicateurs de capacités. Ils se différencient par la quantité de réflexion que vous êtes prêt à payer, et les deux extrémités de cette échelle présentent un écart d’un facteur 48 par tâche.
Ce que la mise à jour 6.1 a réellement changé
Trois choses, et une seule d’entre elles est un score.
Le score a progressé : de 47,63 à 51,83, soit un gain de 4,2 points, en une semaine. Le tarif des entrées mises en cache a été divisé par deux, passant de 0,20 $ à 0,10 $ par million, ce qui explique pourquoi le coût mesuré par tâche est tombé de 1,045 $ à 0,724 $ alors que les prix catalogue sont identiques — la même grille tarifaire, une facture différente. Et le nombre de jetons de sortie est passé de 31 000 à 38 128, tandis que le temps réel par tâche est passé de 321 secondes à 640, ce qui est le seul point où cette mise à jour a régressé et le moins visible sur n'importe quelle fiche technique.
Face à Astra, la comparaison est celle qui surprend les gens. GPT-6.1 Sol accuse 0,84 point d’indice de retard sur le modèle phare et coûte 4,5 fois moins cher par tâche. L’avantage restant d’Astra n’est pas son score d’indice ; c’est l’ensemble des évaluations où lui seul est mesuré, et la capacité qu’OpenAI décrit comme propre à ce modèle — trouver de nouvelles vulnérabilités de sécurité, ce qui explique pourquoi le modèle est classé « critique » selon le propre Preparedness Framework du fournisseur et que ses paramètres les plus performants sont réservés à des partenaires agréés.
La fiche OrcaRouter pour GPT-6 Astra constitue le haut de gamme de la même échelle : 10,00 $ / 50,00 $, un p50 de 1,64 seconde jusqu'au premier token, 40,7 millions de tokens sur sept jours, et la même fenêtre de contexte de 1 050 000 tokens que partagent tous les paliers.

Par rapport au 6.0 Sol, la mise à jour est proche d'une amélioration pure et simple — plus d'indice, moins d'argent — avec la réserve que le modèle 6.1 est un modèle différent et non un checkpoint, et qu'il réémet son raisonnement de manière plus verbeuse. Face à Luna, ce n'est pas une comparaison du tout : 10,7 fois le coût pour 13,7 points d'indice, ce qui est un bon compromis pour le travail difficile et un choix désastreux pour le travail à fort volume.
Ce que notre propre routage dit que le marché a déjà décidé
Une chose que cette comparaison offre et qu'une fiche technique ne permet pas, c'est une vue de l'usage réel. Sur les sept jours se terminant le 7 octobre 2026, sur notre propre couche de routage, GPT-6.1 Sol a traité 284,2 millions de jetons et le GPT-6 Sol qu'il remplaçait en a traité 950 000 — une différence d'un facteur 300 pour deux modèles séparés d'une semaine d'âge, ce à quoi ressemble un remplacement de palier vu de l'intérieur. GPT-6 Luna, le palier économique, a traité 641,6 millions, plus que les deux modèles Sol réunis. GPT-6 Astra a traité 40,7 millions.
Interprétez cela comme trois comportements distincts. Le travail à gros volume est allé au palier bon marché, et c'est là qu'est allé le plus grand volume. Le travail sérieux s'est consolidé sur le tout nouveau Sol dans la semaine suivant sa sortie, abandonnant le modèle qu'il remplaçait. Et le modèle phare est resté une niche : l'échelon le plus capable, le moins utilisé, par des équipes dont le problème est celui que lui seul résout. La gamme n'est pas une échelle que l'on gravit ; c'est un ensemble d'outils parmi lesquels on choisit, et on choisit par palier plutôt que par génération.
C'est pourquoi le niveau a sa place dans la requête, et non dans l'architecture
Le problème pratique avec une génération à quatre niveaux, c’est que la bonne réponse change selon la tâche et selon la semaine — comme le montrent les chiffres de trafic ci-dessus, le marché a de nouveau tranché en l’espace de sept jours. Coder en dur le nom d’un seul modèle dans une application, c’est ce qui transforme une gamme en engagement.
Les quatre sont accessibles via un seul point de terminaison OrcaRouter : une seule API pour plus de 200 modèles, avec le prix catalogue du fournisseur répercuté à 0 % de marge. Ce dernier point est déterminant ici, précisément parce que trois des quatre paliers partagent un prix catalogue ou un tarif mis en cache qui a déjà bougé une fois — le tarif de cache de GPT-6.1 Sol a été divisé par deux dans la semaine suivant son lancement, et c'est un compteur de répercussion qui fait que cela arrive automatiquement sur votre facture.

Deux fonctionnalités de la couche de routage méritent d’être nommées pour cette gamme particulière. Le DSL de routage permet au palier d’être un paramètre de la requête plutôt qu’un déploiement — palier économique pour la passe d’extraction, 6.1 Sol pour la passe de raisonnement, Astra uniquement pour les appels qui nécessitent ce qu’Astra est seul à faire. Et la fusion de modèles permet à un panel d’entre eux de répondre ensemble à une question, ce qui est la manière honnête d’utiliser un modèle phare vers lequel vous ne pouvez pas vous permettre de tout router : il devient une voix dans un panel au lieu de constituer toute la facture.
Que faire d’une génération d’une seule personne
N'achetez pas la génération. Achetez un barreau, et rachetez-le quand les barreaux bougent.
Pour les charges de travail à gros volume et sensibles à la latence, GPT-6 Luna, à 0,0678 $ la tâche et 100 secondes jusqu'au premier token, est le palier qui porte déjà le plus de trafic, et son prix est d'un ordre de grandeur inférieur à tout le reste de l'échelle. Pour le raisonnement général et le code, GPT-6.1 Sol est désormais le modèle par défaut que le modèle 6.0 était auparavant — même prix catalogue, meilleur indice, moitié du coût de cache — et le temps de tâche de 640 secondes est la seule chose à tester sur votre propre charge de travail avant de supposer que la mise à niveau est gratuite. Pour les tâches qui exigent une mesure de pointe ou le travail de sécurité que seul le modèle phare assure, GPT-6 Astra reste le seul barreau qui les accomplisse, à 4,5 fois le coût du barreau inférieur.
Ce qu'il faut surveiller, c'est de savoir si la mise à jour 6.1 atteint les autres paliers. Si Luna ou Astra reçoivent le même traitement, la forme de l'échelle change, et l'arithmétique par tâche de cet article avec elle. D'ici là, « GPT-6.1 » désigne un seul modèle, et le traiter comme une famille, c'est ainsi que les équipes finissent par payer des tarifs de modèle phare pour de l'extraction.
