Une carte titre pour le guide API GPT-5.6 Sol, montrant une carte de passerelle arrondie avec une puce de code indiquant model : gpt-5.6-sol, une étiquette de prix indiquant 5 $ / 30 $ par million de jetons, un cadran étiqueté Effort de raisonnement avec six positions, et quatre puces de modèles étiquetées GPT, Claude, Gemini et Qwen reliées par de fines lignes à la passerelle unique.
Guides & Insights

API GPT-5.6 Sol : comment l'appeler, combien ça coûte, et quand rétrograder

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.

Les deux dialectes et l'unique identifiant de modèle

La plupart des tutoriels GPT-5.6 Sol présentent un seul dialecte et s'arrêtent là. Il y en a deux, et les deux atteignent les mêmes poids.

Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.

Responses API — client.responses.create. Le même identifiant de modèle avec une forme de requête plus récente : un seul champ input et un bloc reasoning ({"effort": "high"}) au lieu du tableau messages. OpenAI la recommande pour les nouvelles applications car elle prend directement les paramètres de raisonnement et renvoie les jetons de raisonnement comme sortie de première classe — et le niveau d’effort le plus élevé n’est disponible qu’ici.

Épinglez le niveau. L'alias nu gpt-5.6 pointe vers Sol aujourd'hui, mais un alias est exactement ce qu'un fournisseur change lorsqu'un nouveau produit phare sort. Transmettre gpt-5.6-sol explicitement signifie que chaque appel indique ce qu'il coûte, et c'est l'identifiant que chaque passerelle attend.

Ce que vous obtenez — et le cadran qui détermine votre facture

GPT-5.6 Sol est le modèle phare d'OpenAI axé sur le raisonnement : une fenêtre de contexte d'environ 1,05 million de jetons, 128 000 jetons de sortie maximale, une date de coupure des connaissances au 16 février 2026, et une entrée texte, image et fichier avec sortie texte. Sur le classement indépendant Artificial Analysis, il obtient un indice d'intelligence AA de 61 et un score de codage AA de 77, ainsi qu'un score SWE-bench Pro de 64,6 %, mesuré indépendamment par llm-stats — c'est ce chiffre de codage que la communauté des agents cite réellement.

A spec and benchmark scoreboard for GPT-5.6 Sol: model id gpt-5.6-sol, ~1.05M token context window, 128K max output, released July 9 2026, AA Intelligence Index 61 and AA Coding 77 per Artificial Analysis, SWE-bench Pro 64.6% independently measured by llm-stats, and six reasoning-effort levels from none to max.

La réflexion est activée par défaut, et l'effort de raisonnement paramètre est le plus grand levier sur la latence et le coût :

Six niveauxnone, low, medium, high, xhigh, max. none désactive le raisonnement pour les tâches mécaniques ; max est destiné aux problèmes à coût d’erreur élevé et n’est disponible que via l’API Responses.

Commencez à moyen et progressez d’un niveau à la fois. Le tutoriel apidog GPT-5.6 note que de nombreuses charges de travail GPT-5.5 conservent leur qualité un niveau en dessous sur la famille 5.6 — mesurez la qualité avant de payer pour plus de réflexion.

Le mode Pro est un paramètre, pas un modèle. Définissez reasoning.mode: "pro" et le modèle privilégie la qualité des réponses à la rapidité. Le prix et l'ID du modèle sont inchangés.

Verbositéfaible, moyen (par défaut), élevé — contrôle la longueur de la sortie indépendamment du raisonnement.

Les jetons de raisonnement sont facturés en sortie à 30 $ par million. Sur les prompts difficiles en xhigh ou max, le raisonnement interne peut dominer la facture — la part cachée de la tarification des modèles de raisonnement que l’étiquette ne montre jamais.

Ce que Sol coûte réellement

Le prix de base de Sol est resté inchangé après la baisse tarifaire d'OpenAI du 30 juillet 2026 : $5 par million en entrée et $30 par million en sortie. La baisse a concerné les deux paliers les moins chers — GPT-5.6 Terra est passé à $2 / $12 et GPT-5.6 Luna à $0.20 / $1.20 — ce qui importe ici, car c'est la comparaison exacte qui vous indique quand Sol est surdimensionné.

A price card for the GPT-5.6 Sol API: Sol at $5 input / $30 output per 1M with a $0.50 cache read and a $6.25 cache write, a long-context tier at $10 / $45, GPT-5.6 Terra at $2 / $12 and GPT-5.6 Luna at $0.20 / $1.20, and a worked example of 100K tokens in plus 20K out billing $1.10 uncached or about $0.65 with a cached input leg.

Trois modificateurs changent le taux effectif :

Mise en cache des prompts. Les entrées réutilisées sont facturées environ 0,50 $ par million lors d’une lecture de cache — 90 % de réduction par rapport aux entrées fraîches — et les écritures de cache sont facturées à 6,25 $ par million (1,25 fois le taux d’entrées non mises en cache). La mise en cache est implicite par défaut et peut être rendue explicite via prompt_cache_options avec un ttl ; le préfixe mis en cache doit comporter au moins 1 024 jetons et reste chaud pendant au moins 30 minutes.

Paliers de contexte long. Au-delà d'un seuil de taille d'entrée, Sol passe à $10 / $45 par million. Quelques prompts très longs font discrètement varier votre prix moyen.

Tout ce que le modèle émet est compté comme sortie. Cela inclut les jetons de raisonnement internes, donc sur les appels à forte intensité de raisonnement, la facturation se concentre sur la partie sortie.

Une facture concrète : une requête de 100K jetons qui produit 20K jetons de sortie coûte $0.50 pour l'entrée et $0.60 pour la sortie — $1.10 sans cache. Si ce prompt de 100K est servi depuis le cache à l'appel suivant, la partie entrée tombe à environ $0.05 et le trajet aller-retour avoisine $0.65. Dans une longue boucle d'agent qui réutilise le même prompt système toute la journée, la mise en cache fait la différence entre le fait que Sol soit abordable ou non.

Un endpoint, 200+ modèles

If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the 1.05M-token context window, 128K max output, the p50 TTFT of 4.59s, and the /v1/chat/completions and /v1/responses endpoints.

L'aspect économique est la partie honnête. OrcaRouter ajoute 0 $ par jeton — les 5 $ / 30 $ affichés sur la page du modèle correspondent au tarif d'OpenAI répercuté tel quel, et un changement de prix du fournisseur est appliqué de notre côté le jour même de son annonce. Apporter votre propre clé est une option de premier ordre : fournissez votre clé OpenAI existante, conservez vos propres limites de débit et crédits, et OpenAI vous facture directement. Les garde-fous — un bouclier PII et une politique de contenu — sont appliqués avant la facturation de la requête, pas après. Le DSL de routage compose le basculement afin qu'un modèle moins cher réponde lorsque Sol est en erreur ou lorsque la forme de votre trafic le permet.

Quand Sol est le mauvais palier.

Être le produit phare ne signifie pas être adapté à chaque appel, et il y a trois cas où le tarif de 5 $ / 30 $ perd.

Appels à fort volume et à faible enjeu. Un pipeline de classification ou d'extraction traitant 10M de jetons d’entrée par mois coûte $50 sur Sol contre $2 sur GPT-5.6 Luna — même endpoint, même clé, un changement d’identifiant. Luna à $0,20 / $1,20 est tarifée pour exactement ce travail.

Mid-tier reasoning that does not need frontier depth. GPT-5.6 Terra at $2 / $12 sits between volume and flagship. The apidog tutorial's advice is the sensible default: prototype on Terra, escalate to Sol only where Terra measurably fails, and push stable high-volume paths down to Luna.

La limite de ce que nous pouvons promettre.OrcaRouter route et facture ; OpenAI exécute les poids. L'endpoint, la marge nulle, le basculement et les garde-fous nous appartiennent, mais la qualité d'inférence et le comportement de sécurité relèvent d'OpenAI, et avec BYOK, l'argent leur revient directement. Voilà l'accord, énoncé clairement : vous payez le tarif du fournisseur de toute façon, et la question est de savoir si un seul endpoint pour plus de 200 modèles en vaut la peine.

En résumé

Appelez l'API GPT-5.6 Sol avec Chat Completions si vous avez un client OpenAI existant, et avec l'API Responses si vous construisez du neuf — l’identifiant de modèle gpt-5.6-sol, le tarif de 5 $ / 30 $, et le même niveau de raisonnement dans les deux cas. C’est le bon modèle quand la tâche est difficile, le contexte est long, et que la sortie vaut 30 $ par million de jetons — et le mauvais modèle quand la tâche est routinière, où Terra et Luna coûtent une fraction du prix. La configuration la plus propre est celle qui vous permet de changer d’avis : un point de terminaison, votre propre clé, aucune majoration, et un identifiant de modèle que vous pouvez remplacer le jour où la charge de travail change.

GPT-5.6 Sol est en ligne sur OrcaRouter au prix catalogue d'OpenAI de 5 $ / 30 $ avec une marge de 0 $ par jeton — apportez votre clé OpenAI existante et le fournisseur vous facture directement. Commencez avec GPT-5.6 Sol sur OrcaRouter — un seul endpoint, aucune intégration supplémentaire.

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

Contactez-nous

Rejoignez notre communauté

DiscordEmailXGitHubYouTube