
Tarification de l'API GPT-5.6 Sol : 4 $ / 20 $ par 1M de tokens après la baisse de prix
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 150 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 228 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
GPT-5.6 Sol coûte 4,00 $ par million de jetons d’entrée et 20,00 $ par million de jetons de sortie sur l’API GPT-5.6 Sol à ce jour — le même taux de répercussion que celui du niveau phare sur l’annuaire OrcaRouter, vérifié le 25/08/2026 avec une marge nulle. Le 24 août 2026, OpenAI a réduit le prix de l’API Sol de 20 % sur l’entrée et d’environ 33 % sur la sortie, une promotion temporaire qui court au moins jusqu’au 21 novembre 2026. Il reste le niveau le plus cher de la famille GPT-5.6, et c’est le premier niveau dont le prix catalogue a bougé depuis la baisse du 30 juillet, qui avait ignoré le niveau phare. Les leviers comptent plus que le titre : l’entrée réutilisée est facturée 0,40 $ par million grâce au cache de prompt, l’API par lots tombe à 2,00 $ / 10,00 $, et le mode rapide échange une prime de 2x contre jusqu’à 2,5x de vitesse. Cette page est la référence tarifaire pour Sol spécifiquement — la grille exacte, ce qu’une requête coûte réellement, comment le niveau phare se compare aux autres, quand ce n’est pas le bon choix, et comment l’appeler via un point de terminaison compatible OpenAI avec votre propre clé.
Les prix sont par million de jetons (entrée / sortie), en date du 25 août 2026. La baisse — 20 % sur l'entrée, environ 33 % sur la sortie, en vigueur au moins jusqu'au 21 novembre 2026 — est une annonce d'OpenAI elle-même, reprise telle quelle ; les montants en dollars sont relevés sur les tarifs API publiés par OpenAI et recoupés avec la page du modèle OrcaRouter pour GPT-5.6 Sol. Les tarifs du cache, du batch, du mode rapide et du long contexte sont ceux annoncés par OpenAI. Ce sont des tarifs promotionnels, pas une baisse permanente — les prix évoluent et peuvent revenir en arrière ; vérifiez avant de développer.
Le prix exact, vérifié aujourd'hui.
Voici la grille tarifaire complète pour GPT-5.6 Sol, vérifiée le 25/08/2026 aux tarifs promotionnels. Les mêmes tarifs s'appliquent aux requêtes utilisant l'alias gpt-5.6, et les réductions sont déployées progressivement aux plans de crédits éligibles ChatGPT Work et Codex ; les abonnements ChatGPT Pro, Plus et Business restent inchangés.

• Entrée — $4.00 par 1M de tokens en cas d'échec de cache (au lieu de $5.00, 20 % de réduction jusqu'au 21 novembre).
• Sortie — 20,00 $ par 1M de jetons (en baisse par rapport à 30,00 $, ~33 % de réduction jusqu'au 21 novembre).
• Lecture du cache de prompt — 0,40 $ par 1M de jetons (au lieu de 0,50 $), une remise de 90 % sur toute entrée que vous renvoyez.
• Écriture dans le cache de prompt — 5,00 $ par million de jetons (au lieu de 6,25 $).
• Palier long contexte — les entrées dépassant environ 272K jetons sont facturées à 8,00 $ en entrée / 30,00 $ en sortie (au lieu de 10,00 $ / 45,00 $ ; les mêmes multiples de 2x en entrée et 1,5x en sortie s'appliquent désormais sur la base inférieure).
• Batch API — $2.00 en entrée / $10.00 en sortie, une remise fixe de 50 % (au lieu de $2.50 / $15.00), asynchrone, généralement prête en environ 24 heures.
• Mode rapide — 8,00 $ en entrée / 40,00 $ en sortie (au lieu de 10,00 $ / 60,00 $), une prime de 2x pour une vitesse de sortie jusqu’à environ 2,5x, sans changement d’intelligence.
• Fenêtre de contexte — ~1,05M de jetons, jusqu'à 128K de sortie.
OrcaRouter répercute le tarif du fournisseur sans marge, donc le montant indiqué dans l'annuaire est celui que vous payez — et une baisse de prix du fournisseur apparaît sur la fiche le jour même où elle entre en vigueur. Sur la page du modèle en direct, la carte affiche 4,00 $ / 20,00 $ par 1M, lecture du cache 0,400 $, avec les badges Vision, Tools, JSON et Reasoning. C'est la première fois que le prix catalogue de Sol évolue depuis la réduction du 30 juillet, qui a fait passer GPT-5.6 Luna à 0,20 $ / 1,20 $ et GPT-5.6 Terra à 2 $ / 12 $, tandis que le modèle phare restait inchangé ; la baisse du 24 août est au tour du modèle phare.
Les leviers qui modifient le prix effectif
Le taux de base n'est que le point de départ. Quatre modificateurs changent ce que Sol vous coûte réellement :
• Mise en cache des prompts — le contexte réutilisé coûte 0,40 $ par million au lieu de 4 $ pour du nouveau, et les écritures dans le cache coûtent 5,00 $ par million. Pour tout agent ou chat qui renvoie un grand préfixe à chaque tour, la mise en cache est le plus grand levier sur la facture. OpenAI associe le cache à chaque projet et à chaque clé API, alors rester sur une seule clé (un seul canal) est ce qui permet aux succès de cache de continuer à se produire.
• Palier long contexte — une requête dont l'entrée dépasse environ 272K jetons passe du tarif de base à $8 / $30. Quelques prompts volumineux peuvent discrètement augmenter votre prix moyen, alors regroupez ou tronquez quand vous n'avez pas vraiment besoin du contexte profond.
• Batch — L'API batch d'OpenAI exécute les tâches de manière asynchrone avec un délai d'environ 24 heures à exactement la moitié du prix : $2.00 / $10.00, avec une entrée en cache à $0.20 et des écritures de cache à $2.50. Elle se cumule avec la mise en cache des prompts et convient aux évaluations, à la classification en masse et à la génération hors ligne lorsque la latence n'a pas d'importance.
Mode rapide — 8 $ / 40 $ pour un débit de sortie jusqu'à ~2,5x supérieur, utile pour les travaux sensibles à la latence où l'utilisateur attend, comme l'assistance au codage en direct. Il facture par jeton à 2 fois le tarif standard, n'entre pas dans les forfaits Scale Tier TPM achetés et peut revenir au traitement standard si vous dépassez la limite de débit partagée.
Ce que coûte réellement une requête
Les prix par token sont abstraits, voici donc des exemples concrets aux taux actuels :
• Un seul appel de chat, 50K d'entrée + 20K de sortie — $0.20 + $0.40 = $0.60 (était $0.85).
• 1M en entrée + 1M en sortie — 4 $ + 20 $ = 24 $ (était 35 $).
• Tour agentique, 200K de contexte en cache + 20K d’entrée fraîche + 30K de sortie — $0.08 + $0.08 + $0.60 = $0.76. Le même tour avec un cache froid — 220K d’entrée fraîche à $0.88 plus $0.60 de sortie — totalise $1.48. La mise en cache le réduit environ de moitié.
• Un mois de 10M de tokens avec une répartition 70 % en entrée / 30 % en sortie, avec 80 % de l'entrée servie depuis le cache : 1,4 M d'entrée fraîche (5,60 $) + 5,6 M en cache (2,24 $) + 3 M de sortie (60 $) ≈ 68 $. Sans cache, le même mois coûte 88 $ — et le même mois sur GPT-5.6 Terra revient à environ 50 $, ou à environ 5 $ sur GPT-5.6 Luna. Cet écart d'environ 14x entre Sol et Luna montre pourquoi l'adéquation des paliers importe plus que n'importe quel tarif unique.
Deux mises en garde augmentent le taux effectif. Sol est un modèle de raisonnement — les tokens de raisonnement internes sont facturés en sortie à 20 $ par million. Un prompt difficile avec un réglage d'effort de raisonnement élevé peut consacrer une grande partie de son budget de sortie à la réflexion, si bien que le coût de sortie effectif pour un travail difficile dépasse largement une estimation naïve. Et le tokenizer d'OpenAI est plus verbeux que celui de la génération précédente sur certaines entrées, donc le même texte peut coûter plus de tokens qu'il n'en aurait coûté sur GPT-5.5. Ajustez l'effort de raisonnement à la tâche, plafonnez la sortie lorsque c'est possible, et mesurez l'utilisation réelle avant d'estimer la facture.
Comment la tarification de Sol se compare au reste du secteur

Lecture sur la base des prix catalogue publiés le 2026-08-25 (Sol à son tarif promotionnel). Les articles de presse interprètent cette baisse comme une réponse à la pression tarifaire d'Anthropic et des laboratoires chinois — il s'agit d'une interprétation d'un tiers, et non d'une déclaration d'OpenAI.
• GPT-5.6 Terra — 2 $ / 12 $, le niveau intermédiaire après la réduction. Sol coûte désormais 2 fois plus en entrée et environ 1,7 fois plus en sortie ; Terra est le choix par défaut lorsque vous n'avez pas besoin du raisonnement de pointe.
• GPT-5.6 Luna — $0.20 / $1.20, le palier de volume après réduction. Un écart d’entrée de 20x par rapport à Sol ; Luna est tarifée pour la grande majorité du trafic.
• Claude Opus 5 — 5 $ / 25 $. Sol est désormais 20 % moins cher sur les entrées comme sur les sorties, sur le papier, par rapport à un Opus 5 équivalent sur les entrées aux anciens tarifs. La comparaison était déjà favorable à Sol avant cette baisse : ce blog avait précédemment mesuré que Sol utilise environ 34,5 % de tokens en moins qu’un modèle Anthropic sur le même échantillon anglais/mixte, et une analyse publiée sur l’économie des tokens (TheBlockBeats) estimait que la facture totale de Sol pouvait être environ 21 % inférieure à celle de Claude Opus 5 pour un travail équivalent, même lorsque le tarif de sortie de Sol était plus élevé. Mesurez votre propre tokeniseur, pas le prix affiché.
• Claude Fable 5 — 10 $ / 50 $. Sol est désormais 60 % moins cher en entrée et 60 % moins cher en sortie que le niveau supérieur d'Anthropic (contre 50 % / 40 % aux anciens tarifs).
• Claude Opus 4.8 — 5 $ / 25 $. Sol est désormais 20 % moins cher en entrée et 20 % moins cher en sortie — l’avantage affiché par rapport au produit phare Anthropic de la génération précédente s’est complètement inversé.
• Grok 4.6 — 2 $ / 6 $. Le chiffre le plus marquant du tableau : il a égalé GPT-5.6 Sol sur l’indice Artificial Analysis (61 tous deux), avec une entrée 2 fois moins chère et une sortie environ 3,3 fois moins chère, contre un écart de 2,5x / 5x aux anciens tarifs.
• DeepSeek V4 Pro — 0,44 $ / 0,88 $ hors pointe (les fenêtres de pointe le doublent). Un univers de prix totalement différent, pour la voie des poids ouverts bon marché.
Le cadrage honnête : Sol reste un vaisseau amiral premium, mais la baisse le retire de la tranche de prix la plus haute — le prix de sortie de 20 $ sous-cote désormais les 25 $ de Claude Opus 5 et les 25 $ de Claude Opus 4.8, laissant les 50 $ de Claude Fable 5 comme seul tarif de sortie de vaisseau amiral fermé au-dessus. Il gagne sur le coût effectif par unité de travail difficile (son tokenizer, son raisonnement, son contexte long) plutôt que sur le tarif absolu, et la baisse du 24 août renforce cet argument. Si votre trafic consiste en requêtes courtes et tâches simples, une Terra à 2 $, une Luna à 0,20 $ ou un Grok 4.6 à 2 $ / 6 $ reste l’option la moins chère — et sur l’index, Grok 4.6 ne cède rien sur le papier.
Quand Sol est le mauvais choix
Quatre cas où ce prix n'est pas celui que vous voulez :
Invites courtes et simples. Pour moins de 20 000 jetons environ, sans raisonnement approfondi, recourir au modèle phare est un gaspillage. Le GPT-5.6 Terra à 2 $ / 12 $ ou le GPT-5.6 Luna à 0,20 $ / 1,20 $ gère le palier de volume pour une fraction du coût, et un modèle de classe Grok 4.6 ou DeepSeek coûte encore moins.
Volume à forte intensité de raisonnement. Parce que le raisonnement est facturé comme des tokens de sortie, une requête difficile avec un niveau d’effort élevé peut coûter bien plus que le tarif de sortie nominal. Si votre charge de travail comprend de nombreux appels difficiles, mesurez les tokens de sortie réels avant de vous engager — le taux effectif peut vous surprendre.
Le prix par jeton comme seul objectif. Grok 4.6 a égalé Sol sur l'indice à 2 $ / 6 $, et DeepSeek V4 Pro se situe à 0,44 $ / 0,88 $ en heures creuses. Si un score de référence de pointe n'est pas l'exigence stricte, ces modèles offrent des tarifs par jeton bien inférieurs pour la même catégorie de travail.
Budgets de latence stricts. Sol est un grand modèle de raisonnement, de sorte que le délai avant le premier token est bien supérieur à celui d'un modèle de niveau Flash. Pour un chat en temps réel où un TTFT inférieur à la seconde compte, le mode rapide à 8 $ / 40 $ améliore le débit, mais ne réduit pas la latence du premier token — et un modèle plus petit reste la solution la plus économique.
Comment l'appeler sur OrcaRouter

GPT-5.6 Sol est hébergé sur OrcaRouter sous l'ID de modèle openai/gpt-5.6-sol, exposé via le point d'accès compatible OpenAI à l'adresse api.orcarouter.ai/v1 au tarif du fournisseur, sans aucune majoration. Si vous disposez déjà d'un client OpenAI, la migration se résume à un changement d'URL de base et d'ID de modèle — rien d'autre. La même clé et le même point d'accès donnent accès à plus de 200 modèles, si bien que Sol côtoie GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 et les modèles à poids ouverts auxquels vous souhaitez le comparer, et vous pouvez router par difficulté au lieu de réintégrer chacun d'eux.
Deux spécificités d'OrcaRouter qui méritent d'être mentionnées sur une page de tarification.BYOK : apportez votre propre clé OpenAI et OpenAI vous facture directement à ses propres tarifs — OrcaRouter ajoute 0 $ par jeton et préserve vos limites de débit et vos crédits fournisseur.Guardrails : le PII Shield et la politique de contenu s'exécutent avant la facturation, de sorte qu'une requête bloquée renvoie une erreur 400 propre et n'est jamais facturée, et l'Agent Firewall évalue les appels d'outils et MCP avant leur exécution.
La note d'honnêteté qui compte pour une page de tarification : nous routons le modèle, nous ne fixons pas son prix. Le montant de 4 $ / 20 $ est le tarif promotionnel d'OpenAI répercuté tel quel — et quand OpenAI l'a modifié le 24 août, le prix affiché a suivi le même jour, ce qui explique précisément pourquoi cette page est datée. Si vous appelez OpenAI directement, vous obtenez le même tarif ; OrcaRouter existe pour la route à clé unique et sans marge si vous voulez un seul point de terminaison sur toute la gamme de modèles.
Sources et date
Tous les prix ci-dessus ont été vérifiés le 2026-08-25. Les chiffres de GPT-5.6 Sol proviennent de la tarification API publiée par OpenAI, recoupés avec la page du modèle OrcaRouter pour GPT-5.6 Sol (consultée le même jour) et les articles de presse sur la baisse du 24 août (Indian Express, Economic Times, The Star) ; les tarifs batch, mode rapide, écriture de cache et contexte long sont ceux annoncés par OpenAI. Les chiffres de Claude, Grok et DeepSeek sont les fiches actuelles du répertoire OrcaRouter, DeepSeek V4 Pro étant affiché à son tarif hors pointe. Le prix catalogue de Sol est resté inchangé depuis son lancement le 9 juillet jusqu'à la baisse du 30 juillet, et a bougé pour la première fois le 24 août avec cette promotion — c'est exactement pour cela que la date compte ici : les tarifs de 4 $ / 20 $ sont temporaires, et les prix évoluent ; toute page « GPT-5.6 Sol pricing » antérieure ou postérieure que vous trouverez doit être traitée en vérifiant sa date. Les chiffres indiqués ici sont en vigueur à ce jour.
Chaque prix ci-dessus est le taux en direct sur le GPT-5.6 Sol on OrcaRouter — vérifié le 2026-08-25 à zéro marge, prêt pour votre propre clé.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
