
Tarification de l'API GPT-5.6 Sol : 5 $ / 30 $ par million de tokens, cache à 0,50 $, et ce que cela coûte vraiment
- DeepSeekNOUVEAUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 par million de tokens
- z-aiNOUVEAUZ.ai: GLM 5.32026-08-1860Intelligence75Code
- obsidianNOUVEAUQwen3.8 27B2026-08-1552Intelligence68Code
- qwenNOUVEAUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOUVEAUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligence69Code
- grokNOUVEAUSpaceXAI: Grok 4.62026-08-1261Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0557Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
- metaMeta: Muse Spark 1.12026-07-1653Intelligence71Code
- kimiMoonshotAI: Kimi K32026-07-1560Intelligence76Code
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligence71Code
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligence77Code
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligence77Code
GPT-5.6 Sol coûte $5.00 par million de jetons d'entrée et $30.00 par million de jetons de sortie sur l'API GPT-5.6 Sol — le même tarif que le niveau phare applique sur l'annuaire OrcaRouter, vérifié le 18 août 2026, sans aucune marge. C'est le niveau le plus cher de la famille GPT-5.6 et le seul dont le prix catalogue n'a pas bougé lors de la baisse du 30 juillet. La grille tarifaire de la page en direct du modèle GPT-5.6 Sol est donc celle à utiliser pour établir le budget. Les leviers comptent plus que le titre : les entrées réutilisées sont facturées à $0.50 par million grâce au cache de prompt, l'API batch descend à $2.50 / $15.00, et le mode rapide échange une prime de 2x contre une vitesse jusqu'à 2.5x. Cette page est la référence tarifaire pour Sol en particulier — la grille exacte, ce qu'une requête coûte réellement, comment le modèle phare se compare aux autres, quand il ne faut pas l'acheter, et comment l'appeler via un endpoint compatible OpenAI avec votre propre clé.
Les tarifs sont exprimés par million de jetons (entrée / sortie), à compter du 2026-08-18. Les montants en dollars sont lus sur les tarifs API publiés par OpenAI et recoupés avec la page du modèle OrcaRouter pour GPT-5.6 Sol ; les tarifs de cache, lot, mode rapide et contexte long sont annoncés par OpenAI. Les prix évoluent — vérifiez avant de construire.
Le prix exact, vérifié aujourd'hui.
Voici la grille tarifaire complète pour GPT-5.6 Sol, vérifiée le 2026-08-18 :

• Entrée — 5,00 $ par 1M de tokens en cas de défaut de cache.
• Sortie — 30,00 $ par 1M de jetons.
• Lecture du cache de prompt — 0,50 $ par million de jetons, soit une remise de 90 % sur toute entrée que vous renvoyez.
• Écriture du cache de prompt — 6,25 $ par million de jetons.
• Niveau de contexte long — les entrées au-delà d’environ 272K tokens sont facturées à 10,00 $ l’entrée / 45,00 $ la sortie (2x l’entrée, 1,5x la sortie).
• Batch API — $2.50 en entrée / $15.00 en sortie, une réduction fixe de 50 %, asynchrone, généralement prêt en environ 24 heures.
• Mode rapide — $10.00 en entrée / $60.00 en sortie, un surcoût de 2x pour une vitesse de sortie jusqu’à environ 2.5x supérieure, sans changement d’intelligence.
• Fenêtre de contexte — ~1,05M de jetons, jusqu'à 128K de sortie.
OrcaRouter transmet le tarif du fournisseur sans marges, donc le chiffre affiché sur l'annuaire est celui que vous payez. Sur la page du modèle en direct, la carte indique 5,00 $ / 30,00 $ par million, lecture de cache 0,500 $, avec les badges Vision, Tools, JSON et Reasoning. Le prix de Sol à 5 $ / 30 $ est aussi le prix avant coupe : la réduction du 30 juillet d'OpenAI s'est appliquée à GPT-5.6 Luna (désormais 0,20 $ / 1,20 $) et à GPT-5.6 Terra (désormais 2 $ / 12 $), tandis que le produit phare est resté inchangé.
Les leviers qui modifient le prix effectif
Le taux de base n'est que le point de départ. Quatre modificateurs changent ce que Sol vous coûte réellement :
• Mise en cache des prompts — le contexte réutilisé est facturé à 0,50 $ par million au lieu de 5 $ pour un contexte neuf, et les écritures en cache coûtent 6,25 $ par million. Pour tout agent ou chat qui renvoie un grand préfixe à chaque tour, la mise en cache est le levier le plus important sur la facture. OpenAI associe le cache à chaque projet et clé API, donc rester sur une seule clé (un seul canal) est ce qui permet de continuer à obtenir des correspondances en cache.
• Niveau long-contexte — une requête dont l’entrée dépasse environ 272 000 jetons passe du tarif de base à 10 $ / 45 $. Quelques très grandes requêtes peuvent discrètement augmenter votre prix moyen ; regroupez ou tronquez lorsque vous n’avez pas réellement besoin du contexte profond.
• Batch — L'API batch d'OpenAI exécute les tâches de manière asynchrone avec un délai de traitement d'environ 24 heures à exactement la moitié du prix : 2,50 $ / 15,00 $, avec une entrée en cache à 0,25 $ et des écritures de cache à 3,13 $. Elle se cumule avec la mise en cache des prompts et convient aux évaluations, à la classification en masse et à la génération hors ligne où la latence n'a pas d'importance.
• Mode rapide — $10 / $60 pour un débit de sortie jusqu'à ~2.5x, utile pour les travaux sensibles à la latence où l'utilisateur attend, comme l'assistance au codage en direct. Il facture par jeton au double du tarif standard, ne compte pas dans les forfaits TPM Scale Tier achetés, et peut revenir au traitement standard si vous dépassez la limite de débit partagée.
Ce que coûte réellement une requête
Les prix par token sont abstraits, voici donc des exemples concrets aux taux actuels :
• Appel de chat unique, 50K d’entrée + 20K de sortie — 0,25 $ + 0,60 $ = 0,85 $.
• 1M d'entrée + 1M de sortie — 5 $ + 30 $ = 35 $.
• Tour agentique, 200K de contexte en cache + 20K d'entrée fraîche + 30K de sortie — 0,10 $ + 0,10 $ + 0,90 $ = 1,10 $. Le même tour avec un cache froid — 220K d'entrée fraîche à 1,10 $ — totalise 2,00 $. La mise en cache le réduit presque de moitié.
• Un mois de 10 M de tokens avec une répartition 70 % entrée / 30 % sortie, avec 80 % des entrées servies depuis le cache : 1,4 M d'entrées fraîches (7,00 $) + 5,6 M en cache (2,80 $) + 3 M de sorties (90 $) ≈ $100. Sans cache, le même mois revient à $125 — et le même mois sur GPT-5.6 Terra coûte environ 50 $, ou environ 5 $ sur GPT-5.6 Luna. Cet écart de 20x entre Sol et Luna montre pourquoi la correspondance de palier est plus importante que n'importe quel tarif individuel.
Deux mises en garde augmentent le tarif effectif. Sol est un modèle de raisonnement — les jetons de raisonnement interne sont facturés comme sortie à 30 $ par million. Une invite difficile avec un réglage d’effort de raisonnement élevé peut consacrer une grande partie de son budget de sortie à la réflexion, de sorte que le coût de sortie effectif sur un travail difficile dépasse largement une estimation naïve. De plus, le tokeniseur d’OpenAI est plus verbeux que celui de la génération précédente sur certaines entrées, donc le même texte peut coûter plus de jetons qu’il n’en aurait coûté sur GPT-5.5. Ajustez l’effort de raisonnement à la tâche, plafonnez la sortie lorsque c’est possible, et mesurez l’utilisation réelle avant de projeter une facture.
Comment la tarification de Sol se compare au reste du secteur

Relevé par rapport aux prix catalogue publiés le 2026-08-18 :
• GPT-5.6 Terra — 2 $ / 12 $, le palier intermédiaire après réduction. Sol coûte 2,5 fois plus cher en entrée et en sortie ; Terra est l'option par défaut lorsque vous n'avez pas besoin du raisonnement de pointe.
• GPT-5.6 Luna — $0.20 / $1.20, le palier de volume après réduction. Un écart d'entrée de 25x avec Sol ; Luna est tarifé pour le gros du trafic.
• Claude Opus 5 — 5 $ / 25 $. Même entrée, sortie 20 % moins chère sur le papier. En pratique, la comparaison s’inverse pour certaines charges de travail : ce blog avait précédemment mesuré Sol à environ 34,5 % de jetons en moins qu’un modèle Anthropic sur le même échantillon anglais/mixte, et une analyse publiée de token-économie (TheBlockBeats) estimait que la facture totale de Sol pouvait être environ 21 % inférieure à celle de Claude Opus 5 pour un travail équivalent, malgré un taux de sortie plus élevé. Mesurez votre propre tokeniseur, pas le prix affiché.
• Claude Fable 5 — $10 / $50. Sol coûte la moitié du prix d'entrée et est 40 % moins cher en sortie que le niveau supérieur d'Anthropic.
• Claude Opus 4.8 — $5 / $25. Même entrée que Sol, sortie moins chère — le fleuron de la génération précédente d'Anthropic.
• Grok 4.6 — 2 $ / 6 $. Le chiffre le plus marquant du tableau : il a égalé GPT-5.6 Sol sur l'indice Artificial Analysis (les deux à 61), avec une entrée 2,5 fois moins chère et une sortie 5 fois moins chère.
• DeepSeek V4 Pro — 0,44 $ / 0,88 $ hors pointe (les fenêtres de pointe le doublent). Un univers de prix totalement différent, pour la voie des poids ouverts bon marché.
La formulation honnête : Sol est un flagship premium avec un débit de sortie premium — le débit de sortie le plus élevé parmi les flagships fermés en dessous de Claude Fable 5. Il l'emporte sur le coût effectif par unité de travail difficile (son tokenizer, son raisonnement, son contexte long) plutôt que sur le débit absolu. Si votre trafic se compose de prompts courts et de tâches simples, un Terra à 2 $, un Luna à 0,20 $, ou un Grok 4.6 à 2 $ / 6 $ est le choix le moins cher — et sur l'indice, Grok 4.6 ne cède rien sur le papier.
Quand Sol est le mauvais choix
Quatre cas où ce prix n'est pas celui que vous voulez :
Invites courtes et simples. Pour moins de 20 000 jetons environ, sans raisonnement approfondi, recourir au modèle phare est un gaspillage. Le GPT-5.6 Terra à 2 $ / 12 $ ou le GPT-5.6 Luna à 0,20 $ / 1,20 $ gère le palier de volume pour une fraction du coût, et un modèle de classe Grok 4.6 ou DeepSeek coûte encore moins.
Volume à forte intensité de raisonnement. Parce que le raisonnement est facturé comme des tokens de sortie, une requête difficile avec un niveau d’effort élevé peut coûter bien plus que le tarif de sortie nominal. Si votre charge de travail comprend de nombreux appels difficiles, mesurez les tokens de sortie réels avant de vous engager — le taux effectif peut vous surprendre.
Le prix par jeton comme seul objectif. Grok 4.6 a égalé Sol sur l'indice à 2 $ / 6 $, et DeepSeek V4 Pro se situe à 0,44 $ / 0,88 $ en heures creuses. Si un score de référence de pointe n'est pas l'exigence stricte, ces modèles offrent des tarifs par jeton bien inférieurs pour la même catégorie de travail.
Budgets de latence stricts.Sol est un grand modèle de raisonnement, son délai jusqu'au premier token est donc bien supérieur à celui d'un modèle de niveau Flash. Pour un chat en temps réel où un TTFT sous la seconde compte, le mode rapide à 10 $ / 60 $ achète du débit, pas une latence de premier token plus faible — et un modèle plus petit reste la solution la moins chère.
Comment l'appeler sur OrcaRouter

GPT-5.6 Sol est hébergé sur OrcaRouter sous l'ID de modèle openai/gpt-5.6-sol, exposé via le point d'accès compatible OpenAI à l'adresse api.orcarouter.ai/v1 au tarif du fournisseur, sans aucune majoration. Si vous disposez déjà d'un client OpenAI, la migration se résume à un changement d'URL de base et d'ID de modèle — rien d'autre. La même clé et le même point d'accès donnent accès à plus de 200 modèles, si bien que Sol côtoie GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 et les modèles à poids ouverts auxquels vous souhaitez le comparer, et vous pouvez router par difficulté au lieu de réintégrer chacun d'eux.
Deux spécificités d'OrcaRouter qui méritent d'être mentionnées sur une page de tarification.BYOK : apportez votre propre clé OpenAI et OpenAI vous facture directement à ses propres tarifs — OrcaRouter ajoute 0 $ par jeton et préserve vos limites de débit et vos crédits fournisseur.Guardrails : le PII Shield et la politique de contenu s'exécutent avant la facturation, de sorte qu'une requête bloquée renvoie une erreur 400 propre et n'est jamais facturée, et l'Agent Firewall évalue les appels d'outils et MCP avant leur exécution.
La note d'honnêteté qui compte pour une page de tarification : nous routons le modèle, nous ne fixons pas son prix. Le montant de $5 / $30 est le tarif d'OpenAI répercuté, et lorsqu'OpenAI le modifie, l'affichage suit — c'est exactement pourquoi cette page est horodatée. Si vous appelez OpenAI directement, vous obtenez le même tarif ; OrcaRouter existe pour la voie à clé unique sans marge si vous voulez un seul point de terminaison pour toute la gamme de modèles.
Sources et date
Tous les prix ci-dessus ont été vérifiés le 2026-08-18. Les chiffres de GPT-5.6 Sol proviennent de la tarification API publiée par OpenAI et ont été recoupés avec la page du modèle OrcaRouter pour GPT-5.6 Sol (vérifiée le même jour) ainsi qu'avec nos propres pages de tarification GPT-5.6 publiées. Les tarifs par lot (batch), mode rapide, écriture de cache et contexte long sont annoncés par OpenAI. Les chiffres de Claude, Grok et DeepSeek sont les listes actuelles du répertoire OrcaRouter, DeepSeek V4 Pro étant affiché à son tarif hors heures creuses. OpenAI n'a pas modifié le prix de liste de Sol depuis son lancement le 9 juillet 2026 — la réduction du 30 juillet a laissé le modèle phare inchangé — mais les prix évoluent ; traitez toute page « GPT-5.6 Sol pricing » antérieure que vous trouverez avec la date vérifiée. Les chiffres ici sont actuels à ce jour.
Chaque prix ci-dessus est le taux en direct sur le GPT-5.6 Sol on OrcaRouter — vérifié le 2026-08-18 sans marge, prêt pour votre propre clé.
Comparés dans cet article3
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
