Illustration éditoriale vectorielle plate pour une section héros de blog technologique sur la tarification des modèles : une grande puce de modèle arrondie sur un fond clair, une étiquette de prix accrochée à son coin, trois flux de tokens qui s'en échappent pour alimenter un indicateur de prix circulaire, et une petite pile de blocs en cache à côté de l'indicateur. Palette bleu profond et cyan, esthétique SaaS moderne et épurée, aucun texte lisible.
Guides & Insights

Tarification de l'API Claude Opus 5 : 5 $ / 25 $ pour 1 M de jetons, cache à 0,50 $, et ce que cela coûte réellement

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Opus 5 coûte $5.00 par million de jetons d'entrée et $25.00 par million de jetons de sortie sur l'API Claude Opus 5 — le même tarif que le modèle affiche dans l'annuaire OrcaRouter, vérifié le 2026-08-18, sans aucune majoration. Cela le place à la moitié du prix de Claude Fable 5 et exactement au prix de Claude Opus 4.8, et la grille tarifaire sur la page live du modèle Claude Opus 5 est celle à utiliser pour budgétiser. Les leviers comptent plus que le titre : les entrées réutilisées sont facturées à $0.50 le million grâce au cache de prompt, le mode batch descend à $2.50 / $12.50, et sa version bêta en mode rapide se situe à $10 / $50. Cette page est la référence tarifaire du modèle — la grille exacte, le coût réel d'une requête, la comparaison du prix avec le marché, les cas où il ne faut pas l'acheter, et comment l'appeler via un point de terminaison compatible OpenAI avec votre propre clé.

Les prix sont par million de jetons (entrée / sortie), au 18 août 2026. Les montants en dollars sont relevés sur les tarifs API publiés par Anthropic et recoupés avec la page du modèle OrcaRouter pour Claude Opus 5 ; les tarifs de cache, de lot et de mode rapide sont annoncés par Anthropic. Les prix évoluent — vérifiez avant de construire.

Le prix exact, vérifié aujourd'hui.

Voici la grille tarifaire complète pour Claude Opus 5, vérifiée le 18/08/2026 :

Price card titled 'Claude Opus 5 — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $25.00 and Cache read $0.50. Rows below list cache write 5-minute TTL $6.25, cache write 1-hour TTL $10.00, batch $2.50 input / $12.50 output, fast mode $10 / $50, context window 1M tokens and max output 128K. Footer: reused input costs one tenth of fresh input.

Entrée — 5,00 $ par 1M de tokens en cas de défaut de cache.

Sortie — $25.00 par 1M de tokens.

Écriture du cache de prompt — 6,25 $ par million avec un TTL de 5 minutes, 10,00 $ par million avec un TTL d'une heure.

Lecture du cache de prompt — 0,50 $ par million de jetons, soit une remise de 90 % sur toute entrée que vous renvoyez.

Batch API — 2,50 $ en entrée / 12,50 $ en sortie, une remise forfaitaire de 50 %, asynchrone.

Mode rapide — 10 $ en entrée / 50 $ en sortie, un supplément de 2x pour une vitesse de sortie environ 2,5x supérieure, version bêta d'Anthropic.

Fenêtre de contexte — 1M de jetons, jusqu'à 128K en sortie.

OrcaRouter transmet le tarif du fournisseur sans majoration, donc le montant figurant dans l'annuaire est celui que vous payez. Sur la page du modèle en direct, la carte indique $5.00 / $25.00 par 1M, lecture de cache $0.500, écriture de cache $10.00 (le taux de TTL de 1 heure), avec les badges Vision, Tools, JSON et Reasoning.

Les leviers qui modifient le prix effectif

Le taux de base n'est que le point de départ. Trois modificateurs changent ce que Opus 5 vous coûte réellement :

Mise en cache des prompts — le contexte réutilisé est facturé à 0,50 $ par million au lieu de 5 $ pour un contexte neuf. Le préfixe minimum pouvant être mis en cache a été réduit à environ 512 jetons sur Opus 5, de sorte que même une invite système stable et modeste est éligible. Pour tout agent ou chat qui renvoie un grand préfixe à chaque tour, la mise en cache est le plus gros levier sur la facture — et comme Anthropic associe le cache à chaque clé API, rester sur une seule clé (un seul canal) est ce qui permet de conserver les succès de cache.

Batch — L'API batch d'Anthropic exécute les tâches de manière asynchrone, avec des résultats généralement disponibles dans les 24 heures, à exactement la moitié du prix : $2.50 / $12.50. Elle se cumule avec la mise en cache des prompts et convient aux évaluations, à la classification en masse et à la génération hors ligne lorsque la latence n'a pas d'importance.

Fast mode — 10 $ / 50 $ pour un débit de sortie jusqu'à ~2.5x, utile pour les travaux à haut volume et sensibles à la latence. Il ne se combine pas avec l'API batch et est une bêta first-party d'Anthropic ; le taux de répercussion standard d'un routeur est le tarif de base de 5 $ / 25 $.

Ce que coûte réellement une requête

Les prix par token sont abstraits, voici donc des exemples concrets aux taux actuels :

Un appel de chat, 50K d’entrée + 20K de sortie — $0.25 + $0.50 = $0.75.

1M d'entrée + 1M de sortie — 5 $ + 25 $ = 30 $.

Tour agentique, 200K de contexte en cache + 20K d'entrées fraîches + 30K de sortie — $0.10 + $0.10 + $0.75 = $0.95. Le même tour avec un cache froid — 220K d'entrées fraîches à $1.10 — totalise $1.85. La mise en cache le réduit presque de moitié.

Un mois de 10 M de tokens avec une répartition de 70 % en entrée / 30 % en sortie, avec 80 % de l’entrée servie depuis le cache : 1,4 M d’entrée fraîche (7,00 $) + 5,6 M en cache (2,80 $) + 3 M de sortie (75 $) ≈ 85 $. Sans cache, le même mois revient à 110 $.

Deux mises en garde augmentent le taux effectif. Opus 5 est un modèle de réflexion — la réflexion adaptative est activée par défaut, et les jetons de réflexion sont facturés comme sortie à 25 $ par million. Une invite difficile avec un réglage d'effort élevé peut consacrer une grande partie de son budget de sortie au raisonnement, de sorte que le coût de sortie effectif pour un travail difficile dépasse largement une estimation naïve. Et le tokeniseur actuel d'Anthropic est plus verbeux que celui de la génération précédente, donc le même texte anglais coûte plus de jetons (et plus d'argent) que sur les anciens modèles Claude. Abaissez le réglage d'effort pour les appels simples et plafonnez la sortie lorsque vous le pouvez.

Comment la tarification d'Opus 5 se compare au reste du secteur

Comparison table card titled 'USD per 1M tokens — published list prices', verified 2026-08-18, with an input/output column pair per model: Claude Opus 5 $5.00/$25.00 highlighted with a 'THIS PAGE' tag; Claude Opus 4.8 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Sonnet 5 $3.00/$15.00 (intro $2.00/$10.00 through Aug 31); GPT-5.6 Sol $5.00/$30.00; GPT-5.6 Terra $2.00/$12.00; Gemini 3.6 Flash $1.50/$7.50; Kimi K3 $3.00/$15.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Opus 5 is half the price of Claude Fable 5, the same price as Claude Opus 4.8, and 20% cheaper on output than GPT-5.6 Sol.

Relevé par rapport aux prix catalogue publiés le 2026-08-18 :

Claude Opus 4.8 — 5 $ / 25 $. Même prix que la génération précédente. Opus 5 coûte le même prix pour le nouveau modèle, ce qui rend la mise à niveau facile.

Claude Fable 5 — 10 $ / 50 $. Opus 5 coûte la moitié du prix du niveau supérieur d'Anthropic, avec le même contexte de 1 M de jetons.

Claude Sonnet 5 — 3 $ / 15 $ standard (2 $ / 10 $ en lancement jusqu'au 31 août 2026). Le palier Sonnet est 40 % moins cher en entrée comme en sortie — le choix naturel quand vous n'avez pas besoin du raisonnement de niveau Opus.

GPT-5.6 Sol — $5 / $30. Même prix d’entrée, sortie moins chère sur Opus 5.

GPT-5.6 Terra — $2 / $12. Le palier intermédiaire de volume pour les travaux à grand volume non-frontier.

Gemini 3.6 Flash — 1,50 $ / 7,50 $. Un modèle de niveau Flash pour un trafic multimodal bon marché et rapide.

Kimi K3 — $3 / $15. Un fleuron open-weights dont les tarifs représentent environ la moitié de ceux d'Opus.

DeepSeek V4 Pro — $0.44 / $0.88 en heures creuses (les fenêtres de pointe le doublent). Le fleuron open-weights bon marché, un tout autre univers de prix.

Le cadrage honnête : Opus 5 n'est pas un modèle bon marché — c'est un produit phare proposé à la moitié du prix du haut de gamme (Claude Fable 5) et exactement au prix de la génération précédente. Il gagne sur le rapport prix/contexte long et prix/raisonnement complexe, pas sur le tarif absolu. Si votre trafic est constitué de requêtes courtes et de tâches simples, un Sonnet à 3 $ ou un modèle DeepSeek à 0,44 $ est le choix le moins cher.

Lorsque Opus 5 est le mauvais choix

Quatre cas où ce prix n'est pas celui que vous voulez :

Prompts courts et simples. En dessous d’environ 20K jetons et sans raisonnement approfondi, le premium d’Opus est gaspillé. Claude Sonnet 5 à 3 $ / 15 $ (ou 2 $ / 10 $ pendant la période d’introduction) gère le palier de volume pour 40 % de moins, et un modèle de classe Gemini Flash ou DeepSeek coûte encore bien moins.

Volume à forte intensité de raisonnement. Parce que le raisonnement est facturé comme des tokens de sortie, une requête difficile avec un niveau d’effort élevé peut coûter bien plus que le tarif de sortie nominal. Si votre charge de travail comprend de nombreux appels difficiles, mesurez les tokens de sortie réels avant de vous engager — le taux effectif peut vous surprendre.

Le prix par jeton comme unique objectif. Si un score de référence de pointe ou le contexte de 1M n'est pas l'exigence stricte, les modèles phares moins chers (GPT-5.6 Terra, DeepSeek V4 Pro) ou les modèles de niveau Flash (Gemini 3.6 Flash) offrent des tarifs par jeton bien inférieurs pour la grande majorité du trafic facile.

Budgets de latence stricts. Opus 5 est un grand modèle de réflexion — p50 du temps jusqu'au premier token (TTFT) d'environ 7 secondes dans la mesure d'OrcaRouter sur 7 jours. Pour un chat en temps réel où un TTFT inférieur à la seconde est crucial, c'est le mauvais modèle, quel que soit le prix.

Comment l'appeler sur OrcaRouter

Screenshot of the OrcaRouter model page for Claude Opus 5 (model ID anthropic/claude-opus-5): a New Featured badge, Vision/Tools/JSON/Reasoning capability badges, 1M token context and 128K max output, input $5.00 and output $25.00 per 1M tokens, cache read $0.500 and cache write $10.00, p50 TTFT 7.06s, the /v1/chat/completions and /v1/messages endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

Claude Opus 5 est hébergé sur OrcaRouter sous l'ID de modèle anthropic/claude-opus-5, servi via le endpoint compatible OpenAI à l'adresse api.orcarouter.ai/v1 au tarif du fournisseur, avec zéro marge. Si vous avez déjà un client OpenAI, la migration consiste à changer l'URL de base et l'ID du modèle — rien d'autre. La même clé et le même endpoint donnent accès à plus de 200 modèles, donc Opus 5 côtoie Claude Sonnet 5, Claude Haiku 4.5, les niveaux GPT-5.6, la famille Gemini et les modèles open-weight auxquels vous voudriez le comparer, et vous pouvez router par difficulté au lieu de réintégrer chacun d'eux.

Deux spécificités d'OrcaRouter à mentionner sur une page de tarification. BYOK : apportez votre propre clé Anthropic et Anthropic vous facture directement à ses propres tarifs — OrcaRouter ajoute 0 $ par jeton et conserve vos limites de débit et vos crédits fournisseur. Guardrails : le PII Shield et la politique de contenu s'exécutent avant la facturation, donc une requête bloquée renvoie un 400 propre et n'est jamais facturée, et l'Agent Firewall évalue les appels d'outils et les appels MCP avant leur exécution.

La note d'honnêteté qui compte pour une page de tarification : nous routons le modèle, nous ne fixons pas son prix. Le montant de 5 $ / 25 $ est le tarif d'Anthropic répercuté, et lorsqu'Anthropic le modifie, l'affichage suit — c'est exactement pour cela que cette page est datée. Si vous appelez Anthropic directement, vous obtenez le même tarif ; OrcaRouter existe pour la route à clé unique et sans marge si vous voulez un seul point de terminaison pour toute la gamme de modèles.

Sources et date

Tous les prix ci-dessus ont été vérifiés le 18 août 2026. Les chiffres de Claude proviennent de la tarification API publiée par Anthropic et ont été recoupés avec la page du modèle OrcaRouter pour Claude Opus 5 (vérifiée le même jour). Les prix de GPT-5.6 après réduction sont les taux publiés par OpenAI ; les chiffres de Gemini, Kimi et DeepSeek sont les listes actuelles de l’annuaire OrcaRouter, avec DeepSeek V4 Pro affiché à son tarif hors pointe (les fenêtres de pointe le doublent). Les prix d’Anthropic sont stables depuis le lancement d’Opus 5 le 24 juillet 2026, mais ils évoluent — traitez toute page « tarification d’Opus 5 » antérieure que vous trouvez avec la date de vérification en tête. Les chiffres ici sont actuels en date d’aujourd’hui.

Chaque prix ci-dessus est le taux en direct sur la page du modèle Claude Opus 5 — vérifié le 18 août 2026 sans marge, prêt pour votre propre clé.

Comparés dans cet article4

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube