Ilustración editorial de vector plano para el hero de un blog de tecnología sobre precios de modelos: un gran chip de modelo redondeado sobre un fondo claro, una etiqueta de precio sujeta a su esquina, tres flujos de tokens que salen de él hacia un indicador de precio circular, y una pequeña pila de bloques en caché junto al indicador. Paleta de azul profundo y cian, estética SaaS moderna y limpia, sin texto legible.
Guides & Insights

Precios de la API de Claude Opus 5: $5 / $25 por 1M de tokens, caché a $0.50, y lo que realmente cuesta

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Opus 5 cuesta $5.00 por millón de tokens de entrada y $25.00 por millón de tokens de salida en la API de Claude Opus 5 — la misma tarifa que el modelo tiene en el directorio OrcaRouter, verificada el 2026-08-18, sin margen adicional. Eso lo sitúa en la mitad del precio de Claude Fable 5 y exactamente en lo que costaba Claude Opus 4.8, y la tarjeta de tarifas de la página del modelo en vivo de Claude Opus 5 es la referencia para presupuestar. Las palancas importan más que el titular: la entrada reutilizada se factura a $0.50 por millón mediante el caché de prompts, el batch baja a $2.50 / $12.50, y su beta de modo rápido se sitúa en $10 / $50. Esta página es la referencia de precios del modelo — la tarjeta de tarifas exacta, lo que cuesta realmente una solicitud, cómo se compara el precio con el resto del mercado, cuándo es una mala compra y cómo llamarlo a través de un único endpoint compatible con OpenAI con tu propia clave.

Los precios son por millón de tokens (entrada / salida), a fecha de 2026-08-18. Las cifras en dólares se leen de las tarifas de API publicadas por Anthropic y se contrastan con la página del modelo OrcaRouter para Claude Opus 5; las tarifas de caché, lote y modo rápido son anunciadas por Anthropic. Los precios cambian — verifica antes de construir.

El precio exacto, verificado hoy

Aquí está la tarjeta de tarifas completa para Claude Opus 5, verificada el 2026-08-18:

Price card titled 'Claude Opus 5 — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $25.00 and Cache read $0.50. Rows below list cache write 5-minute TTL $6.25, cache write 1-hour TTL $10.00, batch $2.50 input / $12.50 output, fast mode $10 / $50, context window 1M tokens and max output 128K. Footer: reused input costs one tenth of fresh input.

Entrada — $5.00 por 1M de tokens en caso de fallo de caché.

Salida — $25.00 por 1M tokens.

Escritura de caché de prompt — $6.25 por 1M con un TTL de 5 minutos, $10.00 por 1M con un TTL de 1 hora.

Lectura de caché de prompts — $0.50 por 1M de tokens, un descuento del 90% en cualquier entrada que reenvíes.

Batch API — $2.50 de entrada / $12.50 de salida, un 50 % de descuento fijo, asíncrono.

Modo rápido — $10 de entrada / $50 de salida, una prima de 2x para hasta aproximadamente 2.5x de velocidad de salida, beta de Anthropic.

Ventana de contexto — 1M tokens, hasta 128K de salida.

OrcaRouter transmite la tarifa del proveedor sin margen, por lo que la cifra en el directorio es la cifra que pagas. En la página del modelo en vivo, la tarjeta muestra $5.00 / $25.00 por 1M, lectura de caché $0.500, escritura de caché $10.00 (la tarifa TTL de 1 hora), con insignias de Vision, Tools, JSON y Reasoning.

Las palancas que cambian el precio efectivo

La tarifa base es solo el punto de partida. Tres modificadores cambian lo que Opus 5 realmente te cuesta:

Prompt caching — el contexto reutilizado se factura a $0.50 por millón en lugar de $5 por contexto nuevo. El prefijo mínimo cacheable se redujo a aproximadamente 512 tokens en Opus 5, por lo que incluso un prompt de sistema estable y modesto califica. Para cualquier agente o chat que reenvía un prefijo grande en cada turno, el almacenamiento en caché es la palanca más importante en la factura — y debido a que Anthropic vincula la caché por clave de API, permanecer en una sola clave (un solo canal) es lo que hace que los aciertos sigan llegando.

Batch — La API Batch de Anthropic ejecuta trabajos de forma asíncrona, con resultados normalmente disponibles en 24 horas, a exactamente la mitad de precio: $2.50 / $12.50. Se combina con el almacenamiento en caché de prompts y es adecuada para evaluaciones, clasificación masiva y generación sin conexión donde la latencia no importa.

Modo rápido — $10 / $50 para un rendimiento de salida de hasta ~2.5x, útil para trabajos de alta producción con latencia crítica. No se combina con la API por lotes y es una beta de primera parte de Anthropic; la tarifa de transferencia estándar de un router es la base de $5 / $25.

Lo que realmente cuesta una solicitud

Los precios por token son abstractos, así que aquí tienes ejemplos resueltos con las tarifas actuales:

Llamada de chat única, 50K de entrada + 20K de salida — $0.25 + $0.50 = $0.75.

1M de entrada + 1M de salida — $5 + $25 = $30.

Turno agéntico, 200K de contexto en caché + 20K de entrada nueva + 30K de salida — $0.10 + $0.10 + $0.75 = $0.95. El mismo turno con una caché fría — 220K de entrada nueva a $1.10 — totaliza $1.85. El almacenamiento en caché casi lo reduce a la mitad.

Un mes de 10M de tokens con una división de 70% entrada / 30% salida, con el 80% de la entrada servida desde caché: 1.4M de entrada nueva ($7.00) + 5.6M en caché ($2.80) + 3M de salida ($75) ≈ $85. Sin caché, el mismo mes es $110.

Dos advertencias aumentan la tasa efectiva. Opus 5 es un modelo de razonamiento: el pensamiento adaptativo está activado por defecto, y los tokens de razonamiento se facturan como salida a 25 dólares por millón. Un mensaje complejo con un nivel de esfuerzo alto puede gastar una gran parte de su presupuesto de salida en razonamiento, por lo que el costo efectivo de salida en trabajos difíciles supera con creces una estimación ingenua. Y el tokenizador actual de Anthropic es más verboso que el de la generación anterior, por lo que el mismo texto en inglés cuesta más tokens (y más dinero) que en los modelos Claude más antiguos. Reduce el nivel de esfuerzo para llamadas sencillas y limita la salida siempre que puedas.

Cómo se compara el precio de Opus 5 con el resto

Comparison table card titled 'USD per 1M tokens — published list prices', verified 2026-08-18, with an input/output column pair per model: Claude Opus 5 $5.00/$25.00 highlighted with a 'THIS PAGE' tag; Claude Opus 4.8 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Sonnet 5 $3.00/$15.00 (intro $2.00/$10.00 through Aug 31); GPT-5.6 Sol $5.00/$30.00; GPT-5.6 Terra $2.00/$12.00; Gemini 3.6 Flash $1.50/$7.50; Kimi K3 $3.00/$15.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Opus 5 is half the price of Claude Fable 5, the same price as Claude Opus 4.8, and 20% cheaper on output than GPT-5.6 Sol.

Leído contra los precios de lista publicados el 2026-08-18:

Claude Opus 4.8 — $5 / $25. Precio idéntico al de la generación anterior. El modelo más nuevo, Opus 5, tiene el mismo precio, lo que facilita la actualización.

Claude Fable 5 — $10 / $50. Opus 5 cuesta la mitad que el nivel superior de Anthropic, con el mismo contexto de 1M de tokens.

Claude Sonnet 5 — $3 / $15 estándar ($2 / $10 de introducción hasta el 31 de agosto de 2026). El nivel Sonnet es un 40 % más barato en entrada y salida — la opción natural cuando no necesitas razonamiento de nivel Opus.

GPT-5.6 Sol — $5 / $30. Mismo precio de entrada, salida más barata en Opus 5.

GPT-5.6 Terra — $2 / $12. El nivel intermedio de volumen para trabajo de alto volumen no fronterizo.

Gemini 3.6 Flash — $1.50 / $7.50. Un modelo de nivel Flash para tráfico multimodal económico y rápido.

Kimi K3 — $3 / $15. Un modelo insignia de pesos abiertos a aproximadamente la mitad de las tarifas de Opus.

DeepSeek V4 Pro — $0.44 / $0.88 fuera de horas punta (las horas punta lo duplican). El buque insignia barato de pesos abiertos, un universo de precios completamente diferente.

El marco honesto: Opus 5 no es un modelo barato — es un buque insignia con un precio de la mitad del nivel superior (Claude Fable 5) y exactamente lo que costaba la generación anterior. Gana en precio por contexto largo y precio por razonamiento difícil, no en la tarifa absoluta. Si tu tráfico son indicaciones cortas y tareas simples, un Sonnet de $3 o un modelo DeepSeek de $0.44 es la opción más barata.

Cuando Opus 5 es la opción incorrecta

Four cases where this price is not the one you want:

Indicaciones breves y sencillas. Por debajo de aproximadamente 20K tokens sin razonamiento profundo, el sobreprecio de Opus se desperdicia. Claude Sonnet 5 a $3 / $15 (o $2 / $10 a través de la ventana de introducción) maneja el nivel de volumen por un 40 % menos, y un modelo de clase Gemini Flash o DeepSeek cuesta mucho menos aún.

Volumen de alto razonamiento. Debido a que el razonamiento se factura como salida, un prompt difícil con un nivel de esfuerzo alto puede costar mucho más que la tarifa de salida nominal. Si tu carga de trabajo consiste en muchas llamadas difíciles, mide los tokens de salida reales antes de comprometerte — la tarifa efectiva puede sorprenderte.

Precio por token como único objetivo. Si una puntuación en benchmarks de frontera o el contexto de 1M no es el requisito estricto, los modelos insignia más económicos (GPT-5.6 Terra, DeepSeek V4 Pro) o los modelos de nivel Flash (Gemini 3.6 Flash) ofrecen tarifas por token mucho más bajas para la mayor parte del tráfico sencillo.

Presupuestos estrictos de latencia. Opus 5 es un modelo de razonamiento grande — el p50 del tiempo hasta el primer token es de unos 7 segundos en la medición de 7 días de OrcaRouter. Para el chat en tiempo real donde el TTFT de menos de un segundo importa, es el modelo equivocado, sin importar el precio.

¿Cómo llamarlo en OrcaRouter?

Screenshot of the OrcaRouter model page for Claude Opus 5 (model ID anthropic/claude-opus-5): a New Featured badge, Vision/Tools/JSON/Reasoning capability badges, 1M token context and 128K max output, input $5.00 and output $25.00 per 1M tokens, cache read $0.500 and cache write $10.00, p50 TTFT 7.06s, the /v1/chat/completions and /v1/messages endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

Claude Opus 5 está alojado en OrcaRouter como ID de modelo anthropic/claude-opus-5, servido a través del endpoint compatible con OpenAI en api.orcarouter.ai/v1 a la tarifa del proveedor sin margen adicional. Si ya tienes un cliente OpenAI, la migración es un cambio de URL base y de ID de modelo — nada más. La misma clave y el mismo endpoint admiten más de 200 modelos, por lo que Opus 5 se sitúa junto a Claude Sonnet 5, Claude Haiku 4.5, los niveles de GPT-5.6, la familia Gemini y los modelos de pesos abiertos con los que querrías compararlo, y puedes enrutar por dificultad en lugar de reintegrar cada uno.

Dos detalles específicos de OrcaRouter que vale la pena destacar en una página de precios. BYOK: trae tu propia clave de Anthropic y Anthropic te factura directamente a sus propias tarifas: OrcaRouter añade $0 por token y mantiene intactos los límites de velocidad y créditos de tu proveedor. Guardrails: el PII Shield y la política de contenido se ejecutan antes de la facturación, por lo que una solicitud bloqueada devuelve un 400 limpio y nunca se cobra, y el Agent Firewall evalúa las llamadas de herramientas y MCP antes de que se ejecuten.

La nota de honestidad que importa para una página de precios: enrutamos el modelo, no fijamos su precio. La cifra de $5 / $25 es la tarifa de Anthropic repercutida, y cuando Anthropic la cambia, el listado la sigue — que es exactamente por qué esta página está fechada. Si llamas a Anthropic directamente obtienes la misma tarifa; OrcaRouter existe para la ruta de una sola clave y sin margen de beneficio si quieres un único endpoint en toda la línea de modelos.

Fuentes y fecha

Todos los precios anteriores fueron verificados el 2026-08-18. Las cifras de Claude se leen de los precios de API publicados por Anthropic y se contrastan con la página del modelo OrcaRouter para Claude Opus 5 (verificada el mismo día). Los precios de GPT-5.6 posteriores al recorte son las tarifas publicadas por OpenAI; las cifras de Gemini, Kimi y DeepSeek son los listados actuales del directorio de OrcaRouter, con DeepSeek V4 Pro mostrado a su tarifa de horas valle (las horas punta la duplican). Los precios de Anthropic se han mantenido estables desde el lanzamiento de Opus 5 el 24 de julio de 2026, pero cambian: trata cualquier página de "Opus 5 pricing" anterior que encuentres con la fecha verificada. Las cifras aquí son las actuales a día de hoy.

Cada precio anterior es la tarifa en vivo en la página del modelo Claude Opus 5 — verificada el 2026-08-18 sin recargo, lista para tu propia clave.

Comparados en este artículo4

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube