Una tarjeta de título para el precio de Claude Opus 5.5 que muestra las tarifas principales de $4.00 por millón de tokens de entrada, $20.00 por millón de tokens de salida y $0.20 por millón de tokens de lectura en caché.
Guides & Insights

Precios de Claude Opus 5.5: la tarifa completa, la línea de caché y lo que realmente cuesta una tarea

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Opus 5.5 tiene un precio de lista de $4.00 por millón de tokens de entrada y $20.00 por millón de tokens de salida, un recorte fijo del 20% respecto a los $5.00/$25.00 que Claude Opus 5 ha mantenido, con las lecturas de caché reducidas un 60% hasta $0.20 por millón. Esos son los precios publicados por Ant​hropic, leídos de la propia documentación de precios de Ant​hropic el 24 de septiembre de 2026, dos días después de que se lanzara el modelo. El precio de etiqueta es la parte fácil. Ant​hropic también afirma que el modelo cuesta "alrededor de un 40% menos de ejecutar" en cargas de trabajo típicas, y esa cifra no aparece en la hoja de precios: es una caracterización del proveedor construida a partir del recorte por token más la suposición de que el modelo consume menos tokens y menos turnos para completar el mismo trabajo. Esta página separa ambas cosas: cada tarifa que puedes verificar hoy en la hoja, y la aritmética que hay detrás de la que no puedes verificar. Claude Fable 5.1, el nivel de $10/$50 por encima de él, aparece a lo largo de todo el texto como la comparación que la propia Ant​hropic hace.

La tarifa completa, cada línea tal como Anthropic la publica

Todo en esta sección se leyó de la documentación de precios de Anthropic en platform.claude.com y claude.com el 24 de septiembre de 2026. Nada de aquí se ha tomado de otro texto.

Entrada — $4.00 por millón de tokens (tarifa publicada de Anthropic).

Salida — $20.00 por millón de tokens. Los tokens de razonamiento se facturan como tokens de salida, y el razonamiento adaptativo de Claude Opus 5.5 está siempre activado y no se puede desactivar.

Lectura de caché — $0,20 por millón de tokens. Ant​hropic lo documenta como 0,05x del precio base de entrada, su propia excepción en nota al pie para este modelo.

Escritura de caché de 5 minutos — 5,00 $ por millón de tokens, el multiplicador estándar de 1,25x sobre la entrada base que Ant​hropic aplica a todos los modelos de la hoja.

Escritura en caché de 1 hora — $8.00 por millón de tokens, el multiplicador estándar de 2x sobre la entrada base.

Batch API — 50% de descuento en ambas direcciones: $2.00 de entrada y $10.00 de salida por millón. Ant​hropic publica las cifras con descuento directamente en lugar de dejar que las dividas por la mitad.

Modo rápido — $8.00 de entrada y $40.00 de salida por millón, exactamente 2 veces el estándar. La documentación de Ant​hropic titula la página "Modo rápido (vista previa de investigación)".

Inferencia solo en EE. UU. — un multiplicador de 1.1x en entrada, salida, escrituras de caché y lecturas de caché cuando inference_geo: "us" está establecido. El enrutamiento global, el predeterminado, usa precios estándar.

Contexto y límite de salida — 1M de tokens de contexto y 128K de salida síncrona con precios estándar, sin recargo por contexto largo. Anthropic afirma que una solicitud de 900k tokens se factura a la misma tarifa por token que una de 9k. En la API por lotes, el límite de salida asciende a 300K con la output-300k-2026-03-24cabecera beta.

Ant​hropic también afirma que los multiplicadores de caché «se acumulan con otros modificadores de precios, como el descuento de Batch API y la residencia de datos», de modo que una solicitud por lotes, en caché y fijada a EE. UU. multiplica los tres, y la aritmética se compone en lugar de reemplazar.

Esto es lo que realmente sopesan los lectores de los dos modelos respecto al costo en la misma hoja:

Claude Opus 5 — $5.00 de entrada, $25.00 de salida, $0.50 por lectura de caché, $6.25 por una escritura de caché de 5 minutos, $10.00 por una escritura de 1 hora, $2.50/$12.50 en Batch (tarifas publicadas de Anthropic, consultadas el 2026-09-24).

Claude Fable 5.1 — $10.00 de entrada, $50.00 de salida, $0.25 por lectura de caché, $12.50 por escritura de caché de 5 minutos, $20.00 por escritura de 1 hora, $5.00/$25.00 en Batch (tarifas publicadas de Ant​hropic, consultadas el 2026-09-24).

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

La línea de caché es donde realmente se decide la factura de un agente.

La cobertura de lanzamiento trata la lectura de caché como una nota al pie. Es la palanca individual más grande de la hoja para cualquier carga de trabajo que reenvíe un prefijo grande, que es la mayoría de las cargas de trabajo de programación y de agentes.

La propia nota al pie de Ant​hropic es inusualmente explícita sobre las proporciones: los aciertos y refrescos de caché cuestan 0,1x el precio base de entrada en la mayoría de los modelos Claude, 0,025x en Claude Fable 5.1, y 0,05x en Claude Opus 5.5. Así que la proporción de caché de Claude Opus 5.5 es el doble de mala que la estándar, y el doble de mala que la de Claude Fable 5.1.

En dólares gana de todos modos, y esta es la parte que vale la pena interiorizar: un mejor multiplicador no gana en dólares cuando la tasa base es dos veces y media más alta.

• Claude Fable 5.1 — el 2,5 % de una base de $10,00 es $0,25 por millón de tokens en caché.

• Claude Opus 5.5 — el 5 % de una base de $4.00 es $0.20 por millón de tokens en caché.

• Claude Opus 5 — el 10 % de una base de $5,00 es $0,50 por millón de tokens en caché.

La misma relación invertida se mantiene en las escrituras. Claude Fable 5.1 cobra $12.50 por escribir un millón de tokens en la caché de 5 minutos y $20.00 por la ventana de 1 hora; Claude Opus 5.5 cobra $5.00 y $8.00. Las lecturas de caché son el único apartado en el que Claude Opus 5.5 supera a sus dos hermanos en dólares absolutos a pesar de tener la proporción intermedia.

Dos reglas deciden si vale la pena pagar por la escritura en absoluto. La documentación de Ant​hropic dice que una escritura de 5 minutos cuesta 1,25 veces la entrada base y, por lo tanto, se amortiza tras una sola lectura de caché, mientras que una escritura de 1 hora cuesta 2 veces la entrada base y necesita dos lecturas para amortizarse. Y la caché está vinculada al prefijo que la produjo: Ant​hropic señala que cambiar entre velocidad rápida y estándar invalida la caché, porque las solicitudes a diferentes velocidades no comparten prefijos en caché. Cambiar el modelo, el nivel de esfuerzo o las definiciones de herramientas tiene el mismo efecto. Un modelo más barato que obliga a reescribir el prefijo en cada cambio puede costar más que el modelo caro al que reemplazó.

Lo que realmente cuesta un bucle de agente largo

Toma un agente de programación de 40 turnos que reenvía un prefijo de 120.000 tokens —prompt del sistema, esquemas de herramientas, árbol de archivos— en cada turno, añade 1.000 tokens de entrada nuevos por turno a partir de los resultados de las herramientas y genera 800 tokens de salida por turno. La sustitución es lo importante aquí: cambia cualquiera de esos cuatro números para que coincida con tu propio tráfico y la aritmética que aparece a continuación sigue siendo válida.

Sobre Claude Opus 5.5:

• Escritura en caché, una vez — 120,000 tokens a $5.00 por millón = $0.60

• Lecturas de caché, 39 turnos — 4.680.000 tokens a $0,20 por millón = $0,94

• Entrada nueva, 40 turnos — 40.000 tokens a $4,00 por millón = $0,16

• Salida, 40 turnos — 32.000 tokens a $20,00 por millón = $0,64

Total de la sesión — $2.34, de los cuales las lecturas de caché representan aproximadamente el 40%.

En Claude Opus 5, con recuentos de tokens idénticos: $0,75 de escritura en caché, $2,34 de lecturas de caché, $0,20 de entrada nueva y $0,80 de salida — $4,09.

En Claude Fable 5.1, con recuentos de tokens idénticos: $1.50 de escritura en caché, $1.17 de lecturas de caché, $0.40 de entrada nueva y $1.60 de salida — $4.67.

Mismos tokens, mismos turnos, sin necesidad de alegar ninguna eficiencia: Claude Opus 5.5 queda un 43 % por debajo de Claude Opus 5 y un 50 % por debajo de Claude Fable 5.1. Y 1,40 $ de los 1,75 $ de diferencia frente a Claude Opus 5 — el ochenta por ciento del ahorro — procede únicamente de la línea de lectura de caché, no de la tarifa de entrada principal.

Ahora prueba la forma opuesta: una llamada de un solo disparo con 20.000 tokens de entrada y 8.000 de salida, sin caché. Claude Opus 5.5 cuesta $0,08 de entrada más $0,16 de salida — $0,24. Claude Opus 5 cuesta $0,10 más $0,20 — $0,30. Eso es exactamente el recorte del 20 % sobre el precio anunciado, y ni un punto más.

Así que la tarjeta de tarifas por sí sola ofrece entre un 20 % y un 43 %, según cuánta parte de tu factura corresponda a lecturas de caché. Cualquier afirmación por encima de ese rango proviene de los recuentos de tokens, no de los precios.

De dónde viene el "aproximadamente un 40% más barato de ejecutar" de Anthropic

El material de lanzamiento de Anthropic dice que Claude Opus 5.5 "requiere menos cómputo para servir que Opus 5" y que sus pruebas muestran que "costará un 40% menos que Opus 5 en cargas de trabajo típicas" con la configuración predeterminada. El desglose que da Anthropic es que el modelo "cuesta menos por token que Opus 5 y usa menos tokens por tarea, lo que se traduce en una caída del 40% en los costos".

Llama a eso por lo que es: una caracterización por parte del proveedor de un promedio entre cargas de trabajo que Anthropic seleccionó, no un resultado auditado ni una tarifa publicada en la hoja de precios. La mitad verificable es la primera: 20 % de descuento en entrada y salida, 60 % de descuento en lecturas de caché, ambos se pueden leer en la hoja hoy. La segunda mitad depende de que el modelo gaste menos tokens y menos turnos en tu carga de trabajo, lo cual solo se puede comprobar ejecutándola.

La evidencia que Anthropic ofrece para la mitad de tokens es un conjunto de declaraciones de clientes del momento del lanzamiento. Todas las siguientes están publicadas por el proveedor y describen cargas de trabajo que el proveedor y sus clientes eligieron:

Box — el modelo "usó un tercio de los tokens que usó Opus 5", con respuestas "un 40% menos verbosas sin perder precisión".

Kiro — "resolvió más que Opus 5 a la vez que realizaba alrededor de un 40 % menos de llamadas y usaba la mitad de los tokens".

Factory — igualó a Opus 5 en esfuerzo alto, usando entre un 20 y un 25 % menos de tokens de salida.

GitHub — «utilizó uno de los menores números de tokens y pasos que medimos», y en VS Code «resolvió más tareas de terminal que Opus 5 en menos de la mitad de los pasos».

Análisis de fusiones, un ejemplo resuelto — dos empresas ficticias de software de RR. HH., cada modelo elaborando un modelo de Excel y una presentación ejecutiva. Anthropic informa de que Claude Opus 5.5 terminó en 63 minutos frente a los 93 de Claude Opus 5 y «costó un 50 % menos producir». Reportado por el proveedor, n=1.

El contrapeso independiente importa aquí, porque apunta en sentido contrario. Artificial Analysis midió Claude Opus 5.5 con el máximo esfuerzo en aproximadamente 119.000 tokens de salida por tarea del Intelligence Index, frente a aproximadamente 73.000 para Claude Opus 5 con el máximo esfuerzo — el recuento de tokens va hacia arriba, no hacia abajo. Su resumen de esa configuración es que Claude Opus 5.5 está "a la par con Opus 5 en coste por tarea a pesar de 1,6 veces los tokens de salida", con un coste publicado de 5,98 $ por tarea del Intelligence Index. Es una medición independiente con el máximo esfuerzo, y no es una contradicción de la afirmación de Anthropic — es el otro extremo de la escala de esfuerzo.

Lo que nos lleva a la advertencia que rige cada número de esta sección. Anthropic afirma que, salvo que se indique lo contrario, todos sus resultados de Claude Opus 5.5 usan pensamiento adaptativo con esfuerzo máximo. Claude Opus 5.5 usa por defecto un esfuerzo medio, y Claude Opus 5 usaba por defecto un esfuerzo alto, y el mismo nivel con el mismo nombre no es el mismo presupuesto de pensamiento en los dos modelos. Así que una tabla del proveedor ejecutada con esfuerzo máximo y una tabla independiente ejecutada con esfuerzo máximo con el mecanismo de reserva predeterminado habilitado no son la misma configuración, y tampoco lo es la configuración predeterminada que un lector realmente implementaría. Un promedio del 40% medido en un conjunto seleccionado de cargas de trabajo, con ajustes que puede que no uses, es una hipótesis inicial — no una línea presupuestaria.

El modo rápido es una vista previa de investigación, no un nivel.

El modo rápido en Claude Opus 5.5 cuesta $8.00 por millón de tokens de entrada y $40.00 por millón de tokens de salida — exactamente el doble del precio estándar — para obtener hasta 2,5 veces más tokens de salida por segundo. No mejora el tiempo hasta el primer token; la ganancia está en la velocidad de salida, y es más visible con streaming.

Dilo claro, porque es fácil presupuestar esto como si fuera un nivel cuando no lo es. Ant​hropic etiqueta el modo rápido como una vista previa de investigación. El acceso se solicita a través de un account manager o de la lista de espera. Requiere el fast-mode-2026-02-01 encabezado beta y speed: "fast" en la solicitud. Solo está disponible en la Claude API, no en Amazon Bedrock, Goo​gle Cloud, Microsoft Foundry ni Claude Platform on AWS. No se puede combinar con la Batch API ni con un compromiso de Priority Tier. Sí se acumula con el prompt caching y los multiplicadores de residencia de datos, así que una solicitud en caché con modo rápido y fijada en EE. UU. paga 1.1x sobre 2x. Y cambiar una carga de trabajo entre velocidad rápida y estándar invalida la caché de prompts, lo que en un bucle de agente largo puede costar más de lo que ahorra la velocidad.

Claude Opus 5 y Claude Opus 4.8 también admiten el modo rápido, a $10.00/$50.00. Claude Opus 4.7 rechaza el parámetro de plano.

La unidad que decide la factura es el costo por tarea terminada

Cada una de las tarifas anteriores es un precio por token. Nadie compra tokens. Un precio por token solo se convierte en un costo cuando se multiplica por los tokens que consume una tarea y por la cantidad de intentos que se necesitan para terminarla.

Haz las cuentas del ejemplo de caché ligera de antes. A $0.24 por pasada, un modelo que termina una tarea al primer intento cuesta $0.24. La misma tarea en un competidor a $0.30 por pasada cuesta $0.30, así que el modelo más barato parece llevar un 20% de ventaja. Ahora supongamos que el modelo más barato necesita 1.2 pasadas por tarea terminada, lo cual es una tasa de éxito generosa para trabajo de agentes: 1.2 × $0.24 son $0.288, frente a $0.30 de la alternativa de una sola pasada. El ahorro desapareció. Con tres pasadas son $0.72, y el modelo que parecía un 20% más barato por token es un 140% más caro por trabajo terminado.

Por eso las propias afirmaciones de eficiencia de Ant​hropic —menos tokens, menos llamadas, menos pasos— se enmarcan en la unidad correcta. También es la razón por la que ninguna de ellas debería tomarse como una partida presupuestaria hasta que las hayas reproducido. La comprobación es mecánica: precio por pasada, multiplicado por las pasadas por tarea finalizada, medido sobre tu propio tráfico. Ambos números tienes que generarlos tú, y ningún proveedor publica el segundo para tu carga de trabajo.

Si quieres un único punto de referencia externo al proveedor, Artificial Analysis sitúa a Claude Opus 5.5 en 5,98 $ por tarea del Intelligence Index en su configuración de máximo esfuerzo — una cifra independiente correspondiente a un ajuste que la mayor parte del tráfico de producción no utilizará, útil como techo y no como pronóstico.

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

Líneas que la tarifa anunciada no incluye

Residencia.La inferencia solo en EE. UU. es de 1,1x en todas las categorías de tokens, incluidas las lecturas y escrituras de caché. Se acumula con el modo rápido y con el descuento de Batch.

Definiciones de herramientas. Ant​hropic publica una sobrecarga del prompt de sistema de uso de herramientas por modelo: declarar herramientas añade 286 tokens a cada solicitud de Claude Opus 5.5. Es poco a $4.00 por millón, pero se cobra por solicitud, y un bucle de agente hace muchísimas solicitudes.

Invalidación de caché. Un prefijo que se reescribe tras un cambio de modelo, esfuerzo, definición de herramienta o velocidad se factura a la tarifa de escritura —5,00 $ u 8,00 $ por millón en Claude Opus 5.5—, no a la tarifa de lectura de 0,20 $.

El modelo que figura debajo. Claude Sonnet 5 se sitúa en $2.00 por millón de tokens de entrada y $10.00 por millón de tokens de salida, lo que la nota al pie de precios de Anthropic confirma que ahora es el precio estándar en lugar de la tarifa introductoria con la que se anunció. Claude Opus 5.5 es exactamente 2x Sonnet 5 en ambas direcciones.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

Llamar a Claude Opus 5.5 al precio de lista de Anthropic

Claude Opus 5.5 está en OrcaRouter en anthropic/claude-opus-5.5 por $4.00 de entrada y $20.00 de salida por millón — el precio de lista de la propia Anthropic, transferido con 0% de recargo. Esa transferencia merece declararse con precisión en una página de precios: como la tarifa del proveedor se reenvía en lugar de almacenarse en caché en una tabla, un cambio de tarifa del proveedor se refleja aquí el mismo día en que se publica, no después de una ventana de sincronización. Si Anthropic mueve esta hoja, el número al que llamas se mueve con ella.

La misma clave llega a los niveles con los que esta página la compara — anthropic/claude-opus-5 a $5.00/$25.00 y anthropic/claude-fable-5.1 a $10.00/$50.00 — junto con el resto de la línea Claude y más de otros 200 modelos, así que comprobar si la tarifa por token más barata sobrevive al contacto con sus propios recuentos de pases no requiere un segundo contrato ni un cambio de código. La conmutación por error automática está ahí para el caso en que quiera ejecutar un modelo desconocido en una ruta de producción sin apostar la ruta a él.

La respuesta en dos líneas sobre de qué trata esta página: la tabla de tarifas es $4.00 de entrada, $20.00 de salida y $0.20 por millón de lecturas en caché, y el recorte del 20 % es real y verificable hoy. El 40 % es el promedio de Ant​hropic entre las cargas de trabajo que seleccionó. Ejecuta uno de tus propios bucles de agentes a través de él antes de hacer tu presupuesto con el segundo número.

Comparados en este artículo3

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario