Se generó una tarjeta de título principal para Claude Sonnet 5.5 vs Claude Sonnet 5, con el subtítulo «Precios idénticos, facturas diferentes», que muestra $2.00 y $10.00 por millón de tokens en ambos lados, con una cifra divergente de costo por tarea debajo, y el logotipo de OrcaRouter compuesto en la esquina inferior derecha.
Guides & Insights

Claude Sonnet 5.5 vs Claude Sonnet 5: Precios idénticos, facturas diferentes

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Dos modelos del mismo proveedor, del mismo nivel, con el mismo nombre y —en cada línea de la lista de precios publicada— el mismo precio. Claude Sonnet 5 se lanzó el 30 de junio de 2026 a $2.00 por millón de tokens de entrada y $10.00 por millón de tokens de salida. Claude Sonnet 5.5 alcanzó la disponibilidad general el 28 de septiembre de 2026 a $2.00 y $10.00, con lecturas de caché a $0.20 y escrituras de caché de cinco minutos a $2.50 en ambos. Nada del precio cambió. Lo que cambió es todo lo que una hoja de precios no mide, y el resultado es que uno de estos dos modelos es sustancialmente más barato de operar que el otro a pesar de costar exactamente lo mismo por token. El propio titular de Anthro​pic para el lanzamiento dice tanto sin decirlo del todo: hasta un 30% menos de coste para la mayoría del trabajo, con una tarifa sin cambios. La única forma en que ambas frases sean verdaderas es que el modelo más nuevo termine el mismo trabajo con menos tokens, que es lo que muestran los benchmarks y lo que confirman las cifras independientes por tarea.

¿Es Claude Sonnet 5.5 más caro que Claude Sonnet 5?

No — y, de todos modos, vale la pena tomar en serio la pregunta, porque muchísimas migraciones han salido mal por tratar una tarjeta de tarifas planas como una factura plana.

Por token, los dos modelos son idénticos: $2.00 de entrada, $10.00 de salida, $0.20 por leer un token en caché y $2.50 por escribir uno. No hay tramos escalonados ni recargo por contexto largo. Sea cual sea el modelo más reciente, no es un aumento de precio disfrazado de nueva generación.

Por cada tarea completada, la imagen se invierte según de quién sea la carga de trabajo que se esté describiendo. Artificial Analysis informa un costo de 5,09 $ por tarea para Claude Sonnet 5 y 7,60 $ por tarea para Claude Sonnet 5.5 en la misma suite Intelligence Index v4.3 —el modelo más nuevo es un 49 % más caro para completar una tarea con él, a una tarifa idéntica—. El mismo informe señala que Sonnet 5.5 emitió 410 millones de tokens en toda la suite, frente a los 370 millones de Sonnet 5, y ambos frente a una mediana de 88 millones para el conjunto monitoreado. En los prompts abiertos del evaluador, el modelo más nuevo simplemente escribe más y, a precios iguales, más tokens significa una factura más alta.

La afirmación de Anthropic de que es un 30 % más barato es una afirmación de proveedor sobre sus propias cargas de trabajo elegidas. La medición de terceros, 7,60 $ frente a 5,09 $, corresponde a un conjunto diferente. Ninguna de las dos es incorrecta; la discrepancia es toda la historia, y el factor decisivo es si tus tareas limitan su propia salida.

Lo que realmente se movió entre las dos generaciones

La tarjeta de tarifas es estática; el modelo no. Expuestos en una sola lista, los deltas son grandes y en su mayoría unidireccionales.

• Terminal-Bench 4.0 — 70,6 % para Claude Sonnet 5.5 frente a 10,3 % para Claude Sonnet 5, el mayor salto de una sola generación que Anthropic ha publicado en esta prueba

• CursorBench 4.0 — 55,5 % frente a 34,1 %

• Cartografía, sin herramientas — 61,6 % frente a 15,6 %

• GDPval-AA v2.1 — 1844 frente a 1449

• AA-Briefcase v1.1 — 1811 contra 1359

• Humanity's Last Exam, con herramientas — 64,5% frente a 54,9%

• OSWorld 2.1, finalización parcial — 80,1 % frente a 57,0 %

• Artificial Analysis Intelligence Index v4.3 — 56 frente a 38, una diferencia de dieciocho puntos en una escala de terceros medida bajo la misma configuración "Adaptive Reasoning, Max Effort"

La forma de esa lista no es un progreso uniforme. Que Chartography pase del 15,6 % al 61,6 % y Terminal-Bench del 10,3 % al 70,6 % parece indicar capacidades que estaban ausentes y ahora están presentes, no capacidades que mejoraron. Que Humanity's Last Exam suba diez puntos y OSWorld veintitrés puntos a un precio sin cambios es el patrón de una generación que cerró brechas específicas en lugar de una que se volvió más inteligente en general. La brecha de dieciocho puntos en el índice es el promedio aritmético de eso: real, grande y concentrada en el uso de herramientas, la ejecución de código y el trabajo visual.

Una nota al pie es importante para cualquiera que lea atentamente la tabla de proveedores. Anthropic afirma que, en FrontierCode, la configuración de esfuerzo Max obtiene una puntuación inferior a la de Xhigh, y señala que las ejecuciones de GDPval-AA y AA-Briefcase se realizaron en una implementación previa al lanzamiento que contenía un error de salidas estructuradas. Las cifras anteriores siguen siendo las mejores disponibles, pero considérelas una instantánea de una implementación concreta, no una propiedad permanente del modelo.

¿Por qué el precio es igual y la cuenta no?

Tres mecanismos, en orden descendente según cuánto mueven una factura real.

La primera es la disciplina en la longitud de la salida. Sonnet 5.5 es un agente más capaz, lo que significa que hace más antes de responder y, en una suite sin restricción de longitud, escribe aproximadamente un 11 % más que Sonnet 5, aunque cuesta lo mismo por token. En una carga de trabajo que limita la salida —extracción a un esquema fijo, clasificación, resúmenes acotados—, ese 11 % nunca se materializa y la afirmación del 30 % se vuelve creíble, porque la ganancia consiste en llegar a la respuesta en menos turnos, no en menos tokens por turno.

El segundo es el comportamiento de la caché, y es la razón por la que un precio de lectura de caché sin cambios no significa un coste de caché sin cambios. Las lecturas y escrituras de caché tienen el mismo precio en ambos modelos, por lo que cualquier cambio en el volumen de tokens en caché se traslada directamente a la factura. Un modelo que necesita menos turnos para completar una tarea agéntica lee su prefijo menos veces. Eso es un ahorro sin ningún movimiento de precio detrás, y es invisible en toda tabla comparativa que solo enumere líneas de tarifas.

El tercero es el que la mayoría de los equipos hace mal el día de la migración: el valor predeterminado de effort. Claude Sonnet 5.5 configura el razonamiento mediante un parámetro effort con ajustes low, medium, high, xhigh y max, y de forma predeterminada usa high en Claude Platform y medium dentro de las aplicaciones de Claude. Si migraste desde una implementación de Sonnet 5 en la que habías fijado un presupuesto de razonamiento, el nuevo valor predeterminado puede tener una profundidad distinta de la que estabas pagando. Mide antes de asumir un ahorro o un aumento.

También hay una consecuencia de comportamiento que conviene señalar antes del despliegue y no después. Anthropic afirma que Claude Sonnet 5.5 es el primer Sonnet que se lanza con salvaguardas cibernéticas y mecanismos de respaldo al mismo nivel que sus modelos de gama alta, por lo que las solicitudes de ciberseguridad de mayor riesgo retroceden visiblemente al Sonnet anterior. Tus registros mostrarán un modelo que no solicitaste. En relación con esto, si ejecutas Sonnet con el pensamiento desactivado, debes cambiar a un comportamiento entre herramientas —un cambio de código, no una bandera.

En OrcaRouter, anthropic/claude-sonnet-5 es enrutable hoy con una sola credencial al precio de lista del proveedor con un 0% de recargo, junto con Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro y Gemini 3.1 Pro Preview. Claude Sonnet 5.5 en sí todavía no es una ruta en nuestra plataforma, por lo que la forma práctica de esta comparación en este momento es que un equipo que ya ejecuta Sonnet 5 puede medir el delta el día en que se liste sin tocar una clave de API, y puede conmutar entre niveles en caso de fallo mientras tanto cambiando una cadena.

Preguntas que la gente hace antes de cambiar

¿Puedo ejecutar ambos a la vez y compararlos con mi propio tráfico? Todavía no mediante una sola credencial de OrcaRouter, ya que Claude Sonnet 5.5 no es una ruta listada. La solución alternativa es ejecutar el modelo más nuevo en la propia API de Anthropic y el más antiguo a través de nosotros, y luego comparar tokens por tarea completada en lugar de coste por token, porque esa es la cifra en la que los dos modelos realmente difieren.

¿Que el precio no haya cambiado significa que Anthropic no está cobrando por la nueva capacidad?Significa que el precio de lista se mantiene sin cambios mientras el modelo mejora, que es el mismo patrón que en las dos generaciones anteriores de Sonnet. Que eso persista es una cuestión comercial, no técnica, y la ventana de retirada publicada —no antes de septiembre de 2027— es el único compromiso asociado.

¿En qué cifra debería confiar, en el 30 % de Anthropic o en el 49 % de terceros?En ninguna de las dos como afirmación general. La cifra de Anthropic describe cargas de trabajo en las que el modelo llega a una respuesta en menos turnos; la cifra de Artificial Analysis describe un conjunto de índices sin restricciones en el que la verbosidad puede crecer libremente. Elija la que se parezca a su conjunto de prompts y, si no puede determinar cuál es, esa ambigüedad es en sí misma la respuesta: mídala.

En resumen

Claude Sonnet 5.5 no es un aumento de precio, pero tampoco es automáticamente un ahorro. Anthropic mantuvo sin cambios cada línea de la lista de tarifas y trasladó el modelo a esa misma estructura, lo que significa que todo el argumento económico depende de los tokens por tarea completada: una cifra que es un 30 % mejor en las cargas de trabajo que eligió el proveedor y un 49 % peor en el conjunto de pruebas que eligió un evaluador independiente. Si tus tareas acotan su propia salida, cambia y aprovecha la ventaja. Si no lo hacen, el precio plano no es una razón para omitir la medición, porque puedes pagar un 50 % más por tarea por un modelo que es inequívocamente mejor en el trabajo.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Sonnet 5 across eight rows. Both columns carry the identical rate card: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output. The rows that differ are AA Intelligence Index v4.3 score 56 for Claude Sonnet 5.5 against 38 for Claude Sonnet 5, $7.60 per task on the index run against $5.09, and Terminal-Bench 4.0 (vendor) 70.6% against 10.3%. The card heading reads "Identical rate cards, different bills: Claude Sonnet 5.5 against Claude Sonnet 5", and a footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Every price line is a tie by design: the two models share one rate card and differ only in what they emit to finish the same task."Screenshot of the OrcaRouter model page for Anthropic Claude Sonnet 5 (anthropic/claude-sonnet-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.24-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-06-30" line, and the $2.00 input and $10.00 output prices per million tokens.Screenshot of Anthropic's newsroom page for Claude Sonnet 5.5, showing the site navigation bar, the publication date September 28, 2026, the model heading "Claude Sonnet 5.5", and an image-led marketing hero beneath it that carries no machine-readable specification figures.