Una tarjeta de título generada para Claude Opus 5.5 vs Claude Sonnet 5, subtitulada 'La mitad del precio, veinte puntos de índice, cinco meses de punto ciego', con tres iconos de línea planos (una marca de base de datos apilada, un gráfico de barras ascendente y un calendario con un reloj) y una línea de pie de página que dice 'Índice según Artificial Analysis al máximo esfuerzo; precios según Anthropic.' El logotipo real de OrcaRouter se compone en la esquina inferior derecha.
Guides & Insights

Claude Opus 5.5 vs Claude Sonnet 5: la mitad del precio, veinte puntos de índice y un punto ciego de cinco meses

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Si solo quieres la regla: usa Claude Sonnet 5 de forma predeterminada y escala a Claude Opus 5.5 cuando una tarea falla, porque el modelo más barato cuesta realmente la mitad y realmente pertenece a una clase de capacidad distinta. Los dos números que respaldan esto son 38 y 58 —las puntuaciones de Sonnet 5 y Opus 5.5 en el Artificial Analysis Intelligence Index, con el mismo evaluador, en la misma familia de configuración. Una diferencia de veinte puntos en ese índice no es un desempate, y es la mayor separación en cualquier enfrentamiento entre Claude y Claude que se pueda construir actualmente: Claude Opus 5.5 ocupa el puesto n.º 1 de 210 modelos y Claude Sonnet 5 ocupa el puesto n.º 54, y la diferencia de precio entre ellos es de $2 por millón de tokens de entrada.

Esa es la mitad fácil. La mitad difícil es que escalar de forma selectiva requiere saber qué tareas fallan, y los dos modelos discrepan sobre el mundo después de enero de 2026 de un modo que ninguna evaluación sacará a la luz como error.

La diferencia de veinte puntos, en contexto

A two-column scoreboard comparing Claude Opus 5.5 and Claude Sonnet 5 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 38, ranked #54), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), default effort (medium against high), knowledge cutoff (Jun 2026 against Jan 2026), output speed (not yet published against 79.3 tokens per second) and cache read ($0.20 per million on both). The footer reads 'Index and speed figures per Artificial Analysis at max effort; prices, effort defaults and cutoffs per Anthropic.'

Artificial Analysis ejecuta cada modelo en una configuración publicada, y estos dos comparten una etiqueta de familia — «Razonamiento adaptativo, esfuerzo máximo» —, lo que hace que la comparación sea inusualmente limpia:

• Índice de Inteligencia — Claude Opus 5.5 58, clasificado n.º 1 de 210 frente a Claude Sonnet 5 38, clasificado n.º 54

• Precio — Claude Opus 5.5 $4.00 entrada / $20.00 salida por millón vs Claude Sonnet 5 $2.00 / $10.00

• Velocidad de salida — Claude Sonnet 5 79,3 tokens/seg vs Claude Opus 5.5, aún no publicado en la tabla

• Tiempo hasta el primer token — Claude Sonnet 5 150,02 s frente a una mediana de la comparativa de 3,83 s

• Esfuerzo predeterminado — Claude Opus 5.5 medio vs Claude Sonnet 5 alto

• Fecha de corte de conocimiento — junio de 2026 para Claude Opus 5.5 vs enero de 2026 para Claude Sonnet 5

• Contexto y salida — contexto de 1M y salida máxima de 128K en ambos

La columna de clasificación es la parte que merece una pausa. Veinte puntos de índice no son cuatro puestos en una tabla de posiciones; son cuarenta y nueve. En una tabla de 210 modelos, Opus 5.5 y Sonnet 5 no son vecinos con una diferencia de precio: están en bandas distintas, y la brecha de $2 por millón compra un salto real de capacidad, no una insignia. Quien haya leído la cobertura de esta semana como «Anthropic lanzó un Opus más barato» y haya asumido que el nivel Sonnet lo absorbió debería fijarse en ese par de puestos: la propia página de precios de Anthropic sigue incluyendo Claude Sonnet 5 como producto vigente, y su posición en la tabla independiente no se ha movido.

Dos salvedades mantienen esto honesto. Ambas puntuaciones se ejecutaron con el máximo esfuerzo, y el valor predeterminado de lanzamiento de ninguno de los dos modelos es el máximo: Sonnet 5 usa por defecto high, y Opus 5.5, medium. Y las filas de velocidad complican la historia a favor de Sonnet 5: 79,3 tokens por segundo con un primer token de 150 segundos es un perfil de latencia real y medido, y es el único de los dos que existe en la tabla. Artificial Analysis no ha publicado la velocidad ni la latencia de Opus 5.5, lo que significa que la afirmación de «más rápido» en este enfrentamiento actualmente se apoya en material del proveedor y no en una medición.

La nota al pie que cambia el precio de Sonnet 5

Lo más concreto que ha salido del último mes para Claude Sonnet 5 es una frase que la mayoría de la cobertura omitió. Cuando el modelo se lanzó el 30 de junio de 2026, su tarifa de $2 / $10 se anunció como precio introductorio hasta el 31 de agosto, con un aumento programado a $3 / $15 el 1 de septiembre. En la página de precios actual de Anthropic, la nota al pie dice que el precio de $2/$10 "ahora es el precio estándar" y que el aumento "no se producirá".

Eso importa por dos razones. La obvia es que un aumento del 50 % que se anunció y luego se canceló es una partida de costes en la que ahora puedes basar tu planificación — Sonnet 5 no es una tarifa promocional para la que tengas que modelar un vencimiento. La menos obvia es que corrige la aritmética del escalado. Con Sonnet 5 permanente a $2/$10 y Opus 5.5 a $4/$20, la proporción entre los dos niveles es exactamente 2x en ambos sentidos, y es estable. Una regla de escalado que envíe, por ejemplo, una quinta parte de tu tráfico a Opus 5.5 tiene un coste que puedes calcular una vez y dejar de recalcular.

Las tarifas de lote y de caché se mueven juntas, y eso es lo que hace útil la comparación de toda la tabla: Sonnet 5 en modo lote cuesta $1.00 / $5.00 frente a los $2.00 / $10.00 de Opus 5.5, y ambos cobran las lecturas de caché a $0.20 por millón. Esa última cifra es un empate real: Opus 5.5 redujo su lectura de caché de $0.50 a $0.20, y Sonnet 5 ya estaba en ese precio. Si tu carga de trabajo se basa sobre todo en releer un contexto grande en caché en lugar de generar resultados nuevos, la ventaja de precio del modelo más barato es mucho menor de lo que sugiere la proporción anunciada, porque la única línea en la que coinciden es la línea en la que más gastas.

El corte es la parte que falla en silencio.

A generated two-card graphic titled 'Knowledge cutoffs, five months apart', showing Claude Sonnet 5 with a knowledge cutoff of January 2026 against Claude Opus 5.5 with a cutoff of June 2026, separated by a marker reading '5 months of coverage'. The footer reads 'Cutoff dates per Anthropic's Claude model documentation, current as of September 2026.'

Claude Opus 5.5 tiene una fecha de corte de conocimiento de junio de 2026. La de Claude Sonnet 5 es enero de 2026. Eso supone cinco meses de diferencia, y es la única dimensión en esta comparación que no se anuncia por sí sola. Un modelo que no sabe de un acontecimiento no es más lento ni menos preciso al respecto de una forma que detecte tu manejo de errores — responde con confianza desde un mundo que ha avanzado, y el fallo se parece a una respuesta incorrecta plausible en lugar de a una negativa.

Para algunas cargas de trabajo esto es irrelevante: refactorizar una base de código cuyas convenciones son estables, resumir documentos que proporcionas, transformar datos estructurados. Para otras, es descalificador por sí solo, independientemente de los veinte puntos del índice o del precio. Cualquier cosa que toque software publicado en la segunda mitad de 2026, cualquier cosa que responda preguntas sobre eventos recientes, cualquier cosa que dependa de una API o una versión de biblioteca que cambiara después de enero: esas tareas no pueden escalarse a Opus 5.5, tienen que empezar ahí. Los cinco meses no son una diferencia de calidad; son una restricción de alcance, y corresponde a la regla de enrutamiento en lugar de a la evaluación.

Ambos modelos comparten el resto de la envolvente, lo que limita hasta qué punto se puede sortear el cutoff. Ambos aceptan 1M tokens de contexto y devuelven hasta 128K, ambos ejecutan pensamiento adaptativo que no se puede desactivar, y ambos exponen profundidad solo a través del parámetro de esfuerzo. No hay ninguna configuración en la que a Sonnet 5 se le entregue un documento más largo para compensar.

Ejecutando el split

La versión práctica de esta comparación es una opción predeterminada y una excepción, y la excepción tiene que definirse por algo distinto de "tareas difíciles". El patrón que se mantiene es por clase de tarea en lugar de por dificultad: Sonnet 5 para el trabajo de alto volumen donde su fecha de corte es irrelevante y su perfil de latencia es aceptable, Opus 5.5 para cualquier cosa actual, cualquier cosa a largo plazo, o cualquier cosa donde un intento fallido cueste más que la diferencia de tokens.

Eso es una configuración de enrutamiento y no una reescritura, y es ahí donde un único endpoint se gana su lugar. Claude Sonnet 5 está en OrcaRouter a los $2.00 / $10.00 de Anthropic, y Claude Opus 5.5 está ahí a $4.00 / $20.00 — el precio de lista del proveedor trasladado tal cual con un 0 % de margen, así que la relación de costos de tu regla de escalado es la relación de costos que publica Anthropic, sin una capa de margen que la altere. Ambos están detrás de una sola clave, lo que significa que la ruta de escalado es una edición de una regla en lugar de una segunda integración, la conmutación automática por error evita que un primario que falla se lleve consigo la solicitud, y la comparación que determina tus umbrales es algo que puedes ejecutar dentro de tu propio tráfico en lugar de reconstruirla a partir de dos tablas de proveedores.

A screenshot of OrcaRouter's own model page for anthropic/claude-sonnet-5, headed 'Claude Sonnet 5' and credited to Anthropic, showing $2.00 input and $10.00 output per 1M tokens, a 1M-token context and a PERFORMANCE panel with 79.3 output tokens per second, a 150.02s time to first token and 55M output tokens over 7 days.

Quién debería moverse, y quién debería esperar

Si ya estás en Claude Sonnet 5 y está funcionando, el argumento para reemplazarlo es débil: el modelo cuesta la mitad, su tarifa ahora es permanente, y la brecha en el índice solo importa en las tareas en las que está fallando. El argumento para añadir Claude Opus 5.5 por encima es fuerte, siempre que puedas nombrar el disparador — y el disparador suele ser o bien un fallo de corte o una tarea que las ejecuciones de máximo esfuerzo de Sonnet 5 todavía hacen mal.

Si estás eligiendo tu primer modelo Claude, la respuesta está menos equilibrada de lo que la relación de precios hace parecer. Una diferencia de veinte puntos en el índice y cinco meses adicionales de conocimiento por el doble de tokens son un intercambio que la mayoría de las cargas de trabajo de producción aceptará en una minoría de llamadas y que casi ninguna aceptará en todas ellas. El error que hay que evitar en cualquiera de las dos direcciones es tratar a los dos como intercambiables y cambiar solo por el costo, porque el fallo que sigue no es una peor respuesta: es una respuesta confiada sobre un mundo que terminó en enero.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario