
Claude Sonnet 5.5: la opción predeterminada de gama media, con todas sus especificaciones
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Claude Sonnet 5.5 es el modelo de gama media de la línea Claude, lanzado el 28 de septiembre de 2026, y el precio es la razón de peso por la que merece una página: $2 por millón de tokens de entrada y $10 por millón de tokens de salida, frente a $4 y $20 de Claude Opus 5.5, el buque insignia que se lanzó seis días antes. Eso es la mitad del precio de salida por 1,62 puntos del Artificial Analysis Intelligence Index —56,00 para el modelo de gama media frente a 57,62 para el buque insignia, ambas cifras medidas por Artificial Analysis sobre la revisión v4.3.2 del índice, y no por nosotros ni por el proveedor. Por encima de ambos está Claude Fable 5.1, a $10 / $50 y 53,35 en la misma revisión: más caro que el buque insignia, y por detrás de él. Al mismo precio de catálogo de $2 / $10 que Claude Sonnet 5.5 se sitúa el modelo de OpenAI GPT-6.1 Sol, con 51,83 —417 centésimas de índice al otro lado de la línea, que es la comparación que un lector que sopesa la gama media realmente tiene que hacer.
Esta página es una referencia, y las fechas indican el porqué, no la frescura. Claude Sonnet 5.5 cumple diez días el 2026-10-08, lo que lo sitúa fuera de la ventana de siete días en la que este blog publica noticias. Lo que sí está dentro de esa ventana es un acontecimiento de hace seis días: dos publicaciones en X con fecha 2026-10-02 que afirman que un modelo sucesor de esta familia supera a un rival que su propio proveedor terminó y retuvo. Esa afirmación no tiene ningún id de modelo, ninguna tarifa, ninguna ventana de contexto ni ningún benchmark que la respalde en ningún registro accesible desde aquí, y no es el tema de esta página — la cadena de fuentes, la verificación de ausencia en las superficies del proveedor y la dispersión del índice de cinco modelos son propiedad exclusiva del artículo que este blog ya publicó bajo el título Claude Fable 5.5 venció a GPT-6.1 Astra antes de existir — y esa es la parte interesante, fechado el 2026-10-03. Lo que esa afirmación sí produjo es una cola de lectores preguntando en qué modelo de Claude ya disponible estandarizarse mientras esperan, y esa pregunta necesita una página sobre el modelo que existe. Esta es.
¿Qué se lanzó el 28 de septiembre de 2026?
La documentación del propio proveedor proporciona la especificación directamente, y es una continuación del nivel en lugar de una nueva forma. Todo lo que aparece a continuación se leyó de la documentación de Claude Platform de Anthropic el 2026-10-08, por lo que es la especificación de Anthropic, no una prueba independiente de ella.
• Publicado — 28 de septiembre de 2026. La propia página de documentación del modelo comienza con la frase «Lo último. Publicado el 28 de septiembre de 2026.»
• Posicionamiento — «La mejor combinación de velocidad e inteligencia», con la latencia comparativa indicada como Rápida frente a Moderada para Claude Opus 5.5, Más lenta para Claude Fable 5.1 y La más rápida para el nivel pequeño.
• ID de modelo — claude-sonnet-5-5 en la API de Claude, Google Cloud, Microsoft Foundry y Claude Platform on AWS; anthropic.claude-sonnet-5-5 en Amazon Bedrock. Cada ID de modelo de Claude es una instantánea fijada, así que la cadena no es un puntero que se desplace bajo tus pies.
• Contexto y salida — 1.000.000 de tokens de contexto y 128.000 tokens de salida sincrónica en la Messages API, que aumentan a 300.000 tras el encabezado beta output-300k-2026-03-24 en la Message Batches API.
• Thinking — adaptativo, siempre activado por defecto, con un esfuerzo predeterminado de alto. El ajuste más bajo es between_tools, que desactiva el pensamiento previo y se acepta en alto esfuerzo o inferior. Establecer temperature, top_p o top_k a cualquier valor que no sea su predeterminado devuelve un error 400, por lo que una solicitud migrada desde un modelo Claude anterior con una temperatura ajustada fallará ruidosamente en lugar de silenciosamente.
• Fecha límite del conocimiento — junio de 2026, tanto para el límite fiable como para el límite de los datos de entrenamiento.
• Ciclo de vida — Activo (la versión más reciente), con un compromiso de retirada no antes del 28 de septiembre de 2027 en las plataformas que opera Anthropic. Amazon Bedrock y Google Cloud establecen sus propias fechas.
Vale la pena citar el planteamiento de lanzamiento del proveedor porque es una afirmación, no una medición: el anuncio de Anthropic describe Claude Sonnet 5.5 como «una mejora clara respecto de Sonnet 5 que se ejecuta un 30 % más rápido y cuesta hasta un 30 % menos para la mayoría del trabajo». Esa frase es del proveedor, no la hemos reproducido nosotros, y es el tipo de afirmación que depende por completo del trabajo que le pongas delante. También hay un costo de migración asociado con la versión, y esta página no es el lugar para tratarlo: cinco cambios que rompen la compatibilidad afectan al código que ya se ejecuta en Claude Sonnet 5, y un sexto altera la forma de la respuesta sin que falle ninguna solicitud. Ese desglose corresponde al artículo sobre el despliegue que este blog publicó la semana del lanzamiento, y es lo primero que hay que leer si hoy tienes Sonnet 5 en producción.

Los 1.62 puntos, y la mitad de precio
Las puntuaciones independientes de este modelo proceden de un único lugar, y conllevan un número que decide la discusión. Artificial Analysis mide Claude Sonnet 5.5 en 56.00 en su Intelligence Index, revisión v4.3.2, en la configuración que la página denomina «Claude Sonnet 5.5 (Max, Default Fallback)». Leímos esa página el 2026-10-08. En la misma revisión, el mismo día:
• Claude Opus 5.5 — 57,62, publicado el 22/09/2026, $4 / $20
• Claude Sonnet 5.5 — 56.00, lanzado el 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53,35, publicado el 2026-09-01, $10 / $50
• GPT-6 Astra — 52,67, lanzado el 2026-09-03, $10 / $50, con un nivel de contexto largo por encima de 272.000 tokens de prompt a $20 / $75
• GPT-6.1 Sol — 51,83, lanzado el 29/09/2026, $2 / $10
Especificar qué revisión se utiliza es importante, porque una puntuación de una versión del índice no es comparable con una puntuación de otra: v4.3.2 incorpora diez evaluaciones —AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience y AA-LCR v1.1— y la composición de ese conjunto ha cambiado a lo largo de las revisiones. Las cinco cifras anteriores proceden de la misma revisión, por lo que pueden leerse unas frente a otras, y por lo que ninguna puede leerse frente a una cifra citada de una versión anterior.
La comparación de precios es la parte que decide el comportamiento. La tarifa de salida de Claude Sonnet 5.5 es la mitad de la de Claude Opus 5.5, y su tarifa de entrada también es la mitad; en la lista del propio proveedor, la gama media cuesta 2 $ / 10 $, mientras que el modelo insignia cuesta 4 $ / 20 $. Combina las dos cifras publicadas y la proporción es contundente: por dólar de precio de lista de salida, Claude Sonnet 5.5 aporta 5,60 puntos de índice y Claude Opus 5.5 aporta 2,88 —casi el doble de índice por dólar de salida, según la propia tarifa de Anthropic y la propia medición de Artificial Analysis. Eso es aritmética con dos cifras publicadas, no la medición de nada, y es la forma honesta del argumento a favor de la gama media. Tampoco es un veredicto: un punto de índice no es una unidad de corrección, y el sentido del resto de esta página es de qué está hecho el 1,62 y de qué no.

La tarifa, y las dos líneas que más se mueven
Lista de precios completa de Anthropic, consultada el 08/10/2026. Todas las cifras de esta sección son del proveedor.
• Entrada — 2,00 USD por millón de tokens. Salida — 10,00 USD por millón, y los tokens de pensamiento se facturan como salida, lo que no se puede suprimir aquí porque el pensamiento adaptativo está activado de forma predeterminada.
• Lectura de caché — 0,10 $ por millón, que Anthropic documenta como el 5 por ciento del precio base de entrada. Es el mismo descuento proporcional que aplica Claude Opus 5.5, así que el almacenamiento en caché no cambia la clasificación entre ambos, y sí significa que una ejecución larga de un agente que mantiene un prefijo estable paga una décima parte de la tarifa de entrada por todo lo que vuelve a leer.
• Escritura de caché — 2,50 $ por millón para la caché de cinco minutos, 4,00 $ para la caché de una hora. La longitud mínima de prompt que se puede almacenar en caché es de 512 tokens, así que los prompts cortos no pueden aprovechar el descuento en absoluto.
• Batch API — 50 por ciento de descuento en ambos sentidos, así que $1.00 de entrada y $5.00 de salida para el trabajo que puede esperar.
• Sin recargo por contexto largo — Anthropic factura la ventana completa de 1M tokens a la tarifa estándar por token en este modelo, así que una solicitud de 900.000 tokens cuesta lo mismo por token que una de 9.000. Eso es una diferencia real con GPT-6 Astra, cuyo nivel de contexto largo por encima de 272.000 tokens de prompt pasa a $20 / $75 — vale la pena mencionarlo porque es el único punto donde las cifras destacadas de los dos proveedores divergen marcadamente cuando un prompt se vuelve largo.
Dos líneas deciden la mayoría de las facturas en lugar de la tarifa destacada: el descuento por lectura de caché a lo largo de una ejecución larga de agente, y el descuento por lotes para cualquier cosa asíncrona. El $2 / $10 destacado es lo que se compara en una tabla de clasificación; las líneas de caché y por lotes son de lo que realmente se compone una factura mensual.
Lo que la brecha significa y lo que no significa
El Intelligence Index es un único número sobre un conjunto fijo de tareas, y esa única propiedad explica la mayor parte de la confusión que lo rodea. Las diez evaluaciones detrás de v4.3.2 incluyen codificación agéntica y trabajo en terminal, razonamiento científico de nivel de posgrado, un conjunto de ingeniería de software, un conjunto de automatización agéntica y un conjunto de recuperación de contexto largo, ponderadas en un compuesto. Un modelo que está 1.62 puntos por detrás de otro está por detrás en ese compuesto — no en tu carga de trabajo, que puede ponderar esas diez en una proporción completamente diferente, y puede contener tareas que ninguna de ellas representa.
Lo que eso significa en la práctica es una división por la forma del trabajo más que por el prestigio de la gama. El propio selector de modelos de Anthropic hace explícita la división, y vale la pena leerlo porque no halaga a la gama media: la documentación les dice a los lectores que "empiecen con Claude Opus 5.5 para la mayoría de las cargas de trabajo", y que recurran a Claude Fable 5.1 "para razonamiento exigente y trabajo agéntico de horizonte largo, o cuando tus evaluaciones de Claude Opus 5.5 con mayor esfuerzo sigan quedándose cortas". Claude Sonnet 5.5 no es el modelo con el que comienza esa frase. Es el modelo que la misma documentación describe como la mejor combinación de velocidad e inteligencia, con la latencia comparativa más rápida fuera de la gama pequeña — lo cual es un argumento distinto, y uno más acotado.
Entonces, la lectura honesta es esta. El nivel medio suele ser la respuesta correcta para trabajo bien delimitado y a volumen: funcionalidades y correcciones de errores sobre una base de código conocida, extracción y clasificación con una forma de salida definida, bucles de llamada a herramientas donde la parte difícil es el arnés y no el razonamiento, y cualquier cosa en la que un primer token rápido y un bajo coste por llamada importen más que el último dos por ciento de capacidad. El modelo insignia se gana su tarifa cuando el trabajo es genuinamente de horizonte largo —ejecuciones de agentes de varias horas, refactorizaciones que abarcan archivos que el prompt no puede contener de una vez, y evaluaciones en el nivel medio que se quedan mediblemente cortas con un esfuerzo mayor—. Esa última condición es del propio proveedor, y es comprobable: sube el nivel de esfuerzo en el nivel medio, ejecuta tu propia evaluación y observa si cierra la brecha. Si lo hace, el 1.62 no era estructural para ti. Si no lo hace, has comprado tu respuesta con tus propios números en lugar de con el índice compuesto de otra persona.
Lo que la brecha no significa es que 1,62 puntos no sean nada. Es todo el margen entre dos modelos y, en un arnés fijo evaluado bajo condiciones idénticas, es un ordenamiento real. Es simplemente un ordenamiento de una combinación específica de tareas, con el máximo esfuerzo y el fallback predeterminado, y no dice nada sobre cuál de los dos es la mejor compra para una carga de trabajo en la que ninguno de los dos fue evaluado.
La trampa del nombre: de qué página de Claude Sonnet 5.5 se trata
Un lector que busca el nombre de este modelo se topa con varias páginas en este blog que se parecen a esta, y no lo son. La fechada el 2026-09-24 es la página de anticipación: se escribió antes de que se lanzara el modelo, y su tema era una sola publicación en X que afirmaba una prueba encubierta, reconstruida con base en las cifras del modelo al que reemplazaría. La publicada en la semana del lanzamiento es la nota de despliegue: su tema son los cinco cambios que rompen la compatibilidad y que afectan al código que ya se ejecuta en Claude Sonnet 5, más el sexto cambio que altera la forma de la respuesta sin generar un error. También hay un abanico de páginas comparativas que llevan el nombre de este modelo frente a modelos de otros proveedores, y una página aplicada sobre lo que cubre la promoción del lanzamiento.
Ninguna de ellas es la página del modelo, y ese es el vacío que cubre este artículo. Esta página es la referencia a la que llega un lector después de buscar el nombre del propio modelo: qué es, cuánto cuesta, qué mide y qué trabajo le pertenece. El detalle de migración de la página de despliegue y la crítica de fuentes de la página de anticipación se quedan donde están; si tienes código de Sonnet 5 en producción, la página de despliegue es tu primer clic, y esta página es la que te dice si el modelo al que estás migrando es el que quieres.
Una costumbre de nomenclatura vale la pena corregir mientras estamos aquí, porque por sí sola induce a error. Un sufijo 5.5 marca una generación, no un rango. Claude Sonnet 5.5 y Claude Opus 5.5 son la misma generación de la misma familia, y el número delante del punto es el nivel. Nada en el sufijo te dice cuál gana en un benchmark.
Disponibilidad, con fecha
Claude Sonnet 5.5 está en OrcaRouter desde que se lanzó, como anthropic/claude-sonnet-5.5, al precio de lista del propio Anthropic sin ningún recargo añadido: 2,00 $ de entrada y 10,00 $ de salida por millón de tokens, las dos cifras leídas de nuestro propio endpoint de modelos el 2026-10-08 y coincidiendo línea por línea con la tarifa del proveedor. Nuestra página para él incluye la misma ventana de contexto de 1M de tokens y una salida máxima de 128K, enumera texto, imagen y archivo como tipos de entrada aceptados y texto como la única salida, lo marca como publicado el 2026-09-28 y no obsoleto, y muestra que es accesible tanto a través del endpoint de chat-completions compatible con OpenAI como a través del endpoint messages del propio Anthropic — lo que lo convierte en un cambio directo para una integración que ya hable con cualquiera de los dos.
Todo lo demás en el mismo catálogo se accede desde la misma clave: una API para más de 200 modelos, con el precio de lista del proveedor transferido con un margen del 0 %, de modo que una rebaja de precio del proveedor llega al cliente el mismo día en que se anuncia, conmutación por error automática cuando un endpoint se degrada, y un DSL de enrutamiento para los casos en los que quieres fijar un modelo o combinar varios en una sola respuesta. Esa combinación es lo que hace que la pregunta de esta página sea barata de responder en lugar de costosa. Ambos modelos de la comparación anterior están detrás de la misma credencial, por lo que el precio con el que comparas es el precio publicado por el propio proveedor y no el de un revendedor, y la prueba de versión cuesta una ejecución de evaluación en lugar de un proyecto de migración: dirige una porción del tráfico a anthropic/claude-sonnet-5.5, mantén el resto en el modelo insignia y deja que tus propias cifras de coste por tarea completada decidan cuál debería ser el predeterminado.

La versión corta
Claude Sonnet 5.5 es un modelo de gama media con cifras cercanas a las del buque insignia y la mitad del precio de salida del buque insignia, y estos son los tres datos que deciden si es tu opción predeterminada. Se sitúa 1,62 puntos por detrás de Claude Opus 5.5 en el índice v4.3.2 de Artificial Analysis, con 56,00 frente a 57,62, y ambas cifras medidas sobre la misma revisión y en la misma configuración de esfuerzo máximo con fallback predeterminado. Cuesta $2 / $10 frente a los $4 / $20 del buque insignia, con los descuentos de caché y por lotes proporcionales en lugar de distintos, así que la brecha de precio se mantiene con cualquier descuento que ofrezca uno u otro modelo. Y su valor predeterminado es el esfuerzo alto, mientras que el del buque insignia es medio, lo que significa que un ajuste heredado del buque insignia se ejecuta aquí un nivel más alto en lugar de más bajo, y el coste de eso te toca medirlo a ti en lugar de darlo por supuesto.
El propio selector de Anthropic sigue partiendo de Claude Opus 5.5 para la mayoría de las cargas de trabajo, y eso conviene saberlo antes de estandarizar sobre cualquier cosa. Pero para la mayoría de los lectores que llegan a esta página buscando el nombre de este modelo, el nivel intermedio es la opción predeterminada sensata y el buque insignia es la excepción que se compra cuando tus propias evaluaciones lo exigen: trabajo bien delimitado y a volumen, latencia rápida, una ventana de un millón de tokens sin recargo por contexto largo y una tarifa que reduce a la mitad la línea de salida. Ambos están a una sola clave de distancia en OrcaRouter, y la evaluación que decide entre ellos cuesta una tarde en lugar de una migración.
Comparados en este artículo4
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
