
Claude Sonnet 5.5 ya está disponible en Claude y la API — con cinco cambios que rompen el código existente
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 348 tok/s
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAINUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
Claude Sonnet 5.5 ya está disponible. El anuncio del proveedor está fechado el 28 de septiembre de 2026, la página del modelo de Claude Platform lo lista como "Latest", y el identificador es claude-sonnet-5-5 en la API de Claude, Amazon Bedrock, las consolas en la nube, Microsoft Foundry y Claude Platform on AWS. El despliegue a Claude en sí y a la API es la parte que está ocurriendo esta semana. La parte que te costará un día está en otra parte de la misma documentación: cinco cambios que rompen la compatibilidad afectan al código que ya se ejecuta en Claude Sonnet 5, y un sexto cambia la forma de la respuesta sin que falle ni una sola solicitud.
Esa es la forma de este lanzamiento. La lista de precios no se movió: Claude Sonnet 5.5 cuesta $2 por millón de tokens de entrada y $10 por millón de tokens de salida, exactamente lo que cuesta Claude Sonnet 5, con lecturas de caché a $0,20 y una escritura de caché de cinco minutos a $2,50. La capacidad avanzó muchísimo. En la revisión actual de Artificial Analysis, el nuevo modelo se sitúa 18 puntos por encima del que reemplaza, que es la mayor diferencia entre dos modelos Sonnet consecutivos en esa clasificación. El coste de migración es, en consecuencia, el más elevado. Nada de eso es una queja —un modelo que mejora sin encarecerse es el caso favorable—, pero los dos hechos llegan juntos, y las notas de la versión son la mitad que decide si tu semana va bien.
¿Qué se lanzó realmente el 28 de septiembre?

La especificación es una continuación directa del nivel en lugar de una nueva forma:
• ID del modelo — claude-sonnet-5-5 en la API de Claude, Claude Platform en AWS y Microsoft Foundry; anthropic.claude-sonnet-5-5 en Amazon Bedrock
• Precio — $2 / MTok de entrada, $10 / MTok de salida, $2.50 por escritura en caché de cinco minutos, $4 por escritura en caché de una hora, $0.20 por lectura de caché
• Batch — 50 % de descuento en ambas direcciones, es decir, $1 / $5 por MTok
• Contexto y salida — 1M tokens de entrada, 128K tokens de salida de forma síncrona, 300K de salida en la API de Message Batches detrás deloutput-300k-2026-03-24 encabezado beta
• Pensamiento — adaptativo, con un esfuerzo predeterminado de alto; las fechas de corte de conocimiento y de entrenamiento son ambas de junio de 2026
• Ciclo de vida — retención de datos cero desde el lanzamiento, y un mínimo de retirada publicado de no antes del 28 de septiembre de 2027
Dos detalles son fáciles de pasar por alto y son importantes. Primero, no hay recargo por contexto largo: Anthropic factura la ventana completa de 1M tokens a la tarifa estándar, por lo que una solicitud de 900,000 tokens cuesta lo mismo por token que una de 9,000 tokens. Segundo, la tarifa de $2 / $10 del modelo anterior era originalmente un precio introductorio con un aumento programado a $3 / $15 el 1 de septiembre de 2026; la página de precios de Anthropic ahora indica que el aumento no se producirá, lo que convierte el precio actual del nivel Sonnet en un compromiso permanente en lugar de una promoción. Ambas son declaraciones del proveedor, no hallazgos independientes.
La lista de migraciones, en el orden en que te van a morder
La descripción general de Sonnet 5.5 de Anthropic es inusualmente directa al respecto: cinco cambios disruptivos afectan a código que ya se ejecuta en Claude Sonnet 5. No son de estilo. Cada uno devuelve un error o cambia el comportamiento de forma silenciosa.
• Se rechaza el uso forzado de herramientas. Un tool_choice de "any", o de una herramienta con nombre, ahora devuelve un error en lugar de restringir el modelo. Si tu bucle de agente fija una herramienta para garantizar una llamada estructurada, ese bucle deja de funcionar en la primera solicitud. La solución es dejar que el modelo elija y validar el resultado, o trasladar la garantía a las salidas estructuradas.
• thinking: {"type": "disabled"} se rechaza. Desactivar el pensamiento por completo ya no es una configuración admitida. El reemplazo es between_tools, que desactiva el pensamiento inicial y funciona con un nivel de esfuerzo high o inferior. Es la configuración de pensamiento más baja del modelo, no un interruptor de apagado.
• Los bloques de pensamiento están vinculados al modelo y a la conversación. El razonamiento que produjo un turno anterior se conserva de Claude Sonnet 5 a Claude Sonnet 5.5, pero no hacia otra familia, ni entre cuentas. Las aplicaciones que reproducen una transcripción entre versiones del modelo encontrarán que los bloques de pensamiento son rechazados donde antes se aceptaban.
• computer_20251124 no se acepta en la API de Claude ni en Google Cloud. El código que declaraba la versión anterior de la herramienta de uso de computadora debe migrar al conjunto de herramientas actual.
• La herramienta de asesor rechaza a su propia familia. Claude Opus 4.8, Claude Opus 4.7 y Claude Sonnet 5 se rechazan como asesores, por lo que cualquier flujo de trabajo que utilizara un modelo Claude más pequeño como verificador frente a uno más grande necesita volver a emparejarse.
Luego está el cambio que no hace fallar nada. El texto que el modelo emite entre llamadas a herramientas ahora llega dentro de thinking en forma de bloques en lugar de como salida normal. Una aplicación que transmite texto a un usuario se queda en silencio entre llamadas a herramientas — sin error, sin excepción, solo una interfaz de usuario que parece quedarse bloqueada hasta que configuras un valor de tipo display que devuelve el texto, o cambias a between_tools. Este es el modo de fallo con más probabilidades de llegar a producción, porque nada en una suite de pruebas lanza una excepción.
Uno más, para que quede completo: establecer temperature, top_p o top_k en cualquier valor distinto del predeterminado devuelve un 400. Si tu gateway o biblioteca cliente establece el parámetro temperature por costumbre más que por intención, ese hábito ahora es una interrupción.
La afirmación del 30%, frente al número independiente

La frase de marketing de Anthropic para Claude Sonnet 5.5 es que "cuesta hasta un 30 % menos por tarea que su predecesor" con tarifas idénticas por token, y que "genera resultados al menos un 30 % más rápido" que Claude Sonnet 5. Ambas son afirmaciones sobre tokens en lugar de sobre precios, y ambas están reportadas por el proveedor. El mecanismo detrás de la primera es visible en la propia tabla comparativa del proveedor: con esfuerzo medio en Terminal-Bench, Anthropic dice que Claude Sonnet 5.5 supera la mejor puntuación de Claude Sonnet 5 por "menos de una décima parte del coste por tarea", y hace afirmaciones similares para CursorBench con esfuerzo bajo y AA-Briefcase con esfuerzo medio.
El panorama independiente coincide en la dirección y discrepa en la magnitud. En el Intelligence Index v4.3.2 de Artificial Analysis —diez evaluaciones, ejecutadas en una única configuración en todos los modelos—, Claude Sonnet 5.5 obtiene 56, lo que la página sitúa en el puesto 3 de 216. Claude Sonnet 5 obtiene 38 en la misma tabla. Eso supone un movimiento de 18 puntos entre dos modelos consecutivos de la misma gama al mismo precio, y es la mayor brecha que Anthropic ha abierto dentro de la línea Sonnet este año.
La cifra de coste es donde la afirmación del proveedor se vuelve más difícil de sostener. Artificial Analysis mide Claude Sonnet 5.5 en $7.60 por tarea completada del Intelligence Index. Esa cifra no está un 30% por debajo de nada en su clase, porque el modelo es extremadamente verboso: emitió 410 millones de tokens de salida para completar las evaluaciones del Index, frente a una mediana de 88 millones entre modelos comparables. La eficiencia por token y la eficiencia por tarea son cantidades distintas, y Claude Sonnet 5.5 es inusualmente bueno en la primera y solo promedio en la segunda.
Todas las cifras de benchmark del propio Anthropic para este lanzamiento están reportadas por el proveedor y no han sido reproducidas por terceros, y dos de ellas incluyen notas al pie que vale la pena repetir: los números de GDPval-AA v2.1 y AA-Briefcase v1.1 fueron ejecutados por Artificial Analysis en un despliegue previo al lanzamiento que tenía un bug que posiblemente subestimaba las puntuaciones, y la nota de Anthropic sobre su cifra de FrontierCode 1.1 explica por qué Claude Sonnet 5.5 obtiene una puntuación más baja con Max effort que con Xhigh en esa evaluación. Una tabla en la que un modelo se supera a sí mismo con un ajuste de esfuerzo inferior es una tabla que te dice que la configuración de su benchmark no está resuelta.
Cómo probarlo sin arriesgar una ruta de producción en ello
Hay una razón específica para ejecutar Claude Sonnet 5.5 a través de un router en lugar de contra el endpoint del proveedor directamente durante una migración: no tienes que elegir entre el modelo antiguo y el nuevo mientras lo averiguas. En OrcaRouter, Claude Sonnet 5 se puede enrutar desde el 30 de junio a los propios $2 / $10 de Anthropic sin recargo añadido, uno de más de 200 modelos tras un único endpoint compatible con OpenAI, y sigue siendo el modelo por el que circula la mayor parte del tráfico de la API de Claude. Claude Sonnet 5.5 aún no está en nuestro catálogo, así que la ruta hacia él hoy es la propia API de Anthropic.
El patrón que funciona mientras tanto es enviar una porción del tráfico al nuevo modelo y dejar que el failover se encargue del resto — con Claude Sonnet 5 como respaldo, de modo que un 400 de uno de los cinco cambios disruptivos se degrade a una respuesta más lenta en lugar de a una solicitud fallida. Esa es también la forma más económica de medir lo que la afirmación del proveedor no te dice: tus propios tokens por tarea en ambos modelos con la misma configuración de esfuerzo. La cifra del 30% es un promedio de las propias evaluaciones de Anthropic; tu tráfico no es ese promedio.
¿Qué llega después?
El anuncio de Anthropic dice que Claude Haiku 5.5 se une a la familia “en las próximas semanas”, lo que completaría la generación 5.5 en el nivel pequeño. Hasta entonces, las dos decisiones que tiene ante sí un equipo que ejecuta Sonnet en producción son separables: la migración es un trabajo de un día que puedes programar, y el cambio de modelo es una medición que puedes posponer. Hacerlas en el orden inverso —cambiar primero y descubrir el error de uso forzado de herramientas en producción— es la versión de este despliegue que cuesta un fin de semana.

