Tarjeta principal de Claude Sonnet 5.5 titulada 'Una prueba sigilosa, o la lista de precios que ya tienes', con tres pastillas que dicen 'no lanzado', 'sin ID de modelo publicado' y 'anunciado: próximas semanas', un pie de página que cita una publicación de X del 24 de septiembre de 2026 y la publicación de lanzamiento de Opus 5.5 de Anthropic del 22 de septiembre de 2026, y el logotipo de OrcaRouter en la esquina inferior derecha
Guides & Insights

Claude Sonnet 5.5: una filtración de prueba encubierta construida a partir de cuatro números que ya existen

Autor

Alistair Wren

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Cuatro cifras se publicaron en X el 24 de septiembre como prueba de que Claude Sonnet 5.5 "ya se está probando de forma encubierta": una ventana de contexto de 1M de tokens, una salida máxima de 128K tokens, $2 por millón de tokens de entrada y $10 por millón de tokens de salida. Las cuatro están en la propia lista de precios de Anthropic ahora mismo, vinculadas a Claude Sonnet 5 —el modelo que un 5.5 reemplazaría, disponible de forma general desde el 30 de junio de 2026—. El mismo titular de $2 / $10 también corresponde a GPT-6 Sol, que OpenAI lanzó el 22 de septiembre, y esa coincidencia es lo que hace que la publicación se lea como una respuesta a OpenAI en lugar de una actualización rutinaria de nivel: "Esto lo interpreto como una respuesta directa a GPT-6-Sol. Mismo precio y, presumiblemente, un r[endimiento] similar."

Nada de eso hace que la afirmación sea errónea. Hace que la afirmación sea infalsable, lo cual es un problema distinto y más útil de dejar por escrito. Un avistamiento en una prueba sigilosa vale solo tanto como el artefacto que tiene detrás, y el artefacto detrás de este es una ficha técnica indistinguible del modelo que Anthropic lleva doce semanas sirviendo.

¿Qué se publicó realmente?

La fuente es una única publicación en X de la cuenta @kimmonismus, fechada el 24 de septiembre de 2026. En ella se indican la ventana de contexto, el límite de salida y los dos precios, se compara el precio con GPT-6 Sol y se concluye que Sonnet 5.5 está en pruebas. No hay ninguna captura de pantalla, ni cadena de modelo, ni respuesta de API, ni listado de consola, ni descripción del comportamiento por parte de los probadores, ni un segundo observador vinculado a nada de ello. La publicación es una afirmación con cifras, y las cifras son los límites públicos del nivel.

Vale la pena separar eso del otro tipo de historia de prelanzamiento de Anthropic, porque 2026 ha producido ambas y no se parecen en nada. Los identificadores de acceso anticipado de agosto claude-marshmallow-eap y claude-melon-eap eran cadenas que existían en solicitudes: feas, poco glamurosas y verificables. La historia de Opus 5.2 que se extiende durante septiembre es un informe de enrutamiento: desarrolladores que notan que el backend detrás de la etiqueta "Opus 5" respondía de manera diferente, y describen el comportamiento. Ambas son artefactos. "Ya se está probando en sigilo" sin ningún artefacto adjunto es un resumen de lo que el nivel Sonnet ya vende.

También hay un patrón que vale la pena señalar en la propia fuente. La misma cuenta publicó una recopilación el 20 de septiembre que abría con cuatro modelos de los que decía que "ya se estaban viendo pruebas": Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 y Gemini 4 Pro. De esos cuatro nombres, las entradas de Opus y Fable tienen detrás informes separados y corroborados, y la entrada de Gemini tiene sus propios avistamientos. La entrada de Sonnet tenía una posición en una lista. Cuatro días después, la afirmación sobre Sonnet ha pasado a tener una ficha técnica, y la ficha técnica es el modelo que ya existe.

Los cuatro números son los números de Claude Sonnet 5.

Esta es la parte que toma treinta segundos comprobar y que casi nadie ha comprobado. La página de resumen de modelos de Anthropic, consultada hoy, enumera Claude Sonnet 5 con una ventana de contexto de 1M de tokens, una salida máxima de 128K y $2 / $10 por millón de tokens. Compara la filtración con esto:

• Ventana de contexto — 1M tokens declarados para Claude Sonnet 5.5; 1M tokens publicados para Claude Sonnet 5

• Salida máxima — 128K tokens declarados; 128K tokens publicados

• Precio de entrada — $2 por millón reclamado; $2 por millón publicado

• Precio de salida — $10 por millón reclamado; $10 por millón publicado

• ID del modelo — nada publicado para Claude Sonnet 5.5; claude-sonnet-5 para Claude Sonnet 5

• Puntuaciones independientes — ninguna para el modelo declarado; Artificial Analysis sitúa a Claude Sonnet 5 en un Índice de Inteligencia de 38, en el puesto 54 de los 210 modelos que mide, en la configuración de razonamiento adaptativo y esfuerzo máximo

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

Hay una segunda capa del punto de precios que la filtración invierte. Cuando se lanzó Claude Sonnet 5, se anunció $2 / $10 como precio introductorio vigente hasta el 31 de agosto de 2026, con un aumento programado a $3 / $15 el 1 de septiembre. Ese aumento no se produjo. La página de precios de Anthropic ahora incluye una nota al pie que afirma que $2 / $10 «ahora es el precio estándar» y que «el aumento previamente programado a $3 / $15 por millón de tokens de entrada/salida el 1 de septiembre de 2026 no se producirá». Así que el precio que la filtración presenta como el arma competitiva del nuevo modelo es la tarifa permanente del incumbente — lo que significa que un Sonnet 5.5 lanzado a $2 / $10 se lanzaría sin ningún descuento, a un nivel que ya tiene un precio establecido frente a GPT-6 Sol.

Lo único que Anthropic ha dicho realmente

Descartando todo lo procedente de filtradores anónimos, sobrevive una única frase de la propia empresa. Cuando Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026, afirmó que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarían "en las próximas semanas", con mejoras comparables en rendimiento, eficiencia y seguridad. Esa frase es todo el registro confirmado. No incluye ningún identificador de modelo, ni ventana de contexto, ni precio, ni benchmark, ni fecha; y, en particular, no dice nada sobre una prueba encubierta, una vía gris ni ningún tipo de prueba.

El resto de la superficie pública de Anthropic concuerda con esa lectura. El resumen de modelos sigue enumerando cuatro modelos —Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 y Claude Haiku 4.5—, sin una quinta fila, sin entrada de precios y sin marcador de "próximamente" para un sucesor de Sonnet. Si se estuviera sirviendo un checkpoint de la categoría Sonnet en algún lugar al que un desarrollador pudiera acceder, el identificador sería lo primero en aparecer, porque un modelo servido tiene que tener un nombre en una solicitud. No ha aparecido nada.

Una cosa que el anuncio de septiembre sí zanjó: contradecía la filtración anterior que afirmaba que la línea Haiku se retiraría y que la generación 5.5 reestructuraría la gama. Haiku 5.5 está en camino, según Anthropic, lo que significa que la historia de la reestructuración era errónea en la dirección en la que los filtradores rara vez se equivocan: el nivel económico se queda.

La filtración de agosto decía 2 millones de tokens. Esta dice 1 millón.

Seis semanas antes de la publicación del 24 de septiembre, el 9 de agosto, una cuenta distinta de X publicó una hoja de especificaciones titulada "SONNET 5.5 LEAK" con una afirmación mucho más audaz: una ventana de contexto de 2 millones de tokens, el doble que la de Sonnet 5, inferencia más rápida, mejor uso de herramientas de navegador y terminal, rendimiento cercano al de Claude Fable 5, y un lanzamiento "el próximo mes". Esa filtración venía con un gráfico diseñado para parecerse a una tarjeta de vista previa de Anthropic. También traía un detalle fatal en el que sus críticos se fijaron de inmediato: el nombre en clave que daba, "Fennec", era el nombre en clave que ya se había lanzado con Claude Sonnet 5 el 30 de junio. Un nombre en clave no puede ser evidencia nueva de un sucesor del modelo que lo usó.

Así que las dos olas de filtraciones no coinciden en el número más citado de todos. Agosto dijo 2M de contexto. Septiembre dice 1M. No es posible que ambas describan la misma compilación. La interpretación más probable es la aburrida: la publicación de septiembre describe los límites publicados del nivel Sonnet porque así es como se ve un modelo de nivel Sonnet desde fuera, y la publicación de agosto fue una conjetura sobre lo que una actualización duplicaría de forma plausible. Fíjate en en qué dirección se movió el número: hacia abajo, hacia lo que ya existe.

Entonces, ¿es correcta la comparación con GPT-6 Sol?

En gran medida, y el punto donde se rompe es la parte interesante. GPT-6 Sol se lanzó el 22 de septiembre de 2026, el mismo día que Claude Opus 5.5, y su precio de lista comienza en $2 por millón de tokens de entrada y $10 por millón de tokens de salida — exactamente la tarifa de Sonnet 5 y exactamente lo que afirma la filtración sobre Sonnet 5.5. Ofrece una ventana de contexto de 1.050.000 tokens con un límite de salida de 128K, ambos un poco alejados de las cifras de Claude Sonnet 5. El hermano más económico, GPT-6 Luna, se sitúa en $0.10 / $0.50.

La diferencia está en el contexto largo. GPT-6 Sol fija precios en dos tramos: $2 / $10 hasta 272.000 tokens de entrada, y luego $4 / $15 a partir de ahí. Anthropic no hace eso en la línea Sonnet: Claude Sonnet 5 factura toda la ventana de 1M a tarifas estándar, por lo que una solicitud de 900K tokens cuesta lo mismo por token que una de 9K. Un Sonnet 5.5 real frente a un GPT-6 Sol real es, por tanto, un empate en precio para prompts comunes y una diferencia del doble para las cargas de trabajo de documentos largos y repositorios grandes para las que se comercializan ambos modelos. “El mismo precio” es cierto en el titular y falso en las cargas de trabajo donde se elige el tramo.

Un segundo matiz subyace bajo toda la comparación. Claude Sonnet 5 utiliza el tokenizador más reciente de Anthropic, que genera aproximadamente un 30 % más de tokens para el mismo texto que el anterior. Una tarifa de titular no es una factura; la factura son los tokens por tarea, y ese es el número que ninguna filtración ha recogido jamás.

¿Qué haría que un Sonnet 5.5 importara?

Deja de lado si existe y pregúntate qué cambiaría para alguien que paga por tokens. Cuatro cosas, y ninguna de ellas es una ficha técnica.

El primero es un precio por debajo de $2 / $10. Con el aumento del 1 de septiembre cancelado, la tarifa del incumbente ahora es permanente — así que un sucesor que mantenga esa misma tarifa es un movimiento lateral, y la única noticia del nivel Sonnet que mueve dinero es un recorte.

La segunda es el contexto más allá de 1M. Esa era la propuesta real de la filtración de agosto, y es la única brecha de capacidades que la filtración puede nombrar y que el incumbente aún no cubre.

El tercero son los tokens por tarea. El pensamiento adaptativo de Claude Sonnet 5 está activado por defecto, y análisis independientes han medido que genera bastantes más tokens de salida por tarea que su predecesor. Una versión que mantuviera la tarifa de $2 / $10 y detuviera esa inflación recortaría las facturas reales más que un recorte de precio de titular.

El cuarto es un identificador. Una cadena de modelo de API, una fila en la documentación, una entrada de precios, una tarjeta de modelo — cualquiera de esas zanja la discusión, y la ausencia de las cuatro tras una filtración tan explícita es en sí misma el hecho más revelador de esta historia.

Lo que puedes llamar hoy

Claude Sonnet 5 no es un recurso provisional mientras se define el nivel. Es el modelo en el que ya se ejecuta la mayor parte del tráfico de Claude API, con una ventana de 1M de tokens, salida de 128K y la tarifa de $2 / $10 que ahora es estándar y no promocional.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

Lleva en OrcaRouter desde junio con los propios $2 / $10 de Anthropic, trasladados al precio de lista del proveedor sin recargo, así que un cambio de precio del proveedor en la línea Sonnet estaría activo aquí el mismo día en lugar de en el siguiente ciclo de facturación. La misma clave ya llega a GPT-6 Sol a $2 / $10, lo cual importa más de lo habitual en un artículo como este: la comparación en la que se apoya la filtración es una que puedes ejecutar tú mismo con una sola credencial en lugar de dos contratos.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Esa es también la forma más barata de responder a la pregunta que plantea la filtración. Si aparece un Sonnet 5.5, llega al catálogo como cualquier otra cosa, y diriges una porción del tráfico hacia él detrás de la conmutación por error automática a Claude Sonnet 5 — sin una segunda integración, sin renegociación y sin una ruta de producción que dependa de un modelo que nadie ha evaluado de forma independiente. Probar un nivel no probado es una decisión de enrutamiento, no un proyecto de migración.

Qué ver en lugar de la próxima publicación de filtraciones

Tres señales, en orden descendente de cuánto te dirían. Un identificador es decisivo, porque un modelo servido tiene que tener un nombre en una solicitud, y así fue como cada historia comprobable de prelanzamiento de Anthropic en 2026 pasó a ser comprobable. Una confirmación del proveedor —una ficha de modelo, una fila en la documentación, una línea de precios o que el modelo simplemente aparezca en la propia lista de Anthropic— lo resuelve de plano; la frase «próximas semanas» significa que uno de esos realmente se debe. Un informe de un probador que describe comportamiento en lugar de especificaciones es el más débil de los tres, y aun así es más de lo que existe hoy.

Hasta que uno de esos se materialice, el resumen honesto es que Anthropic ha prometido una renovación de Sonnet en las próximas semanas y un observador lo ha descrito usando las cifras del modelo al que reemplazará. Si tu stack ya ejecuta claude-sonnet-5, no hay nada que esperar ni nada que planificar. Si estás sopesando Claude Sonnet 5 frente a GPT-6 Sol, las cifras con las que puedes actuar son las ya publicadas — y son las mismas cifras que la filtración intenta venderte como noticia.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario