Tarjeta principal de la filtración de Claude Sonnet 5.2: un panel de lo que sabemos hasta ahora que indica el estado como no lanzado, con una entrada de lista y sin identificador, una etiqueta de observador sin confirmar, evidencia limitada a una publicación recopilatoria y un titular, sin identificadores publicados, sin benchmarks, y Claude Sonnet 5 como el modelo que realmente se lanzó, disponible de forma general desde el 30 de junio
Guides & Insights

Claude Sonnet 5.2: una entrada de lista, cero identificadores — lo que realmente se sabe

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Sonnet 5.2 llegó a internet como el primer elemento de una lista. El 20 de septiembre, la cuenta de X @kimmonismus publicó un resumen que abría con los modelos que, según decía, "ya se están probando" —Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 y Gemini 4 Pro— y luego pasaba a los lanzamientos que esperaba a continuación. Todo lo que sigue a ese primer nombre tiene algo detrás. Claude Opus 5.2 tiene una semana de cobertura sobre un canal de enrutamiento silencioso dentro de Claude Code. Claude Fable 5.2 tiene su propio hilo de filtraciones. Gemini 4 Pro tiene avistamientos por separado. Claude Sonnet 5.2 tiene una posición en una lista. Ese es todo el registro público hasta esta mañana: un tuit, un titular en un agregador de baja verificación y ningún identificador, precio, ventana de contexto ni benchmark en ninguna parte. Claude Sonnet 5 —el modelo al que sustituiría un 5.2— está disponible de forma general desde el 30 de junio a $2 por millón de tokens de entrada y $10 por millón de salida, y es el modelo predeterminado en todos los niveles de suscripción de Claude.

Esa asimetría es la historia que vale la pena dejar por escrito, porque es justo lo que se pierde cuando un tuit recopilatorio se lee como un acontecimiento noticioso. Que un nombre de modelo aparezca en una lista no es el mismo tipo de afirmación que un nombre de modelo que aparece junto a un ID de modelo, y la diferencia es toda la diferencia entre «se acerca una renovación de Sonnet» y «alguien agrupó la palabra Sonnet con el número 5.2».

Lo que realmente dice la publicación del 20 de septiembre

Lee la publicación con atención, y la afirmación sobre Sonnet es aún más endeble de lo que sugiere el titular. La lista se divide en dos mitades, y Sonnet 5.2 se encuentra en la primera —la mitad de "ya se está viendo en pruebas"—, que es la más sólida de las dos afirmaciones. La segunda mitad está explícitamente matizada: "confirmación o indicios de próximos lanzamientos", y abarca Grok 4.7, GPT-6-Sol y Kimi K3.1; la línea de GPT-6-Sol incluso lleva su propia advertencia de que un gran lanzamiento insinuado para el martes "podría serlo".

Así que el autor es cuidadoso en una mitad de la publicación y no se anda con reservas en la otra, y Sonnet 5.2 está en la mitad sin reservas. Ni captura de pantalla, ni respuesta de API, ni cadena de modelo, ni informe de probador, ni medición de tiempos. Un lector que quiera comprobar la afirmación no tiene nada con qué contrastarla.

El único otro lugar donde el nombre aparece en público es una publicación de agregador del 19 de septiembre cuyo titular dice «Filtración de Fable 5.2, Opus 5.2, Sonnet 5.2». Ábrela y Sonnet 5.2 aparece en el titular y luego nunca más en el cuerpo, donde los tres nombres de Claude se agrupan en una sola frase sobre «progreso notable» en toda la plataforma. Esa publicación no ofrece ninguna evidencia para ninguno de los tres, y advierte explícitamente que los benchmarks falsos deben tratarse con cautela. Dos apariciones, la misma forma: un nombre dentro de un grupo, sin nada asociado a él individualmente.

Lo que falta es el artefacto específico y verificable que toda filtración real de Anthropic en 2026 ha producido. En agosto, la historia de Marshmallow y Melon tuvo tráfico de API observable en una cadena llamada claude-marshmallow-ht-eap y variantes más limpias después. La historia de Opus 5.2 de este mes tiene desarrolladores informando que el slug de backend detrás de la etiqueta "Opus 5" apuntaba a algún lugar nuevo. Sonnet 5.2 no tiene ninguno de los dos. Si un checkpoint de nivel Sonnet se estuviera sirviendo en algún lugar al que un desarrollador pudiera acceder, el identificador sería lo primero en filtrarse, porque es lo más difícil de ocultar: tiene que existir en una solicitud.

La parte de la historia de septiembre que está corroborada no es un soneto.

Aquí está la trampa al leer ese resumen. La historia corroborada de la prueba en gris de Anthropic que se extendió durante septiembre es una historia de nivel Opus. Varios medios, en chino e inglés, informaron que Anthropic estaba enrutando silenciosamente una fracción de las solicitudes a un checkpoint no publicado bajo la etiqueta Opus 5 —una prueba en gris silenciosa que los desarrolladores notaron por el cambio de comportamiento, no por un cambio de nombres. Los reportes de la noche del 17 de septiembre describieron que el canal se cortó sin aviso y se restauró aproximadamente un día después, tras lo cual se dijo que se había ampliado de Claude Code a las superficies de chat y cowork. El nombre asociado a ese checkpoint en los reportes es Claude Opus 5.2.

Sonnet 5.2 hereda la credibilidad de esa cobertura periodística sin heredar nada de sus pruebas. Se trata de un modo de fallo concreto y habitual en la cobertura de filtraciones: un nivel queda documentado, un segundo nivel se menciona en la misma frase y ese segundo nombre acaba circulando como si también se hubiera informado sobre él. Pero no es así. Si te pones a buscar un informe sobre el enrutamiento de la gama Sonnet, encontrarás el de Opus y una lista.

Hay un hilo aparte, con mejores fuentes, que subyace a todo esto: la información periodística de que Anthropic ha pospuesto su salida a bolsa hasta noviembre y que, según Reuters, citando a tres fuentes, está sopesando si lanzar un nuevo modelo antes de esa fecha para responder a GPT-6 Astra. Esa información es real y es relevante. También, y esto es notable, guarda silencio sobre a qué gama pertenecería el modelo. Una renovación de caballo de batalla y el lanzamiento de un buque insignia son movimientos muy diferentes antes de una OPI, y nada de lo publicado hasta ahora dice cuál se está contemplando.

El mes pasado, la comunidad nombró un Sonnet que nunca se lanzó.

El argumento más sólido para el escepticismo respecto a «Sonnet 5.2» no es que la afirmación sea endeble. Es que este mismo patrón de nombres fracasó hace un mes, en público, y el fracaso está documentado.

A finales de agosto, circularon dos identificadores de acceso anticipado: claude-marshmallow-eap y claude-melon-eap. Ninguna de las cadenas contiene las palabras Opus, Sonnet ni ningún número de versión. El 24 de agosto, publicaciones en redes sociales y blogs de rumores les asignaron nombres de producto desde fuera —Marshmallow se convirtió en «Opus 5.1», Melon se convirtió en «Sonnet 5.1»— basándose en las impresiones de los probadores de que Marshmallow se percibía más fuerte que Melon y más fuerte que el Opus 5 de entonces. Según los informes, un desarrollador que investigó descubrió que las cadenas simples no producían ninguna salida verificable de primera parte, dejando el tráfico anterior como la única evidencia observable.

Ninguno de los dos nombres se lanzó. El siguiente lanzamiento de Anthropic en esa ventana fue Claude Fable 5.1, el 1 de septiembre — una categoría completamente distinta, bajo un nombre que nadie había asignado a ninguno de los dos identificadores. La etiqueta "Sonnet 5.1" fue una inferencia de la comunidad que se consolidó como rumor y luego se desvaneció.

Esa historia es relevante aquí por una razón que va más allá de la cautela general. Significa que el nivel Sonnet ya ha sido mencionado en filtraciones dos veces en dos meses sin un solo artefacto específico de ese nivel en ninguna de las dos ocasiones. También significa que el antecedente más sólido —la cadencia real de Anthropic en 2026— apunta a una forma distinta: Opus 5 a finales de julio, Fable 5.1 a principios de septiembre y una prueba gris de Opus 5.2 a mediados de septiembre. El nivel Sonnet no se ha movido desde el 30 de junio, que es exactamente por lo que un rumor sobre Sonnet es plausible y exactamente por lo que no está verificado. Un lapso prolongado es una razón para esperar algo, no una prueba de que exista algo concreto.

Lo que realmente puedes ejecutar hoy

Claude Sonnet 5 no es un marcador de posición mientras esperas. Es el modelo en el que ya se ejecuta la mayor parte del tráfico de Claude, y sus cifras son concretas de una forma en la que nada de lo que se rumorea sobre el 5.2 lo es.

Artificial Analysis model page for Claude Sonnet 5 showing an Intelligence Index of 32 at rank 8, 165 tokens per second output speed, 31.20 second time to first token, $2.00 input and $10.00 output per million tokens, a 1M token context window, 128k maximum output, a Coding Index of 51 and an Agentic Index of 36

• ID del modelo — claude-sonnet-5, ya se puede invocar; Claude Sonnet 5.2 no tiene ningún identificador publicado de ningún tipo

• Precio — $2 por millón de tokens de entrada y $10 por millón de tokens de salida, fijado de forma permanente el 10 de agosto; la tarifa estándar prevista de $3 / $15 ya no se aplica. No se sabe nada sobre el precio de 5.2 porque no hay nada que saber

• Contexto — ventana de 1M de tokens con salida máxima de 128K. La propia publicación de Anthropic no indica la ventana en la página de lanzamiento; el tokenizador revisado es el detalle que sí señala, y es más importante de lo que parece: una entrada idéntica puede corresponder a aproximadamente 1,0–1,35× tantos tokens según el tipo de contenido

• Benchmarks reportados por el proveedor — SWE-bench Pro 63,2 %, Terminal-Bench 2.1 con 80,4–80,5 %, Humanity's Last Exam 43,2 % sin herramientas y 57,4 % con ellas, OSWorld-Verified 81,2 %, GDPval-AA v2 con 1.618. Estas son cifras de Anthropic, no reproducidas aquí.

• Independiente — Artificial Analysis sitúa a Claude Sonnet 5 en un Índice de Inteligencia de 32 en su configuración de razonamiento adaptativo y esfuerzo máximo, muy por encima de la mediana de 24 para su categoría de precio, y en 29 en la configuración de alto esfuerzo sin razonamiento

• La advertencia sobre el costo que sobrevive a cualquier número de versión — los precios de los tokens de Anthropic no cambiaron, pero un análisis independiente del Intelligence Index encontró que Sonnet 5 consume aproximadamente un 30–40 % más de tokens de salida por tarea que su predecesor, porque el pensamiento adaptativo está activado de forma predeterminada. El precio de etiqueta no es la factura.

Ese último punto es el que hay que llevar a cualquier debate sobre 5.2. Si llega una actualización de Sonnet, el número interesante no es la tarifa por millón. Son los tokens por tarea, y si un nuevo nivel de esfuerzo predeterminado vuelve a elevarlo silenciosamente.

Qué tendría que cambiar un Sonnet 5.2 para ser relevante

Dejemos de lado si existe. La pregunta más útil es qué haría que valiera la pena cambiar, porque eso determina qué hay que vigilar, y nada de eso es «el lanzamiento de una actualización de Sonnet».

Comparison scoreboard for Claude Sonnet 5.2 and Claude Sonnet 5: the rumoured model's unconfirmed status, missing model ID, unknown price, absent benchmarks and single list entry against the live model's GA date of June 30, claude-sonnet-5 model ID, $2 / $10 per million tokens, and Artificial Analysis Intelligence Index of 32

Un Sonnet 5.2 significativo tendría que cambiar al menos una de cuatro cosas. La primera es la cantidad de tokens por tarea: una versión que mantenga la tarifa de $2 / $10 pero detenga la inflación del 30–40% en tokens de salida recortaría las facturas reales más de lo que lo haría un recorte de precio de titular. La segunda es la brecha agéntica con el nivel superior: Sonnet 5 se posicionó como aproximadamente nueve décimas partes del camino hacia el anterior modelo insignia en trabajo agéntico por una fracción del costo, y esa proporción es lo que lo convierte en la opción predeterminada. La tercera es el comportamiento de contexto largo que el tokenizador revisado volvió más difícil de razonar. La cuarta, y la menos probable de que se anuncie, es si un 5.2 llega siquiera como Sonnet — la última vez que la comunidad nombró con confianza un sucesor de Sonnet, el modelo que se lanzó fue un Fable.

Lo que no sería noticia: que aparezca un checkpoint en un arnés de evaluación, que aparezca un nombre en clave en un repositorio de un framework u otro tuit recopilatorio. Nada de eso cambia a qué puedes llamar, lo que cuesta o lo que puntúa.

Cómo posicionarse sin apostar por ello

El problema práctico de una actualización de nivel no verificada no es que puedas pasarla por alto. Es que prepararse para ella normalmente implica un trabajo que te molestaría tener que hacer dos veces —un segundo contrato con un proveedor, una segunda integración de SDK y un segundo conjunto de claves, límites y facturas.

Esa es la parte que conviene eliminar ahora en lugar de después. Claude Sonnet 5 está en OrcaRouter desde junio con el propio precio de Anthropic de $2 / $10, trasladado al precio de lista del proveedor sin ningún margen, así que un cambio de precio del proveedor en la línea Sonnet estaría activo aquí el mismo día en lugar de en el siguiente ciclo de facturación.

OrcaRouter model page for anthropic/claude-sonnet-5, showing Claude Sonnet 5 listed at Anthropic's prices of $2.00 input and $10.00 output per million tokens with a 1M token context window, 128K maximum output, and an Artificial Analysis Intelligence Index of 32 at rank 8

La misma clave ya llega al resto de la gama actual de Claude y a los más de 200 modelos de la plataforma, lo que significa que la llegada de un 5.2 no supone poner en marcha un proyecto de integración: aparece en el catálogo y tú diriges una porción del tráfico hacia él con una reserva de conmutación a Claude Sonnet 5 mientras averiguas si los cálculos de tokens por tarea funcionan realmente en tu carga de trabajo. La conmutación por error automática es lo que hace que sea seguro hacerlo con un modelo que nadie ha evaluado de forma independiente todavía.

Para cualquiera cuyo stack ya esté sobre claude-sonnet-5, la respuesta honesta a «¿debería esperar a Claude Sonnet 5.2?» es no: no hay nada que esperar, no hay fecha y no hay razón para creer que el modelo actual esté a punto de dejar de ser la opción predeterminada correcta. Lo que hay que hacer es que el cambio resulte barato, no hacerlo antes de tiempo.

¿Qué resolvería esto?

Tres cosas, en orden descendente según cuánto te dirían. Un identificador de API sería decisivo, porque un modelo que se está sirviendo tiene que tener un nombre en una solicitud, y así es como la historia de Marshmallow y Melon se volvió comprobable y como los informes de enrutamiento de Opus 5.2 se volvieron comprobables. Un reconocimiento del proveedor —una ficha de modelo, una página de documentación, una línea en un registro de cambios— zanjaría la discusión de inmediato. Un informe de un probador específico de un nivel, con una descripción del comportamiento en lugar de un nombre, sería el más débil de los tres y aun así más de lo que existe hoy.

Hasta que aparezca uno de esos, Claude Sonnet 5.2 es un nombre en una lista. Trátalo como una indicación para comprobar si tu stack puede absorber una actualización de Sonnet a bajo costo, y no como una razón para planificar en torno a una.