Tarjeta destacada de la filtración de Claude Opus 5.5 titulada «Claude Opus 5.5: una filtración, etiquetada», con la línea «Checkpoint, según se informa, se llama claude-wafer-eap — sin lanzar, sin confirmar, una sola fuente» y tres tarjetas etiquetadas: Afirmado — versión 5.5, lanzamiento tan pronto como el mar. 22 de sep.; Verificado — Opus 5.2 se sirvió bajo la etiqueta Opus 5, del 14 al 17 de sep.; Sin confirmar — nombre en clave y alias del filtrador: sin una segunda fuente
Guides & Insights

Filtración de Claude Opus 5.5: un checkpoint llamado «claude-wafer-eap» y un lanzamiento rumoreado para el martes

Autor

Alistair Wren

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

La afirmación que circula este fin de semana es lo bastante concreta como para verificarla y lo bastante frágil como para desmoronarse al hacerlo: se dice que un nuevo checkpoint para la próxima actualización de Opus, ahora etiquetado Claude Opus 5.5, ya está disponible, con un nombre en clave interno —"claude-wafer-eap"— y un lanzamiento que podría llegar tan pronto como el martes 22 de septiembre. La fuente es la cuenta de X @kimmonismus, que retransmite a un filtrador llamado Lyra. No hay ficha de modelo, ni identificador de API, ni hoja de precios, ni benchmark, ni un segundo medio que informe de la misma cadena de checkpoint. Lo que sí hay, por debajo de la afirmación, es un acontecimiento real y bien documentado: Claude Opus 5.2, la compilación de Opus no publicada que se estaba sirviendo a una porción del tráfico bajo una etiqueta "Opus 5" sin cambios hasta mediados de septiembre, y que el proveedor cortó brevemente la noche del 17 de septiembre. Eso sí está corroborado por múltiples medios. Todo lo que está por encima es la palabra de una sola cuenta. Y hay una tercera cosa que merece atención, que es lo que la filtración le hace al propio número de versión: Claude Opus 5 se lanzó el 24 de julio a 5,00 $/25,00 $ por millón de tokens y sigue siendo el Opus de disponibilidad general más avanzado del proveedor; Claude Fable 5.1 llegó el 1 de septiembre. Si el próximo Opus es realmente el 5.5, entonces la nomenclatura ha saltado por encima del 5.3 y el 5.4, y el número hace más trabajo en esta historia que cualquier benchmark.

Lo que la filtración afirma en realidad

Si se quita el envoltorio, hay cuatro afirmaciones. Primera, que existe un checkpoint: un modelo que ha sido entrenado, guardado y se está preparando en algún lugar. Segunda, que su número de versión es 5.5, no 5.2 ni 5.3. Tercera, que lleva un nombre en clave, "claude-wafer-eap", donde "eap" se lee como programa de acceso anticipado en la abreviatura habitual de los proveedores. Cuarta, que el lanzamiento es inminente, posiblemente el martes.

Cada una de esas es un tipo diferente de afirmación, y no están respaldadas por igual. La cuarta es la que tiene evidencia externa detrás, y esa evidencia apunta a una fecha, no a un nombre en clave. Los mercados de predicción sobre el próximo lanzamiento de Claude Opus abrieron el 16 de septiembre y habían agrupado la mayor parte de su probabilidad implícita entre el 21 y el 24 de septiembre, con una parte significativa del volumen aún respaldando "ningún lanzamiento antes del 30 de septiembre". Las reglas de resolución del mercado son estrictas: el modelo tiene que ser de acceso público, y tiene que llamarse explícitamente Opus. Los lanzamientos Fable, Mythos, Sonnet y Haiku no cuentan. "Claude Opus 5.5" aparece en la propia lista de nombres elegibles de ese mercado —que es donde la cadena con mayor probabilidad entró en circulación, y que es una lista de posibilidades, no un informe de un avistamiento.

El nombre en clave es el eslabón más débil. «claude-wafer-eap» aparece en el texto de la señal y, hasta donde podemos determinar, en ningún otro lugar: ninguna referencia de repositorio, ningún slug de API, ninguna filtración de configuración, ninguna cuenta que lo corrobore. Los nombres en clave son exactamente el tipo de detalle que se propaga porque suena verificable. Trata este como no verificado hasta que una segunda fuente independiente produzca la misma cadena. Lo mismo se aplica a la atribución de «Lyra» —un alias de filtrador sin historial con el que podamos contrastarlo.

¿Qué se verifica realmente?

La línea base verificada es Claude Opus 5, y está inusualmente bien documentado, lo que lo hace útil como vara de medir. Anthropic lo lanzó el 24 de julio de 2026 —sin un 5.1 de por medio— con una ventana de contexto de 1M de tokens, hasta 128K tokens de salida (300K mediante un encabezado beta en la Batch API), pensamiento adaptativo activado por defecto, y cinco niveles de esfuerzo de razonamiento, de bajo a máximo. El precio es fijo: $5.00 por millón de tokens de entrada y $25.00 por millón de tokens de salida en cualquier longitud de prompt, igual que Opus 4.8 antes, con la Batch API a la mitad. Artificial Analysis lo sitúa en la cima de su Intelligence Index, con la puntuación exacta dependiendo de la variante de esfuerzo que se mire —un detalle que conviene retener, porque un marcador de "5.5" no será comparable con uno de "5" a menos que la configuración de esfuerzo coincida.

Artificial Analysis model page for Claude Opus 5 (Adaptive Reasoning, Max Effort), showing 7th of 200 on the Intelligence Index, released July 2026, $5.00 input and $25.00 output per million tokens with a 90% cache discount, and a 1M token context window

A eso se suma el evento corroborado de septiembre. Del 14 al 15 de septiembre aproximadamente, los desarrolladores informaron que una pequeña proporción probabilística de las solicitudes dirigidas nominalmente a Opus 5 estaba siendo respondida por un modelo de backend diferente, con metadatos de solicitud que apuntaban a un claude-opus-5.2 no lanzado — un número de versión que se salta por completo la 5.1. Los comportamientos reportados incluían una salida más concisa y una autoiteración no solicitada: escribir código, ejecutar pruebas, corregir fallos, repetir hasta que las pruebas pasen, en lugar de detenerse a medio terminar. El truco de detección que circuló junto a esto —preguntar al modelo una pregunta específica sobre una persona que no debería conocer, con la búsqueda y la memoria desactivadas— era una forma de saber qué backend respondía. En la noche del 17 de septiembre, Anthropic cortó el canal sin previo aviso, un evento que la comunidad de desarrolladores apodó el "shock de medianoche"; el canal volvió aproximadamente un día después y, según esos informes, se amplió de Claude Code a las superficies de chat y cowork. Ninguna tarjeta de modelo, tabla de precios, identificador de API ni declaración oficial acompañó nada de esto.

El número de versión lo dice todo

Aquí está la parte que la filtración acierta estructuralmente, aunque cada dato concreto sea erróneo. Anthropic ya ha demostrado, dos veces este año, que iterará el nivel Opus sin un evento de lanzamiento: 4.8 a finales de mayo, 5 el 24 de julio omitiendo la 5.1, y luego una 5.2 que existió en producción sin existir públicamente. Un proveedor que distribuye mediante enrutamiento de backend y controla la proporción de despliegue también puede decidir, en el último momento, qué número imprimir en la caja. Si el próximo Opus se anuncia como 5.5 en lugar de 5.2, esa es una decisión de marketing tomada después del trabajo técnico, y es el tipo de decisión de la que un filtrador se entera tarde y de forma imprecisa.

Eso tiene una doble lectura para cualquiera que lea esto. Un número de versión filtrado es una evidencia débil sobre la capacidad y una evidencia fuerte sobre el posicionamiento. Si el número realmente es 5.5, implica un salto mayor del que habría implicado 5.2 —y da a entender que Anthropic quiere que el mercado lo interprete así, antes de una IPO que, según se informa, la empresa ha empujado hacia noviembre. Reuters informó el 18 de septiembre, citando tres fuentes, que Anthropic está evaluando si lanzar un nuevo modelo específicamente para responder al impulso empresarial de GPT-6 Astra, mientras su director ejecutivo pide públicamente a la industria que baje el ritmo. Un número más grande en el mismo checkpoint no cuesta nada y compra un titular. Eso no es una razón para no creer la filtración; es una razón para no tener en cuenta el número a la hora de tomar una decisión.

¿Qué tendría que ser cierto el martes?

Un lanzamiento el 22 de septiembre sería verificable en unos cinco minutos, y vale la pena nombrar ahora las comprobaciones para que el anuncio —si llega— pueda leerse en lugar de absorberse.

• Disponibilidad — una tarjeta de modelo pública, un identificador de modelo de API que devuelve completions, o una lista de espera abierta y continua. Una beta cerrada no califica, y los mercados de predicción generalmente se resuelven en su contra. Esta es la línea que separa "lanzado" de "probado en algunas cuentas".

• Precios — si el nuevo Opus mantiene el nivel de $5.00/$25.00, lo cambia o llega con una tarifa promocional. Opus 5 mantuvo exactamente el precio de Opus 4.8, que es el patrón que cabe esperar y, por lo tanto, lo que hay que comprobar.

• Límites de contexto y de salida — el contexto de 1M y la salida de 128K del Opus 5 (300K en Batch) son el mínimo actual. Un nuevo Opus que se lanzara con menos sería una degradación disfrazada de lanzamiento.

• Puntuación independiente — una entrada de Artificial Analysis con un nivel de esfuerzo declarado, no un gráfico de proveedor. Actualmente no se ha reproducido ninguna de las afirmaciones sobre capacidades de la filtración, y una tarjeta de modelo por sí sola no cambiará eso.

• El comportamiento de enrutamiento — si el comportamiento conciso y autoiterativo descrito en los reportes de las pruebas cerradas sigue presente en la versión pública, o si se trató de un artefacto de las pruebas. Ese cambio de comportamiento es lo más concreto que los desarrolladores observaron realmente, y es lo que más probabilidades tiene de ser eliminado discretamente antes del lanzamiento.

A two-column scoreboard for the Claude Opus 5.5 leak: left column 'Claude Opus 5.5 (reported)' lists status unreleased single source, codename claude-wafer-eap unconfirmed, version number reportedly 5.5, reported release as early as Tue Sep 22, no published pricing, and no independent benchmarks; right column 'Claude Opus 5 (verified)' lists generally available since Jul 24, codename n/a, version number 5, shipped Jul 24 2026, $5.00 / $25.00 per million, and top of the Artificial Analysis Index

Probar un Claude no probado sin apostar por él una ruta de producción

La incómoda brecha en una semana como esta es que el modelo que todos quieren evaluar es el que nadie puede llamar. Lo que puedes llamar hoy es Claude Opus 5 — y si aparece un 5.5, la pregunta práctica pasa a ser cómo dirigir una porción de tráfico real hacia él sin reescribir tu integración ni comprometer una ruta crítica a un modelo sin benchmarks independientes.

Ese es el caso para el que se diseñó el enrutamiento. OrcaRouter pone la gama actual de Claude detrás de una sola clave de API al precio de lista del proveedor, con un 0% de recargo —Claude Opus 5 a los $5.00/$25.00 de la propia Anthropic, las mismas cifras que publica el proveedor, de modo que un cambio de precio del proveedor está activo en nuestro lado el mismo día y no después de una sincronización. Cuando se lance un nuevo Opus, será una ruta más en lugar de un segundo contrato: puedes enviar un porcentaje del tráfico hacia él, mantener la conmutación automática por error apuntando a un modelo que ya hayas caracterizado, y comparar los resultados con tus propios prompts en lugar de con un benchmark filtrado. Componer una llamada entre varios modelos —un borrador de uno, una pasada de verificación de otro— es una línea del DSL de enrutamiento en lugar de un nuevo servicio.

OrcaRouter model page for anthropic/claude-opus-5, showing Claude Opus 5 by Anthropic dated 2026-07-24 with a 1M token context window, 128K max output, input $5.00 and output $25.00 per million tokens, p50 time to first token 9.49 seconds, and 975.4M tokens of traffic in seven days

Para ser explícitos sobre lo que no estamos diciendo: no hay ningún Claude Opus 5.5 en OrcaRouter, porque no hay ningún Claude Opus 5.5 que enrutar. No tendremos uno hasta que Anthropic lance uno, y este artículo no es una vista previa de una página de producto. Todo lo que aparece en este texto sobre 5.5 es un informe de un informe.

Qué observar y qué ignorar

Vigila el identificador del modelo. Un slug de API que funcione es la diferencia entre un lanzamiento y un rumor, y es el artefacto que una filtración no puede falsificar por mucho tiempo. Vigila la tabla de precios, porque es donde Anthropic te dice a qué nivel cree que pertenece el modelo. Vigila si el enrutamiento de las pruebas en gris se reanuda antes de un anuncio: un canal reampliado es una señal mucho más fuerte que un tuit, y el corte y restauración del 17 de septiembre ya mostró cómo se ve ese canal desde fuera.

Por ahora, ignora el nombre en clave. «claude-wafer-eap» es una cadena de una sola fuente y sin corroboración, y lo mismo ocurre con la atribución a «Lyra» que está detrás. Ignora el número de versión como evidencia de algo que no sea el posicionamiento. E ignora cualquier marcador que aparezca en las primeras 48 horas que compare un Opus 5 público con un 5.5 que nadie ha ejecutado de forma independiente —incluido el nuestro, si construimos uno—, hasta que haya algo real en ambos lados de la comparación.

Si el martes pasa sin un lanzamiento, la filtración no queda por ello desmentida; el episodio de Opus 5.2 de septiembre fue en sí mismo el caso de un modelo que existió en producción durante días antes de que nadie pudiera nombrarlo. La postura honesta hasta entonces es la que respaldan las pruebas: una build real de Opus no publicada se estaba sirviendo discretamente hace una semana, una ventana de lanzamiento real está descontada en el mercado para esta semana, y una cuenta le ha atribuido un número, un nombre en clave y una fecha que nadie más ha confirmado.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario