Una tarjeta principal generada para 'Claude Haiku 5.5 cuesta una décima parte', con la insignia 'EL CLAUDE MÁS BARATO' y el antetítulo 'ANTHROPIC, 7 DE OCTUBRE DE 2026' y el subtítulo 'Un recorte de tarifa del 90%, un tokenizador que añade alrededor de un 30% más de tokens, y un vídeo de lanzamiento que Anthropic no publicó.' Cuatro chips muestran '$0.10 de entrada', '$0.50 de salida', 'contexto de 1M' y '75% de ahorro real'. Dos tarjetas debajo están etiquetadas como 'LO QUE BAJÓ' ('entrada de $1.00 a $0.10, salida de $5.00 a $0.50 por 100,000 tokens') y 'LO QUE SUBIÓ' ('el mismo texto cuenta como aproximadamente un 30% más de tokens que antes'). Un pie de página dice 'Documentación de precios del proveedor consultada el 8 de octubre de 2026.' El logotipo de OrcaRouter está superpuesto en la esquina inferior derecha.
Guides & Insights

Claude Haiku 5.5: una reducción de precio del 90 %, un nuevo tokenizador y el video que Anthropic no publicó

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Alguien escribió una sola frase en Claude Haiku 5.5 y recibió de vuelta un filme de lanzamiento terminado. El prompt, publicado en X la noche del 7 de octubre de 2026, dice textualmente: «haz un video diez veces más brutal para tu lanzamiento que demuestre lo buen diseñador de movimiento que eres». El texto de la publicación tiene tres palabras —"One shotted this video"— y lleva el clip como archivo adjunto. Sin reintentos, sin storyboard, sin editor. Si eso es lo que hace ahora el modelo más barato de la línea Claude, ese nivel dejó de ser un compromiso.

Esa es la mitad interesante del lanzamiento. La otra mitad son las cuentas, y ahí es donde está la verdadera noticia: Claude Haiku 5.5 cuesta $0,10 por millón de tokens de entrada y $0,50 por millón de tokens de salida para prompts de hasta 100.000 tokens, frente a Claude Haiku 4.5, con su tarifa plana de $1 y $5. La propia nota al pie de Ant​hropic dice que eso es un 90% menos en el caso habitual — y luego dice, en la misma frase, que la cifra con la que debería planificar un comprador se acerca más al 75%. Ambas cifras son correctas, y la diferencia entre ellas es lo más importante de este lanzamiento.

Lo que Anthropic hizo constar el 7 de octubre

La publicación de lanzamiento del proveedor y su documentación de precios coinciden en la forma que tiene el asunto, y se trata de un paso más grande de lo que suele acompañar a un recorte de precios.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• Precio — $0,10 por millón de tokens de entrada y $0,50 por millón de tokens de salida para prompts de hasta 100.000 tokens. Por encima de ese umbral, la misma solicitud se factura a $0,50 y $2,50. Las lecturas de caché cuestan $0,01 por millón hasta 100 mil y $0,05 por encima de eso; las escrituras de caché son $0,125 y $0,625.

• Contexto — 1M de tokens, con un máximo de salida de 128.000 tokens. Es la misma ventana y el mismo límite de salida que ofrecen Claude Fable 5.1, Claude Opus 5.5 y Claude Sonnet 5.5, reproducidos en el nivel más económico.

• Pensamiento — pensamiento adaptativo con el parámetro effort, cuyo valor predeterminado es medium. Anthropic afirma que este es el primer modelo de la clase Haiku con una configuración de effort ajustable, lo que significa que el mismo id de modelo se puede ejecutar de forma económica o cuidadosa sin cambiar nada más.

• Tokenizador — el tokenizador más reciente compartido con Claude 4.7 y versiones posteriores, que «produce aproximadamente un 30 % más de tokens para el mismo texto». La documentación de Anthropic dice que el aumento exacto depende del contenido y de la forma de la carga de trabajo.

• Ciclo de vida — fecha límite de conocimiento: junio de 2026, y un compromiso de retiro de "no antes del 7 de octubre de 2027".

• Disponibilidad — la API de Claude, Amazon Web Services, Goo​gle Cloud, Microsoft Azure y Claude Platform on AWS, todos a la vez desde el primer día.

El sticker de 10x y la realidad del 75%

Diez veces más barato es la cifra que llegará más lejos, y es la que más probabilidades tiene de acabar en el lugar equivocado en el modelo presupuestario de alguien. Se aplica a prompts de hasta 100.000 tokens. Haiku 5.5 no mantiene esa tarifa durante toda la ventana.

• Hasta 100.000 tokens — $0,10 de entrada y $0,50 de salida, frente a los $1 y $5 de Haiku 4.5. Esa es la reducción del 90 %, y Anthropic dice que el 90 % de las solicitudes al modelo Haiku anterior caían en esta franja.

• Más de 100,000 tokens — $0.50 de entrada y $2.50 de salida. Todavía exactamente la mitad de lo que cobraba Haiku 4.5, en la misma solicitud, sin ningún límite que alcanzar.

• El tokenizador — el mismo texto se convierte en aproximadamente un 30 % más de tokens que en Haiku 4.5, así que la reducción por token no se traduce en una factura más baja de forma proporcional.

• El promedio del propio proveedor — Ant​hropic presenta la combinación como «alrededor de un 75 % menos de ejecución». Esa es su cifra, no una medición independiente, y es la que hay que poner en una previsión.

• Economía de la caché — las lecturas de caché bajaron de $0,10 a $0,01 por millón en la banda común, lo que importa más que la tarifa de entrada para cualquier pipeline que reenvíe un prefijo compartido largo.

La cifra del 75 % también explica algo que un lector podría interpretar de otro modo como una contradicción. Las dos cifras principales no están en conflicto; una es una tasa sobre una forma de solicitud, la otra es una estimación combinada sobre una mezcla real de tráfico que incluye la minoría de más de 100 K y los tokens adicionales del tokenizador. Si estás modelando el gasto, usa el 75 % y comprueba tu propia distribución de longitudes de prompt antes de creer que hay algo mejor.

Lo que el video afirma y lo que no

El clip es real, el prompt se cita textualmente arriba, y la marca de tiempo —19:49 UTC del 7 de octubre, aproximadamente el mismo día en que el modelo se lanzó— es verificable. La atribución corresponde a un usuario individual, no a Ant​hropic.

Esa distinción importa aquí, porque la propia página de producto de Ant​hropic para Claude Haiku 5.5 no incluye ningún vídeo incrustado: ni reproductor, ni archivo multimedia, solo un enlace al canal de YouTube de la empresa. Si se hizo un vídeo de lanzamiento con el modelo, el proveedor no lo ha dicho. Así que la afirmación precisa es limitada: un usuario informa haber generado un vídeo de lanzamiento de un solo intento con Claude Haiku 5.5, y publicó el prompt. Si fue de un solo intento, cuánto costó y cuánto de él sobrevivió a la edición son afirmaciones de una única fuente. Trata el clip como una demostración, no como un punto de referencia.

La razón por la que vale la pena mencionarlo de todos modos es que la generación de video no forma parte de las especificaciones del modelo. Haiku 5.5 recibe texto e imágenes y devuelve texto. Un resultado de diseño de movimiento con esa calidad implica que el modelo está impulsando otra cosa —una ruta de generación de código, un pipeline de renderizado, un bucle de herramientas— en vez de producir fotogramas por sí mismo. Eso es una afirmación sobre orquestación agéntica con $0.10 de entrada, que es la parte realmente sorprendente.

Los números que publicó Anthropic

La tabla de lanzamiento del proveedor es una comparación de antes y después frente a Haiku 4.5, con GPT-6 Luna y Claude Sonnet 5.5 en las mismas columnas para escala. Cada cifra a continuación es el resultado de evaluación reportado por la propia Ant​hropic, ejecutado en el harness de Ant​hropic, y se reproduce pero no se verifica de forma independiente.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• Trabajo de conocimiento — GDPval-AA v2.1 en 1620 frente a los 735 de Haiku 4.5, los 1437 de GPT-6 Luna y los 1840 de Sonnet 5.5. AA-Briefcase v1.1 en 1578 frente a 614, 1336 y 1824.

• Uso de computadora — OSWorld 2.1 con un 72,4 % en el subconjunto sin conexión, frente al 15,7 % de Haiku 4.5, el 48,9 % de GPT-6 Luna y el 83,9 % de Sonnet 5.5.

• Razonamiento multidisciplinario — Humanity's Last Exam con un 45,9 % sin herramientas y un 57,4 % con ellas, frente al 10,2 % y el 18,7 % de Haiku 4.5.

• Codificación agéntica: Terminal-Bench 4.0 con un 39,2% frente al 0,0%, el 16,4% y el 70,6%. FrontierCode 1.1 (Main) con un 46,4% frente al 42,4% de GPT-6 Luna y el 52,1% de Sonnet 5.5.

• Razonamiento visual — Chartography en un 46,4 % sin herramientas, frente al 6,4 %, el 29,1 % y el 61,6 %.

Ant​hropic también es inusualmente directa sobre dónde no gana la gama pequeña. Su propio comentario sobre el gráfico de Terminal-Bench dice que Sonnet 5.5 y Opus 5.5 «siguen siendo mejores opciones para tareas complejas de codificación agéntica», y posiciona a Haiku 5.5 para compactación, resumen y trabajo de subagentes en su lugar. Las citas de clientes en la publicación apuntan en la misma dirección y llevan la misma advertencia: son socios de acceso anticipado que describen sus propias evaluaciones, no auditorías: Asana informa más de un 30 % menos de latencia para completar tareas y una inferencia hasta 2,5 veces más rápida por turno de agente; HubSpot informa un 92,8 % promediado en tres ejecuciones en una suite de portales de CRM; AlphaSense informa 0,84 frente a 0,76 en 400 consultas sobre una carga de trabajo que realiza unas 8 millones de llamadas a la semana; Box informa 11 puntos más que Haiku 4.5 con aproximadamente la mitad de latencia; Rogo describe a un subagente de Haiku 5.5 extrayendo una línea de ingresos de segmento de un 10-K; y Cognition informa que Devin Fusion mantiene una puntuación de FrontierCode de 66,2 con Haiku 5.5 como compañero.

Lo que dice la junta independiente

Las tablas de los proveedores son de los proveedores. La primera cifra externa es la más útil para cualquiera que deba decidir si el nivel se movió lo suficiente como para cambiar un pipeline de producción.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis otorga a Claude Haiku 5.5 una puntuación de 43 en su Intelligence Index v4.3.2 en la configuración Max del modelo, lo que lo sitúa en segundo lugar de los 182 modelos de esa tabla y muy por encima de la mediana de esta, que es 13. La misma página mide 242 tokens de salida por segundo —el noveno de 182— y un coste de 0,21 $ por tarea del Intelligence Index.

Hay dos cosas en esa página que valen más que el titular. La primera es la verbosidad: al evaluar el Index, Artificial Analysis registró 440 millones de tokens de salida, frente a una mediana de 100 millones, y describe el modelo como "muy verboso". Se cobra un precio de etiqueta por token, así que un modelo que piensa durante mucho tiempo lo paga — que es exactamente por lo que la cifra de coste por tarea se sitúa en $0.21 en lugar de cerca de cero, y por lo que el recorte del 90 % de la entrada no lo explica todo. La segunda es la escala de esfuerzo: la misma página muestra configuraciones desde Max hasta Low, y la configuración predeterminada de Anthropic es medium, no max. El 43 del ranking es lo más alto de esa escala, no la configuración que obtienes si no haces nada.

Ejecutar el nivel por debajo del nivel que ya puedes invocar

Claude Haiku 5.5 no figura en el catálogo de OrcaRouter, y convendría decirlo con claridad en lugar de insinuar lo contrario: la brecha que hay el día del lanzamiento entre que un modelo exista y que sea enrutable suele ser de días, y a veces mayor.

Lo que hay hoy en el catálogo de Ant​hropic es Claude Haiku 4.5, Claude Sonnet 5.5 y Claude Opus 5.5, cada uno al precio de lista del proveedor, traspasado con un 0 % de margen, así que cualquier rebaja que haga Ant​hropic llega a nuestro lado el mismo día en que llega al suyo. Esa es la vía práctica para cualquiera que quiera probar ahora el patrón de subagentes: una cascada que envía los turnos rutinarios a Haiku 4.5 y escala los difíciles hacia arriba funciona hoy con una sola clave y un solo SDK, y cambiar más adelante la pata pequeña a Haiku 5.5 es un cambio de id de modelo y no una migración. La conmutación por error automática está por debajo de las patas que elijas, así que una mala tarde de un solo proveedor no se lleva la canalización consigo.

Si prefiere no esperar en absoluto, la misma banda de entrada de $0.10 ya está ocupada por GPT-6 Luna, que sí enrutamos, y que mantiene esa tarifa hasta los 272.000 tokens antes de subir de nivel.

Quién debería moverse, y quién no

Si tu carga de trabajo es clasificación, extracción, enrutamiento, compactación o resumen a escala, y tus prompts están por debajo de 100.000 tokens, el caso es sencillo: la tarifa es una décima parte de lo que era, la ventana es cinco veces más amplia, y el ajuste de esfuerzo te permite hacer el cambio contrario cuando una solicitud lo requiere. Presupuesta aproximadamente un 75 % menos y no te llevarás sorpresas.

Si tus prompts superan de forma habitual los 100.000 tokens, estás comprando un descuento del 50 % en lugar de uno del 90 %, y comparar precios para contextos profundos sigue mereciendo que le dediques una tarde: en el mercado hay varios modelos con una tarifa para más de 100 K igual o inferior a la de este nivel.

Y si tu eval sigue fallando en trabajo con forma de Terminal-Bench, este no es el modelo que lo arregla; lo dice la propia Anthropic, y el 39,2 % frente al 70,6 % de Sonnet 5.5 es la evidencia más clara del artículo. El resumen honesto del 7 de octubre es que el suelo de la inteligencia útil bajó muchísimo y el techo no se movió en absoluto.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario