
Claude Haiku 5.5 en OpenCode Go: qué compra realmente $10 al mes
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026, y en un día ya figuraba en los catálogos Go y Zen de OpenCode — las suscripciones de agentes de programación que miden una asignación mensual en dólares en lugar de facturar por tokens. Esa segunda inclusión es la parte que merece una pausa, porque la asignación que OpenCode ofrece para Claude Haiku 5.5 no es un descuento sobre el modelo. Es un medidor de presupuesto fijado al precio de lista del propio Anthropic, y cada cifra que hay detrás puede verificarse en las dos páginas que lo publican. Si aún estás decidiendo qué usar en lugar de Claude Haiku 4.5, la asignación es la decisión, no el precio de etiqueta.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Lo que Anthropic hizo constar el 7 de octubre
El proveedor no lanzó esto en silencio. La sala de prensa de Anthropic incluye un anuncio con fecha, una página de producto con una tabla de benchmarks, una tarjeta de sistema, una tabla de precios y seis citas de clientes con nombre y apellidos. No hay repositorio ni publicación de pesos que inspeccionar, porque no hay nada que publicar: Artificial Analysis registra Claude Haiku 5.5 como propietario, con el número de parámetros sin revelar. Cualquiera que describa esto como un modelo filtrado o no anunciado está leyendo un repositorio que no existe.
El propio planteamiento de Anthropic es un modelo de volumen más que uno de frontera:
• Posicionamiento — "el modelo pequeño más barato, más rápido y más capaz que hemos lanzado jamás", orientado a resúmenes, compactaciones, consultas a bases de datos y clasificación, y presentado como un subagente que se complementa con Claude Opus 5.5 y Claude Sonnet 5.5 en tareas de programación.
Precio — $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida para prompts de hasta 100.000 tokens; $0.50 y $2.50 por encima de eso. Lecturas de caché $0.01 / $0.05, escrituras de caché $0.125 / $0.625.
• Contexto y salida — una ventana de 1M de tokens con una salida máxima de 128.000 tokens, el mismo conjunto de capacidades que ofrecen los modelos más grandes de la gama 5.5, reproducido en el nivel más económico.
• Esfuerzo — el primer modelo de la clase Haiku con un ajuste de esfuerzo regulable, que abarca de Bajo a Máximo y cuyo valor predeterminado es Medio. Anthropic publica curvas de precisión frente a coste para cada ajuste, en lugar de una única cifra.
• Puntos de referencia, reportados por el proveedor y no reproducidos de forma independiente — GDPval-AA v2.1 1620 frente a los 735 de Claude Haiku 4.5; AA-Briefcase v1.1 1578 frente a 614; OSWorld 2.1 72,4 % frente a 15,7 %; Humanity's Last Exam 45,9 % sin herramientas y 57,4 % con ellas, frente a 10,2 % y 18,7 %; Terminal-Bench 4.0 39,2 % frente a 0,0 %; Chartography 46,4 % frente a 6,4 %.
• El propio techo del proveedor — el comentario de Anthropic sobre su gráfico de Terminal-Bench dice que Claude Sonnet 5.5 y Claude Opus 5.5 "siguen siendo mejores opciones para tareas complejas de codificación agéntica". Las citas de clientes en la misma publicación son de socios de acceso anticipado que describen sus propias evaluaciones, no auditorías: Asana reporta más del 30% menos de latencia y hasta 2.5 veces más rápida la inferencia por turno de agente, HubSpot 92.8% en promedio de tres ejecuciones, AlphaSense 0.84 frente a 0.76 en 400 consultas en una carga de trabajo de aproximadamente 8 millones de llamadas por semana, Box 11 puntos más alto con aproximadamente la mitad de la latencia, y Cognition una puntuación de FrontierCode de 66.2 con Haiku 5.5 como compañero.

Anthropic también aprovechó el lanzamiento para mover dos precios adyacentes: las lecturas de caché en Claude Sonnet 5.5 se redujeron a la mitad, a $0.10 por millón de tokens, lo que, según la empresa, hace que Sonnet 5.5 sea alrededor de un 20% más barato en la mayoría del trabajo agéntico; y un nuevo crédito mensual de API para los suscriptores de Claude Max y Team. Ambos son cambios en el nivel superior, y ambos importan más a un equipo que ya está estandarizado en Sonnet que a cualquiera que busque un modelo pequeño.
La asignación es un presupuesto en dólares, no un descuento
Esta es la parte que el tuit de anuncio no menciona. La documentación de Go de OpenCode afirma que «los límites de uso se definen como cantidades mensuales en dólares», que el precio de los tokens es el mismo en ambos planes y que la asignación de cada modelo disminuye según un calendario fijo: 20% del límite mensual cada cinco horas, 50% por semana, 100% por mes. La documentación también publica el perfil de tokens por solicitud que asume para este modelo: 1.100 tokens de entrada, 55.000 tokens en caché, 240 tokens de salida.
Pasa esos datos por el precio de lista de Anthropic y los recuentos de solicitudes publicados dejan de parecer una asignación arbitraria:
• Coste por solicitud a precio de lista — 1.100 de entrada a $0,10/M más 55.000 lecturas en caché a $0,01/M más 240 de salida a $0,50/M asciende a $0,00078.
• La cantidad de solicitudes mensuales — $15 dividido entre $0,00078 da 19.230, que es la cifra que imprime la documentación. La asignación de $60 del plan de $40 da 76.923, y la documentación imprime 76.920.
• La reducción gradual — el 20 % de 19.230 es 3.846, que se imprime como 3.850 por cada cinco horas; el 50 % es 9.615, que se imprime como 9.620 por semana. Go Plus sigue la misma aritmética con 15.380 y 38.460.
• Qué significa eso en dólares: la asignación equivale a $15 en tokens con precios de Anthropic en el plan de $10 y a $60 en el plan de $40. Por lo tanto, una suscripción de $10 compra como máximo $15 al mes en tokens de este modelo si gastas toda la asignación en Claude Haiku 5.5 y nada más.
Esa es la forma honesta de leer la insignia «Nuevo» en la página de Go. La suscripción es barata, el modelo es barato, y ambos hechos son independientes: la asignación es un presupuesto medido a la tarifa del propio proveedor, así que el plan limita cuánto puedes gastar en lugar de lo poco que cuesta el modelo. Los usuarios intensivos alcanzan el techo y pagan directamente a Anthropic —o enrutan el modelo por su cuenta.

Noventa por ciento, setenta y cinco por ciento, y el acantilado de cinco veces
El titular de Anthropic es que Claude Haiku 5.5 cuesta alrededor de un 90% menos que Claude Haiku 4.5 para prompts de hasta 100.000 tokens, y que, en promedio, "ahora cuesta alrededor de un 75% menos ejecutarlo". Ambas cifras son del proveedor. También son ambas correctas, y la diferencia entre ellas constituye todo el riesgo de precios.
• Dentro de la banda — $0,10 de entrada y $0,50 de salida, frente a la tarifa plana de $1 y $5 de Haiku 4.5. Anthropic dice que alrededor del 90 % de las solicitudes a su modelo Haiku anterior caían dentro de esta banda, que es de donde proviene la cifra del 90 %.
• Por encima de la banda — la misma solicitud se factura a $0.50 de entrada y $2.50 de salida, un aumento de cinco veces en la entrada. Eso sigue siendo la mitad de la tarifa de Haiku 4.5, pero no se acerca ni de lejos a un recorte del 90%.
• La cifra combinada — ese 75 % es una estimación de Anthropic basada en una combinación real de tráfico, no una tarifa, y es el número que hay que poner en un pronóstico.
• El tokenizador — el tokenizador más reciente, compartido con Claude 4.7 y versiones posteriores, produce aproximadamente un 30 % más de tokens para el mismo texto, según la propia documentación de Anthropic, por lo que un recorte por token no se traduce uno a uno en una factura más baja.
El dial de esfuerzo lo agrava todo. Como el valor predeterminado es medio y las curvas publicadas llegan hasta Max, el mismo prompt puede costar varias veces más según un parámetro que la mayoría de quienes llaman nunca configura, y las estimaciones de solicitudes de OpenCode asumen un perfil de tokens fijo en una configuración implícita. Si tus prompts rondan los 100.000 tokens, ejecutas un subagente de uso acotado o mueves el dial de esfuerzo, la cifra destacada del 90 % no es el número que verás.
El consejo independiente coincide en la puntuación y señala sus propias matemáticas
Artificial Analysis otorga a Claude Haiku 5.5 una puntuación de 43 en su Intelligence Index v4.3.2 en la configuración Max del modelo, frente a una mediana de la tabla de 13, y mide 241,9 tokens de salida por segundo frente a una mediana comparable de 110,9. El mismo sitúa el coste en $0,21 por tarea del Intelligence Index e informa de que el modelo generó 440 millones de tokens de salida durante la evaluación frente a una mediana de 100 millones — describiéndolo como «muy verboso».
La verbosidad es donde interactúan las dos tablas. El cálculo de la cuota anterior se cobra por token, así que un modelo que razona extensamente consume el presupuesto más rápido de lo que sugiere el recuento de solicitudes, y el perfil por solicitud de OpenCode de 55.000 tokens en caché es una suposición sobre el almacenamiento en caché de prompts que un usuario con suscripción puede reproducir o no. Dos revelaciones de la página de Artificial Analysis valen más que su titular: el 43 corresponde a la configuración Max y no al ajuste de esfuerzo que se obtiene sin hacer nada, y la página incluye una nota explícita de que Claude Haiku 5.5 «tiene un precio 5 veces mayor en las entradas de contexto más largo, lo cual no se refleja actualmente» en sus cifras de coste. El precipicio del contexto largo es real, y la tabla independiente ya te ha dicho que aún no aparece en sus propias cifras.

La línea de retención que la mayoría de los compradores se saltará
La documentación de Go de OpenCode incluye una tabla de privacidad por modelo, y esta es la fila en la que Claude Haiku 5.5 se diferencia de la mayor parte del catálogo. La formulación del propio proveedor es retención cero con excepciones. La mayoría de los modelos de esa tabla de Go indican «0 días». Este indica «30 días», con la nota de que las solicitudes se conservan durante 30 días de acuerdo con las políticas de datos de Anthropic —el mismo tratamiento que se da a GPT-6 Luna y GPT-5.6 Luna, y lo contrario de las filas de cero días que constituyen la mayor parte de la lista.
Para un agente de programación, eso significa que los prompts, las rutas de archivo y el código fuente pegado pueden permanecer con el proveedor upstream durante un mes, en un plan cuyo lenguaje de marketing es retención cero. Eso no es una razón para evitar el modelo; es una razón para leer la fila en lugar del banner. Mientras tanto, nada en los materiales de lanzamiento de Anthropic cambia la postura del lado de la API: la API de Claude ha ofrecido retención de datos cero, y los términos de retención de la tarjeta del modelo son los que rigen una integración directa.
Qué está confirmado, y qué no
El conjunto de lo confirmado es amplio y específico, algo inusual para un modelo tan nuevo. Lo que no está confirmado es más acotado, y merece nombrarse en lugar de pasarse por alto:
• Confirmado — el modelo existe, es solo mediante API bajo el id claude-haiku-5-5, se lanzó el 7 de octubre en la API de Claude además de Amazon Web Services, Google Cloud y Microsoft Azure, a los precios anteriores, con una ventana de 1M de tokens, esfuerzo ajustable y una tarjeta de sistema publicada.
• Confirmado — dos plataformas de terceros lo tienen listado con ids de modelo, endpoints y cuotas medidas el mismo día.
• Sin confirmar — ningún benchmark independiente que podamos encontrar ha reproducido la tabla del proveedor. Todas las cifras de precisión de la publicación de lanzamiento de Anthropic provienen del propio entorno de pruebas de Anthropic, y cada testimonio de cliente es una prueba temprana autoinformada por un socio.
• No confirmado — no hay pesos, ni repositorio, ni checkpoint, ni licencia que inspeccionar. El modelo es cerrado, y cualquier afirmación sobre su arquitectura o tamaño es una inferencia.
• No confirmado — si las estimaciones de solicitudes de la plataforma se mantienen para algo distinto de su perfil de tokens asumido, y si (o cuándo) el precio 5x de contexto largo llega a las cifras de costes de los tableros independientes.
Ejecutándolo junto a lo que ya llamas
La pregunta práctica que crea este lanzamiento no es «¿es bueno Haiku 5.5?» —la tabla del proveedor dice que sí, y nadie fuera de Anthropic lo ha comprobado. Es «¿cuál es la factura, y qué pasa cuando el nivel barato no es el nivel adecuado para esta llamada en particular?». Ambas mitades son problemas de enrutamiento.
En cuanto al coste, el medidor es la factura de tokens, no el precio de etiqueta: un recorte del 90 % en la entrada, más un tokenizador un 30 % más grande, más un modelo de razonamiento verboso, más un salto de contexto largo de cinco veces, significa que la cifra que pronosticas y la cifra que pagas divergen a menos que midas tu propia distribución de longitud de prompts. Un modelo que es 5 veces más caro por encima de 100.000 tokens recompensa la compactación —y Haiku 5.5 se presenta precisamente como el modelo de compactación, lo cual es un bucle que merece la pena notar.
En materia de riesgo, un nivel sin probar es exactamente el caso en el que no conviene apostar por él una ruta de producción. Claude Haiku 4.5 ya está en OrcaRouter al precio de lista de Anthropic con un 0% de recargo, así que el nivel antiguo no necesita ningún contrato nuevo, y una ruta que recae de un modelo nuevo a uno conocido es un cambio de configuración, no una reescritura. El parámetro effort es por llamada, lo que significa que el mismo endpoint puede ejecutar un resumen con effort bajo y una extracción difícil con effort alto sin mantener dos integraciones — el DSL de enrutamiento existe precisamente para este tipo de decisión, y la conmutación por error automática es lo que te permite poner un modelo con solo días de antigüedad frente a tráfico real antes de tener cifras independientes sobre él. Lo que todavía no es cierto es lo obvio: Claude Haiku 5.5 no está en nuestras rutas hoy, y si lo quieres esta semana tendrás que llamar directamente a Anthropic o pasar por la plataforma que lo anunció.
Quién debería dar el paso: los equipos cuyo volumen son resúmenes, clasificación, compactación y trabajo de subagentes, donde aplica la banda del 90% y el 30% del tokenizador es aritmética que puedes absorber. Quién debería esperar: cualquiera cuyos prompts superen de forma habitual los 100.000 tokens, cualquiera que necesite un benchmark independiente antes de comprometerse, y cualquiera cuyo código no pueda permanecer en una ventana de retención de 30 días. El lanzamiento es real y el precio es real. La prueba sigue siendo del proveedor.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
