Una tarjeta de título principal generada con la insignia "Disponibilidad general en GitHub Copilot - 7 de octubre de 2026", con el antetítulo "Informe de disponibilidad de modelos", titulada "Claude Haiku 5.5 en GitHub Copilot", con el subtítulo "Diez veces más barato por token que el Haiku al que reemplaza, hasta que una solicitud supere los 100.000 tokens", tres chips que dicen "$0,10 / $0,50 por M", "1 crédito de IA = $0,01" y "Pro: 1.500 créditos/mes", y tres tarjetas para "Nivel corto: menos de 100K tokens", "Nivel largo: 5x cada tarifa" y "Aún no está en nuestro catálogo: Claude Haiku 4.5 está".
Guides & Insights

Claude Haiku 5.5 ya está en GitHub Copilot: cuánto cuesta el modelo más barato de Anthropic dentro de un presupuesto de créditos

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Haiku 5.5 apareció en el selector de modelos de GitHub Copilot el 7 de octubre de 2026 —el mismo día en que el proveedor lo lanzó—, y la entrada del registro de cambios que lo anunció dedica la mayor parte de su extensión a las superficies. Visual Studio Code, Visual Studio, Copilot CLI, el agente en la nube de GitHub Copilot, la aplicación Copilot, github.com, GitHub Mobile en iOS y Android, los IDE de JetBrains, Xcode, Eclipse. La frase que importa si controlas el presupuesto es más corta: el modelo se factura "al precio de lista del proveedor con facturación basada en el uso". Dentro de Copilot, eso significa créditos de IA, y las tarifas de Claude Haiku 5.5 son lo bastante bajas como para que la aritmética de los créditos se convierta en la parte interesante del lanzamiento en lugar de una idea de último momento. Este artículo hace esa aritmética, separa lo que GitHub ha demostrado realmente de lo que solo ha afirmado, y cubre dos excepciones en la propia documentación del proveedor que la cobertura del lanzamiento omitió en su mayoría.

Qué lanzó GitHub y a quién

La entrada se titula, sin más, «Claude Haiku 5.5 in GitHub Copilot», y se publicó a las 13:12, hora del Pacífico, del 7 de octubre. Está disponible para los suscriptores de Copilot Pro, Pro+, Max, Business y Enterprise, es decir, para todos los niveles de pago y, notablemente, no para el nivel gratuito, donde la selección del modelo aún se gestiona de forma automática en lugar de por el usuario. El despliegue es gradual, por lo que el selector de tu editor puede ir con días de retraso respecto al registro de cambios; eso se indica en la propia entrada en lugar de dejarlo para que lo descubras por tu cuenta.

El propio planteamiento de GitHub sobre para qué sirve el modelo merece una lectura atenta, porque es más limitado que el del proveedor:

• Trabajo rápido y de gran volumen —subagentes, ediciones rápidas y tareas de terminal, en palabras del propio GitHub • No se posiciona como un reemplazo de los modelos grandes del selector, sino como el nivel económico que va por debajo de ellos • Disponible de forma general, según la referencia de modelos compatibles de GitHub, que incluye Claude Haiku 5.5 como disponible de forma general, con un estado de GA • También aparece en esa referencia con una fila de versión de IDE marcada como TBD, que es la razón práctica por la que el despliegue se percibe como gradual desde el lado del editor • Con el precio de lista del proveedor bajo facturación por uso, en lugar de un recargo específico de Copilot img src="2.png"> p>Las fechas del registro de cambios que lo rodean aportan el contexto de cadencia que una sola página de modelo no puede ofrecer. Claude Sonnet 5.5 llegó a Copilot el 28 de septiembre, Claude Opus 5.5 el 22 de septiembre y Claude Fable 5.1 el 1 de septiembre. Anthropic está lanzando una integración con Copilot aproximadamente cada dos a cuatro semanas, y GitHub resuelve cada una en cuestión de días. Esa cadencia es también la razón de que el reloj esté corriendo: GitHub publicó a mediados de septiembre un aviso de descontinuación para "determinados modelos de GitHub Copilot" a mediados de octubre, y después un seguimiento el 2 de octubre en el que confirmaba las eliminaciones. Si tu equipo está fijando un modelo en una configuración de Copilot, ahora lo más probable es que lo que se rompa sea la fijación, no el precio.

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

La lista de tarifas, leída como un libro mayor de créditos

Claude Haiku 5.5 factura en dos niveles, determinados por el tamaño de la solicitud y no por ninguna configuración que elijas. Todo lo que aparece a continuación es la propia tabla de tarifas publicada por GitHub, y todo está expresado por millón de tokens:

• Con 100.000 tokens de entrada o menos — $0,10 de entrada, $0,01 de entrada en caché, $0,125 de escritura en caché, $0,50 de salida • Por encima de 100.000 tokens de entrada — $0,50 de entrada, $0,05 de entrada en caché, $0,625 de escritura en caché, $2,50 de salida • Claude Haiku 4.5, en contraste — $1,00 de entrada, $0,10 de entrada en caché, $1,25 de escritura en caché, $5,00 de salida • Claude Sonnet 5.5, el nivel superior — $2,00 de entrada, $0,10 de entrada en caché, $2,50 de escritura en caché, $10,00 de salida • Las escrituras en caché se facturan por separado en los modelos de Anthropic, por encima y más allá de la entrada en caché: una línea de facturación que no existe en todos los proveedores del selector img src="3.png"> p>De leer esas filas en conjunto se desprenden dos cosas. Primero, el nivel corto de Claude Haiku 5.5 es exactamente diez veces más barato que Claude Haiku 4.5 tanto en entrada como en salida, y aproximadamente veinte veces más barato en entrada que Claude Sonnet 5.5, que es la razón principal por la que pertenece a los espacios de subagentes, donde una flota de llamadas pequeñas multiplica lo que pagues por llamada. Segundo, el nivel de contexto largo es exactamente cinco veces el corto en todas las tarifas a la vez, en la misma línea de 100.000 tokens. Una solicitud de 99.000 tokens y una de 101.000 tokens no se diferencian un 2 por ciento en los tokens que cruzaron la línea; se diferencian cinco veces en todos ellos. Ese escalón se hereda directamente del precio de lista de Anthropic, y el sistema de créditos de Copilot no lo suaviza.

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

Ahora los créditos. La facturación basada en el uso de Copilot convierte el uso del modelo en créditos de IA a una tarifa documentada de $0.01 por crédito, y cada plan incluye una asignación mensual:

• Copilot Pro, $10 al mes — 1.500 créditos, anunciados como 1.000 base más 500 flexibles • Copilot Pro+, $39 al mes — 7.000 créditos, anunciados como 3.900 base más 3.100 flexibles • Copilot Max, $100 al mes — 20.000 créditos, anunciados como 10.000 base más 10.000 flexibles • Copilot Business, $19 por asiento al mes — 1.900 créditos por usuario • Copilot Enterprise, $39 por asiento al mes — 3.900 créditos por usuario • Las bolsas de organización y empresa se comparten entre asientos en lugar de aislarse por usuario • El uso que supera la bolsa se factura a $0,01 por crédito — la misma conversión, aplicada al excedente • Las completaciones de código y las sugerencias de siguiente edición quedan por completo fuera de la facturación por créditos y siguen siendo ilimitadas en los planes de pago p>Si juntamos ambas cosas, la forma del lanzamiento se vuelve concreta. Tomemos un paso de agente de tamaño moderado — 40.000 tokens de entrada, 2.000 tokens de salida, sin caché. En el nivel corto de Claude Haiku 5.5, eso es 40.000 por $0,10 por millón más 2.000 por $0,50 por millón, o $0,005, que es medio crédito según la conversión documentada. La misma llamada con las tarifas de Claude Haiku 4.5 asciende a $0,05, o cinco créditos. La aritmética aquí es nuestra, no de GitHub, pero los datos de entrada provienen todos de la tarjeta de tarifas publicada, y la conclusión no es sutil: la bolsa de 1.500 créditos de un suscriptor Pro absorbe aproximadamente 3.000 llamadas de ese tipo con el nuevo Haiku, mientras que absorbía aproximadamente 300 con el antiguo. La bolsa se vuelve diez veces más larga sin que cambie la suscripción.

Esa es la propuesta de valor honesta, y conlleva la advertencia honesta de que la bolsa se cotiza en créditos en lugar de dólares, por lo que el techo real de un plan cambia cada vez que cambia una tarifa. Un recorte de diez veces en un modelo no multiplica por diez una bolsa si tu tráfico se reparte entre tres.

Lo que GitHub dice que hace el modelo, y lo que no ha demostrado

El registro de cambios contiene una única afirmación de rendimiento, y está haciendo más trabajo en la cobertura del que puede soportar. GitHub escribe que, en pruebas preliminares, Claude Haiku 5.5 «igualó a Claude Sonnet 5 en muchas tareas de programación» mientras usaba «significativamente menos tokens y pasos».

Lee los condicionantes en orden. Es una prueba temprana. Es una prueba de GitHub, sobre tareas de GitHub, y GitHub es la parte que vende la integración. No se nombra ningún arnés, no se publica ningún conjunto de tareas, ninguna cifra acompaña a ninguna de las dos mitades de la frase, y "many" no es un número. La afirmación bien podría ser cierta —que un modelo pequeño iguale a uno grande en tareas de codificación concretas y con forma de herramienta es un resultado plausible en 2026—, pero tal como se publica es una aseveración de un proveedor, y debería etiquetarse como tal cada vez que se repita. La mitad de "menos tokens y pasos" es la más duradera de las dos, porque es una afirmación sobre eficiencia más que sobre capacidad, y la eficiencia al precio de Haiku aparece en tu propia telemetría de uso en el plazo de una semana. La mitad de capacidad necesita un arnés de terceros antes de entrar en una diapositiva.

Las propias cifras de Anthropic son una afirmación aparte de las de GitHub y conllevan el mismo problema de procedencia. Anthropic afirma que Claude Haiku 5.5 es aproximadamente un 75 % más barato de ejecutar en promedio, y que alrededor del 90 % de las solicitudes enviadas anteriormente a un modelo de la clase Haiku están por debajo de los 100.000 tokens, que es donde el modelo tiene una "relación calidad-precio especialmente buena". En ambos casos, es el proveedor el que describe la economía de su propio producto. Son coherentes con la tabla de tarifas publicada —una gran reducción para el tramo corto y una más pequeña para el tramo largo— y resultan útiles como orientación del proveedor más que como resultado medido.

Activarlo es una decisión del administrador, el valor predeterminado es sí

La parte del registro de cambios que los compradores de Copilot Business y Enterprise deberían leer dos veces es el párrafo sobre el control de acceso. Los administradores gestionan el acceso a los modelos mediante la política de modelos en la configuración de Copilot, y el comportamiento predeterminado documentado por GitHub es que los modelos nuevos se habilitan automáticamente, a menos que un administrador haya desactivado el valor predeterminado global o haya deshabilitado explícitamente ese modelo en concreto. El valor predeterminado es permisivo; la restricción es de exclusión voluntaria (opt-out).

Se derivan dos consecuencias. Si tu organización tiene una gobernanza estricta de modelos, es posible que tus desarrolladores ya puedan seleccionar Claude Haiku 5.5 sin que nadie lo haya aprobado por su nombre. Y si, en cambio, tu organización ya ha desactivado el valor predeterminado global, el modelo no aparecerá para ti, sin importar lo que diga el registro de cambios, lo cual es la explicación más probable de la pregunta de soporte más común durante la primera semana de cualquier lanzamiento de un modelo de Copilot. Antes de depurar una entrada ausente en el selector, revisa la política de modelos.

Dos excepciones que la documentación de Anthropic señala que las publicaciones de lanzamiento no

Ambas cosas proceden de la documentación de la plataforma de Anthropic, no de cobertura de prensa alguna, y ambas afectan lo que puedes construir, no lo que pagas:

• El nivel Priority Tier no está disponible en Claude Haiku 5.5: la documentación de niveles de servicio de Anthropic incluye el modelo en su lista explícita de exclusiones, junto con Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 y la línea Mythos. Si tu arquitectura da por supuesto un rendimiento aprovisionado en el nivel económico, esa suposición no se sostiene aquí. • La ventana de contexto completa de 1 millón de tokens a precio estándar se concede a «Claude 4.6 y modelos posteriores (excepto Claude Haiku 5.5)»: el paréntesis es de Anthropic, y Claude Haiku 5.5 es el único modelo actual que queda excluido de ella. La ventana sigue anunciándose en la fila de especificaciones del modelo como 1M, con una salida máxima de 128.000 tokens; lo que significa la exclusión es que no debes interpretar que la garantía general de precios de contexto largo se aplica a este modelo. • El tokenizador cambió. Anthropic afirma que Claude 4.7 y los modelos posteriores usan un tokenizador más reciente que produce aproximadamente un 30 por ciento más de tokens para el mismo texto, lo que significa que el precio por token y el precio por página de tu texto se movieron en direcciones opuestas. La fila de especificaciones de Claude Haiku 5.5 indica «Fastest» como su posición, un valor predeterminado de pensamiento adaptativo medio, una fecha de corte de conocimiento de junio de 2026 y un ID de modelo claude-haiku-5-5.

Ninguno de estos es un impedimento insalvable para las cargas de trabajo de subagentes y de edición rápida a las que GitHub dirige el modelo. Son la diferencia entre citar una publicación de lanzamiento y citar la documentación, y lo segundo es lo que sobrevive al contacto con una prueba de carga.

Si prefieres enrutarlo en lugar de cambiar de herramienta.

Hay un argumento razonable para llamar a Claude Haiku 5.5 desde tu propio stack en lugar de hacerlo únicamente a través de una suscripción de chat y editor: obtienes las tarifas brutas del nivel corto sin una conversión de créditos de por medio, y mantienes la decisión de enrutamiento en tu propio código. El panorama de disponibilidad, dicho sin rodeos, es que Anthropic lo vende a través de Claude Platform y mediante Amazon Bedrock, Vertex AI y Microsoft Azure, y todavía no está en nuestro catálogo. OrcaRouter ofrece hoy Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 y Claude Fable 5.1 dentro de un catálogo de poco más de 200 modelos, y Claude Haiku 5.5 no está entre ellos. Para el modelo en sí ahora mismo, llama directamente a Anthropic o a una de las tres nubes.

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

Donde sí encajamos es en la capa que lo rodea. OrcaRouter transfiere el precio de lista del proveedor sin margen, así que cuando un proveedor cambia el precio de un modelo —como hizo Anthropic con este—, la nueva tarifa está activa de nuestro lado el mismo día en lugar de después de un ciclo de facturación. La conmutación por error automática hace que una llamada de nivel económico que da error acabe en una ruta funcional en vez de fallar la solicitud, lo cual importa más para una flota de subagentes que hace miles de llamadas pequeñas que para una sola sesión interactiva. Y el DSL de enrutamiento existe precisamente para el tipo de decisión que crea este lanzamiento: enviar trabajo corto y de gran volumen al modelo que sea más barato por debajo del umbral y trabajo de contexto largo al que sea más barato por encima de él, desde un único endpoint en una única factura, en lugar de codificar esa división en dos integraciones. Si Haiku 5.5 llega al catálogo, se integra en esa política sin cambios en el código.

Qué hacer con esto antes del próximo sprint

La interpretación limitada es que el modelo actual más barato de Anthropic ahora se puede seleccionar en todos los niveles de pago de Copilot y es aproximadamente diez veces más barato por token que el Haiku al que reemplaza en el nivel corto. Si tu equipo ejecuta subagentes o automatización con forma de terminal a través de Copilot, cambiar de modelo es un cambio de configuración con un efecto grande e inmediato en hasta dónde alcanza una bolsa mensual de créditos.

Las dos cosas que conviene comprobar primero son las que el anuncio entierra. Fíjate en el percentil 95 del tamaño de tus solicitudes: si se sitúa por encima de 100.000 tokens, el nivel por el que realmente se te factura es el segundo, y la comparación de diez veces es en realidad de cinco. Y fíjate en si la política de modelos de tu organización tiene activado el valor predeterminado global: en las licencias Business y Enterprise, ese único ajuste decide si este lanzamiento está disponible o no para tus desarrolladores.

transfiere el precio de lista del proveedor sin ningún margen de beneficio