
Claude Haiku 5.5 já está no GitHub Copilot: quanto custa o modelo mais barato da Anthropic dentro de um orçamento de créditos
- OrcaNOVOOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 por 1M de tokens · 71 tok/s
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
O Claude Haiku 5.5 apareceu no seletor de modelos do GitHub Copilot em 7 de outubro de 2026 — no mesmo dia em que o fornecedor o lançou — e a entrada do changelog que o anunciou dedica a maior parte de sua extensão às superfícies. Visual Studio Code, Visual Studio, o Copilot CLI, o GitHub Copilot cloud agent, o Copilot app, github.com, o GitHub Mobile no iOS e Android, as IDEs da JetBrains, Xcode, Eclipse. A frase que importa se você é quem controla o orçamento é mais curta: o modelo é cobrado "ao preço de tabela do provedor sob cobrança baseada no uso". Dentro do Copilot, isso significa créditos de IA, e as tarifas do Claude Haiku 5.5 são baixas o suficiente para que a aritmética dos créditos se torne a parte interessante do lançamento, em vez de um detalhe secundário. Este artigo faz essa aritmética, separa o que o GitHub realmente demonstrou do que apenas afirmou e aborda duas exceções na própria documentação do fornecedor que a cobertura do lançamento em grande parte ignorou.
O que o GitHub lançou, e para quem
A entrada tem como título, simplesmente, "Claude Haiku 5.5 in GitHub Copilot", e foi publicada às 13:12 do horário do Pacífico em 7 de outubro. Ela está disponível para assinantes do Copilot Pro, Pro+, Max, Business e Enterprise — ou seja, todos os planos pagos e, notavelmente, não o plano gratuito, no qual a seleção de modelos ainda é feita automaticamente, e não pelo usuário. A implantação é gradual, portanto o seletor no seu editor pode ficar dias atrás do changelog; isso é declarado na entrada, em vez de ser deixado para você descobrir.
A própria formulação do GitHub sobre a finalidade do modelo merece uma leitura atenta, porque é mais restrita do que a do fornecedor:
• Trabalho rápido e de alto volume — subagentes, edições rápidas e tarefas de terminal, nas próprias palavras do GitHub • Não posicionado como substituto dos modelos grandes do seletor, mas como o nível barato abaixo deles • Disponibilidade geral, segundo a referência de modelos compatíveis do GitHub, que lista o Claude Haiku 5.5 como disponível geralmente, com status GA • Também listado nessa referência com uma linha de versão da IDE marcada como TBD, que é o motivo prático pelo qual a implementação parece gradual do ponto de vista do editor • Preço de tabela do provedor sob cobrança baseada em uso, em vez de uma margem específica do Copilot img src="2.png"> p>As datas do changelog ao redor dão o contexto de cadência que uma única página de modelo não consegue dar. O Claude Sonnet 5.5 chegou ao Copilot em 28 de setembro, o Claude Opus 5.5 em 22 de setembro e o Claude Fable 5.1 em 1º de setembro. A Anthropic está lançando uma integração com o Copilot a cada duas a quatro semanas, aproximadamente, e o GitHub está dando conta de cada uma delas em questão de dias. Essa cadência também explica por que há um relógio correndo: o GitHub publicou um aviso de descontinuação em meados de setembro para "modelos selecionados do GitHub Copilot" em meados de outubro, e depois um acompanhamento em 2 de outubro confirmando as remoções. Se sua equipe está fixando um modelo em uma configuração do Copilot, o pin agora é a coisa mais provável de quebrar, não o preço.

A tabela de tarifas, lida como um livro-razão de créditos
Claude Haiku 5.5 é cobrado em dois níveis, alternados pelo tamanho da solicitação, e não por qualquer configuração que você escolha. Tudo abaixo é a tabela de preços publicada pelo próprio GitHub, e tudo é por milhão de tokens:
• Com 100.000 tokens ou menos na entrada — US$ 0,10 de entrada, US$ 0,01 de entrada em cache, US$ 0,125 de gravação em cache, US$ 0,50 de saída • Acima de 100.000 tokens na entrada — US$ 0,50 de entrada, US$ 0,05 de entrada em cache, US$ 0,625 de gravação em cache, US$ 2,50 de saída • Claude Haiku 4.5, para efeito de comparação — US$ 1,00 de entrada, US$ 0,10 de entrada em cache, US$ 1,25 de gravação em cache, US$ 5,00 de saída • Claude Sonnet 5.5, o nível acima — US$ 2,00 de entrada, US$ 0,10 de entrada em cache, US$ 2,50 de gravação em cache, US$ 10,00 de saída • As gravações em cache são cobradas separadamente nos modelos da Anthropic, além da entrada em cache — um item de linha que não existe em todos os fornecedores do seletor img src="3.png"> p>Duas conclusões decorrem da leitura dessas linhas em conjunto. Primeiro, o nível curto do Claude Haiku 5.5 é exatamente dez vezes mais barato que o Claude Haiku 4.5 tanto na entrada quanto na saída, e cerca de vinte vezes mais barato na entrada que o Claude Sonnet 5.5 — o que é a razão principal para ele pertencer a slots de subagentes, onde uma frota de chamadas pequenas multiplica tudo o que você paga por chamada. Segundo, o nível de contexto longo é exatamente cinco vezes o curto em todas as tarifas ao mesmo tempo, na mesma linha de 100.000 tokens. Uma solicitação de 99.000 tokens e uma de 101.000 tokens não estão 2 por cento distantes nos tokens que cruzaram a linha; estão cinco vezes distantes em todos eles. Esse degrau é herdado diretamente da tabela de preços da Anthropic, e o sistema de créditos do Copilot não o suaviza.

Agora, os créditos. O faturamento baseado no uso do Copilot converte o uso do modelo em créditos de IA a uma taxa documentada de US$ 0,01 por crédito, e cada plano inclui uma cota mensal:
• Copilot Pro, US$ 10 por mês — 1.500 créditos, apresentados como 1.000 base mais 500 flexíveis • Copilot Pro+, US$ 39 por mês — 7.000 créditos, apresentados como 3.900 base mais 3.100 flexíveis • Copilot Max, US$ 100 por mês — 20.000 créditos, apresentados como 10.000 base mais 10.000 flexíveis • Copilot Business, US$ 19 por assento por mês — 1.900 créditos por usuário • Copilot Enterprise, US$ 39 por assento por mês — 3.900 créditos por usuário • Os pools de organização e empresa são compartilhados entre assentos, em vez de isolados por usuário • O uso além do pool é cobrado a US$ 0,01 por crédito — a mesma conversão, aplicada ao excedente • Conclusões de código e sugestões de próxima edição ficam inteiramente fora da cobrança por créditos e permanecem ilimitadas nos planos pagos p>Junte os dois e o formato do lançamento se torna concreto. Considere um passo de agente de tamanho moderado — 40.000 tokens de entrada, 2.000 tokens de saída, sem cache. No nível curto do Claude Haiku 5.5, isso dá 40.000 vezes US$ 0,10 por milhão mais 2.000 vezes US$ 0,50 por milhão, ou US$ 0,005, o que equivale a meio crédito na conversão documentada. A mesma chamada com as tarifas do Claude Haiku 4.5 chega a US$ 0,05, ou cinco créditos. A aritmética aqui é nossa, não do GitHub, mas os dados de entrada vêm todos da tabela de preços publicada, e a conclusão não é sutil: o pool de 1.500 créditos de um assinante Pro absorve cerca de 3.000 chamadas desse tipo no novo Haiku, enquanto absorvia cerca de 300 no antigo. O pool fica dez vezes maior sem que a assinatura mude.
Essa é a proposta de valor honesta, e ela vem com a ressalva honesta de que o pool é cotado em créditos, e não em dólares, então o teto real de um plano muda sempre que uma tabela de preços muda. Um corte de dez vezes em um modelo não estende um pool em dez vezes se o seu tráfego estiver distribuído entre três.
O que o GitHub diz que o modelo faz, e o que ele não mostrou
O changelog contém uma alegação de desempenho, e ela está fazendo mais trabalho na cobertura do que consegue suportar. O GitHub escreve que, em testes iniciais, Claude Haiku 5.5 "igualou Claude Sonnet 5 em muitas tarefas de programação" enquanto usava "significativamente menos tokens e etapas".
Leia os qualificadores em ordem. É um teste inicial. É o teste do GitHub, em tarefas do GitHub, e o GitHub é a parte que vende a integração. Nenhum harness é nomeado, nenhum conjunto de tarefas é publicado, nenhum número acompanha qualquer das metades da frase, e “many” não é um número. A alegação pode muito bem ser verdadeira — um modelo pequeno igualando um grande em tarefas de codificação estreitas e moldadas por ferramentas é um resultado plausível em 2026 —, mas, como publicada, é uma afirmação de fornecedor, e deveria ser rotulada como tal toda vez que for repetida. A metade “menos tokens e etapas” é a mais duradoura das duas, porque é uma afirmação sobre eficiência, e não sobre capacidade, e a eficiência no ponto de preço do Haiku aparece na sua própria telemetria de uso dentro de uma semana. A metade relativa à capacidade precisa de um harness de terceiros antes de ir para um slide.
Os números da própria Anthropic constituem uma alegação separada da apresentada pelo GitHub e carregam o mesmo problema de proveniência. A Anthropic afirma que o Claude Haiku 5.5 é cerca de 75% mais barato para executar, em média, e que aproximadamente 90% das solicitações enviadas anteriormente a um modelo da classe Haiku ficam abaixo de 100.000 tokens, que é onde o modelo tem "uma relação custo-benefício especialmente boa". Nos dois casos, é o fornecedor descrevendo a economia de seu próprio produto. Essas alegações são consistentes com a tabela de preços publicada — um grande corte na faixa curta, um menor na faixa longa — e são úteis como orientação do fornecedor, e não como um resultado medido.
Ativá-lo é uma decisão do administrador, e o padrão é sim.
A parte do changelog que os compradores do Copilot Business e Enterprise devem ler duas vezes é o parágrafo sobre controle de acesso. Os administradores gerenciam o acesso aos modelos por meio da política de modelos nas configurações do Copilot, e o comportamento padrão documentado pelo GitHub é que novos modelos são habilitados automaticamente, a menos que um administrador tenha desativado o padrão global ou desabilitado explicitamente esse modelo específico. O padrão é permissivo; a restrição é do tipo opt-out.
Seguem-se duas consequências. Se a sua organização tiver uma governança de modelos rigorosa, o Claude Haiku 5.5 pode já estar selecionável pelos seus desenvolvedores sem que ninguém o tenha aprovado pelo nome. E se, em vez disso, a sua organização já tiver desativado o padrão global, o modelo não aparecerá para você, independentemente do que diga o registro de alterações — o que é a explicação mais provável para a pergunta de suporte mais comum na primeira semana de qualquer lançamento de modelo do Copilot. Antes de depurar uma entrada ausente no seletor, verifique a política de modelos.
Duas exceções que a documentação da Anthropic afirma que os posts de lançamento não
Ambos vêm da documentação da plataforma da Anthropic, e não de qualquer cobertura da imprensa, e ambos afetam o que você pode construir, e não o que você paga:
• O Priority Tier não está disponível no Claude Haiku 5.5 — a documentação de níveis de serviço da Anthropic nomeia o modelo em sua lista de exclusão explícita, ao lado de Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 e da linha Mythos. Se sua arquitetura pressupõe throughput provisionado no nível barato, essa premissa não se aplica aqui. • A janela de contexto completa de 1 milhão de tokens com preço padrão é concedida a “Claude 4.6 e modelos posteriores (exceto Claude Haiku 5.5)” — o parêntese é da Anthropic, e o Claude Haiku 5.5 é o único modelo atual excluído dela. A janela ainda é anunciada na linha de especificações do modelo como 1M, com saída máxima de 128.000 tokens; o que a exclusão significa é que você não deve interpretar a garantia geral de preço para contexto longo como aplicável a este modelo. • O tokenizador mudou. A Anthropic afirma que Claude 4.7 e modelos posteriores usam um tokenizador mais novo que produz aproximadamente 30% mais tokens para o mesmo texto, o que significa que o preço por token e o preço por página do seu texto se moveram em direções opostas. A linha de especificações do Claude Haiku 5.5 lista “Fastest” como sua posição, um padrão de pensamento adaptativo médio, um corte de conhecimento de junho de 2026 e um ID de modelo claude-haiku-5-5.
Nenhum deles é um impedimento decisivo para as cargas de trabalho de subagente e de edição rápida para as quais o GitHub está direcionando o modelo. Eles são a diferença entre citar um post de lançamento e citar a documentação, e a segunda é a que sobrevive ao contato com um teste de carga.
Se preferir encaminhá-lo em vez de trocar de ferramenta
Há um argumento razoável para chamar o Claude Haiku 5.5 a partir da sua própria stack em vez de apenas através de uma subscrição de chat e editor: obtém as tarifas brutas do nível mais curto sem uma conversão de créditos pelo meio, e mantém a decisão de encaminhamento no seu próprio código. O panorama de disponibilidade, dito de forma clara, é que a Anthropic o vende através da Claude Platform e através da Amazon Bedrock, Vertex AI e Microsoft Azure — e ainda não está no nosso catálogo. A OrcaRouter disponibiliza hoje o Claude Haiku 4.5, o Claude Sonnet 5.5, o Claude Opus 5.5 e o Claude Fable 5.1 num catálogo de pouco mais de 200 modelos, e o Claude Haiku 5.5 não está entre eles. Para o modelo em si, neste momento, contacte a Anthropic ou uma das três clouds diretamente.

Onde nós nos encaixamos é na camada ao redor disso. O OrcaRouter repassa o preço de tabela do provedor sem markup, então quando um fornecedor reajusta o preço de um modelo — como a Anthropic fez neste aqui — a nova tarifa já está ativa do nosso lado no mesmo dia, em vez de só depois de um ciclo de faturamento. O failover automático faz com que uma chamada de nível barato que dá erro caia em uma rota funcional, em vez de fazer a requisição falhar, o que importa mais para uma frota de subagentes fazendo milhares de chamadas pequenas do que para uma única sessão interativa. E a DSL de roteamento existe exatamente para o formato de decisão que este lançamento cria: enviar trabalho curto e de alto volume para o modelo mais barato abaixo do limite e trabalho de contexto longo para o mais barato acima dele, a partir de um único endpoint em uma única fatura, em vez de codificar essa divisão em duas integrações. Se o Haiku 5.5 chegar ao catálogo, ele se encaixa nessa política sem alteração de código.
O que fazer com isto antes da próxima sprint
A leitura mais restrita é que o modelo mais barato atual da Anthropic agora é selecionável em todos os planos pagos do Copilot e é cerca de dez vezes mais barato por token do que o Haiku que ele substitui no plano curto. Se a sua equipe executa subagentes ou automação em formato de terminal por meio do Copilot, trocar o modelo é uma mudança de configuração com um efeito grande e imediato sobre até onde se estende uma cota mensal de créditos.
As duas coisas que vale a pena verificar primeiro são precisamente as que o anúncio enterra. Olhe para o percentil 95 dos tamanhos dos seus pedidos: se estiver acima de 100 000 tokens, o nível pelo qual é efetivamente faturado é o segundo, e a comparação de dez vezes passa a ser de cinco vezes. E veja se a política de modelos da sua organização tem a predefinição global ativada — para as licenças Business e Enterprise, essa única definição decide se este lançamento está sequer disponível para os seus programadores.
