Um cartão de título principal gerado, com o selo "Disponibilidade geral no GitHub Copilot - 7 de outubro de 2026", com o antetítulo "Relatório de disponibilidade do modelo", com o título "Claude Haiku 5.5 no GitHub Copilot", com o subtítulo "Dez vezes mais barato por token do que o Haiku que substitui - até uma solicitação ultrapassar 100.000 tokens", três chips com os dizeres "$0,10 / $0,50 por M", "1 crédito de IA = $0,01" e "Pro: 1.500 créditos/mês", e três cartões para "Faixa curta: abaixo de 100 mil tokens", "Faixa longa: 5x todas as tarifas" e "Ainda não está no nosso catálogo: Claude Haiku 4.5 está".
Guides & Insights

Claude Haiku 5.5 já está no GitHub Copilot: quanto custa o modelo mais barato da Anthropic dentro de um orçamento de créditos

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O Claude Haiku 5.5 apareceu no seletor de modelos do GitHub Copilot em 7 de outubro de 2026 — no mesmo dia em que o fornecedor o lançou — e a entrada do changelog que o anunciou dedica a maior parte de sua extensão às superfícies. Visual Studio Code, Visual Studio, o Copilot CLI, o GitHub Copilot cloud agent, o Copilot app, github.com, o GitHub Mobile no iOS e Android, as IDEs da JetBrains, Xcode, Eclipse. A frase que importa se você é quem controla o orçamento é mais curta: o modelo é cobrado "ao preço de tabela do provedor sob cobrança baseada no uso". Dentro do Copilot, isso significa créditos de IA, e as tarifas do Claude Haiku 5.5 são baixas o suficiente para que a aritmética dos créditos se torne a parte interessante do lançamento, em vez de um detalhe secundário. Este artigo faz essa aritmética, separa o que o GitHub realmente demonstrou do que apenas afirmou e aborda duas exceções na própria documentação do fornecedor que a cobertura do lançamento em grande parte ignorou.

O que o GitHub lançou, e para quem

A entrada tem como título, simplesmente, "Claude Haiku 5.5 in GitHub Copilot", e foi publicada às 13:12 do horário do Pacífico em 7 de outubro. Ela está disponível para assinantes do Copilot Pro, Pro+, Max, Business e Enterprise — ou seja, todos os planos pagos e, notavelmente, não o plano gratuito, no qual a seleção de modelos ainda é feita automaticamente, e não pelo usuário. A implantação é gradual, portanto o seletor no seu editor pode ficar dias atrás do changelog; isso é declarado na entrada, em vez de ser deixado para você descobrir.

A própria formulação do GitHub sobre a finalidade do modelo merece uma leitura atenta, porque é mais restrita do que a do fornecedor:

• Trabalho rápido e de alto volume — subagentes, edições rápidas e tarefas de terminal, nas próprias palavras do GitHub • Não posicionado como substituto dos modelos grandes do seletor, mas como o nível barato abaixo deles • Disponibilidade geral, segundo a referência de modelos compatíveis do GitHub, que lista o Claude Haiku 5.5 como disponível geralmente, com status GA • Também listado nessa referência com uma linha de versão da IDE marcada como TBD, que é o motivo prático pelo qual a implementação parece gradual do ponto de vista do editor • Preço de tabela do provedor sob cobrança baseada em uso, em vez de uma margem específica do Copilot img src="2.png"> p>As datas do changelog ao redor dão o contexto de cadência que uma única página de modelo não consegue dar. O Claude Sonnet 5.5 chegou ao Copilot em 28 de setembro, o Claude Opus 5.5 em 22 de setembro e o Claude Fable 5.1 em 1º de setembro. A Anthropic está lançando uma integração com o Copilot a cada duas a quatro semanas, aproximadamente, e o GitHub está dando conta de cada uma delas em questão de dias. Essa cadência também explica por que há um relógio correndo: o GitHub publicou um aviso de descontinuação em meados de setembro para "modelos selecionados do GitHub Copilot" em meados de outubro, e depois um acompanhamento em 2 de outubro confirmando as remoções. Se sua equipe está fixando um modelo em uma configuração do Copilot, o pin agora é a coisa mais provável de quebrar, não o preço.

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

A tabela de tarifas, lida como um livro-razão de créditos

Claude Haiku 5.5 é cobrado em dois níveis, alternados pelo tamanho da solicitação, e não por qualquer configuração que você escolha. Tudo abaixo é a tabela de preços publicada pelo próprio GitHub, e tudo é por milhão de tokens:

• Com 100.000 tokens ou menos na entrada — US$ 0,10 de entrada, US$ 0,01 de entrada em cache, US$ 0,125 de gravação em cache, US$ 0,50 de saída • Acima de 100.000 tokens na entrada — US$ 0,50 de entrada, US$ 0,05 de entrada em cache, US$ 0,625 de gravação em cache, US$ 2,50 de saída • Claude Haiku 4.5, para efeito de comparação — US$ 1,00 de entrada, US$ 0,10 de entrada em cache, US$ 1,25 de gravação em cache, US$ 5,00 de saída • Claude Sonnet 5.5, o nível acima — US$ 2,00 de entrada, US$ 0,10 de entrada em cache, US$ 2,50 de gravação em cache, US$ 10,00 de saída • As gravações em cache são cobradas separadamente nos modelos da Anthropic, além da entrada em cache — um item de linha que não existe em todos os fornecedores do seletor img src="3.png"> p>Duas conclusões decorrem da leitura dessas linhas em conjunto. Primeiro, o nível curto do Claude Haiku 5.5 é exatamente dez vezes mais barato que o Claude Haiku 4.5 tanto na entrada quanto na saída, e cerca de vinte vezes mais barato na entrada que o Claude Sonnet 5.5 — o que é a razão principal para ele pertencer a slots de subagentes, onde uma frota de chamadas pequenas multiplica tudo o que você paga por chamada. Segundo, o nível de contexto longo é exatamente cinco vezes o curto em todas as tarifas ao mesmo tempo, na mesma linha de 100.000 tokens. Uma solicitação de 99.000 tokens e uma de 101.000 tokens não estão 2 por cento distantes nos tokens que cruzaram a linha; estão cinco vezes distantes em todos eles. Esse degrau é herdado diretamente da tabela de preços da Anthropic, e o sistema de créditos do Copilot não o suaviza.

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

Agora, os créditos. O faturamento baseado no uso do Copilot converte o uso do modelo em créditos de IA a uma taxa documentada de US$ 0,01 por crédito, e cada plano inclui uma cota mensal:

• Copilot Pro, US$ 10 por mês — 1.500 créditos, apresentados como 1.000 base mais 500 flexíveis • Copilot Pro+, US$ 39 por mês — 7.000 créditos, apresentados como 3.900 base mais 3.100 flexíveis • Copilot Max, US$ 100 por mês — 20.000 créditos, apresentados como 10.000 base mais 10.000 flexíveis • Copilot Business, US$ 19 por assento por mês — 1.900 créditos por usuário • Copilot Enterprise, US$ 39 por assento por mês — 3.900 créditos por usuário • Os pools de organização e empresa são compartilhados entre assentos, em vez de isolados por usuário • O uso além do pool é cobrado a US$ 0,01 por crédito — a mesma conversão, aplicada ao excedente • Conclusões de código e sugestões de próxima edição ficam inteiramente fora da cobrança por créditos e permanecem ilimitadas nos planos pagos p>Junte os dois e o formato do lançamento se torna concreto. Considere um passo de agente de tamanho moderado — 40.000 tokens de entrada, 2.000 tokens de saída, sem cache. No nível curto do Claude Haiku 5.5, isso dá 40.000 vezes US$ 0,10 por milhão mais 2.000 vezes US$ 0,50 por milhão, ou US$ 0,005, o que equivale a meio crédito na conversão documentada. A mesma chamada com as tarifas do Claude Haiku 4.5 chega a US$ 0,05, ou cinco créditos. A aritmética aqui é nossa, não do GitHub, mas os dados de entrada vêm todos da tabela de preços publicada, e a conclusão não é sutil: o pool de 1.500 créditos de um assinante Pro absorve cerca de 3.000 chamadas desse tipo no novo Haiku, enquanto absorvia cerca de 300 no antigo. O pool fica dez vezes maior sem que a assinatura mude.

Essa é a proposta de valor honesta, e ela vem com a ressalva honesta de que o pool é cotado em créditos, e não em dólares, então o teto real de um plano muda sempre que uma tabela de preços muda. Um corte de dez vezes em um modelo não estende um pool em dez vezes se o seu tráfego estiver distribuído entre três.

O que o GitHub diz que o modelo faz, e o que ele não mostrou

O changelog contém uma alegação de desempenho, e ela está fazendo mais trabalho na cobertura do que consegue suportar. O GitHub escreve que, em testes iniciais, Claude Haiku 5.5 "igualou Claude Sonnet 5 em muitas tarefas de programação" enquanto usava "significativamente menos tokens e etapas".

Leia os qualificadores em ordem. É um teste inicial. É o teste do GitHub, em tarefas do GitHub, e o GitHub é a parte que vende a integração. Nenhum harness é nomeado, nenhum conjunto de tarefas é publicado, nenhum número acompanha qualquer das metades da frase, e “many” não é um número. A alegação pode muito bem ser verdadeira — um modelo pequeno igualando um grande em tarefas de codificação estreitas e moldadas por ferramentas é um resultado plausível em 2026 —, mas, como publicada, é uma afirmação de fornecedor, e deveria ser rotulada como tal toda vez que for repetida. A metade “menos tokens e etapas” é a mais duradoura das duas, porque é uma afirmação sobre eficiência, e não sobre capacidade, e a eficiência no ponto de preço do Haiku aparece na sua própria telemetria de uso dentro de uma semana. A metade relativa à capacidade precisa de um harness de terceiros antes de ir para um slide.

Os números da própria Anthropic constituem uma alegação separada da apresentada pelo GitHub e carregam o mesmo problema de proveniência. A Anthropic afirma que o Claude Haiku 5.5 é cerca de 75% mais barato para executar, em média, e que aproximadamente 90% das solicitações enviadas anteriormente a um modelo da classe Haiku ficam abaixo de 100.000 tokens, que é onde o modelo tem "uma relação custo-benefício especialmente boa". Nos dois casos, é o fornecedor descrevendo a economia de seu próprio produto. Essas alegações são consistentes com a tabela de preços publicada — um grande corte na faixa curta, um menor na faixa longa — e são úteis como orientação do fornecedor, e não como um resultado medido.

Ativá-lo é uma decisão do administrador, e o padrão é sim.

A parte do changelog que os compradores do Copilot Business e Enterprise devem ler duas vezes é o parágrafo sobre controle de acesso. Os administradores gerenciam o acesso aos modelos por meio da política de modelos nas configurações do Copilot, e o comportamento padrão documentado pelo GitHub é que novos modelos são habilitados automaticamente, a menos que um administrador tenha desativado o padrão global ou desabilitado explicitamente esse modelo específico. O padrão é permissivo; a restrição é do tipo opt-out.

Seguem-se duas consequências. Se a sua organização tiver uma governança de modelos rigorosa, o Claude Haiku 5.5 pode já estar selecionável pelos seus desenvolvedores sem que ninguém o tenha aprovado pelo nome. E se, em vez disso, a sua organização já tiver desativado o padrão global, o modelo não aparecerá para você, independentemente do que diga o registro de alterações — o que é a explicação mais provável para a pergunta de suporte mais comum na primeira semana de qualquer lançamento de modelo do Copilot. Antes de depurar uma entrada ausente no seletor, verifique a política de modelos.

Duas exceções que a documentação da Anthropic afirma que os posts de lançamento não

Ambos vêm da documentação da plataforma da Anthropic, e não de qualquer cobertura da imprensa, e ambos afetam o que você pode construir, e não o que você paga:

• O Priority Tier não está disponível no Claude Haiku 5.5 — a documentação de níveis de serviço da Anthropic nomeia o modelo em sua lista de exclusão explícita, ao lado de Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 e da linha Mythos. Se sua arquitetura pressupõe throughput provisionado no nível barato, essa premissa não se aplica aqui. • A janela de contexto completa de 1 milhão de tokens com preço padrão é concedida a “Claude 4.6 e modelos posteriores (exceto Claude Haiku 5.5)” — o parêntese é da Anthropic, e o Claude Haiku 5.5 é o único modelo atual excluído dela. A janela ainda é anunciada na linha de especificações do modelo como 1M, com saída máxima de 128.000 tokens; o que a exclusão significa é que você não deve interpretar a garantia geral de preço para contexto longo como aplicável a este modelo. • O tokenizador mudou. A Anthropic afirma que Claude 4.7 e modelos posteriores usam um tokenizador mais novo que produz aproximadamente 30% mais tokens para o mesmo texto, o que significa que o preço por token e o preço por página do seu texto se moveram em direções opostas. A linha de especificações do Claude Haiku 5.5 lista “Fastest” como sua posição, um padrão de pensamento adaptativo médio, um corte de conhecimento de junho de 2026 e um ID de modelo claude-haiku-5-5.

Nenhum deles é um impedimento decisivo para as cargas de trabalho de subagente e de edição rápida para as quais o GitHub está direcionando o modelo. Eles são a diferença entre citar um post de lançamento e citar a documentação, e a segunda é a que sobrevive ao contato com um teste de carga.

Se preferir encaminhá-lo em vez de trocar de ferramenta

Há um argumento razoável para chamar o Claude Haiku 5.5 a partir da sua própria stack em vez de apenas através de uma subscrição de chat e editor: obtém as tarifas brutas do nível mais curto sem uma conversão de créditos pelo meio, e mantém a decisão de encaminhamento no seu próprio código. O panorama de disponibilidade, dito de forma clara, é que a Anthropic o vende através da Claude Platform e através da Amazon Bedrock, Vertex AI e Microsoft Azure — e ainda não está no nosso catálogo. A OrcaRouter disponibiliza hoje o Claude Haiku 4.5, o Claude Sonnet 5.5, o Claude Opus 5.5 e o Claude Fable 5.1 num catálogo de pouco mais de 200 modelos, e o Claude Haiku 5.5 não está entre eles. Para o modelo em si, neste momento, contacte a Anthropic ou uma das três clouds diretamente.

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

Onde nós nos encaixamos é na camada ao redor disso. O OrcaRouter repassa o preço de tabela do provedor sem markup, então quando um fornecedor reajusta o preço de um modelo — como a Anthropic fez neste aqui — a nova tarifa já está ativa do nosso lado no mesmo dia, em vez de só depois de um ciclo de faturamento. O failover automático faz com que uma chamada de nível barato que dá erro caia em uma rota funcional, em vez de fazer a requisição falhar, o que importa mais para uma frota de subagentes fazendo milhares de chamadas pequenas do que para uma única sessão interativa. E a DSL de roteamento existe exatamente para o formato de decisão que este lançamento cria: enviar trabalho curto e de alto volume para o modelo mais barato abaixo do limite e trabalho de contexto longo para o mais barato acima dele, a partir de um único endpoint em uma única fatura, em vez de codificar essa divisão em duas integrações. Se o Haiku 5.5 chegar ao catálogo, ele se encaixa nessa política sem alteração de código.

O que fazer com isto antes da próxima sprint

A leitura mais restrita é que o modelo mais barato atual da Anthropic agora é selecionável em todos os planos pagos do Copilot e é cerca de dez vezes mais barato por token do que o Haiku que ele substitui no plano curto. Se a sua equipe executa subagentes ou automação em formato de terminal por meio do Copilot, trocar o modelo é uma mudança de configuração com um efeito grande e imediato sobre até onde se estende uma cota mensal de créditos.

As duas coisas que vale a pena verificar primeiro são precisamente as que o anúncio enterra. Olhe para o percentil 95 dos tamanhos dos seus pedidos: se estiver acima de 100 000 tokens, o nível pelo qual é efetivamente faturado é o segundo, e a comparação de dez vezes passa a ser de cinco vezes. E veja se a política de modelos da sua organização tem a predefinição global ativada — para as licenças Business e Enterprise, essa única definição decide se este lançamento está sequer disponível para os seus programadores.

repassa o preço de tabela do provedor sem margem