
Claude Haiku 5.5 no OpenCode Go: O que US$ 10 por mês realmente compra
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
A Anthropic lançou o Claude Haiku 5.5 em 7 de outubro de 2026 e, em um dia, ele já aparecia no Go e no Zen do OpenCode — as assinaturas de agente de programação que medem uma franquia de uso em vez de cobrar por token. Essa segunda listagem é a parte que merece uma pausa, porque a franquia que o OpenCode publica para o Claude Haiku 5.5 não é um desconto sobre o modelo. É um orçamento definido pelo preço de tabela da própria Anthropic, e cada número por trás dele pode ser conferido nas duas páginas que o publicam. Se você ainda está decidindo o que usar no lugar do Claude Haiku 4.5, a franquia é a decisão, não a etiqueta de preço.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
O que a Anthropic declarou publicamente em 7 de outubro
O fornecedor não lançou isto discretamente. A sala de imprensa da Anthropic traz um anúncio datado, uma página de produto com uma tabela de benchmarks, um system card, uma tabela de preços e seis depoimentos de clientes nomeados. Não há repositório nem lançamento de pesos para inspecionar, porque não há nada a lançar: a Artificial Analysis registra Claude Haiku 5.5 como proprietário, com a contagem de parâmetros não divulgada. Qualquer pessoa que descreva isto como um modelo vazado ou não anunciado está lendo um repositório que não existe.
O próprio enquadramento da Anthropic é um modelo de volume, e não de fronteira:
• Posicionamento — "o modelo pequeno mais barato, mais rápido e mais capaz que já lançamos", voltado para resumos, compactações, consultas a bancos de dados e classificação, e apresentado como um subagente que trabalha em conjunto com Claude Opus 5.5 e Claude Sonnet 5.5 em tarefas de programação.
• Preço — $0,10 por milhão de tokens de entrada e $0,50 por milhão de tokens de saída para prompts de até 100.000 tokens; $0,50 e $2,50 acima disso. Leituras de cache $0,01 / $0,05, gravações de cache $0,125 / $0,625.
• Contexto e saída — uma janela de 1M de tokens com uma saída máxima de 128.000 tokens, o mesmo envelope que os modelos maiores da categoria 5.5 apresentam, reproduzido no nível mais barato.
• Esforço — o primeiro modelo da classe Haiku com uma configuração de esforço ajustável, operando de Baixo a Máximo, com padrão em médio. A Anthropic publica curvas de precisão versus custo em cada configuração, em vez de um único número.
• Benchmarks, relatados pelo fornecedor e não reproduzidos independentemente — GDPval-AA v2.1 1620 contra os 735 do Claude Haiku 4.5; AA-Briefcase v1.1 1578 contra 614; OSWorld 2.1 72,4% contra 15,7%; Humanity's Last Exam 45,9% sem ferramentas e 57,4% com elas, contra 10,2% e 18,7%; Terminal-Bench 4.0 39,2% contra 0,0%; Chartography 46,4% contra 6,4%.
• O teto do próprio fornecedor — o comentário da Anthropic sobre seu gráfico do Terminal-Bench diz que Claude Sonnet 5.5 e Claude Opus 5.5 "continuam sendo melhores escolhas para tarefas complexas de codificação agêntica". As citações de clientes na mesma publicação são de parceiros de acesso antecipado descrevendo suas próprias avaliações, não auditorias: a Asana relata mais de 30% de redução na latência e inferência até 2,5x mais rápida por turno do agente; a HubSpot, 92,8% em média em três execuções; a AlphaSense, 0,84 contra 0,76 em 400 consultas, numa carga de trabalho de aproximadamente 8 milhões de chamadas por semana; a Box, 11 pontos a mais com cerca de metade da latência; e a Cognition, uma pontuação FrontierCode de 66,2 com Haiku 5.5 como sidekick.

A Anthropic também aproveitou o lançamento para ajustar dois preços adjacentes: as leituras de cache no Claude Sonnet 5.5 caíram pela metade, para US$ 0,10 por milhão de tokens, o que, segundo a empresa, torna o Sonnet 5.5 cerca de 20% mais barato na maioria dos trabalhos agênticos, e um novo crédito mensal de API para assinantes do Claude Max e do Team. Ambas são mudanças no nível acima, e ambas importam mais para uma equipe já padronizada no Sonnet do que para quem está procurando um modelo pequeno.
A verba é um orçamento em dólares, não um desconto.
Aqui está a parte que o tweet de anúncio não diz. A documentação Go do OpenCode afirma que "os limites de uso são definidos como valores mensais em dólares", que o preço dos tokens é o mesmo nos dois planos e que a cota de cada modelo diminui gradualmente em um cronograma fixo: 20% do limite mensal a cada cinco horas, 50% por semana, 100% por mês. A documentação também publica o perfil de tokens por requisição que pressupõe para este modelo — 1.100 tokens de entrada, 55.000 tokens em cache, 240 tokens de saída.
Passe esses pelos preços de tabela da Ant{{1}}hropic e as contagens de solicitações publicadas deixam de parecer uma alocação arbitrária:
• Custo por requisição ao preço de tabela — 1.100 de entrada a US$ 0,10/M mais 55.000 leituras em cache a US$ 0,01/M mais 240 de saída a US$ 0,50/M totaliza US$ 0,00078.
A contagem mensal de solicitações — US$ 15 divididos por US$ 0,00078 é 19.230, que é o número mostrado na documentação. A cota de US$ 60 do plano de US$ 40 resulta em 76.923, e a documentação mostra 76.920.
• A redução gradual — 20% de 19.230 é 3.846, exibido como 3.850 por cinco horas; 50% é 9.615, exibido como 9.620 por semana. O Go Plus segue a mesma aritmética em 15.380 e 38.460.
• O que isso significa em dólares — a franquia vale $15 em tokens com preços da Anthropic no plano de $10 e $60 no plano de $40. Uma assinatura de $10, portanto, compra no máximo $15 por mês dos tokens deste modelo se você gastar toda a franquia em Claude Haiku 5.5 e nada mais.
Essa é a forma honesta de interpretar o selo “New” na página Go. A assinatura é barata, o modelo é barato, e os dois fatos são independentes: a cota é um orçamento medido pela própria tarifa do fornecedor, então o plano limita quanto você pode gastar, e não quão pouco o modelo custa. Usuários intensivos atingem o teto e pagam diretamente à Anthropic — ou roteiam o modelo por conta própria.

Noventa por cento, setenta e cinco por cento e o precipício das cinco vezes
O destaque da Anthropic é que Claude Haiku 5.5custa cerca de 90% menos que o Claude Haiku 4.5para prompts de até 100.000 tokens, e que, em média, ele "agora custa cerca de 75% menos para ser executado". Ambos os números são do fornecedor. E ambos estão corretos, e a diferença entre eles é todo o risco de precificação.
• Dentro da faixa — $0,10 na entrada e $0,50 na saída, contra o valor fixo de $1 e $5 do Haiku 4.5. A Anthropic afirma que cerca de 90% das solicitações ao seu modelo Haiku anterior ficaram dentro dessa faixa, e é daí que vem o número de 90%.
• Acima da faixa — a mesma solicitação é cobrada a US$ 0,50 de entrada e US$ 2,50 de saída, um salto de cinco vezes na entrada. Isso ainda é metade da tarifa do Haiku 4.5, mas está longe de um corte de 90%.
• A afirmação combinada — o número de 75% é a estimativa da própria Anthropic em uma mistura real de tráfego, não uma tabela de tarifas, e é o número que se deve colocar em uma previsão.
• O tokenizador — o tokenizador mais recente, compartilhado com o Claude 4.7 e versões posteriores, produz cerca de 30% mais tokens para o mesmo texto, conforme a própria documentação da Anthropic, de modo que um corte por token não se traduz em uma conta proporcionalmente menor.
O dial de esforço potencializa tudo isso. Como o padrão é médio e as curvas publicadas vão até Max, o mesmo prompt pode custar várias vezes mais dependendo de um parâmetro que a maioria dos chamadores nunca define — e as estimativas de requisição do OpenCode assumem um perfil fixo de tokens em uma configuração implícita. Se seus prompts ficam perto de 100.000 tokens, você executa um subagente de uso limitado, ou você move o dial de esforço, o número de manchete de 90% não é o número que você verá.
O conselho independente concorda com a pontuação e sinaliza os seus próprios cálculos.
O Artificial Analysis atribui uma pontuação de Claude Haiku 5.5de 43 no seu Intelligence Index v4.3.2, na configuração Max do modelo, contra uma mediana do painel de 13, e mede 241,9 tokens de saída por segundo, contra uma mediana de 110,9 de modelos comparáveis. A mesma página apresenta o custo de US$ 0,21 por tarefa do Intelligence Index e informa que o modelo gerou 440 milhões de tokens de saída durante a avaliação, contra uma mediana de 100 milhões — descrevendo-o como "muito verboso".
A verbosidade é onde os dois rankings interagem. A aritmética de cota acima é cobrada por token, então um modelo que raciocina longamente consome o orçamento mais rápido do que a contagem de solicitações sugere, e o perfil por solicitação do OpenCode de 55.000 tokens em cache é uma suposição sobre cache de prompt que um usuário de assinatura pode ou não reproduzir. Duas divulgações na página da Artificial Analysis valem mais do que sua manchete: o 43 é a configuração Max, e não o ajuste de esforço que você obtém ao não fazer nada, e a página traz uma nota explícita de que Claude Haiku 5.5"tem preços 5x mais altos em entradas de contexto mais longo que atualmente não estão refletidos" nos seus números de custo. O penhasco do contexto longo é real, e o ranking independente já lhe disse que isso ainda não está em seus próprios números.

A linha de retenção que a maioria dos compradores vai ignorar
A documentação Go do OpenCode traz uma tabela de privacidade por modelo, e esta é a linha em que Claude Haiku 5.5difere da maior parte do catálogo. A própria formulação do fornecedor é retenção zero com exceções. A maioria dos modelos nessa tabela Go indica "0 dias". Este indica "30 dias", com a nota de que as solicitações são retidas por 30 dias de acordo com as políticas de dados da Anthropic — o mesmo tratamento que dá ao GPT-6 Luna e ao GPT-5.6 Luna, e o oposto das linhas de zero dias que constituem a maior parte da lista.
Para um agente de codificação, isso significa que prompts, caminhos de arquivo e código-fonte colado podem permanecer com o fornecedor upstream por um mês, em um plano cuja linguagem de marketing é retenção zero. Isso não é motivo para evitar o modelo; é motivo para ler a linha em vez do banner. Enquanto isso, nada nos materiais de lançamento da Anthropic muda a posição do lado da API: a API do Claude tem oferecido retenção zero de dados, e os termos de retenção do model card são os que regem uma integração direta.
O que está confirmado e o que não está
O conjunto confirmado é amplo e específico, o que é incomum para um modelo tão novo. O que não está confirmado é mais restrito e vale a pena nomear, em vez de passar por cima:
• Confirmado — o modelo existe, é somente via API sob o id claude-haiku-5-5, foi lançado em 7 de outubro na Claude API, além de Amazon Web Services, Google Cloud e Microsoft Azure, pelos preços acima, com uma janela de 1M de tokens, esforço ajustável e um system card publicado.
• Confirmado — duas plataformas de terceiros o listaram com IDs de modelo, endpoints e franquias medidas no mesmo dia.
• Não confirmado — nenhum benchmark independente que conseguimos encontrar reproduziu a tabela do fornecedor. Todos os números de precisão no post de lançamento da Anthropic vêm do próprio harness da Anthropic, e todo depoimento de cliente é um teste inicial autorrelatado por um parceiro.
• Não confirmado — não há pesos, nem repositório, nem checkpoint, nem licença para inspecionar. O modelo é fechado, e qualquer afirmação sobre sua arquitetura ou tamanho é uma inferência.
• Por confirmar — se as estimativas de requisições da plataforma se mantêm com algo diferente do perfil de tokens pressuposto, e se (ou quando) o preço 5x de contexto longo entra nos números de custo dos painéis independentes.
Executando-o ao lado do que você já chama
A questão prática que este lançamento cria não é “o Haiku 5.5 é bom” — a tabela do fornecedor diz que sim, e ninguém fora da Anthropic verificou. É “qual é a fatura, e o que acontece quando a camada barata não é a camada certa para esta chamada em particular”. As duas metades são problemas de roteamento.
No que diz respeito ao custo, o medidor é a conta de tokens, não o preço de etiqueta: um corte de 90% na entrada, mais um tokenizador 30% maior, mais um modelo de raciocínio prolixo, mais um avanço de cinco vezes em contexto longo, significa que o número que você projeta e o número que você paga divergem, a menos que você meça sua própria distribuição de comprimento de prompt. Um modelo que é 5x mais caro acima de 100.000 tokens recompensa a compactação — e o Haiku 5.5 é ele próprio apresentado como o modelo de compactação, o que é um ciclo que vale a pena notar.
Em termos de risco, uma camada não comprovada é exatamente o caso para não apostar um caminho de produção nela. O Claude Haiku 4.5 já está no OrcaRouter pelo preço de tabela da Anthropic com 0% de markup, então a camada antiga não precisa de um novo contrato, e uma rota que faz fallback de um modelo novo para um conhecido é uma mudança de configuração, não uma reescrita. O parâmetro effort é por chamada, o que significa que o mesmo endpoint pode executar um resumo com effort baixo e uma extração difícil com effort alto sem manter duas integrações — a DSL de roteamento existe precisamente para esse tipo de decisão, e o failover automático é o que permite colocar um modelo com poucos dias de existência na frente de tráfego real antes de você ter números independentes sobre ele. O que ainda não é verdade é o óbvio: o Claude Haiku 5.5 não está nas nossas rotas hoje, e se você o quer esta semana, está ligando diretamente para a Anthropic ou passando pela plataforma que o anunciou.
Quem deve migrar: equipes cujo volume é composto por resumos, classificação, compactação e trabalho de subagentes, onde a faixa dos 90% se aplica e os 30% do tokenizador são aritmética que você consegue absorver. Quem deve esperar: qualquer pessoa cujos prompts rotineiramente ultrapassam 100.000 tokens, qualquer pessoa que precise de um benchmark independente antes de se comprometer, e qualquer pessoa cujo código não pode permanecer em uma janela de retenção de 30 dias. O lançamento é real e o preço é real. A prova ainda é do fornecedor.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
