Um cartão de destaque gerado intitulado 'Claude Haiku 5.5 vs Aion 3.5' com a chamada '30x O PREÇO DE ENTRADA' e o subtítulo 'Um recebe pontuação. O outro não.', trazendo chips que exibem US$ 0,10 vs US$ 3,00 por milhão de tokens de entrada, AA Index 43 contra nenhum, e 1M contra 262K de contexto.
Guides & Insights

Claude Haiku 5.5 vs Aion 3.5: Trinta vezes o preço de entrada por um modelo que ninguém avaliou

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O Claude Haiku 5.5 tem preço de tabela de US$ 0,10 por milhão de tokens de entrada. O Aion 3.5 tem preço de tabela de US$ 3,00. Isso é trinta vezes o preço de entrada e doze vezes o preço de saída para dois modelos que ambos aceitam um prompt de texto longo e retornam texto, e a diferença não é explicada pela capacidade — é explicada pelo que cada empresa está vendendo. O Claude Haiku 5.5, lançado em 7 de outubro de 2026, é um cavalo de batalha com preço de commodity, com um seletor de esforço e uma pontuação independente. O Aion 3.5, lançado em 23 de setembro de 2026 pela AionLabs, é um ensemble de raciocínio obrigatório que vem em dois tamanhos, um dos quais é genuinamente barato. Se vale a pena pagar o prêmio de trinta vezes depende inteiramente de uma pergunta que o fornecedor não respondeu.

Aqui está a parte incômoda logo de início: a Artificial Analysis avaliou o Claude Haiku 5.5 e nunca publicou uma pontuação para o Aion 3.5. Nem ninguém mais que conseguimos encontrar. Portanto, isto não é uma comparação entre duas coisas medidas. É uma comparação de uma coisa medida com um conjunto de alegações do fornecedor, e a maneira honesta de escrevê-la é dizer isso em todas as seções, em vez de uma vez em uma nota de rodapé.

Os dois modelos, em um parágrafo cada

Claude Haiku 5.5 é o modelo pequeno do fornecedor, ID claude-haiku-5-5, com entrada de texto e imagem e saída de texto, uma janela de contexto de 1M de tokens, um máximo de saída de 128.000 tokens (300.000 com um cabeçalho beta na Batch API), um corte de treinamento em junho de 2026 e um compromisso da Anthropic de não desativá-lo antes de 7 de outubro de 2027. O esforço é ajustável entre Low, Medium, High, Xhigh e Max, com padrão Medium, e pensamento adaptativo ativado por padrão. Leituras de cache custam US$ 0,01 por milhão de tokens. Acima de 100.000 tokens de prompt, tanto as taxas de entrada quanto as de saída são multiplicadas por cinco.

Aion 3.5 é o carro-chefe da AionLabs, ID aion-labs/aion-3.5, e é somente texto em ambas as direções. O contexto é de 262.144 tokens — o dobro dos 131.072 do Aion 3.0 — com uma saída máxima de 32.768 tokens. O raciocínio é obrigatório, e não opcional, com padrão em high, que pode ser movido para max ou reduzido para low. Arquiteturalmente, ele é descrito como um ensemble de múltiplos modelos da família GLM, em vez de uma única rede treinada, o que é a coisa mais interessante nele e também a mais difícil de verificar de fora. O preço é de US$ 3,00 por milhão de tokens de entrada, US$ 0,75 para entrada em cache e US$ 6,00 para saída, fixo em toda a janela. O Aion 3.5 Mini, lançado no mesmo dia, custa US$ 0,70 / US$ 0,18 / US$ 1,40 para o mesmo contexto de 256K — e esse irmão menor é o que torna esta comparação interessante.

A capture of the AionLabs documentation page listing available models and their pricing, showing Aion 2.0, Aion 3.0, Aion 3.0 Mini, Aion 3.5 and Aion 3.5 Mini with their context windows and per-million input, cached-input and output rates, including Aion 3.5 at 256K context and Aion 3.5 Mini at the lower tier.

• As dimensões, uma por linha

• Preço de entrada — Claude Haiku 5.5: US$ 0,10 por milhão até 100 mil tokens, subindo para US$ 0,50 acima disso; Aion 3.5: US$ 3,00 fixos em toda a janela de 256K.

• Preço de saída — Claude Haiku 5.5 $0,50 por milhão até 100 mil, depois $2,50; Aion 3.5 $6,00 fixo.

• Entrada em cache — Claude Haiku 5.5 $0.01 por milhão em leituras e $0.125 em gravações de cinco minutos; Aion 3.5 $0.75 em entrada em cache, sem taxa de leitura publicada separadamente.

• Janela de contexto — 1.000.000 de tokens contra 262.144.

• Saída máxima — 128.000 tokens contra 32.768.

• Modalidades de entrada — texto e imagens versus apenas texto.

• Controle de raciocínio — um seletor de esforço de cinco posições, de Baixo a Máximo, em comparação com três posições em que Alto é o padrão.

• Pontuação independente — Artificial Analysis Intelligence Index 43, com uma configuração Max em 43,40, segundo de 182 modelos; nenhum publicado para Aion 3.5.

• Custo por tarefa concluída — US$ 0,21 por tarefa do índice Artificial Analysis para o Claude Haiku 5.5; não mensurável para o Aion 3.5 sem uma pontuação.

• Velocidade de saída — 243,4 tokens por segundo para o Claude Haiku 5.5; não informado para o Aion 3.5.

Por que a tarifa fixa não é a vitória que parece

O preço fixo de US$ 3 do Aion 3.5 para 256K é o ponto mais claro de sua precificação, e é uma resposta direta à falta de jeito do lado da Anthropic: um prompt que cresce de 99.000 para 101.000 tokens custa cinco vezes mais por token, o que força você ou a permanecer bem abaixo da linha ou a desistir por completo da faixa barata. O Aion 3.5 não tem linha. Você pode enviar 240.000 tokens e pagar a mesma tarifa por token que pagaria por 4.000.

Essa vantagem evapora no momento em que você faz as contas com uma carga de trabalho real. Uma chamada de 240.000 tokens no Aion 3.5 custa cerca de US$ 0,72 em entrada; a mesma chamada no Claude Haiku 5.5 acima do limite custa cerca de US$ 0,12. Mesmo pagando a tarifa penalizada após 100 mil, o Haiku 5.5 é aproximadamente seis vezes mais barato no maior prompt que qualquer um dos modelos consegue processar. A tarifa fixa elimina um penhasco, não um custo.

Onde o preço fixo realmente ajuda é na previsibilidade. Um pipeline cujo tamanho do prompt oscila entre 80.000 e 130.000 tokens é um tormento de orçar num esquema por camadas e trivial num esquema fixo, e, se esse é o seu perfil, o caráter fixo do Aion 3.5 já vale alguma coisa mesmo antes de a capacidade entrar na conversa.

O argumento a favor de Aion 3.5, apresentado da forma mais contundente que as evidências permitem

Três argumentos se sustentam. Primeiro, raciocínio obrigatório em um nível alto por padrão significa menos engenharia de prompt: não há parâmetro de esforço para ajustar e nem risco de uma configuração baixa degradar silenciosamente uma tarefa que ninguém retestou. Segundo, um ensemble na família GLM tem um perfil de falha genuinamente diferente do de um único modelo pequeno da Anthropic, e, se você já executa o Claude Haiku 5.5 em uma grande superfície, uma segunda opinião não correlacionada tem valor mesmo a trinta vezes o preço de entrada — você rotearia para ele raramente. Terceiro, o Aion 3.5 Mini a $0.70 / $0.18 / $1.40 com o mesmo contexto de 256K é uma camada barata crível, e qualquer comparação que olhe apenas para o carro-chefe está comparando o modelo Aion errado.

O que não se sustenta é tratar o preço premium de trinta vezes como evidência de capacidade trinta vezes maior. A AionLabs não publica nenhum benchmark para o Aion 3.5 que consigamos encontrar, nenhum laboratório independente o avaliou, e a alegação de ensemble não tem nenhuma avaliação pública vinculada a ela. Um fornecedor que tenha um modelo mais forte que o Claude Haiku 5.5 e consiga demonstrá-lo, demonstraria.

Onde o Claude Haiku 5.5 vence de forma incontestável, e não é por pouco

Entrada de imagens, para começar. O Aion 3.5 é somente texto, e o Claude Haiku 5.5 aceita imagens, o que decide qualquer carga de trabalho de documentos, capturas de tela ou diagramas antes mesmo de se falar em preço. Saída máxima, como outro ponto: 128.000 tokens contra 32.768, com um caminho beta de 300.000 tokens no Batch. E o seletor de esforço, que é um mecanismo de controle de custos e não uma capacidade: no Low, o Claude Haiku 5.5 produz muito menos tokens de raciocínio e, como o raciocínio é cobrado como saída, é aí que você mantém um agente verboso dentro da faixa barata.

A pontuação independente é a palavra final sobre isso. No índice da Artificial Analysis, o Claude Haiku 5.5 está em 43 no geral e 43,40 na configuração Max, segundo de 182 modelos, a US$ 0,21 por tarefa do índice, com 243,4 tokens por segundo de saída. Esses são números obtidos de forma independente. O Aion 3.5 não tem nenhum, e até que tenha, a comparação que o comprador está de fato fazendo é "um modelo com uma pontuação publicada e um preço que eu consigo prever" contra "um modelo com um preço mais alto e sem pontuação", o que não é uma decisão difícil para um caminho de produção.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Aion 3.5 — the scoreboard'. Claude Haiku 5.5 reads input $0.10 to $0.50 per million, output $0.50 to $2.50, 1M-token context, 128K maximum output, AA Index 43, text and image in; Aion 3.5 reads input $3.00 flat, output $6.00 flat, 262K context, 32K maximum output, no published independent score, text only. A footer notes that Claude Haiku 5.5 figures are per Artificial Analysis and Aion 3.5 figures are vendor-reported and unreproduced.

Executar ambos sem duplicar a infraestrutura

O Aion 3.5 está acessível através da própria API da AionLabs e de várias plataformas de terceiros. O Claude Haiku 5.5 está disponível através da API da Anthropic e, a partir daí, onde quer que os modelos da Anthropic sejam revendidos. Nenhum dos dois está no catálogo da OrcaRouter hoje, e não vamos insinuar o contrário: o que roteamos deste canto do mercado é anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 e anthropic/claude-fable-5.1 — o nível acima do modelo sobre o qual este artigo trata.

A razão pela qual isso importa aqui é que a arquitetura sensata para esse confronto é uma pequena parcela do tráfego no modelo caro. Você não migra um pipeline para um ensemble de $3,00 por milhão; você envia a ele os dois por cento das chamadas em que uma segunda opinião vale $3,00, e mantém todo o resto no modelo barato. Isso significa dois provedores, duas chaves e duas superfícies de cobrança para uma carga de trabalho de dois por cento, que é exatamente o tipo de caso para o qual um gateway serve. OrcaRouter repassa o preço de tabela do provedor com 0% de markup, então uma mudança de preço do fornecedor entra em vigor no mesmo dia, em vez de seguir um ciclo de reprecificação, e o A/B é uma string de modelo em vez de uma segunda integração. Quando nenhuma das duas pontas está no nosso catálogo, a resposta honesta é que somos a camada errada para isso e uma integração direta é o que você quer.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

O que resolveria isso

Uma avaliação independente do Aion 3.5. Essa é a peça que falta. Se um laboratório neutro o pontuar em algo próximo dos 43 do Claude Haiku 5.5, a US$ 0,21 por tarefa, então a AionLabs está cobrando trinta vezes o preço de entrada para entregar paridade, e o argumento do ensemble é um passivo, e não um recurso. Se ele pontuar materialmente mais alto, então o prêmio é real e a decisão certa é gastá-lo na pequena fração de chamadas que precisam dele. Enquanto esse número não existir, um comprador que escolhe entre esses dois está escolhendo um modelo avaliado a um preço publicado ou um não avaliado a um preço mais alto — e só há um padrão defensável nesse par.

Isso significa dois provedores, duas chaves e duas superfícies de cobrança para uma carga de trabalho de dois por cento, que é exatamente o formato para o qual um gateway serve.