
Octen Search alcança o terceiro lugar no Artificial Analysis Search Index: o mais rápido por tarefa, o mais barato entre os líderes
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligência69Código
O Octen Search marcou 77 em sua primeira aparição no Artificial Analysis Search Index, o que lhe garantiu o terceiro lugar no ranking — e chegou lá em 17,2 segundos por tarefa, mais rápido do que qualquer outra coisa que o Artificial Analysis testou. O produto em si não é novo: o Octen Search está disponível comercialmente desde 22 de abril de 2026, quando sua empresa controladora, a APITECH AI, anunciou uma rodada seed de US$ 10 milhões liderada pela Square Peg. O que mudou é que, com os dados de 8 de setembro do Artificial Analysis, finalmente há um número de terceiros associado a ele, e o número é melhor do que os primeiros testes independentes práticos do Octen Search teriam previsto.
O que a Artificial Analysis está realmente medindo
O Search Index entrou no ar em 18 de agosto de 2026, e seu design é excepcionalmente limpo para uma tabela de classificação. Todos os provedores rodam dentro do mesmo harness de agente — Stirrup, o agente de código aberto da própria Artificial Analysis — impulsionado pelo mesmo modelo, GPT-5.6 Luna em raciocínio médio, e avaliado pelo mesmo corretor. O agente recebe duas ferramentas, web_search e web_fetch, com até 25 turnos por tarefa e no máximo dez resultados por busca, com fontes de contaminação conhecidas filtradas. Uma execução que consome todos os 25 turnos sem chamar finish recebe pontuação zero, então deixar o agente incapaz de concluir uma tarefa é punido tão severamente quanto não recuperar nada.
A única variável é o provedor de busca. Essa é a propriedade que falta à maioria das comparações de busca, e é o que torna o posicionamento do Octen Search legível como uma afirmação sobre recuperação, e não sobre qual fornecedor incluiu o modelo de resposta mais forte.
As pontuações são a média com pesos iguais de três avaliações em uma escala de 0 a 100. O F1 do DeepSearchQA é executado sobre uma divisão de 900 tarefas de perguntas amplas de pesquisa e avalia a resposta como uma lista de itens. A acurácia do BrowseComp usa um subconjunto difícil de 200 amostras de fatos com múltiplos saltos, em que a resposta é um único valor verificável. A acurácia do AA-Omniscience usa 600 perguntas de conhecimento geral reservadas e existe principalmente para isolar quanto a busca acrescenta além do que o modelo já sabia. Como o índice é uma média simples, um único componente fraco puxa o número principal para baixo, e o perfil dos componentes costuma ser mais útil do que o ranking. Executar o mesmo agente sem nenhuma ferramenta de busca pontua 33, então quase tudo o que um provedor obtém é ganho em relação aos próprios parâmetros do modelo.
A Artificial Analysis afirma ter testado 20 produtos de busca em 10 fornecedores; os gráficos padrão exibem 12 deles.
Onde o Octen Search chegou
O topo da tabela de 8 de setembro, com custos por tarefa calculados somando as colunas de busca e de tokens de modelo que a Artificial Analysis publica por 1.000 tarefas — o próprio ranking não exibe um único valor combinado:
• Perplexity Search (médio) — Índice 80, 28,8s por tarefa, cerca de US$ 0,091 por tarefa
• Perplexity Search (alta) — Índice 79, 29,7s, cerca de $0,091
• Octen Search (destaques) — Índice 77, 17,2s, cerca de $0,058
• Perplexity Search (baixo) — Índice 77, 37,4s, cerca de $0,105
• Pesquisa Paralela (avançada) — Índice 75, 42,9s, cerca de $0,084
• Brave Search (contexto de LLM) — Índice 75, 24,4s, cerca de $0,130
• You.com Search (destaques) — Índice 74, 20,7 s, cerca de US$ 0,117
• Exa Search (automático) — Índice 74, 33,3s, cerca de $0,127
As pontuações por componente são onde o posicionamento fica mais interessante do que o ranking. O Octen Search marca 80 no DeepSearchQA, 86 no BrowseComp e 66 no AA-Omniscience. O Parallel Search (advanced), o provedor que liderou o índice no lançamento, marca 81, 77 e 67. Assim, o Octen Search supera o Parallel Search em nove pontos no benchmark de apuração de fatos com múltiplos saltos e o iguala em pesquisa ampla, enquanto fica atrás das configurações do Perplexity Search no ganho de conhecimento geral — 66 contra 72 do Perplexity Search (medium). Em termos simples, o Octen Search é muito bom em caçar coisas genuinamente difíceis de encontrar e oferece menos ganho extra em perguntas que o modelo já conhece pela metade.
Um pequeno detalhe que vale a pena observar para quem for citar isto: o próprio anúncio do resultado pela Artificial Analysis colocou o Octen Search em 16,9 segundos por tarefa, enquanto a tabela ao vivo mostra 17,2 nos dados de 8 de setembro. Isso é variação entre reexecuções, não uma contradição, mas é o motivo de citar a tabela em vez da postagem em rede social.

A velocidade é a manchete; a divisão dos custos é a verdadeira história.
17,2 segundos por tarefa tornam o Octen Search a entrada mais rápida do índice. O Perplexity Search (medium) precisa de 28,8 segundos, o Parallel Search (advanced) de 42,9, e o Firecrawl Search de 63,2. A Artificial Analysis também relata o Octen Search como o mais rápido por consulta individual, com uma média de 0,21 segundos por pesquisa — o tempo de chamada mais rápido medido, independentemente de quantas chamadas uma tarefa exige.
O número que vale a pena encarar, no entanto, é a decomposição de custos. A cada 1.000 tarefas, a Artificial Analysis estima o Octen Search em US$ 9,07 de gastos com pesquisa e US$ 49,15 de gastos com tokens de modelo. Os tokens custam cerca de 5,4 vezes as pesquisas. Isso não é uma peculiaridade do Octen Search — é o ponto estrutural que este índice vem repetindo. Um provedor de pesquisa não cobra apenas pela recuperação; ele decide quantos turnos o agente dá, e cada turno extra são tokens de modelo à tarifa do modelo.
A Artificial Analysis fez o mesmo argumento com o Parallel no lançamento: o modo avançado custava mais por pesquisa do que o básico (US$ 0,048 contra US$ 0,045), mas menos por tarefa (US$ 0,084 contra US$ 0,11), porque resultados melhores reduziram o uso de tokens de cerca de 339.000 para 169.000 por tarefa. Chamadas mais baratas e tarefas mais baratas são coisas diferentes, e apenas uma delas aparece na sua fatura.
Comparando com o resto da tabela, o custo de cerca de $0,058 por tarefa do Octen Search é o mais baixo de tudo o que pontua 75 ou mais. O TinyFish Search é mais barato, a cerca de $0,035, mas pontua 71 e demora 60,4 segundos a concluir uma tarefa.
O que o resultado resolve, e o que não resolve
Os números da própria Octen sempre foram agressivos e continuam sendo informados pelo fornecedor. A empresa afirma latência P50 de 62 ms e P90 de 68 ms no benchmark SealQA Hard, vazão acima de um milhão de consultas por segundo por conta, novo conteúdo indexado em até cinco minutos, e uma colocação global em terceiro lugar no DeepResearch Bench, com uma pontuação geral de 55,58. Nenhum desses números foi reproduzido de forma independente, e vários não são diretamente comparáveis a nada mais publicado.
Agora existem dois testes independentes, e eles apontam em direções diferentes. A Artificial Analysis, mantendo o modelo e o harness fixos, coloca o Octen Search em terceiro lugar em qualidade e em primeiro em velocidade. Um benchmark independente separado publicado em agosto de 2026 mediu o Octen Search em 359 ms de P50 e 941 ms de P95 — várias vezes a latência alegada pelo fornecedor — e um nDCG@10 de 0,495, logo abaixo da linha de 0,5 e atrás de Parallel, Brave, Kagi, Perplexity, Context, Tavily e Exa nessa métrica. A equipe da Octen disse àquele avaliador que seu próprio benchmark testa principalmente a latência, e não a qualidade dos resultados, o que é um esclarecimento justo e também uma admissão de que a qualidade dos resultados não era o que estava sendo alegado.
Ambos os resultados podem estar corretos, porque fazem perguntas diferentes. Aquele teste anterior avaliava se os dez primeiros resultados pareciam relevantes por heurísticas de metadados em seu próprio conjunto de consultas; a Artificial Analysis avalia se um agente, com um modelo real a conduzi-lo, conclui uma tarefa corretamente. O que a posição no índice estabelece firmemente é mais restrito do que "melhor API de busca" e mais útil do que uma alegação de fornecedor: na conclusão de tarefas agênticas, com o modelo mantido constante, o Octen Search é competitivo com os provedores mais fortes e mais rápido que todos eles.
Quanto custa realmente executar o Octen Search
Os preços publicados da Octen, que a empresa atualizou pela última vez em 7 de setembro de 2026:
• Chamadas à API de pesquisa — US$ 1 por 1.000 chamadas, um desconto de 80% sobre o preço de tabela de US$ 5, aplicado automaticamente desde 16 de julho de 2026
• Limites de resultados — os primeiros 10 resultados dentro de uma pesquisa são gratuitos; os extras são cobrados a US$ 0,50 por 1.000 resultados
• Outros endpoints — Pesquisa de Imagens e Pesquisa de Vídeos a US$ 5 por 1.000 chamadas; Extração a US$ 1 por 1.000 URLs processadas com sucesso
• Embeddings — octen-embedding-8b a $0,07 e octen-embedding-0.6b a $0,01 por milhão de tokens
• Planos de throughput — nível gratuito até 10 QPS; Base até 20 QPS sem custo assim que a conta tiver crédito; Builder até 50 QPS por US$ 2.099/mês; Pro até 200 QPS por US$ 13.999/mês; Max até 500 QPS por US$ 33.999/mês
• Cadastro — $5 de saldo grátis
As camadas de throughput são a parte que silenciosamente quebra as contas de custo. Esse US$ 0,058 por tarefa é um cálculo puramente por chamada. Se sua carga de trabalho precisa de 200 consultas simultâneas por segundo, você está pagando US$ 13.999 por mês antes de a primeira busca ser executada, e o valor por tarefa deixa de ser o número interessante.
Também há as lacunas que foram sinalizadas quando a Octen foi lançada: termos de retenção zero de dados, certificações de conformidade e disponibilidade regional não são publicados com o mesmo nível de detalhe que os fornecedores estabelecidos publicam. Se você está lançando em um ambiente regulamentado, isso importa consideravelmente mais do que uma diferença de três pontos no índice.


Se está em terceiro, por que alguém ainda escolheria o Perplexity Search?
A diferença de três pontos para o Perplexity Search (medium) é menor do que parece, e o argumento para trocar de vez também é menor. O Perplexity Search vence no AA-Omniscience por 72 a 66, e retorna uma resposta sintetizada e com citações em uma única chamada, algo que alguns pipelines querem e que este índice — construído em torno de um agente de chamada de ferramentas — não recompensa. As vantagens do Octen Search são velocidade e preço: cerca de 1,7 vez mais rápido por tarefa e aproximadamente 36% mais barato por tarefa do que o Perplexity Search (medium) com base nesses números.
O resumo prático: se o seu agente é limitado por latência, ou se a sua fatura é dominada pela recuperação em volume, o Octen Search é agora um padrão defensável em vez de uma aposta. Se o seu pipeline depende de uma resposta sintetizada, ou da postura de conformidade de um incumbente, o índice não lhe dá qualquer razão para mudar.
Onde isso deixa a sua stack de agentes
O Search Index mede uma camada que a maioria das equipes trata como infraestrutura básica, e levanta um ponto que vai além da busca. Na própria linha do Octen Search, os tokens do modelo custam 5,4 vezes a conta de recuperação. Independentemente do que você escolher para recuperação, é no lado do modelo que o dinheiro vai, e é o lado que você menos quer reintegrar sempre que testa um novo fornecedor de busca.
É por isso que faz sentido manter o caminho do modelo atrás de um único endpoint. O OrcaRouter atende mais de 200 modelos por trás de uma única API com 0% de margem — o preço de tabela do fornecedor é repassado, de modo que um corte de preço do fornecedor chega até você no mesmo dia — com failover automático entre fornecedores e uma DSL de roteamento para compor vários modelos em uma única chamada. Mantenha a rota do modelo fixa, troque a camada de recuperação por trás dela e, se o novo fornecedor se mostrar mais fraco no seu tráfego do que é no DeepSearchQA, você terá mudado uma dependência em vez de duas. Você pode ver o catálogo em catálogo de modelos do OrcaRouter.
Para deixar claro o que servimos e o que não servimos: o Octen Search não está no catálogo do OrcaRouter e não fazemos proxy dele — essa chamada vai diretamente para a Octen. O que roteamos é o modelo na outra ponta.
O que assistir em seguida
Três coisas mudariam o rumo desta história. A Artificial Analysis reexecuta o índice conforme os provedores lançam mudanças, então um segundo ponto de dados em 77 ou próximo disso transformaria uma estreia em uma trajetória, enquanto uma queda sugeriria que a primeira colocação foi favorecida pela combinação de consultas. A Octen não publicou seus próprios números por benchmark do DeepSearchQA, do BrowseComp e do AA-Omniscience, o que constitui a credibilidade mais barata de que dispõe. E a tarifa de $1 por 1.000 chamadas está em vigor desde 16 de julho; se essa promoção expirar e voltar ao preço de tabela de $5, a linha referente a buscas no custo do Octen Search quase quintuplica, e o argumento de preço enfraquece consideravelmente.
Para quem está construindo um agente neste trimestre, a mudança é pequena. O índice é um sinal de qualidade por custo, não um teste de compatibilidade. Execute sua própria distribuição de consultas no Octen Search antes de transferir um caminho de recuperação em produção, e trate um 77 como um motivo para fazer benchmark, e não como um motivo para migrar.
