Una tarjeta de título generada que dice «Octen Search se sitúa en tercer lugar en el AI Search Index», con tarjetas de estadísticas que muestran una puntuación de 77 en el Artificial Analysis Search Index, en tercer lugar; 17,2 segundos por tarea como el tiempo más rápido medido; y un coste de aproximadamente $0,058 por tarea.
Guides & Insights

Octen Search ocupa el tercer lugar en el Índice de Búsqueda de Artificial Analysis: el más rápido por tarea, el más económico entre los líderes

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Octen Search obtuvo una puntuación de 77 en su primera aparición en el Artificial Analysis Search Index, lo que le valió el tercer puesto en la clasificación — y llegó allí en 17,2 segundos por tarea, más rápido que cualquier otra cosa que Artificial Analysis probó. El producto en sí no es nuevo: Octen Search está disponible comercialmente desde el 22 de abril de 2026, cuando su empresa matriz APITECH AI anunció una ronda semilla de 10 millones de dólares liderada por Square Peg. Lo que cambió es que, según los datos de Artificial Analysis del 8 de septiembre, por fin hay una cifra de terceros asociada a él, y la cifra es mejor de lo que habrían pronosticado las primeras pruebas independientes prácticas de Octen Search.

Qué está midiendo realmente Artificial Analysis

El Índice de Búsqueda se lanzó el 18 de agosto de 2026, y su diseño es inusualmente limpio para ser una tabla de clasificación. Todos los proveedores se ejecutan dentro del mismo arnés de agente —Stirrup, el propio agente de código abierto de Artificial Analysis—, impulsados por el mismo modelo, GPT-5.6 Luna con razonamiento medio, y evaluados por el mismo calificador. El agente recibe dos herramientas, web_search y web_fetch, hasta 25 turnos por tarea y como máximo diez resultados por búsqueda, con las fuentes de contaminación conocidas filtradas. Una ejecución que agota los 25 turnos sin llamar a finish obtiene cero, así que dejar al agente incapaz de cerrar una tarea se penaliza tan duramente como no recuperar nada.

La única variable es el proveedor de búsqueda. Esa es la propiedad de la que carecen la mayoría de las comparaciones de búsqueda, y es lo que hace que el posicionamiento de Octen Search pueda leerse como una declaración sobre la recuperación y no sobre qué proveedor integró el modelo de respuestas más potente.

Las puntuaciones son la media con igual ponderación de tres evaluaciones en una escala de 0 a 100. DeepSearchQA F1 se ejecuta sobre una división de 900 tareas de preguntas amplias de investigación y califica la respuesta como una lista de elementos. La precisión de BrowseComp utiliza un subconjunto difícil de 200 muestras de hechos de múltiples saltos donde la respuesta es un único valor verificable. La precisión de AA-Omniscience utiliza 600 preguntas reservadas de conocimiento general y existe principalmente para aislar cuánto aporta la búsqueda más allá de lo que el modelo ya sabía. Dado que el índice es una media simple, un solo componente débil arrastra a la baja la cifra principal, y el perfil de componentes suele ser más útil que la clasificación. Ejecutar el mismo agente sin ninguna herramienta de búsqueda obtiene una puntuación de 33, así que casi todo lo que gana un proveedor es una mejora con respecto a los propios parámetros del modelo.

Artificial Analysis dice que probó 20 productos de búsqueda de 10 proveedores; los gráficos predeterminados muestran 12 de ellos.

Dónde aterrizó Octen Search

La parte superior de la tabla del 8 de septiembre, con los costes por tarea calculados al sumar las columnas de búsqueda y de tokens del modelo que Artificial Analysis publica por cada 1000 tareas —la propia tabla de clasificación no muestra una única cifra combinada:

• Perplexity Search (medio) — Índice 80, 28,8 s por tarea, aproximadamente $0,091 por tarea

• Perplexity Search (alto) — Índice 79, 29,7s, aproximadamente $0,091

• Octen Search (destacados) — Índice 77, 17.2s, aproximadamente $0.058

• Perplexity Search (bajo) — Índice 77, 37.4s, aproximadamente $0.105

• Búsqueda paralela (avanzada) — Índice 75, 42,9 s, aproximadamente $0,084

• Brave Search (contexto de LLM) — Índice 75, 24,4 s, aproximadamente $0,130

• You.com Search (destacados) — Índice 74, 20,7 s, aproximadamente $0,117

• Exa Search (automático) — Índice 74, 33,3 s, aproximadamente $0,127

Las puntuaciones por componente son donde el posicionamiento se vuelve más interesante que la clasificación. Octen Search obtiene 80 en DeepSearchQA, 86 en BrowseComp y 66 en AA-Omniscience. Parallel Search (advanced), el proveedor que lideró el índice en su lanzamiento, obtiene 81, 77 y 67. Así, Octen Search supera a Parallel Search por nueve puntos en el benchmark de búsqueda de hechos de múltiples saltos y lo iguala en investigación amplia, mientras queda por detrás de las configuraciones de Perplexity Search en la mejora de conocimiento general: 66 frente a 72 de Perplexity Search (medium). En términos simples, Octen Search es muy bueno encontrando cosas que son genuinamente difíciles de encontrar, y ofrece menos extra en preguntas que el modelo ya conoce a medias.

Un pequeño matiz que vale la pena señalar para cualquiera que cite esto: el propio anuncio de Artificial Analysis del resultado situaba a Octen Search en 16,9 segundos por tarea, mientras que la tabla en vivo muestra 17,2 con los datos del 8 de septiembre. Eso es variación entre ejecuciones, no una contradicción, pero es la razón para citar la tabla en lugar de la publicación en redes sociales.

Screenshot of the Artificial Analysis Search Index leaderboard, September 8 2026 data, showing Octen Search (highlights) third at Index 77 with 17.2 seconds per task, behind Perplexity Search medium at 80 and high at 79.

La velocidad es el titular; el reparto de costes es la verdadera historia

17,2 segundos por tarea hacen de Octen Search la entrada más rápida del índice. Perplexity Search (medium) necesita 28,8 segundos, Parallel Search (advanced) 42,9, y Firecrawl Search 63,2. Artificial Analysis también informa que Octen Search es el más rápido por consulta individual, con un promedio de 0,21 segundos por búsqueda — el tiempo de llamada más rápido medido, independientemente de cuántas llamadas requiera una tarea.

No obstante, la cifra que merece la pena mirar fijamente es el desglose de costos. Por cada 1.000 tareas, Artificial Analysis sitúa a Octen Search en 9,07 $ de gasto en búsquedas y 49,15 $ de gasto en tokens de modelo. Los tokens cuestan aproximadamente 5,4 veces lo que las búsquedas. Eso no es una peculiaridad de Octen Search; es el punto estructural que este índice insiste en señalar. Un proveedor de búsqueda no solo te cobra por la recuperación; también decide cuántos turnos realiza el agente, y cada turno adicional son tokens de modelo a la tarifa del modelo.

Artificial Analysis planteó el mismo argumento con Parallel en su lanzamiento: el modo avanzado costaba más por búsqueda que el básico (0,048 $ frente a 0,045 $), pero menos por tarea (0,084 $ frente a 0,11 $), porque unos mejores resultados reducían el uso de tokens de aproximadamente 339.000 a 169.000 por tarea. Las llamadas más baratas y las tareas más baratas son cosas distintas, y solo una de ellas aparece en tu factura.

Si se compara con el resto de la tabla, el coste de Octen Search, de aproximadamente $0.058 por tarea, es el más bajo de todo lo que puntúa 75 o más. TinyFish Search es más barato, con unos $0.035, pero puntúa 71 y tarda 60.4 segundos en completar una tarea.

Lo que el resultado resuelve, y lo que no

Los números propios de Octen siempre han sido agresivos, y siguen siendo reportados por el proveedor. La empresa afirma una latencia de 62 ms en P50 y 68 ms en P90 en el benchmark SealQA Hard, un rendimiento superior a un millón de consultas por segundo por cuenta, contenido nuevo indexado en cinco minutos y una posición global número tres en DeepResearch Bench con un 55,58 general. Ninguno de ellos ha sido reproducido de forma independiente, y varios no son directamente comparables con nada más publicado.

Ahora existen dos pruebas independientes, y apuntan en direcciones distintas. Artificial Analysis, manteniendo fijos el modelo y el entorno de pruebas, sitúa a Octen Search en tercer lugar en calidad y primero en velocidad. Un benchmark independiente aparte publicado en agosto de 2026 midió Octen Search en 359 ms P50 y 941 ms P95 —varias veces la latencia declarada por el proveedor— y un nDCG@10 de 0,495, justo por debajo de la línea de 0,5 y por detrás de Parallel, Brave, Kagi, Perplexity, Context, Tavily y Exa en esa métrica. El equipo de Octen dijo a ese evaluador que su propio benchmark evalúa principalmente la latencia en lugar de la calidad de los resultados, lo cual es una aclaración justa y también una admisión de que la calidad de los resultados no era lo que se estaba afirmando.

Ambos resultados pueden ser correctos, porque responden a preguntas diferentes. Aquel test anterior evaluaba si los diez primeros resultados parecían relevantes mediante heurísticas de metadatos sobre su propio conjunto de consultas; Artificial Analysis evalúa si un agente, impulsado por un modelo real, completa una tarea correctamente. Lo que la posición en el índice establece con firmeza es más limitado que «la mejor API de búsqueda» y más útil que una afirmación de un proveedor: en la finalización de tareas agénticas, con el modelo constante, Octen Search es competitivo con los proveedores más fuertes y más rápido que todos ellos.

Los precios publicados de Octen, que la empresa actualizó por última vez el 7 de septiembre de 2026:

• Llamadas a Search API — $1 por cada 1,000 llamadas, un 80% de descuento sobre el precio de lista de $5 que se ha aplicado automáticamente desde el 16 de julio de 2026

• Límites de resultados — los primeros 10 resultados dentro de una búsqueda son gratuitos; los adicionales se facturan a $0.50 por cada 1,000 resultados

• Otros endpoints — Búsqueda de Imágenes y Búsqueda de Videos a $5 por cada 1.000 llamadas; Extract a $1 por cada 1.000 URL procesadas correctamente

• Embeddings — octen-embedding-8b a $0.07 y octen-embedding-0.6b a $0.01 por millón de tokens

• Planes de rendimiento — nivel gratuito de hasta 10 QPS; Base de hasta 20 QPS sin cargo una vez que la cuenta tenga crédito; Builder de hasta 50 QPS por $2,099/mes; Pro de hasta 200 QPS por $13,999/mes; Max de hasta 500 QPS por $33,999/mes

• Registro — $5 en saldo gratis

Los niveles de rendimiento son la parte que rompe silenciosamente las cuentas de costos. Ese $0.058 por tarea es un cálculo puro por llamada. Si tu carga de trabajo necesita 200 consultas concurrentes por segundo, estarás pagando $13,999 al mes antes de que se ejecute la primera búsqueda, y la cifra por tarea deja de ser el número interesante.

También están las lagunas que se señalaron cuando Octen se lanzó: los términos de retención cero de datos, las certificaciones de cumplimiento y la disponibilidad regional no se publican con el mismo detalle que por parte de los proveedores consolidados. Si vas a implementar en un entorno regulado, eso importa mucho más que una diferencia de tres puntos en el índice.

A scoreboard card for Octen Search listing its Artificial Analysis Search Index score of 77 in third place, 17.2 seconds per task as the fastest measured, an estimated $0.058 cost per task as the lowest of anything scoring 75 or above, 0.21 seconds average per search query, a $1 per 1,000 calls search list price, and an independent nDCG@10 of 0.495.Screenshot of Octen's official pricing documentation showing the QPS plan tiers from the free 10 QPS tier through the $2,099 Builder, $13,999 Pro and $33,999 Max plans, the $1 per 1,000 calls web search rate discounted 80 percent from the $5 list price, and the $5 per 1,000 calls image and video search rate.

La brecha de tres puntos respecto a Perplexity Search (medium) es más pequeña de lo que parece, y el argumento para cambiar sin más también. Perplexity Search gana en AA-Omniscience por 72 a 66, y devuelve una respuesta sintetizada y citada en una sola llamada, algo que algunos pipelines quieren y que este índice —construido en torno a un agente que llama a herramientas— no recompensa. Las ventajas de Octen Search son la velocidad y el precio: alrededor de 1,7 veces más rápido por tarea y aproximadamente un 36 % más barato por tarea que Perplexity Search (medium) según estas cifras.

El resumen práctico: si tu agente está limitado por la latencia, o si tu factura está dominada por la recuperación a gran volumen, Octen Search es ahora una opción predeterminada defendible en lugar de una apuesta arriesgada. Si tu canalización depende de una respuesta sintetizada, o de la postura de cumplimiento de un proveedor establecido, el índice no te da ninguna razón para cambiar.

Dónde deja esto tu stack de agentes

El Search Index mide una capa que la mayoría de los equipos trata como infraestructura básica, y plantea un punto que trasciende la búsqueda. En la propia fila de Octen Search, los tokens del modelo cuestan 5,4 veces la factura de recuperación. Elijas lo que elijas para la recuperación, el lado del modelo es donde se va el dinero, y es el lado que menos quieres volver a integrar cada vez que pones a prueba a un nuevo proveedor de búsqueda.

Ese es el argumento a favor de mantener la ruta del modelo detrás de un único endpoint. OrcaRouter sirve más de 200 modelos detrás de una sola API con un 0 % de recargo —el precio de lista del proveedor se transfiere tal cual, así que una rebaja de precio de un proveedor te llega el mismo día—, con conmutación automática en caso de fallo entre proveedores y un DSL de enrutamiento para componer varios modelos en una sola llamada. Mantén fija la ruta del modelo, cambia la capa de recuperación que hay detrás y, si el nuevo proveedor resulta ser más débil con tu tráfico de lo que es con DeepSearchQA, habrás cambiado una dependencia en lugar de dos. Puedes ver el catálogo en el catálogo de modelos de OrcaRouter.

Para ser claros sobre lo que servimos y lo que no: Octen Search no está en el catálogo de OrcaRouter y no actuamos como proxy para ello — esa llamada va directamente a Octen. Lo que enrutamos es el modelo que está al otro lado.

Qué ver a continuación

Tres cosas harían cambiar esta historia. Artificial Analysis vuelve a ejecutar el índice a medida que los proveedores implementan cambios, así que un segundo punto de datos en 77 o cerca de 77 convertiría un debut en una trayectoria, mientras que una caída sugeriría que la primera posición se vio favorecida por la mezcla de consultas. Octen no ha publicado sus propias cifras por benchmark de DeepSearchQA, BrowseComp y AA-Omniscience, que es la credibilidad más barata de la que dispone. Y la tarifa de $1 por cada 1,000 llamadas está vigente desde el 16 de julio; si esa promoción caduca y vuelve al precio de lista de $5, la partida de búsqueda en el costo de Octen Search se quintuplica aproximadamente y el argumento de precio se debilita considerablemente.

Para cualquiera que esté construyendo un agente este trimestre, el cambio es pequeño. El índice es una señal de calidad por coste, no una prueba de compatibilidad. Ejecuta tu propia distribución de consultas contra Octen Search antes de mover una ruta de recuperación en producción, y trata un 77 como una razón para hacer una evaluación comparativa en lugar de una razón para migrar.