Une carte de titre générée indiquant « Octen Search se classe troisième sur l’AI Search Index », avec des cartes de statistiques affichant un score de 77 à l’Artificial Analysis Search Index, en troisième position, 17,2 secondes par tâche comme le plus rapide mesuré, et un coût d’environ 0,058 $ par tâche.
Guides & Insights

Octen Search décroche la troisième place de l’Artificial Analysis Search Index : le plus rapide par tâche, le moins cher des leaders

Auteur

Gideon Frost

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Octen Search a obtenu 77 lors de sa première apparition dans l’Artificial Analysis Search Index, ce qui lui vaut la troisième place du classement — et il y est parvenu en 17,2 secondes par tâche, plus rapidement que tout ce qu’Artificial Analysis a testé. Le produit lui-même n’est pas nouveau : Octen Search est commercialisé depuis le 22 avril 2026, date à laquelle sa société mère APITECH AI a annoncé un tour de financement d’amorçage de 10 millions de dollars mené par Square Peg. Ce qui a changé, c’est que, d’après les données du 8 septembre d’Artificial Analysis, un chiffre provenant d’un tiers lui est enfin associé, et ce chiffre est meilleur que ce que les tout premiers tests pratiques indépendants d’Octen Search auraient laissé prévoir.

Ce qu'Artificial Analysis mesure réellement

Le Search Index a été mis en ligne le 18 août 2026, et sa conception est inhabituellement épurée pour un classement. Chaque fournisseur s'exécute dans le même harnais d'agent — Stirrup, l'agent open source d'Artificial Analysis lui-même — piloté par le même modèle, GPT-5.6 Luna en raisonnement moyen, et noté par le même évaluateur. L'agent dispose de deux outils, web_search et web_fetch, avec jusqu'à 25 tours par tâche et au maximum dix résultats par recherche, les sources de contamination connues étant écartées. Une exécution qui épuise les 25 tours sans appeler finish obtient un score de zéro, donc le fait de laisser l'agent incapable d'achever une tâche est puni aussi durement que de ne rien récupérer.

La seule variable est le fournisseur de recherche. C’est la propriété qui manque à la plupart des comparaisons de moteurs de recherche, et c’est ce qui permet de lire le positionnement d’Octen Search comme une affirmation sur la récupération plutôt que sur le fournisseur qui a intégré le modèle de réponse le plus performant.

Les scores sont la moyenne à pondération égale de trois évaluations sur une échelle de 0 à 100. Le F1 de DeepSearchQA s’exécute sur un sous-ensemble de 900 tâches composé de vastes questions de recherche et note la réponse sous forme de liste d’éléments. L’exactitude de BrowseComp utilise un sous-ensemble difficile de 200 échantillons de faits à sauts multiples où la réponse est une valeur unique vérifiable. L’exactitude d’AA-Omniscience utilise 600 questions de culture générale mises de côté et sert principalement à isoler ce que la recherche ajoute au-delà de ce que le modèle savait déjà. Comme l’indice est une simple moyenne, une seule composante faible fait baisser le chiffre phare, et le profil des composantes est souvent plus utile que le classement. Exécuter le même agent sans aucun outil de recherche obtient un score de 33, donc presque tout ce qu’un fournisseur gagne est un gain par rapport aux paramètres propres du modèle.

Artificial Analysis indique avoir testé 20 produits de recherche auprès de 10 fournisseurs ; les graphiques par défaut en affichent 12.

Où Octen Search a atterri

Le haut du tableau du 8 septembre, avec les coûts par tâche calculés en additionnant les colonnes recherche et tokens de modèle qu’Artificial Analysis publie pour 1 000 tâches — le classement lui-même n’affiche pas un chiffre combiné unique :

• Perplexity Search (medium) — Index 80, 28,8 s par tâche, environ 0,091 $ par tâche

• Perplexity Search (élevé) — Index 79, 29,7 s, environ 0,091 $

• Octen Search (surlignages) — Indice 77, 17,2 s, environ 0,058 $

• Perplexity Search (faible) — Index 77, 37,4 s, environ 0,105 $

• Recherche parallèle (avancée) — Index 75, 42,9 s, environ 0,084 $

• Brave Search (contexte LLM) — Index 75, 24,4 s, environ 0,130 $

• You.com Search (points forts) — Index 74, 20,7 s, environ 0,117 $

• Exa Search (auto) — Index 74, 33,3 s, environ 0,127 $

Les scores par composante sont l'endroit où le positionnement devient plus intéressant que le classement. Octen Search obtient 80 sur DeepSearchQA, 86 sur BrowseComp et 66 sur AA-Omniscience. Parallel Search (advanced), le fournisseur qui menait l'index lors de son lancement, obtient 81, 77 et 67. Ainsi, Octen Search devance Parallel Search de neuf points sur le benchmark de recherche de faits à sauts multiples et l'égale sur la recherche large, tout en étant en retrait par rapport aux réglages de Perplexity Search sur l'apport en connaissances générales — 66 contre 72 pour Perplexity Search (medium). En clair, Octen Search est très bon pour dénicher des choses réellement difficiles à trouver, et apporte moins de valeur ajoutée sur les questions que le modèle connaît déjà à moitié.

Un petit détail à signaler pour quiconque cite cela : l’annonce du résultat par Artificial Analysis elle-même plaçait Octen Search à 16,9 secondes par tâche, tandis que le tableau en direct indique 17,2 sur les données du 8 septembre. Il s’agit d’une dérive due à une réexécution, et non d’une contradiction, mais c’est la raison pour laquelle il faut citer le tableau plutôt que la publication sur les réseaux sociaux.

Screenshot of the Artificial Analysis Search Index leaderboard, September 8 2026 data, showing Octen Search (highlights) third at Index 77 with 17.2 seconds per task, behind Perplexity Search medium at 80 and high at 79.

La vitesse, c’est le gros titre ; la répartition des coûts, c’est l’histoire.

17,2 secondes par tâche font d’Octen Search l’entrée la plus rapide de l’index. Perplexity Search (medium) a besoin de 28,8 secondes, Parallel Search (advanced) de 42,9, et Firecrawl Search de 63,2. Artificial Analysis indique également qu’Octen Search est le plus rapide par requête individuelle, avec une moyenne de 0,21 seconde par recherche — le temps d’appel le plus rapide mesuré, indépendamment du nombre d’appels nécessaires à une tâche.

Le chiffre qui mérite qu'on s'y attarde, toutefois, c'est la ventilation des coûts. Pour 1 000 tâches, Artificial Analysis estime qu'Octen Search dépense 9,07 $ en recherche et 49,15 $ en jetons de modèle. Les jetons coûtent environ 5,4 fois plus cher que les recherches. Ce n'est pas une particularité d'Octen Search — c'est le point structurel que cet indice ne cesse de mettre en évidence. Un fournisseur de recherche ne vous facture pas seulement la récupération ; il détermine le nombre de tours que l'agent effectue, et chaque tour supplémentaire représente des jetons de modèle au tarif du modèle.

Artificial Analysis a tenu le même raisonnement avec Parallel lors de son lancement : le mode avancé coûtait plus cher par recherche que le mode de base (0,048 $ contre 0,045 $), mais moins cher par tâche (0,084 $ contre 0,11 $), parce que de meilleurs résultats réduisaient l’utilisation de tokens d’environ 339 000 à 169 000 par tâche. Des appels moins chers et des tâches moins chères sont deux choses différentes, et une seule d’entre elles apparaît sur votre facture.

Comparé au reste du classement, le coût d’environ 0,058 $ par tâche d’Octen Search est le plus bas de tout ce qui obtient une note de 75 ou plus. TinyFish Search est moins cher, à environ 0,035 $, mais il obtient 71 et met 60,4 secondes pour terminer une tâche.

Ce que le résultat tranche, et ce qu’il ne tranche pas

Les chiffres propres à Octen ont toujours été agressifs, et ils restent déclarés par le fournisseur. L’entreprise revendique une latence P50 de 62 ms et P90 de 68 ms sur le benchmark SealQA Hard, un débit supérieur à un million de requêtes par seconde et par compte, l’indexation de nouveaux contenus en cinq minutes, et une troisième place mondiale sur DeepResearch Bench avec un score global de 55,58. Aucun de ces éléments n’a été reproduit de manière indépendante, et plusieurs ne sont pas directement comparables à d’autres résultats publiés.

Deux tests indépendants existent désormais, et ils pointent dans des directions différentes. Artificial Analysis, en gardant le modèle et le harnais fixes, place Octen Search troisième en qualité et premier en vitesse. Un benchmark indépendant distinct publié en août 2026 a mesuré Octen Search à 359 ms en P50 et 941 ms en P95 — plusieurs fois la latence annoncée par le fournisseur — et un nDCG@10 de 0,495, juste sous la barre des 0,5 et derrière Parallel, Brave, Kagi, Perplexity, Context, Tavily et Exa sur cette métrique. L'équipe d'Octen a déclaré à cet évaluateur que son propre benchmark testait principalement la latence plutôt que la qualité des résultats, ce qui est une clarification juste et aussi l'aveu que la qualité des résultats n'était pas ce qui était revendiqué.

Les deux résultats peuvent être corrects, car ils posent des questions différentes. Ce test antérieur évaluait si les dix premiers résultats semblaient pertinents au moyen d’heuristiques fondées sur les métadonnées appliquées à son propre jeu de requêtes ; Artificial Analysis évalue si un agent, piloté par un vrai modèle, termine correctement une tâche. Ce que le positionnement dans l’index établit fermement est plus étroit que « meilleure API de recherche » et plus utile qu’une affirmation de fournisseur : sur l’achèvement de tâches agentiques, à modèle constant, Octen Search est compétitif avec les fournisseurs les plus performants et plus rapide que tous.

Tarification publiée d'Octen, que l’entreprise a mise à jour pour la dernière fois le 7 septembre 2026 :

• Appels à l'API Search — 1 $ par 1 000 appels, une remise de 80 % sur le prix catalogue de 5 $, appliquée automatiquement depuis le 16 juillet 2026

• Limites de résultats — les 10 premiers résultats d'une recherche sont gratuits ; les résultats supplémentaires sont facturés 0,50 $ pour 1 000 résultats

• Autres points de terminaison — Image Search et Video Search à 5 $ pour 1 000 appels ; Extract à 1 $ pour 1 000 URL traitées avec succès

• Embeddings — octen-embedding-8b à 0,07 $ et octen-embedding-0.6b à 0,01 $ par million de tokens

• Forfaits de débit — palier gratuit jusqu’à 10 QPS ; Base jusqu’à 20 QPS sans frais dès que le compte dispose d’un crédit ; Builder jusqu’à 50 QPS à 2 099 $/mois ; Pro jusqu’à 200 QPS à 13 999 $/mois ; Max jusqu’à 500 QPS à 33 999 $/mois

• Inscription — 5 $ en solde gratuit

Les paliers de débit sont la partie qui fait discrètement dérailler le calcul des coûts. Ces 0,058 $ par tâche relèvent d'un calcul purement à l'appel. Si votre charge de travail exige 200 requêtes concurrentes par seconde, vous payez 13 999 $ par mois avant même que la première recherche ne s'exécute, et le chiffre par tâche cesse d'être le nombre intéressant.

Il y a aussi les lacunes qui ont été signalées lors du lancement d’Octen : les conditions de rétention zéro des données, les certifications de conformité et la disponibilité régionale ne sont pas publiées avec autant de détails que par les fournisseurs établis. Si vous déployez dans un environnement réglementé, cela compte bien davantage qu’un écart de trois points dans l’indice.

A scoreboard card for Octen Search listing its Artificial Analysis Search Index score of 77 in third place, 17.2 seconds per task as the fastest measured, an estimated $0.058 cost per task as the lowest of anything scoring 75 or above, 0.21 seconds average per search query, a $1 per 1,000 calls search list price, and an independent nDCG@10 of 0.495.Screenshot of Octen's official pricing documentation showing the QPS plan tiers from the free 10 QPS tier through the $2,099 Builder, $13,999 Pro and $33,999 Max plans, the $1 per 1,000 calls web search rate discounted 80 percent from the $5 list price, and the $5 per 1,000 calls image and video search rate.

L'écart de trois points avec Perplexity Search (medium) est plus petit qu'il n'y paraît, et l'argument en faveur d'un changement pur et simple l'est aussi. Perplexity Search l'emporte sur AA-Omniscience par 72 à 66, et il renvoie une réponse synthétisée et sourcée en un seul appel, ce que certains pipelines recherchent et que cet indice — construit autour d'un agent à appel d'outils — ne récompense pas. Les avantages d'Octen Search sont la vitesse et le prix : environ 1,7 fois plus rapide par tâche et à peu près 36 % moins cher par tâche que Perplexity Search (medium) selon ces chiffres.

En résumé pratique : si votre agent est contraint par la latence, ou si votre facture est dominée par la récupération à fort volume, Octen Search est désormais un choix par défaut défendable plutôt qu’un pari. Si votre pipeline dépend d’une réponse synthétisée, ou de la posture de conformité d’un acteur établi, l’index ne vous donne aucune raison de changer.

Où cela laisse votre stack d’agents

L’index de recherche mesure une couche que la plupart des équipes considèrent comme de la plomberie, et il avance un point qui dépasse le cadre de la recherche. Sur la propre ligne d’Octen Search, les tokens du modèle coûtent 5,4 fois la facture de récupération. Quel que soit votre choix pour la récupération, c’est du côté du modèle que l’argent part, et c’est le côté que vous avez le moins envie de réintégrer chaque fois que vous évaluez un nouveau fournisseur de recherche.

C'est l'argument en faveur du maintien du chemin du modèle derrière un point de terminaison unique. OrcaRouter dessert plus de 200 modèles derrière une seule API avec 0 % de marge — le prix catalogue du fournisseur est répercuté tel quel, de sorte qu'une baisse de prix d'un fournisseur vous parvient le jour même — avec un basculement automatique entre fournisseurs et un DSL de routage permettant de composer plusieurs modèles en un seul appel. Gardez la route du modèle fixe, remplacez la couche de récupération derrière elle, et si le nouveau fournisseur s'avère plus faible sur votre trafic qu'il ne l'est sur DeepSearchQA, vous n'avez changé qu'une seule dépendance au lieu de deux. Vous pouvez consulter le catalogue sur le catalogue de modèles d'OrcaRouter.

Pour être explicite sur ce que nous servons et ne servons pas : Octen Search ne figure pas au catalogue d’OrcaRouter et nous ne le proxyfions pas — cet appel va directement à Octen. Ce que nous routons, c’est le modèle à l’autre bout.

Que regarder ensuite

Trois éléments feraient évoluer cette histoire. Artificial Analysis réexécute l'indice à mesure que les fournisseurs déploient des changements, ainsi un deuxième point de données à 77 ou proche de 77 transformerait un début en trajectoire, tandis qu'une baisse suggérerait que le premier classement a été flatté par la composition des requêtes. Octen n'a pas publié ses propres chiffres par benchmark pour DeepSearchQA, BrowseComp et AA-Omniscience, ce qui est la forme de crédibilité la moins coûteuse qui lui soit accessible. Et le tarif de 1 $ pour 1 000 appels est en vigueur depuis le 16 juillet ; si cette promotion expire et revient au prix catalogue de 5 $, la part de la recherche dans le coût d'Octen Search est multipliée par cinq environ et l'argument du prix s'affaiblit considérablement.

Pour quiconque construit un agent ce trimestre, le geste est modeste. L’indice est un signal de qualité par coût, pas un test de compatibilité. Testez votre propre distribution de requêtes sur Octen Search avant de déplacer un chemin de récupération en production, et considérez un 77 comme une raison de benchmarker plutôt qu’une raison de migrer.