Een gegenereerde titelkaart met de tekst "Octen Search staat derde op de AI Search Index", met statistiekkaarten die het volgende tonen: een Artificial Analysis Search Index-score van 77 op de derde plaats, 17,2 seconden per taak als de snelste gemeten tijd, en ongeveer $0,058 aan kosten per taak.
Guides & Insights

Octen Search staat derde op de Artificial Analysis Search Index: snelste per taak, goedkoopste van de koplopers

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Octen Search scoorde 77 bij zijn eerste verschijning in de Artificial Analysis Search Index, goed voor een derde plaats op de ranglijst — en die bereikte het in 17,2 seconden per taak, sneller dan alles wat Artificial Analysis testte. Het product zelf is niet nieuw: Octen Search is commercieel verkrijgbaar sinds 22 april 2026, toen het moederbedrijf APITECH AI een seedronde van $10 miljoen aankondigde onder leiding van Square Peg. Wat veranderd is, is dat er sinds de gegevens van Artificial Analysis van 8 september eindelijk een cijfer van een derde partij aan verbonden is, en dat cijfer is beter dan de vroegste onafhankelijke praktijktests van Octen Search zouden hebben voorspeld.

Wat Artificial Analysis eigenlijk meet

De Search Index ging live op 18 augustus 2026, en het ontwerp is ongewoon overzichtelijk voor een leaderboard. Elke provider draait binnen dezelfde agent-harness — Stirrup, de eigen opensource-agent van Artificial Analysis — aangestuurd door hetzelfde model, GPT-5.6 Luna met medium reasoning, en beoordeeld door dezelfde grader. De agent krijgt twee tools, web_search en web_fetch, tot 25 beurten per taak en maximaal tien resultaten per zoekopdracht, waarbij bekende contaminatiebronnen eruit worden gefilterd. Een run die alle 25 beurten verbruikt zonder finish aan te roepen, scoort nul, dus een agent de mogelijkheid ontnemen om een taak af te ronden wordt even zwaar bestraft als niets ophalen.

De enige variabele is de zoekprovider. Dat is de eigenschap die de meeste zoekvergelijkingen missen, en het is wat de plaatsing van Octen Search leesbaar maakt als een uitspraak over retrieval in plaats van over welke leverancier het sterkste antwoordmodel bundelde.

Scores zijn het gelijkgewogen gemiddelde van drie evaluaties op een schaal van 0–100. DeepSearchQA F1 loopt over een split van 900 taken met brede onderzoeksvragen en beoordeelt het antwoord als een lijst van items. BrowseComp-nauwkeurigheid gebruikt een moeilijke subset van 200 samples met multi-hop-feiten waarbij het antwoord één verifieerbare waarde is. AA-Omniscience-nauwkeurigheid gebruikt 600 achtergehouden algemene-kennisvragen en dient vooral om te isoleren hoeveel zoeken toevoegt bovenop wat het model al wist. Omdat de index een rechttoe rechtaan gemiddelde is, trekt één zwakke component het kopcijfer omlaag, en het componentprofiel is vaak nuttiger dan de rangschikking. Dezelfde agent draaien zonder enige zoektool levert een score van 33 op, dus bijna alles wat een provider verdient, is winst ten opzichte van de eigen parameters van het model.

Artificial Analysis zegt dat het 20 zoekproducten bij 10 aanbieders heeft getest; de standaardgrafieken tonen er 12 van.

Waar Octen Search is beland

De top van de tabel van 8 september, met de kosten per taak berekend door de zoek- en modeltokenkolommen die Artificial Analysis per 1.000 taken publiceert bij elkaar op te tellen — het leaderboard zelf geeft geen enkel gecombineerd cijfer weer:

• Perplexity Search (medium) — Index 80, 28,8s per taak, ongeveer $0,091 per taak

• Perplexity Search (hoog) — Index 79, 29,7s, ongeveer $ 0,091

• Octen Search (hoogtepunten) — Index 77, 17,2s, ongeveer $ 0,058

• Perplexity Search (laag) — Index 77, 37,4s, ongeveer $0,105

• Parallel zoeken (geavanceerd) — Index 75, 42.9s, ongeveer $0.084

• Brave Search (LLM-context) — Index 75, 24,4 s, ongeveer $ 0,130

• You.com Search (hoogtepunten) — Index 74, 20,7s, ongeveer $0,117

• Exa Search (automatisch) — Index 74, 33,3s, ongeveer $0,127

De componentscores zijn waar de positie interessanter wordt dan de rangschikking. Octen Search scoort 80 op DeepSearchQA, 86 op BrowseComp en 66 op AA-Omniscience. Parallel Search (advanced), de aanbieder die bij de lancering de index aanvoerde, scoort 81, 77 en 67. Dus Octen Search verslaat Parallel Search met negen punten op de multi-hop feitenonderzoeksbenchmark en doet het even goed op breed onderzoek, terwijl het achterblijft bij de Perplexity Search-instellingen op de algemene-kenniswinst — 66 tegen 72 voor Perplexity Search (medium). Simpel gezegd: Octen Search is heel goed in het opsporen van dingen die echt moeilijk te vinden zijn, en biedt minder extra bij vragen die het model al half kent.

Eén kleine complicatie die het vermelden waard is voor iedereen die dit citeert: de eigen aankondiging van het resultaat door Artificial Analysis zette Octen Search op 16,9 seconden per taak, terwijl de live tabel 17,2 laat zien op gegevens van 8 september. Dat is drift door heruitvoering, geen tegenstrijdigheid, maar het is de reden om de tabel te citeren in plaats van het socialmedia-bericht.

Screenshot of the Artificial Analysis Search Index leaderboard, September 8 2026 data, showing Octen Search (highlights) third at Index 77 with 17.2 seconds per task, behind Perplexity Search medium at 80 and high at 79.

De snelheid is de kop; de kostenverdeling is het verhaal

Met 17,2 seconden per taak is Octen Search de snelste vermelding in de index. Perplexity Search (medium) heeft 28,8 seconden nodig, Parallel Search (advanced) 42,9 en Firecrawl Search 63,2. Artificial Analysis meldt ook dat Octen Search het snelst is per individuele query, met gemiddeld 0,21 seconden per zoekopdracht — de snelste gemeten aanroeptijd, ongeacht hoeveel aanroepen een taak vereist.

Het getal waar je echt naar zou moeten staren, is echter de kostenopbouw. Per 1.000 taken komt Artificial Analysis voor Octen Search uit op $9,07 aan zoekuitgaven en $49,15 aan uitgaven voor modeltokens. De tokens kosten ongeveer 5,4 keer zoveel als de zoekopdrachten. Dat is geen eigenaardigheid van Octen Search — het is het structurele punt dat deze index blijft maken. Een zoekprovider factureert je niet alleen voor retrieval; hij bepaalt hoeveel beurten de agent neemt, en elke extra beurt zijn modeltokens tegen het tarief van het model.

Artificial Analysis maakte bij de lancering van Parallel hetzelfde argument: de geavanceerde modus kostte meer per zoekopdracht dan de basisversie ($ 0,048 tegen $ 0,045), maar minder per taak ($ 0,084 tegen $ 0,11), omdat betere resultaten het tokengebruik per taak terugbrachten van ongeveer 339.000 naar 169.000. Goedkopere aanroepen en goedkopere taken zijn verschillende dingen, en slechts één daarvan staat op je factuur.

Afgezet tegen de rest van de ranglijst is de ongeveer $0,058 per taak van Octen Search het laagste van alles wat 75 of hoger scoort. TinyFish Search is goedkoper met ongeveer $0,035, maar scoort 71 en heeft 60,4 seconden nodig om een taak af te ronden.

Wat het resultaat beslecht, en wat niet

Octens eigen cijfers zijn altijd agressief geweest, en ze blijven door de leverancier gerapporteerd. Het bedrijf claimt 62 ms P50- en 68 ms P90-latentie op de SealQA Hard-benchmark, een doorvoer van meer dan een miljoen query's per seconde per account, nieuwe content die binnen vijf minuten wordt geïndexeerd, en een wereldwijde derde plaats op DeepResearch Bench met een algehele score van 55,58. Geen daarvan is onafhankelijk gereproduceerd, en verschillende zijn niet direct vergelijkbaar met iets anders dat is gepubliceerd.

Er bestaan nu twee onafhankelijke tests, en ze wijzen in verschillende richtingen. Artificial Analysis, met het model en de testopstelling ongewijzigd, plaatst Octen Search derde op kwaliteit en eerste op snelheid. Een afzonderlijke onafhankelijke benchmark die in augustus 2026 werd gepubliceerd, mat Octen Search op 359 ms P50 en 941 ms P95 — een veelvoud van de door de leverancier geclaimde latentie — en een nDCG@10 van 0,495, net onder de grens van 0,5 en achter Parallel, Brave, Kagi, Perplexity, Context, Tavily en Exa op die maatstaf. Het team van Octen vertelde die recensent dat zijn eigen benchmark voornamelijk latentie test en niet de kwaliteit van de resultaten, wat een terechte verduidelijking is en ook een erkenning dat de kwaliteit van de resultaten niet iets was dat werd geclaimd.

Beide resultaten kunnen correct zijn, omdat ze verschillende vragen stellen. Die eerdere test beoordeelde of de top tien resultaten relevant leken op basis van metadata-heuristieken op zijn eigen queryverzameling; Artificial Analysis beoordeelt of een agent, met een echt model dat hem aanstuurt, een taak correct voltooit. Wat de positie in de index overtuigend vaststelt, is beperkter dan "beste zoek-API" en nuttiger dan een leveranciersclaim: bij het voltooien van agentische taken, met het model constant gehouden, is Octen Search concurrerend met de sterkste aanbieders en sneller dan allemaal.

De gepubliceerde prijsstelling van Octen, die het bedrijf voor het laatst op 7 september 2026 heeft bijgewerkt:

• Search API-aanroepen — $1 per 1.000 aanroepen, een korting van 80% op de lijstprijs van $5 die sinds 16 juli 2026 automatisch wordt toegepast

• Limieten voor resultaten — de eerste 10 resultaten binnen een zoekopdracht zijn gratis; extra's worden gefactureerd tegen $0,50 per 1.000 resultaten

• Overige endpoints — Image Search en Video Search tegen $5 per 1.000 aanroepen; Extract tegen $1 per 1.000 succesvol verwerkte URL's

• Embeddings — octen-embedding-8b voor $0,07 en octen-embedding-0.6b voor $0,01 per miljoen tokens

• Doorvoerplannen — gratis niveau tot 10 QPS; Base tot 20 QPS kosteloos zodra het account krediet heeft; Builder tot 50 QPS voor $2,099/maand; Pro tot 200 QPS voor $13,999/maand; Max tot 500 QPS voor $33,999/maand

• Registratie — $5 gratis saldo

De doorvoerniveaus zijn het onderdeel dat de kostenberekening stilletjes onderuit haalt. Die $0,058 per taak is puur een berekening per aanroep. Als je workload 200 gelijktijdige query's per seconde nodig heeft, betaal je $13.999 per maand voordat de eerste zoekopdracht draait, en het bedrag per taak is niet langer het interessante getal.

Er zijn ook de hiaten die werden gesignaleerd toen Octen werd gelanceerd: voorwaarden voor zero data retention, compliancecertificeringen en regionale beschikbaarheid worden niet in hetzelfde detail gepubliceerd als door gevestigde aanbieders. Als je uitrolt in een gereguleerde omgeving, weegt dat aanzienlijk zwaarder dan een verschil van drie punten in de index.

A scoreboard card for Octen Search listing its Artificial Analysis Search Index score of 77 in third place, 17.2 seconds per task as the fastest measured, an estimated $0.058 cost per task as the lowest of anything scoring 75 or above, 0.21 seconds average per search query, a $1 per 1,000 calls search list price, and an independent nDCG@10 of 0.495.Screenshot of Octen's official pricing documentation showing the QPS plan tiers from the free 10 QPS tier through the $2,099 Builder, $13,999 Pro and $33,999 Max plans, the $1 per 1,000 calls web search rate discounted 80 percent from the $5 list price, and the $5 per 1,000 calls image and video search rate.

De kloof van drie punten met Perplexity Search (medium) is kleiner dan die lijkt, en dat geldt ook voor de argumenten voor een directe overstap. Perplexity Search wint op AA-Omniscience met 72 tegen 66, en retourneert in één enkele aanroep een gesynthetiseerd antwoord met bronvermelding, wat sommige pipelines willen en deze index — gebouwd rond een tool-calling-agent — niet beloont. De voordelen van Octen Search zijn snelheid en prijs: ongeveer 1,7 keer sneller per taak en ongeveer 36% goedkoper per taak dan Perplexity Search (medium) op basis van deze cijfers.

De praktische samenvatting: als je agent latentiegebonden is, of als je rekening wordt gedomineerd door retrieval bij volume, dan is Octen Search nu een verdedigbare standaard in plaats van een gok. Als je pipeline afhankelijk is van een gesynthetiseerd antwoord, of van de compliancepositie van een incumbent, geeft de index je geen reden om over te stappen.

Wat dit betekent voor je agent-stack

De Search Index meet een laag die de meeste teams als leidingwerk beschouwen, en het maakt een punt dat verder reikt dan zoeken. Op de eigen regel van Octen Search kosten de tokens van het model 5,4 keer zoveel als de retrievalfactuur. Wat je ook voor retrieval kiest, aan de modelkant gaat het geld naartoe, en het is de kant die je het minst opnieuw wilt integreren telkens als je een nieuwe zoekleverancier uitprobeert.

Dat pleit ervoor om het modelpad achter één eindpunt te houden. OrcaRouter bedient 200+ modellen achter één API met 0% opslag — de lijstprijs van de provider wordt doorgegeven, zodat een prijsverlaging van een leverancier u dezelfde dag bereikt — met automatische failover tussen providers en een routing-DSL om meerdere modellen in één aanroep te combineren. Houd de modelroute vast, vervang de retrieval-laag erachter, en als de nieuwe provider zwakker blijkt op uw verkeer dan op DeepSearchQA, hebt u één afhankelijkheid vervangen in plaats van twee. U kunt de catalogus bekijken op OrcaRouter's modelcatalogus.

Om expliciet te zijn over wat we wel en niet aanbieden: Octen Search staat niet in de catalogus van OrcaRouter en we treden er niet als proxy voor op — die aanroep gaat rechtstreeks naar Octen. Wat wij routeren, is het model aan de andere kant daarvan.

Wat nu te kijken

Drie dingen zouden dit verhaal veranderen. Artificial Analysis draait de index opnieuw wanneer aanbieders wijzigingen uitrollen, dus een tweede datapunt op of nabij 77 zou van een debuut een traject maken, terwijl een daling erop zou wijzen dat de eerste positie werd geflatteerd door de querymix. Octen heeft zijn eigen cijfers per benchmark voor DeepSearchQA, BrowseComp en AA-Omniscience niet gepubliceerd, en dat is de goedkoopste manier om geloofwaardigheid te verwerven die het heeft. En het tarief van $1 per 1.000 aanroepen geldt sinds 16 juli; als die promotie terugvalt naar de lijstprijs van $5, wordt de zoekkostenpost van Octen Search ruwweg vijf keer zo hoog en verzwakt het prijsargument aanzienlijk.

Voor iedereen die dit kwartaal een agent bouwt, is de stap klein. De index is een kwaliteit-per-kosten-signaal, geen compatibiliteitstest. Draai je eigen querydistributie tegen Octen Search voordat je een productie-retrievalpad verplaatst, en beschouw een 77 als een reden om te benchmarken in plaats van een reden om te migreren.