
Octen Search tar tredjeplatsen på Artificial Analysis Search Index: snabbast per uppgift, billigast bland ledarna
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiNYOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleNYGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenNYQwen: Qwen3.8 Max (0902)2026-09-0240Intelligens72Kodning
- anthropicNYAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligens69Kodning
Octen Search fick 77 poäng vid sitt första framträdande i Artificial Analysis Search Index, vilket räckte till en tredjeplats på resultattavlan – och den tog sig dit på 17,2 sekunder per uppgift, snabbare än något annat som Artificial Analysis testade. Själva produkten är inte ny: Octen Search har varit kommersiellt tillgänglig sedan den 22 april 2026, då dess moderbolag APITECH AI tillkännagav en såddrunda på 10 miljoner dollar ledd av Square Peg. Det som har förändrats är att det i och med data från Artificial Analysis den 8 september äntligen finns en tredjepartssiffra kopplad till den, och siffran är bättre än vad den tidigaste oberoende praktiska testningen av Octen Search skulle ha förutspått.
Vad Artificial Analysis faktiskt mäter
Sökindexet lanserades den 18 augusti 2026, och dess design är ovanligt ren för att vara en resultattabell. Varje leverantör körs i samma agentharness — Stirrup, Artificial Analysiss egen agent med öppen källkod — drivs av samma modell, GPT-5.6 Luna vid medelhög resonemangsnivå, och poängsätts av samma bedömare. Agenten får två verktyg, web_search och web_fetch, upp till 25 turer per uppgift och högst tio resultat per sökning, med kända kontamineringskällor bortfiltrerade. En körning som bränner alla 25 turer utan att anropa finish får noll poäng, så att lämna agenten oförmögen att slutföra en uppgift straffas lika hårt som att inte hämta någonting alls.
Den enda variabeln är sökleverantören. Det är den egenskap som de flesta sökjämförelser saknar, och det är vad som gör placeringen av Octen Search läsbar som ett uttalande om sökning snarare än om vilken leverantör som paketerade den starkaste svarsmodellen.
Poäng är det likaviktade medelvärdet av tre utvärderingar på en 0–100-skala. DeepSearchQA F1 körs över en delmängd på 900 uppgifter med breda forskningsfrågor och betygsätter svaret som en lista av punkter. BrowseComp-accuracy använder en svår delmängd på 200 sampel av flerhoppsfakta där svaret är ett enda verifierbart värde. AA-Omniscience-accuracy använder 600 undanhållna allmänkunskapsfrågor och finns främst för att isolera hur mycket sökning tillför utöver vad modellen redan visste. Eftersom indexet är ett rakt medelvärde drar en enda svag komponent ner huvudresultatet, och komponentprofilen är ofta mer användbar än rankningen. Att köra samma agent helt utan sökverktyg ger 33 poäng, så nästan allt som en leverantör tjänar in är lyft utöver modellens egna parametrar.
Artificial Analysis säger att de testade 20 sökprodukter från 10 leverantörer; standarddiagrammen visar 12 av dem.
Där Octen Search landade
Toppen av tabellen för den 8 september, med kostnader per uppgift beräknade genom att lägga samman kolumnerna för sökning och modelltoken som Artificial Analysis publicerar per 1 000 uppgifter – topplistan själv skriver inte ut en enda sammanvägd siffra:
• Perplexity Search (medium) — Index 80, 28,8 s per uppgift, cirka 0,091 $ per uppgift
• Perplexity Search (hög) — Index 79, 29,7 s, cirka 0,091 $
• Octen Search (höjdpunkter) — Index 77, 17,2 s, cirka 0,058 $
• Perplexity Search (låg) — Index 77, 37,4 s, cirka $0,105
• Parallel Search (avancerat) — Index 75, 42,9 s, cirka 0,084 $
• Brave Search (LLM-kontext) — Index 75, 24,4 s, cirka $0,130
• You.com Search (höjdpunkter) — Index 74, 20,7 s, cirka $0,117
• Exa Search (auto) — Index 74, 33,3 s, cirka 0,127 $
Delpoängen är där placeringen blir mer intressant än rankningen. Octen Search får 80 på DeepSearchQA, 86 på BrowseComp och 66 på AA-Omniscience. Parallel Search (advanced), leverantören som ledde indexet vid lanseringen, får 81, 77 och 67. Så Octen Search slår Parallel Search med nio poäng i benchmarken för faktasökning i flera steg och matchar den inom bred research, medan den ligger efter Perplexity Search-inställningarna på den allmänna kunskapslyften — 66 mot 72 för Perplexity Search (medium). I klartext: Octen Search är mycket bra på att spåra upp saker som är genuint svåra att hitta, och erbjuder mindre extra på frågor som modellen redan halvt känner till.
En liten hake värd att notera för alla som citerar detta: Artificial Analysis eget tillkännagivande av resultatet angav Octen Search till 16,9 sekunder per uppgift, medan den aktuella tabellen visar 17,2 på data från 8 september. Det är drift mellan omkörningar, inte en motsägelse, men det är anledningen till att citera tabellen i stället för inlägget i sociala medier.

Hastigheten är rubriken; kostnadsfördelningen är historien
17,2 sekunder per uppgift gör Octen Search till det snabbaste alternativet i indexet. Perplexity Search (medium) behöver 28,8 sekunder, Parallel Search (advanced) 42,9 och Firecrawl Search 63,2. Artificial Analysis rapporterar också att Octen Search är snabbast per enskild fråga, med i genomsnitt 0,21 sekunder per sökning – den snabbaste uppmätta anropstiden, oberoende av hur många anrop en uppgift kräver.
Siffran som är värd att stirra på är dock kostnadsuppdelningen. Per 1 000 uppgifter anger Artificial Analysis att Octen Search står för 9,07 dollar i sökutgifter och 49,15 dollar i utgifter för modelltokens. Tokensen kostar ungefär 5,4 gånger så mycket som sökningarna. Det är inte en egenhet hos Octen Search – det är den strukturella poängen som detta index gång på gång lyfter fram. En sökleverantör fakturerar dig inte bara för hämtningen; den bestämmer hur många turer agenten tar, och varje extra tur är modelltokens till modellens pris.
Artificial Analysis framförde samma argument med Parallel vid lanseringen: avancerat läge kostade mer per sökning än grundläget (0,048 USD mot 0,045 USD) men mindre per uppgift (0,084 USD mot 0,11 USD), eftersom bättre resultat minskade tokenanvändningen från ungefär 339 000 till 169 000 per uppgift. Billigare anrop och billigare uppgifter är olika saker, och bara en av dem syns på din faktura.
Jämfört med resten av resultattavlan är Octen Searchs ungefär 0,058 USD per uppgift det lägsta av allt som får 75 eller högre. TinyFish Search är billigare på omkring 0,035 USD, men får 71 poäng och tar 60,4 sekunder att slutföra en uppgift.
Vad resultatet avgör, och vad det inte avgör
Octens egna siffror har alltid varit aggressiva, och de förblir leverantörsrapporterade. Företaget hävdar 62 ms P50 och 68 ms P90 i latens på SealQA Hard-benchmark, en genomströmning på över en miljon frågor per sekund per konto, att nytt innehåll indexeras inom fem minuter samt en global tredjeplats på DeepResearch Bench med ett totalresultat på 55,58. Inget av detta har oberoende reproducerats, och flera är inte direkt jämförbara med något annat som har publicerats.
Två oberoende tester finns nu, och de pekar i olika riktningar. Artificial Analysis, med modellen och testramverket oförändrade, placerar Octen Search på tredje plats i kvalitet och först i hastighet. En separat oberoende benchmark publicerad i augusti 2026 uppmätte Octen Search till 359 ms P50 och 941 ms P95 – flera gånger den latens leverantören hävdade – och ett nDCG@10 på 0,495, precis under 0,5-gränsen och bakom Parallel, Brave, Kagi, Perplexity, Context, Tavily och Exa i den metriken. Octens team berättade för den recensenten att deras egen benchmark i första hand testar latens snarare än resultatkvalitet, vilket är ett rimligt förtydligande och också ett medgivande att resultatkvalitet inte var det som hävdades.
Båda resultaten kan vara korrekta, eftersom de ställer olika frågor. Det tidigare testet betygsatte huruvida de tio främsta resultaten verkade relevanta utifrån metadataheuristik på sin egen frågeuppsättning; Artificial Analysis betygsätter huruvida en agent, med en riktig modell som driver den, slutför en uppgift korrekt. Vad indexplaceringen med säkerhet fastställer är snävare än ”bästa sök-API” och mer användbart än ett leverantörspåstående: vid slutförande av agentiska uppgifter, med modellen hållen konstant, är Octen Search konkurrenskraftig mot de starkaste leverantörerna och snabbare än alla dem.
Vad det kostar att faktiskt driva Octen Search
Octens publicerade prissättning, som företaget senast uppdaterade den 7 september 2026:
• Search API-anrop — $1 per 1 000 anrop, en rabatt på 80 % på listpriset på $5 som automatiskt har tillämpats sedan den 16 juli 2026
• Resultatgränser — de första 10 resultaten i en sökning är gratis; extra resultat debiteras med $0,50 per 1 000 resultat
• Övriga slutpunkter — Image Search och Video Search för 5 USD per 1 000 anrop; Extract för 1 USD per 1 000 framgångsrikt bearbetade URL:er
• Embeddings — octen-embedding-8b till $0.07 och octen-embedding-0.6b till $0.01 per miljon tokens
• Genomströmningsplaner — kostnadsfri nivå upp till 10 QPS; Base upp till 20 QPS utan kostnad när kontot har kredit; Builder upp till 50 QPS för 2 099 USD/månad; Pro upp till 200 QPS för 13 999 USD/månad; Max upp till 500 QPS för 33 999 USD/månad
• Registrering — $5 i gratis saldo
Genomströmningsnivåerna är den del som i tysthet kullkastar kostnadsmatematiken. Den där summan på 0,058 dollar per uppgift är en ren beräkning per anrop. Om din arbetsbelastning behöver 200 samtidiga frågor per sekund betalar du 13 999 dollar i månaden innan den första sökningen ens körs, och siffran per uppgift är inte längre den intressanta siffran.
Det finns också de luckor som flaggades när Octen lanserades: villkor för noll datalagring, efterlevnadscertifieringar och regional tillgänglighet publiceras inte med samma detaljrikedom som av etablerade leverantörer. Om du levererar in i en reglerad miljö spelar det betydligt större roll än en indexskillnad på tre punkter.


Om det är den tredje, varför skulle någon fortfarande välja Perplexity Search?
Trepunktsgapet till Perplexity Search (medium) är mindre än det ser ut, och detsamma gäller argumentet för att byta rakt av. Perplexity Search vinner på AA-Omniscience med 72 mot 66, och den returnerar ett syntetiserat, citerat svar i ett enda anrop, vilket vissa pipelines vill ha och detta index – byggt kring en verktygsanropande agent – inte belönar. Fördelarna med Octen Search är hastighet och pris: cirka 1,7 gånger snabbare per uppgift och ungefär 36 % billigare per uppgift än Perplexity Search (medium) enligt dessa siffror.
Den praktiska sammanfattningen: om din agent är latensbegränsad, eller om din kostnad domineras av hämtning vid stora volymer, är Octen Search nu ett försvarbart standardval snarare än en chansning. Om din pipeline är beroende av ett syntetiserat svar, eller av en etablerad leverantörs regelefterlevnadsprofil, ger indexet dig ingen anledning att byta.
Vad detta innebär för din agentstack
The Search Index mäter ett lager som de flesta team behandlar som infrastruktur, och det framför en poäng som sträcker sig bortom sök. På Octen Searchs egen rad kostar modellens tokens 5,4 gånger så mycket som retrieval-notan. Vad du än väljer för retrieval är det modellsidan som pengarna går till, och det är den sidan du minst av allt vill återintegrera varje gång du utvärderar en ny sökleverantör.
Det är argumentet för att hålla modellvägen bakom en enda slutpunkt. OrcaRouter betjänar 200+ modeller bakom ett enda API med 0 % påslag – leverantörens listpris förs vidare, så en leverantörs prissänkning når dig samma dag – med automatisk failover mellan leverantörer och en routing-DSL för att kombinera flera modeller till ett anrop. Håll modellvägen fast, byt ut hämtningslagret bakom den, och om den nya leverantören visar sig vara svagare på din trafik än den är på DeepSearchQA, har du ändrat ett beroende i stället för två. Du kan se katalogen på OrcaRouters modellkatalog.
För att vara tydliga med vad vi tillhandahåller och inte tillhandahåller: Octen Search finns inte i OrcaRouters katalog och vi proxar det inte – det anropet går direkt till Octen. Det vi dirigerar är modellen i andra änden av det.
Vad du ska titta på härnäst
Tre saker skulle förändra den här berättelsen. Artificial Analysis kör om indexet i takt med att leverantörer inför ändringar, så en andra datapunkt på eller nära 77 skulle göra en debut till en bana, medan en nedgång skulle tyda på att den första placeringen smickrades av frågemixen. Octen har inte publicerat sina egna siffror per benchmark för DeepSearchQA, BrowseComp och AA-Omniscience, vilket är den billigaste trovärdighet som står till dess förfogande. Och priset på 1 dollar per 1 000 anrop har gällt sedan den 16 juli; om den kampanjen upphör och återgår till listpriset på 5 dollar, blir sökposten i kostnaden för Octen Search ungefär fem gånger så hög och prisargumentet försvagas betydligt.
För alla som bygger en agent det här kvartalet är åtgärden liten. Indexet är en signal om kvalitet per kostnad, inte ett kompatibilitetstest. Kör din egen frågedistribution mot Octen Search innan du flyttar en hämtningsväg i produktion, och behandla en 77 som ett skäl att benchmarka snarare än ett skäl att migrera.
