Eine generierte Titelkarte mit der Aufschrift „Octen Search landet auf Platz drei im AI Search Index“, dazu Statistik-Karten, die einen Artificial Analysis Search Index Score von 77 auf dem dritten Platz, 17,2 Sekunden pro Aufgabe als schnellsten gemessenen Wert und etwa 0,058 $ Kosten pro Aufgabe zeigen.
Guides & Insights

Octen Search belegt den dritten Platz im Artificial Analysis Search Index: Am schnellsten pro Aufgabe, am günstigsten unter den Spitzenreitern

Autor

Gideon Frost

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Octen Search erzielte bei seinem ersten Auftritt im Artificial Analysis Search Index 77 Punkte, was für den dritten Platz in der Rangliste reichte – und das mit 17,2 Sekunden pro Aufgabe, schneller als alles andere, was Artificial Analysis getestet hat. Das Produkt selbst ist nicht neu: Octen Search ist seit dem 22. April 2026 kommerziell erhältlich, als sein Mutterunternehmen APITECH AI eine Seed-Finanzierungsrunde über 10 Millionen Dollar unter der Leitung von Square Peg bekannt gab. Was sich geändert hat: Mit den Daten von Artificial Analysis vom 8. September gibt es endlich eine Zahl von dritter Seite, und diese Zahl ist besser, als die frühesten unabhängigen Praxistests von Octen Search hätten erwarten lassen.

Was Artificial Analysis tatsächlich misst

Der Search Index ging am 18. August 2026 live, und sein Design ist für ein Leaderboard ungewöhnlich klar. Jeder Anbieter läuft in derselben Agent-Harness — Stirrup, dem eigenen Open-Source-Agenten von Artificial Analysis —, angetrieben vom selben Modell, GPT-5.6 Luna mit mittlerem Reasoning, und bewertet von derselben Bewertungsinstanz. Der Agent erhält zwei Tools, web_search und web_fetch, bis zu 25 Züge pro Aufgabe und höchstens zehn Ergebnisse pro Suche, wobei bekannte Kontaminationsquellen herausgefiltert werden. Ein Durchlauf, der alle 25 Züge verbraucht, ohne finish aufzurufen, erhält null Punkte; ein Agent, der eine Aufgabe nicht abschließen kann, wird also genauso hart bestraft wie einer, der nichts abruft.

Die einzige Variable ist der Suchanbieter. Das ist die Eigenschaft, die den meisten Suchvergleichen fehlt, und sie ist es, die die Platzierung von Octen Search als Aussage über Retrieval und nicht als Aussage darüber lesbar macht, welcher Hersteller das stärkste Antwortmodell mitgeliefert hat.

Die Scores sind das gleich gewichtete Mittel aus drei Bewertungen auf einer Skala von 0–100. DeepSearchQA F1 läuft über einen 900-Aufgaben-Split breiter Forschungsfragen und bewertet die Antwort als Liste von Elementen. Die BrowseComp-Genauigkeit verwendet eine harte 200-Stichproben-Teilmenge von Multi-Hop-Fakten, bei denen die Antwort ein einzelner verifizierbarer Wert ist. Die AA-Omniscience-Genauigkeit verwendet 600 zurückgehaltene Allgemeinwissensfragen und dient hauptsächlich dazu, zu isolieren, wie viel die Suche über das hinaus beiträgt, was das Modell bereits wusste. Da der Index ein reines Mittel ist, zieht eine einzelne schwache Komponente die Schlagzeilenzahl nach unten, und das Komponentenprofil ist oft nützlicher als das Ranking. Derselbe Agent ohne jegliche Suchwerkzeuge erzielt 33, sodass fast alles, was ein Anbieter erzielt, eine Verbesserung gegenüber den eigenen Parametern des Modells ist.

Artificial Analysis gibt an, 20 Suchprodukte von 10 Anbietern getestet zu haben; die Standarddiagramme zeigen 12 davon.

Wo Octen Search gelandet ist

Der obere Teil der Tabelle vom 8. September, mit Kosten pro Aufgabe, die durch Addition der Spalten für Suche und Modell-Token berechnet wurden, die Artificial Analysis pro 1.000 Aufgaben veröffentlicht – die Rangliste selbst zeigt keine einzelne kombinierte Zahl an:

• Perplexity Search (medium) — Index 80, 28,8 s pro Aufgabe, etwa 0,091 $ pro Aufgabe

• Perplexity Search (hoch) — Index 79, 29,7 s, etwa 0,091 $

• Octen Search (Highlights) — Index 77, 17,2 s, etwa 0,058 $

• Perplexity Search (niedrig) — Index 77, 37,4 s, ca. $0,105

• Parallel Search (erweitert) — Index 75, 42,9 s, etwa 0,084 $

• Brave Search (LLM-Kontext) — Index 75, 24,4 s, etwa 0,130 $

• You.com Search (Hervorhebungen) — Index 74, 20,7 s, etwa 0,117 $

• Exa Search (auto) — Index 74, 33,3 s, etwa 0,127 $

Die Komponentenwerte sind der Punkt, an dem die Platzierung interessanter wird als das Ranking. Octen Search erzielt 80 bei DeepSearchQA, 86 bei BrowseComp und 66 bei AA-Omniscience. Parallel Search (advanced), der Anbieter, der den Index zum Start anführte, erzielt 81, 77 und 67. Octen Search schlägt Parallel Search also um neun Punkte beim Multi-Hop-Faktenfindungs-Benchmark und zieht bei der breiten Recherche gleich, während es bei der Allgemeinwissens-Steigerung hinter den Perplexity-Search-Einstellungen zurückbleibt — 66 gegenüber 72 für Perplexity Search (medium). Einfach ausgedrückt: Octen Search ist sehr gut darin, Dinge aufzuspüren, die wirklich schwer zu finden sind, und bietet weniger Zusatznutzen bei Fragen, die das Modell bereits halbwegs kennt.

Eine kleine Feinheit, die erwähnenswert ist für alle, die dies zitieren: Artificial Analysis’ eigene Ankündigung des Ergebnisses gab für Octen Search 16,9 Sekunden pro Aufgabe an, während die Live-Tabelle 17,2 bei den Daten vom 8. September zeigt. Das ist Drift durch erneute Ausführung, kein Widerspruch, aber es ist der Grund, eher die Tabelle als den Social-Media-Beitrag zu zitieren.

Screenshot of the Artificial Analysis Search Index leaderboard, September 8 2026 data, showing Octen Search (highlights) third at Index 77 with 17.2 seconds per task, behind Perplexity Search medium at 80 and high at 79.

Die Geschwindigkeit ist die Schlagzeile; die Kostenaufteilung ist die eigentliche Geschichte.

17,2 Sekunden pro Aufgabe machen Octen Search zum schnellsten Eintrag im Index. Perplexity Search (medium) braucht 28,8 Sekunden, Parallel Search (advanced) 42,9 und Firecrawl Search 63,2. Artificial Analysis meldet Octen Search außerdem als schnellste bei einzelnen Abfragen, mit durchschnittlich 0,21 Sekunden pro Suche — die schnellste gemessene Aufrufzeit, unabhängig davon, wie viele Aufrufe eine Aufgabe erfordert.

Die Zahl, die man sich jedoch genauer ansehen sollte, ist die Kostenaufschlüsselung. Pro 1.000 Aufgaben veranschlagt Artificial Analysis für Octen Search 9,07 US-Dollar an Suchausgaben und 49,15 US-Dollar an Ausgaben für Modell-Tokens. Die Tokens kosten rund 5,4-mal so viel wie die Suchvorgänge. Das ist keine Eigenheit von Octen Search – es ist der strukturelle Punkt, den dieser Index immer wieder deutlich macht. Ein Suchanbieter stellt Ihnen nicht nur den Abruf in Rechnung; er bestimmt, wie viele Durchgänge der Agent absolviert, und jeder zusätzliche Durchgang sind Modell-Tokens zum Tarif des Modells.

Artificial Analysis führte bei der Markteinführung von Parallel dasselbe Argument an: Der erweiterte Modus kostete mehr pro Suche als der Basis-Modus (0,048 $ gegenüber 0,045 $), aber weniger pro Aufgabe (0,084 $ gegenüber 0,11 $), weil bessere Ergebnisse den Token-Verbrauch von ungefähr 339.000 auf 169.000 pro Aufgabe senkten. Günstigere Aufrufe und günstigere Aufgaben sind zwei verschiedene Dinge, und nur eines davon taucht auf Ihrer Rechnung auf.

Im Vergleich zum restlichen Board sind die rund 0,058 $ pro Aufgabe von Octen Search der niedrigste Wert von allem, was 75 oder mehr Punkte erreicht. TinyFish Search ist mit etwa 0,035 $ günstiger, erzielt aber 71 Punkte und benötigt 60,4 Sekunden, um eine Aufgabe abzuschließen.

Was das Ergebnis klärt, und was nicht

Octens eigene Zahlen waren schon immer aggressiv, und sie bleiben Anbieterangaben. Das Unternehmen behauptet 62 ms P50- und 68 ms P90-Latenz beim SealQA Hard-Benchmark, einen Durchsatz von über einer Million Abfragen pro Sekunde pro Konto, neue Inhalte, die innerhalb von fünf Minuten indexiert werden, und einen globalen dritten Platz beim DeepResearch Bench mit einem Gesamtwert von 55,58. Nichts davon wurde unabhängig reproduziert, und mehrere sind nicht direkt mit anderen veröffentlichten Angaben vergleichbar.

Zwei unabhängige Tests existieren inzwischen, und sie weisen in unterschiedliche Richtungen. Artificial Analysis, mit festgehaltenem Modell und Test-Harness, platziert Octen Search bei der Qualität auf Platz drei und bei der Geschwindigkeit auf Platz eins. Ein separater unabhängiger Benchmark, veröffentlicht im August 2026, maß für Octen Search 359 ms P50 und 941 ms P95 – ein Mehrfaches der vom Anbieter angegebenen Latenz – sowie einen nDCG@10 von 0,495, knapp unter der 0,5-Marke und bei dieser Kennzahl hinter Parallel, Brave, Kagi, Perplexity, Context, Tavily und Exa. Octens Team sagte jenem Rezensenten, sein eigener Benchmark teste in erster Linie die Latenz und nicht die Ergebnisqualität, was eine faire Klarstellung und zugleich ein Eingeständnis ist, dass die Ergebnisqualität nicht das war, was beansprucht wurde.

Beide Ergebnisse können korrekt sein, weil sie unterschiedliche Fragen stellen. Der frühere Test bewertete, ob die obersten zehn Ergebnisse anhand von Metadaten-Heuristiken auf seinem eigenen Query-Set relevant erschienen; Artificial Analysis bewertet, ob ein Agent, angetrieben von einem echten Modell, eine Aufgabe korrekt abschließt. Was die Indexplatzierung eindeutig belegt, ist enger gefasst als „beste Such-API“ und nützlicher als eine Anbieterbehauptung: Bei agentischer Aufgabenerfüllung, mit konstant gehaltenem Modell, ist Octen Search konkurrenzfähig mit den stärksten Anbietern und schneller als alle von ihnen.

Octens veröffentlichte Preisgestaltung, die das Unternehmen zuletzt am 7. September 2026 aktualisiert hat:

• Search-API-Aufrufe — 1 $ pro 1.000 Aufrufe, ein Rabatt von 80 % auf den Listenpreis von 5 $, der seit dem 16. Juli 2026 automatisch gilt

• Ergebnislimits — die ersten 10 Ergebnisse innerhalb einer Suche sind kostenlos; zusätzliche werden mit 0,50 $ pro 1.000 Ergebnisse berechnet

• Weitere Endpunkte — Bildsuche und Videosuche zu 5 $ pro 1.000 Aufrufe; Extract zu 1 $ pro 1.000 erfolgreich verarbeitete URLs

• Embeddings — octen-embedding-8b für 0,07 $ und octen-embedding-0.6b für 0,01 $ pro Million Token

• Durchsatz-Tarife — kostenloser Tarif bis zu 10 QPS; Base bis zu 20 QPS kostenlos, sobald das Konto über Guthaben verfügt; Builder bis zu 50 QPS für 2.099 $/Monat; Pro bis zu 200 QPS für 13.999 $/Monat; Max bis zu 500 QPS für 33.999 $/Monat

• Registrierung — $5 Gratisguthaben

Die Durchsatzstufen sind der Teil, der die Kostenrechnung still und leise aushebelt. Diese $0,058 pro Aufgabe sind eine reine Berechnung pro Aufruf. Wenn Ihre Arbeitslast 200 gleichzeitige Abfragen pro Sekunde benötigt, zahlen Sie $13.999 im Monat, bevor die erste Suche überhaupt läuft, und die Zahl pro Aufgabe ist nicht mehr die interessante Größe.

Es gibt außerdem die Lücken, die beim Start von Octen gemeldet wurden: Zero-Data-Retention-Bedingungen, Compliance-Zertifizierungen und regionale Verfügbarkeit werden nicht in derselben Detailtiefe veröffentlicht wie von etablierten Anbietern. Wenn Sie in eine regulierte Umgebung ausliefern, zählt das deutlich mehr als eine Drei-Punkte-Lücke im Index.

A scoreboard card for Octen Search listing its Artificial Analysis Search Index score of 77 in third place, 17.2 seconds per task as the fastest measured, an estimated $0.058 cost per task as the lowest of anything scoring 75 or above, 0.21 seconds average per search query, a $1 per 1,000 calls search list price, and an independent nDCG@10 of 0.495.Screenshot of Octen's official pricing documentation showing the QPS plan tiers from the free 10 QPS tier through the $2,099 Builder, $13,999 Pro and $33,999 Max plans, the $1 per 1,000 calls web search rate discounted 80 percent from the $5 list price, and the $5 per 1,000 calls image and video search rate.

Der Drei-Punkte-Abstand zu Perplexity Search (medium) ist kleiner, als er aussieht, und das Argument für einen kompletten Wechsel ebenso. Perplexity Search gewinnt bei AA-Omniscience mit 72 zu 66 und liefert in einem einzigen Aufruf eine synthetisierte, mit Quellen belegte Antwort, die manche Pipelines wollen und die dieser Index – auf einen Tool-Calling-Agenten ausgerichtet – nicht belohnt. Die Vorteile von Octen Search sind Geschwindigkeit und Preis: etwa 1,7-mal schneller pro Aufgabe und rund 36 % günstiger pro Aufgabe als Perplexity Search (medium) nach diesen Zahlen.

Die praktische Zusammenfassung: Wenn Ihr Agent latenzgebunden ist oder Ihre Rechnung bei hohem Volumen von Retrieval dominiert wird, ist Octen Search inzwischen eine vertretbare Standardwahl statt eines Glücksspiels. Wenn Ihre Pipeline von einer synthetisierten Antwort oder von der Compliance-Position eines etablierten Anbieters abhängt, gibt Ihnen der Index keinen Grund zu wechseln.

Was das für Ihren Agent-Stack bedeutet

Der Search Index misst eine Ebene, die die meisten Teams als reine Infrastruktur behandeln, und er verdeutlicht etwas, das über die Suche hinausreicht. In der eigenen Zeile von Octen Search kosten die Modell-Tokens das 5,4-Fache der Retrieval-Rechnung. Was auch immer Sie für das Retrieval wählen: Die Modellseite ist der Bereich, in den das Geld fließt, und sie ist die Seite, die Sie am wenigsten neu integrieren wollen, wenn Sie einen neuen Suchanbieter testen.

Das spricht dafür, den Modellpfad hinter einem einzigen Endpunkt zu belassen. OrcaRouter stellt über 200 Modelle hinter einer einzigen API mit 0 % Aufschlag bereit – der Listenpreis des Anbieters wird durchgereicht, sodass eine Preissenkung eines Anbieters Sie noch am selben Tag erreicht – mit automatischem Failover über Anbieter hinweg und einer Routing-DSL, mit der sich mehrere Modelle zu einem Aufruf zusammenstellen lassen. Halten Sie die Modellroute fest, tauschen Sie die dahinterliegende Retrieval-Schicht aus, und wenn sich der neue Anbieter bei Ihrem Traffic als schwächer erweist als bei DeepSearchQA, haben Sie eine Abhängigkeit statt zwei geändert. Den Katalog sehen Sie unter OrcaRouters Modellkatalog.

Um explizit zu sagen, was wir anbieten und was nicht: Octen Search ist nicht in OrcaRouters Katalog und wir proxyen es nicht – dieser Aufruf geht direkt an Octen. Was wir weiterleiten, ist das Modell am anderen Ende davon.

Was als Nächstes ansehen

Drei Dinge würden diese Geschichte verändern. Artificial Analysis führt den Index erneut aus, wenn Anbieter Änderungen ausliefern, sodass ein zweiter Datenpunkt bei oder nahe 77 aus einem Debüt eine Entwicklung machen würde, während ein Rückgang nahelegen würde, dass die erste Platzierung durch die Mischung der Abfragen geschmeichelt war. Octen hat seine eigenen DeepSearchQA-, BrowseComp- und AA-Omniscience-Zahlen pro Benchmark nicht veröffentlicht, was die günstigste Form von Glaubwürdigkeit ist, die ihm zur Verfügung steht. Und der Tarif von 1 US-Dollar pro 1.000 Aufrufe gilt seit dem 16. Juli; wenn diese Aktion ausläuft und zum Listenpreis von 5 US-Dollar zurückkehrt, verfünffacht sich die Kostenzeile für die Suche bei Octen Search in etwa, und das Preisargument wird erheblich schwächer.

Für alle, die in diesem Quartal einen Agenten bauen, ist der Schritt klein. Der Index ist ein Signal für Qualität pro Kosten, kein Kompatibilitätstest. Lassen Sie Ihre eigene Query-Verteilung gegen Octen Search laufen, bevor Sie einen Produktions-Retrieval-Pfad verschieben, und behandeln Sie eine 77 als Grund zum Benchmarken statt als Grund zur Migration.