
Octen Search zajmuje trzecie miejsce w Artificial Analysis Search Index: najszybszy na zadanie, najtańszy wśród liderów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
Octen Search uzyskał 77 punktów przy swoim pierwszym wystąpieniu w Artificial Analysis Search Index, co zapewniło mu trzecie miejsce w tabeli — i osiągnął to w 17,2 sekundy na zadanie, szybciej niż cokolwiek innego testowanego przez Artificial Analysis. Sam produkt nie jest nowy: Octen Search jest dostępny komercyjnie od 22 kwietnia 2026 r., kiedy to jego spółka macierzysta APITECH AI ogłosiła rundę zalążkową o wartości 10 milionów dolarów, prowadzoną przez Square Peg. Zmieniło się to, że według danych Artificial Analysis z 8 września w końcu jest z nim powiązana liczba pochodząca od strony trzeciej, a liczba ta jest lepsza, niż przewidywałyby najwcześniejsze niezależne testy praktyczne Octen Search.
Co tak naprawdę mierzy Artificial Analysis
Indeks wyszukiwania wystartował 18 sierpnia 2026 r., a jego konstrukcja jest wyjątkowo przejrzysta jak na ranking. Każdy dostawca działa w ramach tego samego środowiska agentowego — Stirrup, własnego agenta open source firmy Artificial Analysis — napędzanego tym samym modelem, GPT-5.6 Luna przy średnim poziomie rozumowania, i ocenianego przez ten sam system oceniający. Agent otrzymuje dwa narzędzia, web_search i web_fetch, maksymalnie 25 tur na zadanie i co najwyżej dziesięć wyników na wyszukiwanie, przy czym znane źródła zanieczyszczeń są odfiltrowywane. Przebieg, który zużyje wszystkie 25 tur, nie wywołując finish, otrzymuje zero punktów, więc pozostawienie agenta bez możliwości zamknięcia zadania jest karane tak samo surowo, jak nieznalezienie niczego.
Jedyną zmienną jest dostawca wyszukiwania. To cecha, której brakuje większości porównań wyszukiwarek, i to ona sprawia, że umiejscowienie Octen Search można odczytać jako stwierdzenie o wyszukiwaniu informacji, a nie o tym, który dostawca dołączył w pakiecie najsilniejszy model odpowiedzi.
Wyniki to średnia równorzędnie ważona z trzech ewaluacji w skali 0–100. DeepSearchQA F1 obejmuje podział na 900 zadań z szerokimi pytaniami badawczymi i ocenia odpowiedź jako listę elementów. Dokładność BrowseComp wykorzystuje trudny podzbiór 200 próbek faktów wieloetapowych, w których odpowiedzią jest pojedyncza weryfikowalna wartość. Dokładność AA-Omniscience wykorzystuje 600 wydzielonych pytań z wiedzy ogólnej i służy głównie do wyizolowania, ile wyszukiwanie wnosi ponad to, co model już wiedział. Ponieważ indeks jest zwykłą średnią, pojedynczy słabszy składnik obniża wynik główny, a profil składników jest często bardziej przydatny niż ranking. Uruchomienie tego samego agenta bez żadnych narzędzi wyszukiwania daje wynik 33, więc niemal wszystko, co zyskuje dostawca, to poprawa względem własnych parametrów modelu.
Artificial Analysis twierdzi, że przetestował 20 produktów wyszukiwania od 10 dostawców; domyślne wykresy pokazują 12 z nich.
Gdzie wylądował Octen Search
Góra tabeli z 8 września, z kosztami na zadanie obliczonymi przez dodanie kolumn wyszukiwania i tokenów modelu, które Artificial Analysis publikuje w przeliczeniu na 1000 zadań — sam ranking nie podaje jednej łącznej liczby:
• Perplexity Search (średni) — Indeks 80, 28,8 s na zadanie, około 0,091 USD na zadanie
• Perplexity Search (wysoki) — Indeks 79, 29,7 s, około 0,091 USD
• Octen Search (wyróżnienia) — Indeks 77, 17,2 s, około 0,058 USD
• Perplexity Search (niski) — Indeks 77, 37,4 s, około 0,105 USD
• Parallel Search (zaawansowane) — Index 75, 42,9 s, około 0,084 USD
• Brave Search (kontekst LLM) — Indeks 75, 24,4 s, około 0,130 USD
• You.com Search (najważniejsze informacje) — Indeks 74, 20,7 s, około 0,117 USD
• Exa Search (auto) — Indeks 74, 33,3 s, około 0,127 USD
Wyniki poszczególnych komponentów sprawiają, że umiejscowienie staje się ciekawsze niż sam ranking. Octen Search uzyskuje 80 punktów w DeepSearchQA, 86 w BrowseComp i 66 w AA-Omniscience. Parallel Search (advanced), dostawca, który prowadził w indeksie w momencie premiery, uzyskuje 81, 77 i 67. Zatem Octen Search pokonuje Parallel Search o dziewięć punktów w benchmarku wieloetapowego wyszukiwania faktów i dorównuje mu w szeroko zakrojonych badaniach, jednocześnie ustępując ustawieniom Perplexity Search we wzroście wiedzy ogólnej — 66 przeciwko 72 dla Perplexity Search (medium). Mówiąc wprost, Octen Search jest bardzo dobry w wyszukiwaniu rzeczy, które są naprawdę trudne do znalezienia, i oferuje mniej dodatkowej wartości w przypadku pytań, na których model już częściowo się zna.
Jedna drobna uwaga warta odnotowania dla każdego, kto to cytuje: własne ogłoszenie wyniku przez Artificial Analysis podawało Octen Search na 16,9 sekundy na zadanie, podczas gdy bieżąca tabela pokazuje 17,2 na danych z 8 września. To dryf związany z ponownym uruchomieniem, a nie sprzeczność, ale właśnie dlatego należy cytować tabelę, a nie post w mediach społecznościowych.

Szybkość to nagłówek; podział kosztów to właściwa historia.
17,2 sekundy na zadanie sprawia, że Octen Search jest najszybszą pozycją w indeksie. Perplexity Search (medium) potrzebuje 28,8 sekundy, Parallel Search (advanced) 42,9, a Firecrawl Search 63,2. Artificial Analysis podaje również, że Octen Search jest najszybszy na pojedyncze zapytanie, osiągając średnio 0,21 sekundy na wyszukiwanie — najkrótszy zmierzony czas wywołania, niezależnie od tego, ile wywołań wymaga zadanie.
Liczba, w którą warto się wpatrywać, to jednak rozbicie kosztów. Na 1000 zadań Artificial Analysis szacuje Octen Search na 9,07 USD wydatków na wyszukiwanie i 49,15 USD wydatków na tokeny modelu. Tokeny kosztują około 5,4 razy więcej niż wyszukiwania. To nie jest osobliwość Octen Search — to strukturalna teza, którą ten indeks stale stawia. Dostawca wyszukiwania nie tylko obciąża cię za wyszukiwanie; decyduje też o tym, ile tur wykonuje agent, a każda dodatkowa tura to tokeny modelu po stawce modelu.
Artificial Analysis przedstawiła ten sam argument przy premierze Parallel: tryb zaawansowany kosztował więcej za wyszukiwanie niż podstawowy (0,048 USD wobec 0,045 USD), ale mniej za zadanie (0,084 USD wobec 0,11 USD), ponieważ lepsze wyniki zmniejszyły zużycie tokenów z około 339 000 do 169 000 na zadanie. Tańsze wywołania i tańsze zadania to różne rzeczy, a tylko jedno z nich widać na fakturze.
W porównaniu z resztą zestawienia koszt Octen Search wynoszący około 0,058 USD za zadanie jest najniższy spośród wszystkich pozycji z wynikiem 75 lub wyższym. TinyFish Search jest tańszy — około 0,035 USD — ale uzyskuje wynik 71 i ukończenie zadania zajmuje mu 60,4 sekundy.
Co ten wynik rozstrzyga, a czego nie
Własne liczby Octena zawsze były agresywne i pozostają raportowane przez dostawcę. Firma twierdzi, że opóźnienie wynosi 62 ms P50 i 68 ms P90 w benchmarku SealQA Hard, przepustowość przekracza milion zapytań na sekundę na konto, nowe treści są indeksowane w ciągu pięciu minut, a globalna pozycja to trzecie miejsce w DeepResearch Bench z ogólnym wynikiem 55,58. Żadna z tych deklaracji nie została niezależnie odtworzona, a kilka z nich nie jest bezpośrednio porównywalnych z niczym innym, co opublikowano.
Istnieją teraz dwa niezależne testy i wskazują różne kierunki. Artificial Analysis, przy ustalonym modelu i zestawie narzędzi, umieszcza Octen Search na trzecim miejscu pod względem jakości i na pierwszym pod względem szybkości. Osobny niezależny benchmark opublikowany w sierpniu 2026 r. zmierzył Octen Search na poziomie 359 ms P50 i 941 ms P95 — kilkukrotnie więcej niż deklarowane przez dostawcę opóźnienie — oraz nDCG@10 wynoszące 0,495, tuż poniżej progu 0,5 i za Parallel, Brave, Kagi, Perplexity, Context, Tavily i Exa w tej metryce. Zespół Octen powiedział temu recenzentowi, że własny benchmark Octen testuje przede wszystkim opóźnienie, a nie jakość wyników, co jest uczciwym wyjaśnieniem, a także przyznaniem, że jakość wyników nie była tym, co deklarowano.
Oba wyniki mogą być poprawne, ponieważ stawiają różne pytania. Ten wcześniejszy test oceniał, czy dziesięć najlepszych wyników wyglądało na istotne na podstawie heurystyk metadanych na własnym zestawie zapytań; Artificial Analysis ocenia, czy agent, napędzany prawdziwym modelem, kończy zadanie poprawnie. To, co umiejscowienie w indeksie ustala w sposób pewny, jest węższe niż „najlepsze API wyszukiwania” i bardziej użyteczne niż twierdzenie dostawcy: w zakresie ukończenia zadań agentowych, przy stałym modelu, Octen Search jest konkurencyjny względem najsilniejszych dostawców i szybszy od nich wszystkich.
Ile kosztuje faktyczne uruchomienie Octen Search
Opublikowany cennik Octen, który firma ostatnio zaktualizowała 7 września 2026 roku:
• Wywołania Search API — 1 USD za 1 000 wywołań, 80% zniżki od ceny katalogowej 5 USD, obowiązującej automatycznie od 16 lipca 2026
• Limity wyników — pierwsze 10 wyników w wyszukiwaniu jest bezpłatne; dodatkowe są rozliczane po $0.50 za 1000 wyników
• Inne punkty końcowe — Image Search i Video Search po 5 USD za 1000 wywołań; Extract po 1 USD za 1000 pomyślnie przetworzonych adresów URL
• Embeddingi — octen-embedding-8b za 0,07 USD i octen-embedding-0.6b za 0,01 USD za milion tokenów
• Plany przepustowości — plan darmowy do 10 QPS; Base do 20 QPS bez opłat, gdy konto posiada środki; Builder do 50 QPS za 2 099 USD/miesiąc; Pro do 200 QPS za 13 999 USD/miesiąc; Max do 500 QPS za 33 999 USD/miesiąc
• Rejestracja — 5 $ w darmowym saldzie
Poziomy przepustowości to część, która po cichu psuje kalkulację kosztów. Te 0,058 USD za zadanie to czyste rozliczenie za wywołanie. Jeśli Twoje obciążenie wymaga 200 równoczesnych zapytań na sekundę, płacisz 13 999 USD miesięcznie, zanim uruchomi się pierwsze wyszukiwanie, a stawka za zadanie przestaje być interesującą liczbą.
Są również luki, które zostały oznaczone przy uruchomieniu Octen: warunki zerowej retencji danych, certyfikaty zgodności i dostępność regionalna nie są publikowane w takim samym szczególe, jak przez uznanych dostawców. Jeśli wdrażasz do regulowanego środowiska, ma to znacznie większe znaczenie niż trzypunktowa luka w indeksie.


Jeśli jest trzeci, dlaczego ktokolwiek miałby nadal wybierać Perplexity Search?
Trzypunktowa różnica w stosunku do Perplexity Search (medium) jest mniejsza, niż się wydaje, podobnie jak argument za całkowitą zmianą. Perplexity Search wygrywa w AA-Omniscience 72 do 66 i zwraca zsyntetyzowaną, opatrzoną cytowaniami odpowiedź w jednym wywołaniu, czego oczekują niektóre pipeline'y, a ten indeks — zbudowany wokół agenta wywołującego narzędzia — tego nie nagradza. Zalety Octen Search to szybkość i cena: około 1,7 razy szybszy na zadanie i około 36% tańszy na zadanie niż Perplexity Search (medium) według tych danych.
Praktyczne podsumowanie: jeśli Twój agent jest ograniczony opóźnieniami albo Twój rachunek jest zdominowany przez wyszukiwanie na dużą skalę, Octen Search jest teraz uzasadnionym domyślnym wyborem, a nie ryzykiem. Jeśli Twój pipeline zależy od zsyntetyzowanej odpowiedzi albo od podejścia do zgodności dotychczasowego dostawcy, indeks nie daje Ci powodu do zmiany.
Co to oznacza dla twojego stosu agentów
The Search Index mierzy warstwę, którą większość zespołów traktuje jako zwykłą infrastrukturę, i stawia tezę, która wykracza poza wyszukiwanie. W wierszu samego Octen Search koszt tokenów modelu jest 5,4 razy wyższy niż rachunek za retrieval. Niezależnie od tego, co wybierzesz do retrieval, to strona modelu pochłania pieniądze i to jest strona, którą najmniej chcesz ponownie integrować za każdym razem, gdy testujesz nowego dostawcę wyszukiwania.
To przemawia za utrzymywaniem ścieżki modelu za jednym punktem końcowym. OrcaRouter udostępnia ponad 200 modeli za jednym API przy 0% marży — cena katalogowa dostawcy jest przekazywana bez zmian, więc obniżka ceny u dostawcy dociera do Ciebie tego samego dnia — z automatycznym przełączaniem awaryjnym między dostawcami i DSL routingu do łączenia kilku modeli w jedno wywołanie. Utrzymaj stałą trasę modelu, wymień warstwę wyszukiwania za nią, a jeśli nowy dostawca okaże się słabszy na Twoim ruchu niż na DeepSearchQA, zmieniasz jedną zależność zamiast dwóch. Katalog można zobaczyć w katalogu modeli OrcaRouter.
Aby było jasne, co obsługujemy, a czego nie: Octen Search nie znajduje się w katalogu OrcaRouter i nie pośredniczymy w nim — to wywołanie trafia bezpośrednio do Octen. To, co routujemy, to model po drugiej stronie.
Co obejrzeć dalej
Trzy rzeczy mogłyby zmienić tę historię. Artificial Analysis ponownie uruchamia indeks, gdy dostawcy wdrażają zmiany, więc drugi punkt danych na poziomie 77 lub w jego pobliżu zmieniłby debiut w trajektorię, natomiast spadek sugerowałby, że pierwsza pozycja została zawyżona przez dobór zapytań. Octen nie opublikował własnych wyników dla poszczególnych benchmarków DeepSearchQA, BrowseComp i AA-Omniscience, co jest najtańszą dostępną dla niego formą wiarygodności. A stawka 1 USD za 1000 wywołań obowiązuje od 16 lipca; jeśli ta promocja wygaśnie i cena wróci do poziomu katalogowego 5 USD, pozycja kosztowa dotycząca wyszukiwania w Octen Search wzrośnie mniej więcej pięciokrotnie, a uzasadnienie ceny znacznie osłabnie.
Dla każdego, kto w tym kwartale buduje agenta, posunięcie jest niewielkie. Indeks jest sygnałem jakości w przeliczeniu na koszt, a nie testem zgodności. Przetestuj własny rozkład zapytań na Octen Search, zanim przeniesiesz produkcyjną ścieżkę wyszukiwania, a wynik 77 traktuj jako powód do benchmarku, a nie jako powód do migracji.
