
Octen Search занимает третье место в индексе Artificial Analysis Search Index: самый быстрый в расчёте на задачу, самый дешёвый среди лидеров
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Octen Search набрал 77 баллов при первом появлении в Artificial Analysis Search Index, что обеспечило ему третье место в рейтинге, — и он добился этого за 17,2 секунды на задачу, быстрее, чем всё остальное, что тестировала Artificial Analysis. Сам продукт не нов: Octen Search коммерчески доступен с 22 апреля 2026 года, когда его материнская компания APITECH AI объявила о посевном раунде на $10 млн под руководством Square Peg. Что изменилось: по данным Artificial Analysis от 8 сентября, у него наконец появился независимый показатель, и этот показатель лучше, чем можно было бы предсказать по самым ранним независимым практическим тестам Octen Search.
Что на самом деле измеряет Artificial Analysis
Search Index заработал 18 августа 2026 года, и его устройство на удивление аккуратное для лидерборда. Каждый провайдер работает внутри одного и того же агентного каркаса — Stirrup, собственного опенсорсного агента Artificial Analysis, — управляется одной и той же моделью GPT-5.6 Luna при среднем уровне рассуждений и оценивается одним и тем же грейдером. Агенту дают два инструмента, web_search и web_fetch, до 25 ходов на задачу и не более десяти результатов на один поиск, а известные источники загрязнения отфильтровываются. Запуск, который израсходует все 25 ходов, так и не вызвав finish, получает ноль, так что невозможность довести задачу до конца наказывается так же строго, как и полное отсутствие найденных результатов.
Единственная переменная — это поисковый провайдер. Именно этого свойства не хватает большинству сравнений поисковых систем, и именно оно позволяет воспринимать позиционирование Octen Search как утверждение о поиске, а не о том, какой вендор включил в комплект самую сильную модель ответов.
Баллы — это равновзвешенное среднее трёх оценок по шкале от 0 до 100. DeepSearchQA F1 выполняется на разбиении из 900 заданий с широкими исследовательскими вопросами и оценивает ответ как список пунктов. Точность BrowseComp использует сложное подмножество из 200 примеров многошаговых фактов, где ответ представляет собой единственное проверяемое значение. Точность AA-Omniscience использует 600 отложенных вопросов на общие знания и существует в основном для того, чтобы изолировать, насколько поиск добавляет сверх того, что модель уже знала. Поскольку индекс — это простое среднее, один слабый компонент тянет главный показатель вниз, и профиль компонентов часто полезнее, чем рейтинг. Запуск того же агента вообще без инструментов поиска даёт 33 балла, так что почти всё, что получает провайдер, — это прирост по сравнению с собственными параметрами модели.
Artificial Analysis сообщает, что протестировала 20 поисковых продуктов от 10 провайдеров; на графиках по умолчанию отображаются 12 из них.
Где оказался Octen Search
Верхняя часть таблицы от 8 сентября, где стоимость за задачу рассчитывается путём сложения столбцов поиска и токенов модели, которые Artificial Analysis публикует в расчёте на 1 000 задач, — сам лидерборд не выводит единую сводную цифру:
• Perplexity Search (средний) — Индекс 80, 28,8 с на задачу, около $0,091 за задачу
• Perplexity Search (высокий) — Индекс 79, 29.7s, около $0.091
• Octen Search (основные моменты) — Индекс 77, 17,2 с, около $0,058
• Perplexity Search (низкий) — Индекс 77, 37,4 с, около $0,105
• Параллельный поиск (расширенный) — индекс 75, 42,9 с, около $0,084
• Brave Search (контекст LLM) — Индекс 75, 24,4 с, около $0,130
• You.com Search (ключевые моменты) — Индекс 74, 20,7 с, около $0,117
• Exa Search (авто) — Индекс 74, 33,3 с, около $0,127
Компонентные оценки — это то место, где расстановка становится интереснее, чем сам рейтинг. Octen Search набирает 80 в DeepSearchQA, 86 в BrowseComp и 66 в AA-Omniscience. Parallel Search (advanced), провайдер, который возглавлял индекс на момент запуска, набирает 81, 77 и 67. Так что Octen Search опережает Parallel Search на девять баллов в бенчмарке многошагового поиска фактов и идёт наравне с ним в широком исследовании, при этом уступая настройкам Perplexity Search по приросту общих знаний — 66 против 72 у Perplexity Search (medium). Проще говоря, Octen Search очень хорош в поиске вещей, которые действительно трудно найти, и даёт меньше дополнительного преимущества на вопросах, которые модель уже знает наполовину.
Одна небольшая деталь, которую стоит отметить всем, кто будет это цитировать: в собственном анонсе результата от Artificial Analysis для Octen Search указано 16,9 секунды на задачу, тогда как актуальная таблица по данным на 8 сентября показывает 17,2. Это дрейф при повторном прогоне, а не противоречие, но именно поэтому стоит ссылаться на таблицу, а не на пост в соцсети.

Скорость — это заголовок; распределение затрат — вот в чём суть.
17,2 секунды на задание делают Octen Search самым быстрым участником индекса. Perplexity Search (medium) требуется 28,8 секунды, Parallel Search (advanced) — 42,9, а Firecrawl Search — 63,2. Artificial Analysis также сообщает, что Octen Search — самый быстрый при обработке отдельного запроса, в среднем 0,21 секунды на поиск — самое быстрое измеренное время вызова, независимо от того, сколько вызовов требуется для выполнения задания.
Цифра, на которую стоит пристально смотреть, — это разбивка затрат. На 1 000 задач Artificial Analysis оценивает Octen Search в $9.07 расходов на поиск и $49.15 расходов на токены модели. Расходы на токены примерно в 5,4 раза превышают расходы на поиск. Это не причуда Octen Search — это структурный тезис, который этот индекс постоянно проводит. Поисковый провайдер выставляет вам счёт не только за извлечение; он определяет, сколько ходов делает агент, и каждый дополнительный ход — это токены модели по тарифу модели.
Artificial Analysis приводила тот же аргумент в случае с Parallel на запуске: продвинутый режим стоил дороже за поиск, чем базовый (0,048 доллара против 0,045), но дешевле за задачу (0,084 доллара против 0,11), потому что лучшие результаты сокращали расход токенов примерно с 339 000 до 169 000 на задачу. Более дешёвые вызовы и более дешёвые задачи — это разные вещи, и только одна из них отражается в вашем счёте.
Если сравнивать с остальной таблицей результатов, примерно $0,058 за задачу у Octen Search — самый низкий показатель среди всех, кто набирает 75 или выше. TinyFish Search дешевле — около $0,035, но он набирает 71 балл и выполняет задачу за 60,4 секунды.
Что результат решает, а что нет
Собственные показатели Octen всегда были агрессивными и по-прежнему заявлены производителем. Компания утверждает, что latency на бенчмарке SealQA Hard составляет 62 мс P50 и 68 мс P90, пропускная способность превышает один миллион запросов в секунду на аккаунт, новый контент индексируется в течение пяти минут, а на DeepResearch Bench она занимает третье место в мире с общей оценкой 55,58. Ни один из этих показателей не был независимо воспроизведён, а несколько из них невозможно напрямую сравнить с чем-либо ещё опубликованным.
Теперь существуют два независимых теста, и они указывают в разные стороны. Artificial Analysis, зафиксировав модель и тестовый стенд, ставит Octen Search на третье место по качеству и на первое по скорости. Отдельный независимый бенчмарк, опубликованный в августе 2026 года, измерил у Octen Search 359 мс P50 и 941 мс P95 — в несколько раз больше заявленной производителем задержки — и nDCG@10 0,495, чуть ниже отметки 0,5 и позади Parallel, Brave, Kagi, Perplexity, Context, Tavily и Exa по этому показателю. Команда Octen сказала этому обозревателю, что их собственный бенчмарк в первую очередь проверяет задержку, а не качество результатов, что является справедливым уточнением и одновременно признанием того, что качество результатов не было тем, что заявлялось.
Оба результата могут быть верными, потому что они отвечают на разные вопросы. Тот более ранний тест оценивал, выглядели ли десять лучших результатов релевантными на основе эвристик по метаданным на собственном наборе запросов; Artificial Analysis оценивает, правильно ли агент, управляемый реальной моделью, выполняет задачу. То, что позиция в индексе уверенно устанавливает, — это уже, чем «лучший поисковый API», и полезнее, чем заявление вендора: при выполнении агентных задач, при неизменной модели, Octen Search конкурентоспособен с сильнейшими провайдерами и быстрее всех их.
Сколько на самом деле стоит запуск Octen Search
Опубликованные цены Octen, которые компания в последний раз обновляла 7 сентября 2026 года:
• Вызовы Search API — $1 за 1 000 вызовов, скидка 80% от прейскурантной цены в $5, которая автоматически применяется с 16 июля 2026 г.
• Лимиты результатов — первые 10 результатов в рамках одного поиска бесплатны; дополнительные тарифицируются по $0.50 за 1 000 результатов
• Другие эндпоинты — Поиск по изображениям и Поиск по видео — $5 за 1 000 вызовов; Извлечение — $1 за 1 000 успешно обработанных URL
• Эмбеддинги — octen-embedding-8b за $0.07 и octen-embedding-0.6b за $0.01 за миллион токенов
• Тарифы по пропускной способности — бесплатный уровень до 10 QPS; Base — до 20 QPS бесплатно, как только на аккаунте появятся средства; Builder — до 50 QPS за $2,099/мес.; Pro — до 200 QPS за $13,999/мес.; Max — до 500 QPS за $33,999/мес.
• Регистрация — $5 в виде бесплатного баланса
Уровни пропускной способности — это та часть, которая незаметно ломает расчёты затрат. Эти $0,058 за задачу — чисто расчёт за один вызов. Если вашей нагрузке требуется 200 одновременных запросов в секунду, вы платите $13 999 в месяц ещё до того, как выполнится первый поиск, и показатель затрат на задачу перестаёт быть интересной цифрой.
Есть также пробелы, которые были отмечены при запуске Octen: условия нулевого хранения данных, сертификаты соответствия и региональная доступность публикуются не с такой подробностью, как у признанных провайдеров. Если вы поставляете продукт в регулируемую среду, это имеет значительно большее значение, чем разрыв в индексе в три пункта.


Если он на третьем месте, почему кто-то всё ещё выбирает Perplexity Search?
Разрыв в три пункта с Perplexity Search (medium) меньше, чем кажется, и довод в пользу прямого перехода тоже не так весом, как кажется. Perplexity Search побеждает по AA-Omniscience со счётом 72 против 66 и возвращает синтезированный ответ со ссылками за один вызов — чего хотят некоторые пайплайны, а этот индекс, построенный вокруг агента, вызывающего инструменты, этого не поощряет. Преимущества Octen Search — скорость и цена: примерно в 1,7 раза быстрее на задачу и примерно на 36% дешевле на задачу, чем Perplexity Search (medium), по этим показателям.
Практический вывод: если ваш агент ограничен задержкой или ваши расходы в основном обусловлены извлечением при больших объёмах, Octen Search теперь — обоснованный выбор по умолчанию, а не рискованная ставка. Если ваш конвейер зависит от синтезированного ответа или от комплаенс-статуса действующего поставщика, этот индекс не даёт вам причин переходить.
Что это значит для вашего стека агентов
Search Index измеряет слой, который большинство команд воспринимают как сантехнику, и делает вывод, выходящий за пределы поиска. В собственной строке Octen Search стоимость токенов модели в 5,4 раза превышает расходы на поиск. Что бы вы ни выбрали для поиска, деньги уходят именно в модель, и именно эту сторону меньше всего хочется заново интегрировать каждый раз, когда вы пробуете нового поискового вендора.
Это аргумент в пользу того, чтобы держать путь к модели за одним эндпоинтом. OrcaRouter предоставляет более 200 моделей через один API с наценкой 0 % — цена провайдера из прайс-листа передаётся без изменений, поэтому снижение цены поставщиком доходит до вас в тот же день — с автоматическим переключением при сбое между провайдерами и DSL маршрутизации для объединения нескольких моделей в один вызов. Оставьте маршрут модели неизменным, замените слой извлечения за ним, и если новый провайдер окажется слабее на вашем трафике, чем на DeepSearchQA, вы изменили одну зависимость вместо двух. Посмотреть каталог можно в каталоге моделей OrcaRouter.
Чтобы внести ясность в то, что мы обслуживаем, а что нет: Octen Search отсутствует в каталоге OrcaRouter, и мы не проксируем его — этот вызов идёт напрямую в Octen. Мы маршрутизируем модель на другом конце этого вызова.
Что посмотреть дальше
Три вещи могли бы изменить эту историю. Artificial Analysis повторно прогоняет индекс по мере того, как провайдеры выпускают изменения, поэтому вторая точка данных на уровне 77 или около него превратила бы дебют в траекторию, а падение указывало бы на то, что первое место было завышено благодаря составу запросов. Octen не опубликовала собственные результаты по отдельным бенчмаркам DeepSearchQA, BrowseComp и AA-Omniscience, а это самый дешёвый способ завоевать доверие, доступный ей. А тариф в $1 за 1000 вызовов действует с 16 июля; если эта акция откатится обратно к прейскурантной цене $5, статья расходов на поиск в Octen Search примерно увеличится в пять раз, и ценовое обоснование заметно ослабнет.
Для всех, кто в этом квартале создаёт агента, переход будет небольшим. Этот индекс — сигнал качества на единицу стоимости, а не тест на совместимость. Прогоните собственное распределение запросов через Octen Search, прежде чем переносить продакшен-путь извлечения, и воспринимайте 77 как повод провести бенчмарк, а не как повод мигрировать.
