Сгенерированная титульная карточка с надписью «AREX-2 vs Qwen3.8-Max — субстрат и то, что работает на нём», с двумя панелями. В левой панели с заголовком Qwen3.8-Max перечислено: работает с 3 августа 2026 года; контекст 1M токенов, мультимодальность; $2 за вход / $6 за выход за 1M токенов; доступна для вызова уже сегодня. В правой панели с заголовком AREX-2 перечислено: репозиторий создан 29 сентября 2026 года; нет весов, нет карточки модели; нигде нет прайс-листа; нигде недоступна для вызова. В футере написано: «Первое поколение AREX было постобучено на бэкбоне Qwen.» Логотип OrcaRouter вкомпонован в правый нижний угол.
Guides & Insights

AREX-2 против Qwen 3.8: один — субстрат, на котором, вероятно, построен другой

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Противостояние между AREX-2 и Qwen3.8-Maxвыглядит как прямой бой между флагманскими системами двух китайских лабораторий, и это не так — не потому, что AREX-2 не проверен, хотя это так, а потому, что они находятся на разных уровнях одного и того же стека. Qwen3.8-Max работает с 3 августа 2026 года, по цене $2 за миллион входных токенов и $6 за миллион выходных при контекстном окне в 1 млн токенов; её открытые по весам аналоги, Qwen3.8-27B и Qwen3.8-Flash, вышли 13 и 26 августа с опубликованными бенчмарками и опубликованными ценами. AREX-2 — это репозиторий, созданный BAAI на Hugging Face 29 сентября 2026 года в 17:56 UTC, содержащий .gitattributes и ничего больше. И причина, по которой они не соперники, кроется в основополагающем факте, который ни один из вендоров громко не рекламирует: каждая модель AREX, выпущенная BAAI к настоящему времени, построена на основе Qwe​n.

Это не спекуляция об AREX-2. Это задокументировано для существующего поколения. AREX-Base — это смесь экспертов на 122 миллиарда параметров с 10 миллиардами активных параметров, построенная на Qwen3.5-122B-A10B, а AREX-Turbo — это плотная 4B-модель, построенная на Qwen3.5-4B; обе были выпущены 23 июля 2026 года под лицензией Apache 2.0. Так что честная суть этого сравнения — не «агент против флагмана». Она такова: что сегодня даёт вам субстрат Alibaba, что добавляет поверх него агентный слой BAAI и какую часть второго вопроса можно ответить до того, как BAAI загрузит файл?

Что сейчас работает на стороне Qwen и сколько это стоит

Поколение Qwen3.8 необычно легко анализировать, поскольку оно полностью специфицировано и имеет публичные цены на трёх отдельных уровнях.

• Qwen3.8-Max — выпущена 3 августа 2026 года. Контекстное окно на 1 млн токенов, нативная поддержка ввода текста, изображений и видео, режим размышления, вызов функций и структурированные выходные данные, а также три формата обмена данными (совместимый с OpenAI, совместимый с Anthropic и собственный DashScope) в пяти регионах. 2,00 $ за миллион входных токенов и 6,00 $ за миллион выходных, при этом чтение из кэша — 0,25 $.

• Qwen3.8-27B — выпущена 13 августа 2026 года. Плотная модель, 27B параметров, контекст 256K (262 144 позиции), на входе текст, изображения и видео, веса Apache 2.0. Опубликована на собственной карточке Qwen с показателями 90,3 на LiveCodeBench v6, 89,2 на GPQA Diamond, 84,3 на OSWorld-Verified и 79,0 на QwenSWEBench — по данным производителя, независимо не воспроизведено. Независимое измерение даёт ей индекс Artificial Analysis Intelligence Index 33,7 и 68,1 в AA Coding index.

• Qwen3.8-Flash— выпущена 26 августа 2026 года. То же окно в 1 млн токенов и тот же мультимодальный ввод, по цене $0,15 за миллион входных токенов и $0,47 за выходные. Дешёвый уровень в семействе — тот, что делает высоконагруженный агентный трафик доступным.

Есть также неотмеченная запись Qwen3.8: флагманская модель с 2,4 триллиона параметров, веса которой, как заявила Alibaba, должны появиться, и которую пока нигде нельзя вызвать. Если вы ищете «Qwe​n 3.8» и ожидаете одну модель, вот почему ответ — семейство из четырёх, а не одна.

A screenshot of the OrcaRouter model page for Qwen3.8-27B, showing the Featured badge, a 256K-token context window, text, image and video input with text output, badges for Vision, Tools, JSON and Reasoning, the provider line 'by Qwen - 2026-08-13', a pricing row of $0.33 input and $2.40 output per million tokens with measured latency and 120.2M tokens of traffic, and the beginning of the model description covering the 27B dense multimodal model's Apache-2.0 licence and 256K context.

На фоне всего этого спецификация AREX-2 — всего одна строка: репозиторий, отметка времени и название, которое подразумевает второе поколение того, что BAAI уже однажды создала.

Деталь, которая меняет всю картину сравнения

AREX — не конкурент Qwe​n; это потребитель Qwe​n. Обе модели AREX первого поколения проходят пост-обучение на бэкбонах Qwen3.5, а затем оборачиваются в фреймворк, который делает их агентами, а не чат-моделями: внутренний цикл, который ищет, просматривает и интегрирует доказательства в ответ-кандидат с показателем уверенности, и внешний цикл, который проверяет этот ответ на соответствие исходным ограничениям и либо принимает его, либо уточняет, либо отбрасывает траекторию и начинает заново. Интересная инженерия в AREX — не сеть. Это цикл, механизм обновления контекста, который на длинном горизонте не даёт перепутать проверенные находки, открытые кандидаты и нерешённые ограничения, и интерфейс инструментов, который предоставляет модели поиск и просмотр как действия первого класса.

Именно поэтому собственные опубликованные показатели семейства — 82.5 в BrowseComp, 85.4 в GAIA, 71.0 в xbench-2510, 89.9 в DeepSearch QA и 82.0 в WideSearch-en для 122B Base, а для 4B Turbo — 70.7 / 81.6 / 57.0 / 78.5 / 68.5 — несопоставимы с оценками Qwen3.8-27B в программировании и агентных задачах, хотя они принадлежат к одной архитектурной линии. Они измеряют разные вещи. QwenSWEBench проверяет, способна ли модель решить проблему в репозитории. BrowseComp проверяет, способен ли агент найти факт, который намеренно трудно найти, в ходе множества поисков, не теряя из виду вопрос. Сырой чекпоинт Qwen3.5 показывает плохие результаты во втором и хорошие в первом, и именно этот разрыв призваны закрыть посттренировка и harness BAAI.

A generated pricing card headed 'The Qwen3.8 family is priced. AREX-2 is not callable.' It lists Qwen3.8-Max at $2.00 in / $6.00 out with a 1M context released 3 Aug 2026, Qwen3.8-27B at $0.33 in / $2.40 out with 256K context and open weights released 13 Aug 2026, Qwen3.8-Flash at $0.15 in / $0.47 out with a 1M context released 26 Aug 2026, Qwen3.5-122B-A10B at $0.115 in / $0.917 out as the backbone AREX-Base post-trains up to 128K, and a highlighted AREX-2 row reading 'no rate card' because there are no weights, card or licence tag. A footer reads 'Qwen3.8-27B scores 33.7 on the AA Intelligence Index; AREX-2 does not exist to score.' The OrcaRouter logo is composited in the bottom-right corner.

Каким наиболее вероятно было бы второе поколение

Если AREX-2 продолжит эту закономерность, наиболее вероятная трактовка — умозаключение, а не факт — это исследовательский агент второго поколения, дообученный на более новой основе Qwen, чем поколение 3.5, которое используют текущие модели AREX. Qwen3.8-27B — плотная, мультимодальная модель под лицензией Apache 2.0, что делает её естественным кандидатом для агента уровня качества; Qwen3.8-Flash дешёва в расчёте на токен, а это имеет огромное значение, когда ваш агент делает десятки вызовов на один запрос и на каждом шаге перечитывает растущий контекст.

Ничто из этого не подтверждено. Название не несёт ни размера, ни архитектуры, ни даты, а «2» в линейке продуктов — это соглашение об именовании, а не спецификация. Подтверждено гораздо меньше, и именно так это и следует формулировать: BAAI создала репозиторий 29 сентября 2026 года, ничего в него не добавила и ничего не объявила. Ни весов, ни карточки модели, ни числа параметров, ни тега лицензии, ни бенчмарков, ни провайдера, который бы его обслуживал. Если на этой неделе где-либо приводят числа AREX-2, это не измерения.

Что вы действительно можете купить сегодня днём

Практическая асимметрия между этими двумя заключается не в качестве, а в том, что у одной стороны есть прайс-лист, а у другой — запись в справочнике.

Если ваша работа связана с агентами и вам нужна та самая основа, на которой было построено семейство AREX, именно ту базовую модель можно вызвать: Qwen3.5-122B-A10B есть в каталоге OrcaRouter по цене $0.115 за миллион входных токенов и $0.917 за миллион выходных до 128K токенов, а свыше этого — $0.287 / $2.294, с включёнными функциями зрения, использования инструментов и рассуждения. Это модель, которую дообучает AREX-Base; она доступна без ожидания.

Если вам нужно текущее поколение, оба открытых тарифных уровня Qwen3.8 есть в каталоге: Qwen3.8-27B по $0,33 за миллион входных и $2,40 за выходные, работает на нашей собственной инфраструктуре, потому что веса открыты и нет вендорской платы за токен, которую нужно перекладывать, и Qwen3.8-Flashза $0,15 / $0,47 для объёмного тарифа. Один API покрывает оба; прейскурантная цена провайдера передаётся без каких-либо наценок за токен, так что когда Alibaba меняет цену, число здесь меняется в тот же день.

И когда AREX-2 всё-таки выйдет, причина, по которой ему место за тем же самым слоем, структурная, а не рекламная. Цикл агента, выполняющий двадцать вызовов на один запрос, умножает частоту отказов каждого провайдера на двадцать; правило маршрутизации с автоматическим переключением при сбое, принимающее решение во время выполнения, — вот разница между таймаутом как поводом для повторной попытки и таймаутом как уверенно неверным ответом. Этот аргумент применим к любому исследовательскому агенту и будет применим к AREX-2, когда появится AREX-2, который можно будет маршрутизировать.

Кто должен действовать и в отношении чего?

Если вам сегодня нужен исследовательский агент, AREX-Base — это та модель AREX, которая существует; она вышла в июле под Apache 2.0, и её агентные бенчмарки — собственные у поставщика, но, по крайней мере, они привязаны к скачиваемой модели. Если вам сегодня нужно передовое мультимодальное рассуждение или агентный трафик большого объёма, уровни Qwen3.8 уже доступны, имеют цену и частично независимо оценены, и существование AREX-2 ничего не меняет в этом решении.

Единственный сценарий, в котором AREX-2 имеет значение для решения, которое вы принимаете на этой неделе, — это выбор бэкбона для дообучения. И здесь ответ уже виден в каталоге: бэкбоны версии 3.5, которые использовал AREX, всё ещё дешёвы и доступны, поколение 3.8 лучше и тоже доступно, а AREX второго поколения — когда бы он ни появился — почти наверняка будет свидетельством того, какую базу Qwen, по мнению BAAI, стоит брать за основу, а не заменой для неё.

Три вещи решили бы всё остальное: файлы в дереве, карточка с числом параметров и полем базовой модели и тег лицензии. Первое из них — то, что действительно важно, потому что пока оно не появится, это сравнение между платным семейством и заглушкой.