Заглавное изображение «Nex-N2.5 Pro против GLM-5.2» — это сгенерированная титульная карточка, на которой написано «Nex-N2.5 Pro против GLM-5.2», с подзаголовком «Две агентные модели с открытыми весами и одно подозрительное совпадение на 82,7» и надзаголовком «Nex-AGI против Z.ai — сентябрь 2026».
Guides & Insights

Nex-N2.5 Pro против GLM-5.2: одинаковые 82.7 на Terminal-Bench, два совершенно разных происхождения

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две агентные модели с открытыми весами — и одно подозрительное совпадение: Nex-N2.5 Pro и GLM-5.2 обе набирают 82,7 на Terminal-Bench 2.1. Nex-AGI указывает 82,7 для Nex-N2.5 Pro в собственной карточке модели — результат, полученный на собственном харнессе альянса NexCUA, который публика не видела. Лучшая заявленная цифра Z.ai для GLM-5.2 на том же наборе — тоже 82,7; однако когда независимый харнесс перепрогнал модель, она остановилась на 77,9, примерно на пять пунктов ниже цифры вендора. Безупречная ничья между цифрой, которую никто не может проверить, и цифрой, которая уже уменьшилась при проверке, — это вовсе не ничья. Это максимально чистое доказательство того, почему разница между «открытыми весами» и «весами, которые когда-нибудь появятся» решает исход этого противостояния ещё до прочтения первой строки бенчмарка.

Обе модели находятся в одном и том же коммерческом сегменте и при этом не могут быть более разными по своей сути. Nex-N2.5 Pro, анонсированный 8 сентября 2026 года, — это мультимодальная модель для работы с компьютером: 397 миллиардов параметров всего, из которых активно около 17 миллиардов. Она построена на базе линейки Qwen3.5 и спроектирована так, чтобы считывать экран и управлять браузером или сеансом рабочего стола с помощью визуальной обратной связи. GLM-5.2 — флагман Z.ai (Zhipu AI) с лицензией MIT, предназначенный для длительных многошаговых рассуждений и написания кода: примерно 743 миллиарда параметров, из которых активны около 40 миллиардов; это текстовая модель, находящаяся в общей доступности (GA) с 16 июня 2026 года, и именно она в течение нескольких месяцев удерживала независимые оценки в категории открытых весов. Одна смотрит на мир через пиксели и действует в нём. Другая мыслит текстом и выпускает код. Лицензии обеих моделей разрешают строить на них бизнес; разница в том, что у одной из них эта лицензия сейчас — лишь обещание.

Одно и то же число, два разных происхождения

Начнём с ничьей, потому что она объясняет всё противостояние. В карточке Nex-AGI Terminal-Bench 2.1 указан как 82,7 для Nex-N2.5 Pro, наряду с OSWorld-2 — 56,4, SWE-Bench Pro — 61,2 и BrowseComp — 89,7; все они получены через харнес NexCUA, и ни один из результатов не был независимо воспроизведён в первые дни жизни модели, по той простой причине, что веса недоступны для загрузки. Показатель Z.ai в 82,7 для GLM-5.2 на Terminal-Bench 2.1 — это лучшее заявленное число самого вендора, но оно относится к модели, которую любой может скачать с Hugging Face и перезапустить уже сегодня днём; независимое измерение на харнесе в 77,9 уже существует, и оно примерно на пять пунктов ниже заявленного Z.ai. Когда показатель вендора уменьшается при независимом тестировании, это не скандал — это обычный налог на самостоятельное измерение. Когда показатель конкурирующего вендора вообще невозможно протестировать, отсутствие этого налога и есть проблема, а не признак того, что число безупречно.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GLM-5.2 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; License Apache-2.0 pending; Params 397B / ~17B active; Modality text + image (computer use); Terminal-Bench 2.1 82.7 vendor; Price free hosted / no list. Right column GLM-5.2: GA Jun 16 2026; License MIT live now; Params ~743B / ~40B active; Modality text only; Terminal-Bench 2.1 82.7 claimed / 77.9 independent; Price $1.40 / $4.40 per 1M. Footer: 'Nex and Z.ai figures vendor-reported; 77.9 per the OrcaRouter harness.'

Читайте соседние строки точно так же. GLM-5.2 удерживает самый высокий независимый показатель индекса, когда-либо полученный открытым уровнем, — низкие 50 баллов по текущему индексу интеллекта Artificial Analysis, — поэтому она уже несколько месяцев остается эталонной открытой моделью, несмотря на то что не является самой яркой новой разработкой. У Nex-N2.5 Pro вообще нет записи в независимом индексе. В строках, где обе компании заявляют цифры, проверяемой оказывается цифра действующей модели; в строках, где публикации есть только у Nex-AGI, цифры не воспроизведены. Это не вердикт о том, какая модель умнее. Это вердикт о том, какую модель вам разрешено проверить.

Технические характеристики совпадают больше, чем можно было бы ожидать.

Уберите бенчмарки в сторону — и обе модели окажутся близки по основным характеристикам:

Релизы — Nex-N2.5 Pro: 8 сентября 2026 г. (эндпоинты доступны, веса ожидаются). GLM-5.2: GA 16 июня 2026 г., веса доступны.

Лицензия — Nex-N2.5 Pro: Apache-2.0, веса скоро появятся. GLM-5.2: MIT, доступна для скачивания.

Масштаб — Nex-N2.5 Pro: 397B всего / ~17B активных. GLM-5.2: ~743B всего / ~40B активных.

Модальность — Nex-N2.5 Pro: ввод текста и изображений, вывод текста, цикл компьютерного зрения. GLM-5.2: текстовая модель рассуждений.

Контекст / вывод — Nex-N2.5 Pro: контекст 262 144 токена. GLM-5.2: контекст 1M токенов, потолок вывода 128K.

Управление рассуждением — Nex-N2.5 Pro: нет / средний (адаптивный, по умолчанию) / высокий. GLM-5.2: управление усилием рассуждения — в той же строке модели.

Цена за 1 млн токенов — Nex-N2.5 Pro: бесплатный размещённый тариф, цена не указана. GLM-5.2: $1.40 за входные токены / $4.40 за выходные токены, $0.26 за кэшированные входные токены.

Конверты различаются так же, как различаются задачи двух моделей: GLM-5.2 обеспечивает полный миллион токенов текстового контекста и потолок в 128K выходных токенов для длительных инженерных сессий, тогда как Nex-N2.5 Pro меняет размер контекста на канал зрения и меньший 262K-буфер, рассчитанный на нагрузки с размером экрана. Ни одна из спецификаций не является ошибочной; они рассчитаны на разные задачи.

Открытые веса: два разных значения

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Это тот момент, когда сравнение перестаёт быть про числа. GLM-5.2 открыт так, как открывают продукт, на котором можно построить бизнес: лицензия MIT, веса на Hugging Face, никаких ограничений на коммерческое использование, никакого пункта об обмене данными, никакого вендора, который заглядывает вам через плечо. Вы можете скачать его, дообучить, развернуть за собственным периметром комплаенса или отдать на любой хостинг — а поскольку веса опубликованы, у его цены есть нижняя граница, которую ни один отдельный вендор не сможет поднять. Nex-N2.5 Pro обещан под Apache-2.0, столь же разрешительной лицензией, но на баннере его карточки на Hugging Face сказано, что веса появятся скоро, и без указания даты. Для команды, живущей по правилам управления данными, или для той, что хочет в масштабе полностью уйти от поплатной тарификации, эта разница и есть всё решение: GLM-5.2 — модель, которой можно владеть уже сегодня, а Nex-N2.5 Pro — модель, которую вам лишь пообещали. Арифметика самостоятельного размещения тоже играет в пользу новичка, когда веса наконец появятся: 17B активных параметров на узле из восьми H100 — это куда более доступная конфигурация, чем «коробка» GLM-5.2 с ~40B активных, — но «когда веса появятся» в этом предложении делает очень много работы.

Семьи двигаются в противоположных направлениях.

Обе модели принадлежат быстро развивающимся семействам, и траектории этих семейств расходятся в разные стороны. {{1}}Линия развития GLM-5.2 прозрачна и итеративна: Z.ai выпустила GLM-5.3 в августе как посттренировочное обновление той же базовой модели 5.2, а GLM-5.3 Flash — в начале сентября. Поэтому веса 5.2, на которых вы строите сегодня, — это фундамент, который семейство продолжает совершенствовать; ваши знания об архитектуре и ваши дообученные модели не теряют актуальности.{{/1}} {{2}}Семейство Nex-AGI — это ставка на совершенно новое поколение: Nex-N2.5 Mini (35B), Nex-N2.5 Pro (397B) и текстовый Nex-N2.5 Max (1.6T), чья собственная база — DeepSeek-V4-Pro-Base; при этом веса модели Pro, которые позволили бы любому проверить заявления семейства, всё ещё не опубликованы.{{/2}} {{3}}Команда, выбирающая платформу для разработки, выбирает между линейкой с опубликованной дорожной картой обновлений и первым релизом, второй акт которого ещё не наступил.{{/3}}

Какой из них заслуживает место в вашей сборке?

Если ваше требование — «модель должна быть нашей» — для управления данными, для аудита, для продукта, контроль над которым вы не хотите отдавать одному вендору, — то в этом сравнении GLM-5.2 — не лучший выбор; это единственный выбор, потому что это единственная модель из представленных, которую можно скачать. Это также единственная модель с независимой оценкой, и её цена по прайс-листу Z.ai составляет $1.40 за миллион входных токенов и $4.40 за миллион выходных. Если ваше требование — мультимодальный агент для работы с компьютером, который со временем мог бы подорвать позиции закрытых лидеров, то Nex-N2.5 Pro — более интересная долгосрочная идея — оператор зрения с 17B активных параметров от альянса, который точно знает, что хочет построить, — но идея — это не зависимость, а бесплатный размещённый эндпоинт — не фундамент.

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), marked FEATURED, showing the header stats $1.40 input and $4.40 output per million tokens and the byline 'by Z.ai - 2026-06-16'.

Практический подход ко всему этому — опираться на то, что уже существует, и измерять обещанное, когда оно появится. GLM-5.2 доступна на OrcaRouter по прейскуранту Z.ai (те же $1,40 / $4,40 без наценки), а поскольку веса у неё открытые, её можно развернуть и у себя, если вы хотите включить в замер собственный serving-стек. Это точка отсчёта, на которой уже сегодня стоит прогнать вашу реальную агентную нагрузку, а DSL маршрутизации будет служить заменой до того дня, когда Nex-N2.5 Pro появится у провайдера по прейскурантной цене. Когда это произойдёт, смена объекта сравнения станет правилом маршрутизации, а не миграцией. Пока не появятся шарды и независимый стенд не подтвердит — или не скорректирует — показатель 82,7, Nex-N2.5 Pro против GLM-5.2 — это противостояние цифры, которую нельзя проверить, и модели, которую можно проверить.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно