
Step 5 Preview против GLM-5.3: разница в один балл, и только у одного из них есть файл лицензии
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
В независимом рейтинге Step 5 Preview и GLM-5.3различаются всего на один балл: 44 против 45 в Artificial Analysis Intelligence Index v4.3.2, где GLM-5.3 оценивается как GLM-5.3 (max), а Step 5 Preview вообще не имеет метки уровня усилий. Это самый маленький разрыв в этой серии, и в то же время это наименее полезное число во всём сравнении. Решающее же число — это то, что у GLM-5.3 есть веса, которые можно скачать уже сегодня, — опубликованные Z.ai под нестандартной лицензией, которая не является MIT, — тогда как у Step 5 Preview, анонсированного StepFun 20 сентября 2026 года, есть репозиторий на Hugging Face, содержащий единственный .gitattributes и заявленную дату выхода BF16-чекпоинта — 15 октября. В стартовых материалах StepFun модель описывается как результат, входящий в тройку лучших открытых решений. Но открытым исходным кодом она пока не является. GLM-5.3 — является, и именно её лицензию стоит прочитать, прежде чем строить на ней планы.
Что на самом деле можно купить за один пункт индекса
Обе модели прогнали через одни и те же десять оценок в одной и той же лаборатории, что делает сравнение необычно чистым и одновременно необычно бесполезным.
• Индекс интеллекта — Step 5 Preview 44 против GLM-5.3 45
• Где это находится — GLM-5.3 на один пункт выше Step 5 Preview; Step 5 Preview на одном уровне с Kimi K3
• Параметры — Step 5 Preview: 600B всего / 27B активных против GLM-5.3: 753B всего / 40B активных
• Скорость вывода — Step 5 Preview 99,8 токенов/сек против GLM-5.3 72,1 токенов/сек
• Время до первого токена — Step 5 Preview 2,96 с против GLM-5.3 2,99 с
• Цена за 1 млн токенов — Step 5 Preview $1.00 за вход / $2.70 за выход против GLM-5.3 $1.40 за вход / $4.40 за выход
• Скидка на кэш — Step 5 Preview 95% против GLM-5.3 81%
• Стоимость за одну задачу Intelligence Index — Step 5 Preview $0,71 против GLM-5.3 $2,01
• Контекст — у обоих 1M токенов; в нашем каталоге GLM-5.3 указана с потолком вывода 131.1K, а StepFun его не опубликовала
• Веса — Step 5 Preview закрыт, BF16-чекпоинт запланирован на 15 октября; GLM-5.3 опубликована по кастомной лицензии Z.ai
Если прочитать эти строки вместе, разрыв в один пункт перестаёт быть главной новостью. Step 5 Preview на 29% дешевле на входе, на 39% дешевле на выходе, генерирует токены на 38% быстрее и имеет на 14 пунктов более глубокую скидку за кеш — а показатель стоимости на задачу индексирования, который сводит многословность и поведение кеша в одно число, в 2,8 раза ниже. И это при 600B общих параметров против 753B у GLM-5.3 и 27B активных против 40B. По оси эффективности это не близкое противостояние; по возможностям — настолько близко, насколько это вообще возможно на табло.
Единственная строка, где Step 5 Preview не выигрывает, — это та, которую труднее всего исправить: у GLM-5.3 есть файл лицензии, а у Step 5 Preview — нет.
Лицензия — это вся разница, и это не MIT.
Легко предположить, что открытый флагман китайской лаборатории поставляется под MIT, потому что некоторые так и делают. Собственные модели Z.ai GLM-5.2 и GLM-5.3-Flash обе распространяются под MIT. А флагман GLM-5.3 — нет: он поставляется под собственной лицензией «glm-5.3», которая разрешает коммерческое использование при соблюдении ряда ограничений. Это существенно иной документ по сравнению с условиями MIT, под которыми распространяется его младший собрат, и для компании, чьи юристы читают лицензию раньше README, это скорее разговор, чем формальность.
У Step 5 Preview пока вообще нет лицензии, а это другая проблема, и не обязательно меньшая. Ограничительная лицензия говорит, что вам разрешено делать, и оставляет вам решать, приемлемы ли условия. Отсутствие лицензии не говорит ничего: ни разрешения на коммерческое использование, ни права на распространение, ни разрешения на дообучение, ни способа оценить, будет ли контрольная точка от 15 октября пригодна для вашего продукта, пока она не появится. Название репозитория, которое зарезервировала StepFun, — stepfun-ai/Step-5-Preview-BF16 — указывает на формат bfloat16, то есть на артефакт, из которого вы дообучаете и квантуете, а не на тот, который вы обслуживаете. Это говорит о форме релиза. Но оно не говорит о его условиях.
Так что честное сравнение — это сравнение между лицензией, которую можно прочитать и с которой можно не согласиться, и лицензией, которой не существует. Для команды, которой нужно дообучать модель, разворачивать её самостоятельно в контролируемой среде или выпускать производный продукт, GLM-5.3 — единственная из этих двух, у которой есть ответ, и ответ этот — юридическая проверка, а не зелёный свет.
Разрыв в эффективности — это та часть, которая выдерживает проверку.
Заявления об эффективности заслуживают большего скептицизма, чем заявления о результатах бенчмарков, потому что их легче сделать и труднее проверить. Эти два выдерживают проверку лучше большинства, и механизм виден в архитектуре.
Разреженные модели со смесью экспертов тратят вычисления только на тех экспертов, к которым маршрутизируется токен, поэтому именно активируемый показатель определяет поведение в продакшене, а общее число — это в основном вопрос памяти. При 27 млрд активных параметров против 40 млрд у GLM-5.3 Step 5 Preview выполняет примерно на треть меньше работы на токен, и измерения это подтверждают: 99,8 выходных токенов в секунду против 72,1 и стоимость одной задачи индексирования $0,71 против $2,01. Это одна и та же история, рассказанная тремя способами, — именно это делает её убедительной, а не единичным лестным числом.
Скидка за кэш — это та строка, которая важнее всего для рабочей нагрузки, под которую продаются обе модели. Цикл агента, заново отправляющий один и тот же системный промпт и контекст репозитория на каждом шаге, почти целиком укладывается в эту скидку, поэтому 95% против 81% накапливаются на протяжении долгой сессии так, как цена по прайс-листу — нет. При соотношении попаданий в кэш, входных и выходных токенов 7:2:1 смешанная ставка Step 5 Preview оказывается около $0,51 за миллион токенов против существенно более высокой смешанной ставки GLM-5.3 — и чем дольше работает цикл, тем сильнее расходится разрыв.
Пока нельзя проверить, сохранится ли эта эффективность при масштабировании. API Step 5 Preview открылся в день запуска — на одном-единственном эндпоинте. GLM-5.3 обслуживает продакшн-трафик с середины августа у множества независимых вызывающих сторон, а у модели, за которой стоят пять недель реальной нагрузки, есть режимы отказов, известные достаточно большой аудитории, чтобы они всплывали публично. У эндпоинта, которому всего несколько дней, всего этого нет. Цифры эффективности — это более благоприятное прочтение; опыт реальной эксплуатации — более полезное.

Что можно задействовать с каждой стороны сегодня
Это единственная часть сравнения, где они не симметричны, и здесь стоит быть точным, а не округлять до «оба доступны».
GLM-5.3 уже доступна на OrcaRouter на странице модели z-ai/glm-5.3 по цене $1.26 за вход и $3.96 за выход, тогда как на самой странице модели у Z.ai указаны $1.40 и $4.40 — передаются как есть, с нулевой наценкой, поэтому число, которое вы видите, — это текущая ставка провайдера, а не та, которую выбрали мы. Открытые веса доступны на Hugging Face, поэтому одну и ту же модель можно получить тремя способами: через наш эндпоинт, через собственный API Z.ai или на вашем собственном оборудовании.
Step 5 Preview не входит в наш каталог, и мы его не маршрутизируем. Он работает на собственном API и в Studio StepFun, и это единственное место, где он работает, пока не выложат веса. Рядом с ним с нашей стороны находится набор моделей, с которыми его сравнивают, за одним ключом — более 200 моделей: GLM-5.3 по сниженной цене, указанной выше, DeepSeek V4 Pro за $0.66 и $1.98, а также Claude Opus 5 за $5.00 и $25.00. Именно это делает следующие четыре недели рабочими, а не заблокированными — вы можете сравнить превью с production-моделью на одном и том же ключе, при этом автоматический фейловер между провайдерами удерживает production-путь, пока кривая ёмкости превью всё ещё неизвестна, а DSL маршрутизации собирает production-плечо в один вызов, а не во вторую интеграцию.

Выбор между перспективным кандидатом и послужным списком
Если вы занимаетесь дообучением, разворачиваете модель у себя или создаёте производный продукт, ответ — GLM-5.3, и он вне конкуренции — не потому, что набирает на один балл больше, а потому, что только у него из этих двух есть лицензия, которую можно прочитать, и чекпойнт, который можно скачать. Заложите в бюджет юридическую проверку, потому что эти кастомные условия — не MIT, и эта разница такого рода, что всплывает скорее при аудите закупок, чем в бенчмарке.
Если вы вызываете модель через API и ваша рабочая нагрузка — это агентный текст в большом объёме, Step 5 Preview опережает по всему, что важно для счёта и часов: дешевле за токен, дешевле за задачу, быстрее генерирует и даёт более глубокую скидку на кэш для шаблона повторяющегося префикса, который наполняет цикл агента. По сравнению с появившимся всего несколько дней назад одноисточниковым эндпоинтом без опубликованного потолка вывода и без лицензии, аргумент в пользу того, чтобы сделать его выбором по умолчанию, — это аргумент о бенчмарке, а не о контракте.
Что изменило бы ответ — это чекпоинт от 15 октября. Разрешительная лицензия превратила бы преимущество в эффективности в то, чем можно владеть, а не арендовать, и в этот момент отставание в одно очко перестаёт иметь значение — модель, которая в 2,8 раза дешевле на задачу индексации и на 38% быстрее при генерации, не обязана побеждать в агрегированном показателе. Ограничительная лицензия оставляет GLM-5.3 единственной из пары, на которой можно строить продукт, и разрыв в одно очко становится мелочью о двух моделях, которые вы всё равно использовали бы по-разному.
Единственная характеристика, за которой стоит следить, — это потолок вывода. Оба вендора заявляют контекст в 1M токенов. В нашем каталоге для GLM-5.3 указан максимальный объём вывода 131.1K; в анонсе StepFun названы контекст 1M и отсутствие ограничения на вывод, а отдельная сторонняя конфигурация, распространявшаяся во время утечки, указывала контекст 350 000 при максимальном выводе 64 000. Для пары моделей, позиционируемых для долгосрочной агентной работы, это число определяет, что вы реально сможете построить, и прямо сейчас только одна сторона дала на него ответ.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
