
GLM-5.3-Flash против GLM-5.3: Оправдывает ли преимущество флагмана в три пункта его десятикратную цену?
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianНОВИНКАQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
Zhipu AI провела 26 августа в демпинге собственного флагмана. В тот же день, когда она подтвердила GLM-5.3-Flash — мультимодальную модель с 18B активных параметров, стоящую за анонимным «Ox Alpha», — она установила цену на эту модель в десятую часть от цены GLM-5.3, своего флагмана с 743B параметров, который неделей ранее возглавил рейтинги открытых моделей, а ограниченная по времени скидка доводит её до одной двадцатой. Две модели разделяют имя, происхождение и окно контекста в 1M токенов, но находятся на противоположных концах прайс-листа Zhipu, и теперь вопрос в том, что стоит между ними: GLM-5.3 набирает 60 баллов в Artificial Analysis Intelligence Index, тогда как Zhipu заявляет 57 для GLM-5.3-Flash — так что вся флагманская премия держится на трёх баллах индекса, и вопрос в том, стоят ли эти баллы в десять-двадцать раз дороже.
Это сравнение внутри одного семейства, поэтому привычная постановка вопроса «что лучше» здесь неверна — правильнее спросить: «какой уровень подходит под задачу». Flash дешевле, готов к открытым весам и изначально мультимодален; флагманская модель сильнее в независимо измеряемых рассуждениях, многословнее и всё ещё ждёт даты выхода собственных открытых весов. Вот сводка результатов, а затем — обоснование.
Одна семья, два уровня
{{1}}GLM-5.3 — флагманская модель Zhipu для рассуждений{{/1}}: {{2}}743 млрд параметров на той же базе смеси экспертов, что и GLM-5.2 (примерно 40 млрд активных на токен), исключительно текстовая, с обязательным рассуждением на трёх уровнях усилий и независимо измеренным показателем AA Intelligence Index 60, который делит с Kimi K3 первое место среди открытых моделей.{{/2}} {{3}}GLM-5.3-Flash — контрпозиция{{/3}}: {{4}}320 млрд всего / 18 млрд активных на 45 слоях, нативный ввод текста/изображений/видео, веса под лицензией MIT, опубликованные в день запуска, и показатель AA Index 57, о котором сообщает Zhipu, но который Artificial Analysis пока независимо не подтвердила.{{/4}} {{5}}Обе модели поддерживают окно контекста до 1 млн токенов, обе доступны через API Zhipu, и обе используют подход GLM-5 с упором на пост-обучение{{/5}} — {{6}}все улучшения GLM-5.3 достигнуты за счёт масштабированного обучения с подкреплением на фиксированной базе, и Flash продолжает это направление, а не разворачивает его вспять.{{/6}}

Куда идут три точки
В индексе разница между 57 и 60 — это разница между соответствием Claude Opus 4.8 (57) и соответствием Kimi K3 на вершине открытых моделей (60). На практике три пункта AA соответствуют сложному концу рассуждений — долгосрочным многошаговым задачам, где проявляется масштабный пост-тренинг флагмана. Это согласуется с тем, что ещё известно об этих двух моделях: GLM-5.3 — самая многословная модель в своём классе, генерирующая гораздо больше выходных токенов на задачу, чем её аналоги, что является признаком модели, которая дольше думает перед ответом. Flash, по позиционированию Zhipu, разменивает часть этого обдумывания на стоимость и скорость.
Существует также асимметрия в проверке. Показатель 60 у GLM-5.3 был измерен Artificial Analysis независимо; 57 у GLM-5.3-Flash взяты из материалов запуска Zhipu и на момент написания не появились в лидерборде. Что касается кодирования, заявленные вендором показатели GLM-5.3 высоки (Terminal-Bench 3.0 28.3, DeepSWE v1.1 66.9, Agents' Last Exam CLI 28.5), и Zhipu утверждает, что кодирование Flash на её внутреннем Z.ai Code Bench сопоставимо с Claude Opus 4.8 — это утверждение сообщество проверит на весах MIT в течение дней, а не месяцев.
Ценовой разрыв в цифрах
GLM-5.3 стоит $1.40 за миллион входных и $4.40 за миллион выходных токенов. GLM-5.3-Flash стоит в десять раз меньше — примерно $0.14 / $0.44, исходя из заявленного Zhipu соотношения, — или примерно $0.07 / $0.22 во время ограниченной по времени скидки, то есть в двадцать раз меньше. Zhipu также оценивает стоимость Flash за одну задачу AA Intelligence Index примерно в $0.045 против оценочных $0.68 у GLM-5.3. Главное здесь — разница в цене за токен: десяти-двадцатикратное отличие в цене при разнице в три пункта индекса.
Две оговорки делают разрыв честным. Во-первых, скидка на Flash явно ограничена по времени, так что его стабильная цена может соответствовать уровню $0.14 / $0.44, а не сниженным $0.07 / $0.22. Во-вторых, реальная разница в стоимости зависит от многословности: известно, что GLM-5.3 расходует много выходных токенов, тогда как поведение Flash при больших объёмах ещё не измерено. Если Flash работает с аналогичным коэффициентом расширения, часть ценового преимущества исчезает в пересчёте на конкретную задачу. Как всегда, сравнивайте стоимость за задачу на своих собственных рабочих нагрузках, а не ценники за токен.
Открытые веса: Flash обошёл флагман
Самая удивительная деталь этого запуска — порядок лицензирования. GLM-5.3-Flash опубликовал свои веса на Hugging Face под лицензией MIT 26 августа, в тот же день, что и анонс. GLM-5.3 — модель, которую Zhipu позиционирует как флагман с открытыми весами, — на тот момент оставался проприетарным: веса обещали примерно на 28 августа, через две недели после запуска 14 августа. В результате более дешёвая модель Zhipu теперь может быть развёрнута самостоятельно, а флагман — пока нет, и сообщество сможет протестировать Flash против заявленной производительности флагмана ещё до того, как появятся собственные веса флагмана. Если заявленные вендором показатели Flash — 57 и результаты по кодированию — выдержат независимое тестирование, обосновать ценность флагмана станет сложнее; если нет, надбавка в три пункта выглядит оправданной.

Какую GLM на самом деле стоит вызывать?
Пройдите по уровням так, как подразумевает ценообразование:
• Мультимодальный ввод — GLM-5.3-Flash — единственная из двух моделей с нативным пониманием текста/изображений/видео; GLM-5.3 поддерживает только текст.
• Самостоятельный хостинг — GLM-5.3-Flash: веса под лицензией MIT уже доступны; веса GLM-5.3 всё ещё ожидаются.
• Самые сложные задачи на рассуждение — GLM-5.3, на основе его независимо измеренных 60 и известной глубины размышлений.
• Экономичный объем — GLM-5.3-Flash, по цене от одной десятой до одной двадцатой от тарифа флагманской модели, с учетом вышеуказанной оговорки о скидке.
• Агентное кодирование — доказательства неоднозначны, пока Flash не будет независимо протестирован; заявленные вендором показатели кодирования GLM-5.3 сильны, но также не воспроизведены, а заявление Flash о кодировании ещё новее. Протестируйте на собственном наборе.
На стороне маршрутизации, флагманская сторона этого сравнения уже работает на OrcaRouter — GLM-5.3 попал в список в день открытия API Zhipu, по прейскурантной цене Zhipu с нулевой наценкой. GLM-5.3-Flash пока нет в списке; это день запуска. Полезное следствие: как только Flash появится, всё семейство окажется за одним ключом, и DSL маршрутизации позволит отправлять сложные задачи флагману, а массовые — Flash без второй интеграции. А пока веса MIT от Flash — самый быстрый способ самому понять, какой уровень вам действительно нужен.

Суть
GLM-5.3-Flash против GLM-5.3 — это не совсем дуэль: это ценообразование Zhipu на двух уровнях одной и той же кривой возможностей, и разница в цене — продуктовая стратегия. Трёхбалльное преимущество флагмана реально там, где это важно (независимое измерение, самые сложные рассуждения), и оно оправдывает деньги для рабочих нагрузок, которым это нужно. Скидка Flash в десять-двадцать раз даёт тот же подход в рамках семейства, нативный мультимодальный ввод и веса MIT ценой трёх индексных пунктов и набора невоспроизводимых утверждений. Для большинства производственных нагрузок, которые не живут на жёстком конце рассуждений, Flash — рациональный выбор по умолчанию; для остальных GLM-5.3 — страховка. Двухнедельное окно до появления весов флагмана покажет, сколько в премии — возможности, а сколько — заглушка.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
