
Qwen 4 Max vs Kimi K3: обещание открытых весов встречается с выпуском открытых весов
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
Moonshot AI выпустила Kimi K3 16 июля 2026 года, а затем сделала то, о чём большинство лабораторий только говорят: опубликовала веса. Чекпоинт на 2,8 трлн параметров появился 27 июля 2026 года под модифицированной лицензией MIT — через одиннадцать дней после запуска. Тем временем конференция Yunqi 22 сентября 2026 года была использована, чтобы объявить Qwen 4 Max флагманом семейства Qwen 4 из четырёх уровней, которое включает Qwen 4 27B с открытыми весами — уровень, который обещан, но не выпущен. Эти два факта и есть сравнение. Всё остальное о Qwen 4 Max на данный момент неизвестно, и разрыв между обещанным открытым уровнем и уже поставленным — вот где это противостояние действительно может что-то сказать.
Что Kimi K3 представил в июле
Kimi K3 — это смесь экспертов с 2,8 трлн параметров, которая активирует 16 из 896 экспертов на токен, что задействует примерно 104 млрд параметров на каждом отдельном шаге. Она имеет контекстное окно размером 1 048 576 токенов как на входе, так и на выходе и принимает текст, изображения и видео на входе, выдавая текст на выходе. Тарифы её собственного API составляют $3,00 за миллион входных токенов, $15,00 за миллион выходных токенов и $0,30 за миллион кэшированных входных токенов, а тарифы сторонних поставщиков ниже этого уровня.
Архитектура — это тот аспект, который перекликается с собственным предварительным обзором Alibaba. Kimi K3 построена на Kimi Delta Attention и Attention Residuals, которые, по утверждению Moonshot, обеспечивают примерно в 2,5 раза лучшую эффективность масштабирования, чем Kimi K2, и до 6,3 раза более быстрое декодирование при контекстах в миллион токенов. Это та же проблема, на которую нацелена QSA от Qwen — сделать внимание доступным при экстремальной длине, — а значит, эти два семейства конкурируют не столько по масштабу, сколько по тому, чей дизайн разреженного внимания лучше стареет.
Результаты, опубликованные Moonshot при запуске, заявленные производителем и не воспроизведённые на тот момент:
• Artificial Analysis Intelligence Index — 57, на тот момент третье место после Claude Fable 5 и GPT-5.6 Sol. Это значение было зафиксировано в более ранней редакции индекса; с тех пор индекс дважды перестраивали, так что это исторический показатель, а не текущий
• Frontend Code Arena — первое место с 1 679 Elo, опередив обе модели, которые превзошли её по общему индексу.
• Terminal-Bench 2.1 — 88,3
• SWE-Marathon — 42, опережает Opus 4.8 и GPT-5.6 Sol
• DeepSearchQA — 0,95, первое место, и MATH-Vision 0,98, тоже первое
• GPQA-Diamond — 0.94
Собственные материалы запуска Moonshot признают, что K3 по-прежнему уступает Claude Fable 5 и GPT-5.6 Sol по общим возможностям, и это предложение полезнее любого из заявлений о первом месте, приведённых выше. Интересная особенность этих цифр в том, что модель, занявшая третье место в общем индексе, стала первой во фронтенд-коде и первой в долгосрочном поиске — профиль, который говорит о том, что агрегированный индекс скрывает специализированный инструмент, а не описывает универсальный.

Что пообещала Alibaba и чего стоит обещание
В анонсе Qwen 4 были названы четыре уровня. Qwen 4 Max — как флагман, Qwen 4 Flash — для пропускной способности, Qwen 4 Plus — как сбалансированный средний вариант, а Qwen 4 27B — как локальный уровень с открытыми весами. Руководитель Qwen LLM Лю Да Ичэн описал это семейство как обучаемое на архитектуре нового поколения и сказал, что оно появится в ближайшее время. Для всех четырёх нет ни даты, ни карточки модели, ни идентификатора API, ни облачного листинга, ни цены, ни опубликованной оценки.
Две конкретные вещи в этом объявлении освещаются неверно, и обе важны для всех, кто пытается планировать с учётом этого:
• Цифра в 5–10 триллионов параметров, приписываемая материалам о Qwen 4, не является характеристикой Qwen 4. Она относится к дорожной карте Qwen 4.5 и Qwen 5. Для Qwen 4 Max не публиковалось никаких данных о количестве параметров.
• То, что названия уровней сохраняются, не означает переноса характеристик. Контекстное окно, цена и лицензия Qwen 4 Max неизвестны; цифры выпускаемой Qwen3.8-Max — 1,000,000 токенов при $2.00 и $6.00 за миллион — описывают другую модель
Причина, по которой сегмент 27B интересен, не имеет ничего общего с бенчмарками. Это единственный сегмент в линейке Qwen 4, который исторически выпускался с открытыми весами, и поколение Qwen 3.8 показало, что это открывает: в течение нескольких дней после появления весов 27B сообщество создало MLX-конверсии, квантования NVFP4 и файнтюны на любой вкус. Анонсированный 27B — это обязательство перед экосистемой, которая строится на его основе, и это самая предсказуемая поставка в дорожной карте.
Но предсказуемость не обеспечена. Веса Kimi K3 — это файл, который можно скачать уже сегодня. Веса Qwen 4 27B — это строка в докладе на конференции.
Открытые веса и веса, которые можно запустить, — это разные утверждения.
Есть ловушка в том, чтобы считать Kimi K3 ответом с открытыми весами, и об этом стоит сказать прямо, потому что это самое распространённое преувеличение в освещении китайских фронтирных моделей. Смесь экспертов с 2,8 триллиона параметров — это артефакт масштаба дата-центра. Опубликованные веса означают, что вам разрешено её запускать, вы можете её проверять, дообучать и квантовать. Они не означают, что вы можете запустить её на рабочей станции. Эффективное обслуживание чекпойнта такого размера требует десятков ускорителей, а работа по квантованию, которая следует за открытым релизом, — варианты в стиле NVFP4 и REAP, которые появляются в течение нескольких недель, — в равной мере служит тому, чтобы модель можно было обслуживать, и тому, чтобы сделать её меньше.
Итак, честное прочтение лицензии Kimi K3 даёт более узкую, но по-прежнему значимую картину: это передовая модель, которую можно аудировать, модифицировать и развёртывать на собственном оборудовании, по модифицированной лицензии MIT — для организаций, располагающих оборудованием, чтобы её обслуживать. Это реальный стратегический актив — и плохой вариант для тех, кто понял «открытые веса» как «работает на моём ноутбуке».
Та же оговорка будет применима к Qwen 4 27B, если и когда он выйдет — и она применима менее остро, потому что уровень с открытыми весами на 27B действительно локального масштаба, в отличие от флагмана на 2.8T. Именно поэтому в этом сравнении уровень Qwen 4 27B заслуживает большего внимания, чем уровень Max, хотя именно с уровня Max начинался анонс.

Коммерческий вопрос, стоящий за лицензионным вопросом
Собственный тариф Kimi K3 — $3,00 за вход и $15,00 за выход за миллион токенов — это премиальное позиционирование, и Moonshot прямо давала понять, что цена намеренно установлена выше дешёвого сегмента китайского рынка. На фоне Qwen3.8-Max с $2,00 и $6,00 это в полтора раза выше ставка за вход и в два с половиной раза выше ставка за выход — разрыв настолько велик, что рабочая нагрузка должна опираться на конкретные сильные стороны Kimi K3, среди которых фронтенд-код и поиск на длинном горизонте, чтобы премия была оправдана.
OrcaRouter маршрутизирует kimi/kimi-k3 наряду с семейством Qwen 3.8 через одну конечную точку, совместимую с OpenAI, с наценкой 0%, а значит, с вас списывают по прайсовой ставке поставщика, а не по эквиваленту с наценкой. В сравнении, где разница в цене на выходе составляет 2,5 раза, отсутствие маржи платформы — не деталь округления: десятипроцентная надбавка к ставке вывода $15.00 — это $1.50 за миллион токенов, что больше, чем вся стоимость ввода более дешёвой модели в этом сопоставлении. Та же конечная точка поддерживает автоматическое аварийное переключение и DSL маршрутизации для явного выражения политики — именно так вы пробуете модель с профилем Kimi K3 на части продакшн-трафика, не ставя весь маршрут на поставщика, с которым ещё не работали.
OrcaRouter не предоставляет Qwen 4 Max или какой-либо уровень Qwen 4, потому что ни один из них пока не существует как продукт.

За чем следить и что игнорировать
Три сигнала могли бы изменить это сравнение, и они достаточно конкретны, чтобы за ними следить:
• Веса Qwen 4 27B. Не таблица бенчмарков уровня Max — а 27B-чекпоинт, его лицензия и его размер. Именно этот релиз покажет вам, так же ли реальна приверженность Alibaba открытым весам в этом поколении, как и в предыдущем.
• Лицензия Qwen 4 Max, если таковая имеется. Если Alibaba опубликует веса для своей флагманской модели так же, как она сделала для Qwen3.8-Max, аргумент в пользу открытых весов в этом противостоянии перестанет быть преимуществом Kimi и превратится в ничью
• Свежая независимая оценка Kimi K3. Стартовые оценки Moonshot были заявлены самой компанией, а индекс Artificial Analysis с тех пор дважды перестраивался, поэтому и 57, и Elo Frontend Code Arena нужно пересчитать на новой базе, прежде чем сравнивать их с чем-либо актуальным
Игнорировать следует любую таблицу спецификаций Qwen 4 Max, которая появляется до того, как Alibaba опубликует карточку модели, и любое утверждение о том, что открытые веса Kimi K3 позволяют запускать её локально. Обе ошибки уже распространяются. Тем временем сравнение, на которое можно опираться, — это сравнение двух моделей, которые существуют: Kimi K3 по премиальной цене, с уже выпущенными весами и действительно выделяющимся профилем для кодинга, и Qwen3.8-Max при стоимости вывода менее чем в половину, с фиксированным окном в миллион токенов и собственными весами. Это реальный выбор с ценой для обоих вариантов, и он не требует ждать, пока слайд с конференции станет продуктом.
Сравнение в этой статье3
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
