Сгенерированная hero-карточка под названием «Qwen 4 Max vs Kimi K3» с подзаголовком «Обещание открытых весов встречается с поставкой открытых весов» и тремя бейджами-пилюлями с текстом «Веса обещаны, но не поставлены», «Веса K3 выйдут 27 июля 2026 года» и «Модифицированная лицензия MIT». Строка в нижнем колонтитуле гласит: «Конференция Alibaba Yunqi, Ханчжоу». Плоское векторное редакционное оформление на белом фоне с градиентной заливкой от синего к голубому и логотипом OrcaRouter, размещённым в правом нижнем углу.
Engineering & Research

Qwen 4 Max vs Kimi K3: обещание открытых весов встречается с выпуском открытых весов

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Moonshot AI выпустила Kimi K3 16 июля 2026 года, а затем сделала то, о чём большинство лабораторий только говорят: опубликовала веса. Чекпоинт на 2,8 трлн параметров появился 27 июля 2026 года под модифицированной лицензией MIT — через одиннадцать дней после запуска. Тем временем конференция Yunqi 22 сентября 2026 года была использована, чтобы объявить Qwen 4 Max флагманом семейства Qwen 4 из четырёх уровней, которое включает Qwen 4 27B с открытыми весами — уровень, который обещан, но не выпущен. Эти два факта и есть сравнение. Всё остальное о Qwen 4 Max на данный момент неизвестно, и разрыв между обещанным открытым уровнем и уже поставленным — вот где это противостояние действительно может что-то сказать.

Что Kimi K3 представил в июле

Kimi K3 — это смесь экспертов с 2,8 трлн параметров, которая активирует 16 из 896 экспертов на токен, что задействует примерно 104 млрд параметров на каждом отдельном шаге. Она имеет контекстное окно размером 1 048 576 токенов как на входе, так и на выходе и принимает текст, изображения и видео на входе, выдавая текст на выходе. Тарифы её собственного API составляют $3,00 за миллион входных токенов, $15,00 за миллион выходных токенов и $0,30 за миллион кэшированных входных токенов, а тарифы сторонних поставщиков ниже этого уровня.

Архитектура — это тот аспект, который перекликается с собственным предварительным обзором Alibaba. Kimi K3 построена на Kimi Delta Attention и Attention Residuals, которые, по утверждению Moonshot, обеспечивают примерно в 2,5 раза лучшую эффективность масштабирования, чем Kimi K2, и до 6,3 раза более быстрое декодирование при контекстах в миллион токенов. Это та же проблема, на которую нацелена QSA от Qwen — сделать внимание доступным при экстремальной длине, — а значит, эти два семейства конкурируют не столько по масштабу, сколько по тому, чей дизайн разреженного внимания лучше стареет.

Результаты, опубликованные Moonshot при запуске, заявленные производителем и не воспроизведённые на тот момент:

• Artificial Analysis Intelligence Index — 57, на тот момент третье место после Claude Fable 5 и GPT-5.6 Sol. Это значение было зафиксировано в более ранней редакции индекса; с тех пор индекс дважды перестраивали, так что это исторический показатель, а не текущий

• Frontend Code Arena — первое место с 1 679 Elo, опередив обе модели, которые превзошли её по общему индексу.

• Terminal-Bench 2.1 — 88,3

• SWE-Marathon — 42, опережает Opus 4.8 и GPT-5.6 Sol

• DeepSearchQA — 0,95, первое место, и MATH-Vision 0,98, тоже первое

• GPQA-Diamond — 0.94

Собственные материалы запуска Moonshot признают, что K3 по-прежнему уступает Claude Fable 5 и GPT-5.6 Sol по общим возможностям, и это предложение полезнее любого из заявлений о первом месте, приведённых выше. Интересная особенность этих цифр в том, что модель, занявшая третье место в общем индексе, стала первой во фронтенд-коде и первой в долгосрочном поиске — профиль, который говорит о том, что агрегированный индекс скрывает специализированный инструмент, а не описывает универсальный.

A generated scoreboard titled 'Qwen 4 Max vs Kimi K3 - the scoreboard'. Left column 'Qwen 4 Max' reads announced not released, Qwen 4 27B promised, not published, not published, not published, not published. Right column 'Kimi K3' reads GA since July 16 2026, published July 27 2026, Modified MIT, $3.00 per 1M tokens, $15.00 per 1M tokens, 1,048,576 tokens. Footer reads 'Kimi K3 figures from Moonshot's launch material; Qwen 4 Max status per Alibaba's September 22 2026 Yunqi conference.'

Что пообещала Alibaba и чего стоит обещание

В анонсе Qwen 4 были названы четыре уровня. Qwen 4 Max — как флагман, Qwen 4 Flash — для пропускной способности, Qwen 4 Plus — как сбалансированный средний вариант, а Qwen 4 27B — как локальный уровень с открытыми весами. Руководитель Qwen LLM Лю Да Ичэн описал это семейство как обучаемое на архитектуре нового поколения и сказал, что оно появится в ближайшее время. Для всех четырёх нет ни даты, ни карточки модели, ни идентификатора API, ни облачного листинга, ни цены, ни опубликованной оценки.

Две конкретные вещи в этом объявлении освещаются неверно, и обе важны для всех, кто пытается планировать с учётом этого:

• Цифра в 5–10 триллионов параметров, приписываемая материалам о Qwen 4, не является характеристикой Qwen 4. Она относится к дорожной карте Qwen 4.5 и Qwen 5. Для Qwen 4 Max не публиковалось никаких данных о количестве параметров.

• То, что названия уровней сохраняются, не означает переноса характеристик. Контекстное окно, цена и лицензия Qwen 4 Max неизвестны; цифры выпускаемой Qwen3.8-Max — 1,000,000 токенов при $2.00 и $6.00 за миллион — описывают другую модель

Причина, по которой сегмент 27B интересен, не имеет ничего общего с бенчмарками. Это единственный сегмент в линейке Qwen 4, который исторически выпускался с открытыми весами, и поколение Qwen 3.8 показало, что это открывает: в течение нескольких дней после появления весов 27B сообщество создало MLX-конверсии, квантования NVFP4 и файнтюны на любой вкус. Анонсированный 27B — это обязательство перед экосистемой, которая строится на его основе, и это самая предсказуемая поставка в дорожной карте.

Но предсказуемость не обеспечена. Веса Kimi K3 — это файл, который можно скачать уже сегодня. Веса Qwen 4 27B — это строка в докладе на конференции.

Открытые веса и веса, которые можно запустить, — это разные утверждения.

Есть ловушка в том, чтобы считать Kimi K3 ответом с открытыми весами, и об этом стоит сказать прямо, потому что это самое распространённое преувеличение в освещении китайских фронтирных моделей. Смесь экспертов с 2,8 триллиона параметров — это артефакт масштаба дата-центра. Опубликованные веса означают, что вам разрешено её запускать, вы можете её проверять, дообучать и квантовать. Они не означают, что вы можете запустить её на рабочей станции. Эффективное обслуживание чекпойнта такого размера требует десятков ускорителей, а работа по квантованию, которая следует за открытым релизом, — варианты в стиле NVFP4 и REAP, которые появляются в течение нескольких недель, — в равной мере служит тому, чтобы модель можно было обслуживать, и тому, чтобы сделать её меньше.

Итак, честное прочтение лицензии Kimi K3 даёт более узкую, но по-прежнему значимую картину: это передовая модель, которую можно аудировать, модифицировать и развёртывать на собственном оборудовании, по модифицированной лицензии MIT — для организаций, располагающих оборудованием, чтобы её обслуживать. Это реальный стратегический актив — и плохой вариант для тех, кто понял «открытые веса» как «работает на моём ноутбуке».

Та же оговорка будет применима к Qwen 4 27B, если и когда он выйдет — и она применима менее остро, потому что уровень с открытыми весами на 27B действительно локального масштаба, в отличие от флагмана на 2.8T. Именно поэтому в этом сравнении уровень Qwen 4 27B заслуживает большего внимания, чем уровень Max, хотя именно с уровня Max начинался анонс.

A screenshot of the OrcaRouter model page for Kimi K3 (kimi/kimi-k3), captured September 22 2026, showing the model name, the 1M token context, text and image input with text output, vision, tool and reasoning badges, and a p50 time-to-first-token figure.

Коммерческий вопрос, стоящий за лицензионным вопросом

Собственный тариф Kimi K3 — $3,00 за вход и $15,00 за выход за миллион токенов — это премиальное позиционирование, и Moonshot прямо давала понять, что цена намеренно установлена выше дешёвого сегмента китайского рынка. На фоне Qwen3.8-Max с $2,00 и $6,00 это в полтора раза выше ставка за вход и в два с половиной раза выше ставка за выход — разрыв настолько велик, что рабочая нагрузка должна опираться на конкретные сильные стороны Kimi K3, среди которых фронтенд-код и поиск на длинном горизонте, чтобы премия была оправдана.

OrcaRouter маршрутизирует kimi/kimi-k3 наряду с семейством Qwen 3.8 через одну конечную точку, совместимую с OpenAI, с наценкой 0%, а значит, с вас списывают по прайсовой ставке поставщика, а не по эквиваленту с наценкой. В сравнении, где разница в цене на выходе составляет 2,5 раза, отсутствие маржи платформы — не деталь округления: десятипроцентная надбавка к ставке вывода $15.00 — это $1.50 за миллион токенов, что больше, чем вся стоимость ввода более дешёвой модели в этом сопоставлении. Та же конечная точка поддерживает автоматическое аварийное переключение и DSL маршрутизации для явного выражения политики — именно так вы пробуете модель с профилем Kimi K3 на части продакшн-трафика, не ставя весь маршрут на поставщика, с которым ещё не работали.

OrcaRouter не предоставляет Qwen 4 Max или какой-либо уровень Qwen 4, потому что ни один из них пока не существует как продукт.

A screenshot of the OrcaRouter models catalogue, captured September 22 2026, showing the filter sidebar (input modalities, context length, input price, status, series), the model card grid and a code sample posting to the OpenAI-compatible endpoint at api.orcarouter.ai.

За чем следить и что игнорировать

Три сигнала могли бы изменить это сравнение, и они достаточно конкретны, чтобы за ними следить:

• Веса Qwen 4 27B. Не таблица бенчмарков уровня Max — а 27B-чекпоинт, его лицензия и его размер. Именно этот релиз покажет вам, так же ли реальна приверженность Alibaba открытым весам в этом поколении, как и в предыдущем.

• Лицензия Qwen 4 Max, если таковая имеется. Если Alibaba опубликует веса для своей флагманской модели так же, как она сделала для Qwen3.8-Max, аргумент в пользу открытых весов в этом противостоянии перестанет быть преимуществом Kimi и превратится в ничью

• Свежая независимая оценка Kimi K3. Стартовые оценки Moonshot были заявлены самой компанией, а индекс Artificial Analysis с тех пор дважды перестраивался, поэтому и 57, и Elo Frontend Code Arena нужно пересчитать на новой базе, прежде чем сравнивать их с чем-либо актуальным

Игнорировать следует любую таблицу спецификаций Qwen 4 Max, которая появляется до того, как Alibaba опубликует карточку модели, и любое утверждение о том, что открытые веса Kimi K3 позволяют запускать её локально. Обе ошибки уже распространяются. Тем временем сравнение, на которое можно опираться, — это сравнение двух моделей, которые существуют: Kimi K3 по премиальной цене, с уже выпущенными весами и действительно выделяющимся профилем для кодинга, и Qwen3.8-Max при стоимости вывода менее чем в половину, с фиксированным окном в миллион токенов и собственными весами. Это реальный выбор с ценой для обоих вариантов, и он не требует ждать, пока слайд с конференции станет продуктом.

Сравнение в этой статье3

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно