Qwen 3.8 против Kimi K3: два китайских гиганта с открытыми весами — лицом к лицу
Guides & Insights

Qwen 3.8 против Kimi K3: два китайских гиганта с открытыми весами — лицом к лицу

Автор

jinhao song

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Среди всех моделей, с которыми сравнивают Qwen 3.8 Max, Kimi K3 от Moonshot — самый естественный соперник: обе модели — огромные китайские Mixture-of-Experts модели, обе относятся к классу открытых весов, обе славятся многословием, дотошностью и медлительностью. По сути, это два самых больших гиганта китайского мира открытых весов — и, что необычно, нам не нужно гадать, как они соотносятся, потому что кто-то запустил их друг против друга на одной и той же задаче. Это делает данное сравнение самым богатым в серии: не утверждения вендора против проверенных цифр, а настоящая дуэль один на один.

Прежде чем перейти к деталям, заметка для разработчиков — честный способ разрешить такое близкое соперничество — запустить обе модели на своей собственной нагрузке и оценить компромисс между тщательностью и скоростью. OrcaRouter предоставляет доступ к 200+ моделям через одну совместимую с OpenAI конечную точку, так что вы можете сравнить Qwen 3.8 против Kimi K3 на одних и тех же запросах, не настраивая два SDK.

Краткий вердикт. В единственном прямом сравнении, которое у нас есть (Trilogy AI, задача понимания архитектуры), Kimi K3 набрала 83/100, а Qwen 3.8 Max — 80/100 — узкое преимущество в 3 балла у Kimi. Но Qwen была более *тщательной*: 354 цитирования репозиториев против 274, 22 шлюзовых запроса против 53 и ноль неудачных вызовов инструментов против двух, ценой более высокой задержки и большего количества токенов. Обе достигли более 90% попадания в кэш и пришли к одному и тому же ключевому архитектурному решению. Сегодня Kimi K3 — более безопасный выбор среди моделей с открытыми весами: у неё есть проверенный результат (57.1, #3 в Artificial Analysis), корона фронтенда Arena и веса, которые, по сути, уже доступны. Qwen 3.8 — та, за которой стоит следить: больше амбиций, более исчерпывающее исследование, но без оценок на публичных досках и с весами, которые только "скоро появятся".

Основные выводы

•  Qwen 3.8 Max — это 2.4T-параметровый MoE предварительная версия; Kimi K3 — это 2.8T MoE с контекстом 1M и встроенным зрением — то есть Qwen примерно на 400B параметров меньше, напоминание о том, что большее количество параметров не означает лучше.

•  В единственном прямом тесте (Trilogy AI), Kimi K3 незначительно опередил Qwen 80 к 83 в целом — но Qwen сделал больше ссылок на репозитории (354 против 274), меньше запросов к шлюзу (22 против 53), и имел ноль неудачных вызовов инструментов (против двух).

• Kimi K3 имеет проверенный AA Intelligence Index 57.1 (#3) — уступает Fable 5 и GPT-5.6 Sol, опережая все остальное. Qwen 3.8 не имеет независимого бенчмарка вообще.

•  Kimi K3 также занимает LMArena frontend-code #1 место (1679); Qwen 3.8 еще не был оценен на публичных таблицах лидеров.

• Открытость почти на одном уровне, но сроки различаются: веса Kimi K3 открыты/обещаны и практически готовы; веса Qwen 3.8 «скоро появятся» без указания даты, лицензии или репозитория.

Показатели Qwen 3.8 — это заявления поставщиков или ранние, неконтролируемые практические впечатления — независимо не проверены. Индекс и ценовые показатели Kimi K3 приписываются Artificial Analysis и могут отличаться от собственных отчетов Moonshot. Прямое сравнение The Trilogy AI — это отдельная задача, а не полный набор тестов. Предварительная цена Qwen 3.8 — это временная скидка; проверьте ставки перед составлением бюджета.

Характеристики и цена, бок о бок

Вот объективные данные, каждая цифра о конкурентах приписана к своему источнику.

•  Производитель / статус — Qwen 3.8 Max: Alibaba; превью (19 июля 2026 г.); Kimi K3: Moonshot; релиз с открытыми весами

•  Архитектура — Qwen 3.8 Max: ~2.4T всего, разреженный MoE (активные параметры не раскрыты); Kimi K3: 2.8T MoE, нативное зрение (источник: Artificial Analysis)

•  Контекстное окно — Qwen 3.8 Max: Заявлено ~1М токенов (официально не подтверждено); Kimi K3: 1М токенов (источник: Artificial Analysis)

•  AA Intelligence Index — Qwen 3.8 Max: Пока нет — без оценки; Kimi K3: 57.1 — #3 (Artificial Analysis)

• Арена / таблица лидеров — Qwen 3.8 Max: не оценено публично; Kimi K3: Frontend-code #1, 1679 (LMArena)

• Цены (вход/выход) — Qwen 3.8 Max: только предварительный просмотр (скидка ~90%; API за токен не опубликован); Kimi K3: $3 / $15 за 1M (AA смешанный ~$2.31)

•  Открытые веса — Qwen 3.8 Max: Обещано «скоро» (не выпущено); Kimi K3: Открытый вес; веса готовы/скоро

• Скорость — Qwen 3.8 Max: Самая медленная протестированная модель (практическое испытание); Kimi K3: Многословная и медленная (~34 с TTFT, по данным AA)

Два момента определяют всё сравнение. Во-первых, пустая ячейка «AA Intelligence Index» для Qwen 3.8 — это и есть история: 57,1 балла у Kimi K3 — это вердикт нейтрального рефери, который ставит её на #3 в мире, уступая только Fable 5 и GPT-5.6 Sol; положение Qwen 3.8 держится на маркетинговых формулировках вендора и горстке практических тестов. Во-вторых, обратите внимание на инверсию размера — Qwen 3.8 (2.4T) на самом деле примерно на 400B параметров меньше чем Kimi K3 (2.8T). Модель Alibaba — это та, которую описывают как «более амбициозную по размаху», но по сырому количеству параметров Kimi — более крупный гигант, и именно у неё есть аудированный результат, чтобы это подтвердить. Обе модели известны своей многословностью и медлительностью, так что задержка примерно одинакова; настоящими различиями являются доказательства и доступность весов, и сегодня оба фактора на стороне Kimi.

Единственное настоящее очное противостояние, которое у нас есть

Это редкое противостояние, где нам не нужно строить догадки. Trilogy AI запустила обе модели на одной задаче понимания архитектуры — чтение и анализ реальной кодовой базы — и опубликовала сравнительные результаты. Kimi K3 победила по основному показателю, но поведение в деталях рассказывает более интересную историю.

• Общая оценка — Qwen 3.8 Max: 80 / 100; Kimi K3: 83 / 100

•  Цитирования репозиториев — Qwen 3.8 Max: 354; Kimi K3: 274

• Шлюзовые запросы — Qwen 3.8 Max: 22; Kimi K3: 53

• Неудачные вызовы инструментов — Qwen 3.8 Max: 0; Kimi K3: 2

• Рейтинг использования инструментов — Qwen 3.8 Max: 9 / 10; Kimi K3: 8 / 10

•  Процент попаданий в кэш — Qwen 3.8 Max: >90%; Kimi K3: >90%

Читайте столбцы, а не только верхнюю строку. Kimi K3 одержал победу с преимуществом в 3 балла, но Qwen 3.8 был более скрупулезным: он процитировал на 80 больше мест в репозитории (354 против 274), пришел к своему выводу за значительно меньше запросов к шлюзу (22 против 53), совершил ноль неудачных вызовов инструментов против двух у Kimi, и обошел Kimi по оценке использования инструментов (9 против 8). Этот компромисс — именно то, что можно ожидать от характера Qwen в других местах: он исследует исчерпывающе, что приводит к более высокой задержке и большему количеству токенов. Ключевой момент: обе модели пришли к одному и тому же основному архитектурному решению, так что это не ситуация, когда один прав, а другой нет; это Kimi получает немного более оцененный ответ быстрее, а Qwen достигает его с большим количеством доказательств и более чистой дисциплиной использования инструментов. Если ваша работа поощряет исчерпывающее, хорошо цитируемое исследование, профиль Qwen привлекателен; если вы хотите проверенный вариант с более быстрым ответом, Kimi выиграл этот раунд.

Часто задаваемые вопросы

Qwen 3.8 лучше, чем Kimi K3?

Не на основании существующих сегодня доказательств. В единственном прямом сравнении (Trilogy AI) Kimi K3 набрал 83/100 против 80/100 у Qwen, и у Kimi есть проверенный Artificial Analysis Index 57,1 (#3) плюс корона Arena по фронтенд-коду, в то время как у Qwen 3.8 вообще нет независимых оценок. Преимуществом Qwen была основательность — больше ссылок на репозитории (354 против 274), меньше шлюзовых запросов и ни одного неудачного вызова инструмента — но это стилевое преимущество, а не доказанное лидерство в возможностях.

Qwen 3.8 больше — делает ли это его лучше?

Нет, на самом деле всё наоборот по размеру: Qwen 3.8 имеет ~2,4 трлн параметров, а Kimi K3 — ~2,8 трлн, так что Kimi больше примерно на 400 млрд. Большее количество параметров не означает лучшего — Kimi и больше, и имеет более высокие оценки, что является чистым напоминанием о том, что архитектура, обучение и настройка важнее, чем сырое количество параметров.

Как сравниваются цены?

Kimi K3 — это опубликованный, долговечный $3 / $15 за 1 млн токенов (Artificial Analysis сводит это примерно к $2.31). Предварительная версия Qwen 3.8 имеет большую скидку (~90% скидки), но не имеет опубликованной цены за токен по API, и скидка временная, поэтому стабильное сравнение цен пока невозможно. Для бюджетирования сегодня Kimi — это та, у которой есть реальная цифра.

Какой вариант с открытыми весами лучше?

Обе модели относятся к классу с открытыми весами, но сроки различаются. Веса Kimi K3 открыты и по сути готовы; веса Qwen 3.8 обещают «скоро», без указания даты, лицензии или репозитория. Если открытые веса — причина вашего выбора, Kimi — тот вариант, с которым можно действовать уже сейчас.

Что мне использовать сегодня?

Kimi K3 — более безопасный выбор по умолчанию: он получил оценку (#3), веса готовы, и он победил в прямом сравнении. Обращайтесь к Qwen 3.8, когда вы цените исчерпывающее, хорошо цитируемое исследование и чистое использование инструментов выше скорости, и рассматривайте его как кандидата, за которым стоит следить, когда выйдут его веса и появится независимая оценка.

Суть

Qwen 3.8 vs Kimi K3— это самое близкое к честному бою, что есть в этой серии: два китайских открытых гиганта с открытым весом, оба многословные, оба тщательные, оба медленные. Kimi K3 выигрывает раунд сегодня, потому что он выигрывает в том, что определяет принятие — проверенное третье место в рейтинге, корону фронтенда Arena, опубликованную цену и готовые веса — и он обошёл Qwen со счётом 80 к 83 в единственном реальном сравнении один на один. Но это сравнение также показывает, почему Qwen 3.8 стоит внимания: это была более скрупулёзная модель, цитирующая больше частей кодовой базы, использующая меньше запросов и не совершившая ни одного неудачного вызова инструментов. Если ваша работа вознаграждает исчерпывающее исследование, и если Alibaba выпустит веса, а независимая оценка окажется рядом с вершиной, это соперничество может перевернуться. До тех пор Kimi K3 — более безопасный выбор среди открытых весов, а Qwen 3.8 — претендент, который стоит протестировать на своих собственных промптах.


© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

Свяжитесь с нами

Присоединяйтесь к сообществу

DiscordEmailXGitHubYouTube