
GPT-6 Sol против Kimi K3: три предположения об открытых весах, проверенные на одном счёте
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Покупка открытых весов обычно — это ставка на три вещи: что они будут дешевле, что они дают вам контроль и что они страхуют от того, что поставщик передумает. Kimi K3, модель с 2,8 трлн параметров, которую Moonshot AI выпустила под открытыми весами 27 июля 2026 года, и GPT-6 Sol, закрытая модель, выпущенная 22 сентября 2026 года, представляют собой чистый тестовый пример для всех трёх, потому что эти две модели достаточно близки в нейтральном лидерборде, так что предположениям приходится самим нести всю тяжесть аргумента.
Вот как они показывают себя. K3 не дешевле в расчёте на задачу — он примерно вдвое дороже: $3.00 и $15.00 за миллион токенов против $2.00 и $10.00 у Sol. Контроль реален, но имеет аппаратный порог, который большинство команд не переступит. А страховка — это единственное допущение, которое полностью подтверждается, что делает её единственной, за которую стоит платить. Далее — арифметика, стоящая за каждым из них.
Две модели, вкратце
Kimi K3 — это разреженная модель смеси экспертов с 2,8 трлн общих параметров и примерно 104 млрд — около 3,7% — активных параметров на токен, опубликованная под лицензией Modified MIT с контекстным окном в 1 048 576 токенов. Архитектурные заявления Moonshot конкретны: Kimi Delta Attention — гибридная схема линейного внимания, которая, по словам компании, до 6,3× быстрее при декодировании в длинном контексте, а также Attention Residuals и фреймворк Stable LatentMoE. На вход она принимает текст и изображение, на выходе возвращает текст. Размер недистиллированной модели превышает 1 ТБ, а продакшн-развёртывание описывается через минимальный порог в 64 ускорителя.
GPT-6 Sol — закрытая, с единым идентификатором, по фиксированной цене $2.00 и $10.00, с $0.20 за кэшированное чтение и $2.50 за запись в кэш; при этом весь запрос свыше 272 000 входных токенов переоценивается в $4.00 и $15.00. На входе — текст и изображения, на выходе — текст, с окном в 1 050 000 токенов, максимальным входом в 922 000 токенов, потолком выхода в 128 000 токенов и датой отсечки знаний 20 апреля 2026 года.
Окна контекста практически совпадают по размеру — разница составляет 0,1 %. Это устраняет самую распространённую причину предпочесть одно из них, а значит, решение полностью зависит от трёх допущений.
Допущение первое: открытые веса дешевле. Это не так.
• Ввод — GPT-6 Sol $2.00 за миллион токенов против Kimi K3 $3.00 за миллион токенов
• Вывод — GPT-6 Sol $10.00 за миллион токенов против Kimi K3 $15.00 за миллион токенов
• Кэшированный ввод — GPT-6 Sol $0,20 за миллион токенов против Kimi K3 $0,30 за миллион токенов; оба составляют одну десятую от ставки за некэшированный ввод
• Индекс интеллекта, независимый — GPT-6 Sol 48 при максимальном усилии против Kimi K3 44 при максимальном усилии
• Стоимость за задачу Index, независимо — GPT-6 Sol $1,06 против Kimi K3 $2,00
• Токены вывода для прогона индекса — GPT-6 Sol 77M vs Kimi K3 160M
• Контекстное окно — 1 050 000 токенов у GPT-6 Sol против 1 048 576 токенов у Kimi K3
• Веса — закрытые у GPT-6 Sol против открытых у Kimi K3, доступных для скачивания и самостоятельного хостинга
• Лицензия — GPT-6 Sol не применимо vs Kimi K3 Modified MIT
• Всего параметров — у GPT-6 Sol не раскрыто против 2 800 миллиардов у Kimi K3, из которых 104 миллиарда активны на каждый токен
Sol дешевле по каждой строке тарифной сетки, и разрыв особенно велик именно там, где агентные нагрузки тратят свои деньги. Независимый совет согласен и в направлении, и примерно в масштабе: Sol стоит примерно вдвое меньше за выполненную задачу, при этом на четыре пункта индекса выше. K3 сгенерировал чуть более чем вдвое больше выходных токенов, чтобы выполнить тот же индекс.
Одна деталь не позволяет считать это разгромом. Moonshot утверждает, что K3 выдаёт на 21% меньше выходных токенов, чем его предшественник, а архитектурные наработки — схема внимания, дизайн остаточных связей — нацелены непосредственно на стоимость декодирования в длинном контексте. На нагрузке, где преобладают очень длинные входные данные, эффективные решения K3 могут сократить часть разрыва, который показывает прогон по индексу. Никто не публиковал это измерение на сопоставимом тестовом стенде, так что считайте это заявлением вендора с правдоподобным механизмом, а не результатом.


Допущение второе: открытые веса дают вам контроль. Вплоть до аппаратного минимума.
Контроль здесь подлинный, и об этом стоит сказать точно, потому что «открытые веса» часто употребляют вольно. Модифицированная лицензия MIT на скачиваемый чекпоинт означает, что вы можете запускать модель на собственном оборудовании, дообучать её, закреплять конкретную ревизию и держать инференс в контролируемых вами границах. Ничего из этого недоступно с GPT-6 Sol ни за какие деньги.
Это не означает, что самостоятельный хостинг заменяет API с точки зрения затрат. Опубликованные цифры оценивают чекпойнт полной точности примерно в 4,9 ТБ, или около 397 ГБ при 1-битной квантизации, с минимальным порогом развёртывания около 410 ГБ совокупной памяти, а промышленные развёртывания описываются в расчёте на 64 ускорителя. Команда, уже эксплуатирующая кластер такого класса, имеет здесь реальную возможность. Команда, у которой его нет, сравнивает счёт за API с капитальной закупкой, и счёт за API выигрывает с большим отрывом.
Честная версия аргумента о контроле уже, чем её обычно излагают: открытые веса дают вам возможность уйти, а не возможность дёшево запускать. Это разные вещи, и только одна из них доступна большинству команд.
Предположение третье: открытые веса — это страховка. Это предположение верно.
Третье допущение выдерживает все приведённые выше цифры, и именно поэтому у K3 вообще есть рынок. Moonshot может быть приобретён, может изменить лицензию для будущих версий, может объявить K3 устаревшим, может поднять цену, может приостановить подписки — и он действительно приостановил новые подписки в течение 48 часов после выпуска, чтобы защитить качество обслуживания существующих платящих клиентов; это наглядная демонстрация того, что доступ к API — это вопрос политики, а не свойство.
Если K3 признан устаревшим, веса, которые вы скачали, всё равно будут работать. Если Moonshot втрое повысит цену API, ваше развёртывание на собственной инфраструктуре останется незатронутым. Если вам нужно продемонстрировать аудитору, что ваш стек инференса зафиксирован на известной ревизии, чекпойнт даёт вам это, а API — нет. Ничего из этого не отображается в таблице затрат на задачу, и всё это реально.
Вопрос в том, чего это стоит. Судя по приведённым выше цифрам, за эту страховку вы платите примерно вдвое больше за каждую выполненную задачу, плюс четыре индексных пункта возможностей. Для рабочей нагрузки, где прекращение поддержки API равносильно перебою в бизнесе, это дёшево. Для рабочей нагрузки, где вы просто переключились бы на другую модель, это премия за хедж, которым вы никогда не воспользуетесь.
Оба на одной клавише, если вы этого хотите.

Kimi K3 присутствует в каталоге OrcaRouter по цене из прайс-листа Moonshot, в рамках модели сквозного переноса цен, при которой изменение тарифа Moonshot вступает в силу на нашей стороне в тот же день, а не после того, как реселлер пересмотрит условия. GPT-6 Sol на момент написания этого текста отсутствует в нашем каталоге, и доступ к нему можно получить через собственный API OpenAI.
Такое сочетание значит для этого конкретного решения больше, чем кажется, потому что эти две модели относятся к разным типам отказов. Причина запускать K3 не в том, что это дешевле — это не так, — а в том, что это хедж, а хедж, на который нельзя быстро переключиться, немногого стоит. Держать K3 за тем же эндпоинтом, что и всё остальное, с автоматическим переключением при отказе и правилом маршрутизации, которое можно изменить в конфигурации, — именно это превращает «у нас есть резервный вариант с открытыми весами» из слайда в презентации в то, что работает в 3 часа ночи.
Для чего каждый из них на самом деле нужен
• Если вам нужна самая низкая стоимость за выполненную задачу в общих рабочих задачах — GPT-6 Sol, и разрыв составляет около 2×.
• Если вам нужны максимальные возможности на нейтральном табло среди этих двух — GPT-6 Sol с отрывом в четыре балла.
• Если вы уже эксплуатируете кластер класса памяти 400 ГБ+ и вам нужен инференс в пределах собственного периметра — K3, и вся логика расчёта кардинально меняется, потому что предельная стоимость весов не равна стоимости аппаратного обеспечения.
• Если ваше настоящее требование состоит в том, чтобы вашу модель нельзя было у вас отнять — K3, и это единственный аргумент в сравнении, на который Sol не может ответить.
• Если вы выбираете по цене за токен, потому что K3 выглядит как более дешёвая китайская модель, — сначала проверьте количество токенов. При 160 миллионах выходных токенов для прогона индекса против 77 миллионов у Sol более низкая ставка означает покупку большего числа токенов, а не меньший счёт.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
