Сгенерированная главная карточка, сравнивающая Intern-S2-397B и Kimi K3, показывающая слева страницу научной литературы с молекулярной диаграммой, подающей карточку с открытыми весами на 403 миллиарда параметров, а справа длинную ленту документа, подающую флагманскую модель на 2,8 триллиона параметров с индикатором контекста 1M, с логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

Intern-S2-397B против Kimi K3: научная модель на 397B и гигант рассуждений на 2,8T

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Intern-S2-397B и Kimi K3 находятся по разные стороны линии открытых весов, которая определит остаток 2026 года: скачиваемый научный специалист против независимо проверенного универсала с длинным контекстом. Intern-S2-397B — это научная мультимодальная модель с 403 миллиардами параметров, которую InternLM выпустила под лицензией Apache-2.0 13 сентября 2026 года: без прайс-листа, без независимой оценки и с визуальным трактом, обученным на необработанных страницах научной литературы. Kimi K3 — флагманская модель Moonshot AI с 2,8 триллиона параметров на основе смеси экспертов, запущенная в июле 2026 года по цене 3,00 доллара за миллион входных токенов и 15,00 доллара за миллион выходных токенов, открывшая свои веса 27 июля под лицензией Modified MIT и прошедшая шесть недель независимой оценки. Необычность этого противостояния в том, что у обеих моделей одна и та же долгосрочная амбиция — продолжать работать над большой, запутанной задачей — и они движутся к ней в противоположных направлениях.

Оба амбициозны, но механизмы противоположны

Амбиция общая: каждая модель хочет быть тем, что продолжает работать, когда задача длится долго. Они достигают этого по-разному, и различие архитектурное.

Ответ Kimi K3 — это контекст. Окно в 1 048 576 токенов как на входе, так и на выходе означает, что целый репозиторий, целый дата-рум или агентный цикл из пятидесяти шагов может уместиться в одном разговоре. Стек инференса Mooncake от Moonshot, как сообщается, поддерживает долю попаданий в кэш выше 90% на нагрузках, связанных с программированием, — именно поэтому цена в $15 за миллион выходных токенов становится жизнеспособной на практике. Kimi K3 предоставляет управление reasoning_effort верхнего уровня и не принимает параметры сэмплирования, по умолчанию выполняет рассуждения на максимальной глубине и ожидает, что вы будете дословно воспроизводить предыдущие reasoning_content и tool_calls в многоходовых циклах вызова инструментов, иначе качество ухудшится.

Ответ Intern-S2-397B — это специализация плюс управление на уровне весов. Его контекст — 256K для текстовых рассуждений и 64K для мультимодальных данных, обе цифры из карточки модели — это окно другой категории: его достаточно для солидной статьи или долгой исследовательской сессии, но не для рабочего набора объёмом в миллион токенов. Вместо этого он предлагает визуальный контур, который нативно читает научную литературу — рисунки, вёрстку, символьные обозначения и прозу вместе, — а также вход для временных рядов, дающий прогнозы, наряду с размышлением, которое включено по умолчанию и переключается для каждого запроса. Если ваша длинная задача — научная, модель обучалась именно для этого; если ваша длинная задача — это кодовая база, то это не та модель, у которой есть окно в миллион токенов для неё.

• Контекст — Kimi K3: 1 048 576 токенов на входе и выходе против Intern-S2-397B: 256K текста / 64K мультимодальных.

• Масштаб — Kimi K3: 2,8 трлн всего, ~104 млрд активных на токен против Intern-S2-397B: 403 млрд всего, 512 экспертов / 10 активных.

• Интерфейс управления — Kimi K3: регулятор reasoning_effort, без параметров сэмплирования, против Intern-S2-397B: переключатель enable_thinking плюс полный контроль на уровне весов под Apache-2.0.

• Входные данные — Kimi K3: текст, изображение против Intern-S2-397B: текст, изображение, временные ряды.

• Веса — Kimi K3: открыты под лицензией Modified MIT (27 июля) против Intern-S2-397B: открыты под лицензией Apache-2.0 (13 сентября).

• Независимые данные — Kimi K3: шесть недель оценок от третьих сторон против Intern-S2-397B: пока нет.

Асимметрия доказательств — вот в чём настоящая разница.

Kimi K3 прошёл через независимую проверку и вышел с показателями, на которые можно опереться. Artificial Analysis ставит его в середине 40-х в текущем Intelligence Index, с GPQA Diamond в начале 90-х, HLE в середине 40-х, независимо измеренным долгоконтекстным воспроизведением 88.7 и оценкой по программированию в середине 70-х. Он занимает первое место на Frontend Code Arena (Elo в 1670-х) и показал 91.2 в BrowseComp — самый высокий показатель в этом бенчмарке по долгосрочному извлечению, — хотя сама Moonshot предупреждает, что K3 «всё ещё уступает самым мощным проприетарным моделям», и несколько его строк на день запуска остаются заявленными производителем.

Доказательная база Intern-S2-397B — это его собственная таблица запуска, прогнанная через OpenCompass, VLMEvalKit и AgentCompass и опубликованная за несколько часов до того, как вы это прочитали. Каждое число принадлежит самому вендору и не воспроизведено: MMLU Pro 89.77, MMMU Pro 81.68, HMMT-2026 93.56, SWE-bench-Pro 68.54 и TerminalBench 2.1 — 64.04, причём, как показывает карточка, этот результат с большим отрывом проигрывает более старому закрытому поколению. Его строки по научным бенчмаркам — это числа, которые и создают аргумент в пользу специалиста: 55.71 на Biology-Instructions, 63.28 на SciReasoner 1.5, 53.95 на Mol-Instructions, 62.35 на MolecularIQ. Эти две доказательные базы не соприкасаются, поэтому честная формулировка этого противостояния — не «кто побеждает», а «какой тип доказательств нужен вашей рабочей нагрузке».

A generated two-column scoreboard titled 'Intern-S2-397B vs Kimi K3 — the scoreboard.' Left column 'Intern-S2-397B': Weights Apache-2.0 open; Scale 403B total MoE; Context 256K text / 64K multimodal; Inputs text, image, time series; Independent score none yet; Biology-Instructions 55.71 vendor-reported. Right column 'Kimi K3': Weights Modified MIT open; Scale 2.8T total, ~104B active; Context 1M tokens in and out; Inputs text, image; Independent score AA Index mid-40s, long-context recall 88.7; Price .00 / 5.00 per 1M. Footer reads 'Intern-S2-397B figures are InternLM's own, unreproduced; Kimi K3 figures per Artificial Analysis and Moonshot AI.'

Сколько каждый стоит: версия с открытыми весами

Обе модели имеют открытые веса, что превращает вопрос стоимости из обычной истории противостояния оплаты по счётчику и бесплатного доступа в сравнение двух предложений по хостингу. У Kimi K3 опубликована цена API — $3.00 / $15.00 за миллион токенов по прайс-листу Moonshot, передаваемая через OrcaRouter с наценкой 0%, плюс тарификация за чтение из кэша, — и её также можно скачать: релиз с открытыми весами из 96 шардов, для обслуживания которого требуется оборудование класса суперузла, 64 или более ускорителей. Практическая аудитория для самостоятельно размещаемой K3 — команды с бюджетами на дата-центры. У Intern-S2-397B вообще нет опубликованной цены API; карточка модели указывает на официальный Intern API, а реальная экономика — это самостоятельный хостинг: примерно 807 ГБ весов на 188 шардах в BF16, серьёзный узел с несколькими GPU, при этом сборка FP8 сокращает занимаемый объём примерно вдвое.

Обе модели доступны через один и тот же интерфейс, если настроить маршрутизацию: Kimi K3 доступна на OrcaRouter по прайс-листовой цене Moonshot с нулевой наценкой, а Intern-S2-397B не маршрутизируется — это совершенно новый чекпойнт под Apache-2.0, а путь к нему — собственный API вендора или развёртывание на своём оборудовании. Ценность маршрутизации в этом противостоянии состоит в том, чтобы удерживать трафик универсальных длинноконтекстных задач на ключе, который у вас уже есть, а научную пакетную работу — на модели, которую вы запускаете, с автоматическим переключением при сбое между ними. DSL превращает эту границу в конфигурацию, а не во вторую интеграцию.

A screenshot of the Hugging Face model card for internlm/Intern-S2, captured September 13, 2026, showing the Apache-2.0 licence, the description of Intern-S2-397B as a 403-billion-parameter multimodal foundation model for scientific intelligence and long-horizon agents, and the note that text reasoning benchmarks use a 256K inference length while multimodal benchmarks use 64K.

Вердикт

Выбирайте Kimi K3, когда задача — это универсальная работа с длинным контекстом: программирование целых репозиториев, длительные циклы агентов, интеллектуальная работа, требующая миллиона токенов рабочей памяти, — и вы хотите, чтобы за этим стояла независимая система оценки. Это модель с более сильной доказательной базой во всех смыслах, её открытые веса реальны (Modified MIT, 27 июля), и если вы уже эксплуатируете инфраструктуру класса суперузла, экономика затрат на токен с кэшированием благоприятна.

Выбирайте Intern-S2-397B, когда задача научная: статьи с обилием иллюстраций, молекулярные диаграммы, отсканированная литература, сигналы временных рядов и данные, которые должны оставаться внутри вашего периметра, или веса, которые вы хотите дообучить на проприетарных результатах. Apache-2.0 делает это возможным, а никакой арендуемый API — нет, и научные строки в карточке — это совсем другой вид, нежели то, для чего когда-либо настраивали универсальную модель. Заложите бюджет на оборудование, проведите собственную оценку и относитесь к каждому опубликованному числу о ней как к заявлению, пока кто-нибудь за пределами InternLM не воспроизведёт хотя бы одно.

A screenshot of the OrcaRouter model page for Kimi K3 at orcarouter.ai/models/kimi/kimi-k3, captured September 13, 2026, showing the model listing with its provider MoonshotAI, 1,048,576-token context window, and .00 / 5.00 per-million-token pricing displayed alongside the surrounding catalogue.