
Mistral Large 4 — это превью с 1 трлн параметров: веса ещё не выложены
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 151 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 120 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 250 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Mistral Large 4 появился 6 октября 2026 года в качестве публичной предварительной версии — модель смеси экспертов с триллионом параметров, 49 миллиардами активных параметров, 1,6-миллиардным визуальным энкодером и заявлением от производителя, что это самая мощная модель с открытыми весами, созданная за пределами Китая. Чего не появилось, так это та часть, которую описывают слова «открытые веса». Сегодня нет ни контрольных точек для скачивания, ни файла лицензии, ни репозитория. Mistral говорит, что веса появятся «в конце этого месяца», после периода ред-тиминга, в течение которого проверенные партнёры и национальные органы получат разблокированную сборку со сниженной модерацией и расширенными кибервозможностями. Так что точное описание Mistral Large 4 на этой неделе — это предварительный API, который можно вызвать, и модель, которой вы пока не можете владеть.
Этот раскол — и есть суть истории, а не сноска к ней. Каждая цифра, опубликованная Mistral вместе с анонсом, — оценки по программированию, оценки по кибербезопасности, финансовые и юридические оценки — была получена на сборке, которая всё ещё изменяется, и каждый заголовок, сравнивающий новинку с закрытой фронтирной моделью, сравнивает артефакт, который не будет тем артефактом, который вы скачаете. Самое полезное, что можно сделать при таком запуске, — отделить то, что вы можете проверить сегодня, от того, что вам предлагают принять на веру, а собственный пост mistral.ai на удивление щедро разъясняет, что есть что.
Что на самом деле выходит в прямом эфире 6 октября?
Preview API доступен на Mistral Studio под идентификатором модели mistral-large-4-0. В собственной карточке модели Mistral описывает её как «передовую многоцелевую мультимодальную модель с открытыми весами», построенную на гранулярной архитектуре MoE, и раскладывает количество параметров так: 49 млрд активных при 1,05 трлн общих, плюс визуальный энкодер. Компания обучила её с нуля на 3 800 GPU NVIDIA Grace Blackwell в собственных европейских дата-центрах, и предварительная версия обслуживается на той же инфраструктуре — аргумент о суверенитете, который Mistral продвигает так же громко, как и аргумент о производительности.
Спецификация, как её излагает поставщик:
• Общее количество параметров против активных — 1,05 триллиона всего, 49 миллиардов активных на токен, разреженный MoE
• Модальности — текст и изображение на входе, текст на выходе; врождённая мультимодальность, а не прикрученный адаптер
• Контекстное окно — в документации Mistral указано 1M токенов; Artificial Analysis видит 524 288 в тестируемой им конфигурации, поэтому 1M следует считать заявленным производителем потолком, а не фактически предоставляемым окном
• Цена — $1,36 за миллион входных токенов и $4,18 за миллион выходных, при этом кэшированный ввод — $0,14, согласно опубликованной карточке Mistral
• Стартовое предложение — на той же карточке отображается акция с зачёркнутыми $0.68 / $2.09 и $0.07 за кэшированный ввод, т. е. половинная цена
• Веса — не выпущены; «до конца этого месяца», согласно объявлению
• Лицензия — не названа ни в анонсе, ни на странице документации, где запись помечена только как «Open»
Две из этих строк заслуживают того, чтобы их прочитали дважды. Контекстное окно различается в два раза в зависимости от того, читаете ли вы данные поставщика или сторонней лаборатории, что неудивительно для предварительной версии, конфигурация обслуживания которой всё ещё может меняться, но об этом стоит знать, прежде чем подбирать под неё рабочую нагрузку. А цена, которую вы заплатите, зависит от того, переживёт ли промо-тариф окно запуска; $1.36 / $4.18 — это цифра, указанная в её собственной тарифной сетке, а $0.68 / $2.18 — это цифра, которую она взимает сейчас. При расчёте счёта исходите из первого.

Показатели бенчмарков и кто их проводил
В посте Mistral осторожно подходят к вопросу происхождения данных, и эту осторожность стоит сохранить. Три из ключевых показателей агентного программирования — 61,7% в DeepSWE v1.1, 59,4% в SWE-Atlas-QnA и 28,3% в Terminal-Bench 4.0, которые в совокупности дают 49,8% в Coding Agent Index, — по словам самой Mistral, «цифры, оценённые Artificial Analysis в закрытом порядке до публичного запуска харнесса». Их пока нет в публичном индексе Artificial Analysis. Они появятся там, когда харнесс выйдет. А до тех пор это опубликованные вендором цифры, которые получила третья сторона, но ещё не опубликовала; это более надёжное происхождение, чем у большинства заявлений о запуске, и всё же не то же самое, что воспроизводимый публичный результат.

Что является публичным и независимым на сегодняшний день, если судить по странице модели Artificial Analysis от 6 октября: Mistral Large 4 Preview набирает 38.4 по Intelligence Index v4.3, затрачивая около 507 секунд на задачу, при этом Terminal-Bench 4.0 — 26.8%, а Long-Context Reasoning — 81.3%. На той же странице он указан как модель с открытыми весами, которая на самом деле открытой по весам не является — флаг гласит isOpenWeights: false с категоризацией «проприетарная», потому что существует лишь превью, обслуживаемое из собственного кластера вендора. Этот флаг — самая наглядная единичная иллюстрация разрыва, которому посвящена эта статья.

Самый цитируемый результат — тот, который Mistral не проводила сама. Surge AI, сторонняя компания по аннотации данных, провела слепую человеческую оценку качества кодирования со скрытыми идентичностями моделей, и профессиональные аннотаторы поставили Mistral Large 4 Preview 3,74 по шкале от 1 до 5 — второе место из пяти, впереди Kimi K3 с 3,59, GLM-5.3 с 3,60 и GLM-5.2 с 3,40, и позади только Claude Opus 5с 4,22. Слепая оценка людьми, когда на другой стороне — лаборатория с именем, — это иной тип доказательства, чем самостоятельно проведённый бенчмарк, и это самая сильная независимая точка данных в анонсе.
Дальше идёт кибербезопасность — здесь Mistral делает своё самое резкое заявление. По данным Cyber Index от Artificial Analysis, компания утверждает, что Mistral Large 4 входит в мировую топ-пятёрку и лидирует среди открытых моделей, разработанных за пределами Китая. В одном конкретном тесте — воспроизвести реальную уязвимость в программном обеспечении с открытым исходным кодом, а затем устранить её — она набирает 82%, что описывается как лучший результат среди всех моделей, и 93% в 40 соревновательных заданиях Cybench. Mistral добавляет язвительное замечание: несколько ведущих закрытых моделей, Claude Opus 5.5 и GPT-6 Astra названных в их числе, набирают почти ноль в том же тесте, потому что отказываются выполнять задачу. Без сторонней страницы перед глазами эти 82% — цифра от вендора; аргумент о доле отказов — интерпретация вендора. И то, и другое правдоподобно, и ни то, ни другое на сегодня независимо не подтверждено.
Почему кадрирование в предварительном просмотре меняет расчёт цены
Preview — это не просто обозначение стадии. Это означает, что модель можно перенацелить, изменить её цену или вывести из эксплуатации с меньшим предварительным уведомлением, чем для GA-релиза, а также что конфигурация обслуживания, на которой вы проводите бенчмарк, может не совпадать с конфигурацией, в которой вы развёртываете. Для решения о маршрутизации это реальная цена: конвейер, настроенный на сборке этой недели, влечёт счёт за повторную валидацию, который вы не закладывали в бюджет.
На OrcaRouter, где более 200 моделей стоят за одной совместимой с OpenAI конечной точкой по каталожной цене провайдера с 0% наценки, транслируемой напрямую, изменение цены в собственной тарифной карточке вендора — это изменение цены в нашей в тот же день, — и это здесь важно именно потому, что в этом запуске предлагаются две цены, одна из которых зачёркнута. Автоматическое переключение при сбое — вторая половина ответа для непроверенного предпросмотра: оно позволяет направить часть продакшен-трафика на Mistral Large 4, пока собственная модель держит остальное, так что предпросмотр, который деградирует под вашей реальной нагрузкой, превращается в перенаправление, а не в инцидент. Внимательным читателям не следует предполагать, что Mistral Large 4 сегодня маршрутизируется на OrcaRouter. Его нет в каталоге — предпросмотр доступен через собственный API Mistral и несколько сторонних платформ, а его веса, когда они появятся, будут предполагать самостоятельный хостинг.
Утверждение об открытых весах на данный момент — это обещание.
Формулировка Mistral состоит в том, что Mistral Large 4 «раздвигает границы производительности моделей с открытыми весами», а открытые веса — это механизм, с помощью которого предприятия сохраняют контроль над моделью. Это аргумент, который можно отстаивать применительно к модели, которую Mistral намеревается выпустить. А для модели, которую она выпустила на этой неделе, этот механизм отсутствует: нет репозитория Hugging Face, нет текста лицензии, нет загружаемого чекпойнта. Собственная организация Mistral на Hugging Face по состоянию на 6 октября не содержит ничего новее июля, а её последние записи не связаны с линейкой Large.
Это не критика плана; поэтапный выпуск весов после окна red-teaming — это последовательная политика, и Mistral говорит об этом прямо. Это предостережение по поводу прилагательного. «Open-weight» выполняет маркетинговую работу в абзаце, где до самих весов ещё четыре недели, а лицензия, которая будет ими управлять, не названа. Разрешительная лицензия и условия в стиле Apache — это один исход; лицензия только для исследований или с ограничением по выручке — другой, и в анонсе не делается выбор между ними.
Что проверить до конца октября
Пять вещей превратили бы этот предварительный просмотр в установленный факт, и каждую из них можно проверить, ничего не спрашивая у Mistral:
• Репозиторий Hugging Face в организации Mistral, содержащий чекпоинт и файл лицензии, — релиз, который Mistral обязалась выпустить в этом месяце
• Само название лицензии, которое определяет, означает ли «open weight» свободу в стиле Apache-2.0 или разрешение с ограничением использования
• Сохранится ли промо-тариф $0.68 / $2.09 или он вернётся к $1.36 / $4.18 согласно тарифной карте
• Перенесёт ли Artificial Analysis показатели по кодингу, оцениваемые в закрытом режиме, в свой публичный индекс, когда выйдет харнесс, и сохранятся ли они на тех же значениях
• Обслуживаемое окно контекста, которое в настоящее время указано поставщиком как 1M и независимой лабораторией определено как 524,288
Пока они не разрешатся, правильная позиция по отношению к Mistral Large 4 — та, к которой приглашает сам его запуск: вызовите его, измерьте на своей рабочей нагрузке и оставьте продакшен на модели, поведение которой не запланировано к изменению. Веса — это и есть событие. Превью — это трейлер.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
