Сгенерированная титульная карточка для статьи «Mistral Large 4 — это превью с 1 трлн параметров», на которой заголовок изображён жирным геометрическим шрифтом без засечек, подзаголовок «Веса ещё не выложены» — под ним, а выше — ряд из трёх плоских линейных иконок: закрытый навесной замок, неактивная стрелка загрузки и щит, — на белом фоне с сине-голубыми градиентными акцентами и логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

Mistral Large 4 — это превью с 1 трлн параметров: веса ещё не выложены

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Mistral Large 4 появился 6 октября 2026 года в качестве публичной предварительной версии — модель смеси экспертов с триллионом параметров, 49 миллиардами активных параметров, 1,6-миллиардным визуальным энкодером и заявлением от производителя, что это самая мощная модель с открытыми весами, созданная за пределами Китая. Чего не появилось, так это та часть, которую описывают слова «открытые веса». Сегодня нет ни контрольных точек для скачивания, ни файла лицензии, ни репозитория. Mistral говорит, что веса появятся «в конце этого месяца», после периода ред-тиминга, в течение которого проверенные партнёры и национальные органы получат разблокированную сборку со сниженной модерацией и расширенными кибервозможностями. Так что точное описание Mistral Large 4 на этой неделе — это предварительный API, который можно вызвать, и модель, которой вы пока не можете владеть.

Этот раскол — и есть суть истории, а не сноска к ней. Каждая цифра, опубликованная Mistral вместе с анонсом, — оценки по программированию, оценки по кибербезопасности, финансовые и юридические оценки — была получена на сборке, которая всё ещё изменяется, и каждый заголовок, сравнивающий новинку с закрытой фронтирной моделью, сравнивает артефакт, который не будет тем артефактом, который вы скачаете. Самое полезное, что можно сделать при таком запуске, — отделить то, что вы можете проверить сегодня, от того, что вам предлагают принять на веру, а собственный пост mistral.ai на удивление щедро разъясняет, что есть что.

Что на самом деле выходит в прямом эфире 6 октября?

Preview API доступен на Mistral Studio под идентификатором модели mistral-large-4-0. В собственной карточке модели Mistral описывает её как «передовую многоцелевую мультимодальную модель с открытыми весами», построенную на гранулярной архитектуре MoE, и раскладывает количество параметров так: 49 млрд активных при 1,05 трлн общих, плюс визуальный энкодер. Компания обучила её с нуля на 3 800 GPU NVIDIA Grace Blackwell в собственных европейских дата-центрах, и предварительная версия обслуживается на той же инфраструктуре — аргумент о суверенитете, который Mistral продвигает так же громко, как и аргумент о производительности.

Спецификация, как её излагает поставщик:

• Общее количество параметров против активных — 1,05 триллиона всего, 49 миллиардов активных на токен, разреженный MoE

• Модальности — текст и изображение на входе, текст на выходе; врождённая мультимодальность, а не прикрученный адаптер

• Контекстное окно — в документации Mistral указано 1M токенов; Artificial Analysis видит 524 288 в тестируемой им конфигурации, поэтому 1M следует считать заявленным производителем потолком, а не фактически предоставляемым окном

• Цена — $1,36 за миллион входных токенов и $4,18 за миллион выходных, при этом кэшированный ввод — $0,14, согласно опубликованной карточке Mistral

• Стартовое предложение — на той же карточке отображается акция с зачёркнутыми $0.68 / $2.09 и $0.07 за кэшированный ввод, т. е. половинная цена

• Веса — не выпущены; «до конца этого месяца», согласно объявлению

• Лицензия — не названа ни в анонсе, ни на странице документации, где запись помечена только как «Open»

Две из этих строк заслуживают того, чтобы их прочитали дважды. Контекстное окно различается в два раза в зависимости от того, читаете ли вы данные поставщика или сторонней лаборатории, что неудивительно для предварительной версии, конфигурация обслуживания которой всё ещё может меняться, но об этом стоит знать, прежде чем подбирать под неё рабочую нагрузку. А цена, которую вы заплатите, зависит от того, переживёт ли промо-тариф окно запуска; $1.36 / $4.18 — это цифра, указанная в её собственной тарифной сетке, а $0.68 / $2.18 — это цифра, которую она взимает сейчас. При расчёте счёта исходите из первого.

A generated single-column scoreboard titled 'Mistral Large 4 Preview — the scoreboard', listing the API id mistral-large-4-0 and rows: Intelligence Index v4.3 38.4; cost per index task $1.13; Terminal-Bench 4.0 26.8%; Humanity's Last Exam 35.0%; MMMU-Pro 76.4%; context 1M stated by the vendor against 524,288 tested; input $1.36 now $0.68; output $4.18 now $2.09; cached input $0.14 now $0.07; weights promised end of October; licence unnamed; announced 6 October 2026. The footer reads that index and per-task figures are per Artificial Analysis Intelligence Index v4.3 read 6 October 2026, prices are per the vendor's own rate card, and AA still flags the model isOpenWeights: false.

Показатели бенчмарков и кто их проводил

В посте Mistral осторожно подходят к вопросу происхождения данных, и эту осторожность стоит сохранить. Три из ключевых показателей агентного программирования — 61,7% в DeepSWE v1.1, 59,4% в SWE-Atlas-QnA и 28,3% в Terminal-Bench 4.0, которые в совокупности дают 49,8% в Coding Agent Index, — по словам самой Mistral, «цифры, оценённые Artificial Analysis в закрытом порядке до публичного запуска харнесса». Их пока нет в публичном индексе Artificial Analysis. Они появятся там, когда харнесс выйдет. А до тех пор это опубликованные вендором цифры, которые получила третья сторона, но ещё не опубликовала; это более надёжное происхождение, чем у большинства заявлений о запуске, и всё же не то же самое, что воспроизводимый публичный результат.

A screenshot of Mistral's own documentation, the Models Overview page at docs.mistral.ai, showing the GENERALIST MODELS card grid in which 'Mistral Large 4' is listed with a version tag of v26.10 and the description 'A state-of-the-art, open-weight, general-purpose multimodal model' — the description Mistral Large 3 beside it shares, while only Large 3 carries an APACHE 2.0 licence badge. Mistral Small 4, Mistral Medium 3.5, Z.ai GLM 5.3 and the Ministral 3 sizes are also visible, and the OCR MODELS section begins below.

Что является публичным и независимым на сегодняшний день, если судить по странице модели Artificial Analysis от 6 октября: Mistral Large 4 Preview набирает 38.4 по Intelligence Index v4.3, затрачивая около 507 секунд на задачу, при этом Terminal-Bench 4.0 — 26.8%, а Long-Context Reasoning — 81.3%. На той же странице он указан как модель с открытыми весами, которая на самом деле открытой по весам не является — флаг гласит isOpenWeights: false с категоризацией «проприетарная», потому что существует лишь превью, обслуживаемое из собственного кластера вендора. Этот флаг — самая наглядная единичная иллюстрация разрыва, которому посвящена эта статья.

A screenshot of the Artificial Analysis model page for Mistral Large 4 Preview, showing the header describing it as a proprietary model released October 2026, percentile ranks of #64 of 225 for intelligence, #51 for speed, #56 for cost and #105 for verbosity, pricing of $1.36 in and $4.18 out with a 90% cache discount, an Intelligence Index of 38, a cost-per-task figure of $1.13, and a summary paragraph noting a 524k-token context window, text and image input, and roughly 200M tokens generated during the index run.

Самый цитируемый результат — тот, который Mistral не проводила сама. Surge AI, сторонняя компания по аннотации данных, провела слепую человеческую оценку качества кодирования со скрытыми идентичностями моделей, и профессиональные аннотаторы поставили Mistral Large 4 Preview 3,74 по шкале от 1 до 5 — второе место из пяти, впереди Kimi K3 с 3,59, GLM-5.3 с 3,60 и GLM-5.2 с 3,40, и позади только Claude Opus 5с 4,22. Слепая оценка людьми, когда на другой стороне — лаборатория с именем, — это иной тип доказательства, чем самостоятельно проведённый бенчмарк, и это самая сильная независимая точка данных в анонсе.

Дальше идёт кибербезопасность — здесь Mistral делает своё самое резкое заявление. По данным Cyber Index от Artificial Analysis, компания утверждает, что Mistral Large 4 входит в мировую топ-пятёрку и лидирует среди открытых моделей, разработанных за пределами Китая. В одном конкретном тесте — воспроизвести реальную уязвимость в программном обеспечении с открытым исходным кодом, а затем устранить её — она набирает 82%, что описывается как лучший результат среди всех моделей, и 93% в 40 соревновательных заданиях Cybench. Mistral добавляет язвительное замечание: несколько ведущих закрытых моделей, Claude Opus 5.5 и GPT-6 Astra названных в их числе, набирают почти ноль в том же тесте, потому что отказываются выполнять задачу. Без сторонней страницы перед глазами эти 82% — цифра от вендора; аргумент о доле отказов — интерпретация вендора. И то, и другое правдоподобно, и ни то, ни другое на сегодня независимо не подтверждено.

Почему кадрирование в предварительном просмотре меняет расчёт цены

Preview — это не просто обозначение стадии. Это означает, что модель можно перенацелить, изменить её цену или вывести из эксплуатации с меньшим предварительным уведомлением, чем для GA-релиза, а также что конфигурация обслуживания, на которой вы проводите бенчмарк, может не совпадать с конфигурацией, в которой вы развёртываете. Для решения о маршрутизации это реальная цена: конвейер, настроенный на сборке этой недели, влечёт счёт за повторную валидацию, который вы не закладывали в бюджет.

На OrcaRouter, где более 200 моделей стоят за одной совместимой с OpenAI конечной точкой по каталожной цене провайдера с 0% наценки, транслируемой напрямую, изменение цены в собственной тарифной карточке вендора — это изменение цены в нашей в тот же день, — и это здесь важно именно потому, что в этом запуске предлагаются две цены, одна из которых зачёркнута. Автоматическое переключение при сбое — вторая половина ответа для непроверенного предпросмотра: оно позволяет направить часть продакшен-трафика на Mistral Large 4, пока собственная модель держит остальное, так что предпросмотр, который деградирует под вашей реальной нагрузкой, превращается в перенаправление, а не в инцидент. Внимательным читателям не следует предполагать, что Mistral Large 4 сегодня маршрутизируется на OrcaRouter. Его нет в каталоге — предпросмотр доступен через собственный API Mistral и несколько сторонних платформ, а его веса, когда они появятся, будут предполагать самостоятельный хостинг.

Утверждение об открытых весах на данный момент — это обещание.

Формулировка Mistral состоит в том, что Mistral Large 4 «раздвигает границы производительности моделей с открытыми весами», а открытые веса — это механизм, с помощью которого предприятия сохраняют контроль над моделью. Это аргумент, который можно отстаивать применительно к модели, которую Mistral намеревается выпустить. А для модели, которую она выпустила на этой неделе, этот механизм отсутствует: нет репозитория Hugging Face, нет текста лицензии, нет загружаемого чекпойнта. Собственная организация Mistral на Hugging Face по состоянию на 6 октября не содержит ничего новее июля, а её последние записи не связаны с линейкой Large.

Это не критика плана; поэтапный выпуск весов после окна red-teaming — это последовательная политика, и Mistral говорит об этом прямо. Это предостережение по поводу прилагательного. «Open-weight» выполняет маркетинговую работу в абзаце, где до самих весов ещё четыре недели, а лицензия, которая будет ими управлять, не названа. Разрешительная лицензия и условия в стиле Apache — это один исход; лицензия только для исследований или с ограничением по выручке — другой, и в анонсе не делается выбор между ними.

Что проверить до конца октября

Пять вещей превратили бы этот предварительный просмотр в установленный факт, и каждую из них можно проверить, ничего не спрашивая у Mistral:

• Репозиторий Hugging Face в организации Mistral, содержащий чекпоинт и файл лицензии, — релиз, который Mistral обязалась выпустить в этом месяце

• Само название лицензии, которое определяет, означает ли «open weight» свободу в стиле Apache-2.0 или разрешение с ограничением использования

• Сохранится ли промо-тариф $0.68 / $2.09 или он вернётся к $1.36 / $4.18 согласно тарифной карте

• Перенесёт ли Artificial Analysis показатели по кодингу, оцениваемые в закрытом режиме, в свой публичный индекс, когда выйдет харнесс, и сохранятся ли они на тех же значениях

• Обслуживаемое окно контекста, которое в настоящее время указано поставщиком как 1M и независимой лабораторией определено как 524,288

Пока они не разрешатся, правильная позиция по отношению к Mistral Large 4 — та, к которой приглашает сам его запуск: вызовите его, измерьте на своей рабочей нагрузке и оставьте продакшен на модели, поведение которой не запланировано к изменению. Веса — это и есть событие. Превью — это трейлер.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно