Сгенерированная заглавная карточка под названием MiniMax M3.1 Flash Preview с подзаголовком «Доступно в Token Plan, 27 сентября 2026». Три чипа гласят: «контекст 1M токенов», «текст + изображение + видео на входе» и «только Token Plan — без оплаты по мере использования». Левая карточка гласит: «Подтверждено поставщиком: тот же Subscription Key, что у M3 и M2.7, размышление включено по умолчанию, усилие от низкого до максимального»; правая карточка гласит: «Не опубликовано: цена за токен, карточка модели, бенчмарки, веса, независимые измерения». Логотип OrcaRouter расположен в правом нижнем углу.
Guides & Insights

MiniMax M3.1 Flash Preview уже доступна в плане Token Plan: что на самом деле открывает ваша подписка

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

MiniMax-M3.1-Flash-Preview вышел 27 сентября 2026 года, и то, как он вышел, — это отдельная история. Это не модель с оплатой по мере использования. Поставщик поместил свою новейшую текстовую модель за тот же Token Plan Subscription Key, который уже покрывает MiniMax-M3, MiniMax M2.7 и вариант M2.7-highspeed, так что если у вас есть место, не нужно выпускать новый ключ и не нужно подписывать второй контракт. Чего также нет на сегодняшний день, так это цены за токен, карточки модели, опубликованного бенчмарка или какого-либо способа отключить мышление модели.

Такая комбинация — беспрепятственный доступ в сочетании с полностью нераскрытыми экономическими условиями — достаточно необычна, чтобы её стоило разобрать, прежде чем кто-либо подключит к ней продакшн-пайплайн. Остальная часть этого материала — это то, что на самом деле говорится в собственной документации вендора, то, о чём она демонстративно умалчивает, и одна строка кода, которая в течение минуты скажет вам, соответствует ли эта модель тому, как вы работаете.

Что на самом деле приземлилось 27 сентября?

В документации для разработчиков MiniMax теперь есть постоянное примечание, повторяющееся на каждой странице текстовых моделей: MiniMax-M3.1-Flash-Preview пока доступна только через Token Plan и MiniMax Code. Модель указана первой в собственной таблице моделей вендора, выше MiniMax-M3, и описана как передовая мультимодальная модель для программирования с контекстным окном 1M и настраиваемой глубиной рассуждений.

• Контекстное окно — 1 000 000 токенов, такой же потолок, как у MiniMax-M3
• Входные модальности — текст, изображение и видео; на выходе — текст
• Глубина мышления — настройка усилия, принимающая уровни: низкий, средний, высокий, очень высокий и максимальный, по умолчанию максимальный, если не указана
• Поддержка протоколов — один и тот же идентификатор модели работает через Anthropic-совместимый эндпоинт MiniMax, её OpenAI-совместимый эндпоинт и её эндпоинт OpenAI Responses
• Доступность — только Token Plan и MiniMax Code; недоступна при оплате по мере использования
• Цена — тариф за токен нигде не опубликован
• Веса — отсутствуют; два самых последних публичных репозитория организации MiniMaxAI остаются MiniMax-Music3 и MiniMax-H3
• Независимые бенчмарки — отсутствуют; модель не представлена в индексе моделей Artificial Analysis

Компания анонсировала её в тот же день в своём аккаунте MiniMaxAgent, позиционируя для повседневной разработки, а не для передовых задач: быстрая и надёжная — от оперативных исправлений ошибок до полноценной реализации функций. Это задача уровня Flash, а не флагмана. Сторонние новостные публикации от PANews и KuCoin описали её в тех же выражениях и отметили, что разработчики заметили модель в селекторе MiniMax Code ещё до того, как компания подтвердила это.

A headless Chromium screenshot of MiniMax's own model documentation page, showing the standing note that MiniMax-M3.1-Flash-Preview is available only through Token Plan and MiniMax Code for now, above the vendor's language-model table in which MiniMax-M3.1-Flash-Preview is listed first with a 1,000,000-token context window and the description 'Frontier multimodal coding model with 1M context window and tunable thinking depth', ahead of MiniMax-M3 with the same 1,000,000-token window, captured 28 September 2026.

То, какой ключ вы используете, важнее, чем обычно.

Вот на этом люди обычно и попадаются. MiniMax использует два отдельных типа учётных данных, и M3.1-Flash-Preview отвечает только на один из них. Token Plan охватывает раздел Billing > Token, использование по подписке и приобретённые Credits. API-ключ с оплатой по мере использования покрывает модели с оплатой за токены. В документации поставщика прямо сказано, что эти два типа не взаимозаменяемы и что ключ подписки может существовать до того, как к нему будет привязан какой-либо платный ресурс, — в этом случае это действительный ключ, за которым ничего не стоит.

Итак, практическая проверка — не «есть ли у меня ключ API MiniMax», а «есть ли у меня место в Token Plan». Существующие места покрыты. В документации отмечается, что Subscription Key становится доступным для использования, когда назначено место или доступ к Credits, и что переполнение Credits списывается автоматически, как только квота подписки исчерпана.

Есть также несоответствие в документации, о котором стоит знать, потому что оно запутает любого, кто сначала читает страницу с ценами. В сноске о покрытии на странице цен Token Plan по-прежнему указано, что в список доступных моделей входят M3, M2.7, изображения и речь, а H3 исключён — её не обновили, чтобы указать M3.1-Flash-Preview. На страницах моделей говорится обратное: что M3.1-Flash-Preview доступна в Token Plan и нигде больше. Обе страницы — актуальные страницы поставщика на сегодняшний день. Только ключ в вашей руке решает это.

400, который говорит вам, что это за модель

Каждая модель серии MiniMax M думает, прежде чем ответить, но M3.1-Flash-Preview — первая, которая отказывается останавливаться. Отправьте thinking: {"type": "disabled"} или reasoning_effort: "none", и API вернёт HTTP 400 с сообщением:

Модель «MiniMax-M3.1-Flash-Preview» требует адаптивного режима мышления; thinking.type="disabled" (включая reasoning.effort=none) не допускается (2013)

Собственная рекомендация вендора — снижать усилие, а не пытаться отключить мышление, и лестница — это рычаг задержки: рутинная правка на низком и изменение по всему репозиторию на xhigh — это одна и та же модель, совершающая разные компромиссы. Ещё две детали специфичны для этой модели. Параметр reasoning_effort задокументирован как эффективный только для MiniMax-M3.1-Flash-Preview — это не общий элемент управления серии M. А переключатель вывода reasoning_split, который выделяет мышление в поле reasoning_content, в настоящее время не может быть установлен в false на этой модели.

Куда попадает текст рассуждений, зависит от протокола: Anthropic-совместимый эндпоинт возвращает его как thinking-блок контента, OpenAI-совместимый эндпоинт возвращает его в reasoning_content, а Responses-эндпоинт возвращает его как элемент вывода reasoning. Если вы извлекали <think>-теги из вывода MiniMax-M3, эта работа больше не нужна на более новой модели — а для диалогов с чередующимся использованием инструментов полный ответ, включая блок рассуждений, необходимо добавлять обратно в историю сообщений, иначе цепочка рассуждений нарушается.

Акция, действующая прямо сейчас

MiniMax Code проводит акцию с ежедневной отметкой входа с 28 сентября по 7 октября по UTC+8, удваивая бесплатные кредиты, начисляемые за ежедневные входы, и распространяя её как на новых, так и на существующих пользователей. Начисляемые кредиты действуют для поддерживаемых моделей, при этом в качестве примеров названы M3.1-Flash-Preview и видеомодели H3. Отдельно компания сообщила, что квоты Token Plan сбрасываются для всех пользователей при запуске и что во время мероприятия планируются дальнейшие сбросы, а право на участие отображается в приложении.

Рассматривайте эти два как заявления вендора, переданные через материалы о запуске — это промо-условия с указанием дат, а не поведение продукта, и в тех же материалах отмечается, что в анонсе не было указано количество кредитов за каждый чек-ин или точные правила для пропущенных дней. Экономику в установившемся режиме проще описать: Token Plan указан по цене $22 в месяц для Plus, $55 для Max и $132 для Ultra, с 5-часовыми скользящими окнами и недельными окнами квот, рассчитанными вендором примерно на три-четыре, четыре-пять и шесть-семь одновременных агентов соответственно. Purchased Credits идут по курсу 1 000 кредитов за доллар и списываются по цене из прайс-листа для оплаты по мере использования каждой модели.

Четыре вещи, которых у этой модели всё ещё нет

Ничто из следующего не является критикой модели; каждое — это брешь, которую команде приходится учитывать при планировании, и все четыре можно проверить уже сегодня.

• Цены нет. На страницах MiniMax нет тарифа за токен для M3.1-Flash-Preview, поэтому его нельзя сравнить по стоимости за токен ни с M3 с его $0.30 за миллион входных и $1.20 за миллион выходных токенов, ни с чем-либо ещё.
• Нет бенчмарков. MiniMax не опубликовала таблицу оценок вместе с этим релизом. Не сделал этого и кто-либо ещё: модель отсутствует в индексе Artificial Analysis, поэтому её столбец действительно пуст, а не просто пока не заполнен.
• Нет весов. MiniMax-M3 поставлялась с открытыми весами; у M3.1-Flash-Preview нет ни репозитория, ни доступного для скачивания чекпоинта.
• Нет независимых измерений. Никаких данных о скорости вывода, задержке или частоте ошибок ни от одной третьей стороны, и никаких из нашей собственной телеметрии маршрутизации, потому что модель отсутствует в нашем каталоге.

На фоне запуска M3 в июне 2026 года, который в первый же день вышел с заметкой об архитектуре, таблицей бенчмарков и тарифной сеткой, это намеренно тихий релиз. Наиболее правдоподобная трактовка — и это именно трактовка, а не заявленный план — состоит в том, что MiniMax хочет реального использования внутри своего собственного продукта, прежде чем решит, сколько стоит модель и открывать ли её.

A generated two-column infographic titled 'What the vendor confirms, and what it has not published', for MiniMax M3.1 Flash Preview. The left column, headlined 'Confirmed on day one', lists 'Listed first in MiniMax's own model table, above MiniMax-M3', '1,000,000-token context window', 'Text, image and video input returning text', 'An effort ladder from low to max, defaulting to max', 'Reachable over Anthropic-, OpenAI- and Responses-compatible endpoints', and 'Covered by the existing Token Plan Subscription Key'. The right column, headlined 'Still unpublished', lists 'Per-token price, anywhere on MiniMax's pages', 'A model card or evaluation table', 'Public weights or a downloadable checkpoint', 'Any entry on Artificial Analysis's model index', and 'Output-speed and latency figures from any third party'. A footer reads 'Per platform.minimax.io documentation and the launch announcement, 27 September 2026.'

В чём утёкшая предварительная заметка оказалась права

За четыре дня до запуска распространялся предварительный документ, перенесённый в публичный партнёрский репозиторий, описывающий MiniMax M3.1 с разреженным вниманием, квантованием внимания Q8KV4, маршрутизируемыми экспертами NVFP4, головой спекулятивного декодирования DSpark и новым reasoning_effort полем, принимающим значения от max до low. На тот момент мы описали это как непроверенное, потому что так и было: не существовало ни весов, ни карточки модели, ни страницы с ценами, ни идентификатора модели в API.

Одно из этих пяти утверждений теперь подтверждено собственной документацией вендора, и это reasoning_effort — включая лестницу от max до low, которая в точности совпадает с поставляемыми значениями. Остальные четыре остаются неподтверждёнными. Опубликованное описание M3.1-Flash-Preview от MiniMax говорит лишь, что это передовая мультимодальная модель для кодинга с контекстным окном в 1M и настраиваемой глубиной рассуждений; в нём не описываются схема внимания, квантизация или декодирующая головка. Любой, кто повторяет утверждения о разрежённом внимании и NVFP4 как об установленной спецификации, повторяет пересказ третьей стороны, а это как раз то, чего релиз не подтвердил.

Если хотите попробовать это, не рискуя всем пайплайном

Неудобная часть предварительного просмотра только по Token-Plan заключается в том, что естественный способ оценить новую модель — вызвать её из вашего существующего стека и измерить — это именно то, что вы не можете сделать без проблем. Нет тарифа за токен, с которым можно было бы сравнивать, нет опубликованного профиля задержек, и нет истории отказоустойчивости внутри собственного продукта вендора, если предварительный просмотр зашатается.

Именно для такой ситуации и создаётся слой маршрутизации. Всё, что вы можете вызвать сегодня, находится за одной конечной точкой, совместимой с OpenAI, и одним API-ключом, а модели, соседние с этой, уже там: MiniMax-M3 по тарифу провайдера — $0,30 за миллион входных токенов и $1,20 за миллион выходных, MiniMax M2.7 по той же цене с окном в 200 000 токенов и открытыми весами, а также уровни DeepSeek и Qwen Flash в том же ценовом диапазоне. Цены на нашей стороне — списочная цена провайдера, передаваемая с наценкой 0 %, поэтому, когда вендор снижает тариф, он появляется здесь в тот же день, а не в цикле пересмотра условий. Автоматическое переключение при сбое означает, что зависимость уровня превью может находиться рядом с продакшн-путём, а не под ним, и когда MiniMax всё же опубликует тарифную сетку и конечную точку для MiniMax-M3.1-Flash-Preview, вопрос превратится в запись в таблице маршрутизации, а не в проект миграции. Сам MiniMax-M3.1-Flash-Preview отсутствует в нашем каталоге, и сегодня добраться до него можно через собственный Token Plan вендора и его продукт для программирования.

Честное резюме для команды, читающей это в день запуска: модель уже работает, бесплатна на марже, если вы уже платите за место в Token Plan, и совершенно не оценена и не измерена по своим собственным меркам. Попробуйте её в MiniMax Code, оставьте конвейер, от которого вы зависите, на модели с тарифной сеткой и проверенной историей, и следите за двумя вещами, которые превратят это из любопытства в решение — опубликованной ценой и первыми независимыми оценками.

A generated scorecard infographic titled 'The models you can call today, and what they cost'. Six rows read: 'MiniMax M3 — $0.30 in / $1.20 out per 1M tokens, 1,048,576-token context, open weights', 'MiniMax M2.7 — $0.30 in / $1.20 out per 1M tokens, 204,800-token context, open weights', 'DeepSeek V4 Flash — $0.22 in / $0.66 out per 1M tokens, 1,048,576-token context', 'DeepSeek V4.1 Flash — routed on the same key in the same price band', 'MiniMax M3.1 Flash Preview — no per-token rate published; Token Plan and MiniMax Code only', and 'One OrcaRouter API key reaches 200+ models with 0% markup on the provider's list price and automatic failover across providers'. A footer reads 'Catalogue figures per OrcaRouter's public model API, 28 September 2026; MiniMax M3.1 Flash Preview is not on the OrcaRouter catalogue.'