
MiniMax M3.1 Flash Preview уже доступна в плане Token Plan: что на самом деле открывает ваша подписка
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 468 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 192 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
MiniMax-M3.1-Flash-Preview вышел 27 сентября 2026 года, и то, как он вышел, — это отдельная история. Это не модель с оплатой по мере использования. Поставщик поместил свою новейшую текстовую модель за тот же Token Plan Subscription Key, который уже покрывает MiniMax-M3, MiniMax M2.7 и вариант M2.7-highspeed, так что если у вас есть место, не нужно выпускать новый ключ и не нужно подписывать второй контракт. Чего также нет на сегодняшний день, так это цены за токен, карточки модели, опубликованного бенчмарка или какого-либо способа отключить мышление модели.
Такая комбинация — беспрепятственный доступ в сочетании с полностью нераскрытыми экономическими условиями — достаточно необычна, чтобы её стоило разобрать, прежде чем кто-либо подключит к ней продакшн-пайплайн. Остальная часть этого материала — это то, что на самом деле говорится в собственной документации вендора, то, о чём она демонстративно умалчивает, и одна строка кода, которая в течение минуты скажет вам, соответствует ли эта модель тому, как вы работаете.
Что на самом деле приземлилось 27 сентября?
В документации для разработчиков MiniMax теперь есть постоянное примечание, повторяющееся на каждой странице текстовых моделей: MiniMax-M3.1-Flash-Preview пока доступна только через Token Plan и MiniMax Code. Модель указана первой в собственной таблице моделей вендора, выше MiniMax-M3, и описана как передовая мультимодальная модель для программирования с контекстным окном 1M и настраиваемой глубиной рассуждений.
• Контекстное окно — 1 000 000 токенов, такой же потолок, как у MiniMax-M3
• Входные модальности — текст, изображение и видео; на выходе — текст
• Глубина мышления — настройка усилия, принимающая уровни: низкий, средний, высокий, очень высокий и максимальный, по умолчанию максимальный, если не указана
• Поддержка протоколов — один и тот же идентификатор модели работает через Anthropic-совместимый эндпоинт MiniMax, её OpenAI-совместимый эндпоинт и её эндпоинт OpenAI Responses
• Доступность — только Token Plan и MiniMax Code; недоступна при оплате по мере использования
• Цена — тариф за токен нигде не опубликован
• Веса — отсутствуют; два самых последних публичных репозитория организации MiniMaxAI остаются MiniMax-Music3 и MiniMax-H3
• Независимые бенчмарки — отсутствуют; модель не представлена в индексе моделей Artificial Analysis
Компания анонсировала её в тот же день в своём аккаунте MiniMaxAgent, позиционируя для повседневной разработки, а не для передовых задач: быстрая и надёжная — от оперативных исправлений ошибок до полноценной реализации функций. Это задача уровня Flash, а не флагмана. Сторонние новостные публикации от PANews и KuCoin описали её в тех же выражениях и отметили, что разработчики заметили модель в селекторе MiniMax Code ещё до того, как компания подтвердила это.

То, какой ключ вы используете, важнее, чем обычно.
Вот на этом люди обычно и попадаются. MiniMax использует два отдельных типа учётных данных, и M3.1-Flash-Preview отвечает только на один из них. Token Plan охватывает раздел Billing > Token, использование по подписке и приобретённые Credits. API-ключ с оплатой по мере использования покрывает модели с оплатой за токены. В документации поставщика прямо сказано, что эти два типа не взаимозаменяемы и что ключ подписки может существовать до того, как к нему будет привязан какой-либо платный ресурс, — в этом случае это действительный ключ, за которым ничего не стоит.
Итак, практическая проверка — не «есть ли у меня ключ API MiniMax», а «есть ли у меня место в Token Plan». Существующие места покрыты. В документации отмечается, что Subscription Key становится доступным для использования, когда назначено место или доступ к Credits, и что переполнение Credits списывается автоматически, как только квота подписки исчерпана.
Есть также несоответствие в документации, о котором стоит знать, потому что оно запутает любого, кто сначала читает страницу с ценами. В сноске о покрытии на странице цен Token Plan по-прежнему указано, что в список доступных моделей входят M3, M2.7, изображения и речь, а H3 исключён — её не обновили, чтобы указать M3.1-Flash-Preview. На страницах моделей говорится обратное: что M3.1-Flash-Preview доступна в Token Plan и нигде больше. Обе страницы — актуальные страницы поставщика на сегодняшний день. Только ключ в вашей руке решает это.
400, который говорит вам, что это за модель
Каждая модель серии MiniMax M думает, прежде чем ответить, но M3.1-Flash-Preview — первая, которая отказывается останавливаться. Отправьте thinking: {"type": "disabled"} или reasoning_effort: "none", и API вернёт HTTP 400 с сообщением:
Модель «MiniMax-M3.1-Flash-Preview» требует адаптивного режима мышления; thinking.type="disabled" (включая reasoning.effort=none) не допускается (2013)
Собственная рекомендация вендора — снижать усилие, а не пытаться отключить мышление, и лестница — это рычаг задержки: рутинная правка на низком и изменение по всему репозиторию на xhigh — это одна и та же модель, совершающая разные компромиссы. Ещё две детали специфичны для этой модели. Параметр reasoning_effort задокументирован как эффективный только для MiniMax-M3.1-Flash-Preview — это не общий элемент управления серии M. А переключатель вывода reasoning_split, который выделяет мышление в поле reasoning_content, в настоящее время не может быть установлен в false на этой модели.
Куда попадает текст рассуждений, зависит от протокола: Anthropic-совместимый эндпоинт возвращает его как thinking-блок контента, OpenAI-совместимый эндпоинт возвращает его в reasoning_content, а Responses-эндпоинт возвращает его как элемент вывода reasoning. Если вы извлекали <think>-теги из вывода MiniMax-M3, эта работа больше не нужна на более новой модели — а для диалогов с чередующимся использованием инструментов полный ответ, включая блок рассуждений, необходимо добавлять обратно в историю сообщений, иначе цепочка рассуждений нарушается.
Акция, действующая прямо сейчас
MiniMax Code проводит акцию с ежедневной отметкой входа с 28 сентября по 7 октября по UTC+8, удваивая бесплатные кредиты, начисляемые за ежедневные входы, и распространяя её как на новых, так и на существующих пользователей. Начисляемые кредиты действуют для поддерживаемых моделей, при этом в качестве примеров названы M3.1-Flash-Preview и видеомодели H3. Отдельно компания сообщила, что квоты Token Plan сбрасываются для всех пользователей при запуске и что во время мероприятия планируются дальнейшие сбросы, а право на участие отображается в приложении.
Рассматривайте эти два как заявления вендора, переданные через материалы о запуске — это промо-условия с указанием дат, а не поведение продукта, и в тех же материалах отмечается, что в анонсе не было указано количество кредитов за каждый чек-ин или точные правила для пропущенных дней. Экономику в установившемся режиме проще описать: Token Plan указан по цене $22 в месяц для Plus, $55 для Max и $132 для Ultra, с 5-часовыми скользящими окнами и недельными окнами квот, рассчитанными вендором примерно на три-четыре, четыре-пять и шесть-семь одновременных агентов соответственно. Purchased Credits идут по курсу 1 000 кредитов за доллар и списываются по цене из прайс-листа для оплаты по мере использования каждой модели.
Четыре вещи, которых у этой модели всё ещё нет
Ничто из следующего не является критикой модели; каждое — это брешь, которую команде приходится учитывать при планировании, и все четыре можно проверить уже сегодня.
• Цены нет. На страницах MiniMax нет тарифа за токен для M3.1-Flash-Preview, поэтому его нельзя сравнить по стоимости за токен ни с M3 с его $0.30 за миллион входных и $1.20 за миллион выходных токенов, ни с чем-либо ещё.
• Нет бенчмарков. MiniMax не опубликовала таблицу оценок вместе с этим релизом. Не сделал этого и кто-либо ещё: модель отсутствует в индексе Artificial Analysis, поэтому её столбец действительно пуст, а не просто пока не заполнен.
• Нет весов. MiniMax-M3 поставлялась с открытыми весами; у M3.1-Flash-Preview нет ни репозитория, ни доступного для скачивания чекпоинта.
• Нет независимых измерений. Никаких данных о скорости вывода, задержке или частоте ошибок ни от одной третьей стороны, и никаких из нашей собственной телеметрии маршрутизации, потому что модель отсутствует в нашем каталоге.
На фоне запуска M3 в июне 2026 года, который в первый же день вышел с заметкой об архитектуре, таблицей бенчмарков и тарифной сеткой, это намеренно тихий релиз. Наиболее правдоподобная трактовка — и это именно трактовка, а не заявленный план — состоит в том, что MiniMax хочет реального использования внутри своего собственного продукта, прежде чем решит, сколько стоит модель и открывать ли её.

В чём утёкшая предварительная заметка оказалась права
За четыре дня до запуска распространялся предварительный документ, перенесённый в публичный партнёрский репозиторий, описывающий MiniMax M3.1 с разреженным вниманием, квантованием внимания Q8KV4, маршрутизируемыми экспертами NVFP4, головой спекулятивного декодирования DSpark и новым reasoning_effort полем, принимающим значения от max до low. На тот момент мы описали это как непроверенное, потому что так и было: не существовало ни весов, ни карточки модели, ни страницы с ценами, ни идентификатора модели в API.
Одно из этих пяти утверждений теперь подтверждено собственной документацией вендора, и это reasoning_effort — включая лестницу от max до low, которая в точности совпадает с поставляемыми значениями. Остальные четыре остаются неподтверждёнными. Опубликованное описание M3.1-Flash-Preview от MiniMax говорит лишь, что это передовая мультимодальная модель для кодинга с контекстным окном в 1M и настраиваемой глубиной рассуждений; в нём не описываются схема внимания, квантизация или декодирующая головка. Любой, кто повторяет утверждения о разрежённом внимании и NVFP4 как об установленной спецификации, повторяет пересказ третьей стороны, а это как раз то, чего релиз не подтвердил.
Если хотите попробовать это, не рискуя всем пайплайном
Неудобная часть предварительного просмотра только по Token-Plan заключается в том, что естественный способ оценить новую модель — вызвать её из вашего существующего стека и измерить — это именно то, что вы не можете сделать без проблем. Нет тарифа за токен, с которым можно было бы сравнивать, нет опубликованного профиля задержек, и нет истории отказоустойчивости внутри собственного продукта вендора, если предварительный просмотр зашатается.
Именно для такой ситуации и создаётся слой маршрутизации. Всё, что вы можете вызвать сегодня, находится за одной конечной точкой, совместимой с OpenAI, и одним API-ключом, а модели, соседние с этой, уже там: MiniMax-M3 по тарифу провайдера — $0,30 за миллион входных токенов и $1,20 за миллион выходных, MiniMax M2.7 по той же цене с окном в 200 000 токенов и открытыми весами, а также уровни DeepSeek и Qwen Flash в том же ценовом диапазоне. Цены на нашей стороне — списочная цена провайдера, передаваемая с наценкой 0 %, поэтому, когда вендор снижает тариф, он появляется здесь в тот же день, а не в цикле пересмотра условий. Автоматическое переключение при сбое означает, что зависимость уровня превью может находиться рядом с продакшн-путём, а не под ним, и когда MiniMax всё же опубликует тарифную сетку и конечную точку для MiniMax-M3.1-Flash-Preview, вопрос превратится в запись в таблице маршрутизации, а не в проект миграции. Сам MiniMax-M3.1-Flash-Preview отсутствует в нашем каталоге, и сегодня добраться до него можно через собственный Token Plan вендора и его продукт для программирования.
Честное резюме для команды, читающей это в день запуска: модель уже работает, бесплатна на марже, если вы уже платите за место в Token Plan, и совершенно не оценена и не измерена по своим собственным меркам. Попробуйте её в MiniMax Code, оставьте конвейер, от которого вы зависите, на модели с тарифной сеткой и проверенной историей, и следите за двумя вещами, которые превратят это из любопытства в решение — опубликованной ценой и первыми независимыми оценками.

