
MiniMax M3.1 Flash Preview против DeepSeek V4 Flash: два дешёвых билета с контекстом 1M, но одна огромная звёздочка
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 468 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 192 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Если вы подбираете контекстное окно на миллион токенов по низкой цене за токен, постоянно всплывают два названия — MiniMax-M3.1-Flash-Preview и DeepSeek V4 Flash — и это, по сути, не продукты одного типа. DeepSeek V4 Flash — выведенная из эксплуатации модель, чей идентификатор всё ещё отвечает; она живёт в тарифной сетке поставщика, которую можно прочитать с точностью до цента. MiniMax-M3.1-Flash-Preview — это действующий предпросмотр, для которого тариф вообще не опубликован. Поэтому сравнение ниже — отчасти сравнение характеристик, а отчасти демонстрация того, насколько по-разному эти два поставщика решили продавать один и тот же сегмент.
Обе стороны этого стоит изложить точно, потому что цифры, которые это решают, разбросаны по странице цен поставщика, дереву документации поставщика и нашему собственному каталогу, а одно из самых часто повторяемых утверждений о DeepSeek V4 Flash — его цена — это то, которое DeepSeek с тех пор заменил.
В чём на самом деле совпадают две спецификации
Основные характеристики настолько близки, что не являются решающим фактором, за одним исключением, которое никто не афиширует.
• Контекстное окно — 1 000 000 токенов для MiniMax-M3.1-Flash-Preview против 1 048 576 для DeepSeek V4 Flash: номинально одинаковые, разница в 48 576 токенов
• Максимальный вывод — не опубликован для MiniMax-M3.1-Flash-Preview; 384 000 токенов для DeepSeek V4 Flash, что необычно при такой цене и должно во многом определять выбор при покупке
• Входные модальности — текст, изображение и видео для MiniMax-M3.1-Flash-Preview; только текст для DeepSeek V4 Flash
• Управление размышлением — усилий шкала от низкого до максимального, размышление постоянно включено, для MiniMax-M3.1-Flash-Preview; режим размышления или режим без размышления для DeepSeek V4 Flash, причём режим без размышления — реальная опция
• Поддержка протоколов — Anthropic-совместимые, OpenAI-совместимые и эндпоинты OpenAI Responses для MiniMax-M3.1-Flash-Preview; те же три плюс завершение по префиксу чата на DeepSeek V4 Flash
• Веса — отсутствуют для MiniMax-M3.1-Flash-Preview; веса DeepSeek V4 Flash были опубликованы, хотя сама модель уже заменена
• Цена — не опубликована для MiniMax-M3.1-Flash-Preview; опубликована и низкая для DeepSeek V4 Flash
Прочитайте этот список дважды, потому что потолок вывода — это тот, о котором молчат. Миллион токенов контекста с 384 000 токенов вывода — это действительно длинное окно генерации за один проход. Миллион токенов контекста с нераскрытым потолком вывода — это обещание о чтении, а не о записи. Если ваша рабочая нагрузка — «прочитать репозиторий, выдать план миграции», то именно второе число определяет, укладывается ли задача в один вызов.
На каком уровне измеряется каждый из них
Это самая неудобная часть сравнения, и она короткая.
У DeepSeek V4 Flash есть результат бенчмарка, и он независим. Artificial Analysis оценивает его в 34,3 балла по Intelligence Index — 42-е место из 145 моделей в этом индексе — с 69,1 по Coding Index и 90,8% по GPQA Diamond. 95,0 по τ²-Bench, с которого начинается наша собственная карточка в каталоге, — это та же цифра, что фигурировала в материалах к запуску DeepSeek, так что это вендорское число в одном ряду с независимыми, а не проверенное аудитом. Его recall на длинном контексте составляет 79,7%, а показатель terminal-bench — 78,7% на стенде v2.1. Это реальные, сопоставимые измерения известной модели.
У MiniMax-M3.1-Flash-Preview его нет. MiniMax не опубликовала вместе с релизом никакой таблицы оценок, и ни у одной третьей стороны её тоже нет — модель вообще не фигурирует в индексе Artificial Analysis. Это не пробел в наших исследованиях; это текущее состояние публичных данных, а значит, любое утверждение о качестве новой модели в данный момент — не более чем рекламное прилагательное от вендора. Любой, кто сегодня протянет вам таблицу бенчмарков MiniMax-M3.1-Flash-Preview, либо цитирует более старую MiniMax-M3, либо всё это выдумывает.

DeepSeek V4 Flash продаётся не по той цене, которую вы помните
Вот в чём подвох. Широко цитируемая цифра для DeepSeek V4 Flash — $0,14 за миллион входных токенов и $0,28 за миллион выходных токенов — была тарифной карточкой модели до 10 сентября 2026 года. В тот день DeepSeek выпустила DeepSeek-V4.1-Flash, вывела из эксплуатации и V4 Flash, и эксперимент V4-Flash-Vision-Exp, а также снизила цены. А вот deepseek-v4-flash как идентификатор всё ещё работает, но в документации DeepSeek указано, что он временно перенаправляется на V4.1 Flash и тарифицируется по цене Flash. Иными словами, вы всё ещё можете ввести старое название модели; но вызываете не старую модель.
Итак, реальная карта для сравнения — это текущая, в расчёте на 1 млн токенов, — а внепиковый вариант — её более дешёвая половина:
• Входные данные при промахе кэша — $0.15 вне пиковых часов, $0.30 в пиковые часы
• Входные данные при попадании в кэш — $0.003 вне пиковых часов, $0.006 в пиковые часы
• Выходные данные — $0.60 вне пиковых часов, $1.20 в пиковые часы
• Пиковые периоды — 01:00–04:00 и 06:00–10:00 UTC, с понедельника по пятницу, за исключением государственных праздников Китая; всё остальное время, включая полные выходные, считается внепиковым
А вот у MiniMax-M3.1-Flash-Preview нет никакой ставки за токен. Его стоимость — это сколько стоит ваше место в Token Plan — $22, $55 или $132 в месяц для Plus, Max и Ultra — сжигаемое через общий пул квот по прайс-листу pay-as-you-go для каждой модели, причём поставщик оставляет за собой право менять состав этого пула. Для фиксированного месячного бюджета с предсказуемым объёмом это может быть отличным вариантом. Для проекта, которому нужно относить затраты на каждый вызов, это непрозрачность, замаскированная под подписку.
Причина, по которой на стороне DeepSeek это важнее обычного, — пиковый множитель. Команда в Европе или Азии, работающая в течение своего рабочего дня, попадает в пиковое окно для значительной доли своего трафика и платит вдвое за эту привилегию, что превращает заявленную ставку ввода $0.15 в $0.30 именно в те часы, когда работает большинство продуктов. Планируйте бюджет вне пика, если только он не работает ночью по UTC.
Где MiniMax M3.1 Flash Preview — неправильный выбор
Три случая, причём первые два легко пропустить, потому что они задокументированы, а не вычтены.
Потолок объёма вывода неизвестен. Если ваша задача заканчивается длинной генерацией — полной спецификацией, переписыванием транскрипта, аннотированным отчётом, — вы выбираете бюджет вывода, которого не видите. DeepSeek V4 Flash публикует 384 000. Эта асимметрия играет в пользу более старой модели во всём, что связано с большим объёмом текста.
Мышление нельзя отключить. Отправьте thinking: {"type": "disabled"} в MiniMax-M3.1-Flash-Preview — и получите HTTP 400: модель требует адаптивного мышления. В DeepSeek V4 Flash режим без мышления существует и поддерживается как переключатель. Для высоконагруженной классификации, маршрутизации или короткого структурированного извлечения модель, которая всегда сначала рассуждает, платит задержкой и токенами, которые вы не запрашивали, — и единственный доступный вам рычаг — снизить effort до low, а не убирать рассуждение.
Его нельзя вызвать по модели оплаты по мере использования. Документация поставщика недвусмысленно указывает, что MiniMax-M3.1-Flash-Preview сейчас доступна только через Token Plan и MiniMax Code, а Subscription Key не является взаимозаменяемым с API-ключом для оплаты по мере использования. Если у вас уже есть место, это изменение в одну строку. Если нет, то для оценки этой модели придётся купить подписку.
Где цифра DeepSeek — неверное решение
Зеркальное отражение ситуации состоит в том, что DeepSeek V4 Flash работает только с текстом и уже вытеснен. Он никогда не принимал изображения — для этого требовалась отдельная экспериментальная сборка, которая теперь выведена из эксплуатации вместе с ним, — а идентификатор модели теперь соответствует другим весам, чем предполагает название. Пайплайн, привязанный к deepseek-v4-flash для воспроизводимости, полагается на перенаправление, которое DeepSeek называет временным.
MiniMax-M3.1-Flash-Preview нативно принимает текст, изображения и видео, и это текущая топовая текстовая модель вендора. Видеовход по цене Flash — редкость в этом сегменте.
Оба предостережения указывают в одну и ту же сторону для всех, кто обслуживает продакшен-трафик: не гарантируется, что идентификатор в счёте и модель, которая ответила, навсегда останутся одним и тем же, а слой маршрутизации — это то место, где это обрабатывается, а не обнаруживается.

Как принять это решение за один день
Начните с конца задачи, а не с начала.
Если задача — это генерация длинных текстов, то есть всё, что завершается написанием десятков тысяч токенов, DeepSeek V4 Flash — единственная из двух, кто публикует тарифную сетку, достаточно крупную, чтобы это обещать, и при этом его тарифная сетка достаточно мала, чтобы пиковый множитель можно было пережить. Считайте стоимость по пиковому тарифу, а не по непиковому, и рассматривайте выведенный из эксплуатации идентификатор как миграцию, которую вы ещё не выполнили, а не как стабильный контракт.
Если задача — чтение и рассуждения по мультимодальным входным данным при фиксированном месячном бюджете — записи экрана, отсканированные документы, анализ видео — MiniMax-M3.1-Flash-Preview — это более мощная конфигурация, а в рамках места в Token Plan — самый дешёвый способ получить видеовход при такой длине контекста. Смиритесь с тем, что вы покупаете неизмеренную модель, и ограничьте радиус поражения: оставьте важную рабочую нагрузку на чём-то с опубликованной тарифной сеткой, а исследовательскую половину отдайте preview-версии.
If both descriptions fit your pipeline, that is a routing problem rather than a model-selection problem, and it is the case we exist for. DeepSeek V4 Flash on OrcaRouter sits at the provider's rate with 0% markup — its catalogue entry shows $0.22 per million input tokens and $0.66 per million output, which is the peak column of the current Flash card, passed straight through — alongside MiniMax-M3 and MiniMax M2.7 in the same price band on the same key. One endpoint reaches 200+ models with automatic failover behind it, so a workload can move between price brackets without a second integration. MiniMax-M3.1-Flash-Preview is not on our catalogue; reaching it means the vendor's Token Plan and its coding product.
Кратко, в одну строку: DeepSeek V4 Flash — известная величина с опубликованным потолком вывода, понятной тарифной сеткой и преемником, который тихо откликается на своё имя; MiniMax-M3.1-Flash-Preview — более новая, мультимодальная, неизмеренная модель, попробовать которую можно только по подписке. Ни одно из этих обстоятельств не повод выбирать другую — это просто факты, которых вы не получили бы из сравнения цены за токен, где цитируется прайс-лист, отозванный DeepSeek в сентябре.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
