
Dots vs MiniMax M3: аренда воркера или скачивание ридера
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 349 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 210 tok/s
- OrcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Самая дешёвая модель в этой партии — это также та, которую вам разрешено оставить, и это сочетание и есть всё сравнение. MiniMax M3, опубликованная 31 мая 2026 года, описывается как флагманская открытая фундаментальная модель MiniMax: текст, изображения и видео на входе, текст на выходе, контекстное окно в 1 048 576 токенов, до 512 000 токенов вывода в одном ответе, а также прейскурантная цена $0,30 за миллион входных токенов и $1,20 за миллион выходных токенов при кэшированном чтении по $0,06 — примерно тринадцатая часть того, что фронтир берёт за те же токены. Dots — это постоянно работающий агент компании, анонсированный на DevDay 29 сентября 2026 года: он получает собственный облачный компьютер и браузер, работает более чем с 4 000 подключённых приложений, работает на GPT-6 Astra и входит в состав Pro и Business Premium, при этом нигде не опубликованы данные о лимитах. Одно — это компонент, который можно подержать в руках. Другое — это сервис, на который можно только подписаться.
Цена — это не интересное число
Тридцать центов за миллион входных токенов — это заголовок, но интересны две цифры, которые определяют, что вы можете запросить. Первая — 512 000 токенов максимального вывода: в шесть раз больше, чем GPT-5.6 Sol выдаст в одном ответе, и самый высокий потолок вывода среди всех моделей в этом наборе для сравнения. Вторая — 83 балла по воспроизведению длинного контекста — достаточно высокий показатель, чтобы контекстное окно было пригодной для работы поверхностью, а не числом в спецификации.
Сложите это вместе — и определённый класс задач становится дешёвым: сгенерировать длинный текст из длинного источника. Техническое руководство на 400 страниц, переписанное для другой аудитории. Руководство по миграции, созданное на основе целого репозитория. Исследовательское резюме, которое само по себе длиной с отчёт. При цене $0.30 и $1.20 за миллион работа, которая на передовой модели была бы строкой расходов с четырёхзначной суммой, здесь — погрешность округления; и то, что потолок вывода измеряется сотнями тысяч токенов, а не десятками тысяч, позволяет выполнить её одним запросом вместо двадцати.
Есть одна оговорка, которую стоит сделать насчёт измерений. Панель задержек в нашем каталоге сообщает медианное время до первого токена, равное 10,00 секунды для M3, за то же семидневное окно, в котором отображается 18,35 млн токенов трафика, и этот показатель находится ровно на верхней границе отображаемого диапазона панели. Воспринимайте это как артефакт окна, а не как характеристику модели. А вот показатель трафика говорит о том, что люди действительно им пользуются.

Видео — это входные данные, которые никто не планирует.
Зрение теперь стало обязательным минимумом, поэтому модальность, которая всё ещё обеспечивает отличие, — это видео. M3 поддерживает его нативно, наряду с текстом и изображениями, и это меняет структуру пайплайна, а не просто добавляет возможность в список. Архив записей экрана для поддержки, набор клипов с видеорегистратора, семестр записей лекций — раньше это была задача предварительной обработки, где вы выбирали кадры одним инструментом, а описывали их другим. Модель, которая читает видео напрямую, объединяет два этапа в один вызов.
Это также делает арифметику затрат менее предсказуемой, потому что видео дорого обрабатывать, а текст — нет, и самая большая цифра в счёте — это обычно входные данные, которые никто не закладывал в бюджет. Именно низкая цена за токен позволяет безопасно экспериментировать: при цене $0.30 за миллион входных токенов эпизодическая пятичасовая загрузка достаточно дешева, чтобы её можно было прототипировать, а не обсуждать на совещании по планированию.
Что на самом деле меняют открытые веса
MiniMax описывает M3 как модель с открытыми весами: это значит, что веса публикуются, а не только предоставляются через сервис, и это гарантия иного рода, чем подписка. Если бы MiniMax завтра прекратила обслуживание, изменила цены или объявила идентификатор устаревшим, модель не исчезла бы — она продолжала бы работать на уже купленном вами оборудовании при том квантовании, которое помещается. В общем случае это не делает самостоятельный хостинг дешевле; обслуживать большую разреженную смесь экспертов своими силами — это настоящий инженерный проект. Это делает зависимость переживаемой, а это другое утверждение, и именно оно важно, когда вы решаете, на чём строить.
Точка предлагает противоположную гарантию. OpenAI владеет компьютером, браузером, коннекторами и квотой, а если что-то из этого изменится, вашим средством защиты будет прекратить этим пользоваться. Это справедливые условия (аренда — то, с чего большинству команд стоит начинать), но это не те же самые условия, и разница становится заметна только в тот день, когда это имеет значение.

Шесть различий, которые меняют решение
• Гарантия — сервис, который может менять условия, в противовес весам, которые вы можете оставить себе (MiniMax M3 описывается как open-weight; точку нельзя скачать ни в каком смысле)
• Стоимость за единицу работы — не опубликована для dot, против $0,30 и $1,20 за миллион токенов при кэшированных чтениях по $0,06 — самой низкой ставке в этом наборе сравнения
• Потолок для одного запроса — не задокументирован ни на йоту, в отличие от 1,048,576 токенов на входе и 512,000 токенов на выходе
• Входные модальности — сообщения и данные подключённых приложений для dot, в отличие от текста, изображения и видео для
• Модальности исключены — изменения внутри другого ПО, по тексту и только по тексту
• Независимое положение — для точки не существует бенчмарка; M3 имеет показатель Artificial Analysis Intelligence Index 29,2 и занимает шестидесятое место из 145 измеренных моделей, что является серединой поля, и это стоит знать, прежде чем предполагать, что низкая цена даёт передовые рассуждения. Это не так.
Где каждый из них заслуживает свою строку в счёте
Если честно читать опубликованный профиль M3, становится ясно: это модель для объёмных задач, а не фронтирная. 92,9 на GPQA Diamond — конкурентоспособный результат, 59 на SWE Bench Pro — достойный, а середина поля в Intelligence Index — это и есть показательный момент. Она выигрывает по стоимости за единицу работы, потолку вывода, видео и развёртываемости — именно в таком порядке. Это хорошая модель, чтобы поставить её под дорогим слоем пайплайна — на этапах суммирования, извлечения, транскрибирования, генерации длинных текстов и разветвления на множество попыток, — и плохая, чтобы ставить её на самый верх.
OrcaRouter предоставляет его в качестве minimax/minimax-m3 по прейскурантной цене провайдера MiniMax с наценкой 0%, в том же каталоге, что и более 200 моделей за одним ключом, с автоматическим переключением при сбое между вышестоящими провайдерами и DSL маршрутизации для отправки отдельного запроса модели, которая должна его обработать. Именно такая схема делает двухуровневое разделение практичным, а не теоретическим: тот же ключ, который достигает дешёвой модели для объёма, достигает передовой модели для вызовов, которые должны быть правильными, и ничего не приходит внутри точки, потому что точек вообще нет в каталоге — ни конечной точки, ни идентификатора, ни заменителя интеллекта.
Что делать в понедельник
Если у вас есть корпус аудио или видео и нет способа его просмотреть, начните с него: M3 — единственная модель в этом наборе, которая нативно читает видео по такой цене, а эксперимент почти ничего не стоит. Если у вас есть класс работы, который постоянно выпадает, потому что никто за ним не гонится, dot — это продукт, созданный для этого, а модель с оплатой по мере использования не станет выдавать себя за него.
Эти двое конфликтуют, только если вы исходите из того, что один должен победить. Подписка гонится; скачанный ридер читает. Владейте вторым, арендуйте первый и сохраняйте границу между ними настолько явной, чтобы вы могли заменить любой из них, не переписывая другой.

