
LongCat-2.5-Preview против MiniMax M3: дешёвое место уже занято
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 610 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 189 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Посылка большинства материалов о LongCat-2.5-Preview состоит в том, что Meituan сбил цены на рынке. В сравнении с MiniMax M3 это предположение испаряется при первом же соприкосновении. В нашем каталоге MiniMax M3 предлагается по цене $0.30 за миллион входных токенов и $1.20 за миллион выходных токенов. Опубликованная тарифная сетка LongCat-2.5-Preview — $0.30 за миллион некешированных входных токенов и $1.20 за миллион выходных токенов. Это не похожие цифры; это одни и те же цифры. Единственное место, где они расходятся, — кешированный ввод: Meituan называет $0.006 за миллион против $0.06 у действующего игрока — десятикратный разрыв по самой дешёвой строке счёта. Так что интересный вопрос не в том, дёшев ли LongCat-2.5-Preview. А в том, что вы покупаете и от чего отказываетесь, когда новая модель появляется ровно по цене действующего игрока.
Короткий ответ: гораздо более высокий потолок вывода, гораздо более скудная доказательная база и скидка за кэш.
Одна и та же заявленная цена, но совершенно разные публикуемые потолки
MiniMax M3 официально доступна с 31 мая 2026 года. В нашем каталоге она представлена с контекстным окном в 1 048 576 токенов и максимальным объёмом вывода 512 000 токенов — больше, чем допускают большинство моделей, и в четыре раза больше, чем 131 072 у LongCat-2.5-Preview. Она принимает на вход текст, изображения и видео и возвращает текст; доступны вызов инструментов, режим JSON и механизм рассуждений.

LongCat-2.5-Preview, представленная на платформе LongCat API Platform от Meituan 25 сентября 2026 года, совпадает по контексту при 1 000 000 токенов и сильно не дотягивает по объёму вывода при 131 072. Его профиль входных данных — вот актуальный вопрос: в журнале изменений понимание изображений представлено как главное нововведение, но пример ответа в собственной документации Meituan «Retrieve Model» всё ещё показывает input_modalities/ как ["text"]/ с text->text/ строкой модальности. MiniMax M3 также поддерживает видео, чего LongCat-2.5-Preview вообще не заявляет. Если в ваш конвейер подаются записи экрана или последовательности кадров, это сравнение на этом заканчивается.
Асимметрия кэша работает в противоположную сторону, и это стоит отметить в пользу Meituan, потому что это единственное измерение, в котором новая модель действительно отличается. $0.006 за миллион кэшированных входных токенов против $0.06 — это реальное преимущество для агентных рабочих нагрузок, которые на каждом шаге повторно отправляют один и тот же длинный префикс, — а это большинство из них. Это также статья, которая с наибольшей вероятностью может измениться без предупреждения, поскольку Meituan помечает всю карточку как скидку на ограниченное время.
Пробел в доказательствах, честно измеренный в обоих направлениях
Позиция MiniMax M3 в бенчмарках не сильна, и сказать об этом — часть того, чтобы провести это сравнение как следует. Artificial Analysis фиксирует для неё Coding Index 58,6 — сорок шестое место среди отслеживаемых моделей — и Intelligence Index 29,2 на шестидесятом месте. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Опубликованные самой MiniMax цифры охватывают другую область: BrowseComp 83,5, GDPval rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Это цифры, заявленные производителем, и их место — в другой колонке, не в той, где независимые, но они существуют, и слово «существуют» здесь ключевое.

У LongCat-2.5-Preview нет вообще никакой колонки. Ни опубликованной таблицы бенчмарков, ни карточки модели, ни технического отчёта, ни репозитория на HuggingFace или в организации Meituan на GitHub, а метаданные каталога указывают открытые веса как false. Оценка примерно в 1,6 трлн общих / 48 млрд активных параметров взята из метаданных сайта Meituan и китайских отраслевых публикаций, а не из документации. Так что точная формулировка такова: оценки M3 посредственные и получены из независимых источников; у LongCat-2.5-Preview они отсутствуют. Модель, набирающая сорок с небольшим баллов по индексу программирования, — это известная величина, которую можно учитывать в планах. Модель без оценки — это риск иного рода, а одинаковая цена устраняет ту компенсацию, которая обычно оправдывает выбор в её пользу.
Когда одна и та же цена меняет то, что вам следует делать
Когда новая модель предлагает цену ниже, чем у конкурентов, рациональный ход — оценить её: потенциальная выгода — это реальная скидка. Когда новая модель выходит по ровно той же цене, что и действующий игрок, доступный с мая, выгода не в цене. Она в возможностях, а возможности — это единственное, чего LongCat-2.5-Preview не опубликовала. Это полностью меняет рамку оценки: вы проверяете не то, дешевле ли она, а то, лучше ли она — на ваших задачах, стартуя с нуля и без доказательств, на которые можно опереться.
Есть деталь второго порядка, которая делает этот тест дешевле, чем он выглядит. LongCat-2.5-Preview бесплатен и без ограничений через OpenCode в течение окна неуказанной длительности, с политикой нулевого хранения данных, которую OpenCode явно документирует — обучение модели «Not used», хранение данных «0 days», против тридцати дней у листинга для сравнения. Так что стоимость создания собственной оценки близка к нулю, а политика хранения означает, что вы можете запускать её на приватном коде. Единственная деталь харнесса, которую нужно уладить в первую очередь, — модель возвращает свою цепочку рассуждений во вложенном reasoning_content/ поле; клиенты, которые парсят chat completions, не ожидая этого, молча отбросят размышления и заставят модель выглядеть хуже, чем она есть.

Аргумент о маршрутизации, относящийся именно к сравнению при одинаковой цене.
Мы предоставляем MiniMax M3 по цене из прайс-листа MiniMax с нулевой наценкой. LongCat-2.5-Preview не является одним из наших маршрутов — мы его не обслуживаем, и ничто здесь не должно восприниматься как утверждение об обратном.
Совпадение по цене — это как раз тот случай, когда маршрутизация окупает себя, а не просто служит удобством. Если две модели стоят одинаково, выбор между ними делается для каждого запроса и каждой задачи: M3 — ради потолка вывода в 512 000 токенов и поддержки видео на входе, LongCat-2.5-Preview — ради скидки за кэшированный префикс в длинных агентных циклах, когда вы уже убедились в его качестве. Объединение моделей — это механизм, который делает это буквальным: этап поиска и этап синтеза могут быть разными моделями в рамках одного запроса, так что вас не заставляют выбирать победителя до того, как появятся доказательства. А поскольку мы передаём прайс-листовые цены провайдеров без наценки, изменение тарифа у вендора отражается в вашем счёте в тот же день, а не при следующем продлении контракта, — и это важно как никогда, когда одна из двух карточек явно рекламная. Автоматическое переключение при сбое покрывает случай, когда один из провайдеров деградирует, и особенно важно для модели, у которой нет истории обслуживания, которую можно изучить.
Часто задаваемые
• Дешевле ли LongCat-2.5-Preview, чем MiniMax M3? Нет. В опубликованных тарифах ставки за ввод и вывод идентичны — $0.30 и $1.20 за миллион. Единственное ценовое преимущество — на кэшированном вводе: $0.006 против $0.06, а Meituan помечает весь свой тариф как ограниченную по времени скидку, не сообщая, что будет дальше.
• У кого больше полезный объём вывода? У MiniMax M3 — со значительным отрывом: 512 000 токенов против 131 072. Для генерации длинных текстов, структурированного извлечения данных из больших документов или любых задач, где текст длиннее одной главы, этот потолок становится решающей характеристикой.
• Что из этого я могу проверить? MiniMax M3, и проверка ему не льстит — Coding 58,6 на сорок шестом месте и Intelligence Index 29,2 на шестидесятом месте по данным Artificial Analysis. У LongCat-2.5-Preview нет опубликованных оценок ни от кого. Если на этой неделе появится бенчмарк LongCat-2.5-Preview, считайте его непроверяемым, пока не сможете проследить его до названного оценщика.
• Что мне запускать в продакшен? Ни то, ни другое — без собственного теста. Из этих двух M3 — выбор с меньшей дисперсией, потому что его слабые места задокументированы, а входные модальности подтверждены; LongCat-2.5-Preview — выбор с большей дисперсией: заявленный контекст больше, потолок вывода намного меньше, есть скидка за кэш и ноль публичных доказательств. Запускайте его бесплатно, пока окно открыто, держите оба за одним ключом, и пусть последнее слово скажут ваши собственные цифры.
