Сгенерированная hero-карточка заголовка с надписью «LongCat-2.5-Preview против MiniMax M3» и надзаголовком «Дешёвое место уже занято», а также две панели: «LongCat-2.5-Preview: $0.30 / $1.20 за 1 млн, макс. вывод: 131 072» и «MiniMax M3: $0.30 / $1.20 за 1 млн, макс. вывод: 512 000». Логотип OrcaRouter в правом нижнем углу.
Guides & Insights

LongCat-2.5-Preview против MiniMax M3: дешёвое место уже занято

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Посылка большинства материалов о LongCat-2.5-Preview состоит в том, что Meituan сбил цены на рынке. В сравнении с MiniMax M3 это предположение испаряется при первом же соприкосновении. В нашем каталоге MiniMax M3 предлагается по цене $0.30 за миллион входных токенов и $1.20 за миллион выходных токенов. Опубликованная тарифная сетка LongCat-2.5-Preview — $0.30 за миллион некешированных входных токенов и $1.20 за миллион выходных токенов. Это не похожие цифры; это одни и те же цифры. Единственное место, где они расходятся, — кешированный ввод: Meituan называет $0.006 за миллион против $0.06 у действующего игрока — десятикратный разрыв по самой дешёвой строке счёта. Так что интересный вопрос не в том, дёшев ли LongCat-2.5-Preview. А в том, что вы покупаете и от чего отказываетесь, когда новая модель появляется ровно по цене действующего игрока.

Короткий ответ: гораздо более высокий потолок вывода, гораздо более скудная доказательная база и скидка за кэш.

Одна и та же заявленная цена, но совершенно разные публикуемые потолки

MiniMax M3 официально доступна с 31 мая 2026 года. В нашем каталоге она представлена с контекстным окном в 1 048 576 токенов и максимальным объёмом вывода 512 000 токенов — больше, чем допускают большинство моделей, и в четыре раза больше, чем 131 072 у LongCat-2.5-Preview. Она принимает на вход текст, изображения и видео и возвращает текст; доступны вызов инструментов, режим JSON и механизм рассуждений.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, представленная на платформе LongCat API Platform от Meituan 25 сентября 2026 года, совпадает по контексту при 1 000 000 токенов и сильно не дотягивает по объёму вывода при 131 072. Его профиль входных данных — вот актуальный вопрос: в журнале изменений понимание изображений представлено как главное нововведение, но пример ответа в собственной документации Meituan «Retrieve Model» всё ещё показывает input_modalities/ как ["text"]/ с text->text/ строкой модальности. MiniMax M3 также поддерживает видео, чего LongCat-2.5-Preview вообще не заявляет. Если в ваш конвейер подаются записи экрана или последовательности кадров, это сравнение на этом заканчивается.

Асимметрия кэша работает в противоположную сторону, и это стоит отметить в пользу Meituan, потому что это единственное измерение, в котором новая модель действительно отличается. $0.006 за миллион кэшированных входных токенов против $0.06 — это реальное преимущество для агентных рабочих нагрузок, которые на каждом шаге повторно отправляют один и тот же длинный префикс, — а это большинство из них. Это также статья, которая с наибольшей вероятностью может измениться без предупреждения, поскольку Meituan помечает всю карточку как скидку на ограниченное время.

Пробел в доказательствах, честно измеренный в обоих направлениях

Позиция MiniMax M3 в бенчмарках не сильна, и сказать об этом — часть того, чтобы провести это сравнение как следует. Artificial Analysis фиксирует для неё Coding Index 58,6 — сорок шестое место среди отслеживаемых моделей — и Intelligence Index 29,2 на шестидесятом месте. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Опубликованные самой MiniMax цифры охватывают другую область: BrowseComp 83,5, GDPval rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Это цифры, заявленные производителем, и их место — в другой колонке, не в той, где независимые, но они существуют, и слово «существуют» здесь ключевое.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

У LongCat-2.5-Preview нет вообще никакой колонки. Ни опубликованной таблицы бенчмарков, ни карточки модели, ни технического отчёта, ни репозитория на HuggingFace или в организации Meituan на GitHub, а метаданные каталога указывают открытые веса как false. Оценка примерно в 1,6 трлн общих / 48 млрд активных параметров взята из метаданных сайта Meituan и китайских отраслевых публикаций, а не из документации. Так что точная формулировка такова: оценки M3 посредственные и получены из независимых источников; у LongCat-2.5-Preview они отсутствуют. Модель, набирающая сорок с небольшим баллов по индексу программирования, — это известная величина, которую можно учитывать в планах. Модель без оценки — это риск иного рода, а одинаковая цена устраняет ту компенсацию, которая обычно оправдывает выбор в её пользу.

Когда одна и та же цена меняет то, что вам следует делать

Когда новая модель предлагает цену ниже, чем у конкурентов, рациональный ход — оценить её: потенциальная выгода — это реальная скидка. Когда новая модель выходит по ровно той же цене, что и действующий игрок, доступный с мая, выгода не в цене. Она в возможностях, а возможности — это единственное, чего LongCat-2.5-Preview не опубликовала. Это полностью меняет рамку оценки: вы проверяете не то, дешевле ли она, а то, лучше ли она — на ваших задачах, стартуя с нуля и без доказательств, на которые можно опереться.

Есть деталь второго порядка, которая делает этот тест дешевле, чем он выглядит. LongCat-2.5-Preview бесплатен и без ограничений через OpenCode в течение окна неуказанной длительности, с политикой нулевого хранения данных, которую OpenCode явно документирует — обучение модели «Not used», хранение данных «0 days», против тридцати дней у листинга для сравнения. Так что стоимость создания собственной оценки близка к нулю, а политика хранения означает, что вы можете запускать её на приватном коде. Единственная деталь харнесса, которую нужно уладить в первую очередь, — модель возвращает свою цепочку рассуждений во вложенном reasoning_content/ поле; клиенты, которые парсят chat completions, не ожидая этого, молча отбросят размышления и заставят модель выглядеть хуже, чем она есть.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Аргумент о маршрутизации, относящийся именно к сравнению при одинаковой цене.

Мы предоставляем MiniMax M3 по цене из прайс-листа MiniMax с нулевой наценкой. LongCat-2.5-Preview не является одним из наших маршрутов — мы его не обслуживаем, и ничто здесь не должно восприниматься как утверждение об обратном.

Совпадение по цене — это как раз тот случай, когда маршрутизация окупает себя, а не просто служит удобством. Если две модели стоят одинаково, выбор между ними делается для каждого запроса и каждой задачи: M3 — ради потолка вывода в 512 000 токенов и поддержки видео на входе, LongCat-2.5-Preview — ради скидки за кэшированный префикс в длинных агентных циклах, когда вы уже убедились в его качестве. Объединение моделей — это механизм, который делает это буквальным: этап поиска и этап синтеза могут быть разными моделями в рамках одного запроса, так что вас не заставляют выбирать победителя до того, как появятся доказательства. А поскольку мы передаём прайс-листовые цены провайдеров без наценки, изменение тарифа у вендора отражается в вашем счёте в тот же день, а не при следующем продлении контракта, — и это важно как никогда, когда одна из двух карточек явно рекламная. Автоматическое переключение при сбое покрывает случай, когда один из провайдеров деградирует, и особенно важно для модели, у которой нет истории обслуживания, которую можно изучить.

Часто задаваемые

• Дешевле ли LongCat-2.5-Preview, чем MiniMax M3? Нет. В опубликованных тарифах ставки за ввод и вывод идентичны — $0.30 и $1.20 за миллион. Единственное ценовое преимущество — на кэшированном вводе: $0.006 против $0.06, а Meituan помечает весь свой тариф как ограниченную по времени скидку, не сообщая, что будет дальше.

• У кого больше полезный объём вывода? У MiniMax M3 — со значительным отрывом: 512 000 токенов против 131 072. Для генерации длинных текстов, структурированного извлечения данных из больших документов или любых задач, где текст длиннее одной главы, этот потолок становится решающей характеристикой.

• Что из этого я могу проверить? MiniMax M3, и проверка ему не льстит — Coding 58,6 на сорок шестом месте и Intelligence Index 29,2 на шестидесятом месте по данным Artificial Analysis. У LongCat-2.5-Preview нет опубликованных оценок ни от кого. Если на этой неделе появится бенчмарк LongCat-2.5-Preview, считайте его непроверяемым, пока не сможете проследить его до названного оценщика.

• Что мне запускать в продакшен? Ни то, ни другое — без собственного теста. Из этих двух M3 — выбор с меньшей дисперсией, потому что его слабые места задокументированы, а входные модальности подтверждены; LongCat-2.5-Preview — выбор с большей дисперсией: заявленный контекст больше, потолок вывода намного меньше, есть скидка за кэш и ноль публичных доказательств. Запускайте его бесплатно, пока окно открыто, держите оба за одним ключом, и пусть последнее слово скажут ваши собственные цифры.