Сгенерированная карточка главного заголовка с текстом «LongCat-2.5-Preview против GPT-5.6 Sol» и надписью сверху «Окно в 1M, цена которого не меняется на всём протяжении», а также две панели: «LongCat-2.5-Preview: $0.30 / $1.20 за 1M, макс. вывод 131 072» и «GPT-5.6 Sol: $4.00 / $20.00 за 1M, удваивается после 272K входных данных». Логотип OrcaRouter в правом нижнем углу.
Engineering & Research

LongCat-2.5-Preview против GPT-5.6 Sol: во сколько обходится окно в 1 млн токенов каждой стороне

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Самое полезное, что можно сказать о LongCat-2.5-Preview в сравнении с GPT-5.6 Sol, — это не то, какая из них умнее. Дело в том, что обе рекламируют контекстное окно примерно в миллион токенов, и только одна из них взимает одинаковую плату за всё окно. Цена Sol удваивается после 272 000 входных токенов. Опубликованная тарифная сетка LongCat-2.5-Preview, судя по тому, как её описывает Meituan, вообще не имеет градаций. Это одно структурное различие решает большинство реальных рабочих нагрузок с длинными документами ещё до того, как кто-либо обратится к бенчмаркам, — и это именно то, чего сравнение спецификаций никогда вам не покажет, потому что обе модели указывают «1M» одним и тем же шрифтом.

Вот что в действительности официально зафиксировано по каждому — в разбивке по вопросам, которые стоит задать.

Окно в миллион токенов — это один и тот же продукт с обеих сторон?

Нет, и разница не в окне — а в том, что происходит, когда вы его заполняете. В нашем каталоге Sol доступен с контекстным окном на 1 050 000 токенов и максимальным объёмом вывода 128 000 токенов: 4,00 доллара США за миллион входных токенов и 20,00 долларов США за миллион выходных токенов для запросов объёмом до 272 000 токенов, при этом кэшированный ввод стоит 0,40 доллара США за миллион, а запись в кэш — 5,00 доллара США за миллион. Выше этого порога тарифы возрастают до 8,00 и 30,00 долларов США за миллион. Так что обработка документа объёмом 500 000 токенов на Sol тарифицируется по тарифу для длинного контекста за весь запрос, а не по смешанному тарифу.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview заявляет контекст в 1 000 000 токенов и максимальный объём вывода в 131 072 токена. Его тарифная сетка, опубликованная на собственной платформе Meituan и отмеченная там как скидка на ограниченное время, составляет $0.30 за миллион некэшированных входных токенов, $0.006 за миллион кэшированных входных токенов и $1.20 за миллион выходных токенов. Meituan не публикует второй тарифный уровень. Это не то же самое, что утверждать, будто его не существует, — это означает, что поставщик его не описал, а цену, которая не описана, нельзя заложить в бюджет.

Назовите число. Чтение в 500 000 токенов, которое записывает обратно 20 000 токенов, стоит примерно $4,60 на Sol на тарифе для длинного контекста и примерно 17 центов на LongCat-2.5-Preview по его опубликованной промо-цене. Обе цифры — это арифметика по опубликованным прайс-листам, а не измерения. Соотношение достаточно велико, чтобы изменить то, что экономически разумно пытаться делать: при тарифах Sol для длинного контекста подача кодовой базы в модель — это решение; при тарифах LongCat это ближе к варианту по умолчанию.

У какого из них есть доказательства, стоящие за этой цифрой?

Sol — с большим отрывом, и именно это не позволяет свести сравнение к чисто ценовому аргументу. Sol — релиз июля 2026 года с полноценным независимым профилем в нашем каталоге: Coding Index 77,4, третий среди моделей, которые отслеживает Artificial Analysis; Intelligence Index 47, тринадцатое место; GPQA Diamond 94,1%; Humanity's Last Exam 49,5%; SciCode 57,1%; Terminal-Bench v2.1 — 88,0; τ²-Bench — 85,1. Все эти данные взяты из Artificial Analysis, а не из OpenAI.

Самое релевантное число для этого сравнения — Long-Context Recall: 84. Это самый высокий показатель среди передовых моделей, которые мы предлагаем, и это измерение того, продолжает ли модель использовать информацию в глубине длинного ввода — вопрос, на который должно отвечать большое контекстное окно. При этом он снят при собственной длине контекста Sol и на собственных условиях Sol.

У LongCat-2.5-Preview нет аналогов. Запись в журнале изменений Meituan от 25 сентября 2026 года заявляет о понимании изображений, способности к программированию и совместимости с «Claude Code и другими основными средами разработки», упоминая Hermes, OpenClaw, OpenCode и Kilo Code. В ней не публикуется ни таблица бенчмарков, ни карточка модели, ни технический отчёт. Сообщается о примерно 1,6 трлн общих параметров при примерно 48 млрд активных на токен — эти сведения взяты из метаданных сайта Meituan и китайских отраслевых публикаций, а не из документации. На HuggingFace нет репозитория LongCat-2.5-Preview, его нет и в организации Meituan на GitHub, а метаданные каталога, поставляемые OpenCode, указывают открытые веса как false.

A screenshot of OrcaRouter's own model page for OpenAI GPT-5.6 Sol at /models/openai/gpt-5.6-sol, showing the openai/gpt-5.6-sol identifier, a 1.05M-token context window, 128K maximum output, text + image + file input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-07-09, a p50 first-token figure of 10.00 s, $4.00 and $20.00 rate tiles, and the OpenAI-compatible code samples.

Входная сторона совпадает, или только выходная?

Именно здесь профиль Sol шире, а у LongCat он спорен. Sol принимает текст, изображения и файлы на вход в нашем каталоге и возвращает текст. В списке изменений LongCat-2.5-Preview понимание изображений представлено как главное нововведение — «разбирать содержимое изображений для кросс-модального ответа на вопросы, обобщения контента и сложных визуальных рассуждений» — но пример ответа в собственной документации Meituan «Retrieve Model» по-прежнему показывает input_modalities как ["text"] со text->text строкой модальности. Возможно, этот пример просто устарел. Тем не менее это опубликованный контракт вендора, и честная интерпретация такова: ввод изображений скорее заявлен, чем подтверждён, пока вы его не проверите.

Одно практическое следствие: трассировка рассуждений от LongCat-2.5-Preview поступает в чередующемся reasoning_content поле, а не как сэмплированный параметр. Обвязки, которые разбирают chat completions, не ожидая этого поля, молча отбросят размышления модели — без ошибки, просто ответ будет хуже. Что бы вы ни решили насчёт самой модели, сначала проверьте это.

Какой из них — маршрут, который вы действительно сможете сохранить?

Sol — одна из наших моделей. Мы предоставляем её по каталожной цене OpenAI с нулевой наценкой, поэтому изменение цены поставщика отражается в вашем счёте в тот же день, а не при следующем продлении, и автоматическое переключение при сбое переводит деградировавший запрос к работоспособному провайдеру незаметно для вашего приложения. LongCat-2.5-Preview не входит в число наших маршрутов — мы её не обслуживаем, и ничто в этом материале не следует воспринимать как утверждение об обратном.

Именно эта асимметрия — причина, по которой слой маршрутизации заслуживает своего места в этом конкретном сравнении, а не в качестве общего замечания. Многоуровневое ценообразование Sol означает, что одна и та же задача может стоить вдвое дороже исключительно из-за длины входных данных, а порог находится на уровне 272 000 токенов — число, которое ваше приложение знает до отправки запроса. Разделение рабочей нагрузки по размеру запроса между провайдерами — это именно то, для чего нужен DSL маршрутизации, и слияние моделей идёт дальше: две модели можно скомпоновать в одном запросе, чтобы этап обработки длинного контекста и этап высококачественного синтеза не обязаны были выполняться одной и той же моделью по одной и той же цене. Ни то, ни другое не является причиной выбирать модель без опубликованного бенчмарка. И то, и другое — причины не жёстко привязываться к одной модели.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs GPT-5.6 Sol' with the subhead 'Two million-token windows, and only one of them prices the whole window the same'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, no second tier described by the vendor, $1.20 output flagged limited-time, long-context recall not published, no repo and catalogue open_weights false. Right column 'GPT-5.6 Sol' (OpenAI, released 2026-07-09, independently scored): 1,050,000-token context, 128,000 max output, text, image and file to text, $4.00 input up to 272K then $8.00, price doubles at 272,000 input tokens, $20.00 output up to 272K then $30.00, long-context recall 84, coding index 77.4 at rank 3 by Artificial Analysis. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Итог

Если ваша рабочая нагрузка короткая, Sol — очевидный выбор: он третий в индексе кодирования, у него независимые показатели по всем параметрам, а его входная часть документирована. Если ваша рабочая нагрузка длинная, арифметика резко переворачивается — тариф Sol для длинного контекста примерно в 26 раз дороже промо-тарифа LongCat-2.5-Preview за тот же объём чтения в 500 000 токенов, и именно у Sol показатель recall, равный 84, действительно отвечает на вопрос, работает ли длинное окно. Вы покупаете измеренное длинное окно по цене фронтирного уровня против неизмеренного длинного окна по скидочной цене, которую поставщик уже назвал временной.

Режим отказа, которого следует избегать, — это отношение к ним как к сопоставимым вариантам. Это не один и тот же продукт, продаваемый по разным ценам; это задокументированная возможность и обещание. Правильный способ закрыть разрыв — запускать LongCat-2.5-Preview на ваших собственных задачах с длинным контекстом, пока он бесплатен через OpenCode или дёшев через Meituan, — и держать Sol за роутером, чтобы в тот день, когда промо-тариф исчезнет или уровень с длинным контекстом выйдет за рамки вашего бюджета, переключение было строкой конфигурации, а не миграцией.