Сгенерированная титульная карточка с текстом: GPT-6 Sol против MiniMax M3 — чего не даёт восьмикратная цена вывода, со статистическими карточками: цена вывода $10.00 против $1.20 за миллион, индекс интеллекта 47.6 против 29.2, веса закрытые против открытых, а в нижнем колонтитуле — индекс по Artificial Analysis v4.3.2; тарифы MiniMax M3 — по данным MiniMax, тарифы GPT-6 Sol — по тарифной карте OpenAI.
Guides & Insights

GPT-6 Sol против MiniMax M3: что всё ещё не купить даже за восьмикратную цену вывода

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Первое, что нужно сказать о GPT-6 Sol в сравнении с MiniMax M3, — это то, что цена совсем не близка, и оценка тоже не близка, причём они указывают в противоположные стороны. MiniMax M3 — это модель с открытыми весами, которую можно скачать и запустить самостоятельно; её цена указана как $0,30 за миллион входных токенов и $1,20 за миллион выходных; GPT-6 Sol, средний уровень поколения GPT-6, выпущенного 22 сентября 2026 года, стоит $2,00 и $10,00 за те же единицы. Это чуть более чем в восемь раз превышает цену за выходные токены. MiniMax M3 также принимает видео в качестве входной модальности, чего GPT-6 Sol не делает — модель Sol принимает текст, изображения и файлы. Чего у M3 нет, так это оценки, хоть сколько-нибудь близкой к оценке Sol: 29,2 против 47,6 в Индексе интеллекта Artificial Analysis, в той же версии рейтинга v4.3.2.

Эта асимметрия — и есть вся суть, и она интереснее, чем простой компромисс между ценой и качеством, потому что колонка с открытыми весами сохраняет то, что закрытая колонка не может продать ни за какие деньги: контрольные точки M3 находятся на Hugging Face, и модель можно запускать внутри периметра сети. Если вы выбираете между этими двумя, полезный вопрос не в том, что лучше. А в том, от чего из четырёх отдельных вещей, которые вы покупаете — цены, пропускной способности, контроля или возможностей, — вы можете позволить себе отказаться.

Четыре измерения, и они ранжируются не одинаково.

• Цена вывода — GPT-6 Sol $10.00 за миллион против MiniMax M3 $1.20 за миллион
• Цена ввода — GPT-6 Sol $2.00 за миллион против MiniMax M3 $0.30 за миллион
• Кэшированный ввод — GPT-6 Sol $0.20 за миллион против MiniMax M3 $0.06 за миллион
• Веса — GPT-6 Sol закрытые, только API против MiniMax M3 с открытыми весами и возможностью самостоятельного хостинга
• Входные модальности — GPT-6 Sol текст, изображения и файлы против MiniMax M3 текст, изображения и видео
• Контекстное окно — GPT-6 Sol 1 050 000 токенов против MiniMax M3 1 048 576 токенов
• Макс. вывод — GPT-6 Sol 128 000 токенов против MiniMax M3 512 000 токенов
• Индекс интеллекта — GPT-6 Sol 47.6 против MiniMax M3 29.2
• Индекс программирования — GPT-6 Sol не опубликован в этой версии против MiniMax M3 58.6
• Ступень для длинных запросов — GPT-6 Sol переоценивает весь запрос при превышении 272 000 входных токенов против MiniMax M3 — без ступени в его карточке

Две из этих строк заслуживают большего, чем одна строка. Потолок максимального вывода работает в противоположную сторону по сравнению со всем остальным: M3 сможет выдавать до 512 000 токенов в одном ответе — в четыре раза больше, чем 128 000 у GPT-6 Sol. Для рабочей нагрузки, которая генерирует целый файл или длинный отчёт за один вызов, это структурное преимущество, а не погрешность округления. А надбавка за длинные запросы — это реальная статья расходов GPT-6 Sol, которой у M3 нет вообще: при превышении 272 000 входных токенов Sol пересчитывает стоимость всего запроса на $4,00 / $15,00, тогда как в спецификации M3 нет аналогичного пункта. При промпте в 300 000 токенов соотношение ставок за вывод составляет не восемь раз, а двенадцать с половиной.

Так что честный рейтинг полностью зависит от рабочей нагрузки. Для массовой классификации или извлечения данных, где неверный ответ дёшев, а медленный — нет, M3 за $0.30 / $1.20 без надбавки за длинный контекст — разумный выбор по умолчанию, а Sol — это сожжённые деньги. А для задачи, где первый ответ обязан быть правильным — план миграции, проверка безопасности, цепочка рассуждений, которую прочитает человек и будет по ней действовать, — разрыв в индексе на 18,4 пункта при восьмикратной цене за вывод — это компромисс, на который идёт большинство команд, ведь альтернатива — платить человеку, чтобы он это исправил.

Generated comparison scoreboard titled GPT-6 Sol vs MiniMax M3, the scoreboard, with six matched rows. GPT-6 Sol: input $2.00 per million, output $10.00 per million, weights closed, Intelligence Index 47.6, context window 1,050,000 tokens, reprices above 272K input tokens. MiniMax M3: input $0.30 per million, output $1.20 per million, weights open and downloadable, Intelligence Index 29.2, context window 1,048,576 tokens, no long-request step. A footer reads MiniMax M3 figures per Artificial Analysis v4.3.2 and MiniMax; GPT-6 Sol figures per Artificial Analysis v4.3.2 and OpenAI.

Где опубликованные показатели M3 необычно хороши, а где они скудны

Самые сильные независимые показатели MiniMax M3 оказываются не там, где можно было бы ожидать от модели за такую цену. Воспроизведение в длинном контексте составляет 83,0 — это на 0,7 ниже, чем 83,7 у GPT-6 Sol, и фактически ничья — на окне в миллион токенов, при цене ввода в шесть раз ниже. GPQA Diamond показывает 92,9 — достаточно близко к фронтирному диапазону, чтобы разница укладывалась в пределы, которые следовало бы ожидать от настроек интенсивности рассуждений, а не от способностей. Эти две строки — причина, по которой M3 стоит воспринимать серьёзно, а не относить к разряду «дешёвых».

Слабые места столь же очевидны, и о них следует говорить прямо, а не сглаживать. Использование инструментов в розничном стиле оставляет желать лучшего: в tau-banking M3 набирает 15,3, а в более новой редакции Terminal-Bench 4.0 — 2,0. Оба этих показателя — сторонние измерения, и оба указывают на модель, у которой средний балл по бенчмаркам скрывает конкретную крупную слабость в агентном вызове инструментов при работе с имитированным сервисом. Собственные заявленные цифры вендора рисуют гораздо более благоприятную картину — SWE-Bench Pro 59, BrowseComp 83,5, MCP Atlas 74,2, Terminal-Bench 2.1 — 66 — и это цифры вендора на его собственном стенде, то есть утверждение, а не измерение. Любое развёртывание, зависящее от использования инструментов, должно рассматривать обе группы чисел в совокупности и проверять это напрямую.

Есть момент второго порядка относительно самого сравнения бенчмарков. GPT-6 Sol измеряется на меньшем наборе бенчмарков в нашем каталоге, чем M3, — пять оценок против двадцати трёх у M3, — потому что вендор публикует меньше, а третьи стороны провели меньше тестов с ним. Модель с двадцатью тремя опубликованными числами всегда будет выглядеть более тщательно оценённой, чем модель с пятью, и разница здесь в документации, а не в возможностях.

Что на самом деле дают открытые веса — помимо более низкого счёта

Самостоятельный хостинг M3 — это вариант, который GPT-6 Sol не может предложить, и его ценность не в основном финансовая. При $0,30 / $1,20 API дешевле, чем стоимость эксплуатации оборудования у большинства команд, поэтому причина скачать его — ограничение, а не электронная таблица: данные, которые не могут покинуть периметр, рабочая нагрузка без приемлемой внешней зависимости, дообучение или бюджет задержки, который не может обеспечить общий эндпоинт. Открытые веса — единственный из этих четырёх пунктов, на который закрытая модель может ответить, и она отвечает на него тем, что недоступна. Ответ GPT-6 Sol состоит в том, что вам не нужно его запускать, — это другой аргумент, и он верен для другого набора команд.

Пропускная способность заслуживает отдельной строки, потому что это число, которое демо никогда не показывает. MiniMax M3 в нашем скользящем семидневном окне выдаёт примерно 495 выходных токенов в секунду, а GPT-6 Sol — примерно 244. M3 в этом сравнении не просто более дешёвая модель, а ещё и более быстрая на наших маршрутах — примерно вдвое, а это меняет стоимость пакетной задачи как по реальному времени, так и в долларах. Оговорка: это скользящие окна на общей площадке, а не контролируемый бенчмарк, и они меняются.

OrcaRouter model page for MiniMax M3 (minimax/minimax-m3) by MiniMax, dated 2026-05-31, tagged Vision, Tools, JSON and Reasoning, describing it as MiniMax's flagship open-weight foundation model with a 1M-token context window and text, image and video input, listing $0.30 per million input and $1.20 per million output, with a model-page note that it is available through OrcaRouter under the model id minimax/minimax-m3.

Запуск пары как единой системы

Обе модели стоят за одним ключом OrcaRouter наряду с более чем 200 другими, поэтому интересная конфигурация здесь — это каскад «сначала дешёвое», а не выбор. Направьте основной объём на MiniMax M3, держите GPT-6 Sol позади него для запросов, которые не проходят проверку или подают сигнал о сложности, и итоговая смешанная стоимость окажется гораздо ближе к тарифу открытых весов, чем к тарифу Sol, при этом сложные случаи всё равно попадут к модели с результатом 47.6. Именно в DSL маршрутизации OrcaRouter выражается эта композиция — вызов может указывать несколько моделей и условия между ними вместо жёсткого назначения одной конечной точки на задачу.

Для команд, которые действительно не могут определиться, объединение моделей — это грубая версия той же идеи: панель моделей отвечает вместе, а ответы объединяются. Оно плохо подходит для массовой работы и вполне подходит для редко запускаемого запроса с высокими ставками, где разница между ответами 29,2 и 47,6 — единственное, что есть на странице.

Переключение при сбое важнее для модели с открытыми весами, чем для закрытой, и по конкретной причине: M3 обслуживается более чем одним инфраструктурным провайдером, и эндпоинты различаются. Второй маршрут, настроенный заранее, означает, что медленный или деградировавший хост — это повторная попытка, а не простой. И поскольку наш каталог передаёт прайс-листовые цены провайдеров без наценки, изменение тарифов вендора вступает в силу у нас в тот же день — что важно для строки вывода за $1.20, где изменение вендором одной ставки за кэшированный ввод заметно меняет счёт.

Artificial Analysis model page for MiniMax-M3, described as an open-weights model released June 2026, showing an Intelligence rank of 18 of 117 with an Intelligence Index of 29 on a comparable-model median of 18, an output speed rating above average, a 1M-token context window, and support for text, image and video input with text output.

Кому из них вам действительно стоит позвонить?

Берите MiniMax M3 для объёма, для всего, что требует видеовхода, для всего, что должно выдавать больше 128 000 токенов в одном ответе, и для всего, что должно работать внутри вашего собственного периметра. Берите GPT-6 Sol для запросов, ответ на которые и есть продукт, для насыщенных инструментами агентных циклов, где показатели M3 по tau-banking и Terminal-Bench 4.0 — предупреждение, а не сноска, и для всего, где разница в 18 пунктов индекса стоит для вас восьмикратной скорости вывода. Берите оба и позвольте маршрутизатору решать, если ни то, ни другое не описывает весь ваш трафик.

Одно, что стоит проверить перед любым из них, — и это та же контрольная точка, на которую постоянно натыкается этот блог: M3 с мая 2026 года является флагманом линейки M-series и остаётся самой новой моделью M-series в нашем каталоге, так что он действительно актуален, — но GPT-6 Sol уже вытеснен GPT-6.1 Sol при тех же тарифах для короткого контекста и с более дешёвым кэшированным вводом, а на его собственной странице GPT-6 Sol есть указатель на него. Если причина, по которой вы смотрите на Sol здесь, — это возможности, а не восьмидневная интеграция, сначала посмотрите на преемника.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно