
Mercury 2.5 Preview против Grok 4.6: Сможет ли предварительная версия со скоростью 1 107 токенов/с обойти чемпиона по соотношению цены и качества?
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
Вот ответ одним предложением: Mercury 2.5 Preview — самая дешёвая заслуживающая доверия модель для рассуждений в продакшене на сегодня, $0,04 / $0,15 за миллион токенов, а Grok 4.6 — самая дешёвая модель на интеллектуальном переднем крае, $2,00 / $6,00 — так что практический вопрос между ними состоит в том, сможет ли диффузионная модель в статусе превью, которую Inception лишь называет «сопоставимой с» GPT-5.6 Luna (Low) и Claude Haiku 4.5, выполнять задачи, за которые в противном случае вы платили бы по ставке переднего края. Mercury 2.5 Preview, выпущенный 31 августа 2026 года, генерирует токены параллельно и заявляет о 1107 токенах в секунду на стандартных GPU; Grok 4.6, флагман переднего края, выпущенный 12 августа 2026 года, набирает 61 балл в Artificial Analysis Intelligence Index, деля мировое третье место, и делает это по цене, которой передний край ещё не видел. Именно это столкновение — самая быстрая заявка в нижней части ценовой кривой против лучшего соотношения цены и качества в верхней её части — и есть тема этой статьи.
Основные выводы
• Grok 4.6 по $2.00 / $6.00 с показателем AA Intelligence Index 61 — это оптимальный выбор по цене и качеству в классе frontier; Mercury 2.5 Preview по $0.04 / $0.15 — это ставка на то, что достаточно хорошее качество по цене в 50 раз ниже окажется лучше, чем frontier-качество, которое вам редко нужно.
Заявления Mercury 2.5 Preview о скорости и качестве полностью принадлежат Inception; на момент выхода не существовало независимых результатов бенчмарков.
Скидка 80% на запуск Mercury 2.5 Preview действует до 8 сентября 2026 года, после чего его цена составит $0,20 / $0,75 — это всё ещё в 10 раз дешевле Grok 4.6 по входу, но уже менее значительная история.
• Grok 4.6 сегодня маршрутизируется через OrcaRouter по прейскурантной цене; Mercury 2.5 Preview пока не маршрутизируется и предоставляется через собственный API Inception и несколько сторонних платформ.
Табло

• Интеллект — Mercury 2.5 Preview: независимого индекса нет; Inception заявляет о паритете с оптимизированным по стоимости уровнем. Grok 4.6: AA Intelligence Index 61, делит 3-е место в мире (по данным Artificial Analysis; цифры лаборатории приводит сам вендор).
• Цена — Mercury 2.5 Preview: $0,04 / $0,15 за 1 млн (скидка 80% от $0,20 / $0,75, до 8 сентября 2026 г.). Grok 4.6: $2,00 / $6,00 за 1 млн, удваивается до $4,00 / $12,00 для запросов от 200 тыс. токенов и более.
• Скорость — Mercury 2.5 Preview: по заявлению производителя, 1107 токенов/сек. Grok 4.6: скорость не является ключевой характеристикой; модель создана для длительных агентных запусков, а не для быстрых потоков.
• Контекст — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.
• Агентная работа — Mercury 2.5 Preview: публичных результатов нет, хотя параллельные вызовы инструментов поддерживаются. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (заявлены вендором, в основном не воспроизведены).
• Веса — Mercury 2.5 Preview: закрытый, проприетарный. Grok 4.6: закрытый, проприетарный.
Чемпион по соотношению цены и качества и пропуск из-за цены
Позиция Grok 4.6 необычна. Он занимает третье место по интеллекту в индексе Artificial Analysis — наравне с GPT-5.6 Sol Max — а стоит дешевле любой модели в пределах десяти баллов от него. В освещении его запуска подчеркивались длительные агентные прогоны, которые в среднем обходились примерно в $0.84 за задачу по итогам одной оценки, проведенной вендором. Это определение чемпиона по соотношению цены и качества: возможности, близкие к передовым, по цене, делающей затраты на каждую задачу наглядными в таблице. Mercury 2.5 Preview не пытается быть таким. Inception позиционирует его против таких моделей, как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5 — это оптимизированный по стоимости уровень, а не передний край. Если Inception прав, Mercury 2.5 Preview находится на уровень ниже Grok 4.6 по возможностям и на несколько уровней ниже по цене, что делает его совершенно логичным продуктом: шагом вниз по цене для рабочих нагрузок, где передовой уровень — пустая трата.
Что на самом деле меняет параллельное декодирование
Архитектура — вот что стоит понять, потому что именно она меняет смысл слова «быстро». Авторегрессионные модели выпускают по одному токену за шаг, поэтому пропускная способность упирается в последовательную задержку; диффузионная LLM вроде Mercury 2.5 Preview генерирует блок токенов параллельно и уточняет его на шагах денойзинга, что делает пропускную способность независимой от количества выпущенных токенов. Поэтому Inception может заявлять о 1107 токенах в секунду на стандартных GPU — без специальных ускорителей и без трюков с пакетированием — и поэтому реальное продуктовое обещание — это менее 300 миллисекунд до первого токена для интерактивных нагрузок. Для голосового агента, поискового пайплайна или субагента-кодера, который обращается к модели на каждом шаге, эта разница в задержке и есть продукт: это разница между голосовым циклом, который ощущается живым, и тем, который делает паузы. Загвоздка в том, что диффузионные языковые модели — молодая область исследований, цифра 1107 принадлежит Inception, и ни одна независимая лаборатория не воспроизвела эту скорость и не измерила возможный дрейф качества, который параллельная генерация может вносить на длинных или состязательных промптах.
Где Grok 4.6 по-прежнему справляется с работой
Ничто в Mercury 2.5 Preview не затрагивает те части рынка, которые Grok 4.6 действительно выигрывает. Рост Grok по сравнению с Grok 4.5 был сосредоточен на агентных и кодовых бенчмарках — DeepSWE вырос на 11,9 пункта, APEX-Agents на 10,4, Terminal-Bench на 10,3 — а его контекстное окно в 500K существует для долгосрочных агентов, которым нужно удерживать всю задачу в контексте. Mercury 2.5 Preview предлагает параллельные вызовы инструментов, но модель без собственных агентных показателей, с лимитом вывода в 65 536 токенов и контекстом в 260K — не тот инструмент для 50-шагового процесса разработки ПО. Эти две модели почти не пересекаются по применению: Grok 4.6 — движок для работы, которая должна реально завершаться; Mercury 2.5 Preview — движок для работы, которая должна ощущаться мгновенной и стоить почти ничего за запрос.
Окно со скидкой 80%
У здешних цен есть срок действия, и это меняет решение. Тариф Mercury 2.5 Preview по $0,04 / $0,15 — это скидка 80% от базовой цены $0,20 / $0,75, а в Inception заявили, что акция продлится до 8 сентября 2026 года. $2,00 / $6,00 у Grok 4.6 — это стабильная базовая цена с прозрачной структурой: кэшированный ввод по $0,50, приоритетный тариф с множителем 2× и надбавка за длинные промпты от 200K токенов, при которой весь запрос тарифицируется по повышенной ставке. Если сравнивать сегодняшние цифры, Mercury выглядит в 50 раз дешевле по вводу и в 40 раз дешевле по выводу; если скидка истечёт как запланировано, реальный долгосрочный разрыв составит 10× по вводу и 5× по выводу. Обе формулировки честны — это просто разные временные горизонты, и пайплайн, рассчитанный на скидку без точки пересмотра, будет застигнут врасплох 9 сентября. $2,00 / $6,00 у Grok 4.6 — это именно то, что вы платите на OrcaRouter, где базовая цена провайдера проходит с нулевой наценкой — когда провайдер меняет цифру, она в тот же день становится активной на том же ключе, с автоматическим переключением на другой путь, если один из путей провайдера начинает ограничивать частоту запросов.
Вердикт одной строкой
Если задачу нужно обязательно завершить и вам нужны передовые возможности по лучшей цене в этом классе, покупайте Grok 4.6 — это проверенный чемпион по соотношению цены и качества, уже доступный на OrcaRouter по $2.00 / $6.00. Если же речь идёт о высоконагруженных текстовых рассуждениях, чувствительных к задержке, где приемлемые ответы легко и дёшево проверить, то Mercury 2.5 Preview по цене $0.04 / $0.15 — это очень выгодное предложение, которое стоит протестировать, пока действует скидка. Просто помните: любые заявления на его стороне доски — это заявления Inception, и они пока ничем не подтверждены.


OrcaRouter передает цены поставщика по прайс-листу с 0% наценкой с автоматическим переключением, поэтому изменение цены поставщика становится активным на том же ключе в тот же день.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
