«Герой-титульная карточка для „Mercury 2.5 Preview vs Grok 4.6“ с подзаголовком „Сможет ли предварительная версия со скоростью 1,107 токенов/с обойти чемпиона по соотношению цены и качества?“, показывающая чип в виде молнии с надписью „1,107 ток/с“, чип-весы с надписью „ЦЕНА vs СКОРОСТЬ“, чип-трофей с надписью „AA #3“ и логотип OrcaRouter в правом нижнем углу.»
Guides & Insights

Mercury 2.5 Preview против Grok 4.6: Сможет ли предварительная версия со скоростью 1 107 токенов/с обойти чемпиона по соотношению цены и качества?

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Вот ответ одним предложением: Mercury 2.5 Preview — самая дешёвая заслуживающая доверия модель для рассуждений в продакшене на сегодня, $0,04 / $0,15 за миллион токенов, а Grok 4.6 — самая дешёвая модель на интеллектуальном переднем крае, $2,00 / $6,00 — так что практический вопрос между ними состоит в том, сможет ли диффузионная модель в статусе превью, которую Inception лишь называет «сопоставимой с» GPT-5.6 Luna (Low) и Claude Haiku 4.5, выполнять задачи, за которые в противном случае вы платили бы по ставке переднего края. Mercury 2.5 Preview, выпущенный 31 августа 2026 года, генерирует токены параллельно и заявляет о 1107 токенах в секунду на стандартных GPU; Grok 4.6, флагман переднего края, выпущенный 12 августа 2026 года, набирает 61 балл в Artificial Analysis Intelligence Index, деля мировое третье место, и делает это по цене, которой передний край ещё не видел. Именно это столкновение — самая быстрая заявка в нижней части ценовой кривой против лучшего соотношения цены и качества в верхней её части — и есть тема этой статьи.

Основные выводы

• Grok 4.6 по $2.00 / $6.00 с показателем AA Intelligence Index 61 — это оптимальный выбор по цене и качеству в классе frontier; Mercury 2.5 Preview по $0.04 / $0.15 — это ставка на то, что достаточно хорошее качество по цене в 50 раз ниже окажется лучше, чем frontier-качество, которое вам редко нужно.

Заявления Mercury 2.5 Preview о скорости и качестве полностью принадлежат Inception; на момент выхода не существовало независимых результатов бенчмарков.

Скидка 80% на запуск Mercury 2.5 Preview действует до 8 сентября 2026 года, после чего его цена составит $0,20 / $0,75 — это всё ещё в 10 раз дешевле Grok 4.6 по входу, но уже менее значительная история.

• Grok 4.6 сегодня маршрутизируется через OrcaRouter по прейскурантной цене; Mercury 2.5 Preview пока не маршрутизируется и предоставляется через собственный API Inception и несколько сторонних платформ.

Табло

A two-column scoreboard titled 'Mercury 2.5 Preview vs Grok 4.6 — the scoreboard': left column Mercury 2.5 Preview — Intelligence claimed cheap-tier parity, Price $0.04/$0.15 (80% off), Speed 1,107 tok/s (claimed), Context 260K, Agentic no public scores, Weights closed; right column Grok 4.6 — Intelligence AA Index 61 (#3), Price $2.00/$6.00, Speed not a headline spec, Context 500K, Agentic APEX-Agents 57.5, Weights closed; footer 'Mercury figures vendor-reported, unreproduced; Grok per xAI and Artificial Analysis'.

Интеллект — Mercury 2.5 Preview: независимого индекса нет; Inception заявляет о паритете с оптимизированным по стоимости уровнем. Grok 4.6: AA Intelligence Index 61, делит 3-е место в мире (по данным Artificial Analysis; цифры лаборатории приводит сам вендор).

Цена — Mercury 2.5 Preview: $0,04 / $0,15 за 1 млн (скидка 80% от $0,20 / $0,75, до 8 сентября 2026 г.). Grok 4.6: $2,00 / $6,00 за 1 млн, удваивается до $4,00 / $12,00 для запросов от 200 тыс. токенов и более.

Скорость — Mercury 2.5 Preview: по заявлению производителя, 1107 токенов/сек. Grok 4.6: скорость не является ключевой характеристикой; модель создана для длительных агентных запусков, а не для быстрых потоков.

Контекст — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.

Агентная работа — Mercury 2.5 Preview: публичных результатов нет, хотя параллельные вызовы инструментов поддерживаются. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (заявлены вендором, в основном не воспроизведены).

Веса — Mercury 2.5 Preview: закрытый, проприетарный. Grok 4.6: закрытый, проприетарный.

Чемпион по соотношению цены и качества и пропуск из-за цены

Позиция Grok 4.6 необычна. Он занимает третье место по интеллекту в индексе Artificial Analysis — наравне с GPT-5.6 Sol Max — а стоит дешевле любой модели в пределах десяти баллов от него. В освещении его запуска подчеркивались длительные агентные прогоны, которые в среднем обходились примерно в $0.84 за задачу по итогам одной оценки, проведенной вендором. Это определение чемпиона по соотношению цены и качества: возможности, близкие к передовым, по цене, делающей затраты на каждую задачу наглядными в таблице. Mercury 2.5 Preview не пытается быть таким. Inception позиционирует его против таких моделей, как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5 — это оптимизированный по стоимости уровень, а не передний край. Если Inception прав, Mercury 2.5 Preview находится на уровень ниже Grok 4.6 по возможностям и на несколько уровней ниже по цене, что делает его совершенно логичным продуктом: шагом вниз по цене для рабочих нагрузок, где передовой уровень — пустая трата.

Что на самом деле меняет параллельное декодирование

Архитектура — вот что стоит понять, потому что именно она меняет смысл слова «быстро». Авторегрессионные модели выпускают по одному токену за шаг, поэтому пропускная способность упирается в последовательную задержку; диффузионная LLM вроде Mercury 2.5 Preview генерирует блок токенов параллельно и уточняет его на шагах денойзинга, что делает пропускную способность независимой от количества выпущенных токенов. Поэтому Inception может заявлять о 1107 токенах в секунду на стандартных GPU — без специальных ускорителей и без трюков с пакетированием — и поэтому реальное продуктовое обещание — это менее 300 миллисекунд до первого токена для интерактивных нагрузок. Для голосового агента, поискового пайплайна или субагента-кодера, который обращается к модели на каждом шаге, эта разница в задержке и есть продукт: это разница между голосовым циклом, который ощущается живым, и тем, который делает паузы. Загвоздка в том, что диффузионные языковые модели — молодая область исследований, цифра 1107 принадлежит Inception, и ни одна независимая лаборатория не воспроизвела эту скорость и не измерила возможный дрейф качества, который параллельная генерация может вносить на длинных или состязательных промптах.

Где Grok 4.6 по-прежнему справляется с работой

Ничто в Mercury 2.5 Preview не затрагивает те части рынка, которые Grok 4.6 действительно выигрывает. Рост Grok по сравнению с Grok 4.5 был сосредоточен на агентных и кодовых бенчмарках — DeepSWE вырос на 11,9 пункта, APEX-Agents на 10,4, Terminal-Bench на 10,3 — а его контекстное окно в 500K существует для долгосрочных агентов, которым нужно удерживать всю задачу в контексте. Mercury 2.5 Preview предлагает параллельные вызовы инструментов, но модель без собственных агентных показателей, с лимитом вывода в 65 536 токенов и контекстом в 260K — не тот инструмент для 50-шагового процесса разработки ПО. Эти две модели почти не пересекаются по применению: Grok 4.6 — движок для работы, которая должна реально завершаться; Mercury 2.5 Preview — движок для работы, которая должна ощущаться мгновенной и стоить почти ничего за запрос.

Окно со скидкой 80%

У здешних цен есть срок действия, и это меняет решение. Тариф Mercury 2.5 Preview по $0,04 / $0,15 — это скидка 80% от базовой цены $0,20 / $0,75, а в Inception заявили, что акция продлится до 8 сентября 2026 года. $2,00 / $6,00 у Grok 4.6 — это стабильная базовая цена с прозрачной структурой: кэшированный ввод по $0,50, приоритетный тариф с множителем 2× и надбавка за длинные промпты от 200K токенов, при которой весь запрос тарифицируется по повышенной ставке. Если сравнивать сегодняшние цифры, Mercury выглядит в 50 раз дешевле по вводу и в 40 раз дешевле по выводу; если скидка истечёт как запланировано, реальный долгосрочный разрыв составит 10× по вводу и 5× по выводу. Обе формулировки честны — это просто разные временные горизонты, и пайплайн, рассчитанный на скидку без точки пересмотра, будет застигнут врасплох 9 сентября. $2,00 / $6,00 у Grok 4.6 — это именно то, что вы платите на OrcaRouter, где базовая цена провайдера проходит с нулевой наценкой — когда провайдер меняет цифру, она в тот же день становится активной на том же ключе, с автоматическим переключением на другой путь, если один из путей провайдера начинает ограничивать частоту запросов.

Вердикт одной строкой

Если задачу нужно обязательно завершить и вам нужны передовые возможности по лучшей цене в этом классе, покупайте Grok 4.6 — это проверенный чемпион по соотношению цены и качества, уже доступный на OrcaRouter по $2.00 / $6.00. Если же речь идёт о высоконагруженных текстовых рассуждениях, чувствительных к задержке, где приемлемые ответы легко и дёшево проверить, то Mercury 2.5 Preview по цене $0.04 / $0.15 — это очень выгодное предложение, которое стоит протестировать, пока действует скидка. Просто помните: любые заявления на его стороне доски — это заявления Inception, и они пока ничем не подтверждены.

A screenshot of the Inception documentation page 'Models, Endpoints, and Pricing' (captured September 1, 2026), showing the Mercury family pricing table — Mercury 2 and Mercury Edit 2 both at $0.25 input / $0.025 cached / $0.75 output per 1M tokens — and a cURL chat-completions API example.A screenshot of the OrcaRouter model page for Grok 4.6 (grok/grok-4.6), showing the model header, the '$2.00' price badge, and the model description noting the August 12, 2026 release.

OrcaRouter передает цены поставщика по прайс-листу с 0% наценкой с автоматическим переключением, поэтому изменение цены поставщика становится активным на том же ключе в тот же день.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube