Hero-карточка с заголовком «Claude Sonnet 5.5 vs Grok 4.6», подзаголовком «тарифная сетка говорит одно, а счёт за токены — другое», с плашками «вывод $10 против $6», «стоимость за задачу $7.60 против $1.86» и «Индекс 56 против 44», а в футере — ссылка на Artificial Analysis v4.3.2 и цены вендоров.
Guides & Insights

Claude Sonnet 5.5 против Grok 4.6: В прайс-листе одно, а в счёте за токены — другое

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Арифметика в заголовке выглядит решённой ещё до начала статьи. Grok 4.6 стоит $2 за миллион входных токенов и $6 за миллион выходных; Claude Sonnet 5.5 стоит $2 и $10. Модель Space​XAI дешевле на выходе на 40%, по стоимости ввода совпадает и находится в общем доступе с 12 августа 2026 года — достаточно долго, чтобы её особенности были задокументированы, а не оставались слухами. Модель Anthro​pic появилась 28 сентября 2026 года, за день до написания этой статьи, и с большим отрывом является самой новой в этой категории.

Затем вы доходите до независимых показателей эффективности, и порядок меняется на противоположный. Artificial Analysis измеряет модели класса GPT и Claude на основе стоимости за задачу наряду со своим Intelligence Index, и в редакции v4.3.2 две модели здесь — $1.86 за задачу индекса для Grok 4.6 и $7.60 для Claude Sonnet 5.5. Модель с более дешёвой тарифной сеткой оказывается дорогой в эксплуатации — в четыре раза. Разобраться, почему это так и когда это обращение справедливо, а когда нет, — в этом и состоит всё сравнение.

Две модели, две позиции в своих семействах

Grok 4.6 — текущий флагман линейки Grok: в собственной документации для разработчиков SpaceXAI он указан как новейший, и он сменил Grok 4.5 с тем же контекстным окном в 500 000 токенов, той же поверхностью ввода текста, изображений и файлов и той же базовой ценой. Он поддерживает настраиваемые усилия рассуждения, нативный вызов инструментов, структурированные выходные данные и полную поверхность сэмплирования, а как первоклассная модель OpenAI Responses он встраивается в существующие агентные фреймворки без слоя трансляции. Artificial Analysis присваивает ему индекс интеллекта 44, он занимает 31-е место из 216 измеряемых моделей, а показатель GPQA Diamond составляет 94,9%.

Two-column scoreboard for Claude Sonnet 5.5 and Grok 4.6 across six rows. Left column Claude Sonnet 5.5: input $2.00 per million, output $10.00 per million, 1M-token context, AA Intelligence Index 56, cost per Index task $7.60, verbosity 410M output tokens. Right column Grok 4.6: input $2.00 per million, output $6.00 per million, 500K-token context, AA Intelligence Index 44, cost per Index task $1.86, verbosity 94M output tokens. A footer line reads Index, cost per task and verbosity per Artificial Analysis v4.3.2; prices per the vendors.

Claude Sonnet 5.5 — второй представитель поколения 5.5 от Anthropic и модель, которую компания позиционирует как лучшее сочетание скорости и интеллекта в своей линейке. Она поставляется как claude-sonnet-5-5/ в Claude API и трёх крупнейших облачных платформах, имеет контекстное окно на 1 млн токенов при потолке синхронного вывода 128K, сохраняет тарифы Claude Sonnet 5 в размере $2 / $10 за вход, выход и кэширование и доступна при нулевом хранении данных. В той же ревизии индекса она набирает 56 баллов и занимает третье место из 216.

Так что эти две модели не совсем на одном рынке. Одна — это фронтирная модель с 500 000 токенов, которая продаётся уже семь недель по экономной цене. Другая — это универсальный уровень с 1 млн токенов, который стоит не больше за токен, чем его предшественник, и набирает на двенадцать баллов больше по комплексному показателю. Тем не менее сравнение стоит провести, потому что обе являются моделями с входной ценой $2, и именно с этого фактически начинаются решения о закупке.

Четырёхкратный разрыв, который никто не выносит на слайд

Тарифные карточки назначают цену токенам. Счета исчисляются в задачах, а количество токенов, которое модель тратит на достижение ответа, — это дизайнерское решение, а не постоянная величина. Именно здесь эти два подхода расходятся, и измеренные цифры разительны:

• Тариф за вывод — Claude Sonnet 5.5 $10 за миллион против Grok 4.6 $6 за миллион

• Стоимость одной задачи Intelligence Index — Claude Sonnet 5.5 $7.60 против Grok 4.6 $1.86

• Многословность в индексе — Claude Sonnet 5.5: 410 млн выходных токенов против Grok 4.6: 94 млн

• Индекс интеллекта — Claude Sonnet 5.5 56 против Grok 4.6 44, оба на v4.3.2

• Скорость вывода — у Grok 4.6 зафиксировано 67,7 токена в секунду при медианном значении 82,7; Anthropic сообщает, что Claude Sonnet 5.5 генерирует вывод более чем на 30 % быстрее, чем Claude Sonnet 5, у которого Artificial Analysis замерила 78,7 токена в секунду

Линия многословности — это механизм. Чтобы модель, выдающая в четыре раза больше токенов, стоила в четыре раза дороже на задачу, ей не нужна на 67% более высокая скорость вывода — но это помогает, и здесь оба эффекта указывают в одну сторону. Собственная формулировка Anthropic поддерживает эту интерпретацию, а не противоречит ей: в материалах о запуске утверждается, что Claude Sonnet 5.5 «стоит до 30% меньше на задачу», чем Claude Sonnet 5, при одинаковых ценах за токен, а это утверждение о количестве токенов, а не о скорости. На фоне внешнего базового уровня, который гораздо экономнее, это же свойство становится крупнейшим риском затрат для модели.

Ничто из этого не устраняет разрыв в индексе. Двенадцать пунктов композитного показателя — это реальная разница в возможностях, а более дешёвая задача, которая проваливается, не становится дешевле. Это означает, что честный вопрос не в том, «какая ставка ниже», а в том, «сколько токенов требует более сложная задача», и это число появляется только после того, как вы запустите свою собственную рабочую нагрузку.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38, an output speed of 78.7 tokens per second against an average of 83, a cost of $2.00 per million input tokens and $10.00 per million output tokens, $5.09 per Intelligence Index task, a verbosity of 370M output tokens, and a 1M-token context window.

Контекст, усилия и форма интеграции

Второе расхождение — архитектурное, и оно решает, какое из двух вы можете принять, ничего не переписывая.

OrcaRouter model page for grok/grok-4.6, attributed to SpaceXAI and dated 2026-08-12, showing a 500K-token context window, text, image and file input, an input price of $2.00 and output price of $6.00 per million tokens, a p50 time to first token of 3.00 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Claude Sonnet 5.5 изменяет шесть моделей поведения по сравнению с Claude Sonnet 5, причём пять из них — с нарушением совместимости. Отправка thinking: {"type": "disabled"}/ теперь возвращает 400, и её следует заменить на between_tools/. Принудительное использование инструментов — tool_choice/ со значением "any"/ или именованного инструмента — отклоняется сразу, поэтому цикл, который принудительно инициирует вызов, валидный по схеме, должен перейти на auto/ с строгим использованием инструментов или структурированными выводами. Более старый computer_20251124/ инструмент computer-use не принимается в Claude API и Google Cloud. Блоки мышления теперь привязаны к модели и учётной записи, которые их создали, поэтому диалог может переносить свои рассуждения вперёд из Claude Sonnet 5, но не «вбок» — в другое семейство моделей. А инструмент advisor больше не принимает Claude Opus 4.8, Claude Opus 4.7 или Claude Sonnet 5 в качестве советников за исполнителем Sonnet 5.5.

Grok 4.6 ничего этого не требует. Это модель в формате OpenAI с нетронутой поверхностью сэмплирования, а переход с Grok 4.5 сводится к изменению строки модели. Правда, в её собственной структуре стоимости есть подвох, и он представляет собой зеркальное отражение структуры Anthropic: ставка $2 / $6 действует до 200 000 входных токенов, а всё сверх этого тарифицируется по $4 / $12. Claude Sonnet 5.5 взимает стандартную ставку на всём 1M-окне.

Поставьте две структуры рядом друг с другом, и выбор перестанет сводиться к тому, чей поставщик дешевле:

• Короткие промпты, плотный вывод — более экономный расход токенов и более низкий расход выходных токенов у Grok 4.6 убедительно побеждают

• Очень длинные входные данные — фиксированная ставка 1M у Claude Sonnet 5.5 начинает превосходить удваивающийся тариф задолго до достижения предела контекста

• Крупные одиночные выходные данные — потолок 128K у Sonnet 5.5 совпадает с потолком Grok 4.6, а в Message Batches API он достигает 300K при использовании заголовка output-300k-2026-03-24/ заголовок

• Существующий код в формате OpenAI — Grok 4.6 не требует изменений; Sonnet 5.5 требует вышеописанной работы по использованию инструментов и рассуждению

Размещение обоих на одном удостоверении

Держать в голове сравнение двух вендоров легко. А вот провести его — именно здесь и прячутся затраты: два аккаунта, два набора лимитов, две системы выставления счетов и количество токенов, которое нужно измерить дважды, прежде чем оно вообще что-то будет значить.

OrcaRouter сводит всё это к одному совместимому с OpenAI эндпоинту, охватывающему более 200 моделей, с передачей прайс-листовой цены провайдера и без наценки, поэтому изменение тарифа вендора на стороне Grok или Claude вступает в силу здесь в тот же день, а не при следующем продлении контракта. Вся линейка Grok 4.x представлена в каталоге по собственным тарифам вендора, и Claude Sonnet 5 можно маршрутизировать с 30 июня по цене Anthropic $2 / $10 — модель, на которой по-прежнему идёт большая часть трафика Claude API, со скоростью 150 выходных токенов в секунду и медианным временем до первого токена около пяти секунд.

Конкретно Claude Sonnet 5.5 пока нет в нашем каталоге. Пока его там нет, путь к нему — собственный API вендора, а способ протестировать его, не ставя рабочую нагрузку на модель, которую никто независимо не тестировал дальше одного композитного бенчмарка, — направлять на него процент трафика с автоматическим переключением при сбое, а Grok 4.6 или Claude Sonnet 5 будут подхватывать то, что он отбрасывает. Проба совершенно нового уровня — это решение о маршрутизации, а не проект миграции.

Что делать с числами

Grok 4.6 — лучшая модель, к которой стоит обратиться, когда задача коротка, вывод плотный, а интеграция уже говорит на OpenAI. Она измеримо экономичнее в расчёте на задачу, чем что-либо ещё в этом ценовом диапазоне, её средства управления сэмплированием не тронуты, а семь недель доступности означают, что её режимы отказа уже были обнаружены другими людьми.

Claude Sonnet 5.5 — лучшая модель, когда входные данные огромны, когда вы покупаете именно составную оценку или когда работа настолько агентна, что разрыв в двенадцать пунктов индекса и потолок вывода в 128K важнее, чем четырёхкратная разница в стоимости за задачу. Чек-лист миграции реален, и это день работы, а не правка строки с именем модели.

Что решило бы вопрос — это измерение количества токенов на задачу на вашем собственном трафике, проведённое на обоих вариантах. Каждое число в этой статье, определяющее исход, — $1.86 против $7.60, 94M против 410M, — служит прокси для этого единственного показателя, и это единственное из них, которое вы можете получить сами.

Сравнение в этой статье4

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно