
Claude Sonnet 5.5 против Grok 4.5: два тарифа на ввод по $2 и шестиминутное ожидание
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 931 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 192 tok/s
- OrcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Claude Sonnet 5.5 и Grok 4.5 берут одинаковую цену за вход: $2,00 за миллион токенов. На этом совпадения заканчиваются, и один показатель говорит об этом лучше любой таблицы характеристик. В ревизии v4.3.2 Индекса интеллекта Artificial Analysis медианное время до первого токена ответа у Claude Sonnet 5.5 на настройке Max Effort составляет 370,8 секунды. У Grok 4.5 — 6,9 секунды. Одинаковая цена за вход. В пятьдесят три раза дольше ждать, прежде чем вообще вернётся хоть что-то. Claude Sonnet 5.5, выпущенный 28 сентября 2026 года, и Grok 4.5, выпущенный 8 июля 2026 года и с тех пор дважды обойдённый внутри собственного семейства, — это два самых дешёвых на бумаге способа попасть в первую половину фронтира, и эта бумага скрывает решение, которое действительно важно: то, что вы покупаете вместе с ожиданием.
Эту цифру нужно сразу сопроводить оговоркой, потому что число задержки без конфигурации бессмысленно: 370,8 секунды — это режим рассуждений Anthropic по умолчанию при максимальных усилиях, который тратит очень большой бюджет на размышления, прежде чем выдать первый токен ответа. Вызывающая сторона, которой нужен быстрый первый токен, настраивает другие параметры. Но тенденция реальна, и это не артефакт — Artificial Analysis измеряет скорость вывода Claude Sonnet 5.5 на уровне 138,7 токена в секунду, уступая лишь нескольким моделям, а Grok 4.5 — 59,2. Модель, которая ждёт дольше всех, также пишет быстрее всех. Вы выбираете между долгим размышлением, за которым следует быстрый ответ, и коротким, за которым следует более медленный.
Что изменилось 28 сентября?
Claude Sonnet 5.5 вышел всего день назад. Anthropic выпустила его 28 сентября 2026 года под идентификатором API claude-sonnet-5-5, а также в Bedrock, Google Cloud и Microsoft Foundry, и описывает его как работающий на 30% быстрее, чем Claude Sonnet 5, и стоящий до 30% меньше за задачу для большинства работ. Это данные поставщика, и они не были независимо воспроизведены; цена, с которой он сравнивается, реальна, поскольку тарифная сетка осталась неизменной: $2.00 за миллион входных токенов, $10.00 за миллион выходных, $0.20 за чтение из кэша и $2.50 за запись в кэш. Окно составляет 1 000 000 токенов при синхронном пределе вывода в 128 000 токенов и 300 000 токенов в Message Batches API при использовании заголовка output-300k-2026-03-24. Дата отсечения знаний — июнь 2026 года. Нулевое хранение данных доступно с момента запуска, и Anthropic не планирует выводить модель из эксплуатации до 28 сентября 2027 года.

Anthropic на своей собственной странице документации тоже на удивление прямо говорит о цене обновления: пять несовместимых изменений отделяют Claude Sonnet 5.5 от модели, на которой сейчас работает большая часть трафика Claude, и о них речь пойдёт ниже.
Grok 4.5 — это более раннее предложение и более сложное. SpaceXAI — компания, которая всё ещё выпускает модели под брендом xAI в своих карточках моделей — выпустила её 8 июля 2026 года как смесь экспертов на 1,5 триллиона параметров, обученную вместе с редактором кода Cursor, с окном в 500 000 токенов, вводом текста, изображений и файлов, а презентация при запуске почти целиком строилась на экономии токенов, а не на наилучших показателях. Теперь это уже не флагман. Grok 4.6 и Grok 4.7 оба существуют, у обеих одинаковая прайс-листовая цена $2.00 / $6.00, и в нашем каталоге перечислены все три. Поэтому интересный вопрос в сентябре 2026 года не в том, хорош ли Grok 4.5, а в том, оправдывает ли что-то по-прежнему обращение к самому старому из трёх.
Счёт — это не прайс-лист
Положите их рядом на независимой доске — и форма сделки проявится.
• Индекс интеллекта, редакция v4.3.2 — Claude Sonnet 5.5 56 в режиме Max Effort против Grok 4.5 39
• Стоимость за задачу Index — Claude Sonnet 5.5 $7.60 против Grok 4.5 $1.04, оба показателя измерены, а не оценены
• Стоимость вывода — Claude Sonnet 5.5 $10.00 за миллион против Grok 4.5 $6.00 за миллион
• Скорость вывода — Claude Sonnet 5.5 138,7 токенов/с против Grok 4.5 59,2 токенов/с
• Время до первого токена ответа, Max Effort — Claude Sonnet 5.5 370,8 с против Grok 4.5 6,9 с
• Токены, сгенерированные в ходе всей оценки Index — Claude Sonnet 5.5 410M против Grok 4.5 77M
• Контекст — Claude Sonnet 5.5: 1 000 000 токенов против Grok 4.5: 500 000 токенов
Показатель многословности — это механизм, лежащий в основе разрыва в стоимости на задачу, и это самое полезное число на этой странице. Модель, которая выдаёт 410 миллионов токенов в рамках оценки, где её конкурент выдаёт 77 миллионов, не нуждается в ставке за вывод на 67% выше, чтобы стоить в семь раз дороже на задачу, — но у неё она всё равно есть, и оба эффекта действуют в одном направлении. Формулировка самой Anthropic согласуется с такой интерпретацией, а не противоречит ей: «до 30% меньше на задачу» — это утверждение о количестве токенов, а не о ставках, потому что ставки не изменились между Claude Sonnet 5 и Claude Sonnet 5.5. Artificial Analysis приходит к тому же выводу с другой стороны и описывает модель простым языком как заметно быструю, но очень многословную. В сравнении с экономной моделью это же свойство — крупнейший операционный риск Claude Sonnet 5.5.

Где дешёвый тариф Grok 4.5 перестаёт быть дешёвым
Строка $2.00 / $6.00 — это тарифный уровень, а не ставка. В собственной документации SpaceXAI для разработчиков эта цена применяется к 200 000 входных токенов, а сверх этого удваивается до $4.00 за ввод и $12.00 за вывод. Окно Grok 4.5 составляет 500 000 токенов, поэтому вторая половина окна, которое он рекламирует, стоит вдвое дороже первой. Загрузка промпта масштаба репозитория в Grok 4.5 — это не операция с выводом за $12, а операция с выводом за $6, и в этот момент модель с отдельной ставкой вывода $12 оказывается дорогой.
Claude Sonnet 5.5 не имеет эквивалентного тарифа. Ставка $2.00 / $10.00 действует на всём окне в 1 000 000 токенов, а чтение из кэша тарифицируется по $0.20 — это десятая часть ставки за ввод, — что и делает сценарий с длинным контекстом работоспособным на практике, а не только на бумаге.
Размер окна — вторая половина этого аргумента, и он указывает в ту же сторону. Окно Grok 4.5 — 500 000 токенов, и каждый из них тарифицируется по заявленной ставке. У Claude Sonnet 5.5 в распоряжении 1 000 000 токенов, и именно характер рабочей нагрузки делает это важным: репозиторий, над которым нужно рассуждать, длинный транскрипт работы агента, груда документов, которые должны оставаться в поле зрения. Вдвое больший потолок, отсутствие тарифной ступеньки на половине этого объёма и чтение из кэша по цене в одну десятую от ставки за входные токены — вот что превращает удержание такого объёма контекста на протяжении множества вызовов в отдельную статью расходов, а не в бюджет целиком.
Практическое разделение не назовёшь тонким:
• Короткие запросы с плотным выводом — Grok 4.5 побеждает по скорости и снова побеждает по экономии токенов
• Запросы, превышающие 200 000 входных токенов, — ставка Grok 4.5 удваивается, а у Claude Sonnet 5.5 — нет
• Интерактивная работа, критичная к задержкам — Grok 4.5 отвечает первым, со значительным отрывом, при настройках по умолчанию
• Агентные запуски с длинным горизонтом — сводная оценка Claude Sonnet 5.5 и потолок вывода в 128K — вот за что вы платите дополнительную стоимость задачи, а потолок Batches в 300K расширяет его ещё дальше
Миграция — это не строка модели.
Всем, кто переходит с Claude Sonnet 5 на Claude Sonnet 5.5, следует прочитать примечание Anthropic о миграции, прежде чем писать код, потому что изменилось пять вариантов поведения, и только один из них громко даёт сбой в очевидном месте.
• Нестандартные temperature, top_p или top_k теперь возвращают ошибку 400 — конвейер с интенсивной выборкой перестаёт работать вместо того, чтобы деградировать
• thinking: {"type": "disabled"} возвращает 400 и должен стать between_tools, при этом effort ограничен значениями low, medium или high; xhigh и max отклоняются
Принудительное использование инструментов — tool_choice со значением "any" или именованного инструмента — немедленно отклоняется, поэтому циклу, который принудительно выполняет вызов, валидный по схеме, приходится переходить на auto со строгим использованием инструментов или структурированными выводами
• Более старый computer_20251124 инструмент computer-use отклоняется в Claude API и в Google Cloud
• Блоки размышлений привязаны к модели, которая их создала, и к аккаунту, поэтому рассуждения передаются дальше от Claude Sonnet 5, но не переходят вбок в другое семейство — а инструмент advisor больше не принимает Claude Opus 4.8, Claude Opus 4.7 или Claude Sonnet 5 в качестве советников, стоящих за исполнителем Sonnet 5.5.
Есть шестое изменение, которое вообще ничего не ломает, и именно это делает его опасным: текст между вызовами инструментов теперь возвращается внутри блоков размышления. Приложение, которое передаёт этот текст пользователю потоком, замолкает между вызовами инструментов, пока либо не задаст значение отображения, либо полностью не отключит предварительное размышление. Никаких ошибок. Вывод просто перестаёт появляться.
Grok 4.5 ничего из этого не требует. Это модель формата OpenAI с нетронутой поверхностью сэмплирования, а переход на неё от собственных предшественников Grok 4.5 — это смена строки модели. Все издержки миграции ложатся целиком на сторону Claude, и это день работы, а не вторая половина дня.
Оба на одних учётных данных — и честный предел этого
Держать в голове сравнение двух поставщиков легко; а вот вести его на практике — здесь и прячутся затраты. OrcaRouter ставит более 200 моделей за единый OpenAI-совместимый эндпоинт с прайс-листовой ценой провайдера без наценки, поэтому изменение тарифа у любой из сторон отражается здесь в тот же день, а не при следующем продлении договора, с автоматическим переключением при отказе между вышестоящими провайдерами и DSL маршрутизации для составления вызовов. Вся линейка Grok есть в каталоге по собственным тарифам SpaceXAI, а Grok 4.5 маршрутизируется как grok/grok-4.5 за $2.00 за входные и $6.00 за выходные данные за миллион токенов в пределах его окна в 500 000 токенов.
Claude Sonnet 5.5 отсутствует в нашем каталоге, и эта страница не собирается утверждать обратное. Сегодня путь к нему — собственный API Anthropic, либо Bedrock и Google Cloud, если ваша инфраструктура уже находится там. Claude Sonnet 5 доступен для маршрутизации здесь с 30 июня по ценам Anthropic — $2.00 и $10.00, и он остаётся моделью, на которой работает большая часть трафика Claude API, что делает его естественным резервным вариантом для переключения при отказе, пока Claude Sonnet 5.5 ещё существует всего день и не имеет подтверждений из продакшена ни у кого.
Ко всему этому следует добавить одну оговорку, и она немаленькая. Строка Grok 4.5 выше — это презентация вендора в том виде, в каком её сейчас воспроизводит наш каталог; счётчик трафика в этой записи показывает ноль за последние семь дней, а показатель пропускной способности для неё не измеряется, причём время до первого токена держится на односекундном минимуме, который обычно демонстрирует модель, к которой почти не обращаются. Отсутствие недавнего трафика у модели здесь не доказывает, что модель плоха, — запросы этого семейства ушли к 4.6 и 4.7, — но это значит, что операционные цифры на той странице скудны, а заслуживающий доверия показатель задержки — это данные с активного маршрута.

Какой из них выбрать?
Grok 4.5 — правильная модель, когда промпт короткий, ответ плотный, а интеграция уже говорит на языке OpenAI — и когда запрос не превысит 200 000 входных токенов, потому что после этой отметки арифметика переходит в другие руки. Он также правильный выбор, когда первый токен должен прийти за секунды, а не за минуты. Но это не текущий флагман Grok; Grok 4.6 и Grok 4.7 стоят выше него при той же прейскурантной цене, и причина выбрать 4.5 вместо любого из них должна быть конкретной.
Claude Sonnet 5.5 — правильная модель, когда промпт огромен, работа достаточно агентна, чтобы семнадцать баллов Index и потолок вывода в 128K оправдывали семикратно более высокую стоимость за задачу, или когда покупается попросту композитный балл. Его многословность — это проектное решение, а не дефект, и именно её стоит измерить на собственном трафике, прежде чем на что-то решаться, — потому что $7.60 за задачу Index против $1.04 — это лишь прокси для цифры, которую способна выдать только ваша рабочая нагрузка.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
