
Claude Sonnet 5.5 против Gemini 3.1 Pro: дешевле за токен, в одиннадцать раз дороже за задачу
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 984 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 195 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
В тарифной сетке Claude Sonnet 5.5 — более дешёвая модель, и по возможностям разрыв не в пользу конкурентов. Она стала общедоступной 28 сентября 2026 года по цене $2.00 за миллион входных токенов и $10.00 за миллион выходных токенов; Gemini 3.1 Pro, анонсированная 19 февраля 2026 года и всё ещё обслуживаемая через preview-эндпоинт, стоит $2.00 и $12.00. Sonnet 5.5 также набирает 56 баллов в Intelligence Index v4.3 от Artificial Analysis против 30 у Gemini 3.1 Pro Preview — разрыв в двадцать шесть пунктов на одном тестовом стенде. Контекст Gemini в 1,048,576 токенов — единственный ключевой показатель, по которому эта модель безоговорочно выигрывает. И всё же тот же оценщик сообщает, что завершение одной открытой задачи стоит $0.67 на модели Google и $7.60 на модели Anthropic — то есть разница в одиннадцать раз в противоположную сторону. Оба числа верны, и причина, по которой они сосуществуют, — потолок вывода в 65,536 токенов с одной стороны и проблема многословности с другой — в этом и состоит всё сравнение.
Что на самом деле представляет собой каждый эндпоинт
Сначала разберитесь с идентичностями, а потом уже с арифметикой. Субъект здесь — anthropic/claude-sonnet-5.5, выпущенный 28 сентября 2026 года, с вводом текста, изображений и файлов, контекстом в 1 000 000 токенов, максимальным выводом в 128 000 токенов, адаптивным мышлением с параметром effort, который по умолчанию имеет значение high на платформе Claude Platform. Противник — google/gemini-3.1-pro-preview, выпущенный 19 февраля 2026 года, с вводом текста, изображений, видео, аудио и файлов, контекстом в 1 048 576 токенов, максимальным выводом в 65 536 токенов. Одно из этих двух названий содержит слово, которого нет в другом, и это не украшение.
Суффикс preview используется уже семь месяцев. За это время Google выпустила несколько релизов Flash, но не выпустила преемника уровня Pro; модель, которую заменила 3.1 Pro, указана как отключённая. Ничто из этого не является дефектом модели — она всё это время была доступна, стабильна и корректно оценена — но это означает, что конечная точка, с которой вы интегрируетесь, не покрывается обязательством жизненного цикла общей доступности, и это семейство уже вывело из эксплуатации одну модель Pro. Относитесь к этому как к постоянной статье расходов, а не как к сноске, потому что это меняет стоимость многолетнего архитектурного решения, если вы ошибётесь.
Два числа, направленные в противоположные стороны
Сначала — сравнение по токенам, потому что именно его запускают все, и оно отдаёт предпочтение более новой модели.
• Ввод — $2.00 за миллион у обоих; точное равенство по заявленной ставке
• Вывод — $10,00 за Claude Sonnet 5.5 против $12,00 за Gemini 3.1 Pro; модель Anthropic дешевле на 17%
• Чтение из кэша — $0,20 за миллион для обоих ниже границы уровня
• Запись в кэш — $2,50 за миллион для пятиминутного окна на Claude Sonnet 5.5 против $0,375 для Gemini 3.1 Pro; у Google запись в кэш обходится примерно в семь раз дешевле
• Контекст — 1 000 000 против 1 048 576; разница, не имеющая практических последствий
• Максимальный вывод — 128 000 токенов против 65 536; у модели Anthropic потолок почти вдвое выше
• Входная модальность — текст, изображение и файл против текста, изображения, видео, аудио и файла
Затем — сравнение по задачам, от того же оценщика, на той же неделе, в конфигурации с максимальными усилиями с обеих сторон: $7,60 для Claude Sonnet 5.5 против $0,67 для Gemini 3.1 Pro. В одиннадцать раз. Механизм задокументирован на той же странице, а не выведен косвенно: Sonnet 5.5 сгенерировал 410 миллионов токенов по всему набору индексов против медианы в 88 миллионов для остальных участников, что оценщик описывает как чрезмерную многословность, тогда как Gemini 3.1 Pro описывается как довольно лаконичный. Когда одна модель пишет в несколько раз больше другой, преимущество в 17% по ставке за вывод не выдерживает столкновения со счётом.
Урок выходит за рамки этих двух моделей: тарифная карта назначает цену токену, а счёт выставляется за выполненную работу. Любое сравнение, которое останавливается на прайс-листе, измеряет не ту величину.
Граница уровня на отметке 200 000 токенов
Ценообразование Gemini 3.1 Pro не является единым, и ступень достаточно велика, чтобы перевернуть части приведённого выше сравнения. При размере промпта менее 200 000 токенов тарифы составляют $2,00 за вход и $12,00 за выход при $0,20 за чтение кэша. Выше этого порога стоимость всего вызова пересчитывается: $4,00 за вход, $18,00 за выход и $0,40 за чтение кэша — ставка за вход удваивается и становится ровно вдвое выше, чем у Claude Sonnet 5.5, а выходные данные из 17% дешевле на стороне Anthropic превращаются в 80% дороже на стороне Google.
Граница не экзотична. Промпт на 200 000 токенов — это небольшая кодовая база, длинный набор контрактов, несколько часов стенограммы или агент, который уже какое-то время работает. Работа с длинным контекстом — именно то, для чего продаётся окно в 1 млн токенов, так что уровень, который больше всего выигрывает от такого окна, — это также уровень, на котором ценовое преимущество исчезает. Если ваши промпты регулярно превышают 200 000 токенов, оценивайте Gemini 3.1 Pro по $4.00 и $18.00, а не по тарифам на лендинге.
Записи в кэш заслуживают отдельного предложения, потому что они меняются в противоположную сторону и сохраняются при смене уровня. При $0,375 за миллион против $2,50 наполнять кэш через Gemini гораздо дешевле, и эта ставка не меняется при пересечении границы. Для агента, который каждый ход пересобирает большой префикс, а не переиспользует его, эта одна строка может дать большее структурное преимущество, чем ставка за вход, — и это единственная строка в этом сравнении, которой не касается ни одна граница уровня.
Потолок в 65 536 токенов, и почему он определяет архитектуру
Показатель, который сильнее всего меняет то, что вы можете создавать, — это максимальный объём вывода: 65 536 токенов у Gemini 3.1 Pro против 128 000 у Claude Sonnet 5.5. Потолок — это не метрика производительности; это ограничение на то, помещается ли задача в один вызов.
Всё, что порождает крупный артефакт — полный исходный файл, длинный отчёт, целый документ, структурированный набор данных — объёмом свыше 65 536 токенов в случае Gemini, должно быть разложено на цепочку вызовов с передачей состояния между ними. Декомпозиция стоит больше входных токенов на каждом шаге, больше кода оркестрации и добавляет новый режим отказа на стыках, где заканчивается один фрагмент и начинается следующий. Второе ограничение усугубляет это: материалы самой Anthropic указывают, что практический порог Sonnet 5.5 для надёжной длительной работы существенно выше, а потолок Gemini — более жёсткий из двух, причём вдвое. Если ваш самый длинный артефакт — 40 000 токенов, этот раздел не имеет значения, и вам следует сравнивать по стоимости на задачу. Если он 100 000, потолок уже принял решение за вас.
Модальность — единственная ось, которой Gemini владеет безраздельно {{1}}...{{/1}}
Gemini 3.1 Pro принимает видео и аудио; Claude Sonnet 5.5 принимает текст, изображения и файлы и не может принимать ни то, ни другое. Для рабочей нагрузки, построенной вокруг медиа — записей звонков, снимков экрана, видео о продукте, аудио встреч, — в этой паре нет замены, а сравнение цен не имеет смысла, потому что только одна из двух конечных точек вообще способна принять такой вход. Для рабочих нагрузок с текстом и изображениями наборы возможностей пересекаются, и определяющей становится приведённая выше ценовая арифметика.
О ещё одном операционном показателе Gemini стоит упомянуть, потому что его легко не заметить на странице, где на первом месте стоит интеллект: наш каталог измеряет медианную задержку до первого токена в 10 000 мс на уровне p50 и скорость вывода около 1 283 токенов в секунду при частоте ошибок за семь дней в 56,8%. Это чрезвычайно быстрая модель с очень высокой наблюдаемой частотой сбоев — сочетание, которое гораздо лучше подходит для пакетной работы с щедрым бюджетом повторных попыток, чем для всего, чего ждёт пользователь. Для сравнения: Claude Sonnet 5.5 — более медленный и более стабильный профиль. Частота ошибок не указана на лендинге ни одного из поставщиков; это именно тот показатель, который проявляется только тогда, когда кандидаты находятся за единым эндпоинтом, который их измеряет, и это одна из причин оценивать оба из одного места, а не из двух дашбордов.
Что куда маршрутизировать
Отправляйте это в Claude Sonnet 5.5, когда работа — это текст или изображение, когда планка качества настолько высока, что разрыв в двадцать шесть пунктов индекса имеет значение, когда выходные артефакты настолько длинны, что требуется потолок в 128 000 токенов, или когда рабочая нагрузка интерактивна и частота ошибок 56,8% неприемлема. На структурированных, ограниченных задачах штраф за многословность, который даёт цифру $7,60, в значительной степени исчезает, и преимущество в расчёте на токен превращается в реальные деньги.
Отправляйте это в Gemini 3.1 Pro, когда входные данные содержат видео или аудио, когда промпты остаются в пределах 200 000 токенов и объём высок, когда вы часто записываете большие кэши и расходы на запись в кэш по $0,375 накапливаются, или когда задача имеет пакетный характер и стоимость за задачу — единственный столбец, который имеет значение — при $0,67 за задачу против $7,60 вы можете позволить себе множество повторных попыток.
Оба уже маршрутизируются на OrcaRouter. google/gemini-3.1-pro-preview и anthropic/claude-sonnet-5 — обе являются действующими позициями каталога, доступными по одним учётным данным по прайсовой цене провайдера с наценкой 0%, а значит, описанное выше разделение можно задать правилом маршрутизации, а не двумя отдельными интеграциями — медиа-запросы направляются на одну конечную точку, запросы с текстом и изображениями — на другую, с автоматическим переключением при сбое, если любая из них начнёт возвращать ошибки. Claude Sonnet 5.5 пока не является маршрутом на нашей платформе; когда он появится в каталоге, то же правило охватит и его без нового ключа.
Честный вердикт для этого противостояния: Claude Sonnet 5.5 — заметно лучшая модель и более дешёвая за токен, а Gemini 3.1 Pro примерно в одиннадцать раз дешевле на каждую завершённую задачу в работе с открытым результатом, в шесть раз дешевле при создании кэша и единственная из двух, кто умеет видеть видео. Любой, кто приводит вам прайс-лист, описывает сравнение, которого не существует; существующее — о том, какие запросы вы можете ограничить.



Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
