Сгенерирована главная титульная карточка для Claude Sonnet 5.5 против Gemini 3.1 Pro с подзаголовком «Дешевле за токен, в одиннадцать раз дороже за задачу», показывающая $2,00 и $10,00 за миллион токенов против $2,00 и $12,00 с указанным справа потолком вывода в 65 536 токенов и логотипом OrcaRouter, скомпонованным в правом нижнем углу.
Guides & Insights

Claude Sonnet 5.5 против Gemini 3.1 Pro: дешевле за токен, в одиннадцать раз дороже за задачу

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

В тарифной сетке Claude Sonnet 5.5 — более дешёвая модель, и по возможностям разрыв не в пользу конкурентов. Она стала общедоступной 28 сентября 2026 года по цене $2.00 за миллион входных токенов и $10.00 за миллион выходных токенов; Gemini 3.1 Pro, анонсированная 19 февраля 2026 года и всё ещё обслуживаемая через preview-эндпоинт, стоит $2.00 и $12.00. Sonnet 5.5 также набирает 56 баллов в Intelligence Index v4.3 от Artificial Analysis против 30 у Gemini 3.1 Pro Preview — разрыв в двадцать шесть пунктов на одном тестовом стенде. Контекст Gem​ini в 1,048,576 токенов — единственный ключевой показатель, по которому эта модель безоговорочно выигрывает. И всё же тот же оценщик сообщает, что завершение одной открытой задачи стоит $0.67 на модели Goog​le и $7.60 на модели Anthro​pic — то есть разница в одиннадцать раз в противоположную сторону. Оба числа верны, и причина, по которой они сосуществуют, — потолок вывода в 65,536 токенов с одной стороны и проблема многословности с другой — в этом и состоит всё сравнение.

Что на самом деле представляет собой каждый эндпоинт

Сначала разберитесь с идентичностями, а потом уже с арифметикой. Субъект здесь — anthropic/claude-sonnet-5.5, выпущенный 28 сентября 2026 года, с вводом текста, изображений и файлов, контекстом в 1 000 000 токенов, максимальным выводом в 128 000 токенов, адаптивным мышлением с параметром effort, который по умолчанию имеет значение high на платформе Claude Platform. Противник — google/gemini-3.1-pro-preview, выпущенный 19 февраля 2026 года, с вводом текста, изображений, видео, аудио и файлов, контекстом в 1 048 576 токенов, максимальным выводом в 65 536 токенов. Одно из этих двух названий содержит слово, которого нет в другом, и это не украшение.

Суффикс preview используется уже семь месяцев. За это время Google выпустила несколько релизов Flash, но не выпустила преемника уровня Pro; модель, которую заменила 3.1 Pro, указана как отключённая. Ничто из этого не является дефектом модели — она всё это время была доступна, стабильна и корректно оценена — но это означает, что конечная точка, с которой вы интегрируетесь, не покрывается обязательством жизненного цикла общей доступности, и это семейство уже вывело из эксплуатации одну модель Pro. Относитесь к этому как к постоянной статье расходов, а не как к сноске, потому что это меняет стоимость многолетнего архитектурного решения, если вы ошибётесь.

Два числа, направленные в противоположные стороны

Сначала — сравнение по токенам, потому что именно его запускают все, и оно отдаёт предпочтение более новой модели.

• Ввод — $2.00 за миллион у обоих; точное равенство по заявленной ставке

• Вывод — $10,00 за Claude Sonnet 5.5 против $12,00 за Gemini 3.1 Pro; модель Anthropic дешевле на 17%

• Чтение из кэша — $0,20 за миллион для обоих ниже границы уровня

• Запись в кэш — $2,50 за миллион для пятиминутного окна на Claude Sonnet 5.5 против $0,375 для Gemini 3.1 Pro; у Google запись в кэш обходится примерно в семь раз дешевле

• Контекст — 1 000 000 против 1 048 576; разница, не имеющая практических последствий

• Максимальный вывод — 128 000 токенов против 65 536; у модели Anthropic потолок почти вдвое выше

• Входная модальность — текст, изображение и файл против текста, изображения, видео, аудио и файла

Затем — сравнение по задачам, от того же оценщика, на той же неделе, в конфигурации с максимальными усилиями с обеих сторон: $7,60 для Claude Sonnet 5.5 против $0,67 для Gemini 3.1 Pro. В одиннадцать раз. Механизм задокументирован на той же странице, а не выведен косвенно: Sonnet 5.5 сгенерировал 410 миллионов токенов по всему набору индексов против медианы в 88 миллионов для остальных участников, что оценщик описывает как чрезмерную многословность, тогда как Gemini 3.1 Pro описывается как довольно лаконичный. Когда одна модель пишет в несколько раз больше другой, преимущество в 17% по ставке за вывод не выдерживает столкновения со счётом.

Урок выходит за рамки этих двух моделей: тарифная карта назначает цену токену, а счёт выставляется за выполненную работу. Любое сравнение, которое останавливается на прайс-листе, измеряет не ту величину.

Граница уровня на отметке 200 000 токенов

Ценообразование Gemini 3.1 Pro не является единым, и ступень достаточно велика, чтобы перевернуть части приведённого выше сравнения. При размере промпта менее 200 000 токенов тарифы составляют $2,00 за вход и $12,00 за выход при $0,20 за чтение кэша. Выше этого порога стоимость всего вызова пересчитывается: $4,00 за вход, $18,00 за выход и $0,40 за чтение кэша — ставка за вход удваивается и становится ровно вдвое выше, чем у Claude Sonnet 5.5, а выходные данные из 17% дешевле на стороне Anthropic превращаются в 80% дороже на стороне Google.

Граница не экзотична. Промпт на 200 000 токенов — это небольшая кодовая база, длинный набор контрактов, несколько часов стенограммы или агент, который уже какое-то время работает. Работа с длинным контекстом — именно то, для чего продаётся окно в 1 млн токенов, так что уровень, который больше всего выигрывает от такого окна, — это также уровень, на котором ценовое преимущество исчезает. Если ваши промпты регулярно превышают 200 000 токенов, оценивайте Gemini 3.1 Pro по $4.00 и $18.00, а не по тарифам на лендинге.

Записи в кэш заслуживают отдельного предложения, потому что они меняются в противоположную сторону и сохраняются при смене уровня. При $0,375 за миллион против $2,50 наполнять кэш через Gemini гораздо дешевле, и эта ставка не меняется при пересечении границы. Для агента, который каждый ход пересобирает большой префикс, а не переиспользует его, эта одна строка может дать большее структурное преимущество, чем ставка за вход, — и это единственная строка в этом сравнении, которой не касается ни одна граница уровня.

Потолок в 65 536 токенов, и почему он определяет архитектуру

Показатель, который сильнее всего меняет то, что вы можете создавать, — это максимальный объём вывода: 65 536 токенов у Gemini 3.1 Pro против 128 000 у Claude Sonnet 5.5. Потолок — это не метрика производительности; это ограничение на то, помещается ли задача в один вызов.

Всё, что порождает крупный артефакт — полный исходный файл, длинный отчёт, целый документ, структурированный набор данных — объёмом свыше 65 536 токенов в случае Gemini, должно быть разложено на цепочку вызовов с передачей состояния между ними. Декомпозиция стоит больше входных токенов на каждом шаге, больше кода оркестрации и добавляет новый режим отказа на стыках, где заканчивается один фрагмент и начинается следующий. Второе ограничение усугубляет это: материалы самой Anthropic указывают, что практический порог Sonnet 5.5 для надёжной длительной работы существенно выше, а потолок Gemini — более жёсткий из двух, причём вдвое. Если ваш самый длинный артефакт — 40 000 токенов, этот раздел не имеет значения, и вам следует сравнивать по стоимости на задачу. Если он 100 000, потолок уже принял решение за вас.

Модальность — единственная ось, которой Gemini владеет безраздельно {{1}}...{{/1}}

Gemini 3.1 Pro принимает видео и аудио; Claude Sonnet 5.5 принимает текст, изображения и файлы и не может принимать ни то, ни другое. Для рабочей нагрузки, построенной вокруг медиа — записей звонков, снимков экрана, видео о продукте, аудио встреч, — в этой паре нет замены, а сравнение цен не имеет смысла, потому что только одна из двух конечных точек вообще способна принять такой вход. Для рабочих нагрузок с текстом и изображениями наборы возможностей пересекаются, и определяющей становится приведённая выше ценовая арифметика.

О ещё одном операционном показателе Gemini стоит упомянуть, потому что его легко не заметить на странице, где на первом месте стоит интеллект: наш каталог измеряет медианную задержку до первого токена в 10 000 мс на уровне p50 и скорость вывода около 1 283 токенов в секунду при частоте ошибок за семь дней в 56,8%. Это чрезвычайно быстрая модель с очень высокой наблюдаемой частотой сбоев — сочетание, которое гораздо лучше подходит для пакетной работы с щедрым бюджетом повторных попыток, чем для всего, чего ждёт пользователь. Для сравнения: Claude Sonnet 5.5 — более медленный и более стабильный профиль. Частота ошибок не указана на лендинге ни одного из поставщиков; это именно тот показатель, который проявляется только тогда, когда кандидаты находятся за единым эндпоинтом, который их измеряет, и это одна из причин оценивать оба из одного места, а не из двух дашбордов.

Что куда маршрутизировать

Отправляйте это в Claude Sonnet 5.5, когда работа — это текст или изображение, когда планка качества настолько высока, что разрыв в двадцать шесть пунктов индекса имеет значение, когда выходные артефакты настолько длинны, что требуется потолок в 128 000 токенов, или когда рабочая нагрузка интерактивна и частота ошибок 56,8% неприемлема. На структурированных, ограниченных задачах штраф за многословность, который даёт цифру $7,60, в значительной степени исчезает, и преимущество в расчёте на токен превращается в реальные деньги.

Отправляйте это в Gemini 3.1 Pro, когда входные данные содержат видео или аудио, когда промпты остаются в пределах 200 000 токенов и объём высок, когда вы часто записываете большие кэши и расходы на запись в кэш по $0,375 накапливаются, или когда задача имеет пакетный характер и стоимость за задачу — единственный столбец, который имеет значение — при $0,67 за задачу против $7,60 вы можете позволить себе множество повторных попыток.

Оба уже маршрутизируются на OrcaRouter. google/gemini-3.1-pro-preview и anthropic/claude-sonnet-5 — обе являются действующими позициями каталога, доступными по одним учётным данным по прайсовой цене провайдера с наценкой 0%, а значит, описанное выше разделение можно задать правилом маршрутизации, а не двумя отдельными интеграциями — медиа-запросы направляются на одну конечную точку, запросы с текстом и изображениями — на другую, с автоматическим переключением при сбое, если любая из них начнёт возвращать ошибки. Claude Sonnet 5.5 пока не является маршрутом на нашей платформе; когда он появится в каталоге, то же правило охватит и его без нового ключа.

Честный вердикт для этого противостояния: Claude Sonnet 5.5 — заметно лучшая модель и более дешёвая за токен, а Gemini 3.1 Pro примерно в одиннадцать раз дешевле на каждую завершённую задачу в работе с открытым результатом, в шесть раз дешевле при создании кэша и единственная из двух, кто умеет видеть видео. Любой, кто приводит вам прайс-лист, описывает сравнение, которого не существует; существующее — о том, какие запросы вы можете ограничить.

A two-column scoreboard for Claude Sonnet 5.5 and Gemini 3.1 Pro Preview across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, input modality text, image and file, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run. Right column Gemini 3.1 Pro Preview: input $2.00 rising to $4.00 over 200K tokens, output $12.00 rising to $18.00, cache read $0.20, cache write $0.375, 1,048,576-token context with a 65,536-token max output, input modality text, image, video, audio and file, AA Intelligence Index v4.3 score 30, $0.67 per task on the index run. The card heading reads "Cheaper per token, eleven times dearer per finished task", and a footer line notes that Gemini 3.1 Pro remains a preview endpoint seven months after its February 19, 2026 announcement.Screenshot of the OrcaRouter model page for Google Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), showing the model header, the 1,048,576-token context window, the 65,536-token maximum output, audio, file, image, text and video input, the Vision, Audio, Tools, JSON and Reasoning capability tags, a 10.00-second p50 time to first token, a "Public benchmarks by Google · 2026-02-19" line, and the $2.00 input and $12.00 output prices per million tokens.Screenshot of Artificial Analysis's model page for Gemini 3.1 Pro Preview, marked a proprietary model and released February 2026, showing In $2.00 and Out $12.00 with a 90% cache discount, the Intelligence Index score of 30, an output rate of 114 tokens per second, the $0.67 average cost per task, and 67M output tokens described as fairly concise against a median of 88M.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно