Сгенерированная главная карточка под названием «Claude Haiku 5.5 против Gemini 3.6 Flash» с надзаголовком «7,5× СТОИМОСТЬ ЗА ОТВЕТ», показывающая Claude Haiku 5.5 при вводе $0,10, выводе $0,50 и индексе 43,40 против Gemini 3.6 Flash при вводе $0,75, выводе $3,75 и индексе 33,98, над полосой с надписью «Стоимость за выполненную задачу $0,21 против $1,60».
Engineering & Research

Claude Haiku 5.5 против Gemini 3.6 Flash: в 7,5 раза выше цена за ответ, на девять пунктов хуже модель

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Haiku 5.5 и Gemini 3.6 Flashнаходятся на одной и той же ступени в своих линейках — маленькая, быстрая, дешёвая модель — и на этом сходство заканчивается. В Artificial Analysis Intelligence Index v4.3.2 Claude Haiku 5.5 набирает 43.40 в конфигурации Max против 33.98 у Gemini 3.6 Flash в конфигурации High. В том же прогоне одна выполненная задача Index обходится в $0.21 у Claude Haiku 5.5 и в $1.60 у Gemini 3.6 Flash.

Читайте эти два числа вместе, потому что по отдельности каждое вводит в заблуждение. Более дешёвая модель не просто немного дешевле; она в 7,5 раза дешевле на каждую выполненную задачу. А модель, которую она обгоняет, не просто немного слабее; она слабее на 9,42 индексных пункта, что в таблице из 182 моделей составляет расстояние между верхним квартилем и серединой.

Оба факта взяты из одного и того же независимого прогона, и это важно, потому что карточки вендоров здесь не сообщают ни об одном из них. Anthropic выпустила Claude Haiku 5.5 7 октября 2026 года; Google выпустила Gemini 3.6 Flash 21 июля 2026 года. Самое интересное — три месяца между ними.

Две карточки, рядом друг с другом

За миллион токенов в долларах США. Тарифы Anthropic и Google взяты из их собственной документации по ценам; общие строки — это Artificial Analysis Intelligence Index v4.3.2. Кэшировано 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.6 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 33.98, cost per task $0.21 against $1.60, input price $0.10 against $0.75, output tokens per task 162,164 against 41,606, Terminal Bench 4.0 0.3283 against 0.0707 and input modality 'text, image' against 'text, image, video, audio', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; Gemini 3.6 Flash is flagged deprecated on the board.'

• Ввод — Claude Haiku 5.5: $0,10 до 100 000 токенов и $0,50 свыше; Gemini 3.6 Flash — $0,75 фиксированно на сегодня, с 1 января 2027 года — $1,50.

• Вывод — Claude Haiku 5.5 $0.50 до 100 000 токенов и $2.50 свыше; Gemini 3.6 Flash $3.75 фиксированно сегодня, повышение до $7.50 в ту же дату.

• Кэшированный ввод — Claude Haiku 5.5: $0.01 и $0.05; Gemini 3.6 Flash: $0.075, плюс плата за хранение в размере $0.50 за миллион токенов в час.

• Контекст и потолок вывода — 1 млн токенов для обоих. Claude Haiku 5.5 ограничивает ответ 128 000 токенов; Gemini 3.6 Flash — 65 536.

• Модальность — Claude Haiku 5.5 принимает текст и изображения. Gemini 3.6 Flash принимает текст, изображения, видео, аудио и файлы. Это единственная строка, где сторона Google однозначно впереди, и для конвейера понимания медиа это может решить весь вопрос.

• Независимая оценка — 43,40 у Claude Haiku 5.5 (Max) против 33,98 у Gemini 3.6 Flash (High).

• Стоимость одной выполненной задачи — $0,21 против $1,60 при одном и том же прогоне оценки.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

Почему для расчётов следует использовать показатель на задачу, а не на токен

Множитель тарифной карты уже выглядит как 7,5 на входе и 7,5 на выходе, так что показатель на задачу здесь не удивляет — но стоит показать, почему две модели оказываются на одном и том же уровне по одному показателю и так далеко друг от друга по другому, ведь та же арифметика даёт обратный результат в других сравнениях этого батча.

Gemini 3.6 Flash — менее многословная из двух. Он выдаёт 41 606 выходных токенов на задачу Intelligence Index — 20 061 на рассуждения и 21 545 на ответ — против 162 164 у Claude Haiku 5.5, из которых 129 047 — рассуждения и 33 118 — ответ. Модель Anthropic тратит почти в четыре раза больше токенов на ту же работу, и именно у неё скорость вывода составляет седьмую часть от гугловской, так что разрыв в токенах и разрыв в скорости не компенсируются, а перемножаются.

Та комбинация — дешёвый тариф, помноженный на интенсивное использование — является честным описанием экономики Claude Haiku 5.5, и в собственном посте о запуске Anthropic признаёт и обратную сторону этого: модель «особенно выгодна при использовании для задач с промптами объёмом до 100 000 токенов, которые составляют около 90% запросов к нашей предыдущей модели Haiku». После 100 000 токенов тариф на ввод становится $0.50, а на вывод — $2.50, и тогда превышение над Gemini 3.6 Flash сокращается примерно до 1,5x.

Что делал собственный уровень Google, пока это сравнение стояло на месте

Вот здесь материал перестаёт быть сравнением двух моделей и превращается в предупреждение о том, с какой именно Gemini вы на самом деле сравниваете.

Google держит цену Flash неизменной на протяжении трёх поколений. Gemini 3.6 Flash, Gemini 3.7 Flash и Gemini 3.8 Flash — все указаны в собственной документации Google по ценам как $0.75 за вход и $3.75 за выход, с той же ставкой кэширования $0.075 и тем же повышением 1 января 2027 года до $1.50 и $7.50. В карточке Google для линейки 3.6 она описана как «наша модель Flash предыдущего поколения» — это собственные слова вендора о ней.

Изменился балл, а не цена. В независимом рейтинге Gemini 3.6 Flash набирает 33,98, Gemini 3.7 Flash — 39,06, а Gemini 3.8 Flash — 40,93 — все в их опубликованной конфигурации с наивысшей интенсивностью. За шесть недель во flash-сегменте Google появилось девять пунктов индекса — при неизменном тарифе.

Последствие для каждого, кто находится в середине оценки, конкретно: если вы три недели назад прогнали бенчмарк для этого противостояния против Gemini 3.7 Flash, ваш результат устарел, а если прогнать его против Gemini 3.8 Flash, разрыв с Claude Haiku 5.5 сократится до 2,47 балла. Gemini 3.6 Flash — это та версия этого сравнения, которая льстит Anthropic больше всего, и в то же время та версия, которую Google дальше всего от того, чтобы продавать.

Artificial Analysis помечает запись 3.6 как устаревшую. Документация Google по ценам всё ещё публикует тариф, а список моделей Google всё ещё ведёт к разделу 3.6, поэтому честнее считать, что она не «исчезла», а «дважды была заменена внутри собственного семейства за десять недель», и это факт о том, как быстро меняется этот сегмент, а не повод пропускать сравнение.

За кого это на самом деле решает

Есть реальный аргумент в пользу Gemini 3.6 Flash, и это не баллы.

Если в промпте нужны аудио или видео, Claude Haiku 5.5 вообще на это не способен — он читает текст и изображения и больше ничего. Gemini 3.6 Flash читает текст, изображения, видео, аудио и файлы, а в нашем собственном каталоге за последнюю неделю для него зафиксировано измеренное значение 582 выходных токена в секунду при медианном времени до первого токена 4,1 секунды, что делает его быстрой моделью даже по меркам Flash. Для пайплайна понимания медиа список модальностей — это всё решение, а разрыв в индексе — всего лишь сноска.

Если ваша работа — это текст и изображения, арифметика не настолько близка, чтобы о ней спорить. При смеси 7:2:1 с преобладанием входных данных — такой, какую имеет большая часть продакшен-трафика — Claude Haiku 5.5 обходится в $0,077 за миллион токенов против $0,63 у Gemini 3.6 Flash. При более чем миллионе смешанных токенов в день это 77 центов против $6,30, причём второе число станет хуже 1 января 2027 года, а первое не сдвинется.

Обрыв на 100 000 токенов — это единственное условие, которое переворачивает ситуацию. Конвейер поиска или обработки длинных документов, который регулярно собирает промпты на 150 000 токенов, платит по тарифу Anthropic $0,50/$2,50 за весь запрос, и в этот момент две модели оказываются в пределах 1,5× друг от друга по цене, тогда как Gemini 3.6 Flash всё ещё выигрывает по модальности и по показателю 91,8%, который Google публикует для поиска с несколькими иглами при среднем 128k. Это данные, заявленные вендором и не воспроизведённые независимо, и их следует подавать именно в такой формулировке.

A capture of the OrcaRouter model page for Gemini 3.6 Flash under google/gemini-3.6-flash, showing a 65K maximum output, text, image, video, file and audio input, public benchmarks published by Google dated 2026-07-21, a p50 time to first token of 4.1 seconds, and the page's own description of the model as Google's fast, cost-efficient multimodal model in the Gemini 3 family with a 1M-token context window.

Звонить обоим или звонить одному

Gemini 3.6 Flash уже сегодня в каталоге OrcaRouter по адресу google/gemini-3.6-flash, по прайсовой цене Google с наценкой 0% — $0.75 и $3.75 при чтении из кэша за $0.075, ровно по той цене, которую выставляет провайдер. Для этой конкретной модели это важно, потому что январское повышение Google — это изменение тарифа, а каталог со сквозной передачей цен применяет его в день вступления в силу, а не при следующем продлении контракта. Один API-ключ и один вызов SDK — к этой модели или к любой из более чем 200 других в каталоге, поэтому A/B между плечом на Google и плечом на Anthropic — это просто смена строки модели с автоматическим переключением при сбое под капотом, а не вторая интеграция.

Claude Haiku 5.5 отсутствует в каталоге. Модель Anthropic доступна через собственный API Anthropic, а также через AWS, Google Cloud и Microsoft Azure — и это весь честный ответ. А вот что из этой линейки у нас действительно есть — это Claude Sonnet 5.5 и Claude Opus 5.5 — именно это делает путь эскалации от дешёвого вызова классификации до агентного вызова среднего уровня решением о маршрутизации, а не проектом.

Что делает вердикт достаточно простым, чтобы сформулировать его прямо. Для работы с текстом и изображениями при коротких промптах Claude Haiku 5.5 побеждает по всем параметрам, кроме потолка ответа. Для всего, что содержит аудио или видео, Gemini 3.6 Flash — единственный из двух, кто вообще может ответить, — и если вы собираетесь платить по расценкам Google за эту возможность, уточните, за какого именно Gemini вы платите, потому что на этом уровне за те же деньги можно получить на девять больше индексных баллов от более нового собрата.

Один API для более чем 200 моделей, один ключ, автоматическое переключение при сбое под капотом, так что A/B между плечом на Google и плечом на Anthropic — это изменение строки модели, а не вторая интеграция.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно