
Claude Haiku 5.5 против Gemini 3.6 Flash: в 7,5 раза выше цена за ответ, на девять пунктов хуже модель
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Claude Haiku 5.5 и Gemini 3.6 Flashнаходятся на одной и той же ступени в своих линейках — маленькая, быстрая, дешёвая модель — и на этом сходство заканчивается. В Artificial Analysis Intelligence Index v4.3.2 Claude Haiku 5.5 набирает 43.40 в конфигурации Max против 33.98 у Gemini 3.6 Flash в конфигурации High. В том же прогоне одна выполненная задача Index обходится в $0.21 у Claude Haiku 5.5 и в $1.60 у Gemini 3.6 Flash.
Читайте эти два числа вместе, потому что по отдельности каждое вводит в заблуждение. Более дешёвая модель не просто немного дешевле; она в 7,5 раза дешевле на каждую выполненную задачу. А модель, которую она обгоняет, не просто немного слабее; она слабее на 9,42 индексных пункта, что в таблице из 182 моделей составляет расстояние между верхним квартилем и серединой.
Оба факта взяты из одного и того же независимого прогона, и это важно, потому что карточки вендоров здесь не сообщают ни об одном из них. Anthropic выпустила Claude Haiku 5.5 7 октября 2026 года; Google выпустила Gemini 3.6 Flash 21 июля 2026 года. Самое интересное — три месяца между ними.
Две карточки, рядом друг с другом
За миллион токенов в долларах США. Тарифы Anthropic и Google взяты из их собственной документации по ценам; общие строки — это Artificial Analysis Intelligence Index v4.3.2. Кэшировано 2026-10-08.

• Ввод — Claude Haiku 5.5: $0,10 до 100 000 токенов и $0,50 свыше; Gemini 3.6 Flash — $0,75 фиксированно на сегодня, с 1 января 2027 года — $1,50.
• Вывод — Claude Haiku 5.5 $0.50 до 100 000 токенов и $2.50 свыше; Gemini 3.6 Flash $3.75 фиксированно сегодня, повышение до $7.50 в ту же дату.
• Кэшированный ввод — Claude Haiku 5.5: $0.01 и $0.05; Gemini 3.6 Flash: $0.075, плюс плата за хранение в размере $0.50 за миллион токенов в час.
• Контекст и потолок вывода — 1 млн токенов для обоих. Claude Haiku 5.5 ограничивает ответ 128 000 токенов; Gemini 3.6 Flash — 65 536.
• Модальность — Claude Haiku 5.5 принимает текст и изображения. Gemini 3.6 Flash принимает текст, изображения, видео, аудио и файлы. Это единственная строка, где сторона Google однозначно впереди, и для конвейера понимания медиа это может решить весь вопрос.
• Независимая оценка — 43,40 у Claude Haiku 5.5 (Max) против 33,98 у Gemini 3.6 Flash (High).
• Стоимость одной выполненной задачи — $0,21 против $1,60 при одном и том же прогоне оценки.

Почему для расчётов следует использовать показатель на задачу, а не на токен
Множитель тарифной карты уже выглядит как 7,5 на входе и 7,5 на выходе, так что показатель на задачу здесь не удивляет — но стоит показать, почему две модели оказываются на одном и том же уровне по одному показателю и так далеко друг от друга по другому, ведь та же арифметика даёт обратный результат в других сравнениях этого батча.
Gemini 3.6 Flash — менее многословная из двух. Он выдаёт 41 606 выходных токенов на задачу Intelligence Index — 20 061 на рассуждения и 21 545 на ответ — против 162 164 у Claude Haiku 5.5, из которых 129 047 — рассуждения и 33 118 — ответ. Модель Anthropic тратит почти в четыре раза больше токенов на ту же работу, и именно у неё скорость вывода составляет седьмую часть от гугловской, так что разрыв в токенах и разрыв в скорости не компенсируются, а перемножаются.
Та комбинация — дешёвый тариф, помноженный на интенсивное использование — является честным описанием экономики Claude Haiku 5.5, и в собственном посте о запуске Anthropic признаёт и обратную сторону этого: модель «особенно выгодна при использовании для задач с промптами объёмом до 100 000 токенов, которые составляют около 90% запросов к нашей предыдущей модели Haiku». После 100 000 токенов тариф на ввод становится $0.50, а на вывод — $2.50, и тогда превышение над Gemini 3.6 Flash сокращается примерно до 1,5x.
Что делал собственный уровень Google, пока это сравнение стояло на месте
Вот здесь материал перестаёт быть сравнением двух моделей и превращается в предупреждение о том, с какой именно Gemini вы на самом деле сравниваете.
Google держит цену Flash неизменной на протяжении трёх поколений. Gemini 3.6 Flash, Gemini 3.7 Flash и Gemini 3.8 Flash — все указаны в собственной документации Google по ценам как $0.75 за вход и $3.75 за выход, с той же ставкой кэширования $0.075 и тем же повышением 1 января 2027 года до $1.50 и $7.50. В карточке Google для линейки 3.6 она описана как «наша модель Flash предыдущего поколения» — это собственные слова вендора о ней.
Изменился балл, а не цена. В независимом рейтинге Gemini 3.6 Flash набирает 33,98, Gemini 3.7 Flash — 39,06, а Gemini 3.8 Flash — 40,93 — все в их опубликованной конфигурации с наивысшей интенсивностью. За шесть недель во flash-сегменте Google появилось девять пунктов индекса — при неизменном тарифе.
Последствие для каждого, кто находится в середине оценки, конкретно: если вы три недели назад прогнали бенчмарк для этого противостояния против Gemini 3.7 Flash, ваш результат устарел, а если прогнать его против Gemini 3.8 Flash, разрыв с Claude Haiku 5.5 сократится до 2,47 балла. Gemini 3.6 Flash — это та версия этого сравнения, которая льстит Anthropic больше всего, и в то же время та версия, которую Google дальше всего от того, чтобы продавать.
Artificial Analysis помечает запись 3.6 как устаревшую. Документация Google по ценам всё ещё публикует тариф, а список моделей Google всё ещё ведёт к разделу 3.6, поэтому честнее считать, что она не «исчезла», а «дважды была заменена внутри собственного семейства за десять недель», и это факт о том, как быстро меняется этот сегмент, а не повод пропускать сравнение.
За кого это на самом деле решает
Есть реальный аргумент в пользу Gemini 3.6 Flash, и это не баллы.
Если в промпте нужны аудио или видео, Claude Haiku 5.5 вообще на это не способен — он читает текст и изображения и больше ничего. Gemini 3.6 Flash читает текст, изображения, видео, аудио и файлы, а в нашем собственном каталоге за последнюю неделю для него зафиксировано измеренное значение 582 выходных токена в секунду при медианном времени до первого токена 4,1 секунды, что делает его быстрой моделью даже по меркам Flash. Для пайплайна понимания медиа список модальностей — это всё решение, а разрыв в индексе — всего лишь сноска.
Если ваша работа — это текст и изображения, арифметика не настолько близка, чтобы о ней спорить. При смеси 7:2:1 с преобладанием входных данных — такой, какую имеет большая часть продакшен-трафика — Claude Haiku 5.5 обходится в $0,077 за миллион токенов против $0,63 у Gemini 3.6 Flash. При более чем миллионе смешанных токенов в день это 77 центов против $6,30, причём второе число станет хуже 1 января 2027 года, а первое не сдвинется.
Обрыв на 100 000 токенов — это единственное условие, которое переворачивает ситуацию. Конвейер поиска или обработки длинных документов, который регулярно собирает промпты на 150 000 токенов, платит по тарифу Anthropic $0,50/$2,50 за весь запрос, и в этот момент две модели оказываются в пределах 1,5× друг от друга по цене, тогда как Gemini 3.6 Flash всё ещё выигрывает по модальности и по показателю 91,8%, который Google публикует для поиска с несколькими иглами при среднем 128k. Это данные, заявленные вендором и не воспроизведённые независимо, и их следует подавать именно в такой формулировке.

Звонить обоим или звонить одному
Gemini 3.6 Flash уже сегодня в каталоге OrcaRouter по адресу google/gemini-3.6-flash, по прайсовой цене Google с наценкой 0% — $0.75 и $3.75 при чтении из кэша за $0.075, ровно по той цене, которую выставляет провайдер. Для этой конкретной модели это важно, потому что январское повышение Google — это изменение тарифа, а каталог со сквозной передачей цен применяет его в день вступления в силу, а не при следующем продлении контракта. Один API-ключ и один вызов SDK — к этой модели или к любой из более чем 200 других в каталоге, поэтому A/B между плечом на Google и плечом на Anthropic — это просто смена строки модели с автоматическим переключением при сбое под капотом, а не вторая интеграция.
Claude Haiku 5.5 отсутствует в каталоге. Модель Anthropic доступна через собственный API Anthropic, а также через AWS, Google Cloud и Microsoft Azure — и это весь честный ответ. А вот что из этой линейки у нас действительно есть — это Claude Sonnet 5.5 и Claude Opus 5.5 — именно это делает путь эскалации от дешёвого вызова классификации до агентного вызова среднего уровня решением о маршрутизации, а не проектом.
Что делает вердикт достаточно простым, чтобы сформулировать его прямо. Для работы с текстом и изображениями при коротких промптах Claude Haiku 5.5 побеждает по всем параметрам, кроме потолка ответа. Для всего, что содержит аудио или видео, Gemini 3.6 Flash — единственный из двух, кто вообще может ответить, — и если вы собираетесь платить по расценкам Google за эту возможность, уточните, за какого именно Gemini вы платите, потому что на этом уровне за те же деньги можно получить на девять больше индексных баллов от более нового собрата.
Один API для более чем 200 моделей, один ключ, автоматическое переключение при сбое под капотом, так что A/B между плечом на Google и плечом на Anthropic — это изменение строки модели, а не вторая интеграция.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
