
Claude Haiku 5.5 против Gemini 3.8 Flash: два пункта индекса, в шесть раз выше стоимость за задачу
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Claude Haiku 5.5 и Gemini 3.8 Flash ближе по измеренной производительности друг к другу, чем любая другая пара в этом ценовом диапазоне, — 43,40 против 40,93 по Artificial Analysis Intelligence Index v4.3.2, и обе входят в топ-50 рейтинга из 225 моделей. Разделяет их то, сколько стоит один из этих пунктов индекса. По тому же независимому измерению выполненная задача Intelligence Index стоит $0,21 на Claude Haiku 5.5 и $1,24 на Gemini 3.8 Flash.
Это шестикратный разрыв при разнице в оценке всего в два с половиной балла, и именно это число должно решить исход данного сравнения. Всё остальное — заявленные тарифы, список модальностей, сроки, привязанные к ценам Google, — это спор о периферийных деталях.
Обе модели — по значимым показателям
За миллион токенов в долларах США, согласно собственной документации Anthropic и Google по ценам, при этом независимые измерения приписываются Artificial Analysis. Кэшировано 2026-10-08.

• Ввод — Claude Haiku 5.5: $0.10 до 100 000 токенов и $0.50 свыше; Gemini 3.8 Flash: $0.75 фиксированно, с повышением до $1.50 1 января 2027 года.
• Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов и $2.50 свыше; Gemini 3.8 Flash: $3.75 фиксированно, с повышением до $7.50 в ту же дату.
• Кэшированный ввод — Claude Haiku 5.5 $0.01 и $0.05; Gemini 3.8 Flash $0.075, плюс плата за хранение $0.50 за миллион токенов в час.
• Контекст — 1M токенов для обоих. Максимальный вывод — 128 000 токенов у Claude Haiku 5.5 против 65 536 у Gemini 3.8 Flash.
• Входная модальность — текст и изображения для Claude Haiku 5.5; текст, изображения, речь и видео для Gemini 3.8 Flash. Это единственная строка, где список Google строго длиннее.
• Независимая оценка — 43,40 у Claude Haiku 5.5 (Max) против 40,93 у Gemini 3.8 Flash (High) в Intelligence Index v4.3.2.
• Независимая стоимость одной задачи — $0,21 против $1,24 на одной и той же плате.
• Скорость — 241,9 выходных токенов в секунду против 125,2; оба показателя измерены Artificial Analysis.
Откуда берётся шестикратный показатель
Разрыв в стоимости за задачу больше, чем разрыв в заявленных ценах, и это самое интересное, потому что это значит, что один только прайс-лист этого не объясняет.
Арифметика с ценниками довольно проста: $0.10 против $0.75 на входе — это в семь с половиной раз дешевле, а $0.50 против $3.75 на выходе — то же самое соотношение. Если бы обе модели генерировали одинаковые токены для одной и той же работы, это соотношение напрямую перешло бы в счёт.
Это не проходит, и оба эффекта играют на руку Google. Claude Haiku 5.5 многословен в том смысле, что его собственный поставщик, Artificial Analysis, зафиксировал 440 миллионов выходных токенов при запуске Index против медианы в 100 миллионов, и называет модель очень многословной. Claude Haiku 5.5 сгенерировал 170 миллионов против медианы в 81 миллион — также помечен как многословный, но это треть от количества токенов. Собственная документация Anthropic добавляет второй эффект: Claude Haiku 5.5 использует более новый токенизатор, общий с Claude 4.7 и более поздними, поэтому один и тот же текст насчитывает примерно на 30% больше токенов, чем на модели, которую он заменяет.
Если собрать всё вместе, честная версия утверждения о ценах выглядит так: преимущество по ставке на входные данные десять к одному и преимущество по ставке на выходные данные семь с половиной к одному, частично съедаемое моделью, которая пишет больше токенов на ответ, что даёт преимущество шесть к одному в метрике, которая тарифицирует всю работу. Всё ещё разгром — и меньший, чем предполагает прайс-лист.
На цене Google стоит дата
Самое полезное на странице тарифов Google — это предложение, которое большинство сравнительных таблиц опускают.
Gemini 3.8 Flash указан по цене $0,75 за ввод и $3,75 за вывод «до 31 декабря 2026 года», а также по $1,50 и $7,50 «начиная с 1 января 2027 года». Кэшированный ввод в ту же дату меняется с $0,075 до $0,15. Это вводный тариф с указанным рядом сроком действия — примерно одиннадцать недель с момента написания этого текста.
Ничто в карточке Anthropic не говорит об этом. Тарифы Claude Haiku 5.5 указаны как тарифы, с двухуровневой структурой, привязанной к длине промпта, а не к календарю, и обязательством не выводить из эксплуатации ранее 7 октября 2027 года. Если вы моделируете пайплайн, который продолжается и в следующем году, январский шаг Google — это удвоение, и его следует заложить в модель; у Anthropic нет эквивалентного события, которое нужно было бы планировать.
Это палка о двух концах, и справедливое прочтение не таково: «один поставщик честен, а другой нет». Промо-тариф — это настоящий тариф, пока он действует, и Google вправе устанавливать такую цену на запуск. Просто факт сравнения состоит в том, что более дешёвая на вид сторона январских цифр — это та, у которой есть крайний срок.

Сколько стоят два пункта индекса?
Разрыв в 2,47 балла по индексу, который доходит до шестидесяти с лишним, — это не ошибка округления и не пропасть. Обе модели находятся в одном рабочем диапазоне, и практический вопрос в том, проявится ли этот разрыв на задачах, которые вы действительно запускаете.
По собственным данным вендоров эти две модели не измеряются на одном и том же стенде, поэтому их нельзя напрямую сопоставить — Anthropic публикует результаты GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 и FrontierCode для Claude Haiku 5.5, а Google публикует собственный набор для Gemini 3.8 Flash, и ни один из вендоров не запускал набор тестов другого. Единственное доступное сравнение в одинаковых условиях — это независимый лидерборд, и там ответ таков: Anthropic впереди с измеримым, но небольшим отрывом.
Разница в возможностях, которая окажется важнее для некоторых команд, лежит в плоскости модальностей. Gemini 3.8 Flash принимает на вход речь и видео; Claude Haiku 5.5 принимает текст и изображения. Конвейер, который нативно обрабатывает записи звонков или захват экрана, вовсе не выбирает между этими двумя моделями по цене — одна из них не справится с задачей без предварительного этапа транскрипции или извлечения кадров, а у этого этапа есть своя стоимость и свои режимы отказа.
Использование более дешёвой стороны пары
Gemini 3.8 Flash присутствует в каталоге OrcaRouter по прейскурантной цене Google с наценкой 0 %, и здесь это значит больше, чем обычно: ставка провайдера передаётся напрямую, а не усредняется, так что если вы хотите увидеть, что январское изменение на самом деле делает со счётом, цифра меняется вместе с цифрой у Google. Claude Sonnet 5.5 и Claude Opus 5.5 тоже есть в каталоге, что превращает тест маршрутизации по трём направлениям — ветка Flash от Google, средний уровень Anthropic и позже малый уровень Anthropic — в настройку, а не в отдельный проект. Один ключ, один SDK, автоматическое переключение при сбое под капотом, и DSL маршрутизации, если вы предпочитаете выражать эскалацию в маршруте, а не в коде приложения.
Сам Claude Haiku 5.5 пока отсутствует в каталоге, и лучше прямо об этом сказать, чем оставлять это неясным. Сторона этого сравнения, относящаяся к Anthropic, сейчас доступна только на Anthropic, а сторону, относящуюся к Google, можно вызвать через нас уже сегодня по цене, указанной выше.

Какой именно и для кого?
Если ваша работа — это текст на входе и текст на выходе, ваши промпты укладываются в 100 000 токенов, и вы реально платите за токен, то Claude Haiku 5.5 — более дешёвая модель по всем меркам в этой статье и более высоко оценённая на единственной общей доске — с той оговоркой, что преимущество шестикратное по стоимости за задачу, а не десятикратное, как подразумевает ценник.
Если вам нужен аудио- или видеовход, или вам нужен ответ длиной свыше 65K, или ваши промпты регулярно оказываются длинными, расчеты меняются: Gemini 3.8 Flash принимает входные данные, которые не может принимать младший тариф Anthropic, а после 100 000 токенов собственный второй тариф Anthropic стоит значительно дороже фиксированной ставки Google.
Единственное, за что стоит держаться, — это сроки. Ставка Google сохраняется до конца года, а после него удваивается. У Anthropic она заявлена фиксированной с шагом по длине. На чью бы сторону вы ни встали, встройте календарь в таблицу прежде, чем строить пайплайн.
