Сгенерированная hero-карточка с заголовком «Claude Haiku 5.5 vs GPT-5.6 Luna» и надзаголовком «ПОЛОВИНА ЦЕНЫ, БОЛЬШЕ ЗА ОТВЕТ», показывающая Claude Haiku 5.5 при вводе $0.10, выводе $0.50 и индексе 43.40 против GPT-5.6 Luna при вводе $0.20, выводе $1.20 и индексе 37.32, на полосе с надписью «Стоимость за завершённую задачу $0.21 против $0.18».
Engineering & Research

Claude Haiku 5.5 против GPT-5.6 Luna: половина номинальной цены, на 19% больше за выполненную задачу

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Совпадение цен, о котором все писали, реально — и оно не про эту модель. Claude Haiku 5.5, которую вендор выпустил 7 октября 2026 года, имеет цену $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов для промптов до 100 000 токенов. GPT-5.6 Luna, оптимизированный по затратам уровень от 9 июля 2026 года, имеет цену $0.20 и $1.20. Так что у вендора ровно половина тарифа более старой модели по обоим показателям — и ровно столько же, сколько у GPT-6 Luna, преемника, который пришёл на смену предыдущей модели 22 сентября 2026 года и который является моделью, с которой вендор сравнивает в собственном анонсе о запуске.

Странное место для того, чтобы писать сравнение, поэтому стоит точно определить, для чего это сопоставление. GPT-5.6 Luna — единственная из двух, которая помечена как устаревшая на независимой панели, она больше не Luna в флагманской тарифной сетке OpenAI, и при этом это всё ещё та Luna, которую сегодня можно найти во множестве интеграционного кода. Сравнение её с Claude Haiku 5.5 — это вопрос о миграции, которую вы, возможно, уже должны, а не о том, какую из двух актуальных моделей вызывать.

А ответ на очевидный вопрос — это самое интересное. В одном и том же независимом прогоне оценки одна завершённая задача Intelligence Index стоит $0,21 на Claude Haiku 5.5 и $0,18 на GPT-5.6 LunaЦена токена вдвое ниже, а на каждый ответ — на 19% больше.

Две тарифные карты

За миллион токенов в долларах США. Тарифы Anthropic и OpenAI взяты из их собственной документации; общие оценки — Artificial Analysis Intelligence Index v4.3.2, по состоянию на 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs GPT-5.6 Luna — the scoreboard' with rows Index v4.3.2 43.40 against 37.32, cost per task $0.21 against $0.18, input price $0.10 against $0.20, output price $0.50 against $1.20, Terminal Bench 4.0 0.3283 against 0.1162 and status 'current, API only' against 'superseded by GPT-6 Luna', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; prices per vendor documentation.'

• Ввод — Claude Haiku 5.5: $0.10 до 100 000 токенов и $0.50 свыше; GPT-5.6 Luna — $0.20, с удвоением до $0.40 для запросов объёмом более 272 000 токенов.

• Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов и $2.50 свыше; GPT-5.6 Luna: $1.20, с повышением до $1.80 на длинноконтекстном пути.

• Кэшированный ввод — Claude Haiku 5.5: $0,01 и $0,05, скидка 90%; GPT-5.6 Luna — $0,02, тоже 90%, плюс плата за запись в кэш в размере $0,25.

• Контекст — 1 млн токенов для Claude Haiku 5.5 и 1 050 000 для GPT-5.6 Luna. Оба ограничивают один ответ 128 000 токенов, а OpenAI указала дату отсечения знаний для своей модели — 16 февраля 2026 года.

• Управление рассуждениями — Claude Haiku 5.5 предоставляет регулятор усилий от Low до Max, по умолчанию — medium; GPT-5.6 Luna предоставляет шесть настроек: none / low / medium (по умолчанию) / high / xhigh / max.

• Независимая оценка — 43,40 у Claude Haiku 5.5 (Max) против 37,32 у GPT-5.6 Luna (Max), разрыв в 6,07 балла в рейтинге из 182 моделей.

• Статус — Claude Haiku 5.5 — актуальная, проприетарная, доступна только через API. GPT-5.6 Luna имеет флаг устаревания на независимой панели и больше не занимает строку в флагманской таблице цен OpenAI.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the two-tier pricing lines and 'Released October 7, 2026'.

Вдвое дешевле, но дороже за ответ

Арифметика тарифной сетки здесь необычайно выгодна для Anthropic — ровно 2x по обоим счётчикам в режиме коротких промптов — поэтому объяснять нужно именно результат на одну задачу.

Claude Haiku 5.5 выдаёт 162 164 выходных токена на задачу Intelligence Index, из которых 129 047 — на рассуждения и 33 118 — на ответ. GPT-5.6 Luna выдаёт 41 235, из которых 28 098 — на рассуждения и 13 136 — на ответ. Модель Anthropic тратит в 3,9 раза больше токенов на ту же работу, и при вдвое меньшей скорости вывода это делает её на 19 % дороже за выполненную задачу. Преимущество в скорости и недостаток в многословности различаются менее чем вдвое, так что они почти полностью компенсируют друг друга, а остаток — в пользу OpenAI.

Стоимости за задачу у двух моделей близки, но их структура — нет. $0,1783 за задачу у GPT-5.6 Luna — это примерно половина, приходящаяся на запись в кеш, и четверть — на вывод; $0,2128 у Claude Haiku 5.5 — это $0,1317 на входные данные (в основном чтения из кеша) плюс $0,0811 на вывод. Ни одна из моделей не дорога в абсолютном выражении, и дороги они в разных местах — именно поэтому итоговые затраты на задачу сближаются, тогда как тарифы различаются вдвое.

Это тот же эффект, из-за которого сравнение reasoning-моделей по стоимости токена в целом оказывается ненадёжным, и его стоит назвать прямо: дешёвый тариф умножается на большой бюджет токенов, и платите вы именно за произведение. В собственных заметках Anthropic о запуске об этом говорится откровенно: Claude Haiku 5.5 — это «особенно выгодный вариант при использовании для задач с промптами до 100 000 токенов, которые составляют около 90% запросов к нашей предыдущей модели Haiku».

Математика смеси рассказывает ту же историю с другой стороны. На смеси 7:2:1 с преобладанием входных данных от Artificial Analysis — той форме, которая фактически характерна для большинства продакшен-трафика — Claude Haiku 5.5 обходится в $0,077 за миллион токенов против $0,174 у GPT-5.6 Luna. Это те самые 2,26x, которые можно было бы ожидать исходя из ценника. Только когда вы взвешиваете счётчик выходных данных так, как это делает нагрузка рассуждения, эти два значения сближаются, а после 100 000 токенов они пересекаются.

Обрыв на 100 000 токенов против обрыва на 272 000 токенов

Оба поставщика пересчитывают стоимость длинных запросов, а их пороговые значения различаются более чем в два с половиной раза.

Порог Anthropic — 100 000 входных токенов. Выше него тарифы Claude Haiku 5.5 становятся $0,50 за вход и $2,50 за выход — в пять раз выше ставки для коротких запросов, причём применяется ко всему запросу. Порог OpenAI — 272 000 входных токенов. Выше него тарифы GPT-5.6 Luna становятся $0,40 за вход и $1,80 за выход — в 2 раза выше на входе и в 1,5 раза на выходе, также применяется ко всему запросу.

Так что этот переход — не медленная сходимость, а скачок. Промпт с извлечением на 120 000 токенов оплачивается по длинному тарифу Anthropic и спокойно укладывается в короткий тариф OpenAI, что превращает двукратное преимущество Anthropic в преимущество OpenAI в 1,25 раза на входе и в 1,39 раза на выходе. И порог у Anthropic достаточно низкий, чтобы конвейер с большим объёмом документов регулярно его перешагивал, а у OpenAI он достаточно высокий, чтобы большинство таких конвейеров до него вообще не доходили.

При менее чем 100 000 токенов ничто из этого не меняет порядок. При более чем 272 000 порядок инвертируется и остаётся инвертированным.

Что заменило модель, с которой вы сравниваете?

Это та часть, которая в принципе должна определять, сколько времени вы тратите на сравнение.

OpenAI выпустила GPT-6 Luna 22 сентября 2026 года — за пятнадцать дней до того, как Anthropic выпустила Claude Haiku 5.5 — по цене $0,10 за вход и $0,50 за выход, с контекстом в 1 млн токенов, лимитом ответа в 128 000 токенов и тем же шестиступенчатым регулятором усилий рассуждения. Это идентичная тарифная сетка, что и у Claude Haiku 5.5, по обоим счётчикам, в режиме коротких промптов.

В независимом лидерборде эти двое настолько близки, что композитный рейтинг не позволяет вынести вердикт: Claude Haiku 5.5 набирает 43,40 против 38,12 у GPT-6 Luna — по-прежнему преимущество Anthropic в 5,28 пункта — но стоимость одной завершённой задачи составляет $0.21 против $0.068. Это трёхкратное преимущество OpenAI по показателю, который реально выставляется в счёт, и причина тому та же многословность, что и выше: GPT-6 Luna выдаёт 50 012 выходных токенов на задачу Index против 162 164 у Claude Haiku 5.5.

В своём посте о запуске Anthropic сама проводит это сравнение — в таблице, где Haiku 5.5 противопоставляется «GPT-6 Luna» по GDPval-AA v2.1 (1620 против 1437), AA-Briefcase v1.1 (1578 против 1336), офлайн-подмножеству OSWorld 2.1 (72.4% против 48.9%) и Terminal-Bench 4.0 (39.2% против 16.4%). Это собственные цифры Anthropic, и они заявлены производителем, но выбор соперника говорит сам за себя: модель, которую Anthropic выбрала, чтобы побить, — это та, что идёт после той, что указана в заголовке этой статьи.

Где старая Luna всё ещё побеждает

Три вещи, и ни одна из них — не способности.

Видео и аудио. Ни одна из этих моделей не является видео-нативной — Claude Haiku 5.5 читает текст и изображения, и GPT-5.6 Luna читает текст и изображения — так что в этой строке ничья, и обе проигрывают всему, что имеет медиаконвейер.

Записи в кэш. OpenAI публикует тариф $0,25 за миллион операций записи в кэш для GPT-5.6 Luna, а Anthropic для Claude Haiku 5.5 не публикует его вовсе; это означает, что честная формулировка такова: стоимость записи находится внутри тарифа Anthropic на входные данные в $0,10, а не отсутствует. Нагрузка с преобладанием префиксов и короткоживущим кэшем платит эту разницу на каждом ходу.

И сам путь длинного контекста, где более высокий порог OpenAI — это настоящее структурное преимущество, не имеющее никакого отношения к тому, какая модель умнее.

A capture of the OrcaRouter model page for GPT-5.6 Luna under openai/gpt-5.6-luna, showing a 128K maximum output, text, image and file input, public benchmarks by OpenAI dated 2026-07-09, a p50 time to first token, and the page's own description of the model as the fast, cost-efficient tier of OpenAI's GPT-5.6 series with a 1.05M-token context window.

Оба вызываемые, один из них не наш

GPT-5.6 Luna уже сегодня в каталоге OrcaRouter по адресу openai/gpt-5.6-luna — $0.20 за вход, $1.20 за выход, $0.25 за запись в кэш, контекст на 1 050 000 токенов и потолок ответа в 128 000 токенов, при этом тариф длинного контекста на 272 000 токенов проведён отдельной строкой в записи о ценах, а не усреднён. Передаётся по прайс-листовой цене OpenAI с наценкой 0%, иавтоматическое переключение при сбое в основе — а это даёт вполне конкретную выгоду для намеренно устаревшей модели: если собственные мощности OpenAI для неё начнут сокращаться, маршрут переключится раньше, чем это сделает ваш бюджет ошибок.

Claude Haiku 5.5 отсутствует в каталоге. До него можно добраться через Anthropic API, а также через AWS, Google Cloud и Microsoft Azure, и именно так будет правильно сказать. Что каталог действительно содержит от Anthropic — это Claude Sonnet 5.5 и Claude Opus 5.5, поэтому путь эскалации из дешёвого тарифа для классификации в агентный тариф среднего уровня — это настройка маршрутизации, а не интеграция, — и в том же каталоге есть GPT-6 Luna по ровно той же тарифной сетке, которую использует Claude Haiku 5.5, что делает честное A/B-сравнение для этой ценовой точки изменением двух строк, а не закупочной процедурой.

Что делать с этим сравнением?

Если ваша интеграция называет gpt-5.6-luna, полезный вывод не в том, что Claude Haiku 5.5 превосходит её на шесть индексных пунктов. А в том, что вы работаете на модели, которую ваш поставщик уже дважды заменил более новой в своём собственном flash-сегменте — сначала поколением Terra, затем GPT-6 Luna, которую сама Anthropic считает текущим конкурентом по этой цене. Переход на GPT-6 Luna — это соответствие тарифной сетке и троекратное снижение стоимости за выполненную задачу при одном и том же независимом измерении.

Если вы выбираете между Claude Haiku 5.5 и линейкой Luna по возможностям, Anthropic побеждает по композитному показателю, по строкам «терминал и код» и по использованию компьютера, и это подтверждает собственная таблица Anthropic как вендора. Если же вы выбираете по счёту, линейка Luna выигрывала в каждой версии этого сравнения с большим отрывом, и причина — одно число: 162 164 выходных токена на задачу против 41 235.

Это сравнение на самом деле доказывает: счётчик, который вдвое дешевле, стоит меньше, чем вчетверо более экономная модель. Anthropic выставила цену Claude Haiku 5.5 вровень с GPT-6 Luna — и добилась этого: в точности, по обоим счётчикам, — но получить от неё ответ всё равно стоит в три раза дороже.