
Claude Haiku 5.5 против GPT-6 Luna Pro: модель против режима
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Одна сторона этого сравнения — модель, а другая — настройка. Claude Haiku 5.5 стала общедоступной 7 октября 2026 года по цене $0,10 за миллион входных токенов и $0,50 за миллион выходных — в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. GPT-6 Luna Pro — вовсе не модель: добраться до неё можно, вызвав GPT-6 Luna — доступную с 22 сентября 2026 года по тем же $0,10 и $0,50 — с reasoning.mode, установленным в pro вместо standard. На странице моделей OpenAI нет gpt-6-luna-proидентификатора. Так что честная формулировка этого противостояния — не «какая модель побеждает», а «какой способ лучше потратить десять центов за миллион входных токенов»: маленькая модель с регулятором усилий или более крупная модель, запущенная в режиме, который делает больше работы и выставляет вам счёт за токены, которых вам не показывает. Для короткой работы с большим объёмом ответ обычно первый. Для сложной, редкой работы это может быть второй — а число, которое это решает, OpenAI не опубликовала.
Что такое "pro" с механической точки зрения
В руководстве OpenAI по reasoning-моделям указано, что модели GPT-5.6 и GPT-6 поддерживают в Responses API два режима, standard (режим по умолчанию) и pro, выбираемых через reasoning.mode. Режим — это не тот же параметр, что reasoning.effort: режим определяет, какой объём работы модель выполняет, прежде чем перейти к ответу, а effort определяет, какой объём рассуждений выполняется внутри выбранного вами режима. Документированные значения effort для GPT-6 Luna — none, low, medium (значение по умолчанию), high, xhigh и max, и любое из них можно сочетать с режимом pro.
В вопросах биллинга документация высказывается прямо и немного контринтуитивно. Режим Pro агрегирует всю работу модели за итоговым ответом и тарифицирует эти токены «по стандартным тарифам на токены выбранной модели». Никакой надбавки за pro в тарифной сетке нет. Затраты проявляются как объём, поскольку режим pro «выполняет больше работы модели, чем стандартный режим, увеличивая расход токенов и стоимость», — а токены рассуждений тарифицируются как выходные токены, появляясь при этом только в объекте usage под output_tokens_details.reasoning_tokens. Если не читать это поле, рост остаётся незаметным до прихода счёта.
Из этого следуют два сравнения, и их стоит различать. GPT-6 Luna в стандартном режиме — pro-режим представляет собой ту же модель с неизвестным множителем потребления токенов. В сравнении с Claude Haiku 5.5 это тоже другая модель в другом масштабе — 1 050 000 токенов контекста против 1 млн, потолок ввода в 922 000 токенов и дата отсечки знаний 18 мая 2026 года, на уровне, который сама Anthropic в документации к запуску позиционирует чуть выше Haiku в сложной агентной работе. Оба различия действуют в одну сторону по стоимости и в противоположные стороны по возможностям, поэтому ни то, ни другое нельзя прочитать по прайс-листу.
Тарифные карты, бок о бок
Обе модели тарифицируются по двум ступеням, причём пороги расположены в разных местах — а это важнее, чем заявленная ставка, потому что заявленные ставки у обеих одинаковы.
• Ввод — Claude Haiku 5.5: $0.10 за миллион до 100 000 токенов, $0.50 выше этого порога. GPT-6 Luna: $0.10 до 272 000 токенов, $0.20 выше этого порога.
• Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов, $2.50 свыше этого объёма. GPT-6 Luna: $0.50 до 272 000 токенов, $0.75 свыше этого объёма.
• Кэширование — чтение кэша Claude Haiku 5.5 стоит $0.01, запись — $0.125 ниже порога, $0.05 и $0.625 выше него. Чтение кэша GPT-6 Luna стоит $0.01, запись — $0.125 до 272 000 токенов, $0.02 и $0.25 сверх этого.
• Контекст и вывод — 1M токенов и 128 000 максимального вывода для Claude Haiku 5.5; 1 050 000 токенов при ограничении ввода в 922 000 токенов и максимальном выводе в 128 000 для GPT-6 Luna.
• Размышление — адаптивно в обоих случаях. Claude Haiku 5.5 по умолчанию использует средний уровень усилий; GPT-6 Luna по умолчанию использует средний уровень усилий и стандартный режим, при этом режим pro можно включить дополнительно.
• Скидки на пакетную обработку и кэширование — Claude Haiku 5.5 даёт скидку 50% на Message Batches API; GPT-6 Luna даёт скидку 50% на Batch и Flex, удваивает стоимость в режиме Fast mode и добавляет 10% надбавки за региональную обработку.
Единственная строка, которая не совпадает по форме, — это токенизатор. В документации Anthropic отмечается, что Claude Haiku 5.5 использует более новый токенизатор, общий с Claude 4.7 и более поздними версиями, поэтому один и тот же текст насчитывает примерно на 30% больше токенов, чем на Claude Haiku 4.5. Это не меняет тариф; это меняет то, как быстро запрос достигает порога в 100 000 токенов, и это реальная разница в стоимости, которую не показывает ни одна тарифная карта. Запрос на 90 000 токенов насчитывает примерно 117 000 и оплачивается по $0.50 за миллион входных токенов вместо $0.10 — пятикратный тариф для запроса, который выглядит так, будто он с комфортом ниже порога.
Сколько стоит Pro-режим — в единственных единицах, которыми может пользоваться каждый
Поскольку множитель не опубликован, полезно указать, сколько стоит каждый дополнительный токен, а затем — как правдоподобные диапазоны ведут себя при больших объёмах.
• При цене GPT-6 Luna $0,50 за миллион выходных токенов каждые дополнительные 10 000 выходных токенов на задачу стоят $0,005. Запускайте 100 000 задач в день — и этот прирост составит миллиард дополнительных токенов — примерно $500 в день, или $15 000 в месяц, на модели, заявленная цена которой — десять центов за миллион входных токенов.
• Для понимания масштаба: GPT-6 Luna при максимальных усилиях уже потребляет 140 миллионов выходных токенов при прохождении Intelligence Index по сравнению с медианой в 100 миллионов, что оценщик называет несколько многословным. Таблица из анонса Anthropic, составленная на собственном стенде Anthropic, оценивает GPT-6 Luna в 16,4% на Terminal-Bench 4.0 и 42,4% на FrontierCode 1.1 против 39,2% и 46,4% у Claude Haiku 5.5 — по данным вендора, на наборе тестов одного вендора, для модели конкурента.
• На независимом табло расстановка более плотная. Artificial Analysis оценивает Claude Haiku 5.5 в 43 балла при максимальном усилии по Intelligence Index v4.3.2 — второе место из 182, а GPT-6 Luna (Max) — в 38, восьмое место из 182. Оба показателя относятся к стандартному режиму с максимальным усилием. Независимой оценки GPT-6 Luna в pro-режиме нет: на странице модели нет pro-записи, и Artificial Analysis её не приводит.
Структурная проблема для режима pro заключается во взаимодействии между последними двумя пунктами. Полное ценовое преимущество GPT-6 Luna над Claude Haiku 5.5 проистекает из эффективности использования токенов — 140 миллионов выходных токенов против 440 миллионов для одного и того же набора, при одинаковых тарифах, поэтому одна и та же оценка стоит $0,07 за задачу с одной стороны и $0,21 с другой. Режим pro по определению — это режим, который генерирует больше токенов. Его включение отключает то, что делало модель дешёвой в этом сравнении, а множитель, который сказал бы, насколько именно, не публикуется. Это не аргумент в пользу того, что режим pro — плохая сделка — на сложных задачах больший объём работы обычно означает лучшую работу — это аргумент в пользу того, что режим pro конкурирует по возможностям, а не по цене, и его следует оценивать в сравнении с моделями среднего уровня, рядом с которыми он находится по цене, а не с дешёвым уровнем, внутри которого он находится.

Где каждый из них действительно выигрывает
Сведи всё к самому решению — и разделение окажется чётким, хотя ни одна из сторон не свободна от оговорок.
Claude Haiku 5.5 владеет дешёвым сегментом. Он быстрее в обоих важных смыслах: 241,9 выходных токенов в секунду по измерению Artificial Analysis против 123,0 у GPT-6 Luna, а также 295-секундное время до первого токена в прогоне Index — это следствие того, как долго он размышляет перед ответом при усилии Max, а не сетевой показатель. Его тарифная сетка достигает второго уровня при 100 000 токенов, а токенизатор раздувает промпты примерно на 30%, поэтому рабочие нагрузки с длинными промптами платят больше, чем предполагает ценник, по обоим пунктам. Взамен он даёт пятибалльное преимущество по интеллекту в независимом индексе и регулятор усилия — от Low до Max — который является самым полезным средством контроля затрат, выпущенным любым из вендоров вместе с этими запусками. Фиксация усилия на низком уровне — это способ обменять часть этого пятибалльного преимущества на показатель стоимости за задачу, более близкий к GPT-6 Luna.
Самые сложные задачи — вотчина GPT-6 Luna Pro, но счёт за них не поддаётся количественной оценке. Модель, лежащая в основе, дешевле за токен при объёме свыше 272 000 входных токенов, чем Claude Haiku 5.5 при объёме свыше 100 000, — в 2,5 раза по входу и в 3⅓ раза по выходу, а её первый уровень доходит в восемнадцать раз дальше по контекстному окну. Стандартный режим измеримо дешевле в расчёте на завершённую задачу. Режим Pro обменивает это на больше работы за ответ по тем же тарифам, и вопрос о том, превосходит ли он Claude Haiku 5.5 при Max effort или модель среднего уровня в конкретной задаче, не имеет ответа ни в одной опубликованной цифре. Чтобы ответить на него, нужно выполнить задачу обоими способами и посмотреть на поле reasoning-token.

Попробовать любой из них, не делая ставку на это
Неудобная часть этого сравнения в том, что его самое важное число — реальная стоимость pro-режима — можно получить, только прогнав через него собственный трафик, а эффективная стоимость меньшей модели зависит от того, где окажутся ваши промпты относительно отметки в 100 000 токенов после повторной токенизации. И то и другое — задачи измерения, и оба варианта дешевле на общем эндпоинте, чем при использовании двух клиентов разных поставщиков.
GPT-6 Luna уже сегодня в каталоге OrcaRouter по прайсовой цене провайдера с 0% наценки, переданной напрямую, так что базовый уровень в стандартном режиме для этого сравнения вызывается одним ключом, а изменение цены вендором отражается на нашей стороне в тот же день, а не в следующем расчётном цикле. Claude Haiku 5.5 в каталоге пока нет; из линейки Anthropic мы сегодня маршрутизируем Claude Haiku 4.5, Claude Sonnet 5.5 и Claude Opus 5.5, а значит тест эскалации от дешёвого звена к среднему — это правило маршрутизации, а не изменение кода. Автоматическое переключение при сбое «под капотом» — именно это позволяет модели, которой всего два дня, обслуживать продакшен-трафик, пока вы её ещё только измеряете: провайдера, который начал сбоить, начинают обходить стороной, вместо того чтобы уронить запрос, — и это разница между пилотом, который можно запустить на этой неделе, и миграцией, которую нужно планировать.
Что решает это
Три вещи, в порядке того, насколько сильно они изменили бы ответ. Если бы OpenAI опубликовала множитель токенов для pro-режима или отдельный pro-пункт с собственной строкой цены, центральное неизвестное превратилось бы в арифметику. Если бы Artificial Analysis повторно прогнала GPT-6 Luna в pro-режиме при сопоставимом уровне усилий, это дало бы ответ с независимой стороны. А второй независимый прогон Claude Haiku 5.5 на medium, а не на Max, показал бы, сколько модель на самом деле стоит при настройке по умолчанию — а это и есть конфигурация, в которой её будут использовать большинство: $0,21 за задачу в таблице — это цифра при максимальных усилиях, а Max не является значением по умолчанию.
До тех пор точная сводка остаётся узкой. Claude Haiku 5.5 — это модель, которую можно вызвать, оценить по цене и протестировать уже сегодня, и при объёмах, для которых создан её уровень, она является более дешёвым решением, причём с документированным способом сделать его ещё дешевле. GPT-6 Luna Pro — это конфигурация модели, которую можно вызвать; её тарифная сетка — не проблема, её потребление токенов не проверено, и все аргументы в её пользу опираются на задачи, достаточно сложные, чтобы трата большего числа токенов была самой целью. Покупайте её для таких задач, измеряйте её перед этим и не ставьте её на высоконагруженный маршрут, пока кто-нибудь не опубликует множитель.

