
GPT-5.6 Luna: что на самом деле изменило 80-процентное снижение цен OpenAI
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
GPT-5.6 Luna с конца июля стоит на 80% дешевле своей стартовой цены, и OpenAI начала воспринимать это как аргумент, а не как скидку. Модель — быстрый и недорогой уровень семейства GPT-5.6 — стала общедоступной 9 июля 2026 года по цене $1,00 за миллион входных токенов и $6,00 за миллион выходных. Сегодня её тарифицируют по $0,20 и $1,20. 9 сентября главный финансовый директор OpenAI Сара Фрайар заявила на конференции Goldman Sachs Communacopia, что это снижение цены дало примерно десятикратный рост использования, и что развёртывание Luna обходится дешевле, чем запуск GLM 5.3 от Z.ai на облачном уровне.
Последнее утверждение — собственное утверждение OpenAI: его сделал один из руководителей на конференции для инвесторов, и к нему следует относиться так же, как к любой другой цифре от вендора: о нём стоит сообщить, его стоит проверить, но не стоит повторять как установленный факт. Сама цена — другое дело. Она публична и не откатилась обратно.
Что на самом деле изменилось и когда?
В сентябре ничего не изменилось ни в возможностях GPT-5.6 Luna, ни в её контекстном окне, ни в доступности. Изменилось то, как OpenAI его продаёт, и за этим сдвигом стоят пять дат.
• 26 июня 2026 г. — OpenAI объявила о семействе GPT-5.6 (GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna), доступном в ограниченном предварительном доступе для небольшой группы партнёров, после согласования с государственными ведомствами США.
• 9 июля 2026 г. — общая доступность. Sol, Terra и Luna стали доступны в API по цене $5/$30, $2,50/$15 и $1/$6 за миллион входных/выходных токенов соответственно.
• Конец июля 2026 г. — снижение на 80% только для Luna, до $0.20 за вход и $1.20 за выход. Чтение кэшированного ввода обходится примерно на 90% дешевле. Выше порога длинного контекста тариф примерно удваивается — до примерно $0.40/$1.80.
• 6–7 августа 2026 г. — Luna заменила GPT-5.5 Instant в качестве модели по умолчанию для ChatGPT Free и Go, предоставив неограниченные текстовые чаты и кнопку «Think» для более глубоких рассуждений, которая появится на следующей неделе. Внутренняя оценка OpenAI показала, что доля ответов Luna, содержащих как минимум одну фактическую ошибку, примерно на 62% ниже, чем у GPT-5.5 Instant, на финансовых, медицинских и юридических запросах — это показатель, заявленный производителем, а не независимый.
• 9 сентября 2026 г. — замечания Фрайера, которые впервые обнародовали публичные цифры об эффекте сокращения: примерно 10-кратный рост использования, выручка корпоративного сегмента выросла на 32% с июня по июль на фоне 20% общего годового роста, а Codex — 25 миллионов пользователей.
Если читать их вместе, эти даты описывают двухмесячное превращение дешёвого тарифа в стратегию объёма. Luna всегда была тем тарифом, который должен был поглощать высокообъёмную, низкосложную работу — классификацию, извлечение, маршрутизацию, черновики первого прохода. Снижение сделало арифметику, стоящую за этим позиционированием, гораздо труднее оспорить.
Число, которое значит больше, чем цена токена

На ценниках большинство сравнений обычно и заканчивается, а в случае с Luna они ей льстят. При $0,20/$1,20 она предлагает примерно в 5 раз меньшую цену за вход и в 4 раза меньшую за выход, чем Claude Haiku 4.5 от Anthropic — самое близкое к прямому конкуренту, что у неё есть.
Artificial Analysis измеряет кое-что менее удобное: стоимость одной выполненной задачи Intelligence Index, которая учитывает, сколько токенов модель фактически сжигает, чтобы выполнить ту же работу. По текущему индексу конфигурация рассуждений GPT-5.6 Luna составляет $0,18 за задачу. Claude Haiku 4.5 в конфигурации рассуждений составляет $0,21.
Это разрыв примерно в 14%, а не в 5 раз. Причина — многословность. На выполнение того набора для оценки Luna потратила примерно 150 млн выходных токенов против 78 млн у Haiku. Luna рассуждает пространно, а выходные токены тарифицируются по ставке в шесть раз выше, чем входные.
Практическая интерпретация чётко делится на две части. Для работы с короткими выходными данными и большими объёмами — классификации, разметки тегами, извлечения, маршрутизации запросов, черновиков первого прохода — сокращение на 80% реально, значительно и напрямую отражается в счёте. Для работы, где модель рассуждает перед тем, как ответить, значительная доля скидки поглощается дополнительными выходными токенами. Оба утверждения верны одновременно, и именно второй аспект остался за рамками освещения этого сокращения.
Также стоит знать, что индекс говорит о возможностях, ведь уровни далеко не близки. Artificial Analysis в настоящее время присваивает GPT-5.6 Luna 38, что ставит её на четвёртое место из 177 моделей в её классе. Конфигурация рассуждений Claude Haiku 4.5 набирает 18, то есть 138-е место из 200. По этим цифрам есть две оговорки. Во-первых, индекс был пересчитан в сентябре 2026 года, поэтому цифры на момент запуска — включая 51 и 52, которые всё ещё ходят по рукам для Luna, — взяты из вышедшей из употребления шкалы. Во-вторых, Artificial Analysis выбрала GPT-5.6 Luna единственным оценщиком для нескольких своих собственных тестов, и это стоит учитывать при чтении её результатов.
Почему OpenAI приводит этот аргумент именно сейчас
Сокращение на 80%, объявленное в конце июля, не нуждалось в том, чтобы финансовый директор заново оспаривал его в сентябре. То, что она это сделала, говорит о том, для чего это сокращение было нужно.
Китайские модели с открытыми весами провели 2026 год, напирая именно на ту ось, которую занимает Luna: достаточное качество по цене, при которой решающим фактором становится учёт затрат на токен. Заявить о более низкой цене, чем эта, при облачном развёртывании сложнее, чем на уровне весов, и именно это утверждение выбрала OpenAI — назвав GLM 5.3 конкретно, а не намекая на «открытые модели» в целом.
Корпоративные показатели, которые Фрайер сопоставил с этим, указывают в том же направлении. Рост корпоративной выручки на 32% месяц к месяцу против 20% в целом — именно так выглядит компания, продающая в циклы закупок, а циклы закупок — это то место, где статья расходов ставится под сомнение. Она также подтвердила, что OpenAI экспериментирует с ценообразованием на основе результатов, привязывая плату к бизнес-результатам, а не к потреблению токенов. Это значимое признание для компании, вся модель выручки которой строилась на оплате за токен: оно говорит о том, что в дешёвом сегменте рынка цена за токен становится менее весомым аргументом при продаже, чем то, что модель выдаёт в итоге.
И ничто из этого не делает сравнение с GLM подтверждённым. Утверждение Фрайера опирается на сравнение облачных развёртываний, которое OpenAI не опубликовала в подробностях, а «дешевле, чем запускать X самостоятельно на облачном слое» полностью зависит от того, какое облако, какой инстанс и какое допущение об утилизации вы выберете. Относитесь к нему как к ангажированному утверждению заинтересованной стороны и проверьте его на своей собственной рабочей нагрузке, прежде чем оно изменит что-либо из того, что вы создаёте.
Что это меняет, если вы уже маршрутизируете между моделями

Здесь важны три вещи, а не заявленная в заголовке цена.
Снижение цен вступает в силу в тот же день, когда оно происходит. OrcaRouter передаёт прейскурантную цену провайдера по нулевой наценке, поэтому, когда вендор меняет тариф, тариф на нашей стороне меняется вместе с ним — без обращения в поддержку, без пересмотра договора, без вторых биллинговых отношений. Именно поэтому об июльском снижении стоит написать, а не просто отметить: для всех, кто обращается к Luna через единый API для 200+ моделей, оно вступило в силу в тот же день.
Алиас — это ловушка. Идентификатор без суффикса gpt-5.6 указывает на флагманский уровень Sol, а не на Luna, поэтому любой интеграции, которой нужна экономика Luna, придётся закрепить gpt-5.6-luna явно. Это задокументировано в руководствах для разработчиков этого семейства, и это по-прежнему один из самых распространённых способов, с помощью которых миграция на «дешёвый уровень» незаметно выставляет счёт по флагманским тарифам.
Дешёвые тарифы хорошо переключаются при сбоях. Модель в этом ценовом сегменте часто выполняет работу, где кратковременная ошибка 503 обходится дорого — тысячи вызовов классификации, а не одно важное завершение. Маршрутизация одного и того же запроса через нескольких провайдеров GPT-5.6 Luna с автоматическим переключением при сбое — это разница между очередью повторных попыток и простоем, и именно эта функция делает недорогой тариф безопасным для включения в продакшн-путь.
Вы можете увидеть текущий тариф и показатели p50/p95 времени до первого токена на странице GPT-5.6 Luna on OrcaRouter — стоит взглянуть, потому что страницы с ценами поставщиков отстают от снижений, а сторонние трекеры отстают от обоих.
Что посмотреть дальше
Три вещи превратили бы эту историю о ценах в совершенно другую.
Ещё одно сокращение. Китайскоязычные финансовые публикации в начале сентября описывали OpenAI как готовящуюся вновь скорректировать цены, чтобы противостоять конкуренции со стороны моделей с открытыми весами. Эта публикация ориентирована на будущее и не подтверждена, но она согласуется с компанией, которая уже согласилась на 80-процентное снижение на своём объёмном тарифе и теперь публично спорит о стоимости за развёртывание.
Ценообразование на основе результата становится реальностью. Если OpenAI начнёт продавать Luna по бизнес-результату, а не по токенам, сравнение по стоимости за токен, на котором держится весь этот рынок, перестанет быть релевантной системой оценки — и каждую оценку стоимости за задачу, включая приведённые выше, придётся пересчитывать заново.
Достойный преемник по той же цене. GPT-6 Astra уже существует выше линейки GPT-5.6, и позиция самой Luna зависит от того, оставит ли её OpenAI там, где она есть. Как только появится более новый младший тариф по цене $0.20/$1.20, интересный вопрос перестанет быть вопросом о том, дёшева ли Luna, и станет вопросом о том, остаётся ли она самым дешёвым вариантом, на который стоит направлять запросы.

Пока ситуация необычно проста. GPT-5.6 Luna — модель возрастом два месяца, и новость здесь — её цена, а не её возможности; а цена за токен — это самый лестный способ взглянуть на неё, а не самый точный.
