
OpenAI снизила цены на GPT-5.6 API: что изменилось, почему и как получить
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 984 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 195 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
30 июля 2026 года OpenAI снизила цены на API для своих двух более дешёвых моделей GPT-5.6 — резко уменьшив стоимость самого дешёвого тарифа и немного урезав средний тариф. Три недели спустя OpenAI перешла к флагманской модели: 21 августа 2026 года OpenAI объявила, что цены на API GPT-5.6 Sol будут снижены более чем на 20% в течение следующих трёх месяцев, по мере того как компания работает над повышением эффективности модели. В этой статье подробно объясняется, что именно изменилось в обоих раундах, какие инженерные решения за этим стоят, как новые цены выглядят на фоне конкурентов, какие скрытые издержки стоит учитывать, как ещё больше сократить свой счёт — и как сниженные цены уже действуют на OrcaRouter с нулевой наценкой.
Каждая цифра ниже помечена источником. Цены указаны за миллион токенов (вход / выход). Тарифы Luna и Terra отражают прайс-лист OpenAI от 30 июля 2026 года, о котором сообщали в том числе Unite.AI; снижение цен Sol отражает анонс OpenAI от 21 августа 2026 года, с ценами за токен, о которых сообщали в том числе Runtimewire и Reuters. На страницах модели транзитного ценообразования OrcaRouter указаны те же цифры; данные по конкурентам приведены с указанием источников. Цены меняются — проверяйте перед созданием продукта.
TL;DR. OpenAI снизила цены на GPT-5.6 Luna до $0,20 / $1,20 (с $1 / $6, скидка ~80%) и на GPT-5.6 Terra до $2 / $12 (с $2,50 / $15, скидка ~20%) 30 июля. 21 августа скидку распространили на флагманскую модель: цены API GPT-5.6 Sol падают более чем на 20% в течение следующих трёх месяцев — до $4 / $20 за миллион токенов с $5 / $30, по данным OpenAI, — при этом токен-ориентированные кредиты Codex и ChatGPT Work дают больше, а использование по подписке остаётся без изменений. Июльское снижение цен стало возможным благодаря двум улучшениям эффективности: переписанным GPU-ядрам (примерно на 20% ниже стоимость обслуживания) и переработанной черновой модели для спекулятивного декодирования (генерация токенов на 15%+ быстрее). Если вы маршрутизируете запросы через нейтральный к вендорам эндпоинт с нулевой наценкой, например OrcaRouter, новые тарифы уже действуют — та же цена, один OpenAI-совместимый API, а рядом все конкурирующие модели, чтобы сравнивать и маршрутизировать между ними.
Основные выводы
• GPT-5.6 Luna: теперь $0.20 / $1.20 за 1 млн токенов, вместо $1 / $6 — снижение примерно на 80%.
• GPT-5.6 Terra: теперь $2 / $12, снижение с $2.50 / $15 — примерно на 20%.
• GPT-5.6 Sol (флагман): теперь $4 / $20 на следующие три месяца, вместо $5 / $30 — снижение более чем на 20%, объявленное 21 августа 2026 года.
• Кредиты на основе токенов Codex и ChatGPT Work теперь дают больше: ввод Sol снижается до 100 кредитов, а вывод — до 500 кредитов за 1 млн токенов (ранее 125 / 750).
Подписки не изменились: включенное использование в тарифах Plus, Pro и Business, лимиты пять часов в неделю и прежние тарифы кредитов остаются без изменений.
• Зачем: OpenAI представил оба раунда как дивиденды от повышения эффективности — переписанные продакшен GPU-ядра (~20% снижение стоимости обслуживания) плюс редизайн черновой модели для спекулятивного декодирования (повышение эффективности генерации токенов на 15%+), согласно инженерному посту OpenAI от 29 июля.
• Как получить: скидки уже отражены в OrcaRouter (наценка 0%) — Luna по $0,20 / $1,20, Sol по $4 / $20 — через одну OpenAI-совместимую конечную точку.
Что именно изменилось?
Семейство моделей OpenAI GPT-5.6 работает как лестница уровней: Luna (быстрая, самая дешёвая), Terra (средняя) и Sol (флагманская). Сокращение цен 30 июля затронуло два более дешёвых уровня. Согласно опубликованному прайс-листу, GPT-5.6 Luna подешевела с $1 / $6 до $0,20 / $1,20 за миллион входных/выходных токенов — примерно на 80% как для входа, так и для выхода, — а GPT-5.6 Terra — с $2,50 / $15 до $2 / $12, примерно на 20%. GPT-5.6 Sol, флагманскую модель, созданную для самых сложных рассуждений и агентного программирования, в тот день не трогали — но 21 августа 2026 года OpenAI объявила о временном снижении цен и для неё: цены API падают более чем на 20% на ближайшие три месяца, до $4 за миллион входных токенов и $20 за миллион выходных, а кэшированный вход дешевеет с $0,50 до $0,40. В том же объявлении говорилось, что покупаемые вами кредиты в Codex на тарифах на основе токенов теперь работают дальше, а включённое в вашу подписку использование остаётся прежним.
Базовая ставка за токен — это ещё не вся история. В ценообразовании GPT-5.6 также есть уровни в зависимости от длины ввода (очень длинные контексты переходят на более высокую ставку), скидка на кэширование промптов (кэшированный ввод обходится гораздо дешевле, чем свежий) и пакетный вариант (асинхронные задания со скидкой). Все три фактора сохраняются и после снижения цен, так что эффективная цена для рабочей нагрузки с интенсивным использованием кэша или пакетов может быть ещё ниже. Однако следите за уровнем длинного контекста и в другую сторону: очень большие промпты могут перевести вас на уровень выше.

Две оптимизации за катом
Это не было работой в убыток ради привлечения клиентов — OpenAI преподнёс это как дивиденд от эффективности. В инженерном посте от 29 июля 2026 года сотрудники технического отдела OpenAI описали оптимизации в инференсе и агентской обвязке, лежащих в основе Codex и ChatGPT Work. Две особенно примечательны. Во-первых, переписывание GPU-ядер во всей продакшн-инфраструктуре — с помощью Sol, работающего внутри Codex, для переписывания собственных ядер компании, — которое, по словам OpenAI, сократило сквозные затраты на сервинг примерно на 20%. Во-вторых, переработанная черновая модель спекулятивного декодирования, которая, как сообщается, повысила эффективность генерации токенов более чем на 15%. Снижение стоимости сервинга, переданное клиентам в виде более низких цен на тарифах с высокими объёмами, — вот суть, и это проблеск петли обратной связи, за которой гонится вся индустрия: использование фронтирных моделей для оптимизации самой инфраструктуры, которая их обслуживает.
Объявленное 21 августа снижение цены на Sol имеет ту же формулировку. По словам OpenAI, сокращение — более чем на 20% в течение следующих трёх месяцев — связано с тем, что компания делает модель более эффективной в работе, и оно явно временное, а не постоянное изменение цены.
Как соотносятся новые цены
Снижение цен метит прямо в конкурентов. По данным Unite.AI, новые расценки Luna — $0,20 / $1,20 — примерно в 5 раз ниже входной цены и в 4 раза ниже выходной цены Anthropic Haiku 4.5, а новые $2 / $12 у Terra оказываются ниже стандартного прайсинга Claude Sonnet 5 (сообщается, что $3 / $15 вступают в силу после 31 августа 2026 года). На поле моделей с открытыми весами Luna теперь находится близко к минимальной планке дешёвого инференса, заданной линейкой DeepSeek V4 и GLM-5.2 от Zhipu (примерно $1,20 / $4,10), а тарифы Alibaba Qwen и Google Gemini Flash находятся в том же диапазоне. Временное снижение Sol до $4 / $20 оставляет флагманскую модель значительно выше её собственных объёмных тарифов, но урезает премию — и сокращение выходных токенов на треть важнее всего для агентных нагрузок с большим объёмом выходных данных. В освещении этого шага отмечается, что он происходит на фоне растущей конкуренции OpenAI со стороны Anthropic и китайских ИИ-моделей.
Инференс становится всё дешевле
Если посмотреть шире, это снижение цен вписывается в многолетний тренд: стоимость заданного уровня производительности резко падает из поколения в поколение, поскольку лаборатории выжимают всё большую пропускную способность из того же оборудования. Более старые тарифы самой OpenAI иллюстрируют это постепенное удешевление, и каждый прорыв в эффективности — лучшие ядра, спекулятивное декодирование, более дешёвое внимание — обычно превращается в снижение цен в течение нескольких месяцев. Для покупателей практический вывод — проектировать архитектуру под мир, где инференс дешевеет по предсказуемому графику: не привязывайтесь к ценам одной модели и сохраняйте возможность дешёвого переключения.
Скрытая стоимость, на которую стоит обратить внимание: токены рассуждений
Модели GPT-5.6 — это модели рассуждений, и это влияет на реальные расходы. Когда рассуждение включено, модель генерирует внутренние токены рассуждений, которые тарифицируются как выходные данные, — поэтому ваша эффективная стоимость вывода может быть выше, чем предполагает наивная оценка «слов в ответе», особенно на сложных запросах с высоким уровнем рассуждения. Решение — настраивать уровень рассуждения под задачу (низкий или выключенный для простых вызовов), ограничивать вывод там, где можно, и измерять фактическое использование токенов, а не предполагать. Более низкая цена за токен помогает, но контроль над количеством генерируемых токенов помогает больше.
Что это значит для разработчиков
Если вы используете GPT-5.6 Luna или Terra для работы с большими объёмами — классификации, извлечения данных, маршрутизации, лёгких агентов, чатов — ваш счёт только что снизился, в некоторых случаях на бо́льшую часть суммы, и для этого не нужно менять код. Это делает объёмные тарифы ещё более привлекательными для затрато-чувствительных нагрузок и сокращает ценовой разрыв с дешёвыми открытыми моделями. Флагманские расценки тоже изменились, по крайней мере пока: Sol по $4 / $20 в течение следующих трёх месяцев снижает стоимость задач с интенсивными рассуждениями и агентной работы на верхнем уровне, а токен-основанные кредиты Codex и ChatGPT Work покрывают больший объём. Это по-прежнему премиальный выбор для самых сложных задач — просто более дешёвый, чем раньше. Выигрышная схема та же: маршрутизация по сложности — дешёвые тарифы (или дешёвые открытые модели) для лёгких 80%, флагман только там, где он оправдывает свою стоимость.
Как еще больше сократить ваши счета
Снижение цены — это фундамент для развития, а не финишная черта. Крупнейшие дополнительные рычаги: кэширование промптов (повторно используйте стабильный системный промпт или длинный контекст и платите гораздо более низкую ставку за кэшированный ввод); пакетный режим (выполняйте несрочные задания асинхронно со скидкой); маршрутизация по уровням и моделям (отправляйте каждый запрос самой дешёвой модели, которая с ним справится, включая открытые модели); и управление рассуждениями (не платите за глубокие рассуждения на тривиальных запросах). В совокупности эти меры регулярно сокращают реальные счета гораздо сильнее, чем любое отдельное изменение тарифов. В качестве конкретного ориентира: при 10 миллионах токенов в месяц с 70% долей ввода новые тарифы Luna составляют примерно $5 в месяц (около $4.37 с кэшированием); тот же объём на Sol — около $125 в месяц — самый наглядный аргумент в пользу маршрутизации по сложности.
Как сразу зафиксировать более низкие цены
Вот та часть, которая связывает всё воедино. OrcaRouter взимает 0% наценки и передаёт цены провайдера напрямую, так что сниженные цены OpenAI уже действуют на OrcaRouter: GPT-5.6 Luna показывает $0.20 / $1.20, Terra $2 / $12, а GPT-5.6 Sol $4 / $20 на страницах моделей прямо сейчас — те же тарифы, что и на собственной карточке OpenAI, доступные через единый OpenAI-совместимый эндпоинт наряду с 185+ другими моделями. Вы получаете сниженные цены без миграции и можете сравнивать цены Sol, Luna и Terra с DeepSeek, GLM, Qwen, Gemini и Claude в одном месте, а затем направлять каждый запрос туда, где он обойдётся дешевле всего для задачи. Также есть бесплатный тариф и страница Offers для дополнительной экономии.

Снижение цен уже действует на OrcaRouter: GPT-5.6 Luna по $0.20 / $1.20 и GPT-5.6 Sol по $4 / $20 за 1 млн токенов, с нулевой наценкой.
Прокладывайте маршрут по сложности, чтобы сэкономить ещё больше.
Самый дешёвый счёт — это не одна модель, а правильная модель для каждого запроса. Поскольку OrcaRouter открывает весь модельный ряд через одну конечную точку, вы можете отправлять простые высокообъёмные запросы на Luna или дешёвую открытую модель, а Sol или другой флагман приберечь для сложных, переключаясь изменением конфигурации, а не повторной интеграцией. Снижение цены на Luna делает эту стратегию маршрутизации по сложности ещё дешевле, а временная скидка на Sol снижает стоимость и сложных запросов — без какой-либо переделки с вашей стороны.

Часто задаваемые вопросы
Насколько OpenAI снизила цены на GPT-5.6?
GPT-5.6 Luna подешевела с $1 / $6 до $0,20 / $1,20 за миллион токенов (примерно на 80%), а GPT-5.6 Terra — с $2,50 / $15 до $2 / $12 (примерно на 20%). 21 августа 2026 года OpenAI также снизила цены на GPT-5.6 Sol с $5 / $30 до $4 / $20 на следующие три месяца.
Когда вступило в силу снижение цен?
Сокращения Luna и Terra вступили в силу 30 июля 2026 года и были отражены в опубликованном тарифном прайс-листе. OpenAI объявил о временном снижении Sol 21 августа 2026 года на следующие три месяца.
Почему OpenAI снизил цены?
OpenAI объясняет июльское снижение цен оптимизацией инференса — переписанными производственными GPU-ядрами (примерно на 20% ниже стоимость обслуживания) и переработанной моделью-черновиком для спекулятивного декодирования (эффективность генерации токенов выше на 15%+) — согласно инженерному посту от 29 июля 2026 года. Компания представила снижение цен на Sol аналогичным образом — как шаг, предпринятый по мере того, как модель становится дешевле в эксплуатации, на рынке с растущей конкуренцией.
Флагман (Sol) подешевел?
Да — временно. Снижение цен 30 июля оставило GPT-5.6 Sol на уровне $5 / $30, но 21 августа 2026 года OpenAI объявила о снижении цен более чем на 20% на следующие три месяца, до $4 / $20 за миллион токенов. Токен-кредиты Codex и ChatGPT Work также позволяют купить больше, в то время как использование по подписке остаётся без изменений.
Как новые цены соотносятся с ценами Anthropic и открытых моделей?
Согласно сообщениям, Luna теперь предлагает цены примерно в 5 раз ниже на ввод и в 4 раза ниже на вывод, чем Haiku 4.5 от Anthropic, а Terra опускается ниже стандартных цен Claude Sonnet 5 ($3 / $15). Luna также находится рядом с нижней границей цен дешёвых открытых моделей, заданной DeepSeek и GLM-5.2.
В чём подвох с токенами рассуждения?
GPT-5.6 — это модели рассуждений; внутренние токены рассуждений тарифицируются как выходные данные, поэтому эффективная стоимость вывода может превышать наивную оценку. Настройте усилия рассуждений и ограничьте вывод, чтобы это контролировать.
Как получить новые более низкие цены?
Они уже доступны в API OpenAI и, с нулевой наценкой, в OrcaRouter — где GPT-5.6 Luna показывает $0.20 / $1.20, а GPT-5.6 Sol — $4 / $20 — через одну конечную точку, совместимую с OpenAI, без необходимости менять код.
Итог
Снижение цен OpenAI 30 июля сделало GPT-5.6 Luna и Terra значительно дешевле для высоконагруженных задач, а анонс от 21 августа продолжает эту историю для флагманской модели: GPT-5.6 Sol падает до $4 / $20 на ближайшие три месяца, при этом токены Codex дают больше за те же деньги, а использование подписки остаётся без изменений. Оба раунда — это дивиденды эффективности: переписывание ядра и улучшения спекулятивного декодирования с одной стороны, более дешёвое обслуживание — с другой, и очевидный ответ на реальную ценовую войну. Маршрутизируйте по сложности, используйте кэширование и пакетную обработку, контролируйте токены рассуждений, чтобы экономить максимально. А поскольку OrcaRouter передаёт цены провайдеров без наценки (0%), сниженные тарифы уже активны там: Luna по $0.20 / $1.20, Sol по $4 / $20 — та же цена, одна OpenAI-совместимая конечная точка, вся модельная линейка в одном месте. Получите снижение цен, не меняя ни строчки кода, и пусть каждый запрос выбирает самую дешёвую модель, способную справиться с задачей.
