OpenAI снизила цены на GPT-5.6 API: что изменилось, почему и как получить
Guides & Insights

OpenAI снизила цены на GPT-5.6 API: что изменилось, почему и как получить

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

30 июля 2026 года OpenAI снизила цены на API для своих двух более дешёвых моделей GPT-5.6 — резко уменьшив стоимость самого дешёвого тарифа и немного урезав средний тариф. Три недели спустя OpenAI перешла к флагманской модели: 21 августа 2026 года OpenAI объявила, что цены на API GPT-5.6 Sol будут снижены более чем на 20% в течение следующих трёх месяцев, по мере того как компания работает над повышением эффективности модели. В этой статье подробно объясняется, что именно изменилось в обоих раундах, какие инженерные решения за этим стоят, как новые цены выглядят на фоне конкурентов, какие скрытые издержки стоит учитывать, как ещё больше сократить свой счёт — и как сниженные цены уже действуют на OrcaRouter с нулевой наценкой.

Каждая цифра ниже помечена источником. Цены указаны за миллион токенов (вход / выход). Тарифы Luna и Terra отражают прайс-лист OpenAI от 30 июля 2026 года, о котором сообщали в том числе Unite.AI; снижение цен Sol отражает анонс OpenAI от 21 августа 2026 года, с ценами за токен, о которых сообщали в том числе Runtimewire и Reuters. На страницах модели транзитного ценообразования OrcaRouter указаны те же цифры; данные по конкурентам приведены с указанием источников. Цены меняются — проверяйте перед созданием продукта.

TL;DR. OpenAI снизила цены на GPT-5.6 Luna до $0,20 / $1,20 (с $1 / $6, скидка ~80%) и на GPT-5.6 Terra до $2 / $12 (с $2,50 / $15, скидка ~20%) 30 июля. 21 августа скидку распространили на флагманскую модель: цены API GPT-5.6 Sol падают более чем на 20% в течение следующих трёх месяцев — до $4 / $20 за миллион токенов с $5 / $30, по данным OpenAI, — при этом токен-ориентированные кредиты Codex и ChatGPT Work дают больше, а использование по подписке остаётся без изменений. Июльское снижение цен стало возможным благодаря двум улучшениям эффективности: переписанным GPU-ядрам (примерно на 20% ниже стоимость обслуживания) и переработанной черновой модели для спекулятивного декодирования (генерация токенов на 15%+ быстрее). Если вы маршрутизируете запросы через нейтральный к вендорам эндпоинт с нулевой наценкой, например OrcaRouter, новые тарифы уже действуют — та же цена, один OpenAI-совместимый API, а рядом все конкурирующие модели, чтобы сравнивать и маршрутизировать между ними.

Основные выводы

• GPT-5.6 Luna: теперь $0.20 / $1.20 за 1 млн токенов, вместо $1 / $6 — снижение примерно на 80%.

• GPT-5.6 Terra: теперь $2 / $12, снижение с $2.50 / $15 — примерно на 20%.

• GPT-5.6 Sol (флагман): теперь $4 / $20 на следующие три месяца, вместо $5 / $30 — снижение более чем на 20%, объявленное 21 августа 2026 года.

• Кредиты на основе токенов Codex и ChatGPT Work теперь дают больше: ввод Sol снижается до 100 кредитов, а вывод — до 500 кредитов за 1 млн токенов (ранее 125 / 750).

Подписки не изменились: включенное использование в тарифах Plus, Pro и Business, лимиты пять часов в неделю и прежние тарифы кредитов остаются без изменений.

• Зачем: OpenAI представил оба раунда как дивиденды от повышения эффективности — переписанные продакшен GPU-ядра (~20% снижение стоимости обслуживания) плюс редизайн черновой модели для спекулятивного декодирования (повышение эффективности генерации токенов на 15%+), согласно инженерному посту OpenAI от 29 июля.

• Как получить: скидки уже отражены в OrcaRouter (наценка 0%) — Luna по $0,20 / $1,20, Sol по $4 / $20 — через одну OpenAI-совместимую конечную точку.

Что именно изменилось?

Семейство моделей OpenAI GPT-5.6 работает как лестница уровней: Luna (быстрая, самая дешёвая), Terra (средняя) и Sol (флагманская). Сокращение цен 30 июля затронуло два более дешёвых уровня. Согласно опубликованному прайс-листу, GPT-5.6 Luna подешевела с $1 / $6 до $0,20 / $1,20 за миллион входных/выходных токенов — примерно на 80% как для входа, так и для выхода, — а GPT-5.6 Terra — с $2,50 / $15 до $2 / $12, примерно на 20%. GPT-5.6 Sol, флагманскую модель, созданную для самых сложных рассуждений и агентного программирования, в тот день не трогали — но 21 августа 2026 года OpenAI объявила о временном снижении цен и для неё: цены API падают более чем на 20% на ближайшие три месяца, до $4 за миллион входных токенов и $20 за миллион выходных, а кэшированный вход дешевеет с $0,50 до $0,40. В том же объявлении говорилось, что покупаемые вами кредиты в Codex на тарифах на основе токенов теперь работают дальше, а включённое в вашу подписку использование остаётся прежним.

Базовая ставка за токен — это ещё не вся история. В ценообразовании GPT-5.6 также есть уровни в зависимости от длины ввода (очень длинные контексты переходят на более высокую ставку), скидка на кэширование промптов (кэшированный ввод обходится гораздо дешевле, чем свежий) и пакетный вариант (асинхронные задания со скидкой). Все три фактора сохраняются и после снижения цен, так что эффективная цена для рабочей нагрузки с интенсивным использованием кэша или пакетов может быть ещё ниже. Однако следите за уровнем длинного контекста и в другую сторону: очень большие промпты могут перевести вас на уровень выше.

Две оптимизации за катом

Это не было работой в убыток ради привлечения клиентов — OpenAI преподнёс это как дивиденд от эффективности. В инженерном посте от 29 июля 2026 года сотрудники технического отдела OpenAI описали оптимизации в инференсе и агентской обвязке, лежащих в основе Codex и ChatGPT Work. Две особенно примечательны. Во-первых, переписывание GPU-ядер во всей продакшн-инфраструктуре — с помощью Sol, работающего внутри Codex, для переписывания собственных ядер компании, — которое, по словам OpenAI, сократило сквозные затраты на сервинг примерно на 20%. Во-вторых, переработанная черновая модель спекулятивного декодирования, которая, как сообщается, повысила эффективность генерации токенов более чем на 15%. Снижение стоимости сервинга, переданное клиентам в виде более низких цен на тарифах с высокими объёмами, — вот суть, и это проблеск петли обратной связи, за которой гонится вся индустрия: использование фронтирных моделей для оптимизации самой инфраструктуры, которая их обслуживает.

Объявленное 21 августа снижение цены на Sol имеет ту же формулировку. По словам OpenAI, сокращение — более чем на 20% в течение следующих трёх месяцев — связано с тем, что компания делает модель более эффективной в работе, и оно явно временное, а не постоянное изменение цены.

Как соотносятся новые цены

Снижение цен метит прямо в конкурентов. По данным Unite.AI, новые расценки Luna — $0,20 / $1,20 — примерно в 5 раз ниже входной цены и в 4 раза ниже выходной цены Anthropic Haiku 4.5, а новые $2 / $12 у Terra оказываются ниже стандартного прайсинга Claude Sonnet 5 (сообщается, что $3 / $15 вступают в силу после 31 августа 2026 года). На поле моделей с открытыми весами Luna теперь находится близко к минимальной планке дешёвого инференса, заданной линейкой DeepSeek V4 и GLM-5.2 от Zhipu (примерно $1,20 / $4,10), а тарифы Alibaba Qwen и Google Gemini Flash находятся в том же диапазоне. Временное снижение Sol до $4 / $20 оставляет флагманскую модель значительно выше её собственных объёмных тарифов, но урезает премию — и сокращение выходных токенов на треть важнее всего для агентных нагрузок с большим объёмом выходных данных. В освещении этого шага отмечается, что он происходит на фоне растущей конкуренции OpenAI со стороны Anthropic и китайских ИИ-моделей.

Инференс становится всё дешевле

Если посмотреть шире, это снижение цен вписывается в многолетний тренд: стоимость заданного уровня производительности резко падает из поколения в поколение, поскольку лаборатории выжимают всё большую пропускную способность из того же оборудования. Более старые тарифы самой OpenAI иллюстрируют это постепенное удешевление, и каждый прорыв в эффективности — лучшие ядра, спекулятивное декодирование, более дешёвое внимание — обычно превращается в снижение цен в течение нескольких месяцев. Для покупателей практический вывод — проектировать архитектуру под мир, где инференс дешевеет по предсказуемому графику: не привязывайтесь к ценам одной модели и сохраняйте возможность дешёвого переключения.

Скрытая стоимость, на которую стоит обратить внимание: токены рассуждений

Модели GPT-5.6 — это модели рассуждений, и это влияет на реальные расходы. Когда рассуждение включено, модель генерирует внутренние токены рассуждений, которые тарифицируются как выходные данные, — поэтому ваша эффективная стоимость вывода может быть выше, чем предполагает наивная оценка «слов в ответе», особенно на сложных запросах с высоким уровнем рассуждения. Решение — настраивать уровень рассуждения под задачу (низкий или выключенный для простых вызовов), ограничивать вывод там, где можно, и измерять фактическое использование токенов, а не предполагать. Более низкая цена за токен помогает, но контроль над количеством генерируемых токенов помогает больше.

Что это значит для разработчиков

Если вы используете GPT-5.6 Luna или Terra для работы с большими объёмами — классификации, извлечения данных, маршрутизации, лёгких агентов, чатов — ваш счёт только что снизился, в некоторых случаях на бо́льшую часть суммы, и для этого не нужно менять код. Это делает объёмные тарифы ещё более привлекательными для затрато-чувствительных нагрузок и сокращает ценовой разрыв с дешёвыми открытыми моделями. Флагманские расценки тоже изменились, по крайней мере пока: Sol по $4 / $20 в течение следующих трёх месяцев снижает стоимость задач с интенсивными рассуждениями и агентной работы на верхнем уровне, а токен-основанные кредиты Codex и ChatGPT Work покрывают больший объём. Это по-прежнему премиальный выбор для самых сложных задач — просто более дешёвый, чем раньше. Выигрышная схема та же: маршрутизация по сложности — дешёвые тарифы (или дешёвые открытые модели) для лёгких 80%, флагман только там, где он оправдывает свою стоимость.

Как еще больше сократить ваши счета

Снижение цены — это фундамент для развития, а не финишная черта. Крупнейшие дополнительные рычаги: кэширование промптов (повторно используйте стабильный системный промпт или длинный контекст и платите гораздо более низкую ставку за кэшированный ввод); пакетный режим (выполняйте несрочные задания асинхронно со скидкой); маршрутизация по уровням и моделям (отправляйте каждый запрос самой дешёвой модели, которая с ним справится, включая открытые модели); и управление рассуждениями (не платите за глубокие рассуждения на тривиальных запросах). В совокупности эти меры регулярно сокращают реальные счета гораздо сильнее, чем любое отдельное изменение тарифов. В качестве конкретного ориентира: при 10 миллионах токенов в месяц с 70% долей ввода новые тарифы Luna составляют примерно $5 в месяц (около $4.37 с кэшированием); тот же объём на Sol — около $125 в месяц — самый наглядный аргумент в пользу маршрутизации по сложности.

Как сразу зафиксировать более низкие цены

Вот та часть, которая связывает всё воедино. OrcaRouter взимает 0% наценки и передаёт цены провайдера напрямую, так что сниженные цены OpenAI уже действуют на OrcaRouter: GPT-5.6 Luna показывает $0.20 / $1.20, Terra $2 / $12, а GPT-5.6 Sol $4 / $20 на страницах моделей прямо сейчас — те же тарифы, что и на собственной карточке OpenAI, доступные через единый OpenAI-совместимый эндпоинт наряду с 185+ другими моделями. Вы получаете сниженные цены без миграции и можете сравнивать цены Sol, Luna и Terra с DeepSeek, GLM, Qwen, Gemini и Claude в одном месте, а затем направлять каждый запрос туда, где он обойдётся дешевле всего для задачи. Также есть бесплатный тариф и страница Offers для дополнительной экономии.

Снижение цен уже действует на OrcaRouter: GPT-5.6 Luna по $0.20 / $1.20 и GPT-5.6 Sol по $4 / $20 за 1 млн токенов, с нулевой наценкой.

Прокладывайте маршрут по сложности, чтобы сэкономить ещё больше.

Самый дешёвый счёт — это не одна модель, а правильная модель для каждого запроса. Поскольку OrcaRouter открывает весь модельный ряд через одну конечную точку, вы можете отправлять простые высокообъёмные запросы на Luna или дешёвую открытую модель, а Sol или другой флагман приберечь для сложных, переключаясь изменением конфигурации, а не повторной интеграцией. Снижение цены на Luna делает эту стратегию маршрутизации по сложности ещё дешевле, а временная скидка на Sol снижает стоимость и сложных запросов — без какой-либо переделки с вашей стороны.

Часто задаваемые вопросы

Насколько OpenAI снизила цены на GPT-5.6?

GPT-5.6 Luna подешевела с $1 / $6 до $0,20 / $1,20 за миллион токенов (примерно на 80%), а GPT-5.6 Terra — с $2,50 / $15 до $2 / $12 (примерно на 20%). 21 августа 2026 года OpenAI также снизила цены на GPT-5.6 Sol с $5 / $30 до $4 / $20 на следующие три месяца.

Когда вступило в силу снижение цен?

Сокращения Luna и Terra вступили в силу 30 июля 2026 года и были отражены в опубликованном тарифном прайс-листе. OpenAI объявил о временном снижении Sol 21 августа 2026 года на следующие три месяца.

Почему OpenAI снизил цены?

OpenAI объясняет июльское снижение цен оптимизацией инференса — переписанными производственными GPU-ядрами (примерно на 20% ниже стоимость обслуживания) и переработанной моделью-черновиком для спекулятивного декодирования (эффективность генерации токенов выше на 15%+) — согласно инженерному посту от 29 июля 2026 года. Компания представила снижение цен на Sol аналогичным образом — как шаг, предпринятый по мере того, как модель становится дешевле в эксплуатации, на рынке с растущей конкуренцией.

Флагман (Sol) подешевел?

Да — временно. Снижение цен 30 июля оставило GPT-5.6 Sol на уровне $5 / $30, но 21 августа 2026 года OpenAI объявила о снижении цен более чем на 20% на следующие три месяца, до $4 / $20 за миллион токенов. Токен-кредиты Codex и ChatGPT Work также позволяют купить больше, в то время как использование по подписке остаётся без изменений.

Как новые цены соотносятся с ценами Anthropic и открытых моделей?

Согласно сообщениям, Luna теперь предлагает цены примерно в 5 раз ниже на ввод и в 4 раза ниже на вывод, чем Haiku 4.5 от Anthropic, а Terra опускается ниже стандартных цен Claude Sonnet 5 ($3 / $15). Luna также находится рядом с нижней границей цен дешёвых открытых моделей, заданной DeepSeek и GLM-5.2.

В чём подвох с токенами рассуждения?

GPT-5.6 — это модели рассуждений; внутренние токены рассуждений тарифицируются как выходные данные, поэтому эффективная стоимость вывода может превышать наивную оценку. Настройте усилия рассуждений и ограничьте вывод, чтобы это контролировать.

Как получить новые более низкие цены?

Они уже доступны в API OpenAI и, с нулевой наценкой, в OrcaRouter — где GPT-5.6 Luna показывает $0.20 / $1.20, а GPT-5.6 Sol — $4 / $20 — через одну конечную точку, совместимую с OpenAI, без необходимости менять код.

Итог

Снижение цен OpenAI 30 июля сделало GPT-5.6 Luna и Terra значительно дешевле для высоконагруженных задач, а анонс от 21 августа продолжает эту историю для флагманской модели: GPT-5.6 Sol падает до $4 / $20 на ближайшие три месяца, при этом токены Codex дают больше за те же деньги, а использование подписки остаётся без изменений. Оба раунда — это дивиденды эффективности: переписывание ядра и улучшения спекулятивного декодирования с одной стороны, более дешёвое обслуживание — с другой, и очевидный ответ на реальную ценовую войну. Маршрутизируйте по сложности, используйте кэширование и пакетную обработку, контролируйте токены рассуждений, чтобы экономить максимально. А поскольку OrcaRouter передаёт цены провайдеров без наценки (0%), сниженные тарифы уже активны там: Luna по $0.20 / $1.20, Sol по $4 / $20 — та же цена, одна OpenAI-совместимая конечная точка, вся модельная линейка в одном месте. Получите снижение цен, не меняя ни строчки кода, и пусть каждый запрос выбирает самую дешёвую модель, способную справиться с задачей.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube