
Ценообразование API GPT-5.6: уровни Sol, Terra и Luna, реальная стоимость и как вызвать каждый из них
- qwenНОВИНКАQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaНОВИНКАOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicНОВИНКАAnthropic: Claude Opus 52026-07-2461Интеллект78Кодинг
- googleНОВИНКАGoogle: Gemini 3.6 Flash2026-07-2150Интеллект69Кодинг
- googleНОВИНКАGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaНОВИНКАMeta: Muse Spark 1.12026-07-1651Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1557Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Интеллект71Кодинг
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Интеллект77Кодинг
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Интеллект77Кодинг
- grokxAI: Grok 4.52026-07-0854Интеллект72Кодинг
- tencentTencent: Hy32026-07-0641Интеллект59Кодинг
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Интеллект42Кодинг
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Интеллект39Кодинг
- anthropicAnthropic: Claude Sonnet 52026-06-3053Интеллект72Кодинг
- klingKling: Kling 3.0 Turbo2026-06-1757Интеллект52Кодинг57Математика
- z-aiZ.ai: GLM 5.22026-06-1651Интеллект69Кодинг60Математика
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Интеллект61Кодинг61Математика
- anthropicAnthropic: Claude Fable 52026-06-0960Интеллект77Кодинг
- qwenQwen: Qwen3.7 Plus2026-06-0139Интеллект56Кодинг59Математика
GPT-5.6 — это флагманская серия OpenAI, выпущенная в июле 2026 года, и важная деталь для разработчиков — у неё не одна цена. Она поставляется в трёх вариантах: Sol, Terra и Luna. На OpenAI API Sol стоит $5 за миллион входных токенов и $30 за миллион выходных, Terra — $2,50 и $15, а Luna — $1 и $6. Для каждого варианта есть скидка на кэшированные входные данные, все три поддерживают ввод изображений, а также текста, а контекстное окно составляет около 1,05 млн токенов с возможностью вывода до 128 тыс.
Розничная цена — это лишь начало реальной стоимости. Какой именно уровень вам нужен, сколько вы кешируете, какой объём вывода генерирует модель, а также несколько правил ценообразования, которые большинство руководств пропускают — подсказки свыше 272 тыс. токенов, надбавка за место хранения данных и уровни обслуживания — влияют на счёт гораздо сильнее, чем базовая ставка. В этом руководстве разбираются цена каждого уровня, для чего он предназначен, как он оценивается, как мигрировать с GPT-5.5, как его вызывать и как он сравнивается с Claude, GLM, Gemini, DeepSeek и Grok.
Краткий ответ: цены на GPT-5.6 с первого взгляда
- Три уровня (за миллион токенов, ввод / вывод): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- Кэшированный ввод: $0.50 (Sol), $0.25 (Terra), $0.10 (Luna) за миллион токенов; запись в кэш стоит в 1.25x тарифа некэшированного ввода.
- Позиционирование: Sol для самых сложных рассуждений и агентной работы, Terra как сбалансированная по умолчанию, Luna для высоконагруженных задач, чувствительных к стоимости.
- Модальность: мультимодальная — GPT-5.6 принимает изображения вместе с текстом. Контекст ~1.05M токенов, максимальный вывод 128K.
- Два правила ценообразования, которые следует учитывать: запросы с более чем 272K входных токенов тарифицируются по двойному тарифу за входные и полуторному за выходные токены для всего запроса, а конечные точки data-residency добавляют 10% надбавку.
- Способы платить меньше: Batch со скидкой 50% от стандартной цены, кэширование сокращает повторный ввод на десятую часть, а маршрутизация рутинной работы на более низкий уровень позволяет избежать вывода Sol за $30.
- Intelligence: Artificial Analysis places GPT-5.6 Sol near the top of its Intelligence Index (score 59).
Цены на API GPT-5.6 по уровням

OpenAI устанавливает цену на GPT-5.6 за миллион токенов, и вывод намного дороже ввода на каждом уровне. Текущие опубликованные тарифы:
- GPT-5.6 Sol: $5.00 за ввод, $0.50 за кэшированный ввод, $30.00 за вывод (запись в кэш $6.25).
- GPT-5.6 Terra: $2.50 вход, $0.25 кэшированный вход, $15.00 выход.
- GPT-5.6 Luna: $1.00 за ввод, $0.10 за кешированный ввод, $6.00 за вывод.
Две детали важны перед планированием бюджета. Во-первых, скорость вывода преобладает в большинстве реальных затрат, особенно для работы по рассуждению и агентной работы, где модель генерирует длинные трассы, вызовы инструментов и правки до финального ответа. Во-вторых, на странице цен нет отдельной строки «Sol Ultra»; «Sol Ultra» — это конфигурация Sol с повышенным уровнем рассуждения (многоагентная установка), а не независимый уровень — планируйте бюджет исходя из Sol, Terra и Luna.
Для чего на самом деле нужен каждый уровень
Luna: высокообъемный и чувствительный к затратам
Luna — это экономичный уровень по цене $1 за вход и $6 за выход. Это правильный выбор по умолчанию для классификации, извлечения, маршрутизации, обобщения, составления черновиков и больших объёмов рутинной работы, где небольшая разница в качестве не меняет результат. При цене шесть долларов за миллион выходных токенов это достаточно дёшево для работы в масштабе и многократной выборки.
Terra: сбалансированный вариант по умолчанию
Terra находится посередине: $2.50 и $15. Для большинства прикладных задач и написания кода это разумная отправная точка: заметно сильнее Luna на более сложных заданиях, но при вдвое меньшей выходной цене, чем у Sol. Начинайте здесь, а затем переносите задачу на Sol, только когда Terra явно с ней не справляется.
Сол: самая сложная работа по рассуждению и агентным действиям
Sol является флагманской моделью по цене $5 и $30, и Artificial Analysis помещает её вблизи вершины своего Индекса Интеллекта. Используйте её для сложной архитектуры, комплексной отладки, долгосрочных агентов и анализа с высокими ставками, где одно предотвращённое фиаско оправдывает надбавку. Использование Sol для рутинной работы — самый распространённый способ переплатить на GPT-5.6.
Переходите с GPT-5.5? Какой тариф экономит больше всего?
GPT-5.6 Sol стоит так же, как GPT-5.5: $5 за вход и $30 за выход, поэтому перемещение рабочей нагрузки GPT-5.5 напрямую на Sol мало что меняет в счете. Экономия заключается в двух новых более низких уровнях. Terra обеспечивает примерно качество уровня GPT-5.5 на большинстве задач за половину цены, поэтому самый простой способ миграции — отправлять существующий трафик GPT-5.5 на Terra и только те задачи, которые ухудшаются, повышать обратно до Sol.
Практический план миграции состоит из трех шагов: перенаправьте вызовы GPT-5.5 на Terra, запустите свой набор для оценки и передавайте только неудачные случаи Sol, одновременно отодвигая явно рутинную работу на Luna. Большинство рабочих нагрузок GPT-5.5 таким образом обходятся дешевле без измеримой потери качества.
Как на самом деле оцениваются уровни


Price only matters next to capability. On OpenAI’s own Terminal-Bench 2.1 numbers, the tiers separate about as you would expect: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, and Luna 84.7%. For context in the same table, GPT-5.5 scores 85.6%, Claude Opus 4.8 is 78.9%, Claude Fable 5 is 83.1%, and Gemini 3.1 Pro (preview) is 70.7%. Artificial Analysis separately gives Sol an Intelligence Index of 59, near the top of its ranking.
Читайте это как отчеты от вендоров и ориентиры. OpenAI опубликовал ограниченный набор оценок для GPT-5.6 и на момент написания статьи не публиковал традиционные бенчмарки по кодингу и рассуждениям, такие как SWE-bench Verified или GPQA, поэтому используйте эти оценки, чтобы решить, что тестировать на своей собственной рабочей нагрузке, а не как окончательный вердикт.

Скорость чтения из кэша для каждого уровня составляет одну десятую от скорости чтения свежих данных: $0.50 на Sol, $0.25 на Terra, $0.10 на Luna. Однако запись в кэш стоит в 1,25 раза дороже скорости ввода без кэширования (около $6,25 на миллион на Sol), поэтому кэширование оправдывает себя только тогда, когда стабильный префикс используется повторно достаточное количество раз, чтобы окупить премию за запись — системные инструкции, большой документ, правила репозитория или таксономия продуктов. Поместите стабильный материал в начало подсказки, а изменяющийся вопрос — в конец, и избегайте вставки временных меток или случайных идентификаторов перед повторно используемым контекстом.
Кэширование снижает повторные затраты на ввод; оно ничего не делает для вывода. Поскольку вывод — это дорогостоящая сторона на каждом уровне, два рычага, которые больше всего влияют на счет GPT-5.6, — это кэширование стабильного префикса и контроль объема того, что модель пишет.
Какой уровень вам следует выбрать?

Не выбирайте уровень по репутации. Выбирайте его по тестам. Создайте небольшой набор репрезентативных задач с четкими критериями приемки, сначала запустите их на Luna, и продвигайте только те задачи, которые не удались, на Terra, затем на Sol. Измеряйте стоимость за принятую задачу, а не среднюю цену токена, потому что более дешевый уровень, требующий трех попыток, может стоить дороже, чем более сильный уровень, который справляется с первого раза.
Одна операционная привычка экономит реальные деньги: указывать точный ID модели уровня в каждом вызове, а не полагаться на голый псевдоним, чтобы рядовой запрос никогда незаметно не выполнялся на самом дорогом уровне. Смешанная рабочая нагрузка обычно сводится к тому, что Luna используется для рутинных преобразований и черновиков, Terra — для повседневной реализации и анализа, а Sol зарезервирована для сложного меньшинства — большинству запросов флагман вообще не нужен.
GPT-5.6 vs конкуренты по цене
GPT-5.6 does not exist in isolation. Read against the current field (per million tokens, input / output, mid-2026): Claude Opus 4.8 is $5 / $25, Claude Fable 5—Anthropic’s strongest public model—is $10 / $50, GLM 5.2 is $1.40 / $4.40 on Z.AI (third-party hosts can be lower), Grok 4.5 is $2 / $6, Google’s Gemini 3.5 Flash is about $1.50 / $9, and DeepSeek V4-Pro is about $0.44 / $0.87. Confirm each on the vendor’s own page, as these move.
Выводы конкретны. GPT-5.6 Sol соответствует Opus 4.8 по входу, но дороже по выходу ($30 против $25), поэтому для задач с интенсивным выходом Opus немного дешевле за токен, в то время как Sol лидирует в Индексе интеллекта. Terra дешевле обоих флагманов и является лучшим выбором по соотношению цены и качества в семействе OpenAI. Luna конкурирует по цене с более дешевыми моделями, хотя Grok 4.5, GLM 5.2 и особенно DeepSeek расположены еще ниже. Ни один отдельный уровень или поставщик не выигрывает во всем, именно поэтому маршрутизация по сложности лучше, чем привязка к одному.
Отработанный ежемесячный счет

Нанесите на него числа. Для средне-тяжелого месяца с 50M входных и 10M выходных токенов, по прейскурантной цене до кэширования и использования инструментов, стоимость модели составляет примерно:
- GPT-5.6 Luna: примерно $110.
GPT-5.6 Terra: около $275.
- GPT-5.6 Sol: примерно $550.
- Для сравнения: GLM 5.2 около $114, Grok 4.5 около $160, Claude Opus 4.8 около $500, Claude Fable 5 около $1,000.
Те же задачи, интеллектуально распределенные — Luna и Terra для основной массы, Sol для сложного меньшинства — оказываются гораздо ближе к диапазону $110–$275, чем к плоской цене $550 за Sol для всего. Этот разрыв, умноженный на год, и есть вся суть аргументации в пользу маршрутизации на основе уровней.
Скрытые расходы, которые нужно предусмотреть
Несколько правил ценообразования не отображаются в базовой ставке и удивляют команды позже:
- Длинные промпты: запрос объемом более 272 тыс. входных токенов тарифицируется по двойной стоимости входных и полуторной стоимости выходных токенов для всего запроса, поэтому вызовы с большим контекстом и большие RAG-запросы могут увеличить стоимость более чем вдвое.
- Объем вывода: вывод может достигать шестикратного объема ввода, поэтому неограниченный или высокоинтеллектуальный вывод представляет наибольший риск перерасхода.
Уровень обслуживания: приоритетная обработка стоит примерно вдвое больше стандартной ставки (около $10 за ввод / $60 за вывод на Sol); Flex и Batch дешевле. Выбирайте уровень осознанно с помощью настройки service_tier.
- Хранение данных: региональные конечные точки обработки добавляют 10% повышение для моделей, выпущенных 5 марта 2026 года или позднее, что включает GPT-5.6.
- Циклы и повторные попытки агента: инструкции, инструменты и история повторно отправляются на каждом шаге, а неудачный длинный запрос приводит к потере ввода, за который вы уже заплатили.
- Дрейф уровней: оставлять всё на Sol «чтобы быть в безопасности» — самая дорогая привычка.
Способы платить меньше
Три рычага сокращают счет за GPT-5.6, не меняя то, что вы создаете. Batch: асинхронные запросы через пакетный уровень (Batch tier) дешевле на 50% от стандартной цены, идеально для высокообъемной работы с Luna, не чувствительной к задержкам. Caching: повторно используйте стабильный префикс достаточное количество раз, чтобы превзойти надбавку за запись в 1.25x, и повторный ввод снижается до десятой части. Routing: отправляйте рутинную работу на Luna или Terra и передавайте только сложные меньшинства на Sol, а также по возможности держите prompts ниже порога в 272K.
Как вызвать GPT-5.6
GPT-5.6 доступен через OpenAI API и через шлюзы, совместимые с OpenAI, поэтому интеграция остаётся стабильной, когда вы меняете модель или уровень за ней. Ниже приведён стандартный шаблон, совместимый с OpenAI; перед использованием в production подтвердите текущий идентификатор модели и фиксируйте точный уровень, а не голый псевдоним.
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Выполните рефакторинг этого модуля и объясните риски."}],
)
print(response.choices[0].message.content)
Переключение между уровнями — это изменение одной строки в поле модели, что делает маршрутизацию на основе сложности практичной: отправляйте рутинные вызовы на Luna или Terra и повышайте уровень только сложных до Sol.
Тестирование GPT-5.6 через OrcaRouter
Шлюз упрощает внедрение GPT-5.6 по двум причинам. Во-первых, один и тот же совместимый с OpenAI клиент может вызывать все три уровня и сравнительные модели, такие как Claude Opus 4.8, GLM 5.2 и Grok 4.5, поэтому вы можете запустить один оценочный набор для всего без переписывания интеграционного кода и измерить реальную стоимость за принятую задачу — включая комиссии за инструменты, повторные попытки и наценку в 272K. Во-вторых, шлюз может выполнять отказоустойчивое переключение между провайдерами и обеспечивать лимит бюджета, поэтому временная проблема с пропускной способностью или случайный вызов Sol не сорвут месяц. Подтвердите действующий маршрут GPT-5.6 и текущие идентификаторы уровней, прежде чем строить на них бюджет.

Следующий шаг: зарегистрируйтесь в OrcaRouter и запустите собственное сравнение уровней GPT-5.6 через один API-эндпоинт.
Часто задаваемые вопросы
В чем разница между GPT-5.6 Sol, Terra и Luna?
Это три уровня одной семьи с разными ценами и уровнями возможностей. Sol — флагман для самых сложных задач ($5/$30), Terra — сбалансированный вариант по умолчанию ($2.50/$15), а Luna — экономичный уровень для задач с большим объемом ($1/$6). Выберите самый низкий, который проходит ваши тесты.
Есть ли ценовой уровень GPT-5.6 Sol Ultra?
Нет. "Sol Ultra" — это конфигурация Sol с более высоким уровнем рассуждений и множеством агентов, а не отдельная строка на странице с ценами. Она использует больше токенов и стоит дороже за задачу, но вы планируете её как Sol с более высокими усилиями.
Почему мой счет за GPT-5.6 превысил простую оценку?
Обычно выходные токены, надбавка за длинный промпт в 272K (2x на ввод, 1.5x на вывод), уровень приоритетного обслуживания, надбавка за размещение данных или повторные попытки. Записывайте полную цепочку запросов и измеряйте стоимость за принятую задачу, а не за промпт.
Могу ли я точно настроить GPT-5.6, и есть ли бесплатный тариф?
Нет на оба. GPT-5.6 не поддерживает тонкую настройку, а в API нет бесплатного тарифа — оплата начинается с первого токена. Бесплатный доступ существует только внутри некоторых планов ChatGPT, что является отдельным продуктом от API.
Какой план ChatGPT может использовать какой уровень?
Зависит от продукта. В ChatGPT Work и Codex пользователи Free и Go могут использовать Terra, в то время как Plus и выше могут выбирать между Sol, Terra и Luna; самый высокий уровень ultra ограничен для Pro и Enterprise. Относитесь к планам API и ChatGPT как к отдельным — ключ API не наследует доступ от подписки.
Суть
История ценообразования GPT-5.6 — это уровневая система. Sol за $5/$30 возглавляет рейтинг интеллекта, Terra за $2.50/$15 — это стандартный вариант по соотношению цена/качество и естественный дом для бывшего трафика GPT-5.5, а Luna за $1/$6 обрабатывает объём. Кэширование сокращает повторный ввод до десятой части (после надбавки на запись в 1.25x), пакетная обработка (Batch) стоит вдвое дешевле, но вывод (output) — дорогая сторона на каждом уровне, и длинные запросы более 272K несут наценку.
Относитесь к трём уровням как к задаче маршрутизации, а не к единой покупке: по умолчанию низкий, повышать при сбое, кэшировать стабильный контекст, использовать Batch там, где позволяет задержка, и держать сравнительную модель доступной через ту же конечную точку. Это даёт гораздо меньшую стоимость за принятую задачу, чем оплата флагманских тарифов за рутинную работу.
