Редакционная плоская векторная иллюстрация для hero-секции технологического блога о ценообразовании флагманских моделей: большой скругленный чип модели глубокого синего цвета с мягким циановым свечением на светлом фоне, бумажный ценник, прикрепленный к его углу, три потока токенов, вытекающих из чипа в круглый ценовой индикатор с мелкими абстрактными делениями, небольшая стопка кэшированных блоков рядом с индикатором и тонкий календарный лист, выезжающий слева. Белый фон с мягкими сине-голубыми градиентными акцентами и одним едва заметным теплым бликом; минималистичные плоские линейные иконки; чистая современная геометрическая типографика без засечек; без читаемого текста.
Guides & Insights

Цены на GPT-5.6 Sol API: $5 / $30 за 1M токенов, кэш по $0.50, и какова реальная стоимость

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

GPT-5.6 Sol стоит $5.00 за миллион входных токенов и $30.00 за миллион выходных токенов в API GPT-5.6 Sol — по той же ставке, что и флагманский тариф в каталоге OrcaRouter (проверено 2026-08-18, без наценки). Это самый дорогой тариф в семействе GPT-5.6 и единственный, чья цена не изменилась после урезания 30 июля, так что для бюджетирования нужно ориентироваться на тарифную карту на странице живой модели GPT-5.6 Sol. Рычаги важнее заголовка: повторное использование входных данных обходится в $0.50 за миллион благодаря кэшированию промптов, batch API снижает цены до $2.50 / $15.00, а быстрый режим обменивает 2x надбавку на скорость до 2.5x. Эта страница — справочник по ценам именно для Sol: точная тарифная карта, сколько реально стоит запрос, как флагман выглядит на рынке, когда его брать не стоит и как обратиться к нему через один OpenAI-совместимый endpoint со своим ключом.

Цены указаны за миллион токенов (вход / выход) по состоянию на 18.08.2026. Долларовые значения взяты из опубликованных тарифов OpenAI API и сверены со страницей модели OrcaRouter для GPT-5.6 Sol; тарифы на кэш, пакетные запросы, быстрый режим и длинный контекст объявлены OpenAI. Цены меняются — проверьте перед созданием.

Точная цена, проверенная сегодня

Вот полная карта тарифов для GPT-5.6 Sol, проверено 2026-08-18:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

Вход — $5.00 за 1M токенов при промахе кэша.

Вывод — $30.00 за 1M токенов.

Чтение из кэша промптов — $0,50 за 1 млн токенов, скидка 90% на любой повторно отправленный ввод.

Запись в кэш промптов — $6.25 за 1M токенов.

Уровень длинного контекста — входные данные, превышающие примерно 272K токенов, тарифицируются по $10.00 за вход / $45.00 за выход (2x за вход, 1.5x за выход).

Batch API — $2.50 за вход / $15.00 за выход, фиксированная скидка 50%, асинхронно, обычно готово в течение примерно 24 часов.

Быстрый режим — $10.00 вход / $60.00 выход, надбавка 2x за выходную скорость до примерно 2.5x без изменения интеллекта.

Контекстное окно — ~1,05 млн токенов, до 128K на выходе.

OrcaRouter передаёт тариф провайдера без наценки, поэтому цифра в каталоге — это цифра, которую вы платите. На живой странице модели карточка показывает $5.00 / $30.00 за 1M, чтение из кэша — $0.500, с бейджами Vision, Tools, JSON и Reasoning. Цена Sol $5 / $30 тоже является ценой до снижения: снижение OpenAI от 30 июля применено к GPT-5.6 Luna (теперь $0.20 / $1.20) и GPT-5.6 Terra (теперь $2 / $12), а флагманская модель осталась без изменений.

Рычаги, которые меняют эффективную цену

Базовая ставка — это лишь отправная точка. Четыре модификатора меняют то, сколько Sol на самом деле вам стоит.

Кэширование промптов — повторно используемый контекст тарифицируется по $0,50 за миллион вместо $5 за новый, а запись в кэш стоит $6,25 за миллион. Для любого агента или чата, который повторно отправляет большой префикс на каждом ходу, кэширование — самый значимый рычаг влияния на счёт. OpenAI привязывает кэш к проекту и API-ключу, поэтому оставаться на одном ключе (одном канале) — это то, что обеспечивает попадания в кэш.

Тариф с длинным контекстом — запрос, чей ввод превышает примерно 272K токенов, переходит с базовой ставки на $10 / $45. Несколько огромных промптов могут незаметно повысить вашу среднюю цену, поэтому пакетируйте или обрезайте запросы, когда вам на самом деле не нужен глубокий контекст.

Batch — пакетный API OpenAI запускает задания асинхронно, с временем обработки около 24 часов, ровно за полцены: $2.50 / $15.00, с кэшированным вводом по $0.25 и записью в кэш по $3.13. Он сочетается с кэшированием промптов и подходит для оценки моделей, массовой классификации и офлайн-генерации, где задержка не имеет значения.

Быстрый режим — $10 / $60 за пропускную способность вывода до ~2.5x, полезен для задач, критичных к задержкам, когда пользователь ждет результат, например при помощи в написании кода в реальном времени. Тарифицируется за токен по двойной стандартной ставке, не учитывается в приобретенных пакетах TPM уровня Scale и может переключаться на стандартную обработку при превышении общего лимита скорости.

Что на самом деле стоит запрос

Цены за токен абстрактны, поэтому вот наглядные примеры по сегодняшним ставкам:

Один вызов чата, 50K вход + 20K выход — $0.25 + $0.60 = $0.85.

1M вход + 1M вывод — $5 + $30 = $35.

Агентный ход, 200K кэшированного контекста + 20K нового ввода + 30K вывода — $0.10 + $0.10 + $0.90 = $1.10. Тот же ход с холодным кэшем — 220K нового ввода по $1.10 — составляет $2.00. Кэширование почти вдвое сокращает стоимость.

Месяц на 10M токенов при разбиении 70% на вход / 30% на выход, при этом 80% входных данных подаётся из кэша: 1.4M некэшированных входных ($7.00) + 5.6M из кэша ($2.80) + 3M выходных ($90) ≈ $100. Без кэша тот же месяц стоит $125 — и тот же месяц на GPT-5.6 Terra обходится примерно в $50, или около $5 на GPT-5.6 Luna. Этот 20-кратный разрыв между Sol и Luna — вот почему подбор уровня важнее, чем любая отдельная ставка.

Два предостережения повышают эффективную ставку. Sol — модель рассуждений: внутренние токены рассуждений тарифицируются как выходные по $30 за миллион. Сложный промпт при высоком уровне усилия рассуждений может тратить большую долю выходного бюджета на размышления, поэтому эффективная стоимость вывода для сложных задач значительно превышает наивную оценку. К тому же токенизатор OpenAI более многословен, чем у предыдущего поколения, на некоторых входных данных, поэтому один и тот же текст может стоить больше токенов, чем стоил бы на GPT-5.5. Настраивайте усилие рассуждений под задачу, ограничивайте выходной объём, где можно, и измеряйте фактическое использование, прежде чем прогнозировать счёт.

Как цены Sol соотносятся с конкурентами

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Сверено с опубликованными прейскурантными ценами на 2026-08-18:

GPT-5.6 Terra — $2 / $12, средний тариф после снижения цен. Sol стоит в 2,5 раза дороже на вводе и выводе; Terra — вариант по умолчанию, когда не нужны флагманские рассуждения.

GPT-5.6 Luna — $0.20 / $1.20, объёмный тариф после среза. Разрыв по входу с Sol в 25 раз; Luna рассчитана на основную массу простого трафика.

Claude Opus 5 — $5 / $25. Тот же ввод, на бумаге вывод на 20% дешевле. На практике для некоторых рабочих нагрузок сравнение меняется: этот блог ранее измерил, что Sol использует примерно на 34,5% меньше токенов, чем модель Anthropic, на той же англоязычной/смешанной выборке, а опубликованный анализ токен-экономики (TheBlockBeats) оценил, что общий счёт Sol может быть примерно на 21% ниже, чем у Claude Opus 5, за эквивалентную работу, несмотря на более высокую цену за вывод. Измеряйте свой собственный токенизатор, а не ценник.

Claude Fable 5 — $10 / $50. Sol вдвое дешевле по входу и на 40% дешевле по выходу, чем топ-уровень Anthropic.

Claude Opus 4.8 — $5 / $25. Тот же вход, что и у Sol, а выход дешевле — предыдущий флагман Anthropic.

Grok 4.6 — $2 / $6. Самый яркий показатель на табло: он сравнялся с GPT-5.6 Sol по индексу Artificial Analysis (оба 61), при этом ввод в 2,5 раза дешевле, а вывод — в 5 раз.

DeepSeek V4 Pro — $0.44 / $0.88 в непиковые часы (в пиковые окна — вдвое дороже). Совершенно иная ценовая вселенная для дешёвого сегмента моделей с открытыми весами.

Честная формулировка: Sol — это премиальный флагман с премиальной скоростью вывода — самой высокой скоростью вывода среди закрытых флагманов, находящихся ниже Claude Fable 5. Он выигрывает по эффективной стоимости за единицу сложной работы (его токенизатор, его рассуждения, его длинный контекст), а не по абсолютной скорости. Если ваш трафик — это короткие запросы и простые задачи, то $2 Terra, $0.20 Luna или $2/$6 Grok 4.6 — более дешёвый вариант — и по индексу Grok 4.6 на бумаге ни в чём не уступает.

Когда Sol — неверный выбор

Четыре случая, когда эта цена — не та, что вам нужна:

Короткие, простые промпты. При объёме ниже примерно 20K токенов и без глубоких рассуждений флагманский премиум тратится впустую. GPT-5.6 Terra за $2 / $12 или GPT-5.6 Luna за $0,20 / $1,20 справится с массовым уровнем за долю стоимости, а модель уровня Grok 4.6 или DeepSeek стоит ещё меньше.

Большой объём рассуждений. Поскольку мышление тарифицируется как выходные токены, сложный запрос при высоком уровне усилий может стоить значительно выше номинального тарифа на выходные токены. Если ваша нагрузка — множество трудных вызовов, измерьте фактические выходные токены, прежде чем брать на себя обязательства, — реальная ставка может вас удивить.

Цена за токен как единственная цель. Grok 4.6 сравнялся с Sol по индексу при $2 / $6, а DeepSeek V4 Pro стоит $0.44 / $0.88 в непиковое время. Если показатель передового бенчмарка не является жёстким требованием, эти модели обеспечивают гораздо более низкие ставки за токен для того же класса работ.

Строгие лимиты задержки. Sol — это большая модель рассуждений, поэтому время до первого токена значительно выше, чем у модели уровня Flash. Для чата в реальном времени, где важна субсекундная TTFT, быстрый режим за $10 / $60 повышает пропускную способность, а не снижает задержку первого токена — и модель меньшего размера по-прежнему остаётся более дешёвым решением.

Как вызвать это в OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol размещён на OrcaRouter под идентификатором модели openai/gpt-5.6-sol, обслуживается через совместимый с OpenAI эндпоинт по адресу api.orcarouter.ai/v1 по тарифу провайдера с нулевой наценкой. Если у вас уже есть OpenAI-клиент, миграция — это смена базового URL и идентификатора модели, и ничего больше. Тот же ключ и эндпоинт поддерживают 200+ моделей, так что Sol находится рядом с GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 и открытыми моделями, с которыми вы захотите его сравнить, и вы можете маршрутизировать по сложности, а не интегрировать каждую заново.

Две особенности OrcaRouter, которые стоит упомянуть на странице тарифов. BYOK: принесите свой ключ OpenAI, и OpenAI будет выставлять вам счёт напрямую по своим тарифам — OrcaRouter добавляет $0 за токен и сохраняет лимиты и кредиты вашего провайдера. Guardrails: PII Shield и политика контента выполняются до выставления счёта, поэтому заблокированный запрос возвращает чистую ошибку 400 и никогда не тарифицируется, а Agent Firewall оценивает вызовы инструментов и MCP до их выполнения.

Честное примечание, которое важно для страницы с ценами: мы маршрутизируем модель, но не устанавливаем её цену. Цена $5 / $30 — это тариф OpenAI, передаваемый без наценки, и когда OpenAI меняет его, прайс-лист обновляется — именно поэтому на этой странице указана дата. Если вы обращаетесь к OpenAI напрямую, вы получаете ту же ставку; OrcaRouter существует для маршрута с одним ключом и нулевой наценкой, если вам нужна одна конечная точка для всей линейки моделей.

Источники и дата

Все цены, указанные выше, были проверены 2026-08-18. Показатели GPT-5.6 Sol взяты из опубликованного API-прайса OpenAI и перекрёстно сверены со страницей модели GPT-5.6 Sol в OrcaRouter (проверено в тот же день) и с нашими собственными опубликованными страницами цен на GPT-5.6. Тарифы для batch-режима, быстрого режима, кэш-записи и длинного контекста объявлены OpenAI. Показатели Claude, Grok и DeepSeek — это текущие записи в каталоге OrcaRouter, при этом DeepSeek V4 Pro указан по тарифу вне пиковых часов. OpenAI не менял прейскурант Sol с момента запуска 9 июля 2026 года — сокращение 30 июля не затронуло флагманскую модель, — но цены меняются; относитесь к любой найденной вами более ранней странице «GPT-5.6 Sol pricing» с учётом даты её проверки. Приведённые здесь цифры актуальны на сегодняшний день.

Каждая указанная выше цена — это актуальный курс на GPT-5.6 Sol on OrcaRouter — проверено 2026-08-18 с нулевой наценкой, готово для вашего собственного ключа.

Сравнение в этой статье3

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube