
Цены на Claude Opus 5.5: полная тарифная сетка, строка кэша и сколько на самом деле стоит задача
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 177 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1323 tok/s
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
Claude Opus 5.5 предлагается по цене $4,00 за миллион входных токенов и $20,00 за миллион выходных — ровное снижение на 20% с $5,00/$25,00, которыеClaude Opus 5 держал за собой, при этом чтение из кэша подешевело на 60% до $0,20 за миллион. Это опубликованные цены Anthropic, взятые из собственной документации Anthropic по ценообразованию на 24 сентября 2026 года, через два дня после выпуска модели. Ценник — это простая часть. Anthropic также утверждает, что модель стоит «примерно на 40% меньше в эксплуатации» на типичных нагрузках, и этого числа нет в прайс-листе — это характеристика от поставщика, построенная из снижения цены за токен плюс допущения, что модель тратит меньше токенов и меньше шагов на выполнение той же задачи. Эта страница разделяет одно и другое: каждую ставку, которую можно проверить в прайс-листе сегодня, и арифметику, стоящую за той, которую проверить нельзя. Claude Fable 5.1, уровень за $10/$50 над ним, фигурирует повсюду как сравнение, которое проводит сама Anthropic.
Полный прайс-лист, каждая строка в том виде, как её публикует Anthropic
Всё в этом разделе было прочитано из документации Anthropic по ценам на platform.claude.com и claude.com от 24 сентября 2026 г.. Ничего здесь не перенесено из другого текста.
• Ввод — 4,00 $ за миллион токенов (опубликованный тариф Anthropic).
• Вывод — $20.00 за миллион токенов. Токены мышления тарифицируются как токены вывода, а адаптивное мышление Claude Opus 5.5 всегда включено, и его нельзя отключить.
• Чтение из кэша — $0,20 за миллион токенов. Anthropic документирует это как 0,05x базовой цены ввода — отдельная сноска-исключение для этой модели.
• 5-минутная запись в кэш — $5.00 за миллион токенов, стандартный множитель 1,25x к базовому вводу, который Anthropic применяет к каждой модели в таблице.
• Запись в кэш на 1 час — $8,00 за миллион токенов, стандартный множитель 2x к базовой стоимости ввода.
• Batch API — скидка 50 % в обоих направлениях: $2,00 за вход и $10,00 за выход за миллион. Anthropic публикует сниженные цифры напрямую, а не оставляет вам делить их пополам.
• Fast mode — 8,00 $ за вход и 40,00 $ за выход за миллион токенов, ровно вдвое больше стандартного тарифа. В документации Anthropic эта страница называется «Fast mode (research preview)».
• Инференс только в США — множитель 1,1× для входных данных, выходных данных, записей в кэш и чтений из кэша, когда inference_geo: "us" установлен. Глобальная маршрутизация, применяемая по умолчанию, использует стандартные тарифы.
• Контекст и лимит вывода — 1 млн токенов контекста и 128 тыс. токенов синхронного вывода по стандартной цене, без надбавки за длинный контекст. Anthropic заявляет, что запрос на 900 тыс. токенов тарифицируется по той же цене за токен, что и запрос на 9 тыс. токенов. В Batch API лимит вывода повышается до 300 тыс. при использовании output-300k-2026-03-24 бета-заголовка.
Anthropic также утверждает, что множители кэширования «складываются с другими модификаторами ценообразования, такими как скидка Batch API и резидентность данных», — так что для пакетного, кэшированного запроса с привязкой к США все три перемножаются, и арифметика работает по принципу накопления, а не замены.
Вот как читатели двух моделей на самом деле оценивают стоимость на одном и том же листе:
• Claude Opus 5 — $5.00 за ввод, $25.00 за вывод, $0.50 за чтение кэша, $6.25 за запись в кэш на 5 минут, $10.00 за запись на 1 час, $2.50/$12.50 в Batch (опубликованные тарифы Anthropic, проверено 2026-09-24).
• Claude Fable 5.1 — $10.00 за ввод, $50.00 за вывод, $0.25 за чтение из кэша, $12.50 за запись в кэш на 5 минут, $20.00 за запись на 1 час, $5.00/$25.00 в Batch (опубликованные тарифы Anthropic, актуально на 2026-09-24).

Именно кэш-линия фактически определяет счёт агента.
Освещение запуска рассматривает чтение из кэша как сноску. Это самый мощный отдельный рычаг в таблице для любой рабочей нагрузки, которая повторно отправляет большой префикс, — а это большинство нагрузок в сфере программирования и агентных нагрузок.
Собственная сноска Anthropic на удивление прямо говорит о коэффициентах: попадания в кэш и его обновления стоят 0,1x от базовой цены ввода на большинстве моделей Claude, 0,025x на Claude Fable 5.1 и 0,05x на Claude Opus 5.5. Так что коэффициент кэша у Claude Opus 5.5 вдвое хуже стандартного и вдвое хуже, чем у Claude Fable 5.1.
В долларах он всё равно выигрывает, и именно это стоит усвоить: лучший множитель не побеждает в долларах, когда базовая ставка в два с половиной раза выше.
• Claude Fable 5.1 — 2,5% от базовой суммы $10.00 составляют $0.25 за миллион кэшированных токенов.
• Claude Opus 5.5 — 5 % от базовой цены $4,00 составляют $0,20 за миллион кэшированных токенов.
• Claude Opus 5 — 10% от базовой цены $5.00 составляет $0.50 за миллион кэшированных токенов.
Та же инверсия сохраняется и при записи. Claude Fable 5.1 взимает $12.50 за запись миллиона токенов в 5-минутный кэш и $20.00 за 1-часовое окно; Claude Opus 5.5 взимает $5.00 и $8.00. Чтение из кэша — единственный пункт, где Claude Opus 5.5 превосходит обоих собратьев по абсолютным долларам, несмотря на средний коэффициент.
Два правила решают, стоит ли вообще платить за запись. В документации Anthropic сказано, что 5-минутная запись стоит 1,25× базовой стоимости входных данных и потому окупается уже после одного чтения из кэша, тогда как 1-часовая запись стоит 2× базовой стоимости входных данных и требует двух чтений, чтобы окупиться. А кэш привязан к префиксу, который его создал: Anthropic отмечает, что переключение между быстрой и стандартной скоростью аннулирует кэш, поскольку запросы на разной скорости не используют общие кэшированные префиксы. Смена модели, уровня усилий или определений инструментов даёт тот же эффект. Более дешёвая модель, которая вынуждает перезаписывать префикс при каждом переключении, может обойтись дороже, чем заменённая ею дорогая.
Во сколько на самом деле обходится длинный цикл агента
Возьмите coding-агента с 40 ходами, который на каждом ходу повторно отправляет префикс из 120 000 токенов — системный промпт, схемы инструментов, дерево файлов, — добавляет по 1 000 новых входных токенов на каждом ходу из результатов работы инструментов и выдаёт 800 выходных токенов на каждом ходу. Смысл здесь в подстановке: замените любое из этих четырёх чисел на соответствующие вашему трафику, и приведённая ниже арифметика всё равно останется верной.
О Claude Opus 5.5:
• Запись в кэш, однократно — 120 000 токенов по $5.00 за миллион = $0.60
• Чтения из кэша, 39 ходов — 4,680,000 токенов по $0.20 за миллион = $0.94
• Новый ввод, 40 ходов — 40 000 токенов по $4,00 за миллион = $0,16
• Вывод, 40 ходов — 32 000 токенов по $20,00 за миллион = $0,64
• Итого за сессию — $2.34, при этом на чтения из кэша приходится около 40%.
На Claude Opus 5, при одинаковом количестве токенов: $0,75 на запись в кэш, $2,34 на чтение из кэша, $0,20 на новый ввод и $0,80 на вывод — $4,09.
На Claude Fable 5.1 при одинаковом количестве токенов: $1.50 на запись в кеш, $1.17 на чтение из кеша, $0.40 на новый ввод и $1.60 на вывод — $4.67.
Те же токены, те же ходы, никаких заявлений об эффективности не требуется: Claude Opus 5.5 оказывается на 43% дешевле Claude Opus 5 и на 50% дешевле Claude Fable 5.1. И $1,40 из разницы в $1,75 с Claude Opus 5 — восемьдесят процентов экономии — приходится на одну лишь строку чтения из кэша, а не на заявленную ставку за входные данные.
Теперь запустим противоположный сценарий: однократный вызов с 20 000 входных токенов и 8 000 выходных, без кэширования. Claude Opus 5.5 стоит $0,08 за входные данные плюс $0,16 за выходные — $0,24. Claude Opus 5 стоит $0,10 плюс $0,20 — $0,30. Это ровно 20-процентное снижение заявленной цены, и ни на процентный пункт больше.
Итак, сама по себе тарифная сетка даёт где-то от 20% до 43% в зависимости от того, какая доля вашего счёта приходится на чтения из кэша. Любое утверждение выше этого диапазона исходит из подсчёта токенов, а не из цен.
Откуда у Anthropic взялось «примерно на 40% дешевле в эксплуатации»
В материалах о запуске Anthropic говорится, что Claude Opus 5.5 «требует меньше вычислений для обслуживания, чем Opus 5», и что его тесты показывают, что он «будет стоить на 40% меньше, чем Opus 5, на типичных рабочих нагрузках» при настройках по умолчанию. Декомпозиция, которую приводит Anthropic, такова: модель «стоит меньше за токен, чем Opus 5, и использует меньше токенов на задачу, что в итоге даёт снижение затрат на 40%».
Называйте это тем, чем оно является: описание среднего по нагрузкам, выбранным самой Anthropic, сделанное вендором, а не результат, проверенный аудитом, и не тариф, опубликованный в прайс-листе. Проверяемая половина — это первая половина: скидка 20% на входные и выходные данные, 60% на чтение из кэша, и то и другое можно увидеть в прайс-листе уже сегодня. Вторая половина зависит от того, станет ли модель тратить меньше токенов и меньше шагов на вашу нагрузку, а это можно проверить, только запустив её.
Доказательства, которые Anthropic приводит для части с токенами, — это набор заявлений клиентов на момент запуска. Все нижеперечисленное опубликовано вендором и описывает рабочие нагрузки, которые выбрали вендор и его клиенты:
• Box — модель «израсходовала треть токенов по сравнению с Opus 5», а её ответы «на 40% менее многословны без потери точности».
• Kiro — он «решил больше задач, чем Opus 5, сделав примерно на 40% меньше вызовов и потратив вдвое меньше токенов».
• Factory — «не уступал Opus 5 при высоком уровне усилий, расходуя при этом на 20–25% меньше выходных токенов».
• GitHub — он «потратил одно из наименьших количеств токенов и шагов среди всех, что мы измеряли», а в VS Code «решил больше терминальных задач, чем Opus 5, менее чем за половину шагов».
• Анализ слияния, один разобранный пример — две вымышленные компании по разработке HR-софта, каждая модель строит модель в Excel и презентацию для руководства. Anthropic сообщает, что Claude Opus 5.5 справился за 63 минуты против 93 у Claude Opus 5 и «обошёлся на 50% дешевле». По данным вендора, n=1.
Независимый противовес здесь важен, потому что он указывает в другую сторону. Artificial Analysis измерила Claude Opus 5.5 при максимальных усилиях с примерно 119 000 выходных токенов на задачу Intelligence Index, против примерно 73 000 для Claude Opus 5 при максимальных усилиях — количество токенов растёт, а не падает. В своём резюме по этой конфигурации она указывает, что Claude Opus 5.5 «на одном уровне с Opus 5 по стоимости за задачу, несмотря на 1,6-кратное увеличение выходных токенов», при опубликованной стоимости $5,98 за задачу Intelligence Index. Это независимое измерение при максимальных усилиях, и оно не противоречит заявлению Anthropic — это другой конец шкалы усилий.
Что подводит нас к оговорке, которая управляет каждым числом в этом разделе. Antropic заявляет, что, если не указано иное, все её результаты для Claude Opus 5.5 используют адаптивное мышление на максимальном уровне усилий. По умолчанию Claude Opus 5.5 использует средний уровень усилий; Claude Opus 5 по умолчанию использовал высокий уровень усилий, и уровень с одним и тем же названием не означает один и тот же бюджет мышления у двух моделей. Так что таблица от вендора, полученная при максимальном уровне усилий, и независимая таблица, полученная при максимальном уровне усилий с включённым резервным переходом к настройкам по умолчанию, — это не одна и та же конфигурация, и настройка по умолчанию — тоже не та, которую реально развернул бы читатель. Усреднённые 40%, измеренные на выбранном наборе рабочих нагрузок, при настройках, которые вы, возможно, не используете, — это отправная гипотеза, а не строка бюджета.
Режим Fast — это исследовательский предпросмотр, а не уровень.
Быстрый режим в Claude Opus 5.5 — это $8.00 за миллион входных токенов и $40.00 за миллион выходных — ровно вдвое дороже стандартного тарифа — в обмен на до 2,5 раза больше выходных токенов в секунду. Он не улучшает время до первого токена; выигрыш — в скорости вывода, и он наиболее заметен при потоковой передаче.
Скажите остальное прямо, потому что это легко заложить в бюджет как тарифный уровень, хотя это не тарифный уровень. Anthropic называет fast mode исследовательским предпросмотром. Доступ запрашивается через аккаунт-менеджера или лист ожидания. Для этого требуются fast-mode-2026-02-01 бета-заголовок и speed: "fast" в запросе. Он доступен только в Claude API — не в Amazon Bedrock, Google Cloud, Microsoft Foundry или Claude Platform on AWS. Его нельзя комбинировать с Batch API или с обязательством Priority Tier. Он суммируется с prompt caching и множителями data-residency, поэтому закреплённый за США кэшированный запрос в fast mode платит 1.1x поверх 2x. А переключение рабочей нагрузки между fast и standard speed аннулирует кэш промптов, что в длинном цикле агента может стоить больше, чем экономит скорость.
Claude Opus 5 и Claude Opus 4.8 также поддерживают быстрый режим — $10.00/$50.00. Claude Opus 4.7 попросту отклоняет этот параметр.
Единица, определяющая счёт, — это стоимость за завершённую задачу.
Каждый из приведённых выше тарифов — это цена за токен. Никто не покупает токены. Цена за токен становится затратами только тогда, когда она умножается на количество токенов, которое потребляет задача, и на число попыток, необходимых для её завершения.
Посчитайте на примере с малым кешем, приведённом ранее. При $0,24 за проход модель, которая выполняет задачу с первой попытки, стоит $0,24. Та же задача у конкурента при $0,30 за проход стоит $0,30 — так что более дешёвая модель выглядит на 20% выгоднее. Теперь пусть более дешёвой модели требуется 1,2 прохода на завершённую задачу, что является щедрой оценкой успешности для агентной работы: 1,2 × $0,24 — это $0,288 против $0,30 для однопроходной альтернативы. Экономия исчезает. При трёх проходах это $0,72, а модель, которая выглядела на 20% дешевле за токен, оказывается на 140% дороже за завершённую задачу.
Именно поэтому собственные заявления Anthropic об эффективности — меньше токенов, меньше вызовов, меньше шагов — сформулированы в правильной единице измерения. Именно поэтому ни одно из них не следует закладывать в бюджет, пока вы не воспроизвели их. Проверка чисто механическая: цена за проход, умноженная на количество проходов на завершённую задачу, измеренная на вашем собственном трафике. Оба числа должны получить вы сами, и ни один поставщик не публикует второе из них для вашей рабочей нагрузки.
Если вам нужна единственная точка отсчёта от независимого источника, Artificial Analysis оценивает Claude Opus 5.5 в $5,98 за задачу Intelligence Index в конфигурации с максимальным уровнем усилий — независимый показатель при настройке, которую большинство продакшн-нагрузок использовать не будет, полезный скорее как верхняя граница, чем как прогноз.

Линии, не входящие в основной тариф
• Резидентность.Инференс только в США — 1,1x по каждой категории токенов, включая чтение и запись кэша. Он суммируется с быстрым режимом и со скидкой Batch.
• Определения инструментов. Anthropic публикует данные о накладных расходах системного промпта на использование инструментов для каждой модели: объявление инструментов добавляет 286 токенов к каждому запросу Claude Opus 5.5. Мелочь при $4,00 за миллион, но платить приходится за каждый запрос, а агентный цикл делает их немало.
• Инвалидация кэша. Префикс, перезаписанный после изменения модели, уровня усилий, определения инструмента или скорости, тарифицируется по ставке записи — $5.00 или $8.00 за миллион в Claude Opus 5.5 — а не по ставке чтения $0.20.
• Модель, указанная ниже. Claude Sonnet 5 стоит $2.00 за вход и $10.00 за выход за миллион, и, как подтверждает сноска о ценах Anthropic, теперь это стандартная цена, а не вводная ставка, как было объявлено при анонсе. Claude Opus 5.5 ровно в 2 раза дороже Sonnet 5 в обоих направлениях.

Вызов Claude Opus 5.5 по прейскурантной цене Anthropic
Claude Opus 5.5 доступен на OrcaRouter по цене anthropic/claude-opus-5.5 — $4.00 за вход и $20.00 за выход за миллион: это собственная прайс-листовая цена Anthropic, передаваемая с наценкой 0%. Об этой сквозной передаче стоит сказать точно на странице цен: поскольку ставка провайдера перенаправляется, а не кэшируется в таблице, изменение ставки вендора действует здесь в тот же день, когда оно публикуется, а не после окна синхронизации. Если Anthropic изменит этот лист, цена, на которую вы ориентируетесь, изменится вместе с ним.
Тот же ключ даёт доступ к тарифам, с которыми эта страница его сравнивает — anthropic/claude-opus-5 по цене $5.00/$25.00 и anthropic/claude-fable-5.1 по цене $10.00/$50.00 — а также к остальной линейке Claude и ещё более 200 другим моделям, так что проверить, выдерживает ли более низкая цена за токен столкновение с вашим собственным числом проходов, можно без второго контракта и без изменений в коде. Автоматическое переключение при сбое предусмотрено для случая, когда вы хотите запустить незнакомую модель на продакшн-пути, не ставя на карту сам этот путь.
Ответ в двух строках о том, чему посвящена эта страница: тарифная сетка — $4.00 за вход, $20.00 за выход и $0.20 за миллион кэшированных чтений, а 20%-ная скидка реальна и проверяема уже сегодня. 40% — это среднее значение Anthropic по выбранным ею рабочим нагрузкам. Прогоните через это один из ваших собственных агентных циклов, прежде чем закладывать бюджет исходя из второго числа.
Сравнение в этой статье3
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
