Титульная карточка для руководства по API Claude Opus 5.5 с надписью «ID модели, четыре ломающих изменения и незаметное пятое», со строкой характеристик, где указаны ID модели claude-opus-5-5, контекстное окно 1M, вывод 128K и $4 / $20 за 1M токенов.
Engineering & Research

Руководство по API Claude Opus 5.5: идентификатор модели, четыре несовместимых изменения и тихий пятый

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Измените строку модели с claude-opus-5 на claude-opus-5-5 — и ваш код по-прежнему компилируется, по-прежнему проходит проверку типов и по-прежнему проходит всё, что у вас считается тестовым набором. А затем в продакшене он отдаёт 400. Четыре варианта запросов, которые Claude Opus 5 принимал, получают прямой отказ от Claude Opus 5.5, а пятое изменение вообще ничего не ломает — именно поэтому именно оно доберётся до ваших пользователей. Это справочник по интеграции для модели: идентификатор, поверхности, которые её обслуживают, контракт запросов, четыре ошибки, незаметное пятое и то, как теперь работает параметр effort. Там, где поведение совпадает с Claude Fable 5.1, команда, которая уже перешла на неё, выполнила часть работы, поэтому для каждого изменения ниже указано, применимо ли оно также к этой модели.

Всё здесь взято из собственной документации Anthropic по Claude от 24.09.2026 — через два дня после выпуска модели. Заявления вендора помечены как заявления вендора, независимые данные — как независимые, и те и другие никогда не приводятся при одной и той же настройке усилий так, будто их можно сравнивать.

Идентификатор модели и где она обслуживается

Идентификатор — claude-opus-5-5 — фиксированный идентификатор модели без суффикса с датой, та же схема, что и у claude-opus-5. Отдельной формы закреплённого снимка, которую можно было бы использовать, не существует, как и псевдонима, разрешающегося во что-то другое.

В обзоре моделей Anthropic перечислены пять поверхностей со следующими точными строками:

• Claude API — claude-opus-5-5, доступен всем клиентам.

• Amazon Bedrock — anthropic.claude-opus-5-5 (единственная поверхность, где имя поставщика используется в качестве префикса).

• Claude Platform в AWS — claude-opus-5-5, используются идентификаторы Claude API, а не идентификаторы в стиле Bedrock.

Google Cloud — claude-opus-5-5.

• Microsoft Foundry — claude-opus-5-5; именно имя развёртывания вы и отправляете, а Foundry следует графику жизненного цикла Claude API.

Две из этих пяти важнее, чем остальная часть этого раздела. Amazon Bedrock и Google Cloud устанавливают собственные даты жизненного цикла и вывода из эксплуатации, и — как показывают приведённые ниже критические изменения — Bedrock также является единственной платформой, где старый инструмент computer-use всё ещё работает. Если вы используете Bedrock, вы проходите не ту же миграцию, что и все остальные.

Чему теперь должен соответствовать каждый запрос

В руководстве Anthropic по миграции этот контракт представлен в виде списка, и список достаточно короткий, чтобы вы могли сверить с ним собственный клиент. С какой бы модели вы ни переходили, запрос к claude-opus-5-5 должен:

• Отправьте либо без поля thinking, либо thinking: {"type": "adaptive"} — эти два варианта эквивалентны, поскольку адаптивное мышление всегда включено.

• Управляйте глубиной мышления с помощью effort — единственного параметра запроса, который на это влияет; поддерживаются все пять уровней, по умолчанию используется средний.

• Используйте tool_choice со значением {"type": "auto"} (по умолчанию) или {"type": "none"}. Принудительный выбор инструмента отклоняется.

• Не указывайте temperature, top_p и top_k или оставьте их значения по умолчанию. Любое другое значение отклоняется — как на этой модели, так и на всех начиная с Claude Opus 4.7.

• Не завершайте сообщения предзаполненной репликой ассистента; это уже было отклонено в Opus 4.6 и более поздних версиях.

• Объявите использование компьютера как computer_toolset_20260801 — набор инструментов в Claude API и Google Cloud.

• Не отправляйте бета-заголовок контекстного окна. Контекстное окно в 1M используется по умолчанию, а заголовок, написанный для более старой модели, не оказывает эффекта.

Если в руководстве сказано, что настройка отклоняется, API возвращает HTTP 400. Это и есть весь режим отказа при переходе на эту модель: не ухудшенный вывод, не предупреждение в журнале — запрос, который никогда не выполняется.

Anthropic's Migrating to Claude Opus 5.5 documentation page, showing the 'What every request to Claude Opus 5.5 must satisfy' list: the claude-opus-5-5 model id with no date suffix, thinking adaptive-only, the effort parameter with five levels low through max defaulting to medium, tool_choice auto or none, sampling parameters at their defaults, no prefilled assistant turn, the computer_toolset_20260801 toolset on the Claude API and Google Cloud, and a 1M-token context window requiring no beta header.

Четыре критических изменения

1. Мышление невозможно отключить

Адаптивное мышление всегда включено. thinking: {"type": "disabled"} возвращает ошибку 400, и бюджет, заданный вручную, тоже — thinking: {"type": "enabled", "budget_tokens": N}. В тексте ошибки указывается тип, который вы отправили, а затем — замена:

• Параметр "thinking.type.disabled" не поддерживается для этой модели. Используйте "thinking.type.adaptive" и "output_config.effort" для управления поведением мышления.

• "thinking.type.enabled" не поддерживается для этой модели. Используйте "thinking.type.adaptive" и "output_config.effort" для управления поведением режима обдумывания.

Практическое следствие — не сама ошибка, а то, что происходит после её исправления. В Claude Opus 4.8 и более ранних версиях запрос без поля thinking выполнялся без размышлений. В Claude Opus 5.5 каждый запрос размышляет, и max_tokens остаётся жёстким лимитом, покрывающим размышления плюс текст ответа. Токены размышлений тарифицируются как выходные токены, даже если текст размышлений никогда не возвращается вам. Поэтому эндпоинт, который раньше работал без размышлений, после «исправления» может выдавать больше выходных токенов на запрос, чем раньше. Руководство Anthropic рекомендует снижать effort там, где вы раньше отключали размышления, и — при xhigh или max effort — начинать с max_tokens = 64k и настраивать дальше.

Форма ответа тоже меняется. Ответ может начинаться с одного или нескольких блоков размышлений перед первым текстовым блоком, поэтому код, который читает ответ по позиции — content[0].text, или обработчик потока, который считает первый content_block_start текстом — ломается на таких ответах, даже когда запрос успешно выполнен. Выбирайте блоки по их полю type вместо этого.

2. Принудительное использование инструментов возвращает ошибку

tool_choice типы any и tool возвращают 400, и та же валидация применяется к эндпоинту подсчёта токенов, поэтому предварительный подсчёт завершается так же, как и реальный вызов:

• tool_choice: типы "tool" и "any" не поддерживаются для этой модели.

Значения auto и none не затронуты. Документированная замена — сохранить tool_choice: {"type": "auto"}, помечать инструменты с помощью strict: true для аргументов, валидных по схеме, или перенести схему в Structured Outputs — и указывать в промпте, когда инструмент применим, поскольку auto не гарантирует вызов. Строгое использование инструментов принимает подмножество JSON Schema: каждый объект в input_schema инструмента должен задавать additionalProperties: false, поэтому проверяйте каждую схему, прежде чем включать этот флаг. И обратите внимание на пробел, который это оставляет: если ваш код зависел от принудительного вызова, а не просто разрешения его, auto восстанавливает разрешение, но не гарантию. Проверьте, что блок tool_use действительно вернулся.

3. Блоки размышлений привязаны к модели и к беседе

Каждый блок размышлений записывает, какая модель его создала, и каждая модель читает свои собственные блоки, а также определённый набор чужих. Правила действуют в обоих направлениях:

• Claude Opus 5.5 читает блоки размышлений из Claude Opus 5 и более ранних моделей Opus, Sonnet и Haiku — но не из моделей Claude Fable или Claude Mythos.

• В Claude API блоки Claude Opus 5.5 читают Claude Fable 5.1 и Claude Mythos 5.1. Никакая другая модель этого не делает.

• Если разговор переходит с Claude Opus 5.5 на что-либо, кроме этих двух, его последующие ходы выполняются без предыдущих рассуждений.

Маршрутизатор или механизм переключения, переносящий диалог, — очевидный способ добиться этого. Более тонкая половина заключается в том, что блок также привязан к префиксу диалога — системному промпту, инструментам и каждому сообщению перед ним. Anthropic по умолчанию проверяет префикс для аккаунтов, созданных 2026-08-31 00:00 UTC или позднее, в Claude API и на облачных платформах: если воспроизвести блок после изменения системного промпта, списка инструментов или более раннего сообщения, запрос вернёт 400. Существует два пути обхода. Отправьте бета-заголовок thinking-binding-controls-2026-08-01 и установите thinking.block_binding.prefix_mismatch_behavior в значение "drop_block", чтобы отбросить затронутые блоки вместо отказа запроса. Или же ведите диалог только в режиме добавления и меняйте инструкции с помощью системного сообщения в середине диалога, а не редактирования, — именно так уже делают Claude Code, claude.ai, Claude Managed Agents и Claude Agent SDK.

Есть одна хорошая новость, которую легко упустить: когда запрос содержит блок, который целевая модель не может прочитать, API отбрасывает его до того, как модель его увидит. Запрос выполняется успешно, и за отброшенные блоки плата не взимается.

4. Более старый инструмент computer-use отклоняется в Claude API и Google Cloud

Элемент tools типа computer_20251124 возвращает ошибку 400 в Claude API и Google Cloud. В сообщении указывается отклонённый тип, а затем перечисляются типы, которые модель принимает:

• 'claude-opus-5-5' не поддерживает следующие типы инструментов: computer_20251124.

Замена — это computer_toolset_20260801 набор инструментов: уберите computer-use-2025-11-24 бета-заголовок и отправляйте запись инструментов без имени и без размеров отображения. Это не только изменение запроса — вместе с ним меняется и цикл агента. Действия приходят в виде блоков tool_use в составе сообщения, а не единого инструмента computer, в одном ходе их может быть несколько, действием служит name блока, а не input.action, и каждый результат должен возвращать toolset_name обратно. В Amazon Bedrock computer_20251124 продолжает работать точно так же, как на Claude Opus 5, и никаких изменений не требуется.

Какие из четырёх также применимы к Claude Fable 5.1?

Anthropic утверждает, что первые три действуют и в Claude Fable 5.1 — постоянно включённое мышление, отсутствие принудительного выбора инструмента и блоки мышления, привязанные к модели и диалогу. А вот изменение, связанное с computer use, — нет: оно специфично для этой модели в Claude API и Google Cloud. Так что команда, уже перешедшая на Claude Fable 5.1, отказалась от кодовых путей с отключённым мышлением и от принудительного выбора инструментов, а её диалог строится по принципу «только добавление»; остаются лишь идентификатор модели и набор инструментов computer use. Команда, приходящая с Claude Opus 5, сталкивается со всеми четырьмя сразу. Именно эту миграцию стоит запланировать, и объём работы зависит от того, с чего вы начинаете.

Пятое изменение: ничто не выдаёт ошибок, и ваша лента прогресса затихает.

В Claude Opus 5 короткие заметки, которые модель пишет между вызовами инструментов, возвращаются как обычные текстовые блоки. В Claude Opus 5.5 — как и в Claude Fable 5.1 — этот текст возвращается в виде блоков размышлений с обновлением прогресса, не более одного перед каждым вызовом инструмента. А thinking.display по умолчанию имеет значение "omitted", поэтому эти блоки приходят с пустым полем thinking вместе с их сигнатурой.

Ни один запрос не завершается ошибкой. Ни одна ошибка не записывается в журнал. Приложение, которое в качестве индикатора прогресса передаёт своим пользователям поток текста между инструментами, просто перестаёт отображать прогресс между вызовами инструментов и начинает отображать пустоту. Видимый симптом — интерфейс, который кажется зависшим именно на том участке работы, где пользователю больше всего нужно подтверждение, что всё в порядке, и о нём сообщат как о проблеме производительности, проблеме сети или зависании — а не как об ошибке миграции. Именно это изменение и уходит в продакшен.

Исправление — это настройка отображения плюс соответствующее ей чтение:

• Установите thinking.display в "updates" — бета-версия, за заголовком thinking-display-updates-2026-08-18 — чтобы вернуть обновления о ходе выполнения, при этом сами рассуждения остаются скрытыми. Это параметр, который нужен ленте прогресса.

• Или установите значение "суммированный", чтобы получать обновления о ходе выполнения и сводки рассуждений, смешанные вместе в одних и тех же блоках.

• Затем читайте текст из блоков размышлений, а не из текстовых блоков, отображайте каждый непустой блок размышлений перед блоком tool_use, которому он предшествует, и возвращайте блоки без изменений вместе с остальной частью хода ассистента.

Собственное замечание Anthropic по этому поводу стоит процитировать по духу: от интерфейса, который отображает текст между вызовами инструментов, ожидается установка значения отображения, а не использование значения по умолчанию. Если ваша интеграция сегодня полностью игнорирует блоки размышлений, это единственное место, где значение по умолчанию безопасно.

A single-column scoreboard titled 'Claude Opus 5.5 — the migration at a glance' listing six rows: thinking always on and cannot be disabled; forced tool use returning a 400 error; thinking blocks bound to the model and the conversation; the old computer tool rejected on the Claude API and Google Cloud; progress text hidden by default; and the fix of setting thinking.display to summarized. Footer reads: per Anthropic's Claude Opus 5.5 migration guide, read 2026-09-24; vendor-reported.

Усилие — это поверхность API.

Поскольку мышление отключить невозможно, output_config.effortстановится единственной ручкой, регулирующей, сколько модель рассуждает, а значит, и единственной ручкой, определяющей стоимость и задержку при решении конкретной задачи. Прежде чем переносить эту настройку из старой модели, стоит знать о ней четыре вещи.

Значение по умолчанию изменилось. Claude Opus 5.5 по умолчанию использует средний уровень усилий, тогда как Claude Opus 5 и более ранние модели Opus по умолчанию использовали высокий. Запрос, в котором уровень усилий не указан, теперь выполняется на один уровень ниже, чем до этого изменения. Anthropic также отмечает, что модель склонна обдумывать больше за ход при заданном уровне усилий, чем Claude Opus 5, особенно при xhigh и max. Эти два эффекта действуют в противоположных направлениях, и именно поэтому инструкция поставщика — провести новый перебор уровней усилий на собственных оценках, а не переносить настройку напрямую.

Шкала — это low / medium / high / xhigh / max, все пять поддерживаются здесь. Названный уровень изначально не является фиксированным бюджетом токенов — Anthropic описывает усилие как поведенческий сигнал, а не строгий бюджет — и распределение токенов, стоящее за каждым уровнем, менялось от модели к модели, поэтому «high» в Claude Opus 5.5 — это не «high» в Claude Opus 5. Установка усилия на значение по умолчанию для модели равносильна его пропуску.

Две операционные детали, потому что обе стоят денег, если их упустить. Во-первых, изменение значения effort верхнего уровня между запросами аннулирует кеш промптов: выберите уровень и держите его постоянным в рамках диалога, который полагается на попадания в кеш, а варьируйте его между рабочими нагрузками. Во-вторых, эта модель поддерживает effort для каждого сообщения (бета-заголовок mid-conversation-output-config-2026-07-01), что позволяет менять уровень начиная с более позднего хода без перезапуска кеша. Минимальный размер промпта для кеширования здесь — 512 токенов, что меньше 1 024 в предыдущем поколении, поэтому промпты, которые раньше были слишком короткими для кеширования, теперь могут создавать записи без изменения кода.

Ограничения вывода: 128K синхронно, 300K в Batch

Синхронный Messages API ограничивает объём вывода на уровне 128K токенов. API Message Batches доходит до 300K токенов вывода при использовании output-300k-2026-03-24 бета-заголовка — именно этой строки. Входные данные по умолчанию используют полное контекстное окно на 1M токенов, заголовок не требуется.

Практическое прочтение: потолок в 128K не изменился по сравнению с Claude Opus 5, так что только из-за этой оси ничего в синхронной интеграции не требует пересмотра бюджета. А что действительно требует пересмотра бюджета — это мышление внутри неё. Поскольку теперь max_tokens покрывает мышление плюс текст при каждом запросе, значение, которое было впритык для текста ответа в Claude Opus 5, здесь становится теснее — а при уровне усилий xhigh или max производитель советует начинать с 64k и подстраивать. Если долго выполняющаяся задача рассчитывалась исходя из синхронного потолка в 128K, а теперь обрезается, то сдвинулся не потолок.

Маршрутизация Safeguard является частью спецификации.

Это факт об интеграции, а не сноска о политике: в некоторых промптах строка модели, которую вы отправляете, не описывает то, что ответило.

Claude Opus 5.5 поставляется с классификаторами безопасности, и отклонённый запрос возвращается как HTTP 200 с stop_reason: "refusal" и stop_details — объектом, указывающим область политики. Эта модель охватывает больше категорий, чем Claude Opus 5, — ожидайте bio, frontier_llm и reasoning_extraction наряду с привычным cyber. Отказ reasoning_extraction блокируется сразу, а не повторяется: серверный резервный механизм Anthropic не повторяет его, и отказ возвращается вам.

Для категорий, в которых предусмотрены повторные попытки, механизм — это параметр. Установите fallbacks в значение "default" при использовании server-side-fallback-2026-07-01 бета-заголовка, и API повторно выполняет отклонённый запрос на модели, которую Anthropic рекомендует для этой категории, в рамках одного вызова, возвращая один ответ. Справочный центр Anthropic прямо указывает маршрутизацию для этой модели: запросы по кибербезопасности, помеченные флагом, переключаются на Claude Opus 4.8, а её классификаторы биологии — набор в стиле Fable-5 — вызывают переключение на Claude Opus 5 для работ в области наук о жизни двойного назначения. Небольшой набор возможностей разработки передовых LLM также направляется в Claude Opus 5. Anthropic также отмечает, что проверки анализируют всё, что читает модель, а не только ваше последнее сообщение, поэтому память, содержимое коннекторов, результаты поиска и файлы могут вызвать переключение.

Из этого для вашей интеграции следуют три вещи. Читайте поле верхнего уровня model в каждом ответе, поскольку оно указывает модель, которая фактически создала сообщение, а fallback блок содержимого отмечает каждую точку передачи. Проверяйте собственные ограничения скорости fallback, потому что при превышении лимита fallback не используется, и вместо него возвращается отказ — при нагрузке fallback деградируют до отказов. И рассматривайте любой опубликованный запуск бенчмарка с включёнными защитными механизмами как измерение маршрутизированной системы, а не одного Claude Opus 5.5, — именно это Anthropic говорит о своих собственных цифрах ниже.

Серверный fallback — это бета-функция и только для Claude API: она не поддерживается в Message Batches API и недоступна в Amazon Bedrock, Google Cloud и Microsoft Foundry, где вместо этого документированным путём является middleware SDK. Что касается верификации, маршруты доступа существуют для обеих категорий — программы Cyber Verification Program и Life Sciences Verification Program — но обратите внимание на асимметрию, которую справочный центр Anthropic документирует на момент написания: Claude Opus 5.5 в настоящее время не указан в Cyber Verification Program, тогда как программа для наук о жизни описывается как предоставляющая верифицированным организациям доступ к самым способным моделям.

Контекст, отсечка, вывод из эксплуатации и Быстрый режим

Остальная часть конверта, со страницы модели и таблицы устареваний:

• Окно контекста — 1 млн токенов, по умолчанию, без бета-заголовка.

• Граница знаний — июнь 2026 года, что также является границей данных обучения.

• Вывод из эксплуатации — не ранее 2027-09-22 на платформах, управляемых Anthropic, с уведомлением не менее чем за 60 дней. Amazon Bedrock и Google Cloud устанавливают свои собственные даты. Claude Opus 5 остаётся активной как минимум до 2027-07-24, поэтому принудительного перехода не будет.

• Тарифы — $4.00 за миллион входных токенов, $20.00 за миллион выходных токенов, $5.00 за миллион записей в кэш на 5 минут, $8.00 за миллион записей в кэш на 1 час, $0.20 за миллион чтений из кэша. Пакетный режим — полцены в обоих направлениях: $2.00 / $10.00.

• Чтения из кэша — это исключение, заслуживающее внимания: $0,20 составляет 5% от базового ввода, тогда как у большинства моделей Claude этот показатель равен 10%, а у Claude Fable 5.1 — 2,5%. В смешанных рабочих нагрузках с интенсивным повторным использованием кэша это ощущается как реальная скидка.

• Fast mode — по-прежнему задокументирован как исследовательский предпросмотр, только в Claude API, тарифицируется отдельно: $8,00 за вход / $40,00 за выход за миллион. Включается с помощью speed: "fast" и fast-mode-2026-02-01 бета-заголовка. Он недоступен в Bedrock, Claude Platform on AWS, Google Cloud или Microsoft Foundry, а также не поддерживается в Batch API и при обязательстве Priority Tier. Обратите внимание, что Claude Opus 5.5 вообще не поддерживает Priority Tier.

Что говорят бенчмарки и при какой настройке

Настройки усилий — вот почему таблицу поставщика и независимую таблицу нельзя сравнивать построчно и почему каждое число ниже приводится вместе со своей настройкой.

Данные от производителя, собственный тестовый стенд Anthropic. В заметке Anthropic о запуске указано, что, если не отмечено иное, все результаты Claude Opus 5.5 получены с адаптивным мышлением при максимальном уровне усилий; исключение — Terminal-Bench 4.0, результаты которого приведены при xhigh для Claude Opus 5.5 и при high для GPT-6 Astra, поскольку это наивысшие показатели каждой из моделей. На этом основании производитель сообщает следующие результаты: Terminal-Bench 4.0 — 66,4%, FrontierCode v1.1 Main — 54,4%, CursorBench 4.0 — 57,8%, GDPval-AA v2.1 — 1 846 Elo, AutomationBench — 40,0%, Humanity's Last Exam с инструментами — 67,7%, Terminal-Bench-Science 0.1 — 58,7%, OSWorld 2.0 — 81,8% (частично) и Chartography с инструментами — 89,0%. При среднем уровне усилий по умолчанию для модели производитель указывает FrontierCode — 54,6% и CursorBench — 52,5%. Обратите внимание, что в той же заметке раскрывается следующее: оценка проводилась при включённых производственных механизмах защиты, и когда они срабатывали, задачи по кибербезопасности выполняла Claude Opus 4.8, а задачи по биологии и разработке передовых LLM — Claude Opus 5; по словам Anthropic, это, вероятно, снижает производительность Claude Opus 5.5 на этих бенчмарках. Таким образом, опубликованные результаты по затронутым оценкам не являются чистыми измерениями этой модели.

Независимо, Artificial Analysis. В Intelligence Index v4.3.2 Claude Opus 5.5 набирает 58 в конфигурации, которую Artificial Analysis обозначает как «Adaptive Reasoning, Max Effort, Default Fallback», — это его наивысший измеренный результат, на несколько пунктов выше остальных, и он лидирует в шести из десяти входящих в индекс оценок. На том же индексе и том же стенде Claude Fable 5.1 набирает 53, а Claude Opus 5 — 51. Artificial Analysis публикует полную лестницу усилий, и это здесь самый полезный независимый артефакт: max — 58, xhigh — 56, high — 54, medium — 51, low — 42. Согласно его собственным измерениям, Claude Opus 5.5 расходует примерно 119 000 выходных токенов на задачу индекса при максимальных усилиях, против примерно 73 000 у Claude Opus 5, 78 000 у Claude Fable 5.1 и 27 000 у GPT-6 Astra — токенов, которые тарифицируются как выходные, — а на его странице сообщается о стоимости $5.98 за задачу индекса. Он также измеряет Terminal-Bench 4.0 на уровне 59,6% и Humanity's Last Exam — на уровне 61,4%, против заявленных производителем 66,4% и 67,7% при максимальных усилиях на другом стенде.

Сопоставьте эти два абзаца друг с другом — и честный вывод оказывается узким. 66,4% Terminal-Bench у поставщика и независимые 59,6% — это один и тот же бенчмарк, проведённый разными людьми при настройках, которые не гарантированно совпадают, и ни один из них не является доказательством применительно к вашей рабочей нагрузке. Переносимый вывод — это лестница усилий: на независимом индексе собственные настройки этой модели охватывают диапазон в шестнадцать пунктов, а это более широкий разброс, чем разрыв между ней и её предшественницей. Выбор уровня усилий важнее, чем выбор между этими моделями, а формулировка «Default Fallback» в этой метке — это описанная выше защитная маршрутизация, а не артефакт бенчмарка.

Заявленная поставщиком эффективность с указанием источника. Anthropic утверждает, что Claude Opus 5.5 показывает уровень Claude Fable 5.1 в большинстве задач при примерно на 40% меньших затратах на выполнение, а типичные рабочие нагрузки обходятся примерно на 40% дешевле, чем на Claude Opus 5, на фоне снижения прейскурантной цены на 20%. Скорость генерации более чем на 30% выше. Это характеристики поставщика, основанные на усреднённых показателях по отобранным им рабочим нагрузкам. Заявления клиентов на момент запуска — доказательства того же рода: Box сообщает о трети токенов и ответах примерно на 40% менее многословных, Kiro — примерно о половине токенов и примерно на 40% меньшем числе вызовов, Factory — на 20–25% меньшем числе выходных токенов, GitHub — об одних из наименьших показателей по токенам и шагам, которые он измерял. Anthropic также сообщает о внутреннем тесте на проверку фактов, в котором 16 из 18 его отчётов прошли планку качества, которую ни Claude Fable 5.1, ни Claude Opus 5 не преодолели ни при одной попытке. Всё это заявлено поставщиком, и ничто из этого не прошло аудит. Раскрытое ограничение на удивление откровенно, и его стоит учитывать: Anthropic говорит, что Claude Opus 5.5 «часто подозревает, что его оценивают».

И наконец, родственные модели: Anthropic говорит, что Claude Sonnet 5.5 и Claude Haiku 5.5 появятся «в ближайшие недели». Ни одна из них ещё не выпущена, цена ни одной не объявлена, и ни одна сегодня не представлена ни на одной платформе.

Тестирование четырёх изменений без полного переключения

Риск миграции здесь не в качестве — он в том, что именно тот путь кода, который вы никогда не задействовали на стейджинге, возвращает 400 в продакшене. Четыре несовместимых изменения — это всё изменения структуры запросов, а значит, они дают сбой детерминированно и немедленно, и единственный способ найти пропущенные пути — пропустить через них реальный трафик.

Claude Opus 5.5 доступен на OrcaRouter как anthropic/claude-opus-5.5по собственной каталожной цене Anthropic с наценкой 0% — каталожная цена провайдера передаётся как есть, поэтому изменение цены поставщика действует здесь в тот же день.

The OrcaRouter model page for Claude Opus 5.5, showing the identifier anthropic/claude-opus-5.5, input at $4.00 and output at $20.00 per 1M tokens, a 1M-token context window, 128K max output, text plus image and file input, and OpenAI-compatible and Anthropic Messages endpoints served from api.orcarouter.ai.

Это позволяет направлять процент production-трафика на модель, пока остальной трафик по-прежнему идёт через Claude Opus 5, наблюдать, какие запросы завершаются ошибкой и почему, и исправлять их по одному. Четыре ошибки описывают сами себя: каждая называет параметр, который она отклонила, а в трёх из четырёх случаев — и замену. Автоматическое переключение при сбое закрывает пробел, пока путь всё ещё сломан — запрос, который завершается ошибкой при обращении к модели, которую вы ещё не полностью охарактеризовали, переключается на ту, которую вы уже охарактеризовали, вместо того чтобы выдавать пользователю 400.

Практичный порядок работы: сначала замените id модели и явно задайте effort, так как значение по умолчанию сместилось на medium; затем уберите пути с thinking-disabled и forced-tool-choice; после этого исправьте потоковый ридер — выбор блоков по типу и настройку thinking.display, — потому что именно он отказывает молча, а не громко; а миграцию набора инструментов computer-use оставьте напоследок, если вы работаете на Bedrock, так как именно она там не применяется. Всё остальное — цена, контекстное окно, ставки кэша и значение по умолчанию в 1M токенов — уже там, где вы это оставили.

Направьте часть живого трафика на новую модель без полного переключения: Claude Opus 5.5 на OrcaRouter работает по цене из прайс-листа Anthropic с автоматическим переключением при сбое на модель, характеристики которой вам уже известны.

Сравнение в этой статье4

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно