Claude Fable 5 — это модель класса Mythos от Anthropic — уровень возможностей выше класса Opus, сделанная безопасной для общего использования. Её возможности превосходят любую модель, ранее широко выпущенную Anthropic, с передовыми результатами в разработке программного обеспечения, работе со знаниями, компьютерном зрении и научных исследованиях; чем длиннее и сложнее задача, тем больше её преимущество. Она принимает текстовые, графические и файловые вводные данные с выводом текста, обслуживает контекстное окно в 1M токенов с возможностью вывода до 128K токенов и поддерживает адаптивное рассуждение и структурированные выводы. Fable 5 создан для автономной работы в течение длительного времени: он сохраняет связность на протяжении миллионов токенов, улучшает собственные результаты с помощью файловой памяти и выполняет сложные многошаговые задачи с гораздо меньшим количеством вспомогательных средств, чем предыдущие модели. Это новый уровень передовых возможностей для задач, связанных с компьютерным зрением — извлечение точных значений из научных рисунков, восстановление приложений только по скриншотам — и кардинальный шаг для агентного программирования и прототипирования, выполняя миграции всей кодовой базы и инженерные задачи на переднем крае за меньшее, более токен-эффективное количество шагов. Это делает его хорошим выбором по умолчанию для ИИ-помощников по программированию, пайплайнов глубокого анализа и долго работающих автономных агентов, где наиболее важны устойчивая связность и рассудительность.
Claude Fable 5 — это большая языковая модель от Anthropic, которая отличается расширенным контекстом и поддержкой мультимодального ввода. Её окно контекста в 1 000 000 токенов позволяет обрабатывать…
Claude Fable 5 отлично справляется с задачами, требующими глубокого контекстного понимания длинных текстов или мультимодальных входных данных. Примеры включают обобщение многотомных юридических документов, ревью кода в больших репозиториях, интеграцию информации из нескольких изображений и текста, а также планирование сложных многошаговых процессов, где предыдущие шаги влияют на последующие. Показатель модели в 85,0 баллов на OSWorld-Verified указывает на то, что она может успешно выполнять реалистичные компьютерные задачи, включающие навигацию, работу с файлами и взаимодействие с программным обеспечением на протяжении многих шагов. Модель также показывает хорошие результаты на стандартных тестах понимания языка и генерации, хотя конкретные баллы, помимо OSWorld, публично не раскрыты. Для задач, не требующих большого контекста или мультимодальных данных, более экономически эффективными будут меньшие модели, такие как Claude 3 Haiku или GPT-4o mini.
Учитывая премиальное ценообразование в $10/$50 за миллион токенов, Claude Fable 5 не оптимален для коротких высокообъёмных запросов, таких как простая классификация, перевод отдельных предложений или стандартная поддержка клиентов. Если ваша задача укладывается в контекстное окно 8K–32K и не требует понимания изображений, более мелкие модели, такие как Claude 3 Sonnet, GPT-4o или последние лёгкие версии, обеспечат более быстрые ответы при значительно меньших затратах. Кроме того, если вы выполняете тонкую настройку или нуждаетесь в высокой пропускной способности для множества одновременных запросов, стоимость и задержка Claude 5 могут оказаться непомерными. Резервируйте эту модель для задач, где уникальная ценность экстремального контекста, мультимодального рассуждения или агентной производительности высшего уровня явно оправдывает расходы. API OrcaRouter позволяет динамически переключать модели для каждого запроса, так что вы можете использовать Fable 5 только для сложных задач, а простые направлять в другие модели.
Да, модель хорошо подходит для агентных рабочих процессов, требующих поддержания состояния на протяжении многих шагов. Её контекстное окно может вмещать полный журнал агента, историю вызовов инструментов и наблюдения среды, обеспечивая согласованное принятие решений в рамках расширенных взаимодействий. Оценка 85.0 на OSWorld-Verified напрямую измеряет производительность на реалистичных многошаговых компьютерных задачах — таких как составление электронного письма, редактирование электронной таблицы или навигация по веб-интерфейсу, — что является основой агентных систем. Максимальный вывод в 128K позволяет модели создавать длинные последовательности действий или подробные отчеты. Однако разработчикам следует учитывать повышенную задержку и стоимость за шаг. Для более простых агентных циклов с короткими контекстами могут подойти меньшие модели. API OrcaRouter поддерживает стриминг и пользовательские параметры (например, temperature, max_tokens) для тонкой настройки поведения.
Сильные стороны включают самый большой из доступных на рынке контекстный размер окна (1 млн токенов), развитое мультимодальное понимание (текст, изображения, файлы) и высокий балл на OSWorld-Verified (85,0), что отражает надёжную производительность в реальных задачах. Модель также имеет щедрый лимит вывода в 128K токенов, позволяя генерировать длинные тексты. Ограничения включают высокую стоимость: по $10/$50 за миллион токенов она в несколько раз дороже моделей среднего уровня. Кроме того, задержка возрастает с длиной контекста — обработка почти 1 млн токенов может занимать десятки секунд и более. Модель лишена таких модальностей, как аудио или видео; она принимает только текст и изображения. Она также не поддерживает тонкую настройку или индивидуальное обучение — это фиксированная модель, доступная только через API. Для задач, не использующих её уникальные возможности, стоимость может превысить выгоду.
OSWorld-Verified — это бенчмарк, оценивающий AI-агентов на реалистичных многошаговых компьютерных задачах в разных операционных системах. Оценка 85.0 означает, что Claude Fable 5 успешно выполняет 85% оцениваемых задач без участия человека. Это высокий показатель, предполагающий, что модель может эффективно использовать инструменты, просматривать файлы, манипулировать элементами интерфейса и рассуждать в длинных последовательностях. Для контекста: многие другие модели набирают ниже 50 в аналогичных бенчмарках. Оценка отражает как большой контекст модели (позволяющий запоминать предыдущие шаги), так и её способность к рассуждению. Однако OSWorld-Verified — лишь один из метрик; он не измеряет фактологичность, безопасность или предметные знания. Пользователям следует оценивать производительность на собственных задачах. Бенчмарк был выполнен компанией Anthropic с использованием независимой системы оценки.
Точные показатели задержки для Claude Fable 5 не раскрываются публично компанией Anthropic, но общие ожидания можно оценить. Для типичного короткого промпта (например, несколько сотен токенов) модель может отвечать в течение секунд. При приближении длины контекста к лимиту в 1M задержка значительно возрастает — потенциально превышая минуту как для обработки, так и для генерации. Длина вывода также влияет на скорость; генерация 128K токенов может занять значительное время. API OrcaRouter поддерживает потоковые ответы, поэтому пользователи могут обрабатывать частичные результаты по мере их поступления. Для приложений реального времени рассмотрите использование меньшей модели. Высокая стоимость ($50/output MTok) дополнительно стимулирует оптимизацию длины промпта. Кэширование изначально недоступно, но OrcaRouter может предлагать опциональное кэширование для повторных запросов — проверьте текущую документацию.
Несмотря на свои сильные стороны, Claude Fable 5 имеет ограничения. Во-первых, это не универсальный инструмент для множества задач; он превосходно справляется с длинным контекстом и мультимодальными рассуждениями, но может уступать специализированным моделям в таких задачах, как математика (например, GPT-4o) или генерация кода (например, Code Llama), если эти модели доработаны. Во-вторых, дата отсечки знаний модели не указана; предполагается, что она может не быть актуальной для самых последних событий. В-третьих, как и все большие языковые модели, она может галлюцинировать или выдавать неточную информацию, особенно при выходе за пределы своего обучающего распределения. В-четвертых, понимание изображений мощное, но не идеальное — мелкие детали на изображениях с низким разрешением могут быть упущены. Наконец, стоимость и задержка делают ее непрактичной для высокопроизводительных производственных систем. Всегда критически проверяйте результаты. Платформа OrcaRouter позволяет при необходимости переключаться на альтернативные модели.
Эталон OSWorld-Verified относительно новый, поэтому прямые сравнения с многими моделями ограничены. Однако известные результаты из публичных лидербордов показывают, что баллы выше 70 считаются очень высокими. Например, более ранние модели, такие как GPT-4V и Claude 3 Opus, сообщали о баллах ниже 60 на аналогичных агентских эталонах (например, OSWorld). Claude Fable 5 с результатом 85.0 указывает, что это одна из лучших моделей для выполнения агентских задач. Тем не менее, результаты эталонов не гарантируют производительность в каждом сценарии; реальные задачи различаются по сложности и предметной области. Модель, вероятно, также показывает высокие результаты на эталонах общего понимания языка (например, MMLU, HellaSwag), хотя конкретные цифры не приводятся. Пользователям следует проводить собственную оценку, используя репрезентативные выборки. API OrcaRouter позволяет тестировать модели бок о бок с одинаковыми запросами.
Цены прозрачны: $10.00 за 1 миллион входных токенов и $50.00 за 1 миллион выходных токенов. Это точные тарифы провайдера Anthropic; OrcaRouter не добавляет наценок. Входные токены включают весь текст, изображения и содержимое файлов, обрабатываемые моделью. Выходные токены учитывают каждый сгенерированный токен. Например, запрос с 10 000 входных токенов и 2000 выходных токенов будет стоить $0.10 + $0.10 = $0.20. Никаких скрытых платежей или минимального объёма использования. Оплата выставляется через вашу учётную запись OrcaRouter. Если вы крупный пользователь, OrcaRouter может предложить скидочные уровни — обратитесь в поддержку для подробностей. Обратите внимание: из-за высокой стоимости модели важно контролировать использование токенов. OrcaRouter предоставляет журналы использования и разбивку затрат в панели управления.
Основной компромисс — между возможностями и стоимостью. Claude Fable 5 — одна из самых дорогих доступных моделей из-за большого контекста и высокой цены за токен. Для задач, использующих менее 32K токенов, вы будете платить премию, не задействуя ключевое преимущество модели. Рассмотрите использование более дешёвой модели (например, Claude 3 Haiku по $0.25/$1.25 за MTok) в таких случаях. Кроме того, выходные токены в пять раз дороже входных, поэтому оптимизация длины генерации — с помощью структурированных запросов или более низких настроек max_tokens — может снизить затраты. Также избегайте включения лишнего контекста; каждое изображение потребляет значительное количество токенов (часто тысячи). API OrcaRouter поддерживает параметр `max_tokens` для ограничения вывода. Для рабочих нагрузок с частыми повторяющимися запросами подумайте, может ли кэширование или кастомная тонкая настройка более мелкой модели быть более рентабельными.
На данный момент Anthropic не предлагает встроенную функцию кэширования промптов для Claude Fable 5, и OrcaRouter не кэширует промпты автоматически. Однако API OrcaRouter может поддерживать опциональное кэширование запросов на уровне инфраструктуры для идентичных запросов — обратитесь к документации OrcaRouter или свяжитесь со службой поддержки, чтобы узнать о текущих возможностях кэширования. Без кэширования каждый запрос тарифицируется полностью за каждый токен. Если ваш вариант использования включает много одинаковых префиксов (например, общий системный промпт для множества пользовательских сообщений), вы можете реструктурировать свои вызовы, чтобы минимизировать повторные затраты на токены, но модель все равно будет обрабатывать полный ввод каждый раз. Для приложений с высоким объемом запросов рассмотрите возможность точной настройки (fine-tuning) более маленькой модели или использования более дешевой модели с более коротким контекстом. OrcaRouter позволяет программно переключать модели для оптимизации затрат.
Нет, OrcaRouter не взимает дополнительных комиссий сверх тарифа провайдера. Вы платите ровно $10.00 за 1M входных токенов и $50.00 за 1M выходных токенов. Нет платы за каждый запрос, нет минимального порога подписки и нет скрытых затрат. Стандартные комиссии аккаунта OrcaRouter (если они есть) применяются ко всем запросам API, но не относятся к ценам на конкретные модели. Если вы используете такие функции, как пользовательская маршрутизация моделей, стриминг или многократные диалоги, они включены в стоимость токенов. Всегда проверяйте страницу цен OrcaRouter для получения самой актуальной информации. Для корпоративных клиентов OrcaRouter может предложить оптовые скидки или индивидуальные цены — свяжитесь с отделом продаж для получения предложения. Вкратце, стоимость прозрачна и предсказуема на основе использования токенов.
Вы получаете доступ к Claude Fable 5 через совместимый с OpenAI API OrcaRouter. Базовый URL: https://api.orcarouter.ai/v1. Используйте идентификатор модели "anthropic/claude-fable-5" в своих запросах. API принимает стандартные параметры чат-завершения OpenAI: `messages`, `max_tokens`, `temperature`, `top_p`, `stop` и т.д. Для мультимодальных входных данных используйте массивы `content` с записями типа "text", "image_url" или "file_url" (в зависимости от версии вашего SDK). Для аутентификации требуется ключ API от OrcaRouter, передаваемый в заголовке Authorization как "Bearer YOUR_API_KEY". Пример команды curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $ORCAROUTER_API_KEY" -d '{"model":"anthropic/claude-fable-5","messages":[{"role":"user","content":"Hello"}],"max_tokens":100}'. Потоковая передача поддерживается установкой `stream: true`.
Claude Fable 5 поддерживает стандартные параметры API завершений чата OpenAI. Наиболее важные из них: `max_tokens` (максимум 128K по умолчанию), `temperature` (диапазон 0–2, рекомендуется 0–1), `top_p` (альтернатива temperature), последовательности `stop`, `presence_penalty` и `frequency_penalty`. Для мультимодальных запросов поле `content` может содержать массивы объектов с `type` и соответствующими данными (например, `{"type":"text","text":"Опишите этот график"}` и `{"type":"image_url","image_url":{"url":"data:image/jpeg;base64,..."}}`). Загрузка файлов возможна через URL или данные в кодировке base64. Также существует параметр `stream` для получения частичных ответов. Не все параметры поддерживаются; например, функции/инструменты в настоящее время недоступны для этой модели — проверяйте документацию OrcaRouter на предмет обновлений. Все параметры передаются в теле запроса.
Миграция проста, поскольку API OrcaRouter совместим с OpenAI. Начните с получения ключа API OrcaRouter в панели управления аккаунтом. Замените текущий базовый URL на https://api.orcarouter.ai/v1 и измените идентификатор модели на "anthropic/claude-fable-5". Если вы ранее использовали нативный API Anthropic, учтите, что OrcaRouter использует формат сообщений OpenAI, а не формат Anthropic. Вам потребуется адаптировать любой код, который формирует структуру сообщений. Для ввода изображений преобразуйте их в формат OpenAI (например, base64 или URL). OrcaRouter обрабатывает внутреннюю трансляцию в API Anthropic. Протестируйте с одним запросом перед миграцией production-нагрузок. OrcaRouter также может предлагать дополнительные функции, такие как ограничение скорости, аналитика использования и резервные модели. Обратитесь к документации OrcaRouter за подробностями о форматировании сообщений и аутентификации.
Claude Fable 5 предлагает большее окно контекста (1M против 200K у Opus) и более высокий результат в OSWorld-Verified (85.0 против примерных ~55-60 у Opus). Он также поддерживает ввод изображений и файлов, как и Opus. Лимит выходных токенов выше (128K против 4,096 у Opus). Однако Claude 3 Opus значительно дешевле: $15/$75 за MTok для Opus (ранее) или $8/$24 для Opus после снижения цен? Фактические текущие цены для Opus — $15/$75 за MTok против $10/$50 у Fable 5—подождите, Opus на самом деле $15/$75 ввод/вывод? (Стандартный тариф: Claude 3 Opus $15/$75 за MTok). Так что Fable 5 на самом деле дешевле за токен, чем Opus? По сути $10/$50 против $15/$75, то есть Fable 5 на 33% дешевле. Это интересный момент. Но Opus всё ещё подходит для коротких задач. Главное преимущество Fable 5 — длина контекста и производительность в агентных задачах. Для задач в пределах 200K токенов Opus может быть достаточен при меньшей стоимости. Если нужен экстремальный контекст или высшие агентные показатели, Fable 5 лучше.
GPT-4o (от OpenAI) имеет контекстное окно 128K, по сравнению с 1M у Fable 5. GPT-4o также поддерживает ввод текста, изображений и аудио (Fable 5: только текст и изображения). Ограничение вывода для GPT-4o составляет 4 096 токенов, что намного меньше, чем 128K у Fable 5. По бенчмаркам GPT-4o набирает около 87,1 на MMLU, но не имеет публично сообщаемого балла OSWorld-Verified. Что касается ценообразования, GPT-4o стоит $5/$15 за MTok (ввод/вывод), что дешевле, чем $10/$50 у Fable 5. Таким образом, GPT-4o быстрее и дешевле для коротких задач, в то время как Fable 5 превосходит в длинных контекстах и агентских сценариях. Для мультимодальности с аудио GPT-4o является лучшим выбором. Оба доступны через OrcaRouter, что позволяет выбирать для каждого запроса.
В OrcaRouter вы можете выбирать из различных моделей Anthropic (Claude 3.5 Sonnet, Claude 3 Haiku) и моделей OpenAI (GPT-4o, GPT-4o mini, GPT-4 Turbo), а также из моделей с открытым исходным кодом. Для большинства задач Claude 3.5 Sonnet предлагает хороший баланс возможностей и стоимости ($3/$15 за MTok) с контекстом в 200K. Для очень длинных контекстов Fable 5 не имеет аналогов. Для высокопроизводительной классификации или извлечения данных Claude 3 Haiku ($0.25/$1.25 за MTok) дёшев и быстр. Для генерации кода могут быть специализированы GPT-4o или Code Llama. OrcaRouter позволяет задавать резервные модели: если Fable 5 выйдет из строя или превысит тайм-аут, можно перенаправить запрос на более дешёвую модель. Оцените свои конкретные требования к длине контекста, входной модальности и производительности бенчмарков. Лучшая модель зависит от вашего сценария использования, а не только от наивысших показателей бенчмарков.
Совместимо с OpenAI — оставьте свой SDK
https://api.orcarouter.ai/v1https://api.orcarouter.aifrom openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="anthropic/claude-fable-5",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_tokensreasoningresponse_formatstopstructured_outputstool_choicetoolsverbosity| Ввод / 1M токенов | $10.00 |
| Вывод / 1M токенов | $50.00 |
| Чтение кэша / 1M | $1.00 |
| Запись кэша / 1M | $12.50 |
| Валюта | USD |
Оценка по прайс-листу
Только оценка — фактическое число токенов зависит от токенизатора провайдера.
GET /api/public/models/anthropic/claude-fable-5Открыть @misc{orcarouter_claude_fable_5,
title = {Claude Fable 5 API},
author = {Anthropic},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/anthropic/claude-fable-5}
}Anthropic. (2026). Claude Fable 5 API. OrcaRouter. https://www.orcarouter.ai/models/anthropic/claude-fable-5