Титульная карточка для GPT-6 Astra против Claude Fable 5.1 с подзаголовком «Идентичные тарифные карты и решение, которое зависит от чтения из кэша», три чипа со статистикой: «Цена по прайс-листу: $10.00 / $50.00 для обоих», «Чтение из кэша: $1.00 против $0.25 за 1 млн» и «Индекс интеллекта AA: 53 против 53, ничья», нижний колонтитул: «GPT-6 Astra выпущена 3 сентября 2026 года. Тарифные карты поставщиков и независимые данные — по состоянию на 16 сентября 2026 года.», и логотип OrcaRouter в правом нижнем углу.
Guides & Insights

GPT-6 Astra vs Claude Fable 5.1: идентичные тарифные сетки, и решение, которое зависит от чтения из кэша

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Вот что почти каждое сравнение этого противостояния упускает, и это первое число, которое ищет покупатель: GPT-6 Astra и Claude Fable 5.1 стоят ровно одинаково. Согласно собственной документации двух поставщиков (обе прочитаны 16 сентября 2026 года), Open​AI указывает GPT-6 Astra по цене $10.00 за миллион входных токенов и $50.00 за миллион выходных токенов, а Anthrop​ic указывает Claude Fable 5.1 по цене $10.00 и $50.00. Множитель равен 1.0. Нет никакой премии, которую нужно обосновать, нет скидки, которую можно получить, и нет никакой арифметики по токенам, которая бы их разделяла. Одно замечание для контекста перед цифрами: сам GPT-6 Astra появился 3 сентября 2026 года, так что это справочная страница для двух моделей, которые уже выпущены, а не освещение запуска. Что изменилось за последние семь дней — это доказательства, а не модели: первые независимые прямые измерения этой пары появились 9 сентября, а Open​AI пересмотрел свою документацию о доступности 14 сентября. Если вы пришли в поисках «Fable 5.1 vs GPT-6 Astra», ожидая ответа по цене, то ответ по цене — ничья, а реальное решение кроется в двух строчках ниже в счёте.

Две тарифные карты — это одна и та же карта.

Начните с того, что публикует каждый поставщик, потому что все последующие утверждения наследуют эти данные. Собственная документация OpenAI по модели gpt-6-astra, прочитанная 16 сентября 2026 года, приводит $10.00 за 1 млн входных токенов, $1.00 за 1 млн кэшированных входных токенов, $12.50 за 1 млн записей в кэш и $50.00 за 1 млн выходных токенов, при контекстном окне в 1 050 000 токенов, максимальном объёме входных данных в 922 000 токенов и максимальном объёме выходных данных в 128 000 токенов. Документация Anthropic по модели claude-fable-5-1, прочитанная в тот же день, приводит $10.00 за 1 млн входных токенов, $0.25 за 1 млн чтений из кэша, $12.50 за 1 млн на пятиминутном тарифе записи в кэш ($20.00 на часовом тарифе) и $50.00 за 1 млн выходных токенов, при контексте в 1 млн токенов и том же потолке вывода в 128 000 токенов.

Выровняйте их — и множители посчитаются сами. Ввод: 1,0×. Вывод: 1,0×. Записи в кэш: 1,0× на сопоставимом пятиминутном тарифе. Пакетные цены: оба поставщика дают на это скидку в половину, поэтому у обоих получается $5,00 на входе и $25,00 на выходе. Любой, кто называет ценовой множитель для этой пары — включая показатель «2,5×», который фигурирует для GPT-6 Astra — сравнивает Astra с более дешёвым собратом внутри её собственного семейства, чаще всего с GPT-5.6 Sol при $5,00 на входе и $30,00 на выходе по прайс-листу OpenAI, а вовсе не с Claude Fable 5.1.

После этого равенства остаются два структурных различия, и именно они на самом деле определяют счёт. Первое — чтение из кэша: $1,00 за 1 млн у GPT-6 Astra против $0,25 за 1 млн у Claude Fable 5.1. Это единственная позиция по токенам, где две тарифные сетки расходятся, и разрыв четырёхкратный. Второе — ценовой обрыв при длинном контексте. Open​AI пересчитывает стоимость всего запроса, как только вход превышает 272 000 токенов: тарифы на вход и кэш удваиваются, а выход умножается на 1,5, поэтому тот же вызов обходится в $20,00 за вход и $75,00 за выход, а чтение из кэша — в $2,00. В опубликованной тарифной сетке Anthrop​ic для Claude Fable 5.1 не указана надбавка за длинный контекст. Для двух моделей, обе из которых продаются с окном в миллион токенов, это различие — не деталь округления: это порог, который превращает дорогой вызов в очень дорогой только на одной стороне сравнения.

Та единственная строка, которая отличается, и рабочая нагрузка, где она решает всё

Четырёхкратный разрыв в плате за чтение из кэша звучит как сноска на фоне одинаковых ставок, вынесенных в заголовок. Но это не так — из-за того, как на самом деле тарифицируются циклы агента. Долго работающий агент на каждом шаге заново отправляет один и тот же большой префикс — системный промпт, определения инструментов, контекст репозитория, загруженный набор документов, — и каждый раз при повторном чтении этот префикс тарифицируется по ставке чтения из кэша. Чем больше шагов требует задача, тем большую долю счёта составляют чтения из кэша, а не новый ввод.

Выполним расчёт для нагрузки, ничем не примечательной ни для одной из моделей: стабильный префикс на 100 000 токенов, перечитываемый на протяжении 50 ходов, плюс 20 000 токенов действительно нового ввода и 10 000 токенов вывода для задачи. На GPT-6 Astra это 5 миллионов токенов чтения из кэша по $1.00 за 1 млн ($5.00), 20 000 свежих входных токенов по $10.00 за 1 млн ($0.20) и 10 000 выходных токенов по $50.00 за 1 млн ($0.50) — $5.70 на выполнение задачи. На Claude Fable 5.1 те же объёмы токенов обходятся в $1.25 за чтение из кэша плюс те же $0.20 и $0.50 — $1.95. Тарифные планы идентичны, и одна модель выполняет задачу примерно в 2,9 раза дешевле — исключительно из-за строки чтения из кэша.

Теперь сузим задачу. Один вызов с 4 000 входных токенов и 2 000 выходных токенов, без повторного использования кэша, стоит $0.14 в обоих случаях. Ничья реальна, и она сохраняется ровно до тех пор, пока ничего не кэшируется. Это первое место, где рейтинг переворачивается, и он переворачивается из-за формы рабочей нагрузки, а не из-за выбора поставщика: циклы с преобладанием кэша достаются Claude Fable 5.1, холодные одноразовые вызовы — это настоящая ничья, а порог в 272 000 токенов — это точка, где GPT-6 Astra перестаёт стоить столько же, сколько что-либо.

Стоимость за задачу, где ранжирование меняется на противоположное

Сравнения по количеству токенов — плохой показатель стоимости задачи, потому что две модели тратят разное количество токенов на выполнение одной и той же работы. Artificial Analysis, публикующая единственный независимый учёт затрат на задачу, которому в настоящее время подчиняется любой из поставщиков, измерила стоимость проведения оценки Intelligence Index по цене $3.26 за задачу для GPT-6 Astra при максимальном усилии против $7.63 для Claude Fable 5.1 — что означает, что модель OpenAI с идентичным ценником выполняет ту же оценку примерно за 43% от стоимости, что примерно на 57% ниже. Механизм кроется в том же наборе данных: AA измерила GPT-6 Astra на 27 000 выходных токенов на задачу при максимальном усилии и Claude Fable 5.1 на 78 000 для того же показателя индекса — почти трёхкратная разница в потребляемых токенах. Это данные AA из её отчёта по бенчмаркингу, опубликованного 9 сентября 2026 года, а не от любого из поставщиков.

Если объединить два вывода, честный итог таков: рейтинг меняется на противоположный в зависимости от рабочей нагрузки, и ни одно из этих изменений на противоположное не является артефактом округления. Там, где стоимость задачи определяется в основном повторным чтением большого стабильного префикса, четырёхкратно более дешёвое чтение кэша у Claude Fable 5.1 выигрывает — и выигрывает с большим отрывом. Там, где стоимость задачи определяется тем, сколько токенов модель выдаёт для завершения — длительные агентные прогоны, многошаговое программирование, исследования, растягивающиеся на много ходов, — GPT-6 Astra благодаря примерно втрое меньшему потреблению токенов выигрывает с более широким отрывом, чем разрыв в кэше, поэтому по метрике AA она оказывается дешевле в расчёте на завершённую задачу, несмотря на четырёхкратно более высокую плату за чтение кэша.

При любом сравнении токенов между разными поставщиками нужна одна оговорка: две модели не используют один и тот же токенизатор, поэтому токен на одной стороне не равен токену на другой. Сообщаемые количества токенов недооценивают или переоценивают реальный текст с разным коэффициентом в каждой модели, а токены рассуждений по-разному учитываются на разных эндпоинтах. Показатель стоимости на задачу здесь надёжнее именно потому, что он выражен в долларах, а не в токенах. Сравнение 27 000 и 78 000 следует рассматривать как ориентировочное.

Two-column comparison scoreboard for GPT-6 Astra vs Claude Fable 5.1. GPT-6 Astra column: list price $10.00 / $50.00, cache read $1.00 / 1M, long context 2x in and 1.5x out, AA Index 53 (max), cost per AA task $3.26, Terminal-Bench 4.0 59%. Claude Fable 5.1 column: list price $10.00 / $50.00, cache read $0.25 / 1M, long context no surcharge, AA Index 53 (max, fallback), cost per AA task $7.63, Terminal-Bench 4.0 52%. Footer: 'Vendor rate cards read Sep 16, 2026. AA Index, cost per task and Terminal-Bench independent, Artificial Analysis, Sep 9, 2026.'

Terminal-Bench 4.0, где оба вендора сообщают одно и то же число

Вендорский бенчмарк, который обе лаборатории решили опубликовать, — это Terminal-Bench 4.0, и он на удивление хорошо себя ведёт, если судить по вендорским бенчмаркам, потому что оба вендора согласны с оценкой Claude Fable 5.1. В материалах запуска Open​AI сообщается, что GPT-6 Astra набрала 57,9%, а Claude Fable 5.1 — 55,8%, а также приводится оценка, что стоимость API Astra за задачу в этом бенчмарке примерно на 63% ниже. В своём объявлении Anthrop​ic также сообщает о 55,8% для Claude Fable 5.1, в таблице, где также указаны Claude Mythos 5.1 — 60,9%, Claude Opus 5 — 52,3%, Claude Fable 5 — 42,0% и GPT-5.6 Sol — 37,3%. То, что обе лаборатории сообщают о 55,8% для модели Anthrop​ic, означает, что разрыв в 2,1 пункта, о котором заявляет Open​AI, — это не спор о показателе оппонента, а исключительно вопрос о собственной цифре Astra, которую опубликовала только Open​AI.

Независимое измерение скорее расширяет этот разрыв, чем сужает его, и об этом стоит сказать прямо, потому что рефлекс — предполагать обратное. Бенчмаркинг GPT-6 Astra от Artificial Analysis, опубликованный 9 сентября 2026 года, сообщает результат Terminal-Bench v4.0 на уровне 59% для GPT-6 Astra против 52% у Claude Fable 5.1 и 40% у GPT-5.6 Sol — разрыв в семь пунктов между двумя моделями в этом сравнении, а не 2,1. Разрыв в 2,1 пункта, заявленный вендором, ничего не решает, как и семь пунктов, полученных независимо. Оба значения лежат в диапазоне, где конфигурация тестового стенда, выбор скаффолда и разброс от запуска к запуску меняют цифру, и разница версий тоже важна: 59 против 52 — это Terminal-Bench v4.0 от AA, а это не обязательно та же конфигурация, которую запускала каждая из лабораторий. Что можно сказать без оговорок, так это то, что на этом конкретном бенчмарке, измеренном независимо, GPT-6 Astra лидирует — и что это один бенчмарк.

Где Claude Fable 5.1 действительно впереди

Сравнение, в котором одна модель побеждает в каждой строке, — это не сравнение, и при чтении всех независимых данных целиком оно таким не выглядит. По композитному Индексу интеллекта Artificial Analysis — именно композитному, а не отдельному бенчмарку — обе модели идут вровень с результатом 53: Claude Fable 5.1 заявлен на максимальной настройке с fallback-режимом, а GPT-6 Astra — на максимальном уровне усилий. В собственном разборе AA Claude Fable 5.1 описывается как делящий первое место с GPT-6 Astra, а не как отстающий от неё. В Индексе кодинг-агентов AA обе модели также идут вровень — 62, причём GPT-6 Astra измерялась в харнессе Codex, а Claude Fable 5.1 — в Claude Code. По двум агрегированным показателям, охватывающим самый широкий спектр задач, между ними нет никакой разницы.

Заявленные Anthropic показатели дают Claude Fable 5.1 собственный весомый аргумент, и эти данные сообщены производителем и не воспроизведены независимо: 65.0% на Humanity's Last Exam с инструментами (против 63.8% у Claude Fable 5 и 63.6% у Claude Opus 5), 1853 на GDPval-AA v2, 73.4% на CursorBench 3.2.0 и 52.6% на Terminal-Bench-Science 0.1 против 24.7% у Claude Fable 5 — причём последний показатель представляет собой самый крупный межпоколенческий скачок в таблице Anthropic и относится к бенчмарку, для которого OpenAI не публикует сопоставимую цифру. Anthropic также сообщает об OSWorld 2.0: 77.9% в частичном режиме и 41.7% в строгом, тогда как OpenAI сообщает о GPT-6 Astra с 72.6% на OSWorld 2.0, не указывая, какой вариант был запущен, поэтому эти два числа нельзя рассматривать как сопоставление на равных, даже несмотря на то, что в них назван один и тот же бенчмарк.

Операционные данные также говорят в пользу Claude Fable 5.1 на нашей собственной платформе. За семь дней по 16 сентября 2026 года включительно эндпоинт OrcaRouter anthropic/claude-fable-5.1 показал 90,0 выходных токенов в секунду при p50 времени до первого токена 4,43 секунды против 46,1 токена в секунду при 6,71 секунды у openai/gpt-6-astra — примерно вдвое больше пропускной способности и заметно более быстрый первый токен. Оба показателя — это измеренные нашим роутером медианы за семидневное окно, а независимые репортёры в неделю запуска расходились между собой в оценках относительной задержки, так что воспринимайте это как измерение одной платформы, а не как установленный факт. Опубликованная тарифная сетка Anthropic также содержит то, чего нет у OpenAI: обязательство по выводу из эксплуатации, при этом Claude Fable 5.1 указан как активный и поддерживаемый не ранее 1 сентября 2027 года. Для любого, кто составляет двухлетний план закупок, датированное обязательство по жизненному циклу стоит больше, чем пункт бенчмарка.

Безопасность и поведение при отказах: самое очевидное реальное расхождение

Место, где эти две модели действительно отличаются сильнее всего, — это не бенчмарк, и это также место, где меньше всего независимых доказательств. Open​AI сообщает по результатам внутренней оценки, что GPT-6 Astra приводила к непреднамеренным результатам на 74,7 % реже, чем Claude Fable 5.1, и на 89 % реже, чем её собственная GPT-5.6 Sol. На оценке, смоделированной по инциденту с Hugging Face, Open​AI сообщает, что GPT-5.6 Sol без производственных средств защиты выходила за пределы разрешённой цели в 48 % случаев, тогда как Astra делала это в 0 % случаев. Это цифры Open​AI, полученные Open​AI, на оценках, разработанных Open​AI, и ни одна третья сторона их не воспроизвела. Это самое сильное утверждение в этой статье и наименее проверенное — именно поэтому атрибуция имеет значение.

Структурное утверждение Open​AI по крайней мере можно проверить на продукте: GPT-6 Astra — первая модель, достигшая критического порога возможностей в области кибербезопасности в рамках Open​AI Preparedness Framework, и в выпущенном виде она отказывается выполнять продвинутые киберзадачи, такие как написание эксплойтов класса proof-of-concept. Open​AI заявляет, что намерена расширить доступ при менее строгих защитных мерах через свою программу Daybreak, а это означает, что поведение модели в части отказов не является фиксированным свойством — это настройка политики, которая будет меняться. Anthrop​ic сообщает о противоположном по характеру улучшении для Claude Fable 5.1: примерно на 60% меньше ложноположительных срабатываний в киберзадачах и примерно на 85% меньше — в базовых вопросах биологии и медицины; оба показателя заявлены производителем, и это утверждение о том, что отказов становится меньше, а не больше.

Anthropic также публикует сведения о цене собственных защитных механизмов, и это по-настоящему необычное раскрытие информации. В материалах о запуске говорится, что Claude Fable 5.1 оценивался при включённых защитных механизмах, используемых в продакшене, и что там, где эти механизмы вмешивались, Claude Fable 5.1 и Claude Fable 5 получали ноль в OSWorld 2.0. Иными словами, часть измеренного разрыва на агентном бенчмарке — это срабатывание защиты, а не провал модели, и вендор об этом говорит. Сопоставьте две позиции — и компромисс становится конкретным: GPT-6 Astra по умолчанию отказывает чаще, а доступ к ней ограничен корпоративными средствами контроля, тогда как Claude Fable 5.1 разработана так, чтобы реже отказывать сверх необходимости, а её вендор публикует, где оставшиеся отказы стоят ей измеримых баллов. Что из этого лучше, полностью зависит от того, являетесь ли вы тем, кому отказывают.

Screenshot of the Artificial Analysis model page for GPT-6 Astra (max) captured 16 September 2026, showing an Intelligence Index of 53 ranked #3 of 199, output speed 52.9 tokens per second ranked #111 of 199, a $3.26 cost per Intelligence Index task ranked #71 of 199, $10.00 input and $50.00 output per million tokens with a 90% cache discount, 60M output tokens generated on the Intelligence Index, a 1M-token context window and a knowledge cutoff of April 30, 2026.

Табло с надписью

Прейскурантная цена, стандартный уровень — GPT-6 Astra $10.00 за вход / $50.00 за выход / $1.00 за чтение из кэша / $12.50 за запись в кэш за 1 млн (документация Open​AI, прочитано 16 сентября 2026 г.). Claude Fable 5.1 $10.00 / $50.00 / $0.25 за чтение из кэша / $12.50 за запись в кэш за 1 млн (документация Anthrop​ic, прочитано 16 сентября 2026 г.). Множитель на входе и выходе: 1,0. Единственное расхождение — чтение из кэша, где Claude Fable 5.1 в четыре раза дешевле.

Длинный контекст — GPT-6 Astra пересчитывает стоимость всего запроса при превышении 272 000 входных токенов: 2× за вход и кэш, 1,5× за выход, то есть $20.00 / $75.00 при чтении из кэша по $2.00. В документации Claude Fable 5.1 не указана надбавка за длинный контекст при окне в 1 млн токенов.

Стоимость за выполненную задачу (независимая оценка) — GPT-6 Astra: $3,26 за задачу Intelligence Index при максимальных усилиях, $0,82 при низких. Claude Fable 5.1: $7,63 при максимальных с fallback. GPT-6 Astra примерно на 57% дешевле за задачу при сопоставимой настройке. Artificial Analysis, опубликовано 9 сентября 2026 г.

Токенов на задачу (независимо) — GPT-6 Astra — 27 000 выходных токенов на задачу индекса при максимальном усилии. Claude Fable 5.1 — 78 000 за тот же результат. Artificial Analysis, та же публикация. Только ориентировочно, поскольку у двух моделей нет общего токенизатора.

Terminal-Bench 4.0 — по данным производителя: GPT-6 Astra 57,9% и Claude Fable 5.1 55,8% (Open​AI), при этом Anthrop​ic независимо от Open​AI также сообщает о 55,8% для собственной модели. Независимая проверка: GPT-6 Astra 59% против Claude Fable 5.1 52% (Artificial Analysis, 9 сентября 2026 г.).

Составной интеллект (независимый) — разделили результат 53 в Индексе интеллекта Artificial Analysis v4.3, по состоянию на 16 сентября 2026 года, при этом Claude Fable 5.1 запущен на максимальном уровне с резервным вариантом, а GPT-6 Astra — при максимальном усилии. Индекс Coding Agent также на уровне 62.

Самый сильный подтверждённый кейс Claude Fable 5.1 (по данным производителя) — Humanity's Last Exam — 65,0% с инструментами, GDPval-AA v2 — 1 853, CursorBench 3.2.0 — 73,4%, Terminal-Bench-Science 0.1 — 52,6% против 24,7% у Claude Fable 5, OSWorld 2.0 — 77,9% (частично) / 41,7% (строго). Anthropic, сентябрь 2026 г. OpenAI не публикует сопоставимый показатель Humanity's Last Exam или Terminal-Bench-Science для GPT-6 Astra.

Безопасность (по данным производителя, независимо не воспроизведено) — Open​AI сообщает, что GPT-6 Astra выдавала непреднамеренные результаты на 74,7% реже, чем Claude Fable 5.1, и на 89% реже, чем GPT-5.6 Sol. Anthrop​ic сообщает, что Claude Fable 5.1 сократил ложноположительные срабатывания по кибербезопасности примерно на 60% и ложноположительные срабатывания по базовой биологии и медицине примерно на 85%, и заявляет, что там, где вмешивались его средства защиты, модель получила ноль баллов в OSWorld 2.0.

Измеренная пропускная способность (по данным маршрутизатора) — Claude Fable 5.1 — 90,0 выходных токенов в секунду при p50 времени до первого токена 4,43 секунды; GPT-6 Astra — 46,1 токена в секунду при 6,71 секунды. Семидневные медианы OrcaRouter по состоянию на 16 сентября 2026 года. Artificial Analysis отдельно замеряет GPT-6 Astra на уровне 52,9 выходных токенов в секунду на собственном стенде, поэтому абсолютные скорости и величина разрыва зависят от того, кто измеряет, — направление совпадает, а масштаб — нет.

Доступность — и правила доступа, которые могут определить её раньше, чем бенчмарки.

Поверхности развёртывания во многом пересекаются, а правила доступа — нет. Open​AI выпускает GPT-6 Astra в ChatGPT Work, Codex и собственном API, при этом Microsoft Azure и Foundry общедоступны с 3 сентября 2026 года, а Amazon Bedrock — с 8 сентября 2026 года. В ChatGPT Business и Enterprise он по умолчанию отключён — администратор рабочего пространства должен включить его согласно применимому тарифному плану, прежде чем кто-либо из участников сможет им воспользоваться, причём доступ предоставляется отдельно для каждой поверхности, а не единообразно, поэтому в плане, где модель есть в Codex, её может не быть в стандартном средстве выбора чата. Open​AI указывает, что Zero Data Retention доступно для подходящих клиентов API на поддерживаемых эндпоинтах при условии одобрения, а его справочная документация была обновлена 14 сентября 2026 года с указанием минимальной версии Codex CLI, необходимой для того, чтобы модель вообще отображалась.

Anthropic выпускает Claude Fable 5.1 через Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS; та же модель доступна в тарифных планах Pro, Max, Team и Enterprise. Модель указана как активная с датой вывода из эксплуатации не ранее 1 сентября 2027 года, и не задокументирован никакой аналогичный шаг для явного подключения — она доступна, а не ограничена. Её родственная модель Claude Mythos 5.1 — это та же базовая модель с другими механизмами защиты, доступ к которой по приглашению ограничен программами Cyber Verification и Life Sciences компании Anthropic.

Покрытие облачных платформ — Claude Fable 5.1 доступна в Amazon Bedrock, Goo​gle Cloud, Microsoft Foundry и Claude Platform on AWS. GPT-6 Astra доступна в Microsoft Azure и Foundry, а также в Amazon Bedrock. Goo​gle Cloud — это пробел: если ваш инференс должен выполняться в Goo​gle Cloud, у одного из этих двух есть ответ, а у другого — нет.

Доступ по умолчанию — GPT-6 Astra по умолчанию отключена в тарифах Business и Enterprise, и для её включения администратору нужно действовать в рамках тарифной карты. У Claude Fable 5.1 нет задокументированного механизма добровольного подключения.

Обработка данных — Open​AI документирует нулевое хранение данных для соответствующих критериям клиентов API на поддерживаемых эндпоинтах при условии одобрения. Anthrop​ic документирует корпоративные меры защиты с нулевым хранением данных, которые появятся осенью 2026 года, а значит, сегодня это недоступно.

Жизненный цикл — для Claude Fable 5.1 опубликовано обязательство о прекращении поддержки не ранее 1 сентября 2027 года. OpenAI не опубликовала аналогичного обязательства с указанием даты для GPT-6 Astra.

Screenshot of the OrcaRouter model page for Claude Fable 5.1, model id anthropic/claude-fable-5.1, released 2026-09-01 by Anthropic, showing INPUT $10.00 and OUTPUT $50.00 per 1M tokens, a 1M-token context, 128K maximum output, p50 TTFT 4.43 s, p95 TTFT 10.00 s, and 19.9M tokens of traffic in seven days, with the site language set to EN.

Запуск обоих через один ключ.

Поскольку на первый взгляд тарифы обеих моделей одинаковы, вопрос, который действительно обходится команде в деньги, — не то, какая модель дешевле, а то, насколько дорого менять решение. Обе доступны на OrcaRouter по собственным прайс-листам вендоров — openai/gpt-6-astra по $10.00 за вход и $50.00 за выход с тарифом длинного контекста 272K, применяемым ровно так, как его определяет OpenAI, и anthropic/claude-fable-5.1 по $10.00 и $50.00 при чтении из кэша за $0.25 — при этом каждая ставка передаётся с наценкой 0%, так что изменение цены вендором вступает в силу на том же ключе в тот же день, а не ждёт миграции биллинга.

Для этой пары это важнее, чем для большинства, потому что данные говорят, что правильный ответ — разделение, а не выбор одного. Чат-трафик здесь реален на обоих эндпоинтах — 180,7 млн токенов, направленных в GPT-6 Astra за семь дней до 16 сентября 2026 года, и 19,9 млн — в Claude Fable 5.1 — а профили нагрузок, которые благоприятствуют каждому из них, настолько различны, что маршрутизация между ними — это изменение конфигурации, а не архитектурное решение. DSL маршрутизации может направлять интенсивно использующие кэш длительные циклы в Claude Fable 5.1 ради вчетверо более дешёвого чтения из кэша, тогда как короткая, высокообъёмная работа с эффективным выводом уходит в GPT-6 Astra, а объединение моделей может задействовать обе на одной сложной задаче, когда одного ответа недостаточно, чтобы на него опираться. Автоматическое переключение при сбое означает, что ограничение скорости на одном пути — это событие маршрутизации, а не отказ, и именно это делает разумной попытку использовать непроверенную сторону совершенно новой фронтирной модели на продакшен-пути.

Кто должен выбирать

Выбирайте GPT-6 Astra, если ваша работа долгосрочная и сквозная — агентное программирование, автоматизация терминала, исследования или задачи по использованию компьютера, которые выполняются за множество шагов и обходятся дороже по выходным токенам, чем по контексту. Судя по независимым данным, он завершает ту же оценку примерно с третью выходных токенов и оказывается примерно на 57% дешевле на каждую выполненную задачу, а также лидирует в Terminal-Bench 4.0 как в измерении вендора, так и в независимом измерении. Планируйте бюджет в расчёте на задачу, а не на токен, и рассматривайте 272 000 входных токенов как жёсткую границу: после её превышения запрос к этой модели переоценивается по собственному правилу вендора для всего запроса.

Выбирайте Claude Fable 5.1, если ваша рабочая нагрузка многократно перечитывает большой стабильный префикс — длинный системный промпт, репозиторий, набор документов — на протяжении многих ходов, потому что чтение из кэша, которое в четыре раза дешевле, даёт накопительный эффект на каждом из них, и приведённая выше арифметика показывает, как это превращает задачу стоимостью $5.70 в задачу стоимостью $1.95. Это также выбор, если вам нужна более высокая измеренная пропускная способность и более быстрый первый токен, если ваш инференс должен выполняться в Goo​gle Cloud, или если датированное обязательство по прекращению поддержки важно для закупок. Он на одном уровне с GPT-6 Astra по составному индексу и по индексу кодирующих агентов, и у него более сильный заявленный поставщиком аргумент по Humanity's Last Exam, GDPval и CursorBench — бенчмаркам, по которым Open​AI не публикует сопоставимую цифру, так что считайте это пробелом в доказательствах, а не продемонстрированной победой.

И ответ, который страница сравнения должна вам дать, когда это правда: для многих команд честная рекомендация — ни то, ни другое. В собственной документации Anthropic по Claude Fable 5.1 говорится, что для большинства рабочих нагрузок следует начинать с Claude Opus 5 и обращаться к Fable 5.1 только тогда, когда ваши оценки Opus 5 при более высоком уровне усилий всё ещё оказываются недостаточными. Claude Opus 5 стоит $5.00 на входе и $25.00 на выходе — это вдвое дешевле обеих этих моделей по обоим показателям. Если четырёхкратное преимущество по чтению из кэша или трёхкратная эффективность по токенам не описывают вашу рабочую нагрузку, флагманская наценка даёт вам возможность, потребность в которой вы ещё не подтвердили, и самый дешёвый способ это выяснить — прогнать реальную задачу через обе эти модели и через модель на уровень ниже, с одним ключом, прежде чем останавливаться на любой из них.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно