Qwen 3.8 против Claude Fable 5: флагман Alibaba на 2,4 трлн параметров наконец-то получил цену
Guides & Insights

Qwen 3.8 против Claude Fable 5: флагман Alibaba на 2,4 трлн параметров наконец-то получил цену

Автор

jinhao song

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Когда Alibaba представила Qwen3.8-Max в Шанхае 19 июля 2026 года, она сделала одно заявление громче любого другого: эта модель с 2,4 триллиона параметров близка к уровню передовых и уступает только Claude Fable 5. Тогда это невозможно было оценить: не было ни тарифной сетки, ни таблицы бенчмарков, ни лицензии — просто позиционирование.

В день 3 августа 2026 года Qwen3.8-Max стал общедоступным, и сравнение наконец-то обрело реальную основу с обеих сторон. Alibaba опубликовала цены $2 / $6 за миллион токенов и таблицу бенчмарков с реальными цифрами. Fable 5 по-прежнему находится на вершине независимого индекса Artificial Analysis Intelligence с подтверждёнными аудитом 95,0% на SWE-bench Verified. Так что вопрос обостряется: теперь, когда Qwen показал свои цифры, сохраняется ли утверждение «второй после Fable 5»?

Заметка для разработчиков — самый быстрый способ урегулировать такой спор — запустить обе модели на своих собственных промптах. OrcaRouter предоставляет доступ к более чем 200 моделям через единую OpenAI-совместимую конечную точку, так что вы можете сравнить Qwen 3.8 Max с Fable 5 на одной и той же задаче без подключения двух SDK.

Вердикт TL;DR. Qwen3.8-Max на этапе GA — гораздо более сильный соперник, чем предполагала предварительная версия, — и при этом значительно дешевле. При $2 / $6 фиксированная цена за 1 млн токенов он подрезает цены Fable 5 $10 / $50 примерно в 5 раз на входе и в 8 раз на выходе, а его собственные заявленные показатели выглядят как у frontier-моделей (GPQA Diamond 92.6, Terminal-Bench 2.1 86.6, FrontierSWE 73.5 против 40.7 у предшественника). Но Fable 5 сохраняет корону по одной причине, которая не изменилась с июля: это единственная из двух, у которой есть рефери. Индекс интеллекта Fable (~60) и 95,0% SWE-bench проверены третьей стороной; каждый показатель Qwen — собственные данные Alibaba, и ни Artificial Analysis, ни LMArena не публиковали результат Qwen3.8-Max. Fable 5 побеждает по доказательности; Qwen 3.8 убедительно побеждает по цене и, как только появятся веса, по открытости.

Основные выводы

Qwen3.8-Max стал общедоступным (GA) 3 августа 2026 года — больше не предварительная версия. Опубликован прайс-лист, API совместим с OpenAI и DashScope, представлена таблица бенчмарков вендора.

Разрыв в ценах огромен: Qwen — $2 / $6 за 1M против $10 / $50 у Fable 5. Это примерно ~5× на входе и ~8× на выходе, причём тариф Qwen одинаков для всего контекста в 1M токенов, без надбавки за длинные промпты.

Fable 5 остаётся единственной стороной, прошедшей аудит. ~60 по Artificial Analysis Intelligence Index (#1) и 95.0% SWE-bench Verified, тогда как Qwen3.8-Max до сих пор не оценён ни одним независимым оценщиком.

Заявленные самой Qwen показатели действительно сильны: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — но это данные самого вендора, а лаборатории публикуют лишь те бенчмарки, в которых побеждают.

Alibaba так и не раскрыла количество активных параметров, поэтому цифра 2.4T почти ничего не говорит о реальной стоимости обслуживания. Архитектура Fable 5 тоже не раскрыта — в плане прозрачности обе стороны небезупречны.

Открытые веса обещаны в течение недели, а также Qwen3.8-27B, который, по сообщениям, работает в ~17 ГБ видеопамяти. Fable 5 закрыт и доступен только через API, навсегда.

Примечание о точности: все показатели качества Qwen3.8-Max предоставлены компанией Alibaba и не были независимо воспроизведены. Показатели Fable 5 взяты из Artificial Analysis и Anthropic и могут отличаться в зависимости от трекера. Цены Qwen соответствуют тарифной карте GA от Alibaba Model Studio и больше не включают временную скидку на предварительный просмотр, действовавшую в июле.

Характеристики и цена, бок о бок

Вот конкретные данные, каждая цифра привязана к своему источнику.

• Производитель / статус — Qwen3.8-Max: Alibaba; GA (3 августа 2026); Claude Fable 5: Anthropic; GA-флагман

• Архитектура — Qwen3.8-Max: ~2.4T всего, разреженная MoE (активные параметры все еще не раскрыты); Fable 5: закрытая; архитектура не раскрыта

• Контекстное окно — Qwen3.8-Max: 1M токенов (983,616 с мышлением; максимальный вывод 131,072); Fable 5: флагман длинного контекста

• Индекс интеллекта AA — Qwen3.8-Max: Ещё не оценено; Fable 5: ~60 — #1 (Artificial Analysis)

• SWE-bench Verified — Qwen3.8-Max: Не сообщается (Alibaba вместо этого сообщает о FrontierSWE 73.5); Fable 5: 95.0% (Anthropic / buildfastwithai)

• Заявленные вендором сильные стороны — Qwen3.8-Max: GPQA Diamond 92.6, Terminal-Bench 2.1 86.6, PaperBench 93.0, OSWorld-Verified 86.1 (все данные Alibaba); Fable 5: по результатам аудита — #1 в общем зачёте

• Цены (вход / выход) — Qwen3.8-Max: $2.00 / $6.00 за 1 млн, фиксированная цена для контекста в 1 млн; кэшированный ввод $0.25; Fable 5: $10 / $50 за 1 млн

• Открытые веса — Qwen3.8-Max: Обещано в течение недели (лицензии пока нет); Fable 5: Нет — закрытая / только API

• Мультимодальность — Qwen3.8-Max: текст, изображение, видео на входе → текст на выходе; Fable 5: мультимодальный флагман

Две вещи задают рамки всему сравнению, и обе изменились 3 августа.

Во-первых, колонка цен теперь — самое заметное на странице. В июле ценовое преимущество Qwen выглядело как купон на скидку — 90% скидки на кредиты, временно, без тарифа за токен, на который можно было бы ориентироваться. Теперь это тарифная сетка, и разрыв носит структурный, а не рекламный характер. При $6 за вывод против $50 у Fable вы можете выполнить примерно восемь запросов к Qwen по цене одного запроса к Fable. Для любой нагрузки, где вы платите за объём, а не за единственный самый сложный ответ, это соотношение меняет архитектуру того, что вы строите.

Во-вторых, столбец бенчмарков больше не пуст — но он также не сопоставим. Это тот нюанс, который имеет наибольшее значение. Alibaba сообщает о FrontierSWE 73.5; Anthropic сообщает о SWE-bench Verified 95.0%. Это разные бенчмарки с разными кривыми сложности, и ставить 73.5 против 95.0 так, будто они измеряют одно и то же, было бы откровенно вводящим в заблуждение. То, что мы можем сказать, уже и честнее: результат Fable 5 получен третьей стороной в условиях, которые другие могут проверить, а результат Qwen получен Alibaba на стенде, который больше никто не запускал. Пока Artificial Analysis или LMArena не опубликует оценку Qwen3.8-Max, правильное прочтение не изменилось с июля — предположительно близко, но всё ещё не доказано.

Что на самом деле дает разница в цене

Абстрактные множественные примеры менее полезны, чем разобранный пример, поэтому вот один. Возьмём агента проверки кода, который отправляет 150 000 токенов контекста репозитория и генерирует 6 000 токенов ревью за один вызов.

Qwen3.8-Max: 0.15M × $2 = $0.30, плюс 0.006M × $6 = $0.036. ≈ $0.34 за вызов.

Claude Fable 5: 0.15M × $10 = $1.50, плюс 0.006M × $50 = $0.30. ≈ $1.80 за вызов.

• При 2 000 вызовов в день: Qwen ≈ $672 в день; Fable ≈ $3 600 в день. За месяц это примерно $20 000 против $108 000.

• Благодаря кэшированию промптов в стабильном контексте репозитория, кэшированный ввод Qwen по цене $0.25/1M снижает стоимость ввода с $0.30 до менее $0.04, доводя вызов до ≈ $0.08 — примерно в 22 раза дешевле Fable за вызов.

Это не незначительная экономия; это разница между запуском ревьюера на каждом pull request и запуском его только на рискованных. А фиксированная ставка за контекст у Qwen усиливает этот эффект по мере роста промптов: поскольку Alibaba не применяет надбавку за длинные промпты, прогон контекста в 900 000 токенов стоит столько же за токен, как и контекст в 5 000 токенов.

Честным противовесом является то, что цена за токен — это не цена за решенную задачу. Если Fable 5 решает проблему за один проход, тогда как более дешевая модель требует трех попыток плюс исправление человеком, более дешевая модель в сумме может обойтись дороже — и на самых сложных задачах на рассуждение подтвержденный аудитом рейтинг №1 Fable является лучшим доступным доказательством того, что она действительно решает больше за один проход. Аргумент о стоимости для Qwen наиболее силен для высокообъемных некритичных рабочих нагрузок и наиболее слаб для низкообъемных с высокими ставками.

Доказательство, и почему оно по-прежнему решает этот матч.

Наиболее цитируемые практические доказательства возможностей Qwen3.8-Max взяты из обзора эпохи предварительного доступа (thomas-wiegold.com), в котором модель прогнали через четыре реальных сборки. Результаты были действительно впечатляющими: Qwen с первой попытки справилась с симуляцией покера на Go — лишь третья модель в истории, прошедшая этот промпт за один проход, наряду с Fable 5 и Grok 4.5, — а на промпте для сайта обжарщика кофе она выдала лучший результат, который рецензент когда-либо видел в этом тесте, добавив из чистой дотошности незапрошенные корзину для покупок, оптовый раздел и интеграцию с Instagram.

Загвоздка была в скорости: 30+ минут на сайте и 1 час 20 минут на симуляции покера, что делало эту модель самой медленной из всех, которые рецензент использовал. Этот результат теперь нуждается в оговорке, которой в июле не требовалось. Он был измерен на предварительной инфраструктуре, одним рецензентом, при необычно длинных агентских прогонах. GA-обслуживание — это другая система. Для справки, собственная 7-дневная телеметрия OrcaRouter в настоящее время показывает p50 времени до первого токена 1,64 секунды для Qwen3.8-Max — собственное измерение, хотя TTFT и сквозная пропускная способность при часовых сборках — разные величины. Честная позиция состоит в том, что вывод о медленной работе предварительной версии следует перепроверить, а не повторять как актуальный факт.

Что не изменилось, так это асимметрия доказательств. Таблица бенчмарков GA от Alibaba — это реальный шаг вперёд по сравнению с публикацией ничего, но это всё ещё артефакт вендора: лаборатории сами выбирают, какие бенчмарки публиковать, и самый слабый опубликованный показатель Alibaba — IFBench 82,8, следование инструкциям — как раз совпадает с претензией из предварительного обзора о том, что модель перевыполняет задачу и игнорирует ограничения. Fable 5, тем временем, оценивается независимым оценщиком, не заинтересованным в результате. На вопрос «какая модель справится с работой, в которой я не могу позволить себе ошибиться», эта разница — не формальность. Это и есть вся основа для выбора.

Открытость: ось, на которой Qwen может победить окончательно

Fable 5 никогда не будет self-hosted. Qwen3.8-Max, возможно, будет, и Alibaba теперь заявляет, что веса появятся в течение недели. Но два предостережения заслуживают равного внимания.

Первое — юридический аспект: до сих пор нет ни текста лицензии, ни карточки модели. Надпись «Открытые веса скоро появятся» — это не предоставление коммерческих прав, пока не появится документ, который можно прочитать, и именно лицензия определит, можно ли вообще использовать этот релиз в продукте.

Вторая причина — физическая. Модель на 2.4T при 4-битном квантовании занимает примерно 1.2 ТБ, тогда как один H200 — около 141 ГБ; это восемь или более топовых ускорителей, прежде чем вы сможете обслужить хотя бы один токен. А поскольку Alibaba так и не раскрыла количество активных параметров, вы не можете даже оценить пропускную способность, которую обеспечили бы эти расходы. Для почти любой команды самостоятельный хостинг флагманской модели — не реальный вариант.

Что делает Qwen3.8-27B — анонсированный одновременно с флагманом, также выпускаемый с открытыми весами и, по сообщениям, требующий ~17 ГБ видеопамяти — более важным на практике релизом. Если причина, по которой вы предпочитаете Qwen, а не Fable 5, — локализация данных или контроль над локальной инфраструктурой, а не сырая производительность, то 27B — это модель, которая действительно это обеспечивает. Сравнение флагмана на 2.4T с Fable 5 по открытости — по большей части теоретическое; сравнение 27B по открытости — конкретное.

Часто задаваемые вопросы

Qwen 3.8 лучше, чем Claude Fable 5?

Не на основе существующих доказательств. Таблица бенчмарков GA от Alibaba сильна (GPQA Diamond 92.6, Terminal-Bench 2.1 86.6), но каждая цифра — самоотчётная, и ни один независимый оценщик не оценивал модель. Fable 5 имеет аудированный ~60 Intelligence Index (#1) и 95.0% SWE-bench Verified. Fable 5 лидирует по доказательствам; Qwen 3.8 с огромным отрывом лидирует по цене.

Верно ли утверждение «уступает только Fable 5»?

Это остается собственной позицией Alibaba. GA представила сравнительную таблицу, но не стороннюю проверку — Artificial Analysis и LMArena по-прежнему не имеют оценок. Для справки: предшественник Qwen3.7-Max набрал 46 баллов по индексу интеллекта AA против ~60 у Fable 5, поэтому утверждение требует очень большого скачка между поколениями, чтобы быть буквально верным.

Насколько Qwen 3.8 дешевле, чем Fable 5?

Существенно, и теперь это реальная ставка, а не скидка. Qwen3.8-Max стоит $2 / $6 за 1M токенов против $10 / $50 у Fable 5 — примерно в 5× дешевле на входе и в 8× на выходе. Ставка Qwen также одинакова для всего контекста в 1M, а кэшированный ввод по $0,25/1M делает повторные контекстные нагрузки ещё дешевле.

Qwen 3.8 Max вышла из предварительной версии?

Да. Он вышел в общий доступ 3 августа 2026 года с опубликованным прайс-листом и конечной точкой, совместимой с OpenAI и DashScope. Рекламная кампания с кредитами Qoder и описание предварительной версии со скидкой 90%, распространявшиеся в июле, больше не отражают, как продаётся эта модель.

Qwen 3.8 всё ещё самая медленная модель, как говорили в ранних обзорах?

Этот вывод был получен от одного рецензента на предварительной инфраструктуре, выполнявшей часовые агентские сборки, и его следует перепроверить на GA-обслуживании, а не рассматривать как текущий факт. Телеметрия OrcaRouter за 7 дней показывает p50 времени до первого токена, равный 1,64 секунды, хотя это измеряет задержку до первого токена, а не пропускную способность на очень длинных сборках.

Могу ли я разместить Qwen 3.8 на собственном сервере вместо того, чтобы платить за Fable 5?

{{1}}Пока нет, и, вероятно, не флагман.{{/1}} {{2}}Веса обещают в течение недели, но лицензии всё ещё нет;{{/2}} {{3}}а при ~1,2 ТБ в 4-битном формате понадобилось бы восемь или более GPU класса H200.{{/3}} {{4}}Одновременно анонсированная Qwen3.8-27B с ~17 ГБ видеопамяти — реалистичный путь для самохостинга.{{/4}} {{5}}Fable 5 закрыта навсегда.{{/5}}

Что мне использовать сегодня?

Fable 5 — для работы, где неверный ответ дорого обходится и требуется проверяемая надёжность: сложные рассуждения, ответственные производственные сценарии. Qwen3.8-Max — для высокообъёмных задач, где преимущество 8× по цене за выходные данные даёт накопительный эффект: массовое ревью кода, анализ длинных документов, всё, где допустима сверка. Многим командам стоит запускать обе модели и маршрутизировать запросы по ценности задачи.

Суть

Qwen 3.8 против Claude Fable 5 — это принципиально иное сравнение, чем две недели назад. Qwen3.8-Max больше не является предварительной версией с купоном — это общедоступная модель с тарифной сеткой, которая на 5× дешевле Fable 5 по входу и на 8× по выходу, с фиксированной ценой на миллион токенов, самостоятельно заявленными показателями, которые выглядят как у передовых моделей, и скачком в программировании по сравнению с предшественником, который был бы примечательным, если он подтвердится.

Но Fable 5 сохраняет корону — и ровно по той же причине, по которой сохраняла её в июле: это сторона, у которой есть судья. Аудированный #1 Intelligence Index и 95.0% SWE-bench Verified — это утверждения, проверенные кем-то другим. Таблица Alibaba, какой бы сильной она ни была, принадлежит Alibaba. Следите за двумя событиями: первым независимым результатом Intelligence Index для Qwen3.8-Max и выходом весов с прикреплённой лицензией. Если оба события будут в пользу Qwen, «уступает только Fable 5» перестанет быть маркетингом. А пока разумный ответ — не выбирать победителя, а разделить по ставкам: Fable там, где нельзя ошибаться, Qwen там, где нельзя позволить себе дорого, — и проверить обе на своих собственных промптах.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

Свяжитесь с нами

Присоединяйтесь к сообществу

DiscordEmailXGitHubYouTube