Qwen 3.8 против Claude Fable 5: сборка 0902 лидирует в написании кода
Guides & Insights

Qwen 3.8 против Claude Fable 5: сборка 0902 лидирует в написании кода

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Когда Alibaba представила Qwen3.8-Max в Шанхае 19 июля 2026 года, она сделала одно заявление громче любого другого: эта модель с 2,4 триллиона параметров близка к уровню передовых и уступает только Claude Fable 5. Тогда это невозможно было оценить: не было ни тарифной сетки, ни таблицы бенчмарков, ни лицензии — просто позиционирование.

3 августа 2026 года Qwen3.8-Max стала общедоступной — с настоящим прайс-листом: $2 / $6 за миллион токенов, таблицей бенчмарков с цифрами и endpoint, совместимым с OpenAI и DashScope. 2 сентября Alibaba выпустила следующий шаг, не меняя номер версии: Qwen3.8-Max-0902 — посттренировочное обновление, нацеленное на программирование и агентные задачи, которое дебютировало на первом месте в лидерборде Code Arena: WebDev с результатом 1691 Elo. Claude Fable 5, модель, позади которой Alibaba весь июль себя позиционировала, находится на том же лидерборде с результатом 1628. Вопрос июля стал острее: по-прежнему ли Qwen 3.8 «уступает только Fable 5» — или ось программирования уже перевернулась?

Заметка для разработчиков — самый быстрый способ урегулировать такой спор — запустить обе модели на своих собственных промптах. OrcaRouter предоставляет доступ к более чем 200 моделям через единую OpenAI-совместимую конечную точку, так что вы можете сравнить Qwen 3.8 Max с Fable 5 на одной и той же задаче без подключения двух SDK.

Краткий вердикт. Qwen3.8-Max-0902 — самая мощная на сегодняшний день сборка флагмана Alibaba с 2,4 трлн параметров, и новый довод в её пользу больше не исходит только от самой Alibaba: модель дебютировала на #1 в независимом рейтинге Code Arena: WebDev с результатом 1 691 Elo, опередив Claude Fable 5 (1 628, #8) в этой таблице. Цена не изменилась и по-прежнему имеет решающее значение: при фиксированных тарифах $2 / $6 за 1 млн токенов Qwen стоит дешевле Fable 5 ($10 / $50) примерно в 5 раз по входным токенам и в 8 раз по выходным. Что не сократилось, так это разрыв в универсальности: Artificial Analysis оценивает Qwen3.8-Max в 56 баллов по индексу интеллекта против 62 у Claude Fable 5, а в общем рейтинге Arena за последнюю опубликованную неделю (24–30 августа) Fable 5 удерживает #1 (1 508 Elo), тогда как Qwen3.8-Max занимает #20 (1 479). Итак, два вердикта: в написании кода у обновления 0902 от Qwen теперь есть и независимый рефери, и победа; на широком спектре проверенных задач на рассуждение лидерство по-прежнему удерживают и Claude Fable 5, и более новая модель Anthropic Claude Fable 5.1, возглавляющая индекс AA с 66 баллами.

Основные выводы

Qwen3.8-Max вышел в GA 3 августа 2026 года, а его обновление 0902 последовало 2 сентября — номер версии не изменился: та же тарифная сетка $2 / $6 и тот же контекст на 1 млн токенов.

Разрыв в ценах огромен: Qwen — $2 / $6 за 1M против $10 / $50 у Fable 5. Это примерно ~5× на входе и ~8× на выходе, причём тариф Qwen одинаков для всего контекста в 1M токенов, без надбавки за длинные промпты.

Теперь у обеих сторон есть независимые показатели — и они указывают в разных направлениях. Qwen3.8-Max набирает 56 баллов по Artificial Analysis Intelligence Index (Claude Fable 5: 62), а его сборка 0902 занимает первое место в Code Arena: WebDev с 1 691 Elo против 1 628 у Fable 5.

Собственная таблица бенчмарков Qwen по-прежнему сильна и по-прежнему подготовлена вендором. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — но обновление от 2 сентября — первый результат Qwen, который независимая арена поставила на первое место.

Пробел в спецификации, касающийся архитектуры, закрыт. Qwen3.8-2.4T-A95B — ~95B активных параметров из 2.4T общих, распределённых по 512 экспертам; данная информация была раскрыта в релизе открытых весов от 12 августа. Архитектура Fable 5 остаётся нераскрытой.

Открытые веса выпущены, а не обещаны. Qwen3.8-2.4T-A95B (BF16 и FP8) появилась на Hugging Face и ModelScope 12 августа под специальной лицензией Qwen3.8-Max, а Qwen3.8-27B вышла следом 14 августа под Apache 2.0. Fable 5 закрыта и доступна только через API, навсегда.

Примечание о точности: цифры из собственной бенчмарк-таблицы Alibaba остаются данными вендора и не были независимо воспроизведены. Приведённые здесь независимые показатели имеют временные метки и получены от третьих сторон: индекс Artificial Analysis Intelligence (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), рейтинг Code Arena: WebDev Elo и еженедельная таблица Arena. Рейтинги Arena меняются по мере накопления голосов, а позиция №1 сборки 0902 соответствует заявлению Alibaba о списке на конкретный момент времени. Показатель Fable 5 — 95,0% SWE-bench Verified — приведён Anthropic; цены Qwen взяты из прайс-листа GA Alibaba Model Studio.

Характеристики и цена, бок о бок

Вот конкретные данные, каждая цифра привязана к своему источнику.

• Производитель / статус — Qwen3.8-Max: Alibaba; GA — 3 августа 2026 г.; обновление 0902 — 2 сентября 2026 г. Claude Fable 5: Anthropic; GA, флагманская модель.

• Архитектура — Qwen3.8-Max: 2,4 трлн всего / ~95 млрд активных, разреженная MoE, 512 экспертов (раскрыто 12 августа); Fable 5: не раскрыто

• Контекстное окно — Qwen3.8-Max: 1M токенов (983,616 с мышлением; максимальный вывод 131,072); Fable 5: флагман длинного контекста

• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1 сент.): 66, лидирует

• SWE-bench Verified — Qwen3.8-Max: Не сообщается (Alibaba вместо этого сообщает о FrontierSWE 73.5); Fable 5: 95.0% (Anthropic / buildfastwithai)

• Независимые + заявленные вендором сильные стороны — Qwen3.8-Max: Code Arena WebDev #1 с результатом 1,691 (0902, независимый); таблица вендора: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%

• Цены (вход / выход) — Qwen3.8-Max: $2.00 / $6.00 за 1 млн, фиксированная цена для контекста в 1 млн; кэшированный ввод $0.25; Fable 5: $10 / $50 за 1 млн

• Открытые веса — Qwen3.8-Max: выпущен 12 августа 2026 (специальная лицензия, не Apache); Qwen3.8-27B — под Apache 2.0, 14 августа. Fable 5: нет — закрытая / только API.

• Мультимодальность — Qwen3.8-Max: текст, изображение, видео на входе → текст на выходе; Fable 5: мультимодальный флагман

Два обстоятельства определяют всё сравнение. Первое изменилось 3 августа и по-прежнему в силе; второе снова изменилось 2 сентября.

Во-первых, колонка цен теперь — самое заметное на странице. В июле ценовое преимущество Qwen выглядело как купон на скидку — 90% скидки на кредиты, временно, без тарифа за токен, на который можно было бы ориентироваться. Теперь это тарифная сетка, и разрыв носит структурный, а не рекламный характер. При $6 за вывод против $50 у Fable вы можете выполнить примерно восемь запросов к Qwen по цене одного запроса к Fable. Для любой нагрузки, где вы платите за объём, а не за единственный самый сложный ответ, это соотношение меняет архитектуру того, что вы строите.

Во-вторых, колонка бенчмарков перестала быть односторонней. Почти весь август честная оценка была ограниченной: Alibaba сообщила о FrontierSWE 73,5 и таблице собственных прогонов, Anthropic сообщила о сторонне проверенном результате 95,0% в SWE-bench Verified, а Qwen не был оценён ни одним независимым оценщиком. Сборка 0902 положила этому конец. Code Arena: WebDev — это арена со слепым попарным голосованием людей, проект, ранее известный как WebDev Arena, которым никто из Alibaba не управляет, — и Qwen3.8-Max-0902 вошла в неё на #1 с 1 691 Elo, обойдя Claude Opus 5 (1 688), Kimi K3 (1 674) и Claude Fable 5 (1 628, #8). Эту честность поддерживают две оговорки: это лишь одна доска, измеряющая агентную front-end разработку, а не общие способности, и «дебют на #1» — это объявление Alibaba о позиции на конкретный момент времени. Но утверждение, что у Qwen вообще нет судьи, больше не соответствует действительности, и это меняет сравнение сильнее, чем любое отдельное число на ней.

Что на самом деле дает разница в цене

Абстрактные множественные примеры менее полезны, чем разобранный пример, поэтому вот один. Возьмём агента проверки кода, который отправляет 150 000 токенов контекста репозитория и генерирует 6 000 токенов ревью за один вызов.

Qwen3.8-Max: 0.15M × $2 = $0.30, плюс 0.006M × $6 = $0.036. ≈ $0.34 за вызов.

Claude Fable 5: 0.15M × $10 = $1.50, плюс 0.006M × $50 = $0.30. ≈ $1.80 за вызов.

• При 2 000 вызовов в день: Qwen ≈ $672 в день; Fable ≈ $3 600 в день. За месяц это примерно $20 000 против $108 000.

• Благодаря кэшированию промптов в стабильном контексте репозитория, кэшированный ввод Qwen по цене $0.25/1M снижает стоимость ввода с $0.30 до менее $0.04, доводя вызов до ≈ $0.08 — примерно в 22 раза дешевле Fable за вызов.

Это не незначительная экономия; это разница между запуском ревьюера на каждом pull request и запуском его только на рискованных. А фиксированная ставка за контекст у Qwen усиливает этот эффект по мере роста промптов: поскольку Alibaba не применяет надбавку за длинные промпты, прогон контекста в 900 000 токенов стоит столько же за токен, как и контекст в 5 000 токенов.

Честным противовесом является то, что цена за токен — это не цена за решенную задачу. Если Fable 5 решает проблему за один проход, тогда как более дешевая модель требует трех попыток плюс исправление человеком, более дешевая модель в сумме может обойтись дороже — и на самых сложных задачах на рассуждение подтвержденный аудитом рейтинг №1 Fable является лучшим доступным доказательством того, что она действительно решает больше за один проход. Аргумент о стоимости для Qwen наиболее силен для высокообъемных некритичных рабочих нагрузок и наиболее слаб для низкообъемных с высокими ставками.

Наименование 0902: возможности выросли, номер версии — нет.

Примечательная особенность 2 сентября заключается в том, чего Alibaba не сделала: не выпустила Qwen 3.9. Улучшение вышло как датированный контрольный снимок под тем же названием модели — Qwen3.8-Max-0902 — и API предоставляло её под тем же именем и по той же цене. Именно в этом направлении движется индустрия: когда скачок возможностей больше не гарантирует новый номер версии, вопрос «какую модель мне использовать» становится вопросом о сборках и датах, а не только о названиях семейств.

Это также означает, что результат бенчмарка, привязанный к «Qwen3.8-Max», имеет срок годности: оценка, полученная на сборке за июль или август, может не соответствовать модели, которую API возвращает сегодня. Проверьте идентификатор сборки на том эндпоинте, который вы на самом деле вызываете, — номер 0902 — это разница между моделью, которая отставала от Claude Fable 5, и моделью, которая опережает её в Code Arena: WebDev.

Доказательство, и почему оно по-прежнему решает этот матч.

Наиболее цитируемые практические доказательства возможностей Qwen3.8-Max взяты из обзора эпохи предварительного доступа (thomas-wiegold.com), в котором модель прогнали через четыре реальных сборки. Результаты были действительно впечатляющими: Qwen с первой попытки справилась с симуляцией покера на Go — лишь третья модель в истории, прошедшая этот промпт за один проход, наряду с Fable 5 и Grok 4.5, — а на промпте для сайта обжарщика кофе она выдала лучший результат, который рецензент когда-либо видел в этом тесте, добавив из чистой дотошности незапрошенные корзину для покупок, оптовый раздел и интеграцию с Instagram.

Загвоздка была в скорости: 30+ минут на сайте и 1 час 20 минут на симуляции покера, что делало эту модель самой медленной из всех, которые рецензент использовал. Этот результат теперь нуждается в оговорке, которой в июле не требовалось. Он был измерен на предварительной инфраструктуре, одним рецензентом, при необычно длинных агентских прогонах. GA-обслуживание — это другая система. Для справки, собственная 7-дневная телеметрия OrcaRouter в настоящее время показывает p50 времени до первого токена 1,64 секунды для Qwen3.8-Max — собственное измерение, хотя TTFT и сквозная пропускная способность при часовых сборках — разные величины. Честная позиция состоит в том, что вывод о медленной работе предварительной версии следует перепроверить, а не повторять как актуальный факт.

После обновления 0902 неизменным остаётся то, что самые сильные аргументы каждой стороны по-прежнему исходят из разных источников. Первое место Qwen3.8-Max-0902 в Code Arena: WebDev — это независимый результат слепого голосования, но он оценивает лишь одну таблицу лидеров, а собственная бенчмарк-таблица Alibaba остаётся артефактом вендора: лаборатории сами выбирают, какие бенчмарки публиковать. Самый слабый из заявленных Alibaba показателей (IFBench 82.8, следование инструкциям) по-прежнему согласуется с претензией к предварительной версии о том, что модель делает слишком много и игнорирует границы задачи. Доказательства Claude Fable 5 шире и по большей части независимы: 62 в индексе интеллекта AA, #1 в общей таблице Arena, 95.0% SWE-bench Verified — при этом более новая собственная модель Anthropic, Claude Fable 5.1, удерживает лидерство в индексе AA на уровне 66 с 1 сентября. На вопрос «какая модель справится с работой, в которой нельзя допустить ошибку», универсальный ответ не изменился. На вопрос «какая модель выдаёт лучший фронтенд за десятую часть цены», ответ сменился 2 сентября.

Открытость: на этой оси Qwen уже победил

Fable 5 никогда не будет доступна для самостоятельного развертывания. Qwen3.8-Max уже является таковой: 12 августа веса для Qwen3.8-2.4T-A95B — BF16 и официальный вариант FP8 — появились на Hugging Face и ModelScope, что сделало её первой Qwen класса Max, которую любой может скачать. Две оговорки заслуживают равного внимания.

Первый вариант легален. Релиз выпускается под собственной лицензией «Qwen3.8-Max», а не Apache 2.0: провайдеры, ведущие бизнес в сфере model-as-a-service или ИИ-ассистентов для рабочих задач, с выручкой за последние 12 месяцев свыше 50 млн долларов, обязаны заключить с Qwen отдельное лицензионное соглашение, а коммерческие продукты с более чем 100 млн активных пользователей в месяц или более 20 млн долларов месячной выручки должны отображать название модели. Для внутреннего использования и стартапов эти пороги редко имеют значение — но это не вседозволенность.

{{1}}Второй аспект — физический.{{/1}} {{2}}Модель MoE с суммарным объёмом 2,4T параметров занимает примерно 4,9 ТБ в формате BF16 (около половины — в официальном чекпоинте FP8), тогда как память одного H200 составляет около 141 ГБ — то есть для самостоятельного размещения флагманской модели потребуется целая стойка ускорителей, прежде чем вы обработаете хотя бы один токен.{{/2}} {{3}}Раскрытые ~95 млрд активных параметров как минимум позволяют оценить, что даст такая стойка.{{/3}} {{4}}Для почти любой команды практичный путь — это размещённый API по цене $2 / $6.{{/4}}

Именно поэтому Qwen3.8-27B — модель, выпуск весов которой под лицензией Apache-2.0 последовал 14 августа и которая, по сообщениям, работает в ~17 ГБ видеопамяти, — остаётся практически значимым релизом для самостоятельного развёртывания. Если причина, по которой вы предпочитаете Qwen, а не Fable 5, — это местонахождение данных или контроль on-premise, а не сырая производительность, то именно 27B действительно реализует это, — и с обеих сторон сравнение открытости больше не является теоретическим.

Часто задаваемые вопросы

Qwen 3.8 лучше, чем Claude Fable 5?

Теперь всё зависит от оси сравнения, что является настоящим изменением по сравнению с августом. В кодинге лидирует Qwen3.8-Max-0902: #1 на Code Arena: WebDev с рейтингом 1691 Elo против 1628 у Claude Fable 5, при цене $2 / $6 против $10 / $50 у Fable 5. По широкой, проверенной оценке качества по-прежнему лидирует Fable 5: 62 балла в AA Intelligence Index против 56 у Qwen, 95,0% по SWE-bench Verified и #1 на общем табло Arena. Для работы, где неверный ответ стоит дорого, Fable 5 — выбор с лучшей документацией; а для высокообъёмного кодинга и агентных веб-задач новейший Qwen одновременно дешевле и выше в рейтинге Arena.

Верно ли утверждение «уступает только Fable 5»?

Позиционирование Alibaba было сделано без независимых цифр, и сборка 0902 с тех пор изменила картину. Qwen3.8-Max-0902 опережает Claude Fable 5 на Code Arena: WebDev (1 691 против 1 628), но уступает ему по индексу AA Intelligence (56 против 62) и на общем табло Arena (Qwen #20 с Elo 1 479; Fable 5 #1 с 1 508). Таким образом, «второй после Fable 5» превратилось в «опережающий Fable 5 на той кодинговой доске, на которую было направлено это обновление, но уступающий ему на широких досках общего назначения».

Насколько Qwen 3.8 дешевле, чем Fable 5?

Существенно, и теперь это реальная ставка, а не скидка. Qwen3.8-Max стоит $2 / $6 за 1M токенов против $10 / $50 у Fable 5 — примерно в 5× дешевле на входе и в 8× на выходе. Ставка Qwen также одинакова для всего контекста в 1M, а кэшированный ввод по $0,25/1M делает повторные контекстные нагрузки ещё дешевле.

Qwen 3.8 Max вышла из предварительной версии?

Да. Он вышел в общий доступ 3 августа 2026 года с опубликованным прайс-листом и конечной точкой, совместимой с OpenAI и DashScope. Рекламная кампания с кредитами Qoder и описание предварительной версии со скидкой 90%, распространявшиеся в июле, больше не отражают, как продаётся эта модель.

Qwen 3.8 всё ещё самая медленная модель, как говорили в ранних обзорах?

Этот вывод был получен от одного рецензента на предварительной инфраструктуре, выполнявшей часовые агентские сборки, и его следует перепроверить на GA-обслуживании, а не рассматривать как текущий факт. Телеметрия OrcaRouter за 7 дней показывает p50 времени до первого токена, равный 1,64 секунды, хотя это измеряет задержку до первого токена, а не пропускную способность на очень длинных сборках.

Могу ли я разместить Qwen 3.8 на собственном сервере вместо того, чтобы платить за Fable 5?

Да, для Qwen — с оговорками. Qwen3.8-2.4T-A95B доступен для загрузки с 12 августа по специальной лицензии (не Apache 2.0), а Qwen3.8-27B — под Apache 2.0 с 14 августа. Практический барьер — аппаратное обеспечение: MoE с суммарным объёмом 2,4T требует примерно 4,9 ТБ в BF16 — целая стойка ускорителей, — поэтому большинство команд всё равно будут обращаться к хостируемому API по $2 / $6, а не запускать флагманскую модель. Fable 5 закрыт навсегда.

Что мне использовать сегодня?

Для общей работы, где неверный ответ обходится дорого, — сложные рассуждения, ответственные производственные сценарии, — Claude Fable 5 по-прежнему остаётся выбором с более полной документацией, а Claude Fable 5.1 от Anthropic расширяет это лидерство. Для высокообъёмного программирования и агентной веб-разработки Qwen3.8-Max-0902 теперь имеет независимое преимущество на арене и цену вывода примерно в 8 раз ниже: массовое ревью кода, генерация фронтенда, анализ длинных документов. Многим командам стоит использовать обе модели и распределять задачи по типу.

Суть

Qwen 3.8 против Claude Fable 5 — это уже не то сравнение, что было месяц назад, и снова не то, что было неделю назад. Qwen3.8-Max — это общедоступная модель с тарифом, который дешевле Fable 5 в 5 раз на входе и в 8 раз на выходе, без изменений на миллионе токенов — а с 2 сентября то же название обслуживает сборку 0902, которую независимая арена сейчас ставит на #1 по агентной веб-разработке, выше Fable 5 в этом рейтинге.

Теперь ни одна из моделей не владеет всем сравнением. Claude Fable 5 — а также Anthropic Claude Fable 5.1, возглавляющая индекс AA Intelligence Index с показателем 66 с 1 сентября, — удерживают широкое, проверенное, универсальное поле, а собственная бенчмарк-таблица Alibaba остаётся артефактом вендора. Но причина, по которой в июле этот матч был односторонним — у Qwen вообще не было независимого арбитра, — перестала действовать 2 сентября: Qwen3.8-Max-0902 — модель №1 в Code Arena: WebDev. Разумный ответ по-прежнему — разделять по ставкам и задачам: Fable 5 — для общих рассуждений, где ошибка стоит дорого, Qwen3.8-Max — для высокообъёмного кодинга, где и ценовой разрыв, и преимущество на арене играют в его пользу, — а также тестировать обе на своих собственных промптах.

Сравнение в этой статье3

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно