Титульная карточка hero для «Qwen 4 Max против Claude Opus 5» с подзаголовком «Бенчмарк, который сдвинулся под обоими», тремя бейджами-пилюлями с надписями «Ревизия индекса v4.3.2», «51 против 53» и «$5.00 и $25.00», и логотип OrcaRouter в правом нижнем углу.
Engineering & Research

Qwen 4 Max против Claude Opus 5: бенчмарк, который сдвинулся под ними обоими

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Qwen 4 Max был впервые представлен на конференции Yunqi в Ханчжоу 22 сентября 2026 года — это флагманский уровень линейки Qwen 4 из четырёх моделей, которая анонсирована, но ещё не выпущена, без цены, без контекстного окна и без опубликованных оценок. Claude Opus 5 общедоступен с 24 июля 2026 года по цене $5.00 за миллион входных токенов и $25.00 за миллион выходных токенов, и именно на него были нацелены все флагманы после выпуска Qwen3.8-Max. Очевидный способ написать это сравнение — таблица характеристик с одним пустым столбцом. Полезный способ — заметить, что 19 сентября 2026 года, за три дня до анонса, Artificial Analysis пересчитала свой Intelligence Index, и Claude Opus 5 перестал быть моделью на его вершине. Это единственное изменение меняет рамку того, что Qwen 4 Max должен превзойти.

Что изменилось 19 сентября

Artificial Analysis опубликовала ревизию индекса v4.3.2 19 сентября 2026 года. В текущей ревизии Claude Opus 5 набирает 51 балл по Intelligence Index при максимальном уровне рассуждений — 50 при xhigh, 48 при high, 45 при medium и 39 при low — и уступает Claude Fable 5.1 и GPT-6 Astra, у обоих 53. Стоимость за задачу в этом индексе составляет $5.86.

Если это выглядит как понижение, то это не понижение. Модель не менялась. Изменился индекс. В наших собственных материалах за июль и август Claude Opus 5 указывался с 61–63 баллами и на вершине таблицы, и эти числа были верны с учётом действовавших на тот момент пересмотров. Любой, кто всё ещё цитирует их без даты пересмотра, цитирует устаревший показатель, и это самая распространённая ошибка в сравнениях, написанных в этом месяце. Практическое следствие: утверждение вроде «Claude Opus 5 — модель с наивысшим результатом из доступных» больше не верно, и сравнение, построенное на нём, рассыпается.

Для Qwen последствия ещё острее. Флагманский уровень, анонсированный в сентябре 2026 года, нацелен на ориентир, который был переопределён в сентябре 2026 года. Что бы Alibaba в итоге ни опубликовала для Qwen 4 Max, это будут оценивать по таблице лидеров, где превзойти нужно 53, а не 63.

A two-column scoreboard titled "Qwen 4 Max vs Claude Opus 5 - the scoreboard". Left column Qwen 4 Max: Status announced, no date; Input price not published; Output price not published; Context window not published; Independent score none exists; Open weights not published. Right column Claude Opus 5: Status generally available; Input price $5.00 per 1M tokens; Output price $25.00 per 1M tokens; Context window 1M tokens; Independent score 51 on index v4.3.2; Open weights none. Footer reads "Claude Opus 5 from Anthropic published pricing and Artificial Analysis index v4.3.2, September 19 2026.", with the OrcaRouter logo bottom-right.

Сравнение, честно говоря

Одна сторона этой таблицы заполнена, а другая пуста, и делать вид, что это не так, означало бы в точности провалить всю эту статью. Вот что на самом деле известно:

• Статус — Claude Opus 5 в общем доступе с 24 июля 2026 года, тогда как Qwen 4 Max была анонсирована 22 сентября 2026 года без даты выпуска

• Цена входных данных — Claude Opus 5 $5.00 за 1 млн токенов, тогда как у Qwen 4 Max не опубликована

• Цена за выходные токены — Claude Opus 5: $25.00 за 1 млн токенов, тогда как у Qwen 4 Max она не опубликована

• Кэшированный ввод — Claude Opus 5 $0,50 за 1 млн токенов при чтении из кэша, тогда как для Qwen 4 Max цена не опубликована

• Контекст — Claude Opus 5: 1M токенов по умолчанию и как максимум, тогда как у Qwen 4 Max не опубликовано

• Ограничение вывода — Claude Opus 5: 128K токенов синхронно и 300K в Batches API с бета-заголовком, тогда как у Qwen 4 Max это не опубликовано

• Модальность — Claude Opus 5: ввод текста, изображений и файлов с выводом текста, в сравнении с Qwen 4 Max — не опубликована

• Ценообразование для длинного контекста — у Claude Opus 5 нет надбавки, поэтому запрос на 900 000 токенов тарифицируется по той же цене за токен, что и запрос на 9 000 токенов, тогда как для Qwen 4 Max она не опубликована

• Независимая оценка — Claude Opus 5: 51 в Artificial Analysis Intelligence Index v4.3.2 при максимальном усилии, тогда как для Qwen 4 Max независимой оценки не существует

• Оценки, заявленные производителем, — Claude Opus 5 SWE-bench Verified 96,0 %, SWE-bench Pro 79,2 %, OSWorld 2.0 70,6 %, Terminal-Bench 2.1 — около 85 % в зависимости от харнесса, тогда как по Qwen 4 Max ничего не сообщается

• Управление рассуждениями — адаптивное мышление Claude Opus 5 включено по умолчанию с пятиступенчатой шкалой усилий, а у Qwen 4 Max это не опубликовано

Десять строк «не опубликовано» — это не риторический приём. Это состояние доказательств, и честный вывод из него состоит в том, что пока никто не может провести сравнение возможностей этих двух моделей.

Та часть разрыва, которая не закроется

Цены и контекст в конечном итоге будут опубликованы. Одно различие сохранится и после релиза, и об этом стоит решить сейчас, а не на неделе, когда выйдет Qwen 4 Max: две модели созданы для разных способов покупки.

Claude Opus 5 — это одна закрытая модель по единой цене от единственного поставщика, с опубликованным обязательством о выводе из эксплуатации не ранее 24 июля 2027 года. Это стабильный ориентир для планирования мощностей. Qwen 4 Max — флагман семейства, которое Alibaba неоднократно выпускала в гораздо более широком ценовом диапазоне — поколение Qwen 3.8 охватывает флагман переднего края по цене $2.00 за вход и уровень Flash, значительно ниже его, — и флагманский уровень линейки Qwen исторически был тем, у которого самый короткий срок полезной жизни, прежде чем более дешёвый уровень сократит разрыв с ним.

Второе различие — открытые веса, и оно указывает в противоположную сторону. Поколение Qwen 3.8 опубликовало веса своей крупнейшей модели под собственной лицензией Qwen — именно это и делает в принципе возможными дообучение, квантизацию и самохостинг. У Claude Opus 5 веса не открыты и не будут. Если вашей рабочей нагрузке нужна модель, которую можно запускать внутри собственного периметра или дорабатывать, это структурное преимущество, которого не отнимет у Alibaba никакая ревизия бенчмарков, — и это самая веская причина обратить внимание именно на это сравнение, а не воспринимать его как противостояние одного флагмана с другим.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, English UI), showing the 1M token context badge, the model ID anthropic/claude-opus-5, a 128K maximum output, text plus image plus file input with text output, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24 credited to Anthropic, a p50 time-to-first-token of 5.75s, the OpenAI-compatible code sample, the Public benchmarks block, and the opening of the model description calling Claude Opus 5 Anthropic flagship for demanding reasoning, coding and long-horizon agentic work.

Как запустить это сравнение сегодня

Claude Opus 5 уже доступен, и OrcaRouter маршрутизирует его как anthropic/claude-opus-5 по каталожной цене Anthropic с наценкой 0% — тариф провайдера передаётся без изменений, поэтому указанные выше суммы $5.00 и $25.00 — это именно то, что с вас списывают, а не эквивалент с наценкой. Для модели в этом ценовом диапазоне это значит больше, чем обычно: 10-процентная маржа платформы при цене вывода $25.00 составляет $2.50 за миллион токенов — больше, чем вся стоимость ввода у большинства открытых альтернатив. Наряду с ним каталог предлагает около 200 моделей на одной конечной точке, совместимой с OpenAI, с автоматическим переключением при сбое, когда маршрут провайдера деградирует, и DSL маршрутизации, позволяющим явно выразить политику вместо жёсткого прописывания имени модели в вашем приложении.

Чего OrcaRouter не содержит, так это Qwen 4 Max или любого представителя линейки Qwen 4. В каталоге нет ни одной записи для этого семейства, что вполне ожидаемо для модели, о которой объявили, но которую не выпустили. Когда эти версии всё же появятся, они будут в том же месте, а до тех пор модель Qwen, которую стоит сравнивать с Claude Opus 5, — это та, которую вы действительно можете вызвать: Qwen3.8-Max, общедоступная с 3 августа 2026 года по цене $2,00 за входные и $6,00 за выходные данные за миллион токенов, с опубликованными весами и зафиксированной независимой оценкой интеллекта 56 при $1,14 за задачу — показатель, полученный в рамках более ранней редакции индекса, так что сравнивайте его с 51 у Claude Opus 5 только с этой оговоркой.

Что делать с этим до появления карточки модели

Здесь нечего выносить вердикт, потому что одна из двух моделей не существует как продукт. Можно сказать, что сравнение изменило форму 19 сентября 2026 года, при этом ни один из поставщиков ничего не делал: Claude Opus 5 больше не является моделью с самым высоким рейтингом в независимом индексе, на который опирается большинство сравнений, и теперь он отстаёт на два балла от двух других моделей. Запуск Qwen 4 Max попадёт в эту таблицу, а не в ту, что была в июле.

Итак, выбор на ближайшие несколько месяцев — это не Qwen 4 Max против Claude Opus 5. Это Claude Opus 5 против уже выпущенной модели Qwen — флагмана с ценой за входные данные в пять раз ниже и опубликованными весами — и это сравнение доступно уже сейчас, с реальными цифрами с обеих сторон. Вернитесь к нему, когда Alibaba опубликует карточку модели, а любую таблицу бенчмарков Qwen 4 Max, которую вы увидите до этого, считайте непроверенной.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the OpenAI-compatible Python code sample, and the model description naming Qwen3.8-Max Alibaba newest flagship and highest-capability tier to date.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube