
Qwen 4 Max против Claude Opus 5: бенчмарк, который сдвинулся под ними обоими
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max был впервые представлен на конференции Yunqi в Ханчжоу 22 сентября 2026 года — это флагманский уровень линейки Qwen 4 из четырёх моделей, которая анонсирована, но ещё не выпущена, без цены, без контекстного окна и без опубликованных оценок. Claude Opus 5 общедоступен с 24 июля 2026 года по цене $5.00 за миллион входных токенов и $25.00 за миллион выходных токенов, и именно на него были нацелены все флагманы после выпуска Qwen3.8-Max. Очевидный способ написать это сравнение — таблица характеристик с одним пустым столбцом. Полезный способ — заметить, что 19 сентября 2026 года, за три дня до анонса, Artificial Analysis пересчитала свой Intelligence Index, и Claude Opus 5 перестал быть моделью на его вершине. Это единственное изменение меняет рамку того, что Qwen 4 Max должен превзойти.
Что изменилось 19 сентября
Artificial Analysis опубликовала ревизию индекса v4.3.2 19 сентября 2026 года. В текущей ревизии Claude Opus 5 набирает 51 балл по Intelligence Index при максимальном уровне рассуждений — 50 при xhigh, 48 при high, 45 при medium и 39 при low — и уступает Claude Fable 5.1 и GPT-6 Astra, у обоих 53. Стоимость за задачу в этом индексе составляет $5.86.
Если это выглядит как понижение, то это не понижение. Модель не менялась. Изменился индекс. В наших собственных материалах за июль и август Claude Opus 5 указывался с 61–63 баллами и на вершине таблицы, и эти числа были верны с учётом действовавших на тот момент пересмотров. Любой, кто всё ещё цитирует их без даты пересмотра, цитирует устаревший показатель, и это самая распространённая ошибка в сравнениях, написанных в этом месяце. Практическое следствие: утверждение вроде «Claude Opus 5 — модель с наивысшим результатом из доступных» больше не верно, и сравнение, построенное на нём, рассыпается.
Для Qwen последствия ещё острее. Флагманский уровень, анонсированный в сентябре 2026 года, нацелен на ориентир, который был переопределён в сентябре 2026 года. Что бы Alibaba в итоге ни опубликовала для Qwen 4 Max, это будут оценивать по таблице лидеров, где превзойти нужно 53, а не 63.

Сравнение, честно говоря
Одна сторона этой таблицы заполнена, а другая пуста, и делать вид, что это не так, означало бы в точности провалить всю эту статью. Вот что на самом деле известно:
• Статус — Claude Opus 5 в общем доступе с 24 июля 2026 года, тогда как Qwen 4 Max была анонсирована 22 сентября 2026 года без даты выпуска
• Цена входных данных — Claude Opus 5 $5.00 за 1 млн токенов, тогда как у Qwen 4 Max не опубликована
• Цена за выходные токены — Claude Opus 5: $25.00 за 1 млн токенов, тогда как у Qwen 4 Max она не опубликована
• Кэшированный ввод — Claude Opus 5 $0,50 за 1 млн токенов при чтении из кэша, тогда как для Qwen 4 Max цена не опубликована
• Контекст — Claude Opus 5: 1M токенов по умолчанию и как максимум, тогда как у Qwen 4 Max не опубликовано
• Ограничение вывода — Claude Opus 5: 128K токенов синхронно и 300K в Batches API с бета-заголовком, тогда как у Qwen 4 Max это не опубликовано
• Модальность — Claude Opus 5: ввод текста, изображений и файлов с выводом текста, в сравнении с Qwen 4 Max — не опубликована
• Ценообразование для длинного контекста — у Claude Opus 5 нет надбавки, поэтому запрос на 900 000 токенов тарифицируется по той же цене за токен, что и запрос на 9 000 токенов, тогда как для Qwen 4 Max она не опубликована
• Независимая оценка — Claude Opus 5: 51 в Artificial Analysis Intelligence Index v4.3.2 при максимальном усилии, тогда как для Qwen 4 Max независимой оценки не существует
• Оценки, заявленные производителем, — Claude Opus 5 SWE-bench Verified 96,0 %, SWE-bench Pro 79,2 %, OSWorld 2.0 70,6 %, Terminal-Bench 2.1 — около 85 % в зависимости от харнесса, тогда как по Qwen 4 Max ничего не сообщается
• Управление рассуждениями — адаптивное мышление Claude Opus 5 включено по умолчанию с пятиступенчатой шкалой усилий, а у Qwen 4 Max это не опубликовано
Десять строк «не опубликовано» — это не риторический приём. Это состояние доказательств, и честный вывод из него состоит в том, что пока никто не может провести сравнение возможностей этих двух моделей.
Та часть разрыва, которая не закроется
Цены и контекст в конечном итоге будут опубликованы. Одно различие сохранится и после релиза, и об этом стоит решить сейчас, а не на неделе, когда выйдет Qwen 4 Max: две модели созданы для разных способов покупки.
Claude Opus 5 — это одна закрытая модель по единой цене от единственного поставщика, с опубликованным обязательством о выводе из эксплуатации не ранее 24 июля 2027 года. Это стабильный ориентир для планирования мощностей. Qwen 4 Max — флагман семейства, которое Alibaba неоднократно выпускала в гораздо более широком ценовом диапазоне — поколение Qwen 3.8 охватывает флагман переднего края по цене $2.00 за вход и уровень Flash, значительно ниже его, — и флагманский уровень линейки Qwen исторически был тем, у которого самый короткий срок полезной жизни, прежде чем более дешёвый уровень сократит разрыв с ним.
Второе различие — открытые веса, и оно указывает в противоположную сторону. Поколение Qwen 3.8 опубликовало веса своей крупнейшей модели под собственной лицензией Qwen — именно это и делает в принципе возможными дообучение, квантизацию и самохостинг. У Claude Opus 5 веса не открыты и не будут. Если вашей рабочей нагрузке нужна модель, которую можно запускать внутри собственного периметра или дорабатывать, это структурное преимущество, которого не отнимет у Alibaba никакая ревизия бенчмарков, — и это самая веская причина обратить внимание именно на это сравнение, а не воспринимать его как противостояние одного флагмана с другим.

Как запустить это сравнение сегодня
Claude Opus 5 уже доступен, и OrcaRouter маршрутизирует его как anthropic/claude-opus-5 по каталожной цене Anthropic с наценкой 0% — тариф провайдера передаётся без изменений, поэтому указанные выше суммы $5.00 и $25.00 — это именно то, что с вас списывают, а не эквивалент с наценкой. Для модели в этом ценовом диапазоне это значит больше, чем обычно: 10-процентная маржа платформы при цене вывода $25.00 составляет $2.50 за миллион токенов — больше, чем вся стоимость ввода у большинства открытых альтернатив. Наряду с ним каталог предлагает около 200 моделей на одной конечной точке, совместимой с OpenAI, с автоматическим переключением при сбое, когда маршрут провайдера деградирует, и DSL маршрутизации, позволяющим явно выразить политику вместо жёсткого прописывания имени модели в вашем приложении.
Чего OrcaRouter не содержит, так это Qwen 4 Max или любого представителя линейки Qwen 4. В каталоге нет ни одной записи для этого семейства, что вполне ожидаемо для модели, о которой объявили, но которую не выпустили. Когда эти версии всё же появятся, они будут в том же месте, а до тех пор модель Qwen, которую стоит сравнивать с Claude Opus 5, — это та, которую вы действительно можете вызвать: Qwen3.8-Max, общедоступная с 3 августа 2026 года по цене $2,00 за входные и $6,00 за выходные данные за миллион токенов, с опубликованными весами и зафиксированной независимой оценкой интеллекта 56 при $1,14 за задачу — показатель, полученный в рамках более ранней редакции индекса, так что сравнивайте его с 51 у Claude Opus 5 только с этой оговоркой.
Что делать с этим до появления карточки модели
Здесь нечего выносить вердикт, потому что одна из двух моделей не существует как продукт. Можно сказать, что сравнение изменило форму 19 сентября 2026 года, при этом ни один из поставщиков ничего не делал: Claude Opus 5 больше не является моделью с самым высоким рейтингом в независимом индексе, на который опирается большинство сравнений, и теперь он отстаёт на два балла от двух других моделей. Запуск Qwen 4 Max попадёт в эту таблицу, а не в ту, что была в июле.
Итак, выбор на ближайшие несколько месяцев — это не Qwen 4 Max против Claude Opus 5. Это Claude Opus 5 против уже выпущенной модели Qwen — флагмана с ценой за входные данные в пять раз ниже и опубликованными весами — и это сравнение доступно уже сейчас, с реальными цифрами с обеих сторон. Вернитесь к нему, когда Alibaba опубликует карточку модели, а любую таблицу бенчмарков Qwen 4 Max, которую вы увидите до этого, считайте непроверенной.

Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
