Сгенерирована hero-карточка под названием Claude Sonnet 5.5 vs Qwen 4 Max. Подзаголовок: у одной модели есть карточка, у другой — имя. Три карточки: Claude Sonnet 5.5 выпущена 2026-09-28; Qwen 4 Max — анонс без карточки модели; Qwen3.8 Max — Qwen, который можно вызвать за $2.00 / $6.00. Нижний колонтитул: Qwen 4 Max анонсировали 2026-09-22 без опубликованной цены, контекстного окна, весов или оценки.
Guides & Insights

Claude Sonnet 5.5 против Qwen 4 Max: у одной модели есть карта, у другой — имя

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две половины этого заголовка — не объекты одного и того же рода, и это первое, что нужно понять читателю. Claude Sonnet 5.5 вышел 28 сентября 2026 года: у него есть идентификатор API, тарифная сетка, контекстное окно, опубликованный порог вывода из эксплуатации и строка в независимых рейтингах. Q​wen 4 Max был показан в рамках превью на конференции Yunqi в Ханчжоу 22 сентября 2026 года как флагман анонсированной линейки Q​wen 4 из четырёх моделей — и на сегодняшний день у него нет ни цены, ни контекстного окна, ни опубликованных оценок, ни карточки модели, ни страницы на Artificial Analysis, которую можно было бы открыть. Это не скандал; именно так и объявляют новый уровень. Но это меняет то, как выглядит полезное сравнение. Сравнивать стоит новейший выпущенный Sonnet с той моделью Q​wen, которую действительно можно вызвать сегодня, — с Qwen3.8 Max, — потому что у неё есть тарифная сетка, и эта тарифная сетка поучительна.

Что A​libaba на самом деле положила на стол

Qwen 4 Max фигурировал как название в линейке, а не как продукт. Презентация на конференции представила уровневую структуру семейства Qwen 4, и с тех пор ничего из этого не было превращено в спецификацию, на которую разработчик мог бы опираться при планировании: ни цены за миллион токенов, ни размера контекстного окна, ни максимального объёма вывода, ни таблицы бенчмарков, ни репозитория на Hugging Face, ни записи в собственном списке моделей вендора. Поставляется ли он как закрытый уровень API, как открытые веса или в обеих формах, нигде в опубликованных вендором материалах не сказано. Когда уровень находится на такой ранней стадии, единственное честное, что статья может сказать о его характеристиках, — это то, что их нет; а любая страница, предлагающая сейчас спецификацию Qwen 4 Max, публикует прогноз.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Qwen 4 Max, the scoreboard, with six matched rows. Claude Sonnet 5.5: released 2026-09-28, $2.00 input, $10.00 output, Intelligence Index 56, 1,000,000-token context window, closed weights. Qwen 4 Max: announced with no model card, input and output price not published, no score published, context window not published, weights not stated. A footer reads Qwen 4 Max was announced 2026-09-22 with no specification published; Claude Sonnet 5.5 figures per Artificial Analysis v4.3.2 and Anthropic.

Единственное, что объявление действительно задаёт, — это направление. Самый новый флагман Alibaba, Qwen3.8 Max, согласно собственному руководству по миграции производителя, позиционируется непосредственно против GPT-5.5, Claude Opus 4.7 и Gemini 3.1 Pro, и это тот уровень, который Qwen 4 Max призван заменить. Так что цель преемника понятна, даже если его цифры — нет, а модель, которую ему придётся обойти по цене, — это та, что уже в продаже.

Qwen, к которому можно обратиться уже сегодня, с ценой против нового Sonnet

Qwen3.8 Max находится в общем доступе с 3 августа 2026 года. Это самый мощный уровень Alibaba на сегодняшний день: нативная мультимодальность с вводом текста, изображений и видео и выводом текста, окно в 1 000 000 токенов, режим размышления, вызов функций, встроенные инструменты и структурированные выходные данные, доступные через OpenAI-совместимые, Anthropic-совместимые и нативные конечные точки DashScope. Alibaba позиционирует его для той же требовательной многошаговой аналитики и агентной работы, для которой поставщик позиционирует Claude Sonnet 5.5, и оба попадают почти ровно в один и тот же заявленный тариф — вот где сравнение становится интересным.

• Цена входных данных — Claude Sonnet 5.5 $2.00 за миллион против Qwen3.8 Max $2.00 за миллион, одинаково

Цена вывода — Claude Sonnet 5.5 $10.00 за миллион против Qwen3.8 Max $6.00 за миллион

• Чтение из кэша — Claude Sonnet 5.5 $0.20 за миллион против Qwen3.8 Max $0.25 за миллион

• Запись в кэш — Claude Sonnet 5.5 $2,50 за миллион против Qwen3.8 Max $2,50 за миллион

• Контекст — Claude Sonnet 5.5 1 000 000 токенов против Qwen3.8 Max 1 000 000 токенов в спецификации производителя; Artificial Analysis фиксирует измеренный им снимок на уровне 983 616

• Макс. объём вывода — Claude Sonnet 5.5: 128 000 синхронно, 300 000 в Batches, тогда как для Qwen3.8 Max он не опубликован производителем

• Модальность ввода — Claude Sonnet 5.5: текст, изображение и файл против Qwen3.8 Max: текст, изображение и видео

Одинаковая цена за ввод и на 40% более низкая цена за вывод — это действительно сильная ценовая позиция, и именно поэтому Qwen3.8 Max продолжает появляться в сравнениях с передовыми моделями. А затем смотришь на независимые измерения — и преимущество оказывается совсем в другом месте.

Что независимые цифры говорят о ценовом преимуществе

Обе модели входят в один и тот же Индекс интеллекта Artificial Analysis версии v4.3.2, и обе были измерены, а не оценены.

• Индекс интеллекта — Claude Sonnet 5.5 56 при максимальных усилиях против Qwen3.8 Max 45 на снимке от 2 сентября

• Стоимость одной задачи индексации — Claude Sonnet 5.5 $7.60 против Qwen3.8 Max $5.41

• Скорость вывода — Claude Sonnet 5.5 138,7 токенов/с против Qwen3.8 Max 38,2 токенов/с

• Время до первого чанка — Claude Sonnet 5.5 370.8 с при Max Effort против Qwen3.8 Max 3.0 с

• Выходные токены, сгенерированные по всему Index — Claude Sonnet 5.5 410M против Qwen3.8 Max 190M, что совет расценивает как чрезмерную многословность на фоне медианы 88M

• GPQA Diamond — Claude Sonnet 5.5 не опубликован в текущем лидерборде против Qwen3.8 Max 92.8%

• Humanity's Last Exam — Claude Sonnet 5.5 55,0% против Qwen3.8 Max 43,1%

• Воспроизведение в длинном контексте — Claude Sonnet 5.5 82,7% против Qwen3.8 Max 80,3%

Бросаются в глаза две вещи, и ни одна из них — не цена. Первое — то, что стоимость вывода, на 40% более низкая, оборачивается задачей, на 30% более дешёвой, если учесть количество токенов — Qwen3.8 Max выдаёт 190 млн токенов по всему индексу против 410 млн у Claude Sonnet 5.5, что экономнее, но недостаточно экономно, чтобы сохранить весь разрыв в тарифах. Второе — скорость, и здесь направление резко разворачивается: Claude Sonnet 5.5 генерирует вывод в 3,6 раза быстрее, чем Qwen3.8 Max, — 138,7 токена в секунду против 38,2. При долгой генерации это разница между минутой и несколькими минутами, и никакая скидка за токен эту разницу не исправляет.

Показатель времени до первого токена работает в обратную сторону и заслуживает того, чтобы оговорка была сформулирована прямо. 370,8 секунды — это Claude Sonnet 5.5 в режиме Max Effort со стандартным fallback: конфигурация рассуждения, которая расходует очень большой бюджет размышлений перед ответом; вызывающий, настроивший более низкий уровень effort, получает первый токен за секунды. 3,0 секунды у Qwen3.8 Max измерены на модели, чьё поведение при размышлении отличается. Сравнение реально, но это сравнение конфигураций, а не вендоров.

Artificial Analysis model page for Qwen3.8 Max (0902), a proprietary model released September 2026, showing an Intelligence Index of 45, an output speed of 38.2 tokens per second, $2.00 per million input tokens and $6.00 per million output tokens, $5.41 per Intelligence Index task, 190M output tokens generated during the Index evaluation described as very verbose, and a 984k-token context window.

Куда ляжет недостающая стоимость миграции Sonnet

Одно операционное различие не отображается ни в одной из строк выше и значит больше, чем ценовой разрыв, для всех, у кого код уже работает. Claude Sonnet 5.5 изменил шесть вариантов поведения по сравнению с Claude Sonnet 5, и пять из них ломают существующие интеграции: нестандартные значения temperature, top_p и top_k теперь возвращают 400; thinking: {"type": "disabled"} возвращает 400 и должно стать between_tools с усилием, ограниченным значениями low, medium или high; принудительный выбор инструмента "any" или именованного инструмента отклоняется, поэтому циклы должны перейти на auto со строгим использованием инструментов или структурированными выходами; computer_20251124 (инструмент computer-use) отклоняется в Claude API и Google Cloud; а блоки мышления теперь привязаны к создавшей их модели и аккаунту, поэтому рассуждения сохраняются при переходе от Sonnet 5, но не передаются в другое семейство. Шестое изменение не вызывает сбоев, и поэтому именно его легко выпустить сломанным: текст между вызовами инструментов теперь возвращается внутри блоков мышления, поэтому потоковое приложение замолкает между вызовами, пока не задаст значение отображения или не отключит предварительное мышление.

Qwen3.8 Max ничего этого не требует от вызывающей стороны Qwen — это OpenAI-совместимый эндпоинт с полным набором параметров сэмплирования и стандартным форматом вызова инструментов, — а его Anthropic-совместимый эндпоинт существует именно для того, чтобы код, написанный под Claude, можно было направить на него, изменив base-URL. Для команды, уже использующей Sonnet 5, переход на Sonnet 5.5 — это день работы по миграции со списком из пяти пунктов для проверки; переход на Qwen3.8 Max — это изменение конфигурации с другим набором рисков, связанных в основном с дрейфом поведения, а не с формой API.

Размещение доступного элемента на той же клавише

Реалистичный пайплайн в конце сентября 2026 года не выбирает один из них. Он запускает модель Claude для агентного пути и модель Qwen там, где имеет значение видеовход или цена, и стоимость такой организации обычно составляет два контракта, два ключа, две поверхности ограничения скорости и два места, где запрос может отказать. OrcaRouter сводит это к одной конечной точке, совместимой с OpenAI, для более чем 200 моделей, с передачей прейскурантной цены провайдера без наценки, так что изменение тарифа поставщика с любой стороны вступает в силу здесь в тот же день, а не при следующем продлении, плюс автоматическое переключение при сбое между вышестоящими провайдерами и DSL маршрутизации для составления вызовов из нескольких моделей.

Qwen3.8 Max уже сегодня доступен здесь для маршрутизации как qwen/qwen3.8-max по цене A​libaba: $2.00 за вход и $6.00 за выход при полном окне в 1 000 000 токенов, а снимок от 2 сентября, который измерила Artificial Analysis, доступен как qwen/qwen3.8-max-0902 когда вам нужна именно та ревизия, на которой был получен результат. Ни Q​wen 4 Max, ни любой другой уровень Q​wen 4 не входит в наш каталог, и ни один уровень Q​wen 4 не появится там, пока A​libaba не опубликует что-то, что можно маршрутизировать. Claude Sonnet 5.5 тоже отсутствует в каталоге — ему всего день, и маршрут к нему — собственный API A​nthropic, а Claude Sonnet 5 доступен здесь по цене A​nthropic $2.00 и $10.00 как цель для переключения при отказе тем временем. Qwen3.8 Max пропускает через этот каталог 52,0 миллиона токенов трафика в неделю, а Claude Sonnet 5 — 7,9 миллиона, и это практическая версия приведённого выше аргумента: уровень Q​wen не является запасным вариантом лишь на словах.

OrcaRouter model page for qwen/qwen3.8-max, dated 2026-08-03, showing text, image and video input, a 1M-token context window, $2.00 input and $6.00 output per million tokens, a p50 time to first token of 2.27 s, and 52.0M tokens of recent traffic.

Правило для анонсированного уровня

Относитесь к анонсированному тиру как к входным данным для планирования, а не как к варианту закупки. За Qwen 4 Max стоит следить: он подсказывает, куда движется флагман Alibaba, и со временем сместит Qwen3.8 Max с вершины линейки. Но планировать исходя из него не стоит, потому что планировать не от чего: ни идентификатора, ни цены, ни окна, ни весов, ни измеренной оценки. Доказательства, которые сделают его реальным, конкретны и легко узнаваемы — запись в собственном списке моделей Alibaba, строка с ценой, опубликованное контекстное окно, репозиторий на Hugging Face, если веса открыты, и страница на Artificial Analysis, ведь модель, которую никто не измерил, — это не модель, которую можно сравнить.

До тех пор выбор — между двумя моделями, которые обе уже существуют. Если ваша работа агентная, то семнадцать пунктов индекса и скорость вывода 3,6× — это то, что вы покупаете, и более высокая стоимость Claude Sonnet 5.5 за задачу — цена за это. Если ваша работа принимает видео на входе, требует нативного эндпоинта, совместимого с Anthro​pic, при оплате по счету Q​wen, или просто не может оправдать ставку вывода $10, то Qwen3.8 Max сейчас продается по той же цене ввода с на 40% более дешевым выводом и первым токеном, который появляется за секунды, — и честная оговорка состоит в том, что он будет казаться медленным, как только начнется генерация, и это тот компромисс, который покупает более дешевая ставка.