
Claude Sonnet 5.5 против Qwen 4 Max: у одной модели есть карта, у другой — имя
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 931 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 192 tok/s
- OrcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Две половины этого заголовка — не объекты одного и того же рода, и это первое, что нужно понять читателю. Claude Sonnet 5.5 вышел 28 сентября 2026 года: у него есть идентификатор API, тарифная сетка, контекстное окно, опубликованный порог вывода из эксплуатации и строка в независимых рейтингах. Qwen 4 Max был показан в рамках превью на конференции Yunqi в Ханчжоу 22 сентября 2026 года как флагман анонсированной линейки Qwen 4 из четырёх моделей — и на сегодняшний день у него нет ни цены, ни контекстного окна, ни опубликованных оценок, ни карточки модели, ни страницы на Artificial Analysis, которую можно было бы открыть. Это не скандал; именно так и объявляют новый уровень. Но это меняет то, как выглядит полезное сравнение. Сравнивать стоит новейший выпущенный Sonnet с той моделью Qwen, которую действительно можно вызвать сегодня, — с Qwen3.8 Max, — потому что у неё есть тарифная сетка, и эта тарифная сетка поучительна.
Что Alibaba на самом деле положила на стол
Qwen 4 Max фигурировал как название в линейке, а не как продукт. Презентация на конференции представила уровневую структуру семейства Qwen 4, и с тех пор ничего из этого не было превращено в спецификацию, на которую разработчик мог бы опираться при планировании: ни цены за миллион токенов, ни размера контекстного окна, ни максимального объёма вывода, ни таблицы бенчмарков, ни репозитория на Hugging Face, ни записи в собственном списке моделей вендора. Поставляется ли он как закрытый уровень API, как открытые веса или в обеих формах, нигде в опубликованных вендором материалах не сказано. Когда уровень находится на такой ранней стадии, единственное честное, что статья может сказать о его характеристиках, — это то, что их нет; а любая страница, предлагающая сейчас спецификацию Qwen 4 Max, публикует прогноз.

Единственное, что объявление действительно задаёт, — это направление. Самый новый флагман Alibaba, Qwen3.8 Max, согласно собственному руководству по миграции производителя, позиционируется непосредственно против GPT-5.5, Claude Opus 4.7 и Gemini 3.1 Pro, и это тот уровень, который Qwen 4 Max призван заменить. Так что цель преемника понятна, даже если его цифры — нет, а модель, которую ему придётся обойти по цене, — это та, что уже в продаже.
Qwen, к которому можно обратиться уже сегодня, с ценой против нового Sonnet
Qwen3.8 Max находится в общем доступе с 3 августа 2026 года. Это самый мощный уровень Alibaba на сегодняшний день: нативная мультимодальность с вводом текста, изображений и видео и выводом текста, окно в 1 000 000 токенов, режим размышления, вызов функций, встроенные инструменты и структурированные выходные данные, доступные через OpenAI-совместимые, Anthropic-совместимые и нативные конечные точки DashScope. Alibaba позиционирует его для той же требовательной многошаговой аналитики и агентной работы, для которой поставщик позиционирует Claude Sonnet 5.5, и оба попадают почти ровно в один и тот же заявленный тариф — вот где сравнение становится интересным.
• Цена входных данных — Claude Sonnet 5.5 $2.00 за миллион против Qwen3.8 Max $2.00 за миллион, одинаково
Цена вывода — Claude Sonnet 5.5 $10.00 за миллион против Qwen3.8 Max $6.00 за миллион
• Чтение из кэша — Claude Sonnet 5.5 $0.20 за миллион против Qwen3.8 Max $0.25 за миллион
• Запись в кэш — Claude Sonnet 5.5 $2,50 за миллион против Qwen3.8 Max $2,50 за миллион
• Контекст — Claude Sonnet 5.5 1 000 000 токенов против Qwen3.8 Max 1 000 000 токенов в спецификации производителя; Artificial Analysis фиксирует измеренный им снимок на уровне 983 616
• Макс. объём вывода — Claude Sonnet 5.5: 128 000 синхронно, 300 000 в Batches, тогда как для Qwen3.8 Max он не опубликован производителем
• Модальность ввода — Claude Sonnet 5.5: текст, изображение и файл против Qwen3.8 Max: текст, изображение и видео
Одинаковая цена за ввод и на 40% более низкая цена за вывод — это действительно сильная ценовая позиция, и именно поэтому Qwen3.8 Max продолжает появляться в сравнениях с передовыми моделями. А затем смотришь на независимые измерения — и преимущество оказывается совсем в другом месте.
Что независимые цифры говорят о ценовом преимуществе
Обе модели входят в один и тот же Индекс интеллекта Artificial Analysis версии v4.3.2, и обе были измерены, а не оценены.
• Индекс интеллекта — Claude Sonnet 5.5 56 при максимальных усилиях против Qwen3.8 Max 45 на снимке от 2 сентября
• Стоимость одной задачи индексации — Claude Sonnet 5.5 $7.60 против Qwen3.8 Max $5.41
• Скорость вывода — Claude Sonnet 5.5 138,7 токенов/с против Qwen3.8 Max 38,2 токенов/с
• Время до первого чанка — Claude Sonnet 5.5 370.8 с при Max Effort против Qwen3.8 Max 3.0 с
• Выходные токены, сгенерированные по всему Index — Claude Sonnet 5.5 410M против Qwen3.8 Max 190M, что совет расценивает как чрезмерную многословность на фоне медианы 88M
• GPQA Diamond — Claude Sonnet 5.5 не опубликован в текущем лидерборде против Qwen3.8 Max 92.8%
• Humanity's Last Exam — Claude Sonnet 5.5 55,0% против Qwen3.8 Max 43,1%
• Воспроизведение в длинном контексте — Claude Sonnet 5.5 82,7% против Qwen3.8 Max 80,3%
Бросаются в глаза две вещи, и ни одна из них — не цена. Первое — то, что стоимость вывода, на 40% более низкая, оборачивается задачей, на 30% более дешёвой, если учесть количество токенов — Qwen3.8 Max выдаёт 190 млн токенов по всему индексу против 410 млн у Claude Sonnet 5.5, что экономнее, но недостаточно экономно, чтобы сохранить весь разрыв в тарифах. Второе — скорость, и здесь направление резко разворачивается: Claude Sonnet 5.5 генерирует вывод в 3,6 раза быстрее, чем Qwen3.8 Max, — 138,7 токена в секунду против 38,2. При долгой генерации это разница между минутой и несколькими минутами, и никакая скидка за токен эту разницу не исправляет.
Показатель времени до первого токена работает в обратную сторону и заслуживает того, чтобы оговорка была сформулирована прямо. 370,8 секунды — это Claude Sonnet 5.5 в режиме Max Effort со стандартным fallback: конфигурация рассуждения, которая расходует очень большой бюджет размышлений перед ответом; вызывающий, настроивший более низкий уровень effort, получает первый токен за секунды. 3,0 секунды у Qwen3.8 Max измерены на модели, чьё поведение при размышлении отличается. Сравнение реально, но это сравнение конфигураций, а не вендоров.

Куда ляжет недостающая стоимость миграции Sonnet
Одно операционное различие не отображается ни в одной из строк выше и значит больше, чем ценовой разрыв, для всех, у кого код уже работает. Claude Sonnet 5.5 изменил шесть вариантов поведения по сравнению с Claude Sonnet 5, и пять из них ломают существующие интеграции: нестандартные значения temperature, top_p и top_k теперь возвращают 400; thinking: {"type": "disabled"} возвращает 400 и должно стать between_tools с усилием, ограниченным значениями low, medium или high; принудительный выбор инструмента "any" или именованного инструмента отклоняется, поэтому циклы должны перейти на auto со строгим использованием инструментов или структурированными выходами; computer_20251124 (инструмент computer-use) отклоняется в Claude API и Google Cloud; а блоки мышления теперь привязаны к создавшей их модели и аккаунту, поэтому рассуждения сохраняются при переходе от Sonnet 5, но не передаются в другое семейство. Шестое изменение не вызывает сбоев, и поэтому именно его легко выпустить сломанным: текст между вызовами инструментов теперь возвращается внутри блоков мышления, поэтому потоковое приложение замолкает между вызовами, пока не задаст значение отображения или не отключит предварительное мышление.
Qwen3.8 Max ничего этого не требует от вызывающей стороны Qwen — это OpenAI-совместимый эндпоинт с полным набором параметров сэмплирования и стандартным форматом вызова инструментов, — а его Anthropic-совместимый эндпоинт существует именно для того, чтобы код, написанный под Claude, можно было направить на него, изменив base-URL. Для команды, уже использующей Sonnet 5, переход на Sonnet 5.5 — это день работы по миграции со списком из пяти пунктов для проверки; переход на Qwen3.8 Max — это изменение конфигурации с другим набором рисков, связанных в основном с дрейфом поведения, а не с формой API.
Размещение доступного элемента на той же клавише
Реалистичный пайплайн в конце сентября 2026 года не выбирает один из них. Он запускает модель Claude для агентного пути и модель Qwen там, где имеет значение видеовход или цена, и стоимость такой организации обычно составляет два контракта, два ключа, две поверхности ограничения скорости и два места, где запрос может отказать. OrcaRouter сводит это к одной конечной точке, совместимой с OpenAI, для более чем 200 моделей, с передачей прейскурантной цены провайдера без наценки, так что изменение тарифа поставщика с любой стороны вступает в силу здесь в тот же день, а не при следующем продлении, плюс автоматическое переключение при сбое между вышестоящими провайдерами и DSL маршрутизации для составления вызовов из нескольких моделей.
Qwen3.8 Max уже сегодня доступен здесь для маршрутизации как qwen/qwen3.8-max по цене Alibaba: $2.00 за вход и $6.00 за выход при полном окне в 1 000 000 токенов, а снимок от 2 сентября, который измерила Artificial Analysis, доступен как qwen/qwen3.8-max-0902 когда вам нужна именно та ревизия, на которой был получен результат. Ни Qwen 4 Max, ни любой другой уровень Qwen 4 не входит в наш каталог, и ни один уровень Qwen 4 не появится там, пока Alibaba не опубликует что-то, что можно маршрутизировать. Claude Sonnet 5.5 тоже отсутствует в каталоге — ему всего день, и маршрут к нему — собственный API Anthropic, а Claude Sonnet 5 доступен здесь по цене Anthropic $2.00 и $10.00 как цель для переключения при отказе тем временем. Qwen3.8 Max пропускает через этот каталог 52,0 миллиона токенов трафика в неделю, а Claude Sonnet 5 — 7,9 миллиона, и это практическая версия приведённого выше аргумента: уровень Qwen не является запасным вариантом лишь на словах.

Правило для анонсированного уровня
Относитесь к анонсированному тиру как к входным данным для планирования, а не как к варианту закупки. За Qwen 4 Max стоит следить: он подсказывает, куда движется флагман Alibaba, и со временем сместит Qwen3.8 Max с вершины линейки. Но планировать исходя из него не стоит, потому что планировать не от чего: ни идентификатора, ни цены, ни окна, ни весов, ни измеренной оценки. Доказательства, которые сделают его реальным, конкретны и легко узнаваемы — запись в собственном списке моделей Alibaba, строка с ценой, опубликованное контекстное окно, репозиторий на Hugging Face, если веса открыты, и страница на Artificial Analysis, ведь модель, которую никто не измерил, — это не модель, которую можно сравнить.
До тех пор выбор — между двумя моделями, которые обе уже существуют. Если ваша работа агентная, то семнадцать пунктов индекса и скорость вывода 3,6× — это то, что вы покупаете, и более высокая стоимость Claude Sonnet 5.5 за задачу — цена за это. Если ваша работа принимает видео на входе, требует нативного эндпоинта, совместимого с Anthropic, при оплате по счету Qwen, или просто не может оправдать ставку вывода $10, то Qwen3.8 Max сейчас продается по той же цене ввода с на 40% более дешевым выводом и первым токеном, который появляется за секунды, — и честная оговорка состоит в том, что он будет казаться медленным, как только начнется генерация, и это тот компромисс, который покупает более дешевая ставка.
