Сгенерированная hero-карточка под названием «Dots vs Qwen 3.8 Max» с подзаголовком «Разница в том, куда вам разрешено её перемещать». Карточку разделяет вертикальная линия: на левой панели с надписью «Dots» написано «одно место, где он может работать»; на правой, с надписью «Qwen 3.8 Max», — «три формата передачи данных — пять регионов — $2.00 / $6.00». Логотип OrcaRouter наложен в правом нижнем углу.
Guides & Insights

Dots vs Qwen 3.8 Max: разница в том, куда вам разрешено его перемещать

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Qwen 3.8 Max был выпущен 3 августа 2026 года и является самым мощным на сегодняшний день уровнем Alibaba: нативно мультимодальный, принимает текст, изображения и видео и возвращает текст, в контекстном окне на 1 000 000 токенов, обслуживается через три формата подключения — совместимый с OpenAI, совместимый с Anthropic и нативный DashScope — из Пекина, Сингапура, Токио, Франкфурта и Вирджинии, по цене $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов, а чтение из кэша — $0.25. Dots — это постоянно работающий агент компании, анонсированный на DevDay 29 сентября 2026 года: он получает собственный облачный компьютер и браузер, имеет доступ к более чем 4 000 приложений, работает на GPT-6 Astra и входит в тарифы Pro и Business Premium. Если поставить их рядом, интересный вопрос не в том, кто из них более способен. А в том, в скольких местах каждому из них разрешено присутствовать, и кто это решает.

Это не абстрактное различие. Именно оно решает, доступен ли инструмент на вашем рынке в принципе, может ли его проверить ваша команда по комплаенсу и переживёт ли работа, которую вы на нём строите, изменение условий. Функциональность — простая часть этого сравнения; переносимость — та часть, которая решается поздно и дорого.

Три способа вызвать одну модель

Формат передачи данных кажется мелкой инженерной деталью, пока не придётся переносить приложение между вендорами. Интерфейс, совместимый с OpenAI, означает, что существующие клиентские библиотеки работают без слоя трансляции. А совместимый с Anthropic — что кодовую базу, написанную под формат сообщений другого вендора, не придётся переписывать. Нативный интерфейс DashScope открывает полный набор возможностей, включая переключатель режима размышления. Три интерфейса для одной модели означают, что цена перехода — это базовый URL и ключ, а не рефакторинг.

Это важнее всего, когда её нет. Точка сама по себе не предлагает ни формата, ни URL, ни ключа, потому что точка — это не то, что вы вызываете, а то, с чем вы разговариваете внутри чужого интерфейса. Перенос вашей логики агента в другое место означает её пересборку, затем повторное подключение четырёх тысяч коннекторов, от которых она зависела, а затем выяснение того, какие из них вели себя так, как вы не описали.

• Что вы покупаете — размещённый воркер внутри ChatGPT, Slack и Teams (Dots) в противовес эндпоинту модели, который можно вызвать откуда угодно (Qwen 3.8 Max)

• Интерфейсы — ни одного не опубликовано для точки, в сравнении с OpenAI-совместимыми, Anthropic-совместимыми и нативными поверхностями DashScope (Qwen 3.8 Max)

• Где это работает — облачный компьютер OpenAI с собственным браузером (Dots) против пяти обслуживаемых регионов в Азии, Европе и Северной Америке (Qwen 3.8 Max)

• Управление рассуждениями — не предоставляется для точки, в отличие от переключателя enable_thinking или reasoning.effort в Responses API (Qwen 3.8 Max)

• Стоимость за единицу — первая точка включена в Pro или Business Premium, квота не опубликована (Dots), против $2.00 за миллион входных и $6.00 за миллион выходных, кэшированные чтения — $0.25 (Qwen 3.8 Max)

• Независимые доказательства — демонстрации вендоров и заявления о возможностях, ни одного бенчмарка, против Индекса интеллекта Artificial Analysis в 45,4 на пятнадцатом месте из 145 измеренных моделей и 92,8 на GPQA Diamond (Qwen 3.8 Max)

К чему приходит модель — в цифрах, которые вы можете проверить

Опубликованный профиль Qwen 3.8 Max — это профиль среднего уровня фронтира, и его стоит читать точно, а не по впечатлению. Индекс интеллекта AA 45.4, ставящий её на пятнадцатое место из 145 измеренных моделей, помещает её в топ-10 процентов, но не на вершину. Индекс кодинга AA 76.2 — девятое место из 138 — сильнее, а 88.8 на Terminal-Bench 2.1 — это действительно высокий показатель агентного выполнения, выше, чем 88.0 у GPT-5.6 Sol на том же бенчмарке. Там, где она сравнительно слабее, — это долгоконтекстное воспроизведение на уровне 80.3, что ниже, чем 88.7 у Kimi K3 и 83 у MiniMax M3, несмотря на сопоставимый размер окна, и SciCode — 52.1.

Позиционирование самой Alibaba в её руководстве по миграции ставит модель в прямую конкуренцию с GPT-5.5, Claude Opus 4.7 и Gemini 3.1 Pro, и при честном прочтении цифр это модель, к которой обращаешься, когда сочетание сильного агентного выполнения и мультимодального ввода важно больше, чем быть первым в рейтинге интеллекта. Все эти цифры — сторонние измерения, которые в нашем каталоге приводятся вместе с источниками, а не заявления вендора, — и именно поэтому они ценнее, чем презентация к запуску.

Одно число отсутствует, и его следует назвать вслух, а не вписать: в нашем каталоге не указана максимальная длина вывода для этой модели. Контекст в миллион токенов задокументирован; потолок вывода на один ответ — нет.

A screenshot of the OrcaRouter model page for Qwen3.8 Max, showing the identifier 'qwen/qwen3.8-max' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-03, a description of it as Alibaba's newest flagship with a 1M-token context window served through OpenAI-compatible, Anthropic-compatible and native DashScope interfaces across multiple regions, a side panel reading 1M tokens of context over text, image and video input, and a price strip reading $2.00 and $6.00 with a p50 time to first token of 2.44 seconds.

О чём Dots вам не рассказывает и почему это осознанное дизайнерское решение

OpenAI опубликовала одно предложение о том, сколько стоит точка, и в нём нет числа: первая точка включена в Pro и Business Premium, с расширенными лимитами в первый месяц и без расходования лимитов использования ChatGPT на разговоры с ней. Помимо этого, нет цифры лимита, нет цены за вторую точку, нет ставки за дополнительный объём и нет стоимости за задачу. Тариф Pro 500 за $500 в месяц — это лимит использования плюс режим Ultrafast, а не ставка за точку, поэтому даже самый дорогой план не превращается в стоимость за единицу работы агента.

Соблазнительно увидеть в этом пробел в документации. Точнее будет увидеть в этом саму категорию: продукт с ценой за место не может иметь цену за единицу, потому что весь смысл места в том, что предельные издержки его использования невидимы. Это действительно удобно для исследовательской работы и действительно неудобно для всего, что приходится относить на проект, клиента или статью бюджета.

Обратите внимание, для чего оптимизированы эти два продукта. Qwen 3.8 Max оптимизирован для вызова откуда угодно, чем угодно и в любом формате, на котором уже говорит вызывающий. A dot оптимизирован для использования в одном месте, через один интерфейс, со скрытой начинкой. Оба дизайна целостны; они просто отвечают на разные вопросы, и один из них на вопрос «смогу ли я перенести это позже» отвечает «нет».

A generated scoreboard titled 'Dots vs Qwen 3.8 Max - reach and reversibility', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; interfaces none published; regions OpenAI's cloud computer; connectors 4,000+ apps; independent benchmark none. The right column, 'Qwen 3.8 Max', lists: context 1,000,000 tokens; input text, image, video; interfaces OpenAI-compatible, Anthropic-compatible, DashScope; regions five; price $2.00 in / $6.00 out per 1M; AA Intelligence Index 45.4, 15th of 145. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Qwen 3.8 Max figures from independent listings as carried in the OrcaRouter catalogue.'

Два ответа на вопрос «что, если этот поставщик изменится»

Вопрос переносимости становится конкретным в тот момент, когда поставщик меняет цену, объявляет идентификатор устаревшим или меняет состав подписки. Для модели с оплатой по мере использования и тремя форматами передачи данных реакция механическая: направьте клиент на другой базовый URL или измените одну строку модели — и приложение продолжит работать. Переносить больше нечего, потому что модель всегда была не чем иным, как вызовом.

В случае с dot реакция на изменение условий — остановиться. Компьютер, браузер, коннекторы и квота — всё принадлежит OpenAI, и ничего из этого нельзя экспортировать. Это не критика продукта; это честное описание аренды. Но это означает, что работа, которую вы полностью создаёте внутри dot, имеет путь миграции, проходящий через переписывание, и этот факт стоит учесть в цене, прежде чем создавать что-то, от чего вы собираетесь зависеть в течение года.

OrcaRouter создан для первого случая. Qwen 3.8 Max маршрутизируется как qwen/qwen3.8-max по прейскурантной цене провайдера Alibaba, передаваемой с наценкой 0%, в том же каталоге, что и более 200 других моделей, доступных по одному ключу, с автоматическим переключением при сбое между вышестоящими провайдерами и DSL маршрутизации для объединения нескольких моделей в один запрос. Именно это позволяет ответить на вопрос о трёх регионах на вашей стороне, а не на стороне поставщика: один и тот же идентификатор достигает модели везде, где она обслуживается, а изменение тарифа от Alibaba отражается в вашем счёте в тот же день, а не при следующем продлении. А чего оно не достигает — так это всего, что находится внутри точки: для неё нет ни эндпоинта, ни идентификатора, ни заменяющего интеллекта, который можно было бы подставить.

Вопрос, который стоит задать перед тем, как взять на себя обязательства

Спросите, что случится с вашей работой в тот день, когда вендор изменит что-то, что вы не контролируете. Если ответ — «мы меняем строку и идём дальше», вы покупаете модель, и модель с оплатой по мере использования — более выгодная покупка. Если ответ — «нам придётся всё пересобирать», вы покупаете продукт, и покупать его следует осознанно — понимая, что за удобство, за которое вы платите, вы расплачиваетесь обратимостью.

Ни один из ответов не является неправильным. Покупать портативность, которой вы никогда не воспользуетесь, так же расточительно, как покупать удобство, от которого вам придётся спасаться. Ошибка — не знать, что именно вы купили.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно