
MAI-Image-2.5-Pro против Qwen-Image 3.0: В четыре раза дороже за другой вид текста
- z-aiНОВИНКАZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianНОВИНКАQwen3.8 27B Uncensored (Aggressive)2026-08-1552Интеллект68Кодинг
- qwenНОВИНКАQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekНОВИНКАDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokНОВИНКАSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Интеллект77Кодинг
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Интеллект77Кодинг
- grokxAI: Grok 4.52026-07-0856Интеллект72Кодинг
Поставьте MAI-Image-2.5-Pro и Qwen-Image 3.0 рядом друг с другом, и первое, что бросается в глаза, — это цена: примерно $108.50 за 1000 изображений для премиального тарифа Microsoft против примерно $25–30 за 1000 для Qwen-Image 3.0 от Alibaba — собственная заявленная цена Alibaba близка к $25, тогда как в рейтинге Artificial Analysis указано $30. Более чем втрое дороже по любой из этих цифр. Что на самом деле даёт эта премия, так это другой вид работы с текстом. Qwen-Image 3.0, выпущенный командой Qwen из Alibaba 21 июля 2026 года и открытый для международного API 4 августа, позиционируется по цене как массовый рендерер текста — разборчив вплоть до ~10px на двенадцати языках, с окном промпта на 4500 токенов для насыщенных брифов. MAI-Image-2.5-Pro, находящийся в публичном предварительном доступе на Microsoft Foundry с 23 июля, является самым высоко оценённым редактором в независимом рейтинге, с заявленной вендором точностью рендеринга текста, но жёстким ограничением вывода до ~1 мегапикселя. Обе являются API-моделями для генерации изображений, главная особенность которых — текст; они конкурируют по цене за задачу, а не по единому показателю качества.
Две текстовые истории, ни одна из которых полностью не проверена.
Текстовая битва — причина существования обеих моделей, и именно здесь доказательств меньше всего — каждая цифра в этом разделе предоставлена вендором, и ни одна не была независимо воспроизведена.
• Qwen-Image 3.0 — в релизных материалах Alibaba утверждается, что разборчивый рендеринг обеспечивается вплоть до примерно 10px, нативная поддержка 12 языков, 20+ шрифтов и 100+ художественных стилей, математической нотации, нижних и верхних индексов, многострочных формул, а также знание распространённых веб-, игровых и программных интерфейсов. Окно промпта достигает 4 500 токенов ввода — в 4,5 раза больше, чем в предыдущем поколении, — что позволяет охватывать плотные брифы вроде первых полос газет или девятипанельной сетки знаний за один вызов.
• MAI-Image-2.5-Pro — Microsoft заявляет о 96.8% точности рендеринга текста на китайском, английском, японском, корейском и испанском языках, а также о 27% лучшем следовании промпту, чем у GPT-Image-1.5 по внутренним оценкам, и о 94% согласованности персонажей на нескольких изображениях. Входные характеристики на бумаге более вместительные — до 32,000 входных текстовых токенов с окном контекста 131k — а вывод ограничен 1,048,576 пикселями, что эквивалентно 1024×1024.
На момент написания оба утверждения не воспроизведены. Разница — в форме заявлений: Qwen касается объёма и читабельности в разных письменностях, а Microsoft — точности и согласованности для заданного набора из пяти языков. Ни один из вендоров не опубликовал бенчмарк, который другая лаборатория могла бы запустить и проверить.
В редактировании живёт премиум.
Что отличает их друг от друга — это редактирование, и это единственная ось, для которой есть независимые доказательства. MAI-Image-2.5-Pro занимает первое место на Artificial Analysis Image Editing Arena при Elo 1,272 (~6,100 слепых голосов), опережая Reve 2.1, MAI-Image-2.5 и GPT Image 2. На той же таблице лидеров более новая Qwen-Image-3.0-Pro находится на отметке 1,249 — конкурентоспособный результат, отставание на 23 Elo, и примечательный для модели, которая только в этом месяце стала доступна через международный API.
Помимо базовой модели, портфолио Alibaba в области редактирования — это набор специализированных приёмов, а не единая корона: реставрация древних картин, генерация панорам, эскиз-в-PPT и многосерийная раскадровка. У Microsoft ставка уже и глубже — точные, хирургические правки, которые сохраняют остальную часть кадра неизменной (замена объектов, изменение макета, обновление текста внутри изображения, устранение размытия), то есть тот класс правок, где старые модели перегенерируют всю сцену и теряют объект. Для рабочего процесса вида «берём существующий ассет, меняем одну деталь, отправляем в работу» независимое первое место в тарифе Pro — более сильный сигнал; а для сборной солянки креативных форматов редактирования список Qwen обширнее.

Контраст спецификации
• Цена — ~$108.50 за 1 тыс. изображений (1024×1024, конвертация AA) против ~$25–30 за 1 тыс. изображений (цена Alibaba против указанной ставки AA)br />• Релиз — 23 июля 2026 (публичная предварительная версия, Foundry) против 21 июля 2026, международный API 4 августаbr />• Ввод текста — 32 000 токенов, контекст 131k против окна запроса на 4 500 токеновbr />• Потолок вывода — ~1 048 576 пикселей (~1K) против до 2048×2048br />• Изображений за вызов — одно изображение на запрос против до шести изображений за вызовbr />• Ранг редактирования — № 1, Elo 1 272 (AA) против 1 249 у Qwen-Image-3.0-Pro в том же рейтингеbr />• Происхождение — заявление Microsoft об «отсутствии дистилляции из сторонних моделей» против маркировки происхождения AIGC на выходных данныхbr />• Веса — закрытые, только API против закрытых, только API
Потолок выходных данных и количество изображений за вызов важнее, чем кажется. Qwen-Image 3.0 может создавать изображение 2048×2048 и возвращать до шести изображений за один вызов — это преимущество для экономики пакетной обработки; тариф Pro упирается в потолок около 1K и выдаёт один результат на запрос. Если ваша задача — «дайте подборку из шести продуктовых снимков», модель Alibaba создана именно для этого, а модель Microsoft — нет.

Когда премия окупает себя
Решающее правило касается того, для чего предназначены изображения, а не того, какая модель «лучше».
• Платите премию за MAI-Image-2.5-Pro когда результат — главный актив: продуктовый визуал, постер, ключевой кадр, изображение, которое попадает в кампанию и не будет перегенерировано пятьдесят раз. Первое место в рейтинге редактирования и заявление о консистентности персонажей важнее всего, когда правка должна быть выполнена правильно с первого раза.
• Покупайте объем с Qwen-Image 3.0, когда результат одноразовый или массовый — локализованные варианты рекламы, черновые иллюстрации, слайды из эскизов, кадры раскадровки, все, что вы скорее перегенерируете, чем будете дорабатывать. При $25–30 за 1 тыс. неудачная генерация — это ошибка округления; при $108.50 за 1 тыс. — уже нет.
Существует промежуточный вариант, который стоит назвать: для плотной многоязычной работы с текстом в изображениях — макета целевой страницы с японским и испанским текстом, инфографики с формулами — разборчивость Qwen при 10 px и двенадцать языков лучше подходят на бумаге, и при этом по цене в четверть меньше. Контраргумент модели Microsoft — заявленная точность 96,8% на пяти языках, но это утверждение не проверено, и покупателю, выбирающему между двумя непроверенными текстовыми утверждениями, вероятно, следует учитывать цену.

Слой маршрутизации, когда он применяется
Ни одна из моделей пока недоступна через OrcaRouter — Qwen-Image 3.0 работает на собственном API Alibaba (Alibaba Cloud Bailian и платформа Qwen) и на нескольких сторонних платформах, а MAI-Image-2.5-Pro — на Microsoft Foundry, поэтому честное сравнение прямо говорит: ни одна из них сегодня не на нашей стороне. Когда любая из них станет доступна через вызываемого управляемого провайдера, действует сквозная экономика: 0% наценки к прейскуранту провайдера, так что вы платите по тарифу вендора, а запусковая скидка или снижение цены появляется в вашем счете в тот же день, когда она анонсирована. Аргумент о переключении при отказе — вторая половина: Qwen-Image 3.0 — это международный API недельной давности, модель, на которую вы направляете часть трафика, пока проверенный резервный вариант поглощает крайние случаи, — именно та схема, для которой и создан маршрутизирующий слой.
Вердикт
Qwen-Image 3.0 и MAI-Image-2.5-Pro — это не один и тот же продукт по разным ценам; это разные продукты, которым просто установлены разные цены. Модель Microsoft завоёвывает корону в редактировании, обладает более широким контекстным окном и заявляет о непроверенной точности на пяти языках — для ключевых визуальных материалов и точечного редактирования надбавка к цене оправдана. Модель Alibaba более разборчиво отображает больше шрифтов, принимает более плотные технические задания на генерацию на своих условиях, выдаёт изображения большего размера партиями по шесть штук и стоит вчетверо дешевле — для объёмных и многоязычных задач с текстом в изображении это экономически рациональный выбор. Покупайте премиум там, где изображение — это продукт; покупайте объём там, где изображение — это инвентарь.
