Сгенерированная карточка главного заголовка с надписью «Solar Mini 4 vs Qwen3.8-Max», подзаголовком «Сколько на самом деле стоили последние двадцать пунктов индекса» и двумя бейджами: «24,1 против 45,4 по индексу» и «$0,36 против $5,41 за задачу».
Guides & Insights

Solar Mini 4 против Qwen3.8-Max: чего на самом деле стоят последние двадцать пунктов индекса

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Solar Mini 4 стоит $0,10 за миллион входных токенов и $0,40 за миллион выходных токенов. Qwen3.8-Max — модель, которую большинство людей имеет в виду, когда вводит «Qwen 3.8» и просит API, — стоит $2,00 и $6,00. Если смотреть на тарифную сетку, это выглядит как двадцатикратная разница в цене за входные токены. Согласно независимой оценке, которую обе модели уже прошли, честная цифра такова: Qwen3.8-Max набирает 45,4 балла в Artificial Analysis Intelligence Index против 24,1 у Solar Mini 4 — примерно вдвое больше измеренной способности — при этом обходясь примерно в пятнадцать раз дороже за выполненную задачу. Всё, что стоит знать об этой паре, заключено в разрыве между этими двумя соотношениями и в том, что модель Upstage работает со скоростью 204 токена в секунду, а флагман Alibaba — 39.

Одно замечание по названиям перед цифрами, потому что это меняет то, что вы покупаете. Qwen 3.8 — это поколение, а не модель: хостируемая флагманская модель — Qwen3.8-Max, обновлённая как датированный снимок 0902, а загружаемый представитель того же поколения — Qwen3.8-2.4T-A95B, веса на 2,4 триллиона параметров, опубликованные Alibaba 12 августа 2026 года. Solar Mini 4, выпущенная 22 сентября 2026 года, — это разреженная смесь экспертов от Upstage на 35 миллиардов параметров, с примерно 3 миллиардами активных параметров на токен и без открытых весов ни за какую цену.

Два столбца, по измерениям, которые определяют закупку

• Индекс интеллекта — 45,4 у Qwen3.8-Max (0902) против 24,1 у Solar Mini 4; оба — Intelligence Index v4.3.2.

• Стоимость одной выполненной задачи — $5,41 у Qwen3.8-Max против $0,36 у Solar Mini 4. Примерно пятнадцать к одному — и об этом соотношении никто не говорит.

• Тарифная сетка — $2.00 / $6.00 за миллион токенов, кэшированный ввод $0.25, для Qwen3.8-Max против $0.10 / $0.40, кэшированный ввод $0.01, для Solar Mini 4.

• Контекст — 1 000 000 токенов у обеих, и это единственное измерение, в котором дешёвая модель ни в чём не уступает. Artificial Analysis указывает 983 616 для Qwen3.8-Max и 1 048 576 для Solar Mini 4; в собственной документации Upstage значится 512K, так что потолок меньшей модели — из этих двух менее определённый.

• Веса — Qwen3.8-Max — проприетарная модель, размещаемая провайдером; её открытый аналог Qwen3.8-2.4T-A95B можно скачать по специальной лицензии, и он набирает 39.9 по тому же индексу при 262 000 токенов контекста. Solar Mini 4 — проприетарная модель, не имеющая открытого аналога.

• Пропускная способность — 103 выходных токена в секунду у Solar Mini 4 против 39,5 у Qwen3.8-Max по измерениям той же лаборатории. Модель, которая на одну задачу обходится в пятнадцать раз дешевле, выполняет её в пять раз быстрее.

Что покупают двадцать один индексный пункт

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

Они выбирают сложный край распределения. На Humanity's Last Exam Qwen3.8-Max правильно отвечает на 43,1% заданий против 25,8% у Solar Mini 4. В научном программировании — 52,1% против 47,6%. В агентной работе со знаниями разрыв расширяется и переходит в другую категорию: Qwen3.8-Max достигает 1663 Elo на GDPval-AA, тогда как Solar Mini 4 набирает 1072 — почти шестьсот пунктов Elo, и это не разница на уровне округления, а изменение того, что модели можно доверить делать без присмотра.

Единственная оценка, где небольшая модель не просто удерживает позиции, а побеждает, — это рассуждение с длинным контекстом. Solar Mini 4 набирает 83,3% в AA-LCR v1.1, а Qwen3.8-Max — 80,3%. Это самый сильный аргумент в пользу Solar Mini 4 во всём этом сравнении: на бенчмарке, созданном для проверки умения «прочитать очень длинный документ и рассуждать по нему», в пятнадцать раз более высокая цена за задачу даёт результат на три пункта хуже.

Область, в которой ни одна из моделей не является подходящим инструментом, — это автономная работа в терминале. Solar Mini 4 набирает 1% в Terminal-Bench 4.0; Qwen3.8-Max — 38,9%. Модель, которая проходит восемь из двадцати сложных терминальных задач, действительно пригодна для такой работы, а другая — нет, и это самый ясный пример в данном сравнении качественного, а не количественного разрыва.

Почему счёт флагмана за задачу намного хуже, чем можно предположить по цене его токена

Qwen3.8-Max выдаёт больше выходных токенов на задачу, чем Solar Mini 4, — 107 700 токенов против 88 300 — и делает это по $6.00 за миллион, а не по $0.40. Вот где кроется большая часть разрыва — ещё до учёта поведения кеша. Alibaba действительно предлагает тариф $0.25 за кешированный ввод, что является реальной скидкой по сравнению с ценой ввода $2.00, а открытый собрат этого семейства, Qwen3.8-2.4T-A95B, — это разреженная модель с 2,4 трлн параметров, из которых активны около 95 млрд, так что каждый производимый ею токен создаётся существенно более крупной машиной. Ничто из этого не является критикой. Это причина, по которой существует пятнадцатикратный множитель на задачу, и причина, по которой сравнение цен за токен между этими двумя моделями вводит в заблуждение в обе стороны.

Практическое следствие: Solar Mini 4 — это не «бюджетный Qwen 3.8». Это специалист, который, так уж вышло, дешёвый, быстрый и силён ровно в одном измерении — длинных документах — и слаб в том измерении, где ошибка обходится дороже всего, а именно в надёжности агентных систем. Qwen3.8-Max — это универсал, чьё преимущество проявляется именно там, где неверный ответ стоит дорого.

Запуск пары вместо выбора между ними

Это необычный случай в серии Solar Mini 4, когда обе стороны сравнения — это маршруты, которые мы действительно можем вам продать. Qwen3.8-Max и его датированный 0902 снимок доступны на OrcaRouter по собственному прайсу вендора $2.00 / $6.00, наряду с Qwen3.8-Flash по $0.15 / $0.47 и Qwen3.8-27B по $0.33 / $2.40 — три ступени одного поколения, один ключ, без второго контракта и без изменений в коде, кроме строки с названием модели. По состоянию на 1 октября 2026 года наши собственные измерения в песочнице показывают Qwen3.8-Max на уровне p50 в 2,5 секунды при 87,7 выходных токенов в секунду за последние семь дней; это окно скользящее, так что читайте актуальную карточку модели, а не это предложение. Модели Upstage недоступны через нас, и до Solar Mini 4 можно добраться только через собственный API Upstage.

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

Что это делает возможным, так это разделение, за которое выступает данное сравнение: отправлять трафик длинных документов, корейскоязычный трафик и трафик структурированного извлечения куда-нибудь подешевле, направлять запросы, требующие интенсивных рассуждений и использования инструментов, на флагманскую модель, а также позволять переключению при сбое подстраховывать провайдера, у которого выдался неудачный день. Именно здесь routing DSL оправдывает своё место — объединение моделей в один вызов означает, что дешёвый первый проход и дорогостоящий проход проверки могут стать одним запросом к одной конечной точке вместо двух интеграций, которые необходимо поддерживать синхронизированными.

Краткая версия

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

Если ваша нагрузка — это длинный контекст, фиксированная форма вывода и приемлемый бюджет задержки, Solar Mini 4 даёт вам 83% результата для длинного контекста при пятнадцатой части стоимости задачи и пятикратной пропускной способности, а двадцати одного недостающего индексного балла на вашем дашборде не будет никогда. Если ваша нагрузка подразумевает инструменты, многошаговых агентов или вопросы, где уверенный неверный ответ хуже отсутствия ответа, недостающие баллы — это и есть весь продукт, и Qwen3.8-Max стоит пятнадцатикратной цены. Каждая цифра, приписываемая выше Artificial Analysis, — это независимое измерение этой организации; названия и даты релизов Qwen3.8 принадлежат Alibaba, а показатели обслуживания OrcaRouter — это наши собственные измерения на тестовом стенде за скользящее семидневное окно.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube