Сгенерированная титульная карточка, сравнивающая Aion 3.5 Mini слева с подписью «закрытый API — без опубликованных оценок» и Gemma 4 12B справа с подписью «Apache 2.0 — карточка оценки от вендора», а внизу — лента с надписью «Одна и та же задача, разные доказательства».
Guides & Insights

Aion 3.5 Mini против Gemma 4 12B: у одного из них есть табло результатов, а у другого — ценник.

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Aion 3.5 Mini и Gemma 4 12B — это покупка одного и того же рода лишь в одном отношении: обе — небольшие модели, которые уже сегодня можно вызвать через API. AionLabs выпустила Aion 3.5 Mini 23 сентября 2026 года как закрытую текстовую мультимодельную систему по цене $0.70 за миллион входных токенов и $1.40 за выходные. DeepMind выпустила Gemma 4 12B 3 июня 2026 года как модель с открытыми весами на 11,95 млрд параметров под лицензией Apache 2.0, с мультимодальным входным путём без энкодера и опубликованной картой оценки. Практическая разница не в количестве параметров и не в строке цены. Она в том, что одну из этих моделей можно измерить до того, как вы решитесь на покупку, а другую измерить нельзя вообще.

Всё ниже об Aion 3.5 Mini взято из собственного опубликованного списка моделей AionLabs и конфигурации, обслуживаемой в его API. Всё о Gemma 4 12B взято из карточки модели вендора, откуда происходят её числовые данные, а также из стороннего оценочного стенда, который фактически её запускал. Там, где показатель указан вендором, это отмечено соответствующим образом. Независимой оценки какой-либо модели Aion не существует, и это утверждается как факт, а не как оговорка.

Где эти два на самом деле совпадают

Меньше мест, чем предполагает метка «малая модель», а насчёт тех, что действительно совпадают, стоит быть точным, потому что именно их покупатель проверяет в первую очередь.

• Контекст — Aion 3.5 Mini вмещает 262 144 токена. Gemma 4 12B имеет окно в 256K. Номинально паритет, и на практике оба достаточно велики, чтобы контекст не был решающим критерием.

• Максимальный вывод — Aion 3.5 Mini ограничивает один ответ 32 768 токенами, потолок, общий для всего каталога Aion. Gemma 4 12B не публикует эквивалентного ограничения в виде одного числа на своей карточке, так что это параметр, который вам придется тестировать, а не читать.

• Вызов инструментов — обе модели его поддерживают. Aion 3.5 Mini принимает определения инструментов, формат ответа JSON и temperature на OpenAI-совместимом эндпоинте. Gemma 4 12B поставляется с поддержкой вызова функций в своей версии, дообученной следовать инструкциям.

• Управление рассуждениями — Aion 3.5 Mini выполняет рассуждения при каждом вызове и предоставляет три уровня усилий: max, high и low, причём high используется по умолчанию; рассуждения не опциональны. Gemma 4 12B поставляется в вариантах с рассуждениями и без них, и эти два варианта показывают разные результаты на одном и том же тестовом стенде, поскольку выполняют разный объём работы.

• Входная модальность — это первый пункт, где они резко расходятся. Aion 3.5 Mini — текст на входе, текст на выходе, и архитектура не предусматривает ввод изображений. Gemma 4 12B принимает текст, изображение, аудио и видео на входе и возвращает текст.

Что Gemma 4 12B может вам показать

Gemma 4 12B выходит с картой оценки от вендора, и приведённые на ней цифры сообщены вендором, а не независимо воспроизведены, — но они существуют, они конкретны и охватывают те оси, о которых покупатель действительно спорит.

• Заявленные производителем способности к рассуждению и знания — MMLU Pro 77,2, GPQA Diamond 78,8, HLE без инструментов 5,2, BigBench Extra Hard 53,0, MMMLU 83,4.

• Заявленные производителем показатели программирования — LiveCodeBench v6 72.0, рейтинг Codeforces ELO 1659, AIME 2026 без инструментов 77.5.

• Агентные возможности по данным вендора — Tau2, усреднённый по трём запускам, 69,0, и Codeforces ELO вновь как самый сильный отдельный результат в карточке.

• Мультимодальные результаты по данным производителя — MMMU Pro 69.1, MATH-Vision 79.7, MedXPertQA MM 48.7. В карточке отсутствует строка DocVQA; ближайший показатель для документов — среднее расстояние редактирования OmniDocBench 1.5, равное 0.164.

• Воспроизведение длинного контекста — MRCR v2, 8-needle, 128k, 43,4. Это честное слабое место в карточке, и его стоит прочитать, прежде чем предполагать, что окно в 256K ведёт себя как окно в 256K на дальнем конце.

• Измерение третьей стороной — Artificial Analysis на собственном тестовом стенде указывает для Gemma 4 12B Reasoning Intelligence Index, равный 14, и Non-reasoning Index, равный 9, скорость вывода около 113 токенов в секунду в режиме рассуждений и цену по прайс-листу $0,10 за вход и $0,30 за выход за миллион токенов. Пересмотры индекса меняются от снимка к снимку, поэтому относитесь к индексу как к ориентировочному, а к цене и скорости — как к устойчивым показателям.

A screenshot of the Hugging Face model card for google/gemma-4-12b, showing the model blurb 'Google | Gemma 4 | 12B | Apache 2.0 | Text, Image, Audio, Video -> Text | 256K context' and the description that Gemma 4 models are multimodal, handling text and image input and generating text output.

Что Aion 3.5 Mini может показать вам

Цена, окно, описание архитектуры — и ничего больше. AionLabs не публикует ни одного показателя SWE-bench Verified, Terminal-Bench, GPQA или MMLU-Pro ни для одной модели в своём каталоге, а материалы запуска 3.5 вообще не содержат таблицы бенчмарков. У Artificial Analysis нет страницы для Aion 3.5 Mini, Aion 3.5, Aion 3.0 или Aion 3.0 Mini — ни одна из этих четырёх не представлена в индексе моделей.

Это отсутствие само по себе не обязательно является компрометирующим, и было бы неправильно представлять его таковым. AionLabs описывает свои модели как многомодельные системы, созданные для работы с повествованием и сторителлингом, с процессом совместной генерации, в котором несколько специализированных моделей вносят вклад в ответ. Приведённые выше составные индексы собраны из задач по математике, программированию и экономике — неподходящий инструмент для оценки прозы. Модель может быть по-настоящему хороша в деле, для которого она создана, и при этом плохо выступить в рейтинге по программированию или вообще никогда в него не попадать.

Что это отсутствие на самом деле означает, так это нечто более узкое и более жёсткое: вы не можете вычислить стоимость в расчёте на выполненную задачу. $0.70 и $1.40 для Aion 3.5 Mini — это прейскурантные цены без измеренного знаменателя. У $0.10 и $0.30 для Gemma 4 12B есть привязанный измеренный знаменатель, и тот же тестовый стенд, который его измерил, также сообщает стоимость за задачу. В этом и состоит асимметрия, и она выдерживает любые доводы о том, правильные ли это бенчмарки.

Разрыв в цене больше, чем, вероятно, будет разрыв в возможностях.

Поставьте две тарифные карты рядом — и форма решения меняется. Aion 3.5 Mini взимает $0,70 за миллион входных токенов и $1,40 за миллион выходных. Gemma 4 12B указана по цене $0,10 за вход и $0,30 за выход в стороннем тестовом стенде, который её измеряет. Это в семь раз больше ставки за вход и примерно в четыре с половиной раза больше ставки за выход — для модели, чей собственный вендор не публикует никакой оценки, с которой можно было бы сравнить.

Две вещи усложняют прямое умножение, и обе ещё больше склоняют чашу весов в пользу Gemma 4 12B. Во-первых, Aion 3.5 Mini выполняет рассуждения при каждом вызове, поэтому строка вывода содержит токены, которые вы не запрашивали и не можете ограничить, — AionLabs не публикует никаких заявлений о том, сколько токенов модель тратит на размышления на любом из трёх уровней усилий. Gemma 4 12B позволяет отключить этап размышления, что меняет и счёт, и задержку. Во-вторых, Gemma 4 12B — это открытые веса под Apache 2.0, поэтому $0.10 и $0.30 — лишь один вариант среди нескольких, а не единственный способ её запуска.

Ничто из этого не решает, какая модель пишет лучше, потому что никто не измерял ни одну из них по этой оси. Зато это решает, какую из них можно поставить перед стейкхолдером.

Запуск их обоих вместе

Полезный ход здесь — не выбирать что-то одно. Aion 3.5 Mini и Gemma 4 12B находятся за разными интерфейсами, но используют одно и то же соглашение о вызовах: AionLabs предоставляет OpenAI-совместимую конечную точку, а Gemma 4 12B обслуживается обычными OpenAI-совместимыми средами выполнения. Это делает их взаимозаменяемыми на уровне базового URL, а значит, цепочку дёшево построить: Aion 3.5 Mini — первым для запросов, где ансамбль и есть причина, по которой вы обращаетесь именно к нему; Gemma 4 12B — следом за ним для всего, где нужна взвешенная модель, переключаемый шаг размышления и тарифная сетка вчетверо меньше.

Шлюз, который выставляет несколько сотен моделей под одним ключом, — именно это превращает такую цепочку в одну строку конфигурации, а не во вторую интеграцию, и именно здесь правило отказоустойчивости оправдывает себя: ошибка 429 или сбой у провайдера поглощается ещё до начала ответа, а не всплывает как проваленная задача. Когда вендор меняет свой тариф, сквозной роутер тарифицирует по прайс-листу провайдера без каких-либо наценок за токен, так что изменение вступает в силу в тот же день, а не в следующем расчётном цикле. Одна деталь, которую стоит проверить, а не предполагать: ни Aion 3.5 Mini, ни Gemma 4 12B не обслуживаются на каждой платформе, где размещены модели такого размера, а Gemma 4 12B в частности отсутствует в некоторых каталогах, где есть её более крупные собратья. Убедитесь, что идентификатор разрешается, прежде чем подключать его.

A screenshot of AionLabs' own documentation site, the Introduction / LLM API page, showing that the vendor serves its models through an OpenAI-compatible REST API at https://api.aionlabs.ai/v1 supporting chat completions and model discovery, with API-key authentication and a signed-in browser workspace for testing prompts.

Как решить

• Если вам нужна цифра до того, как вы примете решение — Gemma 4 12B. Это единственная из двух с опубликованной карточкой оценки и сторонним индексом, и оценка предшествует вашему решению, а не следует за ним.

• Если вам нужен ввод изображений, аудио или видео — Gemma 4 12B. Aion 3.5 Mini заявляет только «текст в текст» и ничего больше.

• Если вам нужно владеть этой штукой — Gemma 4 12B. Веса под Apache 2.0 означают, что вы можете дообучать, квантовать или хостить её самостоятельно; Aion 3.5 Mini — закрытая система, веса которой нельзя скачать.

• Если нарратив и длинная проза — это вся работа, то это тот случай, когда сравнение не работает для вас. Aion 3.5 Mini создавалась именно для такой работы, а Gemma 4 12B — как универсальная модель, и ни одна опубликованная цифра не скажет, какая из них пишет лучше. Попробуйте её на задаче, которую можете позволить себе потерять.

• Если стоимость за выполненную задачу — решающий критерий, то {{1}}Gemma 4 12B{{/1}} — уже по одной только арифметике, и разрыв тем больше, чем сильнее задача зависит от выходных токенов.

Обе модели выпущены недавно, обе работают, и лишь одна из них просит верить ей на слово. Обоснованное резюме таково: Gemma 4 12B — измеримый вариант по умолчанию, а Aion 3.5 Mini — специалист, которого вы внедряете осознанно, а не по результатам сравнения; и если вы всё же внедряете его, внедряйте его рядом с резервным вариантом, а не вместо него.

A generated scoreboard comparing Aion 3.5 Mini and Gemma 4 12B across six rows: published scores (none vs vendor card), price in / out ($0.70 / $1.40 vs $0.10 / $0.30), context (262,144 vs 256K), inputs (text only vs text, image, audio, video), weights (closed vs Apache 2.0) and reasoning (mandatory, 3 levels vs switchable off). Footnoted that Aion figures are unaudited and vendor-published and that Gemma figures are vendor-reported with the index per Artificial Analysis.