Сгенерированная hero-карточка под названием «Claude Haiku 5.5 против Aion 3.5» с надзаголовком «ЦЕНА ВВОДА В 30 РАЗ ВЫШЕ» и подзаголовком «У одного есть оценка. У другого — нет.», содержащая чипы: $0.10 против $3.00 за миллион входных токенов, AA Index 43 против отсутствия и контекст 1M против 262K.
Guides & Insights

Claude Haiku 5.5 против Aion 3.5: в тридцать раз выше цена за вход для модели, которую никто не оценивал

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Haiku 5.5 стоит $0.10 за миллион входных токенов. Aion 3.5 — $3.00. Это в тридцать раз больше цены за входные токены и в двенадцать раз больше цены за выходные токены для двух моделей, которые обе принимают длинный текстовый промпт и возвращают текст, и этот разрыв объясняется не возможностями — он объясняется тем, что продаёт каждая компания. Claude Haiku 5.5, выпущенная 7 октября 2026 года, — это рабочая лошадка по цене массового товара с регулятором усилий и независимой оценкой. Aion 3.5, выпущенная 23 сентября 2026 года компанией AionLabs, — это ансамбль с обязательным режимом рассуждений, который выпускается в двух размерах, один из которых по-настоящему дёшев. Стоит ли платить тридцатикратную надбавку, полностью зависит от вопроса, на который поставщик не ответил.

Неприятная часть — сразу, без обиняков: Artificial Analysis оценила Claude Haiku 5.5 и никогда не публиковала оценку для Aion 3.5. Никто другой, кого мы смогли найти, тоже этого не сделал. Так что это не сравнение двух измеренных вещей. Это сравнение одной измеренной вещи с одним набором заявлений вендора, и честный способ написать об этом — говорить так в каждом разделе, а не один раз в сноске.

Две модели, по одному абзацу на каждую

Claude Haiku 5.5 — это малая модель производителя, ID claude-haiku-5-5, текст и изображения на входе и текст на выходе, контекстное окно 1 млн токенов, максимальный объём вывода 128 000 токенов (300 000 с бета-заголовком в Batch API), обучение завершено в июне 2026 года и обязательство Anthropic не выводить её из эксплуатации до 7 октября 2027 года. Уровень усилий регулируется: Low, Medium, High, Xhigh, по умолчанию — Medium; адаптивное мышление включено по умолчанию. Чтение из кэша стоит $0.01 за миллион токенов. При объёме промпта свыше 100 000 токенов тарифы на ввод и вывод умножаются на пять.

Aion 3.5 — флагман AionLabs, ID aion-labs/aion-3.5, и она работает только с текстом в обоих направлениях. Контекст — 262 144 токена — вдвое больше, чем 131 072 у Aion 3.0 — при максимальном объёме вывода 32 768 токенов. Рассуждения обязательны, а не опциональны; по умолчанию — высокий уровень, который можно переключить на максимальный или снизить до низкого. Архитектурно она описывается как мультимодельный ансамбль в семействе GLM, а не как единая обученная сеть, — это самое интересное в ней и одновременно самое сложное для внешней проверки. Цена составляет $3,00 за миллион входных токенов, $0,75 за кэшированный ввод и $6,00 за вывод, одинаково по всему окну. Aion 3.5 Mini, выпущенная в тот же день, стоит $0,70 / $0,18 / $1,40 за тот же контекст 256K — и именно этот младший собрат делает это сравнение интересным.

A capture of the AionLabs documentation page listing available models and their pricing, showing Aion 2.0, Aion 3.0, Aion 3.0 Mini, Aion 3.5 and Aion 3.5 Mini with their context windows and per-million input, cached-input and output rates, including Aion 3.5 at 256K context and Aion 3.5 Mini at the lower tier.

• Размеры, по одному в строке

• Цена ввода — Claude Haiku 5.5 $0,10 за миллион до 100K токенов, повышается до $0,50 выше этого порога; Aion 3.5 $3,00 неизменна на всём 256K-окне.

• Цена вывода — Claude Haiku 5.5: $0.50 за миллион до 100K, затем $2.50; Aion 3.5: $6.00 фиксированно.

• Кэшированный ввод — Claude Haiku 5.5: $0.01 за миллион при чтении и $0.125 за пятиминутную запись; Aion 3.5: $0.75 за кэшированный ввод, при этом отдельная ставка за чтение не публикуется.

• Контекстное окно — 1 000 000 токенов против 262 144.

• Максимальный объём вывода — 128 000 токенов против 32 768.

• Входные модальности — текст и изображения против только текста.

• Управление рассуждениями — пятипозиционный регулятор усилий от Low до Max против трёх позиций, где High установлен по умолчанию.

• Независимая оценка — Artificial Analysis Intelligence Index: 43, в конфигурации Max — 43,40; второе место среди 182 моделей; для Aion 3.5 данные не опубликованы.

• Стоимость одной завершённой задачи — 0,21 доллара США за задачу индекса Artificial Analysis для Claude Haiku 5.5; не поддаётся измерению для Aion 3.5 без оценки.

• Скорость вывода — 243,4 токена в секунду для Claude Haiku 5.5; для Aion 3.5 не указана.

Почему фиксированная ставка — не такое преимущество, как кажется

Фиксированная цена Aion 3.5 — $3,00 на всём диапазоне 256K — это самое чистое в его ценообразовании, и это прямой ответ на неловкость на стороне Anthropic: запрос, который вырастает с 99 000 до 101 000 токенов, стоит в пять раз больше за токен, что вынуждает вас либо держаться значительно ниже этой границы, либо полностью отказаться от дешёвого диапазона. У Aion 3.5 нет такой границы. Вы можете отправить 240 000 токенов и платить ту же ставку за токен, что и за 4 000.

Это преимущество исчезает, как только вы посчитаете на реальной нагрузке. Запрос на 240 000 токенов к Aion 3.5 стоит около $0,72 по входным данным; тот же запрос к Claude Haiku 5.5 выше порога стоит около $0,12. Даже при оплате штрафного тарифа после 100K Haiku 5.5 примерно в шесть раз дешевле на самом большом промпте, который может обработать любая из этих моделей. Единый тариф устраняет скачок, а не затраты.

Фиксированное ценообразование действительно помогает в одном — в предсказуемости. Пайплайн, размер промпта которого колеблется между 80 000 и 130 000 токенов, мучительно планировать по бюджету в многоуровневой схеме и элементарно — в фиксированной; и если это ваш случай, фиксированность Aion 3.5 кое-что значит ещё до того, как в разговор вступают возможности.

Аргументы в пользу Aion 3.5, изложенные настолько убедительно, насколько позволяют доказательства

Три аргумента состоятельны. Во-первых, обязательное рассуждение при высоком значении по умолчанию означает меньше работы над промптами: нет параметра усилия, который нужно настраивать, и нет риска, что низкая настройка незаметно ухудшит задачу, которую никто не перепроверял. Во-вторых, ансамбль в семействе GLM имеет действительно иной профиль отказов, чем отдельная небольшая модель Anthropic, и если вы уже используете Claude Haiku 5.5 во множестве сценариев, некоррелированное второе мнение имеет ценность даже при цене за входные данные в тридцать раз выше — обращаться к нему вы будете редко. В-третьих, Aion 3.5 Mini за $0.70 / $0.18 / $1.40 с тем же контекстом 256K — это убедительный дешёвый уровень, и любое сравнение, которое смотрит только на флагман, сравнивает не ту модель Aion.

Не выдерживает критики трактовка тридцатикратной наценки как доказательства тридцатикратного превосходства в возможностях. Нам не удалось найти ни одного бенчмарка, опубликованного AionLabs для Aion 3.5, ни одна независимая лаборатория не оценивала её, а к заявлению об ансамбле не приложено никаких публичных оценок. Вендор, у которого есть модель сильнее Claude Haiku 5.5 и который может это продемонстрировать, продемонстрировал бы это.

Где Claude Haiku 5.5 безоговорочно побеждает, причём с большим отрывом

Ввод изображений — это первое. Aion 3.5 работает только с текстом, а Claude Haiku 5.5 принимает изображения, что решает исход любой задачи с документами, скриншотами или диаграммами ещё до того, как речь заходит о цене. Максимальный объём вывода — это второе: 128 000 токенов против 32 768, с бета-путём на 300 000 токенов в Batch. И регулятор усилий, который является механизмом контроля затрат, а не возможностью: на уровне Low Claude Haiku 5.5 создаёт гораздо меньше токенов рассуждений, а поскольку рассуждения тарифицируются как вывод, именно так вы удерживаете многословного агента в дешёвом диапазоне.

Независимая оценка — последнее слово в этом вопросе. В индексе Artificial Analysis Claude Haiku 5.5 имеет 43 балла в общем зачёте и 43,40 в конфигурации Max, занимая второе место среди 182 моделей, при $0,21 за задачу индекса и 243,4 токена в секунду на выходе. Это независимо полученные результаты. У Aion 3.5 их нет, и пока они не появятся, покупатель фактически сравнивает «модель с опубликованной оценкой и ценой, которую я могу предсказать» с «моделью с более высокой ценой и без оценки», а для продакшена это не сложный выбор.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Aion 3.5 — the scoreboard'. Claude Haiku 5.5 reads input $0.10 to $0.50 per million, output $0.50 to $2.50, 1M-token context, 128K maximum output, AA Index 43, text and image in; Aion 3.5 reads input $3.00 flat, output $6.00 flat, 262K context, 32K maximum output, no published independent score, text only. A footer notes that Claude Haiku 5.5 figures are per Artificial Analysis and Aion 3.5 figures are vendor-reported and unreproduced.

Запуск обоих без удвоения инфраструктуры

Aion 3.5 доступен через собственный API AionLabs и несколько сторонних платформ. Claude Haiku 5.5 доступен через API Anthropic и, оттуда, везде, где перепродаются модели Anthropic. Ни того, ни другого сегодня нет в каталоге OrcaRouter, и мы не станем утверждать обратное: из этого сегмента рынка мы маршрутизируем anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 и anthropic/claude-fable-5.1 — уровень выше той модели, о которой говорится в этой статье.

Причина, по которой это здесь важно, в том, что разумная архитектура для такого сочетания — небольшая доля трафика на дорогой модели. Вы не переводите пайплайн на ансамбль за $3,00 за миллион; вы отправляете ему те два процента вызовов, где второе мнение стоит $3,00, а всё остальное оставляете на дешёвой модели. Это означает двух провайдеров, два ключа и два биллинговых контура для нагрузки в два процента — именно для такой конфигурации и предназначен шлюз. OrcaRouter передаёт прайс-листовую цену провайдера без наценки (0%), поэтому изменение цены поставщика становится актуальным в тот же день, а не в цикле пересмотра цен, а A/B — это строка модели, а не вторая интеграция. Если ни одно из плеч не представлено в нашем каталоге, честный ответ таков: мы — неподходящий слой для этого, и вам нужна прямая интеграция.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

Что могло бы это уладить?

Одна независимая оценка Aion 3.5. Вот и весь недостающий фрагмент. Если нейтральная лаборатория оценит её где-то рядом с 43 баллами Claude Haiku 5.5 при $0,21 за задачу, то AionLabs берёт в тридцать раз больше цены за ввод ради паритета, и история с ансамблем — это скорее обуза, чем преимущество. Если она наберёт существенно больше, то наценка оправдана, и правильный ход — потратить её на небольшую долю вызовов, которым она нужна. Пока такого числа нет, покупатель, выбирающий между этими двумя, выбирает либо измеренную модель по опубликованной цене, либо неизмеренную по более высокой — и в этой паре есть только один защитимый вариант по умолчанию.

Это означает двух провайдеров, два ключа и две биллинговые системы для рабочей нагрузки в два процента — именно для этого шлюз и предназначен.