Сгенерированная титульная карточка с заголовком «Pareto 26.10 Preview vs Pareto» и подзаголовком «Одна и та же строка модели, два разных релиза», над тремя карточками с текстом «Контекст: 1M против 262K», «Цена: $0.80 / $3.20 против $2.50 / $7.50» и «Стабильность: preview против stable», с нижним колонтитулом «Оба релиза обслуживаются Unbiased под строкой модели pareto; цифры согласно публичному листингу.»
Guides & Insights

Pareto 26.10 Preview против Pareto: одна и та же строка модели, две разные модели

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Unbiased выпустила Pareto 26.10 Preview 1 октября 2026 года и оставила предыдущий релиз, Pareto, указанный рядом с ним. Это не варианты одного семейства, между которыми выбирают с помощью флага. Это два релиза под одним брендом, и собственная строка модели вендора — pareto — теперь указывает на более новый, явно нестабильный выпуск. Так что вопрос сравнения на самом деле не «что лучше». Он в том: до какого из них фактически доходит ваш запрос, и что происходит с ответом, когда это меняется у вас под ногами?

Единственное место, где о них двоих говорится в одном контексте, — это публичный технический листинг модели. Собственная карточка модели Unbiased, страница с ценами и FAQ описывают один составной продукт и ни разу не упоминают о разделении. Эта асимметрия — подробный публичный diff с одной стороны и молчание с другой — и есть честная отправная точка для прямого сравнения, потому что из неё видно, откуда взялось каждое число ниже.

Шесть измерений, обе стороны

Всё, что отличает эти релизы, заключено в этих шести строках. Слева — Pareto 26.10 Preview; справа — релиз Pareto от 17 сентября, тот, который в тексте каталога предварительной версии называется стабильным выбором.

• Контекстное окно — 1 048 576 токенов против 262 144 токена. Вчетверо больше места — на бумаге, при этом ни один из них не предлагает меньшего тарифа.
• Максимальный вывод — 131 072 токена против 131 072 токена. Без изменений. Большее окно не принесло более длинного ответа.
• Цена ввода при маршрутизации — $0,80 за миллион против $2,50 за миллион. Предварительная версия стоит примерно треть от цены по этому прайс-листу.
• Цена вывода при маршрутизации — $3,20 за миллион против $7,50 за миллион. Меньше половины.
• Кэшированный ввод при маршрутизации — $0,03 за миллион против $0,25 за миллион. Здесь больше всего выигрывают самые длинные траектории агента.
• Опубликованная таблица бенчмарков — четыре оценки, явно «предварительные» и «могут измениться до окончательной публикации», против полного отсутствия опубликованной таблицы бенчмарков.

Две из этих строк — те, что определяют реальную работу. Контекстное окно — это заголовок, который вендор не укажет на своём собственном сайте: оно живёт в листинге, а не в карточке модели, — а цена кэшированного ввода — это то, что меняет счёт агента, а не его потолок. Всё остальное — либо маркетинговая дельта, либо, в случае оценки выходных данных, реклама: публиковать цифры предпросмотра с пометкой «предварительно» честнее, чем альтернатива, и это также предупреждение.

A generated two-column scoreboard titled "Pareto 26.10 Preview vs Pareto - the scoreboard". The left column, "Pareto 26.10 Preview", reads "Context: 1,048,576 tokens", "Max output: 131,072 tokens", "Input price: $0.80 / 1M", "Output price: $3.20 / 1M", "Cached input: $0.03 / 1M" and "Scores: four, preliminary". The right column, "Pareto", reads "Context: 262,144 tokens", "Max output: 131,072 tokens", "Input price: $2.50 / 1M", "Output price: $7.50 / 1M", "Cached input: $0.25 / 1M" and "Scores: none published". A footer reads "Both columns per the public listing; the vendor's own site lists $2.50 / $7.50 for both releases."

Цена, которую вы видите, зависит от того, куда вы смотрите.

Поставьте две тарифные карты рядом — и они не согласуются, а это как раз та часть сравнения, которую никто не объяснил.

Собственная платформа Unbiased в день, когда 26.10 Preview стал текущим релизом, всё ещё указывает $2.50 за миллион входных, $0.25 за кэшированные и $7.50 за выходные. Это сентябрьские цифры, без изменений, как на странице цен, так и на карточке модели. Более низкий набор — $0.80, $0.03, $3.20 — указан в листинге маршрутизированного каталога для того же превью. Таким образом, клиент, вызывающий pareto напрямую через API поставщика, платит по старой карточке за новую модель, в то время как в маршрутизированном листинге рекламируется примерно треть от этого. Оба действуют. Поставщик не опубликовал ни даты окончания акции, ни заявления, которое бы их согласовывало.

Это вопрос канала, а в предварительном релизе — ещё и вопрос времени: на какую бы из цифр вы ни опирались при моделировании затрат, другая отстаёт от того, чтобы стать верной, всего на одну заметку о релизе. Роутер, который транслирует прайс-листовую цену провайдера с наценкой 0 %, устраняет ровно это трение — изменение цены вендора вступает в силу в тот же день, а не на следующем пересмотре договора, — и это единственная структурная вещь, которую здесь стоит позаимствовать у OrcaRouter. Мы не поддерживаем ни один из релизов Unbiased на сегодняшний день, поэтому прямой ответ на вопрос «куда мне обращаться» — собственный API Unbiased, с тем из двух наборов цен, который окажется в листинге, через который вы покупаете. Причина сказать это вслух в том, что разница — в три раза, и превью — не то место, где стоит обнаружить, что вы заложили не ту цену.

Что вам даёт предпросмотр и чего он вам стоит

Собственное описание предварительной версии в каталоге задаёт условия: она «может измениться без уведомления», а всех, кому нужно предсказуемое поведение, отсылают к сентябрьскому выпуску. Это не шаблонная оговорка — это определение продукта. Сравните это с реальной картиной долгой сессии агента — и компромисс становится конкретным.

Агент, который поддерживает ход разговора, накапливает контекст, и именно в длинных диалогах кэширование промптов оправдывает себя. Изменённая модель за неизменной конечной точкой — классический способ всё потерять: кэш привязан к модели, создавшей токены, поэтому незаметная смена версии посреди траектории может аннулировать то, что вы уже закэшировали, и заново выставить счёт за работу, которую вы считали уже оплаченной. Собственная документация Unbiased разворачивает этот аргумент в другую сторону — она представляет свою смесь как кэш-стабильную, тогда как переключающий маршрутизатор — нет, — так что поставщик хорошо понимает этот риск и просто принимает его в обмен на выпуск preview-версии. Об этом стоит сказать прямо, потому что сбой незаметен в дашборде: токены по-прежнему тарифицируются, ответы по-прежнему возвращаются, а цифра просто больше, чем на прошлой неделе.

Плюсы превью-версии реальны и зеркально отражают её минусы. Вчетверо больше контекста, кэшированный ввод по цене в одну восьмую от тарифа стабильного релиза в маршрутизируемом листинге, и вообще есть таблица бенчмарков — у сентябрьского релиза опубликованных результатов никогда не было. Если ваша нагрузка связана с длинным контекстом и чувствительна к стоимости, нужна именно превью-версия, а способ взять её, не ставя на кон весь стек, — закрепить её осознанно: именованный эндпоинт для превью, именованный эндпоинт для стабильного релиза и резервный переход между ними, настроенный один раз. DSL маршрутизации существует именно для такой задачи — скомпонуйте обе версии как отдельные плечи, направьте на каждое по части реального трафика и позвольте журналу запросов показать, во что каждое обошлось на самом деле. Превью должно быть решением, которое можно отменить одной строкой конфигурации, а не свойством вашего эндпоинта, о котором вы узнаёте из счёта.

A generated three-card graphic titled "Where the version reaches you", with cards reading "Vendor API: model string pareto leads to 26.10 Preview", "Vendor pricing card: $2.50 / $7.50, unchanged" and "Listing: $0.80 / $3.20, may change without notice", and a footer reading "Read Oct 1, 2026; which release pareto points at is set by the release calendar."

Картина производительности, недостаточно стабильная, чтобы ей можно было доверять.

Каждый показатель выше взят из публичного листинга, и собственная панель производительности листинга менялась между чтениями в день запуска. Одно чтение страницы 26.10 Preview сообщало о медианной задержке 5,28 секунды и 35 токенов в секунду; опубликованное в тот же день сравнение бок о бок сообщало о 3,54 секунды и 21 токене в секунду для предварительной версии и 1,05 секунды и 45 токенов в секунду для сентябрьского релиза. Это не маленькие расхождения. У совершенно новой модели, обслуживаемой одним провайдером, узкая база измерений, и скользящее окно в течение нескольких часов будет смещаться.

Честно говоря, ни у одного из релизов нет показателя пропускной способности или задержки, достаточно стабильного, чтобы на него опираться при планировании, а для предварительной версии это заложено в сам продукт, а не является проблемой разового замера. У сентябрьского релиза по крайней мере есть недели трафика — в его листинге указана многодневная доступность на уровне 95–99% с полной историей провайдера за плечами. У предварительной версии — всего часы. Если вы выбираете между ними из-за скорости, а не цены или контекста, доказательств для выбора ещё не существует, и ответственный шаг — провести измерение на собственных промптах, а не считывать число с любой из страниц.

A screenshot of the OrcaRouter models catalogue headed "Models" and subtitled "208 models · 16 providers · one API key, one bill", with input-modality, context-length, input-price, status, series and supported-parameter filter rows, tabs for Models, Leaderboard, Offers and Playground, a "How to call any model" panel showing a POST to an OpenAI-compatible endpoint, and model cards including OpenAI: GPT-6.1 Sol.

Кому звонить и как перестать переживать

Вызывайте предварительную версию, если ваша работа связана с длинным контекстом, чувствительна к затратам и поддаётся оценке — сессии агентов, пакетная обработка, всё, где четырёхкратное окно и треть входной цены окупают риск изменения в середине недели. Относитесь к ней как к пробному запуску со строкой конфигурации под ней и сохраняйте собственные показатели, потому что цифры поставщика будут меняться.

Выбирайте стабильный Pareto, если ваша нагрузка — продакшен, критична к задержкам или подпадает под проверку на соответствие требованиям, которая не хочет, чтобы модель описывали как возможно меняющуюся без предупреждения. Вы отказываетесь от окна в 1M, более дешёвого кеша и опубликованных оценок; вы сохраняете эндпоинт с историей и именем, которое будет означать то же самое на следующей неделе. Для многих команд это и есть всё требование.

Ошибка — считать это постоянным форком. В Unbiased это разветвление задумано как временное — превью существует, чтобы его оценили, а затем вобрали, — и решение, которое действительно имеет значение, не в том, какой из двух вариантов вы выберете, а в том, будет ли переключение между ними пятиминутным изменением или квартальным проектом. На одном эндпоинте с одной строкой модели сейчас нет ни того, ни другого: это анонс, который нужно не пропустить. Настройте выбор как решение о маршрутизации — и версия, которую вы вызываете, станет регулируемым параметром, а это единственная позиция, которую предварительный релиз когда-либо действительно вознаграждал.