
Pareto 26.10 Preview против Pareto: одна и та же строка модели, две разные модели
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 221 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 103 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Unbiased выпустила Pareto 26.10 Preview 1 октября 2026 года и оставила предыдущий релиз, Pareto, указанный рядом с ним. Это не варианты одного семейства, между которыми выбирают с помощью флага. Это два релиза под одним брендом, и собственная строка модели вендора — pareto — теперь указывает на более новый, явно нестабильный выпуск. Так что вопрос сравнения на самом деле не «что лучше». Он в том: до какого из них фактически доходит ваш запрос, и что происходит с ответом, когда это меняется у вас под ногами?
Единственное место, где о них двоих говорится в одном контексте, — это публичный технический листинг модели. Собственная карточка модели Unbiased, страница с ценами и FAQ описывают один составной продукт и ни разу не упоминают о разделении. Эта асимметрия — подробный публичный diff с одной стороны и молчание с другой — и есть честная отправная точка для прямого сравнения, потому что из неё видно, откуда взялось каждое число ниже.
Шесть измерений, обе стороны
Всё, что отличает эти релизы, заключено в этих шести строках. Слева — Pareto 26.10 Preview; справа — релиз Pareto от 17 сентября, тот, который в тексте каталога предварительной версии называется стабильным выбором.
• Контекстное окно — 1 048 576 токенов против 262 144 токена. Вчетверо больше места — на бумаге, при этом ни один из них не предлагает меньшего тарифа.
• Максимальный вывод — 131 072 токена против 131 072 токена. Без изменений. Большее окно не принесло более длинного ответа.
• Цена ввода при маршрутизации — $0,80 за миллион против $2,50 за миллион. Предварительная версия стоит примерно треть от цены по этому прайс-листу.
• Цена вывода при маршрутизации — $3,20 за миллион против $7,50 за миллион. Меньше половины.
• Кэшированный ввод при маршрутизации — $0,03 за миллион против $0,25 за миллион. Здесь больше всего выигрывают самые длинные траектории агента.
• Опубликованная таблица бенчмарков — четыре оценки, явно «предварительные» и «могут измениться до окончательной публикации», против полного отсутствия опубликованной таблицы бенчмарков.
Две из этих строк — те, что определяют реальную работу. Контекстное окно — это заголовок, который вендор не укажет на своём собственном сайте: оно живёт в листинге, а не в карточке модели, — а цена кэшированного ввода — это то, что меняет счёт агента, а не его потолок. Всё остальное — либо маркетинговая дельта, либо, в случае оценки выходных данных, реклама: публиковать цифры предпросмотра с пометкой «предварительно» честнее, чем альтернатива, и это также предупреждение.

Цена, которую вы видите, зависит от того, куда вы смотрите.
Поставьте две тарифные карты рядом — и они не согласуются, а это как раз та часть сравнения, которую никто не объяснил.
Собственная платформа Unbiased в день, когда 26.10 Preview стал текущим релизом, всё ещё указывает $2.50 за миллион входных, $0.25 за кэшированные и $7.50 за выходные. Это сентябрьские цифры, без изменений, как на странице цен, так и на карточке модели. Более низкий набор — $0.80, $0.03, $3.20 — указан в листинге маршрутизированного каталога для того же превью. Таким образом, клиент, вызывающий pareto напрямую через API поставщика, платит по старой карточке за новую модель, в то время как в маршрутизированном листинге рекламируется примерно треть от этого. Оба действуют. Поставщик не опубликовал ни даты окончания акции, ни заявления, которое бы их согласовывало.
Это вопрос канала, а в предварительном релизе — ещё и вопрос времени: на какую бы из цифр вы ни опирались при моделировании затрат, другая отстаёт от того, чтобы стать верной, всего на одну заметку о релизе. Роутер, который транслирует прайс-листовую цену провайдера с наценкой 0 %, устраняет ровно это трение — изменение цены вендора вступает в силу в тот же день, а не на следующем пересмотре договора, — и это единственная структурная вещь, которую здесь стоит позаимствовать у OrcaRouter. Мы не поддерживаем ни один из релизов Unbiased на сегодняшний день, поэтому прямой ответ на вопрос «куда мне обращаться» — собственный API Unbiased, с тем из двух наборов цен, который окажется в листинге, через который вы покупаете. Причина сказать это вслух в том, что разница — в три раза, и превью — не то место, где стоит обнаружить, что вы заложили не ту цену.
Что вам даёт предпросмотр и чего он вам стоит
Собственное описание предварительной версии в каталоге задаёт условия: она «может измениться без уведомления», а всех, кому нужно предсказуемое поведение, отсылают к сентябрьскому выпуску. Это не шаблонная оговорка — это определение продукта. Сравните это с реальной картиной долгой сессии агента — и компромисс становится конкретным.
Агент, который поддерживает ход разговора, накапливает контекст, и именно в длинных диалогах кэширование промптов оправдывает себя. Изменённая модель за неизменной конечной точкой — классический способ всё потерять: кэш привязан к модели, создавшей токены, поэтому незаметная смена версии посреди траектории может аннулировать то, что вы уже закэшировали, и заново выставить счёт за работу, которую вы считали уже оплаченной. Собственная документация Unbiased разворачивает этот аргумент в другую сторону — она представляет свою смесь как кэш-стабильную, тогда как переключающий маршрутизатор — нет, — так что поставщик хорошо понимает этот риск и просто принимает его в обмен на выпуск preview-версии. Об этом стоит сказать прямо, потому что сбой незаметен в дашборде: токены по-прежнему тарифицируются, ответы по-прежнему возвращаются, а цифра просто больше, чем на прошлой неделе.
Плюсы превью-версии реальны и зеркально отражают её минусы. Вчетверо больше контекста, кэшированный ввод по цене в одну восьмую от тарифа стабильного релиза в маршрутизируемом листинге, и вообще есть таблица бенчмарков — у сентябрьского релиза опубликованных результатов никогда не было. Если ваша нагрузка связана с длинным контекстом и чувствительна к стоимости, нужна именно превью-версия, а способ взять её, не ставя на кон весь стек, — закрепить её осознанно: именованный эндпоинт для превью, именованный эндпоинт для стабильного релиза и резервный переход между ними, настроенный один раз. DSL маршрутизации существует именно для такой задачи — скомпонуйте обе версии как отдельные плечи, направьте на каждое по части реального трафика и позвольте журналу запросов показать, во что каждое обошлось на самом деле. Превью должно быть решением, которое можно отменить одной строкой конфигурации, а не свойством вашего эндпоинта, о котором вы узнаёте из счёта.

Картина производительности, недостаточно стабильная, чтобы ей можно было доверять.
Каждый показатель выше взят из публичного листинга, и собственная панель производительности листинга менялась между чтениями в день запуска. Одно чтение страницы 26.10 Preview сообщало о медианной задержке 5,28 секунды и 35 токенов в секунду; опубликованное в тот же день сравнение бок о бок сообщало о 3,54 секунды и 21 токене в секунду для предварительной версии и 1,05 секунды и 45 токенов в секунду для сентябрьского релиза. Это не маленькие расхождения. У совершенно новой модели, обслуживаемой одним провайдером, узкая база измерений, и скользящее окно в течение нескольких часов будет смещаться.
Честно говоря, ни у одного из релизов нет показателя пропускной способности или задержки, достаточно стабильного, чтобы на него опираться при планировании, а для предварительной версии это заложено в сам продукт, а не является проблемой разового замера. У сентябрьского релиза по крайней мере есть недели трафика — в его листинге указана многодневная доступность на уровне 95–99% с полной историей провайдера за плечами. У предварительной версии — всего часы. Если вы выбираете между ними из-за скорости, а не цены или контекста, доказательств для выбора ещё не существует, и ответственный шаг — провести измерение на собственных промптах, а не считывать число с любой из страниц.

Кому звонить и как перестать переживать
Вызывайте предварительную версию, если ваша работа связана с длинным контекстом, чувствительна к затратам и поддаётся оценке — сессии агентов, пакетная обработка, всё, где четырёхкратное окно и треть входной цены окупают риск изменения в середине недели. Относитесь к ней как к пробному запуску со строкой конфигурации под ней и сохраняйте собственные показатели, потому что цифры поставщика будут меняться.
Выбирайте стабильный Pareto, если ваша нагрузка — продакшен, критична к задержкам или подпадает под проверку на соответствие требованиям, которая не хочет, чтобы модель описывали как возможно меняющуюся без предупреждения. Вы отказываетесь от окна в 1M, более дешёвого кеша и опубликованных оценок; вы сохраняете эндпоинт с историей и именем, которое будет означать то же самое на следующей неделе. Для многих команд это и есть всё требование.
Ошибка — считать это постоянным форком. В Unbiased это разветвление задумано как временное — превью существует, чтобы его оценили, а затем вобрали, — и решение, которое действительно имеет значение, не в том, какой из двух вариантов вы выберете, а в том, будет ли переключение между ними пятиминутным изменением или квартальным проектом. На одном эндпоинте с одной строкой модели сейчас нет ни того, ни другого: это анонс, который нужно не пропустить. Настройте выбор как решение о маршрутизации — и версия, которую вы вызываете, станет регулируемым параметром, а это единственная позиция, которую предварительный релиз когда-либо действительно вознаграждал.
