
Claude Haiku 5.5 против PPLX 27B: $0,00 за токен — это не то же самое, что бесплатно
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
PPLX 27B не стоит ничего за токен. Он работает локально, на принадлежащем вам оборудовании, и как только оборудование куплено, предельная стоимость следующего токена действительно равна нулю. Claude Haiku 5.5 стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных — число настолько малое, что стоит как следует выполнить вычитание, а не принимать очевидный вывод. Машина, способная хорошо запускать PPLX 27B, — это примерно $4 500 за DGX Spark или настольный компьютер с видеокартой RTX на 24 ГБ и более, а $4 500 выходных токенов Claude Haiku 5.5 — это около девяти миллиардов токенов. Так что вопрос, который на самом деле ставит это сравнение, не в том, что дешевле. Он в том, сколько токенов вы рассчитываете сжечь, и изменится ли ответ на это оттого, что токены лежат на вашем столе.
Claude Haiku 5.5 — это малая модель вендора, выпущенная 7 октября 2026 года. PPLX 27B была анонсирована Perplexity 25 августа 2026 года вместе с Portable Computer, созданным с NVIDIA, и представляет собой дообученную версию модели Qwen 3.8 27B с открытыми весами, настроенную под собственный инструментарий Perplexity. Ни одна из них не является полноценной заменой другой, и ни одна не представлена в каталоге OrcaRouter.
Две модели, и почему одна из них живёт на вашем рабочем столе
Claude Haiku 5.5 — ID claude-haiku-5-5: принимает текст и изображения, выдаёт текст, контекст на 1 млн токенов, максимальный объём вывода 128 000 токенов плюс бета-маршрут на 300 000 токенов в Batch API, отсечка обучающих данных — июнь 2026 года и обязательство не выводить модель из эксплуатации до 7 октября 2027 года. Уровень усилий — от Low до Max, по умолчанию Medium, адаптивное мышление включено по умолчанию, чтение из кэша стоит $0.01 за миллион токенов, а Batch снижает тариф вдвое. Это хостинговый продукт: вы отправляете токены, вы получаете токены, вы никогда не видите GPU.
PPLX 27B — плотная модель на 27 миллиардов параметров, созданная на основе Qwen 3.8 27B и дообученная для собственного агентного каркаса Perplexity. Она работает внутри Portable Computer на DGX Spark или на Linux-машине с видеокартой NVIDIA RTX объёмом 24 ГБ и более и не покидает эту машину. Гибридный режим, добавленный 1 сентября 2026 года, объединяет её с облачной моделью для более тяжёлых задач за локальным Privacy Gate; поддержка Linux для RTX появилась 3 сентября; поддержка Windows для карт RTX от 24 ГБ появилась 14 сентября вместе с локальным MCP и задачами по расписанию. Дообученные веса являются проприетарными и доступны по подписке Perplexity Pro или Max.

• Размеры, по одному в строке
• Предельная стоимость за токен — Claude Haiku 5.5: $0,10 за миллион входных и $0,50 за миллион выходных при длине промпта до 100 тыс. токенов, затем $0,50 и $2,50; PPLX 27B — ничего, как только оборудование окупится.
• Стоимость старта — ничего, кроме API-ключа для Claude Haiku 5.5; примерно 4 500 $ за DGX Spark или настольный компьютер с видеокартой NVIDIA RTX объёмом 24 ГБ или больше, для PPLX 27B.
• Контекстное окно — 1 000 000 токенов для Claude Haiku 5.5 против примерно 262 144, унаследованных от Qwen 3.8 27B.
Максимальный объём вывода — 128 000 токенов для Claude Haiku 5.5, с бета-заголовком на 300 000 токенов в Batch; для PPLX 27B не опубликовано.
• Куда попадают данные — облако Anthropic против вашего собственного устройства, при этом Privacy Gate в гибридном режиме решает, что его покидает.
• Независимая оценка — индекс интеллекта Artificial Analysis: 43 у Claude Haiku 5.5, конфигурация Max — 43,40, второе место из 182; для PPLX 27B ничего не опубликовано, поскольку Artificial Analysis его не отслеживает.
• Скорость вывода — 243,4 токена в секунду для Claude Haiku 5.5; для PPLX 27B зависит от вашего GPU и несопоставима без опубликованного показателя.
• Входные модальности — текст и изображения против текста, унаследованные от мультимодальной основы.
• Веса — в обоих случаях проприетарные, но по разным причинам: невыпущенные веса против ограниченного пост-трена, для получения которого требуется подписка.
Железо — это цена, а цена — это проверка на честность.
«Бесплатно» — неподходящее слово для локального инференса, и вендоры это знают; поэтому в качестве называемой цифры всегда фигурирует предельная стоимость. Правильное сравнение — это точка безубыточности: машина за $4,500 при цене Claude Haiku 5.5 в $0.50 за миллион выходных токенов окупает себя после девяти миллиардов выходных токенов. Команда, генерирующая сто миллионов выходных токенов в месяц, достигает этой точки примерно через семь с половиной лет, и к тому времени GPU уже устареет. Команда, генерирующая пять миллиардов в месяц, достигает её менее чем за два месяца.
Оба ответа верны, и они верны для разных компаний. Именно поэтому это сравнение нельзя разрешить по спецификации, и именно поэтому приведённая выше арифметика игнорирует всё, что делает локальный инференс дорогим на практике: электроэнергию, место в стойке, человека, отвечающего за обновления драйверов, и тот факт, что машина на столе — это единая точка отказа, если только вы не купили две. Добавьте их — и точка безубыточности сдвинется ещё дальше.
То, что даёт локальный инференс за эти деньги, — вовсе не экономия. Это гарантия того, что промпт никогда не покидает стен, а для юридической, медицинской или околоборонной команды это ценнее любой ставки за токен, и никакая скидка, которую предлагает Anthropic, этого не заменит. И наоборот: контекст Claude Haiku 5.5 в 1M токенов и потолок вывода в 128 000 токенов — это то, что нельзя купить ни за какие деньги на карте с 24 ГБ, и машина за $4,500 этого не меняет.
Что на самом деле измеряют эти 85,4 %
Опубликованный Perplexity показатель для PPLX 27B составляет 85,4% на его собственном Local Knowledge Work Bench из 53 заданий, против 82,6% для того же стенда, запущенного на необученной базовой Qwen 3.8 27B, 77,6% для Pi и 74,0% для Hermes. Три вещи в связи с этим заслуживают того, чтобы сказать их прямо, потому что материалы о запуске, как правило, о них не говорили.
Это заявлено поставщиком и не было независимо воспроизведено. Это сравнение на собственном испытательном стенде поставщика, а это максимально справедливый возможный тест для модели, дообученной на этом стенде, — прирост относительно базовой модели отчасти объясняется лучшей подгонкой под тест. И оно измеряет именно локальную работу со знаниями: извлечение информации, реферирование, работу с документами — задачи, для которых создан Portable Computer. Это не оценка общих способностей, и её не следует воспринимать как таковую.
Базовая модель — это другое дело. Qwen 3.8 27B — плотная модель под лицензией Apache-2.0, мультимодальная, выпущенная 14 августа 2026 года с нативным контекстным окном в 262 144 токена, и Artificial Analysis оценивает её конфигурацию для рассуждений в 44 балла по Intelligence Index — на один пункт выше 43,40 у Claude Haiku 5.5, при другой цене. PPLX 27B — это та же модель плюс постобучение от Perplexity, так что честная интерпретация такова: лежащие в основе веса находятся в диапазоне возможностей Claude Haiku 5.5, а тонкая настройка сместила их в сторону рабочей нагрузки одного вендора. Что именно из этих двух вещей вы покупаете — это и есть вопрос, на который показатель в 85,4% по задумке не отвечает.
Где Claude Haiku 5.5 побеждает без необходимости в бенчмарке
Длинный контекст — во-первых: 1 млн токенов против примерно 262 тыс., а также 128 000 токенов максимального вывода против неопубликованного показателя. Во-вторых, ввод изображений: линейка Qwen 3.8 его поддерживает, но обвязка Perplexity о нём не заявляет. В-третьих, управление усилиями — и это недооценённый пункт: настройка Low существует специально для того, чтобы вы могли перестать платить за токены рассуждений в вызовах, где они не нужны. Это рычаг экономии, которого не даёт ни одна локальная модель, потому что там нет счёта, который можно было бы снизить.
И доступность, в-четвёртых. Claude Haiku 5.5 — это строка модели в API, и независимые числа существуют: Intelligence Index 43 в целом и 43,40 при Max effort, второе место из 182, при $0,21 за задачу индекса, 243,4 выходных токена в секунду и около 0,3 секунды до первого токена. Когда вы решаете, готова ли рабочая нагрузка к переносу, опубликованная оценка, которую вы не вычисляли сами, ценнее, чем более быстрое число, которое вы получили сами.

Где PPLX 27B выигрывает, не нуждаясь в бенчмарке
Приватность — первое и самое важное: токены никогда не покидают машину, и ни одна хостинговая модель этого не может. Стоимость при больших объёмах — второе, и она становится реальной после нескольких миллиардов выходных токенов в месяц. Работа офлайн — третье: ноутбук в подвале без подключения всё равно отвечает, а Claude Haiku 5.5 — нет. А гибридный режим, добавленный 1 сентября, — самая интересная архитектура в продукте: локальная модель делает рутинную работу, а облачная модель стоит за локальным шлюзом для сложных случаев — именно так вы получаете и приватность, и возможности, и эту архитектуру стоило бы копировать большинству команд, независимо от того, у какого поставщика они её покупают.
Чего PPLX 27B не предлагает, так это переносимого решения. Он привязан к Portable Computer, для получения весов требуется подписка, а сами веса являются производной от чужой модели — поэтому лицензия, которая у вас фактически есть, принадлежит Perplexity, а не Apache-2.0. Если цель — модель, которую можно форкнуть и выпускать, то базовая Qwen 3.8 27B — это та, у которой разрешительная лицензия, но это другая модель, не та, о которой рассказывается в этой статье.

Запуск любого из них с одной клавиши и то, где это останавливается
PPLX 27B вообще не доступен через API: он работает внутри Portable Computer на вашем собственном оборудовании, а гибридный режим обращается к облачной модели, выбранной Perplexity, по другую сторону Privacy Gate. Claude Haiku 5.5 доступен через собственный API Anthropic и, оттуда, везде, где модели Anthropic перепродаются. Ни того, ни другого нет в каталоге OrcaRouter, и мы не будем утверждать обратное — из этих двух семейств мы маршрутизируем anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 и anthropic/claude-fable-5.1, а отдельно — базовую модель Qwen 3.8 27B, на которой дообучен PPLX 27B, представленную в каталоге как qwen/qwen3.8-27b и размещённую на нашей собственной инфраструктуре.
Последний пункт — самый практичный. Если причина, по которой вы смотрели на PPLX 27B, заключалась в весах Qwen 3.8 27B под ним, а не в локальном выполнении, вы можете получить базовую модель через один API для более чем 200 моделей, один ключ и один счёт, при этом прайс-листовая цена провайдера передаётся с наценкой 0%, а под капотом работает автоматическое переключение между провайдерами при сбоях. Если же вам на самом деле нужно, чтобы промпт никогда не покидал машину, то никакой шлюз не подойдёт, а Portable Computer — да.
Решение, не делая вид, что цифры его предопределяют
Если ваши промпты не могут покидать вашу инфраструктуру, PPLX 27B — единственная из этих двух, которая существует для вас, и $4,500 — это не сравнение затрат, а цена ограничения, от которого нельзя отказаться. Если вы сжигаете больше нескольких миллиардов выходных токенов в месяц, локальный вариант окупается за квартал, а затем продолжает приносить выгоду.
Если ни то, ни другое не верно, Claude Haiku 5.5 — более выгодная покупка почти при любом объёме: никакого оборудования, никакой эксплуатации, окно в 1 млн токенов, потолок вывода в 128 000 токенов, ввод изображений, регулятор усилий, который по требованию снижает стоимость, опубликованная независимая оценка 43 и цена $0,10 и $0,50 за миллион, при которой безубыточность по сравнению с рабочей станцией наступает примерно через девять миллиардов токенов. Показатель $0,00 за токен — правда. Просто это не всё вычитание.
Если причина, по которой вы рассматривали PPLX 27B, заключалась в лежащих в его основе весах Qwen 3.8 27B, а не в локальном выполнении, вы можете получить базовую модель через один API для более чем 200 моделей, один ключ и один счёт , с передачей прейскурантной цены провайдера с наценкой 0% и автоматическим переключением при сбое между нижележащими провайдерами.
