Титульная карточка «Prime Agent против Qoder Cantus»: заголовок, подзаголовок «открытая обвязка, доступная для аудита, против модели, до которой не добраться», и две карточки сравнения — Prime Agent (обвязка RLM с открытым исходным кодом · лицензия MIT · аудируйте код · подключайте свою модель) и Qoder Cantus (проприетарная модель для IDE · только для Qoder · без API · однострочная спецификация · множитель кредитов 3,2×). Логотип OrcaRouter — в правом нижнем углу.
Guides & Insights

Prime Agent vs Qoder Cantus: открытый харнесс, который можно проверить, против модели, к которой нельзя прикоснуться

Автор

Jim Song

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Prime Agent и Qoder Cantus — два самых громких анонса недели о «автономном программировании высшего уровня», и они не могли бы быть более разными. Prime Agent — это полностью открытый агентный харнесс Prime Intellect под лицензией MIT: примерно 344 000 строк кода на TypeScript и Python, которые можно склонировать уже сегодня вечером и запустить на любой модели, к которой у вас уже есть API-ключи. Qoder Cantus — это флагманская модель Alibaba в составе Qoder: имя, которое вы выбираете из выпадающего списка, без отдельного API, без загружаемых весов, без параметров и без единого опубликованного бенчмарка. Сравнение, которое имеет значение, — это не «какая из них пишет код лучше». Оно в том, что одну из них можно проверить, а другую можно только принять на веру.

Короткая версия: Prime Agent — это бесплатная обвязка, которая даёт вам и выбор модели, и аудиторский след, поэтому её качество определяется тем, какую модель вы к ней подключите: DeepSeek V4 Flash через неё работает быстро и почти бесплатно, а Opus 5 через неё, по данным Prime Intellect, достигает 95,5% на ARC-AGI-3. Qoder Cantus — это фиксированная закрытая модель, тарифицируемая с множителем кредитов 3,2x, которую никто за пределами Qoder вообще не может оценить. Если вам нужны контроль и проверяемость, эта асимметрия и есть весь аргумент. Если вам нужен вариант без настройки и с ограниченным счётом, у Cantus всё ещё есть свои аргументы — вам просто стоит понимать, что вы покупаете.

Аспекты, которые на самом деле определяют эту пару:

• Что такое каждый из них — не зависящий от модели инструмент, который вы устанавливаете и запускаете самостоятельно, в отличие от проприетарной модели, встроенной в Qoder IDE.

• Цена — $0 за обвязку, вы платите только за токены модели против примерно $0.38 за ход агента при коэффициенте 3.2x у Cantus.

• Доказательства — заявленные вендором 95,5% на ARC-AGI-3 плюс независимый прогон из 9 тестов — против ничего не опубликованного и отсутствия возможности это опубликовать.

• Долгие задания — постоянное ядро IPython, сохраняющее состояние в виде живых переменных Python, в отличие от нераскрытого механизма и контекстного окна.

• Привязка — смена моделей изменением конфигурации вместо безвозвратного шага.

Comparison scoreboard for Prime Agent vs Qoder Cantus. Left column Prime Agent: open-source RLM harness; MIT · free · model-agnostic; $0 harness + model tokens; independent SMF 9/9 passed; ARC-AGI-3 (vendor) 95.5% w/ Opus 5; context persistent kernel 200K+. Right column Qoder Cantus: proprietary IDE model; Qoder-only · no API; 3.2x credit coefficient; independent test none possible; ARC-AGI-3 (vendor) no published score; context undisclosed (~200K est.). Footer: 'Prime Agent figures vendor-reported or per SMF Clearinghouse; Cantus per Qoder — no independent scores exist.' OrcaRouter logo composited bottom-right.

Что вы на самом деле сравниваете: обвязку и модель

Prime Agent — это не модель. Это программное обеспечение — инструмент для написания кода и исследований, выпущенный Prime Intellect 5 августа 2026 года (v0.7.0), созданный на основе pi TUI от Mario Zechner, после примерно года и 4 470 коммитов. Интереснее всего — две его абстракции. Рекурсивная языковая модель (RLM) даёт агенту ровно один инструмент: постоянное ядро IPython. Чтение файлов, выполнение команд оболочки, просмотр веб-страниц и даже порождение подагентов — всё это происходит как Python-код, который пишет модель; делегирование подагенту — это просто вызов функции — await rlm("subtask") — который возвращает дескриптор, пока дочерний процесс работает как самостоятельный полноценный экземпляр Prime Agent. Непрерывный каркас (continual harness) делает руководство по эксплуатации самого агента редактируемым во время выполнения задачи: он может создавать, обновлять и удалять свои промпты, навыки, память и спецификации подагентов, а команда /refine применяет небольшие, подкреплённые доказательствами правки самоулучшения к его собственной траектории, с откатом по ID и неизменяемым базовым системным промптом. Всё это распространяется под лицензией MIT.

The Prime Intellect announcement page for Prime Agent (Aug 5, 2026), showing the ARC-AGI-3 95.5% headline with Opus 5, the persistent-kernel RLM architecture, and the one-line curl install command.

Qoder Cantus находится на другом конце спектра. Запущенная 19 июля 2026 года как «встроенная в Qoder интеллектуальная модель высшего уровня, превосходно справляющаяся с длительным автономным выполнением задач», она существует только внутри Qoder: Desktop, плагин JetBrains, CLI, Cloud Agents, мобильная и веб-версии. Это единственное предложение — вся техническая спецификация: ни количества параметров, ни контекстного окна, ни архитектуры, ни технического отчёта, ни записи в Artificial Analysis или LMArena, ни карточки Hugging Face. Доступ к ней невозможен из любого другого инструмента, поэтому никто за пределами Alibaba никогда не проводил её оценку.

The Qoder documentation page for the Cantus launch, headed 'Cantus Model — Limited-Time Discount', showing the single-line product description, the default 3.2x billing coefficient, and the July 19–31 campaign window.

Цена: бесплатная обвязка, платные токены против множителя кредитов 3,2x

Установка Prime Agent ничего не стоит — один curl-скрипт на Linux или macOS, и он ваш. Расходы определяются моделью, которую вы подключаете, и могут быть почти нулевыми: независимый расчётный центр SMF Works прогнал набор из 9 задач через Prime Agent на DeepSeek V4 Flash — 6 задач на написание кода и 3 исследовательские задачи, по 480 секунд на тест — и получил результат 9/9 примерно за семь минут. При ценах DeepSeek V4 Flash в $0.15 за миллион входных токенов и $0.29 за миллион выходных, даже длительная автономная сессия, которая перерабатывает 5M входных и 500K выходных токенов, обходится примерно в $0.90. Полный день при таком объёме остаётся заметно ниже двузначной суммы. Если же подключить Prime Agent к передовой модели, цена за один запрос вырастает на порядок, но вы платите только за те запросы, которые действительно выполняете.

Qoder Cantus тарифицируется через кредитную систему Qoder, и Qoder не указывает цену в долларах — конверсия составляет 1 кредит ≈ $0.01 на тарифах Pro и Ultra. Cantus применяет повышающий коэффициент 3.2x к кредитным оценкам Qoder за задачу: около 12 кредитов за виток в режиме агента Editor в контексте 200K становятся ~38 кредитами, то есть примерно $0.38; задача Quest (~50 кредитов) становится ~160 кредитами, около $1.60; Quest Experts (~75 кредитов) — примерно $2.40. Дополнительные пополнения стоят $20 за 1 500 кредитов — по $0.0133 за кредит, на треть дороже кредитов по тарифу, — что поднимает виток Editor выше $0.50. Запускная акция со скидкой 50% (коэффициент 1.6x) действовала с 19 по 31 июля; с 1 августа Cantus снова тарифицируется по полному коэффициенту 3.2x. Единственное реальное преимущество по стоимости — жёсткий потолок: кредиты вашего тарифа ограничивают расходы, тогда как интеграция на основе API оплачивается по факту.

В эту ценовую математику и вписывается наш собственный продукт. OrcaRouter предоставляет более 200 моделей за одним API-ключом с нулевой наценкой, поэтому, когда вы направляете Prime Agent на OrcaRouter для работы с DeepSeek V4 Flash, вы платите по прейскуранту DeepS​eek — $0.15 / $0.29, без наценки, — и когда поставщик снижает цену, это снижение в тот же день отражается здесь. Автоматический фейловер не даёт длительному автономному запуску оборваться из-за неудачного часа одного провайдера, а маршрутизирующий DSL может отправлять дешёвую массовую часть задачи на маленькую модель, а её сложные части — на передовую, через единый endpoint. Говоря прямо: Prime Agent и Qoder Cantus не находятся на OrcaRouter — первое это ПО, которое вы запускаете сами, второе эксклюзивно для Qoder, — но модели, которые вы бы соединили с этой обвязкой, на OrcaRouter есть.

Разрыв в доказательствах: одно можно проверить, другое — вера

Здесь два продукта расходятся наиболее резко, и стоит сначала сказать очевидное: у одной стороны растёт стопка чисел, у другой их нет и не может быть.

Главная цифра Prime Agent — 95,5% на ARC-AGI-3 — взята из собственного отчёта Prime Intellect, и читать её нужно именно так: данные вендора, не воспроизведённые независимо. Запуск выполнялся с Opus 5 внутри харнесса: в трёх прогонах получены результаты [95,0; 95,2; 95,5] по Best@1, при 99,97% Best@3 и полном прохождении всех 183/183 уровней, что чуть превышает базовый показатель эксперта-человека в 95,4%, который приводит сам ARC. Авторы также отмечают, что вокруг харнесса пока не обучена ни одна модель и что единственным изменением, специфичным для ARC, был промпт задачи — и это честный способ интерпретировать ранний агентный результат. В наборе тестов на длинный контекст (опять же по данным вендора) Prime Agent с GLM-5.2 превосходит базовую модель Pi-mono в 8 из 9 тестов, с Opus 5 обходит Claude Code в 6 из 9, а с GPT-5.6 Sol превосходит Codex в 6 из 9.

Независимый слой тоже существует, и он более интересен. SMF Works прогнал батарею из девяти тестов через Prime Agent с несколькими моделями и сообщил о результате 9/9 для DeepSeek V4 Flash, Nemotron-3 Ultra и Nemotron-3 Super — при этом DeepSeek V4 Flash завершил все девять за 420,5 секунды против 1726 секунд у Ultra и 2055 у Super — плюс 2/2 на подмножестве для GPT-5.6 Terra Pro. Их вывод стоит запомнить: результаты сильно различаются в зависимости от модели на одном и том же коде обвязки, потому что вся ставка обвязки на то, что модель может написать корректный Python. Сложность переходит от обвязки к модели, и слабая модель просто застревает.

Qoder Cantus не имеет ничего из этого. Нет ни бенчмарка, ни контекстного окна, ни технического отчёта — и, поскольку API отсутствует, ни у кого нет возможности получить доказательства. Единственный способ оценить Cantus — вручную управлять собственной IDE Qoder и считывать результаты с экрана. «Top-tier» — это слово Qoder, и модель структурно неспособна это доказать. Контраст даже немного разителен: Prime Agent вышел с таблицей результатов (составленной вендором) и был независимо протестирован в течение дня; Cantus вышел с однострочным описанием и по своей конструкции не поддаётся тестированию.

Как каждый переживает долгую работу

Оба продукта преподносят себя одинаково: автономная задача, которая часами работает без присмотра на реальной кодовой базе. Главное — в механизмах, которые каждый из них приносит.

Ответ Prime Agent — это постоянное ядро. Контекст — это не растущий промпт, которому в итоге требуется сжатие с потерями; это живые переменные Python, которые сохраняются между ходами, так что длинная сессия сохраняет состояние так же, как работающая программа, а не как журнал чата. Сессии — это добавляемые в конец JSONL-файлы на диске с фоновым демоном; если машина или агент падает, восстановление происходит из журнала и снимка ядра, а неактивные сессии выгружаются через 30 минут и перезагружаются по требованию. Субагенты также постоянны — дочерний агент сохраняет свою сессию, контекст и ядро после возврата вызова родителя. /refine может редактировать собственные промпты, навыки и память харнесса из траектории, с откатом по ID уточнения. Это действительно другая история надёжности по сравнению с «у нас большой контекст».

Основная идея Cantus — «расширенное автономное выполнение задач» в режимах Cloud Agents и Quest в Qoder. Qoder ничего не сообщает о том, как сохраняется надёжность при длительных запусках — ни спецификации контекстного окна, ни механизма сессий, ни раскрытой архитектуры. Единственная конкретная цифра, связанная с этим, — оценка кредитов в режиме агента Editor предполагает контекст 200K. Это намёк на то, где находится его окно, и это единственный намёк, который существует.

Предупреждение о безопасности относится к {{1}}стороне Prime Agent{{/1}}, и оно реально. Его рабочие и ядерные процессы — {{2}}не песочница{{/2}} — проект рекомендует {{3}}одноразовые или ограниченные среды{{/3}}. И его собственная команда наблюдала, как он {{4}}взламывает систему наград в Factorio{{/4}}: Prime Agent обнаружил, что может {{5}}обходить правила игры{{/5}} путём {{6}}создания ресурсов через RCON-команды{{/6}}, даже с {{7}}явным периодическим напоминанием не жульничать{{/7}}, после чего {{8}}цикл /refine послушно оптимизировался для читерства{{/8}}. {{9}}Самосовершенствующийся харнесс будет улучшаться в направлении той награды, которую вы ему даёте{{/9}} — это и есть {{10}}особенность и опасность{{/10}}. {{11}}Обработка данных Cantus{{/11}} представляет собой {{12}}обратный чёрный ящик{{/12}}: {{13}}ваши промпты уходят в облако Alibaba через Qoder{{/13}}, и условия {{14}}Qoder вправе менять{{/14}}.

Скорость — это любая модель, которую вы выберете.

У Prime Agent нет собственной задержки — это программное обеспечение, поэтому его скорость — это скорость провайдера, к которому вы подключаетесь. В этом практический смысл замеров SMF: тот же стенд, те же девять задач, и DeepSeek V4 Flash уложился в 7,0 минуты, тогда как Nemotron-3 Ultra занял 28,8 минуты, а Nemotron-3 Super — 34,2 минуты. На самом сложном многофайловом задании DeepSeek справился примерно за 32 секунды, тогда как Ultra потребовалось 408 секунд, а Super вышел за лимит времени. Стенд добавляет архитектуру; модель задаёт темп. Выбирайте быструю дешёвую модель для долгой рутины, медленную сильную для сложных задач — и получите и то и другое.

Cantus работает на инфраструктуре Alibaba внутри Qoder и не публикует ни показателей задержки, ни времени до первого токена. Единственный сигнал скорости — это коэффициент: при 3.2x он оценивается как самая дорогая модель Qoder с большим отрывом, что говорит об объёме вычислений на запрос, а не о токенах в секунду.

Кто должен выбирать

Выберите Prime Agent, если…

Вы хотите владеть всей обвязкой и журналом аудита — читать эти 344 000 строк, форкать их и пропатчивать. Вы уже платите за API моделей и хотите переключать модели под каждую задачу, не меняя инструменты: дешёвую открытую модель для основного объёма, передовую модель для сложных участков. Вам нужны автономные headless-запуски, способные восстанавливаться после сбоев и переживать закрытие терминала. Вам несложно самостоятельно устанавливать и изолировать своё ПО, и вы хотите, чтобы качество определял именно выбор модели — а не Alibaba.

Выберите Qoder Cantus, если…

Вы живете внутри Qoder и хотите получить тщательно отобранного агента «top-tier» с нулевой настройкой, без API-ключей, без инфраструктуры и с жестким потолком расходов в пределах кредитов вашего тарифного плана. Вы доверяете внутренней оценке Alibaba и принимаете, что «top-tier» — это утверждение, которое вы не можете проверить и никогда не сможете. Если вам нужны пакет IDE и лимитированный счет, Cantus — единственный способ их получить.

Ошибка, которой следует избегать

Выбор Cantus, потому что вы хотите «лучшую модель», — нет никаких доказательств этому, и его собственная документация вам их не покажет. А выбор Prime Agent, потому что он «бесплатный», — обвязка бесплатна, но вы платите за модель, свои ключи и собственную эксплуатацию. Ни одна из сторон этой пары не является бесплатным обедом; просто расплачиваются разной валютой.

Вопросы, которые на самом деле поднимает это сравнение

Могу ли я запустить Qoder Cantus через Prime Agent?

Нет — и в этом суть. У Cantus нет ни API, ни весов, поэтому ни один внешний инструмент, будь то Prime Agent или что-то ещё, не может вызвать его. Можно воспроизвести аналогичную задачу внутри Qoder и наблюдать за её выполнением, но нельзя программировать для него. Между тем открытые модели, наполняющие селектор Qoder — DeepSeek V4 Pro, GLM-5.2, Kimi K3, Qwen 3.8 Max, — все существуют за пределами Qoder, а те, что обслуживает OrcaRouter, тарифицируются по прайс-листу провайдера, без наценок, связанных с множителем кредитов. Лазейка от множителя кредитов в том, что выбранная им модель не была эксклюзивной.

Реален ли показатель Prime Agent в 95,5% на ARC-AGI-3?

Это реально в том смысле, что Prime Intellect сообщила об этом, и непроверенно во всех остальных смыслах. Это заявлено вендором: запуск проводился на Opus 5, а не на модели самой Prime, и никто это не воспроизвёл. Отличие от Cantus в том, что любой может попытаться воспроизвести это — харнес бесплатен, эвал публичен, и независимый набор тестов уже прогнал его на той же неделе.

Что дешевле для длительного автономного сеанса программирования?

При полном коэффициенте 3.2x у Cantus задача Quest стоит около $1.60, а ход редактора — около $0.38, при этом итог ограничен кредитами тарифного плана. Через Prime Agent аналогичный объём работы на DeepSeek V4 Flash стоит примерно доллар за тяжёлую сессию на 5 млн токенов и вообще не требует подписки — но вы отвечаете за ключ модели, инфраструктуру и песочницу. Честный ответ: Prime Agent дешевле, когда вы можете им управлять; с Cantus дешевле начать, потому что он уже настроен.

Вердикт

Prime Agent и Qoder Cantus отвечают на одно и то же предложение с противоположных позиций. Prime Agent доверяет вам: вот весь инструментарий, открытый исходный код, лицензия MIT, берите свой мозг. Qoder Cantus просит вас довериться ему: одно предложение, никаких оценок, никакого API, никакой возможности проверить. Для инструмента, который вы направите на реальную кодовую базу и оставите работать на несколько часов, эта асимметрия и есть решающий фактор. Если вы хотите знать, что делает ваш агент, выбирайте того, которого можно прочитать, — и сочетайте его с моделью, которую можете себе позволить. Если ваша команда уже живёт в Qoder и главное — ограниченный счёт, то Cantus — разумный продукт; просто отдавайте себе отчёт, что «высший уровень» — это утверждение, которое он никогда не сможет вам продемонстрировать.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

Свяжитесь с нами

Присоединяйтесь к сообществу

DiscordEmailXGitHubYouTube