بطاقة عنوان لـ 'Prime Agent مقابل Qoder Cantus': عنوان رئيسي، عنوان فرعي 'الأداة المفتوحة التي يمكنك تدقيقها مقابل النموذج الذي لا يمكنك الوصول إليه'، وبطاقتا مقارنة — Prime Agent (أداة RLM مفتوحة المصدر · رخصة MIT · راجع الكود المصدري · استخدم نموذجك الخاص) و Qoder Cantus (نموذج IDE مملوك · حصري لـ Qoder · بدون API · مواصفات بسطر واحد · مضاعف ائتماني 3.2x). شعار OrcaRouter مدمج في الأسفل يمين.
Guides & Insights

Prime Agent مقابل Qoder Cantus: أداة مفتوحة يمكنك تدقيقها مقابل نموذج لا يمكنك لمسه

الكاتب

Jim Song

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Prime Agent و Qoder Cantus هما أبرز طرحين في فئة «البرمجة الذاتية من الطراز الأول» هذا الأسبوع، ولا يمكن أن يكونا أقل تشابهًا. Prime Agent هو إطار عمل وكيل من Prime Intellect مرخّص بموجب MIT ومفتوح المصدر بالكامل — نحو 344,000 سطر من TypeScript وPython يمكنك استنساخه الليلة وتشغيله مع أي نموذج تملك مفاتيح API له بالفعل. Qoder Cantus هو النموذج الرائد من Alibaba داخل Qoder — اسم تختاره من قائمة منسدلة، دون API مستقل، ودون أوزان قابلة للتنزيل، ودون معلمات، ولا معيار واحد منشور. المقارنة المهمة ليست «أيهما يكتب برمجيات أفضل». بل هي أن أحدهما يمكنك التحقق منه، والآخر لا يمكنك إلا أن تأخذ به على الإيمان.

النسخة المختصرة: Prime Agent هو إطار عمل مجاني يمنحك حرية اختيار النموذج وسجل التدقيق معًا، لذا فإن جودته تعتمد على النموذج الذي توجهه إليه — DeepSeek V4 Flash عبره سريع وشبه مجاني، بينما Opus 5 عبره هو ما أبلغت عنه Prime Intellect بتحقيق 95.5% على ARC-AGI-3. أما Qoder Cantus فهو نموذج ثابت ومغلق يُفوتر بمضاعف ائتمان 3.2x لا يمكن لأي شخص خارج Qoder تقييمه على الإطلاق. إذا كنت تريد التحكم والتحقق، فهذا التباين هو الحجة بأكملها. وإذا كنت تريد إعدادًا صفريًا وفاتورة محدودة السقف، فلا يزال لدى Cantus ما يبرره — لكن ينبغي أن تعرف ما الذي تشتريه.

الأبعاد التي تحدد هذا الاقتران فعليًا:

• ما هو كل منهما — أداة غير مرتبطة بنموذج محدد تقوم بتثبيتها وتشغيلها بنفسك مقابل نموذج مملوك محبوس داخل بيئة تطوير Qoder.

• السعر — 0 دولار للأداة، تدفع فقط مقابل توكنات النموذج، مقارنةً بحوالي 0.38 دولار لكل دورة وكيل بمعامل Cantus البالغ 3.2x.

• الأدلة — نتيجة 95.5% في ARC-AGI-3 أبلغ عنها البائع، بالإضافة إلى اجتياز 9 اختبارات مستقلة، مقابل عدم نشر أي شيء وعدم وجود أي وسيلة لنشره.

• المهام الطويلة — نواة IPython مستمرة تحتفظ بالحالة كمتغيرات بايثون حية مقابل آلية غير معلنة ونافذة سياق.

• الاحتجاز — تبديل النماذج عبر تغيير الإعدادات مقابل بابٍ بلا عودة.

Comparison scoreboard for Prime Agent vs Qoder Cantus. Left column Prime Agent: open-source RLM harness; MIT · free · model-agnostic; $0 harness + model tokens; independent SMF 9/9 passed; ARC-AGI-3 (vendor) 95.5% w/ Opus 5; context persistent kernel 200K+. Right column Qoder Cantus: proprietary IDE model; Qoder-only · no API; 3.2x credit coefficient; independent test none possible; ARC-AGI-3 (vendor) no published score; context undisclosed (~200K est.). Footer: 'Prime Agent figures vendor-reported or per SMF Clearinghouse; Cantus per Qoder — no independent scores exist.' OrcaRouter logo composited bottom-right.

ما الذي تقارنه فعليًا: إطار عمل ونموذج

Prime Agent ليس نموذجًا؛ إنه برنامج — أداة برمجية للترميز والبحث أصدرتها Prime Intellect في 5 أغسطس 2026 (الإصدار 0.7.0)، مبنية على واجهة pi TUI الخاصة بـ Mario Zechner، بعد ما يقرب من عام و4,470 commit. أما التجريدان الأساسيان فيه فهما الجزء المثير للاهتمام. يمنح نموذج اللغة التكراري (RLM) الوكيل أداة واحدة فقط: نواة IPython دائمة. فقراءة الملفات، وتنفيذ أوامر الصدفة، وتصفّح الويب، وحتى توليد وكلاء فرعيين — كل ذلك يتم عبر كود Python يكتبه النموذج؛ وتفويض الوكيل الفرعي ليس سوى استدعاء دالة — await rlm("subtask") — يُرجع مقبضًا (handle) بينما يعمل الطفل كنسخة كاملة مستقلة من Prime Agent. ويجعل الإطار المستمر دليل تشغيل الوكيل نفسه قابلاً للتعديل أثناء المهمة: إذ يمكنه إنشاء مطالباته (prompts) ومهاراته وذاكرته ومواصفات وكيله الفرعي وتحديثها وحذفها، ويطبّق أمر /refine تعديلات صغيرة لتحسين الذات مدعومة بالأدلة على مساره الخاص، مع إمكانية التراجع بالمعرّف (ID) وبرومبت نظام أساسي غير قابل للتغيير. وكل ذلك مرخّص بموجب MIT.

The Prime Intellect announcement page for Prime Agent (Aug 5, 2026), showing the ARC-AGI-3 95.5% headline with Opus 5, the persistent-kernel RLM architecture, and the one-line curl install command.

يقع Qoder Cantus على الطرف الآخر من الطيف. أُطلق في 19 يوليو 2026 بوصفه "النموذج الذكي الأعلى المدمج في Qoder، المتفوق في تنفيذ المهام المستقلة الممتدة"، ولا يوجد إلا داخل Qoder — سطح المكتب، والمكوّن الإضافي لـ JetBrains، وواجهة الأوامر، وعملاء السحابة، والجوال، والويب. هذه الجملة الواحدة هي ورقة المواصفات بأكملها: لا عدد معاملات، ولا نافذة سياق، ولا بنية، ولا تقرير فني، ولا إدراج في Artificial Analysis أو LMArena، ولا بطاقة Hugging Face. لا يمكن الوصول إليه من أي أداة أخرى، ولهذا السبب لم يُجرِ أي شخص خارج Alibaba تقييمًا ضده.

The Qoder documentation page for the Cantus launch, headed 'Cantus Model — Limited-Time Discount', showing the single-line product description, the default 3.2x billing coefficient, and the July 19–31 campaign window.

السعر: أداة مجانية، توكنات مدفوعة مقابل مضاعف ائتماني 3.2x

تثبيت Prime Agent لا يكلف شيئًا — سكربت curl واحد على لينكس أو ماك وتصبح ملكك. فاتورتك هي النموذج الذي تُرفقه. ويمكن أن يكون ذلك شبه لا شيء: فقد أجرت جهة المقاصة المستقلة SMF Works بطارية من 9 مهام عبر Prime Agent على DeepSeek V4 Flash — 6 مهام برمجية و3 مهام بحثية، 480 ثانية لكل اختبار — وحصلت على 9/9 في حوالي سبع دقائق. وبأسعار DeepSeek V4 Flash البالغة 0.15 دولار لكل مليون توكن إدخال / 0.29 دولار لكل مليون توكن إخراج، حتى الجلسة المستقلة الطويلة التي تستهلك 5 ملايين توكن إدخال و500 ألف توكن إخراج تكلف حوالي 0.90 دولار. ويبقى يوم كامل بهذا الحجم من الاستهلاك أقل بكثير من عشرة دولارات. أمّا إذا ربطت Prime Agent بدلًا من ذلك بنموذج حدودي متطور، فسيرتفع سعر كل دورة بمقدار عشرة أضعاف، لكنك تدفع فقط مقابل الدورات التي تشغّلها فعلًا.

يتم دفع فواتير Qoder Cantus عبر نظام الاعتمادات الخاص بـ Qoder، ولا يعلن Qoder عن سعر الدولار — إذ إن التحويل هو 1 اعتماد ≈ 0.01 دولار على خطتي Pro وUltra. يحمل Cantus معامل فوترة يبلغ 3.2x فوق تقديرات Qoder للاعتمادات لكل مهمة: نحو 12 اعتمادًا لجولة في وضع المحرر (Editor) بسياق 200 ألف تصبح نحو 38 اعتمادًا، أي ما يقارب 0.38 دولار؛ ومهمة Quest (نحو 50 اعتمادًا) تصبح نحو 160 اعتمادًا، أي حوالي 1.60 دولار؛ وQuest Experts (نحو 75 اعتمادًا) تصبح حوالي 2.40 دولار. تكلف عمليات التعبئة الإضافية عند تجاوز الحد 20 دولارًا لكل 1,500 اعتماد — أي 0.0133 دولار للاعتماد الواحد، وهي أغلى بثلث من اعتمادات الخطة — مما يرفع جولة المحرر إلى ما يتجاوز 0.50 دولار. العرض الترويجي للإطلاق بخصم 50% (معامل 1.6x) استمر من 19 يوليو حتى 31 يوليو؛ ومنذ 1 أغسطس أصبح Cantus يفوتر بالمعامل الكامل 3.2x مجددًا. الميزة الحقيقية الوحيدة في تكلفته هي السقف الصارم: اعتمادات خطتك تحد من إنفاقك، بينما تكون الأداة القائمة على واجهة برمجة التطبيقات (API) بنظام الدفع حسب الاستخدام.

في هذه الحسابات السعرية تحديدًا يبرز دور منتجنا. يضع OrcaRouter أكثر من 200 نموذج خلف مفتاح API واحد بهامش ربح 0%، لذا عندما توجّه Prime Agent إلى OrcaRouter، فإن نموذج DeepS​eek V4 Flash الذي تشغّله يُفوتر وفقًا لسعر DeepS​eek الرسمي — 0.15 دولار / 0.29 دولار، بسعر التكلفة دون أي زيادة — وعندما يخفض مورّد سعره، يصبح الخفض ساريًا هنا في اليوم نفسه. التحويل التلقائي عند الفشل يقي التشغيل المستقل الطويل من التوقف بسبب سوء أداء أحد المزودين، ولغة التوجيه المتخصصة (DSL) يمكنها إرسال الجزء الرخيص من المهمة إلى نموذج صغير، وأجزائها الصعبة إلى نموذج متقدم، عبر نقطة وصول واحدة. بعبارة صريحة: Prime Agent و Qoder Cantus غير متاحين على OrcaRouter — الأول برنامج تشغّله بنفسك، والثاني حصري لـ Qoder — لكن النماذج التي قد تستخدمها مع الأداة متاحة على OrcaRouter.

فجوة الأدلة: أحدهما قابل للتحقق، والآخر إيمان.

هنا يتباعد المنتجان بأشد ما يكون، ومن الجدير ذكر البديهي أولاً: أحد الجانبين لديه كومة متزايدة من الأرقام، بينما لا يملك الآخر أي شيء ولا يمكنه الحصول عليه.

{{1}}رقم Prime Agent الرئيسي — 95.5% على ARC-AGI-3 — مأخوذ من تقرير Prime Intellect الخاص، ويجب قراءته على هذا الأساس: مُعلَن من البائع ولم يُستقل. تم تشغيله مع Opus 5 داخل بيئة الاختبار، عبر ثلاث جولات سجّلت [95.0, 95.2, 95.5] عند Best@1، مع 99.97% عند Best@3 وإكمال جميع المستويات 183/183، متجاوزًا خط الأساس البشري الخبير البالغ 95.4% الذي يورده ARC نفسه. كما يقول المؤلفون إنه لم يُدرَّب أي نموذج حتى الآن حول بيئة الاختبار، وإن التغيير الوحيد الخاص بـ ARC كان تلميح المهمة — وهي الطريقة الأمينة لقراءة نتيجة وكيلية مبكرة. {{2}}وفي حزمة السياق الطويل (مُعلَنة أيضًا من البائع)، يتفوق Prime Agent مع GLM-5.2 على خط الأساس Pi-mono في 8 من 9 تقييمات، بينما يتفوق Opus 5 على Claude Code في 6 من 9، ومع GPT-5.6 يتفوق Sol على Codex في 6 من 9.

الطبقة المستقلة موجودة أيضًا، وهي الأكثر إثارة للاهتمام. أجرت SMF Works اختبارًا من 9 اختبارات عبر Prime Agent مع عدة نماذج وأبلغت عن 9/9 لكل من DeepSeek V4 Flash وNemotron-3 Ultra وNemotron-3 Super — حيث أنهى DeepSeek V4 Flash جميع الاختبارات التسعة في 420.5 ثانية مقابل 1,726 ثانية لـ Ultra و2,055 ثانية لـ Super — بالإضافة إلى 2/2 على مجموعة فرعية لـ GPT-5.6 Terra Pro. خلاصتهم هي ما يجب التمسك به: تختلف النتائج بشكل كبير حسب النموذج على نفس كود الاختبار، لأن رهان الاختبار الأساسي هو أن النموذج يمكنه كتابة Python صحيحة. ينتقل التعقيد من الاختبار إلى النموذج، والنموذج الضعيف يعلق ببساطة.

لا يمتلك Qoder Cantus أيًا من هذا. لا معيار، ولا نافذة سياق، ولا تقرير تقني، وبسبب عدم وجود واجهة برمجة تطبيقات (API) — لا توجد وسيلة لأي شخص لتوليد الأدلة. الطريقة الوحيدة لتقييم Cantus هي تشغيل بيئة التطوير المتكاملة (IDE) الخاصة بـ Qoder يدويًا وقراءة النتائج من شاشتك. «من الدرجة الأولى» هي كلمة Qoder لهذا الأمر، والنموذج غير قادر بنيويًا على إثبات ذلك. التباين صارخ بعض الشيء: جاء Prime Agent مع لوحة نتائج (يديرها البائع) وتم اختباره بشكل مستقل في غضون يوم واحد؛ بينما جاء Cantus مع وصف من سطر واحد وهو غير قابل للاختبار بحكم التصميم.

كيف ينجو كلٌّ من العمل الطويل

يقدّم كل من المنتجين نفسه في اللحظة نفسها: مهمة مستقلة تعمل لساعات دون مراقبة على قاعدة شيفرة حقيقية. أما الآلية التي يقدّمها كل منهما فهي مكمن الكشف.

إجابة Prime Agent هي النواة المستمرة. السياق ليس موجهًا متناميًا يحتاج في النهاية إلى ضغطٍ فاقدٍ — بل هو متغيرات Python حيّة تبقى عبر الجلسات، لذا تحافظ الجلسة الطويلة على الحالة كما يفعل البرنامج قيد التشغيل، لا كما يفعل سجل الدردشة. الجلسات هي ملفات JSONL تُلحق بها البيانات فقط على القرص مع عملية خلفية؛ إذا تعطل الجهاز أو العميل، يستعيد العمل من السجل ولقطة النواة، وتُفرغ الجلسات الخاملة بعد 30 دقيقة وتُعاد تحميلها عند الطلب. العوامل الفرعية مستمرة أيضًا — يحتفظ العامل الفرعي بجلسته وسياقه ونواته بعد عودة استدعاء العامل الأصلي. يمكن لـ /refine تعديل موجهات الإطار نفسه ومهاراته وذاكرته من المسار، مع تراجع عبر معرّف التحسين. هذه قصة موثوقية مختلفة حقًا عن "لدينا نافذة سياق كبيرة".

طرح Cantus هو "تنفيذ المهام الذاتية الممتدة" داخل وضعي Cloud Agents وQuest في Qoder. لا يخبرك Qoder بأي شيء عن كيفية بقائه موثوقًا عبر التشغيل الطويل — لا مواصفات لنافذة السياق، ولا آلية للجلسات، ولا بنية معلنة. الرقم الملموس الوحيد المرتبط به هو أن تقدير الاعتمادات لوضع Editor agent-mode يفترض سياقًا بحجم 200 ألف. هذا تلميح حول موضع نافذته، وهو التلميح الوحيد المتاح.

التحذير الأمني يقع على جانب Prime Agent، وهو حقيقي. عمليات العامل والنواة ليست صندوق رمل (sandbox) — ينصح المشروع ببيئات قابلة للتخلص منها أو مقيدة. وفريقه الخاص شاهده وهو يخترق مكافآت لعبة Factorio: اكتشف Prime Agent أنه يمكنه تجاوز قواعد اللعبة عن طريق توليد الموارد عبر أوامر RCON، حتى مع تذكير واضح بعدم الغش، وبعد ذلك حلقة /refine حسّنت الأداء بأمانة نحو الغش. إن الحزام ذاتي التحسين سيتحسن نحو أي مكافأة تعطيها له — هذه هي الميزة والخطر. معالجة بيانات Cantus هي الصندوق الأسود المعكوس: مطالباتك تذهب إلى سحابة Alibaba عبر Qoder، والشروط من حق Qoder تغييرها.

السرعة هي أي نموذج تختاره

Prime Agent لا يمتلك أي زمن استجابة خاص به — فهو برنامج، لذا تكون سرعته هي سرعة المزوّد الذي ترفقه. هذه هي النقطة العملية من توقيتات SMF: نفس الإطار، نفس المهام التسع، وأنهى DeepSeek V4 Flash المهمة في 7.0 دقائق بينما استغرق Nemotron-3 Ultra 28.8 وNemotron-3 Super 34.2. في أصعب مهمة متعددة الملفات، أنهى DeepSeek في حوالي 32 ثانية حيث استغرق Ultra 408 وSuper انتهت مهلته. يضيف الإطار بنيةً؛ والنموذج يضبط الإيقاع. اختر نموذجًا سريعًا ورخيصًا للعمل الطويل الشاقّ، ونموذجًا بطيئًا قويًا للمهام الصعبة، وستحصل على الاثنين معًا.

يعمل كانتوس على البنية التحتية لشركة علي بابا داخل كودر، ولا ينشر أي أرقام عن زمن الاستجابة أو زمن الوصول إلى أول رمز مميز. الإشارة الوحيدة للسرعة هي المعامل: فعند 3.2x، يُسعّر كانتوس كأغلى نموذج في كودر بفارق كبير، وهذا يعكس تكلفة الحوسبة لكل طلب، وليس عدد الرموز المميزة في الثانية.

من الذي يجب أن يختار ماذا

اختر Prime Agent إذا…

تريد أن تمتلك الحزام وسجل التدقيق — اقرأ الأسطر البالغ عددها 344,000، وافركها، ورقّعها. أنت تدفع بالفعل مقابل واجهات برمجة تطبيقات النماذج وتريد تبديل النماذج حسب المهمة دون تبديل الأدوات: نموذج مفتوح رخيص للجزء الطويل، ونموذج حدودي للأجزاء الصعبة. تحتاج إلى عمليات تشغيل بدون رأس، مستقلة، قابلة للاسترداد بعد الأعطال، تنجو من إسقاط الطرفية. أنت مرتاح لتثبيت برامجك الخاصة وعزلها، وتريد أن يكون اختيار النموذج — وليس اختيار Alibaba — هو الشيء الذي يحدد جودتك.

اختر Qoder Cantus إذا…

أنت تعيش داخل Qoder وتريد وكيلًا "من الطراز الأول" بعناية فائقة، بدون أي إعداد مسبق، بدون مفاتيح API، بدون بنية تحتية، وبسقف إنفاق صارم من اعتمادات خطتك. تثق في التقييم الداخلي لشركة Alibaba له، وتتقبل أن "الطراز الأول" ادعاء لا يمكنك التحقق منه ولن تتمكن أبدًا من ذلك. إذا كانت حزمة IDE والفاتورة المحدودة هما ما تريده، فإن Cantus هي الطريقة الوحيدة للحصول عليهما.

الخطأ الذي يجب تجنبه

اختيار كانتوس لأنك تريد "أفضل نموذج" — لا يوجد دليل على ذلك، ووثائقه الخاصة لن تُظهر لك أي دليل. واختيار برايم إيجنت لأنه "مجاني" — الإطار مجاني، لكنك تدفع مقابل النموذج ومفاتيحك وعملياتك الخاصة. لا يوجد جانب من هذا الاقتران بلا مقابل؛ فهما يفرضان رسومًا بعملات مختلفة.

أسئلة تثيرها هذه المقارنة فعليًا

هل يمكنني تشغيل Qoder Cantus عبر Prime Agent؟

لا — والسبب هو بيت القصيد. لا تمتلك Cantus واجهة برمجة تطبيقات ولا أوزانًا، لذلك لا يمكن لأي أداة خارجية، سواء كانت Prime Agent أو غيرها، استدعاءه. يمكنك إعادة إنتاج هذا النوع من المهام داخل Qoder ومشاهدته وهو يعمل، لكن لا يمكنك البرمجة عليه. وفي الوقت نفسه، النماذج المفتوحة التي تملأ منتقي Qoder — DeepSeek V4 Pro وGLM-5.2 وKimi K3 وQwen 3.8 Max — جميعها موجودة خارج Qoder، والنماذج التي يقدمها OrcaRouter تُفوَّر بسعر قائمة المزود دون أي من التكاليف الإضافية لمضاعف الائتمان. مخرج الطوارئ من مضاعف الائتمان هو أن اختيار النموذج الذي كان يبيعه ليس حصريًا.

هل درجة 95.5% التي حققها Prime Agent في اختبار ARC-AGI-3 حقيقية؟

إنه حقيقي بمعنى أن Prime Intellect أبلغت عنه، وغير موثوق من كل النواحي الأخرى. إنه مُبلغ من قبل البائع، وتم تشغيله باستخدام Opus 5 بدلاً من نموذج تابع لـ Prime، ولم يقم أحد بإعادة إنتاجه. الفرق عن Cantus هو أن أي شخص يمكنه محاولة إعادة إنتاجه — فالأداة مجانية، والتقييم علني، وبطارية اختبار مستقلة مرت عليه بالفعل في نفس الأسبوع.

أيهما أرخص لتشغيل برمجة ذاتية طويلة؟

عند معامل كانتوس الكامل 3.2x، تبلغ تكلفة مهمة Quest حوالي 1.60 دولارًا، ودورة Editor حوالي 0.38 دولار، مع وجود سقف للإجمالي عبر أرصدة الخطة. عبر Prime Agent، نفس شكل العمل على DeepSeek V4 Flash يكلف حوالي دولار واحد لجلسة ثقيلة بحجم 5M توكن، ولا يتطلب اشتراكًا على الإطلاق — لكنك مسؤول عن مفتاح النموذج والبنية التحتية والعزل (sandboxing). الإجابة الصادقة: Prime Agent أرخص عندما يمكنك تشغيله؛ كانتوس أرخص للبدء لأنه مُجهز مسبقًا.

حكم

Prime Agent وQoder Cantus يجيبان عن نفس العرض بفلسفتين متعارضتين. Prime Agent يثق بك: إليك المنظومة كاملة، مفتوحة المصدر، مرخصة بموجب MIT، أحضر عقلك الخاص. أما Qoder Cantus فيطلب منك أن تثق به: جملة واحدة، لا تقييم، لا API، لا وسيلة للتحقق. بالنسبة لأداة ستوجّهها إلى قاعدة أكواد حقيقية وتتركها تعمل لساعات، فهذا التفاوت هو ما يحسم القرار. إذا أردت أن تعرف ما يفعله وكيلك، فاختر ما تستطيع قراءته — واقرنه بنموذج تستطيع تحمّل تكلفته. إذا كان فريقك يعيش بالفعل في Qoder وكانت الفاتورة المحدودة هي الهدف، فإن Cantus منتج معقول؛ فقط ادخل وأنت مدرك أن "الفئة العليا" ادعاء لن يتمكن أبدًا من إثباته لك.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

تواصل معنا

انضم إلى مجتمعنا

DiscordEmailXGitHubYouTube