
Clef مقابل Qwen3.8-27B: عمود فقري واحد، عقدان للمخرجات
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 219 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 41 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 105 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
Clef لا يستطيع كتابة جملة، وهو مبنيّ من نموذج يستطيع ذلك. Cloudflare/clef هو نموذج قرار متعدد الوسائط ذو 27 مليار معامل: تعطيه حالة ومخططًا لأسئلة ذات أنواع، فيعيد احتمالًا لكل خيار مسموح دون إنتاج أي رمز من النثر. العمود الفقري تحته هو Qwen3.8-27B، وهو نموذج كثيف للرؤية واللغة مفتوح الأوزان، مجمّد في مكانه مع رأس إضافي صغير ملحق. وهذا يجعله من الصفحات القليلة التي تواجه نموذجًا بنموذج حيث لا يكون الجانبان متنافسين على الإطلاق — بل هما نقطة تفتيش ومشتقتها، يتشاركان 55 غيغابايت من الأوزان ويختلفان حول ما إذا كانت الإجابة شيئًا تقرؤه أم شيئًا تحسبه.
أصبحت أوزان كليهما علنية قبل أن تصبح الكلمات كذلك. أنشأت Cloudflare مستودع Cloudflare/clef على Hugging Face في الساعة 21:15 بالتوقيت العالمي المنسق (UTC) في 30 سبتمبر 2026، بموجب Apache-2.0، ونشرت منشور الإعلان — "تقديم Clef: نماذجنا مفتوحة المصدر لاتخاذ القرار، ومنصة جديدة للضبط الدقيق بالتعلم المعزز" — في فترة ما بعد ظهر اليوم التالي. لنحو ثماني عشرة ساعة، كان نموذج بحجم 55 غيغابايت قابلًا للتنزيل ويعمل على وحدات GPU الطرفية الخاصة بـ Cloudflare قبل أن يقول مورّده أي شيء عنه. خلال ثلاثة أيام، أصبح لديه صفحة في مكتبة Ollama خلف Ollama 0.35.1، وهي حيث وجد هذا المقال النموذج، وبنى NVFP4 وFP8 وEXL3 وINT8 وQ4 وQ8 من اثني عشر رافعًا مختلفًا.
ما يمكن معرفته من المستودع مكتمل على نحو غير معتاد، ويستحق الأمر فصل ذلك عما لا يمكن معرفته. القابل للمعرفة: البنية المعمارية، ونقطة التحقق الأساسية، والترخيص، وتنفيذ مرجعي يعمل، ومصفوفة تقييم كاملة. غير القابل للمعرفة: ما إذا كانت أي من تلك الأرقام ستصمد عند إعادة تشغيل يقوم بها شخص ليس من Cloudflare. كل نتيجة تُنسب إلى Clef أدناه تأتي من تشغيل المورّد نفسه لمجموعة اختبارات يستضيفها المورّد. هذا التفاوت في مقابل نموذج خلفه شهر من الاستخدام المستقل هو العمود الفقري الصادق لهذه المقارنة، وبقية المقال تتناول موضع الأثر الفعلي.
المستودعان، جنبًا إلى جنب
ابدأ بالتنزيل، لأن التشابه هو المغزى. تبلغ ملفات safetensors الخاصة بـ Clef 54.97 غيغابايت موزعة على اثني عشر جزءًا. أما ملفات safetensors الخاصة بالنموذج الأب فتبلغ 55.56 غيغابايت موزعة على ثمانية عشر جزءًا. يحتفظ Clef بمشفّر الرؤية الخاص بـ Qwen3.8-27B — المعالج، وبرج الرؤية، والواجهة الأمامية متعددة الوسائط بأكملها — لذا لم يُجرَّد أي شيء لجعله أصغر. ما أضافته Cloudflare هو رأس مخطط مشترك بحجم 256 ميغابايت: أربع طبقات، بعرض 1,024، وستة عشر رأسًا، وشبكة تغذية أمامية بعرض 4,096، وطبقتا توجيه تقرآن الحالات المخفية النهائية للعمود الفقري. وصفة التدريب هي عمود فقري مجمّد، وذلك الرأس، ومهايئات منخفضة الرتبة برتبة 256، مع إنتروبيا متقاطعة بتنعيم التسميات لإجابات المخطط الصالحة مقترنة بخسارة Brier لشحذ المعايرة.
ثم يأتي التباعد، وهو بالكامل في ما يُسمح للنموذج بإصداره.
• المعاملات — Clef 27B، مُدرَّب لاحقًا من Qwen/Qwen3.8-27B. Qwen3.8-27B كثيف بحجم 27B، بـ64 طبقة، و5,120 بُعدًا مخفيًا، ومفردات من 248,320 رمزًا، و16 × (3 × Gated DeltaNet → FFN) متداخلة مع Gated Attention.
• المُخرَج — Clef: logit واحد لكل خيار مسموح به، مع تطبيق softmax لكل سؤال، ولا يوجد مسار توليد على الإطلاق. Qwen3.8-27B: الرموز، واستدعاءات الأدوات، وكتلة استدلال مُفعَّلة افتراضيًا.
• أشكال الأسئلة — يستقبل Clef من 1 إلى 64 سؤالًا محدد النوع في كل طلب، وذلك في ثلاثة أشكال: noul (احتمال أن تكون صحيحة)، choice (من 2 إلى 255 خيارًا مُسمّى)، score (من 2 إلى 10 مستويات مرتّبة، وتُعيد قيمة مرجّحة بالاحتمالات يمكن أن تقع بينها). لا يوفّر Qwen3.8-27B عقدًا كهذا؛ فما تحصل عليه هو نصٌّ حرّ وعليك أنت كتابة المُحلِّل.
• الترخيص — Apache-2.0 على كليهما، ولهذا السبب حدث التكميم من طرف ثالث خلال عطلة نهاية أسبوع.
• تكلفة النصف المجمَّد — رأس Clef هو 256 MB مقابل 54.97 GB من العمود الفقري. يكاد يكون التنزيل بأكمله هو النموذج الأب. إذا كان Qwen3.8-27B موجودًا لديك بالفعل على القرص، فأنت تنزّله مرة ثانية للحصول على رأي مختلف حول كيفية الإجابة.

ما تكلفة إعادة الترويس، في رقمين
تقييم Cloudflare هو مجموعة Decision Index 0.2.1، التي تُشغَّل داخليًا، وهي جدول عن نماذج القرار — ستة أعمدة: Clef، وClef-flash، وJev، وDiffusionGemma Jev، وKev 9B، وLaya. لا يوجد لـ Qwen3.8-27B صف فيه، ولا يوجد لـ Clef صف في Artificial Analysis Intelligence Index. لذا لا توجد لوحة نتائج مشتركة، ولن تختلق هذه المقالة واحدة.
ومع ذلك، هناك اختبار قياسي واحد خضع له الجانبان، والفجوة كبيرة بما يكفي لتكون الرقم الأكثر صلةً بالقرار في الإصدار. في GPQA Diamond — أسئلة علمية بمستوى الدراسات العليا، اختيار من متعدد — تقيس Cloudflare أداء Clef عند 48.0. ويسجل النموذج الأصل 90.5 على أداة تقييم Artificial Analysis و89.2 على بطاقة النموذج الخاصة بالمورّد. هذه هاوية من أربعين نقطة في المعرفة العامة، وهي ليست لغزًا: فـ Clef يجيب عبر تقييم مجموعة ثابتة من الخيارات التي أُعطيت له، والاختيار من متعدد في المعرفة العامة يكاد يكون أبعد ما يمكن توجيه الأوزان نفسها إليه عن "وجّه هذه التذكرة". تعامل مع المقارنة باعتبارها استرشادية لا منضبطة — أداتا تقييم، ومختبران، لا أداة المورّد ولا أداة الجهة الراصدة. لكن الاتجاه ليس محل شك، وهو ثمن العقد.
يظهر النمط نفسه في بقية خلايا Clef العامة. MMLU-Pro 65.9، وBBH 73.7، وCLINC150 مع التعامل مع ما هو خارج النطاق عند 97.4 لنموذج 27B مقابل 89.3 لدى Jev — تلك الأخيرة هي الخلية النادرة التي يتفوق فيها النموذج المشتق على نموذج القرار الأقدم بشكل قاطع، وهي تهم لأن رفض التصنيف هو النصف الصعب من التوجيه. حيث يكون Clef قويًا، فإنه يكون قويًا تحديدًا حيث ينبغي لمصنّف مدرّب داخليًا أن يكون: BANKING77 لتصنيف النوايا macro-F1 عند 94.2، وBFCL لمطابقة الحالة الدقيقة عند 98.5، وAPI-Bank عند 91.9. وحيث يكون ضعيفًا، فإن نموذج قرار نصي فقط من مختبر منافس — Jev من TypeSafe — يتفوق عليه بثلاثين نقطة في GPQA Diamond بينما يتقاضى $0.042 لكل مليون رمز إدخال في كتالوجنا الخاص، وهو تذكير مفيد بأن "27B" ليس بحد ذاته حجة.
ما يحتفظ به النموذج الأب هو كل ما لا يسأل عنه Decision Index. على بطاقته الخاصة وفي الصفوف المستمدة من AA، يتضمن كتالوجنا: Terminal-Bench 2.1 عند 73.0، وSWE-bench Pro 61.7، وLiveCodeBench v6 90.3، وOSWorld-Verified 84.3، وDeepSWE 1.1 عند 42.2، وAA Coding 68.1 في المرتبة 35 من 138 نموذجًا ضمن العينة. لا يوجد لأي منها صف خاص بـ Clef، لأن Clef لا يمكنه خوضها. ليس لديه مسار لاستدعاء الأدوات، ولا تخطيط طويل المدى، ولا طريقة لإصدار التصحيح.
ما تكلفة قرارٍ واحد، ولماذا يُعدّ سطر المخرجات هو الحجة بأكملها
تسرد صفحة نموذج Workers AI سعر وحدة واحدًا بالضبط لـ Clef: 0.24 دولار لكل مليون رمز إدخال. لا يوجد بند للإخراج، والسبب موجود في الاستجابات. المثال الموثّق من Ollama نفسه — تذكرة دعم تُوجَّه عبر ثلاثة أسئلة — يعود بـ "usage": {"input_tokens": 1204, "output_tokens": 3}. ثلاثة رموز إخراج مقابل ثلاثة أسئلة. سواء كانت Cloudflare تحاسب على تلك الرموز الثلاثة أم لا، فذلك شبه غير ذي صلة: تكلفة الإخراج لقرار ما ليست معدلًا، بل عدد الأسئلة.
قارن ذلك ببطاقة أسعار النموذج الأب على كتالوجنا الخاص، وهي 0.33 دولار لكل مليون رمز إدخال و2.40 دولار لكل مليون رمز إخراج مع نافذة تبلغ 262,144 رمزًا. نفس الحالة البالغة 1,204 رمز، ونفس قرار التوجيه الواحد:
• Clef — 1,204 رمز إدخال بتكلفة 0.24 دولار لكل مليون يبلغ نحو 0.00029 دولار لكل قرار، ونحو 289 دولارًا لكل مليون قرار. لا يكاد الرقم يتغير عندما تصبح الإجابة أصعب، بل فقط عندما تصبح الحالة أطول.
• Qwen3.8-27B مع تعطيل التفكير — تكلّف الحالة نفسها نحو 0.00040 دولار من المدخلات، بالإضافة إلى ما يقرب من عشرة رموز إخراج بسعر 2.40 دولار لكل مليون. لنسمِّها $0.00042، أو 421 دولارًا لكل مليون. Clef أرخص بنحو 1.5×، وهي ليست القصة التي يرويها أحد.
• Qwen3.8-27B مع إبقاء التفكير مُشغَّلًا — وهو الوضع الافتراضي في نقطة التحقق هذه. إذا أنفق النموذج 400 رمز في التفكير بشأن أيٍّ من أربع فئات ينتمي إليها بريد إعادة تعيين كلمة المرور، فهذا يضيف $0.00096 أخرى، ويستقر القرار عند نحو$0.0014، أي $1,357 لكل مليون. وهذه الرموز الـ400 مجرد افتراض لا قياس، والمضاعف يتغير خطيًا معها.
إذن، النسخة الصادقة من حجة التسعير أضيق مما تبدو للوهلة الأولى. في مواجهة نموذج عام يعمل مع إيقاف التفكير، يتفوق Clef من حيث الدولارات بمعامل يقارب واحدًا ونصف — أمر حقيقي، لكنه ليس تحويليًا. وفي مواجهة النموذج نفسه في تكوينه الافتراضي، تكون الفجوة دالة على الإسهاب، والإسهاب هو بالضبط ما يمتلكه نموذج اللغة ولا يمتلكه تصميم scorers-over-options على الإطلاق. تلك هي الحجة البنيوية: تكلفة Clef محدودة بطول الحالة، بينما تكلفة النموذج الأصل محدودة بمقدار ما يقرر النموذج الأصل قوله.

الرقم الوحيد الذي ليس قريبًا
تُفيد Cloudflare بأن وسيط زمن استجابة الطلبات يبلغ 209.3 مللي ثانية لـ Clef، وp95 يبلغ 238.6 مللي ثانية، مقيسًا عبر 43 اختبار أداء في تشغيلها، على وحدات معالجة الرسومات الطرفية الخاصة بها. لم يُعِد أحد خارج Cloudflare إنتاج هذه النتيجة، والبنية التحتية للبائع هي السبب في انخفاض الرقم إلى هذا الحد — فهذا النموذج مصمم ليجاور المتصل على الشبكة نفسها.
بالنسبة للشركة الأم، يمكننا أن نقدّم ما هو أفضل من رقم مورّد، لأنه أحد مساراتنا. خلال النافذة الممتدة على سبعة أيام والمنتهية في 2 أكتوبر 2026، قاست ساحة اختبار OrcaRouter الخاصة بـ Qwen3.8-27B عند p50 البالغ 1,929 مللي ثانية و235.8 رمز إخراج في الثانية، على 136.3 مليون رمز من الحركة في تلك النافذة. السلسلة اليومية هي الجزء المثير للاهتمام: يستقر p95 عند 10,000 مللي ثانية بالضبط في ستة من الأيام السبعة، وهو ما يُقرأ كسقف لا كقياس، ويتأرجح p50 بين 1,751 مللي ثانية و4,296 مللي ثانية حسب اليوم. اعتبر الوسيط نحو تسعة أضعاف وسيط Clef، واعتبر الذيل غير مفيد حتى ينشر أحدهم توزيعًا حقيقيًا.
تلك الفجوة ليست فرقًا في الضبط، ولن تُسدّ. فتمريرة تعبئة مسبقة فقط مع رأس تقييم متوازٍ تكتمل في مرور واحد؛ أما النموذج الانحداري الذاتي فينتهي عندما ينفد ما لديه من كلام. الأرقام المطلقة التي أعلنها المورّد بشأن Clef تستحق الخصم المعتاد، لكن الترتيب خاصية من خصائص المعمارية، لا من خصائص عتاد Cloudflare.
السياق مقتبس بثلاث طرق لأحدها
كلا الطرازين يستقبلان النصوص وJSON والصور والفيديو. النافذتان ليستا متماثلتين، وإحداهما يُذكر حجمها على نحو متعارض حسب المصدر الذي تقرأ منه.
• Clef، المستضاف — 65,536 توكنًا، وفقًا لصفحة نموذج Workers AI ومنشور الإعلان. هذا هو الرقم الذي يُقيّد مُستدعي API، وصياغة Cloudflare نفسها مقارنة: ضعف الحالة التي تحتفظ بها نافذة Jev البالغة 32K.
• Clef، على القرص — الإصدار المنشور من config.json يعلن max_position_embeddings بقيمة 262,144، لأن العمود الفقري المجمّد هو عمود النموذج الأصل ولا يزال يحمل سقف الموضع الخاص بالنموذج الأصل. الأداة المساعدة المضمّنة encode_record تُعين افتراضيًا max_length=16,384، مع max_state_tokens المتاح لتقييد الحالة بشكل منفصل. لا يوجد من هذه الأرقام الثلاثة ما هو خاطئ؛ فهي تجيب عن أسئلة مختلفة، وقائمة وقت التشغيل التي تعلن 256K إنما تقرأ الإعدادات، لا نقطة النهاية.
• Qwen3.8-27B — 262,144 أصليًا، وقابلة للتوسعة إلى 1,000,000 مع تكوين الخدمة المناسب، وفقًا لبطاقة المورّد وصف الكتالوج لدينا. أربعة أضعاف نافذة Clef المستضافة كحد أدنى.
النتيجة العملية أصغر مما توحي به النسبة. يستهلك Clef حالة — تذكرة، فاتورة، لقطة شاشة — لا محادثة، ومن نقاط قوته التسويقية أنك تستطيع تسليمه حمولة كبيرة مسطّحة وتسأل عنها أربعة وستين سؤالًا دون أن تدفع مقابل الحمولة مرة أخرى لكل سؤال. يحتاج العنصر الأب إلى النافذة لأنه يجب أن يحتفظ بالسجل ونتائج الأدوات واستدلاله الخاص. متطلبات مختلفة، سقوف مختلفة.
كلاهما يرى البكسلات نفسها
مشفّر الرؤية موروث، لذا ليست هذه حالة يكون فيها أحد النموذجين متعدد الوسائط والآخر غير كذلك. يقبل Clef ما يصل إلى أربع صور لكل طلب، بصيغة PNG أو JPEG أو WebP مُرمّزة بـ base64، تتشاركها كل الأسئلة في الحمولة، ويمكن إضافة إطارات الفيديو على هيئة مصفوفات إطارات — مثال الإيصال في البطاقة يطرح سؤالًا بنعم/لا عمّا إذا كان الإجمالي مقروءًا، وهو التصميم في نسخة مصغّرة. Qwen3.8-27B هو نموذج رؤية-لغة أصلي، مع OmniDocBench 1.5 عند 91.1، وRealWorldQA عند 85.9، وCharXiv عند 78.8 على بطاقة المورّد.
ما يختلف هو ما تحصل عليه في المقابل. يمنحك Clef قرارًا حقلًا بحقل مع احتمال مرفق به، وهي إجابة محددة النوع عن مستند. أما النموذج الأب فيمنحك وصفًا للمستند، ثم تقوم أنت بتحليله. وفي فئة كبيرة من أعمال المستندات — تحقّق من هذه الاستمارة، حدّد موقع هذا البند، هل هذا المجموع فوق الحد — تكون الإجابة محددة النوع هي المهمة بأكملها، ويكون الوصف عبئًا إضافيًا تدفعه ثم تتخلص منه.
حيث يقع الخط فعليًا
• اختر Clef — فالإجابات قابلة للتعداد مسبقًا، وكنت تفضّل ألا تكتب محللًا. التوجيه، والفرز، والبوابات، وفحوصات السياسات، واستخراج حقول المستندات. مجموعات مغلقة، من 2 إلى 255 خيارًا لكل سؤال، وحتى 64 سؤالًا يُقيَّم معًا.
• اختر Clef — القرار في مسار ساخن، و209 ms مقابل 1,929 ms يغيّر ما يمكن لخط المعالجة فعله. هذا هو أقوى سبب منفرد للانتقال، وهو سبب يتعلق بزمن الاستجابة، لا بالدقة.
• اختر Clef — فأنت تريد الحتمية. لا يمكن أن يعود خيار لم تُصرّح به، لأنه لا توجد خطوة توليد لإنتاجه.
• أبقِ على Qwen3.8-27B — فالجواب ليس اختيارًا من قائمة: التلخيص، وصياغة المسودات، والتفكير في حلّ مشكلة جديدة، وكتابة الشيفرة، وتشغيل الأدوات على مدى زمني طويل. لا يقدر Clef على أيٍّ من ذلك، ولن يخبرك بذلك.
• أبقِ Qwen3.8-27B — فأنت تحتاج أن يقول النموذج "لا شيء من هذه". نموذج القرار يقيّم الخيارات التي أُعطيها. أعطِه مخططًا للفوترة/الدعم الفني/المبيعات وطلبًا يتعلق بالخصوصية، فيعيد أقلَّ تلك الثلاثة سوءًا بدلًا من الرفض. النموذج الأب يُظهر السؤال الذي لم يخطر لك أن تطرحه.
• احتفظ بـ Qwen3.8-27B — لأعمال السياق أو المستندات الطويلة. أربعة أضعاف سعة النافذة المستضافة، قبل توسعة المليون رمز.
اقرأ تلك القائمة بوصفها خط أنابيب لا حكمًا نهائيًا، فهذا ما هي عليه في حقيقته. تجعل البنية المعمارية هذه العلاقة حرفية: Clef هو مرحلة التعبئة المسبقة الخاصة بالنموذج الأصل، لكن بآلية إجابة مختلفة في الطرف الأخير. التصميم المعقول يضع Clef في المقدمة — ليحدّد المسار والأولوية وعلامة التصعيد — ويُبقي Qwen3.8-27B خلفه لينفّذ القرار. الاثنان مكمّلان لبعضهما تصادف أنهما يتشاركان التنزيل نفسه.
أين يتم تشغيل كل منها
Clef مستضاف على Workers AI من Cloudflare بسعر $0.24 لكل مليون إدخال كما هو مذكور أعلاه، وأوزان Apache-2.0 متاحة لك لتشغيلها محليًا. إدراج مكتبة Ollama هو أحدث واجهة: ollama pull clef يحتاج إلى Ollama 0.35.1 أو أحدث، لأن النموذج يتحدث عبر /v1/systemone، نقطة النهاية التي أضافها Ollama لنماذج القرار. راقب الوسوم، لا العنوان الرئيسي — فالافتراضي وclef:27b هما الوسمان بحجم 18 GB، وهو بناء رباعي البتات لنموذج بحجم 55 غيغابايت؛ clef:27b-q8_0 هو 30 GB، clef:27b-nvfp4 هو 18 GB، clef:27b-mxfp8 هو 31 GB، وclef:27b-mlx-bf16 هو 55 GB الكامل لشرائح Apple silicon. سيتحدث إليه Python SDK الخاص بـ TypeSafe إذا وجّهته إلى Ollama محلي وزوّدته بأي مفتاح API، وهو ما يتجاهله وقت التشغيل. ثمة تحذير واحد سيؤلم في الإنتاج: الثقة تقيس مدى تركز الاحتمالات، وليس احتمال أن تكون الإجابة صحيحة، وتُحسم التعادلات وفق ترتيب الخيارات الذي أعلنته.
يُعدّ النموذج الأب هو الأسهل في وضعه خلف واجهة برمجة تطبيقات (API) اليوم. يمكن توجيه Qwen3.8-27B على OrcaRouter بالسعرين 0.33 دولار و2.40 دولار لكل مليون المستخدمين أعلاه، مع نافذة 262,144 توكن، وهو أحد أكثر من 200 نموذج يمكن الوصول إليها عبر مفتاح واحد متوافق مع OpenAI. ولأن سعر القائمة لدى المزوّد يُمرَّر بهامش ربح 0%، فإن أي خفض سعر من أحد المورّدين على أيٍّ من جانبي هذه المقارنة يصبح سارياً على مساراتنا في اليوم نفسه الذي يظهر فيه.
Clef نفسه ليس أحد مساراتنا — فالكتالوج العام لدينا لا يعيد شيئًا له، ولا ينبغي قراءة أي شيء هنا على أنه ادعاء توفر من جانبنا. ما نوفّره فعلاً هو النموذج الذي يجعل نمط القرار قابلًا للوصول دون حساب Cloudflare: من TypeSafe Jev 1.13 مسار مُدرَج بسعر $0.042 لكل مليون رمز إدخال مع سياق من 65,536 رمزًا، مقيس عند p50 قدره 148 ms خلال النافذة نفسها البالغة سبعة أيام، وهو يستخدم لـ POST /v1/systemone بنية الطلب نفسها. وبما أن Clef متوافق مع Jev على مستوى API عن قصد، فإن خط أنابيب مبنيًا على أي منهما لا يبعد عن الآخر سوى تغيير في الإعدادات — وهي الحالة التي توجد طبقة توجيه لجعلها بلا كلفة. أبقِ كليهما قابلين للوصول، وقِس على تسمياتك الخاصة، ودع الفائز يكون نقطة بيانات لا التزامًا معماريًا. إذا انتهى الأمر بنموذج قرار يعمل كبوابة لوكيل، فإن النموذج الذي يتصرف بناءً على القرار لا يزال عليه أن يكون قابلًا للوصول، وهذا النصف موجود بالفعل خلف المفتاح نفسه.

ما الذي قد يغير هذه القراءة؟
ثلاثة أشياء، بترتيب تصاعدي حسب مقدار ما قد تُحرّكه.
يحتاج طرف ثالث إلى إعادة تشغيل Decision Index. المجموعة عامة، وتصف Cloudflare التقييمات بأنها قابلة لإعادة الإنتاج، لذا فإن ذلك قابل للتحقيق — وخلية CLINC150 خارج النطاق هي الجديرة بالمراقبة، لأن نتيجة 97.4 لنموذج 27B إما أن تكون ميزة حقيقية على 89.3 الخاصة بـ Jev في النصف الأصعب من التوجيه، أو أثرًا من أداة اختبار مبنية داخليًا. ولا أحد في Cloudflare يعرف ذلك بعد.
على أحدهم أن يقيّم Clef وQwen3.8-27B على مهمة التصنيف نفسها وبالعلامات نفسها. فهذه هي المقارنة الوحيدة التي ستحسم ما إذا كانت إعادة الترويس مقايضة في الجودة أم ترقية في الجودة لقرارات المجموعة المغلقة، ولا يملك أي من المورّدين حافزًا لإجرائها. وحتى ذلك الحين، تظل فجوة الأربعين نقطة في GPQA أفضل دليل متاح على ما تمت إزالته، وهي دليل على المهمة الخاطئة.
ويحتاج زمن استجابة Clef إلى p95 في ظل التزامن. وقد قاس المورّد الوسيط البالغ 209 مللي ثانية، على عتاد يتحكم فيه المورّد، لنموذج تتمثل حجته الترويجية بأكملها في أنه يقع في مسار ساخن. أما الترتيب مقابل نموذج أب ذي انحدار ذاتي فهو معماري وسيبقى صامدًا. القيم المطلقة بالمللي ثانية هي الرقم الذي ينبغي عدم الوثوق به، وهي الرقم الذي يقوم عليه المبرر التجاري بأكمله.
Qwen3.8-27B هو أحد أكثر من 200 نموذج يمكن الوصول إليها عبر مفتاح واحد متوافق مع OpenAI — Qwen3.8-27B.
