
Spark-X2.5-4B وSpark-X2.5-1.7B: نماذج وكيل مدمجة على الجهاز بسياق أصلي يبلغ 1M
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
نُشر كل من Spark-X2.5-4B وSpark-X2.5-1.7B للعموم في 1 سبتمبر 2026، عندما قامت SparkLLM — الشركة التابعة لـ iFlytek والمعروفة باسم XHToken (词元星火) — بفتح مصدر النموذجين المضغوطين بموجب رخصة Apache 2.0، مع ظهور الأوزان والكود ووثائق النشر على Hugging Face وGitHub في اليوم نفسه. المواصفة الرئيسية هي نافذة سياق أصلية تبلغ 1,000,000 توكن على نماذج صغيرة بما يكفي للعمل على الجهاز، مدعومة بمفردات يُدَّعى أنها تغطي أكثر من 200 لغة، وتصميم انتباه هجين تقول الشركة الموردة إنه مخصص للعمل الوكيل. ما يمكن معرفته اليوم من المستودعات كبير؛ أما ما لم يُؤكَّد بعد فهو كل ما لا يمكن حسمه إلا بالقياس المعياري المستقل، لأن نموذجًا طُرح قبل ساعات فقط لا توجد له تقييمات محايدة حتى الآن. كما تضم عائلة X2.5 عضوًا أكبر قادمًا — Spark-X2.5-293B المقرر إطلاقه في 7 سبتمبر.
ما الذي تظهره المستودعات فعليًا
تضم مجموعة Hugging Face ستة مستودعات: نموذجا Spark-X2.5-4B وSpark-X2.5-1.7B المضبوطان بالتعليمات، ونقاط التحقق الأساسية لهما، وتحويلات GGUF لكليهما. تصف بطاقة نموذج 4B بنية الانتباه الهجين — طبقة انتباه كاملة واحدة لكل ثلاث طبقات انتباه بنافذة منزلقة — وهو الشكل المطلوب تمامًا عندما يكون الرقم التسويقي مليون رمز، لأن الانتباه الكامل على مليون رمز سيكون مكلفًا تربيعيًا لولا ذلك. وتذكر البطاقة نافذة سياق أصلية تصل إلى مليون رمز، مع مرحلة تدريب على السياقات الطويلة مددت طول التسلسل إلى مليون أثناء التدريب المسبق.
• البنية — انتباه هجين، طبقة انتباه كاملة واحدة لكل ثلاث طبقات ذات نافذة منزلقة؛ BF16 safetensors.
• السياق — يدعم أصلاً حتى 1,000,000 توكن؛ وقد استُخدم التدريب على السياق الطويل بتسلسلات تصل إلى 1M.
• اللغات — أكثر من 200، وفقًا لبطاقة النموذج (الإصدار 1.7B يحمل الادعاء نفسه).
• التدريب المسبق — حوالي 20 تريليون رمز من صفحات الويب والكتب والمنشورات الأكاديمية والشفرة البرمجية والمواد الموسوعية، تم تدريبه من البداية إلى النهاية على مجموعات Huawei Ascend.
• ما بعد التدريب — SFT يتبعه RL واسع النطاق عبر الاستدلال والبرمجة والسلوك الوكيلي واتباع التعليمات، مع دمج سياسات المجالات عبر تقنية تسميها الورقة MOPD.
• الترخيص — Apache 2.0 لكلا الحجمين، دون بنود تتعلق بالإيرادات أو المناطق من النوع الذي تُرفقه عدة مختبرات صينية أخرى بإصداراتها المفتوحة.

أرقام الوكلاء — وإلى أي مدى يمكن الوثوق بها
بطاقة النموذج تنشر جدولًا كاملًا لمعايير الوكلاء والاستدلال، وهو كلّه من إبلاغ البائع ولم يُتحقق منه بشكل مستقل — فعليك أن تصنّفه على هذا الأساس، لأن السؤال المهم بالنسبة لنموذج 4B الذي لم يتجاوز عمره يومًا واحدًا هو: هل ينجو أيٌّ من هذه الأرقام عند التقييم المستقل؟ على جدول البائع نفسه، يسجّل Spark-X2.5-4B نتيجة 65.1 في BFCL-V4 (استدعاء الدوال)، و75.1 في τ²-bench (مهام الوكيل طويلة الأفق)، و40.9 في BrowseComp، و44.4 في SWE-Bench Pro، و90.7 في AIME 2026، و81.2 في HMMT فبراير 2026، و74.2 في IMO-AnswerBench، و67.4 في GPQA. أما نموذج 1.7B فله لحظته في اختبار المنزل الذكي: دقة وصول إلى نهاية بنسبة 90.3% للأوامر، بزمن استجابة متوسط يبلغ 0.85 ثانية على مجموعة Domux. كما يدّعي البائع أن نموذج 4B "ينافس النماذج السحابية التي يزيد حجمها مرّتين إلى ثلاث مرات" في تنفيذ الخوارزميات وإكمال الأكواد وتوليدها — وهي دعوى تُعدّ في الوقت نفسه الجملة الأكثر فائدة في الإصدار، والأكثر حاجةً إلى تحققٍ محايد.

ما هو أكثر إثارة للاهتمام بنيويًا من أي رقم منفرد هو أن الإصدار موجّه نحو الوكلاء منذ البداية. تسرد البطاقة التكامل مع بيئات Codex وClaude Code وOpenClaw وHermes، ودعم استدعاء الأدوات عبر محلل مخصص في SGLang، والتفكير مفعّل افتراضيًا (علامة وقت تشغيل، enable_thinking، تعطّله). بعبارة أخرى، وضع المورّد نموذج 4B كنموذج لاستخدام الأدوات، وليس روبوت دردشة، وهو رهان حقيقي: نماذج الوكلاء الصغيرة هي ما يتجه إليه سوق التشغيل على الأجهزة فعلًا.
النظام البيئي لليوم صفر، وقصة vLLM
يدعم vLLM كلاً من Spark-X2.5-4B وSpark-X2.5-1.7B منذ اليوم الأول عبر إضافة عامة خارج الشجرة وليس عبر دمج في الفرع الرئيسي. ويقع هذا التكامل في مستودع XHToken/Spark-plugin؛ استنسخه ثم نفّذ uv pip install .، ثم شغّل النموذج باستخدام vllm serve و --trust-remote-code مع قالب محادثة مخصص. أما مسار SGLang فهو صورة Docker معدّة مسبقًا تُطلق باستخدام --tool-call-parser spark25 و --context-length 1048576 — وهي نافذة سياق كاملة بمليون رمز في أمر الإطلاق، وهي أسرع طريقة للتحقق من صحة ادعاء طول السياق على عتاد حقيقي.

بالإضافة إلى vLLM وSGLang، يعمل النموذج على نسخة fork من llama.cpp، وMLX (على Apple silicon وLinux CPU)، وOllama وLM Studio عبر GGUF، مع دعم الضبط الدقيق من خلال fork من LLaMA-Factory. دعم العتاد هو العنوان الرئيسي الآخر: NVIDIA وHuawei وHygon وHOUMO.AI — إضافة إلى Apple silicon — وهذا أمر مهم لأنه من النادر أن يُطرح نموذج من مختبر صيني مع وثائق نشر على Ascend وHygon والرقائق المحلية في اليوم الأول، وليس كوعد.
ما الغرض من نموذج محلي بسعة 1M توكن؟
طول السياق هو الميزة، وهو موجّه لمهام محددة. مليون رمز من السياق الأصلي على نموذج 4B يعني قاعدة بيانات برمجية كاملة، أو مجموعة مستندات طويلة، محمّلة في نموذج يعمل محليًا — دون خط أنابيب RAG، ودون تقسيم. العرض التوضيحي الخاص بالمورّد، المبني على أدوات مكتبية من Loomy، يجعل نموذج 4B يكتب سكربتًا لتجميع جدول بيانات مبيعات، واستخراج المؤشرات والاتجاهات الرئيسية، وإنشاء تقرير ثنائي اللغة يبلغ نحو 3,000 كلمة. جانب الروبوتات هو النصف الآخر: كلا الحجمين موجّهان للروبوتات والإدراك والتنفيذ على الحافة، ويغطيان التحكم وتتبّع الأهداف والملاحة، وهو مجال منطقي لنموذج 1.7B يستجيب في أقل من ثانية.
الخطوة الأكبر: Spark-X2.5-293B
النموذجان الصغيران هما الخطوة الافتتاحية. في 7 سبتمبر، تقول SparkLLM إنها ستصدر Spark-X2.5-293B، وهو نموذج أساسي يضم 293 مليار معامل، ويتمتع — وفقًا للإعلان — بقدرات محسّنة في البرمجة والوكيل. نماذج X2.5 الصغيرة هي في الواقع الجزء المخصص للأجهزة من قصة ذات مستويين؛ أما النموذج الكبير فهو الذي يحدد سقف العائلة. إن التعامل مع نموذجي 4B و1.7B بوصفهما الإصدار الكامل سيفوّت اتجاه التطور.
كيف تجربها، وماذا تشاهد
واجهة برمجة التطبيقات (API) متاحة على منصة Xingchen MaaS التابعة لشركة iFlytek ومجانية لفترة محدودة؛ الأوزان متاحة على Hugging Face وModelScope ومكتبة Ollama. أما بخصوص التوجيه، فإن Spark-X2.5-4B جديد جدًا بحيث لم يبدأ أي مُجمّع في تقديمه بعد — وOrcaRouter لا يوجّهه اليوم، ولا ينبغي فهم أي شيء في هذه الصفحة على أنه يوحي بغير ذلك. لكن في اليوم الذي يضيف فيه أي مزوّد موجَّه هذا النموذج، تتغير المعادلة الاقتصادية بطريقة يمكن توقعها: إذ يمرر OrcaRouter سعر القائمة الخاص بالمزود دون أي زيادة (0%)، لذلك مهما كان السعر الذي يحدده البائع فستدفعه، باستخدام مفتاح API نفسه الذي تستخدمه بالفعل، والتبديل التلقائي عند الفشلبحيث لا يضطر أي نموذج صدر للتو إلى أن يكون رهانًا في الإنتاج أبدًا. وهذه هي النظرة المعتادة لهذه المدونة إلى أي نموذج جديد كليًا، ويستحق الأمر أن يُقال صراحةً.
أربعة أمور ستحدد ما إذا كان هذا الإصدار لحظةً أم مجرد حاشية. أولًا، ما إذا كانت التقييمات المستقلة — سواءً إدراجًا في مؤشر Artificial Analysis، أو مركزًا في الساحة، أو تشغيلًا مُعادًا لمعيار τ²-bench — ستقترب ولو جزئيًا من الأرقام التي يعلنها البائع؛ فحصول نموذج بحجم 4B على 90.7 في AIME رقم كبير، والأرقام الكبيرة الواردة في بطاقة يوم الإصدار هي بالتحديد ما يخضع للتحقق. ثانيًا، ما إذا كان سياق 1M من التوكنات يصمد في مكدس الانتباه الهجين تحت أحمال خدمة حقيقية، وليس فقط في أمر الإطلاق. ثالثًا، ما إذا كانت الأوزان المدربة على Ascend تعمل بشكل سليم على أجهزة NVIDIA في الميدان. رابعًا، ماذا سيقدّم Spark-X2.5-293B فعليًا في 7 سبتمبر. وحتى ذلك الحين، الملخص الصادق لـ Spark-X2.5-4B وSpark-X2.5-1.7B هو: واعد، مفتوح، وغير مُتحقق منه تمامًا — وهو، بالنسبة لنموذج أُطلق هذا الصباح، الوضع الصحيح.
