بطاقة عنوان رئيسية مكتوب عليها DeepSeek V4.1 Flash في OpenCode، فوق نص علوي من دليل وكيل البرمجة - سبتمبر 2026، وعنوان فرعي حول ثلاث تكاملات تم التحقق منها اليوم، ومقياس الجهد الذي يحدد ما إذا كان سيكتمل، مع أربع شرائح تحمل النص: OpenCode Go بسعر 10 دولارات شهريًا، خارج وقت الذروة 0.15 دولار / 0.60 دولار لكل مليون، إعدادات الجهد المسبقة: منخفض 50، مرتفع 75، أقصى 100، ومؤشر AA Intelligence Index 40، وتذييل يشير إلى أن إعدادات الجهد المسبقة مستندة إلى تقارير المجتمع.
Guides & Insights

DeepSeek V4.1 Flash في OpenCode: الإعداد والتكلفة وقرص الجهد الذي لا يذكره أحد

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ظلّ DeepSeek V4.1 Flash موجودًا في OpenCode Go منذ 10 سبتمبر، وللمضاعِف الذي ألحقته به OpenCode تاريخ انتهاء منشور: 20 سبتمبر. أي بعد أربعة أيام من الآن. الجزء المثير ليس الموعد النهائي — بل إن الإعداد الذي يحدد ما إذا كانت البرمجة مع هذا النموذج ممتعة غائب عن كل دليل إعداد في الصفحة الأولى من النتائج، وفي إطارين على الأقل من أُطر التشغيل يُسقَط بصمت. هذا دليل عملي لتوجيه وكيل برمجة إلى DeepSeek V4.1 Flash: معرّفات النماذج الدقيقة، وعمليات التكامل الثلاث التي جرى التحقق منها اليوم، والتحكم في جهد الاستدلال المُبلَّغ عنه من المجتمع، ونمط فشل الإفراط في التفكير مع التخفيفات التي تعمل فعلاً.

ما الذي توجّه وكيلك نحوه فعليًا؟

طُرح DeepSeek V4.1 Flash في 2026-09-10 — ملاحظة الإصدار في وثائق واجهة برمجة التطبيقات (API) الخاصة بـ DeepSeek نفسها مؤرخة بذلك اليوم، وهو أصغر نموذج في عائلة البنية الجديدة للمورّد. وتفيد DeepSeek بوجود عمود فقري من مزيج الخبراء (Mixture-of-Experts) بمعاملات 552B، مبني على ما تسميه تصميم Causal Encoder–Decoder، مع تنشيط نحو 8B معامل لكل توكن أثناء prefill و16B أثناء decode. يستقبل النص والصور كمدخلات ويعيد النص، ويدعم نافذة سياق تصل إلى مليون توكن، وسيولّد ما يصل إلى 384,000 توكن في استجابة واحدة — ويأتي الحدان الأقصيان للسياق والإخراج كلاهما من صفحة النموذج الخاصة بـ OrcaRouter، والتي تدرج 1,048,576 و384,000 على التوالي.

اختبارات الأداء من البائع، من الرسم البياني على صفحة إصدار DeepSeek وبالتالي مُبلَّغ عنها من البائع وغير مدققة: 30.0 في Terminal-Bench 3.0، و74.2 في DeepSWE v1.1، و88.1 في CyberGym، و54.8 في Automation-Bench، و90.9 في GPQA Diamond. التقييم المستقل أقل وفرة لكنه موجود — Artificial Analysis، كما تم الاطلاع عليها مباشرة اليوم، تضع DeepSeek V4.1 Flash عند 40 على مؤشر الذكاء الخاص بها، في المرتبة السادسة من 113 في فئة المقارنة الخاصة بها. سطر واحد من تلك الصفحة نفسها يهم قارئ وكيل البرمجة أكثر مما يهمه الترتيب: تُصنّف Artificial Analysis النموذج بأنه مفرط في الإسهاب، بعد أن استهلك 250 مليون رمز إخراج لإكمال دورة مؤشر الذكاء الخاص به مقابل وسيط قدره 140 مليون. سنعود إلى ذلك.

حقيقتان تتعلقان بالتسمية توفّران وقتًا حقيقيًا في تصحيح الأخطاء. معرّف نموذج API المرجعي لدى DeepSeek هو الآن code>deepseek-flash/code>. السلاسل النصية الأقدم code>deepseek-v4-flash/code> و code>deepseek-v4-flash-vision-exp/code> لا تزال مقبولة، لكن النماذج التي تقف خلفها تم إيقافها، ويتم تلبية الطلبات عبر V4.1 Flash بسعر Flash. وفي سياق منفصل، لم يختفِ DeepSeek V4 Pro: توضح وثائق DeepSeek أن خدمة API الخاصة بـ V4 Pro تستمر بعد 2026-09-14 مع فوترة دون تغيير. إذا قيل لك إن الطراز الرائد قد أُوقف، فهذا ليس ما تقوله وثائق المورّد نفسه.

Single-column scoreboard titled DeepSeek V4.1 Flash in coding agents, with six rows reading Released 2026-09-10, Context window 1,048,576, Max output 384,000, Price per 1M $0.15 / $0.60 off-peak, Peak price per 1M $0.30 / $1.20, and AA Intelligence Index 40, #6 of 113, over a footer citing DeepSeek and OpenCode Go documentation for price and limits and Artificial Analysis for the index.

OpenCode: مسارَان للدخول، والمعرّف الذي يجب كتابته فعليًا

هناك طريقتان لوضع DeepSeek V4.1 Flash خلف OpenCode، ولهما اعتبارات اقتصادية مختلفة.

مسار الاشتراك هو OpenCode Go، خطة بقيمة 10 دولارات شهريًا يصفها OpenCode بأنها مجموعة منسقة من نماذج البرمجة المفتوحة التي اختبرها وقاس أداءها. الإعداد أربع خطوات ولا يوجد ملف تكوين لتحريره يدويًا: سجّل الدخول إلى OpenCode Zen، واشترك في Go، وانسخ مفتاح API، ثم شغّل code>/connect/code> في TUI، اختر OpenCode Go، والصق المفتاح. بعد ذلك code>/models/code> يسرد ما هو متاح. تأخذ مراجع النماذج في التكوين الشكل code>opencode-go/<model-id>/code>.

أي معرّف نموذج؟ كلاهما. قائمة النماذج الخاصة ببوابة Go، التي تم جلبها اليوم من code>https://opencode.ai/zen/go/v1/models/code>، وتعيد code>deepseek-flash/code> وcode>deepseek-v4.1-flash/code> كمدخلين متميزين، إلى جانب القديم code>deepseek-v4-flash/code> وcode>deepseek-v4-pro/code>. أي من الأولين يقابل النموذج الذي تريده؛ code>deepseek-flash/code> هو الاسم الأساسي والخيار الأكثر أمانًا لأي شيء تنوي إبقاءه قيد التشغيل.

المسار المباشر يتخطى الاشتراك بالكامل: شغِّل code>/connect/code>، وابحث عن DeepSeek، والصق مفتاح منصة DeepSeek. بعد ذلك ستُحاسبك DeepSeek بسعر القائمة بدلًا من الاستفادة من مخصص Go. تنشر DeepSeek سعر القائمة على النحو التالي: خارج ساعات الذروة 0.15 دولار لكل مليون رمز إدخال و0.60 دولار لكل مليون رمز إخراج، مع قراءات مخزّنة مؤقتًا بسعر 0.003 دولار لكل مليون — وتتضاعف هذه الأسعار تمامًا خلال ساعات الذروة. وتتفق كل من وثائق OpenCode Go وصفحة نموذج OrcaRouter، كما قُرئتا اليوم، على هذه الأرقام.

ما يضيفه OpenCode Go هو بنية الحصص المخصصة، وهنا تستحق الأرقام قراءة متأنية لأنها السبب وراء أهمية الموعد النهائي. تُدرج وثائق OpenCode الخاصة الطراز DeepSeek V4.1 Flash بحدّ شهري قدره 15 دولارًا، مضروبًا حاليًا في 4 ليصبح 60 دولارًا ضمن عرض ترويجي تصفه OpenCode بأنه "ينتهي في 20 سبتمبر". وتُنشر أعداد الطلبات المقدّرة في عمودين: 6,500 لكل 5 ساعات / 16,250 أسبوعيًا / 32,500 شهريًا بالسعر القياسي، أو 26,000 / 65,000 / 130,000 مع تطبيق مضاعف 4×. وشكل الحصة متسق عبر الطرز جميعها — فحدّ الـ5 ساعات يمثل 20% من الرقم الشهري، والحدّ الأسبوعي 50%، والحدّ الشهري هو الكل.

تلك هي أرقام OpenCode المنشورة، مقروءة من توثيق Go الخاص بها اليوم. إنهاء العرض الترويجي قرارهم، وله تاريخ محدد.

Screenshot of the OpenCode Go documentation pricing table showing the DeepSeek V4.1 Flash off-peak row at $0.15 input, $0.60 output and $0.003 cached read per 1M tokens with a monthly limit of $15 raised to $60 under a 4x promotion ending Sep 20, the DeepSeek V4.1 Flash peak row at $0.30 input, $1.20 output and $0.006 cached read with the same $15 to $60 limit, and a footnote stating peak hours are 01:00-04:00 and 06:00-10:00 UTC Monday through Friday with all other hours including weekends off-peak.

Command Code: لا يزال نشطًا، وتقرير خطأ يستحق الاطلاع

لا يزال كتالوج Command Code الخاص يسرد الطراز حتى اليوم، تحت المعرّف code>deepseek-v4-1-flash/code>، بنافذة سياق تبلغ 1M رمز وبنفس اقتصاديات التمرير: $0.15 / $0.60 خارج أوقات الذروة، $0.30 / $1.20 في وقت الذروة، $0.003 لقراءة مخزّنة مؤقتًا. إن تطابق الأسعار بين أداتَي اختبار مستقلتين ليس مصادفة — فكلتاهما تمرران سعر القائمة الخاص بـ DeepSeek بدلًا من تحديد سعرهما الخاص.

الآلية واضحة ومباشرة. ثبّت باستخدام code>npm i -g command-code/code>، شغّله من دليل مشروعك، وقم بالمصادقة باستخدام code>/login/code>، واستخدم code>/connect/code> إذا أردت إحضار مفتاح المزوّد الخاص بك. code>/model <id>/code> يطبّق تغيير النموذج مباشرةً، بينما code>/model/code> المجرّد يفتح قائمة اختيار، و code>/effort/code> يضبط جهد الاستدلال للنموذج الحالي — الخيار الأكثر أهمية هنا.

يستحق تقرير خطأ واحد من المجتمع أن يبقى في ذهنك قبل أن تتعقّب العطل في الطبقة الخطأ. تصف مشكلة مفتوحة ضد طبقة توجيه من طرف ثالث ذاكرة تخزين مؤقت لإعادة تشغيل الاستدلال لا تُفعّل أبدًا من أجل code>command-code/deepseek-v4.1-flash/code> المعرّف، لأن النمط الذي تُطابِق عليه طبقة التوجيه يتوقّع code>v4./code> أو code>v4-/code> مقطعًا والسلسلة هي code>v4.1/code>. العَرَض المُبلَّغ عنه هو أخطاء 400 من المنبع تشكو من أن محتوى الاستدلال الناتج في وضع التفكير يجب أن يُعاد تمريره إلى واجهة API. هذا تقرير خطأ مجتمعي حول مُطابِق من جهة العميل، وليس إرشادًا من المورّد وليس مشكلة في النموذج — لكنه بالضبط النوع من الأمور الذي يبدو كخلل في النموذج في الثانية فجرًا.

Claude Code وCodex والعملاء الذين تحققت منهم OpenCode بنفسها

إن OpenCode Go ليس مقتصرًا على OpenCode فقط، وتقول وثائقهم ذلك صراحةً: فهو مصمم لـ OpenCode ووكلاء البرمجة الآخرين الذين ينتجون أنماط طلبات مشابهة، مع قائمة منشورة بالعملاء الذين تم التحقق من عملهم. تضم هذه القائمة حاليًا Hermes وClaude Code وCodex وZCode وPi — وبالنسبة إلى Claude Code، الملاحظة هي أنه "يتعرّف على ترويسة الجلسة الأصلية الخاصة به. لا حاجة إلى غلاف ترويسة مخصص." ويأتي مع ذلك مطلبان: عرّف عميلك بوكيل المستخدم الخاص به بدلًا من اسم SDK عام، وأرسل معرّف جلسة ثابتًا في code>x-opencode-session/code> كترويسة في كل محادثة، وهذا ما يسمح لتوجيههم والتخزين المؤقت للمطالبات لديهم بالعمل. بالنسبة إلى Hermes، يهمّ البناء الذي تم التحقق منه — فقد دُمج إصلاح الترويسة بعد v0.21.0، لذا لا يحمل ذلك الإصدار وحده هذا الإصلاح.

هناك أيضًا مسار غير مرتبط بأي اشتراك على الإطلاق، يستخدم نقطة نهاية DeepSeek المتوافقة مع Anthropic مباشرة. اضبط code>ANTHROPIC_BASE_URL/code> على code>https://api.deepseek.com/anthropic/code>، واضبط code>ANTHROPIC_AUTH_TOKEN/code> على مفتاح DeepSeek الخاص بك، ووجّه متغيرات النموذج إلى النموذج. تُعاد تسمية أسماء نماذج Claude أثناء الدخول: أي شيء يبدأ بـ code>claude-opus/code> يذهب إلى DeepSeek V4 Pro ويُحتسب بسعر V4 Pro، بينما الأسماء code>claude-sonnet/code> و code>claude-haiku/code> تذهب إلى نموذج Flash. لاحقة code>[1m]/code> على سلسلة النموذج تطلب نسخة السياق ذات المليون رمز. كما يضبط دليل DeepSeek الخاص بهذا الإعداد code>CLAUDE_CODE_EFFORT_LEVEL=max/code> ويثبّت نافذة الضغط التلقائي عند 786432 رمزًا.

هذا المتغير الأخير هو المكان الذي يكمن فيه إصلاح مجتمعي. يوجد وكيل بديل كحل التفافي لأن إصدارات Claude Code الحديثة ترسل code>thinking: {"type": "disabled"}/code> في طلبات الوكلاء الفرعيين بينما code>CLAUDE_CODE_EFFORT_LEVEL=max/code> يضيف معامل جهد الاستدلال، وترفض نقطة نهاية DeepSeek بتنسيق Anthropic ذلك الاقتران برسالة مفادها أن خيارات التفكير لا يمكن تعطيلها عند ضبط جهد الاستدلال. الحل البديل المذكور ضيق — إزالة معامل الجهد من طلبات الوكلاء الفرعيين فقط، مع ترك الوكيل الرئيسي دون مساس. تعامل معه كاكتشاف مجتمعي حول عدم تطابق العقد بين العميل والخادم، وتوقّع أن حد الإصدار الدقيق سيتغير.

مقياس الجهد: 1–100، ولماذا تعني "منخفض" 50

كل شيء في هذا القسم هو اكتشاف من المجتمع لا إرشاد من المورّد. لا تنشر DeepSeek مخططًا لربط الإعداد المسبق بالأرقام يمكننا التحقق منه، والأرقام الواردة أدناه مستمدة من كتابات الممارسين وتوثيق أدوات الاختبار الخارجية. وهي متسقة بما يكفي عبر المصادر لتكون مفيدة، وغير مؤكدة بما يكفي بحيث ينبغي أن تختبرها في عملك الخاص.

تم تدريب DeepSeek V4.1 Flash باستخدام مقياس متصل لجهد الاستدلال من 1 إلى 100. وهو ليس حدًا أقصى للرموز — بل يحدد الموضع الذي يستقر عليه النموذج على منحنى تعلّمته عملية التدريب، حيث يفرض الجهد الأقل ضغطًا أكبر ليكون موجزًا، ويجعل الجهد الأعلى الاستدلال الإضافي أرخص. وتتطابق ثلاثة إعدادات مسبقة عامة مع هذا المقياس:

• منخفض — 50، المسار الأقصر، والإعداد المسبق الذي يمنح أداة التحكم سمعتها بالرخص.

• عالٍ — 75، والمستوى الذي تصفه معظم مصادر المجتمع بأنه السقف المعقول لعمل الوكيل.

• Max — 100، حيث تُلغى عقوبة طول الاستدلال بالكامل.

ما يشتريه هذا المقبض حقيقي لكنه يتضاءل بحدّة. أفاد مسح مجتمعي للمعايير أن رفع الجهد من 25 إلى 100 نقل Terminal-Bench 2.1 من 82.4 إلى 90.6 مع مضاعفة إجمالي رموز الإخراج بنحو 2.5×. وتتّفق التقارير على أن جهدًا يقع بين 60 و80 يلتقط معظم الدقة المتاحة بأقل من نصف ميزانية الرموز، بينما يضيف الحد الأقصى زيادة أخرى بمقدار 1.6–1.8× إلى مسارات الوكيل مقابل مكسب هامشي.

الافتراضي هو الجزء الذي لا يتفق عليه أحد. تقول بعض وثائق منظومة التشغيل وتقارير الممارسين إن إعداد الجهد غير المحدد يُحسم إلى high؛ بينما تصف أخرى الافتراضي على الخادم بأنه مجهول ببساطة. ما هو موثّق لا محل للنقاش فيه هو أن تكاملين مع منظومة التشغيل وُجدا يفشلان في إرسال المعامل إطلاقًا — ملف تعريف مزوّد OpenCode Go وملف تعريف DeepSeek الأصلي لم يُصدرا code>reasoning_effort/code> لـ code>deepseek-flash/code> الـ slug، لأن حارس المطابقة لديهما كان يتوقع code>deepseek-v…/code> بادئة لا يملكها المعرّف القياسي. في كلتا الحالتين، استُبدل الإعداد الذي اختاره المستخدم بصمت بالإعداد الافتراضي للمزوّد. إذا كان عميلك يعرض عنصر تحكم في الجهد، فهذا ليس دليلًا على أنه يُرسَل على الشبكة. سجّل جسم طلب واحد وانظر.

من التقارير نفسها، هناك غرابة أخرى: نقطة نهاية OpenCode Go تقبل code>low/code>، code>medium/code>، code>high/code> وcode>max/code>، لكنها ترفض تمرير effort كعدد صحيح — فقد أُبلغ أن القيمة 80 تُرجع HTTP 400. يوجد في النموذج مقياس من 1 إلى 100، لكنه لا يُعرض كرقم خام في كل مكان، لذا قد لا يكون من الممكن التعبير عن "set effort to 65" في العميل الخاص بك.

نمط الفشل الناتج عن الإفراط في التفكير، وما الذي يصلحه فعلاً

هذا هو نمط الفشل الذي يحدد ما إذا كنت تُبقي النموذج داخل حلقتك. تصف تقارير المجتمع أن DeepSeek V4.1 Flash يستمر في الاستدلال بعد انتهاء العمل: يعيد الجدال حول نقطة أجاب عنها إجابة صحيحة بالفعل، ويسرد تصحيح افتراضاته الخاطئة، وينتج سلاسل استدلال طويلة ذات كثافة معلوماتية منخفضة. أبلغ أحد الممارسين عن استمرار مخرجات الاستدلال لأكثر من ساعة داخل جلسة CLI برمجية. وأبلغ آخر عن عدم قدرته على جعله يُكمل تشغيل اختبار قياسي طويل على الإطلاق.

ملاحظة حول مصدر ذلك التقرير الثاني، لأنه من نوع الادعاءات التي تُغسَل. وهو يأتي من نقاش مجتمعي حول تشغيل النموذج بشكل موثوق، وReddit يحجب أداة الجلب لدينا، لذلك لم نتمكن من قراءة النقاش مباشرة — نحن ننقل التقرير بدلًا من أن نقتبس من صفحة فتحناها. ما استطعنا التحقق منه بشكل مستقل هو شكل المشكلة، وهناك يكون الدليل الخارجي نظيفًا على نحو غير معتاد: Artificial Analysis، على صفحتها الخاصة، تشير إلى أن النموذج مفرط في الإسهاب، إذ يستهلك 250 مليون توكن إخراج لإكمال تشغيل ينهيه نموذج المقارنة الوسيط الخاص بها في 140 مليون. وهذا نحو 1.8×، مقيسًا من طرف ثالث، على مجموعة مهام ثابتة. تقارير المنتدى والمقياس المستقل يصفان السلوك نفسه.

التدابير التخفيفية التي تخرج من تلك التقارير، وجميعها مستمدة من مصادر مجتمعية:

• ثبّت مستوى الجهد عند high أو أقل، وارفض السماح له بالتصاعد الأحادي. إن أكثر إصلاح صريح شوهد في الميدان هو إضافة توجيه كُتبت خصيصاً لوقف تصعيد الجهد: لا يُسهم عمق الدور في درجة التصعيد، ولا يُحتسب إلا نتيجة أداة فاشلة أو إعادة محاولة مطابقة، والتصعيد محدود بسقف، وmax يتطلب التفعيل ويُخفَّض افتراضياً. إذا كان إطار التشغيل لديك يسمح للوكيل برفع جهده الخاص مع ازدياد طول التشغيل، فتلك هي الآلية التي يجب تعطيلها.

• لا تُشغِّل max كوضع افتراضي. يُفيد العديد من الممارسين بأن max يدور على نفسه بدل أن يتقارب في المهام الروتينية، وأن العودة إلى high تحل المشكلة.

• ضع حدًا أعلى لـ code>max_tokens/code> في المسارات التفاعلية. سقف الإخراج البالغ 384,000 رمزًا هو حدّ، وليس هدفًا، والحلقة التي لا تنتهي مكلفة عند هذا السقف.

• تحقَّق من أن المعامل يُرسَل فعلاً. فبالنظر إلى أنه وُجدت أداتا اختبار تُسقطانه بصمت، فإن «ضبطتُه على high» و«وصل high إلى الـ API» ليسا الادّعاء نفسه.

• إنّ أداة التشغيل تهمّ أكثر مما قد تتوقع. يبلّغ ممارسون يشغّلون الأوزان نفسها عن سلوك مختلف بحدّة بين الأصداف — النموذج نفسه الذي يجادل ذاته ويدفن الإشارة في أداة تشغيل ما لا يجلب أيًّا من تلك الشكاوى في أداة أخرى. هذه ملاحظة مجتمعية حول سلوك أداة التشغيل، وليست ادّعاءً من مورّد حول النموذج، لكنها أكثر نصيحة تتكرّر في التقارير.

ما الذي تكلفه حلقة برمجة فعليًا بهذه المعدلات

يبلغ سعر القائمة لدى DeepSeek 0.15 دولار لكل مليون رمز إدخال و0.60 دولار لكل مليون رمز إخراج خارج أوقات الذروة — الإخراج أربعة أضعاف الإدخال، وهو أول ما ينبغي استيعابه عن وكيل يولّد الاستدلال إلى جانب الكود.

خُذ دورة وكيل واقعية: 60,000 توكن من السياق (موجّه النظام، مخططات الأدوات، شريحة من المستودع، سجل المحادثة) كمدخل، و3,000 توكن من الاستدلال بالإضافة إلى رقعة كمخرج. أي 60,000 × $0.15/1M = $0.009 كمدخل، زائد 3,000 × $0.60/1M = $0.0018 كمخرج، ما يعادل نحو 1.1 سنت للدورة. مئتا دورة كهذه في يوم عمل تكلّف نحو $2.16، أو حوالي $47 على مدى شهر من أيام الأسبوع بالسعر خارج الذروة. هذه هي الحسابات التي تجعل بدلاً شهرياً قدره $15 مع عرض ترويجي 4× فوقه يبدو سخياً — وهي الحسابات التي تجعل الإسهاب هو الأمر الذي ينبغي مراقبته.

لأن هنا تكمن الرافعة الخفية في رقم Artificial Analysis ذلك. فاستهلاك النموذج لـ1.8× من وسيط رموز المخرجات على مجموعة مهام ثابتة يعني أن أي حلقة محدودة بالمخرجات تكلّف 1.8× مما يوحي به سعر الرموز وحده. وقرص الجهد هو أداة التحكم في هذا بالضبط. تشير تقارير المجتمع إلى أن الانتقال من الحد الأقصى نزولًا إلى المستوى المرتفع يقلّص رموز المخرجات إلى النصف تقريبًا — وهو فارق أكبر بكثير مما قد يفعله بك جدول الذروة/خارج الذروة. إعداد الجهد هو الرافعة الكبرى؛ أما الجدول فهو المجاني.

ما يستحق معرفته قبل أن تجدول أي شيء: ساعات الذروة هي 01:00–04:00 و06:00–10:00 بالتوقيت العالمي المنسق (UTC)، من الاثنين إلى الجمعة، وكل ما عدا ذلك بما في ذلك عطلات نهاية الأسبوع خارج الذروة. فريق أوروبي يعمل من 09:00 إلى 18:00 بتوقيت وسط أوروبا (CET) لا يلامس الذروة أبدًا. فريق في بكين يعمل بالساعات المحلية نفسها يصطدم بالذروة من 09:00 إلى 12:00 ومن 14:00 إلى 18:00 — سبع ساعات عمل من أصل تسع بسعر مضاعف. النموذج نفسه، والشيفرة نفسها، وفاتورة مضاعفة، يتحدد ذلك بالكامل حسب المنطقة الزمنية.

الوفير المجاني الآخر هو سعر القراءة من الذاكرة المؤقتة، $0.003 لكل مليون مقابل $0.15 للإدخال الجديد — واحد من خمسين. تكون مُطالبة وكيل البرمجة في معظمها بادئة مستقرة: تعليمات النظام، وتعريفات الأدوات، والأجزاء غير المتغيرة من المستودع. أبقِ المواد المستقرة في المقدمة ودع المحتوى المتغير يتبعها، وتتولى الذاكرة المؤقتة من جانب المزوّد الباقي. إن كان الإدخال المخزّن مؤقتًا المخفَّض ينطبق، وتحت أي شروط، يحدده DeepSeek وليس العميل، لذا تأكد منه في الوثائق الحالية قبل أن تبني ميزانية عليه — صفحة النموذج الخاصة بنا لـ code>deepseek/deepseek-v4.1-flash/code> تقول الشيء نفسه، إن سعر الإدخال المخزّن مؤقتًا يتبع شروط المزوّد.

إذا كنت تفضّل ألّا تضيف اشتراكًا ثانيًا لتقييم النموذج، فإن المعرّف نفسه متاح عبر نقطة نهاية واحدة متوافقة مع OpenAI أمام كتالوجنا بالكامل، بسعر المزوّد مع هامش ربح 0% — لذا فإن أي تغيير في السعر من جانب DeepSeek يصبح ساريًا هنا في اليوم نفسه بدلًا من إعادة التسعير التالية. وهذا يهم أكثر في الحالة تحديدًا التي تصفها هذه المقالة: نموذج لديه ميل موثّق للاستمرار، على مسار لم تكمل تقييمه بعد. تعني سلسلة احتياطية أن دورًا يسير على نحو خاطئ ينتقل إلى نموذج آخر قبل بدء الاستجابة، بدلًا من فشل الطلب.

552B، أو 748B، أو 763B — مسألة الحجم مفتوحة حقًا

لا تكرر ذكر عدد المعلمات لهذا النموذج باعتباره أمرًا محسومًا، لأن ثلاثة أرقام مختلفة متداولة، ولا أحدها خاطئ ببساطة.

تصف بطاقة الطراز الخاصة بـ DeepSeek نفسها طرازًا يمتلك "552B من المعاملات الأساسية"، وهذا هو الرقم المعلَن من الجهة المطوّرة — وهو أيضًا الرقم المدرَج في لوحة المواصفات على صفحة الطراز لدينا. وتُدرِج البطاقة نفسها على نحو منفصل وحدة "ذاكرة Engram الشرطية" بـ 196B من المعاملات، "يُوصَل إليها بشكل مت sparse عبر البحث المعتمد على الرموز". اجمع الرقمين فتحصل على 748B، وهو الحساب الذي خلص إليه تحليل المجتمع خلال ساعات من الإصدار. كما تُدرِج بيانات الملف الوصفية على مستودع الطراز نفسه حجمًا للطراز يبلغ 763B من المعاملات، وهو رقم ثالث مختلف.

الخلاف الظاهر خلاف تعريفي/اصطلاحي لا تناقض. فمعاملات Engram المسترجَعة بالبحث تكلّف ذاكرةً لكنها لا تكلّف تقريبًا أي عمليات حسابية لكل رمز، في حين أن معاملات العمود الفقري المحسوبة تكلّف وقتًا مع كل رمز — وهذا بالتحديد سبب إيراد المورّد لها منفصلة، وسبب أن مقارنة الأرقام الرئيسية لنموذجين بمعمارين مختلفين لا تخبرك إلا بالقليل.

ما لا يُجادَل فيه بجدية هو عدد المعاملات النشطة: نحو 8B لكل رمز أثناء التعبئة المسبقة و16B أثناء فك التشفير، وهو الرقم الذي يحكم فعليًا تكلفة الاستدلال. الأوزان مفتوحة بموجب رخصة MIT إذا أردت التحقق من أي من هذا بنفسك. اعتبر 552B رقمًا مُبلَّغًا عنه من المورّد، و748B إجماليًا مجتمعيًا موثوقًا، واعتبر أي ادعاء بأن مسألة الحجم قد أُغلقت سابقًا لأوانه.

Screenshot of DeepSeek's own API documentation release page for DeepSeek-V4.1-Flash, dated 2026-09-10, showing the headline claim of a 552B-parameter MoE on a new Causal Encoder-Decoder architecture with 8B active parameters for input and 16B for output, a bar chart comparing DeepSeek V4.1 Flash against Kimi K3, GLM-5.3, Opus 5 and GPT-5.6 Sol on Terminal-Bench 3.0, DeepSWE v1.1, CyberGym and Automation-Bench, and the start of a vendor benchmark table with GPQA Diamond at 90.9 and HLE at 36.8.

ما الذي يجب فعله قبل العشرين

إذا كنت ستجرّب DeepSeek V4.1 Flash في وكيل برمجي، فإن الترتيب الذي يهدر أقل وقت هو: اختر إطار التشغيل أولاً، ثم ثبّت مستوى الجهد، ثم قِس.

على منصة الاختبار، الخلاصة الصادقة لتحقق اليوم هي أن المسارات الثلاثة كلها تعمل وهي تختلف في ما تطلبه منك. OpenCode Go هو اشتراك بقيمة 10 دولارات شهريًا مع مضاعف ترويجي ينتهي في 20 سبتمبر، والإعداد هو code>/connect/code> بالإضافة إلى code>/models/code> بدون أي ملف لتحريره. يسرد Command Code النموذج مباشرةً في كتالوجه الخاص، ويبدّل باستخدام code>/model <id>/code>، ويعرض الجهد كأمر من الدرجة الأولى. يصل إليه Claude Code إما عبر مسار العملاء المتحقق منهم في OpenCode Go — حيث لا يحتاج إلى غلاف ترويسة مخصص — أو مباشرةً مقابل نقطة نهاية DeepSeek بتنسيق Anthropic، حيث يكون تعارض جهد الوكيل الفرعي هو الحافة الخشنة المعروفة.

بخصوص effort، اضبطه صراحةً واضبطه عند مستوى منخفض نسبيًا: high، أو الافتراضي للنموذج إذا تبيّن أن high هو ذلك، وليس max. ثم تأكّد من أنه غادر جهازك، لأنه وُجد أن أداتَي اختبار تُسقطانه.

عند القياس، راقب توكنات الإخراج بدلًا من الزمن الفعلي. الإسهاب هو التكلفة، ومقبض الجهد هو أداة التحكم، وجدول الذروة هو مصادفة منطقة زمنية يمكنك تجنّبها مجانًا.

وبخصوص ادعاءات الحجم التي ستُقتبَس أمامك هذا الأسبوع — 552B، و748B، و763B — فالردّ المفيد هو أن المورّد يعلن عن عموده الفقري، والمجتمع يضيف وحدة الذاكرة، بينما تقول البيانات الوصفية للمستودع شيئًا آخر مجددًا. وأي شخص يقدّم أحد هذه الأرقام كإجابة نهائية يكون قد اختار رقمًا بدلًا من أن يتحقق منه.