DeepSeek V4 Flash 0731 هو الإصدار الرسمي المعاد تدريبه بعد التدريب لنموذج DeepSeek الفعّال V4 Flash من نوع خليط الخبراء — 284 مليار معامل إجمالاً / 13 مليار معامل نشط، مطابق في البنية والحجم لإصدار أبريل من V4 Flash، مع إعادة التدريب اللاحق من الصفر. يخدم نافذة سياق تبلغ مليون توكن مع إخراج يصل إلى 384 ألف توكن، ويدعم وضعي التفكير وعدم التفكير (التفكير مفعّل افتراضياً) بالإضافة إلى إخراج JSON واستدعاءات الأدوات، ويدعم أصلياً واجهة Responses API مع تكييف مستهدف لوكلاء الترميز بنمط Codex. مراجعة 0731 تمثل قفزة كبيرة في قدرات الوكلاء، حيث تتفوق حتى على DeepSeek V4 Pro Preview في معايير الوكلاء التي نشرتها DeepSeek — 82.7 على Terminal Bench 2.1، و76.7 على Cybergym، و70.3 على Toolathlon Verified، و54.4 على DeepSWE، و54.2 على NL2Repo. على API الطرف الأول من DeepSeek، هذه المراجعة هي ما يقدمه معرف النموذج deepseek-v4-flash حالياً؛ والمعرف المؤرخ يقدم نفس المراجعة للمتصلين الذين يشيرون إليه بالتاريخ. وهو اختيار قوي لوكلاء الترميز، وأحمال عمل الطرفية واستخدام الأدوات، وخطوط معالجة الوكلاء عالية الحجم بتكلفة فئة Flash.
DeepSeek V4 Flash 0731 هو نموذج لغوي نصي فقط من المزود deepseek، متاح عبر OrcaRouter بمعرف النموذج deepseek/deepseek-v4-flash-0731. مواصفاته الرئيسية هي نافذة سياق تبلغ 1,048,576 رمزًا، وحد أقصى…
الإدخال مقتصر على النصوص. حجم نافذة السياق هو 1,048,576 رمزًا، والحد الأقصى للإخراج هو 384,000 رمزًا لكل استجابة. هذه مساحة عمل كبيرة: يمكنك قراءة حوالي مليون رمز من المحتوى قبل التوليد، ويمكنك طلب ما يصل إلى 384,000 رمزًا من الإخراج في استدعاء واحد. تذكر بطاقة النموذج هذين الحدّين كحدّين منفصلين؛ ولا تذكر حدًا مشتركًا لطلب يستخدم كلا الحدّين شبه الأقصيين. عمليًا، للبقاء ضمن الحدود، احسب رموزك قبل الإرسال واضبط max_tokens ليكون أقل من سقف الإخراج. كما أن القيد النصي فقط يعني أنه يجب عليك تحويل ملفات PDF وجداول البيانات والمستندات الأخرى إلى نص عادي أولًا. لم يتم تحديد آلية الترميز (Tokenization) في الحقائق المتاحة، لذا اختبر محتوى تمثيليًا لمعرفة حجم مطالباتك. إذا تجاوز طلبك 1,048,576 رمزًا للإدخال، سيفشل استدعاء الواجهة البرمجية (API)؛ وينطبق الأمر نفسه على المخرجات التي تتجاوز 384,000 رمزًا.
بالنظر إلى المواصفات المذكورة، فإن النموذج هو الأنسب للمهام التي تجمع بين مدخلات نصية طويلة، ومخرجات نصية طويلة، والاستدلال الوكيل الموجّه نحو الطرفية. تُعد نتيجة 82.7 في Terminal Bench 2.1 دليلاً على القوة في إنجاز المهام عبر سطر الأوامر، حيث يقرأ النموذج مخرجات الصدفة ويقرر الأمر التالي. يدعم سياق 1,048,576 رمزًا تحليل المستودع بالكامل، ومراجعة الكود متعدد الملفات، والمستندات القانونية أو التقنية الطويلة، وسجلات المحادثات الواسعة. يدعم إخراج 384,000 رمزًا توليد مستندات منظمة طويلة، أو مجموعات بيانات تركيبية، أو تحليلات خطوة بخطوة في تمريرة واحدة. يجعل التسعير لكل رمز بقيمة 0.15$ للإدخال و0.29$ للإخراج لكل مليون رمز معالجة النصوص عالية الحجم قابلة للتنبؤ ماليًا. النموذج أقل ملاءمة عندما تحتاج إلى فهم الصور، أو نسخ الصوت، أو زمن استجابة منخفض جدًا، ولا يغطي أيٌّ من ذلك الحقائق المقدمة. إذا كانت مهمتك تناسب ملف تعريف النص فقط، والسياق الكبير، والإخراج الكبير، فهذا مرشح معقول للتقييم عبر OrcaRouter.
لا يمكن للنموذج قبول مدخلات غير نصية؛ لا توجد وسيلة رؤية أو صوت أو فيديو في سجله. كما لا توجد أي ضمانات منشورة بشأن زمن الاستجابة أو البث في الحقائق المتاحة. يجب عليك اختيار نموذج أرخص عندما لا يحتاج عبء عملك إلى حدود السياق أو الإخراج الكبيرة. على سبيل المثال، تبادل دردشة قصير يستخدم بضعة آلاف من الرموز سيظل محاسبًا بنفس معدل السعر لكل رمز، لكن قد يكون من الأفضل خدمته بنموذج بسياق أصغر وسعر أقل لكل مليون رمز. لا تدرج الحقائق المتاحة أسعارًا للبدائل، لذا قارن معدلات كل مليون رمز في كتالوج OrcaRouter. إذا كانت مهمتك تصنيفًا بسيطًا أو تلخيصًا لمقاطع قصيرة، فقد يكون نموذج أرخص كافيًا. إذا كانت مهمتك تحتاج إلى سياق كامل يبلغ 1M أو إخراج 384K، أو تستفيد من قوة Terminal Bench 2.1 في العمل على سطر الأوامر، فإن سعر هذا النموذج هو الأساس المناسب للتقييم.
يجب أن يكون كل إدخال نصًا. يجب تحويل ملفات PDF والصور وجداول البيانات والملفات الصوتية إلى نص عادي أو تفريغها نصيًا قبل إرسالها. هذه خطوة معالجة مسبقة ضرورية، لكنها أيضًا تبسّط تنسيق الطلب: كل ما تحتاجه هو حقول محتوى قياسية بأسلوب OpenAI تحتوي على سلاسل نصية. سياق 1,048,576 توكنًا يعني أنه يمكنك تمرير نصوص طويلة من المحتوى المحوّل في طلب واحد؛ ومخرج 384,000 توكن يعني أنه يمكنك استقبال نص طويل جدًا في المقابل. يُعد عدد التوكنات هو الشاغل التشغيلي الرئيسي، إذ تعتمد الفاتورة الإجمالية على توكنات الإدخال والإخراج. يُبلغ OrcaRouter عن الاستخدام في الاستجابة المتوافقة مع OpenAI، مما يتيح لك مراقبة الرقمين معًا. إذا كنت تعمل مع لغات أو أكواد برمجية تتميز بتقطيع غير فعّال إلى توكنات، فسوف يتقلص سياقك الفعلي لأن الحدود مفروضة بعدد التوكنات وليس بعدد الأحرف. لا يتم توفير تفاصيل حول أداة التقطيع إلى توكنات، لذا قم بإجراء اختبار سريع على المحتوى الخاص بك لمعرفة أطوال التوكنات النموذجية.
تقييم Terminal Bench 2.1 قدرة النموذج على العمل في بيئة طرفية (terminal): فهم مخرجات الأوامر، والتنقل بين الدلائل، وتنفيذ الأوامر، وإكمال مهام واقعية لإدارة الأنظمة أو هندسة البرمجيات عبر الصدفة (shell). النتيجة الرئيسية لنموذج DeepSeek V4 Flash 0731 هي 82.7، على مقياس تكون فيه القيم الأعلى أفضل. هذه هي نتيجة المعيار الوحيدة المقدمة في الحقائق المتاحة. تُعدّ النتيجة إشارة مفيدة إذا كنت تخطط لبناء حلقات وكيل (agent loops) تصدر أوامر صدفة، لأن المعيار مصمم لاختبار هذا النوع من القدرات تحديدًا. وهي ليست مقياسًا للمعرفة العامة، أو الكتابة الإبداعية، أو الرياضيات، أو الكفاءة متعددة اللغات. لا توجد خطوط أساسية للمقارنة أو أرقام معايير أخرى مقدمة، لذا ينبغي تفسير 82.7 في سياقها: دليل قوي على المهام المتعلقة بالطرفية، ولا دليل في أي اتجاه للمجالات الأخرى. تعتمد نتائج المعايير على التوزيع الدقيق للمهام، لذلك قد تختلف نتائج مهامك الطرفية؛ تحقق من خلال تقييمك الخاص قبل الاستخدام في الإنتاج.
الحقائق المتاحة حول DeepSeek V4 Flash 0731 لا تتضمن الرموز في الثانية، أو الوقت حتى أول رمز، أو زمن الاستجابة p95، أو الإنتاجية. يشير الاسم Flash إلى نسخة أخف، لكن الحقائق المقدمة لا تحدد السرعة كميًا. ما تتضمنه الحقائق هو نافذة سياق كبيرة تبلغ 1,048,576 رمزًا وحدًا أقصى كبيرًا للإخراج يبلغ 384,000 رمز. المدخلات والمخرجات الأطول تستهلك بطبيعتها قدرة حاسوبية أكبر، لذا فمن المرجح أن يكون زمن الاستجابة للطلبات ذات السياق الكامل أعلى منه للطلبات القصيرة، حتى بالنسبة لنموذج سريع. التسعير البالغ 0.15$ / 0.29$ لكل مليون رمز يصف التكلفة، وليس السرعة. لاتخاذ قرار مستنير، قم بإجراء اختبار تحميل خاص بك على واجهة برمجة التطبيقات الخاصة بـ OrcaRouter باستخدام مطالبات تمثيلية بالحجم الذي تنوي استخدامه، وقارن الوقت حتى أول رمز والمدة الإجمالية مع النماذج الأخرى في الكتالوج. لا تستنبط زمن الاستجابة من نتيجة المعيار، فهي لا تقيس وقت الاستجابة.
القيود الرئيسية واضحة من الحقائق المذكورة. إنه نصي فقط، لذا أي إدخال متعدد الوسائط خارج النطاق. الدليل المعياري يقتصر على درجة واحدة، 82.7 على Terminal Bench 2.1، والتي تغطي إنجاز المهام القائمة على الطرفية، وليس التفكير العام أو المعرفة. لا توجد مقاييس منشورة لزمن الاستجابة أو التوفر أو معدل الخطأ، لذا فإن الأداء تحت الحمل غير معروف. حدود السياق والإخراج كبيرة لكنها محدودة: 1,048,576 توكنًا للإدخال و384,000 توكنًا للإخراج لكل طلب. الطلبات التي تتجاوزها لن تنجح. لا يوجد خصم موثق للتخزين المؤقت للطلبات في الحقائق المقدمة، لذا تُحتسب البادئات المتكررة كرموز إدخال عادية. السعر منخفض على أساس كل توكن، لكن التكاليف المطلقة تنمو خطيًا مع حجم السياق. إذا كان تطبيقك يحتاج إلى رؤية أو زمن استجابة منخفض أو إنتاجية عالية جدًا، فقد لا يكون هذا النموذج مناسبًا؛ تحقق من تلك المتطلبات بشكل منفصل قبل الالتزام.
تُحسب التكاليف لكل توكن، بمعدل واحد للإدخال وواحد للإخراج. تبلغ تكلفة رموز الإدخال 0.15 دولارًا لكل 1,000,000 رمز؛ وتبلغ تكلفة رموز الإخراج 0.29 دولارًا لكل 1,000,000 رمز. تقوم OrcaRouter بفوترة هذه الأسعار بسعر المزوّد دون أي هامش ربح، أي لا تُضاف أي نسبة مئوية إضافية للمنصة فوق سعر deepseek. تبلغ تكلفة الطلب الواحد تقريبًا (رموز الإدخال مضروبة في 0.15 دولار مقسومة على 1,000,000) بالإضافة إلى (رموز الإخراج مضروبة في 0.29 دولار مقسومة على 1,000,000). على سبيل المثال، إذا تم استخدام الحدين كاملين في معاملات منفصلة، فإن إدخالًا كاملًا مكونًا من 1,048,576 رمزًا تبلغ تكلفته حوالي 0.1573 دولارًا، وإخراجًا بأقصى طول مكونًا من 384,000 رمز تبلغ تكلفته حوالي 0.1114 دولارًا. لا تذكر الحقائق المتاحة أي تسعير مخفّض للإدخال المخزّن مؤقتًا، لذا افترض أن كل رمز إدخال يُفوتر بالسعر القياسي. وبما أن التسعير خطي، فإن تقدير التكلفة للدفعات يكون مباشرًا بمجرد معرفة متوسط حجم المطالبة وطول الإخراج.
المفاضلة الرئيسية هي بين حجم السياق والسعر. بسعر 0.15 دولار لكل 1M رمز إدخال، فإن موجهًا يستخدم كامل سياق 1,048,576 رمزًا يكلف حوالي 0.157 دولارًا في رسوم الإدخال وحدها. إذا كانت مهمتك تحتاج فقط إلى بضعة آلاف من رموز السياق، فأنت تدفع مقابل سعة غير مستخدمة، بمعنى أن نموذجًا بحجم سياق أصغر وبتسعير أقل لكل رمز قد يكون أرخص، اعتمادًا على أسعاره. معدل الإخراج البالغ 0.29 دولار لكل 1M يعني أن المخرجات الطويلة ليست باهظة الثمن بشكل فردي، لكن عبء العمل الذي يولّد غيغابايت من النص سيتراكم عليه التكلفة. لا يوجد خصم للدفعات المجمعة، أو حجز، أو خصم تخزين مؤقت مذكور في المعلومات المقدمة. الفوترة بدون هامش ربح من OrcaRouter تعني أن السعر الذي تراه هو سعر المزوّد؛ فاتورتك النهائية هي ببساطة دالة على عدد الرموز المرسلة والمستلمة. بالنسبة للمهام المجمعة واسعة النطاق، قدّر إجمالي رموز الإدخال والإخراج، واضربه في المعدلين، وقارن بالبدائل في الكتالوج.
تقوم OrcaRouter بفوترة DeepSeek V4 Flash 0731 صراحةً بسعر المزوّد دون أي زيادة. إن سعر 0.15$ لكل 1M رمز إدخال و0.29$ لكل 1M رمز إخراج هما أسعار المزوّد، وليسا نسخةً بربح مضاف. المعلومات المقدمة لا تصف التخزين المؤقت للاستعلامات (prompt caching) لهذا النموذج. لا توجد فئة تسعير للمدخلات المخزّنة مؤقتًا، ولا يوجد بيان يفيد بأن OrcaRouter تخزّن الاستعلامات تلقائيًا نيابةً عنك. إذا كان المزوّد الأساسي يوفر التخزين المؤقت، فإن الشروط ليست جزءًا مما تم توفيره لبيان الكتالوج هذا، لذا يجب عليك مراجعة وثائق OrcaRouter الحالية قبل افتراض وجود خصم. استجابة API، لأنها تتبع تنسيق إكمال المحادثات من OpenAI، تتضمن معلومات استخدام تتيح لك التحقق من رموز الإدخال والإخراج المُفوترة. لأغراض التدقيق، سجّل كائن الاستخدام من كل استجابة وقارنه بأعداد الرموز المتوقعة لديك. يجب أن يأتي أي تحكم في التكلفة من اختياراتك الخاصة للاستعلامات والمعاملات.
أرسل طلبات إكمال المحادثة القياسية إلى واجهة برمجة التطبيقات المتوافقة مع OpenAI الخاصة بـ OrcaRouter. عنوان URL الأساسي هو https://api.orcarouter.ai/v1، ومعرف النموذج هو deepseek/deepseek-v4-flash-0731. اضبط حقل النموذج على تلك السلسلة بالضبط، وضع مفتاح API الخاص بـ OrcaRouter في ترويسة Authorization كرمز bearer. أنشئ مصفوفة messages بمحتوى نصي؛ لن يقبل النموذج محتوى الصور أو الصوت. يكون الرد منسقًا كإكمال محادثة OpenAI ويتضمن الرسالة المُولَّدة وكائن usage. نظرًا لأن معرف النموذج يتضمن بادئة مزود الخدمة، احتفظ به تمامًا كما هو معروض. لا تتطلب الحقائق المتاحة أي ترويسات غير قياسية أو إعدادات نقل خاصة. يمكنك استخدام حزم SDK الخاصة بـ OpenAI أو curl أو أي عميل HTTP يتعامل مع JSON. ابدأ بطلب صغير، وتحقق من أن usage المُعاد يطابق أعداد الرموز المتوقعة للمدخلات والمخرجات، ثم قم بالتوسع.
نظرًا لأن نقطة النهاية متوافقة مع OpenAI، فإن معاملات إكمال المحادثة النموذجية متاحة: model، messages، temperature، top_p، max_tokens أو max_completion_tokens، stop، stream، وخيارات مشابهة مدعومة من SDK الذي تستخدمه. لا تُعد الحقائق المتاحة قائمة بالمعاملات التي يكرمها OrcaRouter لهذا النموذج المحدد، لذا يجب اختبار أي شيء يتجاوز model و messages. الحدود الحاسمة هي حدود النموذج نفسه: 1,048,576 رمزًا للإدخال و384,000 رمزًا للإخراج. أبقِ max_tokens أقل من حد الإخراج لتجنب طلبات فاشلة. بالنسبة لاستدعاء الأدوات أو الدوال، لا تنص الحقائق على الدعم؛ اختبر تعريف أداة بسيط قبل إنشاء وكيل. بالنسبة للتحكم في تنسيق الإخراج، لا يوجد ذكر لوضع JSON أو ضمانات إخراج منظمة؛ تحقق من النص المُولّد بنفسك إذا كنت بحاجة إلى بنية موثوقة. غالبًا ما يكون البث مدعومًا على نقاط النهاية المتوافقة مع OpenAI، لكن الحقائق لا تؤكد ذلك لهذا النموذج، لذا راجع مرجع API الخاص بـ OrcaRouter.
الترحيل في الغالب مسألة إعدادات: غيّر عنوان URL الأساسي إلى https://api.orcarouter.ai/v1، وبدّل مفتاح API إلى مفتاح OrcaRouter الخاص بك، واستبدل اسم النموذج بـ deepseek/deepseek-v4-flash-0731. الكود الذي يبني الرسائل بالفعل، ويعالج استجابات الدردشة، ويقرأ بيانات الاستخدام سيستمر في العمل طالما يتبع اصطلاح OpenAI. هناك اختلافان يتطلبان الانتباه. أولاً، هذا النموذج نصي فقط، لذا أزل أي حقول image_url أو audio من طلباتك. ثانيًا، حدود السياق والإخراج كبيرة جدًا؛ اضبط إعداد max_tokens لديك لاحترام سقف الإخراج البالغ 384,000 رمزًا وكن مستعدًا لاستجابات طويلة أحيانًا. إذا كان كودك يتضمن إعادة محاولة عند أخطاء 429 أو 5xx، فاحتفظ بها؛ الحقائق لا تغيّر توقعات معالجة الأخطاء. نفّذ اختبارًا سريعًا بنص صغير، وتأكد من ظهور الفوترة بمبلغ $0.15/$0.29 لكل مليون رمز، ثم حوّل حركة المرور تدريجيًا.
عنوان URL الأساسي لواجهة برمجة تطبيقات OrcaRouter هو https://api.orcarouter.ai/v1. يجب أن تستخدم جميع الطلبات الموجهة إلى هذا العنوان بروتوكول HTTPS. المصادقة تتم عبر مفتاح API، يُرسل كرمز حامل (bearer token) قياسي في ترويسة Authorization. الحقائق المتاحة لا تذكر طرق مصادقة بديلة. معرّف النموذج هو deepseek/deepseek-v4-flash-0731، والذي يتضمن اسم المزوّد ولاحقة لقطة 0731؛ مرّره تمامًا كما هو مكتوب. في معظم حزم SDK المتوافقة مع OpenAI، يمكنك إعداد عميل باستخدام base_url وapi_key، ثم تعيين اسم النموذج في كل استدعاء. سيتضمن الرد أعداد الرموز ذات الصلة بالفوترة داخل كائن usage. لا تذكر الحقائق حدود المعدل أو سلوك إعادة المحاولة أو إرشادات المهلة الزمنية، لذا راجع وثائق OrcaRouter للحصول على تلك التفاصيل التشغيلية. خزّن مفتاح API الخاص بك بشكل آمن؛ فالمفتاح يحدد الوصول إلى كل حسابات النماذج في مشروع OrcaRouter الخاص بك. إذا كنت تستخدم وكيلًا أو بوابة، وجّهها إلى عنوان URL الأساسي لـ OrcaRouter وحافظ على معرّف النموذج الكامل.
المعلومات المقدمة تغطي فقط هذه اللقطة الزمنية المحددة، لذا فإن المقارنة الرقمية سطرًا بسطر مع إدخالات DeepSeek الأخرى غير ممكنة بناءً على ما هو معطى. ما نعرفه عن DeepSeek V4 Flash 0731 هو سياقه البالغ 1,048,576 رمزًا، وسقف الإخراج البالغ 384,000 رمزًا، وإدخال نصي فقط، وتسعير $0.15/$0.29 لكل مليون رمز، ودرجة 82.7 في Terminal Bench 2.1. قد تختلف نماذج DeepSeek الأخرى في كتالوج OrcaRouter في أي من هذه المحاور. عند اتخاذ القرار، قارن المواصفات المهمة: عدد الرموز التي تستخدمها استفساراتك فعليًا، وعدد الرموز التي تتطلبها مخرجاتك، وما إذا كنت تحتاج إلى إدخال متعدد الوسائط، وسعر كل مليون رمز للنموذج المرشح. تُشير علامة Flash إلى نسخة أخف مقارنةً بإصدارات DeepSeek الأخرى، لكن المؤشر الوحيد الموضوعي للأداء في المعلومات هو درجة Terminal Bench. استخدم صفحات قائمة كتالوج OrcaRouter للمواصفات جنبًا إلى جنب والأسعار الحالية قبل الاختيار.
عند 1,048,576 رمزًا من السياق، يقع هذا النموذج في فئة السياق الطويل. قد يصل النموذج ذو السياق الأصغر إلى حد أقصى يبلغ بضع مئات الآلاف من الرموز أو أقل، مما يضطرك إلى تقسيم المستندات، أو تضمين الأجزاء، أو استخدام الاسترجاع. وتتمثل ميزة هذا النموذج في أنه يمكنك وضع مجموعة نصوص كبيرة جدًا في موجه واحد والسماح للنموذج بالتعامل معها جميعًا في تمريرة واحدة. والعيب هو التكلفة لكل طلب: يتم احتساب كل رمز إدخال، لذا فإن السياق الضخم يضاعف الإنفاق على الإدخال. لا تسرد الحقائق أي نموذج بنافذة سياق أكبر، لذا فإن العبارات الآمنة الوحيدة تتعلق بحدود هذا النموذج نفسه. عند الاختيار، قدّر أحجام موجهاتك الفعلية. إذا كانت مهامك تستخدم عادةً أقل من 100 ألف رمز، فقد يكون السياق الكامل غير ذي صلة، وقد يكون النموذج الأصغر والأرخص أفضل. أما إذا كنت تتجاوز بانتظام حدود السياق الشائعة، فإن نافذة هذا النموذج البالغة مليون رمز هي الميزة الحاسمة.
اختر DeepSeek V4 Flash 0731 عندما تكون المهمة نصية فقط ويمكنك استغلال مواصفاته. سياق الـ 1,048,576 رمزًا يبرر الاختيار عندما تحتاج إلى قراءة مستودع كامل أو مجموعة مستندات أو محضر طويل في تمريرة واحدة. حد الإخراج البالغ 384,000 رمزًا يبرر الاختيار عندما تحتاج إلى إجابات مولدة طويلة جدًا دون جولات متعددة. درجة 82.7 في Terminal Bench 2.1 تبرر الاختيار لأتمتة الطرفية وسير عمل CLI الوكيلية. سعر $0.15/$0.29 لكل مليون رمز يبرر الاختيار لمعالجة النصوص الدفعية عالية الحجم حيث تهيمن تكلفة الرمز الواحد. لا تختره عندما تحتاج صورًا أو صوتًا، أو عندما تكون احتياجاتك من السياق ضئيلة ويوجد نموذج أرخص، أو عندما لا يمكنك قبول خصائص زمن استجابة غير معروفة. الحقائق المتاحة لا تقدم أي ضمانات لزمن الاستجابة، لذا يجب على الفرق الحساسة للأداء إجراء معايير مرجعية باستخدام استفسارات حقيقية أولاً. في كل حالة، تأكد من معرف النموذج والفوترة على OrcaRouter قبل التوسع.
متوافق مع OpenAI — أبقِ على SDK الحالي
https://api.orcarouter.ai/v1https://api.orcarouter.aiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p| الإدخال / 1M توكن | $0.147 |
| الإخراج / 1M توكن | $0.295 |
| قراءة الذاكرة المؤقتة / 1M | $0.020 |
| العملة | USD |
تقدير بناءً على السعر المُعلن
تقدير فقط — يعتمد العدد الفعلي للرموز على مُجزّئ الرموز الخاص بالمزوّد.
ما يتحدث عنه المطورون هذا الأسبوع
GET /api/public/models/deepseek/deepseek-v4-flash-0731فتح @misc{orcarouter_deepseek_v4_flash_0731,
title = {DeepSeek V4 Flash 0731 API},
author = {DeepSeek},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731}
}DeepSeek. (2026). DeepSeek V4 Flash 0731 API. OrcaRouter. https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731