
FLUX 3 Image مقابل Bernini-Diffusers-v2: نقطة نهاية مدفوعة في مواجهة مستودع قابل للتنزيل
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 223 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
FLUX 3 Image وBernini-Diffusers-v2 هما نموذجان للصور يمكنك الحصول عليهما بالكامل اليوم، وليس أي منهما منتجًا يمكنك استئجاره. أُطلق FLUX 3 Image في 1 أكتوبر 2026 على api.bfl.ai/v1/flux-3-image مع قائمة أسعار منشورة ولا نتيجة منشورة. وظهر Bernini-Diffusers-v2 على Hugging Face في 13 أغسطس 2026 بموجب Apache-2.0 مع نتائج منشورة ولا سبيل لاستدعائه سوى وحدات معالجة الرسومات الخاصة بك. يأتي أحدهما مع فاتورة. ويأتي الآخر مع تثبيت إصدار Python.
هذا الانقسام هو المقارنة بأكملها، ويستحق أن نكون دقيقين بشأنه، لأن الإطار المعتاد "مستضاف مقابل أوزان مفتوحة" لا ينطبق هنا. Bernini ليس نموذجًا مفتوح الأوزان يمكنك إسقاطه في مكدس استدلال قائم. إنه نظام من مرحلتين — مخطط Qwen2.5-VL-7B أمام مفكك ترميز انتشار Wan2.2-T2V-A14B — وإصداره v2 عبارة عن إصلاح لجدول التدريب، وليس طبقة قدرات جديدة. FLUX 3 Image هو نقطة نهاية واحدة مربوطة بها كمية غير معتادة من سطح التحكم: إرساء مكاني، وشبكة إحداثيات من 0 إلى 1000، وتحرير محدد بالمربعات حيث تسمّي المناطق التي تبقى. شيئان مختلفا الشكل.
ما هو كل واحد منها في الحقيقة
• FLUX 3 Image — Black Forest Labs' image tier of its unified FLUX 3 family, released October 1, 2026. One HTTP POST to https://api.bfl.ai/v1/flux-3-image with an x-key header; only prompt is required. The call returns a polling URL, and a finished 4K render can take several minutes. Generated samples are downloadable for one hour.
• Bernini-Diffusers-v2 — حزمة ByteDance المكوّنة من مخطِّط ومُصيّر، رُفعت إلى Hugging Face في 13 أغسطس 2026 دون أي إعلان مصاحب. المستودع موسوم بوسم image-text-to-video ويعتمد على diffusers. المهام المدرجة: تحويل النص إلى صورة، وتحويل الصورة إلى صورة، وتحويل النص إلى فيديو، وتحويل الفيديو إلى فيديو، وتحويل المرجع إلى فيديو، وتحويل المرجع إلى صورة. لا يوجد استدلال مستضاف ولا قائمة أسعار — مسار البدء هو hf download وتطبيق Gradio.
• فجوة التوزيع — FLUX 3 Image خدمة تُحاسب حسب الاستخدام وتستدعيها. أما Bernini فهو مستودع تنشره. وقبل أن يستحق أي سؤال عن الجودة أن يُطرح، يتطلب أحدهما وحدة معالجة رسومات من فئة Hopper ويتطلب الآخر بطاقة ائتمان.
الترخيص هو المجال الذي يتباعد فيه هذان الاثنان إلى أقصى حد.
Bernini-Diffusers-v2 مرخّص بموجب Apache-2.0 على مستوى المستودع. وبالنسبة لخط أنابيب مستضاف ذاتيًا، فإن ذلك يهم كثيرًا: لا عدّاد لكل صورة، ولا اتفاق تفاوضي، ولا إبلاغ عن الاستخدام. أنت تدفع مقابل الكهرباء ووقت المُجدوِل، والتكلفة الحدية للصورة رقم عشرة آلاف هي نفسها تكلفة الصورة الأولى.
FLUX 3 Image ليس بأوزان مفتوحة، وشركة Black Forest Labs صريحة في أن هذا مؤقت. الأوزان التجارية متاحة اليوم بموجب ترخيص BFL تفاوضي، ويُوصف الإصدار العام المفتوح الأوزان بأنه سيأتي في الأسابيع التالية. هذا وعد له شكل لكن بلا تاريخ، وهو الشيء الوحيد الأهم في هذه الصفحة الذي ينبغي إعادة التحقق منه بدل افتراضه. إذا كنت تختار مجموعة تقنيات للصور للعامين المقبلين، فمن المرجح أن مسألة الترخيص تفوق مسألة Elo — لكن فقط إذا كنت مستعدًا لتشغيل مجموعة انتشار أصلية للفيديو من مرحلتين بنفسك.
سطح التحكم: المربعات المحيطة مقابل تحسين المطالبة
هذا هو الجزء المثير للاهتمام حقًا في هذه المواجهة، لأن النموذجين يحلان مسألة «اجعلها تذهب إلى هناك بالضبط» بطرق مختلفة تمامًا.
يأخذ FLUX 3 Image مصفوفة JSON ملحقة بالمطالبة. تعمل الإحداثيات على شبكة من 0 إلى 1000 على كلا المحورين، ويُكتب كل مربع على شكل [أعلى، يسار، أسفل، يمين]. أنت تقدم جدولاً من العناصر، كل منها يحتوي على معرف، ومربع إحاطة ووصف، بالإضافة إلى تعليق عام يذكر تلك المعرفات بالاسم. في مثال BFL الخاص، تبدو المعرفات مثل animal_1 وsilhouette_1؛ يشير التعليق إليها مباشرة. فوق استدعاء التوليد يوجد grounding، مفعّل افتراضيًا، والذي يقوم ببحث ويب وبحث صور قبل التوليد.
ثم يوسّع FLUX 3 Image نظام الإحداثيات نفسه ليشمل التحرير. فبدلًا من إرسال قناع، ترسل مجموعة من العمليات المحددة النطاق بالمربعات: إبقاء (المربع المصدر إلى المربع نفسه، مأخوذ من ref_image_0)، نقل (المربع المصدر إلى مربع هدف جديد)، جديد (لا يوجد مصدر، يُنشأ مربع الهدف من وصف — إضافة أو استبدال أو إعادة تلوين) وإزالة (المربع المصدر إلى هدف فارغ). توضع عمليات متعددة في طلب واحد.
التحفّظ مهم. تقول وثائق BFL إن البكسلات خارج المربعات المحرَّرة "تبقى عادةً متطابقة". عادةً. إنه ادعاء بالحفاظ مع تحفّظ مدمج في الصياغة، وهذه هي الطريقة الصادقة لطرح ادعاء كهذا، وهي أيضًا السبب في أنه ينبغي لك الاختبار على إطاراتك الخاصة بدلًا من الوثوق بعرض توضيحي.
لا يمتلك Bernini لغة إحداثيات مكافئة موجهة للمستخدم. تحسّن التحرير الموجّه بالمرجع الخاص به في v2 بسبب تغيير في التدريب — حيث يتم تسخين وحدة الموصل لآلاف الخطوات قبل بدء التدريب المشترك — وتفيد ByteDance أن هذا التغيير يظهر كتحرير محسّن موجّه بالمرجع وأداء أفضل في OpenS2V. إنه إصلاح جودة داخل بنية موجودة، وليس واجهة تحكم جديدة. إذا كان سير عملك يعتمد على إخبار النموذج بأي مستطيل يجب تركه بمفرده، فإن واحدة فقط من هاتين الإجابتين تجيب على السؤال.

ما الذي تدعمه الأرقام وما لا تدعمه
تحمل صفحة Bernini-Diffusers-v2 جدولاً من سبعة مقاييس يقارن الإصدار v2 بالإصدار v1، وكل رقم فيه مُبلَّغ عنه من الجهة المورِّدة. والاتجاه متباين، وهو أمر يجدر قوله صراحةً:
• ارتفاع — OpenS2V 63.83 (من 62.30)، VBench 84.46 (من 84.37)، Bernini-rv2v 3.55 (من 3.48).
• Flat — EditVerse 8.02، دون تغيير، وBernini-v2v 3.49، دون تغيير.
• انخفاض — OpenVE 3.96، من 4.03.
تذكر الصفحة أيضًا أن v2 يقع في الطبقة الأولى بين النماذج التجارية الرائدة المغلقة المصدر في ساحة داخلية عمياء للمقارنات البشرية الثنائية. هذا غير قابل للتحقق من خارج ByteDance، وينبغي قراءته كادعاء تسويقي، لا كقياس. أما التحركات الحقيقية الثلاث فهي المذكورة أعلاه، وهي مُبلَّغ عنها ذاتيًا بالمقارنة مع الإصدار v1 الخاص بالمختبر نفسه.
لا توجد لـ FLUX 3 Image أي أرقام على الإطلاق حتى الآن. تم فحص كل من لوحة تحويل النص إلى صورة ولوحة التحرير لدى Artificial Analysis في 1 أكتوبر و2026-10-02، ولا تحمل أي صف لـ FLUX 3 Image — تتوقف إدخالات BFL على تلك اللوحتين عند سطر FLUX.2، حيث يجلس FLUX.2 [max] عند 1021 Elo على لوحة التوليد و996 على لوحة التحرير. أما FLUX.2 [dev] فيثبّت اللوحتين عند 1000 بالضبط. لذا فإن البيان الصادق بشأن جودة FLUX 3 Image الآن هو أنه لم ينشر أحد خارج Black Forest Labs نتيجة لها، وأقرب نقطة مرجعية متاحة هي الجيل الذي سبقه.
هذا التباين هو الفخ العملي في هذه المقارنة. أرقام Bernini مُجراة بواسطة البائع لكنها موجودة ولها دلالة اتجاهية. أما أرقام FLUX 3 Image فهي غائبة. الغياب ليس فشلاً — فالنموذج عمره يوم واحد — لكنه يعني أن الدليل الوحيد على ادعاء التحرير في FLUX 3 Image يأتي حالياً من الشركة التي تبيعه.
جانب السعر، الذي ليس متماثلًا على الإطلاق
يُسعَّر FLUX 3 Image لكل صورة حسب فئة الدقة، وتُدرج قائمة أسعار المورّد خمسًا منها:
• 768sq — 0.041 دولار للسعر المعلن، و0.0205 دولار خلال فترة الإطلاق.
• 1K (الافتراضي) — $0.048 لسعر القائمة، $0.024 عند العرض.
• 1.5 ألف — سعر القائمة 0.07 دولار، و0.035 دولار عند العرض.
• 2K — 0.10 دولار بسعر القائمة، و0.05 دولار عند العرض.
• 4K — سعر القائمة 0.607 $، وعند العرض 0.3035 $.

الصور المرجعية وطول النص التوجيهي مشمولان دون أي رسوم إضافية، ولا تُحصّل رسوم عن الطلبات المرفوضة أو الفاشلة أو الخاضعة للإشراف — وهذا يهم أكثر من المعتاد هنا، لأن استدعاء 4K بطيء وإغراء التخلي عن الطلب حقيقي. يسري تسعير الإطلاق من الساعة 15:00 UTC في 1 أكتوبر حتى الساعة 15:00 UTC في 8 أكتوبر. القفزة في سعر القائمة من 2K إلى 4K بمعامل 6.07، وهي أكثر حدة بكثير من نسبة عدد البكسلات، لذا فإن فئة الدقة التي تختارها هي قرار التكلفة الرئيسي في كامل الـAPI.
تتبع الفئات ميزانية بكسل بدلاً من إطار ثابت. الناتج النموذجي من BFL هو 5456 × 3072، أي نحو 16.8 ميغابكسل، مقابل UHD 2160p عند 8.3 ميغابكسل — لذا فإن "4K" هنا يسمّي ميزانية، وتُقرَّب أبعاد الإخراج إلى مضاعفات 16 مع إعادة القيمة الفعلية باسم output_mp.
سعر Bernini صفر لكل صورة وغير صفر لكل ساعة. ثماني وحدات معالجة رسومية لاستدلال متوازٍ تسلسليًا، ويوصى بسيليكون من فئة Hopper، وPython 3.11.2 مع PyTorch 2.7.1 وCUDA 12.6. تقع نقطة التعادل مقابل 0.048 دولار للصورة عند 1K في مكان ما ضمن آلاف الصور شهريًا، اعتمادًا كليًا على ما تدفعه مقابل الحوسبة — وهو رقم حقيقي، لا رقم بلاغي. إذا كنت تشغّل بنية تحتية للاستدلال بالفعل، فإن الصورة الهامشية لدى Bernini تكاد تكون مجانية. وإذا لم تكن كذلك، فإن نقطة نهاية FLUX 3 Image أرخص بشكل هائل من إنشاء حزمة انتشار من مرحلتين.
التوجيه: لا يوجد أيٌّ من هذين في كتالوجنا
من الجدير قوله بصراحة، لأنه نوع من الادعاءات التي تصبح قديمة بسرعة. لا يقوم OrcaRouter بتوجيه FLUX 3 Image، ولا يوجّه Bernini-Diffusers-v2. استدعاء FLUX 3 Image يعني استدعاء Black Forest Labs مباشرةً عبر نقطة النهاية الخاصة بها. استدعاء Bernini يعني نشره بنفسك.
ما الغرض الفعلي من موجّه متوافق مع OpenAI، في مسار معالجة كهذا، هو كل ما يحيط باستدعاء الصورة من الجانبين. تمريرة كتابة تعليق أو إعادة صياغة موجّه، ونموذج رؤية يفحص الناتج مقابل الموجز، ونموذج فيديو يحرّك الصورة الثابتة المعتمدة، ونموذج نصي صغير يصنّف الخرج — تلك هي الخطوات التي تتيح فيها إمكانية تبديل مزوّد بسلسلة واحدة، وبمفتاح واحد، وجعل الطلبات تنتقل تلقائيًا إلى بديل عند تدهور أحدها، إزالة قدر حقيقي من أعباء الصيانة. يمرّر OrcaRouter سعر قائمة المزوّد كما هو دون أي هامش ربح، لذا عندما يخفض مورّد سعرًا يصبح التغيير ساريًا في اليوم نفسه بدلًا من انتظار أن يعيد موزّع التسعير، كما تمكّنك لغة التوجيه DSL من تثبيت نموذج محدد أو تعريف ترتيب الرجوع دون لمس كود التطبيق. لا شيء من ذلك يجعل FLUX 3 Image قابلًا للتوجيه. إنه يعني فقط أن بقية مسار المعالجة لا تحتاج إلى الاهتمام بالنموذج الذي أنتج الصورة الثابتة.
![Screenshot of the Artificial Analysis text-to-image leaderboard, showing FLUX.2 [max] at 1021 Elo and FLUX.2 [dev] fixed as the 1000 anchor, with no FLUX 3 Image entry anywhere on the board](https://cms.orcarouter.ai/api/media/file/4-1497.png)
أي واحد نبني عليه؟
ثلاثة أسئلة تفصل بين هذه بوضوح، وليس لها إجابة مشتركة.
هل تحتاج إلى التحكم في المكان الذي تذهب إليه الأشياء؟ FLUX 3 Image هو الوحيد من بين الاثنين الذي يمتلك لغة إحداثيات، وعمليات التحرير الخاصة به المحددة بالمربع — الإبقاء، النقل، الإضافة، الإزالة — هي واجهة مختلفة حقًا عن التحرير بتعليمات نصية. إذا كان عملك هو التركيب أو التخطيط أو تصوير المنتجات حيث يجب أن تبقى المناطق سليمة، فإن ذلك حاسم، والتحفظ في "تبقى عادة متطابقة" هو شيء تختبره بدلاً من أن تفترضه.
هل تحتاج إلى معرفة مدى جودته قبل أن تلتزم؟ لدى Bernini أرقام، جميعها مُبلَّغ عنها من المورّد، واتجاه سير مختلط. أما FLUX 3 Image فلا يملك أيًّا منها. وإذا لم تستطع إجراء تقييمك الخاص، فأنت تختار بين نموذج مقيس ونموذج غير مقيس، والنموذج المقيس هو البنية الأقدم.
هل يمكنك تشغيل مكدّس انتشار ثنائي المرحلتين؟ هذا هو العائق الحقيقي أمام Bernini. مخطِّط Qwen2.5-VL-7B يغذّي مُفكِّك Wan2.2-T2V-A14B، على Hopper GPUs، مع خطاف مُحسِّن للمطالبات يشير إلى نقطة نهاية متوافقة مع OpenAI. الترخيص متساهل أما فاتورة الحوسبة فليست كذلك. إذا لم تستطع، فالسؤال غير ذي جدوى والإجابة هي $0.048 للصورة.
الشيء الوحيد الذي قد يغيّر هذه الصفحة بأسرع وتيرة هو أن تفتح BFL أوزان FLUX 3 Image، وهو ما قالت الشركة إنه على بُعد أسابيع. سيحوّل ذلك عدم التماثل في الترخيص من حاسم إلى طفيف، ويترك اختلاف سطح التحكم ليكون هو المقارنة الفعلية. وحتى ذلك الحين، فالملخص الدقيق هو أن هذين نموذجان جيدان بنموذجَي توزيع متعاكسين، ويُتخذ الاختيار بناءً على الترخيص والتحكم قبل وقت طويل من اتخاذه بناءً على الجودة.
