
GPT-Image-2 مقابل Flux 3: مقارنة نموذج حي بخارطة طريق
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
هذه ليست مشاركة عادية للمقارنة بين نموذج وآخر، لأن GPT-Image-2 و Flux 3 ليستا في نفس الحالة الوجودية. فقد جرى إطلاق GPT-Image-2 في 21 أبريل 2026، وأصبح قابلاً للاستدعاء عبر واجهة OpenAI البرمجية منذ أوائل مايو، واكتسب هذا الأسبوع قدرة جديدة — توليد صور بخلفية شفافة في الواجهة البرمجية، وهو ما أُعلن عنه في 20 أغسطس وهو متاح الآن. أما Flux 3 فهو النموذج الأساسي متعدد الوسائط من Black Forest Labs، الذي أُعلن عنه في 23 يوليو 2026، وما زالت طبقة الصور فيه بلا نقطة نهاية عامة ولا معرّف نموذج ولا بطاقة أسعار حتى وقت كتابة هذه السطور. يمكنك استدعاء أحدهما في الساعة 3 صباحًا بمفتاح صالح؛ أما الآخر فيمكنك التسجيل في قائمة الانتظار للحصول عليه. والمقارنة المفيدة إذن ليست "أيهما أفضل" — بل ما يفعله النموذج المطروح فعليًا اليوم، وما تعد به خارطة الطريق للنموذج غير المطروح، وكيف ينبغي للمطوّر التعامل مع نموذج موعود يظل يتأخر بينما يواصل النموذج المتاح تحسّنه.
أحد هذه لديه نقطة نهاية
ابدأ بالتوافر، لأنه يحدد كل شيء آخر. كشفت Black Forest Labs عن Flux 3 في 23 يوليو كنموذج واحد تم تدريبه بشكل مشترك على التنبؤ بالصور والفيديو والصوت وأفعال الروبوت، مبنيًا على نهج مطابقة التدفق الذي تسميه المختبر Self-Flow. يُذكر أن أكثر من 95٪ من قدرة التدريب تلك ذهبت إلى التنبؤ بالفيديو، وهو ما يظهر في ما تم إطلاقه فعليًا: فقط Flux 3 Video وصل إلى التوافر العام، في 4 أغسطس، مع API مدفوعة. صفحة نموذج الطبقة الخاصة بالصور لا تزال تحمل ملصق "قريبًا" مع نموذج طلب، وليس زر بدء استخدام — لا نقطة نهاية، ولا معلمات موثقة، ولا تكلفة لكل صورة، ولا معيار يمكن لأي شخص تشغيله.
GPT-Image-2، على النقيض من ذلك، في الإنتاج منذ أربعة أشهر. فتحت OpenAI الوصول إلى واجهة برمجة التطبيقات في أوائل مايو، ومعرّف النموذج، gpt-image-2، مستقر بما يكفي لدرجة أن نسخة مجمّدة، gpt-image-2-2026-04-21، تتعايش معه. وهو حاليًا النموذج الأول لتوليد الصور من النص على كل من المجلسين المستقلين الرئيسيين — 1,381 إيلو على لوحة صدارة توليد الصور من النص في Arena (النسخة المتوسطة) و1,369 إيلو للنسخة العالية على Artificial Analysis — ويعرض نصًا متعدد اللغات بما في ذلك CJK، ويؤسس التوليد على البحث على الويب، وينتج مخرجات تصل إلى 4K. أربعة أشهر من حركة الإنتاج هي الفرق بين الادعاء والسجل الحافل.
التغيير الأخير في جانب GPT-Image-2
الحدث الذي يجعل هذه المواجهة في توقيتها المناسب لا علاقة له بـ Flux 3. في 20 أغسطس، أطلقت OpenAI معاينة بخلفية شفافة لـ GPT-Image-2 في واجهة برمجة تطبيقات الصور (Images API): اضبط الخلفية على "transparent" وستُعيد نقطة النهاية ملف PNG أو WebP بقناة ألفا حقيقية، مقطوعًا وجاهزًا للدمج. هذه ميزة تستهدف بدقة أعمال الإنتاج التي تروّج لها أيضًا خارطة طريق نموذج صور Flux 3 — لقطات المنتجات، الأيقونات، أصول التسويق — وقد وصلت كمعامل على نقطة نهاية نشطة بالفعل بدلاً من نموذج جديد. لذا، بينما ينتظر العالم نقطة نهاية صور Flux 3 التي ما تزال تقول "قريبًا"، أغلقت الشركة القائمة للتو إحدى الثغرات التي أبقتها خارج خطوط أنابيب الدمج.
هذه الإمكانية متاحة عبر API فقط — لا يوجد مفتاح تبديل في ChatGPT — وهي معلمة (parameter) وليست منتجًا جديدًا. تقبل نقطتا نهاية واجهة برمجة تطبيقات الصور (Images API)، التوليد والتحرير، حقل background بقيم "transparent" و"opaque" و"auto" (القيمة الافتراضية، حيث يقرر النموذج). لا تبقى قناة ألفا (alpha channel) إلا في مخرجات PNG أو WebP، لذلك يثبّت الطلب صيغة الإخراج بشكل صريح. لا يزال مرجع واجهة برمجة التطبيقات الخاص بـ OpenAI يضع علامة دعم الشفافية لنموذج gpt-image-2 ولقطة gpt-image-2-2026-04-21 على أنه "قيد المعاينة" — وهذه تسمية من البائع، وليست إعلان تخرج — وإرشاده هو إبقاء المطالبة (prompt) خالية من أي خلفية موصوفة كي يلتزم النموذج فعليًا بطلب الشفافية. لا نقطة نهاية جديدة، لا معرّف نموذج جديد، لا بطاقة أسعار منفصلة: نفس استدعاء gpt-image-2 الذي كان يعيد PNG بطبقة غير شفافة يعيد الآن صورة مقتطعة.

ما الذي يَعِد به Flux 3 Image، وما الذي يُطرَح فعليًا
صفحة مواصفات طبقة صور Flux 3 هي خارطة طريق من المورّد، لذا تعامل معها على هذا الأساس. لقد وعدت Black Forest Labs بتوليف الصور وتحريرها عبر أنماط ودقّات متعددة، وتحسين معالجة الاستعلامات المعقّدة، وعرض نصوص متعددة اللغات بدقّة عالية، ونقل الأنماط بدون عينات (zero-shot) من الصور المرجعية، والحفاظ على ثبات الشخصيات والعلامات التجارية دون ضبط دقيق، وتحرير غير مدمر يحافظ على الملمس والإضاءة. هذه هي الوعود الصحيحة — فهي بالضبط الميزات التي يتنافس عليها قادة السوق الحاليون — لكن لا يمكن اختبار أيٍّ منها اليوم لأن أياً منها لا يملك نقطة نهاية.
ما يمكن استدعاؤه فعليًا من BFL هو طبقة الفيديو وخط صور FLUX الأقدم. يبلغ سعر Flux 3 Video 0.17 دولارًا في الثانية بدقة HD و0.29 دولارًا في الثانية بدقة FHD للعرض الكامل، مع وضع مسودة بمعدل 0.06 دولارًا في الثانية. الأرقام التي أبلغ عنها هي 1,135 Elo للنص إلى فيديو و1,051 للصورة إلى فيديو، وتفوق في اختبارات التفضيل على Luma Ray 3.2 وRunway Gen-4.5 وGrok Imagine Video وKling v3 Pro — وكلها أرقام مقدمة من البائع وغير مُعاد إنتاجها، ولا ينتقل أي منها إلى طبقة الصور على أي حال. أما بالنسبة للصور الثابتة، فإن عرض BFL الحالي يظل خط FLUX.2، الذي يسجل 1,226 Elo على لوحة Artificial Analysis نفسها التي تتصدرها GPT-Image-2 بـ1,369. هذه الفجوة هي السياق العملي لعبارة «نموذج صور Flux 3 قادم»: إن واجهة برمجة تطبيقات الصور الحالية من BFL متخلفة عن نظيرتها في OpenAI بنحو 140 Elo، والنموذج الموعود هو ما تحتاجه BFL لسد هذه الفجوة.

التسعير: توجد بطاقة سعر حقيقية واحدة فقط.
لا يوجد سعر لصور Flux 3، لأنه لا يوجد منتج صور Flux 3. الأرقام المنشورة الوحيدة هي أسعار رموز GPT-Image-2: 5 دولارات لكل مليون رمز نصي للإدخال، و8 دولارات لكل مليون رمز صورة للإدخال، و30 دولارًا لكل مليون رمز صورة للإخراج، مع تشغيل Batch API بنصف السعر تقريبًا لمدة استجابة تصل إلى 24 ساعة. لا تنشر OpenAI عدد الرموز لكل صورة، لذا فإن الأرقام لكل صورة هي تحويلات وليست عروض أسعار: حوالي 0.006 دولار لصورة منخفضة الجودة بدقة 1024×1024، وحوالي 0.05 دولار لصورة متوسطة، وحوالي 0.21 دولار بجودة عالية، وحتى حوالي 0.41 دولار لعرض عالي الدقة 4K. للمقارنة، هذا هو الجانب الوحيد الحقيقي من الحساب؛ عمود صور Flux 3 هو خلية فارغة.

ما يجب على المنشئ فعله بالنموذج الموعود
الموقف السليم عندما يستمر نموذج منافس في التدهور هو البناء على ما هو موجود وجعل المستقبل تغييرًا في الإعدادات بدلاً من إعادة هندسة. GPT-Image-2 قابل للتوجيه اليوم عبر OrcaRouter — مفتاح API واحد، سعر OpenAI الرسمي يُمرَّر بهامش ربح 0%، وتبديل تلقائي عند انقطاع الخدمة بين المزودين — بحيث يمكن لخط أنابيب يولّد الأصول به أن يوجّه لاحقًا نفس نقطة النهاية إلى واجهة برمجة تطبيقات Flux 3 image في اليوم الذي توجد فيه نقطة نهاية فعلية، ويوجّه جزءًا من حركة المرور إليها عبر لغة التوجيه DSL دون لمس كود الاستدعاء. تحصل على النموذج المُطلق الآن، وعندما يصل النموذج الموعود، تقيّمه مقابل خط أساس يعمل بدلاً من بيان صحفي. الانتظار لا يكلفك شيئًا؛ أما البناء على لا شيء أثناء الانتظار فيكلفك كل شيء.
الحكم منحاز بتصميم. إذا كنت بحاجة إلى توليد الصور في هذا الربع، فإن GPT-Image-2 هو الخيار الأمثل بلا منازع — فهو الرقم الأول في التقييمات المستقلة، وقد أضاف للتو إخراجًا بخلفية شفافة في واجهة برمجة التطبيقات (API)، ولديه واجهة برمجة تطبيقات عامة وسعر مستقر. أما Flux 3 image فهو سبب لترقب Black Forest Labs، وليس سببًا لتعليق مشروع. راقب افتتاح الوصول المبكر وأول التقييمات المستقلة؛ فبمجرد وجود نقطة نهاية (endpoint)، تتحول المقارنة في هذا المنشور إلى اختبار يمكنك تشغيله فعليًا.
