
GPT-Image-2 מול Flux 3: השוואה בין מודל חי למפת דרכים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
זה לא פוסט רגיל של השוואת מודל מול מודל, כי GPT-Image-2 ו-Flux 3 אינם באותו מצב קיום. GPT-Image-2 הושק ב-21 באפריל 2026, ניתן לקרוא לו דרך ה-API של OpenAI מאז תחילת מאי, וקיבל השבוע יכולת חדשה — יצירת תמונות עם רקע שקוף ב-API, שהוכרזה ב-20 באוגוסט וזמינה כעת. Flux 3 הוא מודל הבסיס המולטי-מודאלי של Black Forest Labs, שהוכרז ב-23 ביולי 2026, ולשכבת התמונות עדיין אין נקודת קצה ציבורית, אין מזהה מודל ואין כרטיס מחיר נכון לכתיבת שורות אלה. את אחד מאלה אפשר לקרוא בשעה 3 לפנות בוקר עם מפתח API תקף; על השני אפשר להירשם לרשימת המתנה. ההשוואה השימושית, אם כן, אינה "מה עדיף" — אלא מה המודל ששוחרר עושה בפועל היום, מה מפת הדרכים טוענת לגבי זה שטרם שוחרר, וכיצד מפתח צריך להתייחס למודל מובטח שממשיך להידחות בזמן שמודל חי ממשיך להשתפר.
לאחת מאלה יש נקודת קצה
התחל עם זמינות, כי היא קובעת כל דבר אחר. Black Forest Labs חשפה את Flux 3 ב-23 ביולי כמודל יחיד שאומן במשותף על חיזוי תמונה, וידאו, אודיו ופעולות רובוט, הבנוי על גישת flow-matching שהמעבדה מכנה Self-Flow. לפי הדיווחים, מעל 95% מכוח החישוב של האימון הזה הופנה לחיזוי וידאו, וזה נראה במה שנשלח בפועל: רק Flux 3 Video הגיע לזמינות כללית, ב-4 באוגוסט, עם API בתשלום. עמוד המודל של שכבת התמונה עדיין נושא תווית "בקרוב" עם טופס הרשמה, לא כפתור התחלה — אין נקודת קצה, אין פרמטרים מתועדים, אין עלות לתמונה, ואין benchmark שמישהו יכול להריץ.
GPT-Image-2, לעומת זאת, נמצא בייצור כבר ארבעה חודשים. OpenAI פתחה את גישת ה-API בתחילת מאי, ומזהה המודל, gpt-image-2, יציב מספיק כך שגרסה מקושרת, gpt-image-2-2026-04-21, מתקיימת במקביל אליו. זהו המודל הנוכחי מספר אחת לטקסט-לתמונה בשני לוחות עצמאיים מרכזיים — 1,381 Elo בלוח הטקסט-לתמונה של Arena (המבנה הבינוני) ו-1,369 Elo למבנה הגבוה ב-Artificial Analysis — והוא מייצר טקסט רב-לשוני כולל CJK, מבסס יצירה על חיפוש באינטרנט, ומפיק פלט עד 4K. ארבעה חודשים של תעבורת ייצור הם ההבדל בין טענה לרקורד מוכח.
השינוי האחרון בצד GPT-Image-2
האירוע שהופך את ההשוואה הזו לאקטואלית אינו קשור ל-Flux 3. ב-20 באוגוסט, OpenAI פתחה תצוגה מקדימה עם רקע שקוף עבור GPT-Image-2 ב-Images API: הגדר את הרקע ל-"transparent" וה-endpoint מחזיר PNG או WebP עם ערוץ אלפא אמיתי, גזור ומוכן לשילוב. זוהי תכונה שמכוונת ישירות לעבודת ההפקה שגם מפת הדרכים של Flux 3 image משווקת — צילומי מוצר, אייקונים, נכסי שיווק — והיא הגיעה כפרמטר על נקודת קצה שכבר פעילה, ולא כמודל חדש. אז בעוד העולם מחכה ל-endpoint של Flux 3 image שעדיין מציג "בקרוב", המובילה סגרה זה עתה אחד מהפערים שמנעו ממנה להיכנס לצינורות קומפוזיציה.
היכולת זמינה אך ורק דרך API — אין בורר ChatGPT — והיא פרמטר, לא מוצר חדש. שני ה-endpoints של Images API, יצירה ועריכה, מקבלים שדה background עם הערכים "transparent", "opaque" ו-"auto" (ברירת המחדל, שבה המודל מחליט). ערוץ האלפא נשמר רק בפלט PNG או WebP, ולכן הבקשה קובעת את פורמט הפלט במפורש. התיעוד של OpenAI עצמו עדיין מסמן את התמיכה בשקיפות עבור gpt-image-2 והסנאפשט שלו gpt-image-2-2026-04-21 כ-"in preview" (בתצוגה מקדימה) — זוהי תווית של הספק, לא הכרזת שחרור — וההנחיה שלו היא לשמור על ה-prompt נקי מכל תיאור רקע, כך שהמודל אכן יכבד את בקשת השקיפות. אין endpoint חדש, אין מזהה מודל חדש, אין תמחור נפרד: אותה קריאה ל-gpt-image-2 שהחזירה PNG אטום מחזירה כעת קאטאאוט.

מה ש-Flux 3 מבטיח, ומה שנשלח בפועל
גיליון המפרט של שכבת התמונה של Flux 3 הוא מפת דרכים של ספק, אז התייחסו אליו ככזה. Black Forest Labs הבטיחה סינתזת תמונה ועריכה במגוון סגנונות ורזולוציות, טיפול משופר בהנחיות מורכבות, עיבוד טקסט רב-לשוני בדיוק גבוה, העברת סגנון zero-shot מתמונות ייחוס, עקביות דמויות ומותג ללא כוונון עדין, ועריכה לא הרסנית המשמרת מרקם ותאורה. אלה הדברים הנכונים להבטיח — הם בדיוק התכונות שהמובילים הנוכחיים בשוק מתחרים עליהן — אבל אף אחת מהן אינה ניתנת לבדיקה היום, כי לאף אחת מהן אין נקודת קצה.
מה שבפועל ניתן לקרוא דרך BFL הוא שכבת הווידאו וקו התמונות הוותיק של FLUX. Flux 3 Video נמכר ב-0.17 דולר לשנייה ב-HD וב-0.29 דולר לשנייה ב-FHD עבור רינדורים מלאים, עם מצב טיוטה ב-0.06 דולר לשנייה. המספרים שהוא עצמו מדווח הם 1,135 Elo לטקסט-לווידאו ו-1,051 לתמונה-לווידאו, וניצחונות בהעדפה על Luma Ray 3.2, Runway Gen-4.5, Grok Imagine Video ו-Kling v3 Pro — {{1}}הכל מדווח על ידי הספק ולא שוכפל, וממילא שום דבר מזה לא עובר לשכבת התמונה{{/1}}. לתמונות סטילס, ההיצע הנוכחי של BFL נותר קו ה-FLUX.2, שעומד על 1,226 Elo באותו לוח של Artificial Analysis שבו GPT-Image-2 מוביל עם 1,369. הפער הזה הוא ההקשר המעשי ל"{{2}}תמונת Flux 3 בדרך{{/2}}": ה-API הנוכחי לתמונות של BFL {{3}}נמוך בכ-140 Elo מזה{{/3}} {{4}}של OpenAI{{/4}}, והמודל המובטח הוא מה ש-BFL צריך כדי לסגור את הפער.

תמחור: קיים רק כרטיס מחיר אמיתי אחד.
אין מחיר לתמונות של Flux 3, כי אין מוצר תמונות של Flux 3. המספרים היחידים שפורסמו הם תעריפי האסימונים של GPT-Image-2: 5 דולר למיליון אסימוני טקסט בקלט, 8 דולר למיליון אסימוני תמונה בקלט, ו-30 דולר למיליון אסימוני תמונה בפלט, כאשר ה-Batch API פועל בכמחצית מהמחיר עבור זמן אספקה של עד 24 שעות. OpenAI לא מפרסמת אסימונים לתמונה, ולכן הנתונים לתמונה הם המרות, לא הצעות מחיר: בערך 0.006 דולר עבור תמונה באיכות נמוכה 1024×1024, סביב 0.05 דולר עבור תמונה בינונית, סביב 0.21 דולר באיכות גבוהה, ועד כ-0.41 דולר עבור רינדור גבוה ב-4K. לשם השוואה, זה הצד האמיתי היחיד בספר החשבונות; עמודת תמונות Flux 3 היא תא ריק.

מה על קבלן לעשות עם דגם שהובטח
העמדה השפויה כשהמודל של מתחרה ממשיך להחליק היא לבנות על מה שקיים ולהפוך את העתיד לשינוי תצורה במקום לארכיטקטורה מחודשת. GPT-Image-2 ניתן לניתוב היום דרך OrcaRouter — מפתח API אחד, המחיר הרשמי של OpenAI מועבר ב-0% markup, מעבר אוטומטי בין ספקים — כך שצנרת שמייצרת נכסים באמצעותו תוכל בהמשך להפנות את אותו endpoint אל ה-API של Flux 3 image ביום שבו endpoint כזה באמת יהיה קיים, ולנתב חלק מהתעבורה אליו עם ה-DSL לניתוב מבלי לגעת בקוד הקורא. אתה מקבל את המודל ששוחרר עכשיו, וכשהמודל המובטח יגיע, אתה מעריך אותו מול קו בסיס עובד במקום מול הודעה לעיתונות. ההמתנה לא עולה לך כלום; לבנות על כלום בזמן שאתה מחכה עולה לך הכל.
ההכרעה חד-צדדית במתכוון. אם אתה צריך ייצור תמונות ברבעון הזה, GPT-Image-2 הוא הבחירה ואין בכלל שאלה — הוא מספר אחת עצמאי, הוא בדיוק הוסיף פלט עם רקע שקוף ב-API, ויש לו API ציבורי ומחיר יציב. תמונת Flux 3 היא סיבה לעקוב אחרי Black Forest Labs, לא סיבה לעכב פרויקט. עקוב אחרי פתיחת הגישה המוקדמת ואחרי הבנצ'מרקים העצמאיים הראשונים; ברגע שיהיה endpoint, ההשוואה בפוסט הזה הופכת לבדיקה שאתה באמת יכול להריץ.
