כרטיס כותרת עבור FLUX 3 Image לעומת Bernini-Diffusers-v2, המשווה בין "FLUX 3 Image - זמין החל מ-1 באוקטובר 2026, $0.048 לתמונה ברזולוציית 1K, בכתובת api.bfl.ai" לבין "Bernini-Diffusers-v2 - משקולות Apache-2.0, אירוח עצמי בלבד, ללא API מתארח", ומציין ש-OrcaRouter אינו מנתב אף אחד מהשניים. הלוגו של OrcaRouter ממוקם בפינה הימנית התחתונה.
Guides & Insights

FLUX 3 Image מול Bernini-Diffusers-v2: נקודת קצה בתשלום מול מאגר להורדה

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

FLUX 3 Image ו-Bernini-Diffusers-v2 הם שניהם מודלי תמונה שאפשר להשיג במלואם היום, ואף אחד מהם אינו מוצר שניתן לשכור. FLUX 3 Image עלה לאוויר ב-1 באוקטובר 2026 בכתובת api.bfl.ai/v1/flux-3-image עם מחירון מפורסם וללא ציון מפורסם. Bernini-Diffusers-v2 נחת ב-Hugging Face ב-13 באוגוסט 2026 תחת Apache-2.0 עם ציונים מפורסמים וללא דרך לקרוא לו מלבד ה-GPU שלך. האחד מגיע עם חשבונית. האחר מגיע עם נעיצת גרסת Python.

הפיצול הזה הוא כל ההשוואה, וכדאי להיות מדויקים לגביו, מפני שהמסגור הרגיל של "מאוחסן מול משקולות פתוחות" לא מתאים כאן. Bernini אינו מודל עם משקולות פתוחות שאפשר להשתיל לתוך מחסנית הסקה קיימת. זוהי מערכת דו-שלבית — מתכנן Qwen2.5-VL-7B לפני מפענח דיפוזיה Wan2.2-T2V-A14B — ומהדורת v2 שלו היא תיקון של לוח הזמנים לאימון, לא דרגת יכולת חדשה. FLUX 3 Image מהווה נקודת קצה אחת עם כמות יוצאת דופן של משטח שליטה שמוברגים אליה: עיגון מרחבי, רשת קואורדינטות 0–1000, ועריכה תחומה בתיבה שבה אתה מציין אילו אזורים שורדים. צורות שונות של דבר.

מה כל אחד הוא בפועל

• FLUX 3 Image — Black Forest Labs' image tier of its unified FLUX 3 family, released October 1, 2026. One HTTP POST to https://api.bfl.ai/v1/flux-3-image with an x-key header; only prompt is required. The call returns a polling URL, and a finished 4K render can take several minutes. Generated samples are downloadable for one hour.

• Bernini-Diffusers-v2 — מערכת המתכנן והמרנדר של ByteDance, שהועלתה ל-Hugging Face ב-13 באוגוסט 2026 ללא הכרזה נלווית. המאגר מתויג image-text-to-video ותלוי ב-diffusers. המשימות המפורטות: טקסט לתמונה, תמונה לתמונה, טקסט לווידאו, וידאו לווידאו, רפרנס לווידאו ורפרנס לתמונה. אין הסקה מתארחת ואין מחירון — מסלול ההתחלה הוא hf download ואפליקציית Gradio.

• פער ההפצה — FLUX 3 Image הוא שירות מדוד שאתה קורא לו. Bernini הוא מאגר שאתה פורש. לפני ששווה לשאול שאלת איכות כלשהי, אחד מאלה דורש GPU בדרגת Hopper והאחר דורש כרטיס אשראי.

רישוי הוא הנקודה שבה השניים האלה מתפצלים באופן החריף ביותר

Bernini-Diffusers-v2 מופץ תחת רישיון Apache-2.0 ברמת המאגר. עבור פייפליין בהארחה עצמית, זה משנה מאוד: אין מדידה לפי תמונה, אין הסכם מסחרי שנקבע במשא ומתן, ואין דיווח על שימוש. אתם משלמים על חשמל ועל זמן מתזמן, והעלות השולית של התמונה ה-10,000 זהה לזו של הראשונה.

FLUX 3 Image אינו זמין במשקלים פתוחים, ו-Black Forest Labs מבהירה במפורש שזה זמני. משקלים מסחריים זמינים היום תחת רישיון BFL במשא ומתן, והשחרור הציבורי של המשקלים הפתוחים מתואר ככזה שיגיע בשבועות הקרובים. זו הבטחה עם צורה אבל בלי תאריך, וזה הדבר היחיד והחשוב ביותר בעמוד הזה שיש לבדוק מחדש ולא להניח. אם אתם בוחרים סטאק תמונות לשנתיים הקרובות, שאלת הרישיון כנראה גוברת על שאלת ה-Elo — אבל רק אם אתם מוכנים להפעיל בעצמכם סטאק דיפוזיה דו-שלבי ילידי-וידאו.

משטח בקרה: תיבות תיחום לעומת שיפור פרומפט

זה החלק בהתמודדות שהוא באמת מעניין, כי שני המודלים פותרים את "לגרום לזה להגיע בדיוק לשם" בדרכים שונות לחלוטין.

FLUX 3 Image מקבל מערך JSON שמצורף לפרומפט. הקואורדינטות פועלות על רשת 0–1000 בשני הצירים, וכל תיבה נכתבת בתור [top, left, bottom, right]. אתם מספקים טבלה של אלמנטים, שלכל אחד מהם id, bbox ו-desc, בתוספת כיתוב גלובלי שמאזכר את המזהים האלה בשמם. בדוגמה של BFL עצמה המזהים נראים כמו animal_1 ו-silhouette_1; הכיתוב מתייחס אליהם ישירות. מעל קריאת היצירה יש grounding, שמופעל כברירת מחדל, ומריץ חיפוש באינטרנט ובתמונות לפני היצירה.

FLUX 3 Image מרחיב לאחר מכן את אותה מערכת הקואורדינטות לתוך עריכה. במקום לשלוח מסכה, אתה שולח קבוצה של פעולות תחומות לתיבה: השאר (תיבת מקור לאותה תיבה, מקורה מ-ref_image_0), העבר (תיבת מקור לתיבת יעד חדשה), חדש (ללא מקור, תיבת יעד נוצרת מתיאור — הוספה, החלפה או שינוי צבע) והסר (תיבת מקור ליעד ריק). מספר פעולות נשלחות בבקשה אחת.

ההסתייגות הזו חשובה. התיעוד של BFL אומר שפיקסלים מחוץ לתיבות שנערכו "בדרך כלל נשארים זהים". בדרך כלל. זו טענת שימור עם הסתייגות מובנית בניסוח, וזו הדרך הישרה לשחרר טענה כזו, וגם הסיבה שעליכם לבדוק על הפריימים שלכם במקום לסמוך על דמו.

ל-Bernini אין שפת קואורדינטות מקבילה הפונה למשתמש. העריכה המודרכת-רפרנס השתפרה ב-v2 בגלל שינוי באימון — מודול המחבר עובר חימום במשך אלפי צעדים לפני שהאימון המשותף מתחיל — ו-ByteDance מדווחת שהשינוי הזה בא לידי ביטוי בעריכה מונחית-רפרנס טובה יותר ובביצועי OpenS2V טובים יותר. זהו תיקון איכות בתוך ארכיטקטורה קיימת, לא ממשק בקרה חדש. אם זרימת העבודה שלך תלויה בכך שתגיד למודל איזה מלבן להשאיר ללא שינוי, רק אחת משתי התשובות האלה עונה על השאלה.

Screenshot of Black Forest Labs' FLUX 3 Image model page, headed 'Maximum control over every pixel', showing the bounding-box and region-editing feature list for the October 1, 2026 image release

מה המספרים תומכים בו ומה הם אינם תומכים בו

הדף של Bernini-Diffusers-v2 מציג טבלה בת שבעה מדדים המשווה בין v2 ל-v1, וכל נתון בה מדווח על ידי הספק. הכיוון מעורב, וכדאי לומר זאת בקול רם:

• עלייה — OpenS2V 63.83 (מ-62.30), VBench 84.46 (מ-84.37), Bernini-rv2v 3.55 (מ-3.48).

שטוח — EditVerse 8.02, ללא שינוי, ו-Bernini-v2v 3.49, ללא שינוי.

• ירידה — OpenVE 3.96, מ־4.03.

הדף גם מציין כי v2 נמצא בדרג הראשון מבין המודלים המסחריים המובילים בקוד סגור בזירה פנימית של השוואות אנושיות עיוורות בזוגות. לא ניתן לאמת זאת מחוץ ל-ByteDance, ויש לקרוא זאת כטענה שיווקית, לא כמדידה. שלושת המהלכים האמיתיים הם אלה המפורטים לעיל, והם מדווחים על ידי אותה מעבדה בעצמה מול ה-v1 שלה.

ל-FLUX 3 Image אין עדיין מספרים בכלל. לוח הטקסט-לתמונה של Artificial Analysis ולוח העריכה שלה נבדקו שניהם ב-1 באוקטובר וב-2 באוקטובר 2026 ואינם כוללים שורה של FLUX 3 Image — הרשומות של BFL בלוחות האלה מסתיימות בשורת FLUX.2, שבה FLUX.2 [max] ממוקם על 1021 Elo בלוח היצירה ועל 996 בלוח העריכה. FLUX.2 [dev] מעגן את שני הלוחות בדיוק על 1000. אז ההצהרה הכנה לגבי איכות FLUX 3 Image כרגע היא שאף אחד מחוץ ל-Black Forest Labs לא פרסם עבורו ציון, ונקודת הייחוס הזמינה הקרובה ביותר היא הדור שלפניו.

האסימטריה הזו היא המלכודת המעשית בהשוואה הזאת. המספרים של Bernini אמנם מגיעים מהספק, אבל הם קיימים והם כיווניים. אלה של FLUX 3 Image נעדרים. היעדרות אינה כישלון — המודל בן יומו — אבל היא כן אומרת שהראיה היחידה לטענת העריכה של FLUX 3 Image מגיעה כרגע מהחברה שמוכרת אותו.

צד המחיר, שאינו סימטרי כלל

FLUX 3 Image מתומחר לפי תמונה, לפי דרגת רזולוציה, וכרטיס התעריפים של הספק מפרט חמישה מהם:

• 768sq — $0.041 במחיר מחירון, $0.0205 במהלך חלון ההשקה.

• 1K (ברירת המחדל) — $0.048 מחיר מחירון, $0.024 במבצע.

• 1.5 אלף — $0.07 מחיר מחירון, $0.035 במבצע.

• 2K — $0.10 מחיר מחירון, $0.05 במבצע.

• 4K — $0.607 מחיר מחירון, $0.3035 במבצע.

Screenshot of Black Forest Labs' pricing page captured October 2, 2026, showing the FLUX 3 Image tab and its per-image rates by resolution tier, from 768sq through 4K

תמונות ייחוס ואורך הפרומפט כלולים ללא תוספת תשלום, ובקשות שנדחו, נכשלו או נחסמו על ידי מודרציה אינן מחויבות בתשלום — מה שחשוב כאן יותר מהרגיל, כי קריאה ב-4K היא איטית והפיתוי לזנוח בקשה הוא ממשי. תמחור ההשקה תקף מ-15:00 UTC ב-1 באוקטובר עד 15:00 UTC ב-8 באוקטובר. הזינוק במחיר המחירון מ-2K ל-4K הוא פי 6.07, תלול בהרבה מיחס מספר הפיקסלים, לכן דרגת הרזולוציה שתבחרו היא החלטת העלות העיקרית בכל ה-API.

הרמות עוקבות אחרי תקציב פיקסלים ולא אחרי פריים קבוע. הפלט לדוגמה של BFL הוא 5456 × 3072, כ-16.8 מגה-פיקסלים, לעומת UHD 2160p עם 8.3 מגה-פיקסלים — לכן "4K" כאן מציין תקציב, ומידות הפלט מעוגלות לכפולות של 16, כאשר הנתון בפועל מוחזר בתור output_mp.

המחיר של Bernini הוא אפס לתמונה, ואינו אפס לשעה. שמונה GPUs להסקה במקביליות רצף, מומלץ סיליקון בדרגת Hopper, Python 3.11.2 עם PyTorch 2.7.1 ו-CUDA 12.6. נקודת האיזון מול $0.048 לתמונה ב-1K מגיעה אי-שם באלפי תמונות בחודש, תלוי לחלוטין במה שאתם משלמים עבור מחשוב — וזה מספר אמיתי, לא רטורי. אם אתם כבר מפעילים תשתית הסקה, התמונה השולית של Bernini היא כמעט בחינם. אם לא, נקודת הקצה FLUX 3 Image זולה באופן דרמטי מאשר להקים מערך דיפוזיה דו-שלבי.

ניתוב: אף אחד מאלה אינו בקטלוג שלנו

כדאי לומר זאת בבירור, מפני שזו טענה מהסוג שמתיישן במהירות. OrcaRouter לא מנתב את FLUX 3 Image, והוא גם לא מנתב את Bernini-Diffusers-v2. קריאה ל-FLUX 3 Image משמעה פנייה ישירה אל Black Forest Labs בנקודת הקצה שלהם. קריאה ל-Bernini משמעה לפרוס אותו בעצמך.

מה שנתב תואם-OpenAI באמת נועד לעשות, בצינור עיבוד כמו זה, הוא כל מה שמשני צדי קריאת התמונה. מעבר של כתוביות או ניסוח מחדש של פרומפט, מודל ראייה שבודק את הרינדור מול הבריף, מודל וידאו שמנפיש את התמונה הסטטית המאושרת, מודל טקסט קטן שמסווג את הפלט — אלה הם השלבים שבהם היכולת להחליף ספק במחרוזת אחת, במפתח אחד, ולגרום לבקשות לעבור אוטומטית לספק חלופי כשאחד מהם במצב ירוד, חוסכת כמות ממשית של תחזוקה. OrcaRouter מעביר את מחיר המחירון של הספק ללא תוספת, כך שכשספק מוריד תעריף השינוי נכנס לתוקף באותו יום במקום להמתין שמשווק יקבע מחיר מחדש, ו-DSL הניתוב מאפשר לך לנעוץ מודל מסוים או להגדיר סדר חלופות בלי לגעת בקוד האפליקציה. שום דבר מזה לא הופך את FLUX 3 Image למודל שאפשר לנתב. זה רק אומר ששאר הצינור לא צריך לדעת איזה מודל הפיק את התמונה הסטטית.

Screenshot of the Artificial Analysis text-to-image leaderboard, showing FLUX.2 [max] at 1021 Elo and FLUX.2 [dev] fixed as the 1000 anchor, with no FLUX 3 Image entry anywhere on the board

על איזה מהם לבנות

שלוש שאלות מפרידות ביניהם באופן נקי, ואין להן תשובה משותפת.

האם אתה צריך לשלוט לאן הדברים הולכים? FLUX 3 Image הוא היחיד מבין השניים עם שפת קואורדינטות, ולפעולות העריכה המוגבלות לתיבה שלו — שמור, הזז, הוסף, הסר — יש ממשק שונה מהותית מעריכה באמצעות הוראות טקסט. אם העבודה שלך היא קומפוזיציה, פריסה או צילומי מוצר שבהם אזורים חייבים לשרוד, זה מכריע, וההסתייגות ב"בדרך כלל נשארים זהים" היא משהו שבודקים ולא מניחים.

האם אתה צריך לדעת עד כמה זה טוב לפני שאתה מתחייב? ל-Bernini יש מספרים, כולם מדווחים על ידי הספק, ומגמה מעורבת. ל-FLUX 3 Image אין. אם אינך יכול להריץ הערכה משלך, אתה בוחר בין מודל מדוד למודל לא מדוד, והמדוד הוא הארכיטקטורה הישנה יותר.

האם אתה יכול להפעיל מערך דיפוזיה דו-שלבי? זה השער האמיתי על Bernini. מתכנן Qwen2.5-VL-7B שמזין מפענח Wan2.2-T2V-A14B, על GPUs של Hopper, עם hook משפר-פרומפט שמצביע לנקודת קצה תואמת OpenAI. הרישיון מתירני וחשבון המחשוב אינו. אם אינך יכול, השאלה מיותרת ו-$0.048 לתמונה היא התשובה.

הדבר האחד שישנה את העמוד הזה מהר ביותר הוא ש-BFL תפתח את משקולות FLUX 3 Image, שהחברה אמרה שזה במרחק שבועות. זה הופך את אסימטריית הרישוי ממכרעת למתונה ומשאיר את ההבדל במשטח השליטה כהשוואה האמיתית. עד אז, הסיכום המדויק הוא שאלו שני מודלים טובים עם מודלי הפצה מנוגדים, והבחירה נעשית על בסיס רישוי ושליטה הרבה לפני שהיא נעשית על בסיס איכות.