כרטיס כותרת ראשי עבור MAI-Image-2.6, מודל הטקסט-לתמונה מספר 2 של מיקרוסופט ב-Arena, המציג ציון Arena של 1,336, דירוג מספר 2, ורווח Elo של +79 על פני MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview: #1 בעריכת תמונות, #2 בטקסט לתמונה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ה-MAI-Image-2.6-Preview של Microsoft כבר אינו רק ערך בלוח המובילים של Arena שאי אפשר לגעת בו — הוא כעת מוביל עצמאי בלוח המובילים. ב-25 באוגוסט, Artificial Analysis, ארגון אמות המידה העצמאי, דירג את אותו build Preview במקום הראשון בלוח המובילים לעריכת תמונות (Image Editing Leaderboard) ובמקום השני ב-Text to Image. המקום הראשון בעריכה מציב אותו לפני ה-MAI-Image-2.5-Pro של Microsoft עצמה (המוביל הקודם), Reve 2.1, ו-GPT Image 2 של OpenAI, ובכך מעניק ל-Microsoft את שני המקומות הראשונים בלוח זה. המודל נכנס לתצוגה מקדימה פרטית ב-MAI Playground וב-Microsoft Foundry ב-19 באוגוסט, לפי הודעת Microsoft — בהזמנה בלבד, עדיין ללא API ציבורי, ועדיין ללא מחירון.

החלק הבולט הוא מסלול ההתקדמות, לא רק הדירוג. הגרסה שהגיעה למקום מס' 2 בלוח הטקסט-לתמונה של Arena נקראת, פשוטו כמשמעו, "mai-image-2.6-preview," נשאה כ-3,500 קולות בתמונת המצב ההיא, וטיפסה שמונה מקומות עם רווח של 79+ נקודות Elo לעומת MAI-Image-2.5 בצעד אחד. מאז, התמונה התבהרה במהירות: גישת תצוגה מקדימה פרטית נפתחה ב-MAI Playground וב-Microsoft Foundry ב-19 באוגוסט, לוח עריכת התמונות של Arena העלה את הגרסה למקום מס' 3, וכעת Artificial Analysis ממקמת אותה במקום מס' 1 בעריכת תמונות ובמקום מס' 2 בטקסט-לתמונה. זהו האות העצמאי החזק ביותר עד כה לכך שהמאמץ הפנימי של מיקרוסופט בתחום התמונות סגר את הפער מול OpenAI — וה-API הציבורי עדיין לא זמין באופן כללי.

המספרים המפתח

• דירוג Arena לטקסט-לתמונה: מקום 2 — ציון 1,336±11, ראשוני, ~3,488 קולות

• פער מהמקום 1 (GPT Image 2 Medium): 45 Elo

• יתרון על המקום השלישי (Grok Imagine Image 2.0): 20 Elo

• עוקף את MAI-Image-2.5: +79 נקודות Elo בסך הכל, +91 נקודות Elo בעיבוד טקסט

• מקום קודמו: MAI-Image-2.5 במקום 10 (1,256)

• דירוג עריכת תמונות: מקום 3 ב-Arena's "Single Image Edit" — 1,420 נקודות, עלייה ממקום 5

• דירוג עריכת התמונות של Artificial Analysis: מקום 1 — לפני MAI-Image-2.5-Pro (המקום 1 הקודם), Reve 2.1, ו-GPT Image 2; מיקרוסופט מחזיקה בשני המקומות הראשונים

• דירוג Artificial Analysis לטקסט-לתמונה: מקום 2 — אחרי GPT Image 2 בלבד; ראשון ב-5 מתוך 19 לוחות קטגוריות

• תצוגה מקדימה פרטית: הוכרז ב-19 באוגוסט ב-MAI Playground וב-Microsoft Foundry — לפי הצהרת הספק, גישה בהזמנה בלבד, טרם פורסם מחירון

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

מה זה MAI-Image-2.6

MAI-Image-2.6 הוא הדגם החדש ביותר בקו ייצור התמונות הפנימי של מיקרוסופט, שנבנה תחת Microsoft AI של מוסטפא סולימאן. המשפחה התקדמה מהר: MAI-Image-1 היה הבסיס, MAI-Image-2 (מרץ 2026) סיפק את הקפיצה בריאליזם הצילומי ובעיבוד הטקסט, MAI-Image-2.5 (יוני 2026) הוסיף פלט ועריכה ברמה מקצועית והפך למנוע בתוך Bing Image Creator, PowerPoint ו-OneDrive, MAI-Image-2.5-Pro (יולי 2026) הוסיף שכבת פרימיום של 8K — וכעת 2.6 מגיע כשש שבועות לאחר קודמו.

הקצב חשוב לא פחות מהמודל. מיקרוסופט משחררת שיפורי תמונה במחזור של שישה עד שמונה שבועות, קרוב יותר לאופן שבו מעבדות החזית משחררות מודלי טקסט מאשר לאופן שבו שוק התמונות נע היסטורית. הופעת בכורה במקום 2 ב-Arena בעת ההשקה, ומקום 3 בדירוג העריכה שבוע לאחר מכן, זה מה שהקצב הזה נראה כמו כשהוא מצטבר.

תוצאות לוח המובילים, קראו בעיון

ארנה (המותג המחודש LMArena) מדרגת מודלי תמונה לפי העדפה אנושית עיוורת: מצביעים רואים שתי תמונות שנוצרו מאותה הנחיה ובוחרים את החזקה יותר. Artificial Analysis מריצה את אותו סוג של זירת העדפה עיוורת בלתי תלויה עם דירוגי Elo משלה. שתיהן מדדים בלתי תלויים של מה שאנשים באמת מעדיפים, ולא מדדים שמנוהלים על ידי ספקים — לכן כניסה במקום השני נושאת משקל אמיתי, ולכן שתי לוחות נפרדים שמסכימים על אותו מודל חשובים יותר מכל מספר בנפרד. זו גם הסיבה שהמספרים דורשים הסתייגויות: הציון 1,336 של ארנה הוא ראשוני, מבוסס על כ-3,500 קולות לעומת יותר מ-70,000 עבור המודל במקום הראשון, והערך מסומן כ"תצוגה מקדימה". Elo בשלבי הצבעה מוקדמים משתנה; התייחסו לכיוון כמוצק ולציון המדויק כזמני.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

היכן שהרווחים מרוכזים מעניין יותר מהמספר הראשי. ארנה דירגה את MAI-Image-2.6 במקום הראשון בהדמיה ומודלים תלת-ממדיים (עלייה מהמקום השישי) ובמקום השני בקריקטורה/אנימה/פנטזיה (עלייה מהמקום השמיני), בעיצוב מוצר, מיתוג ועיצוב מסחרי (עלייה מהמקום השביעי), בעיבוד טקסט (עלייה מהמקום השמיני, עם רווח של +91 Elo), ובאמנות (עלייה מהמקום הרביעי). מיקרוסופט אומרת שהיא השתפרה בכל קטגוריה שנמדדה. הפיזור הזה — עיצוב מסחרי, תלת-ממד, טקסט ואמנות — הוא החותם של מודל תמונה לשימוש כללי ולא של מומחיות בטריק אחד.

לאחר מכן הגיעו עוד שתי נקודות נתונים. לוח עריכת התמונות של Arena — קטגוריית "Single Image Edit" — מציב את אותו build בשם mai-image-2.6-preview במקום השלישי עם 1,420 נקודות, עלייה מהמקום החמישי, ו-19 נקודות לפני MAI-Image-2.5, כאשר עיבוד טקסט הוא השיפור הגדול ביותר (+43 נקודות). ב-25 באוגוסט, Artificial Analysis הרחיקה לכת: לוח מובילי עריכת התמונות שלה מציב את ה-build המקדים במקום הראשון, ולוקח את הפסגה מ-MAI-Image-2.5-Pro של מיקרוסופט עצמה (שבעבר היה במקום הראשון עם 1,272 נקודות Elo), וממקם אותו לפני Reve 2.1 ו-GPT Image 2 של OpenAI — כעת מיקרוסופט מחזיקה בשני המקומות הראשונים בלוח זה. ראש חטיבת הבינה המלאכותית של מיקרוסופט, מוסטפה סולימאן, כינה את 2.6 'מודל עריכת התמונות הטוב ביותר ב-AA' ואמר שמיקרוסופט מחזיקה בשלושה מתוך חמשת המקומות הראשונים — זו מסגור של ספק; הדירוגים הבסיסיים הם של Artificial Analysis עצמה. ציון עריכת התמונות של AA עבור ה-build המקדים עצמו טרם פורסם, ושני לוחות הדירוג מוקדמים ובעלי מספר הצבעות נמוך, כך שיש להתייחס לכיוון כמוצק ולמספרים המדויקים כזמניים.

מה בעצם חדש (דיווח ספק)

באשר ליכולות, התיאורים של מיקרוסופט עבור MAI-Image-2.6 הם:

• עיבוד טקסט חזק יותר, פורטרטים ותמונות תלת-ממד

• פלט מסחרי ופוטוריאליסטי מעודן יותר במקרי שימוש של מוצר, מיתוג וקולנוע

• עבודה עם מספר תמונות ייחוס ביצירה אחת

• עיגון עשיר יותר — היצמדות טובה יותר לפרטים שבהנחיה

• שליטה רבה יותר על חשיבה, פורמט ורזולוציה

כל אחד מאלה הוא דיווח של הספק וטרם שוחזר באופן בלתי תלוי. העדות הבלתי תלויה היא צמד לוחות התוצאות: מקום 2 בטקסט-לתמונה גם ב-Arena וגם ב-Artificial Analysis, מקום 3 בלוח העריכה של Arena, ומקום 1 בלוח העריכה של Artificial Analysis — כולם ראשוניים. עד ש-MAI-Image-2.6 יהיה זמין באופן נרחב וצדדים שלישיים יוכלו להריץ הערכות מבוקרות, יש להתייחס לרשימת היכולות כאל טענת מיקרוסופט ולשני לוחות התוצאות כאל האות הפעיל.

מתי אפשר באמת להשתמש בזה

MAI-Image-2.6 עבר השבוע מ-"Arena בלבד" ל-"Arena בתוספת תצוגה מקדימה רשמית". ב-19 באוגוסט הודיעה מיקרוסופט שהמודל זמין בתצוגה מקדימה פרטית ב-MAI Playground וב-Microsoft Foundry. זוהי הצהרת היצרן עצמו, והגישה לתצוגה המקדימה מוגבלת להזמנות ולא להרשמה ציבורית — ולכן עדיין אין מחירון ואין API בתשלום לפי אסימון. הסימן המעשי שכדאי לעקוב אחריו: כאשר MAI-Image-2.5 הפך לברירת המחדל ב-Bing Image Creator והגיע ל-PowerPoint ול-OneDrive, זה אומר שמיקרוסופט ראתה בו בטוח לשימוש בייצור. פריסה דומה של גרסת 2.6 בפלטפורמות האלה — או הסרת התווית "תצוגה מקדימה" — תהיה האות לכך שהיא מוכנה לעומסי עבודה בייצור.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

מה זה עשוי לעלות

לא פורסם תמחור עבור 2.6 — לתצוגה המקדימה הפרטית אין מחירון. נקודת ההתייחסות היא שאר משפחת המוצרים, כולם מדווחים על ידי הספקים:

• MAI-Image-2.5: $5 למיליון טוקנים של קלט טקסט, $8 לקלט תמונה, $47 לפלט תמונה

• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — דרגת הנפח הגבוה

• MAI-Image-2.5-Pro (יולי 2026): $5 / $8 / $106 — פלט 8K, דיוק רינדור טקסט של 96.8%

זהו פער של פי חמישה בין תעריפי הפלט של תמונות הזולים והיקרים ביותר שמיקרוסופט כבר מוכרת, כך שעלות הייצור של 2.6 תהיה תלויה באיזו דרגה הוא ימוקם. בתעריף הפלט של 2.5, שעומד על 47 דולר למיליון, תמונה שצורכת בערך אלף אסימוני פלט מגיעה לכמעט חמישה סנטים — אבל מיקרוסופט לא מפרסמת ספירת אסימונים לתמונה, אז התייחסו לזה כחשבון, לא כציטוט.

התמחור הוא גם המקום שבו שכבת ניתוב מרוויחה את מקומה ברגע שהמודל מגיע ל-API ציבורי. ב-OrcaRouter, כל מה שמיקרוסופט גובה מועבר הלאה ללא תוית רווח של 0% — מחיר המחירון של הספק, ללא תוספות — כך שהנחת השקה או הפחתת מחיר מאוחרת יותר נוחתת בצד שלך של החשבון באותו יום שבו היא מוכרזת. אין צורך במשא ומתן חוזר ובחוזה שני; המודל מופיע על אותו מפתח כמו כל השאר.

לאן זה מוביל את המירוץ בין מודלי התמונה

בראש טבלת הטקסט-לתמונה של Arena כרגע: GPT Image 2 (Medium) עם 1,381, MAI-Image-2.6 עם 1,336, Grok Imagine Image 2.0 עם 1,316, Reve 2.1 עם 1,302, ו-Muse Image של Meta עם 1,282. חמישה מודלים בטווח של כ-100 נקודות Elo בראש. Artificial Analysis מגיע לאותה מסקנה כוללת — מקום 2 בטקסט-לתמונה, אחרי GPT Image 2 בלבד — ומוסיף פירוט קטגורי: גרסת התצוגה המקדימה (preview) מקבלת מקום ראשון ב-5 מתוך 19 קטגוריות הטקסט-לתמונה שלה (Material, Knowledge, Frontier, Retail & Ecommerce, ו-Marketing & Advertising), כאשר GPT Image 2 מוביל בכל שאר הקטגוריות. שני לוחות דירוג עצמאיים המבוססים על העדפות שמצביעים לאותו כיוון הם האינדיקציה החזקה ביותר שאפשר לקבל על מודל כה צעיר. פער האיכות שנהג להפריד בין המוביל לשאר הצמרת הצטמצם עד כדי כך ש"מודל התמונות הטוב ביותר" כבר אינו שאלה שימושית — עריכה, דיוק בהתאמה להנחיה, מהירות ומחיר הם השאלות.

ההימור של מיקרוסופט רחב יותר מכל כתר יחיד בטבלת הדירוג: מחסנית מודלים פנימית המכסה תמונה, קול, קוד והגיון, המופצת דרך Copilot, Bing ו-Office. דירוגי ה-Arena הם הוכחת העבודה; ההפצה היא המוצר בפועל.

איך לנסות את זה בלי לסכן את הייצור

התצוגה המקדימה של Arena היא חינמית — נסו אותה עוד היום אם אתם רוצים את האות הגולמי. אם יש לכם גישה לתצוגה מקדימה פרטית, נקודות הכניסה של MAI Playground ו-Microsoft Foundry מאפשרות לכם להריץ עומסי עבודה אמיתיים לפני שאתם מתחייבים. עבור כל השאר, הדרך ההגיונית לאמץ מודל חדש לגמרי עם ציון "מקדמי" היא לנתב אליו נתח תעבורה ולהשאיר את המודל המוכח שלכם כגיבוי. זה בדיוק מצב הכשל ששכבת ניתוב נועדה לו: ב-OrcaRouter הייתם מפנים נקודת קצה אחת אל MAI-Image-2.6 ברגע שהוא יתארח אצל ספק מעלה, ומאפשרים ל-failover אוטומטי לתפוס את מקרי הקצה שדירוג לוח מובילים עם מעט קולות לא יכול לראות. מפתח API אחד, 200+ דגמים, מחירי ספקים ללא תוספת.

מה לצפות בהמשך

האם הדירוג מספר 1 לעריכה ב-Artificial Analysis והמקום השלישי ב-Arena יחזיקו מעמד עם הצטברות הקולות — שני הלוחות מוקדמים ובעלי מספר קולות נמוך.

• מחיר ה-API הציבורי ובאיזו דרגה הוא ימוקם — לתצוגה המקדימה הפרטית עדיין אין כרטיס תעריפים.

• האם Bing Image Creator ו-Copilot יעבירו את ברירת המחדל שלהם מ-2.5 ל-2.6

• בנצ'מרקים עצמאיים ברגע שה-API ייפתח

האם תווית ה"preview" תוסר — הסימן שמיקרוסופט מספיק בטוחה בעצמה כדי למכור אותו

שאלות נפוצות

מתי אני יכול/ה בעצם להשתמש ב-MAI-Image-2.6?

כרגע דרך Arena, וזה בחינם. מאז 19 באוגוסט, זה זמין גם בתצוגה מקדימה פרטית ב-MAI Playground וב-Microsoft Foundry — לפי ההודעה הרשמית של מיקרוסופט, כך שהגישה מותנית בהזמנה ולא בהרשמה פומבית. עדיין אין API ציבורי בתשלום לפי אסימון ולא פורסם מחיר רשמי.

עד כמה חזקה תוצאת עריכת התמונה?

בלוח המובילים לעריכת תמונות של Artificial Analysis, MAI-Image-2.6-Preview מדורג ראשון, לפני MAI-Image-2.5-Pro, Reve 2.1 ו-GPT Image 2 — מיקרוסופט מחזיקה בשני המקומות הראשונים. בלוח "עריכת תמונה בודדת" של Arena הוא מדורג שלישי עם 1,420 נקודות, לעומת מקום חמישי בעבר. שתי התוצאות הן העדפות עיוורות בלתי תלויות, אך מוקדמות עם מעט הצבעות, וציוני העריכה של AA לגרסת התצוגה המקדימה עוד לא פורסמו.

כמה זה קרוב ל-GPT Image 2 Medium?

45 Elo בתמונת המצב הנוכחית של Arena לטקסט-לתמונה — קרוב מספיק כך שההפרש בין המקום השני לראשון נמצא בטווח שזרימת הצבעות יכולה להזיז, וחמשת הדגמים המובילים כולם בטווח של בערך 100 Elo.

האם דירוגי הארנה אמינים?

הן תוצאות עצמאיות של העדפות אנושיות עיוורות, וזה בדיוק מה שהופך אותן למשמעותיות — אבל שתיהן ראשוניות (כ-3,500 הצבעות בלוח הטקסט-לתמונה) ומצורפות לגרסת תצוגה מקדימה. סמכו על הכיוון, לא על הספרות.

בשורה התחתונה: MAI-Image-2.6-Preview הוא מודל התמונות הראשון של מיקרוסופט שבאמת ראוי למקום בשיחת החזית — והוא הגיע לשם מהר: מקום 2 בלוח text-to-image של Arena כבר בהשקה, מקום 1 בעריכת תמונות ב-Artificial Analysis עד 25 באוגוסט, ותצוגה מקדימה פרטית בפלטפורמות של מיקרוסופט עצמה לפני כל API ציבורי. שני לוחות בלתי תלויים מתכנסים כעת לאותה מסקנה. אם המחיר הסופי יגיע לאזור שכבות ה-Flash, זה יהפוך לאחד מתמהילי הערך המעניינים ביותר ביצירת תמונות השנה. דירוגי העריכה והתצוגה המקדימה עונים על "האם זה אמיתי." ה-API הציבורי והמחיר שלו יענו על "האם כדאי לבנות על זה."