
MAI-Image-2.6-Preview: อันดับ 1 ด้านการแก้ไขภาพ, อันดับ 2 ด้านการสร้างภาพจากข้อความ
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Microsoft's MAI-Image-2.6-Preview ไม่ใช่แค่รายการในลีดเดอร์บอร์ด Arena ที่คุณเข้าไม่ถึงอีกต่อไป — ตอนนี้มันกลายเป็นผู้นำลีดเดอร์บอร์ดอิสระแล้ว เมื่อวันที่ 25 สิงหาคม Artificial Analysis องค์กรวัดประสิทธิภาพอิสระ จัดอันดับพรีวิวบิลด์เดียวกันนี้เป็นอันดับ 1 ในลีดเดอร์บอร์ดการแก้ไขภาพ และอันดับ 2 ในข้อความสร้างภาพ โดยตำแหน่งที่ 1 ด้านการแก้ไขทำให้มันอยู่เหนือ MAI-Image-2.5-Pro ของ Microsoft เอง (ผู้ชนะคนก่อน), Reve 2.1 และ GPT Image 2 ของ OpenAI ทำให้ Microsoft ครองสองอันดับแรกบนกระดานนั้น โมเดลดังกล่าวเข้าสู่พรีวิวส่วนตัวบน MAI Playground และ Microsoft Foundry เมื่อวันที่ 19 สิงหาคม ตามประกาศของ Microsoft — ต้องได้รับคำเชิญ ยังไม่มี API สาธารณะ และยังไม่มีราคา
สิ่งที่น่าทึ่งคือเส้นทางการพัฒนา ไม่ใช่แค่อันดับที่ได้ โมเดลที่ไต่ขึ้นไปสูงสุดที่อันดับ 2 บนกระดาน text-to-image ของ Arena มีชื่อตรงตัวว่า "mai-image-2.6-preview" โดยในข้อมูล ณ ขณะนั้นมีคะแนนโหวตประมาณ 3,500 คะแนน และไต่ขึ้นมา 8 อันดับ ด้วยค่า Elo ที่เพิ่มขึ้น +79 เมื่อเทียบกับ MAI-Image-2.5 ในขั้นตอนเดียว ตั้งแต่นั้นมา ภาพรวมก็ชัดเจนขึ้นอย่างรวดเร็ว: การเข้าถึงแบบ private-preview เปิดให้ใช้งานบน MAI Playground และ Microsoft Foundry เมื่อวันที่ 19 สิงหาคม กระดาน image-editing ของ Arena เลื่อนบิลด์นี้ขึ้นไปอยู่อันดับที่ 3 และตอนนี้ Artificial Analysis จัดให้อยู่อันดับที่ 1 ในด้านการแก้ไขภาพ และอันดับที่ 2 ในด้าน text-to-image นี่ถือเป็นสัญญาณอิสระที่แข็งแกร่งที่สุดเท่าที่เคยมีมาว่าความพยายามพัฒนาระบบภาพภายในของ Microsoft ได้ลดช่องว่างกับ OpenAI ลงแล้ว — และ public API ก็ยังไม่เปิดให้ใช้งานโดยทั่วไป
ตัวเลขสำคัญ
• อันดับ Arena text-to-image: อันดับ 2 — คะแนน 1,336±11, เบื้องต้น, ~3,488 โหวต
• ช่องว่างกับอันดับ 1 (GPT Image 2 Medium): 45 Elo
• นำหน้าอันดับ 3 (Grok Imagine Image 2.0): 20 Elo
• แซงหน้า MAI-Image-2.5: +79 Elo โดยรวม, +91 Elo ในการเรนเดอร์ข้อความ
• ตำแหน่งของรุ่นก่อน: MAI-Image-2.5 อยู่อันดับที่ 10 (1,256)
• อันดับการแก้ไขภาพ: อันดับ 3 ในการจัดอันดับ "Single Image Edit" ของ Arena — 1,420 คะแนน เพิ่มขึ้นจากอันดับ 5
• การจัดอันดับการแก้ไขภาพของ Artificial Analysis: อันดับ 1 — เหนือกว่า MAI-Image-2.5-Pro (อันดับ 1 ก่อนหน้า), Reve 2.1 และ GPT Image 2; Microsoft ครองสองอันดับแรก
• อันดับ text-to-image ของ Artificial Analysis: อันดับ 2 — เป็นรองเพียง GPT Image 2; เป็นที่หนึ่งใน 5 จาก 19 หมวดหมู่
• ตัวอย่างส่วนตัว:ประกาศเมื่อวันที่ 19 ส.ค. บน MAI Playground และ Microsoft Foundry — ตามที่ผู้จำหน่ายระบุ, จำกัดเฉพาะผู้ได้รับคำเชิญ, ยังไม่มีการประกาศราคา

MAI-Image-2.6 คืออะไร
MAI-Image-2.6 เป็นโมเดลล่าสุดในสายการสร้างภาพภายในองค์กรของ Microsoft ซึ่งพัฒนาขึ้นภายใต้ Microsoft AI ของ Mustafa Suleyman ตระกูลนี้พัฒนาไปอย่างรวดเร็ว: MAI-Image-1 คือรากฐาน MAI-Image-2 (มีนาคม 2026) สร้างการก้าวกระโดดในด้านความสมจริงเหมือนภาพถ่ายและการเรนเดอร์ข้อความ MAI-Image-2.5 (มิถุนายน 2026) เพิ่มการสร้างภาพและการแก้ไขภาพระดับมืออาชีพ และกลายเป็นเอนจินภายใน Bing Image Creator, PowerPoint และ OneDrive MAI-Image-2.5-Pro (กรกฎาคม 2026) เพิ่มระดับพรีเมียม 8K — และตอนนี้ 2.6 เปิดตัวตามหลังรุ่นก่อนหน้าเพียงประมาณหกสัปดาห์
จังหวะการอัปเดตสำคัญพอ ๆ กับตัวโมเดลเอง Microsoft กำลังปล่อยการปรับปรุงด้านภาพในรอบหกถึงแปดสัปดาห์ ซึ่งใกล้เคียงกับวิธีที่แล็บชั้นแนวหน้าปล่อยโมเดลข้อความมากกว่าที่ตลาดภาพเคยเคลื่อนไหวในอดีต การเปิดตัวอันดับ No. 2 ใน Arena ตั้งแต่เปิดตัว และอันดับ No. 3 ด้านการแก้ไขในอีกหนึ่งสัปดาห์ต่อมา คือสิ่งที่จังหวะแบบนี้ให้ผลเมื่อมันทบต้น
ผลลัพธ์กระดานผู้นำ อ่านอย่างละเอียด
แอรีนา (LMArena ที่ถูกเปลี่ยนชื่อใหม่) จัดอันดับโมเดลสร้างภาพด้วยวิธีเปรียบเทียบแบบไม่เห็นเจ้าของผลงาน: ผู้โหวตเห็นภาพสองภาพที่สร้างจากพรอมป์ต์เดียวกัน แล้วเลือกภาพที่แข็งแกร่งกว่า Artificial Analysis ก็ดำเนินการสนามประลองอิสระแบบเดียวกัน โดยใช้การจัดอันดับ Elo ของตัวเอง ทั้งสองเป็นการวัดอย่างเป็นอิสระว่าผู้คนชอบอะไรจริง ๆ มากกว่าเกณฑ์ที่ผู้ขายตั้งขึ้น — ซึ่งเป็นเหตุผลว่าทำไมการเปิดตัวในอันดับ 2 จึงมีน้ำหนักจริง และเหตุใดที่กระดานจัดอันดับสองแห่งที่แยกจากกันเห็นตรงกันในโมเดลเดียวกัน จึงสำคัญกว่าตัวเลขใดตัวเลขหนึ่งเพียงลำพัง และนี่คือเหตุผลที่ตัวเลขต้องมีข้อแม้: คะแนน 1,336 ของแอรีนาเป็นเพียงข้อมูลเบื้องต้น โดยอิงจากโหวตประมาณ 3,500 เสียง เทียบกับกว่า 70,000 เสียงของโมเดลที่อยู่อันดับหนึ่ง และรายการถูกระบุสถานะเป็น "preview" คะแนน Elo ในช่วงแรกมีการขยับ ให้ถือว่าทิศทางนั้นมั่นคง และตัวเลขที่แน่นอนเป็นเพียงการประมาณชั่วคราว

จุดที่การเพิ่มขึ้นกระจุกตัวอยู่นั้นน่าสนใจกว่าตัวเลขพาดหัว Arena จัดอันดับ MAI-Image-2.6 เป็นที่หนึ่งในด้านการสร้างภาพและโมเดล 3 มิติ (ขึ้นจากที่หก) และเป็นที่สองในด้านการ์ตูน/อนิเมะ/แฟนตาซี (ขึ้นจากที่แปด) ด้านผลิตภัณฑ์และแบรนด์และการออกแบบเชิงพาณิชย์ (ขึ้นจากที่เจ็ด) การเรนเดอร์ข้อความ (ขึ้นจากที่แปด ด้วยการเพิ่มคะแนน Elo +91) และศิลปะ (ขึ้นจากที่สี่) Microsoft กล่าวว่ามันพัฒนาขึ้นในทุกหมวดหมู่ที่วัดได้ การกระจายตัวเช่นนี้ — การออกแบบเชิงพาณิชย์ 3 มิติ ข้อความ และศิลปะ — เป็นเครื่องหมายของโมเดลภาพเอนกประสงค์มากกว่าจะเป็นความเชี่ยวชาญเฉพาะทางเพียงอย่างเดียว
จากนั้นก็มีข้อมูลเพิ่มเติมมาอีกสองรายการ ตารางจัดอันดับการแก้ไขภาพของ Arena — หมวดหมู่ "Single Image Edit" — จัดอันดับบิลด์ mai-image-2.6-preview ตัวเดียวกันที่อันดับ 3 ด้วยคะแนน 1,420 คะแนน ขึ้นมาจากอันดับ 5 และนำหน้า MAI-Image-2.5 อยู่ 19 คะแนน โดยการเรนเดอร์ข้อความเป็นการเพิ่มขึ้นที่มากที่สุดในจุดเดียว (+43 คะแนน) เมื่อวันที่ 25 สิงหาคม Artificial Analysis ไปไกลกว่านั้น: ตารางจัดอันดับการแก้ไขภาพ (Image Editing Leaderboard) ของพวกเขาวางบิลด์พรีวิวไว้ที่อันดับ 1 แย่งตำแหน่งสูงสุดจาก MAI-Image-2.5-Pro ของไมโครซอฟต์เอง (ซึ่งก่อนหน้านี้อยู่อันดับ 1 ด้วย 1,272 Elo) และอยู่เหนือ Reve 2.1 และ GPT Image 2 ของ OpenAI — ตอนนี้ไมโครซอฟต์ครองสองอันดับแรกในตารางนั้นแล้ว Mustafa Suleyman หัวหน้าฝ่าย AI ของไมโครซอฟต์เรียก 2.6 ว่า "โมเดลแก้ไขภาพที่ดีที่สุดบน AA" และกล่าวว่าไมโครซอฟต์ครองสามในห้าอันดับแรก — นั่นคือการพูดแบบผู้ขาย อันดับจริงๆ แล้วเป็นของ Artificial Analysis เอง คะแนนการแก้ไขภาพ AA สำหรับบิลด์พรีวิวนั้นยังไม่ได้เผยแพร่ และตารางทั้งสองยังใหม่อยู่และมีคะแนนโหวตน้อย ดังนั้นให้ถือว่าแนวโน้มนั้นชัดเจน แต่ตัวเลขที่แน่นอนยังเป็นเพียงชั่วคราว
สิ่งใหม่จริงๆ (รายงานโดยผู้จำหน่าย)
ในแง่ของความสามารถ คำอธิบายของ Microsoft เองสำหรับ MAI-Image-2.6 คือ:
• การเรนเดอร์ข้อความ ภาพบุคคล และภาพ 3 มิติที่ดียิ่งขึ้น
• ผลลัพธ์เชิงพาณิชย์และเสมือนจริงที่ดูประณีตยิ่งขึ้น ครอบคลุมการใช้งานด้านผลิตภัณฑ์ การสร้างแบรนด์ และงานภาพยนตร์
• ทำงานกับภาพอ้างอิงหลายภาพในการสร้างเพียงครั้งเดียว
• การยึดโยงข้อมูลที่สมบูรณ์ยิ่งขึ้น — การปฏิบัติตามรายละเอียดเฉพาะในพรอมป์ได้ดียิ่งขึ้น
• ควบคุมการใช้เหตุผล รูปแบบ และความละเอียดได้มากขึ้น
{{1}}ทั้งหมดที่กล่าวมานั้นเป็นข้อมูลที่รายงานโดยผู้จำหน่ายและยังไม่มีการยืนยันซ้ำโดยอิสระ หลักฐานอิสระที่ได้คือคู่ตารางจัดอันดับ: อันดับ 2 ในด้านข้อความสูรูปภาพทั้งบน Arena และ Artificial Analysis, อันดับ 3 บนกระดานแก้ไขภาพของ Arena, และอันดับ 1 บนกระดานแก้ไขภาพของ Artificial Analysis{{/1}} —{{2}}ทั้งหมดเป็นข้อมูลเบื้องต้น จนกว่า MAI-Image-2.6 จะเปิดให้ใช้งานอย่างแพร่หลายและบุคคลที่สามสามารถดำเนินการประเมินผลแบบควบคุมได้ ให้ถือว่ารายการความสามารถนั้นเป็นคำกล่าวอ้างของ Microsoft และตารางจัดอันดับทั้งสองเป็นสัญญาณที่ใช้งานได้จริง{{/2}}
เมื่อคุณสามารถใช้งานมันได้จริงๆ
MAI-Image-2.6 เปลี่ยนจาก "Arena only" เป็น "Arena plus an official preview" ในสัปดาห์นี้ เมื่อวันที่ 19 สิงหาคม Microsoft ประกาศว่าโมเดลดังกล่าวพร้อมใช้งานในรุ่นพรีวิวส่วนตัวบน MAI Playground และ Microsoft Foundry นั่นคือคำกล่าวของตัวผู้จำหน่ายเอง และการเข้าถึงพรีวิวนั้นจำกัดเฉพาะผู้ได้รับเชิญ มิใช่การลงทะเบียนสาธารณะ — ดังนั้นจึงยังไม่มีบัตรราคาและไม่มี API แบบจ่ายต่อโทเคน สัญญาณที่ใช้งานได้จริงที่ต้องสังเกต: เมื่อ MAI-Image-2.5 กลายเป็นค่าเริ่มต้นใน Bing Image Creator และขยายไปยัง PowerPoint และ OneDrive นั่นหมายความว่า Microsoft ถือว่ามันปลอดภัยสำหรับการใช้งานจริง การเปิดตัว 2.6 ในลักษณะเดียวกันสู่แพลตฟอร์มเหล่านั้น — หรือการถอดป้าย "preview" ออก — จะเป็นสัญญาณว่ามันพร้อมสำหรับงานผลิตจริง

ค่าใช้จ่ายที่อาจเกิดขึ้น
ยังไม่มีการประกาศราคาสำหรับ 2.6 — การแสดงตัวอย่างแบบส่วนตัวไม่มีตารางอัตราค่าบริการ จุดอ้างอิงคือผลิตภัณฑ์อื่นๆ ในตระกูลเดียวกัน ซึ่งทั้งหมดเป็นราคาที่ผู้จำหน่ายรายงาน:
• MAI-Image-2.5: $5 ต่อล้านโทเคนอินพุตข้อความ, $8 อินพุตรูปภาพ, $47 เอาต์พุตรูปภาพ
• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — ระดับปริมาณสูง
• MAI-Image-2.5-Pro (กรกฎาคม 2026): $5 / $8 / $106 — เอาต์พุต 8K, ความแม่นยำในการเรนเดอร์ข้อความ 96.8%
นั่นคือช่องว่างห้าเท่าระหว่างอัตราการส่งออกภาพที่ถูกที่สุดและแพงที่สุดที่ Microsoft ขายอยู่แล้ว ดังนั้นต้นทุนการผลิตของ 2.6 จะขึ้นอยู่กับระดับชั้นที่มันถูกจัดวาง ที่อัตราการส่งออก $47 ต่อล้านของ 2.5 รูปภาพหนึ่งรูปที่ใช้โทเคนเอาต์พุตประมาณหนึ่งพันตัวจะมีราคาใกล้เคียงห้าเซนต์ — แต่ Microsoft ไม่ได้เผยแพร่จำนวนโทเคนต่อภาพ ดังนั้นจงถือว่านั่นเป็นเลขคณิต ไม่ใช่ราคาเสนอ
การกำหนดราคาคือจุดที่เลเยอร์การจัดเส้นทางพิสูจน์คุณค่าของตัวเองเมื่อโมเดลเข้าสู่ API สาธารณะ บน OrcaRouter สิ่งที่ Microsoft คิดค่าบริการจะถูกส่งผ่านโดยไม่มีการบวกเพิ่ม 0% — ราคารายการของผู้ให้บริการ ไม่มีการเพิ่มเติมใดๆ — ดังนั้นส่วนลดเปิดตัวหรือการลดราคาในภายหลังจะไปอยู่ในบิลฝั่งคุณในวันเดียวกับที่ประกาศ ไม่ต้องเจรจาใหม่และไม่มีสัญญาฉบับที่สอง โมเดลจะปรากฏบนคีย์เดียวกันกับรายการอื่นๆ ทั้งหมด
สิ่งนี้ทำให้การแข่งขันโมเดลภาพไปอยู่จุดใด
ตอนนี้ด้านบนของกระดานจัดอันดับ text-to-image ของ Arena ได้แก่ GPT Image 2 (Medium) ที่ 1,381, MAI-Image-2.6 ที่ 1,336, Grok Imagine Image 2.0 ที่ 1,316, Reve 2.1 ที่ 1,302 และ Muse Image ของ Meta ที่ 1,282 โดยมีห้าโมเดลอยู่ในช่วงประมาณ 100 Elo ที่ด้านบน Artificial Analysis ให้ข้อสรุปโดยรวมเดียวกัน — เป็นอันดับ 2 ในด้าน text-to-image ตามหลัง GPT Image 2 เพียงตัวเดียว — และเพิ่มรายละเอียดรายหมวดหมู่: บิลด์พรีวิวได้ที่หนึ่งใน 5 จาก 19 หมวดหมู่ text-to-image (Material, Knowledge, Frontier, Retail & Ecommerce และ Marketing & Advertising) ขณะที่ GPT Image 2 เป็นผู้นำในหมวดอื่น ๆ ทั้งหมด กระดานจัดอันดับอิงความชอบสองแห่งที่เป็นอิสระต่อกันชี้ไปในทิศทางเดียวกัน ถือเป็นสัญญาณที่หนักแน่นที่สุดเท่าที่จะได้จากโมเดลอายุน้อยขนาดนี้ ช่องว่างด้านคุณภาพที่เคยแยกผู้นำออกจากกลุ่มที่เหลือถูกบีบให้แคบลงจนถึงจุดที่คำถามว่า "โมเดลภาพที่ดีที่สุด" ไม่ใช่คำถามที่มีประโยชน์อีกต่อไป — แต่คำถามที่มีประโยชน์คือเรื่องการแก้ไขภาพ การยึดโยงกับคำสั่ง ความเร็ว และราคา
การเดิมพันของ Microsoft กว้างกว่าการครองตำแหน่งสูงสุดบนลีดเดอร์บอร์ดใดๆ: ชุดโมเดลภายในองค์กรที่ครอบคลุมทั้งภาพ เสียง โค้ด และการให้เหตุผล กระจายผ่าน Copilot, Bing และ Office อันดับใน Arena คือหลักฐานการทำงาน; การกระจายคือผลิตภัณฑ์ที่แท้จริง
วิธีทดลองใช้โดยไม่ต้องเสี่ยงกับโปรดักชัน
การแสดงตัวอย่าง Arena ใช้งานฟรี — ลองสร้างงานกับมันได้ตั้งแต่วันนี้หากคุณต้องการสัญญาณดิบ ถ้าคุณมีสิทธิ์เข้าถึงตัวอย่างแบบส่วนตัว จุดเข้าใช้งาน MAI Playground และ Microsoft Foundry จะช่วยให้คุณรันเวิร์กโหลดจริงก่อนที่จะตัดสินใจ สำหรับคนอื่น ๆ วิธีที่สมเหตุสมผลในการนำโมเดลใหม่เอี่ยมที่มีคะแนน "เบื้องต้น" มาใช้คือการจัดเส้นทางทราฟิกส่วนหนึ่งไปยังโมเดลนั้น แล้วเก็บโมเดลที่พิสูจน์แล้วของคุณไว้เป็นตัวสำรอง นี่คือโหมดความล้มเหลวที่เลเยอร์การจัดเส้นทางถูกสร้างขึ้นมาเพื่อรองรับโดยเฉพาะ: บน OrcaRouter คุณจะชี้เอนด์พอยต์หนึ่งไปที่ MAI-Image-2.6 ทันทีที่มันถูกโฮสต์บนผู้ให้บริการต้นทาง และปล่อยให้การสลับตัวสำรองอัตโนมัติจัดการกับกรณีขอบที่คะแนนลีดเดอร์บอร์ดซึ่งมีโหวตต่ำมองไม่เห็น คีย์ API หนึ่งชุด โมเดล 200+ รายการ ราคาผู้ให้บริการส่งผ่านมาตรง ๆ
สิ่งที่ควรดูต่อไป
• ไม่ว่าอันดับการแก้ไขอันดับ 1 ของ Artificial Analysis และอันดับ 3 ของ Arena จะยังคงอยู่หรือไม่เมื่อคะแนนเสียงสะสม — ทั้งสองกระดานยังอยู่ในช่วงแรกและมีคะแนนเสียงน้อย
• ราคาของ API สาธารณะและระดับชั้นที่จัดอยู่ — การแสดงตัวอย่างแบบส่วนตัวยังไม่มีอัตราค่าบริการ
• ว่า Bing Image Creator และ Copilot จะเปลี่ยนค่าเริ่มต้นจาก 2.5 เป็น 2.6 หรือไม่
• เกณฑ์มาตรฐานอิสระเมื่อ API เปิดให้ใช้
• ไม่ว่าป้าย "preview" จะถูกถอดออกหรือไม่ — สัญญาณว่า Microsoft มั่นใจพอที่จะวางจำหน่ายมัน
คำถามที่พบบ่อย
เมื่อไหร่ฉันจะใช้ MAI-Image-2.6 ได้จริง?
ตอนนี้ผ่าน Arena ซึ่งไม่มีค่าใช้จ่าย ตั้งแต่วันที่ 19 สิงหาคมเป็นต้นมา ยังอยู่ในช่วง private preview บน MAI Playground และ Microsoft Foundry — ตามประกาศของ Microsoft เอง การเข้าถึงจึงต้องได้รับคำเชิญมากกว่าจะสมัครเปิดให้สาธารณะ ยังไม่มี API แบบสาธารณะที่คิดค่าบริการต่อโทเคน และยังไม่มีการเปิดเผยราคา
ผลลัพธ์การแก้ไขภาพแข็งแกร่งแค่ไหน?
บนกระดานผู้นำการแก้ไขภาพของ Artificial Analysis นั้น MAI-Image-2.6-Preview อยู่อันดับ 1 นำหน้า MAI-Image-2.5-Pro, Reve 2.1 และ GPT Image 2 — Microsoft ครองสองอันดับแรก บนกระดาน "Single Image Edit" ของ Arena อยู่อันดับ 3 ด้วยคะแนน 1,420 จุด ขยับขึ้นจากอันดับ 5 ทั้งคู่เป็นผลลัพธ์จากการโหวตแบบ blind-preference ที่เป็นอิสระแต่ยังมีคะแนนเสียงน้อยและเป็นช่วงแรก และคะแนนการแก้ไขภาพของ AA สำหรับบิลด์พรีวิวยังไม่ได้รับการเผยแพร่
มันใกล้เคียงกับ GPT Image 2 Medium แค่ไหน?
45 Elo ในสแนปช็อตปัจจุบันของ Arena การสร้างภาพจากข้อความ — ใกล้เคียงพอที่ความแตกต่างระหว่างอันดับ 2 / อันดับ 1 อยู่ในช่วงที่กระแสการโหวตสามารถขยับได้ และห้าโมเดลอันดับต้นทั้งหมดอยู่ภายในประมาณ 100 Elo
อันดับ Arena เชื่อถือได้หรือไม่
สิ่งเหล่านี้เป็นผลลัพธ์จากการประเมินความชอบของมนุษย์แบบอิสระและแบบปกปิด ซึ่งนั่นคือสิ่งที่ทำให้มันมีความหมาย — แต่ทั้งคู่ยังเป็นเพียงผลเบื้องต้น (มีคะแนนเสียงประมาณ 3,500 เสียงบนบอร์ด text-to-image) และผูกติดอยู่กับบิลด์ตัวอย่าง จงเชื่อมั่นในทิศทาง ไม่ใช่ตัวเลขทศนิยม
โดยสรุป: MAI-Image-2.6-Preview คือโมเดลสร้างภาพตัวแรกของ Microsoft ที่ได้เข้าไปอยู่ในกลุ่มการสนทนาระดับแนวหน้าอย่างแท้จริง และมันไปถึงจุดนั้นได้อย่างรวดเร็ว: เปิดตัวด้วยอันดับ 2 บนกระดาน text-to-image ของ Arena, อันดับ 1 ในด้านการแก้ไขภาพบน Artificial Analysis ภายในวันที่ 25 สิงหาคม และพรีวิวแบบส่วนตัวบนช่องทางต่างๆ ของ Microsoft เองก่อนที่จะมี API สาธารณะ กระดานจัดอันดับอิสระสองแห่งต่างให้ผลไปในทิศทางเดียวกัน หากราคาท้ายที่สุดออกมาใกล้เคียงระดับ Flash มันจะกลายเป็นหนึ่งในตัวเลือกที่คุ้มค่าที่สุดในวงการสร้างภาพของปีนี้ อันดับด้านการแก้ไขภาพและตัวอย่างการแสดงผลตอบคำถามว่า "มันจริง" ส่วน API สาธารณะและราคาจะตอบว่า "มันคุ้มค่าที่จะสร้างต่อหรือไม่"
