การ์ดหลักสำหรับการเปรียบเทียบ Ideogram 4.5 กับ MAI Image 2.6 Preview พาดหัวอ่านว่า 'Ideogram 4.5 vs MAI Image 2.6 Preview' เหนือบรรทัด 'ผู้เชี่ยวชาญปะทะแพลตฟอร์ม' การ์ดด้านซ้าย หัวข้อ 'Ideogram 4.5' แสดงรายการ 'API สาธารณะตั้งแต่ 30 ก.ย. 2026', 'Elo 1,013, 2,278 ตัวอย่าง' และ '$0.03 ถึง $0.22 ต่อภาพ'; การ์ดด้านขวา หัวข้อ 'MAI Image 2.6 Preview' แสดงรายการ 'พรีวิวสาธารณะใน Microsoft Foundry', 'Elo 1,161, 9,410 ตัวอย่าง' และ 'เอาต์พุตสูงสุด 1.5K' ส่วนท้ายอ่านว่า 'บอร์ดเดียวกัน คณะผู้ประเมินเดียวกัน - Artificial Analysis'
Guides & Insights

Ideogram 4.5 กับ MAI Image 2.6 Preview: ผู้เชี่ยวชาญปะทะแพลตฟอร์ม

ผู้เขียน

Magnus Corvin

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Ideogram 4.5 ถูกสร้างขึ้นมาเพื่อทำสิ่งเดียว นั่นคือแก้ไขภาพซ้ำแล้วซ้ำเล่าโดยไม่ให้คุณภาพลดลง MAI Image 2.6 Preview ซึ่งเป็นโมเดลภาพเรือธงของ Microsoft AI ถูกสร้างมาเพื่อทำทุกอย่างในคราวเดียว — ทั้งสร้างภาพ แก้ไขภาพโดยใช้ภาพอ้างอิงหลายภาพ เชื่อมโยงพรอมป์กับเนื้อหาบนเว็บแบบเรียลไทม์ และเลือกอัตราส่วนภาพได้เอง — และสามารถเรียกใช้งานได้ในพับลิกพรีวิวผ่าน Microsoft Foundry ตั้งแต่วันที่ 4 กันยายน 2026 เมื่อนำมาเปรียบเทียบกัน ตัวเลขชี้ไปทางหนึ่ง แต่รูปร่างของผลิตภัณฑ์กลับชี้ไปอีกทาง Ideogram ชนะในสิ่งที่มันถูกสร้างขึ้นมาเพื่อทำ ส่วน Microsoft ชนะในแทบทุกแกนอื่น รวมถึงแกนที่ตัดสินว่าทีมหนึ่ง ๆ จะนำไปใช้งานจริงได้หรือไม่

แต่ละอย่างคืออะไร

Ideogram 4.5 เปิดตัวเมื่อวันที่ 30 กันยายน 2026 ทั้งในแอปของ Ideogram, API ของตัวเอง, การผสานรวม MCP และคอลเลกชันแอปของบริษัท รวมถึงแพลตฟอร์มพันธมิตร มันสร้างและแก้ไขภาพได้ที่ความเร็วการเรนเดอร์สี่ระดับ ส่งออกที่ความละเอียด 2K โดยกำเนิด และสาธิตการแก้ไขเฉพาะจุดบนต้นฉบับขนาด 4,016 × 6,016 — 24.2 ล้านพิกเซล — โดยไม่ต้องลดขนาด ผู้ขายอ้างว่าการประมวลผลซ้ำหลายรอบจะไม่คลาดเคลื่อนอีกต่อไป: ขอบยังคงอยู่ที่เดิม พื้นผิวคงอยู่ และส่วนที่แก้ไขแล้วสามารถเย็บกลับเข้ากับต้นฉบับได้ ไม่เปิดเผยค่าน้ำหนักโมเดล

MAI Image 2.6 เป็นโมเดลสร้างภาพที่แข็งแกร่งที่สุดของ Microsoft AI และเป็นจุดสูงสุดของสายการพัฒนาที่ไล่เรียงมาจาก MAI-Image-1, MAI-Image-2 ในเดือนมีนาคม 2026, MAI-Image-2.5 ในเดือนมิถุนายน, MAI-Image-2.5-Pro ในเดือนกรกฎาคม และ MAI-Image-2-Efficient ตลอดเส้นทาง โดยเปิดตัวบนกระดานจัดอันดับของ Arena ในเดือนสิงหาคม 2026 ด้วยอันดับที่ 2 และเมื่อวันที่ 4 กันยายน 2026 Microsoft ได้ผลักดันให้มันเข้าสู่พรีวิวสาธารณะใน Microsoft Foundry และ MAI Playground ควบคู่ไปกับ MAI-Image-2.6-Flash ใหม่สำหรับงานประมวลผลปริมาณสูง ความสามารถบนสเปกนั้นกว้างขวาง ทั้งการแก้ไขแบบอ้างอิงหลายภาพซึ่งผสมผสานผู้คน ผลิตภัณฑ์ สไตล์ และฉากจากภาพหลายภาพ การอิงข้อมูลเว็บ อัตราส่วนภาพแบบไดนามิก และเอาต์พุตความละเอียดสูงสุด 1.5K อีกทั้งยังเป็นโมเดลปิด และทำงานบนคลาวด์ของ Microsoft เท่านั้น

A generated two-column comparison scoreboard for Ideogram 4.5 and MAI Image 2.6 Preview. The Ideogram column reads 'Access: public API', 'Price: $0.03 to $0.22', 'Text-to-image: Elo 1,013', 'Editing: rank 23', 'Output: native 2K' and 'Announced: Sep 30, 2026'; the MAI column reads 'Access: invite-gated', 'Price: none published', 'Text-to-image: Elo 1,161', 'Editing: No. 3 on Arena', 'Output: not specified' and 'Announced: Aug 19, 2026'. The footer reads 'Elo figures per Artificial Analysis; access per Microsoft.'

ไลน์อัป

• การเข้าถึง — แอปสาธารณะ การผสานรวม API และ MCP ตั้งแต่ 30 กันยายน 2026 เทียบกับตัวอย่างสาธารณะใน Microsoft Foundry และ MAI Playground ตั้งแต่ 4 กันยายน 2026

• ราคา — $0.03 ต่อภาพที่ระดับ Low, $0.06 ที่ระดับ Medium และ $0.22 ที่ระดับ High บนใบอัตราค่าบริการของผู้ให้บริการ เทียบกับไม่มีใบอัตราค่าบริการที่เผยแพร่บนโพสต์ข่าวของ Microsoft; ข้อมูลราคาอยู่เบื้องหลังการ์ดโมเดล Foundry และบอร์ดจัดอันดับอิสระระบุโมเดลนี้ที่ $38.90 ต่อ 1,000 ภาพ

• คะแนนการสร้างภาพจากข้อความ — อันดับ 34 ที่ 1,013 Elo จาก 2,278 ตัวอย่าง เทียบกับ 1,161 Elo จาก 9,410 ตัวอย่าง เปิดตัวเดือนสิงหาคม 2026

• คะแนนการแก้ไข — อันดับ 23 ที่ 1,064 Elo จาก 2,459 ตัวอย่าง ที่ $220.00 ต่อ 1,000 ภาพ เทียบกับอันดับ 3 ที่ 1,137 Elo จาก 15,684 ตัวอย่าง ที่ $38.90 ต่อ 1,000

• เอาต์พุต — เนทีฟ 2K โดยการแก้ไขแสดงให้เห็นที่ 4,016 × 6,016 เทียบกับความละเอียดสูงสุด 1.5K ตามการ์ดของ Microsoft

• รูปร่างขีดความสามารถ — จุดแข็งที่คมชัดหนึ่งจุด (ความแม่นยำในการแก้ไขแบบหลายรอบ) เทียบกับชุดความสามารถที่กว้าง: การแก้ไขโดยอ้างอิงหลายรายการ, การเชื่อมโยงกับเว็บ, อัตราส่วนภาพแบบไดนามิก และ Flash รุ่นพี่น้องที่เร็วกว่า

A screenshot of the MAI-Image-2.6 model card in Microsoft Foundry, captured in English with a throwaway browser profile, showing the model's publisher, its Preview lifecycle stage, a context window of 32,000 and token limits of 4,096 output, and the pay-as-you-go pricing link. The card does not display a per-image rate.

บอร์ดเดียวกัน แผงเดียวกัน และมันไม่ใกล้เคียงเลย

นี่เป็นการจับคู่ที่พบได้ยากซึ่งมีการเปรียบเทียบที่ชัดเจน เพราะทั้งสองโมเดลอยู่บน Artificial Analysis โดยมีแถวข้อมูลที่วัดโดยคณะผู้ประเมินชุดเดียวกันและฐานคะแนนโหวตเดียวกัน

การสร้างภาพจากข้อความ: MAI-Image-2.6 อยู่ที่ 1,161 Elo จาก 9,410 ตัวอย่าง เทียบกับ Ideogram 4.5 (High) ที่ 1,013 Elo จาก 2,278 ตัวอย่าง นั่นคือ 148 Elo บนจำนวนตัวอย่างที่มากกว่าสี่เท่า และคอลัมน์ราคาระบุ $38.90 เทียบกับ $100.00 ต่อพันภาพ

การแก้ไขภาพ: MAI-Image-2.6 ที่ 1,137 Elo จาก 15,684 ตัวอย่าง เทียบกับ Ideogram 4.5 (High) ที่ 1,064 Elo จาก 2,459 ตัวอย่าง โดยคิดConversionอิสระที่ $38.90 เทียบกับ $220.00 ต่อพัน

โพสต์วันที่ 4 กันยายนของ Microsoft เองอ้างว่าครองตำแหน่งที่ 2 ด้านการสร้างภาพจากข้อความ และที่ 1 ด้านการแก้ไขภาพบนบอร์ดนี้ โดยทั้งคู่ระบุว่า 'ณ วันที่ 4 ก.ย. 2026' เมื่ออ่านในอีกหนึ่งเดือนถัดมา ตำแหน่งการสร้างภาพจากข้อความยังคงอยู่ แต่การอ้างตำแหน่งด้านการแก้ไขภาพไม่เป็นเช่นนั้นแล้ว: GPT Image 2.5 Sunburst เปิดตัวในเดือนกันยายน และครองอันดับหนึ่งบนบอร์ดนั้นที่ 1,182 Elo โดยมี MAI-Image-2.6 อยู่อันดับสามที่ 1,137 นั่นไม่ใช่การวิจารณ์โมเดล — มันคือสิ่งที่เกิดขึ้นกับคำอ้าง 'อันดับ 1 ในวันนี้' ใด ๆ ในตลาดที่เปิดตัวสินค้าใหม่ทุกสัปดาห์ และนั่นคือเหตุผลที่บทความนี้ระบุวันที่กำกับทุกอันดับ

A screenshot of the Artificial Analysis text-to-image leaderboard, captured in English, showing MAI-Image-2.6 at 1,161 Elo, Ideogram 4.5 (High) at rank 34 with 1,013 Elo from 2,278 samples at $100.0 per 1,000 images, and GPT Image 2.5 Sunburst (max) first at 1,197 Elo.

ความแตกต่างที่สำคัญไม่ใช่คะแนน

ถ้าบอร์ดต่างๆ ตัดสินใจเรื่องนี้ มันก็จบไปแล้ว แต่พวกเขาไม่ทำเช่นนั้น ด้วยเหตุผลสองประการ

ประการแรกคือไม่มีคณะกรรมการใดวัดข้ออ้างที่แท้จริงของ Ideogram สนามการแก้ไขแสดงภาพต้นฉบับและผลลัพธ์จากคำสั่งเดียวสองรายการให้ผู้ลงคะแนน พวกเขาไม่เคยแสดงการแก้ไขครั้งที่สิบในลำดับเทียบกับครั้งแรก ซึ่งเป็นดริฟต์ที่ Ideogram สร้าง 4.5 ขึ้นมาเพื่อป้องกัน ช่องว่างการแก้ไข 73 จุดบอกคุณว่า MAI Image 2.6 เป็นที่ต้องการสำหรับการแก้ไขครั้งเดียว มันไม่ได้บอกอะไรคุณเกี่ยวกับเทิร์นที่สิบในไฟล์ขนาดใหญ่ และเทิร์นที่สิบคือสิ่งที่ทีมแคตตาล็อก การสลับป้าย หรือการบูรณะภาพถ่ายต้องพึ่งพาจริง ๆ

ข้อที่สองคือรูปแบบความพร้อมใช้งาน Preview ไม่เหมือนกับผลิตภัณฑ์ Foundry public preview เป็นที่ที่เหมาะสมสำหรับการประเมินและเครื่องมือภายใน และ Microsoft ยังไม่ได้ผูกข้อกำหนดความพร้อมใช้งานทั่วไปไว้กับสิ่งนี้ — ไม่มีคำมั่นด้านความพร้อมใช้งาน ไม่มีประกาศยกเลิกการใช้งาน และไม่มีการรับประกันปริมาณงาน โมเดลของ Microsoft ยังเข้าถึงได้เฉพาะผ่านคลาวด์และ playground ของ Microsoft เท่านั้น จึงไม่มีผู้ให้บริการรายที่สองให้พึ่งพาเมื่อ endpoint ของ preview ถูกจำกัดอัตราการเรียกใช้ Ideogram 4.5 เปิดให้บริการตามระดับชั้นที่ประกาศไว้ พร้อมตารางราคาที่คุณนำไปใส่ในงบประมาณได้ และ API ของ Ideogram เองก็เป็นข้อผูกมัดมากกว่าการเป็น preview

ถัดไปคือทิศทางราคา ซึ่งสร้างความอึดอัดอย่างแท้จริงให้กับโมเดลใหม่กว่า เมื่อไม่มีตารางอัตราค่าบริการของ Microsoft ที่เผยแพร่ออกมา ตัวเลขเดียวที่เทียบเคียงได้คือการแปลงราคาบนบอร์ด: MAI-Image-2.6 ที่ $38.90 ต่อพัน เทียบกับ Ideogram 4.5 ที่ $100.00 สำหรับการสร้างภาพจากข้อความ และ $220.00 สำหรับการแก้ไขภาพ โมเดลที่ได้คะแนนดีกว่าบนบอร์ดทั้งสองและมีราคาแปลงที่ต่ำกว่าไม่ใช่ของที่ขายยาก — มันคือค่าเริ่มต้น

ที่แต่ละสิ่งได้รับตำแหน่งของมันมาอย่างสมเหตุสมผลจริง ๆ

เลือกใช้ Ideogram 4.5 เมื่อส่วนที่แพงที่สุดในเวิร์กโฟลว์ของคุณคือการซ่อมงานที่อนุมัติแล้ว มากกว่าการสร้างงานใหม่ ไม่ว่าจะเป็นตัวแปรชุดสีสำหรับแคตตาล็อก งานป้ายที่แปลให้สอดคล้องกันทั่วทั้งแคมเปญ หรือภาพถ่ายที่เสียหายซึ่งได้รับการบูรณะโดยไม่ต้องวาดทับส่วนที่ยังหลงเหลืออยู่ การสาธิตที่ความละเอียด 24.2 ล้านพิกเซลและคำกล่าวอ้างเรื่องการรักษาขอบภาพมุ่งเป้าไปที่สิ่งเหล่านี้โดยตรง และไม่มีโมเดลคู่แข่งใดกำลังกล่าวอ้างเช่นนั้นด้วยหลักฐานที่เทียบเคียงได้ ลองทดสอบกับลำดับกรณีเลวร้ายที่สุดของคุณก่อนตัดสินใจใช้งาน คำกล่าวอ้างนี้ยังไม่ถูกทำซ้ำโดยใครก็ตามนอกเหนือจากผู้ขาย

เลือก MAI Image 2.6 เมื่อคุณต้องการความกว้างขวางและความรวดเร็วในการผสานรวม การแก้ไขแบบอ้างอิงหลายภาพด้วยภาพต้นฉบับหลายภาพ การอ้างอิงจากเว็บ และอัตราส่วนภาพแบบไดนามิก ครอบคลุมบรีฟงานผลิตส่วนใหญ่ได้โดยไม่ต้องมีโมเดลที่สองในไปป์ไลน์ และ MAI-Image-2.6-Flash มีไว้สำหรับระดับปริมาณงานสูง — ตัวเลขของ Microsoft เองระบุว่าเร็วกว่า GPT-Image-2-Medium 2.8 เท่า วัดจากการทดสอบโหลดภายในที่ 100 คำขอต่อนาทีที่ขนาด 1024 × 1024 ซึ่งเป็นข้อมูลที่ผู้ขายรายงานและยังไม่มีการทำซ้ำ หากทีมของคุณใช้ Azure อยู่แล้ว ต้นทุนการผสานรวมแทบจะเป็นศูนย์ และสิ่งนั้นอาจมีน้ำหนักมากกว่าความเที่ยงตรงในการแก้ไขที่ 24 เมกะพิกเซล

เลือกทั้งสองอย่างหากคุณกำลังดำเนินการด้านคอนเทนต์อย่างจริงจัง โมเดลแบบแพลตฟอร์มสำหรับการสร้างและการผลิตจำนวนมาก ผู้เชี่ยวชาญสำหรับรอบงานที่ต้องแม่นยำระดับพิกเซล และกฎว่าตัวไหนรับผิดชอบขั้นตอนใด ความผิดพลาดคือการมองสิ่งนี้เป็นการซื้อเพียงครั้งเดียว

การกำหนดเส้นทาง เมื่อปลายทางทั้งสองมีความรับประกันที่แตกต่างกัน

ไม่มีสิ่งใดในการเปรียบเทียบครั้งนี้ที่อยู่ในแค็ตตาล็อกของ OrcaRouter เลย Ideogram 4.5 ใช้งานได้ผ่าน API ของผู้จำหน่ายเองและแพลตฟอร์มของบุคคลที่สามหลายแห่ง ส่วน MAI Image 2.6 Preview เข้าถึงได้เฉพาะผ่าน Microsoft Foundry และ MAI Playground เท่านั้น สายงานด้านภาพของเราอยู่คนละที่ — ตัวระบุ G​oogle Gemini 3.1 Flash Image และ Imagen 4 กับโมเดล GPT-Image ของ O​penAI — และถ้าเราบอกว่าเราให้บริการเส้นทางแก่สิ่งใดสิ่งหนึ่งในสองอย่างนี้ ก็คงไม่รอดแม้แต่การตรวจสอบเพียงครั้งเดียว

สิ่งที่เลเยอร์การกำหนดเส้นทางมีไว้จริง ๆ ในกรณีนี้คือความไม่สมดุลระหว่างเรื่องความพร้อมใช้งานสองแบบนั้น ปลายทางพรีวิวที่ไม่มี SLA คือกรณีที่การสลับสำรองอัตโนมัติคุ้มค่ากับการลงทุนจริง ๆ: การเรียกจะไปลงที่ทางเลือกที่ให้บริการได้ แทนที่จะโยนข้อผิดพลาดตอนตี 2 และคุณจะรู้จากบันทึกแทนที่จะรู้จากตั๋วซัพพอร์ต การคิดราคาต่อการเรียกตามราคาตั้งของผู้ให้บริการ โดยไม่มีอะไรบวกเพิ่ม หมายความว่าการลดราคาของผู้ขายหรืออัตราที่ประกาศครั้งแรกของพรีวิวจะปรากฏในใบแจ้งหนี้ของคุณในวันที่มันเกิด — ซึ่งสำคัญเมื่อการเปรียบเทียบที่คุณกำลังทำอยู่คือ 2.6 เท่าในสายการแก้ไข และถ้าคุณต้องการทดสอบ A/B พรีวิวเทียบกับผู้เชี่ยวชาญโดยไม่ต้องมีสองสัญญา การใช้คีย์เดียวคือวิธีที่ถูกที่สุดในการทำเช่นนั้น

ตอนนี้ควรทำอะไร

หากคุณกำลังเลือกโมเดลสักตัวในวันนี้ คำตอบที่ตรงไปตรงมาคือ โมเดลที่ดีกว่าก็เป็นโมเดลที่ถูกกว่าเช่นกัน และเป็นโมเดลที่คุณใช้งานได้เฉพาะในพรีวิวเท่านั้น เลือก MAI Image 2.6 หากคุณใช้งานภายในคลาวด์ของ Microsoft และยอมรับข้อกำหนดการพรีวิวได้ เลือก Ideogram 4.5 หากคุณต้องการตารางราคาที่คาดการณ์ได้ API จากผู้ให้บริการโดยตรง หรือพฤติกรรมความเที่ยงตรงในการแก้ไขแบบเฉพาะเจาะจง และยอมรับว่าคุณกำลังจ่ายในอัตราประมาณสองเท่าครึ่งของอัตราการแก้ไขเมื่อแปลงหน่วยแล้วสำหรับสิ่งนั้น

สองสิ่งนี้จะทำให้เรื่องจบลงได้ สิ่งแรกคือเกณฑ์มาตรฐานวัดความแม่นยำแบบหลายรอบ (multi-turn fidelity benchmark): ภาพเดียวกัน แก้ไขต่อเนื่องสิบครั้ง วัดความแตกต่างที่เกิดขึ้น จนกว่าจะมีใครสักคนรันการทดสอบนี้ คุณสมบัติที่ทำให้ Ideogram 4.5 น่าสนใจก็ยังไม่ถูกวัด และคุณสมบัติที่ทำให้ MAI Image 2.6 น่าสนใจก็ถูกวัดแล้ว สิ่งที่สองคือการที่ Microsoft ย้าย MAI Image 2.6 จากการพรีวิวไปสู่การพร้อมใช้งานทั่วไป (general availability) พร้อมเผยแพร่ตารางราคา ซึ่งจะขจัดข้อโต้แย้งเชิงปฏิบัติข้อสุดท้ายต่อกลยุทธ์แพลตฟอร์ม และทำให้ข้อโต้แย้งแบบผู้เชี่ยวชาญต้องขึ้นอยู่กับ drift แต่เพียงอย่างเดียว

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube