
Ideogram 4.5 กับ MAI Image 2.6 Preview: ผู้เชี่ยวชาญปะทะแพลตฟอร์ม
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 217 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 111 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 43 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Ideogram 4.5 ถูกสร้างขึ้นมาเพื่อทำสิ่งเดียว นั่นคือแก้ไขภาพซ้ำแล้วซ้ำเล่าโดยไม่ให้คุณภาพลดลง MAI Image 2.6 Preview ซึ่งเป็นโมเดลภาพเรือธงของ Microsoft AI ถูกสร้างมาเพื่อทำทุกอย่างในคราวเดียว — ทั้งสร้างภาพ แก้ไขภาพโดยใช้ภาพอ้างอิงหลายภาพ เชื่อมโยงพรอมป์กับเนื้อหาบนเว็บแบบเรียลไทม์ และเลือกอัตราส่วนภาพได้เอง — และสามารถเรียกใช้งานได้ในพับลิกพรีวิวผ่าน Microsoft Foundry ตั้งแต่วันที่ 4 กันยายน 2026 เมื่อนำมาเปรียบเทียบกัน ตัวเลขชี้ไปทางหนึ่ง แต่รูปร่างของผลิตภัณฑ์กลับชี้ไปอีกทาง Ideogram ชนะในสิ่งที่มันถูกสร้างขึ้นมาเพื่อทำ ส่วน Microsoft ชนะในแทบทุกแกนอื่น รวมถึงแกนที่ตัดสินว่าทีมหนึ่ง ๆ จะนำไปใช้งานจริงได้หรือไม่
แต่ละอย่างคืออะไร
Ideogram 4.5 เปิดตัวเมื่อวันที่ 30 กันยายน 2026 ทั้งในแอปของ Ideogram, API ของตัวเอง, การผสานรวม MCP และคอลเลกชันแอปของบริษัท รวมถึงแพลตฟอร์มพันธมิตร มันสร้างและแก้ไขภาพได้ที่ความเร็วการเรนเดอร์สี่ระดับ ส่งออกที่ความละเอียด 2K โดยกำเนิด และสาธิตการแก้ไขเฉพาะจุดบนต้นฉบับขนาด 4,016 × 6,016 — 24.2 ล้านพิกเซล — โดยไม่ต้องลดขนาด ผู้ขายอ้างว่าการประมวลผลซ้ำหลายรอบจะไม่คลาดเคลื่อนอีกต่อไป: ขอบยังคงอยู่ที่เดิม พื้นผิวคงอยู่ และส่วนที่แก้ไขแล้วสามารถเย็บกลับเข้ากับต้นฉบับได้ ไม่เปิดเผยค่าน้ำหนักโมเดล
MAI Image 2.6 เป็นโมเดลสร้างภาพที่แข็งแกร่งที่สุดของ Microsoft AI และเป็นจุดสูงสุดของสายการพัฒนาที่ไล่เรียงมาจาก MAI-Image-1, MAI-Image-2 ในเดือนมีนาคม 2026, MAI-Image-2.5 ในเดือนมิถุนายน, MAI-Image-2.5-Pro ในเดือนกรกฎาคม และ MAI-Image-2-Efficient ตลอดเส้นทาง โดยเปิดตัวบนกระดานจัดอันดับของ Arena ในเดือนสิงหาคม 2026 ด้วยอันดับที่ 2 และเมื่อวันที่ 4 กันยายน 2026 Microsoft ได้ผลักดันให้มันเข้าสู่พรีวิวสาธารณะใน Microsoft Foundry และ MAI Playground ควบคู่ไปกับ MAI-Image-2.6-Flash ใหม่สำหรับงานประมวลผลปริมาณสูง ความสามารถบนสเปกนั้นกว้างขวาง ทั้งการแก้ไขแบบอ้างอิงหลายภาพซึ่งผสมผสานผู้คน ผลิตภัณฑ์ สไตล์ และฉากจากภาพหลายภาพ การอิงข้อมูลเว็บ อัตราส่วนภาพแบบไดนามิก และเอาต์พุตความละเอียดสูงสุด 1.5K อีกทั้งยังเป็นโมเดลปิด และทำงานบนคลาวด์ของ Microsoft เท่านั้น

ไลน์อัป
• การเข้าถึง — แอปสาธารณะ การผสานรวม API และ MCP ตั้งแต่ 30 กันยายน 2026 เทียบกับตัวอย่างสาธารณะใน Microsoft Foundry และ MAI Playground ตั้งแต่ 4 กันยายน 2026
• ราคา — $0.03 ต่อภาพที่ระดับ Low, $0.06 ที่ระดับ Medium และ $0.22 ที่ระดับ High บนใบอัตราค่าบริการของผู้ให้บริการ เทียบกับไม่มีใบอัตราค่าบริการที่เผยแพร่บนโพสต์ข่าวของ Microsoft; ข้อมูลราคาอยู่เบื้องหลังการ์ดโมเดล Foundry และบอร์ดจัดอันดับอิสระระบุโมเดลนี้ที่ $38.90 ต่อ 1,000 ภาพ
• คะแนนการสร้างภาพจากข้อความ — อันดับ 34 ที่ 1,013 Elo จาก 2,278 ตัวอย่าง เทียบกับ 1,161 Elo จาก 9,410 ตัวอย่าง เปิดตัวเดือนสิงหาคม 2026
• คะแนนการแก้ไข — อันดับ 23 ที่ 1,064 Elo จาก 2,459 ตัวอย่าง ที่ $220.00 ต่อ 1,000 ภาพ เทียบกับอันดับ 3 ที่ 1,137 Elo จาก 15,684 ตัวอย่าง ที่ $38.90 ต่อ 1,000
• เอาต์พุต — เนทีฟ 2K โดยการแก้ไขแสดงให้เห็นที่ 4,016 × 6,016 เทียบกับความละเอียดสูงสุด 1.5K ตามการ์ดของ Microsoft
• รูปร่างขีดความสามารถ — จุดแข็งที่คมชัดหนึ่งจุด (ความแม่นยำในการแก้ไขแบบหลายรอบ) เทียบกับชุดความสามารถที่กว้าง: การแก้ไขโดยอ้างอิงหลายรายการ, การเชื่อมโยงกับเว็บ, อัตราส่วนภาพแบบไดนามิก และ Flash รุ่นพี่น้องที่เร็วกว่า

บอร์ดเดียวกัน แผงเดียวกัน และมันไม่ใกล้เคียงเลย
นี่เป็นการจับคู่ที่พบได้ยากซึ่งมีการเปรียบเทียบที่ชัดเจน เพราะทั้งสองโมเดลอยู่บน Artificial Analysis โดยมีแถวข้อมูลที่วัดโดยคณะผู้ประเมินชุดเดียวกันและฐานคะแนนโหวตเดียวกัน
การสร้างภาพจากข้อความ: MAI-Image-2.6 อยู่ที่ 1,161 Elo จาก 9,410 ตัวอย่าง เทียบกับ Ideogram 4.5 (High) ที่ 1,013 Elo จาก 2,278 ตัวอย่าง นั่นคือ 148 Elo บนจำนวนตัวอย่างที่มากกว่าสี่เท่า และคอลัมน์ราคาระบุ $38.90 เทียบกับ $100.00 ต่อพันภาพ
การแก้ไขภาพ: MAI-Image-2.6 ที่ 1,137 Elo จาก 15,684 ตัวอย่าง เทียบกับ Ideogram 4.5 (High) ที่ 1,064 Elo จาก 2,459 ตัวอย่าง โดยคิดConversionอิสระที่ $38.90 เทียบกับ $220.00 ต่อพัน
โพสต์วันที่ 4 กันยายนของ Microsoft เองอ้างว่าครองตำแหน่งที่ 2 ด้านการสร้างภาพจากข้อความ และที่ 1 ด้านการแก้ไขภาพบนบอร์ดนี้ โดยทั้งคู่ระบุว่า 'ณ วันที่ 4 ก.ย. 2026' เมื่ออ่านในอีกหนึ่งเดือนถัดมา ตำแหน่งการสร้างภาพจากข้อความยังคงอยู่ แต่การอ้างตำแหน่งด้านการแก้ไขภาพไม่เป็นเช่นนั้นแล้ว: GPT Image 2.5 Sunburst เปิดตัวในเดือนกันยายน และครองอันดับหนึ่งบนบอร์ดนั้นที่ 1,182 Elo โดยมี MAI-Image-2.6 อยู่อันดับสามที่ 1,137 นั่นไม่ใช่การวิจารณ์โมเดล — มันคือสิ่งที่เกิดขึ้นกับคำอ้าง 'อันดับ 1 ในวันนี้' ใด ๆ ในตลาดที่เปิดตัวสินค้าใหม่ทุกสัปดาห์ และนั่นคือเหตุผลที่บทความนี้ระบุวันที่กำกับทุกอันดับ

ความแตกต่างที่สำคัญไม่ใช่คะแนน
ถ้าบอร์ดต่างๆ ตัดสินใจเรื่องนี้ มันก็จบไปแล้ว แต่พวกเขาไม่ทำเช่นนั้น ด้วยเหตุผลสองประการ
ประการแรกคือไม่มีคณะกรรมการใดวัดข้ออ้างที่แท้จริงของ Ideogram สนามการแก้ไขแสดงภาพต้นฉบับและผลลัพธ์จากคำสั่งเดียวสองรายการให้ผู้ลงคะแนน พวกเขาไม่เคยแสดงการแก้ไขครั้งที่สิบในลำดับเทียบกับครั้งแรก ซึ่งเป็นดริฟต์ที่ Ideogram สร้าง 4.5 ขึ้นมาเพื่อป้องกัน ช่องว่างการแก้ไข 73 จุดบอกคุณว่า MAI Image 2.6 เป็นที่ต้องการสำหรับการแก้ไขครั้งเดียว มันไม่ได้บอกอะไรคุณเกี่ยวกับเทิร์นที่สิบในไฟล์ขนาดใหญ่ และเทิร์นที่สิบคือสิ่งที่ทีมแคตตาล็อก การสลับป้าย หรือการบูรณะภาพถ่ายต้องพึ่งพาจริง ๆ
ข้อที่สองคือรูปแบบความพร้อมใช้งาน Preview ไม่เหมือนกับผลิตภัณฑ์ Foundry public preview เป็นที่ที่เหมาะสมสำหรับการประเมินและเครื่องมือภายใน และ Microsoft ยังไม่ได้ผูกข้อกำหนดความพร้อมใช้งานทั่วไปไว้กับสิ่งนี้ — ไม่มีคำมั่นด้านความพร้อมใช้งาน ไม่มีประกาศยกเลิกการใช้งาน และไม่มีการรับประกันปริมาณงาน โมเดลของ Microsoft ยังเข้าถึงได้เฉพาะผ่านคลาวด์และ playground ของ Microsoft เท่านั้น จึงไม่มีผู้ให้บริการรายที่สองให้พึ่งพาเมื่อ endpoint ของ preview ถูกจำกัดอัตราการเรียกใช้ Ideogram 4.5 เปิดให้บริการตามระดับชั้นที่ประกาศไว้ พร้อมตารางราคาที่คุณนำไปใส่ในงบประมาณได้ และ API ของ Ideogram เองก็เป็นข้อผูกมัดมากกว่าการเป็น preview
ถัดไปคือทิศทางราคา ซึ่งสร้างความอึดอัดอย่างแท้จริงให้กับโมเดลใหม่กว่า เมื่อไม่มีตารางอัตราค่าบริการของ Microsoft ที่เผยแพร่ออกมา ตัวเลขเดียวที่เทียบเคียงได้คือการแปลงราคาบนบอร์ด: MAI-Image-2.6 ที่ $38.90 ต่อพัน เทียบกับ Ideogram 4.5 ที่ $100.00 สำหรับการสร้างภาพจากข้อความ และ $220.00 สำหรับการแก้ไขภาพ โมเดลที่ได้คะแนนดีกว่าบนบอร์ดทั้งสองและมีราคาแปลงที่ต่ำกว่าไม่ใช่ของที่ขายยาก — มันคือค่าเริ่มต้น
ที่แต่ละสิ่งได้รับตำแหน่งของมันมาอย่างสมเหตุสมผลจริง ๆ
เลือกใช้ Ideogram 4.5 เมื่อส่วนที่แพงที่สุดในเวิร์กโฟลว์ของคุณคือการซ่อมงานที่อนุมัติแล้ว มากกว่าการสร้างงานใหม่ ไม่ว่าจะเป็นตัวแปรชุดสีสำหรับแคตตาล็อก งานป้ายที่แปลให้สอดคล้องกันทั่วทั้งแคมเปญ หรือภาพถ่ายที่เสียหายซึ่งได้รับการบูรณะโดยไม่ต้องวาดทับส่วนที่ยังหลงเหลืออยู่ การสาธิตที่ความละเอียด 24.2 ล้านพิกเซลและคำกล่าวอ้างเรื่องการรักษาขอบภาพมุ่งเป้าไปที่สิ่งเหล่านี้โดยตรง และไม่มีโมเดลคู่แข่งใดกำลังกล่าวอ้างเช่นนั้นด้วยหลักฐานที่เทียบเคียงได้ ลองทดสอบกับลำดับกรณีเลวร้ายที่สุดของคุณก่อนตัดสินใจใช้งาน คำกล่าวอ้างนี้ยังไม่ถูกทำซ้ำโดยใครก็ตามนอกเหนือจากผู้ขาย
เลือก MAI Image 2.6 เมื่อคุณต้องการความกว้างขวางและความรวดเร็วในการผสานรวม การแก้ไขแบบอ้างอิงหลายภาพด้วยภาพต้นฉบับหลายภาพ การอ้างอิงจากเว็บ และอัตราส่วนภาพแบบไดนามิก ครอบคลุมบรีฟงานผลิตส่วนใหญ่ได้โดยไม่ต้องมีโมเดลที่สองในไปป์ไลน์ และ MAI-Image-2.6-Flash มีไว้สำหรับระดับปริมาณงานสูง — ตัวเลขของ Microsoft เองระบุว่าเร็วกว่า GPT-Image-2-Medium 2.8 เท่า วัดจากการทดสอบโหลดภายในที่ 100 คำขอต่อนาทีที่ขนาด 1024 × 1024 ซึ่งเป็นข้อมูลที่ผู้ขายรายงานและยังไม่มีการทำซ้ำ หากทีมของคุณใช้ Azure อยู่แล้ว ต้นทุนการผสานรวมแทบจะเป็นศูนย์ และสิ่งนั้นอาจมีน้ำหนักมากกว่าความเที่ยงตรงในการแก้ไขที่ 24 เมกะพิกเซล
เลือกทั้งสองอย่างหากคุณกำลังดำเนินการด้านคอนเทนต์อย่างจริงจัง โมเดลแบบแพลตฟอร์มสำหรับการสร้างและการผลิตจำนวนมาก ผู้เชี่ยวชาญสำหรับรอบงานที่ต้องแม่นยำระดับพิกเซล และกฎว่าตัวไหนรับผิดชอบขั้นตอนใด ความผิดพลาดคือการมองสิ่งนี้เป็นการซื้อเพียงครั้งเดียว
การกำหนดเส้นทาง เมื่อปลายทางทั้งสองมีความรับประกันที่แตกต่างกัน
ไม่มีสิ่งใดในการเปรียบเทียบครั้งนี้ที่อยู่ในแค็ตตาล็อกของ OrcaRouter เลย Ideogram 4.5 ใช้งานได้ผ่าน API ของผู้จำหน่ายเองและแพลตฟอร์มของบุคคลที่สามหลายแห่ง ส่วน MAI Image 2.6 Preview เข้าถึงได้เฉพาะผ่าน Microsoft Foundry และ MAI Playground เท่านั้น สายงานด้านภาพของเราอยู่คนละที่ — ตัวระบุ Google Gemini 3.1 Flash Image และ Imagen 4 กับโมเดล GPT-Image ของ OpenAI — และถ้าเราบอกว่าเราให้บริการเส้นทางแก่สิ่งใดสิ่งหนึ่งในสองอย่างนี้ ก็คงไม่รอดแม้แต่การตรวจสอบเพียงครั้งเดียว
สิ่งที่เลเยอร์การกำหนดเส้นทางมีไว้จริง ๆ ในกรณีนี้คือความไม่สมดุลระหว่างเรื่องความพร้อมใช้งานสองแบบนั้น ปลายทางพรีวิวที่ไม่มี SLA คือกรณีที่การสลับสำรองอัตโนมัติคุ้มค่ากับการลงทุนจริง ๆ: การเรียกจะไปลงที่ทางเลือกที่ให้บริการได้ แทนที่จะโยนข้อผิดพลาดตอนตี 2 และคุณจะรู้จากบันทึกแทนที่จะรู้จากตั๋วซัพพอร์ต การคิดราคาต่อการเรียกตามราคาตั้งของผู้ให้บริการ โดยไม่มีอะไรบวกเพิ่ม หมายความว่าการลดราคาของผู้ขายหรืออัตราที่ประกาศครั้งแรกของพรีวิวจะปรากฏในใบแจ้งหนี้ของคุณในวันที่มันเกิด — ซึ่งสำคัญเมื่อการเปรียบเทียบที่คุณกำลังทำอยู่คือ 2.6 เท่าในสายการแก้ไข และถ้าคุณต้องการทดสอบ A/B พรีวิวเทียบกับผู้เชี่ยวชาญโดยไม่ต้องมีสองสัญญา การใช้คีย์เดียวคือวิธีที่ถูกที่สุดในการทำเช่นนั้น
ตอนนี้ควรทำอะไร
หากคุณกำลังเลือกโมเดลสักตัวในวันนี้ คำตอบที่ตรงไปตรงมาคือ โมเดลที่ดีกว่าก็เป็นโมเดลที่ถูกกว่าเช่นกัน และเป็นโมเดลที่คุณใช้งานได้เฉพาะในพรีวิวเท่านั้น เลือก MAI Image 2.6 หากคุณใช้งานภายในคลาวด์ของ Microsoft และยอมรับข้อกำหนดการพรีวิวได้ เลือก Ideogram 4.5 หากคุณต้องการตารางราคาที่คาดการณ์ได้ API จากผู้ให้บริการโดยตรง หรือพฤติกรรมความเที่ยงตรงในการแก้ไขแบบเฉพาะเจาะจง และยอมรับว่าคุณกำลังจ่ายในอัตราประมาณสองเท่าครึ่งของอัตราการแก้ไขเมื่อแปลงหน่วยแล้วสำหรับสิ่งนั้น
สองสิ่งนี้จะทำให้เรื่องจบลงได้ สิ่งแรกคือเกณฑ์มาตรฐานวัดความแม่นยำแบบหลายรอบ (multi-turn fidelity benchmark): ภาพเดียวกัน แก้ไขต่อเนื่องสิบครั้ง วัดความแตกต่างที่เกิดขึ้น จนกว่าจะมีใครสักคนรันการทดสอบนี้ คุณสมบัติที่ทำให้ Ideogram 4.5 น่าสนใจก็ยังไม่ถูกวัด และคุณสมบัติที่ทำให้ MAI Image 2.6 น่าสนใจก็ถูกวัดแล้ว สิ่งที่สองคือการที่ Microsoft ย้าย MAI Image 2.6 จากการพรีวิวไปสู่การพร้อมใช้งานทั่วไป (general availability) พร้อมเผยแพร่ตารางราคา ซึ่งจะขจัดข้อโต้แย้งเชิงปฏิบัติข้อสุดท้ายต่อกลยุทธ์แพลตฟอร์ม และทำให้ข้อโต้แย้งแบบผู้เชี่ยวชาญต้องขึ้นอยู่กับ drift แต่เพียงอย่างเดียว
