
GPT-Image-2 vs Flux 3: เปรียบเทียบโมเดลที่ใช้งานจริงกับโรดแมป
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
นี่ไม่ใช่โพสต์เปรียบเทียบโมเดลกับโมเดลแบบปกติ เพราะว่า GPT-Image-2 และ Flux 3 ไม่ได้ดำรงอยู่ในสถานะเดียวกัน GPT-Image-2 เปิดตัวเมื่อวันที่ 21 เมษายน 2026 เรียกใช้ได้ผ่าน API ของ OpenAI ตั้งแต่ต้นเดือนพฤษภาคม และเพิ่มความสามารถใหม่ในสัปดาห์นี้ — การสร้างภาพพื้นหลังโปร่งใสใน API ซึ่งประกาศเมื่อวันที่ 20 สิงหาคม และเปิดให้ใช้ได้แล้วตอนนี้ Flux 3 คือโมเดลพื้นฐานมัลติโมดัลของ Black Forest Labs ประกาศเมื่อวันที่ 23 กรกฎาคม 2026 และส่วนของการสร้างภาพ (image tier) ยังไม่มี endpoint สาธารณะ ไม่มี model ID และไม่มีรายการราคา ณ เวลาที่เขียนบทความนี้ หนึ่งในสองโมเดลนี้คุณสามารถเรียกใช้ได้ตอนตี 3 ด้วยคีย์ที่ถูกต้อง ส่วนอีกตัวคุณลงทะเบียนเพื่อเข้าคิวรอได้ การเปรียบเทียบที่มีประโยชน์จึงไม่ใช่ "อันไหนดีกว่า" — แต่เป็นสิ่งที่โมเดลที่เปิดตัวแล้วทำได้จริงในวันนี้ สิ่งที่โรดแมประบุไว้สำหรับโมเดลที่ยังไม่เปิดตัว และวิธีที่นักพัฒนาควรปฏิบัติต่อโมเดลที่ถูกสัญญาไว้แต่เลื่อนออกไปเรื่อย ๆ ในขณะที่โมเดลที่ใช้งานจริงยังคงพัฒนาขึ้นเรื่อย ๆ
หนึ่งในนี้มีจุดสิ้นสุด
เริ่มต้นด้วยความพร้อมใช้งาน เพราะมันเป็นตัวกำหนดทุกอย่างอื่น Black Forest Labs เปิดตัว Flux 3 เมื่อวันที่ 23 กรกฎาคม ในฐานะโมเดลเดียวที่ฝึกฝนร่วมกันบนการคาดคะเนภาพ วิดีโอ เสียง และการกระทำของหุ่นยนต์ สร้างขึ้นบนแนวทาง flow-matching ที่ห้องแล็บเรียกกว่า Self-Flow ประมาณกว่า 95% ของการคำนวณสำหรับการฝึกนั้นรายงานว่าใช้ไปกับการคาดคะเนวิดีโอ ซึ่งเห็นได้จากสิ่งที่เปิดตัวจริง: มีเพียง Flux 3 Video ที่ถึงขั้นพร้อมใช้งานทั่วไป เมื่อวันที่ 4 สิงหาคม พร้อม API ที่คิดค่าใช้จ่าย หน้าของโมเดลระดับภาพยังคงติดป้าย "เร็วๆ นี้" พร้อมแบบฟอร์มสมัคร ไม่ใช่ปุ่มเริ่มต้นใช้งาน — ไม่มี endpoint ไม่มีพารามิเตอร์ที่ระบุ ไม่มีต้นทุนต่อภาพ และไม่มีเกณฑ์มาตรฐานที่ใครจะรันได้
ในทางตรงกันข้าม GPT-Image-2 ถูกใช้งานในระบบโปรดักชันมาแล้วสี่เดือน OpenAI เปิดให้เข้าถึง API ตั้งแต่ต้นเดือนพฤษภาคม และตัวระบุรุ่น gpt-image-2 มีความเสถียรพอที่จะมีสแนปชอตแบบตรึงถาวร gpt-image-2-2026-04-21 อยู่เคียงข้างกัน ปัจจุบันมันเป็นโมเดลข้อความสู่รูปภาพอันดับหนึ่งบนกระดานจัดอันดับอิสระหลักทั้งสองแห่ง — 1,381 Elo บนลีดเดอร์บอร์ด text-to-image ของ Arena (build ระดับกลาง) และ 1,369 Elo สำหรับ build ระดับสูงบน Artificial Analysis — และมันสามารถเรนเดอร์ข้อความหลายภาษา รวมถึงภาษา CJK, ใช้เว็บเสิร์ชเป็นพื้นฐานในการสร้างภาพ และให้ผลลัพธ์ความละเอียดสูงสุดถึง 4K สี่เดือนของปริมาณการใช้งานจริงคือสิ่งที่แยกข้อกล่าวอ้างออกจากประวัติผลงานที่แท้จริง
การเปลี่ยนแปลงล่าสุดทางฝั่ง GPT-Image-2
เหตุการณ์ที่ทำให้การจับคู่แข่งขันครั้งนี้มาถูกจังหวะไม่ได้เกี่ยวกับ Flux 3 เลย เมื่อวันที่ 20 สิงหาคม OpenAI เปิดตัวพรีวิวแบบพื้นหลังโปร่งใสสำหรับ GPT-Image-2 ใน Images API: เพียงตั้งค่า background เป็น "transparent" endpoint ก็จะส่งคืนไฟล์ PNG หรือ WebP ที่มี alpha channel จริง ตัดพื้นหลังออกมาและพร้อมนำไปประกอบภาพ นี่คือฟีเจอร์ที่พุ่งเป้าไปที่งานด้านโปรดักชันโดยตรง ซึ่งโรดแมปของ Flux 3 image ก็ขายอยู่อีกเช่นกัน ไม่ว่าจะเป็นภาพถ่ายผลิตภัณฑ์ ไอคอน หรือสื่อการตลาด — และมันมาในรูปแบบพารามิเตอร์บน endpoint ที่เปิดใช้งานอยู่แล้วแทนที่จะเป็นโมเดลใหม่ ดังนั้น ในขณะที่คนทั้งโลกรอคอย Flux 3 image endpoint ซึ่งยังขึ้นข้อความว่า "coming soon" ผู้เล่นรายเดิมก็เพิ่งปิดช่องว่างข้อหนึ่งที่เคยทำให้ตัวเองถูกกีดกันออกจากไปป์ไลน์การคอมโพสิตภาพสำเร็จ
ความสามารถนี้ใช้งานผ่าน API เท่านั้น — ไม่มีตัวสลับใน ChatGPT — และเป็นพารามิเตอร์ ไม่ใช่ผลิตภัณฑ์ใหม่ เอนด์พอยต์ทั้งสองของ Images API ได้แก่การสร้าง (generation) และการแก้ไข (edit) รองรับฟิลด์ background โดยมีค่า "transparent", "opaque" และ "auto" (ค่าเริ่มต้น ซึ่งโมเดลจะเป็นผู้ตัดสินใจ) อัลฟาแชนเนลจะคงอยู่เฉพาะในผลลัพธ์แบบ PNG หรือ WebP เท่านั้น ดังนั้นคำขอจึงต้องระบุรูปแบบเอาต์พุตอย่างชัดเจน เอกสารอ้างอิง API ของ OpenAI เองยังคงระบุว่าการรองรับพื้นหลังโปร่งใสสำหรับ gpt-image-2 และสแนปช็อต gpt-image-2-2026-04-21 อยู่ในสถานะ "in preview" — ซึ่งเป็นป้ายกำกับของผู้ให้บริการ ไม่ใช่การประกาศว่าพร้อมใช้งานจริง — และคำแนะนำคือให้พรอมปต์ไม่มีการบรรยายถึงฉากหลังใดๆ เพื่อให้โมเดลทำตามคำขอแบบโปร่งใสได้จริง ไม่มีเอนด์พอยต์ใหม่ ไม่มีรหัสโมเดลใหม่ ไม่มีเรตค่าบริการแยกต่างหาก: การเรียก gpt-image-2 เดิมที่เคยคืนภาพ PNG ทึบแสง ตอนนี้จะคืนภาพตัดพื้นหลัง (cutout) แทน

Flux 3 image สัญญาอะไรไว้ และสิ่งที่ส่งมอบจริงคืออะไร
สเปกชีตของระดับภาพ Flux 3 เป็นแผนงานของผู้จำหน่าย ดังนั้นควรถือว่ามันเป็นเช่นนั้น Black Forest Labs ได้สัญญาว่าจะมีการสร้างและแก้ไขภาพในหลากหลายสไตล์และความละเอียด การจัดการพรอมป์ที่ซับซ้อนดีขึ้น การเรนเดอร์ข้อความหลายภาษาแบบมีความแม่นยำสูง การถ่ายโอนสไตล์แบบ zero-shot จากภาพอ้างอิง ความสม่ำเสมอของตัวละครและแบรนด์โดยไม่ต้องปรับแต่ง และการแก้ไขแบบไม่ทำลายซึ่งคงรักษาพื้นผิวและแสงไว้ สิ่งเหล่านี้เป็นสิ่งที่ควรสัญญา — ซึ่งเป็นคุณสมบัติที่ผู้นำตลาดในปัจจุบันแข่งขันกันอยู่พอดี — แต่ไม่มีสิ่งใดที่ทดสอบได้ในวันนี้ เพราะไม่มีสิ่งใดที่มีเอนด์พอยต์
สิ่งที่เรียกใช้ได้จริงจาก BFL คือระดับวิดีโอและไลน์ภาพ FLUX รุ่นเก่า Flux 3 Video ขายในราคา $0.17 ต่อวินาทีที่ความละเอียด HD และ $0.29 ต่อวินาทีที่ FHD สำหรับการเรนเดอร์เต็มรูปแบบ พร้อมโหมดร่าง (draft mode) ราคา $0.06 ต่อวินาที ตัวเลขที่รายงานเองคือ 1,135 Elo สำหรับข้อความเป็นวิดีโอ และ 1,051 สำหรับภาพเป็นวิดีโอ และชนะในด้านความชอบเหนือ Luma Ray 3.2, Runway Gen-4.5, Grok Imagine Video และ Kling v3 Pro — ทั้งหมดเป็นข้อมูลที่บริษัทผู้พัฒนารายงานเองและยังไม่มีการตรวจสอบซ้ำ และก็ไม่ส่งผลต่อระดับภาพแต่อย่างใด สำหรับภาพนิ่ง สิ่งที่ BFL นำเสนอในปัจจุบันยังคงเป็นไลน์ FLUX.2 ซึ่งอยู่ที่ 1,226 Elo บนกระดาน Artificial Analysis เดียวกันกับที่ GPT-Image-2 เป็นผู้นำที่ 1,369 ช่องว่างนั้นคือบริบทเชิงปฏิบัติของคำว่า 'Flux 3 image กำลังจะมา': API ภาพของ BFL ในปัจจุบันนั้นตามหลัง API ของ OpenAI อยู่ประมาณ 140 Elo และโมเดลที่ถูกสัญญาไว้คือสิ่งที่ BFL ต้องการเพื่อปิดช่องว่างนั้น

ราคา: มีการ์ดราคาจริงเพียงใบเดียวเท่านั้น
ไม่มีราคาสำหรับภาพ Flux 3 เพราะไม่มีผลิตภัณฑ์ภาพ Flux 3 ตัวเลขที่เผยแพร่เพียงอย่างเดียวคืออัตราโทเคนของ GPT-Image-2: $5 ต่อล้านโทเคนสำหรับข้อความนำเข้า, $8 ต่อล้านโทเคนสำหรับภาพนำเข้า และ $30 ต่อล้านโทเคนสำหรับภาพส่งออก โดย Batch API คิดราคาประมาณครึ่งหนึ่งสำหรับการประมวลผลภายใน 24 ชั่วโมง OpenAI ไม่ได้เผยแพร่จำนวนโทเคนต่อภาพ ดังนั้นตัวเลขต่อภาพจึงเป็นการแปลงค่า ไม่ใช่ราคาอ้างอิง: ประมาณ $0.006 สำหรับภาพคุณภาพต่ำขนาด 1024×1024, ประมาณ $0.05 สำหรับภาพคุณภาพปานกลาง, ประมาณ $0.21 สำหรับคุณภาพสูง และสูงสุดประมาณ $0.41 สำหรับการเรนเดอร์คุณภาพสูงขนาด 4K สำหรับการเปรียบเทียบ นั่นคือด้านหนึ่งของบัญชีที่มีข้อมูลจริง ส่วนคอลัมน์ภาพ Flux 3 เป็นเซลล์ว่าง

สิ่งที่ผู้สร้างควรทำกับโมเดลที่สัญญาไว้
ท่าทีที่สมเหตุสมผลเมื่อโมเดลของคู่แข่งเลื่อนเปิดตัวซ้ำแล้วซ้ำเล่า คือการต่อยอดจากสิ่งที่มีอยู่ และทำให้อนาคตเป็นเพียงการเปลี่ยนคอนฟิก ไม่ใช่การปรับสถาปัตยกรรมใหม่ GPT-Image-2 ใช้งานผ่าน OrcaRouter ได้แล้ววันนี้ — คีย์ API เดียว ราคารายการของ OpenAI ที่ส่งผ่านโดยมาร์กอัป 0% และมี failover อัตโนมัติข้ามผู้ให้บริการ — ดังนั้นไปป์ไลน์ที่สร้างแอสเซ็ตด้วยมันสามารถชี้เอนด์พอยต์เดียวกันไปที่ API ของ Flux 3 image ในวันที่เอนด์พอยต์มีจริง และจัดเส้นทางทราฟฟิกบางส่วนไปยังมันด้วย routing DSL โดยไม่ต้องแตะโค้ดที่เรียกใช้ คุณได้โมเดลที่ปล่อยออกมาจริงแล้วตอนนี้ และเมื่อโมเดลที่สัญญาไว้ออกมา คุณก็ประเมินมันเทียบกับ baseline ที่ทำงานได้จริง แทนที่จะเทียบกับข่าวประชาสัมพันธ์ การรอไม่ทำให้คุณเสียอะไรเลย แต่การสร้างบนความว่างเปล่าขณะที่รอ ทำให้คุณเสียทุกอย่าง
บทสรุปนี้เอนเอียงโดยเจตนา หากคุณต้องการสร้างภาพในไตรมาสนี้ GPT-Image-2 คือคำตอบ และไม่มีข้อกังขาใดๆ — มันคืออันดับหนึ่งอย่างไม่มีข้อโต้แย้ง มันเพิ่งเพิ่มความสามารถในการส่งออกภาพพื้นหลังโปร่งใสใน API และมี API สาธารณะพร้อมราคาที่มั่นคง Flux 3 image เป็นเหตุผลให้จับตาดู Black Forest Labs ไม่ใช่เหตุผลที่จะพักโปรเจกต์ไว้ ติดตามการเปิด Early Access และเกณฑ์มาตรฐานอิสระแรก ทันทีที่มี endpoint การเปรียบเทียบในโพสต์นี้จะกลายเป็นบททดสอบที่คุณลงมือทำได้จริง
