การ์ดชื่อเรื่องหลักสำหรับ GPT-Image-2 กับ Flux 3 หัวข้อข่าว 'GPT-Image-2 vs Flux 3' พร้อมคำบรรยายใต้หัวข้อ 'หนึ่งโมเดลที่ใช้งานจริง หนึ่งโรดแมป' การ์ดสองใบที่แสดง GPT-Image-2 พร้อมป้าย 'Public API ตั้งแต่พฤษภาคม 2026' และ Flux 3 พร้อมป้าย 'ระดับภาพ: เร็วๆ นี้' โลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

GPT-Image-2 vs Flux 3: เปรียบเทียบโมเดลที่ใช้งานจริงกับโรดแมป

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

นี่ไม่ใช่โพสต์เปรียบเทียบโมเดลกับโมเดลแบบปกติ เพราะว่า GPT-Image-2 และ Flux 3 ไม่ได้ดำรงอยู่ในสถานะเดียวกัน GPT-Image-2 เปิดตัวเมื่อวันที่ 21 เมษายน 2026 เรียกใช้ได้ผ่าน API ของ Ope​nAI ตั้งแต่ต้นเดือนพฤษภาคม และเพิ่มความสามารถใหม่ในสัปดาห์นี้ — การสร้างภาพพื้นหลังโปร่งใสใน API ซึ่งประกาศเมื่อวันที่ 20 สิงหาคม และเปิดให้ใช้ได้แล้วตอนนี้ Flux 3 คือโมเดลพื้นฐานมัลติโมดัลของ Black Forest Labs ประกาศเมื่อวันที่ 23 กรกฎาคม 2026 และส่วนของการสร้างภาพ (image tier) ยังไม่มี endpoint สาธารณะ ไม่มี model ID และไม่มีรายการราคา ณ เวลาที่เขียนบทความนี้ หนึ่งในสองโมเดลนี้คุณสามารถเรียกใช้ได้ตอนตี 3 ด้วยคีย์ที่ถูกต้อง ส่วนอีกตัวคุณลงทะเบียนเพื่อเข้าคิวรอได้ การเปรียบเทียบที่มีประโยชน์จึงไม่ใช่ "อันไหนดีกว่า" — แต่เป็นสิ่งที่โมเดลที่เปิดตัวแล้วทำได้จริงในวันนี้ สิ่งที่โรดแมประบุไว้สำหรับโมเดลที่ยังไม่เปิดตัว และวิธีที่นักพัฒนาควรปฏิบัติต่อโมเดลที่ถูกสัญญาไว้แต่เลื่อนออกไปเรื่อย ๆ ในขณะที่โมเดลที่ใช้งานจริงยังคงพัฒนาขึ้นเรื่อย ๆ

หนึ่งในนี้มีจุดสิ้นสุด

เริ่มต้นด้วยความพร้อมใช้งาน เพราะมันเป็นตัวกำหนดทุกอย่างอื่น Black Forest Labs เปิดตัว Flux 3 เมื่อวันที่ 23 กรกฎาคม ในฐานะโมเดลเดียวที่ฝึกฝนร่วมกันบนการคาดคะเนภาพ วิดีโอ เสียง และการกระทำของหุ่นยนต์ สร้างขึ้นบนแนวทาง flow-matching ที่ห้องแล็บเรียกกว่า Self-Flow ประมาณกว่า 95% ของการคำนวณสำหรับการฝึกนั้นรายงานว่าใช้ไปกับการคาดคะเนวิดีโอ ซึ่งเห็นได้จากสิ่งที่เปิดตัวจริง: มีเพียง Flux 3 Video ที่ถึงขั้นพร้อมใช้งานทั่วไป เมื่อวันที่ 4 สิงหาคม พร้อม API ที่คิดค่าใช้จ่าย หน้าของโมเดลระดับภาพยังคงติดป้าย "เร็วๆ นี้" พร้อมแบบฟอร์มสมัคร ไม่ใช่ปุ่มเริ่มต้นใช้งาน — ไม่มี endpoint ไม่มีพารามิเตอร์ที่ระบุ ไม่มีต้นทุนต่อภาพ และไม่มีเกณฑ์มาตรฐานที่ใครจะรันได้

ในทางตรงกันข้าม GPT-Image-2 ถูกใช้งานในระบบโปรดักชันมาแล้วสี่เดือน OpenAI เปิดให้เข้าถึง API ตั้งแต่ต้นเดือนพฤษภาคม และตัวระบุรุ่น gpt-image-2 มีความเสถียรพอที่จะมีสแนปชอตแบบตรึงถาวร gpt-image-2-2026-04-21 อยู่เคียงข้างกัน ปัจจุบันมันเป็นโมเดลข้อความสู่รูปภาพอันดับหนึ่งบนกระดานจัดอันดับอิสระหลักทั้งสองแห่ง — 1,381 Elo บนลีดเดอร์บอร์ด text-to-image ของ Arena (build ระดับกลาง) และ 1,369 Elo สำหรับ build ระดับสูงบน Artificial Analysis — และมันสามารถเรนเดอร์ข้อความหลายภาษา รวมถึงภาษา CJK, ใช้เว็บเสิร์ชเป็นพื้นฐานในการสร้างภาพ และให้ผลลัพธ์ความละเอียดสูงสุดถึง 4K สี่เดือนของปริมาณการใช้งานจริงคือสิ่งที่แยกข้อกล่าวอ้างออกจากประวัติผลงานที่แท้จริง

การเปลี่ยนแปลงล่าสุดทางฝั่ง GPT-Image-2

เหตุการณ์ที่ทำให้การจับคู่แข่งขันครั้งนี้มาถูกจังหวะไม่ได้เกี่ยวกับ Flux 3 เลย เมื่อวันที่ 20 สิงหาคม OpenAI เปิดตัวพรีวิวแบบพื้นหลังโปร่งใสสำหรับ GPT-Image-2 ใน Images API: เพียงตั้งค่า background เป็น "transparent" endpoint ก็จะส่งคืนไฟล์ PNG หรือ WebP ที่มี alpha channel จริง ตัดพื้นหลังออกมาและพร้อมนำไปประกอบภาพ นี่คือฟีเจอร์ที่พุ่งเป้าไปที่งานด้านโปรดักชันโดยตรง ซึ่งโรดแมปของ Flux 3 image ก็ขายอยู่อีกเช่นกัน ไม่ว่าจะเป็นภาพถ่ายผลิตภัณฑ์ ไอคอน หรือสื่อการตลาด — และมันมาในรูปแบบพารามิเตอร์บน endpoint ที่เปิดใช้งานอยู่แล้วแทนที่จะเป็นโมเดลใหม่ ดังนั้น ในขณะที่คนทั้งโลกรอคอย Flux 3 image endpoint ซึ่งยังขึ้นข้อความว่า "coming soon" ผู้เล่นรายเดิมก็เพิ่งปิดช่องว่างข้อหนึ่งที่เคยทำให้ตัวเองถูกกีดกันออกจากไปป์ไลน์การคอมโพสิตภาพสำเร็จ

ความสามารถนี้ใช้งานผ่าน API เท่านั้น — ไม่มีตัวสลับใน ChatGPT — และเป็นพารามิเตอร์ ไม่ใช่ผลิตภัณฑ์ใหม่ เอนด์พอยต์ทั้งสองของ Images API ได้แก่การสร้าง (generation) และการแก้ไข (edit) รองรับฟิลด์ background โดยมีค่า "transparent", "opaque" และ "auto" (ค่าเริ่มต้น ซึ่งโมเดลจะเป็นผู้ตัดสินใจ) อัลฟาแชนเนลจะคงอยู่เฉพาะในผลลัพธ์แบบ PNG หรือ WebP เท่านั้น ดังนั้นคำขอจึงต้องระบุรูปแบบเอาต์พุตอย่างชัดเจน เอกสารอ้างอิง API ของ Ope​nAI เองยังคงระบุว่าการรองรับพื้นหลังโปร่งใสสำหรับ gpt-image-2 และสแนปช็อต gpt-image-2-2026-04-21 อยู่ในสถานะ "in preview" — ซึ่งเป็นป้ายกำกับของผู้ให้บริการ ไม่ใช่การประกาศว่าพร้อมใช้งานจริง — และคำแนะนำคือให้พรอมปต์ไม่มีการบรรยายถึงฉากหลังใดๆ เพื่อให้โมเดลทำตามคำขอแบบโปร่งใสได้จริง ไม่มีเอนด์พอยต์ใหม่ ไม่มีรหัสโมเดลใหม่ ไม่มีเรตค่าบริการแยกต่างหาก: การเรียก gpt-image-2 เดิมที่เคยคืนภาพ PNG ทึบแสง ตอนนี้จะคืนภาพตัดพื้นหลัง (cutout) แทน

Comparison scoreboard titled 'GPT-Image-2 vs Flux 3 - the scoreboard'. GPT-Image-2 column: Released Apr 21, 2026; Availability Public API since May; Arena T2I Elo 1,381 (#1); Text rendering multilingual incl. CJK; Transparent bg preview Aug 20; Max resolution 4K. Flux 3 column: Released announced Jul 23, 2026; Availability image tier coming soon; Arena T2I Elo none yet; Text rendering promised; Transparent bg not stated; Max resolution not specified. Footer: GPT-Image-2 figures per Arena and OpenAI list pricing; Flux 3 image claims are a vendor roadmap. OrcaRouter logo bottom-right.

Flux 3 image สัญญาอะไรไว้ และสิ่งที่ส่งมอบจริงคืออะไร

สเปกชีตของระดับภาพ Flux 3 เป็นแผนงานของผู้จำหน่าย ดังนั้นควรถือว่ามันเป็นเช่นนั้น Black Forest Labs ได้สัญญาว่าจะมีการสร้างและแก้ไขภาพในหลากหลายสไตล์และความละเอียด การจัดการพรอมป์ที่ซับซ้อนดีขึ้น การเรนเดอร์ข้อความหลายภาษาแบบมีความแม่นยำสูง การถ่ายโอนสไตล์แบบ zero-shot จากภาพอ้างอิง ความสม่ำเสมอของตัวละครและแบรนด์โดยไม่ต้องปรับแต่ง และการแก้ไขแบบไม่ทำลายซึ่งคงรักษาพื้นผิวและแสงไว้ สิ่งเหล่านี้เป็นสิ่งที่ควรสัญญา — ซึ่งเป็นคุณสมบัติที่ผู้นำตลาดในปัจจุบันแข่งขันกันอยู่พอดี — แต่ไม่มีสิ่งใดที่ทดสอบได้ในวันนี้ เพราะไม่มีสิ่งใดที่มีเอนด์พอยต์

สิ่งที่เรียกใช้ได้จริงจาก BFL คือระดับวิดีโอและไลน์ภาพ FLUX รุ่นเก่า Flux 3 Video ขายในราคา $0.17 ต่อวินาทีที่ความละเอียด HD และ $0.29 ต่อวินาทีที่ FHD สำหรับการเรนเดอร์เต็มรูปแบบ พร้อมโหมดร่าง (draft mode) ราคา $0.06 ต่อวินาที ตัวเลขที่รายงานเองคือ 1,135 Elo สำหรับข้อความเป็นวิดีโอ และ 1,051 สำหรับภาพเป็นวิดีโอ และชนะในด้านความชอบเหนือ Luma Ray 3.2, Runway Gen-4.5, Gr​ok Imagine Video และ Kling v3 Pro — ทั้งหมดเป็นข้อมูลที่บริษัทผู้พัฒนารายงานเองและยังไม่มีการตรวจสอบซ้ำ และก็ไม่ส่งผลต่อระดับภาพแต่อย่างใด สำหรับภาพนิ่ง สิ่งที่ BFL นำเสนอในปัจจุบันยังคงเป็นไลน์ FLUX.2 ซึ่งอยู่ที่ 1,226 Elo บนกระดาน Artificial Analysis เดียวกันกับที่ GPT-Image-2 เป็นผู้นำที่ 1,369 ช่องว่างนั้นคือบริบทเชิงปฏิบัติของคำว่า 'Flux 3 image กำลังจะมา': API ภาพของ BFL ในปัจจุบันนั้นตามหลัง API ของ Ope​nAI อยู่ประมาณ 140 Elo และโมเดลที่ถูกสัญญาไว้คือสิ่งที่ BFL ต้องการเพื่อปิดช่องว่างนั้น

Screenshot of the Artificial Analysis Text-to-Image leaderboard (captured August 20, 2026) showing GPT Image 2 (high) in first place at 1,369 Elo and Black Forest Labs' current image entry FLUX.2 (max) at 1,226 Elo, with no Flux 3 image entry present, in English.

ราคา: มีการ์ดราคาจริงเพียงใบเดียวเท่านั้น

ไม่มีราคาสำหรับภาพ Flux 3 เพราะไม่มีผลิตภัณฑ์ภาพ Flux 3 ตัวเลขที่เผยแพร่เพียงอย่างเดียวคืออัตราโทเคนของ GPT-Image-2: $5 ต่อล้านโทเคนสำหรับข้อความนำเข้า, $8 ต่อล้านโทเคนสำหรับภาพนำเข้า และ $30 ต่อล้านโทเคนสำหรับภาพส่งออก โดย Batch API คิดราคาประมาณครึ่งหนึ่งสำหรับการประมวลผลภายใน 24 ชั่วโมง Ope​nAI ไม่ได้เผยแพร่จำนวนโทเคนต่อภาพ ดังนั้นตัวเลขต่อภาพจึงเป็นการแปลงค่า ไม่ใช่ราคาอ้างอิง: ประมาณ $0.006 สำหรับภาพคุณภาพต่ำขนาด 1024×1024, ประมาณ $0.05 สำหรับภาพคุณภาพปานกลาง, ประมาณ $0.21 สำหรับคุณภาพสูง และสูงสุดประมาณ $0.41 สำหรับการเรนเดอร์คุณภาพสูงขนาด 4K สำหรับการเปรียบเทียบ นั่นคือด้านหนึ่งของบัญชีที่มีข้อมูลจริง ส่วนคอลัมน์ภาพ Flux 3 เป็นเซลล์ว่าง

Screenshot of the OrcaRouter model page for openai/gpt-image-2 (captured August 20, 2026), showing the model description, input rate of $8.00 and output rate of $30.00 per million tokens, median latency, and community usage, in English.

สิ่งที่ผู้สร้างควรทำกับโมเดลที่สัญญาไว้

ท่าทีที่สมเหตุสมผลเมื่อโมเดลของคู่แข่งเลื่อนเปิดตัวซ้ำแล้วซ้ำเล่า คือการต่อยอดจากสิ่งที่มีอยู่ และทำให้อนาคตเป็นเพียงการเปลี่ยนคอนฟิก ไม่ใช่การปรับสถาปัตยกรรมใหม่ GPT-Image-2 ใช้งานผ่าน OrcaRouter ได้แล้ววันนี้ — คีย์ API เดียว ราคารายการของ Ope​nAI ที่ส่งผ่านโดยมาร์กอัป 0% และมี failover อัตโนมัติข้ามผู้ให้บริการ — ดังนั้นไปป์ไลน์ที่สร้างแอสเซ็ตด้วยมันสามารถชี้เอนด์พอยต์เดียวกันไปที่ API ของ Flux 3 image ในวันที่เอนด์พอยต์มีจริง และจัดเส้นทางทราฟฟิกบางส่วนไปยังมันด้วย routing DSL โดยไม่ต้องแตะโค้ดที่เรียกใช้ คุณได้โมเดลที่ปล่อยออกมาจริงแล้วตอนนี้ และเมื่อโมเดลที่สัญญาไว้ออกมา คุณก็ประเมินมันเทียบกับ baseline ที่ทำงานได้จริง แทนที่จะเทียบกับข่าวประชาสัมพันธ์ การรอไม่ทำให้คุณเสียอะไรเลย แต่การสร้างบนความว่างเปล่าขณะที่รอ ทำให้คุณเสียทุกอย่าง

บทสรุปนี้เอนเอียงโดยเจตนา หากคุณต้องการสร้างภาพในไตรมาสนี้ GPT-Image-2 คือคำตอบ และไม่มีข้อกังขาใดๆ — มันคืออันดับหนึ่งอย่างไม่มีข้อโต้แย้ง มันเพิ่งเพิ่มความสามารถในการส่งออกภาพพื้นหลังโปร่งใสใน API และมี API สาธารณะพร้อมราคาที่มั่นคง Flux 3 image เป็นเหตุผลให้จับตาดู Black Forest Labs ไม่ใช่เหตุผลที่จะพักโปรเจกต์ไว้ ติดตามการเปิด Early Access และเกณฑ์มาตรฐานอิสระแรก ทันทีที่มี endpoint การเปรียบเทียบในโพสต์นี้จะกลายเป็นบททดสอบที่คุณลงมือทำได้จริง

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube