
Qwen-Image-3.0 พร้อมใช้งานทั่วไป (GA): โมเดลสร้างภาพที่ใช้งานได้จริงของ Alibaba เปิดให้บริการในราคา ¥0.18 ต่อภาพ
- Alibabaใหม่Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiใหม่Z.ai: GLM 5.3 Flash2026-08-2658ความฉลาด72การเขียนโค้ด
- DeepSeekใหม่DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 ต่อ 1 ล้านโทเค็น
- z-aiใหม่Z.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
ในวันที่ 5 สิงหาคม 2026 Qwen-Image-3.0 ไม่ได้เป็นพรีวิวเฉพาะผู้ได้รับเชิญอีกต่อไป และเปิดให้ผู้ใช้ทุกคนของแพลตฟอร์ม Qwen AI ของ Alibaba เข้าถึงได้ ตัวผลิตภัณฑ์นี้ตั้งราคาแบบสาธารณูปโภค มากกว่าจะเป็นบริการอาร์ตระดับพรีเมียม — การสร้างภาพจากข้อความเริ่มต้นที่ประมาณ ¥0.18 ต่อภาพสำหรับฝั่งผู้บริโภค โดยมีระดับ Pro ที่เหนือขึ้นไป — และกรอบความคิดของ Alibaba เองก็คือ นี่คือโมเดลภาพที่สร้างมาเพื่อทำงานจริง ไม่ใช่เพื่อชนะการประกวดความงาม หนึ่งสัปดาห์หลังเปิดให้ใช้งานทั่วไปเต็มรูปแบบ การวางกรอบเช่นนี้ควรค่าแก่การนำมาพิจารณาอย่างจริงจัง: สองสิ่งที่ Qwen-Image-3.0 ใช้เป็นจุดเด่น นั่นคือพรอมป์ที่ยาวมากและข้อความขนาดเล็กที่อ่านได้ชัดเจนมาก คือสองสิ่งที่โมเดลสร้างภาพส่วนใหญ่ล้มเหลวอย่างเงียบ ๆ พอดี
Qwen-Image-3.0 มีให้บริการในสองรุ่น — Qwen-Image-3.0-Pro และ Qwen-Image-3.0-Standard — ทั้งสองรุ่นใช้งานผ่าน API โฮสต์เดียวกัน การเปิดตัวเป็นแบบทยอย: ประกาศเมื่อวันที่ 21 กรกฎาคม 2026 โดยให้สิทธิ์เข้าถึง API เฉพาะผู้ได้รับเชิญบน Alibaba Cloud Bailian และแพลตฟอร์ม Qwen AI จากนั้นเปิดให้ใช้งานอย่างเต็มรูปแบบในวันที่ 5 สิงหาคม นักพัฒนาต่างประเทศเข้าถึงได้ผ่าน Qwen Cloud ซึ่งข้อมูลการเปิดตัวระบุว่า Pro ราคา $0.04 ต่อภาพ และ Standard ราคา $0.03 ต่อภาพ ราคาสำหรับผู้บริโภคในประเทศเริ่มต้นที่ประมาณ ¥0.18 ต่อภาพ ตัวเลขเหล่านี้เป็นตัวเลขที่ผู้ให้บริการรายงานไว้ และบทความนี้ถือว่าตัวเลขเหล่านั้นเป็นเช่นนั้น — เป็นตัวเลขที่ Alibaba เลือกที่จะเผยแพร่ ไม่ใช่ผลการตรวจสอบโดยอิสระ
การเปิดตัว ในตัวเลขสามตัว
ถ้าคุณจะอ่านเพียงสิ่งเดียวจากประกาศนี้ นั่นก็คือสามสิ่งนี้:
• พรอมต์ความยาว 4,500 โทเคน. Qwen-Image-3.0 รองรับความยาวพรอมต์มากกว่ารุ่นก่อนหน้าประมาณ 4.5 เท่า นั่นคือการเปลี่ยนแปลงที่ทำให้สิ่งอื่นๆ ทั้งหมดเป็นไปได้: พรอมต์สามารถระบุหน้าหนังสือพิมพ์ทั้งหน้า สตอรีบอร์ด อินโฟกราฟิกความรู้แบบตาราง 9 ช่อง หรือข้อสอบได้ในครั้งเดียว แทนที่จะต้องนำมาประกอบเข้าด้วยกันในโปรแกรมแก้ไข
• ~การเรนเดอร์ข้อความขนาด 10 พิกเซล. โมเดลแสดงผลข้อความขนาดเล็กที่อ่านออกได้ชัดเจน โดยมีความสูงของตัวพิมพ์ประมาณสิบพิกเซล — ความแตกต่างระหว่างภาพที่ดูเหมือนมีข้อความกับภาพที่อ่านได้จริง
• 12 ภาษา ฟอนต์ 20+ แบบ การแสดงผลหลายภาษาเป็นคุณสมบัติพื้นฐาน ไม่ใช่สิ่งที่เพิ่มเติมภายหลัง: จีน อังกฤษ เกาหลี และอื่น ๆ แสดงผลเป็นอักษรตามที่พรอมต์ร้องขอ โดยไม่มีกล่องแทนอักขระที่หายไป ซึ่งเป็นปัญหาของโมเดลที่ฝึกด้วยข้อมูลตะวันตกเป็นส่วนใหญ่เมื่อประมวลผลภาษา CJK
เพิ่มชิ้นส่วนที่พูดถึงน้อยกว่าแต่สำคัญพอๆ กัน — การแปลงภาพเป็นภาพและการแก้ไขภาพในโมเดลเดียวกัน แผนภาพความรู้ที่รวมสูตร เรขาคณิต และขั้นตอนการหาคำตอบ และต้นแบบที่สมจริงของอินเทอร์เฟซเว็บ เกม และไลฟ์สตรีม — ก็จะเห็นภาพรวมได้ชัดเจน อาลีบาบากำลังมุ่งเป้าไปที่งานผลิตจริง: การสร้างข้อสอบจำนวนมากเพื่อการศึกษา โปสเตอร์อีคอมเมิร์ซข้ามพรมแดน การจัดหน้าสิ่งพิมพ์ การสร้างต้นแบบ UI เอกสารเปิดตัวฉบับภาษาจีนสรุปตำแหน่งผลิตภัณฑ์ด้วยอักษรตัวเดียว: 实, "ใช้งานได้จริง".

สิ่งที่ได้รับการยืนยันอย่างเป็นอิสระจนถึงขณะนี้

นี่คือส่วนที่สำคัญสำหรับใครก็ตามที่เคยถูกเผาโดยการเปิดตัวที่ฉูดฉาด Qwen-Image-3.0 เป็นโมเดลแบบปิด: ไม่มีน้ำหนักโมเดล ไม่มีไลเซนส์ ไม่มีรายงานทางเทคนิค ไม่มีการเผยแพร่ผล benchmark อย่างเป็นทางการ นี่เป็นการกลับลำอย่างจงใจ — Qwen-Image 1.0 และ 2.0 เผยแพร่เป็นโอเพนซอร์ส น้ำหนักโมเดลภายใต้ Apache-2.0 บน Hugging Face พร้อมรายงานทางเทคนิคในวันเดียวกัน 3.0 ทำลายธรรมเนียมนั้น และ Alibaba ไม่ได้เผยแพร่ model card หรือจำนวนพารามิเตอร์ รายงานช่วงเปิดตัวแรกๆ ระบุว่ามีประมาณ 20B พารามิเตอร์บนสถาปัตยกรรม MMDiT แต่ให้ถือว่าเป็นเพียงรายงาน ยังไม่ได้รับการยืนยัน: เนื่องจากไม่มีรายงานให้ตรวจสอบ จึงไม่มีใครนอก Alibaba ที่จะยืนยันได้
นั่นหมายความว่าความสามารถหลักทุกอย่างที่กล่าวถึงข้างต้น — อินพุต 4,500 โทเค็น, ข้อความ 10px, 12 ภาษา — เป็น คำกล่าวอ้างจากผู้ขาย. หลักฐานอิสระที่แข็งแกร่งที่สุดเท่าที่มีมาคือการเปรียบเทียบเชิงปฏิบัติจริงจากจีน ซึ่งเผยแพร่ในช่วงเวลาเปิดตัว โดยนำ Qwen-Image-3.0-Pro ไปเปรียบเทียบกับคอนฟิกอื่นอีกสิบเอ็ดแบบ ผลลัพธ์ที่ได้ให้ภาพสองด้าน: Qwen-Image-3.0-Pro ดีเยี่ยมในการสร้าง UI/แดชบอร์ด แผนภาพทางวิทยาศาสตร์ และระบบการออกแบบแบบครบวงจร โดยมีคุณภาพผลลัพธ์โดยรวมสูงสุดในหมวดหมู่เหล่านั้น — แต่ก็เป็นโมเดลที่ช้าที่สุดโดยเฉลี่ย และข้อความขนาดเล็กก็ยังสร้างอักขระเพี้ยนในบางกรณี สำหรับความแม่นยำของข้อความอย่างเคร่งครัด การทดสอบเดียวกันนี้เลือก GPT-Image-2 medium, Gemini 3 Pro และ Seedream 5.0 Lite ภาพนี้มีประโยชน์และตรงไปตรงมา: แข็งแกร่งในเชิงโครงสร้าง แต่ยังไม่ไร้ที่ติสำหรับตัวอักษรขนาดเล็กที่โฆษณาไว้
ในฝั่งลีดเดอร์บอร์ด การรายงานการเปิดตัวของ Alibaba อ้างว่า Qwen-Image-3.0-Pro ขึ้นแท่นอันดับ 1 ในบรรดาโมเดลจีน และอันดับ 2 ในบรรดาโมเดลกระแสหลักบนลีดเดอร์บอร์ด Arena สำหรับการสร้างภาพจากข้อความ (text-to-image) ตามหลังซีรีส์ GPT-Image ของ OpenAI เว็บไซต์ติดตามผลอิสระ (AITNT, 5 สิงหาคม) แสดงให้เห็นว่าโมเดล Pro อยู่บนสุดของโมเดลของ Alibaba เองในทั้งหมวด Art Creation (1,256 Elo, ช่วงอันดับโลก 2–11) และ Photorealistic (1,258 Elo, ระดับโลก 4–13) โดยการจัดอันดับรายสัปดาห์ของ Arena เมื่อวันที่ 10 สิงหาคม โมเดล Pro อยู่อันดับที่ 7 โดยรวมในด้านการสร้างภาพ ซึ่งยังคงเป็นระดับแนวหน้า และน่าจับตาดูว่าจะรักษาอันดับนี้ไว้ได้หรือไม่เมื่อกระแสสัปดาห์เปิดตัวจางหายไป

สองรุ่น หนึ่งเรื่องราวด้านราคา
Qwen-Image-3.0-Pro และ Qwen-Image-3.0-Standard เป็นโมเดลตระกูลเดียวกันที่ตั้งราคาเป็นสองระดับ บน Qwen Cloud อัตราต่อภาพที่เผยแพร่คือ $0.04 สำหรับ Pro และ $0.03 สำหรับ Standard; อัตราสำหรับผู้บริโภคในประเทศเริ่มต้นที่ประมาณ ¥0.18 เมื่อเทียบเป็นบริบท ราคานี้อยู่ต่ำกว่าระดับกลางของ GPT-Image-2 และใกล้เคียงกับจุดที่ Nano Banana 2 Lite ของ Google วางไว้ — เป็นราคาที่ตั้งใจให้ 'ถูกพอที่จะวนซ้ำพัฒนาได้' ข้อควรระวังหนึ่งจากการตรวจสอบความพร้อมในการใช้งานโดยอิสระที่ควรชี้ให้เห็น: การตรวจสอบเดียวกันนี้ไม่พบรายการ Qwen-Image-3.0 ในหน้าราคาของ Model Studio บน Alibaba Cloud ณ จุดหนึ่งในช่วงปลายเดือนกรกฎาคม ช่องว่างนั้นถูกปิดในภายหลังเมื่อการเปิดตัว GA ดำเนินต่อไป แต่ก็เป็นเครื่องเตือนใจว่า API ของโมเดลที่เพิ่งเปิดตัวได้เพียงหนึ่งสัปดาห์อาจยังไม่เสถียร — ควรตรวจสอบหน้าราคาปัจจุบันก่อนที่จะนำไปใช้ในระบบการผลิต
ที่ที่คุณสามารถเรียกมันได้
Qwen-Image-3.0 เป็นโมเดลที่โฮสต์ให้บริการ ดังนั้นช่องทางเข้าถึงจึงเป็น API ของผู้ให้บริการเองและแพลตฟอร์มบุคคลที่สามหลายแห่งที่นำไปให้บริการตั้งแต่เปิดตัวทั่วไป (GA) ไม่มีตัวเลือกให้โฮสต์เองและไม่มีเส้นทางโอเพนเวตส์ (open-weights) ซึ่งสำคัญหากข้อกำหนดของคุณคือการเก็บข้อมูลในพื้นที่ (data residency) หรือการควบคุมไปป์ไลน์อย่างเต็มรูปแบบ ในด้านดี การเป็นแบบโฮสต์หมายถึงไม่ต้องวางแผนความจุ GPU คุณจ่ายต่อภาพและผู้ให้บริการปรับขนาดให้
นี่คือช่วงเวลาที่เราเตอร์พิสูจน์คุณค่าของมัน Qwen-Image-3.0 เป็นรุ่นใหม่เอี่ยมและหน้าราคาของมันก็เปลี่ยนไปแล้วครั้งหนึ่งในหนึ่งสัปดาห์; หากคุณกำลังประเมินมันเทียบกับโมเดลภาพอื่นๆ ในวงการ คุณคงไม่อยากต้องทำการเชื่อมต่อเฉพาะสำหรับแต่ละผู้ให้บริการในขณะที่คุณตัดสินใจ OrcaRouter นำเสนอโมเดลมากกว่า 200 รายการผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เพียงจุดเดียวในราคารายการของผู้ให้บริการโดยไม่บวกเพิ่ม ดังนั้นเมื่อผู้ให้บริการลดราคา — รวมถึงโมเดลที่เพิ่งออกมาได้หนึ่งสัปดาห์ — ฝั่งเราจะอัปเดตทันทีในวันเดียวกับที่ประกาศ การเฟลโอเวอร์อัตโนมัติหมายความว่าคุณสามารถรันเวิร์กโหลดที่ใกล้เคียงกับ Qwen-Image-3.0 ผ่านโมเดลที่เราให้บริการ (OpenAI's gpt-image-2, xAI's Grok Imagine, Google's Imagen 4 family) ได้โดยที่ไปป์ไลน์ภาพของคุณไม่ล่ม ขณะที่คุณเบนช์มาร์กโมเดลใหม่ตัวหนึ่งเทียบกับรุ่นอื่นๆ การเปรียบเทียบคือหัวใจสำคัญ: คีย์ API เดียว รูปแบบการเรียกเดียว และตัวเลขที่วางไว้เคียงข้างกัน
ใครควรลงมือตอนนี้
ทีมที่สร้างงานที่มีความหนาแน่นและเต็มไปด้วยข้อความ เช่น เอกสารข้อสอบ แผ่นผลิตภัณฑ์ โปสเตอร์หลายภาษา ต้นแบบแดชบอร์ด สตอรีบอร์ด คือกลุ่มผู้ใช้งานช่วงแรกโดยธรรมชาติ เพราะนี่คืองานที่พรอมต์ 4,500 โทเคนพร้อมการเรนเดอร์หลายภาษาโดยกำเนิดช่วยประหยัดเวลาหลายชั่วโมงในการต่อประกอบและพิมพ์ซ้ำ ทีมที่มีมาตรฐานด้านความสมจริงเหมือนภาพถ่ายหรือความเที่ยงตรงของการพิมพ์อย่างสมบูรณ์ มีตัวเลือกที่ได้รับการพิสูจน์แล้วมากกว่าในปัจจุบัน และข้อมูลการทดสอบอิสระสนับสนุนการรอให้ปัญหาข้อความขนาดเล็กได้รับการแก้ไขให้แน่นขึ้น ไม่ว่ากรณีใด อย่าวางใจเพียงคำกล่าวอ้างตอนเปิดตัว: โมเดลเป็นแบบปิด ดังนั้นสิ่งเดียวที่จะบอกคุณได้ว่ามันสมควรได้ตำแหน่งในสแตกของคุณหรือไม่ คือการลองรันพรอมต์จริงของคุณเองกับมัน ซึ่งที่ราคา $0.03–$0.04 ต่อภาพถือเป็นการทดลองที่ถูกมาก
