
Qwen-Image-2.1 เป็นโมเดลภาพแบบเปิดน้ำหนักที่ดีที่สุดบนกระดานจัดอันดับของ Artificial Analysis ทั้งสองแห่ง
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 223 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
ทีม Qwen ของ Alibaba เปิดตัว Qwen-Image-2.1พร้อมน้ำหนักแบบเปิดเผยเมื่อวันที่ 20 กันยายน 2026 สิบสองวันต่อมา กระดานคะแนนอิสระก็ตามมาทันผล และผลลัพธ์ก็น่าสนใจยิ่งกว่าตอนเปิดตัว ในAA-Image-T2I v2.0ลีดเดอร์บอร์ด Qwen-Image-2.1 อยู่อันดับที่ 18 จากทั้งหมด 166 ด้วยคะแนน Elo 1,034 จากการเปรียบเทียบแบบไม่เห็นชื่อ 5,286 ครั้ง บนAA-Image-Editing v2.0มันอยู่อันดับที่ 18 จาก 97 ด้วยคะแนน Elo 1,074 จากการเปรียบเทียบ 5,536 ครั้ง ทั้งสองแถวนั้นถูกทำเครื่องหมายว่า น้ำหนักแบบเปิดเผยบนกระดานที่ติดป้ายกำกับทุกโมเดลเป็นรายตัว ไม่มีโมเดลอื่นใดที่ติดป้ายนั้นบนกระดานใดกระดานหนึ่งถูกจัดให้อยู่เหนือพวกมัน นั่นคือข้อค้นพบทั้งหมด: บนกระดานภาพสาธารณะเพียงสองแห่งที่ให้คะแนนโมเดลด้วยการเปรียบเทียบแบบจับคู่โดยไม่เห็นชื่อ Qwen-Image-2.1 ที่เปิดตัวแล้วคือชุดน้ำหนักที่ดาวน์โหลดได้แข็งแกร่งที่สุดในวงการ และเป็น Qwen-Image-2.1ตัวจริง ไม่ใช่พรีวิวของมัน ที่ครองทั้งสองตำแหน่ง
ต่อไปนี้คือที่มาของตัวเลขสองตัวนั้น ลักษณะของแถวรอบ ๆ ตัวเลขเหล่านั้น และรายละเอียดสามประการบนบอร์ดที่การรายงานข่าวการเปิดตัวส่วนใหญ่ละไว้ — โดยเริ่มจากข้อเท็จจริงที่ว่าบอร์ดไม่ได้บันทึก API ใด ๆ ไว้ที่ไหนเลยสำหรับโมเดลนี้
ที่สองแถวนั้นตั้งอยู่
Artificial Analysis สร้างบอร์ดทั้งสองจากการเปรียบเทียบแบบจับคู่โดยไม่เปิดเผยตัวตน โดยโมเดลสองตัวตอบพรอมป์ต์เดียวกัน ผู้โหวตเลือกเอาต์พุตที่ดีกว่า และค่า Elo ก็ได้มาจากการรวมผลลัพธ์ บอร์ดทั้งสองมีแค่สไตล์เฉพาะของสำนักที่เหมือนกัน นอกนั้นไม่มีอะไรเหมือนกัน ทั้งสองให้คะแนนงานที่ต่างกัน มีกลุ่มประชากรที่ต่างกัน และค่า Elo ของทั้งสองก็ไม่สามารถนำมาเปรียบเทียบกันได้ Qwen-Image-2.1 บังเอิญได้อันดับเดียวกันในทั้งสองบอร์ด ซึ่งเป็นความบังเอิญจากสองการแจกแจงที่แตกต่างกัน
ข้อความเป็นภาพ, 166 โมเดลบนบอร์ด:
• แถวบนสุดของลีดเดอร์บอร์ดคือ GPT Image 2.5 Sunburst (max) ที่ 1,107 Elo จาก 14,023 ครั้งที่ปรากฏ — โมเดลแบบปิดที่มีตัวอย่างมากกว่าสองเท่าของ Qwen-Image-2.1
• Qwen-Image-2.1 อยู่ในอันดับที่ 18 ด้วยคะแนน Elo 1,034 และช่วงความเชื่อมั่น 95% ที่ 1,024 ถึง 1,044 จากการปรากฏตัว 5,286 ครั้ง
• อ่านจำนวนแถวก่อนที่จะดูอันดับ Qwen-Image-2.1 อยู่อันดับที่ 18 บนทั้งสองกระดาน แต่ลำดับเหล่านั้นมาจากกลุ่มประชากรที่ต่างกัน — 166 โมเดลในงานสร้างภาพจากข้อความ และ 97 โมเดลในงานแก้ไขภาพ — และค่า Elo สองค่าก็อยู่ในสองสเกลที่แยกจากกัน การที่อันดับออกมาเหมือนกันเป็นเรื่องของเลขคณิต ไม่ใช่หลักฐานว่าทั้งสองกระดานเห็นตรงกันในเรื่องใดเลย
• โมเดลระดับ Pro สองตัวของ Alibaba เองอยู่อันดับเหนือกว่ามันบนบอร์ดนี้: Qwen-Image-3.0-Pro ที่ 1,089 Elo อันดับ 14 และ Qwen-Image-3.0 ที่ 1,075 อันดับ 16 ทั้งคู่ไม่มีเครื่องหมาย Open Weights สแนปช็อตเดือนกันยายนของบอร์ดระบุว่าทั้งคู่เป็นรุ่นที่วางจำหน่ายในเดือนกรกฎาคม 2026 ซึ่งเป็นเวอร์ชันของเรื่องที่โมเดลภาพ Qwen ใหม่ล่าสุดไม่ใช่ตัวที่ได้คะแนนสูงสุด — และในด้าน text-to-image มันก็ไม่ใช่
การแก้ไขรูปภาพ, 97 โมเดลบนบอร์ด:
• GPT Image 2.5 Sunburst (max) ก็ครองอันดับต้นของบอร์ดนี้เช่นกัน ด้วยคะแนน 1,182 Elo จากการปรากฏตัว 17,899 ครั้ง
• Qwen-Image-2.1 อยู่อันดับ 18 ด้วย 1,074 Elo ช่วง 1,065 ถึง 1,083 จากจำนวนครั้งที่ปรากฏ 5,536 ครั้ง — เป็นตัวอย่างที่ใหญ่กว่าแถว text-to-image ของมันเล็กน้อย ซึ่งสมเหตุสมผลสำหรับโมเดลที่ฝั่งการแก้ไขได้รับข้อความเปิดตัวที่ดังกว่า
• แถวโดยรอบของมันแน่นขนัด grok-imagine-image อยู่ต่ำลงมาหนึ่งอันดับที่ 1,071 และ Luma UNI 1 Max ที่ 1,069 แถวแบบโอเพนเวตที่ใกล้ที่สุดใต้มันบนกระดานนี้คือ HunyuanImage 3.0 Instructที่ 1,066 จากการปรากฏ 5,221 ครั้ง — ห่าง 8 Elo มีเจ็ดแถวอยู่ในช่วง 18 คะแนน Elo
อ่านข้อกล่าวอ้าง "โมเดล open-weights ชั้นนำ" อย่างตรงไปตรงมา
วลีในพาดหัวข่าวกำลังทำหน้าที่เฉพาะเจาะจง และมันสมควรได้รับการตรวจสอบมากกว่าการพูดซ้ำ
• มันคืออันดับภายในกลุ่มที่มีเครื่องหมายกำกับ ไม่ใช่อันดับโดยรวม Qwen-Image-2.1 อยู่อันดับที่ 18 ในภาพรวมของทั้งสองบอร์ด ป้าย Open Weights คือสิ่งที่ทำให้มันเป็นที่หนึ่งในแต่ละบอร์ด และป้ายนี้ถูกกำหนดให้แต่ละโมเดลโดยดุลยพินิจของบอร์ดเอง — มี 47 แถวในหมวด text-to-image ที่มีเครื่องหมายนี้ ส่วนบอร์ด editing มี 36 แถวที่มีเครื่องหมายดังกล่าว ซึ่งมีรายการทั้งหมด 97 รายการ
• เครื่องหมายนี้อธิบายเรื่องเวต ไม่ใช่ข้อกำหนด Qwen-Image-2.1 เผยแพร่ภายใต้ข้อตกลงสัญญาอนุญาต Qwen Research License Agreement ลงวันที่ 20 กันยายน 2026 ซึ่งให้สิทธิ์สำหรับวัตถุประสงค์ที่ไม่ใช่เชิงพาณิชย์เท่านั้น ป้าย Open Weights ของคณะกรรมการนั้นถูกต้องในเรื่องความสามารถในการดาวน์โหลด และไม่พูดถึงสิ่งที่คุณทำได้กับไฟล์ที่ดาวน์โหลดมา ใครก็ตามที่อ่าน "โมเดลภาพแบบเปิดเวตระดับท็อป" ว่า "ใช้ในผลิตภัณฑ์ได้ฟรี" ได้อ่านป้ายนี้เลยความหมายของมันไปแล้ว
• นี่เป็นภาพ ณ ขณะหนึ่ง ไม่ใช่การจัดอันดับที่สรุปแน่นอนแล้ว กระดานขยับทุกวันเมื่อคะแนนโหวตสะสมเพิ่มขึ้น ช่วงความเชื่อมั่นของ Qwen-Image-2.1 อยู่ที่ ±10 Elo สำหรับการสร้างภาพจากข้อความ และ ±9 สำหรับการแก้ไขภาพ; แถวที่อยู่ถัดลงมาอยู่ในช่วงที่ทับซ้อนกัน ให้ถือว่าตำแหน่งนี้เป็นสถานะปัจจุบันมากกว่าจะเป็นตำแหน่งถาวร
รายละเอียดที่การรายงานข่าวการเปิดตัวไม่มี: ไม่มี API
แถวของ Qwen-Image-2.1 ทั้งสองแถวมีไม่มี API ให้ใช้งานกำกับไว้อย่างชัดเจน นั่นเป็นต้นทุนที่แท้จริงต่อการจัดอันดับ และมันบอกอะไรบางอย่างเกี่ยวกับว่าใครเป็นคนสร้างโหวต 5,286 และ 5,536 โหวตนั้น — หากไม่มีปลายทางให้ชี้พรอมป์ต์ไปที่ได้ การเปรียบเทียบก็มาจากคนที่รันเวตส์เองแล้วส่งผลลัพธ์เข้ามา Elo แบบอิสระสำหรับโมเดลที่โฮสต์เองเท่านั้นเป็นการวัดที่ยากกว่าจริง ๆ เมื่อเทียบกับ Elo สำหรับสิ่งที่ใครก็เรียกใช้ได้ และนั่นคือเหตุผลที่ตัวอย่างตรงนี้มีขนาดเพียงหนึ่งในสามของแถวอันดับต้น ๆ
สำหรับนักพัฒนา รูปแบบของเรื่องนี้เป็นสิ่งที่คุ้นเคย: โมเดลรูปภาพที่ดาวน์โหลดได้ที่แข็งแกร่งที่สุดในวงการไม่ใช่ตัวที่คุณเรียกใช้ได้ในวันนี้ ในทางปฏิบัติ สิ่งนี้ทำให้งานแยกออกเป็นสองทาง คุณจะให้บริการ Qwen-Image-2.1 ด้วยตัวเองบนฮาร์ดแวร์ของคุณเอง หรือจะเรียกใช้หนึ่งในโมเดลรอบๆ บนบอร์ดนี้ ทางเลือกที่สองคือจุดที่ระบบกำหนดเส้นทางพิสูจน์คุณค่าของมัน — API เดียวที่ครอบคลุมโมเดลกว่า 200 รายการ โดยส่งผ่านราคาตามรายการของผู้ให้บริการโดยไม่บวกเพิ่ม, การสลับไปใช้ระบบสำรองอัตโนมัติเมื่อผู้ให้บริการมีประสิทธิภาพลดลง และ DSL สำหรับการกำหนดเส้นทางเพื่อประกอบโมเดลหลายตัวให้เป็นการเรียกครั้งเดียว OrcaRouter ยังไม่ให้บริการ Qwen-Image-2.1 ในวันนี้ ส่วนสายผลิตภัณฑ์รูปภาพบนแพลตฟอร์มประกอบด้วยระดับต่างๆ ของ Imagen จาก Google และตัวอย่างรูปภาพ Gemini, ปลายทางรูปภาพ Grok Imagine ของ xAI และตระกูล GPT-Image ของ OpenAI บนบอร์ดนี้ นั่นคือแถว GPT Image 2.5 Sunburst ที่อยู่บนสุด และมันเป็นคำตอบที่สมเหตุสมผลสำหรับ "ฉันต้องการคะแนนที่ดีที่สุดและต้องการให้เรียกใช้ได้บ่ายนี้"

สิ่งที่ต้องจับตาบนบอร์ด
สามสิ่งที่จะขับเคลื่อนเรื่องนี้ และทั้งสามอย่างปรากฏอยู่บนกระดานแล้ว
ข้อแรกคือว่า API จะปรากฏขึ้นหรือไม่ หาก Alibaba หรือพาร์ตเนอร์ผู้ให้บริการนำ Qwen-Image-2.1 ไปไว้หลังเอนด์พอยต์ ไม่มี API ให้ใช้งาน โน้ตนั้นจะหายไป ปริมาณโหวตควรไต่ขึ้นไปใกล้เคียงกับขนาดของแถวข้างเคียง และช่วงความเชื่อมั่นจะแคบลง ช่วงที่แคบลงบน 1,034 หรือ 1,074 ถือเป็นข้อกล่าวอ้างที่แข็งแรงกว่าช่วงปัจจุบันมาก
ตัวที่สองคือสแต็กของ Alibaba เอง Qwen-Image-3.0-Pro ที่ 1,089 และ Qwen-Image-3.0 ที่ 1,075 ต่างก็จัดอันดับเหนือกว่า Qwen-Image-2.1 ในด้าน text-to-image ขณะที่ไม่มีเครื่องหมาย Open Weights หาก Qwen-Image-2.1 ถูกตั้งใจให้เป็นคู่เทียบที่ดาวน์โหลดได้ของไลน์นั้น มากกว่าจะเป็นรุ่นสืบทอด คำถามที่น่าสนใจคือช่องว่างจะแคบลงหรือไม่ — และบนกระดานการแก้ไขภาพ มันก็แคบลงแล้ว โดยที่ Qwen-Image-3.0-Pro นำ Qwen-Image-2.1 อยู่สองคะแนน Elo
ประการที่สามคือสัญญาอนุญาต ทุกแถว Open Weights บนทั้งสองบอร์ดล้วนมีสิทธิ์ได้รับป้ายนี้เท่าเทียมกัน และสัญญาอนุญาตที่อยู่เบื้องหลังนั้นไม่ได้เท่าเทียมกันเลยแม้แต่น้อย บอร์ดจะไม่มีวันบอกคุณเรื่องนั้น มันคือคอลัมน์เดียวที่สกอร์บอร์ดไม่มี

คำถามที่พบบ่อย
Qwen-Image-2.1 เป็นโมเดลรูปภาพแบบเปิดน้ำหนักที่ดีที่สุดหรือไม่
บนสองบอร์ดนี้ ใช่ — มันคือแถวที่มี Elo สูงที่สุดที่ติดเครื่องหมาย Open Weights ทั้งสองบอร์ด โดยอยู่ที่ 1,034 ใน text-to-image และ 1,074 ใน editing โดยภาพรวมมันอยู่ในอันดับที่ 18 บนแต่ละบอร์ด — และเลข 18 นั้นเป็นอันดับภายใน 166 แถวบนบอร์ดหนึ่ง และภายใน 97 แถวบนอีกบอร์ด ซึ่งแทนสเกล Elo สองสเกลที่ไม่สามารถนำมาเปรียบเทียบกันได้ ข้อกล่าวอ้างนี้จะใช้ได้ก็ต่อเมื่อตัวระบุเงื่อนไขทั้งสองยังคงแนบอยู่
ทำไมบอร์ดทั้งสองจึงแสดงค่า Elo ที่แตกต่างกันสำหรับโมเดลเดียวกัน
ระบบให้คะแนนงานที่แตกต่างกันโดยเทียบกับกลุ่มประชากรมодеลที่ต่างกัน Elo ของ text-to-image กับ Elo ของงานแก้ไขภาพเป็นสองสเกลที่แยกจากกัน การนำ 1,034 ไปเทียบกับ 1,074 นั้นเป็นการวัดกระดานจัดอันดับ ไม่ใช่การวัดตัวโมเดล
ฉันสามารถเรียกใช้ Qwen-Image-2.1 ผ่าน API ได้ไหม
ทั้งสองแถวบนบอร์ดบันทึกว่า ไม่มี API ให้บริการ ค่าน้ำหนักของโมเดลสามารถดาวน์โหลดได้จากที่เก็บของ Alibaba ดังนั้นโมเดลจึงรันได้ — เพียงแต่ไม่มีเอนด์พอยต์แบบโฮสต์ที่บอร์ดให้เครดิตว่าทำหน้าที่ให้บริการโมเดลนี้
ถ้าคุณอยากได้ตัวเลขวันนี้แทนที่จะต้องดาวน์โหลด อันดับต้น ๆ ของทั้งสองบอร์ดสามารถเรียกใช้ได้ผ่าน API ของผู้ขายเอง และตระกูล GPT-Image, ระดับต่าง ๆ ของ Imagen จาก Google และ Grok Imagine ของ xAI คือโมเดลรูปภาพที่ OrcaRouter เปิดให้ใช้โดยตรง เก็บไฟล์น้ำหนักไว้สำหรับการทดลอง และเก็บเอนด์พอยต์ไว้สำหรับกำหนดเส้นตาย
