ส่วนหัวของโพสต์บล็อกของผู้ให้บริการ Qwen ที่ประกาศเปิดตัว Qwen-Image-2.1 โดยแสดงชื่อเรื่อง 'Qwen-Image-2.1: กะทัดรัด มีประสิทธิภาพ และรวมการสร้างภาพเป็นหนึ่งเดียว' อยู่เหนือข้อความ 'ขณะนี้เปิดน้ำหนักโมเดลแล้ว' และเครื่องหมาย Qwen โดยตัวสลับภาษาของหน้าเว็บตั้งค่าเป็น EN
Guides & Insights

Qwen-Image-2.1 เป็นโมเดลภาพแบบเปิดน้ำหนักที่ดีที่สุดบนกระดานจัดอันดับของ Artificial Analysis ทั้งสองแห่ง

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ทีม Qwen ของ Alibaba เปิดตัว Qwen-Image-2.1พร้อมน้ำหนักแบบเปิดเผยเมื่อวันที่ 20 กันยายน 2026 สิบสองวันต่อมา กระดานคะแนนอิสระก็ตามมาทันผล และผลลัพธ์ก็น่าสนใจยิ่งกว่าตอนเปิดตัว ในAA-Image-T2I v2.0ลีดเดอร์บอร์ด Qwen-Image-2.1 อยู่อันดับที่ 18 จากทั้งหมด 166 ด้วยคะแนน Elo 1,034 จากการเปรียบเทียบแบบไม่เห็นชื่อ 5,286 ครั้ง บนAA-Image-Editing v2.0มันอยู่อันดับที่ 18 จาก 97 ด้วยคะแนน Elo 1,074 จากการเปรียบเทียบ 5,536 ครั้ง ทั้งสองแถวนั้นถูกทำเครื่องหมายว่า น้ำหนักแบบเปิดเผยบนกระดานที่ติดป้ายกำกับทุกโมเดลเป็นรายตัว ไม่มีโมเดลอื่นใดที่ติดป้ายนั้นบนกระดานใดกระดานหนึ่งถูกจัดให้อยู่เหนือพวกมัน นั่นคือข้อค้นพบทั้งหมด: บนกระดานภาพสาธารณะเพียงสองแห่งที่ให้คะแนนโมเดลด้วยการเปรียบเทียบแบบจับคู่โดยไม่เห็นชื่อ Qwen-Image-2.1 ที่เปิดตัวแล้วคือชุดน้ำหนักที่ดาวน์โหลดได้แข็งแกร่งที่สุดในวงการ และเป็น Qwen-Image-2.1ตัวจริง ไม่ใช่พรีวิวของมัน ที่ครองทั้งสองตำแหน่ง

ต่อไปนี้คือที่มาของตัวเลขสองตัวนั้น ลักษณะของแถวรอบ ๆ ตัวเลขเหล่านั้น และรายละเอียดสามประการบนบอร์ดที่การรายงานข่าวการเปิดตัวส่วนใหญ่ละไว้ — โดยเริ่มจากข้อเท็จจริงที่ว่าบอร์ดไม่ได้บันทึก API ใด ๆ ไว้ที่ไหนเลยสำหรับโมเดลนี้

ที่สองแถวนั้นตั้งอยู่

Artificial Analysis สร้างบอร์ดทั้งสองจากการเปรียบเทียบแบบจับคู่โดยไม่เปิดเผยตัวตน โดยโมเดลสองตัวตอบพรอมป์ต์เดียวกัน ผู้โหวตเลือกเอาต์พุตที่ดีกว่า และค่า Elo ก็ได้มาจากการรวมผลลัพธ์ บอร์ดทั้งสองมีแค่สไตล์เฉพาะของสำนักที่เหมือนกัน นอกนั้นไม่มีอะไรเหมือนกัน ทั้งสองให้คะแนนงานที่ต่างกัน มีกลุ่มประชากรที่ต่างกัน และค่า Elo ของทั้งสองก็ไม่สามารถนำมาเปรียบเทียบกันได้ Qwen-Image-2.1 บังเอิญได้อันดับเดียวกันในทั้งสองบอร์ด ซึ่งเป็นความบังเอิญจากสองการแจกแจงที่แตกต่างกัน

ข้อความเป็นภาพ, 166 โมเดลบนบอร์ด:

• แถวบนสุดของลีดเดอร์บอร์ดคือ GPT Image 2.5 Sunburst (max) ที่ 1,107 Elo จาก 14,023 ครั้งที่ปรากฏ — โมเดลแบบปิดที่มีตัวอย่างมากกว่าสองเท่าของ Qwen-Image-2.1

• Qwen-Image-2.1 อยู่ในอันดับที่ 18 ด้วยคะแนน Elo 1,034 และช่วงความเชื่อมั่น 95% ที่ 1,024 ถึง 1,044 จากการปรากฏตัว 5,286 ครั้ง

• อ่านจำนวนแถวก่อนที่จะดูอันดับ Qwen-Image-2.1 อยู่อันดับที่ 18 บนทั้งสองกระดาน แต่ลำดับเหล่านั้นมาจากกลุ่มประชากรที่ต่างกัน — 166 โมเดลในงานสร้างภาพจากข้อความ และ 97 โมเดลในงานแก้ไขภาพ — และค่า Elo สองค่าก็อยู่ในสองสเกลที่แยกจากกัน การที่อันดับออกมาเหมือนกันเป็นเรื่องของเลขคณิต ไม่ใช่หลักฐานว่าทั้งสองกระดานเห็นตรงกันในเรื่องใดเลย

• โมเดลระดับ Pro สองตัวของ Alibaba เองอยู่อันดับเหนือกว่ามันบนบอร์ดนี้: Qwen-Image-3.0-Pro ที่ 1,089 Elo อันดับ 14 และ Qwen-Image-3.0 ที่ 1,075 อันดับ 16 ทั้งคู่ไม่มีเครื่องหมาย Open Weights สแนปช็อตเดือนกันยายนของบอร์ดระบุว่าทั้งคู่เป็นรุ่นที่วางจำหน่ายในเดือนกรกฎาคม 2026 ซึ่งเป็นเวอร์ชันของเรื่องที่โมเดลภาพ Qwen ใหม่ล่าสุดไม่ใช่ตัวที่ได้คะแนนสูงสุด — และในด้าน text-to-image มันก็ไม่ใช่

การแก้ไขรูปภาพ, 97 โมเดลบนบอร์ด:

• GPT Image 2.5 Sunburst (max) ก็ครองอันดับต้นของบอร์ดนี้เช่นกัน ด้วยคะแนน 1,182 Elo จากการปรากฏตัว 17,899 ครั้ง

• Qwen-Image-2.1 อยู่อันดับ 18 ด้วย 1,074 Elo ช่วง 1,065 ถึง 1,083 จากจำนวนครั้งที่ปรากฏ 5,536 ครั้ง — เป็นตัวอย่างที่ใหญ่กว่าแถว text-to-image ของมันเล็กน้อย ซึ่งสมเหตุสมผลสำหรับโมเดลที่ฝั่งการแก้ไขได้รับข้อความเปิดตัวที่ดังกว่า

• แถวโดยรอบของมันแน่นขนัด grok-imagine-image อยู่ต่ำลงมาหนึ่งอันดับที่ 1,071 และ Luma UNI 1 Max ที่ 1,069 แถวแบบโอเพนเวตที่ใกล้ที่สุดใต้มันบนกระดานนี้คือ HunyuanImage 3.0 Instructที่ 1,066 จากการปรากฏ 5,221 ครั้ง — ห่าง 8 Elo มีเจ็ดแถวอยู่ในช่วง 18 คะแนน Elo

อ่านข้อกล่าวอ้าง "โมเดล open-weights ชั้นนำ" อย่างตรงไปตรงมา

วลีในพาดหัวข่าวกำลังทำหน้าที่เฉพาะเจาะจง และมันสมควรได้รับการตรวจสอบมากกว่าการพูดซ้ำ

• มันคืออันดับภายในกลุ่มที่มีเครื่องหมายกำกับ ไม่ใช่อันดับโดยรวม Qwen-Image-2.1 อยู่อันดับที่ 18 ในภาพรวมของทั้งสองบอร์ด ป้าย Open Weights คือสิ่งที่ทำให้มันเป็นที่หนึ่งในแต่ละบอร์ด และป้ายนี้ถูกกำหนดให้แต่ละโมเดลโดยดุลยพินิจของบอร์ดเอง — มี 47 แถวในหมวด text-to-image ที่มีเครื่องหมายนี้ ส่วนบอร์ด editing มี 36 แถวที่มีเครื่องหมายดังกล่าว ซึ่งมีรายการทั้งหมด 97 รายการ

• เครื่องหมายนี้อธิบายเรื่องเวต ไม่ใช่ข้อกำหนด Qwen-Image-2.1 เผยแพร่ภายใต้ข้อตกลงสัญญาอนุญาต Qwen Research License Agreement ลงวันที่ 20 กันยายน 2026 ซึ่งให้สิทธิ์สำหรับวัตถุประสงค์ที่ไม่ใช่เชิงพาณิชย์เท่านั้น ป้าย Open Weights ของคณะกรรมการนั้นถูกต้องในเรื่องความสามารถในการดาวน์โหลด และไม่พูดถึงสิ่งที่คุณทำได้กับไฟล์ที่ดาวน์โหลดมา ใครก็ตามที่อ่าน "โมเดลภาพแบบเปิดเวตระดับท็อป" ว่า "ใช้ในผลิตภัณฑ์ได้ฟรี" ได้อ่านป้ายนี้เลยความหมายของมันไปแล้ว

• นี่เป็นภาพ ณ ขณะหนึ่ง ไม่ใช่การจัดอันดับที่สรุปแน่นอนแล้ว กระดานขยับทุกวันเมื่อคะแนนโหวตสะสมเพิ่มขึ้น ช่วงความเชื่อมั่นของ Qwen-Image-2.1 อยู่ที่ ±10 Elo สำหรับการสร้างภาพจากข้อความ และ ±9 สำหรับการแก้ไขภาพ; แถวที่อยู่ถัดลงมาอยู่ในช่วงที่ทับซ้อนกัน ให้ถือว่าตำแหน่งนี้เป็นสถานะปัจจุบันมากกว่าจะเป็นตำแหน่งถาวร

รายละเอียดที่การรายงานข่าวการเปิดตัวไม่มี: ไม่มี API

แถวของ Qwen-Image-2.1 ทั้งสองแถวมีไม่มี API ให้ใช้งานกำกับไว้อย่างชัดเจน นั่นเป็นต้นทุนที่แท้จริงต่อการจัดอันดับ และมันบอกอะไรบางอย่างเกี่ยวกับว่าใครเป็นคนสร้างโหวต 5,286 และ 5,536 โหวตนั้น — หากไม่มีปลายทางให้ชี้พรอมป์ต์ไปที่ได้ การเปรียบเทียบก็มาจากคนที่รันเวตส์เองแล้วส่งผลลัพธ์เข้ามา Elo แบบอิสระสำหรับโมเดลที่โฮสต์เองเท่านั้นเป็นการวัดที่ยากกว่าจริง ๆ เมื่อเทียบกับ Elo สำหรับสิ่งที่ใครก็เรียกใช้ได้ และนั่นคือเหตุผลที่ตัวอย่างตรงนี้มีขนาดเพียงหนึ่งในสามของแถวอันดับต้น ๆ

สำหรับนักพัฒนา รูปแบบของเรื่องนี้เป็นสิ่งที่คุ้นเคย: โมเดลรูปภาพที่ดาวน์โหลดได้ที่แข็งแกร่งที่สุดในวงการไม่ใช่ตัวที่คุณเรียกใช้ได้ในวันนี้ ในทางปฏิบัติ สิ่งนี้ทำให้งานแยกออกเป็นสองทาง คุณจะให้บริการ Qwen-Image-2.1 ด้วยตัวเองบนฮาร์ดแวร์ของคุณเอง หรือจะเรียกใช้หนึ่งในโมเดลรอบๆ บนบอร์ดนี้ ทางเลือกที่สองคือจุดที่ระบบกำหนดเส้นทางพิสูจน์คุณค่าของมัน — API เดียวที่ครอบคลุมโมเดลกว่า 200 รายการ โดยส่งผ่านราคาตามรายการของผู้ให้บริการโดยไม่บวกเพิ่ม, การสลับไปใช้ระบบสำรองอัตโนมัติเมื่อผู้ให้บริการมีประสิทธิภาพลดลง และ DSL สำหรับการกำหนดเส้นทางเพื่อประกอบโมเดลหลายตัวให้เป็นการเรียกครั้งเดียว OrcaRouter ยังไม่ให้บริการ Qwen-Image-2.1 ในวันนี้ ส่วนสายผลิตภัณฑ์รูปภาพบนแพลตฟอร์มประกอบด้วยระดับต่างๆ ของ Imagen จาก Google และตัวอย่างรูปภาพ Gemini, ปลายทางรูปภาพ Grok Imagine ของ xAI และตระกูล GPT-Image ของ OpenAI บนบอร์ดนี้ นั่นคือแถว GPT Image 2.5 Sunburst ที่อยู่บนสุด และมันเป็นคำตอบที่สมเหตุสมผลสำหรับ "ฉันต้องการคะแนนที่ดีที่สุดและต้องการให้เรียกใช้ได้บ่ายนี้"

Screenshot of the Artificial Analysis text-to-image leaderboard, AA-Image-T2I v2.0, captured in English, listing GPT Image 2.5 Sunburst (max) first at 1,107 Elo from 14,023 samples, the Qwen-Image-3.0-Pro row at rank 14 with 1,089 Elo and 6,353 samples, and the Qwen-Image-2.1 row at rank 18 with 1,034 Elo from 5,286 samples

สิ่งที่ต้องจับตาบนบอร์ด

สามสิ่งที่จะขับเคลื่อนเรื่องนี้ และทั้งสามอย่างปรากฏอยู่บนกระดานแล้ว

ข้อแรกคือว่า API จะปรากฏขึ้นหรือไม่ หาก Alibaba หรือพาร์ตเนอร์ผู้ให้บริการนำ Qwen-Image-2.1 ไปไว้หลังเอนด์พอยต์ ไม่มี API ให้ใช้งาน โน้ตนั้นจะหายไป ปริมาณโหวตควรไต่ขึ้นไปใกล้เคียงกับขนาดของแถวข้างเคียง และช่วงความเชื่อมั่นจะแคบลง ช่วงที่แคบลงบน 1,034 หรือ 1,074 ถือเป็นข้อกล่าวอ้างที่แข็งแรงกว่าช่วงปัจจุบันมาก

ตัวที่สองคือสแต็กของ Alibaba เอง Qwen-Image-3.0-Pro ที่ 1,089 และ Qwen-Image-3.0 ที่ 1,075 ต่างก็จัดอันดับเหนือกว่า Qwen-Image-2.1 ในด้าน text-to-image ขณะที่ไม่มีเครื่องหมาย Open Weights หาก Qwen-Image-2.1 ถูกตั้งใจให้เป็นคู่เทียบที่ดาวน์โหลดได้ของไลน์นั้น มากกว่าจะเป็นรุ่นสืบทอด คำถามที่น่าสนใจคือช่องว่างจะแคบลงหรือไม่ — และบนกระดานการแก้ไขภาพ มันก็แคบลงแล้ว โดยที่ Qwen-Image-3.0-Pro นำ Qwen-Image-2.1 อยู่สองคะแนน Elo

ประการที่สามคือสัญญาอนุญาต ทุกแถว Open Weights บนทั้งสองบอร์ดล้วนมีสิทธิ์ได้รับป้ายนี้เท่าเทียมกัน และสัญญาอนุญาตที่อยู่เบื้องหลังนั้นไม่ได้เท่าเทียมกันเลยแม้แต่น้อย บอร์ดจะไม่มีวันบอกคุณเรื่องนั้น มันคือคอลัมน์เดียวที่สกอร์บอร์ดไม่มี

Generated summary card for Qwen-Image-2.1 on the Artificial Analysis boards, listing text-to-image rank 18 of 166 at 1,034 Elo from 5,286 votes, editing rank 18 of 97 at 1,074 Elo from 5,536 votes, the note that it is the top Open Weights row on both boards, and the sourcing line that the figures are per Artificial Analysis

คำถามที่พบบ่อย

Qwen-Image-2.1 เป็นโมเดลรูปภาพแบบเปิดน้ำหนักที่ดีที่สุดหรือไม่

บนสองบอร์ดนี้ ใช่ — มันคือแถวที่มี Elo สูงที่สุดที่ติดเครื่องหมาย Open Weights ทั้งสองบอร์ด โดยอยู่ที่ 1,034 ใน text-to-image และ 1,074 ใน editing โดยภาพรวมมันอยู่ในอันดับที่ 18 บนแต่ละบอร์ด — และเลข 18 นั้นเป็นอันดับภายใน 166 แถวบนบอร์ดหนึ่ง และภายใน 97 แถวบนอีกบอร์ด ซึ่งแทนสเกล Elo สองสเกลที่ไม่สามารถนำมาเปรียบเทียบกันได้ ข้อกล่าวอ้างนี้จะใช้ได้ก็ต่อเมื่อตัวระบุเงื่อนไขทั้งสองยังคงแนบอยู่

ทำไมบอร์ดทั้งสองจึงแสดงค่า Elo ที่แตกต่างกันสำหรับโมเดลเดียวกัน

ระบบให้คะแนนงานที่แตกต่างกันโดยเทียบกับกลุ่มประชากรมодеลที่ต่างกัน Elo ของ text-to-image กับ Elo ของงานแก้ไขภาพเป็นสองสเกลที่แยกจากกัน การนำ 1,034 ไปเทียบกับ 1,074 นั้นเป็นการวัดกระดานจัดอันดับ ไม่ใช่การวัดตัวโมเดล

ฉันสามารถเรียกใช้ Qwen-Image-2.1 ผ่าน API ได้ไหม

ทั้งสองแถวบนบอร์ดบันทึกว่า ไม่มี API ให้บริการ ค่าน้ำหนักของโมเดลสามารถดาวน์โหลดได้จากที่เก็บของ Alibaba ดังนั้นโมเดลจึงรันได้ — เพียงแต่ไม่มีเอนด์พอยต์แบบโฮสต์ที่บอร์ดให้เครดิตว่าทำหน้าที่ให้บริการโมเดลนี้

ถ้าคุณอยากได้ตัวเลขวันนี้แทนที่จะต้องดาวน์โหลด อันดับต้น ๆ ของทั้งสองบอร์ดสามารถเรียกใช้ได้ผ่าน API ของผู้ขายเอง และตระกูล GPT-Image, ระดับต่าง ๆ ของ Imagen จาก Google และ Grok Imagine ของ xAI คือโมเดลรูปภาพที่ OrcaRouter เปิดให้ใช้โดยตรง เก็บไฟล์น้ำหนักไว้สำหรับการทดลอง และเก็บเอนด์พอยต์ไว้สำหรับกำหนดเส้นตาย

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube