สร้าง hero card สำหรับบทความ Qwen-Image-2.1 เทียบกับ LLaDA-Image โดยมีพาดหัวว่า Qwen-Image-2.1 vs LLaDA-Image คำโปรยย่อยว่า The Licence Claim Changed ชิปสองอันที่ระบุว่า Qwen card: research licence, non-commercial และ LLaDA card: apache-2.0, no licence file และส่วนท้ายว่า Model card และ repository state per Hugging Face, October 2026 พร้อมกับโลโก้ OrcaRouter ที่ประกอบไว้มุมขวาล่าง
Guides & Insights

Qwen-Image-2.1 vs LLaDA-Image: ข้ออ้างเรื่องสัญญาอนุญาตเปลี่ยนไป และมีเพียงตัวเดียวเท่านั้นที่บอกเช่นนั้น

ผู้เขียน

Elias Hawthorne

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อ LLaDA-Image เปิดตัวจาก inclusionAI ห้องวิจัยของ Ant Group เมื่อวันที่ 4 กันยายน 2026 การตีความคลังโค้ดของมันก็ตรงไปตรงมา: ไม่มีการระบุสัญญาอนุญาต จึงถือว่าสงวนลิขสิทธิ์ทั้งหมด การตีความนั้นล้าสมัยไปแล้ว ทุกวันนี้การ์ดโมเดลทั้งสี่บน Hugging Face ของมัน — LLaDA-Image, LLaDA-Image-Turbo, LLaDA-Image-FP8 และ LLaDA-Image-Turbo-FP8 — ต่างประกาศ apache-2.0 ไว้ใน frontmatter และมันอยู่บรรทัดแรกของการ์ด ไม่มีคลังใดในสี่แห่งนั้นที่มีไฟล์ LICENSE และคลัง GitHub ของโปรเจกต์ซึ่งสร้างเมื่อวันที่ 31 สิงหาคม 2026 ก็ไม่มีไฟล์สัญญาอนุญาตเช่นกัน ลองเทียบกับ Qwen-Image-2.1 ซึ่งทีม Qwen ของ Alibaba เปิดตัวพร้อมน้ำหนักโมเดลแบบเปิดเมื่อวันที่ 20 กันยายน 2026 ภายใต้ Qwen Research License Agreement — เอกสารจริง ระบุวันที่ ใช้ได้เฉพาะที่ไม่ใช่เชิงพาณิชย์ และเป็นเหตุผลที่คลังของมันเองติดแท็กสัญญาอนุญาตว่า otherโมเดลภาพแบบเปิดน้ำหนักสองตัว ห่างกันสิบหกวัน และตัวที่มีเอกสารดูเหมือนอ่อนกว่ากลับเป็นตัวที่ประกาศสัญญาอนุญาตแบบผ่อนปรน กับดักทั้งหมดอยู่ที่วิธีการประกาศนั่นเอง

นี่เป็นการเปรียบเทียบบนกระดาษ ไม่ใช่บนพิกเซล โมเดลทั้งสองไม่มีคะแนนภาพที่เป็นอิสระ — LLaDA-Image ไม่ว่าจะเป็นแบบใดในสี่รูปแบบของมัน ก็ไม่ปรากฏบนกระดานภาพของ Artificial Analysis เลย และสองแถวของ Qwen-Image-2.1 บนกระดานนั้นมีไม่มี API ให้ใช้กำกับอยู่ สิ่งที่คุณตัดสินใจได้จริงในวันนี้คือสิ่งที่คุณได้รับอนุญาตให้ทำ และคำตอบนั้นเปลี่ยนไปสำหรับหนึ่งในสองโมเดลนี้โดยไม่มีการประกาศ

สิ่งที่พื้นผิวสัญญาอนุญาตทั้งสองกล่าวไว้จริง ๆ

อ่านแหล่งข้อมูลปฐมภูมิแทนที่จะอ่านบทสรุป เพราะช่องว่างระหว่างสองสิ่งนั้นคือเรื่องราวทั้งหมด

• Qwen-Image-2.1 — เผยแพร่ภายใต้ข้อตกลง Qwen Research License Agreement ลงวันที่ 20 กันยายน 2026 โดยอนุญาตให้ใช้ "สำหรับวัตถุประสงค์ที่ไม่ใช่เชิงพาณิชย์เท่านั้น" โดยการใช้เชิงพาณิชย์ต้องขอใบอนุญาตแยกต่างหากจากผู้ขาย รีโพซิทอรี Hugging Face ของ Alibaba สำหรับโมเดลนี้ระบุฟิลด์ใบอนุญาตเป็น other, ซึ่งเป็นแท็กที่ถูกต้อง: มันไม่ใช่ใบอนุญาตที่ได้รับการรับรองจาก OSI และโมเดลนี้ไม่ใช่โอเพนซอร์สในความหมายนั้น ยังคงดาวน์โหลดได้ รันได้ และสามารถนำไปทดสอบ benchmark ได้.

• LLaDA-Image — การ์ดโมเดลบน Hugging Face ระบุว่า license: apache-2.0 ใน YAML frontmatter ของมัน Apache 2.0 เป็นสัญญาอนุญาตที่ OSI รับรอง ซึ่งอนุญาตให้ใช้ในเชิงพาณิชย์ได้ หาก frontmatter คือสัญญาอนุญาตจริง นี่ก็เป็นตัวที่อนุญาตได้กว้างกว่าอีกตัวหนึ่งอย่างมาก

• LLaDA-Image และร่องรอยเอกสารที่เหลือ — ไม่มีไฟล์ LICENSE ในแผนผังที่เก็บโค้ด การ์ดระบุ README, model_index.json, .gitattributes และไดเรกทอรีน้ำหนักเท่านั้น ไม่มีอย่างอื่น ที่เก็บ GitHub ของโปรเจกต์ก็ไม่มีไฟล์สัญญาอนุญาตเช่นกัน API ที่เก็บของ GitHub เองรายงานว่าไม่มีสัญญาอนุญาตสำหรับโปรเจกต์นี้ ข้อความของ Apache 2.0 เองกำหนดว่าต้องมีสำเนาสัญญาอนุญาตมาพร้อมกับการเผยแพร่ และไม่มีสำเนาอยู่ในทั้งสองที่

ดังนั้น คำอธิบายที่ตรงไปตรงมาของสถานะสัญญาอนุญาตของ LLaDA-Image จึงไม่ใช่ "ไม่มีสัญญาอนุญาต" และไม่ใช่ "Apache 2.0" แต่เป็นเช่นนี้: การ์ดระบุว่าเป็น Apache 2.0 และรีโพซิทอรีไม่ได้แนบข้อความสัญญาอนุญาตมาด้วย ข้อเท็จจริงสองข้อนี้ชี้ไปในทิศทางเดียวกัน แต่ไม่ใช่ข้อเท็จจริงเดียวกัน และมีเพียงข้อเดียวเท่านั้นที่เป็นสิ่งที่ผู้ตรวจสอบด้านจัดซื้อจัดจ้างจะมองหา

Screenshot of the LLaDA-Image repository page on Hugging Face, captured in English, showing the model card title Building Strong Image Generators with Fully Open Training Recipes, the apache-2.0 licence label in the metadata sidebar, and the repository file list containing README.md, model_index.json and weight directories but no LICENSE file

ทำไมการ์ดจึงมีข้อความแบบที่มันเป็น

ฟรอนต์แมตเทอร์ของบัตรใบนี้เองที่บอกใบ้ทุกอย่าง พาดหัวของตระกูลโมเดลคือ LLaDA-Image: การสร้างเครื่องมือสร้างภาพที่แข็งแกร่งด้วยสูตรการฝึกอบรมแบบเปิดเต็มรูปแบบ และสองในห้าประเด็นไฮไลต์ที่ระบุไว้ล้วนเกี่ยวกับความเปิดกว้าง ได้แก่ การพรีเทรนด้วยภาพเท่านั้นเพื่อสร้างไพรเออร์เชิงภาพ และโมเดลดิฟฟิวชันแบบรวมที่ทั้งแบ็กโบนและ DiT ต่างเป็นโมเดลดิฟฟิวชันที่ฝึกในกรอบเดียวกัน คำว่า "recipe" ถูกใช้อย่างจงใจ บัตรใบนี้กำลังนำเสนอไปป์ไลน์ที่ทำซ้ำได้ ไม่ใช่แค่เช็กพอยต์

จากนั้นอ่านแผนโอเพนซอร์สที่ด้านล่างของการ์ดใบเดียวกัน:

• โค้ดสำหรับการอนุมานและน้ำหนักโมเดล — ติ๊กแล้ว

• โค้ดการฝึก — ยังไม่ได้ติ๊ก ทำเครื่องหมายว่า เร็ว ๆ นี้.

• รายงาน arXiv อีกฉบับหนึ่ง ซึ่งมีหมายเลข 2609.03796 อยู่บนการ์ด เป็นแหล่งที่บรรจุวิธีการนี้ไว้

นั่นเป็นจุดยืนที่สอดคล้องกันและไม่ใช่จุดยืนที่หลอกลวง: น้ำหนักโมเดลและโค้ดอินเฟอเรนซ์ตอนนี้ โค้ดฝึกโมเดลค่อยว่ากันทีหลัง วิธีการอยู่ในเปเปอร์ มันยังเป็นบริบทที่บรรทัด frontmatter แบบ Apache 2.0 สมเหตุสมผลในฐานะเจตนา — นี่คือโครงการที่ต้องการให้ถูกอ่านว่าเปิดอย่างเต็มรูปแบบ ช่องว่างระหว่างเจตนากับไฟล์สัญญาอนุญาตที่ขาดหายไปคือสิ่งประเภทที่ frontmatter ของการ์ดไม่อาจแสดงออกได้

ตัวเลขบอกอะไร และใครเป็นคนสร้างมันขึ้นมา

ข้อกล่าวอ้างเชิงปริมาณเพียงข้อเดียวที่แนบมากับ LLaDA-Image คือคะแนนจากเบนช์มาร์ก และจำเป็นต้องระบุที่มาของมันอย่างตรงไปตรงมา การ์ดรายงานว่า “SOTA บน Qwen-Image-Bench” โดยมีคะแนนรวม 53.53 สำหรับภาษาอังกฤษ และ 53.38 สำหรับภาษาจีน นั่นเป็นตัวเลขของ inclusionAI เอง ซึ่งวัดบนเบนช์มาร์กที่ตั้งชื่อตามโมเดลของแล็บอื่น และยังไม่มีใครภายนอกแล็บทำซ้ำได้ โมเดล Base ทำคะแนนเหล่านั้นได้ที่ 50 ขั้นตอนการสุ่ม ส่วนรุ่น Turbo ถูกดิสทิลด้วย Twin-DMD เพื่อให้ทำงานใน 2 ถึง 4 ขั้นตอน ตัวเลขทั้งสองไม่มีจำนวนโหวตหนุนหลัง และไม่มีตัวเลขใดปรากฏบนกระดานจัดอันดับอิสระ เพราะ LLaDA-Image ไม่ได้อยู่บนกระดานดังกล่าว

Qwen-Image-2.1 อยู่บนกระดานของ Artificial Analysis ทั้งสองกระดาน — 1,034 Elo ที่อันดับ 18 จาก 166 ในการสร้างภาพจากข้อความ และ 1,074 Elo ที่อันดับ 18 จาก 97 ในการแก้ไขภาพ จากการเปรียบเทียบแบบปกปิดจำนวน 5,286 ครั้งและ 5,536 ครั้งตามลำดับ แถวของโมเดลนี้บนทั้งสองกระดานมีเครื่องหมาย Open Weights กำกับอยู่ข้างๆ ไม่มี API ให้ใช้งาน หมายเหตุ นั่นคือการวัดผลโดยอิสระของโมเดลที่โฮสต์เอง ซึ่งเป็นสิ่งที่ได้มายากกว่าที่ฟังดู และเป็นแกนเดียวที่โมเดลสองตัวนี้ไม่ได้อยู่ในหมวดหมู่เดียวกันเลย

Generated licence paper-trail card for the two models, with two panels. The Qwen-Image-2.1 panel reads Card licence: research licence, Licence file in repository: yes, Licence text: Qwen Research License, Commercial use: not allowed. The LLaDA-Image panel reads Card licence: apache-2.0, Licence file in repository: no, Licence text: Apache 2.0, Commercial use: not documented. A footer reads Card and repository state per Hugging Face, October 2026, with the OrcaRouter logo composited bottom-right

การตัดสินใจที่สิ่งนี้เปลี่ยนแปลงไปจริง ๆ

หากคุณอิงจากการตีความก่อนหน้านี้ — ว่า LLaDA-Image ไม่ได้ประกาศสัญญาอนุญาต จึงถือว่าสงวนสิทธิ์ทั้งหมด — สถานะได้ดีขึ้น และการดีขึ้นนั้นเป็นจริงพอที่จะลงมือดำเนินการได้สำหรับการประเมินและการทำงานภายใน โปรดคงข้อแม้ไว้: สัญญาอนุญาตที่ระบุชื่อเพียงใน YAML โดยไม่มีข้อความสัญญาอนุญาตในที่เก็บโค้ด เป็นหลักฐานที่อ่อนกว่าการมีไฟล์สัญญาอนุญาตที่วางอยู่ข้าง ๆ เวต หาก LLaDA-Image กำลังจะถูกนำไปใช้ในผลิตภัณฑ์ นั่นเป็นคำถามสำหรับห้องปฏิบัติการวิจัยของ Ant Group ไม่ใช่เรื่องที่แก้ได้ด้วยการชี้ไปที่แท็กเมทาดาทา

Qwen-Image-2.1 เป็นข้อแลกเปลี่ยนในทางกลับกัน: เอกสารชัดเจนไม่กำกวม และคำตอบคือไม่ ใบอนุญาตสำหรับงานวิจัยที่ระบุวันที่และห้ามใช้ในเชิงพาณิชย์นั้นวางแผนรับมือได้ง่ายกว่าใบอนุญาตแบบผ่อนปรนที่ไม่ชัดเจน เพราะไม่มีอะไรต้องตีความ ทั้งยังเป็นการเปลี่ยนแปลงจากตระกูล Qwen-Image รุ่นก่อน ซึ่งเผยแพร่ภายใต้ Apache 2.0 ทีมที่สร้างบนรุ่นก่อนจึงไม่อาจถือสมมติฐานเดิมต่อไปได้

โมเดลทั้งสองนี้ไม่ได้ให้บริการบน OrcaRouter และจะยังไม่ให้บริการจนกว่าประเด็นเรื่องสัญญาอนุญาตจะคลี่คลาย — สัญญาอนุญาตสำหรับการวิจัยเท่านั้น และไฟล์สัญญาอนุญาตที่ไม่ได้อยู่ในรีโพซิทอรี ต่างก็เป็นเหตุผลที่ต้องแยกเส้นทางแบบโฮสต์ออกจากการทดลอง โมเดลรูปภาพที่เราให้บริการอยู่คือ Imagen หลายระดับของ Google และ Gemini image previews, image endpoint ของ Grok Imagine จาก xAI และตระกูล GPT-Image ของ OpenAI ทั้งหมดอยู่เบื้องหลัง endpoint เดียวที่เข้ากันได้กับ OpenAI โดยส่งผ่านราคาตามรายการของผู้ให้บริการโดยไม่บวกเพิ่ม การสลับไปยังผู้ให้บริการรายอื่นโดยอัตโนมัติเมื่อเกิดข้อขัดข้อง และ routing DSL สำหรับประกอบโมเดลหลายตัวเข้าด้วยกันในการเรียกครั้งเดียว ใช้งานโมเดลที่ดาวน์โหลดได้สำหรับงานที่สัญญาอนุญาตครอบคลุมไว้ เรียกใช้โมเดลแบบโฮสต์สำหรับสิ่งใดก็ตามที่ไปถึงลูกค้า

ดูอะไรดี

สองสิ่งทำให้สิ่งนี้เปลี่ยนจากการเปรียบเทียบเอกสารมาเป็นการเปรียบเทียบโมเดล และทั้งสองอย่างสามารถตรวจสอบได้โดยไม่ต้องรอประกาศจากใคร

ประการแรกคือว่าไฟล์ LICENSE ปรากฏอยู่ในคลัง LLaDA-Image หรือไม่ สัญญาอนุญาตที่ระบุไว้ใน frontmatter และจัดส่งเป็นข้อความคือสิ่งที่ Apache 2.0 กำหนดไว้จริง ๆ และจนกว่าไฟล์นั้นจะมีอยู่ คำประกาศก็เป็นหลักฐานเพียงอย่างเดียว ประการที่สองคือว่าโค้ดสำหรับการฝึกจะถูกเผยแพร่หรือไม่ มันเป็นช่องสุดท้ายที่ยังไม่ได้ติ๊กบนการ์ด และเป็นความแตกต่างระหว่างเวตที่บังเอิญดาวน์โหลดได้ กับ "สูตรการฝึกแบบเปิดเต็มรูปแบบ" ที่ชื่อเรื่องสัญญาไว้

จนกว่าจะถึงตอนนั้น บทสรุปที่เป็นธรรมคือบทสรุปที่แหล่งข้อมูลสนับสนุน: ตอนนี้ LLaDA-Image อ้างสิทธิ์สัญญาอนุญาตที่ผ่อนปรนกว่า และยังไม่ได้จัดทำเอกสารเรื่องนี้ ส่วน Qwen-Image-2.1 จัดทำเอกสารสัญญาอนุญาตที่ห้ามสิ่งที่ทีมส่วนใหญ่ต้องการทำ และมีเพียงหนึ่งในสองตัวนี้เท่านั้นที่เคยถูกวัดโดยใครก็ตามที่ไม่ใช่ห้องทดลองของตัวเอง

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube