
Qwen-Image-2.1 vs LLaDA-Image: ข้ออ้างเรื่องสัญญาอนุญาตเปลี่ยนไป และมีเพียงตัวเดียวเท่านั้นที่บอกเช่นนั้น
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 223 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
เมื่อ LLaDA-Image เปิดตัวจาก inclusionAI ห้องวิจัยของ Ant Group เมื่อวันที่ 4 กันยายน 2026 การตีความคลังโค้ดของมันก็ตรงไปตรงมา: ไม่มีการระบุสัญญาอนุญาต จึงถือว่าสงวนลิขสิทธิ์ทั้งหมด การตีความนั้นล้าสมัยไปแล้ว ทุกวันนี้การ์ดโมเดลทั้งสี่บน Hugging Face ของมัน — LLaDA-Image, LLaDA-Image-Turbo, LLaDA-Image-FP8 และ LLaDA-Image-Turbo-FP8 — ต่างประกาศ apache-2.0 ไว้ใน frontmatter และมันอยู่บรรทัดแรกของการ์ด ไม่มีคลังใดในสี่แห่งนั้นที่มีไฟล์ LICENSE และคลัง GitHub ของโปรเจกต์ซึ่งสร้างเมื่อวันที่ 31 สิงหาคม 2026 ก็ไม่มีไฟล์สัญญาอนุญาตเช่นกัน ลองเทียบกับ Qwen-Image-2.1 ซึ่งทีม Qwen ของ Alibaba เปิดตัวพร้อมน้ำหนักโมเดลแบบเปิดเมื่อวันที่ 20 กันยายน 2026 ภายใต้ Qwen Research License Agreement — เอกสารจริง ระบุวันที่ ใช้ได้เฉพาะที่ไม่ใช่เชิงพาณิชย์ และเป็นเหตุผลที่คลังของมันเองติดแท็กสัญญาอนุญาตว่า otherโมเดลภาพแบบเปิดน้ำหนักสองตัว ห่างกันสิบหกวัน และตัวที่มีเอกสารดูเหมือนอ่อนกว่ากลับเป็นตัวที่ประกาศสัญญาอนุญาตแบบผ่อนปรน กับดักทั้งหมดอยู่ที่วิธีการประกาศนั่นเอง
นี่เป็นการเปรียบเทียบบนกระดาษ ไม่ใช่บนพิกเซล โมเดลทั้งสองไม่มีคะแนนภาพที่เป็นอิสระ — LLaDA-Image ไม่ว่าจะเป็นแบบใดในสี่รูปแบบของมัน ก็ไม่ปรากฏบนกระดานภาพของ Artificial Analysis เลย และสองแถวของ Qwen-Image-2.1 บนกระดานนั้นมีไม่มี API ให้ใช้กำกับอยู่ สิ่งที่คุณตัดสินใจได้จริงในวันนี้คือสิ่งที่คุณได้รับอนุญาตให้ทำ และคำตอบนั้นเปลี่ยนไปสำหรับหนึ่งในสองโมเดลนี้โดยไม่มีการประกาศ
สิ่งที่พื้นผิวสัญญาอนุญาตทั้งสองกล่าวไว้จริง ๆ
อ่านแหล่งข้อมูลปฐมภูมิแทนที่จะอ่านบทสรุป เพราะช่องว่างระหว่างสองสิ่งนั้นคือเรื่องราวทั้งหมด
• Qwen-Image-2.1 — เผยแพร่ภายใต้ข้อตกลง Qwen Research License Agreement ลงวันที่ 20 กันยายน 2026 โดยอนุญาตให้ใช้ "สำหรับวัตถุประสงค์ที่ไม่ใช่เชิงพาณิชย์เท่านั้น" โดยการใช้เชิงพาณิชย์ต้องขอใบอนุญาตแยกต่างหากจากผู้ขาย รีโพซิทอรี Hugging Face ของ Alibaba สำหรับโมเดลนี้ระบุฟิลด์ใบอนุญาตเป็น other, ซึ่งเป็นแท็กที่ถูกต้อง: มันไม่ใช่ใบอนุญาตที่ได้รับการรับรองจาก OSI และโมเดลนี้ไม่ใช่โอเพนซอร์สในความหมายนั้น ยังคงดาวน์โหลดได้ รันได้ และสามารถนำไปทดสอบ benchmark ได้.
• LLaDA-Image — การ์ดโมเดลบน Hugging Face ระบุว่า license: apache-2.0 ใน YAML frontmatter ของมัน Apache 2.0 เป็นสัญญาอนุญาตที่ OSI รับรอง ซึ่งอนุญาตให้ใช้ในเชิงพาณิชย์ได้ หาก frontmatter คือสัญญาอนุญาตจริง นี่ก็เป็นตัวที่อนุญาตได้กว้างกว่าอีกตัวหนึ่งอย่างมาก
• LLaDA-Image และร่องรอยเอกสารที่เหลือ — ไม่มีไฟล์ LICENSE ในแผนผังที่เก็บโค้ด การ์ดระบุ README, model_index.json, .gitattributes และไดเรกทอรีน้ำหนักเท่านั้น ไม่มีอย่างอื่น ที่เก็บ GitHub ของโปรเจกต์ก็ไม่มีไฟล์สัญญาอนุญาตเช่นกัน API ที่เก็บของ GitHub เองรายงานว่าไม่มีสัญญาอนุญาตสำหรับโปรเจกต์นี้ ข้อความของ Apache 2.0 เองกำหนดว่าต้องมีสำเนาสัญญาอนุญาตมาพร้อมกับการเผยแพร่ และไม่มีสำเนาอยู่ในทั้งสองที่
ดังนั้น คำอธิบายที่ตรงไปตรงมาของสถานะสัญญาอนุญาตของ LLaDA-Image จึงไม่ใช่ "ไม่มีสัญญาอนุญาต" และไม่ใช่ "Apache 2.0" แต่เป็นเช่นนี้: การ์ดระบุว่าเป็น Apache 2.0 และรีโพซิทอรีไม่ได้แนบข้อความสัญญาอนุญาตมาด้วย ข้อเท็จจริงสองข้อนี้ชี้ไปในทิศทางเดียวกัน แต่ไม่ใช่ข้อเท็จจริงเดียวกัน และมีเพียงข้อเดียวเท่านั้นที่เป็นสิ่งที่ผู้ตรวจสอบด้านจัดซื้อจัดจ้างจะมองหา

ทำไมการ์ดจึงมีข้อความแบบที่มันเป็น
ฟรอนต์แมตเทอร์ของบัตรใบนี้เองที่บอกใบ้ทุกอย่าง พาดหัวของตระกูลโมเดลคือ LLaDA-Image: การสร้างเครื่องมือสร้างภาพที่แข็งแกร่งด้วยสูตรการฝึกอบรมแบบเปิดเต็มรูปแบบ และสองในห้าประเด็นไฮไลต์ที่ระบุไว้ล้วนเกี่ยวกับความเปิดกว้าง ได้แก่ การพรีเทรนด้วยภาพเท่านั้นเพื่อสร้างไพรเออร์เชิงภาพ และโมเดลดิฟฟิวชันแบบรวมที่ทั้งแบ็กโบนและ DiT ต่างเป็นโมเดลดิฟฟิวชันที่ฝึกในกรอบเดียวกัน คำว่า "recipe" ถูกใช้อย่างจงใจ บัตรใบนี้กำลังนำเสนอไปป์ไลน์ที่ทำซ้ำได้ ไม่ใช่แค่เช็กพอยต์
จากนั้นอ่านแผนโอเพนซอร์สที่ด้านล่างของการ์ดใบเดียวกัน:
• โค้ดสำหรับการอนุมานและน้ำหนักโมเดล — ติ๊กแล้ว
• โค้ดการฝึก — ยังไม่ได้ติ๊ก ทำเครื่องหมายว่า เร็ว ๆ นี้.
• รายงาน arXiv อีกฉบับหนึ่ง ซึ่งมีหมายเลข 2609.03796 อยู่บนการ์ด เป็นแหล่งที่บรรจุวิธีการนี้ไว้
นั่นเป็นจุดยืนที่สอดคล้องกันและไม่ใช่จุดยืนที่หลอกลวง: น้ำหนักโมเดลและโค้ดอินเฟอเรนซ์ตอนนี้ โค้ดฝึกโมเดลค่อยว่ากันทีหลัง วิธีการอยู่ในเปเปอร์ มันยังเป็นบริบทที่บรรทัด frontmatter แบบ Apache 2.0 สมเหตุสมผลในฐานะเจตนา — นี่คือโครงการที่ต้องการให้ถูกอ่านว่าเปิดอย่างเต็มรูปแบบ ช่องว่างระหว่างเจตนากับไฟล์สัญญาอนุญาตที่ขาดหายไปคือสิ่งประเภทที่ frontmatter ของการ์ดไม่อาจแสดงออกได้
ตัวเลขบอกอะไร และใครเป็นคนสร้างมันขึ้นมา
ข้อกล่าวอ้างเชิงปริมาณเพียงข้อเดียวที่แนบมากับ LLaDA-Image คือคะแนนจากเบนช์มาร์ก และจำเป็นต้องระบุที่มาของมันอย่างตรงไปตรงมา การ์ดรายงานว่า “SOTA บน Qwen-Image-Bench” โดยมีคะแนนรวม 53.53 สำหรับภาษาอังกฤษ และ 53.38 สำหรับภาษาจีน นั่นเป็นตัวเลขของ inclusionAI เอง ซึ่งวัดบนเบนช์มาร์กที่ตั้งชื่อตามโมเดลของแล็บอื่น และยังไม่มีใครภายนอกแล็บทำซ้ำได้ โมเดล Base ทำคะแนนเหล่านั้นได้ที่ 50 ขั้นตอนการสุ่ม ส่วนรุ่น Turbo ถูกดิสทิลด้วย Twin-DMD เพื่อให้ทำงานใน 2 ถึง 4 ขั้นตอน ตัวเลขทั้งสองไม่มีจำนวนโหวตหนุนหลัง และไม่มีตัวเลขใดปรากฏบนกระดานจัดอันดับอิสระ เพราะ LLaDA-Image ไม่ได้อยู่บนกระดานดังกล่าว
Qwen-Image-2.1 อยู่บนกระดานของ Artificial Analysis ทั้งสองกระดาน — 1,034 Elo ที่อันดับ 18 จาก 166 ในการสร้างภาพจากข้อความ และ 1,074 Elo ที่อันดับ 18 จาก 97 ในการแก้ไขภาพ จากการเปรียบเทียบแบบปกปิดจำนวน 5,286 ครั้งและ 5,536 ครั้งตามลำดับ แถวของโมเดลนี้บนทั้งสองกระดานมีเครื่องหมาย Open Weights กำกับอยู่ข้างๆ ไม่มี API ให้ใช้งาน หมายเหตุ นั่นคือการวัดผลโดยอิสระของโมเดลที่โฮสต์เอง ซึ่งเป็นสิ่งที่ได้มายากกว่าที่ฟังดู และเป็นแกนเดียวที่โมเดลสองตัวนี้ไม่ได้อยู่ในหมวดหมู่เดียวกันเลย

การตัดสินใจที่สิ่งนี้เปลี่ยนแปลงไปจริง ๆ
หากคุณอิงจากการตีความก่อนหน้านี้ — ว่า LLaDA-Image ไม่ได้ประกาศสัญญาอนุญาต จึงถือว่าสงวนสิทธิ์ทั้งหมด — สถานะได้ดีขึ้น และการดีขึ้นนั้นเป็นจริงพอที่จะลงมือดำเนินการได้สำหรับการประเมินและการทำงานภายใน โปรดคงข้อแม้ไว้: สัญญาอนุญาตที่ระบุชื่อเพียงใน YAML โดยไม่มีข้อความสัญญาอนุญาตในที่เก็บโค้ด เป็นหลักฐานที่อ่อนกว่าการมีไฟล์สัญญาอนุญาตที่วางอยู่ข้าง ๆ เวต หาก LLaDA-Image กำลังจะถูกนำไปใช้ในผลิตภัณฑ์ นั่นเป็นคำถามสำหรับห้องปฏิบัติการวิจัยของ Ant Group ไม่ใช่เรื่องที่แก้ได้ด้วยการชี้ไปที่แท็กเมทาดาทา
Qwen-Image-2.1 เป็นข้อแลกเปลี่ยนในทางกลับกัน: เอกสารชัดเจนไม่กำกวม และคำตอบคือไม่ ใบอนุญาตสำหรับงานวิจัยที่ระบุวันที่และห้ามใช้ในเชิงพาณิชย์นั้นวางแผนรับมือได้ง่ายกว่าใบอนุญาตแบบผ่อนปรนที่ไม่ชัดเจน เพราะไม่มีอะไรต้องตีความ ทั้งยังเป็นการเปลี่ยนแปลงจากตระกูล Qwen-Image รุ่นก่อน ซึ่งเผยแพร่ภายใต้ Apache 2.0 ทีมที่สร้างบนรุ่นก่อนจึงไม่อาจถือสมมติฐานเดิมต่อไปได้
โมเดลทั้งสองนี้ไม่ได้ให้บริการบน OrcaRouter และจะยังไม่ให้บริการจนกว่าประเด็นเรื่องสัญญาอนุญาตจะคลี่คลาย — สัญญาอนุญาตสำหรับการวิจัยเท่านั้น และไฟล์สัญญาอนุญาตที่ไม่ได้อยู่ในรีโพซิทอรี ต่างก็เป็นเหตุผลที่ต้องแยกเส้นทางแบบโฮสต์ออกจากการทดลอง โมเดลรูปภาพที่เราให้บริการอยู่คือ Imagen หลายระดับของ Google และ Gemini image previews, image endpoint ของ Grok Imagine จาก xAI และตระกูล GPT-Image ของ OpenAI ทั้งหมดอยู่เบื้องหลัง endpoint เดียวที่เข้ากันได้กับ OpenAI โดยส่งผ่านราคาตามรายการของผู้ให้บริการโดยไม่บวกเพิ่ม การสลับไปยังผู้ให้บริการรายอื่นโดยอัตโนมัติเมื่อเกิดข้อขัดข้อง และ routing DSL สำหรับประกอบโมเดลหลายตัวเข้าด้วยกันในการเรียกครั้งเดียว ใช้งานโมเดลที่ดาวน์โหลดได้สำหรับงานที่สัญญาอนุญาตครอบคลุมไว้ เรียกใช้โมเดลแบบโฮสต์สำหรับสิ่งใดก็ตามที่ไปถึงลูกค้า
ดูอะไรดี
สองสิ่งทำให้สิ่งนี้เปลี่ยนจากการเปรียบเทียบเอกสารมาเป็นการเปรียบเทียบโมเดล และทั้งสองอย่างสามารถตรวจสอบได้โดยไม่ต้องรอประกาศจากใคร
ประการแรกคือว่าไฟล์ LICENSE ปรากฏอยู่ในคลัง LLaDA-Image หรือไม่ สัญญาอนุญาตที่ระบุไว้ใน frontmatter และจัดส่งเป็นข้อความคือสิ่งที่ Apache 2.0 กำหนดไว้จริง ๆ และจนกว่าไฟล์นั้นจะมีอยู่ คำประกาศก็เป็นหลักฐานเพียงอย่างเดียว ประการที่สองคือว่าโค้ดสำหรับการฝึกจะถูกเผยแพร่หรือไม่ มันเป็นช่องสุดท้ายที่ยังไม่ได้ติ๊กบนการ์ด และเป็นความแตกต่างระหว่างเวตที่บังเอิญดาวน์โหลดได้ กับ "สูตรการฝึกแบบเปิดเต็มรูปแบบ" ที่ชื่อเรื่องสัญญาไว้
จนกว่าจะถึงตอนนั้น บทสรุปที่เป็นธรรมคือบทสรุปที่แหล่งข้อมูลสนับสนุน: ตอนนี้ LLaDA-Image อ้างสิทธิ์สัญญาอนุญาตที่ผ่อนปรนกว่า และยังไม่ได้จัดทำเอกสารเรื่องนี้ ส่วน Qwen-Image-2.1 จัดทำเอกสารสัญญาอนุญาตที่ห้ามสิ่งที่ทีมส่วนใหญ่ต้องการทำ และมีเพียงหนึ่งในสองตัวนี้เท่านั้นที่เคยถูกวัดโดยใครก็ตามที่ไม่ใช่ห้องทดลองของตัวเอง
