Genererade hjältekortet för artikeln Qwen-Image-2.1 versus LLaDA-Image, med rubriken Qwen-Image-2.1 vs LLaDA-Image, underrubriken Licenspåståendet ändrades, två chips med texten Qwen-kort: forskningslicens, icke-kommersiell och LLaDA-kort: apache-2.0, ingen licensfil, samt sidfoten Modellkort och arkivstatus enligt Hugging Face, oktober 2026, med OrcaRouter-logotypen komponerad i nedre högra hörnet
Guides & Insights

Qwen-Image-2.1 vs LLaDA-Image: Licenspåståendet ändrades, och bara en av dem säger det

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

När LLaDA-Image släpptes av inclusionAI, Ant Groups forskningslabb, den 4 september 2026, var tolkningen av dess repositorier enkel: ingen licens angiven, därför alla rättigheter förbehållna. Den tolkningen är nu föråldrad. Alla fyra av dess Hugging Face-modellkort — LLaDA-Image, LLaDA-Image-Turbo, LLaDA-Image-FP8 och LLaDA-Image-Turbo-FP8 — anger apache-2.0 i sina frontmatter i dag, och det är kortets första rad. Inte ett enda av dessa fyra repositorier innehåller en LICENSE-fil, och projektets GitHub-repositorium som skapades den 31 augusti 2026 har inte heller någon licensfil. Ställ det mot Qwen-Image-2.1, som släpptes av Alibabas Qwen-team med öppna vikter den 20 september 2026 under Qwen Research License Agreement — ett riktigt dokument, daterat, endast för icke-kommersiellt bruk, och anledningen till att dess egna repositorier märker licensen som other. Två bildmodeller med öppna vikter, med sexton dagars mellanrum, och den med det svagare klingande pappersarbetet är den som angav en permisiv licens. Haken ligger helt och hållet i hur den angavs.

Det här är en jämförelse på papper, inte i pixlar. Ingen av modellerna har en oberoende bildpoäng – LLaDA-Image i någon av sina fyra varianter finns inte med på någon av Artificial Analysis-bildtavlorna, och Qwen-Image-2.1:s två rader där har en ”Inget API tillgängligt”-anteckning. Det du faktiskt kan avgöra idag är vad du har tillåtelse att göra, och det svaret ändrades för en av dessa två modeller utan ett tillkännagivande.

Vad de två licensytorna faktiskt säger

Läs primärkällorna i stället för sammanfattningarna, för glappet mellan dem är hela historien.

• Qwen-Image-2.1 — släppt under Qwen Research License Agreement daterat den 20 september 2026, beviljad "ENDAST FÖR ICKE-KOMMERSIELLA ÄNDAMÅL", där kommersiell användning kräver en separat licens som begärs från leverantören. Alibabas Hugging Face-repositorier för modellen anger licensfältet som other, vilket är den korrekta taggen: det är inte en OSI-godkänd licens och modellen är inte öppen källkod i den bemärkelsen. Den är fortfarande nedladdningsbar, körbar och kan benchmarkas.

• LLaDA-Image — Hugging Face-modellkortet deklarerar license: apache-2.0 i dess YAML-frontmatter. Apache 2.0 är en OSI-licens som tillåter kommersiell användning. Om frontmatter är licensen är detta den mer tillåtande av de två med bred marginal.

• LLaDA-Image, resten av pappersspåret — det finns ingen LICENSE-fil i repositoryträdet. Kortet listar en README, en model_index.json, en .gitattributes och viktkatalogerna, och inget annat. Projektets GitHub-repository har inte heller någon licensfil; GitHubs eget repository-API rapporterar ingen licens för det. Apache 2.0:s egen text kräver att en kopia av licensen åtföljer distributionen, och det finns ingen kopia på någon av platserna.

Så den ärliga beskrivningen av LLaDA-Images licensläge är varken "ingen licens" eller "Apache 2.0". Den är: kortet anger Apache 2.0 och repositoriet levererar inte licenstexten. Dessa två fakta drar i samma riktning, men de är inte samma faktum, och bara ett av dem är vad en upphandlingsgranskare kommer att leta efter.

Screenshot of the LLaDA-Image repository page on Hugging Face, captured in English, showing the model card title Building Strong Image Generators with Fully Open Training Recipes, the apache-2.0 licence label in the metadata sidebar, and the repository file list containing README.md, model_index.json and weight directories but no LICENSE file

Varför kortet lyder som det gör

Kortets egen frontmatter är det som avslöjar allt. Modellfamiljens rubrik är LLaDA-Image: Att bygga starka bildgeneratorer med helt öppna träningsrecept, och två av dess fem angivna höjdpunkter handlar om öppenhet: förträning enbart på bilder för att etablera den visuella priorn, och en enhetlig diffusionsmodell där både backbonen och DiT är diffusionsmodeller som tränas i ett och samma ramverk. Ordet ”recept” är avsiktligt laddat. Kortet marknadsför en reproducerbar pipeline, inte bara en checkpoint.

Läs sedan planen för öppen källkod längst ned på samma kort:

• Inferenskod och modellvikter – ikryssat.

• Träningskod – inte ikryssad, markerad kommer snart.

• En separat arXiv-rapport, numrerad 2609.03796 på kortet, innehåller metoden.

Det är en sammanhängande hållning och inte en oärlig sådan: vikter och inferenskod nu, träningskod senare, metod i en artikel. Det är också det sammanhang där en Apache 2.0-frontmatterrad är begriplig som avsikt — det här är ett projekt som vill läsas som helt öppet. Glappet mellan avsikten och den saknade licensfilen är precis den sorts sak som ett korts frontmatter inte kan uttrycka.

Vad siffrorna säger, och vem som producerade dem

Det enda kvantitativa påståendet kopplat till LLaDA-Image är en benchmarkpoäng, och dess härkomst behöver redovisas tydligt. Modellkortet rapporterar "SOTA på Qwen-Image-Bench" med totalpoäng på 53,53 på engelska och 53,38 på kinesiska. Det är inclusionAI:s egna siffror, uppmätta på en benchmark uppkallad efter ett annat labs modell, och de har inte reproducerats av någon utanför labbet. Base-modellen når dem vid 50 samplingssteg; Turbo-varianten destilleras med Twin-DMD för att köras i 2 till 4 steg. Ingen av siffrorna har ett röstunderlag bakom sig, och ingen av dem förekommer på en oberoende resultattavla, eftersom LLaDA-Image inte finns med på någon.

Qwen-Image-2.1 finns med på båda resultattavlorna hos Artificial Analysis — 1 034 Elo på plats 18 av 166 för text-till-bild och 1 074 Elo på plats 18 av 97 för redigering, från 5 286 respektive 5 536 blinda jämförelser. Dess rader på båda tavlorna bär Open Weights-markören bredvid Inget API tillgängligtanteckningen. Det är en oberoende mätning av en självhostad modell, vilket är svårare att få till än vad det låter, och det är den enda axeln där dessa två modeller inte alls är i samma kategori.

Generated licence paper-trail card for the two models, with two panels. The Qwen-Image-2.1 panel reads Card licence: research licence, Licence file in repository: yes, Licence text: Qwen Research License, Commercial use: not allowed. The LLaDA-Image panel reads Card licence: apache-2.0, Licence file in repository: no, Licence text: Apache 2.0, Commercial use: not documented. A footer reads Card and repository state per Hugging Face, October 2026, with the OrcaRouter logo composited bottom-right

Det beslut som detta faktiskt förändrar

Om du förlitade dig på den tidigare tolkningen – att LLaDA-Image inte anger någon licens, så behandla det som alla rättigheter förbehållna – har läget förbättrats, och förbättringen är tillräckligt verklig för att agera på för utvärdering och internt arbete. Behåll förbehållet: en licens som bara anges i YAML, utan licenstext i arkivet, är svagare bevis än en licensfil som ligger bredvid vikterna. Om LLaDA-Image ska in i en produkt är det en fråga för Ant Groups forskningslabb, inte något som löses genom att peka på en metadatatagg.

Qwen-Image-2.1 är den omvända affären: pappersarbetet är entydigt och svaret är nej. En daterad forskningslicens som förbjuder kommersiell användning är lättare att planera kring än en otydlig tillåtande licens, eftersom det inte finns något att tolka. Det är också en förändring från den tidigare Qwen-Image-serien, som släpptes under Apache 2.0, så team som byggde på den föregående generationen kan inte föra antagandet vidare.

Ingen av dessa modeller serveras på OrcaRouter, och ingen av dem kommer att göra det förrän licensfrågan har lösts — en licens för enbart forskning och en licensfil som inte finns i repositoriet är båda skäl att hålla den hostade vägen åtskild från experimentet. De bildmodeller vi faktiskt tillhandahåller är Googles Imagen-nivåer och Gemini-bildförhandsvisningar, xAI:s Grok Imagine-bildslutpunkt och OpenAIs GPT-Image-familj, alla bakom en OpenAI-kompatibel slutpunkt med leverantörens listpris vidarebefordrat utan påslag, automatisk redundansväxling mellan leverantörer, och en routing-DSL för att kombinera flera modeller till ett enda anrop. Kör den nedladdningsbara modellen för det arbete som licensen omfattar; anropa den hostade för allt som når en kund.

Vad du ska titta på

Två saker förvandlar detta från en pappersjämförelse till en modelljämförelse, och båda går att kontrollera utan att vänta på någons tillkännagivande.

Det första är huruvida en LICENSE-fil förekommer i LLaDA-Image-repositorierna. En licens som anges i frontmatter och levereras som text är vad Apache 2.0 faktiskt kräver, och tills den filen finns är deklarationen det enda beviset. Det andra är huruvida träningskoden levereras. Det är den sista rutan som inte är ikryssad på kortet, och det är skillnaden mellan vikter som råkar vara nedladdningsbara och de "helt öppna träningsrecept" som titeln utlovar.

Fram till dess är den rättvisa sammanfattningen den som källorna stöder: LLaDA-Image gör nu anspråk på den mer tillåtande licensen och har ännu inte dokumenterat den, Qwen-Image-2.1 dokumenterar en licens som förbjuder det som de flesta team vill göra, och bara en av de två har mätts av någon annan än dess eget labb.