Carte visuelle principale générée pour l'article Qwen-Image-2.1 versus LLaDA-Image, avec le titre Qwen-Image-2.1 vs LLaDA-Image, le sous-titre La mention de licence a changé, deux pastilles indiquant carte Qwen : licence de recherche, non commerciale et carte LLaDA : apache-2.0, aucun fichier de licence, ainsi que le pied de page : état de la fiche de modèle et du dépôt selon Hugging Face, octobre 2026, avec le logo OrcaRouter incrusté en bas à droite
Guides & Insights

Qwen-Image-2.1 vs LLaDA-Image : La déclaration de licence a changé, et un seul d’entre eux le dit

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Lorsque LLaDA-Image est sorti d'inclusionAI, le laboratoire de recherche d'Ant Group, le 4 septembre 2026, la lecture de ses dépôts allait de soi : aucune licence déclarée, donc tous droits réservés. Cette lecture est aujourd'hui dépassée. Ses quatre cartes de modèle Hugging Face — LLaDA-Image, LLaDA-Image-Turbo, LLaDA-Image-FP8 et LLaDA-Image-Turbo-FP8 — déclarent apache-2.0 dans leur frontmatter aujourd'hui, et c'est la première ligne de la carte. Aucun de ces quatre dépôts ne contient de fichier LICENSE, et le dépôt GitHub du projet, créé le 31 août 2026, n'a pas non plus de fichier de licence. À mettre en regard de Qwen-Image-2.1, publié par l'équipe Qwen d'Alibaba avec des poids ouverts le 20 septembre 2026 sous l'accord de licence Qwen Research — un vrai document, daté, à usage non commercial uniquement, et la raison pour laquelle ses propres dépôts étiquettent la licence comme other. Deux modèles d'image à poids ouverts, à seize jours d'intervalle, et celui dont la paperasse semble la plus faible est celui qui a déclaré une licence permissive. Le hic tient entièrement à la manière dont elle a été déclarée.

Il s'agit d'une comparaison sur le papier, pas de pixels. Aucun des deux modèles ne dispose d'un score d'image indépendant — LLaDA-Image, dans aucune de ses quatre variantes, n'apparaît sur aucun des deux tableaux d'images d'Artificial Analysis, et les deux lignes de Qwen-Image-2.1 y portent une Aucune API disponible mention. Ce que vous pouvez réellement décider aujourd'hui, c'est ce que vous êtes autorisé à faire, et cette réponse a changé pour l'un de ces deux modèles sans annonce.

Ce que disent réellement les deux surfaces de licence

Lisez les sources primaires plutôt que les résumés, car l'écart entre les deux, c'est toute l'histoire.

• Qwen-Image-2.1 — publié sous l'accord de licence Qwen Research daté du 20 septembre 2026, accordé « FOR NON-COMMERCIAL PURPOSES ONLY », l'utilisation commerciale nécessitant une licence distincte à demander au fournisseur. Les dépôts Hugging Face d'Aliba​ba pour le modèle indiquent le champ de licence comme autre, ce qui est l'étiquette exacte : il ne s'agit pas d'une licence approuvée par l'OSI et le modèle n'est pas open source en ce sens. Il reste téléchargeable, exécutable et évaluable.

• LLaDA-Image — la carte de modèle Hugging Face déclare license: apache-2.0 dans son frontmatter YAML. Apache 2.0 est une licence OSI qui autorise l’utilisation commerciale. Si le frontmatter constitue la licence, c’est de loin la plus permissive des deux.

• LLaDA-Image, le reste de la trace documentaire — il n'y a aucun fichier LICENSE dans l'arborescence du dépôt. La fiche répertorie un README, un model_index.json, un .gitattributes et les répertoires de poids, et rien d'autre. Le dépôt GitHub du projet ne comporte pas non plus de fichier de licence ; l'API de dépôt de GitHub elle-même ne signale aucune licence pour celui-ci. Le texte d'Apache 2.0 lui-même exige qu'une copie de la licence accompagne la distribution, et il n'y a de copie ni à l'un ni à l'autre endroit.

Ainsi, la description honnête de la situation de LLaDA-Image en matière de licence n’est ni « pas de licence » ni « Apache 2.0 ». C’est : la fiche affirme Apache 2.0 et le dépôt ne fournit pas le texte de la licence. Ces deux faits vont dans le même sens, mais ils ne constituent pas un seul et même fait, et un seul d’entre eux est ce qu’un évaluateur des achats recherchera.

Screenshot of the LLaDA-Image repository page on Hugging Face, captured in English, showing the model card title Building Strong Image Generators with Fully Open Training Recipes, the apache-2.0 licence label in the metadata sidebar, and the repository file list containing README.md, model_index.json and weight directories but no LICENSE file

Pourquoi la carte est rédigée comme elle l'est

Le frontmatter de la fiche est révélateur. Le titre de la famille de modèles est LLaDA-Image : construire de puissants générateurs d'images avec des recettes d'entraînement entièrement ouvertes, et deux des cinq points forts annoncés portent sur l'ouverture : un pré-entraînement sur images uniquement pour établir le prior visuel, et un modèle de diffusion unifié où le backbone comme le DiT sont des modèles de diffusion entraînés dans un seul cadre. Le mot « recette » n'est pas là par hasard. La fiche met en avant un pipeline reproductible, pas seulement un checkpoint.

Ensuite, lisez le plan open source au bas de la même carte :

• Code d'inférence et poids du modèle — coché.

• Code d'entraînement — non coché, marqué bientôt disponible.

• Un rapport arXiv distinct, numéroté 2609.03796 sur la carte, contient la méthode.

C'est une position cohérente, et non malhonnête : les poids et le code d'inférence maintenant, le code d'entraînement plus tard, la méthode dans un article. C'est aussi le contexte dans lequel une ligne de frontmatter Apache 2.0 a du sens en tant qu'intention — c'est un projet qui veut être lu comme entièrement ouvert. L'écart entre l'intention et le fichier de licence manquant est exactement le genre de chose que le frontmatter d'une fiche de modèle ne peut pas exprimer.

Ce que disent les chiffres, et qui les a produits

La seule affirmation quantitative rattachée à LLaDA-Image est un score de benchmark, et sa provenance doit être énoncée clairement. La fiche indique « SOTA on Qwen-Image-Bench » avec des scores globaux de 53,53 en anglais et de 53,38 en chinois. Ce sont les propres chiffres d'inclusionAI, mesurés sur un benchmark nommé d'après le modèle d'un autre laboratoire, et ils n'ont été reproduits par personne en dehors du laboratoire. Le modèle Base les atteint en 50 étapes d'échantillonnage ; la variante Turbo est distillée avec Twin-DMD pour tourner en 2 à 4 étapes. Aucun de ces chiffres n'est adossé à un décompte de votes, et aucun n'apparaît sur un classement indépendant, car LLaDA-Image n'y figure pas.

Qwen-Image-2.1 figure sur les deux tableaux d'Artificial Analysis — 1 034 Elo, au 18e rang sur 166 en génération d'images à partir de texte, et 1 074 Elo, au 18e rang sur 97 en édition, d'après respectivement 5 286 et 5 536 comparaisons en aveugle. Ses lignes sur les deux tableaux portent le marqueur Open Weights, avec Aucune API disponible comme mention. Il s'agit d'une mesure indépendante d'un modèle auto-hébergé, ce qui est plus difficile à obtenir qu'il n'y paraît, et c'est le seul axe où ces deux modèles ne sont pas du tout dans la même catégorie.

Generated licence paper-trail card for the two models, with two panels. The Qwen-Image-2.1 panel reads Card licence: research licence, Licence file in repository: yes, Licence text: Qwen Research License, Commercial use: not allowed. The LLaDA-Image panel reads Card licence: apache-2.0, Licence file in repository: no, Licence text: Apache 2.0, Commercial use: not documented. A footer reads Card and repository state per Hugging Face, October 2026, with the OrcaRouter logo composited bottom-right

La décision que cela change réellement

Si vous vous fondiez sur la lecture antérieure — selon laquelle LLaDA-Image ne déclare aucune licence, donc à considérer comme tous droits réservés — la situation s’est améliorée, et cette amélioration est suffisamment concrète pour être exploitée en vue d’évaluations et de travaux internes. Maintenez la réserve : une licence mentionnée uniquement dans le YAML, sans texte de licence dans le dépôt, est une preuve plus faible qu’un fichier de licence situé à côté des poids. Si LLaDA-Image doit intégrer un produit, c’est une question à poser au laboratoire de recherche d’Ant Group, et non quelque chose à trancher en pointant une balise de métadonnées.

Qwen-Image-2.1 est l’arrangement inverse : la paperasse est sans ambiguïté et la réponse est non. Une licence de recherche datée qui interdit l’usage commercial est plus facile à prendre en compte dans la planification qu’une licence permissive peu claire, car il n’y a rien à interpréter. C’est aussi un changement par rapport à la précédente gamme Qwen-Image, qui était diffusée sous Apache 2.0, de sorte que les équipes qui se sont appuyées sur la génération précédente ne peuvent pas reconduire cette hypothèse.

Aucun de ces modèles n'est servi sur OrcaRouter, et aucun ne le sera tant que la question de la licence n'est pas résolue — une licence limitée à la recherche et un fichier de licence absent du dépôt sont l'un comme l'autre des raisons de garder le chemin hébergé distinct de l'expérimentation. Les modèles d'image que nous exposons sont les paliers Imagen de Google et les aperçus d'image Gemini, le point de terminaison d'image Grok Imagine de xAI et la famille GPT-Image d'OpenAI, tous derrière un seul point de terminaison compatible OpenAI, avec le prix catalogue du fournisseur répercuté sans marge, le basculement automatique entre fournisseurs, et un DSL de routage permettant de composer plusieurs modèles en un seul appel. Exécutez le modèle téléchargeable pour les travaux couverts par la licence ; appelez le modèle hébergé pour tout ce qui touche un client.

Que regarder

Deux choses transforment cela d’une comparaison de paperasse en une comparaison de modèles, et toutes deux sont vérifiables sans attendre l’annonce de qui que ce soit.

Le premier point est de savoir si un fichier LICENSE apparaît dans les dépôts LLaDA-Image. Une licence nommée dans le frontmatter et livrée sous forme de texte est ce qu’Apache 2.0 exige réellement, et tant que ce fichier n’existe pas, la déclaration est la seule preuve. Le second est de savoir si le code d’entraînement est livré. C’est la dernière case non cochée de la carte, et c’est la différence entre des poids qui se trouvent être téléchargeables et les « recettes d’entraînement entièrement ouvertes » que promet le titre.

D’ici là, le résumé équitable est celui que les sources étayent : LLaDA-Image revendique désormais une licence plus permissive et ne l’a pas encore documentée, Qwen-Image-2.1 documente une licence qui interdit ce que la plupart des équipes veulent faire, et un seul des deux a été mesuré par quelqu’un d’autre que son propre laboratoire.