Hero card generata per l'articolo Qwen-Image-2.1 vs LLaDA-Image, con il titolo Qwen-Image-2.1 vs LLaDA-Image, il sottotitolo La rivendicazione di licenza è cambiata, due chip con il testo Qwen card: licenza di ricerca, non commerciale e LLaDA card: apache-2.0, nessun file di licenza, e il footer Model card e stato del repository secondo Hugging Face, ottobre 2026, con il logo OrcaRouter sovrapposto in basso a destra
Guides & Insights

Qwen-Image-2.1 vs LLaDA-Image: La dichiarazione sulla licenza è cambiata, e solo uno dei due lo dichiara

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Quando LLaDA-Image è stato rilasciato da inclusionAI, il laboratorio di ricerca di Ant Group, il 4 settembre 2026, la lettura dei suoi repository era immediata: nessuna licenza dichiarata, quindi tutti i diritti riservati. Oggi quella lettura è superata. Tutte e quattro le sue model card su Hugging Face — LLaDA-Image, LLaDA-Image-Turbo, LLaDA-Image-FP8 e LLaDA-Image-Turbo-FP8 — dichiarano apache-2.0 nel loro frontmatter, ed è la prima riga della scheda. Nessuno di quei quattro repository contiene un file LICENSE, e neanche il repository GitHub del progetto, creato il 31 agosto 2026, ha un file di licenza. Mettilo a confronto con Qwen-Image-2.1, rilasciato dal team Qwen di Alibaba con pesi aperti il 20 settembre 2026 sotto la Qwen Research License Agreement — un documento reale, datato, solo per uso non commerciale, ed è il motivo per cui i suoi stessi repository etichettano la licenza come other. Due modelli di immagini con pesi aperti, a sedici giorni di distanza, e quello con la documentazione dall'aria più debole è quello che ha dichiarato una licenza permissiva. Il trucco sta interamente in come è stata dichiarata.

Questo è un confronto su carta, non sui pixel. Nessuno dei due modelli ha un punteggio indipendente per le immagini — LLaDA-Image, in una qualsiasi delle sue quattro varianti, non compare su nessuna delle due board di immagini di Artificial Analysis, e le due righe di Qwen-Image-2.1 presenti lì riportano una Nessuna API disponibile nota. Ciò che puoi effettivamente decidere oggi è ciò che ti è consentito fare, e quella risposta è cambiata per uno di questi due modelli senza un annuncio.

Cosa dicono effettivamente le due superfici di licenza

Leggi le fonti primarie invece dei riassunti, perché il divario tra loro è tutto.

• Qwen-Image-2.1 — rilasciato con il Qwen Research License Agreement datato 20 settembre 2026, concesso "SOLO PER SCOPI NON COMMERCIALI", con l'uso commerciale che richiede una licenza separata da richiedere al fornitore. I repository Hugging Face di Alibaba per il modello riportano il campo licenza come other, che è il tag corretto: non è una licenza approvata da OSI e il modello non è open source in quel senso. Resta scaricabile, eseguibile e sottoponibile a benchmark.

• LLaDA-Image — la scheda del modello Hugging Face dichiara licenza: apache-2.0 nel suo frontmatter YAML. Apache 2.0 è una licenza OSI che consente l'uso commerciale. Se il frontmatter è la licenza, questa è di gran lunga la più permissiva delle due.

• LLaDA-Image, il resto della documentazione — nell'albero del repository non c'è alcun file LICENSE. La scheda elenca un README, un model_index.json, un .gitattributes e le directory dei pesi, e nient'altro. Nemmeno il repository GitHub del progetto ha un file di licenza; l'API dei repository di GitHub non segnala alcuna licenza. Il testo stesso di Apache 2.0 richiede che una copia della licenza accompagni la distribuzione, e non ce n'è copia in nessuno dei due luoghi.

Quindi la descrizione onesta della posizione sulla licenza di LLaDA-Image non è "nessuna licenza" e non è "Apache 2.0". È questa: la scheda afferma Apache 2.0 e il repository non fornisce il testo della licenza. Questi due fatti vanno nella stessa direzione, ma non sono lo stesso fatto, e solo uno di essi è ciò che un revisore degli acquisti cercherà.

Screenshot of the LLaDA-Image repository page on Hugging Face, captured in English, showing the model card title Building Strong Image Generators with Fully Open Training Recipes, the apache-2.0 licence label in the metadata sidebar, and the repository file list containing README.md, model_index.json and weight directories but no LICENSE file

Perché la card si legge in questo modo

Il frontmatter stesso della scheda è rivelatore. Il titolo di punta della famiglia di modelli è LLaDA-Image: costruire forti generatori di immagini con ricette di addestramento completamente aperte, e due dei suoi cinque punti salienti dichiarati riguardano l'apertura: il pre-addestramento solo su immagini per stabilire il prior visivo, e un modello diffusion unificato in cui sia il backbone sia il DiT sono modelli diffusion addestrati in un unico framework. La parola "ricetta" sta facendo un lavoro deliberato. La scheda propone una pipeline riproducibile, non solo un checkpoint.

Poi leggi il piano open source in fondo alla stessa scheda:

• Codice di inferenza e pesi del modello — selezionato.

• Codice di addestramento — non spuntato, contrassegnato prossimamente.

• Un rapporto arXiv separato, numerato 2609.03796 sulla scheda, riporta il metodo.

Questa è una posizione coerente e non disonesta: pesi e codice di inferenza ora, codice di addestramento più avanti, metodo in un articolo. È anche il contesto in cui una riga di frontmatter Apache 2.0 ha senso come intento — questo è un progetto che vuole essere letto come completamente aperto. Lo scarto tra l'intento e il file di licenza mancante è esattamente il tipo di cosa che il frontmatter di una card non può esprimere.

Cosa dicono i numeri, e chi li ha prodotti

L'unica affermazione quantitativa collegata a LLaDA-Image è un punteggio di benchmark, e la sua provenienza va dichiarata chiaramente. La scheda riporta "SOTA su Qwen-Image-Bench" con punteggi complessivi di 53.53 in inglese e 53.38 in cinese. Si tratta di cifre di inclusionAI stesso, misurate su un benchmark intitolato al modello di un altro laboratorio, e non sono state riprodotte da nessuno al di fuori del laboratorio. Il modello Base le raggiunge a 50 passaggi di campionamento; la variante Turbo è distillata con Twin-DMD per funzionare in 2-4 passaggi. Nessuno dei due valori ha un conteggio di voti alle spalle e nessuno dei due compare su una classifica indipendente, perché LLaDA-Image non è presente in nessuna di esse.

Qwen-Image-2.1 è presente su entrambe le board di Artificial Analysis — 1.034 Elo alla posizione 18 di 166 nel text-to-image e 1.074 Elo alla posizione 18 di 97 nell'editing, rispettivamente da 5.286 e 5.536 confronti alla cieca. Le sue righe su entrambe le board riportano il marcatore Open Weights accanto alla Nessuna API disponibile. Si tratta di una misurazione indipendente di un modello self-hosted, una cosa più difficile da ottenere di quanto sembri, ed è l'unico asse su cui questi due modelli non appartengono affatto alla stessa categoria.

Generated licence paper-trail card for the two models, with two panels. The Qwen-Image-2.1 panel reads Card licence: research licence, Licence file in repository: yes, Licence text: Qwen Research License, Commercial use: not allowed. The LLaDA-Image panel reads Card licence: apache-2.0, Licence file in repository: no, Licence text: Apache 2.0, Commercial use: not documented. A footer reads Card and repository state per Hugging Face, October 2026, with the OrcaRouter logo composited bottom-right

La decisione che questo cambia davvero

Se ti stavi basando sulla lettura precedente — secondo cui LLaDA-Image non dichiara alcuna licenza, quindi va trattata come tutti i diritti riservati — la situazione è migliorata, e il miglioramento è abbastanza concreto da consentire di agire per la valutazione e il lavoro interno. Tieni presente la precisazione: una licenza indicata solo in YAML, senza il testo della licenza nel repository, è un'evidenza più debole rispetto a un file di licenza che si trova accanto ai pesi. Se LLaDA-Image deve entrare in un prodotto, è una questione per il laboratorio di ricerca di Ant Group, non qualcosa da risolvere indicando un tag di metadati.

Qwen-Image-2.1 è il contrario: la documentazione è inequivocabile e la risposta è no. Una licenza di ricerca datata che vieta l'uso commerciale è più facile da gestire rispetto a una permissiva poco chiara, perché non c'è nulla da interpretare. È anche un cambiamento rispetto alla precedente linea Qwen-Image, distribuita sotto Apache 2.0, quindi i team che hanno costruito sulla generazione precedente non possono portarsi avanti quell'assunzione.

Nessuno di questi modelli è erogato su OrcaRouter, e nessuno dei due lo sarà finché non si risolve la questione della licenza — una licenza solo per la ricerca e un file di licenza non presente nel repository sono entrambi motivi per tenere il percorso hosted separato dall'esperimento. I modelli di immagini che invece esponiamo sono i tier di Imagen di Google e le anteprime immagini di Gemini, l'endpoint per le immagini Grok Imagine di xAI e la famiglia GPT-Image di OpenAI, tutti dietro un unico endpoint compatibile con OpenAI, con il prezzo di listino del provider passato così com'è a markup zero, failover automatico tra provider, e un DSL di routing per comporre più modelli in un'unica chiamata. Usa il modello scaricabile per il lavoro coperto dalla licenza; chiama quello hosted per tutto ciò che arriva a un cliente.

Cosa guardare

Due cose trasformano questa documentazione in un modello, ed entrambe sono verificabili senza aspettare l'annuncio di nessuno.

Il primo è se un file LICENSE compare nei repository LLaDA-Image. Una licenza menzionata nel frontmatter e distribuita come testo è ciò che Apache 2.0 richiede effettivamente, e finché quel file non esiste la dichiarazione è l'unica prova. Il secondo è se il codice di addestramento viene distribuito. È l'ultima casella non spuntata sulla scheda, ed è la differenza tra pesi che per caso sono scaricabili e le «ricette di addestramento completamente aperte» che il titolo promette.

Fino ad allora, la sintesi equa è quella che le fonti suffragano: LLaDA-Image ora rivendica la licenza più permissiva e non l'ha ancora documentata, Qwen-Image-2.1 documenta una licenza che vieta ciò che la maggior parte dei team vuole fare, e solo uno dei due è stato misurato da qualcuno che non sia il suo stesso laboratorio.