Una scheda titolo generata che riporta 'Qwen-Image-3.0 — General Availability', con chip delle funzionalità per prompt da 4.500 token, rendering del testo a ~10px, 12 lingue, e prezzi a partire da ¥0,18 per immagine, e il logo OrcaRouter composto nell'angolo.
Guides & Insights

Qwen-Image-3.0 raggiunge la GA: il modello di immagini pratico di Alibaba viene lanciato a ¥0.18 per immagine

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Il 5 agosto 2026, Qwen-Image-3.0ha smesso di essere un'anteprima solo su invito e si è aperto a tutti gli utenti della piattaforma Qwen AI di Alibaba. L'intero prodotto è tariffato come un servizio di utilità piuttosto che come un servizio d'arte premium — text-to-image a partire da circa ¥0,18 per immagine sul lato consumer, con un livello Pro al di sopra — e la stessa Alibaba la inquadra come un modello di immagine costruito per fare un lavoro, non per vincere un concorso di bellezza. A una settimana dalla piena disponibilità generale, questa impostazione merita di essere presa sul serio: le due cose con cui Qwen-Image-3.0 si distingue, prompt molto lunghi e testi piccoli molto leggibili, sono esattamente le due cose in cui la maggior parte dei modelli di immagine fallisce silenziosamente.

Qwen-Image-3.0 è disponibile in due edizioni — Qwen-Image-3.0-Pro e Qwen-Image-3.0-Standard — entrambe esposte tramite la stessa API ospitata. Il lancio è stato scaglionato: annunciato il 21 luglio 2026 con accesso API solo su invito su Alibaba Cloud Bailian e sulla piattaforma Qwe​n AI, poi reso completamente aperto il 5 agosto. Gli sviluppatori internazionali vi accedono tramite Qwe​n Cloud, dove la copertura del lancio elenca Pro a $0.04 per immagine e Standard a $0.03 per immagine. Per i consumatori domestici, i prezzi partono da circa ¥0.18 per immagine. Quelle sono cifre di lancio riportate dal fornitore, e questo articolo le tratta come tali — sono i numeri che Alibaba ha scelto di pubblicare, non una verifica indipendente.

Il lancio, in tre numeri

Se leggi una sola cosa dall'annuncio, sono queste tre:

Prompt da 4.500 token. Qwen-Image-3.0 accetta circa 4,5 volte la lunghezza del prompt del suo predecessore. È questo il cambiamento abilitante per tutto il resto: un prompt può ora specificare un'intera pagina di giornale, uno storyboard, un'infografica di conoscenza a nove riquadri o un foglio d'esame e produrlo in un'unica passata, invece di essere assemblato in un editor.

Rendering del testo a ~10 pixel. Il modello renderizza testo piccolo e leggibile fino a circa dieci pixel di altezza del carattere — la differenza tra un'immagine che sembra avere del testo e una che in realtà si legge correttamente.

12 lingue, 20+ font. L'output multilingue è nativo, non un ripensamento: cinese, inglese, coreano e altro ancora, renderizzati nella scrittura richiesta dal prompt, senza i riquadri dei glifi mancanti che affliggono la maggior parte dei modelli addestrati in Occidente su CJK.

Aggiungete gli elementi meno citabili ma altrettanto importanti — image-to-image ed editing di immagini nello stesso modello, diagrammi di conoscenza che combinano formule, geometria e passaggi di derivazione, e mock-up plausibili di interfacce web, di gioco e di live-streaming — e il profilo è chiaro. Alibaba mira al lavoro di produzione: generazione in blocco di esami per l'istruzione, poster per l'e-commerce transfrontaliero, impaginazione editoriale, prototipazione UI. I materiali di lancio cinesi riassumono il posizionamento con un unico carattere: , "pratico".

A generated spec scoreboard for Qwen-Image-3.0 showing 4,500-token prompts, ~10px text, 12 native languages, pricing from ¥0.18 / $0.03-0.04 per image, Pro and Standard editions, and closed API-only weights, footnoted as sourced from Alibaba launch materials.

Cosa è stato verificato in modo indipendente finora

Screenshot of the Qwen-Image blog post 'Qwen Image 3.0 Released: Long Prompts, Small Text, and Multilingual Layouts', announcing Qwen-Image-3.0 on July 21, 2026.

Ecco la parte che conta per chiunque sia rimasto scottato da un lancio appariscente. Qwen-Image-3.0 è un modello chiuso: niente pesi, niente licenza, nessun rapporto tecnico, nessuna pubblicazione ufficiale di benchmark. È un'inversione deliberata — Qwen-Image 1.0 e 2.0 erano stati rilasciati come modelli aperti, con pesi Apache-2.0 su Hugging Face e rapporti tecnici pubblicati lo stesso giorno. La 3.0 rompe con tutto ciò, e Alibaba non ha pubblicato una scheda del modello né il numero dei parametri. I resoconti iniziali del lancio la descrivono come un modello da circa 20 miliardi di parametri su architettura MMDiT, ma prendetelo come un dato riportato, non confermato: senza un rapporto da consultare, nessuno al di fuori di Alibaba può verificarlo.

Ciò significa che ogni capacità di punta sopra elencata — l'input da 4.500 token, il testo a 10px, le 12 lingue — è una dichiarazione del fornitore. Il dato indipendente più solido finora è un confronto pratico cinese pubblicato durante la finestra di lancio, che ha messo Qwen-Image-3.0-Pro contro altre undici configurazioni. I risultati sono a doppio taglio: Qwen-Image-3.0-Pro è stato eccellente nella generazione di UI/dashboard, diagrammi scientifici e sistemi di design unificati, con la più alta qualità complessiva di completamento in quelle categorie — ma è stato anche il modello più lento in media, e il testo in corpo piccolo ha comunque prodotto caratteri illeggibili in alcuni casi. Per la rigorosa accuratezza del testo, lo stesso test ha preferito GPT-Image-2 medium, Gemi​ni 3 Pro e Seedream 5.0 Lite. È un quadro utile e onesto: forte nella struttura, non ancora impeccabile nel carattere minuscolo che pubblicizza.

Sul fronte della classifica, la copertura del lancio di Alibaba afferma che Qwen-Image-3.0-Pro ha raggiunto il #1 tra i modelli cinesi e il #2 tra i modelli mainstream nella classifica text-to-image di Arena, dietro alla serie G​PT-Image di Ope​nAI. Un sito di monitoraggio indipendente (AITNT, 5 agosto) mostra il modello Pro in cima ai modelli di Alibaba sia nella categoria Art Creation (1.256 Elo, posizione globale 2–11) sia in quella Photorealistic (1.258 Elo, posizione globale 4–13). Secondo la classifica settimanale di Arena del 10 agosto, il modello Pro si trovava al #7 complessivo nella generazione di immagini — ancora ai vertici, e da tenere d'occhio per vedere se manterrà la posizione mentre si affievolisce la frenesia della settimana di lancio.

Screenshot of the Text-to-Image Arena overall leaderboard on arena.ai, showing 77 ranked image models by Elo as of August 10, 2026.

Due edizioni, un'unica storia di prezzi

Qwen-Image-3.0-Pro e Qwen-Image-3.0-Standard appartengono alla stessa famiglia di modelli, con due livelli di prezzo. Su Qwe​n Cloud le tariffe pubblicate per immagine sono $0.04 per Pro e $0.03 per Standard; la tariffa per i consumatori nazionali parte da circa ¥0.18. Per contesto, questo prezzo si colloca sotto il livello medio di GPT-Image-2 e più o meno allo stesso livello di dove si è posizionato Nano Banana 2 Lite di Goo​gle — una scelta deliberata per essere "abbastanza economico da poter iterare". Un avvertimento da un audit indipendente sulla buildability merita di essere segnalato: lo stesso audit non è riuscito a trovare una voce per Qwen-Image-3.0 nella pagina dei prezzi di Model Studio di Alibaba Cloud a un certo punto di fine luglio. Questo vuoto si è successivamente chiuso con il procedere del rollout GA, ma è un promemoria che la superficie API di un modello vecchio di una settimana può essere ancora in fase di assestamento — controlla la pagina dei prezzi attuale prima di affidargli una pipeline di produzione.

Dove puoi chiamarlo

Qwen-Image-3.0 è un modello ospitato, quindi il percorso di accesso è l'API del fornitore e diverse piattaforme di terze parti che lo hanno adottato a partire dalla GA. Non esiste un'opzione di self-hosting né un percorso con pesi aperti, un aspetto rilevante se la tua esigenza è la residenza dei dati o il pieno controllo della pipeline. In compenso, essere ospitato significa che non devi pianificare la capacità GPU: paghi per immagine e il fornitore gestisce la scalabilità.

Questo è anche il momento in cui un router dimostra il suo valore. Qwen-Image-3.0 è nuovissimo e la sua pagina dei prezzi si è già spostata una volta in una settimana; se lo stai valutando rispetto al resto del panorama dei modelli di immagini, non vuoi un'integrazione su misura per ogni fornitore mentre decidi. OrcaRouter presenta 200+ modelli dietro un unico endpoint compatibile con OpenAI al prezzo di listino del fornitore, senza alcun ricarico, quindi un taglio dei prezzi da parte del fornitore — incluso uno su un modello vecchio di una settimana — è attivo dalla nostra parte lo stesso giorno in cui viene pubblicato. Il failover automatico significa che puoi eseguire carichi di lavoro affini a Qwen-Image-3.0 tramite i modelli che instradiamo (gpt-image-2 di Ope​nAI, Grok Imagine di xAI, la famiglia Imagen 4 di Goo​gle) senza che la tua pipeline di immagini si interrompa mentre confronti un nuovo arrivato con il resto del campo. Il confronto è il punto: una singola chiave API, una sola forma di chiamata e i numeri fianco a fianco.

Chi dovrebbe agire ora

I team che generano risorse dense e ricche di testo — fogli d'esame, schede prodotto, poster multilingue, mock-up di dashboard, storyboard — sono i primi utilizzatori naturali, perché sono proprio quei carichi di lavoro in cui un prompt da 4.500 token con rendering multilingue nativo fa risparmiare ore di assemblaggio e riscrittura. I team il cui standard è il fotorealismo o la fedeltà tipografica assoluta hanno oggi opzioni meglio collaudate, e i dati dei test indipendenti suggeriscono di aspettare che i problemi con i testi piccoli si risolvano. In ogni caso, non basatevi solo sulle dichiarazioni del lancio: il modello è chiuso, quindi l'unica cosa che vi dirà se merita un posto nella vostra stack è provarlo con i vostri prompt reali — che, a $0,03–$0,04 per immagine, è un esperimento economico da fare.

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube