Wygenerowana karta tytułowa z napisem „Qwen-Image-3.0 — Ogólna dostępność”, z chipami funkcji dla promptów o długości 4500 tokenów, renderowaniem tekstu o wielkości ~10px, 12 językami oraz cenami od 0,18 ¥ za obraz, i wkomponowanym logo OrcaRouter w rogu.
Guides & Insights

Qwen-Image-3.0 staje się ogólnie dostępny: praktyczny model obrazowy Alibaby kosztuje ¥0.18 za obraz.

Autor

Rowan Sterling

Data publikacji

Powrót do wszystkich wpisów

5 sierpnia 2026 roku, Qwen-Image-3.0przestał być podglądem dostępnym wyłącznie na zaproszenie i został udostępniony wszystkim użytkownikom platformy AI Qwe​n firmy Alibaba. Cały produkt jest wyceniony jak usługa komunalna, a nie jak ekskluzywna usługa artystyczna — generowanie obrazu z tekstu od mniej więcej ¥0.18 za obraz po stronie konsumenckiej, a nad nim poziom Pro — a sam Alibaba opisuje go jako model obrazowy stworzony do pracy, a nie do wygrywania konkursów piękności. Tydzień po pełnej ogólnej dostępności to ujęcie warto potraktować poważnie: dwie rzeczy, którymi Qwen-Image-3.0 się wyróżnia, czyli bardzo długie prompty i bardzo czytelny mały tekst, to dokładnie te dwie rzeczy, z którymi większość modeli obrazowych po cichu sobie nie radzi.

Qwen-Image-3.0 dostępny jest w dwóch edycjach — Qwen-Image-3.0-Pro i Qwen-Image-3.0-Standard — obie udostępniane przez ten sam hostowany interfejs API. Premierę rozłożono w czasie: ogłoszono ją 21 lipca 2026 roku z dostępem do API tylko na zaproszenia na platformach Alibaba Cloud Bailian i Qwe​n AI, a 5 sierpnia udostępniono je w pełni. Międzynarodowi deweloperzy uzyskują do niego dostęp przez Qwe​n Cloud, gdzie relacje z premiery podają cenę Pro na 0,04 USD za obraz, a Standard na 0,03 USD za obraz. Krajowe ceny dla konsumentów zaczynają się od około 0,18 ¥ za obraz. To dane dotyczące premiery podane przez producenta, i ten artykuł traktuje je jako takie — są to liczby, które Alibaba zdecydowała się opublikować, a nie niezależny audyt.

Premiera w trzech liczbach

Jeśli z tego ogłoszenia przeczytasz tylko jedną rzecz, to są właśnie te trzy:

Prompty o długości 4500 tokenów. Qwen-Image-3.0 akceptuje prompty około 4,5-krotnie dłuższe niż jego poprzednik. To zmiana, która umożliwia wszystko inne: prompt może teraz określić całą stronę gazety, storyboard, dziewięciopolową infografikę wiedzy lub arkusz egzaminacyjny i wygenerować je w jednym przebiegu, zamiast sklejać je w edytorze.

~Renderowanie tekstu o wysokości 10 pikseli. Model renderuje mały, czytelny tekst o wysokości czcionki do około dziesięciu pikseli — to różnica między obrazem, który wygląda, jakby zawierał tekst, a takim, który faktycznie można poprawnie odczytać.

12 języków, 20+ czcionek.Wielojęzyczne wyjście jest natywne, a nie dodatkiem: chiński, angielski, koreański i inne, renderowane w piśmie wskazanym w prompcie, bez pól z brakującymi glifami, które nękają większość modeli trenowanych na językach zachodnich w przypadku CJK.

Dodaj mniej chwytliwe, ale równie ważne elementy — image-to-image i edycję obrazu w tym samym modelu, diagramy wiedzy łączące wzory, geometrię i kroki wyprowadzania, oraz realistyczne makiety interfejsów webowych, gier i streamingu na żywo — a profil jest jasny. Alibaba celuje w zastosowania produkcyjne: masowe generowanie egzaminów edukacyjnych, plakaty do transgranicznego e-commerce, layout wydawniczy, prototypowanie UI. Chińskie materiały premierowe podsumowują pozycjonowanie jednym znakiem: ", "praktyczny".

A generated spec scoreboard for Qwen-Image-3.0 showing 4,500-token prompts, ~10px text, 12 native languages, pricing from ¥0.18 / $0.03-0.04 per image, Pro and Standard editions, and closed API-only weights, footnoted as sourced from Alibaba launch materials.

Co jak dotąd zostało niezależnie zweryfikowane

Screenshot of the Qwen-Image blog post 'Qwen Image 3.0 Released: Long Prompts, Small Text, and Multilingual Layouts', announcing Qwen-Image-3.0 on July 21, 2026.

Oto część, która ma znaczenie dla każdego, kogo poparzyła efektowna premiera. Qwen-Image-3.0 to zamknięty model: brak wag, brak licencji, brak raportu technicznego, brak oficjalnego wydania benchmarków. To celowe odwrócenie — Qwen-Image 1.0 i 2.0 zostały wydane jako otwarte, z wagami na licencji Apache-2.0 na Hugging Face, wraz z raportami technicznymi tego samego dnia. 3.0 zrywa z tym, a Alibaba nie opublikowała karty modelu ani liczby parametrów. Wczesne relacje z premiery opisują go jako model o około 20 miliardach parametrów w architekturze MMDiT, ale należy to traktować jako doniesienia, a nie potwierdzenie: skoro nie ma raportu do sprawdzenia, nikt poza Alibaba nie może tego zweryfikować.

To oznacza, że każda z powyższych flagowych możliwości — wejście o długości 4500 tokenów, tekst 10px, 12 języków — jest twierdzeniem producenta. Najmocniejszym jak dotąd niezależnym punktem danych jest chińskie porównanie praktyczne opublikowane w oknie premiery, w którym porównano Qwen-Image-3.0-Pro z jedenastoma innymi konfiguracjami. Jego ustalenia są dwojakie: Qwen-Image-3.0-Pro sprawdzał się znakomicie w generowaniu interfejsów UI i dashboardów, diagramów naukowych i spójnych systemów projektowych, osiągając najwyższą ogólną jakość wykonania w tych kategoriach — ale był też średnio najwolniejszym modelem, a przy małej czcionce wciąż w niektórych przypadkach generował nieczytelne znaki. Pod względem ścisłej dokładności tekstu ten sam test preferował GPT-Image-2 medium, Gemi​ni 3 Pro i Seedream 5.0 Lite. To przydatny, uczciwy obraz: mocny w strukturze, ale wciąż nie bezbłędny w zakresie maleńkiej czcionki, którą reklamuje.

Po stronie rankingu, relacje z premiery Alibaby twierdzą, że Qwen-Image-3.0-Pro osiągnął #1 wśród chińskich modeli i #2 wśród głównych modeli w rankingu text-to-image na Arenie, za serią G​PT-Image od Ope​nAI. Niezależna strona śledząca (AITNT, 5 sierpnia) pokazuje model Pro na szczycie własnych modeli Alibaby zarówno w kategorii Art Creation (1,256 Elo, globalny zakres rankingu 2–11), jak i Photorealistic (1,258 Elo, globalnie 4–13). Według tygodniowego rankingu Areny z 10 sierpnia model Pro zajmował 7. miejsce ogółem w generowaniu obrazów — wciąż w czołówce i warto obserwować, czy utrzyma tę pozycję, gdy minie pierwszy tydzień premiery.

Screenshot of the Text-to-Image Arena overall leaderboard on arena.ai, showing 77 ranked image models by Elo as of August 10, 2026.

Dwie edycje, jedna historia cen

Qwen-Image-3.0-Pro i Qwen-Image-3.0-Standard to ta sama rodzina modeli oferowana w dwóch przedziałach cenowych. W chmurze Qwe​n opublikowane stawki za pojedynczy obraz wynoszą 0,04 USD dla Pro i 0,03 USD dla Standard; krajowa stawka konsumencka zaczyna się od około 0,18 juana. Dla kontekstu: to poziom poniżej średniego przedziału GPT-Image-2 i mniej więcej tam, gdzie wylądował Nano Banana 2 Lite od Goo​gle — to celowa cena „na tyle niska, by można było iterować”. Warto jednak zwrócić uwagę na jedno zastrzeżenie z niezależnego audytu wykonalności: ten sam audyt w pewnym momencie pod koniec lipca nie mógł znaleźć wpisu Qwen-Image-3.0 na stronie z cennikiem Model Studio w Alibaba Cloud. Ta luka z czasem zniknęła w miarę wdrażania GA, ale to przypomnienie, że powierzchnia API modelu, który ma zaledwie tydzień, wciąż może się stabilizować — sprawdź aktualną stronę z cennikiem, zanim zwiążesz z nim produkcyjny potok.

Gdzie możesz to wywołać

Qwen-Image-3.0 to model hostowany, więc ścieżka dostępu to własne API dostawcy oraz kilka platform trzecich, które go udostępniły od czasu GA. Nie ma opcji samodzielnego hostowania ani ścieżki otwartych wag, co ma znaczenie, jeśli Twoim wymaganiem jest rezydencja danych lub pełna kontrola nad potokiem. Z drugiej strony, bycie hostowanym oznacza brak planowania pojemności GPU — płacisz za obraz, a dostawca to skaluje.

To także moment, w którym router udowadnia swoją wartość. Qwen-Image-3.0 jest zupełnie nowy, a jego strona z cenami zdążyła się już raz zmienić w ciągu tygodnia; jeśli oceniasz go na tle pozostałych modeli obrazowych, nie chcesz integracji szytej na miarę dla każdego dostawcy w trakcie podejmowania decyzji. OrcaRouter udostępnia ponad 200 modeli za jednym endpointem zgodnym z OpenAI, po cenach katalogowych dostawcy i z zerową marżą, więc obniżka cen u dostawcy — w tym ta dotycząca modelu sprzed tygodnia — jest aktywna po naszej stronie tego samego dnia, w którym wchodzi w życie. Automatyczne przełączanie awaryjne oznacza, że możesz uruchamiać obciążenia pokrewne Qwen-Image-3.0 na modelach, które routujemy (gpt-image-2 od Ope​nAI, Grok Imagine od xAI, rodzina Imagen 4 od Goo​gle), bez przestojów w Twoim potoku przetwarzania obrazów, podczas gdy porównujesz jednego nowicjusza z resztą stawki. Porównanie jest sednem sprawy: jeden klucz API, jeden kształt wywołania i liczby obok siebie.

Kto powinien działać teraz

Zespoły tworzące gęste, tekstochłonne materiały — arkusze egzaminacyjne, karty produktów, wielojęzyczne plakaty, makiety dashboardów, storyboardy — są naturalnymi wczesnymi użytkownikami, ponieważ to właśnie przy takich zadaniach prompt o 4500 tokenów z natywnym renderowaniem wielojęzycznym oszczędza godziny sklejania i przepisywania. Zespoły, których standardem jest fotorealizm lub absolutna wierność typograficzna, mają dziś lepiej sprawdzone opcje, a niezależne dane testowe przemawiają za odczekaniem, aż problemy z drobnym tekstem zostaną dopracowane. Tak czy inaczej, nie opieraj się wyłącznie na deklaracjach z premiery: model jest zamknięty, więc jedyne, co powie ci, czy zasługuje na miejsce w twoim stacku, to uruchomienie na nim własnych prawdziwych promptów — co, przy 0,03–0,04 dolara za obraz, jest tanim eksperymentem do przeprowadzenia.

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube