Qwen-Image-2.1: otwarte wagi i przezroczyste PNG, ale tylko do badań
Alibaba udostępniła wagi Qwen-Image-2.1. Model generuje przezroczyste PNG i działa w ComfyUI, ale licencja zabrania użytku komercyjnego bez osobnej umowy.

Alibaba wydała 20 września 2026 Qwen-Image-2.1, model do tworzenia i edycji grafik z otwartymi wagami. Potrafi od razu generować przezroczyste PNG, czyli dokładnie to, czego potrzebujesz do ikon, logotypów, wyciętych zdjęć produktów i innych elementów aplikacji, a w ComfyUI działa od dnia premiery. Haczyk tkwi w licencji: model wolno pobrać i uruchomić wyłącznie do badań i testów. Grafiki do aplikacji, która zarabia, wymagają osobnej licencji komercyjnej od Alibaby.
Drugi haczyk kryje się w liczbie podawanej w nagłówkach. „7B” opisuje tylko część, która rysuje obraz. Razem z enkoderem tekstu pliki z oficjalnego repozytorium zajmują 33,13 GB.
Przezroczyste tło bez osobnego narzędzia
W grudniu 2025 roku Alibaba pokazała Qwen-Image-Layered, osobny model do obrazów z przezroczystością. W wersji 2.1 ta umiejętność trafiła do głównego modelu, a o tym, czy powstanie zwykły obraz, czy PNG z kanałem alfa, decyduje prompt. Producent zaleca stały szablon: na początku This is an RGBA image with transparency., potem opis, a na końcu The image has alpha channel and the background is transparent.
Model wycina też wskazany obiekt ze zwykłego zdjęcia jako warstwę z przezroczystym tłem, dzięki czemu nie potrzebujesz osobnej usługi do usuwania tła. Umie edytować gotową przezroczystą grafikę, na przykład zmienić minę postaci albo podmienić napis, a przezroczystość zostaje. Zespół ComfyUI pisze wprost, że sprite’y, logotypy, ikony i wycięte produkty wychodzą z modelu z poprawnym kanałem alfa.

W przykładzie Alibaby model wyciąga z fotografii same gałęzie, a szachownica oznacza miejsca przezroczyste.
Dla kogoś, kto buduje aplikację z AI, to w praktyce o jeden krok mniej. Ikona trafia do projektu od razu jako PNG, bez ręcznego wycinania.
Dziesięć zdjęć referencyjnych i natywne 2K
Przy edycji model przyjmuje do 10 obrazów referencyjnych naraz. Obszar zmiany zaznaczasz kółkiem, zamalowaniem albo osobną maską, a model ma zachowywać wygląd ludzi i produktów w kolejnych wersjach. Domyślnie generuje obraz 2048 na 2048 pikseli, a w formacie 16:9 daje 2752 na 1536 pikseli.

Ten salon z przykładów producenta złożono z dziesięciu zdjęć wyposażenia widocznych po lewej.
Siódme miejsce w teście Alibaby
Producent pokazuje jakość modelu na własnym benchmarku Qwen-Image-Bench. To 1000 dwujęzycznych promptów przygotowanych przez ekspertów, a oceny wystawia Q-Judger, model oceniający oparty na Qwen3.6-27B. Test i sędzia pochodzą więc od twórcy ocenianego modelu, a wynik trzeba czytać jako jego deklarację.
Qwen-Image-2.1 dostał 60,28 punktu i zajął 7. miejsce na 29 modeli. Całą pierwszą szóstkę stanowią modele zamknięte: GPT Image 2.5 Sunburst (67,01), GPT Image 2 (64,69), Grok Imagine 2.0 (63,47), Qwen Image 3 Pro samej Alibaby (62,36), Muse Image (62,34) i MAI Image 2.5 Pro (61,02). Tuż za nim są Nano Banana 2.0 (59,82) i GPT Image 1.5 (59,65). Wcześniejszy otwarty Qwen-Image-2512 z 20 mld parametrów ma 52,06 punktu, więc prawie trzy razy mniejszy następca wypada wyraźnie lepiej.

Podpisy na wykresie są po chińsku. Górny rząd słupków pokazuje wynik łączny, dolny liczbę parametrów w miliardach, a kłódka oznacza model zamknięty, którego liczby parametrów producent nie ujawnia.
Na jakim sprzęcie to ruszy
Alibaba nie podaje minimalnych wymagań sprzętowych. Generator w pełnej precyzji (BF16) zajmuje 14,23 GB, a enkoder tekstu Qwen3-VL 8B, który czyta polecenia i obrazy referencyjne, 17,53 GB. Enkoder jest więc większy od samego generatora, dlatego model opisywany jako „7B” to w sumie ponad 30 GB plików.
ComfyUI sięga po lżejsze wersje. Oficjalne szablony pobierają generator i enkoder w kwantyzacji INT8 (7,26 GB i 9,35 GB) oraz dekoder obrazu VAE (0,68 GB), łącznie około 17,3 GB.
Pomiary opublikowali twórcy SGLang, silnika obsługującego model od premiery. Na karcie RTX 4090 z 24 GB pamięci wygenerowanie obrazu 1024 na 1024 piksele w 40 krokach trwało około 18,7 sekundy, a szczytowe zużycie pamięci wyniosło 22,7 GiB. Żeby całość się zmieściła, enkoder trzymano w zwykłej pamięci RAM i przesyłano na kartę warstwa po warstwie. Gdy cały model mieścił się na serwerowej karcie H200, zużycie sięgnęło 38,4 GiB.
Rozsądny próg dla domowego komputera to więc karta z 24 GB pamięci, a i na niej część modelu trafia do RAM. Na słabszych kartach zostają pliki INT8 i przenoszenie większej części modelu, co kosztuje czas i wymaga zapasu zwykłej pamięci. Instrukcje powstały z myślą o kartach Nvidii, Alibaba wymienia też karty AMD Radeon, a komputery Apple w nich nie występują.
Gdzie uruchomić model bez własnej karty graficznej
Najprościej w przeglądarce, bo Alibaba udostępnia demo na Hugging Face. Drugą opcją jest Comfy Cloud, gdzie działają te same szablony, bez pobierania plików. Na start dostajesz pięć darmowych uruchomień bez podawania karty płatniczej, potem płacisz kredytami z planu. Plany indywidualne kosztują od 20 do 100 USD miesięcznie.
W chmurze obowiązuje ta sama licencja. W swoim FAQ Comfy odpowiada jednym słowem na pytanie, czy modelu wolno używać komercyjnie: nie.
Licencja: testy tak, użytek komercyjny nie
Wcześniejsze otwarte modele z tej serii, czyli pierwszy Qwen-Image z sierpnia 2025 roku, Qwen-Image-Edit, Qwen-Image-2512 i Qwen-Image-Layered, ukazały się na licencji Apache 2.0, która pozwala na użytek komercyjny. Tak samo wyszedł sierpniowy, tekstowy Qwen3.8-27B. Wersję 2.1 objęto licencją Qwen Research License, która pozwala używać modelu wyłącznie w celach niekomercyjnych, czyli według jej definicji do badań i ewaluacji. Na użytek komercyjny trzeba mieć osobną licencję, o którą należy wystąpić mailowo pod adresem [email protected]. Ewentualne spory rozstrzyga sąd w Hangzhou według prawa chińskiego.
Model wolno więc wypróbować i porównać z innymi. Ikony użyte w płatnej aplikacji, sklepie internetowym albo reklamie to już cel komercyjny.
Co wybrać do aplikacji, która zarabia
Masz trzy uczciwe drogi.
- Licencja od Alibaby: jeśli Qwen-Image-2.1 sprawdza się u ciebie najlepiej, napisz na adres podany w licencji i zapytaj o warunki.
- Płatne API: w Alibaba Cloud Model Studio dostępny jest zamknięty model Qwen-Image-3.0-Pro, który w tym samym zestawieniu wypada wyżej niż 2.1. W regionie Frankfurt obraz w rozdzielczości 1K kosztuje 0,03438 USD, a w 2K 0,068761 USD. Przy edycji dochodzi 0,00275 USD za każdy obraz wejściowy. Sto ikon w 1K kosztuje około 3,44 USD. Karta tego modelu nie wymienia przezroczystego tła, więc tło usuniesz osobnym krokiem.
- Starszy model na Apache 2.0: Qwen-Image-Layered z grudnia 2025 roku rozkłada obraz na osobne warstwy RGBA i pozwala na użytek komercyjny.
Qwen-Image-2.1 to najwyżej oceniony otwarty model w zestawieniu Alibaby. Dopóki licencja się nie zmieni, traktuj go jako narzędzie do testów, a grafiki do produktu generuj modelem, którego licencja dopuszcza użytek komercyjny.
Źródła: ogłoszenie na blogu Qwen, repozytorium i licencja na GitHubie, karta Qwen-Image-Bench, strona modelu w ComfyUI, pomiary SGLang, cennik Qwen-Image-3.0-Pro w Model Studio.
Opanuj AI‑coding w 5 minut. W każdy poniedziałek.
Konkretne premiery, analizy cen i jeden trik, który przyspieszy Twoją pracę. Po polsku, bez żargonu, prosto na maila.