Qwen-Image-2.1 yhdistää kuvien luonnin ja muokkauksen
Alibaba julkaisi Qwen-Image-2.1-kuvamallin, joka tuottaa ja muokkaa kuvia samalla mallilla ja osaa läpinäkyvät kuvat – mutta uusi tutkimuslisenssi sulkee kaupallisen käytön portin taakse.
Alibaban Qwen-tiimi julkaisi 20. syyskuuta 2026 Qwen-Image-2.1 -kuvamallin, joka tekee samalla mallilla sekä uusia kuvia tekstiohjeen perusteella että muokkaa käyttäjän antamia kuvia. Mallin painot on julkaistu ladattavina Hugging Face- ja ModelScope-palveluissa, ja useat suositut kuvatyökalut tukevat sitä heti. Uutta on muun muassa se, että malli osaa tuottaa ja muokata läpinäkyviä kuvia. Julkaisuun liittyy kuitenkin rajoitus: lisenssi sallii toistaiseksi vain tutkimus- ja arviointikäytön.
Yksi malli kahden sijaan
Tähän asti kuvien tuottaminen ja kuvien muokkaaminen on hoidettu usein eri malleilla: yksi ohjelma piirtää kuvan tyhjästä, toinen korjaa olemassa olevaa kuvaa. Qwen-Image-2.1 yhdistää molemmat samaan malliin. Käyttäjä voi antaa pelkän tekstiohjeen, tai tekstiohjeen ja yhden tai useamman kuvan, ja malli tuottaa lopputuloksen samalla kertaa. Qwenin mukaan tämä tekee työnkulusta yksinkertaisemman erityisesti silloin, kun kuvasta pitää säilyttää osia ennallaan.
Mallin kuvan tuottava osa on 7 miljardin parametrin kokoinen, eli selvästi pienempi kuin alkuperäisen Qwen-Image-mallin noin 20 miljardin parametrin kokoluokka. Pienempi koko tarkoittaa, että malli on halvempi ja nopeampi ajaa. Koko pakkaus ei kuitenkaan ole pieni: kuvan tuottavan osan lisäksi mukaan tarvitaan tekstin ja kuvien ymmärtämiseen tarkoitettu multimodaalinen osa sekä kuvat tiiviiseen muotoon pakkaava osa, ja yhteensä niiden koko on noin 33 gigatavua. Käytännössä malli vaatii siis melko runsaasti näytönohjaimen muistia.
Läpinäkyvät kuvat ja useat viitekuvat
Yksi näkyvimmistä uudistuksista on läpinäkyvyyden tuki. Malli tuottaa ja muokkaa kuvia, joissa on alfa-kanava eli läpinäkyvyystieto, ja osaa irrottaa kohteen tavallisesta valokuvasta läpinäkyväksi kuvaksi. Tämä helpottaa esimerkiksi tuotekuvien ja hahmojen liittämistä toisiin kuviin, koska erillistä taustan poistoa ei tarvita.
Malli hyväksyy enintään kymmenen viitekuvaa. Niiden avulla käyttäjä voi kuvata, millainen lopputuloksen pitää olla: yksi kuva voi näyttää kohteen, toinen ympäristön ja kolmas tyylin. Malli tukee myös paikallisia muokkauksia, joissa muutettava kohta merkitään esimerkiksi ympyrällä, piirretyllä merkinnällä tai erillisellä peittokuvalla. Qwenin mukaan teksti kuvissa, kasvojen valaistus ja yksityiskohtien tarkkuus ovat parantuneet aiempiin versioihin verrattuna.
Ohje kirjoitetaan uudelleen ennen kuvaa
Julkaisun mukana tulee kaksi erillistä apumallia, jotka kirjoittavat käyttäjän antaman lyhyen ohjeen uudelleen yksityiskohtaisemmaksi kuvausohjeeksi ennen kuin diffuusiomalli alkaa piirtää. Toinen on tarkoitettu tekstistä kuvaksi -tehtäviin ja toinen kuvien muokkaukseen. Molemmat ovat noin 19 gigatavun kokoisia hienosäädettyjä kielimalleja.
Qwen on julkaissut myös apumallien ohjausohjeen eli niin sanotun järjestelmäkehotteen. Se määrittää muun muassa sen, missä kielessä kuvassa näkyvä teksti piirretään: jos käyttäjä nimeää kielen, sitä noudatetaan; jos kuvassa on jo tekstiä, sen kieltä jatketaan. Tällainen yksityiskohta on tärkeä esimerkiksi pakkaustekstejä tuottavalle yritykselle, koska väärälle kielelle käännetty teksti tekee kuvasta käyttökelvottoman.
Avoimet painot – mutta ei kaupalliseen käyttöön
Qwen-Image-2.1 on avointen painojen malli: kuka tahansa voi ladata sen, tutkia sitä, pienentää sitä omalle laitteelleen ja opettaa sitä lisää omalla aineistollaan. Mallin mukana toimitettu lisenssi on kuitenkin poikkeuksellisen tiukka: Qwen Research License Agreement sallii käytön vain tutkimus- ja arviointitarkoituksiin. Kaupallinen käyttö vaatii erikseen neuvoteltavan luvan, jota voi tiedustella Qwenilta sähköpostitse.
Ratkaisu jatkaa sarjan kiristynyttä linjaa. Qwen-Imagen aiemmat versiot 1.0 ja 2.0 julkaistiin sallivalla Apache 2.0 -lisenssillä, joka sallii myös kaupallisen käytön. Sen jälkeen tuli Qwen-Image 3.0, joka on kokonaan suljettu: sitä ei voi ladata lainkaan vaan ainoastaan käyttää Alibaban palvelun kautta. Uusin malli on siis näiden välimuoto – painot saa käsiinsä, mutta kaupallinen käyttö on rajattu pois. Koska jo myönnettyä lisenssiä ei muuteta jälkikäteen, vanhat Apache 2.0 -versiot pysyvät edelleen vapaasti käytettävinä.
Sama nimi, eri mallisukupolvi
Nimistä syntyy helposti sekaannus. Qwen-Image 3.0 julkaistiin heinäkuussa 2026 ja tuli yleisesti saataville elokuun alussa, eli selvästi aiemmin kuin nyt julkaistu 2.1-versio. Numerot eivät siis kerro järjestyksestä: 3.0 ja 2.1 ovat kaksi eri tuotelinjaa. Isompi numero tarkoittaa tässä yhteydessä suljettua ja kalliimpaa pilvipalvelua, pienempi numero ladattavaa ja kevyempää mallia. Alibaba itse kuvaa 2.1-versiota sarjan tasapainoisimmaksi ja kustannustehokkaimmaksi.
Työkalut tukevat ensimmäisestä päivästä
Mallin käyttöönottoa on pyritty helpottamaan. Se on tuettu heti julkaisupäivänä muun muassa Hugging Facen Diffusers-kirjastossa, suositussa ComfyUI-kuvatyökalussa sekä useissa nopeaan päättelyyn tarkoitetuissa palvelinohjelmistoissa. Nämä työkalut hoitavat teknisen raskaan työn, joten mallia voi kokeilla ilman omaa ohjelmointityötä.
Mitä tästä seuraa?
Julkaisusta puuttuu toistaiseksi riippumaton arviointi. Qwen tiedotti mallista omilla kanavillaan ja tarjosi ennakkoon rajoitetun määrän koekäyttöpaikkoja, mutta kaikki laatuväitteet tulevat toistaiseksi valmistajalta itseltään. Malli sai painot ladattavaksi vain kolme päivää ennakkoilmoituksen jälkeen, eikä julkisia vertailutestejä ulkopuolisilta tahoilta ole vielä ehtinyt syntyä. Käyttäjän kannattaakin suhtautua lukuihin varauksella, kunnes riippumattomia tuloksia ilmestyy.
Selvin viesti ei kuitenkaan ole kuvanlaatu vaan lisenssikäytäntö. Alibaba ei enää käsittele avoimuutta kyllä tai ei -kysymyksenä: uusin malli on ladattava, mutta sen kaupallinen käyttö on portin takana. Yritykselle, joka suunnittelee kuvatuotantoa mallin varaan, ratkaiseva kysymys ei ole mallin laatu vaan se, millä ehdoilla sitä saa käyttää.
Lähteet
- Qwen (Alibaba): Qwen-Image-2.1 -mallikortti ja blogi. 20.9.2026. huggingface.co/Qwen/Qwen-Image-2.1 ja qwen.ai/blog?id=qwen-image-2.1
- QwenLM: Qwen-Image-2.1 -lähdekoodivarasto (julkaisu- ja tukitiedot). 20.9.2026. github.com/QwenLM/Qwen-Image-2.1
- Qwen: Qwen Research License Agreement (lisenssiteksti). 20.9.2026. huggingface.co/Qwen/Qwen-Image-2.1/blob/main/LICENSE
- TechFlow: Qwen Open-Sources Qwen-Image-2.1, a 7B Unified Image Generation and Editing Model with Transparent Image Support. 20.9.2026. techflowpost.com/en-US/newsletter/137018
- Supergok: Qwen-Image-2.1 Launches as Open-Weight AI Image Model. 20.9.2026. supergok.com/qwen-image-2-1
- OrcaRouter: Qwen-Image 2.1 vs Qwen-Image 3.0: the Lower Number Is the Newer Model. 20.9.2026. orcarouter.ai/blog/qwen-image-2-1-vs-qwen-image-3-0
- OrcaRouter: Qwen-Image 2.1 Shipped Quietly: Inside Qwen/Qwen-Image-2.1-PE-I2I. 20.9.2026. orcarouter.ai/blog/qwen-image-2-1-open-weights-research-license
