Qwen4-perhe julkistettiin: Max, Flash, Plus ja 27B
Alibaba julkisti Apsara-konferenssissa Qwen4-malliperheen ja kertoi, että sitä seuraavat Qwen4.5 ja Qwen5 kasvavat 5–10 biljoonaan parametriin.
Kiinalainen teknologiayhtiö Alibaba julkisti 22. syyskuuta uuden Qwen4-tekoälymalliperheen yhtiön vuosittaisessa Apsara-konferenssissa Hangzhoussa. Qwen-mallien uudeksi johtajaksi nimetty Liu Dayiheng esitteli perheen konferenssin avajaisissa: siihen kuuluvat Qwen4-Max, Qwen4-Flash, Qwen4-Plus ja Qwen4-27B. Yhtiön mukaan itse Qwen4-malli on parhaillaan opetusvaiheessa, ja sitä seuraavat Qwen4.5 ja Qwen5 on tarkoitus kasvattaa 5–10 biljoonaan parametriin. Nykyisessä lippulaivamallissa Qwen3.8-Maxissa niitä on noin 2,4 biljoonaa.
Mitä Qwen4-perheeseen kuuluu?
Qwen on Alibaban oma kielimallien sarja, jota yhtiö kehittää sekä omiin palveluihinsa että avoimesti ladattavaksi. Neljä nimeä noudattavat sarjan aiempaa tapaa: Max on raskain ja kyvykkäin, Plus ja Flash ovat kevyempiä ja edullisempia, ja 27B on pienehkö malli, joka mahtuu tavalliseen työasemaan. Edellisessä Qwen3.8-sukupolvessa vastaavat jäsenet olivat Qwen3.8-Max (2,4 biljoonaa parametria), Qwen3.8-Flash ja avoimesti julkaistu Qwen3.8-27B.
Neljän mallin nimet eivät kuitenkaan ole peräisin Alibaban virallisesta tiedotteesta, jossa puhutaan vain Qwen 4:stä ja sitä seuraavista mallisarjoista. Nimet ovat levinneet konferenssin esityksistä ja paikalla olleiden some-koosteista, joten niitä kannattaa pitää toistaiseksi odotettuina mutta ei yhtiön vahvistamina.
Liu Dayiheng nimitettiin Qwen-kielimallien projektin johtajaksi juuri ennen konferenssia. Kiinalaisen teknologiamedian mukaan hän vastaa nyt Qwen-mallien tutkimuksesta ja tuotekehityksestä. Nimitys päätti tilanteen, jossa mallin johtajan paikka oli ollut täyttämättä useita kuukausia.
Mitä uutta Qwen4:ssä on?
Alibaba ei kertonut Qwen4:n koosta eikä kyvyistä tarkkoja lukuja, mutta se kertoi mallin rakentuvan uudelle arkkitehtuurille eli mallin laskennan perusrakenteelle. Yhtiö oli jo elokuussa julkistanut Qwen3.8-Flash-Nextin, jota se itse kuvaili Qwen4:n arkkitehtuurin ennakkoesittelyksi. Sen kerrottiin tuovan mukanaan uudenlaisen tavan käsitellä tekstin sisäisiä riippuvuuksia ja pudottavan opetuskustannuksia lähes 90 prosenttia. Qwen4 on siis ensimmäinen malli, joka rakennetaan tämän pohjan päälle.
Malli parantaa itse omaa kehitystään
Konferenssin kiinnostavimpia lukuja koski rekursiivinen itseparannus. Alibaban mukaan Qwen3.8-Max tunnisti itse omia heikkouksiaan, suunnitteli kokeita ja tuotti lisää opetusaineistoa kuukauden ajan ilman, että ihminen puuttui välivaiheisiin. Tuloksena syntyi 33 kehityskierrosta, ja mallin pistemäärä nousi yhdessä arviointipalvelussa 40:stä 45:een. Sirusuunnittelun kokeessa malli teki yli 10 000 työkalukutsua ja pienensi piirin pinta-alaa 42 prosenttia suorituskyvyn kärsimättä. Nämä ovat yhtiön omia ilmoituksia, joita ulkopuoliset eivät ole vahvistaneet.
Mitä 5–10 biljoonaa parametria tarkoittaa?
Parametrit ovat lukuja, jotka malli oppii opetusvaiheessa ja joihin sen osaaminen tallentuu. Mitä enemmän parametreja mallissa on, sitä enemmän sillä on kapasiteettia — mutta myös sitä enemmän laskentatehoa sen käyttäminen vaatii. Pelkkä parametrien määrä ei kuitenkaan ratkaise, kuinka hyvä malli on. Alibaba ei ole kertonut, milloin 5–10 biljoonan malli valmistuu, eikä se ole luvannut julkaista sen avoimia painoja.
Milloin Qwen4 julkaistaan?
Alibaba ei kertonut julkaisupäivää. Yhtiön tiedotteen mukaan Qwen4 on parhaillaan opetusvaiheessa, ja uutistoimisto Reutersin mukaan Alibaba vahvisti saman erillisessä lausunnossaan. Kiinalainen teknologiimedia otsikoi konferenssin jälkeen, että Qwen4 julkaistaan pian, mutta päivämäärää ei ole annettu. Kun malli on vasta opetusvaiheessa, perheen eri jäsenet ehtivät todennäköisesti markkinoille eri aikaan.
Miksi julkistus on merkittävä?
Qwen on yksi maailman käytetyimmistä avoimien mallien sarjoista. Alibaban mukaan sen malleja on ladattu yli kolme miljardia kertaa ja niistä on tehty yli 300 000 muunnelmaa, ja sarjan 27B-versio nousi aiemmin Hugging Facen historian tykätyimmäksi avoimeksi malliksi. Julkistus on osa laajempaa tekoälykilpajuoksua, jossa yhdysvaltalaiset ja kiinalaiset yhtiöt kasvattavat samaan aikaan sekä malliensa kokoa että laskentakapasiteettiaan. Kehityksen kärjessä olevia frontier-malleja opetetaan nykyään tuhansilla näytönohjaimilla, ja mallien koko on ollut yksi näkyvimmistä mittareista.
Alibaba kertoi samassa tilaisuudessa myös itse suunnittelemastaan Zhenwu V900 -tekoälysirusta sekä aikomuksestaan kasvattaa pilvipalvelunsa datakeskuskapasiteetti yli 20 gigawattiin vuoteen 2032 mennessä. Yhtiön toimitusjohtaja Eddie Wu sanoi tavoitteen olevan matkalla kohti keinotekoista superälyä ja arvioi, että koneiden laskenta tulee lopulta ylittämään ihmiskunnan ajattelun moninkertaisesti.
Lähteet
Alibaba Cloud: Alibaba Unveils Roadmap on Full-Stack AI Strategy from Chips, Cloud Infrastructure, Models to Agents, 22.9.2026.
Reuters / The Jakarta Post: Alibaba plans AI model with 5 trillion to 10 trillion parameters, unveils new chip, 22.9.2026.
CNBC: Alibaba shares jump as new AI chip, data center buildout plans unveiled, 22.9.2026.
CXO Digitalpulse: Alibaba Plans 5–10 Trillion-Parameter AI Model, Unveils Zhenwu V900 Chip, 22.9.2026.
TechWeb / Sina Tech: 阿里:Qwen4.5后模型将扩展至5-10T参数,Qwen4很快发布, 22.9.2026.
Qwen: Qwen3.8-Flash-Next: A New Architecture, Towards Ultimate Cost-Efficiency, 26.8.2026.
HuggingNews: Alibaba Plans 10 Trillion Parameter AI Model and China’s Most Powerful AI Chip, 22.9.2026.
