Tutkimus

Kiina valtasi avoimen tekoälyn

41 prosenttia Hugging Facen latauksista tulee Kiinasta – ero länteen vain kasvaa

Hanna HuulivuoHanna Huulivuo
Jaa:
Kiina valtasi avoimen tekoälyn

Lähdekoodi avautui itään

Hugging Face julkaisi maaliskuussa kattavan raportin avoimen lähdekoodin tekoälyn tilasta. Luvut kertovat muutoksesta, jota harva osasi ennustaa vielä pari vuotta sitten: kiinalaisten mallien osuus kaikista latauksista on noussut 41 prosenttiin. Yhdysvallat jäi 36,5 prosenttiin.

Kyse ei ole pelkästä yhden mallin aiheuttamasta latauspiikistä. Kiinalaiset yhtiöt julkaisevat nyt enemmän malleja, keräävät enemmän johdannaisversioita ja hallitsevat Hugging Facen suosituimpien mallien listoja. Alustan käyttäjämäärä on kasvanut 13 miljoonaan, ja julkisten mallien kokonaismäärä ylittää kaksi miljoonaa.

Ladattavien mallien keskimääräinen koko on samalla paisunut 827 miljoonasta parametrista 20,8 miljardiin kahdessa vuodessa. Kehittäjät eivät enää lataa pieniä kokeilumalleja, vaan tuotantovalmista tekoälyä.

DeepSeekin läpimurto käynnisti vyöryn

Käännekohta osui tammikuuhun 2025, kun DeepSeek julkaisi R1-mallinsa. Se tarjosi kilpailukykyistä suorituskykyä murto-osalla vakiintuneiden toimijoiden kustannuksista, ja painot olivat vapaasti ladattavissa. Malli keräsi yli 10 000 tykkäystä Hugging Facessa ja nousi alustan kaikkien aikojen suosituimmaksi puolentoista miljoonan mallin joukosta.

DeepSeekin menestys rohkaisi muita kiinalaisia toimijoita avaamaan kehitystään. ByteDance ja Tencent moninkertaistivat julkaisunsa lähes kymmenkertaisiksi vuoden aikana. Baidu hyppäsi nollasta yli sataan julkiseen malliin. Kun Meta oli aiemmin hallinnut avointa kenttää Llama-malleillaan, kiinalaiset yhtiöt täyttävät nyt Hugging Facen trendilistoja.

Kasvu ei rajoitu yksittäisiin organisaatioihin. Kiinalaisten repositorioiden määrä Hugging Facessa on kasvanut jyrkästi vuoden 2024 puolivälistä lähtien, kun USA:n kasvu on pysynyt tasaisena. Kiina tuottaa nyt enemmän avoimia malleja kuin yksikään muu maa.

Qwen kasvoi avoimen tekoälyn suurimmaksi ekosysteemiksi

Alibaban Qwen-malliperheen tarina kuvaa muutoksen mittakaavaa. Qwen-mallien kokonaislataukset ylittivät 700 miljoonaa tammikuuhun 2026 mennessä. Joulukuussa 2025 niiden lataukset ohittivat OpenAI:n, Metan, DeepSeekin ja MiniMaxin yhteenlasketun määrän. Tuorein versio Qwen 3.5 julkaistiin helmikuussa 2026, ja se tarjoaa suorituskykyä, joka kilpailee parhaiden länsimaisten mallien kanssa.

Pelkkiä latauslukuja kiinnostavampi on ekosysteemivaikutus. Qwenin pohjalta on rakennettu yli 113 000 johdannaismallia – enemmän kuin Googlella ja Metalla yhteensä. Kun kaikki Qwen-pohjaiset mallit lasketaan mukaan, luku nousee yli 200 000:een. Apache 2.0 -lisenssi madaltaa kynnystä: kuka tahansa voi käyttää malleja kaupallisesti ilman rajoituksia.

Käytännössä eurooppalainen startup, joka rakentaa tekoälysovellusta avoimen mallin päälle, päätyy yhä todennäköisemmin Qwen-pohjaiseen ratkaisuun. Se on ilmainen, suorituskykyinen ja tuettu laajalla kehittäjäyhteisöllä. Metan Llama, joka hallitsi kenttää vielä vuosi sitten, on menettänyt johtoasemansa.

Avoimen tekoälyn kenttä on myös keskittyneempi kuin moni uskoo. Raportin mukaan 200 suosituinta mallia – vain 0,01 prosenttia kaikista – keräävät lähes puolet kaikista latauksista. Noin puolella malleista on alle 200 latausta. Lataukset keskittyvät harvoille, ja yhä useampi suosikkimalli on kiinalainen.

Eurooppa katsoo sivusta – vai tarttuuko tilaisuuteen?

Euroopan osuus Hugging Facen latauksista jää kauas kärjestä. Iso-Britannia, Saksa ja Ranska näkyvät tilastoissa, mutta yhdenkään yksittäisen maan osuus ei yllä lähelle Kiinan tai USA:n lukuja. Ranska ja Saksa ovat tuottaneet yksittäisiä suosittuja malleja, mutta laajaa ekosysteemiä ei ole syntynyt.

Kiinalaisten avoimien mallien runsaus hyödyttää kuitenkin eurooppalaisia kehittäjiä: laadukkaita perusmalleja on saatavilla enemmän kuin koskaan, ja niiden käyttö on maksutonta. Kääntöpuolena riippuvuus ulkopuolisten mallien infrastruktuurista jättää Euroopan käyttäjän rooliin. Kun perusmallin koulutus vaatii kymmeniä tuhansia GPU-tunteja ja miljoonia euroja, harva eurooppalainen organisaatio pystyy kilpailemaan.

Raportti paljastaa myös toisen muutoksen: itsenäisten kehittäjien osuus latauksista on kasvanut 39 prosenttiin. Yritysten osuus on pudonnut alle 40 prosenttiin, kun se vielä vuonna 2022 oli 70 prosenttia. Avoin tekoäly hajaantuu, mutta hajautuminen tapahtuu kiinalaisella ja amerikkalaisella pohjalla.

Kokeile itse ja seuraa tilannetta

Lue Hugging Facen koko raportti osoitteessa huggingface.co/blog/huggingface/state-of-os-hf-spring-2026. Kokeile Qwen 3.5 -malleja ilmaiseksi osoitteessa huggingface.co/Qwen – ne ovat Apache 2.0 -lisensoituja ja vapaasti käytettävissä myös kaupallisiin sovelluksiin. Seuraava tilaraportti ilmestyy syksyllä 2026.

Suomalaisille tekoälyosaajille tilanne avaa oven, mutta pakottaa myös valitsemaan. Parhaat avoimet mallit ovat nyt käytettävissä riippumatta siitä, kumpi suurvalta ne kouluttaa. Hugging Facen data viittaa siihen, että arvonluonti siirtyy yhä enemmän perusmallien koulutuksesta sovellustasolle – sovellusten, hienosäätöjen ja erikoistuneiden ratkaisujen rakentamiseen. Siinä kilpailussa pienikin maa voi olla merkittävä toimija, kunhan se ei tyydy pelkän käyttäjän rooliin.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.