Clem Delangue puhui heinäkuussa TechCrunchin Equity-podcastissa vastuusta. Reilu kuukausi myöhemmin hänen yhtiönsä on Business Insiderin tietojen mukaan pyytänyt pankeilta apua sen arvioimiseen, mitä ostotarjouksista pitäisi ajatella. Puheena olevat luvut asettaisivat Hugging Facen arvoksi yli 13 miljardia dollaria.
Kauppaa ei ole tehty. Ostajaehdokasta ei tiedetä. TechCrunch kertoi asiasta maanantaina Business Insiderin raportin pohjalta, eikä yhtiö ole kommentoinut tietoja julkisuudessa.
“Rakennamme alustaa yhteisölle, ja he luottavat meihin jakaessaan datansa ja mallinsa alustalla, joten meillä on heitä kohtaan pitkäaikainen vastuu.”
Mikä Hugging Face oikeastaan on
Jos GitHub on paikka, josta ohjelmoijat lataavat toistensa koodia, Hugging Face on sama asia tekoälymalleille. Kuka tahansa voi julkaista sinne kouluttamansa mallin, ja kuka tahansa voi ladata sen itselleen ilmaiseksi. Yhtiön omien lukujen mukaan alustalla on yli kaksi miljoonaa mallia, yli 500 000 datajoukkoa ja yli miljoona pientä sovellusta. Yli 50 000 organisaatiota käyttää palvelua.
Se on avointen mallien jakelukanava, ja käytännössä ainoa merkittävä sellainen. Kun Meta julkaisee Llaman tai Alibaba Qwenin, malli ilmestyy Hugging Faceen. Kun turkulainen tutkimusryhmä julkaisee suomenkielisen mallin, se ilmestyy sinne myös.
Hinnasta kertoo se, että infrastruktuuri on tullut muotiin. Hugging Face keräsi rahaa viimeksi vuonna 2023, jolloin Salesforce Venturesin johtama kierros arvotti yhtiön 4,5 miljardiin dollariin. Mukana olivat myös Alphabet, GV ja IBM Ventures. Jos 13 miljardin luku pitää paikkansa, arvostus olisi lähes kolminkertaistunut kolmessa vuodessa.
Yhtiö on myös kieltäytynyt rahasta. Delangue kertoi torjuneensa aiemmin tänä vuonna Nvidian 500 miljoonan dollarin sijoituksen, joka olisi arvottanut Hugging Facen seitsemään miljardiin. Podcastissa hän sanoi yhtiön olevan lähellä kannattavuutta ja koskeneensa vasta hiljattain kolme vuotta sitten kerättyihin rahoihin.
Neutraali alusta on arvokas vain niin kauan kuin se on neutraali
Hintalappu ei ole tämän uutisen kiinnostavin osa. Kiinnostavin on se, kuka maksaisi. Hugging Face on toiminut alan puolueettomana välittäjänä: sinne lataavat mallinsa keskenään kilpailevat yhtiöt, yliopistot ja yksittäiset harrastajat, eikä alustalla ole ollut omaa hevosta kisassa.
Jos ostaja olisi jokin suurista malliyhtiöistä, asetelma muuttuisi. Silloin yhden toimijan omistama alusta jakelisi sen kilpailijoiden tuotteita. Mikään ei pakota uutta omistajaa toimimaan huonosti. Mutta hakutulosten järjestys, latausrajat, hinnoittelu ja se, mitkä mallit nostetaan etusivulle, ovat kaikki päätöksiä, jotka joku tekee jostakin syystä.
Pilvipalveluyhtiö tai sirunvalmistaja olisi ostajana eri asia kuin malliyhtiö, mutta jokaisella mahdollisella ostajalla on jokin intressi. Sitä ei ollut alustalla tähän asti, ja se on ollut koko avoimen ekosysteemin hiljainen perusoletus.
Suomenkieliset mallit ovat samalla alustalla
Suomalainen tekoälytutkimus on kiinni Hugging Facessa syvemmällä kuin ehkä huomataan. Turun yliopiston TurkuNLP-ryhmällä on alustalla 91 mallia ja 29 datajoukkoa, muun muassa suomenkieliset ModernBERT-mallit. LumiOpen-organisaation kautta jaetaan Poro 2 -mallit, jotka AMD:n Silo AI, TurkuNLP ja HPLT-hanke kouluttivat LUMI-supertietokoneella CSC:n laskentaresursseilla.
Mallit on siis koulutettu suomalaisella julkisella rahalla suomalaisella supertietokoneella, ja niiden jakelu tapahtuu yhden yhdysvaltalaisen yksityisyhtiön palvelimilla. Suomalainen yritys, joka hakee suomenkielisen kielimallin tuotteeseensa, hakee sen sieltä. Kunta, joka pilotoi puheentunnistusta, hakee sen sieltä. Toistaiseksi se on ilmaista ja vaivatonta, ja juuri siksi vaihtoehtoja ei ole rakennettu.
Tavallinen ihminen ei käy Hugging Facessa koskaan. Hän käyttää silti sen kautta jaeltuja malleja: roskapostisuodattimessa, verkkokaupan kuvahaussa, sanelun purkuohjelmassa. Ne on jossain vaiheessa ladattu sieltä ja pantu tuotteen sisään. Jos jakelukanavan ehdot muuttuvat, muutos näkyy lopulta hintoina ja siinä, mitä tuotteita ylipäätään kannattaa tehdä pienelle kielialueelle.
Näin juttu on tehty
Uutinen perustuu Business Insiderin tietoihin, jotka TechCrunch kertoi 24.8.2026. Kaupasta ei ole sopimusta eikä ostajaehdokkaita ole nimetty. Hugging Face ei ole kommentoinut tietoja; jutun sitaatti on heinäkuulta TechCrunchin Equity-podcastista, eli se on annettu ennen näitä tietoja eikä koske niitä.
Etsin riippumatonta arviota sekä 13 miljardin arvostuksen realistisuudesta että omistajanvaihdoksen vaikutuksista avoimeen ekosysteemiin. Julkaisuhetkellä sellaista ei ollut saatavilla: uutinen oli tuntien vanha, eikä tutkijoiden tai avoimen lähdekoodin yhteisön kommentteja ollut vielä julkisuudessa. Kaikki jutussa esitetyt arviot seurauksista ovat siis toimituksen omia. Suomalaisten tutkimusryhmien mallijulkaisut on tarkistettu suoraan Hugging Facen sivuilta.
Sanasto
Datajoukko (dataset)
Valmiiksi koottu ja järjestetty aineisto, jolla tekoälymalli opetetaan tai jolla sen toimintaa mitataan. Esimerkiksi kokoelma suomenkielisiä tekstejä tai puhenäytteitä.
Mallien peilaaminen
Samojen mallien ja aineistojen kopioiminen toisille palvelimille niin, että ne pysyvät ladattavissa vaikka alkuperäinen palvelu muuttuisi tai lakkaisi toimimasta.
Delangue on torjunut rahaa ennenkin, ja Nvidian tarjouksesta kieltäytyminen oli siitä selvä merkki. Mutta 13 miljardia on eri kokoluokka kuin 500 miljoonaa, ja sijoittajat, jotka tulivat mukaan 4,5 miljardin arvostuksella, eivät ole mukana yhteisön takia.
Järkevin reaktio ei ole odottaa, kuka voittaa huutokaupan. Se on rakentaa varasuunnitelma nyt. Mallien ja datajoukkojen peilaaminen eurooppalaisille palvelimille ei ole tekninen ongelma, ja esimerkiksi CSC:llä olisi siihen kapasiteetti. Se on työtä, jota kukaan ei ole viitsinyt tehdä niin kauan kuin ilmainen amerikkalainen vaihtoehto on toiminut moitteetta.
Viikoittainen uutiskirje
Tule firmasi fiksuimmaksi AI-osaajaksi
Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.