Datasuvereniteetti nousee tekoälypuheen keskiöön
Siili Solutions ja helsinkiläinen Verda ilmoittivat käynnistävänsä palvelun, jollaista Suomessa ei ole aiemmin ollut: LLM-as-a-service-ratkaisun, jonka laskenta tapahtuu alusta loppuun kotimaassa. Käytännössä se tarkoittaa suuria kielimalleja, jotka pyörivät suomalaisella laitteistolla suomalaisen sähkön voimin, ilman kytköstä yhdysvaltalaisiin pilvijätteihin.
Verda tunnettiin aiemmin nimellä DataCrunch. Yhtiö tarjoaa NVIDIA:n grafiikkasuorittimiin perustuvaa laskentakapasiteettia, joka sijaitsee Suomessa ja toimii sataprosenttisesti uusiutuvalla energialla. Siili puolestaan tuo mukaan niin sanotun LLM-yhdyskäytävän, jonka kautta organisaatio pääsee käyttämään avoimen lähdekoodin malleja tai omaan käyttöön hienosäädettyjä versioita.
Mitä LLM-as-a-service oikeasti tarkoittaa
Termi kuulostaa tekniseltä, mutta idea on suoraviivainen. Organisaation ei tarvitse ostaa kalliita palvelimia eikä palkata omaa tekoälytiimiä ylläpitämään niitä. Se maksaa vain siitä laskennasta, jonka se todella käyttää, samaan tapaan kuin sähköstä tai pilvitallennuksesta. Kapasiteetti skaalautuu käytön mukaan, eikä valmiiksi varattua rautaa jää seisomaan tyhjänä.
Datasuvereniteetti taas viittaa siihen, että data ja sen käsittely pysyvät suomalaisen lainsäädännön ja hallinnan piirissä. Kun sairaala, pankki tai kunta syöttää arkaluontoista tietoa kielimalliin, tieto ei matkaa Atlantin taakse eikä päädy vieraan valtion oikeudenkäytön ulottuville. Arkkitehtuuri on yhtiöiden mukaan lähtökohtaisesti GDPR:n mukainen.
Miksi kotimainen vaihtoehto kiinnostaa juuri nyt
Kysyntä kotimaiselle ratkaisulle ei synny tyhjästä. EU:n tekoälyasetus on astunut voimaan vaiheittain, ja se asettaa erityisesti julkiselle sektorille ja arkaluontoista dataa käsitteleville toimialoille tiukkoja vaatimuksia siitä, miten tekoälyä saa käyttää ja missä data sijaitsee.
Samalla luottamus yhdysvaltalaisiin pilvipalveluihin on rakoillut. Yhdysvaltain lainsäädäntö, kuten CLOUD Act, antaa viranomaisille pääsyn amerikkalaisyhtiöiden hallussa olevaan dataan riippumatta siitä, missä palvelin fyysisesti sijaitsee. Julkishallinnossa ja terveydenhuollossa tämä on konkreettinen riski, ei teoreettinen huoli.
“Asiakkaamme kysyvät yhä useammin turvallista, paikallista tekoälykapasiteettia, joka ei vaaranna hallintaa eikä altista arkaluontoista dataa ulkomaiselle lainkäytölle.”
Kilpailu jättejä vastaan on kova
Analyyttisesti katsottuna Siilin ja Verdan haaste on ilmeinen. Palvelu nojaa avoimen lähdekoodin malleihin, jotka eivät useimmissa vertailuissa yllä OpenAI:n, Googlen tai Anthropicin huippumallien tasolle. Yhdysvaltalaiset ja kiinalaiset toimijat investoivat mallien kehitykseen summia, joihin yksikään suomalainen yhtiö ei pysty vastaamaan.
Verdan myyntijohtaja Anssi Harjunpää myöntää tämän suoraan: kaikki käyttötapaukset eivät vaadi uusinta huippumallia. Moni tiimi haluaa vain testata konseptin mahdollisimman edullisesti tai tarvitsee täyden näkyvyyden siihen, minne data liikkuu. Juuri tähän rakoon palvelu on suunnattu, ei kilpailemaan yleiskäyttöisten chatbottien kanssa.
Hinnoittelun yksityiskohtia ei ole vielä julkistettu, mikä tekee kustannustehokkuuden arvioinnista vaikeaa. Yhtiöt lupaavat ennustettavaa hinnoittelua ja pientä alkuinvestointia, mutta todellinen kilpailukyky isojen pilvitoimijoiden hintoja vastaan selviää vasta käytännössä. Myös suorituskyvystä on toistaiseksi vain lupauksia.



