Tekoäly

Geminiä yritettiin kloonata yli 100 000 promptilla

Google paljasti yrityksen kopioida mallinsa päättelykykyä

Nelli NelisanomaNelli Nelisanoma
Jaa:
Geminiä yritettiin kloonata yli 100 000 promptilla

Satatuhatta promptia ja yksi tavoite

Tekoälymallin varastaminen ei vaadi murtautumista palvelinkeskukseen. Riittää, että esittää tarpeeksi monta oikeaa kysymystä.

Googlen uhkatiedusteluryhmä GTIG julkaisi helmikuussa raportin, joka paljasti laajamittaisen yrityksen kopioida yhtiön Gemini-tekoälymallin päättelykyky. Hyökkääjät syöttivät mallille yli 100 000 tarkkaan muotoiltua promptia tavoitteenaan pakottaa Gemini paljastamaan sisäiset päättelyketjunsa – erityisesti muilla kuin englannin kielellä.

Yksittäin tarkasteltuna promptit näyttivät tavallisilta kysymyksiltä. Yhdessä ne muodostivat järjestelmällisen kartoituksen siitä, miten Gemini käsittelee tietoa ja rakentaa vastauksensa. Googlen järjestelmät havaitsivat kampanjan reaaliaikaisesti ja estivät päättelyketjujen vuotamisen. Yhtiö sulki hyökkääjien tilit.

Googlen mukaan tekijät olivat pääasiassa yksityisiä yrityksiä ja tutkijoita ympäri maailmaa, jotka hakivat kilpailuetua. Kyse oli siis kaupallisesta vakoilusta, ei valtiollisesta kyberoperaatiosta.

Mitä on malliekstraktio?

Malliekstraktiossa hyökkääjä syöttää tekoälymallille tuhansia kysymyksiä ja analysoi vastauksia järjestelmällisesti. Tavoitteena on rakentaa pienempi malli, joka jäljittelee alkuperäisen toimintaa murto-osalla kehityskustannuksista. Menetelmä tunnetaan myös nimellä tislaus eli distillation. Google kuvaa sitä immateriaalioikeuksien varkaudeksi.

Valtiolliset hakkerit tekoälyn asiakkaina

Sama raportti nosti esiin toisen huolestuttavan ilmiön. Kiinan, Iranin, Pohjois-Korean ja Venäjän valtiolliset hakkerit käyttävät Geminiä aktiivisesti kyberhyökkäystensä tehostamiseen. Tekoäly auttaa heitä hyökkäyksen kaikissa vaiheissa tiedustelusta haittakoodin kirjoittamiseen.

Iranin APT42-ryhmä, joka tunnetaan myös nimillä Charming Kitten ja Mint Sandstorm, on hyödyntänyt Geminiä kohteidensa sähköpostiosoitteiden etsimiseen ja phishing-viestien laatimiseen useilla kielillä. Pohjois-korealaiset hakkerit ovat kartoittaneet puolustusalan ja kyberturvallisuusalan organisaatioita sekä profiloineet niiden avainhenkilöitä. Google kuvailee kohdistusta niin tarkaksi, että raja ammatillisen tiedonhaun ja tiedustelun välillä hämärtyy. Kiinalaisryhmät ovat puolestaan automatisoineet haavoittuvuusanalyysia ja luoneet kohdennettuja testaussuunnitelmia yhdysvaltalaisia organisaatioita vastaan.

Raportin huolestuttavin yksityiskohta on HONESTCUE-niminen haittaohjelma, joka havaittiin loppuvuodesta 2025. Se käyttää Geminin ohjelmointirajapintaa C#-kielisen haittakoodin tuottamiseen ja suorittaa sen automaattisesti kohdetietokoneen muistissa. Käytännössä tekoälymalli kirjoittaa viruksen hyökkääjän puolesta.

Tavalliselle käyttäjälle tämä tarkoittaa yhtä asiaa: huijausviestit paranevat nopeasti. Kun tekoäly auttaa hakkereja kirjoittamaan vakuuttavaa suomea tai ruotsia ilman kielioppivirheitä, kielivirheitä ei voi enää käyttää huijauksen tunnistamiseen.

“Tulemme olemaan kaivoskanarialintuja paljon laajemmille hyökkäyksille.”

— John Hultquist, Googlen uhkatiedusteluryhmän johtava analyytikko

Sanasto

Prompti
Tekoälymallille annettava kysymys tai ohje, johon malli tuottaa vastauksen. Malliekstraktiossa hyökkääjä syöttää tuhansia prompteja kerätäkseen tietoa mallin toiminnasta.
Ohjelmointirajapinta (API)
Tekninen liitäntä, jonka kautta ohjelmat voivat käyttää tekoälymallia automaattisesti ilman ihmisen osallistumista. Esimerkiksi HONESTCUE-haittaohjelma tilasi Geminin rajapinnasta haittakoodia.
APT-ryhmä
Valtion tukema hakkeriryhmä, joka tekee pitkäkestoisia ja kohdennettuja kyberhyökkäyksiä. Lyhenne tulee sanoista Advanced Persistent Threat eli kehittynyt ja jatkuva uhka.

Tekoäly geopoliittisena valttina

Googlen raportti osuu aikaan, jolloin tekoälymallien suojaaminen on noussut geopoliittiseksi kysymykseksi. OpenAI syytti samalla viikolla kiinalaista DeepSeekiä siitä, että sen työntekijät olisivat kehittäneet menetelmiä ChatGPT:n kykyjen kopioimiseen rajapinnan kautta. Kaksi maailman suurinta tekoäly-yhtiötä varoitti siis käytännössä samaan aikaan kilpailijoiden tislausyrityksistä.

Yhtälö on suoraviivainen. Kehittyneen tekoälymallin kouluttaminen vaatii miljardien eurojen investointeja laskentakapasiteettiin ja dataan. Jos kilpailija onnistuu kopioimaan mallin kyvyt pelkillä API-kyselyillä, koko investointi menettää merkitystään. Siksi Google ja OpenAI rinnastavat malliekstraktion perinteiseen teollisuusvakoiluun.

DeepSeekin kaltaiset avoimien painojen mallit muuttavat kuitenkin dynamiikkaa. Ne tarjoavat edistyneen päättelykyvyn vapaasti ladattavana, jolloin suljetun mallin varastaminen ei ole enää ainoa tie kehittyneeseen tekoälyyn. Uhka ei katoa, mutta kilpailun painopiste siirtyy: ratkaisevaa ei ole pelkkä malli vaan data, infrastruktuuri ja ekosysteemi sen ympärillä.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 4Datakeskukset Suomessa – hankkeet, sähkö ja vero
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.