Satatuhatta promptia ja yksi tavoite
Tekoälymallin varastaminen ei vaadi murtautumista palvelinkeskukseen. Riittää, että esittää tarpeeksi monta oikeaa kysymystä.
Googlen uhkatiedusteluryhmä GTIG julkaisi helmikuussa raportin, joka paljasti laajamittaisen yrityksen kopioida yhtiön Gemini-tekoälymallin päättelykyky. Hyökkääjät syöttivät mallille yli 100 000 tarkkaan muotoiltua promptia tavoitteenaan pakottaa Gemini paljastamaan sisäiset päättelyketjunsa – erityisesti muilla kuin englannin kielellä.
Yksittäin tarkasteltuna promptit näyttivät tavallisilta kysymyksiltä. Yhdessä ne muodostivat järjestelmällisen kartoituksen siitä, miten Gemini käsittelee tietoa ja rakentaa vastauksensa. Googlen järjestelmät havaitsivat kampanjan reaaliaikaisesti ja estivät päättelyketjujen vuotamisen. Yhtiö sulki hyökkääjien tilit.
Googlen mukaan tekijät olivat pääasiassa yksityisiä yrityksiä ja tutkijoita ympäri maailmaa, jotka hakivat kilpailuetua. Kyse oli siis kaupallisesta vakoilusta, ei valtiollisesta kyberoperaatiosta.
Mitä on malliekstraktio?
Malliekstraktiossa hyökkääjä syöttää tekoälymallille tuhansia kysymyksiä ja analysoi vastauksia järjestelmällisesti. Tavoitteena on rakentaa pienempi malli, joka jäljittelee alkuperäisen toimintaa murto-osalla kehityskustannuksista. Menetelmä tunnetaan myös nimellä tislaus eli distillation. Google kuvaa sitä immateriaalioikeuksien varkaudeksi.
Valtiolliset hakkerit tekoälyn asiakkaina
Sama raportti nosti esiin toisen huolestuttavan ilmiön. Kiinan, Iranin, Pohjois-Korean ja Venäjän valtiolliset hakkerit käyttävät Geminiä aktiivisesti kyberhyökkäystensä tehostamiseen. Tekoäly auttaa heitä hyökkäyksen kaikissa vaiheissa tiedustelusta haittakoodin kirjoittamiseen.
Iranin APT42-ryhmä, joka tunnetaan myös nimillä Charming Kitten ja Mint Sandstorm, on hyödyntänyt Geminiä kohteidensa sähköpostiosoitteiden etsimiseen ja phishing-viestien laatimiseen useilla kielillä. Pohjois-korealaiset hakkerit ovat kartoittaneet puolustusalan ja kyberturvallisuusalan organisaatioita sekä profiloineet niiden avainhenkilöitä. Google kuvailee kohdistusta niin tarkaksi, että raja ammatillisen tiedonhaun ja tiedustelun välillä hämärtyy. Kiinalaisryhmät ovat puolestaan automatisoineet haavoittuvuusanalyysia ja luoneet kohdennettuja testaussuunnitelmia yhdysvaltalaisia organisaatioita vastaan.
Raportin huolestuttavin yksityiskohta on HONESTCUE-niminen haittaohjelma, joka havaittiin loppuvuodesta 2025. Se käyttää Geminin ohjelmointirajapintaa C#-kielisen haittakoodin tuottamiseen ja suorittaa sen automaattisesti kohdetietokoneen muistissa. Käytännössä tekoälymalli kirjoittaa viruksen hyökkääjän puolesta.
Tavalliselle käyttäjälle tämä tarkoittaa yhtä asiaa: huijausviestit paranevat nopeasti. Kun tekoäly auttaa hakkereja kirjoittamaan vakuuttavaa suomea tai ruotsia ilman kielioppivirheitä, kielivirheitä ei voi enää käyttää huijauksen tunnistamiseen.



