Tutkimus

Tekoälyagentteja ei testata – tai siitä ei ainakaan kerrota

30 agentista vain neljä julkaisee turvallisuusarvion

Hanna HuulivuoHanna Huulivuo
Jaa:
Tekoälyagentteja ei testata – tai siitä ei ainakaan kerrota

Autonomia kasvaa, avoimuus ei

Yhdeksän yliopiston tutkijaryhmä kävi läpi 30 tunnetuinta tekoälyagenttia ja havaitsi merkittävän ristiriidan: agentit saavat yhä enemmän itsenäistä toimivaltaa, mutta niiden turvallisuudesta kerrotaan yhä vähemmän. Helmikuussa julkaistu AI Agent Index on ensimmäinen laaja kartoitus tekoälyagenttien turvallisuuskäytännöistä.

Tutkijat Cambridgen, MIT:n, Stanfordin, Harvardin ja Washingtonin yliopistoista arvioivat kunkin agentin 45 muuttujan perusteella kuudessa kategoriassa: tuotekuvaus, vastuullisuus, tekniset kyvyt, autonomia, ekosysteemivuorovaikutus ja turvallisuus. Seitsemän asiantuntijaa kävi jokaisen agentin läpi, ja havainnot tarkistettiin ristiin sekä kehittäjien kanssa käydyn kirjeenvaihdon avulla. 23 prosenttia yrityksistä vastasi tutkijoiden yhteydenottoihin.

30 agentista vain neljä – OpenAI:n ChatGPT Agent ja Codex, Anthropicin Claude Code sekä Googlen Gemini 2.5 Computer Use – on julkaissut varsinaisen turvallisuusarvion eli järjestelmäkortin. 25 agenttia ei kerro sisäisten turvallisuustestien tuloksista lainkaan ja 23:lta puuttuu kolmannen osapuolen riippumaton arvio.

“Kehittäjät julkaisevat laajoja ylätason turvallisuuskehyksiä, jotka kuulostavat rauhoittavilta, mutta tarjoavat rajallisesti empiiristä näyttöä riskien todelliseen ymmärtämiseen. Tämä läpinäkyvyyden epäsymmetria viittaa eräänlaiseen turvallisuuspesuun.”

— Leon Staufer, Cambridgen yliopiston tutkija, AI Agent Indexin pääkoordinaattori

Selainagentit huolestuttavat eniten

Tutkituista agenteista 13 toimii niin sanotulla huipputason autonomialla ja tekee itsenäisiä päätöksiä reaalimaailmassa. Silti vain neljä näistä julkaisee turvallisuusdataa. Erityisen ongelmallinen tilanne on selainagenteilla: ne operoivat korkeimmilla autonomiatasoilla 4–5, mutta niiden turvallisuustiedoista puuttuu 64 prosenttia.

Konkreettinen esimerkki on Perplexityn Comet-selainagentti, joka on jo joutunut oikeudellisen tarkastelun kohteeksi, koska se ei kerro käyttämilleen verkkopalveluille olevansa tekoäly. Kuusi tutkituista agenteista käyttää ihmisen toimintaa jäljittelevää koodia ohittaakseen verkkosivujen bottien eston.

Viidestä kiinalaisesta agentista vain yksi julkaisee turvallisuuskehyksen. Lähes kaikki tutkitut agentit nojaavat kolmeen perusmalliin – GPT:hen, Claudeen tai Geminiin – mikä luo järjestelmätason keskittymisriskin. Jos yhdessä näistä malleista löytyy haavoittuvuus, vaikutukset ulottuvat kymmeniin agentteihin samanaikaisesti.

Tutki itse

AI Agent Index on vapaasti selattavissa osoitteessa aiagentindex.mit.edu. Sivustolla voi vertailla kaikkien 30 agentin turvallisuustietoja, autonomiatasoja ja teknisiä ominaisuuksia.

30

Tutkittua tekoälyagenttia

13

Toimii huipputason autonomialla

64 %↓

Selainagenteista ilman turvatietoja

23 %↓

Yrityksistä vastasi kyselyyn

AI Agent Index, 2026

Sanasto

Tekoälyagentti
Tekoälyohjelma, joka toimii itsenäisesti käyttäjän puolesta: se voi selata verkkoa, tehdä ostoksia tai käsitellä sähköposteja ilman jatkuvaa ohjausta.
Järjestelmäkortti
Kehittäjän julkaisema dokumentti, jossa kuvataan tekoälyjärjestelmän toiminta, rajoitukset ja turvallisuustestien tulokset. Vastaa lääkkeen pakkausselostetta.
Perusmalli
Laaja tekoälymalli, jonka päälle muut sovellukset rakennetaan. GPT, Claude ja Gemini ovat perusmalleja, joita kymmenet eri agentit käyttävät pohjallaan.

Käyttäjälle ei jää kuin luottamus

Tekoälyagentit eivät ole enää chatbotteja. Ne varaavat lentoja, tekevät ostoksia ja käsittelevät sähköposteja käyttäjän puolesta. Kun agentti toimii itsenäisesti verkossa eikä sen turvallisuustestauksesta ole julkista näyttöä, käyttäjän on luotettava pelkkään kehittäjän sanaan.

EU:n tekoälysäädös asettaa vaatimuksia järjestelmien läpinäkyvyydelle, mutta nykymuodossaan se ei kata agenttien erityispiirteitä riittävästi. Suomalaisille yrityksille, jotka ottavat tekoälyagentteja käyttöön päivittäisessä työssään, tutkimus on selkeä viesti: kehittäjiltä kannattaa vaatia turvallisuusdokumentaatiota ennen käyttöönottoa.

Tutkijaryhmä kehottaa kaikkia kehittäjiä julkaisemaan agenttikohtaiset järjestelmäkortit ja avaamaan turvallisuustestauksensa tulokset riippumattomalle arvioinnille. AI Agent Indexiä on tarkoitus päivittää säännöllisesti, mikä tarjoaa kehittäjille paineen kohentaa käytäntöjään – ja käyttäjille työkalun arvioida, keneen luottaa.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 4Datakeskukset Suomessa – hankkeet, sähkö ja vero
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.