Autonomia kasvaa, avoimuus ei
Yhdeksän yliopiston tutkijaryhmä kävi läpi 30 tunnetuinta tekoälyagenttia ja havaitsi merkittävän ristiriidan: agentit saavat yhä enemmän itsenäistä toimivaltaa, mutta niiden turvallisuudesta kerrotaan yhä vähemmän. Helmikuussa julkaistu AI Agent Index on ensimmäinen laaja kartoitus tekoälyagenttien turvallisuuskäytännöistä.
Tutkijat Cambridgen, MIT:n, Stanfordin, Harvardin ja Washingtonin yliopistoista arvioivat kunkin agentin 45 muuttujan perusteella kuudessa kategoriassa: tuotekuvaus, vastuullisuus, tekniset kyvyt, autonomia, ekosysteemivuorovaikutus ja turvallisuus. Seitsemän asiantuntijaa kävi jokaisen agentin läpi, ja havainnot tarkistettiin ristiin sekä kehittäjien kanssa käydyn kirjeenvaihdon avulla. 23 prosenttia yrityksistä vastasi tutkijoiden yhteydenottoihin.
30 agentista vain neljä – OpenAI:n ChatGPT Agent ja Codex, Anthropicin Claude Code sekä Googlen Gemini 2.5 Computer Use – on julkaissut varsinaisen turvallisuusarvion eli järjestelmäkortin. 25 agenttia ei kerro sisäisten turvallisuustestien tuloksista lainkaan ja 23:lta puuttuu kolmannen osapuolen riippumaton arvio.
“Kehittäjät julkaisevat laajoja ylätason turvallisuuskehyksiä, jotka kuulostavat rauhoittavilta, mutta tarjoavat rajallisesti empiiristä näyttöä riskien todelliseen ymmärtämiseen. Tämä läpinäkyvyyden epäsymmetria viittaa eräänlaiseen turvallisuuspesuun.”
Selainagentit huolestuttavat eniten
Tutkituista agenteista 13 toimii niin sanotulla huipputason autonomialla ja tekee itsenäisiä päätöksiä reaalimaailmassa. Silti vain neljä näistä julkaisee turvallisuusdataa. Erityisen ongelmallinen tilanne on selainagenteilla: ne operoivat korkeimmilla autonomiatasoilla 4–5, mutta niiden turvallisuustiedoista puuttuu 64 prosenttia.
Konkreettinen esimerkki on Perplexityn Comet-selainagentti, joka on jo joutunut oikeudellisen tarkastelun kohteeksi, koska se ei kerro käyttämilleen verkkopalveluille olevansa tekoäly. Kuusi tutkituista agenteista käyttää ihmisen toimintaa jäljittelevää koodia ohittaakseen verkkosivujen bottien eston.
Viidestä kiinalaisesta agentista vain yksi julkaisee turvallisuuskehyksen. Lähes kaikki tutkitut agentit nojaavat kolmeen perusmalliin – GPT:hen, Claudeen tai Geminiin – mikä luo järjestelmätason keskittymisriskin. Jos yhdessä näistä malleista löytyy haavoittuvuus, vaikutukset ulottuvat kymmeniin agentteihin samanaikaisesti.
Tutki itse
AI Agent Index on vapaasti selattavissa osoitteessa aiagentindex.mit.edu. Sivustolla voi vertailla kaikkien 30 agentin turvallisuustietoja, autonomiatasoja ja teknisiä ominaisuuksia.



