Sveitsiläisen ETH Zürichin ja Anthropicin tutkijat antoivat tekoälyagentille yksinkertaisen tehtävän. Tässä ovat viestit, jotka joku on kirjoittanut nimimerkillä Hacker News -keskustelupalstalle. Selvitä, kuka hän on. Agentti sai käyttää internetiä.
Agentti nimesi oikein 226 kohdetta 338:sta eli 67 prosenttia. Sen antamista vastauksista noin 90 prosenttia osui oikeaan. Väärin se arvasi 25 kertaa, ja 86 tapauksessa se jätti vastaamatta. Kohdetta kohden ajo maksoi tutkijoille 1–4 dollaria. Työhön, joka veisi ihmistutkijalta tunteja, agentti tarvitsi minuutteja.
Tutkimus Large-scale online deanonymization with LLMs julkaistiin arXivissa helmikuussa 2026, ja se esiteltiin elokuussa Baltimoressa pidetyssä USENIX Security -konferenssissa. Tekijöinä ovat Simon Lermen MATS-tutkimusohjelmasta, Daniel Paleka, Joshua Swanson, Michael Aerni ja Florian Tramèr ETH Zürichistä sekä Nicholas Carlini Anthropicista.
Pienet yksityiskohdat kasautuvat
Ilmiön ydin on arkinen. Kirjoittaja mainitsee ohimennen kaupunginosansa, alansa, lapsen harrastuksen tai koiransa rodun. Mikään näistä ei yksinään paljasta mitään. Yhdessä ne kuitenkin rajaavat joukkoa, ja kielimalli osaa poimia tällaiset murut tuhansien viestien seasta ja etsiä verkosta ihmisen, johon ne kaikki sopivat.
AI Suomi ei kuvaa menetelmää tätä tarkemmin. Tutkijat itsekin jättivät koodinsa ja aineistonsa julkaisematta. Artikkelin mukaan valmiin työkalun julkaiseminen tekisi turhan helpoksi kohdistaa sama hyökkäys oikeasti nimettömiin profiileihin.
Tulokset vaihtelevat aineiston mukaan. Toisessa koeasetelmassa verrattiin Redditin elokuvakeskustelijoita, jotka puhuivat lähinnä elokuvista, ja siellä tunnistusosuus jäi 8,5 prosenttiin samalla 90 prosentin tarkkuudella. Kun joku kirjoittaa omasta elämästään, hänet on helpompi löytää kuin se, joka puhuu vain yhdestä aiheesta. Tutkijat kokeilivat myös Anthropicin haastatteluaineistoa, jossa tiedeihmiset kertoivat nimettöminä tekoälyn käytöstään. Agentti tunnisti heistä 9 henkilöä 33:sta.
“Tuloksemme osoittavat, että käytännön hämäryys, joka on suojannut nimimerkillä kirjoittavia verkon käyttäjiä, ei enää päde ja että verkon yksityisyyden uhkamallit on arvioitava uudelleen.”
Mitä tämä tarkoittaa suomalaiselle nimimerkille
Tutkimus tehtiin englanninkielisillä palveluilla, mutta sama logiikka koskee jokaista palstaa, jolla sama nimimerkki kerää vuosien historian. Suomi24:n pitkäaikainen kirjoittaja, joka on eri ketjuissa kertonut työpaikastaan, paikkakunnastaan ja perheestään, on jättänyt jälkeensä juuri sellaista aineistoa, jota agentti käytti.
Suomenkielisellä aineistolla menetelmää ei ole testattu. Ei siis tiedetä, suojaako pieni kielialue vai helpottaako se tunnistamista. Pieni kieliyhteisö tarkoittaa ainakin pienempää joukkoa, josta etsitään.
Palvelut eroavat toisistaan. Jodelissa viestit eivät kasaannu julkiseksi nimimerkkiprofiiliksi, ja Vauva.fi:ssä voi kirjoittaa myös kirjautumatta. Tutkimus tarkasteli nimenomaan profiileja, joihin viestejä kertyy. Irrallinen viesti antaa vähemmän tarttumapintaa, mutta yhdessä viestissä kerrottu tarkka yksityiskohta voi silti riittää.
Riski ei ole se, että joku tunnistaisi kaikki. Vaarallisinta on kohdistettu uteliaisuus. Kyse voi olla häiritsijästä, joka haluaa tietää kuka kirjoitti kriittisen viestin, työnantajasta, joka etsii nimettömän arvostelijan, tai entisestä puolisosta. Aiemmin tällainen selvitys vaati aikaa ja taitoa. Muutaman dollarin hinta tuo sen kenen tahansa ulottuville, ja se koskee myös väärinkäytöksistä nimettömänä kertovia ja lähteitään suojaavia toimittajia.
“Pysyvällä käyttäjänimellä kirjoittavien käyttäjien pitäisi olettaa, että vastapuoli voi yhdistää heidän tilinsä oikeisiin henkilöllisyyksiin tai toisiinsa ja että todennäköisyys kasvaa jokaisen julkaistun pienen tiedonmurun myötä.”



