Tutkimus

Gemini paljasti yksityishenkilön numeron asiakaspalveluna

ChatGPT kaivoi toimittajan numeron FOIA-asiakirjasta – Claude ja Grok torjuivat.

Aino AikajärviAino Aikajärvi
Jaa:
Gemini paljasti yksityishenkilön numeron asiakaspalveluna

Israelilainen ohjelmistokehittäjä Daniel Abraham alkoi keväällä saada omituisia WhatsApp-viestejä. Tuntemattomat kysyivät häneltä apua PayBox-maksusovelluksen ongelmiin. Syy paljastui pian: Google Gemini oli alkanut antaa Abrahamin yksityistä puhelinnumeroa, kun käyttäjät kysyivät PayBoxin asiakaspalvelunumeroa. Numero oli päätynyt verkkoon kerran vuonna 2015, kun joku oli julkaissut sen paikallisella kysymys-vastaus-sivustolla.

Tapauksen nosti otsikoihin MIT Technology Review'n keskiviikkona julkaisema tutkinta. Toimittajat testasivat Geminiä itse ja saivat botin antamaan useita virheellisiä numeroita PayBoxin asiakaspalveluksi. Yksi niistä kuului Reddit-käyttäjälle, joka on saanut samanlaisia häirintäsoittoja kuukausia. Soittajat ovat etsineet asianajajaa, tuotemuotoilijaa ja lukkoseppää.

Kaksi reittiä, joilla numero vuotaa botista

Vuoto tapahtuu kahdella tavalla. Ensimmäinen on muistiin painuminen: suuret kielimallit toistavat sanasta sanaan harjoitusdatastaan löytyviä tekstipätkiä. Jos numero on koskaan ollut avoimessa verkossa, malli voi palauttaa sen tilastollisen sattuman kautta. Toinen reitti on hakuavusteinen vastaus, jossa botti yhdistää reaaliaikaisia nettihakuja. Tällöin syvälle Google-hakutuloksiin haudattu tieto nousee yhden kysymyksen päähän.

Gizmodon toimittaja Matt Novak koki vuodon ihollaan jo aiemmin. ChatGPT antoi hänelle hänen omaa numeroaan kysyttäessä vanhan numeron, jota Novak ei ole käyttänyt vuosiin. Numero oli päätynyt tekstipohjaiseen PDF-asiakirjaan, jonka Novak oli saanut Yhdysvaltain kuluttajavirastolta FTC:ltä vuonna 2016 tehdyllä tietopyynnöllä. Kun Novak pyysi vielä toista numeroa toiselle samannimiselle henkilölle, ChatGPT löysi senkin – tuntemattoman kalifornialaisen yksityisnumeron.

Grok, Claude ja Perplexity torjuivat pyynnöt

MIT:n testissä kolme muuta chatbottia toimivat toisin. Anthropicin Claude, Perplexity ja Elon Muskin xAI:n Grok eivät antaneet yksityishenkilöiden numeroita vastaaviin kysymyksiin. Ero ei kerro pelkästään suodattimien laadusta vaan myös eri yhtiöiden periaatevalinnoista: kuinka pitkälle botti saa mennä, kun käyttäjä esittää pyyntönsä asialliseen sävyyn. ChatGPT esimerkiksi ohjasi Washingtonin yliopiston tutkijoita "tutkintatyylisellä" kysymystavalla suodattimiensa ohi, jolloin se palautti professorin kotiosoitteen, kauppahinnan ja puolison nimen.

Tietosuojavaltuutettu sai uudet valtuudet tammikuussa

Suomessa vastaava tapaus päätyisi Tietosuojavaltuutetun pöydälle. EU:n yleinen tietosuoja-asetus GDPR määrittelee puhelinnumeron henkilötiedoksi, ja sen käsittelyyn pitää olla peruste. Kun chatbot palauttaa yksityishenkilön numeron asiakaspalvelunumerona, käsittelijällä – tässä tapauksessa OpenAI:lla tai Googlella – on lähtökohtaisesti velvollisuus poistaa tieto pyynnöstä. Tietosuojavaltuutetun toimisto sai 1.1.2026 voimaan tulleen EU:n tekoälyasetuksen myötä uudet valvontavaltuudet, jotka koskevat juuri tällaisia tapauksia.

Käytännössä poisto-oikeuden toteuttaminen on hankalaa. Stanfordin tutkija Jennifer King totesi MIT:lle, ettei Googlella välttämättä ole edes infrastruktuuria vahvistaa, sisältyykö tietty puhelinnumero sen koulutusaineistoon. Suomesta ei toistaiseksi ole raportoitu vastaavia tapauksia julkisesti, mutta yhdysvaltalaisen DeleteMe-palvelun tilastoissa generatiiviseen tekoälyyn liittyvät yksityisyyspyynnöt ovat kasvaneet 400 prosenttia seitsemässä kuukaudessa. Pyynnöistä 55 prosenttia koskee ChatGPT:tä ja 20 prosenttia Geminiä.

Yhden googlauksen päässä

Käytännön riski koskee jokaista, jonka puhelinnumero on joskus päätynyt verkkoon: vanha harrastusilmoitus, työhakemus, urheiluseuran jäsenlista tai kunnan päätösasiakirja. GDPR:n poisto-oikeus pätee Suomessa, ja Tietosuojavaltuutetun toimistolle voi tehdä kantelun, jos OpenAI tai Google ei vastaa pyyntöön kohtuullisessa ajassa. Abrahamin tapauksessa Googlen vastausaika oli seitsemän viikkoa.

Tapaus alleviivaa toisen puolen tekoälyn yksityisyysongelmasta. Ennen Geminiä Abrahamin numero oli kyllä netissä, mutta haudattuna kymmenen vuoden takaiseen viestiketjuun. Chatbot ei vuotanut uutta tietoa, se teki vanhasta hautauksesta lopullisesti turhan. Tätä mekanismia MIT:n haastattelema tutkija Meira Gilbert kutsuu kynnyksen madaltamiseksi: tieto oli aina saavutettavissa, mutta nyt sitä ei tarvitse enää etsiä.

Sanasto

Muistiin painuminen
Ilmiö, jossa kielimalli toistaa sanasta sanaan koulutusaineistossaan ollutta tekstiä. Tämän vuoksi vuosien takainen puhelinnumero voi yllättäen vuotaa chatbotin vastauksesta.
Hakuavusteinen vastaus
Tekniikka, jossa chatbot tekee taustalla nettihaun ja yhdistää tulokset omaan vastaukseensa. Tällöin syvälle Google-tuloksiin haudattu yksityinen tieto voi nousta yhden kysymyksen päähän.
+400 %↑

Generatiiviseen AI:hin liittyvät yksityisyyspyynnöt 7 kk:ssa

55 %

Pyynnöistä koskee ChatGPT:tä

20 %

Pyynnöistä koskee Geminiä

7 vk↓

Googlen vastausaika Abrahamin tapauksessa

MIT Technology Review ja DeleteMe, 13.5.2026

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 320 vuotta koodaamatta, sitten 5,4 miljoonaa
  4. 4Datakeskus söisi Lapinlahdella kokonaisen kaupungin sähköt
  5. 5Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.