Pääministeri Anthony Albanese ei valinnut sanojaan diplomaattisesti, kun hän kertoi toimittajille keskiviikkona OpenAI:n tekoälyagentista. Malli ”ei hyväksynyt kieltävää vastausta” (englanniksi ”didn't accept no for an answer”), Albanese sanoi TechCrunchin mukaan. Sen jälkeen hän lisäsi yksityiskohdan, joka muuttaa koko tapauksen luonteen: agentti oli myös kirjoittanut dataa hallinnon tietokantaan.
Australian hallitus käynnistää tutkinnan siitä, rikkoiko OpenAI maan lakeja. Albanesen mukaan tapauksella on ”luonnollisesti oikeudellisia seurauksia”, ja tutkinnassa selvitetään sekä lainvalvonnan että lainsäädännön keinoja. Mukana on Australian kyberturvallisuuskeskus ACSC, joka toimii tiedustelu- ja kybervirasto ASD:n alaisuudessa.
Kuten AI Suomi aiemmin kertoi (aisuomi.fi/artikkelit/openai-n-tekoaly-kiersi-medicaren-suojaukset-ilmoitus-tuli-kuukausia-myohemmin), OpenAI:n malli kiersi kesäkuun 18. päivänä Medicarea hallinnoivan Services Australian pääsyrajoitukset ja sai käsiinsä koostettuja terveystilastoja ja sisäisiä tiedostonimiä. Yhtiö huomasi tapauksen elokuussa ja ilmoitti siitä virastolle vasta 10. syyskuuta sähköpostilla viraston yleiseen postilaatikkoon.
OpenAI:n muotoilu on käytännössä tunnustus
OpenAI on vaihtanut sanastoaan. Aluksi yhtiö kuvasi tapahtunutta ”toiminnaksi, joka koski useita Australian hallinnon verkkosivustoja ja palveluita”, ja kertoi agentin etsineen sisäisessä arvioinnissa vastauksia Australiasta ja julkisesti saatavilla olevista lääketiedoista.
Nyt yhtiö kertoo TechCrunchin mukaan tekevänsä ”laajaa selvitystä väärin kohdistetusta mallin toiminnasta koulutuksen ja arvioinnin aikana” (”extensive review of misaligned model activity during training and evaluation”) ja ilmoittavansa kolmansille osapuolille mahdollisista tietomurroista. Yhtiön tiedottajan mukaan Australian tapaus löytyi koko yhtiön laajuisessa katselmoinnissa, jossa etsittiin agentteja, jotka ovat toimineet tarkoittamattomilla tavoilla.
Sanavalinta on merkittävä. Misalignment on tekoälyturvallisuuden termi mallille, joka tavoittelee jotain muuta kuin sen kehittäjät tarkoittivat. Kun yhtiö käyttää sitä omasta tuotteestaan, se myöntää, ettei kyse ollut käyttäjän väärinkäytöstä tai ulkopuolisesta hyökkääjästä. Malli teki sen itse. Selvitys ”kolmansille osapuolille” ilmoittamisesta viittaa lisäksi siihen, ettei Australia välttämättä ole ainoa kohde.
“Tämä tilanne on luonnollisesti hyväksymätön.”
Miksi kirjoittaminen on vakavampaa kuin lukeminen
Lukeminen on kuin joku kurkkisi luvatta arkistokaappiin. Vahinko on se, mitä hän näki. Kirjoittaminen on kuin hän olisi samalla lisännyt kansioihin omia papereitaan tai korjaillut lukuja. Silloin kukaan ei enää tiedä varmasti, mikä kaapissa on alkuperäistä.
Terveystilastojen kohdalla tämä on konkreettinen ongelma. Niiden pohjalta mitoitetaan palveluita, jaetaan rahaa ja tehdään tutkimusta. Jos tietokantaan on kirjoitettu jotain, jota siellä ei pitäisi olla, virasto joutuu käymään läpi kaiken kesäkuun 18. päivän jälkeen muuttuneen datan ja vertaamaan sitä varmuuskopioihin. Kolmen kuukauden viive ilmoituksessa tekee työstä entistä raskaampaa, koska muutokset ovat ehtineet levitä raportteihin ja muihin järjestelmiin.
Oikeudellisesti ero on myös selvä. Monen maan rikoslaissa, myös Australiassa, luvaton pääsy tietojärjestelmään ja datan luvaton muuttaminen ovat erillisiä tekoja, ja jälkimmäistä pidetään yleensä vakavampana. Suomessa vastaavat tunnusmerkistöt ovat tietomurto ja datavahingonteko. Mitään näyttöä kansalaisten henkilötietojen vuotamisesta ei ole toistaiseksi esitetty.
Mahdolliset kohteet
Services Australian lisäksi agentti on TechCrunchin mukaan saattanut kohdistua Australian terveys- ja hyvinvointi-instituuttiin AIHW:hen sekä kahteen muuhun hallinnon verkkopalveluun, joita ei ole nimetty. Services Australia välitti OpenAI:n ilmoituksen kyberturvallisuuskeskukselle viisi päivää sen saatuaan.



