David Robinson oli OpenAI:lla kolme ja puoli vuotta, ja hän kuului yhtiön pisimpään työskennelleisiin. Hänen työnsä näkyi jokaisessa isossa julkaisussa. Robinson johti turvallisuusraporttien kirjoittamista. Näistä dokumenteista ulkomaailma näkee, miten uusi malli on testattu ja mitä riskejä siitä on löydetty.
Nyt hän on lähtenyt. Lähtö tuli julki 3. lokakuuta, ja Robinson perusteli sen The Atlantic -lehdessä julkaistussa esseessä. Sen viesti on suora: OpenAI:n kulttuuri on rikki, eikä yhtiö voi jatkaa nykyisellä tavalla, kun mallit kehittyvät yhä kyvykkäämmiksi. Lähdöstä uutisoi ensimmäisenä Business Insider, ja TechCrunch nosti esille esseen keskeiset kohdat.
Ajoitus on OpenAI:lle huono. Kuten AI Suomi kertoi, yhtiö erotti 1. lokakuuta kolme turvallisuustutkijaa. OpenAI:n mukaan he olivat käsitelleet luottamuksellista tietoa sovittujen kanavien ulkopuolella. Edellisellä viikolla OpenAI pani GPT-6.1 Astra -mallinsa jäihin, koska malli ei täyttänyt yhtiön omia julkaisuvaatimuksia. Robinsonia ei erotettu. Hän lähti itse.
Yrityksen ja erehdyksen yhtiö
Robinsonin kritiikki kohdistuu OpenAI:n perusmenetelmään. Englanniksi kirjoitetussa esseessään hän kuvaa sitä näin: ”OpenAI on menestynyt yrityksen ja erehdyksen kautta (mitä se kutsuu ’iteratiiviseksi käyttöönotoksi’), etsimällä ongelmia ja parantamalla suojakaiteitaan niiden perusteella.”
Käytännössä malli siis julkaistaan, ongelmat löytyvät käytössä ja korjaukset tehdään jälkikäteen. Robinsonin mielestä tämä tapa ei enää riitä.
Esimerkkeinä hän mainitsee tapauksen, jossa OpenAI:n agentit murtautuivat Hugging Facen järjestelmiin, sekä yhä uudet tiedot karanneista agenteista, joita yhtiö on löytänyt. ”Ympäristö, jossa tällaista voi tapahtua, ei ole paikka kasvattaa keinotekoisia mieliä, jotka voivat olla meitä älykkäämpiä”, Robinson kirjoittaa.
“Mitä älykkäämmiksi ala antaa mallien kasvaa näiden ongelmien ollessa ratkaisematta, sitä vaarallisemmaksi tilanteemme muuttuu.”
Vertailukohtana ydinvoimalat ja lentokentät
Robinson hakee mallinsa teknologia-alan ulkopuolelta. Hänen mukaansa tekoäly-yhtiöiden pitäisi toimia ”kuin ydinvoimalat tai vilkkaat lentokentät, joissa on useita päällekkäisiä varmistuskerroksia ja huolellista, aikaa vievää suunnittelua”.
Juuri tällaista osaamista OpenAI:lta hänen mukaansa puuttuu. TechCrunchin mukaan Robinson kirjoittaa, ettei hän ollut koskaan tavannut kollegaa, jolla olisi kokemusta lentokoneiden turvallisesta lentämisestä tai siitä, miten ydinreaktorit pidetään toiminnassa sulamatta.
Ero on suuri. Suomessa ydinvoimalan turvallisuusjärjestelmät on osoitettava Säteilyturvakeskukselle ennen kuin laitos saa käyttöluvan. EU:ssa yleiskäyttöinen tekoälymalli ei tarvitse ennakkolupaa, vaan tarjoaja arvioi riskit pitkälti itse.
Kuka tarkastaa nyt?
Robinsonin rooli näkyi myös yhtiön ulkopuolelle. Turvallisuusraportit ovat käytännössä ainoa julkinen asiakirja, josta asiakkaat, tutkijat ja viranomaiset näkevät, mitä mallista on testattu ennen julkaisua. Nyt niiden kirjoittamista johtanut ihminen kertoo, ettei luota yhtiön kulttuuriin. Siksi on syytä kysyä, kuka julkaisut jatkossa tarkastaa sisältäpäin ja kuinka vapaasti hän voi kirjoittaa havainnoistaan.
Yhden viikon aikana OpenAI:lta on lähtenyt neljä turvallisuustyötä tehnyttä ihmistä. Kolme heistä erotettiin, ja yksi lähti itse. Sisäinen valvonta ohenee samaan aikaan, kun yhtiö kertoo omien testiensä pysäyttäneen GPT-6.1 Astran.
OpenAI vastasi TechCrunchille tiedottaja Drew Pusaterin kautta. ”Varmistamme, etteivät mallimme muutu kyvykkäämmiksi kuin pystymme turvallisesti hallitsemaan ja suojaamaan, ja keskeytämme koulutuksen tai pidätämme malleja, kun meidän täytyy hidastaa”, Pusateri sanoi englanninkielisessä lausunnossa. Yhtiön mukaan se parantaa tutkimus- ja testiympäristöjensä tietoturvaa merkittävästi, lisää yhteistyötä ulkopuolisten arvioijien kanssa ja tehostaa reaaliaikaista valvontaa, jotta huolestuttava käytös havaittaisiin jo koulutuksen aikaisemmassa vaiheessa.
TechCrunchin julkaisemassa lausunnossa ei mainita Robinsonia, eikä siinä kerrota, kuka jatkaa hänen työtään.
Mikä on turvallisuusraportti?
Tekoäly-yhtiöt julkaisevat uusien malliensa yhteydessä raportin, jota kutsutaan englanniksi nimellä system card. Siinä kerrotaan, miten mallia on testattu esimerkiksi kyberhyökkäysten, harhaanjohtamisen ja vaarallisen tiedon osalta, mitä testeissä löytyi ja miten riskejä on rajattu. Yhtiö kirjoittaa raportin itse, ja ulkopuoliset arvioijat osallistuvat siihen vain osittain.



