OpenAI kertoi perjantaina jäädyttäneensä osan kehitteillä olevan Astra-mallinsa työstä. Syy ei ole ulkopuolinen välikohtaus vaan yhtiön oma sisäinen arvio: alustavat testit eivät sulje pois sitä, että malli yltää OpenAI:n turvallisuuskehyksen kriittiselle kyberturvatasolle.
Kyse on eri asiasta kuin aiemmin raportoidussa tapauksessa, jossa julkaisematon OpenAI:n malli murtautui Hugging Facen järjestelmiin sisäisessä kokeessa, kuten AI Suomi aiemmin kertoi. Silloin kyse oli yhdestä testitilanteesta. Nyt yhtiö sanoo, että mallin kyvykkyys itsessään saattaa ylittää rajan, jonka se on itse asettanut.
Kriittinen taso tarkoittaa OpenAI:n omin sanoin mallia, joka kykenee itsenäisesti löytämään ja toteuttamaan hyökkäyksiä hyvin suojattuihin oikean maailman järjestelmiin. Ei siis avustamaan ihmishyökkääjää, vaan hoitamaan ketjun alusta loppuun.
“Alustavat arviomme osoittavat niin vahvaa suorituskykyä, ettemme voi tässä vaiheessa sulkea pois kriittistä kyvykkyystasoa.”
Mitä kriittinen raja tarkoittaa OpenAI:n kehyksessä
OpenAI seuraa mallien vaarallisia kyvykkyyksiä Preparedness-kehyksellään. Se määrittelee seurattaville alueille, kyberturvallisuus mukaan lukien, kaksi kynnystä: korkean ja kriittisen.
Korkea taso koskee julkaisua. Jos malli ylittää sen, sitä ei oteta käyttöön ennen kuin riskiä pienentävät suojaukset ovat kunnossa. Kriittinen taso koskee myös kehitystä: silloin jo mallin työstäminen ja sisäinen käyttö edellyttävät riittäviä suojauksia.
Siksi tämä uutinen on hankalampi kuin julkaisun lykkääminen. Jäädytys ei kohdistu tuotteeseen, jota kukaan ei vielä käytä, vaan yhtiön omaan työskentelyyn mallin kanssa.
Mitä jäädytys käytännössä koskee
Yhtiön mukaan se on kiristänyt turvakontrollejaan ja keskeyttänyt ne sisäiset Astraan liittyvät toiminnot, jotka eivät täytä uusia vaatimuksia. Koko mallin kehitys ei siis ole pysähtynyt, vaan osa siitä.
Samalla OpenAI kertoo testaavansa mallin kyvykkyyksiä yhdessä viranomaisten ja valittujen tekoälyn turvallisuusorganisaatioiden kanssa. Julkistusta se perustelee avoimuudella: yhtiön mukaan yleisölle ja turvallisuusyhteisölle on tärkeää kertoa mahdollisesta muutoksesta kyvykkyyksissä.
Mitä OpenAI ei kerro
Tiedotteessa ei ole testituloksia eikä lukuja, joiden perusteella arvio on tehty. Yhtiö ei nimeä viranomaisia tai turvallisuusjärjestöjä, joiden kanssa se testaa. Se ei erittele, mitkä osat kehityksestä ovat pysähdyksissä, eikä kerro milloin arvio valmistuu. Yhtään yhtiön edustajaa ei ole nimetty kommentoimaan päätöstä.



