Tekoäly

OpenAI pysäytti oman mallinsa ja soitti viranomaisille

Yhtiö ei pysty sulkemaan pois, että malli osaisi murtautua järjestelmiin itse.

Aino AikajärviAino Aikajärvi
Jaa:
OpenAI pysäytti oman mallinsa ja soitti viranomaisille
Kuva: UK Prime Minister / CC BY 2.0

OpenAI kertoi perjantaina jäädyttäneensä osan kehitteillä olevan Astra-mallinsa työstä. Syy ei ole ulkopuolinen välikohtaus vaan yhtiön oma sisäinen arvio: alustavat testit eivät sulje pois sitä, että malli yltää OpenAI:n turvallisuuskehyksen kriittiselle kyberturvatasolle.

Kyse on eri asiasta kuin aiemmin raportoidussa tapauksessa, jossa julkaisematon OpenAI:n malli murtautui Hugging Facen järjestelmiin sisäisessä kokeessa, kuten AI Suomi aiemmin kertoi. Silloin kyse oli yhdestä testitilanteesta. Nyt yhtiö sanoo, että mallin kyvykkyys itsessään saattaa ylittää rajan, jonka se on itse asettanut.

Kriittinen taso tarkoittaa OpenAI:n omin sanoin mallia, joka kykenee itsenäisesti löytämään ja toteuttamaan hyökkäyksiä hyvin suojattuihin oikean maailman järjestelmiin. Ei siis avustamaan ihmishyökkääjää, vaan hoitamaan ketjun alusta loppuun.

Alustavat arviomme osoittavat niin vahvaa suorituskykyä, ettemme voi tässä vaiheessa sulkea pois kriittistä kyvykkyystasoa.

OpenAI, yhtiön tiedote 7.8.2026

Mitä kriittinen raja tarkoittaa OpenAI:n kehyksessä

OpenAI seuraa mallien vaarallisia kyvykkyyksiä Preparedness-kehyksellään. Se määrittelee seurattaville alueille, kyberturvallisuus mukaan lukien, kaksi kynnystä: korkean ja kriittisen.

Korkea taso koskee julkaisua. Jos malli ylittää sen, sitä ei oteta käyttöön ennen kuin riskiä pienentävät suojaukset ovat kunnossa. Kriittinen taso koskee myös kehitystä: silloin jo mallin työstäminen ja sisäinen käyttö edellyttävät riittäviä suojauksia.

Siksi tämä uutinen on hankalampi kuin julkaisun lykkääminen. Jäädytys ei kohdistu tuotteeseen, jota kukaan ei vielä käytä, vaan yhtiön omaan työskentelyyn mallin kanssa.

Mitä jäädytys käytännössä koskee

Yhtiön mukaan se on kiristänyt turvakontrollejaan ja keskeyttänyt ne sisäiset Astraan liittyvät toiminnot, jotka eivät täytä uusia vaatimuksia. Koko mallin kehitys ei siis ole pysähtynyt, vaan osa siitä.

Samalla OpenAI kertoo testaavansa mallin kyvykkyyksiä yhdessä viranomaisten ja valittujen tekoälyn turvallisuusorganisaatioiden kanssa. Julkistusta se perustelee avoimuudella: yhtiön mukaan yleisölle ja turvallisuusyhteisölle on tärkeää kertoa mahdollisesta muutoksesta kyvykkyyksissä.

Mitä OpenAI ei kerro

Tiedotteessa ei ole testituloksia eikä lukuja, joiden perusteella arvio on tehty. Yhtiö ei nimeä viranomaisia tai turvallisuusjärjestöjä, joiden kanssa se testaa. Se ei erittele, mitkä osat kehityksestä ovat pysähdyksissä, eikä kerro milloin arvio valmistuu. Yhtään yhtiön edustajaa ei ole nimetty kommentoimaan päätöstä.

Korkea taso koskee julkaisua, kriittinen myös kehitystä

Korkea taso

Preparedness-kehyksen alempi kynnys seurattavilla riskialueilla

Mitä koskee
Mallin julkaisua
Seuraus ylityksestä
Ei käyttöönottoa ennen riittäviä suojauksia
Rajoittaa sisäistä kehitystä
Ei

Kriittinen taso

Malli kykenee itsenäisesti löytämään ja toteuttamaan hyökkäyksiä hyvin suojattuihin järjestelmiin

Mitä koskee
Julkaisua ja kehitystä
Seuraus ylityksestä
Myös sisäinen käyttö vaatii suojaukset
Rajoittaa sisäistä kehitystä
Kyllä, Astran työstöä on jäädytetty

OpenAI Preparedness Framework

Sanasto

Preparedness-kehys
OpenAI:n oma sääntökirja, jossa mallien vaarallisia kyvykkyyksiä mitataan etukäteen ja määritellään kynnykset, joiden ylittyessä mallin julkaisua tai kehitystä on rajoitettava.

Kenen ongelma tämä on

Tavallisen käyttäjän kannalta olennaista ei ole Astra vaan aikataulu. Jos kyberhyökkäysten tekeminen siirtyy ihmisiltä malleille, hyökkäysten määrä ei kasva sen mukaan montako osaajaa rikollisryhmällä on, vaan sen mukaan montako rinnakkaista ajoa sillä on varaa pyörittää.

Puolustus liikkuu toista tahtia. Kunnan potilastietojärjestelmässä tai pienyrityksen verkkokaupassa haavoittuvuuden paikkaaminen kestää päiviä tai viikkoja, ei minuutteja. Sama kyvykkyys auttaa myös puolustajia löytämään omat aukkonsa, mutta vain jos joku ehtii ajaa työkalut ensin.

Suomessa vastuu jakautuu Traficomin Kyberturvallisuuskeskuksen ohjeistuksen ja organisaatioiden oman valmiuden välille. EU:n tekoälyasetus velvoittaa yleiskäyttöisten mallien tarjoajat arvioimaan ja raportoimaan järjestelmätason riskejä, mutta valvonta nojaa yhä pitkälti siihen, mitä yhtiöt itse kertovat.

Itse ilmoitettu jarru

Astran tapauksessa raja, sen mittaus, ylityksen toteaminen ja siitä seuraava jäädytys ovat kaikki saman yhtiön käsissä. OpenAI on nyt tulkinnut omaa sääntöään tiukasti, ja se kannattaa lukea sen ansioksi.

Seuraava kysymys on, mitä ulkopuoliset testaajat saavat kertoa. Jos viranomaiset ja turvallisuusjärjestöt pääsevät ajamaan omat kokeensa mutta tulokset jäävät salassapitosopimusten taakse, ulkopuolinen ei pysty arvioimaan oliko jäädytys varovaisuutta vai välttämättömyys. Se ero ratkaisee, kannattaako seuraavaan ilmoitukseen luottaa.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  2. 2WhatsAppiin ilmestyi nappi, jota ei saa pois
  3. 320 vuotta koodaamatta, sitten 5,4 miljoonaa
  4. 4Uusi Siri saapui – mutta ei suomeksi eikä iPhoneen
  5. 5Google kaatoi 300 hehtaaria metsää – virasto selvittää

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.