Tutkimus

DeepMind laati AGI:lle tutkintotodistuksen

Kymmenen mitattavaa kyvykkyyttä ja 200 000 dollarin hackathon

Hanna HuulivuoHanna Huulivuo
Jaa:
DeepMind laati AGI:lle tutkintotodistuksen

Kognitiivinen tutkinto tekoälylle

Milloin tekoäly on "yleisälykäs"? Kysymys on vaivannut tutkijoita vuosikymmeniä, mutta vakuuttavaa vastausta ei ole ollut. Google DeepMind otti 17. maaliskuuta konkreettisen askeleen: tutkimusryhmä julkaisi kognitiivisen viitekehyksen, joka pilkkoo yleisälykkyyden kymmeneen mitattavaan kyvykkyyteen.

Samalla DeepMind avasi Kaggle-hackathonin, jossa tutkijat ja kehittäjät voivat kilpailla 200 000 dollarin palkintopotista suunnittelemalla parhaita arviointitestejä. Kyseessä on ensimmäinen vakava yritys siirtää AGI-keskustelu spekulaatiosta mitattavaksi tieteeksi.

Kymmenestä kyvystä koostuva äly

Viitekehys perustuu vuosikymmenten psykologian ja neurotieteen tutkimukseen. DeepMindin tiimi, jota johtaa tutkija Ryan Burnell, jakoi kognition kahdeksaan perusrakennuspalikkaan ja kahteen yhdistelmäkykyyn.

Perusrakennuspalikat ovat havainnointi, tuottaminen, tarkkaavaisuus, oppiminen, muisti, päättely, metakognitio ja toiminnanohjaus. Näiden päälle rakentuvat ongelmanratkaisu ja sosiaalinen kognitio, jotka yhdistelevät useampaa peruskyvykkyyttä.

Käytännössä tämä tarkoittaa, että tekoälyjärjestelmää ei enää arvioida yhdellä kokonaispisteellä vaan kymmenellä erillisellä mittarilla. Ajatus on sama kuin ihmisen älykkyyden mittaamisessa: neuropsykologi ei luota yhteen ÄO-lukuun vaan laatii monipuolisen profiilin.

Nykymallien vahvuudet painottuvat havainnoinnin, tuottamisen ja päättelyn puolelle. ChatGPT tuottaa sujuvaa tekstiä ja päättelee loogisesti, mutta sen kyky oppia lennossa uusista tilanteista, arvioida omaa epävarmuuttaan tai lukea sosiaalisia vihjeitä on pinnallista.

Otetaan esimerkiksi metakognitio: ihminen osaa arvioida, milloin hän tietää vastauksen ja milloin ei. Kielimallit tuottavat usein itsevarmoja vastauksia silloinkin, kun niiden pitäisi sanoa "en tiedä". Toiminnanohjaus taas kattaa kyvyn suunnitella monivaiheisia tehtäviä ja muuttaa suunnitelmaa kesken kaiken. Juuri tätä taitoa tekoälyagenttien pitäisi hallita, mutta toistaiseksi ne kompastuvat siihen toistuvasti.

Viisi aukkoa ja 200 000 dollarin palkinto

DeepMindin tutkijat tunnistivat viisi kyvykkyyttä, joissa nykyiset arviointimenetelmät ovat heikoimmillaan: oppiminen, metakognitio, tarkkaavaisuus, toiminnanohjaus ja sosiaalinen kognitio. Juuri näiden ympärille rakennettiin Kaggle-hackathon.

Kilpailussa on viisi erillistä sarjaa, yksi kullekin kyvykkyydelle. Jokaisessa sarjassa kaksi parasta osallistujaa palkitaan 10 000 dollarilla. Lisäksi neljä kokonaiskilpailun parasta saavat kukin 25 000 dollarin palkinnon. Hakuaika päättyy 16. huhtikuuta, ja tulokset julkistetaan 1. kesäkuuta.

Hackathonin idea on kunnianhimoinen: DeepMind ei väitä ratkaisseensa AGI:n mittaamisongelmaa yksin vaan pyytää tutkimusyhteisöä apuun. Avoin lähestymistapa on poikkeuksellinen alalla, jossa suuret toimijat usein kehittävät arviointimittaristonsa suljettujen ovien takana ja julkaisevat vain itselleen mairittelevia tuloksia.

Kokeile itse

DeepMindin tutkimusjulkaisu on luettavissa Googlen AI-blogissa. Kaggle-hackathoniin voi osallistua 16. huhtikuuta asti. Kilpailussa on viisi sarjaa ja palkinnot 10 000–25 000 dollaria per voittaja. Tulokset julkistetaan 1. kesäkuuta 2026.

Miten vertautuu muihin AGI-määritelmiin

DeepMindin viitekehys ei ole ensimmäinen yritys määritellä AGI:tä. OpenAI:n viisitasoinen asteikko kuvaa tekoälyn kehitystä keskustelubotin tasolta kohti järjestelmää, joka pystyy korvaamaan kokonaisen organisaation. Microsoftin tekoälyjohtaja Mustafa Suleyman on puolestaan ehdottanut käytännöllisempää testiä: tekoäly on riittävän kyvykäs, jos se pystyy muuttamaan 100 000 dollaria miljoonaksi itsenäisesti.

DeepMindin lähestymistapa eroaa molemmista. Se ei sijoita tekoälyä yhdelle asteikolle vaan piirtää kymmenen erillisen ulottuvuuden profiilin. Kun seuraavan kerran joku tekoäly-yhtiö ilmoittaa olevansa "lähellä AGI:tä", viitekehys mahdollistaa tarkentavan kysymyksen: missä kymmenessä kyvykkyydessä ja millä tasolla?

DeepMind julkaisi vuonna 2023 oman viisitasoisen AGI-luokittelunsa, joka keskittyi kykyjen syvyyteen. Uusi viitekehys täydentää sitä kartoittamalla kykyjen leveyden. Yhdessä ne muodostavat mittariston, joka tuo AGI-keskusteluun kaivattua tarkkuutta.

Seuraava etappi on kesäkuussa, kun hackathonin voittajat julkistetaan. Jos kilpailijoiden kehittämät testit osoittautuvat toimiviksi, ne voivat muodostaa pohjan ensimmäiselle laajasti hyväksytylle AGI-arviointistandardille. Suomalaisille tekoälytutkijoille, joita Aallossa ja Helsingin yliopistossa riittää, kilpailu tarjoaa tilaisuuden päästä vaikuttamaan siihen, miten koko alan edistystä mitataan.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.