Tutkimus

Tekoäly matematiikan apurina: kumppani vai renki?

Googlen agentti todistaa lauseita matemaatikon rinnalla – mutta ei ilman ihmistä.

Nelli NelisanomaNelli Nelisanoma
Jaa:
Tekoäly matematiikan apurina: kumppani vai renki?

Todistus syntyy nyt vuoropuheluna

Googlen tutkimusryhmä julkaisi kesäkuussa arxiv-palvelussa työn, joka kuvaa AI Co-Mathematician -nimistä järjestelmää. Kyseessä ei ole tavallinen ongelmanratkaisija, jolle syötetään yhtälö ja jolta odotetaan vastausta. Se on interaktiivinen työpöytä, jossa koordinoiva agentti jakaa tehtäviä useille rinnakkaisille alaprosesseille.

Käytännössä järjestelmä toimii kuin pieni tutkimusryhmä. Yksi agentti etsii aiheeseen liittyvää kirjallisuutta, toinen kirjoittaa Python-koodia ja testaa sen, kolmas pyörittää raskaita laskentahakuja pilvipalvelimilla. Matemaatikko keskustelee koordinaattorin kanssa ja tarkentaa tutkimuskysymystä vähitellen, samaan tapaan kuin oikean kollegan kanssa.

Ihminen pelasti todistuksen

Paras esimerkki löytyy topologi Marc Lackenbyn kokeilusta. Hän antoi järjestelmälle ratkaistavaksi vanhan ongelman niin kutsutusta Kourovkan muistikirjasta. Tekoäly tuotti todistuksen, joka oli virheellinen, mutta Lackenby huomasi sen sisältä nokkelan idean. Kun hän kertoi, miten aukon voisi paikata, järjestelmä vei todistuksen loppuun. Sen jälkeen matemaatikko yleisti tuloksen itse ja syötti sen uudelleen tarkistettavaksi.

Toinen testikäyttäjä, Hamiltonin systeemejä tutkiva Semon Rezchikov, sai järjestelmältä siistin todistuksen yhdelle aputulokselle. Hänen kommenttinsa kuvaa hyvin, mistä hyödystä on kyse.

“Olisin voinut helposti käyttää viikon pohtien, mitä siellä oli, mutta sen sijaan pystyin vain jatkamaan eteenpäin.”

— Semon Rezchikov, matemaatikko, järjestelmän testikäyttäjä

Kumppani vai sittenkin työkalu?

Numeroiden valossa harppaus on iso. Vaativassa FrontierMath-testissä järjestelmä ylsi 48 prosentin tarkkuuteen, kun pelkkä Gemini-malli jäi 19 prosenttiin. Vertailu kuitenkin ontuu, sillä tekoäly sai käyttöönsä valtavasti laskentatehoa ja jopa 48 tuntia aikaa yhtä tehtävää kohden.

Tutkijat eivät itse markkinoi järjestelmää itsenäisenä nerona. He kirjoittavat, että tällaiset työkalut pitäisi lähtökohtaisesti nähdä ihmistä vaativina. Jokaisessa esimerkissä ratkaiseva oivallus tuli ihmiseltä, ei koneelta. Ilman alan asiantuntijaa järjestelmä joko juuttuu tai tuottaa hienolta näyttävää mutta ontuvaa matematiikkaa.

Kaksi sudenkuoppaa

Tutkijat nostavat esiin kaksi ongelmaa. Ensimmäinen on väärä konsensus: tarkastaja-agentit voivat hyväksyä todistuksen, joka näyttää oikealta mutta on hienovaraisesti virheellinen. Toinen on kuolinkierre, jossa agentit jäävät loputtomaan korjauskehään ja alkavat keksiä perusteluja tyhjästä. Siisti LaTeX-ulkoasu voi myös peittää heikon logiikan.

Sanasto

FrontierMath
Erittäin vaativa matematiikan testikokoelma, jolla mitataan tekoälyn kykyä ratkaista huippututkimuksen tason ongelmia. Mitä suurempi prosentti, sitä useamman tehtävän malli ratkaisi oikein.
LaTeX
Tieteessä yleisesti käytetty ladontajärjestelmä, jolla kirjoitetaan siistin näköistä matemaattista tekstiä ja kaavoja. Siisti ulkoasu ei kuitenkaan takaa, että sisältö on oikein.

Miksi tällä on väliä

Tavalliselle lukijalle uutinen ei tarkoita, että matematiikka olisi valmis. Se kertoo, mihin suuntaan tiede on menossa. Jos yksi tutkija saa tekoälyn avulla työn valmiiksi viikoissa eikä kuukausissa, uusia tuloksia syntyy nopeammin, ja niitä on myös tarkistettava nopeammin.

Tässä piilee myös riski. Kun kone kirjoittaa 20-sivuisen todistuksen minuuteissa, sen tarkistaminen vie ihmiseltä yhä päiviä. Tutkijat pelkäävät, että vertaisarviointi ruuhkautuu ja uskottavan näköisiä mutta pinnallisia papereita alkaa tulvia julkaisuihin. Luottamus tieteen laatuun nojaa siihen, että joku ihminen yhä ymmärtää, mitä paperissa lukee.

Toistaiseksi kyse on siis vahvasti varustellusta apurista, ei kollegasta. Se hyödyttää eniten niitä, jotka jo hallitsevat alansa ja osaavat ohjata sitä oikeaan suuntaan. Aloittelijalle järjestelmä ei vielä avaa matematiikan salaisuuksia, pikemminkin se palkitsee sen, joka tietää tarkalleen mitä on etsimässä.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 320 vuotta koodaamatta, sitten 5,4 miljoonaa
  4. 4Datakeskus söisi Lapinlahdella kokonaisen kaupungin sähköt
  5. 5Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.