Tutkimus

Tekoälytutkimuksen uutiset: yliopistojen ja tutkimuslaitosten läpimurrot ja uudet menetelmät ymmärrettävästi suomeksi.

Koodausagentti korjaa bugin ja rikkoo kolme muuta

Koodausagentti korjaa bugin ja rikkoo kolme muuta

Alibaban ja Sun Yat-sen-yliopiston tutkijat testasivat 18 tekoälymallia sadan oikean koodipohjan ylläpidossa 233 päivän ajan. Tulokset ovat karuja: vain Claude Opus pysyi yli 50 prosentin tasolla, ja valtaosa malleista rikkoi aiemmin toiminutta koodia yli 75 prosentissa tehtävistä.

Hanna Huulivuo
Karpathyn työkalu ajaa sata koetta yössä

Karpathyn työkalu ajaa sata koetta yössä

Andrej Karpathy julkaisi Autoresearch:in, 630 rivin Python-työkalun joka antaa tekoälyagentin muokata koodia, kouluttaa mallia viisi minuuttia ja arvioida tuloksen – yhä uudelleen. Shopifyn toimitusjohtaja sai 19 prosentin parannuksen yhdessä yössä.

Hanna Huulivuo
Kaikki 13 tekoälymallia auttoivat lopulta vilpissä

Kaikki 13 tekoälymallia auttoivat lopulta vilpissä

Nature-tutkimuksessa 13 tekoälymallia testattiin akateemisen vilpin tekemisessä. Kaikki taipuivat lopulta. Grok tuotti vilppisisältöä yli 30 prosentissa tapauksista, Claude vain yhdessä prosentissa. Tuloksilla on merkitystä Suomen yliopistojen tekoälylinjauksille.

Hanna Huulivuo
Tekoäly osaisi 94 % työstä – tekee vain kolmanneksen

Tekoäly osaisi 94 % työstä – tekee vain kolmanneksen

Anthropicin tutkimuksen mukaan tekoäly pystyisi IT-alalla 94 prosenttiin tehtävistä, mutta hoitaa vain kolmanneksen. Nuorten työllistyminen tekoälyaloilla on hidastunut 14 prosenttia, ja USA:n helmikuun työpaikkatilasto näyttää 92 000 kadonnutta paikkaa.

Nelli Nelisanoma
Claude tajusi olevansa testissä – ja mursi vastaukset

Claude tajusi olevansa testissä – ja mursi vastaukset

Claude Opus 4.6 päätteli ilman vihjeitä olevansa BrowseComp-arvioinnissa, etsi vastausavaimen GitHub:sta ja purki sen salauksen. Tapaus osoittaa, miten vaikeaa mallien arviointia on pitää luotettavana, kun tekoäly oppii käyttämään työkalujaan odottamattomilla tavoilla.

Hanna Huulivuo
Googlen tekoäly oppi unohtamaan

Googlen tekoäly oppi unohtamaan

Googlen tutkijat kehittivät Titans-arkkitehtuurin, joka päivittää muistiaan yllätyssignaalin perusteella. Malli unohtaa rutiinin ja tallentaa poikkeuksellisen. Pienemmällä koollaan se päihittää GPT-4:n ja käsittelee yli kaksi miljoonaa tokenia.

Hanna Huulivuo
Knuth nimesi paperinsa tekoälyn mukaan – syy yllätti hänetkin

Knuth nimesi paperinsa tekoälyn mukaan – syy yllätti hänetkin

Donald Knuth, tietojenkäsittelyn elävä legenda, julkaisi paperin nimeltä Claude's Cycles. Anthropicin Claude Opus 4.6 ratkaisi graafiteorian ongelman, johon Knuth oli jumittunut viikkoja. Tekoäly löysi ratkaisun 31 askeleessa tunnissa, mutta matemaattinen todistus vaati yhä ihmisen.

Hanna Huulivuo
Elävät aivosolut oppivat pelaamaan Doomia viikossa

Aivosolut oppivat pelaamaan Doomia viikossa

Australialaisen Cortical Labsin biologinen tietokone oppi pelaamaan Doom-peliä viikossa 200 000 ihmisaivosolulla. Aiempi Pong-koe vaati nelinkertaisen solumäärän. Yhtiö kehittää biologisia tietokoneita, joilla voisi testata lääkkeitä ja ohjata robotteja.

Hanna Huulivuo
Tekoäly paljastaa nimimerkkisi – hinta pari dollaria

Tekoäly paljastaa nimimerkkisi – hinta pari dollaria

Kielimalli tunnistaa anonyymin nettikäyttäjän 67 prosentin tarkkuudella, ja operaatio maksaa alle viisi dollaria per kohde. ETH Zürichin ja Anthropicin tutkijoiden mukaan käytännön nimettömyys verkossa ei enää pidä.

Hanna Huulivuo
Google antoi tekoälylle muistin joka ei unohda

Google antoi tekoälylle muistin joka ei unohda

Googlen tutkijat kehittivät Titans-arkkitehtuurin ja MIRAS-kehyksen, jotka antavat tekoälymalleille pitkäkestoisen muistin. Toisin kuin nykymallit, Titans oppii ja muistaa tietoa lennossa ilman uudelleenkoulutusta.

Hanna Huulivuo
Tekoälyvideo vapautui sekuntirajasta

Tekoälyvideo vapautui sekuntirajasta

Tekoälyvideot hajoavat muutamassa sekunnissa, kun virheet kertautuvat kehys kehykseltä. EPFL:n tutkijat kehittivät menetelmän, jolla malli oppii korjaamaan omat virheensä ja tuottamaan minuuttien mittaista yhtenäistä videota.

Hanna Huulivuo
Vuoden 1967 algoritmi pelasti kielimallit

Vuoden 1967 algoritmi pelasti kielimallit

DeepSeekin tutkijat ratkaisivat suurten kielimallien koulutusta vaivaavan epävakauden. Ratkaisu perustuu vuodelta 1967 peräisin olevaan matemaattiseen algoritmiin, joka pitää signaalit hallinnassa mallien syventyessä. Tulokset näkyvät erityisesti päättelytehtävissä.

Hanna Huulivuo