Tutkimus

Tekoälytutkimuksen uutiset: yliopistojen ja tutkimuslaitosten läpimurrot ja uudet menetelmät ymmärrettävästi suomeksi.

DeepMind mittasi ensi kertaa tekoälyn manipulointikyvyn

DeepMind mittasi ensi kertaa tekoälyn manipulointikyvyn

Google DeepMind julkaisi ensimmäisen empiirisesti validoidun mittariston tekoälyn manipulointikyvylle. Yhdeksän kokeen sarja yli 10 000 koehenkilöllä osoitti, että tekoäly manipuloi tehokkaimmin taloudellisia päätöksiä mutta on yllättävän heikko terveyskysymyksissä.

Hanna Huulivuo
Meta rakensi aivojen digitaalisen kaksosen

Meta rakensi aivojen digitaalisen kaksosen

Metan tutkimusryhmä julkaisi TRIBE v2 -tekoälymallin, joka ennustaa neuronien reaktiot videoihin, ääniin ja tekstiin tarkemmin kuin yksittäiset fMRI-aivokuvaukset. Avoimeen lähdekoodiin julkaistu malli voi nopeuttaa aivotutkimusta kuten AlphaFold nopeutti proteiinitutkimusta.

Hanna Huulivuo
Nvidian agentti koodasi viikon ja päihitti asiantuntijat

Nvidian agentti koodasi viikon ja päihitti asiantuntijat

Nvidian AVO-agentti optimoi GPU-koodia itsenäisesti seitsemän päivän ajan, tutki yli 500 optimointireittiä ja kehitti 40 ydinversiota. Lopputulos ylitti cuDNN:n ja FlashAttention-4:n Blackwell B200 -siruilla.

Hanna Huulivuo
Tekoäly ratkaisi matematiikan mysteerin – oppia se ei ota

Tekoäly ratkaisi matematiikan mysteerin – oppia se ei ota

GPT-5.4 Pro ratkaisi ensimmäisenä vuosia avoinna olleen Ramsey-hypergrafitehtävän. Myös Opus 4.6 ja Gemini 3.1 Pro onnistuivat. ARC-AGI-3-testissä samat mallit jäivät kuitenkin alle prosentin – ihmisten saadessa täydet pisteet.

Hanna Huulivuo
Ihminen 100, tekoäly 0: uusi testi nollasi kaikki mallit

Ihminen 100, tekoäly 0: uusi testi nollasi kaikki mallit

ARC Prize Foundation julkaisi ARC-AGI-3-testin, jossa tekoälymallien pitää ratkaista uusia tehtäviä ilman aiempaa harjoittelua. Ihmiset ratkaisivat kaikki tehtävät, mutta paras malli pääsi vain 0,37 prosenttiin. Kagglessa on käynnissä kahden miljoonan dollarin kilpailu.

Hanna Huulivuo
Chatbotit ruokkivat harhaluuloja – 391 000 viestiä tutkittu

Chatbotit ruokkivat harhaluuloja – 391 000 viestiä tutkittu

Stanfordin yliopiston johtama tutkimusryhmä analysoi lähes 400 000 chatbot-viestiä käyttäjiltä, jotka kokivat psykologista haittaa. Tekoälybotit mielistelivät yli 70 prosentissa vastauksistaan ja rohkaisivat väkivaltaa joka kolmannessa tapauksessa.

Hanna Huulivuo
Kolme bittiä riittää – Google tiivisti kielimallien muistin

Kolme bittiä riittää – Google tiivisti kielimallien muistin

Googlen tutkijat esittelevät TurboQuant-algoritmin, joka pakkaa kielimallien KV-välimuistin kolmeen bittiin. Menetelmä nopeuttaa laskentaa jopa kahdeksankertaisesti H100-piireillä eikä vaadi uudelleenkoulutusta tai heikennä tarkkuutta.

Hanna Huulivuo
Tekoäly saa aivosi antautumaan

Tekoäly saa aivosi antautumaan

Pennsylvanian yliopiston tutkijat havaitsivat kolmessa kokeessa, että 80 prosenttia koehenkilöistä hyväksyi tekoälyn väärän vastauksen kyseenalaistamatta. Samalla itsevarmuus omiin vastauksiin kasvoi. Tutkijat kutsuvat ilmiötä kognitiiviseksi antautumiseksi.

Hanna Huulivuo
Kiina valtasi avoimen tekoälyn

Kiina valtasi avoimen tekoälyn

Hugging Facen kevätrapotti kertoo selvää kieltä: 41 prosenttia tekoälymallien latauksista tulee Kiinasta. Alibaban Qwen-perheestä on johdettu yli 113 000 mallia, enemmän kuin Googlella ja Metalla yhteensä. Avoin tekoäly ei ole enää lännen yksinoikeus.

Hanna Huulivuo
Tao muutti mielensä tekoälystä

Tao muutti mielensä tekoälystä

Maailman tunnetuin matemaatikko Terence Tao sanoo, että tekoäly säästää nyt enemmän aikaa kuin tuhlaa. Donald Knuth nimesi tutkielmansa Claude-tekoälyn mukaan. Matematiikassa on käynnissä hiljainen vallankumous.

Hanna Huulivuo
DeepMind laati AGI:lle tutkintotodistuksen

DeepMind laati AGI:lle tutkintotodistuksen

Google DeepMind julkaisi viitekehyksen, joka pilkkoo yleisälykkyyden kymmeneen mitattavaan kyvykkyyteen havainnoinnista sosiaaliseen kognitioon. Samalla avattiin Kaggle-hackathon, jossa tutkijat kilpailevat 200 000 dollarin palkintopotista suunnittelemalla arviointitestejä.

Hanna Huulivuo
Googlen Titans muistaa kymmenen romaania

Googlen Titans muistaa kymmenen romaania

Google Research julkaisi Titans-arkkitehtuurin, joka yhdistää transformerin tarkkuuden ja RNN:n nopeuden. Se käsittelee yli kaksi miljoonaa tokenia kerralla ja päihitti GPT-4:n BABILong-testissä – vain 760 miljoonalla parametrilla.

Hanna Huulivuo