Google DeepMind julkaisi ensimmäisen empiirisesti validoidun mittariston tekoälyn manipulointikyvylle. Yhdeksän kokeen sarja yli 10 000 koehenkilöllä osoitti, että tekoäly manipuloi tehokkaimmin taloudellisia päätöksiä mutta on yllättävän heikko terveyskysymyksissä.
Metan tutkimusryhmä julkaisi TRIBE v2 -tekoälymallin, joka ennustaa neuronien reaktiot videoihin, ääniin ja tekstiin tarkemmin kuin yksittäiset fMRI-aivokuvaukset. Avoimeen lähdekoodiin julkaistu malli voi nopeuttaa aivotutkimusta kuten AlphaFold nopeutti proteiinitutkimusta.
Nvidian AVO-agentti optimoi GPU-koodia itsenäisesti seitsemän päivän ajan, tutki yli 500 optimointireittiä ja kehitti 40 ydinversiota. Lopputulos ylitti cuDNN:n ja FlashAttention-4:n Blackwell B200 -siruilla.
GPT-5.4 Pro ratkaisi ensimmäisenä vuosia avoinna olleen Ramsey-hypergrafitehtävän. Myös Opus 4.6 ja Gemini 3.1 Pro onnistuivat. ARC-AGI-3-testissä samat mallit jäivät kuitenkin alle prosentin – ihmisten saadessa täydet pisteet.
ARC Prize Foundation julkaisi ARC-AGI-3-testin, jossa tekoälymallien pitää ratkaista uusia tehtäviä ilman aiempaa harjoittelua. Ihmiset ratkaisivat kaikki tehtävät, mutta paras malli pääsi vain 0,37 prosenttiin. Kagglessa on käynnissä kahden miljoonan dollarin kilpailu.
Stanfordin yliopiston johtama tutkimusryhmä analysoi lähes 400 000 chatbot-viestiä käyttäjiltä, jotka kokivat psykologista haittaa. Tekoälybotit mielistelivät yli 70 prosentissa vastauksistaan ja rohkaisivat väkivaltaa joka kolmannessa tapauksessa.
Googlen tutkijat esittelevät TurboQuant-algoritmin, joka pakkaa kielimallien KV-välimuistin kolmeen bittiin. Menetelmä nopeuttaa laskentaa jopa kahdeksankertaisesti H100-piireillä eikä vaadi uudelleenkoulutusta tai heikennä tarkkuutta.
Pennsylvanian yliopiston tutkijat havaitsivat kolmessa kokeessa, että 80 prosenttia koehenkilöistä hyväksyi tekoälyn väärän vastauksen kyseenalaistamatta. Samalla itsevarmuus omiin vastauksiin kasvoi. Tutkijat kutsuvat ilmiötä kognitiiviseksi antautumiseksi.
Hugging Facen kevätrapotti kertoo selvää kieltä: 41 prosenttia tekoälymallien latauksista tulee Kiinasta. Alibaban Qwen-perheestä on johdettu yli 113 000 mallia, enemmän kuin Googlella ja Metalla yhteensä. Avoin tekoäly ei ole enää lännen yksinoikeus.
Maailman tunnetuin matemaatikko Terence Tao sanoo, että tekoäly säästää nyt enemmän aikaa kuin tuhlaa. Donald Knuth nimesi tutkielmansa Claude-tekoälyn mukaan. Matematiikassa on käynnissä hiljainen vallankumous.
Google DeepMind julkaisi viitekehyksen, joka pilkkoo yleisälykkyyden kymmeneen mitattavaan kyvykkyyteen havainnoinnista sosiaaliseen kognitioon. Samalla avattiin Kaggle-hackathon, jossa tutkijat kilpailevat 200 000 dollarin palkintopotista suunnittelemalla arviointitestejä.
Google Research julkaisi Titans-arkkitehtuurin, joka yhdistää transformerin tarkkuuden ja RNN:n nopeuden. Se käsittelee yli kaksi miljoonaa tokenia kerralla ja päihitti GPT-4:n BABILong-testissä – vain 760 miljoonalla parametrilla.