Koneoppiminen

Koneoppimisen uutiset suomeksi: uudet kielimallit ja mallijulkaisut, vertailut ja tutkimustulokset selkokielellä.

Gemini 3.5 Pro tuli vihdoin – jäikö se GPT-5.6:n jalkoihin?

Gemini 3.5 Pro tuli vihdoin – jäikö se GPT-5.6:n jalkoihin?

Google julkaisi Gemini 3.5 Pron 17. heinäkuuta kolmen myöhästymisen jälkeen. DeepMind rakensi mallin käytännössä uudelleen luotettavuusongelmien ja hallusinaatioiden takia. Lopputulos tuli myöhässä ja ilman selkeää etumatkaa GPT-5.6:een. Jäikö Gemini kilpailijan jalkoihin?

Aino Aikajärvi
Kimi K3: 2,8 biljoonan parametrin avoin jätti Kiinasta

Kimi K3: 2,8 biljoonan parametrin avoin jätti Kiinasta

Kiinalainen Moonshot AI julkaisi Kimi K3:n, 2,8 biljoonan parametrin avoimen MoE-mallin. Uusi Kimi Delta Attention purkaa miljoonan tokenin kontekstin yli kuusi kertaa nopeammin. Malli päihittää länsimallit useissa koodausbenchmarkeissa, ja teesi on selvä: Kiina kuroo kiinni arkkitehtuurilla, ei

Hanna Huulivuo
Muratin uusi malli myöntää: emme ole vahvin

Muratin uusi malli myöntää: emme ole vahvin

Mira Muratin Thinking Machines julkaisi ensimmäisen mallinsa. Inkling on avoin 975 miljardin parametrin MoE-malli, joka aktivoi kerrallaan vain 41 miljardia. Yhtiö myöntää suoraan, ettei se ole markkinoiden vahvin, vaan panostaa räätälöitävyyteen ja edullisuuteen.

Aino Aikajärvi
Kiina kielsi inhimilliset tekoälyagentit – länsi ei

Kiina kielsi inhimilliset tekoälyagentit – länsi ei

Kiinan uudet ihmismäisyyttä rajoittavat tekoälysäännöt astuivat voimaan 15. heinäkuuta. ByteDancen Doubao sulkee käyttäjien luomat agentit 345 miljoonalta käyttäjältä, kun taas lännessä agenttituotteet laajenevat ilman vastaavia rajoituksia.

Aino Aikajärvi
Pieni malli päihittää kolme kertaa suuremmat

Pieni malli päihittää kolme kertaa suuremmat

Valikoivan aktivointiharvennuksen menetelmä opettaa mallin käyttämään vain tehtävään olennaisia parametreja. Blogitiedon mukaan näin koulutetut mallit yltävät päättelyssä kolme kertaa suurempien tasolle, mikä voisi laskea ajokustannuksia. Alkuperäistä ICML-julkaisua ei ole vielä vahvistettu.

Nelli Nelisanoma
Meta haluaa eroon Nvidiasta – oma Iris-siru tuotantoon syyskuussa

Meta haluaa eroon Nvidiasta – oma Iris-siru tuotantoon syyskuussa

Meta aloittaa syyskuussa oman Iris-datakeskussirunsa valmistuksen. Broadcomin kanssa suunniteltu ja TSMC:llä valmistettava siru on yhtiön kovin yritys tähän asti vähentää riippuvuuttaan Nvidian ja AMD:n grafiikkasiruista. Tavoitteena on 14 gigawattia laskentatehoa vuoteen 2027 mennessä.

Aino Aikajärvi
Claudella on pieni työtila – ja se voi paljastaa valheet

Claudella on pieni työtila – ja se voi paljastaa valheet

Anthropicin uusi J-lens-menetelmä paljasti Claude-mallista pienen sisäisen työtilan, jossa on kerrallaan vain 10–25 käsitettä. Se muistuttaa kognitiotieteen globaalin työtilan teoriaa ja voisi auttaa havaitsemaan mallien piilotavoitteet ja valehtelun.

Hanna Huulivuo
Nvidia rakensi lännen älykkäimmän avomallin – Kiina johtaa silti

Nvidia rakensi lännen älykkäimmän avomallin – Kiina johtaa silti

Nvidia julkaisi Nemotron 3 Ultran, jota se kuvaa älykkäimmäksi yhdysvaltalaisen labran avoimen painon malliksi. 47,7 pistettä Artificial Analysis -indeksissä jättää muut länsimaiset avomallit taakse, mutta kiinalainen Kimi K2.6 johtaa avomallien kärkeä yhä selvästi.

Hanna Huulivuo
Metan uusi agenttimalli maksaa neljäsosan kilpailijoista

Metan uusi agenttimalli maksaa neljäsosan kilpailijoista

Meta julkaisi 9. heinäkuuta agenttimallin Muse Spark 1.1, joka veloittaa 1,25 ja 4,25 dollaria miljoonalta tokenilta – noin neljäsosan kilpailijoiden hinnasta. Samalla yhtiö avasi ensimmäistä kertaa maksullisen Meta Model API:n kehittäjille.

Aino Aikajärvi
GLM-5.2 löi GPT-5.5:n ilman ainuttakaan Nvidian sirua

GLM-5.2 löi GPT-5.5:n ilman ainuttakaan Nvidian sirua

Kiinalaisen Z.ai:n avoin 753 miljardin parametrin GLM-5.2 päihittää GPT-5.5:n useissa koodauksen kestotesteissä ja yltää lähelle Opus 4.8:aa. Malli on koulutettu ilman Nvidian siruja ja julkaistu MIT-lisenssillä, mikä painaa länsimallien hinnoittelua alaspäin.

Hanna Huulivuo
LongCat-2.0 hiipi kärkeen nimellä 'Owl Alpha'

LongCat-2.0 hiipi kärkeen nimellä 'Owl Alpha'

OpenRouteriin ilmestyi kesäkuussa nimetön koodausmalli 'Owl Alpha', joka kiipesi kärkeen. Nyt paljastui, että kyseessä oli Meituanin avoin LongCat-2.0: 1,6 biljoonaa parametria, 59,5 % SWE-bench Pro:ssa ja koulutus kokonaan kiinalaisilla ASIC-siruilla.

Hanna Huulivuo
Claude Mythos kiilasi kärkeen testissä, joka nujertaa tohtorit

Claude Mythos kiilasi kärkeen testissä, joka nujertaa tohtorit

Anthropicin Claude Mythos Preview kiilasi GPQA Diamond -testin kärkeen 94,6 prosentilla, mutta ero Gemini 3.1 Prohon on vain kolmasosa prosenttiyksikköä. Grok 4.1 johtaa laajempaa yhdistelmämittaria. Miksi juuri tämä testi erottelee huippumallit, ja mitä luvut jättävät kertomatta?

Hanna Huulivuo