Google julkaisi Gemini 3.5 Pron 17. heinäkuuta kolmen myöhästymisen jälkeen. DeepMind rakensi mallin käytännössä uudelleen luotettavuusongelmien ja hallusinaatioiden takia. Lopputulos tuli myöhässä ja ilman selkeää etumatkaa GPT-5.6:een. Jäikö Gemini kilpailijan jalkoihin?
Kiinalainen Moonshot AI julkaisi Kimi K3:n, 2,8 biljoonan parametrin avoimen MoE-mallin. Uusi Kimi Delta Attention purkaa miljoonan tokenin kontekstin yli kuusi kertaa nopeammin. Malli päihittää länsimallit useissa koodausbenchmarkeissa, ja teesi on selvä: Kiina kuroo kiinni arkkitehtuurilla, ei
Mira Muratin Thinking Machines julkaisi ensimmäisen mallinsa. Inkling on avoin 975 miljardin parametrin MoE-malli, joka aktivoi kerrallaan vain 41 miljardia. Yhtiö myöntää suoraan, ettei se ole markkinoiden vahvin, vaan panostaa räätälöitävyyteen ja edullisuuteen.
Kiinan uudet ihmismäisyyttä rajoittavat tekoälysäännöt astuivat voimaan 15. heinäkuuta. ByteDancen Doubao sulkee käyttäjien luomat agentit 345 miljoonalta käyttäjältä, kun taas lännessä agenttituotteet laajenevat ilman vastaavia rajoituksia.
Valikoivan aktivointiharvennuksen menetelmä opettaa mallin käyttämään vain tehtävään olennaisia parametreja. Blogitiedon mukaan näin koulutetut mallit yltävät päättelyssä kolme kertaa suurempien tasolle, mikä voisi laskea ajokustannuksia. Alkuperäistä ICML-julkaisua ei ole vielä vahvistettu.
Meta aloittaa syyskuussa oman Iris-datakeskussirunsa valmistuksen. Broadcomin kanssa suunniteltu ja TSMC:llä valmistettava siru on yhtiön kovin yritys tähän asti vähentää riippuvuuttaan Nvidian ja AMD:n grafiikkasiruista. Tavoitteena on 14 gigawattia laskentatehoa vuoteen 2027 mennessä.
Anthropicin uusi J-lens-menetelmä paljasti Claude-mallista pienen sisäisen työtilan, jossa on kerrallaan vain 10–25 käsitettä. Se muistuttaa kognitiotieteen globaalin työtilan teoriaa ja voisi auttaa havaitsemaan mallien piilotavoitteet ja valehtelun.
Nvidia julkaisi Nemotron 3 Ultran, jota se kuvaa älykkäimmäksi yhdysvaltalaisen labran avoimen painon malliksi. 47,7 pistettä Artificial Analysis -indeksissä jättää muut länsimaiset avomallit taakse, mutta kiinalainen Kimi K2.6 johtaa avomallien kärkeä yhä selvästi.
Meta julkaisi 9. heinäkuuta agenttimallin Muse Spark 1.1, joka veloittaa 1,25 ja 4,25 dollaria miljoonalta tokenilta – noin neljäsosan kilpailijoiden hinnasta. Samalla yhtiö avasi ensimmäistä kertaa maksullisen Meta Model API:n kehittäjille.
Kiinalaisen Z.ai:n avoin 753 miljardin parametrin GLM-5.2 päihittää GPT-5.5:n useissa koodauksen kestotesteissä ja yltää lähelle Opus 4.8:aa. Malli on koulutettu ilman Nvidian siruja ja julkaistu MIT-lisenssillä, mikä painaa länsimallien hinnoittelua alaspäin.
OpenRouteriin ilmestyi kesäkuussa nimetön koodausmalli 'Owl Alpha', joka kiipesi kärkeen. Nyt paljastui, että kyseessä oli Meituanin avoin LongCat-2.0: 1,6 biljoonaa parametria, 59,5 % SWE-bench Pro:ssa ja koulutus kokonaan kiinalaisilla ASIC-siruilla.
Anthropicin Claude Mythos Preview kiilasi GPQA Diamond -testin kärkeen 94,6 prosentilla, mutta ero Gemini 3.1 Prohon on vain kolmasosa prosenttiyksikköä. Grok 4.1 johtaa laajempaa yhdistelmämittaria. Miksi juuri tämä testi erottelee huippumallit, ja mitä luvut jättävät kertomatta?