Britannian AI Security Institute (AISI) on julkaissut tulokset Anthropicin Claude Mythos Preview -mallin kyberkyvyistä. Toukokuun puolivälissä päivittyneessä raportissa malli ratkaisi The Last Ones -nimisen 32-askeleen yritysverkkohyökkäyksen kuusi kertaa kymmenestä. Ihmisammattilaiselta vastaavan tunkeutumisen suorittaminen veisi AISI:n arvion mukaan noin 20 tuntia.
Testimetodiikka kolmessa kerroksessa
AISI:n testi koostuu kolmesta tasosta. Ensimmäisellä tasolla mallia kysellään suoraan kyberturvallisuuteen liittyviä kysymyksiä. Toisella tasolla mallin on selvitettävä capture-the-flag -tyyppisiä haasteita, joissa piilotettu tieto on löydettävä haavoittuvasta ympäristöstä. Mythos selvisi asiantuntijatason CTF-tehtävistä 73 prosentin osumatarkkuudella, vaikka huhtikuussa 2025 yksikään malli ei vielä päässyt maaliin.
Kolmas taso on The Last Ones -simulaatio, joka kattaa neljä aliverkkoa ja noin 20 isäntäkonetta. Ketju alkaa tiedustelusta ja ulkoisesta kartoituksesta, etenee alkuhyökkäyksen kautta sisäänpääsyyn ja päättyy koko verkon haltuunottoon. Mallilla on käytössään jopa 100 miljoonan tokenin laskentabudjetti. Mythos suoritti aiemmissa testikierroksissa keskimäärin 22 vaihetta 32:sta. Seuraavaksi paras malli, Claude Opus 4.6, ylsi 16 vaiheeseen.
Cooling Tower vie testin teollisuusautomaatioon
Erikseen AISI rakensi Cooling Tower -nimisen seitsemän vaiheen skenaarion, jossa kohteena on teollisuusautomaation järjestelmä (operational technology, OT). Cooling Tower mallintaa tunkeutumista jäähdytystornin ohjauslogiikkaan ja prosessiparametrien ulkopuolista muuttamista. Mythos Preview ratkaisi testin kolme kertaa kymmenestä. Yksikään aiempi malli ei ollut päässyt maaliin.
AISI:n tutkijat huomauttavat, että malli juuttui yrityksissään aluksi IT-puolelle eikä niinkään itse OT-järjestelmään. Testiympäristöstä puuttuvat eläviä puolustajia, päätelaitteiden valvonta ja reaaliaikainen vasteryhmä. Tulokset kertovat siis siitä, mihin malli kykenee heikosti puolustettuja järjestelmiä vastaan, eivät siitä läpäiseekö se nykyaikaisen yritysverkon suojaukset.
Aikahorisontti tuplaantuu joka 4,7 kuukausi
Helmikuussa 2026 AISI arvioi, että edistyneimpien mallien 80 prosentin luotettavuudella mitattu kyber-aikahorisontti tuplaantuu 4,7 kuukauden välein 2,5 miljoonan tokenin budjetilla. Marraskuussa 2025 vastaava arvio oli 8 kuukautta. Tahti on siis miltei kaksinkertaistunut puolessa vuodessa.
Sama trendi näkyy METR-tutkimusyhdistyksen ohjelmistokehityksen mittauksissa. METR:n arvio ilman Mythosta on 4,2 kuukautta. Kun Mythos otetaan mukaan, luku tiivistyy neljään kuukauteen. AISI korostaa raportissaan epävarmuutta: vielä ei voi sanoa, onko kyseessä uusi pysyvä trendi vai vain poikkeama.
Jos 4,7 kuukauden tuplaantumistahti pitää, vuoden 2027 ensimmäisellä puoliskolla autonomiset mallit pystyisivät suorittamaan kyberhyökkäyksiä, jotka veisivät ihmisasiantuntijalta useita työpäiviä. Vuoden 2028 puolivälin tienoilla autonomisten kampanjoiden kesto venyisi jo useiden viikkojen pituiseksi. Käytännössä tämä tarkoittaisi kokonaisten hyökkäysketjujen ajamista ilman ihmisen jatkuvaa ohjausta.
Suomen huoltovarmuus uudessa kuvassa
Traficomin Kyberturvallisuuskeskus on nostanut tekoälyä hyödyntävät hyökkäykset osaksi vuosittaisen tilannekuvansa vakavimpia trendejä. Cooling Tower -testin tulos on suoraan rinnastettavissa siihen, mihin keskus on varautunut: vesilaitosten ohjausjärjestelmiin, sähkönsiirron automaatioon ja energiatuotannon SCADA-järjestelmiin kohdistuviin tunkeutumisiin.
Huoltovarmuuskeskuksen kannalta kysymys on konkreettinen. Fingridin kantaverkossa on kymmeniä sähköasemia, joiden valvonta- ja ohjausjärjestelmät yhdistyvät keskitettyihin valvomoihin. Suomen vesihuollossa on satoja vesilaitoksia, joista isoimmilla on automaattinen prosessiohjaus mutta pienillä rajallinen tietoturvabudjetti. Jos autonominen tekoäly oppii ajamaan koko hyökkäysketjun läpi yksin, hyökkäysten taloudellinen kynnys laskee selvästi.
Puolustuksen aikaikkuna kapenee
AISI:n raportti ei väitä, että nykyinen Mythos kaataisi Fingridin tai Helsingin Veden. Tutkijat painottavat, että testiympäristöstä puuttuu reaaliaikainen puolustus eikä päätelaitevalvontaa ole. Hälytyksiä tuottava päätelaitevalvonta on edelleen merkittävä este käytännön hyökkäykselle.
Trendin suunta on silti selkeä. Kun aikahorisontti tuplaantuu joka kvartaali, puolustuksen on uusittava työkalunsa samalla tahdilla. Suomessa tämä koskettaa erityisesti niitä toimijoita, jotka käyttävät vanhempaa OT-järjestelmäkalustoa: kunnallisia vesilaitoksia, kaukolämpöyhtiöitä ja keskisuurta teollisuutta.
Anthropic toimitti Mythos Preview -mallin AISI:n testattavaksi ennen julkaisua. Avoin tarkastus ennen tuotantokäyttöä on osa yhtiön sitoutumista Britannian ja Yhdysvaltojen turvallisuusvirastojen kanssa. Päätös voi luoda paineen muille mallikehittäjille tehdä samoin ja avata laajemman keskustelun siitä, kuinka kauan vapaaehtoinen testijärjestely riittää.
Onnistui 32-askeleen yritysverkkohyökkäyksessä
Asiantuntijatason CTF-tehtävien osumatarkkuus
Kyber-aikahorisontin tuplaantumisaika
Cooling Tower (OT-järjestelmä)



