Sirut Kaakkois-Aasiasta Sisä-Mongoliaan
Yhdysvaltain hallinnon korkea-arvoinen virkamies vahvisti 23. helmikuuta, että kiinalainen tekoäly-yhtiö DeepSeek on kouluttanut tulevan tekoälymallinsa Nvidian Blackwell-siruilla. Kyseessä ovat Nvidian uusimmat ja tehokkaimmat tekoälysirut, ja niiden vienti Kiinaan on kielletty Yhdysvaltain kauppaministeriön vientirajoituksilla. Reuters uutisoi virkamiehen lausunnon ensimmäisenä.
Virkamiehen mukaan Blackwell-sirut sijaitsevat todennäköisesti DeepSeekin datakeskuksessa Sisä-Mongoliassa, Kiinan pohjoisosassa sijaitsevalla autonomisella alueella. DeepSeekin odotetaan julkaisevan uuden mallinsa jo ensi viikolla. Viranomaisten mukaan yhtiö aikoo poistaa tekniset tunnisteet, jotka voisivat paljastaa amerikkalaisten sirujen käytön.
Miten kiellettyjä siruja päätyy Kiinaan? The Decoderin ja The Informationin aiempien tietojen mukaan operaatio toimii monivaiheisesti. Ensin sirut toimitetaan laillisesti datakeskuksiin Kaakkois-Aasiassa, missä Nvidian kumppanit asentavat ja testaavat ne tavanomaiseen tapaan. Asennuksen ja hyväksynnän jälkeen palvelimet puretaan osiin, ja näytönohjaimet kuljetetaan Kiinaan tullin läpi väärin perustein. Operaatiossa käytetään pienikokoisia kahdeksan sirun palvelimia, jotka ovat helpompia siirtää huomaamatta kuin suuret palvelinkaapistot.
Nvidia on kutsunut raportteja haamudatakeskuksista "kaukaa haetuksi" eikä ole yhtiön mukaan löytänyt niistä todisteita. Samalla Nvidia on kuitenkin myöntänyt seuraavansa aktiivisesti salakuljetusraportteja ja kehittävänsä järjestelmää, jolla Blackwell-sirujen fyysistä sijaintia voidaan jäljittää niiden koko elinkaaren ajan.
Miksi Blackwell-sirut ovat niin haluttuja?
Nvidian Blackwell-arkkitehtuuri (B200) on selvä harppaus edelliseen Hopper-sukupolveen nähden. Piiri sisältää 208 miljardia transistoria – yli 2,5-kertainen määrä H100-piiriin verrattuna. Muistikapasiteetti on 192 gigatavua (H100: 80 Gt) ja muistikaista 8 teratavua sekunnissa. Käytännössä tekoälymallien koulutus on Blackwellillä jopa 2,2 kertaa nopeampaa kuin H100:lla. Piiri tukee myös harvan huomion (sparse attention) -tekniikkaa, jota juuri DeepSeek hyödyntää laskennan tehostamiseen. Vanhemmilla siruilla sama työ vaatisi moninkertaisen määrän laitteistoa.
Valetilien armeija ja teollinen tislaus
Sirujen salakuljetus ei ole ainoa DeepSeekiin kohdistuva syytös. Anthropic ilmoitti 23. helmikuuta havainneensa "teollisen mittakaavan tislaus-hyökkäyksiä" kolmen kiinalaisyhtiön toimesta. Anthropicin mukaan DeepSeek, MiniMax ja Moonshot AI loivat yhteensä yli 24 000 valetiliä ja kävivät yli 16 miljoonaa keskustelua Claude-mallin kanssa tarkoituksenaan siirtää mallin osaaminen omiin järjestelmiinsä.
Tislaus on tekniikka, jossa pienempi tekoälymalli oppii jäljittelemään suuremman mallin kykyjä analysoimalla sen tuottamia vastauksia. Menetelmä on sinänsä yleinen – tekoäly-yhtiöt käyttävät sitä rutiininomaisesti omien malliensa keventämiseen. Ongelma syntyy, kun sitä sovelletaan kilpailijan malleihin ilman lupaa ja valtavassa mittakaavassa.
MiniMax ajoi suurimman liikenteen, yli 13 miljoonaa keskustelua. Yhtiö reagoi Anthropicin uuteen malliversioon alle vuorokaudessa ohjaamalla puolet liikenteestään uuteen kohteeseen. Moonshot AI:n osuus oli 3,4 miljoonaa keskustelua. DeepSeekin osuus oli pienin, noin 150 000 keskustelua, mutta Anthropicin mukaan ne kohdistuivat tarkkaan mallin peruslogiikkaan ja sensitiivisten aiheiden käsittelyyn.
OpenAI on esittänyt omia syytöksiään. Yhtiö ilmoitti Yhdysvaltain lainsäätäjille havainneensa "jatkuvia yrityksiä tislata eturintaman malleja" DeepSeekin toimesta. OpenAI:n mukaan menetelmät ovat kehittyneet vuodessa huomattavasti: pelkästä vastausten kopioinnista on siirrytty monivaiheisiin operaatioihin, joihin kuuluu synteettisen datan tuottamista ja laajamittaista datan siivoamista.



