Kolme yhtiötä, 24 000 valetiliä
Anthropic julkaisi maanantaina raportin, joka paljastaa teollisen mittakaavan tietovarkausoperaation. Yhtiön mukaan kolme kiinalaista tekoäly-yhtiötä – DeepSeek, Moonshot AI ja MiniMax – loi noin 24 000 valetiliä ja käytti niitä yli 16 miljoonan vastauksen poimimiseen Claude-tekoälymallilta. Kyseessä on laajin julkisuuteen tullut tislausyritys tekoälyalalla.
Tislaus tarkoittaa menetelmää, jossa toisen tekoälymallin vastauksia käytetään oman mallin kouluttamiseen. Käytännössä kiinalaisyhtiöt automatisoivat pitkiä, yksityiskohtaisia keskusteluja Clauden kanssa ja syöttivät vastaukset omien malliensa harjoitusdataksi. Menetelmällä pienemmästä mallista saadaan suuremman mallin kyvykkyyksiä murto-osalla alkuperäisestä kehitystyöstä ja kustannuksista.
MiniMax vei leijonanosan
Anthropicin raportti osoittaa, että kolmen yhtiön operaatiot erosivat toisistaan merkittävästi. MiniMax oli ylivoimaisesti aktiivisin: yhtiön tileiltä kertyi yli 13 miljoonaa keskustelua, jotka kohdistuivat Clauden itsenäiseen koodaukseen ja työkalujen käyttöön.
Moonshot AI:n osuus oli 3,4 miljoonaa keskustelua. Ne keskittyivät itsenäiseen päättelyyn, koodaukseen, data-analyysiin ja konenäköön. DeepSeekin kampanja oli määrällisesti pienin – yli 150 000 keskustelua – mutta strategisesti kiinnostava: yhtiö pyrki erityisesti parantamaan mallinsa päättelykykyä ja kehittämään sensuuriturvallisia vaihtoehtoja poliittisesti arkaluontoisiin kysymyksiin.
Kaikki kolme yhtiötä kiersivät Clauden maarajoitukset kaupallisten välityspalveluiden avulla. Anthropic kuvailee operaatiota hydra-klusteriksi – laajaksi verkostoksi, jossa kymmenettuhannet tilit toimivat samanaikaisesti eri API-avaimilla ja pilvipalveluntarjoajilla. Yksi verkosto hallinnoi yli 20 000 tiliä yhtäaikaisesti. Tislausliikenne sekoitettiin tavallisiin kyselyihin, mikä vaikeutti havaitsemista.
Anthropic kertoo tunnistaneensa hyökkäykset IP-osoitteiden korrelaation, pyyntömetadatan ja käyttäytymisprofiloinnin avulla. Yhtiö on sulkenut tunnetut tunkeutumisreitit ja lisännyt mallitason suojauksia, jotka heikentävät tislauksen tehokkuutta.
“Vientirajoitukset ovat tehokkaimpia keinojamme estää tämä kehitys.”
Yhdysvaltalainen rintama tiivistyy
Anthropicin paljastus ei tule tyhjästä. OpenAI esitti vastaavat syytökset jo 12. helmikuuta muistiossaan Yhdysvaltain edustajainhuoneen Kiina-valiokunnalle. OpenAI:n mukaan DeepSeekin työntekijöihin yhdistetyt tilit kehittivät menetelmiä pääsyrajoitusten kiertämiseksi ja mallien vastausten automaattiseen poimimiseen. Kahden suurimman yhdysvaltalaisen tekoäly-yhtiön samanaikaiset syytökset viittaavat koordinoituun vastaiskuun.
Mittakaavan hahmottamiseksi vertailukohta on paikallaan. Google havaitsi aiemmin tänä vuonna yli 100 000 promptin tislausyrityksen Gemini-malliaan vastaan, mikä herätti tuolloin huolta. Anthropicin paljastamat luvut ovat aivan eri luokkaa: 16 miljoonaa vastausta on 160-kertainen määrä.



