Tekoäly

Claudelta varastettiin 16 miljoonaa vastausta

Kolme kiinalaista tekoäly-yhtiötä ja 24 000 valetiliä.

Aino AikajärviAino Aikajärvi
Jaa:
Claudelta varastettiin 16 miljoonaa vastausta

Kolme yhtiötä, 24 000 valetiliä

Anthropic julkaisi maanantaina raportin, joka paljastaa teollisen mittakaavan tietovarkausoperaation. Yhtiön mukaan kolme kiinalaista tekoäly-yhtiötä – DeepSeek, Moonshot AI ja MiniMax – loi noin 24 000 valetiliä ja käytti niitä yli 16 miljoonan vastauksen poimimiseen Claude-tekoälymallilta. Kyseessä on laajin julkisuuteen tullut tislausyritys tekoälyalalla.

Tislaus tarkoittaa menetelmää, jossa toisen tekoälymallin vastauksia käytetään oman mallin kouluttamiseen. Käytännössä kiinalaisyhtiöt automatisoivat pitkiä, yksityiskohtaisia keskusteluja Clauden kanssa ja syöttivät vastaukset omien malliensa harjoitusdataksi. Menetelmällä pienemmästä mallista saadaan suuremman mallin kyvykkyyksiä murto-osalla alkuperäisestä kehitystyöstä ja kustannuksista.

MiniMax vei leijonanosan

Anthropicin raportti osoittaa, että kolmen yhtiön operaatiot erosivat toisistaan merkittävästi. MiniMax oli ylivoimaisesti aktiivisin: yhtiön tileiltä kertyi yli 13 miljoonaa keskustelua, jotka kohdistuivat Clauden itsenäiseen koodaukseen ja työkalujen käyttöön.

Moonshot AI:n osuus oli 3,4 miljoonaa keskustelua. Ne keskittyivät itsenäiseen päättelyyn, koodaukseen, data-analyysiin ja konenäköön. DeepSeekin kampanja oli määrällisesti pienin – yli 150 000 keskustelua – mutta strategisesti kiinnostava: yhtiö pyrki erityisesti parantamaan mallinsa päättelykykyä ja kehittämään sensuuriturvallisia vaihtoehtoja poliittisesti arkaluontoisiin kysymyksiin.

Kaikki kolme yhtiötä kiersivät Clauden maarajoitukset kaupallisten välityspalveluiden avulla. Anthropic kuvailee operaatiota hydra-klusteriksi – laajaksi verkostoksi, jossa kymmenettuhannet tilit toimivat samanaikaisesti eri API-avaimilla ja pilvipalveluntarjoajilla. Yksi verkosto hallinnoi yli 20 000 tiliä yhtäaikaisesti. Tislausliikenne sekoitettiin tavallisiin kyselyihin, mikä vaikeutti havaitsemista.

Anthropic kertoo tunnistaneensa hyökkäykset IP-osoitteiden korrelaation, pyyntömetadatan ja käyttäytymisprofiloinnin avulla. Yhtiö on sulkenut tunnetut tunkeutumisreitit ja lisännyt mallitason suojauksia, jotka heikentävät tislauksen tehokkuutta.

“Vientirajoitukset ovat tehokkaimpia keinojamme estää tämä kehitys.”

— Dario Amodei, Anthropicin toimitusjohtaja

Yhdysvaltalainen rintama tiivistyy

Anthropicin paljastus ei tule tyhjästä. OpenAI esitti vastaavat syytökset jo 12. helmikuuta muistiossaan Yhdysvaltain edustajainhuoneen Kiina-valiokunnalle. OpenAI:n mukaan DeepSeekin työntekijöihin yhdistetyt tilit kehittivät menetelmiä pääsyrajoitusten kiertämiseksi ja mallien vastausten automaattiseen poimimiseen. Kahden suurimman yhdysvaltalaisen tekoäly-yhtiön samanaikaiset syytökset viittaavat koordinoituun vastaiskuun.

Mittakaavan hahmottamiseksi vertailukohta on paikallaan. Google havaitsi aiemmin tänä vuonna yli 100 000 promptin tislausyrityksen Gemini-malliaan vastaan, mikä herätti tuolloin huolta. Anthropicin paljastamat luvut ovat aivan eri luokkaa: 16 miljoonaa vastausta on 160-kertainen määrä.

16 milj.+

Varastettua vastausta

~24 000

Valetiliä

160×

Enemmän kuin Googlen tapaus

Anthropic, 2026

Geopolitiikkaa ja epämukavaa symmetriaa

Syytösten ajoitus ei ole sattumaa. Yhdysvalloissa käydään kiivasta keskustelua tekoälysirujen vientirajoituksista Kiinaan, ja Dario Amodei on kutsuttu Pentagoniin keskustelemaan Clauden sotilaskäytöstä. Tapaamista on kuvattu jännitteiseksi. Amodei on kirjoittanut henkilökohtaisessa esseessään, että kiinalaisyhtiöt ovat "autoritaarisen hallituksen alaisia" ja vientirajoitukset ovat "tehokkaimpia keinoja" teknologian väärinkäytön estämiseksi.

Anthropic kehystää tislausoperaatiot kansallisen turvallisuuden uhkaksi. Yhtiön mukaan ilman turvarajoitteita tislatut mallit voivat päätyä kyberoperaatioihin, disinformaatiokampanjoihin ja massavalvontaan. Väitteet ovat vakavia, mutta kuva ei ole mustavalkoinen. Anthropic itse sopi viime vuonna 1,5 miljardin dollarin tekijänoikeuskanteen kirjojen luvattomasta käytöstä koulutusdatana. Kriitikot ovat huomauttaneet "epämukavasta symmetriasta" – yhdysvaltalaisten tekoäly-yhtiöiden oma suhde koulutusaineistojen tekijänoikeuksiin on kaikkea muuta kuin yksinkertainen.

Suomalaisille tekoälyä hyödyntäville yrityksille tapaus on konkreettinen muistutus siitä, miten geopolitiikka vaikuttaa tekoälypalveluiden arkeen. Jos Yhdysvallat laajentaa vientirajoitukset siruista tekoälypalveluihin, vaikutukset voivat näkyä API-hinnoissa ja saatavuudessa myös Euroopassa. Tekoälymallien toimitusketju on pidempi ja haavoittuvampi kuin moni käyttäjä ymmärtää.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  4. 4Datakeskukset Suomessa – hankkeet, sähkö ja vero
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.