Tekoäly-yhtiö Anthropic on lähettänyt Yhdysvaltain senaatin pankkivaliokunnalle kirjeen, jossa se syyttää kiinalaista Alibabaa Claude-tekoälymallinsa järjestelmällisestä kopioinnista. Yhtiön mukaan Alibaban Qwen-tiimiin kytköksissä olevat toimijat avasivat lähes 25 000 valetiliä ja tekivät niiden kautta 28,8 miljoonaa kyselyä huhtikuun 22. ja kesäkuun 5. päivän välillä 2026.
Kirje on päivätty 10. kesäkuuta ja osoitettu valiokunnan johdolle, senaattoreille Tim Scottille ja Elizabeth Warrenille. Anthropic kuvaa tapausta suurimmaksi tiedossa olevaksi Clauden kopiointiyritykseksi. Tarkoituksena oli yhtiön mukaan niin sanottu mallin tislaus.
Mikä on mallin tislaus?
Tislaus (distillation) on tekoälyalalla vakiintunut tekniikka. Siinä pienempää oppilasmallia opetetaan suuremman opettajamallin vastauksilla. Käytännössä opettajamallille syötetään valtava määrä kysymyksiä, ja sen antamat vastaukset tallennetaan. Näistä vastauksista kootaan opetusaineisto, jonka avulla oppilasmalli oppii matkimaan opettajan käytöstä murto-osalla alkuperäisestä kehitystyöstä.
Juuri tähän 25 000 valetiliä ja 28,8 miljoonaa kyselyä viittaavat. Yksittäinen tili törmäisi nopeasti käyttörajoituksiin, joten kyselyt hajautettiin tuhansille tileille ja välityspalvelimille, jottei toiminta herättäisi huomiota. Lopputuloksena on opetusaineisto, joka kattaa kymmeniä miljoonia Clauden vastauksia, eräänlainen varjokopio mallin osaamisesta.
Vertauskuvallisesti kyse on siitä, että joku kopioisi mestarin vastaukset tuhansiin koekysymyksiin ja kouluttaisi niillä oman vastineensa. Anthropicin käyttöehdot kieltävät nimenomaisesti mallin tuotosten käytön kilpailevan tekoälyn opettamiseen.
Suurin tapaus, mutta ei ensimmäinen
Mallivarkauskiistat eivät ole uusia. Alkuvuonna 2025 OpenAI ja Microsoft epäilivät kiinalaista DeepSeekiä OpenAI:n mallien tislaamisesta vastaavalla tavalla. Kiista jäi tuolloin pitkälti väitteiden tasolle, eikä julkista näyttöä esitetty samassa mitassa.
Anthropicin kirje vie asian uudelle tasolle, koska siinä esitetään konkreettisia lukuja ja tarkka ajankohta. Sanavalinnat ovat poikkeuksellisen suoria.
“Toimijat avasivat röyhkeästi ja laittomasti lähes 25 000 valetiliä kopioidakseen malliemme kyvyt.”
Miksi tämä koskee suomalaisyrityksiä?
Alibaban Qwen-mallit ovat avoimen lähdekoodin malleja, ja niitä käytetään laajasti myös Suomessa. Moni kotimainen ohjelmistoyritys ja startup rakentaa tuotteitaan Qwenin varaan, koska avoimet mallit ovat ilmaisia ja niitä voi ajaa omilla palvelimilla ilman riippuvuutta amerikkalaisista pilvipalveluista.
Jos Anthropicin syytökset pitävät paikkansa, ne nostavat esiin kysymyksen siitä, mille pohjalle nämä mallit on rakennettu. Yritykselle, joka on valinnut Qwenin tietosuojan tai kustannusten vuoksi, riski on ennen kaikkea maineellinen ja juridinen: mallin taustalla saattaa olla kiistanalaista opetusaineistoa, ja sääntely-ympäristö voi muuttua nopeasti, jos Yhdysvallat alkaa rajoittaa kiinalaisten mallien käyttöä.
Tämä ei tarkoita, että Qwenin käyttö pitäisi lopettaa. Se kannattaa kuitenkin tehdä tietoisena riskeistä ja seuraten, miten kiista etenee.



