Federal Registerin hakusivulla oli viisi tapaa etsiä asiakirjoja. Yksi niistä oli merkitty tekoälyhauksi. Sen alla pyöri Qwen3:0.6B, Alibaban julkaisema avoimen painon kielimalli, ja vaihtoehto oli valittavissa vielä keskiviikkona 16. syyskuuta. Samana päivänä se katosi, kun somepostaukset löydöstä alkoivat levitä.
Federal Register on Yhdysvaltain virallinen säädösrekisteri. Sitä ylläpitää kansallisarkisto NARA, ja siellä julkaistaan asetusluonnokset sekä niihin jätetyt lausunnot. Sisältö on julkista jo lähtökohtaisesti, joten salaisesta aineistosta ei ollut kyse.
Ajoitus teki tapauksesta kiusallisen. Viikkoa aiemmin, 10. syyskuuta, FBI oli yhdessä NSA:n ja CISA:n kanssa nimennyt kuusi kiinalaista tekoäly-yhtiötä, jotka viranomaisten mukaan kopioivat yhdysvaltalaisia huippumalleja teollisessa mittakaavassa. Alibaba oli listalla. FBI:n käyttämä sana oli malicious, haitallinen.
Väitteet nojaavat pitkälti Anthropicin samana päivänä julkaisemaan raporttiin. Sen mukaan Alibabaan yhdistetty kampanja kävi Clauden kanssa noin 151 miljoonaa vuoropuhelua touko-heinäkuussa 2026, noin 3 500 tilin kautta, ja huipputahti oli lähes kolme miljoonaa vuoropuhelua päivässä. Luvut ovat Anthropicin omia, eikä niille ole riippumatonta vahvistusta. Alibaba ei ole kommentoinut syytöksiä julkisuudessa.
“Se on yksi hullummista asioista, mitä olen koskaan nähnyt.”
Kyse ei ole siitä, mitä malli olisi voinut viedä. Qwen3:0.6B on pieni malli, jonka painot Alibaba julkaisi Apache 2.0 -lisenssillä. Kuka tahansa voi ladata sen ja ajaa sitä omalla palvelimellaan. Federal Registerillä se järjesti hakutuloksia paikallisesti eikä toiminut pilvipalveluna, eli mikään ei viittaa siihen että hakuja olisi lähetetty Alibaban palvelimille.
Senaatin tiedustelukomitean varapuheenjohtaja, demokraattisenaattori Mark Warner Virginiasta sitoi riskin arvioinnin siihen, poistuiko yhdysvaltalaista dataa hallinnon turvarajan sisältä. Georgetownin oikeustieteen professori Anupam Chander arvioi, että julkista aineistoa käsittelevän haun välitön tietoturvariski on pieni. Arvio riippuu hänen mukaansa siitä, miten malli on koulutettu.
“Yhdenkään liittovaltion viranomaisen ei pitäisi käyttää kiinalaista tekoälymallia.”
Kiinnostavin osa tapausta on se, mitä kukaan ei osaa kertoa. Julkisuudessa ei ole tietoa siitä, kuka mallin sinne laittoi ja millä päätöksellä. Urakoitsijaa ei ole nimetty. Kansallisarkisto ja Valkoinen talo eivät vastanneet toimittajien kysymyksiin, FBI kieltäytyi kommentoimasta ja Kiinan suurlähetystö kutsui syytöksiä perusteettomiksi.
Avoimen painon malli ei kulje hankintaprosessin läpi samalla tavalla kuin ostettu ohjelmisto. Se on tiedosto. Kehittäjä lataa sen mallikirjastosta ja liittää järjestelmään kuten minkä tahansa muun ilmaisen komponentin, eikä siitä synny sopimusta, toimittajarekisterin riviä tai päätöspöytäkirjaa, josta jälkikäteen näkisi kuka valinnan teki.
Väite ja todennettu tieto
Väite: FBI ja Anthropic katsovat, että Alibaba on kopioinut Anthropicin mallien osaamista laajamittaisesti. Alibaba ei ole vastannut syytökseen, eikä asiaa ole käsitelty tuomioistuimessa.
Todennettu: Federal Registerin hakusivulla oli valittavissa Qwen-malliin perustuva hakutapa, ja se poistui sivustolta 16. syyskuuta. Tietomurrosta tai tietojen siirtymisestä Kiinaan ei ole raportoitu.
Syytös ensin, virasto vasta sen jälkeen
2026-09-10
Anthropic kertoo tislauskampanjoista
Yhtiö nimeää raportissaan Alibaban, Moonshot AI:n ja DeepSeekin. FBI, NSA ja CISA listaavat kuusi kiinalaista tekoäly-yhtiötä.
2026-09-16
Qwen-hakuvaihtoehto näkyvissä säädösrekisterissä
Yhdysvaltain virallisen säädösrekisterin hakusivulla saattoi valita hakutavan, joka pyöri Alibaban Qwen-mallilla.
2026-09-17
Reuters kertoo asiasta, vaihtoehto poistuu
Hakutapa katosi sivulta ilman tiedotetta. Kukaan ei kerro kuka sen lisäsi tai poisti.
6
FBI:n, NSA:n ja CISA:n nimeämää kiinalaista tekoäly-yhtiötä, Alibaba yksi niistä
151 milj.
Vuoropuhelua Clauden kanssa touko–heinäkuussa 2026, joita Anthropic pitää tislausyrityksinä
Suomessa vastaavaa listaa ei näytä olevan. AI Suomi haki tietoa siitä, mitkä kielimallit pyörittävät valtion virastojen tekoälytoimintoja, eikä löytänyt julkista koontia yhdestäkään lähteestä. Valtiovarainministeriö käynnisti maaliskuussa 2026 kymmenen miljoonan euron tekoälyinvestointiohjelman ja koordinoi generatiivisen tekoälyn verkostoa vuosille 2026–2028, mutta kummankaan yhteydessä ei julkaista mallikohtaista luetteloa.
Poikkeus löytyy kuntapuolelta. Helsingin kaupungin tekoälyrekisteri kertoo järjestelmäkohtaisesti, minkä tekniikan päällä palvelu toimii, esimerkiksi urheilubotti Urhon kohdalla mainitaan IBM:n Watson Assistant. Valtionhallinnossa vastaavaa ikkunaa ei ole. Sitran ja The Agentic Staten syyskuinen selvitys 109 julkisesta organisaatiosta päätyi siihen, että tekniikka ei ole enää este tekoälyagenttien käytölle. Jos este on poistunut, kysymys konepellin alla pyörivästä mallista muuttuu käytännölliseksi.
Tavallisen ihmisen kannalta kyse on siitä, kuka lukee hänen paperinsa. Kun lausunto asetusluonnokseen, verovalitus tai etuushakemus kulkee järjestelmän läpi, jossain kohtaa sitä käsittelee malli. Mallilla on tekijä, koulutusaineisto ja käyttöehdot. Jos viranomainen ei osaa vastata kysymykseen siitä mikä malli, se ei osaa vastata myöskään kysymykseen siitä miksi hakemus käsiteltiin juuri näin.
Alkuperämaa on huono suodatin. Painot ovat tiedostoja, ne kopioituvat ja niistä tehdään muunnelmia, eikä ladatusta mallista näe päältä kenen käsialaa se on. Toimivampi vaatimus olisi tylsempi: jokaisesta julkisen sektorin tekoälytoiminnosta pitäisi löytyä kirjaus siitä mikä malli, mistä ladattu, milloin ja kenen päätöksellä. Federal Registerin tapauksessa sellaista kirjausta ei näytä olleen, ja siksi vaihtoehdon poistaminen valikosta kävi helpommin kuin sen selittäminen.
Sanasto
Avoimen painon malli
Tekoälymalli, jonka opetuksessa syntyneet lukuarvot eli painot on julkaistu vapaasti ladattaviksi. Kuka tahansa voi ajaa mallia omalla koneellaan ilman yhteyttä sen tehneeseen yhtiöön.
Tislaus (distillation)
Menetelmä, jossa uutta mallia opetetaan toisen, valmiin mallin vastauksilla. Näin osa suuren mallin osaamisesta siirtyy halvemmalla uuteen malliin.
Apache 2.0 -lisenssi
Yleinen avoimen lähdekoodin käyttöehto, joka sallii ohjelman tai mallin vapaan käytön, muokkaamisen ja jakelun myös kaupallisesti.
Viikoittainen uutiskirje
Tule firmasi fiksuimmaksi AI-osaajaksi
Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.