Anthropic alkaa merkitä Clauden tuottaman tekstin piilotetulla vesileimalla. Kaikissa 2. elokuuta jälkeen julkaistuissa malleissa merkintä on mukana automaattisesti, ja yhtiön mukaan tuki laajenee myöhemmin myös vanhempiin malleihin.
Syy on EU:ssa. Tekoälysäädöksen läpinäkyvyyssäännöstö astui voimaan 2. elokuuta, ja se vaatii tekoälyn tuottaman tai muokkaaman sisällön merkitsemistä koneellisesti tunnistettavalla tavalla. Anthropic ei ole yksin. Samaan säännöstöön ovat sitoutuneet myös Google, Meta, Microsoft ja OpenAI, ja merkintöjä ovat ottaneet käyttöön esimerkiksi musiikkipalvelu Suno ja julkaisualusta Substack.
Merkintä tehdään mallitasolla. Se tarkoittaa, että leima on mukana riippumatta siitä, mistä Clauden tuotteesta teksti tulee: rajapinnasta, chatista, Claude Codesta, Claude Coworkista tai Claude Tagista. Käyttäjä ei voi kytkeä sitä pois asetuksista, koska merkintä syntyy jo siinä vaiheessa, kun malli valitsee sanansa.
Kaksi tekniikkaa, kaksi eri heikkoutta
Tiedostoissa Anthropic käyttää C2PA-standardia. Sen takana on Adoben, Googlen, Microsoftin, BBC:n ja OpenAI:n kaltaisten toimijoiden yhteenliittymä, ja periaate on yksinkertainen. Tiedostoon liitetään metatietoa siitä, mistä se on peräisin ja mitä sille on matkan varrella tehty. Yhteenliittymä itse vertaa merkintää pakkausselosteeseen.
Metatiedon ongelma on, että se on kiinni tiedostossa eikä sisällössä. Kuvakaappaus, muunnos toiseen tiedostomuotoon tai siirto alustalta toiselle voi pyyhkiä merkinnän pois. Tämän myöntää C2PA-yhteenliittymä omilla sivuillaan.
Pelkkä teksti on hankalampi tapaus, koska siihen ei voi ripustaa metatietoa. Leima piilotetaan itse sanavalintoihin. Kielimalli valitsee jokaisen sanan todennäköisyyksien perusteella, ja vesileimaus kallistaa noita todennäköisyyksiä hienovaraisesti tiettyyn suuntaan salaisen kaavan mukaan. Lukija ei huomaa mitään, mutta riittävän pitkästä pätkästä algoritmi pystyy laskemaan, kuinka todennäköisesti kaava on siellä tahallaan.
Mikä muuttui 2. elokuuta
EU:n tekoälysäädöksen läpinäkyvyyssäännöstö tuli voimaan 2.8.2026. Se velvoittaa merkitsemään tekoälyn tuottaman sisällön koneellisesti tunnistettavalla tavalla. Anthropicin uusissa malleissa merkintä on mukana automaattisesti, vanhempiin se luvataan jälkikäteen.
Mitä tapahtuu, kun opiskelija kopioi tekstin Wordiin
Leima seuraa mukana. Koska merkintä on tehty sanavalintoihin eikä leikepöydän muotoiluihin, se ei jää chattiin. Sama pätee, jos teksti liimataan sähköpostiin, oppimisalustalle tai blogialustan editoriin. Muotoilut katoavat, kaava ei.
Anthropicin oma muotoilu on kuitenkin huomattavan varovainen.
“Koska vesileima on osa tekstiä, se kulkee tekstin mukana, kun teksti kopioidaan muualle, ja saattaa säilyä osan muokkauksista.”
Ratkaiseva sana on saattaa. Kuinka paljon muokkausta merkinnän hävittämiseen tarvitaan, jää kertomatta. TechCrunch kysyi asiaa Anthropicilta eikä saanut vastausta ennen juttunsa julkaisua.
Tästä syntyy uudistuksen ristiriita. Opiskelija, joka liimaa vastauksen sellaisenaan tehtäväpalautukseen, kantaa leimaa mukanaan. Se, joka syöttää tekstin toiseen malliin uudelleenkirjoitettavaksi tai kirjoittaa jokaisen lauseen omin sanoin, ei todennäköisesti kanna. Sääntelijän vaatimus täyttyy, rehellinen käyttö tulee merkityksi, mutta tahallinen peittely menee yhä läpi. Juuri sen estämiseen merkintöjä on julkisuudessa perusteltu.
Kenelle leimasta on oikeasti hyötyä
Tavallinen käyttäjä ei huomaa muutoksesta mitään. Vastaukset näyttävät samalta, eikä tekstiin ilmesty näkyvää merkintää. Vaikutus alkaa näkyä vasta siellä, missä jonkun pitää arvioida, onko teksti ihmisen vai koneen tekemä.
Oppilaitoksille, toimituksille ja rekrytoijille tämä on periaatteessa parannus. Nykyiset tunnistintyökalut arvaavat tekstin tyylistä ja ovat leimanneet koneen tekemiksi myös ihmisten kirjoittamia tekstejä, mikä on johtanut kiusallisiin plagiointisyytöksiin. Vesileiman etsiminen on eri asia kuin tyylin arvailu, koska silloin haetaan merkkiä, joka on tarkoituksella jätetty tekstiin. Julkisuudessa ei kuitenkaan ole kerrottu, saavatko koulut ja työnantajat käyttöönsä työkalun, jolla merkinnän voi tarkistaa.
Yrityksille kysymys on velvoitteista. Tekoälysäädöksen ensimmäiset velvoitteet ovat olleet voimassa jo pidempään, ja kokosimme aiemmin läpi, keitä säädös käytännössä koskee. Valvonta on sittemmin käynnistynyt ja sakkojen suuruusluokka on tiedossa. Merkintävelvoite koskee mallien kehittäjiä, mutta se muuttaa myös asiakasyritysten arkea: kun tekoälyn tuottama teksti on periaatteessa tunnistettavissa, sopimuksissa ja sisäisissä ohjeissa joutuu ottamaan kantaa siihen, missä työssä koneen käyttö on sallittua ja missä ei.
Kaksi merkintätapaa, kaksi eri heikkoutta
C2PA-metatieto
Käytössä tiedostoissa, kuten kuvissa ja dokumenteissa
Mihin merkintä kiinnittyy
Tiedoston metatietoon
Mitä se kertoo
Alkuperän ja muokkaushistorian
Milloin katoaa
Kuvakaappaus, tiedostomuodon vaihto, siirto alustalta toiselle
Toimiiko pelkässä tekstissä
Ei
Tekstivesileima
Käytössä 2.8.2026 jälkeen julkaistujen Claude-mallien tuottamassa tekstissä
Mihin merkintä kiinnittyy
Mallin sanavalintoihin
Mitä se kertoo
Todennäköisyyden siitä, että teksti on mallin tuottamaa
Milloin katoaa
Muokkaamalla tekstiä – Anthropic ei kerro, paljonko muokkausta riittää
Vesileiman arvo ratkeaa lopulta sillä, kuka sen pystyy lukemaan. Jos tarkistin jää yhtiön sisälle, merkintä on lähinnä todiste sääntelijälle siitä, että laki on täytetty. Jos tarkistin annetaan koulujen, toimitusten ja viranomaisten käyttöön, siitä tulee arkinen työkalu, ja samalla alkaa kilpajuoksu niiden kanssa, jotka opettelevat pesemään leiman pois. Kumpaakaan Anthropic ei ole vielä kertonut valinneensa.
Sanasto
Vesileima (tekstissä)
Piilotettu merkintä, joka syntyy siitä, että malli suosii hienovaraisesti tiettyjä sanavalintoja salaisen kaavan mukaan. Lukija ei erota sitä, mutta oikealla työkalulla teksti voidaan tunnistaa koneen tuottamaksi.
C2PA
Kansainvälinen standardi, jossa kuvan tai dokumentin sisään tallennetaan tieto sen alkuperästä ja tehdyistä muokkauksista. Toimii kuin tiedoston pakkausseloste.
Metatieto
Tiedostoon liitettyä taustatietoa, joka ei näy itse sisällössä – esimerkiksi kuvan ottoaika, laite tai käsittelyhistoria.
Viikoittainen uutiskirje
Tule firmasi fiksuimmaksi AI-osaajaksi
Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.