Tekoäly

Claude jättää tekstiisi näkymättömän vesileiman

EU:n läpinäkyvyyssäännöt pakottivat muutokseen 2. elokuuta.

Aino AikajärviAino Aikajärvi
Jaa:
Claude jättää tekstiisi salaisen merkin

Anthropic alkaa merkitä Clauden tuottaman tekstin piilotetulla vesileimalla. Kaikissa 2. elokuuta jälkeen julkaistuissa malleissa merkintä on mukana automaattisesti, ja yhtiön mukaan tuki laajenee myöhemmin myös vanhempiin malleihin.

Syy on EU:ssa. Tekoälysäädöksen läpinäkyvyyssäännöstö astui voimaan 2. elokuuta, ja se vaatii tekoälyn tuottaman tai muokkaaman sisällön merkitsemistä koneellisesti tunnistettavalla tavalla. Anthropic ei ole yksin. Samaan säännöstöön ovat sitoutuneet myös Google, Meta, Microsoft ja OpenAI, ja merkintöjä ovat ottaneet käyttöön esimerkiksi musiikkipalvelu Suno ja julkaisualusta Substack.

Merkintä tehdään mallitasolla. Se tarkoittaa, että leima on mukana riippumatta siitä, mistä Clauden tuotteesta teksti tulee: rajapinnasta, chatista, Claude Codesta, Claude Coworkista tai Claude Tagista. Käyttäjä ei voi kytkeä sitä pois asetuksista, koska merkintä syntyy jo siinä vaiheessa, kun malli valitsee sanansa.

Kaksi tekniikkaa, kaksi eri heikkoutta

Tiedostoissa Anthropic käyttää C2PA-standardia. Sen takana on Adoben, Googlen, Microsoftin, BBC:n ja OpenAI:n kaltaisten toimijoiden yhteenliittymä, ja periaate on yksinkertainen. Tiedostoon liitetään metatietoa siitä, mistä se on peräisin ja mitä sille on matkan varrella tehty. Yhteenliittymä itse vertaa merkintää pakkausselosteeseen.

Metatiedon ongelma on, että se on kiinni tiedostossa eikä sisällössä. Kuvakaappaus, muunnos toiseen tiedostomuotoon tai siirto alustalta toiselle voi pyyhkiä merkinnän pois. Tämän myöntää C2PA-yhteenliittymä omilla sivuillaan.

Pelkkä teksti on hankalampi tapaus, koska siihen ei voi ripustaa metatietoa. Leima piilotetaan itse sanavalintoihin. Kielimalli valitsee jokaisen sanan todennäköisyyksien perusteella, ja vesileimaus kallistaa noita todennäköisyyksiä hienovaraisesti tiettyyn suuntaan salaisen kaavan mukaan. Lukija ei huomaa mitään, mutta riittävän pitkästä pätkästä algoritmi pystyy laskemaan, kuinka todennäköisesti kaava on siellä tahallaan.

Mikä muuttui 2. elokuuta

EU:n tekoälysäädöksen läpinäkyvyyssäännöstö tuli voimaan 2.8.2026. Se velvoittaa merkitsemään tekoälyn tuottaman sisällön koneellisesti tunnistettavalla tavalla. Anthropicin uusissa malleissa merkintä on mukana automaattisesti, vanhempiin se luvataan jälkikäteen.

Mitä tapahtuu, kun opiskelija kopioi tekstin Wordiin

Leima seuraa mukana. Koska merkintä on tehty sanavalintoihin eikä leikepöydän muotoiluihin, se ei jää chattiin. Sama pätee, jos teksti liimataan sähköpostiin, oppimisalustalle tai blogialustan editoriin. Muotoilut katoavat, kaava ei.

Anthropicin oma muotoilu on kuitenkin huomattavan varovainen.

“Koska vesileima on osa tekstiä, se kulkee tekstin mukana, kun teksti kopioidaan muualle, ja saattaa säilyä osan muokkauksista.”

— Anthropic, yhtiön kuvaus vesileiman toiminnasta

Ratkaiseva sana on saattaa. Kuinka paljon muokkausta merkinnän hävittämiseen tarvitaan, jää kertomatta. TechCrunch kysyi asiaa Anthropicilta eikä saanut vastausta ennen juttunsa julkaisua.

Tästä syntyy uudistuksen ristiriita. Opiskelija, joka liimaa vastauksen sellaisenaan tehtäväpalautukseen, kantaa leimaa mukanaan. Se, joka syöttää tekstin toiseen malliin uudelleenkirjoitettavaksi tai kirjoittaa jokaisen lauseen omin sanoin, ei todennäköisesti kanna. Sääntelijän vaatimus täyttyy, rehellinen käyttö tulee merkityksi, mutta tahallinen peittely menee yhä läpi. Juuri sen estämiseen merkintöjä on julkisuudessa perusteltu.

Kenelle leimasta on oikeasti hyötyä

Tavallinen käyttäjä ei huomaa muutoksesta mitään. Vastaukset näyttävät samalta, eikä tekstiin ilmesty näkyvää merkintää. Vaikutus alkaa näkyä vasta siellä, missä jonkun pitää arvioida, onko teksti ihmisen vai koneen tekemä.

Oppilaitoksille, toimituksille ja rekrytoijille tämä on periaatteessa parannus. Nykyiset tunnistintyökalut arvaavat tekstin tyylistä ja ovat leimanneet koneen tekemiksi myös ihmisten kirjoittamia tekstejä, mikä on johtanut kiusallisiin plagiointisyytöksiin. Vesileiman etsiminen on eri asia kuin tyylin arvailu, koska silloin haetaan merkkiä, joka on tarkoituksella jätetty tekstiin. Julkisuudessa ei kuitenkaan ole kerrottu, saavatko koulut ja työnantajat käyttöönsä työkalun, jolla merkinnän voi tarkistaa.

Yrityksille kysymys on velvoitteista. Tekoälysäädöksen ensimmäiset velvoitteet ovat olleet voimassa jo pidempään, ja kokosimme aiemmin läpi, keitä säädös käytännössä koskee. Valvonta on sittemmin käynnistynyt ja sakkojen suuruusluokka on tiedossa. Merkintävelvoite koskee mallien kehittäjiä, mutta se muuttaa myös asiakasyritysten arkea: kun tekoälyn tuottama teksti on periaatteessa tunnistettavissa, sopimuksissa ja sisäisissä ohjeissa joutuu ottamaan kantaa siihen, missä työssä koneen käyttö on sallittua ja missä ei.

Kaksi merkintätapaa, kaksi eri heikkoutta

C2PA-metatieto

Käytössä tiedostoissa, kuten kuvissa ja dokumenteissa

Mihin merkintä kiinnittyy
Tiedoston metatietoon
Mitä se kertoo
Alkuperän ja muokkaushistorian
Milloin katoaa
Kuvakaappaus, tiedostomuodon vaihto, siirto alustalta toiselle
Toimiiko pelkässä tekstissä
Ei

Tekstivesileima

Käytössä 2.8.2026 jälkeen julkaistujen Claude-mallien tuottamassa tekstissä

Mihin merkintä kiinnittyy
Mallin sanavalintoihin
Mitä se kertoo
Todennäköisyyden siitä, että teksti on mallin tuottamaa
Milloin katoaa
Muokkaamalla tekstiä – Anthropic ei kerro, paljonko muokkausta riittää
Toimiiko pelkässä tekstissä
Kyllä, mutta lyhyt pätkä ei riitä tunnistukseen

TechCrunch ja C2PA, 2026

Vesileiman arvo ratkeaa lopulta sillä, kuka sen pystyy lukemaan. Jos tarkistin jää yhtiön sisälle, merkintä on lähinnä todiste sääntelijälle siitä, että laki on täytetty. Jos tarkistin annetaan koulujen, toimitusten ja viranomaisten käyttöön, siitä tulee arkinen työkalu, ja samalla alkaa kilpajuoksu niiden kanssa, jotka opettelevat pesemään leiman pois. Kumpaakaan Anthropic ei ole vielä kertonut valinneensa.

Sanasto

Vesileima (tekstissä)
Piilotettu merkintä, joka syntyy siitä, että malli suosii hienovaraisesti tiettyjä sanavalintoja salaisen kaavan mukaan. Lukija ei erota sitä, mutta oikealla työkalulla teksti voidaan tunnistaa koneen tuottamaksi.
C2PA
Kansainvälinen standardi, jossa kuvan tai dokumentin sisään tallennetaan tieto sen alkuperästä ja tehdyistä muokkauksista. Toimii kuin tiedoston pakkausseloste.
Metatieto
Tiedostoon liitettyä taustatietoa, joka ei näy itse sisällössä – esimerkiksi kuvan ottoaika, laite tai käsittelyhistoria.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  2. 220 vuotta koodaamatta, sitten 5,4 miljoonaa
  3. 3Uusi Siri saapui – mutta ei suomeksi eikä iPhoneen
  4. 4Google kaatoi 300 hehtaaria metsää – virasto selvittää
  5. 5Datakeskus söisi Lapinlahdella kokonaisen kaupungin sähköt

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.