Tekoäly

Claude leimaa tekstisi – poistotyökalu ilmestyi vuorokaudessa

Vesileima ei tartu koodiin eikä oikolukuun, ja tunnistinta ei ole vielä kenelläkään

Venla ValoVenla Valo
Jaa:
Claude leimaa tekstisi – poistotyökalu ilmestyi vuorokaudessa
Kuva: TechCrunch / CC BY 2.0

Anthropic kytki vesileiman päälle 11. elokuuta. Vuorokauden sisällä GitHubiin ilmestyi ilmainen työkalu, joka poistaa sen. Forbesin Joe Toscanon mukaan työkalu rikkoo noin 70 prosenttia niistä sanajonoista, joihin leima nojaa, ja se keräsi julkaisunsa jälkeen noin 72 tähteä päivässä. Business Insiderin mukaan kymmenkunta käyttäjää irtisanoi tilauksensa leiman takia.

Tässä on koko asetelma pienoiskoossa. EU vaatii merkintää, yhtiö toteuttaa sen, ja poistotyökalu on olemassa ennen kuin ensimmäinenkään viranomainen on ehtinyt katsoa asiaa. Kysymys ei kuitenkaan ole siitä, kestääkö leima. Kysymys on siitä, mitä se todistaa ja kenelle.

Leima ei ole tekstissä vaan arvonnassa

Kielimalli valitsee jokaisen sanan todennäköisyyksien perusteella. Usein useampi vaihtoehto on yhtä hyvä: pilvinen tai harmaa, kertoo tai sanoo. Juuri näihin vähäpätöisiin valintoihin leima piiloutuu.

Anthropic kuvaa mekanismin näin: "valinnat tehdään yhä satunnaisesti, mutta satunnaisuuden lähde on eri." Malli käyttää arpomiseen salaista avainta ja muutamaa edeltävää sanaa. Tuloksena syntyy tilastollinen kuvio, jota lukija ei näe mutta jonka avaimen haltija voi laskea tekstistä jälkikäteen. Menetelmä on Google DeepMindin SynthID-Text, ja sen juuret ovat Scott Aaronsonin vuoden 2022 ehdotuksessa.

Tekstiin ei siis lisätä mitään. Yhtiön mukaan "lukijalle vesileimattu vastaus on erottamaton leimaamattomasta". Se on tärkeä ero vanhoihin kikkoihin, joissa tekstiin ujutettiin näkymättömiä Unicode-merkkejä. Sellaiset katoavat yhdellä etsi ja korvaa -komennolla.

Mihin leima ei tartu lainkaan

Tämä osa on jäänyt uutisoinnissa vähälle, ja se on käytännössä olennaisin. Leima tarvitsee valinnanvaraa. Siellä missä oikeita vastauksia on vain yksi, sitä ei synny.

Koodi jää suurelta osin merkitsemättä, koska tarkka tuotos on pakko olla tarkka. Anthropic huomauttaa, että kommentteihin leima voi silti tarttua, koska niissä sanavalinta on vapaa. Faktapitoinen teksti saa harvemman leiman kuin pohdiskeleva. Lyhyt vastaus ei riitä tunnistukseen alkuunkaan, koska valintoja on liian vähän laskettavaksi.

Erikoisin rajaus koskee oikolukua. Jos annat Claudelle oman tekstisi siistittäväksi ja se muuttaa muutaman pilkun, leimalle ei jää mitään mihin tarttua. Yhtiön oma muotoilu on, että silloin "leimalle on hyvin vähän, jos mitään, mihin kiinnittyä". Juuri tämä on yleisin tapa, jolla ammattilainen käyttää kielimallia työssään.

Mikä sen poistaa

Anthropicin oma vastaus on suora: kevyt muokkaus ei todennäköisesti poista leimaa kokonaan, täydellinen uudelleenkirjoitus poistaa. Käytännössä riittää, että syöttää tekstin toiselle mallille ja pyytää kirjoittamaan sen uusiksi. Silloin sanavalinnat tulevat malliltä, jolla ei ole Anthropicin avainta.

Insinööri Sean Goedecke pitää tätä rakenteellisena eikä korjattavana vikana. Hänen väitteensä on jyrkkä: "tekstin vesileimat tulevat aina olemaan triviaaleja poistaa." Perustelu on kiinnostava, koska se kääntyy sääntelyä vastaan. Tekoälyasetus vaatii merkintämenetelmiltä yhteentoimivuutta siinä määrin kuin se on teknisesti mahdollista. Yhteentoimivuus tarkoittaa julkaisemista, ja julkaistu menetelmä on helpompi kiertää.

Kuvassa on kohinaa, johon leiman voi piilottaa huomaamatta. Teksti on tiiviimpää. Siinä ei ole ylimääräistä tilaa, johon merkinnän voisi kätkeä niin, ettei sitä saa pois muuttamatta itse sisältöä. Tutkimuskirjallisuus tukee tätä: SynthID-Text kestää yksinkertaiset sanatason hyökkäykset, mutta merkityksen säilyttävä uudelleenmuotoilu ja takaisinkäännös heikentävät tunnistustarkkuutta merkittävästi.

Tunnistinta ei ole vielä olemassa

Tässä on jutun epämukavin kohta. Anthropic kertoo tarjoavansa "pian" rajapinnan vesileiman tunnistamiseen ja sanoo olevansa "selvittämässä sen toteutuksen yksityiskohtia". Aikataulua ei ole. Sitä ennen kukaan koulu, toimitus tai rekrytoija ei voi tarkistaa yhtään mitään.

Vielä tärkeämpi on se, mitä osuma tarkoittaisi. Anthropicin mukaan löydös kertoo, että Claude on saattanut käsitellä tekstiä. Se ei kerro, kuka sen kirjoitti. Ero on juridisesti ratkaiseva. Oikoluettu ihmisteksti ja kokonaan koneen tuottama teksti voivat molemmat antaa osuman, eikä leima erottele niitä toisistaan.

Nykyiset tekoälytunnistimet arvaavat tyylistä ja ovat leimanneet koneen tekemiksi myös ihmisten kirjoittamia tekstejä. Vesileima on periaatteessa parempi, koska se etsii tarkoituksella jätettyä merkkiä. Se paremmuus jää kuitenkin teoriaksi niin kauan kuin tunnistin on vain yhtiön omissa käsissä.

Mitä tämä tarkoittaa suomalaiselle yritykselle

Tekoälyasetuksen 50. artiklan läpinäkyvyysvelvoitteita on sovellettu 2. elokuuta 2026 alkaen. Vastuu jakautuu kahtia. Mallin tarjoaja vastaa koneluettavasta merkinnästä, eli tästä vesileimasta. Käyttäjäyritys vastaa siitä, että yleisölle kerrotaan näkyvästi, kun sisältö on tekoälyn tuottamaa.

Tästä seuraa yksi asia, joka menee helposti väärin. Vesileiman poistaminen ei poista sinun ilmoitusvelvollisuuttasi. Velvoite koskee sitä, mitä kerrot yleisölle, ei sitä, mitä tekstistä on teknisesti mitattavissa. Jos yrityksesi julkaisee tekoälyllä tuotettua sisältöä merkitsemättä sitä, rike on olemassa riippumatta siitä, löytyykö tekstistä leimaa.

Suomessa valvonta on hajautettu 15 viranomaiselle, ja Liikenne- ja viestintävirasto Traficom toimii kansallisena yhteyspisteenä. Läpinäkyvyysrikkeiden sakkokatto on 15 miljoonaa euroa tai kolme prosenttia maailmanlaajuisesta liikevaihdosta, kumpi on suurempi. Pienille yrityksille sovelletaan näistä pienempää.

Kolme päätöstä, jotka kannattaa tehdä nyt

Ensimmäinen koskee sopimuksia. Jos ostat sisältöä alihankkijalta, kirjaa sopimukseen kielto poistaa merkintöjä ja vaatimus säilyttää alkuperätiedot. Se on halvempi kuin selvittää jälkikäteen, mistä merkitsemätön teksti tuli.

Toinen koskee henkilöstöpäätöksiä. Älä rakenna rekrytointiin tai opiskelijan arviointiin prosessia, joka nojaa vesileiman löytymiseen. Tunnistinta ei ole, ja jos se tulee, osuma kertoo vain että malli on saattanut käsitellä tekstiä. Kurinpitopäätös sellaisen varassa kaatuu ensimmäisessä riitatilanteessa.

Kolmas koskee omaa julkaisemista. Päätä etukäteen, missä työssä koneen käyttö on sallittua ja miten se kerrotaan. Moni suomalainen yritys on käyttänyt tekoälyä kuvituksessa ja mainosteksteissä vaieten, koska on pelännyt asiakkaiden reaktiota. Nyt vaikeneminen on se riskialttiimpi vaihtoehto.

Vesileima ei ratkaise sitä ongelmaa, jonka ratkaisemiseen se on julkisuudessa perusteltu. Se ei estä sitä, joka tahallaan peittää jälkensä, koska hän kirjoittaa tekstin uusiksi toisella mallilla. Se merkitsee rehellisen käyttäjän, joka ei olisi peitellyt mitään. Sen arvo ratkeaa siinä, annetaanko tunnistin joskus koulujen ja toimitusten käyttöön, vai jääkö se todisteeksi sääntelijälle siitä, että laki on täytetty.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.