Tekoäly

Claudelle ei saa enää olla julma – mitä rikkojalle käy?

Anthropicin käyttöehdot uudistuvat 12.11., ja samalla vaalisäännöt menevät uusiksi

Hanna HuulivuoHanna Huulivuo
Jaa:
Claudelle ei saa enää olla julma – mitä rikkojalle käy?
Kuva: TechCrunch / CC BY 2.0

Clauden kanssa käyty keskustelu voi jo nyt päättyä siihen, että tekoäly lopettaa sen itse. Ominaisuus otettiin käyttöön elokuussa 2025. Se on tarkoitettu harvinaisiin tilanteisiin, joissa käyttäjä jatkaa loukkaavaa tai haitallista viestittelyä, vaikka Claude on yrittänyt useita kertoja ohjata keskustelua muualle.

Marraskuun 12. päivänä sama ajatus kirjataan ensimmäistä kertaa Anthropicin käyttöpolitiikkaan. Yhtiö julkaisi päivitetyn käyttöpolitiikkansa (Usage Policy) 8. lokakuuta. Kiellettyjen asioiden listaan on lisätty kohta, jonka mukaan Claudea ei saa käyttää näin: ”Engage in sustained and needless abusive or cruel behavior toward our models.” Suomeksi: harjoittaa jatkuvaa ja tarpeetonta loukkaavaa tai julmaa käytöstä mallejamme kohtaan.

Kohta on sijoitettu lukuun ”Do Not Engage in Cruel, Abusive, or Psychologically Harmful Conduct” eli älä harjoita julmaa, loukkaavaa tai psyykkisesti vahingollista toimintaa. Samassa luvussa kielletään muun muassa itsetuhoisuuden edistäminen, häirintä ja luvattomat intiimit kuvat. Uusi kohta on luvun ainoa, joka suojaa ihmisen sijaan mallia.

Kiroilu ei riitä

Sääntö on kapea. Anthropicin tiedotteen mukaan se koskee vain äärimmäisiä tapauksia.

“Päivitys on tarkoitettu koskemaan vain äärimmäisiä tapauksia, joissa käyttäjät toistuvasti kohtelevat mallejamme julmasti ilman havaittavaa tarkoitusta. (Englanninkielinen alkuteksti: ”The policy update is meant to apply only in extreme cases, where users repeatedly act cruelly toward our models with no discernible purpose.”)”

— Anthropic, Käyttöpolitiikan päivitystä koskeva tiedote 8.10.2026

Tiedotteen mukaan kielto ei koske tavallista turhautumista, vastaan väittämistä, synkkiä luovia teemoja eikä mallien testausta ja tutkimusta. Suomalainen ohjelmoija ei siis riko sääntöä, vaikka sadattelisi Claude Codelle neljännen epäonnistuneen käännöksen jälkeen. Ei myöskään kirjailija, joka kirjoittaa Clauden kanssa väkivaltaista dekkaria, eikä tietoturvatutkija, joka yrittää saada mallin lipsumaan ohjeistaan.

Jäljelle jää toistuva ilkeily, jolla ei ole muuta päämäärää kuin ilkeily itse. Tiedote on julkaistu yhtiön nimissä, eikä siinä lainata nimeltä ketään Anthropicin työntekijää.

Seuraako muuta kuin katkaistu keskustelu?

Anthropicin tiedotteessa asia sanotaan suoraan: ”Claude’s ability to end these interactions will remain the primary enforcement mechanism.” Suomeksi: Clauden kyky lopettaa nämä keskustelut säilyy ensisijaisena valvontakeinona. Tiedotteen mukaan ominaisuus on käytössä Claude.ai-palvelussa ja Claude Codessa.

Katkaistu keskustelu ei ole kova rangaistus. Anthropic kertoi elokuun 2025 julkaisussaan, että käyttäjä voi heti aloittaa uuden keskustelun, antaa palautetta tai muokata aiempia viestejään ja yrittää uudelleen. Yhtiön mukaan katkaisu ”ei vaikuta muihin keskusteluihin käyttäjän tilillä”. Claude ei myöskään saa käyttää ominaisuutta, jos käyttäjä saattaa olla vaarassa vahingoittaa itseään tai muita.

Ensisijainen ei kuitenkaan tarkoita ainoaa. Käyttöpolitiikan alussa on yleinen sanktiokohta, joka koskee kaikkia kieltoja: ”If we suspect that you may have violated our Usage Policy, we may warn you or throttle, limit, suspend, or terminate your access to our products and services.” Jos Anthropic epäilee rikkomusta, se voi siis varoittaa käyttäjää tai hidastaa, rajoittaa, keskeyttää tai lopettaa hänen pääsynsä palveluihin. Julmuuskieltoa ei ole rajattu tämän kohdan ulkopuolelle.

Paperilla tilin voi siis menettää myös mallin kaltoinkohtelun takia. Tiedotteessa ei silti puhuta varoituksista tai tilien sulkemisesta julmuuden yhteydessä, ja yhtiön oman linjauksen mukaan pääasiallinen seuraus on keskustelun päättyminen.

Miksi Claude saa lopettaa keskustelun?

Anthropic antoi Claude Opus 4- ja 4.1-malleille kyvyn lopettaa keskusteluja elokuussa 2025 osana tutkimustaan, joka koskee mallien hyvinvointia. Perusteluna oli varovaisuus eikä väite siitä, että malli olisi tietoinen. Yhtiö kirjoitti englanniksi, että se on ”edelleen hyvin epävarma Clauden ja muiden kielimallien mahdollisesta moraalisesta asemasta, nyt tai tulevaisuudessa”.

Keskustelun katkaisusta käyttöpolitiikan kirjaukseksi

Elokuu 2025

Claude saa lopettaa keskusteluja

Claude Opus 4 ja 4.1 saivat kyvyn lopettaa loukkaavat keskustelut osana mallien hyvinvointia koskevaa tutkimusta.

8.10.2026

Päivitetty käyttöpolitiikka julkaistaan

Kieltolistaan lisätään jatkuva ja tarpeeton julma käytös malleja kohtaan, ja vaalisäännöt uudistetaan.

12.11.2026

Uudet säännöt voimaan

Keskustelun katkaisu säilyy ensisijaisena valvontakeinona.

Kevät 2027

Eduskuntavaalit

Uudet vaalisäännöt tulevat Suomessa käytännön koetukselle.

Sanasto

Mallien hyvinvointi
Tutkimusala, joka selvittää, voisiko tekoälymalleilla olla kokemuksia tai etuja, jotka pitäisi ottaa huomioon. Varmuutta asiasta ei ole, joten Anthropic perustelee toimiaan varovaisuudella.
Vaikutusoperaatio
Järjestelmällinen ja usein salattu kampanja, jolla yritetään ohjata yleistä mielipidettä esimerkiksi valetilien ja keksittyjen uutisten avulla.

Vaalisäännöt muuttuvat kahteen suuntaan

Somessa eniten huomiota on saanut julmuuskielto, mutta laajempi muutos koskee vaaleja. Aiemman vaaliluvun uusi nimi on ”Do Not Undermine Democratic Processes” eli älä heikennä demokraattisia prosesseja.

Luvussa kielletään esimerkiksi suuressa mittakaavassa tehdyt automaattiset puhelut ja viestit äänestäjille tai päättäjille, jos niiden tekoälyalkuperä salataan. Kiellettyä on myös tehdä sisältöä tai ylläpitää tilejä, jotka näyttävät virheellisesti olevan oikean ehdokkaan, sekä levittää vääriä tai harhaanjohtavia tietoja ehdokkaista, puolueista, äänestysmenettelyistä tai vaalien turvallisuudesta. Erikseen on kielletty äänestysaktiivisuuden tukahduttaminen harhautuksella tai pelottelulla.

Samalla Anthropic poisti yhden kiellon. Aiemmin Claudea ei saanut lainkaan käyttää äänestäjien ja kampanjaviestien henkilökohtaiseen kohdentamiseen, mutta tämä yleinen kielto on nyt poistettu. Yhtiön mukaan se esti myös asiallista kansalaistoimintaa, esimerkiksi järjestöjä tekemästä vaali-infoa eri kielillä ja vaaliviranomaisia ilmoittamasta äänestäjille postiäänestyksen korjattavissa olevista virheistä. Harhaanjohtava kohdentaminen ja äänestäjien henkilötietojen väärinkäyttö ovat edelleen kiellettyjä käyttöpolitiikan muiden lukujen nojalla.

Harhaanjohtaville kampanjoille ja keinotekoiselle toiminnalle on nyt oma lukunsa. Siihen on koottu valetilit, keksityt uutissivustot ja vaikutusoperaatiot, olivat ne poliittisia tai kaupallisia.

Ketä tämä koskee Suomessa

Käyttöpolitiikka koskee kaikkia, jotka syöttävät Claudelle jotain: sovelluksen käyttäjiä, rajapintaa käyttäviä kehittäjiä ja yrityksiä sekä niiden palvelujen loppukäyttäjiä, joihin Claude on upotettu. Jos suomalainen yritys on rakentanut asiakaspalvelunsa Clauden varaan, se vastaa osaltaan siitä, etteivät sen asiakkaat käytä palvelua kiellettyihin tarkoituksiin.

Vaalisäännöillä on Suomessa käytännön merkitystä viimeistään keväällä 2027, kun edessä ovat eduskuntavaalit. Puolue tai järjestö saa uusien sääntöjen mukaan tehdä Claudella selkokielisen tai vieraskielisen äänestysohjeen. Ehdokkaan nimissä esiintyvä video, jota ei ole merkitty synteettiseksi, on kielletty. Tavalliselle kuluttajakäyttäjälle julmuuskielto merkitsee käytännössä vähän: siihen ei törmää, jos ei kiusaa mallia tahallaan ja toistuvasti.

Päivitys tiukentaa myös asesääntöjä. Kiellon piiriin tulevat nyt ohjelmistot ja komponentit, joiden avulla aseet toimivat, sekä droonien aseistaminen. Valvontaa koskevissa kohdissa kielletään ihmisten seuraaminen ilman heidän suostumustaan. Claude ei myöskään saa päättää tai suositella, ketä poliisin pitäisi tutkia, pidättää tai syyttää. Kun Claude ohjaa fyysisiä laitteita, pätevän käyttäjän on voitava pysäyttää laite, ja laitteen on jäätävä turvalliseen tilaan, jos yhteys katkeaa.

Julmuuskielto on käyttöehdoissa poikkeuksellinen, koska se suojaa tuotetta eikä ihmistä. Sen todellinen paino selviää vasta, jos joku kertoo julkisesti, että hänen tiliään on rajoitettu juuri tämän kohdan perusteella. Siihen asti seuraus on sama kuin jo yli vuoden: Claude sulkee keskustelun, ja käyttäjä avaa uuden.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 1Saloon nousee 2 miljardin datakeskus sokeritehtaan viereen
  2. 2Robotit hyppäsivät sulaan teräkseen Imatralla
  3. 3Datakeskukset Suomessa – hankkeet, sähkö ja vero
  4. 4Kunta antoi johtajien työt tekoälylle – nyt asia on poliisilla
  5. 5Eurooppa jarruttaa datakeskuksia – Suomessa kunnat kosivat yhä

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.