Clauden kanssa käyty keskustelu voi jo nyt päättyä siihen, että tekoäly lopettaa sen itse. Ominaisuus otettiin käyttöön elokuussa 2025. Se on tarkoitettu harvinaisiin tilanteisiin, joissa käyttäjä jatkaa loukkaavaa tai haitallista viestittelyä, vaikka Claude on yrittänyt useita kertoja ohjata keskustelua muualle.
Marraskuun 12. päivänä sama ajatus kirjataan ensimmäistä kertaa Anthropicin käyttöpolitiikkaan. Yhtiö julkaisi päivitetyn käyttöpolitiikkansa (Usage Policy) 8. lokakuuta. Kiellettyjen asioiden listaan on lisätty kohta, jonka mukaan Claudea ei saa käyttää näin: ”Engage in sustained and needless abusive or cruel behavior toward our models.” Suomeksi: harjoittaa jatkuvaa ja tarpeetonta loukkaavaa tai julmaa käytöstä mallejamme kohtaan.
Kohta on sijoitettu lukuun ”Do Not Engage in Cruel, Abusive, or Psychologically Harmful Conduct” eli älä harjoita julmaa, loukkaavaa tai psyykkisesti vahingollista toimintaa. Samassa luvussa kielletään muun muassa itsetuhoisuuden edistäminen, häirintä ja luvattomat intiimit kuvat. Uusi kohta on luvun ainoa, joka suojaa ihmisen sijaan mallia.
Kiroilu ei riitä
Sääntö on kapea. Anthropicin tiedotteen mukaan se koskee vain äärimmäisiä tapauksia.
“Päivitys on tarkoitettu koskemaan vain äärimmäisiä tapauksia, joissa käyttäjät toistuvasti kohtelevat mallejamme julmasti ilman havaittavaa tarkoitusta. (Englanninkielinen alkuteksti: ”The policy update is meant to apply only in extreme cases, where users repeatedly act cruelly toward our models with no discernible purpose.”)”
Tiedotteen mukaan kielto ei koske tavallista turhautumista, vastaan väittämistä, synkkiä luovia teemoja eikä mallien testausta ja tutkimusta. Suomalainen ohjelmoija ei siis riko sääntöä, vaikka sadattelisi Claude Codelle neljännen epäonnistuneen käännöksen jälkeen. Ei myöskään kirjailija, joka kirjoittaa Clauden kanssa väkivaltaista dekkaria, eikä tietoturvatutkija, joka yrittää saada mallin lipsumaan ohjeistaan.
Jäljelle jää toistuva ilkeily, jolla ei ole muuta päämäärää kuin ilkeily itse. Tiedote on julkaistu yhtiön nimissä, eikä siinä lainata nimeltä ketään Anthropicin työntekijää.
Seuraako muuta kuin katkaistu keskustelu?
Anthropicin tiedotteessa asia sanotaan suoraan: ”Claude’s ability to end these interactions will remain the primary enforcement mechanism.” Suomeksi: Clauden kyky lopettaa nämä keskustelut säilyy ensisijaisena valvontakeinona. Tiedotteen mukaan ominaisuus on käytössä Claude.ai-palvelussa ja Claude Codessa.
Katkaistu keskustelu ei ole kova rangaistus. Anthropic kertoi elokuun 2025 julkaisussaan, että käyttäjä voi heti aloittaa uuden keskustelun, antaa palautetta tai muokata aiempia viestejään ja yrittää uudelleen. Yhtiön mukaan katkaisu ”ei vaikuta muihin keskusteluihin käyttäjän tilillä”. Claude ei myöskään saa käyttää ominaisuutta, jos käyttäjä saattaa olla vaarassa vahingoittaa itseään tai muita.
Ensisijainen ei kuitenkaan tarkoita ainoaa. Käyttöpolitiikan alussa on yleinen sanktiokohta, joka koskee kaikkia kieltoja: ”If we suspect that you may have violated our Usage Policy, we may warn you or throttle, limit, suspend, or terminate your access to our products and services.” Jos Anthropic epäilee rikkomusta, se voi siis varoittaa käyttäjää tai hidastaa, rajoittaa, keskeyttää tai lopettaa hänen pääsynsä palveluihin. Julmuuskieltoa ei ole rajattu tämän kohdan ulkopuolelle.
Paperilla tilin voi siis menettää myös mallin kaltoinkohtelun takia. Tiedotteessa ei silti puhuta varoituksista tai tilien sulkemisesta julmuuden yhteydessä, ja yhtiön oman linjauksen mukaan pääasiallinen seuraus on keskustelun päättyminen.



