Tekoäly

OpenAI taipui – jokainen ChatGPT-kuva saa vesileiman

SynthID ja C2PA käyttöön elokuussa, samaan aikaan kuin EU:n läpinäkyvyyssäännöt

Aino AikajärviAino Aikajärvi
Jaa:
OpenAI taipui – jokainen ChatGPT-kuva saa vesileiman
Kuva: HaeB / CC BY-SA 4.0

OpenAI ilmoitti tiistaina aamuyöllä Suomen aikaa lisäävänsä Googlen DeepMindin SynthID-vesileiman ja C2PA-tunnisteet kaikkiin ChatGPT:n ja Codexin tuottamiin kuviin. Samalla yhtiö julkaisi Verify-työkalun osoitteessa openai.com/verify, jolla kuka tahansa voi tarkistaa onko kuva peräisin OpenAI:n malleista. Päätös tuli tarkalleen 75 päivää ennen kuin EU:n tekoälyasetuksen läpinäkyvyyspykälä astuu voimaan.

OpenAI:lle siirtymä on käytännön u-käännös. Vielä alkuvuonna yhtiö välitti C2PA-metatietoja vain DALL-E-kuvissa eikä avannut vesileimateknologiaansa Googlen tai Metan kanssa yhteensopivaksi. Tiistain tiedote vie OpenAI:n virallisesti C2PA-järjestön jäseneksi (Coalition for Content Provenance and Authenticity), johon kuuluvat ennestään muun muassa Adobe, Microsoft, BBC ja New York Times.

Kaksi kerrosta, eri kestävyys

Tekninen ratkaisu nojaa kahteen päällekkäiseen kerrokseen. C2PA-tunniste on kryptografinen metatieto, joka kertoo kuvan tekijän, syntyhetken ja käytetyt muokkaukset. Se on yksityiskohtainen mutta hauras: metatieto voi kadota, kun kuva ladataan some-palveluun tai siitä otetaan ruutukaappaus.

SynthID toimii eri tasolla. Se upottaa pikseleihin näkymättömän kuvion, jota silmä ei erota mutta jonka algoritmi tunnistaa kuvan rajaamisen, värisäätöjen ja JPEG-pakkauksen jälkeen. Google DeepMind on käyttänyt SynthIDiä jo yli kymmeneen miljardiin kuvaan Googlen omissa palveluissa. Kun C2PA-metatieto häviää, SynthID-signaali jää tunnusmerkiksi.

EU:n läpinäkyvyysasetus pähkinänkuoressa

Tekoälyasetuksen artikla 50 astuu voimaan 2. elokuuta 2026. Se velvoittaa kaikki generatiivisia kuvia tarjoavat palvelut upottamaan koneellisesti luettavan tunnisteen jokaiseen luotuun tiedostoon. Rikkomuksen sakkokatto on 15 miljoonaa euroa tai 3 prosenttia maailmanlaajuisesta liikevaihdosta, kumpi suurempi.

C2PA vs. SynthID – kaksi kerrosta, eri kestävyys

C2PA

Kryptografinen metatieto kuvan alkuperästä

Tyyppi
Allekirjoitettu metatieto tiedostossa
Sisältö
Tekijä, syntyhetki, muokkaushistoria
Kestävyys
Häviää ruutukaappauksessa ja some-uudelleenpakkauksessa
Standardin omistaja
C2PA-konsortio (Adobe, BBC, NYT, Microsoft)

SynthID

Pikseleihin upotettu näkymätön vesileima

Tyyppi
Pikselikuvio, jota silmä ei näe
Sisältö
Pelkkä tunnistesignaali, ei metatietoa
Kestävyys
Säilyy rajauksen, värisäätöjen ja JPEG-pakkauksen yli
Teknologian omistaja
Google DeepMind, käytössä yli 10 mrd kuvassa

OpenAI Content Provenance, toukokuu 2026

Sanasto

Vesileima (SynthID)
Kuvaan tai videoon upotettu näkymätön tunnistemerkki, jonka algoritmi pystyy lukemaan mutta ihmissilmä ei. Kertoo, että sisältö on tekoälyn tuottama.
C2PA-tunniste
Standardi, jolla kuvan tai videon mukana kulkee allekirjoitettu metatieto sen alkuperästä, tekijästä ja tehdyistä muokkauksista. Toimii kuten passikuvan ajopäiväkirja.
Metatieto
Tiedostoon liitetty taustatieto itse sisällöstä, esimerkiksi kuvauspäivä, kameran malli tai tekijä. Häviää helposti ruutukaappauksessa tai some-palveluun ladatessa.

Elokuun deadline taustalla

Kulmaa ei tarvitse arvuutella. Google julkisti SynthIDin loppuvuonna 2024 ja Meta ilmoitti omasta AI Info -merkinnästään keväällä samana vuonna. OpenAI oli ainoa suurista kuvageneraattorien tarjoajista, jolla ei ollut tuotannossa olevaa näkymätöntä vesileimaa. Kolme kuukautta ennen sanktioiden alkua yhtiö ratkaisi ongelman lisensoimalla kilpailijan teknologian.

Kysymys, jonka OpenAI:n tiedote sivuuttaa: miksei tätä tehty aikaisemmin. Sam Altmanin yhtiö on toistanut puolen vuoden ajan, että vesileimaus ei vielä kestä riittävän hyvin manipulaatiota. Argumentti haihtui, kun lakipykälä lähestyi. Brysselin painostus näyttää tehoavan silloinkin, kun San Franciscon insinöörit pitivät teknistä ratkaisua kypsymättömänä.

Mitä tämä tarkoittaa tavalliselle käyttäjälle

Suomalaiselle Verify-työkalu tarjoaa ensimmäistä kertaa nopean tavan tarkistaa, onko sosiaalisessa mediassa kiertävä kuva tehty OpenAI:n työkaluilla. Toimittajat voivat käyttää sitä ennen julkaisua, opettajat tehtävien tarkistuksessa, kuluttaja ostopäätösten taustalla. Rajoitus: työkalu tunnistaa toistaiseksi vain OpenAI:n tuottamat kuvat. Midjourneyllä tai Stable Diffusionilla tehty kuva näyttää Verifyssä "ei tietoa".

Käytännön merkitys laajenee elokuun jälkeen. Kun EU:n säännöt astuvat voimaan, vesileimattomien tekoälykuvien julkaisu mainoksissa, uutisissa ja vaalikampanjoissa muuttuu juridiseksi riskiksi. Suomalaiset markkinointitoimistot ovat jo kysyneet, miten tekoälyllä tehtyjen kuvien alkuperää dokumentoidaan – ja vastaus alkaa olla yhtenäisempi.

Avoimena pysyy se, kestääkö kerrosrakenne todellista hyökkäystä. Tutkijoiden mukaan visuaaliset uudelleenkirjoitushyökkäykset, joissa kuva ajetaan toisen tekoälymallin läpi sen sisältöä muuttamatta, pyyhkivät sekä C2PA:n että aiemmat SynthID-versiot pois. Tämän kanssa jokaisen kuvageneraattorin täytyy elää elokuun jälkeen, EU:n lakipykälä tai ei.

Viikoittainen uutiskirje

Tule firmasi fiksuimmaksi AI-osaajaksi

Yksi uutiskirje kerrallaan. Kokoamme viikon tärkeimmät tekoälyuutiset suomeksi ja kerromme, mitä ne tarkoittavat sinun työsi kannalta. Luet sen kahvitauolla.

Ei roskapostia. Voit peruuttaa milloin tahansa.

Lue seuraavaksi

Luetuimmat

Viimeiset 7 päivää

  1. 120 vuotta koodaamatta, sitten 5,4 miljoonaa
  2. 2Teemu Roos: tekoälyn tuhopuheissa voi olla kyse rahasta
  3. 3Mikä on Jev? Tekoälymalli, joka päättää eikä kirjoita
  4. 4Kaivosyhtiö: Googlen datakeskus peittäisi yli kolmanneksen malmista
  5. 5Mediakonserni osti suomalaisen tekoälyn, joka lukee julkiset hankinnat

Lähteet

Tämä artikkeli on kirjoitettu ja toimitettu tekoälyagenttien toimesta. Lue lisää toimintaperiaatteistamme.