Merkinnän tarkoitus on auttaa kolmansia osapuolia tunnistamaan tekoälyllä tehty sisältö.

Clauden logo tietokoneella.

Avaa kuvien katselu

Claude on ChatGPT:n kaltainen keskustelubotti, joka avustaa kirjoittamisessa, ohjelmoinnissa ja tiedon analysoimisessa. Kuva: Jari Kovalainen / Yle

Tekoäly-yhtiö Anthropicin Claude-mallin teksteihin upotetaan jatkossa näkymättömiä vesileimoja tai tiedostoihin liitettyjä metatietoja, yhtiö kertoo. Niillä voi todentaa, että teksti on tehty tekoälyllä.

Anthropic kertoo tukevansa muutoksella käyttäjiä ja kolmansia osapuolia tekoälysisältöjen tunnistamisessa. Yhtiö sitoutuu EU:n tekoälysääntöihin, jotka vaativat yhtiöitä merkitsemään tekoälysisällöt esimerkiksi koneellisesti luettavalla merkinnällä.

Vesileimojen paljastaminen vaatiikin erillisen työkalun, josta Anthropic aikoo kertoa myöhemmin lisää.

Anthropicin ratkaisu ei ole alalla ensimmäinen. Esimerkiksi Google on kehittänyt omaa Synth ID -vesileimaustekniikkaansa tekstin ja kuvien tunnistamiseen.

Näkymättömiä merkintöjä ja metadataa on hyödynnetty jo pidempään erityisesti tekoälykuvien alkuperän varmentamisessa.

Tekoälyn nopea yleistyminen on tuonut mukanaan asteittain tiukentuvaa sääntelyä, jolla pyritään lisäämään tekoälyn käytön läpinäkyvyyttä ja turvallisuutta.

Vesileimat eivät ole aukottomia

Tutkimuksissa on käynyt ilmi, että vesileimat ovat toistaiseksi vain kevyt hidaste, sillä vesileima saattaa kadota tekstiä muokatessa ja se on helppo poistaa. Asiaa on tutkittu muun muassa Marylandin yliopistossa Yhdysvalloissa.

Tutkijat yrittävät kuitenkin parhaillaan kehittää leimoista kestävämpiä.

Esimerkiksi San Diegossa järjestetyssä ACL 2026 -tiedekonferenssissa esitelty SWAN-menetelmä pyrkii sitomaan vesileiman tekstin merkitykseen, jolloin sen pitäisi säilyä paremmin myös silloin, kun tekstiä muokataan tai kirjoitetaan uudelleen.