Paveikslėlis: infa.lt / DI
Bendrovė „Anthropic“ pasirašė ES dirbtinio intelekto akto (EU AI Act) 50 straipsnio 2 dalies gerosios praktikos kodeksą dėl dirbtinio intelekto sugeneruoto turinio skaidrumo.
Remiantis naujausiomis taisyklėmis, bendrovė pradeda įdiegti mašininio skaitymo žymes „Claude“ modelių kuriamuose tekstuose bei failuose.
Šios priemonės apima tiek generuojančius modelius, tiek sistemas visame pasaulyje, o nuo 2026 metų rugpjūčio 2 dienos visi naujai išleisti „Claude“ modeliai šį žymėjimą palaiko jau nuo pat paleidimo dienos, rašoma „Anthropic“ palaikymo puslapyje paskelbtame pranešime.
Kaip veikia „Claude“ turinio žymėjimas?
Siekdama užtikrinti atsekamumą, „Anthropic“ naudoja du pagrindinius metodus:
Vandenženkliai tekste. Kai palaikomas „Claude“ modelis generuoja tekstą, į patį tekstą įaunamas nepastebimas vandenženklis. Vartotojui jis nematomas, nekeičia teksto prasmės, kokybės ar skaitomumo, tačiau keliauja kartu su tekstu jį nukopijuojant ir įklijuojant kitur.
Skaitmeninė kilmės metaduomenų žyma (C2PA). Kai „Claude“ sukuria palaikomą failo tipą (pavyzdžiui, .svg, .png arba .jpg), prie jo prijungiami pasirašyti kilmės metaduomenys. Jie atitinka visoje industrijoje naudojamą C2PA standartą, leidžiantį nustatyti, kad failas buvo apdorotas „Claude“ bei aptikti, ar jis vėliau nebuvo klastojamas.
Žymėjimas taikomas visose platformose, kur naudojamas „Claude“ (įskaitant API, „Claude Code“, „Claude Cowork“ ir „Claude Tag“), taip pat per debesijos partnerius – „AWS“, „Google Cloud“ ar „Microsoft Foundry“.
Apribojimai, ir ar įmanoma šias žymes pašalinti?
Kaip nurodo „Anthropic“, aptiktas vandenženklis ar žyma yra tik signalas, rodantis galimą „Claude“ dalyvavimą kuriant turinį, tačiau tai nėra šimtu procentų galutinis įrodymas.
Kilmė ir redagavimas: Žyma gali atsirasti net ir tuo atveju, jei „Claude“ buvo panaudotas tik tekstui redaguoti, išversti, apibendrinti ar failui konvertuoti, o pirminės idėjos priklauso žmogui. Be to, turinys galėjo būti modifikuotas po to, kai jį apdorojo dirbtinis intelektas.
Žymių nebuvimas: Žymos gali nebūti arba ji gali būti neaptinkama, jei tekstas buvo smarkiai redaguotas, perfrazuotas, išverstas, sujungtas su kitu tekstu arba yra per trumpas, kad sistema aptiktų patikimą signalą.
Kaip pašalinamos šios žymės?
Teksto vandenženkliai: Kadangi nematomi vandenženkliai yra įausti tiesiai į pačių žodžių struktūrą bei modelio generavimo dėsningumus, jų neįmanoma „ištrinti“ paprastu failo redagavimu. Visgi vandenženklis natūraliai prarandamas arba tampa nebeaptinkamu, jei tekstas yra smarkiai perrašomas (perfrazuojamas) žmogaus, išverčiamas į kitą kalbą arba stipriai sutrumpinamas.
Failų metaduomenys: C2PA standarto metaduomenys, esantys vaizduose ar kituose failuose, yra kur kas pažeidžiamesni. Jie lengvai pašalinami atliekant formatų konvertavimą (pavyzdžiui, išsaugojus failą iš naujo per paprastą grafikos redaktorių), darant ekrano kopijas (screenshot) arba atliekant kitus veiksmus, kurie ištrina originalaus failo EXIF/C2PA metaduomenis.
Faktai: Kaip pripažįsta pati „Anthropic“ kompanija, – tai, kad tekste yra vandenženkliai, nereiškia jog jį sukūrė Dirbtinis intelektas. Tai nurodo, jog DI pridėjo prie teksto savo rankelę, – tai galėjo būti redagavimo ar perrašymo faktas, neliudijantis, jog patį tekstą sugeneravo DI nuo nulio pagal užsakytą temą. Tad bijoti dėl DI autorystės reikia ko gero tik moksleiviams, kopijuojant DI išspręstas ar sukurtas tekstines užduotis. Na, dar mokslo darbų plagiatoriams.
