OpenAI zavede vodoznaky pro AI text, neprůstřelné však zdaleka nejsou

Sdílet

Shutterstock.com
Autor: Shutterstock.com
Systém pro rozpoznávání AI textů od OpenAi vykazuje vysokou úspěšnost. Relativně snadno ho však lze obejít.

Společnost OpenAI začne v Evropské unii označovat některé texty vytvořené ChatemGPT a Codexem digitálním vodoznakem. Chce tím splnit požadavky evropského AI Actu, který požaduje, aby bylo možné výstupy generativní AI identifikovat strojově čitelným způsobem. Uživatelé OpenAI API si budou moct watermarking zapnout taky mimo EU. OpenAI ho ale na rozdíl od Anthropicu nechce automaticky používat globálně.

Princip je poměrně jednoduchý: AI při generování textu nepatrně upraví výběr slov tak, aby vznikl statistický vzorec, který následně dokáže rozpoznat speciální detektor. Model například v některých případech místo jednoho pravděpodobného slova použije jeho vhodné synonymum. Čtenář rozdíl obvykle nepozná, detektor by ho ale měl odhalit. Technologie OpenAI se jmenuje textGrain.

Data pod tlakem regulace: Jak firmy získávají kontrolu nad citlivými informacemi, v podcastu s Petrem Kunstátem
Data pod tlakem regulace: Jak firmy získávají kontrolu nad citlivými informacemi, v podcastu s Petrem Kunstátem
0:00/

V praxi má však systém poměrně výrazné limity. U textu dlouhého přibližně 200 slov dokáže detektor vodoznak zachytit asi v 80 % případů. U 400 slov se úspěšnost zvyšuje na zhruba 95 %. Horší výsledky má u funkčních textů, například matematiky nebo programového kódu, kde může změna slova snadněji narušit význam či způsobit chybu. Riziko je samozřejmě největší tam, kde záleží na přesném údaji nebo konkrétním tvrzení.

Ještě podstatnější je, že vodoznak lze poměrně snadno oslabit dodatečnou úpravou textu. Při testech na 400-tokenových pasážích klesla úspěšnost detekce z 92 na 66 % poté, co bylo synonymy nahrazeno 10 % slov. Při nahrazení 25 % slov už detektor vodoznak rozpoznal jen v 17 % případů.

To znamená, že textGrain není nástrojem, který by umožnil s jistotou určit, zda konkrétní text napsala umělá inteligence. Jeho smyslem je spíš vytvořit technicky rozpoznatelný signál, pokud byl text vygenerován způsobem, který tento vodoznak obsahuje.

workshop ChatGPT

Podobné technologie vznikají taky pro obrázky. Microsoft a Meta pracují na vlastních systémech a Google nabízí SynthID-Text, který si pro označování textu vybral například Anthropic. OpenAI už používá jiné mechanismy označování původu u obrázků, zvuku a videa.

Evropská legislativa tak získává přesně to, co požaduje – způsob, jak AI obsah identifikovat. Jen je dobré rozlišovat mezi označením AI textu a spolehlivým důkazem jeho původu. Pokud lze vodoznak výrazně oslabit prostou náhradou některých slov za synonyma, nejde právě o neprůstřelný podpis. OpenAI tedy evropským regulátorům může říct, že svůj AI obsah označuje. Jen by asi nebylo dobré předpokládat, že toto označení přežije každého, kdo ve Wordu umí použít funkci „Najít a nahradit“.

Computertrends - promo

Computertrends si můžete objednat i jako klasický časopis. Je jediným odborným magazínem na českém a slovenském trhu zaměreným na profesionály v oblasti informačních a komunikačních technologií (ICT). Díky silnému zázemí přináší aktuální zpravodajství, analýzy, komentáře a přehledy nejnovejších technologií dříve a na vyšší odborné úrovni, než ostatní periodika na tuzemském trhu.

Obsah Computertrends je určen odborníkům a manažerům z firem a institucí, kteří se podílejí na rozhodovacím procesu při nákupu ICT technologií. Jednotlivá čísla si můžete objednat i v digitální podobě.