Takzvané deepfakes už před časem jasně ukázaly rizika generování fotografií a videí s pomocí umělé inteligence. Každý technologicky zdatnější podvodník mohl zneužít podobu reálného člověka a z důvěřivců pak lákat peníze nebo osobní data. A proto začaly velké společnosti v čele s Googlem vkládat do AI generovaných obrázků a videí neviditelný vodoznak. Textů se to ale zatím nijak netýkalo, a tak internet zaplavuje balast generovaný umělou inteligencí. Teď se ale totéž bezpečnostní opatření chystá i v této oblasti.
Rozpoznat AI generovaný text nemusí být vždy snadné. Základní modely ChatGPT nebo Gemini, které lidé používají zdarma, jsou na základě určitých frází rozpoznatelné celkem snadno. Méně bystří jedinci to ale ani tak nerozpoznají a srdceryvné AI příběhy kolující po sociálních sítích berou jako úplnou realitu. S pokročilejšími modely ovšem mají problém už i odborníci. A když Google před pár dny představil Gemini 4, napřímo se pochlubil, že zvládne tvořit výborné texty.
I proto zřejmě společnosti stojící za AI modely přemýšlejí, jak texty označit tak, aby byl jejich původ snadno rozpoznatelný. A aby skrytý vodoznak nezmizel prostě jen tím, že generovaný text zkopíruji do Poznámkového bloku, zbavím ho veškerého formátování a teprve pak ho použiju. Se svým jedinečným řešením se nyní rozhodla přijít OpenAI stojící za ChatGPT. A pojmenovala ho textGrain.
Mohlo by vás zajímat
Vodoznak pro ChatGPT a Codex
Možná víte, že detektory snažící se určit AI původ textů již existují. Jenže jsou velmi nespolehlivé, protože text vznikající na základě propracovaného promptu často působí jako ten psaný lidskou rukou. A často jsou naopak jako AI texty označovány ty, které poctivě sepsali lidé.
Nejspíš právě proto se OpenAI rozhodla začít používat v této oblasti podobný vodoznak jako je SynthID určený pro fotografie. Nebude pouhým zrakem viditelný, ale stane se nedílnou součástí textu. Pokud tak někdo vygenerovaný výsledek pouze zkopíruje a vloží kamkoliv na internet, bude velmi snadné odhalit jeho původ. A nepomůže už ani překopírování přes zmíněný Poznámkový blok. Vodoznak totiž bude fungovat tak, že přidá statistický signál do výběru slov modelu. Takže jedinou možností proti odhalení by bylo velkou část textu přepsat, což ale postrádá logiku.
Týkat se to bude nejen ChatGPT, ale i Codexu. A novinka bude nejprve spuštěna v Evropě. Což není úplně náhodné. Právě zde totiž platí zákon o umělé inteligenci (EU AI Act), který vyžaduje jasnou rozpoznatelnost AI textů. Takže si troufám říct, že nejde o dobrovolné rozhodnutí OpenAI. Na druhou stranu ale firma nezůstane jen u Evropy a záhy hodlá vodoznak rozšířit celosvětově.
Detektor může chybovat
Je logické, že zároveň vznikl detektoru vodoznaků textu, který toto označení ihned dokáže odhalit. OpenAI zatím přístup udílí pouze výzkumníkům a odborným organizacím. Po řádném otestování ale pravděpodobně bude dostupný veřejně. Zatím nicméně OpenAI přiznává, že i takto pokročilý detektor může chybovat a určit AI text jako skutečný nebo naopak.
Potíž je podle mě také v tom, že na řešení nespolupracuje Microsoft, Google ani Meta, takže například texty vygenerované Gemini nebude umět textGrain odhalit. Na tahu proto teď budou Google, Meta a Anthropic. A já toto řešení rozhodně vítám, protože internet začíná být plný AI balastu, lidé jsou čím dál pohodlnější a kreativita je doslova zabíjena. Což se sice bude dít dál, ale údajní autoři aspoň nebudou dál moci lhát.