Společnost OpenAI oznámila, že začne do textů generovaných modely jako ChatGPT a Codex přidávat neviditelné digitální vodoznaky. Toto opatření se týká uživatelů v Evropské unii a představuje reakci na nové nařízení EU o umělé inteligenci, jehož pravidla pro transparentnost vstoupila v platnost 2. srpna. Cílem je, aby byl obsah vytvořený umělou inteligencí rozpoznatelný pro jiné systémy.
Zavádění těchto vodoznaků proběhne v následujících týdnech pro oprávněné uživatele v rámci EU. Zajímavostí je, že vývojáři využívající API OpenAI kdekoliv na světě si mohou tuto funkci aktivovat u vybraných modelů již nyní, přičemž je ve výchozím stavu vypnuta. Společnost zatím neplánuje zavádět vodoznaky globálně jako výchozí nastavení.
Mechanismus vodoznakování není tradičním grafickým symbolem. Funguje na principu jemného ovlivňování výběru slov modelem, čímž vzniká vzor, který lidské oko nezaznamená, ale detekční systém jej dokáže rozpoznat. Klíčovou vlastností je, že tento „otisknutý“ vzor je neoddělitelnou součástí textu a zůstává zachován i při jeho kopírování a vkládání. OpenAI zdůrazňuje, že vodoznak neidentifikuje konkrétního uživatele a jeho aktivace neměla měřitelný vliv na výkonnost modelů.
K této technologii, nazvané „textGrain“, zveřejnila OpenAI i podrobnou technickou zprávu, která vznikla ve spolupráci s výzkumníky z Pensylvánské a Yaleovy univerzity. Metoda využívá tajného klíče k uspořádání předpovědí následujícího slova. Kumulací stovek takovýchto drobných „nápověd“ může detektor identifikovat obsah generovaný AI, a to pouze na základě samotného textu a daného klíče.

Máte nápad na web nebo aplikaci?
Proberme ho spolu — nezávazně, bez tlaku a s konkrétním doporučením dalšího kroku.
Nicméně, testy OpenAI ukázaly, že vodoznak může být odstraněn editací. Například nahrazení 10 % slov synonymy snížilo úspěšnost detekce z přibližně 92 % na 66 %. Obtížnější je detekce také u krátkých úseků textu, matematických odpovědí a přeloženého obsahu. Právě kvůli těmto omezením bude počáteční přístup k detektoru poskytnut pouze schváleným výzkumníkům a odborným organizacím, kteří pomohou s vyhodnocením spolehlivosti a zodpovědného využití.
Společnost také upozorňuje, že absence vodoznaku automaticky neznamená lidské autorství. Text mohl být příliš krátký, výrazně editovaný, nebo mohl pocházet z AI systému jiné společnosti. Vodoznaky tak mohou naznačovat, že systém OpenAI se podílel na generování nebo zpracování části textu, ale neříkají nic o míře lidského úsudku, editace nebo kreativity vložené do díla.
Tento krok přichází několik měsíců poté, co společnost Anthropic oznámila globální zavedení vodoznaků pro text generovaný jejím modelem Claude, což vyvolalo smíšené reakce u některých uživatelů.
