ChatGPT začne v EU vkládat do textu neviditelný vodoznak. Přečíst ho zatím smí jen vybraní výzkumníci
OpenAI v příštích týdnech začne vkládat do textů z ChatGPT a Codexu neviditelný vodoznak, zatím jen uživatelům v Evropské unii. Metodu pojmenovalo textGrain a podle vlastních testů si vede stejně dobře nebo lépe než SynthID od Google DeepMind. Detektor si ovšem nepustí učitel ani personalista, dostanou ho jen schválení výzkumníci.
Jak textGrain funguje: značka schovaná ve volbě slov
Jazykový model skládá odpověď slovo po slovu a často vybírá z několika rovnocenných možností. TextGrain podle oznámení OpenAI „přidává neviditelný statistický signál do volby slov“. Čtenář na odpovědi nic nepozná, vzorec ale zachytí detektor, který zná klíč.
Stejný princip letos v srpnu popsal Anthropic u Clauda. Model podle jeho vysvětlení volí mezi slovy „zataženo“ a „šedivo“ náhodou. Vodoznak mění jen zdroj té náhody: místo generátoru náhodných čísel rozhoduje tajný klíč a několik předchozích slov. Kvalitu odpovědí to podle OpenAI nesníží, s detekcí je to ale složitější.
Kdy vodoznak selže: krátké texty, matematika a úpravy
Výsledky benchmarků, které OpenAI zveřejnilo, ukazují podobný výkon odpovědí s vodoznakem i bez něj. U krátkých textů detektor podle Engadgetu zachytí značku zhruba v 80 % případů, hůř si poradí s matematikou a úspěšnost klesá i tehdy, když text po ChatGPT někdo přepíše.
Firma sama varuje, že silný výkon v ideálních podmínkách nezaručuje spolehlivou detekci v běžném používání. Vodoznak podle ní také neověří přesnost textu, neurčí jeho vlastníka, nezměří podíl člověka a lidské autorství nedokáže. Proto firma detektor zpřístupňuje opatrně.
Detektor dostanou jen schválení výzkumníci
Od pondělí přijímá OpenAI žádosti výzkumníků a odborných organizací. Každou posoudí zvlášť podle evropského kodexu praxe (Code of Practice). Nástroj odpoví jen na otázku, jestli text obsahuje vodoznak textGrain. Uživatele neidentifikuje a jeho prompty ani konverzace neukáže.
Veřejnou verzi firma zatím nevydá kvůli riziku přehlédnutých vodoznaků a falešných poplachů. Technologii chce později zveřejnit jako open source. Že celá věc začíná zrovna v Evropě, má jednoduchý důvod v unijním právu.
Proč jen EU: nařízení o umělé inteligenci a termín 2. prosince
Článek 50 nařízení AI Act ukládá poskytovatelům generativní AI označit textové výstupy strojově čitelným způsobem, aby šly rozpoznat jako uměle vytvořené. Pravidla platí od 2. srpna 2026, služby spuštěné dřív mají odklad do 2. prosince. Za porušení hrozí pokuta až 15 milionů eur nebo 3 % celosvětového ročního obratu.
Povinnost se týká Microsoftu, Googlu, Mety i Anthropicu. Gemini používá SynthID-Text od roku 2024 a vodoznaky pro Claude vycházejí ze stejné technologie, jak popsal The Verge.
Mimo EU zůstane ChatGPT zatím bez vodoznaku. Zákazníci API po celém světě si ho u vybraných modelů mohou zapnout dobrovolně už teď. OpenAI ho během několika týdnů chystá i pro své modely dostupné přes cloudové partnery.
Můj pohled: stopa, kterou zatím nikdo nepřečte
V ChatGPT se pro vás na první pohled nic nezmění, odpovědi budou vypadat stejně. Kdo z něj přebírá texty do práce nebo do školy, bude je mít označené signálem.
Z vodoznaku bych proto nedělal nástroj na usvědčování. Otázkou rozhodně zůstává, co se stane, když část výstupu opravíte a část zůstane původní. Označení jen říká, že se AI na vzniku textu podílela. A OpenAI samo přiznává, že lidské autorství neprokáže a u kratších odpovědí mine zhruba každý pátý případ.