Claude bo označeval svoja besedila

Matej Huš

16. avg 2026 ob 16:14:01

Anthropicovi modeli Claude bodo v prihodnje svoja besedila opremili z nevidnimi vodnimi žigi, s katerimi bo mogoče kasneje dokazovati, da je pri nastajanju besedila sodeloval Claude. Ključna beseda je sodeloval, saj bodo vodni žigi prisotni vsakokrat, ko bo Claude besedilo opazneje spreminjal, najsi ga bo v celoti napisal, prevedel ali pa zgolj jezikovno popravil.

Vodni žigi v slikah in videoposnetkih niso nič novega, saj te datoteke vsebujejo ogromno podatkov, kamor zlahka skrijemo informacije, ki človeku niso vidne. Precej teže pa je to storiti v besedilu, sploh če se izognemo raznim skritim znakom in drugim tehničnim trikom. Anthropic trdi, da bo njihov vodni žig ostal, četudi bi besedilo ročno pretipkali. Kako neki bodo to dosegli?

Besedila bodo neopazno podpisovali s statistiko. Pojasnili so, da gre za izbor besed, kjer ima jezikovni model običajno na voljo več ustreznih možnosti. Model jih razvrsti po verjetnosti, izbor pa sedaj ne bo več naključen. Odvisno od uporabljenega ključa bo model vsakokrat izbral besedo, ki je na seznamu na točno določenem mestu. S poznavanjem ključa bo mogoče nato rekonstruirati to obnašanje in ugotoviti, ali je besedilo napisal Claude ali ne. Vsa besedila bodo enako kvalitetna, človeški bralec pa ne bo mogel utemeljiti razlik.

Podoben način je izumil Googlov DeepMind pred dvema letoma in ga poimenoval SynthID-Text, koncept pa je že leta 2022 predstavil Scott Aaronson. Vodni žig se skriva v viru naključnosti, ki je za vsak jezikovni model ključen. Metoda ima nekaj pomanjkljivosti, in sicer ne deluje na kratkih besedilih ali če model naredi zgolj minimalne popravke.