Anthropic od poloviny srpna 2026 vkládá do textů, které generuje Claude, neviditelný statistický watermark. Netýká se to skrytých znaků ani metadat připojených k souboru - jde o jemnou úpravu toho, jak model při generování vybírá mezi pravděpodobnými slovy. Výsledek vypadá pro čtenáře úplně normálně, ale kdo má odpovídající dešifrovací klíč, dokáže z textu s určitou pravděpodobností odhadnout, že na něm pracoval Claude.
Jak to funguje
Anthropic ve svém vysvětlení uvádí, že přístup vychází z metody SynthID-Text od Google DeepMind. Model při generování odpovědi mění zdroj náhodnosti, se kterým vybírá mezi jazykově podobně pravděpodobnými tokeny - u nízkorizikových rozhodnutí tak zanechává v textu vzorec, který je pro čtenáře neviditelný, ale detekovatelný pro toho, kdo zná klíč.
Kde všude se watermark objeví
Označení se týká Claude Platform API, claude.ai, Claude Code, Claude Cowork, Claude Tag i modelů dostupných přes AWS, Google Cloud a Microsoft Foundry - prakticky všech produktů, kde Claude generuje text. Podle Anthropicu vodoznak „cestuje“ s textem i po zkopírování jinam a může přežít i určité množství úprav.
Proč zrovna teď
Bezprostředním spouštěčem je článek 50 evropského AI Actu, který od 2. srpna 2026 vyžaduje, aby poskytovatelé generativních AI systémů označovali svůj výstup strojově čitelným způsobem (viz náš článek o pravidlech transparentnosti). Anthropic ale watermarking nasadil globálně, ne jen pro evropské uživatele.
Co to není
Anthropic sám zdůrazňuje, že nejde o spolehlivý „AI detektor“ ani o nástroj k identifikaci konkrétního uživatele či konverzace. Důkladné přepsání textu - vlastními slovy, strojovým překladem tam a zpět, nebo jiným modelem - watermark může odstranit. Detekce tak nanejvýš ukazuje pravděpodobnou účast Clauda, ne jistotu.
Proč na tom záleží
Photo Validator se dlouhodobě zabývá otázkou „je tenhle obsah AI?“ - a watermarking textu je první velký krok velké laboratoře k tomu, aby na podobnou otázku u textu šlo aspoň částečně odpovědět technicky, ne jen odhadem podle stylu. Zároveň jasně ukazuje limity takového přístupu: watermark pomáhá, ale nenahrazuje širší kontext a lidský úsudek.