Claude dostává podpis, který při čtení neuvidíte
Anthropic popsal nový systém v článku How Claude marks AI-generated content. Podle něj budou modely Claude uvedené na trh v Evropské unii 2. srpna 2026 nebo později podporovat strojově čitelné označování už od svého uvedení. Stejný text ale zároveň říká, že značení se bude vztahovat na výstupy podporovaných modelů všude, kde je Claude dostupný — tedy celosvětově, nejen v EU.
To je podstatný rozdíl oproti představě, že Anthropic pouze přidává evropským uživatelům speciální omezení. Nový mechanismus se má týkat rozhraní Claude, API Claude Platform, nástroje Claude Code, pracovního prostředí Claude Cowork i služby Claude Tag. Textový vodoznak má být přítomen také tehdy, když vývojář používá podporovaný model přes AWS, Google Cloud nebo Microsoft Foundry. U souborů však Anthropic upozorňuje, že některé cloudové platformy nemusí podporovat všechny typy značení.
Jak funguje značení textu
Anthropic nepopisuje konkrétní algoritmus ani nezveřejnil technickou dokumentaci k detekci. Uvádí pouze, že model při generování „vetká“ nepostřehnutelný vodoznak přímo do textu. Čtenář ho neuvidí, nemá měnit význam, kvalitu ani čitelnost odpovědi a při běžném kopírování a vložení může cestovat spolu s textem dál.
Technicky to není značka v podobě skrytého HTML komentáře nebo přidaných znaků, které by šlo jednoduše zobrazit v textovém editoru. Pravděpodobný princip textových vodoznaků spočívá v řízeném výběru mezi statisticky podobnými dalšími slovy. Model tak vytváří dostatečně dlouhý text s určitým rozpoznatelným vzorem, aniž by změnil jeho obsah. To je ale redakční vysvětlení obecného principu, nikoli potvrzení konkrétní implementace Anthropicu — firma si ji zatím nechává pro sebe.
Anthropic současně slibuje nástroje, pomocí kterých budou moci značky kontrolovat uživatelé i třetí strany. Ve zveřejněném dokumentu však stojí pouze to, že podrobnosti přijdou v další technické dokumentaci. V tuto chvíli tedy nelze vzít libovolný odstavec, vložit ho do oficiálního ověřovače a dostat odpověď, zda vznikl v Claudu.
U obrázků nejde o stejný vodoznak
U podporovaných souborů, například formátů SVG, PNG a JPG, Anthropic používá podepsaná metadata podle standardu C2PA (Coalition for Content Provenance and Authenticity). C2PA lze zjednodušeně přirovnat k digitálnímu štítku původu: soubor může nést informaci o tom, že byl vytvořen nebo zpracován určitým nástrojem, a kryptografický podpis umožní ověřit, zda se metadata po cestě nezměnila.
Tento mechanismus má jiný profil než textový vodoznak. Metadata nejsou součástí samotných obrazových pixelů. Mohou zmizet při převodu formátu, opětovném uložení v grafickém editoru, pořízení snímku obrazovky nebo při nahrání na službu, která metadata odstraňuje. Přítomný platný podpis je proto užitečným signálem původu; jeho nepřítomnost ale neznamená, že obrázek umělá inteligence nevytvořila.
Anthropic reaguje na evropský AI Act
Datum 2. srpna není náhodné. Evropská komise uvádí, že od tohoto dne se uplatňují povinnosti transparentnosti podle článku 50 evropského nařízení o umělé inteligenci. Kodex pro transparentnost obsahu vytvořeného umělou inteligencí má poskytovatelům pomoci s označováním a detekcí syntetického obsahu. Kodex je dobrovolný nástroj pro prokazování souladu, samotné povinnosti podle AI Actu jsou ale právními povinnostmi.
Anthropic tedy oznamuje praktickou podobu svého závazku vůči evropským pravidlům. Zároveň si zjednodušuje provoz tím, že značení aplikuje po celém světě. Starší modely, které byly uvedeny před 2. srpnem, mají přechodné období. Anthropic píše, že jejich podpora značení je „v procesu“, nikoli že už všechny starší výstupy označuje. To se může týkat i modelů, které čeští uživatelé běžně používají, protože firma zatím nezveřejnila přesný seznam aktivovaných variant.
První reakce: transparentnost, nebo ztráta kontroly?
Oznámení vyvolalo na sociálních sítích rychlou a převážně kritickou reakci. Část komentujících vítá možnost odlišit obsah vytvořený AI od textu, který vznikl bez jejího zásahu. Pro vydavatele, školy, firmy nebo platformy by strojově čitelný signál mohl být praktičtější než dnešní nespolehlivé AI detektory založené pouze na stylu psaní.
Silnější vlna nesouhlasu se týká placených uživatelů. Kritici argumentují, že pokud si službu předplácejí, nechtějí do svého pracovního obsahu dostávat trvalou a potenciálně zjistitelnou stopu bez možnosti odmítnutí. Někteří přirovnávají situaci k viditelnému vodoznaku u generátorů obrázků a tvrdí, že by neviditelné označení mělo být součástí bezplatné verze, nikoli všech tarifů. Jiní mluví o zásahu do soukromí, zejména u právních dokumentů, interních strategií nebo novinářské práce.
Technická námitka je ještě zásadnější: není jasné, jak odolný bude vodoznak vůči úpravám. Komentáře citované v analýzách Explainx upozorňují na obavu, že změna formulací, překlad, parafráze nebo smíchání s lidským textem může signál oslabit. U zdrojového kódu je problém ještě výraznější — formátovače, lintery a refaktoring běžně přepisují přesně ty tokeny, na kterých by statistická značka mohla stát.
Podobně se vyjádřil i The Register, podle kterého uživatelé Claude pochybují, zda textové vodoznaky skutečně přinesou spolehlivou identifikaci. Na Hacker News se první diskuse zatím nesla spíše v duchu ověřování zdroje a kritiky kvality oznámení než jako jednoznačná podpora. Z veřejných reakcí je tak patrné hlavně napětí mezi přáním po transparentnosti a obavou, že se z pravděpodobnostního signálu stane důkaz používaný proti uživateli.
Co značka dokáže — a co z ní nelze vyčíst
Anthropic je v této části opatrnější než některé virální příspěvky. Detekovaná značka podle firmy znamená, že text mohl být Claudem zpracován. Neznamená, že Claude vymyslel původní myšlenky. Uživatel může vložit vlastní článek, nechat ho přeložit, zkrátit nebo jazykově upravit a výsledný text přesto ponese značku.
Stejně tak absence značky není potvrzením lidského autorství. Signál může zmizet po důkladné editaci, překladu nebo smíchání s jiným textem. U velmi krátkých pasáží nemusí být dost materiálu pro spolehlivé rozhodnutí. U souborů lze metadata odstranit převodem či opětovným uložením. To znamená, že výsledek budoucího detektoru by měl být interpretován jako indicie o zpracování, nikoli jako rozsudek nad autorstvím.
Co to znamená pro české uživatele
Český uživatel nemusí kvůli oznámení měnit nastavení. Značení je na úrovni modelu a Anthropic nepopisuje možnost jeho vypnutí. Praktický dopad ale pocítí firmy, školy a redakce, které už dnes řeší, zda a jak používání AI přiznávat. V interních pravidlech by měly rozlišit tři různé věci: kdo dodal původní myšlenku, kdo text napsal a zda byl text následně zpracován AI nástrojem.
Pro instituce bude důležité počkat na technickou dokumentaci, hlavně na informace o délce textu potřebné k detekci, chybovosti a přístupu k ověřovacímu nástroji. Do té doby není rozumné označovat jediný výsledek budoucí kontroly za důkaz podvodu. Anthropicův systém může zlepšit transparentnost, ale sám o sobě nevyřeší otázku autorství ani kvality obsahu.
Bude vodoznak v každém textu z Claude?
Anthropic uvádí podporu u modelů uvedených na trh od 2. srpna 2026 a napříč podporovanými produkty. U starších modelů je nasazení teprve v přechodu, takže firma zatím nepotvrdila, že každý jejich výstup značku obsahuje.
Dokáže vodoznak dokázat, že text napsala umělá inteligence?
Ne. Podle Anthropicu značka signalizuje, že text mohl být Claudem zpracován. Může jít také o lidský text, který Claude pouze přeložil, opravil nebo shrnul. Detekce proto nemá být důkazem původního autorství.
Lze označení z textu nebo obrázku odstranit?
Anthropic nepopisuje úplný postup odstranění. Firma ale připouští, že těžká editace, parafráze, překlad nebo příliš krátký text mohou detekci zmařit. U souborů může C2PA metadata zmizet při převodu formátu, opětovném uložení nebo pořízení snímku obrazovky.