Přejít k hlavnímu obsahu

OpenAI chce označit text z ChatGPT. Vodoznak má ale jasné limity

Ilustrační obrázek
OpenAI od 5. října 2026 zavádí vlastní systém pro označování textu vytvořeného umělou inteligencí. Technologie textGrain má v Evropské unii postupně přidávat neviditelný vodoznak do výstupů ChatGPT a Codexu. Uživatel ho neuvidí a běžný detektor zatím nebude veřejně dostupný.

OpenAI reaguje na evropská pravidla

Oznámení přichází krátce po začátku platnosti pravidel transparentnosti podle článku 50 evropského zákona o umělé inteligenci. Evropská komise uvádí, že poskytovatelé generativních systémů mají zajistit strojově čitelné označení obsahu vytvořeného nebo upraveného umělou inteligencí. Tato povinnost se v obecné podobě začala uplatňovat 2. srpna 2026.

OpenAI zvolilo postup ve dvou režimech. Uživatelé ChatGPT a Codexu v Evropské unii dostanou vodoznačené textové výstupy automaticky, a to napříč dostupnými tarify. Zavedení má proběhnout během několika následujících týdnů. Pro zákazníky API po celém světě bude textGrain volitelnou funkcí. Ve výchozím nastavení zůstane vypnutý.

Česká republika do evropského režimu spadá. To znamená, že se změna týká také uživatelů ChatGPT a Codexu v Česku. OpenAI v oznámení nespecifikuje seznam podporovaných jazyků ani rozdíly mezi anglickým a českým textem. Nelze proto tvrdit, že bude detekce v češtině stejně přesná jako v testovaných anglických datech.

Podrobnosti k evropským pravidlům zveřejnila Evropská komise v přehledu k článku 50 AI Actu. Pro firmy používající API z toho plyne hlavně povinnost řešit způsob označování vlastních AI výstupů podle konkrétního nasazení. Samotné zapnutí vodoznaku ale nenahrazuje všechny povinnosti, které mohou dopadat na vydavatele nebo provozovatele služby.

Jak textGrain funguje

TextGrain nevkládá do dokumentu skryté mezery, zvláštní znaky ani řetězce, které by šlo jednoduše vyhledat. Mění statistickou pravděpodobnost volby slov podle tajného klíče. Výsledný text tak na první pohled vypadá stejně jako běžný výstup modelu.

Princip připomíná úpravu jízdního řádu, které si cestující nevšimne, ale kontrolní systém ji dokáže zpětně rozpoznat. Model stále vybírá slova podle významu a zadání, jen část rozhodování probíhá v režimu, který vytváří statistický podpis.

Detektor pak nehledá jednu konkrétní frázi. Vyhodnocuje delší úsek textu a zjišťuje, zda odpovídá vzorci vytvořenému vodoznačením. OpenAI uvádí, že textGrain v interních testech dosahoval srovnatelné nebo lepší účinnosti než další zkoušené přístupy včetně textové varianty SynthID. Nejde však o veřejné nezávislé srovnání všech dostupných metod.

OpenAI chce technologii později zpřístupnit jako open source. Detektor ale při spuštění veřejný nebude. Přístup získají nejprve schválení výzkumníci a odborné organizace, které mají pomoci vyhodnotit chybovost a vhodné způsoby použití.

Detekce funguje hlavně u delšího textu

Výsledky zveřejněné OpenAI ukazují, že délka textu má velký význam. Při nastavené míře falešně pozitivních výsledků na 1 % detektor zachytil vodoznak přibližně u 80 % pasáží dlouhých 200 tokenů. U textů o délce 400 tokenů se úspěšnost pohybovala kolem 92 až 95 %.

Token není totéž co slovo. Jde o menší jednotku, ze které jazykový model text skládá. Přesný poměr závisí na jazyce a konkrétním obsahu. U krátké odpovědi na e-mail proto nemusí být dost materiálu k jistému rozhodnutí, zatímco u delšího článku má detektor více statistických dat.

Výsledky se lišily také podle typu textu. OpenAI uvádí, že matematické odpovědi se rozpoznávaly hůře než texty z oblasti psychologie. Důvod je praktický. V matematice bývá menší prostor pro volbu různých slov, takže model má méně možností, jak do výstupu vložit statistický signál.

To je důležité omezení. Detektor nemůže pracovat jako digitální razítko, které je přítomné nebo nepřítomné v každém jednotlivém slově. Vodoznak je pravděpodobnostní. U krátkých, odborných nebo silně strukturovaných textů proto může být výsledek méně spolehlivý.

Úpravy synonymy vodoznak oslabí

Největší slabinu ukazuje jednoduchá úprava textu. V testu s pasážemi o délce 400 tokenů klesla detekce z přibližně 92 % na 66 %, když bylo synonymy nahrazeno 10 % slov. Po nahrazení 25 % slov klesla úspěšnost na 17 %.

Taková úprava přitom nemusí vyžadovat žádný zvláštní nástroj. Stačí ruční redakce, překlad do jiného jazyka nebo přeformulování vět jiným modelem. OpenAI samo upozorňuje, že technologie se teprve vyvíjí a že spolehlivý výsledek v laboratorních podmínkách nezaručuje spolehlivost při běžném používání.

Vodoznak proto nelze použít jako definitivní důkaz, že konkrétní člověk odevzdal text vytvořený umělou inteligencí. Oznámení také výslovně uvádí, že detekce neurčí autora, účet, zadání ani konverzaci, ze které text vznikl.

Vodoznak neověří pravdivost ani autorství

Nejdůležitější je rozlišit původ textu od jeho kvality. Detekovaný vodoznak neříká, zda je text pravdivý, přesný nebo vhodně zasazený do situace. Stejně tak neurčuje, kolik práce odvedl člověk a kolik model.

Text mohl vzniknout jako návrh, který člověk kompletně přepracoval. Mohl také projít několika koly editace. Detektor přesto může zachytit signál původního výstupu. Naopak nepřítomnost vodoznaku neznamená, že text napsal člověk. Výsledek může být příliš krátký, přepsaný, přeložený nebo vytvořený jiným systémem.

OpenAI uvádí, že vodoznačení nemá určovat vlastnictví textu ani právní odpovědnost. To je podstatné pro školy, redakce i firmy. Samotný výsledek detektoru by neměl být jediným podkladem pro disciplinární rozhodnutí nebo odmítnutí obsahu.

Dopad na kvalitu výstupu je podle testů malý

OpenAI porovnalo vodoznačené a nevodoznačené výstupy modelu GPT-6 Astra. V testu Artificial Analysis Intelligence Index dosáhl nevodoznačený text 49,57 bodu a vodoznačený 49,76 bodu. V benchmarku GPQA Diamond šlo o 94,44 % bez vodoznaku a 93,94 % s vodoznakem.

Rozdíly se objevily i v dalších testech. Například BrowseComp dosáhl 87,92 % bez vodoznaku a 87,35 % s ním. U AutomationBench byly výsledky 34,09 % a 34,86 %. OpenAI z těchto měření vyvozuje, že vodoznačení nemá významný dopad na schopnosti modelu.

Jde však o testy zveřejněné samotným výrobcem. Nejde o nezávislé měření ani o důkaz, že každý typ textu bude stejně kvalitní. V praxi bude záležet na jazyce, délce, tématu a způsobu generování.

Co se mění pro uživatele v Česku

Běžný uživatel ChatGPT si změny pravděpodobně nevšimne. Text bude vypadat stejně a OpenAI neoznámilo samostatný poplatek za vodoznačení. Uživatelé v Evropské unii ho dostanou jako součást výstupu služby v rámci svého tarifu.

Větší dopad mohou pocítit firmy, školy a provozovatelé publikačních systémů. Pokud budou chtít ověřovat, zda text pochází z OpenAI, nemohou zatím jednoduše použít veřejný detektor. Musí požádat o přístup a počítat s tím, že výsledek bude pravděpodobnostní.

Pro český trh je důležitá také jazyková nejistota. OpenAI zveřejnilo měření pro konkrétní typy anglických textů a neuvádí zvláštní výsledky pro češtinu. Detekci českého článku proto nelze automaticky považovat za stejně přesnou jako detekci anglické odpovědi.

OpenAI plánuje svůj přístup průběžně upravovat podle nových standardů, výzkumu a zkušeností s používáním. Zatím je jisté hlavně to, že textGrain bude v EU součástí výstupů ChatGPT a Codexu, zatímco API zákazníci si ho musí zapnout dobrovolně. Detektor zůstává při spuštění omezený na schválené výzkumníky a odborné organizace.

FAQ

Pozná běžný uživatel v textu z ChatGPT vodoznak?

Ne. TextGrain nemá vkládat viditelné značky, skryté mezery ani zvláštní znaky. Signál je založený na statistickém výběru slov a jeho ověření vyžaduje detektor.

Znamená nalezený vodoznak, že celý text napsala umělá inteligence?

Ne. Vodoznak může naznačit, že na části textu pracoval systém OpenAI, neurčuje však rozsah lidské práce, autora ani odpovědnost za obsah.

Bude detekce fungovat stejně dobře u českých textů?

OpenAI v oznámení nezveřejnilo samostatné výsledky pro češtinu. Publikovaná měření se týkají konkrétních testovaných textů, proto nelze přesnost pro český jazyk potvrdit.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.