Co v článku najdete
- Co se píše v médiích a co říkají oficiální dokumenty
- Co říká článek 50, odstavec 2
- Proč je zavedení digitálních značek v praxi tak nevyrovnané
- Co skrytá značka neprozradí o skutečném autorství
- Výzkumníci dokázali vodoznaky vymazat i zfalšovat
- Kdo může skryté označení ověřit
- Proč je to důležité pro specialisty na vyhledávání
- Pohled do budoucna
- Často kladené otázky (FAQ)
Společnost Anthropic plánuje do textů vytvořených AI modelem Claude vkládat neviditelnou digitální značku neboli vodoznak. Tento článek vám vysvětlí, jak označení potvrdí výstup umělé inteligence, proč přesto nedokáže zaručit skutečné autorství textu, a na co byste se v praxi měli připravit do budoucna.
Co se píše v médiích a co říkají oficiální dokumenty
Anthropic nedávno oznámil své plány na označování textů generovaných modelem Claude, čímž reaguje na požadavky Aktu o umělé inteligenci od EU, konkrétně článku 50. Reakce na sebe nenechala dlouho čekat. Autoři, kteří Claude používají k úpravám vlastních textů, odmítají, aby jejich práce takové označení nesla. Vývojáři zase přišli s úplně jinou sérií výhrad a obě strany tak strávily několik dnů dohadováním o tom, kam vlastně vodoznak patří.
Respektovaný magazín Forbes informoval, jak uživatelé protestují proti tomu, aby jejich vlastní práce dostala nálepku obsahu vytvořeného pomocí AI. Server TechCrunch zachytil podobné emoce v diskuzích na platformě Reddit, kde se ale část komunity postavila proti stěžovatelům. Server Decrypt mezitím upozornil na vznikající open-source projekty, které se snaží tyto skryté digitální stopy obcházet nebo úplně narušovat.
Některé zprávy naznačují, že systém označování už reálně běží. Stránka nápovědy společnosti Anthropic uvádí, že modely uvedené na trh v EU od 2. srpna podporují tuto identifikaci hned od spuštění a na zavedení do starších modelů se pracuje. Na stránce však není uvedený žádný konkrétní AI nástroj, který by značku opravdu nesl.
Forbes zdůrazňuje, že uživatelé nemají možnost se z označování odhlásit, a možnost vypnutí nezmiňuje ani samotná nápověda od Anthropic. Co však v médiích většinou zapadá, je fakt, že samotné značení z principu nefunguje všude stejně. Anthropic sám přiznává, že označený výstup nemusí vždy obsahovat zachytitelnou stopu a že evropský předpis nevyžaduje značkovat volný text kratší než 200 tokenů (cca 150 slov v angličtině a 120 slov v češtině).
Co říká článek 50, odstavec 2
Druhý odstavec článku 50 Aktu o AI vyžaduje, aby poskytovatelé systémů generativní umělé inteligence označovali výstupy (zvuk, obrázky, videa i text) strojově čitelným způsobem. Z obsahu tak musí být hned jasné, že jej vytvořila nebo upravila umělá inteligence.
Poskytovatelé musejí toto označení zajistit tak, aby bylo maximálně efektivní, vzájemně kompatibilní, odolné a spolehlivé, jak jen to současné technologie umožňují. To, co je dnes technicky možné, závisí na typu obsahu, finanční náročnosti i celkové úrovni technologického vývoje.
Povinné značkování se nevztahuje na případy, kdy AI pouze pomáhá s běžnými úpravami nebo zásadně nemění vložená data ani jejich celkový význam. Pokyny Evropské komise navíc z tohoto pravidla vyjímají určité výstupy, jako jsou třeba zdrojové kódy nebo krátké sekvence čísel, symbolů a písmen.
Dobrovolný rámec pro dodržování předpisů poskytuje takzvaný Kodex postupů pro transparentnost AI obsahu. Do konce července 2026 se k němu přihlásilo zhruba 190 organizací, mezi nimiž najdete firmy jako Google, Meta, Microsoft, OpenAI nebo právě Anthropic a ve druhém sledu také značky jako Lenovo či Lufthansa a další renomované společnosti.
Zatímco článek 50 odst. 2 ukládá povinnost označovat informace samotnému poskytovateli, článek 50 odst. 4 přidává další požadavek: Označovat ve veřejném zájmu deepfake obsah a AI texty publikované jako informace. Evropská komise k tomu upřesňuje, že vydavatelé se při plnění této povinnosti nemohou spoléhat jen na skryté značky od vývojářů AI.
Článek 50 obsahuje také čtyři podmínky, na základě kterých mohou vydavatelé získat z označování obsahu umělé inteligence výjimku:
- Autorizace a redakční odpovědnost: Text prošel procesem lidské kontroly nebo redakční úpravou a konkrétní osoba (vydavatel/redakce) za něj nese plnou redakční odpovědnost.
- Umělecký, tvůrčí nebo satirický účel: Jde o dílo zjevně umělecké, tvůrčí, satirické či pamfletické povahy, kde by viditelné označení narušilo samotnou podstatu, estetiku či myšlenku díla (při zachování přiměřených záruk proti zneužití).
- Výzkumný a vývojový účel: Obsah je generován čistě pro účely vědeckého výzkumu, vývoje nebo výzkumných zkoušek před uvedením na trh.
- Trestní řízení a bezpečnost státu: Použití AI obsahu je nezbytné pro odhalování, vyšetřování či stíhání trestných činů nebo pro účely národní bezpečnosti a veřejné ochrany.
Proč je zavedení digitálních značek v praxi tak nevyrovnané
Google uvádí, že jeho nástroj SynthID označuje texty vygenerované v aplikaci i ve webovém rozhraní Gemini. Kodex podepsal 24. července a jako partnery pro napojení této technologie napříč systémy jmenoval společnosti Apple, ElevenLabs, Kakao, Nvidia a OpenAI. Ve stejném příspěvku ale Google zároveň vyjádřil obavu, že zavádění dalších pravidel ve chvíli, kdy se samotná technologie teprve vyvíjí, by mohlo ohrozit konkurenceschopnost celé Evropy.
Stránka OpenAI zaměřená na původ obsahu uvádí využívání metadat C2PA a nástroje SynthID u podporovaných obrázků a od 31. července také u zvuku. V plánu má postupně přidávat další typy obsahu, text ale mezi podporovanými formáty v tuto chvíli nefiguruje.
Společnost Anthropic neuvádí žádný konkrétní model, který by skryté označení v tuto chvíli reálně nesl. Tvrdí však, že po zavedení se bude značkování týkat výstupů ze všech podporovaných modelů po celém světě, a to napříč jejím API, aplikacemi i vývojářskými nástroji.
Společnosti Meta a Microsoft sice patří mezi signatáře první části kodexu, nicméně v jejich oficiálních materiálech se ještě v polovině srpna nenacházela žádná konkrétní pravidla, která by řešila přímo označování textu.
Co skrytá značka neprozradí o skutečném autorství
Claude nemusí být původním autorem textu, který v sobě nese skryté označení. Lidé do něj totiž běžně vkládají cizí podklady k revizi, překladu, shrnutí nebo k přepsání. Výstup tak získá digitální stopu AI, přestože samotné myšlenky i původní formulace pocházejí odjinud. Obsah navíc mohl po úpravě modelem Claude projít ještě dalšími změnami.
Anthropic uvádí pět hlavních důvodů, proč označený text nemusí v praxi vykazovat zachytitelnou stopu:
- Použitý model vznikl ještě před zavedením podpory značkování.
- Text prošel výraznými úpravami, parafrázováním, překladem nebo byl začleněný do jiných textů.
- Pasáž je příliš krátká na to, aby poskytla spolehlivý signál.
- Souborová metadata zmizela při změně formátu (to platí u obrázků či audia), případně byl samotný text zkrácený či silně přeformulovaný.
- Konkrétní rozhraní či platforma nepodporovaly tento typ značení.
Samotný kodex počítá s označováním u souvislého textu delšího než 200 tokenů. Ve svém slovníku pojmů označuje jakýkoliv kratší úsek za velmi krátký text a lze očekávat, že se tato hranice bude s dalším vývojem technologií postupně snižovat.
Pro zvuk, obrázky, video a text v souborech šířených online vyžaduje kodex zpravidla dvoje označení, protože žádná samostatná technika nedokáže splnit všechny čtyři stanovené požadavky. Jelikož běžný souvislý text v těle zprávy v sobě nemůže nést klasická metadata, kodex pro tento formát akceptuje pouze jednu vrstvu skryté stopy s tím, že u kratších pasáží může být méně spolehlivá.
Finální pokyny Evropské komise z 20. července 2026 výslovně řadí AI překlady mezi příklady, na které se vztahuje výjimka podle článku 50 odstavce 2, a to společně s opravou gramatiky a kontrolou pravopisu. Anthropic přitom uvádí, že přeložený výstup v sobě kódovanou značku stále mít může. Zjištěná stopa tak automaticky neznamená, že článek 50/2 vyžadoval daný výstup povinně označit.
Výzkumníci dokázali vodoznaky vymazat i zfalšovat
Vědci z laboratoře SRI na prestižní technické vysoké škole ve švýcarském Curychu už před časem ukázali, že při běžném dotazování modelu přes veřejné API dokáže útočník získat dostatek informací o celém systému značkování. Díky tomu pak může skryté stopy odstranit, nebo je dokonce zfalšovat. A to i u metod, které dřívější odborné práce považovaly za zcela bezpečné.
Celá akce přitom inženýry vyšla na méně než 50 dolarů a průměrná úspěšnost přesáhla 80 %. V rámci samostatného experimentu vědci navíc zjistili, že u běžného textu vyhodnotily detektory minimálně 74 % zdařilých parafrází obsahu bez vodoznaku jako označený text (při předpokládané chybovosti falešné detekce 1 z 1 000).
Na konferenci ICML 2025 pak jiný tým oznámil téměř stoprocentní úspěšnost při prolomení sedmi nejnovějších metod značkování, a to s náklady pouhých 0,88 dolaru na milion tokenů. Jejich útok založený na parafrázování se zaměřuje přímo na označené tokeny, aniž by k tomu potřeboval přístup k samotnému algoritmu nebo modelu.
Příslušný kodex přitom po signatářích vyžaduje, aby důkladně otestovali, jak dobře jejich značení odolá úmyslným pokusům o zkopírování, odstranění, přegenerování nebo změnu. Jako běžné úpravy, které by skrytá značka měla bez problémů přežít, zmiňuje právě parafrázování a překlad. Ani jedna ze zmíněných studií nicméně netestovala přímo řešení od Anthropic. Ten od té doby upřesnil, že skrytá značka v modelu Claude vychází z metody SynthID-Text, kterou Google DeepMind publikoval v roce 2024. Jestli a v čem se jeho konkrétní verze liší, už ale nesdělil.
Kdo může skryté označení ověřit
Příslušný kodex nařizuje, aby společnosti, které své výstupy opatřují skrytou značkou, nabídly veřejnosti způsob, jak si ji ověřit.
Anthropic uvádí, že bude uživatelům i třetím stranám s rozpoznáváním svých kódovaných značek pomáhat, a technické detaily plánuje zveřejnit později. Oficiální stránka k nástroji SynthID od Google nabízí návod na ověřování obrázků, videí a zvuků vytvořených v platformě Gemini. Google zároveň sdělil, že jeho detektor pro tyto formáty aktuálně testují novináři a mediální odborníci. Společnost navíc zpřístupnila v rámci SynthID i skryté značkování pro text.
Ověřovací nástroj od OpenAI v současnosti pracuje s obrázky a zvuky. Žádný ze zmíněných systémů ale v tuto chvíli neumožňuje ověřovat čistý text. OpenAI k tomu dodává, že absence zjištěného signálu u obrázků a zvuku ještě automaticky neznamená, že obsah pod jejich hlavičkou nevznikl.
Proč je to důležité pro specialisty na vyhledávání
Týmy pro tvorbu webového obsahu denně publikují na klientských stránkách texty, u kterých si pomáhaly umělou inteligencí. Stále větší část z nich v sobě teď nese strojově čitelnou stopu od modelu Claude, která s textem putuje i po jeho vložení do redakčního systému (CMS) a vydání na webu.
Tyto skryté značky existují proto, aby je dokázaly přečíst stroje. O tom, jaká hodnocení k nim přisoudí, pak rozhodují právě firmy, které tyto detektory provozují. Zatím ale nikdo oficiálně nepotvrdil, jestli vyhledávače s takto označeným obsahem zacházejí jinak při jeho procházení, indexaci nebo zobrazování ve výsledcích vyhledávání.
A pak je tu ještě každodenní praktický problém: Když použijete Claude jen k vyčištění vlastního konceptu, můžete svému textu nechtěně uškodit. Zjištěná stopa totiž říká pouze to, že AI text zpracovala, ne že ho celý sama napsala. A naopak, neúspěšná detekce neznamená vůbec nic, protože starší modely, krátké pasáže nebo výrazně upravený text projdou bez jediného nálezu. Jenže lidé mohou i takový výsledek vnímat jako jasný důkaz práce umělé inteligence.
Pohled do budoucna
Skryté značkování se šíří rychleji, než experti stíhají sledovat. Anthropic svůj detektor zatím vůbec nezveřejnil, nástroj od Google se zaměřuje na obrázky, videa či zvuk a detektor od OpenAI řeší rovněž jen obrázky a audio.
Tato mezera tak vytváří prostor pro obavy. Klienti, univerzity i zakázkové platformy začnou už brzy požadovat důkaz, že text napsal člověk, a to v době, kdy jim to ještě nikdo nebude moci opravdu spolehlivě potvrdit. Pravděpodobným scénářem je tak trh zaplavený pochybnými detektory AI obsahu, používajícími signály, které k takovému účelu nikdy neměly sloužit.
Zásadním faktorem pro to, jak moc se tenhle přístup rozšíří, bude vzájemná kompatibilita a schopnost spolupráce. Jestliže půjde kontrolu provést snadno, v jednom kroku a na jednom místě, místo zdlouhavého dotazování každého vývojáře zvlášť, pak se skryté značky promění z pouhého legislativního požadavku ve skutečně použitelné signály. Tedy data, které mohou platformy, vydavatelé i vyhledávače smysluplně využívat ve velkém měřítku.
Často kladené otázky (FAQ)
Proč skrytý vodoznak z modelu Claude nezaručuje, že text celý napsala umělá inteligence?
Lidé do AI běžně vkládají vlastní autorské koncepty k jazykové korektuře, přeložení nebo přeformulování. Výstup sice získá digitální stopu AI, ale hlavní myšlenky i struktura pocházejí od lidského autora, případně mohl text po úpravě modelem projít ještě dalšími ručními změnami.
Jaké jsou hlavní výjimky, kdy vydavatelé nemusí označovat obsah vytvořený pomocí AI?
Povinnost značení se podle článku 50 Aktu o AI nevztahuje na texty, které prošly lidskou redakční kontrolou a konkrétní osoba za ně nese plnou odpovědnost. Výjimka platí také pro umělecké, tvůrčí či satirické účely, vědecký výzkum a použití pro potřeby bezpečnostních složek.
Dokážou současné vyhledávače a detektory vodoznaky v textu spolehlivě ověřit?
Zatím ne. Nástroje od společností Google i OpenAI v současnosti ověřují pouze obrázky, audio či video a oficiální detektor pro čistý text chybí. Absence zjištěné stopy navíc neznamená, že text nenapsala AI, protože vodoznak běžně zaniká při zkrácení, výrazném přepsání nebo u starších modelů.
Zdroj: searchengineland.com, searchenginejournal.com, marketingland.com, facebook.com, cpcstrategy.com
Autor: Martin Kulhánek
Foto zdroj: AI, pixabay.com