AI Detection

Watermark Claude: Kde značka sídlí a co prokazuje

Anthropic začal označovat textový výstup Claude dne 11 August 2026. Téměř každé vysvětlení od té doby popsalo nesprávný mechanismus. Značka není znak skrytý na stránce, je to statistické zkreslení v tom, která slova model zvolil, a právě tento rozdíl rozhoduje o všem: co ji nese, co ji odstraní a jak málo ve skutečnosti pozitivní výsledek vypovídá o tom, kdo dokument napsal.

10 min
Diagram contrasting a hidden-character watermark with a sampling watermark carried in the model's word choices

Většina toho, co bylo od srpna napsáno o vodoznaku Claude, popisuje mechanismus, který není tím, který Anthropic nasadil. Běžné vysvětlení předpokládá neviditelný znak vložený mezi slova, mezeru o nulové šířce nebo podobný znak Unicode, který čeká, až jej detektor najde. To by byl rozumný odhad. Je však chybný, a tato chyba není akademická, je to důvod, proč celá kategorie bezplatných nástrojů prodávaných jako odstraňovače vodoznaků nemá na tento konkrétní znak vůbec žádný účinek.

Značka Anthropic spočívá ve volbě samotných slov. Do textu se nic nevkládá. Jakmile je to jasné, praktické otázky si odpoví samy způsobem, jakým to nemohou, dokud je ve hře představa skrytého znaku, včetně toho, které operace značku přenášejí dál, které ji odstraňují, a co vám detektor vlastně sděluje, když hlásí nález.

Následující text vychází z vlastní dokumentace Anthropic, nikoli z mediálního pokrytí kolem ní, a záměrně přesně vymezuje omezení, která sama společnost uvádí.

Anthropic's Claude support article on how Claude marks AI-generated content: embedded watermarks in text and signed provenance metadata under the EU AI Act code of practice
Vlastní dokumentace Anthropic k plánu označování, vložené textové vodoznaky plus podepsaná metadata o původu, přičemž nové modely označují od prvního dne podle časového plánu EU AI Act.

Co Anthropic zapnul a kdy

Anthropic začal označovat výstupy Claude 11 August 2026. Jeho článek v centru nápovědy k tomuto tématu popisuje textovou značku jako "an imperceptible watermark directly into the text itself" a uvádí, že čtenář "won't see it, and it doesn't change the meaning, quality, or readability".

Pokrytí je široké. Modely uvedené na trh 2. srpna 2026 nebo později nesou označení od vydání a Anthropic uvádí jako dotčené povrchy Claude Platform API, Claude, Claude Code, Claude Cowork a Claude Tag, včetně Claude přístupného prostřednictvím AWS, Google Cloud a Microsoft Foundry. Platí celosvětově. Považovat cokoli sepsané před srpnem za automaticky vyňaté je nerozumné, protože společnost popsala, že starší modely zavádí postupně během přechodného období.

Regulační impuls za tímto opatřením je článek 50 EU AI Act, jehož požadavky na transparentnost ukládají poskytovatelům generativních systémů označovat strojově čitelný výstup. Anthropic podepsal Kodex praxe podle článku 50(2). Za pozornost stojí, že toto nařízení upravuje systémy používané v Evropské unii a neobsahuje nic, co by vynucovalo celosvětovou působnost. Anthropic použil označení všude bez ohledu na to, což je politické rozhodnutí, nikoli právní požadavek, a proto je výzkumník v Kuala Lumpur nebo Chicago pokryt evropským pravidlem.

Označení je vzorec volby slov, nikoli skrytý znak

Při každém kroku generování textu jazykový model vybírá mezi několika pokračováními, která jsou podle jeho vlastních statistik téměř ekvivalentní. Když je jedno slovo stejně dobré jako jiné, musí něco rozhodnout. Vzorkovací vodoznak tato nerozhodná místa řeší podle klíče drženého poskytovatelem, takže v přiměřeně dlouhém textu nahromaděné volby vytvářejí vzorec, který může detektor se stejným klíčem změřit.

Na stránku se nic nepřidává. Neexistuje žádný znak k nalezení, žádné pole metadat v textu, žádný formátovací artefakt. Slova, která čtete, jsou vodoznakem v tom konkrétním smyslu, že označení je záznamem toho, která slova byla vybrána z alternativ. Proto může Anthropic říci, že označení nestojí nic na významu ani čitelnosti, nikdy totiž nemuselo narušit prózu, pouze opakovaně upřednostňovat jedno přijatelné znění před jiným přijatelným zněním.

Také vysvětluje trvanlivost. Anthropic uvádí, že značka „bude cestovat s textem, když bude zkopírován a vložen jinam“, a důvod je strukturální, nikoli chytrý. Kopírování zachovává vaše slova. Přeformátování zachovává vaše slova. Změna písma, export do PDF, vložení do jiného editoru, převod na prostý text: to vše zachovává sled slov, a právě sled slov je to, co se měří.

Proč na ni čističe neviditelných znaků nemají žádný účinek

Velké množství bezplatných nástrojů se nyní označuje jako odstraňovače vodoznaků AI. Téměř všechny dělají jednu věc: prohledávají nulovou šířku Unicode, neviditelné mezery a podobně vypadající glyfy, a pak smažou to, co najdou. To byla rozumná odpověď na skutečný problém, protože některé systémy skutečně mají vloženou provenienci v znacích, a je to správný nástroj pro odstraňování zbloudilých formátovacích artefaktů z vloženého textu.

Proti vzorkovacímu vodoznaku to však nedělá vůbec nic. Projděte pasáž z Claude přes čistič znaků a každý neviditelný znak v ní zmizí, zatímco pasáž se bude měřit přesně stejně jako předtím, protože se nezměnilo jediné slovo. Nástroj hledá na místě, kde značka nikdy nebyla. To je nejzávažnější rozšířené nedorozumění, a kdokoli se pro tento účel spoléhá na odstraňovač znaků, dostává výsledek, který působí jako akce, ale není jí.

Obecný bod souvisí se širší otázkou jak AI detektory ve skutečnosti fungují, i když klíčovaný vodoznak je od statistického klasifikátoru jiný nástroj. Klasifikátor odhaduje podle podoby psaní. Vodoznak čte signál, který byl záměrně vložen, což znamená, že je mnohem přesnější v tom, co detekuje, a vůbec nelepší v tom, aby vám řekl, kdo dokument napsal.

Druhý mechanismus, který se vztahuje na soubory, nikoli na text

Anthropic provozuje dva systémy a média je z velké části slila v jeden. Vedle textového vodoznaku mohou soubory vytvořené pomocí Claude nést „signed provenance metadata“ podle otevřeného standardu Coalition for Content Provenance and Authenticity (C2PA).

Tato druhá polovina funguje opačně než první. Metadata C2PA jsou připojena k souboru, nikoli vetkána do textu, takže se o ně lze poměrně snadno připravit, stačí text ze souboru zkopírovat a metadata v něm zůstanou, protože nikdy nebyla součástí slov. Tyto dva systémy mají obrácené silné stránky. Textová značka přežívá přesuny a odolává běžným úpravám. Podpis souboru je přesný a ověřitelný, ale nepřežije běžný úkon, kdy vyberete pasáž a vložíte ji do vlastního dokumentu.

Zlidštit vlastní práci

Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.

Začít zdarma

Co pozitivní detekce skutečně prokazuje

Podstatně méně, než naznačuje slovo „detekce“, a Anthropic je v tom neobvykle přímočarý. Jeho dokumentace uvádí, že „detekce značky Claude vám říká, že obsah mohl být zpracován pomocí Claude“ a že „sama o sobě nepotvrzuje úplný původ“.

Čtěte to pozorně, protože tato formulace vykonává přesnou práci. Zpracován, ne napsán. Pozitivní výsledek je slučitelný s dokumentem, který Claude vypracoval od nuly. Stejně tak je slučitelný s dokumentem, který jste napsali sami a požádali Claude, aby jej zpřesnil. Signál nemá způsob, jak tyto případy rozlišit, protože v obou z nich Claude vygeneroval tokeny, které se nakonec objevily na stránce.

Omezení platí i opačným směrem. Anthropic uvádí, že značky nemusí přežít rozsáhlé úpravy, převod formátu nebo velmi krátké pasáže, a že nepřítomnost značky neznamená, že obsah nebyl vygenerován pomocí AI. Negativní výsledek tedy prokazuje téměř nic: text mohl pocházet z jiného modelu, z dřívější verze Claude, nebo z Claude po dostatečně rozsáhlé revizi, která signál vymazala. Detekce je plánována prostřednictvím vlastního rozhraní Anthropic, nikoli zpřístupněna třetím stranám, a proto tento signál nečtou obecné detektory AI a nelze od nich očekávat, že jej budou číst.

OperaceÚčinek na textový vodoznakProč
Kopírování a vkládáníPřenáší seVaše slova jsou zachována přesně
Přeformátování, změny písma, export do PDFPřenáší sePrezentace se mění, pořadí slov nikoli
Odstranění neviditelných znakůBez účinkuZnačka nikdy nebyla uložena v znaku
Lehká jazyková redakceObvykle se přenášíVětšina slov přežije, takže přežije i většina vzoru
Podstatné přepsáníRozpadá seNová slova znamenají nová rozhodnutí, která nejsou navázána na původní text
Překlad do jiného jazykaRozpadá seSekvence tokenů se znovu sestaví od nuly
Velmi krátké úryvkyNespolehlivé v obou směrechStatistické měření potřebuje souvislý úsek textu, aby bylo možné cokoli uzavřít

Problém přisuzování, který to vytváří pro lidi, kteří napsali vlastní práci

Nejostřejší reakce na oznámení nepřišla od nikoho, kdo by se snažil maskovat strojově napsanou práci. Přišla od právníků, výzkumníků, akademiků a redaktorů, kteří používají model tak, jak by použili jazykového redaktora, a kteří si všimli, co značka zaznamenává.

Zvažte běžný případ. Napíšete odstavec. Argument je váš, důkazy jsou vaše, struktura je vaše. Požádáte Claude, aby upravil rytmus a zkrátil text o dvě stě slov. To, co se vrátí, je váš odstavec, označený, a značka nemůže říci, že téměř všechno myšlení a většina formulací tu byla už předtím, než model text viděl. Pokud instituce, vydavatel nebo zaměstnavatel považuje pozitivní výsledek za definitivní důkaz autorství AI, což je silnější výklad, než podporuje samotné znění Anthropic, autor pak musí argumentovat proti signálu, který nikdy nebyl navržen tak, aby odpověděl na otázku, která mu byla položena.

To je skutečný problém atribuce, nikoli problém utajování, a stojí za to to říci přímo, protože se tyto dvě věci neustále zaměňují. Chtít, aby byl váš vlastní argument připsán vám, není totéž jako chtít skrýt, jak byl dokument vytvořen. Ať už vaše institucionální politika zveřejňování vyžaduje cokoli, stále to vyžaduje, odstranění značky nic nemění na tom, co dlužíte čtenáři v prohlášení o použití AI.

Co značku odstraní a co tak jen vypadá

Platí pro to jediný princip. Jakákoli operace, která ponechá vaše slova beze změny, značku zachová. Jakákoli operace, která slova znovu vytvoří od začátku, ji zruší. Všechno ostatní z toho plyne.

Kopírování, přeformátování, převod typů souborů a odstranění neviditelných znaků ponechávají slova beze změny, takže všechny tyto operace značku zachovávají. Překlad a podstatné přepracování slova znovu vytvářejí, takže obě tyto operace ji ruší, a Anthropic uznal, že rozsáhlé úpravy mohou způsobit, že značka zmizí. Ruční přepsání funguje zcela dobře, pokud na to máte čas, což u celé kapitoly většina lidí nemá.

Na tomto mechanismu je založen náš free Claude watermark remover. Obnovuje pasáž větu po větě pomocí jiného modelu, takže je každý token vygenerován znovu a signál navázaný na vzorkování Claude nemá na co se přichytit. Začátky se posouvají a pořadí vět se mění, zatímco čísla, data, jména, zdrženlivé formulace a terminologie oboru zůstávají pevně zachovány, a citovaný materiál i odkazy jsou přenášeny přesně, nikoli přeformulovány. Jedna důslednost tohoto posledního pravidla stojí za to znát předem: dlouhý blokový citát převzatý z Claude si ponechává jakoukoli značku, s níž přišel, protože přesné reprodukování citátu je z těchto dvou povinností důležitější.

U delších dokumentů, nebo u akademické práce, kde na registru a zacházení s citacemi záleží více než v běžné próze, probíhá stejný postup přestavby napříč celým rukopisem v TextPulse humanizer, který byl vytvořen přímo pro výzkumné psaní a považuje citace, definované termíny a technickou slovní zásobu za pevné body.

Pokud se vaše vlastní psaní vrátilo označené

Začněte tím, že přesně určíte, na co se díváte. Označení znamená, že Claude s textem v určitém okamžiku pracoval. Nehodnotí, jak velká část dokumentu je vaše, a vlastní formulace Anthropic vás v tom podpoří, pokud se rozhovor stane formálním.

Uchovejte si veškeré důkazy o postupu, které už máte. Historie návrhů, soubory verzí, poznámky a osnovy vypovídají o autorství způsobem, jakým signál provenience vypovídat nemůže, a jsou podstatně přesvědčivější než argument o statistice. Pokud má vaše práce vyjít pod vaším vlastním jménem a označení vytváří skutečný problém s určením autorství, přestavba pasáže do vašich vlastních slov to vyřeší, ať už to uděláte ručně nebo pomocí nástroje, a vyřeší to právě proto, že přestavba je jediná věc, která se tohoto typu označení dotýká.

Anthropic bude detaily dál měnit. Pokrytí se stále rozšiřuje na starší modely, detekce se stále vyvíjí a regulační obraz, který za tím stojí, je mladší než samotná technologie. Část, která se pravděpodobně nezmění, je mechanismus, a vědomí, že označení spočívá ve volbě slov, nikoli ve skrytém znaku, je to, co odděluje krok, který něco dělá, od kroku, který jen působí dojmem, že něco dělá. Pokud chcete vidět tutéž otázku spíše z pohledu klasifikátoru než z pohledu vodoznaku, slovní zásoba, která prozrazuje AI psaní lidskému čtenáři, je opět jiný signál, a žádný klíč jej nemůže změřit.

XLinkedInFacebook

Často kladené otázky

Je to statistická značka, kterou Anthropic vkládá do textového výstupu Claude, uplatňovaná od 11 August 2026 na každý model vydaný 2 August 2026 nebo později. Místo toho, aby cokoli vkládala do stránky, zkresluje volbu modelu mezi téměř rovnocennými slovy podle klíče, který Anthropic drží, takže dostatečně dlouhý úryvek nese měřitelný vzorec. Anthropic ji popisuje jako nepostřehnutelný watermark vetkaný přímo do textu, který nemění význam, kvalitu ani čitelnost.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

Zůstaňte v obraze o humanizaci AI

Získejte tipy na akademické psaní, detekci AI a humanizaci doručené do vaší schránky.

Žádný spam. Kdykoli se můžete odhlásit.