AI Detection

Водяний знак Claude: де міститься позначка і що вона доводить

Anthropic почала позначати текстовий вивід Claude 11 August 2026. Майже кожне пояснення цього відтоді описувало неправильний механізм. Позначка не є символом, схованим на сторінці, це статистичне зміщення у тому, які слова обрала модель, і саме ця відмінність вирішує все: що її несе, що її усуває і як мало насправді встановлює позитивний результат щодо того, хто написав документ.

10 min
Diagram contrasting a hidden-character watermark with a sampling watermark carried in the model's word choices

Більшість того, що було написано про водяний знак Claude з серпня, описує механізм, який не є тим, що Anthropic випустила. Поширене пояснення говорить про невидимий символ, захований між словами, пробіл нульової ширини або схожий символ Unicode, який чекає, поки детектор його знайде. Це було б розумним припущенням. Але воно є хибним, і ця помилка не є суто академічною, саме через неї ціла категорія безплатних інструментів, що рекламуються як засоби видалення водяних знаків, не має жодного ефекту щодо цього конкретного позначення.

Позначка Anthropic міститься у самому виборі слів. У текст нічого не вставляється. Коли це зрозуміло, практичні питання самі собою отримують відповідь так, як не можуть отримати, поки в обігу залишається уявлення про прихований символ, зокрема які операції переносять позначку далі, які її видаляють, і що насправді повідомляє детектор, коли він фіксує збіг.

Наведене далі взято з власної документації Anthropic, а не з матеріалів про неї, і навмисно конкретно окреслює межі, які сама компанія зазначає.

Anthropic's Claude support article on how Claude marks AI-generated content: embedded watermarks in text and signed provenance metadata under the EU AI Act code of practice
Власна документація Anthropic щодо плану маркування, вбудовані текстові водяні знаки плюс підписані метадані про походження, а нові моделі маркують від першого дня відповідно до графіка EU AI Act.

Що Anthropic увімкнула, і коли

Anthropic почала маркувати вихід Claude 11 серпня 2026. Її стаття в центрі допомоги на цю тему описує текстову позначку як "an imperceptible watermark directly into the text itself", і каже, що читач "won't see it, and it doesn't change the meaning, quality, or readability".

Охоплення є широким. Моделі, випущені 2 August 2026 або пізніше, несуть позначення від моменту релізу, і Anthropic перелічує такі поверхні, як Claude Platform API, Claude, Claude Code, Claude Cowork і Claude Tag, включно з Claude, доступним через AWS, Google Cloud і Microsoft Foundry. Це застосовується глобально. Вважати, що все, створене до August, автоматично звільнене, нерозумно, оскільки компанія описувала включення ранніших моделей протягом перехідного періоду.

Регуляторним поштовхом за цим є Article 50 of the EU AI Act, чиї вимоги щодо прозорості зобов'язують постачальників генеративних систем позначати машинозчитуваний вивід. Anthropic підписала Code of Practice до Article 50(2). Варта уваги обставина полягає в тому, що регулювання охоплює системи, що використовуються в межах Європейського Союзу, і не містить нічого, що змушувало б до глобального застосування. Anthropic застосувала позначення всюди незалежно від цього, що є політичним вибором, а не юридичною вимогою, і саме тому дослідник у Куала-Лумпурі або Chicago охоплюється європейським правилом.

Позначення є шаблоном вибору слів, а не прихованим символом

На кожному етапі генерування тексту мовна модель обирає між кількома продовженнями, які за її власною статистикою є близькими до еквівалентних. Там, де одне слово не гірше за інше, щось має розв'язати нічию. Водяний знак вибірки розв'язує ці нічиї відповідно до ключа, який зберігає постачальник, так що впродовж розумного обсягу тексту накопичені вибори утворюють шаблон, який детектор із тим самим ключем може виміряти.

На сторінку нічого не додається. Немає символу, який треба знайти, немає поля метаданих у тексті, немає артефакту форматування. Слова, які ви читаєте, і є водяним знаком, у конкретному значенні, що позначення є записом того, які слова було обрано з-поміж альтернатив. Саме тому Anthropic може стверджувати, що позначення не коштує нічого в плані змісту або читабельності: воно ніколи не мало спотворювати прозу, а лише неодноразово надавати перевагу одному прийнятному формулюванню над іншим прийнятним формулюванням.

Він також пояснює стійкість. Anthropic каже, що позначка "will travel with the text when it's copied and pasted elsewhere", а причина є структурною, а не хитромудрою. Копіювання зберігає ваші слова. Переформатування зберігає ваші слова. Зміна шрифту, експорт у PDF, вставлення в інший редактор, перетворення на простий текст: усе це зберігає послідовність слів, а саме послідовність слів і є тим, що вимірюється.

Чому очищувачі невидимих символів не мають на це впливу

Велика кількість безплатних інструментів тепер рекламують себе як засоби видалення водяних знаків AI. Майже всі вони виконують одну дію: шукають Unicode нульової ширини, невидимі пробіли та гліфи, що виглядають подібно, а потім видаляють те, що знаходять. Це була розумна відповідь на реальну проблему, оскільки деякі системи справді мають вбудоване походження в символах, і це правильний інструмент для вилучення випадкових форматувальних артефактів із вставленого тексту.

Щодо водяного знака вибірки це не дає жодного результату. Пропустіть уривок Claude через очищувач символів, і кожен невидимий символ у ньому зникне, тоді як уривок буде вимірюватися точно так само, як і раніше, тому що не змінилося жодне слово. Інструмент шукає там, де позначки ніколи не було. Це найсуттєвіше непорозуміння, що нині поширене, і будь-хто, хто покладається на видалення символів для цієї мети, отримує результат, який здається дією, але не є нею.

Загальне положення стоїть поруч із ширшим питанням як AI детектори насправді працюють, хоча водяний знак із ключем є іншою природою, ніж статистичний класифікатор. Класифікатор робить припущення за формою письма. Водяний знак зчитує сигнал, який було навмисно закладено, що робить його значно точнішим у тому, що він виявляє, і зовсім не кращим у тому, щоб сказати вам, хто написав документ.

Другий механізм, який застосовується до файлів, а не до тексту

Anthropic керує двома системами, і в оглядах їх здебільшого зводять до однієї. Поряд із текстовим водяним знаком файли, створені Claude, можуть містити "signed provenance metadata" відповідно до відкритого стандарту Coalition for Content Provenance and Authenticity (C2PA).

Ця друга частина працює навпаки щодо першої. Метадані C2PA прикріплюються до файлу, а не вплітаються в прозу, тому їх порівняно легко втратити: якщо скопіювати текст із файлу, метадані залишаться в ньому, оскільки їх ніколи не було в самих словах. Дві системи мають обернені сильні сторони. Текстова позначка зберігається під час переміщення і чинить опір випадковому редагуванню. Підпис файлу є точним і перевірюваним, але не зберігається за звичайного дії, коли уривок виділяють і вставляють у власний документ.

Гуманізуйте свою власну статтю

Перетворіть текст, створений за допомогою AI, і зробіть його природним, не змінюючи важливих слів або цитат.

Почати безкоштовно

Що насправді встановлює позитивне виявлення

Набагато менше, ніж припускає слово "detection", і Anthropic незвично прямо говорить про це. У його документації зазначено, що "detecting a Claude mark tells you that the content may have been processed by Claude" і що це "does not, on its own, confirm the full provenance".

Уважно прочитайте це, бо тут ідеться про точне розрізнення. Processed, а не written. Позитивний результат узгоджується з документом, який Claude створив із нуля. Він так само узгоджується з документом, який ви написали самі й попросили Claude відшліфувати. Сигнал не має способу розрізнити ці випадки, бо в обох Claude згенерував токени, що зрештою опинилися на сторінці.

Обмеження діють і в іншому напрямку. Anthropic зазначає, що позначки можуть не зберігатися після значного редагування, перетворення формату або в дуже коротких уривках, а відсутність позначки не означає, що контент не був згенерований AI. Отже, негативний результат майже нічого не встановлює: текст міг походити з іншої моделі, з раннішої версії Claude або від Claude після такого обсягу правок, що сигнал зник. Виявлення передбачене через власний інтерфейс Anthropic, а не відкрито для третіх сторін, саме тому універсальні детектори AI не зчитують цей сигнал і не можуть цього робити.

ОпераціяВплив на текстовий водяний знакЧому
Копіювання і вставленняЗберігаєтьсяВаші слова зберігаються точно
Переформатування, зміна шрифтів, експорт у PDFЗберігаєтьсяЗмінюється подання, але не послідовність слів
Видалення невидимих символівНе має ефектуПозначка ніколи не була збережена в символі
Легке літературне редагуванняЗазвичай зберігаєтьсяБільшість слів виживає, тож більша частина шаблону теж зберігається
Суттєве переписуванняРуйнуєтьсяНові слова означають нові вибори, не прив'язані до оригіналу
Переклад іншою мовоюРуйнуєтьсяПослідовність токенів відтворюється з нуля
Дуже короткі уривкиНенадійно в обох випадкахСтатистичне вимірювання потребує достатнього обсягу тексту, щоб зробити будь-який висновок

Проблема атрибуції, яку це створює для людей, що написали власну роботу

Найрізкіша реакція на оголошення не надійшла від тих, хто намагався приховати машинно написаний текст. Вона надійшла від юристів, дослідників, академіків і редакторів, які використовують модель так, як вони використовували б літературного редактора, і які помітили, що саме фіксує позначка.

Розгляньмо звичайний випадок. Ви пишете абзац. Аргумент належить вам, докази належать вам, структура належить вам. Ви просите Claude виправити ритм і скоротити двісті слів. Те, що повертається, це ваш абзац, позначений, і позначка не може сказати, що майже всі міркування і більшість формулювань уже були там до того, як модель їх побачила. Якщо установа, видавець або роботодавець трактує позитивний результат як остаточний доказ авторства AI, що є сильнішим тлумаченням, ніж допускає власне формулювання Anthropic, автор залишається в ситуації, коли йому доводиться заперечувати сигнал, який ніколи не був створений для відповіді на поставлене йому запитання.

Це справжня проблема атрибуції, а не проблема приховування, і варто сказати це прямо, тому що ці дві речі постійно змішують. Бажати, щоб ваш власний аргумент був приписаний вам, це не те саме, що бажати приховати, як було створено документ. Якою б не була політика розкриття вашої установи, вона все одно цього вимагає: очищення позначки нічого не змінює в тому, що ви винні читачеві в декларації про використання AI.

Що очищує позначку, а що лише так виглядає

Один принцип охоплює все це. Будь-яка операція, яка залишає ваші слова на місці, переносить позначку далі. Будь-яка операція, яка знову створює слова з нуля, її порушує. Усе інше з цього випливає.

Копіювання, переформатування, перетворення типів файлів і видалення невидимих символів залишають слова на місці, тож усі вони переносять позначку. Переклад і суттєве переписування знову створюють слова, тож обидва її порушують, і Anthropic визнав, що значне редагування може зробити позначку невидимою. Переписування вручну цілком працює, якщо у вас є на це час, а для цілого розділу його більшість людей не мають.

Саме на цьому механізмі побудований наш free Claude watermark remover. Він відтворює уривок речення за реченням через іншу модель, тож кожен токен генерується заново, і сигнал, прив'язаний до вибірки Claude, більше не має до чого приєднатися. Початки змінюються, порядок частин речення зсувається, тоді як цифри, дати, імена, застереження та лексика галузі залишаються незмінними, а цитований матеріал і посилання копіюються точно, а не перефразовуються. Один наслідок цього останнього правила варто знати заздалегідь: довга дослівна цитата, взята з Claude, зберігає будь-яку позначку, з якою вона була отримана, тому що точне відтворення цитати є важливішим із цих двох зобов'язань.

Для довших документів або для академічної роботи, де регістр і поводження з цитуванням мають більшу вагу, ніж у загальній прозі, той самий підхід до перебудови поширюється на весь рукопис у TextPulse humanizer, який був створений саме для наукового письма і розглядає цитати, визначені терміни та технічну лексику як фіксовані точки.

Якщо ваше власне письмо повернулося позначеним

Почніть із точного розуміння того, на що ви дивитеся. Позначка означає, що Claude обробляв текст у певний момент. Вона не ранжує, яка частина документа є вашою, і власне формулювання Anthropic підтвердить це, якщо розмова набуде офіційного характеру.

Збережіть будь-які докази процесу, які у вас уже є. Чернетки, файли версій, нотатки та плани всі свідчать про авторство так, як не може свідчити сигнал походження, і вони значно переконливіші за аргумент про статистику. Якщо вашу роботу потрібно опублікувати під вашим власним ім'ям і позначка створює реальну проблему атрибуції, перебудова уривка вашими власними словами усуває її, незалежно від того, робите ви це вручну чи за допомогою інструмента, і усуває її саме тому, що перебудова є єдиною дією, яка впливає на такий тип позначки.

Anthropic і надалі змінюватиме деталі. Охоплення все ще розширюється на старіші моделі, виявлення все ще розвивається, а регуляторна картина, що стоїть за цим, молодша за саму технологію. Частина, яка навряд чи зміниться, це механізм, і знання того, що позначка міститься у виборі слів, а не в прихованому символі, відрізняє крок, який щось робить, від кроку, який лише здається таким. Якщо ви хочете побачити те саме питання з боку класифікатора, а не з боку водяного знака, лексика, яка видає AI writing людському читачеві, є ще одним окремим сигналом, і жоден ключ не може його виміряти.

XLinkedInFacebook

Часті запитання

Це статистична позначка, яку Anthropic вбудовує в текстовий вивід Claude, застосована від 11 August 2026 до кожної моделі, випущеної 2 August 2026 або пізніше. Замість того щоб вставляти щось на сторінку, вона зміщує вибір моделі між майже рівнозначними словами відповідно до ключа, який зберігає Anthropic, так що достатньо довгий уривок несе вимірюваний патерн. Anthropic описує її як непомітний водяний знак, вплетений безпосередньо в текст, який не змінює значення, якість або читабельність.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

Будьте в курсі AI-гуманізації

Отримуйте поради щодо академічного письма, виявлення AI та гуманізації прямо на вашу пошту.

Жодного спаму. Відписатися можна будь-коли.