Новости экономики

Anthropic объясняет свою функцию водяных знаков для ИИ

15 августа 2026 г.Артём Волжский2 мин

Компания Anthropic представила функцию водяных знаков для текста, сгенерированного искусственным интеллектом, в своих моделях Claude. Это делается в соответствии с требованиями Закона ЕС об искусственном интеллекте, который предписывает прозрачность в отношении контента, созданного ИИ.

В своем блоге Anthropic пояснила, что водяной знак незаметно изменяет выбор слов в моделях Claude, делая текст проверяемым на предмет происхождения от ИИ. Ранее некоторые клиенты Claude выражали обеспокоенность по поводу этой функции.

Как работает водяной знак Anthropic

Технология водяных знаков основана на методе, описанном в научной работе Google DeepMind 2024 года. Во время генерации текста модели ИИ делают выбор между синонимами или схожими по смыслу словами. Водяной знак Anthropic действует как особая "случайная числовая последовательность", которая влияет на этот выбор слов. При наличии специального "ключа" можно определить, следуют ли слова определенным закономерностям, характерным для Claude.

Anthropic планирует выпустить "ключ" в виде программного интерфейса приложения (API), который позволит пользователям и сторонним разработчикам проверять текст на наличие водяного знака Claude. Важно отметить, что водяной знак не использует скрытые символы, необычные шрифты или секретный текст – это исключительно тонкие изменения в выборе слов, которые, по утверждению компании, не будут заметны для читателя.

Ограничения и перспективы

Anthropic подчеркивает, что водяной знак не является панацеей от путаницы между текстами, созданными ИИ, и написанными человеком. "Ключ" Anthropic позволяет определить вероятность того, что текст был частично написан Claude, а не просто сгенерирован искусственным интеллектом в целом. Более длинные тексты с большим количеством выборов слов легче поддаются распознаванию. Фактические тексты, где неверный выбор слова может повлиять на точность, будут иметь меньше таких маркировок. Аналогично, в сгенерированном коде, где точность критически важна, водяной знак будет применяться реже.

Компания также заявила, что наличие водяного знака означает, что контент был обработан Claude, но не влияет на права и собственность пользователя в отношении текста. Легкое редактирование, скорее всего, не удалит водяной знак полностью, тогда как полная переработка текста с заменой каждого слова, по сути, делает текст уже не "сгенерированным ИИ".

Открытым остается вопрос, насколько часто люди будут проверять текст на наличие водяных знаков и как это повлияет на их взаимодействие с контентом, созданным Claude.