Компания Anthropic объявила о внедрении технологии «водяных знаков» в тексты, создаваемые ее ИИ-моделью Claude AI. Нововведение связано с необходимостью соответствовать требованиям европейского закона об искусственном интеллекте (EU AI Act), который обязывает компании делать ИИ-контент распознаваемым.
В отличие от привычных водяных знаков на изображениях, новый механизм работает незаметно для пользователя. В тексте не появляются дополнительные символы или пометки: «подпись» формируется за счет статистических особенностей выбора слов. Для читателя такой текст выглядит абсолютно обычным, однако при наличии специального ключа можно определить вероятность того, что он был сгенерирован Claude AI.
Источник изображения: ChatGPTAnthropic подчёркивает, что технология не влияет на качество, стиль или смысл текста. Внутренние тесты показали, что читатели не могут отличить текст с меткой от обычного, а уровень креативности и читаемости остаётся прежним. При этом водяной знак не содержит персональных данных и не позволяет определить конкретного пользователя или источник запроса. Система основана на изменении источника случайности при генерации слов: модель по-прежнему выбирает из множества вариантов, но делает это по особому алгоритму. Такой подход позволяет встраивать маркер без изменения содержания текста.
Технология будет применяться ко всем новым моделям Claude AI и распространяться глобально, а не только в Европе. При этом Anthropic признает ограничения метода: водяной знак не может точно доказать авторство текста и хуже работает на коротких фрагментах.

