В августе 2026 года компания Anthropic объявила о внедрении новой технологии водяных знаков в тексты, генерируемые её языковой моделью Claude. Это решение стало ответом на растущие требования регуляторов, особенно в рамках Закона об искусственном интеллекте Евросоюза. Водяные знаки будут незаметны для пользователей, но позволят определить вероятность участия ИИ в создании текста.
Как работает технология водяных знаков?
Технология водяных знаков основана на изменении малозначимых решений при выборе слов. Языковая модель и без того выбирает между несколькими близкими по смыслу вариантами, а система водяных знаков изменяет источник случайности таким образом, чтобы в тексте формировался статистически проверяемый паттерн. Этот паттерн невозможно обнаружить визуально, но специальный инструмент с соответствующим ключом сможет оценить вероятность того, что текст был сгенерирован Claude.
Важно отметить, что водяные знаки не содержат идентифицирующей информации и не позволяют установить, кто именно пользовался Claude, какая организация это делала или в каком чате был создан текст. Они будут характерны для моделей Claude и предназначены прежде всего для того, чтобы сторонние инструменты могли оценивать вероятность участия ИИ в создании текста.
Влияние на качество и стоимость генерации
По словам Anthropic, технология не окажет заметного влияния на качество и содержание ответов Claude. Текст с «водяным знаком» не будет отличаться от обычного визуально, при этом в него не добавляются скрытые символы или другие дополнительные данные. Водяные знаки также не потребуют дополнительных токенов, поэтому их использование не приведёт к росту стоимости запросов.
Для обычного пользователя практически ничего не изменится: Claude продолжит генерировать и редактировать текст так же, как раньше. Отличить текст с водяным знаком от обычного на глаз будет невозможно, а для его обнаружения потребуется специальный инструмент.
Эффективность технологии в разных контекстах
Эффективность технологии зависит от объёма текста. На длинных фрагментах водяной знак обнаружить проще, тогда как в коротких текстах и фактических отрывках возможностей для статистического анализа меньше. Если Claude лишь редактирует написанный человеком текст, метка может практически исчезнуть. В программном коде она также работает хуже, поскольку там выбор формулировок сильнее ограничен требованиями к синтаксису и результату.
Противоречивые данные
Некоторые эксперты выражают опасения, что внедрение водяных знаков может привести к новым формам цензуры и контроля над контентом. С другой стороны, сторонники технологии утверждают, что она необходима для борьбы с дезинформацией и нарушениями авторских прав. Пока что нет единого мнения о том, как именно эта технология повлияет на развитие ИИ и его использование в обществе.
Заключение
Внедрение водяных знаков в тексты, генерируемые Claude, стало важным шагом в развитии технологий искусственного интеллекта. Это решение позволит лучше контролировать использование ИИ и соответствовать требованиям регуляторов. Однако, как и любая новая технология, оно вызывает определённые опасения и требует дальнейшего обсуждения и анализа.