Компания Anthropic, разработчик популярного искусственного интеллекта Claude, объявила о внедрении обязательной системы цифровой маркировки для всего генерируемого контента. Это решение, изначально продиктованное требованиями Европейского Союза в рамках AI Act, будет применяться глобально, затрагивая пользователей по всему миру. Цель инициативы — повышение прозрачности и борьба с дезинформацией, однако эксперты предупреждают о новых вызовах для приватности и авторского права.

Двойная система идентификации

Для надежной идентификации сгенерированного материала Anthropic использует два взаимодополняющих метода. Первый — это скрытые водяные знаки непосредственно в тексте. При генерации ответов алгоритм встраивает в структуру текста невидимый глазу цифровой код. Компания подчеркивает, что этот процесс не изменяет содержание, качество или читаемость текста, однако знак сохраняется даже при копировании, вставке и частичном редактировании материала.

Второй метод касается визуальных файлов. При создании изображений (в форматах .svg, .png или .jpg) к ним добавляются зашифрованные метаданные по открытому стандарту C2PA (Coalition for Content Provenance and Authenticity). Это позволяет подтвердить, что файл был проработан сервисом Claude, и выявить факты последующего внесения изменений в изображение.

Противоречивые данные

Вокруг эффективности новой технологии возникли разногласия. С одной стороны, представители Anthropic заявляют, что их система делает маркировку практически неустранимой, что подтверждается заявлениями в источниках, указывающих на то, что удалить знак «почти невозможно». С другой стороны, в технической документации компании содержится оговорка: наличие или отсутствие цифровой маркировки не является абсолютным доказательством происхождения контента.

Кроме того, существует риск потери знака. Маркировка может исчезнуть или стать нечитаемой в случае агрессивного редактирования, конвертации форматов или специфических манипуляций с данными. Это создает ситуацию, когда отсутствие водяного знака не гарантирует человеческое авторство, а его наличие не всегда однозначно указывает на полную генерацию ИИ, если исходный текст был лишь слегка отредактирован.

Вопросы авторства и этики

Важным аспектом новой политики является уточнение статуса авторства. Наличие отметки Claude свидетельствует лишь о том, что текст обрабатывался моделью — например, при вычитке, переводе или суммаризации. Это означает, что сами идеи или первоначальный текст могли принадлежать человеку, но система все равно проставит метку ИИ. Это создает этическую дилемму: как отличить полностью сгенерированный текст от текста, который ИИ лишь слегка улучшил?

Компания также разрабатывает инструменты детекции, позволяющие пользователям и сторонним сервисам проверять наличие знаков Anthropic в текстах или файлах. Это должно помочь платформам и СМИ быстрее выявлять контент, созданный с помощью нейросетей.

Последствия для разработчиков

Для разработчиков, создающих свои продукты на базе Claude API, Anthropic выпустит дополнительные технические инструкции. Это необходимо, чтобы помочь им соответствовать требованиям прозрачности EU AI Act. Внедрение водяных знаков становится обязательным стандартом, что может повлиять на архитектуру приложений, использующих API Claude, и потребует от разработчиков пересмотра своих протоколов обработки данных.