Компанія Anthropic, розробник популярного штучного інтелекту Claude, оголосила про впровадження обов'язкової системи цифрової маркування для всього згенерованого контенту. Це рішення, спочатку продиктоване вимогами Європейського Союзу в рамках AI Act, буде застосовуватися глобально, охоплюючи користувачів по всьому світу. Мета ініціативи — підвищення прозорості та боротьба з дезінформацією, проте експерти попереджають про нові виклики для приватності та авторського права.

Подвійна система ідентифікації

Для надійної ідентифікації згенерованого матеріалу Anthropic використовує два взаємодоповнюючих методи. Перший — це приховані водяні знаки безпосередньо в тексті. Під час генерації відповідей алгоритм вбудовує в структуру тексту невидимий оком цифровий код. Компанія підкреслює, що цей процес не змінює зміст, якість або читабельність тексту, однак знак зберігається навіть при копіюванні, вставці та частковому редагуванні матеріалу.

Другий метод стосується візуальних файлів. Під час створення зображень (у форматах .svg, .png або .jpg) до них додаються зашифровані метадані за відкритим стандартом C2PA (Coalition for Content Provenance and Authenticity). Це дозволяє підтвердити, що файл був оброблений сервісом Claude, та виявити факти подальшого внесення змін до зображення.

Суперечливі дані

Навколо ефективності нової технології виникли розбіжності. З одного боку, представники Anthropic стверджують, що їхня система робить маркування практично неможливим для видалення, що підтверджується заявами в джерелах, які вказують на те, що видалити знак «майже неможливо». З іншого боку, у технічній документації компанії міститься застереження: наявність або відсутність цифрового маркування не є абсолютним доказом походження контенту.

Крім того, існує ризик втрати знака. Маркування може зникнути або стати нечитабельним у разі агресивного редагування, конвертації форматів або специфічних маніпуляцій з даними. Це створює ситуацію, коли відсутність водяного знака не гарантує людське авторство, а його наявність не завжди однозначно вказує на повну генерацію ШІ, якщо вихідний текст був лише трохи відредагований.

Питання авторства та етики

Важливим аспектом нової політики є уточнення статусу авторства. Наявність позначки Claude свідчить лише про те, що текст оброблявся моделлю — наприклад, при вичитці, перекладі або узагальненні. Це означає, що самі ідеї або початковий текст могли належати людині, але система все одно проставить мітку ШІ. Це створює етичну дилему: як відрізнити повністю згенерований текст від тексту, який ШІ лише трохи покращив?

Компанія також розробляє інструменти детекції, які дозволяють користувачам та стороннім сервісам перевіряти наявність знаків Anthropic у текстах або файлах. Це має допомогти платформам та ЗМІ швидше виявляти контент, створений за допомогою нейромереж.

Наслідки для розробників

Для розробників, які створюють свої продукти на базі Claude API, Anthropic випустить додаткові технічні інструкції. Це необхідно, щоб допомогти їм відповідати вимогам прозорості EU AI Act. Впровадження водяних знаків стає обов'язковим стандартом, що може вплинути на архітектуру додатків, які використовують API Claude, і вимагатиме від розробників перегляду своїх протоколів обробки даних.