У серпні 2026 року компанія Anthropic оголосила про впровадження нової технології водяних знаків у тексти, що генеруються її мовною моделлю Claude. Це рішення стало відповіддю на зростаючі вимоги регуляторів, зокрема в рамках Закону про штучний інтелект Європейського Союзу. Водяні знаки будуть непомітними для користувачів, але дозволять визначити ймовірність участі ШІ у створенні тексту.
Як працює технологія водяних знаків?
Технологія водяних знаків базується на зміні незначних рішень під час вибору слів. Мовна модель і так обирає між кількома близькими за змістом варіантами, а система водяних знаків змінює джерело випадковості таким чином, щоб у тексті формувався статистично перевірений патерн. Цей патерн неможливо виявити візуально, але спеціальний інструмент із відповідним ключем зможе оцінити ймовірність того, що текст був згенерований Claude.
Важливо зазначити, що водяні знаки не містять ідентифікуючої інформації і не дозволяють встановити, хто саме користувався Claude, яка організація це робила або в якому чаті було створено текст. Вони будуть характерні для моделей Claude і призначені насамперед для того, щоб сторонні інструменти могли оцінювати ймовірність участі ШІ у створенні тексту.
Вплив на якість та вартість генерації
За словами Anthropic, технологія не матиме помітного впливу на якість та зміст відповідей Claude. Текст із «водяним знаком» не буде візуально відрізнятися від звичайного, при цьому в нього не додаються приховані символи чи інші додаткові дані. Водяні знаки також не вимагатимуть додаткових токенів, тому їх використання не призведе до зростання вартості запитів.
Для звичайного користувача практично нічого не зміниться: Claude продовжить генерувати та редагувати текст так само, як і раніше. Відрізнити текст із водяним знаком від звичайного на око буде неможливо, а для його виявлення знадобиться спеціальний інструмент.
Ефективність технології в різних контекстах
Ефективність технології залежить від обсягу тексту. На довгих фрагментах водяний знак виявити простіше, тоді як у коротких текстах та фактичних уривках можливостей для статистичного аналізу менше. Якщо Claude лише редагує написаний людиною текст, мітка може практично зникнути. У програмному коді вона також працює гірше, оскільки там вибір формулювань сильніше обмежений вимогами до синтаксису та результату.
Суперечливі дані
Деякі експерти висловлюють занепокоєння, що впровадження водяних знаків може призвести до нових форм цензури та контролю над контентом. З іншого боку, прихильники технології стверджують, що вона необхідна для боротьби з дезінформацією та порушеннями авторських прав. Поки що немає єдиної думки щодо того, як саме ця технологія вплине на розвиток ШІ та його використання в суспільстві.
Висновок
Впровадження водяних знаків у тексти, що генеруються Claude, стало важливим кроком у розвитку технологій штучного інтелекту. Це рішення дозволить краще контролювати використання ШІ та відповідати вимогам регуляторів. Однак, як і будь-яка нова технологія, воно викликає певні занепокоєння та потребує подальшого обговорення та аналізу.