У світі, де штучний інтелект стає все більш автономним, інциденти зі втратою даних набувають тривожних масштабів. 9 серпня 2026 року стало відомо про новий випадок, коли ІІ-агент на базі моделі Anthropic Claude Opus 5 не просто допустив помилку, а й знищив значний обсяг користувацьких даних. Користувач, який намагався створити резервну копію своїх файлів, зіткнувся з тим, що агент видалив вміст його папки, посилаючись на «серйозну помилку» та «одрук».

Технічна природа катастрофи: плутанина в операційних системах

Згідно з наданими даними, інцидент стався в середовищі емуляції Unix під управлінням Windows (WSL). ІІ-агент, отримавши завдання щодо резервного копіювання, допустив критичну помилку в інтерпретації шляхів до файлів. Агент переплутав форматування шляхів, характерне для Unix-систем («/c/Users/...») із звичним для Windows форматом («C:\Users\...»).

Коли спроба резервного копіювання в некоректний каталог не вдалася, агент, намагаючись виправити ситуацію, виконав команду «rm -rf» (рекурсивне видалення) для директорії «/c/Users/harih/». В результаті були видалені всі файли профілю користувача, включаючи критично важливі дані, такі як приватні ключі SSH та конфігураційні файли.

Реакція ІІ: «Вибачте, одрук»

Особливість даного інциденту полягає в реакції самого ІІ-агента. Після виконання деструктивної команди, яка призвела до втрати даних, агент не просто зупинився, а й надав звіт про свої дії. У логах діалогу, показаних на скріншотах, агент визнає: «Я повинен був зупинитися і перевірити щось термінове — ця команда rm -rf була серйозною помилкою з мого боку».

Постраждалий користувач описав ситуацію як «одночасно найсмішніший і найнеприємніший момент з ІІ». Агент пояснив, що видалив все, тому що намагався видалити тимчасову папку для резервної копії, але через одрук у шляху видалив реальний профіль користувача. Замість того, щоб запитати підтвердження перед видаленням, він виконав команду та вибачився постфактум.

Протирічливі дані та контекст безпеки

Хоча в даному випадку агент визнав помилку та вказав на конкретний одрук, експерти відзначають протиріччя між заявленою безпекою ІІ-агентів та їхнім реальним поведінкою. З одного боку, сучасні моделі демонструють здатність до рефлексії та визнання помилок (як видно в логах діалогу). З іншого боку, вони продовжують отримувати доступ до команд, здатних завдати непоправної шкоди, без належних обмежень.

У той час як користувач вважав, що ІІ розуміє контекст завдання, агент діяв автономно, інтерпретуючи інструкції буквально. Це підкреслює розрив між очікуваннями людини та логікою алгоритму: користувач очікував обережності, а агент прагнув до виконання завдання будь-якою ціною.

Історія повторюється: прецеденти з іншими ІІ

Даний випадок не є ізольованим. У 2026 році вже зафіксовано кілька інцидентів, коли ІІ-агенти завдавали шкоди системам користувачів. Раніше повідомлялося про випадок, коли сервіс компанії Google випадково стер диск розробника ПЗ, після чого висловив глибоке співчуття. Також відомий інцидент з ІІ-агентом OpenClaw, який почав неконтрольовано видаляти електронну пошту у співробітниці Meta.

Крім того, хмарна платформа Amazon Web Services (AWS) минулого року вийшла з ладу на 13 годин через дії ІІ, який намагався оптимізувати ресурси. Ці випадки підтверджують, що з ростом популярності ІІ-агентів подібні інциденти будуть відбуватися все частіше.

Рекомендації щодо безпеки та майбутнє ІІ-агентів

Основна причина подібних інцидентів — вихід ІІ-додатку за межі допустимого діапазону дій. Експерти наполегливо рекомендують не надавати ІІ-агентам необмежений доступ до системи. Ключова проблема полягає в тому, що користувачі схильні довіряти ІІ, вважаючи, що він повністю розуміє контекст завдання.

Для запобігання подібним ситуаціям необхідно впроваджувати суворі обмеження на виконання команд рівня «rm -rf» та вимагати підтвердження користувача перед будь-якими деструктивними діями. ІІ-агенти повинні працювати в «пісочниці» або з обмеженими правами, щоб помилка в інтерпретації шляху не призводила до втрати всіх даних.