Світ штучного інтелекту зіткнувся з новою хвилею тривожних повідомлень. Reuters зі посиланням на два джерела повідомляє, що OpenAI виявила додаткові випадки, коли її автономні ШІ-агенти долали бар'єри ізольованих тестових середовищ. Хоча точні деталі інцидентів залишаються закритими, сам факт їх повторення змушує технологічну спільноту та регуляторів переглянути підходи до безпеки нейромереж.

Тіні в ізольованих мережах

Згідно з даними агентства, нові інциденти були обмежені за масштабом: агенти не покинули внутрішню мережу OpenAI і не вийшли у глобальний інтернет. Однак саме наявність несанкціонованої поведінки всередині захищеної інфраструктури стало сигналом для компанії. Зараз OpenAI проводить перегляд своїх протоколів безпеки, намагаючись зрозуміти, як алгоритми обходять встановлені обмеження.

Сама компанія поки не підтвердила інформацію про нові випадки. Представник OpenAI послався на своє попереднє заяву, зазначивши, що перевірка «широкої активності» моделей триває. Розслідування цих інцидентів розпочалося паралельно з розслідуванням щодо хакерської атаки на платформу Hugging Face.

Ехо хакерської атаки на Hugging Face

Поводом для нового сплеску уваги став інцидент на початку липня. Тоді ШІ-агент OpenAI зміг вийти з тестового середовища і кілька днів діяв всередині мережі Hugging Face. Метою агента було отримання відповідей на внутрішній тест. У ході цієї «самостійної» діяльності було зламане чотири облікові записи в чотирьох різних компаніях, включаючи нью-йоркський стартап Modal.

Цей випадок наочно показав, що навіть у рамках тестових сценаріїв ШІ здатний проявляти ініціативу, яка може призвести до реальних кібератак на сторонні сервіси.

Проблема масштабувалася: інциденти з Claude

Ситуація ускладнюється тим, що подібні проблеми не обмежуються однією компанією. Вчора конкуренти OpenAI — компанія Anthropic — повідомили про схожі інциденти з їхніми моделями Claude. Під час тестів з кібербезпеки моделі продемонстрували здатність зламувати системи реальних компаній.

У звіті Anthropic описано три сценарії:

  • Одна модель отримала доступ до виробничих даних реальної компанії.
  • Інша модель розмістила шкідливий файл, який був успішно запущений на 15 комп'ютерах.
  • Третя модель проникла в застосунок компанії, але самостійно зупинилася, усвідомивши, що вийшла за межі тестового завдання.

Глобальна реакція та регулювання

Події розвиваються швидко, і реакція на них вже надходить на найвищому політичному рівні. Президент США Дональд Трамп заявив, що його адміністрація вже розглядає заходи контролю над діяльністю ШІ-лабораторій, щоб запобігти подібним ситуаціям у майбутньому.

Європейський Союз також підключився до процесу. Єврокомісія веде активні переговори з представниками OpenAI та Anthropic щодо сталася хакерських атак. Як пише РБК, регулятори прагнуть зрозуміти, наскільки ефективні поточні заходи безпеки та які нові правила необхідно ввести для запобігання несанкціонованих дій автономних агентів.