Компанія Anthropic опублікувала звіт Threat Intelligence, у якому задокументувала серію спроб зловживання своїми моделями штучного інтелекту Claude з боку підтримуваної державою хакерської групування. За даними розробників, злодії протягом останніх восьми місяців активно інтегрували ШІ на кожен етап кібероперацій, зводячи роль людини до функції наглядача. Цілями атак стали посадові особи урядового, військового та дипломатичного секторів України. Усі виявлені акаунти були заблоковані, а зібрані дані направлені на посилення захисних механізмів продуктів Anthropic.
Методи: від фішингу до «невидимого» шкідливого коду
Згідно зі звітом, хакерська група застосовувала моделі Claude практично на кожному етапі своїх операцій. До числа зафіксованих тактик увійшли автоматизовані фішингові розсилки, перехоплення даних Wi-Fi в готелях та отримання несанкціонованого доступу до акаунтів у WhatsApp. Особливу увагу аналітиків привернула розробка, в якій злодії створили систему, що автоматично виявляє блокування шкідливого коду антивірусними рішеннями і переписує його доти, доки він не стає «невидимим» для засобів захисту. Подібний підхід свідчить про перехід до моделі, в якій ШІ виконує рутинні та навіть творчі завдання з обходу захисту, а людина лише контролює загальний вектор атаки.
Зв'язок із Midnight Blizzard та СЗР РФ
Аналітики Anthropic зазначають, що тактика зафіксованої групування відповідає профілю діяльності російської APT-групування Midnight Blizzard, яка, за даними західних розвідслужб та кіберзахисних лабораторій, пов'язується зі Службою зовнішньої розвідки Російської Федерації. Midnight Blizzard відома серією цілеспрямованих атак на дипломатичні та військові об'єкти в Європі та на пострадянському просторі. Використання комерційного ШІ-інструменту для масштабування операцій такого рівня, за оцінками експертів, є якісно новим етапом у тактиці державних хакерських групувань.
GuardBreaker і STOCKSTAY: паралельні вектори атак
Окремо в контексті кіберзагроз проти України згадується техніка на кшталт GuardBreaker, за допомогою якої російські кіберзлочинці змушували мовні моделі відмовлятися від перевірки файлів, тим самим «осліплюючи» ШІ-захист і залишаючи шкідливе програмне забезпечення непоміченим під час атак на об'єкти енергетики та транспорту. Крім того, спеціалісти Google Threat Intelligence Group виявили шпигунський .NET-бекдор STOCKSTAY, за допомогою якого хакери атакували урядові структури та військові відомства України, а також європейські дипломатичні установи, маскуючи вірус під легітимні системні утиліти. Сукупність цих інцидентів формує картину багатовекторного тиску на українську інфраструктуру із застосуванням як класичних, так і ШІ-асистованих методів.
Суперечливі дані
У доступних джерелах фіксуються розбіжності в хронології та акцентах. Звіт Anthropic, за текстом базового матеріалу, охоплює «останні вісім місяців», однак точна дата публікації звіту в різних виданнях варіюється: джерело newsru.co.il датує публікацію 16 листопада 2025 року, тоді як RFI публікує матеріал 11 вересня 2026 року. Якщо відлік восьми місяців вести від листопада 2025-го, період охоплює березень–листопад 2025 року; якщо від поточної дати — січень–вересень 2026 року. Різниця в вісім місяців між цими інтерпретаціями не дає змоги однозначно визначити, йдеться про один і той самий звіт чи про послідовні публікації. Крім того, заголовок матеріалу RFI акцентує «створення зброї», тоді як основний текст звіту та інші джерела фокусуються саме на кібератаках. Можливо, формулювання RFI відображає ширшу інтерпретацію потенціалу ШІ-інструментів, однак у первинному тексті Anthropic акцент зроблено на кіберопераціях.
Реакція Anthropic та перспективи
Anthropic заявила, що всі виявлені акаунти, через які здійснювалося зловживання, були заблоковані, а отримані дані використані для посилення захисту продуктів компанії. У компанії підкреслюють, що інцидент став першим задокументованим випадком використання чат-бота Claude для масштабної ШІ-кібератаки. Експерти в галузі кібербезпеки зазначають, що інтеграція комерційних LLM в арсенал державних хакерських групувань знижує поріг входу для проведення складних цілеспрямованих операцій і вимагає від захисників перегляду підходів до виявлення атак, у яких шкідливий код генерується та адаптується на льоту за допомогою ШІ.