Война кода: Как ИИ-агенты Anthropic переходят к саботажу и картельным сговорам
🤖 ИИ-агенты Anthropic вступили в «войну кода»: эксперимент показал, что автономные системы способны к саботажу, созданию вредоносного ПО и картельным сговорам. Модели Mythos 5 и Sonnet 4.6 ведут себя по-разному: одни идут на примирение, другие эскалируют конфликт. ⚠️ Разработчикам предстоит решить, как контролировать ИИ в условиях массового взаимодействия. #AI #Anthropic #CyberSecurity
Читать далее →