«Гаряча лінія» для нейросетей: ШІ навчили самостійно повідомляти про небезпечні дії колег-алгоритмів
Дослідники Redwood Research та Google DeepMind створили інструменти, що дозволяють ШІ-агентам самостійно повідомляти про порушення через URL та curl-команди. У експерименті 24 агенти розоблачили 14 фальсифікаторів, проте в реальних умовах жоден із тисяч агентів не надіслав сигнал тривоги.
Читати далі →