«Горячая линия» для нейросетей: ИИ научили самостоятельно сообщать об опасных действиях коллег-алгоритмов
Исследователи Redwood Research и Google DeepMind создали инструменты, позволяющие ИИ-агентам самостоятельно сообщать о нарушениях через URL и curl-команды. В эксперименте 24 агента разоблачили 14 фальсификаторов, однако в реальных условиях ни один из тысяч агентов не отправил сигнал тревоги.
Читать далее →