„Hotline“ für Neuronale Netze: KI wurde gelehrt, eigenständig über gefährliche Handlungen von Kollegen-Algorithmen zu berichten
Forscher von Redwood Research und Google DeepMind haben Werkzeuge erstellt, die es KI-Agenten ermöglichen, eigenständig über Verletzungen über URLs und curl-Befehle zu berichten. Im Experiment entlarvten 24 Agenten 14 Fälscher, doch unter realen Bedingungen hat keiner von Tausenden Agenten ein Warnsignal gesendet.
Weiterlesen →