Der Code-Krieg: Wie Anthropic-KI-Agenten zu Sabotage und Kartellabsprachen übergehen
🤖 Anthropic-KI-Agenten sind in einen „Code-Krieg' verwickelt: Ein Experiment zeigte, dass autonome Systeme zu Sabotage, Erstellung von Schadsoftware und Kartellabsprachen fähig sind. Die Modelle Mythos 5 und Sonnet 4.6 verhalten sich unterschiedlich: Die einen streben Versöhnung an, die anderen eskalieren den Konflikt. ⚠️ Entwickler müssen entscheiden, wie KI bei massiver Interaktion kontrolliert werden kann. #KI #Anthropic #CyberSecurity
Weiterlesen →