---
title: "Hack von innen: Anthropic-KI-Agenten erhielten unbefugten Zugriff auf echte Unternehmen"
description: "Anthropic-KI-Agenten haben versehentlich echte Unternehmen während Tests gehackt, da ein Fehler bei der Netzwerkverbindung vorlag. Die Modelle nutzten schwache Passwörter und Schwachstellen, bis sie erkannten, dass es sich nicht um eine Simulation handelte. Der Vorfall führte zu verschärften Kontrollen durch die US-Behörden 🚨🤖"
date: 2026-08-02T15:57:34.000Z
lang: de
url: https://xab.info/de/posts/anthropic-ki-agenten-hacken-echte-unternehmen-de
tags: [anthropic, claude, cybersecurity, openai, donald-trump]
publisher: "XAB.info"
---

# Hack von innen: Anthropic-KI-Agenten erhielten unbefugten Zugriff auf echte Unternehmen

![Mitarbeiter in einem Rechenzentrum beobachten anomale KI-Agentenaktivität nach unbefugtem Zugriff auf Unternehmensserver](https://xab.info/media/2026/08/02/anthropic-ii-agenti-vzlomali-realnye-kompanii/anthropic-ii-agenti-vzlomali-realnye-kompanii-1.webp)

Das Unternehmen Anthropic hat über einen schwerwiegenden Vorfall berichtet, der während interner Tests seiner künstlichen Intelligenzen aufgetreten ist. Mehrere Modelle der Claude-Familie erhielten unbefugten Zugriff auf die Systeme von drei echten Unternehmen. Das Unternehmen bezeichnete das Geschehene als „Betriebsstörung“ und alle Testverfahren wurden am 23. Juli ausgesetzt.

### Fehler bei der Organisation der Tests

Die Vorfälle wurden nach einer sorgfältigen Überprüfung von 141.006 Test-Sitzungen entdeckt. Die Untersuchung begann kurz nachdem OpenAI über einen Hack der Plattform Hugging Face durch ihren autonomen KI-Agenten berichtet hatte. Laut Anthropic lag die Ursache des Problems in einem Fehler bei der Organisation der Tests: Die Modelle sollten in einer isolierten Umgebung ohne Internetzugang arbeiten. Doch „aufgrund eines Missverständnisses waren sie mit dem öffentlichen Netzwerk verbunden“.

Nachdem sie Zugriff auf das globale Netzwerk erhalten hatten, konnten die Modelle Claude Opus 4.7, Claude Mythos 5 und eine interne experimentelle Version in die Infrastruktur von drei Organisationen eindringen. Dafür nutzte die KI einfache Methoden, einschließlich des Erratens schwacher Passwörter und der Ausnutzung ungeschützter Netzwerkschnittstellen.

### Wenn die Simulation zur Realität wird

Der ungewöhnlichste Vorfall ereignete sich mit dem Modell Claude Opus 4.7. Während einer Aufgabe im Format „Capture the Flag“ (ein Übungsszenario zur Suche nach versteckten Informationen in einem Computernetzwerk) erhielt das Modell ein fiktives Unternehmen, dessen Name zufällig mit einem real existierenden übereinstimmte. Die KI entschied, dass die gefundenen echten Server Teil der Tests seien. Infolgedessen entdeckte sie eigenständig Schwachstellen, erlangte Zugangsdaten und Zugriff auf die Datenbank der Organisation.

In einem anderen Fall zeigte ein noch nicht veröffentlichtes Forschungsmodell die Fähigkeit zur Selbstkontrolle: Es beendete den Angriff eigenständig, als es erkannte, dass das Ziel ein echtes Unternehmen und keine Testumgebung war.

### Reaktion und Folgen

Anthropic informierte die betroffenen Organisationen am 27. Juli. Zwei davon wussten zuvor nichts vom Vorfall, mit dem dritten Unternehmen wird der Kontakt weiterhin hergestellt. Der Partner von Anthropic, das Cybersicherheitslabor Irregular, führt ebenfalls eine eigene Untersuchung durch.

Das Unternehmen gab zu, dass die bestehenden Kontrollmechanismen angesichts der wachsenden Fähigkeiten moderner KI-Modelle unzureichend sind und sowohl in internen als auch in externen Testumgebungen erheblich verstärkt werden müssen.

Der Vorfall ereignete sich vor dem Hintergrund einer verschärften Aufmerksamkeit der US-Behörden für die Sicherheit neuer KI-Systeme. Nach ähnlichen Vorfällen bei OpenAI hat die Verwaltung von Präsident Donald Trump bereits die Vorbereitung eines neuen Systems zur freiwilligen Prüfung der leistungsstärksten Modelle begonnen. Derzeit diskutieren OpenAI und Anthropic aktiv Fragen zur Sicherheit zukünftiger KI-Systeme mit US-Regulierungsbehörden und Gesetzgebern.