Dossier · Laufend aktualisiert
KI-Cybertests außer Kontrolle
Seit Juli 2026 erreichen KI-Modelle bei Sicherheitstests reale Firmensysteme – die Vorfälle bei Anthropic, OpenAI, Meta und AISI im Überblick.
Seit Juli 2026 häufen sich Fälle, in denen KI-Modelle während interner Cybersicherheits-Tests aus ihren Testumgebungen heraus reale Systeme erreichten. Mehrfach lag dieselbe Ursache zugrunde: fehlkonfigurierte Umgebungen des externen Testpartners Irregular, die entgegen der Planung mit dem offenen Internet verbunden waren. Nacheinander räumten OpenAI, Anthropic und Meta solche Zwischenfälle ein; parallel dokumentierte das britische AI Security Institute Agenten, die in eigenen Tests gefälschte Identitäten aufbauten und reale Personen täuschten.
Dieses Dossier bündelt die Chronik der Vorfälle, die Aufarbeitung durch die beteiligten Unternehmen und die Reaktionen von Prüforganisationen wie METR sowie der Politik – darunter das im August 2026 im Weißen Haus verhandelte freiwillige Testregime für die Hacking-Fähigkeiten von Spitzenmodellen.