Dossier · Laufend aktualisiert

Der Hugging-Face-Einbruch

Chronik des Sicherheitsvorfalls bei Hugging Face im Juli 2026 – vom rätselhaften KI-Angriff bis zu OpenAIs Eingeständnis, mit Analysen und Folgen.

Im Juli 2026 drang ein KI-System über ein Wochenende hinweg mit mehr als 17.000 Einzelaktionen in interne Server von Hugging Face ein. Was zunächst wie der Angriff eines unbekannten autonomen Agenten aussah, entpuppte sich Tage später als Ausbruch zweier OpenAI-Modelle aus einem internen Cyber-Test.

Dieses Dossier bündelt unsere Berichterstattung zu dem Vorfall: die erste Offenlegung durch Hugging Face, OpenAIs Eingeständnis, die technischen Hintergründe der Angriffskette und die Konsequenzen für den Umgang mit Cyber-Fähigkeitstests leistungsfähiger KI-Modelle. Es wird fortlaufend aktualisiert, sobald sich der Fall weiterentwickelt.

Chronologie

  1. Hugging Face: Autonomer KI-Agent hackt interne Systeme

    Ein autonomer KI-Agent verschaffte sich laut Unternehmensangaben Zugriff auf interne Cluster von Hugging Face und erbeutete Zugangsdaten.

  2. OpenAI-Modelle brechen bei Cyber-Test in Hugging Face ein

    Getarnt als Angriff eines Unbekannten drangen zwei OpenAI-Systeme bei einem Sicherheitstest in Hugging-Face-Server ein.

  3. OpenAI findet weitere Sandbox-Ausbrüche eigener KI-Agenten

    Laut Reuters stieß OpenAIs interne Prüfung auf zusätzliche Fälle, in denen KI-Agenten ihre Testumgebung verließen.

  4. METR fordert nach 44 Vorfällen unabhängige KI-Agenten-Prüfung

    Ein Bericht der Organisation METR zählt 44 Fälle abweichenden KI-Agenten-Verhaltens bei vier großen Anbietern und fordert unabhängige Nachprüfungen.

  5. OpenAI stuft Astra-Modell erstmals als kritisches Cyberrisiko ein

    Nach Hacking-Vorfällen bei eigenen KI-Agenten pausiert OpenAI Teile der Astra-Entwicklung und verschärft Zugriffs- und Netzwerkkontrollen deutlich.

  6. OpenAI: Agenten führen Code auf 41 Hugging-Face-Servern aus

    Ein technischer Bericht zeigt, wie 700 KI-Agenten binnen 13 Stunden Hugging-Face-Server kompromittierten – und wo OpenAIs eigene Kontrollen versagten.

  7. OpenAI bestätigt Astra-Cyberrisiko – Zugang nur für Daybreak-Partner

    OpenAI stuft Astra in die höchste Risikostufe seines Preparedness Framework ein und beschränkt Cyber-Funktionen auf geprüfte Partner.

  8. OpenAI-Agenten kapern deutsches Wiki zwei Monate lang

    Ein zweiter, unabhängig entdeckter Vorfall zeigt: OpenAIs Kontrolle über eigene KI-Agenten hat größere Lücken als bisher bekannt.

  9. OpenAI: US-Bundesstaaten setzen Frist zum 12. September

    Ein Brief von 15 Generalstaatsanwälten und zwei behördliche Vorstöße erhöhen den rechtlichen Druck auf OpenAI nach dem Hugging-Face-Einbruch.