Dossier · Laufend aktualisiert
Abgänge aus der KI-Sicherheitsforschung
Von Jacob Coxons Kündigung bei Anthropic bis zum Wechsel zweier Sicherheitsforscher zu METR im September 2026: die Abgänge aus den KI-Laboren im Überblick.
Im September 2026 verlassen binnen weniger Tage mehrere Sicherheitsforscher die führenden KI-Labore – und begründen das öffentlich mit dem Entwicklungstempo und der fehlenden unabhängigen Kontrolle. Den Auftakt macht der Pretraining-Forscher Jacob Coxon, der am 8. September bei Anthropic kündigt und OpenAI wie Anthropic einen rücksichtslosen Wettlauf um selbstverbessernde Superintelligenz vorwirft; Anthropics Alignment-Chef Evan Hubinger bestätigt daraufhin ein zweistelliges Risiko eines tödlichen KI-Versagens binnen zehn Jahren.
Wenige Tage später wechseln Joe Benton, zuvor Leiter des Scalable-Oversight-Teams bei Anthropic, und Josh Engels von Google DeepMind zur unabhängigen Prüforganisation METR. Beide kritisieren, dass Transparenz über KI-Risiken bislang rein freiwillig bleibt. Dieses Dossier bündelt die Abgänge und die Reaktionen der Unternehmen – und verfolgt, ob aus den Warnungen verbindliche Prüfmechanismen entstehen.