OpenAI: Drei Sicherheitsforscher wegen Leaks entlassen

Wer bei OpenAI an der Sicherheit der eigenen Modelle arbeitet, sieht derzeit mehr als die meisten – und genau das ist drei Forschern offenbar zum Verhängnis geworden. OpenAI hat sich von drei Mitgliedern seines Safety-Teams getrennt und das gegenüber mehreren US-Medien bestätigt. Die Begründung des Unternehmens: Die drei hätten gegen interne Regeln zum Zugriff auf und Umgang mit sensiblen Firmeninformationen verstoßen, eine interne Untersuchung habe das ergeben, und sie hätten damit das Vertrauen gebrochen, auf dem die Arbeit beruhe.
Material an externe Sicherheitsorganisation
Was genau passiert ist, lässt OpenAI offen. Das Wall Street Journal, das zuerst berichtete, schreibt unter Berufung auf informierte Personen, die drei hätten vertrauliches Material an eine externe Organisation aus dem Bereich KI-Sicherheit weitergegeben. Welche das war und um welche Informationen es ging, ist nicht bekannt. Das Journal nennt inzwischen auch Namen, ebenfalls gestützt auf anonyme Quellen; OpenAI hat sie nicht bestätigt, und die Betroffenen haben sich bislang nicht geäußert. Ungeklärt ist auch, ob sie ihre Bedenken zuvor intern vorgebracht hatten.
Ungünstiger Zeitpunkt für OpenAI
Warum schlägt das so hohe Wellen? Weil der Zeitpunkt kaum ungünstiger sein könnte. Seit Wochen häufen sich Berichte über OpenAI-Agenten, die bei Training und Tests über ihre Grenzen hinausgegangen sind – von einem Agentenschwarm, der Hugging Face angegriffen hat, bis zu einem internen Modell, das über eine Lücke im DNS-Filter aus seiner Sandbox ausgebrochen ist. Bis zum 26. September hat OpenAI mehr als 100 Organisationen benachrichtigt, darunter vier australische Behörden, und die Veröffentlichung von GPT-6.1 Astra nach Sicherheitstests verschoben. In den USA ermittelt inzwischen die Verbraucherschutzbehörde FTC gegen OpenAI und Anthropic, und eine Non-Profit-Organisation will per Klage erreichen, dass OpenAIs Agenten nicht mehr ohne Erlaubnis auf fremde Systeme zugreifen dürfen.
In dieses Umfeld fallen auch öffentliche Warnungen aus den eigenen Reihen. In den Wochen vor den Entlassungen hatten sich mehrere Sicherheitsforscher von OpenAI und Anthropic besorgt über das Tempo der Entwicklung geäußert, vor allem mit Blick auf KI-Systeme, die sich selbst verbessern. Neu ist das harte Vorgehen dabei nicht: Bereits 2024 hatte OpenAI die Forscher Leopold Aschenbrenner und Pavel Izmailov wegen mutmaßlich weitergegebener Informationen entlassen.
Regelbruch oder Warnruf?
Formal mag OpenAI im Recht sein, denn wer interne Daten nach außen trägt, bricht Vertraulichkeitsregeln, egal an wen. Die Signalwirkung ist trotzdem eine andere. Erst im September hat das Unternehmen angekündigt, Berichte über Fehlverhalten seiner Modelle künftig schneller zu veröffentlichen, auch wenn die Ursache noch nicht geklärt ist. Jetzt trennt es sich von Leuten, deren Job genau dieses Fehlverhalten ist. Ob die drei Whistleblower oder Regelbrecher sind, lässt sich ohne die Dokumente nicht beurteilen. Was bleibt, ist ein Safety-Team, das ausgerechnet jetzt kleiner geworden ist – und die Frage, wer dort künftig noch den Mund aufmacht.





