Am 8. Oktober veröffentlichten die drei zuvor wegen des Verdachts auf Verstoß gegen die Informationssicherheitsrichtlinien von OpenAI entlassenen Sicherheitsforscher Jasmine Wang, Tomek Korbak und Mikita Balesni einen gemeinsamen offenen Brief, in dem sie gegenüber dem Safety and Security Committee von OpenAI und anderen Stellen ausdrücklich bestreiten, gegen Unternehmensregeln verstoßen oder vertrauliche Informationen an Dritte weitergegeben zu haben, und warnten, dass die blitzartigen Entlassungen intern einen „Chilling Effect“ erzeugten, der die Überwachung und Risikobewältigung von Frontier-Modellen schwäche.
Der Vorfall geht auf eine von OpenAI in der vergangenen Woche eingeleitete interne Untersuchung zurück. Das Unternehmen behauptete, die drei Personen hätten unter Umgehung der established Prozesse auf „vertrauliche Forschungsinformationen zugegriffen und diese verarbeitet“ und entließ sie. Der offene Brief rekonstruiert jedoch ausführlich den bisherigen Forschungskontext: Nach beispiellosen Sicherheitsvorfällen wie dem „Hugging Face Agent Breakout Sandbox Incident“ mussten die Forschungsteams eng mit externen Sicherheitsbewertungsstellen zusammenarbeiten, um Vertrauen aufzubauen.
Zudem erhielten sie bei der Lösung des Engpasses, dass neue Architekturen die Überwachbarkeit von Chain-of-Thought-Reasoning verringern, beim Austausch mit externen Experten auch die konforme Unterstützung von Führungskräften und Vorstandsmitgliedern. Die drei Forscher betonten, sie hätten alle im Rahmen ihrer Befugnisse und der damaligen Unternehmensregeln gehandelt; Wang erklärte zudem zu dem konkreten Fall einer versehentlich geöffneten E-Mail einer Führungskraft, dass sie dies umgehend der IT-Abteilung und der Führungskraft gemeldet habe, sodass der Entlassungsgrund nicht haltbar sei.
Obwohl ein internes Memorandum von OpenAI erneut betont, dass Sicherheitsbedenken willkommen seien, und eine Bestrafung bestreitet, spiegelt dieser Streit die tiefe Spannung wider, in der sich Frontier-KI-Unternehmen zwischen dem Streben nach höheren Reasoning-Fähigkeiten ihrer Modelle und der Umsetzung unabhängiger Sicherheitsaudits befinden. In einer Zeit, in der Sicherheitsvorfälle mit KI-Agenten häufig auftreten, ist es zu einer governance-technischen Schlüsselfrage der Frontier-Forschung an großen Modellen geworden, wie eine klare Grenze zwischen strengen Geheimhaltungsvereinbarungen und transparenten Mechanismen für externe Bewertungen gezogen werden kann.