TechCrunch AI

Die entlassenen Sicherheitsforscher von OpenAI lehnen die Vorwürfe der Fehlverhalten bestreiten und warnen vor einem einschüchternden Effekt

Drei ausgeschiedene OpenAI-Sicherheitforscher bestreiten die Anschuldigungen bezüglich des Missbrauchs sensibler Informationen und warnen in einem offenen Brief, dass ihre Ablehnung einen beunruhigenden Einfluss auf die…

Bildquelle · TechCrunch AI

Jasmine Wang, Tomek Korbak und Mikita Balesni – die drei Sicherheitsforscher, die OpenAI letzte Woche entlassen wurden – haben einen offenen Brief veröffentlicht, in dem sie die Behauptungen des Unternehmens widerlegen, dass sie sensible Informationen außerhalb der etablierten Unternehmensprozeduren verarbeitet hätten. Sie warnen außerdem, dass ihre Entlassung einen beunruhigenden Effekt auslöst, der weitreichende Auswirkungen auf die Unternehmenskultur haben könnte.

„Wir befürchten, dass die internen und externen Kommunikationen bezüglich unseres Ausscheidens unsere ehemaligen Kollegen dazu gebracht haben, nicht zu sprechen und auf eine Weise zu handeln, die bis letzte Woche ein integraler Bestandteil des Arbeitens bei OpenAI war“, schrieben die Forscher am Donnerstag in einem offenen Brief an den Sicherheits- und Sicherheitausschuss, die Sicherheitsberatungsgruppe und den Missionberatungsrat von OpenAI.

Die Forscher wurden letzte Woche abgewiesen, nachdem sie angeblich vertrauliche Unternehmensinformationen mit einer Drittpartei für die KI-Sicherheit organisation mitgeteilt hatten. OpenAI erklärte damals, dass sie gegen die Unternehmensrichtlinien verstoßen hätten, indem sie „sensible Unternehmensinformationen zugänglich machten und bearbeiteten“.

„Künstliche Intelligenz ist keine normale Technologie, und OpenAI ist kein normaler Unternehmen“, schrieben Wang, Korbak und Balesni. „Wir, die wir für Sicherheit arbeiten, sehen die Risiken vor allen anderen und vertrauen auf enge Zusammenarbeit mit externen Experten, um Lösungen zu finden. Die Freiheit, dies ohne Angst zu tun und über klare interne Verfahren zu verfügen, die diese Arbeit ermöglichen, ist an sich ein wesentlicher Sicherheitsmechanismus.“

Sie sagten, dass die Entlassungen eine umfassendere Veränderung in der Kultur von OpenAI darstellen, die zuvor dazu führte, dass Mitarbeiter „sicherheitsbezogene Bedenken äußern und offen anderer Meinung sein konnten“. Sie sagten, die Mitarbeiter seien jetzt „unsicher, wo sie stehen“, da Verhaltensweisen, die vor einem Monat normal waren, nun plötzlich Grund für Entlassungen sind.

„Angesichts der erheblichen Sicherheitsbedenken im Zusammenhang mit der Entwicklung von KI müssen die Mitarbeiter nicht in einer Umgebung arbeiten, in der Angst und unklare Regeln das sichere Arbeiten mit KI behindern und die Verantwortlichkeit Dritter schwächen“, schrieben sie. „Entlassungen wie unsere, die so abrupt durchgeführt und kommuniziert werden, erschrecken die offene Kultur, die OpenAI in der Vergangenheit so geschätzt hat.“

In dem Brief lehnten die drei den Einsatz in einer Enthüllung für The Information ab, die über Architekturen berichtet, die schwerer zu überwachen sind, in den neuesten Modellen von OpenAI, die das Chain-of-Thought-Reduktion schwieriger zu überwachen macht. Sie lehnten auch das Zusammenarbeiten mit externen Parteien außerhalb der Aufgaben ihrer Jobs ab.

OpenAI hat nicht formell auf den offenen Brief geantwortet, aber ein internes Memo, das einem Forschungsleiter zugeschrieben wird, an TechCrunch weitergegeben. Darin werden die Beiträge der drei Forscher zur AI-Sicherheit gelobt und behauptet, dass sie nicht entlassen wurden als Rache.

„Ich möchte ganz klar machen, dass diese Entscheidungen nicht darum gingen, Sicherheitsbedenken zu äußern oder sich zu äußern“, heißt es in dem Memo. „Wir haben immer dazu aufgefordert und werden das auch weiterhin tun. Wir entlassen keine Mitarbeiter, weil sie Bedenken äußern.“

OpenAI hat nicht direkt auf die Fragen von TechCrunch eingegangen, unter welchen Richtlinien die Forscher angeblich verstoßen haben, welche Umstände ihre Entlassung betrafen oder wie das Unternehmen Mitarbeiter schützt, die Sicherheitsbedenken haben und mit externen Bewertungsinstitutionen zusammenarbeiten.

Die Entlassungen haben Spekulationen über ihre Umstände ausgelöst, insbesondere da OpenAI wegen jünger vorgefallener Sicherheitsvorfälle mit fehlerhaften Agenten und Lecks zu seinen Modeln unter Prüfung steht.

Der Brief bezieht sich auch auf die Antwort der Forscher zu dem Hugging Face-Ereignis, bei dem eine Gruppe von Agenten aus ihrem Sandbox-System herausbrach und externe Systeme verletzte. Der Brief besagt, dass das Ereignis und die Untersuchung „kein Vorbild“ waren, was bedeutet, dass „interne Richtlinien in Echtzeit entwickelt wurden“. Aufgrund der sensiblen Natur der Untersuchung glaubte Korbak, dass er im Einklang mit den Richtlinien und Normen von OpenAI handelte, indem er eng mit externen Sicherheitsbewertern in Kontakt stand, um Vertrauen aufzubauen, wie aus dem Brief hervorgeht.

Gleichzeitig arbeitete Balesni auch intern daran, das zunehmende Problem der Überwachbarkeit von KI zu lösen. Die Forscher sagten in ihrem Brief, dass diese Bemühungen „nur durch umfassende Kommunikation mit externen Parteien erfolgreich sein können“. Laut dem Brief koordinierte Balesni seine Arbeit mit den Vorstandsmitgliedern und Führungskräften von OpenAI und wurde von ihnen unterstützt.

„Im Laufe der Zeit kontrollierte Mikita seine Berichterstattungslinie und sorgte dafür, dass sensible Details aus den Materialien entfernt wurden, bevor sie weitergegeben wurden“, heißt es in dem Brief. „Er handelte stets im guten Glauben und gemäß den damals geltenden Unternehmensrichtlinien.“

In einem separaten Thread auf X erklärte Wang weitere Details über ihre Entlassung, und sagte, dass OpenAI ihr mitteilte, sie sei entlassen worden, weil sie die E-Mail eines Vorstandsmitglieds angegriffen habe.

„OpenAI hat mir diesen Zugriff zur Rekrutierung übertragen“, schrieb sie. „Als ich ihn nicht mehr brauchte, bat ich die IT, ihn zu entfernen. Sie haben meinen Wunsch nicht erfüllt, ich konnte ihn nicht selbst entfernen, und das Posteingangssystem war auf meinem Telefon-Postapparat so zusammengeführt, dass es nicht von den anderen E-Mails unterschieden werden konnte. Als ich versehentlich eine sensible E-Mail öffnete, berichtete ich innerhalb weniger Minuten dem Leiter und bat erneut die IT. Alles wurde nicht versteckt.“

Wang fuhr fort, dass die Gründe für die Entlassungen „nicht zusammenpassen“, und dass sie und ihre Kollegen „nicht die ersten sind, die unter verdächtigen Umständen aus OpenAI entlassen wurden“.

Die Forscher forderten OpenAI auf, sich an ihre öffentlichen Verpflichtungen zu halten – nämlich dritte Parteien als Sicherheitsprüfer in die Organisation einzubeziehen – um die Überwachbarkeit der neuen Modelle zu erhalten, und „ weiterhin eine offene und transparente Kultur des Dialogs zwischen Sicherheitsforschern und dem Rest des Sicherheitsökosystems zu unterstützen“.

OpenAI stimmt den Empfehlungen entsprechend dem Memo zu.

„Wenn die Mitarbeiter jetzt nicht eine Position einnehmen gegen diese Art von Manövrieren, bin ich besorgt, dass wir nicht das Letzte sein werden“, sagte Wang. „Die Botschaft an alle, die noch bei OpenAI sind, ist klar: Erhöhen Sie Ihre Bedenken oder arbeiten Sie eng mit externen Sicherheitsgruppen zusammen – dann könnten Sie das Nächste sein, ohne zu wissen, warum. Man kann keine AGI sicher entwickeln, wenn die Menschen, die am meisten mit den Risiken verbunden sind, Angst haben, etwas zu sagen.“

Originalquelle

TechCrunch AI

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten