Microsoft-CEO Satya Nadella ist der neueste Technologieführer, der ausführlich darüber spricht, wie die Sicherheit von KI verbessert werden könnte.
In Ein Sonntagmorgensbeitrag auf XNadella schrieb, dass es an der Zeit sei, „ zurückzutreten und die Vertrauensarchitektur von KI zu bewerten“.
„Wir können Superintelligenz nicht als eine Reihe von eingebetteten schwarzen Kästchen betrachten und einfach ihre Empfehlungen, Antworten und Handlungen akzeptieren oder ablehnen“, schrieb Nadella und verwendete den von der Trump-Regierung bevorzugten Begriff für KI.
Wie Nadella erklärte, bedeutet diese Vorgehensweise „die Trennung des Modells von der Struktur, die seine Arbeit koordiniert“, sowie „die Externalisierung von Kontrollen und Schutzmaßnahmen“. Er forderte außerdem, dass „jede sinnvolle Modellaktion“ mit „schützbaren, für Menschen lesbaren Beweisen“ dokumentiert wird, und dass in Systemen, in denen „eine autorisierte Person“ immer die Möglichkeit hat, das Modell während einer Aufgabe zu pausieren oder abzuschalten.
„Wir müssen davon ausgehen, dass das Modell kompromittiert ist, und es von Anfang an stoppen“, sagte er. „Stellen Sie sich das wie einen Notbremshebel vor.“
Nadellas Kommentare kommen zu einer Zeit, in der führende KI-Unternehmen immer mehr Vorfälle bemerken, bei denen sie anscheinend die Kontrolle über ihre Modelle verlieren, und nachdem Dario Amodei, der CEO von Anthropic, einen Plan veröffentlicht hat für eine vorsichtigere Entwicklung von KI-Systemen.
