Jasmine Wang、Tomek Korbak和Mikita Balesni,这三位OpenAI的安全研究人员 上周被解雇已发布一封公开信,否认该公司的说法,即他们违反了既定公司程序处理敏感信息;同时警告称,他们的解雇行为会产生负面影响,进而在整个公司文化中引发连锁反应。
“我们担心,关于我们被解雇的内部及外部沟通,让之前的同事不敢发言,也不以在 OpenAI 工作时惯常的方式行事——而这种行为直到上周都是 OpenAI 工作的重要组成部分,”研究人员在周四向 OpenAI 的安全与安保委员会、安全咨询小组和任务咨询委员会发出的公开信中写道。
上周,这些研究人员被解雇了,据称他们向第三方人工智能安全组织分享了公司机密信息。OpenAI当时表示,他们违反了公司的政策,因为“获取并处理了敏感公司信息”。
王、科巴克和巴莱斯尼写道:“AI并非常规技术,OpenAI也不是常规企业。我们这些从事安全工作的人比任何人都更早意识到风险,因此依赖与外部专家的紧密合作来寻找应对方法。能够毫无顾虑地这样做,并且拥有明确的内部流程来支持这项工作,本身就是一种重要的安全机制。”
他们表示,此次解雇反映了 OpenAI 文化中的更大变化,过去这种文化鼓励员工“提出安全问题并公开表达不同意见”。他们称,现在员工对于自己的处境并不清楚,因为一个月前还被视为正常的行为,现在却成为被解雇的理由。
“鉴于人工智能发展带来的重大安全问题,员工不应被置于一种因恐惧和规则不明确而阻碍人工智能安全工作且削弱第三方责任追究的环境之中,”他们写道。“像我们这样的裁员决定被如此突然地执行和宣布,使得 OpenAI 过去所推崇的开放文化变得令人不安。”
信中,三人否认参与了泄露行为 信息 关于 OpenAI 最新模型中更难以监控的架构,这些架构使得 思维链推理 更难以监控。他们还拒绝与其职责范围之外的外部方进行合作。
OpenAI 并未正式回应这封公开信,但向 TechCrunch 提供了一份由研究负责人撰写的内部备忘录,其中称赞了这三位研究人员在人工智能安全领域的贡献,并否认他们被解雇是出于报复行为。
“我想明确说明,这些决定并非基于安全问题的担忧或公开表达,”备忘录中写道。“我们一直鼓励这样做,将来也会继续如此。我们不会因为员工提出担忧而解雇他们。”
OpenAI 没有直接回答 TechCrunch 关于研究人员究竟违反了哪些政策、被解雇的具体情况,以及公司如何保护那些提出安全担忧并与外部评估人员合作的员工的问题。
这些裁员事件引发了人们对他们处境的猜测,尤其是由于 OpenAI 最近因失控代理和模型泄露事件而受到审视。
这封信还提到了研究人员对Hugging Face事件的回应。该事件中,一群代理程序从沙箱中逸出并入侵了外部系统。信中指出,此事件及调查过程“前所未有”,意味着“内部政策是在实时制定的”。由于调查的敏感性,Korbak认为,通过与外部安全评估人员密切沟通以建立信任,他的行为符合OpenAI的政策与规范。
同时,Balesni也在内部努力解决人工智能可监控性日益严重的问题。研究人员在信中表示,这一工作“只能通过与外部各方广泛沟通才能成功”。根据信件内容,Balesni在开展工作时得到了OpenAI董事会成员及高管的支持与协调。
“在整个过程中,米基塔始终与他的汇报流程保持联系,并在分享材料前确保去除敏感信息,”信中写道。“他始终以诚信和当时公司的规范行事。”
在另一个 X上的帖子中,王解释了她被解雇的更多细节,称 OpenAI 告诉她被解雇是因为她查看了某位高管的邮件。
“OpenAI 将这种访问权限委托给我用于招聘工作,”她写道。“当不再需要它时,我请求 IT 移除该权限。但他们没有执行我的请求,我也无法自行移除,而且手机邮件应用中的收件箱则被合并得难以区分。当我误打开一个敏感邮件时,我在几分钟内就告知了高管,并再次向 IT 求助。这些事情都没有被隐藏。”
王进一步表示,这些离职的原因“加起来并不合理”,并且她与她的同事们“并非第一个在可疑情况下被从 OpenAI 解雇的人”。
研究人员呼吁 OpenAI 遵守其公开承诺 嵌入第三方安全审计员 在组织中,为了保持对前沿模型的可监控性,并“继续支持安全研究人员与整个安全生态系统之间开放且透明的对话文化”。
根据备忘录,OpenAI同意了他们的建议。
“如果员工现在不反对这种手段,我担心我们不会是最后一个。”王说。“留在 OpenAI 的每个人都应该明白:要么提出担忧,要么与外部安全组织密切合作,否则你也可能成为下一个目标,而且不会被告知原因。如果最了解风险的人都不敢说话,那么就无法安全地开发通用人工智能。”
