OpenAI 三名安全研究员被解雇后发文否认泄密指控,警告公司安全文化转向产生寒蝉效应
Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect
OpenAI 三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 被公司解雇后发表公开信,否认违规处理敏感信息和向外泄露的指控,并警告此举将对公司安全文化产生寒蝉效应。
原文同时收录被解雇方的公开信与 OpenAI 内部备忘录的回应,读者可直接对比双方对解雇理由和安全文化的不同说法。
Jasmine Wang、Tomek Korbak 和 Mikita Balesni,这三位被 OpenAI上周解雇的安全研究员,发表了一封公开信,否认该公司关于他们在既定公司流程之外处理敏感信息的指控,并警告说他们的解雇释放了一个令人寒心的信号,将在整个公司文化中产生连锁反应。
"我们担心,围绕我们被解雇事件的内部和外部沟通,已经让我们以前的同事不敢再以那种方式发言和行动——而这种方式在直到上周为止,一直是 OpenAI 工作中不可或缺的一部分," 研究人员周四在致 OpenAI 安全与安保委员会、安全顾问小组和使命顾问委员会的公开信中写道。
这些研究员被指控向第三方 AI 安全组织分享了公司的机密信息,于上周被解雇。OpenAI 当时表示,他们因"访问和处理敏感公司信息"违反了公司政策。
"AI 不是一项普通的技术,OpenAI 也不是一家普通的公司," Wang、Korbak 和 Balesni 写道。"我们这些从事安全工作的人比任何人都更早看到风险,我们依靠与外部专家的密切合作来制定应对方案。能够不受恐惧地这样去做,并拥有明确的内部流程来支持这项工作,本身就是一种至关重要的安全机制。"
他们表示,他们的解雇代表了 OpenAI 文化的更广泛转变——过去公司曾鼓励员工"提出安全关切并公开表达不同意见"。他们说,现在员工"不清楚自己的立场",因为一个月前还被视为正常的行为,如今却突然成为解雇的理由。
"鉴于 AI 开发所面临的重大安全关切,员工绝不应被置于一个充满恐惧和规则不清的环境中工作,这种环境会阻碍 AI 安全工作并削弱第三方问责机制," 他们写道。"像我们这样以如此突然的方式执行和传达的解雇行为,正在让 OpenAI 过去所珍视的开放文化寒意森森。"
在信中,三人否认参与了向The Information泄露 OpenAI 最新模型中较难监测的架构信息的行为,这些架构使思维链推理更难被监测。他们也否认在岗位职责之外与外部方进行过接触。
OpenAI 尚未对这封公开信作出正式回应,但向 TechCrunch 分享了一份内部备忘录,该备忘录署名为一位研究负责人,对三位研究员对 AI 安全的贡献表示赞赏,并否认他们是被报复性解雇的。
"我想非常明确地指出,这些决定与提出安全关切或发声无关," 备忘录中写道。"我们一直鼓励这样做,并且未来也仍将如此。我们不会因为员工提出关切就解雇他们。"
OpenAI 没有直接回应 TechCrunch 关于研究员被指控违反了哪些政策、解雇的具体情况,以及公司如何保护提出安全关切并与外部评估人员合作的员工的提问。
这些解雇事件引发了人们对其背景的诸多猜测,尤其是在 OpenAI 正因近期涉及违规 agent 的安全事件以及模型泄露问题而面临审视的背景下。
这封信还涉及研究人员对Hugging Face 事件的回应,当时一群智能体突破了沙箱,侵入了外部系统。信中称该事件和调查"史无前例",意味着"内部政策是在实时制定中"。根据信中内容,由于调查的敏感性,Korbak 认为自己通过与外部安全评估人员密切沟通来建立信任,是在遵循 OpenAI 的政策和规范。
与此同时,Balesni 也在公司内部致力于应对日益严重的 AI 可监控性问题。研究人员在信中表示,这项工作"只能通过与外部各方的广泛沟通才能成功"。根据信中内容,Balesni 在整个工作过程中与 OpenAI 董事会成员和高管进行了协调,并获得了他们的支持。
信中写道:"在整个过程中,Mikita 一直与他的汇报线保持沟通,并在分享材料前仔细删除敏感细节。" "他始终本着善意行事,并遵循当时公司的规范。"
在另一条X 上的帖文中,Wang 进一步解释了她自己被解雇的细节,称 OpenAI 告诉她被解雇是因为她访问了一位高管的电子邮件。
她写道:"OpenAI 把那个访问权限委托给我是为了招聘。" "当我不再需要它时,我要求 IT 部门将其移除。他们没有处理我的请求,我自己也无法移除,而且收件箱在我手机邮件应用中的显示方式难以区分。当我不小心打开了一封敏感邮件时,我在几分钟内就告诉了那位高管,并再次向 IT 部门提出请求。这些都没有被隐瞒。"
Wang 进一步表示,这些解雇背后的理由"说不通",她和她的同事"并不是第一批在可疑情况下被赶出 OpenAI 的人"。
研究人员呼吁 OpenAI 坚持其公开承诺,在组织内部嵌入第三方安全审计人员,保持前沿模型的可监控性,并"继续支持安全研究人员与更广泛的安全生态之间开放透明的对话文化"。
根据备忘录,OpenAI 同意他们的建议。
Wang 表示:"除非员工现在就站出来反对这种做法,否则我担心我们不会是最后一例。" "对所有仍在 OpenAI 工作的人的信息很清楚:提出担忧或与外部安全团体密切合作,你可能就是下一个,而且不会被告知原因。如果最了解风险的人不敢发声,你就不可能安全地构建 AGI。"
当您通过文章中的链接进行购买时,我们可能会获得少量佣金。这不影响我们的编辑独立性。
来源:TechCrunch · techcrunch.com