三名被 OpenAI 解雇的安全研究员发公开信否认不当行为指控,警告寒蝉效应
Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect
被 OpenAI 解雇的三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发公开信,否认不当处理敏感信息的指控,称解雇将在公司内部造成寒蝉效应。
Jasmine Wang、Tomek Korbak 和 Mikita Balesni 这三位 OpenAI 上周解雇的安全研究人员发表了一封公开信,否认该公司关于他们在既定公司程序之外不当处理敏感信息的说法,并警告称,他们的解职释放出一种寒蝉效应,将在整个公司文化中引发连锁反应。
“我们开始担忧,围绕我们被解职的内外部沟通,已使我们的前同事们不敢以过去(直到上周)作为在 OpenAI 工作重要组成部分的方式发言和行事,”三位研究人员周四在致 OpenAI 安全与保障委员会、安全咨询小组和使命咨询委员会的公开信中写道。
这些研究人员因据称向一家第三方 AI 安全组织泄露公司机密信息而于上周被解雇。OpenAI 表示,他们“访问和处理敏感公司信息”的行为违反了公司政策。
“AI 不是一项普通的技术,OpenAI 也不是一家普通的公司,”Wang、Korbak 和 Balesni 写道。“我们这些从事安全工作的人比别人更早看到风险,我们依赖与外部专家的紧密合作来研究如何应对这些风险。在没有恐惧的情况下这样做的自由,以及能够实现这项工作的清晰定义的内部程序,本身就是一种重要的安全机制。”
他们说,他们的解职代表了 OpenAI 文化的更广泛转变,这种文化过去曾鼓励员工“提出安全担忧并公开表达异议”。他们说,当一个月前还被认为正常的行为如今突然成为解雇理由时,员工们现在“不清楚自己的处境”。
“鉴于围绕 AI 发展的重大安全担忧,绝不能让员工在恐惧和不明确规则阻碍 AI 安全工作、削弱第三方问责的工作环境中工作,”他们写道。“像我们这样如此突然地执行和传达的解雇,正在冷却 OpenAI 过去所珍视的开放文化。”
在信中,三人否认参与向 The Information 泄露关于 OpenAI 最新模型中较难监测的架构的信息,这些架构使得思维链推理更难被监控。他们还否认在自己的职责范围之外与外部方有过接触。
OpenAI 尚未对这封公开信作出正式回应,但向 TechCrunch 分享了一份据称来自一位研究负责人的内部备忘录,赞扬了这三位研究人员对 AI 安全的贡献,并否认他们因报复而被解雇。
“我想非常明确地表示,这些决定不是因为提出安全担忧或公开发声,”备忘录写道。“我们一直鼓励这样做,并将永远如此。我们不会因为员工提出担忧而将其解雇。”
另外,一位 OpenAI 发言人告诉 TechCrunch,这三人是因一项调查发现其存在“不当行为的模式”,“明显违反了我们关于不当处理研究信息的政策”而被解雇的,其行为超出了与一个外部 AI 评估组织共享信息的范畴。
OpenAI 没有直接回应 TechCrunch 关于研究人员具体违反了哪些政策、其解雇的具体情况,以及公司如何保护提出安全担忧并与外部评估人员合作的员工的问题。
这些解雇事件引发了外界对其处境的猜测,尤其是 OpenAI 正因近期涉及失控智能体的安全事件及其模型泄露消息而面临审视。
这封信还谈及两位研究员对 Hugging Face 事件的回应——在该事件中,一群智能体突破了沙箱并入侵了外部系统。信中称,该事件及其调查“没有先例”,这意味着“内部政策正在实时制定中”。信中称,由于调查的敏感性,Korbak 认为自己与外部安全评估人员密切沟通以建立信任,是在 OpenAI 的政策和规范之内行事。
与此同时,Balesni 也在公司内部着手应对日益严峻的 AI 可监测性问题。两位研究员在信中表示,这一努力“只有通过与外部各方的广泛沟通才能取得成功”。信中称,Balesni 在整个工作中一直与 OpenAI 董事会成员和高管保持协调并获得他们的支持。
信中写道:“整个过程当中,Mikita 都与其汇报线保持沟通,并在分享材料之前仔细删除了敏感细节。”“他自始至终都本着善意,并在当时公司规范范围内行事。”
在 X 上另一个帖子里,Wang 详细解释了自己被解雇的更多情况,称 OpenAI 告诉她,她被解雇是因为访问了一位高管的电子邮件。
“OpenAI 为了招聘工作将这一访问权限委托给了我,”她写道。“当我不再需要它时,我请 IT 部门移除该权限。他们没有处理我的请求,我自己也无法移除,而且该收件箱以难以区分的方式合并到了我手机的邮件应用中。当我误打开一封敏感邮件时,我在几分钟内就告知了那位高管,并再次请求 IT 处理。这一切都没有隐瞒。”
Wang 接着表示,解雇背后的理由“说不通”,她和她的同事们“并不是第一批在可疑情况下被逐出 OpenAI 的人”。
这些研究员呼吁 OpenAI 履行其公开承诺,即在组织内引入第三方安全审计机构、保持前沿模型的可监测性,并“继续支持安全研究人员与安全生态系统其他成员之间开放透明的对话文化”。
根据备忘录,OpenAI 同意他们的建议。
“如果员工们现在不站出来反对这种操作,我担心我们不会是最后一批,”Wang 说。“留给仍在 OpenAI 工作的每个人的信息很明确:提出疑虑或与外部安全组织密切合作,下一个可能就是你,而且不会被告知原因。如果最接近风险的人都不敢发声,就不可能安全地构建 AGI。”
本文已根据 OpenAI 提供的更多信息进行了更新。
当您通过我们文章中的链接购买时,我们可能会赚取少量佣金。这不会影响我们的编辑独立性。
来源:TechCrunch · AI · techcrunch.com