OpenAI解雇安全研究员引发争议
「三名被OpenAI解雇的安全研究员发表公开信,否认不当处理敏感信息的指控,警告此次解雇将在公司内部产生寒蝉效应。OpenAI内部备忘录则强调解雇并非因员工提出安全关切。双方围绕AI安全协作、内部程序与信息共享边界各执一词。」
三名被 OpenAI 解雇的安全研究员于本周四发表一封公开信,正面回应公司此前对其不当处理敏感信息的指控。这三人分别是 Jasmine Wang、Tomek Korbak 与 Mikita Balesni。他们在信中对 OpenAI 的说法予以否认,并警告称,此次解雇传递出的信号正在公司内部制造寒蝉效应,其影响将波及整个企业文化。
按照 OpenAI 的说法,三人之所以在上周被解雇,是因为他们与一家第三方 AI 安全机构分享了公司机密信息,违反了公司关于获取与处理敏感信息的政策。研究员们则在信中明确表示,他们既没有参与向 The Information 泄露有关 OpenAI 最新模型中更难被监控的架构的信息,也没有在自身职责范围之外与外部机构进行接触。所谓更难被监控的架构,指的是会让思维链推理更难被外部监测的技术设计。
这封公开信写给 OpenAI 的安全与安保委员会、安全顾问组以及使命顾问委员会。信中写道,内部与外部的沟通已经让前同事们不敢再以过去的方式发言和做事,而这些方式在上一周之前还是 OpenAI 工作方式中不可分割的一部分。他们强调,AI 不是一项普通的技术,OpenAI 也不是一家普通的公司;从事安全工作的人往往比其他人更早看到风险,而识别与应对这些风险,依赖与外部专家的紧密协作。能够免于恐惧地开展这种协作,并拥有定义清晰的内部流程来支撑它,本身就是一项至关重要的安全机制。
三位研究员还认为,此次解雇折射出 OpenAI 文化的一次更广泛转向。过去公司鼓励员工提出安全关切并公开表达不同意见,而如今,一个月前还被视为正常的行为,突然之间就可能成为被解雇的理由,员工因此不清楚自己究竟处于什么位置。他们在信中表示,考虑到 AI 发展伴随的重大安全隐忧,员工不应在一个充满恐惧、规则模糊的环境中工作,因为这种环境会阻碍 AI 安全工作,也会削弱第三方问责的作用。如此突然地执行并对外沟通的解雇决定,正在冷却 OpenAI 过去所珍视的开放文化。
OpenAI 尚未就这封公开信作出正式回应,但向 TechCrunch 提供了一份内部备忘录。这份备忘录出自一位研究负责人之手,其中称赞了三位研究员对 AI 安全的贡献,并否认他们是因为遭到报复而被解雇。备忘录写道,这些决定与提出安全关切或公开发声无关,公司一直鼓励而且将继续鼓励员工表达关切,不会因为员工提出关切而终止雇佣关系。不过,对于研究员究竟违反了哪些具体政策、解雇过程的具体情形,以及公司如何保护员工等问题,OpenAI 并未直接回应 TechCrunch 的提问。
从事件本身来看,双方的争论焦点并不在于 AI 安全是否重要,而在于安全研究工作中的信息边界应如何划定。安全研究往往需要与外部专家保持高频互动,以便更早发现模型在推理透明度与可监控性等方面的潜在问题;与此同时,公司又必须对机密信息的流转设定严格规范。当这两者发生冲突时,制度设计的清晰程度与执行过程的可预期性,都会直接影响研究人员是否愿意继续主动识别风险。
这也是此次公开信反复强调内部程序的原因。研究员们认为,明确的规则与免于恐惧的协作空间并非彼此对立,而是同一种安全能力的两个侧面。一旦规则变得模糊,或者执行方式让人无法预判,风险识别的积极性就会下降,外部对模型开发过程的问责能力也会随之减弱。对于正处在能力快速演进阶段的 AI 行业而言,这类组织层面的变化,其影响可能比单一模型的性能指标更为持久。
来源:Heooo AI工具导航