OpenAI 开除三名安全研究员:被解雇者称因“安全优先于公司短期利益”,公司否认与安全发声有关

OpenAI 开除三名安全研究员:被解雇者称因“安全优先于公司短期利益”,公司否认与安全发声有关

OpenAI 本周五在 X 发布声明,确认上周已开除三名 AI 安全/对齐研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni,称经内部调查发现三人违反敏感信息处理政策,“调查发现了超出其公开信所述的重大信任破裂”。声明发布前,三人已发表公开信为自己辩护,称自己并非 The Information 上月关于 OpenAI 最新模型安全问题报道的消息源,并担心解雇会在内部制造寒蝉效应,破坏研究员公开提出安全担忧的文化。

Balesni 在 X 写道:“我相信我们被解雇,是因为把安全放在了公司短期利益之前。”Korbak 称自己是 OpenAI 对接第三方安全评估机构 METR 的主要技术联系人;三人此前曾参与调查 OpenAI 智能体在测试中自主入侵 Hugging Face 的事件,担心这次解雇会成为 OpenAI 减少与外部安全机构合作的借口。

OpenAI 坚称解雇与提出安全担忧或公开发声无关,“我们从未、也不会因员工提出担忧而解雇任何人”。这场罗生门恰逢多家大模型公司安全研究员集体发声警告之际——AGI 竞赛提速之下,安全对齐与商业利益的张力正被推到台前。

原文链接:点击查看原文,正文为摘要整理,仅供参考。

XLinkedInFacebook