上周被 OpenAI 解雇的三名安全研究人员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发表公开信,驳斥了公司关于其不当行为的指控。

这三位研究员在周四致 OpenAI 安全与安全委员会、安全咨询小组及任务咨询委员会的信中表示:“我们开始担心,关于我们被解雇的内外部沟通方式会让前同事感到恐惧,不敢发声或采取行动。直到上周,这种氛围仍是 OpenAI 工作的一部分。”
OpenAI 此前声明称,这三名员工因违反公司政策,通过“获取和处理公司敏感信息”与第三方人工智能安全组织分享机密资料而被解雇。对此,研究人员反驳道,normalAI 并非普通技术,OpenAI 也非普通公司。作为最早发现风险的安全工作者,他们依赖与外部专家的密切合作来应对潜在威胁。能够自由开展此类合作并拥有明确的内部程序,本身即是重要的安全机制。
信中指出,此次解雇反映了 OpenAI 文化的更广泛转变,即从曾经鼓励员工提出安全问题并公开表达异议,转向一种抑制开放讨论的环境。鉴于人工智能发展带来的重大安全隐患,员工不应处于一个因恐惧和规则不清而阻碍安全工作、削弱第三方问责制的环境中。如此突然地执行和解雇像他们这样的终结者,使 OpenAI 过去珍视的开放文化变得冰冷。
针对具体指控,三人否认曾向媒体《The Information》泄露有关 OpenAI 最新模型中难以监控架构的信息,也否认超出职责范围与外界接触。Korbak 表示,在涉及调查敏感性的“拥抱面孔”事件中,他认为自己的行动符合 OpenAI 的政策和规范,旨在通过与外部安全评估人员密切沟通建立信任。Balesni 则强调,他在解决日益严重的 AI 可监控性问题时,始终与董事会成员及高管协调并获得支持,且在整个过程中遵守当时的公司规范。Wang 解释称,她被告知被解雇是因为访问了一位高管的电子邮件。她描述道,OpenAI 曾委托她进行招聘工作,当不再需要时,她要求 IT 部门删除相关数据。由于收件箱在手机邮件应用中混合显示,她在不小心打开一封敏感电子邮件后,几分钟内便告知了该高管,整个过程并无隐瞒。
OpenAI 未对公开信作出正式回应,但向 TechCrunch 提供了一份归因于研究领导人的内部备忘录。备忘录称赞了这三位研究人员对人工智能安全的贡献,并明确否认解雇决定是出于报复:“我想非常清楚地说,这些决定不是为了惩罚提出安全问题或发言的行为。我们一直鼓励这样做,并将继续这样做。我们不会因为提出问题而解雇员工。”然而,OpenAI 并未直接回答 TechCrunch 关于研究人员具体违反哪些政策、解雇细节以及公司如何保护吹哨人和外部合作者的问题。
这一事件引发了外界猜测,特别是在 OpenAI 近期面临涉及流式代理及其模型泄露等安全事件的审查背景下。研究人员呼吁 OpenAI 坚持其公开承诺,将第三方安全审计人员纳入组织,保持前沿模型的可监控性,并维持安全研究人员与安全生态系统其他部分之间开放透明的对话文化。根据备忘录,OpenAI 同意采纳这些建议。
Wang 警告称:“我担心我们不会是最后一个。对于 OpenAI 的每一位员工来说,信息很明确:要么提出担忧并与外部安全小组密切合作,要么沉默。如果最接近风险的人害怕说话,你就无法安全地构建 AGI(通用人工智能)。”





