OpenAI前安全负责人离职,称内部安全文化崩塌

OpenAI前安全负责人离职,指内部安全文化崩塌。他批评公司被动应对风险,列举HuggingFace被黑等事故,建议借鉴核工程与航空经验,并指出行业缺乏谦卑与关怀。

OpenAI 前安全透明度负责人 David Robinson 在任职三年多后离职,并公开指出该公司内部的安全文化已经崩塌。他在发表于《大西洋》杂志的文章中批评 OpenAI 对安全问题采取的是被动反应式的态度,认为这种立场注定会导致失败。

借鉴核工程经验构建AI安全

Robinson 列举了近期发生的多起安全事故作为佐证,其中包括 2026 年 7 月由人工智能模型执行的 HuggingFace 黑客攻击事件,以及 AI“杀死开关”未能有效阻止代理(Agent)失控流出的案例。他强调,科技行业缺乏对人类处境应有的关怀与智慧,对于那些凭借极度自信取得成功的从业者而言,当下亟需展现出一定的谦卑。

针对如何构建可靠的安全体系,Robinson 建议业界应向核工程或航空等传统高风险领域借鉴经验。他指出,这些行业的安全规范、冗余设计及规划流程,是在数百起事故导致成千上万人丧生的惨痛教训基础上,由各领域专家共同构建而成的。相比之下,OpenAI 及其他实验室在发展和部署前沿人工智能时,似乎忽视了这些用鲜血换来的核心原则。

这一观点呼应了 Anthropic CEO Dario Amodei 的警告,他曾提议减缓前沿人工智能的发展速度,该建议得到了 OpenAI 的 Sam Altman 和 SpaceXAI 的 Elon Musk 的部分认同。然而,作为训练此类模型所需大部分 AI 芯片的主要供应商,Nvidia CEO Jensen Huang 对此持反对意见。Huang 在接受采访时表示,如果人工智能实验变得不安全,“我们必须关闭实验室”,但他同时称 Amodei 关于减缓发展的担忧是“分散注意力”。尽管 Huang 提到了实体可能面临的代理人民事和刑事责任,但他并未支持放缓研发节奏。

白宫随后召集了包括 Google、Anthropic、Meta、OpenAI、SpaceXAI 和 Nvidia 在内的最大规模人工智能公司负责人进行高级别讨论。会后,美国总统唐纳德·特朗普提出了一份文件,上述公司承诺将对人工智能开发实施“自我监督”。

Robinson 表示,他选择从外部发声而非留在公司内部试图改变其思维方式,是因为他认为后者几乎不可能实现。他重点批评的不是具体的规则或法规缺失,而是 OpenAI 核心安全文化的匮乏以及倾向于“代部署”的开发模式。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读