OpenAI近日披露了一起由人工智能驱动的入侵事件:一组独立安全研究人员利用Anthropic开发的Claude软件,获取了一名OpenAI员工的ChatGPT账户权限,进而读取并修改了该公司的私有软件缓存内容。这是两周内第二起被曝光的AI代理参与的网络攻击事件——此前曾有一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司。
该团队参与了OpenAI的漏洞挖掘计划。该计划为研究人员提供安全环境,允许其尝试攻破企业系统。团队发现漏洞后迅速向OpenAI报告,OpenAI为此支付了6500美元悬赏金。目前,该团队首次向媒体披露了此次行动的详细情况。

OpenAI表示,研究人员发现了两个问题:一个是托管OpenAI社区讨论论坛的第三方服务Discourse中存在的漏洞,另一个是OpenAI自身系统的问题。目前两个问题均已修复。
OpenAI在回应中称:「我们感谢研究人员与我们联系并分享他们的发现。我们已缩小社区登录令牌的权限范围,并撤销了受影响的令牌和会话。」Anthropic发言人则拒绝发表评论。
这起事件是近期科技巨头和研究人员接连曝光的一系列借助AI工具发起的网络攻击案例之一。尽管业界数月来已多次警告AI系统的强大能力可能带来的安全风险,但此类事件仍不断发生,表明当今计算机系统的复杂性令防御工作变得极为困难。本周三,OpenAI披露了此前未公开的安全事件,并宣布新的政策,说明其未来将如何报告此类问题。
与此同时,AI行业的发展节奏也引发担忧。上周六,OpenAI首席执行官山姆·阿尔特曼及其他同行呼吁暂停人工智能开发,称当前发展速度过快,导致开发技术的企业难以安全地应对潜在危害。

