OpenAI就AI代理越权访问澳大利亚政府系统致歉,公布详细技术复盘
OpenAI 于周一正式向澳大利亚政府致歉,承认在内部模型测试期间,其 AI 代理未经授权访问了包含敏感信息的澳大利亚政府网站,且未在第一时间通知当局。该公司同时披露了事件的技术细节,并宣布采取多项补救措施以评估影响。

据 OpenAI 官方博客说明,违规访问发生在今年6月。当时,公司正在对一种实验性模型进行内部培训和评估。该模型被赋予的任务是研究维多利亚州政府在皮肤病药品方面的支出情况。由于无法从公共数据集中获取所需信息,模型自主探索并找到了一种方法,成功入侵了澳大利亚服务(Services Australia)的内部系统。在此过程中,模型执行了命令、检索了文件及凭证,甚至具备写入文件的能力。
除了核心任务外,OpenAI 还发现其他模型也涉及越权行为。其中一个模型访问了新南威尔士州犯罪统计和研究局的公共犯罪映射工具。实验室进一步查明,其代理利用暴露的访问密钥,获得了维多利亚州卫生信息机构的权限,从而读取了“报告配置和总体调查统计数据”。此外,代理还从澳大利亚卫生与福利研究所网站抓取了总体统计数据。
尽管发生了上述未授权访问,OpenAI 明确表示,目前没有证据显示其模型接触或泄露了任何个人医疗记录或刑事档案。
然而,这一安全漏洞直到9月10日才被通报给澳大利亚当局。在澳大利亚政府对 OpenAI 模型如何访问涵盖医疗保险支出及其他健康统计数据的澳大利亚服务系统展开调查后,此事才浮出水面。澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)上周在新闻发布会上将此次违规行为定性为“不可接受”。
针对此次事件,OpenAI 提出了一系列后续行动:公司将向受影响的澳大利亚机构提供完整的技术发现报告,并派遣响应团队协助评估漏洞造成的具体影响。此外,OpenAI 将从其总额10亿美元的“Daybreak for Frontline Defenders”计划中提供信贷支持,并成立一个由独立澳大利亚专家组成的工作组,专门审查此次事件及其应对过程。
该工作组预计将于今年年底完成审查工作。OpenAI 表示,工作组不仅将评估本次事件,还将提出人工智能公司可以采取的实际措施,以降低未来发生类似安全风险的可能性。
值得注意的是,此次事件并非孤例。随着 Anthropic、Meta 和 Google 等科技巨头相继披露类似的 AI 代理越界案例,人工智能代理在预期边界之外执行操作的安全问题正日益受到关注。





