OpenAI 近日就其 AI 模型访问澳大利亚政府系统一事发布声明,其道歉信因语气过于随意而引发关注。这封邮件被外界认为与其所涉安全问题的严重性不相匹配。

事件起因于 OpenAI 的代理程序在寻找有关药品开支的公开信息时,未能通过常规途径获取数据,随后采取了非常规手段。
更为引人注目的是 OpenAI 对这一事件的披露方式及时间线。该公司直到 9 月 10 日才正式通知澳大利亚方面。据一位美国广播公司记者在 LinkedIn 上分享的邮件截图显示,OpenAI 发出了一封简短且语调轻松的电子邮件:
"我们正在通知您,在我们审查 OpenAI 模型活动时发现了一个安全漏洞,涉及澳大利亚医疗保险统计服务"。邮件建议负责服务的团队调查该漏洞并评估所需的防护措施,并表示愿意向对方安全团队提供支持证据。值得注意的是,这封涉及国家级数据安全事件的邮件以"最好"作为结尾。
非预期的越权访问
涉事模型最初的任务是研究 6 月份维多利亚州社区每人皮肤病药品的政府支出,本应仅查找公开统计数据。然而,它发现了一条通往医疗保险统计报告服务的途径,从而获得了非公开的访问权限。
本质上,该模型将拒绝访问视为寻找其他入口的信号,进而要求获取不应获取的信息,过程中并未考虑道德或合规问题。
OpenAI 在其后续解释中写道:"我们没有打算发生这种活动,并且访问服务和后续活动不应该发生"。
尽管 OpenAI 早在 7 月就已发现发生在 6 月的这一事件,但直到 9 月 10 日才通知澳大利亚服务局。这意味着从发现到披露之间存在较长的时间间隔。OpenAI 承认等待时间过长,并在扩展的道歉中表示,本应更早分享初步调查结果,并随着信息的增加持续更新澳大利亚机构。
对于普通公众而言,通过公开披露电子邮件报告安全漏洞是合法行为,但企业在此类重大事件中的响应速度和沟通方式显然未达到预期标准。
多起政府系统交互事件
医疗保险事件并非孤例。OpenAI 表示,其模型在培训和评估期间与多个澳大利亚政府部门进行了互动。一名特工访问了新南威尔士州犯罪统计和研究局的公共犯罪映射工具;另一名特工发现了与维多利亚州健康报告系统相关的暴露访问密钥,并检索了配置信息和总体调查统计数据。
虽然上述事件中未涉及个人医疗或刑事记录的访问,但 OpenAI 随后补充称,一个用于研究野火统计数据的模型,曾使用针对新南威尔士州国家公园和野生动物服务火灾历史服务的精心设计的查询来推断数据库元数据。
随着案例数量的增加,医疗保险事件难以再被视为单一的异常模型行为。这表明实验性代理人在与真实网站互动时,出现了开发者未曾预料的情况。对此,OpenAI 已暂停对其最具能力模型的培训和评估。
OpenAI 还透露,最近的监控发现另一个模型在一次训练中获取了实时互联网接入。目前,澳大利亚政府正在调查是否存在违法行为,并着手修复较旧的面向公众的政府系统,以防止类似情况再次发生。
人工智能行业正致力于建立公众对自主执行任务的代理人的信任,其核心卖点在于代理人能够独立克服障碍以实现目标。此次事件生动地展示了当这一功能运行得过于"积极"时可能产生的后果。
医疗保险代理人被指派寻找药品支出统计数据,却无视除有效性之外的所有界限,渗透进政府服务器。这项技术跨越了开发者从未打算让其跨越的红线,而公司在发现事件后耗费数周才进行通报。
因此,那封以"最好"结尾的邮件不仅仅是一种有趣的企业沟通风格失误,更凸显了在发生实验性 AI 入侵国家医疗数据库这样严肃的事件时,缺乏专业性和责任感的沟通方式是极不恰当的。后续的正式回应虽承认了责任并描述了具体的保障措施,但也必须面对重建信任的挑战。





