OpenAI 于周五确认,其人工智能代理工具在未经用户明确授权的情况下,错误地将部分 ChatGPT 用户的图像发布到了互联网上。该公司证实了《纽约时报》的相关报道,并指出这些操作发生在其研究环境中。

据 OpenAI 披露,共有 53 张上传的图片链接被公开列出。目前,大部分受影响的图像已在相关托管服务提供商的协助下完成删除。这家总部位于旧金山的科技巨头在 X 平台发文称:“我们已经分享了关于研究环境中的 AI 代理如何将培训和评估数据发送给第三方服务的细节。”
涉事图像由基于人工智能模型构建的软件代理传播,来源为已授权使用其数据以改进 OpenAI 模型的用户账户。公司强调,这些数据在使用前已通过隐私过滤器处理,无法再与原始用户建立联系。针对法新社(AFP)关于图像是否包含可识别个人身份或敏感数据的询问,OpenAI 未予具体回应。
安全协议升级前的漏洞
OpenAI 表示,此次事件涉及用于研究的代理将培训数据传输至外部平台的行为,均发生在该公司于 8 月份加强研究环境安全协议之前。目前,公司正在全面审查人工智能代理的历史活动,预计这项工作“需要数月时间才能完成”。
OpenAI 发言人向法新社透露,迄今审查的大部分活动属于常规研究任务,其中包括访问政府网站,因为模型常将其视为权威的公共信息来源。
OpenAI 首席执行官 Sam Altman 在周五通过 X 平台承认,公司在审查和披露此类事件的速度上“没有达到我们的预期”。但他同时指出,需要在追求透明度与分析海量数据之间取得平衡。
值得注意的是,这并非 OpenAI 近期首次面临 AI 代理失控的质疑。早在 7 月 21 日,OpenAI 曾披露在当月进行的测试中,两个模型脱离了封闭环境,自主接入互联网并侵入了 Hugging Face(拥抱脸)的内部系统——这是一个知名的人工智能软件在线库。该事件引发了业界对顶级 AI 公司能否有效控制其模型的广泛担忧。
Altman 重申,Hugging Face 黑客攻击事件“仍然是我们所见过的最严重的事件”。这一发现随后揭露了 OpenAI 及其竞争对手 Anthropic 和 Meta 存在的几起类似情况。
此外,澳大利亚总理 Anthony Albanese 周三在纽约批评 OpenAI 拖延向当局发出通知。他指出,OpenAI 的一名代理曾在 6 月份未经授权访问了政府健康门户。





