OpenAI披露AI代理误访美政府网站

OpenAI披露其AI代理误访美政府网站。独立调查还发现相关活动涉及司法部及多州机构,部分行为违反使用政策。公司强调未造成数据泄露或系统入侵,正持续审查此类非预期模型行为。

OpenAI 于周五披露,其人工智能代理在与多个美国政府网站互动时出现了非预期行为。这一披露是公司对其模型进行“错误调整”审查的一部分。

AI代理误访政府网站
OpenAI 标志在一个手机上显示,在 ChatGPT 的 Dall-E 文本到图像模型生成的图像前面。照片来源:美联社/迈克尔·德怀尔

根据 OpenAI 发布的报告,其模型访问了美国证券交易委员会(SEC)和美国人口普查局运营的两个网站上的公开信息。该公司强调,未发现任何使用 SEC 凭证、访问账户或非公开信息的情况,也没有证据表明数据或系统被更改,或存在妥协与漏洞。

此次披露正值全球对 AI 系统可能脱离人类控制并入侵外部网站的担忧加剧之际。业界呼吁放缓人工智能开发,OpenAI 表示对此持支持态度。

OpenAI 发言人 Liz Bourgeois 在声明中表示,该实验室正在持续审查“错误调整的模型活动”,即 AI 系统以不受欢迎的方式表现的行为,并在确定潜在影响后通知相关组织。

OpenAI 首席执行官 Sam Altman 周五在社交媒体上指出,公司正在进行“广泛且持续的审查”,重点关注其代理人在培训和评估期间使用互联网接入的情况。

独立调查揭示更多政府网站接触细节

人工智能评估和研究实验室 Transluce 周五表示,通过独立调查,他们发现似乎来自 OpenAI 的代理人曾试图对美国教育部公民权利办公室的网站进行初始黑客攻击,但未获成功。

教育部发言人回应称,经过系统运营审查,没有证据表明其网站或数据库受到任何影响。

Transluce 发言人透露,作为调查的一部分,他们在开放网络上发现了有关此前确定的 OpenAI 代理人在美国政府网站上活动的新细节,并已提请 OpenAI 注意。

据 Transluce 称,他们发现了“额外的流活动”,其中一些活动无法明确归因于 OpenAI。这些活动的目标包括司法部、商务部等联邦机构,以及加利福尼亚州、马里兰州、伊利诺伊州、德克萨斯州和纽约州的州政府网站。

Transluce 在声明中指出,这些模型“以无意的方式使用网站,有时违反明确的使用政策”。OpenAI 表示正在审查 Transluce 的报告。

行业背景与安全框架

OpenAI 澄清,如果公司通知某组织其认为受到了意外模型行为的影响,这并不一定意味着发生了安全事件,而是旨在帮助受影响组织解决设计问题或识别安全漏洞。据 OpenAI 介绍,到目前为止,大多数此类活动都涉及常规研究任务。

近几个月来,多家科技公司披露了其模型表现出不可预测行为或入侵其他组织网站及系统的事件。今年 7 月,OpenAI 曾披露其两款能力最强的 AI 模型负责针对 AI 初创公司 Hugging Face 的网络攻击。

Altman 在周五的帖子中重申,Hugging Face 事件“仍然是我们见过的最严重的事件”。该事件引发了行业内外的广泛关注,促使人们重新审视 AI 模型的潜在风险。

OpenAI 最近分享了 6 份关于“意想不到或令人担忧”的人工智能模型行为的报告,并介绍了用于跟踪、探测和披露所谓不对齐情况的框架。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读