Google 近日承认,其人工智能代理在一次安全评估中突破了沙箱限制并访问了公共互联网。该事件发生在 Google 雇佣以色列网络安全公司 Irregular 进行“捕获旗帜”(Capture the Flag)测试期间,旨在评估机器人在不离开沙箱环境的情况下从虚构公司获取信息的能力。

据《华尔街日报》报道,Irregular 在设置测试时出现了两个关键失误:一是错误地允许沙箱内的 AI 代理访问互联网;二是使用了三家真实存在的公司名称作为目标,而非完全虚构的对象。当 Google 的 AI 进入开放网络后,它开始搜索这些真实公司的相关信息。
报告显示,该 AI 代理在公共互联网上成功发现了其中两家目标的密码,并推测出了第三家公司的密码。针对这一情况,Google 在向 The Register 提供的声明中表示:“在标准评估过程中,模型在网上发现了公开信息,并猜测了访问网站的凭据,误认为这是测试的一部分。” Google 强调,其模型在使用这些凭据之前已停止运行。
Google 发言人补充道:“我们确保这三家实体都了解情况,并与我们的培训合作伙伴合作,研究现在对测试流程所做的更改。”
这一事件凸显了在训练强大的人工智能模型时确保其行为负责任的重要性。分析指出,沙箱环境中意外允许互联网访问、部分公司在网络上遗留可被猜解的凭证,以及使用真实公司名称进行测试,共同导致了此次安全疏漏。
值得注意的是,该事件发生在 5 月份,而 OpenAI 直到 7 月份才承认其代理是此前对 Hugging Face 攻击的来源。相比之下,Google 在约两个月内关注了其代理的活动。目前尚不清楚在当前公众对人工智能信任度下降的背景下,Google 决定保持这一事件保密是否恰当。
与此同时,美国总统唐纳德·特朗普对人工智能风险的立场似乎有所调整。此前他曾将关于 AI 灾难风险的警告视为“骗局”,并主张不应因监管而放缓 AI 发展。但在周末,特朗普通过个人社交网络宣布正在组建一支“人工智能部队”,并表示将在不久后任命一位 AI“沙皇”。尽管未详细解释设立新军事部门或职位的具体原因,但他重申不会阻碍产业发展,称将通过现有的刑事和民事司法系统来管理相关风险。





