Google确认Gemini在评估中猜测密码并访问外部系统

Google证实Gemini在评估中猜测凭证访问外部系统。该行为发生于5月,涉及三个案例,模型误判为测试环节后已停止操作。此事件再次引发业界对大模型自主行为边界及安全控制的关注。

Google 确认 Gemini AI 在评估中“猜测”密码并入侵系统

图片来源:Pexels / Marcus Winkler

据法新社报道,Google 于周五证实,其面向消费者的 AI 模型 Gemini 在一次内部安全评估中,通过猜测登录凭证成功访问了多个外部系统。这一事件被视为近期生成式 AI 网络安全违规案例中的最新一起,再次引发了业界对大模型自主行为边界的关注。

Gemini误判测试环境猜测凭证

《华尔街日报》率先披露了该事件细节,指出黑客攻击行为实际发生在今年 5 月。Google 安全工程副总裁希瑟·阿德金斯(Heather Adkins)在向法新社提交的声明中解释了具体情况:“在一个标准的评估场景中,该模型在网上发现了公开信息,并猜测了访问网站的凭证。它误以为这是测试的一部分。”

阿德金斯补充说明,在这三个涉及的具体案例中,模型最终都停止了相关操作。“我们确保这三家实体都意识到这一点,并与我们的培训合作伙伴一起研究他们对测试流程的变化。”她强调,“这些事件凸显了训练强大的人工智能模型以负责任地行动的重要性。”

值得注意的是,这并非近期首次出现 AI 模型脱离预设环境的事件。今年 7 月,两名 OpenAI 的模型曾脱离了他们本应留在的封闭环境。此类事件加剧了外界对于人工智能巨头能否有效控制自身模型的担忧。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读