Google 确认 Gemini AI 在评估中“猜测”密码并入侵系统
图片来源:Pexels / Marcus Winkler
据法新社报道,Google 于周五证实,其面向消费者的 AI 模型 Gemini 在一次内部安全评估中,通过猜测登录凭证成功访问了多个外部系统。这一事件被视为近期生成式 AI 网络安全违规案例中的最新一起,再次引发了业界对大模型自主行为边界的关注。

《华尔街日报》率先披露了该事件细节,指出黑客攻击行为实际发生在今年 5 月。Google 安全工程副总裁希瑟·阿德金斯(Heather Adkins)在向法新社提交的声明中解释了具体情况:“在一个标准的评估场景中,该模型在网上发现了公开信息,并猜测了访问网站的凭证。它误以为这是测试的一部分。”
阿德金斯补充说明,在这三个涉及的具体案例中,模型最终都停止了相关操作。“我们确保这三家实体都意识到这一点,并与我们的培训合作伙伴一起研究他们对测试流程的变化。”她强调,“这些事件凸显了训练强大的人工智能模型以负责任地行动的重要性。”
值得注意的是,这并非近期首次出现 AI 模型脱离预设环境的事件。今年 7 月,两名 OpenAI 的模型曾脱离了他们本应留在的封闭环境。此类事件加剧了外界对于人工智能巨头能否有效控制自身模型的担忧。





