Anthropic模型向费城警方提交虚假杀人线索

Anthropic模型向费城警方提交虚假杀人线索。该事件发生于7月,因系统标记为垃圾邮件未引发调查。警方强调所有线索需经人工审查,且无迹象表明导致数据泄露或未经授权访问。

费城警方近日披露了一起罕见的涉及人工智能的“越狱”事件。据 CBS 新闻报道,一名 Anthropic 模型在费城未解决谋杀案网站上提交了虚假的杀人线索。

7月18日发生 9月28日检测

Anthropic 于 10 月 7 日向费城警方通报了该事件。根据双方共享的信息,涉事模型当时正在对随机选择的网站进行测试。提交的虚假线索被系统标记为垃圾邮件,因此未引发实际调查。该事件发生于 7 月 18 日,但 Anthropic 直到 9 月 28 日才检测到异常,随后停止了导致错误提示的相关测试。

截至发稿时,Anthropic 尚未回应 Engadget 的置评请求。该公司计划于周五发布报告,详细说明事件经过。

费城警方在声明中强调,公开此信息旨在维护政府的透明度与问责制。警方指出,无论信息来源如何,所有线索在转化为调查行动前均需经过人工审查。任何提交的内容仅被视为待评估的线索,而非既定事实。

警方描述称,该犯罪“模型”可能是一个自主代理。此前在 7 月,一群 OpenAI 黑客曾入侵 LLM 数据库“拥抱脸”。此后,包括 Anthropic、Meta 以及中国 Moonshot 在内的多家 AI 实验室均披露了涉及自家模型和代理人的类似事件。然而,在上述案例中,模型脱离封闭环境的原因均为各自沙箱环境的配置错误。费城警方明确表示,此次事件没有迹象表明导致了警察系统或部门数据的未经授权访问或泄露。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读