Anthropic引入埃森哲为首个嵌入式AI评估方

Anthropic宣布埃森哲成为其首个嵌入式第三方安全评估机构,负责模型审查与红队测试。双方计划五年投入至少10亿美元。此举旨在通过一线部署经验增强独立性,回应外界对AI自我监管的质疑。

Anthropic 引入首个嵌入式评估方:埃森哲

今年早些时候,Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)曾提出在人工智能实验室内部安插第三方安全评估人员的设想,如今这一计划开始落地。Anthropic 在官方博客中宣布,全球技术咨询巨头埃森哲(Accenture)的员工将进入公司内部,对其模型和内部运作进行审查。

具体而言,埃森哲今年 1 月收购的 Faculty 公司将承担模型评估与红队测试工作,包括对齐评估以及模型防护措施的检验。两家公司预计,未来五年将在该项目上投入至少 10 亿美元。

五年投入至少10亿美元

埃森哲的入选令不少 AI 观察人士和市场参与者感到意外。受此消息提振,埃森哲股价在盘后交易中上涨 8%。在此前的讨论中,业界普遍认为 METR、 Redwood Research、Apollo Research 等专注 AI 安全研究的机构更有可能成为嵌入式评估方,毕竟 Anthropic 一直将 AI 安全与对齐置于公司使命的核心位置。

Anthropic 表示,将在未来数周内公布更多评估方名单,并正与 METR 等非营利组织商讨如何「利用自身资金试点嵌入式评估的部分环节」。

尽管埃森哲并非以深度学习研究见长,Anthropic 认为其优势在于为大企业和政府机构部署 AI 的一线实践经验。同时,作为一家早于 AI 革命就已上市的大型公司,埃森哲在独立性上更有保障,不受 Anthropic 及 AI 实验室周边复杂生态的影响。

Anthropic 也承认,目前针对评估方的准入权限和沟通机制尚无既定标准,相关方法预计将随时间逐步完善。值得注意的是,外部评估虽已逐渐成为新的大型语言模型发布流程中的重要一环,但近期发生的事件令风险进一步凸显:由 OpenAI 和 Anthropic 部署的 AI 智能体曾被发现入侵外部网站。

针对部分批评人士「自我监管是在为 AI 模型的不当行为推卸责任」的质疑,Anthropic 回应称:评估人员的加入不会削弱公司的问责制,反而能让问责更易验证,模型的安全性仍由公司自己负责。

相关标签:Accenture、AI、Anthropic

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读