2026 年 9 月 19 日
人工智能公司 Anthropic 于周五宣布,将与全球咨询巨头埃森哲(Accenture)达成合作。根据协议,埃森哲旗下的专业人工智能业务部门 Faculty 将派遣外部评估人员进入 Anthropic 内部,对其最强大的模型进行独立安全评估。这一举措旨在落实 Anthropic 首席执行官 Dario Amodei 此前关于引入独立观察员监督 AI 发展的承诺。

此次合作的核心任务包括对 Anthropic 的模型进行评估及开展“红队测试”(Red Teaming)。所谓红队测试,是指通过故意诱导人工智能系统出现不当行为或漏洞,以揭露其潜在缺陷的安全实践。
在资金投入方面,Anthropic 与埃森哲均表示,未来五年内各自将为该项目投入至少 10 亿美元。鉴于工作的重要性与紧迫性,Anthropic 目前直接资助埃森哲的相关工作,但公司指出,从长远来看,此类资金应来自合并基金或政府来源。
这一合作背景源于今年 9 月 Dario Amodei 发表的公开文章。他在文中主张,人工智能公司必须放慢提升模型能力的速度,以确保安全性。对此,OpenAI 首席执行官 Sam Altman 回应称,其公司将给予外部评估人员类似的访问权限;Microsoft 首席执行官 Satya Nadella 也欢迎嵌入式评估人员的存在,但同时警告称,监督机制不应由少数实体垄断。
除了埃森哲,Anthropic 表示正在与位于加利福尼亚的非营利组织 Model Evaluation and Threat Research (METR) 进行谈判。然而,包括前白宫人工智能顾问戴维·萨克斯在内的批评人士质疑 METR 的独立性,理由是该组织与 Anthropic 的投资者及员工存在关联。
针对评估机构的独立性标准,周五有一封由 100 多名人工智能研究人员签署的公开信引发关注,其中包括被誉为“人工智能教父”的杰弗里·欣顿。信中呼吁嵌入人工智能公司的评估人员必须保持“有意义地独立”。具体而言,这要求相关组织不得由前沿人工智能公司拥有或管理,不得与其有其他重大商业往来,且不得接受取决于评估结果的任何形式的付款或奖励。





