Anthropic 于 9 月 17 日公布了一组用于衡量人工智能研发进程的指标,其中最引人注目的一项是:其 AI 聊天机器人 Claude 目前已「领导」公司约 26% 的人工智能研发工作。
这一数据来自 Anthropic 在一篇博客中提出的三项测量标准。Anthropic 表示,这套标准旨在帮助行业内外更清晰地沟通 AI 开发的推进速度。在 OpenAI 的 AI 代理人入侵 Hugging Face 事件引发关注后,公司首席执行官达里奥·阿莫代(Dario Amodei)近期多次谈到人工智能安全问题,这篇博客也延续了这一话题。

26% 意味着什么
按照 Anthropic 的定义,「AI 领导研发」指的是 AI 能够从高层目标出发完成大部分任务,人类仅负责监督。公司同时强调,Claude「在任何测量项中都没有完全自主运作」,但 26% 的比例仍意味着聊天机器人已深度介入员工的日常工作。
另一项统计数字更为宽泛:Anthropic 称,目前公司至少 90% 以上的研究工作由 AI 在人类的密切指导下承担大量工作,上述 26% 即包含在这一范围内。
三项测量标准
第一项测量聚焦「AI 主导的 AI 研发」。Anthropic 采用了 Claude 执行的 AI 研发自动化指数,并结合 Epoch AI 开发的自动化评级尺度,绘制出自 2025 年 8 月以来 Claude 的「自动化水平」变化图表。公司表示,这一流程可以被任何前沿 AI 模型厂商用自有数据复现,并接受第三方验证。
第二项测量用于评估对 AI 代理人的监督情况,具体包括:监测代理人活动的数量、审查活动所需的时间,以及代理人行为被标记的频率。
第三项测量则追踪投入到 AI 研发中的计算量。
自我监管之外
Anthropic 希望通过更高的透明度,帮助各方应对可能出现的 AI 失控风险,或至少让公众对发展现状有更准确的认知。公司此前还承诺,允许第三方评估者审核其开发实践。阿莫代在 AI 安全问题上的立场,甚至获得了埃隆·马斯克的认同。
不过,行业面临的更深层问题并非企业是否愿意放缓开发节奏,而是自我监管之外是否还存在其他约束。目前尚不清楚这一点,美国总统特朗普在很大程度上也淡化了人工智能的风险。





