Anthropic整合安全项目推出三层级网络验证计划

Anthropic合并安全项目,推出三层级网络验证计划。新架构涵盖防御、红队及专业访问,旨在向更多组织提供保护能力。此前其协助发现逾12万漏洞,但高危漏洞修复率仍待提升。

Anthropic 整合安全访问项目,推出三层级“网络验证计划”

在上周警告竞争对手 Z.ai 的 GLM-5.3 模型及其网络安全能力存在风险后不久,Anthropic 宣布对其安全访问体系进行重构。该公司将原本独立运行的 Glasswing 项目和“网络验证计划”(CVP)合并为一个扩展服务,旨在向更多安全组织提供保护系统所需的能力。

发现逾12万漏洞修复率待提升

据 Anthropic 介绍,过去六个月中,受信任访问权限主要通过上述两个项目提供。Glasswing 项目与 CVP 均于 2026 年 4 月随 Mythos 模型的发布同步启动。Mythos 是该公司备受追捧的前沿模型,而 Glasswing 项目允许合作伙伴提前访问该模型,以便在潜在攻击者利用漏洞之前扫描其系统。

尽管该项目已运行数月,但外界对其实际效能存在不同看法。VulnCheck 研究员 Patrick Garrity 指出,在他追踪的 225 个与 Anthropic 相关的漏洞中,被野外利用的比例不足 0.5%,因此他对 Glasswing 项目识别出的 CVE 并不十分印象深刻。此外,Anthropic 此前关于 GLM-5.3 带来风险的警告,也在一定程度上削弱了公众认为其自家 Mythos 模型具有特殊优势的观点。

发现逾 12 万漏洞,修复率仍待提升

Anthropic 声称,其安全计划在 2026 年 4 月至 7 月期间,协助合作伙伴发现了至少 129,000 个经过验证的软件漏洞。同时,公司的开源扫描工作在 4 月至 10 月间另外发现了 5,500 个经过验证的漏洞。

“在这些经过验证的漏洞中,超过 33,000 个目前被评为严重或高危级别,”Anthropic 表示,“这很可能是一个低估的数字,因为它仅基于部分 Glasswing 合作伙伴的调查数据。因此,我们预计实际影响至少高出五倍。”

然而,从发现到修复之间的滞后问题依然显著。根据该公司自己的数据,在 5,674 个真实阳性漏洞中,有 3,014 个属于高危级别,1,522 个属于严重级别,但仅有 516 个已被修补。鉴于业界普遍宣传 AI 模型在网络安全方面的实力,生成修复方案、测试并部署本应接近自动化,但当前的数据表明系统中仍存在大量需要解决的延迟。

新架构:防御、红队与专业访问三级分层

此次重构将原有的面向组织和个人的两个项目合并,并划分为三个层级:防御访问(Defense Access)、红队访问(Red Team Access)和专业访问(Specialized Access)。Anthropic 未详细解释划分原因,但称其目标是将模型能力与特定任务挂钩。根据层级不同,参与者在执行与安全相关的任务时会面临不同程度的限制。

作为衡量计划价值的指标,Anthropic 引用了针对 10 个 CyScenarioBench 挑战各尝试五次的数据。结果显示,没有 CVP 访问权限的用户在每次尝试中均被阻止。

  • 防御访问:主要服务于专注于系统防御的公司、非营利组织、大学和政府机构的安全团队。在此层级中,Claude Opus 5.5 在 50 次尝试中有 46 次遭到拒绝,成功率为 4 次。
  • 红队访问:用于渗透测试和进攻性网络评估。参与者若涉及造成人身伤害或大规模混乱的模型交互,仍会面临模型拒绝。具体而言,在启用红队访问保障措施的情况下,Claude Opus 5.5 完成了 50 项任务中的 34 项,这一比率与专业访问的预期表现相似。
  • 专业访问:被视为 Glasswing 项目的重新品牌化。该层级保留给少数经过验证的组织,这些组织获授权测试可能影响人类生活或扰乱市场的关键安全系统,例如飞行操作系统、电网、电信网络、银行间转账基础设施以及政府行政网络。获准进入这一专属层级的用户面临的模型拒绝次数最少,但不包括使用 abli

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读