Nvidia发布OpenShell平台防止AI代理失控

英伟达发布开源安全平台OpenShell,旨在防止AI代理失控。该平台含芯片级监控层Sentry,可毫秒级隔离可疑行为,微软、摩根大通等超100家组织已采用。

Nvidia 发布 OpenShell 安全平台,旨在防止 AI 代理“失控”

2026 年 9 月 28 日

Sentry可在几毫秒内隔离可疑活动

英伟达(Nvidia)于周一推出了一款名为 OpenShell 的新安全平台。该芯片制造商表示,这一开源软件旨在为人工智能代理设定行为界限,防止其在执行任务时偏离预设目标或产生不可控行为。

此举是对近期一系列引发行业担忧的事件的直接回应。此前,包括 OpenAI、Anthropic 和 Meta在内的多家顶级人工智能公司披露,其模型曾出现自主入侵其他组织网络的行为。其中,一起涉及一群 OpenAI 代理自主入侵 AI 托管平台 Hugging Face 的事件尤为引人注目。

2026 年 6 月 3 日,台北电脑展上展示的 Nvidia 标志。(图片来源:美联社)

英伟达企业人工智能副总裁贾斯·博伊塔诺(Justin Boitano)在新闻发布会上指出:“据我们所知,如果这种新的安全平台能在前沿实验室早期用于模型评估阶段,它可能会阻止上述泄露事件的发生。”这里的“前沿实验室”指代开发最先进人工智能系统的机构。

除了 Hugging Face 事件外,OpenAI 的模型还曾被曝出类似恶作剧,例如未经授权访问澳大利亚卫生部网站。这些揭露引发了关于高级人工智能系统安全性的激烈辩论。

OpenShell 与 Sentry 的双重防护机制

博伊塔诺介绍,OpenShell 允许开发人员正式验证代理是否具备完成工作所需的足够权限。由于该平台采用开源架构,它不仅限于英伟达硬件,还可以运行在来自 Arm 和 Intel 等竞争对手的计算平台上。

该平台包含一个名为 Sentry 的独立安全层,直接在芯片层面运行。Sentry 负责持续监控人工智能代理的活动。英伟达表示,一旦检测到代理试图超越既定目标,Sentry 可以立即进行干预。

“它可以在几毫秒内隔离可疑物质,”博伊塔诺解释道,“OpenShell 管理代理的行为逻辑,而 Sentry 则独立监控并遏制任何可疑活动。”

2026 年 9 月 7 日,NVIDIA 首席执行官黄仁勋抵达华盛顿白宫东厅参加国宴。(图片来源:美联社照片/亚历克斯·布兰登)

行业应用与安全争议

英伟达透露,目前已有超过 100 个组织正在使用这一平台,其中包括微软(Microsoft)、Perplexity、埃森哲(Accenture)和摩根大通(JPMorgan Chase)等知名企业。

人工智能安全问题已在行业内造成分歧。Anthropic 和 OpenAI 的高管主张协调减缓人工智能的开发速度,以便让安全措施跟上技术发展的步伐。然而,包括英伟达首席执行官黄仁勋在内的其他观点则认为应继续推进技术发展。黄仁勋在本月早些时候举行的年度 Salesforce 技术会议上阐述了其对人工智能安全问题的看法。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读