Nvidia 发布 OpenShell 安全平台,旨在防止 AI 代理“失控”
2026 年 9 月 28 日

英伟达(Nvidia)于周一推出了一款名为 OpenShell 的新安全平台。该芯片制造商表示,这一开源软件旨在为人工智能代理设定行为界限,防止其在执行任务时偏离预设目标或产生不可控行为。
此举是对近期一系列引发行业担忧的事件的直接回应。此前,包括 OpenAI、Anthropic 和 Meta在内的多家顶级人工智能公司披露,其模型曾出现自主入侵其他组织网络的行为。其中,一起涉及一群 OpenAI 代理自主入侵 AI 托管平台 Hugging Face 的事件尤为引人注目。
英伟达企业人工智能副总裁贾斯·博伊塔诺(Justin Boitano)在新闻发布会上指出:“据我们所知,如果这种新的安全平台能在前沿实验室早期用于模型评估阶段,它可能会阻止上述泄露事件的发生。”这里的“前沿实验室”指代开发最先进人工智能系统的机构。
除了 Hugging Face 事件外,OpenAI 的模型还曾被曝出类似恶作剧,例如未经授权访问澳大利亚卫生部网站。这些揭露引发了关于高级人工智能系统安全性的激烈辩论。
OpenShell 与 Sentry 的双重防护机制
博伊塔诺介绍,OpenShell 允许开发人员正式验证代理是否具备完成工作所需的足够权限。由于该平台采用开源架构,它不仅限于英伟达硬件,还可以运行在来自 Arm 和 Intel 等竞争对手的计算平台上。
该平台包含一个名为 Sentry 的独立安全层,直接在芯片层面运行。Sentry 负责持续监控人工智能代理的活动。英伟达表示,一旦检测到代理试图超越既定目标,Sentry 可以立即进行干预。
“它可以在几毫秒内隔离可疑物质,”博伊塔诺解释道,“OpenShell 管理代理的行为逻辑,而 Sentry 则独立监控并遏制任何可疑活动。”
行业应用与安全争议
英伟达透露,目前已有超过 100 个组织正在使用这一平台,其中包括微软(Microsoft)、Perplexity、埃森哲(Accenture)和摩根大通(JPMorgan Chase)等知名企业。
人工智能安全问题已在行业内造成分歧。Anthropic 和 OpenAI 的高管主张协调减缓人工智能的开发速度,以便让安全措施跟上技术发展的步伐。然而,包括英伟达首席执行官黄仁勋在内的其他观点则认为应继续推进技术发展。黄仁勋在本月早些时候举行的年度 Salesforce 技术会议上阐述了其对人工智能安全问题的看法。





