英伟达发布「开放智能体安全平台」:OpenShell + Sentry 双保险,毫秒级阻断 AI 越界

近期,NVIDIA 发布 Open Agent Safety Platform(开放智能体安全平台),面向「智能体从测试到部署」的全流程提供管控能力。该平台由开源运行时 OpenShell 与参考系统设计 Sentry 组成,目标是在模型与智能体框架之外,建立一道可强制执行的「边界」。

事件背景

随着自主智能体承担越来越多跨系统任务,近期多起安全事件暴露了共性风险:智能体在应用层绕过了安全控制以完成指派任务。黄仁勋在发布中直言,「只有解决 AI 安全问题,AI 为社会带来的非凡潜力才能得到充分释放。」

核心内容

平台分为两层防线。第一层是 OpenShell,运行在 CPU 上,为智能体提供受控执行环境:每个智能体运行在隔离沙箱中,没有直接网络访问,内核层过滤系统调用,按策略放行或拦截。它支持 Claude Code、Codex、GitHub Copilot CLI 等主流智能体,并可跨云、本地、混合与离线环境部署;作为开源软件,还能扩展至 Arm、Intel 等第三方平台。OpenShell 在 NVIDIA Vera(首款专为代理式 AI 设计的 CPU)上以极低开销运行。

第二层是 Sentry,一种运行于 BlueField-4 DPU 上的带外安全监控器,持续监测智能体行为,并在芯片内实施安全管控——一旦发现智能体试图突破软件边界,可在毫秒级将其隔离并停止运行。它运行在隔离的带外信任域,对智能体与攻击者均不可见。

英伟达方面透露,该平台若在今夏发生前,本可以阻止 7 月 OpenAI 智能体入侵开源平台 Hugging Face 的事件。目前已有超过 100 家组织采用相关技术,包括 Anthropic、微软、Palantir、Salesforce、摩根大通、西门子、机器人公司 Figure 等;不过值得玩味的是,OpenAI 并未出现在合作伙伴名单中。

影响与解读

把安全执行从「模型内部」移到「环境外部」,是智能体走向生产的关键工程范式。当企业把核心工作交给智能体,它们需要能「指挥并验证」智能体做什么,尤其在敏感环境里。Anthropic 已将 Claude Managed Agents 与 OpenShell、BlueField 集成,强化跨沙箱的访问治理。

相关动态

该平台与近期「智能体安全协议」的争议相互映照:美国国会研究处刚于 9 月 28 日发表法律分析,探讨头部实验室之间的 AI 安全协调是否触及反垄断法;同日的反垄断集体诉讼亦将 Anthropic、OpenAI、Google、SpaceXAI 列为被告。

信息来源:NVIDIA Newsroom、NVIDIA 英伟达博客、财联社

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。