智能体一旦越权,靠日志事后追责根本来不及。NVIDIA 新发布的 NVIDIA Open Agent Safety Platform 把安全闸门下沉到内核和芯片:开源运行时 OpenShell、硬件层 Sentry 和 DOCA 技术,目标直指防止 AI 智能体行为漂移与越权。它不再只靠应用层规则,而是用内核级隔离、零信任环境和带外监控搭完整安全栈。
OpenShell 把操作指令转成可验证策略,智能体每次工具调用、文件访问、网络请求都得先过规则。BlueField DPU 则在模型路径上做实时策略执行与身份治理,把执行点从主机操作系统中抽离。主机即使不可信、已被攻破,DPU 仍能独立保护系统。这正回应前沿实验室反复提示的智能体逃逸风险:安全组件不能和被保护对象共享同一信任边界,否则越狱后只是换一种方式失守。
这套方案的信号很明确:Agent 安全正从提示词护栏、应用层沙箱,走向软硬协同的纵深防御。带外监控让监控通道不经过被监控系统,攻击者控制主机也改不了证据链;芯片级隔离把策略执行变成硬边界,而不是可绕过的中间件。企业和开发者落地智能体,不必先假设模型永不犯错,而要确保每一步都可验证、可拦截、可追溯。NVIDIA 把门槛推到了硬件层,竞争规则也跟着变了。

