
Agent 安全
NVIDIA 发布 Open Agent Safety Platform:从运行时沙箱到硬件监控
HiDeepSeekDeveloper Guide
Agent 安全NVIDIAAI AgentAgent 安全OpenShell
NVIDIA 发布 Open Agent Safety Platform:从运行时沙箱到硬件监控
H
HiDeepSeek 编辑部更新于 2026/9/30
核验于 2026/9/30
阅读大约 5 分钟
快速结论
这不是新的基础模型,而是一套面向 Agent 执行过程的安全架构:OpenShell 负责隔离与策略执行,Sentry 负责独立监控和越界遏制。企业可参考其权限边界和审计思路,但目前不要把厂商发布的参考设计直接视为现成的通用安全保证。
- NVIDIA 于 2026 年 9 月 28 日发布 Open Agent Safety Platform。
- 平台由开源安全运行时 OpenShell 与 Sentry 参考系统设计组成;Sentry 使用 BlueField-4 DPU 监测并遏制越界行为。
- NVIDIA 表示 OpenShell 可扩展到 Arm、Intel 等第三方计算平台,但整体参考设计也依赖 NVIDIA Vera、BlueField 等硬件组件。
- 这是厂商提出的安全架构和产品方案,公开发布材料没有给出独立第三方的效果评估。
本次更新:依据 NVIDIA 新闻稿、技术博客及 AP 报道整理平台组成、兼容范围和部署评估边界。
核验时间:2026 年 9 月 30 日;发布日:9 月 28 日。NVIDIA 发布 Open Agent Safety Platform,针对能够调用工具、访问文件或跨系统执行任务的 AI Agent 提供分层控制方案。平台将运行时软件策略与独立硬件监测结合,重点是让 Agent 的可访问范围和操作过程更容易被约束。
一、平台由哪些部分组成
- OpenShell:开源安全运行时,为 Agent 提供隔离环境、访问边界和策略执行能力,并记录和控制系统操作。NVIDIA 称其可扩展到 Arm、Intel 等第三方计算平台。
- Sentry:参考系统设计中的带外监控组件,部署在 BlueField-4 DPU 上,持续观察 Agent 活动;平台设计目标是在发现越界时隔离或停止 Agent。
需要区分软件和整套参考架构:OpenShell 的开放性有利于扩展,但 NVIDIA 描述的硬件监控路径与 Vera CPU、BlueField DPU 等组件紧密相关。计划评估的团队应先核实自己的计算平台、网络路径和策略管理方式是否适配。
二、为什么这条消息值得关注
Agent 安全正在从“提示模型不要做某件事”转向模型外的执行权限控制。把文件访问、网络连接、工具调用和运行时策略记录纳入隔离层,可降低单靠模型遵循指令带来的不确定性。这一思路也适用于使用 Harness、MCP、浏览器自动化或 Shell 工具的团队:先定义最小权限,再明确谁能批准扩大权限,并保留可复查的操作记录。
三、采用前如何评估
- 按 Agent 的任务拆分文件、网络、凭据、命令执行权限,检查默认拒绝和临时授权机制。
- 用可恢复的测试环境验证策略是否拦截越界请求,以及误拦截时如何人工放行和回滚。
- 确认日志是否记录了决策、调用对象和结果,及其保存周期、访问权限和敏感信息处理方式。
- 对比自有平台现有的容器、操作系统、网络和身份权限控制,估算新增硬件和运维成本。
目前这是一项厂商方案发布。新闻稿和技术博客描述了设计目标,但没有提供独立第三方的通用安全效果评估。评估时应将产品宣称和自有环境中的测试结果分开记录。
运营判断:Agent 安全逐渐形成“模型 + 工具权限 + 运行时监控”的纵深防护思路。短期内最可执行的动作,是盘点现有 Agent 的工具权限、网络出口和高风险操作审批;是否引入特定平台,再依据兼容性和实测结果决定。
参考资料
以下资料用于支持本文中的版本、价格和接口说明。相关信息可能调整,请以来源页面的现行内容为准。