指南  ·  2026-09-29

NVIDIA推出Open Agent Safety Platform(OpenShell安全运行时+Sentry芯片内看门狗),提出五项智能体安全工程原则

指南High 影响Global
2026年9月28日,NVIDIA宣布推出Open Agent Safety Platform:NVIDIA OpenShell(Apache 2.0开源安全运行时,提供内核级隔离、可验证策略和运行于NVIDIA Vera CPU上的智能体操作追踪,可扩展至Arm/Intel)和NVIDIA Sentry——运行于BlueField-4 DPU上的带外看门狗,通过基于DOCA的芯片内威胁检测、经证明的遥测、身份验证和细粒度零信任访问策略,在毫秒级将越界智能体隔离。NVIDIA同时发布了开发者博客工程指南"Open Agent Safety Platform: A Reference for Continuous In-Silicon Agent Monitoring",阐述了五项核心原则(可验证策略、带外强制、模型路径作为控制点/紧急开关、随可检查推理扩展权限、共担责任模型)以及三层应用/运行时/基础设施架构。合作伙伴包括Anthropic(Claude Managed Agents集成)、Cisco、Microsoft、Oracle、CrowdStrike、JPMorganChase、Palantir、Palo Alto Networks、Scale AI、ServiceNow等。
这是一种实质性的智能体安全新方法:在模型执行环境之外并在硬件中强制边界,使策略在运行前可验证,并在模型调用路径上为防御者提供紧急开关。它直接回应了2026年的突破事件(包括报道中的Hugging Face暴露事件),并定义了一个工程参考模式,竞争对手和标准机构(CSA已将其映射至AARM)将在此基础上继续构建。即使作为供应商输出,其开源运行时和已发布的原则现在也已成为大规模智能体AI控制的事实性指南。
评估OpenShell/Sentry(或等效带外强制)用于长期运行的智能体工作负载;在智能体安全架构决策中采用五项原则(带外强制、模型路径紧急开关、策略验证、可检查推理);将智能体运行时策略和可观测性视为设计时要求,而非事后监控。
NVIDIA Newsroom — NVIDIA Launches Open Agent Safety Platform to Secure AI Agents From Testing to DeploymentNVIDIA Developer Blog — NVIDIA Open Agent Safety Platform: A Reference for Continuous In-Silicon Agent MonitoringCNBC — Nvidia releases software platform to stop AI agents from breaking out of containment
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →