무슨 일이 있었나
2026년 9월 28일, NVIDIA는 Open Agent Safety Platform을 발표했다: NVIDIA OpenShell(Apache 2.0 오픈소스 보안 런타임, NVIDIA Vera CPU에서 실행되는 에이전트에 커널 수준 격리, 검증 가능한 정책, 행동 추적 제공, Arm/Intel로 확장 가능) 및 NVIDIA Sentry(BlueField-4 DPU에서 실행되는 대역외 워치독, DOCA 기반 인실리콘 위협 탐지를 통해 에이전트가 경계를 이탈하면 밀리초 단위로 격리, 증명된 텔레메트리, 신원 검증, 세분화된 제로트러스트 접근 정책 제공). NVIDIA는 동시에 개발자 블로그 엔지니어링 가이드 'Open Agent Safety Platform: A Reference for Continuous In-Silicon Agent Monitoring'을 게시하여 5대 핵심 원칙(검증 가능한 정책, 대역외 집행, 제어 지점/킬 스위치로서의 모델 경로, 추론 검사 가능성을 통한 권한 확장, 공동 책임 모델)과 3계층 앱/런타임/인프라 아키텍처를 제시했다. 파트너에는 Anthropic(Claude Managed Agents 통합), Cisco, Microsoft, Oracle, CrowdStrike, JPMorganChase, Palantir, Palo Alto Networks, Scale AI, ServiceNow 등이 포함된다.
왜 중요한가
이는 에이전트 보안에 대한 실질적으로 새로운 접근 방식이다: 모델의 실행 환경 외부이자 하드웨어에서 경계를 집행하고, 실행 전에 정책을 검증 가능하게 만들며, 모델 호출 경로에서 방어자에게 킬 스위치를 제공한다. 이는 2026년 돌발 사고(보고된 Hugging Face 노출 포함)에 직접 대응하며, 경쟁사와 표준 기관(CSA는 이미 이를 AARM에 매핑 중)이 기반으로 삼을 엔지니어링 참조 패턴을 정의한다. 벤더 산출물임에도 불구하고, 오픈소스 런타임과 게시된 원칙은 이제 대규모 에이전틱 AI 통제를 위한 사실상의 지침으로 기능한다.
필요한 조치
장기 실행 에이전트 워크로드에 OpenShell/Sentry(또는 이에 상응하는 대역외 집행)를 평가하라. 에이전트 보안 아키텍처 결정에 5대 원칙(대역외 집행, 모델 경로 킬 스위치, 정책 검증, 검사 가능한 추론)을 채택하라. 에이전트 런타임 정책과 웨어러빌리티를 사후 모니터링이 아닌 설계 시점 요구사항으로 취급하라.