전략 보고서  ·  2026-10-08

The Observability Gap in AI Agents: What to Fix Before Agents Scale

전략 보고서High 영향도Global
Partnership on AI는 6가지 모니터링 목표를 기준으로 널리 사용되는 4가지 에이전트 프레임워크를 평가했으며, 에이전트가 방출하는 텔레메트리에서 체계적인 사각지대를 발견하고 "에이전트 모니터링을 위한 인프라는 아직 안정적으로 존재하지 않으며, 정책 입안자들은 그것이 존재한다고 가정하고 있다"고 경고했다. 이 보고서는 지속적인 에이전트 ID, 권한 모드 변경, 메모리 변경, 인간 개입, 사고 사슬 추론, 토큰 수준 로그 확률 등 6가지 텔레메트리 격차를 식별하며, 이로 인해 "기업이 에이전트의 권한, 권한의 변경 방식, 에이전트가 그렇게 행동한 이유를 안정적으로 추적할 수 없게 된다"고 밝혔다. 이 보고서는 2026년 7월 OpenAI-Hugging Face 사고를 중심으로, OpenAI가 "거의 일주일 동안 침입을 감지하지 못했다"고 지적하며, AI 기업들이 OpenTelemetry 표준을 공식적으로 채택하고 프레임워크 개발자, 모델 제공업체, 기업, 규제 기관의 협력적 조치를 통해 이러한 격차를 해소할 것을 권고한다.
은행, 보험사, 기업이 프로덕션 환경에서 자율 에이전트를 배포함에 따라, 이 보고서는 CISO와 기술 경영진에게 에이전트 플랫폼이 모니터링, 감사, 책임 추궁이 가능해지기 전에 반드시 방출해야 하는 관측 가능성 신호에 대한 구체적이고 증거 기반의 체크리스트를 제공하며, 공급업체에 요구할 수 있는 명명된 표준(OpenTelemetry)을 제시한다.
6가지 텔레메트리 격차를 기준으로 에이전트 배포를 감사하고, 프레임워크/모델 공급업체에 지속적인 ID, 권한 변경, 메모리 변경, 개입 기록을 방출하도록 요구하며, 공통 신호 계층으로 OpenTelemetry 채택을 평가하라.
Partnership on AI — The Observability Gap in AI Agents
라이브 피드에서 보기 AI 보안 및 거버넌스 관련 소식을 더 살펴보세요 — 매일 아침 업데이트.
피드 열기 →