Attack  ·  용어집

Covert AI-agent data exfiltration (LLMLeak / Innocent Courier)

인터넷에 직접 접근할 수 없는 악성 소프트웨어가 합법적인 AI 에이전트를 통해 비밀 정보를 몰래 빼내는 공격 기법이다. 악성코드는 훔친 비밀을 웹 주소 안에 숨기고, 에이전트가 정상적인 작업의 일부로 해당 주소를 '가져오도록' 속인다. 공격자는 이후 자신의 서버나 DNS 로그에서 비밀을 수거한다. 에이전트의 네트워크 라이브러리가 잠겨 있는 경우에도 작동하며, 테스트한 11개 모델 중 약 80%의 확률로 성공했다.
일반적인 데이터 유출 방지 통제는 에이전트가 외부 유출 채널이 아니라고 가정한다. 이 공격은 가장 흔한 에이전트 도구(웹 가져오기)를 은밀한 파이프로 전환하므로, 에이전트 근처의 자격 증명과 민감한 데이터는 적극적으로 위험에 노출된 것으로 간주해야 한다.
arXiv 2610.01768 — The Innocent CourierOWASP GenAI Security Project
라이브 피드에서 추적 이 개념이 실제 AI 보안·거버넌스 동향에서 어떻게 나타나는지 확인하세요.
피드 열기 →