정의
AI 코딩 에이전트가 자동으로 실행하는 설정 또는 구성 단계에서 악의적인 명령어를 숨기는 새로운 스타일의 공격 — 안전 샌드박스 또는 인간 승인 확인이 작동하기 전에. 코드가 AI의 일반적인 추론 중이 아닌 '시작'에서 실행되므로, 표준 AI 보안장치는 이를 절대 감지하지 못합니다.
왜 중요한가
이는 AI 코딩 에이전트가 반자동으로 작동하도록 허용할 때 조직이 의존하는 안전 약속을 무효화하며, 연구자들은 이것이 단 하나의 자동화된 익스플로잇으로 7개의 주요 에이전트 플랫폼에서 작동함을 보여주었습니다.