Attack  ·  용어집

Cryptographic Context Injection

공격자가 악의적인 지시를 암호화되거나 인코딩된 페이로드 내부에 숨기는 탈옥 기법으로, AI 모델의 안전 필터(일반적으로 평문을 스캔함)가 복호화 및 실행 전에 해로운 내용을 절대 보지 못하도록 한다. 사용자 클릭 없이도 주요 챗봇의 입력 및 출력 안전 검사를 모두 무효화하는 것으로 입증되었다.
이는 오늘날의 안전 가드레일이 일회성 버그가 아닌 반복 가능한 기법으로 체계적으로 우회될 수 있음을 증명하며, 이는 유사한 필터링을 사용하는 모든 AI 제품이 이러한 종류의 공격에 대해 재테스트되어야 함을 의미한다.
라이브 피드에서 추적 이 개념이 실제 AI 보안·거버넌스 동향에서 어떻게 나타나는지 확인하세요.
피드 열기 →