정의
AI 시스템이 텍스트뿐만 아니라 이미지, 오디오, 비디오 등 여러 형식을 받아들이기 때문에 공격받을 수 있는 추가적인 방식들 — 각각 자체적인 버그를 포함할 수 있는 자체 처리 코드가 필요함. 공격자는 이러한 추가 형식이 디코딩되는 방식을 악용하여 시스템을 충돌시키거나, 리소스를 소진하거나, 숨겨진 악성 콘텐츠를 삽입할 수 있음.
왜 중요한가
AI 제품들이 경쟁을 위해 음성 및 이미지 기능을 추가하기 위해 경쟁하면서, 각각의 새로운 입력 유형은 보안 팀이 방어해야 할 범위를 조용히 확장시키고 있으며, 종종 방어 수단이 따라잡을 수 있는 것보다 빠르게 확장됨 — 널리 배포된 추론 엔진에서 반복된 오디오/비디오 디코딩 결함으로 나타남.