정의
새로 공개된 공격으로 외부인들이 AI 모델의 비공개 '내부 추론'을 복호화하고 읽을 수 있게 되었습니다. 이는 답변을 도출하는 동안 모델이 일반적으로 사용자에게 숨기는 단계별 메모입니다. 이는 세 개의 가장 큰 AI 제공업체에 모두 영향을 미치고 있으며, 이 취약점이 한 회사의 실수가 아닌 공유된 설계 패턴에 있음을 보여줍니다.
왜 중요한가
기업들은 숨겨진 추론이 경쟁/지적 재산권 이유와 안전 필터링을 위해 숨겨진 상태로 유지되는 것에 의존합니다. 공격자들이 이를 읽을 수 있다면, 그들은 독점 로직을 추출하고 잠재적으로 '보이지 않게' 발생해야 하는 안전 검사를 우회할 수 있는 방법을 찾을 수 있습니다.