무슨 일이 있었나
1Password의 새로운 Off-by-1 Labs 연구팀은 2026년 8월 6일 6개의 최근 CVE에 걸친 6,080개의 AI 생성 패치 결과를 발표했다: 53.9%는 취약점을 완전히 해결하지 못했거나 새로운 취약점을 도입했으며, 26%만 동작상 부작용 없이 결함을 깔끔하게 해결했다. 연구팀은 논문과 함께 FLAWED 도구 및 데이셋을 오픈소스화했다.
왜 중요한가
자율 AI 패치 생성(예: OpenAI의 Patch the Planet, Anthropic의 Project Glasswing)은 프로덕션 배포 전 전문가 인적 검토를 요구하며, 기업이 AI 기반 취약점 개선 파이프라인을 어떻게 제어해야 하는지를 직접 알린다.
적용 범위
AI 지원 패칭 워크플로우를 채택하는 AppSec 팀은 인적 검토 게이트를 통합하고 자율 패치 생성을 규모 있게 신뢰하기 전에 FLAWED 벤치마크를 참조해야 한다.