事件经过
1Password 的新 Off-by-1 Labs 研究团队发布(2026 年 8 月 6 日)了来自六个最近 CVE 中 6,080 个人工智能生成补丁的研究结果:53.9% 未能完全补救漏洞或引入了新的漏洞,而只有 26% 干净地解决了缺陷且没有行为副作用。该团队开源了其 FLAWED 工具和数据集以及论文。
影响分析
提供了确凿的证据证明自主人工智能补丁生成(例如 OpenAI 的 Patch the Planet、Anthropic 的 Project Glasswing)在生产部署前需要专家人工审查,直接告知企业应如何控制人工智能驱动的漏洞补救管道。
适用范围
采用人工智能辅助补丁工作流的应用安全团队应纳入人工审查门控,并在信任大规模自主补丁生成前参考 FLAWED 基准。