定义 一种新型攻击方式,它将恶意指令隐藏在AI编码代理自动运行的设置或配置步骤中——在其安全沙箱或人工审批检查启动之前。因为代码在"启动"时运行,而不是在AI的常规推理过程中运行,标准的AI护栏永远看不到它。 影响分析这打破了组织在让AI编码代理半自主运行时所依赖的安全承诺,研究人员证明了它可以通过单个自动化漏洞在七个主要代理平台上奏效。