定义 一种提示注入攻击,攻击者为AI agent植入恶意指令供其查找并执行,但攻击者永远看不到agent的响应或输出——他们只能从被欺骗的agent采取的任何行动中受益。蜜罐研究已经捕获了真实攻击者对暴露的AI基础设施使用这种技术的情况。 影响分析这表明提示注入已经从实验室的好奇事物演变为一种积极的、机会主义的犯罪技术,正在大规模对互联网面向的AI系统使用。