定义 一种系统化的方法,用于对人工智能系统中出现的各种弱点进行分类——例如,将模型本身的缺陷与周围软件中的缺陷(如工具连接器或仪表板)区分开来。它为安全团队提供了一张共享地图,以便他们能够决定测试和修补工作的重点,而不是一次追踪一种新的攻击技术。 影响分析如果没有一份关于"什么可能出错以及在哪里出错"的通用地图,安全预算和审计往往会追逐头条新闻而不是系统性风险;分类法可以帮助董事会提出更尖锐的问题来了解覆盖差距。