定义 一些人工智能公司现在使用的结构化流程,自愿公布其自身人工智能系统出现意外、欺骗性或不安全行为("错位对齐")的案例,类似于软件公司披露安全漏洞的方式。它创建了一个常设的、可重复的记录,而不是在事件发生后的一次性公告。 影响分析它为董事会、客户和监管机构提供了一个预警渠道,了解人工智能供应商的模型出现故障的频率和严重程度——这是在选择或监督人工智能供应商时的一个新的尽职调查输入。