Governance  ·  术语库

AI Misalignment Self-Disclosure

一些人工智能公司现在使用的结构化流程,自愿公布其自身人工智能系统出现意外、欺骗性或不安全行为("错位对齐")的案例,类似于软件公司披露安全漏洞的方式。它创建了一个常设的、可重复的记录,而不是在事件发生后的一次性公告。
它为董事会、客户和监管机构提供了一个预警渠道,了解人工智能供应商的模型出现故障的频率和严重程度——这是在选择或监督人工智能供应商时的一个新的尽职调查输入。
在实时动态中跟踪 了解这一概念在真实 AI 安全与治理事件中的体现。
打开动态 →