这些面向防御的术语描述了组织控制措施,用于安全地部署AI代理,从零信任和最小权限原则以及审批门槛等基线原则,到通过红队和紫队演练进行的主动测试,以及防护栏。这些措施共同代表了在部署前和部署期间确保代理AI安全的纵深防御方法。