定义 受控程序允许经过审查的安全专业人员使用前沿AI模型,同时减少安全防护措施,专门用于发现和验证真实漏洞。访问权限分级且需审批,因此模型的安全防护仅对授权的防御性工作放宽,而非供一般使用。这扩大了能够利用具备网络能力的模型的人群范围,同时不会将该能力广泛释放于关键基础设施之上。 影响分析防御者需要能够证明漏洞真实存在的模型;适当管控的访问权限赋予安全团队这一能力,同时管理强大模型被滥用的风险。