Governance  ·  术语库

Cyber-verification model access (safe weak-safeguard access)

受控程序允许经过审查的安全专业人员使用前沿AI模型,同时减少安全防护措施,专门用于发现和验证真实漏洞。访问权限分级且需审批,因此模型的安全防护仅对授权的防御性工作放宽,而非供一般使用。这扩大了能够利用具备网络能力的模型的人群范围,同时不会将该能力广泛释放于关键基础设施之上。
防御者需要能够证明漏洞真实存在的模型;适当管控的访问权限赋予安全团队这一能力,同时管理强大模型被滥用的风险。
在实时动态中跟踪 了解这一概念在真实 AI 安全与治理事件中的体现。
打开动态 →