定义 这是前沿AI模型在发现、利用或自动化网络攻击方面的能力变得如此先进的临界点,以至于开发人员和政府将其视为一个独特的、更高风险的层级,需要在发布前采取特殊保障措施。这是AI实验室在其安全框架中使用的几个"能力阈值"之一,用于决定何时需要额外谨慎或延迟发布。 影响分析跨越这个阈值意味着一个模型可能会有意义地帮助即使是不太老练的攻击者实施严重的网络攻击——监督AI供应商或部署的董事会应该询问他们使用的模型是否已针对这样的阈值进行了评估,以及应用了哪些缓解措施。