解决方案  ·  2026-08-29

英国 AI 安全研究所开源 optstop 用于计算高效的前沿模型评估

解决方案Medium 影响Global
AISI 发布了 optstop(2026 年 8 月 27 日),这是一个与其 Inspect 评估框架集成的开源 Python 包,在模型性能估计达到精度/稳定阈值后自适应地停止采样,在二元/序数/连续基准(MATH、GPQA Diamond、WritingBench)上报告 57-97% 的试验节省,且不改变分数估计。
前沿安全/能力评估越来越需要数亿个令牌;一个由政府支持的、可审计的早期停止方法大幅降低了运行严格的危险能力和安全评估的成本,可能增加了实验室和第三方评估器测试前沿模型的频率和彻底程度。
运行基于 Inspect 的评估的 AI 实验室、第三方评估器和模型风险团队应在影子模式下试用 optstop,然后再在安全关键评估中启用实时停止。
UK AI Security InstituteGitHub
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →