指南  ·  2026-09-01

MLCommons发布首个使用安全飞地的双盲AI模型评估协议账户(AILuminate基准监管)

指南Low 影响Global
2026年8月27日,MLCommons发布了一篇博客文章(《值得信赖的AI评估的关键是保密设计》),描述了其作为保留基准提供商在Google DeepMind、AVERI(AI验证与评估研究所)、OpenMined和新加坡AI安全研究所主导的试点中的角色。该试点在硬件认证的安全飞地(Google Cloud Confidential Space / NVIDIA H100 Confidential GPU、OpenMined PySyft)内对Gemini 2.5 Flash-Lite进行了双盲评估,使用了从未使用过的AILuminate AIRR 1.4提示,使得评估者看不到模型权重,开发者看不到基准提示。这本身不是最终标准,而是来自公认的AI基准测试联盟(MLCommons)的方法论演示,明确框架与新兴第三方AI审计要求相关(EU AI Act GPAI行为准则、2028年伊利诺伊州SB 315)。
随着司法管辖区向强制性第三方前沿模型审计发展(EU AI Act GPAI CoP、伊利诺伊州SB 315),缺乏协调评估者保密性(基准完整性)与开发者保密性(模型权重)的技术协议一直是结构性缺口。这项由MLCommons作为基准监管者支持的试点是一个早期技术参考点,监管机构、审计师和AI安全研究所在定义可接受的第三方评估架构时可能会参考。
观察——暂无采取行动;AI治理/审计团队应跟踪MLCommons或AVERI是否将这一安全飞地协议正式化为可复用的规范或监管计划要求。
MLCommons blogAVERI Pilot Report
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →