Defense  ·  术语库

Secure-enclave model evaluation

一种测试AI模型的安全性或能力的方式,其中测试人员和AI公司都无法看到彼此的机密细节,使用特殊的锁定计算环境("安全飞地")在双方都看不到的情况下运行测试。这防止公司根据已知测试调整其模型,并保护测试人员的专有评估问题。
随着政府转向对强大AI模型进行强制性第三方审计,可信的盲测方法是防止这些审计被操纵或泄露的关键。
在实时动态中跟踪 了解这一概念在真实 AI 安全与治理事件中的体现。
打开动态 →