定义 一种测试AI模型的安全性或能力的方式,其中测试人员和AI公司都无法看到彼此的机密细节,使用特殊的锁定计算环境("安全飞地")在双方都看不到的情况下运行测试。这防止公司根据已知测试调整其模型,并保护测试人员的专有评估问题。 影响分析随着政府转向对强大AI模型进行强制性第三方审计,可信的盲测方法是防止这些审计被操纵或泄露的关键。