指南  ·  2026-08-08

NIST发布AI 200-2初稿:用于评估AI系统的TEVV-Athlon框架

指南High 影响United States
2026年8月7日,NIST宣布并发布了NIST AI 200-2初稿《用于评估AI系统的TEVV-Athlon框架》。这是一份新文件,规范化了NIST AI风险管理框架测量职能中要求但之前未规定的测试、评估、验证和验证(TEVV)方法。该框架定义了一个四阶段方法(表述与组织、定义与构建、应用与测量、综合与审视),用于组织构建定制化AI系统评估("TEVV-Athlon"),涵盖统计ML、LLM、多模态模型和代理系统。公众评论期为60天,截止至2026年10月6日。
这是NIST首个用于规范化广泛采用的AI RMF"测量"职能的规范性方法,该职能之前缺乏具体的评估方法。它为组织、审计师、采购团队和评估者提供了一种结构化、可扩展的方法来生成AI系统安全/性能证据——这直接关系到已经将治理与AI RMF挂钩的各行业的AI安全保证、红队演练和部署前验证项目。
安全和AI治理团队应审查草案并在2026年10月6日前提交意见;构建AI评估/TEVV项目的团队应在最终确定前开始将现有红队和基准测试实践映射到四阶段TEVV-Athlon结构。
NISTNIST AI 200-2 (ipd) PDF
在实时动态中查看 浏览更多 AI 安全与治理相关发现 — 每日清晨更新。
打开动态 →