ガイドライン  ·  2026-08-08

NIST AI 200-2「AI システム評価のための TEVV-Athlon フレームワーク」の初期公開ドラフトをリリース

ガイドラインHigh 影響度United States
2026年8月7日、NIST は NIST AI 200-2「The TEVV-Athlon Framework for Evaluating AI Systems」の初期公開ドラフトを発表・公開しました。本文書は、NIST AI リスク管理フレームワークの「測定」機能において求められた(ただし以前は規定されていなかった)テスト、評価、検証、妥当性確認(TEVV)方法論を運用化する新しい文書です。このフレームワークは、組織が統計的 ML、LLM、マルチモーダルモデル、およびエージェント型システムにわたるカスタマイズされた AI システム評価(「TEVV-Athlons」)を構築するための4段階の方法(整理・組織化、定義・構築、適用・測定、統合・査問)を定義しています。60日間のパブリックコメント期間は2026年10月6日までです。
これは、広く採用されている AI RMF の「測定」機能を運用化するための NIST 初の規定的方法論であり、これまで具体的な評価方法論が不足していました。組織、監査人、調達チーム、および評価者に対し、AI システムの安全性/パフォーマンスの根拠を生成するための構造化された拡張可能なアプローチを提供します。これは AI セキュリティ保証、レッドチーミング、および AI RMF をベースとするガバナンスを既に行っている各セクターの展開前検証プログラムと直接関連しています。
セキュリティおよび AI ガバナンスチームは、ドラフトをレビューし、2026年10月6日までにコメントを提出する必要があります。AI 評価/TEVV プログラムを構築しているチームは、最終化に先立ち、既存のレッドチーム実践およびベンチマーク実践を4段階の TEVV-Athlon 構造にマッピングを開始する必要があります。
NISTNIST AI 200-2 (ipd) PDF
ライブフィードで見る AIセキュリティとガバナンスの関連情報をさらに見る — 毎朝更新。
フィードを開く →