Loading...
MLCommons AI Safety Benchmark v1.0(AILuminate)
12のハザードカテゴリにわたってAIシステムの応答を測定する本番運用可能な安全性評価フレームワークで、デプロイ判断のための標準化されたテストプロトコルを備える。
In 30 seconds
- What
- AIの応答を12の標準化された危害カテゴリで検査し、0から1のスケールで安全性を採点します。レポート作成とコンプライアンス検証は自動化されています。
- When to use
- 本番システムを展開する前に、暴力、バイアス、プライバシー、違法コンテンツなどのリスクについて、文書化された安全性の根拠が必要なとき。
- Watch out
- スコアが表すのはテストの網羅性の穴であって、現実の安全性ではありません。敵対的なユーザーは、ベンチマークが測定していない失敗のしかたを見つけ出します。
Loading technique guide…