Loading...
🛡️
MLCommons AI Safety Benchmark v1.0(AILuminate)
面向生产就绪的安全性评估框架,跨 12 个危害类别衡量 AI 系统的响应,并为部署决策提供标准化的测试协议。
复杂度: medium评估与监控
In 30 seconds
- What
- 用 12 类标准化危害类别检验 AI 的回复,按 0 到 1 的区间给出安全评分,并自动生成报告与合规验证。
- When to use
- 在把系统投入生产之前,需要针对暴力、偏见、隐私、违法内容等风险留下有据可查的安全证据时。
- Watch out
- 分数反映的是测试覆盖的盲区,而不是现实中的安全性;有恶意的用户总能找到基准测试没有覆盖的失败方式。
Loading technique guide…