Loading...
MLCommons AI Safety Benchmark v1.0(AILuminate)
Cadre d'évaluation de la sûreté prêt pour la production, qui mesure les réponses des systèmes d'IA à travers 12 catégories de dangers, avec des protocoles de test standardisés pour les décisions de déploiement.
In 30 seconds
- What
- Passe les réponses de l'IA au crible de 12 catégories de risques standardisées, avec un score de sécurité sur une échelle de 0 à 1, des rapports automatisés et une vérification de conformité.
- When to use
- Avant de déployer des systèmes en production quand il vous faut des preuves documentées de sécurité sur la violence, les biais, la vie privée, les contenus illicites et les risques analogues.
- Watch out
- Les scores reflètent les lacunes de couverture des tests, pas la sécurité réelle ; des utilisateurs malveillants trouvent des modes de défaillance que les bancs d'essai ne mesurent pas.
Loading technique guide…