Maîtriser les risques propres à l’IA générative
Contrôle humain, gestion des risques, données confiées aux modèles, transparence et équité.
Ce qu’il faut faire
Prévoir les réponses inventées, l’injection d’instructions, la fuite du contexte et les contenus dangereux : filtrage, citations vérifiables, tests adverses.
La preuve à réunir
Jeu de tests adverses et résultats.
Textes et normes de référence
- NIST AI RMFProfil IA générative NIST AI 600-1
- Recommandation UNESCO sur l’IAPrincipe : proportionnalité et innocuité
Questions fréquentes
Que faut-il faire concrètement ?
Prévoir les réponses inventées, l’injection d’instructions, la fuite du contexte et les contenus dangereux : filtrage, citations vérifiables, tests adverses.
Comment prouver que c’est fait ?
Jeu de tests adverses et résultats.
Sur quels textes repose ce contrôle ?
NIST AI RMF, Profil IA générative NIST AI 600-1 ; Recommandation UNESCO sur l’IA, Principe : proportionnalité et innocuité.