Also known as: ai alignment
L’alignement est la pratique consistant à concevoir, entraîner et gouverner un système d’IA afin que ses objectifs, sorties et comportements restent cohérents avec les intentions et valeurs humaines ainsi qu’avec les contraintes d’usage acceptable. Le terme peut renvoyer à des méthodes techniques, telles que l’ajustement de modèles et la modération de contenu, ainsi qu’à des questions plus larges sur la prévention des comportements nuisibles ou non intentionnels dans les systèmes autonomes.