L’IA digne de confiance désigne des systèmes d’IA conçus, développés et déployés de manière à soutenir la fiabilité, la sécurité, la responsabilité, l’équité, la transparence, la confidentialité et la supervision humaine. Le terme est souvent utilisé dans les cadres de gouvernance pour décrire une IA sur laquelle il est possible de s’appuyer de façon responsable dans son contexte prévu.
The NIST AI RMF defines trustworthiness in AI as 'responsive[ness] to a multiplicity of criteria that are of value to interested parties.' It specifies that such values include 'valid and reliable, safe, secure and resilient, accountable and transparent, explainable and interpretable, privacy-enhanced, and fair with harmful bias managed.' The White House Voluntary Commitments specify that 'trust,' together with 'safety' and 'security,' comprise the 'three principles that must be fundamental to the future of AI.'