Un modèle boîte noire est un modèle dont le raisonnement interne ou le processus de décision est difficile ou impossible à comprendre directement par les humains. Les utilisateurs peuvent observer les entrées et les sorties, mais le chemin de l’une à l’autre manque de transparence ou d’interprétabilité. De nombreux modèles d’apprentissage profond et grands modèles de langage sont traités comme des systèmes boîte noire à des fins de gouvernance.
A model whose "reasoning" is impossible or difficult for humans to understand. That is, although humans can see how prompts affect responses, humans can't determine exactly how a black box model determines the response. In other words, a black box model is lacking interpretability. Most deep models and large language models are black boxes.