Токсичность — это степень, в которой контент является оскорбительным, угрожающим, ненавистническим, травящим или иным образом неприемлемым. ИИ-системы могут обнаруживать или оценивать токсичность по различным измерениям для поддержки модерации, оценки безопасности и управления контентом.
The degree to which content is abusive, threatening, or offensive. Many machine learning models can identify, measure, and classify toxicity. Most of these models identify toxicity along multiple parameters, such as the level of abusive language and the level of threatening language.