Пользователь хочет понять data poisoning в контексте LLM Security и применить это к практической работе по AI governance или комплаенсу.
Data poisoning — это adversarial attack, при которой злоумышленник вмешивается в данные или процесс обучения, используемые для создания модели. Вставляя, изменяя или повреждая обучающие примеры, атакующий стремится манипулировать поведением модели, ухудшить ее производительность или создать целевые сбои.
Материал в разработке
Этот ответ сейчас готовится. Загляните позже за полной версией.