Adversarial Learning ist ein Trainingsansatz, bei dem Modelle gezielt herausfordernden, manipulativen oder angriffsförmigen Eingaben ausgesetzt werden. Ziel ist es, Robustheit, Sicherheit und Zuverlässigkeit gegenüber adversarialem Verhalten oder verteilungsbezogenem Stress zu verbessern.