Open Internet by MindsNet
Mitigating Fine-Tuning Poisoning Attacks
Fine-tuning poisoning attacks can introduce hidden malicious behaviors in machine learning models. Current defenses focus on detecting malicious data or reducing its impact. However, a more fundamental question remains: can we restrict the model's ability to learn certain malicious updates?
Computing & Technology, Computer Science, Machine Learning