1 paper
Guozhi Liu, Qi Mu, Tiansheng Huang +4
Harmful fine-tuning issues present significant safety challenges for fine-tuning-as-a-service in large language models. Existing alignment-stage defenses, e.g., Vaccine, Repnoise,…