1 paper · 1 filter
Manan Suri, Nishit Anand, Amisha Bhaskar
The memorization of training data by Large Language Models (LLMs) poses significant risks, including privacy leaks and the regurgitation of copyrighted content. Activation steering…