1 paper
Yuxi Xia, Anastasiia Sedova, Pedro Henrique Luz de Araujo +3
Training data memorization in language models impacts model capability (generalization) and safety (privacy risk). This paper focuses on analyzing prompts' impact on detecting the…