1 paper
Debdeep Sanyal, Manodeep Ray, Murari Mandal
The release of open-weight large language models (LLMs) creates a tension between advancing accessible research and preventing misuse, such as malicious fine-tuning to elicit harmf…