1 paper · 1 filter
Debdeep Sanyal, Manodeep Ray, Murari Mandal
The release of open-weight large language models (LLMs) creates a tension between advancing accessible research and preventing misuse, such as malicious fine-tuning to elicit harmf…