1 paper
Yuanjie Zhao, Junnan Qiu, Yue Ding +1
Offline Reinforcement Learning (RL) enables policy optimization from static datasets but is inherently vulnerable to backdoor attacks. Existing attack strategies typically struggle…