1 paper
Chaofan Pan, Lingfei Ren, Xiangyu Jiang +6
Offline Reinforcement Learning (RL) agents are trained on fixed behavioral trajectories, which makes trajectory-level deletion important when selected data must be removed after tr…