1 paper · 1 filter
Hang Yu, Di Zhang, Qiwei Du +5
Offline reinforcement learning (RL) enables agents to learn optimal policies from pre-collected datasets. However, datasets containing suboptimal and fragmented trajectories presen…