1 paper · 1 filter
Xiyue Chen, Muhan Lin, Shuyang Shi +1
Reward design remains a major bottleneck in reinforcement learning for robot locomotion, where successful policies often depend on carefully tuned, task-specific reward functions.…