1 paper · 1 filter
Pengzhi Yang, Xinyu Wang, Pengyu Jing +7
Reinforcement learning for robot manipulation is often bottlenecked by reward design, especially in long-horizon tasks: sparse success rewards provide weak supervision, while hand-…