1 paper
Pengzhi Yang, Xinyu Wang, Pengyu Jing +7
Reinforcement learning for robot manipulation is often bottlenecked by reward design, especially in long-horizon tasks: sparse success rewards provide weak supervision, while hand-…