1 paper · 1 filter
Marcel Torne, Anubha Mahajan, Abhijnya Bhat +1
Reward design remains a central bottleneck for autonomous robot policy improvement, especially in long-horizon manipulation tasks where sparse success labels provide too little sig…