1 paper
Yuting Tang, Xin-Qiang Cai, Jing-Cheng Pang +3
Reinforcement Learning (RL) empowers agents to acquire various skills by learning from reward signals. Unfortunately, designing high-quality instance-level rewards often demands si…