1 paper
Ruiqi Wang, Dezhong Zhao, Ziqin Yuan +5
Preference-based reinforcement learning (PbRL) has emerged as a promising paradigm for teaching robots complex behaviors without reward engineering. However, its effectiveness is o…