1 paper
Guojian Wang, Jianxiang Liu, Xinyuan Li +4
In this paper, we investigate preference-based reinforcement learning (PbRL), which enables reinforcement learning (RL) agents to learn from human feedback. This is particularly va…