1 paper
David Chhan, Ellen Novoseller, Vernon J. Lawhern
Preference-based reinforcement learning (RL) provides a framework to train AI agents using human feedback through preferences over pairs of behaviors, enabling agents to learn desi…