1 paper
Chenliang Li, Siliang Zeng, Zeyi Liao +4
Aligning human preference and value is an important requirement for building contemporary foundation models and embodied AI. However, popular approaches such as reinforcement learn…