1 paper
Ying-Tu Chen, Wei Hung, Bing-Shu Wu +2
Many sequential decision-making tasks involve optimizing multiple conflicting objectives, requiring policies that adapt to different user preferences. In multi-objective reinforcem…