1 paper
Shanwen Mao, Hao Zhang, Guangtao nie +4
Real-world Multi-Objective Reinforcement Learning (MORL) often suffers from sparse rewards, reward conflicts, and late-stage reward tug-of-war, causing traditional linear scalariza…