1 paper
Jonaid Shianifar, Michael Schukat, Karl Mason
Multi-objective reinforcement learning (MORL) enables agents to optimize vector-valued rewards while respecting user preferences. CAPQL, a preference-conditioned actor-critic metho…