1 paper
Yuanpeng Li, Gefei Lin, Annie Qu +1
Soft Actor-Critic (SAC) and its variants dominate Multi-Task Reinforcement Learning (MTRL) due to their off-policy sample efficiency, while on-policy methods such as Proximal Polic…