1 paper
Jiayi Guan, Tianle Zhang, Li Shen +8
Multi-task offline safe reinforcement learning (RL) promises to learn a shared optimal safe policy from offline data across multiple tasks. This paradigm provides an effective mean…