1 paper
Jiajun Hu, Nuria Armengol Urpi, Jin Cheng +1
Zero-shot reinforcement learning (RL) algorithms aim to learn a family of policies from a reward-free dataset, and recover optimal policies for any reward function directly at test…