1 paper
Shreyas Chaudhari, Ameet Deshpande, Bruno Castro da Silva +1
Evaluating policies using off-policy data is crucial for applying reinforcement learning to real-world problems such as healthcare and autonomous driving. Previous methods for off-…