1 paper
Tala Aljaafari, Varun Kanade, Philip Torr +1
Deploying reinforcement learning (RL) in safety-critical settings is constrained by brittleness under distribution shift. We study out-of-distribution (OOD) detection for RL time s…