1 citations · 1 across the 1 of their papers we have counts for
1 paper · 1 filter
Prajit T Rajendran, Fabio Arnez, Huascar Espinoza +2
In high stakes environments, agents relying purely on imitation learning or reinforcement learning often struggle to avoid safety-critical errors during exploration. Existing reinf…