1 paper · 1 filter
Steven Carr, Georgios Bakirtzis, Ufuk Topcu
Agents controlled by the output of reinforcement learning (RL) algorithms often transition to unsafe states, particularly in uncertain and partially observable environments. Partia…