1 paper
Pekka Malo, Lauri Viitasaari, Antti Suominen +2
This paper examines reinforcement learning (RL) in infinite-horizon decision processes with almost-sure safety constraints, crucial for applications like autonomous systems, financ…